| Report model cache | Report loaded model cache state. |
| Report model capabilities | Report capabilities for a model spec. |
| Detokenize token ids | Detokenize token ids with a local model. |
| Embed one or more texts | Embed one or more texts into vectors. |
| Generate text | Generate text with an inference model. |
| List catalog models | List catalog inference models. |
| List local models | List locally downloaded inference models. |
| Download a model | Download an inference model locally. |
| Rank passages | Rank passages against a query. |
| Tokenize text | Tokenize text with a local model. |
| Unload cached models | Unload cached inference models. |