Modelli
GET /v1/models elenca i modelli disponibili ora per la tua organizzazione.
beatrice-flash
Il modello generalista: italiano curato, coding, ragionamento.
| Caratteristica | Valore |
|---|---|
| Id | beatrice-flash |
| Contesto | 262.144 token |
| Output predefinito | 8.192 token |
Output massimo (max_tokens) | 32.768 token |
| Ragionamento | sì, in reasoning_content |
| Strumenti (tool calling) | sì, anche in parallelo |
- Ragionamento: il modello pensa prima di rispondere. Il ragionamento arriva nel campo
reasoning_content(in streaming:delta.reasoning_content) e conta nei token di output. Con unmax_tokenstroppo basso la risposta può restare vuota perché il ragionamento ha usato tutto lo spazio. - Contesto in cache: se riparti da una conversazione già vista, la parte ripetuta viene letta dalla cache. È più veloce e nei limiti non conta come input (vedi Limiti e piani).
L’id pubblico resta stabile anche quando cambia il modello sotto: aggiornamenti e sostituzioni vengono annunciati prima.