BEATRICE Docs
Sezioni

Modelli

GET /v1/models elenca i modelli disponibili ora per la tua organizzazione.

beatrice-flash

Il modello generalista: italiano curato, coding, ragionamento.

CaratteristicaValore
Idbeatrice-flash
Contesto262.144 token
Output predefinito8.192 token
Output massimo (max_tokens)32.768 token
Ragionamentosì, in reasoning_content
Strumenti (tool calling)sì, anche in parallelo
  • Ragionamento: il modello pensa prima di rispondere. Il ragionamento arriva nel campo reasoning_content (in streaming: delta.reasoning_content) e conta nei token di output. Con un max_tokens troppo basso la risposta può restare vuota perché il ragionamento ha usato tutto lo spazio.
  • Contesto in cache: se riparti da una conversazione già vista, la parte ripetuta viene letta dalla cache. È più veloce e nei limiti non conta come input (vedi Limiti e piani).

L’id pubblico resta stabile anche quando cambia il modello sotto: aggiornamenti e sostituzioni vengono annunciati prima.

l'amor che move il sole e l'altre stelle