3.6 Flash, 3.5 Flash-Lite e 3.5 Flash Cyber

 | Intelligenza-Artificiale

Gli sviluppatori e i clienti che realizzano agenti IA di produzione necessitano di una maggiore efficienza dei token, di una latenza inferiore e di prestazioni più affidabili. La nostra serie di modelli Flash è progettata per soddisfare il perfetto equilibrio tra efficienza e qualità e consentire la scalabilità dei flussi di lavoro degli agenti. Basandosi su Gemini 3.5 Flash, stiamo introducendo nuovi modelli Gemini:

  • 3.6 Flash: Il nostro modello di cavallo di battaglia che offre codifica, lavoro di conoscenza e prestazioni multimodali migliori. Secondo il Indice di analisi artificialeriduce l’utilizzo dei token di output del 17% rispetto a 3.5 Flash e in alcuni benchmark come DeepSWE di Curva dei datiosserviamo fino al 65%, il tutto a un costo inferiore per gettone di output.
  • 3.5 Flash Lite: Il nostro modello di classe 3,5 più veloce ed economico, che fornisce 350 token di output al secondo secondo l’Artificial Analysis Index, superando significativamente anche le precedenti generazioni di Flash-Lite nei flussi di lavoro degli agenti.
  • 3.5 Flash Cyber ​​in CodeMender: Le applicazioni di sicurezza informatica di successo richiedono un’attenta orchestrazione di un modello insieme a un’infrastruttura di agenti. Stiamo introducendo una combinazione di un nuovo modello altamente efficiente e specializzato incentrato sul cyber abbinato al nostro agente di sicurezza del codice CodeMender che offre prestazioni competitive all’avanguardia.

Oltre alle versioni odierne, Gemini 3.5 Pro è attualmente in fase di test con i partner e prevediamo di renderlo ampiamente disponibile non appena sarà pronto. Parallelamente, il nostro team si sta già concentrando sulla costruzione della prossima generazione di modelli. Abbiamo iniziato il nostro percorso di pre-allenamento più ambizioso finora, per Gemini 4, e siamo entusiasti dei progressi.

3.6 Flash: più efficiente e di migliore qualità rispetto a 3.5 Flash

Gemini 3.6 Flash si basa direttamente sul feedback degli sviluppatori e dei clienti da 3.5 Flash. 3.6 Flash non solo offre un passo avanti nella codifica e nel lavoro di conoscenza, ma lo fa migliorando significativamente l’efficienza dei token. Ad esempio, sull’Indice di analisi artificiale, vediamo che 3.6 Flash consuma il 17% in meno di token di output rispetto a 3.5 Flash. Sono inoltre necessari meno passaggi di ragionamento e chiamate a strumenti per realizzare flussi di lavoro in più fasi.

Questa maggiore efficienza è inoltre combinata con un prezzo inferiore rispetto a 3,5 Flash. Con 1,50 dollari/1 milione di token di input e 7,50 dollari/1 milione di token di output, 3.6 Flash riduce il costo complessivo per attività dell’agente, rendendo gli agenti più convenienti da costruire ed eseguire.

Fonte: deepmind.google

Lascia un commento

Il tuo indirizzo email non sarà pubblicato. I campi obbligatori sono contrassegnati *