Gemini 4 argon: google annuncia il modello di frontiera

Gemini 4 argon: google annuncia il  modello di frontiera
Contenuti dell'articolo

Gemini 4 Argon rappresenta la nuova proposta di Google per l’intelligenza artificiale avanzata, progettata per affrontare attività complesse, processi articolati e flussi di lavoro di lunga durata. Il modello punta su ragionamento approfondito, programmazione, sicurezza informatica, ricerca specialistica e scrittura creativa, con capacità multimodali e una quantità di output nettamente superiore rispetto alle versioni precedenti.

gemini 4 argon e la nuova generazione di modelli google

Il modello viene presentato come una tecnologia destinata alla “prossima era dell’intelligenza di frontiera”. La nuova denominazione accompagna un’evoluzione focalizzata sulle attività che richiedono analisi prolungate e risposte articolate. Gemini 4 Argon arriva dopo la cancellazione di Gemini 3.5 Pro e in un contesto in cui Google ha concentrato l’attenzione anche su Gemini 3.8 Flash.

Uno degli elementi più rilevanti riguarda il limite di output, passato da 64.000 a 1 milione di token. Questa capacità consente al sistema di gestire scenari più lunghi e complessi, mantenendo una traiettoria di ragionamento estesa e producendo centinaia di migliaia di token quando necessario.

gemini 4 argon: prestazioni nei benchmark

Nei test dedicati alla programmazione e alla risoluzione di problemi software, Gemini 4 Argon ha ottenuto un risultato di 77,9% nel benchmark DeepSWE v1.1. Il punteggio risulta superiore a quello di Claude Opus 5.5, fermo al 74,2%, e di GPT-6 Astra, che ha raggiunto il 74,1%.

Il modello ha inoltre mostrato risultati rilevanti in ambiti specifici, tra cui la ricerca finanziaria, l’attività legale, l’automazione aziendale e la comprensione di video di lunga durata.

  • 51,3% in AutomationBench, con il primo posto nella valutazione dell’esecuzione automatizzata di attività aziendali;
  • 91,7% in LVBench, benchmark dedicato alla comprensione di video lunghi;
  • prestazioni di rilievo in Vals Finance Agent v2 e nell’Harvey’s Legal Agent Benchmark.

gemini 4 argon per la sicurezza informatica

Google ha addestrato Gemini 4 Argon per offrire capacità avanzate nella difesa informatica, con miglioramenti rispetto a Gemini 3.8 Flash Cyber. Il modello sarà fornito senza alcune barriere di sicurezza informatica ai difensori considerati affidabili e ai team interni di Google, così da permettere l’impiego completo delle sue funzioni specialistiche.

Nel benchmark CWE-bench v1, che misura la capacità di correggere vulnerabilità, Argon ha raggiunto il 68%, risultando a pari merito al primo posto.

Prima della distribuzione più ampia, Google sta lavorando su diversi aspetti legati alla sicurezza e al controllo del modello:

  • prevenzione degli abusi con sistemi capaci di individuare utilizzi impropri collegati ad attacchi informatici o a minacce chimiche, biologiche, radiologiche e nucleari;
  • protezione dagli attacchi di prompt injection, con particolare attenzione agli inserimenti indiretti di istruzioni malevole;
  • rafforzamento degli ambienti isolati utilizzati per l’addestramento e le valutazioni ad alto rischio;
  • monitoraggio del disallineamento, attraverso controlli sulle catene di ragionamento e sulle azioni del modello, con interruzione dell’esecuzione quando necessario.

gemini 4 argon: disponibilità e prezzi dell’api

La distribuzione inizierà prossimamente e coinvolgerà in primo luogo gli abbonati a Google AI Ultra e i clienti paganti dell’API. Il modello è già stato messo a disposizione di tester affidabili e difensori informatici attraverso il Fairwind Program.

  • 2 dollari per un milione di token in ingresso e 10 dollari per un milione di token in uscita durante il periodo introduttivo;
  • token in ingresso memorizzati nella cache con un prezzo ridotto del 95% rispetto alla tariffa standard;
  • dopo la fase promozionale, 4 dollari per un milione di token in ingresso e 20 dollari per un milione di token in uscita.

gemini 4 argon nei flussi di lavoro interni di google

All’interno di Google, migliaia di dipendenti stanno utilizzando Gemini 4 Argon per attività di programmazione specialistica, ricerca approfondita e scrittura. Tra gli impieghi segnalati figura l’analisi dei dati di telemetria dei centri di elaborazione, che ha consentito di individuare ottimizzazioni della memoria.

Una squadra di agenti Argon ha liberato oltre 300 tebibyte di memoria dopo l’applicazione delle ottimizzazioni, con un risparmio complessivo stimato tra 500 tebibyte e 1 pebibyte.

Il modello viene impiegato anche nella migrazione di grandi basi di codice C e C++ verso Rust. Il lavoro interessa progetti che vanno da decine di migliaia di righe fino a oltre 800.000 righe del kernel Zircon del sistema operativo Fuchsia, con verifiche automatiche e manuali, test di emulazione e revisioni prima dell’adozione in produzione.

Nel progetto libgav1, gli agenti Argon hanno sostituito 32.000 righe di codice SIMD, producendo codice Rust sicuro e ottimizzato. Il risultato è un decoder video con gestione sicura della memoria, capace di funzionare 2,7 volte più velocemente rispetto alla precedente versione Rust e di mantenere lo stesso output video.

Lascia un commento

Il tuo indirizzo email non sarà pubblicato. I campi obbligatori sono contrassegnati *