Nel nuovo flusso di modelli si inserisce anche Google con la sua nuova evoluzione, e ormai appare evidente che la nuova battaglia in tema di AI non si gioca più soltanto sulla capacità di rispondere bene a una domanda. Il vero terreno di scontro sono ormai i compiti lunghi e complessi, quelli in cui un’AI deve lavorare per molto tempo, utilizzare strumenti e arrivare autonomamente a un risultato.
Gemini 4 Argon è il nuovo frontier model con cui Google prova a recuperare terreno su OpenAI e Anthropic, e come sempre sono stati snocciolati i primi numeri, piuttosto interessanti a dire il vero. Argon raggiunge il 77,9% su DeepSWE v1.1, benchmark dedicato ad attività di sviluppo software di lunga durata, e il 51,3% su AutomationBench di Zapier. Nel test LVBench, dedicato invece alla comprensione di video molto lunghi, arriva al 91,7%.
Secondo Google, questi risultati permettono ad Argon di superare GPT-6 Astra e Claude Opus 5.5 in diversi test, ma come sempre i benchmark raccontano soltanto una parte della storia.
Il TOP Android senza compromessi? Samsung Galaxy S25 Ultra, compralo al miglior prezzo da Mondoaffari.it a 714 euro.
CLICCA QUI PER CONTINUARE A LEGGERE
Testi ed immagini Copyright Hdblog.it
