Google выпустил Gemini 4 Argon и обогнал конкурентов в тестах на автоматизацию
Google запустила модель Gemini 4 Argon, которая показала лучшие результаты в собственных бенчмарках среди конкурентов. На тесте DeepSWE v1.1 для решения задач программной инженерии Argon набрала 77,9% против 74,1% у GPT-6 Astra и 74,2% у Claude Opus 5.5.
По AutomationBench, оценивающему способность моделей автономно выстраивать цепочки действий через разные сервисы, Argon получила 51,3% против 41,4% и 40,0% у конкурентов. По Vals Index — сводному показателю для реальных рабочих задач — Google набрала 68,9% против 63,1% у OpenAI и 66,9% у Anthropic.
Источник: ADPASS
Новости этого рынка выходят у нас в телеграме первыми — @wikipulse.