谷歌Gemini 4 Argon正式发布,挑战人工智能极限
2026年10月4日 · 阅读 1 分钟
也发布于 العربية
谷歌最近正式发布了备受期待的新人工智能模型Gemini 4 Argon。该模型在技术界引起了广泛关注,特别是在复杂工作流程、网络防御和软件开发领域的表现超越了竞争对手。目前,Gemini 4 Argon正在美国政府的测试过程中,且其广泛访问仍然受到限制,已在人工智能基准测试中与OpenAI的GPT-6 Astra模型直接竞争。
根据Artificial Analysis分享的数据,Gemini 4 Argon在agent评估方面取得了重大进展。该模型在AutomationBench-AA上获得了77.5分,显著改善了之前Gemini版本的弱点,并在Terminal Bench 4等严格测试中表现出色,在分析质量和呈现质量标准上也体现出平衡的特征。
Gemini 4 Argon是谷歌在七个月后推出的首个“闪电”级别外部模型,人工智能指数达到53分,与GPT-6 Astra持平。在成本方面,该模型也采用了相当具有竞争力的定价策略,最初以每百万个token 2美元的入场费和10美元的输出费推出,尽管折扣期结束后,仍计划在市场平均水平上保持竞争力。
尽管测试结果令人印象深刻,但关于模型在实际应用中的表现仍存在一些疑问。据彭博社发布的一份报告,谷歌内部的一些员工表达了对模型在某些编码任务中表现不佳的担忧,这表明学术成就未必能完全反映在实际应用中。