モデル

オープンAIとAnthropicの最新モデル、価格と性能を比較

2026年10月6日 · 読了 1 分

他の言語でも公開 English

aerial photo of city
Jonathan Kim / Unsplash

2026年10月3日、OpenAIはGPT-6 Astraを発表し、AnthropicはClaude Fable 5.1をリリースした。さらにDeepSeekはV4.1 FlashとV4 Proを公開し、Grok 4.7も市場に登場した。各社は独自の価格体系と性能指標を提示し、業界内での競争が激化した。

価格面では、GPT-6 Lunaが7セントで、DeepSeek V4.1 Flashが27セント、DeepSeek V4 Proが67セントと報告された。最も高価なタスクはSonnet 5.5で、最大レベルで7.67ドル、Fable 5.1は7.63ドル、Opus 5.5は5.98ドルとなっている。Grok 4.7はAstraより5倍安価だが、タスク単価は3.74ドルである。

性能指標としては、Artificial Analysisの総合指数でClaude Opus 5.5が58点、Claude Sonnet 5.5が56点、Claude Fable 5.1が53点、GPT-6 Astraが53点、GPT-6.1 Solが52点、Grok 4.7が46点、DeepSeek V4.1 Flashが39点、GPT-6 Lunaが38点、DeepSeek V4 Proが36点となっている。Terminal-Bench 4.0ではSonnet 5.5が70.6%、Opus 5.5が66.4%、GPT-6 Astraが57.9%、Fable 5.1が55.8%、Grok 4.7が37.6%と報告された。

各モデルは異なる用途に特化しており、長期的なエージェントタスクではClaudeが優位、価格と品質のバランスではGPT-6.1 Solが最適と評価されている。DeepSeekはオープンモデルの中で最もコストパフォーマンスが高いとされるが、独自測定では会社の報告より低い結果が示されている。

総じて、タスク単価で比較することが最も実用的であり、価格と性能の両面を総合的に検証する必要があると結論付けられている。