AI
驚きの番狂わせ:GPT-5.5、過酷な新Agents’ Last ExamベンチマークでClaude Fable 5を破る
Surprise upset: GPT-5.5 beats Claude Fable 5 on brutal new Agents’ Last Exam benchmark
venturebeat2026年6月10日
日本語要約
GPT-5.5が、困難な新ベンチマーク「Agents’ Last Exam」でClaude Fable 5を上回ったと報じられています。この進展は、大規模言語モデルの推論能力とエージェント能力における顕著な飛躍を示唆しています。より洗練されたAIエージェントに向けた競争が加速していることを示唆しています。
English Summary
GPT-5.5 has reportedly outperformed Claude Fable 5 on a challenging new benchmark, 'Agents' Last Exam.' This development signals a notable leap in the reasoning and agentic capabilities of large language models. It suggests an accelerated race towards more sophisticated AI agents.