OpenAIがGPT-5.6のハーネスを改善してARC-AGI-3のスコアを3倍に向上させることに成功、モデル自体の性能だけでなくハーネスも重要であることを示す
2026.07.31 12:06
Livedoor.com
AIの知能をルール不明のゲームで測定するというベンチマークが「ARC-AGI-3」です。このARC-AGI-3におけるスコアを3倍にした方法を、OpenAIが解説しています。How enabling two settings tripled our scores on the ARC-AGI-3 benchmark | OpenAIhttps://openai.com/index/how-two-settings-tripled-our-arc-agi-3-scores/GPT-5.6 Sol has been …
検索
人気記事
コメント一覧
まだコメントはありません。