色つきマス目のパズルを数問見せ、共通する規則を推論して新しい入力に当てはめられるかを採点します。知識量ではなく、その場で考える力を測る設計です。
色つきマス目のパズルを数問見せ、共通する規則を推論して新しい入力に当てはめられるかを採点します。知識量ではなく、その場で考える力を測る設計です。
AGI の進み具合を語る記事やモデル発表のスコア比較で引用されます。人間には簡単でも AI には長く難しく、到達度の物差しとして扱われてきました。
左に「知識クイズ」シーン(AI が即答)、右に「ARC-AGI パズル」シーン(人と AI が並んで色マス目の例を見て考え込む)。中央に矢印ではなく対比の縦線を入れる
擬人化ポンチ絵 · 後日差し込み初見の規則をその場で推論できるかを測る指標です。
知識量ではなく、その場で考える力の伸びを追えます。
リーダーボードは動きやすく、数字は参考程度に見ます。
AGI 到達度の議論やモデル進歩の目安として。
数個の例から規則を見つける出題形式を押さえます。
ARC Prize、ARC-AGI-2、Humanity's Last Exam
2019 年に François Chollet が提案。