Gemini 3.0 Proが難関試験HLEで68%を記録、専門家レベルの推論能力に到達か
要点:AIの限界を測る「人類最後の試験(HLE)」において、Gemini 3.0 Proが68%のスコアを記録したと報告されました。この試験は専門家レベルの閉鎖環境での推論能力を評価するもので、AIの学術的・論理的到達点として注目されています。
日本の事業者にとって、なぜ重要?
AIが専門的な研究や複雑な推論をどこまで代替できるかの指標となり、高度な専門業務へのAI導入を検討する際の重要な判断材料となります。
元記事
From the original HLE paper:
元記事を読むAI評価
外部公開データの選定スコアです。評価元の掲載内容も確認できます。
選定元:AI HOT