GPT-6 Astra公開、Looped Transformerと隠れた推論を解説

Judul asli: GPT-6 Astra, looped transformers, and hidden reasoning

Mengapa Ini Penting

フロンティアモデルの性能競争と新アーキテクチャ採用がAI業界に与える影響は大きい。

OpenAIがGPT-6 Astraを正式公開。数学・コーディング・3Dレンダリングで前世代モデルGPT-5.6を大幅に上回り、ARC-AGI-3で99.9%を達成した。

OpenAIは新モデル「GPT-6 Astra」を大々的にリリースした。機械学習研究者のSebastian Raschka博士が実際に使用し、その印象と技術的背景を詳しく解説している。

Astraは数学、コーディング、ライティングなど幅広い分野で前世代のGPT-5.6を上回る。特にARC-AGI-3ベンチマークでは99.9%を達成(GPT-5.6は7.8%)。3Dレンダリング・アニメーション分野でも他モデルを大きく凌駕している。

独立評価機関Artificial AnalysisのIntelligence Index v4.2でもAstraはフロンティアに位置するが、Coding Agent Index v1.4では他モデルとの差は僅差にとどまる。Raschka氏は、モデル開発時に特定のハーネスに最適化される傾向があり、Astraの能力を過小評価している可能性を指摘している。

また、Astraのアーキテクチャに関して「Looped Transformer(ループ型トランスフォーマー)」の採用と、推論トレース(Chain of Thought)を隠蔽しているという噂が注目されている。Raschka氏はこれらの技術的詳細についても本稿で解説している。

Sumber

magazine.sebastianraschka.com — Baca artikel asli →