UpstageのSolar Mini 4がAI Intelligence Indexで高評価もGPT-6 Lunaの約5倍のコストを報告
日本語参考要約訳
Upstageは新たな独自推論モデルSolar Mini 4を発表した。総パラメータ数35B、アクティブパラメータ3Bで、インテリジェンス指数とアクティブパラメータ数のトレードオフで新たなパレート最適点を達成している。前世代機Solar Pro 3のスコア8を大きく上回る24を記録し、トークン単価も1M tokensあたり入力$0.10、出力$0.40と3分の1に削減した。 Solar Mini 4は同じアクティブパラメータ数のQwen3.6 35B A3B(スコア18)や、はるかに大きいNemotron 3 Ultra(スコア23)を上回る性能を示すものの、パラメータ数の独立検証はできていない。長文推論能力が強みで、AA-LCR v1.1で83%のスコアを示し、MiniMax-M3やGPT-6 Luna(最大値)と並ぶ結果だ。SciCodeでも48%と優位性を持つ。 処理速度は1秒あたり208 tokensとGPT-6 Luna(152 tokens)より速いが、1タスクあたり8.8万トークンの出力を要し、平均7分程度かかる。エージェント型コーディング性能は低く、Terminal-Bench 4.0で1%、AutomationBench-AAで22%となる。一方、知識作業ではGDPval-AAとAA-Briefcaseで一定の成績を残す。
※長文投稿のため、参考訳は概要を最大600字まで表示しています。 元投稿をご参照ください
AINNでは投稿本文・投稿者本人の追記・第三者コメントの全文転載を避け、X公式埋め込みと元投稿への導線を中心に表示します。
AIによる見どころ整理
何について
Upstageは、独自開発の推論モデルSolar Mini 4を公開しました。35Bの総パラメータ数に対し3Bのアクティブパラメータを持ち、同規模のモデルと比べてIntelligence Indexで優れたスコアを達成。しかし、GPT-6 Luna(max)とほぼ同じトークン単価ながら、タスクあたりのコストは約5倍と高くなっています。速度は速いものの、1タスクあたりの時間は平均7.1分を要します。モデルはテキスト入出力のみで、知識精度は低いものの誤出力回避率は比較的高い特徴があります。
なぜ注目
Solar Mini 4は類似パラメータ規模のモデルと比較してIntelligence Indexで優位なスコアを示す一方、タスクあたりコストが高い点が注目されます。また、誤情報の回避率が高いことも利用側が把握すべきポイントです。
🔰 初学者向け要約
Upstageが新たに発表したSolar Mini 4は、テキストの推論を行うAIモデルで、同じ活性パラメータ数のモデルよりも高い知能指数を示しています。性能面では速い出力速度を持つ一方で、1のタスク処理に約7分かかり、コスト面ではGPT-6 Lunaの約5倍かかっています。知識の正確性は高くないものの、誤った情報を出しにくい特徴もあります。
用語を調べる
公開記事とWeb上の出典をもとに、Geminiが短く説明します。1日5回まで利用できます。
