動察 Beating AI 速報、日本のAI企業Sakana AIがFugu MaxとFugu Ultra v2を発表。
これらは本質的に「モデルスケジューラー」である。まずタスクを見て、適切なモデルを選んで分担させ、互いにチェックさせ、最後に答えを統合する。
初代Fuguはこの方法で、GPT、Claude、Geminiなどのモデルをチーム編成し、当時より強力だったFable 5に接近、あるいは一部で上回る成果を達成した。
今回の製品ラインは2つに分かれる。Fugu Maxはコスト削減を主軸とし、モデルプールに更多のオープンウェイトモデルと専門モデルを加え、十分だがより安価なモデルを優先的に選ぶ。公式によると、トップモデルに近い性能で、コストは相手の約1/2から1/6。Fugu Ultra v2は最高性能のみを追求し、8項目の評価中5項目で1位または同率1位、しかもAgentプールにFable 5、Fable 5.1、GPT-6 Astraは含まれていない。
ただし、複数モデルの切り替えはコンテキストキャッシュの再利用を低下させ、追加でオーケストレーションtokenが発生する可能性がある。SakanaはMaxのキャッシュヒット率と単一タスクの総tokenコストを公表していない。初代Fuguもユーザーから遅い、クォータの消費が速いと批判されたことがある。