Sakana AI、Fugu-CyberがCyberGymで86.9%、CTI-REALMで72.1%を達成、GPT-5.5-Cyberに匹敵
Sakana AIは、サイバーセキュリティに特化したマルチエージェント・オーケストレーションシステムで、単一のモデルとして機能するFugu-Cyberを発表しました。脆弱性分析のCyberGymテストで86.9%、脅威インテリジェンス翻訳のCTI-REALMテストで72.1%を達成し、GPT-5.5-CyberおよびMythos-Previewに匹敵します。API経由で利用可能ですが、アクセスには手動承認が必要です。
この記事はAIにより一次情報源から生成されました。
Fugu-Cyberとは何か、なぜ単一モデルのように振る舞うのか?
Sakana AIは、複数の専門AIエージェントがタスク解決のために協働するアーキテクチャであるマルチエージェント・オーケストレーションシステムFugu-Cyberを発表しました。これはサイバーセキュリティのみに特化しています。内部では複数のエージェントを調整していますが、システムはユーザーに対しては単一のモデルとして振る舞い応答し、個々のコンポーネント間の切り替えは見えません。
CyberGymとCTI-REALMテストの結果
Fugu-Cyberは、複雑で実際のコードにおける脆弱性分析能力を測定するベンチマークであるCyberGymテストで86.9%の成功率を達成しています。脅威インテリジェンス——さまざまな情報源から収集された脅威に関する情報——をセキュリティシステム向けの具体的な検知ルールに変換する能力を検証するCTI-REALMテストでは、モデルは72.1%を達成しています。Sakana AIによれば、両方の結果は、同様のサイバーセキュリティ領域に特化した2つの主要な競合モデルであるGPT-5.5-CyberおよびMythos-Previewの結果に匹敵するとのことです。
誰がFugu-Cyberを使用できるのか?
モデルへのアクセスはAPIエンドポイントsakana.ai/fuguを通じて行われますが、SakanaのToken Planの契約者に限定されています。すべてのアクセスリクエストは手動承認を経る必要があり、ユーザーはAPIキーを取得する前に検証済みの連絡先を提供しなければなりません。この承認モデルは同社のAcceptable Usage Policy(許容利用ポリシー)に従っており、同ポリシーはツールの攻撃的な悪用——例えば防御ではなく攻撃の開発にシステムを利用すること——を明確に禁止しています。
GPT-5.5-Cyberとの比較可能性がなぜ重要なのか
両ベンチマークの結果は、異なるマルチエージェントアーキテクチャにもかかわらず、Fugu-Cyberが競合する専門モデルに大きく劣っていないことを示しています。セキュリティチームにとってこれは、脆弱性分析と脅威インテリジェンス処理のツール市場における追加の選択肢を意味し、これまで一般的だったAPI提供よりも厳格なアクセス管理が伴います。GPT-5.5-CyberおよびMythos-Previewとの比較は、マルチエージェントアーキテクチャがオーケストレーションの複雑さの増加にもかかわらず、専門的なサイバーセキュリティタスクにおいて必ずしも低い性能を意味するわけではないことを示しています——むしろ、コード分析と情報の解釈を同時に必要とするタスクでは、複数エージェントの協調が優位性となり得ます。
よくある質問
- Fugu-Cyberとは何で、どのように動作しますか?
- Fugu-Cyberは、Sakana AIによるサイバーセキュリティタスクに特化したマルチエージェント・オーケストレーションシステムで、内部では複数の専門エージェントを調整していますが、ユーザーに対しては単一のモデルとして振る舞い、表示されます。
- Fugu-Cyberはセキュリティテストでどれくらい成功していますか?
- Fugu-Cyberは、複雑なコードにおける脆弱性分析能力を測定するCyberGymテストで86.9%の成功率を、脅威インテリジェンス——さまざまな情報源から収集された脅威情報——を検知ルールに変換する能力を測定するCTI-REALMテストで72.1%を達成しており、これはGPT-5.5-CyberおよびMythos-Previewモデルの結果に匹敵します。
- 誰がFugu-Cyberモデルにアクセスできますか?
- アクセスは、SakanaのToken Planの契約者に限定されており、すべてのリクエストは手動承認を経る必要があり、ユーザーはAPIキーを取得する前に検証済みの連絡先を提供しなければなりません。これは、ツールの攻撃的な悪用を明確に禁止するAcceptable Usage Policy(許容利用ポリシー)に従っています。
出典
📬 AIニュースをあなたの受信箱へ
毎日のダイジェストを自分仕様に——トピック、ソース、頻度を選べます。ワンクリックで解除。