🟡 🛡️ Sicherheit Veröffentlicht: · 2 Min. Lesezeit ·

Sakana AI: Fugu-Cyber erzielt 86,9 % bei CyberGym und 72,1 % bei CTI-REALM, vergleichbar mit GPT-5.5-Cyber

Abstrakte Darstellung eines Multi-Agenten-KI-Systems zur Analyse von Cybersicherheitsschwachstellen

Sakana AI hat Fugu-Cyber vorgestellt, ein Multi-Agenten-Orchestrierungssystem für Cybersicherheit, das wie ein einzelnes Modell auftritt. Es erzielt 86,9 % beim CyberGym-Test zur Schwachstellenanalyse und 72,1 % beim CTI-REALM-Test zur Übersetzung von Threat Intelligence, vergleichbar mit GPT-5.5-Cyber und Mythos-Preview. Verfügbar über API mit manueller Zugangsfreigabe.

🤖

Dieser Artikel wurde mithilfe von künstlicher Intelligenz aus Primärquellen erstellt.

Was ist Fugu-Cyber und warum tritt es als einzelnes Modell auf?

Sakana AI hat Fugu-Cyber vorgestellt, ein Multi-Agenten-Orchestrierungssystem — eine Architektur, bei der mehrere spezialisierte KI-Agenten bei der Lösung einer Aufgabe zusammenarbeiten —, das ausschließlich auf Cybersicherheit spezialisiert ist. Obwohl es intern mehrere Agenten koordiniert, verhält sich und antwortet das System dem Nutzer gegenüber wie ein einzelnes, einheitliches Modell, ohne sichtbare Übergänge zwischen den einzelnen Komponenten.

Ergebnisse bei den Tests CyberGym und CTI-REALM

Fugu-Cyber erzielt 86,9 % Erfolgsquote beim CyberGym-Test, einem Benchmark, der die Fähigkeit misst, Schwachstellen in komplexem, realem Code zu analysieren. Beim CTI-REALM-Test, der die Übersetzung von Threat Intelligence — aus verschiedenen Quellen gesammelten Bedrohungsdaten — in konkrete Erkennungsregeln für Sicherheitssysteme prüft, erzielt das Modell 72,1 %. Sakana AI gibt an, dass beide Ergebnisse mit denen von GPT-5.5-Cyber und Mythos-Preview vergleichbar sind, zwei führenden Konkurrenzmodellen, die auf ein ähnliches Segment der Cybersicherheit spezialisiert sind.

Wer darf Fugu-Cyber nutzen?

Der Zugang zum Modell erfolgt über den API-Endpunkt sakana.ai/fugu, ist jedoch ausschließlich auf Abonnenten von Sakanas Token Plan beschränkt. Jede Zugangsanfrage durchläuft eine manuelle Genehmigung, und der Nutzer muss einen verifizierten Kontakt angeben, bevor er einen API-Schlüssel erhält. Dieses Genehmigungsmodell folgt der Acceptable Usage Policy des Unternehmens, die den offensiven Missbrauch des Tools ausdrücklich untersagt — etwa die Nutzung des Systems zur Entwicklung von Angriffen statt zur Verteidigung.

Warum ist die Vergleichbarkeit mit GPT-5.5-Cyber wichtig?

Die Ergebnisse in beiden Benchmarks zeigen, dass Fugu-Cyber trotz seiner andersartigen Multi-Agenten-Architektur nicht wesentlich hinter konkurrierenden spezialisierten Modellen zurückbleibt. Für Sicherheitsteams bedeutet das eine zusätzliche Option auf dem Markt für Tools zur Schwachstellenanalyse und Verarbeitung von Threat Intelligence, bei strengeren Zugangskontrollen als bisher bei üblichen API-Angeboten. Der Vergleich mit GPT-5.5-Cyber und Mythos-Preview zeigt, dass eine Multi-Agenten-Architektur trotz der zusätzlichen Komplexität der Orchestrierung nicht zwangsläufig eine geringere Leistung bei spezialisierten Cybersicherheitsaufgaben bedeutet — im Gegenteil, die Koordination mehrerer Agenten kann bei Aufgaben, die sowohl Codeanalyse als auch die Interpretation von Geheimdienstdaten im selben Schritt erfordern, ein Vorteil sein.

Häufig gestellte Fragen

Was ist Fugu-Cyber und wie funktioniert es?
Fugu-Cyber ist ein Multi-Agenten-Orchestrierungssystem von Sakana AI, das auf Cybersicherheitsaufgaben spezialisiert ist und intern mehrere spezialisierte Agenten koordiniert, sich dem Nutzer gegenüber jedoch als einzelnes, einheitliches Modell verhält und darstellt.
Wie erfolgreich ist Fugu-Cyber bei Sicherheitstests?
Fugu-Cyber erzielt 86,9 % Erfolgsquote beim CyberGym-Test zur Analyse von Schwachstellen in komplexem Code und 72,1 % beim CTI-REALM-Test zur Übersetzung von Threat Intelligence in Erkennungsregeln, was mit den Ergebnissen von GPT-5.5-Cyber und Mythos-Preview vergleichbar ist.
Wer kann auf das Fugu-Cyber-Modell zugreifen?
Der Zugang ist auf Abonnenten von Sakanas Token Plan beschränkt, wobei jede Anfrage manuell genehmigt wird und ein verifizierter Kontakt erforderlich ist, gemäß der Acceptable Usage Policy, die den offensiven Missbrauch des Tools ausdrücklich untersagt.

📬 KI-News in dein Postfach

Ein täglicher Digest nach deinen Regeln — Themen, Quellen und Rhythmus wählbar. Abmeldung mit einem Klick.