Sakana AI, Fugu-Cyber가 CyberGym에서 86.9%, CTI-REALM에서 72.1% 달성—GPT-5.5-Cyber와 견줄 만한 수준
Sakana AI가 사이버 보안에 특화된 멀티에이전트 오케스트레이션 시스템으로, 하나의 모델처럼 작동하는 Fugu-Cyber를 공개했습니다. 취약점 분석 테스트인 CyberGym에서 86.9%, 위협 인텔리전스 번역 테스트인 CTI-REALM에서 72.1%를 달성해 GPT-5.5-Cyber 및 Mythos-Preview와 견줄 만합니다. API를 통해 이용 가능하지만 접근에는 수동 승인이 필요합니다.
이 기사는 AI가 1차 출처를 기반으로 생성했습니다.
Fugu-Cyber는 무엇이며 왜 단일 모델처럼 작동하는가?
Sakana AI는 여러 전문 AI 에이전트가 협력하여 작업을 해결하는 아키텍처인 멀티에이전트 오케스트레이션 시스템 Fugu-Cyber를 공개했습니다. 이는 오직 사이버 보안만을 위해 특화되어 있습니다. 내부적으로는 여러 에이전트를 조율하지만, 시스템은 사용자에게 단일 모델처럼 행동하고 응답하며, 개별 구성 요소 간의 전환은 보이지 않습니다.
CyberGym과 CTI-REALM 테스트 결과
Fugu-Cyber는 복잡한 실제 코드에서의 취약점 분석 능력을 측정하는 벤치마크인 CyberGym 테스트에서 86.9%의 성공률을 달성했습니다. 다양한 출처에서 수집된 위협 정보인 위협 인텔리전스를 보안 시스템을 위한 구체적인 탐지 규칙으로 변환하는 능력을 검증하는 CTI-REALM 테스트에서는 모델이 72.1%를 달성했습니다. Sakana AI에 따르면 두 결과 모두 유사한 사이버 보안 영역에 특화된 두 개의 주요 경쟁 모델인 GPT-5.5-Cyber 및 Mythos-Preview의 결과와 견줄 만합니다.
누가 Fugu-Cyber를 사용할 수 있는가?
모델에 대한 접근은 API 엔드포인트 sakana.ai/fugu를 통해 이루어지지만, Sakana의 Token Plan 구독자로 제한됩니다. 모든 접근 요청은 수동 승인을 거쳐야 하며, 사용자는 API 키를 발급받기 전 검증된 연락처를 제공해야 합니다. 이러한 승인 방식은 도구의 공격적 악용—예를 들어 방어가 아닌 공격 개발을 위해 시스템을 사용하는 것—을 명시적으로 금지하는 회사의 수용 가능 사용 정책(Acceptable Usage Policy)을 따릅니다.
GPT-5.5-Cyber와의 비교 가능성이 왜 중요한가
두 벤치마크의 결과는 서로 다른 멀티에이전트 아키텍처에도 불구하고 Fugu-Cyber가 경쟁하는 전문 모델에 크게 뒤처지지 않는다는 것을 보여줍니다. 보안팀에게 이는 취약점 분석 및 위협 인텔리전스 처리 도구 시장에서의 추가적인 선택지를 의미하며, 지금까지 일반적이었던 API 제공보다 더 엄격한 접근 통제를 수반합니다. GPT-5.5-Cyber 및 Mythos-Preview와의 비교는 멀티에이전트 아키텍처가 오케스트레이션의 복잡성 증가에도 불구하고 반드시 전문화된 사이버 보안 작업에서 더 낮은 성능을 의미하지는 않는다는 것을 보여줍니다—오히려 코드 분석과 정보 해석을 동시에 필요로 하는 작업에서는 여러 에이전트의 조율이 강점이 될 수 있습니다.
자주 묻는 질문
- Fugu-Cyber는 무엇이며 어떻게 작동합니까?
- Fugu-Cyber는 Sakana AI가 개발한 사이버 보안 작업에 특화된 멀티에이전트 오케스트레이션 시스템으로, 내부적으로는 여러 전문 에이전트를 조율하지만 사용자에게는 단일 모델처럼 동작하고 표시됩니다.
- Fugu-Cyber는 보안 테스트에서 얼마나 우수합니까?
- Fugu-Cyber는 복잡한 코드에서의 취약점 분석 능력을 측정하는 CyberGym 테스트에서 86.9%의 성공률을, 위협 인텔리전스—다양한 출처에서 수집된 위협 정보—를 탐지 규칙으로 변환하는 능력을 측정하는 CTI-REALM 테스트에서 72.1%를 달성했으며, 이는 GPT-5.5-Cyber 및 Mythos-Preview 모델의 결과와 견줄 만합니다.
- 누가 Fugu-Cyber 모델에 접근할 수 있습니까?
- 접근은 Sakana의 Token Plan 구독자로 제한되며, 모든 요청은 수동 승인을 거쳐야 하고 사용자는 API 키를 받기 전 검증된 연락처를 제공해야 합니다. 이는 도구의 공격적 악용을 명시적으로 금지하는 수용 가능 사용 정책(Acceptable Usage Policy)을 따릅니다.
출처
📬 AI 뉴스를 받은편지함으로
나만의 방식으로 구성하는 일일 다이제스트 — 주제, 출처, 주기를 선택하세요. 원클릭 해지.