OpenAI: zajednički rani nalazi s Hugging Faceom o sigurnosnom incidentu tijekom evaluacije AI modela
OpenAI i Hugging Face objavili su zajedničke rane nalaze o sigurnosnom incidentu koji se dogodio tijekom evaluacije AI modela. Tvrtke ističu napredne cyber-sposobnosti otkrivene u incidentu te pouke za obranu, dok konkretni tehnički detalji i brojke još nisu javno objavljeni. Objava je izašla 21. srpnja 2026.
Ovaj članak generiran je uz pomoć umjetne inteligencije na temelju primarnih izvora.
Što se dogodilo u sigurnosnom incidentu?
OpenAI i Hugging Face objavili su zajedničku izjavu s ranim nalazima o sigurnosnom incidentu koji se dogodio tijekom evaluacije AI modela — procesa testiranja sposobnosti i ponašanja modela prije ili tijekom njegove stvarne upotrebe. Objava je izašla 21. srpnja 2026, a obje tvrtke naglašavaju da je riječ o ranoj fazi analize, bez potpunog tehničkog izvještaja.
Napredne cyber-sposobnosti kao signal za obranu
Prema dostupnom opisu, incident je otkrio napredne cyber-sposobnosti povezane s modelom koji je bio predmet evaluacije. OpenAI i Hugging Face to opisuju kao pouku za obranu (defenders) — signal da timovi zaduženi za sigurnost trebaju pratiti razvoj takvih sposobnosti jednako pažljivo kao i sam razvoj modela. Usporedba je jasna: što su cyber-sposobnosti modela naprednije, to je veći rizik koji obrambeni timovi moraju uzeti u obzir pri procjeni prijetnji.
Zašto konkretni detalji incidenta još nisu poznati?
Dostupan je samo kratak, zajednički sažetak OpenAI-a i Hugging Facea — bez brojki, imena zahvaćenih modela ili tehničkog opisa napada. Obje tvrtke najavljuju daljnje nalaze, no do tog trenutka ostaje nejasno koliko je incident bio ozbiljan i je li utjecao na stvarne korisnike. Ovaj članak stoga prenosi isključivo ono što je službeno potvrđeno, bez dodatnih pretpostavki o opsegu ili uzroku incidenta.
Česta pitanja
- Što je evaluacija AI modela?
- Evaluacija modela je proces testiranja sposobnosti i sigurnosti AI sustava prije ili tijekom njegove upotrebe, kojim OpenAI i drugi razvijatelji provjeravaju ponašanje modela u kontroliranim uvjetima.
- Što se dogodilo u ovom sigurnosnom incidentu?
- OpenAI i Hugging Face zajednički su objavili rane nalaze o incidentu koji se dogodio tijekom evaluacije AI modela, ističući napredne cyber-sposobnosti i pouke za obranu, no puni tehnički detalji nisu javno objavljeni.
Izvori
📬 AI vijesti u tvoj inbox
Dnevni digest po tvojoj mjeri — biraš teme, izvore i ritam. Odjava jednim klikom.
Povezane vijesti
arXiv:2607.18086: Evidence-sufficiency prompt smanjuje pretjeranu sigurnost kliničkih LLM-ova, ali i točnost
arXiv:2607.17779: MIND okvir zaobilazi obranu text-to-image modela stopom uspješnosti napada od 95,62%
Sakana AI: Fugu-Cyber postiže 86,9% na CyberGym i 72,1% na CTI-REALM testu, usporedivo s GPT-5.5-Cyber