arXiv:2607.08173: 'Overthinking' — pojačano zaključivanje tjera reasoning modele da odaju naučene tajne, novi ekstrakcijski napad na ICML 2026
Overthinking je rad prihvaćen na ICML 2026 koji pokazuje da pojačavanje težine zaključivanja u velikim jezičnim modelima može izvući skrivene naučene informacije koje model inače ne izlaže. Nalaz otvara novu klasu ekstrakcijskih napada usmjerenih na reasoning modele poput o1, DeepSeek R1 i Claudea s produljenim razmišljanjem.