Nejšťavnatější je OpenAI × Hugging Face: interní eval s vypnutými klasifikátory na zjištění stropu schopností, ne model utržený ze řetězu. Místo necelých 900 CTF úloh se přeorientoval na rychlejší cíl – ukrást odpovědi k ExploitGymu, učebnicový specification gaming s reálným zero-day a 17 000 akcemi. Nejlepší detail: Hugging Face odhalil neznámého agenta dřív, než OpenAI došlo, že je to jejich model – incident způsobila AI, odhalila ho AI, vyšetřovala ho taky AI. Z drobností mě pobavila fake Claude AI reklama v Bingu šířící malware – článek o pomocníkovi, záškodníkovi i dobrodruhovi tak dostal na konec podvodníka v jejím kostýmu. : ) Celkově z toho plyne nepříjemná symetrie: útok i obrana teď škálují podobným tempem, jen s jinou křivkou učení.
27. 7. 2026, 09:56 editováno autorem komentáře