Op 28 juli 2026 publiceerde Anthropics Frontier Red Team een resultaat dat de grens verlegt: Claude Mythos Preview beperkt zich niet langer tot implementatie-bugs in crypto-bibliotheken. Volgens de researchpost vond het model wiskundige zwaktes in de algoritmen zelf — een categoriesprong voor wie multi-agent security-harnesses, PQC-migraties of red-team-pipelines bouwt.
Waar het veld vandaag écht staat
Anthropic rapporteert twee concrete vondsten. Eerste: een verbeterde aanval op HAWK, een post-quantum digitale handtekening die nog kandidaat is in NIST's derde ronde Additional Digital Signatures. In een multi-agent harness met Python en Sage legde Mythos Preview een eerder niet-geëxploiteerd non-triviaal automorfisme bloot in het rooster van HAWK. De effectieve sleutelgrootte wordt grofweg gehalveerd. Voor HAWK-256 daalde de verwachte full key-recovery-kost volgens Anthropic van 264 naar 238. De aanval blijft exponentieel en is specifiek voor HAWK — andere NIST-PQC-kandidaten en lattice-crypto in het algemeen blijven buiten schot. HAWK is niet in productie.
Tweede: een sterkere meet-in-the-middle-aanval op een research-only AES-128 met 7 van 10 rounds. Mythos ontwierp een fingerprint genaamd Möbius Bridge, die een enumeratiestap over 256 waarden elimineert. Afhankelijk van de runtime-meting rapporteert Anthropic een versnelling van 200–800× — onder een academisch chosen-plaintext-model (~2105 plaintexts). Productie-AES met volle rounds blijft onaangetast.
Elke track kostte ruwweg $100.000 aan API-gebruik. HAWK nam ongeveer 60 uur, met een menselijke operator die geen lattice-specialist was en vooral projectmanagement deed. De AES-ontdekking liep grotendeels autonoom via een scaffold. Anthropic volgde responsible disclosure (HAWK-auteurs, NIST-lijst, overheids- en industrpartners), publiceerde democode plus twee technische papers, en bouwde samen met onderzoekers van ETH Zurich, Tel Aviv University en TU Berlin CryptanalysisBench om LLM-cryptanalyse te kunnen meten.
Drie trajecten die in 6–12 maanden zeer waarschijnlijk lijken
- Post-quantumstandaarden-review behandelt LLM-agents als co-reviewers. Anthropic stelt expliciet dat AI-review van specs zoals HAWK een krachtig pre-deploymentinstrument is. Zeer waarschijnlijk: agentische campagnes lopen parallel aan menselijke expertreview in toekomstige standaardisatierondes.
- De bottleneck verschuift van ontdekking naar menselijke verificatie. Voor AES produceerde het model de aanval in ongeveer een week; onderzoekers besteedden daarna honderden uren aan wiskundige validatie. Binnen 6–12 maanden raken labs zonder proof-checking-pipeline het eerst vol.
- Crypto-red-team-stacks standaardiseren op multi-agent harnesses plus computer algebra. De gepubliceerde setup — samenwerkende workers, sandbox, Python/Sage, literatuurtoegang — is al een blueprint. Plausibel dat interne securityteams die nabootsen op eigen primitives en PQC-kandidaten.
Wat speculatief blijft: aanvallen die live productiesystemen breken. Anthropic is helder: geen productiesoftware hoeft te wijzigen door deze twee resultaten.
Drie capabilities om dit kwartaal vast te zetten
- Een reproduceerbare agentische cryptanalyse-harness — multi-worker, gesandboxt, formele-math-tooling, en logs van verworpen hypotheses (Anthropic noteert dat één worker het winnende idee te vroeg verwierp; een tweede zette het door).
- Een model-onafhankelijke wiskundige validatieketen — menselijke review, formalisering, regressietests — vóór elk “kritiek bevinding”-ticket de lab verlaat.
- Een inventaris van PQC-kandidaten versus research-only gereduceerde ciphers — zodat academisch signaal nooit voor een productie-incident wordt aangezien.
Drie risico's om nu te mitigeren
- Headline-overreach: “AI kraakt AES” is niet wat Anthropic publiceerde. Het resultaat raakt 7-round AES, niet de 10-round productiecijfer.
- Eerst publiceren, later bewijzen: als de ontdekkingskost (~$100k API, tientallen uren) sneller daalt dan de bewijskost, verdrinken securityteams in false positives.
- Side channels in de agent-harness: een setup met literatuur, code en slecht geïsoleerde testsleutels kan meer lekken dan een paperresultaat. Isolatie en responsible disclosure blijven non-negotiable — Anthropic deelde de HAWK-aanval in juni al met de auteurs vóór de publieke release.
Drie hefbomen om deze week te activeren
- Lees Anthropics post plus de HAWK- en Möbius Bridge-papers; clone
anthropics/cryptography-research-demoen speel het lokale verificatiepad na. - Koppel CryptanalysisBench (arXiv:2607.18538) aan je interne eval-grid — niet voor leaderboard-ijdelheid, wel om te kalibreren wat je agentstack écht kan bewijzen.
- Werk het post-quantum migratierunbook bij: elke NIST-track-kandidaat krijgt een poort “agent-cryptanalist + menselijke validatie” vóór productintegratie.
Is jouw crypto-review-pipeline nog 100% menselijk?
Als je gek bent op de nieuwste AI-tech, publiceer ik elke dag een diepgaande analyse over frontier-modellen, hardware, robotica, automatiseringen en AI-muziek. 👉 Ontvang de volgende rechtstreeks in je mailbox — inschrijven duurt tien seconden.
Bronnen
- Discovering cryptographic weaknesses with Claude (Anthropic)