Agentische cryptanalyse: de drempel waar Claude Mythos Preview de crypto-review-stack herschrijft

18 juli 2026
11 min
Agentische cryptanalyse: de drempel waar Claude Mythos Preview de crypto-review-stack herschrijft

Op 28 juli 2026 publiceerde Anthropics Frontier Red Team een resultaat dat de grens verlegt: Claude Mythos Preview beperkt zich niet langer tot implementatie-bugs in crypto-bibliotheken. Volgens de researchpost vond het model wiskundige zwaktes in de algoritmen zelf — een categoriesprong voor wie multi-agent security-harnesses, PQC-migraties of red-team-pipelines bouwt.

Waar het veld vandaag écht staat

Anthropic rapporteert twee concrete vondsten. Eerste: een verbeterde aanval op HAWK, een post-quantum digitale handtekening die nog kandidaat is in NIST's derde ronde Additional Digital Signatures. In een multi-agent harness met Python en Sage legde Mythos Preview een eerder niet-geëxploiteerd non-triviaal automorfisme bloot in het rooster van HAWK. De effectieve sleutelgrootte wordt grofweg gehalveerd. Voor HAWK-256 daalde de verwachte full key-recovery-kost volgens Anthropic van 264 naar 238. De aanval blijft exponentieel en is specifiek voor HAWK — andere NIST-PQC-kandidaten en lattice-crypto in het algemeen blijven buiten schot. HAWK is niet in productie.

Tweede: een sterkere meet-in-the-middle-aanval op een research-only AES-128 met 7 van 10 rounds. Mythos ontwierp een fingerprint genaamd Möbius Bridge, die een enumeratiestap over 256 waarden elimineert. Afhankelijk van de runtime-meting rapporteert Anthropic een versnelling van 200–800× — onder een academisch chosen-plaintext-model (~2105 plaintexts). Productie-AES met volle rounds blijft onaangetast.

Elke track kostte ruwweg $100.000 aan API-gebruik. HAWK nam ongeveer 60 uur, met een menselijke operator die geen lattice-specialist was en vooral projectmanagement deed. De AES-ontdekking liep grotendeels autonoom via een scaffold. Anthropic volgde responsible disclosure (HAWK-auteurs, NIST-lijst, overheids- en industrpartners), publiceerde democode plus twee technische papers, en bouwde samen met onderzoekers van ETH Zurich, Tel Aviv University en TU Berlin CryptanalysisBench om LLM-cryptanalyse te kunnen meten.

Drie trajecten die in 6–12 maanden zeer waarschijnlijk lijken

  1. Post-quantumstandaarden-review behandelt LLM-agents als co-reviewers. Anthropic stelt expliciet dat AI-review van specs zoals HAWK een krachtig pre-deploymentinstrument is. Zeer waarschijnlijk: agentische campagnes lopen parallel aan menselijke expertreview in toekomstige standaardisatierondes.
  2. De bottleneck verschuift van ontdekking naar menselijke verificatie. Voor AES produceerde het model de aanval in ongeveer een week; onderzoekers besteedden daarna honderden uren aan wiskundige validatie. Binnen 6–12 maanden raken labs zonder proof-checking-pipeline het eerst vol.
  3. Crypto-red-team-stacks standaardiseren op multi-agent harnesses plus computer algebra. De gepubliceerde setup — samenwerkende workers, sandbox, Python/Sage, literatuurtoegang — is al een blueprint. Plausibel dat interne securityteams die nabootsen op eigen primitives en PQC-kandidaten.

Wat speculatief blijft: aanvallen die live productiesystemen breken. Anthropic is helder: geen productiesoftware hoeft te wijzigen door deze twee resultaten.

Drie capabilities om dit kwartaal vast te zetten

  • Een reproduceerbare agentische cryptanalyse-harness — multi-worker, gesandboxt, formele-math-tooling, en logs van verworpen hypotheses (Anthropic noteert dat één worker het winnende idee te vroeg verwierp; een tweede zette het door).
  • Een model-onafhankelijke wiskundige validatieketen — menselijke review, formalisering, regressietests — vóór elk “kritiek bevinding”-ticket de lab verlaat.
  • Een inventaris van PQC-kandidaten versus research-only gereduceerde ciphers — zodat academisch signaal nooit voor een productie-incident wordt aangezien.

Drie risico's om nu te mitigeren

  • Headline-overreach: “AI kraakt AES” is niet wat Anthropic publiceerde. Het resultaat raakt 7-round AES, niet de 10-round productiecijfer.
  • Eerst publiceren, later bewijzen: als de ontdekkingskost (~$100k API, tientallen uren) sneller daalt dan de bewijskost, verdrinken securityteams in false positives.
  • Side channels in de agent-harness: een setup met literatuur, code en slecht geïsoleerde testsleutels kan meer lekken dan een paperresultaat. Isolatie en responsible disclosure blijven non-negotiable — Anthropic deelde de HAWK-aanval in juni al met de auteurs vóór de publieke release.

Drie hefbomen om deze week te activeren

  1. Lees Anthropics post plus de HAWK- en Möbius Bridge-papers; clone anthropics/cryptography-research-demo en speel het lokale verificatiepad na.
  2. Koppel CryptanalysisBench (arXiv:2607.18538) aan je interne eval-grid — niet voor leaderboard-ijdelheid, wel om te kalibreren wat je agentstack écht kan bewijzen.
  3. Werk het post-quantum migratierunbook bij: elke NIST-track-kandidaat krijgt een poort “agent-cryptanalist + menselijke validatie” vóór productintegratie.

Is jouw crypto-review-pipeline nog 100% menselijk?

Als je gek bent op de nieuwste AI-tech, publiceer ik elke dag een diepgaande analyse over frontier-modellen, hardware, robotica, automatiseringen en AI-muziek. 👉 Ontvang de volgende rechtstreeks in je mailbox — inschrijven duurt tien seconden.

Bronnen

Deel dit artikel

Klaar om samen iets geweldigs te creëren?

Laten we bespreken hoe ik u kan helpen uw visie tot leven te brengen door strategisch design dat tastbare resultaten levert voor uw bedrijf.

    Agentische cryptanalyse: de drempel waar Claude Mythos Preview de crypto-review-stack herschrijft | Matthieu Pesesse