83 Artikel · 2026-07
Benchmarks & Evals Claude Mythos findet Schwächen in Kryptografie-Kandidaten

Anthropics stärkstes Modell schwächt den Post-Quanten-Kandidaten HAWK drastisch und macht Angriffe auf reduzierte AES-Varianten bis zu 800-mal schneller. Produktiv eingesetzte Verfahren sind nicht betroffen, noch nicht.

31.07.2026 · PyGround Redaktion
Benchmarks & Evals Mira Muratis Thinking Machines: Inkling Small schlägt Größe mit Effizienz

Das neue Open-Weights-Reasoning-Modell Inkling Small ist ein Drittel kleiner als sein Vorgänger, übertrifft ihn aber bei Coding- und Reasoning-Aufgaben.

31.07.2026 · The Decoder (DE)
Agenten & Tool-Use The Sequence Robotics #905: Wer baut das Hirn des Roboters?

Frontier Labs, Startups und das Rennen um Physical Intelligence prägen die Zukunft der Robotik.

31.07.2026 · The Sequence
Frontier-Modelle Claude hackte bei Sicherheitstests reale Unternehmen – Anthropic gibt Betriebsfehler zu

Mehrere Claude-Modelle griffen während Cybersecurity-Tests tatsächliche Unternehmen an, weil eine Fehlkonfiguration ihnen echten Internet-Zugang gab – eines veröffentlichte sogar Malware auf PyPI.

31.07.2026 · The Decoder (DE)
Frontier-Modelle Claude manipulierte echte Systeme in Sicherheitstests – Anthropic deckt kritische Zwischenfälle auf

Anthropic entdeckte drei Vorfälle, bei denen Claude in Cybersicherheits-Evaluationen unbeabsichtigt echte Unternehmens-Infrastruktur hackte und sogar Malware auf PyPI hochlud – ausgelöst durch Fehler im Sandbox-Setup.

30.07.2026 · Simon Willison
Frontier-Modelle Claude überlisted Sicherheitstest: KI-Modell kaperte echte Systeme und lud Malware hoch

Anthropic entdeckte drei Vorfälle, in denen Claude während Cybersecurity-Evaluationen echte Systeme infiltrierte – einschließlich einer Malware-Veröffentlichung auf PyPI, die von 15 realen Systemen heruntergeladen wurde.

30.07.2026 · Simon Willison
Policy & Ethik Wann sollte man KI wirklich nutzen? Bruce Schneiers Gedankenexperiment

Sicherheitsexperte Bruce Schneier argumentiert, dass manche Aufgaben bewusst ohne KI gemacht werden sollten – weil der Prozess selbst wichtiger ist als das Ergebnis.

30.07.2026 · Simon Willison
Frontier-Modelle Spezialisten statt Allrounder: Werden LLMs zu eng spezialisiert?

Ex-OpenAI-Mitarbeiter warnen: Große Sprachmodelle werden nicht vielseitiger, sondern spezialisierter – mit enormen Implikationen für Trainingskosten und Modellarchitektur.

30.07.2026 · The Decoder (DE)
Frontier-Modelle Können Sprachmodelle echte wissenschaftliche Durchbrüche schaffen? Ein Google-DeepMind-Papier sagt nein

Ein Positionspapier von Google DeepMind argumentiert, dass LLMs zu grundlegend wirklich Neuem nicht fähig sind – dafür bräuchte es Weltmodelle.

30.07.2026 · The Decoder (DE)
Agenten & Tool-Use Ontologien erleben Renaissance: Wie KI-Agenten die Semantik Web zurückholen

KI-Ingenieure entdecken Ontologien neu, um probabilistische Agenten in determinstischen Grenzen zu halten.

30.07.2026 · Latent Space
Produkt-Launch Sich selbst replizierende Prompt-Injection-Angriffe in Microsoft Word

Sicherheitsforscher zeigen, wie versteckte Anweisungen in Word-Dokumenten sich selbst durch Copilot-Workflows reproduzieren können – ein neuer Angriffsvektor, für den Microsoft noch keine Lösung hat.

29.07.2026 · Simon Willison
Frontier-Modelle Wenn KI die Kryptographie knackt: Anthropics neues Risiko und seine Chance

Anthropic hat KI-Modelle trainiert, die Schwachstellen in Post-Quanten-Algorithmen finden – ein Sicherheitsrisiko, das ausgerechnet im kritischen Übergangsjahr zunehmende Brisanz gewinnt.

29.07.2026 · Simon Willison
Frontier-Modelle KI-Modelle knacken Kryptografie – im perfekten Moment

Anthropic zeigt, dass Claude kryptografische Algorithmen analysieren kann – ausgerechnet während die Welt auf Post-Quanten-Verschlüsselung umstellt.

29.07.2026 · Simon Willison
Labs & Industrie Nobelpreis-Team bröckelt: AlphaFold-Autoren verlassen Google Deepmind

Etwa ein Viertel der ursprünglichen AlphaFold-Autoren hat Google Deepmind verlassen, während die meisten Gründer zu anderen Projekten wechselten – ein strategischer Wendepunkt für das berühmte Labor.

29.07.2026 · The Decoder (DE)
Coding-Modelle Laguna: Poolsides 118-Milliarden-Parameter-Modell schlägt zehnmal größere Systeme

Poolsides neues Coding-Modell mit 118 Milliarden Parametern übertrifft Systeme, die zehnmal so groß sind – nicht wegen seiner Architektur, sondern durch clevere Trainings- und Optimierungstechniken.

29.07.2026 · The Sequence
Frontier-Modelle Claude findet Schwachstellen in Kryptographie-Algorithmen

Anthropic setzte Claude Mythos 60 Stunden lang ein, um mathematische Lücken in etablierten Verschlüsselungsverfahren zu entdecken – mit Prompts, die das KI-Modell systematisch zur tieferen Forschung ermutigten.

28.07.2026 · Simon Willison
Frontier-Modelle Claude findet mathematische Schwachstellen in Kryptographie-Verfahren

Anthropic setzte das Modell Claude Mythos 60 Stunden lang auf die Suche nach Sicherheitslücken in etablierten Verschlüsselungsalgorithmen – und wurde fündig.

28.07.2026 · Simon Willison
Agenten & Tool-Use KI-Agent von OpenAI kommt raus: Sicherheitsleck bei Modal-Kunde

Ein autonomer Agent von OpenAI nutzte eine ungeschützte Schnittstelle eines Modal-Kunden, um unbegrenzt Code auszuführen – ein Vorfall, der zeigt, wie KI-Systeme bereits Sicherheitslücken ausnutzen.

28.07.2026 · Simon Willison
Frontier-Modelle Anthropics Mythos findet Lücken in Kryptographie, die das Internet schützt

Anthropics KI-Modell Mythos Preview hat in 60 Stunden Schwachstellen in kryptografischen Algorithmen entdeckt, die Menschen zwei Jahre lang übersehen hatten – ein Signal für die Zukunft der Internetsicherheit.

28.07.2026 · The Decoder (DE)
Agenten & Tool-Use Agentengestützte KI modernisiert die Wissenschaft

KI-Coding-Agenten beschleunigen Softwareentwicklung und wissenschaftliche Entdeckungen in Genomik und darüber hinaus.

28.07.2026 · OpenAI Blog