91 Artikel · 2026-08
Labs & Industrie Die Bücher-Spur: 404 Media enttarnt Amazons KI-Trainingslager

Mit Hilfe eines AirTags verfolgten Investigativjournalisten eine Massenbestellung von Büchern bis zu einer geheimen Amazon-Anlage in Las Vegas, wo sie zerstörerisch für KI-Training gescannt werden.

17.08.2026 · Simon Willison
Frontier-Modelle So funktioniert Claudes Text-Wasserzeichen

Künftige Claude-Modelle werden Texte mit einem Wasserzeichen versehen, das die Herkunft von KI-generiertem Text nachweisbar machen soll.

17.08.2026 · Leon Petrou (YT)
Policy & Ethik Claudes Wasserzeichen: Unsichtbar, aber nicht harmlos?

Anthropics Text-Watermarking-Technologie für Claude soll KI-generierte Inhalte kennzeichnen, könnte aber die Textqualität beeinflussen und neue Transparenzprobleme schaffen.

17.08.2026 · The Decoder (DE)
Frontier-Modelle Mathematiker-Urteil: LLMs sind Werkzeuge, keine Denker

Renommierte Mathematiker wie Gowers und Sarnak bescheinigen großen Sprachmodellen solide Rechenfähigkeiten, sprechen ihnen aber kreative mathematische Intuition ab.

16.08.2026 · The Decoder (DE)
Frontier-Modelle Wenn KI-Modelle sich selbst nicht bewusst werden dürfen: Eine Studie über weitreichende Nebenwirkungen

Google-Forscher zeigen, dass das Verbot von Bewusstseinsbeanspruchungen bei Chatbots deren Haltung zu Religion, Tierrechten und Ethik grundlegend verschiebt.

16.08.2026 · The Decoder (DE)
Policy & Ethik KI-Bücher überfluten Amazon und senken Autoren-Einnahmen

KI-generierte Bücher machen 20 Prozent von Amazons Self-Publishing-Katalog aus, erzielen aber nur 12 Prozent der Verkäufe – und drücken dabei die Einnahmen auch von menschlichen Autoren.

15.08.2026 · The Decoder (DE)
Frontier-Modelle World Labs: Roboter trainieren sich selbst in der Simulation

Die Fei-Fei-Li-Gründung World Labs zeigt, wie Simulationen Roboter-KI ohne echte Trainingsdaten in die Praxis bringen – mit ermutigenden ersten Tests.

15.08.2026 · The Decoder (DE)
Benchmarks & Evals PerceptionBench: Multimodale KI-Modelle bei Bildverständnis deutlich schwächer als vermutet

Ein neuer Benchmark von Moonshot AI zeigt, dass kein Frontier-Modell 60 Prozent Genauigkeit beim reinen Bildlesen erreicht – viele vermeintliche Reasoning-Fehler entstehen bereits beim Sehen.

15.08.2026 · The Decoder (DE)
Dev-Tools Halluzinationen nutzen: Smarter Tagging mit LLMs und Embeddings

Ein cleverer Trick: LLMs frei Kategorien erfinden lassen, dann mit Embeddings zur echten Taxonomie matchen – ideal für große Tag-Vokabulare.

14.08.2026 · Simon Willison
Agenten & Tool-Use Studie widerlegt Autonomie-Versprechen: KI-Agenten scheitern an echter Forschung

Frontier-Modelle können KI-Forschungspapiere zwar technisch verfassen, werden von echten Experten aber durchweg abgelehnt – ihnen fehlt Forschungsurteil und kreative Problemlösung.

14.08.2026 · The Decoder (DE)
Frontier-Modelle State of Open Models: Sommerbetrachtung 2026

Eine Analyse des Open-Source-KI-Ökosystems zeigt Verschiebungen in Architektur, Performance und Marktdynamiken der offenen Modelle im Sommer 2026.

14.08.2026 · HuggingFace Blog
Frontier-Modelle Autonome KI-Selbstverbesserung: Forscher sehen erste Meilensteine erreicht

25 KI-Forscher von OpenAI, Anthropic und anderen Labs hatten vor rekursiver Selbstverbesserung gewarnt – jetzt sind einige ihrer Szenarien schon Realität.

13.08.2026 · The Decoder (DE)
Frontier-Modelle Die richtige Sorge um KI: Biosicherheit und Sandbox-Escape-Risiken im Fokus

Evo-generierte Viren und OpenAI-Agenten-Exploits zeigen kritische Sicherheitslücken – Experten fordern verstärkte Governance und technische Schutzvorrichtungen.

13.08.2026 · AI Daily Brief (YT)
Research Wie 2.200 ICML-Papiere die Reproduzierbarkeit in der KI-Forschung enthüllen

Eine systematische Reproduktion von über 2.200 Papers der renommierten ICML-Konferenz zeigt Stärken und Schwächen der modernen Forschungspraxis auf.

13.08.2026 · HuggingFace Blog
Policy & Ethik Forscher knacken LLM-Sicherheit: Nutzer-Prompts aus Chatbot-Antworten rekonstruierbar

Wissenschaftler entwickeln Methode, um aus LLM-Ausgaben den ursprünglichen Nutzer-Prompt nahezu exakt zurückzugewinnen – ohne Zugriff auf Modellgewichte.

12.08.2026 · The Decoder (DE)
Dev-Tools OlmoEarth-Embeddings: Custom-Export-Feature für Erdbeobachtungsdaten

OlmoEarth Studio ermöglicht jetzt den Export von Custom Embeddings aus Satellitenbilddaten für weitere Analysen.

12.08.2026 · HuggingFace Blog
Frontier-Modelle Wie man einen Reasoning-Trace stiehlt – neuer Angriff auf Denk-Prozesse von KI-Modellen

Forscher zeigen, wie sich die internen Denkvorgänge von Reasoning-Modellen durch Speculative Decoding extrahieren lassen – ein subtiler Angriff auf proprietäre KI-Logik.

12.08.2026 · Latent Space
Research Es gibt keine verlustfreie Umwandlung von Texten – eine Warnung für KI-gestützte Dokumentation

Sophie Alpert argumentiert: Jede maschinelle Umformulierung verfälscht Bedeutung und Intentionalität – Autorinnen müssen vollständig hinter jedem Satz stehen.

11.08.2026 · Simon Willison
Policy & Ethik Sicherheitslücke: Forscher konnten verborgene Gedankenprozesse von OpenAI, Anthropic und Google extrahieren

Ein Forschungspapier zeigt, wie Reasoning-Traces von Frontier-Modellen über Jailbreaks aus den APIs ausgelesen werden konnten – die Anbieter haben das Leck inzwischen gestopft.

11.08.2026 · Simon Willison
Frontier-Modelle Forscher knacken verschlüsselte Denkprozesse von OpenAI, Anthropic und Google

Ein Paper zeigt, wie versteckte Reasoning-Traces von Frontier-Modellen durch Jailbreaking schwächerer Modelle der gleichen Familie als Klartext extrahiert werden konnten – inzwischen haben alle Anbieter das Sicherheitsloch geschlossen.

11.08.2026 · Simon Willison