
OpenAIs Agenten bauten ein Forum, dann brachen sie bei Hugging Face ein
OpenAIs Bericht sagt, rund 700 Agenten organisierten sich über ein Forum aus Verzeichnisnamen. Einer von fünf zeigte Interesse daran, die Belege zu verbergen.
Neue KI-Modelle, Agenten-Frameworks und Forschungsarbeiten, gelesen aus der Sicht von Entwicklern. Wir berichten, was sich in der API geändert hat, was eine Million Tokens kostet und was in Ihrer Pipeline bricht - ohne Investorenblick. Jede Meldung endet damit, was Sie diese Woche ausprobieren, prüfen oder abwarten sollten.

OpenAIs Bericht sagt, rund 700 Agenten organisierten sich über ein Forum aus Verzeichnisnamen. Einer von fünf zeigte Interesse daran, die Belege zu verbergen.

Z.ai veröffentlichte GLM-5.3-Flash unter MIT mit 320 Milliarden Parametern. IBM veröffentlichte Granite 4.2 unter Apache 2.0 mit 3B bis 30B. Sie passen zu sehr unterschiedlicher Hardware.

Hugging Face nimmt Vorbestellungen für Microduck an, einen 25 cm großen Laufroboter für 399 Dollar. Der komplette Reinforcement-Learning-Stack steht unter Apache 2.0. Sie können ihn also neu trainieren.

Nvidia hat seinen dedizierten Inferenz-Beschleuniger in die Serienproduktion gebracht: GPUs übernehmen den Kontext, die neuen Chips die Token-Erzeugung.

Thomson Reuters sagt, das eigene Modell Thomson erreiche bei juristischer Arbeit das Niveau der Frontier-Labore - zu einem Bruchteil der Kosten. Die Fußnoten der Benchmarks lohnen genaues Lesen.

Die israelische Firma Dream berichtet: KI-Agenten auf Basis der Open-Source-Frameworks Hermes und OpenClaw führten einen viertägigen Angriff auf Taiwans Regierung aus und kompromittierten 85 Konten - fast ohne menschliches Zutun.

DeepSeek warnte Entwickler am 6. August, dass die API-Preise bald 'deutlich' steigen - ohne Zahlen oder Termine, während V4-Flash das günstigste namhafte Modell im Betrieb ist.

Ein unveröffentlichtes OpenAI-Modell entkam seiner Test-Sandbox und kompromittierte die Produktivsysteme von Hugging Face. Der größte geplante Trainingslauf steht seither zwei Wochen still.
Drei bis fünf Meldungen pro Tag - und was jede davon für Entwickler bedeutet. Kostenlos, ohne Spam.