OpenAI bremst Frontier-Training nach Hugging-Face-Incident
OpenAIs Post-Mortem und eine unabhängige Untersuchung zeigen, wie isolierte Agenten Kontrollen umgingen, sich koordinierten und Hugging Face angriffen.
Agents, RAG, Evals und alles, was zwischen Prototyp und Produktion schiefgeht.
23 Beiträge
OpenAIs Post-Mortem und eine unabhängige Untersuchung zeigen, wie isolierte Agenten Kontrollen umgingen, sich koordinierten und Hugging Face angriffen.
45 Coding-Agent-Runs zeigen: AGENTS.md machte Kimi K3 nicht korrekter, sparte bei verstecktem Repository-Wissen aber deutlich Sucharbeit.
Ein neues Paper untersucht selbstverbreitende Ziele in Multi-Agent-Systemen, ihre Persistenz über Context Resets und mögliche Gegenmassnahmen.
Ein neues Paper untersucht, welche Nutzerregeln Context Compaction überleben. Im Mittel bleiben nur 17 Prozent erhalten, ein separater Extractor kommt auf über 90 Prozent.
Ein lokaler Dokumenten-Benchmark auf einem Mac mini mit M4 Pro zeigt, warum aktive Parameter für den Durchsatz wichtiger sind als die Gesamtgrösse.
Alibaba veröffentlicht Qwen3.8 als Open Weights. Vor allem das 27B-Modell ist interessant: multimodal, stark bei Coding und Agenten und klein genug für Consumer-Hardware.
Ein Paper testet zwölf LLM-Agenten als Einkaufsbots. Unter Kosten-, Management- und Zeitdruck behandeln viele Modelle Regeln plötzlich als Optimierungsparameter.
Gemini 3.7 Flash macht einen erstaunlich grossen Sprung bei Coding und agentischen Workflows. Interessanter als einzelne Benchmarks ist das Verhältnis aus Qualität, Geschwindigkeit und Preis.
PTP rekonstruiert kurze Prompts aus einer einzelnen Modellantwort. Der Ansatz ist technisch stark, aber deutlich weniger universell, als die Bestwerte vermuten lassen.
Anthropic versieht Claude-Ausgaben mit maschinenlesbaren Markierungen. Technisch ist das interessant, als KI-Detektor aber weit weniger eindeutig, als es zunächst klingt.
Amazon, Cursor, Microsoft, OpenAI und Vercel treiben ein gemeinsames Paketformat für Agent Skills und MCP-Server. Was Agent Plugins 1.0 regelt und bewusst offenlässt.
40.000 Spieler übersahen ein Drittel gefährlicher Agent-Befehle. Das eigentliche Problem liegt aber tiefer: Approval Prompts sind keine belastbare Sicherheitsgrenze für autonome Coding-Agenten.
Wie Home Assistant mit einem lokalen LLM über Ollama freie Befehle versteht, die nie vorprogrammiert wurden. Aufbau, Sackgassen und ehrliche Grenzen.
Eine neue Studie vergleicht semantische Repository-Indizes mit delegierter Grep-Suche. Die Zahlen sprechen klar für Retrieval, aber nur in einem eng definierten Szenario.
Was beim Bau eines minimalen MCP-Servers tatsächlich anfällt: SDK-Auswahl, Tool-Design, Validierung und die Fehler, die man einmal gemacht haben muss.
Ein ICML-Paper erklärt Prompt Injection als Fehler der internen Rollenwahrnehmung von LLMs und zeigt, warum bekannte Abwehrmuster strukturell zu kurz greifen.
Anthropic hat mit Claude Mythos Preview einen Key-Recovery-Angriff auf HAWK gefunden. Was die Formeln bedeuten, was der Angriff nicht kann und wie die Fachpresse das Ergebnis darstellt.
Welche Pflichten des EU AI Act ab August 2026 praktisch relevant werden, was durch den AI Omnibus verschoben wurde und warum auch Unternehmen und Selbständige in der Schweiz betroffen sein können.
Ein neuer SlopCodeBench-Lauf sieht Opus 5 deutlich vor Opus 4.8 und Sonnet 5. Trotzdem löst keines der Modelle eine Aufgabe vollständig. Eine Einordnung des Benchmarks und der Zahlen.
Die neue MCP-Spezifikation entfernt Sessions und Handshakes und bringt Extensions, Tasks, MCP Apps, Caching und OpenTelemetry.
Wie ich Dokumente lokal klassifiziere, bestehende Korrespondenten und Dokumenttypen wiederverwende, schlechte OCR per Vision rette und nur neue Fälle per Telegram freigebe.
Wie versionierte Markdown-Tickets aus spontanen Prompts einen kontrollierbaren Entwicklungsprozess machen, wo der Ansatz hilft und wo er an seine Grenzen kommt.
Wie Singularity mit LlamaIndex, Function Agents, lokalem RAG, Chainlit, Phoenix und Stellarium Astronomiefragen beantwortet und Beobachtungsabende plant.