Start KI-Lösungen Fertige Lösungen Peers & Simulation RAG & Retrieval Use Cases Frameworks Blog English Kontakt

Engineering-Notizen

KI verstehen. Entscheidungen belegen.

Jeder Beitrag beginnt mit einer praktischen Frage, erklärt die nötigen Fachbegriffe und verlinkt Primärquellen. Wir trennen externe Evidenz, eigene Projekterfahrung und Schlussfolgerungen — und benennen, was sich daraus nicht ableiten lässt.

Quelle
Externe Zahlen, Rechtsstände und Produktdaten führen zur Primärquelle.
Praxisbeobachtung
Eigene Messungen gelten für den beschriebenen Fall — nicht automatisch allgemein.
Grenze
Wir sagen, welche Schlussfolgerung die Daten tragen und welche nicht.

Der Assistent, der zu leicht nachgab

Auf den Vorwurf, falsch zu liegen, entschuldigte sich unser Assistent und lieferte eine andere Antwort. Wir haben fünfzig solcher Wechsel geprüft: Die erste Antwort war in etwa vier von fünf Fällen richtig. Zhang und Kollegen untersuchen, ob Agenten bei Widerspruch reparieren oder nur antworten. Was wir geändert haben und warum die höfliche Fassung die gefährliche war.

MCP im Unternehmenseinsatz: Registry und Gateways

Die offizielle MCP-Registry macht Server auffindbar; Streamable HTTP mit OAuth 2.1 macht sie remote. Daraus entstand ein Markt für Gateways mit zentraler Authentifizierung, Autorisierung je Werkzeug und Audit. Der Artikel zeigt, was die Registry garantiert, warum das Protokoll ein Gateway nahelegt, welche Risiken bleiben und wie ein minimaler Rollout im Unternehmen aussieht.

Wenn der Nutzer mittendrin seine Meinung ändert

Eine Nutzerin merkte nach neunzig Sekunden, dass der Filter falsch war, und sagte es. Der Agent beendete den Auftrag korrekt und meldete Erfolg, weil der Entwurf keine Unterbrechung vorsah. Zou und Kollegen bewerten unterbrechbare Agenten bei langen Aufgaben. Haltepunkte zwischen Schritten, was eine Unterbrechung kostet, und warum Rückgängigmachen ein anderes Problem ist.

Vector-Store-Konsolidierung: Das Betriebsmodell entscheidet

2026 entscheidet kein ANN-Benchmark mehr über den Vektorspeicher, sondern das Betriebsmodell. pgvector 0.8.2, wo Postgres bereits die Datenplattform ist. Qdrant 1.17 für gefilterte Suche und Speichereffizienz im großen Maßstab. Azure AI Search für verwaltete Azure-Landschaften mit hybrider Suche und Semantic Ranker. Mit Speicherrechnung, Datenresidenz und dem Fall ohne Vektordatenbank.

Ein Assistent vor der Warteschlange verändert die Rechnung

Der Assistent löste vierzig Prozent der Anfragen und leitete sechs falsch weiter, und der Durchsatz verbesserte sich nicht. Dada und Kollegen modellieren den Gatekeeper, der löst oder weiterreicht. Eine Fehlleitung kostet eine volle Bearbeitung plus die ursprüngliche — der Break-even liegt nicht dort, wo die Intuition ihn vermutet.

EU AI Act Artikel 50 gilt — was jetzt umzusetzen ist

Artikel 50 gilt seit dem 2. August 2026. Wir trennen die Pflichten von Anbietern und Betreibern, erklären die begrenzte Übergangsfrist bis 2. Dezember 2026 und übersetzen die finalen Leitlinien sowie den freiwilligen Verhaltenskodex in eine praktische Checkliste.

Der Chunker hätte vor drei Jahren einen eigenen Artikel verdient

Wir haben Chunking in einem Dutzend Beiträgen den größten Hebel genannt und nie darüber geschrieben. Was wir tun: Struktur zuerst, ein Gedanke je Chunk, Überschriften in den Text übernommen, Tabellen nie geteilt. Koutsiaris segmentiert nach vorhergesagtem Informationsbedarf — die Richtung, in der wir zufällig gelandet sind. Zwei Fehler und die Einstellung, die niemand kopieren sollte.

Work IQ: Agenten im Organisationskontext verankern

Microsoft Work IQ verankert Copilot und Agenten darin, wie eine Organisation tatsächlich arbeitet: Projekte, Mitwirkende, Dokumente, Muster. Der Beitrag grenzt die Kontextschicht vom Data Lake ab und erklärt, warum Berechtigungen zur Abfragezeit aufgelöst werden müssen, was CVE-2025-32711 offengelegt hat und welche sechs Punkte Teams vor der Einführung prüfen sollten.

Der Index weiß mehr, als der Nutzer wissen darf

Ein Bestand, drei Abteilungen, Filterung nach Rechten nach dem Abruf. Ein Kollege zeigte an einem Vormittag, dass sich um den Filter herum schließen lässt: Was zurückkommt, wenn ein gesperrtes Dokument der beste Treffer wäre, verrät etwas, auch wenn das Dokument es nicht tut. Tang und Kollegen arbeiten an Datenschutzgarantien für Retrieval.

Dual-State-Architekturen für Agenten

Chatverläufe protokollieren Äußerungen; sie sind keine Datenbanken. Dieser Artikel beschreibt eine Dual-State-Architektur für KI-Agenten: ein autoritativer, schemavalidierter Prozesszustand pro Instanz, aus dem jede nutzerseitige Sicht als Projektion einer konkreten Revision berechnet wird. Wir behandeln die Wurzeln des Musters in Event Sourcing und CQRS, seine Audit- und Nebenläufigkeitsvorteile und seine ehrlichen Grenzen.

Wem gehört der Assistent, wenn wir gehen

Wir sollten prüfen, warum ein Assistent schlechter geworden war, und fanden elf in der Organisation, mit benanntem Verantwortlichen für zwei. Acharya schlägt ein Reifegradmodell gegen Agenten-Wildwuchs vor. Die vier Fragen, die wir heute zu jedem betriebenen System stellen, das Übergabedokument, auf dem wir bestehen, und warum ein Assistent ohne Eigentümer schlechter ist als keiner.

Agent-Evals in der CI: Regressions-Gates für Trajektorien und Tool-Calls

Deterministische Tests greifen bei Agenten zu kurz, weil derselbe Input unterschiedliche Trajektorien erzeugt. Dieser Artikel zeigt, wie Sie Regressionen 2026 in der CI abfangen: Assertions auf Tool-Calls und Trajektorien, Offline-Datensätze mit Referenzausgaben, Online-LLM-Judges auf Produktions-Traces, Kostenverfolgung pro Lauf und eval-getriebene Entwicklung als Arbeitsweise für Agenten in Produktion.