Artikel

Einordnungen und Praxisnotizen zu KI-Agenten, Testautomatisierung und Qualitätssicherung.

Gegenläufige Kurven: Warum zwischen lokalem LLM und GitHub Copilot die Datenklassifizierung entscheidet – nicht der Preis

Festpreis-Vergleiche und Datenschutz-Pauschalen sind 2026 als Entscheidungsgrundlage weggebrochen. Was bleibt, ist die Frage, welche Datenklassen mehr brauchen als EU-Residency – und nur für diesen Rest ist der lokale Betrieb begründbar.

Token-Kosten senken – aber erst die richtige Frage stellen

Warum Token-Kosten-Kontrolle nicht mit Caching oder lokalen LLMs beginnt, sondern mit zwei vorgelagerten Fragen: Liefert der KI-Einsatz belegten Wert – und welche Zahlen sind Fakten, welche nur Bandbreiten?

Wenn der Agent altert: Der Lebenszyklus selbstgebauter KI-Agenten

Selbstgebaute KI-Agenten sind Code – also haben sie einen Lebenszyklus. Warum Reife dosieren heißt statt maximal ausbauen, und warum kein Release-Prozess einen Agenten deterministisch macht.

Wenn der Agent zu Code wird: Wie Teams selbstgebaute KI-Assistenten versionieren und absichern

Selbstgebaute KI-Agenten in Copilot, Claude Code oder Cursor sind keine persönlichen Einstellungen, sondern Code-Bestandteile – und gehören versioniert, gereviewt und abgesichert wie anderer Code. Mit Augenmaß.

Kein Vertrauen ohne Abnahme: KI-Recherche prüfbar machen

Wie wir KI-Recherche prüfbar machen – mit einem Audit-Gate, einem Score, Prüfungen auf Bedeutung und Form und einem Menschen, der am Ende geradesteht.

Grüne Balken, trügerische Sicherheit: Was wir verlieren, wenn KI das Testen übernimmt

Agentenbasierte Testautomatisierung verspricht grüne Pipelines ohne menschliches Zutun. Warum das Oracle-Problem, Nicht-Determinismus und erodierende Kompetenzen das eigentliche Risiko sind - und was die Rolle des Test-Auditors tragfähig macht.

KI-gestützte Testfall-Generierung: Warum „Erstell mir 10 Tests" nicht reicht

Warum naive Test-Prompts zu redundanten Testsuiten führen — und welche Prompting-Muster für Äquivalenzklassen, Grenzwertanalyse und risikobasiertes Testdesign tatsächlich funktionieren.