
AI
Wir glauben daran, dass AI einen deutlich höheren Kundennutzen erlaubt, wenn man sie richtig einsetzt!
Hier findest du:
Aktuellste Beiträge
-

Die Desk Tax ist ein Mythos
230 verschenkte Stunden, jammert das Internet. Drei Instanzen parallel, Weekly-Limit am Mittwoch durch, jammert die andere Hälfte des Internets. Beide reden über dasselbe Tool. Eine Replik auf die „Desk Tax“ – plus die Erkenntnis, dass alle Lösungen dafür Relay-Services sind, die dir genau null zusätzliche Tokens schenken.
-

Mutation Testing bei KI-Agenten: Wer hält das Schloss?
Ein grüner Haken ist eine Behauptung, kein Beweis. Hatten wir jetzt schon ein paar Mal. Weil 100 % Testabdeckung klingt auch nur so lange beeindruckend, bis man merkt, dass auch ein Test, der nichts prüft, grün durchläuft. Also werfen wir mal einen Blick darauf, was Mutation Testing zeigt (und Coverage verschweigt).
-

Drei Agenten für den Product Owner
Recherche, Stories, technische Planung: Drei spezialisierte KI-Agenten in Claude Code nehmen mir als Product Owner die Fleißarbeit ab – und zeigen zugleich, wo die KI an ihre Grenzen stößt. Ein ehrlicher Werkstattbericht über Effizienz, Quality Gates und die Frage, wohin die gesparte Zeit eigentlich wandert.
Weitere Beiträge
-
Spec-Driven Development, oder: EARS vs. Vibe Coding
Der grüne Haken sagt „erfüllt die Spezifikation“. Nett. Aber welche? Das Problem: Dein Agent fragt nie zurück. Er rät einfach – selbstbewusst, schnell … und meistens falsch. Dieser Teil der Serie zeigt, wie Spec-Driven Development und EARS-Notation das ändern. Und weil ich ehrlich sein muss: Sogar mein Claude Opus ist beim Schreiben dieser Serie genau…
-
Warum bessere Prompts deinen KI-Code nicht retten
Manche feiern das Tempo agentischen Codens, andere zeigen auf die Trümmer. Beide haben recht und beide übersehen die eigentliche Ursache: Reward Hacking. Das ist der Auftakt einer Serie über Qualität als Systemfrage.
-
Multi-Modell-Workflow mit Dynamic Agents
Warum ein Modell allein nicht reicht: Drei Rollen, drei Modelle; teuer geplant, günstig gebaut, fremd geprüft. Inklusive des Bugs, den nur ein Reviewer aus einer anderen Modellfamilie fand.
-
Claude Code Must-Haves Juni ’26
Im März drehte sich alles um Werkzeuge. Jetzt orchestriert Claude Code Subagenten selbst, bis zu 16 nebenläufig. Ein Snapshot aus der täglichen Praxis: Workflows, Plugins, Memory und Hooks im Juni 2026.
-
Mental Load bei LLMs
Mental Loads bei LLMs ist ein reales Problem. Denn das Modell selbst merkt die Probleme nicht. Zeit für ein wenig (Self-)Care.
-
Late Interaction in PostgreSQL
Ein Vektor pro Dokument? Das ist eine Zusammenfassung – und versteckt oft genau die Evidenz, die du suchst. ColBERT-Style Late Interaction macht es token-genau, jetzt dank etwas Spielerei nativ in PostgreSQL.





