Beiträge

Eigene Projekte und Positionen

Die Grundlagen sind gebaut, um durchgearbeitet zu werden. Hier steht das andere: einzelne Stücke, geordnet nach dem, was sie versprechen. Ein Use-Case behauptet ein übertragbares Ergebnis, ein Werkstattbericht behauptet das ausdrücklich nicht.

21 Beiträge · 6 vorgemerkt

MeinungenEine Behauptung, eine Begründung, und was dagegen spricht. Als Meinung gekennzeichnet, damit niemand sie für einen Befund hält.1 Beitrag
Use-CasesEin Vorhaben, der Aufwand, das Ergebnis mit Zahl, und was schiefging. Übertragbar gemeint: Wer Ähnliches vorhat, soll abschätzen können, was ihn erwartet.2 vorgemerkt
··Ein Agenten-System, das täglich öffentliche Vergabeportale abfragtvorgemerkt
··Eine Präsentation in 20 Minuten statt in drei Stundenvorgemerkt
FachartikelEin Thema so weit ausgeführt, wie es nötig ist. Zu lang für einen Absatz, zu speziell für ein Grundlagenkapitel.13 Beiträge
FachartikelDerselbe Prompt, sieben Modelle, zwei Richtungen

Eine verbreitete Regel sagt, man solle im Prompt nennen, was zu tun ist, statt was zu lassen. Eine eigene Messung über sieben Modelle zeigt, dass dieselbe Umformulierung die einen verbessert und die anderen verschlechtert.

Lesen · 6 min
FachartikelErst der rote Test

Testgetriebene Entwicklung heißt, den Test vor dem Code zu schreiben. Im Betrieb mit einem Agenten entscheidet diese Reihenfolge darüber, wer die Erwartung festlegt. Was dazu gemessen ist, wo die Vorteile liegen, und wie man es in Claude Code so einrichtet, dass es auch stattfindet.

Lesen · 17 min
FachartikelMCP, was ohne Sitzung übrig bleibt

Die Protokollfassung 2026-07-28 des Model Context Protocol streicht Handshake, Sitzung und Wiederaufnahme. Was an ihre Stelle tritt, wer davon profitiert, und welche Paarungen aus Client und Server danach schlicht nicht mehr funktionieren.

Lesen · 8 min
FachartikelWas offene Gewichte wert sind, wenn sie 1,56 Terabyte wiegen

Kimi K3 ist herunterladbar und praktisch von niemandem allein zu betreiben. Beides stimmt gleichzeitig, und der Widerspruch löst sich auf, sobald man aufhört, offen mit lokal zu verwechseln.

Lesen · 5 min
FachartikelWelcher Copilot in welchem Microsoft-365-Paket steckt

In fast jedem Microsoft-365-Paket ist ein Copilot enthalten, und es ist nicht der, den die Werbung zeigt. Was ohne Aufpreis dabei ist, was das kostenpflichtige Add-on wirklich heißt, was es in Deutschland kostet und woran der Unterschied hängt.

Lesen · 12 min
FachartikelWen die Kennzeichnungspflicht für KI-Texte trifft

Seit dem 2. August 2026 gilt Artikel 50 der KI-Verordnung. Vier Fragen entscheiden, ob ein Unternehmen betroffen ist, und die meisten Antworten fallen anders aus als die Schlagzeilen vermuten lassen. Mit den Beispielen der Kommission und der einen Bedingung, an der die Ausnahme später wieder zerbricht.

Lesen · 9 min
FachartikelWie eine Maschine ein Dokument zerlegt

Zeichen aus einem Bild zu lesen gilt als gelöst. Die Struktur darunter nicht: welche Zeile zu welcher Spalte gehört, welche Zelle in welche Reihe, was Fußnote ist und was Fließtext. Drei Bauformen versuchen das, ihre Ranglisten messen weniger als sie versprechen, und seit macOS 26 liefert das Betriebssystem selbst Absätze, Tabellen und Listen.

Lesen · 11 min
FachartikelDasselbe Modell, dreifacher Wert

OpenAI hat den ARC-AGI-3-Test noch einmal gefahren, ohne am Modell etwas zu ändern, und kommt von 13,3 auf 38,3 Prozent. Verändert wurde nur die Umgebung, in der das Modell arbeitet. Was das für jede Benchmark-Zahl bedeutet, die man liest.

Lesen · 3 min
FachartikelADR und Spezifikation: wie viel Papier ein Agent braucht

Architecture Decision Records halten fest, warum etwas so gebaut ist, eine Spezifikation sagt, was entstehen soll. Mit Codingagenten sind beide wieder gefragt. Wann welches Artefakt hilft, ab wann es zu viel wird, was hinter dem Vorwurf vom Wasserfall steckt und welche Orte es sonst gibt.

Lesen · 10 min
FachartikelWelchen Copilot habe ich?

Copilot heißt bei Microsoft eine ganze Reihe von Produkten, die wenig miteinander zu tun haben. Wer welchen vor sich hat, entscheidet die Lizenz, und die Beschriftung hilft dabei kaum weiter.

Lesen · 4 min
FachartikelWas vor der Copilot-Einführung zu klären ist

Sieben Handgriffe vor der ersten Lizenz, jeder an der Herstellerdoku belegt: eigene Lizenz nachsehen, Postfachlage prüfen, Berechtigungen aufräumen, Message Center abonnieren.

Lesen · 4 min
FachartikelWie aus Anthropics Speicherpflicht für Unternehmen ein Kompromiss mit eigenem Schlüssel wurde

Anthropic verlangt seit Fable 5 eine dreißigtägige Speicherfrist gegen Missbrauch. Enterprise Frontier Safeguards verlagert diese Daten jetzt in die eigene Cloud-Umgebung der Kunden.

Lesen · 4 min
FachartikelWie Claude Docs und Claude Slides funktionieren

Anthropics eigene Hilfeartikel zeigen, was hinter Claude Docs und Claude Slides steckt: derselbe Artifact-Unterbau, Rechte und Zuordnung je Änderung, Exportwege und die bewusst offengelassenen Lücken. Dazu die Abgrenzung zum getrennten Add-in Claude for PowerPoint.

Lesen · 8 min
WerkstattberichteWie etwas gebaut wurde, mit den Messungen und den Fehlschlägen. Der Wert liegt in der offengelegten Arbeit, ein Ergebnis zum Mitnehmen gibt es hier nicht.5 Beiträge
WerkstattberichtElf Wege, ein lokales Modell schneller zu machen

llama.cpp bietet elf Verfahren an, die dasselbe versprechen: mehr Token je Sekunde ohne neue Hardware. Eine Messung über vier Textsorten zeigt, dass die meisten auf einem Arbeitsrechner nicht messbar sind, und dass die interessantere Kennzahl woanders steht.

Lesen · 12 min
WerkstattberichtNeues Modell, alte Anweisungen

Mit jedem neuen Modell veröffentlicht Anthropic Hinweise, was sich am Prompt ändern sollte, und seit August einen Befehl, der die eigenen Prompt-Dateien danach durchsucht. Ein Lauf über einen gewachsenen Claude-Code-Aufbau beim Wechsel auf Opus 5.5: was er fand, was bleiben durfte und was eine erste Messung davon übrig ließ.

Lesen · 13 min
WerkstattberichtQR-Codes aus dem Chat, und wozu dann noch ein Werkzeug

Drei Chat-Anwendungen bekamen denselben Satz und lieferten in unter einer Minute einen QR-Code. Nachgemessen unterscheiden sich die drei Ergebnisse. Keines kodiert genau das, was eingegeben wurde. Was daraus für ein eigenes Werkzeug folgt, und was an einem Tag beim Bauen schiefging.

Lesen · 12 min
WerkstattberichtWarum ich eine eigene Diktier-App gebaut habe

Es gibt drei Arten von Diktier-Software für den Mac. Gepasst hat keine. Der Bericht über den Bau einer eigenen: was vorher gemessen wurde, welche Modelle durchfielen, und was die Nutzung danach über die eigenen Annahmen verraten hat.

Lesen · 36 min
WerkstattberichtWo in der eigenen Texterkennung das Modell sitzt

Ein Balkendiagramm gab die Zeichenfolge 120 180 150 210 Q1 Q2 Q3 Q4 zurück. Jedes Zeichen richtig gelesen, die Aussage weg. Der Bericht über eine eigene Texterkennung auf einem Mac Mini, über die Frage, welche Entscheidung darin wirklich ein Modell trifft, über eine Label-Tabelle, die drei Monate lang zu einem anderen Modell gehörte, und über 598 Tabellenzellen, die niemand vermisst hatte.

Lesen · 24 min
NotizenKurz festgehalten, was passiert ist und was es bedeutet. Mit Datum und Quelle.2 Beiträge

Was für Unternehmen taugt, erscheint zusätzlich unter Im Unternehmen. Es liegt trotzdem nur einmal hier: Ein zweites Lager für dieselben Texte läuft nach ein paar Monaten auseinander, und das fällt erst auf, wenn die falsche Fassung online ist.

Tippen Sie los.

↑↓ auswählenEnter öffnenDie Suche läuft im Browser. Nichts wird übertragen.