Eigene Projekte und Positionen
Die Grundlagen sind gebaut, um durchgearbeitet zu werden. Hier steht das andere: einzelne Stücke, geordnet nach dem, was sie versprechen. Ein Use-Case behauptet ein übertragbares Ergebnis, ein Werkstattbericht behauptet das ausdrücklich nicht.
21 Beiträge · 6 vorgemerkt
Eine verbreitete Regel sagt, man solle im Prompt nennen, was zu tun ist, statt was zu lassen. Eine eigene Messung über sieben Modelle zeigt, dass dieselbe Umformulierung die einen verbessert und die anderen verschlechtert.
Lesen · 6 minFachartikelErst der rote TestTestgetriebene Entwicklung heißt, den Test vor dem Code zu schreiben. Im Betrieb mit einem Agenten entscheidet diese Reihenfolge darüber, wer die Erwartung festlegt. Was dazu gemessen ist, wo die Vorteile liegen, und wie man es in Claude Code so einrichtet, dass es auch stattfindet.
Lesen · 17 minFachartikelMCP, was ohne Sitzung übrig bleibtDie Protokollfassung 2026-07-28 des Model Context Protocol streicht Handshake, Sitzung und Wiederaufnahme. Was an ihre Stelle tritt, wer davon profitiert, und welche Paarungen aus Client und Server danach schlicht nicht mehr funktionieren.
Lesen · 8 minFachartikelWas offene Gewichte wert sind, wenn sie 1,56 Terabyte wiegenKimi K3 ist herunterladbar und praktisch von niemandem allein zu betreiben. Beides stimmt gleichzeitig, und der Widerspruch löst sich auf, sobald man aufhört, offen mit lokal zu verwechseln.
Lesen · 5 minFachartikelWelcher Copilot in welchem Microsoft-365-Paket stecktIn fast jedem Microsoft-365-Paket ist ein Copilot enthalten, und es ist nicht der, den die Werbung zeigt. Was ohne Aufpreis dabei ist, was das kostenpflichtige Add-on wirklich heißt, was es in Deutschland kostet und woran der Unterschied hängt.
Lesen · 12 minFachartikelWen die Kennzeichnungspflicht für KI-Texte trifftSeit dem 2. August 2026 gilt Artikel 50 der KI-Verordnung. Vier Fragen entscheiden, ob ein Unternehmen betroffen ist, und die meisten Antworten fallen anders aus als die Schlagzeilen vermuten lassen. Mit den Beispielen der Kommission und der einen Bedingung, an der die Ausnahme später wieder zerbricht.
Lesen · 9 minFachartikelWie eine Maschine ein Dokument zerlegtZeichen aus einem Bild zu lesen gilt als gelöst. Die Struktur darunter nicht: welche Zeile zu welcher Spalte gehört, welche Zelle in welche Reihe, was Fußnote ist und was Fließtext. Drei Bauformen versuchen das, ihre Ranglisten messen weniger als sie versprechen, und seit macOS 26 liefert das Betriebssystem selbst Absätze, Tabellen und Listen.
Lesen · 11 minFachartikelDasselbe Modell, dreifacher WertOpenAI hat den ARC-AGI-3-Test noch einmal gefahren, ohne am Modell etwas zu ändern, und kommt von 13,3 auf 38,3 Prozent. Verändert wurde nur die Umgebung, in der das Modell arbeitet. Was das für jede Benchmark-Zahl bedeutet, die man liest.
Lesen · 3 minFachartikelADR und Spezifikation: wie viel Papier ein Agent brauchtArchitecture Decision Records halten fest, warum etwas so gebaut ist, eine Spezifikation sagt, was entstehen soll. Mit Codingagenten sind beide wieder gefragt. Wann welches Artefakt hilft, ab wann es zu viel wird, was hinter dem Vorwurf vom Wasserfall steckt und welche Orte es sonst gibt.
Lesen · 10 minFachartikelWelchen Copilot habe ich?Copilot heißt bei Microsoft eine ganze Reihe von Produkten, die wenig miteinander zu tun haben. Wer welchen vor sich hat, entscheidet die Lizenz, und die Beschriftung hilft dabei kaum weiter.
Lesen · 4 minFachartikelWas vor der Copilot-Einführung zu klären istSieben Handgriffe vor der ersten Lizenz, jeder an der Herstellerdoku belegt: eigene Lizenz nachsehen, Postfachlage prüfen, Berechtigungen aufräumen, Message Center abonnieren.
Lesen · 4 minFachartikelWie aus Anthropics Speicherpflicht für Unternehmen ein Kompromiss mit eigenem Schlüssel wurdeAnthropic verlangt seit Fable 5 eine dreißigtägige Speicherfrist gegen Missbrauch. Enterprise Frontier Safeguards verlagert diese Daten jetzt in die eigene Cloud-Umgebung der Kunden.
Lesen · 4 minFachartikelWie Claude Docs und Claude Slides funktionierenAnthropics eigene Hilfeartikel zeigen, was hinter Claude Docs und Claude Slides steckt: derselbe Artifact-Unterbau, Rechte und Zuordnung je Änderung, Exportwege und die bewusst offengelassenen Lücken. Dazu die Abgrenzung zum getrennten Add-in Claude for PowerPoint.
Lesen · 8 minllama.cpp bietet elf Verfahren an, die dasselbe versprechen: mehr Token je Sekunde ohne neue Hardware. Eine Messung über vier Textsorten zeigt, dass die meisten auf einem Arbeitsrechner nicht messbar sind, und dass die interessantere Kennzahl woanders steht.
Lesen · 12 minWerkstattberichtNeues Modell, alte AnweisungenMit jedem neuen Modell veröffentlicht Anthropic Hinweise, was sich am Prompt ändern sollte, und seit August einen Befehl, der die eigenen Prompt-Dateien danach durchsucht. Ein Lauf über einen gewachsenen Claude-Code-Aufbau beim Wechsel auf Opus 5.5: was er fand, was bleiben durfte und was eine erste Messung davon übrig ließ.
Lesen · 13 minWerkstattberichtQR-Codes aus dem Chat, und wozu dann noch ein WerkzeugDrei Chat-Anwendungen bekamen denselben Satz und lieferten in unter einer Minute einen QR-Code. Nachgemessen unterscheiden sich die drei Ergebnisse. Keines kodiert genau das, was eingegeben wurde. Was daraus für ein eigenes Werkzeug folgt, und was an einem Tag beim Bauen schiefging.
Lesen · 12 minWerkstattberichtWarum ich eine eigene Diktier-App gebaut habeEs gibt drei Arten von Diktier-Software für den Mac. Gepasst hat keine. Der Bericht über den Bau einer eigenen: was vorher gemessen wurde, welche Modelle durchfielen, und was die Nutzung danach über die eigenen Annahmen verraten hat.
Lesen · 36 minWerkstattberichtWo in der eigenen Texterkennung das Modell sitztEin Balkendiagramm gab die Zeichenfolge 120 180 150 210 Q1 Q2 Q3 Q4 zurück. Jedes Zeichen richtig gelesen, die Aussage weg. Der Bericht über eine eigene Texterkennung auf einem Mac Mini, über die Frage, welche Entscheidung darin wirklich ein Modell trifft, über eine Label-Tabelle, die drei Monate lang zu einem anderen Modell gehörte, und über 598 Tabellenzellen, die niemand vermisst hatte.
Lesen · 24 minMoonshot AI hat am 27. Juli die Gewichte seines größten Modells freigegeben: 2,8 Billionen Parameter, 96 Dateien, 1,56 Terabyte. Was in der Meldung steht und was sich daraus nicht ableiten lässt.
Lesen · 2 minNotizMCP wird zustandslosDie neue Fassung des Protokolls für Tool-Anbindung streicht Handshake und Sitzung. Was dadurch leichter wird, was zum Client wandert und was in zwölf Monaten verschwindet.
Lesen · 2 minWas für Unternehmen taugt, erscheint zusätzlich unter Im Unternehmen. Es liegt trotzdem nur einmal hier: Ein zweites Lager für dieselben Texte läuft nach ein paar Monaten auseinander, und das fällt erst auf, wenn die falsche Fassung online ist.