Llm

13. Jun 2026

Kein Geist in der Maschine: Über die Verwechslung von Sprachmodell und Bewusstsein

ChatGPT klingt nachdenklich. Claude klingt empathisch. Trotzdem ist da niemand zuhause. Eine mechanistische, philosophische und gesellschaftliche Einordnung des Unterschieds zwischen Sprachmodellen und Bewusstsein.
llm · KI · politik
7. Jun 2026

Graphify und MemPalace: zwei Antworten auf das Gedächtnisproblem von Claude Code

Innerhalb weniger Wochen sind zwei quelloffene Tools angetreten, um das Gedächtnisproblem von Claude Code zu lösen. Sie lösen aber nicht dasselbe Problem — Graphify baut einen Code-Graphen, MemPalace speichert das Gespräch.
llm · claude-code · projekt
23. May 2026

Drei Quellen, eine Wahrheit — Validierung des byhaushalt-Parsers gegen PDF und STMFH-Diagramm

Bonus-Artikel der Reihe — wie sich der Parser des byhaushalt-Demos gegen zwei voneinander unabhängige Quellen messen lässt: die offiziellen EPL-PDFs des bayerischen Finanzministeriums und das interaktive Haushaltsdiagramm auf stmfh.bayern.de. Σ Einnahmen und Σ Ausgaben treffen die PDF-Σ bit-exakt; die Restdifferenz gegen STMFH ist datenstandsbedingt.
agentic-coding · claude-code · byhaushalt · llm
23. May 2026

Vom Branch zur Live-URL — Worktree-PR-Workflow und Codeberg-Pages-Deploy

Artikel 10 der Reihe — wie aus einer Vite-SPA im Repo eine Live-Site unter eigener Subdomain wird. Branch-Protection für Solo-Projekte, ein Bash-Skript das via git worktree den pages-Branch befüllt, Custom-Domain über DNS-CNAME plus .domains-Datei, HTTPS via Let's Encrypt. Und warum CI bewusst ein eigener Folge-Artikel wird.
agentic-coding · claude-code · byhaushalt · llm
18. May 2026

Hooks — Tests als Gate im Hintergrund

Artikel 9 der Reihe — drei Hooks für byhaushalt: PostToolUse formatiert nach jedem Edit, PreToolUse blockt Commits mit Debug-Resten, Stop läuft schnelle Tests aber nur für geänderte Layer. Warum ein zu aggressiver Stop-Hook mehr schadet als nützt, und warum Playwright in die CI gehört, nicht in den Hook.
agentic-coding · claude-code · byhaushalt · llm
17. May 2026

End-to-End mit Playwright-MCP — Tests die Claude selbst schreibt

Artikel 8 der Reihe — Markdown-Spec als E2E-Test-Vertrag: Claude liest den User-Flow, exploriert live im Browser über Playwright-MCP, findet robuste Selektoren und schreibt den Playwright-Test. Drei Specs, drei Tests, drei Baseline-Screenshots.
agentic-coding · claude-code · byhaushalt · llm
16. May 2026

MCP-Server — Doku-Lookup im Editor

Artikel 7 der Reihe — zwei MCP-Server, eine Projektkonfiguration: Context7 holt aktuelle Library-Doku direkt in den Editor, bevor Claude raten muss. Plus shadcn/ui-Migration und ein chart-builder-Skill, der Context7 gezielt aufruft.
agentic-coding · claude-code · byhaushalt · llm
16. May 2026

Worktrees — Drei Visualisierungen parallel bauen

Artikel 6 der Reihe — drei Worktree-Branches, drei Visualisierungen über demselben Datenmodell. Treemap, Sunburst und Sankey nebeneinander vergleichen, statt sequenziell zu raten. Plus: warum die Entscheidung am Ende nicht gegen zwei Verlierer fiel, sondern für einen Switcher.
agentic-coding · claude-code · byhaushalt · llm
14. May 2026

Hello Hummingbird — Das Skelett

Artikel 1 · Swift auf dem Server mit Hummingbird. Wir legen das Projekt an, schreiben Package.swift, richten den AsyncParsableCommand-Einstiegspunkt ein und bauen einen minimalen Router mit /healthz und /v1/models bis curl eine Antwort liefert.
Hummingbird · llm · swift
13. May 2026

Subagent-Driven Development — Datenmodell parallel bauen

Artikel 5 der Reihe — v0.4 liefert drei JSON-Dateien, kein Datenmodell. Ein Plan-File mit drei Tasks und parallelen Subagents baut Schema, Normalisierung und Property-based Tests. Plus: was Format-Inkonsistenz über Parallelisierung lehrt.
agentic-coding · claude-code · byhaushalt · llm
13. May 2026

ABAP goes Agentic: MCP Server, VS Code und der Preis für KI-Unterstützung

SAP hat auf dem Sapphire 2026 den ABAP MCP Server zur allgemeinen Verfügbarkeit angekündigt — die technische Grundlage, um externe KI-Agenten wie GitHub Copilot, Amazon Q oder Claude Code direkt in ABAP-Entwicklung einzubinden. Was die Ankündigungen technisch bedeuten, was sie kosten werden und wo die Grenzen noch liegen.
llm · coding
12. May 2026

Slash Commands — Wiederholung wegautomatisieren

Artikel 4 der Reihe — mit drei Slash Commands wird der Parser wiederholbar: /parse-epl für beliebige Einzelpläne, /check-totals mit eingebautem pytest-Aufruf, /diff-vs-gesamt für den Abgleich gegen den Gesamthaushalt. Plus: was xfail über Parser-Lücken verrät.
agentic-coding · claude-code · byhaushalt · llm
11. May 2026

Eigene Skills schreiben — PDF-Parser-Skill mit pytest TDD

Artikel 3 der Reihe — der erste Parser-Code für byhaushalt entsteht per TDD: Custom Skill mit Trigger-Description, uv-Setup, sechs Tests vor der Implementation, und wie der Summen-Konsistenz-Test Halluzinationen im PDF-Parsing verhindert.
agentic-coding · claude-code · byhaushalt · llm
10. May 2026

Erkunden statt loslegen — Plan Mode mit Subagents

Artikel 2 der Reihe — bevor byhaushalt seinen ersten Parser-Code sieht, kartiert Claude Code die PDF-Struktur der bayerischen Haushaltspläne. Plan Mode, Explore-Subagent und Architecture Decision Records als Werkzeuge für das Erkunden vor dem Implementieren.
agentic-coding · claude-code · byhaushalt · llm
10. May 2026

CLAUDE.md als Briefing

Artikel 1 der Reihe — wir installieren Claude Code, legen das byhaushalt-Repo an, schreiben die erste Memory-Datei und legen fest, woran sich der Agent in jeder Session zu halten hat. Plus: Permissions, Quelldaten, der erste Tag.
agentic-coding · claude-code · byhaushalt · llm
8. May 2026

Was Agentic Coding eigentlich heißt

Prolog · Serie: Agentic Coding mit Claude Code. Wer sich in diesem Jahr durch Tech-Newsletter, Konferenz-Keynotes und Tool-Landingpages liest, trifft auf zwei Begriffe, die beide mit denselben Versprechen verkauft werden: Vibe Coding und Agentic Coding. Die Zukunft des Programmierens, heißt es.
agentic-coding · claude-code · llm · coding · byhaushalt
7. May 2026

Subquadratic SubQ: Ein Startup behauptet das Skalierungsgesetz von Transformern gebrochen zu haben

Ein neues LLM aus Miami verspricht 12 Millionen Tokens Kontext, lineare Skalierung und 52-fache Geschwindigkeit gegenüber FlashAttention. Wir schauen uns an, was technisch dahintersteckt – und wo die berechtigte Skepsis ansetzt.
llm
7. May 2026

Bonus: Wir bauen Lal — ein kleines Basismodell aus den Bauteilen der Serie

Acht Artikel Theorie, ein Bonus-Kapitel Praxis. Wir führen alle Code-Bausteine der LLM-Serie zu einem lauffähigen Mini-Sprachmodell zusammen, trainieren es auf TinyShakespeare und hängen einen winzigen SFT-Schritt an. Mit Augenzwinkern Richtung Star Trek TNG.
llm · python
5. May 2026

Fine-Tuning, vom Basismodell zum Assistenten

Wie aus einem Basismodell, das Texte vervollständigt, ein hilfreicher Assistent wird. Supervised Fine-Tuning, RLHF, DPO und Constitutional AI — das letzte Stück der LLM-Pipeline, mit der ehrlichen Frage, was Alignment eigentlich löst.
llm · python
3. May 2026

Wenn die sichere KI-Schmiede die Haustür offen lässt

Claude Desktop registriert ungefragt eine Native-Messaging-Brücke in sieben Browser-Verzeichnissen — auch in nicht installierten. Was das technisch bedeutet, warum es gegen die ePrivacy-Richtlinie verstößt, und warum gerade Anthropic damit Vertrauen verspielt.
llm · claude-code · datenschutz
3. May 2026

Der Transformer, die vollständige Architektur

Position, Tiefe, Stabilität — was zu Attention dazukommt, damit ein vollständiger Transformer entsteht. Positional Encodings, Feed-Forward-Schichten, Residual Connections, Layer Normalization, der ganze Block in Python und der Sprung zu GPT, BERT, Llama und Claude.
llm · python
2. May 2026

Migration mit CI-Fokus: Vom Plan zur Ausführung

Eine schrittweise Migrationsstrategie weg von GitHub, mit Schwerpunkt auf CI-Pipelines. Konkrete Workflow-Übersetzung, Self-Hosted-Runner-Setup und eine abhakbare Checkliste.
coding · llm · datenschutz
30. Apr 2026

Attention Is All You Need

Wie aus dem Bottleneck der RNNs ein Mechanismus wurde, der jeden Token mit jedem anderen verbindet. Query, Key, Value, Multi-Head und das Paper, das die NLP-Welt umkrempelte, erklärt mit Bibliotheks-Bildern und etwas Mathe für die, die es genau wissen wollen.
llm · python
29. Apr 2026

Alternativen im Vergleich: Codeberg, Forgejo, Gogs, Launchpad und mehr

Welche Code-Hosting-Plattformen arbeiten ohne Default-on-Datenverarbeitung? Vergleichstabelle, Plattform-Steckbriefe von Codeberg über Gogs und Launchpad bis zu AWS CodeCommit, plus konkrete TDM-Opt-out-Implementierung.
coding · llm · datenschutz
26. Apr 2026

Default-on seit 24. April: GitHub trainiert Copilot mit Nutzer-Code

Seit dem 24. April 2026 nutzt GitHub die Copilot-Daten von Free-, Pro- und Pro+-Konten standardmäßig zum KI-Training. Was hinter der Änderung steckt und warum sie das Zwei-Klassen-Modell der Plattform offenlegt.
llm · coding · politik
24. Apr 2026

Kontext und RNNs — warum Reihenfolge zählt

Warum Sprache Gedächtnis braucht, und wie die ersten Sprachmodelle diesen Kontext gelernt haben. Rekurrente Netze, LSTMs und das Problem mit langen Sätzen, erklärt ohne Formel-Gewitter.
llm · python
24. Apr 2026

GPT-5.5 im Realitätscheck: Benchmarks, Preise und was uns OpenAI nicht erzählt

Eine unabhängige Analyse des am 23. April 2026 veröffentlichten GPT-5.5. Was die Zahlen wirklich sagen, wo Claude Opus 4.7 weiterhin führt und warum die Preisentwicklung Entwickler beunruhigen sollte.
llm · claude-code
22. Apr 2026

Backpropagation — wie ein Modell lernt

Wie neuronale Netze aus Fehlern lernen. Loss, Gradienten, Chain Rule, Gradient Descent — Backpropagation von Hand implementiert auf einem 2-Layer MLP das XOR und Token-Vorhersage lernt.
llm · python
21. Apr 2026

Neuronale Netze von Grund auf

Was zwischen Embedding und Logit passiert. Neuronen, Layer, Forward Pass und Aktivierungsfunktionen — vollständig in numpy implementiert, ohne Framework-Magie.
llm · python
20. Apr 2026

Wörter als Punkte im Raum — was Embeddings wirklich sind

Wie Sprachmodelle Bedeutung in Zahlen kodieren. Embedding-Tabellen, Cosine Similarity, Vektorarithmetik und warum King minus Man plus Woman gleich Queen ergibt.
llm · python
18. Apr 2026

Das nächste Wort — wie Sprachmodelle funktionieren

Was passiert zwischen Eingabe und Antwort? Tokens, Wahrscheinlichkeitsverteilungen und Sampling-Strategien — Schritt für Schritt erklärt, mit echtem Code.
llm · python
16. Apr 2026

Claude Opus 4.7: Mehr Coding-Power, mehr Pixel und ein Hinweis auf Mythos

Anthropic veröffentlicht Claude Opus 4.7 mit deutlich besserer Coding-Performance, 3,75 Megapixel Vision und einem neuen xhigh-Effort-Level. Eine Einordnung der Benchmarks und des Mythos-Hinweises am Rande.
llm · coding
12. Apr 2026

MemPalace: Wie Milla Jovovich das KI-Gedächtnis geknackt hat

Ein Open-Source-Tool, das kommerzielle KI-Memory-Lösungen deklassiert — mit einer 2.500 Jahre alten Methode, lokal, kostenlos und quelloffen.
llm · projekt
12. Apr 2026

Claude Mythos: Sandbox-Ausbruch, Zero-Days und die Frage nach dem Hype

Anthropics Claude Mythos brach aus einer Sandbox aus und fand tausende Zero-Days. Eine Einordnung zwischen echtem Risiko, methodischen Lücken und strategischer Narrativsteuerung.
llm · politik