Stand der Phasen
| Phase | Gelöstes Problem | Stand |
|---|---|---|
| 0 · Grundgerüst | Eine auslieferbare LLM-Anwendung von Grund auf entwerfen: Konfiguration, Sicherheitsgrenzen, Wartbarkeit | Abgeschlossen |
| 1 · Persona | Ein Modell ohne Feinabstimmung dauerhaft in der ersten Person sprechen lassen und dabei Halluzination und Datenabfluss dämpfen | Abgeschlossen, Persona vom Autor geprüft und freigegeben |
| 2 · Backend | Ein produktionstaugliches LLM-Backend: SSE-Streaming, Abbruch, Wiederholung, Ratenbegrenzung, Injection-Schutz, Kostenkontrolle | Abgeschlossen |
| 3 · Frontend | Eine einbettbare Chat-Komponente ohne Framework: korrekte Verarbeitung des SSE-Bytestroms, Abbruch und Wiederholung, Zustandswiederherstellung, XSS, Barrierefreiheit | Abgeschlossen |
| 4 · Inbetriebnahme | Sicher auf eine kostenlose Container-Plattform ausliefern: Zugangsdaten aus Git und Image heraushalten, CORS in der Produktion, Readiness-Prüfungen, Rollback-Kriterien | Abgeschlossen, inklusive einer echten Rollback-Übung |
| 5 · Beobachtbarkeit | Wissen, ob das System funktioniert, ohne Rohgespräche zu speichern oder eine Datenbank hinzuzufügen | Abgeschlossen |
| 6 · Eigene Inferenz | Ein lokal quantisiertes Modell hinter denselben Aufrufpfad bringen | Umsetzung und lokale Verifikation abgeschlossen, Produktion nicht umgestellt |
| 7 · Training von Grund auf | Die gesamte Kette von Training über quantisierten Export bis zur Auslieferung durchlaufen | Läuft |
Anmerkung zu diesen Angaben
Die Phasen 6 und 7 stehen nicht auf „abgeschlossen”, weil sie es nicht sind.
Phase 6 hat Code, Adapterschicht und lokale Verifikation fertig — der vollständige Inferenzpfad läuft auf meinem eigenen Rechner gegen ein quantisiertes Modell. Der GPU-Server für die Produktion existiert jedoch noch nicht, und die Live-Konfiguration wurde nicht umgestellt. Die Produktion umzuschalten, bevor ein Server verifiziert ist, hieße, einen funktionierenden Dienst gegen einen ungeprüften einzutauschen.
Phase 7 reicht derzeit bis zur Modellinitialisierung, einem Profil zur GPU-Kompatibilität sowie dem Herunterladen und der Lizenzprüfung des Trainingskorpus. Das eigentliche Training, die Auswertung, der quantisierte Export und die Anbindung an den Dienst haben noch nicht begonnen.
Jede Phase dieses Projekts hat ein ausdrückliches Abnahmekriterium, und nichts geht weiter, bevor es erfüllt ist. „Fast fertig” als „fertig” zu schreiben ist der naheliegendste und zugleich unnötigste Fehler bei einem privaten Projekt.