Xilin Zhu
KontaktAvailable for work
← KI-Zwilling

KI-Zwilling

Entwicklungslog

Acht Phasen, jede hinter einem eigenen Abnahmekriterium

ENTWURF — vom Autor zu prüfen

Das Projekt schreitet phasenweise voran, und die nächste Phase beginnt erst, wenn die aktuelle abgenommen ist. Hier steht, was jede Phase tatsächlich gelöst hat und wie der Stand wirklich ist — einschließlich der beiden, die noch nicht fertig sind.

Stand der Phasen

Phase Gelöstes Problem Stand
0 · Grundgerüst Eine auslieferbare LLM-Anwendung von Grund auf entwerfen: Konfiguration, Sicherheitsgrenzen, Wartbarkeit Abgeschlossen
1 · Persona Ein Modell ohne Feinabstimmung dauerhaft in der ersten Person sprechen lassen und dabei Halluzination und Datenabfluss dämpfen Abgeschlossen, Persona vom Autor geprüft und freigegeben
2 · Backend Ein produktionstaugliches LLM-Backend: SSE-Streaming, Abbruch, Wiederholung, Ratenbegrenzung, Injection-Schutz, Kostenkontrolle Abgeschlossen
3 · Frontend Eine einbettbare Chat-Komponente ohne Framework: korrekte Verarbeitung des SSE-Bytestroms, Abbruch und Wiederholung, Zustandswiederherstellung, XSS, Barrierefreiheit Abgeschlossen
4 · Inbetriebnahme Sicher auf eine kostenlose Container-Plattform ausliefern: Zugangsdaten aus Git und Image heraushalten, CORS in der Produktion, Readiness-Prüfungen, Rollback-Kriterien Abgeschlossen, inklusive einer echten Rollback-Übung
5 · Beobachtbarkeit Wissen, ob das System funktioniert, ohne Rohgespräche zu speichern oder eine Datenbank hinzuzufügen Abgeschlossen
6 · Eigene Inferenz Ein lokal quantisiertes Modell hinter denselben Aufrufpfad bringen Umsetzung und lokale Verifikation abgeschlossen, Produktion nicht umgestellt
7 · Training von Grund auf Die gesamte Kette von Training über quantisierten Export bis zur Auslieferung durchlaufen Läuft

Anmerkung zu diesen Angaben

Die Phasen 6 und 7 stehen nicht auf „abgeschlossen”, weil sie es nicht sind.

Phase 6 hat Code, Adapterschicht und lokale Verifikation fertig — der vollständige Inferenzpfad läuft auf meinem eigenen Rechner gegen ein quantisiertes Modell. Der GPU-Server für die Produktion existiert jedoch noch nicht, und die Live-Konfiguration wurde nicht umgestellt. Die Produktion umzuschalten, bevor ein Server verifiziert ist, hieße, einen funktionierenden Dienst gegen einen ungeprüften einzutauschen.

Phase 7 reicht derzeit bis zur Modellinitialisierung, einem Profil zur GPU-Kompatibilität sowie dem Herunterladen und der Lizenzprüfung des Trainingskorpus. Das eigentliche Training, die Auswertung, der quantisierte Export und die Anbindung an den Dienst haben noch nicht begonnen.

Jede Phase dieses Projekts hat ein ausdrückliches Abnahmekriterium, und nichts geht weiter, bevor es erfüllt ist. „Fast fertig” als „fertig” zu schreiben ist der naheliegendste und zugleich unnötigste Fehler bei einem privaten Projekt.