4.6 KiB
Go-Live Gate – v1.5.0
Registry und Start
Auf dem Produktionshost wird nicht gebaut. Voraussetzung ist ein freigegebener, unveränderlicher IMAGE_TAG in .env.
./scripts/preflight.sh
docker compose pull
docker compose up -d --remove-orphans
docker compose ps
Alternativ führt ./scripts/go-live.sh genau diesen Ablauf ohne make aus. IMAGE_TAG=latest, Placeholder-Secrets, wiederverwendete Trust-Boundary-Tokens, build: oder env_file: im Produktions-Compose brechen den Preflight ab.
Pflicht-Smoke-Test auf dem echten Host
- Ollama enthält Chat- und Embedding-Modell (
gemma3/konfiguriert undembeddinggemma/konfiguriert); NeuroForge/readyzmuss 200 liefern. - Knowledge
/api/healthund Agent/readyzliefern 200; Control/healthzbleibt ohne Login erreichbar, alle Betriebs-/Graphseiten verlangen Control-Basic-Auth. - Agent kann mit dem Integration-Token Knowledge-Integration/Outcome-Pfade nutzen; der Control-Read-Token kann diese Schreibpfade nicht nutzen.
- Einen Research-Goal manuell ausführen. Fortschritt und ein Staging-Draft müssen auch dann entstehen können, wenn
NEUROFORGE_GOAL_LEARNING_ENABLED=falseist. - Einen zweiten parallelen Cycle desselben Goals auslösen; er muss
409 Conflicterhalten. - Staging-Draft im Knowledge-Editor prüfen und promoten. Der Produktionsartikel erscheint genau einmal und der Draft wird archiviert.
- NeuroForge stoppen: Knowledge und Control müssen weiterlaufen; Agent verhält sich entsprechend
KNOWLEDGE_VECTOR_BACKEND/NEUROFORGE_FAIL_OPEN. - Vor GLPI-Schreibfreigabe einen vollständigen Ticketdurchlauf in
DRY_RUN=trueprüfen. Erst danach die gewünschten Automationen einzeln aktivieren.
Docker, eine echte GLPI-Instanz, SearXNG und Ollama stehen in der Build-/Review-Umgebung nicht zur Verfügung; dieser Host-Smoke-Test ist deshalb ein bewusstes externes Release-Gate und darf nicht als lokal bestanden markiert werden.
v1.5.5 Production-Grounding Zusatzgate
Vor Go-Live mit autonomem Research zusätzlich verifizieren:
NEUROFORGE_KB_STAGING_REQUIRE_AUTHORITATIVE_SOURCE=trueundNEUROFORGE_KB_STAGING_VERIFY_CLAIMS=truesind im aufgelösten Compose gesetzt.- Ein Test-Goal mit explizitem Herstellerbezug erzeugt mindestens eine First-Party-Query (
site:) und nutzt mindestens eine autoritative Quelle im finalen Staging-JSON. claim_verification.verdictistpass,claim_verification.coverageist1,unsupported/contradictionssind leer.research_authoritative_sources >= 1undquality_gate_version=staging-v2sind im Draft vorhanden.- Ein absichtlich nicht belegter Versions-/Errorcode im Synthese-Test wird fail-closed abgewiesen.
- Ein Blog-/Forum-only Evidence-Set erzeugt bei aktiviertem Authority-Gate keinen Staging-Artikel.
v1.5.6 Structured-Output Zusatzgate
Für einen realen Research→Staging-Smoke-Test zusätzlich verifizieren:
- Ein Windows-/Registry-lastiges Testziel erzeugt keine
invalid ... string escape code-Fehler. - Staging-Synthese und Claim-Verifikation bleiben bei nicht reparierbarem JSON fail-closed.
- Der resultierende Draft enthält weiterhin
human_review_required=trueundauto_reply=false. - Source-Authority und Claim-Verifikation aus v1.5.5 bleiben bestanden; JSON-Robustheit darf diese Gates nicht umgehen.
v1.5.7 Identifier-Grounding Zusatzgate
Bei Windows-/Vendor-Artikeln dürfen normale Slash-Komposita oder URL-Pfade kein source-unverified identifiers auslösen. Echte CLI-Switches in Code-Spans/Fences bleiben source-verifiziert. Vor Go-Live mindestens einen Goal-Lauf mit BIOS-/UEFI-ähnlicher Prosa und einen Lauf mit einem belegten Slash-Command prüfen.
v1.5.8 Staging-Revalidation Zusatzgate
Nach einem Upgrade auf v1.5.8 aktive Goals mindestens einen Scheduler-Cycle durchlaufen lassen. Ein Artikelziel darf erst dann als erfüllt gelten, wenn der Goal-State staging_draft_validated=true und staging_quality_gate_version=staging-v3 meldet. Persistierte Fehler aus älteren Gates dürfen nicht als aktueller Fehlerstatus interpretiert werden.
v1.5.9 Article-Depth Zusatzgate
Nach dem Upgrade muss ein aktiver Research-Draft staging_quality_gate_version=staging-v4 erreichen. Im Staging-RAW-JSON article_quality prüfen: text_chars muss mindestens NEUROFORGE_KB_STAGING_MIN_ARTICLE_CHARS erfüllen, die kompakte answer-Zusammenfassung muss innerhalb ihrer Grenzen bleiben und claim_verification muss bei aktivierter Verifikation vollständig bestehen. NEUROFORGE_OLLAMA_NUM_PREDICT=0 ist der empfohlene Mega-Default, damit das Staging-Call-Budget nicht von einem alten globalen num_predict abgeschnitten wird.