update-1.6.2c
ci / test (services/control) (push) Successful in 49s
ci / test (services/knowledge) (push) Successful in 50s
ci / test (platform/neuroforge) (push) Successful in 54s
ci / test (services/agent) (push) Successful in 1m0s
ci / docker-build (push) Failing after 1m10s
release-tag / release-image (push) Successful in 6m33s
ci / test (services/control) (push) Successful in 49s
ci / test (services/knowledge) (push) Successful in 50s
ci / test (platform/neuroforge) (push) Successful in 54s
ci / test (services/agent) (push) Successful in 1m0s
ci / docker-build (push) Failing after 1m10s
release-tag / release-image (push) Successful in 6m33s
This commit is contained in:
@@ -303,6 +303,10 @@ KNOWLEDGE_EMBEDDING_PROFILE=auto
|
||||
# OLLAMA_MAX_CONCURRENT bleibt als Legacy-Alias für
|
||||
# OLLAMA_NODE_MAX_INFLIGHT erhalten, falls der neue Wert nicht gesetzt ist.
|
||||
|
||||
# Explizite Kontextgröße für strukturierte Agent-Chatrequests.
|
||||
# Höhere Werte benötigen mehr Runtime-Speicher; 8192 verhindert insbesondere
|
||||
# die 4k-Trunkierung bei umfangreichen Kategorieprompts.
|
||||
OLLAMA_NUM_CTX=8192
|
||||
# Maximale Anzahl generierter Tokens für strukturierte Antworten.
|
||||
OLLAMA_NUM_PREDICT=768
|
||||
# Wiederholungen bei semantisch/strukturell fehlerhaftem Modell-JSON.
|
||||
|
||||
Reference in New Issue
Block a user