diff --git a/config.json b/config.json index ad4b7a4..0df5b88 100644 --- a/config.json +++ b/config.json @@ -136,6 +136,24 @@ "art": "fest", "upstream": "openrouter", "model": "mistralai/mistral-embed-2312" + }, + "42i/inka-qwen": { + "art": "fest", + "upstream": "openrouter", + "model": "qwen/qwen3.8-27b", + "body": { + "reasoning": { + "effort": "none" + }, + "provider": { + "order": [ + "AkashML", + "Parasail" + ], + "allow_fallbacks": false + } + }, + "_doku": "Test-Hirn fuer Inka (2026-09-06): Qwen 3.8 27B OHNE Denkstufe und mit festen Providern (fp8, Cache-Treffer $0,05/1M, Uptime >99,6 %), damit der Prompt-Cache ueber die Zuege traegt. Erster Qwen-Anruf ohne das: 5,2 s je Zug, 700 Reasoning-Token, Cache in 3 von 8 Zuegen." } }, "_stufen_doku": "Stufen als Index-Schwelle (Artificial-Analysis-Intelligence-Index, 0-100) mit Mindestkontext (Andreas 2026-09-05): low 25/256k, medium 45/256k, high 49/500k, max 53/500k. Die Art \"alternative\" mit Referenzmodell (z.B. anthropic/claude-opus-5:medium) bleibt möglich. Namen versioniert wie bei LiteLLM (2608): 42i/marvin-2609:*.", @@ -165,7 +183,7 @@ "docs": "42i/marvin-2609:medium", "ar": "42i/marvin-2609:medium", "archivist": "42i/marvin-2609:medium", - "inka": "openrouter/qwen/qwen3.8-27b" + "inka": "42i/inka-qwen" }, "_namen_doku": "Namensraeume: 42i/* = konfigurierte Aliasse (aliases); deizo/* = Modelle im Prod-RZ deizo (kira, fest); openrouter/[:effort] = 1:1 an OpenRouter, Effort als reasoning.effort; alt/[:effort] = guenstigste Alternative derselben Klasse (Intelligence, Coding, Agentic je >= 95 % der Referenz, Kontext >= 90 %, billiger), aufgeloest bei der ersten Anfrage und im 12h-Takt erneuert, OHNE Last-Probe; role/ = Rolle (rollen). Alles andere -> fallback (LiteLLM).", "anthropicModus": "alt",