llmrouter: 42i/inka-qwen (Qwen 3.8 27B, reasoning none, Provider AkashML/Parasail fest), role/inka darauf

Co-Authored-By: Claude Fable 5.1 <noreply@anthropic.com>
This commit is contained in:
2026-09-06 10:02:50 +02:00
committed by andreas
co-authored by Claude Fable 5.1
parent 106eb633c5
commit 6ea2601d1e
+19 -1
View File
@@ -136,6 +136,24 @@
"art": "fest",
"upstream": "openrouter",
"model": "mistralai/mistral-embed-2312"
},
"42i/inka-qwen": {
"art": "fest",
"upstream": "openrouter",
"model": "qwen/qwen3.8-27b",
"body": {
"reasoning": {
"effort": "none"
},
"provider": {
"order": [
"AkashML",
"Parasail"
],
"allow_fallbacks": false
}
},
"_doku": "Test-Hirn fuer Inka (2026-09-06): Qwen 3.8 27B OHNE Denkstufe und mit festen Providern (fp8, Cache-Treffer $0,05/1M, Uptime >99,6 %), damit der Prompt-Cache ueber die Zuege traegt. Erster Qwen-Anruf ohne das: 5,2 s je Zug, 700 Reasoning-Token, Cache in 3 von 8 Zuegen."
}
},
"_stufen_doku": "Stufen als Index-Schwelle (Artificial-Analysis-Intelligence-Index, 0-100) mit Mindestkontext (Andreas 2026-09-05): low 25/256k, medium 45/256k, high 49/500k, max 53/500k. Die Art \"alternative\" mit Referenzmodell (z.B. anthropic/claude-opus-5:medium) bleibt möglich. Namen versioniert wie bei LiteLLM (2608): 42i/marvin-2609:*.",
@@ -165,7 +183,7 @@
"docs": "42i/marvin-2609:medium",
"ar": "42i/marvin-2609:medium",
"archivist": "42i/marvin-2609:medium",
"inka": "openrouter/qwen/qwen3.8-27b"
"inka": "42i/inka-qwen"
},
"_namen_doku": "Namensraeume: 42i/* = konfigurierte Aliasse (aliases); deizo/* = Modelle im Prod-RZ deizo (kira, fest); openrouter/<id>[:effort] = 1:1 an OpenRouter, Effort als reasoning.effort; alt/<id>[:effort] = guenstigste Alternative derselben Klasse (Intelligence, Coding, Agentic je >= 95 % der Referenz, Kontext >= 90 %, billiger), aufgeloest bei der ersten Anfrage und im 12h-Takt erneuert, OHNE Last-Probe; role/<name> = Rolle (rollen). Alles andere -> fallback (LiteLLM).",
"anthropicModus": "alt",