KI4BUW · LLM Status

Automatischer Erreichbarkeitscheck alle 30 Minuten · Stand: 2026-09-03 11:07 UTC
Zugriff auf die Modelle

Alle Modelle sind über eine OpenAI-kompatible API erreichbar:

Base URL: https://llm.ki4buw.de/v1

Beispiel-Request (curl):

curl https://llm.ki4buw.de/v1/chat/completions \ -H "Authorization: Bearer <DEIN_TOKEN>" \ -H "Content-Type: application/json" \ -d '{"model": "<MODELLNAME>", "messages": [{"role":"user","content":"Hallo"}]}'

Den Zugangstoken erhältst du von KI4BUW. Die verfügbaren Modellnamen siehst du in der Tabelle unten.

Modell Status Letzter Check Latenz Uptime 24h Uptime 7d
deepseek-r1:32b Online 2026-09-03T10:59:06.618280+00:00 6468 ms 100.0 % 100.0 %
defacto-model Online 2026-09-03T10:59:06.618280+00:00 227 ms 100.0 % 100.0 %
llama3.1:70b Online 2026-09-03T10:59:06.618280+00:00 11584 ms 100.0 % 100.0 %
llama4 Online 2026-09-03T10:59:06.618280+00:00 22930 ms 50.0 % 50.0 %
ollama/jeffh/intfloat-multilingual-e5-large-instruct:f16 Offline
HTTP 500: {"error":{"message":"litellm.APIConnectionError: OllamaException - {\"error\":\"\\\"jeffh/intfloat-multilingual-e5-large-instruct:f16\\\" does not support generate\"}. Received Model Group=ollama/jeffh/intfloat-multilingual-e5-large-instruct:f16\nAvailable Model Group Fallbacks=None","type":null,"pa
2026-09-03T10:59:06.618280+00:00 5242 ms 0.0 % 0.0 %
ollama/qwen3.8:27b Online 2026-09-03T10:59:06.618280+00:00 9903 ms 100.0 % 100.0 %
openai/qwen3 Online 2026-09-03T10:59:06.618280+00:00 235 ms 100.0 % 100.0 %
openai/qwen3.8 Online 2026-09-03T10:59:06.618280+00:00 434 ms 100.0 % 100.0 %
oski/inferenz-gpt-oss-120b Online 2026-09-03T10:59:06.618280+00:00 665 ms 100.0 % 100.0 %
oski/inferenz-mistral-small-4-119b Online 2026-09-03T10:59:06.618280+00:00 544 ms 100.0 % 100.0 %
oski/inferenz-qwen3-embedding-8b Online 2026-09-03T10:59:06.618280+00:00 250 ms 100.0 % 100.0 %
qwen3-embedding:8b Online 2026-09-03T10:59:06.618280+00:00 3239 ms 100.0 % 100.0 %
qwen3.5:27b Online 2026-09-03T10:59:06.618280+00:00 5726 ms 100.0 % 100.0 %