L LLMKube
Kubernetes-Operator für selbst gehostete LLM-Inferenz mit austauschbaren Laufzeiten (llama.cpp, vLLM, TGI, Ollama, vllm-swift), Multi-GPU-Sharding, NVIDIA-CUDA- und Apple-Silicon-Metal-Unterstützung sowie OpenAI-kompatibler API.
L Kubernetes-Operator für selbst gehostete LLM-Inferenz mit austauschbaren Laufzeiten (llama.cpp, vLLM, TGI, Ollama, vllm-swift), Multi-GPU-Sharding, NVIDIA-CUDA- und Apple-Silicon-Metal-Unterstützung sowie OpenAI-kompatibler API.
O Starten Sie mit Llama 3.3, DeepSeek-R1, Phi-4, Gemma 3 und anderen großen Sprachmodellen durch.
O Benutzerfreundliche KI-Schnittstelle, unterstützt Ollama und OpenAI API.
L Modernes KI-Chat-Framework mit Unterstützung für mehrere KI-Anbieter, One-Click-Installation von MCP Marketplace und Artifacts / Thinking.
All-in-One-Desktop- und Docker-KI-Anwendung mit integriertem RAG, KI-Agenten, No-Code-Agent-Builder, MCP-Kompatibilität und mehr.
Führe deine KI-Modelle lokal aus und generiere Bilder und Audio (Alternative zu OpenAI und Claude).
L Verbesserte ChatGPT-kompatible KI-Chat-Oberfläche mit Unterstützung mehrerer KI-Anbieter, Multi-User-Authentifizierung, Nachrichtensuche und Plugin-Unterstützung.