Sicherheit der KI-Modell-Lieferkette: Der LiteLLM-Vorfall und was er offenbart🇬🇧 Read in EnglishAugust 15, 2026~7 min readDevOpsSecuritysupply-chainai-securitylitellmtrivymodel-securitydevsecopssbom
August 19, 2026· ~11 min readDie stoische Unix-Philosophie: Besonnene Tools für eine unkontrollierbare WeltDie Unix-Philosophie gibt vor, wie Tools gestaltet sein sollten. Die stoische Unix-Philosophie lehrt sie, wie sie sich in Widrigkeiten verhalten sollen: ruhig, ehrlich und gleichgültig gegenüber allem, was außerhalb ihrer Kontrolle liegt. Ein Leitfaden mit einer praxisnahen Fallstudie.
August 18, 2026· ~8 min readEin 27B Hybrid-SSM-Modell mit 128k Kontext auf einer 12-GB-Laptop-GPU ausführenBenchmark: Qwen3.8-27B mit hybrider Attention/SSM-Architektur auf einem RTX 4080 Laptop. 19 % Prefill-Degradation über 64x Input, konstante 2,76 tok/s Generation und 128k Kontext in 8,8 GB VRAM.
May 25, 2026· ~5 min readSelf-Hosted AI Stack: Ollama, Open WebUI und LiteLLM in der ProduktionSo implementieren Sie einen produktionsreifen, selbstgehosteten AI-Inference-Stack mit lokalen LLMs, einer ChatGPT-kompatiblen Benutzeroberfläche und einem vereinheitlichten API-Gateway für das Model-Routing.ollamaopen-webuilitellm