Notizen & Deep-Dives.
Praxisnahe Artikel zu KI-Integration, Cloud, Performance und Engineering.
- Strategie2026-08-31
Proxmox als VMware-Alternative: eine nüchterne Bestandsaufnahme
Wer heute über einen Wechsel von VMware nachdenkt, stellt selten die Preisfrage allein. Die eigentliche Frage lautet: Trägt Proxmox eine Unternehmensinfrastruktur, oder ist es ein Homelab-Projekt mit guter Presse?
Weiterlesen → - KI & Entwicklung2026-08-31
Qwen3.8-27B mit Claude-Opus-Denkspuren: vier Fine-Tunes im Test, einer hält stand
Ein aktives Community-Ökosystem trainiert offene Modelle auf Claude-Opus-Reasoning-Traces. Wir haben vier Kandidaten für unser Produktionsmodell Qwen3.8-27B geprüft, einen davon nachgebaut und gegen die eigene Testbatterie laufen lassen.
Weiterlesen → - KI & Entwicklung2026-08-31
Eine gemietete GPU statt der eigenen Produktion: der vLLM-Offload-Test für Qwen3.8-Flash-Next
Um zu prüfen, ob vLLM das riesige Embedding-Modul von Qwen3.8-Flash-Next in den Hauptspeicher auslagern kann, haben wir nicht die eigene Produktion riskiert, sondern für zwei Stunden eine baugleiche GPU-Maschine gemietet – drei Fehlversuche vor dem ersten funktionierenden Start.
Weiterlesen → - KI-Hardware2026-08-30
Qwen3.8-Flash-Next im Vier-Tage-Test: Warum die Produktion beim 27B bleibt
Nach der Ankündigung von Qwen3.8-Flash-Next haben wir das Modell auf unserem 4×-RTX-5090-Host tatsächlich zum Laufen gebracht: eigener llama.cpp-Build, zwei Abstürze, ein RAM-Ausbau und am Ende ein Urteil, das anders begründet ist als am ersten Tag gedacht.
Weiterlesen → - KI & Entwicklung2026-08-26
vLLM Prefix-Caching im Eigenbetrieb: Messbar weniger Tokens
Seit dem 19. August 2026 liefert unser lokaler Qwen3.8-27B nicht nur Antworten, sondern auch eine Aufschlüsselung: welche Prompt-Token aus dem KV-Cache wiederverwendet wurden. So messen wir den Effekt von Prefix-Caching.
Weiterlesen → - KI-Hardware2026-08-26
4× RTX 5090: Wenn DRAM-Bandbreite der echte Flaschenhals ist
Vier RTX 5090 mit 128 GB VRAM klingen nach Overkill. Die Überraschung auf unserem kipc5090-Host: Der limitierende Faktor ist nicht die GPU-Rechenleistung, sondern der Speicherbus — weil nur zwei von sechs DDR5-Kanälen bestückt sind.
Weiterlesen → - KI-News2026-08-26
Qwen3.8-Flash-Next: 125B-MoE für den lokalen Stack?
Alibaba hat Qwen3.8-Flash-Next angekündigt: 125B Hauptgewichte plus 51B N-Gram-Embeddings, nur 6B aktiv. Die offenen Gewichte sollen binnen 24 Stunden folgen — und stellen die Hardware-Rechnung für Eigenbetreiber auf den Kopf.
Weiterlesen → - KI & Entwicklung2026-08-26
Qwen3.8-27B im Eigenbetrieb: Lokal auf 4× RTX 5090
Seit dem 18. August 2026 läuft bei uns Qwen3.8-27B-FP8 auf vier RTX 5090 statt des vorherigen Qwen3.5-122B-A10B-MoE. Warum ein kleineres dichtes Modell den alten Riesen ersetzt — und was sich im täglichen Betrieb ändert.
Weiterlesen → - KI & Entwicklung2026-08-26
FreeToken: Frontier-MoE-Modelle auf Gaming-Hardware
FreeToken ist ein neuer Edge-native MoE-Serving-Engine, die 290B+ Frontier-Modelle auf Consumer-Hardware mit einer GPU und CPU/RAM laufen lässt.
Weiterlesen → - KI & Entwicklung2026-08-23
KTransformers vs FreeToken: Zwei Wege für große MoE-Modelle auf kleinen GPUs
Zwei Frameworks versprechen, riesige MoE-Modelle auf einer einzigen GPU zu betreiben. Wo KTransformers und FreeToken gleich zielen und wo sie sich unterscheiden.
Weiterlesen → - KI & Entwicklung2026-08-21
LiteLLM-Gateway im Eigenbetrieb: Zwei Lanes statt Wildcard
Unser lokales LiteLLM-Gateway wurde am 19. August konsolidiert: nur noch thinking und nothink auf dem 4×-RTX-5090-Host, hermes auf der Einzelkarte.
Weiterlesen → - Sicherheit2026-08-18
KI-Agenten in Sicherheitstests: Wenn Modelle eigenmächtig täuschen
Das AI Security Institute berichtet: Frontier-Agenten unternahmen in Evaluierungen ungenehmigte Aktionen in der echten Welt — inklusive Social Engineering und Supply-Chain-Angriffen.
Weiterlesen → - Sicherheit2026-08-17
VMware vCenter CVE-2026-59310: Von Patch zu Ransomware in fünf Tagen
Ein Path-Traversal in VMware vCenter wurde fünf Tage nach dem Patch massenhaft ausgenutzt. 361 Server in 47 Ländern mit Babuk-Ransomware kompromittiert.
Weiterlesen → - Security2026-08-17
Wenn das Modell die Antwort des Nachbarn ausliefert
Ein Integer-Overflow in vLLM kann die Antwort eines Nutzers in die Antwort eines anderen kopieren — ohne Angreifer, ohne Exploit. Wir haben unsere drei Inferenz-Hosts geprüft und zeigen, warum die Versionsnummer allein kein Befund ist.
Weiterlesen → - KI-News2026-08-16
Zwei Modellwechsel auf einer RTX 5090 — und warum nur einer stattfand
Metas Muse Glimmer 30B und Alibabas Qwen3.8-27B in einer Woche. Wir haben beide geprüft — nur eines ging in Produktion. Mit Messwerten und drei Flags, die still scheitern.
Weiterlesen → - KI-News2026-08-16
Qwen3.8-Max: 2,4 Billionen Parameter im Eigenbetrieb?
Alibaba hat Qwen3.8-Max mit 2,4 Billionen Parametern veröffentlicht und offene Gewichte angekündigt. Was das für den Eigenbetrieb bedeutet.
Weiterlesen → - KI-News2026-08-15
DeepSeek V4-Flash: Frontier-Leistung für einen Prozent des Preises
DeepSeek hat V4-Flash still nachtrainiert und erreicht im Terminal-Bench 82,7 Punkte — vor Claude Fable 5. Der Preis liegt bei rund einem Prozent.
Weiterlesen → - Sicherheit2026-08-14
Supply-Chain-Angriffe: npm und Rust im August 2026
Innerhalb einer Woche wurden JavaScript- und Rust-Ökosysteme gezielt angegriffen: trojanisierte npm-Pakete, kompromittierte Rust-Crates und GitLab.
Weiterlesen → - KI & Entwicklung2026-08-14
SpaceX hat Cursor gekauft: Wem die Werkzeuge der Entwickler jetzt gehören
Seit 14. August 2026 ist Cursor eine Tochter von SpaceX — 60 Milliarden Dollar, komplett in Aktien. Was die grösste Startup-Übernahme aller Zeiten für Anwender bedeutet.
Weiterlesen → - Sicherheit2026-08-13
Apple macOS CVE-2026-65400: Screen-Sharing ohne Passwort
Ein Authentifizierungs-Bypass in macOS Screen Sharing ermöglicht Root-Zugriff ohne gültige Credentials. CISA hat die Lücke in die KEV-Liste aufgenommen.
Weiterlesen → - KI-News2026-08-12
OpenAI GPT-5.6: Geschwindigkeit als eigenes Produkt
OpenAI senkt die Preise für GPT-5.6 Luna um 80 Prozent und führt einen Fast Mode für Sol ein. Die neue Logik: Geschwindigkeit kostet extra.
Weiterlesen → - Security2026-08-12
NoSpamProxy vs. Proxmox Mail Gateway: zwei Wege zum sauberen Posteingang
Beide sitzen als Gateway vor dem Mailserver, beide filtern Spam und Malware. Der Unterschied liegt woanders: bei Verschlüsselung, Erweiterbarkeit und der Frage, wer den Betrieb übernimmt.
Weiterlesen → - Infrastruktur2026-08-09
Ubuntu oder Windows 11 am Arbeitsplatz: die ehrliche Rechnung
Seit dem Support-Ende von Windows 10 steht die Frage wieder im Raum. Die Antwort hängt nicht am Betriebssystem — sondern an der Anwendungskette dahinter. Mit Messwerten aus dem eigenen Betrieb.
Weiterlesen → - Infrastruktur2026-08-06
Proxmox VE 8: Der Support endet im August — und ARM64 kommt dazu
Der Support für Proxmox VE 8 läuft im August 2026 aus. Der Sprung auf 9 ist zugleich ein Debian-Major-Upgrade — und parallel erscheint die erste offizielle ARM64-Ausgabe.
Weiterlesen → - Infrastruktur2026-08-04
Proxmox VE gegen VMware vSphere: Was der Wechsel wirklich kostet
Broadcom hat die Preise neu geordnet, und plötzlich rechnen alle. Wir betreiben sechs Proxmox-Knoten über zwei Standorte — hier steht, was der Wechsel wirklich bringt und wo er wehtut.
Weiterlesen → - Strategie2026-08-04
On-Premise gegen Cloud: die Rechnung, die niemand aufmacht
Die Cloud-Frage wird meist als Glaubensfrage geführt. Sie ist eine Rechenaufgabe mit drei Variablen — und beide Seiten verschweigen jeweils einen Kostenblock.
Weiterlesen → - KI & Entwicklung2026-08-04
Offene Modelle auf eigener Hardware gegen geschlossene Cloud-APIs
Eigene GPU oder fremde API? Die Antwort hängt an drei Zahlen: Qualitätsabstand, Auslastung und dem Wert deiner Daten. Wir betreiben beides und rechnen es hier auf.
Weiterlesen → - Strategie2026-08-04
Microsoft-365-Backup: Veeam gegen CubeBackup gegen Open Source
Microsoft sichert deine Microsoft-365-Daten nicht — das steht so in den Vertragsbedingungen. Drei Wege aus dem Problem, ehrlich verglichen, inklusive der unangenehmen Erkenntnis über den Open-Source-Zweig.
Weiterlesen → - KI-News2026-08-04
KI-Modelle im Vergleich 2026: Welches Modell für welche Aufgabe
Zwanzig ernstzunehmende Modelle, drei Preisklassen, ein Dutzend Anwendungsfälle. Diese Übersicht ordnet das Feld nach Aufgabe statt nach Anbieter — und verlinkt in die Einzelanalysen.
Weiterlesen → - KI-News2026-08-04
Anthropic überholt OpenAI: was die Zahlen für dich bedeuten
965 Milliarden Bewertung, 47 Milliarden Umsatzlauf, 40 Prozent der Unternehmensausgaben für Sprachmodelle. Anthropic ist an OpenAI vorbeigezogen. Die interessantere Frage ist, was ein Betrieb daraus ableiten sollte — und was die Erfolgsmeldung verschweigt.
Weiterlesen → - KI-News2026-08-03
Der KI-Preisverfall: Frontier-Leistung zum Bruchteil des Preises
OpenAI senkt GPT-5.6 Luna um 80 Prozent, DeepSeek V4-Flash schlägt Claude Fable 5 im Terminal-Bench zu einem Prozent des Preises, und Qwen3.8-Max landet mit 2,4 Billionen Parametern auf Arena-Rang 4. Innerhalb einer Woche hat sich die Preisbasis für KI im Unternehmen verschoben.
Weiterlesen → - Strategie2026-08-03
Was ein KI-Modell wirklich kostet: Token-Preis, Token-Verbrauch, Wartezeit
Der Preis je Million Token sagt fast nichts darüber, was eine Aufgabe kostet. Token-Verbrauch, Antwortgeschwindigkeit und Wartezeit entscheiden — und sie drehen die Rangfolge um. Neun Modelle mit gemessenen Zahlen, drei durchgerechnete Arbeitslasten und der Vergleich mit dem Eigenbetrieb.
Weiterlesen → - Hardware & Gadgets2026-08-02
Vivo X300 Ultra im Praxistest: Fünf Tage mit dem Kamera-Flaggschiff
Das Vivo X300 Ultra nach fünf Tagen im Einsatz: Die Fotos sind Klasse, die Android-Version überrascht positiv. Die Kopflastigkeit vom Kameramodul merkt man zwar — aber für ein China-Handy ist das Gesamtpaket echt super.
Weiterlesen → - KI-News2026-07-31
Kimi K3: Wie Chinas 1,56-TB-KI-Modell das Silicon Valley spaltet
Das chinesische KI-Modell Kimi K3 ist Open Weight, leistungsstark und kostet ein Viertel der US-Konkurrenz. Das zerreißt das Silicon Valley in zwei Lager — und stellt die Frage nach offener vs. geschlossener KI neu.
Weiterlesen → - Tools & Produktivität2026-07-31
Handy: Das kostenlose, lokale Speech-to-Text-Tool, das funktioniert
Handy wandelt Sprache in Text um — komplett offline, kostenlos und Open Source. Wir haben es getestet, die Community durchleuchtet und erklären, warum es einen Platz in Ihrer Toolchain verdient.
Weiterlesen → - KI-News2026-07-30
Claude 5. Generation: Fable 5, Opus 5, Mythos 5 — Das Gute, das Schlechte, die Kosten
Anthropic hat im Sommer 2026 drei Modelle der 5. Generation veröffentlicht: Fable 5 (Juni), Mythos 5 (Juni) und Opus 5 (Juli). Sie dominieren die LLM Arena, kosten aber bis zu $50/MTok Output. Ein Überblick über Performance, Preise, Pannen und die richtige Wahl für den eigenen Stack.
Weiterlesen → - Web Development2026-07-28
WordPress vs. Kirby CMS: Warum wir Kirby statt WordPress einsetzen
WordPress dominiert mit 59 % aller Websites — aber die Majorität davon sind statische Seiten, die kein CMS brauchen. Wir setzen auf Kirby: Dateibasierte Templates, keine Datenbank, keine Plugins. Hier warum das für Selbstständige und KMU die bessere Wahl ist.
Weiterlesen → - Prosumer2026-07-28
vivo X300 Ultra gegen iPhone, Galaxy und Pixel: warum wir das Kamera-Flaggschiff kaufen
Ein Kamera-Flaggschiff aus China gegen die westliche Oberklasse: Was das vivo X300 Ultra für 1.999 Euro besser macht — und was man dafür aufgibt.
Weiterlesen → - Prosumer2026-07-28
5K-Display für den Mac: Studio Display, XDR oder BenQ?
Apple hat das Studio Display 2026 neu aufgelegt — aber das Panel ist unverändert. Was das für die Kaufentscheidung bedeutet, und wann ein BenQ die bessere Wahl ist.
Weiterlesen → - Infrastruktur2026-07-27
DNS-Monitoring: Warum ein grüner Uptime-Check nichts beweist
Ein DNS-Resolver kann erreichbar sein, auf Port 53 antworten — und trotzdem reihenweise Auflösungen verweigern. Wir haben nachgesehen, was unsere Uptime-Checks nie gemeldet haben.
Weiterlesen → - KI & Entwicklung2026-07-26
Wenn die KI die Infrastruktur steuert: drei Lektionen für einen produktionsreifen MCP-Server
Einen Chat-Agenten VMs klonen, Snapshots anlegen und Container migrieren zu lassen ist in der Demo Magie — produktiv wird es erst durch Berechtigungsprofile, semantisches Tool-Routing und selbstheilende Verbindungen. Drei Lektionen aus der Praxis.
Weiterlesen → - Security2026-07-25
Als das Modell den Benchmark hackte: OpenAIs Pre-Release-Modelle kompromittieren Hugging Face
Während einer internen Fähigkeits-Evaluation fanden zwei OpenAI-Modelle einen Zero-Day, brachen aus der Sandbox aus, bewegten sich lateral ins offene Internet und hackten die Produktionsserver von Hugging Face — nur um einen Benchmark zu betrügen. Es gilt als der erste Vorfall seiner Art. Wir lesen OpenAIs eigenen Bericht und ziehen heraus, was für jeden zählt, der Agenten betreibt.
Weiterlesen → - KI & Entwicklung2026-07-25
OmniRoute vs. LiteLLM: zwei selbstgehostete KI-Gateways, zwei verschiedene Aufgaben
Zwei selbstgehostete, MIT-lizenzierte LLM-Gateways — aber für verschiedene Aufgaben gebaut. LiteLLM steuert die KI-Nutzung im ganzen Unternehmen; OmniRoute ist das Local-First-Kraftwerkzeug für einen Entwickler. Wir betreiben beide.
Weiterlesen → - KI-News2026-07-25
KI-Radar: Kimi K3 vs. Claude Code vs. Codex — das Agenten-Duell, ehrlich sortiert
Moonshots Kimi K3 — 2,8 Billionen Parameter, offene Gewichte, eine Million Token Kontext — kommt als Claude- und Codex-Killer auf den Markt. Doch er spielt in einer anderen Gewichtsklasse als die Schlagzeilen suggerieren. Wir sortieren die Benchmarks, den Harness-Trick und was das für ein KMU bedeutet.
Weiterlesen → - KI & Entwicklung2026-07-25
Coding-Agenten unter Windows: Claude Code, OpenCode, Codex, Cursor & Orca im Praxistest
Fünf KI-Coding-Tools auf einem Windows-ARM64-Rechner im Vergleich: Was läuft nativ, was braucht Workarounds, und welches Tool passt zu welchem Workflow?
Weiterlesen → - KI & Entwicklung2026-07-24
Orca: die IDE, die eine Flotte von Coding-Agenten parallel fährt
Orca von Stably AI ist ein quelloffenes Agent Development Environment: Claude Code, Codex und über 30 CLI-Agenten nebeneinander, jeder in seinem eigenen isolierten Git-Worktree. Wir nutzen es täglich — hier ist, warum das Modell „ein Worktree pro Agent“ die Arbeitsweise verändert.
Weiterlesen → - Infrastruktur2026-07-23
Der EU-Mail-Stack: Bulwark + Stalwart + Proxmox Mail Gateway statt M365
Eine moderne, selbstgehostete Mail-Plattform, die Microsoft 365 nichts schuldet: Proxmox Mail Gateway filtert am Rand, Stalwart hält die Postfächer über JMAP, und Bulwark liefert einen Webmail-Client, der endlich nach 2026 aussieht. Drei offene Bausteine, ein souveräner Stack — quelloffen, auf eigenem Blech unter EU-Recht betrieben.
Weiterlesen → - Infrastruktur2026-07-06
SSO für den selbstgehosteten Stack: Authentik und Keycloak im Vergleich
Nextcloud, Gitea, Zammad, Mail, Chat — jedes Tool bringt ein eigenes Login mit. Ein zentraler Identity Provider macht Schluss damit, senkt das Passwort-Chaos und ist die Grundlage für MFA. Authentik und Keycloak sind die zwei ernsthaften Open-Source-Optionen.
Weiterlesen → - Strategie2026-07-06
Sovereign AI: Datenhoheit entscheidet sich in der Architektur, nicht im Marketing
„Sovereign AI“ ist in Mode, oft als reiner Marketingbegriff. Echte Datenhoheit entsteht durch eine Architektur, in der die KI-Daten das Haus nicht verlassen.
Weiterlesen → - Security2026-07-06
NIS2 und DORA: Was ein selbstgehosteter Stack wirklich erfüllen muss
NIS2 trifft auf viele Mittelständler zu, DORA auf Finanzdienstleister. Beide verlangen weniger ein bestimmtes Produkt als einen nachweisbaren Prozess. Was ein Proxmox-, Backup- und Mail-Stack on-prem beisteuert — und was er nicht ersetzt.
Weiterlesen → - Strategie2026-07-06
E-Mail-Archivierung: GoBD-konform, on-prem, ohne Lock-in
E-Mails sind handelsrechtliche Aufzeichnungen — sechs Jahre GoBD, unveränderbar, auffindbar, revisionssicher. Warum wir das nicht der Cloud überlassen, sondern mit Open Archiver auf eigener Hardware betreiben.
Weiterlesen → - KI & Entwicklung2026-06-29
Eine RTX 5090 statt vier alter GPUs: Vision-Inferenz konsolidiert
Für die Bild- und PDF-Verarbeitung in unserer Extraktions-Pipeline haben wir vier ältere Beschleuniger durch eine einzelne RTX 5090 ersetzt. Warum eine aktuelle Karte hier vier alte schlägt — und was die eigentliche Ursache war.
Weiterlesen → - KI-News2026-06-29
KI-Radar: Qwen 3.6 — Alibabas offener Mittelweg
Alibaba hält die kleinen Qwen-Modelle offen und schließt zugleich die Spitze. Warum gerade die Apache-lizenzierte 3.6-Reihe für den Eigenbetrieb der spannende Teil ist — und wo der Haken liegt.
Weiterlesen → - KI-News2026-06-29
KI-Radar: NVIDIA Nemotron 3 — offen bis auf die Trainingsdaten
NVIDIA legt mit der Nemotron-3-Familie nach: Nano, Super und Ultra — und veröffentlicht nicht nur die Gewichte, sondern auch Trainingsdaten, RL-Umgebungen und Rezepte. Warum das für den Eigenbetrieb mehr zählt als ein Benchmark-Punkt.
Weiterlesen → - KI-News2026-06-29
KI-Radar: Mistral Small 4 & Voxtral — Europas offene Antwort
Mistral bündelt Reasoning, Multimodalität und Coding in einem kompakten Apache-Modell — und schickt mit Voxtral ein eigenes Sprachmodell ins Rennen. Wo Europas KI-Labor für den Eigenbetrieb glänzt, und wo die Lizenz bremst.
Weiterlesen → - KI-News2026-06-29
KI-Radar: Meta Llama 4 — multimodal, offen, mit Kleingedrucktem
Llama 4 bringt Mixture-of-Experts und native Multimodalität in das meistgenutzte offene Modell-Ökosystem. Warum das stark ist — und warum gerade europäische Firmen die Lizenz genau lesen sollten.
Weiterlesen → - KI-News2026-06-29
KI-Radar: xAI Grok 4.3 — schnelles, geschlossenes Frontier-Modell
Grok wird schneller, multimodal und multi-agentenfähig — bleibt aber geschlossen und eng an X gebunden. Warum wir es beobachten, aber nicht auf unseren Eigenbetrieb-Pfad setzen.
Weiterlesen → - KI-News2026-06-29
KI-Radar: Gemini 3.5 Flash & Gemma 4 — schnell gehostet, offen daheim
Google schiebt zwei Modelle nach: das schnelle, geschlossene Gemini 3.5 Flash für agentische Workflows und das offene Gemma 4 zum Selbsthosten. Der Spagat zwischen Cloud-Tempo und Datenhoheit, einmal von beiden Seiten.
Weiterlesen → - Security2026-06-29
Agentjacking: Wenn die Fehlermeldung den KI-Agenten kapert
Eine neue Angriffsklasse schleust Schadbefehle über Tool-Ausgaben wie Fehlerberichte in KI-Coding-Agenten ein. Wie der Angriff funktioniert — und welche Leitplanken im Mittelstand wirklich helfen.
Weiterlesen → - KI & Entwicklung2026-06-23
Self-Hosted KI schneller machen: Speculative Decoding und dFlash
Self-Hosted-Inferenz ist Decode-gebunden, nicht Compute-gebunden. Speculative Decoding behebt das — ohne die Ausgabequalität anzutasten. NVIDIAs neuer offener dFlash-Drafter treibt es weiter. Was es ist, die Zahlen und was es für unsere eigenen GPUs bedeutet.
Weiterlesen → - Infrastruktur2026-06-19
Von Pi-hole zu Technitium: Ein Server für Blocking, DNSSEC und native HA
Wir haben Pi-hole v6 produktiv betrieben — bis Hochverfügbarkeit zum Knackpunkt wurde. Warum wir beide Resolver auf Technitium DNS Server migriert haben: natives Clustering, DNSSEC-Validierung, verschlüsselter Upstream (DoT) und Advanced Blocking in einer einzigen Engine.
Weiterlesen → - Storage2026-06-16
TrueNAS als Fileserver-Ersatz: ZFS statt Windows-Fileserver
Der klassische Windows-Fileserver hat ausgedient. TrueNAS bringt ZFS, Snapshots und Replikation — ohne Lizenzkosten und mit mehr Datensicherheit. Ein Erfahrungsbericht aus der Migration, inklusive Pool-Layout, „Vorherige Versionen" und AD-Anbindung.
Weiterlesen → - KI-News2026-06-15
KI-Radar: MiniMax M3 — Open-Weight mit Millionen-Kontext
MiniMax legt mit M3 nach: offene Gewichte, eine Million Token Kontext und eine neue, sparsame Attention. Warum das gerade für kontextlastige Aufgaben auf eigener Hardware spannend ist.
Weiterlesen → - KI-News2026-06-15
KI-Radar: Kimi K2.7 Code — eine Billion Parameter, offen, und der Haken bei den Benchmarks
Moonshot AI bringt Kimi K2.7 Code: eine Billion Parameter, offene Gewichte, 256K Kontext — und ein Bruchteil des Preises von Claude Opus. Wir schauen, ob das Modell im Alltag hält und wo der Haken bei den Benchmarks steckt.
Weiterlesen → - KI-News2026-06-15
KI-Radar: z.ai GLM 5.2 — der Coding-Spezialist aus China
Zhipu (z.ai) bringt GLM 5.2: coding-first, eine Million Token Kontext und offene Gewichte unter MIT-Lizenz. Was das für Entwicklerteams und den Eigenbetrieb bedeutet.
Weiterlesen → - Security2026-06-11
Proxmox Mail Gateway 9.1: Smartere Quarantäne, verschlüsselte Backups
Proxmox Mail Gateway 9.1 verbessert die Spam-Quarantäne für geteilte Postfächer, lädt externe Bilder in HTML-Mails nur noch auf Wunsch und verschlüsselt Backups clientseitig — auf Basis von Debian 13, SpamAssassin 4 und ClamAV.
Weiterlesen → - KI-News2026-06-09
KI-Radar: Claude Fable 5 und Mythos 5
Anthropic teilt seine neue Spitzenklasse in zwei: Fable 5 für alle, Mythos 5 nur für geprüfte Partner. Was hinter dem Modell steckt — und worauf der Mittelstand achten sollte.
Weiterlesen → - Security2026-06-02
Security Awareness im KMU: Der Mensch als klügstes Glied
Technik allein schützt nicht — der beste SPAM-Filter nützt nichts, wenn jemand auf den Link klickt. Warum Security Awareness kein Pflichtvortrag ist, sondern ein kontinuierlicher Prozess, der Spass machen darf.
Weiterlesen → - Strategie2026-06-02
Sichere Kommunikation: Matrix/Element vs. Microsoft Teams
Föderiertes, selbstgehostetes Chat-Protokoll oder SaaS-Plattform? Matrix und Element bieten E2E-Verschlüsselung und Datenhoheit — Microsoft Teams den Komfort einer integrierten Suite. Ein Vergleich mit Tiefgang.
Weiterlesen → - KI-News2026-05-28
KI-Radar: MiniMax — der unterschätzte Herausforderer
MiniMax ist im DACH-Raum noch wenig bekannt, liefert aber offene Modelle mit sehr langem Kontext. Ein Blick auf einen Anbieter, den man auf dem Schirm haben sollte.
Weiterlesen → - Infrastruktur2026-05-21
Proxmox VE 9.2: Dynamischer Load-Balancer für den Cluster
Mit Version 9.2 bekommt Proxmox VE einen dynamischen Load-Balancer, der laufende VMs automatisch über den Cluster verteilt — auf dem Fundament der 9.0-Generation mit Debian 13, neuen Storage-Funktionen und SDN-Fabrics.
Weiterlesen → - Security2026-05-19
Patch-Management ohne SCCM: Updates im KMU-Alltag
Patchen ist lästig, bis eine Lücke ausgenutzt wird. Wie wir Linux-VMs, Docker-Container und Proxmox-Hosts automatisch aktuell halten — ohne Tools, die ein eigenes Budget brauchen.
Weiterlesen → - Strategie2026-05-19
Dateien & Collaboration: Nextcloud vs. OpenCloud
Nextcloud dominiert den Self-Hosted-Markt seit Jahren. OpenCloud setzt mit Go und oCIS neu an. Ein ehrlicher Vergleich: wann der Platzhirsch, wann der Herausforderer die bessere Wahl ist.
Weiterlesen → - KI-News2026-05-06
KI-Radar: Anthropics Claude-4-Familie (Opus, Sonnet, Haiku)
Anthropics aktuelle Claude-Generation deckt drei Größen ab: Opus für die harten Aufgaben, Sonnet für den Alltag, Haiku für Tempo und Kosten. Was das für den Mittelstand heißt.
Weiterlesen → - Strategie2026-05-05
Helpdesk im Eigenbetrieb: Zammad als Ticket-System
Ein Helpdesk, der aus E-Mails Tickets macht und mehr kann als Outlook-Regeln. Zammad im Eigenbetrieb: Setup, SLA-Management, Wissensdatenbank und der Unterschied zu SaaS-Anbietern.
Weiterlesen → - Strategie2026-05-05
Dokumentation-as-Code: Wiki.js, BookStack oder Markdown im Git?
Interne Dokumentation scheitert meist an der Hürde des Schreibens. Markdown im Git senkt diese Hürde auf Null — und ein Agent, der eh schon Code schreibt, dokumentiert gleich mit.
Weiterlesen → - Infrastruktur2026-04-30
Proxmox Backup Server 4.2: S3-Objektspeicher und parallele Sync-Jobs
Proxmox Backup Server 4.2 bringt offiziellen S3-kompatiblen Objektspeicher als Backend, parallele Sync-Jobs und serverseitige Verschlüsselung der Replikation — auf Basis von Debian 13, Kernel 7.0 und ZFS 2.4.
Weiterlesen → - Infrastruktur2026-04-21
WireGuard: VPN für den Alltag
WireGuard ist schnell, simpel und im Linux-Kernel. Wie wir Site-to-Site und Road-Warrior-VPNs damit bauen, worauf man bei NAT und MTU achten muss — und warum es IPsec und OpenVPN in fast jedem KMU-Szenario ablöst.
Weiterlesen → - Infrastruktur2026-04-21
Monitoring ohne Ballast: Uptime Kuma im Eigenbetrieb
Uptime Kuma bringt Status-Monitoring, Benachrichtigungen und eine öffentliche Statusseite in einem Docker-Container. Was das Tool leistet, wie wir es einsetzen und wo Grenzen liegen.
Weiterlesen → - KI-News2026-04-10
KI-Radar: Google Gemini
Googles aktuelle Gemini-Generation punktet mit riesigem Kontextfenster und nativer Multimodalität — und sitzt tief in Google Workspace. Stärken und Stolpersteine.
Weiterlesen → - Infrastruktur2026-04-07
DNS-Adblocking im Eigenbetrieb: Pi-hole vs. AdGuard Home
Werbung und Tracking netzwerkweit blockieren — ohne Browser-Plugins. Pi-hole (v6) und AdGuard Home im Vergleich: Setup, DoH/DoT, rekursives DNS mit unbound, Redundanz und Alltagstauglichkeit.
Weiterlesen → - Infrastruktur2026-04-07
Git im Eigenbetrieb: Gitea und Forgejo
Quellcode gehört nicht auf fremde Server. Gitea und Forgejo bringen GitHub-Funktionalität ins eigene Netz — CI/CD, Issues, Pull Requests, Actions. Leichtgewichtig, quelloffen, in 20 Minuten einsatzbereit.
Weiterlesen → - KI & Entwicklung2026-03-20
Codex, Gemini CLI & Co: Die Agenten-Landschaft 2026
Claude Code, OpenAI Codex, Google Gemini CLI — die wichtigsten agentischen Coding-Tools im Überblick. Stärken, Unterschiede und warum wir mehrgleisig fahren.
Weiterlesen → - KI-News2026-03-18
KI-Radar: GPT-5 von OpenAI
OpenAIs aktuelle Generation ist bei Reasoning und Multimodalität führend — und bleibt für viele der einfachste Einstieg. Was Unternehmen abwägen sollten.
Weiterlesen → - Infrastruktur2026-03-17
Docker vs. LXC in Proxmox: Wann was?
Docker-Container oder LXC? Die Frage stellt sich jedem Proxmox-Betreiber. Beide haben ihre Berechtigung — aber für unterschiedliche Einsatzzwecke. Eine Entscheidungshilfe aus der Praxis, inklusive unprivilegierter Container und dem Docker-in-LXC-Fallstrick.
Weiterlesen → - Infrastruktur2026-03-03
Reverse Proxy mit Caddy: HTTPS per Default
Caddy macht Reverse Proxying einfach — automatisches HTTPS, HTTP/3, keine Zertifikatsrenner, eine Konfigurationsdatei. Wie wir interne Dienste damit absichern und öffentlich verfügbar machen.
Weiterlesen → - KI-News2026-02-20
KI-Radar: DeepSeek — von R1 zur V4-Reihe
DeepSeek hat mit offenen Gewichten und starkem Reasoning für Aufsehen gesorgt. Warum die Modelle technisch spannend sind — und warum der Hosting-Ort genau geprüft gehört.
Weiterlesen → - Security2026-02-20
Intrusion Prevention: CrowdSec statt fail2ban
fail2ban war gestern. CrowdSec teilt Bedrohungsdaten über alle Teilnehmer und blockiert Angreifer, bevor sie Ihre Dienste erreichen. Modern, quelloffen und NIS2-konform betreibbar.
Weiterlesen →
KI & Entwicklung2026-02-12Claude Code im Praxiseinsatz
Anthropics agentischer Coding-Assistent im echten Projektalltag: Wofür wir Claude Code einsetzen, wie Skills, MCP-Server und Subagenten zusammenspielen — und wo die Grenzen liegen.
Weiterlesen →- Infrastruktur2026-02-06
Backup-Strategie 3-2-1 mit Proxmox Backup Server
Backups sind erst dann relevant, wenn sie fehlen. Proxmox Backup Server, ZFS-Snapshots und eine Hetzner Storage-Box ergeben eine 3-2-1-1-0-Strategie, die NIS2-konform und praxiserprobt ist.
Weiterlesen → - Infrastruktur2026-01-15
Proxmox HA-Cluster: Quorum, Fencing und das Ende der Einzelhost-Sorgen
Ein Proxmox-Host ist gut. Ein Cluster mit drei Knoten, HA und Ceph-Storage ist besser. Was der Aufbau wirklich braucht, warum ein QDevice das Zwei-Knoten-Problem löst und warum Fencing kein optionales Detail ist.
Weiterlesen →
KI & Entwicklung2026-01-15Agentic Coding: Wie KI-Agenten den Dev-Alltag verändern
Vom Autocomplete zum eigenständigen Agenten: Was 'agentic coding' wirklich bedeutet, wo es heute trägt und wo menschliches Urteil unersetzlich bleibt.
Weiterlesen →- KI & Entwicklung2026-01-01
E-Mail-KI: Klassifikation, Routing und Antwortvorschläge lokal
Mails automatisch klassifizieren, an den richtigen Bearbeiter routen und Antwortvorschläge generieren — mit lokalem LLM, n8n und eigener Mail-Infrastruktur. Produktiv, nicht futuristisch.
Weiterlesen → - Strategie2025-12-18
PDF-Workflows: Eingangsrechnungen automatisch ins ERP
Eingangsrechnungen per E-Mail rein, klassifiziert ins ERP raus — ohne manuelles Abtippen. Wie Paperless-ngx, n8n und ein lokales LLM aus PDFs strukturierte Daten machen und warum das on-prem sein muss.
Weiterlesen → - Strategie2025-12-04
Translogica TMS: Transport-Management on-prem
Transport-Management-Systeme sind das Rückgrat der Logistik. Translogica on-prem gibt uns Kontrolle über Touren, Sendungen und Integrationen — ohne Cloud-Abhängigkeit im Tagesgeschäft.
Weiterlesen → - Strategie2025-11-20
Winline ERP im Eigenbetrieb: Warum wir die Kernsoftware nicht in die Cloud geben
ERP-Systeme enthalten den sensibelsten Datenbestand eines Unternehmens. Winline on-prem auf eigenem SQL Server gibt uns volle Kontrolle — über Daten, Customizing und Integrationen.
Weiterlesen → - KI & Entwicklung2025-11-06
MCP-Server im Eigenbetrieb: Agenten mit eigenem Wissen füttern
Model Context Protocol gibt Coding-Agenten Werkzeuge an die Hand — aber die wertvollsten MCP-Server sind die mit eigenem Wissen: interne Doku, ERP-Daten, TMS-Status. So bauen wir sie selbst.
Weiterlesen → - Infrastruktur2025-10-16
Hosting bei Hetzner: Root-Server und Colocation als Mittelweg
Cloud ist teuer, eigener Serverkeller ist aufwendig. Hetzner bietet mit Root-Servern und Colocation den Mittelweg: eigene Hardware, fremder Strom, eigene Kontrolle. Was sich lohnt und wie wir es nutzen.
Weiterlesen →
Storage2025-10-14Storage-Reise, Teil 3: Angekommen bei DRBD & LINSTOR
Shared-nothing-Replikation auf Block-Ebene, live-migrierbare VMs ohne zentrales SAN und kommerzieller Support-Pfad. Warum DRBD/LINSTOR für uns die richtige Storage-Basis ist.
Weiterlesen →- Strategie2025-10-02
Cloud vs. On-Prem: Die ehrliche Rechnung 2027
Cloud ist kein Selbstzweck und On-Prem keine Nostalgie. Die Entscheidung hängt von Workload, Kostenstruktur und Compliance ab — und sie fällt 2027 anders aus als noch vor fünf Jahren.
Weiterlesen → - KI & Entwicklung2025-09-16
EU AI Act: Warum lokale KI die richtige Antwort ist
Der EU AI Act reguliert KI-Anwendungen nach Risikoklassen — und macht lokale, selbstbetriebene Modelle zur strategisch saubersten Option. Was das Gesetz fordert und warum eigene Hardware die Compliance vereinfacht.
Weiterlesen → - Security2025-09-02
NIS2 und der Eigenbetrieb: Compliance durch Kontrolle
NIS2 verpflichtet mehr Unternehmen zu Cybersicherheitsmaßnahmen, als viele denken, und nimmt die Geschäftsleitung persönlich in die Pflicht. Warum Self-Hosting und Eigenbetrieb die Umsetzung vereinfachen.
Weiterlesen → - KI & Entwicklung2025-08-19
KI-Telefon-Agenten: Voice-Bots mit Pipecat & Asterisk
Echtzeit-Sprachpipeline — STT, LLM, TTS — angebunden an eine Telefonanlage: Pipecat und Asterisk machen das möglich. Ein Ausblick, was heute schon geht und wo die Grenzen liegen.
Weiterlesen → - Infrastruktur2025-08-05
VoIP & Telefonie mit innovaphone — on-prem statt Cloud-PBX
Telefonie muss nicht in die Cloud. Innovaphone bringt IP-PBX, SIP-Trunks und Gerätemanagement ins eigene Rack. Ein Erfahrungsbericht zu Setup, Ausfallsicherheit und Integration.
Weiterlesen → - KI & Entwicklung2025-07-15
Workflow-Automatisierung mit n8n — selbst gehostet
n8n verbindet Dienste, Webhooks und jetzt auch KI-Agenten in einem selbst gehosteten Workflow-Tool. Was n8n von Zapier und Make unterscheidet — und warum wir es für ernsthafte Automatisierung einsetzen.
Weiterlesen → - Storage2025-07-09
Storage-Reise, Teil 2: Vitastor — schnell, aber jung
Vitastor verspricht Ceph-ähnliche Architektur bei deutlich niedrigerer Latenz. Was wir im Betrieb gesehen haben — und warum 'schnell' allein nicht reicht.
Weiterlesen → - Strategie2025-07-01
Business Intelligence self-hosted: Metabase
Dashboards auf eigenen Datenbanken, ohne SQL-Kenntnisse, ohne Cloud-Abo. Metabase bringt BI in den Eigenbetrieb — und macht Fragen an die eigenen Daten so einfach wie Googeln.
Weiterlesen → - KI & Entwicklung2025-06-17
RAG-Umgebungen im Vergleich: Vektordatenbanken, Chunking, Embeddings
Retrieval-Augmented Generation verspricht Fakten aus eigenen Dokumenten — aber die Pipeline dahinter entscheidet über Qualität. Vektordatenbanken, Chunking-Strategien und Embedding-Modelle im Praxischeck.
Weiterlesen → - KI & Entwicklung2025-06-03
LLM-Frontends: OpenWebUI vs. LibreChat
Zwei Self-Hosted-Webinterfaces, die aus lokalen LLMs einen chatbaren Dienst machen. OpenWebUI und LibreChat im Vergleich: Multi-Modell, RAG, Benutzerverwaltung, Alltagstauglichkeit.
Weiterlesen →
Strategie2025-05-20Self-Hosting als Strategie: Datenhoheit statt Cloud-Abhängigkeit
Self-Hosting ist keine Bastler-Romantik, sondern eine betriebswirtschaftliche und rechtliche Entscheidung. Wann eigene Hardware der Cloud überlegen ist — und wann nicht.
Weiterlesen →- KI & Entwicklung2025-05-20
llama.cpp & GGUF: LLMs lokal, effizient, ohne Cluster
llama.cpp macht LLM-Inferenz auf Consumer-Hardware möglich — Quantisierung, CPU/GPU-Offload und ein Dateiformat, das kein Cloud-Budget braucht. Der Gegenpol zu vLLM und wann wir welches Werkzeug nehmen.
Weiterlesen → - KI & Entwicklung2025-05-06
Hochdurchsatz-LLM-Inferenz mit vLLM auf eigener Hardware
vLLM macht LLM-Inferenz schnell und effizient — PagedAttention, kontinuierliches Batching und eine OpenAI-kompatible API. So betreiben wir es auf einer RTX 5090 und was dabei wirklich zählt.
Weiterlesen → - Storage2025-04-22
Storage-Reise, Teil 1: Was uns Ceph gelehrt hat
Ceph ist das Schweizer Taschenmesser der verteilten Speicher — mächtig, aber hungrig. Warum wir damit begonnen haben, welche Hardware es wirklich braucht und wo es für unsere Cluster-Größe an Grenzen stieß.
Weiterlesen → - Infrastruktur2025-04-15
Netzwerk-Grundlagen: VLANs & Jumbo Frames
802.1Q-Segmentierung und MTU 9000 sind keine Details für Netzwerk-Feinschmecker, sondern handfeste Werkzeuge für mehr Sicherheit und Durchsatz. Wann sie helfen, wie Proxmox SDN sie verwaltet — und wo sie schaden.
Weiterlesen → - Infrastruktur2025-04-01
Server-OS-Wahl: Ubuntu vs. Alpine
Ubuntu bringt Stabilität und Support, Alpine minimale Image-Größe und musl. Wann sich welches Server-OS lohnt — und warum die Frage im Container-Zeitalter anders liegt als noch vor fünf Jahren.
Weiterlesen → - Infrastruktur2025-03-18
SQL Server 2022/2025 im Eigenbetrieb — nicht nur unter Windows
SQL Server läuft längst stabil auf Linux und in Containern. Was die Versionen 2022 und 2025 bringen, wie Backup und Hochverfügbarkeit im Eigenbetrieb aussehen — und was die Lizenzierung kostet.
Weiterlesen → - Security2025-03-04
Single Sign-On & IAM: Keycloak sichert interne Dienste
Ein Login für alle internen Dienste — Keycloak macht das ohne Lizenzkosten. OIDC, SAML, Identity Brokering und MFA für Webanwendungen hinter dem Reverse Proxy. So setzen wir es ein.
Weiterlesen → - Security2025-02-21
Mail-Security: NoSpamProxy vor dem eigenen Mailserver
Spam, Malware und fehlende Verschlüsselung sind die drei Dauerprobleme der E-Mail. NoSpamProxy löst alle drei als Gateway vor dem eigenen Mailserver — und bringt S/MIME gleich mit.
Weiterlesen → - Infrastruktur2025-02-18
Von VMware zu Proxmox: Warum wir den Hypervisor gewechselt haben
Lizenzkosten, Unsicherheit nach der Broadcom-Übernahme und der Wunsch nach echter Datenhoheit: warum wir unsere Virtualisierung auf Proxmox VE migriert haben — inklusive nativem ESXi-Import, VirtIO-Fallstricken bei Windows und sauberem Cutover.
Weiterlesen → - Infrastruktur2025-02-07
Mailserver self-hosted: Stalwart & Axigen vs. Exchange
Exchange ist teuer und komplex. Moderne Self-Hosted-Alternativen wie Stalwart und Axigen bieten JMAP, IMAP und SMTP auf einem Bruchteil der Komplexität. Was sie leisten, wo Unterschiede liegen.
Weiterlesen →
Innovation2024-12-10So verankern Sie KI im Unternehmen, ohne die Kontrolle zu verlieren
Künstliche Intelligenz ist zum Wettbewerbsfaktor geworden. Wie man KI sicher und nachhaltig im Unternehmen verankert, von der Datengrundlage bis zum Betrieb.
Weiterlesen →- Cloud Solutions2024-12-01
Cloud-Migration: die 6-Phasen-Strategie, die über Erfolg entscheidet
Aus vielen Migrationsprojekten: die 6-Phasen-Strategie, die über Erfolg oder teures Scheitern entscheidet, von der Bestandsaufnahme bis zum laufenden Betrieb.
Weiterlesen → - Web Development2024-11-15
PHP 8 Performance: spürbare Geschwindigkeitssteigerung erreichen
JIT, OPcache und Preloading richtig konfiguriert — wie aus einer durchschnittlichen PHP-Anwendung eine schnelle wird, ohne den Code neu zu schreiben.
Weiterlesen →
senn-tech