Der Nokkela-Blog
Fachbeiträge zu IT-Infrastruktur, IT-Security und KI – fundiert und praxisnah. Hier teilen wir aus den verschiedenen Fachbereichen aktuelle Themen und was in echten Projekten im DACH-Raum, in Skandinavien und darüber hinaus funktioniert.
Eine Instanz pro Kunde – .NET, MSSQL und S3 weltweit skalieren
Eine Windows-VM mit IIS, ein MSSQL-Server, dazu S3 für die Dokumente – und das je Kunde einmal. Dieses Modell trägt erstaunlich weit, bricht aber an drei berechenbaren Stellen: Lizenzkosten, Wartungsfenster und Entfernung. Wir zeigen den Weg in vier Ausbaustufen – bis zu einer vollständigen, eigenständigen Kopie der Lösung je Weltregion – und sagen dazu, welche Stufe die meisten Anbieter wirklich brauchen.
Vom Ein-Kunde-eine-VM-Modell zur weltweiten Flotte: Ausbaustufen, regionale Zellen, Mandantenkatalog, Datenresidenz und die Lizenzrechnung, die am Ende über alles entscheidet.
Beitrag lesen →Geopolitik der KI-Modelle und Europas Souveränität
US-Closed-Source, chinesische Open-Weights mit politischer Prägung, Europa mit Mistral – und warum das Betriebsmodell über die Souveränität entscheidet.
Beitrag lesen →Ein /56 IPv6 per IPsec auf alle Edge-Standorte verteilen
Komplexes Routing auf Palo Alto: ein /56 über IPsec-Hub-and-Spoke mit ULA-Routing zwischen den Tunnelendpunkten.
Beitrag lesen →Worüber wir schreiben
Wir schreiben über drei Felder, in denen wir täglich arbeiten: IT-Infrastruktur mit On-Premise-, Managed- und Hosted Services; IT- und Netzwerksicherheit mit Palo Alto Networks und Zero Trust aus europäischen Rechenzentren; und Künstliche Intelligenz, gehostet in Europa oder On-Premise beim Kunden. Jedes Thema verweist auf das dahinterliegende Kompetenzfeld.
Wissen aus den Nokkela Kompetenzfeldern
In diesem Blog veröffentlichen die Fachbereiche der Nokkela-IT-Concept GmbH, was sie in echten Projekten gelernt haben. Wir schreiben aus dem eigenen Betriebsalltag statt aus Marketingunterlagen, arbeiten Open-Source-First und herstellerunabhängig und stehen für europäische digitale Souveränität in der Art, wie wir Systeme bauen und betreiben.
Alle Beiträge im Überblick
Dieses Archiv listet unsere früheren Beiträge chronologisch auf, jeweils mit Datum, Themenfeld und Lesezeit. Sie finden hier die Anleitung zur GPU-Durchreichung unter Proxmox 9 für einen vLLM-Server, die Anleitung zu RAG im Eigenbetrieb mit Qdrant, BGE-M3 und einem lokalen LLM sowie die ehrliche Gegenüberstellung von Managed Services und Eigenbetrieb. Jeder Eintrag öffnet eine kurze Zusammenfassung und verlinkt direkt auf den vollständigen Beitrag.
Proxmox 9 mit GPU für eine vLLM-VM konfigurieren
03.08.2026 · Infrastruktur & KI · 18 Min. Lesezeit
NVIDIA-GPU per IOMMU/VFIO an eine VM durchreichen und vLLM als OpenAI-kompatiblen LLM-Server betreiben – von den BIOS-Einstellungen bis zur Verifikation.
RAG im Eigenbetrieb: DSGVO-konform suchen
02.08.2026 · KI & DSGVO · 16 Min. Lesezeit
Eigene Dokumente lokal durchsuchbar machen – mit Qdrant, BGE-M3, Reranking und einem lokalen LLM. Datenhoheit garantiert, inklusive Recht auf Löschung.
Managed Services vs. Eigenbetrieb
01.08.2026 · Infrastruktur & Strategie · 12 Min. Lesezeit
Wann sich welcher Weg rechnet – eine ehrliche Gegenüberstellung von Kosten, Kontrolle, Know-how und Risiko, mit Vergleichstabelle und Entscheidungs-Checkliste.
Fragen zu diesen Blog
Hier finden Sie die Fragen, die uns zu diesem Bereich am häufigsten gestellt werden. Jede Antwort ist so geschrieben, dass sie für sich lesbar und auch einzeln zitiert korrekt bleibt.
Welche Themen behandelt der Nokkela-Blog?
Der Nokkela-Blog behandelt drei Themenstränge: IT-Infrastruktur, IT- und Netzwerksicherheit sowie Künstliche Intelligenz. Jeder Strang gehört zu einem spezialisierten Kompetenzfeld — nokkela.systems für On-Premise-, Managed- und Hosted Services, nokkela.network für Palo Alto Networks und Zero Trust, nokkela.ai für souveräne KI. Bisher erschienen: die weltweite Skalierung einer Ein-Instanz-pro-Kunde-Lösung auf .NET, MSSQL und S3, GPU-Durchreichung unter Proxmox 9 für vLLM, IPv6 über IPsec auf PAN-OS, RAG im Eigenbetrieb, Managed Services versus Eigenbetrieb sowie die Geopolitik der KI-Modelle.
Lassen sich die Anleitungen aus dem Nokkela-Blog in der eigenen Umgebung nachbauen?
Die Anleitungen im Nokkela-Blog sind als nachvollziehbare Schritt-für-Schritt-Guides mit exakt benannten Versionsständen geschrieben. Die Proxmox-Anleitung etwa läuft auf Proxmox VE 9.0 — Debian 13 Trixie, Linux-Kernel 6.14, QEMU 10 — und führt von den BIOS/UEFI-Einstellungen über die IOMMU-Kernelparameter, die VFIO-Module und die Bindung der GPU an vfio-pci bis zu einer q35/OVMF-VM mit Ubuntu 24.04 LTS. Jede Anleitung endet mit Verifikation und Troubleshooting.
Wie skaliert man eine Ein-Instanz-pro-Kunde-Lösung auf .NET und MSSQL weltweit?
Der Nokkela-Blog beschreibt dafür vier Ausbaustufen. Zuerst werden Web, Datenbank und Objektspeicher zu eigenen Bausteinen getrennt und viele Mandanten auf eine SQL-Instanz gebündelt — je Mandant eine Datenbank. Dann entsteht die erste vollständige Zelle: mehrere zustandslose IIS-Knoten hinter einem Lastverteiler, MSSQL mit Replikat in derselben Region und Backups mit Object Lock. Erst danach wird die Zelle in weitere Regionen vervielfältigt, gesteuert über einen Mandantenkatalog. Die eine Regel, die alles trägt: Anwendung, Datenbank und Dokumentspeicher eines Mandanten liegen immer im selben Rechenzentrum.
Welchen Stack nutzt der Nokkela-Blog für RAG im Eigenbetrieb?
Die RAG-Anleitung im Nokkela-Blog kombiniert vier Bausteine: Qdrant als Vektordatenbank, BGE-M3 für mehrsprachige Embeddings, einen Reranking-Schritt und ein lokales Sprachmodell, das über vLLM bereitgestellt wird. Da jeder Schritt auf eigener Hardware läuft, verlassen weder Dokumente noch Fragen das Netz. Neue Dokumente werden indexiert statt eintrainiert, sind also sofort verfügbar und jederzeit löschbar — so geht die Anleitung das Recht auf Löschung an.
Wie lässt sich ein delegiertes /56-IPv6-Präfix per IPsec auf mehrere Standorte verteilen?
Die Palo-Alto-Anleitung im Nokkela-Blog baut auf PAN-OS ein Hub-and-Spoke: Die Zentrale terminiert das vom Provider delegierte /56, jeder Edge-Standort erhält ein eigenes /64 und hängt über je einen IPsec-Tunnel an. Die Tunnelschnittstellen nummerieren wir mit ULA-Adressen (RFC 4193) als Next-Hop, damit das öffentliche Präfix den Produktivgeräten vorbehalten bleibt und das Routing einen Wechsel des delegierten /56 übersteht. Statische Routen genügen für wenige Standorte, BGP über die ULAs skaliert auf viele.
Sagt der Nokkela-Blog, ob Managed Services oder Eigenbetrieb günstiger sind?
Der Nokkela-Blog gibt dazu keine pauschale Antwort, denn maßgeblich sind die Gesamtkosten und nicht allein die monatliche Rechnung. Eigenbetrieb bietet maximale Kontrolle und Anpassbarkeit, verlangt aber Know-how, Personal und Vorabinvestitionen; Managed Services bieten planbare Kosten und Entlastung im Tausch gegen ein Stück Steuerung. Der hybride, co-managed Mittelweg lässt den Anbieter die Basis betreiben, während Anwendung und Datenhoheit beim Kunden bleiben. Unsere Faustregel: Kern selbst betreiben, Standardbetrieb auslagern.
Welche KI-Modelle gelten dem Nokkela-Blog als souverän?
Der Nokkela-Blog argumentiert, dass Souveränität weniger von der Herkunft eines Modells abhängt als vom Betriebsmodell: Open Weights laufen auf eigener Hardware. Die kommerziellen US-Spitzenmodelle sind überwiegend geschlossen und unterliegen US-Recht, wobei mehrere US-Anbieter zusätzlich Open Weights veröffentlichen. Chinesische Open-Weights-Modelle lassen sich lokal betreiben, sind inhaltlich aber geprägt; Europa ist am sichtbarsten durch Mistral vertreten, daneben Aleph Alpha, OpenEuroLLM und Teuken. Wir gewichten deshalb das Betriebsmodell, nicht nur die Rangliste.
Setzt der Nokkela-Blog Cookies oder externe Tracker?
Der Nokkela-Blog setzt keine Marketing- oder Analyse-Cookies und lädt keine externen Schriften, Karten, Analyse- oder Tracking-Dienste — er wird als statisches HTML ausgeliefert. Cloudflare steht als Reverse Proxy zum Schutz vor Angriffen wie DDoS davor; für Nutzer in Europa haben wir dessen Tracking ausdrücklich deaktiviert. Die Verarbeitung erfolgt überwiegend innerhalb der EU/des EWR, auf Servern in Deutschland und Finnland. Die im Footer verlinkte Datenschutzerklärung nennt die Einzelheiten.