senn-techKontakt

KI-Native Software + Corporate LLM Stack

KI-native Software.
Eigene GPUs.
Tiroler Engineering.

Eigene GPUs, keine Kompromisse.

root@senn-tech
vLLM · Ollama · Qdrant · RAG · Proxmox · HA-Storage · Medusa · Stripe · Voice-Agents · DSGVO · RTX 5090 · On-Prem · Monitoring · Firewalling ·vLLM · Ollama · Qdrant · RAG · Proxmox · HA-Storage · Medusa · Stripe · Voice-Agents · DSGVO · RTX 5090 · On-Prem · Monitoring · Firewalling ·

Leistungen

Drei Disziplinen, ein Stack.

01 · APPS

Enterprise App Vibecoding

Geschäftsanwendungen, die ohne klassische Projektstruktur entstehen — schnell gebaut, direkt am Bedarf, iterativ mit dem Team.

Next.js · Medusa · Stripe

02 · LLM

Corporate LLM Stack

Sprachmodelle on-premise: Inferenz, RAG, Agenten und Dokumentenverarbeitung auf eigener Hardware — DSGVO-konform und souverän.

vLLM · Ollama · Qdrant

03 · IT

General IT Solutions

Infrastruktur, die hält: Proxmox-Cluster, HA-Storage, Monitoring, Security und Betrieb für KMUs, die ihre IT ernst nehmen.

Proxmox · Ceph · OPNsense

Warum senn-tech

Kein Sales-Layer, kein Buzzword-Bingo — Umsetzung.

Auf eigener Hardware

On-Prem-LLMs auf eigenen GPUs — deine Daten bleiben im Haus, DSGVO-konform.

15+ Jahre IT

Von der Anwendung über das Modell bis zur Infrastruktur — Erfahrung von KMU bis Konzern, alles aus einer Hand.

Full-Stack

App-Entwicklung, LLM-Stack und Betrieb greifen ineinander, statt an Schnittstellen zu scheitern.

Direkter Ansprechpartner

Du sprichst mit dem, der baut — kein Vertrieb, kein Ticket-Pingpong.

Technologieneutral

Das passende Werkzeug für dein Problem, kein Vendor-Lock-in.

Ehrlich & messbar

Konkrete Ergebnisse statt Strategiepapieren — und ein klares Nein, wenn KI nicht die Antwort ist.

0+

Jahre IT-Erfahrung

On-Prem

On-Prem RTX-5090-Inferenz

0,9 %

HA-Infrastruktur & Storage

DSGVO

DSGVO konform, on-premise

Wie RAG funktioniert

Antworten mit Quellen — live aus deinen Daten.

Dokumente werden vorab in Vektoren umgewandelt. Bei jeder Frage sucht das System die relevantesten Stellen und gibt sie dem LLM als Kontext — so entstehen belegbare Antworten.

01Anfrage wird als Vektor eingebettet
02Vektor-Datenbank findet die relevantesten Stellen
03Treffer gehen als Kontext ans LLM
04Antwort wird generiert — mit Bezug auf die Quellen

Live-Demo

Sprich mit dem Stack.

Dieser Chat l\u00e4uft auf unserem eigenen KI-Server — DSGVO-konform in der EU. Frag etwas \u00fcber meine Leistungen.

senn-tech-llm · on-prem · EU

Antworten werden von einem Sprachmodell generiert und k\u00f6nnen Fehler enthalten.

So arbeiten wir

Von der Idee zur produktiven L\u00f6sung.

01

Gespräch & Analyse

Wir klären Ziel, Daten und Rahmen — und ob KI überhaupt der richtige Hebel ist.

02

Prototyp

Schnell ein lauffähiger Proof of Concept zum Anfassen — kein monatelanges Konzeptpapier.

03

Produktivbetrieb

Sauber gebaut, abgesichert und betrieben — auf deiner oder unserer Infrastruktur.

FAQ

H\u00e4ufige Fragen.

Bleiben unsere Daten wirklich im Haus?+

Ja. Auf Wunsch läuft die komplette LLM-Inferenz on-premise auf eigener Hardware — kein Datenabfluss an externe APIs.

Arbeitet ihr auch mit kleineren Unternehmen?+

Ja, vom Einzelunternehmen bis zum Mittelstand. Lösungen werden auf Größe und Budget zugeschnitten.

Was kostet ein Projekt?+

Das hängt vom Umfang ab. Nach einem kurzen Erstgespräch bekommst du eine ehrliche Einschätzung — ohne Verkaufsdruck.

Lassen sich bestehende Systeme anbinden?+

In der Regel ja. Wir integrieren in vorhandene Tools, Datenbanken und Workflows, statt sie zu ersetzen.

Und wenn KI für unser Problem nicht sinnvoll ist?+

Dann sagen wir das. Manchmal ist klassische Automatisierung oder ein Prozessfix die bessere Lösung.

Lass uns dein Projekt bauen.

Von der Enterprise-App bis zum eigenen LLM-Cluster — schreib mir, was du vorhast.

Kontakt aufnehmen