Zum Inhalt springen
GENTIAN – MULTI-GPU-SOFTWARE FÜR INFERENZ UND TRAINING

Längerer Kontext.
Retrieval aus dem Cache.
Für jede Antwort ein Nachweis.

Gentian erweitert Inferenz und Training auf Multi-GPU-Produktivservern, mit einem Knoten oder mit mehreren – gezeigt an vLLM und Megatron, aber nicht auf sie beschränkt. Die Software läuft auf Ihrer vorhandenen NVIDIA-Hardware – ohne Austausch, Sondermodus oder Plattformwechsel.

Drei Dinge, die Gentian leistet

Gentian ist eine Architektur in zwei Ausprägungen: Gentian Software, die heute auf Ihren vorhandenen NVIDIA-Servern läuft, und Gentian Silicon, derselbe Entwurf als physisches Design.

Kontext

Zweieinhalbmal so viel Kontext auf einem einzigen Server mit acht GPUs – über 1,3 Millionen Token, wo der herkömmliche All-Gather-Pfad den Speicher erschöpft. Eine gemessene Kapazitätsuntergrenze, keine Geschwindigkeitsaussage.

Retrieval-Cache

Wächst ein Dokumentbestand von 10 auf 48, bricht gewöhnliches Caching ein – von rund 13 % Trefferquote auf unter 3 %. Gentian bleibt über dieselbe Messreihe über 95 %, bei demselben Speicherbudget von 0,85. Stabilität der Trefferquote, keine Durchsatzaussage.

Nachweise

Jede Antwort kann einen signierten Nachweis tragen: Ein eingetragenes NVIDIA-Gerät hat eine Anfrage beantwortet, die an genau diese Antwort gebunden war, bevor signiert wurde. Prüfen kann das jeder – offline, Jahre später, auch wenn GPU und Schlüssel längst weg sind. Belegt ist die Anwesenheit des Geräts bei der Autorisierung.

Den letzten Punkt prüfen Sie selbst, in zwei Befehlen

Sie müssen uns kein Wort glauben. Das öffentliche Repository enthält einen echten signierten Nachweis einer KI-Antwort und eine manipulierte Kopie desselben Nachweises. Der erste besteht die Prüfung. Beim zweiten verweigert das Werkzeug die Bestätigung und nennt den Grund. Es läuft mit Python 3 und cryptography – im Prüfpfad steckt keinerlei Software von cybiont.

device-presence-bound-v1$ python3 standalone_verify.py valid
{"terminal_status":"PASSED","device_presence_profile":"DEVICE_PRESENCE_BOUND",
 "workload_execution_claim":false,"device_locality_claim":false,
 "performance_claim":false,"vendor_code_used":false, …}

device-presence-bound-v1$ python3 standalone_verify.py tampered
{"refusal_code":"PAYLOAD_DIGEST_MISMATCH","terminal_status":"REFUSED"}

Echte Ausgabe, gekürzt – das Werkzeug gibt eine Zeile JSON aus. Die Grenzen stehen darin als Felder, nicht als Fussnote von uns.

Nachweise holen und prüfen →  ·  Zwei Befehle, kein Konto, kein Formular.

Produkt und Engineering-Programme

Gentian ist das Produkt. Governance und Nidus sind separate Engineering-Programme unter demselben Schweizer Dach. Gentians Siliziumarbeit ist eine separate, längerfristige Forschungslinie – nicht das Softwareangebot.

Programm · I

Gentian

Multi-GPU-Software für Inferenz und Training

Erweitert Inferenz und Training auf vorhandener NVIDIA-Hardware, gezeigt an vLLM und Megatron. Die Software ergänzt beide um Kapazität für längere Kontexte, stabiles zwischengespeichertes Retrieval und einen an Geräteanwesenheit gebundenen Nachweis für jede Antwort. Öffentliche Messungen und ihre Grenzen stehen auf der Produktseite.

Gentian-Produkt ansehen →

Programm · II

Governance

Kontrollen für KI-Nutzung in regulierten Organisationen

Ein unabhängig prüfbarer signierter Nachweis einer echten KI-Antwort, veröffentlicht mit einer manipulierten Kopie, bei der die Bestätigung verweigert und der Grund genannt wird – beide offline in zwei Befehlen ausführbar. Browsernative DLP, Policy-Durchsetzung und gesteuerte KI-Workflows sind Forschung im selben Programm.

Governance-Stack prüfen →

Programm · III

Nidus

Nachvollziehbares Reasoning für KI-gestützte Engineering-Arbeit

Governance-Runtime, die das V-Modell mechanisiert. Anforderungen, Architektur, Traces, Proofs und Evidenz leben in einem einzigen entscheidbaren Artefakt, das bei jeder Mutation verifiziert wird. Öffentlicher Preprint auf arXiv (2604.05080).

Nidus erkunden →