nexives
all for one & one for ram

RAM
deduplication
for AI
infrastructure.
RAM-Deduplizierung
für KI-Infrastruktur.

Native Linux system software that deduplicates shared libraries across AI workloads — recovering tens to hundreds of gigabytes of RAM per server, with no model changes and bit-identical results. Native Linux-Systemsoftware, die Shared Libraries über AI-Workloads hinweg dedupliziert — und so Dutzende bis Hunderte Gigabyte RAM pro Server freigibt, ohne Modell­anpassung und mit bit-identischen Ergebnissen.

nexives@gpu-node-04 · ~ live
nexives scan --report
[12:43:08] scanning /usr/lib, /opt, ~/.venv … 7142 files
[12:43:23] reclaimable memory identified
[12:43:36] optimization plan ready — 528 targets
[12:43:39] applying … 528/528 ok
────────────────────────────────
scan complete · 31 s
  RAM recovered: 19.83 GB
  Reversible: yes
  Status: ready
Real benchmark output. 4 LLM venvs on gpu-node-04, May 2026 — independently verifiable through standard Linux memory reporting. Echte Benchmark-Ausgabe. 4 LLM-venvs auf gpu-node-04, Mai 2026 — unabhängig über die Standard-Speicheranzeige von Linux verifizierbar.
Validated benchmark · May 2026Validiertes Benchmark · Mai 2026 | 19.83 GB recoveredfreigegeben · 31 s scanScan · 2.5 TB on a 10-node cluster10-Knoten-Cluster · 0 model changesModelländerungen
our missionunsere Mission

normalize
the AI stack.
Den KI-Stack
normalisieren.

acceleratebeschleunigen

78 % faster cold starts via ML-based prefetch. 78 % schnellere Cold-Starts via ML-basierten Prefetch.

economizeeinsparen

Save 50–250 GB of RAM per GPU server. 50–250 GB RAM pro GPU-Server einsparen.

deduplicatededuplizieren

Eliminate identical library copies across every environment. Identische Bibliotheks­kopien in jeder Umgebung eliminieren.

One copyEine Kopie

one copy.
shared everywhere.
Eine Kopie.
Überall geteilt.

Duplicate shared libraries collapse into one shared memory footprint.Doppelte Shared Libraries fallen zu einem gemeinsamen Speicher-Footprint zusammen.

libtorch_cpu.so
Shared copyGemeinsame Kopie
1shared libraryShared Library
What it isWas es ist

a system layer between
your AI runtime and the kernel.
Eine System­schicht zwischen
der AI-Runtime und dem Kernel.

On every modern AI server, the same shared-library files sit in RAM dozens of times. Nexives reclaims that duplicated memory in a single pass — safely, reversibly, and with bit-identical results — freeing tens to hundreds of gigabytes per server. Auf jedem modernen AI-Server liegen dieselben Shared-Library-Dateien dutzendfach im RAM. Nexives gewinnt diesen duplizierten Speicher in einem einzigen Durchlauf zurück — sicher, reversibel und bit-identisch — und gibt so Dutzende bis Hunderte Gigabyte pro Server frei.

What it doesWas es tut

deduplicates .so files at the memory level dedupliziert .so-Dateien auf Speicher-Ebene

Recovers the RAM wasted by duplicated shared libraries across every workload on the host — in place, safely and reversibly, with no change to your models, code or runtime. Gewinnt den RAM zurück, den duplizierte Shared Libraries über alle Workloads eines Hosts verschwenden — direkt am Host, sicher und reversibel, ohne Änderung an Modellen, Code oder Runtime.

What it doesn't touchWas es nicht anfasst

GPU memory, model weights, application code GPU-Speicher, Modellgewichte, Anwendungscode

No interference with VRAM, KV cache, datasets, Python objects or container layers. No code changes, no restarts, no configuration. Linux only. Kein Eingriff in VRAM, KV-Cache, Datensätze, Python-Objekte oder Container-Layer. Keine Code-Änderungen, keine Neustarts, keine Konfiguration. Linux-only.

Who it's forFür wen

GPU clouds, AI-first companies, hosting providers GPU-Clouds, AI-First-Unternehmen, Hosting-Provider

Anyone running multiple AI workloads on shared Linux hosts — or anyone running large fleets of customer VMs and containers on physical hardware. Jeder, der mehrere AI-Workloads auf gemeinsamen Linux-Hosts betreibt — oder große Flotten von Kunden-VMs und -Containern auf physischer Hardware.

ArchitectureArchitektur

The Nexives scope is isolated, explicit, and easy to understand.Der Nexives-Bereich ist isoliert, explizit und leicht verständlich.

User processesBenutzerprozessePython · Java · Node
Nexives deduplication layerNexives Deduplizierungs-Schichtour scopeunser Bereich
Linux kernelLinux-Kernelunmodifiedunverändert
FilesystemDateisystemext4 · xfs · btrfs
Shared libraryGemeinsame Bibliothek

many apps.
one library footprint.
Viele Apps.
Ein Bibliotheks-Footprint.

Multiple isolated workloads reference the same shared copy — without changing model results.Mehrere isolierte Workloads referenzieren dieselbe gemeinsame Kopie — ohne die Modellergebnisse zu verändern.

App Ashared libsgeteilte Libs
App Bshared libsgeteilte Libs
Shared libraryGemeinsame Bibliothek
numpy.so
libcublas.so
libgomp.so
App Cshared libsgeteilte Libs
App Dshared libsgeteilte Libs
How it worksFunktionsweise

four steps,
thirty-one seconds.
Vier Schritte,
einunddreißig Sekunden.

Nexives is intentionally simple. It installs in minutes, analyzes the host in a single fast pass, and recovers the wasted memory in place — safely and reversibly. Nexives ist bewusst einfach. Es ist in Minuten installiert, analysiert den Host in einem einzigen schnellen Durchlauf und gewinnt den verschwendeten Speicher direkt zurück — sicher und reversibel.

SCAN

map reclaimable memoryrückgewinnbaren Speicher erfassen

A single agent analyzes the host across all venvs, containers and language runtimes — read-only. Nothing is changed yet. Ein Agent analysiert den Host über alle venvs, Container und Runtimes hinweg — nur lesend. Noch wird nichts verändert.

VERIFY

prove exact identityexakte Identität sicherstellen

Every candidate is verified as byte-for-byte identical before anything is touched — ground truth, zero risk of a false match. Jeder Kandidat wird als Byte-für-Byte identisch verifiziert, bevor irgendetwas verändert wird — eindeutig, ohne Risiko einer Fehlzuordnung.

RECLAIM

recover the RAM in placeRAM direkt zurückgewinnen

Duplicated memory is reclaimed atomically and fully reversibly. Idempotent — safe to re-run at any time, with no disruption to running workloads. Duplizierter Speicher wird atomar und vollständig reversibel zurückgewonnen. Idempotent — jederzeit gefahrlos wiederholbar, ohne Störung laufender Workloads.

RUN

permanent, zero overheaddauerhaft, ohne Overhead

The recovered RAM stays recovered — permanently, with zero ongoing CPU cost and no runtime overhead. Results stay bit-identical. Der zurückgewonnene RAM bleibt frei — dauerhaft, ohne laufende CPU-Kosten und ohne Laufzeit-Overhead. Ergebnisse bleiben bit-identisch.

User processes (Python, Java, Node)Benutzerprozesse (Python, Java, Node)N processes
Nexives · deduplication layerNexives · Deduplizierungs-Schichtour scope
Linux kernelLinux-Kernelunmodified
Filesystem (ext4, xfs, btrfs)Dateisystem (ext4, xfs, btrfs)block device
Where it mattersWo es zählt

three customers,
one technology.
Drei Kunden,
eine Technologie.

Wherever multiple Linux processes load the same shared libraries, Nexives recovers RAM. The economics scale with workload density. Überall, wo mehrere Linux-Prozesse dieselben Shared Libraries laden, gewinnt Nexives RAM zurück. Die Ökonomie skaliert mit der Workload-Dichte.

GPU cloudsGPU-Clouds

multi-tenant inference at scaleMulti-Tenant-Inference im Großmaßstab

Each tenant runs its own PyTorch / vLLM venv. Hundreds of duplicate libtorch_cpu.so, libcudart.so, libnvinfer.so — collapsed to one copy in RAM per node. Jeder Tenant betreibt sein eigenes PyTorch- / vLLM-venv. Hunderte duplizierte libtorch_cpu.so, libcudart.so, libnvinfer.so — reduziert auf eine Kopie pro Knoten.

~250 GB
per node, 50 venvspro Knoten, 50 venvs
AI-first enterprisesAI-First-Unternehmen

in-house training and inferenceEigene Training- und Inference-Cluster

Capacity that would otherwise require additional hardware procurement — reclaimed in a 31-second scan, with no operational disruption. Kapazität, die anderenfalls zusätzliche Hardware-Beschaffung erfordern würde — in 31 Sekunden zurückgewonnen, ohne operative Störung.

2.5 TB
10-node cluster10-Knoten-Cluster
Hosting providersHosting-Provider

infrastructure editionInfrastructure Edition

Sell 25–35 % more customer capacity per physical host. Same hardware. Same Linux. New revenue line. Verkaufen Sie 25–35 % mehr Kundenkapazität pro physischem Host. Selbe Hardware. Selbes Linux. Neue Umsatzlinie.

200 TB
across 10 000 hostsüber 10 000 Hosts
AboutÜber uns

a small team,
built for the system layer.
Ein kleines Team,
gebaut für die Systemschicht.

Nexives is founded by engineers with deep experience in Linux internals, AI infrastructure and enterprise software. We have spent years operating the systems we now build for — and started this company because the memory layer beneath every modern AI workload was overdue for a rethink. Nexives wurde von Ingenieuren mit tiefer Erfahrung in Linux-Internals, AI-Infrastruktur und Enterprise-Software gegründet. Wir haben die Systeme, für die wir heute bauen, jahrelang selbst betrieben — und dieses Unternehmen gegründet, weil die Speicher­schicht unter jeder modernen AI-Workload eine grundlegende Neugestaltung verdient.

Full team to be announced. Das vollständige Team wird in Kürze vorgestellt.

IntegrityIntegrität

bit-identical by design.Bit-identisch per Design.

Nexives never alters file contents; recovery is fully reversible and applications see the same bytes.Nexives verändert niemals Dateiinhalte; die Rückgewinnung ist vollständig reversibel und Anwendungen sehen dieselben Bytes.

Reference runReferenzlauf
10101010101010101010
01010101010101010101
10101010101010101010
01010101010101010101
10101010101010101010
=
Nexives runNexives-Lauf
10101010101010101010
01010101010101010101
10101010101010101010
01010101010101010101
10101010101010101010
bit-identical · 0 model changesbit-identisch · 0 Modelländerungen
Frequently askedHäufige Fragen

questions worth answering up front. Fragen & Antworten.

Does Nexives change inference results?Verändert Nexives Inferenz­ergebnisse?
No. Bit-identical. Nexives never alters file contents — recovery is fully reversible and models see exactly the same bytes as in the reference run. Verifiable independently through standard Linux memory reporting. Nein. Bit-identisch. Nexives verändert niemals Dateiinhalte — die Rückgewinnung ist vollständig reversibel, und Modelle sehen exakt dieselben Bytes wie im Referenzlauf. Unabhängig über die Standard-Speicheranzeige von Linux verifizierbar.
What runtimes are supported?Welche Laufzeitumgebungen werden unterstützt?
Any Linux workload that loads shared-library (.so) files. Validated: PyTorch, vLLM, pip, conda, uv, CPython. Equivalent benefit: Java / JVM, Node.js native modules, Ruby, PHP, Go (with CGo). Jede Linux-Workload, die Shared-Library-Dateien (.so) lädt. Validiert: PyTorch, vLLM, pip, conda, uv, CPython. Gleichwertiger Nutzen: Java / JVM, Node.js native Module, Ruby, PHP, Go (mit CGo).
Is the kernel modified?Wird der Kernel verändert?
No kernel module, no patch, no custom build. Nexives runs entirely in userspace using standard, mainline Linux facilities. Compatible with mainline Linux on ext4, xfs and btrfs. Kein Kernel-Modul, kein Patch, kein Custom-Build. Nexives läuft vollständig im Userspace und nutzt ausschließlich Standard-Funktionen von Mainline-Linux. Kompatibel mit Mainline-Linux auf ext4, xfs und btrfs.
How does it scale across a cluster?Wie skaliert es über einen Cluster?
Each node runs Nexives independently. No shared storage, no cross-node dependency, no cluster-wide single point of failure. A lightweight Control Plane — one small VM — coordinates deployment, monitoring, licensing and compliance reporting across the fleet. Jeder Knoten betreibt Nexives unabhängig. Kein geteilter Speicher, keine knotenübergreifende Abhängigkeit, kein cluster­weiter Single Point of Failure. Ein leichter Control Plane — eine kleine VM — koordiniert Deployment, Monitoring, Lizenzierung und Compliance-Reporting über die Flotte hinweg.
How is this different from Linux KSM?Wie unterscheidet es sich von Linux KSM?
KSM scans memory continuously, takes 30+ minutes per pass, burns CPU permanently, and is disabled by default in cross-tenant deployments due to side-channel attack risk. Nexives runs as a single fast pass, completes in 31 seconds, has zero ongoing CPU cost, and never exposes memory across tenants. KSM scannt kontinuierlich Speicher, benötigt 30+ Minuten pro Durchlauf, verbrennt permanent CPU und ist in Multi-Tenant-Deployments standardmäßig deaktiviert wegen Side-Channel-Risiken. Nexives läuft als einzelner schneller Durchlauf, ist in 31 Sekunden fertig, hat null laufende CPU-Kosten und legt niemals Speicher tenantübergreifend offen.
What about Windows?Was ist mit Windows?
Linux only. Windows uses a fundamentally different memory model. Given that essentially all AI training and inference runs on Linux, this is intentional and not on the roadmap. Linux-only. Windows nutzt ein grundlegend anderes Speichermodell. Da praktisch das gesamte AI-Training und -Inference auf Linux läuft, ist dies bewusst gewählt und nicht auf der Roadmap.

ready to recover your RAM? bereit, ihren RAM zurückzugewinnen?

Reach out for a technical conversation, a pilot benchmark on your hardware, or a partner conversation about the Infrastructure Edition. Melden Sie sich für ein technisches Gespräch, einen Pilot-Benchmark auf Ihrer Hardware oder ein Partnergespräch zur Infrastructure Edition.

info@nexives.com