Dienstag, 6. Oktober 2026 · KW 41 DE · EN · FR · ES Dunkel
KI

Ghost Core holt den KI-Agenten ins Wohnzimmer

Ghost Core betreibt KI-Agenten rund um die Uhr auf dem eigenen Gerät. Die erste Charge ist laut Gründer ausverkauft, PCs mit RTX Spark folgen im Herbst.

Von Benedikt Langer 6. Oktober 2026 5 Minuten Lesezeit
Ghost Core holt den KI-Agenten ins Wohnzimmer

Das Start-up Ghost verkauft mit Core einen Rechner, der offene KI-Modelle und lokale KI-Agenten mit Zugriff auf Mail und Kalender dauerhaft auf dem Gerät betreibt. Die erste Charge für netto rund 3.120 Euro ist laut Gründer ausverkauft und soll Ende Oktober ausgeliefert werden. Im Herbst sollen PCs mit NVIDIA RTX Spark folgen.

Das Wichtigste in Kürze

  • Ghost Core betreibt offene KI-Modelle und einen persönlichen Agenten dauerhaft auf dem Gerät. Die erste Charge für netto rund 3.120 Euro ist laut Gründer ausverkauft und soll Ende Oktober ausgeliefert werden.
  • Das Datenversprechen gilt für KI-Modell und Gedächtnis. Für Websuche, E-Mail und Software-Updates braucht Core weiterhin eine Internetverbindung.
  • Bis 2027 sollen kleine, aufgabenspezifische Modelle laut Gartner dreimal häufiger genutzt werden als große Sprachmodelle. Neben Ghost sollen ASUS, Dell, HP, Lenovo, Microsoft Surface und MSI im Herbst Geräte mit NVIDIA RTX Spark bringen.

Verwandt:Herunterladbar heißt nicht betreibbar  /  DGX Spark vs. Mac Mini: Prefill zählt

Der persönliche KI-Computer

Zain Javaid ist 19 Jahre alt, war zuvor Quant-Trader und hat für sein Start-up Ghost eine Seed-Finanzierung, also eine frühe Finanzierungsrunde, über rund 9,8 Millionen Euro eingesammelt. Andreessen Horowitz führt die Runde an, beteiligt sind außerdem Abstract, Audacious Ventures, SV Angel und Nova. Das Produkt heißt Core. Ghost bezeichnet es als persönlichen KI-Computer, der lokale Modelle rund um die Uhr vollständig auf dem Gerät betreibt.

Bedient wird Core über Laptop, Mobil-App oder iMessage. Das Gerät verbindet sich mit Mail, Kalender, Dateien, Smart-Home-Geräten und dem Browserverlauf sowie mit Wearables wie Oura, Eight Sleep und Whoop. Core hat ein eigenes Dateisystem, einen Browser und Werkzeuge, um selbst zu handeln. In der Vorführung sucht der Agent im Web nach Umzugsfirmen in San Francisco, ruft sie an und vergleicht die Preise.

Javaid begründet die eigene Hardware damit, dass Modelle auf vorhandenen Rechnern zwar laufen, das aber in vieler Hinsicht ein schlechtes Erlebnis sei. Die erste Charge kostet netto rund 3.120 Euro, wird in San Francisco montiert und ist nach seinen Worten bereits ausverkauft. Ausgeliefert werden soll am 31. Oktober.

Was ist lokale Inferenz? Inferenz bezeichnet das Ausführen eines trainierten KI-Modells, das auf eine Eingabe hin eine Antwort erzeugt. Bei lokaler Inferenz rechnet das Modell auf dem eigenen Gerät, etwa auf dessen Grafikkarte und Arbeitsspeicher. Bei Ghost Core gilt das für KI-Modell und Gedächtnis, für Websuche, E-Mail und Software-Updates braucht das Gerät weiterhin eine Internetverbindung.

Was im Gehäuse steckt

Herzstück ist eine NVIDIA RTX PRO 4000 Blackwell in kompakter SFF-Bauform mit 24 GB GDDR7-ECC-Grafikspeicher und 432 GB/s Speicherbandbreite. Die Karte ist auf 70 Watt ausgelegt. Dazu kommen ein AMD Ryzen 5 7600 mit 6 Kernen und 12 Threads, 64 GB DDR5-Arbeitsspeicher und eine 1-TB-NVMe-SSD. Ghost gibt 770 AI TOPS an, eine Kennzahl für die KI-Rechenleistung.

Vorinstalliert sind die offenen Modelle Qwen 3.8-Next, Qwen 3.8-27B, Gemma 4-31B und Muse-Glimmer-30B. Modelle bis rund 30 Milliarden Parameter, also Stellgrößen des Modells, laufen nach Javaids Angaben vollständig auf der Grafikkarte. Größere wie Qwen-3.8-Next lagern Teile in den Arbeitsspeicher aus.

Für die Geschwindigkeit nennt Ghost über 87 Token pro Sekunde mit Qwen-3.8-27B und 32 mit Qwen-3.8-Next. Token sind die Wortbausteine, in denen Sprachmodelle Text erzeugen. Unabhängig gemessen sind diese Werte nicht. Auf Kritik hin sprach Javaid von 70 bis über 80 Token pro Sekunde für das 27B-Modell. Er führt das auf Optimierungen der Rechenroutinen auf Kernel-Ebene und auf Multi-Token-Prediction zurück. Bei diesem Verfahren sagt das Modell mehrere Token pro Schritt voraus. Die Open-Source-Software llama.cpp hat die Technik gerade ebenfalls eingebaut und meldet auf einer NVIDIA DGX Spark eine rund 1,5-fache Beschleunigung beim Decodieren. Ethereum-Mitgründer Vitalik Buterin sind 20 bis 30 Token pro Sekunde zu langsam, flüssig fühlt es sich für ihn erst ab 100 an.

Wo das Datenversprechen endet

Ghost verspricht, dass keine Daten das Haus verlassen. Core verschlüsselt, speichert und verarbeitet die Daten nach Herstellerangaben vollständig auf dem Gerät. Quellcode, Logik und Modellgewichte liegen ebenfalls lokal, damit Core nicht von einem externen Dienstbetreiber abhängt. Neue Modelle kommen per Funk-Update, ähnlich wie bei Tesla.

Für Websuche, E-Mail und diese Software-Updates braucht Core allerdings eine Internetverbindung. Das Versprechen gilt damit für KI-Modell und Gedächtnis. Suche, Mail und Updates laufen weiter über das Netz, auch der Agent aus der Vorführung findet die Umzugsfirmen im Web.

Bei der Modellqualität räumt Javaid eine Lücke ein. Die kleinen und mittelgroßen Modelle seien noch nicht auf Spitzenniveau, reichten aber für die meisten Alltagsaufgaben. In ein bis zwei Modellgenerationen erwartet er keinen nennenswerten Unterschied mehr zwischen dem aktuellen Opus-Modell und dem, was auf Core läuft. Buterin beschreibt eine Strategie, bei der ein lokales Modell als Steuerzentrale arbeitet und leistungsstarke Cloud-Modelle als Werkzeug für anspruchsvollere Aufgaben aufruft.

NVIDIA und Microsoft verbreitern den Markt

NVIDIA hat RTX Spark für Windows-PCs im Zeitalter persönlicher KI-Agenten gebaut. Die Plattform kombiniert eine Blackwell-RTX-GPU mit 6.144 CUDA-Kernen und eine Grace-CPU mit 20 Kernen, liefert bis zu 1 Petaflop KI-Rechenleistung und bietet 128 GB gemeinsamen Speicher. Laptops und Desktops damit sollen im Herbst von ASUS, Dell, HP, Lenovo, Microsoft Surface und MSI kommen, Acer und Gigabyte folgen. NVIDIA und Microsoft bauen gemeinsam eine sichere Windows-Plattform für Agenten auf dem Gerät, mit neuen Sicherheitsfunktionen im Betriebssystem und NVIDIA OpenShell.

Am 7. Oktober wollen Microsoft-CEO Satya Nadella, Windows-Chef Pavan Davuluri und NVIDIA-CEO Jensen Huang in San Francisco gemeinsam auftreten. Thema sind Neuerungen bei Windows, RTX Spark, Surface und dem PC-Ökosystem. Ghost Core soll am 31. Oktober ausgeliefert werden, die ersten RTX-Spark-Laptops und -Desktops kündigt NVIDIA für Herbst 2026 an.

Die Sicht der Unternehmens-IT

Nach Angaben von Gartner werden Organisationen bis 2027 kleine, aufgabenspezifische KI-Modelle dreimal häufiger nutzen als allgemeine große Sprachmodelle. Als Gründe nennt Gartner-Analyst Sumit Agarwal geringere Rechen- und Betriebskosten sowie höhere Genauigkeit bei spezialisierten Aufgaben.

Tom Mainelli, Group Vice President für Device & Consumer Research bei IDC, sieht eine Hürde auf Firmengeräten. IT-Teams hätten klargemacht, dass sie autonome Software ohne entsprechende Kontrolle nicht auf verwalteten Geräten zulassen. Ob die großen KI-Labore zu dem Schluss kommen, dass ein Teil ihrer Inferenz auf den Schreibtisch des Kunden gehört, hält Mainelli für offen.

Häufige Fragen

Fallen nach dem Kauf von Ghost Core laufende Kosten an?

Core braucht nach Herstellerangaben kein Abonnement. Zum Gerät gehören 1 Jahr Garantie und 30 Tage Rückgaberecht.

Können andere Programme die Modelle auf Core nutzen?

Core stellt eine Schnittstelle bereit, die mit der OpenAI Responses API kompatibel ist. Andere Apps, Skripte und Agenten können die lokalen Modelle darüber ohne Gebühren pro Token ansprechen.

Warum ist Core günstiger als eine NVIDIA DGX Spark?

Javaid erklärt das mit dem Einkauf. Ghost habe Grafikkarten zu Preisen vor der Teuerung gesichert und gebe die Ersparnis an die Kunden weiter.

Bildquelle: KI-generiert (Oktober 2026)

MBF Media Newsletter

Das monatliche Briefing für Entscheider

Einmal im Monat bündelt der MBF Media Newsletter das Wichtigste aus cloudmagazin, MyBusinessFuture, Digital Chiefs und SecurityToday, kuratiert von der Redaktion.

Rund 23.500 IT- und Business‑Entscheider lesen diesen Newsletter. Lesen Sie mit.

Kostenfrei abonnieren
MBF Media Newsletter, aktuelle Ausgabe auf dem iPhone
Ein Magazin der Evernine Media GmbH