🤖 KI-News

Gerücht: 14-MB-KI-Modell soll Smart Home und Wearables steuern

Kurz gesagt: Der Anbieter Cactus hat laut einem Beitrag im Reddit-Forum LocalLLaMA ein neues KI-Modell namens Needle 2 vorgestellt, das als einzelne 14-Megabyte-Datei mit rund 28 Megabyte Arbeitsspeicher auskommen und komplette Sitzungen direkt auf Handys, Smartwatches, Smart-Home-Geräten und kleinen Robotern ausführen soll. Laut Herstellerangaben soll es fünf- bis siebzigmal kleiner sein als Konkurrenzmodelle wie FunctionGemma 270M, LFM2.5 230M oder Apple FM, weil es 2-Bit-Kompression statt 16-Bit-Gewichten nutzt. Unabhängige Benchmarks Dritter liegen bislang nicht vor, der Quellcode ist aber unter MIT-Lizenz auf GitHub einsehbar.

Gerücht: 14-MB-KI-Modell soll Smart Home und Wearables steuern

Symbolbild: KI-generiert

Ein 14 Megabyte kleines KI-Modell, das komplett auf einem Smartphone oder einer Smartwatch laufen und dort eigenständig Aufgaben wie Terminplanung, Nachrichten oder Smart-Home-Befehle ausführen soll – das behauptet laut Reddit LocalLLaMA der Anbieter Cactus zu seinem neuen Modell Needle 2.

Was Cactus verspricht

Laut dem Reddit-Beitrag von „Henry from Cactus“ handelt es sich bei Needle 2 um ein in sich geschlossenes 14-Megabyte-Binary, das eine komplette KI-Sitzung mit rund 28 Megabyte Arbeitsspeicher bewältigen soll – Werte, die auf handelsüblichen Smartphones, aber auch auf deutlich schwächerer Hardware wie Wearables, Smart-Home-Zentralen oder Kleinrobotern realistisch erscheinen. Laut Cactus richtet sich das Modell an genau solche „tiny devices“ und soll dort strukturierte Werkzeugaufrufe (Tool Calling) übernehmen, also etwa erkennen, welche App oder Funktion ein Sprachbefehl auslösen soll und die passenden Parameter dafür liefern.

Die Vorgängerversion als Beleg – Needle 2 selbst noch unbestätigt im Detail

Eigene Recherche auf GitHub und im Cactus-Blog bestätigt zumindest den Unterbau: Die Vorgängerversion Needle wurde bereits im Mai 2026 mit offen einsehbarem Quellcode unter MIT- beziehungsweise Apache-2.0-Lizenz veröffentlicht – ein 26-Millionen-Parameter-Modell, destilliert aus Googles Gemini, das laut Cactus’ eigenem Blogpost bei einfachen Werkzeugaufrufen die deutlich größeren Modelle FunctionGemma-270M, Qwen-0.6B, Granite-350M und LFM2.5-350M übertrifft – Modelle, die alle um ein Vielfaches mehr Parameter mitbringen. Für Needle 2 nennt Cactus laut GitHub-Repository einen Vorsprung von „5x bis 70x“ geringerer Größe gegenüber FunctionGemma 270M, LFM2.5 230M und Apples firmeneigenem Modell Apple FM, erreicht durch 2-Bit- statt 16-Bit-Gewichte. Unabhängige, von Cactus losgelöste Benchmark-Zahlen zu Needle 2 selbst liegen bislang nicht vor – die Angaben stammen ausschließlich vom Hersteller selbst, der Quellcode ist aber öffentlich auf GitHub einsehbar und damit grundsätzlich nachprüfbar.

Warum die Größe der eigentliche Clou wäre

Die meisten KI-Assistenten laufen heute in der Cloud: Der Sprachbefehl wird an einen Server geschickt, dort verarbeitet und die Antwort zurückgesendet – mit spürbarer Verzögerung, laufenden Kosten und der Notwendigkeit einer Internetverbindung. Ein Modell, das komplett auf dem Gerät läuft, würde diese Kette überflüssig machen: schnellere Reaktionszeiten, keine Abhängigkeit vom Internet, keine Daten, die das Gerät verlassen. Laut Cactus’ Architekturbeschreibung erreicht Needle das unter anderem, indem es auf klassische Feedforward-Schichten verzichtet und Werkzeugaufrufe stattdessen als reines Abruf- und Zusammensetzungsproblem behandelt – Cactus nennt das „Simple Attention Network“.

Was das für Nutzer bedeutet

Sollte sich Needle 2 in der Praxis bewähren, wäre das ein Baustein für Smart-Home-Zentralen und Wearables, die Sprachbefehle ohne Cloud-Anbindung verarbeiten – etwa eine Smartwatch, die „Licht im Wohnzimmer aus“ direkt versteht, ohne den Umweg über einen entfernten Server. Bis dahin gilt: Es handelt sich um Herstellerangaben aus einem Community-Forum, nicht um einen von unabhängiger Seite geprüften Produkttest. Wer die Technik selbst ausprobieren will, findet Quellcode und Modellgewichte frei zugänglich auf GitHub.

Quelle: Reddit LocalLLaMA. Zusätzliche Einordnung auf Basis eigener Recherche bei GitHub (cactus-compute/needle) und Cactus Compute Blog.

Quelle & Einordnung: Anlass dieser Meldung: Reddit LocalLLaMA. Text, Bewertung und Bild sind unsere eigene, unabhängige Einordnung – wir geben keine fremden Inhalte im Wortlaut wieder.
Was das im Alltag bedeutet
🤖 Transparenz: Recherche und Text dieser Meldung entstehen mit KI-Werkzeugen. Themenauswahl, Einordnung und Veröffentlichung verantwortet die Redaktion – verantwortlich im Sinne des § 18 Abs. 2 MStV ist Jörg Schock.

SmartHome Kompass bei Google folgen · alle Nachrichten

← Alle KI-News