Zum Inhalt springen
Tech & Tacheles„Klartext zu KI, Security und Crypto"
← Alle Beiträge
Künstliche Intelligenz July 18, 2026

Ollama v0.32.0: Lokale KI wird schneller – und bekommt 65 Millionen Dollar

Ollama v0.32.0 macht Gemma 4 auf Apple Silicon fast doppelt so schnell und bringt einen Agenten-Modus. Dazu 65 Mio. Dollar Series B. Was das für lokale KI bedeutet.

Ollama v0.32.0: Lokale KI wird schneller – und bekommt 65 Millionen Dollar

Ollama ist für viele der einfachste Weg, KI-Sprachmodelle lokal auf dem eigenen Rechner zu betreiben. Jetzt hat das Projekt gleich zwei Neuigkeiten geliefert: die Version v0.32.0 mit spürbar mehr Tempo und eine Finanzierungsrunde über 65 Millionen Dollar. Beides zeigt, wie ernst lokale KI inzwischen genommen wird.

Was Ollama v0.32.0 neu macht

Das am 11. Juli 2026 veröffentlichte Release Ollama v0.32.0 bringt vor allem Geschwindigkeit. Auf Apple-Silicon-Macs erzeugt das Modell Gemma 4 laut Projektangaben rund 90 Prozent mehr Token pro Sekunde – also fast doppelt so schnell. Möglich macht das eine Kombination aus Multi-Token-Vorhersage und automatischer Feinabstimmung.

Newsletter

Klartext ins Postfach

KI, Security & Crypto – die wichtigsten Analysen, kein Spam. Jederzeit abbestellbar.

Darüber hinaus verbessert das Update das Tool-Calling und die mehrstufige Argumentation von Gemma 4, behebt ein Speicherleck im MLX-Cache und beschleunigt das Laden von Snapshots. Neu ist außerdem ein interaktiver Agenten-Modus, der beim Aufruf startet und beim Programmieren oder beim Delegieren von Aufgaben hilft. Ollama entwickelt sich damit vom reinen Modell-Starter zum kleinen KI-Werkzeugkasten.

65 Millionen Dollar für lokale KI

Am 9. Juli 2026 gab das Team eine Series-B-Runde über 65 Millionen Dollar bekannt, angeführt von Theory Ventures. Damit steigt das insgesamt eingesammelte Kapital auf 88 Millionen Dollar. Das Geld soll in Entwicklerwerkzeuge rund um lokal betriebene KI fließen.

Der Trend dahinter ist klar: Wer Modelle selbst hostet, behält seine Daten im Haus, spart laufende Abo-Kosten und ist unabhängig von der Verfügbarkeit einzelner Anbieter. Gerade aus CISO-Sicht ist das ein starkes Argument – sensible Prompts verlassen den eigenen Rechner erst gar nicht.

Ollama in der Praxis: Was du dafür brauchst

Ollama ist nur die Software-Schicht. Wie gut lokale KI läuft, entscheidet am Ende die Hardware – vor allem Grafikspeicher und Arbeitsspeicher. Kompakte Modelle wie Gemma 4 12B oder Qwen 3.6 27B laufen bereits auf gut ausgestatteten Consumer-Geräten, während echte Schwergewichte wie das neue Kimi K3 Rechenzentrums-Hardware verlangen.

Wenn du überlegst, in einen Rechner für lokale Modelle zu investieren, lohnt ein Blick in meinen Ratgeber zur Hardware für lokale KI. Dort steht, wie viel VRAM welche Modellgröße wirklich braucht und wo du dein Budget am sinnvollsten einsetzt. Kurz gesagt: Ollama senkt die Einstiegshürde weiter – die spannendste Entwicklung ist derzeit, wie klein und schnell brauchbare Modelle werden.

Quellen

Dranbleiben

Diese Analysen als Newsletter

Ein Mal pro Woche Klartext zu KI, Security & Crypto – direkt in dein Postfach.

Jetzt anmelden