KI für Ihr Unternehmen – Jetzt Demo buchen

Inkling-Small: Ein neues KI-Modell mit Fokus auf Effizienz und Vielseitigkeit

Kategorien:
No items found.
Freigegeben:
August 2, 2026

KI sauber im Unternehmen integrieren: Der 5-Schritte-Plan

Von der ersten Idee bis zur voll integrierten KI-Lösung – strukturiert, sicher und mit messbarem Erfolg

1
🎯

Strategie & Zieldefinition

Wir analysieren Ihre Geschäftsprozesse und identifizieren konkrete Use Cases mit dem höchsten ROI-Potenzial.

✓ Messbare KPIs definiert

2
🛡️

Daten & DSGVO-Compliance

Vollständige Datenschutz-Analyse und Implementierung sicherer Datenverarbeitungsprozesse nach EU-Standards.

✓ 100% DSGVO-konform

3
⚙️

Technologie- & Tool-Auswahl

Maßgeschneiderte Auswahl der optimalen KI-Lösung – von Azure OpenAI bis zu Open-Source-Alternativen.

✓ Beste Lösung für Ihren Fall

4
🚀

Pilotprojekt & Integration

Schneller Proof of Concept mit nahtloser Integration in Ihre bestehende IT-Infrastruktur und Workflows.

✓ Ergebnisse in 4-6 Wochen

5
👥

Skalierung & Team-Schulung

Unternehmensweiter Rollout mit umfassenden Schulungen für maximale Akzeptanz und Produktivität.

✓ Ihr Team wird KI-fit

Inhaltsverzeichnis

    mindverse studio – Ihre Plattform für digitale Effizienz

    Optimieren Sie Prozesse, automatisieren Sie Workflows und fördern Sie Zusammenarbeit – alles an einem Ort.
    Mehr über Mindverse Studio erfahren

    Das Wichtigste in Kürze

    • Thinking Machines hat mit "Inkling-Small" ein neues Open-Weights-Modell vorgestellt, das Effizienz über reine Größe stellt.
    • Das Modell erreicht eine vergleichbare Leistung wie sein größerer Vorgänger "Inkling", ist jedoch deutlich kleiner und kostengünstiger im Betrieb.
    • Inkling-Small basiert auf einer Mixture-of-Experts-Architektur mit 276 Milliarden Gesamtparametern und 12 Milliarden aktiven Parametern.
    • Es übertrifft Inkling in bestimmten Bereichen wie Codierung und Argumentation und bietet Vorteile bei der Token-Effizienz.
    • Die Veröffentlichung unter der Apache 2.0 Lizenz ermöglicht eine breite kommerzielle Nutzung und Anpassung durch Unternehmen.
    • Das Modell ist multimodal und verarbeitet Text-, Bild- und Audioeingaben nativ.

    Die Landschaft der Künstlichen Intelligenz wird zunehmend von Innovationen geprägt, die nicht nur auf die schiere Größe von Modellen abzielen, sondern auch auf deren Effizienz und praktische Anwendbarkeit. Ein aktuelles Beispiel hierfür ist die Einführung von "Inkling-Small" durch Thinking Machines, einem KI-Labor unter der Leitung der ehemaligen OpenAI CTO Mira Murati. Dieses neue Modell stellt eine strategische Entwicklung dar, die den Fokus auf optimierte Leistung bei reduzierten Ressourcen legt.

    Die strategische Neuausrichtung: Effizienz statt reiner Größe

    Thinking Machines hat mit Inkling-Small ein Modell veröffentlicht, das eine vergleichbare Leistung wie sein größeres Pendant Inkling erzielt, dabei aber nur etwa ein Viertel der Parameter aufweist. Während Inkling über 975 Milliarden Gesamtparameter und 41 Milliarden aktive Parameter verfügt, kommt Inkling-Small mit 276 Milliarden Gesamtparametern und 12 Milliarden aktiven Parametern aus. Diese Reduzierung der Modellgröße hat direkte Auswirkungen auf die Rechenanforderungen und Betriebskosten, was für Unternehmen von erheblicher Bedeutung ist.

    Technische Details und Leistungsmerkmale

    Inkling-Small ist ein multimodales Modell, das Text-, Bild- und Audioeingaben verarbeiten kann und Textausgaben generiert. Es nutzt eine sogenannte Mixture-of-Experts (MoE)-Architektur. Diese Architektur ermöglicht es, dass das Modell zwar eine große Anzahl von Gesamtparametern besitzt, aber pro Token nur einen Bruchteil davon aktiv nutzt. Konkret leitet das Modell jedes Token an sechs von 256 spezialisierten Experten sowie zwei geteilte Experten weiter, die immer aktiv sind. Dies trägt maßgeblich zur Effizienz bei, da nicht alle Parameter bei jeder Inferenz aktiviert werden müssen.

    Das Modell verfügt über ein Kontextfenster von bis zu einer Million Tokens und zeigt eine vielseitige Leistung in verschiedenen Benchmarks. Laut Artificial Analysis erreicht Inkling-Small einen Wert von 40 auf dem Intelligence Index, nur einen Punkt unter dem Wert von Inkling (41). Bemerkenswert ist, dass Inkling-Small in mehreren Codierungs- und Argumentationstests, wie Humanity's Last Exam (32 % vs. 30 %) und GPQA Diamond (89 % vs. 87 %), bessere Ergebnisse erzielt als sein größerer Vorgänger. Es zeigt jedoch leichte Schwächen bei agentenbasierten Aufgaben und faktischem Wissen. Ein entscheidender Vorteil ist die Token-Effizienz: Inkling-Small benötigt durchschnittlich 24.000 Output-Tokens pro Aufgabe, verglichen mit 45.000 für Deepseek V4 Flash und 78.000 für GPT-5.4 mini.

    Praktische Implikationen für Unternehmen

    Die Veröffentlichung von Inkling-Small unter der Apache 2.0 Lizenz ist ein wichtiger Aspekt für die B2B-Zielgruppe. Diese permissive Lizenz erlaubt es Unternehmen, das Modell frei zu nutzen, zu modifizieren, zu fine-tunen, weiterzuverbreiten und kommerziell zu verwerten. Dies bietet eine größere rechtliche Flexibilität im Vergleich zu vielen proprietären oder restriktiveren "Open"-Lizenzen, die oft Umsatzschwellen, Branding-Verpflichtungen oder Nutzungseinschränkungen enthalten.

    Für Unternehmen, die KI-Anwendungen entwickeln, bedeutet Inkling-Small eine Option, die nahezu die Leistungsfähigkeit eines größeren Modells bietet, jedoch mit geringeren Rechenanforderungen und Betriebskosten. Dies ist besonders relevant für Anwendungen wie Codierungsassistenten, Werkzeugnutzungssysteme, Retrieval Augmented Generation (RAG) und multimodale Workflows. Obwohl das Modell immer noch zu groß für den lokalen Betrieb auf Standard-Laptops ist, reduziert der geringere Ressourcenbedarf die Hürden für den Einsatz auf Unternehmens-GPU-Servern oder in Cloud-Umgebungen erheblich.

    Thinking Machines betont zudem die Möglichkeit, den Reasoning Effort des Modells anzupassen, um je nach Schwierigkeitsgrad der Aufgabe ein Gleichgewicht zwischen Qualität, Latenz und Kosten zu finden. Dies bietet Entwicklern eine direkte Kontrolle über die Ressourcenallokation.

    Ein Ausblick auf die Modellentwicklung

    Die schnelle Veröffentlichung von Inkling-Small nach dem ursprünglichen Inkling-Modell deutet auf eine effiziente und wiederholbare Entwicklungspipeline bei Thinking Machines hin. Dies lässt vermuten, dass das Unternehmen in der Lage ist, seine Modellfamilie kontinuierlich zu optimieren und schnell auf neue Anforderungen zu reagieren. Die Offenheit des Modells und die Bereitstellung der Gewichte auf Plattformen wie Hugging Face ermöglichen eine breite Adaption und Weiterentwicklung durch die KI-Community.

    Zusammenfassend lässt sich festhalten, dass Inkling-Small eine Entwicklung darstellt, die den Trend zu effizienteren und anwendbaren KI-Modellen unterstreicht. Für Unternehmen, die eine Balance zwischen Leistung, Kosten und Flexibilität suchen, könnte dieses Modell eine strategisch vorteilhafte Lösung bieten.

    Bibliografie

    - Thinking Machines Lab. (2026, 30. Juli). Introducing Inkling-Small. [Online]. Verfügbar unter: https://thinkingmachines.ai/news/inkling-small/ - Thinking Machines Lab. (o.D.). Inkling-Small Model Card. [Online]. Verfügbar unter: https://thinkingmachines.ai/model-card/inkling-small/ - Bastian, M. (2026, 31. Juli). Thinking Machines bets on efficiency over size with its second model, Inkling Small. The Decoder. [Online]. Verfügbar unter: https://the-decoder.com/thinking-machines-bets-on-efficiency-over-size-with-its-second-model-inkling-small/ - Franzen, C. (2026, 31. Juli). Thinking Machines debuts Inkling Small open source AI model nearing performance of predecessor at about 1/4 size. VentureBeat. [Online]. Verfügbar unter: https://venturebeat.com/technology/thinking-machines-debuts-inkling-small-open-source-ai-model-nearing-performance-of-predecessor-at-about-1-4-size - RuntimeWire. (2026, 30. Juli). Thinking Machines Lab ships Inkling-Small with open weights and lower compute costs. [Online]. Verfügbar unter: https://runtimewire.com/article/thinking-machines-lab-inkling-small-open-weights - Developers Digest. (2026, 31. Juli). Inkling-Small: Thinking Machines Ships a 12B-Active Open Model That Beats Its Big Sibling on Agent Work. [Online]. Verfügbar unter: https://www.developersdigest.tech/blog/inkling-small-open-weights-2026

    Artikel jetzt als Podcast anhören

    Kunden die uns vertrauen:
    Arise Health logoArise Health logoThe Paak logoThe Paak logoOE logo2020INC logoEphicient logo
    und viele weitere mehr!

    Bereit für den nächsten Schritt?

    Das Expertenteam von Mindverse freut sich darauf, Ihnen zu helfen.
    Herzlichen Dank! Deine Nachricht ist eingegangen!
    Oops! Du hast wohl was vergessen, versuche es nochmal.

    🚀 Neugierig auf Mindverse Studio?

    Lernen Sie in nur 30 Minuten kennen, wie Ihr Team mit KI mehr erreichen kann – live und persönlich.

    🚀 Demo jetzt buchen