Neue KI-Modelle
Google veröffentlicht DiffusionGemma 26B als Open-Weight-Modell
Google hat DiffusionGemma 26B unter Apache 2 Lizenz als Open-Weight-Modell veröffentlicht, basierend auf der experimentellen Gemini Diffusion-Technologie vom Mai 2024. Das Modell erreicht über 500 Token/Sekunde und ist derzeit kostenlos über NVIDIAs NIM Cloud API verfügbar.
Mehr lesen →
Claude Fable 5 verweigert einfache Biologie-Fragen trotz beworbener Expertise
Anthropics neues Flaggschiff-Modell Claude Fable 5 wird als besonders stark in Biologie beworben, weigert sich jedoch, grundlegende Biologie-Fragen zu beantworten, die Schüler bewältigen könnten. Stattdessen leitet das Modell solche Anfragen an das vorherige Flaggschiff-Modell weiter.
Mehr lesen →
Decart veröffentlicht Oasis 3: Photorealistische Fahrsimulation in Echtzeit
Decart hat Oasis 3 vorgestellt, ein Echtzeit-Weltmodell, das photorealistische Fahrumgebungen für autonome Fahrzeuge generiert. Das Modell ist über eine API für Entwickler verfügbar und kann stundenlang realistische Fahrsituationen simulieren.
Mehr lesen →Nemotron 3.5 Content Safety: Anpassbare multimodale KI-Sicherheit für Unternehmen
Hugging Face kündigt Nemotron 3.5 Content Safety an, ein multimodales Sicherheitsmodell für Unternehmens-KI-Anwendungen. Das System bietet anpassbare Sicherheitsfilter für verschiedene globale Märkte und Compliance-Anforderungen.
Mehr lesen →Reve 2 und Ideogram 4: Neue Layout-Features in der Bildgenerierung
Zwei neue Bildgenerierungs-Modelle wurden angekündigt: Reve 2 und Ideogram 4, die beide verbesserte Layout-Funktionalitäten für die KI-basierte Bilderstellung bieten.
Mehr lesen →
Microsoft stellt MAI-Thinking-1 und MAI-Modellfamilie vor
Microsoft hat auf der Build-Konferenz neue MAI-Modelle angekündigt, darunter MAI-Thinking-1 mit erweiterten Reasoning-Fähigkeiten. Die MAI-Familie umfasst mehrere spezialisierte Modelle für verschiedene Anwendungsfälle.
Mehr lesen →Microsoft stellt MAI-Thinking-1 und MAI-Code-1-Flash vor
Microsoft hat zwei neue LLMs angekündigt: MAI-Thinking-1 (1T Parameter, 35B aktiv) für Reasoning und MAI-Code-1-Flash (137B Parameter, 5B aktiv) speziell für GitHub Copilot. Beide Modelle nutzen Mixture-of-Experts-Architektur und wurden auf lizenzierten Daten trainiert.
Mehr lesen →
Microsoft stellt erstes Reasoning-Modell MAI-Thinking-1 vor
Microsoft hat auf der Build 2026 sein neues Flaggschiff-Modell MAI-Thinking-1 angekündigt, das fortgeschrittene Reasoning-Fähigkeiten bietet. Dies markiert einen wichtigen Schritt in Microsofts eigener KI-Modellentwicklung, nachdem das Unternehmen seine Abhängigkeit von OpenAI reduziert hat.
Mehr lesen →Holo 3.1: Schnelle lokale Computer-Use-Agenten von Hugging Face
Hugging Face hat Holo 3.1 vorgestellt, ein System für schnelle und lokal ausführbare Computer-Use-Agenten. Das System ermöglicht es KI-Modellen, direkt mit Computer-Interfaces zu interagieren und Aufgaben lokal ohne Cloud-Abhängigkeit auszuführen.
Mehr lesen →
NVIDIA veröffentlicht Cosmos 3, Nemotron 3 Ultra und RTX Spark
NVIDIA hat drei neue KI-Modelle vorgestellt: Cosmos 3 für physikalische Simulation, Nemotron 3 Ultra als fortschrittliches Sprachmodell und RTX Spark als neue GPU-optimierte KI-Technologie. Die Veröffentlichungen unterstreichen NVIDIAs Position als führender Anbieter von KI-Hardware und -Software.
Mehr lesen →
JetBrains veröffentlicht Mellum2: 12B Mixture-of-Experts Modell
JetBrains hat Mellum2 vorgestellt, ein 12 Milliarden Parameter starkes Mixture-of-Experts (MoE) Sprachmodell. Das Modell wurde speziell für Code-Aufgaben entwickelt und soll Entwicklern bei der Programmierung helfen.
Mehr lesen →
NVIDIA Cosmos 3: Erstes offenes Omni-Modell für physikalische KI-Anwendungen
NVIDIA hat Cosmos 3 vorgestellt, das erste offene Omni-Modell, das speziell für physikalische KI-Anwendungen und Aktionsplanung entwickelt wurde. Das Modell kombiniert verschiedene Modalitäten und zielt auf robotische und embodied AI-Systeme ab.
Mehr lesen →
Claude Opus 4.8: Anthropic liefert bescheidenes, aber spürbares Update
Anthropic hat Claude Opus 4.8 veröffentlicht und bewirbt es ehrlich als "bescheidene aber spürbare Verbesserung". Das Update fokussiert sich hauptsächlich auf verbesserte Ehrlichkeit und weniger Halluzinationen, sowie neue Features wie Mid-Conversation System Messages.
Mehr lesen →
Anthropic veröffentlicht Claude Opus 4.8 mit verbesserter 'Ehrlichkeit'
Anthropic veröffentlicht am Donnerstag Claude Opus 4.8, ein neues KI-Modell, das weniger zu voreiligen Schlüssen neigt und ehrlicher zugibt, wenn es unsicher ist. Das Unternehmen hat das Training darauf ausgelegt, dass das Modell keine unbelegbaren Behauptungen aufstellt.
Mehr lesen →
Google stellt neues universelles KI-Modell für beliebige Eingabe-Ausgabe-Kombinationen vor
Google hat ein neues KI-Modell vorgestellt, das beliebige Eingaben in beliebige Ausgaben umwandeln kann. Das Modell ermöglicht vielseitige multimodale Anwendungen, wie das Erstellen von Deepfake-Videos aus Fotos von Kuscheltieren.
Mehr lesen →Google I/O 2026: Gemini 3.5 Flash, Omni, Spark und Antigravity 2.0
Google kündigte auf der I/O 2026 mehrere neue KI-Modelle und Features an: Gemini 3.5 Flash, Omni für Video-Verarbeitung, Spark für Hintergrund-Agenten und Antigravity 2.0.
Mehr lesen →
Google veröffentlicht Gemini 3.5 Flash mit deutlich höheren Preisen
Google hat Gemini 3.5 Flash bei der I/O-Konferenz veröffentlicht und direkt in viele Kernprodukte integriert. Das neue Modell kostet jedoch 3x mehr als der Vorgänger Gemini 3 Flash Preview und 6x mehr als Gemini 3.1 Flash-Lite.
Mehr lesen →
OlmoEarth v1.1: Neue effiziente Modellfamilie von Hugging Face
Hugging Face hat OlmoEarth v1.1 veröffentlicht, eine neue Version ihrer Open-Source-Modellfamilie mit verbesserter Effizienz. Die Modelle wurden für bessere Performance bei geringerem Ressourcenverbrauch optimiert.
Mehr lesen →
Google I/O 2026: Gemini 3.5 Modell-Familie und Project Aura Smart Glasses angekündigt
Auf der Google I/O 2026 stellte Google eine neue Gemini 3.5 AI-Modell-Familie vor, kündigte neue Features für Search und Gmail an und gab Updates zu den Project Aura Smart Glasses bekannt. Die Keynote war erneut von KI-bezogenen Ankündigungen geprägt.
Mehr lesen →
PaddleOCR 3.5 mit Transformers-Backend für OCR und Dokumentenanalyse
PaddleOCR 3.5 wurde veröffentlicht und unterstützt nun ein Transformers-Backend für OCR- und Dokumentenanalyse-Aufgaben. Die neue Version ermöglicht eine nahtlose Integration mit dem Hugging Face Transformers-Ökosystem.
Mehr lesen →KI-News direkt ins Postfach
Jeden Morgen um 8:30 Uhr — die wichtigsten KI-Nachrichten zusammengefasst.