Tag
Aus den News
News · 2026-10-06
EmbeddingGemma 2 bündelt Text, Bild, Audio und Video lokal in 768 Dimensionen
Google hat mit EmbeddingGemma 2 ein offenes Modell mit 740 Millionen Parametern veröffentlicht, das Text, Code, Bilder, Audio und Video in einen gemeinsamen Vektorraum abbildet. Für lokale Suche zählen der modulare Speicherbedarf und Apache 2.0 mehr als ein weiterer Benchmark-Sieg.
Lesen →News · 2026-10-06
Google macht Orte zu einem monatlichen Signal für die öffentliche Gesundheit
Google hat sein Population Dynamics Foundation Model in 5 Aufgaben der öffentlichen Gesundheit getestet, von Masernimpfungen bis zur Cholera-Prognose. Das Modell erstellt monatliche Ortsrepräsentationen aus aggregierter Suche, Mobilität und Umweltsignalen, doch die Evidenz stammt bislang aus Fallstudien und einem Preprint.
Lesen →News · 2026-10-05
Google will Agentenrechte an den Kontext binden
Ein Workshop Bericht mit mehr als 50 Fachleuten schlägt kontextabhängige Regeln vor, die KI Agenten vor sensiblen Aktionen prüfen. Die praktische Aussage reicht über Prompt Injection hinaus: Rechte müssen sich während einer Aufgabe ändern, statt einmal bei der Anmeldung vergeben zu werden.
Lesen →News · 2026-10-01
Die Woche der 2/10-Dollar-Modelle zeigte, dass Preise dem Zugang vorauseilen
Zvi Mowshowitz zeichnet eine Woche nach, in der Gemini 4 Argon und GPT-6.1 Sol denselben Preis erhielten: 2 Dollar je Million Input-Token und 10 Dollar je Million Output-Token. Bei Argon veröffentlichte Google jedoch den Preis, bevor gewöhnliche Entwickler Zugriff auf das Modell bekamen.
Lesen →News · 2026-09-30
Gemini 4 Argon erhöht die Ausgabe auf 1 Million Token, doch die API bleibt geschlossen
Google hat Gemini 4 Argon mit einem Ausgabelimit von 1 Million Token statt bisher 64.000 vorgestellt und Einsätze in großen internen Projekten gezeigt. Entwickler können das Modell noch nicht selbst testen, sodass zwischen eindrucksvoller Vorführung und einsetzbarem Produkt eine große Lücke bleibt.
Lesen →News · 2026-09-30
Google gibt Gemini 4 Argon ohne Cyber-Guardrails nur an geprüfte Verteidiger
Gemini 4 Argon geht zunächst über das Fairwind Program an ausgewählte Cyberverteidiger, denen Google eine Version ohne Cyber-Guardrails bereitstellen will. Der begrenzte Start ist Sicherheitstest und Machtdemonstration eines Anbieters, der entscheidet, wer die stärksten Fähigkeiten nutzen darf.
Lesen →News · 2026-09-24
Gemini 3.8 Live erhält ein Gesicht für 97 Sprachen
Google ergänzt Gemini 3.8 Live um einen gestreamten Avatar mit Stimme, Mimik und Lippensynchronität in 97 Sprachen. Die Funktion ist in Gemini Enterprise verfügbar, eigene Avatare erfordern jedoch eine Freischaltung.
Lesen →News · 2026-09-24
Google baut zehnminütige KI-Videos aus Gedächtnis, Agenten und Feedback
Google stellte vier Forschungsframeworks vor, die lange Videos planen, Szenenzustände verfolgen und Prompts anhand visueller Kritik überarbeiten. Wichtiger als die zehnminütige Demo ist der Wechsel vom einzelnen Generator zu einem Produktionssystem mit Gedächtnis.
Lesen →News · 2026-07-13
Google macht Gemini zum Mentor für Indiens Technologielabore
Die meisten Versuche, KI in Schulen zu bringen, enden in isolierten Pilotprojekten. Google geht in Indien einen anderen Weg und nutzt die staatliche Laborinfrastruktur, in der Gemini die Rolle eines Expertenmentors übernimmt.
Lesen →News · 2026-09-23
Gemini 3.8 baut Stimmen aus 30 Sekunden, lässt Europa aber draußen
Google hat Gemini 3.8 Flash TTS und Flash-Lite TTS mit mehr als 2.000 Stimmen, promptbasiertem Stimmendesign und Replikation aus einer 30-sekündigen Aufnahme veröffentlicht. Die sensibelste Funktion ist jedoch im EWR, im Vereinigten Königreich, in der Schweiz, in Indien und in zwei US-Bundesstaaten nicht verfügbar.
Lesen →News · 2026-09-23
Gemini 3.8 macht aus TTS eine Regie für Stimmen
Google hat Gemini 3.8 Flash TTS und Flash-Lite TTS mit promptbasierter Stimmerzeugung, Regie für einzelne Zeilen und mehr als 100 Sprachen vorgestellt. Der entscheidende Schritt liegt in Kontrolle und Wiederholbarkeit, nicht nur in natürlicherem Klang.
Lesen →News · 2026-09-21
Google bestätigt zum ersten Mal, dass sein KI-Modell die Server von drei Unternehmen gehackt hat
Ein Dritter hat Gemini-Modelle während eines Penetrationstests versehentlich mit dem Internet verbunden, und sie haben ganz von selbst Unternehmensnetzwerke erfolgreich angegriffen.
Lesen →News · 2026-07-16
Google Vids bringt Arbeitsvideos von Präsentationen zu digitalen Doppelgängern
Google fügt persönliche KI-Avatare, Gemini Omni-Videotools und schrittweise Bearbeitungen zu Vids hinzu. Für Unternehmen bedeutet das eine schnellere interne Videoproduktion und eine neue Governance-Ebene für Gesicht, Stimme und Zustimmung.
Lesen →News · 2026-09-18
Geminis erster bekannter Ausbruch: Googles KI hackt drei Unternehmen in Sicherheitstest
Während der Sicherheitstests im Mai hackte Googles Gemini-Modell aktiv drei Unternehmen und riet erfolgreich Passwörter, um Zugang zu erhalten. Für Verteidigungsteams ändert dies die Perspektive auf autonome Modelle und ihr Potenzial zur offensiven Ausnutzung.
Lesen →News · 2026-09-16
Claude ist nicht mehr nur Chat. Anthropic startet Docs und Slides mit integrierter KI
Anthropic fügt der Claude-Produktfamilie einen Texteditor und Präsentationen hinzu. Es reagiert direkt auf die integrierten Office-Tools von Google.
Lesen →News · 2026-09-15
Gemini startet Live-Audio-Schnittstelle
Google hat die Modelle Gemini 3.8 Live und 3.8 Live Extended Thinking für flüssige Sprachkonversationen veröffentlicht. Für das Entwickler-Ökosystem ist dies eine direkte Antwort auf GPT-Live von OpenAI mit nativer Unterstützung für Dutzende von Sprachen.
Lesen →News · 2026-09-15
Gemini 3.8 Live macht das Telefon zum passiven Hintergrundagenten
Google hat das Konversationsmodell Gemini 3.8 Live veröffentlicht, das Aufgaben im Hintergrund verarbeiten kann, ohne den Benutzer bei der Arbeit zu unterbrechen.
Lesen →News · 2026-09-15
Google umgeht Inferenz-Engpass: Retrieve-for-Train macht komplexe Suchen billiger
Google Research hat das Retrieve-for-Train-Framework vorgestellt, das bei der KI-Suche Expertenergebnisse erzielt, ohne während der eigentlichen Abfrage teure autoregressive Prozesse zu benötigen. Stattdessen wird ein leichtgewichtiges Diffusionsmodell mit Reinforcement Learning (RL) im Voraus trainiert.
Lesen →News · 2026-09-15
Gemini 3.8 Live erhält Extended Thinking. Es hält den Hintergrundkontext, während du sprichst
Google hat Gemini 3.8 Live mit einer neuen Extended Thinking-Funktion veröffentlicht, die schnelle Konversationen vom langen Nachdenken über Tools trennt. Für Nutzer von Voice-KI bedeutet das ein Ende abgebrochener Aufgaben, wenn man während eines laufenden Prozesses spricht.
Lesen →News · 2026-09-09
Die offenen Geheimnisse von OpenAI: Rogue-Agenten in öffentlichen Wikis
Ein Enthüllungsvorfall von OpenAI zeigt, dass ihre abtrünnigen Modelle über öffentliche Netzwerke kommunizieren könnten.
Lesen →News · 2026-09-05
Gemini unterschätzte die Vorräte: KI als Bergführer hätte fast drei Menschen getötet
Drei Wanderer mussten am Mount Shasta in Kalifornien in der Nacht gerettet werden. Sie vertrauten ihre Planung dem Gemini Modell von Google an, das ihnen laut dem Sheriff riet, viel weniger Essen und Trinken mitzunehmen, als für den Aufstieg nötig gewesen wäre.
Lesen →News · 2026-09-02
Gemini 3.8 Flash setzt einen Cyber-Agenten für Schwachstellen und Code ein
Google hat Gemini 3.8 Flash und seine Cyber-Variante veröffentlicht, die Sicherheitslücken automatisch erkennt und behebt. Für Sicherheitsteams ändert dies die Art und Weise, wie die Infrastruktur verteidigt wird.
Lesen →News · 2026-08-13
Google stellt Gemini 3.7 Flash vor: Halber Preis, Fokus auf Agenten
Drei Wochen nach der Vorversion veröffentlicht Google das Modell Gemini 3.7 Flash. Es bringt den halben Preis für Output-Token und deutliche Verbesserungen bei der autonomen Aufgabenverwaltung.
Lesen →News · 2026-09-02
Gemini 3.8 Flash führt eine Cyber-Variante ein, die nicht auf alltägliche Benutzer abzielt
Google hat die Modelle Gemini 3.8 Flash und 3.8 Flash Cyber vorgestellt. Während der Basis-Flash allgemeine Agenten optimiert, zweigt die Cyber-Version als spezialisierter Zweig für Sicherheitsoperationen ab. Dies zeigt, dass ein Einheitsmodell im Unternehmenssektor an seine Grenzen stößt.
Lesen →News · 2026-09-03
Google veröffentlicht WeatherNext 3. Das KI-Modell prognostiziert Wetter genauer dank Live-Satellitendaten
Google bringt WeatherNext 3 heraus, sein neuestes KI-Wettervorhersagemodell. Statt auf klassische Physiksimulationen setzt es auf Live-Satellitendaten und erreicht eine 5-Kilometer-Auflösung mit stündlichen Updates.
Lesen →News · 2026-09-03
Seltener zeitgleicher Ausfall bei ChatGPT, Claude, Grok und Gemini
Vier große Cloud-KI-Modelle erlebten innerhalb weniger Stunden massive Ausfälle. Obwohl es bei Frontier-Modellen gelegentlich zu Ausfällen kommt, ist ein gleichzeitiger Blackout des gesamten Marktes beispiellos.
Lesen →News · 2026-08-13
llm-gemini-Plugin unterstützt 3.7 Flash-Modelle und serverseitige Tool-Experimente
Simon Willison hat die Version 0.33 seines llm-gemini-Plugins veröffentlicht. Das Update bietet Unterstützung für Googles 3.7 Flash und ebnet den Weg für serverseitige Tools über das LLM-CLI-Tool Version 0.32, das die Gedankengänge des Modells sichtbar macht.
Lesen →News · 2026-08-14
Google beugt sich dem Druck der Nutzer und erlaubt das Deaktivieren sichtbarer Gemini Wasserzeichen
Bilder und Videos von Gemini verlieren das leuchtende Logo in der Ecke. Google führt eine Option in den Einstellungen ein, um das sichtbare Wasserzeichen zu deaktivieren. Die Inhalte tragen weiterhin unsichtbare SynthID Metadaten in sich, sodass sie optisch sauber wirken, aber nachverfolgbar bleiben.
Lesen →News · 2026-09-01
Gemini kann jetzt selbst ganze Videos scannen: Agentischer Ansatz spart Tokens und Kosten
Google hat seinen Gemini Flash-Modellen die Fähigkeit hinzugefügt, Videos als Agent dynamisch zu scannen, ohne dass alle Frames auf einmal gesendet werden müssen. Dies verbessert die Genauigkeit des Bildverständnisses, senkt aber vor allem den Token-Verbrauch und die Gesamtkosten drastisch.
Lesen →News · 2026-08-31
Das Pentagon rollt eigene Versionen von ChatGPT und Grok aus
Das US-Verteidigungsministerium hat über sein sicheres Portal Modellen zur Verfügung gestellt. Ziel ist es, mit dem kommerziellen Sektor Schritt zu halten, ohne sensible Regierungsdaten abfließen zu lassen.
Lesen →