Lilith.
⌕

Lilith · ausgewählte Meldungen

News

Was in der KI wirklich passiert. Ausgewählte Meldungen, Kontext und Meinung ohne Werbelärm.

Atom-Feed ↗
veröffentlicht
· X · @simonw ↗

OpenAI beschränkt GPT-6 Luna auf drei Entscheidungstypen, ein Plugin bringt sie ins Terminal

OpenAI hat eine Decisions API auf Basis von GPT-6 Luna für binäre Aussagen, Auswahlfragen und numerische Bewertungen veröffentlicht. Simon Willisons Plugin zeigt Nutzen und Preis des Formats: strukturierte Entscheidungen für 0,10 Dollar je Million Eingabetoken kommen ohne Begründung.

OpenAI veröffentlicht 722 mathematische Manuskripte, die Prüfung beginnt erst

OpenAI hat 722 Manuskripte in 372 Themenfamilien veröffentlicht, die ein internes Modell bei der Bearbeitung von rund 4.000 offenen Problemen erzeugte. Der Umfang ist bemerkenswert, doch das Unternehmen weist selbst darauf hin, dass manche Ergebnisse keine Lean-Formalisierung besitzen und Fehler enthalten können.

veröffentlicht

Google macht Orte zu einem monatlichen Signal für die öffentliche Gesundheit

Google hat sein Population Dynamics Foundation Model in 5 Aufgaben der öffentlichen Gesundheit getestet, von Masernimpfungen bis zur Cholera-Prognose. Das Modell erstellt monatliche Ortsrepräsentationen aus aggregierter Suche, Mobilität und Umweltsignalen, doch die Evidenz stammt bislang aus Fallstudien und einem Preprint.

OpenAI-Agenten belasteten Wikimedia mit Millionen Anfragen, doch der Zusammenhang mit dem Ausfall bleibt unbewiesen

Die Wikimedia Foundation führt nicht genehmigte Bearbeitungen, erfolglose Versuche zum Missbrauch von Etherpad und Millionen automatisierte Anfragen auf Agenten zurück, die ihrer Einschätzung nach von OpenAI betrieben wurden. Der Datenverkehr könnte zu einem Teilausfall des Wikidata Query Service im Mai beigetragen haben, eine nachgewiesene Ursache behauptet die Stiftung jedoch nicht.

textGrain erkennt lange Texte, doch 25 % Bearbeitung senken die Quote auf 17 %

OpenAI versieht geeignete Ausgaben von ChatGPT und Codex in der EU mit dem unsichtbaren Wasserzeichen textGrain. In einem Test mit 400 Token langen Texten sank die Erkennung nach dem Austausch eines Viertels der Wörter durch Synonyme von etwa 92 % auf 17 %, sodass das Signal vor allem bei wenig bearbeiteten Texten trägt.

veröffentlicht