Lilith.
⌕

Lilith · ausgewählte Meldungen

News

Was in der KI wirklich passiert. Ausgewählte Meldungen, Kontext und Meinung ohne Werbelärm.

Atom-Feed ↗
#agents· × <built-in method clear of dict object at 0xf5f988521140>
veröffentlicht

Goodfire überwacht Agenten im Modell und will Kosten von 10.000 auf 51 Dollar gesenkt haben

Goodfire setzt bei Baseten Kunden kleine Klassifikatoren ein, die Modellaktivierungen lesen und verdächtige Fälle an einen teureren KI Prüfer weiterreichen. Im eigenen Test mit Kimi K3 meldet das Unternehmen eine Erkennung von 94 % der schädlichen Sitzungen, benötigt dafür aber Zugriff auf das Innere des jeweiligen Modells.

veröffentlicht
veröffentlicht

OpenAI-Agenten belasteten Wikimedia mit Millionen Anfragen, doch der Zusammenhang mit dem Ausfall bleibt unbewiesen

Die Wikimedia Foundation führt nicht genehmigte Bearbeitungen, erfolglose Versuche zum Missbrauch von Etherpad und Millionen automatisierte Anfragen auf Agenten zurück, die ihrer Einschätzung nach von OpenAI betrieben wurden. Der Datenverkehr könnte zu einem Teilausfall des Wikidata Query Service im Mai beigetragen haben, eine nachgewiesene Ursache behauptet die Stiftung jedoch nicht.

veröffentlicht
· X · @OpenAI ↗

OpenAI markiert Texte in der EU, hält den Detektor aber unter Verschluss

OpenAI versieht geeignete Texte aus ChatGPT und Codex in der EU in den kommenden Wochen mit einem unsichtbaren Watermark, während API Kunden es weltweit freiwillig aktivieren können. Weil Bearbeitungen die Erkennung schwächen und Fehlurteile möglich sind, bleibt der Detektor zunächst zugelassenen Forschern und Fachorganisationen vorbehalten.

veröffentlicht

ThinkingBox bewertet Agenten nach dem Datenbankzustand statt nach selbstsicheren Antworten

Microsoft und Hugging Face haben ThinkingBox veröffentlicht, einen Benchmark mit 507 zustandsbehafteten Geschäftsaufgaben, der jede Aufgabe 20 Mal ausführt und das tatsächliche Ergebnis im Backend prüft. Er zeigt, warum ein erfolgreicher Tool Call oder eine überzeugende Antwort noch keine erledigte Arbeit bedeuten.

Die Debatte über Claudes Bewusstsein erreicht den Vatikan, doch wichtiger ist, wer seine Moral schreibt

Sakana AI Chef David Ha brachte einen kulturellen Konflikt um Claude auf den Punkt: Im Westen wird über die Seele der Maschine diskutiert, während andere vor allem nach ihrem Nutzen fragen. Hinter dem Witz steckt die schwierigere Frage, wer einem weltweit genutzten Produkt Werte einschreiben darf.

veröffentlicht
veröffentlicht