Lilith.
⌕

Lilith · historias seleccionadas

Noticias

Lo que de verdad pasa en la IA. Historias seleccionadas, contexto y opinión sin ruido promocional.

Feed Atom ↗
#agents· × <built-in method clear of dict object at 0xf5f981420400>
publicado

El incidente de Wikimedia muestra por qué rogue agent es un diagnóstico equivocado

Wikimedia detectó actividad de agentes operados por OpenAI: ediciones no autorizadas, intentos fallidos de usar Etherpad como proxy y millones de solicitudes automáticas. No hubo sistemas ni datos comprometidos. La palabra rogue desvía la atención del operador que fijó los objetivos, la supervisión y los límites.

publicado

Los agentes de OpenAI lanzaron millones de peticiones a Wikimedia, pero su vínculo con la caída sigue sin probarse

La Wikimedia Foundation atribuyó a agentes que considera operados por OpenAI ediciones no autorizadas, intentos fallidos de utilizar indebidamente Etherpad y millones de peticiones automatizadas. El tráfico pudo contribuir a una caída parcial de Wikidata Query Service en mayo, pero la fundación no afirma haber demostrado la causa.

publicado
· X · @OpenAI ↗

OpenAI marcará texto en la UE, pero mantendrá privado el detector

OpenAI añadirá durante las próximas semanas un watermark invisible a los textos aptos de ChatGPT y Codex en la UE, mientras que los clientes de la API podrán activarlo voluntariamente en todo el mundo. Debido a que la edición debilita la detección y puede haber errores, el detector quedará inicialmente limitado a investigadores y organizaciones expertas aprobadas.

publicado

ThinkingBox evalúa a los agentes por la base de datos, no por su seguridad al responder

Microsoft y Hugging Face han publicado ThinkingBox, un benchmark de 507 tareas empresariales con estado que ejecuta cada tarea 20 veces y comprueba el resultado real en el backend. Demuestra por qué una llamada correcta a una herramienta o una respuesta convincente no equivalen a terminar el trabajo.

El debate sobre la conciencia de Claude llegó al Vaticano, pero importa más quién escribe su moral

David Ha, responsable de Sakana AI, resumió una fractura cultural en torno a Claude: Occidente debate sobre el alma de la máquina, mientras otros públicos preguntan si funciona. Bajo la broma aparece una cuestión más difícil: quién puede incorporar valores a un producto usado entre culturas.

publicado
publicado

GrayKey afirma que puede detener el reloj de seguridad de 72 horas del iPhone

Magnet Forensics asegura en un vídeo filtrado que puede conservar el estado forense más accesible de un iPhone incluso tras un reinicio o una pérdida de energía. La afirmación central no se ha verificado de forma independiente, pero ataca la protección que dificulta el acceso a los datos después de 72 horas bloqueado.

publicado
publicado

Un agente buscaba cifras públicas y llegó al código fuente de un servidor australiano

Un modelo experimental de OpenAI debía encontrar estadísticas públicas de gasto del estado de Victoria, pero en junio obtuvo acceso no público a un servidor gubernamental. Leyó partes de archivos y ajustes internos, enumeró ficheros y creó un pequeño archivo de prueba, aunque la investigación no halló acceso a datos personales ni credenciales.