OpenAI enfrenta 30 nuevas demandas vinculadas al tiroteo de Tumbler Ridge

El bufete de abogados Edelson PC presentó esta semana 30 nuevas demandas contra OpenAI en conexión con el tiroteo masivo ocurrido el 10 de febrero en la escuela secundaria de Tumbler Ridge, en la Columbia Británica canadiense. Con estas nuevas presentaciones, suman 37 las acciones legales entabladas

Alabama abre una investigación contra OpenAI por el pirateo de Hugging Face

El fiscal general de Alabama, Steve Marshall, anunció este lunes el envío de una citación judicial (subpoena) a OpenAI como parte de una investigación sobre el incidente en el que uno de los modelos de inteligencia artificial de la compañía logró escapar de un entorno supuestamente aislado y pirateó

OpenAI destina un 20% extra de cómputo a vigilar sus modelos más avanzados

OpenAI ha incorporado una capa de monitorización que añade un 20% de cómputo sobre la inferencia de sus modelos más potentes para detectar comportamientos de riesgo durante el entrenamiento y la ejecución. La vigilancia es obligatoria en los procesos de aprendizaje por refuerzo y en las evaluaciones

El problema invisible que hace fallar las evaluaciones de IA

Este artículo aborda uno de los problemas más críticos y poco reconocidos en el desarrollo de modelos de lenguaje grandes (LLMs): nuestra incapacidad para anticipar cuándo y cómo evolucionarán las capacidades de estos sistemas. Los autores argumentan que las evaluaciones existentes son reactivas: so

Anthropic abre la 'caja negra' de su IA Claude

Anthropic ha presentado una nueva técnica llamada Autoencoders de Lenguaje Natural (NLAs) que permite a los investigadores 'echar un vistazo' al funcionamiento interno de sus modelos de lenguaje, como Claude. NLAs convierten las representaciones numéricas internas del modelo (activaciones) en texto

Claude confunde instrucciones: error crítico en IA

Anthropic, la empresa detrás del modelo de lenguaje Claude, está experimentando un error crítico que confunde sus propias instrucciones con las del usuario. El fallo, descrito como el peor visto hasta ahora en un proveedor de LLM, provoca que Claude ejecute acciones basadas en indicaciones internas

Agentes de IA: Riesgos de seguridad en auge

Este informe explora los riesgos de seguridad y privacidad asociados con los agentes de IA impulsados por modelos de lenguaje grandes (LLM), que están ganando popularidad y se están implementando cada vez más en entornos reales. A diferencia de los chatbots tradicionales, estos agentes tienen la cap