La censura política no se transfiere al destilar un modelo chino

Un equipo de CTGT Inc. publica LineageEval, un conjunto de 304 prompts (152 pares emparejados) diseñado para medir si un modelo destilado hereda los sesgos de censura de su modelo profesor. El trabajo compara a DeepSeek V4 Flash, un modelo de frontera chino conocido por rehuir y reformular temas sen

LinkedIn congela la inversión en centros de datos durante un año

LinkedIn ha decidido no ampliar este año fiscal sus centros de datos ni aumentar su inversión en GPUs, en un movimiento que contrasta con el gasto agresivo de otras grandes tecnológicas en infraestructura para inteligencia artificial. Los ejecutivos de la red social profesional, propiedad de Microso

Optimizador de modelos a partir de trazas de agentes

La herramienta world-model-optimizer (WMO) permite mejorar continuamente modelos de lenguaje a partir de las trazas de agentes. Ofrece un punto final de modelo con calidad de frontera a un costo 40% menor. El flujo de trabajo incluye registrar proveedores, ajustar un enrutador basado en trazas OTel,

Alibaba prohíbe a sus empleados usar Claude Code por riesgos de seguridad

El gigante chino del comercio electrónico Alibaba prohibirá a sus empleados utilizar la herramienta de programación Claude Code, desarrollada por Anthropic, a partir del 10 de julio. La medida, confirmada por múltiples medios, responde a la clasificación de Claude Code como software de alto riesgo p

Anthropic rectifica las restricciones ocultas de Claude Fable 5

Anthropic se disculpó por implementar restricciones ocultas en su nuevo modelo Claude Fable 5, diseñadas para impedir la destilación, una técnica que permite entrenar modelos más pequeños a partir de las salidas de uno grande. La medida, que degradaba las respuestas sin avisar, afectaba a investigad