La gestión por indicadores puede obstaculizar la excelencia

La gestión de productos y equipos de software basada en indicadores clave de rendimiento puede desviar la atención de los problemas reales y de quienes realizan el trabajo. El autor sostiene que los profesionales dedicados a crear tecnología centran sus reuniones en necesidades, dificultades y soluc

La definición de 'terminado' para desarrolladores de software

Artículo de opinión técnica que reflexiona sobre lo que realmente significa dar por concluido un trabajo en el desarrollo de software. El autor sostiene que 'terminado' es una afirmación sobre la realidad y el valor entregado, no sobre el esfuerzo invertido, y advierte de la trampa frecuente de cons

Notas sobre codificación agéntica desde la isla Galápagos

Dan Luu comparte en una entrada extensa sus reflexiones tras meses de uso intensivo de agentes de programación con IA. El autor describe una experiencia paradójica: cuando un agente falla como lo haría un empleado humano —por ejemplo, Codex inventando un commit responsable de un bug y fabricando un

Antithesis completa el Tetris de NES hasta el «renacimiento» en el nivel 255

Un ingeniero de Antithesis relata cómo la empresa consiguió finalmente «vencer» al Tetris de la NES, un objetivo que persigue desde 2021 y que quedó estancado en el nivel 160 cuando los jugadores adolescentes llevaron el rendimiento humano más allá de lo que su plataforma de pruebas había explorado.

No digas que usas IA para escribir: el aviso de un veterano del software

El consultor de software Michael Bolton (James Bach, detrás del seudónimo) ha publicado un aviso público en el que pide a profesionales y escritores que dejen de afirmar que recurren a inteligencia artificial para redactar sus textos, porque esa afirmación, aunque se formule como una simple 'ayuda',

Reductores de casos de prueba: herramientas de depuración infravaloradas

Los reductores de casos de prueba son herramientas de depuración capaces de reducir automáticamente un fichero de entrada —código fuente, datos de configuración, cualquier texto— hasta conservar únicamente la versión mínima que reproduce un error. Funcionan combinando un programa, una entrada grande

Cómo enseñar a agentes de IA a escribir mejores tests con TDD

Los agentes de IA, en el momento de escribir este artículo, suelen ser malos escribiendo tests: las pruebas que generan tienden a ser vagas, crípticas, excesivamente complicadas, chapuceras, desorganizadas, tautológicas, performativas, superficiales o directamente inútiles. El autor, Jason Swett, at

LLM: Oráculos Ejecutables Mejoran la Calidad del Código

Este artículo explora una técnica prometedora para mejorar la calidad del código generado por modelos de lenguaje grandes (LLMs) como Claude y Codex: el uso de 'oráculos ejecutables' para restringir sus grados de libertad. Actualmente, los LLMs pueden generar código impresionante en tareas muy espec

Bombadil: nueva herramienta automatiza pruebas de UI web

Antithesis ha lanzado 'Bombadil', una nueva herramienta experimental para automatizar las pruebas basadas en propiedades de interfaces de usuario web. La herramienta, disponible desde ahora, explora y valida automáticamente la corrección de las propiedades de la UI, con el objetivo de detectar error

Mejoran pruebas de IA con 'Golden Sets'

Un nuevo método llamado 'Golden Sets' busca mejorar la evaluación y el control de calidad en sistemas de inteligencia artificial, especialmente aquellos con comportamiento probabilístico. Según Ryan Setter, de heavythoughtcloud.com, los 'Golden Sets' no son simples conjuntos de datos, sino coleccion

Integración Continua: Fallar para Aprender

La Integración Continua (CI) es una práctica fundamental en el desarrollo de software que automatiza las comprobaciones después de cada commit de código. Contrariamente a la creencia popular, el verdadero valor de la CI reside en su capacidad para *fallar*. El objetivo principal no es que pase, sino

tldraw: pruebas ahora privadas, ¿por qué el cambio?

La empresa tldraw ha decidido trasladar su conjunto de pruebas (test suite) desde el repositorio de código abierto tldraw/tldraw a un repositorio de código cerrado. Esta decisión, anunciada recientemente en GitHub, afecta a aproximadamente 327 archivos de prueba, incluyendo pruebas unitarias, de int

Escrow: El Secreto Tras los Lanzamientos de Software

En el desarrollo de software, especialmente en grandes proyectos como los de Microsoft, existe un proceso interno llamado "Escrow" (Depósito en custodia) que asegura la calidad y estabilidad de un producto antes de su lanzamiento final (RTM - Release to Manufacturing). Es un concepto poco conocido f

Antítesis Fusiona C++ y Rust para Mejorar Pruebas de Software

Antítesis, una empresa especializada en pruebas de software, ha desarrollado una técnica innovadora para integrar código C++ de un solo hilo con código Rust de múltiples hilos y asíncrono. Esta integración es crucial para su fuzzer, una herramienta que busca vulnerabilidades en software mediante la

Kernighan on Programming

Este artículo reflexiona sobre la importancia de las pruebas de software, basándose en la experiencia del autor en diversos entornos, desde el desarrollo de comercio electrónico hasta la industria aeroespacial. Inicialmente, el autor cuestiona la efectividad de las pruebas automatizadas, especialmen