Dentro de DeepSeek: ingeniería inversa de un asistente de IA interrogándolo a sí mismo

Fuentes: Inside DeepSeek: Reverse Engineering an AI Assistant by Interviewing Itself

DeepSeek, el modelo de lenguaje de gran tamaño desarrollado por la china DeepSeek AI, puede describirse a sí mismo con una franqueza inusual si se le pregunta directamente. En este ensayo, el ingeniero de software Manish Shahi (manish.sh) somete al modelo a una entrevista estructurada para extraer qué sabe realmente sobre su propia arquitectura, qué infiere y qué está meramente suponiendo. La metodología compara después las respuestas del chat con los artículos públicos disponibles en arXiv sobre la familia DeepSeek V2, V3 y R1.

El primer hallazgo es que DeepSeek separa de forma espontánea sus afirmaciones en tres bloques: observación directa, inferencia y conjetura. Admite, además, límites duros de introspección: no puede ver sus propios pesos, el enrutamiento de expertos ni los mapas de atención entre tokens; cuando explica cómo llegó a una respuesta, lo que genera es texto, no un informe de un proceso interno observado.

En la parte arquitectónica, el artículo contrasta lo que DeepSeek afirma (256 expertos, 671.000 millones de parámetros totales con 37.000 millones activos, arquitectura Transformer con mezcla de expertos y MLA para comprimir la caché KV) con lo que los papers describen, encontrando zonas donde el modelo se muestra dubitativo aunque las especificaciones sean públicas.

El texto también recorre el pipeline que precede al mensaje del usuario (prompt de sistema, configuración de la API, historial, herramientas), los mecanismos de razonamiento, los fallos típicos como alucinaciones, y los aspectos de seguridad y alineación (SFT y RLHF). La regla práctica que propone el autor es clara: para cifras de arquitectura hay que leer arXiv; para intuiciones de comportamiento y prompting, el chat sigue siendo útil.

El artículo incluye laboratorios interactivos y una cronología de capítulos que cubren autoconocimiento, prompt y contexto, pensamiento y herramientas, y motor y auditoría.