La documentación oficial de DeepSeek detalla cómo invocar sus modelos mediante la Responses API, el formato introducido por OpenAI y soportado por herramientas como Codex. El endpoint base es https://api.deepseek.com y basta con apuntar el SDK de OpenAI hacia esa URL, indicando la clave de DeepSeek, para empezar a usar los modelos deepseek-v4-flash y deepseek-v4-pro.
La guía explica paso a paso la integración con Codex y la realización de llamadas, incluido el modo de streaming con eventos SSE. Cada evento lleva un campo type y un sequence_number incremental, y la transmisión finaliza con response.completed, response.incomplete o response.failed; no existe un mensaje data: [DONE] como en otras APIs.
El documento también recoge una tabla completa de compatibilidad de parámetros y elementos de entrada. La API admite temperature, top_p, max_output_tokens, top_logprobs, tools (function y web_search), tool_choice y reasoning.effort; otros parámetros como previous_response_id, conversation, store, background, metadata, include, prompt, truncation, service_tier o stream_options no están soportados. Los parámetros no admitidos se ignoran sin generar errores, lo que permite conectar clientes existentes sin modificarlos.
En cuanto a tipos de entrada, son compatibles message (incluido developer, tratado como system), function_call, function_call_output, reasoning y web_search_call; las entradas de imagen o archivo se sustituyen por un marcador. En herramientas, además de function y web_search, solo se admite el custom tool apply_patch, necesario para mantener la compatibilidad con Codex. El objeto de respuesta mantiene la estructura de OpenAI y devuelve el uso de tokens en usage, con campos para tokens de entrada, tokens en caché, tokens de salida y reasoning_tokens.
