Skip to main content
  1. Home
  2. Computación
  3. Noticias
  4. Tendencias
  5. News

DeepSeek coder: qué es y cómo funciona

Add as a preferred source on Google
DeepSeek
DTES

¿Cómo se construye el modelo de lenguaje de DeepSeek?, ¿Necesita cierta capacidad de GPU para desarrollarse? y ¿Cómo le va contra la competencia?.

Bueno, comencemos por una definición del DeepSeek coder: DeepSeek-Coder-V2 es un modelo de lenguaje de código abierto Mixture-of-Experts (MoE) que logra un rendimiento comparable al de GPT4-Turbo en tareas específicas de código.

Recommended Videos

En concreto, DeepSeek-Coder-V2 se entrena previamente desde un punto de control intermedio de DeepSeek-V2 con 6 billones de tokens adicionales. A través de este entrenamiento previo continuo, DeepSeek-Coder-V2 mejora sustancialmente las capacidades de codificación y razonamiento matemático de DeepSeek-V2, al tiempo que mantiene un rendimiento comparable en tareas generales del lenguaje. 

DeepSeek Coder comprende una serie de modelos de lenguaje de código entrenados desde cero con un 87 % de código y un 13 % de lenguaje natural en inglés y chino, con cada modelo pre entrenado en tokens 2T. Proporcionamos varios tamaños del modelo de código, que van desde las versiones 1B hasta 33B.

«Cada modelo se entrena previamente en un corpus de código a nivel de repositorio mediante el empleo de un tamaño de ventana de 16K y una tarea adicional de rellenar los espacios en blanco, lo que da como resultado modelos fundamentales (DeepSeek-Coder-Base). Ajustamos aún más el modelo base con 2 mil millones de tokens de datos de instrucción para obtener modelos ajustados a la instrucción, denominados DeepSeek-Coder-Instruct», dicen en DeepSeek.

  • Entrenado previamente en 2 billones de tokens en más de 80 lenguajes de programación.
  • Varios tamaños de modelo (1.3B5.7B6.7B y 33B) para cumplir con diferentes requisitos.
  • Un tamaño de ventana de 16K, que admite la finalización y el relleno de código a nivel de proyecto.
  • Rendimiento de última generación entre modelos de código abierto.
  • Código abierto y gratuito para investigación y uso comercial.

En su sitio de GitHub, DeepSeek afirma que  «Si desea utilizar DeepSeek-Coder-V2 en formato BF16 para la inferencia, se requieren GPU de 80 GB*8».

Rendimiento de DeepSeek coder

En las evaluaciones de referencia estándar, y según ellos mismos muestran, DeepSeek-Coder-V2 logra un rendimiento superior en comparación con los modelos de código cerrado como GPT4-Turbo, Claude 3 Opus y Gemini 1.5 Pro en las pruebas comparativas de codificación y matemáticas:

Imagen utilizada con permiso del titular de los derechos de autor

«DeepSeek-Coder-V2 demuestra avances significativos en varios aspectos de las tareas relacionadas con el código, así como en el razonamiento y las capacidades generales. Además, DeepSeek-Coder-V2 amplía su compatibilidad con lenguajes de programación de 86 a 338, al tiempo que amplía la longitud del contexto de 16K a 128K», dice la compañía china.

ACÁ EL CÓDIGO EN GITHUB DE DEEPSEEK

ACÁ EL CÓDIGO EN GITHUB DE DEEPSEEK
Diego Bastarrica
Diego Bastarrica es Senior Editor y Head of Content en Digital Trends en Español, donde lidera la estrategia editorial, SEO…
La “Jaula de Pájaro” que promete ordenar el caos de ChatGPT
Electronics, Mobile Phone, Phone

ChatGPT puede ser un asistente para investigar, redactar, planificar un viaje, estudiar, generar ideas o resolver dudas cotidianas. El problema aparece cuando todas esas actividades comienzan a convivir dentro de un mismo espacio: una conversación puede pasar de una estrategia de contenidos a una receta, de una investigación periodística a la planificación de unas vacaciones, sin que el usuario advierta que también está cambiando el contexto de trabajo.

La técnica conocida como “Jaula de Pájaro” —o bird cage prompt— propone una solución simple: pedirle a ChatGPT que trate cada proyecto como un espacio independiente y que no utilice información de otros temas, a menos que el usuario lo autorice explícitamente.

Read more
Los mejores navegadores web para 2026
Electronics, Mobile Phone, Phone

Elegir un navegador web solía depender principalmente de la velocidad, las extensiones y lo que viniera instalado en tu ordenador. En 2026, las diferencias son más profundas. Las protecciones de privacidad varían considerablemente, la IA se está filtrando en el propio navegador, y cosas como la gestión de pestañas y la sincronización entre dispositivos pueden afectar al uso diario más que una pequeña ventaja de rendimiento.

Google Chrome sigue siendo nuestra mejor elección global. Su amplia compatibilidad, su enorme biblioteca de extensiones y su estrecha integración con los servicios de Google hacen que sea difícil superarlo como navegador para el día a día. Brave comienza con protecciones de privacidad mucho más fuertes, Firefox te da más control mientras te mantiene fuera del ecosistema Chromium, y Edge presenta un argumento especialmente sólido en Windows.

Read more
Una IA está creando nuevos virus biológicos y abrió una brecha impensada
Virus

Investigadores de la Universidad de Stanford y del Arc Institute utilizaron un modelo de inteligencia artificial para diseñar genomas virales que no coinciden con ningún virus registrado en las bases de datos biológicas. El estudio, publicado en la revista Science, demostró que 16 de las secuencias creadas por el sistema lograron convertirse en bacteriófagos funcionales, es decir, virus capaces de infectar y destruir bacterias.

El modelo utilizado se llama Evo 2 y funciona de manera similar a un sistema de lenguaje generativo, aunque en lugar de analizar palabras trabaja con información genética. La herramienta fue entrenada con millones de secuencias de ADN y, para este experimento, recibió datos de aproximadamente 14.000 genomas virales pertenecientes a la familia Microviridae.

Read more