DeepSeek V4 Pro 0813 disponible con pesas de 1.7 billones de parámetros

Hecho Qué ha ocurrido
DeepSeek ha lanzado el modelo V4 Pro 0813, disponible únicamente a través de API en OpenRouter. Las pesas del modelo (1.7 billones de parámetros, 893 GB) están ahora disponibles en Hugging Face, continuando con el patrón de liberación abierta de versiones anteriores (V4-Pro de abril y V4-Flash de julio). El lanzamiento carece de anuncio oficial en canales convencionales de DeepSeek.
Resumen generado mediante IA a partir de Simon Willison (original en inglés). Naturaleza de la información: hecho documentado.
Análisis Por qué importa
La iteración regular de DeepSeek mantiene la presión competitiva en el mercado de grandes modelos de lenguaje y su estrategia de código abierto amplía el acceso a capacidades avanzadas de razonamiento a desarrolladores fuera de ecosistemas propietarios. El cambio visual en la generación de imágenes según el nivel de razonamiento sugiere mejoras arquitectónicas en la alineación entre razonamiento y generación multimodal.
- Quién se ve afectado
- Desarrolladores, investigadores en IA, empresas que construyen aplicaciones con LLM, y proveedores de APIs que buscan modelos alternativos a OpenAI.
- Qué puede cambiar
- La disponibilidad de pesas abiertas permite que organizaciones sin acceso a APIs proprietarias ejecuten el modelo localmente, reduciendo costes operacionales y dependencia de terceros. El acceso consistente a nuevas versiones en Hugging Face acelera la adopción en ámbitos académicos y de código abierto.
Análisis generado a partir de la información disponible; no procede de la fuente.
Predicción Qué observar a continuación
Rendimiento comparativo del V4 Pro 0813 respecto a Claude 3.5 Sonnet y GPT-4o en benchmarks estándar (aunque DeepSeek distribuye resultados de forma poco convencional). Adopción en plataformas como Hugging Face y LM Studio. Tiempo entre lanzamiento de versión Flash y Pro (estructura de diferenciación de precios).
Recomendación Qué debería hacer una empresa
Equipos técnicos deberían evaluar el V4 Pro 0813 en los próximos 2-3 meses si dependen de LLM de razonamiento avanzado, tanto en su versión API como en pesas locales, para validar rendimiento en casos de uso específicos y comparar costes totales versus soluciones propietarias.
Recomendación generada por IA con la evidencia disponible; no es asesoramiento profesional.
Fuente original: Simon Willison. La referencia es siempre el artículo original.
Ver fuente original ↗LLMrazonamientomodelos abiertosgeneración multimodal ChinaDeepSeeklanzamiento de modeloLLM abiertosrazonamiento
Tu opinión
0 comentarios
Relacionadas
OpenAI lanza GPT-6 Astra y un desarrollador simula el conectoma de una mosca en Minecraft
Un desarrollador del Georgia Institute of Technology, Evan Sinclair, usó GPT-6 Astra de OpenAI para simular las 166.700 neuronas del conectoma de una mosca de…
Por qué importaLa demostración ilustra capacidades avanzadas de razonamiento y manejo de datos científicos del nuevo modelo, aunque las declaraciones sobre AGI son…
GPT-6 Astra de OpenAI reaviva el debate sobre si se alcanzó la IA general
OpenAI lanzó GPT-6 Astra, que muestra mejoras notables en tareas de agente, automatización y programación frente a GPT-5.6 Sol, según benchmarks como OSWorld…
Por qué importaMás allá de la etiqueta de AGI, Astra consolida la transición del chatbot al 'agente' capaz de ejecutar flujos de trabajo completos con mínima…
Demostraciones virales de GPT-6 Astra reavivan debate sobre AGI y opacidad de razonamiento
Usuarios muestran a GPT-6 Astra completando el juego Portal en unas 24 horas de forma autónoma y dibujando una figura reconocible en Google Calendar mediante…
Por qué importaLa reducción de la cadena de pensamiento visible dificulta la supervisión externa de modelos cada vez más autónomos, lo que preocupa a investigadores…
ARC Prize matiza el 99,9% de GPT-6 Astra en ARC-AGI-3: cae a 62,7% sin memoria persistente
OpenAI presentó a GPT-6 Astra con una puntuación de 99,9% en ARC-AGI-3. ARC Prize, la organización que verificó el resultado, precisó que esa cifra se logró…
Por qué importaMuestra que los benchmarks de IA dependen fuertemente del entorno y las herramientas de apoyo, no solo del modelo, lo que obliga a leer con cautela…



