Ir al contenido
IA para hoy
Modelos y avances Lanzamiento

DeepSeek V4 Pro 0813 disponible con pesas de 1.7 billones de parámetros

DeepSeek V4 Pro 0813 disponible con pesas de 1.7 billones de parámetros
Imagen: Simon Willison

Hecho Qué ha ocurrido

DeepSeek ha lanzado el modelo V4 Pro 0813, disponible únicamente a través de API en OpenRouter. Las pesas del modelo (1.7 billones de parámetros, 893 GB) están ahora disponibles en Hugging Face, continuando con el patrón de liberación abierta de versiones anteriores (V4-Pro de abril y V4-Flash de julio). El lanzamiento carece de anuncio oficial en canales convencionales de DeepSeek.

Resumen generado mediante IA a partir de Simon Willison (original en inglés). Naturaleza de la información: hecho documentado.

Análisis Por qué importa

La iteración regular de DeepSeek mantiene la presión competitiva en el mercado de grandes modelos de lenguaje y su estrategia de código abierto amplía el acceso a capacidades avanzadas de razonamiento a desarrolladores fuera de ecosistemas propietarios. El cambio visual en la generación de imágenes según el nivel de razonamiento sugiere mejoras arquitectónicas en la alineación entre razonamiento y generación multimodal.

Quién se ve afectado
Desarrolladores, investigadores en IA, empresas que construyen aplicaciones con LLM, y proveedores de APIs que buscan modelos alternativos a OpenAI.
Qué puede cambiar
La disponibilidad de pesas abiertas permite que organizaciones sin acceso a APIs proprietarias ejecuten el modelo localmente, reduciendo costes operacionales y dependencia de terceros. El acceso consistente a nuevas versiones en Hugging Face acelera la adopción en ámbitos académicos y de código abierto.

Análisis generado a partir de la información disponible; no procede de la fuente.

Predicción Qué observar a continuación

Rendimiento comparativo del V4 Pro 0813 respecto a Claude 3.5 Sonnet y GPT-4o en benchmarks estándar (aunque DeepSeek distribuye resultados de forma poco convencional). Adopción en plataformas como Hugging Face y LM Studio. Tiempo entre lanzamiento de versión Flash y Pro (estructura de diferenciación de precios).

Recomendación Qué debería hacer una empresa

Equipos técnicos deberían evaluar el V4 Pro 0813 en los próximos 2-3 meses si dependen de LLM de razonamiento avanzado, tanto en su versión API como en pesas locales, para validar rendimiento en casos de uso específicos y comparar costes totales versus soluciones propietarias.

Recomendación generada por IA con la evidencia disponible; no es asesoramiento profesional.

Compartir WhatsApp LinkedIn X Bluesky Telegram Correo

Fuente original: Simon Willison. La referencia es siempre el artículo original.

Ver fuente original ↗

LLMrazonamientomodelos abiertosgeneración multimodal ChinaDeepSeeklanzamiento de modeloLLM abiertosrazonamiento

Tu opinión

0 comentarios

Sin registro. La primera vez te pediremos confirmar el correo y el comentario pasará por moderación; después se publican al momento si cumplen las normas. Se guarda un resumen de tu IP para evitar abusos.

Relacionadas

OpenAI lanza GPT-6 Astra y un desarrollador simula el conectoma de una mosca en Minecraft

Un desarrollador del Georgia Institute of Technology, Evan Sinclair, usó GPT-6 Astra de OpenAI para simular las 166.700 neuronas del conectoma de una mosca de…

Por qué importaLa demostración ilustra capacidades avanzadas de razonamiento y manejo de datos científicos del nuevo modelo, aunque las declaraciones sobre AGI son…

Impacto bajo Fiabilidad una fuente fiable El Confidencial Tecnología
Modelos y avances 17 fuentes

GPT-6 Astra de OpenAI reaviva el debate sobre si se alcanzó la IA general

OpenAI lanzó GPT-6 Astra, que muestra mejoras notables en tareas de agente, automatización y programación frente a GPT-5.6 Sol, según benchmarks como OSWorld…

Por qué importaMás allá de la etiqueta de AGI, Astra consolida la transición del chatbot al 'agente' capaz de ejecutar flujos de trabajo completos con mínima…

Impacto alto Fiabilidad confirmado por varias fuentes Relevancia 8/10 Clarín Tecnología
Modelos y avances 17 fuentes

Demostraciones virales de GPT-6 Astra reavivan debate sobre AGI y opacidad de razonamiento

Usuarios muestran a GPT-6 Astra completando el juego Portal en unas 24 horas de forma autónoma y dibujando una figura reconocible en Google Calendar mediante…

Por qué importaLa reducción de la cadena de pensamiento visible dificulta la supervisión externa de modelos cada vez más autónomos, lo que preocupa a investigadores…

Impacto medio Fiabilidad confirmado por varias fuentes Xataka México
Modelos y avances 17 fuentes

ARC Prize matiza el 99,9% de GPT-6 Astra en ARC-AGI-3: cae a 62,7% sin memoria persistente

OpenAI presentó a GPT-6 Astra con una puntuación de 99,9% en ARC-AGI-3. ARC Prize, la organización que verificó el resultado, precisó que esa cifra se logró…

Por qué importaMuestra que los benchmarks de IA dependen fuertemente del entorno y las herramientas de apoyo, no solo del modelo, lo que obliga a leer con cautela…

Impacto alto Fiabilidad declaración interesada Relevancia 8/10 Infobae Tecno