Ir al contenido
IA para hoy

Tecnología

benchmarks científicos

Evolución en 16 semanas

Noticias por semana y momentum estimado por semana 1 6,3 1 12,5 27/05 17/06 08/07 29/07 19/08 02/09: 1 09/09 27/05: 003/06: 010/06: 017/06: 024/06: 001/07: 008/07: 015/07: 022/07: 029/07: 005/08: 012/08: 019/08: 026/08: 002/09: 12,509/09: 0
Noticias por semana Momentum estimado · Fuentes distintas en la última semana: 0 · impacto medio 3,0/5

El momentum semanal se estima con la misma fórmula que el momentum actual: volumen, aceleración respecto a la semana anterior, diversidad de fuentes e impacto.

Relacionadas

LLM ×1Anthropic ×1razonamiento ×1

Historias

Noticias

Modelos y avances 2 fuentes

Claude Fable 5.1: mejora sustancial en tareas científicas con razonamiento escalable

Anthropic lanzó Claude Fable 5.1, que logra un 52,6% en el nuevo benchmark Terminal-Bench-Science 0.1, un aumento significativo desde el 24,7% de Fable 5. El…

Por qué importaPara equipos de investigación y work knowledge, los resultados en benchmarks científicos indican avances en resolución de problemas complejos. La…

Impacto medio Fiabilidad varias fuentes Simon Willison