Ir al contenido
IA para hoy
Herramientas y productos Producto

Meta lanza SAM 3 y SAM 3D para segmentación de objetos y reconstrucción 3D

Imagen: Meta Newsroom

Hecho Qué ha ocurrido

Meta ha anunciado SAM 3 y SAM 3D, nuevos modelos de visión dentro de su colección Segment Anything. SAM 3 permite detectar, segmentar y rastrear objetos en imágenes y vídeo usando indicaciones de texto y visuales, superando las limitaciones previas al aceptar indicaciones textuales complejas como "gorro de béisbol rojo". SAM 3D reconstruye objetos y personas en 3D a partir de una única imagen, con dos variantes: SAM 3D Objects para objetos y escenas, y SAM 3D Body para estimación de cuerpos humanos. Ambos modelos están disponibles en el nuevo Segment Anything Playground y Meta compartirá pesos de modelos, conjuntos de datos de evaluación y código de investigación.

Resumen generado mediante IA a partir de Meta Newsroom (original en inglés). Naturaleza de la información: hecho documentado.

Análisis Por qué importa

Estos modelos simplifican tareas complejas de visión por computadora que antes requerían modelos especializados o anotación manual: edición de vídeo, generación de activos 3D y comprensión visual multimodal. Para empresas de medios, e-commerce, robótica y tecnologías inmersivas, representan una reducción significativa de fricción técnica y coste.

Quién se ve afectado
Creadores de contenido, equipos de e-commerce y marketplace, investigadores en robótica y realidad aumentada, desarrolladores de aplicaciones de visión por computadora, y productores de medios.
Qué puede cambiar
Los flujos de edición de vídeo y generación de activos 3D pueden automatizarse sin expertise técnica, acelerando ciclos de desarrollo. El comercio electrónico (ejemplo: Facebook Marketplace con View in Room) mejora la experiencia de visualización previa de productos. La barrera de entrada para aplicaciones de IA visual se reduce dramáticamente.

Análisis generado a partir de la información disponible; no procede de la fuente.

Predicción Qué observar a continuación

Adopción en herramientas creativas de Meta (Edits, Vibes, meta.ai) durante los próximos meses. Impacto en productividad de equipos de contenido y validación de las capacidades de SAM 3D en sectores como robótica y medicina del deporte. Disponibilidad de integraciones en plataformas de terceros a través del Playground. Posibles mejoras iterativas basadas en retroalimentación de la comunidad académica y creativa.

Recomendación Qué debería hacer una empresa

Equipos de e-commerce y marketing deberían evaluar SAM 3 y SAM 3D en el Segment Anything Playground en los próximos 2-3 meses para automatizar tareas de edición visual y generación de activos 3D. Desarrolladores de herramientas creativas deben estudiar cómo integrar estos modelos en pipelines de producción de contenido.

Recomendación generada por IA con la evidencia disponible; no es asesoramiento profesional.

Fuente original: Meta Newsroom (fuente primaria). La referencia es siempre el artículo original.

Ver fuente original ↗

visión por computadorasegmentaciónreconstrucción 3DmultimodalLLM 3DMetaSAM 3Segment Anythingvision

Relacionadas

Lenovo apuesta por IA híbrida local con su asistente Qira en IFA 2026

En IFA de Berlín, Lenovo presentó su visión de IA centrada en Qira, un asistente personal que funciona a través de PC, móviles, tablets y el Moto Watch Ultra…

Por qué importaLa estrategia de Lenovo refleja una tendencia hacia modelos de IA local que priorizan privacidad y reducción de dependencia de la nube, algo…

Impacto bajo Fiabilidad una fuente fiable Xataka

Google y Cathay Pacific amplían pruebas de IA para evitar estelas de condensación

Google Research está ampliando con Cathay Pacific un programa piloto que usa IA, imágenes satelitales y datos meteorológicos para ajustar ligeramente la…

Por qué importaEs un ejemplo de aplicación de IA a un problema climático concreto en un sector con difícil descarbonización, usando infraestructura existente sin…

Impacto bajo Fiabilidad una fuente fiable Google AI

Gemini Spark de Google ya puede gestionar bibliotecas de Google Photos

Google anunció que su agente personal Gemini Spark puede ejecutar tareas en Google Photos, como editar imágenes, curar álbumes, crear álbumes compartidos…

Por qué importaEs un ejemplo más de cómo las grandes tecnológicas integran agentes de IA en servicios de consumo masivo, buscando justificar el valor de las…

Impacto muy bajo Fiabilidad una fuente fiable TechCrunch AI