ByteDance estaría preparando un modelo de video espacial en tiempo real, con la participación de su fundador Zhang Yiming según un reporte, que podría cambiar la competencia en realidad extendida al trasladar buena parte del procesamiento desde los cascos hacia la nube.
***
- El modelo se construiría sobre Seedance y podría generar mundos virtuales interactivos para Pico, juegos, dramas y transmisiones en vivo.
- La propuesta apunta a producir cerca de 20 cuadros por segundo con una latencia aproximada de 0,05 segundos, según un reporte citado por Bloomberg.
- ByteDance también habría reservado un presupuesto de datos superior al de sus rivales para avanzar en modelos de mundo durante 2026.
🚨 ByteDance prepara video espacial en tiempo real
El modelo, basado en Seedance, podría crear mundos interactivos para Pico desde la nube.
El reporte menciona 20 fps y 0,05 s de latencia. Lanzamiento posible en octubre, aún sin confirmar. pic.twitter.com/g35XV7sxyi
— Diario฿itcoin (@DiarioBitcoin) September 7, 2026
ByteDance prepara un modelo de inteligencia artificial para generar video espacial en tiempo real, con Zhang Yiming, fundador de la compañía, involucrado en la supervisión del proyecto, según un reporte. El lanzamiento podría ocurrir tan pronto como octubre, aunque una fuente advirtió que el calendario todavía no está definido y que los planes pueden cambiar.
El sistema estaría diseñado para crear mundos virtuales interactivos capaces de reaccionar a la voz y a los movimientos de los usuarios de Pico, la división de realidad extendida de ByteDance. La propuesta conecta generación de video, computación en la nube y dispositivos inmersivos, en una apuesta que puede llevar la competencia de la realidad extendida más allá de las especificaciones del hardware.
Un modelo espacial construido sobre Seedance
La tecnología reportada se construiría sobre Seedance, la familia de modelos de generación de video de ByteDance. La página oficial de Seedance describe su primera versión como un modelo capaz de generar videos de múltiples planos a partir de texto e imágenes. El nuevo proyecto buscaría llevar esas capacidades hacia entornos interactivos para productos como CapCut, Doubao y Pico, aunque sus integraciones concretas todavía no están confirmadas públicamente.
Su objetivo sería producir entornos que no funcionen como videos pasivos, sino como espacios capaces de cambiar de manera coherente cuando el usuario habla, se mueve o toma decisiones dentro de ellos.
La especificación técnica mencionada en el reporte contempla video bajo demanda de aproximadamente 20 cuadros por segundo y una latencia cercana a 0,05 segundos. El procesamiento ocurriría en la nube, en lugar de ejecutarse completamente en el dispositivo, una decisión que reduce la carga computacional que deben soportar los cascos de realidad extendida.
Ese enfoque puede tener una consecuencia comercial directa: si los dispositivos necesitan menos capacidad para renderizar escenarios complejos, los fabricantes podrían reducir parte de sus costos y simplificar el diseño del hardware. La fidelidad visual seguiría dependiendo de la infraestructura remota, pero el casco dejaría de cargar con toda la responsabilidad de crear y actualizar el mundo virtual.
ByteDance cuenta además con una ventaja de distribución frente a empresas que apenas buscan una aplicación convincente para sus dispositivos inmersivos. La compañía combina una plataforma de video, modelos generativos, servicios de software y una división de realidad extendida, por lo que puede probar el sistema en contenidos de entretenimiento antes de convertirlo en una herramienta general.
La apuesta de ByteDance por los modelos de mundo
Los llamados modelos de mundo intentan aprender cómo se comportan los entornos para generar escenarios que respondan de forma consistente a las acciones de una persona. A diferencia de un generador de imágenes o de un modelo de lenguaje que responde con texto, este tipo de sistema debe mantener cierta continuidad espacial, física y temporal mientras el usuario interactúa con lo que observa.
La conexión con el video resulta estratégica porque las compañías que han pasado años procesando grandes volúmenes de imágenes en movimiento poseen experiencia en compresión, generación y distribución de contenido. ByteDance ha desarrollado precisamente ese tipo de infraestructura para sus plataformas digitales, aunque ahora busca reutilizarla en experiencias tridimensionales y participativas.
Según un reporte de 36Kr, ByteDance estableció cuatro prioridades de inteligencia artificial para 2026, con los modelos de mundo en el primer lugar. Las otras líneas serían mantener el liderazgo de Seedance en video, mejorar las capacidades de programación y comercializar Doubao, su producto de inteligencia artificial.
El mismo reporte señaló que los modelos de mundo recibirían el mayor presupuesto de datos entre las áreas de desarrollo de la empresa, con una cifra de ocho dígitos en renminbi. Las fuentes citadas afirmaron que ese monto sería entre tres y cuatro veces superior al gasto de competidores, aunque las pruebas internas de comienzos de 2026 todavía ubicarían a ByteDance cerca de 10% por detrás del estado del arte global.
Dos rutas: robótica y entretenimiento inmersivo
La compañía estaría trabajando en dos rutas tecnológicas al mismo tiempo. Una emplea un enfoque de visión, lenguaje y acción orientado a la inteligencia encarnada y la robótica, mientras la otra utiliza simulación tridimensional para entretenimiento y videojuegos.
El modelo de video espacial pertenece a la segunda ruta, que cuenta con una base de usuarios potenciales a través de Pico. ByteDance adquirió la empresa de realidad virtual en 2021, según CNBC. Esa relación podría facilitar las pruebas de interacción, porque la compañía no tendría que esperar a que aparezca un mercado completamente nuevo para evaluar cómo las personas reaccionan ante mundos generados en tiempo real.
El interés de Zhang Yiming por esta área coincide con una discusión más amplia dentro de la inteligencia artificial. Investigadores como Fei-Fei Li y Yann LeCun han sostenido que los sistemas necesitan comprender mejor la visión y la física, y no limitarse a manipular lenguaje, si aspiran a actuar de manera competente en el mundo.
La apuesta comercial convierte esa discusión teórica en un problema de producto: los mundos deben ser suficientemente rápidos, coherentes y atractivos para que una persona quiera permanecer en ellos. Una demostración técnicamente impresionante no bastará si el costo de la nube es demasiado alto, la respuesta presenta retrasos o los usuarios no encuentran una actividad que justifique ponerse un casco.
Presupuesto, competencia y próximos pasos
El tamaño de la inversión muestra que ByteDance no trata este proyecto como un experimento marginal. Reportes citados por medios financieros señalaron que la empresa obtuvo un préstamo cercano a USD 30.000 millones y que evalúa un gasto de capital de hasta USD 70.000 millones para su infraestructura de inteligencia artificial.
La empresa todavía compite en China con actores como Alibaba, DeepSeek y Moonshot AI, mientras Seedance mantiene un papel central en CapCut y Doubao. El desarrollo de un modelo espacial permitiría aprovechar esos activos para extender la generación de video hacia videojuegos, dramas de formato corto y transmisiones en vivo.
Para Meta y Apple, la amenaza no sería inmediata en términos de reemplazar la fidelidad de dispositivos como Vision Pro, sino de cambiar la lógica económica de la categoría. Ambas compañías han invertido grandes sumas en cascos que todavía no se han masificado, mientras ByteDance intenta trasladar parte del procesamiento a centros de datos remotos.
Un modelo renderizado en la nube no necesariamente superaría a un dispositivo premium en calidad visual, pero sí trasladaríaparte del costo y de la complejidad hacia los centros de datos. El desafío para ByteDance será demostrar que esa arquitectura puede entregar una respuesta suficientemente rápida y estable, además de convertir la novedad técnica en experiencias que atraigan usuarios de forma sostenida.
Por ahora, el posible lanzamiento sigue sujeto a cambios y no existe confirmación pública de ByteDance sobre la fecha. Si el proyecto llega al mercado durante octubre, la compañía se adelantaría al objetivo reportado de presentar al menos un modelo de mundo antes de terminar 2026 y pondría a prueba una tesis ambiciosa: que el futuro de la realidad extendida podría depender menos del casco y más del modelo que vive en la nube.
Imagen original de DiarioBitcoin, creada con inteligencia artificial, de uso libre, licenciada bajo Dominio Público.
Este artículo fue escrito por un redactor de contenido de IA y revisado por un editor humano para garantizar calidad y precisión.
ADVERTENCIA: DiarioBitcoin ofrece contenido informativo y educativo sobre diversos temas, incluyendo criptomonedas, IA, tecnología y regulaciones. No brindamos asesoramiento financiero. Las inversiones en criptoactivos son de alto riesgo y pueden no ser adecuadas para todos. Investigue, consulte a un experto y verifique la legislación aplicable antes de invertir. Podría perder todo su capital.
Suscríbete a nuestro boletín
Artículos Relacionados
Empresas
Anthropic crea un equipo que descarta ideas rápido para impulsar la frontera de la IA
Asia
Taiwán prepara una unidad cibernética con respaldo de EE.UU. para detectar amenazas militares ocultas
Corea del Sur
Corea del Sur y EE.UU. evalúan una planta de gas de USD $22.300 millones en Texas
Blockchain