요약:
Bloomberg에 따르면 ByteDance는 로봇 공학 및 자율 시스템 애플리케이션 분야에서 Meta 및 Google 모회사인 Alphabet과 경쟁하기 위해 실시간 공간 비디오 생성을 위한 AI 모델 출시를 준비하고 있습니다. 이 문제에 정통한 소식통에 따르면 ByteDance 창립자인 Zhang Yiming은 이르면 다음 달에 출시될 수 있는 새 모델의 개발을 개인적으로 감독하고 있습니다. 이 문제에 정통한 소식통에 따르면 Zhang Yiming은 회사의 다양한 비즈니스 부서의 관련 업무를 조정하고 이 프로젝트에 AI 리소스와 컴퓨팅 성능을 할당하고 있다고 합니다. 해당 모델의 출시일은 불확실하며 계획은 변경될 수 있습니다.

ByteDance
정보통에 따르면 이 모델은 Bytedance의 기존 영화 수준 비디오 생성 AI 모델인 Seedance를 기반으로 구축되었으며 사용자가 생방송, 단편 연극 및 게임을 위한 대화형 가상 세계를 만들 수 있게 해줄 것이라고 합니다.
장 이밍(Zhang Yiming)은 이 최신 AI 모델을 통해 회사가 비디오 분야에서 최고의 전문 역량을 바탕으로 빠르게 발전하는 세계 모델 분야에 진출할 수 있기를 바라고 있습니다. 그는 Fei-Fei Li, Yann LeCun 등과 함께 로봇 공학, 게임 및 자율 주행 자동차에 중요한 방향으로 간주되는 AI의 시각적 경로를 탐구할 예정입니다.
ByteDance의 최신 모델은 Pico 헤드셋 사용자의 음성이나 움직임에 반응하는 가상 세계를 생성하는 것을 목표로 합니다. 이 문제에 정통한 한 관계자는 이 모델이 약 0.05초의 대기 시간으로 초당 20프레임의 속도로 주문형 비디오를 생성할 수 있고 공간 컴퓨팅 환경과 대화형 인터페이스를 제공할 수 있다고 밝혔습니다.
중국 모델은 공간 콘텐츠를 생성하는 계산 집약적인 프로세스를 클라우드로 이동하여 VR 도입의 초기 비용을 줄이는 것을 목표로 합니다. 이는 헤드셋에 필요한 처리 능력을 줄여 하드웨어 구성이 더 간단한 저가형 장치로의 길을 열어줄 것입니다. 신속한 콘텐츠 생성은 또한 사용자의 전쟁터를 하드웨어 사양에서 AI 모델, 컴퓨팅 인프라 및 콘텐츠 배포 플랫폼으로 전환하는 데 도움이 될 수 있습니다.
성공한다면 이 새로운 모델은 ByteDance가 Meta 및 Apple과 경쟁할 수 있는 새로운 전장을 열 수 있습니다. Meta와 Apple 모두 가상 현실과 혼합 현실 장비에 막대한 투자를 해왔습니다. Meta는 Quest 헤드셋을 중심으로 대중 시장 생태계를 구축하려고 노력해 왔으며 Apple은 Vision Pro를 고급 공간 컴퓨팅 플랫폼으로 포지셔닝했습니다. 그러나 어느 회사도 그러한 제품을 주류 시장에 출시할 수 없었습니다.
보도 시점 현재 ByteDance 대변인은 이에 대해 언급하지 않았습니다.
댓글