欢迎来智东西
登录
免费注册
我的订阅
关注我们
智东西
车东西
芯东西
智猩猩
中国电信发布全自研视频生成大模型
2024-12-04
智东西
17
智东西12月4日消息,12月3日,在中国电信“2024数字科技生态大会”期间,首届“TeleAI 开发者大会”在广州举办。会上,TeleAI发布视频生成大模型、视觉大模型产用一体化平台、具身智能、智传网等一系列创新技术、产品及科研成果,并发布开发者产业联盟计划。目前,TeleAI视频生成大模型在权威视频生成评测榜单VBench中排名第一。
视频生成大模型创新地打造了“VAST(Video As Storyboard from Text)二阶段视频生成技术”,通过文本描述精准勾勒出包含视频构图、主体目标位置及人物姿态等关键信息的“故事板”(Storyboard),进而生成对应的视频内容,可保证单个或多个主体人物在各视频片段中的外观一致性,实现对复杂动作和交互式动作的精确控制,并让角色和目标物体的运动符合物理规律。
依托TeleSearch 2.0,中国电信构建了视觉大模型产用一体化平台,通过算法冷启动回流数据,摆脱了传统模型对大量数据的依赖,实现0训练数据直接推理,显著降低算法应用的准入门槛。同平台还支持小样本训练,仅需100个样本数据就能训练出高精度模型,实现模型生产的全自动化过程。该平台已成功应用于多省应急项目,沉淀了20余个应急全流程感知场景,提升对灾害研判与应急响应的核心能力。
中国电信