Sora级视频生成大模型“视界一粟YiSu”发布
时间:2024-06-11 22:30 来源:光明网 阅读量:9350
近日,极佳科技联合清华大学自动化系发布中国首个超长时长、高性价比、端侧可用的Sora级视频生成大模型“视界一粟 YiSu”。
据悉,“视界一粟 YiSu”拥有模型原生的16秒超长时长,并可生成至1分钟以上,同时还拥有超大运动、超强表现力、懂物理世界等众多优势,更重要的是,YiSu模型成本更低、速度更快、端侧可用。通过YiSu模型强大的性能和极致的性价比,有望更快实现长视频生成的大规模产品应用。
年初Sora的爆火,让DiT受到业内极大关注,很多公司和项目开始复现DiT路线。极佳科技和清华大学研究人员在视频生成技术路线上有着深入的积累和独特的理解,在autoregressive、Masked Token、DiT、UNet等不同路线方面均拥有丰富的经验。此前,团队提出WorldDreamer,是全球第一次以Transformer和LLM(Masked Token路线)为中心的视频生成工作。
“视界一粟 YiSu”基于团队自研的视频生成大模型技术,并没有止步于DiT,而是融合LLM和扩散模型的自研架构,结合各种路线的优势,在多模态融合、训练效率、推理效率、模型效果等方面进行极致优化,打造视频生成的最佳方案。
极佳科技认为,世界模型对于自动驾驶、通用机器人等物理世界的通用智能至关重要,在数据生成、闭环仿真、端到端方案等方面都拥有关键的作用,视频生成是走向世界模型最高效的路径。
在世界模型方向,极佳科技发布了中国首个自动驾驶世界模型,并获得业内首个世界模型商业化定点和落地,签约多个头部主机厂和大客户。极佳科技通过世界模型已经服务自动驾驶、机器人等具身智能客户几十余家,携手行业加速走向物理世界通用智能。
此次发布的是YiSu-Beta V0.5版本,YiSu大模型正在按照每周一个小版本、每月一个大版本的迭代速度飞速成长和进化,未来几个月在视频时长、可控性、推理速度、运行成本、理解物理世界等方面将持续迎来大幅度的提升,为行业客户和广大用户带来更多的价值和功能。
据了解,极佳科技核心团队是兼具技术、产业、创业的顶尖综合团队,拥有超过十年、全球领先的AI技术积累,同时还拥有AI、自动驾驶、大模型等方向连续创业经验。
免责声明:该文章系本站转载,旨在为读者提供更多信息资讯。所涉内容不构成投资、消费建议,仅供读者参考。
-
怎么选购电动叉车呢?易工机械分享几个要点
电动叉车是现代物流行业中的重要设备之一,与传统的燃油叉车相比,它具有更好的环保性、低噪音、更低的维护成本、操作简便、节省时间和更高的安全性等优势。但在选购电动叉车时,需要考虑以下几个方面:一、载货能力叉车的载货能力是一个非常重要的指标。在选...
-
不断创“芯”,亚略特为行业高质量发展提供
近日,由深圳市芯片行业协会联合凤凰网举办的“新时代芯未来“全球芯片产业链发展高峰论坛在深圳前海万科国际会议中心成功召开。亚略特作为杰出企业代表之一受邀参与了此次峰会,并凭借在多模态生物识别核心技术上的不断创新,以及芯片研发领域的持续突破,获...
-
我国5G基站总数达238.4万个
工信部发布2023年1—2月份通信业经济运行情况。截至2月末,我国5G基站总数达238.4万个,占移动基站总数的21.9%,5G网络建设稳步推进。数据显示,1—2月份,信息通信行业整体运行平稳。电信业务收入和业务总量稳步增长,云计算等新兴业...
-
灵感来自中国:俄罗斯电视台首次推出AI女
这年头,连女主播都可能不是真人了。据看看新闻KNEWS报道,俄罗斯南部斯塔夫罗波尔地区的一家电视台推出了一位AI天气预报女播报员,她亮相2次后就圈粉无数。3月22日SvoyoTV电视台首播了名为ldquo;未来预测rdquo;的新节目,最引...