生数科技下周全球发布Vidu Q1模型,强调高可控

内容摘要【TechWeb】4月16日消息,在今日举办的第三届中国AIGC产业峰会上,生数科技产品副总裁、Vidu产品负责人廖谦透露,下周将全球发布即新的Vidu Q1模型,该大模型优化旨在大幅提升内容创作的可控性,尤其在位置控制、运动布局和音频生成

联系电话:400-962-3929

【TechWeb】4月16日消息,在今日举办的第三届中国AIGC产业峰会上,生数科技产品副总裁、Vidu产品负责人廖谦透露,下周将全球发布即新的Vidu Q1模型,该大模型优化旨在大幅提升内容创作的可控性,尤其在位置控制、运动布局和音频生成上,以更贴近人类审美和自然法则。

廖谦表示,Vidu Q1模型将推动多模态大模型时代的变革,将极大增强个性化内容生成能力,对社交、游戏、VR/AR等领域产生深远影响。

生数科技(北京生数科技有限公司)成立于2023年3月,是一家专注于多模态生成式大模型与应用产品开发的高科技企业,核心团队来自清华大学人工智能研究院。

生数科技首创了基于Transformer的U-ViT架构,融合了Diffusion模型与Transformer的优势,支持多模态任务的统一建模。该架构在2023年开源的UniDiffuser模型中首次应用,成为全球首个基于Diffusion Transformer的多模态扩散模型,比Stable Diffusion 3采用的DiT架构领先一年。

基于U-ViT架构,生数科技2024年4月发布的视频大模型Vidu可一键生成16秒1080P高清视频,具备多镜头切换、高时空一致性和物理世界模拟能力,性能对标OpenAI的Sora。

 
举报 收藏 打赏 评论 0
今日推荐
浙ICP备19001410号-1

免责声明

本网站(以下简称“本站”)提供的内容来源于互联网收集或转载,仅供用户参考,不代表本站立场。本站不对内容的准确性、真实性或合法性承担责任。我们致力于保护知识产权,尊重所有合法权益,但由于互联网内容的开放性,本站无法核实所有资料,请用户自行判断其可靠性。

如您认为本站内容侵犯您的合法权益,请通过电子邮件与我们联系:675867094@qq.com。请提供相关证明材料,以便核实处理。收到投诉后,我们将尽快审查并在必要时采取适当措施(包括但不限于删除侵权内容)。本站内容均为互联网整理汇编,观点仅供参考,本站不承担任何责任。请谨慎决策,如发现涉嫌侵权或违法内容,请及时联系我们,核实后本站将立即处理。感谢您的理解与配合。

合作联系方式

如有合作或其他相关事宜,欢迎通过以下方式与我们联系: