在备受瞩目的WAIC2025世界人工智能大会上,生数科技携创新力震撼发布Vidu Q1″参考生视频”功能,以算法革新彻底颠覆传统视频制作模式,为视频生成领域注入革命性突破。这一突破性技术彻底改变了传统视频制作的繁琐流程,将创作效率提升至全新高度。

告别分镜,一键直出视频成为Vidu Q1″参考生视频”最耀眼的亮点。用户只需上传人物、道具、场景等参考图像,并配合文字提示,即可直接生成完整视频素材。制作流程从传统的”分镜生成——视频生成——剪辑——成片”精简为”参考图——视频生成——剪辑——成片”,极大降低了创作门槛。以”诸葛亮与丘吉尔、拿破仑在会议室讨论”为例,只需输入提示词并上传三位历史人物的参考图和会议室场景图,系统即可智能生成三人同框对话的完整视频,为创意表达开辟无限可能。

该功能的核心优势在于破解了视频模型商业化的关键瓶颈——主体一致性问题。Vidu Q1参考生目前支持最多七个主体同时输入并保持高度一致,据生数科技透露,这一能力已能满足绝大多数创作场景需求。生数科技CEO骆怡航指出,这种通用创作方式将全面赋能广告、动漫、影视、文旅、教育等多元商业领域,实现从线下拍摄到线上AI创作的根本性转变。

生数科技Vidu Q1″参考生”功能革新视频制作告别分镜插图

在技术路径与产业导向方面,生数科技采用先进的U-ViT架构,结合扩散模型与Transformer技术,并在此基础上持续优化算法模块。Vidu模型内置强大的多模态理解能力,已成功应用于视频生成领域。骆怡航强调,团队始终以产业落地为核心导向,暂未将理解与生成一体化作为优先级,”行业客户更关注内容实际效果而非技术路线本身”。

7月25日,清华大学与生数科技联合发布具身智能模型Vidar,通过”视频大模型+具身智能”创新路径实现低成本、少样本泛化。骆怡航详细解释,视频模型与具身智能在本质上都处理时空信息,采用相同的输入决策逻辑。团队基于Vidu视频大模型,仅需少量机器人实操视频训练,即可将虚拟视频智能转化为对应机械臂动作,有效解决传统VLA路线面临的数据稀缺难题。目前,Vidu仍以提升视频生成能力为最高优先级,将具身智能作为持续探索方向,为该领域开拓潜在商业市场空间。

最新快讯

2026年03月04日

07:37
微新创想:3月11日,苹果将在美国旧金山举办的游戏开发者大会(GDC)上举行三场专题演讲,全面推动其游戏生态建设。首场演讲将聚焦苹果软硬件协同开发,深入探讨如何通过系统级优化提升游戏性能与用户体验。这一环节不仅展示了苹果在硬件与软件整合方面的技术实力,也为开发者提供了宝贵的参考和灵感。 次场演讲由CD Projekt Red带来,将详细解析《赛博朋克2077...
07:37
微新创想:河北维达康生物科技股份有限公司在2026年3月4日前于河北证监局完成IPO辅导备案 辅导机构为中信建投证券 公司成立于2021年 注册资本达到1.4亿元 注册地设在河北省保定市满城区于家庄镇 公司专注于膳食补充剂 天然色素 香料以及医药中间体等合成生物学产业化领域 作为国家认定的“专精特新”小巨人企业 公司在科技创新方面表现突出 牵头承担了河北省“...
07:37
微新创想:2026年3月3日晚,苹果公司正式发布全新Studio Display及Studio Display XDR显示器。两款产品专为Mac优化,普通版起售价11999元,XDR版24999元起。新显示器采用100%再生铝支架,标准版屏幕含80%再生玻璃,系苹果首次达成该环保指标;包装盒为可折叠全纤维设计,便于拆解回收。此举旨在降低运输与回收环节的环境负...
07:37
微新创想:2026年3月3日,谷歌正式推出Gemini 3.1 Flash-Lite模型,宣称为其速度最快、成本效益最高的Gemini 3系列轻量级模型。该模型即日起向开发者开放预览版,可通过Google AI Studio的Gemini API及企业级Vertex AI平台调用。这一发布标志着谷歌在大模型领域持续发力,进一步拓展其在AI应用中的影响力。 G...
07:36
微新创想:2026年3月3日晚,苹果正式推出Studio Display XDR专业显示器。这款27英寸的5K Retina XDR屏幕采用了先进的mini-LED背光技术,带来了卓越的显示效果。其HDR峰值亮度高达2000尼特,确保了在各种光照条件下都能呈现出细腻的色彩与高对比度。同时,该显示器支持120Hz自适应刷新率,为用户提供流畅的视觉体验。 微新创...
06:55
微新创想:3月4日,新闻集团与Meta Platforms宣布达成多年期人工智能内容授权协议。协议为期至少三年,自2026年起生效。该协议标志着两家公司在人工智能领域迈出了重要一步。 微新创想:根据协议内容,Meta将每年向新闻集团支付最高5000万美元。这笔费用将用于获取新闻集团旗下知名媒体如《华尔街日报》《泰晤士报》等的内容授权。这些内容将被用于AI模型...
05:07
微新创想:2026年3月4日,Meta宣布成立Meta Applied AI工程组织,该组织隶属于Reality Labs部门。这一举措标志着Meta在推动人工智能技术实际应用方面迈出了重要一步,旨在加快AI技术在现实场景中的工程化落地。 微新创想:新成立的组织将专注于AR/VR、智能助手以及沉浸式应用等多个关键领域。通过整合公司内部不同部门的AI研发资源,...
02:34
微新创想:2026年3月4日,OpenAI正式推出GPT-5.3即时版网站。该版本即日起面向所有ChatGPT用户免费开放使用。此前的GPT-5.2即时版仍保留在旧版模型选择器中,仅限付费用户访问,为期三个月,将于2026年6月3日终止服务。 此次升级旨在提升响应速度与多模态理解能力,无需额外订阅即可体验最新模型。OpenAI未披露具体技术参数,但强调其在实...
02:34
微新创想:2026年3月4日,荷兰半导体设备制造商ASM国际发布2025年第四季度财报。当季营收达6.98亿欧元,略高于市场预期的6.976亿欧元。这一成绩表明公司在全球半导体市场中继续保持强劲的盈利能力。 订单额为8.028亿欧元,显著高于预期的7.726亿欧元。这显示出客户对ASM国际产品的持续高需求,尤其是在高端制造领域。订单积压也达到了12.5亿欧元...
01:25
微新创想:2026年3月4日,阿波罗全球管理CEO Marc Rowan警示私募信贷市场面临结构性洗牌。当前软件公司贷款违约率上升,叠加人工智能潜在冲击软件行业,引发投资者对1.8万亿美元私募信贷资产质量的担忧。 商业发展公司近期遭遇赎回潮,高管持续回应质疑。此次压力源于底层资产集中度高、估值透明度低及利率环境变化等多重因素。行业正加速分化,风控能力薄弱机构...
00:40
微新创想:3月2日,中兴通讯在西班牙巴塞罗那举行的2026年世界移动通信大会(MWC26)上,正式发布了其首款AI原生手机努比亚M153以及豆包手机助手预览版。这一发布标志着中兴在人工智能领域的重要突破。努比亚M153搭载了骁龙8至尊版芯片,具备强大的计算能力,能够支持自然语言跨应用的多步任务执行,为用户带来更加智能和高效的使用体验。 微新创想:与此同时,中...
00:40
微新创想:2026年3月3日,KDE团队正式发布桌面环境Plasma 6.6.2。该版本作为Plasma 6.6系列的第二个错误修复更新,主要针对显示子系统、远程桌面组件KRdp以及应用商店Discover进行了稳定性提升和交互优化。此次更新解决了多个关键问题,包括DRM后端崩溃、镜像输出异常、KRdp中的线程安全与死锁问题,同时改善了Discover的悬停...