昆仑万维开源Skywork UniPic2.0模型突破多模态AI技术

昆仑万维集团在备受瞩目的SkyWork AI技术发布周第三天,正式向全球开发者与研究者开源其最新研发的「Skywork UniPic2.0」统一多模态模型。这一具有里程碑意义的发布,不仅标志着多模态人工智能领域迈入新纪元,更代表着该技术生态的又一次重大突破。Skywork UniPic2.0作为一个面向统一多模态建模的高效训练与推理框架,通过创新性地整合生成与编辑模块的轻量化设计,以及多模态理解模型的联合训练机制,成功构建了集理解、生图、编辑于一体的核心能力体系。该模型致力于实现“高效、高质、统一”的多模态生成目标,为人工智能应用开辟了更广阔的可能性。

昆仑万维开源Skywork UniPic2.0模型突破多模态AI技术插图1

Skywork UniPic2.0模型架构由三大核心模块协同构成:生图编辑模块、统一模型能力模块以及生图编辑后训练模块。这一设计基于先进的SD3.5-Medium架构,将原本仅支持文本输入的传统模型升级为同时兼容文本与图像输入的双重输入模型,显著扩展了生图能力至生图与编辑的双重功能。通过冻结生图编辑模块,并引入多模态模型Qwen2.5-VL-7B与Pre-Train连接器,成功构建出理解生成编辑一体化能力框架。在此基础上,通过连接器与生图编辑模块的联合微调,最终实现了真正意义上的一体化理解、生图、编辑模型,为多模态AI应用提供了前所未有的技术支持。

此次Skywork UniPic2.0的开源举措,不仅向全球开发者与研究者提供了全面的技术平台,涵盖模型权重、推理代码、强化策略等全部技术资源,更在技术指标上实现了超越性突破。其生成模块基于2B参数的SD3.5-Medium架构进行深度训练,在生图和编辑指标上超越了众多具有更大参数量的同类模型。此外,该模型创新性地引入了强化学习机制,基于Flow-GRPO首创的渐进式双任务强化策略,有效提升了模型对复杂指令的理解能力,并显著增强了图像生成与编辑的一致性,为多模态AI应用带来了质的飞跃。

昆仑万维开源Skywork UniPic2.0模型突破多模态AI技术插图2

项目主页:https://unipic-v2.github.io/
技术报告:https://github.com/SkyworkAI/UniPic/blob/main/UniPic-2/assets/pdf/UNIPIC2.pdf
GitHub地址:https://github.com/SkyworkAI/UniPic/tree/main/UniPic-2
HuggingFace Gradio:https://huggingface.co/spaces/Skywork/UniPic2-Metaquery
HuggingFace Model:https://huggingface.co/Skywork/UniPic2-SD3.5M-Kontext-2B; https://huggingface.co/Skywork/UniPic2-Metaquery-9B

最新快讯

2026年03月05日

12:23
微新创想:近日广西贵港发生了一件令人意想不到的事情。一位车主在驾驶过程中发现车辆出现异常,一踩刹车便传来奇怪的异响。起初他并未太过在意,想着等第二天去保养时再一探究竟。然而,当保养师傅对车辆进行检查后,车主顿时感到震惊不已——车底竟然被老鼠塞满了红薯和玉米,重量达到了20斤。这一发现让车主感到既惊讶又无奈,不禁感叹:“这老鼠也太聪明了吧,怎么能把这么多食物搬...
12:23
微新创想:在冰天雪地的黑龙江,寒冬里正上演着一场暖心的营救与新生故事。近日,一位女子驾车前往黑河市,途中竟在路边碰到一只正徘徊求助的动物。当时四周是荒郊野岭,天气又冷得刺骨,女子一时也拿不准这到底是流浪狗还是野狼,心里直犯嘀咕。为了安全着想,她没敢贸然停车帮忙,而是继续开着车往前走。 可这只狗狗特别执着,在后面撒开腿拼命追,一跟就是好几公里。女子看到狗狗这么...
12:23
微新创想:近日,一则关于20岁小伙因长期在嘈杂健身房使用骨传导耳机导致耳聋的消息在网络上引发了广泛关注。据报道,这位运动爱好者小李,由于健身时习惯性佩戴骨传导耳机,近期被医生确诊为噪声性耳聋。这一案例再次将慢性声损伤对听力的潜在危害推到了公众视野中。 医生指出,像小李这样的感音神经性听力损伤,一旦超过3到6个月,恢复难度极大。很多人误以为骨传导耳机因为不经过...
12:23
微新创想 3月5日消息 昨天 鸿蒙智行召开技术焕新发布会 新一代双光路图像级激光雷达迎来全球首发 华为常务董事 终端BG董事长余承东在发布会后透露 新一代双光路图像级激光雷达首发 全球量产最高896线数 几年前我担任车BU的CEO 就开始开发这款激光雷达 很不容易 今天终于与消费者见面 此次发布的华为新一代激光雷达为全球量产领域线数最高的896线超高精度...
12:23
微新创想 全国政协委员、360集团创始人周鸿祎近日透露自己已接受眼部手术更换人工晶体摘掉眼镜以适配AI眼镜并笑称眼神更像机器人了。这一举动引发广泛关注同时也展现出他对未来科技趋势的敏锐洞察。 微新创想 周鸿祎在谈及AI眼镜时表示佩戴存在反人性痛点必须找到强功能强场景才能真正普及。他指出当前AI眼镜市场面临诸多挑战其中最为关键的是如何突破用户的使用习惯与实际需...
12:23
微新创想:一加15T将于3月发布 新机在性能 续航 体验等方面全面拉满 一加15T被官方称为小屏党期待的Dream Phone。这款新机在多个方面进行了升级,旨在为用户带来更极致的使用体验。作为一加品牌在小屏旗舰领域的重要布局,一加15T不仅延续了小屏手机的便携优势,更在核心配置上实现了突破。 今日一加中国区总裁李杰正式宣布,一加15T将首发7500mAh超...
12:23
微新创想 小鹏汽车近日正式宣布G6超级增程车型将于明天下午正式上市。这款新车不仅在续航能力上实现了重大突破,还在智能驾驶、充电效率、空间设计等多个方面展现出强大的竞争力。 微新创想 G6超级增程车型的最大亮点之一是其超长的综合续航里程,达到1704公里,这一成绩在全球范围内处于领先地位。同时,其纯电续航里程也达到430公里,远超同级别车型,为用户提供了更加灵...
11:52
微新创想:一位养老院里的老爷爷因为解答高中物理题意外走红网络 最近,一段视频在网络上引起了广泛关注。视频中,一位年迈的老爷爷认真地解答高中物理题目,展现出令人敬佩的学习态度和智慧。他的专注与认真,不仅让视频的拍摄者小任感动,也让无数网友为之动容。 视频里,老爷爷头发花白,神情严肃,拿着题目仔细思考。他的样子被网友们形容为“可爱又励志”,仿佛一位重返校园的老学...
11:52
微新创想:近日一则关于20岁小伙因长期在嘈杂健身房佩戴骨传导耳机导致听力受损的新闻引发了广泛讨论。该事件让公众开始关注日常生活中潜在的听力健康风险。据多家媒体报道,这位名叫小李的运动爱好者,由于在健身房锻炼时长时间使用骨传导耳机,近期被确诊为噪声性耳聋。 医生指出,这种类型的感音神经性听力损伤一旦持续超过3到6个月,恢复的几率将大大降低。骨传导耳机虽然不经过...
11:52
微新创想:钻石市场最近发生了巨大的变化,许多消费者都感到意外和惊喜。十年前,一颗1克拉的天然钻石动辄就要花费数万元,这让不少人望而却步。然而,如今情况完全不同,同样品质的1克拉培育钻石,价格已经降至1000多元,几乎可以说是“白菜价”了。这种价格的大幅下降,让不少消费者直呼“没想到”。 钻石价格的波动背后,是培育钻石技术的不断突破和成熟。随着科技的发展,培育...
11:52
微新创想:最近广西南宁理工学院东盟校区发生了一件令人惊喜又有趣的事情,一只被师生们亲切称为“鹅学长”的大白鹅在网络上迅速走红。这只鹅不仅在校园里自由活动,还常常出现在教室中,与学生们“同堂听课”,展现出独特的校园生活场景。据学校工作人员介绍,这只“鹅学长”原本是饲养在校园景观湖里的,性格温顺,与师生互动频繁,深受喜爱。 它不仅不怕人,反而喜欢在人多的地方出现...
11:52
微新创想:周黑鸭(01458.HK)于3月4日发布2025年业绩预告,预计全年总收入将达到25.2亿至25.5亿元,同比增长2.8%至4.0%。这一增长表现得益于公司在多个方面的积极调整与优化。首先,门店结构的优化使得整体运营效率得到提升。其次,单店的盈利能力增强,进一步推动了收入的增长。此外,公司新设渠道事业部,致力于拓展多元销售渠道,为品牌带来新的增长点...