昆仑万维开源Skywork UniPic模型 融合图像生成与理解能力

昆仑万维重磅发布自回归路线的「多模态统一预训练模型 Skywork UniPic」,并正式开源,为人工智能领域带来突破性进展。这款创新模型集成了图像理解、文本生成图像(T2I)和图像编辑三大核心功能于一体,展现了人工智能技术的最新突破。Skywork UniPic 的核心优势在于基于海量高质量数据进行端到端的预训练,使其具备出色的通用性和可迁移性。昆仑万维始终秉持开放合作的理念,用户可通过官方链接免费获取模型权重、技术报告和代码仓库,为开发者和研究者提供便捷的探索平台。

Skywork UniPic 借鉴了 GPT-4o 的自回归范式,通过深度融合图像理解、文本到图像生成和图像编辑任务,构建了真正统一的多模态模型架构。与传统多模态模型不同,Skywork UniPic 采用了创新的 MAR 编码器和 SigLIP2 结构设计,显著提升了模型在理解、生成和编辑任务上的综合表现。该模型支持图文理解、图像生成和图像编辑等多种功能,用户只需输入简单提示词,即可实现图像内容理解、新图像生成,甚至风格转绘等高级编辑操作。其便捷的操作性和强大的功能,迅速在开发者群体中引发广泛关注。

Skywork UniPic 以 1.5B 的轻量级参数规模,实现了媲美大型模型的卓越性能,完美诠释了“小而美”的技术设计理念。在各类权威评估中,该模型表现亮眼,尤其在指令遵循、复杂指令生成和图像编辑方面展现出超凡的执行能力。为确保 Skywork UniPic 的高性能,团队构建了精细化的数据构建和训练体系,通过精选训练数据和创新的奖励模型,持续优化模型表现。多阶段训练和渐进式任务引入机制,不仅大幅提升模型的理解和生成能力,还有效克服了多任务训练中的常见挑战。

昆仑万维开源Skywork UniPic模型 融合图像生成与理解能力插图1

Skywork UniPic 的发布为多模态人工智能模型的实用化应用开辟了新路径,显著降低了技术门槛,激励更多开发者投身这一前沿领域。以下是获取 Skywork UniPic 的官方资源链接:

模型权重:https://huggingface.co/Skywork/Skywork-UniPic-1.5B
技术报告:https://github.com/SkyworkAI/UniPic/blob/main/UNIPIC.pdf
代码仓库:https://github.com/SkyworkAI/UniPic

划重点:
? Skywork UniPic 是昆仑万维推出的开源多模态统一预训练模型,集成了图像理解、生成和编辑功能。
? 模型采用 1.5B 的轻量级设计,性能接近大型模型,便于开发者快速上手。
? 通过精细化的数据构建和多阶段训练,Skywork UniPic 在各类评估中表现卓越,推动多模态人工智能技术迈向新高度。

最新快讯

2026年01月14日

01:03
2025年,波音公司凭借不懈努力,成功交付了600架飞机,这一数字不仅彰显了其生产实力的稳步回升,更成为航空业复苏的重要里程碑。在众多机型中,737系列表现尤为突出,全年交付量高达447架,占据了总交付量的绝大部分,充分证明了该机型在全球市场依然保持着强大的竞争力。这一亮眼成绩的背后,是波音公司多年来的持续投入与艰难转型。面对过去生产瓶颈与安全事件带来的重重...
00:32
1月13日夜间,甘肃河西多地出现沙尘天气,局地发生沙尘暴。受西北气流中强风速下传影响,武威市民勤县出现明显沙尘暴,能见度显著下降。甘肃省气象局已监测到相关天气过程,提醒公众减少外出,注意防护。此次沙尘天气对交通和空气质量造成一定影响。
00:32
2026年1月14日,容百科技收到上交所问询函,被要求核实并补充披露与宁德时代签署的超1200亿元磷酸铁锂正极材料采购协议相关事项。根据公告,双方协议自2026年第一季度起至2031年,容百科技将向宁德时代供应约305万吨磷酸铁锂正极材料。问询函要求公司说明现有产能与协议产量差异较大的情况下,是否具备履约能力,并补充披露产能建设、年度交付计划、价格调整机制...
00:32
2026年1月13日,Meta启动新一轮裁员,主要涉及Reality Labs部门。此次裁员影响约10%员工,即超过1500个岗位,旨在将资源从元宇宙转向AI可穿戴设备和移动功能开发。公司首席技术官Andrew Bosworth确认,受影响员工自1月14日起陆续收到通知。Meta发言人表示,此举是为提升业务可持续性,将缩减虚拟现实项目投入,并将资金转移至今...
00:32
1月12日,《逃离鸭科夫》官方在B站及X平台暗示即将开启首次游戏联动。通过提及‘两个共通人格’‘强大战斗力’等线索,以及展示持锤与持枪的两只鸭子形象,明显指向《逃离塔科夫》中的经典Boss塔基拉和基拉。此举引发粉丝热烈猜测与互动,评论区普遍认定了此次联动角色。目前官方尚未正式官宣联动细节,但已引发广泛关注。

2026年01月13日

23:32
2026年1月13日,多位用户反馈在升级至macOS 26后,调整窗口大小功能出现响应问题。尽管窗口视觉上为圆角设计,但系统仍沿用方形窗口的19*19像素触发区域逻辑,导致75%的触发区落在窗口外部。开发者指出,用户习惯点击的绿色区域实际无法触发操作,仅红色区域有效。此设计不一致造成操作困扰,苹果尚未发布修复补丁。
23:32
2026年1月13日,谷歌股价上涨超2%,总市值达4.09万亿美元,续创历史新高。此次增长得益于其Gemini人工智能模型将为苹果Siri等AI功能提供技术支持的消息推动。该合作标志着两大科技巨头在人工智能领域深化协作,进一步拓展AI在智能设备中的应用。市场分析认为,技术整合将增强双方竞争力,推动股价持续走强。
23:32
2026年1月13日,河南金星啤酒股份有限公司正式向港交所递交上市申请。联席保荐人为中信证券与中银国际。此举标志着该公司推进资本市场布局的重要一步。上市募集资金将用于产能提升、市场拓展及品牌建设。金星啤酒成立于1982年,总部位于河南,是中国较早的民营啤酒企业之一。此次赴港上市,意在增强全国竞争力并寻求更广阔发展空间。
23:32
2026年1月13日,死了么APP宣布将在新版本中启用全球化品牌名Demumu。该决策由团队审慎讨论后作出,旨在推动品牌国际化进程。此次更名不涉及公司主体及运营模式变更,原有功能与服务保持不变。用户在更新应用后将逐步看到新品牌标识的呈现。此举被视为其拓展海外市场的重要一步。
23:32
2026年1月13日,中国航天事业再传捷报,太原卫星发射中心成功见证了一幕壮丽的太空之舞。当日,长征六号改运载火箭以雷霆万钧之势升空,精准将遥感五十号01星顺利送入预定轨道。此次发射任务不仅圆满成功,更标志着中国航天在2026年的发射征程中实现了开门红,为全年航天事业奠定了坚实基础。 长征六号改运载火箭作为中国航天领域的重要力量,此次表现再次彰显了其卓越的运...
23:32
2026年1月13日,微软正式在GitHub平台上发布了备受期待的XAML Studio 1.1版本源代码,并采用业界通用的MIT开源许可证。这款强大的开发工具基于成熟的C#语言开发,其核心使命在于赋能开发者高效创建XAML UI原型,并实现界面变化的实时可视化预览。该应用严格遵循UWP(Universal Windows Platform)架构设计,确保在...
23:32
2026年1月13日,Apple大中华区董事总经理葛越正式官宣,备受创作者期待的创新服务——Apple Creator Studio将于1月28日登陆App Store。这一全新平台将重新定义移动创作体验,通过整合行业顶尖的专业创作工具与前沿AI技术,为用户带来前所未有的创作自由。 Apple Creator Studio将首次将Final Cut Pro、...