欢迎来到【AI日报】栏目!这里是您每日探索人工智能世界的权威指南,我们为您精选并呈现AI领域的最新热点内容,始终聚焦开发者群体,助您洞悉前沿技术趋势,深入了解创新AI产品的实际应用。新鲜出炉的AI产品推荐,点击了解详情:https://top.aibase.com/1

AI日报:智谱开源百亿级视觉推理模型GLM-4.5V,达摩院推具身智能技术,360智脑亮出Light-IF系列模型插图

智谱GLM-4.5V开源发布:全球100B级最佳视觉推理模型
智谱公司正式宣布推出并开源了全球参数量达100B且效果最佳的视觉推理模型GLM-4.5V,这一重要成果标志着该公司在迈向通用人工智能(AGI)的道路上迈出了坚实一步。AiBase特别提要:🤖 GLM-4.5V总参数量高达106B,在41个视觉多模态榜单中均达到SOTA(State-of-the-Art)性能水平;🎯 该模型具备全场景视觉推理能力,涵盖图像推理、视频理解、GUI任务等多种应用场景;💡 新增”思考模式”开关,可灵活平衡推理效率与效果;💰 API调用价格极具竞争力,输入成本仅为2元/M tokens,输出成本为6元/M tokens。

AI日报:智谱开源百亿级视觉推理模型GLM-4.5V,达摩院推具身智能技术,360智脑亮出Light-IF系列模型插图1

阿里达摩院开源三项具身智能核心技术
在世界机器人大会上,阿里达摩院隆重宣布开源三项自研的具身智能核心技术:VLA模型RynnVLA-001-7B、世界理解模型RynnEC以及机器人上下文协议RynnRCP。这一战略举措旨在推动数据、模型与机器人本体的兼容适配,为具身智能开发提供完整的解决方案。AiBase特别提要:🚀 开源的三项核心技术包括VLA模型、世界理解模型和机器人上下文协议;🔗 RynnRCP实现了从传感器数据到机器人动作执行的完整工作流程;👁️ RynnVLA-001从第一人称视角视频学习人类操作技能;🌍 RynnEC从11个维度全面解析场景物体,无需依赖3D模型。详情链接:https://github.com/alibaba-damo-academy/RynnRCP

AI日报:智谱开源百亿级视觉推理模型GLM-4.5V,达摩院推具身智能技术,360智脑亮出Light-IF系列模型插图2

苹果即将升级 Apple Intelligence 至 GPT-5,推动 Siri 与写作工具智能化
苹果公司近日正式宣布,计划在即将发布的iOS26、iPadOS26和macOS Tahoe26系统更新中,将其Apple Intelligence中的ChatGPT核心模型升级至最新的GPT-5版本。这一重大升级将显著提升Siri、写作工具和视觉智能的整体性能。AiBase特别提要:🚀 苹果将在iOS26等系统更新中将ChatGPT模型升级至GPT-5,全面增强Siri、写作工具和视觉智能的功能;🚀 新版本将引入多语言实时翻译及屏幕内容分析功能,大幅提升设备在跨语言交流和信息处理方面的能力;🚀 苹果还首次向开发者开放设备端API,支持第三方应用接入,提供低延迟和高隐私的AI体验。

AI日报:智谱开源百亿级视觉推理模型GLM-4.5V,达摩院推具身智能技术,360智脑亮出Light-IF系列模型插图3

高德全面接入通义大模型 推出首个地图AI原生Agent
阿里巴巴集团旗下高德地图联合通义实验室发布全球首个AI原生地图,正式推出”小高老师”智能体,实现全链路语音交互与复杂任务推理导航。AiBase特别提要:🎙️ 内置智能体”小高老师”,支持音频/文本等多模态交互,支持随时打断的全双工语音;🧠 基于36万亿token预训练的Qwen大模型,实现空间语义深度理解与高效调度近百种内部工具;🗂️ 联合推出复杂POI推理Agent,可拆解多重约束并整合实时信息,提供精准推荐与导航;🔍 依托自研DeepResearch框架,具备规划、反思、工具调用等完整Agent能力。

AI日报:智谱开源百亿级视觉推理模型GLM-4.5V,达摩院推具身智能技术,360智脑亮出Light-IF系列模型插图4

宇树科技将出征首届世界人形机器人运动会,硬件将被多队采用
宇树科技将于8月14日至17日参加首届世界人形机器人运动会。宇树公司透露,除其自有团队外,赛场上还将有多支队伍使用宇树机器人硬件参赛,但会搭配各自自研的算法。AiBase特别提要:🤖 除宇树自有团队外,赛场上还将有多个队伍使用宇树的机器人硬件参赛,但会搭配各自研发的算法;🏟️ 此次运动会汇聚了天工、加速进化、松延动力、傅利叶、星海图等国内头部人形机器人企业,以及来自美国、德国、澳大利亚、巴西、日本等16个国家的共计280支队伍;🔧 宇树科技的参与不仅展示了其在人形机器人硬件方面的实力,也体现了其设备在开放生态中的广泛应用和竞争力。

AI日报:智谱开源百亿级视觉推理模型GLM-4.5V,达摩院推具身智能技术,360智脑亮出Light-IF系列模型插图5

Claude AI推出历史对话记忆功能,支持多背景切换
Anthropic为Claude AI上线了”记忆功能”,可自动记忆并复用用户历史对话中的背景信息,实现跨会话无缝衔接,并支持多背景隔离切换,目前仅向付费用户开放。AiBase特别提要:🔄 支持为不同项目设定独立背景,工作/生活场景一键切换,保持上下文延续;💰 先行面向Claude Max、Team、Enterprise付费用户,Pro版后续跟进,免费用户暂未开放;⚙️ 用户可在”设置—搜索和参考聊天”中手动启用或查看记忆内容;🤖 与ChatGPT手动预设不同,Claude采用自动提取机制,体验更”无感”但可控性稍弱。

360智脑推出Light-IF系列模型 显著提升复杂指令遵循能力
360智脑发布Light-IF系列模型,以”预览-自检式推理+信息熵控制”框架专治”懒惰推理”,在四大基准测试中全面领先,小参数模型即可越级挑战大模型,并全部开源。AiBase特别提要:🎯 创新Light-IF框架:难度感知指令生成→Zero-RL强化→推理模式过滤→熵保持冷启动→熵自适应正则,显著抑制”只会复述不检查”的懒惰推理;📈 权威评测霸榜:Light-IF-32B在SuperCLUE拿下0.575分,领先第二名13.9个百分点;Light-IF-1.7B小模型反超Qwen3-235B-A22B等超大模型;🔓 全面开源:模型权重将陆续上线Hugging Face,冷启动数据集与训练代码同步发布GitHub,并联合SuperCLUE推出中文评测基准SuperCLUE-CPIFOpen。

字节跳动推出视频字幕无痕擦除方案 基于DiT大模型打造
字节跳动发布全球首个基于DiT大模型的”视频字幕无痕擦除”方案,实现像素级修复、多语言适配、一键”擦除-翻译-口型同步”,助力短剧出海与跨境电商全球化。AiBase特别提要:🎞️ 两大核心:DiT视频字幕擦除大模型+字体级分割模型,像素级精准修复,告别马赛克/模糊/闪烁;🌐 多语言支持:突破中英限制,覆盖小语种,形成”擦除-翻译-口型同步”一站式闭环;⚙️ 工程落地:万集数据验证,成功率100%;分布式分镜计算,效率提升数倍。详情地址:https://console.volcengine.com/vod/

昆仑万维发布开源世界模型Matrix-Game2.0:实时生成分钟级高连贯视频
昆仑万维发布全球首个开源交互式世界模型Matrix-Game2.0,实时生成分钟级25fps高连贯视频,支持无语言提示的纯视觉驱动交互,已在GTA、Minecraft等场景落地。AiBase特别提要:🚀 开源首发:业内首个通用场景实时长序列开源世界模型,持续迭代全面开放;📹 分钟级生成:25fps连续视频,物理规律与场景语义理解大幅提升,可直接用于游戏/影视/VR;🎮 视觉驱动交互:摒弃语言提示,3D因果VAE+多模态扩散Transformer逐帧响应用户动作,跨域适应多风格场景。

昆仑万维开源Matrix-3D大模型:用单张图像可生成高质量全景视频
昆仑万维开源Matrix-3D:单张图像即可生成360°可漫游3D全景视频,轨迹一致、几何精准,全面开放代码与数据集。AiBase特别提要:🌐 单图生成3D世界:打破多视角依赖,直接由单张图像产出高质量全景视频与可探索3D场景;🎥 轨迹引导一致性:用Mesh渲染图驱动扩散模型,保证相机轨迹下的时空一致,减少伪影与遮挡;⚙️ 双路径重建:超分+结构优化慢工出细活;Transformer前馈网络极速推理,兼顾质量与效率。详情:https://github.com/SkyworkAI/Matrix-3D

最新快讯

2025年08月12日

23:54
2025年8月12日,科技界掀起了一场惊涛骇浪。人工智能领域的领军企业Perplexity突然向全球最大的搜索引擎巨头谷歌Chrome投下了一枚价值高达345亿美元的收购重磅炸弹。这一出人意料的举动瞬间引爆了整个业界的热议,无数目光聚焦于这场可能重塑全球浏览器市场版图的商业博弈。值得注意的是,截至目前,谷歌方面尚未就这一天价要约发布任何官方声明,市场各方正拭...
23:54
2025年8月12日,北京时间,国际市场银价迎来显著上涨,纽约期银价格成功突破38美元/盎司的关键心理关口,当日涨幅高达0.56%。这一积极走势的背后,是市场对贵金属需求呈现的明显回暖态势。多位行业分析师指出,当前全球经济环境仍存在诸多不确定性因素,这使得白银作为传统避险资产的价值得到进一步凸显,从而吸引了大量投资者关注。随着全球经济形势的复杂多变,白银的避...
23:54
2025年8月12日,大宗商品期货市场夜盘交易落下帷幕,多数品种录得上涨行情。数据显示,菜籽粕主力合约强势涨停,成为当日市场最耀眼的明星;菜籽油同样表现不俗,涨幅超过3%,展现出强劲的上涨动能。此外,焦煤、棕榈油等品种也纷纷上涨,涨幅均超过1%,市场整体呈现普涨格局。豆粕、棉纱等品种虽涨幅有限,但同样小幅上扬,为市场增添了一抹暖色。与之形成对比的是,PTA、...
23:54
2025年7月,波音公司交机量达到48架,其中737Max系列贡献了37架,环比下降12架,显示出市场需求的微妙变化。同期,波音成功斩获31份新订单,包括30架737Max和1架787机型,这一成绩不仅印证了波音产品线的持续吸引力,也折射出全球航空市场对高效能飞机的迫切需求。 这一数据背后,是波音公司对生产与交付节奏的精准把控。面对复杂多变的航空市场环境...
23:54
2025年8月12日,一则重磅消息在加密货币行业掀起波澜:据多方知情人士透露,知名加密货币交易所Bullish(BLSH)的首次公开募股(IPO)正迎来史无前例的热潮,其超额认购倍数已突破20倍大关。更令人瞩目的是,此次IPO的发行价预计将超越此前32至33美元的定价区间,有望达到更高水平。这一惊人表现不仅彰显了Bullish在行业内的领先地位,更折射出全球...
23:54
近日,广州市属国企珠实地产传来重磅消息,正式启动"保价行动",旗下7个热门楼盘郑重承诺"买贵即补差价",保价期限直抵2025年底。这一创新营销策略迅速引发市场热议,被视为房企应对7月广州楼市成交量下滑的积极举措。 此次"保价行动"的核心亮点在于,购房者若在保价期内购入指定楼盘,若未来市场价格上涨,开发商将退还差价。这一举措无疑为当前观望中的购房者注入了一剂强...
23:54
特斯拉近日宣布了一项重要的战略调整,正式终止其备受瞩目的超级计算机项目,并对原项目团队进行人员重组与重新分配。这一决策背后,是公司对现有业务布局的深度优化,旨在将资源集中于更具增长潜力的核心领域。据悉,该项目自启动以来,一直致力于研发高性能计算系统,为自动驾驶技术的突破性进展提供强大的算力支持。然而,随着公司整体战略的演变,管理层经过审慎评估后认为,当前资源...
23:54
2025年8月12日,Highview Merger Corp.(HVMCU)在美国证券交易所成功举行首次公开募股(IPO),开盘价报10.02美元,较原定发行价10美元略高。这一里程碑事件标志着HVMCU正式叩开美国资本市场大门,开启其公开交易的新篇章。作为一家首次公开募股的公司,此次IPO不仅为其募集了宝贵的资金,更为其未来发展奠定了坚实基础。 市场分析...
23:54
2025年8月12日,备受瞩目的McKinley Acquisition Corp.(MKLYU)在美国成功敲钟,正式拉开首次公开募股(IPO)的序幕。开盘当日,MKLYU股价以10美元的平价开盘,这一价格精准地反映了市场对该公司的初步估值,也预示着其未来发展的巨大潜力。此次IPO不仅为MKLYU打通了融资渠道,更标志着其正式迈入资本市场,成为投资者眼中的新...
23:54
受超强台风“杨柳”外围环流影响,预计8月13日至15日,我国珠江流域将迎来一轮强降雨天气过程。福建南部、广东中东部等核心区域预计将迎来50至200毫米的降水,局部地区雨量可能更大。此次降雨过程不仅范围广,强度大,更对流域内的河流水位造成显著影响。西江、北江等主要河流水位或将明显上涨,部分中小河流甚至可能出现超警洪水,同时山洪、滑坡、泥石流等地质灾害风险也将显...
23:54
2025年8月12日,上纬新材正式发布重要公告,披露了金风投控的最新减持动态。自7月9日起至公告发布当日,金风投控通过集中竞价交易系统累计减持上纬新材股份158.44万股,导致其直接持股比例从原有水平大幅下降至5.00%。这一操作不仅调整了双方的股权结构,也引发了市场的高度关注。 除了上述减持行为外,金风投控还计划以协议转让方式出售公司4.40%的股份。值得...
23:54
乐舒适有限公司于8月12日正式向香港交易所提交了首次公开募股(IPO)申请材料,标志着这家企业迈向资本市场的重要里程碑。此次IPO计划由中金公司、中信证券以及广发证券(香港)联合担任联席保荐人,共同为该公司的上市之路保驾护航。通过此次公开募股,乐舒适有限公司计划募集大量资金,用于支持公司未来的业务拓展、技术创新以及市场扩张,进一步巩固其在行业内的领先地位。这...