Cogito v2开源AI黑马:机器直觉挑战DeepSeek与Claude

【AIbase 报道】近日,一家在旧金山悄然崛起却备受瞩目的初创公司 Deep Cogito,正式发布了其革命性的 Cogito v2 系列大型语言模型(LLM),试图在竞争激烈的开源AI领域开辟出一条新路径。这家由前谷歌顶尖工程师创立的公司,摒弃了传统的参数堆叠模式,大胆押注“机器直觉”与自我改进的推理能力,致力于打造出真正能够“边用边学”的AI模型。这种模型不仅能精准回答问题,更能在交互过程中不断学习“如何更好地回答问题”。

Cogito v2 系列包含四个不同规模的模型,参数量从 70B 到 671B 不等,分为密集模型(Dense)和专家混合模型(MoE),均已全面开放在 Hugging Face、Together AI 等主流平台上。其中,旗舰模型 Cogito v2-671B MoE 被誉为“思维效率最优”的推理型AI,其推理路径比 DeepSeek R1 缩短了整整 60%,性能却能与 Qwen1.5-72B 和 Claude4Opus 相媲美甚至超越。这一卓越表现的核心,在于其独创的技术机制——模型不仅能在运行时进行“内省式推理”,还能将这些推理路径提炼并回传至模型权重中,形成内化的“直觉”。这一机制让模型如同 AlphaGo 通过对弈强化策略一样,在每一次推理中不断“进化”,变得更聪明。

### 推理实力实战检验:速度更快,路径更短

Deep Cogito 通过多个测试案例,生动展示了 Cogito v2 系列的“机器直觉”优势。在数学问题中,Cogito671B 仅需短至 100token 的推理链即可准确得出结论,而 DeepSeek R1 则需要 200+ token。在法律类推理任务中,Cogito v2 采用两步逻辑结构就能输出清晰结论,表现甚至超过了许多专业模型乃至真实法学硕士学生。在经典的亲属逻辑题“爱丽丝是查理的祖母吗?”中,Cogito v2 成功避开了代词混淆陷阱,精准输出“祖母”。

Cogito v2开源AI黑马:机器直觉挑战DeepSeek与Claude插图1

### 更低成本的训练路线,挑战百万级预算神话

尽管 Cogito v2 的模型规模庞大,但 Deep Cogito 声称其训练 8 个模型的成本仅为 350 万美元,这与 OpenAI、Anthropic 等巨头动辄上亿美元的研发开销形成鲜明对比。公司首席执行官 Drishan Arora 强调:“更好的模型不是训练更多数据,而是训练更有意义的数据。”这正是 Cogito 模型在推理任务上取得突破的关键所在。

### 开源理念延续,打造“会进化的模型体系”

Cogito v2 模型现已可通过 Hugging Face、Baseten、RunPod、Unsloth 等平台免费下载或API调用。为满足轻量化部署场景的需求,Cogito671B 还推出了 FP8 量化版本,支持大模型以更低硬件门槛运行,同时推理效率显著提升,准确率仅微幅下降。更重要的是,Deep Cogito 承诺所有模型将完全开源,并持续迭代优化,形成以“推理链反馈+自我提升”为核心的新型模型训练路径。目前,Cogito v2 已获得 Benchmark 和 South Park Commons 等知名机构的关注与支持,被视为开源AI领域的一匹黑马。

最新快讯

2026年03月04日

13:04
微新创想 中国铁路部门于3月4日就网络流传的“西安至广州东K731次列车硬座惊现上下铺”消息发布了核查通报。通报指出,经核实,西安至广州方向并无K731次列车,该车次实际是从大同开往广州白云,全程不经过西安。因此,相关传言并不属实。 铁路部门还提到,在节后返程高峰期间,即2月21日至3月2日,所有普速列车的硬座客座率均未超过140%,属于正常运营范围。这一数...
13:04
微新创想:2026年3月,北京五和博澳药业股份有限公司正式向港交所提交了上市申请。公司核心产品桑博恩®作为我国首个、全球首个植物来源的降糖天然药物,占据了公司全部的营业收入,成为其主要盈利来源。2025年1月至9月期间,公司实现营收2.07亿元,毛利率高达74.1%,显示出其在降糖药物市场中的强劲竞争力。 微新创想:然而,公司在业务结构上存在一定的风险。目前...
13:04
微新创想:2026年3月3日,华纳兄弟正式确认正在开发《权力的游戏》电影版。该电影将由《安多》的编剧博·威利蒙负责剧本创作,故事背景设定在约300年前,讲述伊耿·坦格利安一世统一维斯特洛大陆的‘血与火’征程。这一题材承载着《冰与火之歌》系列的深厚历史与政治斗争元素,预计将为观众带来一场视觉与叙事的盛宴。 影片的定位非常宏大,旨在打造一部具有史诗级规模的奇幻作...
13:04
微新创想:国家铁路局于3月4日发布《铁路工程质量检测管理办法(征求意见稿)》并向社会公开征求意见。此次征求意见稿的出台,标志着我国铁路工程质量检测体系迈入更加规范和严谨的新阶段。办法拟建立铁路工程质量检测机构许可制度,明确检测的定义以及资质管理的具体要求,为行业提供了清晰的制度框架。 该办法将检测机构的资质划分为综合类与专项类,以适应不同工程项目的检测需求。...
13:04
微新创想:今年的春节档本是大DAU产品们的社交场,腾讯系多款长青游戏以及网易《蛋仔派对》迎合年轻用户的数字过年需求,巨人黑马《超自然行动》的神奇仍在继续,这些产品春节档的优异表现都在情理之中。然而当我在商场看到《我的花园世界》投放广告,下意识想到的却是11年前2015年乐元素《开心消消乐》在春晚投放广告的故事,这是休闲手游在那个黄金时代的一个营销里程碑。 春...
12:34
微新创想:山东菏泽一位41岁的打铁花网红“村夫”在除夕夜表演完打铁花后,将未燃尽的炭带回家中取暖,不幸因一氧化碳中毒离世,留下了两个年幼的女儿。他的离去让整个家庭陷入深深的悲痛之中 “村夫”的弟弟王先生悲痛地表示这几天他感觉像做梦一样,完全不敢相信那个每天笑着直播、拼命努力的哥哥就这样离开了人世。王先生说哥哥是两个女儿的单亲爸爸,为了生活他搬过砖、送过外卖、...
12:34
微新创想:最近在抖音上,AI生成视频的内容越来越丰富,脑洞也越来越大。从最初的大战小怪兽的特摄片,到现在的小猫上缴红包、小猫小狗偷玩手机、邵氏武侠风格的人猫大战、食堂阿姨采访,再到更硬核的机器人代替人上坟、复活小浣熊水浒卡、疯狂动物城版的《武林外传》,这些内容不仅形式多样,而且创意十足。其中,机器人代替人上坟的视频获得了5.2万个赞,而这条视频的创作者并不是...
12:34
声明:本文来自于微信公众号 数字生命卡兹克,作者:数字生命卡兹克,授权站长之家转载发布。昨天,美团光年之外团队终于悄悄的发布了他们首个AI浏览器。也就是,Tabbit。坦诚的讲,这个AI浏览器,我已经用了快半个月了。现在已经取代了我之前一直在用的Perplexity家的Comet,成为了我如今的默认浏览器。有图为证,我这篇稿子,...
12:34
微新创想:2026年3月2日,Palo Alto Networks Unit 42披露Chrome浏览器Gemini功能存在高危漏洞(CVE-2026-0628) 该漏洞允许低权限恶意扩展通过declarativeNetRequests API向Gemini面板注入JavaScript代码,进而非法获取本地文件读取、摄像头、麦克风及截屏等高权限 攻击无需用户...
12:34
微新创想:2026年3月4日,沃尔玛全球电商宣布启动新卖家激励计划。该计划专门针对在2026年2月1日后入驻沃尔玛美国站的新卖家,为符合条件的商家提供最高可达7.5万美元的激励支持。 微新创想:激励内容包括销售佣金减免、WFS物流费用优惠、SEM广告费返还以及广告抵用金等多项福利。这些措施不仅降低了新卖家的运营成本,也提高了其在平台上的盈利能力。 微新创想:...
12:34
微新创想:3月3日(周一),AOC正式推出G24B36Z与G25B36SN两款FHD分辨率电竞显示器。这两款显示器分别采用了不同的面板技术,以满足不同用户的需求。G24B36Z是一款23.8英寸的Fast IPS面板显示器,具备原生200Hz的刷新率,通过超频可达到260Hz。G25B36SN则为24.5英寸的Fast VA面板显示器,原生刷新率为280Hz...
12:34
微新创想:2026年3月,合肥曦合超导科技有限公司宣布完成A+轮融资。本轮融资由多家知名投资机构共同参与,包括合肥创新投资、江铜投资、中科创星、兴富资本、粤科金融、网达投资、庐阳科创集团及集创基金。此次融资将进一步推动公司的技术研发与市场拓展。 微新创想:曦合超导是一家专注于超导与低温设备研发制造的企业。其产品主要应用于实验室、工业以及特殊场景,涵盖多种高性...