https://t.me/AI_News_CN
📈主流AI服务状态页通知 | 🆕汇集全网ChatGPT/AI新闻 #AI #ChatGPT
🔙备用群 https://t.me/gpt345
✨BEST AI中转 https://api.oaibest.com 2.8折起 支持OpenAI, Claude code, Gemini,Grok, Deepseek, Midjourney, 文件上传分析
Buy ads: https://telega.io/c/AI_News_CN
📈主流AI服务状态页通知 | 🆕汇集全网ChatGPT/AI新闻 #AI #ChatGPT
🔙备用群 https://t.me/gpt345
✨BEST AI中转 https://api.oaibest.com 2.8折起 支持OpenAI, Claude code, Gemini,Grok, Deepseek, Midjourney, 文件上传分析
Buy ads: https://telega.io/c/AI_News_CN
Investigating service degradation — Cloud Agents and Grok Bot
Sep 17, 15:20 UTC
Investigating - We are investigating a service degradation affecting Cloud Agents and Grok Bot.
via Cursor Status - Incident History
Sep 17, 15:20 UTC
Investigating - We are investigating a service degradation affecting Cloud Agents and Grok Bot.
via Cursor Status - Incident History
OpenAI 外包商能查看到真实用户与ChatGPT的聊天记录
OpenAI已悄悄建立了一个人工审核业务,根据404 Media的最新报道,该程序在内部被称为“莉莉计划”(Project Lily),旨在使聊天机器人减少谄媚并提高准确性,但它也使敏感的用户提示内容暴露给外部承包商。OpenAI正在支付数百名承包商来阅读真实的ChatGPT对话并对机器人的回复进行评分。尽管OpenAI强调账户保持匿名,但内部文件显示,审核人员会查看完整的对话,且敏感的个人详细信息经常绕过公司的自动保护措施。
—— Unusual Whales
via 风向旗参考快讯 - Telegram Channel
OpenAI已悄悄建立了一个人工审核业务,根据404 Media的最新报道,该程序在内部被称为“莉莉计划”(Project Lily),旨在使聊天机器人减少谄媚并提高准确性,但它也使敏感的用户提示内容暴露给外部承包商。OpenAI正在支付数百名承包商来阅读真实的ChatGPT对话并对机器人的回复进行评分。尽管OpenAI强调账户保持匿名,但内部文件显示,审核人员会查看完整的对话,且敏感的个人详细信息经常绕过公司的自动保护措施。
—— Unusual Whales
via 风向旗参考快讯 - Telegram Channel
还记得本月早些时候,数学家指责OpenAI试图抢占先机、争夺一道超高难度数学难题的成果,令这家公司陷入舆论风波吗?据了解该研究进展的人士透露,事实是OpenAI距离攻克千禧年大奖难题中的另一道数学难题已近在咫尺。千禧年大奖难题一共包含七大著名数学挑战,此前引发争议的纳维–斯托克斯方程存在性与光滑性问题正是其中之一。
该消息人士称,公司内部员工预计,下一个目标——霍奇猜想,有望在较短时间内得到证明。霍奇猜想研究的是:由多项式方程定义几何体时,其特定几何特征是否总能用更简单的代数组件来描述。不过,OpenAI可能需要更长时间才会对外公布证明结果。原因在于,公司正研究如何与数学界开展合作,以合适的方式发布成果,避免再次酿成公关危机。
OpenAI为何会对这些冷门艰深的数学难题产生兴趣?毕竟攻克这类问题成本不菲:此前证明纳维–斯托克斯方程相关结论,耗费的成本很可能高达数百万美元。该消息人士表示,OpenAI当时使用了下一代预训练模型的一个变体(代号“道格”)完成了这项证明。
部分OpenAI研究员认为,在软件工程之后,数学是大模型顺理成章要攻克的下一个领域。两个领域具备相似特征:都需要分步逻辑推理,得出的结果大多可以自动核验正误。一些研究员甚至判断,过去一年软件工程领域发生的自动化变革,将在未来6至9个月内在数学领域重演。
除此之外,攻克高难度数学难题,也有助于AI研发人员推进机器学习研究的自动化——机器学习本身就涉及大量数学。这类自动化,是他们迈向递归自改进(AI自主研发新AI)目标的重要一环。
测试前沿模型解决从未被证明的数学难题的能力,同样能帮助研究员评估模型的进展水平与复杂推理能力。倘若模型能够破解纳维–斯托克斯方程、霍奇猜想这类难题,这或许意味着它也有能力解决生物、化学等其他领域同等难度的问题。
另外,只要发布成果时不会引发数学家群体的强烈不满,这类突破也能为OpenAI打造亮眼的新里程碑,在通用超级人工智能的竞赛中作为宣传筹码,这一点自然也对公司有利。
via cnBeta.COM - 中文业界资讯站 (author: 稿源:环球市场播报)
在花🎗️科技圈:
🍏 iPhone 18 Pro&Duo 系列媒体评测解禁 MKBHD | 钟文泽 | 影视飓风 | 极客湾 🌸 科技圈· 茶馆 · 投稿
🍏 极客湾:苹果最强 2nm 手机芯片来了
苹果发布搭载首款 2nm 旗舰芯片 A20 Pro 的 iPhone 18 Pro 系列。A20 Pro 集成 6 核 CPU(超核提速 20%)、7 核 GPU(提速 40%)与双 16 核神经网络引擎,内存带宽较 A19 Pro 提升 50%,被苹果称为「所有智能手机中速度最快」。
芯片采用借鉴 M 系列的新封装设计,叠加 3 倍面积 VC 均热板,持续性能较上代最多提升 40%。同时发布自研 C2 调制解调器,上传提速 50%、功耗降 15%;首款定制 N1 无线芯片支持 Wi-Fi 7 与蓝牙 6。
极客湾
🌸 科技圈· 茶馆 · 投稿
via 在花🎗️科技圈 - Telegram Channel
Investigating service degradation — Grok Bot
Sep 17, 12:30 UTC
Investigating - We are investigating a service degradation affecting Grok Bot. Users may experience degraded performance or bots that don't respond.
via Cursor Status - Incident History
Sep 17, 12:30 UTC
Investigating - We are investigating a service degradation affecting Grok Bot. Users may experience degraded performance or bots that don't respond.
via Cursor Status - Incident History
OpenAI及Anthropic收入为所有中国AI模型总和的10倍
中国AI模型虽然迅速普及,但尚未转化为相应收入,引发市场对企业估值的疑问。美国研究机构 Rhodium Group 周四发表估算指出,所有中国AI模型合共产生的收入,仅相当于OpenAI及Anthropic公司所公布收入的约10%。相关数据基于年度经常性收入(ARR)指标,以近期单月收入乘以12计算,以反映高速增长。 Rhodium报告指出,深度求索在主要中国AI公司中ARR最低,为5亿美元;其次为 MiniMax 的8亿美元,以及月之暗面的10亿美元。智谱周三向投资者表示,其最新ARR为18亿美元。报告指出,中国初创企业的低收入水平,远未追上市场对其估值。
—— 雅虎新闻、彭博社
via 风向旗参考快讯 - Telegram Channel
中国AI模型虽然迅速普及,但尚未转化为相应收入,引发市场对企业估值的疑问。美国研究机构 Rhodium Group 周四发表估算指出,所有中国AI模型合共产生的收入,仅相当于OpenAI及Anthropic公司所公布收入的约10%。相关数据基于年度经常性收入(ARR)指标,以近期单月收入乘以12计算,以反映高速增长。 Rhodium报告指出,深度求索在主要中国AI公司中ARR最低,为5亿美元;其次为 MiniMax 的8亿美元,以及月之暗面的10亿美元。智谱周三向投资者表示,其最新ARR为18亿美元。报告指出,中国初创企业的低收入水平,远未追上市场对其估值。
—— 雅虎新闻、彭博社
via 风向旗参考快讯 - Telegram Channel
OpenAI最新研究:打工“牛马”用上AI 工作不知不觉变多了?
OpenAI经济研究团队周三发布报告,进一步展示了AI工具如何重塑当代打工人的职场命运。即便在今天,讨论起在职场使用AI,大多数人首先担心的是AI会不会抢走饭碗,但OpenAI的最新研究展现出另一幅画面:饭碗暂时还在,岗位边界正变得愈发模糊。
更准确地说,你原来不负责的活,开始顺手也能干了 —— 而其中一部分,干着干着可能就成了日常工作。随着打工人向AI “借”能力从事跨岗位任务,这些原本在职责范围以外的事,会逐渐成为劳动者后续使用AI的重复性任务。如果某个员工这个月已经用AI做过某项跨岗位任务,那么下个月他再次使用这项任务的概率是23.6%。
—— 财联社
via 风向旗参考快讯 - Telegram Channel
OpenAI经济研究团队周三发布报告,进一步展示了AI工具如何重塑当代打工人的职场命运。即便在今天,讨论起在职场使用AI,大多数人首先担心的是AI会不会抢走饭碗,但OpenAI的最新研究展现出另一幅画面:饭碗暂时还在,岗位边界正变得愈发模糊。
更准确地说,你原来不负责的活,开始顺手也能干了 —— 而其中一部分,干着干着可能就成了日常工作。随着打工人向AI “借”能力从事跨岗位任务,这些原本在职责范围以外的事,会逐渐成为劳动者后续使用AI的重复性任务。如果某个员工这个月已经用AI做过某项跨岗位任务,那么下个月他再次使用这项任务的概率是23.6%。
—— 财联社
via 风向旗参考快讯 - Telegram Channel
Claude Code 是一款具备 agent 能力的编程工具,运行于你的终端中,能够理解你的代码库,并通过执行例行任务、解释复杂代码以及处理 git 工作流,帮助你更快地编写代码——所有这些都只需用自然语言指令即可完成。
语言: TypeScript
Stars:145743
Forks:23517
----------------------
Claude Code is an agentic coding tool that lives in your terminal, understands your codebase, and helps you code faster by executing routine tasks, explaining complex code, and handling git workflows - all through natural language commands.
Language: TypeScript
Stars: 145743
Forks: 23517
via Trending repositories on GitHub this week · GitHub (author: anthropics)
这个开源仓库收录了一组插件,主要面向知识工作者,供其在 Claude Cowork 中使用。
语言:Python
星标:24412
Forks:2929
----------------------
Open source repository of plugins primarily intended for knowledge workers to use in Claude Cowork
Language: Python
Stars: 24412
Forks: 2929
via Trending repositories on GitHub this week · GitHub (author: anthropics)
英国 AI 初创 Emulate 启动融资,目标最高募资7亿美元、估值37亿美元
周三(9月16日),英国 AI 初创公司 Emulate 启动新一轮融资,目标最高募资7亿美元,投后估值约37亿美元,由 Index Ventures 和 Lightspeed Venture Partners 等领投。Emulate 成立于2026年8月,创始人 Jack Parker-Holder 和 Matthew McGill 均曾任职谷歌 DeepMind,两人此前参与创建 DeepMind 的 Genie 世界模型。
Genie 能依据简短提示生成逼真视频与交互式3D 环境,今年1月发布时曾在游戏行业引发震动,令 Take-Two、Roblox 和 Unity 市值合计蒸发数十亿美元。该模型经训练以理解和复现物理空间,被视为 AI 研究的新前沿;相比驱动 ChatGPT、Gemini 和 Claude 的大语言模型,这一领域的研究竞争尚不那么拥挤。Emulate 此前以隐身模式运营,是今年第三家从 DeepMind 伦敦办公室走出、获数亿美元融资的英国新实验室。
由大型 AI 公司前研究人员主导的新公司通常被称为“新实验室”(neo-labs),今年已吸引数百亿美元资金,多凭创始人声誉在产品尚未问世前就获得巨额估值。上月,谷歌首席科学家 Jeff Dean 离职赴美创办 AI 初创公司 Discovery Loop;DeepMind 前研究员 David Silver 的 Ineffable Intelligence 以50亿美元估值募资约10亿美元,DeepMind 与 OpenAI 前工程师团队创立的 Recursive Superintelligence 则以40亿美元估值募资逾6亿美元。
这类公司最大的两项成本是算力融资与招募顶尖研究人员。
via AI新闻资讯 (author: AI Base)
周三(9月16日),英国 AI 初创公司 Emulate 启动新一轮融资,目标最高募资7亿美元,投后估值约37亿美元,由 Index Ventures 和 Lightspeed Venture Partners 等领投。Emulate 成立于2026年8月,创始人 Jack Parker-Holder 和 Matthew McGill 均曾任职谷歌 DeepMind,两人此前参与创建 DeepMind 的 Genie 世界模型。
Genie 能依据简短提示生成逼真视频与交互式3D 环境,今年1月发布时曾在游戏行业引发震动,令 Take-Two、Roblox 和 Unity 市值合计蒸发数十亿美元。该模型经训练以理解和复现物理空间,被视为 AI 研究的新前沿;相比驱动 ChatGPT、Gemini 和 Claude 的大语言模型,这一领域的研究竞争尚不那么拥挤。Emulate 此前以隐身模式运营,是今年第三家从 DeepMind 伦敦办公室走出、获数亿美元融资的英国新实验室。
由大型 AI 公司前研究人员主导的新公司通常被称为“新实验室”(neo-labs),今年已吸引数百亿美元资金,多凭创始人声誉在产品尚未问世前就获得巨额估值。上月,谷歌首席科学家 Jeff Dean 离职赴美创办 AI 初创公司 Discovery Loop;DeepMind 前研究员 David Silver 的 Ineffable Intelligence 以50亿美元估值募资约10亿美元,DeepMind 与 OpenAI 前工程师团队创立的 Recursive Superintelligence 则以40亿美元估值募资逾6亿美元。
这类公司最大的两项成本是算力融资与招募顶尖研究人员。
via AI新闻资讯 (author: AI Base)
Command Code 在 29 项 AI 编程框架基准测试中并列第一
据报道,Command Code 在 29 项任务的对比测试中与 Codex、Hermes Agent 并列最佳 AI 编程框架,成绩为 21/29,并强调 token 效率。
内容详情 · 原文链接
via AI Pulse | 全球 AI 动态简报 - Telegram Channel
据报道,Command Code 在 29 项任务的对比测试中与 Codex、Hermes Agent 并列最佳 AI 编程框架,成绩为 21/29,并强调 token 效率。
内容详情 · 原文链接
via AI Pulse | 全球 AI 动态简报 - Telegram Channel
Anthropic将Claude Chat与Cowork合并
Anthropic 宣布将 Claude Chat 与主打复杂任务处理的 Cowork 合并为一个统一版本的 Claude。Anthropic 还推出了 Claude Docs 和 Claude Slides 两项新功能,并将Claude Design 能力整合进聊天界面。
该公司1月推出了Cowork,希望让用户借助AI完成更多非代码类的复杂工作;4月推出Claude Design,用于网页和原型设计。功能不断增加之后,新的问题逐渐出现。用户开始不知道应该进入哪个入口。新的Claude将聊天、Cowork、Artifacts 以及 Claude Design 集成到同一个界面中。用户无需提前判断任务类型,只需要描述自己的目标,Claude 会自动决定需要调用哪些能力。
—— 新浪财经
via 风向旗参考快讯 - Telegram Channel
Anthropic 宣布将 Claude Chat 与主打复杂任务处理的 Cowork 合并为一个统一版本的 Claude。Anthropic 还推出了 Claude Docs 和 Claude Slides 两项新功能,并将Claude Design 能力整合进聊天界面。
该公司1月推出了Cowork,希望让用户借助AI完成更多非代码类的复杂工作;4月推出Claude Design,用于网页和原型设计。功能不断增加之后,新的问题逐渐出现。用户开始不知道应该进入哪个入口。新的Claude将聊天、Cowork、Artifacts 以及 Claude Design 集成到同一个界面中。用户无需提前判断任务类型,只需要描述自己的目标,Claude 会自动决定需要调用哪些能力。
—— 新浪财经
via 风向旗参考快讯 - Telegram Channel
AI Pulse
Real-time official AI news and updates from OpenAI, Anthropic, Google Gemini, and key industry leaders. Featuring AI-powered vector search, bilingual digests, and RAG Q&A.
via AI Pulse | 全球 AI 动态简报 - Telegram Channel
Anthropic大动作:将Chat与Cowork合并,推出Docs与Slides全新功能
人工智能公司 Anthropic 宣布对其产品线进行重大整合,正式将 Claude Chat 与 Cowork 功能进行合并,推出统一版本的 Claude 应用。此次更新打破了以往不同功能之间存在明显入口区别的限制,用户现在可以在同一个对话窗口中,根据实际的任务需求随时调用聊天、Cowork 以及 Design 等多种核心能力。同时,Anthropic 还将 Claude Design 深度整合进了聊天界面,并升级了底层的记忆机制,让用户能够自主选择不同的工作模式,且此前的原有内容不会受到任何影响。
在整合应用入口的同时,Anthropic 正式推出了两项处于 Beta 测试阶段的全新功能:Claude Docs 和 Claude Slides。其中,Docs 提供了类似于 Google Docs 的实时协作体验,不仅支持内容的在线生成、修改与协作分享,还允许用户设置周期性任务自动执行;而 Slides 则支持生成、修改与协作分享,并且可以直接导出为 PowerPoint 或 PDF 格式,满足办公场景下的多样化演示需求。
在功能的发布与覆盖节奏方面,Anthropic 采取了分阶段推进的策略。这批升级后的全新功能将率先向 Pro 和 Max 计划的用户进行推送,随后逐步覆盖 Team 和 Free 计划的用户。此外,针对企业级用户,企业版管理员可以自主决定开启 Claude Docs 和 Claude Slides 测试版的时间,以保障企业内部数据安全与管理节奏。
via AI新闻资讯 (author: AI Base)
人工智能公司 Anthropic 宣布对其产品线进行重大整合,正式将 Claude Chat 与 Cowork 功能进行合并,推出统一版本的 Claude 应用。此次更新打破了以往不同功能之间存在明显入口区别的限制,用户现在可以在同一个对话窗口中,根据实际的任务需求随时调用聊天、Cowork 以及 Design 等多种核心能力。同时,Anthropic 还将 Claude Design 深度整合进了聊天界面,并升级了底层的记忆机制,让用户能够自主选择不同的工作模式,且此前的原有内容不会受到任何影响。
在整合应用入口的同时,Anthropic 正式推出了两项处于 Beta 测试阶段的全新功能:Claude Docs 和 Claude Slides。其中,Docs 提供了类似于 Google Docs 的实时协作体验,不仅支持内容的在线生成、修改与协作分享,还允许用户设置周期性任务自动执行;而 Slides 则支持生成、修改与协作分享,并且可以直接导出为 PowerPoint 或 PDF 格式,满足办公场景下的多样化演示需求。
在功能的发布与覆盖节奏方面,Anthropic 采取了分阶段推进的策略。这批升级后的全新功能将率先向 Pro 和 Max 计划的用户进行推送,随后逐步覆盖 Team 和 Free 计划的用户。此外,针对企业级用户,企业版管理员可以自主决定开启 Claude Docs 和 Claude Slides 测试版的时间,以保障企业内部数据安全与管理节奏。
via AI新闻资讯 (author: AI Base)
小米公开MiMo-V2.6大模型RL训练过程 罗福莉发文确认将开源技术细节
9月17日凌晨,小米MiMo大模型团队负责人、前DeepSeek研究员罗福莉在X平台发文,首次公开旗下最新大模型MiMo-V2.6的强化学习(RL)训练进展,并同步上线实时训练页面,开启大模型RL阶段的全程公开直播。此举标志着小米在物理世界与通用智能(AGI)道路上的探索迈入全新突破期,相关技术细节亦计划于未来数周内逐步开源。
技术架构上,MiMo-V2.6正在开展大规模多任务智能体(Agent)RL实验。团队围绕三大维度进行全面扩展:算力层面实现单步约20亿Token(1568个Prompt×16次rollout)的完全异步并行;环境层面搭建支持单次运行混合多框架的代理式RL;评估层面则采用带测试用例与量规奖励的组内信用分配机制。
直播页面实时呈现训练进度、Token消耗与成本指标,其中MiMo-V2.6-Pro版本训练约1天19小时、耗资89万美元,MiMo-V2.6-Flash时长1天14小时、耗资39.7万美元,双版本累计训练成本已突破128万美元。
作为雷军此前从DeepSeek重磅引进的“95后”AI科学家,罗福莉曾主导达摩院多语言预训练及DeepSeek-V2研发,于去年11月正式加盟小米并执掌MiMo大模型团队。今年3月,上一代万亿参数模型Mimo-V2-Pro已登顶Artificial Analysis全球大模型综合智能榜第八位(品牌榜第五)。
本次MiMo-V2.6通过透明化直播与工程细节开源,展示了小米在RL Scaling Law(强化学习扩展定律)上的深度积累,也将推动前沿大模型训练从“黑盒试错”向“极客级过程开源”的范式演进。
via AI新闻资讯 (author: AI Base)
9月17日凌晨,小米MiMo大模型团队负责人、前DeepSeek研究员罗福莉在X平台发文,首次公开旗下最新大模型MiMo-V2.6的强化学习(RL)训练进展,并同步上线实时训练页面,开启大模型RL阶段的全程公开直播。此举标志着小米在物理世界与通用智能(AGI)道路上的探索迈入全新突破期,相关技术细节亦计划于未来数周内逐步开源。
技术架构上,MiMo-V2.6正在开展大规模多任务智能体(Agent)RL实验。团队围绕三大维度进行全面扩展:算力层面实现单步约20亿Token(1568个Prompt×16次rollout)的完全异步并行;环境层面搭建支持单次运行混合多框架的代理式RL;评估层面则采用带测试用例与量规奖励的组内信用分配机制。
直播页面实时呈现训练进度、Token消耗与成本指标,其中MiMo-V2.6-Pro版本训练约1天19小时、耗资89万美元,MiMo-V2.6-Flash时长1天14小时、耗资39.7万美元,双版本累计训练成本已突破128万美元。
作为雷军此前从DeepSeek重磅引进的“95后”AI科学家,罗福莉曾主导达摩院多语言预训练及DeepSeek-V2研发,于去年11月正式加盟小米并执掌MiMo大模型团队。今年3月,上一代万亿参数模型Mimo-V2-Pro已登顶Artificial Analysis全球大模型综合智能榜第八位(品牌榜第五)。
本次MiMo-V2.6通过透明化直播与工程细节开源,展示了小米在RL Scaling Law(强化学习扩展定律)上的深度积累,也将推动前沿大模型训练从“黑盒试错”向“极客级过程开源”的范式演进。
via AI新闻资讯 (author: AI Base)
每小时烧掉三万美元!前DeepSeek大牛罗福莉加盟小米后首度直播大模型训练
一、 沉寂半年后重回大众视野
在人工智能领域备受关注的小米迎来新动态。沉寂半年的小米 MiMo 大模型团队负责人、前 DeepSeek 研究员罗福莉,于9月17日凌晨在 X 平台发文,正式对外公开并直播了当前大模型的训练过程。此次动作标志着她再次卷入激烈的大模型技术竞争中,同时也让外界得以首次窥探小米最新一代模型的内部训练状态。
二、 MiMo-V2.6的 RL 实验与三大扩展方向
根据罗福莉分享的实时训练页面显示,目前小米旗下的最新大模型MiMo-V2.6正在进行大规模的 Agent(智能体)强化学习(RL)实验。团队在此次运行中重点推进了三个维度的技术扩展:
计算资源扩展:每步计算资源大约消耗20亿 token,包含1568个提示乘以16次 rollout,采取完全异步的运行模式。
环境和测试框架扩展:构建了多任务代理式 RL,在单次运行中同步混合多个测试框架。
评估计算扩展:引入代理式组内信用分配,配备了实际测试用例和基于量规的奖励机制。
罗福莉同时透露,团队将在未来的几周内逐步向外界开源相关的技术细节。
三、 高昂的训练成本与双版本表现
从公开的实时训练数据来看,此次大模型训练展现出极高的资金与算力消耗。训练页面中目前主要包含两个并行版本:
MiMo-V2.6-Pro:累计训练时长达到1天19小时,累计耗资约89万美元,平均每小时的训练成本超过2万美元。
MiMo-V2.6-Flash:累计训练时长为1天14小时,累计耗资约39.7万美元,平均每小时的训练成本超过1万美元。
两个版本的累计训练成本目前已经突破128万美元,折算下来整体每小时的耗费超过3万美元,充分凸显出当前头部大模型在强化学习阶段对海量算力的极致诉求。
四、 团队背景与此前进展
在业务布局方面,小米高层此前曾多次公开披露 AI 领域的阶段性成果。今年3月份,小米创始人雷军曾在微博发文透露,万亿参数大模型MiMo-V2-Pro曾跻身全球大模型综合智能排行榜 Artificial Analysis 的全球第八位,在品牌排名中位列全球第五,整体表现超越了 xAI 的 Grok 模型,并计划在后续保持快速迭代与增强。
作为核心领军人物,罗福莉是一位备受瞩目的“95后”AI青年科学家。公开资料表明,她本科毕业于北京师范大学计算机专业,随后在北京大学攻读计算语言学硕士学位。毕业后,她曾加入阿里巴巴达摩院机器智能实验室担任研究员,负责多语言预训练模型 VECO 的开发,并推动了 AliceMind 项目的开源。
2022年,罗福莉加入 DeepSeek 母公司幻方量化从事深度学习相关工作,此后担任 DeepSeek 深度学习研究员,参与了 DeepSeek-V2等核心模型的研发工作。直到去年11月12日,罗福莉在朋友圈发文确认加入小米,投身 Xiaomi MiMo 团队,并致力于构建从语言迈向物理世界的 AGI(通用人工智能)未来。
via AI新闻资讯 (author: AI Base)
一、 沉寂半年后重回大众视野
在人工智能领域备受关注的小米迎来新动态。沉寂半年的小米 MiMo 大模型团队负责人、前 DeepSeek 研究员罗福莉,于9月17日凌晨在 X 平台发文,正式对外公开并直播了当前大模型的训练过程。此次动作标志着她再次卷入激烈的大模型技术竞争中,同时也让外界得以首次窥探小米最新一代模型的内部训练状态。
二、 MiMo-V2.6的 RL 实验与三大扩展方向
根据罗福莉分享的实时训练页面显示,目前小米旗下的最新大模型MiMo-V2.6正在进行大规模的 Agent(智能体)强化学习(RL)实验。团队在此次运行中重点推进了三个维度的技术扩展:
计算资源扩展:每步计算资源大约消耗20亿 token,包含1568个提示乘以16次 rollout,采取完全异步的运行模式。
环境和测试框架扩展:构建了多任务代理式 RL,在单次运行中同步混合多个测试框架。
评估计算扩展:引入代理式组内信用分配,配备了实际测试用例和基于量规的奖励机制。
罗福莉同时透露,团队将在未来的几周内逐步向外界开源相关的技术细节。
三、 高昂的训练成本与双版本表现
从公开的实时训练数据来看,此次大模型训练展现出极高的资金与算力消耗。训练页面中目前主要包含两个并行版本:
MiMo-V2.6-Pro:累计训练时长达到1天19小时,累计耗资约89万美元,平均每小时的训练成本超过2万美元。
MiMo-V2.6-Flash:累计训练时长为1天14小时,累计耗资约39.7万美元,平均每小时的训练成本超过1万美元。
两个版本的累计训练成本目前已经突破128万美元,折算下来整体每小时的耗费超过3万美元,充分凸显出当前头部大模型在强化学习阶段对海量算力的极致诉求。
四、 团队背景与此前进展
在业务布局方面,小米高层此前曾多次公开披露 AI 领域的阶段性成果。今年3月份,小米创始人雷军曾在微博发文透露,万亿参数大模型MiMo-V2-Pro曾跻身全球大模型综合智能排行榜 Artificial Analysis 的全球第八位,在品牌排名中位列全球第五,整体表现超越了 xAI 的 Grok 模型,并计划在后续保持快速迭代与增强。
作为核心领军人物,罗福莉是一位备受瞩目的“95后”AI青年科学家。公开资料表明,她本科毕业于北京师范大学计算机专业,随后在北京大学攻读计算语言学硕士学位。毕业后,她曾加入阿里巴巴达摩院机器智能实验室担任研究员,负责多语言预训练模型 VECO 的开发,并推动了 AliceMind 项目的开源。
2022年,罗福莉加入 DeepSeek 母公司幻方量化从事深度学习相关工作,此后担任 DeepSeek 深度学习研究员,参与了 DeepSeek-V2等核心模型的研发工作。直到去年11月12日,罗福莉在朋友圈发文确认加入小米,投身 Xiaomi MiMo 团队,并致力于构建从语言迈向物理世界的 AGI(通用人工智能)未来。
via AI新闻资讯 (author: AI Base)
GLM-5.3 参与优化了服务 GLM-5.3-Flash 的推理基础设施
Z.ai 分享了 GLM-5.3-Flash 推理基础设施如何在不到两周内达到生产就绪,端到端吞吐量提升至约 3.2 倍,这主要归功于由 GLM-5.3 驱动的基础设施智能体。
内容详情 · 原文链接
via AI Pulse | 全球 AI 动态简报 - Telegram Channel
Z.ai 分享了 GLM-5.3-Flash 推理基础设施如何在不到两周内达到生产就绪,端到端吞吐量提升至约 3.2 倍,这主要归功于由 GLM-5.3 驱动的基础设施智能体。
内容详情 · 原文链接
via AI Pulse | 全球 AI 动态简报 - Telegram Channel
GLM-5.3助力GLM-5.3-Flash推理基础设施,吞吐量提升3倍
Z.ai分享了GLM-5.3如何帮助构建并优化服务GLM-5.3-Flash的推理基础设施,通过密集反馈回路在不到两周内实现3倍吞吐量并达到生产就绪。
内容详情 · 原文链接
via AI Pulse | 全球 AI 动态简报 - Telegram Channel
Z.ai分享了GLM-5.3如何帮助构建并优化服务GLM-5.3-Flash的推理基础设施,通过密集反馈回路在不到两周内实现3倍吞吐量并达到生产就绪。
内容详情 · 原文链接
via AI Pulse | 全球 AI 动态简报 - Telegram Channel