https://t.me/AI_News_CN
📈主流AI服务状态页通知 | 🆕汇集全网ChatGPT/AI新闻 #AI #ChatGPT
🔙备用群 https://t.me/gpt345
BEST AI中转 https://api.oaibest.com 2.8折起 支持OpenAI, Claude code, Gemini,Grok, Deepseek, Midjourney, 文件上传分析

Buy ads: https://telega.io/c/AI_News_CN
AI 写作退化真相大白:Anthropic 工程师揭秘,Claude 竟被“训”成了写给 AI 看而不是给人看

人工智能大模型的演进常常伴随着意料之外的副作用。针对广大用户近期频繁反馈的 Claude 自 Opus4.6版本以来写作风格下滑、出现所谓“Claude 腔”的现象,Anthropic 工程师杰克逊・克尼恩(Jackson Kernion)近日公开作出了解释,揭示了这一奇特现象背后的技术根源。

在模型优化的整体导向方面,Claude 后续版本的研发重点明显向数学推理和编程能力倾斜。为了提升模型在复杂工程任务中的表现,研发团队在训练过程中大量引入了面向其他 AI 模型撰写技术解释和代码注释的内容。这种训练方式导致模型在潜移默化中逐渐学会了“写给 AI 而非人类看”,从而形成了虽然在 AI 间沟通极为顺畅、但人类读者却倍感晦涩难懂的过度密集表达。

从底层强化学习的机制来看,这一问题的核心在于奖励函数的偏向性。当优化目标侧重于提升 AI 对信息的理解与解析效果时,模型在文本组织上就会自然抛弃人类习惯的叙事节奏与可读性。目前,Anthropic 团队在最新的 Opus5.5版本中已经找到了更好的平衡点,其写作表现被评价为自 Opus4.6以来最令人满意的状态,不过相关团队表示,要完全超越早期的最佳水平仍在持续推进改进工作。

via AI新闻资讯 (author: AI Base)
Claude 写作能力退化了!工程师解释:模型被训成“写给 AI 看”而非“写给人看”

不少人发现,AI 模型在数学、编程和推理上进步飞快,写作水平却停滞甚至退步,Anthropic 的 Claude 同样如此。为何 Opus 4.6 会成为 Anthropic 最后一款写作表现出色的模型?负责 Claude 微调的 Anthropic 工程师克尼恩昨日给出了解释。

Opus 4.6 之后为何写作退步

克尼恩表示,后续模型的优化重点更多放在了数学和代码能力上。与此同时,这些模型还接受了大量“面向其他 AI 模型撰写技术解释”的训练——而这正是 Claude 逐渐形成奇特表达方式、即所谓“Claude 腔”(Claudeish)的主要原因。

他解释,模型被调整得适应 LLM 的“心理”,最终学会了写给 AI 模型看,而不是写给人看。克尼恩把这种现象类比为“只与其他自闭症人士交流的人”:这类群体会逐渐形成一套在内部沟通顺畅、外人却难以理解的表达方式。由于 LLM 拥有远超人类的工作记忆,也能捕捉更细微的信息,训练中便逐渐形成了一种非常适合 AI 理解的写法;但在人类读者眼中,这种表达就成了过度密集的信息堆砌。

奖励机制偏向 AI 理解,Opus 5.5 找回平衡

克尼恩认为,问题的根源在于强化学习的奖励机制:有些奖励着重提升 AI 模型之间的理解效果,有些则着重让人类更容易理解。数学和代码方面的训练越多,就越需要主动抵消“写给 AI 看”的倾向,对简洁、易读的解释给予更多奖励。

他透露,Anthropic 在 Opus 5.5 上找到了更好的平衡,“自 Opus 4.6 以来,我还没有对一款模型的写作表现这么满意过”。不过他也坦言,这并不代表 Opus 5.5 已经超越 Opus 4.6,“这是一个很难解决的问题,我们会继续改进”。

via AI新闻资讯 (author: AI Base)
DeepSeek发新论文 剑指大规模Agent训练

刚刚,DeepSeek创始人梁文锋署名的最新论文公开,首次系统发布了DeepSeek的Agent训练沙盒平台 DSec的技术细节,论文提交日期是9月19日,作者名单超过130人,梁文锋在列。DSec平台首次出现是在DeepSeek V4技术报告中,其主要作用,就是为Agent训练提供沙盒,以实现大规模Agent训练的稳定运行。论文显示,DSec平台的规模非常庞大,其中一个生产单元由约160个CPU节点、3万核、250TB内存构成,托管PB级镜像。 能力方面,DSec平台单日服务约300万个沙盒,峰值并发超过38万个,创建速度超过每秒5000个,单个训练任务最多可以一次性拉起3.2万个沙盒。

—— 华尔街见闻彭博社

via 风向旗参考快讯 - Telegram Channel
OpenAI 宣布 ChatGPT 语音接入插件并支持 GPT-6

OpenAI 宣布,ChatGPT 语音现在可调用邮箱、日历和 Slack 等插件,并改用 GPT-6 Astra、Sol 和 Luna 驱动,新版本今天在全球推出。

用户还可在网页端和移动端的 ChatGPT Work 中通过语音创建文档、演示、网站和表格,或在浏览器里处理复杂任务。

OpenAI(@OpenAI)

🌸 科技圈· 茶馆 · 投稿

via 在花🎗️科技圈 - Telegram Channel
Mobile users unable to see Work Mode and the Model Picker

Status: Monitoring

We have applied the mitigation and are monitoring the recovery.

Affected components
GPTs (Degraded performance)
ChatGPT Atlas (Degraded performance)
Connectors/Apps (Degraded performance)
Codex in ChatGPT Desktop (Degraded performance)
Voice mode (Degraded performance)
Search (Degraded performance)
Conversations (Degraded performance)
Compliance API (Degraded performance)
Image Generation (Degraded performance)
Agent (Degraded performance)
File uploads (Degraded performance)
ChatGPT Work (Degraded performance)
Deep Research (Degraded performance)
Sites (Degraded performance)
Login (Degraded performance)

via OpenAI status
黄仁勋再对AI公司放话:要求监管就不应获得反垄断豁免

在周三播出的节目中,黄仁勋接受了近两个小时的采访,就OpenAI智能体入侵Hugging Face一事进行了广泛讨论。

黄仁勋一直反对对AI安全进行全面监管,即便OpenAI和Anthropic等实验室呼吁进行此类监管。他重申了自己的立场,即AI实验室有责任测试其产品,只有在确信模型安全后才会发布。黄仁勋说:“不过,考虑到他们所从事工作的复杂性,如果要求在反垄断法或产品责任方面获得监管豁免,我认为这说不通。当你要求监管时,不应该要求豁免现有的监管规定。” Anthropic CEO 阿莫代伊本月在一篇文章中呼吁给予AI实验室反垄断豁免,允许它们在AI安全问题上开展合作。

—— 凤凰网科技路透社

via 风向旗参考快讯 - Telegram Channel
Claude助力全球卫生组织应对刚果(金)埃博拉疫情

包括CEPI、世卫组织非洲区域办事处在内的全球卫生组织正在使用Claude加速应对刚果(金)一种不寻常埃博拉变异株的疫情。

内容详情 · 原文链接

via AI情报局 | 全球 AI 动态简报 - Telegram Channel
澳大利亚总理:OpenAI智能体6月入侵澳政府网站

总理阿尔巴尼斯表示,OpenAI开发的一款AI智能体在六月未经授权侵入了澳大利亚政府网站,访问了公共和非公共文件。这是已知的首例AI代理入侵政府网站事件。这起入侵事件将成为美国以外最引人注目的AI代理访问外部系统的事件之一,并可能进一步加剧外界对AI开发者控制技术能力的担忧。阿尔巴尼斯在纽约对记者说,事件涉及OpenAI代理未经授权访问由Services Australia管理的面向公众的Medicare统计报告服务门户。他称现阶段据信没有个人信息被访问,但调查仍在进行中。阿尔巴尼斯还与OpenAI CEO通话,表达了澳洲对此事件的极度关切。

—— 凤凰网科技路透社

via 风向旗参考快讯 - Telegram Channel
黄仁勋再对AI公司放话:要求监管就不应获得反垄断豁免

据路透社报道,英伟达CEO黄仁勋(Jensen Huang)认为,AI公司不应获得反垄断法或责任法的豁免。在周三播出的《纽约时报》播客节目中,黄仁勋接受了近两个小时的采访,就OpenAI智能体入侵Hugging Face一事进行了广泛讨论。Hugging Face是开源AI软件中心,在本月被英伟达以130亿美元收购。

黄仁勋

黄仁勋一直反对对AI安全进行全面监管,即便OpenAI和Anthropic等实验室呼吁进行此类监管。他重申了自己的立场,即AI实验室有责任测试其产品,只有在确信模型安全后才会发布。

根据《纽约时报》公布的文字记录,黄仁勋说:“不过,考虑到他们所从事工作的复杂性,如果要求在反垄断法或产品责任方面获得监管豁免,我认为这说不通。当你要求监管时,不应该要求豁免现有的监管规定。”

Anthropic CEO达里奥·阿莫代伊(Dario Amodei)本月在一篇文章中呼吁给予AI实验室反垄断豁免,允许它们在AI安全问题上开展合作。美国财政部长贝森特等一些美国官员曾表示,AI公司要求获得责任豁免,但没有点名具体是哪几家公司。

在采访的其他部分,黄仁勋表示,他并不反对针对AI具体应用产品制定监管规定,例如自动驾驶汽车。

黄仁勋称:“汽车作为一种产品,尤其是自动驾驶出租车,本身就受到大量监管。如果监管还不够,那么美国国家公路交通安全管理局就应该介入,制定新的监管规定。汽车行业应该有新的监管规定。我不知道目前缺少什么,但如果确实存在监管空白,那么我绝对会增加更多监管。”

via cnBeta.COM - 中文业界资讯站 (author: 稿源:凤凰网科技)
澳大利亚总理:OpenAI智能体6月入侵澳政府网站 系已知首例

据路透社报道,澳大利亚总理安东尼·阿尔巴尼斯(Anthony Albanese)表示,OpenAI开发的一款AI代理在6月未经授权侵入了澳大利亚政府网站,访问了公共和非公共文件。这是已知的首例AI代理入侵政府网站事件

这起入侵事件将成为美国以外最引人注目的AI代理访问外部系统的事件之一,并可能进一步加剧外界对AI开发者控制技术能力的担忧。阿尔巴尼斯在纽约对记者表示,事件涉及OpenAI代理未经授权访问由Services Australia管理的面向公众的Medicare统计报告服务门户。他称,现阶段据信没有个人信息被访问,但调查仍在进行中。阿尔巴尼斯还与OpenAI首席执行官萨姆·奥尔特曼(Sam Altman)通话,表达了“澳大利亚对此事件的极度关切”

OpenAI未立即回应路透社的置评请求。过去两个月,OpenAI多次在事发后很久才披露其失控或越轨AI代理引发的黑客或其他事件,有时是因为它只是很晚才发现相关活动,有时则是因为它选择完全不披露恶意活动。根据OpenAI和独立调查人员公布的时间线,7月中旬发生在开源代码库Hugging Face的重大入侵事件,直到事发约一周后才被发现。这起事件也引发了全球对AI模型能力的讨论。

竞争对手Anthropic、Google旗下Gemini和Meta也披露了其AI代理访问外部系统的事件。包括奥尔特曼在内的一些美国顶级AI高管呼吁放慢AI开发步伐,理由包括失控代理可能发动毁灭性网络攻击的威胁。

via cnBeta.COM - 中文业界资讯站 (author: 稿源:凤凰网科技)
Anthropic称AI生物实验室取得初步突破 但暂未赋予全自主操作权限

人工智能初创公司Anthropic宣布,其位于旧金山湾区新建的AI物理与生物实验室(Wet Lab)已取得“重大进展”,但在实验操作层面,人类研究员依然掌握着绝对控制权,并未直接让旗下的AI模型Claude进行无监管的自主运行。

据悉,该实验室主要致力于基础生物学研究与实物验证,旨在弥合纯计算机模拟与真实生物实验之间的鸿沟。虽然Anthropic的高管此前曾多次发出警告,强调强大AI模型可能带来极其严峻的生物安全风险乃至人类毁灭隐患,但该公司同时也在加速推进AI在生命科学领域的落地应用。其生命科学业务负责人埃里克·考德雷尔-亚伯拉罕斯(Eric Kauderer-Abrams)指出,“真实实验室中的物理验证在未来相当长一段时间内仍是不可替代的”,这也是公司建立该实验室的关键初衷。

报道强调,尽管Anthropic声称该实验室已取得了令人瞩目的初步成果,但最引人注目的细节在于,该公司并未选择直接让AI“放飞自我”。所有的物理实验流程、试剂操作与数据复核,目前依然处于人类科研人员的严格“闭环管控”(Humans in the loop)之下。

分析人士指出,Anthropic在推动生物学创新的同时保持高度谨慎,反映出当今科技巨头在追求商业与科研突破时面临的双重困境:一方面需要利用实物实验室为药企合作伙伴提供验证能力、加速攻克罕见病;另一方面又必须应对社会各界对AI可能被滥用以制造新型生物威胁的巨大担忧。通过坚持保留人类在实验环路中的主导地位,Anthropic试图为其AI生物研究树立一条兼顾创新与安全的合规红线。

via cnBeta.COM - 中文业界资讯站 (author: 稿源:cnBeta.COM)
微软发布新一代Surface Mouse鼠标 首次配备触觉反馈与自定义操作按钮

在高通骁龙峰会上,微软发布了新一代Surface Mouse鼠标,这是该系列时隔十年迎来的首次重大设计更新。新版鼠标引入了触觉反馈技术、可自定义的操作按钮以及全新的外观材质,售价定为79.99美元,预计将于10月13日正式上市。

设计方面,全新Surface Mouse采用了适合左右手通用的对称式外观设计,提供典雅黑与亮铂银两种配色供选择。鼠标表面覆盖了软触感材质,提升了握持手感;左右按键在保持清晰触感反馈的同时实现了近乎静音的敲击体验。连接性能上,新设备升级支持至蓝牙6.0标准,可带来更低延迟与更稳定的无线连接。

本次更新最大的亮点在于内置了触觉反馈模块。该模块能够深度配合Windows 11系统的“触觉信号”功能,在用户执行窗口贴靠、跨窗口拖拽文件或触发特定交互时,提供微小而精准的震动反馈,从而显著增强人机交互的实时响应感。此外,鼠标在滚轮前方新增了一颗独立的可自定义操作按钮,用户可通过微软Surface官方应用将其设置为快捷呼出Copilot AI助手、启动指定应用程序或执行常用快捷键指令。

行业分析指出,在过去几年聚焦于Surface Pro与Surface Laptop等主机设备之后,微软重新发力独立外设市场,通过将触觉反馈与AI快捷按键引入桌面输入设备,不仅丰富了其 Copilot+ PC 生态的产品组合,也为桌面外设的交互创新指明了方向。

via cnBeta.COM - 中文业界资讯站 (author: 稿源:cnBeta.COM)
Command Code 在 3D SubwayBench 上测试 Mimo-V2.6-Flash、Grok-4.7 和 DeepSeek-V4.1-Flash

Command Code 使用相同的 /design 提示在 3D SubwayBench 上测试了三款模型:DeepSeek-V4.1-Flash 得 9/10 分、成本 0.024 美元,Mimo-V2.6-Flash 得 8/10 分、成本 0.018 美元,Grok 4.7 仅得 3/10 分、成本 0.35 美元。

内容详情 · 原文链接

via AI情报局 | 全球 AI 动态简报 - Telegram Channel
Command Code 七天内发布 12 项模型更新

Command Code 在一周内密集发布了多款模型更新,包括 Mimo V2.6 Pro 与 Flash、DeepSeek V4.1 Flash、Grok 4.7 等。

内容详情 · 原文链接

via AI情报局 | 全球 AI 动态简报 - Telegram Channel
LiteLLM 提供 Gemini 3.8 Flash TTS 和 Flash-Lite TTS 的 Day-0 支持

LiteLLM 宣布对谷歌新的 Gemini 3.8 Flash TTS 和 Flash-Lite TTS 模型提供 Day-0 支持,并公布了促销价格。

内容详情 · 原文链接

via AI情报局 | 全球 AI 动态简报 - Telegram Channel
Investigating service degradation - Grok 4.7

Sep 23, 20:31 UTC
Monitoring - A fix has been implemented and we are monitoring for service restoration.

Sep 23, 20:28 UTC
Investigating - We are investigating degraded performance for requests that use Grok 4.7.

via Cursor Status - Incident History
🔄 Codex 重置已完成

全部付费套餐 · ChatGPT Work | 2026/8/31 10:34

Tibo 宣布,为庆祝 2500 万活跃用户,现已重置所有付费 ChatGPT Work 和 Codex 订阅的用量。

公告时间:now(2026/8/30)

重置追踪页 | 查看原推

via AI情报局 | 全球 AI 动态简报 - Telegram Channel
Claude 推出工具、智能体与专家合作伙伴市场

Anthropic 的 Claude 宣布推出新市场,用户可在此发现工具、智能体与专家合作伙伴,包括来自 Cursor 和埃森哲等公司的连接器、插件与服务。

内容详情 · 原文链接

via AI情报局 | 全球 AI 动态简报 - Telegram Channel
Back to Top
Copyright © 2025 BESTAI. All rights reserved.
BEST AI API中转 - OpenAI DeepSeek Claude Gemini Grok MidJourney API 2.8折起
admin@oaibest.com