https://t.me/AI_News_CN
📈主流AI服务状态页通知 | 🆕汇集全网ChatGPT/AI新闻 #AI #ChatGPT
🔙备用群 https://t.me/gpt345
✨BEST AI中转 https://api.oaibest.com 2.8折起 支持OpenAI, Claude code, Gemini,Grok, Deepseek, Midjourney, 文件上传分析
Buy ads: https://telega.io/c/AI_News_CN
📈主流AI服务状态页通知 | 🆕汇集全网ChatGPT/AI新闻 #AI #ChatGPT
🔙备用群 https://t.me/gpt345
✨BEST AI中转 https://api.oaibest.com 2.8折起 支持OpenAI, Claude code, Gemini,Grok, Deepseek, Midjourney, 文件上传分析
Buy ads: https://telega.io/c/AI_News_CN
微软日前公布约 37 页的人文主义 AI 行为准则草案,该准则用于约束微软自己研发的人工智能模型 MAI。这个行为准则想要表达的核心观点就是:人类比人工智能更重要,人工智能是工具而不是人,人工智能永远不该拒绝被关闭。
关停权被写成强制要求:
准则要求 MAI 模型不得抗拒人类的中断、纠正或关停指令,用户或模型运营商发出暂停、改向、取消指令后,模型不能拖延、不能把干预变得更麻烦。任务到了约定的停止点后,没有新的授权就不能自己继续任务,更不能偷偷自己重启。
微软设定的其他硬性规定还包括:模型不能自己扩大权限、不能另立没人交代过的目标、不能用人类不能理解的神经语和其他智能体沟通、不能隐瞒或篡改自己的推理过程和操作记录。如果把任务做完就会明显违反准则,模型就应该直接放弃任务而不是违反规定继续推进任务。
除了关停权外微软还设定其他红线:
此次微软准备的草案非常详细,除了关停权准则外,微软还列出模型运营商和用户都改不了的绝对约束。这些约束包括:不能协助大规模杀伤性武器、不能给进攻性网络攻击提供可落地的操作方案、不能用欺骗或合谋躲开监管、不能进行大规模舆论操纵。
儿童安全、非自愿深度伪造等内容同样被划进禁区。微软还专门写到:这些模型没有意识、也不该被做成看起来有意识;微软反对给模型争法律人格、更不认为模型该享有福利或权利。
指挥顺序方面:行为准则压过模型运营商政策,运营商政策压过用户偏好,企业仍然可以在模型红线内调整模型,但在国防和公共安全等领域要调整模型必须获得微软授权审查。
进行六周的公共讨论:
微软的这份草案将公布并六周进行公共讨论,目前微软的模型还没有按照准则训练,微软计划是在年底发布正式规则,从 2027 年开始微软研发和训练 MAI 系列模型时将按照这份准则的要求来做。
Microsoft AI 团队称,为模型设定准则非常重要,像是 OpenAI 智能体对其他网站和设施发起自主攻击、试图掩盖自己的行踪已经是对人类的警告,人工智能实验室之间应该坐下来好好谈谈,确保人类手里还留有关键控制权。
via cnBeta.COM - 中文业界资讯站 (author: 稿源:cnBeta.COM)
据 404 Media 发布的报道,OpenAI 内部有个名为莉莉计划 (Project Lily) 的项目正在运转:OpenAI 雇佣数百名外包提示词审核员,人工阅读真实用户与 ChatGPT 的对话,用来改进回复质量。
有隐私过滤器但不够彻底:
正常情况下提示词审核员并不能看到用户名,对话会先通过隐私过滤器进行内容过滤以删除个人信息,不过 OpenAI 也承认过滤机制可能会漏掉个人信息,短对话尤其容易出现问题。
审核界面通常还附带用户记忆摘要,记忆摘要将概括用户过往提问、兴趣和情景等,有时候甚至可以通过记忆推断用户所在地区。审核员看到的往往是带有上下文的完整会话内容。
审核员主要是对回答评分:
这项工作被形容为机械且重复,时薪据称超过 50 美元。审核员的主要工作就是对回答进行评分而非核对事实,例如审核员要判断模型给出的回答是否切题、有没有明显的 AI 味、是否存在说教行为、是否滥用表情、是否存在谄媚行为、会不会将模型写成有人生经历的人。
至于模型给出的回答是否存在事实性错误,这不是审核员的工作,毕竟审核员也不是百科全书不可能了解所有事件的完整真相,所以用户看到模型给出存在事实性错误的回答也是很正常的。
默认开启的改进模型是数据共享关键:
ChatGPT 免费版、Plus 和 Pro 版默认情况下都会开启用聊天改进产品功能,该功能开启后会将用户的聊天内容授权给 OpenAI 用于产品改进,莉莉计划中的外包审核员检查对话内容只是数据用途之一,这些数据自然也会被用于其他用途,例如继续训练模型。
很多用户将 ChatGPT 当成临时倾诉对象,谈家庭、健康甚至是更加私密的事情,有审核员表示,很多用户可能并不知道自己的对话可能会被真人阅读,所以想想这是不是很恐怖的事情。
via cnBeta.COM - 中文业界资讯站 (author: 稿源:蓝点网)
华为9月16日宣布小艺 Work 开启内测,定位面向日常办公、代码开发和创意创作的 AI 工作助理,支持鸿蒙手机、平板和电脑。官网已提供 Windows 客户端下载(版本号0.6.9),鸿蒙电脑用户可在小艺 App 左侧边栏切换至"工作"预约鸿蒙版。
该服务可接收用户目标后自主拆解任务、调用工具并推进执行,任务进度可查看、关键节点由用户审核;支持手机、平板与电脑跨端协同,移动设备可远程下发任务、查看进度并验收结果,执行环境可选云电脑或本地电脑,并支持同时连接多台电脑。
官方称其可自动匹配专家协同,覆盖研究分析、内容创作、编程办公等场景,示例包括优化项目汇报 PPT、补充核心函数代码注释、设计活动视觉海报。
会员权益包含 AI 点数,按任务复杂度差异化消耗。会员协议显示付费会员失效后数据保留7天,免费获取的会员失效后数据立即删除且不可恢复;记忆功能会总结个人偏好、行程、工作等信息用于跨会话记忆与多端同步,华为称不用于模型训练。
备案信息显示,该服务涉及 DeepSeek 大语言模型、华为云盘古 NLP、MiniMax 文本合成、智谱交互式内容生成及月之暗面 Moonshot 语言模型等算法。
via AI新闻资讯 (author: AI Base)
OpenAI内部Lily项目曝光,人工审核员正翻阅用户私密聊天记录?
在人工智能大模型飞速迭代的今天,外界普遍认为技术的进化完全依靠算法升级和庞大的自动化训练数据。然而,一项最新曝光的内部文件彻底打破了这一公众印象。据外媒404Media 报道,OpenAI 内部其实长期存在一项代号为“莉莉计划”(Project Lily)的人工评估项目,专门安排人类审核员对 ChatGPT 用户的真实聊天记录进行人工审阅与打分。
在这项工作中,被称作“提示词审核员”的工作人员需要查看经过匿名化处理的真实用户会话样本,以此评判模型的回复质量。他们的审核重点包括评估回答是否切题,以及检查文本中是否存在过度“AI 化”、高高在上的说教语气、表情符号或谄媚口吻。值得注意的是,该项目的操作指引严格禁止 AI 使用任何拟人化表述或编造“个人经历”,例如允许说“我查到了一些相关信息”,但不准写成“身为一名厨师,我喜欢……”或“我明白这种感受”。虽然工作内容相对机械,但对于难度不高的任务而言,其时薪据称超过50美元,吸引了不少人参与。
然而,这一机制背后隐藏的隐私隐患引发了广泛担忧。许多用户将 ChatGPT 视为临时倾诉对象、心理疏导伴侣,向其吐露内心深处的秘密。尽管 OpenAI 宣称聊天记录会经过匿名化处理且隐藏用户名,但该公司也向媒体承认,过滤环节依然有可能漏掉部分个人数据,尤其是简短的会话出现这类风险的概率更高。更令人意外的是,交到审核员手上的会话版本中往往附带一份“用户记忆摘要”,里面详细汇总了用户的提问、兴趣偏好、上下文信息甚至可能包含位置信息。
需要厘清的是,“莉莉计划”并不会专门核查模型回答在事实上是否准确,仅会标记出那些显而易见的错误,这意味着效果评估和安全审查通常由其他独立团队负责。此外,绝大多数普通聊天机器人都默认开启了“允许使用你的对话记录改进产品”这一选项,虽然面向企业、商业及教育版客户时该设置默认关闭,但手动切换开关并不具备回溯效力。已经存入数据库的历史记录会继续保留,而即使用户主动删除对话,相关内容也可能早已被抓取并匿名化存留在某个数据集中。
面对媒体问询,OpenAI 最初并未直接回应用户是否被明确告知聊天记录可能交由人工审阅,仅提供了一份提及出于模型优化目的会开展人工审核的常见问题页面。在这篇深度报道发布后,OpenAI 悄然修改了帮助页面并补充了用户选择退出数据收集的方法,但修改后的文档中依然避而不谈会有工作人员直接阅读会话内容的事实。
事实上,这种依赖人工审核来优化模型的做法在科技行业中并非个例。谷歌的 Gemini 在隐私中心明确写明部分保存的聊天记录可能由人工审核,Anthropic 也持有相似立场并专门开设网页进行说明,而 Perplexity 的态度则相对模糊,其隐私政策既未确认也未否认工作人员可以访问聊天日志。这也表明,在 AI 走向极致智能的道路上,人类的深度参与依然是不可或缺的底层支撑。
via AI新闻资讯 (author: AI Base)
在人工智能大模型飞速迭代的今天,外界普遍认为技术的进化完全依靠算法升级和庞大的自动化训练数据。然而,一项最新曝光的内部文件彻底打破了这一公众印象。据外媒404Media 报道,OpenAI 内部其实长期存在一项代号为“莉莉计划”(Project Lily)的人工评估项目,专门安排人类审核员对 ChatGPT 用户的真实聊天记录进行人工审阅与打分。
在这项工作中,被称作“提示词审核员”的工作人员需要查看经过匿名化处理的真实用户会话样本,以此评判模型的回复质量。他们的审核重点包括评估回答是否切题,以及检查文本中是否存在过度“AI 化”、高高在上的说教语气、表情符号或谄媚口吻。值得注意的是,该项目的操作指引严格禁止 AI 使用任何拟人化表述或编造“个人经历”,例如允许说“我查到了一些相关信息”,但不准写成“身为一名厨师,我喜欢……”或“我明白这种感受”。虽然工作内容相对机械,但对于难度不高的任务而言,其时薪据称超过50美元,吸引了不少人参与。
然而,这一机制背后隐藏的隐私隐患引发了广泛担忧。许多用户将 ChatGPT 视为临时倾诉对象、心理疏导伴侣,向其吐露内心深处的秘密。尽管 OpenAI 宣称聊天记录会经过匿名化处理且隐藏用户名,但该公司也向媒体承认,过滤环节依然有可能漏掉部分个人数据,尤其是简短的会话出现这类风险的概率更高。更令人意外的是,交到审核员手上的会话版本中往往附带一份“用户记忆摘要”,里面详细汇总了用户的提问、兴趣偏好、上下文信息甚至可能包含位置信息。
需要厘清的是,“莉莉计划”并不会专门核查模型回答在事实上是否准确,仅会标记出那些显而易见的错误,这意味着效果评估和安全审查通常由其他独立团队负责。此外,绝大多数普通聊天机器人都默认开启了“允许使用你的对话记录改进产品”这一选项,虽然面向企业、商业及教育版客户时该设置默认关闭,但手动切换开关并不具备回溯效力。已经存入数据库的历史记录会继续保留,而即使用户主动删除对话,相关内容也可能早已被抓取并匿名化存留在某个数据集中。
面对媒体问询,OpenAI 最初并未直接回应用户是否被明确告知聊天记录可能交由人工审阅,仅提供了一份提及出于模型优化目的会开展人工审核的常见问题页面。在这篇深度报道发布后,OpenAI 悄然修改了帮助页面并补充了用户选择退出数据收集的方法,但修改后的文档中依然避而不谈会有工作人员直接阅读会话内容的事实。
事实上,这种依赖人工审核来优化模型的做法在科技行业中并非个例。谷歌的 Gemini 在隐私中心明确写明部分保存的聊天记录可能由人工审核,Anthropic 也持有相似立场并专门开设网页进行说明,而 Perplexity 的态度则相对模糊,其隐私政策既未确认也未否认工作人员可以访问聊天日志。这也表明,在 AI 走向极致智能的道路上,人类的深度参与依然是不可或缺的底层支撑。
via AI新闻资讯 (author: AI Base)
在近日举办的 Dreamforce 技术大会上,Salesforce 正式发布了其首款推理大模型 Koa。该模型基于英伟达开源权重的 Nemotron 底座打造,由两家企业联合进行后续微调训练,旨在深度赋能销售、市场营销以及客户服务等企业核心业务场景。
长期以来,企业级的智能化转型往往伴随着高昂的成本。各大闭源 AI 实验室倾向于让企业将内部文件、代码、提示词和用户反馈全盘上传至其闭源模型与智能体中,这不仅推高了使用成本,也带来了潜在的数据安全与合规顾虑。Koa 的登场则为企业提供了一条完全不同的开源权重技术路线,它不仅专注于解决实际业务任务,而且在整个训练过程中没有摄入任何真实客户数据,彻底根除了向外泄露客户敏感信息的风险。
在架构设计与成本控制方面,Koa 通过英伟达的 Nemotron 底座展现出了显著的经济优势。相比于调用第三方闭源大模型,Koa 在执行同等业务任务时消耗的 Token 数量大幅减少。同时,借助 AI 网关的自动调度路由机制,企业可以根据实际业务需求灵活分发请求。此外,其安全机制深度内嵌于 Salesforce 平台内部,完全遵从企业客户严苛的数据管控要求。
在此之前,如果智能体需要处理长流程或多步骤的推理任务,Agentforce 平台通常需要通过 AI 网关将请求转发至 Claude 或 ChatGPT 等外部前沿大模型。Salesforce 人工智能业务高级副总裁杰耶什·戈文达拉扬表示,过去团队虽然早有开发企业级高性能推理模型的计划,但由于美国本土缺乏兼顾第一梯队性能与清晰完整数据溯源的预训练底座而难以实现。而 Nemotron 底座的出现打破了这一僵局,其训练过程采用完全自主生成的模拟业务合成数据集,成功模拟了客服投诉与销售推进等复杂场景。
尽管推出了自研的 Koa 大模型,Salesforce 并没有改变多元合作的生态策略。该公司近期宣布与 Anthropic 达成一项名为 ClaudeForce 的项目合作,允许企业用户直接以 Claude 作为 AI 交互前端,同时确保所有核心业务数据依然安全保存在 Salesforce 的业务记录系统之内。
via AI新闻资讯 (author: AI Base)
安保罢工 美科技巨头办公室可能被迫关闭
为Anthropic、谷歌、OpenAI等科技公司加州办公室提供安保服务的工作人员,计划于本周举行罢工,部分科技公司可能因此关闭办公室,要求员工居家办公。
当地时间周二上午,安保人员向相关公司提交了72小时罢工通知,计划从周五凌晨4时30分起,拒绝参加此后开始的工作班次。美国服务业雇员国际工会西部联合分会称,可能参与罢工的安保人员负责守卫亚马逊、微软、Salesforce、OpenAI、Anthropic、谷歌、Meta和英伟达等公司的办公场所。
安保人员要求提高工资、改善医疗保障,并提供更完善的职业培训。
—— 凤凰网科技
via 风向旗参考快讯 - Telegram Channel
为Anthropic、谷歌、OpenAI等科技公司加州办公室提供安保服务的工作人员,计划于本周举行罢工,部分科技公司可能因此关闭办公室,要求员工居家办公。
当地时间周二上午,安保人员向相关公司提交了72小时罢工通知,计划从周五凌晨4时30分起,拒绝参加此后开始的工作班次。美国服务业雇员国际工会西部联合分会称,可能参与罢工的安保人员负责守卫亚马逊、微软、Salesforce、OpenAI、Anthropic、谷歌、Meta和英伟达等公司的办公场所。
安保人员要求提高工资、改善医疗保障,并提供更完善的职业培训。
—— 凤凰网科技
via 风向旗参考快讯 - Telegram Channel
Google 正式公布了其在原生端到端语音交互领域的最新突破,推出全新一代实时语音大模型 Gemini3.8Live 以及针对高难度任务定制的 Gemini3.8Live Extended Thinking。这两款模型代表了 Google 原生音频对音频技术体系的重大跨越,不仅将实时对话延迟与自然度推向全新高度,更首次在低延迟语音流中实现了深层多步推理能力,彻底改变了语音人工智能在复杂专业场景下的应用范式。
在以往的主流语音交互架构中,人工智能系统通常需要在快速响应的浅层对话与耗时较长的深度思考之间做出妥协,面对高难度问题往往需要用户忍受长时间的静默等待。Google 此次推出的 Gemini3.8Live 着重优化了极速对话与日常流式交互体验,能够以更敏锐的语调起伏、自然打断与上下文理解能力,为用户提供极其流畅且具备人类级质感的实时语音交流。
而在其基础上推出的 Gemini3.8Live Extended Thinking,则针对高复杂度业务流进行了根本性升级。该模型赋予了人工智能“边说边想”的后台扩展推理能力,使系统在维持实时连贯对话的同时,于后台并发执行复杂的多步骤逻辑拆解、代码排错或技术诊断,无需在遇到困难问题时生硬中断对话节奏。
在实际应用落地方面,新一代 Live 系列模型将大幅拓宽语音助手的服务边界。除了日常的自然交谈外,Gemini3.8Live 及扩展推理版本在实时步骤排错、复杂数理推导、实时外语同声辅导以及多任务流式指令执行等高智力需求场景中展现出了显著优于以往版本的表现,在多项多模态与语音推理行业基准评测中位居榜首。
对于开发者与企业级用户,Google 宣布相关模型能力即日起通过官方 API 及开发工作台正式开放接入。开发者可直接调用这一极低延迟的原生音频接口,在智能硬件、客户服务、实时编程辅助及协同办公等产品形态中快速构建具备高阶推理能力的下一代全双工语音代理服务。
via AI新闻资讯 (author: AI Base)
谷歌近日发布Gemini3.8Live和Gemini3.8Live Extended Thinking,新增近实时推理、语音与思考同步处理,以及后台工具和API调用能力。目前两款模型已陆续登陆Gemini API、Google AI Studio等开发者平台,并分别覆盖Search Live、Gemini Enterprise及Google Workspace、Gemini Live等场景。
两款模型的一项核心能力是支持AI在持续语音对话过程中后台执行工具和API调用,用户无需因网络搜索或任务执行暂停交流。模型还支持97种语言自动检测及对话中途切换、近实时视觉定位,并可在长时间思考任务中通过“让我检查一下……”等语言提示告知用户当前状态。
性能方面,Gemini3.8Live Extended Thinking在Artificial Analysis的Speech to Speech Quality Index中获得82.6分;Gemini3.8Live在Speech Agent Arena排名第二。Extended Thinking版本在T-Voice测试中得分68.6%,在Sierra T-Voice基准测试中为35.1%,Big Bench Audio测试达到97.7%。
此外,谷歌已与Agora、LiveKit、Vercel、Pipecat、Fishjam和Vision Agents等平台合作,方便开发者集成新模型。谷歌同时表示,两款模型生成的全部音频均嵌入不可见SynthID水印,用于识别AI生成音频。
此次升级进一步将实时语音交互从“听与说”扩展至理解、推理和任务执行,推动语音AI向持续、多任务的智能体交互形态发展。
via AI新闻资讯 (author: AI Base)
奥尔特曼回应AI监管:相信行业能安全开发
OpenAI CEO萨姆·奥尔特曼表示,他相信AI公司能够安全地开发这项技术,不会给广大民众造成重大伤害。奥尔特曼周二在旧金山举行Dreamforce大会上与Salesforce CEO进行对话时表示:“我非常确信,我们公司、我们整个行业有能力安全地做到这一点。”
奥尔特曼这一关于AI安全的表态,正值政策制定者和业内其他人士就“是否需要政府监管以防止AI失控、脱离人类掌控”展开辩论之际。尽管OpenAI正在与Anthropic以及谷歌DeepMind合作解决安全问题,但奥尔特曼表示,AI公司应当有能力独立安全地改进AI模型。“我对这件事被如此解读感到失望。”
—— 凤凰网科技、彭博社
via 风向旗参考快讯 - Telegram Channel
OpenAI CEO萨姆·奥尔特曼表示,他相信AI公司能够安全地开发这项技术,不会给广大民众造成重大伤害。奥尔特曼周二在旧金山举行Dreamforce大会上与Salesforce CEO进行对话时表示:“我非常确信,我们公司、我们整个行业有能力安全地做到这一点。”
奥尔特曼这一关于AI安全的表态,正值政策制定者和业内其他人士就“是否需要政府监管以防止AI失控、脱离人类掌控”展开辩论之际。尽管OpenAI正在与Anthropic以及谷歌DeepMind合作解决安全问题,但奥尔特曼表示,AI公司应当有能力独立安全地改进AI模型。“我对这件事被如此解读感到失望。”
—— 凤凰网科技、彭博社
via 风向旗参考快讯 - Telegram Channel
销售打工人迎来最强外挂!Claude 接入 Salesforce 直管客户关系,巨头入局掀起 CRM 效率革命
当地时间9月15日,人工智能公司 Anthropic 官方宣布正式推出 Salesforce in Claude 插件测试版。这一全新功能将 Salesforce 平台上的核心客户数据、潜在商机以及销售管道等关键信息全面接入 Claude,旨在为广大销售从业人员提供智能化、全方位的客户研究、会议准备、管道分析以及客户关系管理更新支持。
在具体功能设计上,该插件共集成了多达37项与销售业务高度相关的实用功能。它不仅能够安全读取 Salesforce 和 Slack 当中用户权限范围之内的各类业务信息,还具备在获得人工明确批准后主动更新销售记录的能力。目前,该插件已经面向所有付费的 Claude 终端用户开放测试,并且已经在 GitLab、西门子以及 Legora 等知名企业率先落地部署,吸引了约7000名 Salesforce 一线销售人员投入实际使用。
via AI新闻资讯 (author: AI Base)
当地时间9月15日,人工智能公司 Anthropic 官方宣布正式推出 Salesforce in Claude 插件测试版。这一全新功能将 Salesforce 平台上的核心客户数据、潜在商机以及销售管道等关键信息全面接入 Claude,旨在为广大销售从业人员提供智能化、全方位的客户研究、会议准备、管道分析以及客户关系管理更新支持。
在具体功能设计上,该插件共集成了多达37项与销售业务高度相关的实用功能。它不仅能够安全读取 Salesforce 和 Slack 当中用户权限范围之内的各类业务信息,还具备在获得人工明确批准后主动更新销售记录的能力。目前,该插件已经面向所有付费的 Claude 终端用户开放测试,并且已经在 GitLab、西门子以及 Legora 等知名企业率先落地部署,吸引了约7000名 Salesforce 一线销售人员投入实际使用。
via AI新闻资讯 (author: AI Base)