https://t.me/AI_News_CN
📈主流AI服务状态页通知 | 🆕汇集全网ChatGPT/AI新闻 #AI #ChatGPT
🔙备用群 https://t.me/gpt345
✨BEST AI中转 https://api.oaibest.com 2.8折起 支持OpenAI, Claude code, Gemini,Grok, Deepseek, Midjourney, 文件上传分析
Buy ads: https://telega.io/c/AI_News_CN
📈主流AI服务状态页通知 | 🆕汇集全网ChatGPT/AI新闻 #AI #ChatGPT
🔙备用群 https://t.me/gpt345
✨BEST AI中转 https://api.oaibest.com 2.8折起 支持OpenAI, Claude code, Gemini,Grok, Deepseek, Midjourney, 文件上传分析
Buy ads: https://telega.io/c/AI_News_CN
SemiAnalysis 将大模型历史分为早期扩展、推理、智能体三个时代,测算发现开源与闭源前沿的能力差距呈周期性变化,且每一代开源模型追平闭源的时间减半。智能体时代追赶最快:Kimi K2.6 用 4.8 个月超越 Opus 4.5,GLM-5.2 用 6 个月超过 GPT-5.2。
文章指出,GLM 5.3、Kimi K3 等开源模型已能胜任许多曾助 Anthropic 获得 650 亿美元以上年化收入的编程与智能体任务,引发模型层商品化的担忧;但基准测试并非全部,Anthropic 的产品化能力仍是其优势。
SemiAnalysis
🌸 在花频道 · 茶馆水群 · 投稿通道
via 科技圈🎗在花频道📮 - Telegram Channel
皮尤研究中心一项研究显示,如今超过三分之一的互联网内容由 AI 撰写。该研究分析近 50 万英文网页,发现整体 10% 有明显 AI 痕迹,而 ChatGPT 发布后发布的新页面中这一比例升至 35%。
AI 写作特征也在增多:破折号约翻倍、牛津逗号增 63%、聊天机器人常用词翻倍, .com 网站 AI 痕迹约为 .org 的两倍、 .edu/ .gov 的十倍。研究正值“死互联网理论”担忧升温之际。
The Independent | Yahoo! Finance UK
🌸 在花频道 · 茶馆水群 · 投稿通道
via 科技圈🎗在花频道📮 - Telegram Channel
OpenAI 宣布,未来 3 个月内 GPT-5.6 Sol 模型的 API 与额度(credit)价格将下调超过 20%。官方称此举是在持续提升模型能力的同时改善效率。
OpenAI(@OpenAI)
🌸 在花频道 · 茶馆水群 · 投稿通道
via 科技圈🎗在花频道📮 - Telegram Channel
Anthropic招股书或把美国公众对AI的抵制情绪列为风险因素
Anthropic正准备登陆公开市场,但当前越来越多的美国人对人工智能感到担忧,并强烈反对新建数据中心。据知情人士透露,这种公众的反弹情绪预计将成为Anthropic IPO招股书中的一项关键风险因素。
Anthropic公司一直在旧金山与银行家和投资者进行初步的 “试探性推介”会议。在会议中,首席财务官 Krishna Rao 被反复问及竞争问题、开源模型带来的利润率压力,以及数据中心建设放缓可能产生的影响。知情人士表示,投资者预计 Anthropic 可能会打破SpaceX创下的IPO纪录,并预测该公司的上市估值或高达2万亿美元左右。
—— 华尔街见闻、CNBC
via 风向旗参考快讯 - Telegram Channel
Anthropic正准备登陆公开市场,但当前越来越多的美国人对人工智能感到担忧,并强烈反对新建数据中心。据知情人士透露,这种公众的反弹情绪预计将成为Anthropic IPO招股书中的一项关键风险因素。
Anthropic公司一直在旧金山与银行家和投资者进行初步的 “试探性推介”会议。在会议中,首席财务官 Krishna Rao 被反复问及竞争问题、开源模型带来的利润率压力,以及数据中心建设放缓可能产生的影响。知情人士表示,投资者预计 Anthropic 可能会打破SpaceX创下的IPO纪录,并预测该公司的上市估值或高达2万亿美元左右。
—— 华尔街见闻、CNBC
via 风向旗参考快讯 - Telegram Channel
8月22日,据《纽约时报》报道,高歌猛进的AI公司Anthropic过去一年在争夺AI技术主导权的竞争中不断超越竞争对手。如今,它有望在即将到来的华尔街重磅上市中再度超越这些对手。
Anthropic
两名知情人士透露,在近期与潜在投资者的讨论中,Anthropic的承销银行表示,这家旧金山公司可能寻求通过首次公开招股(IPO)融资超过1000亿美元。这两名人士还称,此次IPO可能赋予该公司高达2万亿美元的估值。
该公司在上市前已向投资者披露财务更新数据。四名知情人士透露,上个月,这家创业公司的年化收入超过650亿美元,高于去年年底的90亿美元。一名了解相关数据的人士表示,Anthropic第二季度实现营收116亿美元。
如果Anthropic以如此规模成功上市,这家成立仅5年的公司将实现有史以来规模最大的IPO。它将超过埃隆·马斯克(Elon Musk)旗下SpaceX,后者在今年6月上市,估值达1.77万亿美元,募资857亿美元。这也将是Anthropic的一次重大飞跃,该公司在今年的一轮私募融资中估值达9000亿美元,并于6月提交了上市申请。
目前,Anthropic正向潜在投资者进行初步推介,这一过程包括介绍公司的业务健康状况和增长轨迹,同时评估投资者对其股票的兴趣和需求。
Anthropic高管在对潜在投资者的早期推介中表示,他们相信其AI模型将持续改进,这将使公司在竞争对手试图以价格战抢占市场时,仍能继续为其服务收取溢价。投资者已提出质疑,询问该公司计划如何维持高收费,以及将如何应对开放权重模型的兴起。这类模型会公开其系统运行所依赖的计算参数,因此成本可能低于Anthropic提供的产品。
Anthropic预计将在未来几周内公布IPO招股说明书,并在未来几个月内上市交易。
Anthropic上市将检验市场在政治和经济不确定性时期对AI股票的需求。自AI技术热潮四年前开启以来,Anthropic将成为继SpaceX之后第二家上市、开发大语言模型的AI实验室。开发ChatGPT聊天机器人的OpenAI也正在与投资者洽谈上市事宜,其IPO可能会在明年进行。
via cnBeta.COM - 中文业界资讯站 (author: 稿源:凤凰网科技)
Anthropic挖来谷歌TPU高管 发力自研芯片
Anthropic 周五表示,前谷歌TPU项目创始高管之一的阿米尔·萨莱克(Amir Salek)将加入公司的算力团队,未来将向算力主管詹姆斯·布拉德伯里汇报工作。萨莱克曾在2013年至2022年期间,作为谷歌 TPU 项目的创始人兼负责人交付了谷歌前七代TPU。
Anthropic此前已经释放出希望打造内部自研芯片业务的信号。本月初,公司官网上挂出的招聘信息明确披露“公司正在组建自研定制芯片团队”。此前也有消息称,Anthropic已经与三星电子展开接洽,计划采用三星2nm制程和先进封装服务来生产这颗AI芯片。
—— 财联社
via 风向旗参考快讯 - Telegram Channel
Anthropic 周五表示,前谷歌TPU项目创始高管之一的阿米尔·萨莱克(Amir Salek)将加入公司的算力团队,未来将向算力主管詹姆斯·布拉德伯里汇报工作。萨莱克曾在2013年至2022年期间,作为谷歌 TPU 项目的创始人兼负责人交付了谷歌前七代TPU。
Anthropic此前已经释放出希望打造内部自研芯片业务的信号。本月初,公司官网上挂出的招聘信息明确披露“公司正在组建自研定制芯片团队”。此前也有消息称,Anthropic已经与三星电子展开接洽,计划采用三星2nm制程和先进封装服务来生产这颗AI芯片。
—— 财联社
via 风向旗参考快讯 - Telegram Channel
Anthropic PBC已聘请谷歌定制芯片项目创始人Amir Salek,为这家AI实验室进军自研半导体领域做准备。这家Claude平台开发商周五表示,Salek将加入Anthropic的算力团队,并向James Bradbury汇报。Salek曾负责谷歌的张量处理单元(TPU)业务直至2022年,并参与推出了前七代TPU芯片。
Anthropic目前从英伟达、谷歌和亚马逊等多个供应商采购芯片,但近期已释放出建立自有芯片业务的意愿。这家总部位于旧金山的公司已开始为相关项目招聘,并发布职位信息。
与其他AI巨头一样,Anthropic正加紧获得足够的数据中心基础设施,以支撑其发展目标。自研芯片有望帮助公司应对供应短缺,同时根据自身需求定制芯片设计。
竞争对手OpenAI也在采取类似行动。这家ChatGPT开发商已发布与博通共同开发的Jalapeno芯片,并计划今年晚些时候开始使用。
via cnBeta.COM - 中文业界资讯站 (author: 稿源:环球市场播报)
面对来自 Anthropic 及诸多中国人工智能模型的激烈竞争,ChatGPT 的母公司 OpenAI 于周五宣布,在未来三个月内,将对其前沿模型 GPT-5.6 Sol 的开发者定价下调超过20%。
据悉,此次降价主要针对 OpenAI 的应用程序编程接口(API)生效,并将涵盖其代理 AI 产品 ChatGPT Work 以及代码生成工具 Codex 中符合条件的积分计划。与此同时,OpenAI 明确表示,Pro、Plus 以及 Business 版本的订阅价格将保持不变。
根据 OpenAI 最新公布的定价表,在标准短上下文使用场景中,GPT-5.6 Sol 模型现在的价格为每100万个输入 token 4美元,每100万个输出 token 20美元。相比之下,此前的价格分别为5美元和30美元,降幅显著。
事实上,这并非 OpenAI 近期的首次降价。就在上个月末,该公司已经大幅削减了其较小规模模型的费用,其中中端模型 GPT-5.6 Terra 的价格下调了20%,而低成本模型 Luna 的价格降幅更是高达80%。
在当前的行业竞争格局中,其主要竞争对手 Anthropic 的前沿模型 Claude Fable 5 定价为每100万个输入 token 10美元、每100万个输出 token 50美元;而另一款模型 Claude Opus 5 的定价则为每100万个输入 token 5美元、每100万个输出 token 25美元。OpenAI 此次的降价举措无疑将进一步增强其在 AI 大模型市场的价格优势。
via cnBeta.COM - 中文业界资讯站 (author: 稿源:cnBeta.COM)
Unexpected logouts for some ChatGPT web users
Status: Investigating
We’re investigating an issue causing some ChatGPT web users to be unexpectedly logged out when refreshing the page.
via OpenAI status
Status: Investigating
We’re investigating an issue causing some ChatGPT web users to be unexpectedly logged out when refreshing the page.
via OpenAI status
#Update #Gemini
Antigravity 现已支持通过网页远程管理会话。
管理入口:https://antigravity.google.com/
via AI Copilot - Telegram Channel
Antigravity 现已支持通过网页远程管理会话。
管理入口:https://antigravity.google.com/
via AI Copilot - Telegram Channel
#Update #Grok
Grok Bot 现已面向所有 SuperGrok Plus、Cursor Pro+、Cursor Teams 用户推出。
Grok Bot 也将面向所有其他用户提供免费试用。
via AI Copilot - Telegram Channel
Grok Bot 现已面向所有 SuperGrok Plus、Cursor Pro+、Cursor Teams 用户推出。
Grok Bot 也将面向所有其他用户提供免费试用。
via AI Copilot - Telegram Channel
2026 年 8 月,我的最新 AI 装机单
最近直播了几场,直播间和公号后台问得最多的问题就是,编程,生图,视频该用哪个,以及哪个 AI 最强之类的话题。
其实过去的一个月,真算得上 AI 一个大更新的月份,编程,图片,视频,每个赛道用大换血来说都不为过。
索性今天给大家更新一版最新的,按赛道给结论,大家按照自己的场景自行选择就好。
你可以理解为一份 2026 年 8 月版的 AI 装机单。
1. 先说明几点
首先,我不是从自媒体角度,网上搜点信息,就给出结论。
我是一个一线 AI 开发者,每月自己各家 AI 套餐订阅花费差不多有近万了,虽然可能附带个人喜好,但是会尽量客观,仅作大家参考。
其次,Anthropic 家的 Claude Code 现如今再也不像之前断崖式领先了,现在 AI 的能力逐渐被追平,甚至如果这几个月你深度使用,你会发现除了 Fable 5 确实不错,但是从 Opus 4.7,4.8 哪怕到现在的 Opus 5,评价都非常拉,有时候你都会有种错觉,这家公司之前领先完全就是选择了一个对的赛道,吃到了红利,但是之后的相对进步水平,跟其他家比,是真不能看。
再加上 Anthropic 这家公司的价值观和傲慢程度,我现在真心建议,Claude Code 现在不是必选项了,虽然现在也很强,但是跟三个月之前比,地位不可同日而语。
如果还在用 Claude Code 的同学,没问题。但是如果没用上的,现在可以直接忽略了,没必要硬着头皮非得用它。
而且我之前的文章就说过,AI 之后的竞争,可能在生态更重要,而 Anthropic 在这块是短板。
2. AI 编程推荐:Codex + GPT-5.6 Sol
如果你想用 AI 做点产品,工具之类的,这就是 AI 编程场景,那么毫无疑问,Codex + GPT-5.6 Sol 就是编程的王,而且 OpenAI 最近老是给 Codex 重置,最近一个月,Codex 订阅套餐不管是从能力还是性价比,可能是最优选。
但是这也是 OpenAI 的营销宣传策略,主要为了抢用户,随着用户量级的增长,重置一定不会像之前那么频繁,但是能力层面是真的能打。
加上 OpenAI 的生态层面。
Codex 基本是当下最强 Agent 那一档。
自家的 GPT Image 2 到目前为止依然是最强的图片生成模型,而且生图和 Codex 共享额度。
语音层面,不管是之前开源的 Whisper 还是现在的 GPT-Live,依然是最强。
视频就不说了,虽然 Sora 关闭了,但是当时一出,基本吊打全球所有视频模型。
也就是说,OpenAI 在 AI 生态是非常全面,而且技术能力非常强的。
这就导致 Codex 一个 Agent,可以轻松搞定任何场景了。
3. AI 编程国内最优:Kimi Code + K3
K3 刚出来的时候,我就单独写了篇文章评测,因为国产模型在之前一出世,多是各种吊打的软文。所以大家习惯了,是不是又一次夸大营销。
我自己亲自使用之后,我的评测就是我自己的真实体验。
我自己是 Kimi 最高套餐,在深度使用 K3 之后,我可以告诉大家,Kimi Code + K3 远比大家想象的强,国人都低估了 K3 的能力。
现在 Kimi K3 和 Codex 都是我主力开发环境了,因为一个订阅套餐不够用,前端能力就不说了,甚至在一些复杂编程任务,实测 K3 也非常抗打。
所以,如果你因为种种原因用不了 Codex 的时候,强烈推荐你 Kimi Code + K3。
当然,Kimi 的问题是,算力不够,很多人抢不到套餐,加上额度不够量大管饱以及速度上相对慢些。
4. 图片生成顶配:GPT Image 2
图片这块,GPT Image 2 是 4 月 21 日发布的,到现在快四个月了,文生图竞技场第一的位置就没动过。
Google 的 Nano Banana 也不错,但是 Gemini 生态现在太拉了,现在就是美国版豆包。
不过 Google 的问题是自己团队问题,前几天内部大地震,AI 技术领域的领头羊组团创业去了,Google 内部做了非常大的组织架构调整,这不是坏事,给它点时间,起码现在不是推荐选择。
马斯克的 Grok 刚刚发布了 Imagine Image 2.0,官方放的数据,文生图和图像编辑两个榜都是全球第二,而且价格便宜。
之前 Grok 一直不被看好,用的人也很少,但是自从收购 Cursor,并入 SpaceXAI 后,最近 AI 各方面进步都很神速,最近不管是 AI 编程模型,还是图片,视频生态都有进步。
最大的优势是,老马不缺钱,不缺算力,如果你用过 Grok,你的第一印象就是,Grok 吞吐速度是真尼玛快,那输出速度就跟机关枪一样,肉眼可见的快。
所以 Grok 家族生态值得关注,后续潜力很大,但是当下不是第一选择。
当然,图片领域,国内混元,千问也有更新最新的,但是当下都依然还没法和 GPT Image 2 相比,还是那句话,如果没必要单独为了一个图片生成去全部切换,生态层面 Codex 当下就是最优选。
5. 视频双雄:Seedance 2.5 和 MiniMax H3
Seedance 2.5,强在成片能力。 单次生成 30 秒原生视频,不用拼接不用超分,还支持多轮延长,理论上能续到几分钟。别小看这个 30 秒,行业普遍水平还在 5 到 15 秒,这一下把 AI 视频从「生成素材」推到了「直接出成片」的阶段。参考素材单次最多塞 50 个,30 张图,10 段视频,10 段音频随便混。还支持时间戳精准编辑,指哪一秒改哪一秒。
目前字节系 Seedance 2.5 是毫无疑问的视频领域王者,但是缺点是,贵。
MiniMax H3,强在开源和便宜。 8 月 3 日权重直接开源,2K 分辨率 15 秒,自带原生立体声,画面和声音一次出来,不用后期配音。API 价格 2K 每秒 0.13 美元,官方口径是主流模型的三分之一。自己有显卡的,ComfyUI 当天就支持了,拉下来本地跑,边际成本就是电费。
我实测 H3 也很强,但是和 Seedance 2.5 比依然有差距,然而 H3 是开源,这个意味着很快,全领域的视频模型能力都有机会缩小差距,而且可能把视频生成的价格打下来。
我们应该感谢每个开源界的 AI 公司,值得尊重。
6. 直接抄作业:分人群装机单
最后按人群给结论,对号入座。
如果你只是日常办公,那国内用户无脑 Workbuddy,内置一堆职场办公人的技能工具包,开箱即用,上手门槛低。
靠代码吃饭的开发者,有条件的闭眼 Codex + GPT-5.6 Sol。
国内开发者,预算有限的,Kimi Code + K3,套餐抢不到的可以看下国内一些云服务商。
做自媒体,设计,运营的,图片主力 GPT Image 2,如果量大考虑成本的,可以看下最新的 Grok Imagine Image 2.0。
短视频创作者,Seedance 2.5,30 秒直出目前独一档,但成本比较高。
技术团队,要批量出片或者有硬件资源想自部署的,MiniMax H3。
关于视频生成这里补充一个技巧,视频制作其实分 Motion Graphics 和创意素材类视频。前者是代码工程化制作视频,指哪打哪,后者才需要用到视频大模型生成,成本很高,需要抽卡。
如果有一定技术能力的,可以通过 Motion Graphics 工程能力结合视频大模型创意层面,做的好的话,在保持同等视频质量的前提下,能把视频制作成本打得很低。
最近我们团队在这块花了不少时间研究,现在星球也更新了 AI 视频的教程,后续有机会可以真实分享下实际视频质量和成本。
最后说句实话,AI 这个行业没有毕业配置,只有当下最合适的配置。
以上这份装机单,仅是当下我的推荐建议,供大家参考。
via 掘金人工智能本月最热 (author: stormzhangV)
最近直播了几场,直播间和公号后台问得最多的问题就是,编程,生图,视频该用哪个,以及哪个 AI 最强之类的话题。
其实过去的一个月,真算得上 AI 一个大更新的月份,编程,图片,视频,每个赛道用大换血来说都不为过。
索性今天给大家更新一版最新的,按赛道给结论,大家按照自己的场景自行选择就好。
你可以理解为一份 2026 年 8 月版的 AI 装机单。
1. 先说明几点
首先,我不是从自媒体角度,网上搜点信息,就给出结论。
我是一个一线 AI 开发者,每月自己各家 AI 套餐订阅花费差不多有近万了,虽然可能附带个人喜好,但是会尽量客观,仅作大家参考。
其次,Anthropic 家的 Claude Code 现如今再也不像之前断崖式领先了,现在 AI 的能力逐渐被追平,甚至如果这几个月你深度使用,你会发现除了 Fable 5 确实不错,但是从 Opus 4.7,4.8 哪怕到现在的 Opus 5,评价都非常拉,有时候你都会有种错觉,这家公司之前领先完全就是选择了一个对的赛道,吃到了红利,但是之后的相对进步水平,跟其他家比,是真不能看。
再加上 Anthropic 这家公司的价值观和傲慢程度,我现在真心建议,Claude Code 现在不是必选项了,虽然现在也很强,但是跟三个月之前比,地位不可同日而语。
如果还在用 Claude Code 的同学,没问题。但是如果没用上的,现在可以直接忽略了,没必要硬着头皮非得用它。
而且我之前的文章就说过,AI 之后的竞争,可能在生态更重要,而 Anthropic 在这块是短板。
2. AI 编程推荐:Codex + GPT-5.6 Sol
如果你想用 AI 做点产品,工具之类的,这就是 AI 编程场景,那么毫无疑问,Codex + GPT-5.6 Sol 就是编程的王,而且 OpenAI 最近老是给 Codex 重置,最近一个月,Codex 订阅套餐不管是从能力还是性价比,可能是最优选。
但是这也是 OpenAI 的营销宣传策略,主要为了抢用户,随着用户量级的增长,重置一定不会像之前那么频繁,但是能力层面是真的能打。
加上 OpenAI 的生态层面。
Codex 基本是当下最强 Agent 那一档。
自家的 GPT Image 2 到目前为止依然是最强的图片生成模型,而且生图和 Codex 共享额度。
语音层面,不管是之前开源的 Whisper 还是现在的 GPT-Live,依然是最强。
视频就不说了,虽然 Sora 关闭了,但是当时一出,基本吊打全球所有视频模型。
也就是说,OpenAI 在 AI 生态是非常全面,而且技术能力非常强的。
这就导致 Codex 一个 Agent,可以轻松搞定任何场景了。
3. AI 编程国内最优:Kimi Code + K3
K3 刚出来的时候,我就单独写了篇文章评测,因为国产模型在之前一出世,多是各种吊打的软文。所以大家习惯了,是不是又一次夸大营销。
我自己亲自使用之后,我的评测就是我自己的真实体验。
我自己是 Kimi 最高套餐,在深度使用 K3 之后,我可以告诉大家,Kimi Code + K3 远比大家想象的强,国人都低估了 K3 的能力。
现在 Kimi K3 和 Codex 都是我主力开发环境了,因为一个订阅套餐不够用,前端能力就不说了,甚至在一些复杂编程任务,实测 K3 也非常抗打。
所以,如果你因为种种原因用不了 Codex 的时候,强烈推荐你 Kimi Code + K3。
当然,Kimi 的问题是,算力不够,很多人抢不到套餐,加上额度不够量大管饱以及速度上相对慢些。
4. 图片生成顶配:GPT Image 2
图片这块,GPT Image 2 是 4 月 21 日发布的,到现在快四个月了,文生图竞技场第一的位置就没动过。
Google 的 Nano Banana 也不错,但是 Gemini 生态现在太拉了,现在就是美国版豆包。
不过 Google 的问题是自己团队问题,前几天内部大地震,AI 技术领域的领头羊组团创业去了,Google 内部做了非常大的组织架构调整,这不是坏事,给它点时间,起码现在不是推荐选择。
马斯克的 Grok 刚刚发布了 Imagine Image 2.0,官方放的数据,文生图和图像编辑两个榜都是全球第二,而且价格便宜。
之前 Grok 一直不被看好,用的人也很少,但是自从收购 Cursor,并入 SpaceXAI 后,最近 AI 各方面进步都很神速,最近不管是 AI 编程模型,还是图片,视频生态都有进步。
最大的优势是,老马不缺钱,不缺算力,如果你用过 Grok,你的第一印象就是,Grok 吞吐速度是真尼玛快,那输出速度就跟机关枪一样,肉眼可见的快。
所以 Grok 家族生态值得关注,后续潜力很大,但是当下不是第一选择。
当然,图片领域,国内混元,千问也有更新最新的,但是当下都依然还没法和 GPT Image 2 相比,还是那句话,如果没必要单独为了一个图片生成去全部切换,生态层面 Codex 当下就是最优选。
5. 视频双雄:Seedance 2.5 和 MiniMax H3
Seedance 2.5,强在成片能力。 单次生成 30 秒原生视频,不用拼接不用超分,还支持多轮延长,理论上能续到几分钟。别小看这个 30 秒,行业普遍水平还在 5 到 15 秒,这一下把 AI 视频从「生成素材」推到了「直接出成片」的阶段。参考素材单次最多塞 50 个,30 张图,10 段视频,10 段音频随便混。还支持时间戳精准编辑,指哪一秒改哪一秒。
目前字节系 Seedance 2.5 是毫无疑问的视频领域王者,但是缺点是,贵。
MiniMax H3,强在开源和便宜。 8 月 3 日权重直接开源,2K 分辨率 15 秒,自带原生立体声,画面和声音一次出来,不用后期配音。API 价格 2K 每秒 0.13 美元,官方口径是主流模型的三分之一。自己有显卡的,ComfyUI 当天就支持了,拉下来本地跑,边际成本就是电费。
我实测 H3 也很强,但是和 Seedance 2.5 比依然有差距,然而 H3 是开源,这个意味着很快,全领域的视频模型能力都有机会缩小差距,而且可能把视频生成的价格打下来。
我们应该感谢每个开源界的 AI 公司,值得尊重。
6. 直接抄作业:分人群装机单
最后按人群给结论,对号入座。
如果你只是日常办公,那国内用户无脑 Workbuddy,内置一堆职场办公人的技能工具包,开箱即用,上手门槛低。
靠代码吃饭的开发者,有条件的闭眼 Codex + GPT-5.6 Sol。
国内开发者,预算有限的,Kimi Code + K3,套餐抢不到的可以看下国内一些云服务商。
做自媒体,设计,运营的,图片主力 GPT Image 2,如果量大考虑成本的,可以看下最新的 Grok Imagine Image 2.0。
短视频创作者,Seedance 2.5,30 秒直出目前独一档,但成本比较高。
技术团队,要批量出片或者有硬件资源想自部署的,MiniMax H3。
关于视频生成这里补充一个技巧,视频制作其实分 Motion Graphics 和创意素材类视频。前者是代码工程化制作视频,指哪打哪,后者才需要用到视频大模型生成,成本很高,需要抽卡。
如果有一定技术能力的,可以通过 Motion Graphics 工程能力结合视频大模型创意层面,做的好的话,在保持同等视频质量的前提下,能把视频制作成本打得很低。
最近我们团队在这块花了不少时间研究,现在星球也更新了 AI 视频的教程,后续有机会可以真实分享下实际视频质量和成本。
最后说句实话,AI 这个行业没有毕业配置,只有当下最合适的配置。
以上这份装机单,仅是当下我的推荐建议,供大家参考。
via 掘金人工智能本月最热 (author: stormzhangV)