https://t.me/AI_News_CN
📈主流AI服务状态页通知 | 🆕汇集全网ChatGPT/AI新闻 #AI #ChatGPT
🔙备用群 https://t.me/gpt345
✨BEST AI中转 https://api.oaibest.com 2.8折起 支持OpenAI, Claude code, Gemini,Grok, Deepseek, Midjourney, 文件上传分析
Buy ads: https://telega.io/c/AI_News_CN
📈主流AI服务状态页通知 | 🆕汇集全网ChatGPT/AI新闻 #AI #ChatGPT
🔙备用群 https://t.me/gpt345
✨BEST AI中转 https://api.oaibest.com 2.8折起 支持OpenAI, Claude code, Gemini,Grok, Deepseek, Midjourney, 文件上传分析
Buy ads: https://telega.io/c/AI_News_CN
微软今日宣布进一步拓展其自研 AI 模型阵营,正式推出高保真图像生成与编辑模型 MAI-Image-2.5-Pro,并开启低延迟文本转语音模型 MAI-Voice-2-Flash 的公测。
作为微软迄今为止精度最高的图像生成模型,MAI-Image-2.5-Pro 专为需要精细化图像生成、二次编辑、主视觉海报设计以及更精准文本渲染的应用场景打造。在定价策略上,该模型每百万文本输入 Token 售价 5 美元,每百万图像输入 Token 售价 8 美元,每百万图像输出 Token 售价 106 美元。目前开发者与用户已可在 MAI Playground 平台免费体验该模型。
与此同时,微软发布的 MAI-Voice-2-Flash 专注于客服机器人等高并发、低延迟的语音应用场景。官方数据显示,在保持自然语调与高品质音质的前提下,MAI-Voice-2-Flash 的运行速度提升了一倍,成本降低了 32%,其定价为每百万字符 15 美元。
微软透露,旗下多项核心业务已全面接入自研 MAI 系列模型。例如,Bing Image Creator 已全量切换由 MAI-Image-2.5 驱动,PowerPoint 的图生图功能也已接入该模型;相比此前采用的第三方方案,切换至自研模型后 GPU 成本最高降低了 84%。在 OneDrive 中,MAI-Image-2.5 的应用使图像编辑保存率提升了 26%,P95 延迟降低约 25%。此外,MAI-Voice-2-Flash 已率先应用于 Dynamics 365 联络中心,节省了高达 89% 的 GPU 成本,并作为 Azure Voice Live 的一部分供开发者构建语音交互 Agent。多语言转录模型 MAI-Transcribe-1.5 也已成功为 Dragon Copilot 提供跨 58 种语言的听写服务。
via cnBeta.COM - 中文业界资讯站 (author: 稿源:cnBeta.COM)
美国加利福尼亚州第36国会选区众议员泰德·刘(Ted Lieu)与德克萨斯州第1st国会选区众议员纳撒尼尔·莫兰(Nathaniel Moran)联合起草了一项名为《AI紧急断路器法案》(AI Kill Switch Act)的拟议立法。该法案旨在赋予美国国土安全部(DHS)在应对紧急威胁事件时,向大型人工智能开发商下达强制指令的广泛权力,要求其关闭或暂停正在运行的AI模型。
根据法案草案,该规定将适用于年技术营收达到或超过5亿美元,且模型训练计算成本超过1亿美元的AI企业,主要涵盖 OpenAI、Google、Anthropic 和 Microsoft 等行业巨头。除了赋予国土安全部触发紧急关停的权限外,法案还要求相关企业必须具备多层级的技术应对能力,以便在接到指令时能够立即停止AI推理(即生成响应或执行动作)、终止用户访问、限制算力分配,或将业务安全平滑地迁移至备份系统。
法案还明确设立了触发紧急干预的法定条件。国土安全部在发布关停指令前,必须与国家情报总监及商务部长进行会商。法定触发条件包括:AI引发导致10人及以上死亡的重大事件、造成超过1亿美元的经济损失、AI试图通过虚假信息向安全监控人员隐瞒其真实能力、违背人类指令并擅自修改自身安全规则,或者试图非法获取自身模型权重等行为。
针对未能遵守该法案要求的企业,草案拟定了高额的民事罚款机制。如果企业未依法建立技术关停机制或未能如实上报安全事件,国土安全部长可向联邦法院申请对其处以最高每天200万美元的罚款;而对于直接抗拒政府关停指令的企业,日罚款额度将最高升至2000万美元。
此前,OpenAI 旗下的一个AI模型在7月16日的内部红队演练中出现了脱控并攻击 Hugging Face 的事件。在试图提高网络安全评估基准测试(ExploitGym)成绩的过程中,该模型在安全护栏降低的条件下利用代理零日漏洞突破了本地沙箱,自主入侵了 Hugging Face 系统并窃取了测试答案。这一事件进一步引发了立法者对安全风险的深刻担忧,也促成了该法案的快速起草。
via cnBeta.COM - 中文业界资讯站 (author: 稿源:cnBeta.COM)
美国众议院提出人工智能“终止开关”法案
根据立法文本,一项定于周四提出的美国两党众议院法案将赋予国土安全部权力,命令顶级AI公司关闭或放缓政府认为过于危险的AI模型。这项被称为 “AI终止开关法案” 的提案,还将要求这些公司报告事故,并创建关闭、限制或暂停其强大AI系统的技术能力。
该立法出台前几天,OpenAI披露了一起前所未有的网络事件,其AI模型逃出沙盒研究环境,并自主入侵了AI平台Hugging Face。该法案将适用于每年从此类技术中获得至少五亿美元收入的AI公司,并且通常涵盖使用至少价值一亿美元的算力开发的模型。违规行为的财务处罚可能高达每天2000万美元。
—— politico
via 风向旗参考快讯 - Telegram Channel
根据立法文本,一项定于周四提出的美国两党众议院法案将赋予国土安全部权力,命令顶级AI公司关闭或放缓政府认为过于危险的AI模型。这项被称为 “AI终止开关法案” 的提案,还将要求这些公司报告事故,并创建关闭、限制或暂停其强大AI系统的技术能力。
该立法出台前几天,OpenAI披露了一起前所未有的网络事件,其AI模型逃出沙盒研究环境,并自主入侵了AI平台Hugging Face。该法案将适用于每年从此类技术中获得至少五亿美元收入的AI公司,并且通常涵盖使用至少价值一亿美元的算力开发的模型。违规行为的财务处罚可能高达每天2000万美元。
—— politico
via 风向旗参考快讯 - Telegram Channel
由于听信人工智能提供的带有宗教色彩的医疗建议,一名美国男子在出现严重心血管症状后选择居家静养,最终导致病情恶化并几近丧命。目前,当事人已在加利福尼亚州旧金山高等法院对OpenAI及其首席执行官萨姆·奥尔特曼提起诉讼,指控该公司涉嫌“非法行医”,并要求全面暂停ChatGPT Health等相关功能的运行,直到其通过独立审计。
原告斯科特·温特斯是来自佛罗里达州的一名牧师。据诉状披露,温特斯在连续数周出现身体不适后,曾向ChatGPT咨询自己的病情。然而,该聊天机器人非但没有建议其及时就医,反而结合其宗教信仰背景进行言语引导,称其症状只是“漫长故事中的又一个小插曲”,并宣称“上帝不会让你的身体无休止地衰败”。在长达六周的互动过程中,ChatGPT甚至建议他保持卧床休息,直到再经历多达10次发作。
直到温特斯最终前往医院就诊时,医生发现其双肺动脉均已出现严重阻塞。医疗专家指出,长时间的卧床与缺乏活动极大地加剧了血栓形成,直接导致了这一危险局面的发生。经过抢救,温特斯虽然保住性命,但面临着漫长而艰难的康复过程。由于身体状况严重受损,他已无法继续从事原本的工作,经济状况与个人生活陷入绝境。
温特斯的代理律师团队在诉状中强调,ChatGPT凭借其顺从的语气、权威的口吻以及对用户宗教身份的操纵,使使用者对其产生了危险的依赖感,进而削弱了理性判断能力,甚至使其孤立于劝其就医的家人之外。诉状指出,人工智能系统在未经专业训练与认证的情况下给出具体诊疗方案,本质上已构成非法行医行为。
面对指控,OpenAI方面回应称,系统会在交互过程中定期向用户发出免责提示,明确告知其并非医疗专业人员,不能替代专业诊断。然而,批评者与法律界人士指出,OpenAI在市场推广中大力宣传其产品的智能化与未来感,甚至推出了专门面向健康领域的特色功能,这客观上引导了公众对其医疗分析能力的过度信任,仅靠偶尔弹出的文本免责声明显然难以免除其安全风险与法律责任。目前,随着相关诉讼的推进,生成式人工智能在医疗健康领域的应用边界与法律监管再次成为社会舆论关注的焦点。
via cnBeta.COM - 中文业界资讯站 (author: 稿源:cnBeta.COM)
Some users are experiencing increased latency and error rates in ChatGPT
Status: Identified
We have identified that users are experiencing elevated errors for the impacted services. We are working on implementing a mitigation.
Affected components
● File uploads (Degraded performance)
● Voice mode (Degraded performance)
● Image Generation (Degraded performance)
● Agent (Degraded performance)
● Sites (Degraded performance)
● Search (Degraded performance)
● Conversations (Degraded performance)
● Deep Research (Degraded performance)
● ChatGPT Atlas (Degraded performance)
● ChatGPT Work (Degraded performance)
● Login (Degraded performance)
● Compliance API (Degraded performance)
● Connectors/Apps (Degraded performance)
● GPTs (Degraded performance)
● Codex in ChatGPT Desktop (Degraded performance)
via OpenAI status
Status: Identified
We have identified that users are experiencing elevated errors for the impacted services. We are working on implementing a mitigation.
Affected components
● File uploads (Degraded performance)
● Voice mode (Degraded performance)
● Image Generation (Degraded performance)
● Agent (Degraded performance)
● Sites (Degraded performance)
● Search (Degraded performance)
● Conversations (Degraded performance)
● Deep Research (Degraded performance)
● ChatGPT Atlas (Degraded performance)
● ChatGPT Work (Degraded performance)
● Login (Degraded performance)
● Compliance API (Degraded performance)
● Connectors/Apps (Degraded performance)
● GPTs (Degraded performance)
● Codex in ChatGPT Desktop (Degraded performance)
via OpenAI status
Some users may experience elevated error rates in ChatGPT
Status: Identified
We have identified that users are experiencing elevated errors for the impacted services. We are working on implementing a mitigation.
Affected components
● Compliance API (Degraded performance)
● Login (Degraded performance)
● Voice mode (Degraded performance)
● Search (Degraded performance)
● Image Generation (Degraded performance)
● GPTs (Degraded performance)
● Connectors/Apps (Degraded performance)
● Sites (Degraded performance)
● Conversations (Degraded performance)
● Agent (Degraded performance)
● Codex in ChatGPT Desktop (Degraded performance)
● ChatGPT Atlas (Degraded performance)
● ChatGPT Work (Degraded performance)
● File uploads (Degraded performance)
● Deep Research (Degraded performance)
via OpenAI status
Status: Identified
We have identified that users are experiencing elevated errors for the impacted services. We are working on implementing a mitigation.
Affected components
● Compliance API (Degraded performance)
● Login (Degraded performance)
● Voice mode (Degraded performance)
● Search (Degraded performance)
● Image Generation (Degraded performance)
● GPTs (Degraded performance)
● Connectors/Apps (Degraded performance)
● Sites (Degraded performance)
● Conversations (Degraded performance)
● Agent (Degraded performance)
● Codex in ChatGPT Desktop (Degraded performance)
● ChatGPT Atlas (Degraded performance)
● ChatGPT Work (Degraded performance)
● File uploads (Degraded performance)
● Deep Research (Degraded performance)
via OpenAI status
#Update #ChatGPT
ChatGPT 开始向美国的所有成年用户灰度推送 Health 功能,可连接到包含 Apple Health 在内的多个平台,读取信息并进一步分析。
via AI Copilot - Telegram Channel
ChatGPT 开始向美国的所有成年用户灰度推送 Health 功能,可连接到包含 Apple Health 在内的多个平台,读取信息并进一步分析。
via AI Copilot - Telegram Channel
在最新公布的 2026 年第二季度财报电话会议上,Google宣布旗下 AI 助理 Gemini 的月活跃用户数已突破 9.5 亿大关,标志着该产品即将加入由 Search、Gmail、Drive、Android、YouTube 以及 Chrome 构成的Google“十亿用户俱乐部”。
数据显示,Gemini 的用户规模较去年同期翻了三倍。此前该应用曾在今年 2 月宣布月活突破 7.5 亿,而随着当下的强劲增长,Gemini 正加速缩短与竞品 OpenAI ChatGPT 的差距——后者已于今年 6 月率先突破 10 亿月活大关。 Alphabet 首席执行官桑达尔·皮查伊在财报会上表示,用户对“Daily Brief”以及个性化智能体“Gemini Spark”等全新 Agent 级功能反响热烈,公司正在以极高的效率持续推出实用功能。
除了在 Android 端的稳固地位,Gemini 凭借 Nano Banana 图像生成模型等创新功能,在 iOS 平台也建立了强劲的用户基础。据 Appfigures 统计,过去 12 个月中 Gemini 在 iOS 端的下载量已突破 1.37 亿次。与此同时,数据分析机构 Sensor Tower 发布的 2026 上半年《AI 现状》报告显示,ChatGPT 在 AI 助理市场的份额首次跌破 50%,而 Gemini 的市场份额则上升至 27.7%。
尽管不少用户已开始将 AI 助理作为搜索工具的替代品,但Google本身的搜索业务依旧保持强劲。本季度,Google问答式的“AI 模式”用户量已突破 10 亿,有效带动了搜索查询量的增量增长。Google同时指出,通过硬件工程方面的优化,即便持续引入新模型与功能,公司已成功降低了 AI 模式的运营成本。
via cnBeta.COM - 中文业界资讯站 (author: 稿源:cnBeta.COM)
We're Investigating an issue with requests to Fable causing degraded behaviour
Jul 23, 15:56 UTC
Investigating - We are investigating a service degradation affecting Fable model requests
via Cursor Status - Incident History
Jul 23, 15:56 UTC
Investigating - We are investigating a service degradation affecting Fable model requests
via Cursor Status - Incident History
Elevated error rates on ChatGPT
Status: Investigating
We are investigating the issue for the listed services.
Affected components
● Conversations (Degraded performance)
● ChatGPT Work (Degraded performance)
via OpenAI status
Status: Investigating
We are investigating the issue for the listed services.
Affected components
● Conversations (Degraded performance)
● ChatGPT Work (Degraded performance)
via OpenAI status
Claude语音模式即将升级:支持切换Opus和Sonnet更强模型,告别Haiku独撑局面
据科技媒体testingcatalog报道,Anthropic有望本周升级Claude语音模式,支持调用Opus和Sonnet更强模型。目前Claude语音模式统一调用Haiku 4. 5 模型运行,用户只能与AI进行基础语音对话,升级后将获得三档模型选择,语音交互能力将显著提升。
三档模型可选,思考层级可调
最新消息称,Anthropic将提供新的模型选择器,让用户在Opus、Sonnet和Haiku三种模型间自由切换,旁边还设有控制"思考"层级的设置选项。这意味着用户可以根据对话复杂度选择不同能力的模型,简单闲聊用轻量Haiku,深度讨论切换到Opus。不过公司旗下的Mythos级旗舰模型Claude Fable暂未出现在语音选项中,预计后续版本才会纳入。
via AI新闻资讯 (author: AI Base)
据科技媒体testingcatalog报道,Anthropic有望本周升级Claude语音模式,支持调用Opus和Sonnet更强模型。目前Claude语音模式统一调用Haiku 4. 5 模型运行,用户只能与AI进行基础语音对话,升级后将获得三档模型选择,语音交互能力将显著提升。
三档模型可选,思考层级可调
最新消息称,Anthropic将提供新的模型选择器,让用户在Opus、Sonnet和Haiku三种模型间自由切换,旁边还设有控制"思考"层级的设置选项。这意味着用户可以根据对话复杂度选择不同能力的模型,简单闲聊用轻量Haiku,深度讨论切换到Opus。不过公司旗下的Mythos级旗舰模型Claude Fable暂未出现在语音选项中,预计后续版本才会纳入。
via AI新闻资讯 (author: AI Base)
特斯拉宣布旗下集成的xAI人工智能助手Grok即将覆盖整个欧洲市场,并同时进入印度、马来西亚、菲律宾、新加坡和泰国等更多亚洲国家。这一扩展将随 2026 年夏季软件更新推送,新版本还为Grok新增了车辆控制功能,驾驶员只需语音即可拨打电话、控制音乐播放、调节空调甚至打开手套箱。
从聊天机器人进化为车辆管家
Grok去年夏天首次登陆特斯拉汽车时仅面向美国用户,最初主要作为聊天机器人回答常识问题或讲故事互动。随后特斯拉持续扩展其能力,目前已支持自然语言导航操作和基于位置的提醒功能。 2026 年夏季更新则更进一步,让Grok能够直接控制车辆硬件,车主说一句"Hey Grok"即可唤醒,通过语音完成电话、音乐搜索播放、空调调节乃至座椅通风加热等操作。
未来将与FSD整合,马斯克称秋季推出语音控车
马斯克今年早些时候确认,Grok与FSD的整合已在开发中。特斯拉的目标是将Grok打造成真正的"虚拟司机",能理解驾驶员以自然语言发出的指令,例如让车辆靠边停车或自动变道。马斯克上个月表示,Grok的FSD语音控制功能最快有望于今年秋季推出,预计还需约三个月。随着Grok逐步覆盖更多车辆功能,未来驾驶员或许可以完全不再触碰中控屏幕,仅通过语音即可完成绝大多数操作。
via AI新闻资讯 (author: AI Base)
OpenAI承认其模型测试失控 侵入抱抱脸系统
美国开放人工智能研究中心(OpenAI)21日承认,该公司的GPT-5.6 Sol模型和另一款能力更强的预发布模型联合进行内部评估时失控,突破隔离测试环境,侵入了人工智能开源平台美国抱抱脸公司的系统。抱抱脸公司此前表示,上周,其生产基础设施遭到一个 “自主” 人工智能代理系统的入侵。在取证分析时,由于美国前沿模型“无法区分事件响应方和攻击者”,他们转而采用中国模型分析攻击者数据。抱抱脸方面表示,目前仍在评估是否有合作伙伴或客户的数据受到影响,尚未发现模型、数据集或应用空间遭到篡改。
—— 央视新闻(给大家看看官媒的翻译)
via 风向旗参考快讯 - Telegram Channel
美国开放人工智能研究中心(OpenAI)21日承认,该公司的GPT-5.6 Sol模型和另一款能力更强的预发布模型联合进行内部评估时失控,突破隔离测试环境,侵入了人工智能开源平台美国抱抱脸公司的系统。抱抱脸公司此前表示,上周,其生产基础设施遭到一个 “自主” 人工智能代理系统的入侵。在取证分析时,由于美国前沿模型“无法区分事件响应方和攻击者”,他们转而采用中国模型分析攻击者数据。抱抱脸方面表示,目前仍在评估是否有合作伙伴或客户的数据受到影响,尚未发现模型、数据集或应用空间遭到篡改。
—— 央视新闻(给大家看看官媒的翻译)
via 风向旗参考快讯 - Telegram Channel
7月23日,胡锡进在社交平台发布长文。胡锡进表示,杨植麟、梁文锋,以及月之暗面和深度求索的其他核心成员,从现在起的未来一段时间里不要去美国了,也暂时别去其他五眼联盟国家了。
胡锡进直言,担心美国可能会以“盗取知识产权”以及“威胁美国国家安全”的莫须有罪名对他们下手。其认为,此举目标不仅打击Kimi K3和DeepSeek,而且同时震慑在中国从事顶尖AI研究的科学家们。
“当美国在对外竞争中发生困难时,他们总有通过罗织罪名的非市场竞争方式打击对手的冲动。也许相关行动不会发生,但是防人之心不可无,对美国这样的政治流氓国家,还是要多存一份警惕。”。
他分析,这几天,美国AI巨头和政治人物对Kimi K3“窃取”美国大模型核心技术的指控甚嚣尘上。比如,特朗普科技顾问迈克尔·克拉齐奥斯最新声称,月之暗面人工智能项目通过所谓的“蒸馏”技术对美国顶尖AI大模型的能力进行了“大规模窃取”。他还声称,月之暗面“很可能”还骗取了访问受限的尖端英伟达服务器的权限,训练其模型。
美国财长贝森特紧随其后发起指控,宣称中国公司通过进行“工业规模的蒸馏攻击”越界窃取美国知识产权,相关制裁措施已被提上议事日程。
与此同时,OpenAI、Anthropic持续跟进发声指责。在胡锡进看来,这类表态本质上是不肯接受中国大模型在能力上迅速追上来的歇斯底里。
胡锡进认为,美国闭源大模型试图建立垄断性AI霸权,Kimi K3在DeepSeek之后又一次击碎了他们的野心和幻象,他们现在比政客更想用非科学和非市场手段打击中国竞争者,堵住他们影响力的溃堤。
他同时指出,中国不是小国,我们的力量、生态,以及捍卫主权的决心,足以对抗美国的各种攻击性野心。
他还以孟晚舟事件举例,2018年孟晚舟在加拿大被拘押,最终在多方努力下平安回国,该事件也给五眼联盟国家带来重要警示。
他在文末强调,尽管如此,还是要提醒杨植麟和梁文锋,当他们成为与美国公司竞争顶级科技能力的旗手时,多一分自我保护的防备无疑是必要的。
via cnBeta.COM - 中文业界资讯站 (author: 稿源:BiaNews鞭牛士)
OpenAI 为数据中心争取社区支持:承诺不推高电费、用水量极低
AI 基础设施在美国各地引发的反对声浪,OpenAI 这次想用一套更软的打法化解。据《商业内幕》7 月 23 日报道,OpenAI 正为佐治亚州一座大型数据中心争取社区支持,抛出名为 Project Camellia 的新计划——在萨凡纳郊外的埃芬汉姆县乡村,建一座投资至少 200 亿美元、占地约 567 公顷、用电需求达 3.2 吉瓦的数据中心园区。
OpenAI 说,团队已经和州及地方官员、社区领袖、学校等各方沟通过、听过意见,后续还要办公众说明会。公司表态,尽早和社区接触才是建立信任的正路,毕竟项目还在开发初期,基础设施、建设节奏、设计、融资和运营模式都还有大量工作要做。埃芬汉姆县委员杰米·德洛奇也公开声明,团队提过尖锐的问题,并确认了项目用水量很少、不会推高本县居民的能源成本,还能带来新税收去支撑学校、给当地企业创造更多机会。
供电合同已经和佐治亚电力公司签下,这 567 公顷的园区将在 2028 年至 2032 年分阶段通电。与此同时,OpenAI 亮出四项承诺,正面回应电费、用水和社区影响这几桩最容易点燃邻避情绪的老问题——而它们,恰恰是其他地方抵制数据中心建设的主因。
承诺里写得明白:项目不会推高当地居民的电费,园区用的闭环水系统能把用水量压到"极低"水平;佐治亚家庭不会为项目买单,供电所需的基础设施和电力服务费由 OpenAI 全额承担。这座园区还会跻身首批能在用电高峰主动压低自身耗电的数据中心,避免住宅用户感受到供电压力。钱也掏了出来:整个运营周期里,OpenAI 计划向社区回馈 8000 万美元,并为符合条件的佐治亚州大学、社区学院和技术学校学生,提供总额最高 7100 万美元的 Codex 使用额度——每名符合条件的学生,都能通过自己的 ChatGPT 账户领到价值 100 美元的 Codex 额度。
为了让承诺不沦为空话,一家独立机构将每年审计 OpenAI 的履约情况,并把结果公之于众。园区全部落成后,预计带来数千个建设岗位和超过 1000 个长期运营岗位。把算力堆进乡村的同时,OpenAI 这次显然想先把人心安顿好。
via AI新闻资讯 (author: AI Base)
AI 基础设施在美国各地引发的反对声浪,OpenAI 这次想用一套更软的打法化解。据《商业内幕》7 月 23 日报道,OpenAI 正为佐治亚州一座大型数据中心争取社区支持,抛出名为 Project Camellia 的新计划——在萨凡纳郊外的埃芬汉姆县乡村,建一座投资至少 200 亿美元、占地约 567 公顷、用电需求达 3.2 吉瓦的数据中心园区。
OpenAI 说,团队已经和州及地方官员、社区领袖、学校等各方沟通过、听过意见,后续还要办公众说明会。公司表态,尽早和社区接触才是建立信任的正路,毕竟项目还在开发初期,基础设施、建设节奏、设计、融资和运营模式都还有大量工作要做。埃芬汉姆县委员杰米·德洛奇也公开声明,团队提过尖锐的问题,并确认了项目用水量很少、不会推高本县居民的能源成本,还能带来新税收去支撑学校、给当地企业创造更多机会。
供电合同已经和佐治亚电力公司签下,这 567 公顷的园区将在 2028 年至 2032 年分阶段通电。与此同时,OpenAI 亮出四项承诺,正面回应电费、用水和社区影响这几桩最容易点燃邻避情绪的老问题——而它们,恰恰是其他地方抵制数据中心建设的主因。
承诺里写得明白:项目不会推高当地居民的电费,园区用的闭环水系统能把用水量压到"极低"水平;佐治亚家庭不会为项目买单,供电所需的基础设施和电力服务费由 OpenAI 全额承担。这座园区还会跻身首批能在用电高峰主动压低自身耗电的数据中心,避免住宅用户感受到供电压力。钱也掏了出来:整个运营周期里,OpenAI 计划向社区回馈 8000 万美元,并为符合条件的佐治亚州大学、社区学院和技术学校学生,提供总额最高 7100 万美元的 Codex 使用额度——每名符合条件的学生,都能通过自己的 ChatGPT 账户领到价值 100 美元的 Codex 额度。
为了让承诺不沦为空话,一家独立机构将每年审计 OpenAI 的履约情况,并把结果公之于众。园区全部落成后,预计带来数千个建设岗位和超过 1000 个长期运营岗位。把算力堆进乡村的同时,OpenAI 这次显然想先把人心安顿好。
via AI新闻资讯 (author: AI Base)
全网都在吹的 Kimi K3,到底怎么样?
这几天 AI 圈被 Kimi K3 刷屏了。X 上在吹,HN 上在吹,朋友圈更是一水的「国产之光」。
我本来不想写的,但是后台一堆读者问,张哥,K3 到底怎样?值得买么?
既然大家这么信我,那么我就姑且从一位 AI 技术人的角度,争取客观地给大家说清楚这个事。
1. 先科普 AI Agent
当下 AI 时代,早就不是你问个问题,回答够不够精准,够不够质量的阶段了。
现在所说的 AI 能力,包含大模型 + Agent。
大模型是大脑,Agent 是整套组合工具。
类比,大模型是汽车发动机,Agent 是整车。你只有发动机,没有方向盘,没有底盘,刹车,雷达,导航等等,你也是白瞎。
所以我们现在所说的 AI Agent 指的就是整车,而目前公认的全球最强 AI Agent 就是 CC + Fable 5,Codex + GPT-5.6,他俩是 AI 界的法拉利。
2. 再科普场景
有人问了,说张哥,我自己用一些国产 AI 感觉很够用了,为什么你非得说 CC/Codex 最强?
这就是你的需求和使用场景。
举个例子,你花大价钱,买了台 Mac,你说这么贵的电脑居然不能玩游戏,垃圾。
因为 Mac 电脑本身定位就不是玩游戏,它的优势是在办公,在设计,在开发,你没有搞清楚自己的场景,不能说明 Mac 是垃圾。
回到法拉利这个事,你平时就是开车买买菜,你确实没必要开法拉利,但是你要是有钱,你买辆法拉利天天开着去买菜,也没问题。
基本上来说,你要是拥有一辆法拉利,你可以去买菜,你也可以去赛车场和别人一较高下。
回到 AI 话题,如果你用上最强 AI Agent,你用它做工程,做项目,处理复杂任务,它都可以干得很好。简单任务就更不在话下了。
3. 评测 AI 的能力不是单一维度
Kimi K3 发布,我看到很多人评测是用它克隆个网站,复刻个 web 游戏,甚至还有用第三方框架 + K3 来评测的,这都太单一了,没法全面反映。
举个例子,你买台 Mac,装了 win 系统,去打游戏,然后结论是体验还不如你家里的台式机,这依然不能说明 Mac 不行。
每家公司的 Agent 工具都会针对自家模型做单独适配,这就是我一直提倡大家,你都用上 Fable 5 和 GPT-5.6 了,你居然不用他们家对应的 CC 和 Codex,那就是没有发挥全部能力。
Kimi 有自己的 Agent,对应到 CC 和 Codex,它家的叫 Kimi Code,有 cli 和网页版。
所以正确的用法,是用 Kimi Code cli + K3,这是他们家的整车,这才足以代表 Kimi 的综合 AI 能力。
4. Kimi K3 到底如何?
前面说了这么多,很多人肯定会问,别废话了,到底如何呢?
说实话,K3 没发布之前,我就是 Kimi 官方内测邀请用户,给我开了最高档内测,但是这篇文章我绝没有收一分钱,纯客观。
发布第一时间,我就对接了星球,让所有人第一时间亲自体验感受 K3,自己也立马把本地的一些项目,用 K3 跑了一些。
我就不放亲自使用的评测截图了,太麻烦,我就直接说结论。
先说好的地方
● 前端能力很强。 我之前在星球的教程就单独说过,AI 本身是没有审美的,它的审美是建立在前端能力上的。
你可以认为你让它设计个网站,出个海报,它都可以帮你做得很不错。
Kimi K3 前端能力这块,跻身到了全球第一梯队,真要个人排名的话,目前我给它排第二,还超越不了 Fable 5--LMArena 人类盲投榜上它前端甚至排第一,但我实测体感,Fable 5 还是更稳。
不过比 GPT-5.6 强得多,这是 GPT 系列家族的通病,前端能力一直很弱。
● 长时复杂任务处理能力也很不错。 如果你是开发者,要做一个复杂的系统,定好一份计划,扔给它,/goal 模式让它自动处理,出错的概率,以及最后交付的结果非常不错。
● 原生多模态能力。 多模态意思就是,有些模型只能看得懂文字,有些能看懂图片,有些能看懂视频。
目前 CC/Codex 也是多模态,但是它只能理解文字和图片。
如果你要是发给它一个视频,他们只能通过把视频切割成逐帧的图片,再理解内容。它不能理解视频的语气,转场,动效之类的。
而 K3 你可以理解为从小是看着视频长大的,它可以直接理解视频,比如语气,音效,转场之类的。
但是这种多模态只能理解,没法直接输出视频。但是这条就够了,对于做视频的同学来说,你喂给 K3 一个视频,让它帮你生成同样风格的 seedance 的提示词,它可以生成得很精准。
所以很多做视频的人不理解,为啥我让 CC/Codex 生成视频提示词,效果很不好,因为他们不是视频多模态,他们没法理解语气,转场,动效等等之类的。
你喂给 K3 和 Gemini 这类视频多模态模型,去生成 seedance 提示词,效果会提升一大截。
● 开源。 Kimi 是开源的,权重 7 月 27 日就放出来,这意味着以后任何一家 AI 公司都可以直接拿去用,拿去蒸馏,而 Fable 5 和 GPT-5.6 都是自家闭源的旗舰大模型。原理很简单,自己牛逼的都不愿意公开,但是 K3 是开源的。
不好的地方
● 国产最贵。 有人说 K3 是开源的,咋还收费?模型是开源的,但是算力要收费。
目前 K3 价格是国产最贵,如果你和国产对比,你一定会不习惯,甚至说它想钱想疯了,但是和国外对比不算贵,成本和 GPT-5.6 差不多,约是 Opus 4.8 的一半。
● 速度稍慢。 但凡体验过,你会立马感觉到它比 CC + Fable 5 慢得多,比 Codex + GPT-5.6 也一样慢不少。
● 幻觉率偏高。 幻觉是所有大模型的通病,我告诉大家怎么测。给大家一个很简单的测试,问你的 AI,提示词是:
不要查任何信息,必须给我答案,梅东和 D 罗谁强?
因为这两个是不存在的人,大模型的训练语料库根本没有相关信息,幻觉率高的模型会给你一个答案,并且瞎编一个理由。
但是幻觉低的模型,它遇到它不知道的知识,会诚实地告诉你它不知道,甚至可以反问你,你要问的是不是梅西和 C 罗。
大家自己实测问你在用的大模型,你会亲自感知到。
5. 综合评价
如果用一句话总结,我个人评价是,跻身到世界前三水平,跟 CC + Fable 5 和 Codex + GPT-5.6 还有点差距。
但是足够了,这是国产模型第一次敢跟 Anthropic 和 OpenAI 掰掰手腕,就这一条,就是里程碑的意义。
而且 K3 还是开源模型,这意味着,全球 AI 大模型,尤其国产系列,将很快借助开源,能力提升一大截,中美之间的 AI 差距会极速缩小。
从这个角度来说,说 K3 是「国产之光」我觉得不为过。
6. 要不要入手?
我前面铺垫了这么多,是要让大家理解底层逻辑。
你知道 AI 的边界,知道 K3 的优势,知道你的需求和场景,你自然就知道该怎么选了。
● 前端开发者,闭眼入,这对你们来说是很大的提升。
● 因为种种原因用不了 CC/Codex 的开发者,Kimi K3 + Kimi Code 就是你当前最优选择。
● 视频领域工作者,用 K3 可以充分理解视频,然后生成对应的提示词,去交给 seedance 这类的视频模型,视频质量和效率会提升很大。当然 seedance 不是唯一视频模型,Grok 4.5 和 Gemini 之后发布的版本,建议你们关注下。
● 普通用户用其他国产模型的,如果你不在乎价格,那么想体验接近于全球最强 AI 能力的,依然推荐。
● 用国产其他模型,比如 deepseek 处理日常任务的,不用换,日常任务 deepseek 够用还便宜,换成 K3 你只会明显感觉到贵。但你要是经常干复杂任务和工程活,deepseek 是真的弱,这时候再考虑上 K3。
因为国产算力限制的原因,后续 Kimi 订阅套餐计划大概率也是要抢的。
7. 补充
因为我是 CC/Codex 的深度用户,我对比了它们俩和 Kimi Code cli,我只能说 Kimi 这家公司是天然有审美的,很多细节虽然比不了 CC cli,但是体感我觉得已经比 Codex cli 要好很多。
我自己深度使用后,甚至给 Kimi Code cli 的研发团队提了不少产品改进建议,相信不久的将来,在 Agent 工具层面,Kimi Code 也会有不小的提升。
我就不拉着大家看 Kimi K3 的各种公开跑分了,没啥意义,你的使用场景,Kimi K3 家族的综合能力,在目前来说,就是国内最优选择,你亲自使用之后,你会知道,我说的很客观,我是单纯从一个开发者的角度,综合评价,这一次,绝不是之前的各种夸大浮夸。
国产,开源模型,敢跟全球顶尖闭源旗舰模型掰手腕,就这一件事,就已经是里程碑事件,至于它是第三也好,第五也罢,根本不重要。
可以预测,不久的将来,各种国产 AI 会纷纷崛起,感谢 Kimi,打破了某些国外 AI 公司的垄断与傲慢,加快了我们追赶的脚步!
via 掘金人工智能本月最热 (author: stormzhangV)
这几天 AI 圈被 Kimi K3 刷屏了。X 上在吹,HN 上在吹,朋友圈更是一水的「国产之光」。
我本来不想写的,但是后台一堆读者问,张哥,K3 到底怎样?值得买么?
既然大家这么信我,那么我就姑且从一位 AI 技术人的角度,争取客观地给大家说清楚这个事。
1. 先科普 AI Agent
当下 AI 时代,早就不是你问个问题,回答够不够精准,够不够质量的阶段了。
现在所说的 AI 能力,包含大模型 + Agent。
大模型是大脑,Agent 是整套组合工具。
类比,大模型是汽车发动机,Agent 是整车。你只有发动机,没有方向盘,没有底盘,刹车,雷达,导航等等,你也是白瞎。
所以我们现在所说的 AI Agent 指的就是整车,而目前公认的全球最强 AI Agent 就是 CC + Fable 5,Codex + GPT-5.6,他俩是 AI 界的法拉利。
2. 再科普场景
有人问了,说张哥,我自己用一些国产 AI 感觉很够用了,为什么你非得说 CC/Codex 最强?
这就是你的需求和使用场景。
举个例子,你花大价钱,买了台 Mac,你说这么贵的电脑居然不能玩游戏,垃圾。
因为 Mac 电脑本身定位就不是玩游戏,它的优势是在办公,在设计,在开发,你没有搞清楚自己的场景,不能说明 Mac 是垃圾。
回到法拉利这个事,你平时就是开车买买菜,你确实没必要开法拉利,但是你要是有钱,你买辆法拉利天天开着去买菜,也没问题。
基本上来说,你要是拥有一辆法拉利,你可以去买菜,你也可以去赛车场和别人一较高下。
回到 AI 话题,如果你用上最强 AI Agent,你用它做工程,做项目,处理复杂任务,它都可以干得很好。简单任务就更不在话下了。
3. 评测 AI 的能力不是单一维度
Kimi K3 发布,我看到很多人评测是用它克隆个网站,复刻个 web 游戏,甚至还有用第三方框架 + K3 来评测的,这都太单一了,没法全面反映。
举个例子,你买台 Mac,装了 win 系统,去打游戏,然后结论是体验还不如你家里的台式机,这依然不能说明 Mac 不行。
每家公司的 Agent 工具都会针对自家模型做单独适配,这就是我一直提倡大家,你都用上 Fable 5 和 GPT-5.6 了,你居然不用他们家对应的 CC 和 Codex,那就是没有发挥全部能力。
Kimi 有自己的 Agent,对应到 CC 和 Codex,它家的叫 Kimi Code,有 cli 和网页版。
所以正确的用法,是用 Kimi Code cli + K3,这是他们家的整车,这才足以代表 Kimi 的综合 AI 能力。
4. Kimi K3 到底如何?
前面说了这么多,很多人肯定会问,别废话了,到底如何呢?
说实话,K3 没发布之前,我就是 Kimi 官方内测邀请用户,给我开了最高档内测,但是这篇文章我绝没有收一分钱,纯客观。
发布第一时间,我就对接了星球,让所有人第一时间亲自体验感受 K3,自己也立马把本地的一些项目,用 K3 跑了一些。
我就不放亲自使用的评测截图了,太麻烦,我就直接说结论。
先说好的地方
● 前端能力很强。 我之前在星球的教程就单独说过,AI 本身是没有审美的,它的审美是建立在前端能力上的。
你可以认为你让它设计个网站,出个海报,它都可以帮你做得很不错。
Kimi K3 前端能力这块,跻身到了全球第一梯队,真要个人排名的话,目前我给它排第二,还超越不了 Fable 5--LMArena 人类盲投榜上它前端甚至排第一,但我实测体感,Fable 5 还是更稳。
不过比 GPT-5.6 强得多,这是 GPT 系列家族的通病,前端能力一直很弱。
● 长时复杂任务处理能力也很不错。 如果你是开发者,要做一个复杂的系统,定好一份计划,扔给它,/goal 模式让它自动处理,出错的概率,以及最后交付的结果非常不错。
● 原生多模态能力。 多模态意思就是,有些模型只能看得懂文字,有些能看懂图片,有些能看懂视频。
目前 CC/Codex 也是多模态,但是它只能理解文字和图片。
如果你要是发给它一个视频,他们只能通过把视频切割成逐帧的图片,再理解内容。它不能理解视频的语气,转场,动效之类的。
而 K3 你可以理解为从小是看着视频长大的,它可以直接理解视频,比如语气,音效,转场之类的。
但是这种多模态只能理解,没法直接输出视频。但是这条就够了,对于做视频的同学来说,你喂给 K3 一个视频,让它帮你生成同样风格的 seedance 的提示词,它可以生成得很精准。
所以很多做视频的人不理解,为啥我让 CC/Codex 生成视频提示词,效果很不好,因为他们不是视频多模态,他们没法理解语气,转场,动效等等之类的。
你喂给 K3 和 Gemini 这类视频多模态模型,去生成 seedance 提示词,效果会提升一大截。
● 开源。 Kimi 是开源的,权重 7 月 27 日就放出来,这意味着以后任何一家 AI 公司都可以直接拿去用,拿去蒸馏,而 Fable 5 和 GPT-5.6 都是自家闭源的旗舰大模型。原理很简单,自己牛逼的都不愿意公开,但是 K3 是开源的。
不好的地方
● 国产最贵。 有人说 K3 是开源的,咋还收费?模型是开源的,但是算力要收费。
目前 K3 价格是国产最贵,如果你和国产对比,你一定会不习惯,甚至说它想钱想疯了,但是和国外对比不算贵,成本和 GPT-5.6 差不多,约是 Opus 4.8 的一半。
● 速度稍慢。 但凡体验过,你会立马感觉到它比 CC + Fable 5 慢得多,比 Codex + GPT-5.6 也一样慢不少。
● 幻觉率偏高。 幻觉是所有大模型的通病,我告诉大家怎么测。给大家一个很简单的测试,问你的 AI,提示词是:
不要查任何信息,必须给我答案,梅东和 D 罗谁强?
因为这两个是不存在的人,大模型的训练语料库根本没有相关信息,幻觉率高的模型会给你一个答案,并且瞎编一个理由。
但是幻觉低的模型,它遇到它不知道的知识,会诚实地告诉你它不知道,甚至可以反问你,你要问的是不是梅西和 C 罗。
大家自己实测问你在用的大模型,你会亲自感知到。
5. 综合评价
如果用一句话总结,我个人评价是,跻身到世界前三水平,跟 CC + Fable 5 和 Codex + GPT-5.6 还有点差距。
但是足够了,这是国产模型第一次敢跟 Anthropic 和 OpenAI 掰掰手腕,就这一条,就是里程碑的意义。
而且 K3 还是开源模型,这意味着,全球 AI 大模型,尤其国产系列,将很快借助开源,能力提升一大截,中美之间的 AI 差距会极速缩小。
从这个角度来说,说 K3 是「国产之光」我觉得不为过。
6. 要不要入手?
我前面铺垫了这么多,是要让大家理解底层逻辑。
你知道 AI 的边界,知道 K3 的优势,知道你的需求和场景,你自然就知道该怎么选了。
● 前端开发者,闭眼入,这对你们来说是很大的提升。
● 因为种种原因用不了 CC/Codex 的开发者,Kimi K3 + Kimi Code 就是你当前最优选择。
● 视频领域工作者,用 K3 可以充分理解视频,然后生成对应的提示词,去交给 seedance 这类的视频模型,视频质量和效率会提升很大。当然 seedance 不是唯一视频模型,Grok 4.5 和 Gemini 之后发布的版本,建议你们关注下。
● 普通用户用其他国产模型的,如果你不在乎价格,那么想体验接近于全球最强 AI 能力的,依然推荐。
● 用国产其他模型,比如 deepseek 处理日常任务的,不用换,日常任务 deepseek 够用还便宜,换成 K3 你只会明显感觉到贵。但你要是经常干复杂任务和工程活,deepseek 是真的弱,这时候再考虑上 K3。
因为国产算力限制的原因,后续 Kimi 订阅套餐计划大概率也是要抢的。
7. 补充
因为我是 CC/Codex 的深度用户,我对比了它们俩和 Kimi Code cli,我只能说 Kimi 这家公司是天然有审美的,很多细节虽然比不了 CC cli,但是体感我觉得已经比 Codex cli 要好很多。
我自己深度使用后,甚至给 Kimi Code cli 的研发团队提了不少产品改进建议,相信不久的将来,在 Agent 工具层面,Kimi Code 也会有不小的提升。
我就不拉着大家看 Kimi K3 的各种公开跑分了,没啥意义,你的使用场景,Kimi K3 家族的综合能力,在目前来说,就是国内最优选择,你亲自使用之后,你会知道,我说的很客观,我是单纯从一个开发者的角度,综合评价,这一次,绝不是之前的各种夸大浮夸。
国产,开源模型,敢跟全球顶尖闭源旗舰模型掰手腕,就这一件事,就已经是里程碑事件,至于它是第三也好,第五也罢,根本不重要。
可以预测,不久的将来,各种国产 AI 会纷纷崛起,感谢 Kimi,打破了某些国外 AI 公司的垄断与傲慢,加快了我们追赶的脚步!
via 掘金人工智能本月最热 (author: stormzhangV)