https://t.me/AI_News_CN
📈主流AI服务状态页通知 | 🆕汇集全网ChatGPT/AI新闻 #AI #ChatGPT
🔙备用群 https://t.me/gpt345
✨BEST AI中转 https://api.oaibest.com 2.8折起 支持OpenAI, Claude code, Gemini,Grok, Deepseek, Midjourney, 文件上传分析
Buy ads: https://telega.io/c/AI_News_CN
📈主流AI服务状态页通知 | 🆕汇集全网ChatGPT/AI新闻 #AI #ChatGPT
🔙备用群 https://t.me/gpt345
✨BEST AI中转 https://api.oaibest.com 2.8折起 支持OpenAI, Claude code, Gemini,Grok, Deepseek, Midjourney, 文件上传分析
Buy ads: https://telega.io/c/AI_News_CN
美国大模型抄了DeepSeek作业:性能没赢、价格更贵,却精准卡住了美国企业的合规刚需
OpenAI前首席技术官穆拉蒂离开老东家后交出的第一份答卷,意外地把中美大模型的角色关系颠倒了过来。 7 月 15 日,她创办的Thinking Machines Lab发布首款模型Inkling,混合专家架构主要沿用DeepSeek-V3,后训练冷启动还借了月之暗面Kimi K2. 5 等开放模型生成的合成数据。结果颇显微妙:在多项基准评测里,Inkling落后于Kimi和GLM,调用价格反而更高。一家融资 20 亿美元、估值 120 亿美元的明星公司,首秀多少低于预期,但穆拉蒂可能从一开始就没打算靠它争夺第一。
单看硬件配置,Inkling确实撑得起明星实验室的排面。它采用混合专家架构,总参数量 9750 亿,每处理一个Token激活 410 亿参数;预训练用了 45 万亿Token,数据涵盖文本、图像、音频与视频,最长支持 100 万Token上下文;能理解文字、图片和音频,以文字形式输出,还支持通过调节思考强度在性能、速度与成本之间取舍。模型同时开放权重,采用相当宽松的Apache 2. 0 许可证,开发者既能下载权重自行部署,也能通过Thinking Machines旗下的Tinker平台微调。公司的定位很明确:与其直接和ChatGPT争夺普通用户,Inkling更适合充当企业开发AI应用的底座。
真正引人注意的,藏在技术报告的后半段。Thinking Machines在介绍架构时直接写道,Inkling的混合专家设计主要沿用了DeepSeek-V3,同样设置了大量专家模块、每个Token只调用其中一小部分,并采用了DeepSeek-V3 的无辅助损失负载均衡设计。中国模型的影响还延伸到了训练阶段:为了启动后训练,公司先用开放权重模型生成的合成数据做了一轮监督微调,其中明确提到了Kimi K2.5。
一条完整的路线浮出水面——一家由OpenAI前CTO创办的美国实验室,首款模型沿用DeepSeek架构,又借助Kimi的数据完成后训练起步。借鉴开放模型本身无可厚非,DeepSeek和Kimi公开权重、允许使用,本就是建立在公开成果之上,更尴尬的是Inkling吸收了中国模型的技术之后,性能依旧没压过这些老师。Thinking Machines也坦然承认:Inkling并非目前表现最强的模型,无论开放模型还是闭源模型。
把数字摆出来就更清楚了。在人类最后的考试纯文本评测中,Inkling得29.7%,Kimi K2. 6 和GLM 5. 2 分别达到35.9%与40.1%;加上工具后Inkling升至46%,仍低于Kimi K2. 6 的54%和GLM 5. 2 的54.7%;考察真实软件工程能力的SWE-Bench Pro里,Inkling为54.3%,Kimi K2. 6 是58.6%,GLM 5. 2 达到62.1%;差距在Terminal Bench 2. 1 上最刺眼,Inkling仅63.8%,Kimi K2. 6 和GLM 5. 2 分别有71.3%和82.7%。
当然Inkling也有长项,在网页应用设计、音频理解和安全性评测中表现不错,部分数学任务还能超过Kimi和DeepSeek,但综合推理、编程与智能体能力,它暂时挤不进开放模型的第一梯队。价格同样没给惊喜:Tinker平台上64K版本每 100 万Prefill Token收费1. 87 美元、每 100 万Sample Token收费4. 68 美元,且这已是限时五折价,256K版本更分别涨到3. 74 和9. 36 美元;对比Kimi K2. 6 官方API输入0.95、输出 4 美元,GLM 5. 2 为1. 4 和4. 4 美元,Inkling的预填充价格接近Kimi K2. 6 的两倍,生成价格也更高,暂时看不出价格优势。于是局面变得有点微妙:架构参考DeepSeek,后训练借力Kimi,综合性能没超过中国头部开放模型,调用价格反而更贵。
之所以耐人寻味,在于Thinking Machines的特殊身世。这家公司几乎是OpenAI校友会—— 2025 年 2 月亮相时团队约 30 人,三分之二来自OpenAI,其余主要来自Meta和Mistral,创始阵容一度包括John Schulman、Barret Zoph、Lilian Weng、Andrew Tulloch和Luke Metz,路透社称穆拉蒂从前东家挖走了至少 20 名研究人员。
穆拉蒂本人 2018 年加入OpenAI,参与过DALL-E、Codex、ChatGPT和Sora, 2022 年升任CTO, 2023 年 11 月董事会罢免Altman后还短暂出任临时CEO,对OpenAI的模型研发与产品化路径有着完整认知。这样一群最懂OpenAI的人离开后,从零搭建技术体系,外界本期待一条带着OpenAI印记的路线,结果最明确的技术来源却指向中国模型,这很容易被解读成一个戏剧性信号:最了解OpenAI的一群人,最终选了中国模型的技术蓝图。
但这个结论需要拆开看。OpenAI近年前沿模型全部闭源,外界拿不到权重,也不了解完整架构与训练方案,穆拉蒂即便熟悉内部技术,也不能把前东家的商业机密搬进新公司;DeepSeek和Kimi则公开了权重或技术报告,架构、训练方法和工具链都可以合法研究复用。
Inkling本身也是开放权重模型,对想建设开放生态的公司来说,从DeepSeek、Kimi等开放模型吸收成熟方案,是顺理成章的工程选择。今天开发一款开放模型却完全避开中国团队已公开的成果,反而要付出更高试错成本。因此借鉴中国模型并不能证明穆拉蒂认为DeepSeek全面领先OpenAI,双方公开程度不同、可借鉴条件也完全不同,但它释放了一个清晰信号:至少在开放权重领域,中国模型已经成了美国AI团队的重要参考系。
真正要回答的,是为什么Thinking Machines吸收了现成架构和训练经验,做出的Inkling却性能更弱、价格更高。穆拉蒂拥有顶尖团队、充足资金和英伟达最新训练系统,没有理由看不到这些差距,所以贵替很可能是一个经过计算的选择。
按Thinking Machines拿到的待遇,Inkling本不该只是一款够用的模型。 2025 年 7 月公司尚未推出任何产品,就完成 20 亿美元种子轮、估值 120 亿美元,投资方包括a16z、英伟达、AMD和简街;四个月后新一轮谈判目标估值一度高达 500 亿美元,虽未官宣,外界已把它视作OpenAI和Anthropic的潜在对手。当它以性能不如中国模型、价格还更贵的产品亮相,难免低于预期,但从商业角度看,穆拉蒂可能从一开始就没打算用它争基准第一。
公司强调的是开放权重、多模态与可定制性,希望企业经Tinker微调,把Inkling改造成客服、编程助手、行业智能体等专用模型。穆拉蒂押注的市场,对基准第一并不执着,企业更在意模型能否私有部署、能否掌握数据、能否按自己的业务继续训练。此前这类需求很大一部分被中国开放模型接住了:OpenAI和Anthropic长期闭源,Meta的Llama4 不及预期后也逐渐收缩开放路线,而DeepSeek、Kimi、Qwen和GLM持续开放权重,性能越来越接近美国闭源模型、价格却低得多。
美国企业很快用脚投票——OpenRouter向CNBC提供的数据显示, 2026 年 2 月以来,中国模型在美国企业经该平台调用的Token中每周占比都超过30%,最高一度达46%,而 2025 年上半年的平均占比还只有4.5%;Cursor开发Composer2 时测试多款基础模型,最终选了评测最强的Kimi K2.5,桥水基金则通过Tinker微调阿里的Qwen,以更低成本超过了部分顶级闭源模型。中国开放模型由此成了美国企业降成本的捷径,但这条路正在承压。
与此同时,美国对中国AI模型的监管氛围在收紧。相关部门已围绕数据安全、模型来源和供应链风险发出警告,部分使用中国模型的企业受到调查。即便尚未形成统一限制,政策不确定性已足以影响企业选择,尤其是涉及政府业务和敏感数据的公司。
这正是Inkling的市场空间:它是一款美国公司开发、采用Apache 2.0、支持私有部署和定制的开放权重模型,美国企业选它,不必担心使用中国模型引发的政治争议,也更容易通过政府客户和大型公司的合规审查。Inkling真正的价值,来自这种合规确定性——穆拉蒂把DeepSeek和Kimi的公开成果,转化成一款由美国公司提供的模型,它不需要在基准里击败中国模型,只需成为那些不敢继续用中国模型的美国企业可以接受的选择,这也解释了它为何敢定更高的价:政策替它缩小了竞争范围,性能与价格的差距便没那么致命,对一些美国企业来说,一款稍弱、稍贵但风险低的模型,已经足够。
从这个角度看,Inkling反而证明了穆拉蒂懂做生意。但这套生意成立的代价,可能由美国企业承担。美国之外的公司仍可自由选择GLM、Kimi和DeepSeek,在更强更便宜的基础模型上开发产品;美国企业却可能被迫采用性能稍弱、价格更高的本土替代品,基础模型的能力差距会继续传递到微调后的产品,最终形成结构性竞争劣势。华盛顿原本想用限制保护美国AI公司,结果可能先替Inkling这样的贵替创造了市场。对穆拉蒂来说,一般般已经够了,对美国AI产业来说,这份够用意味着成本升高与竞争力下降。
via AI新闻资讯 (author: AI Base)
OpenAI前首席技术官穆拉蒂离开老东家后交出的第一份答卷,意外地把中美大模型的角色关系颠倒了过来。 7 月 15 日,她创办的Thinking Machines Lab发布首款模型Inkling,混合专家架构主要沿用DeepSeek-V3,后训练冷启动还借了月之暗面Kimi K2. 5 等开放模型生成的合成数据。结果颇显微妙:在多项基准评测里,Inkling落后于Kimi和GLM,调用价格反而更高。一家融资 20 亿美元、估值 120 亿美元的明星公司,首秀多少低于预期,但穆拉蒂可能从一开始就没打算靠它争夺第一。
单看硬件配置,Inkling确实撑得起明星实验室的排面。它采用混合专家架构,总参数量 9750 亿,每处理一个Token激活 410 亿参数;预训练用了 45 万亿Token,数据涵盖文本、图像、音频与视频,最长支持 100 万Token上下文;能理解文字、图片和音频,以文字形式输出,还支持通过调节思考强度在性能、速度与成本之间取舍。模型同时开放权重,采用相当宽松的Apache 2. 0 许可证,开发者既能下载权重自行部署,也能通过Thinking Machines旗下的Tinker平台微调。公司的定位很明确:与其直接和ChatGPT争夺普通用户,Inkling更适合充当企业开发AI应用的底座。
真正引人注意的,藏在技术报告的后半段。Thinking Machines在介绍架构时直接写道,Inkling的混合专家设计主要沿用了DeepSeek-V3,同样设置了大量专家模块、每个Token只调用其中一小部分,并采用了DeepSeek-V3 的无辅助损失负载均衡设计。中国模型的影响还延伸到了训练阶段:为了启动后训练,公司先用开放权重模型生成的合成数据做了一轮监督微调,其中明确提到了Kimi K2.5。
一条完整的路线浮出水面——一家由OpenAI前CTO创办的美国实验室,首款模型沿用DeepSeek架构,又借助Kimi的数据完成后训练起步。借鉴开放模型本身无可厚非,DeepSeek和Kimi公开权重、允许使用,本就是建立在公开成果之上,更尴尬的是Inkling吸收了中国模型的技术之后,性能依旧没压过这些老师。Thinking Machines也坦然承认:Inkling并非目前表现最强的模型,无论开放模型还是闭源模型。
把数字摆出来就更清楚了。在人类最后的考试纯文本评测中,Inkling得29.7%,Kimi K2. 6 和GLM 5. 2 分别达到35.9%与40.1%;加上工具后Inkling升至46%,仍低于Kimi K2. 6 的54%和GLM 5. 2 的54.7%;考察真实软件工程能力的SWE-Bench Pro里,Inkling为54.3%,Kimi K2. 6 是58.6%,GLM 5. 2 达到62.1%;差距在Terminal Bench 2. 1 上最刺眼,Inkling仅63.8%,Kimi K2. 6 和GLM 5. 2 分别有71.3%和82.7%。
当然Inkling也有长项,在网页应用设计、音频理解和安全性评测中表现不错,部分数学任务还能超过Kimi和DeepSeek,但综合推理、编程与智能体能力,它暂时挤不进开放模型的第一梯队。价格同样没给惊喜:Tinker平台上64K版本每 100 万Prefill Token收费1. 87 美元、每 100 万Sample Token收费4. 68 美元,且这已是限时五折价,256K版本更分别涨到3. 74 和9. 36 美元;对比Kimi K2. 6 官方API输入0.95、输出 4 美元,GLM 5. 2 为1. 4 和4. 4 美元,Inkling的预填充价格接近Kimi K2. 6 的两倍,生成价格也更高,暂时看不出价格优势。于是局面变得有点微妙:架构参考DeepSeek,后训练借力Kimi,综合性能没超过中国头部开放模型,调用价格反而更贵。
之所以耐人寻味,在于Thinking Machines的特殊身世。这家公司几乎是OpenAI校友会—— 2025 年 2 月亮相时团队约 30 人,三分之二来自OpenAI,其余主要来自Meta和Mistral,创始阵容一度包括John Schulman、Barret Zoph、Lilian Weng、Andrew Tulloch和Luke Metz,路透社称穆拉蒂从前东家挖走了至少 20 名研究人员。
穆拉蒂本人 2018 年加入OpenAI,参与过DALL-E、Codex、ChatGPT和Sora, 2022 年升任CTO, 2023 年 11 月董事会罢免Altman后还短暂出任临时CEO,对OpenAI的模型研发与产品化路径有着完整认知。这样一群最懂OpenAI的人离开后,从零搭建技术体系,外界本期待一条带着OpenAI印记的路线,结果最明确的技术来源却指向中国模型,这很容易被解读成一个戏剧性信号:最了解OpenAI的一群人,最终选了中国模型的技术蓝图。
但这个结论需要拆开看。OpenAI近年前沿模型全部闭源,外界拿不到权重,也不了解完整架构与训练方案,穆拉蒂即便熟悉内部技术,也不能把前东家的商业机密搬进新公司;DeepSeek和Kimi则公开了权重或技术报告,架构、训练方法和工具链都可以合法研究复用。
Inkling本身也是开放权重模型,对想建设开放生态的公司来说,从DeepSeek、Kimi等开放模型吸收成熟方案,是顺理成章的工程选择。今天开发一款开放模型却完全避开中国团队已公开的成果,反而要付出更高试错成本。因此借鉴中国模型并不能证明穆拉蒂认为DeepSeek全面领先OpenAI,双方公开程度不同、可借鉴条件也完全不同,但它释放了一个清晰信号:至少在开放权重领域,中国模型已经成了美国AI团队的重要参考系。
真正要回答的,是为什么Thinking Machines吸收了现成架构和训练经验,做出的Inkling却性能更弱、价格更高。穆拉蒂拥有顶尖团队、充足资金和英伟达最新训练系统,没有理由看不到这些差距,所以贵替很可能是一个经过计算的选择。
按Thinking Machines拿到的待遇,Inkling本不该只是一款够用的模型。 2025 年 7 月公司尚未推出任何产品,就完成 20 亿美元种子轮、估值 120 亿美元,投资方包括a16z、英伟达、AMD和简街;四个月后新一轮谈判目标估值一度高达 500 亿美元,虽未官宣,外界已把它视作OpenAI和Anthropic的潜在对手。当它以性能不如中国模型、价格还更贵的产品亮相,难免低于预期,但从商业角度看,穆拉蒂可能从一开始就没打算用它争基准第一。
公司强调的是开放权重、多模态与可定制性,希望企业经Tinker微调,把Inkling改造成客服、编程助手、行业智能体等专用模型。穆拉蒂押注的市场,对基准第一并不执着,企业更在意模型能否私有部署、能否掌握数据、能否按自己的业务继续训练。此前这类需求很大一部分被中国开放模型接住了:OpenAI和Anthropic长期闭源,Meta的Llama4 不及预期后也逐渐收缩开放路线,而DeepSeek、Kimi、Qwen和GLM持续开放权重,性能越来越接近美国闭源模型、价格却低得多。
美国企业很快用脚投票——OpenRouter向CNBC提供的数据显示, 2026 年 2 月以来,中国模型在美国企业经该平台调用的Token中每周占比都超过30%,最高一度达46%,而 2025 年上半年的平均占比还只有4.5%;Cursor开发Composer2 时测试多款基础模型,最终选了评测最强的Kimi K2.5,桥水基金则通过Tinker微调阿里的Qwen,以更低成本超过了部分顶级闭源模型。中国开放模型由此成了美国企业降成本的捷径,但这条路正在承压。
与此同时,美国对中国AI模型的监管氛围在收紧。相关部门已围绕数据安全、模型来源和供应链风险发出警告,部分使用中国模型的企业受到调查。即便尚未形成统一限制,政策不确定性已足以影响企业选择,尤其是涉及政府业务和敏感数据的公司。
这正是Inkling的市场空间:它是一款美国公司开发、采用Apache 2.0、支持私有部署和定制的开放权重模型,美国企业选它,不必担心使用中国模型引发的政治争议,也更容易通过政府客户和大型公司的合规审查。Inkling真正的价值,来自这种合规确定性——穆拉蒂把DeepSeek和Kimi的公开成果,转化成一款由美国公司提供的模型,它不需要在基准里击败中国模型,只需成为那些不敢继续用中国模型的美国企业可以接受的选择,这也解释了它为何敢定更高的价:政策替它缩小了竞争范围,性能与价格的差距便没那么致命,对一些美国企业来说,一款稍弱、稍贵但风险低的模型,已经足够。
从这个角度看,Inkling反而证明了穆拉蒂懂做生意。但这套生意成立的代价,可能由美国企业承担。美国之外的公司仍可自由选择GLM、Kimi和DeepSeek,在更强更便宜的基础模型上开发产品;美国企业却可能被迫采用性能稍弱、价格更高的本土替代品,基础模型的能力差距会继续传递到微调后的产品,最终形成结构性竞争劣势。华盛顿原本想用限制保护美国AI公司,结果可能先替Inkling这样的贵替创造了市场。对穆拉蒂来说,一般般已经够了,对美国AI产业来说,这份够用意味着成本升高与竞争力下降。
via AI新闻资讯 (author: AI Base)
网络安全这道防线,正在被一种新的作战单元重新定义。7月21日,日本人工智能初创企业Sakana AI发布专为应对现代网络防御复杂性而打造的Fugu Cyber模型,它在业界最具挑战性的安全基准测试里交出了足以压过头部闭源对手的成绩。
具体来看,Fugu Cyber在CyberGym测试中达到86.9%的成功率,在CTI-REALM测试中达到72.1%的成功率,表现甚至优于OpenAI的GPT-5.5-Cyber与Anthropic的Claude Mythos-Preview。这意味着,面对真实而刁钻的攻防场景,这家初创公司的专用模型已经跑到了通用旗舰的前面。
Fugu Cyber的能力来源于它的系统形态。与标准版Fugu一脉相承,它是一个被封装成单一API的多智能体系统,针对用户的每一次请求,系统会动态编排不同的专业智能体,协作处理复杂的多步骤任务,而不是靠单个模型硬扛。除了这套简洁的API,Sakana AI还提供由企业应用团队支持的网络安全解决方案实地部署服务,把模型能力直接搬进客户的生产环境。
via AI新闻资讯 (author: AI Base)
在最近的一次分析中,Wojciech Gryc 探讨了 Anthropic 的 Fable 5 与两款中国新模型的市场竞争情况。Moonshot 于 7 月 16 日推出的 Kimi K3 和阿里巴巴于 7 月 19 日发布的 Qwen 3.8 都达到了与 Fable 5 相似的性能,并且这两款模型将开源其权重。
Gryc 指出,训练前沿 AI 模型的主要成本来自研究人员和算力,但在模型训练完成后,推理成本才是真正的开销。每当用户调用 API 时,都会消耗大量的 GPU 资源和电力。他认为,如何支付推理成本将直接影响公司的商业模式。
他将 AI 公司分为三类:第一类是租用数据中心并支付电费的公司,如 Anthropic、Moonshot 和智谱(GLM 5.2);第二类是自建数据中心的公司,如 Meta 和阿里巴巴;第三类是拥有自发电能力和自建数据中心的公司,如 SpaceX。Gryc 强调,拥有基础设施的公司即使在模型性能上不是最优,依然能通过出租服务器获得盈利。
此外,Gryc 指出 Anthropic 的 Fable 5 在单个任务的推理成本上几乎是 OpenAI 和开源模型的三倍。这样的高成本在竞争激烈的市场中是否能被用户接受,是一个值得关注的问题。他认为,当前市场上的基准测试已趋于饱和,用户对于模型的感知差异远低于成本差异,可能导致 Anthropic 面临被市场抛弃的风险。
与之相比,OpenAI 则凭借其全面的产品线和数据中心的布局展现出更强的市场竞争力。Gryc 预计,当前这一波竞争将持续发展,多家实验室可能会在未来不断超越传统的美国科技巨头。
划重点:
🌟 Fable 5 的推理成本是 OpenAI 和开源模型的三倍,面临市场压力。
🔍 Gryc 将 AI 公司分为三类,指出基础设施的重要性。
📈 竞争持续加剧,多家中国实验室正在快速追赶甚至超越美国公司。
via AI新闻资讯 (author: AI Base)
OpenAI宣布扩大ChatGPT家长通知功能,当青少年用户因违反暴力威胁或网络暴力政策被封号时,已关联账号的父母和监护人将收到提醒。
此前,OpenAI推出家长控制功能,支持家长关联未成年子女账号,设置使用限制、减少敏感内容,并在发现自残风险时发送警示。此次升级后,系统将进一步覆盖可能伤害他人的风险行为。
该功能由OpenAI与网络暴力监测机构Moonshot共同开发。Moonshot表示,在严重风险出现时及时通知家长,有助于家庭尽早介入并采取措施。
OpenAI此次强化安全机制,也与AI使用风险争议有关。2025年加拿大枪击事件调查发现,嫌疑人曾使用ChatGPT,OpenAI随后承诺加强安全措施。
此外,OpenAI还在家长控制页面加入“学习模式”,通过提示引导学生思考,而非直接提供答案;针对青少年长时间使用ChatGPT的情况,系统也将增加休息提醒。
随着AI助手进入教育等场景,未成年人安全使用成为行业重点议题,OpenAI正在通过监管工具和交互设计提升AI产品的安全性。
via AI新闻资讯 (author: AI Base)
Elevated errors on Haiku 4.5
Jul 21, 07:11 UTC
Identified - The issue has been identified and a fix is being implemented.
via Claude Status - Incident History
Jul 21, 07:11 UTC
Identified - The issue has been identified and a fix is being implemented.
via Claude Status - Incident History
节省 40 亿元还是触发监管?微软拟为Copilot引入国产AI模型陷两难
为了降低高昂的AI运营成本,微软目前正在评估将中国人工智能公司月之暗面研发的Kimi K3 模型引入其Copilot服务。此前该服务主要依赖OpenAI与Anthropic的技术,而新模型的加入有望重塑其底层架构。
性能出众兼具降本优势,每年最高可省 6 亿美金
作为全球参数规模最大的开源模型,Kimi K3 在编程等多项权威评测中展现出了媲美顶级模型的卓越性能。微软内部测算显示,切换至该模型后单个Token的推理成本最高可降低60%,每年将为公司节省约6. 02 亿美元的开支。
巨额收益碰撞政治风险,政策红线成最大隐忧
然而,这项极具商业诱惑力的决策正面临着严峻的外部政治考量与政策风险。当前美国政府正计划进一步限制本土企业使用中国AI模型,甚至可能出台针对性的禁用禁令。
如果在旗舰产品中深度整合中国开源技术,微软极有可能招致白宫方面的强烈不满与审查。面对巨大的经济利益与复杂的政治局势,微软目前依然处于谨慎权衡与抉择的阶段。
via AI新闻资讯 (author: AI Base)
为了降低高昂的AI运营成本,微软目前正在评估将中国人工智能公司月之暗面研发的Kimi K3 模型引入其Copilot服务。此前该服务主要依赖OpenAI与Anthropic的技术,而新模型的加入有望重塑其底层架构。
性能出众兼具降本优势,每年最高可省 6 亿美金
作为全球参数规模最大的开源模型,Kimi K3 在编程等多项权威评测中展现出了媲美顶级模型的卓越性能。微软内部测算显示,切换至该模型后单个Token的推理成本最高可降低60%,每年将为公司节省约6. 02 亿美元的开支。
巨额收益碰撞政治风险,政策红线成最大隐忧
然而,这项极具商业诱惑力的决策正面临着严峻的外部政治考量与政策风险。当前美国政府正计划进一步限制本土企业使用中国AI模型,甚至可能出台针对性的禁用禁令。
如果在旗舰产品中深度整合中国开源技术,微软极有可能招致白宫方面的强烈不满与审查。面对巨大的经济利益与复杂的政治局势,微软目前依然处于谨慎权衡与抉择的阶段。
via AI新闻资讯 (author: AI Base)
算力飙升 10 倍!谷歌秘密研发Frozen芯片,Gemini大模型硬核升级
面对日益严峻的AI算力短缺压力,谷歌正在秘密研发一款代号为Frozen v2 的全新专用服务器芯片。该芯片的核心突破在于将Gemini大模型的底层计算逻辑直接固化在硬件之中,以此大幅提升芯片的运算效率。
硬核架构重塑算力生态
据研发团队测算,Frozen v2 落地后的单位功耗处理性能将达到谷歌现役最新自研芯片的 6 至 10 倍。这种将软件算法直接蚀刻进硅片的设计,能够显著减少数据搬运和逻辑判断步骤,实现能效的质变。
与英伟达GPU或谷歌TPU等通用芯片不同,这款专用芯片是专为Gemini架构量身打造的软硬一体化利器。它不仅可以极大缩短AI响应时间,还能支撑更多复杂的全新应用场景,预计最早于 2028 年投入部署。
定位实验平台不替代TPU
虽然性能表现强劲,但谷歌并不打算用Frozen芯片全面取代现有的TPU芯片,两者未来将形成优势互补。由于固化了算法逻辑,该芯片要求Gemini模型必须长期沿用特定基础架构,因此具有一定的技术专一性。
目前谷歌将其定位为技术试验平台,用于为下一代更高专用化的AI芯片积累工程经验。受限于初期较小的量产规模,该芯片将主要面向内部特定需求,暂不会进行大规模市场铺开。
via AI新闻资讯 (author: AI Base)
面对日益严峻的AI算力短缺压力,谷歌正在秘密研发一款代号为Frozen v2 的全新专用服务器芯片。该芯片的核心突破在于将Gemini大模型的底层计算逻辑直接固化在硬件之中,以此大幅提升芯片的运算效率。
硬核架构重塑算力生态
据研发团队测算,Frozen v2 落地后的单位功耗处理性能将达到谷歌现役最新自研芯片的 6 至 10 倍。这种将软件算法直接蚀刻进硅片的设计,能够显著减少数据搬运和逻辑判断步骤,实现能效的质变。
与英伟达GPU或谷歌TPU等通用芯片不同,这款专用芯片是专为Gemini架构量身打造的软硬一体化利器。它不仅可以极大缩短AI响应时间,还能支撑更多复杂的全新应用场景,预计最早于 2028 年投入部署。
定位实验平台不替代TPU
虽然性能表现强劲,但谷歌并不打算用Frozen芯片全面取代现有的TPU芯片,两者未来将形成优势互补。由于固化了算法逻辑,该芯片要求Gemini模型必须长期沿用特定基础架构,因此具有一定的技术专一性。
目前谷歌将其定位为技术试验平台,用于为下一代更高专用化的AI芯片积累工程经验。受限于初期较小的量产规模,该芯片将主要面向内部特定需求,暂不会进行大规模市场铺开。
via AI新闻资讯 (author: AI Base)
苹果 41 页诉状点名三人却放过伊夫:古尔曼拆解这份"留白"背后的三重算计
一份41页的诉状,把苹果与OpenAI的暗战摆上了法庭,但最耐人寻味的,是它点了谁的名、又故意略过了谁。据多家媒体援引彭博社马克·古尔曼的分析,苹果自7月12日起诉OpenAI及其硬件子公司io Products盗用商业秘密,诉状中明确点名了Tang Tan、Chang Liu、Yu-Ting Alyssa Peng三人,却对前苹果设计师乔纳森·伊夫只字未提。
古尔曼认为,这份留白并非疏忽,而是经过权衡的结果,背后至少叠着三层考量。第一层是关联性的强弱——在苹果的判断里,伊夫与这起商业秘密争议的实质牵连有限,不足以把他推上被告席。
第二层则牵出人际与资本的网络:伊夫与乔布斯遗孀Laurene Powell Jobs私交甚好,而后者在相关投资与支持上产生的影响,让直接点名伊夫的代价和连带效应都变得复杂。第三层是舆论层面的避险——若把这位苹果设计灵魂人物卷进诉讼,势必将引发外界对苹果设计话语权是否易主的无尽争论,苹果显然不愿在打官司的同时,再给自己添一场关于设计地位变动的公共危机。
当诉状用41页的篇幅细数OpenAI与io Products的"偷师"指控,却在对伊夫的处理上按下静音键,这份刻意留出的空白,本身就成了观察苹果诉讼策略的一扇窗。
via AI新闻资讯 (author: AI Base)
一份41页的诉状,把苹果与OpenAI的暗战摆上了法庭,但最耐人寻味的,是它点了谁的名、又故意略过了谁。据多家媒体援引彭博社马克·古尔曼的分析,苹果自7月12日起诉OpenAI及其硬件子公司io Products盗用商业秘密,诉状中明确点名了Tang Tan、Chang Liu、Yu-Ting Alyssa Peng三人,却对前苹果设计师乔纳森·伊夫只字未提。
古尔曼认为,这份留白并非疏忽,而是经过权衡的结果,背后至少叠着三层考量。第一层是关联性的强弱——在苹果的判断里,伊夫与这起商业秘密争议的实质牵连有限,不足以把他推上被告席。
第二层则牵出人际与资本的网络:伊夫与乔布斯遗孀Laurene Powell Jobs私交甚好,而后者在相关投资与支持上产生的影响,让直接点名伊夫的代价和连带效应都变得复杂。第三层是舆论层面的避险——若把这位苹果设计灵魂人物卷进诉讼,势必将引发外界对苹果设计话语权是否易主的无尽争论,苹果显然不愿在打官司的同时,再给自己添一场关于设计地位变动的公共危机。
当诉状用41页的篇幅细数OpenAI与io Products的"偷师"指控,却在对伊夫的处理上按下静音键,这份刻意留出的空白,本身就成了观察苹果诉讼策略的一扇窗。
via AI新闻资讯 (author: AI Base)
国产大模型的密集爆发,正把和美国旗舰闭源AI的身位拉近到肉眼难辨。快科技7月20日报道,在千问、Kimi接连秀出肌肉之后,轮到智谱出手了,传闻中的GLM-5.5被描述为一轮史诗级提升。而这次不是媒体猜测,是智谱创始人唐杰亲自下了场。
有网友在评论里提到,千问和Kimi都完成了史诗级进化,顺口问了句GLM还有没有戏。唐杰的回应当场把期待值拉满——他用了一个词:史诗级plus。这意味着,在智谱自己的判断里,这一代的提升幅度比网友提到的那些还要大。
具体的数字现在当然无从谈起,但唐杰显然希望外界对GLM保持信心。他的底气来自上一代的战绩:在Kimi K3登场之前,GLM-5.2是国产大模型中第一个在AI编程能力上追平Opus级别性能的选手。更值得注意的是它的体量——GLM-5.2的参数规模只有7400多亿,差不多是Kimi K3的四分之一,大概也只有美国顶级AI的五分之一甚至更少,却硬是靠后训练把能力托到了那个水位,堪称小参数撬动大能力的样本。
唐杰口中的史诗级plus新模型,指向的应该是下一代GLM-5.5。此前圈内传过GLM-5.3的名字,但现在看GLM-5.5的可能性更大,当然也不排除发布时直接冠上GLM-6的名号。一个可以确定的趋势是,下一代大模型的参数量至少会迈过1万亿的门槛。考虑到智谱历史上曾使用过DeepSeek开源的基模,外界猜测GLM-5.5或许会做到与V4Pro同级的1.6万亿参数;再叠加智谱公认颇强的后训练功力,其性能跃升确实值得押注,很可能又是一个对标Fable5量级的国产大模型。
不过在国产阵营的等待名单里,眼下最让人坐立难安的,还是DeepSeek V4的正式版。报道发出时,7月中旬的最后一刻——当天零点——正悬在头顶,那条小鲸鱼究竟是打算半夜甩出大招,还是又一次跳了票,谁也说不准。当智谱用一句史诗级plus把话题点燃,国产大模型这场接力赛,显然还远没到撞线的时候。
via AI新闻资讯 (author: AI Base)
Adobe正在为旗下实验性iOS相机应用Project Indigo加入一系列AI功能,通过大型语言模型(LLM)分析照片内容,为用户提供摄影点评、编辑建议以及智能优化方案。该应用此前已支持专业拍摄控制、多帧超分辨率和多种摄影模式,此次更新进一步强化了AI辅助创作能力。
新功能包括照片点评、拍摄与编辑建议、高级物体移除、AI景深生成以及照片风格迁移等。其中,照片点评功能能够围绕构图、光线、色彩和情感表达等维度提供类似专业摄影师的分析;拍摄建议功能则会针对重新构图、曝光调整以及画面元素优化提出具体指导,帮助用户提升拍摄技巧。
Project Indigo开发负责人Marc Levoy曾参与谷歌Pixel相机技术研发。他表示,当前多数生成式AI图像工具依赖用户输入提示词,但普通用户往往难以准确描述想要的调整效果。因此,Project Indigo更多采用按钮化和确定性操作,让AI直接提供可执行的编辑方案。
在智能编辑方面,Project Indigo新增的对象移除功能可以自动识别并删除背景人物、垃圾桶、电线杆、车辆等干扰元素,同时支持用户自定义描述需要移除的对象。相比传统需要手动圈选目标的方式,该功能能够减少操作成本,并提升处理效果。
此外,应用还支持通过AI生成景深效果,为普通照片模拟背景虚化,并提供水彩、钢笔画、彩色墨线、单色、逆光等风格迁移效果。不过,风格转换并非全新技术,其实际应用价值仍有待进一步验证。
目前,Project Indigo的新AI能力由基于谷歌Gemini的Nano Banana模型提供支持,Adobe也表示未来可能测试包括自研Adobe Firefly模型在内的其他AI模型。这些功能目前集中在“AI Playground”测试区域,仅向部分用户开放,是否最终全面推广仍未确定。
随着AI图像工具逐渐从简单生成和自动修图向智能摄影助手方向发展,Adobe正在探索如何利用大模型帮助用户理解摄影、优化创作流程,而不仅仅是生成视觉效果。该方向也代表了移动影像领域AI应用从“自动处理”向“辅助决策”演进的趋势。
via AI新闻资讯 (author: AI Base)
一场发生在中文微博与英文社交平台之间的隔空喊话,把大模型参数竞赛的火药味推到了台前。7月20日,月之暗面发布的新一代开源大模型Kimi K3登顶全球榜单,引发广泛关注,而就在几天前,埃隆·马斯克的一句话,让这场竞争从榜单延伸到了口水仗。
7月18日上午,马斯克在社交平台发文称,旗下那款2万亿参数的模型在各方面都优于当前1.5万亿参数版本,将在下周完成初步训练,且有可能超越Kimi;同时他放话,新模型的推理速度和Token效率将接近现有的1.5T模型,也就是Grok4.5。这番表态,等于在Kimi K3刚刚登顶的节点上,直接把参数规模的对标线拉到了2万亿以上。
月之暗面的回应干脆又带刺。它在微博上公开发文@马斯克,只扔下一句话:欢迎加入2万亿+俱乐部。一句看似轻松的邀约,实则是趁着登顶之势,把自家的开源成绩摆成了俱乐部的门槛。
不过,这场隔空对话里还留着不少未解之谜。目前xAI尚未公布Grok4.6的正式发布时间、训练细节与完整技术指标,马斯克的2万亿模型究竟是代号4.6还是另一款新作,外界仍只能等待。而把时间拨回不久前的7月9日,xAI已经发布了Grok4.5——这是该公司首个专门面向编程与智能体任务训练的模型,由xAI与Cursor联合完成训练,在提供前沿智能水平的同时兼顾领先的速度与成本效率,马斯克本人将其称为Opus级模型。当2万亿参数的新王尚未露面,Kimi K3已经先一步把开源榜单的椅子坐热,这场俱乐部之争的下一回合,恐怕要等马斯克的新模型真正走出训练阶段才算开场。
via AI新闻资讯 (author: AI Base)
马斯克把Grok塞进Excel:选中一片数据就能问涨跌原因,图表直接插进表格
马斯克旗下的xAI,把自家大模型Grok直接装进了微软Office的心脏地带。据多家财经媒体 7 月 21 日消息,xAI为微软Excel推出了一款名为Grok For Excel的免费Microsoft365 插件,目前已上线Microsoft Marketplace,同时兼容Word与PowerPoint。这意味着Grok不再只活在聊天框里,而是成了办公套件里随手可调用的数据分析员。
这款插件的使用逻辑极其贴近真实办公场景:用户在Excel里选中一片数据区域,就能直接向Grok发问,询问数据的变动情况、背后的原因以及其中的亮点,而Grok的回答会明确引用对应的数据单元格,不是凭空给结论。它还能理解公式语法,完成平均值计算、排序、填充等常规编辑操作,生成的图表则可以一键插入工作表。换句话说,过去要写函数、拖公式、手动画图的活儿,现在对着数据说句话就能推进。
更关键的是,Grok并不只盯着表格里那一小块被选中的数据。借助连接器,它能从电子邮件、SharePoint或Google Drive中提取上下文信息,把散落在各处的资料拼进当前分析。这一能力让Excel里的问答不再是孤岛,而是能结合邮件往来、团队文档和外部文件做出更完整的判断。当Grok以免费插件的姿态嵌入Word、PowerPoint和Excel三件套,办公软件与对话式AI的边界,又被磨掉了一层。
via AI新闻资讯 (author: AI Base)
马斯克旗下的xAI,把自家大模型Grok直接装进了微软Office的心脏地带。据多家财经媒体 7 月 21 日消息,xAI为微软Excel推出了一款名为Grok For Excel的免费Microsoft365 插件,目前已上线Microsoft Marketplace,同时兼容Word与PowerPoint。这意味着Grok不再只活在聊天框里,而是成了办公套件里随手可调用的数据分析员。
这款插件的使用逻辑极其贴近真实办公场景:用户在Excel里选中一片数据区域,就能直接向Grok发问,询问数据的变动情况、背后的原因以及其中的亮点,而Grok的回答会明确引用对应的数据单元格,不是凭空给结论。它还能理解公式语法,完成平均值计算、排序、填充等常规编辑操作,生成的图表则可以一键插入工作表。换句话说,过去要写函数、拖公式、手动画图的活儿,现在对着数据说句话就能推进。
更关键的是,Grok并不只盯着表格里那一小块被选中的数据。借助连接器,它能从电子邮件、SharePoint或Google Drive中提取上下文信息,把散落在各处的资料拼进当前分析。这一能力让Excel里的问答不再是孤岛,而是能结合邮件往来、团队文档和外部文件做出更完整的判断。当Grok以免费插件的姿态嵌入Word、PowerPoint和Excel三件套,办公软件与对话式AI的边界,又被磨掉了一层。
via AI新闻资讯 (author: AI Base)