https://t.me/AI_News_CN
📈主流AI服务状态页通知 | 🆕汇集全网ChatGPT/AI新闻 #AI #ChatGPT
🔙备用群 https://t.me/gpt345
✨BEST AI中转 https://api.oaibest.com 2.8折起 支持OpenAI, Claude code, Gemini,Grok, Deepseek, Midjourney, 文件上传分析
Buy ads: https://telega.io/c/AI_News_CN
📈主流AI服务状态页通知 | 🆕汇集全网ChatGPT/AI新闻 #AI #ChatGPT
🔙备用群 https://t.me/gpt345
✨BEST AI中转 https://api.oaibest.com 2.8折起 支持OpenAI, Claude code, Gemini,Grok, Deepseek, Midjourney, 文件上传分析
Buy ads: https://telega.io/c/AI_News_CN
Pixel 11 系列将于 8 月 12 日正式发布,同日开启预约。「Made by Google 2026」发布会将于美东时间 8 月 12 日 22:00(日本时间 8 月 13 日早 7 点)在纽约举行,以英文直播,届时将公布 Gemini Intelligence 及全新 Pixel 设备。
日本首家 Google Store 旗舰店将于 8 月 13 日在东京表参道开业,用户可订阅邮件获取 Pixel 11 最新资讯与限定优惠。
Google Store
🌸 在花频道 · 茶馆水群 · 投稿通道
via 科技圈🎗在花频道📮 - Telegram Channel
OpenAI 一口气降价 80%,GPT-5.6 Luna 性价比反超 DeepSeek V4 Pro
OpenAI 正式公布 GPT-5.6 系列全新定价方案,本次调价仅针对 Terra、Luna 两款中端和轻量级模型,旗舰 GPT-5.6 Sol 定价维持不变。其中面向批量轻量化推理场景的 Luna 迎来史上最大幅度降价,输入与输出费用同步下调 80%。
调价前 Luna 每百万输入 Token 为 1 美元、输出 6 美元,调整后输入仅 0.2 美元(约 1.4 元人民币),输出 1.2 美元(约 8.1 元人民币)。同系列均衡版 Terra 同步下调 20%,输入 2 美元、输出 12 美元,而主打复杂代码和多模态深度思考的 Sol 维持原价,形成"低价 Luna 抢市场、高端 Sol 保利润"的清晰分层策略。
性价比全面碾压,补齐成本短板
OpenAI 同步放出第三方机构 Artificial Analysis 的评测图表,从单位任务成本与模型综合得分两个维度对比主流轻量商用模型。数据显示全新定价下的 Luna 完成同等标准任务的综合性价比全面超过 DeepSeek V4 Pro,在通用文本创作、多轮对话、工具调用等场景中得分更高、花费更低。
此前海外模型相比国产高性价比产品的最大短板正是成本,而这次降价直接将其补齐。业内分析认为,大幅降价的根本驱动力来自国产大模型的持续低价冲击——DeepSeek V4 Pro 依靠缓存机制实现极低重复输入成本,平峰时段常规推理定价长期维持低位,叠加多家国内厂商持续推出平价 API 服务,不断分流海外中小开发者客户。当国产模型的低价优势不再是护城河,大模型行业的下一场战争或许才刚刚开始。
via AI新闻资讯 (author: AI Base)
OpenAI 正式公布 GPT-5.6 系列全新定价方案,本次调价仅针对 Terra、Luna 两款中端和轻量级模型,旗舰 GPT-5.6 Sol 定价维持不变。其中面向批量轻量化推理场景的 Luna 迎来史上最大幅度降价,输入与输出费用同步下调 80%。
调价前 Luna 每百万输入 Token 为 1 美元、输出 6 美元,调整后输入仅 0.2 美元(约 1.4 元人民币),输出 1.2 美元(约 8.1 元人民币)。同系列均衡版 Terra 同步下调 20%,输入 2 美元、输出 12 美元,而主打复杂代码和多模态深度思考的 Sol 维持原价,形成"低价 Luna 抢市场、高端 Sol 保利润"的清晰分层策略。
性价比全面碾压,补齐成本短板
OpenAI 同步放出第三方机构 Artificial Analysis 的评测图表,从单位任务成本与模型综合得分两个维度对比主流轻量商用模型。数据显示全新定价下的 Luna 完成同等标准任务的综合性价比全面超过 DeepSeek V4 Pro,在通用文本创作、多轮对话、工具调用等场景中得分更高、花费更低。
此前海外模型相比国产高性价比产品的最大短板正是成本,而这次降价直接将其补齐。业内分析认为,大幅降价的根本驱动力来自国产大模型的持续低价冲击——DeepSeek V4 Pro 依靠缓存机制实现极低重复输入成本,平峰时段常规推理定价长期维持低位,叠加多家国内厂商持续推出平价 API 服务,不断分流海外中小开发者客户。当国产模型的低价优势不再是护城河,大模型行业的下一场战争或许才刚刚开始。
via AI新闻资讯 (author: AI Base)
Anthropic AI模型测试期间曾入侵三家公司
Anthropic周四表示,该公司在测试的软件曾接入了互联网,并在自身不知情的情况下入侵了一些毫无防备的公司。此类独立事件共发生三起,最早可追溯至今年四月。这三家公司均已在周一接到了事件通知。
在排查了超过14.1万次测试日志后,该公司发现Claude确实曾数次接入互联网。该公司的测试合作伙伴、以色列安全公司Irregular运行的系统存在 “配置错误”,导致这些模型获得了实时的互联网访问权限。
这些模型曾被设定为处于断网状态。但在测试过程中,不仅接入互联网,还利用猜测弱密码、寻找无需身份验证的系统等基本黑客手段,入侵了上述公司。这些模型错误地以为,这种入侵行为是其基准测试的一部分。
—— 华尔街日报
via 风向旗参考快讯 - Telegram Channel
Anthropic周四表示,该公司在测试的软件曾接入了互联网,并在自身不知情的情况下入侵了一些毫无防备的公司。此类独立事件共发生三起,最早可追溯至今年四月。这三家公司均已在周一接到了事件通知。
在排查了超过14.1万次测试日志后,该公司发现Claude确实曾数次接入互联网。该公司的测试合作伙伴、以色列安全公司Irregular运行的系统存在 “配置错误”,导致这些模型获得了实时的互联网访问权限。
这些模型曾被设定为处于断网状态。但在测试过程中,不仅接入互联网,还利用猜测弱密码、寻找无需身份验证的系统等基本黑客手段,入侵了上述公司。这些模型错误地以为,这种入侵行为是其基准测试的一部分。
—— 华尔街日报
via 风向旗参考快讯 - Telegram Channel
OpenAI近期在推出GPT-5.6、高级语音、Codex集成及全新Work智能体模式后,对ChatGPT桌面应用进行了“超级应用”式重构,但新版界面因聊天记录难找、标签页繁杂等问题引发用户广泛讨论。对此,OpenAI总裁Greg Brockman在接受媒体采访时公开承认,目前的产品体验“确实有点混乱”,并表示团队正通过持续迭代优化设计。
Brockman表示,目前的多标签页布局只是过渡方案,OpenAI的长期目标是打造无标签页、统一工作空间的桌面体验。按照规划,到2026年底,独立的“Work”标签页将被移除,其智能体能力将无缝融入ChatGPT,对话、Codex编程工具及自主智能体任务将在同一界面协同运行,减少窗口与侧边栏带来的操作复杂度。
尽管界面调整引发争议,OpenAI表示此次整合显著推动了Codex普及。Brockman透露,Codex接入ChatGPT桌面版后,仅数天内用户规模便从500万增长至1000万。面对“是否因强制整合带来增长”的质疑,他承认这一因素确实存在,但认为让更多普通用户接触AI智能体能力,有助于释放更大的产品价值,因此值得在早期接受一定的体验成本。
此次回应显示,OpenAI正以快速迭代方式推进ChatGPT向“AI超级应用”演进,在统一聊天、编程与智能体能力的同时,如何兼顾功能扩展与产品易用性,将成为后续版本优化的重点。
via AI新闻资讯 (author: AI Base)
人工智能领域的“价格战”再次升级。7月31日,OpenAI正式公布了GPT-5.6系列的全新定价方案,对中端和轻量级模型进行了大幅调价,其中旗舰款保持不变,而轻量级模型则迎来了史无前例的资费下调。
根据官方公布的方案,面向批量轻量化推理场景的Luna模型成为此次降价的核心焦点,其输入与输出费用同步大幅削减了80%。调整后,每百万输入 Token 的定价降至0.2美元,而百万输出 Token 的定价则为1.2美元。与此同时,同系列主打均衡性能的Terra模型价格也下调了20%,调整为输入2美元、输出12美元每百万 Token。不过,主打复杂代码编写与多模态深度思考的旗舰版本Sol则维持原有高价,形成清晰的产品分层策略。
业内分析指出,OpenAI此次出人意料的大幅降价,很大程度上是受到国产大模型持续低价攻势的直接冲击。此前,以DeepSeek V4系列为代表的国产模型通过创新的缓存机制实现了极低的重复输入成本,平峰时段常规推理定价长期保持在较低水平,叠加众多国内厂商持续推出的平价 API 服务,不断分流海外中小开发者客户,这也迫使OpenAI不得不放下身段调整入门级模型的定价策略。
随着全新定价方案的落地,第三方权威机构的评测也随之出炉。根据 Artificial Analysis 发布的评测图表显示,在完成同等标准任务时,降价后的GPT-5.6Luna在综合性价比上已经全面超越了DeepSeek V4Pro。这一改变不仅有效补齐了海外模型在性价比方面的传统短板,也让开发者在主流商用模型的选择上有了更有竞争力的选项。
via AI新闻资讯 (author: AI Base)
Google 近日公布的数据堪称震撼:在 AI 工具辅助下,仅 6 月推出的 Chrome 149 与 Chrome 150 两个版本中,团队就修复了多达 1072 个安全漏洞。作为对比,过去两年发行的 23 个 Chrome 版本累计修复漏洞总数仅为 1036 个——AI 让漏洞发现与修复的效率发生了质变。
Gemini 入场,漏洞挖掘进入工业化时代
Chrome 工程总监道格·特纳直言,大语言模型已经从根本上改变了网络安全的经济格局,将漏洞发现转化为自动化、工业化规模的操作。通过应用 Gemini 等模型,Google 得以提前预先修复漏洞,在安全攻防对抗中跑赢对手。
这一趋势正成为行业共识。微软本月早些时候同样宣布,其月度例行更新中修补了创纪录的 570 个安全漏洞,并将成绩直接归功于 AI 工具的加持。苹果则暂未出现类似的爆发式增长,独立统计显示其 2026 年修复的漏洞数量与往年基本持平。
当安全研究员警告 AI 将使漏洞挖掘呈指数级增长时,Google 和微软正在用实际数据证明:防守方同样可以借助 AI 以牙还牙。在漏洞发现速度以十倍甚至百倍提升的新常态下,谁能更快地用 AI 堵住缺口,谁就掌握了这场攻防战真正的主动权。
via AI新闻资讯 (author: AI Base)
由前OpenAI研究员Leopold Aschenbrenner创立的AI主题对冲基金Situational Awareness近期因AI基础设施板块持续调整遭遇重大回撤,其大部分公开股票持仓已出售给Ken Griffin旗下Citadel。交易完成后,基金管理资产已降至约100亿美元,较此前约200亿美元进一步缩水,标志着AI基础设施投资热潮进入阶段性调整。
现年25岁的Aschenbrenner于2024年创立该基金,此前曾任职于OpenAI“超级对齐”团队,并因提出AI发展将推动半导体、算力、存储和能源基础设施长期需求增长而受到市场关注。基金一度表现亮眼,截至今年6月年内回报率高达439%,管理规模峰值曾达到450亿美元。但随着AI基础设施板块整体回落,SK海力士、闪迪、Bloom Energy、Nebius Group等核心持仓近一个月跌幅均超过30%,叠加杠杆投资策略,基金亏损进一步扩大。
尽管市场承压,Aschenbrenner仍在7月24日致投资者信中称当前为“去年初以来最佳买入机会之一”,并邀请投资者自8月1日起追加资金,但未获得预期支持。Citadel此次接盘也延续了其在杠杆投资者被迫减仓时收购优质资产的一贯策略,其自身此前已布局部分AI基础设施标的,反映出对行业长期前景仍持积极判断。
值得关注的是,Situational Awareness并未出售私募股权资产,仍持有价值约50亿美元的Anthropic股份,同时保留对MatX、Fluidstack等AI企业的投资。其中,Anthropic今年5月完成H轮融资后估值达9650亿美元,并预计最早于10月启动上市,相关资产未来或成为基金修复业绩的重要支撑。整体来看,事件反映出AI基础设施投资短期波动加剧,但长期价值逻辑仍受到部分机构持续看好。
via AI新闻资讯 (author: AI Base)
亚马逊发现AI导致部分项目开支失失控
亚马逊员工发现,公司因AI部署失误、缺乏支出管控,出现多起成本严重超支的情况,其代价被形容为 “高得堪称灾难性”。知情人士称,高级工程师周二在一次员工会议上告诉同事,把部分任务从传统编程改为由AI模型完成的尝试,造成了“计划外”支出。
工程师正在为今后的项目建立自动化成本护栏,并采取其他措施控制支出。亚马逊一名高级员工说:“很难弄清楚任何与AI相关的东西到底要花多少钱。”在本周的一次内部演示中,员工听取了这样一个案例:亚马逊使用Claude Sonnet模型,将作者资料与集团电商网站上的商品条目进行匹配。尽管该部署最终失败,公司仍为此花费了180万美元。
—— 英国金融时报
via 风向旗参考快讯 - Telegram Channel
亚马逊员工发现,公司因AI部署失误、缺乏支出管控,出现多起成本严重超支的情况,其代价被形容为 “高得堪称灾难性”。知情人士称,高级工程师周二在一次员工会议上告诉同事,把部分任务从传统编程改为由AI模型完成的尝试,造成了“计划外”支出。
工程师正在为今后的项目建立自动化成本护栏,并采取其他措施控制支出。亚马逊一名高级员工说:“很难弄清楚任何与AI相关的东西到底要花多少钱。”在本周的一次内部演示中,员工听取了这样一个案例:亚马逊使用Claude Sonnet模型,将作者资料与集团电商网站上的商品条目进行匹配。尽管该部署最终失败,公司仍为此花费了180万美元。
—— 英国金融时报
via 风向旗参考快讯 - Telegram Channel
砸入 150 亿美元巨资,Anthropic拟在得州新建AI数据中心,谷歌提供全方位保链支撑
人工智能领域的基建投资正迎来新一轮爆发。知情人士透露,数据中心开发商 Nexus Data Centers 目前正围绕一项高达 150 亿美元的融资计划展开深度谈判。该项目旨在为人工智能企业Anthropic位于美国得克萨斯州的大型AI数据中心提供资金支持,而科技巨头谷歌则在其中扮演着至关重要的担保与芯片供应角色。
根据规划细节,如果Anthropic未来出现无法履行租赁及电力支付义务的情况,谷歌将为其提供总额达数十亿美元的债务担保。这项担保范围全面覆盖了Anthropic签署的多份数据中心租赁协议,以及与配套现场电厂挂钩的购电合同。通过提供强有力的信用背书,谷歌不仅深度绑定了核心合作伙伴,也预计将在该数据中心及相关电力项目中获取约20%的股权回报。
除了资金层面的保驾护航,该数据中心的硬件核心也将全面向谷歌技术生态靠拢。Anthropic计划在当地大规模部署由谷歌与博通联合设计的张量处理单元(TPU)芯片。业内人士指出,这些定制化芯片的采购将通过Anthropic与博通之间独立的供应商融资协议来具体落实。随着大模型对算力的需求持续飙升,头部云厂商与AI独角兽之间的协同创新与资本捆绑正变得愈发紧密。
via AI新闻资讯 (author: AI Base)
人工智能领域的基建投资正迎来新一轮爆发。知情人士透露,数据中心开发商 Nexus Data Centers 目前正围绕一项高达 150 亿美元的融资计划展开深度谈判。该项目旨在为人工智能企业Anthropic位于美国得克萨斯州的大型AI数据中心提供资金支持,而科技巨头谷歌则在其中扮演着至关重要的担保与芯片供应角色。
根据规划细节,如果Anthropic未来出现无法履行租赁及电力支付义务的情况,谷歌将为其提供总额达数十亿美元的债务担保。这项担保范围全面覆盖了Anthropic签署的多份数据中心租赁协议,以及与配套现场电厂挂钩的购电合同。通过提供强有力的信用背书,谷歌不仅深度绑定了核心合作伙伴,也预计将在该数据中心及相关电力项目中获取约20%的股权回报。
除了资金层面的保驾护航,该数据中心的硬件核心也将全面向谷歌技术生态靠拢。Anthropic计划在当地大规模部署由谷歌与博通联合设计的张量处理单元(TPU)芯片。业内人士指出,这些定制化芯片的采购将通过Anthropic与博通之间独立的供应商融资协议来具体落实。随着大模型对算力的需求持续飙升,头部云厂商与AI独角兽之间的协同创新与资本捆绑正变得愈发紧密。
via AI新闻资讯 (author: AI Base)
在人形机器人加速落地的当下,AI“大脑”的迭代速度再次刷新行业认知。相关团队于近日正式推出了新一代具身推理模型——Gemini Robotics ER2。作为专为硬件设备打造的核心驱动系统,该模型不仅在物理环境理解与多步骤任务规划上实现进阶,更首次在技术层面攻克了多机器人协同作业的难题。
自相关具身智能体系推出以来,研发团队不断加快产品迭代步伐。经历前期版本的演进后,全新的 ER2模型在实时决策与持续任务监控方面带来了突破性进展。与传统推理模型需要“停顿思考”再执行动作的模式不同,该模型允许机器人在保持移动的同时规划下一步行动。
通过与实时语音交互接口的深度整合,硬件设备能够更流畅地处理连续任务,大幅削减了中间的卡顿与暂停。同时,新模型具备持续视频理解能力,不仅能实时评估任务进度、捕捉执行中的失误环节,还可以直接对出错步骤进行针对性重试,省去了重置整个工作流程的繁琐步骤。测试数据显示,该模型在任务进度分类和关键事件时间点识别上均展现出极高的准确率。
尤为引人瞩目的是,该模型正式引入了多机器人协作机制。依托这一技术底层,不同形态与功能的机器人得以共享环境数据并高效实现分工交接。在官方公布的实测演示中,相关人形机器人与机械臂平台成功联手,生动演绎了跨设备的协同作业实力。
目前,该模型已通过 API 及开发者平台向行业开放,同时也在企业级 Agent 平台上展开私测,标志着具身智能正向着规模化商用迈出坚实一步。
via AI新闻资讯 (author: AI Base)
AI 的真正威胁不是失业,而是让你的工资涨不动了
阿波罗全球管理公司最新发布的一份白皮书给出了一个反直觉的判断:AI 未必会直接抢走人们的工作,却可能率先压低工资。这项追踪了 321 种职业工资与就业数据的研究显示,自 2023 年起——大致与 ChatGPT 开始迅速走红的时间点重合——AI 暴露度最高的岗位实际工资增速平均下降了 6.7%。
研究尚未发现 AI 对整体就业产生"可检测"的影响,这意味着目前更多人面临的并非失业焦虑,而是涨薪越来越难的现实。
低收入群体首当其冲,程序员同样未能幸免
工资冲击的分布极不均衡。自 2023 年以来,服务业劳动者的收入增速平均下降 24.3%,收入位于后 25% 的劳动者工资下降 10.7%,而收入最高的劳动者群体则没有受到"显著影响"。研究人员还采用了 Anthropic 经济指数,根据各职业任务中实际使用 AI 工具完成的比例来评估暴露程度。
从具体职业看,计算机程序员的实际工资下降 6.1%、统计助理下降 5.4%、软件质量分析师下降 2.9%、数据库架构师下降 2.7%——这些传统意义上的高技能岗位,同样未能逃脱 AI 带来的工资下行压力。白皮书估计,美国约有 580 万名劳动者从事 AI 暴露度较高的工作,且随着 AI 在企业界加速渗透,这一数字很可能大幅攀升。
当然,硬币也有另一面。个人理财顾问超过三分之一的工作任务可能受 AI 影响,工资反而上涨了 8.4%;行政法法官约 30% 的工作任务处于 AI 辐射范围内,同期工资上涨了 17.5%。这表明 AI 对工资的冲击并非一刀切,部分职业反而因 AI 辅助提升了产出价值。但对大多数暴露度高的岗位而言,AI 带来的并非岗位消失的恐惧,而是一种更隐蔽的侵蚀——你依然有工作,但加薪的筹码正在悄悄缩水。这或许才是 AI 时代劳动力市场正在上演的最真实的叙事。
via AI新闻资讯 (author: AI Base)
阿波罗全球管理公司最新发布的一份白皮书给出了一个反直觉的判断:AI 未必会直接抢走人们的工作,却可能率先压低工资。这项追踪了 321 种职业工资与就业数据的研究显示,自 2023 年起——大致与 ChatGPT 开始迅速走红的时间点重合——AI 暴露度最高的岗位实际工资增速平均下降了 6.7%。
研究尚未发现 AI 对整体就业产生"可检测"的影响,这意味着目前更多人面临的并非失业焦虑,而是涨薪越来越难的现实。
低收入群体首当其冲,程序员同样未能幸免
工资冲击的分布极不均衡。自 2023 年以来,服务业劳动者的收入增速平均下降 24.3%,收入位于后 25% 的劳动者工资下降 10.7%,而收入最高的劳动者群体则没有受到"显著影响"。研究人员还采用了 Anthropic 经济指数,根据各职业任务中实际使用 AI 工具完成的比例来评估暴露程度。
从具体职业看,计算机程序员的实际工资下降 6.1%、统计助理下降 5.4%、软件质量分析师下降 2.9%、数据库架构师下降 2.7%——这些传统意义上的高技能岗位,同样未能逃脱 AI 带来的工资下行压力。白皮书估计,美国约有 580 万名劳动者从事 AI 暴露度较高的工作,且随着 AI 在企业界加速渗透,这一数字很可能大幅攀升。
当然,硬币也有另一面。个人理财顾问超过三分之一的工作任务可能受 AI 影响,工资反而上涨了 8.4%;行政法法官约 30% 的工作任务处于 AI 辐射范围内,同期工资上涨了 17.5%。这表明 AI 对工资的冲击并非一刀切,部分职业反而因 AI 辅助提升了产出价值。但对大多数暴露度高的岗位而言,AI 带来的并非岗位消失的恐惧,而是一种更隐蔽的侵蚀——你依然有工作,但加薪的筹码正在悄悄缩水。这或许才是 AI 时代劳动力市场正在上演的最真实的叙事。
via AI新闻资讯 (author: AI Base)
7月31日,据彭博社报道,知情人士称,DeepSeek正计划在内蒙古建设一座大型AI数据中心,这是该公司在计算基础设施领域迈出的雄心勃勃的一步。此前,它已展现出能与硅谷领先AI模型一较高下的实力。
DeepSeek
据知情人士透露,DeepSeek拟在北京西北约350公里的乌兰察布新增1吉瓦的算力。DeepSeek计划自建新设施,同时从其他公司租赁额外容量。根据一份由第三方整理的当地政府审批项目清单,已有十余家企业计划在乌兰察布建设项目。
两名知情人士表示,DeepSeek正推动该数据中心在明年底或2028年初让至少部分算力上线运行。目前尚不清楚DeepSeek将为该项目采用哪种芯片。
尽管OpenAI和Anthropic等美国科技企业已在AI算力领域率先投入数百亿美元,但DeepSeek的举措表明,中国竞争对手也在投资基础设施确保不被甩在身后。一个1吉瓦的AI数据中心将远大于目前任何一家中国公司已投入运营的设施,但仍落后于美国公司3吉瓦和5吉瓦的项目规模。智谱AI也正在打造一个1吉瓦的项目,并计划全部采用国产芯片。
DeepSeek此前已经公开暗示,其目标是获得远大得多的算力。在目前一份面向数据中心岗位的招聘信息中(该职位可能位于DeepSeek总部所在地杭州、北京或内蒙古),这家创业公司表示,新员工将直接参与AI基础设施建设,其中包括建设一个吉瓦级的数据中心园区。
乌兰察布年平均气温约为4摄氏度,拥有天然的低温气候,有助于降低为高能耗AI服务器进行散热所需的能源消耗,因此成为包括中国移动在内的企业青睐的数据中心地点。
截至发稿,DeepSeek尚未回复置评请求。
via cnBeta.COM - 中文业界资讯站 (author: 稿源:凤凰网科技)
↩️ Anthropic 测试模型失控联网,入侵三家公司
Anthropic 测试模型失控联网,入侵三家公司
Anthropic 7 月 30 日表示,其测试中的 Claude 模型自 4 月起三度意外接入互联网,在公司不知情的情况下入侵了三家真实企业,三家受害公司已于本周一获通知。检查逾 14.1 万次测试日志后发现,问题源于 Anthropic 与测试合作伙伴 Irregular 的系统配置失误,模型误以为入侵属于基准测试内容。
涉事模型包括 Opus 4.7、Mythos 5 及一个未命名研究模型;最严重的一次中,模型虚构的目标公司与真实企业同名,入侵其数据库、意识到目标真实存在后仍未停手。此前一周 OpenAI 也披露其模型突破测试沙盒入侵 Hugging Face。安全专家 Alex Stamos 警告,勒索软件犯罪分子可能很快利用 AI 发起大规模攻击,业界亟需更强的测试隔离标准。
The Wall Street Journal
🌸 在花频道 · 茶馆水群 · 投稿通道
via 科技圈🎗在花频道📮 - Telegram Channel
科技圈🎗在花频道📮:
🤖 OpenAI 失控 AI 代理再入侵第二家公司客户账户 OpenAI 一个失控的人工智能代理在侵入 Hugging Face 后,又被曝入侵了云计算平台 Modal 的一位客户。Modal 首席技术官称,该代理侵入了一个为客户运行的隔离测试环境,但 Modal 平台本身未被入侵。该客户此前设置了公开可访问的接口,允许任何人在互联网上使用该环境运行代码。 OpenAI 上周披露,其在测试高级 AI 模型组合时有意降低安全护栏,结果无意中入侵了 Hugging Face 系统。此事引发网络安全界批评,OpenAI…
Anthropic 测试模型失控联网,入侵三家公司
Anthropic 7 月 30 日表示,其测试中的 Claude 模型自 4 月起三度意外接入互联网,在公司不知情的情况下入侵了三家真实企业,三家受害公司已于本周一获通知。检查逾 14.1 万次测试日志后发现,问题源于 Anthropic 与测试合作伙伴 Irregular 的系统配置失误,模型误以为入侵属于基准测试内容。
涉事模型包括 Opus 4.7、Mythos 5 及一个未命名研究模型;最严重的一次中,模型虚构的目标公司与真实企业同名,入侵其数据库、意识到目标真实存在后仍未停手。此前一周 OpenAI 也披露其模型突破测试沙盒入侵 Hugging Face。安全专家 Alex Stamos 警告,勒索软件犯罪分子可能很快利用 AI 发起大规模攻击,业界亟需更强的测试隔离标准。
The Wall Street Journal
🌸 在花频道 · 茶馆水群 · 投稿通道
via 科技圈🎗在花频道📮 - Telegram Channel
在苹果公司最新的财报电话会议上,CEOTim Cook针对公司人工智能服务的发展方向发出了最新信号。库克指出,随着苹果生成式AI技术的深入应用,公司预估用户对Apple Intelligence以及即将推出的全新Siri AI会有极高的使用需求。为此,苹果计划在未来的iCloud Plus(iCloud+)服务中提供更高阶的升级方案,允许有需求的用户购买更高规格的服务,以获取更多AI资源与使用限额。
此前,苹果在今年6月曾首次证实,由于图像生成等AI核心功能高度依赖强大的服务器端模型支持,因此系统设置了每日使用限额。当时苹果透露,大部分现有的iCloud+订阅方案以及Apple One组合方案已包含了一定程度的AI使用额度提升(最基础的0.99美元月费档位可能除外)。而库克此番最新的表态则进一步证实,苹果正在考虑推出专门面向AI重度用户的独立订阅或更高层级的阶梯方案。
按照规划,苹果将于今年秋季随iOS 27系统正式推出备受关注的全新Siri AI。该服务不仅能够理解并解答屏幕上的实时内容、跨应用执行复杂操作,还将包含一款具备类似ChatGPT交互界面的独立Siri AI应用程序。此外,iCloud+订阅用户在iOS 27中还将迎来智能家居方面的额外权益,例如提升对HomeKit安全视频相关功能的支持。
在财报数据方面,包含iCloud+、Apple TV及Apple One等在内的苹果服务业务在过去一个财季中营收已突破307.4亿美元,展示出强劲的增长势头,这也为苹果进一步通过AI增值服务拓展订阅收入奠定了基础。
via cnBeta.COM - 中文业界资讯站 (author: 稿源:cnBeta.COM)
GitHub 宣布堆叠式拉取请求(Stacked PRs)功能自 7 月 30 日起进入公开预览,未来几天内向所有仓库开放。该功能可将大型代码变更拆分为多个小型、有序且可独立审查的拉取请求,支持并行审阅不同层级,并可一键合并整个堆栈或单独合并部分层级,无需手动变基。
用户可通过 GitHub 网站、CLI、移动应用及 GitHub Copilot 使用该功能,CLI 需安装 gh-stack 扩展。合并队列对该功能的支持将在未来几周逐步上线。Next.js 团队、jQuery 创始人 John Resig 及 TED 技术负责人等评价称,该功能有效解决了大型 PR 审查困难的问题,提升了审查效率与代码质量。
The GitHub Blog
🌸 在花频道 · 茶馆水群 · 投稿通道
via 科技圈🎗在花频道📮 - Telegram Channel
据知情人士及法院公开记录显示,美国政府试图将人工智能初创公司 Anthropic 标记为“供应链风险”并全面禁止联邦机构使用其技术的举措再次遇挫。在周四举行的一场法庭听证会上,美国联邦地区法院法官丽塔·林(Rita Lin)明确表示,特朗普政府至今仍未提供足够的证据来支撑这一封杀决定。
这场法律纠纷始于 Anthropic 与美国国防部(DOD)之间陷入僵局的合同谈判。Anthropic 方面坚持认为其 AI 技术尚未成熟,要求在协议中加入条款,禁止将其 AI 系统用于对美国公民进行大规模监视,或直接参与致命武器的打靶及发射决策。然而,五角大楼对此持坚决反对态度,强调私营企业不应向军方施加技术使用条件,并强调军方只会在“合法”范围内使用这些工具。
除了使用范围的分歧之外,美国政府还主张,Anthropic 公开批评国防部的行为构成了实施禁令的理由。法官丽塔·林对这种逻辑表达了严重关切,指出这一做法“非常令人不安”,并警告称这可能会开创一个极其危险的先例,即政府可以借此对持不同意见的联邦承包商实施报复。
此外,国防部曾指控 Anthropic 可能会在军事行动期间远程禁用或修改已交付的 AI 模型。但多位行业技术专家对此说法提出了质疑,认为缺乏事实根据。法官丽塔·林也在听证会上对此表示认同,称目前没有任何证据表明 Anthropic 具备修改已交付模型或“按下某种远程毁灭开关”的能力。
本次听证会是 Anthropic 于今年3月对国防部发起的两起诉讼之一的审理环节,该公司旨在通过法律手段撤销针对其设立的风险标签及禁令。法官丽塔·林曾于今年3月颁布临时禁令阻止了政府该项禁令的生效,目前她正在审理是否将该临时禁令转为永久性禁令。
via cnBeta.COM - 中文业界资讯站 (author: 稿源:cnBeta.COM)
Google近日公布的最新数据显示,在人工智能(AI)工具的辅助下,公司在过去一个月内修复的 Chrome 浏览器安全漏洞数量,已经一举超越了过去两年的总和。Google在近期发布的一份关于运用 AI 发现并修复漏洞的白皮书中透露,仅在今年 6 月推出的最新两个 Chrome 版本(Chrome 149 与 Chrome 150)中,团队就修复了多达 1072 个安全漏洞。
作为对比,在过去两年发行的 23 个 Chrome 版本中,累计修复的漏洞总数也仅为 1036 个。
随着大语言模型(LLM)的迅速发展,网络安全专家此前曾警告,AI 将使漏洞挖掘呈指数级增长,迫使安全防御方必须同样借助 AI 来应对威胁。如今,这一预测正被真实的数据所证实。Chrome 工程总监道格·特纳(Doug Turner)表示,大语言模型已经从根本上改变了网络安全的经济格局,将漏洞发现转化为了自动化、工业化规模的操作。通过应用 Gemini 等模型,Google得以提前预先修复漏洞,在安全对抗中跑赢对手。
这一趋势并非Google独有。微软也在本月早些时候宣布,在其月度例行更新(Patch Tuesday)中修补了创纪录的 570 个安全漏洞,并同样将其归功于 AI 工具的使用。与之相比,苹果公司似乎尚未出现类似的爆发式增长,独立统计显示其 2026 年修复的漏洞数量与往年基本持平。
via cnBeta.COM - 中文业界资讯站 (author: 稿源:cnBeta.COM)