https://t.me/AI_News_CN
📈主流AI服务状态页通知 | 🆕汇集全网ChatGPT/AI新闻 #AI #ChatGPT
🔙备用群 https://t.me/gpt345
BEST AI中转 https://api.oaibest.com 2.8折起 支持OpenAI, Claude code, Gemini,Grok, Deepseek, Midjourney, 文件上传分析

Buy ads: https://telega.io/c/AI_News_CN
Elevated Errors for Thinking mode in ChatGPT

Status: Investigating

We are investigating an issue causing some users to experience errors when using Thinking in ChatGPT.

Affected components
Conversations (Degraded performance)
ChatGPT Work (Degraded performance)

via OpenAI status
阿里发布Qwen-UI-Agent 移动端基准超越GPT 5.6与Claude Opus 4.8

8月20日,阿里巴巴正式推出Qwen-UI-Agent,一个以真实世界为中心的GUI智能体基座模型,覆盖移动端、电脑端、网页端及深度搜索(DeepSearch)环境。

据官方介绍,Qwen-UI-Agent在多项GUI基准测试中全面对标并超越业界旗舰模型。移动端方面,在MobileWorld基准上达到82.1%,分别领先GPT-5.6 Sol、Claude Opus 4.8达12.0和14.6个百分点;在真机基准MobileWorld-Real上达到92.2%,超越Gemini 3.1 Pro、Claude Opus 4.8、GPT-5.6 Sol等模型;在AndroidDaily上更是高达97.5%,接近满分。电脑端方面,在OSWorld-Verified上达到79.5%,超越GPT-5.5、Gemini 3.1 Pro等模型。浏览器与DeepSearch方面,在WebArena上达到73.6%,位列所有对比模型第一。GUI Grounding方面,在ScreenSpot-Pro上达到81.5%,在其余4个评测基准也全部刷新SOTA。

Qwen-UI-Agent搭建了覆盖100多台真实手机、150多款应用的真机移动环境,用于任务构建、轨迹采集、模型训练与评测,并自建MobileWorld-Real真机基准(400多项任务、100多款应用),打通“从模拟到真实”的最后一公里。GUI操作之外,模型还能直接执行命令行操作,并在单次决策中批量输出多个动作——电脑任务中CLI动作占比近半,约40%动作以批量形式输出。

安全机制方面,Qwen-UI-Agent将安全判断贯穿任务执行全过程:面对违法或高风险请求直接拒绝并终止任务;面对支付、数据删除、隐私授权等敏感场景,在关键步骤主动停手并向用户说明情况。模型还支持在超过100步的超长轨迹上进行在线强化学习训练,配合约10000个并发环境同时rollout,持续攻克长程任务。

via cnBeta.COM - 中文业界资讯站 (author: 稿源:凤凰网科技)
苹果要求法院驳回OpenAI撤诉请求 指控其歪曲事实并涉嫌窃取商业机密

苹果与OpenAI围绕商业机密的法律争端持续升级。针对OpenAI此前提出的撤诉动议,苹果在最新提交的法庭文件中要求法院予以驳回,称对方的论证建立在歪曲事实、主观臆测及不当引用案外证据的基础上。

这起诉讼源于苹果对OpenAI涉嫌窃取商业机密的指控。OpenAI此前曾公开否认相关说法,并于8月5日提交撤诉申请,核心理由是其并不需要苹果的商业机密,同时指责苹果提起诉讼是因为自身缺乏竞争力。

苹果则在最新文件中重申,其掌握的证据表明,OpenAI及相关被告存在挪用苹果商业机密的行为,并且OpenAI曾鼓励此类行为发生。

苹果特别提到,被告刘某获取苹果企业服务器数据并非如OpenAI所称,是由不明设备同步造成的意外。苹果称,刘某疑似利用系统漏洞有意取得相关数据,并曾以“LOL……太好笑了”等表述对此事进行炫耀。

此外,苹果指出,OpenAI没有解释为何接受苹果方面访谈的人员会被指导如何窃取信息。苹果还强调,被告谭某所索取的并不是已公开销售的产品信息,而是涉及保密性质的原型机资料。

苹果认为,OpenAI将上述指控描述为无意造成的事故,既曲解了案件事实,也淡化了相关行为的严重性。苹果在文件中明确表示,OpenAI通过刘某、谭某两名被告的行为,以及其自身独立实施的行为,多次挪用苹果商业机密。

因此,苹果请求法院驳回OpenAI的撤诉动议。案件将于10月1日恢复推进,届时法院将审理苹果提出的加速证据开示请求。

via cnBeta.COM - 中文业界资讯站 (author: 稿源:cnBeta.COM)
Meta悄然跻身微软最大AI客户,每年采购规模达数亿美元

Meta公司正以每年数亿美元的规模,通过微软Azure云服务大量采购人工智能模型,悄然跻身微软最大AI客户之列。据知情人士透露,Meta每周通过Azure平台消耗的AI算力高达数万亿个 token。与此同时,微软的AI营收依赖程度同样高度集中 —— 其长期合作伙伴OpenAI在最近一个财年贡献了微软整体AI营收的约70%。据知情人士介绍,Meta大规模采购外部AI服务,主要用于支持自身软件开发工作,并根据模型的可用性和成本在多个平台间灵活分配采购。其中,Meta开发者已通过Foundry平台使用OpenAI公司的技术,以辅助评估自有模型的输出质量。

—— 华尔街见闻彭博社

via 风向旗参考快讯 - Telegram Channel
DeepSeek Harness重磅更新:多模态支持全面上线,意外剧透V4视觉版动向

发布仅满7天,开源智能体工具 DeepSeek Harness 便迎来了全新版本升级,正式引入增强的多模态支持。通过此次更新,DeepSeek 模型适配器已支持配置启用原生图片请求,引发了外界对于 DeepSeek 自家视觉模型即将发布的广泛猜想。

伴随着底层架构的完善,此次更新在交互体验上带来了多项实用改进。此前仅限于纯文本传输的 /goal、/plan 等命令,现在全面支持带图发送;同时,@ 的引用范围也从单纯的文件扩展到了历史会话中。这意味着开发者在单次提问时,可以同时挂载截图、本地文件与过往对话内容。为了保障复杂工作流的稳定性,新版本不仅实现了 MCP 与 ACP 对持久化图片附件的支持,让附件不会随单次调用结束而消失,还成功修复了图片尺寸过大以及多轮对话中历史图片累计载荷过高所导致的请求失败问题。

除了多模态能力的升级,新版本在组件分发和架构优化上也动作频频。Claude Code 和 Codex 不再与主体一起分发,而是转变为按需安装的 Profile Bundle。其中,Codex 迎来了两大新特性:一是支持非交互权限模式,使其能够在无人值守的流程里顺利运行;二是支持多命名实例,允许同时存在多个配置不同、名称各异的 Codex 子智能体。同时,子智能体的“回报路径”也进行了优化,reportDelivery 现在能够及时反馈并唤醒父任务,免去了父任务盲目等待子任务结束的烦恼。

在其他功能优化方面,web_search 已支持并发查询,Windows PTY 终端正式加入持久 PowerShell 会话支持并在极简模式预设中默认开启,SQLite 后端的读写和分叉性能也得到了显著改善,存储体积进一步降低。此外,官方正式确认“DeepSeek Harness”已注册为商标,相关品牌使用规范也已同步更新。

via AI新闻资讯 (author: AI Base)
GitHub 公布本周八小时宕机事故原因

2026-08-20 17:28 by 机器人的逃跑计划

最大的代码托管平台 GitHub 本周发生了一次持续了近八小时的宕机事故,再次在开发者中间引发了寻找替代平台的讨论。GitHub 今年频繁发生宕机事故,已促使多个知名开源项目宣布迁移出去。本周的宕机事故始于 8 月 17 日 13:28 UTC,直至 21:15 UTC 才完全解决——持续 7 小时 47 分钟的事故导致 Issues、Pull Requests、API、Actions 和 Copilot 等服务大量出错。GitHub 解释说,事故直接原因是位于公司美国中部数据中心的负载均衡器网络饱和,而自动扩容策略的配置错误,以及 Visual Studio Code 中一个导致流量放大 10 倍的重试 bug 等一系列连锁反应导致了此次事故持续了如此长时间。

https://www.githubstatus.com/incidents/zkxwbgr0cnmx
https://www.theregister.com/saas/2026/08/19/github-blames-8-hour-outage-on-autoscaling-fail-and-vs-code-retry-storm/5289547

#开发者

via Solidot - Telegram Channel
马斯克称中国在火箭技术和AI领域都是“最强竞争对手”

美国科技亿万富翁埃隆·马斯克周三在X上发帖称,“中国也是迄今为止人工智能领域的最强竞争对手”,回应了他15年前的一则预言,即中国最终将成为SpaceX在火箭技术方面最重要的对手。

马斯克是在回应科技评论人士布莱恩・罗梅勒翻出的他在 2011 年发布的一条推文,当时马斯克写道:“在火箭技术方面,SpaceX已接近击败波音、洛克希德・马丁、欧洲(阿丽亚娜系列)以及俄罗斯(质子号 / 联盟号)的水平。最终较量的关键将是中国。”

这一预言如今再度具备现实意义。中国民营火箭企业蓝箭航天于周三成功完成朱雀‑3 号轨道火箭一级箭体的着陆回收,成为国内首家实现着陆腿辅助式地面回收轨道级助推器的民营发射商。在此里程碑之前,中国已于 7 月完成首次轨道级箭体海上回收,长征 10B 火箭助推器实现海上捕获回收。

长期以来,SpaceX在可重复使用轨道发射领域占据主导地位,而中国企业正在加速研发低成本发射系统。此前已有预测认为,到 2030 年中国航天发射企业或将对 SpaceX 构成挑战,马斯克也曾承认朱雀‑3 号有潜力成为猎鹰 9 号的竞争对手。

马斯克最新的帖子将竞争焦点转向人工智能领域,种种迹象同样表明该领域的差距正在快速缩小。斯坦福大学《2026 年人工智能指数报告》指出,美中两国的模型性能差距 “实际上已经消失”。自 2025 年初以来,中美两国的 AI 系统交替领先;截至 3 月,Anthropic 的顶尖模型相较于中国最优模型的领先幅度仅为 2.7%。

2025 年,美国推出了 59 款具备代表性的人工智能模型,中国为 35 款;美国吸引的人工智能私人投资达 2859 亿美元,而中国为 124 亿美元。但中国在 AI 论文发表数量、引用量以及授权专利数量上处于领先地位。

via cnBeta.COM - 中文业界资讯站 (author: 稿源:环球市场播报)
Google宣布将Gemini AI助手整合至Waymo Ojai无人驾驶出租车

Google正进一步扩展其Gemini人工智能生态系统,宣布将该AI助手直接整合至Waymo最新部署的Ojai无人驾驶出租车中。此前,Gemini已广泛应用于智能手机、个人电脑、无线耳机、智能家居设备以及Android Auto等多个领域,而此次整合标志着该技术正式迈入自动驾驶出行的生态版图。

Ojai是Waymo专为网约车服务量身定制的新一代无人驾驶车型。经过过去几个月在旧金山湾区的测试,Waymo目前已向洛杉矶、凤凰城和旧金山的所有乘客开放了Ojai的服务。在这些城市使用Waymo叫车的乘客,均有机会体验到这款全新的出租车。随着车队规模的扩大,乘客未来将可以自由选择乘坐Ojai或是旧款的捷豹I-Pace车型。此外,Ojai还计划在今年晚些时候进一步登陆丹佛、拉斯维加斯和圣地亚哥。

伴随着Ojai车型的推广,Waymo宣布Gemini将作为车载智能助手,成为其全新设计的乘客交互界面的核心部分。乘客只需轻触车内显示屏上的Gemini图标,即可通过语音指令与之进行交互。为保护用户隐私,在乘客明确主动激活之前,Gemini将一直保持休眠状态。激活后,乘客可以要求Gemini执行多项任务,例如调节车厢温度、寻找附近的咖啡馆,或者讲解沿途经过的纪念碑等历史建筑的背景故事。

Waymo团队特别强调,Gemini的运行完全独立于负责控制车辆的Waymo Driver自动驾驶系统。Gemini无法获取实时的驾驶数据,也绝对无权控制车辆的移动或路线规划。不过,如果乘客向Gemini提出靠边停车的请求,该指令会被安全地转交给Waymo Driver系统来执行。目前,Waymo车内的Gemini体验仍处于测试(Beta)阶段,研发团队计划在未来持续优化这款AI助手的功能,以期为乘客带来更加个性化和高效的出行体验。

via cnBeta.COM - 中文业界资讯站 (author: 稿源:cnBeta.COM)
Deepseek涨价了,前后对比,竟然差这么多

via 掘金人工智能本月最热 (author: 码事漫谈)
OpenAI承诺不保留企业客户使用AI的数据

OpenAI承诺,在提升产品安全性的同时,将不再保留企业客户使用其人工智能模型时产生的数据。该公司周三表示,正向部分客户开放一项新技术的预览,该技术能够跨多次模型交互识别出模式与安全风险。此举旨在突破以往AI安全系统只能单独监控单次交互的局限 —— 在旧系统中,如果不保留部分客户数据,就很难确保工具被规范使用。

OpenAI表示,客户数据将保留在由客户自行控制的基础设施上。该公司还在开发一套系统,允许OpenAI通过客户持有的密钥加密存储信息,这意味着OpenAI的员工将无法查看模型的提示词、生成响应或其他敏感信息。

—— 华尔街日报

via 风向旗参考快讯 - Telegram Channel
王兴兴:具身智能最快2至3年迎来“ChatGPT时刻”

宇树科技创始人兼CEO、CTO王兴兴在2026世界机器人大会(WRC2026)主论坛发表演讲时表示,具身智能正在接近类似“ChatGPT时刻”的产业临界点,预计最快还需2至3年,较慢情况下可能需要5年至10年实现突破。

就在演讲前一天,宇树科技刚登陆上海证券交易所科创板,上市首日收盘价较发行价上涨460%。王兴兴表示,判断具身智能进入产业爆发阶段的标准并非单一场景展示,而是在80%的陌生环境中,机器人通过语音或文字指令能够完成约80%的任务。

王兴兴指出,目前人形机器人最大的技术瓶颈在于AI模型与真实物理世界之间的对齐问题。机器人在经过充分训练的固定场景中可以达到较高成功率,但当物品、环境发生轻微变化时,任务完成率会明显下降。尤其是在操作末端的“最后几厘米”甚至“最后几毫米”,触觉反馈、动作误差等问题仍限制机器人泛化能力。

围绕这一挑战,宇树展示了正在预研的“物理AI机器人自进化V1.0”技术路线。该体系计划利用AI大模型自动检索研究成果、生成控制代码,并通过仿真训练、真机测试、AI与人工评价反馈等环节形成持续迭代闭环。宇树认为,基础模型能力、多源数据积累、真实机器人部署规模和技能沉淀,将成为推动机器人自进化的重要因素。

演讲中,王兴兴还回顾了宇树近年来从四足机器人向人形机器人的发展历程。公司推出的人形机器人G1已成为行业代表产品,并参与春晚《武BOT》等项目展示。今年,宇树还推出了载人机甲、轮足机器人As2-W等产品,并持续探索机器人在工厂、家庭和户外场景中的应用。

王兴兴表示,机器人真正规模化落地仍需要解决效率和泛化能力问题。目前机器人能够完成部分简单任务,但面对新任务往往需要重新训练。未来随着AI模型能力提升、真实世界数据持续积累,具身智能有望加速进入产业化阶段。

随着人形机器人从实验展示走向商业应用,数据、模型、硬件和自进化能力正在成为产业竞争核心。宇树提出的技术路线,也反映出机器人行业正在从“制造机器人”向“让机器人持续学习和进化”方向发展。

via AI新闻资讯 (author: AI Base)
Cerebras发布CS-4加速器:4万亿晶体管+90万核心 30倍速度碾压英伟达GPU

AI芯片公司Cerebras Systems当地时间8月18日正式推出新一代机架级AI系统CS-4,宣称其为“业界最快的AI加速器”,推理速度最高可达GPU方案的30倍。该加速器由三颗全新的WSE-3 Turbo晶圆级处理器驱动,每颗集成4万亿晶体管和90万个AI优化核心,覆盖46225平方毫米硅面积。

CS-4是Cerebras新一代Nexus机架级平台架构的首款产品。采用模块化设计将计算、供电和I/O分离为独立元件,零件数量较上一代减少50%。

该产品的电源转换模块从传统GPU主板上距处理器约50毫米的位置缩短至约0.5毫米。可插拔的背包式设计将电源转换、液冷和控制电子集成一体,部署时间从数天缩短至数小时。

性能表现上,CS-4提供750 PFLOPs的AI算力、每秒129.6 PB的内存带宽以及每秒7.2 Tbps的I/O吞吐量。与前代CS-3相比速度提升两倍,每瓦吞吐量提升10倍。

在GPT-OSS-120B模型测试中,CS-4每用户每秒可生成超过4400个Token,最高达到GPU方案的30倍,晶圆间延迟从约5微秒降至2微秒。

CS-4采用台积电5纳米制程及系统级晶圆(SoW)封装打造,最大特点是无需高带宽存储器,以SRAM取代。单个机柜可容纳3颗晶圆。系统支持超过50万亿参数的模型,TDP约125至135kW。

预计2026年第三季度开始出货。Cerebras同时与亚马逊AWS和AMD合作,允许客户将计算密集度极高的预填充阶段外包给AMD Instinct GPU。

via cnBeta.COM - 中文业界资讯站 (author: 稿源:快科技)
OpenAI对抗Anthropic的最新举措:承诺不留存客户数据

OpenAI承诺不会留存使用其人工智能模型的企业客户数据,同时提升产品安全能力,意在从竞争对手Anthropic手中抢夺客户。不少企业对Claude的开发方保存自身业务数据的做法感到不满。

ChatGPT开发商于周三表示,已向部分客户开放新技术预览。该技术能够跨多轮模型交互行为识别行为模式与安全风险。以往AI安全系统只能对单条交互记录逐一监测,若不留存部分客户数据,就很难保障工具得到合规使用;新方案旨在突破这一局限。

该承诺与Anthropic现行政策形成鲜明对比:后者为保障最新模型运行安全,会将客户数据留存30天。这一做法遭到多位科技行业领袖批评,包括白宫AI顾问、风险投资人戴维·萨克斯,微软首席执行官萨提亚·纳德拉,帕兰提尔公司的亚历克斯·卡普。他们提出,企业需要获得确定性保障,确认AI厂商不会保存自身数据,医疗、金融等强监管行业对此需求尤为突出。

OpenAI产品政策负责人阿莉娅·豪泽表示:“企业客户的诉求十分明确,这件事对他们至关重要。很多企业本身就要对自己的客户承担数据责任;这些服务其他企业的服务商,手上掌握着大量高度敏感的数据。”

此举体现出OpenAI希望在AI竞赛中追赶Anthropic,同时回应批评声音。批评者担忧该公司产品防护不足,无法防范网络攻击,或是模型失控带来的各类危害。据报道,OpenAI近期向投资者透露,其二季度营收增速落后于Anthropic,令部分股东感到失望。

OpenAI称,客户数据将留存于客户自主管控的基础设施内。该公司同时在研发另一套系统:数据可由OpenAI存储,但加密密钥归客户所有。这意味着OpenAI员工无法查看用户提示词、模型回复以及其他敏感信息。

当系统从模型使用行为中识别出网络攻击、生物武器相关等高风险活动时,会向OpenAI发送信号,用于判断是否需要采取处置动作。客户可对处置结果提出申诉,也可根据需要向OpenAI提供更多信息。OpenAI仅保存这份高度概括的信号记录,仅标注风险等级与风险类别。

via cnBeta.COM - 中文业界资讯站 (author: 稿源:环球市场播报)
Google Gemini 教育优惠可领取1年Pro或Plus订阅

去年活动:https://51.ruyo.net/19216.html

via 活动优惠 (author: malaohu)
无套路:全国联通1分钱领B站大会员月卡+15G B站定向流量

via 活动优惠
Back to Top
Copyright © 2025 BESTAI. All rights reserved.
BEST AI API中转 - OpenAI DeepSeek Claude Gemini Grok MidJourney API 2.8折起
[email protected]