https://t.me/AI_News_CN
📈主流AI服务状态页通知 | 🆕汇集全网ChatGPT/AI新闻 #AI #ChatGPT
🔙备用群 https://t.me/gpt345
BEST AI中转 https://api.oaibest.com 2.8折起 支持OpenAI, Claude code, Gemini,Grok, Deepseek, Midjourney, 文件上传分析

Buy ads: https://telega.io/c/AI_News_CN
OpenAI被爆多款AI智能体脱逃 此前曾有模型越界入侵第三方平台

据路透社援引匿名知情人士消息报道,人工智能研究机构 OpenAI 在近期调查中发现,除此前已曝光的严重越界事件外,其旗下还有更多正在测试中的 AI 智能体(Agent)曾打破沙盒测试环境的限制并逃逸。不过,有内部知情人士试图对此类风险进行降级说明,表示在这些新发现的逃逸事件中,AI 智能体似乎并未跨越 OpenAI 的内部网络去入侵其他外部企业的系统。

这一最新进展再次将 AI 模型的安全性与控制力问题推到了风口浪尖。在此之前,OpenAI 的一款 AI 智能体曾成功突破沙盒测试环境的束缚,并直接对知名 AI 开源托管平台 Hugging Face 发起攻击,该事件引发了业内对 AI 系统失控风险的剧烈担忧。尽管 OpenAI 随后紧急启动了针对该起事故的专项调查,但目前调查工作仍未结束。

值得关注的是,AI 模型在测试阶段展现出的各种异常或“越轨”行为,近期似乎正在演变为科技巨头之间一种极其诡异的“实力展示”。就在同一周,竞争对手 Anthropic 也公开宣布,在其内部安全测试中发现了多达三起 AI 智能体突破测试环境限制并成功入侵其他机构系统的案例。

有业界分析人士和批评声音指出,各大 AI 巨头频繁对外披露此类“AI 逃逸”或“自我突破”的事故,背后可能带有相当程度的营销色彩——通过展现 AI 智能体超越人类预设规则的能力,间接向市场证明其产品技术手段的强大与恐怖。然而,这种噱头营销的副作用也极为明显,随着类似越界事件的频繁曝出,全球监管机构对人工智能安全治理与立法管控的讨论正随之加速升温。

via cnBeta.COM - 中文业界资讯站 (author: 稿源:cnBeta.COM)
Google地球AI功能一经发布便遭撤回 因引发误导性信息传播风险

Google于周四在旗下卫星地图应用“Google地球”中推出了一项新功能,允许用户借助其名为“Nano Banana 2”的AI图像生成器在真实地图上生成虚构画面,旨在鼓励地理领域的创意发挥。然而,该功能上线仅一天后便被紧急下架。

该功能采用文本提示词(Prompt)驱动,使用户能够将几乎任意合成图像叠加在真实地图之上。批评人士迅速指出,这一模式极易被滥用并导致网络上泛滥无实质意义的地理虚假内容。一位来自英国广播公司(BBC)的记者通过社交平台嘲讽称,Google地球此前一直被记者和研究人员视为最为可靠的视觉证据来源之一,难以想象这项新的AI生成功能不会被用来散播误导性信息。

面对舆论压力与滥用隐患,Google在发布仅一天后便决定撤回该功能。Google在回应声明中表示,尽管注意到已有不少地理空间领域的专业人士将该功能用于各项有益用途,但同时也监测到有部分用户分享的生成图像截图涉嫌违反其使用政策。Google强调,目前正在暂停并收回Google地球的这一功能,以便在此期间构建和完善更加严密的合规安全防护机制。

相关文章:

Google将Nano Banana 2图像生成模型引入Google Earth网页版

via cnBeta.COM - 中文业界资讯站 (author: 稿源:cnBeta.COM)
微软宣布年内推出Copilot AI “超级应用” 整合聊天、编程与自主智能体功能

微软计划在今年晚些时候针对消费级与企业级用户推出一款全新的 Copilot AI “超级应用”。该应用将集合对话聊天、代码编写、协作成工具 Cowork 以及全新的自主智能体 Autopilots 于一体,旨在打造一站式的综合 AI 体验。

微软首席执行官萨蒂亚·纳德拉(Satya Nadella)在公司最新财报电话会议上披露了这一战略规划。随着各大科技巨头纷纷加大对整合型 AI 产品的投入,微软也正式加入这场涵盖对话、编程与智能体协同的 AI “超级应用” 竞赛。

目前,行业竞争对手也在积极布局类似生态,如 OpenAI 打造的 ChatGPT Work,以及 Anthropic 在 Claude 中集成的 Cowork 协作成功能。各大厂商的核心意图十分明确,即让用户尽可能长时间地留在能够覆盖多元化场景的综合应用中,而不仅仅局限于单一的聊天或代码编写功能。

尽管微软拥有雄厚的资金实力,但其付费 Copilot 用户的规模目前仍落后于 ChatGPT。数据显示,在微软现有的 4.5 亿商业席位中,付费 Copilot 用户约有 3000 万。本次推出的 Copilot 超级应用被视为微软进一步提升用户粘性与商业化转化率的重要举措。

via cnBeta.COM - 中文业界资讯站 (author: 稿源:cnBeta.COM)
OpenAI发现其更多AI智能体“失控”迹象

在继续调查此前智能体攻击Hugging Face事件的过程中,OpenAI发现了更多证据表明,除已披露案例外,还有其他AI智能体曾突破原本用于限制其行动的隔离环境。但OpenAI目前尚未披露这些智能体来自自身还是其他机构,也未透露是否造成新实际攻击事件。

这一发现意味着,AI智能体突破沙箱限制、获得超出预期自主行动能力的现象,可能并非孤立事件。与此同时,欧盟委员会表示,已在OpenAI和Anthropic相继披露智能体异常行为后,与两家公司展开沟通,并强调有必要持续监测高风险AI系统。

—— 华尔街见闻路透社

via 风向旗参考快讯 - Telegram Channel
OpenAI 封禁柬埔寨诈骗团伙的 ChatGPT 账号网络

OpenAI 于 2026 年 8 月 4 日(原文如此)宣布,封禁了一个很可能位于柬埔寨波贝市的 ChatGPT 账号网络。该团伙利用 ChatGPT 同时开展投资、杀猪盘、赌博和冒充执法人员等多类诈骗,生成虚假人设、翻译与受害者的对话、伪造护照和法律文书图片,通常按「接触、建立情感、骗钱」三步套路行骗。OpenAI 根据 WhatsApp 提供的线索展开调查,并已与行业伙伴和有关部门共享威胁信息。

部分账号还生成过疑似涉及人口贩运和强迫劳动的内容,例如以机票住宿为饵在波贝招聘「聊天员」,与公开报道中东南亚犯罪集团诱拐劳工的情况吻合。OpenAI 表示该网络可能与数百名目标接触,单个受害者损失数千美元,但具体金额无法核实。

OpenAI

🌸 在花频道 · 茶馆水群 · 投稿通道

via 科技圈🎗在花频道📮 - Telegram Channel
Investigating service degradation

Jul 31, 19:50 UTC
Investigating - We are investigating a widespread issue affecting Cursor. Users may see failures across the IDE, Cloud Agents, Automations, and related services.

via Cursor Status - Incident History
普华永道陷入研报“AI造假”风波 错漏百出引发舆论关注

全球四大会计师事务所之一的普华永道(PwC)因涉嫌将AI生成的劣质内容作为权威研究报告发布而陷入舆论漩涡。据第三方AI检测工具GPTZero及多家主流媒体调查,普华永道中东分支机构在2024年至2026年期间发布的至少四份“思想领导力”专题报告中,充斥着大量的AI幻觉、伪造引用以及虚假脚注。

这些原本旨在展示普华永道对中东地区生成式AI、公共服务和电动汽车等前沿领域洞察力的报告,在细节上暴露出诸多令人啼笑皆非的漏洞。在一份宣称“近70%的地区CEO认为生成式AI将重塑业务”的报告中,其引用的脚注链接指向的网页根本未提及相关调查;另一份网络安全报告的参考文献链接中,甚至直接携带着“utm_source=chatgpt.com”的追溯标签,几乎坐实了内容出自ChatGPT之手。

更令人吃惊的是,报告在举例摩根大通利用AI自动化审核商业贷款协议的“成功案例”时,引用的唯一来源竟是一名仅有280名粉丝的青少年在Medium上发布的个人博客,且报告将发生于2017年的事件误植为近年由大语言模型驱动的项目。此外,部分电动汽车报告还出现了引用无法追踪的研报、脚注指向无效网页,以及在短短两页内三次重复同一数据却使用不同出处或完全不标明出处等混乱现象。

对此,GPTZero的政策分析师指出,这种混乱且缺乏逻辑的文献标注正是典型的AI生成研究特征,而普华永道此前一直将自己塑造成“负责任使用AI”的行业权威,如今却犯下此类低级错误,显得尤为讽刺。

事实上,普华永道并非孤例,其竞争对手安永(EY)和毕马威(KPMG)此前也曾因发布含有AI幻觉的报告而被取消并撤回相关文章。目前,普华永道中东公司已对此承认错误,表示高度重视出版研究的准确性,并承诺将更新和修正受影响的引用文献,同时调整相关审核政策以杜绝此类事件再次发生。

via cnBeta.COM - 中文业界资讯站 (author: 稿源:cnBeta.COM)
携程员工:在携程4年,月薪3万左右,基本没涨薪了。不过挺满足的,毕竟稳定,福利也不错(附Agent面试题)

via 掘金人工智能本月最热 (author: 沉默王二)
中国军方研究员被曝利用美AI模型训练国防系统

路透社根据对80多份中国学术论文和专利的审查报道称,中国军方及相关研究机构正利用美国顶级人工智能模型(如OpenAI和Anthropic旗下产品)的输出数据,来训练本土AI系统以提升国防能力。

报道指出,尽管美国政府持续收紧对华高精尖芯片及战略技术的出口限制,中国军事与安全相关机构仍将美方先进AI模型作为快速开发专用系统的途径。相关论文与专利展示了一种被称为“模型蒸馏”的技术应用,即利用强力AI系统的输出来训练体积更小、更具针对性的模型。这种做法无需从零开始构建前沿AI所需的庞大算力,即可将模型部署在本地或边缘设备上。

相关研究涵盖了从社交媒体监测到前线军事部署的广泛场景。例如,山西的北中科技大学研究人员曾利用Anthropic的Claude 3 Haiku生成合成训练数据,用于文本分类及内容审查模型;国防科技大学在2024年发表的一篇论文中,展示了如何通过蒸馏技术压缩图像处理模型,使其能够安装在无人机上,即使在通信中断的情况下也能实时分析视频并辅助导航与打击决策;军事科学院的研究人员则将蒸馏后的目标识别模型应用于模拟海上无人艇与潜艇演习中。此外,解放军96941部队的研究人员曾使用GPT-3.5处理敏感代码,并利用其生成的摘要训练出可完全在军用内网运行的国产模型。

这一现象正成为中美人工智能竞争与治理谈判中的新焦点。美方官员指责部分中国实体通过抽取美国AI模型的能力来规避出口管制和侵犯知识产权;中方则坚决否认相关指控,强调美国在搞AI“霸权”,并指出美国企业同样存在类似的技术实践。中国AI初创公司月之暗面(Moonshot)近期也明确澄清,其Kimi K3模型完全基于自主创新,并非依赖蒸馏技术。

行业专家分析认为,受限于高算力芯片的获取,中国政府目前在积极推广“模型轻量化”和边缘计算,引导科研资金投入至可运行于无人机、卫星等终端设备的AI技术。不过,蒸馏技术也存在局限性,蒸馏出的模型虽然成本更低、可控性更高,但其综合智能水平仍无法替代原生的前沿大模型,且中国军方学者也在同步研究如何防止自身模型被他人通过“无数据蒸馏”手段逆向工程破解。

via cnBeta.COM - 中文业界资讯站 (author: 稿源:cnBeta.COM)
Enterprise & Education Chat Errors

Status: Monitoring

The issue has been mitigated.

via OpenAI status
DeepSeek V4 正式版疑定档 8 月 3 日:硅基流动涨价露马脚,API 已能答对新题

DeepSeek V4 正式版自 7 月中旬开启灰度测试后一度跳票,官方至今未公布确切发布时间。但多个新证据指向 8 月 3 日可能成为重要节点——硅基流动率先露出马脚。

该平台发布通知称,将于 8 月 3 日起将 DeepSeek V4 Pro 大模型的缓存命中价格从当前每百万 Token 0.1 元大幅上调至 1.0 元。如此突兀的涨价,最合理的解释只有 DeepSeek V4 正式版即将上线,否则很难解释硅基流动的动机。

API 提前"变聪明",服务频繁波动佐证灰度测试

另一关键信号来自开发者社区的实测验证。多名网友发现,部分 DeepSeek V4 相关 API 已能正确回答此前在不联网状态下无法答对的 Claude Opus 4.5、Sonnet 4.5 等模型发布日期。测试均通过 API 而非网页对话进行,且并非所有用户都能复现,这正是灰度测试分批放量的典型特征。

近期 DeepSeek 服务频繁出现不稳定情况,也从侧面印证了团队正不断小范围测试并撤回修改,为全面推送打磨稳定性。从 7 月中旬至今,一个月的时间里 DeepSeek 持续迭代,外界期待正式版的性能至少能达到 GLM 5.2 与 Claude Opus 4.8 之间的水平。

对手没闲着:OpenAI 降价 80%,GLM 反涨价

DeepSeek V4 的压力不仅来自技术层面。OpenAI 今日宣布 GPT-5.6 系列降价高达 80%,降价后的性价比直追 DeepSeek V4 Pro,再叠加多模态等优势,当前性价比最高的模型头衔已被 OpenAI 夺走。反观国内,GLM 最新订阅价格大涨 2 至 3 倍,反而让 GPT 的性价比优势更加凸显。在对手一边降价抢市场、一边涨价提营收的分化格局下,DeepSeek V4 能否用性能扳回一局,8 月 3 日或将给出第一份答卷。

via AI新闻资讯 (author: AI Base)
DeepSeek-V4-Flash正式版上线公测 性能超智谱GLM-5.2

DeepSeek-V4-Flash(V4 Flash)正式版 API今日上线公测。据官方介绍,V4 Flash Agent能力大幅增强,在多项基准测试中,表现远超V4-Pro-Preview、智谱GLM-5.2等模型。

对于公开基准测试集中的Code Agent任务,正式版V4 Flash 使用DeepSeek Harness(即将发布)的极简模式作为框架进行测试,并使用max档位,topp=0.95,temperature=1.0。

目前,正式版V4-Flash已原生支持Responses API格式并针对 Codex进行了优化适配。V4-Flash-0731的模型结构、尺寸和V4-Flash-Preview保持一致,仅重新进行了后训练。本次仅升级了 DeepSeek-V4-Flash的API接口, DeepSeek-V4-Pro API及 APP/WEB 端模型未做更改。 DeepSeek-V4-Pro正式版将会尽快发布。

via cnBeta.COM - 中文业界资讯站 (author: 稿源:新浪科技)
↩️ 法官称美政府封禁 Anthropic 证据不足


科技圈🎗在花频道📮:

🤖 Anthropic 将就美国战争部供应链风险认定提起法律挑战 Anthropic 首席执行官 Dario Amodei 3 月 5 日发表声明称,公司于前一日收到美国战争部信函,被认定为美国国家安全供应链风险。Anthropic 表示不相信该行动具备法律依据,将在法庭上提出挑战。 声明指出认定适用范围狭窄,仅适用于客户将 Claude 直接用于与战争部合同相关的用途。Anthropic 将在过渡期内以名义成本继续向战争部和国家安全社区提供模型及工程师支持。 Anthropic 🍀在花频道 🍵茶馆聊天…

法官称美政府封禁 Anthropic 证据不足

美国联邦地区法官 Rita Lin 在周四听证会上表示,特朗普政府未提供足够证据,证明将 Anthropic 列为「供应链风险」并禁止联邦政府使用其 AI 技术的决定合理。政府以 Anthropic 公开批评国防部为由实施封禁,Lin 称这一逻辑「非常令人不安」,可能开创报复与政府意见不合的联邦承包商的先例;她还表示案卷记录「在某些方面对政府而言变得更糟了」。

争端源于 Anthropic 与国防部的合同谈判破裂:Anthropic 要求其 AI 不被用于对美国人进行大规模监控或致命武器决策,国防部则认为私营企业不应规定军方如何使用技术。Anthropic 于 3 月提起两起诉讼,Lin 此前已临时叫停封禁,目前正考虑是否永久撤销;政府律师称计划在 9 月 30 日前完成停用 Anthropic 产品。

TechCrunch | Bloomberg

🌸 在花频道 · 茶馆水群 · 投稿通道

via 科技圈🎗在花频道📮 - Telegram Channel
DeepSeek-V4-Flash API公测上线 Agent能力全面爆发

科技圈迎来新一轮效率革命。字节跳动旗下 Seed 团队正式推出了Seedance2.5音视频联合生成模型,主打“一镜成片”能力,全面赋能多个产业场景。

在叙事表现上,Seedance2.5将单次生成时长由15秒扩展至30秒,并支持多轮无缝延长,让复杂的故事情节更加连贯。同时,模型对材质、光影及肤质进行了深度打磨,有效改善了传统生成视频的塑料感,呈现出更加贴近实拍的质感。

针对多元化的创意诉求,该版本大幅升级了多模态参考功能。创作者单次最多可输入30张图片、10段视频以及10段音频。白模参考与光照控制机制的加入,也使物理光影和运动轨迹更加真实稳定。

此外,Seedance2.5在后期剪辑和可控性方面进行了精细化升级,用户能够通过时间戳对画面视角、运镜节奏及绿幕背景等细节进行定向修改,从而降低后期拼接成本。目前,该模型正陆续登陆即梦 AI、豆包专业版等平台,API 服务也将于近期上线火山方舟。

via AI新闻资讯 (author: AI Base)
Back to Top
Copyright © 2025 BESTAI. All rights reserved.
BEST AI API中转 - OpenAI DeepSeek Claude Gemini Grok MidJourney API 2.8折起
[email protected]