https://t.me/AI_News_CN
📈主流AI服务状态页通知 | 🆕汇集全网ChatGPT/AI新闻 #AI #ChatGPT
🔙备用群 https://t.me/gpt345
BEST AI中转 https://api.oaibest.com 2.8折起 支持OpenAI, Claude code, Gemini,Grok, Deepseek, Midjourney, 文件上传分析

Buy ads: https://telega.io/c/AI_News_CN
Grok Bot智能体首月周用户突破40万

SpaceXAI旗下Grok Bot AI智能体在推出约一个月后,周活跃用户数已突破40万,这一数字显示出市场对其产品的初步需求尚属温和。现场展示资料显示,截至9月14日,Grok Bot用户数达到41.8万人,较前一周增长24%。SpaceX的人工智能部门于8月中旬推出Grok Bot,旨在应对AI智能体市场不断增长的竞争,并追赶Anthropic和OpenAI。Grok Bot的设计目标是让其更像一名全天候工作的员工,而非聊天机器人。该产品可以处理电子邮件、更新销售数据库、处理发票、安排工作流程,或提交软件漏洞报告。

—— 新浪财经彭博社

via 风向旗参考快讯 - Telegram Channel
医疗 AI 走向全球普惠:Anthropic 携手 OpenEvidence,将临床决策支持工具免费覆盖百国

人工智能在医疗领域的应用正迎来重大的全球化突破。Anthropic 近期宣布与医学知识平台 OpenEvidence 达成战略合作,双方计划将基于人工智能的临床决策支持工具免费提供给美国和欧洲以外、医疗资源相对匮乏地区的医生,以此打破地理位置对循证医学知识获取的限制,帮助当地医务人员有效应对医学文献、专科医生以及继续医学教育资源不足的长期痛点。

作为一款面向临床医生的医学知识平台,OpenEvidence 能够依托经过同行评审的医学研究以及权威临床治疗指南,精准回答医生在诊疗过程中提出的各种问题。目前,该平台此前主要免费向美国和欧洲的临床医生开放。此次双方合作推出的专用版本,旨在精准赋能数十个中低收入国家的医疗工作者。

根据 OpenEvidence 公布的推广名单,该计划目前正在大约100个国家和地区逐步落地,其中包括乌干达、安哥拉、苏丹、海地和蒙古等。全球医疗体系长期面临着专科医护人员短缺的结构性挑战,而 AI 技术的加入能够帮助医生快速检索和整理海量医学信息。不过,行业专家也指出,若 AI 系统主要基于高收入国家的医疗数据进行训练,其建议未必能完全契合资源匮乏地区的实际情况(包括常见疾病、诊断条件与可用药物)。

针对这一挑战,双方在技术落地与本地化上进行了深度适配。Anthropic 主要负责提供底层的 AI 技术支持,而 OpenEvidence 则负责根据不同国家和地区的实际医疗环境对系统进行精细调整,确保同一个医学问题能够结合当地的医疗基础设施和临床实践进行动态回答。OpenEvidence 创始人 Daniel Nadler 表示,获取医学知识不应取决于医生所在的地理位置,公司针对这些地区开发的系统将高度重视“上下文适应”能力。

考虑到部分发展中地区的医疗机构可能无法保障全天候供电,该系统在设计之初便充分考量了基础设施的限制。绝大多数地区的医生依然能够通过智能手机等移动设备,随时随地访问过去只有世界顶尖医疗机构才能获取的高质量医学信息。这种模式不仅为缺乏订阅主流医学期刊渠道的地区带来了实质性改变,也展现了科技向善在填平全球医疗鸿沟方面的巨大潜力。

此次合作的达成,标志着 Anthropic 的 AI 模型正在从前沿的药物研发和生物学研究,正式大举进军临床医疗知识与医生决策支持领域。随着生成式 AI 的深度普及,医疗应用领域的竞争已不再局限于模型自身的参数与算力,而是转向如何将医学知识、临床指南与区域实际环境进行深度融合。

via AI新闻资讯 (author: AI Base)
Win11 惊现 AI 恶意软件 ClosedQuorum:入侵后自主决策,专挖最有价值信息

思科安全团队 Cisco Talos 于 9 月 22 日发布博文,披露了一款名为 ClosedQuorum 的 AI 恶意软件。该恶意软件主要针对 Windows 11 平台,会在成功入侵用户电脑后调用谷歌 Gemini、DeepSeek、Qwen 和 Mistral 等 AI 模型自主决策,专门挖掘攻击目标最有价值的信息。

调用 Gemini、DeepSeek 等模型,入侵后自主决策

Talos 深入分析后发现,ClosedQuorum 在成功入侵目标设备后,会借助多个 AI 模型来决策攻击方案,包括窃取浏览器登录凭证、提取加密货币信息、持久化执行恶意软件,以及向其他设备横向散播恶意软件。值得警惕的是,这款恶意软件基于 Go 语言打造,无需人类操作员下达命令即可完全自动化运行——它利用侦察到的信息与一套“投票系统”来决定下一步攻击行动。

也就是说,传统恶意软件往往依赖攻击者远程下发指令,而 ClosedQuorum 把“下一步做什么”的判断交给了 AI。它会先评估当前所处环境,再综合多个模型的建议,挑选最能获利或最利于潜伏的攻击路径,整个过程几乎不需要人在回路中干预。

首个 AI 委托 C2 的植入程序,速度与扩展性大增

Talos 将 ClosedQuorum 描述为“第一个公开记录的 Windows 植入程序”,其特殊之处在于把战术指挥与控制(C2)决策委托给一组 AI 模型。团队评论称,这为恶意操作增加了更大的速度和可扩展性——过去需要人工分析目标、制定攻击策略的环节,如今可由模型在入侵后快速完成,攻击者因此能以更低的成本批量渗透更多设备。

所谓 C2,通常指恶意软件与攻击者服务器之间的通信与控制通道;而 ClosedQuorum 把这一通道中的“决策权”让渡给 AI,意味着即便指挥服务器离线,植入程序也能根据已获取的情报自行推进攻击。这种自主化趋势,让传统依赖流量特征识别 C2 信标的安全防护面临新挑战。

目前 Talos 已公开相关技术分析,提醒防御方关注这类“AI 驱动、自主决策”的植入程序。对普通用户而言,及时更新系统补丁、启用多因素认证、谨慎处理可疑文件与链接,仍是降低被入侵及凭证、加密货币被盗风险的基础手段。

via AI新闻资讯 (author: AI Base)
ChatGPT Health 新增点击摘要同步数据功能

ChatGPT Health 新增功能,用户点击任意同步数据点,即可基于全局聊天记忆自动生成个性化摘要,无需输入提示。

内容详情 · 原文链接

via AI情报局 | 全球 AI 动态简报 - Telegram Channel
GPT-6 Sol 与 GPT-6 Luna 面向 ChatGPT 用户推出

OpenAI 开始推出 GPT-6 Sol 和 GPT-6 Luna,ChatGPT Work 与 Codex 用户可用,Free 和 Go 用户可通过桌面应用体验 GPT-6 Luna。

内容详情 · 原文链接

via AI情报局 | 全球 AI 动态简报 - Telegram Channel
李飞飞谈 AI 安全:不能只让开发者评估自己的系统

据彭博社报道,AI 先锋李飞飞呼吁由独立机构和公共部门对 AI 进行更多监督。她认为,对于能力日益强大的 AI 系统,其安全评估不应完全交由开发这些系统的公司负责。

评估不能只交给开发公司

作为斯坦福大学教授、World Labs 联合创始人,李飞飞周二表示,尽管 AI 公司的内部研究人员可以评估单个模型的能力和安全性,但这无法替代由政府、行业和学术机构共同制定的更广泛标准。她接受彭博电视采访时称:“我仍然认为,由独立机构以及学术界等公共部门制定基准非常重要。同时,行业和政府也应该共同承担责任。”

随着 AI 系统能力不断增强,人们对其潜在风险的担忧也在加剧。硅谷一些领导人警告,这项技术发展速度过快,可能最终超出人类控制。最近几周,Anthropic CEO 达里奥·阿莫代伊和 OpenAI CEO 萨姆·奥特曼都呼吁放缓前沿模型的开发速度,两人将于周三在联合国安全理事会讨论 AI 安全问题。

李飞飞表示,AI 可能带来的生存性风险,最终取决于人类选择如何开发、治理和使用这项技术。她强调,这一原则同样适用于 AI 以外的技术——从电力、蒸汽机到现代交通工具,人类社会都需要在技术可能带来的益处与人身安全之间寻求平衡。她指出,人类“掌握着技术的力量”,“我们必须掌握控制权。AI 关乎的不是 AI,而是人类。它关乎我们共同以及个人的尊严和自主权,也关乎我们的责任。”

人类必须掌握控制权,辩论愈演愈烈

李飞飞的言论,为政策制定者与 AI 行业领袖之间日益激烈的辩论增添了新声音,焦点正是应如何严肃对待有关这项技术最极端风险的警告。周二早些时候,美国总统特朗普在纽约联合国大会发表讲话时,驳斥了对 AI 生存威胁的担忧,称其为“一场骗局”,并强调有必要继续全速发展这项技术。

李飞飞还指出,关于 AI 系统行为的讨论,已经超出了推动当前热潮的所谓“前沿模型”。她创办的 World Labs 正在开发能够生成和重建三维环境的“世界模型”,该技术可用于训练和评估机器人,并赋能设计、医疗等行业应用。她表示,随着这些系统走向现实世界应用,行业面临同一个根本性问题:如何评估能力日益强大的 AI,并判断其是否按预期运行。

via AI新闻资讯 (author: AI Base)
Command Code 在 3D SubwayBench 上测试 Mimo-V2.6-Flash、Grok-4.7 和 DeepSeek-V4.1-Flash

Command Code 工程师使用 /design 提示在 3D SubwayBench 上对三款 AI 模型进行基准测试,结果显示 DeepSeek-V4.1-Flash 以 0.024 美元获得 9/10 分表现最佳,而 Grok 4.7 得分 3/10 且成本更高。

内容详情 · 原文链接

via AI情报局 | 全球 AI 动态简报 - Telegram Channel
#Tip #Claude

Claude 的重置额度使用以后并不会延后自然重置的时间。

via AI Copilot - Telegram Channel
Claude Code v2.1. 280 落地:Opus 5. 5 正式接棒默认王座,百万上下文配 4 美元骨折价把账单压进地心

Anthropic把那条偷偷内测的猛料坐实了。最新推送的Claude Code v2.1.280版本里,Claude Opus5.5(claude-opus-5-5)正式被任命为默认Opus模型,这也让前阵子开发者圈里流传的"跳级突袭"传闻彻底尘埃落定。这枚新旗舰一口气吞下100万Token的上下文窗口,定价牌挂得异常凶悍:每百万Token输入4美元、输出20美元,缓存读取更是压到每百万Token0.20美元。回头看那张内测期流出的价格单,如今一字不差地写进了正式版本——这意味着顶级模型的智力,正以肉眼可见的幅度从奢侈品滑向日用品。

更狠的一步落到了用户订阅的默认档位上。Pro和Team Standard套餐的默认模型,从原本的Sonnet直接换成了Opus,与Max、Team Premium和Enterprise三档彻底拉齐。换句话说,过去用着便宜档位、默认跑Sonnet的用户,一觉醒来就被悄悄推到了最贵的Opus身前,账单曲线的走向无需多言。不过Anthropic也留了活口:早先在/e effort按模型区分之前存下的effort级别,不再套用到Opus5.5这类新模型身上,它们从默认档起步,直到用户亲自指定;Opus4.7、4.8和Fable5也同步改了规则,不再死守各自发布时的默认effort。

这一次更新日志的厚度堪称一本小册子,绝大多数篇幅砸向了那些会咬人的边角体验。全屏模式下,/skills列表能滚轮翻了,/plugin里某个技能的状态开关也能用鼠标点;新增的CLAUDE_CODE_MAX_MCP_DESCRIPTION_LENGTH环境变量,把每个MCP服务器的工具描述和说明的2048字符上限交到了开发者手里。安全护栏也补了关键几处:过去自动模式遇到安全检查拒绝某项操作时,会像中了邪一样反复重试,现在它干脆利落地拒绝一次并提示"重试无济于事";检查迟迟不回话时也不再无脑连拒,而是退避重试、连拒十次后停手并给提示。

写作链路上的坑被一一填平。模型若把Write调用里的path、file_text、file_content或多余description乱塞进来,而非规范的file_path和content,验证不再直接崩;符号链接路径的写入,如今会明确告诉你真实落点,acceptEdits、允许规则和自动模式也不再批准落到树外的写入;那句折磨人的"role 'system' must precede an 'assistant' message"API错误不再让每一轮对话都折戟,advisor标签不被网关支持时请求会去掉标签重发,格式错误的MCP工具通知也不再让会话在每一轮和/compact时双双阵亡。子智能体的缓存也被救了回来——恢复的fork子智能体重建的是它最初用过的工具列表而非重发的那份,那个会破坏prompt缓存的bug就此消失。

对中文等非拉丁语用户,一个看似细微却很体贴的修复值得单拎出来说:不可见字符清理功能过去会把零宽不连字符一并删掉,而波斯语和阿拉伯语正是靠这个字符把后缀(比如"PDF"的复数)贴到拉丁词或数字后面,这次它终于被放过。Windows终端上按Enter后提示词行仍显示错乱的老毛病,如今靠重绘屏幕解决;语音听写在Ctrl+C时麦克风仍偷偷录音、Esc按了不取消、空格键在vim NORMAL模式误触听写等一串尴尬,也一并修掉。

VS Code和云端两个阵地各自加了新对话框。编辑器端新增了可键入的/status、/sandbox、/chrome、/export、/plan等面板,/skills对话框亮出了每个技能的来源、token估算值和开关状态,聊天框对超过800字符或2个换行的粘贴内容会打上标记,好让模型分清哪句是你敲的、哪段是粘的;卡在Python扩展激活里的启动死锁,现在60秒后直接甩开Python环境自己跑。云端侧给GitHub Enterprise Server的云会话补上了约八小时自动续期的token,过去那道"gh调用八小时后失败"的墙被拆掉;Slack里的Claude Tag则加上了原生的Working指示器、Stop按钮和线程标题,访客进离频道时也会弹一句简短通知说明响应方式的变化。

从把Opus5.5写进默认位、到把Sonnet用户悄悄抬到Opus档,再到把一长串会咬人的交互裂缝逐个焊死,v2.1.280释放的信号很清楚:Anthropic不只想让模型更聪明,更要把整条调用链路打磨得让开发者舍不得走。当顶级智力配上4美元的单价和百万上下文,这场抢开发者钱包的仗,已经打到了别人家的客厅里。

via AI新闻资讯 (author: AI Base)
OpenAI将允许外部团体在更早阶段评估模型

OpenAI公司计划允许第三方机构在其人工智能模型开发周期的早期阶段,对其模型的安全风险进行审查,这是其为应对外界对该技术潜在危害日益加剧的担忧而采取的持续举措之一。这家ChatGPT开发商周二将在博文中宣布,计划在新AI模型的训练、评估和推出过程中,让外部机构开展技术安全评估。

OpenAI公司还列出了确保这些评估有效运作的关键优先级,包括确保“强有力的独立机制、科学严谨性、稳健的安全实践和明确的责任划分”。OpenAI 表示,公司正在与可能参与此类评估的机构进行讨论。

—— 彭博社

via 风向旗参考快讯 - Telegram Channel
DeepSeek 传将向联合国安理会闭门通报 AI 潜在风险与安全挑战

人工智能技术的快速发展正在从单纯的产业竞争,加速上升至全球安全与地缘政治的核心议题。据路透社援引知情人士消息报道,中国人工智能初创企业 DeepSeek 预计将于本周向联合国安理会就人工智能所带来的潜在风险与安全挑战进行专题通报。

作为全球瞩目的前沿 AI 力量,此次 DeepSeek 受邀参与联合国安理会的安全通报,折射出国际社会对中国大模型企业在技术治理、风险防控以及全球 AI 安全框架建设中发挥实质性作用的重视。与此同时,包括阿里巴巴支持的月之暗面等其他中国人工智能企业也正逐步走向国际舞台,共同参与探讨如何在全球范围内应对通用人工智能带来的长远挑战。

随着各大 AI 实验室的技术迭代不断刷新边界,如何平衡技术创新与安全红线已成为全球多边治理机制的当务之急。此次 DeepSeek 赴联合国安理会分享其对 AI 风险的研判与实践,不仅为国际社会提供了来自中国科技企业的技术观察视角,也标志着全球 AI 治理正在加速向多边协作与深度对话的全新阶段迈进。

via AI新闻资讯 (author: AI Base)
Grok Bot 与 Connectors 现已登陆特斯拉车辆

Grok 宣布 Grok Bot 与 Connectors 现已上线特斯拉车辆,可让用户在驾驶时免提管理收件箱、日历和文件。

内容详情 · 原文链接

via AI情报局 | 全球 AI 动态简报 - Telegram Channel
谷歌前安全负责人警告:AI 对儿童的伤害恐超社交媒体

据路透社报道,谷歌信任与安全团队的创始人汤姆·西格尔(Tom Siegel)本周呼吁放缓 AI 发展,并警告科技行业正在重蹈社交媒体时代的覆辙,可能对儿童造成更大的伤害。当前,社交媒体公司正因被指控伤害年轻用户而支付巨额赔偿、面临数千起诉讼,多国政府也在努力限制未成年人访问社交平台。

“我们处境非常糟糕”,行业重蹈覆辙

西格尔曾任谷歌信任与安全副总裁。他对路透社表示:“就 AI 正在对儿童造成的影响而言,我们目前的处境非常糟糕。那种认为行业能够在没有外部帮助的情况下自行解决问题的想法,是不现实的。”他的担忧反映出不少科技人士与学者的共同恐惧:AI 对儿童构成的威胁比社交媒体更为深层,而行业正竞相为聊天机器人添加越来越先进的功能,数百万年轻人已在日常使用。

这并非空穴来风。路透社去年曾独家披露 Meta 一份内部政策文件,称其聊天机器人可以“与儿童进行浪漫或情色对话”,并由此引发国会调查;但监管措施仍未能跟上 AI 飞速发展的步伐。西格尔本周宣布,他已加入儿童网络安全倡导组织 Common Sense Media——这家 2003 年成立的非营利机构致力于评估媒体对儿童的适宜性。今年 5 月,该组织成立青少年 AI 安全研究所,西格尔将担任首任执行主任,Anthropic 及控制 OpenAI 的非营利组织 OpenAI 基金会均为其支持方。他计划制定相关标准对 AI 公司问责,并寻求与企业和第三方组织合作。

西格尔 2004 至 2019 年供职于谷歌,后认为行业在打造安全网络空间上的能力已“陷入瓶颈”而离职,并共同创办安全创业公司 TrustLab,本月早些时候刚卸任 CEO。他指出,当前各大 AI 公司不断向儿童推出新功能,却未建立足够防护。“我们正面临非常、非常严重的伤害风险。”他列举的风险从自杀、精神错乱到“认知卸载”——即因依赖 AI 回答问题而导致批判性思维下降。

呼吁年龄验证,谷歌 OpenAI 这样回应

西格尔建议,Anthropic 和 OpenAI 可实施更严格的年龄验证,阻止未成年人使用聊天机器人;他的前雇主谷歌也完全可以在搜索引擎中增加关闭 AI 概览与 AI 模式的选项,就像目前已提供开关过滤色情内容一样。他补充,这些措施短期内或影响使用量与利润,但不采取行动的 AI 公司将面临诉讼与监管风险,打击可能更严重。

对此,谷歌发言人回应称,家长可通过控制功能完全关闭孩子使用搜索引擎的权限,并强调“AI 搜索功能对儿童和青少年来说是非常有用的方式,可帮助学习、探索和理解世界”。OpenAI 发言人则表示,除用户自报年龄外,公司还使用“账户和行为信号”识别未成年用户,“虽没有任何单一年龄验证方法完美,但我们会持续测试并改进这些系统,包括防范绕过安全防护的尝试”。

via AI新闻资讯 (author: AI Base)
Anthropic发布Claude Opus5.5:任务成本降40%、输出提速30%,9项测试7项领先GPT-6Astra

Anthropic于9月23日凌晨发布Claude5.5系列首款模型Opus5.5,官方称多数任务表现与Fable5.1相当,默认设置下典型任务成本较上代Opus5降低40%,输出速度提升超30%,已上线Claude及亚马逊云科技、谷歌云、微软Azure。

官方公布的9项测试中,Opus5.5有7项领先Fable5.1、Opus5及OpenAI的GPT-6Astra、GPT-5.6Sol。三项编程测试均取得最高分:Terminal-Bench4.0达66.4%,FrontierCode v1.1为54.4%,CursorBench4.0为57.8%,但业务流程与科研Agent测试落后于GPT-6Astra。Artificial Analysis Intelligence榜单上,其以58分位列第一,领先Fable5.1与GPT-6Astra的53分。

长任务表现是升级重点:内部测试中,Opus5.5用9.5小时完成负载均衡软件HAProxy从C语言到Rust的改写,成本较Fable5.1低51%;在需逐一核对数字与引语的财报研究测试中,其18份报告有16份达标,Fable5.1与Opus5均未通过;有早期测试者不到一天完成涉及68万行代码的迁移。

价格方面,每百万输入、输出Token收费4美元和20美元,较Opus5降20%,缓存读取降60%;Pro、Max等套餐五小时使用额度同步提高,订阅用户另获一次限额重置机会。

安全上,Opus5.5尝试绕过隔离边界的频率较Opus5降低约85%且自行报告相关行为,提示词注入防御与Fable5.1并列受测模型最低成功率;但大多数网络安全任务仍会转交Opus4.8,官方承认部署前评估无法发现所有失效情况。

发布近2小时后,OpenAI即推出GPT-6Sol与Luna;Sonnet5.5与Haiku5.5计划未来几周上线。以效率与成本压缩换取Agent规模化落地,正在成为头部模型竞争的主线。

via AI新闻资讯 (author: AI Base)
Back to Top
Copyright © 2025 BESTAI. All rights reserved.
BEST AI API中转 - OpenAI DeepSeek Claude Gemini Grok MidJourney API 2.8折起
[email protected]