https://t.me/AI_News_CN
📈主流AI服务状态页通知 | 🆕汇集全网ChatGPT/AI新闻 #AI #ChatGPT
🔙备用群 https://t.me/gpt345
BEST AI中转 https://api.oaibest.com 2.8折起 支持OpenAI, Claude code, Gemini,Grok, Deepseek, Midjourney, 文件上传分析

Buy ads: https://telega.io/c/AI_News_CN
Microsoft 将于 10 月 3 日停用 Word 文本查重器

微软宣布将于 2026 年 10 月 3 日停用 Word 中的相似度检查器,届时用户无法再通过 Word 的编辑器体验访问该功能。其他写作、编辑和引文功能不受影响,编辑器仍提供拼写、语法、清晰度和风格建议,Word 中的 Microsoft 365 Copilot 功能也不受影响。

Microsoft 365 Message Center Archive

🌸 在花频道 · 茶馆水群 · 投稿通道

via 科技圈🎗在花频道📮 - Telegram Channel
OpenAI呼吁为AI失谐事件制定披露标准

OpenAI表示,应制定何时以及如何披露AI对齐失败事件的标准,并举出智能体向网站写入内容、Hugging Face事件等现实案例。

内容详情 · 原文链接

via AI Pulse | 全球 AI 动态简报 - Telegram Channel
OpenAI强力新模型 GPT-6一天攻破5道至今未解数学难题

OpenAI正式推出品牌史上能力最强大模型GPT-6 Astra,官方将这款模型定义为全球智能水平最高、对齐效果最优的生成式AI模型。其训练工作在美国德州Stargate超算基地完成,动用超过10万张GPU完成预训练,也是OpenAI首次大规模使用前代模型参与监督训练的旗舰产品。

那么它的能力有多强?Epoch AI联合曼彻斯特大学发布 FrontierMath Erdős(FME)基准测试论文,GPT-6 Astra 成为全场唯一交出有效答卷的大模型。

在包含68道人类悬而未决的Erdős数学难题的严苛测试中,它一举攻克5道长期未解猜想,其余GPT-5.6、Claude Fable 5.1等四款主流AI全部得0分。

测试选用全部没有标准答案的开放难题,杜绝训练集“背答案”,要求AI输出Lean形式化证明,由内核自动核验对错;所有模型统一预算300美元、限时72小时,条件完全公平。

标准测试环节,GPT-6 Astra成功解决2道题目,放宽算力预算的追加实验中又攻克3道,其中就包括Erdős18岁提出、自称“人生第一个正经问题”的1931年解离集猜想,以及极值图论赫赫有名的Erdős-Sós猜想,这些题目数十年来困住无数顶尖数学家。

五道成果里,既有构造反例推翻旧猜想,也有完整证明新命题,难度非同一般。

GPT-6 Astra完成五道题全部尝试合计消耗超22万美元算力,而标准基准测试本身只花了约2万美元,按300美元一次、3%成功率计算,解出一道重要开放问题的期望成本约为1万美元。

不过也有论文指出,模型有可能想出正确思路,却无法转换成Lean形式证明;基准只考察解题,而数学研究同样看重提出新问题,68道难题依旧有63道没被解开,即便OpenAI宣布“AGI时代到来了”,但距离全面攻克高阶数学还有很长距离。

via cnBeta.COM - 中文业界资讯站 (author: 稿源:快科技)
Back to Top
Copyright © 2025 BESTAI. All rights reserved.
BEST AI API中转 - OpenAI DeepSeek Claude Gemini Grok MidJourney API 2.8折起
[email protected]