https://t.me/AI_News_CN
📈主流AI服务状态页通知 | 🆕汇集全网ChatGPT/AI新闻 #AI #ChatGPT
🔙备用群 https://t.me/gpt345
BEST AI中转 https://api.oaibest.com 2.8折起 支持OpenAI, Claude code, Gemini,Grok, Deepseek, Midjourney, 文件上传分析

Buy ads: https://telega.io/c/AI_News_CN
Anthropic 拟 10 月 IPO 冲刺 2 万亿美元:估值碾压 SpaceX,剑指史上最大上市案

《财富》于 8 月 13 日发布报道称,Anthropic 计划于 2026 年 10 月以 2 万亿美元估值登陆资本市场,其规模将超过 SpaceX,成为史上规模最大的 IPO。作为参照,马斯克旗下的 SpaceX 于今年 6 月 12 日完成 IPO,按每股 135 美元的发行价计算市值约 1.77 万亿美元,曾创下美股史上最大规模上市纪录。若 Anthropic 如期推进,这家成立仅数年的 AI 公司将在四个月里把"最大 IPO"的桂冠从火箭巨头手中夺走。

业内消息显示,Anthropic 已于 6 月向美国证券交易委员会秘密提交 IPO 相关文件,目前进入静默期,受监管约束不得对外披露自身财务表现。这一安排与近期频频见于媒体报道的"已保密提交上市申请"信息相互印证,也为 10 月挂牌的时间表提供了可信度支撑。

模型能打、营收飙涨,撑起万亿估值

Anthropic 敢于喊出 2 万亿美元估值,底气来自产品与商业化的双重突破。今年以来,公司接连推出多款性能优于竞品的模型,同时在企业客户销售上重点发力,把增长引擎从消费者订阅转向更高价值的 B 端市场。今年 5 月,Anthropic 公布其年化营收已突破 470 亿美元,这一数字甚至略高于 OpenAI 同期约 400 亿美元的预估水平。

在 AI 双雄的上市竞速中,Anthropic 显然选择了"抢跑"策略——相较 OpenAI 仍在私有阶段以 70 亿美元回购安抚员工、为 IPO 蓄力,Anthropic 直接把敲钟时间定在了秋季。2 万亿美元的估值若最终兑现,不仅将重塑资本市场对 AI 公司的定价预期,也意味着投资者愿意为"更安全的 Claude"及其企业级叙事支付远超传统科技巨头的溢价。这场由大模型点燃的上市浪潮,正把硅谷的估值游戏推向前所未有的高度。

via AI新闻资讯 (author: AI Base)
DeepSeek Harness v0.1开放全球测试:采用“一切皆插件”架构并开源

DeepSeek Harness 开发者预览版(v0.1)已面向全球 Harness 开发者开放测试,并同步以 MIT 协议开源。作为早期预览版本,DeepSeek Harness 采用“一切皆插件”的设计思路,通过插件化架构构建 Agent Harness,模型、工具、技能、会话、沙箱、存储、循环、调度和 UI 等能力均以插件形式组合,可独立替换与灵活重组。

DeepSeek Harness 主要基于 Cordis 插件系统构建。Cordis 元框架仅负责插件加载、卸载及依赖管理,Agent Harness 的具体组件则由不同 Cordis 插件实现,并通过服务与事件机制协作。开发者无需修改 DeepSeek Harness 源码,即可在配置层独立选择、替换或扩展任意能力。

针对不同场景,DeepSeek Harness 提供标准、PTC(程序化工具调用)、极简和创造四种模式。其中,PTC模式由模型生成代码组合多轮工具调用;极简模式仅保留 Shell 和文件编辑工具,用于最小环境下的模型基准测试;创造模式则支持检查运行时、在内存中试验 Cordis 插件并组合新的模式。目前,已安装 Node.js 开发工具链的系统可通过 npx 快速启动其 Web UI。

via AI新闻资讯 (author: AI Base)
DeepSeek V4 Pro 编程测评夺亚:分数仅输 Kimi K3,成本却只有对手十四分之一

CLUE 团队最新发布的 SuperCLUE-Terminal 中文智能体终端编程测评榜单显示,DeepSeek-V4-Pro-0813 拿下 51.52 分,在所有参测模型中位列第二,仅落后于登顶的 Kimi K3。更值得注意的是,它在取得这一成绩的同时保持着极低的调用成本,性价比优势在一众高分模型中格外突出。该榜单专门面向国内开发者设计,全部采用本土真实编程任务,并统一以 Claude Code 作为运行框架,公平对比各大模型理解中文需求、规划任务、调用工具及排错改代码的完整能力。

评测的真实感来自其任务设定:每道考题需要模型完成 50 至 110 轮交互,单题完整运行耗时半小时到一小时半,能高度还原日常开发中的复杂工作流。本轮榜单中 Kimi K3 以 60.61 分排名第一,DeepSeek-V4-Pro-0813 紧随其后,分数高于 GLM-5.2 的 48.48 分和老版 DeepSeek-V4-Flash 的 46.46 分,稳居第一梯队。

1.42 元单题成本,硬刚顶级算力

最亮眼的是 DeepSeek-V4-Pro-0813 的成本控制:单题调用成本仅约 1.42 元,大约是 Kimi K3 的十四分之一、GLM-5.2 的十六分之一。在头部模型比拼分数往往只差几分的当下,这种数量级的成本差距,意味着中小团队用得起"接近顶级"的代码能力,而不必为每一次交互支付高昂算力费。

从实测场景看,该模型覆盖了前端页面、3D 游戏和工程脚本修改等真实需求,能完整闭环游戏开发逻辑,碰撞、计分、结算功能均运转正常,页面配色与交互反馈也摆脱了模板化的 AI 风格。少数创意绘图类题目会出现结构小瑕疵,但整体完成度仍处于领先水平。对预算敏感的中小企业和独立开发者而言,DeepSeek-V4-Pro-0813 用"第二名的分数、十四分之一的价格"重新定义了编程模型的性价比基准——当顶级能力不再意味着顶级开销,AI 编程的普及门槛正在被真正拉低。

via AI新闻资讯 (author: AI Base)
微软大刀阔斧精简AI业务:合并Copilot应用并砍掉多项冷门功能

微软近期对其人工智能战略进行了重大调整,宣布将消费者端与商业端的Copilot应用进行全面合并,同时淘汰多项未能达到预期效果的AI功能。这一举措不仅反映出个人与专业场景在AI应用中日益模糊的界限,也宣告了微软以往过于繁琐的产品布局需要做出改变,以更好地与ChatGPT、Claude和Gemini等竞品展开竞争。

根据相关的支持文档显示,多项消费者端的功能将在 8 月 18 日正式下线,其中包括群聊功能、AI生成的播客、Copilot Labs实验性功能以及深度研究。不过,付费专业用户未来将通过Researcher功能获得相应的替代方案。此外,微软还决定撤下此前颇受争议、被称为Mico的虚拟动画角色。在过渡期间,独立Copilot应用生成的文件将自动迁移至OneDrive。

此次精简的核心目标是打造更简单、连贯的使用体验。微软内部近期强调,各类功能必须真正赢得用户在日常生活中的存在价值,果断舍弃无效模块。在当前各大科技公司纷纷对AI应用进行整合的背景下,微软正通过精简架构来优化资源,寻求在激烈的市场竞争中站稳脚跟。

via AI新闻资讯 (author: AI Base)
谷歌发布Gemini3.7Flash:编码性能全面升级,初始定价降幅达50%

8月13日,谷歌在其前代模型Gemini3.6Flash发布仅三周后,正式推出全新Gemini3.7Flash。谷歌将其定位为迄今针对代码编写与AI Agent场景功能最强的主力模型,并归功于算法层面的重大突破。

该模型在软件工程与逻辑任务上实现显著升级:FrontierCode基准测试得分由前代的34.4%提升至43.6%,DeepSWE测试得分由49.0%跃升至65.3%,且在Web开发、文档理解与业务流程自动化等方面均表现出色,综合性能已超越Claude Sonnet5和GPT-5.6Terra。

在生态部署与成本控制方面,Gemini3.7Flash已通过API、AI Studio及Antigravity同步开放。其初始定价设定为每百万输入代币0.75美元、每百万输出代币3.75美元,相比3.6Flash的发布初始价格直接降低50%(目前两款模型价格已平齐)。

该优惠定价预计将维持至2026年年底。随着轻量级主力模型在复杂编码与自主代理领域的性能突破及成本压低,高性价比大模型正在加速大规模落地应用的商业化进程。

via AI新闻资讯 (author: AI Base)
Back to Top
Copyright © 2025 BESTAI. All rights reserved.
BEST AI API中转 - OpenAI DeepSeek Claude Gemini Grok MidJourney API 2.8折起
[email protected]