https://t.me/AI_News_CN
📈主流AI服务状态页通知 | 🆕汇集全网ChatGPT/AI新闻 #AI #ChatGPT
🔙备用群 https://t.me/gpt345
BEST AI中转 https://api.oaibest.com 2.8折起 支持OpenAI, Claude code, Gemini,Grok, Deepseek, Midjourney, 文件上传分析

Buy ads: https://telega.io/c/AI_News_CN
Meta Muse Spark 1.3 登陆 Command Code,官方称“性能最强、成本最低”

Meta Muse Spark 1.3 现已在 Command Code 的 GOAT、Pro、Max 和 API 方案中上线。官方称其为迄今性能最强、成本最低的模型,基准测试达到 Sol 级别,可与 Opus 5 和 GPT 5.6 对标。

内容详情 · 原文链接

via AI Pulse | 全球 AI 动态简报 - Telegram Channel
Muse Spark 1.3 在 FlappyBench 对比中凭成本与速度胜出

Command Code 使用相同的 /design 提示在 FlappyBench 上对比了 Muse Spark 1.3、Grok-4.6 和 Gemini 3.8 Flash。Muse Spark 1.3 以最低成本取得最佳表现,而 Gemini 3.8 Flash 成本最高且未完全完成。

内容详情 · 原文链接

via AI Pulse | 全球 AI 动态简报 - Telegram Channel
Meta发布新模型 进一步缩小与对手差距

Meta周三发布其迄今最强大的人工智能模型Muse Spark 1.3,首席AI官汪滔称其性能已追平甚至超越主要竞争对手,标志着这家社媒巨头在AI军备竞赛中迈出重要一步。

汪滔在接受采访时表示,Muse Spark 1.3在编程能力上优于OpenAI的GPT-5.6 Sol,与Anthropic的Claude Fable 5.1模型"旗鼓相当"。他将此次更新定性为Meta"迄今在模型性能上最大的一次跃升"。该模型将向开发者开放付费访问,并将陆续向旗下社交平台及 Meta AI的用户推送。Meta同时透露,其更受期待的大型模型 “Watermelon” 的开发工作仍按计划推进。

—— 华尔街见闻彭博社

via 风向旗参考快讯 - Telegram Channel
OpenAI 采购 —— 数万台 Mac 训练 AI 代理

🖥️ 今天刷到最有意思的行业消息,不是任何新品发布。是 The Information 曝出来:OpenAI 已经悄悄买了数万台 Mac mini 与 Mac Studio,拿来跑强化学习、训练能操作电脑的 AI 代理

🍎 另一边 Anthropic 没自己囤货,是走 AWS 租同款的 Mac mini

📮 这篇文章是转发给你的吗?点击这里加入频道,一起探索更多有趣的内容!

via Roller | DeepSeek Harness 中文社区 - Telegram Channel
↩️ 🤖 美商务部长称信任 Anthropic,宣布其「回到正确一边」


科技圈🎗在花频道📮:

🤖 美国法官叫停五角大楼拉黑 Anthropic 美国旧金山地区法官裁定,特朗普政府必须解除对 Anthropic 人工智能技术用于联邦机构的禁令。法官认为国防部将 Claude 开发商列为供应链风险缺乏充分依据,此举意在因其批评政府而“杀鸡儆猴”,并非相信它会破坏自身模型。 Anthropic 表示欢迎这一裁决,称将继续与政府合作。此前其与五角大楼的军事 AI 谈判破裂后,国防部将其列为供应链风险并禁止政府机构使用其技术,Anthropic 随后起诉。 Bloomberg 🌸 在花频道 · 茶馆水群…

🤖 美商务部长称信任 Anthropic,宣布其「回到正确一边」

美国商务部长卢特尼克表示信任 Anthropic,称「他们做了我们要求的事,已回到正确一边」。此表态恰逢 Anthropic 联合创始人汤姆·布朗在修复与白宫关系中发挥关键作用,并在本周 G20 创新部长会议上被卢特尼克隆重介绍。

今年早些时候特朗普政府与 Anthropic 关系紧张,曾对该公司最先进模型实施全面出口管制;布朗多次沟通促成和解。8 月一名联邦法官还裁定五角大楼对 Anthropic 的黑名单违宪。

Axios

🌸 在花频道 · 茶馆水群 · 投稿通道

via 科技圈🎗在花频道📮 - Telegram Channel
为什么OpenAI和Anthropic决定不了中美AI竞赛的走向

在中美AI竞争中,OpenAI和Anthropic定位不同,并非关键变量;真正有威胁的竞争者需要是美国背景、开源模型,并具备大规模推理能力。

内容详情 · 原文链接

via AI Pulse | 全球 AI 动态简报 - Telegram Channel
解决模型失控 OpenAI称正开发AI系统自动终止功能

据路透社看到的一封公司信件,OpenAI告诉两名众议院民主党议员,其工程师正在为AI系统开发“自动终止功能”。就在几周前,该公司披露,其一款AI工具在一次安全测试中逃出了测试环境。

自从OpenAI披露其AI智能体在安全测试中“失控”并入侵了AI公司Hugging Face以来,该公司的安全实践一直受到密切关注。

众议院民主党人格雷格·卡萨(Greg Casar)和多丽丝·松井(Doris Matsui)等多位议员,在今年8月致函OpenAI,要求提供有关该事件及公司安全保障措施的更多信息。OpenAI在回复中表示,将更密切地监控其AI系统在完成任务时所采取的行动,包括它们访问的数字工具以及所遵循的操作步骤。

信件显示,OpenAI还表示,公司已提高AI模型在安全测试期间访问互联网的难度。在此前的安全测试中,那个失控的自主性智能体曾接入互联网,从而得以入侵Hugging Face。

OpenAI并未提供此次入侵事件的日志记录,此举招致了卡萨的批评。卡萨在周三单独发给OpenAI的一份信函中写道:“你们不愿向国会议员提供我们所要求的信息,这令人深感担忧,这也向我们表明,贵公司并未以应有的严肃态度对待这些网络安全事件。”

在OpenAI披露其AI智能体失控后的几天内,美国议员提出了《AI紧急终止法案》(AI Kill Switch Act)。该法案将赋予美国官员权力,可下令要求AI公司关闭其模型。

via cnBeta.COM - 中文业界资讯站 (author: 稿源:凤凰网科技)
Claude Code 在基准测试中屡屡垫底,却依然位居第一

一位开发者指出,Claude Code 在层出不穷的基准测试中屡屡垫底,却依然是排名第一的 AI 编程工具,并且增长速度超过大多数竞品——这一现象已持续一年。

内容详情 · 原文链接

via AI Pulse | 全球 AI 动态简报 - Telegram Channel
Meta推出Muse Spark 1.3 编程能力与智能代理性能进一步提升

Meta近日推出旗舰人工智能模型Muse Spark 1.3。该模型主要面向编程和智能代理任务,目前已通过Muse Code及Meta API提供使用。Meta首席执行官马克·扎克伯格还表示,未来公司将推出采用开放权重形式发布的Muse Spark版本。

Muse Spark 1.3是Meta在编程领域持续改进人工智能模型的又一次更新,距离Muse Spark 1.2发布还不到一个月。Meta表示,新模型使用了更多长周期编程任务进行训练,旨在减少日常工作中的无效操作。

根据Meta工程团队的测试,与Muse Spark 1.2相比,Muse Spark 1.3完成相关任务时所需的工具调用次数减少约20%,使用的词元数量减少约25%。公司还称,新模型会减少冗长回答,并降低不必要的交互轮次。

这些改进对于编程任务尤其重要,因为较为复杂、耗时更长的工作要求人工智能持续记住用户最初提出的需求,并据此推进任务。Meta表示,Muse Spark 1.3能够在同一段对话中处理多种工作负载,还可以发现自身计划中的缺口,并将相关指令保留为后续开发任务。

Meta还指出,当用户的请求存在歧义时,新模型更倾向于先提出澄清问题,而不是基于错误假设直接执行。

在基准测试方面,Meta公布的数据显示,Muse Spark 1.3在DeepSWE v1.1测试中取得75.4分,高于图表中列出的GPT 5.6 Sol和Opus 5成绩。该模型在Meta的长上下文测试中,相比Muse Spark 1.2也实现了大幅提升。不过,在其他测试项目中,竞争对手的模型仍然保持领先。

价格方面,Meta没有提高Muse Spark 1.3的API收费标准。该模型的价格仍为每百万输入词元1.25美元、每百万缓存输入词元0.15美元,以及每百万输出词元4.25美元。

与上一代模型一样,Meta继续向开发者提供价格更低的“贡献者”层级。参与该层级的开发者需要允许Meta使用其数据改进模型,费用为每百万输入词元0.10美元、每百万输出词元0.20美元。

via cnBeta.COM - 中文业界资讯站 (author: 稿源:cnBeta.COM)
Anthropic 发布 Claude Fable5.1:具备更强 Agent 编码能力,最高降本45%

Anthropic 官方宣布推出新一代 AI 模型Claude Fable5.1与限制性变体Mythos5.1,在大幅提升智能体(Agent)编码与科研逻辑能力的同时,显著优化了推理成本。

两款模型均基于同一基座,其中 Fable5.1向公有云平台全量开放 API,Mythos5.1则针对网络安全与生命科学特定项目实行受限访问。同时,两款新模型成为首批内置 AI 文本水印的 Claude 产品。

在性能表现上,Fable5.1展现出强劲的 Agentic 任务处理实力,Terminal-Bench4.0智能体编码测试得分达55.8%(Mythos5.1为60.9%),Terminal-Bench-Science0.1科学研究测试得分达52.6%,相比前代 Fable5呈现翻倍增长,并超越 GPT-5.6Sol 等竞争对手。

此外,新模型优化了安全过滤机制,网络安全领域的误报率降低60%,生物学无害查询的误报率下降85%,使其具备自主识别软件漏洞的能力。

经济性是本次升级的核心切入点。通过将缓存读取价格大幅降至每百万 Token0.25美元,Fable5.1在典型工作负载下可节省约25% 成本,长时间运行的复杂 Agent 工作流最高降本达45%。

这一改动精准解决了前代模型因推理成本过高阻碍企业级推广的痛点,兼顾了顶级前沿模型的推理性能与实际落地时的商业可行性。随着 AI 大模型迈入应用深度落地阶段,这种“高性能+高性价比”的演进路线正在加快重塑前沿生产力工具的市场格局。

via AI新闻资讯 (author: AI Base)
谷歌发布Gemini 3.8 Flash推理模型

本周三,谷歌宣布推出Gemini 3.8 Flash和Gemini 3.8 Flash Cyber两款全新模型,分别瞄准长周期编程、智能体工作流与复杂推理,以及网络安全漏洞发现和自动修复。谷歌称,Gemini 3.8是其迄今“最强的推理和编程模型”,两款模型均通过长时间运行的智能体循环,不断评估和优化任务执行结果。

距离上一代Gemini 3.7 Flash发布仅过去三周,谷歌就再次推出新版本。谷歌称此次是其六周内第三次发布 Flash模型。在性能提升的同时,谷歌继续维持低价策略:Gemini 3.8 Flash的引导价格与3.7 Flash相同,为每百万输入 Token 0.75 美元、每百万输出Token 3.75美元,优惠持续至今年年底。

—— 华尔街见闻

via 风向旗参考快讯 - Telegram Channel
百度引入北美大模型专家,原DeepSeek研究员出任文心多模态负责人

百度基础模型研发部(BMU)近期完成关键人才布局。9月3日,BMU 负责人孙天祥内部宣布,已从北美某 Frontier Lab 引入资深研究员武钦(花名),强化文心大模型预训练能力。武钦过去两年参与多代大模型研发,具体背景未公开。

与此同时,原 DeepSeek 研究员魏浩然正式转岗至 BMU,担任文心多模态算法负责人。魏浩然2026年初加入百度,其团队于今年6月开源 Unlimited OCR 模型,在 OmniDocBench 基准测试中斩获全球第一,刷新端到端 OCR 性能纪录。他此前在 DeepSeek 主导了 V3.2、V4等版本开发及 DeepSeek-OCR 系列开源,拥有丰富的多模态大模型研发经验。

据悉,1997年出生的孙天祥于今年7月出任 BMU 负责人,并进入百度模型委员会与技术战略委员会。随着核心团队就位,他正推动文心大模型在组织与技术层面的双重升级,通过引入顶尖人才,进一步对齐国际前沿模型研发节奏。

via AI新闻资讯 (author: AI Base)
AI算力大爆发催生超级巨单:Nscale斩获Anthropic 450亿美元大单,合同总收入跃升突破1000亿美元大关

英国新型云服务商Nscale近期迎来了其发展史上的高光时刻。根据The Information的最新报道,在成功斩获知名人工智能企业Anthropic一笔高达 450 亿美元的算力协议后,Nscale向潜在投资者披露的合同总收入已经大幅跨越千亿美元门槛,达到约 1030 亿美元。

相关财务与业务文件显示,在拿下这笔来自Anthropic的重磅订单之前,Nscale向投资者披露的合同收入大约为 510 亿美元。随着Anthropic算力大单的正式落地,再加上其他多项AI客户合同的持续注入,公司的业务规模实现了翻倍式增长。文件还透露,Nscale目前持有的这些合同平均期限约为5. 7 年。以此周期进行折算,合同总额对应的年均规模大约为 180 亿美元,不过相关文件并未明确披露实际预期的具体收入。

凭借这份亮眼的业务增长表现,Nscale正加速推进资本化进程。据知情人士透露,该公司目前计划最早于本月正式进行首次公开募股(IPO),向资本市场发起新一轮的冲刺。

via AI新闻资讯 (author: AI Base)
纽约时报起诉OpenAI 美国司法部首次公开站队

美司法部向曼哈顿一家联邦法院表示,从国家利益出发,法院应认定OpenAI使用纽约时报及其他出版商的文章开发AI系统没有违反版权法。这是美国司法部首次就AI公司使用受版权保护材料的问题公开表明立场。

司法部在周二晚提交的文件中表示,发展AI对国家安全至关重要。AI系统在训练过程中对文字作品进行了充分转换,形成了新的内容,相关使用应当受到版权法允许。AI带来的利益远远超过其可能造成的竞争损害。司法部副部长伍德沃德表示,特朗普总统已经明确提出,美国在AI领域保持领先,对国家安全、经济繁荣和社会流动至关重要。

—— 凤凰网科技TechCrunch

via 风向旗参考快讯 - Telegram Channel
司法部首次就 AI 版权公开表态:力挺 OpenAI,主张 AI 训练属“合理使用”

美国司法部(DOJ)当地时间 9 月 1 日向曼哈顿联邦法院提交了一份“利益声明”,正式介入《纽约时报》诉 OpenAI 版权侵权案,明确支持 OpenAI 的立场,主张 AI 公司使用受版权保护的材料训练大语言模型属于“合理使用”,不构成版权侵权。这份文件由美国副司法部长斯坦利·伍德沃德(Stanley Woodward Jr.)等人签署。

以“国家安全”和“转换性使用”为由支持 OpenAI

DOJ 首先从国家安全角度论证支持 OpenAI 的必要性,认为如果版权规则显著增加在美国开发大语言模型的难度,可能损害美国 AI 产业竞争力并带来国家安全风险。文件称:“那些使在美国建立强大 AI 产业变得显著更加困难的法律规则,因此威胁到国家安全,并给不受此类束缚的外国对手带来竞争优势。”司法部还引用了特朗普关于“消除美国在 AI 领域领导地位障碍”的行政命令,称 AI 主导地位对“促进国家安全、繁荣和全体美国人的经济流动性”至关重要。

DOJ 进一步阐述,大语言模型训练对版权作品的使用具有“转换性”目的,符合合理使用标准,“大语言模型训练所带来的创造性可能和公共利益,远远超过任何竞争损害”。文件还特别指出,若法院支持《纽约时报》的主张,将“阻碍创造性和科学进步,同时妨碍美国的繁荣和经济流动性”。伍德沃德称这份文件为“具有历史意义的利益声明”。

原告方强烈反弹,法官要求 9 月 4 日前提交动议

《纽约时报》发言人格雷厄姆·詹姆斯发表声明批评 DOJ 的立场:“政府站在少数几家市值万亿美元的 AI 公司一边,却牺牲了无数作品被窃取的美国创作者的权益。”他表示,AI 和创作者可以共同繁荣——AI 公司只需按照版权法的要求,为造就其产品的内容公平付费。

《纽约每日新闻》首席律师史蒂文·利伯曼则指出,政府的立场“忽视了美国宪法中的版权条款”,并与美国版权局此前表达的观点相矛盾。

《纽约时报》于 2023 年 12 月起诉 OpenAI 及其合作伙伴微软,指控两家公司非法使用其数百万篇受版权保护的新闻文章训练 AI 系统,并寻求“数十亿美元”的损害赔偿。此后,《纽约每日新闻》《芝加哥论坛报》等多家新闻机构以及大量畅销书作者也加入了这起合并诉讼。OpenAI 和微软否认相关指控,主张其使用属于合理使用范畴。

此次司法部的介入使这起标志性版权诉讼进一步升级,案件结果可能为 AI 公司使用受版权保护材料训练模型的合法性确立重要先例。负责审理此案的法官西德尼·斯坦要求双方最迟于当地时间 9 月 4 日提交简易判决动议。

via AI新闻资讯 (author: AI Base)
Back to Top
Copyright © 2025 BESTAI. All rights reserved.
BEST AI API中转 - OpenAI DeepSeek Claude Gemini Grok MidJourney API 2.8折起
[email protected]