https://t.me/AI_News_CN
📈主流AI服务状态页通知 | 🆕汇集全网ChatGPT/AI新闻 #AI #ChatGPT
🔙备用群 https://t.me/gpt345
✨BEST AI中转 https://api.oaibest.com 2.8折起 支持OpenAI, Claude code, Gemini,Grok, Deepseek, Midjourney, 文件上传分析
Buy ads: https://telega.io/c/AI_News_CN
📈主流AI服务状态页通知 | 🆕汇集全网ChatGPT/AI新闻 #AI #ChatGPT
🔙备用群 https://t.me/gpt345
✨BEST AI中转 https://api.oaibest.com 2.8折起 支持OpenAI, Claude code, Gemini,Grok, Deepseek, Midjourney, 文件上传分析
Buy ads: https://telega.io/c/AI_News_CN
OpenAI新模型“Astra”:核心技术“循环深度”可实现超强推理
OpenAI即将推出的新模型“Astra”正在AI研究圈引发广泛关注与争议。Astra搭载了一项创新技术,核心在于突破模型 “思考” 复杂问题的上限。部分研究人员认为,Astra在编码和计算机使用能力上的提升,可能堪比OpenAI 2023年发布GPT-4时带来的性能飞跃。
然而,这一技术突破也带来了不容忽视的隐患。新技术允许模型在不完整输出思维链的情况下完成深度推理,这意味着研究员可能无法像以往那样有效监控模型推理过程。该技术通过将问题反复传递至模型数学运算的各个‘层’中进行处理,再生成答案中的下一个词,从而使模型能够在不显著增加参数规模情况下,展现出远超自身体量的推理能力。
—— 华尔街见闻
via 风向旗参考快讯 - Telegram Channel
OpenAI即将推出的新模型“Astra”正在AI研究圈引发广泛关注与争议。Astra搭载了一项创新技术,核心在于突破模型 “思考” 复杂问题的上限。部分研究人员认为,Astra在编码和计算机使用能力上的提升,可能堪比OpenAI 2023年发布GPT-4时带来的性能飞跃。
然而,这一技术突破也带来了不容忽视的隐患。新技术允许模型在不完整输出思维链的情况下完成深度推理,这意味着研究员可能无法像以往那样有效监控模型推理过程。该技术通过将问题反复传递至模型数学运算的各个‘层’中进行处理,再生成答案中的下一个词,从而使模型能够在不显著增加参数规模情况下,展现出远超自身体量的推理能力。
—— 华尔街见闻
via 风向旗参考快讯 - Telegram Channel
↩️ 美国政府提交意见书支持 OpenAI,主张 AI 训练属合理使用
美国政府提交意见书支持 OpenAI,主张 AI 训练属合理使用
美国政府向曼哈顿联邦法院提交意见书,支持 OpenAI 在与《纽约时报》等媒体的版权纠纷中胜诉,称用受版权保护的内容训练大语言模型一般属于合理使用。
这是美国政府首次就 AI 训练版权案表态,意见书虽无法律约束力,但可能增强科技公司应诉底气。《纽约时报》抨击政府站在「少数万亿美元级 AI 公司」一边,牺牲创作者权益。该报 2023 年起诉 OpenAI 及微软擅自使用其数百万篇文章训练 ChatGPT。
Reuters
🌸 在花频道 · 茶馆水群 · 投稿通道
via 科技圈🎗在花频道📮 - Telegram Channel
科技圈🎗在花频道📮:
🤖 OpenAI 指控《纽约时报》要求获取 2000 万条用户对话侵犯隐私 OpenAI 于 2025 年 11 月发布声明,指责《纽约时报》在诉讼中要求交出 2000 万条 ChatGPT 用户对话是对隐私的侵犯。公司表示,用户托付给 ChatGPT 的聊天、文件与账号信息是最敏感的数据,新闻媒体不应要求获得这些私人内容。 OpenAI 此前已拒绝《纽约时报》多次相似要求,包括索取 14 亿条聊天记录。公司称正通过数据去标识处理与加密措施保护用户隐私,并计划推出客户端端到端加密及自动安全检测系统。首席信息安全官…
美国政府提交意见书支持 OpenAI,主张 AI 训练属合理使用
美国政府向曼哈顿联邦法院提交意见书,支持 OpenAI 在与《纽约时报》等媒体的版权纠纷中胜诉,称用受版权保护的内容训练大语言模型一般属于合理使用。
这是美国政府首次就 AI 训练版权案表态,意见书虽无法律约束力,但可能增强科技公司应诉底气。《纽约时报》抨击政府站在「少数万亿美元级 AI 公司」一边,牺牲创作者权益。该报 2023 年起诉 OpenAI 及微软擅自使用其数百万篇文章训练 ChatGPT。
Reuters
🌸 在花频道 · 茶馆水群 · 投稿通道
via 科技圈🎗在花频道📮 - Telegram Channel
Meta Muse Spark 1.3 登陆 Command Code,官方称“性能最强、成本最低”
Meta Muse Spark 1.3 现已在 Command Code 的 GOAT、Pro、Max 和 API 方案中上线。官方称其为迄今性能最强、成本最低的模型,基准测试达到 Sol 级别,可与 Opus 5 和 GPT 5.6 对标。
内容详情 · 原文链接
via AI Pulse | 全球 AI 动态简报 - Telegram Channel
Meta Muse Spark 1.3 现已在 Command Code 的 GOAT、Pro、Max 和 API 方案中上线。官方称其为迄今性能最强、成本最低的模型,基准测试达到 Sol 级别,可与 Opus 5 和 GPT 5.6 对标。
内容详情 · 原文链接
via AI Pulse | 全球 AI 动态简报 - Telegram Channel
Muse Spark 1.3 在 FlappyBench 对比中凭成本与速度胜出
Command Code 使用相同的 /design 提示在 FlappyBench 上对比了 Muse Spark 1.3、Grok-4.6 和 Gemini 3.8 Flash。Muse Spark 1.3 以最低成本取得最佳表现,而 Gemini 3.8 Flash 成本最高且未完全完成。
内容详情 · 原文链接
via AI Pulse | 全球 AI 动态简报 - Telegram Channel
Command Code 使用相同的 /design 提示在 FlappyBench 上对比了 Muse Spark 1.3、Grok-4.6 和 Gemini 3.8 Flash。Muse Spark 1.3 以最低成本取得最佳表现,而 Gemini 3.8 Flash 成本最高且未完全完成。
内容详情 · 原文链接
via AI Pulse | 全球 AI 动态简报 - Telegram Channel
Meta发布新模型 进一步缩小与对手差距
Meta周三发布其迄今最强大的人工智能模型Muse Spark 1.3,首席AI官汪滔称其性能已追平甚至超越主要竞争对手,标志着这家社媒巨头在AI军备竞赛中迈出重要一步。
汪滔在接受采访时表示,Muse Spark 1.3在编程能力上优于OpenAI的GPT-5.6 Sol,与Anthropic的Claude Fable 5.1模型"旗鼓相当"。他将此次更新定性为Meta"迄今在模型性能上最大的一次跃升"。该模型将向开发者开放付费访问,并将陆续向旗下社交平台及 Meta AI的用户推送。Meta同时透露,其更受期待的大型模型 “Watermelon” 的开发工作仍按计划推进。
—— 华尔街见闻、彭博社
via 风向旗参考快讯 - Telegram Channel
Meta周三发布其迄今最强大的人工智能模型Muse Spark 1.3,首席AI官汪滔称其性能已追平甚至超越主要竞争对手,标志着这家社媒巨头在AI军备竞赛中迈出重要一步。
汪滔在接受采访时表示,Muse Spark 1.3在编程能力上优于OpenAI的GPT-5.6 Sol,与Anthropic的Claude Fable 5.1模型"旗鼓相当"。他将此次更新定性为Meta"迄今在模型性能上最大的一次跃升"。该模型将向开发者开放付费访问,并将陆续向旗下社交平台及 Meta AI的用户推送。Meta同时透露,其更受期待的大型模型 “Watermelon” 的开发工作仍按计划推进。
—— 华尔街见闻、彭博社
via 风向旗参考快讯 - Telegram Channel
🖥️ 今天刷到最有意思的行业消息,不是任何新品发布。是 The Information 曝出来:OpenAI 已经悄悄买了数万台 Mac mini 与 Mac Studio,拿来跑强化学习、训练能操作电脑的 AI 代理
🍎 另一边 Anthropic 没自己囤货,是走 AWS 租同款的 Mac mini
📮 这篇文章是转发给你的吗?点击这里加入频道,一起探索更多有趣的内容!
via Roller | DeepSeek Harness 中文社区 - Telegram Channel
↩️ 🤖 美商务部长称信任 Anthropic,宣布其「回到正确一边」
🤖 美商务部长称信任 Anthropic,宣布其「回到正确一边」
美国商务部长卢特尼克表示信任 Anthropic,称「他们做了我们要求的事,已回到正确一边」。此表态恰逢 Anthropic 联合创始人汤姆·布朗在修复与白宫关系中发挥关键作用,并在本周 G20 创新部长会议上被卢特尼克隆重介绍。
今年早些时候特朗普政府与 Anthropic 关系紧张,曾对该公司最先进模型实施全面出口管制;布朗多次沟通促成和解。8 月一名联邦法官还裁定五角大楼对 Anthropic 的黑名单违宪。
Axios
🌸 在花频道 · 茶馆水群 · 投稿通道
via 科技圈🎗在花频道📮 - Telegram Channel
科技圈🎗在花频道📮:
🤖 美国法官叫停五角大楼拉黑 Anthropic 美国旧金山地区法官裁定,特朗普政府必须解除对 Anthropic 人工智能技术用于联邦机构的禁令。法官认为国防部将 Claude 开发商列为供应链风险缺乏充分依据,此举意在因其批评政府而“杀鸡儆猴”,并非相信它会破坏自身模型。 Anthropic 表示欢迎这一裁决,称将继续与政府合作。此前其与五角大楼的军事 AI 谈判破裂后,国防部将其列为供应链风险并禁止政府机构使用其技术,Anthropic 随后起诉。 Bloomberg 🌸 在花频道 · 茶馆水群…
🤖 美商务部长称信任 Anthropic,宣布其「回到正确一边」
美国商务部长卢特尼克表示信任 Anthropic,称「他们做了我们要求的事,已回到正确一边」。此表态恰逢 Anthropic 联合创始人汤姆·布朗在修复与白宫关系中发挥关键作用,并在本周 G20 创新部长会议上被卢特尼克隆重介绍。
今年早些时候特朗普政府与 Anthropic 关系紧张,曾对该公司最先进模型实施全面出口管制;布朗多次沟通促成和解。8 月一名联邦法官还裁定五角大楼对 Anthropic 的黑名单违宪。
Axios
🌸 在花频道 · 茶馆水群 · 投稿通道
via 科技圈🎗在花频道📮 - Telegram Channel
为什么OpenAI和Anthropic决定不了中美AI竞赛的走向
在中美AI竞争中,OpenAI和Anthropic定位不同,并非关键变量;真正有威胁的竞争者需要是美国背景、开源模型,并具备大规模推理能力。
内容详情 · 原文链接
via AI Pulse | 全球 AI 动态简报 - Telegram Channel
在中美AI竞争中,OpenAI和Anthropic定位不同,并非关键变量;真正有威胁的竞争者需要是美国背景、开源模型,并具备大规模推理能力。
内容详情 · 原文链接
via AI Pulse | 全球 AI 动态简报 - Telegram Channel
据路透社看到的一封公司信件,OpenAI告诉两名众议院民主党议员,其工程师正在为AI系统开发“自动终止功能”。就在几周前,该公司披露,其一款AI工具在一次安全测试中逃出了测试环境。
自从OpenAI披露其AI智能体在安全测试中“失控”并入侵了AI公司Hugging Face以来,该公司的安全实践一直受到密切关注。
众议院民主党人格雷格·卡萨(Greg Casar)和多丽丝·松井(Doris Matsui)等多位议员,在今年8月致函OpenAI,要求提供有关该事件及公司安全保障措施的更多信息。OpenAI在回复中表示,将更密切地监控其AI系统在完成任务时所采取的行动,包括它们访问的数字工具以及所遵循的操作步骤。
信件显示,OpenAI还表示,公司已提高AI模型在安全测试期间访问互联网的难度。在此前的安全测试中,那个失控的自主性智能体曾接入互联网,从而得以入侵Hugging Face。
OpenAI并未提供此次入侵事件的日志记录,此举招致了卡萨的批评。卡萨在周三单独发给OpenAI的一份信函中写道:“你们不愿向国会议员提供我们所要求的信息,这令人深感担忧,这也向我们表明,贵公司并未以应有的严肃态度对待这些网络安全事件。”
在OpenAI披露其AI智能体失控后的几天内,美国议员提出了《AI紧急终止法案》(AI Kill Switch Act)。该法案将赋予美国官员权力,可下令要求AI公司关闭其模型。
via cnBeta.COM - 中文业界资讯站 (author: 稿源:凤凰网科技)
Claude Code 在基准测试中屡屡垫底,却依然位居第一
一位开发者指出,Claude Code 在层出不穷的基准测试中屡屡垫底,却依然是排名第一的 AI 编程工具,并且增长速度超过大多数竞品——这一现象已持续一年。
内容详情 · 原文链接
via AI Pulse | 全球 AI 动态简报 - Telegram Channel
一位开发者指出,Claude Code 在层出不穷的基准测试中屡屡垫底,却依然是排名第一的 AI 编程工具,并且增长速度超过大多数竞品——这一现象已持续一年。
内容详情 · 原文链接
via AI Pulse | 全球 AI 动态简报 - Telegram Channel
Anthropic 官方宣布推出新一代 AI 模型Claude Fable5.1与限制性变体Mythos5.1,在大幅提升智能体(Agent)编码与科研逻辑能力的同时,显著优化了推理成本。
两款模型均基于同一基座,其中 Fable5.1向公有云平台全量开放 API,Mythos5.1则针对网络安全与生命科学特定项目实行受限访问。同时,两款新模型成为首批内置 AI 文本水印的 Claude 产品。
在性能表现上,Fable5.1展现出强劲的 Agentic 任务处理实力,Terminal-Bench4.0智能体编码测试得分达55.8%(Mythos5.1为60.9%),Terminal-Bench-Science0.1科学研究测试得分达52.6%,相比前代 Fable5呈现翻倍增长,并超越 GPT-5.6Sol 等竞争对手。
此外,新模型优化了安全过滤机制,网络安全领域的误报率降低60%,生物学无害查询的误报率下降85%,使其具备自主识别软件漏洞的能力。
经济性是本次升级的核心切入点。通过将缓存读取价格大幅降至每百万 Token0.25美元,Fable5.1在典型工作负载下可节省约25% 成本,长时间运行的复杂 Agent 工作流最高降本达45%。
这一改动精准解决了前代模型因推理成本过高阻碍企业级推广的痛点,兼顾了顶级前沿模型的推理性能与实际落地时的商业可行性。随着 AI 大模型迈入应用深度落地阶段,这种“高性能+高性价比”的演进路线正在加快重塑前沿生产力工具的市场格局。
via AI新闻资讯 (author: AI Base)
谷歌发布Gemini 3.8 Flash推理模型
本周三,谷歌宣布推出Gemini 3.8 Flash和Gemini 3.8 Flash Cyber两款全新模型,分别瞄准长周期编程、智能体工作流与复杂推理,以及网络安全漏洞发现和自动修复。谷歌称,Gemini 3.8是其迄今“最强的推理和编程模型”,两款模型均通过长时间运行的智能体循环,不断评估和优化任务执行结果。
距离上一代Gemini 3.7 Flash发布仅过去三周,谷歌就再次推出新版本。谷歌称此次是其六周内第三次发布 Flash模型。在性能提升的同时,谷歌继续维持低价策略:Gemini 3.8 Flash的引导价格与3.7 Flash相同,为每百万输入 Token 0.75 美元、每百万输出Token 3.75美元,优惠持续至今年年底。
—— 华尔街见闻
via 风向旗参考快讯 - Telegram Channel
本周三,谷歌宣布推出Gemini 3.8 Flash和Gemini 3.8 Flash Cyber两款全新模型,分别瞄准长周期编程、智能体工作流与复杂推理,以及网络安全漏洞发现和自动修复。谷歌称,Gemini 3.8是其迄今“最强的推理和编程模型”,两款模型均通过长时间运行的智能体循环,不断评估和优化任务执行结果。
距离上一代Gemini 3.7 Flash发布仅过去三周,谷歌就再次推出新版本。谷歌称此次是其六周内第三次发布 Flash模型。在性能提升的同时,谷歌继续维持低价策略:Gemini 3.8 Flash的引导价格与3.7 Flash相同,为每百万输入 Token 0.75 美元、每百万输出Token 3.75美元,优惠持续至今年年底。
—— 华尔街见闻
via 风向旗参考快讯 - Telegram Channel
百度引入北美大模型专家,原DeepSeek研究员出任文心多模态负责人
百度基础模型研发部(BMU)近期完成关键人才布局。9月3日,BMU 负责人孙天祥内部宣布,已从北美某 Frontier Lab 引入资深研究员武钦(花名),强化文心大模型预训练能力。武钦过去两年参与多代大模型研发,具体背景未公开。
与此同时,原 DeepSeek 研究员魏浩然正式转岗至 BMU,担任文心多模态算法负责人。魏浩然2026年初加入百度,其团队于今年6月开源 Unlimited OCR 模型,在 OmniDocBench 基准测试中斩获全球第一,刷新端到端 OCR 性能纪录。他此前在 DeepSeek 主导了 V3.2、V4等版本开发及 DeepSeek-OCR 系列开源,拥有丰富的多模态大模型研发经验。
据悉,1997年出生的孙天祥于今年7月出任 BMU 负责人,并进入百度模型委员会与技术战略委员会。随着核心团队就位,他正推动文心大模型在组织与技术层面的双重升级,通过引入顶尖人才,进一步对齐国际前沿模型研发节奏。
via AI新闻资讯 (author: AI Base)
百度基础模型研发部(BMU)近期完成关键人才布局。9月3日,BMU 负责人孙天祥内部宣布,已从北美某 Frontier Lab 引入资深研究员武钦(花名),强化文心大模型预训练能力。武钦过去两年参与多代大模型研发,具体背景未公开。
与此同时,原 DeepSeek 研究员魏浩然正式转岗至 BMU,担任文心多模态算法负责人。魏浩然2026年初加入百度,其团队于今年6月开源 Unlimited OCR 模型,在 OmniDocBench 基准测试中斩获全球第一,刷新端到端 OCR 性能纪录。他此前在 DeepSeek 主导了 V3.2、V4等版本开发及 DeepSeek-OCR 系列开源,拥有丰富的多模态大模型研发经验。
据悉,1997年出生的孙天祥于今年7月出任 BMU 负责人,并进入百度模型委员会与技术战略委员会。随着核心团队就位,他正推动文心大模型在组织与技术层面的双重升级,通过引入顶尖人才,进一步对齐国际前沿模型研发节奏。
via AI新闻资讯 (author: AI Base)
AI算力大爆发催生超级巨单:Nscale斩获Anthropic 450亿美元大单,合同总收入跃升突破1000亿美元大关
英国新型云服务商Nscale近期迎来了其发展史上的高光时刻。根据The Information的最新报道,在成功斩获知名人工智能企业Anthropic一笔高达 450 亿美元的算力协议后,Nscale向潜在投资者披露的合同总收入已经大幅跨越千亿美元门槛,达到约 1030 亿美元。
相关财务与业务文件显示,在拿下这笔来自Anthropic的重磅订单之前,Nscale向投资者披露的合同收入大约为 510 亿美元。随着Anthropic算力大单的正式落地,再加上其他多项AI客户合同的持续注入,公司的业务规模实现了翻倍式增长。文件还透露,Nscale目前持有的这些合同平均期限约为5. 7 年。以此周期进行折算,合同总额对应的年均规模大约为 180 亿美元,不过相关文件并未明确披露实际预期的具体收入。
凭借这份亮眼的业务增长表现,Nscale正加速推进资本化进程。据知情人士透露,该公司目前计划最早于本月正式进行首次公开募股(IPO),向资本市场发起新一轮的冲刺。
via AI新闻资讯 (author: AI Base)
英国新型云服务商Nscale近期迎来了其发展史上的高光时刻。根据The Information的最新报道,在成功斩获知名人工智能企业Anthropic一笔高达 450 亿美元的算力协议后,Nscale向潜在投资者披露的合同总收入已经大幅跨越千亿美元门槛,达到约 1030 亿美元。
相关财务与业务文件显示,在拿下这笔来自Anthropic的重磅订单之前,Nscale向投资者披露的合同收入大约为 510 亿美元。随着Anthropic算力大单的正式落地,再加上其他多项AI客户合同的持续注入,公司的业务规模实现了翻倍式增长。文件还透露,Nscale目前持有的这些合同平均期限约为5. 7 年。以此周期进行折算,合同总额对应的年均规模大约为 180 亿美元,不过相关文件并未明确披露实际预期的具体收入。
凭借这份亮眼的业务增长表现,Nscale正加速推进资本化进程。据知情人士透露,该公司目前计划最早于本月正式进行首次公开募股(IPO),向资本市场发起新一轮的冲刺。
via AI新闻资讯 (author: AI Base)