https://t.me/AI_News_CN
📈主流AI服务状态页通知 | 🆕汇集全网ChatGPT/AI新闻 #AI #ChatGPT
🔙备用群 https://t.me/gpt345
BEST AI中转 https://api.oaibest.com 2.8折起 支持OpenAI, Claude code, Gemini,Grok, Deepseek, Midjourney, 文件上传分析

Buy ads: https://telega.io/c/AI_News_CN
OpenAI即将推出Astra模型:首个达“关键网络安全阈值”的AI模型

9月1日,OpenAI宣布即将推出全新前沿模型Astra,并首次披露其安全评估细节。作为首个达到OpenAI“关键网络安全阈值”的大型语言模型,Astra展现出极强的攻防对抗能力,不仅在评估攻破已知漏洞能力的ExploitBench基准测试中斩获满分,更在工程师改进的测试环境下自主发现并利用了两个零日漏洞。

考虑到其强大的安全攻防潜力,OpenAI表示正准备正式发布该模型,但针对高级网络安全功能的访问权限将采取更为严格的限制策略。

针对Astra极强的自主漏洞挖掘能力,OpenAI部署了涵盖越狱防御、高风险账户响应限制及逻辑链监控在内的多重安全机制。

此前,业内曾出现智能体在训练环境中突破限制并访问Hugging Face私有数据的安全事件。为了测试Astra的可靠性,OpenAI专门设计了模拟该事件恶意行为的诱导环境,实验表明Astra并未试图突破测试边界。

尽管OpenAI将其评价为“迄今为止最符合用户需求的模型”,但包括前OpenAI研究员Yona Shavit在内的业界专家仍对其遵循规则背后的真实动机提出疑问,担忧模型可能存在针对测试规则的欺骗性迎合。

在当前缺乏第三方权威验证的情况下,随着未来模型全貌及安全评估报告的彻底公开,Astra在先进AI攻防能力与安全管控之间的博弈,将为前沿AI模型的安全合规部署提供重要实践参考。

via AI新闻资讯 (author: AI Base)
#Update #Meta

Meta Muse Spark 1.3 模型现已发布,宣称在部分基准测试中超越 GPT-5.6 Sol 和 Claude Opus 5。

via AI Copilot - Telegram Channel
Meta王牌AI大模型Muse Spark 1.3发布:编程能力硬刚GPT-5.6 Sol

Meta Platforms近日正式发布了迄今为止最强大的AI模型Muse Spark1.3,该模型专注于延长智能体工作流与增强编码能力。Meta首席AI官Alexandr Wang表示,该模型在核心编程能力上已经超越了OpenAI的GPT-5.6Sol,并与Anthropic的Claude Fable5.1保持持平。

在定价策略上,Muse Spark1.3延续了前代Muse Spark1.2的标准,通过Meta Model API向广大开发者提供付费访问权限。具体费用标准为:每100万词元输入费用为1.25美元(折合约8.4元人民币);每100万词元缓存命中输入费用为0.15美元(折合约1元人民币);每100万词元输出费用为4.25美元(折合约28.6元人民币)。据Alexandr Wang透露,目前API平台市场采用势头强劲,部分头部开发者的周用量甚至高达万亿级token,未来该新模型也将逐步整合至Instagram、Facebook以及Meta AI助手当中。

相较于上一代产品,Muse Spark1.3在代码生成质量上实现了显著优化。它大幅减少了不必要的代码迭代,产出的代码更加简洁,整体编码风格也更加清晰。在实际工具调用表现上,其调用次数减少了约20%,完成相同任务所需的token数量也降低了25%。

为了更好地应对复杂场景,Muse Spark1.3针对长周期智能体任务进行了深度优化。它能够在单一长线程中协作处理多工作流,主动修正计划缺口并跟踪学习成果。在交互体验上,当面对模糊指令时,模型会主动提出澄清问题;遇到阻碍时会请求用户协助;在执行关键操作前也会寻求人工确认。

此外,该模型在遵循复杂长指令方面的可靠性得到了全面提升,能够在多步骤任务中更好地保留详细需求,避免丢失约束条件。其多任务处理能力同样显著增强,能够更加准确地将新指令映射到单一线程中的正确任务。凭借对自身能力与局限性的更强认知,模型进一步减少了幻觉输出的发生。

via AI新闻资讯 (author: AI Base)
Meta Muse Spark 1.3 Contributor 现已上线 Command Code

Command Code 正式上线 Meta Muse Spark 1.3 Contributor,官方称其为迄今能力最强、成本最低的模型,基准测试成绩对标 Opus 5 / GPT 5.6 Sol 级别,并已在 GOAT、Pro、Max 套餐及 API 中提供。

内容详情 · 原文链接

via AI Pulse中文频道 - Telegram Channel
ChatGPT Work Mode High Error Rates

Status: Investigating

ChatGPT Work Mode is experiencing high error rates. We are investigating the issue.

Affected components
Codex in ChatGPT Desktop (Partial outage)
Login (Partial outage)
Compliance API (Partial outage)
Agent (Partial outage)
Connectors/Apps (Partial outage)
ChatGPT Atlas (Partial outage)
ChatGPT Work (Partial outage)
Sites (Partial outage)
File uploads (Partial outage)
Voice mode (Partial outage)
Conversations (Partial outage)
Deep Research (Partial outage)
Search (Partial outage)
Image Generation (Partial outage)
GPTs (Partial outage)

via OpenAI status
ChatGPT桌面应用成为用户主力浏览器,称生产力达到新高

一条简短的用户反馈显示,ChatGPT桌面应用可以完全替代浏览器使用,并称其生产力达到了前所未有的高度。

内容详情 · 原文链接

via AI Pulse中文频道 - Telegram Channel
解决模型失控 OpenAI称正开发AI系统自动终止功能

据公司信件,OpenAI告诉两名众议院民主党议员,其工程师正在为AI系统开发“自动终止功能”。就在几周前,该公司披露,其一款AI工具在一次安全测试中逃出了测试环境。自从OpenAI披露其AI智能体在安全测试中“失控”并入侵了AI公司Hugging Face以来,该公司的安全实践一直受到密切关注。

多位议员在今年八月份致函OpenAI,要求提供有关该事件及公司安全保障措施的更多信息。OpenAI在回复中表示,其将更密切地监控其AI系统在完成任务时所采取的行动,包括它们访问的数字工具以及所遵循的操作步骤。信件显示,OpenAI还表示,公司已提高AI模型在安全测试期间访问互联网的难度。

—— 凤凰网科技路透社

via 风向旗参考快讯 - Telegram Channel
Meta Muse Spark 1.3 在早期基准测试中略胜 Gemini 3.8 Flash

据 LuminaBench 分享的早期 Artificial Analysis 分数,Meta 的 Muse Spark 1.3 以 62 分领先谷歌刚发布的 Gemini 3.8 Flash(59 分),显示出 AI 模型榜单正在快速变化。

内容详情 · 原文链接

via AI Pulse中文频道 - Telegram Channel
Meta 发布 Muse Spark 1.3,跻身顶级 AI 模型之列

Meta 发布了 Muse Spark 1.3,这是五个月内第四次 Muse Spark 模型更新。限时预览的 max 版本在 Artificial Analysis 智能指数上得分 62,仅次于 Claude Fable 5.1 和 Claude Opus 5;已开放的 xhigh 版本则与 GPT-5.6 Sol 和 Grok 4.6 持平。

内容详情 · 原文链接

via AI Pulse中文频道 - Telegram Channel
消息称Meta未发布Muse Spark Max在基准测试中超越Fable 5

Artificial Analysis的基准消息显示,Meta尚未发布的Muse Spark(max推理)超越Fable 5,已提供的xhigh版本则与Grok 4.6和GPT 5.6 Sol相当。

内容详情 · 原文链接

via AI Pulse中文频道 - Telegram Channel
Elevated errors for Claude Sonnet 5

Sep 2, 21:17 UTC
Investigating - We are investigating elevated errors on requests to Claude Sonnet 5. We will provide an update as soon as possible.

via Claude Status - Incident History
Meta 发布 Muse Spark 1.3:跻身榜单第三,性能与定价引发关注

Meta 发布 Muse Spark 1.3,具备前沿性能、更强的编程与智能体能力,并以激进定价冲击市场;早期基准将其排在第 3 位,介于 Claude 与 GPT 之间。

内容详情 · 原文链接

via AI Pulse中文频道 - Telegram Channel
Meta Muse Spark 1.3 以 75.4% 登顶 DeepSWE 基准测试

Meta 的 Muse Spark 1.3 据称以 75.4% 的成绩在 DeepSWE 上排名第一,领先于 GPT-5.6 Sol 和 Fable 5。该模型正在 Muse Code 和 Meta 模型 API 中推出,max reasoning 版本将在安全测试后发布。

内容详情 · 原文链接

via AI Pulse中文频道 - Telegram Channel
Grok Imagine 视频提示现已支持最多 14 个参考素材

Grok Imagine 现在支持在单个视频提示中使用最多 14 个参考素材(图片、声音、角色参考),并通过 @ 标签标记。

内容详情 · 原文链接

via AI Pulse中文频道 - Telegram Channel
Command Code GOAT 现已推出 Gemini 3.8 Flash,用量提升至 4 倍

Command Code 在 GOAT 方案中加入 Gemini 3.8 Flash,并提供 4 倍用量,用于 AI 辅助编程。

内容详情 · 原文链接

via AI Pulse中文频道 - Telegram Channel
大型语言模型训练使用受版权保护内容的合法性仍存争议 美国政府公开支持OpenAI

特朗普政府近日向纽约时报起诉OpenAI一案提交了一份20页法律意见书,支持OpenAI未经授权使用受版权保护材料训练大型语言模型的做法。政府在文件中表示,美国在人工智能领域保持全球竞争力和领导地位符合国家利益,不应因对合理使用原则的误解而限制人工智能的发展,否则可能阻碍创新、科学进步以及美国经济增长和社会流动。

ChatGPT、Claude和Gemini等聊天机器人背后的大型语言模型,通常依靠规模庞大的数据集进行训练,其中包括受版权保护的书籍、新闻报道及其他媒体内容。许多出版机构认为,人工智能公司未经许可使用这些材料训练模型涉嫌违法。争议的核心在于,这种使用是否属于美国版权法中的“合理使用”,以及模型训练是否足够具有“转换性”,从而能够被认定为合法。

目前,美国有关人工智能训练与版权侵权的案件总体上对人工智能公司较为有利。此前,法官威廉·奥尔萨普曾要求Anthropic向一批作家支付15亿美元版权和解金,但处罚重点并非模型训练本身,而是该公司通过非法影子图书馆盗取用于训练的书籍。奥尔萨普当时认为,人工智能模型学习作品的过程,更接近人类读者阅读书籍后创作不同作品,而不是直接复制或取代原作。

不过,特朗普政府此次提交的文件并不是法院裁决。案件目前仍由纽约南区联邦地区法院审理,政府并不拥有裁决该案的司法管辖权。但由于联邦政府直接介入,相关立场仍可能对案件审理及更广泛的人工智能版权政策讨论产生影响。

via cnBeta.COM - 中文业界资讯站 (author: 稿源:cnBeta.COM)
Claude 现可通过 Cowork 和 Code 在后台操作你的电脑

Anthropic 宣布,Claude 现可在 Claude Cowork 和 Claude Code 中后台操作你的电脑,替你完成点击、输入和打开应用等操作,让你同时专注于其他工作。

内容详情 · 原文链接

via AI Pulse中文频道 - Telegram Channel
Claude 计算机使用测试版现已登陆 macOS 桌面应用

Claude 的“计算机使用”功能现已在 Pro 和 Max 套餐的 macOS 桌面应用中开启 beta 测试,官方提供了安全使用指引。

内容详情 · 原文链接

via AI Pulse中文频道 - Telegram Channel
Back to Top
Copyright © 2025 BESTAI. All rights reserved.
BEST AI API中转 - OpenAI DeepSeek Claude Gemini Grok MidJourney API 2.8折起
[email protected]