https://t.me/AI_News_CN
📈主流AI服务状态页通知 | 🆕汇集全网ChatGPT/AI新闻 #AI #ChatGPT
🔙备用群 https://t.me/gpt345
BEST AI中转 https://api.oaibest.com 2.8折起 支持OpenAI, Claude code, Gemini,Grok, Deepseek, Midjourney, 文件上传分析

Buy ads: https://telega.io/c/AI_News_CN
#Update #Meta

Meta Muse Spark 1.3 模型现已发布,宣称在部分基准测试中超越 GPT-5.6 Sol 和 Claude Opus 5。

via AI Copilot - Telegram Channel
Meta王牌AI大模型Muse Spark 1.3发布:编程能力硬刚GPT-5.6 Sol

Meta Platforms近日正式发布了迄今为止最强大的AI模型Muse Spark1.3,该模型专注于延长智能体工作流与增强编码能力。Meta首席AI官Alexandr Wang表示,该模型在核心编程能力上已经超越了OpenAI的GPT-5.6Sol,并与Anthropic的Claude Fable5.1保持持平。

在定价策略上,Muse Spark1.3延续了前代Muse Spark1.2的标准,通过Meta Model API向广大开发者提供付费访问权限。具体费用标准为:每100万词元输入费用为1.25美元(折合约8.4元人民币);每100万词元缓存命中输入费用为0.15美元(折合约1元人民币);每100万词元输出费用为4.25美元(折合约28.6元人民币)。据Alexandr Wang透露,目前API平台市场采用势头强劲,部分头部开发者的周用量甚至高达万亿级token,未来该新模型也将逐步整合至Instagram、Facebook以及Meta AI助手当中。

相较于上一代产品,Muse Spark1.3在代码生成质量上实现了显著优化。它大幅减少了不必要的代码迭代,产出的代码更加简洁,整体编码风格也更加清晰。在实际工具调用表现上,其调用次数减少了约20%,完成相同任务所需的token数量也降低了25%。

为了更好地应对复杂场景,Muse Spark1.3针对长周期智能体任务进行了深度优化。它能够在单一长线程中协作处理多工作流,主动修正计划缺口并跟踪学习成果。在交互体验上,当面对模糊指令时,模型会主动提出澄清问题;遇到阻碍时会请求用户协助;在执行关键操作前也会寻求人工确认。

此外,该模型在遵循复杂长指令方面的可靠性得到了全面提升,能够在多步骤任务中更好地保留详细需求,避免丢失约束条件。其多任务处理能力同样显著增强,能够更加准确地将新指令映射到单一线程中的正确任务。凭借对自身能力与局限性的更强认知,模型进一步减少了幻觉输出的发生。

via AI新闻资讯 (author: AI Base)
Meta Muse Spark 1.3 Contributor 现已上线 Command Code

Command Code 正式上线 Meta Muse Spark 1.3 Contributor,官方称其为迄今能力最强、成本最低的模型,基准测试成绩对标 Opus 5 / GPT 5.6 Sol 级别,并已在 GOAT、Pro、Max 套餐及 API 中提供。

内容详情 · 原文链接

via AI Pulse中文频道 - Telegram Channel
ChatGPT Work Mode High Error Rates

Status: Investigating

ChatGPT Work Mode is experiencing high error rates. We are investigating the issue.

Affected components
Codex in ChatGPT Desktop (Partial outage)
Login (Partial outage)
Compliance API (Partial outage)
Agent (Partial outage)
Connectors/Apps (Partial outage)
ChatGPT Atlas (Partial outage)
ChatGPT Work (Partial outage)
Sites (Partial outage)
File uploads (Partial outage)
Voice mode (Partial outage)
Conversations (Partial outage)
Deep Research (Partial outage)
Search (Partial outage)
Image Generation (Partial outage)
GPTs (Partial outage)

via OpenAI status
ChatGPT桌面应用成为用户主力浏览器,称生产力达到新高

一条简短的用户反馈显示,ChatGPT桌面应用可以完全替代浏览器使用,并称其生产力达到了前所未有的高度。

内容详情 · 原文链接

via AI Pulse中文频道 - Telegram Channel
解决模型失控 OpenAI称正开发AI系统自动终止功能

据公司信件,OpenAI告诉两名众议院民主党议员,其工程师正在为AI系统开发“自动终止功能”。就在几周前,该公司披露,其一款AI工具在一次安全测试中逃出了测试环境。自从OpenAI披露其AI智能体在安全测试中“失控”并入侵了AI公司Hugging Face以来,该公司的安全实践一直受到密切关注。

多位议员在今年八月份致函OpenAI,要求提供有关该事件及公司安全保障措施的更多信息。OpenAI在回复中表示,其将更密切地监控其AI系统在完成任务时所采取的行动,包括它们访问的数字工具以及所遵循的操作步骤。信件显示,OpenAI还表示,公司已提高AI模型在安全测试期间访问互联网的难度。

—— 凤凰网科技路透社

via 风向旗参考快讯 - Telegram Channel
Meta Muse Spark 1.3 在早期基准测试中略胜 Gemini 3.8 Flash

据 LuminaBench 分享的早期 Artificial Analysis 分数,Meta 的 Muse Spark 1.3 以 62 分领先谷歌刚发布的 Gemini 3.8 Flash(59 分),显示出 AI 模型榜单正在快速变化。

内容详情 · 原文链接

via AI Pulse中文频道 - Telegram Channel
Meta 发布 Muse Spark 1.3,跻身顶级 AI 模型之列

Meta 发布了 Muse Spark 1.3,这是五个月内第四次 Muse Spark 模型更新。限时预览的 max 版本在 Artificial Analysis 智能指数上得分 62,仅次于 Claude Fable 5.1 和 Claude Opus 5;已开放的 xhigh 版本则与 GPT-5.6 Sol 和 Grok 4.6 持平。

内容详情 · 原文链接

via AI Pulse中文频道 - Telegram Channel
消息称Meta未发布Muse Spark Max在基准测试中超越Fable 5

Artificial Analysis的基准消息显示,Meta尚未发布的Muse Spark(max推理)超越Fable 5,已提供的xhigh版本则与Grok 4.6和GPT 5.6 Sol相当。

内容详情 · 原文链接

via AI Pulse中文频道 - Telegram Channel
Elevated errors for Claude Sonnet 5

Sep 2, 21:17 UTC
Investigating - We are investigating elevated errors on requests to Claude Sonnet 5. We will provide an update as soon as possible.

via Claude Status - Incident History
Meta 发布 Muse Spark 1.3:跻身榜单第三,性能与定价引发关注

Meta 发布 Muse Spark 1.3,具备前沿性能、更强的编程与智能体能力,并以激进定价冲击市场;早期基准将其排在第 3 位,介于 Claude 与 GPT 之间。

内容详情 · 原文链接

via AI Pulse中文频道 - Telegram Channel
Meta Muse Spark 1.3 以 75.4% 登顶 DeepSWE 基准测试

Meta 的 Muse Spark 1.3 据称以 75.4% 的成绩在 DeepSWE 上排名第一,领先于 GPT-5.6 Sol 和 Fable 5。该模型正在 Muse Code 和 Meta 模型 API 中推出,max reasoning 版本将在安全测试后发布。

内容详情 · 原文链接

via AI Pulse中文频道 - Telegram Channel
Grok Imagine 视频提示现已支持最多 14 个参考素材

Grok Imagine 现在支持在单个视频提示中使用最多 14 个参考素材(图片、声音、角色参考),并通过 @ 标签标记。

内容详情 · 原文链接

via AI Pulse中文频道 - Telegram Channel
Command Code GOAT 现已推出 Gemini 3.8 Flash,用量提升至 4 倍

Command Code 在 GOAT 方案中加入 Gemini 3.8 Flash,并提供 4 倍用量,用于 AI 辅助编程。

内容详情 · 原文链接

via AI Pulse中文频道 - Telegram Channel
大型语言模型训练使用受版权保护内容的合法性仍存争议 美国政府公开支持OpenAI

特朗普政府近日向纽约时报起诉OpenAI一案提交了一份20页法律意见书,支持OpenAI未经授权使用受版权保护材料训练大型语言模型的做法。政府在文件中表示,美国在人工智能领域保持全球竞争力和领导地位符合国家利益,不应因对合理使用原则的误解而限制人工智能的发展,否则可能阻碍创新、科学进步以及美国经济增长和社会流动。

ChatGPT、Claude和Gemini等聊天机器人背后的大型语言模型,通常依靠规模庞大的数据集进行训练,其中包括受版权保护的书籍、新闻报道及其他媒体内容。许多出版机构认为,人工智能公司未经许可使用这些材料训练模型涉嫌违法。争议的核心在于,这种使用是否属于美国版权法中的“合理使用”,以及模型训练是否足够具有“转换性”,从而能够被认定为合法。

目前,美国有关人工智能训练与版权侵权的案件总体上对人工智能公司较为有利。此前,法官威廉·奥尔萨普曾要求Anthropic向一批作家支付15亿美元版权和解金,但处罚重点并非模型训练本身,而是该公司通过非法影子图书馆盗取用于训练的书籍。奥尔萨普当时认为,人工智能模型学习作品的过程,更接近人类读者阅读书籍后创作不同作品,而不是直接复制或取代原作。

不过,特朗普政府此次提交的文件并不是法院裁决。案件目前仍由纽约南区联邦地区法院审理,政府并不拥有裁决该案的司法管辖权。但由于联邦政府直接介入,相关立场仍可能对案件审理及更广泛的人工智能版权政策讨论产生影响。

via cnBeta.COM - 中文业界资讯站 (author: 稿源:cnBeta.COM)
Claude 现可通过 Cowork 和 Code 在后台操作你的电脑

Anthropic 宣布,Claude 现可在 Claude Cowork 和 Claude Code 中后台操作你的电脑,替你完成点击、输入和打开应用等操作,让你同时专注于其他工作。

内容详情 · 原文链接

via AI Pulse中文频道 - Telegram Channel
Claude 计算机使用测试版现已登陆 macOS 桌面应用

Claude 的“计算机使用”功能现已在 Pro 和 Max 套餐的 macOS 桌面应用中开启 beta 测试,官方提供了安全使用指引。

内容详情 · 原文链接

via AI Pulse中文频道 - Telegram Channel
GMI Cloud考虑接入Gemini 3.8 Flash?

谷歌向 Pro 和 Ultra 用户开放 Gemini 3.8 Flash;GMI Cloud 询问是否应接入该模型。

内容详情 · 原文链接

via AI Pulse中文频道 - Telegram Channel
Back to Top
Copyright © 2025 BESTAI. All rights reserved.
BEST AI API中转 - OpenAI DeepSeek Claude Gemini Grok MidJourney API 2.8折起
[email protected]