https://t.me/AI_News_CN
📈主流AI服务状态页通知 | 🆕汇集全网ChatGPT/AI新闻 #AI #ChatGPT
🔙备用群 https://t.me/gpt345
BEST AI中转 https://api.oaibest.com 2.8折起 支持OpenAI, Claude code, Gemini,Grok, Deepseek, Midjourney, 文件上传分析

Buy ads: https://telega.io/c/AI_News_CN
Anthropic 发布三项追踪 AI 发展的指标

Anthropic 公布三项有助于追踪 AI 发展的指标:AI 驱动的研发、智能体监督和算力分配,并附上公司内部数据快照。

内容详情 · 原文链接

via AI Pulse | 全球 AI 动态简报 - Telegram Channel
OpenAI 通过 Trusted Access 向部分律所推出 Astra for Law

OpenAI 宣布 Astra for Law 将首先通过 ChatGPT 和 Codex 中的 Trusted Access 向部分律所开放,API 即将推出,并将与法律合作伙伴共同开发。

内容详情 · 原文链接

via AI Pulse | 全球 AI 动态简报 - Telegram Channel
OpenAI为ChatGPT推出73个法律插件

OpenAI正在ChatGPT中推出26个合作伙伴构建和47个社区法律插件,合作方包括Thomson Reuters、Harvey、Legora和iManage。

内容详情 · 原文链接

via AI Pulse | 全球 AI 动态简报 - Telegram Channel
OpenAI 推出 Astra for Law:基于 GPT-6 Astra 的法律 AI 产品

OpenAI 宣布推出 Astra for Law,这是基于 GPT-6 Astra 的新产品,通过工具、设置和上下文为律师及法律科技公司提供支持。

内容详情 · 原文链接

via AI Pulse | 全球 AI 动态简报 - Telegram Channel
Grok Voice 带来「美丽的惊喜」

Grok 官方账号预告了一项「由 Grok Voice 驱动」的体验,并称之为「美丽的惊喜」,目前细节有限,但附有链接可供进一步了解。

内容详情 · 原文链接

via AI Pulse | 全球 AI 动态简报 - Telegram Channel
Elevated errors affecting ChatGPT Work mode

Status: Investigating

We are investigating the issue for the listed services. Some users may experience failures when starting or running Work tasks.

Affected components
ChatGPT Work (Partial outage)

via OpenAI status
OpenRouter 现已成为 ZCode 支持的模型提供商

OpenRouter 现已成为 ZCode 支持的模型提供商,用户可接入 API Key,与 GLM 一起选用模型。

内容详情 · 原文链接

via AI Pulse | 全球 AI 动态简报 - Telegram Channel
Command Code AI登顶Composio基准测试,被誉为“GOAT”

Command Code AI在Composio知识工作基准测试中表现出色,在DeepSeek等开源模型上击败其他框架,以18/30任务完成率和最快平均用时位居前列。

内容详情 · 原文链接

via AI Pulse | 全球 AI 动态简报 - Telegram Channel
Command Code 在 Composio 知识工作基准测试中排名第二

Composio 的知识工作基准测试显示,Command Code 在 GPT-6 Astra 模型上排名第二,该基准依托最全面的连接器与 MCP 工具集,衡量超出编码范畴的真实工作表现。

内容详情 · 原文链接

via AI Pulse | 全球 AI 动态简报 - Telegram Channel
Command Code在Composio基准测试中领先开源模型,超越DeepSeek自家框架

Command Code在Composio面向DeepSeek等开源模型的基准测试中声称准确率和速度领先,完成30个任务中的18个,平均耗时375秒,并超越DeepSeek自家框架。

内容详情 · 原文链接

via AI Pulse | 全球 AI 动态简报 - Telegram Channel
Dropbox 与 Google Gemini 集成,开启 AI 文件工作流

Dropbox 正在与 Google Gemini 集成,用户可通过 Gemini 聊天和 Gemini Spark 操作 Dropbox 文件、创建可分享链接,并生成 Google 幻灯片、表格、Gmail 草稿等。

内容详情 · 原文链接

via AI Pulse | 全球 AI 动态简报 - Telegram Channel
Anthropic:Claude Pro 和 Max 的现有 Projects 将随新功能扩展逐步升级

Anthropic 表示,Claude Pro 和 Max 套餐中的现有 Projects 目前保持原样运行,并会随着新功能在 Claude 上逐步扩展而获得升级;官方已开放候补名单供用户提前体验。

内容详情 · 原文链接

via AI Pulse | 全球 AI 动态简报 - Telegram Channel
Claude 云端线程离线也能继续运行,本地支持即将到来

Claude 的云端线程即使在电脑离线时也能继续工作,但暂时还无法访问本地文件、本地工具或内网资源;本地支持即将上线。

内容详情 · 原文链接

via AI Pulse | 全球 AI 动态简报 - Telegram Channel
Claude项目现可在Claude Code中从单一对话启动并行线程

Anthropic宣布,项目现可在Claude Code中从单一对话启动,由Claude指挥并行工作线程,即使合上笔记本电脑也会继续运行;该测试版正在向部分云端会话中的Pro和Max用户推出。

内容详情 · 原文链接

via AI Pulse | 全球 AI 动态简报 - Telegram Channel
用户实测 Command Code macOS 版:Agent 自行构建 Computer Use 能力

用户反馈称,新版 Command Code macOS 应用通过创建 UI-TARS 的 MCP 服务器,借助开源的 DeepSeek 4.1 Flash 自行实现了 Computer Use 功能,虽然较慢但极其便宜。

内容详情 · 原文链接

via AI Pulse | 全球 AI 动态简报 - Telegram Channel
Investigating service degradation — Cloud Agents and Grok Bot

Sep 17, 15:20 UTC
Investigating - We are investigating a service degradation affecting Cloud Agents and Grok Bot.

via Cursor Status - Incident History
OpenAI 外包商能查看到真实用户与ChatGPT的聊天记录

OpenAI已悄悄建立了一个人工审核业务,根据404 Media的最新报道,该程序在内部被称为“莉莉计划”(Project Lily),旨在使聊天机器人减少谄媚并提高准确性,但它也使敏感的用户提示内容暴露给外部承包商。OpenAI正在支付数百名承包商来阅读真实的ChatGPT对话并对机器人的回复进行评分。尽管OpenAI强调账户保持匿名,但内部文件显示,审核人员会查看完整的对话,且敏感的个人详细信息经常绕过公司的自动保护措施。

—— Unusual Whales

via 风向旗参考快讯 - Telegram Channel
OpenAI有望攻克另一项千禧年大奖数学难题

还记得本月早些时候,数学家指责OpenAI试图抢占先机、争夺一道超高难度数学难题的成果,令这家公司陷入舆论风波吗?据了解该研究进展的人士透露,事实是OpenAI距离攻克千禧年大奖难题中的另一道数学难题已近在咫尺。千禧年大奖难题一共包含七大著名数学挑战,此前引发争议的纳维–斯托克斯方程存在性与光滑性问题正是其中之一。

该消息人士称,公司内部员工预计,下一个目标——霍奇猜想,有望在较短时间内得到证明。霍奇猜想研究的是:由多项式方程定义几何体时,其特定几何特征是否总能用更简单的代数组件来描述。不过,OpenAI可能需要更长时间才会对外公布证明结果。原因在于,公司正研究如何与数学界开展合作,以合适的方式发布成果,避免再次酿成公关危机。

OpenAI为何会对这些冷门艰深的数学难题产生兴趣?毕竟攻克这类问题成本不菲:此前证明纳维–斯托克斯方程相关结论,耗费的成本很可能高达数百万美元。该消息人士表示,OpenAI当时使用了下一代预训练模型的一个变体(代号“道格”)完成了这项证明。

部分OpenAI研究员认为,在软件工程之后,数学是大模型顺理成章要攻克的下一个领域。两个领域具备相似特征:都需要分步逻辑推理,得出的结果大多可以自动核验正误。一些研究员甚至判断,过去一年软件工程领域发生的自动化变革,将在未来6至9个月内在数学领域重演。

除此之外,攻克高难度数学难题,也有助于AI研发人员推进机器学习研究的自动化——机器学习本身就涉及大量数学。这类自动化,是他们迈向递归自改进(AI自主研发新AI)目标的重要一环。

测试前沿模型解决从未被证明的数学难题的能力,同样能帮助研究员评估模型的进展水平与复杂推理能力。倘若模型能够破解纳维–斯托克斯方程、霍奇猜想这类难题,这或许意味着它也有能力解决生物、化学等其他领域同等难度的问题。

另外,只要发布成果时不会引发数学家群体的强烈不满,这类突破也能为OpenAI打造亮眼的新里程碑,在通用超级人工智能的竞赛中作为宣传筹码,这一点自然也对公司有利。

via cnBeta.COM - 中文业界资讯站 (author: 稿源:环球市场播报)
Back to Top
Copyright © 2025 BESTAI. All rights reserved.
BEST AI API中转 - OpenAI DeepSeek Claude Gemini Grok MidJourney API 2.8折起
[email protected]