https://t.me/AI_News_CN
📈主流AI服务状态页通知 | 🆕汇集全网ChatGPT/AI新闻 #AI #ChatGPT
🔙备用群 https://t.me/gpt345
✨BEST AI中转 https://api.oaibest.com 2.8折起 支持OpenAI, Claude code, Gemini,Grok, Deepseek, Midjourney, 文件上传分析
Buy ads: https://telega.io/c/AI_News_CN
📈主流AI服务状态页通知 | 🆕汇集全网ChatGPT/AI新闻 #AI #ChatGPT
🔙备用群 https://t.me/gpt345
✨BEST AI中转 https://api.oaibest.com 2.8折起 支持OpenAI, Claude code, Gemini,Grok, Deepseek, Midjourney, 文件上传分析
Buy ads: https://telega.io/c/AI_News_CN
Anthropic 发布三项追踪 AI 发展的指标
Anthropic 公布三项有助于追踪 AI 发展的指标:AI 驱动的研发、智能体监督和算力分配,并附上公司内部数据快照。
内容详情 · 原文链接
via AI Pulse | 全球 AI 动态简报 - Telegram Channel
Anthropic 公布三项有助于追踪 AI 发展的指标:AI 驱动的研发、智能体监督和算力分配,并附上公司内部数据快照。
内容详情 · 原文链接
via AI Pulse | 全球 AI 动态简报 - Telegram Channel
OpenAI 通过 Trusted Access 向部分律所推出 Astra for Law
OpenAI 宣布 Astra for Law 将首先通过 ChatGPT 和 Codex 中的 Trusted Access 向部分律所开放,API 即将推出,并将与法律合作伙伴共同开发。
内容详情 · 原文链接
via AI Pulse | 全球 AI 动态简报 - Telegram Channel
OpenAI 宣布 Astra for Law 将首先通过 ChatGPT 和 Codex 中的 Trusted Access 向部分律所开放,API 即将推出,并将与法律合作伙伴共同开发。
内容详情 · 原文链接
via AI Pulse | 全球 AI 动态简报 - Telegram Channel
OpenAI为ChatGPT推出73个法律插件
OpenAI正在ChatGPT中推出26个合作伙伴构建和47个社区法律插件,合作方包括Thomson Reuters、Harvey、Legora和iManage。
内容详情 · 原文链接
via AI Pulse | 全球 AI 动态简报 - Telegram Channel
OpenAI正在ChatGPT中推出26个合作伙伴构建和47个社区法律插件,合作方包括Thomson Reuters、Harvey、Legora和iManage。
内容详情 · 原文链接
via AI Pulse | 全球 AI 动态简报 - Telegram Channel
OpenAI 推出 Astra for Law:基于 GPT-6 Astra 的法律 AI 产品
OpenAI 宣布推出 Astra for Law,这是基于 GPT-6 Astra 的新产品,通过工具、设置和上下文为律师及法律科技公司提供支持。
内容详情 · 原文链接
via AI Pulse | 全球 AI 动态简报 - Telegram Channel
OpenAI 宣布推出 Astra for Law,这是基于 GPT-6 Astra 的新产品,通过工具、设置和上下文为律师及法律科技公司提供支持。
内容详情 · 原文链接
via AI Pulse | 全球 AI 动态简报 - Telegram Channel
Grok Voice 带来「美丽的惊喜」
Grok 官方账号预告了一项「由 Grok Voice 驱动」的体验,并称之为「美丽的惊喜」,目前细节有限,但附有链接可供进一步了解。
内容详情 · 原文链接
via AI Pulse | 全球 AI 动态简报 - Telegram Channel
Grok 官方账号预告了一项「由 Grok Voice 驱动」的体验,并称之为「美丽的惊喜」,目前细节有限,但附有链接可供进一步了解。
内容详情 · 原文链接
via AI Pulse | 全球 AI 动态简报 - Telegram Channel
Elevated errors affecting ChatGPT Work mode
Status: Investigating
We are investigating the issue for the listed services. Some users may experience failures when starting or running Work tasks.
Affected components
● ChatGPT Work (Partial outage)
via OpenAI status
Status: Investigating
We are investigating the issue for the listed services. Some users may experience failures when starting or running Work tasks.
Affected components
● ChatGPT Work (Partial outage)
via OpenAI status
OpenRouter 现已成为 ZCode 支持的模型提供商
OpenRouter 现已成为 ZCode 支持的模型提供商,用户可接入 API Key,与 GLM 一起选用模型。
内容详情 · 原文链接
via AI Pulse | 全球 AI 动态简报 - Telegram Channel
OpenRouter 现已成为 ZCode 支持的模型提供商,用户可接入 API Key,与 GLM 一起选用模型。
内容详情 · 原文链接
via AI Pulse | 全球 AI 动态简报 - Telegram Channel
Command Code AI登顶Composio基准测试,被誉为“GOAT”
Command Code AI在Composio知识工作基准测试中表现出色,在DeepSeek等开源模型上击败其他框架,以18/30任务完成率和最快平均用时位居前列。
内容详情 · 原文链接
via AI Pulse | 全球 AI 动态简报 - Telegram Channel
Command Code AI在Composio知识工作基准测试中表现出色,在DeepSeek等开源模型上击败其他框架,以18/30任务完成率和最快平均用时位居前列。
内容详情 · 原文链接
via AI Pulse | 全球 AI 动态简报 - Telegram Channel
Command Code 在 Composio 知识工作基准测试中排名第二
Composio 的知识工作基准测试显示,Command Code 在 GPT-6 Astra 模型上排名第二,该基准依托最全面的连接器与 MCP 工具集,衡量超出编码范畴的真实工作表现。
内容详情 · 原文链接
via AI Pulse | 全球 AI 动态简报 - Telegram Channel
Composio 的知识工作基准测试显示,Command Code 在 GPT-6 Astra 模型上排名第二,该基准依托最全面的连接器与 MCP 工具集,衡量超出编码范畴的真实工作表现。
内容详情 · 原文链接
via AI Pulse | 全球 AI 动态简报 - Telegram Channel
Command Code在Composio基准测试中领先开源模型,超越DeepSeek自家框架
Command Code在Composio面向DeepSeek等开源模型的基准测试中声称准确率和速度领先,完成30个任务中的18个,平均耗时375秒,并超越DeepSeek自家框架。
内容详情 · 原文链接
via AI Pulse | 全球 AI 动态简报 - Telegram Channel
Command Code在Composio面向DeepSeek等开源模型的基准测试中声称准确率和速度领先,完成30个任务中的18个,平均耗时375秒,并超越DeepSeek自家框架。
内容详情 · 原文链接
via AI Pulse | 全球 AI 动态简报 - Telegram Channel
Dropbox 与 Google Gemini 集成,开启 AI 文件工作流
Dropbox 正在与 Google Gemini 集成,用户可通过 Gemini 聊天和 Gemini Spark 操作 Dropbox 文件、创建可分享链接,并生成 Google 幻灯片、表格、Gmail 草稿等。
内容详情 · 原文链接
via AI Pulse | 全球 AI 动态简报 - Telegram Channel
Dropbox 正在与 Google Gemini 集成,用户可通过 Gemini 聊天和 Gemini Spark 操作 Dropbox 文件、创建可分享链接,并生成 Google 幻灯片、表格、Gmail 草稿等。
内容详情 · 原文链接
via AI Pulse | 全球 AI 动态简报 - Telegram Channel
Anthropic:Claude Pro 和 Max 的现有 Projects 将随新功能扩展逐步升级
Anthropic 表示,Claude Pro 和 Max 套餐中的现有 Projects 目前保持原样运行,并会随着新功能在 Claude 上逐步扩展而获得升级;官方已开放候补名单供用户提前体验。
内容详情 · 原文链接
via AI Pulse | 全球 AI 动态简报 - Telegram Channel
Anthropic 表示,Claude Pro 和 Max 套餐中的现有 Projects 目前保持原样运行,并会随着新功能在 Claude 上逐步扩展而获得升级;官方已开放候补名单供用户提前体验。
内容详情 · 原文链接
via AI Pulse | 全球 AI 动态简报 - Telegram Channel
Claude 云端线程离线也能继续运行,本地支持即将到来
Claude 的云端线程即使在电脑离线时也能继续工作,但暂时还无法访问本地文件、本地工具或内网资源;本地支持即将上线。
内容详情 · 原文链接
via AI Pulse | 全球 AI 动态简报 - Telegram Channel
Claude 的云端线程即使在电脑离线时也能继续工作,但暂时还无法访问本地文件、本地工具或内网资源;本地支持即将上线。
内容详情 · 原文链接
via AI Pulse | 全球 AI 动态简报 - Telegram Channel
Claude项目现可在Claude Code中从单一对话启动并行线程
Anthropic宣布,项目现可在Claude Code中从单一对话启动,由Claude指挥并行工作线程,即使合上笔记本电脑也会继续运行;该测试版正在向部分云端会话中的Pro和Max用户推出。
内容详情 · 原文链接
via AI Pulse | 全球 AI 动态简报 - Telegram Channel
Anthropic宣布,项目现可在Claude Code中从单一对话启动,由Claude指挥并行工作线程,即使合上笔记本电脑也会继续运行;该测试版正在向部分云端会话中的Pro和Max用户推出。
内容详情 · 原文链接
via AI Pulse | 全球 AI 动态简报 - Telegram Channel
用户实测 Command Code macOS 版:Agent 自行构建 Computer Use 能力
用户反馈称,新版 Command Code macOS 应用通过创建 UI-TARS 的 MCP 服务器,借助开源的 DeepSeek 4.1 Flash 自行实现了 Computer Use 功能,虽然较慢但极其便宜。
内容详情 · 原文链接
via AI Pulse | 全球 AI 动态简报 - Telegram Channel
用户反馈称,新版 Command Code macOS 应用通过创建 UI-TARS 的 MCP 服务器,借助开源的 DeepSeek 4.1 Flash 自行实现了 Computer Use 功能,虽然较慢但极其便宜。
内容详情 · 原文链接
via AI Pulse | 全球 AI 动态简报 - Telegram Channel
Investigating service degradation — Cloud Agents and Grok Bot
Sep 17, 15:20 UTC
Investigating - We are investigating a service degradation affecting Cloud Agents and Grok Bot.
via Cursor Status - Incident History
Sep 17, 15:20 UTC
Investigating - We are investigating a service degradation affecting Cloud Agents and Grok Bot.
via Cursor Status - Incident History
OpenAI 外包商能查看到真实用户与ChatGPT的聊天记录
OpenAI已悄悄建立了一个人工审核业务,根据404 Media的最新报道,该程序在内部被称为“莉莉计划”(Project Lily),旨在使聊天机器人减少谄媚并提高准确性,但它也使敏感的用户提示内容暴露给外部承包商。OpenAI正在支付数百名承包商来阅读真实的ChatGPT对话并对机器人的回复进行评分。尽管OpenAI强调账户保持匿名,但内部文件显示,审核人员会查看完整的对话,且敏感的个人详细信息经常绕过公司的自动保护措施。
—— Unusual Whales
via 风向旗参考快讯 - Telegram Channel
OpenAI已悄悄建立了一个人工审核业务,根据404 Media的最新报道,该程序在内部被称为“莉莉计划”(Project Lily),旨在使聊天机器人减少谄媚并提高准确性,但它也使敏感的用户提示内容暴露给外部承包商。OpenAI正在支付数百名承包商来阅读真实的ChatGPT对话并对机器人的回复进行评分。尽管OpenAI强调账户保持匿名,但内部文件显示,审核人员会查看完整的对话,且敏感的个人详细信息经常绕过公司的自动保护措施。
—— Unusual Whales
via 风向旗参考快讯 - Telegram Channel
还记得本月早些时候,数学家指责OpenAI试图抢占先机、争夺一道超高难度数学难题的成果,令这家公司陷入舆论风波吗?据了解该研究进展的人士透露,事实是OpenAI距离攻克千禧年大奖难题中的另一道数学难题已近在咫尺。千禧年大奖难题一共包含七大著名数学挑战,此前引发争议的纳维–斯托克斯方程存在性与光滑性问题正是其中之一。
该消息人士称,公司内部员工预计,下一个目标——霍奇猜想,有望在较短时间内得到证明。霍奇猜想研究的是:由多项式方程定义几何体时,其特定几何特征是否总能用更简单的代数组件来描述。不过,OpenAI可能需要更长时间才会对外公布证明结果。原因在于,公司正研究如何与数学界开展合作,以合适的方式发布成果,避免再次酿成公关危机。
OpenAI为何会对这些冷门艰深的数学难题产生兴趣?毕竟攻克这类问题成本不菲:此前证明纳维–斯托克斯方程相关结论,耗费的成本很可能高达数百万美元。该消息人士表示,OpenAI当时使用了下一代预训练模型的一个变体(代号“道格”)完成了这项证明。
部分OpenAI研究员认为,在软件工程之后,数学是大模型顺理成章要攻克的下一个领域。两个领域具备相似特征:都需要分步逻辑推理,得出的结果大多可以自动核验正误。一些研究员甚至判断,过去一年软件工程领域发生的自动化变革,将在未来6至9个月内在数学领域重演。
除此之外,攻克高难度数学难题,也有助于AI研发人员推进机器学习研究的自动化——机器学习本身就涉及大量数学。这类自动化,是他们迈向递归自改进(AI自主研发新AI)目标的重要一环。
测试前沿模型解决从未被证明的数学难题的能力,同样能帮助研究员评估模型的进展水平与复杂推理能力。倘若模型能够破解纳维–斯托克斯方程、霍奇猜想这类难题,这或许意味着它也有能力解决生物、化学等其他领域同等难度的问题。
另外,只要发布成果时不会引发数学家群体的强烈不满,这类突破也能为OpenAI打造亮眼的新里程碑,在通用超级人工智能的竞赛中作为宣传筹码,这一点自然也对公司有利。
via cnBeta.COM - 中文业界资讯站 (author: 稿源:环球市场播报)