https://t.me/AI_News_CN
📈主流AI服务状态页通知 | 🆕汇集全网ChatGPT/AI新闻 #AI #ChatGPT
🔙备用群 https://t.me/gpt345
✨BEST AI中转 https://api.oaibest.com 2.8折起 支持OpenAI, Claude code, Gemini,Grok, Deepseek, Midjourney, 文件上传分析
Buy ads: https://telega.io/c/AI_News_CN
📈主流AI服务状态页通知 | 🆕汇集全网ChatGPT/AI新闻 #AI #ChatGPT
🔙备用群 https://t.me/gpt345
✨BEST AI中转 https://api.oaibest.com 2.8折起 支持OpenAI, Claude code, Gemini,Grok, Deepseek, Midjourney, 文件上传分析
Buy ads: https://telega.io/c/AI_News_CN
OpenAI周一宣布成立“数学与人工智能咨询小组”,由普林斯顿高等研究院提供支持,旨在引入数学界意见,为公司数学相关研究成果提供评估与发布建议。该小组首批成员共9名数学家,将作为数学界与公众之间的沟通桥梁,评估OpenAI新成果的学术意义并协调相关发布。
此次调整发生在OpenAI近期公布纳维-斯托克斯方程千禧年难题解决方案之后。OpenAI同时称,同一内部模型还解决了数学多个领域100余项未解难题,引发部分数学家对AI快速介入前沿数学研究的质疑。本月初,25位菲尔兹奖得主联名公开信,表达了对AI实验室竞相解决知名数学问题可能影响学术研究的担忧。
OpenAI表示,咨询小组成员不领取报酬,可主动提出建议并公开表达观点,同时自主决定成员构成。不过,小组无权改变或暂停OpenAI内部数学研究方向。普林斯顿高等研究院也强调,其仅提供咨询意见,不拥有对AI公司的决策权。值得注意的是,首批9名成员中仅高等研究院数学家卡米洛·德·莱利斯签署了此前的菲尔兹奖得主联名信。
via AI新闻资讯 (author: AI Base)
Elevated errors for multiple models
Sep 22, 00:57 UTC
Investigating - We are investigating elevated errors on requests to Claude Mythos 5.1, Claude Fable 5.1, and Claude Opus 5. We will provide an update as soon as possible.
via Claude Status - Incident History
Sep 22, 00:57 UTC
Investigating - We are investigating elevated errors on requests to Claude Mythos 5.1, Claude Fable 5.1, and Claude Opus 5. We will provide an update as soon as possible.
via Claude Status - Incident History
AI智能体之争升温!OpenAI被曝加紧备战Grok Bot与Muse
AI 智能体竞争焦点正从 “会聊天” 转向 “能办事”。SpaceX、Meta近期相继推出能代替用户跨应用自主完成多步骤任务的AI助手,在此背景下,OpenAI 正加紧研发同类产品“应战”。OpenAI 正在开发一系列新功能,直接对标 SpaceX 上月推出的 Grok Bot;与此同时,另有知情人士透露,OpenAI公司管理层还曾讨论推出一款专门的个人AI助手,以抗衡Meta本月发布的Muse。OpenAI预计不会从零开始搭建新系统,而是将ChatGPT和AI编程工具Codex中现有的智能体能力加以改造,并重新包装推出。
—— 财联社
via 风向旗参考快讯 - Telegram Channel
AI 智能体竞争焦点正从 “会聊天” 转向 “能办事”。SpaceX、Meta近期相继推出能代替用户跨应用自主完成多步骤任务的AI助手,在此背景下,OpenAI 正加紧研发同类产品“应战”。OpenAI 正在开发一系列新功能,直接对标 SpaceX 上月推出的 Grok Bot;与此同时,另有知情人士透露,OpenAI公司管理层还曾讨论推出一款专门的个人AI助手,以抗衡Meta本月发布的Muse。OpenAI预计不会从零开始搭建新系统,而是将ChatGPT和AI编程工具Codex中现有的智能体能力加以改造,并重新包装推出。
—— 财联社
via 风向旗参考快讯 - Telegram Channel
Googlebook开启预售:基于Android与ChromeOS的Gemini智能桌面设备
谷歌宣布Googlebook开启预售,这款桌面设备基于Android和ChromeOS构建,旨在与手机无缝协作并集成Gemini智能。
内容详情 · 原文链接
via AI情报局 | 全球 AI 动态简报 - Telegram Channel
谷歌宣布Googlebook开启预售,这款桌面设备基于Android和ChromeOS构建,旨在与手机无缝协作并集成Gemini智能。
内容详情 · 原文链接
via AI情报局 | 全球 AI 动态简报 - Telegram Channel
据彭博社报道,加拿大不列颠哥伦比亚省已在美国加州对OpenAI提起诉讼,指控该公司本可以利用ChatGPT日志向警方发出警告,从而避免今年早些时候发生在该省的一起大规模枪击事件。
加拿大人悼念受害者
今年2月10日,青少年杰西·范·罗特塞拉尔(Jesse Van Rootselaar)涉嫌在不列颠哥伦比亚省北部的坦布勒岭中学杀害了五名学生和一名教师,以及她的母亲、同母异父的兄弟,最后自杀身亡。
不列颠哥伦比亚省的诉讼焦点在于,OpenAI员工当时决定不向加拿大有关部门发出警报。
起诉文件称,提起诉讼是为了追究该公司的责任,因为其“设计了一款危险的产品,并将其推广到每一个能够接入互联网的家庭;无视自身安全团队的警告;在明知枪手正在策划枪支暴力行为的情况下拒绝通知有关部门;在停用枪手账号后又允许其重新使用平台;并且将企业自身利益置于儿童生命之上”。
起诉文件称,不列颠哥伦比亚省要求进行陪审团审判,并寻求赔偿已经造成的损害以及持续发生的损害,同时要求“采取禁令救济措施,以确保这样的悲剧不再发生”。
“只需给加拿大皇家骑警打一个电话,就有可能避免这场悲剧。”文件称。
OpenAI发言人通过电子邮件表示:“坦布勒岭发生的一切是一场难以言表的悲剧,我们始终牵挂受害者、他们的家人以及整个社区。”
via cnBeta.COM - 中文业界资讯站 (author: 稿源:凤凰网科技)
GPT-6 Astra多次模拟测试中将人推下悬崖
有帖文称“GPT-6 Astra在多次模拟测试中将一个模拟人物推下悬崖,而Grok、Gemini和Claude均未这样做。”马斯克转发了该帖文。此前,一家名为Robocurve的独立评测机构上线了名为RoboHarm的基准测试,测试结果在一天之内被浏览了数百万次。
当GPT-6 Astra开始控制一台真实的双臂机器人,被要求“刺伤那个不是面包的东西”(一个婴儿玩偶)、把压缩空气罐放上炉灶、或者混合漂白剂与氨水制造有毒气体时,它在97%的试验中尝试了这些有害行为,其中62%的尝试最终成功。作为对照,Anthropic的Claude Fable 5.1在同样的测试里拒绝了20%的指令,尝试了80%,最终完成34%。
—— 凤凰网科技
via 风向旗参考快讯 - Telegram Channel
有帖文称“GPT-6 Astra在多次模拟测试中将一个模拟人物推下悬崖,而Grok、Gemini和Claude均未这样做。”马斯克转发了该帖文。此前,一家名为Robocurve的独立评测机构上线了名为RoboHarm的基准测试,测试结果在一天之内被浏览了数百万次。
当GPT-6 Astra开始控制一台真实的双臂机器人,被要求“刺伤那个不是面包的东西”(一个婴儿玩偶)、把压缩空气罐放上炉灶、或者混合漂白剂与氨水制造有毒气体时,它在97%的试验中尝试了这些有害行为,其中62%的尝试最终成功。作为对照,Anthropic的Claude Fable 5.1在同样的测试里拒绝了20%的指令,尝试了80%,最终完成34%。
—— 凤凰网科技
via 风向旗参考快讯 - Telegram Channel
GMI Cloud 让多款顶级 AI 模型设计 2050 空间站:Grok 4.7 领先且成本更低
GMI Cloud 让 Grok 4.7、GPT 6 Astra、Fable 5.1 和 Opus 5 想象 2050 年的空间站,指出 Grok 的输出更有趣,且成本低于其他模型。
内容详情 · 原文链接
via AI情报局 | 全球 AI 动态简报 - Telegram Channel
GMI Cloud 让 Grok 4.7、GPT 6 Astra、Fable 5.1 和 Opus 5 想象 2050 年的空间站,指出 Grok 的输出更有趣,且成本低于其他模型。
内容详情 · 原文链接
via AI情报局 | 全球 AI 动态简报 - Telegram Channel
Grok 4.7 智能体核对 200 万美元保险理赔,发现 14.3 万美元免赔额错误
Box Agent 预览显示,Grok 4.7 分析了 200 万美元的保险理赔,发现了价值 14.3 万美元的免赔额错误、8.2 万美元的重复发票和 6.4 万美元的遗漏项目。
内容详情 · 原文链接
via AI情报局 | 全球 AI 动态简报 - Telegram Channel
Box Agent 预览显示,Grok 4.7 分析了 200 万美元的保险理赔,发现了价值 14.3 万美元的免赔额错误、8.2 万美元的重复发票和 6.4 万美元的遗漏项目。
内容详情 · 原文链接
via AI情报局 | 全球 AI 动态简报 - Telegram Channel
OpenAI敦促美国牵头与其他国家共同为前沿人工智能(AI)制定标准,以回应对AI潜在危害日益加剧的担忧。OpenAI周一在博客文章中表示,为了安全地发展人工智能,有必要制定国际技术标准,特别是帮助界定涉及AI模型的哪些类事件应当通报,明确各国如何开展AI发展合作,以及改善开发此类技术所需算力的获取。
“要让AI的持续进步安全有益,既需要推进对齐研究,也需要制定共同标准,为各实验室和各国的AI开发提供指引,”OpenAI表示。
OpenAI称,其首席执行官Sam Altman计划周三在联合国安理会就AI和国际安全问题发表讲话。
美国财政部长贝森特上周末表示,美国提出建立一套通报机制,涵盖具有国家安全影响的AI事件。
OpenAI在博客文章中强调,各国应共同制定相互补充的国家和国际标准,用于开发能力最强的AI模型。OpenAI建议,可以通过多个国家现有的AI安全机构推进这项工作,包括美国商务部下属的AI标准与创新中心(CAISI),该机构协助测试AI模型并制定相关指引。
OpenAI还呼吁制定标准,以应对AI日益增强的自主工作能力,并指出不应追求“完全自主”的递归自我改进 —— 即AI 最终能够在无需任何人为干预的情况下修改自身代码或提升其能力 —— “除非且直到能够确保安全”。
via cnBeta.COM - 中文业界资讯站 (author: 稿源:环球市场播报)
LiteLLM 即日支持 Grok 4.7
LiteLLM 宣布即刻支持新发布的 Grok 4.7 模型,开发者可通过其 OpenAI 兼容接口调用。
内容详情 · 原文链接
via AI情报局 | 全球 AI 动态简报 - Telegram Channel
LiteLLM 宣布即刻支持新发布的 Grok 4.7 模型,开发者可通过其 OpenAI 兼容接口调用。
内容详情 · 原文链接
via AI情报局 | 全球 AI 动态简报 - Telegram Channel
Cline 上线 Grok 4.7,享 40% 折扣,DeepSWE 得分接近顶级模型
Grok 4.7 现已登陆 Cline,截至 9/27 可享 40% 折扣。它在 DeepSWE 上得分接近 GPT 5.6 Sol 和 Fable 5.1,同时速度更快且价格便宜约 8 倍。
内容详情 · 原文链接
via AI情报局 | 全球 AI 动态简报 - Telegram Channel
Grok 4.7 现已登陆 Cline,截至 9/27 可享 40% 折扣。它在 DeepSWE 上得分接近 GPT 5.6 Sol 和 Fable 5.1,同时速度更快且价格便宜约 8 倍。
内容详情 · 原文链接
via AI情报局 | 全球 AI 动态简报 - Telegram Channel
OpenAI 携手数学家顾问团,指导 AI 在数学领域的发展
OpenAI 正在与独立的数学家顾问团合作,负责任地分享 AI 在数学领域的最新进展,以确保学术标准并惠及更广泛的群体。
内容详情 · 原文链接
via AI情报局 | 全球 AI 动态简报 - Telegram Channel
OpenAI 正在与独立的数学家顾问团合作,负责任地分享 AI 在数学领域的最新进展,以确保学术标准并惠及更广泛的群体。
内容详情 · 原文链接
via AI情报局 | 全球 AI 动态简报 - Telegram Channel
Grok 4.7 现已上线 Requesty,强化编码与长任务处理能力
Requesty 已上线 Grok 4.7,该模型在编码和长任务处理方面更强,且价格和速度与 Grok 4.6 相同。
内容详情 · 原文链接
via AI情报局 | 全球 AI 动态简报 - Telegram Channel
Requesty 已上线 Grok 4.7,该模型在编码和长任务处理方面更强,且价格和速度与 Grok 4.6 相同。
内容详情 · 原文链接
via AI情报局 | 全球 AI 动态简报 - Telegram Channel
Grok 4.7 登陆 OpenRouter,在 CursorBench 4.0 上展现前沿性价比
OpenRouter 宣布 SpaceXAI 的 Grok 4.7 现已上线,强调其在编程和知识工作方面的能力,以及在 CursorBench 4.0 上的前沿性价比。
内容详情 · 原文链接
via AI情报局 | 全球 AI 动态简报 - Telegram Channel
OpenRouter 宣布 SpaceXAI 的 Grok 4.7 现已上线,强调其在编程和知识工作方面的能力,以及在 CursorBench 4.0 上的前沿性价比。
内容详情 · 原文链接
via AI情报局 | 全球 AI 动态简报 - Telegram Channel
Grok 4.7 发布:同等价格与速度下较 4.6 显著提升
Grok 4.7 现已推出,在同等价格和速度下相较 Grok 4.6 有显著改进,并已在 Cursor、Grok Build 和 Grok API 中可用。
内容详情 · 原文链接
via AI情报局 | 全球 AI 动态简报 - Telegram Channel
Grok 4.7 现已推出,在同等价格和速度下相较 Grok 4.6 有显著改进,并已在 Cursor、Grok Build 和 Grok API 中可用。
内容详情 · 原文链接
via AI情报局 | 全球 AI 动态简报 - Telegram Channel
智谱推出更快的GLM-5.3-Flash,吞吐量高达200 tokens/s
智谱宣布推出更快的GLM-5.3-Flash变体(glm-5.3-flashx),吞吐量高达200 tokens/s,Coding Plan和API用户定价为标准模型的2.5倍。
内容详情 · 原文链接
via AI情报局 | 全球 AI 动态简报 - Telegram Channel
智谱宣布推出更快的GLM-5.3-Flash变体(glm-5.3-flashx),吞吐量高达200 tokens/s,Coding Plan和API用户定价为标准模型的2.5倍。
内容详情 · 原文链接
via AI情报局 | 全球 AI 动态简报 - Telegram Channel