https://t.me/AI_News_CN
📈主流AI服务状态页通知 | 🆕汇集全网ChatGPT/AI新闻 #AI #ChatGPT
🔙备用群 https://t.me/gpt345
BEST AI中转 https://api.oaibest.com 2.8折起 支持OpenAI, Claude code, Gemini,Grok, Deepseek, Midjourney, 文件上传分析

Buy ads: https://telega.io/c/AI_News_CN
ChatGPT Health 新增点击摘要同步数据功能

ChatGPT Health 新增功能,用户点击任意同步数据点,即可基于全局聊天记忆自动生成个性化摘要,无需输入提示。

内容详情 · 原文链接

via AI情报局 | 全球 AI 动态简报 - Telegram Channel
GPT-6 Sol 与 GPT-6 Luna 面向 ChatGPT 用户推出

OpenAI 开始推出 GPT-6 Sol 和 GPT-6 Luna,ChatGPT Work 与 Codex 用户可用,Free 和 Go 用户可通过桌面应用体验 GPT-6 Luna。

内容详情 · 原文链接

via AI情报局 | 全球 AI 动态简报 - Telegram Channel
李飞飞谈 AI 安全:不能只让开发者评估自己的系统

据彭博社报道,AI 先锋李飞飞呼吁由独立机构和公共部门对 AI 进行更多监督。她认为,对于能力日益强大的 AI 系统,其安全评估不应完全交由开发这些系统的公司负责。

评估不能只交给开发公司

作为斯坦福大学教授、World Labs 联合创始人,李飞飞周二表示,尽管 AI 公司的内部研究人员可以评估单个模型的能力和安全性,但这无法替代由政府、行业和学术机构共同制定的更广泛标准。她接受彭博电视采访时称:“我仍然认为,由独立机构以及学术界等公共部门制定基准非常重要。同时,行业和政府也应该共同承担责任。”

随着 AI 系统能力不断增强,人们对其潜在风险的担忧也在加剧。硅谷一些领导人警告,这项技术发展速度过快,可能最终超出人类控制。最近几周,Anthropic CEO 达里奥·阿莫代伊和 OpenAI CEO 萨姆·奥特曼都呼吁放缓前沿模型的开发速度,两人将于周三在联合国安全理事会讨论 AI 安全问题。

李飞飞表示,AI 可能带来的生存性风险,最终取决于人类选择如何开发、治理和使用这项技术。她强调,这一原则同样适用于 AI 以外的技术——从电力、蒸汽机到现代交通工具,人类社会都需要在技术可能带来的益处与人身安全之间寻求平衡。她指出,人类“掌握着技术的力量”,“我们必须掌握控制权。AI 关乎的不是 AI,而是人类。它关乎我们共同以及个人的尊严和自主权,也关乎我们的责任。”

人类必须掌握控制权,辩论愈演愈烈

李飞飞的言论,为政策制定者与 AI 行业领袖之间日益激烈的辩论增添了新声音,焦点正是应如何严肃对待有关这项技术最极端风险的警告。周二早些时候,美国总统特朗普在纽约联合国大会发表讲话时,驳斥了对 AI 生存威胁的担忧,称其为“一场骗局”,并强调有必要继续全速发展这项技术。

李飞飞还指出,关于 AI 系统行为的讨论,已经超出了推动当前热潮的所谓“前沿模型”。她创办的 World Labs 正在开发能够生成和重建三维环境的“世界模型”,该技术可用于训练和评估机器人,并赋能设计、医疗等行业应用。她表示,随着这些系统走向现实世界应用,行业面临同一个根本性问题:如何评估能力日益强大的 AI,并判断其是否按预期运行。

via AI新闻资讯 (author: AI Base)
Command Code 在 3D SubwayBench 上测试 Mimo-V2.6-Flash、Grok-4.7 和 DeepSeek-V4.1-Flash

Command Code 工程师使用 /design 提示在 3D SubwayBench 上对三款 AI 模型进行基准测试,结果显示 DeepSeek-V4.1-Flash 以 0.024 美元获得 9/10 分表现最佳,而 Grok 4.7 得分 3/10 且成本更高。

内容详情 · 原文链接

via AI情报局 | 全球 AI 动态简报 - Telegram Channel
#Tip #Claude

Claude 的重置额度使用以后并不会延后自然重置的时间。

via AI Copilot - Telegram Channel
Claude Code v2.1. 280 落地:Opus 5. 5 正式接棒默认王座,百万上下文配 4 美元骨折价把账单压进地心

Anthropic把那条偷偷内测的猛料坐实了。最新推送的Claude Code v2.1.280版本里,Claude Opus5.5(claude-opus-5-5)正式被任命为默认Opus模型,这也让前阵子开发者圈里流传的"跳级突袭"传闻彻底尘埃落定。这枚新旗舰一口气吞下100万Token的上下文窗口,定价牌挂得异常凶悍:每百万Token输入4美元、输出20美元,缓存读取更是压到每百万Token0.20美元。回头看那张内测期流出的价格单,如今一字不差地写进了正式版本——这意味着顶级模型的智力,正以肉眼可见的幅度从奢侈品滑向日用品。

更狠的一步落到了用户订阅的默认档位上。Pro和Team Standard套餐的默认模型,从原本的Sonnet直接换成了Opus,与Max、Team Premium和Enterprise三档彻底拉齐。换句话说,过去用着便宜档位、默认跑Sonnet的用户,一觉醒来就被悄悄推到了最贵的Opus身前,账单曲线的走向无需多言。不过Anthropic也留了活口:早先在/e effort按模型区分之前存下的effort级别,不再套用到Opus5.5这类新模型身上,它们从默认档起步,直到用户亲自指定;Opus4.7、4.8和Fable5也同步改了规则,不再死守各自发布时的默认effort。

这一次更新日志的厚度堪称一本小册子,绝大多数篇幅砸向了那些会咬人的边角体验。全屏模式下,/skills列表能滚轮翻了,/plugin里某个技能的状态开关也能用鼠标点;新增的CLAUDE_CODE_MAX_MCP_DESCRIPTION_LENGTH环境变量,把每个MCP服务器的工具描述和说明的2048字符上限交到了开发者手里。安全护栏也补了关键几处:过去自动模式遇到安全检查拒绝某项操作时,会像中了邪一样反复重试,现在它干脆利落地拒绝一次并提示"重试无济于事";检查迟迟不回话时也不再无脑连拒,而是退避重试、连拒十次后停手并给提示。

写作链路上的坑被一一填平。模型若把Write调用里的path、file_text、file_content或多余description乱塞进来,而非规范的file_path和content,验证不再直接崩;符号链接路径的写入,如今会明确告诉你真实落点,acceptEdits、允许规则和自动模式也不再批准落到树外的写入;那句折磨人的"role 'system' must precede an 'assistant' message"API错误不再让每一轮对话都折戟,advisor标签不被网关支持时请求会去掉标签重发,格式错误的MCP工具通知也不再让会话在每一轮和/compact时双双阵亡。子智能体的缓存也被救了回来——恢复的fork子智能体重建的是它最初用过的工具列表而非重发的那份,那个会破坏prompt缓存的bug就此消失。

对中文等非拉丁语用户,一个看似细微却很体贴的修复值得单拎出来说:不可见字符清理功能过去会把零宽不连字符一并删掉,而波斯语和阿拉伯语正是靠这个字符把后缀(比如"PDF"的复数)贴到拉丁词或数字后面,这次它终于被放过。Windows终端上按Enter后提示词行仍显示错乱的老毛病,如今靠重绘屏幕解决;语音听写在Ctrl+C时麦克风仍偷偷录音、Esc按了不取消、空格键在vim NORMAL模式误触听写等一串尴尬,也一并修掉。

VS Code和云端两个阵地各自加了新对话框。编辑器端新增了可键入的/status、/sandbox、/chrome、/export、/plan等面板,/skills对话框亮出了每个技能的来源、token估算值和开关状态,聊天框对超过800字符或2个换行的粘贴内容会打上标记,好让模型分清哪句是你敲的、哪段是粘的;卡在Python扩展激活里的启动死锁,现在60秒后直接甩开Python环境自己跑。云端侧给GitHub Enterprise Server的云会话补上了约八小时自动续期的token,过去那道"gh调用八小时后失败"的墙被拆掉;Slack里的Claude Tag则加上了原生的Working指示器、Stop按钮和线程标题,访客进离频道时也会弹一句简短通知说明响应方式的变化。

从把Opus5.5写进默认位、到把Sonnet用户悄悄抬到Opus档,再到把一长串会咬人的交互裂缝逐个焊死,v2.1.280释放的信号很清楚:Anthropic不只想让模型更聪明,更要把整条调用链路打磨得让开发者舍不得走。当顶级智力配上4美元的单价和百万上下文,这场抢开发者钱包的仗,已经打到了别人家的客厅里。

via AI新闻资讯 (author: AI Base)
OpenAI将允许外部团体在更早阶段评估模型

OpenAI公司计划允许第三方机构在其人工智能模型开发周期的早期阶段,对其模型的安全风险进行审查,这是其为应对外界对该技术潜在危害日益加剧的担忧而采取的持续举措之一。这家ChatGPT开发商周二将在博文中宣布,计划在新AI模型的训练、评估和推出过程中,让外部机构开展技术安全评估。

OpenAI公司还列出了确保这些评估有效运作的关键优先级,包括确保“强有力的独立机制、科学严谨性、稳健的安全实践和明确的责任划分”。OpenAI 表示,公司正在与可能参与此类评估的机构进行讨论。

—— 彭博社

via 风向旗参考快讯 - Telegram Channel
DeepSeek 传将向联合国安理会闭门通报 AI 潜在风险与安全挑战

人工智能技术的快速发展正在从单纯的产业竞争,加速上升至全球安全与地缘政治的核心议题。据路透社援引知情人士消息报道,中国人工智能初创企业 DeepSeek 预计将于本周向联合国安理会就人工智能所带来的潜在风险与安全挑战进行专题通报。

作为全球瞩目的前沿 AI 力量,此次 DeepSeek 受邀参与联合国安理会的安全通报,折射出国际社会对中国大模型企业在技术治理、风险防控以及全球 AI 安全框架建设中发挥实质性作用的重视。与此同时,包括阿里巴巴支持的月之暗面等其他中国人工智能企业也正逐步走向国际舞台,共同参与探讨如何在全球范围内应对通用人工智能带来的长远挑战。

随着各大 AI 实验室的技术迭代不断刷新边界,如何平衡技术创新与安全红线已成为全球多边治理机制的当务之急。此次 DeepSeek 赴联合国安理会分享其对 AI 风险的研判与实践,不仅为国际社会提供了来自中国科技企业的技术观察视角,也标志着全球 AI 治理正在加速向多边协作与深度对话的全新阶段迈进。

via AI新闻资讯 (author: AI Base)
Grok Bot 与 Connectors 现已登陆特斯拉车辆

Grok 宣布 Grok Bot 与 Connectors 现已上线特斯拉车辆,可让用户在驾驶时免提管理收件箱、日历和文件。

内容详情 · 原文链接

via AI情报局 | 全球 AI 动态简报 - Telegram Channel
谷歌前安全负责人警告:AI 对儿童的伤害恐超社交媒体

据路透社报道,谷歌信任与安全团队的创始人汤姆·西格尔(Tom Siegel)本周呼吁放缓 AI 发展,并警告科技行业正在重蹈社交媒体时代的覆辙,可能对儿童造成更大的伤害。当前,社交媒体公司正因被指控伤害年轻用户而支付巨额赔偿、面临数千起诉讼,多国政府也在努力限制未成年人访问社交平台。

“我们处境非常糟糕”,行业重蹈覆辙

西格尔曾任谷歌信任与安全副总裁。他对路透社表示:“就 AI 正在对儿童造成的影响而言,我们目前的处境非常糟糕。那种认为行业能够在没有外部帮助的情况下自行解决问题的想法,是不现实的。”他的担忧反映出不少科技人士与学者的共同恐惧:AI 对儿童构成的威胁比社交媒体更为深层,而行业正竞相为聊天机器人添加越来越先进的功能,数百万年轻人已在日常使用。

这并非空穴来风。路透社去年曾独家披露 Meta 一份内部政策文件,称其聊天机器人可以“与儿童进行浪漫或情色对话”,并由此引发国会调查;但监管措施仍未能跟上 AI 飞速发展的步伐。西格尔本周宣布,他已加入儿童网络安全倡导组织 Common Sense Media——这家 2003 年成立的非营利机构致力于评估媒体对儿童的适宜性。今年 5 月,该组织成立青少年 AI 安全研究所,西格尔将担任首任执行主任,Anthropic 及控制 OpenAI 的非营利组织 OpenAI 基金会均为其支持方。他计划制定相关标准对 AI 公司问责,并寻求与企业和第三方组织合作。

西格尔 2004 至 2019 年供职于谷歌,后认为行业在打造安全网络空间上的能力已“陷入瓶颈”而离职,并共同创办安全创业公司 TrustLab,本月早些时候刚卸任 CEO。他指出,当前各大 AI 公司不断向儿童推出新功能,却未建立足够防护。“我们正面临非常、非常严重的伤害风险。”他列举的风险从自杀、精神错乱到“认知卸载”——即因依赖 AI 回答问题而导致批判性思维下降。

呼吁年龄验证,谷歌 OpenAI 这样回应

西格尔建议,Anthropic 和 OpenAI 可实施更严格的年龄验证,阻止未成年人使用聊天机器人;他的前雇主谷歌也完全可以在搜索引擎中增加关闭 AI 概览与 AI 模式的选项,就像目前已提供开关过滤色情内容一样。他补充,这些措施短期内或影响使用量与利润,但不采取行动的 AI 公司将面临诉讼与监管风险,打击可能更严重。

对此,谷歌发言人回应称,家长可通过控制功能完全关闭孩子使用搜索引擎的权限,并强调“AI 搜索功能对儿童和青少年来说是非常有用的方式,可帮助学习、探索和理解世界”。OpenAI 发言人则表示,除用户自报年龄外,公司还使用“账户和行为信号”识别未成年用户,“虽没有任何单一年龄验证方法完美,但我们会持续测试并改进这些系统,包括防范绕过安全防护的尝试”。

via AI新闻资讯 (author: AI Base)
Anthropic发布Claude Opus5.5:任务成本降40%、输出提速30%,9项测试7项领先GPT-6Astra

Anthropic于9月23日凌晨发布Claude5.5系列首款模型Opus5.5,官方称多数任务表现与Fable5.1相当,默认设置下典型任务成本较上代Opus5降低40%,输出速度提升超30%,已上线Claude及亚马逊云科技、谷歌云、微软Azure。

官方公布的9项测试中,Opus5.5有7项领先Fable5.1、Opus5及OpenAI的GPT-6Astra、GPT-5.6Sol。三项编程测试均取得最高分:Terminal-Bench4.0达66.4%,FrontierCode v1.1为54.4%,CursorBench4.0为57.8%,但业务流程与科研Agent测试落后于GPT-6Astra。Artificial Analysis Intelligence榜单上,其以58分位列第一,领先Fable5.1与GPT-6Astra的53分。

长任务表现是升级重点:内部测试中,Opus5.5用9.5小时完成负载均衡软件HAProxy从C语言到Rust的改写,成本较Fable5.1低51%;在需逐一核对数字与引语的财报研究测试中,其18份报告有16份达标,Fable5.1与Opus5均未通过;有早期测试者不到一天完成涉及68万行代码的迁移。

价格方面,每百万输入、输出Token收费4美元和20美元,较Opus5降20%,缓存读取降60%;Pro、Max等套餐五小时使用额度同步提高,订阅用户另获一次限额重置机会。

安全上,Opus5.5尝试绕过隔离边界的频率较Opus5降低约85%且自行报告相关行为,提示词注入防御与Fable5.1并列受测模型最低成功率;但大多数网络安全任务仍会转交Opus4.8,官方承认部署前评估无法发现所有失效情况。

发布近2小时后,OpenAI即推出GPT-6Sol与Luna;Sonnet5.5与Haiku5.5计划未来几周上线。以效率与成本压缩换取Agent规模化落地,正在成为头部模型竞争的主线。

via AI新闻资讯 (author: AI Base)
被指“OpenClaw换皮”后,Meta罕见承认:产品设计确实深受其影响

Meta超级智能实验室(MSL)产品负责人Nat Friedman日前在X上回应称,旗下AI代理产品Muse“在产品设计上确实深受OpenClaw的影响”,但Muse本身“从零开始创建”。

此番回应源于AI应用联合创始人Ansh Nanda的一篇疯传帖子,后者称“Muse简直就是面向普通用户的OpenClaw”,并晒出与Muse的对话,其中AI代理自认其系统文件与OpenClaw的相似性并非“巧合”而是“匹配”。

社区随后发现:Muse同样包含一个SOUL.md文件——以Markdown编写的纯文本配置文件,用于定义AI代理的个性、沟通风格、价值观、行为边界与专业领域,且其内容与OpenClaw的文件几乎完全相同。面对追问,Friedman未予否认,仅回复“我们认为Peter(Steinberger,OpenClaw创建者)把这些都做得完全正确”。

Friedman为前GitHub CEO,去年与Meta首席AI官Alexandr Wang一同加入Meta。他透露,今年一月试用OpenClaw后,曾为MSL团队购买数百台Mac mini,许多人由此爱上OpenClaw等个人代理软件;开发Muse的目标是打造类似OpenClaw的产品,使其安全可靠、易于使用,并能扩展至数十亿用户。

OpenClaw为开源项目,Meta借鉴其设计并不意外;OpenAI今年早些时候已挖走其创始人。这也延续Meta一贯策略:吸纳有潜力的产品并复制其最佳功能,最著名的案例是对Snapchat Stories功能的借鉴。

Muse目前反响热烈,近期登顶美国App Store排行榜;若直接比较平台与市场覆盖范围,其发展速度已超过ChatGPT。Meta发言人表示已就Friedman的声明作出回应,无其他补充。个人AI代理的设计范式正被头部厂商快速吸纳,开源社区成为产品创新的重要源头。

via AI新闻资讯 (author: AI Base)
OpenAI 宣布将在 AI 模型开发早期阶段引入第三方独立安全评估

面对外界持续增长的对人工智能潜在风险的担忧,OpenAI 近期公布了最新的安全治理动向。据相关报道,该公司计划打破传统的内部闭环测试模式,将第三方独立机构正式引入 AI 模型开发周期的更早阶段,对其进行系统性的安全风险评估。

为了确保这一创新机制能够真正发挥实质性作用,OpenAI 同时明确了此类外部评估得以有效开展的核心优先事项。具体包括四大关键支柱:必须具备强有力的独立运作机制、严格遵循科学的严谨性、落实稳健的日常安全实践,以及在各方之间划分清晰明确的安全责任。

这一举措表明,随着前沿人工智能模型的迭代速度不断加快,行业头部企业正在进一步主动向外部开放,通过引入客观公正的第三方力量来共同构筑安全防线,从而回应公众与监管机构对技术可控性的长远审视。

via AI新闻资讯 (author: AI Base)
Grok Bot 上线仅一个月,周活跃用户数正式突破 40 万大关

人工智能领域的竞争格局正在迎来新的变数。根据最新行业报道显示,由马斯克的 SpaceX AI 团队推出的 Grok Bot 人工智能智能体在上线大约一个月后,其周活跃用户数已经成功突破40万大关。

具体数据表现十分亮眼。截至9月14日的统计数据显示,Grok Bot 的用户规模已迅速攀升至41.8万人,与前一周相比实现了高达24% 的强劲环比增长。这一增长速度不仅印证了该智能体在市场上的受欢迎程度,也展现出了其在终端用户群体中的快速渗透能力与强大的吸引力。

via AI新闻资讯 (author: AI Base)
GMI Cloud 用 50 美元和 Claude Opus 5.5 创作二战短片

GMI Cloud 声称仅用 50 美元就借助 Claude Opus 5.5 制作了一部二战主题短片,展示了超低成本 AI 驱动内容创作的潜力。

内容详情 · 原文链接

via AI情报局 | 全球 AI 动态简报 - Telegram Channel
Back to Top
Copyright © 2025 BESTAI. All rights reserved.
BEST AI API中转 - OpenAI DeepSeek Claude Gemini Grok MidJourney API 2.8折起
[email protected]