https://t.me/AI_News_CN
📈主流AI服务状态页通知 | 🆕汇集全网ChatGPT/AI新闻 #AI #ChatGPT
🔙备用群 https://t.me/gpt345
✨BEST AI中转 https://api.oaibest.com 2.8折起 支持OpenAI, Claude code, Gemini,Grok, Deepseek, Midjourney, 文件上传分析
Buy ads: https://telega.io/c/AI_News_CN
📈主流AI服务状态页通知 | 🆕汇集全网ChatGPT/AI新闻 #AI #ChatGPT
🔙备用群 https://t.me/gpt345
✨BEST AI中转 https://api.oaibest.com 2.8折起 支持OpenAI, Claude code, Gemini,Grok, Deepseek, Midjourney, 文件上传分析
Buy ads: https://telega.io/c/AI_News_CN
Anthropic 首次量化公开 AI 研发自动化进度:Claude 主导 26% 研发,压力甩给 OpenAI 等竞品
当地时间9月17日,Anthropic 发文,第一次以量化方式掀开了内部 AI 研发自动化的底牌。数据相当扎眼:截至今年8月,Claude 已主导公司内部26% 的 AI 研发工作,而今年2月这一比例还不足1%;公司内部 Agent 平台任意时刻约有3万个 AI Agent 在跑,8月产生超过10亿次决策。这组数字被外界视为递归自我改进(RSI)从概念走向工程现实的关键信号。
Anthropic 采用了独立 AI 研究机构 Epoch AI 提出的六级自动化框架,把 AI 的参与程度划分为 AL0至 AL5——AL0完全没有 AI 参与,AL3是 AI 协作,AL4是 AI 主导,AL5为完全自主。截至8月,26% 的 AI 研发工作达到 AL4:人类只需给出高层目标,Claude 就能完成端到端的大部分工作,人只负责监督、检查和最终拍板;另有超过90% 的研发工作至少达到 AL3。
一个具体场景很能说明问题:夜间数据管道出故障后,工程师只需把报告丢给 Claude 说一句"把它修好",它就能自主查看日志、定位原因、编写修复代码、测试、处理新冒出来的问题,最后重跑管道、对比结果并撰写说明。但 Anthropic 也明确划了线——目前尚未有任何被测量的 AI 研发工作达到 AL5完全自主水平。
规模数据更为实在。截至8月,Anthropic 内部约3万个 Agent 从事研究和工程工作,它们拥有独立于底层模型升级的身份标识,通过共享消息系统互相委派任务、交叉纠错。安全监控上,所有 Agent 动作执行前都要过在线监控,8月超10亿次决策中约0.002% 被阻止;离线监控每周标记约10万条对话记录,经分类器过滤误报和初步审查后,最高优先级约50条升级到人工审查。算力分配方面,7月样本周内约6% 的 AI 研发算力投入安全研究,若只统计 AI 驱动的研发,这一比例升至约12%。Anthropic 也坦承,AI 协作与 AI 主导的边界存在主观性,跨实验室比较需要统一方法和第三方验证。
RSI 眼下已是行业最热的概念。昨日智谱创始人唐杰披露,GLM-5.3-Flash 两周内完成国产加速器全量部署,大部分工作由 GLM-5.3驱动的 Infra Agent 完成;他判断距离完全 RSI 尚远,但"模型优化系统、系统服务模型"的循环已经开始运转。OpenAI 则在9月初宣布达成自动化 AI 研究实习生里程碑,目标2028年3月前实现自动化 AI 研究员,最薄弱的环节仍是"决定做什么"——任务超过4小时就需要人类频繁介入。谷歌 DeepMind 的进化式编码智能体 AlphaEvolve 从算法进化切入,其提出的电路方案已集成进下一代 TPU,谷歌前首席科学家杰夫·迪恩称之为"TPU 大脑帮助设计下一代 TPU 身体"的最新案例。
谷歌 DeepMind 首席战略官贾吉特·塞洪此前的一句话点透了底层逻辑:RSI 正成为 AI 资本开支的核心投资逻辑,虽然当前 AI 收入还撑不起正在投入的资本开支,但不下注 RSI 并不明智。
Anthropic 这次把数字摆上台面,一面是想在人类仍握主导权的窗口期,让社会参与决定 AI 自我迭代的节奏与方向;另一面,则是给行业立下一个可参照的披露基准——当研发自动化比例、Agent 规模、算力投入占比和安全监控覆盖率都被公开,透明度本身就变成了无声的竞争压力,不跟进就可能被当成有意遮掩。
via AI新闻资讯 (author: AI Base)
当地时间9月17日,Anthropic 发文,第一次以量化方式掀开了内部 AI 研发自动化的底牌。数据相当扎眼:截至今年8月,Claude 已主导公司内部26% 的 AI 研发工作,而今年2月这一比例还不足1%;公司内部 Agent 平台任意时刻约有3万个 AI Agent 在跑,8月产生超过10亿次决策。这组数字被外界视为递归自我改进(RSI)从概念走向工程现实的关键信号。
Anthropic 采用了独立 AI 研究机构 Epoch AI 提出的六级自动化框架,把 AI 的参与程度划分为 AL0至 AL5——AL0完全没有 AI 参与,AL3是 AI 协作,AL4是 AI 主导,AL5为完全自主。截至8月,26% 的 AI 研发工作达到 AL4:人类只需给出高层目标,Claude 就能完成端到端的大部分工作,人只负责监督、检查和最终拍板;另有超过90% 的研发工作至少达到 AL3。
一个具体场景很能说明问题:夜间数据管道出故障后,工程师只需把报告丢给 Claude 说一句"把它修好",它就能自主查看日志、定位原因、编写修复代码、测试、处理新冒出来的问题,最后重跑管道、对比结果并撰写说明。但 Anthropic 也明确划了线——目前尚未有任何被测量的 AI 研发工作达到 AL5完全自主水平。
规模数据更为实在。截至8月,Anthropic 内部约3万个 Agent 从事研究和工程工作,它们拥有独立于底层模型升级的身份标识,通过共享消息系统互相委派任务、交叉纠错。安全监控上,所有 Agent 动作执行前都要过在线监控,8月超10亿次决策中约0.002% 被阻止;离线监控每周标记约10万条对话记录,经分类器过滤误报和初步审查后,最高优先级约50条升级到人工审查。算力分配方面,7月样本周内约6% 的 AI 研发算力投入安全研究,若只统计 AI 驱动的研发,这一比例升至约12%。Anthropic 也坦承,AI 协作与 AI 主导的边界存在主观性,跨实验室比较需要统一方法和第三方验证。
RSI 眼下已是行业最热的概念。昨日智谱创始人唐杰披露,GLM-5.3-Flash 两周内完成国产加速器全量部署,大部分工作由 GLM-5.3驱动的 Infra Agent 完成;他判断距离完全 RSI 尚远,但"模型优化系统、系统服务模型"的循环已经开始运转。OpenAI 则在9月初宣布达成自动化 AI 研究实习生里程碑,目标2028年3月前实现自动化 AI 研究员,最薄弱的环节仍是"决定做什么"——任务超过4小时就需要人类频繁介入。谷歌 DeepMind 的进化式编码智能体 AlphaEvolve 从算法进化切入,其提出的电路方案已集成进下一代 TPU,谷歌前首席科学家杰夫·迪恩称之为"TPU 大脑帮助设计下一代 TPU 身体"的最新案例。
谷歌 DeepMind 首席战略官贾吉特·塞洪此前的一句话点透了底层逻辑:RSI 正成为 AI 资本开支的核心投资逻辑,虽然当前 AI 收入还撑不起正在投入的资本开支,但不下注 RSI 并不明智。
Anthropic 这次把数字摆上台面,一面是想在人类仍握主导权的窗口期,让社会参与决定 AI 自我迭代的节奏与方向;另一面,则是给行业立下一个可参照的披露基准——当研发自动化比例、Agent 规模、算力投入占比和安全监控覆盖率都被公开,透明度本身就变成了无声的竞争压力,不跟进就可能被当成有意遮掩。
via AI新闻资讯 (author: AI Base)
吴恩达回应AI末日论:别被科幻叙事带偏,应解决现实工程问题
AI领域研究者吴恩达9月17日在接受彭博电视采访时表示,顶尖模型开发商近期有关AI可能导致人类生存风险的警告“更像科幻小说,而不是科学”,并认为这类叙事可能分散行业对实际AI安全问题的关注。吴恩达曾参与创办Google Brain和Coursera。
吴恩达称,科技行业早期曾放大AI潜在灾难性风险,以获取关注并影响监管方向;近两周相关讨论再次升温,也可能存在类似动机。他认为AI确实存在现实风险,尤其包括网络安全等领域,但不认同将人类灭绝风险作为当前AI发展的核心判断依据。
近期,前Anthropic和OpenAI研究员Jacob Coxon公开离职并警告前沿实验室正在竞相开发超级AI,引发新一轮AI安全争论。Anthropic CEO Dario Amodei和OpenAI CEO Sam Altman随后均提出应适当放缓前沿模型发展,并加强安全措施。吴恩达早年曾与两人共事。
与“减速”主张不同,吴恩达认为行业应继续推进AI发展,同时通过受控测试、工程防护和迭代改进解决可验证的安全问题,并让AI更多应用于能够产生社会价值的场景。当前,AI安全讨论正从模型能力边界进一步延伸至网络安全、代理失控、对齐及前沿模型治理等具体问题。
via AI新闻资讯 (author: AI Base)
AI领域研究者吴恩达9月17日在接受彭博电视采访时表示,顶尖模型开发商近期有关AI可能导致人类生存风险的警告“更像科幻小说,而不是科学”,并认为这类叙事可能分散行业对实际AI安全问题的关注。吴恩达曾参与创办Google Brain和Coursera。
吴恩达称,科技行业早期曾放大AI潜在灾难性风险,以获取关注并影响监管方向;近两周相关讨论再次升温,也可能存在类似动机。他认为AI确实存在现实风险,尤其包括网络安全等领域,但不认同将人类灭绝风险作为当前AI发展的核心判断依据。
近期,前Anthropic和OpenAI研究员Jacob Coxon公开离职并警告前沿实验室正在竞相开发超级AI,引发新一轮AI安全争论。Anthropic CEO Dario Amodei和OpenAI CEO Sam Altman随后均提出应适当放缓前沿模型发展,并加强安全措施。吴恩达早年曾与两人共事。
与“减速”主张不同,吴恩达认为行业应继续推进AI发展,同时通过受控测试、工程防护和迭代改进解决可验证的安全问题,并让AI更多应用于能够产生社会价值的场景。当前,AI安全讨论正从模型能力边界进一步延伸至网络安全、代理失控、对齐及前沿模型治理等具体问题。
via AI新闻资讯 (author: AI Base)
白帽黑客用 Claude 攻破 OpenAI 员工 ChatGPT 账户,拿到 6500 美元赏金
据《华尔街日报》9 月 18 日报道,独立安全研究人员利用 Anthropic Claude 成功入侵了一名 OpenAI 员工的 ChatGPT 账户,得以获取该公司私有软件代码库的文档。
涉事团队来自安全公司 Hacktron AI,此前曾参与 OpenAI 的漏洞赏金计划。团队发现漏洞后迅速向 OpenAI 报告,OpenAI 随后支付了 6500 美元(约合 43692 元人民币)赏金。
漏洞在 Discourse,token 竟然在 ChatGPT 上有效
此次入侵始于 7 月 23 日。Hacktron 研究人员当天发现了 Discourse 处理特定图像文件方式的漏洞,并使用面向合格网络安全从业者提供的 Claude Opus 4.8 特殊版本,要求其编写利用该漏洞的攻击代码——首次尝试未成功;当晚 Anthropic 发布 Opus 5,次日 Claude 便找到了利用方法。
被利用的漏洞编号为 CVE-2026-45788,属于 Discourse 安全上传功能中的无限制上传漏洞,攻击者可在知晓受保护上传 URL 的情况下暴露安全上传内容,无需身份验证即可远程发起攻击。Discourse 称已于 7 月 25 日接到通知当天修复。
攻击使研究人员得以访问托管 OpenAI 论坛的 Discourse 服务器并获取账户登录 token。让他们没想到的是,这些 token 在 ChatGPT 上竟然有效,其中包括 OpenAI 员工的账户,还可用于访问 OpenAI 的 GitHub 服务。
研究人员因此能读取名为“Monorepo”的大型软件仓库中的文件。据知情人士透露,Monorepo 是 OpenAI 存放算法机密的仓库,用于使模型更快更高效,但不包含模型权重。他们在意识到可访问敏感数据后停止了攻击,此前已提交了一个带有“Hacktron AI Team PoC”字样的文档修改请求作为证明(未被接受)。
“我们只是三个有 Claude 和 Codex 订阅的人”
Hacktron AI 首席技术官 Mohan Pedhapati 表示,此次攻击表明由国家支持的高级网络团队确有真实机会窥探美国 AI 机密:“我不觉得我们比他国威胁者更聪明。我们只是三个拥有 Claude 和 Codex 订阅的人。”
OpenAI 确认黑客发现了两处问题:一处位于 Discourse,另一处涉及 OpenAI 自身,目前均已解决。OpenAI 表示已缩小社区登录 token 权限范围并撤销受影响 token 和会话,Anthropic 发言人则拒绝置评。
via AI新闻资讯 (author: AI Base)
据《华尔街日报》9 月 18 日报道,独立安全研究人员利用 Anthropic Claude 成功入侵了一名 OpenAI 员工的 ChatGPT 账户,得以获取该公司私有软件代码库的文档。
涉事团队来自安全公司 Hacktron AI,此前曾参与 OpenAI 的漏洞赏金计划。团队发现漏洞后迅速向 OpenAI 报告,OpenAI 随后支付了 6500 美元(约合 43692 元人民币)赏金。
漏洞在 Discourse,token 竟然在 ChatGPT 上有效
此次入侵始于 7 月 23 日。Hacktron 研究人员当天发现了 Discourse 处理特定图像文件方式的漏洞,并使用面向合格网络安全从业者提供的 Claude Opus 4.8 特殊版本,要求其编写利用该漏洞的攻击代码——首次尝试未成功;当晚 Anthropic 发布 Opus 5,次日 Claude 便找到了利用方法。
被利用的漏洞编号为 CVE-2026-45788,属于 Discourse 安全上传功能中的无限制上传漏洞,攻击者可在知晓受保护上传 URL 的情况下暴露安全上传内容,无需身份验证即可远程发起攻击。Discourse 称已于 7 月 25 日接到通知当天修复。
攻击使研究人员得以访问托管 OpenAI 论坛的 Discourse 服务器并获取账户登录 token。让他们没想到的是,这些 token 在 ChatGPT 上竟然有效,其中包括 OpenAI 员工的账户,还可用于访问 OpenAI 的 GitHub 服务。
研究人员因此能读取名为“Monorepo”的大型软件仓库中的文件。据知情人士透露,Monorepo 是 OpenAI 存放算法机密的仓库,用于使模型更快更高效,但不包含模型权重。他们在意识到可访问敏感数据后停止了攻击,此前已提交了一个带有“Hacktron AI Team PoC”字样的文档修改请求作为证明(未被接受)。
“我们只是三个有 Claude 和 Codex 订阅的人”
Hacktron AI 首席技术官 Mohan Pedhapati 表示,此次攻击表明由国家支持的高级网络团队确有真实机会窥探美国 AI 机密:“我不觉得我们比他国威胁者更聪明。我们只是三个拥有 Claude 和 Codex 订阅的人。”
OpenAI 确认黑客发现了两处问题:一处位于 Discourse,另一处涉及 OpenAI 自身,目前均已解决。OpenAI 表示已缩小社区登录 token 权限范围并撤销受影响 token 和会话,Anthropic 发言人则拒绝置评。
via AI新闻资讯 (author: AI Base)