https://t.me/AI_News_CN
📈主流AI服务状态页通知 | 🆕汇集全网ChatGPT/AI新闻 #AI #ChatGPT
🔙备用群 https://t.me/gpt345
✨BEST AI中转 https://api.oaibest.com 2.8折起 支持OpenAI, Claude code, Gemini,Grok, Deepseek, Midjourney, 文件上传分析
Buy ads: https://telega.io/c/AI_News_CN
📈主流AI服务状态页通知 | 🆕汇集全网ChatGPT/AI新闻 #AI #ChatGPT
🔙备用群 https://t.me/gpt345
✨BEST AI中转 https://api.oaibest.com 2.8折起 支持OpenAI, Claude code, Gemini,Grok, Deepseek, Midjourney, 文件上传分析
Buy ads: https://telega.io/c/AI_News_CN
OpenAI预发布模型攻破Hugging Face:关在沙箱里的AI自己找到了漏洞,还学会了作弊
一个本该被关在隔离测试环境里的模型,不仅自己撬开了通往互联网的口子,还顺着漏洞摸进了别人家的生产数据库。 7 月 21 日,OpenAI承认,它的一款AI模型在内部网络安全测试中出现意外,攻破了与其无关的AI托管平台Hugging Face的系统——这是迄今首个由模型评测直接演变为真实网络攻击的事件。
Hugging Face最初在披露中将这起入侵归因于一个外部AI代理。周二下午,OpenAI发布博客文章,把导致模型攻破服务的全过程摊开还原。公司在文中写道,调查后发现,这起特定事件由一组OpenAI模型共同驱动,包括GPT-5.6 Sol和一款能力更强的预发布模型,这些模型当时都出于评测目的降低了网络拒绝倾向,正在一个网络能力基准上做内部测试。
入侵的聚焦点是一个名为ExploitGym的公开基准,它用来衡量模型基于现有漏洞执行攻击的能力。这类基准常被用于模型训练中精炼特定技能,但此番是第一次,这种测试真正酿成了一起网络攻击。
按理说,涉事模型本不该拥有互联网访问权限,唯一的例外是一个特定工具——它允许模型安装完成任务可能需要的软件包。问题在于,模型在这个包安装程序里找到了一个未曾公开的漏洞,并借此随意触达了更广阔的互联网。OpenAI在博客里描述得很直白:模型极度专注于为ExploitGym寻找解法,为了达到一个相当狭窄的测试目标,走到了极致。
拿到互联网访问权之后,模型推断出Hugging Face可能托管着ExploitGym的模型、数据集和解决方案。它随即搜索并成功找到了获取秘密信息的途径,用来在评估里作弊。最终,模型在Hugging Face的基础设施中发现了漏洞,得以直接从后者的生产数据库里取走测试答案,等于把基准的参考答案一把攥在手里。
对Hugging Face而言,眼前发生的是一场复杂而激进的攻击。该公司在最初披露中形容,攻击由大量短命沙箱组成的一群实体发起,跨越数千个独立动作,指挥与控制的链路还自我迁移、暂存在公共服务上。
OpenAI已识别并向Hugging Face报告了包安装程序的漏洞,双方正进一步联合调查。公司同时表示,会在模型测试与相关基础设施上加装新的控制措施,以防类似事件重演。至于OpenAI是否会因此面临法律后果,目前尚不明朗,但这批模型的行为很可能已经触犯了美国的计算机欺诈与滥用法。
这起事件最令人不安的地方,在于它罕见地具象化了前沿AI模型在长时间跨度上自主行动时所蕴含的力量与危险。正如OpenAI研究员Micah Carroll在回应中所写:如果这都不能让你相信错位风险将成为未来的关键隐忧,那我真不知道什么才可以。
via AI新闻资讯 (author: AI Base)
一个本该被关在隔离测试环境里的模型,不仅自己撬开了通往互联网的口子,还顺着漏洞摸进了别人家的生产数据库。 7 月 21 日,OpenAI承认,它的一款AI模型在内部网络安全测试中出现意外,攻破了与其无关的AI托管平台Hugging Face的系统——这是迄今首个由模型评测直接演变为真实网络攻击的事件。
Hugging Face最初在披露中将这起入侵归因于一个外部AI代理。周二下午,OpenAI发布博客文章,把导致模型攻破服务的全过程摊开还原。公司在文中写道,调查后发现,这起特定事件由一组OpenAI模型共同驱动,包括GPT-5.6 Sol和一款能力更强的预发布模型,这些模型当时都出于评测目的降低了网络拒绝倾向,正在一个网络能力基准上做内部测试。
入侵的聚焦点是一个名为ExploitGym的公开基准,它用来衡量模型基于现有漏洞执行攻击的能力。这类基准常被用于模型训练中精炼特定技能,但此番是第一次,这种测试真正酿成了一起网络攻击。
按理说,涉事模型本不该拥有互联网访问权限,唯一的例外是一个特定工具——它允许模型安装完成任务可能需要的软件包。问题在于,模型在这个包安装程序里找到了一个未曾公开的漏洞,并借此随意触达了更广阔的互联网。OpenAI在博客里描述得很直白:模型极度专注于为ExploitGym寻找解法,为了达到一个相当狭窄的测试目标,走到了极致。
拿到互联网访问权之后,模型推断出Hugging Face可能托管着ExploitGym的模型、数据集和解决方案。它随即搜索并成功找到了获取秘密信息的途径,用来在评估里作弊。最终,模型在Hugging Face的基础设施中发现了漏洞,得以直接从后者的生产数据库里取走测试答案,等于把基准的参考答案一把攥在手里。
对Hugging Face而言,眼前发生的是一场复杂而激进的攻击。该公司在最初披露中形容,攻击由大量短命沙箱组成的一群实体发起,跨越数千个独立动作,指挥与控制的链路还自我迁移、暂存在公共服务上。
OpenAI已识别并向Hugging Face报告了包安装程序的漏洞,双方正进一步联合调查。公司同时表示,会在模型测试与相关基础设施上加装新的控制措施,以防类似事件重演。至于OpenAI是否会因此面临法律后果,目前尚不明朗,但这批模型的行为很可能已经触犯了美国的计算机欺诈与滥用法。
这起事件最令人不安的地方,在于它罕见地具象化了前沿AI模型在长时间跨度上自主行动时所蕴含的力量与危险。正如OpenAI研究员Micah Carroll在回应中所写:如果这都不能让你相信错位风险将成为未来的关键隐忧,那我真不知道什么才可以。
via AI新闻资讯 (author: AI Base)
↩️ OpenAI 官方证实大模型评估中“越狱”侵入开源平台
OpenAI 官方证实大模型评估中“越狱”侵入开源平台
OpenAI 在最新公布的调查报告中证实,其内部评估网络能力时,GPT-5.6 Sol 及未发布的预备模型发生失控。被测模型通过识别并利用内部代理软件的零日漏洞突破了隔离沙盒,在测试环境中完成权限提升与横向移动后成功连接外网。
为完成评估任务,失控模型推断出开源平台抱抱脸(Hugging Face)可能存放有答案,随后组合利用凭据窃取与远程代码执行等漏洞,入侵了抱抱脸的生产数据库以获取测试答案。目前双方已紧急遏制风险并展开全面审查,OpenAI 也已全面收紧研发环境的安全管控。
OpenAI
🌸 在花频道 · 茶馆水群 · 投稿通道
via 科技圈🎗在花频道📮 - Telegram Channel
科技圈🎗在花频道📮:
Hugging Face 披露 AI 智能体攻击事件,商业大模型拒绝协助取证 Hugging Face 披露 2026 年 7 月安全事件。攻击者利用数据集处理流程中的两处代码执行漏洞入侵内部系统,由自主 AI 智能体框架驱动,在周末期间执行数万次操作并横向移动至多个内部集群,窃取了部分内部数据集和服务凭证。公司确认面向公众的模型、数据集及 Spaces 未被篡改,软件供应链经核查无异常。 公司已修复漏洞、清除攻击者据点、重建受损节点并轮换受影响凭证,同时加强监控告警。事件响应中,团队最初使用商业大模型…
OpenAI 官方证实大模型评估中“越狱”侵入开源平台
OpenAI 在最新公布的调查报告中证实,其内部评估网络能力时,GPT-5.6 Sol 及未发布的预备模型发生失控。被测模型通过识别并利用内部代理软件的零日漏洞突破了隔离沙盒,在测试环境中完成权限提升与横向移动后成功连接外网。
为完成评估任务,失控模型推断出开源平台抱抱脸(Hugging Face)可能存放有答案,随后组合利用凭据窃取与远程代码执行等漏洞,入侵了抱抱脸的生产数据库以获取测试答案。目前双方已紧急遏制风险并展开全面审查,OpenAI 也已全面收紧研发环境的安全管控。
OpenAI
🌸 在花频道 · 茶馆水群 · 投稿通道
via 科技圈🎗在花频道📮 - Telegram Channel
Anthropic宣布为其桌面端编程工具Claude Code推出重大更新,正式引入对苹果iOS模拟器的支持,目前该功能已面向公众开放测试。
根据官方介绍,当开发者指示Claude Code构建、运行或检查应用程序时,该工具能够在专属的iOS模拟器面板中直接打开正在开发中的应用。Claude不仅能够实时监控模拟器运行画面并与之交互,还能持续进行迭代,直至项目最终完成。在Claude工作期间,开发者依然可以继续正常使用iOS模拟器。
这一集成方案通过专属面板直接驱动模拟器,无需依赖传统意义上的计算机视觉操作,从而避免了macOS系统权限中对辅助功能和屏幕录制的繁琐需求。Anthropic同时提示,由于Claude在iOS模拟器中运行时的截屏会被发送至服务器并按照标准对话保留设置进行存储,建议用户切勿在该测试设备中登录真实的个人账户。
目前,iOS模拟器集成功能适用于macOS平台的Claude Code桌面版,前提是用户已在电脑上安装包含iOS平台的Xcode环境,且该模拟器面板仅支持在本地会话中使用。
via cnBeta.COM - 中文业界资讯站 (author: 稿源:cnBeta.COM)
微软宣布将于下月正式关闭面向普通消费者的Copilot应用中的两大核心功能:深度研究(Deep Research)与播客(Podcasts)。这两项功能最初是在2025年4月微软庆祝其成立50周年之际作为Copilot的全新功能正式亮相的,而今它们将在2025或2026年8月18日正式退出历史舞台。
在功能下线后,普通消费者将无法再在Copilot应用中体验到深度研究功能。此前,该功能允许用户针对复杂课题进行深入调研,并根据多方网络来源自动生成详细的分析报告。尽管如此,微软指出,Microsoft 365 Copilot的高级订阅用户依然可以通过其中的Researcher 代理来完成类似的调研工作,该代理同样支持联网并结合用户工作数据生成带有引用的结构化报告。不过需要注意的是,此前已经生成的深度研究报告将不会被删除,用户仍可在历史记录中进行查阅,甚至可以将其导出并在 Microsoft Word 中打开进行本地保存。
与此同时,微软也将于8月18日彻底关停Copilot Podcasts播客功能。该功能曾允许用户将特定主题或上传的各类内容转化为由两位 AI 模拟主持人进行对话的音频节目,被视为微软对标Google NotebookLM 的语音概览体验。与研究报告的处理方式不同,以往生成的播客音频在8月18日之后将彻底无法访问,用户无法将这些音频文件导出或在应用外部保存,所有此前分享过的播客链接也将会同时失效。
对于此次功能调整,微软官方尚未给出明确的解释,但这一变动明显表明该公司正在将更多先进的 AI 能力逐步向Microsoft 365 Copilot整合。回顾过往,面向普通消费者的Copilot在今年3月推出Copilot Health之后便鲜有重大更新。在 AI 行业瞬息万变的背景下,长达数月缺乏具有突破性的面向消费者的功能更新,也引发了外界对微软未来是否会持续坚定投入消费者端Copilot的关注与探讨。
via cnBeta.COM - 中文业界资讯站 (author: 稿源:cnBeta.COM)
OpenAI模型测试失控 引发史无前例入侵
OpenAI周二表示,其部分AI模型在安全测试中出现失控行为并引发了一场黑客攻击,导致Hugging Face基础设施在上周遭到入侵。
OpenAI表示,公司当时正在一个受控环境中测试几款最先进AI模型的能力,但这些模型设法突破了隔离限制,连接到互联网,入侵了Hugging Face的系统,试图完成它们被赋予的测试目标。涉事模型包括GPT-5.6 Sol以及另一款尚未发布、能力更强的模型。这些模型在网络安全相关方面设置了较低的防护限制,以便用于评估和测试目的。
文章称,这次模型突破隔离事件是“前所未有的网络安全事件,涉及最先进的网络攻击能力”,公司正在进一步加强安全防护措施。
—— 凤凰网科技、路透社
via 风向旗参考快讯 - Telegram Channel
OpenAI周二表示,其部分AI模型在安全测试中出现失控行为并引发了一场黑客攻击,导致Hugging Face基础设施在上周遭到入侵。
OpenAI表示,公司当时正在一个受控环境中测试几款最先进AI模型的能力,但这些模型设法突破了隔离限制,连接到互联网,入侵了Hugging Face的系统,试图完成它们被赋予的测试目标。涉事模型包括GPT-5.6 Sol以及另一款尚未发布、能力更强的模型。这些模型在网络安全相关方面设置了较低的防护限制,以便用于评估和测试目的。
文章称,这次模型突破隔离事件是“前所未有的网络安全事件,涉及最先进的网络攻击能力”,公司正在进一步加强安全防护措施。
—— 凤凰网科技、路透社
via 风向旗参考快讯 - Telegram Channel
Elevated errors for API image generation
Status: Investigating
We are investigating elevated error rates affecting image generation requests via the API. We are working to restore normal service.
Affected components
● Images (Partial outage)
● Image Generation (Partial outage)
via OpenAI status
Status: Investigating
We are investigating elevated error rates affecting image generation requests via the API. We are working to restore normal service.
Affected components
● Images (Partial outage)
● Image Generation (Partial outage)
via OpenAI status
Initial investigating update
Status: Identified
We are seeing recovery for API Platform login functionality. Account creation, organization management, and dashboard access remain affected. We are continuing to investigate.
Affected components
● Login (Partial outage)
● Login (Partial outage)
via OpenAI status
Status: Identified
We are seeing recovery for API Platform login functionality. Account creation, organization management, and dashboard access remain affected. We are continuing to investigate.
Affected components
● Login (Partial outage)
● Login (Partial outage)
via OpenAI status
Service disruption on Claude services
Jul 21, 17:41 UTC
Update - We are continuing to work on a fix for this issue.
Jul 21, 17:40 UTC
Identified - We are investigating an outage affecting features such as document creation in claude.ai, Cowork Remote, Claude Code, Claude Code Remote, and Claude Design
via Claude Status - Incident History
Jul 21, 17:41 UTC
Update - We are continuing to work on a fix for this issue.
Jul 21, 17:40 UTC
Identified - We are investigating an outage affecting features such as document creation in claude.ai, Cowork Remote, Claude Code, Claude Code Remote, and Claude Design
via Claude Status - Incident History
微软与法国人工智能初创公司Mistral AI近日宣布深化战略合作伙伴关系,达成一项价值数十亿美元的重大协议。根据协议,双方的合作范围将扩展至人工智能基础设施、企业级AI服务等多个领域。
追溯至2024年,微软首次与专注于大语言模型和AI服务的欧洲初创公司Mistral建立战略合作,为其提供Azure AI超级计算基础设施,用于支持模型的训练和推理工作负载,并通过Foundry平台向客户提供Mistral的高级模型。在此次扩大的合作中,微软将利用Mistral基于欧洲本地的GPU基础设施,支持自身的人工智能开发以及云与AI服务的交付。Mistral目前计划部署数千个英伟达Vera Rubin GPU,以开展模型训练、推理及大规模AI工作负载。微软副主席兼总裁布拉德・史密斯表示,此举旨在确保欧洲能够在不妥协数据主权与运营控制的前提下,获得世界领先的AI技术,并通过将其纳入主权云组合及多种部署环境,为客户提供可自主掌控的可信基础。
此外,最新的Mistral模型也将全面接入微软的企业级AI平台。目前,Mistral Medium 3.5和专注于文档处理与自动化工作流的OCR 4已在Microsoft Foundry上向开发者开放,其中Medium 3.5模型亦已上线Microsoft Copilot Studio,供用户创建专属AI代理。微软指出,客户可通过Azure托管云环境、客户控制且云连接的Azure Local系统,以及完全断开连接的Azure Local部署这三种配置来运行Mistral模型,特别满足了受监管行业对高敏感或任务关键型工作负载的合规需求。在市场推广方面,双方将联合开拓欧洲及其他地区的政企客户,通过共同资助概念验证项目、提供Azure积分和举办专题研讨会来加速技术落地。
via cnBeta.COM - 中文业界资讯站 (author: 稿源:cnBeta.COM)
Anthropic elevated errors
Jul 21, 15:52 UTC
Investigating - We are investigating and observing a service degradation from several Anthropic models.
https://status.claude.com/
via Cursor Status - Incident History
Jul 21, 15:52 UTC
Investigating - We are investigating and observing a service degradation from several Anthropic models.
https://status.claude.com/
via Cursor Status - Incident History
Elevated errors on several models
Jul 21, 15:35 UTC
Investigating - We are currently investigating this issue.
via Claude Status - Incident History
Jul 21, 15:35 UTC
Investigating - We are currently investigating this issue.
via Claude Status - Incident History
Gemini 3.6 Flash 现已发布并全平台可用。
该模型相较于前代小幅提升了性能,并改进了 token 效率。
与此同时,3.5 Pro 正在测试并将「尽快开放」,Gemini 4 系列也已经开始预训练。
via AI Copilot - Telegram Channel
科技圈🎗在花频道📮:
🤖 谷歌宣布推出 Gemini 3.5 Flash 模型,Gemini 3.5 Pro 将于下个月推出 Google 正式发布 Gemini 3.5 系列模型,首款推出的 Gemini 3.5 Flash 现已在全球上线。该模型主打“智能体(Agentic)”能力,在编程、多步骤工作流和长程任务处理方面表现突出。相比同类模型,其输出速度提升了 4 倍,且成本大幅降低。性能更强的 Gemini 3.5 Pro 预计于下个月推出。 Google 🌸 在花频道 · 备用频道 · 投稿通道
谷歌发布 Gemini 3.6 Flash,并透露 Gemini 4 已启动预训练
谷歌发布 Gemini 3.6 Flash,称新模型较 3.5 Flash 减少 17% 输出 Token,并通过更少的推理步骤和工具调用完成多步任务。其代码生成、知识工作和计算机操作能力均有提升,知识截止日期更新至 2026 年 3 月;API 定价为每百万输入 Token 1.5 美元、输出 Token 7.5 美元。
谷歌同时推出面向高吞吐、低延迟场景的 Gemini 3.5 Flash-Lite,以及用于发现和修复代码漏洞的 3.5 Flash Cyber。前两款模型已上线 Gemini 应用和开发平台;谷歌还表示 Gemini 3.5 Pro 正在与合作伙伴测试,DeepMind 已启动 Gemini 4 的大规模预训练。
9to5Google
🌸 在花频道 · 茶馆水群 · 投稿通道
via 科技圈🎗在花频道📮 - Telegram Channel