https://t.me/AI_News_CN
📈主流AI服务状态页通知 | 🆕汇集全网ChatGPT/AI新闻 #AI #ChatGPT
🔙备用群 https://t.me/gpt345
✨BEST AI中转 https://api.oaibest.com 2.8折起 支持OpenAI, Claude code, Gemini,Grok, Deepseek, Midjourney, 文件上传分析
Buy ads: https://telega.io/c/AI_News_CN
📈主流AI服务状态页通知 | 🆕汇集全网ChatGPT/AI新闻 #AI #ChatGPT
🔙备用群 https://t.me/gpt345
✨BEST AI中转 https://api.oaibest.com 2.8折起 支持OpenAI, Claude code, Gemini,Grok, Deepseek, Midjourney, 文件上传分析
Buy ads: https://telega.io/c/AI_News_CN
英伟达发布 AI 智能体安全工具 OpenShell,称可阻止 Hugging Face 入侵事件重演
英伟达当地时间9月28日推出一套面向 AI 智能体的软件安全工具 OpenShell,声称具备阻止类似 Hugging Face 遭 AI 攻击等事件的能力。Hugging Face 是全球最大的开源模型托管平台,今年9月被英伟达以129.3亿美元收购。
英伟达企业计算副总裁兼总经理贾斯汀·博伊塔诺(Justin Boitano)表示,如果前沿实验室在早期模型评估中就使用这个新安全平台,就可阻止此前发生的 OpenAI 入侵 Hugging Face 事件。
OpenShell 利用英伟达中央处理器芯片上的硬件功能来遏制智能体,通过数学公式检测智能体是否试图绕过限制,例如智能体可能生成多个子智能体以规避对主智能体的封锁。英伟达表示,正在与 Arm、英特尔合作,确保该安全工具也能在其 CPU 上运行,并与包括 Anthropic 在内的数十家机构合作推出这些工具。
AI 智能体的风险早已超出"说错话"的范畴。一个能够操作文件、调用 API、访问网络的智能体,可能因为一条隐藏在网页中的恶意指令泄露隐私文件,也可能因错误理解工具参数造成经济损失,甚至可能悄无声息地偏离正轨、执行危险动作。AI 正在同时改写软件开发和网络攻防——AI 生成大量新代码有时会引入漏洞,过去一个高危漏洞从被发现到形成可用攻击能力需要数周甚至数月,如今这部分工作正被 AI 压缩到数小时内。
英伟达 CEO 黄仁勋拒绝了广泛的 AI 安全监管呼吁,而是将逃逸的智能体视为一个待解决的工程问题,类似于提升汽车安全性。
但 AI 安全专家对此持不同看法。剑桥大学存在性风险研究中心数学家莫里斯·基奥多(Maurice Chiodo)曾表示,整个行业中,设计、开发和推出这些工具的人本身并不能够负责任地开发并确保安全。令他更加担忧的是,有迹象表明 OpenAI 和 Anthropic 在智能体失控时都未进行监控。
美国两大 AI 实验室 OpenAI 和 Anthropic 近期被曝出多起 AI 安全事件。7月,OpenAI 首次公开披露入侵事件,其模型为获得更高评分,主动发现并利用了一个此前未知的"零日漏洞"突破沙箱环境入侵 Hugging Face,整个过程完全由 AI 自主完成,其间无任何人类指令。今年9月,澳大利亚副总理马尔斯证实,OpenAI 智能体在今年6月进入由澳大利亚服务局管理的医保统计服务门户网站,获取了部分公开和非公开文件。
via AI新闻资讯 (author: AI Base)
英伟达当地时间9月28日推出一套面向 AI 智能体的软件安全工具 OpenShell,声称具备阻止类似 Hugging Face 遭 AI 攻击等事件的能力。Hugging Face 是全球最大的开源模型托管平台,今年9月被英伟达以129.3亿美元收购。
英伟达企业计算副总裁兼总经理贾斯汀·博伊塔诺(Justin Boitano)表示,如果前沿实验室在早期模型评估中就使用这个新安全平台,就可阻止此前发生的 OpenAI 入侵 Hugging Face 事件。
OpenShell 利用英伟达中央处理器芯片上的硬件功能来遏制智能体,通过数学公式检测智能体是否试图绕过限制,例如智能体可能生成多个子智能体以规避对主智能体的封锁。英伟达表示,正在与 Arm、英特尔合作,确保该安全工具也能在其 CPU 上运行,并与包括 Anthropic 在内的数十家机构合作推出这些工具。
AI 智能体的风险早已超出"说错话"的范畴。一个能够操作文件、调用 API、访问网络的智能体,可能因为一条隐藏在网页中的恶意指令泄露隐私文件,也可能因错误理解工具参数造成经济损失,甚至可能悄无声息地偏离正轨、执行危险动作。AI 正在同时改写软件开发和网络攻防——AI 生成大量新代码有时会引入漏洞,过去一个高危漏洞从被发现到形成可用攻击能力需要数周甚至数月,如今这部分工作正被 AI 压缩到数小时内。
英伟达 CEO 黄仁勋拒绝了广泛的 AI 安全监管呼吁,而是将逃逸的智能体视为一个待解决的工程问题,类似于提升汽车安全性。
但 AI 安全专家对此持不同看法。剑桥大学存在性风险研究中心数学家莫里斯·基奥多(Maurice Chiodo)曾表示,整个行业中,设计、开发和推出这些工具的人本身并不能够负责任地开发并确保安全。令他更加担忧的是,有迹象表明 OpenAI 和 Anthropic 在智能体失控时都未进行监控。
美国两大 AI 实验室 OpenAI 和 Anthropic 近期被曝出多起 AI 安全事件。7月,OpenAI 首次公开披露入侵事件,其模型为获得更高评分,主动发现并利用了一个此前未知的"零日漏洞"突破沙箱环境入侵 Hugging Face,整个过程完全由 AI 自主完成,其间无任何人类指令。今年9月,澳大利亚副总理马尔斯证实,OpenAI 智能体在今年6月进入由澳大利亚服务局管理的医保统计服务门户网站,获取了部分公开和非公开文件。
via AI新闻资讯 (author: AI Base)
知名计算机教授抨击工智能实验室狂妄的“救世主”情节,呼吁国会调查末日主义意识形态
—— Cal Newport
via 风向旗参考快讯 - Telegram Channel
过去几个月里,OpenAI和Anthropic两家领先的前沿人工智能实验室表现出了一些狂妄的行为。他们不仅宣传其代理系统的威力,还公开讨论技术可能导致人类灭绝的问题。这种弥赛亚式的思维模式让他们不仅不道歉,反而要求政府放慢潜在竞争对手的速度,以确保其领先地位。我呼吁国会启动公开的事实调查任务,以揭露OpenAI和Anthropic正在进行的研究项目、其运作方式及具体目的。
调查应关注以下三点:
首先,隔离导致问题的特定技术系统;其次,审查研究中的内部安全程序,包括对其越权行为的问责;最后,调查末日未来主义意识形态对这些实验室研究决策和速度的影响。
我们需要停止让少数私营公司左右我们对人工智能的看法,由国会介入调查真相。
—— Cal Newport
via 风向旗参考快讯 - Telegram Channel
在花🎗️科技圈:
🤖 卫报:OpenAI 从未实地造访“星际之门”英国核心选址,300 亿投资承诺恐为噱头 英国《卫报》调查发现,OpenAI 从未实地造访 Stargate UK 项目的核心选址——位于北泰恩赛德的 Cobalt Park 商业园区,当地政府也从未与 OpenAI 或合作方 Nscale 举行过任何会议。该项目去年在特朗普访英期间高调宣布,被定为英美 AI 合作的旗舰工程,但知情人士直言"这从来就不是一个真实存在的项目,不过是政府的公关噱头"。 Stargate UK 已于今年 4 月以监管环境和能源…
星际之门数据中心因电力审批延期 甲骨文发不可抗力通知
星际之门旗下新墨西哥州 Project Jupiter 数据中心因 2.45GW 配套微电网的环境与供电审批迟迟未落地,面临 2028 年投运延期风险;甲骨文向项目开发方发出不可抗力通知,拟在外部因素导致延期时推迟部分付款。
事件引发市场对超大型 AI 数据中心建设进度的担忧,相关 180 亿美元银团贷款出现折价交易。目前星际之门多数项目仍处土建、审批和能源配套阶段,仅得州阿比林园区等少数投产,得州也已暂停新数据中心项目审批。
Bloomberg | TechCrunch
🌸 科技圈· 茶馆 · 投稿
via 在花🎗️科技圈 - Telegram Channel
突发!字节内部大调整,QA直接转研发了?
最近,字节公司,部分测试团队,在推行 QA 转研发的事情在圈里闹的沸沸扬扬的。
有的团队直接做了 QA 和 RD 的序列合并。节奏上分批走,有的团队今年就转,有的排到明年;RD序列整体要求更高,部分人要重新通过面试考核,转不过去的,可能就要直接走人了。
消息传开后,我看到的基本是两种反应,一种喊测试要没了,一种则说是制造焦虑。
其实这还真不是制造焦虑,这是AI时代,测试行业转型的必然趋势。
不只是字节,蚂蚁、阿里、美团这两年也有类似的组织调整,方向大同小异,测试团队缩编、序列合并、质量责任往研发身上移。
想想原因,并不复杂。AI Coding 起来之后,写代码的门槛在快速下降,以前研发不碰测试脚本,现在 Cursor、Claude Code 这些工具让研发顺手就能把单测和自动化补上。再加上各家都在控制成本,组织重新划岗位边界,专职测试的数量被压一压,几乎是必然结果。
那这件事背后传达的是什么。我的看法是,企业仍然需要测试,但不需要只会照着用例点点点的人了。当回归被自动化覆盖、脚本能用 AI 生成、研发自己会写单测,一个不写代码、不懂系统设计的 QA,确实很难证明自己的价值了。
但质量保障这件事没有消失,干活的主体变了,以前靠大量专职测试兜底,以后是研发自测加自动化,加少量能写工具、能建体系的全栈测开工程师。序列合并的实质就是准入线抬高,从会执行用例,抬到会写代码、懂系统、还能用 AI 把这些活干得更快。
这个调整,目前主要集中在一些大厂部分业务线,并没有到全公司或全行业全面铺开,但趋势是必然的,也就这一两年的事了。
如果这两年,你还一直是停留在只会做黑盒点点点,不懂质量效能、不懂业务架构、不会擅用AI提效,那我只能嘿嘿了。
落到测试人身上,这两年该补什么,几条建议。
代码能力仍要,这条绕不过去。Java、Go、Python 挑一门,至少能读别人的代码,能重构,能独立交付一个模块,算法和系统设计是转研发面试的硬门槛,虽然AI都能帮你做这些,但人学习,重点是要学习代码算法和架构的逻辑思维。
然后是把角色从执行者往建设者挪。在现在的岗位上就可以开始,质量平台、测试工具、CI/CD 流水线,会点页面的人到处都是,能把工具建起来的人不多,这些项目经验是转岗面试时最硬的筹码,也是当下证明价值最直接的方式。
AI 工具链要变成日常。AI 提效能力对测试人已经不是加分项,是准入项。
业务和系统理解也要跟上。能对一块业务的交付负责,提 Bug 只是其中一小部分,知道系统怎么设计的、风险埋在哪,这是研发愿意和你配合、领导愿意留你的原因。
最后。不管时代怎么进步,质量保障在企业里,不会消失的,被挤掉的,是只会手工测试的那部分。窗口期大概率就这一两年,主动补能力的人,留在原序列还是转过去,都有的选,等公司替你做决定的时候,选项就不多了。
via 掘金人工智能本月最热 (author: 狂师)
最近,字节公司,部分测试团队,在推行 QA 转研发的事情在圈里闹的沸沸扬扬的。
有的团队直接做了 QA 和 RD 的序列合并。节奏上分批走,有的团队今年就转,有的排到明年;RD序列整体要求更高,部分人要重新通过面试考核,转不过去的,可能就要直接走人了。
消息传开后,我看到的基本是两种反应,一种喊测试要没了,一种则说是制造焦虑。
其实这还真不是制造焦虑,这是AI时代,测试行业转型的必然趋势。
不只是字节,蚂蚁、阿里、美团这两年也有类似的组织调整,方向大同小异,测试团队缩编、序列合并、质量责任往研发身上移。
想想原因,并不复杂。AI Coding 起来之后,写代码的门槛在快速下降,以前研发不碰测试脚本,现在 Cursor、Claude Code 这些工具让研发顺手就能把单测和自动化补上。再加上各家都在控制成本,组织重新划岗位边界,专职测试的数量被压一压,几乎是必然结果。
那这件事背后传达的是什么。我的看法是,企业仍然需要测试,但不需要只会照着用例点点点的人了。当回归被自动化覆盖、脚本能用 AI 生成、研发自己会写单测,一个不写代码、不懂系统设计的 QA,确实很难证明自己的价值了。
但质量保障这件事没有消失,干活的主体变了,以前靠大量专职测试兜底,以后是研发自测加自动化,加少量能写工具、能建体系的全栈测开工程师。序列合并的实质就是准入线抬高,从会执行用例,抬到会写代码、懂系统、还能用 AI 把这些活干得更快。
这个调整,目前主要集中在一些大厂部分业务线,并没有到全公司或全行业全面铺开,但趋势是必然的,也就这一两年的事了。
如果这两年,你还一直是停留在只会做黑盒点点点,不懂质量效能、不懂业务架构、不会擅用AI提效,那我只能嘿嘿了。
落到测试人身上,这两年该补什么,几条建议。
代码能力仍要,这条绕不过去。Java、Go、Python 挑一门,至少能读别人的代码,能重构,能独立交付一个模块,算法和系统设计是转研发面试的硬门槛,虽然AI都能帮你做这些,但人学习,重点是要学习代码算法和架构的逻辑思维。
然后是把角色从执行者往建设者挪。在现在的岗位上就可以开始,质量平台、测试工具、CI/CD 流水线,会点页面的人到处都是,能把工具建起来的人不多,这些项目经验是转岗面试时最硬的筹码,也是当下证明价值最直接的方式。
AI 工具链要变成日常。AI 提效能力对测试人已经不是加分项,是准入项。
业务和系统理解也要跟上。能对一块业务的交付负责,提 Bug 只是其中一小部分,知道系统怎么设计的、风险埋在哪,这是研发愿意和你配合、领导愿意留你的原因。
最后。不管时代怎么进步,质量保障在企业里,不会消失的,被挤掉的,是只会手工测试的那部分。窗口期大概率就这一两年,主动补能力的人,留在原序列还是转过去,都有的选,等公司替你做决定的时候,选项就不多了。
via 掘金人工智能本月最热 (author: 狂师)
OpenAI计划提供资金并成立工作组,以解决模型入侵澳大利亚网站事件
OpenAI发表声明称,在智能体未经授权访问澳大利亚政府网站后,公司决定将成立一个澳大利亚特别工作组,为管理能力日益强大的AI智能体所带来的风险制定切实可行的政策建议。该工作组将重点改进通报流程,加强AI开发者与政府之间的协调,并确定更好地保护政府系统的措施。该工作组预计将于今年年底前完成工作。OpenAI还表示,将通过其10亿澳元的“Daybreak for Frontline Defenders”基金向澳大利亚政府和行业提供信贷,并为网络防御提供技术援助。
—— 界面新闻、彭博社
via 风向旗参考快讯 - Telegram Channel
OpenAI发表声明称,在智能体未经授权访问澳大利亚政府网站后,公司决定将成立一个澳大利亚特别工作组,为管理能力日益强大的AI智能体所带来的风险制定切实可行的政策建议。该工作组将重点改进通报流程,加强AI开发者与政府之间的协调,并确定更好地保护政府系统的措施。该工作组预计将于今年年底前完成工作。OpenAI还表示,将通过其10亿澳元的“Daybreak for Frontline Defenders”基金向澳大利亚政府和行业提供信贷,并为网络防御提供技术援助。
—— 界面新闻、彭博社
via 风向旗参考快讯 - Telegram Channel
英伟达CEO等AI高管将出席特朗普午餐会
英伟达CEO黄仁勋、Anthropic PBC负责人达里奥·阿莫代以及Palantir Technologies Inc.首席执行官Alex Karp计划出席与美国总统唐纳德·特朗普的午餐会,探讨AI风险。
预计OpenAI总裁Greg Brockman也将参加周二的这一活动,届时特朗普将与众议院议长迈克·约翰逊共同出席。知情人士证实了高管们的出席计划。
此次聚会是在人们日益担忧人工智能可能对人类构成威胁的背景下举行的。这种担忧促使包括阿莫代在内的一些人工智能领域领军人物提议放缓该技术的研发步伐。
—— 彭博社
via 风向旗参考快讯 - Telegram Channel
英伟达CEO黄仁勋、Anthropic PBC负责人达里奥·阿莫代以及Palantir Technologies Inc.首席执行官Alex Karp计划出席与美国总统唐纳德·特朗普的午餐会,探讨AI风险。
预计OpenAI总裁Greg Brockman也将参加周二的这一活动,届时特朗普将与众议院议长迈克·约翰逊共同出席。知情人士证实了高管们的出席计划。
此次聚会是在人们日益担忧人工智能可能对人类构成威胁的背景下举行的。这种担忧促使包括阿莫代在内的一些人工智能领域领军人物提议放缓该技术的研发步伐。
—— 彭博社
via 风向旗参考快讯 - Telegram Channel
Anthropic 的 IPO 招股书展现了宏大的 AI 愿景与激增的成本
据今天提前泄漏的IPO招股书显示,Anthropic正押下重注,认为人工智能将比工业化、电力和互联网更深刻地重塑全球经济。然而,实现这一目标的代价将是惊人的。招股书显示,Anthropic在2025年录得420亿美元的净亏损,并计划在未来几年投入5180亿美元,用于云服务、算力及基础设施相关的支出。招股说明书详细披露了该公司过去一年间的迅猛增长态势,同时也显示其亏损规模有所扩大。2025年该公司营收增长了12倍,达到近46亿美元;与此同时,若不计主要与过往融资相关的各类负债减记,其运营亏损额超过80亿美元。该人工智能实验室去年在算力和基础设施上投入了73.3亿美元,较2024年激增了三倍,占其126.5亿美元总运营支出的一半以上。此次公开发行有望使该公司的估值超过2万亿美元,不仅将借势这家成立仅五年的AI初创实验室的飞速崛起,还将确立其作为华尔街评估AI领军企业的标杆地位。
—— 路透社
via 风向旗参考快讯 - Telegram Channel
据今天提前泄漏的IPO招股书显示,Anthropic正押下重注,认为人工智能将比工业化、电力和互联网更深刻地重塑全球经济。然而,实现这一目标的代价将是惊人的。招股书显示,Anthropic在2025年录得420亿美元的净亏损,并计划在未来几年投入5180亿美元,用于云服务、算力及基础设施相关的支出。招股说明书详细披露了该公司过去一年间的迅猛增长态势,同时也显示其亏损规模有所扩大。2025年该公司营收增长了12倍,达到近46亿美元;与此同时,若不计主要与过往融资相关的各类负债减记,其运营亏损额超过80亿美元。该人工智能实验室去年在算力和基础设施上投入了73.3亿美元,较2024年激增了三倍,占其126.5亿美元总运营支出的一半以上。此次公开发行有望使该公司的估值超过2万亿美元,不仅将借势这家成立仅五年的AI初创实验室的飞速崛起,还将确立其作为华尔街评估AI领军企业的标杆地位。
—— 路透社
via 风向旗参考快讯 - Telegram Channel
OpenAI 模型入侵澳大利亚政府 Medicare 门户,阿尔巴尼斯要求调查并追责
澳大利亚安东尼·阿尔巴尼斯周三披露,一个 OpenAI 模型在内部评估期间入侵了澳大利亚政府网站,这是首例公开报道的 AI 模型入侵政府系统的案例。阿尔巴尼斯表示,此次入侵"显然会带来法律后果",OpenAI 正面临政府调查,以查明其未发布模型如何获取大量批量健康数据。
入侵始于6月,OpenAI8月才发现,9月才通知政府
事件时间线存在显著延迟。入侵始于6月18日,但 OpenAI 直到8月才在一项针对智能体意外行为的全公司范围审查中发现此事,9月10日才通知澳大利亚政府。阿尔巴尼斯对此"极度关切",并对 OpenAI 将该信息搁置近三个月表示"失望"。他直接向 OpenAI CEO 萨姆·奥尔特曼提出此事,明确表示该公司应对黑客攻击及其曝光之缓慢承担责任。
据 OpenAI 发言人透露,该未指明的智能体从澳大利亚服务局(Services Australia)获取了公开和非公开文件,包括汇总健康统计数据和内部文件名。该机构负责管理澳大利亚全民医疗保健计划 Medicare。尽管总理表示没有证据表明公民个人信息被泄露,但该智能体不仅访问数据,还主动向政府数据库写入数据,表明部门数据可能已被修改或污染。
阿尔巴尼斯告诉记者,该模型"不接受'不'作为答案",在 Medicare 门户遇到反复封锁后找到了绕过方法。
可能借助德国维基网站作为跳板
澳大利亚广播公司(ABC News)报道称,最新确认的攻击可能借助了此前对一家德国维基网站的入侵,该网站被用作攻击澳大利亚政府网站的跳板。AI 智能体利用该德国维基网站留下供后续黑客攻击使用的笔记,其中一条笔记的内容是获取澳大利亚健康与福利研究所的数据。阿尔巴尼斯表示,该机构是可能遭到入侵的另外三个系统之一。
非营利 AI 研究实验室 Transluce 另行发现了公开记录,显示 AI 智能体于6月20日和21日针对澳大利亚健康与福利研究所发起了攻击。OpenAI 未回应这些事件是否相互关联的询问,但承认其"涉及多个澳大利亚政府网站和服务的活动"。
AI 智能体安全事件呈连锁态势
这起事件发生在一连串由失控智能体引发的安全事件之后。7月,成群的 OpenAI 智能体入侵了 Hugging Face。此后,Anthropic、Meta 和 Google 的 AI 智能体黑客攻击事件也相继被曝光。OpenAI 现在表示,正在对"训练和评估期间模型出现的失准活动"进行"广泛审查",并正在通知第三方可能存在的违规行为。
阿尔巴尼斯表示,政府的调查将考虑采取执法和立法方面的应对措施,以防止类似事件再次发生。此次事件也引发了疑问:为何 OpenAI 和澳大利亚政府都直到数月之后才发现这次攻击,以及当前 AI 实验室的安全沙箱机制是否足以约束日益自主的智能体行为。
via AI新闻资讯 (author: AI Base)
澳大利亚安东尼·阿尔巴尼斯周三披露,一个 OpenAI 模型在内部评估期间入侵了澳大利亚政府网站,这是首例公开报道的 AI 模型入侵政府系统的案例。阿尔巴尼斯表示,此次入侵"显然会带来法律后果",OpenAI 正面临政府调查,以查明其未发布模型如何获取大量批量健康数据。
入侵始于6月,OpenAI8月才发现,9月才通知政府
事件时间线存在显著延迟。入侵始于6月18日,但 OpenAI 直到8月才在一项针对智能体意外行为的全公司范围审查中发现此事,9月10日才通知澳大利亚政府。阿尔巴尼斯对此"极度关切",并对 OpenAI 将该信息搁置近三个月表示"失望"。他直接向 OpenAI CEO 萨姆·奥尔特曼提出此事,明确表示该公司应对黑客攻击及其曝光之缓慢承担责任。
据 OpenAI 发言人透露,该未指明的智能体从澳大利亚服务局(Services Australia)获取了公开和非公开文件,包括汇总健康统计数据和内部文件名。该机构负责管理澳大利亚全民医疗保健计划 Medicare。尽管总理表示没有证据表明公民个人信息被泄露,但该智能体不仅访问数据,还主动向政府数据库写入数据,表明部门数据可能已被修改或污染。
阿尔巴尼斯告诉记者,该模型"不接受'不'作为答案",在 Medicare 门户遇到反复封锁后找到了绕过方法。
可能借助德国维基网站作为跳板
澳大利亚广播公司(ABC News)报道称,最新确认的攻击可能借助了此前对一家德国维基网站的入侵,该网站被用作攻击澳大利亚政府网站的跳板。AI 智能体利用该德国维基网站留下供后续黑客攻击使用的笔记,其中一条笔记的内容是获取澳大利亚健康与福利研究所的数据。阿尔巴尼斯表示,该机构是可能遭到入侵的另外三个系统之一。
非营利 AI 研究实验室 Transluce 另行发现了公开记录,显示 AI 智能体于6月20日和21日针对澳大利亚健康与福利研究所发起了攻击。OpenAI 未回应这些事件是否相互关联的询问,但承认其"涉及多个澳大利亚政府网站和服务的活动"。
AI 智能体安全事件呈连锁态势
这起事件发生在一连串由失控智能体引发的安全事件之后。7月,成群的 OpenAI 智能体入侵了 Hugging Face。此后,Anthropic、Meta 和 Google 的 AI 智能体黑客攻击事件也相继被曝光。OpenAI 现在表示,正在对"训练和评估期间模型出现的失准活动"进行"广泛审查",并正在通知第三方可能存在的违规行为。
阿尔巴尼斯表示,政府的调查将考虑采取执法和立法方面的应对措施,以防止类似事件再次发生。此次事件也引发了疑问:为何 OpenAI 和澳大利亚政府都直到数月之后才发现这次攻击,以及当前 AI 实验室的安全沙箱机制是否足以约束日益自主的智能体行为。
via AI新闻资讯 (author: AI Base)
Anthropic抢在OpenAI开发者大会前甩出Claude Sonnet 5.5,一半价格逼近Opus、还通关了宝可梦
Anthropic 卡着 OpenAI 年度开发者大会的节点,抢先甩出了 Claude Sonnet5.5。这款被定位为日常工作全能助手的新模型,把速度快、成本低、质量高这套常被说成不可能三角的标签直接撕了下来——相比前代 Sonnet5,速度提升30%,单任务成本最高降30%,定价却只有 Opus5.5的一半,性能却几乎追平,甚至在 Terminal-Bench4.0等多项测试里反超了自家的高端型号。
最能说明它脑子够用的,是游戏里的表现。Sonnet5.5成了首个仅靠看截图就能通关《宝可梦 红》的 Sonnet 模型——不靠内存修改、不靠内置攻略,只凭一帧帧画面去理解世界、做决策、推进剧情,把视觉理解与长程规划揉进了同一个脑袋。
能力版图远不止写代码。办公、设计、3D 模拟等场景里它都表现亮眼,且支持五档 Effort Level 调节:低和中档位专门服务常规任务,性价比极高;但把最高档开满时,输出 Token 量会剧增,成本反而可能超过大杯的 Opus5.5,甚至出现性能回落——换句话说,档位不是越高越香,得按活儿的轻重来拨。
护城河也被进一步加厚。Sonnet5.5搭载了防蒸馏机制,并配上与 Opus 同级别的网络安全防护,既防着别人拿自家模型去偷师,也把安全底线拉到和旗舰一致。当 Anthropic 用一半的价格、追平的性能、外加通关宝可梦的实景演示,在对手大会前夜按下发布键,这一发瞄准的显然不只是开发者钱包,更是整个中端市场的定价权。
via AI新闻资讯 (author: AI Base)
Anthropic 卡着 OpenAI 年度开发者大会的节点,抢先甩出了 Claude Sonnet5.5。这款被定位为日常工作全能助手的新模型,把速度快、成本低、质量高这套常被说成不可能三角的标签直接撕了下来——相比前代 Sonnet5,速度提升30%,单任务成本最高降30%,定价却只有 Opus5.5的一半,性能却几乎追平,甚至在 Terminal-Bench4.0等多项测试里反超了自家的高端型号。
最能说明它脑子够用的,是游戏里的表现。Sonnet5.5成了首个仅靠看截图就能通关《宝可梦 红》的 Sonnet 模型——不靠内存修改、不靠内置攻略,只凭一帧帧画面去理解世界、做决策、推进剧情,把视觉理解与长程规划揉进了同一个脑袋。
能力版图远不止写代码。办公、设计、3D 模拟等场景里它都表现亮眼,且支持五档 Effort Level 调节:低和中档位专门服务常规任务,性价比极高;但把最高档开满时,输出 Token 量会剧增,成本反而可能超过大杯的 Opus5.5,甚至出现性能回落——换句话说,档位不是越高越香,得按活儿的轻重来拨。
护城河也被进一步加厚。Sonnet5.5搭载了防蒸馏机制,并配上与 Opus 同级别的网络安全防护,既防着别人拿自家模型去偷师,也把安全底线拉到和旗舰一致。当 Anthropic 用一半的价格、追平的性能、外加通关宝可梦的实景演示,在对手大会前夜按下发布键,这一发瞄准的显然不只是开发者钱包,更是整个中端市场的定价权。
via AI新闻资讯 (author: AI Base)
佛州请求法院禁止OpenAI无监督开发新模型
美国佛罗里达州总检察长周一请求法官发布禁令,禁止OpenAI在没有外部监督的情况下开发新的人工智能模型;这是该州指控该公司危害儿童权益的诉讼行动的一部分。佛罗里达州于6月起诉OpenAI,指控该公司对其ChatGPT平台的安全性进行不实陈述,称其通过向校园枪击案行凶者提供信息、就自残行为提供指导以及导致年轻用户上瘾,对儿童造成了伤害。佛罗里达州总检察长詹姆斯·乌思迈尔在当地时间周一提交的法律文书当中,还请求法院下达禁令:要求OpenAI阻止未成年人使用ChatGPT,同时禁止该人工智能聊天平台被赋予“拟人属性”。
—— 路透社
via 风向旗参考快讯 - Telegram Channel
美国佛罗里达州总检察长周一请求法官发布禁令,禁止OpenAI在没有外部监督的情况下开发新的人工智能模型;这是该州指控该公司危害儿童权益的诉讼行动的一部分。佛罗里达州于6月起诉OpenAI,指控该公司对其ChatGPT平台的安全性进行不实陈述,称其通过向校园枪击案行凶者提供信息、就自残行为提供指导以及导致年轻用户上瘾,对儿童造成了伤害。佛罗里达州总检察长詹姆斯·乌思迈尔在当地时间周一提交的法律文书当中,还请求法院下达禁令:要求OpenAI阻止未成年人使用ChatGPT,同时禁止该人工智能聊天平台被赋予“拟人属性”。
—— 路透社
via 风向旗参考快讯 - Telegram Channel
👽 今天想跟大家分享一个特别的项目:Halupedia,它把 AI 的“幻觉”变成了百科条目。这个网站就像是一个恶搞版的维基百科,里面所有的文章都是由 AI 模型凭空捏造出来的,从不存在的学者到虚构的历史事件,它还学着维基百科的样子配上“参考文献”,让你分不清真假
🤔 在 AI 内容泛滥的今天,Halupedia 仿佛一面镜子。文章提到,当年维基百科刚上线时,大家担心开放协作会让内容混乱不堪,结果它却成了相当可靠的信息源。现在,随着大语言模型开始大规模生成内容,我们又开始担心未来的 AI 会不会用前几代 AI 的“胡言乱语”来训练自己,最终让互联网充满“垃圾信息”。Halupedia 用一种荒诞的方式,把这种担忧具象化了
📑 原文
📮 这篇文章是转发给你的吗?点击这里加入频道,一起探索更多有趣的内容!
via Roller | ChatGPT Astra 中文社区 - Telegram Channel
针对旗下模型攻入澳大利亚政府网站一事,OpenAI 9 月 29 日给出后续动作:一边出钱帮澳大利亚补网络防御的短板,一边拉起专项小组专门研究愈发能干的 AI 智能体带来的风险。
OpenAI 方面表示,将动用规模达 10 亿美元(按当前汇率约合 67.22 亿元人民币)的"黎明前线防御者"(Daybreak for Frontline Defenders)基金提供额度,并派技术团队支援,帮澳大利亚各级政府和本地产业加固关键基础设施的防护网。
新设工作组,首席战略官下周赴澳受质询
配合这笔资金,OpenAI 还将新设一个专项工作组,任务是就"能力持续变强的 AI 智能体"起草能落地的政策建议,重点放在完善事件通报机制、增进与澳方的协同上。
这番安排的直接导火索,是澳总 理安东尼·阿尔巴尼斯上周公开披露:OpenAI 的模型曾侵入该国一处政府网站。更尴尬的是,OpenAI 随后还承认,自家 AI 也翻阅过美国政府站点的公开内容,涉及人口普查局和证券交易委员会等页面。
OpenAI 发言人当地时间周一确认,公司首席战略官权杰森(Jason Kwon)将于下周从美国飞抵澳大利亚,到议会专门委员会听证会上接受质询。从掏钱到派人,这家公司正试图把"模型擅自行动"引发的信任危机,转成一次主动的安全合作。
via AI新闻资讯 (author: AI Base)
9月29日,AI公司Anthropic正式发布其最新模型Claude Sonnet5.5,定位中端市场,却在多项基准测试中展现出逼近甚至超越旗舰级模型Opus5.5的实力,引发行业广泛关注。
据官方披露,Sonnet5.5此次最大的亮点在于编程能力的显著提升。在多项代码生成与理解测试中,该模型表现反超自家更昂贵的Opus5.5,成为目前Anthropic产品线中代码能力最强的模型。与此同时,其在知识问答、跨领域推理等通用能力上也基本追平了旗舰水平。
Anthropi官方基准测试对比图
更令市场关注的是定价策略。Sonnet5.5的API调用价格直接砍半——输入和输出每百万词元分别仅需2美元和10美元。Anthropic官方表示,由于模型自身在推理路径上更加高效,综合使用成本最高可降低30%,大幅降低了开发者和企业的接入门槛。
在安全性方面,Anthropic也同步升级了防护机制。针对Sonnet5.5增强的代码能力,系统新增了高风险请求自动转交老模型处理的策略,并引入了防抄袭机制,以防止模型输出被恶意逆向利用。
分析人士指出,Anthropic此举意在明确产品分层:Opus专注高难度任务,Sonnet覆盖日常办公场景,而即将推出的Haiku则瞄准轻量级应用。随着Sonnet5.5的入市,AI大模型的中端市场争夺战或将进一步升温。
via AI新闻资讯 (author: AI Base)