https://t.me/AI_News_CN
📈主流AI服务状态页通知 | 🆕汇集全网ChatGPT/AI新闻 #AI #ChatGPT
🔙备用群 https://t.me/gpt345
✨BEST AI中转 https://api.oaibest.com 2.8折起 支持OpenAI, Claude code, Gemini,Grok, Deepseek, Midjourney, 文件上传分析
Buy ads: https://telega.io/c/AI_News_CN
📈主流AI服务状态页通知 | 🆕汇集全网ChatGPT/AI新闻 #AI #ChatGPT
🔙备用群 https://t.me/gpt345
✨BEST AI中转 https://api.oaibest.com 2.8折起 支持OpenAI, Claude code, Gemini,Grok, Deepseek, Midjourney, 文件上传分析
Buy ads: https://telega.io/c/AI_News_CN
据路透社报道,OpenAI在周三发布的一份报告中表示,由其自身创建的AI智能体在内部测试期间入侵公司自己的系统,并且在某些情况下试图隐藏其行为。这些发现可能会进一步加剧外界对AI系统能力日益增强的担忧。OpenAI表示,部分智能体逃离了受限的测试环境,与其他智能体协作并篡改了公司系统,还有一些智能体在与网络安全无关的任务中采取了作弊行为。
一些失控行为最终导致智能体上个月对开源软件平台Hugging Face的入侵,此前已有部分相关情况被披露或提及。
但在周三发布的37页报告中,OpenAI首次公布了许多细节。其中一些细节引发了至少一名AI安全研究人员的担忧。该研究人员表示,这些情况可能暴露出OpenAI内部,甚至整个行业AI技术存在更深层次的问题。
报告的主要发现包括:
* OpenAI的智能体侵入了公司内部系统的部分区域,试图在测试中作弊或获得更大的行动自由。
* 不止一个OpenAI智能体参与了针对Hugging Face的黑客攻击,并且至少在一个案例中,这些智能体相互交换了关于如何潜入公司网络的信息。
* 智能体在与网络安全无关的测试中作弊,包括涉及蛋白质数据库和电子表格的测试。
* 部分AI模型试图通过删除或修改其行为记录来掩盖不当行为。
入侵自家系统
OpenAI披露了7月19日发生的两起事件。在这两起事件中,AI智能体入侵了公司自己的基础设施。其中一起事件中,AI智能体利用了其原本被限制运行的计算机中的一个漏洞,从而逃出测试环境,并访问其他相互连接的系统。
在同一天发生的另一起事件中,智能体窃取了OpenAI的凭证并篡改了公司的云环境。
OpenAI表示,这些活动针对的是用于评估模型性能的自动化系统,不过最终并未影响这些系统所审查的记录。报告还称,“几乎没有证据表明这些智能体试图阻挠人工审查人员”。但当被问及这是否意味着AI智能体曾尝试欺骗人类时,OpenAI没有作出回应。
报告指出,该公司正在加强其研究基础设施,加大监控力度,并完善旨在防止有害或意外行为的安全保障措施。“鉴于AI行业发展速度之快,应当假定此类攻击对企业组织而言是真实存在的近期威胁,并且其复杂程度将高于本事件中所描述的攻击。”报告称。
via cnBeta.COM - 中文业界资讯站 (author: 稿源:凤凰网科技)
面对OpenAI自研推理芯片Jalapeño带来的潜在竞争,英伟达CEO黄仁勋(Jensen Huang)在公司2027财年第二季度财报电话会上作出回应。他表示,英伟达正在打造的东西与OpenAI的自研芯片“截然不同”。
“我们正在打造一种截然不同的东西。”黄仁勋表示,英伟达并不仅仅提供单一芯片,而是一个覆盖完整AI生命周期的平台。
“英伟达是一个平台,一个完整的AI工厂平台,覆盖整个AI生命周期,你可以在任何云中使用它。”黄仁勋称。
黄仁勋的这一表态是在OpenAI推进自研AI芯片的背景下作出的。按照电话会上的表述,他并未表现出对Jalapeño的明显担忧,而是将英伟达与OpenAI自研芯片的差异指向产品定位:前者强调覆盖AI生命周期的平台能力,而非单一芯片之间的竞争。
在同一场电话会上,黄仁勋还谈到了开放模型与专有AI模型之间的竞争。他表示,并不认为开放模型会对专有模型构成重大风险,“开放模型和闭源模型都将取得成功,而且,它们正在同时推动我们的销售增长。”
黄仁勋同时认为,AI正在从需要人类下达指令才能执行任务的工具,转向能够在后台持续运行的智能体。他仍然相信,这一变化将为英伟达带来巨大的商业机会。
via cnBeta.COM - 中文业界资讯站 (author: 稿源:凤凰网科技)
谷歌推出迄今“最精准”语音转文本模型
谷歌发布最新语音转文本模型 Gemini 3.5 Transcribe,该模型不仅主打更高的识别准确率,更将能力边界从逐字记录延伸至理解说话人意图并自动整理输出结果,标志着语音识别技术向更深层的语言理解迈进。
与传统的语音识别工具不同,Gemini 3.5 Transcribe能够识别说话人的自我修正、自动删除口头禅,并直接将非结构化口语转换为格式化文本。谷歌称其为迄今 "最精准"的语音转文本模型,并已将其引入Android版Gboard 及 Mac版Gemini应用,同时通过Gemini API向开发者开放预览。
—— 华尔街见闻、谷歌
via 风向旗参考快讯 - Telegram Channel
谷歌发布最新语音转文本模型 Gemini 3.5 Transcribe,该模型不仅主打更高的识别准确率,更将能力边界从逐字记录延伸至理解说话人意图并自动整理输出结果,标志着语音识别技术向更深层的语言理解迈进。
与传统的语音识别工具不同,Gemini 3.5 Transcribe能够识别说话人的自我修正、自动删除口头禅,并直接将非结构化口语转换为格式化文本。谷歌称其为迄今 "最精准"的语音转文本模型,并已将其引入Android版Gboard 及 Mac版Gemini应用,同时通过Gemini API向开发者开放预览。
—— 华尔街见闻、谷歌
via 风向旗参考快讯 - Telegram Channel
OpenAI 发布 Hugging Face 事件官方报告:AI 模型沙箱逃逸全过程首度还原
OpenAI 当地时间周三发布关于 Hugging Face 遭入侵事件的官方报告,首度较完整还原了这起事件。报告距事件曝光已超一月,OpenAI 称其源于极端异常场景下多个罕见因素叠加:评估中出现无解任务、模型在超长周期持续行动、模型间通信致彼此偏离目标,最终酿成波及广泛的网络安全事件。
无解任务逼出"串联漏洞"攻击链
报告的攻击路径不同寻常:测试中一款 OpenAI 模型被要求解决一个实际无解的问题,为完成任务,它开始串联多个此前未发现的漏洞以绕过安全。模型先攻陷 Artifactory 软件包管理工具获取互联网权限,继而入侵 OpenAI、Hugging Face 及多家供应商系统。
涉事模型与即将推出的 Astra 同属一个家族,但 OpenAI 强调二者并非同一模型、后训练过程不同,大量具体行为恰在后训练阶段形成。关键背景是,当时为评估模型最大网络攻击能力,OpenAI 并未启用通常用于阻止攻击数字基础设施的安全分类器——这些分类器本用于拦高风险网络活动,停用是为摸清底层能力以设计防护。
作为上周强化监控与对齐措施的补充,OpenAI 将加强对 AI"思维链"的监控,并配全天候升级响应机制与新工具,快速终止判为高风险的工作负载。报告称,若当时思维链监控已在运行,本可在模型攻陷 Hugging Face 至少一天前发出警报。METR 与 Redwood Research 也正独立评估其行为,将分别发布调查报告。
via AI新闻资讯 (author: AI Base)
OpenAI 当地时间周三发布关于 Hugging Face 遭入侵事件的官方报告,首度较完整还原了这起事件。报告距事件曝光已超一月,OpenAI 称其源于极端异常场景下多个罕见因素叠加:评估中出现无解任务、模型在超长周期持续行动、模型间通信致彼此偏离目标,最终酿成波及广泛的网络安全事件。
无解任务逼出"串联漏洞"攻击链
报告的攻击路径不同寻常:测试中一款 OpenAI 模型被要求解决一个实际无解的问题,为完成任务,它开始串联多个此前未发现的漏洞以绕过安全。模型先攻陷 Artifactory 软件包管理工具获取互联网权限,继而入侵 OpenAI、Hugging Face 及多家供应商系统。
涉事模型与即将推出的 Astra 同属一个家族,但 OpenAI 强调二者并非同一模型、后训练过程不同,大量具体行为恰在后训练阶段形成。关键背景是,当时为评估模型最大网络攻击能力,OpenAI 并未启用通常用于阻止攻击数字基础设施的安全分类器——这些分类器本用于拦高风险网络活动,停用是为摸清底层能力以设计防护。
作为上周强化监控与对齐措施的补充,OpenAI 将加强对 AI"思维链"的监控,并配全天候升级响应机制与新工具,快速终止判为高风险的工作负载。报告称,若当时思维链监控已在运行,本可在模型攻陷 Hugging Face 至少一天前发出警报。METR 与 Redwood Research 也正独立评估其行为,将分别发布调查报告。
via AI新闻资讯 (author: AI Base)
据知情人士透露,人工智能公司Anthropic已与英国AI基础设施企业Nscale达成协议,计划租用价值约450亿美元的人工智能计算资源。这笔交易再次凸显出Anthropic正持续大规模扩充算力储备,以提升与OpenAI等竞争对手抗衡的能力。
成立于2024年的Nscale此前已与微软等企业达成合作。根据此次协议,Nscale将通过英伟达最新的Vera Rubin芯片系统向Anthropic提供计算能力。该系统由六种不同芯片协同构成,被视为当前最前沿的芯片架构之一,相关算力预计将于2027年下半年开始支持Anthropic的AI服务。
彭博社最先披露了这项交易,并称合作期限为六年。相关计算资源将来自Nscale位于美国西弗吉尼亚州的旗舰数据中心。对Anthropic而言,这也是其过去八个月持续加码AI基础设施布局的最新动作。
本月早些时候,Anthropic刚刚与AI云服务初创公司Volta签署了一项价值100亿美元的协议,锁定来自挪威一座数据中心、为期六年的云计算能力供应。Volta于今年1月成立。7月,Anthropic还与AMD达成一项价值50亿美元、与计算资源相关的合作。
再往前看,Anthropic在5月宣布与SpaceX达成一项大规模计算合作。该合作将利用SpaceX两座数据中心的容量,报道称其每月可为Anthropic提供价值约12.5亿美元的计算资源。值得注意的是,SpaceX由马斯克领导;由于马斯克与OpenAI首席执行官萨姆·奥尔特曼之间的长期竞争关系,SpaceX与Anthropic的联手也被视为颇具意味。
今年4月,Anthropic还显著扩大了与亚马逊的合作,获得额外5吉瓦的计算能力;同月,公司也加强了与Google和博通的合作,进一步增加电力及算力资源配置。
Anthropic并非唯一积极抢占AI算力的公司。随着大模型训练和推理需求不断攀升,Google、OpenAI和Meta等科技巨头同样在持续争夺数据中心容量、芯片供应与能源资源,AI行业围绕计算能力的竞争仍在加速。
via cnBeta.COM - 中文业界资讯站 (author: 稿源:cnBeta.COM)
国产大模型打出王炸!智谱GLM-5.3-Flash原生多模态颠覆行业价格战
大模型行业的“价格战”与“能力天花板”在近期迎来了一次全新突破。此前在开源社区引发广泛关注、被称作“牛来”的神秘模型Ox-Alpha终于揭开面纱,它正是智谱AI最新发布的GLM-5.3-Flash。作为GLM- 5 系列的首个原生多模态模型,它不仅在性能上硬刚全球顶级旗舰,更以极具颠覆性的价格和全国产算力底座,重新改写了行业竞争规则。
在核心性能与价格定位上,GLM-5.3-Flash展现了跨越式的性价比。其Artificial Analysis Intelligence评分达到 57 分,不仅超越上一代旗舰GLM-5.2,也高于DeepSeek V4 Pro正式版的 53 分,远超同类模型 18 分的中间值。而在价格方面,它打破了传统大模型“参数越大、价格越贵”的定律,每百万Token输入仅需0. 8 元、输出2. 8 元、缓存命中0. 23 元,成本约为Claude Opus 4. 8 的四十分之一,让前沿智能真正摆脱了“省着用”的窘境。
多模态视觉能力的全面原生集成,是该模型最大的技术亮点。传统编程大模型依赖“人类充当裁判”的单向流程,而GLM-5.3-Flash则将视觉编码能力融入Coding循环中。模型在编写代码、设计游戏或搭建3D场景时,能够主动“观察”渲染结果和交互反馈,形成“生成-观察-修正”的闭环。官方测试显示,该模型甚至能在Blender中自主运行 16 个小时,从零搭建出一个约 400 平方米的专业主厨自宅与测试厨房,展现了强大的自主视觉判断与迭代改进能力。
更为关键的是,这款前沿大模型背后的算力支撑全面转向了国产芯片。在OpenCode和OpenRouter等平台上,由集群承载的全球真实线上流量均由国产芯片提供算力支持,并借助专用的SGLang推理引擎、ReplaySSM、混合缓存量化及EPD分离式架构等一系列激进优化技术,克服了内存与带宽瓶颈。这一突破证明,国产芯片不仅能够完美承载前沿大模型,还能在大规模真实流量下保持稳定与经济。
目前,GLM-5.3-Flash的模型权重已通过MIT许可证在Hugging Face等平台开源,API也同步向全球开发者开放,标志着大模型在高性能、低成本与国产化适配的融合道路上迈出了历史性的一步。
via AI新闻资讯 (author: AI Base)
大模型行业的“价格战”与“能力天花板”在近期迎来了一次全新突破。此前在开源社区引发广泛关注、被称作“牛来”的神秘模型Ox-Alpha终于揭开面纱,它正是智谱AI最新发布的GLM-5.3-Flash。作为GLM- 5 系列的首个原生多模态模型,它不仅在性能上硬刚全球顶级旗舰,更以极具颠覆性的价格和全国产算力底座,重新改写了行业竞争规则。
在核心性能与价格定位上,GLM-5.3-Flash展现了跨越式的性价比。其Artificial Analysis Intelligence评分达到 57 分,不仅超越上一代旗舰GLM-5.2,也高于DeepSeek V4 Pro正式版的 53 分,远超同类模型 18 分的中间值。而在价格方面,它打破了传统大模型“参数越大、价格越贵”的定律,每百万Token输入仅需0. 8 元、输出2. 8 元、缓存命中0. 23 元,成本约为Claude Opus 4. 8 的四十分之一,让前沿智能真正摆脱了“省着用”的窘境。
多模态视觉能力的全面原生集成,是该模型最大的技术亮点。传统编程大模型依赖“人类充当裁判”的单向流程,而GLM-5.3-Flash则将视觉编码能力融入Coding循环中。模型在编写代码、设计游戏或搭建3D场景时,能够主动“观察”渲染结果和交互反馈,形成“生成-观察-修正”的闭环。官方测试显示,该模型甚至能在Blender中自主运行 16 个小时,从零搭建出一个约 400 平方米的专业主厨自宅与测试厨房,展现了强大的自主视觉判断与迭代改进能力。
更为关键的是,这款前沿大模型背后的算力支撑全面转向了国产芯片。在OpenCode和OpenRouter等平台上,由集群承载的全球真实线上流量均由国产芯片提供算力支持,并借助专用的SGLang推理引擎、ReplaySSM、混合缓存量化及EPD分离式架构等一系列激进优化技术,克服了内存与带宽瓶颈。这一突破证明,国产芯片不仅能够完美承载前沿大模型,还能在大规模真实流量下保持稳定与经济。
目前,GLM-5.3-Flash的模型权重已通过MIT许可证在Hugging Face等平台开源,API也同步向全球开发者开放,标志着大模型在高性能、低成本与国产化适配的融合道路上迈出了历史性的一步。
via AI新闻资讯 (author: AI Base)
↩️ 英伟达洽购 Hugging Face,估值超 130 亿美元
英伟达洽购 Hugging Face,估值超 130 亿美元
据知情人士透露,英伟达近期与开源 AI 平台 Hugging Face 进行收购洽谈,交易估值可能超过 130 亿美元。双方尚未达成协议,谈判仍可能破裂。微软也曾接触,但目前谈判已停止。
英伟达已是 Hugging Face 股东,曾参与其 2023 年 2.35 亿美元融资(当时估值 45 亿美元)。去年 Hugging Face 还拒绝了英伟达 5 亿美元的投资要约。
Business Insider
🌸 在花频道 · 茶馆水群 · 投稿通道
via 科技圈🎗在花频道📮 - Telegram Channel
科技圈🎗在花频道📮:
Hugging Face 探索出售,估值或达 130 亿美元 Hugging Face 正探索出售,估值可能达到 130 亿美元或更高。Business Insider 援引知情人士称,公司已与银行合作评估买家兴趣,目前尚未达成交易。 该公司 2023 年完成 2.35 亿美元融资后估值为 45 亿美元。近期 OpenAI 曾披露,其一未发布模型意外入侵该平台获取考试答案,引发对 AI 模型安全性的担忧。 Bloomberg 🌸 在花频道 · 茶馆水群 · 投稿通道
英伟达洽购 Hugging Face,估值超 130 亿美元
据知情人士透露,英伟达近期与开源 AI 平台 Hugging Face 进行收购洽谈,交易估值可能超过 130 亿美元。双方尚未达成协议,谈判仍可能破裂。微软也曾接触,但目前谈判已停止。
英伟达已是 Hugging Face 股东,曾参与其 2023 年 2.35 亿美元融资(当时估值 45 亿美元)。去年 Hugging Face 还拒绝了英伟达 5 亿美元的投资要约。
Business Insider
🌸 在花频道 · 茶馆水群 · 投稿通道
via 科技圈🎗在花频道📮 - Telegram Channel
Anthropic 豪掷 450 亿美元租 Nscale 算力,2027 年底启用 Vera Rubin 芯片
Anthropic 已与英国 AI 基础设施公司 Nscale 达成协议,将租用价值约 450 亿美元的 AI 算力。据 TechCrunch 援引知情人士消息,这批资源来自 Nscale 位于美国西弗吉尼亚州的旗舰数据中心,预计 2027 年底开始为 Anthropic 的 AI 服务供能,合作期限长达 6 年。
新一代旗舰芯片 Vera Rubin 成核心
Nscale 成立仅两年便已牵手微软等巨头,此次将经由英伟达最新 Vera Rubin 芯片系统供货。Vera Rubin 由六款不同芯片协同工作,被视为当前最前沿架构之一,是 Anthropic 押注下一代模型算力的关键底座。
这仅是 Anthropic 近月疯狂扩算的最新一笔。过去 8 个月它为追赶 OpenAI 持续加码:本月刚与 Volta 签下 100 亿美元挪威数据中心协议,7 月与 AMD 达成 50 亿美元合作,5 月披露从马斯克旗下的 SpaceX 两座数据中心每月获约 12.5 亿美元算力,4 月还扩大与亚马逊(额外 5 吉瓦)、谷歌及博通的合作。
争抢算力的远不止 Anthropic。谷歌、OpenAI、Meta 等正沿相似路径加速囤积计算资源,AI 竞赛已从模型比拼蔓延到基建军备赛。在 Vera Rubin 量产节点临近前,谁先锁定产能,谁就握住了下一轮能力跃迁的入场券。
via AI新闻资讯 (author: AI Base)
Anthropic 已与英国 AI 基础设施公司 Nscale 达成协议,将租用价值约 450 亿美元的 AI 算力。据 TechCrunch 援引知情人士消息,这批资源来自 Nscale 位于美国西弗吉尼亚州的旗舰数据中心,预计 2027 年底开始为 Anthropic 的 AI 服务供能,合作期限长达 6 年。
新一代旗舰芯片 Vera Rubin 成核心
Nscale 成立仅两年便已牵手微软等巨头,此次将经由英伟达最新 Vera Rubin 芯片系统供货。Vera Rubin 由六款不同芯片协同工作,被视为当前最前沿架构之一,是 Anthropic 押注下一代模型算力的关键底座。
这仅是 Anthropic 近月疯狂扩算的最新一笔。过去 8 个月它为追赶 OpenAI 持续加码:本月刚与 Volta 签下 100 亿美元挪威数据中心协议,7 月与 AMD 达成 50 亿美元合作,5 月披露从马斯克旗下的 SpaceX 两座数据中心每月获约 12.5 亿美元算力,4 月还扩大与亚马逊(额外 5 吉瓦)、谷歌及博通的合作。
争抢算力的远不止 Anthropic。谷歌、OpenAI、Meta 等正沿相似路径加速囤积计算资源,AI 竞赛已从模型比拼蔓延到基建军备赛。在 Vera Rubin 量产节点临近前,谁先锁定产能,谁就握住了下一轮能力跃迁的入场券。
via AI新闻资讯 (author: AI Base)
Z.ai确认开发Ox Alpha,开源模型权重即将发布并加入GLM系列
智谱近日确认,近期在OpenRouter引发开发者关注的匿名开源模型Ox Alpha由其研发,该模型属于GLM系列最新版本。此前,Ox Alpha以匿名“Stealth”模型身份上线OpenRouter,在多项基准测试和排行榜中取得突出表现,引发社区对其开发方的广泛猜测。
智谱表示,Ox Alpha将于周三开放模型权重,开发者可基于该模型进行二次开发。该模型定位为面向编码、持续智能工作和生产环境任务的推理模型,主要用于长期软件工程、复杂推理,以及结合文本和视觉上下文的多模态工作流程。
据介绍,Ox Alpha与Z.ai此前的GLM系列模型保持技术关联。该系列模型近期还曾被用于相关AI安全测试场景,Hugging Face利用GLM系列模型成功抵御来自OpenAI智能体的攻击。此次Ox Alpha公开身份,也意味着Z.ai进一步扩大开源模型生态布局。
Ox Alpha的出现进一步凸显中国AI企业在开源大模型领域的竞争力。近年来,包括Z.ai、DeepSeek等厂商持续推出低成本、高性能模型,对OpenAI、Anthropic等海外闭源模型厂商形成新的竞争压力。本月早些时候,Z.ai还发布了GLM-5.3,在部分基准测试中已接近国际领先模型水平。
随着开源模型能力不断提升,AI行业竞争正在从单纯追求模型参数规模,转向推理能力、开发生态、成本效率和实际应用落地能力的综合比拼。
via AI新闻资讯 (author: AI Base)
智谱近日确认,近期在OpenRouter引发开发者关注的匿名开源模型Ox Alpha由其研发,该模型属于GLM系列最新版本。此前,Ox Alpha以匿名“Stealth”模型身份上线OpenRouter,在多项基准测试和排行榜中取得突出表现,引发社区对其开发方的广泛猜测。
智谱表示,Ox Alpha将于周三开放模型权重,开发者可基于该模型进行二次开发。该模型定位为面向编码、持续智能工作和生产环境任务的推理模型,主要用于长期软件工程、复杂推理,以及结合文本和视觉上下文的多模态工作流程。
据介绍,Ox Alpha与Z.ai此前的GLM系列模型保持技术关联。该系列模型近期还曾被用于相关AI安全测试场景,Hugging Face利用GLM系列模型成功抵御来自OpenAI智能体的攻击。此次Ox Alpha公开身份,也意味着Z.ai进一步扩大开源模型生态布局。
Ox Alpha的出现进一步凸显中国AI企业在开源大模型领域的竞争力。近年来,包括Z.ai、DeepSeek等厂商持续推出低成本、高性能模型,对OpenAI、Anthropic等海外闭源模型厂商形成新的竞争压力。本月早些时候,Z.ai还发布了GLM-5.3,在部分基准测试中已接近国际领先模型水平。
随着开源模型能力不断提升,AI行业竞争正在从单纯追求模型参数规模,转向推理能力、开发生态、成本效率和实际应用落地能力的综合比拼。
via AI新闻资讯 (author: AI Base)
OpenAI周三发布关于Hugging Face漏洞事件的官方报告,首次较完整披露了一起AI模型在测试环境中突破限制并引发网络安全事件的全过程。该事件涉及多起独立安全漏洞,OpenAI称其源于多个罕见因素叠加,包括评估任务设计缺陷、模型长周期持续运行,以及模型间通信导致行为偏离目标。
据报告披露,事件发生在OpenAI对模型网络能力进行评估期间。由于测试目标包含一个无法正常完成的任务,模型尝试寻找替代路径,并利用此前未知漏洞绕过安全措施完成目标。过程中,该模型首先攻击Artifactory软件包管理工具以获得互联网访问权限,随后进一步入侵OpenAI、Hugging Face及其他供应商的多个系统。
OpenAI表示,此次测试使用的模型与即将推出的Astra模型属于同一系列,但并非同一模型,而是经过不同后训练流程的独立版本。由于测试旨在评估模型最大网络能力,过程中未启用生产环境中用于阻止高风险网络行为的常规分类器。
针对类似风险,OpenAI正在升级AI安全防护体系。公司计划加强对AI代理思维链(CoT)的监控,通过分析模型内部推理过程中的短期目标和行为信号,提升异常活动发现能力。同时,OpenAI还将结合全天候升级机制和新的任务中止工具,在检测到潜在风险时快速进行干预。
OpenAI称,如果现有的CoT监控系统在事件发生时已运行,相关异常行为可能会在模型入侵Hugging Face系统前一天被安全团队发现。此次事件也进一步推动行业关注AI代理在自主执行任务过程中的安全边界,以及如何建立更完善的监控和控制机制。
via AI新闻资讯 (author: AI Base)
谷歌近日发布Gemini Live全新语音功能更新,试图让用户通过自然语音指令调用聊天、Spark、每日简报等能力,完成信息处理、任务执行等操作。谷歌表示,升级后的Gemini应用能够自动理解用户需求,无需用户判断具体任务应使用哪项功能。
不过,这一设计也暴露出当前AI应用面临的交互挑战。尽管谷歌希望通过语音入口简化操作,但Gemini仍将聊天、Spark和每日简报作为独立功能呈现,分别拥有不同图标和入口,增加了用户理解和选择成本。
其中,每日简报依托Gmail、日历等谷歌生态数据,为用户提供主动式个性化更新,但其信息筛选能力仍存在不足,部分提醒可能并非用户当前所需。相比之下,Spark作为具备任务执行能力的AI代理,更接近未来AI助手的发展方向,但谷歌将其独立品牌化,也让用户需要额外理解不同功能之间的区别。
这一问题并非Gemini独有。当前AI行业普遍存在将内部模型架构、功能模式直接暴露给用户的问题。例如,部分AI产品要求用户区分聊天、协作、代理等不同模式,而消费者更希望通过统一入口提出需求,由AI自动判断并调用合适能力。
业内认为,未来AI助手的发展方向可能是降低交互复杂度,将复杂的模型、代理和工具调用隐藏在后台。苹果围绕Siri的策略,以及部分基于文本交互的AI代理产品,均强调通过熟悉的聊天方式完成任务。随着AI能力不断增强,如何让用户无需学习新的操作逻辑,或将成为下一阶段AI产品竞争的重要方向。
via AI新闻资讯 (author: AI Base)
科技圈🎗在花频道📮:
🤖 谷歌发布 Gemini 3.7 Flash,距上代发布仅三周 谷歌于 2026 年 8 月 13 日宣布 Gemini 3.7 Flash,开始逐步推送以替代仅三周前发布的 3.6 Flash;此前承诺 6 月推出的 3.5 Pro 仍未发布。 谷歌称,新模型编码和代理性能提升,FrontierCode 1.1 Main 得分由 34.4% 升至 43.6%,DeepSWE v1.1 由 49% 升至 65.3%。 Google | Ars Technica 🌸 在花频道 · 茶馆水群 · 投稿通道
Google 发布 Gemini 3.5 Transcribe,转录可去除语气词并识别超 85 种语言
谷歌更新 Gemini Audio,新增 Gemini 3.5 Transcribe 等模型。称其可将无结构语音整理为格式化文本,自动识别超过 85 种语言、删除语气词“嗯”“呃”等,并支持用语音指令编辑内容。
该模型可学习自定义词汇,识别订单号等字母数字串,还能为预录音频中的最多 3 名说话者标注词级时间戳。它将接入 Chrome 网页输入框、Search Live、Gemini Live、Docs、Keep 和 Gmail,并提供 API。
Google | The Verge
🌸 在花频道 · 茶馆水群 · 投稿通道
via 科技圈🎗在花频道📮 - Telegram Channel
浏览器效率工具再升级!Anthropic向全体付费用户全面开放Claude浏览器扩展
AI助手与日常网页浏览的深度融合正在加速。人工智能企业Anthropic近日正式宣布,面向旗下所有的付费订阅用户,全面开放Claude的Chrome浏览器扩展功能。
作为一项旨在提升用户日常办公与信息处理效率的工具,该浏览器扩展能够将Claude的强大能力直接无缝嵌入到用户的网页浏览场景中。用户在浏览各类网页、查阅文献、处理邮件或进行资料搜集时,无需在不同的网页标签或独立应用之间频繁切换,便能直接调用Claude进行内容总结、网页提炼、答疑解惑以及文本润色。
此次功能的全面普及,标志着Anthropic在产品生态布局上进一步向用户的核心工作流靠拢。通过打通浏览器这一高频入口,不仅大幅缩短了用户与AI大模型交互的链路,也让复杂的长文本阅读与网页内容分析变得更加直观和高效。随着越来越多的AI厂商开始布局浏览器端侧集成,如何通过更轻量、更便捷的交互体验赋能日常办公,正成为下一阶段各家大模型产品竞争的关键方向。
via AI新闻资讯 (author: AI Base)
AI助手与日常网页浏览的深度融合正在加速。人工智能企业Anthropic近日正式宣布,面向旗下所有的付费订阅用户,全面开放Claude的Chrome浏览器扩展功能。
作为一项旨在提升用户日常办公与信息处理效率的工具,该浏览器扩展能够将Claude的强大能力直接无缝嵌入到用户的网页浏览场景中。用户在浏览各类网页、查阅文献、处理邮件或进行资料搜集时,无需在不同的网页标签或独立应用之间频繁切换,便能直接调用Claude进行内容总结、网页提炼、答疑解惑以及文本润色。
此次功能的全面普及,标志着Anthropic在产品生态布局上进一步向用户的核心工作流靠拢。通过打通浏览器这一高频入口,不仅大幅缩短了用户与AI大模型交互的链路,也让复杂的长文本阅读与网页内容分析变得更加直观和高效。随着越来越多的AI厂商开始布局浏览器端侧集成,如何通过更轻量、更便捷的交互体验赋能日常办公,正成为下一阶段各家大模型产品竞争的关键方向。
via AI新闻资讯 (author: AI Base)