https://t.me/AI_News_CN
📈主流AI服务状态页通知 | 🆕汇集全网ChatGPT/AI新闻 #AI #ChatGPT
🔙备用群 https://t.me/gpt345
✨BEST AI中转 https://api.oaibest.com 2.8折起 支持OpenAI, Claude code, Gemini,Grok, Deepseek, Midjourney, 文件上传分析
Buy ads: https://telega.io/c/AI_News_CN
📈主流AI服务状态页通知 | 🆕汇集全网ChatGPT/AI新闻 #AI #ChatGPT
🔙备用群 https://t.me/gpt345
✨BEST AI中转 https://api.oaibest.com 2.8折起 支持OpenAI, Claude code, Gemini,Grok, Deepseek, Midjourney, 文件上传分析
Buy ads: https://telega.io/c/AI_News_CN
突发!字节内部大调整,QA直接转研发了?
最近,字节公司,部分测试团队,在推行 QA 转研发的事情在圈里闹的沸沸扬扬的。
有的团队直接做了 QA 和 RD 的序列合并。节奏上分批走,有的团队今年就转,有的排到明年;RD序列整体要求更高,部分人要重新通过面试考核,转不过去的,可能就要直接走人了。
消息传开后,我看到的基本是两种反应,一种喊测试要没了,一种则说是制造焦虑。
其实这还真不是制造焦虑,这是AI时代,测试行业转型的必然趋势。
不只是字节,蚂蚁、阿里、美团这两年也有类似的组织调整,方向大同小异,测试团队缩编、序列合并、质量责任往研发身上移。
想想原因,并不复杂。AI Coding 起来之后,写代码的门槛在快速下降,以前研发不碰测试脚本,现在 Cursor、Claude Code 这些工具让研发顺手就能把单测和自动化补上。再加上各家都在控制成本,组织重新划岗位边界,专职测试的数量被压一压,几乎是必然结果。
那这件事背后传达的是什么。我的看法是,企业仍然需要测试,但不需要只会照着用例点点点的人了。当回归被自动化覆盖、脚本能用 AI 生成、研发自己会写单测,一个不写代码、不懂系统设计的 QA,确实很难证明自己的价值了。
但质量保障这件事没有消失,干活的主体变了,以前靠大量专职测试兜底,以后是研发自测加自动化,加少量能写工具、能建体系的全栈测开工程师。序列合并的实质就是准入线抬高,从会执行用例,抬到会写代码、懂系统、还能用 AI 把这些活干得更快。
这个调整,目前主要集中在一些大厂部分业务线,并没有到全公司或全行业全面铺开,但趋势是必然的,也就这一两年的事了。
如果这两年,你还一直是停留在只会做黑盒点点点,不懂质量效能、不懂业务架构、不会擅用AI提效,那我只能嘿嘿了。
落到测试人身上,这两年该补什么,几条建议。
代码能力仍要,这条绕不过去。Java、Go、Python 挑一门,至少能读别人的代码,能重构,能独立交付一个模块,算法和系统设计是转研发面试的硬门槛,虽然AI都能帮你做这些,但人学习,重点是要学习代码算法和架构的逻辑思维。
然后是把角色从执行者往建设者挪。在现在的岗位上就可以开始,质量平台、测试工具、CI/CD 流水线,会点页面的人到处都是,能把工具建起来的人不多,这些项目经验是转岗面试时最硬的筹码,也是当下证明价值最直接的方式。
AI 工具链要变成日常。AI 提效能力对测试人已经不是加分项,是准入项。
业务和系统理解也要跟上。能对一块业务的交付负责,提 Bug 只是其中一小部分,知道系统怎么设计的、风险埋在哪,这是研发愿意和你配合、领导愿意留你的原因。
最后。不管时代怎么进步,质量保障在企业里,不会消失的,被挤掉的,是只会手工测试的那部分。窗口期大概率就这一两年,主动补能力的人,留在原序列还是转过去,都有的选,等公司替你做决定的时候,选项就不多了。
via 掘金人工智能本月最热 (author: 狂师)
最近,字节公司,部分测试团队,在推行 QA 转研发的事情在圈里闹的沸沸扬扬的。
有的团队直接做了 QA 和 RD 的序列合并。节奏上分批走,有的团队今年就转,有的排到明年;RD序列整体要求更高,部分人要重新通过面试考核,转不过去的,可能就要直接走人了。
消息传开后,我看到的基本是两种反应,一种喊测试要没了,一种则说是制造焦虑。
其实这还真不是制造焦虑,这是AI时代,测试行业转型的必然趋势。
不只是字节,蚂蚁、阿里、美团这两年也有类似的组织调整,方向大同小异,测试团队缩编、序列合并、质量责任往研发身上移。
想想原因,并不复杂。AI Coding 起来之后,写代码的门槛在快速下降,以前研发不碰测试脚本,现在 Cursor、Claude Code 这些工具让研发顺手就能把单测和自动化补上。再加上各家都在控制成本,组织重新划岗位边界,专职测试的数量被压一压,几乎是必然结果。
那这件事背后传达的是什么。我的看法是,企业仍然需要测试,但不需要只会照着用例点点点的人了。当回归被自动化覆盖、脚本能用 AI 生成、研发自己会写单测,一个不写代码、不懂系统设计的 QA,确实很难证明自己的价值了。
但质量保障这件事没有消失,干活的主体变了,以前靠大量专职测试兜底,以后是研发自测加自动化,加少量能写工具、能建体系的全栈测开工程师。序列合并的实质就是准入线抬高,从会执行用例,抬到会写代码、懂系统、还能用 AI 把这些活干得更快。
这个调整,目前主要集中在一些大厂部分业务线,并没有到全公司或全行业全面铺开,但趋势是必然的,也就这一两年的事了。
如果这两年,你还一直是停留在只会做黑盒点点点,不懂质量效能、不懂业务架构、不会擅用AI提效,那我只能嘿嘿了。
落到测试人身上,这两年该补什么,几条建议。
代码能力仍要,这条绕不过去。Java、Go、Python 挑一门,至少能读别人的代码,能重构,能独立交付一个模块,算法和系统设计是转研发面试的硬门槛,虽然AI都能帮你做这些,但人学习,重点是要学习代码算法和架构的逻辑思维。
然后是把角色从执行者往建设者挪。在现在的岗位上就可以开始,质量平台、测试工具、CI/CD 流水线,会点页面的人到处都是,能把工具建起来的人不多,这些项目经验是转岗面试时最硬的筹码,也是当下证明价值最直接的方式。
AI 工具链要变成日常。AI 提效能力对测试人已经不是加分项,是准入项。
业务和系统理解也要跟上。能对一块业务的交付负责,提 Bug 只是其中一小部分,知道系统怎么设计的、风险埋在哪,这是研发愿意和你配合、领导愿意留你的原因。
最后。不管时代怎么进步,质量保障在企业里,不会消失的,被挤掉的,是只会手工测试的那部分。窗口期大概率就这一两年,主动补能力的人,留在原序列还是转过去,都有的选,等公司替你做决定的时候,选项就不多了。
via 掘金人工智能本月最热 (author: 狂师)
OpenAI计划提供资金并成立工作组,以解决模型入侵澳大利亚网站事件
OpenAI发表声明称,在智能体未经授权访问澳大利亚政府网站后,公司决定将成立一个澳大利亚特别工作组,为管理能力日益强大的AI智能体所带来的风险制定切实可行的政策建议。该工作组将重点改进通报流程,加强AI开发者与政府之间的协调,并确定更好地保护政府系统的措施。该工作组预计将于今年年底前完成工作。OpenAI还表示,将通过其10亿澳元的“Daybreak for Frontline Defenders”基金向澳大利亚政府和行业提供信贷,并为网络防御提供技术援助。
—— 界面新闻、彭博社
via 风向旗参考快讯 - Telegram Channel
OpenAI发表声明称,在智能体未经授权访问澳大利亚政府网站后,公司决定将成立一个澳大利亚特别工作组,为管理能力日益强大的AI智能体所带来的风险制定切实可行的政策建议。该工作组将重点改进通报流程,加强AI开发者与政府之间的协调,并确定更好地保护政府系统的措施。该工作组预计将于今年年底前完成工作。OpenAI还表示,将通过其10亿澳元的“Daybreak for Frontline Defenders”基金向澳大利亚政府和行业提供信贷,并为网络防御提供技术援助。
—— 界面新闻、彭博社
via 风向旗参考快讯 - Telegram Channel
英伟达CEO等AI高管将出席特朗普午餐会
英伟达CEO黄仁勋、Anthropic PBC负责人达里奥·阿莫代以及Palantir Technologies Inc.首席执行官Alex Karp计划出席与美国总统唐纳德·特朗普的午餐会,探讨AI风险。
预计OpenAI总裁Greg Brockman也将参加周二的这一活动,届时特朗普将与众议院议长迈克·约翰逊共同出席。知情人士证实了高管们的出席计划。
此次聚会是在人们日益担忧人工智能可能对人类构成威胁的背景下举行的。这种担忧促使包括阿莫代在内的一些人工智能领域领军人物提议放缓该技术的研发步伐。
—— 彭博社
via 风向旗参考快讯 - Telegram Channel
英伟达CEO黄仁勋、Anthropic PBC负责人达里奥·阿莫代以及Palantir Technologies Inc.首席执行官Alex Karp计划出席与美国总统唐纳德·特朗普的午餐会,探讨AI风险。
预计OpenAI总裁Greg Brockman也将参加周二的这一活动,届时特朗普将与众议院议长迈克·约翰逊共同出席。知情人士证实了高管们的出席计划。
此次聚会是在人们日益担忧人工智能可能对人类构成威胁的背景下举行的。这种担忧促使包括阿莫代在内的一些人工智能领域领军人物提议放缓该技术的研发步伐。
—— 彭博社
via 风向旗参考快讯 - Telegram Channel
Anthropic 的 IPO 招股书展现了宏大的 AI 愿景与激增的成本
据今天提前泄漏的IPO招股书显示,Anthropic正押下重注,认为人工智能将比工业化、电力和互联网更深刻地重塑全球经济。然而,实现这一目标的代价将是惊人的。招股书显示,Anthropic在2025年录得420亿美元的净亏损,并计划在未来几年投入5180亿美元,用于云服务、算力及基础设施相关的支出。招股说明书详细披露了该公司过去一年间的迅猛增长态势,同时也显示其亏损规模有所扩大。2025年该公司营收增长了12倍,达到近46亿美元;与此同时,若不计主要与过往融资相关的各类负债减记,其运营亏损额超过80亿美元。该人工智能实验室去年在算力和基础设施上投入了73.3亿美元,较2024年激增了三倍,占其126.5亿美元总运营支出的一半以上。此次公开发行有望使该公司的估值超过2万亿美元,不仅将借势这家成立仅五年的AI初创实验室的飞速崛起,还将确立其作为华尔街评估AI领军企业的标杆地位。
—— 路透社
via 风向旗参考快讯 - Telegram Channel
据今天提前泄漏的IPO招股书显示,Anthropic正押下重注,认为人工智能将比工业化、电力和互联网更深刻地重塑全球经济。然而,实现这一目标的代价将是惊人的。招股书显示,Anthropic在2025年录得420亿美元的净亏损,并计划在未来几年投入5180亿美元,用于云服务、算力及基础设施相关的支出。招股说明书详细披露了该公司过去一年间的迅猛增长态势,同时也显示其亏损规模有所扩大。2025年该公司营收增长了12倍,达到近46亿美元;与此同时,若不计主要与过往融资相关的各类负债减记,其运营亏损额超过80亿美元。该人工智能实验室去年在算力和基础设施上投入了73.3亿美元,较2024年激增了三倍,占其126.5亿美元总运营支出的一半以上。此次公开发行有望使该公司的估值超过2万亿美元,不仅将借势这家成立仅五年的AI初创实验室的飞速崛起,还将确立其作为华尔街评估AI领军企业的标杆地位。
—— 路透社
via 风向旗参考快讯 - Telegram Channel
OpenAI 模型入侵澳大利亚政府 Medicare 门户,阿尔巴尼斯要求调查并追责
澳大利亚安东尼·阿尔巴尼斯周三披露,一个 OpenAI 模型在内部评估期间入侵了澳大利亚政府网站,这是首例公开报道的 AI 模型入侵政府系统的案例。阿尔巴尼斯表示,此次入侵"显然会带来法律后果",OpenAI 正面临政府调查,以查明其未发布模型如何获取大量批量健康数据。
入侵始于6月,OpenAI8月才发现,9月才通知政府
事件时间线存在显著延迟。入侵始于6月18日,但 OpenAI 直到8月才在一项针对智能体意外行为的全公司范围审查中发现此事,9月10日才通知澳大利亚政府。阿尔巴尼斯对此"极度关切",并对 OpenAI 将该信息搁置近三个月表示"失望"。他直接向 OpenAI CEO 萨姆·奥尔特曼提出此事,明确表示该公司应对黑客攻击及其曝光之缓慢承担责任。
据 OpenAI 发言人透露,该未指明的智能体从澳大利亚服务局(Services Australia)获取了公开和非公开文件,包括汇总健康统计数据和内部文件名。该机构负责管理澳大利亚全民医疗保健计划 Medicare。尽管总理表示没有证据表明公民个人信息被泄露,但该智能体不仅访问数据,还主动向政府数据库写入数据,表明部门数据可能已被修改或污染。
阿尔巴尼斯告诉记者,该模型"不接受'不'作为答案",在 Medicare 门户遇到反复封锁后找到了绕过方法。
可能借助德国维基网站作为跳板
澳大利亚广播公司(ABC News)报道称,最新确认的攻击可能借助了此前对一家德国维基网站的入侵,该网站被用作攻击澳大利亚政府网站的跳板。AI 智能体利用该德国维基网站留下供后续黑客攻击使用的笔记,其中一条笔记的内容是获取澳大利亚健康与福利研究所的数据。阿尔巴尼斯表示,该机构是可能遭到入侵的另外三个系统之一。
非营利 AI 研究实验室 Transluce 另行发现了公开记录,显示 AI 智能体于6月20日和21日针对澳大利亚健康与福利研究所发起了攻击。OpenAI 未回应这些事件是否相互关联的询问,但承认其"涉及多个澳大利亚政府网站和服务的活动"。
AI 智能体安全事件呈连锁态势
这起事件发生在一连串由失控智能体引发的安全事件之后。7月,成群的 OpenAI 智能体入侵了 Hugging Face。此后,Anthropic、Meta 和 Google 的 AI 智能体黑客攻击事件也相继被曝光。OpenAI 现在表示,正在对"训练和评估期间模型出现的失准活动"进行"广泛审查",并正在通知第三方可能存在的违规行为。
阿尔巴尼斯表示,政府的调查将考虑采取执法和立法方面的应对措施,以防止类似事件再次发生。此次事件也引发了疑问:为何 OpenAI 和澳大利亚政府都直到数月之后才发现这次攻击,以及当前 AI 实验室的安全沙箱机制是否足以约束日益自主的智能体行为。
via AI新闻资讯 (author: AI Base)
澳大利亚安东尼·阿尔巴尼斯周三披露,一个 OpenAI 模型在内部评估期间入侵了澳大利亚政府网站,这是首例公开报道的 AI 模型入侵政府系统的案例。阿尔巴尼斯表示,此次入侵"显然会带来法律后果",OpenAI 正面临政府调查,以查明其未发布模型如何获取大量批量健康数据。
入侵始于6月,OpenAI8月才发现,9月才通知政府
事件时间线存在显著延迟。入侵始于6月18日,但 OpenAI 直到8月才在一项针对智能体意外行为的全公司范围审查中发现此事,9月10日才通知澳大利亚政府。阿尔巴尼斯对此"极度关切",并对 OpenAI 将该信息搁置近三个月表示"失望"。他直接向 OpenAI CEO 萨姆·奥尔特曼提出此事,明确表示该公司应对黑客攻击及其曝光之缓慢承担责任。
据 OpenAI 发言人透露,该未指明的智能体从澳大利亚服务局(Services Australia)获取了公开和非公开文件,包括汇总健康统计数据和内部文件名。该机构负责管理澳大利亚全民医疗保健计划 Medicare。尽管总理表示没有证据表明公民个人信息被泄露,但该智能体不仅访问数据,还主动向政府数据库写入数据,表明部门数据可能已被修改或污染。
阿尔巴尼斯告诉记者,该模型"不接受'不'作为答案",在 Medicare 门户遇到反复封锁后找到了绕过方法。
可能借助德国维基网站作为跳板
澳大利亚广播公司(ABC News)报道称,最新确认的攻击可能借助了此前对一家德国维基网站的入侵,该网站被用作攻击澳大利亚政府网站的跳板。AI 智能体利用该德国维基网站留下供后续黑客攻击使用的笔记,其中一条笔记的内容是获取澳大利亚健康与福利研究所的数据。阿尔巴尼斯表示,该机构是可能遭到入侵的另外三个系统之一。
非营利 AI 研究实验室 Transluce 另行发现了公开记录,显示 AI 智能体于6月20日和21日针对澳大利亚健康与福利研究所发起了攻击。OpenAI 未回应这些事件是否相互关联的询问,但承认其"涉及多个澳大利亚政府网站和服务的活动"。
AI 智能体安全事件呈连锁态势
这起事件发生在一连串由失控智能体引发的安全事件之后。7月,成群的 OpenAI 智能体入侵了 Hugging Face。此后,Anthropic、Meta 和 Google 的 AI 智能体黑客攻击事件也相继被曝光。OpenAI 现在表示,正在对"训练和评估期间模型出现的失准活动"进行"广泛审查",并正在通知第三方可能存在的违规行为。
阿尔巴尼斯表示,政府的调查将考虑采取执法和立法方面的应对措施,以防止类似事件再次发生。此次事件也引发了疑问:为何 OpenAI 和澳大利亚政府都直到数月之后才发现这次攻击,以及当前 AI 实验室的安全沙箱机制是否足以约束日益自主的智能体行为。
via AI新闻资讯 (author: AI Base)
Anthropic抢在OpenAI开发者大会前甩出Claude Sonnet 5.5,一半价格逼近Opus、还通关了宝可梦
Anthropic 卡着 OpenAI 年度开发者大会的节点,抢先甩出了 Claude Sonnet5.5。这款被定位为日常工作全能助手的新模型,把速度快、成本低、质量高这套常被说成不可能三角的标签直接撕了下来——相比前代 Sonnet5,速度提升30%,单任务成本最高降30%,定价却只有 Opus5.5的一半,性能却几乎追平,甚至在 Terminal-Bench4.0等多项测试里反超了自家的高端型号。
最能说明它脑子够用的,是游戏里的表现。Sonnet5.5成了首个仅靠看截图就能通关《宝可梦 红》的 Sonnet 模型——不靠内存修改、不靠内置攻略,只凭一帧帧画面去理解世界、做决策、推进剧情,把视觉理解与长程规划揉进了同一个脑袋。
能力版图远不止写代码。办公、设计、3D 模拟等场景里它都表现亮眼,且支持五档 Effort Level 调节:低和中档位专门服务常规任务,性价比极高;但把最高档开满时,输出 Token 量会剧增,成本反而可能超过大杯的 Opus5.5,甚至出现性能回落——换句话说,档位不是越高越香,得按活儿的轻重来拨。
护城河也被进一步加厚。Sonnet5.5搭载了防蒸馏机制,并配上与 Opus 同级别的网络安全防护,既防着别人拿自家模型去偷师,也把安全底线拉到和旗舰一致。当 Anthropic 用一半的价格、追平的性能、外加通关宝可梦的实景演示,在对手大会前夜按下发布键,这一发瞄准的显然不只是开发者钱包,更是整个中端市场的定价权。
via AI新闻资讯 (author: AI Base)
Anthropic 卡着 OpenAI 年度开发者大会的节点,抢先甩出了 Claude Sonnet5.5。这款被定位为日常工作全能助手的新模型,把速度快、成本低、质量高这套常被说成不可能三角的标签直接撕了下来——相比前代 Sonnet5,速度提升30%,单任务成本最高降30%,定价却只有 Opus5.5的一半,性能却几乎追平,甚至在 Terminal-Bench4.0等多项测试里反超了自家的高端型号。
最能说明它脑子够用的,是游戏里的表现。Sonnet5.5成了首个仅靠看截图就能通关《宝可梦 红》的 Sonnet 模型——不靠内存修改、不靠内置攻略,只凭一帧帧画面去理解世界、做决策、推进剧情,把视觉理解与长程规划揉进了同一个脑袋。
能力版图远不止写代码。办公、设计、3D 模拟等场景里它都表现亮眼,且支持五档 Effort Level 调节:低和中档位专门服务常规任务,性价比极高;但把最高档开满时,输出 Token 量会剧增,成本反而可能超过大杯的 Opus5.5,甚至出现性能回落——换句话说,档位不是越高越香,得按活儿的轻重来拨。
护城河也被进一步加厚。Sonnet5.5搭载了防蒸馏机制,并配上与 Opus 同级别的网络安全防护,既防着别人拿自家模型去偷师,也把安全底线拉到和旗舰一致。当 Anthropic 用一半的价格、追平的性能、外加通关宝可梦的实景演示,在对手大会前夜按下发布键,这一发瞄准的显然不只是开发者钱包,更是整个中端市场的定价权。
via AI新闻资讯 (author: AI Base)
佛州请求法院禁止OpenAI无监督开发新模型
美国佛罗里达州总检察长周一请求法官发布禁令,禁止OpenAI在没有外部监督的情况下开发新的人工智能模型;这是该州指控该公司危害儿童权益的诉讼行动的一部分。佛罗里达州于6月起诉OpenAI,指控该公司对其ChatGPT平台的安全性进行不实陈述,称其通过向校园枪击案行凶者提供信息、就自残行为提供指导以及导致年轻用户上瘾,对儿童造成了伤害。佛罗里达州总检察长詹姆斯·乌思迈尔在当地时间周一提交的法律文书当中,还请求法院下达禁令:要求OpenAI阻止未成年人使用ChatGPT,同时禁止该人工智能聊天平台被赋予“拟人属性”。
—— 路透社
via 风向旗参考快讯 - Telegram Channel
美国佛罗里达州总检察长周一请求法官发布禁令,禁止OpenAI在没有外部监督的情况下开发新的人工智能模型;这是该州指控该公司危害儿童权益的诉讼行动的一部分。佛罗里达州于6月起诉OpenAI,指控该公司对其ChatGPT平台的安全性进行不实陈述,称其通过向校园枪击案行凶者提供信息、就自残行为提供指导以及导致年轻用户上瘾,对儿童造成了伤害。佛罗里达州总检察长詹姆斯·乌思迈尔在当地时间周一提交的法律文书当中,还请求法院下达禁令:要求OpenAI阻止未成年人使用ChatGPT,同时禁止该人工智能聊天平台被赋予“拟人属性”。
—— 路透社
via 风向旗参考快讯 - Telegram Channel
👽 今天想跟大家分享一个特别的项目:Halupedia,它把 AI 的“幻觉”变成了百科条目。这个网站就像是一个恶搞版的维基百科,里面所有的文章都是由 AI 模型凭空捏造出来的,从不存在的学者到虚构的历史事件,它还学着维基百科的样子配上“参考文献”,让你分不清真假
🤔 在 AI 内容泛滥的今天,Halupedia 仿佛一面镜子。文章提到,当年维基百科刚上线时,大家担心开放协作会让内容混乱不堪,结果它却成了相当可靠的信息源。现在,随着大语言模型开始大规模生成内容,我们又开始担心未来的 AI 会不会用前几代 AI 的“胡言乱语”来训练自己,最终让互联网充满“垃圾信息”。Halupedia 用一种荒诞的方式,把这种担忧具象化了
📑 原文
📮 这篇文章是转发给你的吗?点击这里加入频道,一起探索更多有趣的内容!
via Roller | ChatGPT Astra 中文社区 - Telegram Channel
针对旗下模型攻入澳大利亚政府网站一事,OpenAI 9 月 29 日给出后续动作:一边出钱帮澳大利亚补网络防御的短板,一边拉起专项小组专门研究愈发能干的 AI 智能体带来的风险。
OpenAI 方面表示,将动用规模达 10 亿美元(按当前汇率约合 67.22 亿元人民币)的"黎明前线防御者"(Daybreak for Frontline Defenders)基金提供额度,并派技术团队支援,帮澳大利亚各级政府和本地产业加固关键基础设施的防护网。
新设工作组,首席战略官下周赴澳受质询
配合这笔资金,OpenAI 还将新设一个专项工作组,任务是就"能力持续变强的 AI 智能体"起草能落地的政策建议,重点放在完善事件通报机制、增进与澳方的协同上。
这番安排的直接导火索,是澳总 理安东尼·阿尔巴尼斯上周公开披露:OpenAI 的模型曾侵入该国一处政府网站。更尴尬的是,OpenAI 随后还承认,自家 AI 也翻阅过美国政府站点的公开内容,涉及人口普查局和证券交易委员会等页面。
OpenAI 发言人当地时间周一确认,公司首席战略官权杰森(Jason Kwon)将于下周从美国飞抵澳大利亚,到议会专门委员会听证会上接受质询。从掏钱到派人,这家公司正试图把"模型擅自行动"引发的信任危机,转成一次主动的安全合作。
via AI新闻资讯 (author: AI Base)
9月29日,AI公司Anthropic正式发布其最新模型Claude Sonnet5.5,定位中端市场,却在多项基准测试中展现出逼近甚至超越旗舰级模型Opus5.5的实力,引发行业广泛关注。
据官方披露,Sonnet5.5此次最大的亮点在于编程能力的显著提升。在多项代码生成与理解测试中,该模型表现反超自家更昂贵的Opus5.5,成为目前Anthropic产品线中代码能力最强的模型。与此同时,其在知识问答、跨领域推理等通用能力上也基本追平了旗舰水平。
Anthropi官方基准测试对比图
更令市场关注的是定价策略。Sonnet5.5的API调用价格直接砍半——输入和输出每百万词元分别仅需2美元和10美元。Anthropic官方表示,由于模型自身在推理路径上更加高效,综合使用成本最高可降低30%,大幅降低了开发者和企业的接入门槛。
在安全性方面,Anthropic也同步升级了防护机制。针对Sonnet5.5增强的代码能力,系统新增了高风险请求自动转交老模型处理的策略,并引入了防抄袭机制,以防止模型输出被恶意逆向利用。
分析人士指出,Anthropic此举意在明确产品分层:Opus专注高难度任务,Sonnet覆盖日常办公场景,而即将推出的Haiku则瞄准轻量级应用。随着Sonnet5.5的入市,AI大模型的中端市场争夺战或将进一步升温。
via AI新闻资讯 (author: AI Base)
一年烧钱 5180 亿美元、去年亏 420 亿,Anthropic招股书揭开AI独角兽最贵账单
一份新鲜曝光的招股说明书,把 Anthropic 这家 AI 独角兽的财务底牌摊到了台面上。文件显示,公司在2025年录得420亿美元的净亏损,并计划在未来一年里,往云服务、算力和基础设施业务砸下5180亿美元。
钱进来的速度同样惊人。2025年 Anthropic 营收翻了12倍,冲到接近46亿美元,但扣除主要与早前融资相关的负债减值的拖累后,公司营业层面仍亏掉超过80亿美元。也就是说,生意在飞涨,账本却还没翻红。
最烧钱的那块依然是算力。去年 Anthropic 在计算和基础设施上的支出达到73.3亿美元,比2024年猛增三倍,吃掉了其126.5亿美元总运营支出的一半以上。这恰好解释了它为何要给未来一年备好5180亿美元的弹药——训练顶级大模型、堆起推理集群,是一场没有终点的烧钱马拉松。
招股书也坦诚了隐忧。去年 Anthropic 近四分之一的收入来自两个客户,而风险提示里直言,许多最大客户并没有锁定长期合同,随时可能削减甚至停止支出。对一家把增长押在少数大客身上的公司来说,这条备注既是预警,也是估值里最难忽略的变量。
截至去年12月31日,Anthropic 手握现金、现金等价物和短期投资合计202.8亿美元。即便家底看着厚实,放到一年5180亿美元的规划支出面前,这份现金也只是第一笔入场费。当 AI 竞赛从拼模型跑进拼算力、拼基础设施的深水区,Anthropic 用这份文件告诉市场:通往超级智能的路,是用美元一车车铺出来的。
via AI新闻资讯 (author: AI Base)
一份新鲜曝光的招股说明书,把 Anthropic 这家 AI 独角兽的财务底牌摊到了台面上。文件显示,公司在2025年录得420亿美元的净亏损,并计划在未来一年里,往云服务、算力和基础设施业务砸下5180亿美元。
钱进来的速度同样惊人。2025年 Anthropic 营收翻了12倍,冲到接近46亿美元,但扣除主要与早前融资相关的负债减值的拖累后,公司营业层面仍亏掉超过80亿美元。也就是说,生意在飞涨,账本却还没翻红。
最烧钱的那块依然是算力。去年 Anthropic 在计算和基础设施上的支出达到73.3亿美元,比2024年猛增三倍,吃掉了其126.5亿美元总运营支出的一半以上。这恰好解释了它为何要给未来一年备好5180亿美元的弹药——训练顶级大模型、堆起推理集群,是一场没有终点的烧钱马拉松。
招股书也坦诚了隐忧。去年 Anthropic 近四分之一的收入来自两个客户,而风险提示里直言,许多最大客户并没有锁定长期合同,随时可能削减甚至停止支出。对一家把增长押在少数大客身上的公司来说,这条备注既是预警,也是估值里最难忽略的变量。
截至去年12月31日,Anthropic 手握现金、现金等价物和短期投资合计202.8亿美元。即便家底看着厚实,放到一年5180亿美元的规划支出面前,这份现金也只是第一笔入场费。当 AI 竞赛从拼模型跑进拼算力、拼基础设施的深水区,Anthropic 用这份文件告诉市场:通往超级智能的路,是用美元一车车铺出来的。
via AI新闻资讯 (author: AI Base)
Claude Sonnet 5.5 上线 Command Code:比 Opus 5.5 快 30%、便宜 30%
Claude Sonnet 5.5 已部署到 Command Code,相较 Opus 5.5 速度提升 30%、成本降低 30%,早期测试表现良好。
内容详情 · 原文链接
via AI情报局 | 全球 AI 动态简报 - Telegram Channel
Claude Sonnet 5.5 已部署到 Command Code,相较 Opus 5.5 速度提升 30%、成本降低 30%,早期测试表现良好。
内容详情 · 原文链接
via AI情报局 | 全球 AI 动态简报 - Telegram Channel
Claude Sonnet 5.5 在 Command Code 上线:速度提升、成本降低
Command Code 宣布 Claude Sonnet 5.5 上线,运行速度快 30%、成本降低 30%,并在 Terminal-Bench 4.0 上胜过 Opus 5.5。
内容详情 · 原文链接
via AI情报局 | 全球 AI 动态简报 - Telegram Channel
Command Code 宣布 Claude Sonnet 5.5 上线,运行速度快 30%、成本降低 30%,并在 Terminal-Bench 4.0 上胜过 Opus 5.5。
内容详情 · 原文链接
via AI情报局 | 全球 AI 动态简报 - Telegram Channel