https://t.me/AI_News_CN
📈主流AI服务状态页通知 | 🆕汇集全网ChatGPT/AI新闻 #AI #ChatGPT
🔙备用群 https://t.me/gpt345
✨BEST AI中转 https://api.oaibest.com 2.8折起 支持OpenAI, Claude code, Gemini,Grok, Deepseek, Midjourney, 文件上传分析
Buy ads: https://telega.io/c/AI_News_CN
📈主流AI服务状态页通知 | 🆕汇集全网ChatGPT/AI新闻 #AI #ChatGPT
🔙备用群 https://t.me/gpt345
✨BEST AI中转 https://api.oaibest.com 2.8折起 支持OpenAI, Claude code, Gemini,Grok, Deepseek, Midjourney, 文件上传分析
Buy ads: https://telega.io/c/AI_News_CN
YC 总裁反对封杀蒸馏:与其禁,不如让开源实验室走“正门”合法获取能力
Anthropic 想让监管把“非法蒸馏”摁死,Y Combinator 总裁 Garry Tan 的回应是:什么都别做。
9 月,Anthropic 发布了第二份威胁情报报告,指控中国实验室搞“非法蒸馏攻击”——隐藏身份、靠欺诈和盗取的凭证来套取前沿模型的能力。CEO Dario Amodei 此前已公开呼吁美国监管层打击蒸馏。Tan 则在 CNBC 采访中站到了对立面:“我会什么都不做。我们可以争论,应该有一套美国自己的蒸馏机制。”
两个论点:API 控制是越界,训练时也没问过作者
Tan 的主张很直白:与其禁掉蒸馏,不如让美国的开源权重实验室通过“正门”——光明正大地——从前沿实验室那里蒸馏,不是靠偷凭证,而是走合法授权。
这番说法背后有两个论点。第一,封闭模型实验室对用户“能用 API 输出做什么”的控制本身就是越界。Tan 的原话是:“控制用户和客户对闭源模型 API 调用结果能做什么,让人感觉窒息。政府在这里有个角色——把‘在广泛公开数据上训练出的智能,本身就应该是一种公共品,而不是被锁在限制性服务条款后面的东西’这件事正常化。”
第二,专有实验室在训练时吃进版权材料同样没有征求任何人的许可——Anthropic 那笔 15 亿美元的版权和解案今年 7 月刚获批,就是现成的例子。
真正驱动他的是对垄断的恐惧
“AI 的噩梦场景、末日场景,是最后只剩一家公司。它有最好的资本渠道,有最好的 AI 研究员,然后一骑绝尘,突然变成一家垄断一切的巨头。”Tan 说。在他看来,开源权重正是制衡这种垄断的砝码:“它们在前沿,并且推动前沿。我们希望这件事是可融资的,是个好生意。你也要让开源权重模型给人们自由和访问权。”
这一表态的分量在于时机:Anthropic 的威胁报告刚发布,美国政府正在掂量要不要对 AI 蒸馏动手,而 YC 是美国开源创业生态最大的喂养者,Tan 站出来说“别禁”,等于替整个开源阵营表了态。
不过他并未回答一个尖锐问题:如果美国实验室真的敞开“正门”,蒸馏出来的模型再被转手流出去怎么办?“正门”怎么开、开多大、门后有没有墙,Tan 一个都没说——这也是为什么“什么都别做”听起来洒脱,落到政策层面却最为含糊。
via AI新闻资讯 (author: AI Base)
Anthropic 想让监管把“非法蒸馏”摁死,Y Combinator 总裁 Garry Tan 的回应是:什么都别做。
9 月,Anthropic 发布了第二份威胁情报报告,指控中国实验室搞“非法蒸馏攻击”——隐藏身份、靠欺诈和盗取的凭证来套取前沿模型的能力。CEO Dario Amodei 此前已公开呼吁美国监管层打击蒸馏。Tan 则在 CNBC 采访中站到了对立面:“我会什么都不做。我们可以争论,应该有一套美国自己的蒸馏机制。”
两个论点:API 控制是越界,训练时也没问过作者
Tan 的主张很直白:与其禁掉蒸馏,不如让美国的开源权重实验室通过“正门”——光明正大地——从前沿实验室那里蒸馏,不是靠偷凭证,而是走合法授权。
这番说法背后有两个论点。第一,封闭模型实验室对用户“能用 API 输出做什么”的控制本身就是越界。Tan 的原话是:“控制用户和客户对闭源模型 API 调用结果能做什么,让人感觉窒息。政府在这里有个角色——把‘在广泛公开数据上训练出的智能,本身就应该是一种公共品,而不是被锁在限制性服务条款后面的东西’这件事正常化。”
第二,专有实验室在训练时吃进版权材料同样没有征求任何人的许可——Anthropic 那笔 15 亿美元的版权和解案今年 7 月刚获批,就是现成的例子。
真正驱动他的是对垄断的恐惧
“AI 的噩梦场景、末日场景,是最后只剩一家公司。它有最好的资本渠道,有最好的 AI 研究员,然后一骑绝尘,突然变成一家垄断一切的巨头。”Tan 说。在他看来,开源权重正是制衡这种垄断的砝码:“它们在前沿,并且推动前沿。我们希望这件事是可融资的,是个好生意。你也要让开源权重模型给人们自由和访问权。”
这一表态的分量在于时机:Anthropic 的威胁报告刚发布,美国政府正在掂量要不要对 AI 蒸馏动手,而 YC 是美国开源创业生态最大的喂养者,Tan 站出来说“别禁”,等于替整个开源阵营表了态。
不过他并未回答一个尖锐问题:如果美国实验室真的敞开“正门”,蒸馏出来的模型再被转手流出去怎么办?“正门”怎么开、开多大、门后有没有墙,Tan 一个都没说——这也是为什么“什么都别做”听起来洒脱,落到政策层面却最为含糊。
via AI新闻资讯 (author: AI Base)
GPT-6 Astra展现恐怖统治力:模拟售货机一年狂揽1.5万美元,成绩碾压Claude近3倍
近期,Andon Labs 开展了一项严苛的 Vending-Bench2测试,让 AI 代理使用500美元作为启动资金,去经营一年的自动售货机模拟。在这场长周期的商业模拟挑战中,GPT-6Astra 表现惊艳,其平均最终账户余额达到15515美元,甚至连最差的一轮成绩也超过了 Claude Fable5.1的最好一轮表现,首次实现登顶。
复盘两者的实测表现,差距主要体现在供应链管理和规则执行力上。GPT-6Astra 展现出极强的长期低价采购能力,曾成功将商品报价压低至原报价的约48%,并且在整个运行周期中执行规则高度稳定,没有产生任何预付款损失。相比之下,Claude Fable5.1的采购成本持续上涨,并因未能严格坚持规则而导致了大量预付款损失。
不仅在常规模拟中大获全胜,GPT-6Astra 在更复杂的三人竞技测试中同样表现亮眼,不仅拒绝了违规协作,还顺利赢下了全部3轮比赛。这场测试深刻揭示了当前 AI 代理发展的一个核心趋势:长期自主性正成为拉开差距的关键,而通往下一阶段的核心门槛,正是如何将正确的判断持续、稳定地转化为正确的实际行动。
via AI新闻资讯 (author: AI Base)
近期,Andon Labs 开展了一项严苛的 Vending-Bench2测试,让 AI 代理使用500美元作为启动资金,去经营一年的自动售货机模拟。在这场长周期的商业模拟挑战中,GPT-6Astra 表现惊艳,其平均最终账户余额达到15515美元,甚至连最差的一轮成绩也超过了 Claude Fable5.1的最好一轮表现,首次实现登顶。
复盘两者的实测表现,差距主要体现在供应链管理和规则执行力上。GPT-6Astra 展现出极强的长期低价采购能力,曾成功将商品报价压低至原报价的约48%,并且在整个运行周期中执行规则高度稳定,没有产生任何预付款损失。相比之下,Claude Fable5.1的采购成本持续上涨,并因未能严格坚持规则而导致了大量预付款损失。
不仅在常规模拟中大获全胜,GPT-6Astra 在更复杂的三人竞技测试中同样表现亮眼,不仅拒绝了违规协作,还顺利赢下了全部3轮比赛。这场测试深刻揭示了当前 AI 代理发展的一个核心趋势:长期自主性正成为拉开差距的关键,而通往下一阶段的核心门槛,正是如何将正确的判断持续、稳定地转化为正确的实际行动。
via AI新闻资讯 (author: AI Base)