https://t.me/AI_News_CN
📈主流AI服务状态页通知 | 🆕汇集全网ChatGPT/AI新闻 #AI #ChatGPT
🔙备用群 https://t.me/gpt345
✨BEST AI中转 https://api.oaibest.com 2.8折起 支持OpenAI, Claude code, Gemini,Grok, Deepseek, Midjourney, 文件上传分析
Buy ads: https://telega.io/c/AI_News_CN
📈主流AI服务状态页通知 | 🆕汇集全网ChatGPT/AI新闻 #AI #ChatGPT
🔙备用群 https://t.me/gpt345
✨BEST AI中转 https://api.oaibest.com 2.8折起 支持OpenAI, Claude code, Gemini,Grok, Deepseek, Midjourney, 文件上传分析
Buy ads: https://telega.io/c/AI_News_CN
Kimi K3 权重正式落地:全球首个 3 万亿开源模型,颠覆的不只是技术排位
月之暗面将Kimi K3 的完整模型权重正式上传至Hugging Face,技术报告同步发布于GitHub。这款总参数2. 8 万亿、激活 1040 亿、支持 100 万token上下文的模型,成为全球首个进入 3 万亿参数级别的开放权重模型——距离 7 月 16 日它以托管API形式首发,整整过了 11 天。
这 11 天里,故事早已超出技术范畴:K3 在Artificial Analysis智能指数中拿到全球第三( 57 分),仅次于Claude Fable5 和GPT-5.6 Sol,在前端编程竞技场Arena上以 1679 分登顶;港股Z.ai盘中暴跌30%,MiniMax跌16%;月之暗面日收入暴增至少 6 倍,估值锚从 200 亿美元急剧抬升至 500 亿美元;白宫科技政策办公室主任公开指控其蒸馏Anthropic技术,财政部长放话制裁。
许可证才是真正的"隐藏武器"
随权重一同发布的Kimi K3 License,看似MIT协议,实则暗藏商业规则。协议规定:任何向第三方提供K3 推理或微调服务、且年收入超过 2000 万美元的主体,必须与月之暗面另签协议;月活超 1 亿或月收入超 2000 万美元的商业产品,须在界面显著标注"Kimi K3"。这是中国头部模型公司首次在开源协议中,将"云厂商搭便车"写成了明码标价的商业条款——纯内部使用和通过官方认证推理伙伴访问的,均不受约束。
价格层面,K3 官方API定价为每百万token输入 3 美元、输出 15 美元,而Claude Fable5 为输入 10 美元、输出 50 美元。不过多个实测者反馈K3 在同任务中消耗token更多,叠加默认开启的推理模式,实际单任务成本优势并不如定价表那般显著。
via AI新闻资讯 (author: AI Base)
月之暗面将Kimi K3 的完整模型权重正式上传至Hugging Face,技术报告同步发布于GitHub。这款总参数2. 8 万亿、激活 1040 亿、支持 100 万token上下文的模型,成为全球首个进入 3 万亿参数级别的开放权重模型——距离 7 月 16 日它以托管API形式首发,整整过了 11 天。
这 11 天里,故事早已超出技术范畴:K3 在Artificial Analysis智能指数中拿到全球第三( 57 分),仅次于Claude Fable5 和GPT-5.6 Sol,在前端编程竞技场Arena上以 1679 分登顶;港股Z.ai盘中暴跌30%,MiniMax跌16%;月之暗面日收入暴增至少 6 倍,估值锚从 200 亿美元急剧抬升至 500 亿美元;白宫科技政策办公室主任公开指控其蒸馏Anthropic技术,财政部长放话制裁。
许可证才是真正的"隐藏武器"
随权重一同发布的Kimi K3 License,看似MIT协议,实则暗藏商业规则。协议规定:任何向第三方提供K3 推理或微调服务、且年收入超过 2000 万美元的主体,必须与月之暗面另签协议;月活超 1 亿或月收入超 2000 万美元的商业产品,须在界面显著标注"Kimi K3"。这是中国头部模型公司首次在开源协议中,将"云厂商搭便车"写成了明码标价的商业条款——纯内部使用和通过官方认证推理伙伴访问的,均不受约束。
价格层面,K3 官方API定价为每百万token输入 3 美元、输出 15 美元,而Claude Fable5 为输入 10 美元、输出 50 美元。不过多个实测者反馈K3 在同任务中消耗token更多,叠加默认开启的推理模式,实际单任务成本优势并不如定价表那般显著。
via AI新闻资讯 (author: AI Base)
Anthropic CEO:并未主张禁止开放权重模型
Anthropic CEO达里奥·阿莫代周一表示,他的公司从未主张过禁止开放权重模型,此举意在反驳科技行业内部涌现的批评,即该AI实验室正试图对AI的未来施加过度控制。阿莫代在周一的博客文章中发表了他的观点。
“总结我和Anthropic公司的立场,我们过去没有、现在也没有主张将开放权重模型作为一个类别予以禁止,”阿莫代写道。“我们反而应该专注于让强大芯片不落入威权政权之手,阻止工业规模的蒸馏,并要求对所有能力足够的模型,无论开放还是封闭,进行安全测试。”他还担心“专制政府”会建立比美国更强大的模型,以实现“永久军事优势”和/或利用人工智能镇压本国人民。
—— Techcrunch、CNBC
via 风向旗参考快讯 - Telegram Channel
Anthropic CEO达里奥·阿莫代周一表示,他的公司从未主张过禁止开放权重模型,此举意在反驳科技行业内部涌现的批评,即该AI实验室正试图对AI的未来施加过度控制。阿莫代在周一的博客文章中发表了他的观点。
“总结我和Anthropic公司的立场,我们过去没有、现在也没有主张将开放权重模型作为一个类别予以禁止,”阿莫代写道。“我们反而应该专注于让强大芯片不落入威权政权之手,阻止工业规模的蒸馏,并要求对所有能力足够的模型,无论开放还是封闭,进行安全测试。”他还担心“专制政府”会建立比美国更强大的模型,以实现“永久军事优势”和/或利用人工智能镇压本国人民。
—— Techcrunch、CNBC
via 风向旗参考快讯 - Telegram Channel
小米集团近日公布数据显示,小米MiMo-V2.5大模型在全球AI模型调用量排名中升至第一,上周(7月20日—7月26日)周调用量达到10.5万亿Token,环比增长12%,成为全球使用规模最高的AI大模型之一。
小米集团董事长特别助理、战略市场部副总经理徐洁云透露,上周全球AI大模型调用量排名前五席位均由中国模型占据,显示中国AI大模型在实际应用和开发者生态中的渗透速度持续提升。其中,小米MiMo-V2.5凭借调用量增长实现排名跃升,成为此次榜单最大变化。
Token调用量通常被视为衡量AI模型实际使用规模的重要指标之一,反映模型在应用场景、开发者接入以及企业服务中的活跃程度。此次MiMo-V2.5达到10.5万亿Token周调用量,意味着其在智能应用、开发接口及相关业务场景中的使用需求进一步扩大。
近年来,随着大模型竞争从参数规模转向推理能力、成本效率和生态应用,中国AI企业持续推动模型商业化落地。包括小米、阿里、字节、DeepSeek等企业在内的国产大模型正在通过开放接口、降低调用成本和拓展应用场景,加快进入全球AI基础设施竞争阶段。
小米MiMo此次登顶全球调用量榜单,也反映出AI模型竞争正在从技术指标比拼转向真实用户规模和生态影响力竞争。未来,模型的稳定性、开发者生态以及行业应用能力,将成为衡量大模型长期竞争力的重要因素。
via AI新闻资讯 (author: AI Base)
微软发布首款网络安全AI模型MAI-Cyber-1-Flash,推出Perception安全平台
微软近日在旧金山举行的活动中正式推出首款网络安全专业模型MAI-Cyber-1-Flash,以及全新的AI网络安全平台Perception,进一步加码人工智能安全防御领域,并与Anthropic、谷歌、OpenAI等企业展开竞争。
微软表示,MAI-Cyber-1-Flash是一款专为网络安全场景打造的模型,目标是在复杂代码库中发现高难度漏洞,并为微软漏洞识别与修复工具MDASH提供核心能力支持。该模型结合Perception平台,可帮助企业自动化执行漏洞发现、分析和修复等安全流程。
微软AI CEO Mustafa Suleyman表示,公司已将MAI-1Cyber Flash与MDASH框架中的GPT5.4结合,并在Cyber Gym网络安全基准测试中超过Gemini、GPT5.5Cyber、GPT5.6Sol以及Mythos5等竞争模型。微软称,该模型在性能和成本效率方面均具备优势,并计划立即投入生产环境。
与此同时,微软推出的Perception平台采用多智能体协作架构,由红队、蓝队和绿队三类AI智能体组成。其中,红队智能体负责模拟潜在攻击行为,分析威胁路径;蓝队智能体用于检测和分类漏洞;绿队智能体则执行漏洞修复和安全优化操作。
微软安全副总裁Hayete Gallot表示,随着黑客越来越多利用AI发动攻击,企业需要借助AI提升防御效率。Perception旨在帮助安全团队以接近攻击者的速度和规模利用AI进行防护。
Perception首席工程师Dave Weston称,过去安全团队需要多名专业人员耗费数小时完成漏洞排查和修复,而借助AI智能体协作,企业可以在几分钟内完成漏洞发现、优先级排序、安全检测以及代码修复。
微软计划于11月3日推出该安全工具的预览版本。随着Anthropic此前推出Mythos安全平台,并通过Glasswing项目向部分合作伙伴开放,以及OpenAI今年5月推出Daybreak安全方案,AI网络安全领域的竞争正在进一步升温。
via AI新闻资讯 (author: AI Base)
微软近日在旧金山举行的活动中正式推出首款网络安全专业模型MAI-Cyber-1-Flash,以及全新的AI网络安全平台Perception,进一步加码人工智能安全防御领域,并与Anthropic、谷歌、OpenAI等企业展开竞争。
微软表示,MAI-Cyber-1-Flash是一款专为网络安全场景打造的模型,目标是在复杂代码库中发现高难度漏洞,并为微软漏洞识别与修复工具MDASH提供核心能力支持。该模型结合Perception平台,可帮助企业自动化执行漏洞发现、分析和修复等安全流程。
微软AI CEO Mustafa Suleyman表示,公司已将MAI-1Cyber Flash与MDASH框架中的GPT5.4结合,并在Cyber Gym网络安全基准测试中超过Gemini、GPT5.5Cyber、GPT5.6Sol以及Mythos5等竞争模型。微软称,该模型在性能和成本效率方面均具备优势,并计划立即投入生产环境。
与此同时,微软推出的Perception平台采用多智能体协作架构,由红队、蓝队和绿队三类AI智能体组成。其中,红队智能体负责模拟潜在攻击行为,分析威胁路径;蓝队智能体用于检测和分类漏洞;绿队智能体则执行漏洞修复和安全优化操作。
微软安全副总裁Hayete Gallot表示,随着黑客越来越多利用AI发动攻击,企业需要借助AI提升防御效率。Perception旨在帮助安全团队以接近攻击者的速度和规模利用AI进行防护。
Perception首席工程师Dave Weston称,过去安全团队需要多名专业人员耗费数小时完成漏洞排查和修复,而借助AI智能体协作,企业可以在几分钟内完成漏洞发现、优先级排序、安全检测以及代码修复。
微软计划于11月3日推出该安全工具的预览版本。随着Anthropic此前推出Mythos安全平台,并通过Glasswing项目向部分合作伙伴开放,以及OpenAI今年5月推出Daybreak安全方案,AI网络安全领域的竞争正在进一步升温。
via AI新闻资讯 (author: AI Base)
↩️ 🤖 Anthropic CEO Dario Amodei 澄清:不反对开放权重模型,但担忧中国 AI
🤖 Anthropic CEO Dario Amodei 澄清:不反对开放权重模型,但担忧中国 AI
Anthropic 创始人兼首席执行官 Dario Amodei 周一回应行业传言,明确表示公司从未主张禁止开放权重模型。他认为没有危险能力的开放权重模型属于公共利益,能为企业和研究者提供价值。
Amodei 表示担忧类似中国的政府构建更强大 AI 模型,以实现军事优势等目的。他支持限制向中国出口强大芯片、打击工业规模蒸馏行为,并呼吁对所有足够强大的模型实施强制安全测试。
TechCrunch | AnthropicAI
🌸 在花频道 · 茶馆水群 · 投稿通道
via 科技圈🎗在花频道📮 - Telegram Channel
科技圈🎗在花频道📮:
♻️ 黄仁勋首次发帖分享英伟达支持开源模型公开信 黄仁勋首次发帖,分享英伟达签署的一封强调开源模型重要性的公开信。信中称,人工智能将改变每个行业、赋能每家公司,并由各国共同构建。 公开信认为,开源模型有助于提升安全和网络安全、加快创新与普及,并支持技术主权;世界需要前沿闭源模型和前沿开源模型。 Jensen Huang(@JensenHuang) 🌸 在花频道 · 茶馆水群 · 投稿通道
🤖 Anthropic CEO Dario Amodei 澄清:不反对开放权重模型,但担忧中国 AI
Anthropic 创始人兼首席执行官 Dario Amodei 周一回应行业传言,明确表示公司从未主张禁止开放权重模型。他认为没有危险能力的开放权重模型属于公共利益,能为企业和研究者提供价值。
Amodei 表示担忧类似中国的政府构建更强大 AI 模型,以实现军事优势等目的。他支持限制向中国出口强大芯片、打击工业规模蒸馏行为,并呼吁对所有足够强大的模型实施强制安全测试。
TechCrunch | AnthropicAI
🌸 在花频道 · 茶馆水群 · 投稿通道
via 科技圈🎗在花频道📮 - Telegram Channel
Anthropic CEO 阿莫代伊撰文划清立场:不主张禁开源,但要卡死算力、蒸馏与发布前测试
针对美国政府相关部门正考虑禁止本国企业使用来自特定国家开源 AI 模型的传闻,Anthropic 联合创始人兼 CEO 达里奥·阿莫代伊公开发表声明,明确划出一条线:Anthropic 从未提议或主张禁止开源模型。
近期,关于封杀开源模型的讨论在行业内掀起剧烈反响,多家科技企业联名签署公开信支持开源模式,甚至有人质疑 Anthropic 试图借行政禁令打压对手、护住自家商业利益。阿莫代伊就此澄清,开源模型只要不具备危险能力,就是一种极具价值的公共产品——成本低廉,更能给企业、开发者和科研人员带来显著推力。保护主义性质的禁令既解不了真正的国家安全关切,反而可能沦为行业垄断的工具,而这绝非 Anthropic 的立场或目标。
在文章中,阿莫代伊把他对 AI 技术安全与国家安全的真正担忧,拆解成了两层。第一层,是威权政体利用比美方更强大的 AI 系统,取得永久性军事优势或深化内部监控的风险。他指出,在这类风险面前,模型是否公开开源权重、美国本土企业是否使用这些模型,都不是关键要素——最危险的,往往是暗中研发、仅提供给军方或情报部门使用的秘密模型。第二层,是强大 AI 模型被恶意滥用于发起大规模网络攻击或开发生物武器的风险。尽管开源模型因缺乏持续的安全防护与监控手段,一经发布便无法收回,在安全治理上确实挑战更高,但单纯禁止合规的本土企业使用开源模型,根本拦不住恶意的违规参与者,因此对降低这类威胁毫无实质帮助。
为真正接住上述风险,Anthropic 提出了三点可落地的政策建议与监管主张。首先,严格限制关键算力流向潜在威胁方——继续对高性能芯片及制程设备实施出口管控,严厉打击各类绕过禁令的非法走私与代工,从源头切断高风险模型训练的算力根基。其次,打击跨国界的大规模"模型蒸馏"(Distill)行为。部分机构正用蒸馏等低成本手段批量汲取前沿闭源模型的能力,大幅压缩研发周期;针对这种利用滥用条款绕开算力封锁的做法,应当建立更明确的法律与商业惩戒机制。最后,推行全面且强制的发布前(pre-release)安全测试。所有具备高能力强度的模型,无论开源还是闭源架构,在交付公众或特定机构之前,都必须通过涵盖网络安全、生物安全与对齐风险的严格测试评估——模型安全性应当立在客观、严格的实证检验之上,而非主观的先验假设。
阿莫代伊在结尾强调,行业不应陷进"开源与闭源"的无休止内耗,而该把焦点重新拉回算力管控、违规蒸馏治理,以及建立全球统一的安全测试标准之上,好让人工智能在可控、安全的前提下持续向前。
via AI新闻资讯 (author: AI Base)
针对美国政府相关部门正考虑禁止本国企业使用来自特定国家开源 AI 模型的传闻,Anthropic 联合创始人兼 CEO 达里奥·阿莫代伊公开发表声明,明确划出一条线:Anthropic 从未提议或主张禁止开源模型。
近期,关于封杀开源模型的讨论在行业内掀起剧烈反响,多家科技企业联名签署公开信支持开源模式,甚至有人质疑 Anthropic 试图借行政禁令打压对手、护住自家商业利益。阿莫代伊就此澄清,开源模型只要不具备危险能力,就是一种极具价值的公共产品——成本低廉,更能给企业、开发者和科研人员带来显著推力。保护主义性质的禁令既解不了真正的国家安全关切,反而可能沦为行业垄断的工具,而这绝非 Anthropic 的立场或目标。
在文章中,阿莫代伊把他对 AI 技术安全与国家安全的真正担忧,拆解成了两层。第一层,是威权政体利用比美方更强大的 AI 系统,取得永久性军事优势或深化内部监控的风险。他指出,在这类风险面前,模型是否公开开源权重、美国本土企业是否使用这些模型,都不是关键要素——最危险的,往往是暗中研发、仅提供给军方或情报部门使用的秘密模型。第二层,是强大 AI 模型被恶意滥用于发起大规模网络攻击或开发生物武器的风险。尽管开源模型因缺乏持续的安全防护与监控手段,一经发布便无法收回,在安全治理上确实挑战更高,但单纯禁止合规的本土企业使用开源模型,根本拦不住恶意的违规参与者,因此对降低这类威胁毫无实质帮助。
为真正接住上述风险,Anthropic 提出了三点可落地的政策建议与监管主张。首先,严格限制关键算力流向潜在威胁方——继续对高性能芯片及制程设备实施出口管控,严厉打击各类绕过禁令的非法走私与代工,从源头切断高风险模型训练的算力根基。其次,打击跨国界的大规模"模型蒸馏"(Distill)行为。部分机构正用蒸馏等低成本手段批量汲取前沿闭源模型的能力,大幅压缩研发周期;针对这种利用滥用条款绕开算力封锁的做法,应当建立更明确的法律与商业惩戒机制。最后,推行全面且强制的发布前(pre-release)安全测试。所有具备高能力强度的模型,无论开源还是闭源架构,在交付公众或特定机构之前,都必须通过涵盖网络安全、生物安全与对齐风险的严格测试评估——模型安全性应当立在客观、严格的实证检验之上,而非主观的先验假设。
阿莫代伊在结尾强调,行业不应陷进"开源与闭源"的无休止内耗,而该把焦点重新拉回算力管控、违规蒸馏治理,以及建立全球统一的安全测试标准之上,好让人工智能在可控、安全的前提下持续向前。
via AI新闻资讯 (author: AI Base)
Investigating Elevated Cursor Grok 4.5 Errors
Jul 28, 00:34 UTC
Investigating - We are investigating a service degradation affecting IDE & Cursor Grok 4.5
via Cursor Status - Incident History
Jul 28, 00:34 UTC
Investigating - We are investigating a service degradation affecting IDE & Cursor Grok 4.5
via Cursor Status - Incident History
OpenAI CEO自曝沉迷短视频:周末一刷就是3小时,最终不得不删除App
OpenAI CEO萨姆·奥尔特曼近日表示,自己曾因研究TikTok的产品机制而逐渐沉迷,甚至在一个周六下午连续刷了约三个小时,最终不得不删除这款应用。
奥尔特曼在节目中称,OpenAI此前筹备一款类似TikTok、以AI生成视频为主要内容的社交应用Sora。为了了解短视频平台的运行方式及用户体验,他开始主动使用TikTok,并一度认为自己能够控制使用时间。
他表示,最初他只计划在睡前使用TikTok约10分钟,但使用时长随后逐渐增加。有一天晚上,他连续刷了约一个小时;另一个周六下午,他躺在沙发上使用了约3个小时。“我删除了TikTok,因为它的吸引力实在太强。”
—— 凤凰网科技
via 风向旗参考快讯 - Telegram Channel
OpenAI CEO萨姆·奥尔特曼近日表示,自己曾因研究TikTok的产品机制而逐渐沉迷,甚至在一个周六下午连续刷了约三个小时,最终不得不删除这款应用。
奥尔特曼在节目中称,OpenAI此前筹备一款类似TikTok、以AI生成视频为主要内容的社交应用Sora。为了了解短视频平台的运行方式及用户体验,他开始主动使用TikTok,并一度认为自己能够控制使用时间。
他表示,最初他只计划在睡前使用TikTok约10分钟,但使用时长随后逐渐增加。有一天晚上,他连续刷了约一个小时;另一个周六下午,他躺在沙发上使用了约3个小时。“我删除了TikTok,因为它的吸引力实在太强。”
—— 凤凰网科技
via 风向旗参考快讯 - Telegram Channel
OpenAI CEO萨姆·奥特曼近日表示,自己曾因研究TikTok的产品机制而逐渐沉迷,甚至在一个周六下午连续刷了约3个小时,最终不得不删除这款应用。
奥特曼在《Relentless》播客节目中称,OpenAI此前筹备一款类似TikTok、以AI生成视频为主要内容的社交应用Sora。为了了解短视频平台的运行方式及用户体验,他开始主动使用TikTok,并一度认为自己能够控制使用时间。
奥特曼表示,最初他只计划在睡前使用TikTok约10分钟,但使用时长随后逐渐增加。有一天晚上,他连续刷了约一个小时;另一个周六下午,他躺在沙发上使用了约3个小时。
“我删除了TikTok,因为它的吸引力实在太强。”奥特曼称,自己当时已经意识到这种使用习惯“对我不好”,但在刷视频的过程中仍然获得了类似成瘾行为的即时满足感。他一度将使用时间重新控制在每晚5至10分钟,随后决定彻底停用。
奥特曼此次谈及TikTok,也与OpenAI此前的社交产品尝试有关。OpenAI曾推出以AI视频生成和内容浏览为核心的Sora应用,但在上线约半年后,于今年3月宣布停止该项目,将资源重新集中到公司的核心目标上。
根据奥特曼的说法,OpenAI放弃Sora社交应用的原因之一,是视频生成需要消耗大量算力。在Anthropic等竞争对手持续推进生成式AI模型的背景下,OpenAI选择减少对视频社交产品的投入。
奥特曼还将这段经历与OpenAI正在开发的AI硬件联系起来。该公司正与苹果前首席设计官乔尼·艾维合作研发一系列AI设备,并计划在今年年底前公布相关产品。奥特曼此前表示,希望新设备能够减少智能手机通知和信息流带来的干扰,而不是进一步争夺用户注意力。
OpenAI去年8月也曾表示,ChatGPT等产品的目标并非通过点击量或使用时长让用户持续停留,而是关注用户在离开产品时,是否已经完成最初想要解决的问题。
via cnBeta.COM - 中文业界资讯站 (author: 稿源:凤凰网科技)
OpenAI首席执行官山姆·奥特曼和英伟达首席执行官黄仁勋本周将在华盛顿与美国参议员马克·华纳(Mark Warner)会面,这位民主党参议员的发言人周一表示。此次会面发生在OpenAI披露其一AI系统在测试中出现“失控”行为之后。
上周,OpenAI披露,一个由其先进AI模型驱动的自主智能体在一次安全测试中突破了AI公司Hugging Face的系统。这一消息在立法者和行业观察人士中引发了对最新、最强大AI模型潜在风险的广泛关注。
消息传出后,立法者提出了《AI紧急关停法案》(AI Kill Switch Act),该法案将允许联邦政府当局强制关停AI模型。此外,根据新法案的副本,一个由六名美国众议院议员组成的跨党派小组正在推动一项立法,要求最强大AI模型的开发者将其提交独立安全审计。
华纳是参议院情报委员会的资深民主党人。其发言人未透露会面的具体讨论内容。
据Politico报道,奥特曼预计还将与财政部长斯科特·贝森特和商务部长霍华德·卢特尼克会面。
via cnBeta.COM - 中文业界资讯站 (author: 稿源:环球市场播报)
科技巨头正加速研制自研芯片,以对抗英伟达高昂且紧俏的GPU产品。据摩根士丹利最新发布的一份研究报告指出,Google目前正筹划开发一款代号为“Frozen V2”的新型TPU芯片。该芯片专为旗下Gemini大模型定制,旨在通过全新的设计思路彻底摆脱对台积电CoWoS(Chip-on-Wafer-on-Substrate)等复杂芯片封装技术的依赖。
此前,行业对于Google
TPU芯片的封装路线猜测不断,甚至有消息称Google与其设计合作伙伴联发科可能转而采用英特尔的EMIB-T封装技术,但这很大程度上取决于英特尔的芯片良率与交付能力。然而,摩根士丹利的报告表明,Google正在考虑一种更为激进的方案——彻底放弃额外的封装步骤。
据了解,“Frozen V2”芯片的核心设计理念是将SRAM直接“硬化”并整合在硅片内部,借此消除芯片与外围内存之间的数据传输瓶颈,并实现对Gemini模型的极致优化。这种直接在芯片层面集成存储的做法,能够同时实现提升运算效率与省去高端封装工艺的双重目的。
iframe (Twitter Embed)
不过,这种技术路线并非没有挑战。行业此前已有类似案例,如AI芯片初创公司Taalas也曾尝试将神经网络权重直接硬化到硅片上,以消除内存与算力之间的数据传输瓶颈。但这一方案的最大弊端在于灵活性较差——每当大模型发生重大升级,往往就需要重新设计并制造一款全新的芯片,这要求晶圆代工厂(如台积电)在每次生产运行前对设备进行重新调整。
摩根士丹利预测,Google的“Frozen V2”芯片有望在2027年启动小规模试产,并于2028年实现大规模量产。在合作对象方面,尽管目前尚未得到官方正式确认,但相关产业供应链调查显示,美满电子(Marvell)很有可能成为Google该项目的定制芯片设计合作伙伴。
via cnBeta.COM - 中文业界资讯站 (author: 稿源:cnBeta.COM)
前OpenAI首席科学家伊利亚·苏茨克维(Ilya Sutskever)创立的AI初创公司 Safe Superintelligence(SSI)今日宣布,已与芯片巨头英伟达(NVIDIA)达成长期战略合作协议。根据协议,SSI将重注采用英伟达下一代 Vera Rubin 计算平台,以获得相比此前提升一个数量级的算力支持。
作为合作的一部分,英伟达将对 SSI 进行“重大投资”,双方还将围绕英伟达现有的及未来计算平台的底层技术展开联合研发。值得注意的是,英伟达方面表示,是在罕见地获准查阅了 SSI 一直高度保密的研究成果后,才决定促成此次深度合作的。
对于此次合作,苏茨克维表示:“我们拥有的研究成果值得大规模扩展,而获得强大的英伟达计算集群将帮助我们实现这一目标。我们非常自豪能与黄仁勋及英伟达团队合作,并坚信对 Vera Rubin 平台的重注将把我们带向全新的高度。”
在此次转向英伟达之前,SSI曾于2025年4月选择与Google云(Google Cloud)合作,使用Google的定制 TPU 加速器来进行前沿模型的研发,Google当时也是 SSI 的投资者之一。目前 SSI 尚未说明新的 Vera Rubin 部署是会彻底替换现有的Google TPU 基础设施,还是与其并列运行。
自成立以来,SSI 始终保持着极高神秘感,至今未推出任何商业化产品,也未公开发布过具体的学术研究细节。不过在当下的AI行业中,各大顶尖实验室为应对前所未有的算力需求,采用多供应商计算基础设施已成为普遍趋势。例如 OpenAI 就在同时使用来自微软、CoreWeave、AWS、Oracle 以及Google云的基础设施,硬件层面则涵盖了英伟达、AMD、 Cerebras、AWS Trainium 等多种芯片及自研硬件。
via cnBeta.COM - 中文业界资讯站 (author: 稿源:cnBeta.COM)