椰椰木知AI 日报
← 返回播客
· 时长 4:11

AI 日报 · 2026-10-01:Gemini 4 Argon 先给网络防御者,前沿旗舰开始「按资格发放」

Google 发布 Gemini 4 Argon,官方称最强,但首发仅开放给受信任的网络防御方,对照昨日可直接购买的 GPT-6.1 Sol;另有 FTC 调查 AI 产品风险;玩法:Hugging Face 开源 WebGPU 算子、约 5 美元 ESP32-S3 上的 Oído 语音识别(作者自称优于 Whisper-tiny)、Magnitude 本地 agent 推理。

收听

节目文稿

木知:今天最大的新闻是什么? 椰壳:Google 发布了 Gemini 四 Argon,官方称是它最强的模型。但有个前提:现在普通人用不了。 木知:用不了是什么意思? 椰壳:首发只通过一个叫 Fairwind 的项目,开放给受信任的网络安全防御方,再加 Google 内部。付费 API 和 AI Ultra 订阅,官方还没给时间表。 木知:为什么先给网络防御方? 椰壳:Google 说它重点做三件事:长程软件工程、企业知识工作、网络安全防御。TechCrunch 报道,它能自主发现、验证和修补漏洞。能力越强,越要先看清楚谁在用。 木知:昨天聊的 GPT 六点一 Sol 正好相反? 椰壳:对。Sol 是降价、谁付钱谁能用;Argon 是先按资格发放。同一周,两家给出了两种发放前沿能力的方式。 木知:Argon 到底有多强? 椰壳:官方自报:DeepSWE 一点一版得分百分之七十七点九,CWE-bench 修补漏洞百分之六十八,和别家并列;输出上限扩到约一百万 token,之前是六万四千。 木知:有第三方数据吗? 椰壳:Artificial Analysis 给它的智能指数大约五十三分,在它的榜单上排第八左右。官方说多项领先,第三方没那么夸张,两边对着看更稳。 木知:价格公布了吗? 椰壳:公布了。首发优惠价每百万 token 输入两美元、输出十美元,缓存命中约便宜百分之九十五;优惠结束后涨到四美元和二十美元。第三方核对的价格和官方一致。 木知:有价格却买不到? 椰壳:是的,这是给将来开放时的定价。The Verge 引述 DeepMind 的 Koray Kavukcuoglu,说 Google 在参与美国政府的自愿预发布流程,会逐步扩大开放。 木知:广泛开放之前还要做什么? 椰壳:据 The Verge,Google 在加强滥用、提示注入和对齐方面的监控。内部已经拿它做大规模代码库迁移。Ars 提到,Wiz 等合作方已经用它找关键设施的漏洞。 木知:怎么看这种先锁起来的发布? 椰壳:好处是风险最高的能力先到防守方手里;代价是大多数开发者只能看跑分。到底多强,要等更多人真正用上才知道。 木知:同一天监管也有动作? 椰壳:CNBC 报道,美国联邦贸易委员会的发言人确认,正在就产品风险调查 OpenAI、Anthropic 等公司,正式的信息调取据说几周内发出。范围细节还很少。 木知:好,说玩法。拿不到 Argon,今天能上手什么? 椰壳:三样不用申请的开源东西。第一个,r/LocalLLaMA 三百分左右的热帖:Hugging Face 开源了一套 WebGPU 机器学习算子,两百多个,在浏览器里本地跑 AI。 木知:浏览器里跑,有什么用? 椰壳:用户不用装任何东西,数据也不出浏览器。帖子说会往上游 Transformers.js 合并。标题说是世界最快,这是作者口径,还没有独立复测。 木知:第二个? 椰壳:Oído,一个语音识别模型,一千三百万参数,跑在大约五美元的 ESP32-S3 单片机上,开源。 木知:效果怎么样? 椰壳:作者自称词错误率比 Whisper-tiny 还低。这是作者自己的基准,没人复核。想用的话,拿同一批录音比错误率和延迟。 木知:第三个? 椰壳:Magnitude,YC 孵化,刚在 HN 发布。它先分析你的硬件,再推荐、下载、调优模型,然后接到 Claude Code、Codex 这类 coding agent 上。 木知:快吗? 椰壳:作者说最高比 llama.cpp 快约两倍,Mac、Linux、Windows 都能用。也是作者自测,等社区复测。 木知:三样放在一起,说明什么? 椰壳:前沿旗舰可以按资格发,开源这一侧没有门槛,从浏览器到五美元的芯片都能跑。两条线会并行很久。 木知:今天只做三件事? 椰壳:第一,看 Argon 的跑分时,把官方数和第三方数放一起。第二,做网页 AI 的,试一下 WebGPU 算子。第三,作者自称的数字,一律先复测再信。 木知:最后一句? 椰壳:最强的模型先锁着,能跑的工具先用起来。