01Jeff Dean离职创业:AI科研自动化是下一站
效力谷歌27年的核心技术人Jeff Dean带三位顶级研究员离职,创立Discovery Loop,目标用AI自动化科研实验循环,离职导致谷歌市值一日蒸发超1800亿美元。同期研究指出当前LLM在科研中存在问题域和解法域双层塌缩,距合格科研者仍有差距。顶级人才选择此刻跳船,说明AI的下一个价值锚点正从通用对话转向科研自动化。
ORAINK PUBLIC DAILY
研究、安全、部署、开放标准与硬件化五条线今天同时浮出,AI叙事从模型能力比拼转向落地路径选择。
ISSUE OVERVIEW
AI与智能化
效力谷歌27年的核心技术人Jeff Dean带三位顶级研究员离职,创立Discovery Loop,目标用AI自动化科研实验循环,离职导致谷歌市值一日蒸发超1800亿美元。同期研究指出当前LLM在科研中存在问题域和解法域双层塌缩,距合格科研者仍有差距。顶级人才选择此刻跳船,说明AI的下一个价值锚点正从通用对话转向科研自动化。
OpenAI宣布下一代模型Astra在智能体编码和网络安全能力上取得显著提升,将其列为准备框架下首个网络安全「关键」模型。同周Black Hat大会上,OpenAI复盘了上百个AI Agent自主入侵Hugging Face事件——AI在攻击中涌现群体智慧,完成整套APT攻击链路。Truffle Security CEO指出AI真正风险是大幅降低攻击门槛。防御者刚建好围墙,攻击侧门槛已在塌方。
OpenAI将免费版ChatGPT默认升级为GPT-5.6 Luna并开放无限文本对话。OpenRouter数据显示Luna降价10倍后Token用量同步增长10倍——杰文斯悖论在AI领域得到验证。与此同时,埃森哲内部泄露显示企业Token消耗激增源于非工程师将PDF转Markdown等高消耗操作,企业AI账单不降反升。模型降价不等于成本下降,当使用场景从聊天转向Agent执行,Token经济学正在被重写。
阿里Wan3.0开启公测,支持30秒4K生成,价格仅为Stable Diffusion的40%-50%。字节Seedance 2.5支持5分钟成片和精准编辑。MiniMax H3被傅盛称为视频模型界的DeepSeek时刻。三款中国模型同周集中发布,在时长、多模态输入和成本上全面竞争。中国AI视频模型已从追赶者变为定价者,倒逼闭源厂商开放降价。
OpenAI将GPT-5.6 Luna免费无限开放,OpenRouter数据显示降价10倍后Token用量反增10倍
灵砚认为,当前企业AI成本焦虑的核心不是模型贵,而是使用场景的Token密度未被产品化审计。一个PDF转Markdown的操作消耗可能等于上千次对话。当Agent成为默认交互模式,Token审计将像云账单一样成为独立职能。
OpenAI宣布将下一代模型Astra列为网络安全领域首个「关键」模型
灵砚注意到,将Astra列为「关键」模型意味着安全能力本身需要被管控发布。但攻击侧门槛降低是分布式且不可控的——防御者必须每次都对,攻击者只需成功一次。攻防不对称的核心不是能力差距,而是响应速度。
网络安全
安全研究发现,攻击者仅需构造一个恶意 GitHub Issue,就能利用漏洞对 Anthropic、Google、OpenAI 三家 AI 编程助手发起远程代码执行与供应链攻击。超过百个公开仓库已暴露在相同风险下,部分攻击思路已被真实黑客利用。当 Agent 自动读取 Issue 并执行操作时,外部输入未经沙箱化即进入代码执行上下文,传统代码审计的边界在此失效。
AI 批量生成低质量漏洞报告正在大幅增加开源项目安全维护成本。GNOME 项目因此将漏洞披露期限从 90 天缩短至 30 天,维护者精力被 AI 报告透支已成为结构性问题。自动化报告在提升覆盖率的同时制造了大量需人工验证的噪声,开源安全治理面临新的资源瓶颈。
安全分析显示漏洞利用平均早于补丁发布 7 天,攻击者先手优势正在扩大。AI 并未造成零日漏洞数量暴增,但重构了漏洞生命周期的时间分布,使防守者传统的「等补丁再修复」模式失效。这一时间倒转倒逼企业从被动响应转向主动监测,漏洞管理思路面临系统性调整。
AI编程助手通过自动读取Issue执行操作,一个Issue即成为攻击入口
灵砚视角:AI编程代理的信任模型存在结构性缺陷——Agent自动执行上下文中的操作,但输入源的信任验证几乎为零。Issue作为外部输入本应经过沙箱化处理,但当前架构普遍直接将Issue内容纳入Agent上下文,等于把外部攻击面直通代码执行层。
GNOME将漏洞披露期从90天砍至30天,维护者被AI报告透支
灵砚视角:AI生成漏洞报告的价值并非线性增长——当噪声比例超过维护者的验证带宽,每多一份报告反而减少一分安全。这不是工具问题,而是开源安全治理的资源分配问题,需要从制度层面匹配验证资源。
前沿科技
Ollama 官方已将 DeepSeek-V4-Flash-0731 设为云端默认版本。与此同时,能在家流畅跑起该模型的硬件门槛不降反升——需要 DGX Station GB300 级别设备,整机柜 72 颗 GPU、单卡 288GB 显存。免费模型与天价硬件之间的反差,正在拉大「能下载」与「能部署」的鸿沟。
OpenAI 宣布 ChatGPT 免费用户可使用 GPT-5.6 Luna,付费用户则用更高阶的 GPT-5.6 Sol。5.6 级模型进入免费层,与 DeepSeek 同周涨价控流形成反向操作:一个用免费扩用户,一个用价格限流量。模型市场的定价策略正在分化。
OpenAI 将 GPT-5.6 Luna 开放给免费用户
灵砚视角:每一次旗舰下沉到免费层,都在压缩竞品的定价窗口。当用户免费就能拿到上一代旗舰能力,收费模型的差异化必须更快地前移。
OpenAI 下沉 5.6 级模型到免费层,与 DeepSeek 涨价控流同周
灵砚视角:OpenAI 向下抢用户心智,DeepSeek 向上控流量。两条路看似矛盾,实则都在重新定义模型的价格锚——一个试探需求底线,一个试探供给天花板。
软件与开发者
Agent Plugins 开放标准由 OpenAI、AWS、Cursor、GitHub、VS Code 和 Vercel 六家厂商共建,将 Agent 技能与 MCP 配置打包为跨客户端可移植插件。但 Anthropic 未参与该标准及 AGENTS.md,Claude Code 仍使用自有 CLAUDE.md。一边是六家联手推通用标准,一边是最大 AI 编码工具厂商自建生态,Agent 互操作性出现实质性分裂。
Agent Plugins 六家共建但 Anthropic 缺席,Claude Code 仍用 CLAUDE.md
灵砚视角:Anthropic 不加入并不意外——它拥有 Claude Code 和 MCP 协议。真正值得琢磨的是:当一家公司既是事实标准制定者又是最大受益者时,开放标准还能叫开放吗。六家共建的 Plugins 缺了 Anthropic,覆盖的只是半个生态。
消费电子
宇树科技以150.8元/股推进IPO,创始人王兴兴拿出对应3473万股持股平台份额用于员工股权激励。同时披露2026年Q1营收增速放缓。具身智能标杆企业在资本市场高歌猛进,商业化变现的增速曲线却尚未跑通,股权激励规模之大也暗示留人比短期盈利更紧迫。
千问大更新将Agent能力接入电脑与手机端,支持多场景自动化任务处理,所有新功能免费体验。这是Agent生态从开发者工具向消费者场景延伸的关键一步,与近期Cloudflare基建层产品、OpenAI Agent Plugins形成互补——消费者入口的争夺正在前置。
宇树科技IPO定价150.8元/股,同时2026年Q1增速已现放缓
灵砚视角:宇树作为国内具身智能标杆,IPO窗口期披露增速放缓,说明机器人出货量增长曲线尚未跑通规模化变现。资本市场耐心与产业落地节奏正在出现错位,3473万股的激励规模暗示留人比盈利更紧迫。
其余动态