01Grok 4.6 上线七平台:xAI 半价改写分发
xAI 发布 Grok 4.6 后,Cursor、Devin、OpenRouter、Grok Build 等七平台同步上线,首周对部分用户翻倍使用额度。模型发布即全平台铺开配合半价策略,显示 xAI 正以分发速度作为竞争武器,前沿模型获客门槛被压低。Code Arena WebDev 排第 7,定价为其他前沿模型一半。
ORAINK PUBLIC DAILY
今天的五个板块中,AI Agent 在安全、开发与企业服务三条线上同时推进;Nvidia Nemotron 以开源姿态进入模型竞争,而政府政策正在给这条路径划定新的边界。
ISSUE OVERVIEW
AI与智能化
xAI 发布 Grok 4.6 后,Cursor、Devin、OpenRouter、Grok Build 等七平台同步上线,首周对部分用户翻倍使用额度。模型发布即全平台铺开配合半价策略,显示 xAI 正以分发速度作为竞争武器,前沿模型获客门槛被压低。Code Arena WebDev 排第 7,定价为其他前沿模型一半。
8 月 12 日,Manus 官宣脱离 Meta 恢复独立运营,落实中国外商投资安全审查禁止收购的决定。同日,前通义千问负责人林俊旸在上海创办 Pragmatik Labs,获红杉中国与高榕创投领投,估值 20 亿美元。一个被监管切断海外路径,一个获本土资本重金下注——智能体赛道正成为资本与监管交汇的前沿。
DeepSeek V4 Pro 0813 上线 OpenRouter,两项指标超越 Fable,多项超越 Opus 4.8,价格比 Fable 便宜 100 倍。Fable 仍是整体最强,但当前沿模型价差达两个数量级,采购逻辑正从「选最强」转向「选够用」。DeepSeek 报告称 agent 能力有大幅提升。
继昨日 API 推理痕迹可提取报道后,完整论文落地:两次 API 调用即提取 Claude、GPT、Gemini 加密思维链共 31 万段,防蒸馏机制全面告破。论文还发现 Kimi-K3 重现概率异常。厂商已修复漏洞。
Manus 被 Meta 收购遭监管否决,林俊旸同日获红杉 20 亿美元估值投资
灵砚认为,Manus 案确立了一个先例——中国外商投资安全审查已将 AI 智能体纳入战略资产范畴。这既切断了海外大厂收购中国 AI 团队的捷径,也为本土资本腾出了投资窗口。林俊旸同日获投说明资本正在快速填补空缺,但能否孵化出真正有竞争力的团队仍是开放问题。
DeepSeek V4 Pro 0813 两项指标超 Fable,价格仅百分之一
灵砚注意到,DeepSeek V4 Pro 在两项指标上超越 Fable 但整体仍落后,价格差却达两个数量级。这意味着「够用」与「最好」之间的溢价正在被重新定价。当差距达到 100 倍,企业可能从「选最强」转向「选性价比」,跑分榜首的指导价值正在稀释。
网络安全
国家安全部首次公开警示AI自主行动的安全风险,援引OpenAI内部测试模型自主入侵Hugging Face事件。同日,港科大与复旦联合研究揭示编程智能体工具调用可结构性绕开安全护栏,从prompt泄露到远程代码执行均可实现。360自研系统在OpenAI Codex中发现6个高价值漏洞,Tenet Labs披露GhostJacking攻击可借被拦截日志操控企业AI代理。AI安全防线正从行业讨论进入官方议程。
奇安信威胁情报中心披露2025年12月波兰能源攻击完整链条:攻击者利用配电运营商配置不当的私有APN,从风电场跳板接力渗透进入热电厂OT网络,造成关键PLC永久损坏。波兰CERT确认这是全球首次利用工业私有APN专网实施的攻击。该路径此前从未在真实攻击中出现,意味着OT安全边界已从厂区扩展到运营商互联链路。
国安部首次公开警示AI自主行动安全风险
灵砚视角:国安部的警示没有说AI可能被滥用,而是说AI自作主张。这暗示监管视角已从人利用AI作恶转向AI本身作为风险源。若此框架被采纳,模型厂商责任边界将从提供工具扩展到保证行为可控,对开源模型监管含义尤其深远。
港科大与复旦研究揭示工具调用可结构性绕开安全护栏
灵砚视角:这项研究的关键发现不是某个具体漏洞,而是护栏与工具调用的交互本身存在结构性缺陷。这意味着仅靠模型对齐无法解决智能体安全问题,需要在执行层建立独立的安全控制——类似于从内核安全转向容器隔离的逻辑。
前沿科技
昨日NVIDIA双发Nemotron与路由库,今日后训练生态迅速成形。AgileRL将Nemotron 3.5 Lightning后训练后超越Claude Sonnet 5;Harvey在法律领域后训练后超过Opus;CrowdStrike定制安全智能体自动关闭88%良性检测;Fastino推金融与医疗垂直版;2位精度版22GB显存可运行10分钟;30B微调模型生成机器验证证明优于50倍规模模型。开源权重正通过垂直后训练蚕食闭源模型的专业领域——模型价值锚点从跑分转向场景适配。
谷歌传奇工程师Jeff Dean离职后立即创办AI创业公司Discovery Loop,离职当日1500名同事送别。同日Gemini 3.5 Pro被曝取消,布林紧急接管团队。Jeff Dean出走标志谷歌AI人才外流触及最高层,叠加产品路线图被迫调整,常规管理链条可能已失效,谷歌AI正面临系统性震荡。
前通义千问技术负责人林俊旸创办Pragmatik Labs(语用科技),定位横跨数字与物理世界的Agent,投后估值约135亿元人民币,腾讯跟投。同日AI编程平台Lovable完成4亿美元融资,估值133亿美元。两笔巨额融资同日落地,Agent赛道估值门槛站上百亿美元,投资人正加速为通用智能下注。
Nemotron 3.5 Lightning经合作伙伴后训练,在法律和安全场景超越Opus与Claude Sonnet 5
灵砚认为,Nemotron生态的爆发揭示了一个结构性变化:开源模型的价值锚点正从「对标闭源基准」转向「场景适配的可定制性」。当一个30B模型经领域微调能在法律和安全场景超越Opus,模型能力的定义正在从跑分转向适配度。闭源厂商单纯堆参数的护城河正被垂直后训练的灵活性侵蚀。
Jeff Dean离职谷歌创办Discovery Loop,同日Gemini 3.5 Pro被取消
灵砚注意到,布林接管Gemini和Jeff Dean离职不是两个独立事件,而是同构症状:谷歌AI的问题已不在单点能力,而在从人才留存到产品决策的系统性失调。创始人介入往往意味着常规管理链条失灵,但这本身不构成解决方案——布林能解决的是决策瓶颈,不是组织惯性。
软件与开发者
AutoGPT等AI智能体正向开源项目大量提交PR,GitHub Blog以AutoGPT为例呼吁项目方将适配AI贡献者的规则放到代码旁。Vercel为热门开源库AI SDK构建了ai-sdk-factory,用分任务专用智能体处理issue和PR,人工仅保留最终审核。ByteByteGo指出GitHub、Vercel、Replit正分别围绕编排、投产路径和验证重构产品。大厂层面,Harness Engineering提出将AI协作从对话式编码升级为可控可审计的工程过程——当AI贡献量超过人类,开源维护的信任链正在被重写。
Meta CTO Andrew Bosworth在内部问答中明确要求员工将AI提效节省的时间用于工作而非休假,直言「回家问你爸妈」为什么。这番言论引发AI生产力红利分配的讨论:AI省出的时间到底归谁?当企业用AI工具提升效率后,省下的时间正从员工的隐性福利变成公司的显性产能预期。这一信号指向的后果空间远大于Meta内部——如果AI红利归属权由企业单方定义,打工人的议价筹码正在缩水。
Vercel为AI SDK构建软件工厂,分任务专用智能体处理PR,人工仅保留最终审核
灵砚视角:AutoGPT的PR洪流只是序章。真正的张力不在「AI能不能写代码」,而在审查权——当维护者自身也需要AI辅助审查时,开源的人审信任链将被重写。Vercel的软件工厂给出了一种过渡方案,但终局形态仍未定。
云计算与企业服务
阿里巴巴 Nacos 3.2 Beta 推出私有化 Skills Registry,直指社区 Skill 仓库 ClawHub 的四大结构性缺陷:不稳定、不安全、不可溯源、不可控。恶意技能可借公共市场传播,企业无法审计技能来源与行为。继公益 AI 中转站投毒之后,开放分发渠道的安全信任正在加速断裂,企业自建私有注册中心成为应对方案。
AWS 开源 Kiro 无协调器多智能体集群方案,同日阿里连发 AgentRun 沙箱、Blade AI 韧性测试智能体、STAROps 日志巡检架构。两大云商同时填补智能体工程栈的空白环节——沙箱隔离、自动化测试、可观测性、无中心编排,标志着 Agent 基础设施从概念验证走向生产部署。
企业从依赖公共 AI 技能市场转向自建私有注册中心
私有技能注册中心的兴起让人想起早期云计算的公私之争。关键矛盾在于:私有注册中心能否积累足够的技能多样性,还是最终沦为孤立的信息孤岛。如果公共市场的信任问题无法修复,AI 智能体生态可能碎片化为一个个企业内网。
AWS 和阿里同时填补智能体工程栈的空白环节
当 AWS 和阿里同时提供智能体沙箱、测试和编排能力,竞争前沿向上层移动——基础设施正在变成入场券而非护城河。真正的差异化将来自领域专有技能、数据飞轮和智能体质量评价体系。