01「越克制,越可能赢」:梁文锋定调AGI,同行未必买账
梁文锋完成超500亿元首轮融资后,在4小时投资者交流会中系统阐述DeepSeek的AGI路线:保持战略克制、坚持开源、走持续学习方向。多篇文章将其解读为行业通用的AGI常识,但也有人指出这套路线本质是DeepSeek适配自身资源的公司战略,并非普适真理。
ORAINK PUBLIC DAILY
从模型发布到漏洞赏金、编码成本优化与基础设施升级,今天多个板块同时出现结构性调整信号。
ISSUE OVERVIEW
AI与智能化
梁文锋完成超500亿元首轮融资后,在4小时投资者交流会中系统阐述DeepSeek的AGI路线:保持战略克制、坚持开源、走持续学习方向。多篇文章将其解读为行业通用的AGI常识,但也有人指出这套路线本质是DeepSeek适配自身资源的公司战略,并非普适真理。
OpenAI面向全球多付费用户推送ChatGPT桌面端语音功能,基于GPT-Live驱动,支持语音控制电脑与多智能体调度。同日Claude宣布语音模式升级至更强模型并支持对话中调用工具。两家头部厂商同步将语音从附属功能提升为Agent主交互入口,AI交互范式正从文本优先转向语音优先。
Kimi K3技术性能达全球前沿水平,却因国产算力供给不足暂停新用户接入。模型层的突破第一次跑在了芯片供给前面。同期中国工程院院士郑纬民指出,中国AI算力存在高端短缺、中低端闲置的结构性矛盾,深层短板在生态自立——当模型跑赢芯片,叙事就得重写。
Kimi K3因国产算力供给不足暂停新用户接入,模型跑赢芯片的局面首次出现
灵砚视角:模型层的技术突破第一次跑在了芯片供给前面。此前制约一直是算法和算力双缺,现在算法追上了,算力却没跟上。郑纬民说的高端短缺、中低端闲置指向的不是产能问题,而是生态自立问题——有卡不会用,比没有卡更值得警惕。
49947指出梁文锋的克制路线本质是DeepSeek的公司战略而非行业真理
灵砚视角:克制是有资源门槛的。DeepSeek能说不做应用、不做To B,是因为它有AGI叙事撑着的融资能力。中小公司照搬克制路线,很可能在等到AGI之前先耗尽现金流。49947那篇反思的价值在于提醒:梁文锋谈的不是行业路线图,是DeepSeek的生存策略。
网络安全
中国平安关闭其安全应急响应中心PSRC,被视为AI大模型介入漏洞挖掘后传统白帽经济走向黄昏的标志。当机器批量挖洞的效率远超人工,漏洞赏金模式的成本收益比已经翻转——白帽子的出路不是更努力地挖洞,而是学会与AI协作或转向更高层的威胁狩猎。
平安关停PSRC,标志AI漏洞挖掘已冲击传统白帽经济
灵砚认为,平安关停PSRC不是孤例而是信号。当大模型批量挖洞的效率远超人工白帽,漏洞赏金模式的成本收益比已经翻转。企业需要重新定义安全响应的入口——从被动接收白帽报告转向主动部署AI漏洞扫描。
前沿科技
微软MAI系列同日发布Voice-2-Flash和Image-2.5-Pro,前者速度翻倍且降价32%至$15/百万token;同日通义千问发布Qwen-Audio-3.0-TTS登顶第三方TTS榜单,FLUX 3开放视频功能早鸟访问。三家厂商在同一天覆盖语音、图像、视频三赛道,多模态不再是单一厂商的差异化卖点,而成了模型层竞争的最低入场券。
Lovable创始人宣布产品已脱离「vibe coding」阶段,同日披露获得第三方安全认证AIUC-1,通过不安全代码生成等压力测试。继昨日三家产品从生成转向控流之后,AI编码工具开始用合规认证敲开企业大门,信任正在取代速度成为新的竞争维度。
Replit因规模化获得云服务商优惠定价,宣布8月1日起托管价格降幅超50%,同步推出自主AI代理机构Autobot,声称将定制软件开发成本降低90%。当模型能力趋于同质,AI编程平台的竞争轴正从模型质量转向托管成本与工程效率,Notion同期推出as code功能也在暗示同一方向。
微软MAI、通义千问、Black Forest Labs三家厂商同日发布语音/图像/视频模型
灵砚视角:三家厂商同日覆盖三赛道并非巧合——多模态的边际成本正在快速趋零。当语音图像视频都进入够用且便宜的区间,模型层竞争将转向上游数据飞轮和下游应用集成。微软MAI同时发语音和图像,是在OpenAI之外构建自主模型栈的又一信号。
Replit托管价降幅超50%,Autobot声称将开发成本降低90%
灵砚视角:Replit的降价逻辑是规模换定价权,但这意味着托管利润正在被主动让渡。当所有平台都能以接近成本价提供AI编程能力,差异化只能来自工作流深度集成与锁定效应。Notion同期推出as code功能也在暗示同一方向。
软件与开发者
Cursor推出智能模型路由,按请求自动匹配模型,成本降30%-60%,团队披露约60%开发者只用一个主力模型。同时,有非技术高管用AI两天上线SaaS,因重试风暴一天烧掉整月服务器费;GitHub指出AI降低编写成本但维护成本未降;头部海外Agent产品日订阅收入仍低于广告投放成本。AI编程正从能力突破转向成本博弈。
GitHub为Dependabot版本更新引入默认三天冷却期,仅影响常规版本更新不影响安全更新,旨在规避短生命周期的开源供应链攻击。拉取最新依赖这一长期安全最佳实践,本身已被视为攻击入口。用户可自定义冷却时长,安全更新不受影响仍即时推送。
Cursor Router自动匹配模型降30-60%成本,同时AI编程的维护成本和失控风险同步上升
灵砚视角:路由层的出现意味着模型差异正在收窄。当任何工具都能调用任何模型时,差异化向工作流编排和成本控制迁移。真正的壁垒不再是模型,而是对开发者工作流的理解深度。
云计算与企业服务
llm-d 项目推出协作式时间分片技术,在强化学习后训练中对独立 RL 任务做 interleaving,将加速器利用率从约 40% 推到 70%,且不损模型收敛与精度。同等算力下可承载更多 RL 实验轮次,等效训练成本显著下探。技术以开源形式释出,后训练的算力经济学正在被改写——当利用率不再是硬约束,算力规模作为护城河的效力开始打折。
llm-d将RL后训练GPU利用率从40%提升到70%,且技术开源
RL后训练是推理模型的核心环节,利用率从40%到70%意味着等效算力成本下降近半。开源进一步抹平基础设施差距——算力规模作为护城河的叙事正在被工程效率稀释,中小团队也有机会跑出有竞争力的 RL pipeline。