01Cursor 并入 SpaceX:编码工具层开始被收编
Cursor 官宣收购完成、整体并入 SpaceX,团队加入 SpaceXAI 助力 Grok 研发。这家被 a16z 称为史上最快 ARR 破亿美元的软件公司,年初还自述「算力饥渴」,靠紧急调整与 Composer 2.5 在性价比上突围,如今直接选择入籍。昨日 Devin 估值冲上四百亿,今日 Cursor 卖身,编码工具层的独立窗口正在收窄——算力与分发,正在成为比产品更硬的通货。
ORAINK PUBLIC DAILY
Cursor相关的并购与收购话题,和智谱GLM-5.3的后训练动向同日出现,AI编码的竞争正从模型层延伸到工具层;另一边,GeoServer零日漏洞涉及远程代码执行,是开发者今天更适合优先处理的一件事。
ISSUE OVERVIEW
AI与智能化
Cursor 官宣收购完成、整体并入 SpaceX,团队加入 SpaceXAI 助力 Grok 研发。这家被 a16z 称为史上最快 ARR 破亿美元的软件公司,年初还自述「算力饥渴」,靠紧急调整与 Composer 2.5 在性价比上突围,如今直接选择入籍。昨日 Devin 估值冲上四百亿,今日 Cursor 卖身,编码工具层的独立窗口正在收窄——算力与分发,正在成为比产品更硬的通货。
V4 Pro 上线后口碑一夜反转,AI前线梳理线索称疑似发错了模型,HuggingFace 配置与 API 后台已被紧急切换回滚。若属实,昨日的集体差评可能测的是错误对象,一次工程事故足以污染一整轮模型评测。目前 V4 Pro-0813 已在 Fireworks 完成 Day-0 上线,回滚之后的真实成绩仍待社区重测。
开源阵营同日从两端出手:智谱 GLM-5.3 以 7430 亿参数拿下开源编码 SOTA,宣布将开源并已进入 LMArena 等测;通义 Qwen3.8-27B 被测出可匹配半年前的闭源旗舰 Opus 4.6 Max。Hugging Face 夏季报告同日给出注脚:小模型主导真实部署,通义领跑本地推理。一端堆规模、一端拼效率,27B 已经能装进 17GB 的本地显存。
OpenAI、Anthropic、Google 等头部厂商签署欧盟《AI 生成内容透明度行为准则》。Anthropic 率先把 Claude 文本水印落地并配套 FAQ,明说这是为满足欧盟 AI 法案的要求;Google 同日给 Gemini 加上可见水印开关,并上线 AI 生成内容检测。水印从技术争议变成了合规交付物,三家把它同时推进了产品层。
Cursor 在 ARR 最快破亿美元之后,整体并入 SpaceX 转投 Grok 研发
灵砚视角:Cursor 曾自述「算力饥渴」,年初紧急调整后靠 Composer 2.5 在性价比上打赢一仗,但产品领先换不来算力与分发。昨日 Devin 冲上四百亿估值,今日 Cursor 入籍 SpaceX,编码层的筹码正被巨头逐一收走,独立窗口收窄的速度比多数人预期的快。
DeepSeek V4 Pro 疑似发错模型配置,口碑反转后紧急回滚
灵砚视角:从「梁神」到「牢梁」只隔一天,回滚后真相才浮出。社区跑分默认信任 API 端到端链路,工程事故与模型能力在舆论上不可分辨。发布首日的口碑权重或许该系统性调低,回滚之后的 V4 Pro 重测,才是真正的考场。
网络安全
奇安信 CERT 通告 GeoServer jsonArrayContains 远程代码执行漏洞(QVD-2026-52627):已复现,POC 与 EXP 公开,官方暂无补丁。无补丁零日把「披露到修复」的窗口直接变成攻击窗口,防守方只剩 WAF 规则与限流可撑。安全圈监测显示,漏洞公开数小时内全球已出现数百次探测利用尝试。
昨天刚聊过 DeepSeek Harness 让中间层独立成赛道,今天 ChaMd5 即披露其 0.1.0-rc.5 的四个可利用漏洞:插件、沙箱与一把「总钥匙」串起凭据外泄与宿主机任意代码执行,默认部署即可被利用。同日 AiPy 社区推出 EasyDsh 一键部署版,把安装门槛降到开箱即用。扩散与加固的速度差,第一次在智能体框架上显形;四个漏洞全部默认可达。
OPPO 安全应急响应中心通报,对违规使用 AI、未经人工验证即提交漏洞报告的白帽作出处罚。同日,长亭把 MonkeyScan 与 OpenAI Codex Security 同台跑分,多找回 22 个真实漏洞、成本仅五分之一;SecurityWeek 研究数出 AI 生成应用 434 项实锤缺陷;一线工程师开始给 AI 审查加「证据链」。AI 产出增速超过验证能力,行业转向为机器产出立规矩——罚单、跑分与 434 项缺陷一天到齐。
特朗普 8 月 12 日签署国家安全备忘录:私营企业可在联邦政府监督下执行进攻性网络任务,打击跨国网络犯罪,被评价为美国网络行动模式的重大转向。攻击授权从国家机构外放到公司,误伤认定、跨境边界与追责机制都尚未定义。安全内参与安全牛当日均将其置于头条位置处理。
DeepSeek Harness 发布次日即曝四个默认可利用漏洞,同日社区上线一键部署版
灵砚视角:四个漏洞全部默认可达,说明问题不在用户配置而在出厂状态。当中间层框架把「总钥匙」交给插件生态,审计就必须内建而非外挂。EasyDsh 降门槛的方向没错,但它加速扩散的恰是带洞的默认态。
特朗普签署备忘录,授权私营企业在政府监督下执行进攻性网络任务
灵砚视角:攻击的合法性在向市场开放,但交战规则仍是空白。打击跨国犯罪的口子一旦打开,商业纠纷借「进攻任务」寻仇的灰色地带就会出现;谁来仲裁、如何追责,决定这是威慑还是生意。
前沿科技
Cursor 工程师 Eric 宣布「today we are a part of SpaceX」,Scott Wu 等多方证实收购完成:团队并入 SpaceX AI 部门,直接服务 Grok 相关产品,交割数小时后已在讨论下一代 Grok 的改进方向。最热的编码工具初创没有走向独立 IPO,而是整体并入 Grok 体系——昨日 Devin 估值反超的余温未散,编码工具层的独立性与被整合的定价之争提前开场。
通义千问开源 Qwen3.8 两档权重,Ollama、Together、DeepInfra、Fireworks、Nebius 等八家平台 Day 0 齐上,AMD 与 Unsloth 当日就绪;Hugging Face 夏季报告同日显示,小模型主导实际使用、Qwen 领跑本地推理。开源发布的胜负手,正从跑分转向首发生态的动员能力。最硬的注脚是实测:27B 单卡跑百万上下文,SGLang 适配首日 RTX 5090 解码 206 tok/s。
Replit 创始人 Amjad Masad 称,仅给 Claude Opus 5 加上编码 harness,ARC-AGI-3 成绩便接近满分,验证其「编码能力泛化大模型」的预判;以反记忆、反套路为设计初衷的基准,正接连倒在外层工程手里。Gary Marcus 补充:当前顶级方案全部采用神经符号世界模型,正是他 2020 年写下的路线。
Pika 一口气发布 Soundtrack、Music、SFX、Speech 四款音频基础模型,宣称依托训练与推理效率创新,定价最多比市场上所有音频模型低 20 倍,且不附加免责声明;文本大模型的降价剧本,正在音频赛道整段重演。同日,音潮 V4.0 以 API 限时免费正面挑战 SUNO,Fish Audio 把 S2.1 Pro 铺进东京出租车,并与 LiveKit 打通情感标签自动生成。
SpaceX 完成对 Cursor 的收购,团队并入 Grok 产品线
灵砚视角:Cursor 未走独立路径而是整体并入,说明前沿竞争的筹码正从单一模型转向模型、工具、算力的垂直整合。对开发者而言,最顺手的编辑器成为 Grok 体系的资产,工具中立性的溢价反而可能被重新定价。
编码 harness 让 Claude Opus 5 在 ARC-AGI-3 接近满分
灵砚视角:ARC 系列本以抵抗记忆与套路为初衷,如今倒在外层工程手里,意味着泛化能力的评估单位正从模型迁移到系统。此后读跑分,模型版本与 harness 工程水位要放在一起看。
软件与开发者
智谱在唐杰发帖暗示后仅数小时就上线 GLM-5.3:基座仍是 GLM-5.2,靠后训练拉高编码、长程任务与网络安全能力,与 Kimi K3 互有胜负。同一周内 Grok 4.6、DeepSeek V4 Pro 接连落地,Gemini 3.7 Flash 转正式版反而声量冷清。基座少动、后训练快跑,开源大模型的发布节奏开始按小时计。
Linus Torvalds 吐槽 AI 工具批量修 Bug,让 Linux 7.2 候选版本体量过大,并称这已是内核开发的「新常态」,社区对此褒贬不一。同一天,GitHub 官方连续发文,教开发者把 AI 生成的巨型合并请求拆成聚焦的 PR 栈,并给出自上而下再自下而上的评审顺序。生成速度已经跑在评审容量前面--瓶颈正从写代码的人移向看代码的人。
Google 官方发文称 Go 是 AI 辅助软件工程的理想语言并列出五点理由,Hacker News 讨论迅速两极分化。争论的实质在于:当越来越多代码由模型生成和维护,语言的评价标准正被改写,编译速度、工具链确定性这类工程属性的权重上升。厂商亲自下场为语言站台这件事本身,比结论更值得记下。
DeepSeek Harness 开源第三天,两笔账同日摆上桌:Augment 从零重构 Auggie CLI,精简工具栈后单任务成本降 53%且质量不变;另有用户拿 DSH 配 V4 Flash 做网站,30 多分钟烧掉 1390 万 token,成品不佳。架构解析与企业落地指南同日密集出现,中间层的竞争焦点正从能不能用转向贵不贵。
Linus 把 AI 批量修 Bug 称为内核新常态,GitHub 同日教人拆 PR 栈
灵砚视角:评审正在变成最贵的资源。Linus 的吐槽与 GitHub 的官方指南是同一件事的两面:产出速度已超过社区消化速度,流程与工具的改造才刚起步。
Augment 重构框架省 53%,同期用户烧 1390 万 token 效果不佳
灵砚视角:两笔账相差一个量级,说明成本大头在编排与工具收敛度而非模型单价。Harness 要从演示走进生产,得先交出可复制的成本基线。
消费电子
爱范儿独家:DeepMind 将调整战略,不再追逐超大规模前沿模型,转而聚焦低成本 Flash 模型,裁员最高或超三分之一。这条消息与本周 Gemini 3.7 Flash 半价改写帕累托前沿连成一线——Flash 从一次产品选择上升为组织级战略,连研究团队都要为它让位。当规模不再是唯一信仰,头部实验室开始为便宜的好模型重组自己。
智谱发布 GLM-5.3:约 7000 亿参数量级,靠后训练 Scaling 把编程与网络安全能力抬至比肩顶尖模型,实测重回国产顶流。同日谷歌被曝收缩前沿战线,智谱给出了方向相反的答案——不换赛道,换训练方法,杠杆从预训练移到后训练。评测显示其编程与安全攻防成绩均已对齐第一梯队模型。
爱范儿首发评测小米澎湃 OS 4,这是小米第一个 AIOS:AI 改造覆盖全系统,而非把智能功能拼在应用层。评测肯定了全系统改造的成果,也指出明显短板。手机厂商的 AI 竞争正从比模型参数转向比系统集成度。首发版本的评价落在:全系统方向成立,完成度仍待补课。
DeepMind 被曝不再追逐前沿模型,裁员最高或超三分之一
灵砚视角:谷歌把赌注押向便宜的好模型,规模信仰第一次在头部实验室内部松动。若裁员落地,被释放的研究力量大概率流向开源阵营与新兴实验室,前沿能力的供给格局可能因此重排。
小米把第一个 AIOS 交到用户手上
灵砚视角:澎湃 OS 4 的看点不在单点功能,而在 AI 从应用拼盘变成系统底座的路径能否走通。手机厂商正试图用系统集成度对冲模型能力差距,这是与模型公司不同的一条胜率曲线。