灵砚 oraink
公开刊物索引日报 sitemap周报 sitemapLLM 索引

ORAINK PUBLIC DAILY

当开源模型与具身机器人加速落地,智能化的安全边界正面临重新定义

今天的技术动态中,大模型与开发者工具在开源生态中持续演进,具身智能在机器人领域加速应用,而底层网络安全的漏洞则成为不可回避的基建考验。

日期2026-08-24
Vol298
公开精要13
阅读3 分钟

ISSUE OVERVIEW

本期概览

AI与智能化

AI与智能化

01斯坦福 535B 模型开训,学术界进入前沿模型军备赛

斯坦福 AI 实验室本周启动 Marin 535B-A23B 训练,535B 总参数、23B 激活的 MoE 架构,预计耗时约三个月,全程开放。此前百B级模型训练几乎被头部企业垄断,学术机构始终停留在数十B量级——斯坦福此举意味着开放训练不再只靠企业施舍。

  • #ai-research
  • #open-source
  • #model-release

02Ox Alpha 超过 Fable 5:推理慢暴露后训练瓶颈

匿名大模型 Ox Alpha 突袭 OpenRouter,第三方测试任务通过率超过 Fable 5,行业猜测归属为小米 MiMo V3 或智谱,免费开放一周。但多源反馈暴露尴尬现实:该模型及同类国产 flash 级模型在复杂任务下推理延迟严重,甚至十几分钟才吐一个字。跑分碾压与体验崩塌并存,后训练强度超出参数承载极限正在成为新的工程瓶颈。

  • #llm
  • #model-release
  • #ai-research

03Codex 法律业涨 108 倍,Anthropic 高价模型反失吸引力

a16z 数据显示 Codex 增长最快用户群体已渗出科技圈,法律行业增速达 108 倍。同一窗口期,Ramp AI 统计显示 Anthropic 顶级高价模型因成本高企吸引力不足,Drew Breunig 判断免费迭代时代已随 Fable 推出终结。两条线索指向同一结论:模型市场加速分层,低价实用工具跨界扩张,高价前沿模型的价格墙开始挡住用户。

  • #ai-coding
  • #ai-agent
  • #market

Ox Alpha 跑分压过 Fable 5 但推理慢到十几分钟才吐一个字

当后训练强度超过参数极限,性能增益和体验崩塌之间的边界在哪?

灵砚视角:跑分高不等于可用。Ox Alpha 暴露的不是模型能力短板,而是后训练强度与参数容量的失衡。flash 级模型被塞入过多 RL 训练信号,推理路径过长导致延迟爆炸。下一轮竞争可能从加后训练转向减后训练。

Codex 法律行业增速 108 倍,同时 Anthropic 高价模型用户吸引力不足

当前沿模型定价墙挡住用户,AI 模型市场会分化成几个层级?

灵砚视角:模型市场正在加速分层。底层是免费低价工具跨界扩张,顶层是前沿模型争夺企业预算。中间层正在塌缩——不够便宜也不够强的模型最难生存。Anthropic 的困境不是模型不够好,而是定价卡在了两层之间。

网络安全

网络安全

01BADBOX攻入车机,僵尸网络首次蔓延到智能座舱

卡巴斯基发现全球首例专门针对安卓车机中控的完整恶意感染链路,攻击来自关联BADBOX僵尸网络的MoYu Group。攻击者利用车机合法更新组件植入木马,将车机变为僵尸网络节点牟利,车主全程无法感知。这是BADBOX僵尸网络首次被确认将感染目标从IoT设备扩展到智能座舱系统。

  • #security
  • #network-security
  • #vulnerability
  • #threat-intelligence

卡巴斯基发现BADBOX僵尸网络通过车机合法更新链路植入木马

车规级安全认证会因此纳入僵尸网络免疫指标吗?

灵砚视角:车机智能化长期追体验、轻防御,OTA签名验证形同虚设。攻击面已从数据隐私转向车辆被劫持为基础设施——一辆车被控是个体风险,万辆车成僵尸节点即公共服务中断事件。

前沿科技

前沿科技

01优必选把客户产线搬进展会:具身智能正从演示走向交付

优必选在WRC将客户真实产线1:1复刻展出,展示已进入小规模交付的工业人形方案。当同行还在讨论数据瓶颈时,优必选选择直接亮出真实部署场景。1:1复刻产线与产线上持续运行仍有差距,优必选未披露具体交付台数与运行时长数据。

  • #embodied-ai
  • #robotics
  • #wrc-2026
  • #ubtech

02牛来大模型匿名上线背后,开放生态出现溯源盲区

匿名大模型Ox Alpha(牛来)上线OpenRouter后引发热议,主流猜测其出身为智谱或谷歌,也有人怀疑Cursor用开源GLM训练。一个高能力模型可以完全匿名上架主流平台且无法被溯源——开放推理生态正在出现身份盲区,用户既无法验证模型安全性,也难以判断数据合规风险。

  • #llm
  • #open-source
  • #model-provenance
  • #openrouter

优必选将客户真实产线1:1复刻搬进WRC,称已进入小规模交付

产线进展会等于真落地吗?具身智能的验证标准该看什么?

灵砚视角:把客户产线搬进展会确实比纯Demo进一步,但「1:1复刻」不等于「产线上持续运行」。具身落地的验证标准应是运行时长和故障率,而非展台规模。当同行还在谈数据瓶颈时,优必选的打法是用部署场景证明进度。

软件与开发者

软件与开发者

01DeepSeek Harness开源两天9.5万Star,社区插件生态抢跑

DeepSeek 官方开源 AI Agent 运行环境 DeepSeek Harness(DSH),两天内 GitHub Star 突破 9.5 万。社区反应极快——插件推荐和实战教程在 48 小时内密集出现,覆盖代码生成、自动化测试等场景。此前 OpenAI Codex Harness 已率先开源,DeepSeek 紧跟,大厂 Agent 平台正从比拼模型能力转向比拼插件生态密度。已有 16 款社区插件在流通。

  • #deepseek
  • #ai-agent
  • #open-source
  • #agent-platform

DeepSeek Harness 开源两天内 GitHub Star 破 9.5 万,社区插件推荐文章 48 小时内密集出现

当 Agent 平台本身开源免费,竞争壁垒是否已转移到插件生态密度?

灵砚视角:DeepSeek Harness 的爆发速度暴露了开发者对 开源 Agent 运行环境 的饥渴。但 Star 数到插件贡献者之间的转化率才是真问题——Codex Harness 开源在前,如果两者只是各自建生态而非共享协议,碎片化反而拖慢整个赛道。