XTalking · Daily · AI × Automotive

小谈AI智舱

The Daily Brief on AI and Automotive
SAT 2026-08-01 精选 12 条 Vol. 213
01 今日头条 TOP STORIES
1
智能汽车

大众押注地平线 · 10 亿级订单锁定 2027 年 L3

大众和地平线签下 10 亿级智驾订单,双方合资的 CARIZON 主导,基于征程 6 平台,目标 2027 年在国内量产车上交付 L3 级方案。这次不是过去的辅助驾驶合作,而是 L3 系统主控 —— 意味着大众把中国市场的高阶智驾主权,交给了一家国产芯片公司。对做车机测试的同行,征程 6 的算力量级(560 TOPS)、软件栈(TogetherOS)和 8295 座舱域之间的通信/时序验证会是新的重点,过去围绕 Mobileye + MEB 电子架构积累的测试用例大概率要重写。

对比蔚来 NX9031、小鹏图灵 X9 这类自研路线,大众这次选择的是"深度绑定 + 联合品牌"打法,类似当年小鹏和大众的电子架构合作升级版。建议提前熟悉 J6P 的 NOA 场景库和大众 CARIAD 的 SOA 架构文档,尤其是 L3 场景下人机接管的性能基线该怎么定 —— 这套用例未来两年会覆盖到不止大众一家。

2
AI 大厂动态

DeepSeek V4-Flash-0731 上线 · 304B 参数强化 Agent

DeepSeek 发布 V4 家族的 Flash 版本 · 304B 参数(HuggingFace 上 167GB),官方强调"agentic 能力显著增强"。相比前代 V4,Flash 定位是低延时 + 工具调用优化,面向 Agent 场景专门做过 RL 训练。对做车机 AI 应用的同行,这类"专精 Agent + 低成本"的开源模型,是车端"云侧兜底 + 端侧小模型"混合方案里最合适的云端候选之一,尤其在座舱语音助手多轮工具调用、跨应用意图串联的场景下。

和 GPT-5.6 大降价、Qwen3-Agent 这些同期动作放一起看,行业已经明确从"卷 benchmark"转向"卷 Agent 落地"。建议本周找一台带 GPU 的机器把 V4-Flash 拉起来,重点测三件事:function calling 成功率、连续 5 轮以上工具调用的稳定性、以及 first token 延时 —— 这三个指标直接决定它能不能进车。

3
工程实践

Stateless MCP 落地 · 2026-07-28 规范让协议变轻

MCP 官方发布 2026-07-28 版本规范,核心是 Stateless MCP —— 服务端不再需要维护会话状态,单次 HTTP 请求就能完成一次工具调用。Simon Willison 顺势开源了 mcp-explorer 和 datasette-mcp,验证"零状态"下的调试和数据源接入。对做工程的读者,这是 MCP 从"IDE 里的实验协议"走向"可部署到生产网关"的转折点,过去 SSE + 长连接的复杂性一下子降下来了,和 REST/OpenAPI 的心智模型对齐。

对比一年前 Anthropic 首次发布 MCP 时那种"必须常驻进程"的形态,Stateless 版本更接近传统微服务,能直接塞进 K8s 或 Serverless。建议花一晚上把 mcp-explorer 跑起来,把车机测试用的一个内部工具(比如日志抓取或性能采集)包成 stateless MCP server,亲自感受一下 —— 未来 Claude Code / Cursor 里调你们内部工具,大概率就是这个形态。

02 智能汽车 AUTOMOTIVE
车企动向
  • 乘联分会:车企利润被电池厂吃掉 · 必须自造电池 乘联分会秘书长崔东树公开表示汽车行业利润率跌到近十年新低,而电池环节利润率显著高于整车,建议车企"必须自造电池"。对比比亚迪垂直整合、蔚来 NIO Battery、广汽因湃电池这些先例,车企自建电池已经是一条明牌。对做车机测试的同行,自造电池意味着 BMS 通信协议、SOC 校准、充放电场景的测试用例会跟着车企自研节奏走,不再是"电池厂给什么测什么"。建议关注各家电池管理系统在 CAN/以太网层的接口变化。 → 原文
智驾
  • 自动驾驶巨头 CEO 卸任 · 单日股价暴跌 15% 一家头部自动驾驶公司发生 CEO 级人事变动,资本市场当日回应给出 -15% 的股价反应。近两年 Cruise 停摆、Argo AI 关闭、Aurora 卡车业务重组,L4 商业化推进节奏普遍慢于预期。对做车机测试的同行,这类高层动荡通常伴随技术路线调整(比如 L4 → L2++),意味着 Robotaxi 供应链上的合作可能生变。建议关注该公司后续对 Robotaxi 车队和 L4 SDK 授权的表态,直接影响相关项目的中期规划。 → 原文
03 工程与研究 ENGINEERING & RESEARCH
AI 大厂动态
  • GPT-5.6 全线降价 · 最高降幅 80% OpenAI 把 GPT-5.6 系列价格砍下来最多 80%,主力档位向 DeepSeek/Qwen 的定价区间靠拢。对比年初 GPT-5 发布时的定价,一年内 token 价格几乎打了两折,反映的是模型底价被开源阵营彻底拉平。对做车机 AI 云端方案的同行,意味着"云侧兜底"再也不是成本大头,更多的选型压力转到了延时和数据合规上。建议重新算一遍现有语音/助手方案的每千次会话成本,可能能省下一大笔。 → 原文
  • OpenAI 提出"Abundant Intelligence" · 押注全栈 OpenAI 发布战略博客 Building abundant intelligence,主张用"芯片 + 数据中心 + 模型 + 应用"全栈打法把智能变成基础资源。这和 Anthropic 专注模型层、Google 押 TPU 自研的路线形成明显对比 —— OpenAI 想复刻的是"AWS for AI"的形态。对做车机的同行,意味着未来 API 之外可能出现更"上层"的产品(比如车企专用推理集群),定制化路径可能变多。建议留意后续是否推出车规级 SLA 或专用部署。 → 原文
工程实践
  • Manifest 弃用 LLM Router · 一个反潮流的工程决定 Manifest 团队公开撤下了自建的 LLM Router · 理由是模型间价格差已缩小到 2 倍以内,而路由本身引入的延时、调试复杂度、错误面反而超过收益(HN 83 分)。这和过去一年 Martian、Not Diamond 等一票"多模型路由"公司的方向正好相反。对做车机 AI 集成的同行,启示是不要过早为"多模型自动选择"这类花活写代码,除非模型能力差距真的大到值得。建议先用一个模型跑通全链路,再谈路由。 → 原文
  • SWE-Rebench:13 模型 4 Agent 跨 5 语言实测榜单 SWE-Rebench 发布跨 Go/Java/Python/Rust/TS 五种语言的 SWE 任务评测,覆盖 13 个模型 × 4 种 Agent 框架的组合(HN 41 分)。相比 SWE-bench 只测 Python,这次多语言横评更接近真实项目的复杂度。对做车机的同行,C/C++ 之外的 Rust/Java/TS 场景直接对应车控 SDK、Android Auto 应用、H5 座舱应用,这份榜单可以直接用来选内部代码 Agent。建议对照自己团队的技术栈看对应语言榜首,再动手试用。 → 原文
  • 腾讯云推出研发 AI 队友 · 重构下一代工作流 腾讯云在 Techo 大会展示了一整套 AI 编程队友产品,定位是"进入公司组织架构"的 Agent · 从需求拆解、代码生成、评审到发布全流程接入。对比 CodeBuddy 早期只做补全,这次更像国内版的 Devin + Cursor 组合。对做车机测试的同行,尤其看点是"测试用例自动生成 + CI 集成"的模块 —— 如果自动化程度达到宣传水准,回归测试的编写工作会被明显压缩。建议关注是否有腾讯云内部车机团队作为标杆案例。 → 原文
  • Google:Chrome 6 月修的 Bug 比过去两年还多 · AI 立功 Google 官方博客披露,借助 AI fuzzing 和自动化代码审计,Chrome 在 6 月单月修复的安全 Bug 数量超过之前两年总和(HN 478 分)。核心工具是 OSS-Fuzz + Big Sleep(Gemini 驱动的漏洞挖掘 Agent)。对做车机测试的同行,启示是 fuzzing + LLM 已经进入生产级实用阶段,不再只是研究话题。建议看看能不能把 OSS-Fuzz 的 harness 思路,套到车机 HAL 层或 IPC 接口的稳定性测试上,ROI 可能很高。 → 原文
行业观察
  • 米哈游蔡浩宇 AI 创业转向 · 九成资源押 Agent 蔡浩宇 AI 创业公司 Anuttacon 内部生变 · 多个 AI 游戏项目暂停,九成资源集中转向通用 Agent 方向。对比一年前"AI 生成游戏"的高调,这次是明显的战略收缩。反映的行业信号是:通用 Agent 的想象空间和商业化路径,比垂直 AIGC 产品更被资本认可。对做座舱 AI 助手的同行,一个隐性影响是相关顶尖人才和方法论会向 Agent 池子聚集,座舱内的"车载 Agent"竞争会更激烈。建议关注他们后续的技术公开动作。 → 原文