XTalking · Daily · AI × Automotive

小谈AI智舱

The Daily Brief on AI and Automotive
SUN 2026-07-26 精选 12 条 Vol. 207
01 今日头条 TOP STORIES
1
工程实践

Claude 5 时代的 Context Engineering 新规则

Anthropic 官方博客抛出面向 Claude 5 代模型的上下文工程新守则,HN 上 118 分 70 条讨论。核心变化有三点:一是 system prompt 明显精简 · 不再需要长篇 few-shot 铺垫;二是把工具描述、示例、约束拆成"层" · 用文件而不是单块文本喂给模型;三是明确推荐用 Skills + Slash Commands 承载重复流程,而不是塞进 prompt。对做 Agent 或车机语音后端的读者来说 · 这意味着过去积累的那套"超长人设 + 大量示例"的 prompt 模板要重写,新范式是把上下文当代码来管。

对比 GPT-4 时代那种"prompt 越长越稳"的做法,Claude 5 明显在往"少即是多"迁移 · 这和 Opus 5 系统提示词也在瘦身的观察一致。建议先把手上最长的一份 prompt 拉出来做一次"减法审计" · 把 few-shot 转成 Skill 文件,同时关注官方给的 token 结构化建议。

2
AI 大厂动态

Opus 5 实测炸场:半价打赢 Fable 5

Anthropic 放出 Claude Opus 5,量子位实测跑分和体感都超过了此前一档更贵的 Fable 5,而定价大约只有对手的一半。有趣的伴生现象是:Opus 5 上线后 · Claude Code 的官方系统提示词也跟着精简了一大截 —— 模型变强,套壳的工程 hack 就可以少写。对做工具链的读者,这条线意味着两件事:一是同样的 Agent 场景 · 单请求成本可能直接砍半;二是过去为了"哄模型"堆出来的一层层 prompt wrapper,可以借这轮升级做技术债清理。

这也延续了去年 Sonnet 4.6 → Opus 4.5 的路径:每一代性能一提,官方就在自家 Code CLI 里做减法 · 反向印证模型能力。建议下周把常用工作流切到 Opus 5 跑一遍对比,重点看长上下文任务(代码库理解、日志分析)有没有翻车,再决定是否全量迁。

3
智能汽车

大众押注地平线 · 10 亿级订单锁定 2027 年 L3

大众和地平线深化合作,签下 10 亿级订单,目标 2027 年在国内量产 L3 车型。方案预计基于地平线征程 6 系列 SoC · 由合资公司 CARIZON 负责智驾算法本地化。这是继大众入股小鹏之后 · 又一个"传统巨头 + 中国 AI 供应商"的深度绑定案例,也说明大众彻底放弃了 CARIAD 单打独斗的路线。对车机测试同行:未来两年台架上会出现更多"MQB/PPE 平台 + 地平线域控"的组合 · 测试基线要重建,尤其是智驾和座舱的跨域通信场景。

对比 Mobileye 主导的欧洲传统方案 · 地平线在功能拆解和 OTA 迭代节奏上明显更贴近国内节奏,这也是大众下注的关键。建议关注 CARIZON 后续在 SOP 前的技术公开材料 · 特别是 L3 场景下"眼睛离路"的接管策略 · 那会直接影响座舱交互(HUD/仪表/语音提示)的测试用例设计。

02 智能汽车 AUTOMOTIVE
车企动向
  • 理想成立芯片新公司 · 加入蔚小理比亚迪自研阵营 理想汽车正式成立芯片公司,加入蔚来、小鹏、比亚迪的自研阵营。公开信息暂未透露具体是智驾芯片还是座舱 SoC,但按理想现有的 Orin-X + 8295 组合看,替代路径大概率先从智驾侧切入。对做车机测试的同行 · 意味着未来两三年国产自研 SoC 会陆续进测试台架,过去围绕高通 8155 / 8295 沉淀的性能基线可能都要重写。建议提前跟踪招聘和专利动向 · 能提前判断上车节奏。 → 车东西
  • 理想 L 系中期改款 · 电池/智驾/智舱同步升级 · 送 2.8 万权益 李想给销量神车 L 系补短板 · 三大件同时动刀:电池换新化学体系、智驾接入 VLA、智舱大概率跟进 AI 语音代理,同时叠加 2.8 万元权益。相比小鹏 G9 中期改款只动智驾,理想这次是全域刷新。对测试同行 · 意味着一次改款要覆盖三条测试链 · 老的稳定性基线基本要作废。建议提前把 OTA 前后镜像对比脚本准备好 · 重点关注长时驻留场景。 → 车东西
座舱
  • 华为乾崑媒体日:奕境 X9 用"智感"撑起"贵感" 华为乾崑媒体日重点讲奕境 X9 的座舱和智驾整合 · HarmonyOS 座舱 + ADS 4.0 智驾 · 强调多屏交互与情绪感知。这是华为把"高端豪华"和"智能座舱"绑在一起讲的最新一次尝试,和理想 MEGA、极氪 009 走的是同一赛道。对做车机测试的同行 · 值得关注 HarmonyOS 在跨屏渲染和多音区语音上的性能表现 · 尤其是同时唤醒场景下的响应延迟。建议扒一下现场演示视频里的转场动画 · 是判断 GPU 负载余量的好素材。 → 车东西
03 工程与研究 ENGINEERING & RESEARCH
工程实践
  • 吴恩达开源桌面 Agent · 本地优先 · 模型无关 吴恩达团队放出 100% 开源的个人桌面 Agent · 主打隐私、本地优先、模型无关 —— 后端可以接 Claude / GPT / Qwen / 本地 Ollama。相比 OpenAI 的 Operator 和 Anthropic 的 Computer Use · 这套方案更适合企业内网或车厂研发环境 · 数据不出本机。对车机测试同行 · 可以拿来做 HMI 自动化 · 让 Agent 帮你点车机屏、跑回归。建议先在个人机上试跑一天 · 感受一下端侧 Agent 的可靠度天花板。 → 量子位
AI 大厂动态
  • 英美 AISI 联合评估 Kimi K3 网络安全能力 英国 AISI 和美国 Caisi 联合发布 Kimi K3 的初步安全评估报告 · 重点看它在网络攻击场景下的能力上限 · HN 122 分 39 评论。这是中美英三国监管首次联合评估一个中国开源模型 · 也是继 DeepSeek V3 之后的第二次同类动作。对读者 · 报告本身是一份很好的红队测试参考 · 里面对 CTF、漏洞挖掘、社工邮件的评测方法可以直接借鉴到车机安全测试。建议直接下载 PDF · 看方法论章节。 → NIST
硬件与芯片
  • $8 单片机跑 28.9M 参数 LLM · ESP32 端侧实验 GitHub 项目 slvDev/esp32-ai 在 8 美元的 ESP32 单片机上跑起了 28.9M 参数 LLM · 全 int8 量化 · 推理速度虽慢但可用。这比之前 llama.cpp 在树莓派的最小尝试又下探了一个数量级。对车机测试同行 · 意义在于:未来座舱里那些不起眼的 MCU(如车窗控制器、氛围灯 ECU)也可能内嵌小模型 · 测试边界会扩到 CAN 节点。建议 clone 下来在实验板上跑一次 · 直观感受端侧下限。 → GitHub
  • WAIC 端侧算力竞赛 · 聆思亮出下一代 AI 终端筹码 WAIC 2026 现场端侧算力成主战场 · 聆思展示新一代 AI SoC · 主打低功耗大模型推理 · 目标场景包括 AI 玩具、AI 眼镜、车载副驾。相比高通 8295 主打的座舱主控 · 聆思瞄准的是"座舱二级节点" · 比如娱乐区独立音区、后排屏 · 属于错位竞争。对车机测试同行 · 意味着未来的车内可能有多颗协同 AI SoC · 跨芯片延迟和一致性测试要提上日程。建议关注聆思在整车厂的定点信息。 → 智东西
行业观察
  • 开源权重 AI 的 Kubernetes 时刻已经到来 Mesosphere 前 CEO Tobi Knaup 撰文认为 · 开源权重模型正在经历当年 Kubernetes 击败 Mesos/Swarm 的转折点 · HN 295 分 238 评论。核心论据是:Llama / Qwen / DeepSeek 生态在推理侧的组合可扩展性 · 已经压过闭源 API 的便利性。对做车厂 AI 平台的读者 · 这条判断关系到"自建推理集群 vs 采购 API"的选型 · 影响未来 3 年基础设施投资。建议把这篇当选型讨论的开场素材。 → Tobi Knaup
  • WAIC 2026 终极盘点 · 15 大核心趋势看透 AI 下半场 智东西整理 WAIC 2026 的 15 个核心趋势 · 涵盖开源生态、端侧算力、具身智能、多模态、Agent 商业化、AI 芯片国产化等。相比去年 WAIC 只讲大模型参数竞赛 · 今年明显下沉到"部署、Agent、端侧"三条工程线。对车机测试同行 · 值得重点看的是"Agent 商业化"和"端侧多模态"两节 · 都会在未来 12 个月落到车机上。建议当作季度技术趋势的速查手册收藏。 → 智东西