XTalking · Daily · AI × Automotive

小谈AI智舱

The Daily Brief on AI and Automotive
SAT 2026-08-15 精选 12 条 Vol. 227
01 今日头条 TOP STORIES
1
工程实践

Anthropic 官方发文教你榨干 Claude Code 每一次会话

Anthropic 在官方 Blog 放出一篇《Maximizing the value of your Claude Code sessions》,直接把内部工程师的用法拿出来讲,HN 评分 121、评论 83,是这周社区最火的一篇。核心观点是把 Claude Code 当"会话式流水线"来经营:开新会话前先写好 CLAUDE.md 上下文、任务拆细到单次可完成、用 /compact 主动压缩历史、脏活让 sub-agent 并行跑。对做车机测试的同行,这套方法直接可以套到日报整理、log 分析、稳定性 case 归因这些高频重复流程里。

这篇文章是继几个月前 Skills GA 之后,官方第一次系统讲"会话经济学"—— 上一次同类是 Cursor 团队谈 context window 管理,但 Anthropic 讲得更工程化。建议花 30 分钟通读一遍,然后挑一个你每天重复三次以上的场景(比如 monkey test log 分类)写成 Skill 试跑。

2
工程实践

Claude Code v2.1.233 · GitLab MR 与身份透传落地

Claude Code 发布 v2.1.233,两个变更值得注意:一是 --worktree 参数和 claude agents 视图正式支持 GitLab merge request,MR 直接以 !N 形式显示;二是新增 forward_user_identity 选项,允许上游代理把登录用户身份作为 header 透传,便于企业侧的审计和权限控制。对多数在 GitLab 内网做车机代码的团队,这条相当于把 Claude Code 从"个人玩具"往"团队标配"推进了一步。

此前 Claude Code 对 GitHub PR 支持完善,GitLab 一直靠社区脚本兜底 —— 这次官方补齐,对国内车厂内网 GitLab 环境是刚需。建议 CI/CD 或工具链同事把 v2.1.233 拉下来测一遍 MR 关联和身份透传,顺手评估能不能接进现有的代码评审流程。

3
智能汽车

7 位车圈高管炮轰"速成车"· 工信部甩四记重拳

7 位车企高管公开发声,矛头指向"OTA 补丁当研发"、"消费者当试车员"的速成车乱象。工信部随即出台四条硬约束:整车研发周期最低要求、软件功能上市前完备度门槛、OTA 频次与内容备案、以及关键功能回归测试留痕。对做车机测试的同行,这基本等于把"上车再打补丁"的口子堵死 —— 上市前 SOP 会被大幅拉长,回归覆盖度、稳定性小时数会被强制纳入准入。

类似的收紧此前只在辅助驾驶端出现过(4 月工信部智驾发布会规范),这次直接扩到智舱和整车软件层面。建议关注即将下发的具体技术要求文档,提前把现有稳定性测试台架的时长基线、OTA 前后回归 case 库理清楚 —— 短期内测试工时占比会明显上升。

02 智能汽车 AUTOMOTIVE
车企动向
  • 车市洗牌 · 长城奇瑞被新势力反超 · 出海难掩本土疲态 车东西数据显示,长城、奇瑞在国内市场份额被鸿蒙智行、理想、小米等新势力反超,虽然出海销量还不错,但本土增速掉队明显。核心分野还是智能化 —— 传统油车厂在智驾/智舱上迭代速度跟不上新势力月度 OTA 的节奏。对车机测试同行,意味着未来项目机会会继续往新势力集中,老牌车厂的智舱团队面临组织提速压力。建议关注两边的招聘岗位差异,能判断行业风向。 → 车东西
  • 尊界 S800 顶配 117 万 · 余承东称"跨代领先" 最贵国产 MPV 尊界正式上市,顶配定价 117 万,余承东给出"跨代领先、全面领先"的评价。车机侧搭载最新一代鸿蒙座舱,预计延续 HarmonyOS NEXT 的分布式能力和多屏协同架构。对做座舱性能测试的同行,这台车会是鸿蒙座舱高端旗舰的技术上限参考 —— 多屏、大内存、高算力全堆满。建议关注它的多屏帧率同步、跨屏拖拽时延基线,后面可以作为对标测试的目标值。 → 车东西
03 工程与研究 ENGINEERING & RESEARCH
AI 大厂动态
  • DeepSeek Harness 实测 · 梁文锋憋的"黑色鲸鱼"来了 智东西实测 DeepSeek 新发的 Harness 框架,定位是 agent 训练与评测一体化工具,和 OpenAI 的 Swarm、Anthropic 的 Skills 属于同类但路线不同 —— Harness 更偏"训练 loop 可复用"。对做端侧 agent 落地的同行,这可能是继 R1 之后又一个能白嫖的开源基础设施。建议先看官方 README 判断是否支持本地部署,座舱 agent 场景值得跑一遍。 → 智东西
  • GLM-5.3 发布 · Coding 逼近 Fable 5 · 顺手拿下最强开源安全模型 智谱发布 GLM-5.3,重点做 Coding 增强,官方对标 Fable 5,并附送一个安全模型 —— 号称能揪出潜伏 40 年的老 bug。相比上一代 GLM-4.5,推理和长上下文都有提升,继续维持开源路线。对国内团队意义在于:内网合规场景下,GLM-5.3 是少数能替代 Claude 做代码任务的选项。建议对比一下 GLM-5.3、Qwen3-Coder 在你现有代码库上的实际召回率再决定接入。 → 量子位
  • Qwen3.8-27B 开源 · 家用显卡可跑 · 免费商用 阿里开源 Qwen3.8-27B,27B 参数量卡在消费级显卡(24G 显存)可跑的甜点位,继续维持 Apache 2.0 免费商用协议。相比之前 72B 版本,27B 更适合边缘或车端部署场景。对做车机端侧模型选型的同行,这是继 Qwen3-14B、Gemma-27B 之后又一个 mid-size 选项。建议在车规平台(如 8295)上做一轮 INT4 量化跑分,能出真实的 token/s 数据。 → 量子位
  • Gemini 3.7 Flash 发布 · Google DeepMind 重回前排 Latent Space 分析 Gemini 3.7 Flash,认为 GDM 通过这次 Flash 系列升级重新拉齐了和 Claude、GPT 的差距,尤其在长上下文和多模态延迟上有明显优化。上一次 Gemini 让人眼前一亮还是 2.5 Pro 阶段,中间被 Claude 4/5 甩开一段。对做车端云侧调用的同行,Flash 系列一直是性价比首选。建议看下最新的 pricing 和延迟数据,评估要不要把座舱语音后端切一部分流量过去做 A/B。 → Latent Space
  • Google 用同态加密把 Private AI 做到能落地 Google Security Blog 介绍如何用同态加密(FHE)让隐私 AI 真正可用,HN 评分 255、评论 159,讨论度不低。核心是把密态计算的性能开销压到了工程可接受范围,过去 FHE 一直卡在"慢 1000 倍"没法上生产。对车企数据合规场景意义大 —— 用户语音、行车轨迹这类敏感数据未来可能直接在密态下做推理。建议关注是否有开源实现,车云一体架构里可以预留 FHE 接口位。 → Google Blog
行业观察
  • Google 开始肢解 DeepMind · 多个团队被划归总部 · 布林亲自督战 量子位报道,Google 正把 DeepMind 数个团队(涉及 Gemini 部分模块、基础设施)划归 Google 总部直管,创始人布林亲自下场推动。相比 2023 年 Google Brain 与 DeepMind 合并成立 GDM,这次是反向拆解,信号明显是要把 AI 决策链缩短。对行业意味着 Gemini 迭代节奏可能会加快,Sundar-Demis 二元结构可能会变化。建议关注后续 GDM 的核心研究员流向,人才动向往往先于产品变化。 → 量子位
  • 7 亿年薪留不住 · 余家辉离职 Meta 创业 · 只待了一年 前 OpenAI 明星研究员余家辉从 Meta Superintelligence Lab 离职创业,距他去年被扎克伯格用 7 亿美元年薪挖角刚满一年。这已经是今年第 N 位从 Meta 离开的高价挖来的核心 researcher,Meta 的组织留人能力再次被质疑。行业信号:顶级 AI 人才的选择正在从"打工"转向"自己做 lab"。建议关注他的新公司方向,大概率会在 agent 或 post-training 赛道,可能孵化出新的开源基建。 → 量子位