XTalking · Daily · AI × Automotive

小谈AI智舱

The Daily Brief on AI and Automotive
MON 2026-08-24 精选 12 条 Vol. 236
01 今日头条 TOP STORIES
1
AI 大厂动态

FT:Anthropic 最强模型正在被更便宜的工具吃掉份额

FT 引述知情人称,Anthropic 虽然靠 Claude 在编程场景挣到了 API 收入的大头,但在消费级和中小开发者市场,正被 GLM、DeepSeek、Qwen 这些"够用又便宜"的模型分流。Simon Willison 拆出的几个数据点:Claude API 收入约七成来自代码类调用,但 Sonnet 4/5 的单 token 价格是 GLM-4.6 的 5-10 倍。对做工程和车机 AI 集成的读者,这条信号意味着"能力最强"和"被用得最多"正在明显分叉,选型时最好按场景分层,而不是无脑上 Claude。

对比一年前 Anthropic 独领代码 Agent 赛道的局面,如今 Cursor、Cline 等前端工具已开始默认支持多模型切换,把定价压力直接传导给底模。建议做 IVI 端侧或云端 LLM 选型时,把"编程/工具调用"和"日常对话/语音助手"分开评估,前者留给 Claude 类,后者可以试 GLM-4.6 / DeepSeek V3.2,能省一大截 token 成本。

2
工程实践

Fabien Sanglard 公开自用的 agent.md · 让 LLM 写代码更能落地

《Wolfenstein 3D 游戏引擎黑书》作者 Fabien Sanglard 把自己长期打磨的 agent.md 放了出来,HN 上 121 分、62 条讨论。核心思路很朴素:用一个规范文件明确告诉 Claude Code / Cursor 类工具"这个仓库的编码风格、测试要求、禁止行为",从源头压住 LLM 乱改代码的冲动。文件里明确规定"不要加没必要的注释""改动最小化""每次改完必须跑测试",都是踩过坑才写得出来的条款。对天天用 AI 辅助写测试脚本的同行,这份 agent.md 可以直接改改就用,少走三个月弯路。

这类做法和 Anthropic 官方的 CLAUDE.md、Cursor 的 .cursorrules 是一路,但 Fabien 的版本更偏"防御式"——针对 LLM 常见的过度重构、静默失败等问题写了硬约束。建议把自家的车机测试项目也补一份 agent.md,把"日志格式""性能基线阈值""不能碰的模块"写进去,能显著减少 review 成本。

3
智能汽车

华为系首款方盒子 42.98 万起 · 余承东预告"几个月后可用 L3"

华为系首款"方盒子"造型 SUV 正式发布,起售价 42.98 万,车顶帐篷成了发布会抢戏的功能点。真正值得关注的是余承东在台上明确说"再有几个月就能用上 L3",这是华为高管首次给出比较具体的时间锚。硬件端仍是 ADS 4.0 + 双 Orin/昇腾方案,座舱大概率是 HarmonyOS 5 车机 + 鸿蒙生态互联。对做车机测试的同行,这意味着 L3 相关的接管场景、HMI 提示、疲劳监测等测试用例可能会在半年内成为强制需求,现在开始搭台架不算早。

对比小鹏、理想此前给出的 L3 时间表(2027 前后),华为这次的表态更激进。建议关注三件事:一是华为 L3 是否会先在指定高速路段做区域授权,二是 HarmonyOS 5 在方盒子车型上的多屏交互变化,三是这一代 ADS 的算力配置公开数据,能提前判断测试基线要不要重画。

02 智能汽车 AUTOMOTIVE
车企动向
  • 吉利交出最好半年报 · 李书福交棒 · 官宣停止燃油车研发投入 吉利汽车发布史上最好半年报,同期宣布终结燃油车研发,把资源全部转向新能源与智能化。参考大众、丰田还在纠结油电并行,吉利这一步比合资阵营更果断,和比亚迪 2022 年停燃油车路线类似。对车机测试的同行意味着未来吉利系(极氪、领克、银河)的所有测试基线都会围绕电子电气架构统一,油车相关的仪表/CAN 兼容用例会被逐步废弃。建议关注吉利下半年是否会给出一套统一的软件平台版本号规划。 → 原文
  • 成都车展现场:SUV 全变方盒子 · 合资阵营加速新能源反攻 车东西现场探馆发现,今年成都车展 SUV 造型几乎清一色转向方盒子,大众、丰田、日产等合资品牌也拿出了本土化电动新车。前一届车展合资展台还以油车为主力,如今 8295 座舱 + 中国供应链智驾成了标配。对做车机测试的同行,这意味着合资车型的座舱堆栈正在快速向国产化靠拢,过去按"合资/自主"分开维护的测试脚本可以考虑合并。建议盯一下合资新车用的到底是 8295 还是新一代 8797,芯片一换测试基线就得改。 → 原文
出行
  • 小马智行海外部署超 4000 辆 · Robotaxi 出海跑通闭环 小马智行公布海外 Robotaxi 累计部署已超 4000 辆,覆盖中东、韩国等市场,形成了从取证、地图、运营到用户端的一整套出海闭环。对比 Waymo 仍主要在美国本土扩张,小马靠"车厂合作 + 本地牌照"路径把中国方案外输,速度不算慢。对同行意味着国内智驾团队做的场景库、仿真素材未来可能被迫适配左舵/右舵、多语言 HMI 等新维度。建议关注小马公开的海外 OTA 频次和事故披露,是判断 L4 系统真实成熟度的稀缺数据。 → 原文
03 工程与研究 ENGINEERING & RESEARCH
AI 大厂动态
  • 实测 DeepSeek Harness · 梁文锋憋的"黑色鲸鱼"是一整套 Agent 框架 DeepSeek 低调放出的 Harness 被智东西实测出来,不是新模型,而是一套配套的 Agent 编排框架,内置工具调用、多轮规划、代码执行等能力。对比 Anthropic 的 Claude Agent SDK 和 OpenAI 的 Agents API,DeepSeek 走的是"开源可自部署"路线,和自家 V3.2 深度绑定。对做车机端侧 Agent 的同行,这意味着可以拿到一个不用绑云、能私有部署的完整 Agent 参考实现。建议先把 Harness 的工具调用协议对照 MCP 看一遍,判断能否共用一套 tool 定义。 → 原文
  • 匿名新模型被扒出智谱血缘 · 也有人怀疑用开源 GLM 训的 量子位报道,LMArena 上突然冒出的匿名"牛来"大模型被网友通过 tokenizer、视频编码、API 报错格式一路扒,指向智谱 GLM 系列的高度相似性,甚至有人怀疑是 Cursor 拿开源 GLM 继续训的产物。对比之前 Sonnet 匿名马甲 sus-column 的操作,这轮开源模型也开始玩匿名评测。对同行意味着未来国产模型评测榜单需要更谨慎地看"血缘",不能只看名字。建议关注 GLM-4.6 / 5.x 的更新节奏,以及智谱是否正式回应。 → 原文
  • 百度 Q2 靠 AI 挣了 125 亿 · 云和搜索都在被大模型重构 智东西梳理百度二季度财报:AI 相关业务贡献 125 亿营收,其中智能云环比双位数增长,搜索也在把生成式结果作为默认入口。对比一年前百度还在被质疑"AI 不赚钱",这次财报可能是国内大厂里最明确用数字回应的一次。对同行意味着 ERNIE 系模型的车端合作可能会更积极,毕竟营收压力小了,更愿意做低毛利的车厂定制。建议留意百度 Apollo + ERNIE 在座舱侧的新合作官宣。 → 原文
工程实践
  • 硬核开发者花 $266 + 四个模型解锁 Fire 平板 · GLM-5.3 一天搞定 HN 上 603 分的爆款帖:作者为了"真正拥有"亚马逊 Fire HD 平板,先后花了 266 美元用 Claude、GPT、Gemini 尝试解锁刷机,最后 GLM-5.3 用一天时间跑通了全流程。这条和第一条 FT 的观点直接呼应:GLM 在长链路、需要大量试错的工程任务上已经出乎意料地能打。对做嵌入式、车机 debug 的同行,是一个很直接的信号,可以把 GLM-5.3 加进本地脚本工作流试试。建议对比一下同任务下 Claude Sonnet 和 GLM-5.3 的成本比,大概率超出预期。 → 原文
硬件与芯片
  • 英伟达 AI 服务器涨价 15% · 1GW 数据中心成本一次多掏 50 亿美元 量子位报道,受 HBM 和 DDR5 内存价格飙升拖累,英伟达 AI 服务器整机涨价约 15%,单个 1GW 数据中心的建设成本因此多出 50 亿美元。对比去年"缺卡不缺钱"的局面,今年变成"卡有了但内存扛不住"。对车企和 Tier1 意味着云端训练成本会传导到座舱大模型的定制报价上,合作合同价格窗口在收紧。建议做云端 LLM 车规集成时,把内存价格作为一个 risk 项写进 BOM 评估。 → 原文
  • 一篇讲清主流 AI 芯片架构差异的长文 · TPU / Trainium / MI300 全图解 jepeake.com 的一篇长文用图解方式对比了 NVIDIA H100/B200、Google TPU v5、AWS Trainium2、AMD MI300 的架构差异,重点讲片上互联和内存层级的不同选择。相比市面上大量只讲 TOPS 数字的对比文,这篇更偏体系结构。对做车载智驾芯片选型或对标的同行,这类文章能补齐"为什么 Orin 和 Thor 结构上差这么多"的底层直觉。建议花半小时通读一遍,尤其是内存带宽章节,能直接映射到车端 NPU 分析。 → 原文