XTalking · Daily · AI × Automotive

小谈AI智舱

The Daily Brief on AI and Automotive
MON 2026-08-17 精选 12 条 Vol. 229
01 今日头条 TOP STORIES
1
AI 大厂动态

Anthropic 公开 Claude 历代 System Prompts

Anthropic 在 platform.claude.com 上线了一个新的 Release Notes 页面,把 Claude.ai 上历代模型的 System Prompt 全文公开,包含 Sonnet、Opus 各版本的完整系统提示词。HN 上冲到 503 分、212 条讨论,是过去一周社区讨论最热的工程话题。对做 Prompt 工程和 Agent 的读者,这相当于官方发了一份"顶级团队怎么写 Prompt"的范本 —— 可以直接看到 Anthropic 如何处理 tool use 描述、拒绝策略、格式约束和 artifact 分支逻辑。

此前 Anthropic 的系统 Prompt 一直靠社区逆向泄露,这是官方第一次做成"版本发布日志"的形式常态化更新。建议把这些 Prompt 存下来做 diff · 对比不同版本之间"安全策略"和"工具调用逻辑"的措辞变化,比看 100 篇 Prompt Engineering 教程都有用。

2
工程实践

Anthropic 复盘:多 Agent 系统的模式与陷阱

Anthropic Research 发文总结了当前 multi-agent 系统的常见模式和失败模式,HN 179 分 · 130 条讨论。文章重点讲了 orchestrator-worker 结构、context 共享成本、以及"agent 之间互相误导"这类工程陷阱 —— 并给出一个反直觉的结论:大部分场景下,一个装备完善工具的单 Agent 比多 Agent 编排更稳。对做 Agent 落地的读者,这是继 Building Effective Agents 之后 Anthropic 官方最有价值的一篇实战总结。

和年初 MetaGPT / AutoGen 等"多 Agent 万能论"形成对照,Anthropic 的立场明显更保守,认为多 Agent 应该只在"任务天然并行 + 上下文可切分"时使用。建议在座舱 Agent 场景先跑单 Agent + 好工具的架构,别急着上多 Agent 编排 —— 车机上下文本来就窄,并行收益少、debug 成本高。

3
智能汽车

工信部四记重拳整治"速成车" · 7 位车圈高管公开炮轰

7 位车企高管公开发声,批评当前"18 个月一款新车、消费者变成试车员"的行业乱象;工信部同期出台四项政策,重点包括:延长准入测试周期、强化 OTA 备案、限制未成熟功能量产、以及强化智驾功能宣传合规。对做车机测试的读者,这是一个非常明确的政策信号 —— OTA 备案变严 · 意味着测试报告要跟着监管口径重做,"发出去再修"的老路子行不通了。

对比 2023 年那波"L2 宣传合规"整治,这次的力度和覆盖面明显更大,直接触及研发节奏本身。建议关注工信部原文和《汽车软件在线升级管理规定》修订版,特别是稳定性测试的最低时长和回归测试的强制项 —— 这些会直接进 QA 团队的 KPI。

02 智能汽车 AUTOMOTIVE
车企动向
  • 尊界 S800 顶配 117 万上市 · 余承东称"跨代领先" 华为 + 江淮联合打造的尊界品牌首款 MPV 上市 · 顶配 117 万成为最贵国产 MPV。座舱侧搭载鸿蒙座舱最新版本 · 多屏联动 + 后排大屏方案对标丰田埃尔法 + 奔驰 EQS SUV。对比岚图梦想家、腾势 D9 的 30-50 万区间,尊界直接跳级到百万段,是华为智选车向豪华 MPV 的第一次试水。做座舱测试的读者可以重点关注鸿蒙座舱在多屏、多音区 · 高负载场景下的表现,大概率会成为未来一年的性能标杆。 → 原文
  • 国内车市变天 · 长城奇瑞被新势力反超 最新销量数据显示 · 长城、奇瑞在国内本土市场被理想、鸿蒙智行、小鹏等新势力反超 · 二者靠出海撑住整体盘子。核心差距在智能化 —— 传统车企的座舱 / 智驾迭代节奏跟不上新势力的月更 OTA。对车机测试团队意味着,老牌车企也会开始压缩发版周期、加大 OTA 覆盖率,回归测试的自动化和台架并行能力会被逼着上一个台阶。建议关注长城、奇瑞今年的智驾组织架构调整信号。 → 原文
03 工程与研究 ENGINEERING & RESEARCH
AI 大厂动态
  • DeepSeek Harness 实测 · 梁文锋憋的"黑鲸"大招上线 智东西实测 DeepSeek 新发布的 Harness 框架 · 定位是一个面向复杂任务的 Agent Runtime · 主打长上下文规划和工具编排能力。相比 OpenAI Assistants API 和 Anthropic 的 Claude Code,DeepSeek Harness 更强调开源和本地部署友好。对车端 AI 应用有直接意义 —— 车机上的 Agent 需要能离线跑、能受控编排,Harness 的架构值得抄。建议看看它的 tool schema 定义和 memory 管理方式,和 MCP 做个对比。 → 原文
  • Qwen 3.8 27B 发布 · 视觉能力强但爱过度思考 阿里通义千问开源 Qwen 3.8 27B · Apache 2.0 协议 · 支持视觉输入 · 是当前笔记本本地运行的甜点尺寸。Simon Willison 实测发现能力强但默认爱"overthinking" · 简单问题也会展开长 CoT。对比 Llama 4 27B 和 Gemma 3 27B · Qwen 在中文和多模态上明显更强,但推理成本也更高。做座舱端侧模型选型的读者可以关注 · 特别是 8295+ 平台 · 27B 已经接近端侧可跑的上限。建议关注它的 quantized 版本表现。 → 原文
  • Sand.ai 开源全球首个千亿 MoE 视频模型 Sand.ai 开源全球首个千亿参数级 MoE 视频生成模型 · 为视频 Scaling Law 找到新路径 · 稀疏激活让千亿模型的推理成本可控。对比 Sora、可灵、Runway Gen-4 的 dense 架构,MoE 路线在同等成本下可以塞更多参数。虽然离车端还很远 · 但对座舱内容生成(如 AI 壁纸 / 待机动画 / 后排娱乐)是一条值得跟的技术线 · 建议关注模型权重和推理框架。 → 原文
  • Anthropic 单季营收 115 亿美元 · 同比暴涨 1400% Anthropic 最新季度营收 115 亿美元 · 同比涨 1400% · 传将以史上最高上市估值超越 SpaceX。核心增长来自 Claude Code / Claude API · 企业客户占比高。对比 OpenAI 的消费级路线,Anthropic 明显走"开发者+企业"路线 · Claude Code 的市占率还在扩大。对读者意味着 Claude 生态会继续投入 · Skills / MCP / Claude Code 的迭代节奏不会慢。建议继续押注 Claude Code 作为主力开发工具。 → 原文
工程实践
  • AI Coding Without the Vibes · 用工艺方法驯服 AI 编码 Peter Bloem 撰文反对"vibe coding" · 提出一套 craft-based 的 AI 编码流程 · 强调小步验证 · 契约先行 · 每步都有可回滚点。HN 74 分 · 44 条讨论 · 是近期少见的"反 Cursor 一把梭"的清醒文。对每天用 Claude Code / Cursor 写测试脚本的读者非常适用 —— 车机自动化测试代码尤其怕"跑得动但不知道对不对"。建议照文里的 checklist 重构一份自己的 AI 编码 SOP。 → 原文
行业观察
  • Stripe 70 亿美元收购 OpenRouter · 押注 AI 支付层 Bloomberg 报道 Stripe 接近以 70 亿美元收购 AI 模型路由聚合平台 OpenRouter · 后者是当前调用 100+ 模型的主流中转层。HN 133 分 · 89 条讨论 · 争议焦点是"支付公司为什么要买 Model Router"。核心逻辑是 AI Token 已经成为独立的计价单位 · 支付层比模型层更接近现金流。对做 AI 应用架构的读者是个信号 · 未来 API 调用可能会像刷卡一样标准化 · 建议关注 OpenRouter 的定价和账单模型。 → 原文
  • AI Credit 转售经济 · Token Broker 浮出水面 Vectoral 博客深挖了一个新兴灰色地带 —— AI Credit / Token 转售市场 · 一批中间商靠倒卖 OpenAI / Anthropic 的 API 额度赚差价。HN 217 分 · 83 条讨论。背景是各家大厂对新客户有大额免费额度和阶梯折扣 · 造成套利空间。对企业侧采购 AI 服务的读者是个提醒 · 便宜的 API Key 可能来自转售链,合规和稳定性都有风险。建议采购前查清 Key 的官方直采身份。 → 原文