XTalking · Daily · AI × Automotive

小谈AI智舱

The Daily Brief on AI and Automotive
THU 2026-09-24 精选 10 条 Vol. 267
01 今日头条 TOP STORIES
1
AI 大厂动态

Claude Opus 5.5 上位,全行业降价 40%-50%

Anthropic 发布 Claude Opus 5.5,取代此前版本成为默认模型,同时行业内主要厂商同步下调 API 价格 40%-50%。这轮降价被认为是对 OpenAI 即将推出的 GPT-6 系列(主打效率优先)的提前防御,Opus 5.5 在推理成本上做了明显优化,试图在效率上正面竞争。对天天调用 Claude API 做 Agent / 测试脚本的读者,直接影响就是同样预算能跑更多任务,值得重新核算你现有工作流的 token 成本。

这是 Claude 系列近半年最大的一次价格调整,此前 Sonnet 4.5 定价基本稳定,这次连 Opus 都被拉进降价名单,说明模型厂商价格战从中低端模型蔓延到旗舰模型。建议本周检查一下你项目里跑批量任务用的模型版本,看是否能直接切到 Opus 5.5 获得更好性价比。

2
工程实践

Claude Code v2.1.281:Bedrock 网关支持 IAM Role

Anthropic 发布 Claude Code v2.1.281,给 Claude apps gateway 新增了对新版 Claude Desktop key 的支持,可以在 desktop policy 里配置 blockReadsOutsideWorkingDirectories 和 disableBypassPermissionsMode 两个开关。同时 Bedrock 上游新增 assume_role 能力,gateway 可以直接以 IAM Role 身份调用 Bedrock,不用再手动管理长期密钥。对做企业内部部署或跑批量测试脚本的读者,这意味着权限隔离和密钥轮换可以做得更细,尤其适合多团队共用同一套网关的场景。

此前 Claude Code 的 gateway 权限控制粒度较粗,基本靠一把密钥走天下,这次拆分出目录读取限制和权限绕过开关,是在向企业级 IAM 管理靠拢,思路和 AWS 原生的 STS AssumeRole 一致。如果你们团队已经在用 Bedrock 跑 Claude Code,建议升级到这个版本并把长期密钥换成 assume_role 配置,减少密钥泄露风险。

3
智能汽车

零跑智驾:800 人一年,论文里的关键拆解

车东西深扒了零跑智驾团队最新公开的论文,揭示这套系统背后是 800 人规模的团队投入近一年时间打磨。文章拆解了零跑在感知、预测、规划链路上的具体技术选择,对比了行业里主流的端到端和模块化两种路线的取舍。对做座舱/智驾测试的读者,这类论文级别的拆解比车企发布会的宣传稿更有参考价值,能看到实际的技术债和取舍逻辑。值得花时间通读原文,尤其是测试验证环节的部分。

相比理想、蔚来等更早公开技术细节的车企,零跑此次算是补课式的技术亮相,但 800 人一年的投入规模说明其决心不小。建议对照零跑论文里提到的仿真测试和数据闭环方法,看看能不能借鉴到自己现有的智驾/座舱测试用例设计里。

02 智能汽车 AUTOMOTIVE
智驾
  • GPT-6 Astra 被曝已具备驾驶汽车能力 HN 热帖显示 GPT-6 Astra 在驾驶测试基准 DrivingBench 上跑出结果,热度达 270 分、221 条讨论。此前通用大模型涉足驾驶场景多停留在仿真或语音交互层面,这次是直接的驾驶行为能力展示。对做智驾测试的读者,值得关注 DrivingBench 的评测方法是否能迁移到自己团队的测试用例设计中。建议先看一下该基准的具体评测维度和数据来源。 → 原文
车企动向
  • 零跑连发五大招,朱江明称要做车圈苹果 零跑一次性公开五项技术进展,同时官宣第二品牌和机器人业务规划,朱江明直接对标苹果的软硬件一体化路线。此前零跑主打性价比,这次技术亮相说明其正在补齐研发标签,和理想、小鹏的路线趋同。对做座舱测试的读者,意味着零跑座舱/智驾产品线未来测试需求会明显增加。建议关注第二品牌的具体产品定位和上市节奏。 → 原文
03 工程与研究 ENGINEERING & RESEARCH
硬件与芯片
  • 高通发布 2nm 双旗舰,手机可跑 300 亿参数大模型 新架构针对 Agent 场景做了专项优化,号称能在手机上直接跑起 300 亿参数级别的大模型推理,对比上一代骁龙 8 系列端侧大模型能力有明显跃升。座舱 SoC 和手机 SoC 技术路线一直有交叉,高通在手机端的架构革新往往会在 1-2 年内下沉到 8155/8295 系列车规芯片上。建议关注高通后续是否把这套 Agent 专用架构下放到车规产品线,提前评估对座舱算力基线的影响。 → 原文
AI 大厂动态
  • DeepSeek 公开 Agent 训练论文,梁文锋署名 论文首次系统性披露 DeepSeek 在 Agent 强化学习训练上的沙盒并发架构,每秒能产生 5000+ 个训练沙盒,速度远超此前业界公开的类似方案。这类工程细节此前多被 OpenAI、Anthropic 视为核心机密,DeepSeek 选择公开延续了其开源生态策略。值得精读论文里的沙盒调度部分,对自己搭建 Agent 评测环境有直接参考价值。 → 原文
  • Claude 协助发现带 CRISPR-like 重复序列的新酶系统 Anthropic 披露 Claude 在科研辅助场景实现了具体成果,HN 讨论热度达 439 分、489 条评论。此前 AI 辅助生物发现多停留在文献综述或分子筛选层面,这次直接涉及新酶系统的发现。虽然和车机测试关系不大,但反映出大模型在垂直专业领域的能力边界正被验证。建议关注 Anthropic 后续是否把这类"专业 Agent"能力开放到 API,可能预示工业垂直场景落地方向。 → 原文
工程实践
  • Claude Code 曾只在开启遥测时才读取 AGENTS.md 这是一个隐藏较深的行为 bug——AGENTS.md 本应是项目级配置的核心入口,却和 telemetry 开关强耦合,不少用户配置长期未生效却不自知,现已修复。对比之前 CLAUDE.md 等配置文件读取逻辑一直比较透明,这次说明 gateway 内部条件分支存在耦合设计问题。如果你的项目依赖 AGENTS.md 做规则约束,建议升级到修复版本后重新验证配置是否生效。 → 原文
  • Anthropic 分享:埋点测量后 Claude.ai 响应更快 文章核心思路是"先能测量,才能优化"——团队通过埋点定位到具体延迟瓶颈点并逐个消除,而不是笼统调参。这和常规性能测试工程师的方法论完全一致,即先建立可观测的 benchmark 再迭代。建议参考文章里的埋点粒度设计,类比到车机应用的响应延迟排查上,尤其是语音助手和大模型交互链路的耗时定位。 → 原文