小谈AI智舱
DeepSeek Harness 实测:梁文锋憋的"黑色鲸鱼"到底怎么样
DeepSeek 悄悄放出了自家的 agent harness —— 也就是把模型、工具调用、记忆、多轮规划打包成一套可以直接落地的执行框架,智东西第一时间做了实测。这次的重点不在模型本身,而在"外壳":同样的 DeepSeek-V3 底座,套上官方 Harness 后,复杂任务(浏览器操作、代码修 bug、多步 API 编排)的完成率明显高于裸调用,而且推理成本没有明显上涨。对做工程的读者来说,这意味着国产开源侧终于有一套可以对标 Claude Code / Codex 的"官方最佳实践",不用再自己拼装 ReAct + Function Calling 那一套。
Nvidia 站台:真正的主角不是模型,而是 harness
TechCrunch 的这篇观察把最近半年 AI 圈的路线变化说得很直白 —— Nvidia 在最新的开发者活动上强调,今天决定 AI 应用能不能用的,已经不是模型的 benchmark 分数,而是围绕模型搭的那一整套 harness(工具、记忆、评测、路由、成本控制)。这和 DeepSeek 今天发 Harness、Anthropic 主推 Claude Code、OpenAI 独立 Codex 是同一个信号。对车机测试工程师意味着:未来评估一个车端 AI 助手好不好用,不能再只看"用的什么模型",而要看它的 agent 框架、工具接入方式和失败恢复机制。
华为系首款方盒子 42.98 万起 · 余承东预告"几个月上 L3"
华为鸿蒙智行阵营首款方盒子造型 SUV 正式上市,起售价 42.98 万,同时发布了车顶帐篷这种越野向配件。更值得关注的是余承东在发布会上再次口头预告"再有几个月就能用上 L3"——考虑到目前国内 L3 试点法规才刚落地,这句话如果兑现,华为会是首个把 L3 有条件自动驾驶推到量产用户手里的国内品牌。对做智驾/座舱测试的同行意味着:L3 场景下的接管请求、责任切换、HMI 提示这些新测试项要开始准备了。