DeepSeek Harness v0.1.6-alpha:往「能远程、能组队、能点界面」的工作台靠
大家好,我是珂抖屁。
一人公司这两年最容易踩的坑,是把「又一个能聊天写代码的壳」当成升级。壳越来越多,真正能进工作流的东西其实很少:能不能摸到远程机器、能不能把任务拆给一组 Agent、能不能点开真实界面把活干完。
DeepSeek Harness(dsh)刚放出 v0.1.6-alpha(npm 上 @deepseek-ai/dsh 的 alpha 标签目前指向 0.1.6-alpha.1)。深求社区(@DeepSeek_club)的公开说明里,把这版的关键词写得很直:远程 SSH 协作、MCP 资源探索、实验性 Agent Team,以及经 Playwright / Chrome DevTools 打开的 Browser Use 与 Computer Use。社区话题页的摘要还提到 Web 侧边栏多标签终端、会话恢复、Playwright MCP / Cua Driver 一类后端,以及自动审查相关改进。
我的判断很简单:这不是又发了个聊天壳,而是在往「能远程、能组队、能点界面」的工作台靠。
下面按一人公司怎么用,拆开说——哪些是能核到的方向,哪些仍要当成实验。
先把定位说清:插件化 harness,不是又一个聊天窗

四能力示意:远程 SSH、MCP 资源、Agent Team、Browser·Computer Use;均标注「实验/预览」。
官方仓库与文档把 DeepSeek Harness 写成开源 Agent Harness,口号是 Everything is a Plugin,底层是 Cordis 的插件组合。入口常见是 Web UI:npx @deepseek-ai/dsh web(默认本机 3080)。它还处在 developer preview,README 用大写提醒:会有破坏性变更。
这对一人公司反而友好:你买的不是「某一家模型的独占外壳」,而是一套可插拔的运行时——模型路由、工具、MCP、实验能力,都能当插件叠。v0.1.6-alpha 的意义,在于把几块「真正卡工作流」的能力推到前台:远程、资源、组队、界面控制。
和「对话框里贴一段代码」比,工作台要回答的是另一组问题:文件在哪、命令在哪跑、权限谁批、会话断了能否续、外部知识怎么进来。插件化 harness 的价值,就是把这些问题变成可替换模块,而不是写死在某一个闭源客户端里。
远程 SSH:工作台要能摸到真正的机器
本地写得再花,生产与实验常常在另一台机器上。公开讨论与社区说明把 远程 SSH 协作 列为这版重点;生态里也早有面向 DSH 的远程 / SSH 插件实践(隧道、远程运行时、安全门控的实验室 SSH、远程 IDE 式浏览与终端等)。
一人公司怎么理解这件事:
•不是「SSH 登录聊天」,而是让 harness 的工作区、终端、文件操作能落到你真正干活的那台机。
•边界要守:Web UI 本机绑定、隧道转发、密钥与权限,比「能不能远程」更重要。公开运维文也反复提醒:把无鉴权的 Agent 端口暴露到公网,等于把本机用户权限交出去。
•适配一人公司:白天在笔记本上指挥,重活、GPU、内网仓库在服务器上跑——这才是远程能力的正经用法。
如果你日常只在本机玩具项目,SSH 不是刚需;一旦开始「本机壳 + 远端真环境」,它立刻变成默认配置项。我会把它当成工作台的「网线」,不是卖点贴纸。
MCP 资源:工具之外,还要把「可读资源」接进会话
MCP(Model Context Protocol)在编码 Agent 圈已经是标配。DeepSeek Harness 侧有官方 MCP 客户端插件路线(如 @deepseek-ai/dsh-mcp-client):把外部 MCP server 的工具注册进 ctx.tools,命名形态也和其他主流 harness 接近。
这版公开说明额外点了 MCP 资源探索。工具是「能做什么」;资源更像「能读到什么上下文」——文档、清单、结构化数据源。一人公司最痛的,往往不是少一个 bash,而是会话里接不上自己的知识库、工单、配置目录。
我的用法口径:
•先接 只读资源(文档、状态页、仓库摘要),再开写权限工具。
•每个 MCP server 当独立插件看待:名字空间、超时、失败是否拖垮整棵插件树,都要能热插拔。
•不要把「接了 MCP」当成「安全」——资源权限和工具权限一样,是工作台的税。
资源探索若做得好,Agent 会少问你「文件在哪」;若做得糙,它会在错误目录里自信地改。一人公司没有专职平台组,默认策略只能是:最小权限、可撤回、先只读。
实验性 Agent Team:组队,但别当生产编排器
Agent Team 不是这版才突然出现的概念:官方实验包(例如 @deepseek-ai/dsh-experimental-tool-agent-team 与对应 profile)描述的是 持久化的 Team 运行时——Lead 会话拉队友、邮箱式消息、共享任务图、可等待与可打断。文档写得很清楚:默认关闭、实验性质、契约可能变。npm 上相关 experimental 包也已出现与 0.1.6-alpha.1 对齐的 alpha 标签。
和普通 subagent 的差别,一人公司要记住三句:
•Subagent 更像一次性委派:任务出去,结果回来。
•Team 更像花名册:能继续发消息、跟任务、打断跑偏的队友。
•共享同一份 checkout——任务上的写范围多半是建议,不是硬锁;早期实验请用可丢的分支。
v0.1.6-alpha 把「实验性 Agent Team」再次推到发版叙事里,说明产品方向是:不只单会话循环,而是可组队的工作台。但我会把它标成「可玩、可写笔记、暂不绑死交付流水线」。破坏性预览期,最贵的是你以为稳定的编排契约。
现场建议:两个队友、一个明确任务板、禁止同时改同一目录——先验证「消息与状态是否扛得住刷新」,再谈效率神话。
Browser / Computer Use:能点界面,才像干活
公开说明写明:可通过 Playwright / Chrome DevTools 开启 Browser Use 与 Computer Use;社区摘要还提到 Playwright MCP、Cua Driver 等后端,以及侧边栏终端、会话恢复一类 Web 侧体验。
这对一人公司意味着什么:
•编码 Agent 解决仓库里的活;界面 Agent 解决后台、文档站、控制台、需要真实点击的验收。
•有头浏览器 / 可见操作,比纯无头脚本更适合「人在旁边盯一眼」的混合工作流。
•Computer Use 一旦能控桌面级交互,权限模型就要按「本机可信 Agent」来设计,而不是按聊天机器人来幻想。
生态里已有多种 Playwright / 浏览器控制插件实践;上游若把实验性浏览器与电脑控制收进发版主叙事,方向就更清楚了——工作台要看得见、点得着。
自动审查(公开摘要里提到的方向)若与界面操作联动,价值会更大:不是拦你玩,而是在高风险点击前多一扇门。具体行为以你装到的版本说明为准,这里不编造开关名。
一人公司怎么接这版:先验证三条链路

冒烟路径示意:本机 Web → 隧道/SSH → 只读 MCP → 公开页 Browser。
我不会建议你今晚把全部生产脚本迁过去。alpha + experimental 的正确姿势是三条冒烟:
•本机 Web UI 起得来:模型密钥、工作区、一次只读任务。
•远程或 MCP 只接一条低风险链路:例如只读资源,或隧道到测试机。
•Browser Use 只跑公开页 / 测试环境:先证明「能看能点」,再谈登录态与支付类页面。
Agent Team 放到第四步:用玩具仓库开两个队友,验证消息与任务板,而不是让它们同时改生产主分支。
把这四步写成自己的检查清单,比追每一个 alpha 后缀有用。预览期版本号会跳;你的清单可以稳定。
产品判断:壳在变薄,工作台在变厚
过去两年,大家比的是「谁家模型分更高」。现在更现实的问题是:同一模型换不同 harness,体验差很多;同一 harness 能不能远程、组队、点界面,决定你能不能把 Agent 放进真实工位。
DeepSeek Harness v0.1.6-alpha 的公开叙事,正好压在这三个字上:远程、组队、界面。再加上插件化架构,它更像在抢「Agent 工作台」的位置,而不是再发一个会写代码的对话框。
当然,alpha 就是 alpha。官方自己也说预览期会破兼容。一人公司要的不是情怀,是:哪些能力已经能进日更,哪些只能进实验笔记。 把 SSH / MCP / Team / Browser 四条能力做成自己的检查清单,比追版本号有用。
我自己的临时结论:值得盯,值得在测试机上装;不值得用「发版兴奋」替换权限设计。工作台越强,误操作的半径越大——这是能力税,也是成熟标志。
(依据:npm @deepseek-ai/dsh@0.1.6-alpha.1;深求社区 @DeepSeek_club 公开帖与话题摘要;DeepSeek Harness 官方仓库 / 文档关于插件化、Web UI、MCP 客户端与实验性 Agent Teams 的说明。未核到的细节不编造;以你本机装到的版本与官方文档为准。)