AREX Feed Article
DeepSeek Harness 正式开启内测招募:Harness Team 成员公开征集开源开发者,社区本地部署多点验证
8 月 1 日,DeepSeek Harness Team 成员 Tianyi Cui(@tianyi)在 X 平台公开发布内测招募帖,面向 Agent Harness 相关开源项目开发者征集测试用户。申请者需提供 GitHub ID 及开源代表作。这标志着 DeepSeek 自有编码代理产品从幕后组建正式走向公开测试阶段。
招募帖引爆中文开发者社区
截至 8 月 2 日,该招募帖已积累 56.5 万次浏览、211 次转推、769 条回复、2187 次点赞和 1098 次书签,140 条引用推文进一步扩散。回复中涌现大量知名开源项目申请:
- DeerFlow(ByteDance 生态,MiniMax Code R&D 负责人 DanielWalnut 提交)
- KunAgent(Kun,2545 粉丝独立开发者)
- OpenPencil(AI-Native 设计工具,Fini.Yang 提交)
- CodePilot(歸藏 @op7418,16.4 万粉丝知名 AI 博主)
- Orca(35k GitHub Stars 开源 ADE,前 Google/Cornell YC 校友提交)
- LobeHub、BenchFlow(@xdotli)、Raven(EverMind-AI)等
Tianyi Cui 的个人简介明确标注「Member of Technical Staff @ DeepSeek, Harness Team」,所在地北京。此前 5 月 Verdent 等媒体报道 DeepSeek 组建 Harness 团队并招聘 PM 与研发工程师,目标直指 Claude Code、Codex、Cursor 等现有编码代理产品。7 月 28 日 KuCoin/ChainThink 援引消息称 Harness 将于「本周内测」,此次公开招募确认了该时间线。
社区同时关注到 NDA 流程中的细节问题:开发者 @gaocegege(7630 粉丝)在回复中质疑「为什么 NDA 要提供身份证复印件,签署过非常多 NDA,这是第一次遇到需要提供身份证的」,目前未见官方回应。
V4 Flash 本地部署边界持续扩展
与此前报道的 2×DGX Spark(NVFP4 / 82 tok/s)和 Unsloth GGUF(96–168GB)方案相比,社区于 8 月 2 日验证了两条新的本地部署路径:
- 单台 DGX Spark:@0x0SojalSec(4.96 万粉丝)确认 IQ3_XXS 量化版本在单台 DGX Spark 上完整运行,所有层加载至 GPU,解码速度 16.5 tok/s。其评价该配置为「目前能在单桌面上保持正常对话的最大模型」
- 4×RTX 3090:@gabu3d_pl 展示 IQ2XXS 量化在 4 张 3090 上实现 35–40 tok/s 解码,使用 llama.cpp 加载 antirez 版 GGUF
上述配置均使用 Unsloth 此前发布的动态 GGUF 量化体系,但以更低量化等级换取更广泛的消费级硬件覆盖。单 DGX Spark 方案的确认尤其值得关注——它将此前「双 DGX Spark」的准入门槛降低了一半。
与此前报道的关系
此前三篇报道分别覆盖了 V4 Flash 0731 的公测与 MIT 开源、vLLM/DSpark 推理层支持、以及 HF 免费端点的零门槛接入。本次更新记录了两个方向的新进展:
- Harness 产品化:确认 DeepSeek 自有编码代理产品进入内测阶段,这是模型层(V4 Flash)之上的产品层延伸。此前报道中「DeepSeek Harness minimal mode」仅作为评测框架被提及,如今它正成为独立产品
- 本地部署扩散:在已报道的 2×DGX Spark 和 Unsloth GGUF 量化方案之外,单 DGX Spark 和 4×3090 方案获得社区实操验证
社区普遍猜测 Harness 将与 V4 Pro GA 在 8 月中旬联合发布,但 DeepSeek 官方尚未确认具体日期。