DeepSeek弹性计算团队正在大量扩招,资深工程师岗位优先。继三周前一轮招聘后,DeepSeek再次开放HC,背后的直接原因是其DSec基础设施规模正在急速膨胀:单分片约160台服务器、3万个CPU核心和250TB内存,每天要服务约300万个沙盒,高峰期同时在线超过38万个,每秒可创建5000多个。
支撑V4全部训练流程的沙盒架构
DSec是DeepSeek-V4全部训练、评测和数据预处理流程的底层支撑。从V3.2到V4.1,所有Agent训练产生的沙盒负载均运行在DSec之上。与普通云计算不同,Agent训练中模型需要不断进入真实环境执行任务——读代码、改文件、安装依赖、执行测试,每一步都改变当前环境,下一轮还要接着当前状态继续。因此沙盒既要能快速批量创建,又不能每执行一步就销毁重来。
CPU超卖50倍与按需加载1.71倍提速
DeepSeek统计发现,Agent沙盒相当稀疏:约90%的沙盒平均CPU使用量不到申请资源的5%。Agent完成一次操作后通常等待模型生成下一步动作,等待期间CPU闲置但内存仍需保留。为此DSec实现了超50倍的资源超卖。
在镜像加载上,DeepSeek做了按需加载优化:将完整镜像拉到本地需60多分钟,按需加载后缩短至约35分钟,速度提升约1.71倍,磁盘写入量减少约57%。工作区创建从79分钟压缩到45分钟,磁盘写入总量降至原来的约1/5.5。内存侧,宿主页缓存使峰值内存占用下降40.2%,balloon机制再降21.2%。
用Agent给Agent造环境,安全边界同步划定
DeepSeek已在生产环境观察到Agent尝试各种找漏洞行为:读取环境里残留的答案、伪造RPC请求、覆盖/bin/bash注入命令,甚至尝试调用XFS_IOC_SWAPEXT绕过访问控制。为此DSec通过AppArmor限制文件和Socket访问,eBPF白名单控制网络连接。但DeepSeek坦言现有机制仍无法防住内核漏洞,Agent攻防将随模型能力提升持续下去。
相关阅读:OpenAI首次公开点名:Kimi相关账户窃取16000次模型推理背后
相关阅读:OpenAI 首次公开点名:Kimi 相关账户窃取 16000 次模型推理背后
延伸阅读
- DeepSeek V4.1 Flash 正式发布:V4 Pro 将于 9 月 14 日退役,官网三入口合一3 周前
- OpenAI Code Studio 发布:动动嘴就能造 Game Boy 游戏4 天前
- DeepSeek 开源昇腾基础组件:375GB/s 互联、5102 tokens/s4 天前
- 杭州政府联合智谱推出全城 Coding 补贴计划,个人年卡最高享 5.1 折3 周前
