人工智能-远程-1个月
¥12-18K/月
技能要求: 服务器测试
经验要求: 5-10年经验
程序员客栈
2026-08-26 14:29
工作描述:
项目编号:【44123】
岗位简介:AI 算力方案工程师
本岗位为**项目制远程兼职**,不坐班。针对私有化大模型、Agent、RAG 项目,根据 AI 业务负载输出 GPU 服务器、ARM 边缘整机算力方案、BOM 清单,输出 POC 验证方案,做算力评估与风险识别,输出技术文档,支撑内部项目售前与方案评审。

岗位职责
1. **算力整机方案设计输出**
根据 AI 项目业务负载(离线批量处理、大模型推理、长上下文、边缘轻量化推理),评估显存、算力、内存、IO、网络、功耗散热;完成 X86‑GPU 服务器、ARM 边缘设备、工控盒子、国产 AI 加速卡整机方案,输出硬件配置 BOM 清单、成本测算,区分训练 / 推理场景,识别性能瓶颈、软硬件兼容风险。
2. **POC 方案与技术论证**
输出 POC 验证方案,明确测试指标:QPS、延迟、显存占用、并发上限;给出硬件测试步骤,输出可交付的 POC 测试报告模板,线上评审方案合理性,识别客户不合理硬件预期,输出折中可行技术建议。
3. **售前技术文档输出**
输出算力部分投标技术章节、应答文档,撰写算力选型说明,解答 GPU、异构架构、国产化适配相关技术疑问。
4. **硬件基线与经验沉淀**
梳理不同 GPU、国产加速卡、ARM 边缘设备,针对大模型业务的选型基线;沉淀选型 checklist、常见坑点知识库。
5. **项目答疑评审**
项目实施阶段线上配合答疑,识别算力侧软硬件兼容风险;把硬件层问题反馈给内部研发,给出优化建议。


任职要求
1. 本科及以上,计算机、电子信息相关,有 2‑4 年算力 / 服务器 / AI 私有化方案相关实战经验,可线上高效沟通,按时交付文档。
2. 熟悉 Linux、Docker 基础;理解 GPU 显存、算力对大模型推理任务的约束;熟悉 X86 服务器,了解 ARM 架构特性,有边缘 AI 整机方案经验。
3. 了解大模型推理组件 vLLM/TGI、向量数据库资源消耗特征,具备算力测算能力,能够根据业务负载推导硬件配置,而不是只参考纸面参数。
4. 可以独立输出 BOM 清单、技术方案、POC 报告,具备线上评审、答疑沟通能力。
公司信息

立即沟通