客户支持
$1500 - $2000 / month
加载中...
我们运营遍布欧洲和美国的最先进的人工智能工厂,运行大型NVIDIA GPU集群(H100、H200、B200、B300)在裸金属上,用于前沿人工智能工作负载。我们设计、构建和运营整个堆栈:数据中心的电力和冷却、InfiniBand网络、SLURM和Kubernetes编排、存储以及将原始铁转化为可靠计算的控制平面。
深度SRE/HPC背景:5年以上SRE、系统工程或HPC操作经验。SLURM专家:在大规模SLURM上有生产经验(会计/slurmdbd,prolog/epilog脚本,cgroups,GRES,拓扑意识)。NVIDIA堆栈掌握:有NVIDIA数据中心GPU、驱动栈、CUDA运行时、Fabric Manager、nvidia-smi、DCGM和GPU Direct RDMA的实战经验。网络:在100G或更高速度的InfiniBand网络上有操作经验(OpenSM/UFM,ibdiagnet,perfquery,和网络故障排除)。Linux管理:专家级Linux管理员技能(Ubuntu/RHEL家族),包括内核调优、systemd、网络和PXE部署。自动化:在Python和Bash中有扎实的脚本技能,加上Ansible或Terraform的了解。Nice to Have:分布式训练:有NCCL内部经验、PyTorch分布式或Megatron风格训练堆栈经验。集群管理:熟悉BCM(基础命令管理器)、Run:ai或类似管理器。Kubernetes:有在裸金属上运行Kubernetes的经验,带有GPU、网络和MPI操作符。存储:接触高性能存储如Lustre、WEKA、VAST或BeeGFS。基础设施上下文:在AI云、neocloud、HPC中心或超大规模云环境中有先前工作经验。
我们运营遍布欧洲和美国的最先进的人工智能工厂,运行大型NVIDIA GPU集群(H100、H200、B200、B300)在裸金属上,用于前沿人工智能工作负载。我们设计、构建和运营整个堆栈:数据中心的电力和冷却、InfiniBand网络、SLURM和Kubernetes编排、存储以及将原始铁转化为可靠计算的控制平面。
注册并登录后即可查看
$1500 - $2000 / month
我们正在寻找一位经验丰富的客户服务中心经理,负责领导和扩展一家美国家庭服务组织的远程客户支持运营。在这一务实的角色中,您将负责监督日常运营,管理客服员和调度员团队,并将小支持团队转型为支持全国连锁门店的高效集中中心。
工作时间:9am-5pm EST/PST。需重叠工作。汇报对象:CEO。全远程。我们正在招聘:客户成功经理(远程)。一家快速成长的软件公司正在寻找一位杰出的客户成功经理加入团队!
负责与客户、物流、制造和/或销售或服务代表对接,处理各种售前或售后服务功能。