客户支持
$1500 - $2000 / month
加载中...
Kimchi是CAST AI内部的AI平台。我们最初帮助企业在其自己的Kubernetes集群上运行LLM,现在我们正在构建让代理执行真实工作的执行层。我们的基础设施包括多模型推理(MiniMax、Kimi、GLM-5、Nemotron、DeepSeek)配智能路由,一个与OpenAI兼容的API,以及从我们的GPU到您的VPC的部署灵活性。推理层是基础。我们正在招聘的职位建立在之上:编码代理、代理运行时、编排系统以及使它们真正完成任务的可靠性工程。
技术栈:TypeScript、Go、Kubernetes、AWS/GCP/Azure、MCP、Prometheus/Grafana/Loki、GitLab CI、ArgoCD。
为什么Harness工程在这里重要
OpenAI和Anthropic发布模型。他们也发布了一个Harness每个 - 使原始模型转化为能够计划、执行、恢复和完成工作的支架。我们发布了一种不同的Harness:一个为成本敏感、长周期自主性构建的Harness,运行在我们控制的推理基础设施上。
一个不错的模型加上一个优秀的Harness胜过一个优秀的模型加上一个糟糕的Harness。我们已经见证了这种现象。今天模型能做什么和你看到它们做的差距大多是Harness差距 - 这个差距是我们运营的领域。
你将构建
Ratchet。
每次我们的代理犯错时,我们工程化一个解决方案使其永远不再犯同样的错误。这意味着强制约束的钩子,使模型“知道”但忘记的东西:预提交检查、权限门、在窗口填满前的上下文压缩。成功是沉默的,失败是详尽的。
长周期执行。
我们的Harness围绕着以规范驱动的自主性构建:meta-prompting、每个任务的新上下文、工作树-per-slice git策略、自动重计划、崩溃恢复、卡住检测。我们正在实现Ralph循环 - 当模型试图退出时,我们拦截并重新注入目标到新的上下文中。代理读取磁盘上的状态并继续。多会话、多天工作,没有上下文腐化。
规划/执行拆分。
用推理模型规划,用快速模型执行,用第三个模型评估。分离生成和评估胜过自我验证,因为代理可靠地倾向于积极评分自己的工作。
Harness表面。
CLI、TUI、MCP集成、沙盒执行、遥测。我们的AGENTS.md很短 - 每一行都指向一个具体的东西,它导致了错误。
记忆和上下文。
将代理从笔记本电脑上移开,给予它们在多个会话中存活的状态,管理上下文使信息落在可操作的地方。压缩、工具调用卸载、渐进技能披露。
什么是不同(有收据)
你已经看到的演讲:“我们路由到最好的模型。”每个人都说。这里是我们实际上有的:
GPU基础设施我们拥有。不只是API代理商。从云中的GPU放置到代理调用的推理端点 - 我们控制成本曲线。
以Harness为先的论点。我们将代理失败视为配置问题,而不是模型问题。当我们从股票Harness转移到自己的,内部基准测试的完成率提高了40%以上。
AGENTS.md每行都赚取每行。没有头脑风暴的规则 - 系统提示中的每个约束都指向你亲自诊断的失败。
你已经用AI编码代理在实际工作中。不只是演示 - 真正的工作。你有对Claude Code、Codex、OpenCode、Cursor的看法。你知道代理卡住时的感觉以及为什么。
在生产中拥有强TypeScript或Go。舒适地在它们之间移动。我们的表面是TypeScript;我们的核心是Go。
你以Harness术语思考。你读“代理幻觉”并第一时间问它缺失的上下文是什么,应该有什么钩子,应该有什么约束。
你驱动功能端到端。设计→构建→发布→测量→迭代。我们没有吸收模糊性的层。
构建和演变代理Harness - 发送钩子、权限门和上下文压缩。每个AGENTS.md约束都追溯到你亲自诊断的失败。
拥有长周期执行 - 多会话任务完成通过规范驱动提示、工作树-per-slice git、Ralph循环恢复和卡住检测。完成率是你的指标。
架构规划/执行/评估管道 - 用推理模型规划,用快速模型执行,用第三个模型评估。没有自我验证。
管理代理记忆和上下文 - 状态在多个会话中存活,上下文压缩,工具调用卸载。零上下文腐化在多天工作。
拥有Harness表面 - CLI、TUI、MCP集成、沙盒执行、遥测。表面是TypeScript,核心是Go。
成功后6个月的样子
你已经发布了至少一个主要Harness功能端到端:设计它、建造它、测量它、迭代。
你已经为我们的AGENTS.md添加了基于你亲自观察和诊断的失败的约束。
你已经改进了可测量的可靠性指标 - 完成率、上下文效率或每个成功任务的成本。
你已经形成了关于我们的Harness是负载承载和哪里是死重的强烈意见。
什么对你有利?
有竞争力的薪水(€6,500 - €9,000净收入,根据经验水平而定)。
享受灵活的、以远程为主的全球环境。
与全球云专家和创新者合作,热情推动Kubernetes技术的边界。
股权期权。
快速反馈,快节奏的工作流程。大多数功能项目在1到4周内完成。
将10%的工作时间用于个人项目或自我提高。
学习预算用于专业和个人发展 - 包括国际会议和课程的访问,提升你的技能。
年度黑客马拉松激发新想法并加强团队纽带。
团队建设预算和公司活动,与同事建立联系。
设备预算确保你有所有需要的东西。
额外的休息日以帮助维持健康的工休平衡。
你已经用AI编码代理在实际工作中。不只是演示 - 真正的工作。你有对Claude Code、Codex、OpenCode、Cursor的看法。你知道代理卡住时的感觉以及为什么。
在生产中拥有强TypeScript或Go。舒适地在它们之间移动。我们的表面是TypeScript;我们的核心是Go。
你以Harness术语思考。你读“代理幻觉”并第一时间问它缺失的上下文是什么,应该有什么钩子,应该有什么约束。
你驱动功能端到端。设计→构建→发布→测量→迭代。我们没有吸收模糊性的层。
有竞争力的薪水(€6,500 - €9,000净收入,根据经验水平而定)。
享受灵活的、以远程为主的全球环境。
与全球云专家和创新者合作,热情推动Kubernetes技术的边界。
股权期权。
快速反馈,快节奏的工作流程。大多数功能项目在1到4周内完成。
将10%的工作时间用于个人项目或自我提高。
学习预算用于专业和个人发展 - 包括国际会议和课程的访问,提升你的技能。
年度黑客马拉松激发新想法并加强团队纽带。
团队建设预算和公司活动,与同事建立联系。
设备预算确保你有所有需要的东西。
额外的休息日以帮助维持健康的工休平衡。
Cast AI 是一个专注于AI平台的初创公司,致力于帮助企业和开发者在自己的Kubernetes集群上运行大型语言模型(LLM)。我们最初帮助企业在其自己的Kubernetes集群上运行LLM,现在我们正在构建让代理执行真实工作的执行层。我们的基础设施包括多模型推理(MiniMax、Kimi、GLM-5、Nemotron、DeepSeek)配智能路由,一个与OpenAI兼容的API,以及从我们的GPU到您的VPC的部署灵活性。我们专注于构建一个以Harness为核心的系统,使代理能够以成本敏感、长周期自主性运行在我们控制的推理基础设施上。
注册并登录后即可查看
$1500 - $2000 / month
我们正在寻找一位经验丰富的客户服务中心经理,负责领导和扩展一家美国家庭服务组织的远程客户支持运营。在这一务实的角色中,您将负责监督日常运营,管理客服员和调度员团队,并将小支持团队转型为支持全国连锁门店的高效集中中心。
工作时间:9am-5pm EST/PST。需重叠工作。汇报对象:CEO。全远程。我们正在招聘:客户成功经理(远程)。一家快速成长的软件公司正在寻找一位杰出的客户成功经理加入团队!
负责与客户、物流、制造和/或销售或服务代表对接,处理各种售前或售后服务功能。