产品介绍
Inferable 是什么?
Inferable 是用于在代码中构建可靠 AI 工作流和智能体的托管式持久执行运行时。开发者在自己的代码库定义带版本的工作流,并让它们在自有计算环境中运行,包括私有网络。控制平面保存执行状态、协调任务,并通过出站长轮询连接运行环境,因此无需开放入站端口。
平台提供带验证的结构化 LLM 输出、智能体工具调用、结果记忆、通知、时间线可观测性、重试、长时间运行,以及通过邮件或 Slack 完成的人工审批。工作流可以在等待人员或智能体时暂停,之后带完整上下文恢复。仓库包含开源控制平面、管理应用、CLI 和多语言 SDK。
如何使用 Inferable
- 创建 cluster,并安装应用语言对应的 SDK。
- 在代码中定义工作流名称、输入 schema、执行标识符和版本。
- 添加结构化模型调用、智能体步骤、工具、副作用和输出 schema。
- 为敏感操作加入人工批准或干预点。
- 在应用自有计算环境中启动工作流 listener。
- 使用唯一幂等标识触发执行,并通过时间线检查进度或错误。
- 修改 schema 或逻辑时创建新版本,让旧执行继续使用原版本完成。
核心功能
- 工作流即代码: 在应用仓库中定义多步骤 AI 编排。
- 持久执行: 在长时间等待、网络故障和进程中断后保留工作流状态。
- 人在回路: 通过邮件或 Slack 等待批准或输入,并保留上下文。
- 结构化输出: 解析、验证模型回复,并重试失败执行。
- 工作流版本: 在逻辑变更时维持进行中执行的兼容性。
- 自有基础设施执行: 通过出站连接,在防火墙或私有网络后运行函数。
- 智能体与工具: 支持调用已注册应用函数的迭代推理引擎。
- 可观测性与记忆: 提供执行时间线,并缓存昂贵或有副作用的结果。
使用场景
- 需要审批的自动化: 删除数据、发送决定或执行高影响操作前要求人工批准。
- 长时间 AI 流程: 等待外部事件,并在不丢失状态的情况下恢复。
- 结构化文档处理: 从内容提取经过验证的字段,并重试无效模型输出。
- 内部智能体: 让智能体在私有应用环境中使用受控工具。
- 版本安全的生产流程: 上线新逻辑,同时让旧执行可预测地完成。
- 分布式编排: 跨环境协调任务,无需暴露内部入站端点。
价格
Free 方案标价为 0 美元,包含 2 个已注册工作流、1,000 次工作流执行、自带模型和最大并发 2。Pay as you go 标价为每月 10 美元,包含 20 个工作流、5,000 次执行,超出部分每 1,000 次 1 美元,并发 10,以及更高限制和优先邮件支持。Enterprise 提供定制云部署、数据隔离、专属 Slack 支持和定制服务等级。使用自带模型时,模型提供商费用可能另行计算。
常见问题
工作流代码在哪里执行?
代码在用户自己的基础设施运行,控制平面负责协调执行和保存状态。
工作流可以等待人工审批吗?
可以。Inferable 可暂停,通过邮件或 Slack 通知审核人员,并在保留上下文的情况下恢复。
Inferable 是开源的吗?
是。仓库以 MIT 许可提供控制平面、管理应用、CLI 和多种 SDK。


