首页/Inferable
Inferable 持久 AI 工作流运行时仓库图标

Inferable

Inferable 是开源托管式持久运行时,用于以代码定义 AI 工作流和智能体,提供结构化输出、版本、重试、可观测性、自带模型,以及通过邮件或 Slack 完成人工审批。

访问网站
带人工审批步骤的 Inferable 持久 AI 工作流时间线

产品介绍

Inferable 是什么?

Inferable 是用于在代码中构建可靠 AI 工作流和智能体的托管式持久执行运行时。开发者在自己的代码库定义带版本的工作流,并让它们在自有计算环境中运行,包括私有网络。控制平面保存执行状态、协调任务,并通过出站长轮询连接运行环境,因此无需开放入站端口。

平台提供带验证的结构化 LLM 输出、智能体工具调用、结果记忆、通知、时间线可观测性、重试、长时间运行,以及通过邮件或 Slack 完成的人工审批。工作流可以在等待人员或智能体时暂停,之后带完整上下文恢复。仓库包含开源控制平面、管理应用、CLI 和多语言 SDK。

如何使用 Inferable

  1. 创建 cluster,并安装应用语言对应的 SDK。
  2. 在代码中定义工作流名称、输入 schema、执行标识符和版本。
  3. 添加结构化模型调用、智能体步骤、工具、副作用和输出 schema。
  4. 为敏感操作加入人工批准或干预点。
  5. 在应用自有计算环境中启动工作流 listener。
  6. 使用唯一幂等标识触发执行,并通过时间线检查进度或错误。
  7. 修改 schema 或逻辑时创建新版本,让旧执行继续使用原版本完成。

核心功能

  • 工作流即代码: 在应用仓库中定义多步骤 AI 编排。
  • 持久执行: 在长时间等待、网络故障和进程中断后保留工作流状态。
  • 人在回路: 通过邮件或 Slack 等待批准或输入,并保留上下文。
  • 结构化输出: 解析、验证模型回复,并重试失败执行。
  • 工作流版本: 在逻辑变更时维持进行中执行的兼容性。
  • 自有基础设施执行: 通过出站连接,在防火墙或私有网络后运行函数。
  • 智能体与工具: 支持调用已注册应用函数的迭代推理引擎。
  • 可观测性与记忆: 提供执行时间线,并缓存昂贵或有副作用的结果。

使用场景

  • 需要审批的自动化: 删除数据、发送决定或执行高影响操作前要求人工批准。
  • 长时间 AI 流程: 等待外部事件,并在不丢失状态的情况下恢复。
  • 结构化文档处理: 从内容提取经过验证的字段,并重试无效模型输出。
  • 内部智能体: 让智能体在私有应用环境中使用受控工具。
  • 版本安全的生产流程: 上线新逻辑,同时让旧执行可预测地完成。
  • 分布式编排: 跨环境协调任务,无需暴露内部入站端点。

价格

Free 方案标价为 0 美元,包含 2 个已注册工作流、1,000 次工作流执行、自带模型和最大并发 2。Pay as you go 标价为每月 10 美元,包含 20 个工作流、5,000 次执行,超出部分每 1,000 次 1 美元,并发 10,以及更高限制和优先邮件支持。Enterprise 提供定制云部署、数据隔离、专属 Slack 支持和定制服务等级。使用自带模型时,模型提供商费用可能另行计算。

常见问题

工作流代码在哪里执行?

代码在用户自己的基础设施运行,控制平面负责协调执行和保存状态。

工作流可以等待人工审批吗?

可以。Inferable 可暂停,通过邮件或 Slack 通知审核人员,并在保留上下文的情况下恢复。

Inferable 是开源的吗?

是。仓库以 MIT 许可提供控制平面、管理应用、CLI 和多种 SDK。

返回产品导航

相关产品

OpenAI Codex 是面向软件开发的 AI 编程产品,适合委派边界清晰的仓库任务并审阅其代码变更。

Claude Code 是 Anthropic 的 AI 编程产品,适合通过支持的开发界面在代码库中持续迭代。

Gemini CLI 是 Google 的开源 AI 终端产品,适合本地开发与命令行工作流。

邮件订阅

持续发现实用 AI 产品

定期接收精选产品、真实使用场景和开发者动态。