模型与服务商
选择并配置模型服务商
比较原生适配器、兼容端点、区域配置与验证等级。
支持矩阵
Runifold 把各服务商适配器统一到规范化模型接口。0.9 中运行时位于 runifold,
具体适配器位于 runifold-providers;Cargo 只启用后者在线上真正需要的 Feature。
| 服务商路径 | Feature | 适用场景 |
|---|---|---|
| OpenAI | openai | OpenAI Responses 兼容模型 |
| Anthropic | anthropic | Claude 原生语义 |
| Gemini | gemini | Google Gemini 原生接口 |
| Bedrock | bedrock | AWS 托管的模型访问 |
| OpenAI 兼容 | openai | 具名兼容模块与区域端点 |
完整矩阵和验证状态以当前版本仓库 README 为准。
原生还是兼容接口
需要服务商特有的推理、工具、用量或流语义时优先原生适配器;更重视可替换性且端点 已经验证时,可以使用兼容协议。
“OpenAI 兼容”只描述网络格式,不代表行为完全一致。能力、错误分类、用量记账和流式 行为仍可能不同。
配置方式
从应用配置创建 Client,再构建弹性 Runtime 与 Agent。凭证只能放在进程的 Secret 存储中。
use runifold::ProviderModelExt;
use runifold_providers::openai::OpenAiClient;
let runtime = OpenAiClient::from_api_key(
std::env::var("OPENAI_API_KEY")?
)?.runtime("gpt-5")?;兼容或区域端点的 Base URL 应通过白名单校验,不能直接接受终端用户提供的任意地址。
能力契约
工具、严格结构化输出、推理、视觉与流式等能力会显式协商,结果可能是支持、不支持或 未知。
影响正确性的要求应失败关闭;只有产品可以安全解释并度量时才允许明确降级。
验证等级
必须区分四种声明:
- 适配器可以编译;
- 确定性契约测试通过;
- 针对真实服务的在线冒烟通过;
- 准确模型与能力组合已在线上观察验证。
固定版本,记录已测试模型标识,并在依赖新能力前重新运行在线验证。