Skip to main content
Fastino 提供兼容 OpenAI 的端点,让你可以通过受支持的 OpenAI SDK 方法运行 GLiNER 模型。将 base_url 设置为 https://api.fastino.ai/v1,使用 Fastino API 密钥进行认证,并将 GET /v1/models 返回的 GLiNER 模型 ID 或 GLiNER 训练任务 ID 作为 model。在 Python SDK 中通过 extra_body 传入抽取或分类 schema,或直接在 JSON 请求体中传入。
通过更改 base_url、API 密钥和模型 ID,并添加 Fastino schema,即可复用现有 OpenAI 客户端运行 GLiNER。

支持的 SDK 功能

GLiNER 推理返回一个结构化结果,不支持 stream=True。Fastino 并未实现所有 OpenAI API 或 SDK 资源;请仅使用上表列出的方法。

配置 OpenAI SDK

将 SDK 指向 Fastino 的基础 URL,并提供你的 Fastino API 密钥:

Chat completions

POST /v1/chat/completions 接受 OpenAI Chat Completions 的核心字段。将受支持的 GLiNER 模型 ID 作为 model,并通过 extra_body 传入抽取或分类 schema。

Responses

对于 GLiNER,Responses API 要求将 schema 放在 text.format.schema。

列出可用模型

使用 GET /v1/models 获取可用于这些端点的模型列表。

流式传输

GLiNER 推理不支持流式传输。请勿设置 stream=True;API 会在处理输入后返回完整的结构化结果。

传入 Fastino 特有的字段

对于 Chat Completions,请通过 extra_body={"schema": ...} 传入 schema。对于 Responses,请通过 extra_body={"text": {"format": {"schema": ...}}} 传入。原始 HTTP 请求使用相同的端点特定结构。

相关内容