AI 结构化提取
按照 JSON Schema 从邮件、订单、日志等文本中提取结构化对象,供后续步骤按字段继续处理。
使用前,请先在 Quicker 的 设置 → AI 中配置文本任务场景,并选择明确支持结构化输出的模型。配置方式见统一 AI 服务与模型设置。
当前模块定义
sys:aiExtract输入 7 · 输出 12 · 枚举 2
输入参数
- 文本
textText必填要提取信息的原始文本,例如订单、邮件或日志。
- JSON Schema
jsonSchemaText必填定义输出对象的字段和类型;根类型必须为 object。
- 提取要求
instructionsText可选补充字段含义或取值规则,例如“金额不包含货币符号”。
- AI 任务场景
useCaseIdText可选选择用于结构化提取的文本任务场景;所选模型必须明确支持结构化输出。
日常文本处理与翻译默认text.general - 任务场景缺失时
missingUseCaseBehaviorEnum可选自定义任务场景不存在时,使用内置文本任务场景或直接失败。
使用基础场景默认UseBaseUseCase执行失败Fail - 最大输出 Token
maxOutputTokensInteger可选 - 失败后停止
stopIfFailBoolean可选失败后是否停止动作
输出参数
- 是否成功
isSuccessBoolean操作是否成功
- 结果对象
resultObjectObject - 结果 JSON
resultJsonText - 实际模型
modelText - 输入 Token
inputTokensInteger - 缓存输入 Token
cachedInputTokensInteger服务商报告的缓存命中输入 Token;未提供时为 0。
- 输出 Token
outputTokensInteger - 总 Token
totalTokensInteger - 结束原因
finishReasonText - 调用标识
invocationIdText - 实际任务场景
resolvedUseCaseIdText - 是否回退场景
useCaseFallbackUsedBoolean
基本用法
- 将原始内容传给“文本”。
- 在“JSON Schema”中定义需要的字段、类型和必填项。
- 在“提取要求”中补充字段含义、单位或格式规则。
- 使用“结果对象”继续读取字段,或使用“结果 JSON”保存、传输完整结果。
下面的 Schema 可从订单文本中提取订单号、金额和商品列表:
{
"type": "object",
"properties": {
"orderId": { "type": "string" },
"amount": { "type": "number" },
"items": {
"type": "array",
"items": { "type": "string" }
}
},
"required": ["orderId", "amount", "items"],
"additionalProperties": false
}
Schema 与结果限制
- JSON Schema 必须是合法 JSON,根节点必须为对象。建议明确填写
required和additionalProperties,减少字段缺失或意外扩展。 - 所选模型必须明确支持结构化输出。Schema 过于复杂或包含服务商不支持的关键字时,请根据该服务商的结构化输出限制简化定义。
- “结果对象”只会在模型返回符合要求的 JSON 对象后产生;无效 Schema、非对象结果或服务错误都会使步骤失败。
- AI 提取并不等同于确定性解析。金额、账号、日期等关键字段在用于付款、写库或删除操作前应再次校验。
- 原始文本、Schema 和提取要求会发送给实际选中的 AI 服务商。