ESOP 字段提取工作台
从招股书片段到可核查、可复核的字段结果
先看边界
Demo 夹具
只运行三个版本化合成夹具,不读取真实 PDF 内容,也不把结果自动写入浏览器存储。
准确率目标
≥95%
仍是 target,模型高置信占比只是 proxy。
六步处理状态
1
输入
选择来源
2
抽取
运行模式
3
结构化
校验 schema
4
证据
匹配引文
5
规则
发现异常
6
复核
留下记录
发现旧版浏览器存储
系统不会自动读取或删除旧数据。
加载到本会话
清除旧 key
ⓘ
浏览器存储当前不可用;仍可继续使用,本次模式偏好不会保存。
模型配置
✓ 本次会话已设置
▼
✦ 系统默认
Demo
自定义 API
Demo 只运行下方三个版本化夹具,不会访问外部服务。
自定义 API 只接受自由文本。调用前会显示目标 origin,并要求你明确确认数据外发。
API Key(兼容 OpenAI 格式)
保存
请输入 API Key 后再保存
Endpoint
Endpoint 格式不正确
模型名称
本次请求目标 origin
https://api.deepseek.com
我确认把本次自由文本和 Bearer Key 发送到上方 origin。Key、Endpoint、输入和结果不会写入 localStorage 或 sessionStorage。
仅允许 HTTPS;本机调试可使用 localhost、127.0.0.1 或 ::1。不会加载 config.local.js。CORS 预检需允许当前页面 origin、POST、Content-Type、Authorization。
文本输入
上传 PDF
Demo
Demo 场景
选择一个夹具后,文本会自动填入且只读。
招股书原文
0 字
请输入招股书原文后再开始提取
Demo 文本来自合成夹具,不能代表真实招股书准确率。切换到自定义 API 后才允许编辑和外发自由文本。
📎
拖拽 PDF 文件到此处
或点击选择文件(最大 50MB)
⚠ Demo 模式:返回模拟数据,不读取文件内容
📄
—
—
清除
请上传 PDF 文件后再开始处理
固定 Demo 边界:只展示真实文件名和大小,不读取 PDF 内容,不推断页数。
回到标准夹具
▶ 开始处理
金融术语同义词映射表
▼
系统级配置,供所有模块 Prompt 复用。提取时自动识别以下术语变体。
Prompt 结构预览
▼
System Prompt
User Prompt 模板
AI 正在分析招股书…
通常需要 10-30 秒,请耐心等待
⌁
结果会停留在这里
先选择一个 Demo 夹具查看证据和规则链,或切换到自定义 API,确认数据外发后再处理自己的文本。
处理未完成
—
—
字段结果
Demo · 标准样例
原始模型输出保留不动,有效值来自独立复核记录。
run
—
schema
—
完成于
—
⚑ 导出 Bad Cases (
0
)
⬇ 导出 JSON
字段覆盖
—
当前结果 · 非空字段
模型自报高置信占比
—
proxy,不是准确率
来源声明覆盖
—
有 source 声明
可定位证据覆盖
—
exact + partial
复核进度
—
accepted / corrected / unresolved
规则异常
—
跨字段,不等于模型错误
合成标注评估
offline-measured
样例级 exact match
—
字段值 exact match
—
可定位证据覆盖
—
—
待复核队列
低置信、证据非 exact、未解决或规则异常
规则异常
只提示矛盾,不替你改值
基本信息
●
激励计划
●
授予信息
●
复核字段
字段路径
原文来源(只读)
—
模型原始值
—
模型原始 confidence
—
复核状态
未解决
已修正
已接受
错误类型(可多选)
数值 / 内容错误
应有内容未提取
标注为「高置信」但实际有误
原文来源定位不对
原文表述有歧义
跨字段逻辑冲突
其他
请至少选择一个错误类型
正确值(可选)
根因分类
值或内容错误
字段缺失
过度自信
来源定位错误
原文歧义
逻辑冲突
其他
修复对象
Prompt
Schema
证据定位
校验规则
源数据
人工复核
回归结果
未运行
已通过
未通过
不适用
备注(可选)
取消
保存复核