文献知识挖掘命令:lkm
bohr lkm 用于检索文献知识图谱,获取命题、变量、推理路径和论文图谱。
命令
| 命令 | 用法 | 说明 |
|---|---|---|
claim | bohr lkm claim [command] | 按全局论断 ID 查询论断的推理依据 |
graph | bohr lkm graph [flags] | 获取已入库论文的图谱(节点与边) |
parse | bohr lkm parse [command] | 上传本地 PDF,提取研究问题、结论与推理步骤 |
reasoning | bohr lkm reasoning [flags] | 检索已入库的科学推理链 |
search | bohr lkm search <query> [flags] | 以混合语义与关键词方式检索已入库的论文、论断和科学概念 |
variables | bohr lkm variables [command] | 查询科学变量及其关系 |
命令组内的子命令请运行 bohr lkm <组> --help 查看。
常用参数
| 参数 | 说明 |
|---|---|
--top-k <number> | 最大返回数量,默认 10 |
--offset <number> | 结果偏移量,默认 0 |
--mode <hybrid\|semantic\|lexical> | 检索模式,默认 hybrid |
--sort <comprehensive\|relevance\|recent\|journal> | 排序方式 |
--keywords <a,b> | 按关键词筛选 |
--scopes <a,b> | 限制检索的知识范围 |
示例
bohr lkm search "催化反应机理" --mode semantic --top-k 20
bohr lkm reasoning --query "光合作用能量传递" --top-k 5
bohr lkm variables batch gcn_abc gcn_def
bohr lkm graph --paper-id 812481689673531392
从本地 PDF 抽取知识
lkm parse 上传本地 PDF 并提取研究问题、结论与推理步骤,用于论文尚未进入 LKM 语料库的场景;其余 LKM 子命令只能查询已入库论文。它不同于提取文档版面、正文、表格和公式的 bohr pdf parse。
知识抽取是异步流程:
| 命令 | 说明 | 计费 |
|---|---|---|
bohr lkm parse submit <file.pdf> | 上传 PDF 并返回 task_id;添加 --wait 可等待任务进入终态 | 免费 |
bohr lkm parse status <task-id> | 查询任务当前状态和已完成阶段 | 免费 |
bohr lkm parse wait <task-id> | 等待任务进入 succeeded、partial 或 failed | 免费 |
bohr lkm parse result <task-id> | 获取本地抽取图谱;添加 --format graph 可返回论文图谱结构 | 仅首次成功获取 Result 时扣费 |
bohr lkm parse submit paper.pdf
bohr lkm parse wait <task-id>
bohr lkm parse result <task-id>
bohr lkm parse result <task-id> --format graph -o json
LKM Parse Result 计费规则
submit、status和wait不扣费。- 同一
task_id的 Result 首次返回status=succeeded时扣费:未命中缓存为 1 元(或 100 光子),cache_hit=true时为 0.1 元(或 10 光子)。 - queued 或 running 状态会返回
LKM_PARSE_RESULT_NOT_READY(上游错误码290017),不扣费;partial、failed、任务不存在及其他错误响应也不扣费。 - 重复获取同一成功 Result 不会重复扣费,平台使用
task_id作为幂等键。
完整的 OpenAPI 返回情况与示例见 LKM Parse Result 计费规则。
LKM 语料库查询包含每月免费额度,额度用尽后按次计费;LKM Parse Result 按上方单独规则计费。Claim、Variable 和 Paper ID 应从前一步 LKM 结果中获取。