跳到主要内容

文献知识挖掘命令:lkm

bohr lkm 用于检索文献知识图谱,获取命题、变量、推理路径和论文图谱。

命令​

命令用法说明
claimbohr lkm claim [command]按全局论断 ID 查询论断的推理依据
graphbohr lkm graph [flags]获取已入库论文的图谱(节点与边)
parsebohr lkm parse [command]上传本地 PDF,提取研究问题、结论与推理步骤
reasoningbohr lkm reasoning [flags]检索已入库的科学推理链
searchbohr lkm search <query> [flags]以混合语义与关键词方式检索已入库的论文、论断和科学概念
variablesbohr lkm variables [command]查询科学变量及其关系

命令组内的子命令请运行 bohr lkm <组> --help 查看。

常用参数​

参数说明
--top-k <number>最大返回数量,默认 10
--offset <number>结果偏移量,默认 0
--mode <hybrid\|semantic\|lexical>检索模式,默认 hybrid
--sort <comprehensive\|relevance\|recent\|journal>排序方式
--keywords <a,b>按关键词筛选
--scopes <a,b>限制检索的知识范围

示例​

bohr lkm search "催化反应机理" --mode semantic --top-k 20
bohr lkm reasoning --query "光合作用能量传递" --top-k 5
bohr lkm variables batch gcn_abc gcn_def
bohr lkm graph --paper-id 812481689673531392

从本地 PDF 抽取知识​

lkm parse 上传本地 PDF 并提取研究问题、结论与推理步骤,用于论文尚未进入 LKM 语料库的场景;其余 LKM 子命令只能查询已入库论文。它不同于提取文档版面、正文、表格和公式的 bohr pdf parse。

知识抽取是异步流程:

命令说明计费
bohr lkm parse submit <file.pdf>上传 PDF 并返回 task_id;添加 --wait 可等待任务进入终态免费
bohr lkm parse status <task-id>查询任务当前状态和已完成阶段免费
bohr lkm parse wait <task-id>等待任务进入 succeeded、partial 或 failed免费
bohr lkm parse result <task-id>获取本地抽取图谱;添加 --format graph 可返回论文图谱结构仅首次成功获取 Result 时扣费
bohr lkm parse submit paper.pdf
bohr lkm parse wait <task-id>
bohr lkm parse result <task-id>
bohr lkm parse result <task-id> --format graph -o json

LKM Parse Result 计费规则​

  • submit、status 和 wait 不扣费。
  • 同一 task_id 的 Result 首次返回 status=succeeded 时扣费:未命中缓存为 1 元(或 100 光子),cache_hit=true 时为 0.1 元(或 10 光子)。
  • queued 或 running 状态会返回 LKM_PARSE_RESULT_NOT_READY(上游错误码 290017),不扣费;partial、failed、任务不存在及其他错误响应也不扣费。
  • 重复获取同一成功 Result 不会重复扣费,平台使用 task_id 作为幂等键。

完整的 OpenAPI 返回情况与示例见 LKM Parse Result 计费规则。

LKM 语料库查询包含每月免费额度,额度用尽后按次计费;LKM Parse Result 按上方单独规则计费。Claim、Variable 和 Paper ID 应从前一步 LKM 结果中获取。