论文信息爬取与批量导入
输入单篇论文标题,或粘贴标题列表和上传CSV,自动补齐论文信息
数据来源与规则说明
以下规则对所有单篇爬取与批量导入任务生效通过 Graph API 按标题检索,返回标题、作者、摘要、会议与年份等字段。
当主接口字段缺失或限流时,使用 Crossref REST 补齐 DOI 与出版信息。
交叉核对会议与年份,生成可访问的官方原文链接,剔除失效地址。
区间外的论文会被自动过滤,并在结果说明中标注原因。
仅收录三大顶会主会论文,workshop 与 arXiv 预印本不计入统计。
从英文摘要中通过 TF-IDF 抽取关键词,去停用词后最多保留 10 个。
单篇论文爬取
按标题精确检索,自动补齐作者、摘要、关键词、会议与年份
等待:请输入论文标题后点击“开始爬取”。
输入论文标题后点击“开始爬取”,系统将查询 Semantic Scholar,并用 Crossref 与 DBLP 核对元数据。
已耗时 0.8s,命中缓存将直接返回历史结果。
建议核对:标题是否完整、是否为 CVPR / ICCV / ECCV 主会论文、发表年份是否在 2022 至 2025 之间。也可改用批量导入上传标题列表。
系统已自动重试 1 次仍未成功。已获取的结果会保留在缓存中,重新查询时不会重复请求。
本文提出 Segment Anything(SA)项目:面向图像分割的新任务、新模型与新数据集。借助高效模型构建数据采集闭环,构建了迄今规模最大的分割数据集,包含 1100 万张授权图像上的超过 10 亿个掩码。模型支持可提示分割,可通过点、框、掩码或文本提示生成分割结果,并具备零样本迁移能力。
主接口未返回摘要,Crossref 补齐也失败,已标记为待人工补充,关键词暂由标题提取。
批量导入
粘贴标题列表或上传 CSV / TXT 文件,逐条查询并写入论文列表
模板仅需一列 title,可附带 venue、year 作为辅助校验字段。
-
自动去重:与本地论文列表比对标题,重复项跳过写入并更新原记录 -
单篇失败不影响其他论文,失败项可单独重试 -
接口限流时自动重试(指数退避,最多 3 次)
任务明细
“数据来源”列为该条最终取数的接口 · 失败项可单独重试| 序号 | 论文标题 | 查询状态 | 数据来源 | 结果说明 | 操作 |
|---|
粘贴标题列表或上传文件后点击“开始批量导入”,任务明细会实时显示每一条的处理结果。
学术接口可能限流,系统会缓存已获取结果并自动重试。
爬取结果仅用于课程学习和趋势分析。
关键词为系统提取结果,不一定等同于作者关键词。