大数跨境
0
0

不要再用arxiv链接了!为了让论文引用更规范,上交毕业生、南加州大学华人博士创建了一个小工具

不要再用arxiv链接了!为了让论文引用更规范,上交毕业生、南加州大学华人博士创建了一个小工具 极市平台
2021-01-29
3
导读:上交毕业生、南加州大学博士生林禹臣开发了一个简单的 Python 工具—Rebiber​只需两步,将文献的 arXiv 信息转换为正式来源信息。
↑ 点击蓝字 关注极市平台

作者丨魔王
来源丨机器之心
编辑丨极市平台

极市导读

 

最近,上交毕业生、南加州大学博士生林禹臣开发了一个简单的 Python 工具——Rebiber只需两步,将文献的 arXiv 信息转换为正式来源信息。 >>加入极市CV技术交流群,走在计算机视觉的最前沿

伴随着预印本平台 arXiv 的广泛使用,越来越多的研究者喜欢在写论文参考文献时直接使用 arXiv 信息。这看似非常方便,但也存在问题:这篇 arXiv 论文是否在 ACL、EMNLP、NAACL、ICLR 或 AAAI 等学术会议上发表过?

没错,在某些情况下,只引用 arXiv 信息显得不那么准确,这种不准确的文献条目甚至可能会违反某些会议的论文提交或 camera-ready 版本提交规则。

如何解决这一问题呢?最近,上交毕业生、南加州大学博士生林禹臣开发了一个简单的 Python 工具——Rebiber,它能够基于 ACL Anthology 和 DBLP 数据库自动解决这一问题。

项目地址:https://github.com/yuchenlin/rebiber

下图展示了 Rebiber 的使用示例:

在该示例中,文章的原始信息来自 Google Scholar,仅包括标题、作者、期刊(arXiv)、年份。而事实上该论文已被 EMNLP 2020 接收,原始信息显然不够准确。

经过 Rebiber 转换后,原始 arXiv 信息被转换为来自正式来源的准确信息,包括标题、作者、年月、出版商、数字对象识别码(doi)、网址等详细内容。

Rebiber 支持的会议包括 ACL Anthology 涵盖的会议,如 ACL、EMNLP、NAACL 及其 workshop,以及 DBLP 涵盖的会议,如 ICLR 2020。

目前,Rebiber 支持的会议列表如下所示:

使用者还可以手动添加 DBLP 包含的任意会议:只需从 DBLP 中下载会议 bib 文件至 data 文件夹,然后将其转换为 json 格式,再把路径添加至 bib_list.txt 即可。

如何使用?

这款工具的使用也很简单。

首先,运行以下命令行:

  
git clone https://github.com/yuchenlin/rebiber.gitpip install bibtexparser tqdmcd rebiber

然后,将文献条目归一化为正式格式:

  
python normalize.py -i example_input.bib -o example_output.bib -l bib_list.txt

只需要简单的操作,就可以将 arXiv 信息转换为正式信息了。

项目作者简介

项目作者林禹臣本科毕业于上海交通大学 IEEE 试点班,曾获上海市优秀本科生奖学金、上海交通大学优异学士学位论文奖,现在南加州大学攻读计算机科学博士学位,导师为南加州大学计算机科学学院助理教授、情报与知识发现(INK)研究实验室主任任翔。

他曾在微软亚洲研究院和谷歌 AI 有多段实习经历,研究兴趣包括构建能够深度理解世界的神经符号系统、集成信息提取、知识图谱、机器推理、图神经网络和模型鲁棒性的技术。近期研究集中在利用常识推理推动自然语言处理(理解与生成)。多篇论文发表在 ICLR、AAAI、EMNLP、KDD、ACL 等学术会议上。

参考链接:https://yuchenlin.xyz/


推荐阅读



添加极市小助手微信(ID : cvmart2),备注:姓名-学校/公司-研究方向-城市(如:小极-北大-目标检测-深圳),即可申请加入极市目标检测/图像分割/工业检测/人脸/医学影像/3D/SLAM/自动驾驶/超分辨率/姿态估计/ReID/GAN/图像增强/OCR/视频理解等技术交流群:月大咖直播分享、真实项目需求对接、求职内推、算法竞赛、干货资讯汇总、与 10000+来自港科大、北大、清华、中科院、CMU、腾讯、百度等名校名企视觉开发者互动交流~

△长按添加极市小助手

△长按关注极市平台,获取最新CV干货

觉得有用麻烦给个在看啦~  
【声明】内容源于网络
0
0
极市平台
为计算机视觉开发者提供全流程算法开发训练平台,以及大咖技术分享、社区交流、竞赛实践等丰富的内容与服务。
内容 8155
粉丝 0
极市平台 为计算机视觉开发者提供全流程算法开发训练平台,以及大咖技术分享、社区交流、竞赛实践等丰富的内容与服务。
总阅读16.8k
粉丝0
内容8.2k