语义论文检索
使用语义匹配在约 1.48 亿篇学术论文中检索,因此即使措辞不同,也能找到相关工作。
Cito 是一个快速的学术文献程序化搜索服务。它检索约 1.48 亿篇本地论文的语料库,并将语义检索与关键词检索合并为一个排序结果集,因此用户既可以按含义也可以按精确术语找到论文。
该产品面向那些需要通过 API 而不是浏览器搜索框来可靠发现论文的用户。由于语料库是自托管的,Cito 在查询时不会继承上游速率限制,并且结果来自其自身索引,因此行为可复现。
使用语义匹配在约 1.48 亿篇学术论文中检索,因此即使措辞不同,也能找到相关工作。
在标题和摘要上通过 BM25 搜索,匹配精确术语、行话、作者和缩写,帮助定位准确的论文引用。
通过互惠排名融合将语义和关键词排名结合起来,更重视在两个系统中都表现良好的论文。
当工作流只需要一种模式时,可以只使用语义检索器或关键词检索器;文档中公开了 mode=semantic 和 mode=keyword。
对同一查询和语料快照获得可复现的排序,查询时不调用第三方 API。
接收结构化的论文元数据以及可用时的开放获取 PDF 直链,而不是完整文本托管层。
按概念而不是精确措辞查找奠基论文或某个主题领域,这在你只知道工作背后想法时很有用。
搜索包含特定方法、缩写、模型名称或作者术语的论文,并希望精确词项匹配与相关语义结果一起出现。
使用 API 在应用中构建研究或发现功能,并依赖固定语料快照获得可复现的排序。
利用提供的元数据和开放获取 PDF 链接(如存在)从搜索结果进入源论文,完成筛选与阅读流程。
使用许可条款和归属指南,在产品、数据集或论文中重新发布搜索结果,而不必猜测数据权利。
Cito 是一项面向学术文献的程序化搜索服务。它结合了语义检索和关键词检索,覆盖约 1.48 亿篇本地论文,并将结果融合为一个排序列表。
文档说明,Cito 使用 SPECTER2 进行语义检索,并在标题和摘要上使用 BM25 进行关键词检索。你也可以使用 mode=semantic 或 mode=keyword 只运行其中一种模式。
Cito 返回的结果包含标题、作者、期刊/会议、发表日期、DOI、引用次数以及摘要等元数据(如有)。当存在开放获取副本时,还会提供指向源站的直接 PDF 链接。
可以。许可页面说明,Cito 基于开放许可的学术数据构建,只要保留 API 响应中要求的归属字符串:“Data from Semantic Scholar”,你就可以在商业产品、研究和出版物中使用这些结果。
Cito 不会代理或重新托管全文。PDF 链接指向原始出版商或仓库,下载的 PDF 的任何使用都受其来源条款约束。
GetESP 是一款用于分析 CSV 邮件列表的网页应用,可识别收件人 ESP 和支持的垃圾邮件防护工具,帮助发件人按服务商分组并选择匹配的提供商,以提升送达率。
Predictice 是面向法律专业人士的法律研究与分析平台,整合判例检索、诉讼分析、助手与文档审查流程,依托海量法律文档库提升检索与工作效率。
北极九章是一款企业级AI数据洞察引擎,支持用自然语言进行数据分析。业务人员可通过输入或语音提问,在企业工作流中快速获取图表化结果。
clickworker为企业提供人工生成与人工验证数据服务,包括问卷、门店检查、标签标注、名单构建、众包测试和AI训练数据,支持平台化项目与定制方案。
Rayyan 是一款用于系统综述和文献综述的 AI 平台,帮助研究人员和审查团队在共享工作流中完成筛选、数据提取、偏倚风险评估和报告。
Finlo 是一款网页端股票组合平台,提供精选的策略型组合、每月更新和高级研究工具,适合通过自己的券商账户跟随或复制股票思路的长期投资者。