今天研读《Nougat: Neural Optical Understanding for Academic Documents》 开源实现:Nougat 1. 为什么要引入 Nougat ? PDF 是互联网上仅次于 HTML 的第二大主流文档
在研读 MinerU 工作的时候,发现其版面分析模型基座是 LayoutLMv3 ,对其很感兴趣,遂来研读一二。 论文标题:《LayoutLMv3: Pre-training for Document AIwith Unified Text and Image Masking》 开源实现:Layou
MinerU 是非常著名且广泛使用的 PDF 文档提取开源项目。 今天研读《MinerU: An Open-Source Solution for Precise Document Content Extraction》 开源实现:MinerU 1. 为什么要引入 MinerU ? 随着 LLM 与
今天研读:《ColPali: Efficient Document Retrieval with Vision Language Models》 开源实现:ColPali 1. 为什么要引入 ColPali ? 文档检索将用户的查询与给定语料库中的相关文档进行匹配,它在许多工业应用中扮演非常重要的角
对数据源的预处理是 RAG 系统在工程落地时所必须考量的一项基础设施。 今天研读 《Docling Technical Report》 开源模型:Docling 文档与示例:Github
今天研读《Corrective Retrieval-Augmented Generation (CRAG)》 开源实现:CRAG 有关标准 RAG 的内容,可以参考我的分享贴:《RAG 学习专题 Day 1 —— RAG 是怎样诞生的 ?》 有关 Self-RAG 的内容,可以参考我的分享贴:《
在研读 GraphRAG 的时候发现了 Leiden 社群检测算法,对其原理很好奇,遂来学习研读一二。 论文标题:《From Louvain to Leiden: guaranteeing well-connected communities》 原文补充信息可以点击上述链接打开 Nature 官网查
今天研读 《Self-RAG: Learning to Retrieve, Generate, and Critique through Self-Reflection》 开源实现:Self-RAG 1. 为什么要引入 Self-RAG ?以前的研究有什么不足?
今天来研读《HippoRAG: Neurobiologically Inspired Long-Term Memory for Large Language Models》 开源实现:HippoRAG 1. 为什么要引入 HippoRAG ? 过往的研究有什么
今天我们来研读香港大学 HKUDS 实验室的研究:《LightRAG: Simple and Fast Retrieval-Augmented Generation》 开源实现:LightRAG LightRAG 可以视作 GraphRAG 的一种改进方案。有关 GraphRAG 的内容,参见我的