AI程序员
文章平均质量分 94
柏企
统计学硕士,从事大模型研发。人工智能相关发明专利3个。博客回复不及时,可添加微信:CBQtunan 个人公众号: AIGC 深一度 欢迎关注
展开
专栏收录文章
- 默认排序
- 最新发布
- 最早发布
- 最多阅读
- 最少阅读
-
LLM架构从基础到精通之词向量2
查找第一个单词 “the” 在 10,000 长的词汇表中的索引,假设其索引为 8676,那么 “the” 就可以用一个长度为 10,000 的向量表示,其中除了第 8676 个位置为 1 外,其他位置均为 0。在自然语言处理中,共现矩阵的一个主要应用是生成词嵌入。例如,“cat” 和 “tiger” 被表示为完全不同的向量,没有体现出它们的相似性,这对于基于类比的向量操作等任务来说是个很大的问题。词汇表中的每个单词都被表示为一个独特的向量,除了对应单词索引位置的元素为 1 外,其他所有元素都设置为 0。原创 2025-01-07 20:55:28 · 824 阅读 · 0 评论 -
LLM架构从基础到精通之 Word2Vec 训练全解析
在计算过程中,当我们将一个 1×10,000 的 one - hot 向量与一个 10,000×300 的矩阵相乘时,实际上就会选择出对应于‘1’位置的矩阵行,这一行就是输入单词的“词向量”。尽管它的网络只有两层,比较浅,但非常宽,因此它的每个训练过程都提供了独特的降低计算量的方法。从输入输出来看,网络的输入是表示输入单词的 one - hot 向量,标签也是表示目标单词的 one - hot 向量,但网络的输出是目标单词的概率分布,并非像标签那样一定是 one - hot 向量。原创 2025-01-07 22:20:11 · 614 阅读 · 0 评论 -
使用 Docling、Groq、Ollama 和 GLIDER 评估构建高级 RAG 管道
Docling 能够快速、轻松地将流行的文档格式(如 PDF、DOCX、PPTX、XLSX、图像、HTML、AsciiDoc 和 Markdown)转换为 HTML、Markdown 和 JSON(包含嵌入和引用的图像)格式。:是专门用于管理和查询向量嵌入的开源向量数据库。通过对大量数据的学习和训练,它能够对不同的回答进行多维度的评估,判断其相关性、准确性、完整性等。方法,传入上下文、问题和回答,按照预定义的标准(如相关性、准确性、完整性、连贯性和引用等)进行评估,并输出详细的推理、关键亮点和分数。原创 2025-01-05 19:01:23 · 994 阅读 · 0 评论 -
利用 vLLM 手撸一个多模态RAG系统
由 vLLM 服务引擎驱动,使用名为 LLaVA(llava - hf/llava - 1.5 - 7b - hf)的视觉语言模型来处理文本/表格摘要以及多模态任务,如图像摘要和从集成的文本和视觉输入生成答案。通过结合这些工具,我们将展示如何构建一个强大的多模态 RAG 系统,该系统能够处理不同类型的文档,生成高质量的摘要,并生成利用文本和视觉信息的全面答案。为了配置多向量检索器,我们将原始文档(包括文本、表格和图像)存储在文档存储中,同时在向量存储中索引它们的摘要,以提高语义检索效率。原创 2025-01-06 11:00:17 · 2549 阅读 · 0 评论 -
大模型论文解读|| 舞蹈AI革新 ,清华大学推出Lodge,长序列舞蹈生成的新高度,CVPR
舞蹈AI革新!清华大学推出Lodge,长序列舞蹈生成的新高度,CVPR 2024原创 2024-03-22 13:59:39 · 2568 阅读 · 0 评论
分享