宇宙
生活
随笔
大模型
RAG
强化学习
Agent
LLM架构
论文
理论基础
大模型
强化学习
Agent
LLM架构
论文
机器学习
多模态
基础模型
知识库
分类
标签
归档
上网导航
1
2W8000字读懂GPT全家桶:从GPT-1到O1的技术演进与突破
2
万字解析非结构化文档中的隐藏价值:多模态检索增强生成(RAG)的前景
3
2W8000字深度剖析25种RAG变体
4
强化学习详解第三部分:蒙特卡洛与时间差分学习,从经验中学习
5
2w字解析量化技术,全网最全的大模型量化技术解析
登录
柏企
吹灭读书灯,一身都是月
累计撰写
33
篇文章
累计创建
16
个分类
累计创建
38
个标签
导航
宇宙
生活
随笔
大模型
RAG
强化学习
Agent
LLM架构
论文
理论基础
大模型
强化学习
Agent
LLM架构
论文
机器学习
多模态
基础模型
知识库
分类
标签
归档
上网导航
目录
分类
多模态
大模型论文解读:VidTok:通过紧凑令牌化重新思考视频处理
2025-04-05 22:38
11
0
0
25.1℃
多模态
论文: VidTok A Versatile and Open-Source Video Tokenizer 考虑观看一段繁忙街道的视频:建筑物、树木和道路在每一帧中几乎保持不变,而只有人和车辆在移动。传统的视频处理方法将每一帧作为独立的图像进行分析,这意味着它们最终会处理大量重复的信息,而没有利用
万字解析非结构化文档中的隐藏价值:多模态检索增强生成(RAG)的前景
2025-03-31 18:59
46
2
2
38.6℃
多模态
LLM架构
本文将深入探讨两种创新的多模态文档检索方法 ——ColPali 和 ColFlor。它们在多模态 RAG 技术领域表现卓越,正重塑着文档处理的格局。我们不仅会剖析其系统结构、性能优势,还将通过实际案例展示它们在处理文档时的出色表现 |文末点击阅读原文查看网页版| 更多专栏文章点击查看:
弹