宇宙
生活
随笔
大模型
RAG
强化学习
Agent
LLM架构
论文
论文速递
机器学习
多模态
基础模型
理论基础
开源
大模型
强化学习
Agent
LLM架构
论文
机器学习
多模态
基础模型
知识库
分类
标签
归档
上网导航
1
2W8000字读懂GPT全家桶:从GPT-1到O1的技术演进与突破
2
强化学习详解第三部分:蒙特卡洛与时间差分学习,从经验中学习
3
万字解析非结构化文档中的隐藏价值:多模态检索增强生成(RAG)的前景
4
2W8000字深度剖析25种RAG变体
5
2w字解析量化技术,全网最全的大模型量化技术解析
登录
柏企
吹灭读书灯,一身都是月
累计撰写
63
篇文章
累计创建
16
个分类
累计收获
110
个点赞
导航
宇宙
生活
随笔
大模型
RAG
强化学习
Agent
LLM架构
论文
论文速递
机器学习
多模态
基础模型
理论基础
开源
大模型
强化学习
Agent
LLM架构
论文
机器学习
多模态
基础模型
知识库
分类
标签
归档
上网导航
目录
分类
论文
大模型论文精选||多智能体微调:通过多样推理链实现自我提升
多智能体微调是一种实现自我提升的补充方法,它将微调应用于语言模型的多智能体群体。一组均基于相同基础模型的语言模型,通过模型间的多智能体交互生成的数据,分别对各个模型进行更新,实现独立的专业化。通过在不同的数据集上训练每个模型,这种方法能够让各个模型实现专业化,并使整个模型集合更加多样化。 方法 多智
2025-04-10 20:45
1
0
1
26.1℃
基础模型
Agent
大模型论文精选|| 多 LLM 文本摘要:创新方法与卓越成果
多LLM文本摘要:创新方法与卓越成果 论文 https://arxiv.org/abs/2412.15487 Multi-LLM Text Summarization 2412.15487 多LLM摘要框架在每一轮对话中有两个至关重要的步骤:生成和评估。根据使用的是多LLM去中心化摘要还是中心化摘要
2025-04-10 20:39
1
0
0
24.1℃
LLM架构
基础模型
ViT功能可视化:探索视觉Transformer学到了什么?
ViT功能可视化:探索视觉Transformer学到了什么
2025-04-10 20:23
2
0
1
26.2℃
多模态
清华 ReST-MCTS*:基于过程奖励引导树搜索的 LLM 自训练深度剖析
2025-04-09 16:45
10
0
1
27.0℃
基础模型
3月AI论文精选十篇
1. Feature-Level Insights into Artificial Text Detection with Sparse Autoencoders 核心贡献:通过稀疏自编码器揭示AI生成文本的检测特征,提出基于特征分布的鉴别方法。研究发现,AI文本在稀疏编码空间中呈现独特的"高频低幅
2025-04-07 21:34
11
0
3
31.1℃
论文速递
03.31-04.06 论文速递 聚焦具身智能、复杂场景渲染、电影级对话生成等前沿领域
2025-04-06 12:21
11
0
3
31.1℃
论文速递
🌟 论文速递 | 2025.03.31-04.06 📢 聚焦具身智能、复杂场景渲染、电影级对话生成等前沿领域 1️⃣ 具身智能体:从脑启发到安全协作系统 论文标题: Advances and Challenges in Foundation Agents: From Brain-Inspired
大模型论文解读:VidTok:通过紧凑令牌化重新思考视频处理
论文: VidTok A Versatile and Open-Source Video Tokenizer 考虑观看一段繁忙街道的视频:建筑物、树木和道路在每一帧中几乎保持不变,而只有人和车辆在移动。传统的视频处理方法将每一帧作为独立的图像进行分析,这意味着它们最终会处理大量重复的信息,而没有利用
2025-04-05 22:38
16
0
9
43.6℃
多模态
万字解析非结构化文档中的隐藏价值:多模态检索增强生成(RAG)的前景
本文将深入探讨两种创新的多模态文档检索方法 ——ColPali 和 ColFlor。它们在多模态 RAG 技术领域表现卓越,正重塑着文档处理的格局。我们不仅会剖析其系统结构、性能优势,还将通过实际案例展示它们在处理文档时的出色表现 |文末点击阅读原文查看网页版| 更多专栏文章点击查看:
2025-03-31 18:59
46
2
2
38.6℃
LLM架构
多模态
大模型论文解读:自然语言系统生成文本质量评估新框架: G-Eval
|文末点击阅读原文查看网页版| 更多专栏文章点击查看: LLM 架构专栏
2025-03-31 18:58
31
0
3
33.1℃
大模型
论文
ReSearch框架:通过强化学习推理搜索的LLM框架
2025-03-29 21:30
22
0
1
28.2℃
基础模型
论文与代码 论文:https://arxiv.org/abs/2503.19470 代码:https://github.com/Agent-RL/ReSearch 摘要 将推理与外部搜索过程集成颇具挑战,尤其是针对复杂多跳问题。本文提出ReSearch框架,通过强化学习训练大语言模型(LLMs)进行
弹