宇宙
生活
随笔
大模型
RAG
强化学习
Agent
LLM架构
论文
论文速递
机器学习
多模态
基础模型
理论基础
欢迎订阅
开源
大模型
强化学习
Agent
LLM架构
论文
机器学习
多模态
基础模型
分类
标签
归档
上网导航
1
2W8000字读懂GPT全家桶:从GPT-1到O1的技术演进与突破
2
强化学习详解第三部分:蒙特卡洛与时间差分学习,从经验中学习
3
万字解析非结构化文档中的隐藏价值:多模态检索增强生成(RAG)的前景
4
2W8000字深度剖析25种RAG变体
5
深度解析创新RAG:PIKE-RAG与DeepRAG,RAG技术的创新变革
登录
柏企
吹灭读书灯,一身都是月
累计撰写
101
篇文章
累计创建
16
个分类
累计收获
168
个点赞
导航
宇宙
生活
随笔
大模型
RAG
强化学习
Agent
LLM架构
论文
论文速递
机器学习
多模态
基础模型
理论基础
欢迎订阅
开源
大模型
强化学习
Agent
LLM架构
论文
机器学习
多模态
基础模型
分类
标签
归档
上网导航
目录
大模型论文解读:自然语言系统生成文本质量评估新框架: G-Eval
|文末点击阅读原文查看网页版| 更多专栏文章点击查看: LLM 架构专栏
2025-03-31 18:58
33
0
3
33.3℃
论文
大模型
LLM架构从基础到精通之注意力机制
LLM架构从基础到精通之注意力机制 本文2w字,阅读时长~~ 看速度 2025年01月14日 晴 零下3度 1. LLM大模型架构专栏|| 从NLP基础谈起 2.LLM大模型架构专栏|| 自然语言处理(NLP)之建模 3. LLM大模型架构之词
2025-03-30 21:27
23
0
3
32.3℃
LLM架构
LLM架构从基础到精通之门控循环单元(GRUs)
LLM架构从基础到精通之门控循环单元(GRUs) 以下是已更新文章: 1. LLM大模型架构专栏|| 从NLP基础谈起 2.LLM大模型架构专栏|| 自然语言处理(NLP)之建模 3. LLM大模型架构之词嵌入(Part1)
2025-03-30 21:13
17
0
0
25.7℃
LLM架构
LLM架构从基础到精通之LSTM
以下是已更新文章: 1. LLM大模型架构专栏|| 从NLP基础谈起 2.LLM大模型架构专栏|| 自然语言处理(NLP)之建模 3. LLM大模型架构之词嵌入(Part1)
2025-03-30 21:09
20
0
1
28.0℃
LLM架构
LLM架构从基础到精通之循环神经网络(RNN)
LLM架构从基础到精通之循环神经网络(RNN) 以下是已更新文章: 1. LLM大模型架构专栏|| 从NLP基础谈起 2.LLM大模型架构专栏|| 自然语言处理(NLP)之建模 3. LLM大模型架构之词嵌入(Part1)
2025-03-30 17:50
16
0
2
29.6℃
LLM架构
强化学习详解第三部分:蒙特卡洛与时间差分学习,从经验中学习
在探索强化学习的征程中,我们已经钻研了基础概念,还审视了那些假定对环境有全面认知的基于价值的方法。然而在现实世界里,智能体几乎无法获取关于其所处环境的完美模型。 |文末点击阅读原文查看网页版| 更多专栏文章点击查看:
2025-03-30 15:17
59
0
5
39.9℃
强化学习
Agent
LLM架构从基础到精 深入探究编码器 - 解码器架构:从 RNN 到 Transformer 的自然语言处理模型及实际应用
2025-03-29 22:37
20
0
2
30.0℃
LLM架构
深入探究编码器 - 解码器架构:从RNN到Transformer的自然语言处理模型 本文1w字,阅读时长~~ 看速度 2025年01月10日 晴 零下3度 1. LLM大模型架构专栏|| 从NLP基础谈起 2.LLM大模型架构专栏|| 自然语言处理(
LLM架构从基础到精通之 Word2Vec 训练全解析
2025-03-29 22:17
18
0
1
27.8℃
LLM架构
以下是已更新文章: 1. LLM大模型架构专栏|| 从NLP基础谈起 2.LLM大模型架构专栏|| 自然语言处理(NLP)之建模 3. LLM大模型架构之词嵌入(Part1)
LLM架构从基础到精通之词向量3
2025-03-29 22:02
16
0
0
25.6℃
LLM架构
LLM大模型架构之词嵌入(Part3) 以下是已更新文章: 1. LLM大模型架构专栏|| 从NLP基础谈起 2.LLM大模型架构专栏|| 自然语言处理(NLP)之建模 3. LLM大模型架构之词嵌入(Part1)
ReSearch框架:通过强化学习推理搜索的LLM框架
2025-03-29 21:30
26
0
1
28.6℃
基础模型
论文与代码 论文:https://arxiv.org/abs/2503.19470 代码:https://github.com/Agent-RL/ReSearch 摘要 将推理与外部搜索过程集成颇具挑战,尤其是针对复杂多跳问题。本文提出ReSearch框架,通过强化学习训练大语言模型(LLMs)进行
上一页
下一页
1
…
5
6
7
8
9
10
11
弹