Registrati gratis
Funzionalità
Risorse
Prezzi
Podcasts
Registrati gratis
Accedi
llm learning road
di zc
Miglioramento personale
Feed RSS
Condividi
Episodi
Dettagli
chatgpt-pro-LLM进化史
chatgpt-pro-LLM进化史
minimax-LLM发展史与关键技术演进深度研究报告
minimax-LLM发展史与关键技术演进深度研究报告
doubao-大模型+LLM+发展脉络梳理
doubao-大模型+LLM+发展脉络梳理
qwen-大模型进化图谱:从技术跃迁、厂商博弈到开发者生存指南
qwen-大模型进化图谱:从技术跃迁、厂商博弈到开发者生存指南
DeepseekMath
00:00:00 Start 00:17:41 DeepSeekMathBase+7B+的数学能力评估 00:27:47 DeepSeekMath-RL+的训练与评估 00:40:24 探索抗噪声奖励信号的算法 00:46:35 DPO、PPO+和+GRPO+的目标及梯度 00:51:30 Closing
instructGPT
00:00:00 Start 00:18:49 InstructGPT:在不同方面的表现与改进 00:28:34 Closing
ReAct
00:00:00 Start 00:19:25 ReAct+Outperforms+Other+Methods+in+Tasks 00:28:34 ReAct+在+ICLR+2023+会议论文中发布 00:34:25 ICLR+2023+会议论文中的实验 00:43:45 ReAct+在+ALFWorld+中的刀具清洁问题 00:51:15 Closing
deepseek V3.2
deepseek V3.2 00:00:00 Opening 00:30:00 Main Discussion
deepseek-R1
DeepSeek R1 full discussion and segmented playback. OUTLINE 00:00:00 Opening 00:16:02 DeepSeek R1 - Segment 1 00:29:54 DeepSeek R1 - Segment 2 00:47:34 DeepSeek R1 - Segment 3 00:56:22 DeepSeek R1 - Segment 4 01:04:21 DeepSeek R1 - Segment 5 01:15:42 DeepSeek R1 - Segment 6 01:26:49 DeepSeek R1 - Segment 7 01:42:33 DeepSeek R1 - Segment 8 02:00:42 DeepSeek R1 - Segment 9 02:12:45 DeepSeek R1 - Segment 10 02:21:42 DeepSeek R1 - Segment 11 02:24:38 Ending
硅谷坐标 x 田渊栋: 解析大模型护城河、记忆存储瓶颈与Agent对社会冲击
田渊栋(Meta AI/FAIR,强化学习与大模型推理/长上下文方向)分享对大模型竞争格局、模型“记忆”机制、长上下文与存储瓶颈、推理路线,以及 Agent 时代社会冲击的判断与观察。 ### 内容要点 - 大模型护城河:数据/算法/infra/人才 - 两种记忆:上下文(工作记忆)与权重(世界观) - 长上下文与存储供应链瓶颈 - Agent 形态与社会影响