Training-Free Enhancement:通过噪声初始化和采样轨迹优化增强预训练扩散模型

338
0
2025-02-11 16:05:58
2
投币
5
分享
香港科技大学(广州)博士生周子凯主讲
青年AI研究员idea加油站,AI开发者的新能源充电桩!|直播:周二晚8点/周六上午10点|公众号:青稞AI|进群:ai_qingke113
青稞Talk
(84/133)
12.6万播放
简介
【青稞Talk 92期】RLinf:面向具身智能的“渲训推一体化”开源强化训练框架
01:00:57
【青稞Talk 91期】KTransformers,在大模型微调与推理中的系统化实践
55:02
【青稞Talk 90期】ShotBench: 面向增强MLLM摄影语言理解能力的训练与评估体系
01:12:52
【青稞Talk 89期】Generative RLHF-V: 面向多模态 RLHF 的人类意图对齐框架
01:09:42
【青稞Talk 88期】UniLat3D:几何–外观统一VAE的单阶段 3D 生成框架
49:31
【青稞Talk 87期】RL 训练框架:QeRL,量化技术增强强化学习 Reasoning 探索
57:46
【青稞Talk 86期】从 DeepSeek-OCR 到 Glyph:深入理解图像-文本压缩技术
45:27
【青稞Talk 85期】OpenMoE 2: Sparse Diffusion Language Models
01:06:03
【青稞Talk 84期】SimpleVLA-RL:简单可拓展的VLA强化学习训练
01:01:11
【青稞Talk 83期】统一 SFT & RL:迈向大型语言模型后训练的统一视角
01:37:03
【青稞Talk 82期】OpenCUA:用于构建 Computer-Use Agent 的开源框架
52:09
【青稞Talk 80期】RL for LRMs:探讨面向推理模型的 RL 最新研究
01:09:10
【青稞Talk 65期】Hi3DGen:法线为桥,为高清三维几何生成另辟蹊径
56:45
【青稞Talk 66期】SIMoE:稀疏插值混合专家,大模型升级再造的自动化专家发现框架
01:20:48
【青稞Talk 61期】GUI-Reflection:让多模态 GUI 智能体获得担忧错误能力的训练框架
01:00:39
【青稞Talk 63期】ChatRex / RexSeek / Rex-Thinker:结合多模态大语言模型的目标检测模型构建
01:03:07
【青稞Talk 64期】MindCube:空间智能的实现路径,激发VLM构建创造性空间心理模型的能力
01:00:15
【青稞Talk 62期】ProRL : 延长强化学习训练框架,拓展大语言模型的推理边界
01:13:05
【青稞Talk 59期】大模型推理强化学习中的熵机制
01:00:30
【青稞Talk 58期】Virtual Community 虚拟社区:面向人、机器人与社会的开放世界模拟平台
58:25
【青稞Talk 57期】Fast-dLLM:无需重训的扩散大语言模型推理加速
48:50
【青稞Talk 60期】Satori-SWE:用进化测试时间缩放让小语言模型解决复杂软件工程
49:39
【青稞Talk 54期】BAGEL:统一生成理解的多模态基础模型
01:11:49
【青稞Talk 55期】生成模型中的极简概念
33:35
【青稞Talk 53期】Chain-of-Model (模型链):引入因果建模,全新的大模型 Scaling 结构
01:12:18
【青稞Talk 56期】InternVL3,GPT-4o开源平替:探索多模态通用采集大模型的技术演进与应用探索
01:24:14
【青稞Talk 50期】MoLE & SpeCache:大语言模型端侧部署的架构与算法
50:38
【青稞Talk 52期】Sparse VideoGen:无需重新训练的视频扩散 Transformer 推理加速框架
53:17
【青稞Talk 51期】EraseAnything:在 Flux 等先进文生图架构的概念擦除方法
32:16
【青稞Talk 48期】从 TTS 到 TTRL:无标签数据强化学习探索与展望
01:06:02
【青稞Talk 47期】Free4D:无需微调的 4D 场景生成新框架
53:39
【青稞Talk 46期】从 TinyZero 到 APR:语言模型推理能力的探索与自适应并行化
01:13:44
【青稞Talk 78期】从 LLM-RL 到 Agentic RL:如何让语言模型成为自主智能体
01:10:35
【青稞Talk 44期】InferCept、Preble&Cognify:面向下一代 AI Agent 工作流系统的构建
57:18
【青稞Talk 45期】B-STaR & SimpleRL-Zoo:通过强化学习自我提升推理性能和效率
01:11:59
【青稞Talk 43期】VideoGrain:基于扩散模型的多粒度视频编辑的探索与应用
01:00:55
【青稞Talk 42期】COAT:显存高效的 FP8 训练,实现高效深度学习
47:01
【青稞Talk 41期】PC-Agent:面向复杂 PL 任务的多模态智能体框架
01:02:21
【青稞Talk 33期】XGrammar:高效实现 LLM灵活且可移植的结构化生成
01:01:33
【青稞Talk 31期】Rectified Flow:矫正流生成式模型的概念及应用实践
01:26:00
【青稞Talk 38期】Satori:通过训练LLM做自回归搜索来增强推理能力
01:09:00
【青稞Talk 29期】VILA^2 :视觉语言模型能力的自我提升
01:11:06
【青稞Talk 14期】Mobile-Agent:基于多模态Agent架构的手机智能体
54:21
【青稞Talk 13期】LLaMA Factory:从预训练到RLHF,大模型高效训练框架
01:16:21
【青稞Talk 28期】DuQuant: 基于正交变换实现大型语言模型的 SOTA级 4 bit 量化
01:01:44
【青稞Talk 27期】GenAD & Vista:构建通用可泛化的自动驾驶世界模型
01:02:06
【青稞Talk 23期】CogVideoX 视频生成开源模型上手实践
01:01:00
【青稞Talk 22期】mPLUG-Owl3:探索长序列模型架构的通用多模态大模型
01:04:49
【青稞Talk 19期】AWQ:激活值感知的LLM低位权重量化
49:46
【青稞Talk 20期】S-LoRA:实现多 LoRA 大模型的高效并行化推理
01:00:14
【青稞Talk 16期】YOLO-World:基于视觉语言模型的实时开放词汇物体检测
58:30
【青稞Talk 17期】SEED-Story:生成长篇图文故事的多模态大型语言模型
57:30
【青稞Talk 18期】InternVL 2.0:通过渐进式策略扩展开源多模态大模型的性能边界
01:15:21
【青稞Talk 12期】VillagerAgent:减少幻觉、提高任务分解效率的多智能协作体框架
01:03:09
【青稞Talk 11期】LLaMA Pro:扩展Transformer块优化的大型语言模型继续预训练
50:01
【青稞Talk 10期】PiSSA:收敛快、误差小的大模型参数高效微调方法
01:20:41
【青稞Talk 09期】具身多模态大模型的视觉表征预训练研究
01:00:01
【青稞Talk 07期】MixEval:混合评测数据集来拟合大语言模型的人类评估
58:59
【青稞Talk 08期】VideoBooth:文本和图像提示共同驱动的视频生成
38:06
【青稞Talk 05期】3D-VLA:构建生成式三维具身世界模型
59:44
【青稞Talk 03期】从 3D LLM 到 MultiPLY ,3D 具身基础模型的构建
54:42
【青稞Talk 04期】Mini-Gemini: 挖掘多模态视觉语言大模型的潜力
53:28
【青稞Talk 02期】ChatDev——大语言模型驱动的多智能体协作与演化
49:23
【青稞Talk 01期】SceneTex:高质量三维室内场景纹理图生成
57:27
【青稞Talk 06期】实时渲染 3DGS 中的反走样及逆渲染应用
01:06:03
【青稞Talk 78期】从 LLM-RL 到 Agentic RL:如何让语言模型成为自主智能体
01:10:35
【青稞Talk 79期】UserRL & UserBench “知人者智”:以用户为中心的智能体交互与训练
01:04:19
【青稞Talk 81期】MemGen:生成式隐式记忆,Agent Memory 的第三种可能
59:31
【青稞Talk77期】Theory of Agent: From Definition, to Behavior and Objective
01:21:03
【青稞Talk 76期】NeMo RL:让大规模 MoE 模型权重 Refit 加速 10 倍
01:06:55
【青稞Talk 75期】FlashRL:探讨现代 RL 框架中推理与训练的错位问题及解决方案
55:52
【青稞Talk 74期】ROLL:面向 Agentic 场景的生产级大规模强化学习训练框架
01:17:48
【青稞Talk 73期】从BLIP3o到BLIP3o-NEXT:迈向统一生成与理解的多模态大模型
01:04:22
【青稞Talk 71期】RLPR:基于参考概率奖励的强化学习,推广 RLVR 到通用领域推理问题
01:14:10
【青稞Talk 72期】ETCH: 通过等变紧度向量将人体拟合推广到穿衣人体的方法
01:06:47
【青稞Talk 70期】Evaluation Agent:面向视觉生成模型的高效可提示的评估框架
58:28
【青稞Talk 69期】GSPO:大规模强化学习训练算法,迈向持续拓展的语言模型强化学习
01:15:25
【青稞Talk 67期】大模型训练流水线并行四部曲:吞吐、内存、负载均衡与线性扩展
01:37:28
【青稞Talk 68期】slime:专为 RL Scaling 设计的大规模 RL 训练框架及实践
01:42:37
【青稞Talk 49期】verl 源码解读 与 HybridFlow 编程范式讲解
01:24:11
【青稞Talk 40期】基于 LightLLM 的 DeepSeek R1/V3 模型部署实战
55:43
【青稞Talk 39期】PRIME: 结合隐式过程奖励的强化学习
56:21
【青稞Talk 25期】LLMC:大语言模型的量化基准
01:10:39
【青稞Talk 35期】Training-Free Enhancement:通过噪声初始化和采样轨迹优化增强预训练扩散模型
51:39
【青稞Talk 37期】Motion Dreamer:面向自动驾驶与物理世界对齐的视频生成模型
42:15
【青稞Talk 32期】LLMC:大语言模型压缩工具的开发实践
01:51:01
【青稞Talk 24期】使用 CAMEL Agents 构建 GraphRAG 及应用实践
49:57
【青稞Talk 36期】Follow Family:可控视频生成方法探索与应用
35:29
【青稞Talk 34期】K-Sort Arena:视觉生成模型的高效人类偏好竞技场
54:23
【青稞Talk101期】MiniMax M2.1:Agent 后训练经验与认知
01:01:44
【青稞Talk 96期】Fast-dLLM v2:高效训练推理的块扩散大语言模型框架
48:08
【青稞Talk 97期】从 BF16 到 FP16:如何解决RL训练-推理不匹配问题
01:16:05
【青稞Talk 98期】SANA-Series:探索图像视频扩散模型的高效设计与加速
56:20
【青稞Talk 99期】 TRPO重生:大模型时代的信任域策略优化
01:02:29
【青稞Talk 102期】从 TRPO 到 SAPO:大模型 RL 算法演进
56:29
【青稞 Talk 103期】Decoupled DMD & DMDR: 在扩散模型步数蒸馏的实践及 Z-Image-Turbo 应用
44:22
【青稞Talk 104期】The Prism Hypothesis 视觉统一表征假说:从语义到像素的统一自编码(UAE)
33:46
【青稞Talk 105】InternVLA-A1,虚实贯通:理解、生成、执行一体化的具身操作大模型
01:20:52
【青稞Talk 106期】GDPO:解决 GRPO 在多奖励 RL 训练中的"优势崩溃"问题
40:46
【青稞Talk 95期】从 π_0 到 π_RL:面向流匹配 VLA 的强化学习后训练框架
01:07:04
【青稞Talk 94期】RLinf-VLA 实践:从零上手 VLA(OpenVLA )强化学习
01:08:11
【青稞Talk 93期】通过量化与稀疏性实现高效注意力机制
02:00:47
【青稞Talk 107期】JustRL: 用"最笨"的 RL 方法刷新 1.5B 推理模型新基线
01:05:22
【青稞 Talk108 期】BOAD:引入多臂老虎机,自动化搜索层级结构的多 Agent 架构设计
59:12
【青稞Talk 15】MiniCPM-V:端侧可用的 GPT-4V 级多模态大模型
01:00:51
【青稞 Talk109 期】线性轨迹:揭示 LLM 强化学习中的高效捷径
01:00:21
【青稞 Talk110 期】Dr. Kernel:突破大模型 GPU Kernel 生成的多轮 RL 训练瓶颈
01:09:08
【青稞Talk 111期】RLinf-USER:面向现实世界机器人在线策略学习的统一且可扩展系统
51:10
【青稞Talk 112期】EditReward : 当 AI 学会“审美”,可控多模态生成的下一代范式
46:33
【青稞Talk 114期】从 VGGT 到 PAGE-4D:动态世界中的 3D 感知统一框架
48:07
【青稞Talk 113期】面向对象的 Agent Infra 新范式:有状态运行时管理的设计与工程实践
01:01:54
【青稞Talk 115期】从 Depth Scaling 到 Width Scaling!WideSeek-R1:通过多智能体 RL 探索大模型的广度扩展
01:09:29
【青稞Talk 116期】RISE: 组合式世界模型,在“想象”中实现机器人策略的自主进化
01:11:16
【青稞Talk 117期】OpenClaw-RL: 结合 GRPO + OPD,在使用中自适应变强的龙虾
01:04:46
【青稞Talk 118期】Puffin: 统一多模态空间智能大模型——从任意视角理解和生成世界
01:05:42
【青稞Talk 119期】FIPO & Future-KL:突破大语言模型在复杂推理中的性能瓶颈
42:45
【青稞Talk 120期】VLANeXt:12条设计准则,从入门到精通的 VLA 终极“配方”
01:01:48
【青稞 Talk121 期】大规模真实世界仿真重塑端到端自动驾驶学习范式
52:51
【青稞Talk 122期】从 TTRL 到 URLVR:大模型的无监督强化学习还能走多远?
01:08:02
【青稞Talk 123期】DeepSeek V4 模型在 SGLang 中的系统级优化与全栈适配
01:00:16
【青稞Talk 124期】大模型强化学习的Scaling Law
01:02:41
【青稞Talk 125期】重探 On-Policy Distillation(OPD):三类典型失败以及修复路径
01:20:30
【青稞Talk 126期】STream3R & 4RC: 面向几何与运动理解的流式前馈 3D/4D 重建
01:31:20
【青稞Talk 127期】δ-mem:从长上下文到在线记忆,动态演化原生记忆的一次尝试
35:29
【青稞Talk 128期】从 ARPO,到 AEPO,再到 Agent-World:探索通用智能体训练的可行路径
01:10:07
【青稞Talk 130期】ZEDA:将 Post-Trained MoE 迁移为高效动态 MoE
01:03:31
【青稞Talk 131期】UniRL:面向统一多模态模型的分布式 RL 后训练框架
01:02:25
【青稞Talk 132期】从 MLA 到 GQLA:无需从头训练,硬件自适应高效注意力机制
01:14:03
【青稞Talk 133期】VeRL-Omni:基于 VeRL 及 vLLM-Omni 构建的面向多模态生成模型的高效RL后训练框架
01:11:26
【青稞Talk 128期】MinT: 面向百万级 LoRA 策略的训练与推理基础设施
54:29
【青稞Talk】DPA & LLaVA-HUD v4:多模态大模型的深度预对齐与高效视觉编码优化
01:07:34
【青稞Talk 135期】如何设计一个好的自回归 VLA:从问题构建到工程落地的探索之旅
01:07:45
【青稞Talk 136期】PithTrain:Agent 时代的 MoE 训练框架设计
01:13:36
客服
顶部
赛事库 课堂 2021拜年纪