[M芯片与AI计算] 02 Coding Agent 时代的 MacOS 装机配置与心流体验的获得,实用 CLI 工具,rg、yazi、fzf、uv
[数学基础与PyTorch] 03 回顾策略梯度,score function trick,蒙特卡洛采样,pytorch 优化与重要性采样
[Modern Agent] 16 Claude Code 记忆(Memory)系统设计,记忆语义分类,记忆召回,记忆写入、更新与维护
[LLM Architect] 15 Jev 架构推测,Tree Mask 隔离复用与并行计算,概率与confidence,RLCD/RLCR
[Agentic Infra] 03 算力密度与Roofline model,对比 5090/M5 max/DGX spark,Qwen3-8B 算力与访存
[Modern Agent] 18 何时如何保持思维链 CoT,interleaved thinking,kvcache 利用,Qwen3.6
[说说心里话] [2026-春] 人机协作的视角,AI 时代的学习指南与焦虑缓解
[A100 Training] 04 verl/slime Docker 容器 debug,断点调试,源码细读,ray 分布式 debug
[实用 AI] GPT/Gemini 全流程参与 idea 生成,实验设计,Paper writing | AI scientist | NotebookLM
[A100 Training] 01 熟悉一台A100 SXM GPU计算节点,必要基础配置,SXM/PCIe/HGX,CPU与GPU带宽及内存带宽测试
[数学基础与PyTorch] 06 理解高维Tensor,手撕 MHA 为什么先 reshape 再 permute?view/stride/contiguou
[数学基础与PyTorch] 07 MHA 的 QKVO 四重投影,为什么少不了 W_O?concat 再乘 ≡ 逐 head 求和 | OV 电路 rank
[LLM Architect] 13 Kimi K3 门控机制,门控注意力,Gated MLA,KDA的门控分支,MoE 中的SiTU-GLU,SwiGLU
[数学基础与PyTorch] 04 策略梯度score function trick 与 VAE 重参数化 trick
[Modern Agent] 13 Superpowers Skills,Vibe Coding 时代的软件开发圣经
[Agentic Infra] 02 RL post-training 训练框架,训练流程参数分析与指标监控,显存分配与性能调优
[LLM Architect] 08 Dive into K2.5,Kimi K2.5 论文串讲与导读,原生多模态,Agent Swarm,国产之光
[A100 Training] 02 verl/slime 框架及训练任务介绍,插拔式设计,Qwen3.5全家桶,InfiGUI,thinking mode
[LLM Architect] 11 探测解码分布一致性推导,MTP 拓扑结构,训练与self speculative decoding
[硬件扫盲] 苹果 M5 pro/max 芯片,对比 Nvidia GPU,内存带宽,统一内存,tensor core,融合架构