别笑,你也坚持不到第二关
01
15
以下是gpt的建议 想成为“大模型高手”,数学上你需要的不只是“会算”,而是能把模型行为、训练动态、数值稳定性、泛化用一套可操作的数学语言讲清楚。下面给你一条完整路线:每一阶段学什么、为什么、怎么练、练到什么程度算过关。默认你已经有基本微积
2026-01-15 Austin
15
2026-01-15 Austin
14
14
to learn to learn
稍微写一下自己想学点什么好了算子优化通信优化调度优化计算与通信overlapc++/pythoncuda编程模型了解Tensor core、WGMMA、Shared Memory等底层细节并行算法设计与优化GEMM、注意力、MoE
2026-01-14 Austin
14
nona vllm源码解读 (未完成) nona vllm源码解读 (未完成)
题主代码只会一些基本语法和刷了几道算法题的程度,直接嗯看代码实在是困难,于是采用这种笨方法边学边记录每一块的功能 就先局部局部的看着吧,知道每一块干嘛的,之后我再另写一篇看能不能从全局上有什么收获 我觉得我应该听听ai提供的学习路线建议,v
2026-01-14 Austin
12
MeshFormer论文解读 MeshFormer论文解读
这是题主第一次写关于论文的博客,如果有误的地方请联系题主修改 MeshFormer 解读:用「显式 3D 偏置」重新思考稀疏视角 3D 重建 论文:MeshFormer: High-Quality Mesh Generation with
2026-01-12
07
Paged Attention Paged Attention
Paged Attention文章目的仅供自己回忆或记录用,因此不会写得太详细 WhatPaged Attention是一种vllm采用的技术,我的理解是提高内存利用率一种方法 Problemkv cache需要的内存不是恒定的,decod
2026-01-07
12
12
01
1 1
写博客的目的只是觉得有必要记录或者分享的东西就写下来,所有我写的东西都是给自己看的,如果有不懂的或者不对的地方可以留言可能等我以后厉害一点了也会把博客当字典用,不过现在文章数很少分类之类的功能就先空着吧
2025-12-01 Austin
2 / 2