跳至主要内容

写作与记录

文章

博客以介绍为主,不求甚解:先认识一个概念、方法或工具,建立大致的理解。

博客目录 →

视觉 Token 压缩:ToMe、FastV、EViT 与 DiffRate

从重要性剪枝、相似度合并到可学习压缩率,理解视觉 token 压缩的位置、训练要求,以及 FLOPs 降低为何不等于推理同比加速。

#多模态#视觉Token#模型加速#ToMe#FastV#EViT#DiffRate