文章
全部文章列表。
-
SparTA: Deep-Learning Model Sparsity via Tensor-with-Sparsity-Attribute
发布于:3,013 字约 12 分钟sparTA,带稀疏优化的 DNN 编译器,把 tensor 的稀疏性作为一种重要属性考虑到编译过程中,生成高效的代码。
-
Scalable Diffusion Models with Transformers
发布于:2,252 字约 8 分钟Diffusion Transformer.
-
初探AI Infra
发布于:7,263 字约 26 分钟趁最近找实习的机会学习、总结一下之前零散接触过的模型推理/训练加速的知识,还有一些 CUDA 编程的体系架构之类的内容。
-
Conv2Former: A Simple Transformer-Style ConvNet for Visual Recognition
发布于:1,621 字约 6 分钟使用大 kernel DS 卷积替代 self-attention。字节新加坡的工作。
-
SpikeCV: Open a Continuous Computer Vision Era
发布于:1,624 字约 6 分钟事件相机开源框架。
-
Neuromorphic computing at scale
发布于:7,586 字约 26 分钟发在 Nature 上的一篇 review,讨论了 SNN/神经模态计算社区现在面临的一些问题、挑战,和一些可能的发展方向。
-
Titans: Learning to Memorize at Test Time
发布于:5,255 字约 19 分钟从 TTT 改进而来的新架构,尝试通过 TTT 的方式改进模型的记忆能力。
-
Segment Anything
发布于:6,766 字约 24 分钟Meta 的 SAM。
-
SDiT: Spiking Diffusion Model with Transformer
发布于:1,956 字约 7 分钟脉冲 Diffusion Transformer,里面的 Transformer 的结构是 RWKV 的。
-
2024
发布于:1,472 字约 6 分钟2024.