#ViT
共 8 条 · 7 天 0 条 · 30 天 4 条
信息流里打上「ViT」标签的资讯、产品与论文,按刊登时间排,新的在上。
9月29日
9月28日
9月24日
NS-Attn:用 Newton-Schulz 变换注意力输出提升 ViT 准确率
把 Muon 里那套 Newton-Schulz 迭代搬到注意力输出上,不加参数,ViT 和 Swin 在 CIFAR 上 12 组对比全涨,代价是推理变慢一点。
7月21日
论文12:08
Patch Policy:通过密集视觉表示实现高效机器人控制机器人控制不用再扛百亿参数VLM了,用ViT密集补丁特征直接训练,速度更快、参数量少99.3%,性能还涨18%。想轻量高效做具身策略的可以看这篇。
7月2日
论文12:16
ER-JEPA:面向心电图多变量时间序列的轻量级自监督学习框架想用少量标注数据做心电图分析?这篇论文提出的ER-JEPA用18万条无标注ECG预训练,在ST-MEM基准上跑出SOTA,计算量还比同类方法小。
6月18日
论文11:13
Transformer Geometry Observatory TGO-I: 视觉Transformer的光谱几何研究这篇论文用TGO框架搞清楚了ViT的维度在训练中怎么变化——不是集中而是越来越分散,尤其CLS token最明显,对理解视觉Transformer内部机制很有参考价值。
5月26日
OrpQuant:无乘法器的PoT量化新方法,15分钟校准LLaMA-2-7B
OrpQuant解决了低比特量化中特征流形退化的问题,做边缘部署的开发者可以直接用这个15分钟校准的方案替代传统MAC密集型方法,硬件效率显著提升。