跳到正文
原文
HF blog·· 2026-07-26AI 评分20

VisCo:用大语言模型作为内在编码器实现视觉 token 压缩

Paper page - VisCo: Leveraging Large Language Models as Intrinsic Encoders for Visual Token Compression

AI 导读

VisCo 提出用大语言模型作为内在编码器来压缩视觉 token。该论文页面已在 Hugging Face 上线,具体方法与实验结果尚未在页面内容中给出。

来源:HF blog · huggingface.co