HF blog·· 2026-07-26AI 评分20
VisCo:用大语言模型作为内在编码器实现视觉 token 压缩
Paper page - VisCo: Leveraging Large Language Models as Intrinsic Encoders for Visual Token Compression
AI 导读
VisCo 提出用大语言模型作为内在编码器来压缩视觉 token。该论文页面已在 Hugging Face 上线,具体方法与实验结果尚未在页面内容中给出。
来源:HF blog · huggingface.co