Liquid AI 模型與工程博客·· 5 小時前AI 評分45
LFM2-VL:高效視覺語言模型
LFM2-VL: Efficient Vision-Language Models
AI 導讀
LFM2-VL 推出 LFM2-VL-450M 和 LFM2-VL-1.6B 兩款開放權重視覺語言模型,支援文字及可變解像度圖像輸入。在 GPU 上的推理速度最高達現有 VLM 的 2 倍,並原生處理最高 512×512 解像度的圖像;更大的圖像會切分為 512×512 區塊。兩款模型現已於 Hugging Face 提供,採用基於 Apache 2.0 的開放授權。
來源:Liquid AI 模型與工程博客 · liquid.ai