跳到正文
原文
Hugging Face Blog·· 2024-03-25AI 評分41

Pollen-Vision:機械人零樣本視覺模型的統一介面

Pollen-Vision: Unified interface for Zero-Shot vision models in robotics

AI 導讀

Pollen Robotics 推出開源 pollen-vision 函式庫,整合零樣本視覺模型,支援以影像和文字輸入建立物件偵測及分割流程。首批模型包括 OWL-VIT、Mobile Sam 和 RAM,並結合深度資訊估算物件在 3D 空間中的 (x, y, z) 位置,為機械人抓取提供基礎。目前尚未支援完整 6D 姿態估計,OWL-VIT 的偵測結果亦可能不一致。

來源:Hugging Face Blog · huggingface.co