Local Ai
Cool mlx-vlm segmentation demo by @Prince_Canuma at @aiDotEngineer You can do so much with it
Prince Canuma (GitHub: Blaizzy) demonstrated image segmentation capabilities using mlx-vlm at the AI Engineer event, showcasing the library's versatility beyond standard vision-language tasks. mlx-...
Prince Canuma (GitHub: Blaizzy) demonstrated image segmentation capabilities using mlx-vlm at the AI Engineer event, showcasing the library's versatility beyond standard vision-language tasks. mlx-vlm is an open-source Python package he created for running inference and fine-tuning of Vision Language Models (VLMs) locally on Apple Silicon Macs using Apple's MLX framework. The demo highlighted how mlx-vlm can be applied to a broad range of multimodal use cases — including segmentation, image analysis, video captioning, and more — entirely on-device without cloud dependencies.
Related
- Q-Zoom: Query-Aware Adaptive Perception for Efficient Multimodal Large Language Models
- HQF-Net: A Hybrid Quantum-Classical Multi-Scale Fusion Network for Remote Sensing Image Segmentation
- SAT: Selective Aggregation Transformer for Image Super-Resolution
- Clinical Cognition Alignment for Gastrointestinal Diagnosis with Multimodal LLMs
Source: local-ai