Model Releases
π© NVIDIA's whole speech stack just went local. ASR + TTS + codec, quantized to GGUF, running on-device via NeMo-Speech.cpp
π¦ββ¬ Magpie-TTS Multilingual π¦ Nemotron Speech Streaming EN 0.6B π¦ Nemotron-3.5 ASR Streaming π¦ Parakeet CTC 1.1B π¦ Parakeet TDT 0.6B v3 π₯¦ NanoCodec Merged PR https://huggingface.co/nvidia/magpie_tts_m
π¦ββ¬ Magpie-TTS Multilingual π¦ Nemotron Speech Streaming EN 0.6B π¦ Nemotron-3.5 ASR Streaming π¦ Parakeet CTC 1.1B π¦ Parakeet TDT 0.6B v3 π₯¦ NanoCodec Merged PR https://huggingface.co/nvidia/magpie_tts_multilingual_357m#run-magpietts-locally-with-nemo-speechcpp I run open source llm models via AI Desktop XP but how am I supposed to run these models on my phone? Any recc? submitted by /u/ImaginaryRea1ity [link] [comments]
Related
Source: r/LocalLLaMA | 2026-08-06