Model Releases

🟩 NVIDIA's whole speech stack just went local. ASR + TTS + codec, quantized to GGUF, running on-device via NeMo-Speech.cpp

πŸ¦β€β¬› Magpie-TTS Multilingual 🦜 Nemotron Speech Streaming EN 0.6B 🦜 Nemotron-3.5 ASR Streaming 🦜 Parakeet CTC 1.1B 🦜 Parakeet TDT 0.6B v3 πŸ₯¦ NanoCodec Merged PR https://huggingface.co/nvidia/magpie_tts_m

DGX agentreddit
model-releasesr-localllama

πŸ¦β€β¬› Magpie-TTS Multilingual 🦜 Nemotron Speech Streaming EN 0.6B 🦜 Nemotron-3.5 ASR Streaming 🦜 Parakeet CTC 1.1B 🦜 Parakeet TDT 0.6B v3 πŸ₯¦ NanoCodec Merged PR https://huggingface.co/nvidia/magpie_tts_multilingual_357m#run-magpietts-locally-with-nemo-speechcpp I run open source llm models via AI Desktop XP but how am I supposed to run these models on my phone? Any recc? submitted by /u/ImaginaryRea1ity [link] [comments]

Related

Source: r/LocalLLaMA | 2026-08-06

Loading related sources…