Optimizing Korean-Centric LLMs via Token Pruning
DGX agentarXiv:2604.16235v1 Announce Type: new Abstract: This paper presents a systematic benchmark of state-of-the-art multilingual large language models (LLMs) adapted via token pruning - a compression techn