PIKA: Expert-Level Synthetic Datasets for Post-Training Alignment from Scratch
DGX agentarXiv:2510.06670v2 Announce Type: replace Abstract: High-quality instruction data is critical for LLM alignment, yet existing open-source datasets often lack efficiency, requiring hundreds of thousand