SciRisk-Bench: A Risk-Dimension-Aware Benchmark for AI4Science Safety
arXiv:2606.18936v2 Announce Type: replace Abstract: Large language models (LLMs) are increasingly embedded in AI for Science (AI4Science) workflows, from scientific question answering and literature a