SciRisk-Bench: A Risk-Dimension-Aware Benchmark for AI4Science Safety
arXiv:2606.18936v1 Announce Type: new Abstract: Large language models (LLMs) are increasingly embedded in AI for Science (AI4Science) workflows, from scientific question answering and literature analy