Back to feed
arXiv cs.AI·

SciRisk-Bench: A Risk-Dimension-Aware Benchmark for AI4Science Safety

Signal
72
Hype
18
In three linesSciRisk-Bench is a safety evaluation benchmark for LLMs in AI4Science workflows. It covers 7 disciplines, 31 sub-disciplines, and 10 risk dimensions. The authors evaluate mainstream and science-oriented LLMs to diagnose safety gaps across risk categories.
Read source
Your take?
BenchmarksAI safetyEvals

Summary generated by Claude — human-verified