04:00
2026-08-18
arxiv.org
artificial-intelligence
HarmProfile: Characterizing Harmful Distributions in Frontier LLMs
Researchers introduced HarmProfile, a benchmark dataset containing over 80,000 validated harmful artifacts from 23 frontier large language models across 13 model families, organized into 15 harm categβ¦