Research code and resources for universal and transferable adversarial attacks against aligned language models, including methods to evaluate attack effectiveness.↗·llm-attacks·Apr 7, 2026·research·Python·adversarial-attack·alignment·llm-attacks·python