{"as_of":"2026-08-07T15:37:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:05a1254473ae225d3eb8181ba316551ed49e652c870df321233724ce72a7e08c","coverage":[{"denominator":47,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":47,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-04T19:55:56.611443Z","state":"measured"},{"denominator":47,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":47,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2509.08997/citation-record","integrity":"/paper/2509.08997/integrity","json":"/paper/2509.08997/citation-record.json","paper":"/paper/2509.08997"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T19:55:56.435129Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.08997","last_updated":"2025-09-10T20:47:56Z","snapshot_observed_at":"2026-08-07T01:29:27.719882Z","submitted_at":"2025-09-10T20:47:56Z","title":"YouthSafe: A Youth-Centric Safety Benchmark and Safeguard Model for Large Language Models","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-04T19:55:56.435129Z"},"links":{"citing_paper":"/paper/2509.08997"},"observation_digest":"sha256:e81e19a98fbfddfb665325447377008c3b088c0a265d70f2b1585c76b6d7377c","observation_id":"0f9608bf-c76b-4077-b59d-2bae611432c6","resolution":{"observed_at":"2026-08-04T19:55:56.435129Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T19:55:56.439641Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2509.08997","last_updated":"2025-09-10T20:47:56Z","snapshot_observed_at":"2026-08-07T01:29:27.719882Z","submitted_at":"2025-09-10T20:47:56Z","title":"YouthSafe: A Youth-Centric Safety Benchmark and Safeguard Model for Large Language Models","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-04T19:55:56.439641Z"},"links":{"citing_paper":"/paper/2509.08997"},"observation_digest":"sha256:84619420a8c2b47036ecd8da93ec0812d31ae929112d7a581ae6130537a9ebf4","observation_id":"40d3c938-1881-4761-90b6-4ca3f0fa9bf0","resolution":{"observed_at":"2026-08-04T19:55:56.439641Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T19:55:56.444021Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2509.08997","last_updated":"2025-09-10T20:47:56Z","snapshot_observed_at":"2026-08-07T01:29:27.719882Z","submitted_at":"2025-09-10T20:47:56Z","title":"YouthSafe: A Youth-Centric Safety Benchmark and Safeguard Model for Large Language Models","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-04T19:55:56.444021Z"},"links":{"citing_paper":"/paper/2509.08997"},"observation_digest":"sha256:f36ab871ec103c5b1c98faf77dfb1ac550a1e15cb84fa882b7a81ca4b7d461d8","observation_id":"e3a0654f-c9da-4710-8c90-1af1a139ff1c","resolution":{"observed_at":"2026-08-04T19:55:56.444021Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T19:55:56.447986Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.08997","last_updated":"2025-09-10T20:47:56Z","snapshot_observed_at":"2026-08-07T01:29:27.719882Z","submitted_at":"2025-09-10T20:47:56Z","title":"YouthSafe: A Youth-Centric Safety Benchmark and Safeguard Model for Large Language Models","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-04T19:55:56.447986Z"},"links":{"citing_paper":"/paper/2509.08997"},"observation_digest":"sha256:b1bdf87b33e6c3110a25757539f2c42dfcfffa968dcb15516e6796cd46a38573","observation_id":"300e2c2c-d4c9-436f-bcca-ac823f9f6ff9","resolution":{"observed_at":"2026-08-04T19:55:56.447986Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2204.05862","last_updated":"2022-04-12T15:02:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-04-12T15:02:38Z","title":"Training a Helpful and Harmless Assistant with Reinforcement Learning from Human Feedback","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.05862","snapshot_observed_at":"2026-08-04T19:55:56.451863Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.08997","last_updated":"2025-09-10T20:47:56Z","snapshot_observed_at":"2026-08-07T01:29:27.719882Z","submitted_at":"2025-09-10T20:47:56Z","title":"YouthSafe: A Youth-Centric Safety Benchmark and Safeguard Model for Large Language Models","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-04T19:55:56.451863Z"},"links":{"cited_paper":"/paper/2204.05862","citing_paper":"/paper/2509.08997"},"observation_digest":"sha256:56f8b4349d6e0f0308889b2545337fe13e0f35ffbcdee7a0e9c22b55691c5bd7","observation_id":"aec61d3c-2a8e-4c97-8ffd-86e54e187442","resolution":{"observed_at":"2026-08-04T19:55:56.451863Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T19:55:56.456135Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.08997","last_updated":"2025-09-10T20:47:56Z","snapshot_observed_at":"2026-08-07T01:29:27.719882Z","submitted_at":"2025-09-10T20:47:56Z","title":"YouthSafe: A Youth-Centric Safety Benchmark and Safeguard Model for Large Language Models","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-04T19:55:56.456135Z"},"links":{"citing_paper":"/paper/2509.08997"},"observation_digest":"sha256:45b0beb82c6cf2c1f08edb7503ebc99ada1cf6ffd995c071ae3cf4b3cac03ba1","observation_id":"0338ff4d-f339-41c6-b5bc-b772e015a866","resolution":{"observed_at":"2026-08-04T19:55:56.456135Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T19:55:56.460400Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.08997","last_updated":"2025-09-10T20:47:56Z","snapshot_observed_at":"2026-08-07T01:29:27.719882Z","submitted_at":"2025-09-10T20:47:56Z","title":"YouthSafe: A Youth-Centric Safety Benchmark and Safeguard Model for Large Language Models","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-04T19:55:56.460400Z"},"links":{"citing_paper":"/paper/2509.08997"},"observation_digest":"sha256:66068a24f4000509117d474a71325c6d2557e95abcdc159eef8fffad4185776d","observation_id":"f63a1b9f-bf10-496c-af60-f94804011281","resolution":{"observed_at":"2026-08-04T19:55:56.460400Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.05778","last_updated":"2024-01-11T09:29:56Z","snapshot_observed_at":"2026-08-05T00:16:01.594011Z","submitted_at":"2024-01-11T09:29:56Z","title":"Risk Taxonomy, Mitigation, and Assessment Benchmarks of Large Language Model Systems","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.05778","snapshot_observed_at":"2026-08-04T19:55:56.464199Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.08997","last_updated":"2025-09-10T20:47:56Z","snapshot_observed_at":"2026-08-07T01:29:27.719882Z","submitted_at":"2025-09-10T20:47:56Z","title":"YouthSafe: A Youth-Centric Safety Benchmark and Safeguard Model for Large Language Models","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-04T19:55:56.464199Z"},"links":{"cited_paper":"/paper/2401.05778","citing_paper":"/paper/2509.08997"},"observation_digest":"sha256:237ac16fc68ec44e85f2e806fe31686c0acbc37d620807aebb7750f727b2c7e9","observation_id":"1555aad5-4680-4977-b859-51c2baa6606c","resolution":{"observed_at":"2026-08-04T19:55:56.464199Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.09283","last_updated":"2024-03-27T13:55:14Z","snapshot_observed_at":"2026-07-06T17:30:08.206972Z","submitted_at":"2024-02-14T16:14:03Z","title":"Attacks, Defenses and Evaluations for LLM Conversation Safety: A Survey","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.09283","snapshot_observed_at":"2026-08-04T19:55:56.468210Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.08997","last_updated":"2025-09-10T20:47:56Z","snapshot_observed_at":"2026-08-07T01:29:27.719882Z","submitted_at":"2025-09-10T20:47:56Z","title":"YouthSafe: A Youth-Centric Safety Benchmark and Safeguard Model for Large Language Models","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-04T19:55:56.468210Z"},"links":{"cited_paper":"/paper/2402.09283","citing_paper":"/paper/2509.08997"},"observation_digest":"sha256:1a433b5bb7029fc37a0b13968aa0fef7b114bdf92cafbe485d44749ae009392e","observation_id":"f00d6933-57f9-4176-918c-24f41037209a","resolution":{"observed_at":"2026-08-04T19:55:56.468210Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T19:55:56.472412Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.08997","last_updated":"2025-09-10T20:47:56Z","snapshot_observed_at":"2026-08-07T01:29:27.719882Z","submitted_at":"2025-09-10T20:47:56Z","title":"YouthSafe: A Youth-Centric Safety Benchmark and Safeguard Model for Large Language Models","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-04T19:55:56.472412Z"},"links":{"citing_paper":"/paper/2509.08997"},"observation_digest":"sha256:4a248be4647870601310afe268b1748a9b385784eed32c9ef10143a743da133f","observation_id":"f5a16fcf-69ac-4913-b57e-3d6db52891d9","resolution":{"observed_at":"2026-08-04T19:55:56.472412Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.05993","last_updated":"2024-09-11T14:42:29Z","snapshot_observed_at":"2026-08-06T16:17:24.580021Z","submitted_at":"2024-04-09T03:54:28Z","title":"AEGIS: Online Adaptive AI Content Safety Moderation with Ensemble of LLM Experts","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.05993","snapshot_observed_at":"2026-08-04T19:55:56.480656Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.08997","last_updated":"2025-09-10T20:47:56Z","snapshot_observed_at":"2026-08-07T01:29:27.719882Z","submitted_at":"2025-09-10T20:47:56Z","title":"YouthSafe: A Youth-Centric Safety Benchmark and Safeguard Model for Large Language Models","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-04T19:55:56.480656Z"},"links":{"cited_paper":"/paper/2404.05993","citing_paper":"/paper/2509.08997"},"observation_digest":"sha256:32823c9133a466fc648ff6f245ef35b2244f7daabdaf2025bc34efa6c8d10434","observation_id":"85c84855-85be-479e-8369-f623731c2b37","resolution":{"observed_at":"2026-08-04T19:55:56.480656Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.00930","last_updated":"2024-04-01T05:19:34Z","snapshot_observed_at":"2026-08-04T23:51:15.340647Z","submitted_at":"2024-04-01T05:19:34Z","title":"PSYDIAL: Personality-based Synthetic Dialogue Generation using Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.00930","snapshot_observed_at":"2026-08-04T19:55:56.484935Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.08997","last_updated":"2025-09-10T20:47:56Z","snapshot_observed_at":"2026-08-07T01:29:27.719882Z","submitted_at":"2025-09-10T20:47:56Z","title":"YouthSafe: A Youth-Centric Safety Benchmark and Safeguard Model for Large Language Models","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-04T19:55:56.484935Z"},"links":{"cited_paper":"/paper/2404.00930","citing_paper":"/paper/2509.08997"},"observation_digest":"sha256:c1bf20f2724f053475e80744477b2e5a340b07e706dfdd0622d81a1e95cb2d2b","observation_id":"8c4b9a5f-d5a4-45d1-919a-91266192c326","resolution":{"observed_at":"2026-08-04T19:55:56.484935Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.18495","last_updated":"2024-12-09T20:21:56Z","snapshot_observed_at":"2026-08-06T04:32:59.039501Z","submitted_at":"2024-06-26T16:58:20Z","title":"WildGuard: Open One-Stop Moderation Tools for Safety Risks, Jailbreaks, and Refusals of LLMs","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.18495","snapshot_observed_at":"2026-08-04T19:55:56.488786Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.08997","last_updated":"2025-09-10T20:47:56Z","snapshot_observed_at":"2026-08-07T01:29:27.719882Z","submitted_at":"2025-09-10T20:47:56Z","title":"YouthSafe: A Youth-Centric Safety Benchmark and Safeguard Model for Large Language Models","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-04T19:55:56.488786Z"},"links":{"cited_paper":"/paper/2406.18495","citing_paper":"/paper/2509.08997"},"observation_digest":"sha256:d49bb9c66ba9a176eb149837d532170b916390349cbb26cb66cef877ab6a5ce1","observation_id":"71699409-6c52-4815-b287-0100bb3583e4","resolution":{"observed_at":"2026-08-04T19:55:56.488786Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.06135","last_updated":"2023-06-09T01:37:32Z","snapshot_observed_at":"2026-08-03T23:56:08.367928Z","submitted_at":"2023-06-09T01:37:32Z","title":"Safety and Fairness for Content Moderation in Generative Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.06135","snapshot_observed_at":"2026-08-04T19:55:56.492603Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.08997","last_updated":"2025-09-10T20:47:56Z","snapshot_observed_at":"2026-08-07T01:29:27.719882Z","submitted_at":"2025-09-10T20:47:56Z","title":"YouthSafe: A Youth-Centric Safety Benchmark and Safeguard Model for Large Language Models","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-04T19:55:56.492603Z"},"links":{"cited_paper":"/paper/2306.06135","citing_paper":"/paper/2509.08997"},"observation_digest":"sha256:112bec531f33e335fff3574e6ff4209eac7f423f73ce2aa4bd925516edf529b8","observation_id":"1a55112a-06ca-4296-8653-437f387680fb","resolution":{"observed_at":"2026-08-04T19:55:56.492603Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.09509","last_updated":"2022-07-14T13:04:29Z","snapshot_observed_at":"2026-07-06T12:49:18.486644Z","submitted_at":"2022-03-17T17:57:56Z","title":"ToxiGen: A Large-Scale Machine-Generated Dataset for Adversarial and Implicit Hate Speech Detection","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.09509","snapshot_observed_at":"2026-08-04T19:55:56.496758Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.08997","last_updated":"2025-09-10T20:47:56Z","snapshot_observed_at":"2026-08-07T01:29:27.719882Z","submitted_at":"2025-09-10T20:47:56Z","title":"YouthSafe: A Youth-Centric Safety Benchmark and Safeguard Model for Large Language Models","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-04T19:55:56.496758Z"},"links":{"cited_paper":"/paper/2203.09509","citing_paper":"/paper/2509.08997"},"observation_digest":"sha256:6460d93f878da9fd1d879dfe8371ba59585363b4ce50305d65acff4eb059b7b2","observation_id":"ceb7cea7-f718-4b45-ae01-9dcfd5476e8a","resolution":{"observed_at":"2026-08-04T19:55:56.496758Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.06674","last_updated":"2023-12-07T19:40:50Z","snapshot_observed_at":"2026-07-06T17:00:00.321552Z","submitted_at":"2023-12-07T19:40:50Z","title":"Llama Guard: LLM-based Input-Output Safeguard for Human-AI Conversations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.06674","snapshot_observed_at":"2026-08-04T19:55:56.500552Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.08997","last_updated":"2025-09-10T20:47:56Z","snapshot_observed_at":"2026-08-07T01:29:27.719882Z","submitted_at":"2025-09-10T20:47:56Z","title":"YouthSafe: A Youth-Centric Safety Benchmark and Safeguard Model for Large Language Models","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-04T19:55:56.500552Z"},"links":{"cited_paper":"/paper/2312.06674","citing_paper":"/paper/2509.08997"},"observation_digest":"sha256:9798e6caf8cf5f9f3ebf886f8ce913c5c7e077c02e20273ec6bd717fa741f641","observation_id":"80eab3e1-19f5-47d3-aee1-529c4eb0de6e","resolution":{"observed_at":"2026-08-04T19:55:56.500552Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T19:55:56.504517Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.08997","last_updated":"2025-09-10T20:47:56Z","snapshot_observed_at":"2026-08-07T01:29:27.719882Z","submitted_at":"2025-09-10T20:47:56Z","title":"YouthSafe: A Youth-Centric Safety Benchmark and Safeguard Model for Large Language Models","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-04T19:55:56.504517Z"},"links":{"citing_paper":"/paper/2509.08997"},"observation_digest":"sha256:e300df56dd4c7232b00379ee8d3f976a9030068d213579e051bc3df445d1e7b9","observation_id":"d97c74d2-471a-4031-8b89-df584e805985","resolution":{"observed_at":"2026-08-04T19:55:56.504517Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T19:55:56.512379Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.08997","last_updated":"2025-09-10T20:47:56Z","snapshot_observed_at":"2026-08-07T01:29:27.719882Z","submitted_at":"2025-09-10T20:47:56Z","title":"YouthSafe: A Youth-Centric Safety Benchmark and Safeguard Model for Large Language Models","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-04T19:55:56.512379Z"},"links":{"citing_paper":"/paper/2509.08997"},"observation_digest":"sha256:040802cbb08eb7309c3492346fd10c4c99fadfde872626b8497d6b26145ebe60","observation_id":"2c5cdccd-8705-4784-986e-73c41b9a126a","resolution":{"observed_at":"2026-08-04T19:55:56.512379Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T19:55:56.515891Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.08997","last_updated":"2025-09-10T20:47:56Z","snapshot_observed_at":"2026-08-07T01:29:27.719882Z","submitted_at":"2025-09-10T20:47:56Z","title":"YouthSafe: A Youth-Centric Safety Benchmark and Safeguard Model for Large Language Models","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-04T19:55:56.515891Z"},"links":{"citing_paper":"/paper/2509.08997"},"observation_digest":"sha256:15f897b558c01e90d17f0c305fe707c41e33f2e6e47ae226415cd8f0e4a9d7e1","observation_id":"83671a80-ab37-4280-bcb0-2c204f4364fe","resolution":{"observed_at":"2026-08-04T19:55:56.515891Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T19:55:56.519442Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.08997","last_updated":"2025-09-10T20:47:56Z","snapshot_observed_at":"2026-08-07T01:29:27.719882Z","submitted_at":"2025-09-10T20:47:56Z","title":"YouthSafe: A Youth-Centric Safety Benchmark and Safeguard Model for Large Language Models","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-04T19:55:56.519442Z"},"links":{"citing_paper":"/paper/2509.08997"},"observation_digest":"sha256:67c2ed9e06c45ac34856b7e307e17424c76c34884709c030029bdc8a341f4fbe","observation_id":"0aa60e10-6101-4e65-8127-f1aadc56bad8","resolution":{"observed_at":"2026-08-04T19:55:56.519442Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.05044","last_updated":"2024-06-07T12:05:46Z","snapshot_observed_at":"2026-08-03T21:40:53.683032Z","submitted_at":"2024-02-07T17:33:54Z","title":"SALAD-Bench: A Hierarchical and Comprehensive Safety Benchmark for Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.05044","snapshot_observed_at":"2026-08-04T19:55:56.522947Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.08997","last_updated":"2025-09-10T20:47:56Z","snapshot_observed_at":"2026-08-07T01:29:27.719882Z","submitted_at":"2025-09-10T20:47:56Z","title":"YouthSafe: A Youth-Centric Safety Benchmark and Safeguard Model for Large Language Models","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-04T19:55:56.522947Z"},"links":{"cited_paper":"/paper/2402.05044","citing_paper":"/paper/2509.08997"},"observation_digest":"sha256:029c19f165ddcdb7a3259533279bbfd9d47246f9c6e341c20bda895d12b5fa80","observation_id":"f4c98dc4-5aa3-46e1-ac3b-58ba065cbbcb","resolution":{"observed_at":"2026-08-04T19:55:56.522947Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.10414","last_updated":"2025-02-23T10:12:38Z","snapshot_observed_at":"2026-07-06T19:33:00.110753Z","submitted_at":"2024-10-14T12:04:06Z","title":"On Calibration of LLM-based Guard Models for Reliable Content Moderation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.10414","snapshot_observed_at":"2026-08-04T19:55:56.526754Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.08997","last_updated":"2025-09-10T20:47:56Z","snapshot_observed_at":"2026-08-07T01:29:27.719882Z","submitted_at":"2025-09-10T20:47:56Z","title":"YouthSafe: A Youth-Centric Safety Benchmark and Safeguard Model for Large Language Models","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-04T19:55:56.526754Z"},"links":{"cited_paper":"/paper/2410.10414","citing_paper":"/paper/2509.08997"},"observation_digest":"sha256:3c0da5bdf5a8435c127fa17193a3a9cf022613f76ad45ab4f4c1fc6eef2cf247","observation_id":"2eaee460-0851-49f9-97b8-4f65e3d40154","resolution":{"observed_at":"2026-08-04T19:55:56.526754Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.32996/jhsss.2024.6.9.6","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":null,"venue":"Journal of Humanities and Social Sciences Studies","work_id":"2ea5d1c9-2497-4f57-9b06-3d9f0a7e9cb8","year":2024},"citing_paper":{"arxiv_id":"2509.08997","last_updated":"2025-09-10T20:47:56Z","snapshot_observed_at":"2026-08-07T01:29:27.719882Z","submitted_at":"2025-09-10T20:47:56Z","title":"YouthSafe: A Youth-Centric Safety Benchmark and Safeguard Model for Large Language Models","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-04T19:55:56.530430Z"},"links":{"citing_paper":"/paper/2509.08997"},"observation_digest":"sha256:1fa923c4117b4304703f4f06a6f89f492d14698d9b4891ba9fc43c85401968fe","observation_id":"321ba483-a5e6-48ee-a7f7-dadac95ae4d4","resolution":{"observed_at":"2026-08-04T19:58:31.965104Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T19:55:56.534097Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.08997","last_updated":"2025-09-10T20:47:56Z","snapshot_observed_at":"2026-08-07T01:29:27.719882Z","submitted_at":"2025-09-10T20:47:56Z","title":"YouthSafe: A Youth-Centric Safety Benchmark and Safeguard Model for Large Language Models","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-04T19:55:56.534097Z"},"links":{"citing_paper":"/paper/2509.08997"},"observation_digest":"sha256:3d5aa5a89f198cb67c843609d48d0b6edbc08638ab0eb8ea6e759fdb83957d36","observation_id":"290d5c75-db84-4713-a7ac-7cc98a315ee4","resolution":{"observed_at":"2026-08-04T19:55:56.534097Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T19:55:56.537697Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.08997","last_updated":"2025-09-10T20:47:56Z","snapshot_observed_at":"2026-08-07T01:29:27.719882Z","submitted_at":"2025-09-10T20:47:56Z","title":"YouthSafe: A Youth-Centric Safety Benchmark and Safeguard Model for Large Language Models","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-04T19:55:56.537697Z"},"links":{"citing_paper":"/paper/2509.08997"},"observation_digest":"sha256:7a358a4f2ab5ceb0f36d1b2bfa931613b127c9aef7de483745613b89e4f43eda","observation_id":"8b792521-3269-4505-9d2d-ce27c1d486fb","resolution":{"observed_at":"2026-08-04T19:55:56.537697Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04249","last_updated":"2024-02-27T04:43:08Z","snapshot_observed_at":"2026-07-06T17:26:23.067923Z","submitted_at":"2024-02-06T18:59:08Z","title":"HarmBench: A Standardized Evaluation Framework for Automated Red Teaming and Robust Refusal","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.04249","snapshot_observed_at":"2026-08-04T19:55:56.541068Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.08997","last_updated":"2025-09-10T20:47:56Z","snapshot_observed_at":"2026-08-07T01:29:27.719882Z","submitted_at":"2025-09-10T20:47:56Z","title":"YouthSafe: A Youth-Centric Safety Benchmark and Safeguard Model for Large Language Models","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-04T19:55:56.541068Z"},"links":{"cited_paper":"/paper/2402.04249","citing_paper":"/paper/2509.08997"},"observation_digest":"sha256:2dbd790e2382e27ed37ed6aeead33c927d3a87cd6a1398d41044c286bfc4965f","observation_id":"a871477d-09bd-41bc-835c-b9f0e4c38e04","resolution":{"observed_at":"2026-08-04T19:55:56.541068Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.09785","last_updated":"2024-04-15T13:40:08Z","snapshot_observed_at":"2026-07-06T18:00:21.200922Z","submitted_at":"2024-04-15T13:40:08Z","title":"Benchmarking Llama2, Mistral, Gemma and GPT for Factuality, Toxicity, Bias and Propensity for Hallucinations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.09785","snapshot_observed_at":"2026-08-04T19:55:56.544665Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.08997","last_updated":"2025-09-10T20:47:56Z","snapshot_observed_at":"2026-08-07T01:29:27.719882Z","submitted_at":"2025-09-10T20:47:56Z","title":"YouthSafe: A Youth-Centric Safety Benchmark and Safeguard Model for Large Language Models","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-04T19:55:56.544665Z"},"links":{"cited_paper":"/paper/2404.09785","citing_paper":"/paper/2509.08997"},"observation_digest":"sha256:7dbd60d0d21a6839ea5d3f6c85d8633179ed1390eef2b5ee78773a5669170fa2","observation_id":"bbabf8bd-3ce8-43a6-8cc9-f882708e390f","resolution":{"observed_at":"2026-08-04T19:55:56.544665Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2010.00133","last_updated":"2020-09-30T22:38:40Z","snapshot_observed_at":"2026-08-01T09:26:19.649537Z","submitted_at":"2020-09-30T22:38:40Z","title":"CrowS-Pairs: A Challenge Dataset for Measuring Social Biases in Masked Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.00133","snapshot_observed_at":"2026-08-04T19:55:56.548322Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2509.08997","last_updated":"2025-09-10T20:47:56Z","snapshot_observed_at":"2026-08-07T01:29:27.719882Z","submitted_at":"2025-09-10T20:47:56Z","title":"YouthSafe: A Youth-Centric Safety Benchmark and Safeguard Model for Large Language Models","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-04T19:55:56.548322Z"},"links":{"cited_paper":"/paper/2010.00133","citing_paper":"/paper/2509.08997"},"observation_digest":"sha256:a223b7f9b9a013112da5b9856840227e5e2646ca47214028b0f5f851d9961247","observation_id":"3981cd43-c751-4627-810a-b9e4ba610def","resolution":{"observed_at":"2026-08-04T19:55:56.548322Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T19:55:56.552071Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.08997","last_updated":"2025-09-10T20:47:56Z","snapshot_observed_at":"2026-08-07T01:29:27.719882Z","submitted_at":"2025-09-10T20:47:56Z","title":"YouthSafe: A Youth-Centric Safety Benchmark and Safeguard Model for Large Language Models","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-04T19:55:56.552071Z"},"links":{"citing_paper":"/paper/2509.08997"},"observation_digest":"sha256:cf504871674c94f8ac64908400cc726fc65a04044b0c91c55a34d1bd8020f0fc","observation_id":"6b546276-c361-4041-a1d3-dc6dca48d2cd","resolution":{"observed_at":"2026-08-04T19:55:56.552071Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T19:55:56.559507Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.08997","last_updated":"2025-09-10T20:47:56Z","snapshot_observed_at":"2026-08-07T01:29:27.719882Z","submitted_at":"2025-09-10T20:47:56Z","title":"YouthSafe: A Youth-Centric Safety Benchmark and Safeguard Model for Large Language Models","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-04T19:55:56.559507Z"},"links":{"citing_paper":"/paper/2509.08997"},"observation_digest":"sha256:0c6c73bd5b2d3a4b847f0b1d969e421af4f8f1e9fb8a71eaf07b87f71e53821d","observation_id":"6624f39e-7fbc-4798-bfdb-0574960a90fe","resolution":{"observed_at":"2026-08-04T19:55:56.559507Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.2139/ssrn.4601555","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":null,"venue":"SSRN Electronic Journal","work_id":"6ca4884b-5129-48aa-90ec-c84877d940d0","year":2023},"citing_paper":{"arxiv_id":"2509.08997","last_updated":"2025-09-10T20:47:56Z","snapshot_observed_at":"2026-08-07T01:29:27.719882Z","submitted_at":"2025-09-10T20:47:56Z","title":"YouthSafe: A Youth-Centric Safety Benchmark and Safeguard Model for Large Language Models","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-04T19:55:56.563193Z"},"links":{"citing_paper":"/paper/2509.08997"},"observation_digest":"sha256:84e644f8234ddb15d12a52507f6f46f5584adb5a24edce16d94bb04ac7d755c1","observation_id":"e54d6e74-ee80-40bf-a184-2faaba1ed875","resolution":{"observed_at":"2026-08-04T19:58:31.677871Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.03023","last_updated":"2024-04-03T19:18:25Z","snapshot_observed_at":"2026-07-06T17:55:21.083912Z","submitted_at":"2024-04-03T19:18:25Z","title":"Toward Safe Evolution of Artificial Intelligence (AI) based Conversational Agents to Support Adolescent Mental and Sexual Health Knowledge Discovery","version":1},"cited_work":{"arxiv_id":"2404.03023","doi":"10.48550/arxiv.2404.03023","metadata_source":"pith","pith_arxiv_id":"2404.03023","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"Toward Safe Evolution of Artificial Intelligence (AI) based Conversational Agents to Support Adolescent Mental and Sexual Health Knowledge Discovery","venue":"cs.HC","work_id":"68f72697-1e34-4fc0-b9d3-21cb95fab417","year":2024},"citing_paper":{"arxiv_id":"2509.08997","last_updated":"2025-09-10T20:47:56Z","snapshot_observed_at":"2026-08-07T01:29:27.719882Z","submitted_at":"2025-09-10T20:47:56Z","title":"YouthSafe: A Youth-Centric Safety Benchmark and Safeguard Model for Large Language Models","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-04T19:55:56.567091Z"},"links":{"cited_paper":"/paper/2404.03023","citing_paper":"/paper/2509.08997"},"observation_digest":"sha256:e791780b308f31835c98c84973ba00cfbeb98fc773ef3788a0a7f629ea8282ab","observation_id":"1f2907e8-80e7-49cb-bf5a-924663dcc5b7","resolution":{"observed_at":"2026-08-04T19:58:31.442164Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T19:55:56.570965Z","title":null,"venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2509.08997","last_updated":"2025-09-10T20:47:56Z","snapshot_observed_at":"2026-08-07T01:29:27.719882Z","submitted_at":"2025-09-10T20:47:56Z","title":"YouthSafe: A Youth-Centric Safety Benchmark and Safeguard Model for Large Language Models","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-04T19:55:56.570965Z"},"links":{"citing_paper":"/paper/2509.08997"},"observation_digest":"sha256:24932a4998d8c83ad30d0af788392edae8c1a25a8e00e4eb9973384d21b44b16","observation_id":"0459af65-f013-48df-8282-12b1d11d179c","resolution":{"observed_at":"2026-08-04T19:55:56.570965Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.08676","last_updated":"2024-06-24T08:50:22Z","snapshot_observed_at":"2026-07-06T17:59:29.408432Z","submitted_at":"2024-04-06T15:01:47Z","title":"ALERT: A Comprehensive Benchmark for Assessing Large Language Models' Safety through Red Teaming","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.08676","snapshot_observed_at":"2026-08-04T19:55:56.574549Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.08997","last_updated":"2025-09-10T20:47:56Z","snapshot_observed_at":"2026-08-07T01:29:27.719882Z","submitted_at":"2025-09-10T20:47:56Z","title":"YouthSafe: A Youth-Centric Safety Benchmark and Safeguard Model for Large Language Models","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-04T19:55:56.574549Z"},"links":{"cited_paper":"/paper/2404.08676","citing_paper":"/paper/2509.08997"},"observation_digest":"sha256:98683f4b765cd0414dd45fced9a7cba6109411e9593df9feb6ccd299c76e2805","observation_id":"40abc098-91e8-4218-ba1a-4615bd073004","resolution":{"observed_at":"2026-08-04T19:55:56.574549Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T19:55:56.578358Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.08997","last_updated":"2025-09-10T20:47:56Z","snapshot_observed_at":"2026-08-07T01:29:27.719882Z","submitted_at":"2025-09-10T20:47:56Z","title":"YouthSafe: A Youth-Centric Safety Benchmark and Safeguard Model for Large Language Models","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-04T19:55:56.578358Z"},"links":{"citing_paper":"/paper/2509.08997"},"observation_digest":"sha256:120263b63d4eeb335e4e2bc5d74730672db97db5195dc10170279838438d0e31","observation_id":"143a19bf-a05e-4009-a357-8532e9db4600","resolution":{"observed_at":"2026-08-04T19:55:56.578358Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.14598","last_updated":"2025-03-01T21:45:36Z","snapshot_observed_at":"2026-07-06T18:34:29.513732Z","submitted_at":"2024-06-20T17:56:07Z","title":"SORRY-Bench: Systematically Evaluating Large Language Model Safety Refusal","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.14598","snapshot_observed_at":"2026-08-04T19:55:56.585528Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.08997","last_updated":"2025-09-10T20:47:56Z","snapshot_observed_at":"2026-08-07T01:29:27.719882Z","submitted_at":"2025-09-10T20:47:56Z","title":"YouthSafe: A Youth-Centric Safety Benchmark and Safeguard Model for Large Language Models","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-04T19:55:56.585528Z"},"links":{"cited_paper":"/paper/2406.14598","citing_paper":"/paper/2509.08997"},"observation_digest":"sha256:4f6ff9b278456e2f1a2c7a5b070e0b0f469d3ef81a015bcaf85f8303c0d97d77","observation_id":"5fb4048d-bc8e-49e2-b7ce-73c6c5f11954","resolution":{"observed_at":"2026-08-04T19:55:56.585528Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.12244","last_updated":"2025-05-27T06:49:09Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-04-24T16:31:06Z","title":"WizardLM: Empowering large pre-trained language models to follow complex instructions","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.12244","snapshot_observed_at":"2026-08-04T19:55:56.589081Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.08997","last_updated":"2025-09-10T20:47:56Z","snapshot_observed_at":"2026-08-07T01:29:27.719882Z","submitted_at":"2025-09-10T20:47:56Z","title":"YouthSafe: A Youth-Centric Safety Benchmark and Safeguard Model for Large Language Models","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-04T19:55:56.589081Z"},"links":{"cited_paper":"/paper/2304.12244","citing_paper":"/paper/2509.08997"},"observation_digest":"sha256:d099832d774c3f74a60a2b1ee2d2b899ec6844e75456ae38102ca0e6e2008554","observation_id":"a0c037c2-d332-4f11-90b6-cb9749e2be3c","resolution":{"observed_at":"2026-08-04T19:55:56.589081Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05818","last_updated":"2023-10-09T16:03:22Z","snapshot_observed_at":"2026-08-04T17:56:20.402015Z","submitted_at":"2023-10-09T16:03:22Z","title":"SC-Safety: A Multi-round Open-ended Question Adversarial Safety Benchmark for Large Language Models in Chinese","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.05818","snapshot_observed_at":"2026-08-04T19:55:56.592772Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.08997","last_updated":"2025-09-10T20:47:56Z","snapshot_observed_at":"2026-08-07T01:29:27.719882Z","submitted_at":"2025-09-10T20:47:56Z","title":"YouthSafe: A Youth-Centric Safety Benchmark and Safeguard Model for Large Language Models","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-04T19:55:56.592772Z"},"links":{"cited_paper":"/paper/2310.05818","citing_paper":"/paper/2509.08997"},"observation_digest":"sha256:ae0082edddda958176cf7dbec982370bd938447e38659bbf0569a35ed4c185ec","observation_id":"a68fb491-d2d7-467b-ab7f-cc006bd04620","resolution":{"observed_at":"2026-08-04T19:55:56.592772Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T19:55:56.596701Z","title":null,"venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2509.08997","last_updated":"2025-09-10T20:47:56Z","snapshot_observed_at":"2026-08-07T01:29:27.719882Z","submitted_at":"2025-09-10T20:47:56Z","title":"YouthSafe: A Youth-Centric Safety Benchmark and Safeguard Model for Large Language Models","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-04T19:55:56.596701Z"},"links":{"citing_paper":"/paper/2509.08997"},"observation_digest":"sha256:bfb3c519e026d38d448c12303c4f69c1babb49019d2bc92a83e6b2457150f63c","observation_id":"ee0120c3-fda3-43a0-9a67-6ba4df4f5931","resolution":{"observed_at":"2026-08-04T19:55:56.596701Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.16383","last_updated":"2025-02-25T23:21:20Z","snapshot_observed_at":"2026-07-06T20:41:06.192192Z","submitted_at":"2025-02-22T23:31:51Z","title":"Understanding Generative AI Risks for Youth: A Taxonomy Based on Empirical Data","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.16383","snapshot_observed_at":"2026-08-04T19:55:56.600400Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.08997","last_updated":"2025-09-10T20:47:56Z","snapshot_observed_at":"2026-08-07T01:29:27.719882Z","submitted_at":"2025-09-10T20:47:56Z","title":"YouthSafe: A Youth-Centric Safety Benchmark and Safeguard Model for Large Language Models","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-04T19:55:56.600400Z"},"links":{"cited_paper":"/paper/2502.16383","citing_paper":"/paper/2509.08997"},"observation_digest":"sha256:e1708a87a29071216bbee4a4319c6ff844c539c11279640505ef96d4d70a70db","observation_id":"fa75ef03-97f1-45ba-89fb-3dbcf4daeaf7","resolution":{"observed_at":"2026-08-04T19:55:56.600400Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.10461","last_updated":"2024-10-30T16:01:56Z","snapshot_observed_at":"2026-07-06T18:31:21.929350Z","submitted_at":"2024-06-15T01:14:23Z","title":"Exploring Parent-Child Perceptions on Safety in Generative AI: Concerns, Mitigation Strategies, and Design Implications","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.10461","snapshot_observed_at":"2026-08-04T19:55:56.604134Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.08997","last_updated":"2025-09-10T20:47:56Z","snapshot_observed_at":"2026-08-07T01:29:27.719882Z","submitted_at":"2025-09-10T20:47:56Z","title":"YouthSafe: A Youth-Centric Safety Benchmark and Safeguard Model for Large Language Models","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-04T19:55:56.604134Z"},"links":{"cited_paper":"/paper/2406.10461","citing_paper":"/paper/2509.08997"},"observation_digest":"sha256:b2a907655665082a1107a0f50010d23b9ae3f0221f9e706204332fe446aff1d0","observation_id":"f8087318-fffc-4214-90e8-3dd59136adf1","resolution":{"observed_at":"2026-08-04T19:55:56.604134Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.07045","last_updated":"2024-06-24T04:04:21Z","snapshot_observed_at":"2026-08-06T09:15:44.308151Z","submitted_at":"2023-09-13T15:56:50Z","title":"SafetyBench: Evaluating the Safety of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.07045","snapshot_observed_at":"2026-08-04T19:55:56.607844Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.08997","last_updated":"2025-09-10T20:47:56Z","snapshot_observed_at":"2026-08-07T01:29:27.719882Z","submitted_at":"2025-09-10T20:47:56Z","title":"YouthSafe: A Youth-Centric Safety Benchmark and Safeguard Model for Large Language Models","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-04T19:55:56.607844Z"},"links":{"cited_paper":"/paper/2309.07045","citing_paper":"/paper/2509.08997"},"observation_digest":"sha256:072fcbf848ac6334b0e7cc76d34dba68e0c1ee7175e7b1815a8dacae726d8d34","observation_id":"4d32f22f-ce66-49cd-b9fd-ac8d1e2ec432","resolution":{"observed_at":"2026-08-04T19:55:56.607844Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.13372","last_updated":"2024-06-27T22:44:48Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-03-20T08:08:54Z","title":"LlamaFactory: Unified Efficient Fine-Tuning of 100+ Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.13372","snapshot_observed_at":"2026-08-04T19:55:56.611443Z","title":"conversation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.08997","last_updated":"2025-09-10T20:47:56Z","snapshot_observed_at":"2026-08-07T01:29:27.719882Z","submitted_at":"2025-09-10T20:47:56Z","title":"YouthSafe: A Youth-Centric Safety Benchmark and Safeguard Model for Large Language Models","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-04T19:55:56.611443Z"},"links":{"cited_paper":"/paper/2403.13372","citing_paper":"/paper/2509.08997"},"observation_digest":"sha256:299ec73c1c24f5b6eeb0c16265ff408c01cacbfd39ef2b90d6091f658303c4b9","observation_id":"5a72bd2a-de2b-46e9-a8ba-235be6657ca2","resolution":{"observed_at":"2026-08-04T19:55:56.611443Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T19:55:56.555783Z","title":"InProceedings of the 25th international conference on world wide web","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.08997","last_updated":"2025-09-10T20:47:56Z","snapshot_observed_at":"2026-08-07T01:29:27.719882Z","submitted_at":"2025-09-10T20:47:56Z","title":"YouthSafe: A Youth-Centric Safety Benchmark and Safeguard Model for Large Language Models","version":1},"reference_index":2016,"source":"pdf_text","source_observed_at":"2026-08-04T19:55:56.555783Z"},"links":{"citing_paper":"/paper/2509.08997"},"observation_digest":"sha256:7e6db8eaf26a4395009bf653edd8c7343b64e0760a67acef209478668d9ec817","observation_id":"2d0ee98e-a276-4727-9f4f-6ff2c3030798","resolution":{"observed_at":"2026-08-04T19:55:56.555783Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2009.11462","last_updated":"2020-09-25T20:22:26Z","snapshot_observed_at":"2026-07-06T09:58:19.547859Z","submitted_at":"2020-09-24T03:17:19Z","title":"RealToxicityPrompts: Evaluating Neural Toxic Degeneration in Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.11462","snapshot_observed_at":"2026-08-04T19:55:56.476519Z","title":null,"venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2509.08997","last_updated":"2025-09-10T20:47:56Z","snapshot_observed_at":"2026-08-07T01:29:27.719882Z","submitted_at":"2025-09-10T20:47:56Z","title":"YouthSafe: A Youth-Centric Safety Benchmark and Safeguard Model for Large Language Models","version":1},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-04T19:55:56.476519Z"},"links":{"cited_paper":"/paper/2009.11462","citing_paper":"/paper/2509.08997"},"observation_digest":"sha256:74b36216e159144de9c71727849cc3144c3d49f5336620425e88dda6701e4be9","observation_id":"d324e459-e43f-407b-a930-f83a8df74de5","resolution":{"observed_at":"2026-08-04T19:55:56.476519Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2206.07682","last_updated":"2022-10-26T05:06:24Z","snapshot_observed_at":"2026-08-02T15:56:35.249569Z","submitted_at":"2022-06-15T17:32:01Z","title":"Emergent Abilities of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2206.07682","snapshot_observed_at":"2026-08-04T19:55:56.581905Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.08997","last_updated":"2025-09-10T20:47:56Z","snapshot_observed_at":"2026-08-07T01:29:27.719882Z","submitted_at":"2025-09-10T20:47:56Z","title":"YouthSafe: A Youth-Centric Safety Benchmark and Safeguard Model for Large Language Models","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-04T19:55:56.581905Z"},"links":{"cited_paper":"/paper/2206.07682","citing_paper":"/paper/2509.08997"},"observation_digest":"sha256:d4818112360e2f235474d7db0ba69dc484871c761043ad802b8675d960f6c404","observation_id":"d343159e-61e0-4b36-891a-d93de8ad145f","resolution":{"observed_at":"2026-08-04T19:55:56.581905Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.10007","last_updated":"2023-12-15T18:23:50Z","snapshot_observed_at":"2026-08-03T18:40:17.286021Z","submitted_at":"2023-12-15T18:23:50Z","title":"Faithful Persona-based Conversational Dataset Generation with Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.10007","snapshot_observed_at":"2026-08-04T19:55:56.508575Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.08997","last_updated":"2025-09-10T20:47:56Z","snapshot_observed_at":"2026-08-07T01:29:27.719882Z","submitted_at":"2025-09-10T20:47:56Z","title":"YouthSafe: A Youth-Centric Safety Benchmark and Safeguard Model for Large Language Models","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-04T19:55:56.508575Z"},"links":{"cited_paper":"/paper/2312.10007","citing_paper":"/paper/2509.08997"},"observation_digest":"sha256:f6c5f801f56d2f9c22a824b645366c8e2613f649b15a08b425bb0f8507cda909","observation_id":"251836f7-99fe-4a2d-ace3-865553890023","resolution":{"observed_at":"2026-08-04T19:55:56.508575Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2509.08997","last_updated":"2025-09-10T20:47:56Z","latest_version":1,"primary_category":"cs.HC","snapshot_observed_at":"2026-08-07T01:29:27.719882Z","submitted_at":"2025-09-10T20:47:56Z","title":"YouthSafe: A Youth-Centric Safety Benchmark and Safeguard Model for Large Language Models"},"reference_resolution":{"displayed":47,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":43,"verified_exact":3,"verified_fuzzy":0},"total_outbound_references":47},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 47 of 47 outbound references and 0 inbound Pith citation observations for arXiv:2509.08997."}