{"as_of":"2026-08-10T10:07:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:d81f6d2f618bbf0810d952bc9ae6100190d4e70f2443485d7e8311a76f5a7185","coverage":[{"denominator":12,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":12,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-10T18:59:26.795241Z","state":"measured"},{"denominator":112,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":112,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":417,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":100,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-10T04:37:16.998077Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"pith","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":25,"observed_at":"2026-08-05T02:28:24.338817Z","source":"pith"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2312.06674","last_updated":"2023-12-07T19:40:50Z","snapshot_observed_at":"2026-07-06T17:00:00.321552Z","submitted_at":"2023-12-07T19:40:50Z","title":"Llama Guard: LLM-based Input-Output Safeguard for Human-AI Conversations","version":1},"cited_work":{"arxiv_id":"2312.06674","doi":"10.3390/info16050365","metadata_source":"pith","pith_arxiv_id":"2312.06674","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Llama Guard: LLM-based Input-Output Safeguard for Human-AI Conversations","venue":"cs.CL","work_id":"93844332-869b-448c-a1be-35466150b1b2","year":2023},"citing_paper":{"arxiv_id":"2310.03684","last_updated":"2024-06-11T19:02:52Z","snapshot_observed_at":"2026-07-06T16:28:22.350574Z","submitted_at":"2023-10-05T17:01:53Z","title":"SmoothLLM: Defending Large Language Models Against Jailbreaking Attacks","version":4},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-05-14T17:11:00.639293Z"},"links":{"cited_paper":"/paper/2312.06674","citing_paper":"/paper/2310.03684"},"observation_digest":"sha256:ffde70665929bb9913719341220769a9502670d74a55350c5af0cc4790fb2d31","observation_id":"59b493df-1188-4c0d-9cf6-e209f1c23bf8","resolution":{"observed_at":"2026-05-14T17:11:00.769268Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.06674","last_updated":"2023-12-07T19:40:50Z","snapshot_observed_at":"2026-07-06T17:00:00.321552Z","submitted_at":"2023-12-07T19:40:50Z","title":"Llama Guard: LLM-based Input-Output Safeguard for Human-AI Conversations","version":1},"cited_work":{"arxiv_id":"2312.06674","doi":"10.3390/info16050365","metadata_source":"pith","pith_arxiv_id":"2312.06674","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Llama Guard: LLM-based Input-Output Safeguard for Human-AI Conversations","venue":"cs.CL","work_id":"93844332-869b-448c-a1be-35466150b1b2","year":2023},"citing_paper":{"arxiv_id":"2404.01318","last_updated":"2024-10-31T22:26:40Z","snapshot_observed_at":"2026-08-02T14:59:12.115203Z","submitted_at":"2024-03-28T02:44:02Z","title":"JailbreakBench: An Open Robustness Benchmark for Jailbreaking Large Language Models","version":5},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-05-15T06:08:05.386345Z"},"links":{"cited_paper":"/paper/2312.06674","citing_paper":"/paper/2404.01318"},"observation_digest":"sha256:242f0abf620839efd856b40f28ac7f98f81be7503546203ba05937140309bc86","observation_id":"b032a506-52d4-41cf-8c2f-027640a9e8d0","resolution":{"observed_at":"2026-05-15T06:08:05.602244Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.06674","last_updated":"2023-12-07T19:40:50Z","snapshot_observed_at":"2026-07-06T17:00:00.321552Z","submitted_at":"2023-12-07T19:40:50Z","title":"Llama Guard: LLM-based Input-Output Safeguard for Human-AI Conversations","version":1},"cited_work":{"arxiv_id":"2312.06674","doi":"10.3390/info16050365","metadata_source":"pith","pith_arxiv_id":"2312.06674","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Llama Guard: LLM-based Input-Output Safeguard for Human-AI Conversations","venue":"cs.CL","work_id":"93844332-869b-448c-a1be-35466150b1b2","year":2023},"citing_paper":{"arxiv_id":"2406.18495","last_updated":"2024-12-09T20:21:56Z","snapshot_observed_at":"2026-08-06T04:32:59.039501Z","submitted_at":"2024-06-26T16:58:20Z","title":"WildGuard: Open One-Stop Moderation Tools for Safety Risks, Jailbreaks, and Refusals of LLMs","version":3},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-17T16:25:14.744887Z"},"links":{"cited_paper":"/paper/2312.06674","citing_paper":"/paper/2406.18495"},"observation_digest":"sha256:eda8c44aa1e00c5a3752577bf878c6a40eb0e1d6fd5584039113fbfe8cd16189","observation_id":"72db41cc-e8d5-43e0-9cc8-5b8bcb80f5e0","resolution":{"observed_at":"2026-05-17T16:25:14.849301Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.06674","last_updated":"2023-12-07T19:40:50Z","snapshot_observed_at":"2026-07-06T17:00:00.321552Z","submitted_at":"2023-12-07T19:40:50Z","title":"Llama Guard: LLM-based Input-Output Safeguard for Human-AI Conversations","version":1},"cited_work":{"arxiv_id":"2312.06674","doi":"10.3390/info16050365","metadata_source":"pith","pith_arxiv_id":"2312.06674","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Llama Guard: LLM-based Input-Output Safeguard for Human-AI Conversations","venue":"cs.CL","work_id":"93844332-869b-448c-a1be-35466150b1b2","year":2023},"citing_paper":{"arxiv_id":"2407.21772","last_updated":"2024-08-04T22:13:39Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-07-31T17:48:14Z","title":"ShieldGemma: Generative AI Content Moderation Based on Gemma","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-20T13:17:39.444002Z"},"links":{"cited_paper":"/paper/2312.06674","citing_paper":"/paper/2407.21772"},"observation_digest":"sha256:7138f79c9b5c8838433ce47669d86afaf87368b36bb304689518ac389af169f0","observation_id":"7062158a-35b6-4172-a476-abd86862d35f","resolution":{"observed_at":"2026-05-20T13:17:39.507526Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.06674","last_updated":"2023-12-07T19:40:50Z","snapshot_observed_at":"2026-07-06T17:00:00.321552Z","submitted_at":"2023-12-07T19:40:50Z","title":"Llama Guard: LLM-based Input-Output Safeguard for Human-AI Conversations","version":1},"cited_work":{"arxiv_id":"2312.06674","doi":"10.3390/info16050365","metadata_source":"pith","pith_arxiv_id":"2312.06674","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Llama Guard: LLM-based Input-Output Safeguard for Human-AI Conversations","venue":"cs.CL","work_id":"93844332-869b-448c-a1be-35466150b1b2","year":2023},"citing_paper":{"arxiv_id":"2411.10915","last_updated":"2026-05-01T02:07:46Z","snapshot_observed_at":"2026-07-06T19:51:28.494860Z","submitted_at":"2024-11-16T23:54:53Z","title":"Bias in Large Language Models: Origin, Evaluation, and Mitigation","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-05-23T17:08:09.267577Z"},"links":{"cited_paper":"/paper/2312.06674","citing_paper":"/paper/2411.10915"},"observation_digest":"sha256:85acf83ebf9b8639beeeb0ee7e694ff6822c8a17affbdd49035cc01980e06860","observation_id":"23e47189-e4f6-4d4e-b0ae-bf4b1b6709ae","resolution":{"observed_at":"2026-05-23T17:08:12.380117Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.06674","last_updated":"2023-12-07T19:40:50Z","snapshot_observed_at":"2026-07-06T17:00:00.321552Z","submitted_at":"2023-12-07T19:40:50Z","title":"Llama Guard: LLM-based Input-Output Safeguard for Human-AI Conversations","version":1},"cited_work":{"arxiv_id":"2312.06674","doi":"10.3390/info16050365","metadata_source":"pith","pith_arxiv_id":"2312.06674","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Llama Guard: LLM-based Input-Output Safeguard for Human-AI Conversations","venue":"cs.CL","work_id":"93844332-869b-448c-a1be-35466150b1b2","year":2023},"citing_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-05-10T23:38:44.933410Z"},"links":{"cited_paper":"/paper/2312.06674","citing_paper":"/paper/2501.03575"},"observation_digest":"sha256:2c514b78899ebc676822c3a69c57be78e43a6faa5a878e460d3a2a39c064c4b3","observation_id":"c077c955-8436-4525-b0ca-a0fd153a664d","resolution":{"observed_at":"2026-05-10T23:38:45.530796Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.06674","last_updated":"2023-12-07T19:40:50Z","snapshot_observed_at":"2026-07-06T17:00:00.321552Z","submitted_at":"2023-12-07T19:40:50Z","title":"Llama Guard: LLM-based Input-Output Safeguard for Human-AI Conversations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.06674","snapshot_observed_at":"2026-08-10T04:37:16.998077Z","title":"Llama guard: Llm-based input-output safeguard for human- ai conversations,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.17749","last_updated":"2025-01-29T16:36:53Z","snapshot_observed_at":"2026-08-10T04:50:16.966807Z","submitted_at":"2025-01-29T16:36:53Z","title":"Early External Safety Testing of OpenAI's o3-mini: Insights from the Pre-Deployment Evaluation","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-10T04:37:16.998077Z"},"links":{"cited_paper":"/paper/2312.06674","citing_paper":"/paper/2501.17749"},"observation_digest":"sha256:bd026b0275d533662438c11dae3dddde3ca61090ad5cfdb4903a2cacae497ebd","observation_id":"1cb77ed6-af48-4b3f-a363-3dafa0f2183a","resolution":{"observed_at":"2026-08-10T04:37:16.998077Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.06674","last_updated":"2023-12-07T19:40:50Z","snapshot_observed_at":"2026-07-06T17:00:00.321552Z","submitted_at":"2023-12-07T19:40:50Z","title":"Llama Guard: LLM-based Input-Output Safeguard for Human-AI Conversations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.06674","snapshot_observed_at":"2026-08-10T00:12:04.851548Z","title":"Llama guard: Llm-based input-output safeguard for human-ai conversations","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.18280","last_updated":"2025-05-17T04:37:43Z","snapshot_observed_at":"2026-08-10T03:17:04.804861Z","submitted_at":"2025-01-30T11:37:40Z","title":"Jailbreaking LLMs' Safeguard with Universal Magic Words for Text Embedding Models","version":3},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-10T00:12:04.851548Z"},"links":{"cited_paper":"/paper/2312.06674","citing_paper":"/paper/2501.18280"},"observation_digest":"sha256:511f89d145ab1c056fccb26723050170d496c0a3200c8c91082738d873d74a98","observation_id":"9e107d9a-5896-4eee-ace5-17ba50ef1103","resolution":{"observed_at":"2026-08-10T00:12:04.851548Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.06674","last_updated":"2023-12-07T19:40:50Z","snapshot_observed_at":"2026-07-06T17:00:00.321552Z","submitted_at":"2023-12-07T19:40:50Z","title":"Llama Guard: LLM-based Input-Output Safeguard for Human-AI Conversations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.06674","snapshot_observed_at":"2026-08-09T23:32:16.870220Z","title":"Llama guard: Llm-based input-output safeguard for human-ai conversations,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.18438","last_updated":"2025-01-31T15:39:00Z","snapshot_observed_at":"2026-08-10T04:49:31.672323Z","submitted_at":"2025-01-30T15:45:56Z","title":"o3-mini vs DeepSeek-R1: Which One is Safer?","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-09T23:32:16.870220Z"},"links":{"cited_paper":"/paper/2312.06674","citing_paper":"/paper/2501.18438"},"observation_digest":"sha256:2ac59868648a01c06844cb0e53b60938278f4e7faaf4f180073c24f033bc0a60","observation_id":"8ddc7d46-66fe-495f-a8fc-2e96225335ce","resolution":{"observed_at":"2026-08-09T23:32:16.870220Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.06674","last_updated":"2023-12-07T19:40:50Z","snapshot_observed_at":"2026-07-06T17:00:00.321552Z","submitted_at":"2023-12-07T19:40:50Z","title":"Llama Guard: LLM-based Input-Output Safeguard for Human-AI Conversations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.06674","snapshot_observed_at":"2026-08-09T16:18:40.723901Z","title":"Llama guard: Llm-based input-output safeguard for human-ai conversations.arXiv preprint arXiv:2312.06674, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.01208","last_updated":"2025-06-20T10:54:05Z","snapshot_observed_at":"2026-08-09T16:35:47.837184Z","submitted_at":"2025-02-03T09:59:32Z","title":"On Almost Surely Safe Alignment of Large Language Models at Inference-Time","version":3},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-09T16:18:40.723901Z"},"links":{"cited_paper":"/paper/2312.06674","citing_paper":"/paper/2502.01208"},"observation_digest":"sha256:31fd34a3d3add9a65d8856393d87d8344550d7571643eb99e1a65061ccf9c25b","observation_id":"9faece8a-cb64-4cee-8fae-f19b7dd27043","resolution":{"observed_at":"2026-08-09T16:18:40.723901Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.06674","last_updated":"2023-12-07T19:40:50Z","snapshot_observed_at":"2026-07-06T17:00:00.321552Z","submitted_at":"2023-12-07T19:40:50Z","title":"Llama Guard: LLM-based Input-Output Safeguard for Human-AI Conversations","version":1},"cited_work":{"arxiv_id":"2312.06674","doi":"10.3390/info16050365","metadata_source":"pith","pith_arxiv_id":"2312.06674","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Llama Guard: LLM-based Input-Output Safeguard for Human-AI Conversations","venue":"cs.CL","work_id":"93844332-869b-448c-a1be-35466150b1b2","year":2023},"citing_paper":{"arxiv_id":"2502.01241","last_updated":"2026-04-13T12:56:05Z","snapshot_observed_at":"2026-07-06T20:30:12.663808Z","submitted_at":"2025-02-03T11:02:30Z","title":"Peering Behind the Shield: Guardrail Identification in Large Language Models","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-23T03:45:14.234545Z"},"links":{"cited_paper":"/paper/2312.06674","citing_paper":"/paper/2502.01241"},"observation_digest":"sha256:cdae712974f081bf182996bac317475e460fe5aec0c5989bdd20abac22b11786","observation_id":"706dce9f-555d-4e57-8484-da58ea72d51c","resolution":{"observed_at":"2026-05-23T03:45:21.328838Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.06674","last_updated":"2023-12-07T19:40:50Z","snapshot_observed_at":"2026-07-06T17:00:00.321552Z","submitted_at":"2023-12-07T19:40:50Z","title":"Llama Guard: LLM-based Input-Output Safeguard for Human-AI Conversations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.06674","snapshot_observed_at":"2026-08-09T14:49:08.742936Z","title":"1 10 Adversarial Reasoning at Jailbreaking Time Jia, X., Pang, T., Du, C., Huang, Y ., Gu, J., Liu, Y ., Cao, X., and Lin, M","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.01633","last_updated":"2025-06-25T15:31:17Z","snapshot_observed_at":"2026-08-10T01:48:14.461910Z","submitted_at":"2025-02-03T18:59:01Z","title":"Adversarial Reasoning at Jailbreaking Time","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-09T14:49:08.742936Z"},"links":{"cited_paper":"/paper/2312.06674","citing_paper":"/paper/2502.01633"},"observation_digest":"sha256:977edfde247615ec669c883a3acd8eb34e16aa3646a2d6ea29ad59ab2abb6bbd","observation_id":"ea8c3026-61a9-488a-8974-84c98a1031f0","resolution":{"observed_at":"2026-08-09T14:49:08.742936Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.06674","last_updated":"2023-12-07T19:40:50Z","snapshot_observed_at":"2026-07-06T17:00:00.321552Z","submitted_at":"2023-12-07T19:40:50Z","title":"Llama Guard: LLM-based Input-Output Safeguard for Human-AI Conversations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.06674","snapshot_observed_at":"2026-08-09T13:14:34.027501Z","title":"Llama guard: Llm-based input-output safeguard for human-ai conversations","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.02153","last_updated":"2025-02-04T09:31:54Z","snapshot_observed_at":"2026-08-10T00:34:18.762743Z","submitted_at":"2025-02-04T09:31:54Z","title":"Vulnerability Mitigation for Safety-Aligned Language Models via Debiasing","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-09T13:14:34.027501Z"},"links":{"cited_paper":"/paper/2312.06674","citing_paper":"/paper/2502.02153"},"observation_digest":"sha256:9edbb13b52794838a6f997b36448b50df3c016f7d3e25f1ce69c29f40f382dfa","observation_id":"98c68720-f744-4ff2-869d-311c1b393377","resolution":{"observed_at":"2026-08-09T13:14:34.027501Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.06674","last_updated":"2023-12-07T19:40:50Z","snapshot_observed_at":"2026-07-06T17:00:00.321552Z","submitted_at":"2023-12-07T19:40:50Z","title":"Llama Guard: LLM-based Input-Output Safeguard for Human-AI Conversations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.06674","snapshot_observed_at":"2026-08-09T12:47:21.691851Z","title":"Llama guard: Llm-based input-output safeguard for human-ai conversations","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.02260","last_updated":"2026-06-02T17:48:48Z","snapshot_observed_at":"2026-08-09T12:42:57.704129Z","submitted_at":"2025-02-04T12:17:08Z","title":"Position: Adversarial ML for LLMs Is Not Making Any Progress","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-09T12:47:21.691851Z"},"links":{"cited_paper":"/paper/2312.06674","citing_paper":"/paper/2502.02260"},"observation_digest":"sha256:5769b76c9078ec79c5409cf571a58e1f67b5cd466cc8b9c13eecbe990d789238","observation_id":"26f6c5a6-02f1-4e9b-b6f2-3e021b82b634","resolution":{"observed_at":"2026-08-09T12:47:21.691851Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.06674","last_updated":"2023-12-07T19:40:50Z","snapshot_observed_at":"2026-07-06T17:00:00.321552Z","submitted_at":"2023-12-07T19:40:50Z","title":"Llama Guard: LLM-based Input-Output Safeguard for Human-AI Conversations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.06674","snapshot_observed_at":"2026-08-08T20:06:58.258918Z","title":"Llama guard: Llm-based input-output safeguard for human-ai conversations","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.05174","last_updated":"2025-06-10T18:13:09Z","snapshot_observed_at":"2026-08-08T19:58:38.598603Z","submitted_at":"2025-02-07T18:57:49Z","title":"MELON: Provable Defense Against Indirect Prompt Injection Attacks in AI Agents","version":4},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-08T20:06:58.258918Z"},"links":{"cited_paper":"/paper/2312.06674","citing_paper":"/paper/2502.05174"},"observation_digest":"sha256:c6f6a36c8c0c099cf0d0d957352a24015075d276ce0f4f9ad8e8354cdee3a7fb","observation_id":"6975a179-af4f-48af-95dc-e328b3791da9","resolution":{"observed_at":"2026-08-08T20:06:58.258918Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.06674","last_updated":"2023-12-07T19:40:50Z","snapshot_observed_at":"2026-07-06T17:00:00.321552Z","submitted_at":"2023-12-07T19:40:50Z","title":"Llama Guard: LLM-based Input-Output Safeguard for Human-AI Conversations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.06674","snapshot_observed_at":"2026-08-08T21:06:55.911523Z","title":"Llama guard: Llm-based input-output safeguard for human-ai conversations","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.05242","last_updated":"2026-05-27T09:11:42Z","snapshot_observed_at":"2026-08-08T20:58:31.381100Z","submitted_at":"2025-02-07T13:25:33Z","title":"Beyond External Monitors: Enhancing Transparency of Large Language Models for Easier Monitoring","version":3},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-08T21:06:55.911523Z"},"links":{"cited_paper":"/paper/2312.06674","citing_paper":"/paper/2502.05242"},"observation_digest":"sha256:8875b34bddd970e3e780715c4f74869d5b0ac740be7f877b497c6ef32489de6c","observation_id":"a4e41a44-f263-41ee-84a9-6447e16b6d3b","resolution":{"observed_at":"2026-08-08T21:06:55.911523Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.06674","last_updated":"2023-12-07T19:40:50Z","snapshot_observed_at":"2026-07-06T17:00:00.321552Z","submitted_at":"2023-12-07T19:40:50Z","title":"Llama Guard: LLM-based Input-Output Safeguard for Human-AI Conversations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.06674","snapshot_observed_at":"2026-08-08T14:24:50.338817Z","title":"Llama guard: Llm-based input-output safeguard for human-ai conversations, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.06776","last_updated":"2025-05-22T17:59:11Z","snapshot_observed_at":"2026-08-08T15:07:58.758525Z","submitted_at":"2025-02-10T18:54:05Z","title":"InSTA: Towards Internet-Scale Training For Agents","version":2},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-08T14:24:50.338817Z"},"links":{"cited_paper":"/paper/2312.06674","citing_paper":"/paper/2502.06776"},"observation_digest":"sha256:7d6bb2e6776cbb13e634c18eeb013140e561ac046409b4bce9cb1413888670ca","observation_id":"0ec5b2f6-a62a-446a-b3fa-fcddc1de3ada","resolution":{"observed_at":"2026-08-08T14:24:50.338817Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.06674","last_updated":"2023-12-07T19:40:50Z","snapshot_observed_at":"2026-07-06T17:00:00.321552Z","submitted_at":"2023-12-07T19:40:50Z","title":"Llama Guard: LLM-based Input-Output Safeguard for Human-AI Conversations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.06674","snapshot_observed_at":"2026-08-08T12:25:30.574357Z","title":"Llama guard: Llm-based input-output safeguard for human-ai conversations","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.07557","last_updated":"2025-02-11T13:50:50Z","snapshot_observed_at":"2026-08-09T03:24:13.351555Z","submitted_at":"2025-02-11T13:50:50Z","title":"JBShield: Defending Large Language Models from Jailbreak Attacks through Activated Concept Analysis and Manipulation","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-08T12:25:30.574357Z"},"links":{"cited_paper":"/paper/2312.06674","citing_paper":"/paper/2502.07557"},"observation_digest":"sha256:4ddbfe15109d1294153b40b90f6792df9d4a2352f54eb335fae69c285eb51545","observation_id":"a452f9e8-410d-4564-a5ab-a0db470e947b","resolution":{"observed_at":"2026-08-08T12:25:30.574357Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.06674","last_updated":"2023-12-07T19:40:50Z","snapshot_observed_at":"2026-07-06T17:00:00.321552Z","submitted_at":"2023-12-07T19:40:50Z","title":"Llama Guard: LLM-based Input-Output Safeguard for Human-AI Conversations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.06674","snapshot_observed_at":"2026-08-08T10:23:06.114397Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.08142","last_updated":"2025-02-12T05:48:57Z","snapshot_observed_at":"2026-08-09T00:12:26.816440Z","submitted_at":"2025-02-12T05:48:57Z","title":"Bridging the Safety Gap: A Guardrail Pipeline for Trustworthy LLM Inferences","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-08T10:23:06.114397Z"},"links":{"cited_paper":"/paper/2312.06674","citing_paper":"/paper/2502.08142"},"observation_digest":"sha256:36ba5e241ad29c5610427ee87898c16940c3698376ebcf27ce85050e7429f70f","observation_id":"e0efeb87-91b4-4b79-8353-b4eda5922f4c","resolution":{"observed_at":"2026-08-08T10:23:06.114397Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.06674","last_updated":"2023-12-07T19:40:50Z","snapshot_observed_at":"2026-07-06T17:00:00.321552Z","submitted_at":"2023-12-07T19:40:50Z","title":"Llama Guard: LLM-based Input-Output Safeguard for Human-AI Conversations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.06674","snapshot_observed_at":"2026-08-08T04:37:28.388533Z","title":"Llama guard: Llm- based input-output safeguard for human-ai conversations","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.08586","last_updated":"2025-02-12T17:19:36Z","snapshot_observed_at":"2026-08-08T23:24:16.398221Z","submitted_at":"2025-02-12T17:19:36Z","title":"Commercial LLM Agents Are Already Vulnerable to Simple Yet Dangerous Attacks","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-08T04:37:28.388533Z"},"links":{"cited_paper":"/paper/2312.06674","citing_paper":"/paper/2502.08586"},"observation_digest":"sha256:0ed00f9f28ff54bcee0c2d1a3c3c3c3207b0756452aa2149e7e8bab3306a1eb5","observation_id":"98431140-7e89-4d59-ab0a-9a96b91afff6","resolution":{"observed_at":"2026-08-08T04:37:28.388533Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.06674","last_updated":"2023-12-07T19:40:50Z","snapshot_observed_at":"2026-07-06T17:00:00.321552Z","submitted_at":"2023-12-07T19:40:50Z","title":"Llama Guard: LLM-based Input-Output Safeguard for Human-AI Conversations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.06674","snapshot_observed_at":"2026-08-07T23:08:02.269258Z","title":"Llama guard: Llm-based input-output safeguard for human-ai conversations","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.09674","last_updated":"2025-05-27T08:40:42Z","snapshot_observed_at":"2026-08-09T02:24:15.276351Z","submitted_at":"2025-02-13T06:39:22Z","title":"The Hidden Dimensions of LLM Alignment: A Multi-Dimensional Analysis of Orthogonal Safety Directions","version":4},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-07T23:08:02.269258Z"},"links":{"cited_paper":"/paper/2312.06674","citing_paper":"/paper/2502.09674"},"observation_digest":"sha256:5eaaaf21ede65567d589a6facf3f4bc98806831c43b2d04f78432db14ee3307c","observation_id":"23ca78a9-997c-4099-b4ae-02e4c3ff15ca","resolution":{"observed_at":"2026-08-07T23:08:02.269258Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.06674","last_updated":"2023-12-07T19:40:50Z","snapshot_observed_at":"2026-07-06T17:00:00.321552Z","submitted_at":"2023-12-07T19:40:50Z","title":"Llama Guard: LLM-based Input-Output Safeguard for Human-AI Conversations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.06674","snapshot_observed_at":"2026-08-07T19:45:20.013350Z","title":"Llama guard: Llm-based input-output safeguard for human-ai conversations,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.14881","last_updated":"2025-02-14T08:42:43Z","snapshot_observed_at":"2026-08-07T22:02:21.919237Z","submitted_at":"2025-02-14T08:42:43Z","title":"A Survey of Safety on Large Vision-Language Models: Attacks, Defenses and Evaluations","version":1},"reference_index":155,"source":"pdf_text","source_observed_at":"2026-08-07T19:45:20.013350Z"},"links":{"cited_paper":"/paper/2312.06674","citing_paper":"/paper/2502.14881"},"observation_digest":"sha256:608cad35943f89a2b19feb10fe7600d8d91e88b5d56601cb9b0ee465530bd8f8","observation_id":"c20642f4-1de5-4ced-adc1-0fe61786e329","resolution":{"observed_at":"2026-08-07T19:45:20.013350Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.06674","last_updated":"2023-12-07T19:40:50Z","snapshot_observed_at":"2026-07-06T17:00:00.321552Z","submitted_at":"2023-12-07T19:40:50Z","title":"Llama Guard: LLM-based Input-Output Safeguard for Human-AI Conversations","version":1},"cited_work":{"arxiv_id":"2312.06674","doi":"10.3390/info16050365","metadata_source":"pith","pith_arxiv_id":"2312.06674","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Llama Guard: LLM-based Input-Output Safeguard for Human-AI Conversations","venue":"cs.CL","work_id":"93844332-869b-448c-a1be-35466150b1b2","year":2023},"citing_paper":{"arxiv_id":"2502.16691","last_updated":"2026-05-16T22:13:25Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-23T19:12:10Z","title":"Responsible Federated LLMs via Safety Filtering and Constitutional AI","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-23T02:20:07.800524Z"},"links":{"cited_paper":"/paper/2312.06674","citing_paper":"/paper/2502.16691"},"observation_digest":"sha256:c42edab9baf553b8ccf85980e237e07c3a79ecf75d9824d96ab98b545a015b56","observation_id":"218d685e-3c0d-44e7-84ef-f5d0fec4d481","resolution":{"observed_at":"2026-05-23T02:22:25.232184Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.06674","last_updated":"2023-12-07T19:40:50Z","snapshot_observed_at":"2026-07-06T17:00:00.321552Z","submitted_at":"2023-12-07T19:40:50Z","title":"Llama Guard: LLM-based Input-Output Safeguard for Human-AI Conversations","version":1},"cited_work":{"arxiv_id":"2312.06674","doi":"10.3390/info16050365","metadata_source":"pith","pith_arxiv_id":"2312.06674","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Llama Guard: LLM-based Input-Output Safeguard for Human-AI Conversations","venue":"cs.CL","work_id":"93844332-869b-448c-a1be-35466150b1b2","year":2023},"citing_paper":{"arxiv_id":"2503.03480","last_updated":"2026-04-19T06:23:17Z","snapshot_observed_at":"2026-07-30T14:07:10.544745Z","submitted_at":"2025-03-05T13:16:55Z","title":"SafeVLA: Towards Safety Alignment of Vision-Language-Action Model via Constrained Learning","version":4},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-23T01:27:33.123243Z"},"links":{"cited_paper":"/paper/2312.06674","citing_paper":"/paper/2503.03480"},"observation_digest":"sha256:0ba5345e477977a948d678abb00ac73c52fd068b15c7f84b8c9dac7020fd0b0d","observation_id":"91e8a443-2ab7-4a2f-85d5-5e3a7e316920","resolution":{"observed_at":"2026-05-23T01:32:22.485463Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.06674","last_updated":"2023-12-07T19:40:50Z","snapshot_observed_at":"2026-07-06T17:00:00.321552Z","submitted_at":"2023-12-07T19:40:50Z","title":"Llama Guard: LLM-based Input-Output Safeguard for Human-AI Conversations","version":1},"cited_work":{"arxiv_id":"2312.06674","doi":"10.3390/info16050365","metadata_source":"pith","pith_arxiv_id":"2312.06674","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Llama Guard: LLM-based Input-Output Safeguard for Human-AI Conversations","venue":"cs.CL","work_id":"93844332-869b-448c-a1be-35466150b1b2","year":2023},"citing_paper":{"arxiv_id":"2503.19444","last_updated":"2026-04-30T03:28:28Z","snapshot_observed_at":"2026-07-06T20:58:14.950470Z","submitted_at":"2025-03-25T08:35:30Z","title":"AI Failures in the Eyes of the Downstream Developer: A First Look at Concerns, Practices, and Challenges","version":4},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-05-22T23:13:37.570261Z"},"links":{"cited_paper":"/paper/2312.06674","citing_paper":"/paper/2503.19444"},"observation_digest":"sha256:9ec91437935ad37c69551af336bc334b2f80cbda3df12cb14f287d6e88c2282b","observation_id":"b95f0903-988f-4d32-ad2b-3001027e94aa","resolution":{"observed_at":"2026-05-22T23:15:13.131026Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.06674","last_updated":"2023-12-07T19:40:50Z","snapshot_observed_at":"2026-07-06T17:00:00.321552Z","submitted_at":"2023-12-07T19:40:50Z","title":"Llama Guard: LLM-based Input-Output Safeguard for Human-AI Conversations","version":1},"cited_work":{"arxiv_id":"2312.06674","doi":"10.3390/info16050365","metadata_source":"pith","pith_arxiv_id":"2312.06674","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Llama Guard: LLM-based Input-Output Safeguard for Human-AI Conversations","venue":"cs.CL","work_id":"93844332-869b-448c-a1be-35466150b1b2","year":2023},"citing_paper":{"arxiv_id":"2504.00446","last_updated":"2026-04-05T08:03:35Z","snapshot_observed_at":"2026-08-08T22:42:49.839017Z","submitted_at":"2025-04-01T05:58:14Z","title":"Exposing the Ghost in the Transformer: Abnormal Detection for Large Language Models via Hidden State Forensics","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-05-22T22:27:18.533162Z"},"links":{"cited_paper":"/paper/2312.06674","citing_paper":"/paper/2504.00446"},"observation_digest":"sha256:87b2e19e447dfeb443369d1a20a8451f7818928b28076daa3069fba59d6d98d8","observation_id":"eab566b9-d1bb-45e1-ad28-c55fc678c3a2","resolution":{"observed_at":"2026-05-22T22:32:12.925336Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.06674","last_updated":"2023-12-07T19:40:50Z","snapshot_observed_at":"2026-07-06T17:00:00.321552Z","submitted_at":"2023-12-07T19:40:50Z","title":"Llama Guard: LLM-based Input-Output Safeguard for Human-AI Conversations","version":1},"cited_work":{"arxiv_id":"2312.06674","doi":"10.3390/info16050365","metadata_source":"pith","pith_arxiv_id":"2312.06674","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Llama Guard: LLM-based Input-Output Safeguard for Human-AI Conversations","venue":"cs.CL","work_id":"93844332-869b-448c-a1be-35466150b1b2","year":2023},"citing_paper":{"arxiv_id":"2504.11703","last_updated":"2026-05-14T02:36:38Z","snapshot_observed_at":"2026-07-06T21:10:09.129714Z","submitted_at":"2025-04-16T01:58:40Z","title":"Progent: Securing AI Agents with Privilege Control","version":3},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-22T21:09:51.782808Z"},"links":{"cited_paper":"/paper/2312.06674","citing_paper":"/paper/2504.11703"},"observation_digest":"sha256:3670752f53d3e6d6aa9ab66594049d0fc79632963bac8be747ec28be1609a491","observation_id":"59b5a60d-48a7-4428-9392-cbb269882575","resolution":{"observed_at":"2026-05-22T21:12:08.513942Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.06674","last_updated":"2023-12-07T19:40:50Z","snapshot_observed_at":"2026-07-06T17:00:00.321552Z","submitted_at":"2023-12-07T19:40:50Z","title":"Llama Guard: LLM-based Input-Output Safeguard for Human-AI Conversations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.06674","snapshot_observed_at":"2026-08-07T15:43:22.943099Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.14035","last_updated":"2025-05-20T07:31:17Z","snapshot_observed_at":"2026-08-10T02:31:04.491866Z","submitted_at":"2025-05-20T07:31:17Z","title":"ShieldVLM: Safeguarding the Multimodal Implicit Toxicity via Deliberative Reasoning with LVLMs","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T15:43:22.943099Z"},"links":{"cited_paper":"/paper/2312.06674","citing_paper":"/paper/2505.14035"},"observation_digest":"sha256:4b1e01e50649de7a606ddfffd2da425db368a1a54cb855ae87e6c08914bc0af2","observation_id":"1cccfa9b-1361-422b-be2c-5edeaf6d96aa","resolution":{"observed_at":"2026-08-07T15:43:22.943099Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.06674","last_updated":"2023-12-07T19:40:50Z","snapshot_observed_at":"2026-07-06T17:00:00.321552Z","submitted_at":"2023-12-07T19:40:50Z","title":"Llama Guard: LLM-based Input-Output Safeguard for Human-AI Conversations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.06674","snapshot_observed_at":"2026-08-07T15:15:18.261712Z","title":"Llama guard: Llm-based input-output safeguard for human-ai conversations","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.15710","last_updated":"2025-05-21T16:21:29Z","snapshot_observed_at":"2026-08-08T20:58:02.100576Z","submitted_at":"2025-05-21T16:21:29Z","title":"Advancing LLM Safe Alignment with Safety Representation Ranking","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T15:15:18.261712Z"},"links":{"cited_paper":"/paper/2312.06674","citing_paper":"/paper/2505.15710"},"observation_digest":"sha256:e03ace1adc6370cbc9e9f5581fcb47450ba0e7c49d314b40b5420d1f7f9cf764","observation_id":"b7270254-4aab-4948-9855-19b980d6df2c","resolution":{"observed_at":"2026-08-07T15:15:18.261712Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.06674","last_updated":"2023-12-07T19:40:50Z","snapshot_observed_at":"2026-07-06T17:00:00.321552Z","submitted_at":"2023-12-07T19:40:50Z","title":"Llama Guard: LLM-based Input-Output Safeguard for Human-AI Conversations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.06674","snapshot_observed_at":"2026-08-07T15:15:48.609882Z","title":"Llama guard: Llm-based input-output safeguard for human-ai conversations","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.15753","last_updated":"2025-05-21T16:58:14Z","snapshot_observed_at":"2026-08-07T15:09:59.174634Z","submitted_at":"2025-05-21T16:58:14Z","title":"Scalable Defense against In-the-wild Jailbreaking Attacks with Safety Context Retrieval","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T15:15:48.609882Z"},"links":{"cited_paper":"/paper/2312.06674","citing_paper":"/paper/2505.15753"},"observation_digest":"sha256:85f78a11532106c4a3b28619f4d4acb4c8c4d6fa9347499f7f6d1faf589be223","observation_id":"52d6f016-d02b-4072-953a-d445c93b68cd","resolution":{"observed_at":"2026-08-07T15:15:48.609882Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.06674","last_updated":"2023-12-07T19:40:50Z","snapshot_observed_at":"2026-07-06T17:00:00.321552Z","submitted_at":"2023-12-07T19:40:50Z","title":"Llama Guard: LLM-based Input-Output Safeguard for Human-AI Conversations","version":1},"cited_work":{"arxiv_id":"2312.06674","doi":"10.3390/info16050365","metadata_source":"pith","pith_arxiv_id":"2312.06674","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Llama Guard: LLM-based Input-Output Safeguard for Human-AI Conversations","venue":"cs.CL","work_id":"93844332-869b-448c-a1be-35466150b1b2","year":2023},"citing_paper":{"arxiv_id":"2505.16120","last_updated":"2026-05-04T12:54:07Z","snapshot_observed_at":"2026-08-02T10:48:03.601811Z","submitted_at":"2025-05-22T01:52:15Z","title":"LLM-Powered AI Agent Systems and Their Applications in Industry","version":2},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-05-22T14:05:54.535411Z"},"links":{"cited_paper":"/paper/2312.06674","citing_paper":"/paper/2505.16120"},"observation_digest":"sha256:a85aaea20f5139c17ef66629226f63e8c0881c7cbe9ef343d4b3ef1bab752547","observation_id":"f47dd509-f826-4bfd-91bd-15cb70df1707","resolution":{"observed_at":"2026-05-22T14:06:38.122153Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.06674","last_updated":"2023-12-07T19:40:50Z","snapshot_observed_at":"2026-07-06T17:00:00.321552Z","submitted_at":"2023-12-07T19:40:50Z","title":"Llama Guard: LLM-based Input-Output Safeguard for Human-AI Conversations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.06674","snapshot_observed_at":"2026-08-07T15:03:42.407078Z","title":"Llama guard: Llm-based input-output safeguard for human-ai conversations,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.16446","last_updated":"2025-05-22T09:34:47Z","snapshot_observed_at":"2026-08-09T10:27:17.806903Z","submitted_at":"2025-05-22T09:34:47Z","title":"Implicit Jailbreak Attacks via Cross-Modal Information Concealment on Vision-Language Models","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:42.407078Z"},"links":{"cited_paper":"/paper/2312.06674","citing_paper":"/paper/2505.16446"},"observation_digest":"sha256:24bf265d296472d5eb137511d0bc14abf9dd36d917209e9847110c004be74ed3","observation_id":"3d13f261-fc53-4db5-82a8-4d8512cc1b00","resolution":{"observed_at":"2026-08-07T15:03:42.407078Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.06674","last_updated":"2023-12-07T19:40:50Z","snapshot_observed_at":"2026-07-06T17:00:00.321552Z","submitted_at":"2023-12-07T19:40:50Z","title":"Llama Guard: LLM-based Input-Output Safeguard for Human-AI Conversations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.06674","snapshot_observed_at":"2026-08-07T15:03:01.507759Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.16526","last_updated":"2025-05-22T11:12:27Z","snapshot_observed_at":"2026-08-09T20:43:41.922108Z","submitted_at":"2025-05-22T11:12:27Z","title":"EnSToM: Enhancing Dialogue Systems with Entropy-Scaled Steering Vectors for Topic Maintenance","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-07T15:03:01.507759Z"},"links":{"cited_paper":"/paper/2312.06674","citing_paper":"/paper/2505.16526"},"observation_digest":"sha256:b60a3062bfe6bee30a4f0868e80a83a794cbf6148e084eea1edf107d18b8ef93","observation_id":"d68efde7-02c4-47b8-9d6d-7f4ab01dc51b","resolution":{"observed_at":"2026-08-07T15:03:01.507759Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.06674","last_updated":"2023-12-07T19:40:50Z","snapshot_observed_at":"2026-07-06T17:00:00.321552Z","submitted_at":"2023-12-07T19:40:50Z","title":"Llama Guard: LLM-based Input-Output Safeguard for Human-AI Conversations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.06674","snapshot_observed_at":"2026-08-07T15:07:01.235547Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.17145","last_updated":"2025-05-22T07:30:37Z","snapshot_observed_at":"2026-08-09T05:04:54.664879Z","submitted_at":"2025-05-22T07:30:37Z","title":"LLM Access Shield: Domain-Specific LLM Framework for Privacy Policy Compliance","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T15:07:01.235547Z"},"links":{"cited_paper":"/paper/2312.06674","citing_paper":"/paper/2505.17145"},"observation_digest":"sha256:7cc4dd0e51b1e0fb608dd77332e69d691584d78467b60c952a247a03327baf25","observation_id":"44a28b61-7ba4-4a60-89e4-b959bba1cbc3","resolution":{"observed_at":"2026-08-07T15:07:01.235547Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.06674","last_updated":"2023-12-07T19:40:50Z","snapshot_observed_at":"2026-07-06T17:00:00.321552Z","submitted_at":"2023-12-07T19:40:50Z","title":"Llama Guard: LLM-based Input-Output Safeguard for Human-AI Conversations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.06674","snapshot_observed_at":"2026-08-07T15:09:58.418462Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.17147","last_updated":"2025-05-22T08:22:57Z","snapshot_observed_at":"2026-08-08T03:05:46.469319Z","submitted_at":"2025-05-22T08:22:57Z","title":"MTSA: Multi-turn Safety Alignment for LLMs through Multi-round Red-teaming","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-07T15:09:58.418462Z"},"links":{"cited_paper":"/paper/2312.06674","citing_paper":"/paper/2505.17147"},"observation_digest":"sha256:a433574dad00f61b1e506a0ada1c0badee76ae275224c170b88d6b4b2715d8cc","observation_id":"6f894b69-d7be-4710-a0a9-f5fe74358a9c","resolution":{"observed_at":"2026-08-07T15:09:58.418462Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.06674","last_updated":"2023-12-07T19:40:50Z","snapshot_observed_at":"2026-07-06T17:00:00.321552Z","submitted_at":"2023-12-07T19:40:50Z","title":"Llama Guard: LLM-based Input-Output Safeguard for Human-AI Conversations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.06674","snapshot_observed_at":"2026-08-07T14:53:08.031018Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.17207","last_updated":"2025-05-22T18:32:39Z","snapshot_observed_at":"2026-08-09T08:52:18.980303Z","submitted_at":"2025-05-22T18:32:39Z","title":"Content Moderation in TV Search: Balancing Policy Compliance, Relevance, and User Experience","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T14:53:08.031018Z"},"links":{"cited_paper":"/paper/2312.06674","citing_paper":"/paper/2505.17207"},"observation_digest":"sha256:c12231da35a3c4eb5178a964288addc4dbb9e63446e2d3b5988cd6d1cfb05162","observation_id":"cf682473-c924-4060-b14b-99535db4bba4","resolution":{"observed_at":"2026-08-07T14:53:08.031018Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.06674","last_updated":"2023-12-07T19:40:50Z","snapshot_observed_at":"2026-07-06T17:00:00.321552Z","submitted_at":"2023-12-07T19:40:50Z","title":"Llama Guard: LLM-based Input-Output Safeguard for Human-AI Conversations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.06674","snapshot_observed_at":"2026-08-07T14:50:10.176461Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.18215","last_updated":"2025-05-23T05:46:42Z","snapshot_observed_at":"2026-08-09T16:52:11.863188Z","submitted_at":"2025-05-23T05:46:42Z","title":"Do BERT-Like Bidirectional Models Still Perform Better on Text Classification in the Era of LLMs?","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-07T14:50:10.176461Z"},"links":{"cited_paper":"/paper/2312.06674","citing_paper":"/paper/2505.18215"},"observation_digest":"sha256:2aa3c25e08e951ae8e22f5d5da524bf62199bfb6d6ee6063916039801f142bc0","observation_id":"e1a5f60f-da92-4416-b5b0-7a6f08b3ef81","resolution":{"observed_at":"2026-08-07T14:50:10.176461Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.06674","last_updated":"2023-12-07T19:40:50Z","snapshot_observed_at":"2026-07-06T17:00:00.321552Z","submitted_at":"2023-12-07T19:40:50Z","title":"Llama Guard: LLM-based Input-Output Safeguard for Human-AI Conversations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.06674","snapshot_observed_at":"2026-08-07T14:30:08.405155Z","title":"Llama guard: Llm-based input-output safeguard for human-ai conversations","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.18807","last_updated":"2025-05-24T17:41:47Z","snapshot_observed_at":"2026-08-08T01:20:21.986624Z","submitted_at":"2025-05-24T17:41:47Z","title":"Mitigating Deceptive Alignment via Self-Monitoring","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-07T14:30:08.405155Z"},"links":{"cited_paper":"/paper/2312.06674","citing_paper":"/paper/2505.18807"},"observation_digest":"sha256:5f508d050cd6a8f62937d0dc8f24055a1c988a215a9c0a28611ad440d2935532","observation_id":"533de5ff-de66-4a20-bafc-ba2d1bba421f","resolution":{"observed_at":"2026-08-07T14:30:08.405155Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.06674","last_updated":"2023-12-07T19:40:50Z","snapshot_observed_at":"2026-07-06T17:00:00.321552Z","submitted_at":"2023-12-07T19:40:50Z","title":"Llama Guard: LLM-based Input-Output Safeguard for Human-AI Conversations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.06674","snapshot_observed_at":"2026-08-07T14:27:03.510563Z","title":"Llama guard: Llm-based input-output safeguard for human-ai conversations","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.18889","last_updated":"2025-08-24T03:15:13Z","snapshot_observed_at":"2026-08-08T20:47:09.765405Z","submitted_at":"2025-05-24T22:22:43Z","title":"Security Concerns for Large Language Models: A Survey","version":5},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T14:27:03.510563Z"},"links":{"cited_paper":"/paper/2312.06674","citing_paper":"/paper/2505.18889"},"observation_digest":"sha256:23c3a6d0941b080254e49beb6c7973f26a91831e66e6dedcc5aa5c2d8a5ce408","observation_id":"a94f58ae-8610-4a7f-b05b-0dd5f644d0a1","resolution":{"observed_at":"2026-08-07T14:27:03.510563Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.06674","last_updated":"2023-12-07T19:40:50Z","snapshot_observed_at":"2026-07-06T17:00:00.321552Z","submitted_at":"2023-12-07T19:40:50Z","title":"Llama Guard: LLM-based Input-Output Safeguard for Human-AI Conversations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.06674","snapshot_observed_at":"2026-08-07T14:13:17.802792Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.19684","last_updated":"2025-05-28T15:29:46Z","snapshot_observed_at":"2026-08-08T22:09:14.960254Z","submitted_at":"2025-05-26T08:45:06Z","title":"VisCRA: A Visual Chain Reasoning Attack for Jailbreaking Multimodal Large Language Models","version":2},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-07T14:13:17.802792Z"},"links":{"cited_paper":"/paper/2312.06674","citing_paper":"/paper/2505.19684"},"observation_digest":"sha256:3e4694e8897248ef13394a2db036ac4f3f7305dcce62b0730fdc2bb592008a11","observation_id":"cd501efa-f61b-4fbe-bb0f-4f56f228df20","resolution":{"observed_at":"2026-08-07T14:13:17.802792Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.06674","last_updated":"2023-12-07T19:40:50Z","snapshot_observed_at":"2026-07-06T17:00:00.321552Z","submitted_at":"2023-12-07T19:40:50Z","title":"Llama Guard: LLM-based Input-Output Safeguard for Human-AI Conversations","version":1},"cited_work":{"arxiv_id":"2312.06674","doi":"10.3390/info16050365","metadata_source":"pith","pith_arxiv_id":"2312.06674","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Llama Guard: LLM-based Input-Output Safeguard for Human-AI Conversations","venue":"cs.CL","work_id":"93844332-869b-448c-a1be-35466150b1b2","year":2023},"citing_paper":{"arxiv_id":"2506.00166","last_updated":"2026-04-30T20:54:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-30T19:11:52Z","title":"Disentangled Safety Adapters Enable Efficient Guardrails and Flexible Inference-Time Alignment","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-19T11:52:36.688263Z"},"links":{"cited_paper":"/paper/2312.06674","citing_paper":"/paper/2506.00166"},"observation_digest":"sha256:7f69fbb2946fab02889739571bbd59e6a516755a7af4eefdbcb0534efd1f6be4","observation_id":"acab8d73-6746-4415-b487-bc4857ac4fc4","resolution":{"observed_at":"2026-05-19T11:53:03.593930Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.06674","last_updated":"2023-12-07T19:40:50Z","snapshot_observed_at":"2026-07-06T17:00:00.321552Z","submitted_at":"2023-12-07T19:40:50Z","title":"Llama Guard: LLM-based Input-Output Safeguard for Human-AI Conversations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.06674","snapshot_observed_at":"2026-08-07T12:07:59.394540Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.00548","last_updated":"2025-05-31T13:11:14Z","snapshot_observed_at":"2026-08-08T10:05:29.642578Z","submitted_at":"2025-05-31T13:11:14Z","title":"Con Instruction: Universal Jailbreaking of Multimodal Large Language Models via Non-Textual Modalities","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-07T12:07:59.394540Z"},"links":{"cited_paper":"/paper/2312.06674","citing_paper":"/paper/2506.00548"},"observation_digest":"sha256:f9014367a9bfa27d5f5c727cad31dff14cace1b1a8dff3e708635db256b87f4e","observation_id":"3bf6bcac-375c-47b1-a898-025e275b64d8","resolution":{"observed_at":"2026-08-07T12:07:59.394540Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.06674","last_updated":"2023-12-07T19:40:50Z","snapshot_observed_at":"2026-07-06T17:00:00.321552Z","submitted_at":"2023-12-07T19:40:50Z","title":"Llama Guard: LLM-based Input-Output Safeguard for Human-AI Conversations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.06674","snapshot_observed_at":"2026-08-07T12:02:34.771964Z","title":"Llama guard: Llm-based input-output safeguard for human-ai conversations","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.00676","last_updated":"2025-05-31T19:00:58Z","snapshot_observed_at":"2026-08-10T01:15:57.142226Z","submitted_at":"2025-05-31T19:00:58Z","title":"SafeTuneBed: A Toolkit for Benchmarking LLM Safety Alignment in Fine-Tuning","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T12:02:34.771964Z"},"links":{"cited_paper":"/paper/2312.06674","citing_paper":"/paper/2506.00676"},"observation_digest":"sha256:50e12bab8cf23a26f6bf69f9d39466559825b06722ba6dd167eae8c5e04c3a4c","observation_id":"0a34b9a9-a42a-4873-81c9-41aee11e8d93","resolution":{"observed_at":"2026-08-07T12:02:34.771964Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.06674","last_updated":"2023-12-07T19:40:50Z","snapshot_observed_at":"2026-07-06T17:00:00.321552Z","submitted_at":"2023-12-07T19:40:50Z","title":"Llama Guard: LLM-based Input-Output Safeguard for Human-AI Conversations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.06674","snapshot_observed_at":"2026-08-07T11:59:23.191027Z","title":"Llama guard: Llm-based input-output safeguard for human-ai conversations","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.01055","last_updated":"2025-06-01T15:48:06Z","snapshot_observed_at":"2026-08-09T00:34:14.908419Z","submitted_at":"2025-06-01T15:48:06Z","title":"Simple Prompt Injection Attacks Can Leak Personal Data Observed by LLM Agents During Task Execution","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T11:59:23.191027Z"},"links":{"cited_paper":"/paper/2312.06674","citing_paper":"/paper/2506.01055"},"observation_digest":"sha256:5595763dc61d6d1b4fc607212cae2280334ae08e235e61db668a34276c31263b","observation_id":"9949848e-882c-4c87-ae21-d591081d1305","resolution":{"observed_at":"2026-08-07T11:59:23.191027Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.06674","last_updated":"2023-12-07T19:40:50Z","snapshot_observed_at":"2026-07-06T17:00:00.321552Z","submitted_at":"2023-12-07T19:40:50Z","title":"Llama Guard: LLM-based Input-Output Safeguard for Human-AI Conversations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.06674","snapshot_observed_at":"2026-08-07T11:29:13.320214Z","title":"Llama Guard: LLM-based input-output safeguard for human-AI conversations, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.02372","last_updated":"2025-06-03T02:18:59Z","snapshot_observed_at":"2026-08-07T23:16:46.716621Z","submitted_at":"2025-06-03T02:18:59Z","title":"AnswerCarefully: A Dataset for Improving the Safety of Japanese LLM Output","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T11:29:13.320214Z"},"links":{"cited_paper":"/paper/2312.06674","citing_paper":"/paper/2506.02372"},"observation_digest":"sha256:38073e04aac0cc6eec42a01d1477edbc27c84a1d00c0a33f8c8ad0cd84b15480","observation_id":"312bed32-3c6c-4f5a-a6d9-bba5dc19d8e0","resolution":{"observed_at":"2026-08-07T11:29:13.320214Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.06674","last_updated":"2023-12-07T19:40:50Z","snapshot_observed_at":"2026-07-06T17:00:00.321552Z","submitted_at":"2023-12-07T19:40:50Z","title":"Llama Guard: LLM-based Input-Output Safeguard for Human-AI Conversations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.06674","snapshot_observed_at":"2026-08-07T11:27:47.280600Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.02442","last_updated":"2025-06-04T05:56:40Z","snapshot_observed_at":"2026-08-09T10:09:11.768287Z","submitted_at":"2025-06-03T05:00:12Z","title":"Should LLM Safety Be More Than Refusing Harmful Instructions?","version":2},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-07T11:27:47.280600Z"},"links":{"cited_paper":"/paper/2312.06674","citing_paper":"/paper/2506.02442"},"observation_digest":"sha256:022a8f486d657a0567fc755c4d6f0c899bfc000bb0cb988ef252a52e6200f82f","observation_id":"88b28cec-7931-4bd0-ab13-fd3bf806ad74","resolution":{"observed_at":"2026-08-07T11:27:47.280600Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.06674","last_updated":"2023-12-07T19:40:50Z","snapshot_observed_at":"2026-07-06T17:00:00.321552Z","submitted_at":"2023-12-07T19:40:50Z","title":"Llama Guard: LLM-based Input-Output Safeguard for Human-AI Conversations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.06674","snapshot_observed_at":"2026-08-07T10:45:02.982826Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.04482","last_updated":"2025-06-04T22:01:31Z","snapshot_observed_at":"2026-08-09T22:40:13.919485Z","submitted_at":"2025-06-04T22:01:31Z","title":"Understanding and Meeting Practitioner Needs When Measuring Representational Harms Caused by LLM-Based Systems","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-07T10:45:02.982826Z"},"links":{"cited_paper":"/paper/2312.06674","citing_paper":"/paper/2506.04482"},"observation_digest":"sha256:58ce9017d6cd673bed7363e4a838b7c660e3c7e40e80620e15e177a3f64624d9","observation_id":"88d8b3d7-9188-4a13-9f55-20c4d875c63c","resolution":{"observed_at":"2026-08-07T10:45:02.982826Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.06674","last_updated":"2023-12-07T19:40:50Z","snapshot_observed_at":"2026-07-06T17:00:00.321552Z","submitted_at":"2023-12-07T19:40:50Z","title":"Llama Guard: LLM-based Input-Output Safeguard for Human-AI Conversations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.06674","snapshot_observed_at":"2026-08-07T12:11:19.827281Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.05376","last_updated":"2025-06-09T05:48:22Z","snapshot_observed_at":"2026-08-10T02:41:13.540113Z","submitted_at":"2025-05-30T22:58:54Z","title":"A Red Teaming Roadmap Towards System-Level Safety","version":2},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-07T12:11:19.827281Z"},"links":{"cited_paper":"/paper/2312.06674","citing_paper":"/paper/2506.05376"},"observation_digest":"sha256:97fcdd728d355c33aed979534712c3d2121599f1f4c7421b8f8716405f87c9c1","observation_id":"3ea8fead-5ff6-4fb7-9de4-da9df154c32d","resolution":{"observed_at":"2026-08-07T12:11:19.827281Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.06674","last_updated":"2023-12-07T19:40:50Z","snapshot_observed_at":"2026-07-06T17:00:00.321552Z","submitted_at":"2023-12-07T19:40:50Z","title":"Llama Guard: LLM-based Input-Output Safeguard for Human-AI Conversations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.06674","snapshot_observed_at":"2026-08-07T10:28:55.100445Z","title":"Inan et al., ‘Llama Guard: LLM- based Input-Output Safeguard for Human-AI Conversations’, 2023, doi: 10.48550/arXiv.2312.06674","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.06391","last_updated":"2025-06-05T16:53:29Z","snapshot_observed_at":"2026-08-08T01:20:47.850082Z","submitted_at":"2025-06-05T16:53:29Z","title":"From Rogue to Safe AI: The Role of Explicit Refusals in Aligning LLMs with International Humanitarian Law","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T10:28:55.100445Z"},"links":{"cited_paper":"/paper/2312.06674","citing_paper":"/paper/2506.06391"},"observation_digest":"sha256:cfacdb182c30d7a9d8c89d17726bc42b98fcdca4d41998ea70d2e972597c5f29","observation_id":"ea34ee52-42ec-4c1e-ae5d-96a5e1f37298","resolution":{"observed_at":"2026-08-07T10:28:55.100445Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.06674","last_updated":"2023-12-07T19:40:50Z","snapshot_observed_at":"2026-07-06T17:00:00.321552Z","submitted_at":"2023-12-07T19:40:50Z","title":"Llama Guard: LLM-based Input-Output Safeguard for Human-AI Conversations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.06674","snapshot_observed_at":"2026-08-07T05:47:06.331292Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.07121","last_updated":"2026-08-01T10:21:24Z","snapshot_observed_at":"2026-08-08T16:50:44.576571Z","submitted_at":"2025-06-08T13:07:41Z","title":"Quality-Diversity Red-Teaming: Automated Generation of High-Quality and Diverse Attackers for Large Language Models","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T05:47:06.331292Z"},"links":{"cited_paper":"/paper/2312.06674","citing_paper":"/paper/2506.07121"},"observation_digest":"sha256:d9ca4a6094087ae3fca1f2596586dd8b9cc080bb1e86e922e3f41a8dbdded279","observation_id":"ff8c9001-6c80-4574-b97e-7e4483d26373","resolution":{"observed_at":"2026-08-07T05:47:06.331292Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.06674","last_updated":"2023-12-07T19:40:50Z","snapshot_observed_at":"2026-07-06T17:00:00.321552Z","submitted_at":"2023-12-07T19:40:50Z","title":"Llama Guard: LLM-based Input-Output Safeguard for Human-AI Conversations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.06674","snapshot_observed_at":"2026-08-07T05:41:25.411365Z","title":"Llama guard: Llm-based input-output safeguard for human-ai conversations, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.07330","last_updated":"2025-06-09T00:11:06Z","snapshot_observed_at":"2026-08-08T01:51:03.511040Z","submitted_at":"2025-06-09T00:11:06Z","title":"JavelinGuard: Low-Cost Transformer Architectures for LLM Security","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-07T05:41:25.411365Z"},"links":{"cited_paper":"/paper/2312.06674","citing_paper":"/paper/2506.07330"},"observation_digest":"sha256:7baf8e1175c7ed8537c9207bc035ae277d06660cf1c78b4b896e6ed926e1fe22","observation_id":"9bb5367b-8781-4928-bfc9-7a99b2465ab7","resolution":{"observed_at":"2026-08-07T05:41:25.411365Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.06674","last_updated":"2023-12-07T19:40:50Z","snapshot_observed_at":"2026-07-06T17:00:00.321552Z","submitted_at":"2023-12-07T19:40:50Z","title":"Llama Guard: LLM-based Input-Output Safeguard for Human-AI Conversations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.06674","snapshot_observed_at":"2026-08-07T10:17:26.886326Z","title":"Llama guard: Llm-based input-output safeguard for human-ai conversations,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.11094","last_updated":"2025-10-30T06:22:33Z","snapshot_observed_at":"2026-08-07T10:11:06.747781Z","submitted_at":"2025-06-06T05:50:50Z","title":"The Scales of Justitia: A Comprehensive Survey on Safety Evaluation of LLMs","version":2},"reference_index":97,"source":"pdf_text","source_observed_at":"2026-08-07T10:17:26.886326Z"},"links":{"cited_paper":"/paper/2312.06674","citing_paper":"/paper/2506.11094"},"observation_digest":"sha256:7b222b043f0bbc257afc04207b60d14f39330b8fda9999614b058989ee986498","observation_id":"424edd04-e787-49a4-8572-4b0d520bdb7d","resolution":{"observed_at":"2026-08-07T10:17:26.886326Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.06674","last_updated":"2023-12-07T19:40:50Z","snapshot_observed_at":"2026-07-06T17:00:00.321552Z","submitted_at":"2023-12-07T19:40:50Z","title":"Llama Guard: LLM-based Input-Output Safeguard for Human-AI Conversations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.06674","snapshot_observed_at":"2026-08-07T00:41:51.256225Z","title":"Llama guard: Llm- based input-output safeguard for human-ai conversations","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.12992","last_updated":"2025-06-15T23:20:08Z","snapshot_observed_at":"2026-08-07T00:35:03.776740Z","submitted_at":"2025-06-15T23:20:08Z","title":"SmartHome-Bench: A Comprehensive Benchmark for Video Anomaly Detection in Smart Homes Using Multi-Modal Large Language Models","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T00:41:51.256225Z"},"links":{"cited_paper":"/paper/2312.06674","citing_paper":"/paper/2506.12992"},"observation_digest":"sha256:cafe4d00a528548c6b359c372693bda0e31f94d1fb67a8e14b7a518ec604567d","observation_id":"45db551d-7a63-4765-a360-9c5e1771aa46","resolution":{"observed_at":"2026-08-07T00:41:51.256225Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.06674","last_updated":"2023-12-07T19:40:50Z","snapshot_observed_at":"2026-07-06T17:00:00.321552Z","submitted_at":"2023-12-07T19:40:50Z","title":"Llama Guard: LLM-based Input-Output Safeguard for Human-AI Conversations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.06674","snapshot_observed_at":"2026-08-07T00:32:36.550081Z","title":"Llama guard: Llm-based input-output safeguard for human-ai conversations.CoRR, abs/2312.06674, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.13666","last_updated":"2025-06-16T16:24:31Z","snapshot_observed_at":"2026-08-07T00:25:36.770856Z","submitted_at":"2025-06-16T16:24:31Z","title":"We Should Identify and Mitigate Third-Party Safety Risks in MCP-Powered Agent Systems","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T00:32:36.550081Z"},"links":{"cited_paper":"/paper/2312.06674","citing_paper":"/paper/2506.13666"},"observation_digest":"sha256:677fb21e0c2baa653a597ffeba265b58d43d11b971c5734226c36dd2aea69443","observation_id":"427cf786-071f-45a2-b516-8bde402013dc","resolution":{"observed_at":"2026-08-07T00:32:36.550081Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.06674","last_updated":"2023-12-07T19:40:50Z","snapshot_observed_at":"2026-07-06T17:00:00.321552Z","submitted_at":"2023-12-07T19:40:50Z","title":"Llama Guard: LLM-based Input-Output Safeguard for Human-AI Conversations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.06674","snapshot_observed_at":"2026-08-07T00:27:19.609985Z","title":"Llama guard: Llm-based input-output safeguard for human-ai conversations","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.14018","last_updated":"2025-06-16T21:30:42Z","snapshot_observed_at":"2026-08-08T14:20:33.436519Z","submitted_at":"2025-06-16T21:30:42Z","title":"\"I Cannot Write This Because It Violates Our Content Policy\": Understanding Content Moderation Policies and User Experiences in Generative AI Products","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T00:27:19.609985Z"},"links":{"cited_paper":"/paper/2312.06674","citing_paper":"/paper/2506.14018"},"observation_digest":"sha256:4b5db80b637800c6aae2110a8f8c0b6dee13dc53ae7699c6b1954a9f564f9f64","observation_id":"855553a9-f7f4-4bf5-a382-1af3ac415157","resolution":{"observed_at":"2026-08-07T00:27:19.609985Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.06674","last_updated":"2023-12-07T19:40:50Z","snapshot_observed_at":"2026-07-06T17:00:00.321552Z","submitted_at":"2023-12-07T19:40:50Z","title":"Llama Guard: LLM-based Input-Output Safeguard for Human-AI Conversations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.06674","snapshot_observed_at":"2026-08-06T23:49:53.313221Z","title":"arXiv preprint arXiv:2312.06674","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.16322","last_updated":"2025-06-19T13:56:41Z","snapshot_observed_at":"2026-08-07T20:46:18.050527Z","submitted_at":"2025-06-19T13:56:41Z","title":"PL-Guard: Benchmarking Language Model Safety for Polish","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T23:49:53.313221Z"},"links":{"cited_paper":"/paper/2312.06674","citing_paper":"/paper/2506.16322"},"observation_digest":"sha256:09a92fe23629ef4b4aa68e4698d1cf2ec91b1da26827e0c5f24fd6a9640343b5","observation_id":"1683a507-e3d5-4e7f-b7a0-19a007254198","resolution":{"observed_at":"2026-08-06T23:49:53.313221Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.06674","last_updated":"2023-12-07T19:40:50Z","snapshot_observed_at":"2026-07-06T17:00:00.321552Z","submitted_at":"2023-12-07T19:40:50Z","title":"Llama Guard: LLM-based Input-Output Safeguard for Human-AI Conversations","version":1},"cited_work":{"arxiv_id":"2312.06674","doi":"10.3390/info16050365","metadata_source":"pith","pith_arxiv_id":"2312.06674","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Llama Guard: LLM-based Input-Output Safeguard for Human-AI Conversations","venue":"cs.CL","work_id":"93844332-869b-448c-a1be-35466150b1b2","year":2023},"citing_paper":{"arxiv_id":"2506.17299","last_updated":"2026-04-24T04:36:54Z","snapshot_observed_at":"2026-08-02T14:45:34.223522Z","submitted_at":"2025-06-17T20:37:29Z","title":"Toward Principled LLM Safety Testing: Solving the Jailbreak Oracle Problem","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-19T08:40:56.186349Z"},"links":{"cited_paper":"/paper/2312.06674","citing_paper":"/paper/2506.17299"},"observation_digest":"sha256:fbde67508b6135ae90e8e589aee22814a755e913276a78735d7ebd642dcc09b0","observation_id":"f9e31c90-214d-4919-8250-b2362123671b","resolution":{"observed_at":"2026-05-19T08:42:12.850642Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.06674","last_updated":"2023-12-07T19:40:50Z","snapshot_observed_at":"2026-07-06T17:00:00.321552Z","submitted_at":"2023-12-07T19:40:50Z","title":"Llama Guard: LLM-based Input-Output Safeguard for Human-AI Conversations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.06674","snapshot_observed_at":"2026-08-06T22:44:44.066010Z","title":"Llama guard: Llm-based input-output safeguard for human-ai conver- sations.arXiv preprint arXiv:2312.06674, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.20917","last_updated":"2025-06-26T00:49:35Z","snapshot_observed_at":"2026-08-07T05:17:23.851973Z","submitted_at":"2025-06-26T00:49:35Z","title":"Optimising Language Models for Downstream Tasks: A Post-Training Perspective","version":1},"reference_index":94,"source":"pdf_text","source_observed_at":"2026-08-06T22:44:44.066010Z"},"links":{"cited_paper":"/paper/2312.06674","citing_paper":"/paper/2506.20917"},"observation_digest":"sha256:d903d348493ffee33c72fb39e2feadaebd19751ca4018f0b2754f8ad09c6b462","observation_id":"8bb9cdef-5d9f-4a89-bffc-0f18e730a2b8","resolution":{"observed_at":"2026-08-06T22:44:44.066010Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.06674","last_updated":"2023-12-07T19:40:50Z","snapshot_observed_at":"2026-07-06T17:00:00.321552Z","submitted_at":"2023-12-07T19:40:50Z","title":"Llama Guard: LLM-based Input-Output Safeguard for Human-AI Conversations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.06674","snapshot_observed_at":"2026-08-06T22:07:03.267607Z","title":"Llama guard: Llm-based input-output safeguard for human-ai conversations.arXiv preprint arXiv:2312.06674, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.22666","last_updated":"2026-05-30T16:23:21Z","snapshot_observed_at":"2026-08-06T21:58:37.734178Z","submitted_at":"2025-06-27T22:22:00Z","title":"VERA: Variational Inference Framework for Jailbreaking Large Language Models","version":3},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T22:07:03.267607Z"},"links":{"cited_paper":"/paper/2312.06674","citing_paper":"/paper/2506.22666"},"observation_digest":"sha256:66b6012aa43e26e27046a913cad09c8a910eb6bbca2e89388ad79343f6fb9af6","observation_id":"47456cfa-c3cc-4b83-a3f7-3921fdbc22c4","resolution":{"observed_at":"2026-08-06T22:07:03.267607Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.06674","last_updated":"2023-12-07T19:40:50Z","snapshot_observed_at":"2026-07-06T17:00:00.321552Z","submitted_at":"2023-12-07T19:40:50Z","title":"Llama Guard: LLM-based Input-Output Safeguard for Human-AI Conversations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.06674","snapshot_observed_at":"2026-08-06T21:10:04.541993Z","title":"Llama guard: Llm-based input-output safeguard for human-ai conversations","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.00829","last_updated":"2025-07-01T15:01:18Z","snapshot_observed_at":"2026-08-08T03:47:45.535102Z","submitted_at":"2025-07-01T15:01:18Z","title":"On the Surprising Efficacy of LLMs for Penetration-Testing","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-06T21:10:04.541993Z"},"links":{"cited_paper":"/paper/2312.06674","citing_paper":"/paper/2507.00829"},"observation_digest":"sha256:12a2c1b9746d3060a3831e5940dce25bdbac0e3f761fd872a9e6bbce0fa9db95","observation_id":"934cfb72-d162-4124-9093-7f5d8f904889","resolution":{"observed_at":"2026-08-06T21:10:04.541993Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.06674","last_updated":"2023-12-07T19:40:50Z","snapshot_observed_at":"2026-07-06T17:00:00.321552Z","submitted_at":"2023-12-07T19:40:50Z","title":"Llama Guard: LLM-based Input-Output Safeguard for Human-AI Conversations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.06674","snapshot_observed_at":"2026-08-06T21:05:27.679677Z","title":"Cognitive Neuroscience of Attention and Memory Dynamics","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.01081","last_updated":"2025-07-01T17:59:01Z","snapshot_observed_at":"2026-08-08T13:11:53.651874Z","submitted_at":"2025-07-01T17:59:01Z","title":"AI-guided digital intervention with physiological monitoring reduces intrusive memories after experimental trauma","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-06T21:05:27.679677Z"},"links":{"cited_paper":"/paper/2312.06674","citing_paper":"/paper/2507.01081"},"observation_digest":"sha256:fd8a7de72faad2ce3e8f7d44398c78583286f1660f5bfb4ea2be301225f8b0e6","observation_id":"52dcb26a-0105-4bc9-ab25-c05e1c2d69d7","resolution":{"observed_at":"2026-08-06T21:05:27.679677Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.06674","last_updated":"2023-12-07T19:40:50Z","snapshot_observed_at":"2026-07-06T17:00:00.321552Z","submitted_at":"2023-12-07T19:40:50Z","title":"Llama Guard: LLM-based Input-Output Safeguard for Human-AI Conversations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.06674","snapshot_observed_at":"2026-08-06T20:45:53.281864Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.02057","last_updated":"2025-07-02T18:00:49Z","snapshot_observed_at":"2026-08-09T00:37:18.838001Z","submitted_at":"2025-07-02T18:00:49Z","title":"MGC: A Compiler Framework Exploiting Compositional Blindness in Aligned LLMs for Malware Generation","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T20:45:53.281864Z"},"links":{"cited_paper":"/paper/2312.06674","citing_paper":"/paper/2507.02057"},"observation_digest":"sha256:32075885f44371bfe5ea2b2ce787080d38d82cae974873f9fa5f00f53f4911a7","observation_id":"abbb5f1d-fe91-4e0b-b262-650f9a19e1a3","resolution":{"observed_at":"2026-08-06T20:45:53.281864Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.06674","last_updated":"2023-12-07T19:40:50Z","snapshot_observed_at":"2026-07-06T17:00:00.321552Z","submitted_at":"2023-12-07T19:40:50Z","title":"Llama Guard: LLM-based Input-Output Safeguard for Human-AI Conversations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.06674","snapshot_observed_at":"2026-08-06T21:16:26.838437Z","title":"Llama guard: Llm-based input-output safeguard for human-ai conversations","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.02986","last_updated":"2025-07-08T15:44:49Z","snapshot_observed_at":"2026-08-10T09:25:52.252922Z","submitted_at":"2025-07-01T10:01:21Z","title":"GAF-Guard: An Agentic Framework for Risk Management and Governance in Large Language Models","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T21:16:26.838437Z"},"links":{"cited_paper":"/paper/2312.06674","citing_paper":"/paper/2507.02986"},"observation_digest":"sha256:6ee80f1b4b11c0d17686c0b15d33f58d1b7fbdaa804d9a82df11e53188298e45","observation_id":"7353ff7f-513f-4b87-80c8-4a7f4116fc1d","resolution":{"observed_at":"2026-08-06T21:16:26.838437Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.06674","last_updated":"2023-12-07T19:40:50Z","snapshot_observed_at":"2026-07-06T17:00:00.321552Z","submitted_at":"2023-12-07T19:40:50Z","title":"Llama Guard: LLM-based Input-Output Safeguard for Human-AI Conversations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.06674","snapshot_observed_at":"2026-08-06T19:31:00.841084Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.05455","last_updated":"2025-07-09T02:57:34Z","snapshot_observed_at":"2026-08-08T15:32:57.202249Z","submitted_at":"2025-07-07T20:15:18Z","title":"ModelCitizens: Representing Community Voices in Online Safety","version":2},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-06T19:31:00.841084Z"},"links":{"cited_paper":"/paper/2312.06674","citing_paper":"/paper/2507.05455"},"observation_digest":"sha256:bb25f5cd0642c7b9b8d23f359f82b943c8bb1d8db4d27e2f9ede512ce0a035ed","observation_id":"224d1a9d-36e6-4236-9ac3-18498944b9ae","resolution":{"observed_at":"2026-08-06T19:31:00.841084Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.06674","last_updated":"2023-12-07T19:40:50Z","snapshot_observed_at":"2026-07-06T17:00:00.321552Z","submitted_at":"2023-12-07T19:40:50Z","title":"Llama Guard: LLM-based Input-Output Safeguard for Human-AI Conversations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.06674","snapshot_observed_at":"2026-08-06T19:12:22.912261Z","title":"Llama guard: Llm-based input-output safeguard for human-ai conversations,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.06323","last_updated":"2025-07-08T18:24:28Z","snapshot_observed_at":"2026-08-06T19:05:12.143746Z","submitted_at":"2025-07-08T18:24:28Z","title":"Bridging AI and Software Security: A Comparative Vulnerability Assessment of LLM Agent Deployment Paradigms","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T19:12:22.912261Z"},"links":{"cited_paper":"/paper/2312.06674","citing_paper":"/paper/2507.06323"},"observation_digest":"sha256:0d192824fe980ea462c2d26491a2e27dafee9a4d3510fbdddee180cbc0dbf714","observation_id":"d70c4c11-6f58-4a53-84d6-f1905a37804f","resolution":{"observed_at":"2026-08-06T19:12:22.912261Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.06674","last_updated":"2023-12-07T19:40:50Z","snapshot_observed_at":"2026-07-06T17:00:00.321552Z","submitted_at":"2023-12-07T19:40:50Z","title":"Llama Guard: LLM-based Input-Output Safeguard for Human-AI Conversations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.06674","snapshot_observed_at":"2026-08-06T18:28:43.104007Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.08898","last_updated":"2025-07-17T08:01:44Z","snapshot_observed_at":"2026-08-08T14:51:56.908190Z","submitted_at":"2025-07-11T05:15:35Z","title":"SEALGuard: Safeguarding the Multilingual Conversations in Southeast Asian Languages for LLM Software Systems","version":3},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T18:28:43.104007Z"},"links":{"cited_paper":"/paper/2312.06674","citing_paper":"/paper/2507.08898"},"observation_digest":"sha256:0aa97bb32e657bccb1fae95f69a651169b91233b70fc50ef76b5200e90db9a3e","observation_id":"deafb81e-b3c7-46e4-95ae-f81a2e7c1048","resolution":{"observed_at":"2026-08-06T18:28:43.104007Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.06674","last_updated":"2023-12-07T19:40:50Z","snapshot_observed_at":"2026-07-06T17:00:00.321552Z","submitted_at":"2023-12-07T19:40:50Z","title":"Llama Guard: LLM-based Input-Output Safeguard for Human-AI Conversations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.06674","snapshot_observed_at":"2026-08-06T18:16:10.542110Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.08983","last_updated":"2025-07-11T19:35:29Z","snapshot_observed_at":"2026-08-09T18:47:59.331824Z","submitted_at":"2025-07-11T19:35:29Z","title":"Exploiting Leaderboards for Large-Scale Distribution of Malicious Models","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-06T18:16:10.542110Z"},"links":{"cited_paper":"/paper/2312.06674","citing_paper":"/paper/2507.08983"},"observation_digest":"sha256:c78d91aab56ed42059b260e12e3af63abcd619bd6faca49ff7cd1f8e2067da01","observation_id":"7362b693-3a9c-47e2-96a8-c13be50fd027","resolution":{"observed_at":"2026-08-06T18:16:10.542110Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.06674","last_updated":"2023-12-07T19:40:50Z","snapshot_observed_at":"2026-07-06T17:00:00.321552Z","submitted_at":"2023-12-07T19:40:50Z","title":"Llama Guard: LLM-based Input-Output Safeguard for Human-AI Conversations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.06674","snapshot_observed_at":"2026-08-06T17:49:41.341531Z","title":"Llama guard: Llm-based input-output safeguard for human-ai conversations, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.09820","last_updated":"2025-07-13T22:34:20Z","snapshot_observed_at":"2026-08-08T07:26:19.185941Z","submitted_at":"2025-07-13T22:34:20Z","title":"Measuring What Matters: A Framework for Evaluating Safety Risks in Real-World LLM Applications","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-06T17:49:41.341531Z"},"links":{"cited_paper":"/paper/2312.06674","citing_paper":"/paper/2507.09820"},"observation_digest":"sha256:8f58797cc4da6fe54e988096e9f231d85ff0088aef7ab52ade191a52c418ad76","observation_id":"0f1391c9-8c4e-42ed-b5c0-bf4ce8d633ac","resolution":{"observed_at":"2026-08-06T17:49:41.341531Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.06674","last_updated":"2023-12-07T19:40:50Z","snapshot_observed_at":"2026-07-06T17:00:00.321552Z","submitted_at":"2023-12-07T19:40:50Z","title":"Llama Guard: LLM-based Input-Output Safeguard for Human-AI Conversations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.06674","snapshot_observed_at":"2026-08-06T19:08:23.391760Z","title":"Llama Guard: LLM-based Input-Output Safeguard for Human-AI Conversations","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.11544","last_updated":"2025-07-08T23:58:01Z","snapshot_observed_at":"2026-08-06T22:09:08.446996Z","submitted_at":"2025-07-08T23:58:01Z","title":"The Safety Gap Toolkit: Evaluating Hidden Dangers of Open-Source Models","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-06T19:08:23.391760Z"},"links":{"cited_paper":"/paper/2312.06674","citing_paper":"/paper/2507.11544"},"observation_digest":"sha256:97eb3ab9dc82e28dcc61aa7ec35324efd9ec611ac3a05c84ad569efb28a4f1e0","observation_id":"a92ffb7e-80dc-400f-bbf3-ac1b6d775d14","resolution":{"observed_at":"2026-08-06T19:08:23.391760Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.06674","last_updated":"2023-12-07T19:40:50Z","snapshot_observed_at":"2026-07-06T17:00:00.321552Z","submitted_at":"2023-12-07T19:40:50Z","title":"Llama Guard: LLM-based Input-Output Safeguard for Human-AI Conversations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.06674","snapshot_observed_at":"2026-08-06T17:03:15.860934Z","title":"Llama guard: Llm-based input-output safeguard for human-ai conversations.arXiv preprint arXiv:2312.06674,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.11878","last_updated":"2026-07-06T01:46:44Z","snapshot_observed_at":"2026-08-06T16:57:07.977935Z","submitted_at":"2025-07-16T03:48:03Z","title":"LLMs Encode Harmfulness and Refusal Separately","version":5},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-06T17:03:15.860934Z"},"links":{"cited_paper":"/paper/2312.06674","citing_paper":"/paper/2507.11878"},"observation_digest":"sha256:d65416a0875709b3f8b326cfc46402f406cc56dc8dc6e65d7730641d7279bd2b","observation_id":"ea9101c5-a663-40e6-86d9-309a01082db3","resolution":{"observed_at":"2026-08-06T17:03:15.860934Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.06674","last_updated":"2023-12-07T19:40:50Z","snapshot_observed_at":"2026-07-06T17:00:00.321552Z","submitted_at":"2023-12-07T19:40:50Z","title":"Llama Guard: LLM-based Input-Output Safeguard for Human-AI Conversations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.06674","snapshot_observed_at":"2026-08-06T16:28:50.565875Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.13474","last_updated":"2025-07-17T18:33:50Z","snapshot_observed_at":"2026-08-09T05:14:52.776386Z","submitted_at":"2025-07-17T18:33:50Z","title":"Paper Summary Attack: Jailbreaking LLMs through LLM Safety Papers","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-06T16:28:50.565875Z"},"links":{"cited_paper":"/paper/2312.06674","citing_paper":"/paper/2507.13474"},"observation_digest":"sha256:3d20ae8e6ccf7a1d0c5f3a618b636e227e77e88ebb849ac65a546d19683e5272","observation_id":"210b3c37-d214-4c21-9fc6-bc16dd1be8f5","resolution":{"observed_at":"2026-08-06T16:28:50.565875Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.06674","last_updated":"2023-12-07T19:40:50Z","snapshot_observed_at":"2026-07-06T17:00:00.321552Z","submitted_at":"2023-12-07T19:40:50Z","title":"Llama Guard: LLM-based Input-Output Safeguard for Human-AI Conversations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.06674","snapshot_observed_at":"2026-08-06T16:27:57.229187Z","title":"Llama guard: Llm-based input-output safeguard for human-ai conversations, 2023.https://arxiv.org/abs/2312.06674","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.13541","last_updated":"2025-07-17T21:21:54Z","snapshot_observed_at":"2026-08-07T22:27:51.782315Z","submitted_at":"2025-07-17T21:21:54Z","title":"PrefPalette: Personalized Preference Modeling with Latent Attributes","version":1},"reference_index":2003,"source":"pdf_text","source_observed_at":"2026-08-06T16:27:57.229187Z"},"links":{"cited_paper":"/paper/2312.06674","citing_paper":"/paper/2507.13541"},"observation_digest":"sha256:47dfbc10d9efcbda01db9903e8f2a8a8022a33b1c67ef6ed82188ba0cbeca362","observation_id":"a00e24ce-97d0-4933-b7d5-cd408a718413","resolution":{"observed_at":"2026-08-06T16:27:57.229187Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.06674","last_updated":"2023-12-07T19:40:50Z","snapshot_observed_at":"2026-07-06T17:00:00.321552Z","submitted_at":"2023-12-07T19:40:50Z","title":"Llama Guard: LLM-based Input-Output Safeguard for Human-AI Conversations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.06674","snapshot_observed_at":"2026-08-06T16:12:48.722673Z","title":"Llama guard: Llm-based input-output safeguard for human-ai conversations","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.14293","last_updated":"2025-07-18T18:06:27Z","snapshot_observed_at":"2026-08-06T15:57:20.673152Z","submitted_at":"2025-07-18T18:06:27Z","title":"WebGuard: Building a Generalizable Guardrail for Web Agents","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T16:12:48.722673Z"},"links":{"cited_paper":"/paper/2312.06674","citing_paper":"/paper/2507.14293"},"observation_digest":"sha256:c189b829789aae4efd058a0b63933274b8152c0f5a502292d43358bc52deb3bf","observation_id":"30f7ec07-3d44-4cf9-95d7-a88ae65cc2ed","resolution":{"observed_at":"2026-08-06T16:12:48.722673Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.06674","last_updated":"2023-12-07T19:40:50Z","snapshot_observed_at":"2026-07-06T17:00:00.321552Z","submitted_at":"2023-12-07T19:40:50Z","title":"Llama Guard: LLM-based Input-Output Safeguard for Human-AI Conversations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.06674","snapshot_observed_at":"2026-08-06T15:48:01.454863Z","title":"Llama guard: Llm-based input-output safeguard for human-ai conversations","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.14987","last_updated":"2025-07-20T14:47:03Z","snapshot_observed_at":"2026-08-07T23:14:33.627711Z","submitted_at":"2025-07-20T14:47:03Z","title":"AlphaAlign: Incentivizing Safety Alignment with Extremely Simplified Reinforcement Learning","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-06T15:48:01.454863Z"},"links":{"cited_paper":"/paper/2312.06674","citing_paper":"/paper/2507.14987"},"observation_digest":"sha256:f50be38f11b2e0a947f81a095e39a96af82638fc6638cb3ca0f65f6e2fbcba4a","observation_id":"2de32363-6a72-45f3-a94f-7fa96500ef52","resolution":{"observed_at":"2026-08-06T15:48:01.454863Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.06674","last_updated":"2023-12-07T19:40:50Z","snapshot_observed_at":"2026-07-06T17:00:00.321552Z","submitted_at":"2023-12-07T19:40:50Z","title":"Llama Guard: LLM-based Input-Output Safeguard for Human-AI Conversations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.06674","snapshot_observed_at":"2026-08-06T16:11:47.674139Z","title":"Llama guard: Llm-based input-output safeguard for human-ai conversations","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.15885","last_updated":"2025-07-18T22:27:40Z","snapshot_observed_at":"2026-08-08T14:52:15.670259Z","submitted_at":"2025-07-18T22:27:40Z","title":"ADEPTS: A Capability Framework for Human-Centered Agent Design","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T16:11:47.674139Z"},"links":{"cited_paper":"/paper/2312.06674","citing_paper":"/paper/2507.15885"},"observation_digest":"sha256:17169f01fd52131b873fe21f9e7394753b1540369b77de8e7a665d3a50a1c27a","observation_id":"8012d4b5-ccb6-40cd-a89d-16d44398b3f4","resolution":{"observed_at":"2026-08-06T16:11:47.674139Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.06674","last_updated":"2023-12-07T19:40:50Z","snapshot_observed_at":"2026-07-06T17:00:00.321552Z","submitted_at":"2023-12-07T19:40:50Z","title":"Llama Guard: LLM-based Input-Output Safeguard for Human-AI Conversations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.06674","snapshot_observed_at":"2026-08-06T15:24:16.568903Z","title":"Llama guard: Llm-based input-output safeguard for human-ai conversations","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.16099","last_updated":"2025-07-21T22:50:12Z","snapshot_observed_at":"2026-08-09T03:58:15.089706Z","submitted_at":"2025-07-21T22:50:12Z","title":"TorchAO: PyTorch-Native Training-to-Serving Model Optimization","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-06T15:24:16.568903Z"},"links":{"cited_paper":"/paper/2312.06674","citing_paper":"/paper/2507.16099"},"observation_digest":"sha256:506493fe0202b7be1a0897382ea35739ea1de64cbbe11c347e514a03a4618f91","observation_id":"f1902be7-ee35-4736-88f9-ce89c36aae13","resolution":{"observed_at":"2026-08-06T15:24:16.568903Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.06674","last_updated":"2023-12-07T19:40:50Z","snapshot_observed_at":"2026-07-06T17:00:00.321552Z","submitted_at":"2023-12-07T19:40:50Z","title":"Llama Guard: LLM-based Input-Output Safeguard for Human-AI Conversations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.06674","snapshot_observed_at":"2026-08-06T15:14:22.834304Z","title":"Llama guard: Llm-based input-output safeguard for human-ai conversations.arXiv preprint arXiv:2312.06674,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.16534","last_updated":"2025-07-26T12:33:42Z","snapshot_observed_at":"2026-08-10T02:11:35.629269Z","submitted_at":"2025-07-22T12:44:38Z","title":"Frontier AI Risk Management Framework in Practice: A Risk Analysis Technical Report","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T15:14:22.834304Z"},"links":{"cited_paper":"/paper/2312.06674","citing_paper":"/paper/2507.16534"},"observation_digest":"sha256:0251500c80f99a88bd53da4c5a8af1a4228bba0a7db2a848c1deb92e82a37b3d","observation_id":"a6528721-9175-4293-aa54-96cae918c15e","resolution":{"observed_at":"2026-08-06T15:14:22.834304Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.06674","last_updated":"2023-12-07T19:40:50Z","snapshot_observed_at":"2026-07-06T17:00:00.321552Z","submitted_at":"2023-12-07T19:40:50Z","title":"Llama Guard: LLM-based Input-Output Safeguard for Human-AI Conversations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.06674","snapshot_observed_at":"2026-08-06T15:04:21.448244Z","title":"Llama guard: Llm-based input-output safeguard for human-ai conversations","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.21134","last_updated":"2026-07-27T09:44:33Z","snapshot_observed_at":"2026-08-08T04:33:33.957015Z","submitted_at":"2025-07-22T17:52:29Z","title":"TRIDENT: Benchmarking LLM Safety in Finance, Medicine, and Law","version":2},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-06T15:04:21.448244Z"},"links":{"cited_paper":"/paper/2312.06674","citing_paper":"/paper/2507.21134"},"observation_digest":"sha256:a5b6f72cd22c12cdd62c3d0cdafe629af0ae908927500cd9438bef62816ac14b","observation_id":"d3197835-56a4-4ad2-9624-0d1e5b01b33f","resolution":{"observed_at":"2026-08-06T15:04:21.448244Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.06674","last_updated":"2023-12-07T19:40:50Z","snapshot_observed_at":"2026-07-06T17:00:00.321552Z","submitted_at":"2023-12-07T19:40:50Z","title":"Llama Guard: LLM-based Input-Output Safeguard for Human-AI Conversations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.06674","snapshot_observed_at":"2026-08-06T14:17:04.323451Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.21170","last_updated":"2025-07-31T18:07:13Z","snapshot_observed_at":"2026-08-09T21:31:56.953272Z","submitted_at":"2025-07-25T19:44:38Z","title":"OneShield -- the Next Generation of LLM Guardrails","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T14:17:04.323451Z"},"links":{"cited_paper":"/paper/2312.06674","citing_paper":"/paper/2507.21170"},"observation_digest":"sha256:daeba97d8eaef7436bd08fb2608d6555a8a846cedf8b58a4ca26e72e25ccdce3","observation_id":"111788cd-b8c9-48a2-b775-0811b8f2e177","resolution":{"observed_at":"2026-08-06T14:17:04.323451Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.06674","last_updated":"2023-12-07T19:40:50Z","snapshot_observed_at":"2026-07-06T17:00:00.321552Z","submitted_at":"2023-12-07T19:40:50Z","title":"Llama Guard: LLM-based Input-Output Safeguard for Human-AI Conversations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.06674","snapshot_observed_at":"2026-08-06T13:05:36.990443Z","title":"Llama guard: Llm-based input-output safeguard for human-ai conversations","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.21206","last_updated":"2025-07-28T17:58:12Z","snapshot_observed_at":"2026-08-08T10:48:52.442522Z","submitted_at":"2025-07-28T17:58:12Z","title":"Agentic Web: Weaving the Next Web with AI Agents","version":1},"reference_index":104,"source":"arxiv_source","source_observed_at":"2026-08-06T13:05:36.990443Z"},"links":{"cited_paper":"/paper/2312.06674","citing_paper":"/paper/2507.21206"},"observation_digest":"sha256:37e219a451f7dfd240c13715c6f5a5cbef7aa66e797afe5392d22d1bb0cfdd2d","observation_id":"03bd2d9c-1211-4ebb-80a4-726bfce0f132","resolution":{"observed_at":"2026-08-06T13:05:36.990443Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.06674","last_updated":"2023-12-07T19:40:50Z","snapshot_observed_at":"2026-07-06T17:00:00.321552Z","submitted_at":"2023-12-07T19:40:50Z","title":"Llama Guard: LLM-based Input-Output Safeguard for Human-AI Conversations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.06674","snapshot_observed_at":"2026-08-06T12:54:34.709673Z","title":"Llama guard: Llm- based input-output safeguard for human-ai conversations","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.21391","last_updated":"2025-07-30T04:49:38Z","snapshot_observed_at":"2026-08-09T18:53:55.200265Z","submitted_at":"2025-07-28T23:52:53Z","title":"Multimodal LLMs as Customized Reward Models for Text-to-Image Generation","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T12:54:34.709673Z"},"links":{"cited_paper":"/paper/2312.06674","citing_paper":"/paper/2507.21391"},"observation_digest":"sha256:8954ab6b952cc1e0a026deb76ecdfa1afa1cd6179a392906773a2484e25fdb9b","observation_id":"848fe526-4132-4bf4-9e22-842a315f02bf","resolution":{"observed_at":"2026-08-06T12:54:34.709673Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.06674","last_updated":"2023-12-07T19:40:50Z","snapshot_observed_at":"2026-07-06T17:00:00.321552Z","submitted_at":"2023-12-07T19:40:50Z","title":"Llama Guard: LLM-based Input-Output Safeguard for Human-AI Conversations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.06674","snapshot_observed_at":"2026-08-06T12:25:21.959665Z","title":"arXiv preprint arXiv:2312.06674","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.21782","last_updated":"2025-07-29T13:09:40Z","snapshot_observed_at":"2026-08-09T22:35:56.538982Z","submitted_at":"2025-07-29T13:09:40Z","title":"The Problem with Safety Classification is not just the Models","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T12:25:21.959665Z"},"links":{"cited_paper":"/paper/2312.06674","citing_paper":"/paper/2507.21782"},"observation_digest":"sha256:6d7595231dd23705ca261595bdc9c69dc47e5e8c0d5eb8031509008b4c19637a","observation_id":"f8aa02b0-d615-4334-b707-09bfeeaf163b","resolution":{"observed_at":"2026-08-06T12:25:21.959665Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.06674","last_updated":"2023-12-07T19:40:50Z","snapshot_observed_at":"2026-07-06T17:00:00.321552Z","submitted_at":"2023-12-07T19:40:50Z","title":"Llama Guard: LLM-based Input-Output Safeguard for Human-AI Conversations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.06674","snapshot_observed_at":"2026-08-06T12:17:38.676661Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.21929","last_updated":"2025-07-29T15:45:50Z","snapshot_observed_at":"2026-08-09T14:01:50.797496Z","submitted_at":"2025-07-29T15:45:50Z","title":"Libra: Large Chinese-based Safeguard for AI Content","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T12:17:38.676661Z"},"links":{"cited_paper":"/paper/2312.06674","citing_paper":"/paper/2507.21929"},"observation_digest":"sha256:30979468cb1e5619004e4ada9366f2ae0bab41f717b060948c4e993ac445623a","observation_id":"9299ee83-44bc-4628-8e41-0eac91cd7080","resolution":{"observed_at":"2026-08-06T12:17:38.676661Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.06674","last_updated":"2023-12-07T19:40:50Z","snapshot_observed_at":"2026-07-06T17:00:00.321552Z","submitted_at":"2023-12-07T19:40:50Z","title":"Llama Guard: LLM-based Input-Output Safeguard for Human-AI Conversations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.06674","snapshot_observed_at":"2026-08-06T23:00:44.729289Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.22063","last_updated":"2026-07-02T17:48:45Z","snapshot_observed_at":"2026-08-06T22:52:58.454957Z","submitted_at":"2025-06-25T06:20:15Z","title":"RedCoder: Automated Multi-Turn Red Teaming for Code LLMs","version":2},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-06T23:00:44.729289Z"},"links":{"cited_paper":"/paper/2312.06674","citing_paper":"/paper/2507.22063"},"observation_digest":"sha256:43171981a816fbff934557e30648529807d5b5f963b19f03bb802b8a18ddfa9f","observation_id":"3b014c58-1e32-4a5c-a8a7-599a49863fbc","resolution":{"observed_at":"2026-08-06T23:00:44.729289Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.06674","last_updated":"2023-12-07T19:40:50Z","snapshot_observed_at":"2026-07-06T17:00:00.321552Z","submitted_at":"2023-12-07T19:40:50Z","title":"Llama Guard: LLM-based Input-Output Safeguard for Human-AI Conversations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.06674","snapshot_observed_at":"2026-08-06T05:57:29.271933Z","title":"Llama guard: Llm-based input-output safeguard for human-ai conversations","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.01059","last_updated":"2025-08-01T20:25:57Z","snapshot_observed_at":"2026-08-09T20:48:33.918675Z","submitted_at":"2025-08-01T20:25:57Z","title":"Llama-3.1-FoundationAI-SecurityLLM-8B-Instruct Technical Report","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T05:57:29.271933Z"},"links":{"cited_paper":"/paper/2312.06674","citing_paper":"/paper/2508.01059"},"observation_digest":"sha256:2bbd8f45c21db3aa807d9ac589068af997904fb9a0b491977a45941819fd4d26","observation_id":"0f1e94ae-9858-419d-8101-cc7efc2b17cb","resolution":{"observed_at":"2026-08-06T05:57:29.271933Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.06674","last_updated":"2023-12-07T19:40:50Z","snapshot_observed_at":"2026-07-06T17:00:00.321552Z","submitted_at":"2023-12-07T19:40:50Z","title":"Llama Guard: LLM-based Input-Output Safeguard for Human-AI Conversations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.06674","snapshot_observed_at":"2026-08-06T05:56:20.264246Z","title":"Llama guard: Llm-based input-output safeguard for human-ai conversations","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.01084","last_updated":"2025-08-01T21:37:16Z","snapshot_observed_at":"2026-08-06T05:56:18.361364Z","submitted_at":"2025-08-01T21:37:16Z","title":"Provably Secure Retrieval-Augmented Generation","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T05:56:20.264246Z"},"links":{"cited_paper":"/paper/2312.06674","citing_paper":"/paper/2508.01084"},"observation_digest":"sha256:790d595c3f3738b52bcf98046d6294b4e8745782ae5809e843b698bb93696910","observation_id":"4d7dbf2d-5024-4188-9bf2-190d7779a207","resolution":{"observed_at":"2026-08-06T05:56:20.264246Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.06674","last_updated":"2023-12-07T19:40:50Z","snapshot_observed_at":"2026-07-06T17:00:00.321552Z","submitted_at":"2023-12-07T19:40:50Z","title":"Llama Guard: LLM-based Input-Output Safeguard for Human-AI Conversations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.06674","snapshot_observed_at":"2026-08-06T04:47:25.435933Z","title":"arXiv preprint arXiv:2312.06674 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.03054","last_updated":"2025-08-05T03:58:15Z","snapshot_observed_at":"2026-08-08T05:44:09.712429Z","submitted_at":"2025-08-05T03:58:15Z","title":"Beyond Surface-Level Detection: Towards Cognitive-Driven Defense Against Jailbreak Attacks via Meta-Operations Reasoning","version":1},"reference_index":124,"source":"arxiv_source","source_observed_at":"2026-08-06T04:47:25.435933Z"},"links":{"cited_paper":"/paper/2312.06674","citing_paper":"/paper/2508.03054"},"observation_digest":"sha256:cc3649042817ad92e4d1568d903a46fef0345066ca77a5a170c038e1a5f881e1","observation_id":"7ded2693-e7ac-44c7-9a55-76436bba48b2","resolution":{"observed_at":"2026-08-06T04:47:25.435933Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.06674","last_updated":"2023-12-07T19:40:50Z","snapshot_observed_at":"2026-07-06T17:00:00.321552Z","submitted_at":"2023-12-07T19:40:50Z","title":"Llama Guard: LLM-based Input-Output Safeguard for Human-AI Conversations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.06674","snapshot_observed_at":"2026-08-05T23:13:04.161107Z","title":"arXiv preprint arXiv:2312.06674 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.05775","last_updated":"2026-07-27T20:50:40Z","snapshot_observed_at":"2026-08-10T01:02:48.484224Z","submitted_at":"2025-08-07T18:42:16Z","title":"Guardians and Offenders: A Survey on Harmful Content Generation and Safety Mitigation of LLM","version":3},"reference_index":87,"source":"arxiv_source","source_observed_at":"2026-08-05T23:13:04.161107Z"},"links":{"cited_paper":"/paper/2312.06674","citing_paper":"/paper/2508.05775"},"observation_digest":"sha256:bfa8fcfdb080a74097f6c67ed51c9262fa8f24efd6a8be6bde176854688873dc","observation_id":"a5365e4f-0f2d-47a2-8d76-5b266eafd26e","resolution":{"observed_at":"2026-08-05T23:13:04.161107Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.06674","last_updated":"2023-12-07T19:40:50Z","snapshot_observed_at":"2026-07-06T17:00:00.321552Z","submitted_at":"2023-12-07T19:40:50Z","title":"Llama Guard: LLM-based Input-Output Safeguard for Human-AI Conversations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.06674","snapshot_observed_at":"2026-08-05T22:24:23.377564Z","title":"Llama Guard: LLM-based Input-Output Safeguard for Human-AI Conversations","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.07139","last_updated":"2025-08-10T01:59:07Z","snapshot_observed_at":"2026-08-10T03:43:50.630539Z","submitted_at":"2025-08-10T01:59:07Z","title":"A Real-Time, Self-Tuning Moderator Framework for Adversarial Prompt Detection","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-05T22:24:23.377564Z"},"links":{"cited_paper":"/paper/2312.06674","citing_paper":"/paper/2508.07139"},"observation_digest":"sha256:27ee1e626ab8fa9122e327e7aae3f0a81dda3e19c42cb5bc607f28ddbdb6a0a6","observation_id":"f5881f87-bd05-4c12-9048-d554c8f0467d","resolution":{"observed_at":"2026-08-05T22:24:23.377564Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.06674","last_updated":"2023-12-07T19:40:50Z","snapshot_observed_at":"2026-07-06T17:00:00.321552Z","submitted_at":"2023-12-07T19:40:50Z","title":"Llama Guard: LLM-based Input-Output Safeguard for Human-AI Conversations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.06674","snapshot_observed_at":"2026-08-05T21:22:37.200923Z","title":"Llama guard: Llm-based input-output safeguard for human-ai conversations.arXiv preprint arXiv:2312.06674,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.09237","last_updated":"2025-08-12T12:11:43Z","snapshot_observed_at":"2026-08-08T17:20:22.464472Z","submitted_at":"2025-08-12T12:11:43Z","title":"Blockchain Network Analysis using Quantum Inspired Graph Neural Networks & Ensemble Models","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-05T21:22:37.200923Z"},"links":{"cited_paper":"/paper/2312.06674","citing_paper":"/paper/2508.09237"},"observation_digest":"sha256:e6f498242b4cc848df5db896be197236a10c8df79dd50daa463405b7cfa1423b","observation_id":"d71ee36e-7699-4e13-b5b2-fbbdf54fb341","resolution":{"observed_at":"2026-08-05T21:22:37.200923Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.06674","last_updated":"2023-12-07T19:40:50Z","snapshot_observed_at":"2026-07-06T17:00:00.321552Z","submitted_at":"2023-12-07T19:40:50Z","title":"Llama Guard: LLM-based Input-Output Safeguard for Human-AI Conversations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.06674","snapshot_observed_at":"2026-08-05T16:40:06.696675Z","title":"Llama Guard: LLM-based Input-Output Safeguard for Human-AI Conversations, December 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.18076","last_updated":"2025-08-27T21:24:13Z","snapshot_observed_at":"2026-08-10T09:25:11.118414Z","submitted_at":"2025-08-25T14:43:10Z","title":"Neither Valid nor Reliable? Investigating the Use of LLMs as Judges","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-05T16:40:06.696675Z"},"links":{"cited_paper":"/paper/2312.06674","citing_paper":"/paper/2508.18076"},"observation_digest":"sha256:0a9237f8e827486f8f9bb9e96fcd954ca58cd3b4aa69a0d02dbb252d3d13fd30","observation_id":"f8c156e9-ba9d-462d-aeb5-7cb3cb65fc2e","resolution":{"observed_at":"2026-08-05T16:40:06.696675Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.06674","last_updated":"2023-12-07T19:40:50Z","snapshot_observed_at":"2026-07-06T17:00:00.321552Z","submitted_at":"2023-12-07T19:40:50Z","title":"Llama Guard: LLM-based Input-Output Safeguard for Human-AI Conversations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.06674","snapshot_observed_at":"2026-08-05T16:00:48.568286Z","title":"Llama guard: Llm-based input-output safeguard for human-ai conversations, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.19445","last_updated":"2026-06-16T17:34:06Z","snapshot_observed_at":"2026-08-08T05:25:02.825611Z","submitted_at":"2025-08-26T21:36:45Z","title":"On Surjectivity of Neural Networks: Can you elicit any behavior from your model?","version":3},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-05T16:00:48.568286Z"},"links":{"cited_paper":"/paper/2312.06674","citing_paper":"/paper/2508.19445"},"observation_digest":"sha256:2e2a5f6c6a2b8af2e8bdfc1fd70f722f37eba1ad0c22a8214b55d606d934c5e9","observation_id":"1b002207-66d9-43ba-9015-89a5141a2db7","resolution":{"observed_at":"2026-08-05T16:00:48.568286Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.06674","last_updated":"2023-12-07T19:40:50Z","snapshot_observed_at":"2026-07-06T17:00:00.321552Z","submitted_at":"2023-12-07T19:40:50Z","title":"Llama Guard: LLM-based Input-Output Safeguard for Human-AI Conversations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.06674","snapshot_observed_at":"2026-08-05T15:53:50.137911Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.19461","last_updated":"2025-08-26T22:29:31Z","snapshot_observed_at":"2026-08-07T19:17:20.900756Z","submitted_at":"2025-08-26T22:29:31Z","title":"Reliable Weak-to-Strong Monitoring of LLM Agents","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-05T15:53:50.137911Z"},"links":{"cited_paper":"/paper/2312.06674","citing_paper":"/paper/2508.19461"},"observation_digest":"sha256:cc563bc6d98ab1bf59aa9f4407b1bd268a6bb63ac6fc0e82e03cec7637053b0b","observation_id":"70fe987c-33ce-414e-964a-369b40f947d5","resolution":{"observed_at":"2026-08-05T15:53:50.137911Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.06674","last_updated":"2023-12-07T19:40:50Z","snapshot_observed_at":"2026-07-06T17:00:00.321552Z","submitted_at":"2023-12-07T19:40:50Z","title":"Llama Guard: LLM-based Input-Output Safeguard for Human-AI Conversations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.06674","snapshot_observed_at":"2026-08-05T15:20:14.192838Z","title":"arXiv preprint arXiv:2312.06674","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.20151","last_updated":"2025-08-27T16:47:31Z","snapshot_observed_at":"2026-08-07T23:13:46.567117Z","submitted_at":"2025-08-27T16:47:31Z","title":"IntentionReasoner: Facilitating Adaptive LLM Safeguards through Intent Reasoning and Selective Query Refinement","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-05T15:20:14.192838Z"},"links":{"cited_paper":"/paper/2312.06674","citing_paper":"/paper/2508.20151"},"observation_digest":"sha256:651eabf37d874666eefdfa48b067556b88c9881de4682ac33747bf879e7e85f0","observation_id":"d2bb5a08-5439-4e4e-9501-cb9dbe177c3a","resolution":{"observed_at":"2026-08-05T15:20:14.192838Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.06674","last_updated":"2023-12-07T19:40:50Z","snapshot_observed_at":"2026-07-06T17:00:00.321552Z","submitted_at":"2023-12-07T19:40:50Z","title":"Llama Guard: LLM-based Input-Output Safeguard for Human-AI Conversations","version":1},"cited_work":{"arxiv_id":"2312.06674","doi":"10.3390/info16050365","metadata_source":"pith","pith_arxiv_id":"2312.06674","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Llama Guard: LLM-based Input-Output Safeguard for Human-AI Conversations","venue":"cs.CL","work_id":"93844332-869b-448c-a1be-35466150b1b2","year":2023},"citing_paper":{"arxiv_id":"2508.20697","last_updated":"2026-08-04T09:31:07Z","snapshot_observed_at":"2026-08-07T23:09:05.524726Z","submitted_at":"2025-08-28T12:07:11Z","title":"Token Buncher: Shielding LLMs from Harmful Reinforcement Learning Fine-Tuning","version":3},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-18T20:40:44.496392Z"},"links":{"cited_paper":"/paper/2312.06674","citing_paper":"/paper/2508.20697"},"observation_digest":"sha256:c17fb9dd1b7a6d03185ba943854979b6a7cdfd8b02637b4547228e2c9b767c97","observation_id":"6ade512d-1ab5-4802-8155-1fa8a76cc5a1","resolution":{"observed_at":"2026-05-18T20:41:50.489469Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.06674","last_updated":"2023-12-07T19:40:50Z","snapshot_observed_at":"2026-07-06T17:00:00.321552Z","submitted_at":"2023-12-07T19:40:50Z","title":"Llama Guard: LLM-based Input-Output Safeguard for Human-AI Conversations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.06674","snapshot_observed_at":"2026-08-05T11:19:11.199092Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.02926","last_updated":"2025-09-03T01:27:26Z","snapshot_observed_at":"2026-08-10T06:34:13.702453Z","submitted_at":"2025-09-03T01:27:26Z","title":"Decoding the Rule Book: Extracting Hidden Moderation Criteria from Reddit Communities","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-05T11:19:11.199092Z"},"links":{"cited_paper":"/paper/2312.06674","citing_paper":"/paper/2509.02926"},"observation_digest":"sha256:a130e354dd0e408e75dbb86d1f96313b8d15120941ffb1f4eaf688e46ad0c830","observation_id":"1e67f2ad-fd86-4f28-b849-5f4af713079d","resolution":{"observed_at":"2026-08-05T11:19:11.199092Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.06674","last_updated":"2023-12-07T19:40:50Z","snapshot_observed_at":"2026-07-06T17:00:00.321552Z","submitted_at":"2023-12-07T19:40:50Z","title":"Llama Guard: LLM-based Input-Output Safeguard for Human-AI Conversations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.06674","snapshot_observed_at":"2026-08-05T10:39:08.233150Z","title":"Llama guard: Llm-based input-output safeguard for human-ai conversations","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.03871","last_updated":"2025-09-04T04:12:31Z","snapshot_observed_at":"2026-08-08T03:54:26.940042Z","submitted_at":"2025-09-04T04:12:31Z","title":"A Comprehensive Survey on Trustworthiness in Reasoning with Large Language Models","version":1},"reference_index":270,"source":"pdf_text","source_observed_at":"2026-08-05T10:39:08.233150Z"},"links":{"cited_paper":"/paper/2312.06674","citing_paper":"/paper/2509.03871"},"observation_digest":"sha256:3ad019b7a0b8415cbeaf5e0251c5ff77651245563dc1d878b769d7df7b9d5a75","observation_id":"fee73ba9-20b5-448a-8f5d-59e87ca16c45","resolution":{"observed_at":"2026-08-05T10:39:08.233150Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.06674","last_updated":"2023-12-07T19:40:50Z","snapshot_observed_at":"2026-07-06T17:00:00.321552Z","submitted_at":"2023-12-07T19:40:50Z","title":"Llama Guard: LLM-based Input-Output Safeguard for Human-AI Conversations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.06674","snapshot_observed_at":"2026-08-05T11:25:23.020751Z","title":"Llama guard: Llm-based input-output safeguard for human-ai conversations,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.04512","last_updated":"2025-09-02T20:53:03Z","snapshot_observed_at":"2026-08-07T10:36:58.496060Z","submitted_at":"2025-09-02T20:53:03Z","title":"Scaling behavior of large language models in emotional safety classification across sizes and tasks","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-05T11:25:23.020751Z"},"links":{"cited_paper":"/paper/2312.06674","citing_paper":"/paper/2509.04512"},"observation_digest":"sha256:aa48d887739618f899bad27d4f0c6bba2f1314c3bc0503109c01465f2f7291d7","observation_id":"94554423-d12c-46ec-8c8f-7be52ffd7e57","resolution":{"observed_at":"2026-08-05T11:25:23.020751Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.06674","last_updated":"2023-12-07T19:40:50Z","snapshot_observed_at":"2026-07-06T17:00:00.321552Z","submitted_at":"2023-12-07T19:40:50Z","title":"Llama Guard: LLM-based Input-Output Safeguard for Human-AI Conversations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.06674","snapshot_observed_at":"2026-08-05T10:29:20.630948Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.05372","last_updated":"2026-01-26T08:01:41Z","snapshot_observed_at":"2026-08-05T23:14:14.618484Z","submitted_at":"2025-09-04T09:41:57Z","title":"Adversarial Bug Reports as a Security Risk in Language Model-Based Automated Program Repair","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-05T10:29:20.630948Z"},"links":{"cited_paper":"/paper/2312.06674","citing_paper":"/paper/2509.05372"},"observation_digest":"sha256:8296b2bf2e0e2b40c96aa15860c3afbd2f618be620cdf3a14f8aa8f5bde7df5b","observation_id":"54805df2-0907-45ad-a454-492f38e700bb","resolution":{"observed_at":"2026-08-05T10:29:20.630948Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.06674","last_updated":"2023-12-07T19:40:50Z","snapshot_observed_at":"2026-07-06T17:00:00.321552Z","submitted_at":"2023-12-07T19:40:50Z","title":"Llama Guard: LLM-based Input-Output Safeguard for Human-AI Conversations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.06674","snapshot_observed_at":"2026-08-05T05:09:39.841874Z","title":"Llama guard: Llm-based input-output safeguard for human-ai conversations.arXiv preprint arXiv:2312.06674, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.05755","last_updated":"2026-06-28T05:20:23Z","snapshot_observed_at":"2026-08-06T21:30:43.649885Z","submitted_at":"2025-09-06T15:48:49Z","title":"Red-Teaming Coding Agents from a Tool-Invocation Perspective: An Empirical Security Assessment","version":6},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-05T05:09:39.841874Z"},"links":{"cited_paper":"/paper/2312.06674","citing_paper":"/paper/2509.05755"},"observation_digest":"sha256:55e63beda4cdfb695acc7117607c67c0179ec208f094aeb96200f86b3b2fd14b","observation_id":"a43c34b6-1182-4430-99b8-28e4822e7418","resolution":{"observed_at":"2026-08-05T05:09:39.841874Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2312.06674/citation-record","integrity":"/paper/2312.06674/integrity","json":"/paper/2312.06674/citation-record.json","paper":"/paper/2312.06674"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2305.10403","last_updated":"2023-09-13T20:35:45Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-05-17T17:46:53Z","title":"PaLM 2 Technical Report","version":3},"cited_work":{"arxiv_id":"2305.10403","doi":"10.48550/arxiv.2305.10403","metadata_source":"pith","pith_arxiv_id":"2305.10403","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"PaLM 2 Technical Report","venue":"cs.CL","work_id":"905ee9a7-ea61-4a94-bd62-2600cbe3e315","year":2023},"citing_paper":{"arxiv_id":"2312.06674","last_updated":"2023-12-07T19:40:50Z","snapshot_observed_at":"2026-07-06T17:00:00.321552Z","submitted_at":"2023-12-07T19:40:50Z","title":"Llama Guard: LLM-based Input-Output Safeguard for Human-AI Conversations","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-10T18:59:26.795241Z"},"links":{"cited_paper":"/paper/2305.10403","citing_paper":"/paper/2312.06674"},"observation_digest":"sha256:a6e27710db2fe7b86b01d07ece17724bea3efbe398825a8a963b1f4ec43d1cd9","observation_id":"93d0d324-da69-486a-9b99-0d649bc000ed","resolution":{"observed_at":"2026-05-12T11:59:27.667882Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"SemEval-2019 task 5: Multilingual detection of hate speech against immigrants and women in Twitter","venue":null,"work_id":"dfc91366-1681-4d14-9089-4738ae3527e9","year":2019},"citing_paper":{"arxiv_id":"2312.06674","last_updated":"2023-12-07T19:40:50Z","snapshot_observed_at":"2026-07-06T17:00:00.321552Z","submitted_at":"2023-12-07T19:40:50Z","title":"Llama Guard: LLM-based Input-Output Safeguard for Human-AI Conversations","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-10T18:59:26.795241Z"},"links":{"citing_paper":"/paper/2312.06674"},"observation_digest":"sha256:7f3ac04dbd2819c0f66a488167ebe21920b67e6b7142feca9eea4d3e2b507349","observation_id":"f7a4865c-2473-498d-bb97-e3e373017005","resolution":{"observed_at":"2026-05-10T18:59:26.860719Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/s19-2007","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"doi: 10.18653/v1/S19-2007","venue":null,"work_id":"e2a70284-f629-48c0-9dad-0a85251b33ea","year":2007},"citing_paper":{"arxiv_id":"2312.06674","last_updated":"2023-12-07T19:40:50Z","snapshot_observed_at":"2026-07-06T17:00:00.321552Z","submitted_at":"2023-12-07T19:40:50Z","title":"Llama Guard: LLM-based Input-Output Safeguard for Human-AI Conversations","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-10T18:59:26.795241Z"},"links":{"citing_paper":"/paper/2312.06674"},"observation_digest":"sha256:7efadb2b6811c63995f24326dc96994e007aa83f949e432c6f82d4956408cbac","observation_id":"fb1da084-c7cf-4e7f-a879-898fc527e5c2","resolution":{"observed_at":"2026-05-10T18:59:26.820264Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/w18-0802","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"doi: 10.18653/v1/W18-0802","venue":null,"work_id":"13fc0f13-c7b2-42a4-9edd-55967f162b2f","year":null},"citing_paper":{"arxiv_id":"2312.06674","last_updated":"2023-12-07T19:40:50Z","snapshot_observed_at":"2026-07-06T17:00:00.321552Z","submitted_at":"2023-12-07T19:40:50Z","title":"Llama Guard: LLM-based Input-Output Safeguard for Human-AI Conversations","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-10T18:59:26.795241Z"},"links":{"citing_paper":"/paper/2312.06674"},"observation_digest":"sha256:2aebe2023f1d2a3dcbafb03b50d82bee02ffaaa406291dbf5bae94e7f1afd437","observation_id":"9dceea13-e047-466f-b84a-3833d71da68d","resolution":{"observed_at":"2026-05-10T18:59:26.824217Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/w18-5102","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"doi: 10.18653/v1/W18-5102","venue":null,"work_id":"3ad5d565-3934-4001-83ef-751aef974d4c","year":2019},"citing_paper":{"arxiv_id":"2312.06674","last_updated":"2023-12-07T19:40:50Z","snapshot_observed_at":"2026-07-06T17:00:00.321552Z","submitted_at":"2023-12-07T19:40:50Z","title":"Llama Guard: LLM-based Input-Output Safeguard for Human-AI Conversations","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-10T18:59:26.795241Z"},"links":{"citing_paper":"/paper/2312.06674"},"observation_digest":"sha256:fdb779680b8e045eb447e55c138b4eaf68f9bcaf58636280fa631910f2e0fdb1","observation_id":"86e4cced-6bef-4027-ab2e-afd5bc74fa74","resolution":{"observed_at":"2026-05-10T18:59:26.828659Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2021.acl-long.210","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"doi: 10.18653/v1/2021.acl-long.210","venue":null,"work_id":"5135c786-afc2-4f1a-9c61-d6e0057d1df6","year":2021},"citing_paper":{"arxiv_id":"2312.06674","last_updated":"2023-12-07T19:40:50Z","snapshot_observed_at":"2026-07-06T17:00:00.321552Z","submitted_at":"2023-12-07T19:40:50Z","title":"Llama Guard: LLM-based Input-Output Safeguard for Human-AI Conversations","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-10T18:59:26.795241Z"},"links":{"citing_paper":"/paper/2312.06674"},"observation_digest":"sha256:6e29665047c9bcc3b480e1c1a6a50fd4ef51c7b1239cfaf986e72e16f80c78df","observation_id":"8240a21b-8f77-4b06-b6f1-1163ba51c365","resolution":{"observed_at":"2026-05-10T18:59:26.812597Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Exploring social bias in chatbots using stereotype knowledge","venue":null,"work_id":"6d8d594a-ea28-45e3-a468-e193e25e6083","year":2019},"citing_paper":{"arxiv_id":"2312.06674","last_updated":"2023-12-07T19:40:50Z","snapshot_observed_at":"2026-07-06T17:00:00.321552Z","submitted_at":"2023-12-07T19:40:50Z","title":"Llama Guard: LLM-based Input-Output Safeguard for Human-AI Conversations","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-10T18:59:26.795241Z"},"links":{"citing_paper":"/paper/2312.06674"},"observation_digest":"sha256:3506e0fb85f389d752a33c3e2a017cc03e293e915add5d4a2e9a0426a73e0d70","observation_id":"f125f07f-329d-45d6-abb3-4d877c9641f1","resolution":{"observed_at":"2026-05-10T18:59:26.857527Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.04761","last_updated":"2023-02-09T16:49:57Z","snapshot_observed_at":"2026-07-06T14:50:07.491434Z","submitted_at":"2023-02-09T16:49:57Z","title":"Toolformer: Language Models Can Teach Themselves to Use Tools","version":1},"cited_work":{"arxiv_id":"2302.04761","doi":"10.48550/arxiv.2302.04761","metadata_source":"pith","pith_arxiv_id":"2302.04761","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Toolformer: Language Models Can Teach Themselves to Use Tools","venue":"cs.CL","work_id":"9bce40c8-cfd7-4983-80e0-c3bd4402322a","year":2023},"citing_paper":{"arxiv_id":"2312.06674","last_updated":"2023-12-07T19:40:50Z","snapshot_observed_at":"2026-07-06T17:00:00.321552Z","submitted_at":"2023-12-07T19:40:50Z","title":"Llama Guard: LLM-based Input-Output Safeguard for Human-AI Conversations","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-10T18:59:26.795241Z"},"links":{"cited_paper":"/paper/2302.04761","citing_paper":"/paper/2312.06674"},"observation_digest":"sha256:fa390c54bd37e40f602df3497cd259075cf1be3d128af6454a4e8f57ec09c489","observation_id":"d1b098cf-ee0e-484f-9dec-0e4a49f53bf8","resolution":{"observed_at":"2026-05-10T19:57:53.077868Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-04T01:08:11.107254+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-04T01:08:11.107254+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09288","last_updated":"2023-07-19T17:08:59Z","snapshot_observed_at":"2026-08-07T12:56:43.323460Z","submitted_at":"2023-07-18T14:31:57Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","version":2},"cited_work":{"arxiv_id":"2307.09288","doi":"10.24963/ijcai.2025/706","metadata_source":"pith","pith_arxiv_id":"2307.09288","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","venue":"cs.CL","work_id":"68a5177f-d644-44c1-bd4f-4e5278c22f5d","year":2023},"citing_paper":{"arxiv_id":"2312.06674","last_updated":"2023-12-07T19:40:50Z","snapshot_observed_at":"2026-07-06T17:00:00.321552Z","submitted_at":"2023-12-07T19:40:50Z","title":"Llama Guard: LLM-based Input-Output Safeguard for Human-AI Conversations","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-10T18:59:26.795241Z"},"links":{"cited_paper":"/paper/2307.09288","citing_paper":"/paper/2312.06674"},"observation_digest":"sha256:227585c1772a90c8500a3dc7b77ff71b0d753ed819fa072359788b66f5162cc9","observation_id":"71ab6f0d-57b5-408d-a33c-16d1e58fe3b7","resolution":{"observed_at":"2026-05-10T18:59:26.847187Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.10601","last_updated":"2023-12-03T22:50:35Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-05-17T23:16:17Z","title":"Tree of Thoughts: Deliberate Problem Solving with Large Language Models","version":2},"cited_work":{"arxiv_id":"2305.10601","doi":"10.48550/arxiv.2305.10601","metadata_source":"pith","pith_arxiv_id":"2305.10601","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Tree of Thoughts: Deliberate Problem Solving with Large Language Models","venue":"cs.CL","work_id":"07adb06e-4ed5-4ec5-a7ae-ff288fd214fb","year":2023},"citing_paper":{"arxiv_id":"2312.06674","last_updated":"2023-12-07T19:40:50Z","snapshot_observed_at":"2026-07-06T17:00:00.321552Z","submitted_at":"2023-12-07T19:40:50Z","title":"Llama Guard: LLM-based Input-Output Safeguard for Human-AI Conversations","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-10T18:59:26.795241Z"},"links":{"cited_paper":"/paper/2305.10601","citing_paper":"/paper/2312.06674"},"observation_digest":"sha256:2373ddc196373254022e351960bb9c7f95fa271c3e3b42530bdcfe207cf0bef3","observation_id":"48e938c7-2e65-4984-a082-18817769b950","resolution":{"observed_at":"2026-05-11T15:36:47.138740Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-04T01:08:14.037057+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-04T01:08:14.037057+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"SemEval-2019 task 6: Identifying and categorizing offensive language in social media (OffensEval)","venue":null,"work_id":"2ea18555-1daa-4286-85b3-5e01ded5fbf3","year":2019},"citing_paper":{"arxiv_id":"2312.06674","last_updated":"2023-12-07T19:40:50Z","snapshot_observed_at":"2026-07-06T17:00:00.321552Z","submitted_at":"2023-12-07T19:40:50Z","title":"Llama Guard: LLM-based Input-Output Safeguard for Human-AI Conversations","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-10T18:59:26.795241Z"},"links":{"citing_paper":"/paper/2312.06674"},"observation_digest":"sha256:8142c929d2b6e16e090655312c0e8a8d9b9e7f181d91ea527403e782f7183be8","observation_id":"253d1275-8b8b-4783-9e9b-7211aae604d7","resolution":{"observed_at":"2026-05-10T18:59:26.863640Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/s19-2010","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Zampieri, S","venue":null,"work_id":"55007995-2f25-41cc-a194-8c67ff913065","year":2010},"citing_paper":{"arxiv_id":"2312.06674","last_updated":"2023-12-07T19:40:50Z","snapshot_observed_at":"2026-07-06T17:00:00.321552Z","submitted_at":"2023-12-07T19:40:50Z","title":"Llama Guard: LLM-based Input-Output Safeguard for Human-AI Conversations","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-10T18:59:26.795241Z"},"links":{"citing_paper":"/paper/2312.06674"},"observation_digest":"sha256:8d3e1de4954d6ceb1af49fd6c56a1ef7e3c98b67e8ce4c712c4842166c7a3bed","observation_id":"0c0656c3-286e-4848-bba1-7e3caa68f16e","resolution":{"observed_at":"2026-05-10T18:59:26.816547Z","resolver_source":"doi","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2312.06674","last_updated":"2023-12-07T19:40:50Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-07-06T17:00:00.321552Z","submitted_at":"2023-12-07T19:40:50Z","title":"Llama Guard: LLM-based Input-Output Safeguard for Human-AI Conversations"},"reference_resolution":{"displayed":12,"state_counts":{"malformed_identifier":0,"metadata_mismatch":2,"parse_uncertain":0,"unresolved":0,"verified_exact":7,"verified_fuzzy":3},"total_outbound_references":12},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 12 of 12 outbound references and 100 inbound Pith citation observations for arXiv:2312.06674."}