{"as_of":"2026-08-05T19:45:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:73f6d928132a00549685bf3b784a8a9ebf6805abd586b64597f99908473099c3","coverage":[{"denominator":25,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":25,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-13T01:10:19.056406Z","state":"measured"},{"denominator":25,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":25,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-05T06:32:48.257954+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2605.11664/citation-record","integrity":"/paper/2605.11664/integrity","json":"/paper/2605.11664/citation-record.json","paper":"/paper/2605.11664"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Many-shot jailbreaking","venue":null,"work_id":"10927dbd-1e95-430e-9300-08d5a4b77620","year":2024},"citing_paper":{"arxiv_id":"2605.11664","last_updated":"2026-05-12T07:23:02Z","snapshot_observed_at":"2026-07-06T23:23:30.499023Z","submitted_at":"2026-05-12T07:23:02Z","title":"Safety Context Injection: Inference-Time Safety Alignment via Static Filtering and Agentic Analysis","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-13T01:10:19.056406Z"},"links":{"citing_paper":"/paper/2605.11664"},"observation_digest":"sha256:2b0a4d9d6cbdb29fd37688759f0920c859fa7b26c3bffb4932dab1b0a7c58b74","observation_id":"98bd9b8e-5647-4815-9c31-1e49a45e9088","resolution":{"observed_at":"2026-05-13T15:37:56.153649Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2505.17519","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-02T07:46:46.536714Z","title":"Chain-of-lure: A universal jailbreak attack framework using uncon- strained synthetic narratives","venue":null,"work_id":"7fd2d642-5e2e-41d5-bb3e-6121679e80ee","year":2026},"citing_paper":{"arxiv_id":"2605.11664","last_updated":"2026-05-12T07:23:02Z","snapshot_observed_at":"2026-07-06T23:23:30.499023Z","submitted_at":"2026-05-12T07:23:02Z","title":"Safety Context Injection: Inference-Time Safety Alignment via Static Filtering and Agentic Analysis","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-13T01:10:19.056406Z"},"links":{"citing_paper":"/paper/2605.11664"},"observation_digest":"sha256:841ce2f3ee0ab3fa06bdc76686851191b7fe43af621dfdb672daaeff07f62256","observation_id":"113adb3c-9025-4053-872a-dd6347b27fec","resolution":{"observed_at":"2026-05-13T01:52:06.163429Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Jailbreaking black box large language models in twenty queries, in: 2025 IEEE Conference on Secure and Trustworthy Ma- chine Learning (SaTML), IEEE","venue":null,"work_id":"4c0b71d1-aff7-49a8-939e-8880f88fadf9","year":2025},"citing_paper":{"arxiv_id":"2605.11664","last_updated":"2026-05-12T07:23:02Z","snapshot_observed_at":"2026-07-06T23:23:30.499023Z","submitted_at":"2026-05-12T07:23:02Z","title":"Safety Context Injection: Inference-Time Safety Alignment via Static Filtering and Agentic Analysis","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-13T01:10:19.056406Z"},"links":{"citing_paper":"/paper/2605.11664"},"observation_digest":"sha256:923ee1977d98d73f1b6fceafd277de4abc008209ad467d6bc776c7af1c84ee6b","observation_id":"30b88ccb-7d1f-437a-b43e-3d9fed6200a8","resolution":{"observed_at":"2026-05-13T15:37:56.155470Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2025.35834","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"En- hancing container security through phase-based system call filtering","venue":null,"work_id":"9f691993-14f4-4f25-9392-b2c52ee82583","year":2025},"citing_paper":{"arxiv_id":"2605.11664","last_updated":"2026-05-12T07:23:02Z","snapshot_observed_at":"2026-07-06T23:23:30.499023Z","submitted_at":"2026-05-12T07:23:02Z","title":"Safety Context Injection: Inference-Time Safety Alignment via Static Filtering and Agentic Analysis","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-13T01:10:19.056406Z"},"links":{"citing_paper":"/paper/2605.11664"},"observation_digest":"sha256:f9eab01e0e97dc168b90bd7fd14ffc614f9526e3a33ea2bdd502bb962240ee8f","observation_id":"00b1c0c5-2394-4282-b13e-7435b6e85286","resolution":{"observed_at":"2026-05-13T01:52:06.157839Z","resolver_source":"arxiv_id","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"StruQ: De- fending against prompt injection with structured queries, in: 34th USENIXSecuritySymposium(USENIXSecurity25),USENIXAs- sociation.pp.2383–2400","venue":null,"work_id":"fcc45d12-dbbb-4e4f-b4f4-3eb2f57182ce","year":null},"citing_paper":{"arxiv_id":"2605.11664","last_updated":"2026-05-12T07:23:02Z","snapshot_observed_at":"2026-07-06T23:23:30.499023Z","submitted_at":"2026-05-12T07:23:02Z","title":"Safety Context Injection: Inference-Time Safety Alignment via Static Filtering and Agentic Analysis","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-13T01:10:19.056406Z"},"links":{"citing_paper":"/paper/2605.11664"},"observation_digest":"sha256:4206b89a2b61fe4b8be2eab632393678ee0067c669de9f7f64274c15a82a7dab","observation_id":"9ec9b13c-3d89-477a-b8c4-2364469c8424","resolution":{"observed_at":"2026-05-13T15:37:56.151763Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"ARGS: Alignment as reward-guided search, in: The Twelfth International Conference on Learning Representations","venue":null,"work_id":"20342cba-87da-465e-9aa6-778a29c6104a","year":2024},"citing_paper":{"arxiv_id":"2605.11664","last_updated":"2026-05-12T07:23:02Z","snapshot_observed_at":"2026-07-06T23:23:30.499023Z","submitted_at":"2026-05-12T07:23:02Z","title":"Safety Context Injection: Inference-Time Safety Alignment via Static Filtering and Agentic Analysis","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-13T01:10:19.056406Z"},"links":{"citing_paper":"/paper/2605.11664"},"observation_digest":"sha256:62ecb54c054f290f94fc07b8a86efa49090e820ea4639b7aa06ce0d3cbc24f65","observation_id":"4252bbb5-f9f5-492b-b451-04355bf27a84","resolution":{"observed_at":"2026-05-13T15:37:56.139639Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"8ed66c46-b83c-4f1f-971c-90e08bacdce8","year":2025},"citing_paper":{"arxiv_id":"2605.11664","last_updated":"2026-05-12T07:23:02Z","snapshot_observed_at":"2026-07-06T23:23:30.499023Z","submitted_at":"2026-05-12T07:23:02Z","title":"Safety Context Injection: Inference-Time Safety Alignment via Static Filtering and Agentic Analysis","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-13T01:10:19.056406Z"},"links":{"citing_paper":"/paper/2605.11664"},"observation_digest":"sha256:7064fd0eaf95ac1993b5cb279c92bd5e7dcdf4410d9741081c7b7d7dbbcd21ae","observation_id":"0a960c92-ce0d-466f-bcd1-70c801634bf1","resolution":{"observed_at":"2026-05-13T15:37:56.141163Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2024.emnlp-main.33","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Evaluating the","venue":null,"work_id":"7dc4bc93-217a-4f7b-8194-4ca81a8e17a7","year":2024},"citing_paper":{"arxiv_id":"2605.11664","last_updated":"2026-05-12T07:23:02Z","snapshot_observed_at":"2026-07-06T23:23:30.499023Z","submitted_at":"2026-05-12T07:23:02Z","title":"Safety Context Injection: Inference-Time Safety Alignment via Static Filtering and Agentic Analysis","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-13T01:10:19.056406Z"},"links":{"citing_paper":"/paper/2605.11664"},"observation_digest":"sha256:b544fb54c53c804070f78daac873868cd071999f91704faff0fbe54eec066d63","observation_id":"440878e7-ffaa-445d-a9da-ded061f8ea64","resolution":{"observed_at":"2026-05-13T01:11:59.761123Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.10846","last_updated":"2026-04-16T13:52:09Z","snapshot_observed_at":"2026-08-03T03:52:26.701470Z","submitted_at":"2025-05-16T04:37:12Z","title":"AutoRAN: Automated Hijacking of Safety Reasoning in Large Reasoning Models","version":3},"cited_work":{"arxiv_id":"2505.10846","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.10846","snapshot_observed_at":"2026-07-01T08:55:35.577277Z","title":"AutoRAN: Automated Hijacking of Safety Reasoning in Large Reasoning Models","venue":"cs.LG","work_id":"32fb739a-4dab-48c5-bd16-03cf4bcda360","year":2025},"citing_paper":{"arxiv_id":"2605.11664","last_updated":"2026-05-12T07:23:02Z","snapshot_observed_at":"2026-07-06T23:23:30.499023Z","submitted_at":"2026-05-12T07:23:02Z","title":"Safety Context Injection: Inference-Time Safety Alignment via Static Filtering and Agentic Analysis","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-13T01:10:19.056406Z"},"links":{"cited_paper":"/paper/2505.10846","citing_paper":"/paper/2605.11664"},"observation_digest":"sha256:3b8c068da56ac70da5cc4fbe6e445218d507d920a3afb026c4b463221680506c","observation_id":"61e681aa-0296-40ac-86e0-05e1c3852a45","resolution":{"observed_at":"2026-05-13T01:52:06.151969Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2024.emnlp-main.164","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":null,"venue":null,"work_id":"ddd1f226-5c72-4bcc-918c-b97693fd53dd","year":2024},"citing_paper":{"arxiv_id":"2605.11664","last_updated":"2026-05-12T07:23:02Z","snapshot_observed_at":"2026-07-06T23:23:30.499023Z","submitted_at":"2026-05-12T07:23:02Z","title":"Safety Context Injection: Inference-Time Safety Alignment via Static Filtering and Agentic Analysis","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-13T01:10:19.056406Z"},"links":{"citing_paper":"/paper/2605.11664"},"observation_digest":"sha256:b9c38aedf6830ede295edbff0706f28e839029aa6864f694bec3158c20177a63","observation_id":"9164322c-79ec-4ce3-accf-0772473f2817","resolution":{"observed_at":"2026-05-13T01:11:59.756994Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"0ef7814a-2904-4037-bd7f-2c3a4cfa84d4","year":null},"citing_paper":{"arxiv_id":"2605.11664","last_updated":"2026-05-12T07:23:02Z","snapshot_observed_at":"2026-07-06T23:23:30.499023Z","submitted_at":"2026-05-12T07:23:02Z","title":"Safety Context Injection: Inference-Time Safety Alignment via Static Filtering and Agentic Analysis","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-13T01:10:19.056406Z"},"links":{"citing_paper":"/paper/2605.11664"},"observation_digest":"sha256:0c066c30ff1df96239634fab7d806ebf7cfdf8cce5e730feb60beb061b863561","observation_id":"ce33359b-e118-4989-97fd-78f680407f8b","resolution":{"observed_at":"2026-05-13T15:37:56.136146Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"5e9adcd8-a3ad-460b-9430-6b3106a5540f","year":null},"citing_paper":{"arxiv_id":"2605.11664","last_updated":"2026-05-12T07:23:02Z","snapshot_observed_at":"2026-07-06T23:23:30.499023Z","submitted_at":"2026-05-12T07:23:02Z","title":"Safety Context Injection: Inference-Time Safety Alignment via Static Filtering and Agentic Analysis","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-13T01:10:19.056406Z"},"links":{"citing_paper":"/paper/2605.11664"},"observation_digest":"sha256:258034c68d423594b4e15710afcd258f3d737b40c828be4f216eb8846e9392b8","observation_id":"6c14c8c0-a788-4f50-bd9e-51798a2d2e18","resolution":{"observed_at":"2026-05-13T15:37:56.134199Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"9c24bed3-ae73-4631-9ac2-8cd530c9f3e4","year":2025},"citing_paper":{"arxiv_id":"2605.11664","last_updated":"2026-05-12T07:23:02Z","snapshot_observed_at":"2026-07-06T23:23:30.499023Z","submitted_at":"2026-05-12T07:23:02Z","title":"Safety Context Injection: Inference-Time Safety Alignment via Static Filtering and Agentic Analysis","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-13T01:10:19.056406Z"},"links":{"citing_paper":"/paper/2605.11664"},"observation_digest":"sha256:285b0eac350a980e290beccec7c87511e6c625c00d8c0b5a553cff015d728840","observation_id":"8713df86-cf83-4569-8be4-5968870ef5ef","resolution":{"observed_at":"2026-05-13T15:37:56.137644Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Training language models to follow instructions with human feedback, in: Advances in Neural Information Processing Systems, pp","venue":null,"work_id":"4100de3e-c327-42c8-ad22-6a70bc1c3ef9","year":2022},"citing_paper":{"arxiv_id":"2605.11664","last_updated":"2026-05-12T07:23:02Z","snapshot_observed_at":"2026-07-06T23:23:30.499023Z","submitted_at":"2026-05-12T07:23:02Z","title":"Safety Context Injection: Inference-Time Safety Alignment via Static Filtering and Agentic Analysis","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-13T01:10:19.056406Z"},"links":{"citing_paper":"/paper/2605.11664"},"observation_digest":"sha256:3366fccf50f73a2e81a4b3f9e63ff51951ee27085cac5bd424ead51e0d019f2c","observation_id":"690f3d4a-f0ec-45b4-a72e-484b83becd53","resolution":{"observed_at":"2026-05-13T15:37:56.142888Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/d19-1410","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T01:56:41.012481Z","title":"Sentence- BERT : Sentence Embeddings using S iamese BERT -Networks","venue":"Proceedings of the 2019 Conference on Empirical Methods in Natural Language Processing and the 9th International Joint Conference on Natural Language Processing (EMNLP-IJCNLP)","work_id":"cf07889b-1f35-4d81-9514-4ad3ed223c57","year":2019},"citing_paper":{"arxiv_id":"2605.11664","last_updated":"2026-05-12T07:23:02Z","snapshot_observed_at":"2026-07-06T23:23:30.499023Z","submitted_at":"2026-05-12T07:23:02Z","title":"Safety Context Injection: Inference-Time Safety Alignment via Static Filtering and Agentic Analysis","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-13T01:10:19.056406Z"},"links":{"citing_paper":"/paper/2605.11664"},"observation_digest":"sha256:122063a2943ef80995e1cbd426a48fd395c4f40c39a34e7a83708385a6f9aff1","observation_id":"a84b1c2b-2c62-4fbc-b683-040775c718e4","resolution":{"observed_at":"2026-05-13T01:11:59.769102Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-07-20T15:23:54.681257+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-20T15:23:54.681257+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"8644.367038","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-01T01:45:13.804320Z","title":"”do anything now","venue":null,"work_id":"0a910063-5a55-4e98-bde5-780963aa72ff","year":2024},"citing_paper":{"arxiv_id":"2605.11664","last_updated":"2026-05-12T07:23:02Z","snapshot_observed_at":"2026-07-06T23:23:30.499023Z","submitted_at":"2026-05-12T07:23:02Z","title":"Safety Context Injection: Inference-Time Safety Alignment via Static Filtering and Agentic Analysis","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-13T01:10:19.056406Z"},"links":{"citing_paper":"/paper/2605.11664"},"observation_digest":"sha256:27f989d10b536710ce4182ed2a2c0b0c940213fa13cdef21ca45d19bc6150e7f","observation_id":"d8420dee-18f0-408f-8a1e-14635d279381","resolution":{"observed_at":"2026-05-13T01:11:59.782368Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Jailbroken: How does LLM safety training fail?, in: Advances in Neural Information Processing Systems, pp","venue":null,"work_id":"6a035ffb-eb97-427c-b887-852085b338eb","year":2023},"citing_paper":{"arxiv_id":"2605.11664","last_updated":"2026-05-12T07:23:02Z","snapshot_observed_at":"2026-07-06T23:23:30.499023Z","submitted_at":"2026-05-12T07:23:02Z","title":"Safety Context Injection: Inference-Time Safety Alignment via Static Filtering and Agentic Analysis","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-13T01:10:19.056406Z"},"links":{"citing_paper":"/paper/2605.11664"},"observation_digest":"sha256:cb4eee39f0bb97a556204d6855c420b1f91f75b22a08463864f8477c4b783e0a","observation_id":"db43380d-86d4-4aed-9b6f-9f60ebb3f086","resolution":{"observed_at":"2026-05-13T15:37:56.146580Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Chain-of-thought prompting elicits reasoning in large language models, in: Ad- vances in Neural Information Processing Systems, pp","venue":null,"work_id":"7cd7df05-11cb-4a1e-9ddf-1059498205c9","year":2022},"citing_paper":{"arxiv_id":"2605.11664","last_updated":"2026-05-12T07:23:02Z","snapshot_observed_at":"2026-07-06T23:23:30.499023Z","submitted_at":"2026-05-12T07:23:02Z","title":"Safety Context Injection: Inference-Time Safety Alignment via Static Filtering and Agentic Analysis","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-13T01:10:19.056406Z"},"links":{"citing_paper":"/paper/2605.11664"},"observation_digest":"sha256:b480b5abbeee0cdec1f577f6166e4fa73a891fbaa32f2d5367a1c8cfaccc8b72","observation_id":"6734016a-cc9a-4339-a1bd-6a1e7bc1d6e3","resolution":{"observed_at":"2026-05-13T15:37:56.132695Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Instructional segment embedding:ImprovingLLMsafetywithinstructionhierarchy,in:The Thirteenth International Conference on Learning Representations","venue":null,"work_id":"dbe567fa-83c6-4247-bacd-c5057e57aca3","year":2025},"citing_paper":{"arxiv_id":"2605.11664","last_updated":"2026-05-12T07:23:02Z","snapshot_observed_at":"2026-07-06T23:23:30.499023Z","submitted_at":"2026-05-12T07:23:02Z","title":"Safety Context Injection: Inference-Time Safety Alignment via Static Filtering and Agentic Analysis","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-13T01:10:19.056406Z"},"links":{"citing_paper":"/paper/2605.11664"},"observation_digest":"sha256:cc4a88f940c8249b9f75bacd00ea65becb815d9b99c58d2aaa9581c6cf7293ca","observation_id":"a4eec750-f42e-48d8-8b69-1b6efcd2f27f","resolution":{"observed_at":"2026-05-13T15:37:56.144827Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2025.findings-acl.23","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"URL:https://aclanthology.org/2025","venue":null,"work_id":"7fede401-3577-42f2-9224-997cb14fd922","year":2025},"citing_paper":{"arxiv_id":"2605.11664","last_updated":"2026-05-12T07:23:02Z","snapshot_observed_at":"2026-07-06T23:23:30.499023Z","submitted_at":"2026-05-12T07:23:02Z","title":"Safety Context Injection: Inference-Time Safety Alignment via Static Filtering and Agentic Analysis","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-13T01:10:19.056406Z"},"links":{"citing_paper":"/paper/2605.11664"},"observation_digest":"sha256:7991ae54e84badcdcfd32d34f44e2d870f55bb68c4a7b86156dae45974d34fef","observation_id":"11213c14-8d22-408f-8d8a-6e1e527b897c","resolution":{"observed_at":"2026-05-13T01:11:59.775046Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2024.acl-long.303","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"SafeDecoding: Defending against Jailbreak Attacks via Safety -Aware Decoding","venue":null,"work_id":"811ac4f3-8ae9-4a24-bf58-a5db80755f7c","year":2024},"citing_paper":{"arxiv_id":"2605.11664","last_updated":"2026-05-12T07:23:02Z","snapshot_observed_at":"2026-07-06T23:23:30.499023Z","submitted_at":"2026-05-12T07:23:02Z","title":"Safety Context Injection: Inference-Time Safety Alignment via Static Filtering and Agentic Analysis","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-13T01:10:19.056406Z"},"links":{"citing_paper":"/paper/2605.11664"},"observation_digest":"sha256:c649e540f9f25989695846261b27fb03d30ece19e6905c36b2335b8fb36921c9","observation_id":"03a1d0d3-c46a-4bbb-a0b0-8f988f95b13e","resolution":{"observed_at":"2026-05-13T01:11:59.765356Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2024.naacl-long.337","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"doi: 10.18653/v1/2024.naacl-long.337","venue":null,"work_id":"283cba92-617d-4087-bea5-447b44cfabf5","year":2024},"citing_paper":{"arxiv_id":"2605.11664","last_updated":"2026-05-12T07:23:02Z","snapshot_observed_at":"2026-07-06T23:23:30.499023Z","submitted_at":"2026-05-12T07:23:02Z","title":"Safety Context Injection: Inference-Time Safety Alignment via Static Filtering and Agentic Analysis","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-13T01:10:19.056406Z"},"links":{"citing_paper":"/paper/2605.11664"},"observation_digest":"sha256:d3365c4fe977439b27165378653c522126ada7c55f1a65d2b5531d46ee2a1005","observation_id":"17db23be-703a-449f-87bd-d63f6e515c4f","resolution":{"observed_at":"2026-05-13T01:11:59.788022Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-07-12T03:19:36.176665+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-12T03:19:36.176665+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"LLM-Fuzzer: Scaling assessment of large language model jailbreaks, in: 33rd USENIX Security Symposium (USENIX Security 24), USENIX Association, Philadelphia, PA","venue":null,"work_id":"8f928fc5-9703-4e30-b91a-e92296d78d44","year":null},"citing_paper":{"arxiv_id":"2605.11664","last_updated":"2026-05-12T07:23:02Z","snapshot_observed_at":"2026-07-06T23:23:30.499023Z","submitted_at":"2026-05-12T07:23:02Z","title":"Safety Context Injection: Inference-Time Safety Alignment via Static Filtering and Agentic Analysis","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-13T01:10:19.056406Z"},"links":{"citing_paper":"/paper/2605.11664"},"observation_digest":"sha256:3a836101ca1c5538d3d39916679d5e88e92390cebb6493eb91da8fb2b3941a6b","observation_id":"e9f264b8-b038-48ca-b7aa-23da0c1284a6","resolution":{"observed_at":"2026-05-13T15:37:56.148404Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"65177108-0652-475e-91cd-a437ab8671c4","year":null},"citing_paper":{"arxiv_id":"2605.11664","last_updated":"2026-05-12T07:23:02Z","snapshot_observed_at":"2026-07-06T23:23:30.499023Z","submitted_at":"2026-05-12T07:23:02Z","title":"Safety Context Injection: Inference-Time Safety Alignment via Static Filtering and Agentic Analysis","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-13T01:10:19.056406Z"},"links":{"citing_paper":"/paper/2605.11664"},"observation_digest":"sha256:19a31110d7349c2314dd6edcc3a03eb8f63d2a954d87c7e9a06e030e21131608","observation_id":"ffff0719-a46f-4a7c-a4ee-fbf055d9f392","resolution":{"observed_at":"2026-05-13T15:37:56.150069Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2024.acl-long.481","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":null,"venue":null,"work_id":"6f41f7e2-15ef-4a7a-a4c7-b58cf34f1730","year":2024},"citing_paper":{"arxiv_id":"2605.11664","last_updated":"2026-05-12T07:23:02Z","snapshot_observed_at":"2026-07-06T23:23:30.499023Z","submitted_at":"2026-05-12T07:23:02Z","title":"Safety Context Injection: Inference-Time Safety Alignment via Static Filtering and Agentic Analysis","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-13T01:10:19.056406Z"},"links":{"citing_paper":"/paper/2605.11664"},"observation_digest":"sha256:1a2e8abdb61e512eef9d4cb5c9447cf1965634b470491c3774be0255e3ae8178","observation_id":"7cce0e09-d51c-486d-adfc-3fbeb799ab6b","resolution":{"observed_at":"2026-05-13T01:11:59.750527Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2605.11664","last_updated":"2026-05-12T07:23:02Z","latest_version":1,"primary_category":"cs.CR","snapshot_observed_at":"2026-07-06T23:23:30.499023Z","submitted_at":"2026-05-12T07:23:02Z","title":"Safety Context Injection: Inference-Time Safety Alignment via Static Filtering and Agentic Analysis"},"reference_resolution":{"displayed":25,"state_counts":{"malformed_identifier":2,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":4,"verified_exact":10,"verified_fuzzy":9},"total_outbound_references":25},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"thesis":"As of 5 August 2026, this Paper Citation Record lists 25 of 25 outbound references and 0 inbound Pith citation observations for arXiv:2605.11664."}