{"as_of":"2026-08-07T22:04:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:502c290cf83b35d4e95b041493ef83eee16ffd87918c2d02f383345331e3ca5f","coverage":[{"denominator":50,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":50,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-28T14:51:17.667213Z","state":"measured"},{"denominator":51,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":51,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-01T07:36:57.627890Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2606.02041","last_updated":"2026-06-01T10:30:08Z","snapshot_observed_at":"2026-08-06T02:57:08.156185Z","submitted_at":"2026-06-01T10:30:08Z","title":"SentGuard: Sentence-Level Streaming Guardrails for Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2606.02041","snapshot_observed_at":"2026-08-01T07:36:57.627890Z","title":"Zhang, Y.; et al","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.21401","last_updated":"2026-07-23T15:02:24Z","snapshot_observed_at":"2026-08-04T03:07:11.235926Z","submitted_at":"2026-07-23T15:02:24Z","title":"When Are Reasoning-Based Guardrails Not Efficient? ResponseGuard: A Fast Vision-Language Guard for Real-Time Moderation","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-01T07:36:57.627890Z"},"links":{"cited_paper":"/paper/2606.02041","citing_paper":"/paper/2607.21401"},"observation_digest":"sha256:4909202320495f79b1336ee27388c3c29dee46d85bf25c4e552eae564aad24c8","observation_id":"61ec8934-93db-40e0-bf65-3a98a7955585","resolution":{"observed_at":"2026-08-01T07:36:57.627890Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2606.02041/citation-record","integrity":"/paper/2606.02041/integrity","json":"/paper/2606.02041/citation-record.json","paper":"/paper/2606.02041"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:51:17.667213Z","title":"Findings of the Association for Computational Linguistics: ACL 2025 , pages=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.02041","last_updated":"2026-06-01T10:30:08Z","snapshot_observed_at":"2026-08-06T02:57:08.156185Z","submitted_at":"2026-06-01T10:30:08Z","title":"SentGuard: Sentence-Level Streaming Guardrails for Large Language Models","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-06-28T14:51:17.667213Z"},"links":{"citing_paper":"/paper/2606.02041"},"observation_digest":"sha256:8f16cf46c3ee9138f81becc0be6b59eaab4cab42226138a6e5364164258c7a78","observation_id":"08221678-8e09-4bea-878a-3ea6cdd8805f","resolution":{"observed_at":"2026-06-28T14:51:17.667213Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:51:17.667213Z","title":"2025 , eprint=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.02041","last_updated":"2026-06-01T10:30:08Z","snapshot_observed_at":"2026-08-06T02:57:08.156185Z","submitted_at":"2026-06-01T10:30:08Z","title":"SentGuard: Sentence-Level Streaming Guardrails for Large Language Models","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-06-28T14:51:17.667213Z"},"links":{"citing_paper":"/paper/2606.02041"},"observation_digest":"sha256:dc9c80c80704496a64990e763b3a069ca6016a49b076e5683e6744de9f646086","observation_id":"749008bf-6985-48a1-8568-637a41a492a8","resolution":{"observed_at":"2026-06-28T14:51:17.667213Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:51:17.667213Z","title":"Proceedings of the AAAI Conference on Artificial Intelligence , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.02041","last_updated":"2026-06-01T10:30:08Z","snapshot_observed_at":"2026-08-06T02:57:08.156185Z","submitted_at":"2026-06-01T10:30:08Z","title":"SentGuard: Sentence-Level Streaming Guardrails for Large Language Models","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-06-28T14:51:17.667213Z"},"links":{"citing_paper":"/paper/2606.02041"},"observation_digest":"sha256:d45c272fcf0b1e9a0ccac4bfe013c5a5fbf243b89d5ff5830bf6c42caba1aa7a","observation_id":"94480dc4-715e-4fb3-bfd2-d1b799dd3ea3","resolution":{"observed_at":"2026-06-28T14:51:17.667213Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:51:17.667213Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.02041","last_updated":"2026-06-01T10:30:08Z","snapshot_observed_at":"2026-08-06T02:57:08.156185Z","submitted_at":"2026-06-01T10:30:08Z","title":"SentGuard: Sentence-Level Streaming Guardrails for Large Language Models","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-06-28T14:51:17.667213Z"},"links":{"citing_paper":"/paper/2606.02041"},"observation_digest":"sha256:a6e446c27077fefe6ca48c8b7bbf8ee060f4ddfdbdd613bd0f5b4d374f736c3e","observation_id":"489438ef-8562-445c-8fa7-f8d72dad754d","resolution":{"observed_at":"2026-06-28T14:51:17.667213Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:51:17.667213Z","title":"Proceedings of the 63rd Annual Meeting of the Association for Computational Linguistics (Volume 1: Long Papers) , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.02041","last_updated":"2026-06-01T10:30:08Z","snapshot_observed_at":"2026-08-06T02:57:08.156185Z","submitted_at":"2026-06-01T10:30:08Z","title":"SentGuard: Sentence-Level Streaming Guardrails for Large Language Models","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-06-28T14:51:17.667213Z"},"links":{"citing_paper":"/paper/2606.02041"},"observation_digest":"sha256:79cb91f03b2eba796f3b2e57b3c309a8818609bc12cc7f4ded93778d0f58ceab","observation_id":"30bcb931-eb38-4cc4-bd72-a5664cdef8a0","resolution":{"observed_at":"2026-06-28T14:51:17.667213Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:51:17.667213Z","title":"Proceedings of the 2024 Conference of the North American Chapter of the Association for Computational Linguistics: Human Language Technologies (Volume 1: Long Papers) , pages=","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.02041","last_updated":"2026-06-01T10:30:08Z","snapshot_observed_at":"2026-08-06T02:57:08.156185Z","submitted_at":"2026-06-01T10:30:08Z","title":"SentGuard: Sentence-Level Streaming Guardrails for Large Language Models","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-06-28T14:51:17.667213Z"},"links":{"citing_paper":"/paper/2606.02041"},"observation_digest":"sha256:42fee53a7fd55225f619d46b05d157922a5ef855505697fcb982dedf15889beb","observation_id":"39d70c70-6c50-4ea2-80b3-3dd98e44be37","resolution":{"observed_at":"2026-06-28T14:51:17.667213Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:51:17.667213Z","title":"Advances in neural information processing systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.02041","last_updated":"2026-06-01T10:30:08Z","snapshot_observed_at":"2026-08-06T02:57:08.156185Z","submitted_at":"2026-06-01T10:30:08Z","title":"SentGuard: Sentence-Level Streaming Guardrails for Large Language Models","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-06-28T14:51:17.667213Z"},"links":{"citing_paper":"/paper/2606.02041"},"observation_digest":"sha256:eab657f166e34343327e67e980ce731a82db91e630ebd1aef8ce37ada3700451","observation_id":"f5a5f80f-ffaa-4de5-99d8-0add7a733e8b","resolution":{"observed_at":"2026-06-28T14:51:17.667213Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2510.14276","last_updated":"2025-10-16T04:00:18Z","snapshot_observed_at":"2026-07-06T22:32:47.087967Z","submitted_at":"2025-10-16T04:00:18Z","title":"Qwen3Guard Technical Report","version":1},"cited_work":{"arxiv_id":"2510.14276","doi":"10.48550/arxiv.2510.14276","metadata_source":"pith","pith_arxiv_id":"2510.14276","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Qwen3Guard Technical Report","venue":"cs.CL","work_id":"de1c5964-d29a-456c-97cc-30684b243a85","year":2025},"citing_paper":{"arxiv_id":"2606.02041","last_updated":"2026-06-01T10:30:08Z","snapshot_observed_at":"2026-08-06T02:57:08.156185Z","submitted_at":"2026-06-01T10:30:08Z","title":"SentGuard: Sentence-Level Streaming Guardrails for Large Language Models","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-06-28T14:51:17.667213Z"},"links":{"cited_paper":"/paper/2510.14276","citing_paper":"/paper/2606.02041"},"observation_digest":"sha256:6a1d9714fced6aca99e00d2e1dca32dfe60d79e2c98d9d300db206ee3d852c7e","observation_id":"a3361792-4000-4263-9bbe-dc4bf030ba50","resolution":{"observed_at":"2026-07-01T22:56:20.738256Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":"2407.21783","doi":"10.1016/s0749-0720(15","metadata_source":"pith","pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"The Llama 3 Herd of Models","venue":"cs.AI","work_id":"1549a635-88af-4ac1-acfe-51ae7bb53345","year":2024},"citing_paper":{"arxiv_id":"2606.02041","last_updated":"2026-06-01T10:30:08Z","snapshot_observed_at":"2026-08-06T02:57:08.156185Z","submitted_at":"2026-06-01T10:30:08Z","title":"SentGuard: Sentence-Level Streaming Guardrails for Large Language Models","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-06-28T14:51:17.667213Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2606.02041"},"observation_digest":"sha256:9ffa5c366273dcb8683e4a11a3780d9b18e19920dd2000cc2e98e8b1e755ae30","observation_id":"af37e078-4aeb-4d15-ae60-17e7dd5ac006","resolution":{"observed_at":"2026-07-01T22:56:20.638678Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2601.15588","last_updated":"2026-07-02T12:42:02Z","snapshot_observed_at":"2026-08-04T10:32:44.442857Z","submitted_at":"2026-01-22T02:23:18Z","title":"YuFeng-XGuard: A Reasoning-Centric, Interpretable, and Flexible Guardrail Model for Large Language Models","version":2},"cited_work":{"arxiv_id":"2601.15588","doi":null,"metadata_source":"pith","pith_arxiv_id":"2601.15588","snapshot_observed_at":"2026-07-04T16:59:58.634519Z","title":"Yufeng-xguard: A reasoning-centric, interpretable, and flexible guardrail model for large language models","venue":"cs.CL","work_id":"f2853a9b-ad83-4742-8b29-5d579028cdd7","year":2026},"citing_paper":{"arxiv_id":"2606.02041","last_updated":"2026-06-01T10:30:08Z","snapshot_observed_at":"2026-08-06T02:57:08.156185Z","submitted_at":"2026-06-01T10:30:08Z","title":"SentGuard: Sentence-Level Streaming Guardrails for Large Language Models","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-06-28T14:51:17.667213Z"},"links":{"cited_paper":"/paper/2601.15588","citing_paper":"/paper/2606.02041"},"observation_digest":"sha256:b1d1ef063e0c49a05accd43d58e1f077e245cd218b8ca23c155537ee7c301a68","observation_id":"65667fe6-9e7c-4217-92af-c38234a81f23","resolution":{"observed_at":"2026-07-03T02:17:08.913996Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09388","last_updated":"2025-05-14T13:41:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-14T13:41:34Z","title":"Qwen3 Technical Report","version":1},"cited_work":{"arxiv_id":"2505.09388","doi":"10.1016/j.aiopen.2022.12","metadata_source":"pith","pith_arxiv_id":"2505.09388","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Qwen3 Technical Report","venue":"cs.CL","work_id":"25a4e30c-1232-48e7-9925-02fa12ba7c9e","year":2025},"citing_paper":{"arxiv_id":"2606.02041","last_updated":"2026-06-01T10:30:08Z","snapshot_observed_at":"2026-08-06T02:57:08.156185Z","submitted_at":"2026-06-01T10:30:08Z","title":"SentGuard: Sentence-Level Streaming Guardrails for Large Language Models","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-06-28T14:51:17.667213Z"},"links":{"cited_paper":"/paper/2505.09388","citing_paper":"/paper/2606.02041"},"observation_digest":"sha256:158d6242b397fc3344c4807deca703213bb7f26c2599cc490307e8e4daf7f732","observation_id":"b9042564-4759-49fd-9915-606eb19b6dc2","resolution":{"observed_at":"2026-07-01T22:56:20.642058Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:51:17.667213Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.02041","last_updated":"2026-06-01T10:30:08Z","snapshot_observed_at":"2026-08-06T02:57:08.156185Z","submitted_at":"2026-06-01T10:30:08Z","title":"SentGuard: Sentence-Level Streaming Guardrails for Large Language Models","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-06-28T14:51:17.667213Z"},"links":{"citing_paper":"/paper/2606.02041"},"observation_digest":"sha256:86fb6720f15ff9a6cab80b5f296b644e56f7c511c840faf9c3fec0171d4b1da0","observation_id":"276ded80-4c51-47ac-8a9a-3f29fc95b663","resolution":{"observed_at":"2026-06-28T14:51:17.667213Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.06261","last_updated":"2025-12-19T14:25:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-07-07T17:36:04Z","title":"Gemini 2.5: Pushing the Frontier with Advanced Reasoning, Multimodality, Long Context, and Next Generation Agentic Capabilities","version":6},"cited_work":{"arxiv_id":"2507.06261","doi":"10.48550/arxiv.2503.19","metadata_source":"pith","pith_arxiv_id":"2507.06261","snapshot_observed_at":"2026-07-11T03:17:51.364436Z","title":"Gemini 2.5: Pushing the Frontier with Advanced Reasoning, Multimodality, Long Context, and Next Generation Agentic Capabilities","venue":"cs.CL","work_id":"008df105-2fdd-45d8-857a-8e35868aecb6","year":2025},"citing_paper":{"arxiv_id":"2606.02041","last_updated":"2026-06-01T10:30:08Z","snapshot_observed_at":"2026-08-06T02:57:08.156185Z","submitted_at":"2026-06-01T10:30:08Z","title":"SentGuard: Sentence-Level Streaming Guardrails for Large Language Models","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-06-28T14:51:17.667213Z"},"links":{"cited_paper":"/paper/2507.06261","citing_paper":"/paper/2606.02041"},"observation_digest":"sha256:5240467b4677b75f789e5a00f80059cc338a0c3efc598976d18aef732859a89a","observation_id":"8ac40496-c239-41a1-bb74-f18d9eb0ed7e","resolution":{"observed_at":"2026-07-01T22:56:20.635274Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2601.11659","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-04T13:39:51.085161Z","title":"The Llama 4 Herd: Architecture, Training, Evaluation, and Deployment Notes","venue":null,"work_id":"64fc2bea-61f7-4ae6-9b1c-0cefaee5c228","year":2026},"citing_paper":{"arxiv_id":"2606.02041","last_updated":"2026-06-01T10:30:08Z","snapshot_observed_at":"2026-08-06T02:57:08.156185Z","submitted_at":"2026-06-01T10:30:08Z","title":"SentGuard: Sentence-Level Streaming Guardrails for Large Language Models","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-06-28T14:51:17.667213Z"},"links":{"citing_paper":"/paper/2606.02041"},"observation_digest":"sha256:ce40141862f502bf3fcc6d052225e568fbed59a1b7dd41af20175a0237e56f83","observation_id":"2024a68c-2fec-46c4-ab7e-ecca306ee4a0","resolution":{"observed_at":"2026-07-01T22:56:20.745121Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:51:17.667213Z","title":"0: A diverse ai safety dataset and risks taxonomy for alignment of llm guardrails , author=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.02041","last_updated":"2026-06-01T10:30:08Z","snapshot_observed_at":"2026-08-06T02:57:08.156185Z","submitted_at":"2026-06-01T10:30:08Z","title":"SentGuard: Sentence-Level Streaming Guardrails for Large Language Models","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-06-28T14:51:17.667213Z"},"links":{"citing_paper":"/paper/2606.02041"},"observation_digest":"sha256:6d24d380da5e23219473d3e21b0124682244524ca412cdbb9d251318ebf4e951","observation_id":"31a33f2c-4341-4f29-8dd8-dbe69b3ee78e","resolution":{"observed_at":"2026-06-28T14:51:17.667213Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2202.03286","last_updated":"2022-02-07T15:22:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-02-07T15:22:17Z","title":"Red Teaming Language Models with Language Models","version":1},"cited_work":{"arxiv_id":"2202.03286","doi":"10.48550/arxiv.2202.03286","metadata_source":"pith","pith_arxiv_id":"2202.03286","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Red Teaming Language Models with Language Models","venue":"cs.CL","work_id":"d1274c54-508f-42f9-aeb3-91db13f3a622","year":2022},"citing_paper":{"arxiv_id":"2606.02041","last_updated":"2026-06-01T10:30:08Z","snapshot_observed_at":"2026-08-06T02:57:08.156185Z","submitted_at":"2026-06-01T10:30:08Z","title":"SentGuard: Sentence-Level Streaming Guardrails for Large Language Models","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-06-28T14:51:17.667213Z"},"links":{"cited_paper":"/paper/2202.03286","citing_paper":"/paper/2606.02041"},"observation_digest":"sha256:545366d9f7264d6ad5fec698d30b7b0c7ba03121f78c69364d736ee37e3b3030","observation_id":"624ffb74-9820-4738-9cf9-de9d8321c797","resolution":{"observed_at":"2026-07-01T22:56:20.723506Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.13860","last_updated":"2024-03-10T13:58:08Z","snapshot_observed_at":"2026-07-06T15:31:18.144952Z","submitted_at":"2023-05-23T09:33:38Z","title":"Jailbreaking ChatGPT via Prompt Engineering: An Empirical Study","version":2},"cited_work":{"arxiv_id":"2305.13860","doi":"10.48550/arxiv.2305.13860","metadata_source":"pith","pith_arxiv_id":"2305.13860","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Jailbreaking ChatGPT via Prompt Engineering: An Empirical Study","venue":"cs.SE","work_id":"63e07f6a-433d-4bb2-ba7d-a8886e09211d","year":2023},"citing_paper":{"arxiv_id":"2606.02041","last_updated":"2026-06-01T10:30:08Z","snapshot_observed_at":"2026-08-06T02:57:08.156185Z","submitted_at":"2026-06-01T10:30:08Z","title":"SentGuard: Sentence-Level Streaming Guardrails for Large Language Models","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-06-28T14:51:17.667213Z"},"links":{"cited_paper":"/paper/2305.13860","citing_paper":"/paper/2606.02041"},"observation_digest":"sha256:505c5926187eab6b98c4368c015c31b125d419f9688dfe42d87f18c19570434d","observation_id":"f7fac74a-69c8-44e3-a198-0ea0e1eda8f7","resolution":{"observed_at":"2026-07-01T22:56:20.727019Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-05-24T11:53:04.272267+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-24T11:53:04.272267+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.11986","last_updated":"2023-10-31T18:23:32Z","snapshot_observed_at":"2026-08-02T09:23:01.679296Z","submitted_at":"2023-10-18T14:13:58Z","title":"Sociotechnical Safety Evaluation of Generative AI Systems","version":2},"cited_work":{"arxiv_id":"2310.11986","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2310.11986","snapshot_observed_at":"2026-07-04T12:39:48.761180Z","title":"Sociotechnical safety evaluation of generative ai systems","venue":null,"work_id":"30e90b0f-5bcf-4ade-8777-57a3469d7366","year":2023},"citing_paper":{"arxiv_id":"2606.02041","last_updated":"2026-06-01T10:30:08Z","snapshot_observed_at":"2026-08-06T02:57:08.156185Z","submitted_at":"2026-06-01T10:30:08Z","title":"SentGuard: Sentence-Level Streaming Guardrails for Large Language Models","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-06-28T14:51:17.667213Z"},"links":{"cited_paper":"/paper/2310.11986","citing_paper":"/paper/2606.02041"},"observation_digest":"sha256:a6ac7e9a9a2129cef6814bc22c99e50a2d501f7553a42a5b309568e6eb09fe47","observation_id":"7a74cad9-6c8b-489f-a0cf-89f68af7691a","resolution":{"observed_at":"2026-07-01T22:56:20.708003Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.15221","last_updated":"2024-09-04T00:58:59Z","snapshot_observed_at":"2026-07-06T19:06:41.697671Z","submitted_at":"2024-08-27T17:33:30Z","title":"LLM Defenses Are Not Robust to Multi-Turn Human Jailbreaks Yet","version":2},"cited_work":{"arxiv_id":"2408.15221","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2408.15221","snapshot_observed_at":"2026-07-04T17:30:00.600665Z","title":"Llm defenses are not robust to multi-turn human jailbreaks yet","venue":null,"work_id":"9c0488b9-9f5f-4f7a-ba2b-55e43143aae7","year":2024},"citing_paper":{"arxiv_id":"2606.02041","last_updated":"2026-06-01T10:30:08Z","snapshot_observed_at":"2026-08-06T02:57:08.156185Z","submitted_at":"2026-06-01T10:30:08Z","title":"SentGuard: Sentence-Level Streaming Guardrails for Large Language Models","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-06-28T14:51:17.667213Z"},"links":{"cited_paper":"/paper/2408.15221","citing_paper":"/paper/2606.02041"},"observation_digest":"sha256:91434ca34ac70ba5bc6055d7fd469b6bd0bbb803b20a1a4e93c7d47e3ce8e3d8","observation_id":"284104f1-8e15-4221-b954-329445444012","resolution":{"observed_at":"2026-07-01T22:56:20.699869Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:51:17.667213Z","title":"2024 , url=","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.02041","last_updated":"2026-06-01T10:30:08Z","snapshot_observed_at":"2026-08-06T02:57:08.156185Z","submitted_at":"2026-06-01T10:30:08Z","title":"SentGuard: Sentence-Level Streaming Guardrails for Large Language Models","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-06-28T14:51:17.667213Z"},"links":{"citing_paper":"/paper/2606.02041"},"observation_digest":"sha256:f1d196bbfbaaf4fbedfb1ddc9ef5526d5a797845d372a967b39e27d48b23c411","observation_id":"3d02c5d4-d500-4a32-9179-73199c41865d","resolution":{"observed_at":"2026-06-28T14:51:17.667213Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.08073","last_updated":"2022-12-15T06:19:23Z","snapshot_observed_at":"2026-08-02T04:53:58.766070Z","submitted_at":"2022-12-15T06:19:23Z","title":"Constitutional AI: Harmlessness from AI Feedback","version":1},"cited_work":{"arxiv_id":"2212.08073","doi":"10.48550/arxiv.2212.08073","metadata_source":"pith","pith_arxiv_id":"2212.08073","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Constitutional AI: Harmlessness from AI Feedback","venue":"cs.CL","work_id":"faaaa4e0-2676-4fac-a0b4-99aef10d2095","year":2022},"citing_paper":{"arxiv_id":"2606.02041","last_updated":"2026-06-01T10:30:08Z","snapshot_observed_at":"2026-08-06T02:57:08.156185Z","submitted_at":"2026-06-01T10:30:08Z","title":"SentGuard: Sentence-Level Streaming Guardrails for Large Language Models","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-06-28T14:51:17.667213Z"},"links":{"cited_paper":"/paper/2212.08073","citing_paper":"/paper/2606.02041"},"observation_digest":"sha256:c1fabefc31c4e7ddded57315e4f993662c9a8e1ae945aafa1ed25a18768a1695","observation_id":"10aae749-3dce-41be-b771-0c26f1d66d2b","resolution":{"observed_at":"2026-07-01T22:56:20.711996Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-01T07:38:15.114855+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-01T07:38:15.114855+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2209.07858","last_updated":"2022-11-22T19:12:57Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-08-23T23:37:14Z","title":"Red Teaming Language Models to Reduce Harms: Methods, Scaling Behaviors, and Lessons Learned","version":2},"cited_work":{"arxiv_id":"2209.07858","doi":"10.1136/bcr-2013-201554","metadata_source":"pith","pith_arxiv_id":"2209.07858","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Red Teaming Language Models to Reduce Harms: Methods, Scaling Behaviors, and Lessons Learned","venue":"cs.CL","work_id":"1aabd84d-3779-4ba9-ba2f-15ce264a9b1e","year":2022},"citing_paper":{"arxiv_id":"2606.02041","last_updated":"2026-06-01T10:30:08Z","snapshot_observed_at":"2026-08-06T02:57:08.156185Z","submitted_at":"2026-06-01T10:30:08Z","title":"SentGuard: Sentence-Level Streaming Guardrails for Large Language Models","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-06-28T14:51:17.667213Z"},"links":{"cited_paper":"/paper/2209.07858","citing_paper":"/paper/2606.02041"},"observation_digest":"sha256:9cb90a2c0ab40dcab319165f36bc1825725b312390af7a30f4b5b29b7cf142ba","observation_id":"3d0a2954-c834-46a6-85aa-488e48bc9f94","resolution":{"observed_at":"2026-07-01T22:56:20.731059Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.00055","last_updated":"2024-12-28T07:48:57Z","snapshot_observed_at":"2026-07-06T20:14:54.297131Z","submitted_at":"2024-12-28T07:48:57Z","title":"LLM-Virus: Evolutionary Jailbreak Attack on Large Language Models","version":1},"cited_work":{"arxiv_id":"2501.00055","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.00055","snapshot_observed_at":"2026-07-01T22:56:20.739889Z","title":"arXiv preprint arXiv:2501.00055 , year=","venue":null,"work_id":"23b801a5-6e1d-4573-b1b0-3adc7adc31ea","year":null},"citing_paper":{"arxiv_id":"2606.02041","last_updated":"2026-06-01T10:30:08Z","snapshot_observed_at":"2026-08-06T02:57:08.156185Z","submitted_at":"2026-06-01T10:30:08Z","title":"SentGuard: Sentence-Level Streaming Guardrails for Large Language Models","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-06-28T14:51:17.667213Z"},"links":{"cited_paper":"/paper/2501.00055","citing_paper":"/paper/2606.02041"},"observation_digest":"sha256:e280e9f2c5a4822b75da7c781f42f1286a196c99eaafca2287552c05f877f612","observation_id":"683a1cd9-e373-4e38-ab13-995efadcf83a","resolution":{"observed_at":"2026-07-01T22:56:20.741880Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04249","last_updated":"2024-02-27T04:43:08Z","snapshot_observed_at":"2026-07-06T17:26:23.067923Z","submitted_at":"2024-02-06T18:59:08Z","title":"HarmBench: A Standardized Evaluation Framework for Automated Red Teaming and Robust Refusal","version":2},"cited_work":{"arxiv_id":"2402.04249","doi":"10.48550/arxiv.2402.04249","metadata_source":"pith","pith_arxiv_id":"2402.04249","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"HarmBench: A Standardized Evaluation Framework for Automated Red Teaming and Robust Refusal","venue":"cs.LG","work_id":"b0b0303f-2444-4789-a979-8153624312ff","year":2024},"citing_paper":{"arxiv_id":"2606.02041","last_updated":"2026-06-01T10:30:08Z","snapshot_observed_at":"2026-08-06T02:57:08.156185Z","submitted_at":"2026-06-01T10:30:08Z","title":"SentGuard: Sentence-Level Streaming Guardrails for Large Language Models","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-06-28T14:51:17.667213Z"},"links":{"cited_paper":"/paper/2402.04249","citing_paper":"/paper/2606.02041"},"observation_digest":"sha256:b52991bc9e3ecf7d438f876a9d0b2b872bae7a06d8f3070f5a378a43af6ac838","observation_id":"e95597a9-e747-4a0c-88f0-30e18e9cf35b","resolution":{"observed_at":"2026-07-01T22:56:20.752206Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:51:17.667213Z","title":"ACL , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.02041","last_updated":"2026-06-01T10:30:08Z","snapshot_observed_at":"2026-08-06T02:57:08.156185Z","submitted_at":"2026-06-01T10:30:08Z","title":"SentGuard: Sentence-Level Streaming Guardrails for Large Language Models","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-06-28T14:51:17.667213Z"},"links":{"citing_paper":"/paper/2606.02041"},"observation_digest":"sha256:cabf36ca873b9d6350fa7b57a88ce667590bd02ced20cd5e7f22a849f2556fba","observation_id":"f5d0dbdf-16eb-42ba-8d25-2e202f3e8f9d","resolution":{"observed_at":"2026-06-28T14:51:17.667213Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.15043","last_updated":"2023-12-20T20:48:57Z","snapshot_observed_at":"2026-07-06T15:59:23.019044Z","submitted_at":"2023-07-27T17:49:12Z","title":"Universal and Transferable Adversarial Attacks on Aligned Language Models","version":2},"cited_work":{"arxiv_id":"2307.15043","doi":"10.48550/arxiv.2307.15043","metadata_source":"pith","pith_arxiv_id":"2307.15043","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Universal and Transferable Adversarial Attacks on Aligned Language Models","venue":"cs.CL","work_id":"3322fa86-1768-4677-8425-dd326b45e078","year":2023},"citing_paper":{"arxiv_id":"2606.02041","last_updated":"2026-06-01T10:30:08Z","snapshot_observed_at":"2026-08-06T02:57:08.156185Z","submitted_at":"2026-06-01T10:30:08Z","title":"SentGuard: Sentence-Level Streaming Guardrails for Large Language Models","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-06-28T14:51:17.667213Z"},"links":{"cited_paper":"/paper/2307.15043","citing_paper":"/paper/2606.02041"},"observation_digest":"sha256:993107979bf3bf4a8fcf69d6243f9ff556309e830a9cddd56f159448dffe0476","observation_id":"b950aa26-7c2a-43ec-bb81-0b13fcd3f14d","resolution":{"observed_at":"2026-07-01T22:56:20.695633Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-07-15T23:50:40.271168+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-15T23:50:40.271168+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:51:17.667213Z","title":"IEEE SaTML , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.02041","last_updated":"2026-06-01T10:30:08Z","snapshot_observed_at":"2026-08-06T02:57:08.156185Z","submitted_at":"2026-06-01T10:30:08Z","title":"SentGuard: Sentence-Level Streaming Guardrails for Large Language Models","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-06-28T14:51:17.667213Z"},"links":{"citing_paper":"/paper/2606.02041"},"observation_digest":"sha256:a00722e48fbded83a6e2bf3f53b2a2260565a31e2139034521047fbe12385406","observation_id":"f81ad6ed-9673-431b-9b29-a29fb9a9333f","resolution":{"observed_at":"2026-06-28T14:51:17.667213Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.02119","last_updated":"2024-10-31T15:57:42Z","snapshot_observed_at":"2026-07-06T16:56:46.051958Z","submitted_at":"2023-12-04T18:49:23Z","title":"Tree of Attacks: Jailbreaking Black-Box LLMs Automatically","version":3},"cited_work":{"arxiv_id":"2312.02119","doi":"10.48550/arxiv.2312.02119","metadata_source":"pith","pith_arxiv_id":"2312.02119","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Tree of attacks: Jailbreaking black-box llms automatically","venue":"cs.LG","work_id":"21743458-a817-448a-b77b-559e707b5030","year":2023},"citing_paper":{"arxiv_id":"2606.02041","last_updated":"2026-06-01T10:30:08Z","snapshot_observed_at":"2026-08-06T02:57:08.156185Z","submitted_at":"2026-06-01T10:30:08Z","title":"SentGuard: Sentence-Level Streaming Guardrails for Large Language Models","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-06-28T14:51:17.667213Z"},"links":{"cited_paper":"/paper/2312.02119","citing_paper":"/paper/2606.02041"},"observation_digest":"sha256:bb27d9dfce61ec41d94e831c70a6adef95d561919ad46d6db1a5c5e279a4d4c7","observation_id":"5f197b6b-7e0c-4854-b61f-b156da67f12f","resolution":{"observed_at":"2026-07-01T22:56:20.704212Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-05-24T00:53:06.257775+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-24T00:53:06.257775+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.16667","last_updated":"2024-07-23T17:34:36Z","snapshot_observed_at":"2026-07-06T18:50:48.181248Z","submitted_at":"2024-07-23T17:34:36Z","title":"RedAgent: Red Teaming Large Language Models with Context-aware Autonomous Language Agent","version":1},"cited_work":{"arxiv_id":"2407.16667","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2407.16667","snapshot_observed_at":"2026-07-04T19:50:11.196920Z","title":"Redagent: Red teaming large language models with context-aware au- tonomous language agent.arXiv preprint arXiv:2407.16667","venue":null,"work_id":"d2f46e66-7014-4525-9685-d7b3a13d18a7","year":2024},"citing_paper":{"arxiv_id":"2606.02041","last_updated":"2026-06-01T10:30:08Z","snapshot_observed_at":"2026-08-06T02:57:08.156185Z","submitted_at":"2026-06-01T10:30:08Z","title":"SentGuard: Sentence-Level Streaming Guardrails for Large Language Models","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-06-28T14:51:17.667213Z"},"links":{"cited_paper":"/paper/2407.16667","citing_paper":"/paper/2606.02041"},"observation_digest":"sha256:b1fdc737dfcdf2eede9c8c74219ea059299cc0e15f114fb15e69d9da0eabe8a5","observation_id":"32c7d545-1008-4e71-9b68-37a04ecfbf94","resolution":{"observed_at":"2026-07-01T22:56:20.715715Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.15754","last_updated":"2025-03-20T00:13:04Z","snapshot_observed_at":"2026-08-07T16:50:24.795091Z","submitted_at":"2025-03-20T00:13:04Z","title":"AutoRedTeamer: Autonomous Red Teaming with Lifelong Attack Integration","version":1},"cited_work":{"arxiv_id":"2503.15754","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2503.15754","snapshot_observed_at":"2026-07-04T10:29:45.704338Z","title":"Autoredteamer: Autonomous red teaming with lifelong attack integration.arXiv preprint arXiv:2503.15754","venue":null,"work_id":"a695d4b0-af50-45a2-96c9-107b1289a8b8","year":2025},"citing_paper":{"arxiv_id":"2606.02041","last_updated":"2026-06-01T10:30:08Z","snapshot_observed_at":"2026-08-06T02:57:08.156185Z","submitted_at":"2026-06-01T10:30:08Z","title":"SentGuard: Sentence-Level Streaming Guardrails for Large Language Models","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-06-28T14:51:17.667213Z"},"links":{"cited_paper":"/paper/2503.15754","citing_paper":"/paper/2606.02041"},"observation_digest":"sha256:965348f7442cb0ed69fcb678648390baf0deebbccaf4100afe34da3caaf67cab","observation_id":"19f73f53-0a33-4115-82bb-4430e1ab978c","resolution":{"observed_at":"2026-07-01T22:56:20.719780Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:51:17.667213Z","title":"ICLR , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.02041","last_updated":"2026-06-01T10:30:08Z","snapshot_observed_at":"2026-08-06T02:57:08.156185Z","submitted_at":"2026-06-01T10:30:08Z","title":"SentGuard: Sentence-Level Streaming Guardrails for Large Language Models","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-06-28T14:51:17.667213Z"},"links":{"citing_paper":"/paper/2606.02041"},"observation_digest":"sha256:8521ae6a76697b30b3acbfb367624313a6b95694b55fbef8348b99d730bd30a9","observation_id":"65f6e048-e483-4c86-b9dd-5ad97931983e","resolution":{"observed_at":"2026-06-28T14:51:17.667213Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:51:17.667213Z","title":"AAAI , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.02041","last_updated":"2026-06-01T10:30:08Z","snapshot_observed_at":"2026-08-06T02:57:08.156185Z","submitted_at":"2026-06-01T10:30:08Z","title":"SentGuard: Sentence-Level Streaming Guardrails for Large Language Models","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-06-28T14:51:17.667213Z"},"links":{"citing_paper":"/paper/2606.02041"},"observation_digest":"sha256:71e6d500689bfe15770b2d353cc09776d8d35c0cc3c0dca068dedc3b7807937f","observation_id":"babeb503-d121-4cd6-b4f2-afa3d4c310c3","resolution":{"observed_at":"2026-06-28T14:51:17.667213Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:51:17.667213Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2606.02041","last_updated":"2026-06-01T10:30:08Z","snapshot_observed_at":"2026-08-06T02:57:08.156185Z","submitted_at":"2026-06-01T10:30:08Z","title":"SentGuard: Sentence-Level Streaming Guardrails for Large Language Models","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-06-28T14:51:17.667213Z"},"links":{"citing_paper":"/paper/2606.02041"},"observation_digest":"sha256:22039ca370ed068c3fa207b3b252929fd6386c22f62d3d3213b5a34982b992ae","observation_id":"1d03f7ca-2a50-4762-b3ab-0cc9d44cf3f5","resolution":{"observed_at":"2026-06-28T14:51:17.667213Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1907.11692","last_updated":"2019-07-26T17:48:29Z","snapshot_observed_at":"2026-07-31T22:31:37.910868Z","submitted_at":"2019-07-26T17:48:29Z","title":"RoBERTa: A Robustly Optimized BERT Pretraining Approach","version":1},"cited_work":{"arxiv_id":"1907.11692","doi":"10.1007/s10489-02203627-9","metadata_source":"pith","pith_arxiv_id":"1907.11692","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"RoBERTa: A Robustly Optimized BERT Pretraining Approach","venue":"cs.CL","work_id":"41fe12c4-e538-4890-a244-480650ed3078","year":2019},"citing_paper":{"arxiv_id":"2606.02041","last_updated":"2026-06-01T10:30:08Z","snapshot_observed_at":"2026-08-06T02:57:08.156185Z","submitted_at":"2026-06-01T10:30:08Z","title":"SentGuard: Sentence-Level Streaming Guardrails for Large Language Models","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-06-28T14:51:17.667213Z"},"links":{"cited_paper":"/paper/1907.11692","citing_paper":"/paper/2606.02041"},"observation_digest":"sha256:d8cf1fd391bc3a866b23372922a5cd35a5850ab8c77a361548d8b9123a8ccccd","observation_id":"2ee50272-8e0c-43d7-92fa-909820b2c837","resolution":{"observed_at":"2026-07-01T22:56:20.748998Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.06674","last_updated":"2023-12-07T19:40:50Z","snapshot_observed_at":"2026-07-06T17:00:00.321552Z","submitted_at":"2023-12-07T19:40:50Z","title":"Llama Guard: LLM-based Input-Output Safeguard for Human-AI Conversations","version":1},"cited_work":{"arxiv_id":"2312.06674","doi":"10.3390/info16050365","metadata_source":"pith","pith_arxiv_id":"2312.06674","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Llama Guard: LLM-based Input-Output Safeguard for Human-AI Conversations","venue":"cs.CL","work_id":"93844332-869b-448c-a1be-35466150b1b2","year":2023},"citing_paper":{"arxiv_id":"2606.02041","last_updated":"2026-06-01T10:30:08Z","snapshot_observed_at":"2026-08-06T02:57:08.156185Z","submitted_at":"2026-06-01T10:30:08Z","title":"SentGuard: Sentence-Level Streaming Guardrails for Large Language Models","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-06-28T14:51:17.667213Z"},"links":{"cited_paper":"/paper/2312.06674","citing_paper":"/paper/2606.02041"},"observation_digest":"sha256:c4b20213832ea436b2c695c463e9b2275ac53ba644f16c2e46585744c20f7bcb","observation_id":"c0e4ead4-28db-4303-866c-5e5afe72f07f","resolution":{"observed_at":"2026-07-01T22:56:20.734898Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.10414","last_updated":"2024-11-15T18:34:07Z","snapshot_observed_at":"2026-08-06T19:21:24.933454Z","submitted_at":"2024-11-15T18:34:07Z","title":"Llama Guard 3 Vision: Safeguarding Human-AI Image Understanding Conversations","version":1},"cited_work":{"arxiv_id":"2411.10414","doi":null,"metadata_source":"pith","pith_arxiv_id":"2411.10414","snapshot_observed_at":"2026-07-05T10:30:59.155257Z","title":"Llama Guard 3 Vision: Safeguarding Human-AI Image Understanding Conversations","venue":"cs.CV","work_id":"de29c7ee-383e-4c28-89ea-de06000701c4","year":2024},"citing_paper":{"arxiv_id":"2606.02041","last_updated":"2026-06-01T10:30:08Z","snapshot_observed_at":"2026-08-06T02:57:08.156185Z","submitted_at":"2026-06-01T10:30:08Z","title":"SentGuard: Sentence-Level Streaming Guardrails for Large Language Models","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-06-28T14:51:17.667213Z"},"links":{"cited_paper":"/paper/2411.10414","citing_paper":"/paper/2606.02041"},"observation_digest":"sha256:1decaab607b77c44a4142befef167a418b50bf0fa7a9cfbf1bbc80a014acf1e8","observation_id":"143b6443-0812-475e-9e1a-27cdbd5ddecb","resolution":{"observed_at":"2026-07-01T22:56:20.691442Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21772","last_updated":"2024-08-04T22:13:39Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-07-31T17:48:14Z","title":"ShieldGemma: Generative AI Content Moderation Based on Gemma","version":2},"cited_work":{"arxiv_id":"2407.21772","doi":"10.48550/arxiv.2407.21772","metadata_source":"pith","pith_arxiv_id":"2407.21772","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"ShieldGemma: Generative AI Content Moderation Based on Gemma","venue":"cs.CL","work_id":"6d0d9d39-490d-48d5-b346-6bfe40b8b8fb","year":2024},"citing_paper":{"arxiv_id":"2606.02041","last_updated":"2026-06-01T10:30:08Z","snapshot_observed_at":"2026-08-06T02:57:08.156185Z","submitted_at":"2026-06-01T10:30:08Z","title":"SentGuard: Sentence-Level Streaming Guardrails for Large Language Models","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-06-28T14:51:17.667213Z"},"links":{"cited_paper":"/paper/2407.21772","citing_paper":"/paper/2606.02041"},"observation_digest":"sha256:b5b80c2e51480abb951db01a9c85ebc1a84af1a71ca9399905b3d7b093908ccb","observation_id":"5af71599-f333-4490-b828-cc9724aad655","resolution":{"observed_at":"2026-07-01T22:56:20.666364Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:51:17.667213Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.02041","last_updated":"2026-06-01T10:30:08Z","snapshot_observed_at":"2026-08-06T02:57:08.156185Z","submitted_at":"2026-06-01T10:30:08Z","title":"SentGuard: Sentence-Level Streaming Guardrails for Large Language Models","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-06-28T14:51:17.667213Z"},"links":{"citing_paper":"/paper/2606.02041"},"observation_digest":"sha256:e63429245efae0226f84d1b3a7fae2d24f97514cab892bda463da6873c8cd6f0","observation_id":"bfe14412-fb3d-4043-a138-3b26d611a1ec","resolution":{"observed_at":"2026-06-28T14:51:17.667213Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.00166","last_updated":"2026-04-30T20:54:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-30T19:11:52Z","title":"Disentangled Safety Adapters Enable Efficient Guardrails and Flexible Inference-Time Alignment","version":2},"cited_work":{"arxiv_id":"2506.00166","doi":null,"metadata_source":"pith","pith_arxiv_id":"2506.00166","snapshot_observed_at":"2026-07-01T22:56:20.675955Z","title":"Disentangled Safety Adapters Enable Efficient Guardrails and Flexible Inference-Time Alignment","venue":"cs.LG","work_id":"25f497fb-6b19-48f3-afc2-31b36f4fa10a","year":2025},"citing_paper":{"arxiv_id":"2606.02041","last_updated":"2026-06-01T10:30:08Z","snapshot_observed_at":"2026-08-06T02:57:08.156185Z","submitted_at":"2026-06-01T10:30:08Z","title":"SentGuard: Sentence-Level Streaming Guardrails for Large Language Models","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-06-28T14:51:17.667213Z"},"links":{"cited_paper":"/paper/2506.00166","citing_paper":"/paper/2606.02041"},"observation_digest":"sha256:1723bd1c67b9eb264b2d9f9522d369158dd484bed8b2d87b3edea366a4d71b63","observation_id":"0471eeed-fecf-4088-a47c-0544cc7d6cf8","resolution":{"observed_at":"2026-07-01T22:56:20.678066Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.10253","last_updated":"2024-06-27T16:01:27Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-09-19T02:19:48Z","title":"GPTFUZZER: Red Teaming Large Language Models with Auto-Generated Jailbreak Prompts","version":4},"cited_work":{"arxiv_id":"2309.10253","doi":"10.48550/arxiv.2309.10253","metadata_source":"pith","pith_arxiv_id":"2309.10253","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"GPTFUZZER: Red Teaming Large Language Models with Auto-Generated Jailbreak Prompts","venue":"cs.AI","work_id":"230d395f-9220-4e6f-a52f-e593552b049b","year":2023},"citing_paper":{"arxiv_id":"2606.02041","last_updated":"2026-06-01T10:30:08Z","snapshot_observed_at":"2026-08-06T02:57:08.156185Z","submitted_at":"2026-06-01T10:30:08Z","title":"SentGuard: Sentence-Level Streaming Guardrails for Large Language Models","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-06-28T14:51:17.667213Z"},"links":{"cited_paper":"/paper/2309.10253","citing_paper":"/paper/2606.02041"},"observation_digest":"sha256:180651b0c4085bfb22504b33471a791f26005eb672151b7d2bbc7fe1d3f597a8","observation_id":"e43165ac-f976-41a0-9f2e-2af11e3087e8","resolution":{"observed_at":"2026-07-01T22:56:20.674331Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-05-24T00:53:10.090181+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-24T00:53:10.090181+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2601.01592","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-04T16:29:56.910326Z","title":"arXiv preprint arXiv:2601.01592 , year=","venue":null,"work_id":"9db527e7-f40d-4170-9763-07e1c7d7a009","year":2026},"citing_paper":{"arxiv_id":"2606.02041","last_updated":"2026-06-01T10:30:08Z","snapshot_observed_at":"2026-08-06T02:57:08.156185Z","submitted_at":"2026-06-01T10:30:08Z","title":"SentGuard: Sentence-Level Streaming Guardrails for Large Language Models","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-06-28T14:51:17.667213Z"},"links":{"citing_paper":"/paper/2606.02041"},"observation_digest":"sha256:c9e9a85b5c50ca9534d5511bc345e76eb460b2e3520ab65efa9e630722e51e12","observation_id":"2a2bf394-5e76-4148-9c60-07024d2688a9","resolution":{"observed_at":"2026-07-01T22:56:20.683014Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2510.05025","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-01T22:56:20.661021Z","title":"Imperceptible jailbreaking against large language models","venue":null,"work_id":"659371e5-c7c5-45a0-8ab2-04f16e6c6868","year":2025},"citing_paper":{"arxiv_id":"2606.02041","last_updated":"2026-06-01T10:30:08Z","snapshot_observed_at":"2026-08-06T02:57:08.156185Z","submitted_at":"2026-06-01T10:30:08Z","title":"SentGuard: Sentence-Level Streaming Guardrails for Large Language Models","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-06-28T14:51:17.667213Z"},"links":{"citing_paper":"/paper/2606.02041"},"observation_digest":"sha256:c32b969b7f4cf711f20014245123d6ed0037e8970aa643e91a9f8330c88ef003","observation_id":"e5dccdcd-4c17-4575-8225-06a339b3da45","resolution":{"observed_at":"2026-07-01T22:56:20.663118Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2509.19870","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-03T15:18:33.840739Z","title":"Freezevla: Action-freezing attacks against vision- language-action models","venue":null,"work_id":"ef52074e-6cb8-46c5-9238-3f271d52d343","year":2025},"citing_paper":{"arxiv_id":"2606.02041","last_updated":"2026-06-01T10:30:08Z","snapshot_observed_at":"2026-08-06T02:57:08.156185Z","submitted_at":"2026-06-01T10:30:08Z","title":"SentGuard: Sentence-Level Streaming Guardrails for Large Language Models","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-06-28T14:51:17.667213Z"},"links":{"citing_paper":"/paper/2606.02041"},"observation_digest":"sha256:fce95daa915b48016c8f4484dbe811b26b7093a21ec1f14dcb581588de76ddb2","observation_id":"022d54ce-0996-4f72-ba58-a08db4b46a80","resolution":{"observed_at":"2026-07-01T22:56:20.652629Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.12710","last_updated":"2026-05-18T06:50:41Z","snapshot_observed_at":"2026-07-06T22:35:55.936840Z","submitted_at":"2025-11-16T17:52:07Z","title":"Evolve the Method, Not the Prompts: Evolutionary Synthesis of Jailbreak Attacks on LLMs","version":2},"cited_work":{"arxiv_id":"2511.12710","doi":null,"metadata_source":"pith","pith_arxiv_id":"2511.12710","snapshot_observed_at":"2026-07-01T22:56:20.654057Z","title":"Evolve the Method, Not the Prompts: Evolutionary Synthesis of Jailbreak Attacks on LLMs","venue":"cs.CL","work_id":"c7638094-73a8-4661-aa09-da66cc602a33","year":2025},"citing_paper":{"arxiv_id":"2606.02041","last_updated":"2026-06-01T10:30:08Z","snapshot_observed_at":"2026-08-06T02:57:08.156185Z","submitted_at":"2026-06-01T10:30:08Z","title":"SentGuard: Sentence-Level Streaming Guardrails for Large Language Models","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-06-28T14:51:17.667213Z"},"links":{"cited_paper":"/paper/2511.12710","citing_paper":"/paper/2606.02041"},"observation_digest":"sha256:a2b9a2851685dbbbda0c398db1a259fc43d7f114cc2fee8e30c3753ffc66f1b5","observation_id":"286ad8a6-3c52-46f7-b0da-1987ecec1f25","resolution":{"observed_at":"2026-07-01T22:56:20.655980Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2205.01068","last_updated":"2022-06-21T17:04:40Z","snapshot_observed_at":"2026-08-06T03:13:37.403059Z","submitted_at":"2022-05-02T17:49:50Z","title":"OPT: Open Pre-trained Transformer Language Models","version":4},"cited_work":{"arxiv_id":"2205.01068","doi":"10.48550/arxiv.2205.01068","metadata_source":"pith","pith_arxiv_id":"2205.01068","snapshot_observed_at":"2026-07-11T03:37:45.880117Z","title":"OPT: Open Pre-trained Transformer Language Models","venue":"cs.CL","work_id":"d7ff3b21-1fff-4cf4-952a-4714e3ef2307","year":2022},"citing_paper":{"arxiv_id":"2606.02041","last_updated":"2026-06-01T10:30:08Z","snapshot_observed_at":"2026-08-06T02:57:08.156185Z","submitted_at":"2026-06-01T10:30:08Z","title":"SentGuard: Sentence-Level Streaming Guardrails for Large Language Models","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-06-28T14:51:17.667213Z"},"links":{"cited_paper":"/paper/2205.01068","citing_paper":"/paper/2606.02041"},"observation_digest":"sha256:1e0fd3c846096ddda2ecf0844653bd84d9e118cdab61a51dbf6c0908150f0584","observation_id":"ef4cc879-7497-4d3a-b681-4ee251758e0b","resolution":{"observed_at":"2026-07-01T22:56:20.659522Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-05-25T10:53:17.026227+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-25T10:53:17.026227+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:51:17.667213Z","title":"Forty-first International Conference on Machine Learning , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.02041","last_updated":"2026-06-01T10:30:08Z","snapshot_observed_at":"2026-08-06T02:57:08.156185Z","submitted_at":"2026-06-01T10:30:08Z","title":"SentGuard: Sentence-Level Streaming Guardrails for Large Language Models","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-06-28T14:51:17.667213Z"},"links":{"citing_paper":"/paper/2606.02041"},"observation_digest":"sha256:8db666506d619df6fe378fce7db11ee38083a64952858062cef4958176e4716a","observation_id":"42ae37a1-bf30-4db8-abec-1d61724b7d49","resolution":{"observed_at":"2026-06-28T14:51:17.667213Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:51:17.667213Z","title":"Advances in neural information processing systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.02041","last_updated":"2026-06-01T10:30:08Z","snapshot_observed_at":"2026-08-06T02:57:08.156185Z","submitted_at":"2026-06-01T10:30:08Z","title":"SentGuard: Sentence-Level Streaming Guardrails for Large Language Models","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-06-28T14:51:17.667213Z"},"links":{"citing_paper":"/paper/2606.02041"},"observation_digest":"sha256:ff79f86a1a96e035e4dc429fc744bd2608e320ddf61a2e82f71afe2b3e7e98aa","observation_id":"b2490a34-dcbd-4d8a-8cc4-48250cbcfab9","resolution":{"observed_at":"2026-06-28T14:51:17.667213Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2503.24047","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-02T22:27:25.303864Z","title":"Towards scientific intelligence: A survey of llm-based scientific agents","venue":null,"work_id":"edd2187b-bf89-4900-a855-aa2e8514bc01","year":2025},"citing_paper":{"arxiv_id":"2606.02041","last_updated":"2026-06-01T10:30:08Z","snapshot_observed_at":"2026-08-06T02:57:08.156185Z","submitted_at":"2026-06-01T10:30:08Z","title":"SentGuard: Sentence-Level Streaming Guardrails for Large Language Models","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-06-28T14:51:17.667213Z"},"links":{"citing_paper":"/paper/2606.02041"},"observation_digest":"sha256:c0bdb14e06da45b6166c3df03d2a1f25587e3c6557fd45ea32366e66dd54fc85","observation_id":"766d29e6-6a9c-4814-8aa4-cd17a3380729","resolution":{"observed_at":"2026-07-01T22:56:20.670348Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2604.04759","last_updated":"2026-04-06T15:27:05Z","snapshot_observed_at":"2026-07-06T22:53:37.357996Z","submitted_at":"2026-04-06T15:27:05Z","title":"Your Agent, Their Asset: A Real-World Safety Analysis of OpenClaw","version":1},"cited_work":{"arxiv_id":"2604.04759","doi":"10.48550/arxiv.2604.04759","metadata_source":"pith","pith_arxiv_id":"2604.04759","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"Your Agent, Their Asset: A Real-World Safety Analysis of OpenClaw","venue":"cs.CR","work_id":"210c09c9-0953-4b01-aed7-c4f462b807be","year":2026},"citing_paper":{"arxiv_id":"2606.02041","last_updated":"2026-06-01T10:30:08Z","snapshot_observed_at":"2026-08-06T02:57:08.156185Z","submitted_at":"2026-06-01T10:30:08Z","title":"SentGuard: Sentence-Level Streaming Guardrails for Large Language Models","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-06-28T14:51:17.667213Z"},"links":{"cited_paper":"/paper/2604.04759","citing_paper":"/paper/2606.02041"},"observation_digest":"sha256:53078258cbfb7ac7cb8668d120e4b5a5e30d88b5b617ac64ed0a76313a4a95ff","observation_id":"d60e1be1-0e7b-40bc-b673-f799fa033439","resolution":{"observed_at":"2026-07-01T22:56:20.687244Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2510.09694","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-01T22:56:20.646752Z","title":"arXiv preprint arXiv:2510.09694 , year=","venue":null,"work_id":"eaf989cf-5b8a-4595-8178-9663b6d7bfc1","year":2025},"citing_paper":{"arxiv_id":"2606.02041","last_updated":"2026-06-01T10:30:08Z","snapshot_observed_at":"2026-08-06T02:57:08.156185Z","submitted_at":"2026-06-01T10:30:08Z","title":"SentGuard: Sentence-Level Streaming Guardrails for Large Language Models","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-06-28T14:51:17.667213Z"},"links":{"citing_paper":"/paper/2606.02041"},"observation_digest":"sha256:07d9f5c9c9a2ebcdde579ac03a2b1e66c65d561f75b2b61a33faa9c5f9ce43f1","observation_id":"82be8f2a-662f-41b1-9a1e-84408bbff74b","resolution":{"observed_at":"2026-07-01T22:56:20.648940Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2606.02041","last_updated":"2026-06-01T10:30:08Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-06T02:57:08.156185Z","submitted_at":"2026-06-01T10:30:08Z","title":"SentGuard: Sentence-Level Streaming Guardrails for Large Language Models"},"reference_resolution":{"displayed":50,"state_counts":{"malformed_identifier":0,"metadata_mismatch":27,"parse_uncertain":0,"unresolved":18,"verified_exact":5,"verified_fuzzy":0},"total_outbound_references":50},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 50 of 50 outbound references and 1 inbound Pith citation observation for arXiv:2606.02041."}