{"as_of":"2026-08-07T22:13:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:8bad8163142efc35c66a24e991e967b93567ab68c590f28e2cc8821a2cbc9118","coverage":[{"denominator":60,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":60,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T05:41:25.552737Z","state":"measured"},{"denominator":61,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":61,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-28T15:05:08.411286Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-01T22:46:19.226413Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.07330","last_updated":"2025-06-09T00:11:06Z","snapshot_observed_at":"2026-08-07T08:21:07.384830Z","submitted_at":"2025-06-09T00:11:06Z","title":"JavelinGuard: Low-Cost Transformer Architectures for LLM Security","version":1},"cited_work":{"arxiv_id":"2506.07330","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.07330","snapshot_observed_at":"2026-07-01T22:46:19.226413Z","title":"Datta, S","venue":null,"work_id":"f3c9f786-5d02-44e3-b4fd-a8c0d8af738a","year":2025},"citing_paper":{"arxiv_id":"2606.02959","last_updated":"2026-06-01T23:29:58Z","snapshot_observed_at":"2026-08-05T09:07:58.107278Z","submitted_at":"2026-06-01T23:29:58Z","title":"Gate AI: LLM Security Benchmark Evaluation Methodology and Results","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-06-28T15:05:08.411286Z"},"links":{"cited_paper":"/paper/2506.07330","citing_paper":"/paper/2606.02959"},"observation_digest":"sha256:5821aecafc13dbaace700d7fe33070f85a2bdde7261929b61cbc9fbd8b9ffbf6","observation_id":"63c3cfb0-b070-4509-9a78-eda74b8e5795","resolution":{"observed_at":"2026-07-01T22:46:19.228179Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2506.07330/citation-record","integrity":"/paper/2506.07330/integrity","json":"/paper/2506.07330/citation-record.json","paper":"/paper/2506.07330"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2406.00799","last_updated":"2025-03-06T17:43:10Z","snapshot_observed_at":"2026-08-06T07:52:25.915226Z","submitted_at":"2024-06-02T16:53:21Z","title":"Get my drift? Catching LLM Task Drift with Activation Deltas","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.00799","snapshot_observed_at":"2026-08-07T05:41:25.315260Z","title":"Are you still on track!? catching llm task drift with activations, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07330","last_updated":"2025-06-09T00:11:06Z","snapshot_observed_at":"2026-08-07T08:21:07.384830Z","submitted_at":"2025-06-09T00:11:06Z","title":"JavelinGuard: Low-Cost Transformer Architectures for LLM Security","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-07T05:41:25.315260Z"},"links":{"cited_paper":"/paper/2406.00799","citing_paper":"/paper/2506.07330"},"observation_digest":"sha256:451c1f14fbe9fb6de9b3d72f3a535d8ec1a60a269ba84ed4545f8f83a391927c","observation_id":"7100632c-ff3f-474d-990f-65599ab8012a","resolution":{"observed_at":"2026-08-07T05:41:25.315260Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.02151","last_updated":"2025-04-17T18:55:45Z","snapshot_observed_at":"2026-07-06T17:54:43.685212Z","submitted_at":"2024-04-02T17:58:27Z","title":"Jailbreaking Leading Safety-Aligned LLMs with Simple Adaptive Attacks","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.02151","snapshot_observed_at":"2026-08-07T05:41:25.319900Z","title":"Jailbreaking leading safety-aligned llms with simple adaptive attacks, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07330","last_updated":"2025-06-09T00:11:06Z","snapshot_observed_at":"2026-08-07T08:21:07.384830Z","submitted_at":"2025-06-09T00:11:06Z","title":"JavelinGuard: Low-Cost Transformer Architectures for LLM Security","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-07T05:41:25.319900Z"},"links":{"cited_paper":"/paper/2404.02151","citing_paper":"/paper/2506.07330"},"observation_digest":"sha256:38c12451ca34d91ea5e2fd5de5c5ff601afd6cadb73407b887c81e4714d70e75","observation_id":"96ebaf00-672b-4d55-be47-85964245d851","resolution":{"observed_at":"2026-08-07T05:41:25.319900Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2004.05150","last_updated":"2020-12-02T17:52:35Z","snapshot_observed_at":"2026-07-31T17:17:17.205582Z","submitted_at":"2020-04-10T17:54:09Z","title":"Longformer: The Long-Document Transformer","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2004.05150","snapshot_observed_at":"2026-08-07T05:41:25.323891Z","title":"Peters, and Arman Cohan","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.07330","last_updated":"2025-06-09T00:11:06Z","snapshot_observed_at":"2026-08-07T08:21:07.384830Z","submitted_at":"2025-06-09T00:11:06Z","title":"JavelinGuard: Low-Cost Transformer Architectures for LLM Security","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-07T05:41:25.323891Z"},"links":{"cited_paper":"/paper/2004.05150","citing_paper":"/paper/2506.07330"},"observation_digest":"sha256:3cac5a0edc63b1d8a9642d819ebbaff7181b82817157e0c340a16723973a16d0","observation_id":"ca91e754-c95b-4559-a478-edc26ac4d113","resolution":{"observed_at":"2026-08-07T05:41:25.323891Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.05500","last_updated":"2026-06-01T09:22:31Z","snapshot_observed_at":"2026-08-07T17:21:54.080497Z","submitted_at":"2025-03-07T15:13:58Z","title":"EuroBERT: Scaling Multilingual Encoders for European Languages","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.05500","snapshot_observed_at":"2026-08-07T05:41:25.328485Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.07330","last_updated":"2025-06-09T00:11:06Z","snapshot_observed_at":"2026-08-07T08:21:07.384830Z","submitted_at":"2025-06-09T00:11:06Z","title":"JavelinGuard: Low-Cost Transformer Architectures for LLM Security","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-07T05:41:25.328485Z"},"links":{"cited_paper":"/paper/2503.05500","citing_paper":"/paper/2506.07330"},"observation_digest":"sha256:a3f753796312e025a1484467de1359c0cf1106ac356f0451d0c8d129896c486f","observation_id":"9567dc39-c0be-4ab2-a78f-14ba55a4a456","resolution":{"observed_at":"2026-08-07T05:41:25.328485Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.19587","last_updated":"2025-06-06T20:57:10Z","snapshot_observed_at":"2026-08-07T17:44:48.267080Z","submitted_at":"2025-02-26T22:00:22Z","title":"NeoBERT: A Next-Generation BERT","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.19587","snapshot_observed_at":"2026-08-07T05:41:25.332545Z","title":"Neobert: A next-generation bert, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.07330","last_updated":"2025-06-09T00:11:06Z","snapshot_observed_at":"2026-08-07T08:21:07.384830Z","submitted_at":"2025-06-09T00:11:06Z","title":"JavelinGuard: Low-Cost Transformer Architectures for LLM Security","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-07T05:41:25.332545Z"},"links":{"cited_paper":"/paper/2502.19587","citing_paper":"/paper/2506.07330"},"observation_digest":"sha256:113b00e1422a6ac3f8b03b542dd618639bba125e60ccd83c983a8677c184a5b6","observation_id":"91b0a6d3-d12f-4175-8ce8-cf477bd835c9","resolution":{"observed_at":"2026-08-07T05:41:25.332545Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:41:25.336740Z","title":"Pappas, and Eric Wong","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.07330","last_updated":"2025-06-09T00:11:06Z","snapshot_observed_at":"2026-08-07T08:21:07.384830Z","submitted_at":"2025-06-09T00:11:06Z","title":"JavelinGuard: Low-Cost Transformer Architectures for LLM Security","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-07T05:41:25.336740Z"},"links":{"citing_paper":"/paper/2506.07330"},"observation_digest":"sha256:24f3a761c8fc58e50fc44e41a3b54f89480bfe61662f141c8e42877a8ed2a44c","observation_id":"678082c1-45cf-4324-a007-99bccd950c09","resolution":{"observed_at":"2026-08-07T05:41:25.336740Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.00459","last_updated":"2025-08-02T13:44:03Z","snapshot_observed_at":"2026-08-04T09:37:10.818143Z","submitted_at":"2024-11-01T09:14:21Z","title":"Defense Against Prompt Injection Attack by Leveraging Attack Techniques","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.00459","snapshot_observed_at":"2026-08-07T05:41:25.340870Z","title":"Defense against prompt injection attack by leveraging attack techniques, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.07330","last_updated":"2025-06-09T00:11:06Z","snapshot_observed_at":"2026-08-07T08:21:07.384830Z","submitted_at":"2025-06-09T00:11:06Z","title":"JavelinGuard: Low-Cost Transformer Architectures for LLM Security","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-07T05:41:25.340870Z"},"links":{"cited_paper":"/paper/2411.00459","citing_paper":"/paper/2506.07330"},"observation_digest":"sha256:11abb27210d693aa3d29f78f844fdd37882955a19e94c073d90a1e88a557356a","observation_id":"6277d0de-5d2c-4458-bb27-da4173afcf3d","resolution":{"observed_at":"2026-08-07T05:41:25.340870Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2009.14794","last_updated":"2022-11-19T12:45:21Z","snapshot_observed_at":"2026-08-07T11:26:24.987920Z","submitted_at":"2020-09-30T17:09:09Z","title":"Rethinking Attention with Performers","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.14794","snapshot_observed_at":"2026-08-07T05:41:25.345503Z","title":"Rethinking attention with performers, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.07330","last_updated":"2025-06-09T00:11:06Z","snapshot_observed_at":"2026-08-07T08:21:07.384830Z","submitted_at":"2025-06-09T00:11:06Z","title":"JavelinGuard: Low-Cost Transformer Architectures for LLM Security","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-07T05:41:25.345503Z"},"links":{"cited_paper":"/paper/2009.14794","citing_paper":"/paper/2506.07330"},"observation_digest":"sha256:178f998513b14feefe2ec19b87a31ec2f76b750db2bb7f6ed7f97f53d60904ae","observation_id":"a960944a-cdbe-4137-8087-c0fdfa07eae6","resolution":{"observed_at":"2026-08-07T05:41:25.345503Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:41:26.302739Z","title":"Deepset prompt injection guardrail, 2024","venue":null,"work_id":"94134458-a831-45a6-9ff8-c113ca852cb8","year":2024},"citing_paper":{"arxiv_id":"2506.07330","last_updated":"2025-06-09T00:11:06Z","snapshot_observed_at":"2026-08-07T08:21:07.384830Z","submitted_at":"2025-06-09T00:11:06Z","title":"JavelinGuard: Low-Cost Transformer Architectures for LLM Security","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-07T05:41:25.349610Z"},"links":{"citing_paper":"/paper/2506.07330"},"observation_digest":"sha256:f815f7e2651a35a91a9b21f3c90219645ad9311e112e8ca445365cd679f58d81","observation_id":"cace89d0-a430-42c3-b66f-0ebdada37f3f","resolution":{"observed_at":"2026-08-07T05:41:26.306114Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:41:25.353875Z","title":"Duoguard: A two-player rl-driven framework for multilingual llm guardrails, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.07330","last_updated":"2025-06-09T00:11:06Z","snapshot_observed_at":"2026-08-07T08:21:07.384830Z","submitted_at":"2025-06-09T00:11:06Z","title":"JavelinGuard: Low-Cost Transformer Architectures for LLM Security","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-07T05:41:25.353875Z"},"links":{"citing_paper":"/paper/2506.07330"},"observation_digest":"sha256:060e7d1f63516005b834716cc819bc8ea8da2cde124d15f0654537aee833a5b3","observation_id":"918f6875-290b-45de-aa05-f5e0aacc7e4e","resolution":{"observed_at":"2026-08-07T05:41:25.353875Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11036","last_updated":"2024-06-16T18:18:43Z","snapshot_observed_at":"2026-08-07T20:17:52.557141Z","submitted_at":"2024-06-16T18:18:43Z","title":"garak: A Framework for Security Probing Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.11036","snapshot_observed_at":"2026-08-07T05:41:25.356935Z","title":"garak: A framework for security probing large language models, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07330","last_updated":"2025-06-09T00:11:06Z","snapshot_observed_at":"2026-08-07T08:21:07.384830Z","submitted_at":"2025-06-09T00:11:06Z","title":"JavelinGuard: Low-Cost Transformer Architectures for LLM Security","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-07T05:41:25.356935Z"},"links":{"cited_paper":"/paper/2406.11036","citing_paper":"/paper/2506.07330"},"observation_digest":"sha256:f7192d1cd07f5a0632930d30336f7dd6d7864906664e21a125773674fede5b27","observation_id":"5996d375-da0b-47e3-a050-ed7eec657248","resolution":{"observed_at":"2026-08-07T05:41:25.356935Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1810.04805","last_updated":"2019-05-24T20:37:26Z","snapshot_observed_at":"2026-07-30T09:12:38.100527Z","submitted_at":"2018-10-11T00:50:01Z","title":"BERT: Pre-training of Deep Bidirectional Transformers for Language Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1810.04805","snapshot_observed_at":"2026-08-07T05:41:25.361264Z","title":"Bert: Pre-training of deep bidirectional transformers for language understanding, 2019","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.07330","last_updated":"2025-06-09T00:11:06Z","snapshot_observed_at":"2026-08-07T08:21:07.384830Z","submitted_at":"2025-06-09T00:11:06Z","title":"JavelinGuard: Low-Cost Transformer Architectures for LLM Security","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-07T05:41:25.361264Z"},"links":{"cited_paper":"/paper/1810.04805","citing_paper":"/paper/2506.07330"},"observation_digest":"sha256:5fb726207950f107af8a25293f202c54d6c44efd3569dd10cee8cf70b12c22b4","observation_id":"e17ad33d-2543-4776-a32d-89b0a4ddd171","resolution":{"observed_at":"2026-08-07T05:41:25.361264Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:41:25.365277Z","title":"A wolf in sheep's clothing: Generalized nested jailbreak prompts can fool large language models easily, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.07330","last_updated":"2025-06-09T00:11:06Z","snapshot_observed_at":"2026-08-07T08:21:07.384830Z","submitted_at":"2025-06-09T00:11:06Z","title":"JavelinGuard: Low-Cost Transformer Architectures for LLM Security","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-07T05:41:25.365277Z"},"links":{"citing_paper":"/paper/2506.07330"},"observation_digest":"sha256:23c27c9ffa5702b78b689f74ff6e133f5f24cacf680fc320b92e1c9d1a4640a4","observation_id":"a876e8a2-bd42-41ed-8c37-11b70302d15c","resolution":{"observed_at":"2026-08-07T05:41:25.365277Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.04811","last_updated":"2025-03-25T01:51:22Z","snapshot_observed_at":"2026-07-06T18:58:39.334273Z","submitted_at":"2024-08-09T01:45:39Z","title":"h4rm3l: A language for Composable Jailbreak Attack Synthesis","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.04811","snapshot_observed_at":"2026-08-07T05:41:25.368455Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07330","last_updated":"2025-06-09T00:11:06Z","snapshot_observed_at":"2026-08-07T08:21:07.384830Z","submitted_at":"2025-06-09T00:11:06Z","title":"JavelinGuard: Low-Cost Transformer Architectures for LLM Security","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-07T05:41:25.368455Z"},"links":{"cited_paper":"/paper/2408.04811","citing_paper":"/paper/2506.07330"},"observation_digest":"sha256:c1e9fd56b9a482e73a32535cd9b97a69b2538e477650d9fe56910112d9f423d1","observation_id":"2d70c8ca-0dca-434a-a684-49d64b523cee","resolution":{"observed_at":"2026-08-07T05:41:25.368455Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:41:26.286326Z","title":"Fmops prompt injection guardrail, 2024","venue":null,"work_id":"6921308c-268d-4c9d-a1f6-2a0df93f1466","year":2024},"citing_paper":{"arxiv_id":"2506.07330","last_updated":"2025-06-09T00:11:06Z","snapshot_observed_at":"2026-08-07T08:21:07.384830Z","submitted_at":"2025-06-09T00:11:06Z","title":"JavelinGuard: Low-Cost Transformer Architectures for LLM Security","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-07T05:41:25.372778Z"},"links":{"citing_paper":"/paper/2506.07330"},"observation_digest":"sha256:e6ccdb25216580405745c89d6394b7d123bf526774af7b399c28d2bb88390140","observation_id":"0008caae-1c81-43a3-b732-85fcafad3a51","resolution":{"observed_at":"2026-08-07T05:41:26.289650Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.01547","last_updated":"2024-12-02T14:35:43Z","snapshot_observed_at":"2026-08-07T20:33:32.011947Z","submitted_at":"2024-12-02T14:35:43Z","title":"Improved Large Language Model Jailbreak Detection via Pretrained Embeddings","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.01547","snapshot_observed_at":"2026-08-07T05:41:25.376227Z","title":"Improved large language model jailbreak detection via pretrained embeddings, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07330","last_updated":"2025-06-09T00:11:06Z","snapshot_observed_at":"2026-08-07T08:21:07.384830Z","submitted_at":"2025-06-09T00:11:06Z","title":"JavelinGuard: Low-Cost Transformer Architectures for LLM Security","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-07T05:41:25.376227Z"},"links":{"cited_paper":"/paper/2412.01547","citing_paper":"/paper/2506.07330"},"observation_digest":"sha256:12b03ca8bc5a0e252daef974fdaeb22423d4790254ff320754d7014611e162ab","observation_id":"65c83966-1ce6-4228-bb4b-5cfabc2683bf","resolution":{"observed_at":"2026-08-07T05:41:25.376227Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.05993","last_updated":"2024-09-11T14:42:29Z","snapshot_observed_at":"2026-08-06T16:17:24.580021Z","submitted_at":"2024-04-09T03:54:28Z","title":"AEGIS: Online Adaptive AI Content Safety Moderation with Ensemble of LLM Experts","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.05993","snapshot_observed_at":"2026-08-07T05:41:25.380511Z","title":"Aegis: Online adaptive ai content safety moderation with ensemble of llm experts, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07330","last_updated":"2025-06-09T00:11:06Z","snapshot_observed_at":"2026-08-07T08:21:07.384830Z","submitted_at":"2025-06-09T00:11:06Z","title":"JavelinGuard: Low-Cost Transformer Architectures for LLM Security","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-07T05:41:25.380511Z"},"links":{"cited_paper":"/paper/2404.05993","citing_paper":"/paper/2506.07330"},"observation_digest":"sha256:79c578a150face54cf011f9b1073248359aa12f9d59f80f34040d7c885b903e7","observation_id":"9a02c637-236b-48bc-9429-84998efa3c15","resolution":{"observed_at":"2026-08-07T05:41:25.380511Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-07T05:41:25.384612Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07330","last_updated":"2025-06-09T00:11:06Z","snapshot_observed_at":"2026-08-07T08:21:07.384830Z","submitted_at":"2025-06-09T00:11:06Z","title":"JavelinGuard: Low-Cost Transformer Architectures for LLM Security","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-07T05:41:25.384612Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2506.07330"},"observation_digest":"sha256:31375af1579a18709f621568395dd7f31b1001c10523f88e773789db87ab5978","observation_id":"79cd9546-390d-4c6a-87c8-04a900acd5fb","resolution":{"observed_at":"2026-08-07T05:41:25.384612Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.00752","last_updated":"2024-05-31T17:55:27Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-12-01T18:01:34Z","title":"Mamba: Linear-Time Sequence Modeling with Selective State Spaces","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.00752","snapshot_observed_at":"2026-08-07T05:41:25.389280Z","title":"Mamba: Linear-time sequence modeling with selective state spaces, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07330","last_updated":"2025-06-09T00:11:06Z","snapshot_observed_at":"2026-08-07T08:21:07.384830Z","submitted_at":"2025-06-09T00:11:06Z","title":"JavelinGuard: Low-Cost Transformer Architectures for LLM Security","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-07T05:41:25.389280Z"},"links":{"cited_paper":"/paper/2312.00752","citing_paper":"/paper/2506.07330"},"observation_digest":"sha256:073176cf945ac3e4ca74c43abe7b355ee5c8dabc73d419b750ed56be80ed4f3e","observation_id":"380c2f49-cae7-41c3-8a19-2e3546abfedc","resolution":{"observed_at":"2026-08-07T05:41:25.389280Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.18495","last_updated":"2024-12-09T20:21:56Z","snapshot_observed_at":"2026-08-06T04:32:59.039501Z","submitted_at":"2024-06-26T16:58:20Z","title":"WildGuard: Open One-Stop Moderation Tools for Safety Risks, Jailbreaks, and Refusals of LLMs","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.18495","snapshot_observed_at":"2026-08-07T05:41:25.392879Z","title":"Wildguard: Open one-stop moderation tools for safety risks, jailbreaks, and refusals of llms, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07330","last_updated":"2025-06-09T00:11:06Z","snapshot_observed_at":"2026-08-07T08:21:07.384830Z","submitted_at":"2025-06-09T00:11:06Z","title":"JavelinGuard: Low-Cost Transformer Architectures for LLM Security","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-07T05:41:25.392879Z"},"links":{"cited_paper":"/paper/2406.18495","citing_paper":"/paper/2506.07330"},"observation_digest":"sha256:a9184d7f43cc2b152e6536952796a2512561ac2605fb5287729d802bbe1a80cf","observation_id":"139aa9e9-ccfe-4153-a64b-c272d21b0447","resolution":{"observed_at":"2026-08-07T05:41:25.392879Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2111.09543","last_updated":"2023-03-24T09:17:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-11-18T06:48:00Z","title":"DeBERTaV3: Improving DeBERTa using ELECTRA-Style Pre-Training with Gradient-Disentangled Embedding Sharing","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2111.09543","snapshot_observed_at":"2026-08-07T05:41:25.397072Z","title":"Debertav3: Improving deberta using electra-style pre-training with gradient-disentangled embedding sharing, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.07330","last_updated":"2025-06-09T00:11:06Z","snapshot_observed_at":"2026-08-07T08:21:07.384830Z","submitted_at":"2025-06-09T00:11:06Z","title":"JavelinGuard: Low-Cost Transformer Architectures for LLM Security","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-07T05:41:25.397072Z"},"links":{"cited_paper":"/paper/2111.09543","citing_paper":"/paper/2506.07330"},"observation_digest":"sha256:aad1714860c7b160386dce63ebceeb1fb60cb02932ce1f485b0ce8cfd4ff92ca","observation_id":"3bfc8f48-a756-45a1-9d77-45534fa3abc8","resolution":{"observed_at":"2026-08-07T05:41:25.397072Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06987","last_updated":"2023-10-10T20:15:54Z","snapshot_observed_at":"2026-07-06T16:30:46.321160Z","submitted_at":"2023-10-10T20:15:54Z","title":"Catastrophic Jailbreak of Open-source LLMs via Exploiting Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.06987","snapshot_observed_at":"2026-08-07T05:41:25.400701Z","title":"Catastrophic jailbreak of open-source llms via exploiting generation, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.07330","last_updated":"2025-06-09T00:11:06Z","snapshot_observed_at":"2026-08-07T08:21:07.384830Z","submitted_at":"2025-06-09T00:11:06Z","title":"JavelinGuard: Low-Cost Transformer Architectures for LLM Security","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-07T05:41:25.400701Z"},"links":{"cited_paper":"/paper/2310.06987","citing_paper":"/paper/2506.07330"},"observation_digest":"sha256:bc244314af9a3fc7ec7192745adcdf98a1f84bdf170084a3be659cb8953a96e0","observation_id":"ad7c973f-bb55-4516-a42c-b4caed499c07","resolution":{"observed_at":"2026-08-07T05:41:25.400701Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.14189","last_updated":"2025-05-30T14:12:54Z","snapshot_observed_at":"2026-07-06T18:18:21.334080Z","submitted_at":"2024-05-23T05:31:41Z","title":"Efficient Universal Goal Hijacking with Semantics-guided Prompt Organization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.14189","snapshot_observed_at":"2026-08-07T05:41:25.404633Z","title":"Semantic-guided prompt organization for universal goal hijacking against llms, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07330","last_updated":"2025-06-09T00:11:06Z","snapshot_observed_at":"2026-08-07T08:21:07.384830Z","submitted_at":"2025-06-09T00:11:06Z","title":"JavelinGuard: Low-Cost Transformer Architectures for LLM Security","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-07T05:41:25.404633Z"},"links":{"cited_paper":"/paper/2405.14189","citing_paper":"/paper/2506.07330"},"observation_digest":"sha256:b2fd7ede3a821ed7bd543e8a0a9942791612a61a6f218d22f37718bd4dc73db4","observation_id":"51fc5fdb-b481-4602-85ef-d9687a80ef8b","resolution":{"observed_at":"2026-08-07T05:41:25.404633Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.03556","last_updated":"2024-12-19T22:37:45Z","snapshot_observed_at":"2026-07-06T20:01:45.826971Z","submitted_at":"2024-12-04T18:51:32Z","title":"Best-of-N Jailbreaking","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.03556","snapshot_observed_at":"2026-08-07T05:41:25.408036Z","title":"Best-of-n jailbreaking, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07330","last_updated":"2025-06-09T00:11:06Z","snapshot_observed_at":"2026-08-07T08:21:07.384830Z","submitted_at":"2025-06-09T00:11:06Z","title":"JavelinGuard: Low-Cost Transformer Architectures for LLM Security","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-07T05:41:25.408036Z"},"links":{"cited_paper":"/paper/2412.03556","citing_paper":"/paper/2506.07330"},"observation_digest":"sha256:c071bb505f09509036e96146fac1eb868fa38bd987392dd2b54c4faad67bb10b","observation_id":"2cb4d93b-ad9b-4a88-a555-149af2568ed9","resolution":{"observed_at":"2026-08-07T05:41:25.408036Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.06674","last_updated":"2023-12-07T19:40:50Z","snapshot_observed_at":"2026-07-06T17:00:00.321552Z","submitted_at":"2023-12-07T19:40:50Z","title":"Llama Guard: LLM-based Input-Output Safeguard for Human-AI Conversations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.06674","snapshot_observed_at":"2026-08-07T05:41:25.411365Z","title":"Llama guard: Llm-based input-output safeguard for human-ai conversations, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.07330","last_updated":"2025-06-09T00:11:06Z","snapshot_observed_at":"2026-08-07T08:21:07.384830Z","submitted_at":"2025-06-09T00:11:06Z","title":"JavelinGuard: Low-Cost Transformer Architectures for LLM Security","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-07T05:41:25.411365Z"},"links":{"cited_paper":"/paper/2312.06674","citing_paper":"/paper/2506.07330"},"observation_digest":"sha256:19426150efde5679b0e956da0910fd64d59d52848e7ad5f2319d317b7fc1a268","observation_id":"9bb5367b-8781-4928-bfc9-7a99b2465ab7","resolution":{"observed_at":"2026-08-07T05:41:25.411365Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.00172","last_updated":"2023-10-31T22:22:10Z","snapshot_observed_at":"2026-08-04T07:12:56.362698Z","submitted_at":"2023-10-31T22:22:10Z","title":"Robust Safety Classifier for Large Language Models: Adversarial Prompt Shield","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.00172","snapshot_observed_at":"2026-08-07T05:41:25.415816Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.07330","last_updated":"2025-06-09T00:11:06Z","snapshot_observed_at":"2026-08-07T08:21:07.384830Z","submitted_at":"2025-06-09T00:11:06Z","title":"JavelinGuard: Low-Cost Transformer Architectures for LLM Security","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-07T05:41:25.415816Z"},"links":{"cited_paper":"/paper/2311.00172","citing_paper":"/paper/2506.07330"},"observation_digest":"sha256:d141e913ecffa180d03ad280e6e4736d880f20b17ae009138445d9c145387381","observation_id":"b9e816b9-6a8f-421f-a1db-9f3116b1adee","resolution":{"observed_at":"2026-08-07T05:41:25.415816Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:41:26.275486Z","title":"Lakera-guard, 2024","venue":null,"work_id":"dfea060b-ab6c-41e4-ba62-af5aa68de582","year":2024},"citing_paper":{"arxiv_id":"2506.07330","last_updated":"2025-06-09T00:11:06Z","snapshot_observed_at":"2026-08-07T08:21:07.384830Z","submitted_at":"2025-06-09T00:11:06Z","title":"JavelinGuard: Low-Cost Transformer Architectures for LLM Security","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-07T05:41:25.419706Z"},"links":{"citing_paper":"/paper/2506.07330"},"observation_digest":"sha256:0c450eade3379e7db56608940fcf995c99c2a2f0aa031bdf76382c740e61ae33","observation_id":"410026cd-3f9f-4d39-9f22-e2c59ed3f11c","resolution":{"observed_at":"2026-08-07T05:41:26.279215Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.22770","last_updated":"2025-03-30T16:39:15Z","snapshot_observed_at":"2026-07-06T19:42:03.739016Z","submitted_at":"2024-10-30T07:39:42Z","title":"InjecGuard: Benchmarking and Mitigating Over-defense in Prompt Injection Guardrail Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.22770","snapshot_observed_at":"2026-08-07T05:41:25.422926Z","title":"Injecguard: Benchmarking and mitigating over-defense in prompt injection guardrail models, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07330","last_updated":"2025-06-09T00:11:06Z","snapshot_observed_at":"2026-08-07T08:21:07.384830Z","submitted_at":"2025-06-09T00:11:06Z","title":"JavelinGuard: Low-Cost Transformer Architectures for LLM Security","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-07T05:41:25.422926Z"},"links":{"cited_paper":"/paper/2410.22770","citing_paper":"/paper/2506.07330"},"observation_digest":"sha256:1cff914cece0565be5ef11f8c5928630e7b333daae7451988b59bb57a3a13e84","observation_id":"2b4a2a08-6a1f-44f4-8243-56230774416b","resolution":{"observed_at":"2026-08-07T05:41:25.422926Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.05044","last_updated":"2024-06-07T12:05:46Z","snapshot_observed_at":"2026-08-03T21:40:53.683032Z","submitted_at":"2024-02-07T17:33:54Z","title":"SALAD-Bench: A Hierarchical and Comprehensive Safety Benchmark for Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.05044","snapshot_observed_at":"2026-08-07T05:41:25.431089Z","title":"Salad-bench: A hierarchical and comprehensive safety benchmark for large language models, 2024 b","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07330","last_updated":"2025-06-09T00:11:06Z","snapshot_observed_at":"2026-08-07T08:21:07.384830Z","submitted_at":"2025-06-09T00:11:06Z","title":"JavelinGuard: Low-Cost Transformer Architectures for LLM Security","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-07T05:41:25.431089Z"},"links":{"cited_paper":"/paper/2402.05044","citing_paper":"/paper/2506.07330"},"observation_digest":"sha256:831de858cbad0211f239cce3af8db43dc17b63ea62e21e974591804e8742473a","observation_id":"afdd77a0-996b-4739-bb66-7546694a0b4e","resolution":{"observed_at":"2026-08-07T05:41:25.431089Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:41:26.264919Z","title":"Toxicchat: Unveiling hidden challenges of toxicity detection in real-world user-ai conversation, 2023","venue":null,"work_id":"94946755-63c3-421e-8bb2-f5cd4fc0f622","year":2023},"citing_paper":{"arxiv_id":"2506.07330","last_updated":"2025-06-09T00:11:06Z","snapshot_observed_at":"2026-08-07T08:21:07.384830Z","submitted_at":"2025-06-09T00:11:06Z","title":"JavelinGuard: Low-Cost Transformer Architectures for LLM Security","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-07T05:41:25.435516Z"},"links":{"citing_paper":"/paper/2506.07330"},"observation_digest":"sha256:276b12ad6fa8154e840d85403eb5ab4eccab418faae3e42a643a654a21c10f0c","observation_id":"330eef9b-b172-4600-80f0-212d3ba113d2","resolution":{"observed_at":"2026-08-07T05:41:26.268900Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.03172","last_updated":"2023-11-20T23:09:34Z","snapshot_observed_at":"2026-07-06T15:51:12.179086Z","submitted_at":"2023-07-06T17:54:11Z","title":"Lost in the Middle: How Language Models Use Long Contexts","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.03172","snapshot_observed_at":"2026-08-07T05:41:25.439015Z","title":"Liu, Kevin Lin, John Hewitt, Ashwin Paranjape, Michele Bevilacqua, Fabio Petroni, and Percy Liang","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.07330","last_updated":"2025-06-09T00:11:06Z","snapshot_observed_at":"2026-08-07T08:21:07.384830Z","submitted_at":"2025-06-09T00:11:06Z","title":"JavelinGuard: Low-Cost Transformer Architectures for LLM Security","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-07T05:41:25.439015Z"},"links":{"cited_paper":"/paper/2307.03172","citing_paper":"/paper/2506.07330"},"observation_digest":"sha256:98e429f6f0cfc8c31df0916f2a6af5f04c4d92a9958ddfd8ddc8470a6e949667","observation_id":"ac873b87-a630-4489-9957-ac37cca69be5","resolution":{"observed_at":"2026-08-07T05:41:25.439015Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.04957","last_updated":"2024-03-07T23:46:20Z","snapshot_observed_at":"2026-07-06T17:41:19.171822Z","submitted_at":"2024-03-07T23:46:20Z","title":"Automatic and Universal Prompt Injection Attacks against Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.04957","snapshot_observed_at":"2026-08-07T05:41:25.442964Z","title":"Automatic and universal prompt injection attacks against large language models, 2024 a","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07330","last_updated":"2025-06-09T00:11:06Z","snapshot_observed_at":"2026-08-07T08:21:07.384830Z","submitted_at":"2025-06-09T00:11:06Z","title":"JavelinGuard: Low-Cost Transformer Architectures for LLM Security","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-07T05:41:25.442964Z"},"links":{"cited_paper":"/paper/2403.04957","citing_paper":"/paper/2506.07330"},"observation_digest":"sha256:d83ce9f4e33cfcfea9ed79bd749e4559f1c95f0bf58ee2f1f9a461c4033497b9","observation_id":"3afdebdd-3f5e-4b72-9cbc-eccb2bbb06a5","resolution":{"observed_at":"2026-08-07T05:41:25.442964Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:41:25.446488Z","title":"Formalizing and benchmarking prompt injection attacks and defenses, 2024 b","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07330","last_updated":"2025-06-09T00:11:06Z","snapshot_observed_at":"2026-08-07T08:21:07.384830Z","submitted_at":"2025-06-09T00:11:06Z","title":"JavelinGuard: Low-Cost Transformer Architectures for LLM Security","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-07T05:41:25.446488Z"},"links":{"citing_paper":"/paper/2506.07330"},"observation_digest":"sha256:e64fc57477834351177be2eae3862b538946c9e89cc58aa2755735c1e9cbc56b","observation_id":"f7345811-4137-43a4-b338-a49484f5d123","resolution":{"observed_at":"2026-08-07T05:41:25.446488Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:41:26.253393Z","title":"Promptguard prompt injection guardrail, 2024","venue":null,"work_id":"18974fdc-032c-4be4-a556-4d65a65e0764","year":2024},"citing_paper":{"arxiv_id":"2506.07330","last_updated":"2025-06-09T00:11:06Z","snapshot_observed_at":"2026-08-07T08:21:07.384830Z","submitted_at":"2025-06-09T00:11:06Z","title":"JavelinGuard: Low-Cost Transformer Architectures for LLM Security","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-07T05:41:25.450555Z"},"links":{"citing_paper":"/paper/2506.07330"},"observation_digest":"sha256:96ec73482d1affa3fe3314ebd6e060c0c32b856ea40cba5a46ab2949255ee3c0","observation_id":"2b375a34-9b3e-4932-a5e8-e17de067a432","resolution":{"observed_at":"2026-08-07T05:41:26.256759Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.07724","last_updated":"2024-12-16T20:27:36Z","snapshot_observed_at":"2026-08-01T20:25:38.720765Z","submitted_at":"2024-12-10T18:17:02Z","title":"Granite Guardian","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.07724","snapshot_observed_at":"2026-08-07T05:41:25.455039Z","title":"Daly, Michael Hind, Werner Geyer, Ambrish Rawat, Kush R","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07330","last_updated":"2025-06-09T00:11:06Z","snapshot_observed_at":"2026-08-07T08:21:07.384830Z","submitted_at":"2025-06-09T00:11:06Z","title":"JavelinGuard: Low-Cost Transformer Architectures for LLM Security","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-07T05:41:25.455039Z"},"links":{"cited_paper":"/paper/2412.07724","citing_paper":"/paper/2506.07330"},"observation_digest":"sha256:044fac9340f9f3fe5e3e1aaf858ec089d001bfecda5286f66c8ca80c11b4c5f2","observation_id":"e45241f8-8ebd-45f5-b39e-5051199e0250","resolution":{"observed_at":"2026-08-07T05:41:25.455039Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.09527","last_updated":"2022-11-17T13:43:20Z","snapshot_observed_at":"2026-07-06T14:19:47.424778Z","submitted_at":"2022-11-17T13:43:20Z","title":"Ignore Previous Prompt: Attack Techniques For Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.09527","snapshot_observed_at":"2026-08-07T05:41:25.458988Z","title":"Ignore previous prompt: Attack techniques for language models, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.07330","last_updated":"2025-06-09T00:11:06Z","snapshot_observed_at":"2026-08-07T08:21:07.384830Z","submitted_at":"2025-06-09T00:11:06Z","title":"JavelinGuard: Low-Cost Transformer Architectures for LLM Security","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-07T05:41:25.458988Z"},"links":{"cited_paper":"/paper/2211.09527","citing_paper":"/paper/2506.07330"},"observation_digest":"sha256:1b1992e5494790c347ae892eb1e251e7c5fd08ee9572afa2c2df47cb8779e958","observation_id":"3b212c15-719f-48a6-b0fc-ead3d45c34d3","resolution":{"observed_at":"2026-08-07T05:41:25.458988Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:41:26.240285Z","title":"Fine-tuned deberta-v3-base for prompt injection detection, 2024 a","venue":null,"work_id":"29f48dc9-6553-4394-b04a-b71e7c08300b","year":2024},"citing_paper":{"arxiv_id":"2506.07330","last_updated":"2025-06-09T00:11:06Z","snapshot_observed_at":"2026-08-07T08:21:07.384830Z","submitted_at":"2025-06-09T00:11:06Z","title":"JavelinGuard: Low-Cost Transformer Architectures for LLM Security","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-07T05:41:25.462947Z"},"links":{"citing_paper":"/paper/2506.07330"},"observation_digest":"sha256:9a41d937f95e98fe3459297e66c9444208c660c3ea5a9b089f0cfd3b737b2418","observation_id":"31b87016-bfe2-4f07-b9ae-fa4a118254d0","resolution":{"observed_at":"2026-08-07T05:41:26.244784Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:41:26.228925Z","title":"Fine-tuned deberta-v3-base for prompt injection detection, 2024 b","venue":null,"work_id":"891dbfbc-c90d-47df-a620-ca7ed4221782","year":2024},"citing_paper":{"arxiv_id":"2506.07330","last_updated":"2025-06-09T00:11:06Z","snapshot_observed_at":"2026-08-07T08:21:07.384830Z","submitted_at":"2025-06-09T00:11:06Z","title":"JavelinGuard: Low-Cost Transformer Architectures for LLM Security","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-07T05:41:25.466333Z"},"links":{"citing_paper":"/paper/2506.07330"},"observation_digest":"sha256:4c71de5ffbb87036c26568a43b28ab3e8d38e1045e3f5eb8221ffb4768d46f03","observation_id":"2e629842-48bc-48f9-8fe6-206a3523b2d6","resolution":{"observed_at":"2026-08-07T05:41:26.232332Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.03693","last_updated":"2023-10-05T17:12:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-10-05T17:12:17Z","title":"Fine-tuning Aligned Language Models Compromises Safety, Even When Users Do Not Intend To!","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.03693","snapshot_observed_at":"2026-08-07T05:41:25.469886Z","title":"Fine-tuning aligned language models compromises safety, even when users do not intend to!, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.07330","last_updated":"2025-06-09T00:11:06Z","snapshot_observed_at":"2026-08-07T08:21:07.384830Z","submitted_at":"2025-06-09T00:11:06Z","title":"JavelinGuard: Low-Cost Transformer Architectures for LLM Security","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-07T05:41:25.469886Z"},"links":{"cited_paper":"/paper/2310.03693","citing_paper":"/paper/2506.07330"},"observation_digest":"sha256:315350a24118c09eae8657dd5f1158a701107a6c5504e255224c71f0bc1d4729","observation_id":"529f57a7-1efa-43c9-9fa3-97c2cedc1141","resolution":{"observed_at":"2026-08-07T05:41:25.469886Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.10501","last_updated":"2023-10-16T15:20:30Z","snapshot_observed_at":"2026-08-07T08:20:45.612923Z","submitted_at":"2023-10-16T15:20:30Z","title":"NeMo Guardrails: A Toolkit for Controllable and Safe LLM Applications with Programmable Rails","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.10501","snapshot_observed_at":"2026-08-07T05:41:25.473951Z","title":"Nemo guardrails: A toolkit for controllable and safe llm applications with programmable rails, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.07330","last_updated":"2025-06-09T00:11:06Z","snapshot_observed_at":"2026-08-07T08:21:07.384830Z","submitted_at":"2025-06-09T00:11:06Z","title":"JavelinGuard: Low-Cost Transformer Architectures for LLM Security","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-07T05:41:25.473951Z"},"links":{"cited_paper":"/paper/2310.10501","citing_paper":"/paper/2506.07330"},"observation_digest":"sha256:e57333670153713b3c1f8addc8ccde48d9fb4a645c48e32084b2e78fcf546a5d","observation_id":"aaef1318-e025-4719-b3e6-875569d1de59","resolution":{"observed_at":"2026-08-07T05:41:25.473951Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.16822","last_updated":"2024-12-11T18:07:25Z","snapshot_observed_at":"2026-07-06T17:35:41.168780Z","submitted_at":"2024-02-26T18:47:27Z","title":"Rainbow Teaming: Open-Ended Generation of Diverse Adversarial Prompts","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.16822","snapshot_observed_at":"2026-08-07T05:41:25.478376Z","title":"Markosyan, Manish Bhatt, Yuning Mao, Minqi Jiang, Jack Parker-Holder, Jakob Foerster, Tim Rocktäschel, and Roberta Raileanu","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07330","last_updated":"2025-06-09T00:11:06Z","snapshot_observed_at":"2026-08-07T08:21:07.384830Z","submitted_at":"2025-06-09T00:11:06Z","title":"JavelinGuard: Low-Cost Transformer Architectures for LLM Security","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-07T05:41:25.478376Z"},"links":{"cited_paper":"/paper/2402.16822","citing_paper":"/paper/2506.07330"},"observation_digest":"sha256:bbf08d2a7b1e586ffd1100644759a521b01b0df261743f74617c38399443aecd","observation_id":"35009d95-66aa-4b6f-83aa-3f26744e32df","resolution":{"observed_at":"2026-08-07T05:41:25.478376Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1910.01108","last_updated":"2020-03-01T02:57:50Z","snapshot_observed_at":"2026-08-07T19:07:36.327251Z","submitted_at":"2019-10-02T17:56:28Z","title":"DistilBERT, a distilled version of BERT: smaller, faster, cheaper and lighter","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1910.01108","snapshot_observed_at":"2026-08-07T05:41:25.482732Z","title":"Distilbert, a distilled version of bert: smaller, faster, cheaper and lighter, 2020","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.07330","last_updated":"2025-06-09T00:11:06Z","snapshot_observed_at":"2026-08-07T08:21:07.384830Z","submitted_at":"2025-06-09T00:11:06Z","title":"JavelinGuard: Low-Cost Transformer Architectures for LLM Security","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-07T05:41:25.482732Z"},"links":{"cited_paper":"/paper/1910.01108","citing_paper":"/paper/2506.07330"},"observation_digest":"sha256:f9f6544443eae11b8ac1eea1d2b81a1f999da87191179120fbe72f3a70745987","observation_id":"041865a1-7169-4108-9207-5d1b3a5aee40","resolution":{"observed_at":"2026-08-07T05:41:25.482732Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:41:26.218972Z","title":"``Do Anything Now'': Characterizing and Evaluating In-The-Wild Jailbreak Prompts on Large Language Models","venue":null,"work_id":"42decdf2-35f9-4b79-806f-669a7275378a","year":2024},"citing_paper":{"arxiv_id":"2506.07330","last_updated":"2025-06-09T00:11:06Z","snapshot_observed_at":"2026-08-07T08:21:07.384830Z","submitted_at":"2025-06-09T00:11:06Z","title":"JavelinGuard: Low-Cost Transformer Architectures for LLM Security","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-07T05:41:25.486154Z"},"links":{"citing_paper":"/paper/2506.07330"},"observation_digest":"sha256:fa5fb300b051011d205e8cfc481c7205e8200efcc9842255eef8997b9e5a5e47","observation_id":"d8030e0e-bc31-409a-b35c-b78a0376e43a","resolution":{"observed_at":"2026-08-07T05:41:26.222484Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.17710","last_updated":"2025-08-24T03:35:16Z","snapshot_observed_at":"2026-08-07T19:31:21.577691Z","submitted_at":"2024-03-26T13:58:00Z","title":"Optimization-based Prompt Injection Attack to LLM-as-a-Judge","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.17710","snapshot_observed_at":"2026-08-07T05:41:25.489612Z","title":"Optimization-based prompt injection attack to llm-as-a-judge, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07330","last_updated":"2025-06-09T00:11:06Z","snapshot_observed_at":"2026-08-07T08:21:07.384830Z","submitted_at":"2025-06-09T00:11:06Z","title":"JavelinGuard: Low-Cost Transformer Architectures for LLM Security","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-07T05:41:25.489612Z"},"links":{"cited_paper":"/paper/2403.17710","citing_paper":"/paper/2506.07330"},"observation_digest":"sha256:8fd4927c31df266cb9424954679ce38aca0d941c922de9b2742cd3441f021e52","observation_id":"f2c8128a-0674-4de9-b909-8351da0a6d26","resolution":{"observed_at":"2026-08-07T05:41:25.489612Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:41:26.207377Z","title":"A party of foundation models, 2024","venue":null,"work_id":"3ca824bb-7aa9-4183-8d18-1b2f99a03931","year":2024},"citing_paper":{"arxiv_id":"2506.07330","last_updated":"2025-06-09T00:11:06Z","snapshot_observed_at":"2026-08-07T08:21:07.384830Z","submitted_at":"2025-06-09T00:11:06Z","title":"JavelinGuard: Low-Cost Transformer Architectures for LLM Security","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-07T05:41:25.493704Z"},"links":{"citing_paper":"/paper/2506.07330"},"observation_digest":"sha256:b5a637a7111469f8d1fcbfc0cac17281bc032d882c90b6109ef667bbf5e33c06","observation_id":"dbedd655-a9e4-41ac-ac32-99b06d2f84fb","resolution":{"observed_at":"2026-08-07T05:41:26.211891Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:41:25.497130Z","title":"Alert: A comprehensive benchmark for assessing large language models' safety through red teaming, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07330","last_updated":"2025-06-09T00:11:06Z","snapshot_observed_at":"2026-08-07T08:21:07.384830Z","submitted_at":"2025-06-09T00:11:06Z","title":"JavelinGuard: Low-Cost Transformer Architectures for LLM Security","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-07T05:41:25.497130Z"},"links":{"citing_paper":"/paper/2506.07330"},"observation_digest":"sha256:40753b1d0b77b3362c3cfea45b72cbf173242a7ebe40da42f7a98b3aac5fc209","observation_id":"e6ce1a9c-425f-482a-945f-f58f49547b5d","resolution":{"observed_at":"2026-08-07T05:41:25.497130Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.01011","last_updated":"2023-11-02T06:13:36Z","snapshot_observed_at":"2026-07-06T16:42:04.139453Z","submitted_at":"2023-11-02T06:13:36Z","title":"Tensor Trust: Interpretable Prompt Injection Attacks from an Online Game","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.01011","snapshot_observed_at":"2026-08-07T05:41:25.500880Z","title":"Tensor trust: Interpretable prompt injection attacks from an online game, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.07330","last_updated":"2025-06-09T00:11:06Z","snapshot_observed_at":"2026-08-07T08:21:07.384830Z","submitted_at":"2025-06-09T00:11:06Z","title":"JavelinGuard: Low-Cost Transformer Architectures for LLM Security","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-07T05:41:25.500880Z"},"links":{"cited_paper":"/paper/2311.01011","citing_paper":"/paper/2506.07330"},"observation_digest":"sha256:fc8005fa4099b1b994877f7edd00714ac54c99d871f09ad6adafebe0906a176e","observation_id":"b71b49a1-7392-4df8-80af-f4a4e28d0588","resolution":{"observed_at":"2026-08-07T05:41:25.500880Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.08833","last_updated":"2023-06-15T03:30:13Z","snapshot_observed_at":"2026-07-06T15:42:44.954861Z","submitted_at":"2023-06-15T03:30:13Z","title":"Safeguarding Crowdsourcing Surveys from ChatGPT with Prompt Injection","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.08833","snapshot_observed_at":"2026-08-07T05:41:25.504822Z","title":"Safeguarding crowdsourcing surveys from chatgpt with prompt injection, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.07330","last_updated":"2025-06-09T00:11:06Z","snapshot_observed_at":"2026-08-07T08:21:07.384830Z","submitted_at":"2025-06-09T00:11:06Z","title":"JavelinGuard: Low-Cost Transformer Architectures for LLM Security","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-07T05:41:25.504822Z"},"links":{"cited_paper":"/paper/2306.08833","citing_paper":"/paper/2506.07330"},"observation_digest":"sha256:b18868612efd316f88986c15b7a38e8d463582e0e41ca5c5692b6d0aacec59c4","observation_id":"f53a5bc6-f00d-4a81-87a5-1bc33515624c","resolution":{"observed_at":"2026-08-07T05:41:25.504822Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.16459","last_updated":"2024-06-06T19:21:44Z","snapshot_observed_at":"2026-07-06T17:35:23.161066Z","submitted_at":"2024-02-26T10:03:33Z","title":"Defending LLMs against Jailbreaking Attacks via Backtranslation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.16459","snapshot_observed_at":"2026-08-07T05:41:25.509264Z","title":"Defending llms against jailbreaking attacks via backtranslation, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07330","last_updated":"2025-06-09T00:11:06Z","snapshot_observed_at":"2026-08-07T08:21:07.384830Z","submitted_at":"2025-06-09T00:11:06Z","title":"JavelinGuard: Low-Cost Transformer Architectures for LLM Security","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-07T05:41:25.509264Z"},"links":{"cited_paper":"/paper/2402.16459","citing_paper":"/paper/2506.07330"},"observation_digest":"sha256:8487a824d34384b360404bfcabb3cbacf68c15f51a5f1eefa6c4f10a5cfbf347","observation_id":"d4713d05-f5a1-4f04-ac63-5a6e06c47832","resolution":{"observed_at":"2026-08-07T05:41:25.509264Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.13663","last_updated":"2024-12-19T06:32:26Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-18T09:39:44Z","title":"Smarter, Better, Faster, Longer: A Modern Bidirectional Encoder for Fast, Memory Efficient, and Long Context Finetuning and Inference","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.13663","snapshot_observed_at":"2026-08-07T05:41:25.514146Z","title":"Smarter, better, faster, longer: A modern bidirectional encoder for fast, memory efficient, and long context finetuning and inference, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07330","last_updated":"2025-06-09T00:11:06Z","snapshot_observed_at":"2026-08-07T08:21:07.384830Z","submitted_at":"2025-06-09T00:11:06Z","title":"JavelinGuard: Low-Cost Transformer Architectures for LLM Security","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-07T05:41:25.514146Z"},"links":{"cited_paper":"/paper/2412.13663","citing_paper":"/paper/2506.07330"},"observation_digest":"sha256:e02de425865e79f863d125e6d127a90903c19d91ce07944729d7b2a450fa2405","observation_id":"31fee075-afa3-4a8a-b3e1-2d7eeb518f39","resolution":{"observed_at":"2026-08-07T05:41:25.514146Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.02483","last_updated":"2023-07-05T17:58:10Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-07-05T17:58:10Z","title":"Jailbroken: How Does LLM Safety Training Fail?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.02483","snapshot_observed_at":"2026-08-07T05:41:25.517829Z","title":"Jailbroken: How does llm safety training fail?, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.07330","last_updated":"2025-06-09T00:11:06Z","snapshot_observed_at":"2026-08-07T08:21:07.384830Z","submitted_at":"2025-06-09T00:11:06Z","title":"JavelinGuard: Low-Cost Transformer Architectures for LLM Security","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-07T05:41:25.517829Z"},"links":{"cited_paper":"/paper/2307.02483","citing_paper":"/paper/2506.07330"},"observation_digest":"sha256:be1108cdf2753c1f47aa14778de66c2135cb7610ad41d42bbc46800c081061f8","observation_id":"3e864e9e-421f-4698-a545-2841e7642b3f","resolution":{"observed_at":"2026-08-07T05:41:25.517829Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:41:25.522448Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.07330","last_updated":"2025-06-09T00:11:06Z","snapshot_observed_at":"2026-08-07T08:21:07.384830Z","submitted_at":"2025-06-09T00:11:06Z","title":"JavelinGuard: Low-Cost Transformer Architectures for LLM Security","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-07T05:41:25.522448Z"},"links":{"citing_paper":"/paper/2506.07330"},"observation_digest":"sha256:ac881a8e309f9cf5a36205da329fb10dedb39c00406afd9ece0cf4c12e6d0691","observation_id":"45aae516-53f2-4d72-86fc-0dc9f1494bd5","resolution":{"observed_at":"2026-08-07T05:41:25.522448Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.11082","last_updated":"2024-06-03T12:19:16Z","snapshot_observed_at":"2026-07-06T15:18:26.300068Z","submitted_at":"2023-04-19T17:50:09Z","title":"Fundamental Limitations of Alignment in Large Language Models","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.11082","snapshot_observed_at":"2026-08-07T05:41:25.526186Z","title":"Fundamental limitations of alignment in large language models, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07330","last_updated":"2025-06-09T00:11:06Z","snapshot_observed_at":"2026-08-07T08:21:07.384830Z","submitted_at":"2025-06-09T00:11:06Z","title":"JavelinGuard: Low-Cost Transformer Architectures for LLM Security","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-07T05:41:25.526186Z"},"links":{"cited_paper":"/paper/2304.11082","citing_paper":"/paper/2506.07330"},"observation_digest":"sha256:8a9142cc97f5e365eefdefd17a9913911051be6d2bfc96763473fbe48ff49faf","observation_id":"1885a77b-acf8-4ed0-bd2d-6a19a4d708c2","resolution":{"observed_at":"2026-08-07T05:41:25.526186Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.14197","last_updated":"2025-01-27T08:51:16Z","snapshot_observed_at":"2026-07-06T17:06:45.522731Z","submitted_at":"2023-12-21T01:08:39Z","title":"Benchmarking and Defending Against Indirect Prompt Injection Attacks on Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.14197","snapshot_observed_at":"2026-08-07T05:41:25.529733Z","title":"Benchmarking and defending against indirect prompt injection attacks on large language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.07330","last_updated":"2025-06-09T00:11:06Z","snapshot_observed_at":"2026-08-07T08:21:07.384830Z","submitted_at":"2025-06-09T00:11:06Z","title":"JavelinGuard: Low-Cost Transformer Architectures for LLM Security","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-07T05:41:25.529733Z"},"links":{"cited_paper":"/paper/2312.14197","citing_paper":"/paper/2506.07330"},"observation_digest":"sha256:edd29953debfdac69f7a50eb690cb0fc185314dc1308b7380f1c96025a00ccea","observation_id":"b0693264-866e-4e60-9f8e-589c4dda26a7","resolution":{"observed_at":"2026-08-07T05:41:25.529733Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:41:26.182281Z","title":"LLM-Fuzzer : Scaling assessment of large language model jailbreaks","venue":null,"work_id":"850e45f2-d145-408e-9509-7cece752288a","year":2024},"citing_paper":{"arxiv_id":"2506.07330","last_updated":"2025-06-09T00:11:06Z","snapshot_observed_at":"2026-08-07T08:21:07.384830Z","submitted_at":"2025-06-09T00:11:06Z","title":"JavelinGuard: Low-Cost Transformer Architectures for LLM Security","version":1},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-07T05:41:25.533385Z"},"links":{"citing_paper":"/paper/2506.07330"},"observation_digest":"sha256:d3d0748a33bd43b6490fcc634c1686b1a3851046ecee0fcd87fb584493172390","observation_id":"45cea3df-5075-46fc-a1fc-386817c55935","resolution":{"observed_at":"2026-08-07T05:41:26.187261Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21772","last_updated":"2024-08-04T22:13:39Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-07-31T17:48:14Z","title":"ShieldGemma: Generative AI Content Moderation Based on Gemma","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21772","snapshot_observed_at":"2026-08-07T05:41:25.536496Z","title":"Shieldgemma: Generative ai content moderation based on gemma, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07330","last_updated":"2025-06-09T00:11:06Z","snapshot_observed_at":"2026-08-07T08:21:07.384830Z","submitted_at":"2025-06-09T00:11:06Z","title":"JavelinGuard: Low-Cost Transformer Architectures for LLM Security","version":1},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-07T05:41:25.536496Z"},"links":{"cited_paper":"/paper/2407.21772","citing_paper":"/paper/2506.07330"},"observation_digest":"sha256:7c04f49313e2237dba6afe8e8a3c83b64b3e827089d149ae00df23a6f174cf3c","observation_id":"b22dcf5c-983d-4bf2-a0dd-31adf20acd47","resolution":{"observed_at":"2026-08-07T05:41:25.536496Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.02691","last_updated":"2024-08-04T04:52:35Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-03-05T06:21:45Z","title":"InjecAgent: Benchmarking Indirect Prompt Injections in Tool-Integrated Large Language Model Agents","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.02691","snapshot_observed_at":"2026-08-07T05:41:25.540312Z","title":"Injecagent: Benchmarking indirect prompt injections in tool-integrated large language model agents, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07330","last_updated":"2025-06-09T00:11:06Z","snapshot_observed_at":"2026-08-07T08:21:07.384830Z","submitted_at":"2025-06-09T00:11:06Z","title":"JavelinGuard: Low-Cost Transformer Architectures for LLM Security","version":1},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-08-07T05:41:25.540312Z"},"links":{"cited_paper":"/paper/2403.02691","citing_paper":"/paper/2506.07330"},"observation_digest":"sha256:00c7e6b7dc9a140f1952d28b20094812b8de82a65cf9dfc9d81a3b0526874103","observation_id":"e9bf3071-677e-4ee8-b44e-00b3661b94b0","resolution":{"observed_at":"2026-08-07T05:41:25.540312Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13148","last_updated":"2025-02-21T20:53:08Z","snapshot_observed_at":"2026-08-05T03:04:44.966583Z","submitted_at":"2024-02-20T17:04:06Z","title":"Defending Jailbreak Prompts via In-Context Adversarial Game","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.13148","snapshot_observed_at":"2026-08-07T05:41:25.544626Z","title":"Defending jailbreak prompts via in-context adversarial game, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.07330","last_updated":"2025-06-09T00:11:06Z","snapshot_observed_at":"2026-08-07T08:21:07.384830Z","submitted_at":"2025-06-09T00:11:06Z","title":"JavelinGuard: Low-Cost Transformer Architectures for LLM Security","version":1},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-08-07T05:41:25.544626Z"},"links":{"cited_paper":"/paper/2402.13148","citing_paper":"/paper/2506.07330"},"observation_digest":"sha256:a6bd12f6195b889a833c04c3ae67b76fdfb0d05c71e96522ad04c00a795af116","observation_id":"cf5e83f1-5c39-4c93-8e80-7d2b2bd3d55f","resolution":{"observed_at":"2026-08-07T05:41:25.544626Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.15043","last_updated":"2023-12-20T20:48:57Z","snapshot_observed_at":"2026-07-06T15:59:23.019044Z","submitted_at":"2023-07-27T17:49:12Z","title":"Universal and Transferable Adversarial Attacks on Aligned Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.15043","snapshot_observed_at":"2026-08-07T05:41:25.548660Z","title":"Zico Kolter, and Matt Fredrikson","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.07330","last_updated":"2025-06-09T00:11:06Z","snapshot_observed_at":"2026-08-07T08:21:07.384830Z","submitted_at":"2025-06-09T00:11:06Z","title":"JavelinGuard: Low-Cost Transformer Architectures for LLM Security","version":1},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-08-07T05:41:25.548660Z"},"links":{"cited_paper":"/paper/2307.15043","citing_paper":"/paper/2506.07330"},"observation_digest":"sha256:08906593b5242e32309fc5946259fc4787411d8708e84e5114d27084c9a75ca7","observation_id":"492e0e5a-2a9e-403c-ad88-6b7f8e6e2492","resolution":{"observed_at":"2026-08-07T05:41:25.548660Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.04313","last_updated":"2024-07-12T16:51:07Z","snapshot_observed_at":"2026-07-06T18:26:42.010940Z","submitted_at":"2024-06-06T17:57:04Z","title":"Improving Alignment and Robustness with Circuit Breakers","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.04313","snapshot_observed_at":"2026-08-07T05:41:25.552737Z","title":"Improving alignment and robustness with circuit breakers, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07330","last_updated":"2025-06-09T00:11:06Z","snapshot_observed_at":"2026-08-07T08:21:07.384830Z","submitted_at":"2025-06-09T00:11:06Z","title":"JavelinGuard: Low-Cost Transformer Architectures for LLM Security","version":1},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-08-07T05:41:25.552737Z"},"links":{"cited_paper":"/paper/2406.04313","citing_paper":"/paper/2506.07330"},"observation_digest":"sha256:20875e10752b80993a20483c763b3a80a7a9f2190d584b363292de985da360d1","observation_id":"09c7b8f0-600e-4068-9bc2-b468114b3fc6","resolution":{"observed_at":"2026-08-07T05:41:25.552737Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.07330","last_updated":"2025-06-09T00:11:06Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-07T08:21:07.384830Z","submitted_at":"2025-06-09T00:11:06Z","title":"JavelinGuard: Low-Cost Transformer Architectures for LLM Security"},"reference_resolution":{"displayed":60,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":50,"verified_exact":0,"verified_fuzzy":10},"total_outbound_references":60},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 60 of 60 outbound references and 1 inbound Pith citation observation for arXiv:2506.07330."}