{"as_of":"2026-08-11T06:50:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:5a8e0c1ce1a551a0e0a13557565aacf7cdd64d8ddd21ebf8a685ebcc6f04ddf3","coverage":[{"denominator":159,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":100,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-04T22:33:30.638437Z","state":"measured"},{"denominator":100,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":100,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-11T06:34:44.6726+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2509.07287/citation-record","integrity":"/paper/2509.07287/integrity","json":"/paper/2509.07287/citation-record.json","paper":"/paper/2509.07287"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T22:33:20.402933Z","title":"[Online]","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.07287","last_updated":"2025-09-08T23:44:00Z","snapshot_observed_at":"2026-08-09T14:00:07.903618Z","submitted_at":"2025-09-08T23:44:00Z","title":"Paladin: Defending LLM-enabled Phishing Emails with a New Trigger-Tag Paradigm","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-04T22:33:20.402933Z"},"links":{"citing_paper":"/paper/2509.07287"},"observation_digest":"sha256:627a060e385b0e2026ed22d76da58aeee6a5479ebe32051cebed635ea0c2d311","observation_id":"c1536c27-7079-4391-a25c-e623c269f63b","resolution":{"observed_at":"2026-08-04T22:33:20.402933Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13971","last_updated":"2023-02-27T17:11:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-27T17:11:15Z","title":"LLaMA: Open and Efficient Foundation Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.13971","snapshot_observed_at":"2026-08-04T22:33:20.463575Z","title":"Llama: Open and efficient foundation language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.07287","last_updated":"2025-09-08T23:44:00Z","snapshot_observed_at":"2026-08-09T14:00:07.903618Z","submitted_at":"2025-09-08T23:44:00Z","title":"Paladin: Defending LLM-enabled Phishing Emails with a New Trigger-Tag Paradigm","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-04T22:33:20.463575Z"},"links":{"cited_paper":"/paper/2302.13971","citing_paper":"/paper/2509.07287"},"observation_digest":"sha256:232a2a65a78386c02835188bf30ab42d4c3559a6289b1b0d2d48eda6908eb190","observation_id":"0cccf0d8-a427-49e3-9972-89ae07acd8ef","resolution":{"observed_at":"2026-08-04T22:33:20.463575Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-08-10T16:40:37.411115Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-04T22:33:20.539613Z","title":"The llama 3 herd of models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.07287","last_updated":"2025-09-08T23:44:00Z","snapshot_observed_at":"2026-08-09T14:00:07.903618Z","submitted_at":"2025-09-08T23:44:00Z","title":"Paladin: Defending LLM-enabled Phishing Emails with a New Trigger-Tag Paradigm","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-04T22:33:20.539613Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2509.07287"},"observation_digest":"sha256:19460da98b81ab921c8fb10a45f3850522d504c9d00d5ae92386cb171cf83964","observation_id":"93a1b760-f605-4874-a558-82c25ea8c5b1","resolution":{"observed_at":"2026-08-04T22:33:20.539613Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.16609","last_updated":"2023-09-28T17:07:49Z","snapshot_observed_at":"2026-08-09T21:25:20.369782Z","submitted_at":"2023-09-28T17:07:49Z","title":"Qwen Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.16609","snapshot_observed_at":"2026-08-04T22:33:20.624800Z","title":"Qwen technical report,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.07287","last_updated":"2025-09-08T23:44:00Z","snapshot_observed_at":"2026-08-09T14:00:07.903618Z","submitted_at":"2025-09-08T23:44:00Z","title":"Paladin: Defending LLM-enabled Phishing Emails with a New Trigger-Tag Paradigm","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-04T22:33:20.624800Z"},"links":{"cited_paper":"/paper/2309.16609","citing_paper":"/paper/2509.07287"},"observation_digest":"sha256:b43c9d007da7b8db776e15333a6c32cf35b435270619416682c2db37f7d8946c","observation_id":"8605b452-eea5-41b7-ac49-d8b8e153ab16","resolution":{"observed_at":"2026-08-04T22:33:20.624800Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15115","last_updated":"2025-01-03T02:18:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-19T17:56:09Z","title":"Qwen2.5 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.15115","snapshot_observed_at":"2026-08-04T22:33:20.694909Z","title":"Qwen2. 5 technical report,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.07287","last_updated":"2025-09-08T23:44:00Z","snapshot_observed_at":"2026-08-09T14:00:07.903618Z","submitted_at":"2025-09-08T23:44:00Z","title":"Paladin: Defending LLM-enabled Phishing Emails with a New Trigger-Tag Paradigm","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-04T22:33:20.694909Z"},"links":{"cited_paper":"/paper/2412.15115","citing_paper":"/paper/2509.07287"},"observation_digest":"sha256:898c1ee9c926510952d1cb7b889efaf3d630d442374d36aa318e2fb432689b8f","observation_id":"fa2bfb13-669f-4f21-8c1f-544f3167eebe","resolution":{"observed_at":"2026-08-04T22:33:20.694909Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.19437","last_updated":"2025-02-18T17:26:38Z","snapshot_observed_at":"2026-08-11T01:48:59.557045Z","submitted_at":"2024-12-27T04:03:16Z","title":"DeepSeek-V3 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.19437","snapshot_observed_at":"2026-08-04T22:33:20.799491Z","title":"Deepseek-v3 technical report,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.07287","last_updated":"2025-09-08T23:44:00Z","snapshot_observed_at":"2026-08-09T14:00:07.903618Z","submitted_at":"2025-09-08T23:44:00Z","title":"Paladin: Defending LLM-enabled Phishing Emails with a New Trigger-Tag Paradigm","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-04T22:33:20.799491Z"},"links":{"cited_paper":"/paper/2412.19437","citing_paper":"/paper/2509.07287"},"observation_digest":"sha256:6a2540ca15fc9620470378fd2eed890a021152211e81637a90fba8d3e58147de","observation_id":"1444f8da-f15e-4b24-aa5d-87793d1fb6d8","resolution":{"observed_at":"2026-08-04T22:33:20.799491Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13971","last_updated":"2023-02-27T17:11:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-27T17:11:15Z","title":"LLaMA: Open and Efficient Foundation Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.13971","snapshot_observed_at":"2026-08-04T22:33:20.902746Z","title":"Llama: Open and efficient foundation language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.07287","last_updated":"2025-09-08T23:44:00Z","snapshot_observed_at":"2026-08-09T14:00:07.903618Z","submitted_at":"2025-09-08T23:44:00Z","title":"Paladin: Defending LLM-enabled Phishing Emails with a New Trigger-Tag Paradigm","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-04T22:33:20.902746Z"},"links":{"cited_paper":"/paper/2302.13971","citing_paper":"/paper/2509.07287"},"observation_digest":"sha256:c8903fc92cdb350c58b3651c08302aebc17737544e1a7d86f4fee74ddcee10bf","observation_id":"761f191d-d74a-4b4c-aa7f-295f546d848e","resolution":{"observed_at":"2026-08-04T22:33:20.902746Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T22:33:21.012137Z","title":"A survey on large language model (llm) security and privacy: The good, the bad, and the ugly,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.07287","last_updated":"2025-09-08T23:44:00Z","snapshot_observed_at":"2026-08-09T14:00:07.903618Z","submitted_at":"2025-09-08T23:44:00Z","title":"Paladin: Defending LLM-enabled Phishing Emails with a New Trigger-Tag Paradigm","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-04T22:33:21.012137Z"},"links":{"citing_paper":"/paper/2509.07287"},"observation_digest":"sha256:6e761e20d12aeef8d61e41f58c91ef17af3853111587feaa6b9665690f3e126b","observation_id":"5a4c99fa-3fd6-441b-844b-eea9c7b27774","resolution":{"observed_at":"2026-08-04T22:33:21.012137Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T22:33:21.261306Z","title":"How should pre- trained language models be fine-tuned towards adversarial robustness?","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2509.07287","last_updated":"2025-09-08T23:44:00Z","snapshot_observed_at":"2026-08-09T14:00:07.903618Z","submitted_at":"2025-09-08T23:44:00Z","title":"Paladin: Defending LLM-enabled Phishing Emails with a New Trigger-Tag Paradigm","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-04T22:33:21.261306Z"},"links":{"citing_paper":"/paper/2509.07287"},"observation_digest":"sha256:089a66c4e3d9a239b2dcef4dca591e5f30af8cffaa20f02d9a8cfb2ae08e0622","observation_id":"2d1410e8-0bde-4516-88f6-6bc3d5d1f2a7","resolution":{"observed_at":"2026-08-04T22:33:21.261306Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T22:33:21.359313Z","title":"Textual manifold-based defense against natural language adversarial examples,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.07287","last_updated":"2025-09-08T23:44:00Z","snapshot_observed_at":"2026-08-09T14:00:07.903618Z","submitted_at":"2025-09-08T23:44:00Z","title":"Paladin: Defending LLM-enabled Phishing Emails with a New Trigger-Tag Paradigm","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-04T22:33:21.359313Z"},"links":{"citing_paper":"/paper/2509.07287"},"observation_digest":"sha256:42247e7c3ecbb66ba231fdec0051a8c7f616b824d35ab63b8ed6fc0573f8da94","observation_id":"65f2e6d1-6639-4404-bbc7-11605e55d48e","resolution":{"observed_at":"2026-08-04T22:33:21.359313Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T22:33:21.455181Z","title":"Using punctuation as an adversarial attack on deep learning-based nlp systems: An empirical study,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.07287","last_updated":"2025-09-08T23:44:00Z","snapshot_observed_at":"2026-08-09T14:00:07.903618Z","submitted_at":"2025-09-08T23:44:00Z","title":"Paladin: Defending LLM-enabled Phishing Emails with a New Trigger-Tag Paradigm","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-04T22:33:21.455181Z"},"links":{"citing_paper":"/paper/2509.07287"},"observation_digest":"sha256:cd6909cf2c2765519950102b7e50d0890665c22405b3c3ab47f2d909e8f4ac42","observation_id":"f8e9a7d4-e74f-42ea-b80e-7be0767dfbf3","resolution":{"observed_at":"2026-08-04T22:33:21.455181Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.09673","last_updated":"2024-07-05T14:51:55Z","snapshot_observed_at":"2026-08-06T00:24:20.578745Z","submitted_at":"2024-01-18T01:18:59Z","title":"Artwork Protection Against Neural Style Transfer Using Locally Adaptive Adversarial Color Attack","version":3},"cited_work":{"arxiv_id":"2401.09673","doi":null,"metadata_source":"pith","pith_arxiv_id":"2401.09673","snapshot_observed_at":"2026-08-04T22:33:37.428914Z","title":"Artwork Protection Against Neural Style Transfer Using Locally Adaptive Adversarial Color Attack","venue":"cs.CV","work_id":"338f5282-4f02-4b10-8230-11ff9c0ac9ba","year":2024},"citing_paper":{"arxiv_id":"2509.07287","last_updated":"2025-09-08T23:44:00Z","snapshot_observed_at":"2026-08-09T14:00:07.903618Z","submitted_at":"2025-09-08T23:44:00Z","title":"Paladin: Defending LLM-enabled Phishing Emails with a New Trigger-Tag Paradigm","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-04T22:33:21.503005Z"},"links":{"cited_paper":"/paper/2401.09673","citing_paper":"/paper/2509.07287"},"observation_digest":"sha256:f78bce58f9dbe04d38c56ea091a7e016f722ce735e95359326388233b062bada","observation_id":"b3d856b6-50f5-4008-9f38-72b4dbea46d7","resolution":{"observed_at":"2026-08-04T22:33:37.483027Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T22:33:21.597316Z","title":"A white-box false positive adversarial attack method on contrastive loss based offline handwritten signature verification models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.07287","last_updated":"2025-09-08T23:44:00Z","snapshot_observed_at":"2026-08-09T14:00:07.903618Z","submitted_at":"2025-09-08T23:44:00Z","title":"Paladin: Defending LLM-enabled Phishing Emails with a New Trigger-Tag Paradigm","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-04T22:33:21.597316Z"},"links":{"citing_paper":"/paper/2509.07287"},"observation_digest":"sha256:a6f6e89f2196519dbd570df2c000f805bede5e17e506e12e9e4131fdb6402ff7","observation_id":"8e06a7c6-7b5b-4dea-b3af-1d6e82ff4d38","resolution":{"observed_at":"2026-08-04T22:33:21.597316Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T22:33:21.691377Z","title":"Man ends his life due to ai encouragement,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.07287","last_updated":"2025-09-08T23:44:00Z","snapshot_observed_at":"2026-08-09T14:00:07.903618Z","submitted_at":"2025-09-08T23:44:00Z","title":"Paladin: Defending LLM-enabled Phishing Emails with a New Trigger-Tag Paradigm","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-04T22:33:21.691377Z"},"links":{"citing_paper":"/paper/2509.07287"},"observation_digest":"sha256:7407664087401c1742a5ca68d0a04f4271159bc5e72440404fb1fad532ae4cca","observation_id":"94a39948-04d8-4966-8b77-af0397fc181d","resolution":{"observed_at":"2026-08-04T22:33:21.691377Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.07689","last_updated":"2023-11-13T19:13:29Z","snapshot_observed_at":"2026-07-06T16:47:01.374736Z","submitted_at":"2023-11-13T19:13:29Z","title":"MART: Improving LLM Safety with Multi-round Automatic Red-Teaming","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.07689","snapshot_observed_at":"2026-08-04T22:33:21.814669Z","title":"Mart: Improving llm safety with multi-round automatic red- teaming,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.07287","last_updated":"2025-09-08T23:44:00Z","snapshot_observed_at":"2026-08-09T14:00:07.903618Z","submitted_at":"2025-09-08T23:44:00Z","title":"Paladin: Defending LLM-enabled Phishing Emails with a New Trigger-Tag Paradigm","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-04T22:33:21.814669Z"},"links":{"cited_paper":"/paper/2311.07689","citing_paper":"/paper/2509.07287"},"observation_digest":"sha256:aad9f11773a684a038d9a258145fb85df8dab306b1c277777ac80e71d660ebc3","observation_id":"7b4a7287-a7aa-4929-b01a-c995f4b45c8b","resolution":{"observed_at":"2026-08-04T22:33:21.814669Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T22:33:21.935074Z","title":"(2024) The evolving landscape of llm training data","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.07287","last_updated":"2025-09-08T23:44:00Z","snapshot_observed_at":"2026-08-09T14:00:07.903618Z","submitted_at":"2025-09-08T23:44:00Z","title":"Paladin: Defending LLM-enabled Phishing Emails with a New Trigger-Tag Paradigm","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-04T22:33:21.935074Z"},"links":{"citing_paper":"/paper/2509.07287"},"observation_digest":"sha256:3c16d9877cd1a0846a64a10a2cbc28bae04782b24784e029bfc3828c54df7c5f","observation_id":"96e8eace-e08c-478c-8fc4-0ca00f3b6b2a","resolution":{"observed_at":"2026-08-04T22:33:21.935074Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.08073","last_updated":"2022-12-15T06:19:23Z","snapshot_observed_at":"2026-08-02T04:53:58.766070Z","submitted_at":"2022-12-15T06:19:23Z","title":"Constitutional AI: Harmlessness from AI Feedback","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.08073","snapshot_observed_at":"2026-08-04T22:33:22.038392Z","title":"Constitutional ai: Harmlessness from ai feedback,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.07287","last_updated":"2025-09-08T23:44:00Z","snapshot_observed_at":"2026-08-09T14:00:07.903618Z","submitted_at":"2025-09-08T23:44:00Z","title":"Paladin: Defending LLM-enabled Phishing Emails with a New Trigger-Tag Paradigm","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-04T22:33:22.038392Z"},"links":{"cited_paper":"/paper/2212.08073","citing_paper":"/paper/2509.07287"},"observation_digest":"sha256:57ec2560bc5b9e388c2a9b7422c71b9f90ae5b8b93c972b40485de27656cff52","observation_id":"d45e20a2-2831-4b63-bedd-a678a8a545fd","resolution":{"observed_at":"2026-08-04T22:33:22.038392Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T22:33:22.125400Z","title":"Mistral ai - models in amazon bedrock,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.07287","last_updated":"2025-09-08T23:44:00Z","snapshot_observed_at":"2026-08-09T14:00:07.903618Z","submitted_at":"2025-09-08T23:44:00Z","title":"Paladin: Defending LLM-enabled Phishing Emails with a New Trigger-Tag Paradigm","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-04T22:33:22.125400Z"},"links":{"citing_paper":"/paper/2509.07287"},"observation_digest":"sha256:9b2d6ee50a51932880ff50a64f43225e084a2101f866461855b5317b24f3650a","observation_id":"ff7a8baf-2e32-4da9-a1a5-0507c18ce249","resolution":{"observed_at":"2026-08-04T22:33:22.125400Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T22:33:22.233581Z","title":"Align your models — responsible generative ai toolkit,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.07287","last_updated":"2025-09-08T23:44:00Z","snapshot_observed_at":"2026-08-09T14:00:07.903618Z","submitted_at":"2025-09-08T23:44:00Z","title":"Paladin: Defending LLM-enabled Phishing Emails with a New Trigger-Tag Paradigm","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-04T22:33:22.233581Z"},"links":{"citing_paper":"/paper/2509.07287"},"observation_digest":"sha256:ab9472f4dbc04d0ebb1368d4538f825e6d6eb05584ed5c9afdf747d3754470b5","observation_id":"ddaf71ee-80d4-4676-89f0-1ed9365d9156","resolution":{"observed_at":"2026-08-04T22:33:22.233581Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.02033","last_updated":"2023-12-20T08:27:40Z","snapshot_observed_at":"2026-08-10T23:37:12.750863Z","submitted_at":"2023-09-05T08:22:07Z","title":"Data-Juicer: A One-Stop Data Processing System for Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.02033","snapshot_observed_at":"2026-08-04T22:33:22.371817Z","title":"Data-juicer: A one-stop data processing system for large language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.07287","last_updated":"2025-09-08T23:44:00Z","snapshot_observed_at":"2026-08-09T14:00:07.903618Z","submitted_at":"2025-09-08T23:44:00Z","title":"Paladin: Defending LLM-enabled Phishing Emails with a New Trigger-Tag Paradigm","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-04T22:33:22.371817Z"},"links":{"cited_paper":"/paper/2309.02033","citing_paper":"/paper/2509.07287"},"observation_digest":"sha256:3344934e31dce47805d05f10d5a642f533451a676860e775a3b0b6e6af86688a","observation_id":"77b3d680-6f4e-4258-9498-18517223fc46","resolution":{"observed_at":"2026-08-04T22:33:22.371817Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.03915","last_updated":"2023-03-07T14:25:44Z","snapshot_observed_at":"2026-07-06T14:59:43.014800Z","submitted_at":"2023-03-07T14:25:44Z","title":"The BigScience ROOTS Corpus: A 1.6TB Composite Multilingual Dataset","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.03915","snapshot_observed_at":"2026-08-04T22:33:22.514388Z","title":"The bigscience roots corpus: A 1.6tb composite multilingual dataset,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.07287","last_updated":"2025-09-08T23:44:00Z","snapshot_observed_at":"2026-08-09T14:00:07.903618Z","submitted_at":"2025-09-08T23:44:00Z","title":"Paladin: Defending LLM-enabled Phishing Emails with a New Trigger-Tag Paradigm","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-04T22:33:22.514388Z"},"links":{"cited_paper":"/paper/2303.03915","citing_paper":"/paper/2509.07287"},"observation_digest":"sha256:92154995e8157554407de58d44996ca5ff8f7a0bf994110849c8e2d6f91d9161","observation_id":"dbaedd58-1892-4ef7-8017-20a914af637d","resolution":{"observed_at":"2026-08-04T22:33:22.514388Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T22:33:22.671418Z","title":"Training language models to follow instructions with human feedback,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.07287","last_updated":"2025-09-08T23:44:00Z","snapshot_observed_at":"2026-08-09T14:00:07.903618Z","submitted_at":"2025-09-08T23:44:00Z","title":"Paladin: Defending LLM-enabled Phishing Emails with a New Trigger-Tag Paradigm","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-04T22:33:22.671418Z"},"links":{"citing_paper":"/paper/2509.07287"},"observation_digest":"sha256:81fbb92e9abc51f0f9092f52329313c9ebf06d08ef88129141348013ab032223","observation_id":"bcce4439-916f-4496-b47e-f2c53899fbd8","resolution":{"observed_at":"2026-08-04T22:33:22.671418Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T22:33:22.761193Z","title":"Improving language understanding by generative pre-training,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2509.07287","last_updated":"2025-09-08T23:44:00Z","snapshot_observed_at":"2026-08-09T14:00:07.903618Z","submitted_at":"2025-09-08T23:44:00Z","title":"Paladin: Defending LLM-enabled Phishing Emails with a New Trigger-Tag Paradigm","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-04T22:33:22.761193Z"},"links":{"citing_paper":"/paper/2509.07287"},"observation_digest":"sha256:b8d82571a8d9ffb29b59a8ac530dff7d067da9ef99cf7fb3e3cd7c360c97f297","observation_id":"bcb5eec6-98c8-4d4e-a244-23a4cfd39f9f","resolution":{"observed_at":"2026-08-04T22:33:22.761193Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2205.11916","last_updated":"2023-01-29T05:14:17Z","snapshot_observed_at":"2026-08-07T04:02:08.445660Z","submitted_at":"2022-05-24T09:22:26Z","title":"Large Language Models are Zero-Shot Reasoners","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.11916","snapshot_observed_at":"2026-08-04T22:33:22.898465Z","title":"Large language models are zero-shot reasoners,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.07287","last_updated":"2025-09-08T23:44:00Z","snapshot_observed_at":"2026-08-09T14:00:07.903618Z","submitted_at":"2025-09-08T23:44:00Z","title":"Paladin: Defending LLM-enabled Phishing Emails with a New Trigger-Tag Paradigm","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-04T22:33:22.898465Z"},"links":{"cited_paper":"/paper/2205.11916","citing_paper":"/paper/2509.07287"},"observation_digest":"sha256:3459b4811d5139b9ca8e074746b38c5c863003f08e3987c75201d6d31b303606","observation_id":"3a005816-ac61-4ba0-9ae7-94dd39335a7c","resolution":{"observed_at":"2026-08-04T22:33:22.898465Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2206.07682","last_updated":"2022-10-26T05:06:24Z","snapshot_observed_at":"2026-08-02T15:56:35.249569Z","submitted_at":"2022-06-15T17:32:01Z","title":"Emergent Abilities of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2206.07682","snapshot_observed_at":"2026-08-04T22:33:23.007474Z","title":"Emergent abilities of large language models,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.07287","last_updated":"2025-09-08T23:44:00Z","snapshot_observed_at":"2026-08-09T14:00:07.903618Z","submitted_at":"2025-09-08T23:44:00Z","title":"Paladin: Defending LLM-enabled Phishing Emails with a New Trigger-Tag Paradigm","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-04T22:33:23.007474Z"},"links":{"cited_paper":"/paper/2206.07682","citing_paper":"/paper/2509.07287"},"observation_digest":"sha256:ea69567c08ebdceffef807478488aa4879fe5bb4a74ca4ba67be6b9a71b4b6b8","observation_id":"72e1d268-20b8-4e23-ac5d-73445ac65a70","resolution":{"observed_at":"2026-08-04T22:33:23.007474Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.03693","last_updated":"2023-10-05T17:12:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-10-05T17:12:17Z","title":"Fine-tuning Aligned Language Models Compromises Safety, Even When Users Do Not Intend To!","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.03693","snapshot_observed_at":"2026-08-04T22:33:23.105788Z","title":"Fine-tuning aligned language models compromises safety, even when users do not intend to!","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.07287","last_updated":"2025-09-08T23:44:00Z","snapshot_observed_at":"2026-08-09T14:00:07.903618Z","submitted_at":"2025-09-08T23:44:00Z","title":"Paladin: Defending LLM-enabled Phishing Emails with a New Trigger-Tag Paradigm","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-04T22:33:23.105788Z"},"links":{"cited_paper":"/paper/2310.03693","citing_paper":"/paper/2509.07287"},"observation_digest":"sha256:a8538bd98e18ae9987c791e86f2560ccb29399073b7a2d1930c48b6c28503dda","observation_id":"0267baf5-bf0c-4c31-809c-cafde7b5d777","resolution":{"observed_at":"2026-08-04T22:33:23.105788Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T22:33:23.297692Z","title":"An intelligent cyber security phishing detection system using deep learning techniques,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.07287","last_updated":"2025-09-08T23:44:00Z","snapshot_observed_at":"2026-08-09T14:00:07.903618Z","submitted_at":"2025-09-08T23:44:00Z","title":"Paladin: Defending LLM-enabled Phishing Emails with a New Trigger-Tag Paradigm","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-04T22:33:23.297692Z"},"links":{"citing_paper":"/paper/2509.07287"},"observation_digest":"sha256:bdfc7ce31ee5da092b5249ddd28d32e8a85d9f1922de4806b29b40dfd818ab0a","observation_id":"e90d0f6e-c042-4c5f-a2ba-673ec64334d0","resolution":{"observed_at":"2026-08-04T22:33:23.297692Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T22:33:23.402897Z","title":"Cadue: Content-agnostic detection of unwanted emails for enterprise security,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2509.07287","last_updated":"2025-09-08T23:44:00Z","snapshot_observed_at":"2026-08-09T14:00:07.903618Z","submitted_at":"2025-09-08T23:44:00Z","title":"Paladin: Defending LLM-enabled Phishing Emails with a New Trigger-Tag Paradigm","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-04T22:33:23.402897Z"},"links":{"citing_paper":"/paper/2509.07287"},"observation_digest":"sha256:be157fc5fd6ed95a7355de2210155e77435a108b1ad24b2ac9c7f14dbcef7013","observation_id":"db0f6944-6375-43e4-a9ed-9ae31ee7d543","resolution":{"observed_at":"2026-08-04T22:33:23.402897Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T22:33:23.506518Z","title":"Phishing detection and impersonated entity discovery using conditional random field and latent dirichlet allocation,","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2509.07287","last_updated":"2025-09-08T23:44:00Z","snapshot_observed_at":"2026-08-09T14:00:07.903618Z","submitted_at":"2025-09-08T23:44:00Z","title":"Paladin: Defending LLM-enabled Phishing Emails with a New Trigger-Tag Paradigm","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-04T22:33:23.506518Z"},"links":{"citing_paper":"/paper/2509.07287"},"observation_digest":"sha256:baab93a9a7d3f4ddc96c916d2ef48f2690c95d2f5d312935d1e97379f0b8d506","observation_id":"02aee191-dcb0-4896-993c-de26e28a318e","resolution":{"observed_at":"2026-08-04T22:33:23.506518Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T22:33:23.609610Z","title":"Achieving a consensual definition of phishing based on a systematic review of the literature,","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2509.07287","last_updated":"2025-09-08T23:44:00Z","snapshot_observed_at":"2026-08-09T14:00:07.903618Z","submitted_at":"2025-09-08T23:44:00Z","title":"Paladin: Defending LLM-enabled Phishing Emails with a New Trigger-Tag Paradigm","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-04T22:33:23.609610Z"},"links":{"citing_paper":"/paper/2509.07287"},"observation_digest":"sha256:6e0cf542ef6fab2cb2a5b021be514050acdc0a5b0b37aadad9edb35bdb073ef1","observation_id":"d6d38967-8748-4df4-b1b9-1b1fefc452f7","resolution":{"observed_at":"2026-08-04T22:33:23.609610Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T22:33:23.670614Z","title":"Chatspamdetec- tor: Leveraging large language models for effective phishing email detection,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.07287","last_updated":"2025-09-08T23:44:00Z","snapshot_observed_at":"2026-08-09T14:00:07.903618Z","submitted_at":"2025-09-08T23:44:00Z","title":"Paladin: Defending LLM-enabled Phishing Emails with a New Trigger-Tag Paradigm","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-04T22:33:23.670614Z"},"links":{"citing_paper":"/paper/2509.07287"},"observation_digest":"sha256:9c0a97887431cdc9b190ec0a901deb876343eef8aec6af10e19c1586cfc39eb4","observation_id":"39b4647e-8a31-483f-9fc9-f574e6a36055","resolution":{"observed_at":"2026-08-04T22:33:23.670614Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.09433","last_updated":"2024-08-15T19:51:07Z","snapshot_observed_at":"2026-08-11T00:45:48.191177Z","submitted_at":"2023-11-15T23:07:40Z","title":"Trojan Activation Attack: Red-Teaming Large Language Models using Activation Steering for Safety-Alignment","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.09433","snapshot_observed_at":"2026-08-04T22:33:23.762799Z","title":"Backdoor activation attack: Attack large language models using activation steering for safety-alignment,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.07287","last_updated":"2025-09-08T23:44:00Z","snapshot_observed_at":"2026-08-09T14:00:07.903618Z","submitted_at":"2025-09-08T23:44:00Z","title":"Paladin: Defending LLM-enabled Phishing Emails with a New Trigger-Tag Paradigm","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-04T22:33:23.762799Z"},"links":{"cited_paper":"/paper/2311.09433","citing_paper":"/paper/2509.07287"},"observation_digest":"sha256:131896c25dd8686911158eea23d0a51c0134b0d8ac6f9938d3f871a7fccad0cd","observation_id":"392ef71b-f54a-460c-9979-0a6a0328f509","resolution":{"observed_at":"2026-08-04T22:33:23.762799Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.14910","last_updated":"2024-04-02T23:01:17Z","snapshot_observed_at":"2026-08-07T08:11:34.289181Z","submitted_at":"2023-05-24T08:59:25Z","title":"From Shortcuts to Triggers: Backdoor Defense with Denoised PoE","version":3},"cited_work":{"arxiv_id":"2305.14910","doi":null,"metadata_source":"pith","pith_arxiv_id":"2305.14910","snapshot_observed_at":"2026-08-04T22:33:36.824174Z","title":"From Shortcuts to Triggers: Backdoor Defense with Denoised PoE","venue":"cs.CL","work_id":"7ec0ab13-5033-447d-9120-e6351cf7ed6d","year":2023},"citing_paper":{"arxiv_id":"2509.07287","last_updated":"2025-09-08T23:44:00Z","snapshot_observed_at":"2026-08-09T14:00:07.903618Z","submitted_at":"2025-09-08T23:44:00Z","title":"Paladin: Defending LLM-enabled Phishing Emails with a New Trigger-Tag Paradigm","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-04T22:33:23.916249Z"},"links":{"cited_paper":"/paper/2305.14910","citing_paper":"/paper/2509.07287"},"observation_digest":"sha256:35edc4f89688d7151be3e97235a530fa6aa5944dc258938819dd68b9170d7f3b","observation_id":"c28db14b-19c1-41f2-958d-bff033e57efc","resolution":{"observed_at":"2026-08-04T22:33:36.955954Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.14401","last_updated":"2023-08-28T08:36:53Z","snapshot_observed_at":"2026-08-08T13:25:38.668285Z","submitted_at":"2023-08-28T08:36:53Z","title":"CodeMark: Imperceptible Watermarking for Code Datasets against Neural Code Completion Models","version":1},"cited_work":{"arxiv_id":"2308.14401","doi":null,"metadata_source":"pith","pith_arxiv_id":"2308.14401","snapshot_observed_at":"2026-08-04T22:33:36.653675Z","title":"CodeMark: Imperceptible Watermarking for Code Datasets against Neural Code Completion Models","venue":"cs.SE","work_id":"fb219e6a-2bb1-4ae8-8916-df97f84d26d6","year":2023},"citing_paper":{"arxiv_id":"2509.07287","last_updated":"2025-09-08T23:44:00Z","snapshot_observed_at":"2026-08-09T14:00:07.903618Z","submitted_at":"2025-09-08T23:44:00Z","title":"Paladin: Defending LLM-enabled Phishing Emails with a New Trigger-Tag Paradigm","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-04T22:33:24.013703Z"},"links":{"cited_paper":"/paper/2308.14401","citing_paper":"/paper/2509.07287"},"observation_digest":"sha256:e2826682f03f1a6733ef5b684639867dbaef5ddce4dba05402822f3732a0ee57","observation_id":"2829183b-2860-4bf2-933e-b548e22b9be6","resolution":{"observed_at":"2026-08-04T22:33:36.751219Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T22:33:24.122072Z","title":"Coprotector: Protect open- source code against unauthorized training usage with data poisoning,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.07287","last_updated":"2025-09-08T23:44:00Z","snapshot_observed_at":"2026-08-09T14:00:07.903618Z","submitted_at":"2025-09-08T23:44:00Z","title":"Paladin: Defending LLM-enabled Phishing Emails with a New Trigger-Tag Paradigm","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-04T22:33:24.122072Z"},"links":{"citing_paper":"/paper/2509.07287"},"observation_digest":"sha256:96d4c6041a6c295d0abeaeb396662ac727c833bdf54ff524563c85a1155c838d","observation_id":"ca45c022-93fd-46f1-aabc-618297052b11","resolution":{"observed_at":"2026-08-04T22:33:24.122072Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09288","last_updated":"2023-07-19T17:08:59Z","snapshot_observed_at":"2026-08-07T12:56:43.323460Z","submitted_at":"2023-07-18T14:31:57Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.09288","snapshot_observed_at":"2026-08-04T22:33:24.229075Z","title":"Llama 2: Open foundation and fine-tuned chat models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.07287","last_updated":"2025-09-08T23:44:00Z","snapshot_observed_at":"2026-08-09T14:00:07.903618Z","submitted_at":"2025-09-08T23:44:00Z","title":"Paladin: Defending LLM-enabled Phishing Emails with a New Trigger-Tag Paradigm","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-04T22:33:24.229075Z"},"links":{"cited_paper":"/paper/2307.09288","citing_paper":"/paper/2509.07287"},"observation_digest":"sha256:b70789b8300eb1c3234b1ae6ac6a06a7ff18d926a76792dcb36bbb92c15dc8a4","observation_id":"faae2d59-4838-41f7-b19c-a0f9c6f1b1a1","resolution":{"observed_at":"2026-08-04T22:33:24.229075Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T22:33:24.326763Z","title":"Fundamentals of recurrent neural network (rnn) and long short-term memory (lstm) network,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2509.07287","last_updated":"2025-09-08T23:44:00Z","snapshot_observed_at":"2026-08-09T14:00:07.903618Z","submitted_at":"2025-09-08T23:44:00Z","title":"Paladin: Defending LLM-enabled Phishing Emails with a New Trigger-Tag Paradigm","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-04T22:33:24.326763Z"},"links":{"citing_paper":"/paper/2509.07287"},"observation_digest":"sha256:aeab0b46e850de247d19ed7e6337e4786800bdba81faf1535da74016bdb400dd","observation_id":"2d0b5cb6-664c-43e9-9c40-851a3013044b","resolution":{"observed_at":"2026-08-04T22:33:24.326763Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T22:33:24.438611Z","title":"Attention is all you need,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2509.07287","last_updated":"2025-09-08T23:44:00Z","snapshot_observed_at":"2026-08-09T14:00:07.903618Z","submitted_at":"2025-09-08T23:44:00Z","title":"Paladin: Defending LLM-enabled Phishing Emails with a New Trigger-Tag Paradigm","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-04T22:33:24.438611Z"},"links":{"citing_paper":"/paper/2509.07287"},"observation_digest":"sha256:25cd586f76eb2c8487cc649c36082c4c6de02f242664d92ea198b6c2826c5f5a","observation_id":"eb647c84-22cc-4feb-b217-43bac51a3c2a","resolution":{"observed_at":"2026-08-04T22:33:24.438611Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-04T22:33:24.525164Z","title":"Gpt-4 technical report,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.07287","last_updated":"2025-09-08T23:44:00Z","snapshot_observed_at":"2026-08-09T14:00:07.903618Z","submitted_at":"2025-09-08T23:44:00Z","title":"Paladin: Defending LLM-enabled Phishing Emails with a New Trigger-Tag Paradigm","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-04T22:33:24.525164Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2509.07287"},"observation_digest":"sha256:806a63798798423c415a2a32e94b705d75d5a2dfc8a3ab7613d17f75481fec3d","observation_id":"3969d0de-06b2-4260-aa32-538621fa3d97","resolution":{"observed_at":"2026-08-04T22:33:24.525164Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.13335","last_updated":"2024-03-20T06:38:13Z","snapshot_observed_at":"2026-08-10T09:41:09.855172Z","submitted_at":"2024-03-20T06:38:13Z","title":"Adaptive Ensembles of Fine-Tuned Transformers for LLM-Generated Text Detection","version":1},"cited_work":{"arxiv_id":"2403.13335","doi":null,"metadata_source":"pith","pith_arxiv_id":"2403.13335","snapshot_observed_at":"2026-08-04T22:33:36.471185Z","title":"Adaptive Ensembles of Fine-Tuned Transformers for LLM-Generated Text Detection","venue":"cs.LG","work_id":"e8072896-f842-42a8-97f9-06ea74cab4bf","year":2024},"citing_paper":{"arxiv_id":"2509.07287","last_updated":"2025-09-08T23:44:00Z","snapshot_observed_at":"2026-08-09T14:00:07.903618Z","submitted_at":"2025-09-08T23:44:00Z","title":"Paladin: Defending LLM-enabled Phishing Emails with a New Trigger-Tag Paradigm","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-04T22:33:24.665696Z"},"links":{"cited_paper":"/paper/2403.13335","citing_paper":"/paper/2509.07287"},"observation_digest":"sha256:237533fa82f5655922de78b1bf622a77a93df9122372e0b99b3fb73626f97db5","observation_id":"ff757f3a-a0c2-45ba-9dcc-128ec22be3e9","resolution":{"observed_at":"2026-08-04T22:33:36.546237Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2204.05862","last_updated":"2022-04-12T15:02:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-04-12T15:02:38Z","title":"Training a Helpful and Harmless Assistant with Reinforcement Learning from Human Feedback","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.05862","snapshot_observed_at":"2026-08-04T22:33:24.958069Z","title":"Training a helpful and harmless assistant with reinforcement learning from human feed- back,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.07287","last_updated":"2025-09-08T23:44:00Z","snapshot_observed_at":"2026-08-09T14:00:07.903618Z","submitted_at":"2025-09-08T23:44:00Z","title":"Paladin: Defending LLM-enabled Phishing Emails with a New Trigger-Tag Paradigm","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-04T22:33:24.958069Z"},"links":{"cited_paper":"/paper/2204.05862","citing_paper":"/paper/2509.07287"},"observation_digest":"sha256:095c9b979ee36eee33ac9828c2bac6e7d324149c5cad4f0384dc07202ead486b","observation_id":"1ad16e5d-7301-4988-a1ce-578fec8f6f4d","resolution":{"observed_at":"2026-08-04T22:33:24.958069Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.18290","last_updated":"2024-07-29T22:26:36Z","snapshot_observed_at":"2026-08-01T16:34:38.795326Z","submitted_at":"2023-05-29T17:57:46Z","title":"Direct Preference Optimization: Your Language Model is Secretly a Reward Model","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.18290","snapshot_observed_at":"2026-08-04T22:33:25.158104Z","title":"Direct preference optimization: Your language model is secretly a reward model,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.07287","last_updated":"2025-09-08T23:44:00Z","snapshot_observed_at":"2026-08-09T14:00:07.903618Z","submitted_at":"2025-09-08T23:44:00Z","title":"Paladin: Defending LLM-enabled Phishing Emails with a New Trigger-Tag Paradigm","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-04T22:33:25.158104Z"},"links":{"cited_paper":"/paper/2305.18290","citing_paper":"/paper/2509.07287"},"observation_digest":"sha256:3032adff650db37f074ba4aebb22ffc83ca97e51352811b35c63866aca1d5727","observation_id":"fcb26374-0989-42f7-94e8-d556f6b5243c","resolution":{"observed_at":"2026-08-04T22:33:25.158104Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2301.04246","last_updated":"2023-01-10T23:42:30Z","snapshot_observed_at":"2026-08-10T16:10:21.882538Z","submitted_at":"2023-01-10T23:42:30Z","title":"Generative Language Models and Automated Influence Operations: Emerging Threats and Potential Mitigations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.04246","snapshot_observed_at":"2026-08-04T22:33:25.330648Z","title":"Generative language models and automated influence operations: Emerging threats and potential mitigations,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.07287","last_updated":"2025-09-08T23:44:00Z","snapshot_observed_at":"2026-08-09T14:00:07.903618Z","submitted_at":"2025-09-08T23:44:00Z","title":"Paladin: Defending LLM-enabled Phishing Emails with a New Trigger-Tag Paradigm","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-04T22:33:25.330648Z"},"links":{"cited_paper":"/paper/2301.04246","citing_paper":"/paper/2509.07287"},"observation_digest":"sha256:f62fd35786981fb7f6b7d2e1e0dc93820e6ee04bae8884349302c7dd80dcc6fc","observation_id":"bc097c94-1d99-456b-8a0c-69c97eab2a51","resolution":{"observed_at":"2026-08-04T22:33:25.330648Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.06899","last_updated":"2024-05-22T06:18:41Z","snapshot_observed_at":"2026-08-07T07:57:31.754486Z","submitted_at":"2023-11-12T17:18:21Z","title":"Flames: Benchmarking Value Alignment of LLMs in Chinese","version":6},"cited_work":{"arxiv_id":"2311.06899","doi":null,"metadata_source":"pith","pith_arxiv_id":"2311.06899","snapshot_observed_at":"2026-08-04T22:33:36.302458Z","title":"Flames: Benchmarking Value Alignment of LLMs in Chinese","venue":"cs.CL","work_id":"811fc501-bfb3-4609-9577-c787afb19291","year":2023},"citing_paper":{"arxiv_id":"2509.07287","last_updated":"2025-09-08T23:44:00Z","snapshot_observed_at":"2026-08-09T14:00:07.903618Z","submitted_at":"2025-09-08T23:44:00Z","title":"Paladin: Defending LLM-enabled Phishing Emails with a New Trigger-Tag Paradigm","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-04T22:33:25.430994Z"},"links":{"cited_paper":"/paper/2311.06899","citing_paper":"/paper/2509.07287"},"observation_digest":"sha256:41041405e85173e2d34813b21353238be1d10988d2bc42cbe8490b13e760aff7","observation_id":"b738e5ed-3f5e-43ec-93cb-7fc7dfe409f5","resolution":{"observed_at":"2026-08-04T22:33:36.328020Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.10436","last_updated":"2023-04-20T16:27:35Z","snapshot_observed_at":"2026-07-06T15:17:59.640907Z","submitted_at":"2023-04-20T16:27:35Z","title":"Safety Assessment of Chinese Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.10436","snapshot_observed_at":"2026-08-04T22:33:25.544372Z","title":"Safety assessment of chinese large language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.07287","last_updated":"2025-09-08T23:44:00Z","snapshot_observed_at":"2026-08-09T14:00:07.903618Z","submitted_at":"2025-09-08T23:44:00Z","title":"Paladin: Defending LLM-enabled Phishing Emails with a New Trigger-Tag Paradigm","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-04T22:33:25.544372Z"},"links":{"cited_paper":"/paper/2304.10436","citing_paper":"/paper/2509.07287"},"observation_digest":"sha256:67d5df61ebe5d0ac31fd947ae4ee0b5633c5ef5227934bf333af21b4da4d7789","observation_id":"50e9a650-1576-4307-a997-56c6542d7b07","resolution":{"observed_at":"2026-08-04T22:33:25.544372Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.07045","last_updated":"2024-06-24T04:04:21Z","snapshot_observed_at":"2026-08-09T10:42:31.794884Z","submitted_at":"2023-09-13T15:56:50Z","title":"SafetyBench: Evaluating the Safety of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.07045","snapshot_observed_at":"2026-08-04T22:33:25.711468Z","title":"Safetybench: Evaluating the safety of large language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.07287","last_updated":"2025-09-08T23:44:00Z","snapshot_observed_at":"2026-08-09T14:00:07.903618Z","submitted_at":"2025-09-08T23:44:00Z","title":"Paladin: Defending LLM-enabled Phishing Emails with a New Trigger-Tag Paradigm","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-04T22:33:25.711468Z"},"links":{"cited_paper":"/paper/2309.07045","citing_paper":"/paper/2509.07287"},"observation_digest":"sha256:84fb1df551d8dff3165d2ec4faea72204420a1eb946db91cf2f99f0a34972c3e","observation_id":"0b4b09e4-fb46-4bf9-9358-e27503e3e903","resolution":{"observed_at":"2026-08-04T22:33:25.711468Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04249","last_updated":"2024-02-27T04:43:08Z","snapshot_observed_at":"2026-07-06T17:26:23.067923Z","submitted_at":"2024-02-06T18:59:08Z","title":"HarmBench: A Standardized Evaluation Framework for Automated Red Teaming and Robust Refusal","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.04249","snapshot_observed_at":"2026-08-04T22:33:25.804166Z","title":"Harmbench: A standardized evaluation framework for automated red teaming and robust refusal,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.07287","last_updated":"2025-09-08T23:44:00Z","snapshot_observed_at":"2026-08-09T14:00:07.903618Z","submitted_at":"2025-09-08T23:44:00Z","title":"Paladin: Defending LLM-enabled Phishing Emails with a New Trigger-Tag Paradigm","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-04T22:33:25.804166Z"},"links":{"cited_paper":"/paper/2402.04249","citing_paper":"/paper/2509.07287"},"observation_digest":"sha256:d87e836a8f33954c19f7ff89071baad9d6f33880be23c7bb59ded89636440df5","observation_id":"c8e1234e-cb88-4cd2-ac02-060bbb413531","resolution":{"observed_at":"2026-08-04T22:33:25.804166Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.18495","last_updated":"2024-12-09T20:21:56Z","snapshot_observed_at":"2026-08-06T04:32:59.039501Z","submitted_at":"2024-06-26T16:58:20Z","title":"WildGuard: Open One-Stop Moderation Tools for Safety Risks, Jailbreaks, and Refusals of LLMs","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.18495","snapshot_observed_at":"2026-08-04T22:33:25.927518Z","title":"Wildguard: Open one-stop moderation tools for safety risks, jailbreaks, and refusals of llms,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.07287","last_updated":"2025-09-08T23:44:00Z","snapshot_observed_at":"2026-08-09T14:00:07.903618Z","submitted_at":"2025-09-08T23:44:00Z","title":"Paladin: Defending LLM-enabled Phishing Emails with a New Trigger-Tag Paradigm","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-04T22:33:25.927518Z"},"links":{"cited_paper":"/paper/2406.18495","citing_paper":"/paper/2509.07287"},"observation_digest":"sha256:e057e3dfd5bf5f83ef2fe4ab1a9691b6bf059c8162423ef1f70e39a608e89e04","observation_id":"a41d9207-2dd4-4093-952c-08a63f587494","resolution":{"observed_at":"2026-08-04T22:33:25.927518Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T22:33:26.025185Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.07287","last_updated":"2025-09-08T23:44:00Z","snapshot_observed_at":"2026-08-09T14:00:07.903618Z","submitted_at":"2025-09-08T23:44:00Z","title":"Paladin: Defending LLM-enabled Phishing Emails with a New Trigger-Tag Paradigm","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-04T22:33:26.025185Z"},"links":{"citing_paper":"/paper/2509.07287"},"observation_digest":"sha256:bd85164cf07cce5f0369f0724043709a735a97532f764ac261937e07fe32e797","observation_id":"c344a3fb-96bf-4af9-a5aa-477e0c4c9fc7","resolution":{"observed_at":"2026-08-04T22:33:26.025185Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T22:33:26.197042Z","title":"Perspective api,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.07287","last_updated":"2025-09-08T23:44:00Z","snapshot_observed_at":"2026-08-09T14:00:07.903618Z","submitted_at":"2025-09-08T23:44:00Z","title":"Paladin: Defending LLM-enabled Phishing Emails with a New Trigger-Tag Paradigm","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-04T22:33:26.197042Z"},"links":{"citing_paper":"/paper/2509.07287"},"observation_digest":"sha256:450b27e4e7088efcc4162fbc1b67f317d812f817b311dcf7172a5fb757e23979","observation_id":"aeae4420-f751-4fd2-99b7-83a66e0ec50a","resolution":{"observed_at":"2026-08-04T22:33:26.197042Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T22:33:26.115994Z","title":"Available: https://docs.aws.amazon.com/bedrock/latest/ userguide/guardrails-content-filters.html","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.07287","last_updated":"2025-09-08T23:44:00Z","snapshot_observed_at":"2026-08-09T14:00:07.903618Z","submitted_at":"2025-09-08T23:44:00Z","title":"Paladin: Defending LLM-enabled Phishing Emails with a New Trigger-Tag Paradigm","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-04T22:33:26.115994Z"},"links":{"citing_paper":"/paper/2509.07287"},"observation_digest":"sha256:ecea9fb583306baf27fcb6196ad77df88c73d06e51f37f061fb149b47c885b8d","observation_id":"90095918-3766-4fc6-8de3-e1f6560d3be0","resolution":{"observed_at":"2026-08-04T22:33:26.115994Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.10408","last_updated":"2022-03-19T23:31:23Z","snapshot_observed_at":"2026-08-09T17:35:59.829681Z","submitted_at":"2022-03-19T23:31:23Z","title":"Anomaly Detection in Emails using Machine Learning and Header Information","version":1},"cited_work":{"arxiv_id":"2203.10408","doi":null,"metadata_source":"pith","pith_arxiv_id":"2203.10408","snapshot_observed_at":"2026-08-04T22:33:37.056019Z","title":"Anomaly Detection in Emails using Machine Learning and Header Information","venue":"cs.CR","work_id":"086bc0ca-5354-4881-90f9-4a43b3e65119","year":2022},"citing_paper":{"arxiv_id":"2509.07287","last_updated":"2025-09-08T23:44:00Z","snapshot_observed_at":"2026-08-09T14:00:07.903618Z","submitted_at":"2025-09-08T23:44:00Z","title":"Paladin: Defending LLM-enabled Phishing Emails with a New Trigger-Tag Paradigm","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-04T22:33:26.356111Z"},"links":{"cited_paper":"/paper/2203.10408","citing_paper":"/paper/2509.07287"},"observation_digest":"sha256:2c83bdc2fdf9db54523be5477e6cb8a09d2449bd5bceed8de9d3e992f0fde5c2","observation_id":"a7c14b25-a6cc-46ac-8a01-1f7cdc8c2260","resolution":{"observed_at":"2026-08-04T22:33:37.134524Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T22:33:26.272481Z","title":"[On- line]","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.07287","last_updated":"2025-09-08T23:44:00Z","snapshot_observed_at":"2026-08-09T14:00:07.903618Z","submitted_at":"2025-09-08T23:44:00Z","title":"Paladin: Defending LLM-enabled Phishing Emails with a New Trigger-Tag Paradigm","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-04T22:33:26.272481Z"},"links":{"citing_paper":"/paper/2509.07287"},"observation_digest":"sha256:4426f613b48b0919121ed7a156da2a4cf3a540c041326af9c837c991401b8d5c","observation_id":"79dbc862-a7c0-4b35-a4b1-1998b2f6f173","resolution":{"observed_at":"2026-08-04T22:33:26.272481Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T22:33:26.534762Z","title":"Lstm based phishing detection for big email data,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2509.07287","last_updated":"2025-09-08T23:44:00Z","snapshot_observed_at":"2026-08-09T14:00:07.903618Z","submitted_at":"2025-09-08T23:44:00Z","title":"Paladin: Defending LLM-enabled Phishing Emails with a New Trigger-Tag Paradigm","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-04T22:33:26.534762Z"},"links":{"citing_paper":"/paper/2509.07287"},"observation_digest":"sha256:af55d147a62b0c43c89c40eef1f4e2feb215a5a8e3b9c0d85bcb1b7b0fedc3ea","observation_id":"0d3726c7-a5b8-467b-b013-360983cd730c","resolution":{"observed_at":"2026-08-04T22:33:26.534762Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T22:33:26.509938Z","title":"Phishing email detection based on binary search feature selection,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2509.07287","last_updated":"2025-09-08T23:44:00Z","snapshot_observed_at":"2026-08-09T14:00:07.903618Z","submitted_at":"2025-09-08T23:44:00Z","title":"Paladin: Defending LLM-enabled Phishing Emails with a New Trigger-Tag Paradigm","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-04T22:33:26.509938Z"},"links":{"citing_paper":"/paper/2509.07287"},"observation_digest":"sha256:d7d9269b1c5dafd8e1905074c2064996add309ea67395d8190f9b34b0f445d49","observation_id":"ba24f04f-2d07-4568-88d4-d33304ef1b2f","resolution":{"observed_at":"2026-08-04T22:33:26.509938Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T22:33:26.766215Z","title":"Is GPT-3 text indistinguishable from human text? scarecrow: A framework for scrutinizing machine text,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.07287","last_updated":"2025-09-08T23:44:00Z","snapshot_observed_at":"2026-08-09T14:00:07.903618Z","submitted_at":"2025-09-08T23:44:00Z","title":"Paladin: Defending LLM-enabled Phishing Emails with a New Trigger-Tag Paradigm","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-04T22:33:26.766215Z"},"links":{"citing_paper":"/paper/2509.07287"},"observation_digest":"sha256:900f4278dec38ff2bd7c6f764b5ccd4b68dc089c97555ccbfb45df4ec7c8bb8d","observation_id":"af132b22-3378-45b2-8977-ae7665ec5ccd","resolution":{"observed_at":"2026-08-04T22:33:26.766215Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T22:33:26.665095Z","title":"TURINGBENCH: A benchmark environment for Turing test in the age of neural text generation,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2509.07287","last_updated":"2025-09-08T23:44:00Z","snapshot_observed_at":"2026-08-09T14:00:07.903618Z","submitted_at":"2025-09-08T23:44:00Z","title":"Paladin: Defending LLM-enabled Phishing Emails with a New Trigger-Tag Paradigm","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-04T22:33:26.665095Z"},"links":{"citing_paper":"/paper/2509.07287"},"observation_digest":"sha256:54fca5c203cde0f4d46f5a77367811e0372bdcc9c1b08b40de51bd84619a0300","observation_id":"fda7502f-718e-43f7-b7bd-f551a096c537","resolution":{"observed_at":"2026-08-04T22:33:26.665095Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.17650","last_updated":"2023-08-28T09:34:59Z","snapshot_observed_at":"2026-08-08T03:00:15.427395Z","submitted_at":"2023-03-30T18:28:33Z","title":"Comparing Abstractive Summaries Generated by ChatGPT to Real Summaries Through Blinded Reviewers and Text Classification Algorithms","version":3},"cited_work":{"arxiv_id":"2303.17650","doi":null,"metadata_source":"pith","pith_arxiv_id":"2303.17650","snapshot_observed_at":"2026-08-04T22:33:35.993944Z","title":"Comparing Abstractive Summaries Generated by ChatGPT to Real Summaries Through Blinded Reviewers and Text Classification Algorithms","venue":"cs.CL","work_id":"12ef5c2e-7dbf-4475-b9fb-817d063bb48f","year":2023},"citing_paper":{"arxiv_id":"2509.07287","last_updated":"2025-09-08T23:44:00Z","snapshot_observed_at":"2026-08-09T14:00:07.903618Z","submitted_at":"2025-09-08T23:44:00Z","title":"Paladin: Defending LLM-enabled Phishing Emails with a New Trigger-Tag Paradigm","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-04T22:33:26.946267Z"},"links":{"cited_paper":"/paper/2303.17650","citing_paper":"/paper/2509.07287"},"observation_digest":"sha256:6e3ba5014ef8af81bb1687d4bf035364141891ebe1ee6233907b08df35a79ca0","observation_id":"981f0b21-04bc-40a4-a142-a639d3b93ff7","resolution":{"observed_at":"2026-08-04T22:33:36.091832Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T22:33:26.821810Z","title":"All that’s ‘human’ is not gold: Evaluating human evaluation of generated text,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2509.07287","last_updated":"2025-09-08T23:44:00Z","snapshot_observed_at":"2026-08-09T14:00:07.903618Z","submitted_at":"2025-09-08T23:44:00Z","title":"Paladin: Defending LLM-enabled Phishing Emails with a New Trigger-Tag Paradigm","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-04T22:33:26.821810Z"},"links":{"citing_paper":"/paper/2509.07287"},"observation_digest":"sha256:ff04ccdb6a247866d6ea22a507da9f663cea040568c5484b8764647aadc0ac53","observation_id":"472dd163-b17d-4bf7-b623-540736c66b90","resolution":{"observed_at":"2026-08-04T22:33:26.821810Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.09067","last_updated":"2024-09-02T07:26:46Z","snapshot_observed_at":"2026-07-06T16:07:21.951225Z","submitted_at":"2023-08-17T15:54:38Z","title":"Contrasting Linguistic Patterns in Human and LLM-Generated News Text","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.09067","snapshot_observed_at":"2026-08-04T22:33:27.034220Z","title":"Contrasting linguistic patterns in human and llm-generated text,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.07287","last_updated":"2025-09-08T23:44:00Z","snapshot_observed_at":"2026-08-09T14:00:07.903618Z","submitted_at":"2025-09-08T23:44:00Z","title":"Paladin: Defending LLM-enabled Phishing Emails with a New Trigger-Tag Paradigm","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-04T22:33:27.034220Z"},"links":{"cited_paper":"/paper/2308.09067","citing_paper":"/paper/2509.07287"},"observation_digest":"sha256:a8ce4c95f6f37f8032197d76879a80aa63d00aafcbceef1850ffc88a8ab77566","observation_id":"03d01cc5-8e27-4ef3-8db3-e9bb8b5f09ce","resolution":{"observed_at":"2026-08-04T22:33:27.034220Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T22:33:27.187441Z","title":"”i slept like a baby","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.07287","last_updated":"2025-09-08T23:44:00Z","snapshot_observed_at":"2026-08-09T14:00:07.903618Z","submitted_at":"2025-09-08T23:44:00Z","title":"Paladin: Defending LLM-enabled Phishing Emails with a New Trigger-Tag Paradigm","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-04T22:33:27.187441Z"},"links":{"citing_paper":"/paper/2509.07287"},"observation_digest":"sha256:03fe0f0ca1eb878365e2072021434378cc6bdbdfaf56112f3213be64a32bd49a","observation_id":"ba7caa4e-cc98-4ce2-9967-fcacfeb1830e","resolution":{"observed_at":"2026-08-04T22:33:27.187441Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2301.10416","last_updated":"2023-02-12T11:58:22Z","snapshot_observed_at":"2026-08-03T04:50:16.959490Z","submitted_at":"2023-01-24T04:23:20Z","title":"AI vs. Human -- Differentiation Analysis of Scientific Content Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.10416","snapshot_observed_at":"2026-08-04T22:33:26.987526Z","title":"Is this abstract generated by ai? a research for the gap between ai-generated scientific text and human-written scientific text,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.07287","last_updated":"2025-09-08T23:44:00Z","snapshot_observed_at":"2026-08-09T14:00:07.903618Z","submitted_at":"2025-09-08T23:44:00Z","title":"Paladin: Defending LLM-enabled Phishing Emails with a New Trigger-Tag Paradigm","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-04T22:33:26.987526Z"},"links":{"cited_paper":"/paper/2301.10416","citing_paper":"/paper/2509.07287"},"observation_digest":"sha256:5f7aa1adf08ad2bf3d38b4b7d60d81d49399ab8afbac1680309e74a234c0291f","observation_id":"955f9f4a-1edd-4698-9fbf-dc638abc4644","resolution":{"observed_at":"2026-08-04T22:33:26.987526Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.16746","last_updated":"2023-10-25T16:23:17Z","snapshot_observed_at":"2026-08-11T01:12:54.158908Z","submitted_at":"2023-10-25T16:23:17Z","title":"HANSEN: Human and AI Spoken Text Benchmark for Authorship Analysis","version":1},"cited_work":{"arxiv_id":"2310.16746","doi":"10.48550/arxiv.2310.16746","metadata_source":"pith","pith_arxiv_id":"2310.16746","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"HANSEN: Human and AI Spoken Text Benchmark for Authorship Analysis","venue":"cs.CL","work_id":"71ffa7ee-2dd4-420f-a7a3-6d84a1c44c1f","year":2023},"citing_paper":{"arxiv_id":"2509.07287","last_updated":"2025-09-08T23:44:00Z","snapshot_observed_at":"2026-08-09T14:00:07.903618Z","submitted_at":"2025-09-08T23:44:00Z","title":"Paladin: Defending LLM-enabled Phishing Emails with a New Trigger-Tag Paradigm","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-04T22:33:27.393131Z"},"links":{"cited_paper":"/paper/2310.16746","citing_paper":"/paper/2509.07287"},"observation_digest":"sha256:7f5e60de6eed52702c4fbf77a7ed84a01fd3e4d02b4857f7d80b57f2ec1b2ac8","observation_id":"e6c2451f-eb09-4971-a651-4e1527d194e5","resolution":{"observed_at":"2026-08-04T22:33:34.496855Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T22:33:27.489483Z","title":"A survey of text watermarking in the era of large language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.07287","last_updated":"2025-09-08T23:44:00Z","snapshot_observed_at":"2026-08-09T14:00:07.903618Z","submitted_at":"2025-09-08T23:44:00Z","title":"Paladin: Defending LLM-enabled Phishing Emails with a New Trigger-Tag Paradigm","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-04T22:33:27.489483Z"},"links":{"citing_paper":"/paper/2509.07287"},"observation_digest":"sha256:35d0753f9ebf7e10d7eaad688ab14399092c51ffd4c1836e52765b7165373190","observation_id":"af1c5be4-918f-472d-971a-57df300c3523","resolution":{"observed_at":"2026-08-04T22:33:27.489483Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.04537","last_updated":"2023-06-07T15:42:31Z","snapshot_observed_at":"2026-08-06T03:25:11.061375Z","submitted_at":"2023-06-07T15:42:31Z","title":"Long-form analogies generated by chatGPT lack human-like psycholinguistic properties","version":1},"cited_work":{"arxiv_id":"2306.04537","doi":"10.48550/arxiv.2306.04537","metadata_source":"pith","pith_arxiv_id":"2306.04537","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"Long-form analogies generated by chatGPT lack human-like psycholinguistic properties","venue":"cs.CL","work_id":"e81125bd-2f19-48ba-9b9b-0291f307c954","year":2023},"citing_paper":{"arxiv_id":"2509.07287","last_updated":"2025-09-08T23:44:00Z","snapshot_observed_at":"2026-08-09T14:00:07.903618Z","submitted_at":"2025-09-08T23:44:00Z","title":"Paladin: Defending LLM-enabled Phishing Emails with a New Trigger-Tag Paradigm","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-04T22:33:27.308256Z"},"links":{"cited_paper":"/paper/2306.04537","citing_paper":"/paper/2509.07287"},"observation_digest":"sha256:d10acb7ecff745267b2289c9129b54cbe4aa26b563b9927a5ac594ebe82f9f47","observation_id":"9c6e517f-1c15-47f8-bed8-8be4c148fac4","resolution":{"observed_at":"2026-08-04T22:33:34.662925Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.04634","last_updated":"2024-05-01T21:20:36Z","snapshot_observed_at":"2026-08-06T08:42:48.510710Z","submitted_at":"2023-06-07T17:58:48Z","title":"On the Reliability of Watermarks for Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.04634","snapshot_observed_at":"2026-08-04T22:33:27.809805Z","title":"On the reliability of watermarks for large language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.07287","last_updated":"2025-09-08T23:44:00Z","snapshot_observed_at":"2026-08-09T14:00:07.903618Z","submitted_at":"2025-09-08T23:44:00Z","title":"Paladin: Defending LLM-enabled Phishing Emails with a New Trigger-Tag Paradigm","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-04T22:33:27.809805Z"},"links":{"cited_paper":"/paper/2306.04634","citing_paper":"/paper/2509.07287"},"observation_digest":"sha256:983ca6cfebb7f49a6540df9f329e9db90f3badc52df90f0e5828d6612e0b85f0","observation_id":"08d5ddb0-6973-4152-b9d8-8f8924168e9d","resolution":{"observed_at":"2026-08-04T22:33:27.809805Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T22:33:27.595323Z","title":"Provable robust water- marking for ai-generated text,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.07287","last_updated":"2025-09-08T23:44:00Z","snapshot_observed_at":"2026-08-09T14:00:07.903618Z","submitted_at":"2025-09-08T23:44:00Z","title":"Paladin: Defending LLM-enabled Phishing Emails with a New Trigger-Tag Paradigm","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-04T22:33:27.595323Z"},"links":{"citing_paper":"/paper/2509.07287"},"observation_digest":"sha256:b83f2fbab3667a6d260578df43fdebdf69fa5e6d98b378e9d4a1bc1770a9c631","observation_id":"3cb62e3a-dbaa-4da0-8947-64cde59ae48e","resolution":{"observed_at":"2026-08-04T22:33:27.595323Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.13860","last_updated":"2024-03-10T13:58:08Z","snapshot_observed_at":"2026-07-06T15:31:18.144952Z","submitted_at":"2023-05-23T09:33:38Z","title":"Jailbreaking ChatGPT via Prompt Engineering: An Empirical Study","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.13860","snapshot_observed_at":"2026-08-04T22:33:28.016605Z","title":"Jailbreaking chatgpt via prompt engineering: An empirical study,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.07287","last_updated":"2025-09-08T23:44:00Z","snapshot_observed_at":"2026-08-09T14:00:07.903618Z","submitted_at":"2025-09-08T23:44:00Z","title":"Paladin: Defending LLM-enabled Phishing Emails with a New Trigger-Tag Paradigm","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-04T22:33:28.016605Z"},"links":{"cited_paper":"/paper/2305.13860","citing_paper":"/paper/2509.07287"},"observation_digest":"sha256:ebc69fbb71ea2c9664cd050e7bdbd4c451eb6a5af5febead41afb9f2aeb54112","observation_id":"bd792d46-03bc-4d6f-9d78-587fdb3a2593","resolution":{"observed_at":"2026-08-04T22:33:28.016605Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.04451","last_updated":"2024-03-20T21:34:56Z","snapshot_observed_at":"2026-08-06T02:57:30.438059Z","submitted_at":"2023-10-03T19:44:37Z","title":"AutoDAN: Generating Stealthy Jailbreak Prompts on Aligned Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.04451","snapshot_observed_at":"2026-08-04T22:33:28.067556Z","title":"Autodan: Generating stealthy jailbreak prompts on aligned large language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.07287","last_updated":"2025-09-08T23:44:00Z","snapshot_observed_at":"2026-08-09T14:00:07.903618Z","submitted_at":"2025-09-08T23:44:00Z","title":"Paladin: Defending LLM-enabled Phishing Emails with a New Trigger-Tag Paradigm","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-04T22:33:28.067556Z"},"links":{"cited_paper":"/paper/2310.04451","citing_paper":"/paper/2509.07287"},"observation_digest":"sha256:ec7250f9658d4178e28259d131eb9f0dc60f5569651cc6d9dd87d4c70199f1cf","observation_id":"cda4378f-4538-4ad6-b4a7-788c676bbb54","resolution":{"observed_at":"2026-08-04T22:33:28.067556Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.09573","last_updated":"2023-10-14T12:51:38Z","snapshot_observed_at":"2026-07-06T16:33:04.032904Z","submitted_at":"2023-10-14T12:51:38Z","title":"Self-Detoxifying Language Models via Toxification Reversal","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.09573","snapshot_observed_at":"2026-08-04T22:33:27.930122Z","title":"Self-detoxifying language models via toxification reversal,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.07287","last_updated":"2025-09-08T23:44:00Z","snapshot_observed_at":"2026-08-09T14:00:07.903618Z","submitted_at":"2025-09-08T23:44:00Z","title":"Paladin: Defending LLM-enabled Phishing Emails with a New Trigger-Tag Paradigm","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-04T22:33:27.930122Z"},"links":{"cited_paper":"/paper/2310.09573","citing_paper":"/paper/2509.07287"},"observation_digest":"sha256:65261a94e54864af39d2206fbbf124d8fd1cdfb242dfa7b33a45ba664d5c11eb","observation_id":"f07ecc83-88fe-4285-a2b4-8327c96e856e","resolution":{"observed_at":"2026-08-04T22:33:27.930122Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T22:33:28.219467Z","title":"Malla: Demystifying real-world large language model integrated malicious services,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.07287","last_updated":"2025-09-08T23:44:00Z","snapshot_observed_at":"2026-08-09T14:00:07.903618Z","submitted_at":"2025-09-08T23:44:00Z","title":"Paladin: Defending LLM-enabled Phishing Emails with a New Trigger-Tag Paradigm","version":1},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-04T22:33:28.219467Z"},"links":{"citing_paper":"/paper/2509.07287"},"observation_digest":"sha256:cb6d15efda14e72ac0103a1205aac25ae173e6e201db168a1e85be25b472cd51","observation_id":"28cf27d1-4120-4720-84da-472929341ec8","resolution":{"observed_at":"2026-08-04T22:33:28.219467Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T22:33:28.283775Z","title":"Codegpt — hack forums,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.07287","last_updated":"2025-09-08T23:44:00Z","snapshot_observed_at":"2026-08-09T14:00:07.903618Z","submitted_at":"2025-09-08T23:44:00Z","title":"Paladin: Defending LLM-enabled Phishing Emails with a New Trigger-Tag Paradigm","version":1},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-04T22:33:28.283775Z"},"links":{"citing_paper":"/paper/2509.07287"},"observation_digest":"sha256:66b035e25cbc45fdb536c7bb6f7c7ccaea7d067302b3f56d5bfa7f678110af13","observation_id":"baf6d73c-7253-4bfe-950d-0ea811d19933","resolution":{"observed_at":"2026-08-04T22:33:28.283775Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13457","last_updated":"2024-05-17T05:00:24Z","snapshot_observed_at":"2026-08-11T04:52:50.241599Z","submitted_at":"2024-02-21T01:26:39Z","title":"A Comprehensive Study of Jailbreak Attack versus Defense for Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.13457","snapshot_observed_at":"2026-08-04T22:33:28.168620Z","title":"A comprehensive study of jailbreak attack versus defense for large language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.07287","last_updated":"2025-09-08T23:44:00Z","snapshot_observed_at":"2026-08-09T14:00:07.903618Z","submitted_at":"2025-09-08T23:44:00Z","title":"Paladin: Defending LLM-enabled Phishing Emails with a New Trigger-Tag Paradigm","version":1},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-04T22:33:28.168620Z"},"links":{"cited_paper":"/paper/2402.13457","citing_paper":"/paper/2509.07287"},"observation_digest":"sha256:bc2838a2457e9468d9e8ff064a250460eaf441a3974eeeadabe402951acd6b3e","observation_id":"aa9e6cc6-b697-400f-9c2e-fd2873f19520","resolution":{"observed_at":"2026-08-04T22:33:28.168620Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T22:33:28.374298Z","title":"Makergpt bypass — hack forums,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.07287","last_updated":"2025-09-08T23:44:00Z","snapshot_observed_at":"2026-08-09T14:00:07.903618Z","submitted_at":"2025-09-08T23:44:00Z","title":"Paladin: Defending LLM-enabled Phishing Emails with a New Trigger-Tag Paradigm","version":1},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-04T22:33:28.374298Z"},"links":{"citing_paper":"/paper/2509.07287"},"observation_digest":"sha256:e3e573cfa99451f9ced4e274ad50191674c09399d2a9e839a51594223614d605","observation_id":"c04c6917-c58c-49b7-957a-12f2c8a6b562","resolution":{"observed_at":"2026-08-04T22:33:28.374298Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.15043","last_updated":"2023-12-20T20:48:57Z","snapshot_observed_at":"2026-07-06T15:59:23.019044Z","submitted_at":"2023-07-27T17:49:12Z","title":"Universal and Transferable Adversarial Attacks on Aligned Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.15043","snapshot_observed_at":"2026-08-04T22:33:28.407464Z","title":"Universal and transferable adversarial attacks on aligned language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.07287","last_updated":"2025-09-08T23:44:00Z","snapshot_observed_at":"2026-08-09T14:00:07.903618Z","submitted_at":"2025-09-08T23:44:00Z","title":"Paladin: Defending LLM-enabled Phishing Emails with a New Trigger-Tag Paradigm","version":1},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-08-04T22:33:28.407464Z"},"links":{"cited_paper":"/paper/2307.15043","citing_paper":"/paper/2509.07287"},"observation_digest":"sha256:18ce9477008827e82ead5b5798eecf22c8a0aac6f26f9a99c3782e1409e2d5ee","observation_id":"be95d8e5-5356-4e39-9190-e1ea5914dfab","resolution":{"observed_at":"2026-08-04T22:33:28.407464Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T22:33:28.342839Z","title":"Poe - xxxgptdemo,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.07287","last_updated":"2025-09-08T23:44:00Z","snapshot_observed_at":"2026-08-09T14:00:07.903618Z","submitted_at":"2025-09-08T23:44:00Z","title":"Paladin: Defending LLM-enabled Phishing Emails with a New Trigger-Tag Paradigm","version":1},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-08-04T22:33:28.342839Z"},"links":{"citing_paper":"/paper/2509.07287"},"observation_digest":"sha256:022332a3bd3bbe9792427c8ca4716ae64862d778b1dc6e54ae84de751942be2d","observation_id":"d6b4e85b-d648-4454-902d-76931ec5f988","resolution":{"observed_at":"2026-08-04T22:33:28.342839Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T22:33:28.528779Z","title":"Wormgpt: The generative AI tool cybercriminals are using to launch business email compromise attacks,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.07287","last_updated":"2025-09-08T23:44:00Z","snapshot_observed_at":"2026-08-09T14:00:07.903618Z","submitted_at":"2025-09-08T23:44:00Z","title":"Paladin: Defending LLM-enabled Phishing Emails with a New Trigger-Tag Paradigm","version":1},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-08-04T22:33:28.528779Z"},"links":{"citing_paper":"/paper/2509.07287"},"observation_digest":"sha256:c362abd341d3f7e3cafe8683aa97e889f5832138ca443b34b03905399e29d3c2","observation_id":"75e8e9fd-dd87-4e59-b748-8df5bdb4c5fb","resolution":{"observed_at":"2026-08-04T22:33:28.528779Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T22:33:28.633232Z","title":"Freedomgpt,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.07287","last_updated":"2025-09-08T23:44:00Z","snapshot_observed_at":"2026-08-09T14:00:07.903618Z","submitted_at":"2025-09-08T23:44:00Z","title":"Paladin: Defending LLM-enabled Phishing Emails with a New Trigger-Tag Paradigm","version":1},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-08-04T22:33:28.633232Z"},"links":{"citing_paper":"/paper/2509.07287"},"observation_digest":"sha256:49cfaee580b017d23075a4a5f15817e37862dd339521a37e102fe5d7f082ae03","observation_id":"73b3757d-1bd5-433d-b322-8177194c1f72","resolution":{"observed_at":"2026-08-04T22:33:28.633232Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.09127","last_updated":"2024-01-20T18:55:51Z","snapshot_observed_at":"2026-08-09T01:09:44.001852Z","submitted_at":"2023-11-15T17:17:39Z","title":"Jailbreaking GPT-4V via Self-Adversarial Attacks with System Prompts","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.09127","snapshot_observed_at":"2026-08-04T22:33:28.465066Z","title":"Jailbreaking gpt- 4v via self-adversarial attacks with system prompts,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.07287","last_updated":"2025-09-08T23:44:00Z","snapshot_observed_at":"2026-08-09T14:00:07.903618Z","submitted_at":"2025-09-08T23:44:00Z","title":"Paladin: Defending LLM-enabled Phishing Emails with a New Trigger-Tag Paradigm","version":1},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-08-04T22:33:28.465066Z"},"links":{"cited_paper":"/paper/2311.09127","citing_paper":"/paper/2509.07287"},"observation_digest":"sha256:07ab878622a342f43cdfaadf3dc1f26eb9243d57f1bcdb1e8a44964fb89e0597","observation_id":"e323b017-b385-4b24-8a80-3a5e94c14d1a","resolution":{"observed_at":"2026-08-04T22:33:28.465066Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.02949","last_updated":"2023-10-04T16:39:31Z","snapshot_observed_at":"2026-08-07T11:20:01.991656Z","submitted_at":"2023-10-04T16:39:31Z","title":"Shadow Alignment: The Ease of Subverting Safely-Aligned Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.02949","snapshot_observed_at":"2026-08-04T22:33:28.772074Z","title":"Shadow alignment: The ease of subverting safely-aligned language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.07287","last_updated":"2025-09-08T23:44:00Z","snapshot_observed_at":"2026-08-09T14:00:07.903618Z","submitted_at":"2025-09-08T23:44:00Z","title":"Paladin: Defending LLM-enabled Phishing Emails with a New Trigger-Tag Paradigm","version":1},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-08-04T22:33:28.772074Z"},"links":{"cited_paper":"/paper/2310.02949","citing_paper":"/paper/2509.07287"},"observation_digest":"sha256:a07e60de09e4b850a6e519429c913806d8320f2413a095a3d4beaf74c32c81f4","observation_id":"a9274f2a-95f3-4387-aa55-e4ea777a042f","resolution":{"observed_at":"2026-08-04T22:33:28.772074Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T22:33:28.568176Z","title":"Available: https://slashnext.com/blog/ wormgpt-the-generative-ai-tool-cybercriminals-are-using-to-launch-business-email-compromise-attacks/","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.07287","last_updated":"2025-09-08T23:44:00Z","snapshot_observed_at":"2026-08-09T14:00:07.903618Z","submitted_at":"2025-09-08T23:44:00Z","title":"Paladin: Defending LLM-enabled Phishing Emails with a New Trigger-Tag Paradigm","version":1},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-08-04T22:33:28.568176Z"},"links":{"citing_paper":"/paper/2509.07287"},"observation_digest":"sha256:86b6405b66f2d59640f7aeb589bfb8d78990702659a198e4d0152d8a58ab5792","observation_id":"8d90fffc-ee5a-4a6e-a3bf-38411de6cfff","resolution":{"observed_at":"2026-08-04T22:33:28.568176Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.20624","last_updated":"2024-05-22T08:39:46Z","snapshot_observed_at":"2026-08-02T03:56:52.247351Z","submitted_at":"2023-10-31T16:55:06Z","title":"LoRA Fine-tuning Efficiently Undoes Safety Training in Llama 2-Chat 70B","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.20624","snapshot_observed_at":"2026-08-04T22:33:28.907738Z","title":"Lora fine-tuning effi- ciently undoes safety training in llama 2-chat 70b,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.07287","last_updated":"2025-09-08T23:44:00Z","snapshot_observed_at":"2026-08-09T14:00:07.903618Z","submitted_at":"2025-09-08T23:44:00Z","title":"Paladin: Defending LLM-enabled Phishing Emails with a New Trigger-Tag Paradigm","version":1},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-08-04T22:33:28.907738Z"},"links":{"cited_paper":"/paper/2310.20624","citing_paper":"/paper/2509.07287"},"observation_digest":"sha256:b7ad3afc97d4d1ff1245b56eb7236267286153261d9d74fbdc9a74f2c1994d45","observation_id":"3407591e-bc9f-4f12-bf67-eb608e0b06f3","resolution":{"observed_at":"2026-08-04T22:33:28.907738Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T22:33:28.679711Z","title":"Fine-tuning aligned language models compromises safety, even when users do not intend to!","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.07287","last_updated":"2025-09-08T23:44:00Z","snapshot_observed_at":"2026-08-09T14:00:07.903618Z","submitted_at":"2025-09-08T23:44:00Z","title":"Paladin: Defending LLM-enabled Phishing Emails with a New Trigger-Tag Paradigm","version":1},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-08-04T22:33:28.679711Z"},"links":{"citing_paper":"/paper/2509.07287"},"observation_digest":"sha256:d578f77727950c28df672fc6aa54c839894bf4356900c6bcf64e5242c0e0dd88","observation_id":"efc8f134-be89-4d1e-b695-edf8b5286b0b","resolution":{"observed_at":"2026-08-04T22:33:28.679711Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.04469","last_updated":"2024-05-02T07:05:56Z","snapshot_observed_at":"2026-08-10T22:34:11.407815Z","submitted_at":"2023-12-07T17:41:44Z","title":"On the Learnability of Watermarks for Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.04469","snapshot_observed_at":"2026-08-04T22:33:29.069029Z","title":"On the learnability of watermarks for language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.07287","last_updated":"2025-09-08T23:44:00Z","snapshot_observed_at":"2026-08-09T14:00:07.903618Z","submitted_at":"2025-09-08T23:44:00Z","title":"Paladin: Defending LLM-enabled Phishing Emails with a New Trigger-Tag Paradigm","version":1},"reference_index":88,"source":"pdf_text","source_observed_at":"2026-08-04T22:33:29.069029Z"},"links":{"cited_paper":"/paper/2312.04469","citing_paper":"/paper/2509.07287"},"observation_digest":"sha256:01adc6d0f3007f8e96b399e0804db25e006c166fa1208f802b8f29d3ecde0bfb","observation_id":"217e392e-519d-4fa6-a610-bd68c064147a","resolution":{"observed_at":"2026-08-04T22:33:29.069029Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.05553","last_updated":"2024-04-05T23:30:56Z","snapshot_observed_at":"2026-08-07T23:30:34.877117Z","submitted_at":"2023-11-09T17:54:59Z","title":"Removing RLHF Protections in GPT-4 via Fine-Tuning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.05553","snapshot_observed_at":"2026-08-04T22:33:28.837716Z","title":"Removing rlhf protections in gpt-4 via fine-tuning,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.07287","last_updated":"2025-09-08T23:44:00Z","snapshot_observed_at":"2026-08-09T14:00:07.903618Z","submitted_at":"2025-09-08T23:44:00Z","title":"Paladin: Defending LLM-enabled Phishing Emails with a New Trigger-Tag Paradigm","version":1},"reference_index":89,"source":"pdf_text","source_observed_at":"2026-08-04T22:33:28.837716Z"},"links":{"cited_paper":"/paper/2311.05553","citing_paper":"/paper/2509.07287"},"observation_digest":"sha256:8e7501ef3e57012977a4955039fca551687b9d0d53ac5554c33332c74d5f7aeb","observation_id":"d4d2b640-0807-482c-98e5-f9235fcac7af","resolution":{"observed_at":"2026-08-04T22:33:28.837716Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.05596","last_updated":"2023-08-10T14:14:13Z","snapshot_observed_at":"2026-07-06T16:04:50.826084Z","submitted_at":"2023-08-10T14:14:13Z","title":"You Only Prompt Once: On the Capabilities of Prompt Learning on Large Language Models to Tackle Toxic Content","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.05596","snapshot_observed_at":"2026-08-04T22:33:29.348937Z","title":"You only prompt once: On the capabilities of prompt learning on large language models to tackle toxic content,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.07287","last_updated":"2025-09-08T23:44:00Z","snapshot_observed_at":"2026-08-09T14:00:07.903618Z","submitted_at":"2025-09-08T23:44:00Z","title":"Paladin: Defending LLM-enabled Phishing Emails with a New Trigger-Tag Paradigm","version":1},"reference_index":90,"source":"pdf_text","source_observed_at":"2026-08-04T22:33:29.348937Z"},"links":{"cited_paper":"/paper/2308.05596","citing_paper":"/paper/2509.07287"},"observation_digest":"sha256:846191c2f378463b5f52bd367c886294a34cbcc77556f6336581fd138261f234","observation_id":"32a79ec0-abaf-42c6-9f28-3933e6e6b558","resolution":{"observed_at":"2026-08-04T22:33:29.348937Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T22:33:28.996440Z","title":"On the vulnerability of safety alignment in open-access llms,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.07287","last_updated":"2025-09-08T23:44:00Z","snapshot_observed_at":"2026-08-09T14:00:07.903618Z","submitted_at":"2025-09-08T23:44:00Z","title":"Paladin: Defending LLM-enabled Phishing Emails with a New Trigger-Tag Paradigm","version":1},"reference_index":91,"source":"pdf_text","source_observed_at":"2026-08-04T22:33:28.996440Z"},"links":{"citing_paper":"/paper/2509.07287"},"observation_digest":"sha256:299886eaa42b5d5b5d2ed4e05293067b8ebf26f763770d69d012e7c7986f76b2","observation_id":"1d7f0d17-62bb-4d4f-9492-f15293579cfb","resolution":{"observed_at":"2026-08-04T22:33:28.996440Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.08721","last_updated":"2024-04-01T17:44:19Z","snapshot_observed_at":"2026-07-06T16:47:45.504109Z","submitted_at":"2023-11-15T06:19:02Z","title":"A Robust Semantics-based Watermark for Large Language Model against Paraphrasing","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.08721","snapshot_observed_at":"2026-08-04T22:33:29.549381Z","title":"A robust semantics-based watermark for large language model against paraphrasing,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.07287","last_updated":"2025-09-08T23:44:00Z","snapshot_observed_at":"2026-08-09T14:00:07.903618Z","submitted_at":"2025-09-08T23:44:00Z","title":"Paladin: Defending LLM-enabled Phishing Emails with a New Trigger-Tag Paradigm","version":1},"reference_index":92,"source":"pdf_text","source_observed_at":"2026-08-04T22:33:29.549381Z"},"links":{"cited_paper":"/paper/2311.08721","citing_paper":"/paper/2509.07287"},"observation_digest":"sha256:8afeb9db72eec700d09c8b44d7242cc7af45038ddb2224980382d5b1a4b32546","observation_id":"65d75607-03b8-452b-97aa-37b2464ef6b1","resolution":{"observed_at":"2026-08-04T22:33:29.549381Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.24191","last_updated":"2026-08-10T03:46:44Z","snapshot_observed_at":"2026-08-11T06:20:17.277608Z","submitted_at":"2025-03-31T15:08:06Z","title":"When Grammar Guides the Attack: Uncovering Control-Plane Vulnerabilities in LLMs with Structured Output","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.24191","snapshot_observed_at":"2026-08-04T22:33:29.208444Z","title":"Output constraints as attack surface: Exploiting structured generation to bypass llm safety mechanisms,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.07287","last_updated":"2025-09-08T23:44:00Z","snapshot_observed_at":"2026-08-09T14:00:07.903618Z","submitted_at":"2025-09-08T23:44:00Z","title":"Paladin: Defending LLM-enabled Phishing Emails with a New Trigger-Tag Paradigm","version":1},"reference_index":93,"source":"pdf_text","source_observed_at":"2026-08-04T22:33:29.208444Z"},"links":{"cited_paper":"/paper/2503.24191","citing_paper":"/paper/2509.07287"},"observation_digest":"sha256:6f48f54f85d9f593c54dfe39d53323af374bf9fb755e38fef1483ff2b98e386c","observation_id":"1e6fb2af-930f-4930-9506-d4269c09490c","resolution":{"observed_at":"2026-08-04T22:33:29.208444Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.17439","last_updated":"2023-10-13T04:50:04Z","snapshot_observed_at":"2026-08-07T18:16:43.461993Z","submitted_at":"2023-06-30T07:24:32Z","title":"Provable Robust Watermarking for AI-Generated Text","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.17439","snapshot_observed_at":"2026-08-04T22:33:29.749779Z","title":"Provable robust watermarking for ai-generated text,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.07287","last_updated":"2025-09-08T23:44:00Z","snapshot_observed_at":"2026-08-09T14:00:07.903618Z","submitted_at":"2025-09-08T23:44:00Z","title":"Paladin: Defending LLM-enabled Phishing Emails with a New Trigger-Tag Paradigm","version":1},"reference_index":94,"source":"pdf_text","source_observed_at":"2026-08-04T22:33:29.749779Z"},"links":{"cited_paper":"/paper/2306.17439","citing_paper":"/paper/2509.07287"},"observation_digest":"sha256:13d87b5743100f74c5f398b467e6633406c2ceb887652e6ada65da860b4758d0","observation_id":"a60cd507-be22-412b-833a-5cec4a314f91","resolution":{"observed_at":"2026-08-04T22:33:29.749779Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T22:33:29.443314Z","title":"An unforgeable publicly verifiable watermark for large language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.07287","last_updated":"2025-09-08T23:44:00Z","snapshot_observed_at":"2026-08-09T14:00:07.903618Z","submitted_at":"2025-09-08T23:44:00Z","title":"Paladin: Defending LLM-enabled Phishing Emails with a New Trigger-Tag Paradigm","version":1},"reference_index":95,"source":"pdf_text","source_observed_at":"2026-08-04T22:33:29.443314Z"},"links":{"citing_paper":"/paper/2509.07287"},"observation_digest":"sha256:f02b24ab14b0dcc89ac0ed8fe389c20309fca6855ea2ed7b415de63595b14ed3","observation_id":"63f299ab-f01b-4a2e-858d-289456ef2c8d","resolution":{"observed_at":"2026-08-04T22:33:29.443314Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.14710","last_updated":"2024-04-03T09:15:15Z","snapshot_observed_at":"2026-08-06T20:08:37.704569Z","submitted_at":"2023-05-24T04:27:21Z","title":"Instructions as Backdoors: Backdoor Vulnerabilities of Instruction Tuning for Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.14710","snapshot_observed_at":"2026-08-04T22:33:29.981637Z","title":"Instructions as backdoors: Backdoor vulnerabilities of instruction tuning for large language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.07287","last_updated":"2025-09-08T23:44:00Z","snapshot_observed_at":"2026-08-09T14:00:07.903618Z","submitted_at":"2025-09-08T23:44:00Z","title":"Paladin: Defending LLM-enabled Phishing Emails with a New Trigger-Tag Paradigm","version":1},"reference_index":96,"source":"pdf_text","source_observed_at":"2026-08-04T22:33:29.981637Z"},"links":{"cited_paper":"/paper/2305.14710","citing_paper":"/paper/2509.07287"},"observation_digest":"sha256:c5c2f83ff812efd861b12b994efc634570af1f9a044d326813212521667f6a41","observation_id":"29ecab4a-5913-4ebc-88bb-f45e8f6a09e9","resolution":{"observed_at":"2026-08-04T22:33:29.981637Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T22:33:29.624205Z","title":"Dipmark: A stealthy, efficient and resilient watermark for large language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.07287","last_updated":"2025-09-08T23:44:00Z","snapshot_observed_at":"2026-08-09T14:00:07.903618Z","submitted_at":"2025-09-08T23:44:00Z","title":"Paladin: Defending LLM-enabled Phishing Emails with a New Trigger-Tag Paradigm","version":1},"reference_index":97,"source":"pdf_text","source_observed_at":"2026-08-04T22:33:29.624205Z"},"links":{"citing_paper":"/paper/2509.07287"},"observation_digest":"sha256:c809c9851c3b20f4d14a47891ae337c3270bf70e7499dc526fbd4c45f1b5b465","observation_id":"0562bff8-0af6-4da6-9034-f3a52cc3164d","resolution":{"observed_at":"2026-08-04T22:33:29.624205Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.17946","last_updated":"2025-07-09T03:32:17Z","snapshot_observed_at":"2026-07-06T19:22:50.028253Z","submitted_at":"2024-09-26T15:20:37Z","title":"Breaking PEFT Limitations: Leveraging Weak-to-Strong Knowledge Transfer for Backdoor Attacks in LLMs","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.17946","snapshot_observed_at":"2026-08-04T22:33:30.242883Z","title":"Weak-to-strong backdoor attack for large language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.07287","last_updated":"2025-09-08T23:44:00Z","snapshot_observed_at":"2026-08-09T14:00:07.903618Z","submitted_at":"2025-09-08T23:44:00Z","title":"Paladin: Defending LLM-enabled Phishing Emails with a New Trigger-Tag Paradigm","version":1},"reference_index":98,"source":"pdf_text","source_observed_at":"2026-08-04T22:33:30.242883Z"},"links":{"cited_paper":"/paper/2409.17946","citing_paper":"/paper/2509.07287"},"observation_digest":"sha256:f99eb195fd573191eb75ad18f244908bf68c7c8455076da702238bcea2b5fa86","observation_id":"c3ec2ea2-6057-4bb7-9d8a-54ac97c50fa0","resolution":{"observed_at":"2026-08-04T22:33:30.242883Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T22:33:29.902496Z","title":"Backdoor attacks on pre-trained models by layerwise weight poisoning,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2509.07287","last_updated":"2025-09-08T23:44:00Z","snapshot_observed_at":"2026-08-09T14:00:07.903618Z","submitted_at":"2025-09-08T23:44:00Z","title":"Paladin: Defending LLM-enabled Phishing Emails with a New Trigger-Tag Paradigm","version":1},"reference_index":99,"source":"pdf_text","source_observed_at":"2026-08-04T22:33:29.902496Z"},"links":{"citing_paper":"/paper/2509.07287"},"observation_digest":"sha256:1ba2f2ff8e03776681e576acb565f6f8c02c0e4b71e5b5163b349d69c704884d","observation_id":"241c6506-3f2d-40a5-9e99-d00efe2fcd3d","resolution":{"observed_at":"2026-08-04T22:33:29.902496Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.00923","last_updated":"2024-05-20T06:43:48Z","snapshot_observed_at":"2026-08-11T00:52:12.225793Z","submitted_at":"2023-02-02T07:51:19Z","title":"Multimodal Chain-of-Thought Reasoning in Language Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.00923","snapshot_observed_at":"2026-08-04T22:33:30.357545Z","title":"Multimodal chain-of-thought reasoning in language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.07287","last_updated":"2025-09-08T23:44:00Z","snapshot_observed_at":"2026-08-09T14:00:07.903618Z","submitted_at":"2025-09-08T23:44:00Z","title":"Paladin: Defending LLM-enabled Phishing Emails with a New Trigger-Tag Paradigm","version":1},"reference_index":100,"source":"pdf_text","source_observed_at":"2026-08-04T22:33:30.357545Z"},"links":{"cited_paper":"/paper/2302.00923","citing_paper":"/paper/2509.07287"},"observation_digest":"sha256:ff1fed3eb801abc6afb1890f16ab4fa6a247f7fdccf7244296f274d9e53543b6","observation_id":"fd290b6e-04a7-40ac-837a-f2d139744a8c","resolution":{"observed_at":"2026-08-04T22:33:30.357545Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.14325","last_updated":"2023-03-25T01:41:54Z","snapshot_observed_at":"2026-07-06T15:07:49.009949Z","submitted_at":"2023-03-25T01:41:54Z","title":"Backdoor Attacks with Input-unique Triggers in NLP","version":1},"cited_work":{"arxiv_id":"2303.14325","doi":null,"metadata_source":"pith","pith_arxiv_id":"2303.14325","snapshot_observed_at":"2026-08-04T22:33:35.419749Z","title":"Backdoor Attacks with Input-unique Triggers in NLP","venue":"cs.CL","work_id":"37bbaeed-6626-44ab-86c9-99103ec1a637","year":2023},"citing_paper":{"arxiv_id":"2509.07287","last_updated":"2025-09-08T23:44:00Z","snapshot_observed_at":"2026-08-09T14:00:07.903618Z","submitted_at":"2025-09-08T23:44:00Z","title":"Paladin: Defending LLM-enabled Phishing Emails with a New Trigger-Tag Paradigm","version":1},"reference_index":101,"source":"pdf_text","source_observed_at":"2026-08-04T22:33:30.162009Z"},"links":{"cited_paper":"/paper/2303.14325","citing_paper":"/paper/2509.07287"},"observation_digest":"sha256:021107794f7688805cbe7fef7f169eefeb882e42befbdb00ca0f7ecc592553c2","observation_id":"3e4e309d-9b54-4945-9cbd-7eac7db3ae39","resolution":{"observed_at":"2026-08-04T22:33:35.488139Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2108.07790","last_updated":"2021-11-28T01:32:21Z","snapshot_observed_at":"2026-08-09T14:40:27.898030Z","submitted_at":"2021-08-04T22:18:10Z","title":"Mitigating harm in language models with conditional-likelihood filtration","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2108.07790","snapshot_observed_at":"2026-08-04T22:33:30.522442Z","title":"Mitigating harm in language models with conditional- likelihood filtration,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2509.07287","last_updated":"2025-09-08T23:44:00Z","snapshot_observed_at":"2026-08-09T14:00:07.903618Z","submitted_at":"2025-09-08T23:44:00Z","title":"Paladin: Defending LLM-enabled Phishing Emails with a New Trigger-Tag Paradigm","version":1},"reference_index":102,"source":"pdf_text","source_observed_at":"2026-08-04T22:33:30.522442Z"},"links":{"cited_paper":"/paper/2108.07790","citing_paper":"/paper/2509.07287"},"observation_digest":"sha256:be5cae6b88aecd99135f613c6da2ba4036e8935917d1402505da5ca1a18b519b","observation_id":"112aad77-3277-4814-8ff4-bbf34412e771","resolution":{"observed_at":"2026-08-04T22:33:30.522442Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T22:33:30.314187Z","title":"” do anything now","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.07287","last_updated":"2025-09-08T23:44:00Z","snapshot_observed_at":"2026-08-09T14:00:07.903618Z","submitted_at":"2025-09-08T23:44:00Z","title":"Paladin: Defending LLM-enabled Phishing Emails with a New Trigger-Tag Paradigm","version":1},"reference_index":103,"source":"pdf_text","source_observed_at":"2026-08-04T22:33:30.314187Z"},"links":{"citing_paper":"/paper/2509.07287"},"observation_digest":"sha256:cce59ce3e08759bd5c0f4ebf8c9f45e75b8a795a271ed5ba07c97c7deb733e30","observation_id":"78f32d21-14d6-4a36-bbf9-23bf4f2cbc7a","resolution":{"observed_at":"2026-08-04T22:33:30.314187Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T22:33:30.638437Z","title":"Hid- den killer: Invisible textual backdoor attacks with syntactic trigger,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2509.07287","last_updated":"2025-09-08T23:44:00Z","snapshot_observed_at":"2026-08-09T14:00:07.903618Z","submitted_at":"2025-09-08T23:44:00Z","title":"Paladin: Defending LLM-enabled Phishing Emails with a New Trigger-Tag Paradigm","version":1},"reference_index":104,"source":"pdf_text","source_observed_at":"2026-08-04T22:33:30.638437Z"},"links":{"citing_paper":"/paper/2509.07287"},"observation_digest":"sha256:af43e006aef46de3a3b1ca331eae1636ce7820fed38c5f0ce4a67631c93a88be","observation_id":"7afd2fe1-9353-46fa-bd80-779d45871f0c","resolution":{"observed_at":"2026-08-04T22:33:30.638437Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2509.07287","last_updated":"2025-09-08T23:44:00Z","latest_version":1,"primary_category":"cs.CR","snapshot_observed_at":"2026-08-09T14:00:07.903618Z","submitted_at":"2025-09-08T23:44:00Z","title":"Paladin: Defending LLM-enabled Phishing Emails with a New Trigger-Tag Paradigm"},"reference_resolution":{"displayed":100,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":90,"verified_exact":10,"verified_fuzzy":0},"total_outbound_references":159},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"thesis":"As of 11 August 2026, this Paper Citation Record lists 100 of 159 outbound references and 0 inbound Pith citation observations for arXiv:2509.07287."}