{"as_of":"2026-08-17T14:30:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:5f8c3f792d91a427fac2d0e7e02f0d7bbd31b2af628e877caddc535f3ab90755","coverage":[{"denominator":53,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":53,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T21:29:16.565174Z","state":"measured"},{"denominator":53,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":53,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-17T06:30:58.91139+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2505.09820/citation-record","integrity":"/paper/2505.09820/integrity","json":"/paper/2505.09820/citation-record.json","paper":"/paper/2505.09820"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2103.06333","last_updated":"2021-04-10T19:48:33Z","snapshot_observed_at":"2026-08-16T18:39:47.374377Z","submitted_at":"2021-03-10T20:32:59Z","title":"Unified Pre-training for Program Understanding and Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2103.06333","snapshot_observed_at":"2026-08-15T21:29:16.317104Z","title":"Unified pre-training for program understanding and generation,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.09820","last_updated":"2025-05-14T21:50:46Z","snapshot_observed_at":"2026-08-17T08:41:23.776591Z","submitted_at":"2025-05-14T21:50:46Z","title":"Adversarial Attack on Large Language Models using Exponentiated Gradient Descent","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-15T21:29:16.317104Z"},"links":{"cited_paper":"/paper/2103.06333","citing_paper":"/paper/2505.09820"},"observation_digest":"sha256:7c8c49c4bc36eaa4774a09a9609571915616c8f98a6606e282597da1e933db89","observation_id":"ecfac2b9-d001-430c-80aa-1f47eb2c5117","resolution":{"observed_at":"2026-08-15T21:29:16.317104Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:29:16.321859Z","title":"Language mod- els are few-shot learners,","venue":null,"work_id":null,"year":1901},"citing_paper":{"arxiv_id":"2505.09820","last_updated":"2025-05-14T21:50:46Z","snapshot_observed_at":"2026-08-17T08:41:23.776591Z","submitted_at":"2025-05-14T21:50:46Z","title":"Adversarial Attack on Large Language Models using Exponentiated Gradient Descent","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-15T21:29:16.321859Z"},"links":{"citing_paper":"/paper/2505.09820"},"observation_digest":"sha256:b174003a8f78ea604129f3d6a05169639d17fb1eeaa6f29d94f631415c7bd777","observation_id":"224d9eff-28a6-4853-9cdb-f37c0d937cca","resolution":{"observed_at":"2026-08-15T21:29:16.321859Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2209.14338","last_updated":"2022-10-26T08:11:56Z","snapshot_observed_at":"2026-08-16T16:29:08.327124Z","submitted_at":"2022-09-28T18:07:02Z","title":"Who is GPT-3? An Exploration of Personality, Values and Demographics","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.14338","snapshot_observed_at":"2026-08-15T21:29:16.326057Z","title":"Who is gpt-3? an ex- ploration of personality, values and demographics,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.09820","last_updated":"2025-05-14T21:50:46Z","snapshot_observed_at":"2026-08-17T08:41:23.776591Z","submitted_at":"2025-05-14T21:50:46Z","title":"Adversarial Attack on Large Language Models using Exponentiated Gradient Descent","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-15T21:29:16.326057Z"},"links":{"cited_paper":"/paper/2209.14338","citing_paper":"/paper/2505.09820"},"observation_digest":"sha256:7e132845eb9703eef8fddcb82282b9b9a46e4f0de939a223c0472883ca7295bb","observation_id":"6b344d69-fb6c-4b64-ac68-856baac636e4","resolution":{"observed_at":"2026-08-15T21:29:16.326057Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.03230","last_updated":"2024-11-28T08:49:00Z","snapshot_observed_at":"2026-08-16T14:13:02.754022Z","submitted_at":"2024-03-04T15:27:59Z","title":"Large language models surpass human experts in predicting neuroscience results","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.03230","snapshot_observed_at":"2026-08-15T21:29:16.330351Z","title":"Large language models surpass human experts in predicting neuroscience results,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.09820","last_updated":"2025-05-14T21:50:46Z","snapshot_observed_at":"2026-08-17T08:41:23.776591Z","submitted_at":"2025-05-14T21:50:46Z","title":"Adversarial Attack on Large Language Models using Exponentiated Gradient Descent","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-15T21:29:16.330351Z"},"links":{"cited_paper":"/paper/2403.03230","citing_paper":"/paper/2505.09820"},"observation_digest":"sha256:0bf39d7e27f515ef93a9c66b6e6bf9d434947165bd3435157787e69a50f9108b","observation_id":"ea3f0ac9-3db0-4b8c-8e99-4af6bf8154d7","resolution":{"observed_at":"2026-08-15T21:29:16.330351Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:29:17.391809Z","title":"Chatgpt and large language models in academia: opportunities and challenges,","venue":null,"work_id":"64325aa8-3a99-4d43-9f0e-1ec676be2ccc","year":2023},"citing_paper":{"arxiv_id":"2505.09820","last_updated":"2025-05-14T21:50:46Z","snapshot_observed_at":"2026-08-17T08:41:23.776591Z","submitted_at":"2025-05-14T21:50:46Z","title":"Adversarial Attack on Large Language Models using Exponentiated Gradient Descent","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-15T21:29:16.334559Z"},"links":{"citing_paper":"/paper/2505.09820"},"observation_digest":"sha256:b3fe7f7e225106606f0b48f6a72283a97facd25da9ff66b94f58b9d911022706","observation_id":"395a3caf-83ec-451f-b458-6c6446f698e2","resolution":{"observed_at":"2026-08-15T21:29:17.396440Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2112.04359","last_updated":"2021-12-08T16:09:48Z","snapshot_observed_at":"2026-08-09T15:17:43.394064Z","submitted_at":"2021-12-08T16:09:48Z","title":"Ethical and social risks of harm from Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2112.04359","snapshot_observed_at":"2026-08-15T21:29:16.338492Z","title":"Ethical and social risks of harm from language models. arxiv,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.09820","last_updated":"2025-05-14T21:50:46Z","snapshot_observed_at":"2026-08-17T08:41:23.776591Z","submitted_at":"2025-05-14T21:50:46Z","title":"Adversarial Attack on Large Language Models using Exponentiated Gradient Descent","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-15T21:29:16.338492Z"},"links":{"cited_paper":"/paper/2112.04359","citing_paper":"/paper/2505.09820"},"observation_digest":"sha256:01d0971a928f57808310cca7226b9d158febe9210b92c9611234dea6fc36568e","observation_id":"06155572-288c-4d6b-b618-4ef88c394a2f","resolution":{"observed_at":"2026-08-15T21:29:16.338492Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:29:17.376867Z","title":"Extracting training data from large language models,","venue":null,"work_id":"f84337ff-4e15-4cce-b97b-35a68b47271a","year":2021},"citing_paper":{"arxiv_id":"2505.09820","last_updated":"2025-05-14T21:50:46Z","snapshot_observed_at":"2026-08-17T08:41:23.776591Z","submitted_at":"2025-05-14T21:50:46Z","title":"Adversarial Attack on Large Language Models using Exponentiated Gradient Descent","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-15T21:29:16.343616Z"},"links":{"citing_paper":"/paper/2505.09820"},"observation_digest":"sha256:e2f895fdd73535acf7b20f60e12e8decfb9abd1a869ccf8e0187367741539f15","observation_id":"3fdffb2c-61e4-4d2f-88a4-4530c5d0ef5f","resolution":{"observed_at":"2026-08-15T21:29:17.381661Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:29:16.347891Z","title":"Training language models to follow instructions with human feedback,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.09820","last_updated":"2025-05-14T21:50:46Z","snapshot_observed_at":"2026-08-17T08:41:23.776591Z","submitted_at":"2025-05-14T21:50:46Z","title":"Adversarial Attack on Large Language Models using Exponentiated Gradient Descent","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-15T21:29:16.347891Z"},"links":{"citing_paper":"/paper/2505.09820"},"observation_digest":"sha256:082f0a47973b1f2e33efd90352fc96c049035b68f85c6a7ea6224986fcd2bec9","observation_id":"ade23326-426d-47ea-96a8-08fb19169b21","resolution":{"observed_at":"2026-08-15T21:29:16.347891Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:29:17.353598Z","title":"Pretraining language models with human preferences,","venue":null,"work_id":"91f50657-1e22-4f9d-8d79-d82a2db85293","year":2023},"citing_paper":{"arxiv_id":"2505.09820","last_updated":"2025-05-14T21:50:46Z","snapshot_observed_at":"2026-08-17T08:41:23.776591Z","submitted_at":"2025-05-14T21:50:46Z","title":"Adversarial Attack on Large Language Models using Exponentiated Gradient Descent","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-15T21:29:16.352218Z"},"links":{"citing_paper":"/paper/2505.09820"},"observation_digest":"sha256:10f62e4cd5fa67766d8a818996da0b478a6c8961149331b50bef51fffc1a4776","observation_id":"4bab69ff-0aea-46ea-a11d-5f4c1cc8f16f","resolution":{"observed_at":"2026-08-15T21:29:17.358053Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.07124","last_updated":"2023-10-09T03:34:01Z","snapshot_observed_at":"2026-08-16T15:00:58.034305Z","submitted_at":"2023-09-13T17:59:09Z","title":"RAIN: Your Language Models Can Align Themselves without Finetuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.07124","snapshot_observed_at":"2026-08-15T21:29:16.356471Z","title":"Rain: Your lan- guage models can align themselves without finetuning,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.09820","last_updated":"2025-05-14T21:50:46Z","snapshot_observed_at":"2026-08-17T08:41:23.776591Z","submitted_at":"2025-05-14T21:50:46Z","title":"Adversarial Attack on Large Language Models using Exponentiated Gradient Descent","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-15T21:29:16.356471Z"},"links":{"cited_paper":"/paper/2309.07124","citing_paper":"/paper/2505.09820"},"observation_digest":"sha256:22e31a1a06f74375228087da4948fef7b6b8c2e56d5d84e1f6cea670d11201f4","observation_id":"bb493853-c1ab-4c47-b369-2084b2ed5838","resolution":{"observed_at":"2026-08-15T21:29:16.356471Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.08715","last_updated":"2023-10-25T07:30:51Z","snapshot_observed_at":"2026-08-16T15:15:58.700562Z","submitted_at":"2023-07-16T01:07:15Z","title":"MasterKey: Automated Jailbreak Across Multiple Large Language Model Chatbots","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.08715","snapshot_observed_at":"2026-08-15T21:29:16.361397Z","title":"Jailbreaker: Automated jailbreak across multiple large language model chatbots,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.09820","last_updated":"2025-05-14T21:50:46Z","snapshot_observed_at":"2026-08-17T08:41:23.776591Z","submitted_at":"2025-05-14T21:50:46Z","title":"Adversarial Attack on Large Language Models using Exponentiated Gradient Descent","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-15T21:29:16.361397Z"},"links":{"cited_paper":"/paper/2307.08715","citing_paper":"/paper/2505.09820"},"observation_digest":"sha256:35da31934faf477ad07562163985b07ca2aa46854cd1ed5a9dd059621d1c19d9","observation_id":"dd737c25-6545-473a-a787-3c97b810300d","resolution":{"observed_at":"2026-08-15T21:29:16.361397Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08419","last_updated":"2024-07-18T18:24:57Z","snapshot_observed_at":"2026-08-16T13:08:51.920120Z","submitted_at":"2023-10-12T15:38:28Z","title":"Jailbreaking Black Box Large Language Models in Twenty Queries","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.08419","snapshot_observed_at":"2026-08-15T21:29:16.366235Z","title":"Jailbreaking black box large language models in twenty queries,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.09820","last_updated":"2025-05-14T21:50:46Z","snapshot_observed_at":"2026-08-17T08:41:23.776591Z","submitted_at":"2025-05-14T21:50:46Z","title":"Adversarial Attack on Large Language Models using Exponentiated Gradient Descent","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-15T21:29:16.366235Z"},"links":{"cited_paper":"/paper/2310.08419","citing_paper":"/paper/2505.09820"},"observation_digest":"sha256:21c6e4a38e943adf137539e1d53b7960c045de63aed2ec9145a9c24d36163b78","observation_id":"da1edfa5-ebac-49a4-8dac-588f4095140f","resolution":{"observed_at":"2026-08-15T21:29:16.366235Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1312.6199","last_updated":"2014-02-19T16:33:14Z","snapshot_observed_at":"2026-08-15T16:41:15.505782Z","submitted_at":"2013-12-21T03:36:08Z","title":"Intriguing properties of neural networks","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1312.6199","snapshot_observed_at":"2026-08-15T21:29:16.370977Z","title":"Intriguing properties of neural networks,","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2505.09820","last_updated":"2025-05-14T21:50:46Z","snapshot_observed_at":"2026-08-17T08:41:23.776591Z","submitted_at":"2025-05-14T21:50:46Z","title":"Adversarial Attack on Large Language Models using Exponentiated Gradient Descent","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-15T21:29:16.370977Z"},"links":{"cited_paper":"/paper/1312.6199","citing_paper":"/paper/2505.09820"},"observation_digest":"sha256:04da37fd0e70803d078032e63c1ce047d834cb1026efa29510fe62e7a0c8c6c6","observation_id":"92200545-6874-49d2-9dc1-2d296e23ed14","resolution":{"observed_at":"2026-08-15T21:29:16.370977Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1412.6572","last_updated":"2015-03-20T20:19:16Z","snapshot_observed_at":"2026-08-12T17:13:46.394331Z","submitted_at":"2014-12-20T01:17:12Z","title":"Explaining and Harnessing Adversarial Examples","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1412.6572","snapshot_observed_at":"2026-08-15T21:29:16.375661Z","title":"Explaining and harnessing adversarial examples,","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2505.09820","last_updated":"2025-05-14T21:50:46Z","snapshot_observed_at":"2026-08-17T08:41:23.776591Z","submitted_at":"2025-05-14T21:50:46Z","title":"Adversarial Attack on Large Language Models using Exponentiated Gradient Descent","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-15T21:29:16.375661Z"},"links":{"cited_paper":"/paper/1412.6572","citing_paper":"/paper/2505.09820"},"observation_digest":"sha256:f9d3e969d1ea4b8923f847e37b463388a0bc8efe6e5ed34fe61944f491e12c01","observation_id":"d7a49216-f850-413b-9f8d-660bb3b0ae02","resolution":{"observed_at":"2026-08-15T21:29:16.375661Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:29:16.379883Z","title":"Jailbroken: How does llm safety training fail?","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.09820","last_updated":"2025-05-14T21:50:46Z","snapshot_observed_at":"2026-08-17T08:41:23.776591Z","submitted_at":"2025-05-14T21:50:46Z","title":"Adversarial Attack on Large Language Models using Exponentiated Gradient Descent","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-15T21:29:16.379883Z"},"links":{"citing_paper":"/paper/2505.09820"},"observation_digest":"sha256:f7b48f74d99ee73df272492e2ae49a22d36528c12b3082e25e88f023a97533c1","observation_id":"61eb4008-ecbc-4d42-8f19-1de8b84833a0","resolution":{"observed_at":"2026-08-15T21:29:16.379883Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:29:16.383905Z","title":"Prompt engineering in large language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.09820","last_updated":"2025-05-14T21:50:46Z","snapshot_observed_at":"2026-08-17T08:41:23.776591Z","submitted_at":"2025-05-14T21:50:46Z","title":"Adversarial Attack on Large Language Models using Exponentiated Gradient Descent","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-15T21:29:16.383905Z"},"links":{"citing_paper":"/paper/2505.09820"},"observation_digest":"sha256:ebd36c876113e1da35f0570f6cb80aeac01ef93b4966ff370a3c1db33ae69b1a","observation_id":"a3780aa4-ae9c-4d04-abca-1657f0f21b7c","resolution":{"observed_at":"2026-08-15T21:29:16.383905Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2010.15980","last_updated":"2020-11-07T05:33:35Z","snapshot_observed_at":"2026-08-16T19:09:26.533311Z","submitted_at":"2020-10-29T22:54:00Z","title":"AutoPrompt: Eliciting Knowledge from Language Models with Automatically Generated Prompts","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.15980","snapshot_observed_at":"2026-08-15T21:29:16.388004Z","title":"Auto- prompt: Eliciting knowledge from language models with automatically generated prompts,","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2505.09820","last_updated":"2025-05-14T21:50:46Z","snapshot_observed_at":"2026-08-17T08:41:23.776591Z","submitted_at":"2025-05-14T21:50:46Z","title":"Adversarial Attack on Large Language Models using Exponentiated Gradient Descent","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-15T21:29:16.388004Z"},"links":{"cited_paper":"/paper/2010.15980","citing_paper":"/paper/2505.09820"},"observation_digest":"sha256:498e1f9417328e8977feac7dca2474015eb1141d2670d96168eb2c40dc28c8c0","observation_id":"14ce5075-4c6a-4b89-9a50-1b37925fadcc","resolution":{"observed_at":"2026-08-15T21:29:16.388004Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:29:16.392502Z","title":"Hard prompts made easy: Gradient-based discrete optimization for prompt tuning and discovery,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.09820","last_updated":"2025-05-14T21:50:46Z","snapshot_observed_at":"2026-08-17T08:41:23.776591Z","submitted_at":"2025-05-14T21:50:46Z","title":"Adversarial Attack on Large Language Models using Exponentiated Gradient Descent","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-15T21:29:16.392502Z"},"links":{"citing_paper":"/paper/2505.09820"},"observation_digest":"sha256:e3f36eeef3b05a161efab8e15e19dbda29f40701da2cada20365b989203199f9","observation_id":"654f7344-1368-4768-aae3-8abf3f74544f","resolution":{"observed_at":"2026-08-15T21:29:16.392502Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:29:16.396800Z","title":"Are aligned neural networks adversarially aligned?","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.09820","last_updated":"2025-05-14T21:50:46Z","snapshot_observed_at":"2026-08-17T08:41:23.776591Z","submitted_at":"2025-05-14T21:50:46Z","title":"Adversarial Attack on Large Language Models using Exponentiated Gradient Descent","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-15T21:29:16.396800Z"},"links":{"citing_paper":"/paper/2505.09820"},"observation_digest":"sha256:206849e2fbb11fbebda665cb5b89851d76415c28c25d7bf3087315989864d0cb","observation_id":"06702131-5177-4386-bec7-c3ef6dc06e96","resolution":{"observed_at":"2026-08-15T21:29:16.396800Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06987","last_updated":"2023-10-10T20:15:54Z","snapshot_observed_at":"2026-08-15T18:47:46.763989Z","submitted_at":"2023-10-10T20:15:54Z","title":"Catastrophic Jailbreak of Open-source LLMs via Exploiting Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.06987","snapshot_observed_at":"2026-08-15T21:29:16.400855Z","title":"Catastrophic jailbreak of open-source llms via exploiting generation,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.09820","last_updated":"2025-05-14T21:50:46Z","snapshot_observed_at":"2026-08-17T08:41:23.776591Z","submitted_at":"2025-05-14T21:50:46Z","title":"Adversarial Attack on Large Language Models using Exponentiated Gradient Descent","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-15T21:29:16.400855Z"},"links":{"cited_paper":"/paper/2310.06987","citing_paper":"/paper/2505.09820"},"observation_digest":"sha256:9ef8f24250725f13bd141dee34f6e1798a52b9ba46b74341fa76619f82e6730e","observation_id":"01f0e7e2-5dc8-4218-ab0d-752c9ffe1e46","resolution":{"observed_at":"2026-08-15T21:29:16.400855Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.15043","last_updated":"2023-12-20T20:48:57Z","snapshot_observed_at":"2026-08-12T09:06:50.363435Z","submitted_at":"2023-07-27T17:49:12Z","title":"Universal and Transferable Adversarial Attacks on Aligned Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.15043","snapshot_observed_at":"2026-08-15T21:29:16.405196Z","title":"Universal and transferable adversarial attacks on aligned language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.09820","last_updated":"2025-05-14T21:50:46Z","snapshot_observed_at":"2026-08-17T08:41:23.776591Z","submitted_at":"2025-05-14T21:50:46Z","title":"Adversarial Attack on Large Language Models using Exponentiated Gradient Descent","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-15T21:29:16.405196Z"},"links":{"cited_paper":"/paper/2307.15043","citing_paper":"/paper/2505.09820"},"observation_digest":"sha256:5dd45d4519d68ce6f75ad6595b36273b32bfd69bce121eef3f21acf8fd436529","observation_id":"bff6df8c-b177-4d6e-9e59-ec97cd3131be","resolution":{"observed_at":"2026-08-15T21:29:16.405196Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.15570","last_updated":"2024-02-23T19:12:53Z","snapshot_observed_at":"2026-08-16T14:15:48.297123Z","submitted_at":"2024-02-23T19:12:53Z","title":"Fast Adversarial Attacks on Language Models In One GPU Minute","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.15570","snapshot_observed_at":"2026-08-15T21:29:16.409643Z","title":"Fast adversarial attacks on language models in one gpu minute,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.09820","last_updated":"2025-05-14T21:50:46Z","snapshot_observed_at":"2026-08-17T08:41:23.776591Z","submitted_at":"2025-05-14T21:50:46Z","title":"Adversarial Attack on Large Language Models using Exponentiated Gradient Descent","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-15T21:29:16.409643Z"},"links":{"cited_paper":"/paper/2402.15570","citing_paper":"/paper/2505.09820"},"observation_digest":"sha256:49918254013c33c3c45983e09c65e5702ded881a4a9826d8b3469e5d6e3fb1af","observation_id":"d4da211b-6020-46bf-817d-97544570e12e","resolution":{"observed_at":"2026-08-15T21:29:16.409643Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:29:17.301889Z","title":"Attacking large language models with projected gradient descent,","venue":null,"work_id":"095a43cf-cef8-4722-a39b-94d432a8e64a","year":2024},"citing_paper":{"arxiv_id":"2505.09820","last_updated":"2025-05-14T21:50:46Z","snapshot_observed_at":"2026-08-17T08:41:23.776591Z","submitted_at":"2025-05-14T21:50:46Z","title":"Adversarial Attack on Large Language Models using Exponentiated Gradient Descent","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-15T21:29:16.414279Z"},"links":{"citing_paper":"/paper/2505.09820"},"observation_digest":"sha256:0660d093d55e671a4ee6c5ccf6fbbc9405207ed45d1c21e0624a9a562b17b76a","observation_id":"84ad1fc4-de68-4e33-9fb0-16b1bd0f29a7","resolution":{"observed_at":"2026-08-15T21:29:17.307932Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.09063","last_updated":"2025-04-16T15:15:56Z","snapshot_observed_at":"2026-08-16T14:18:42.489920Z","submitted_at":"2024-02-14T10:20:03Z","title":"Soft Prompt Threats: Attacking Safety Alignment and Unlearning in Open-Source LLMs through the Embedding Space","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.09063","snapshot_observed_at":"2026-08-15T21:29:16.418332Z","title":"Soft prompt threats: Attacking safety alignment and unlearning in open-source llms through the embedding space,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.09820","last_updated":"2025-05-14T21:50:46Z","snapshot_observed_at":"2026-08-17T08:41:23.776591Z","submitted_at":"2025-05-14T21:50:46Z","title":"Adversarial Attack on Large Language Models using Exponentiated Gradient Descent","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-15T21:29:16.418332Z"},"links":{"cited_paper":"/paper/2402.09063","citing_paper":"/paper/2505.09820"},"observation_digest":"sha256:277d61dd657882d8b96332db268e41b07abb11d9f44467bba16ae0039f08875b","observation_id":"28be6349-f425-497c-ad24-49d4f9380f25","resolution":{"observed_at":"2026-08-15T21:29:16.418332Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:29:16.423122Z","title":"Jailbreak in pieces: Compositional adversarial attacks on multi-modal language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.09820","last_updated":"2025-05-14T21:50:46Z","snapshot_observed_at":"2026-08-17T08:41:23.776591Z","submitted_at":"2025-05-14T21:50:46Z","title":"Adversarial Attack on Large Language Models using Exponentiated Gradient Descent","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-15T21:29:16.423122Z"},"links":{"citing_paper":"/paper/2505.09820"},"observation_digest":"sha256:80737e2c63baf589a0d93edbd56faf7258b69991cbbead9d799b30c13b257087","observation_id":"8674ed51-c1f0-4cee-837e-addf1442e3b4","resolution":{"observed_at":"2026-08-15T21:29:16.423122Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.02764","last_updated":"2024-09-12T22:18:03Z","snapshot_observed_at":"2026-08-16T13:55:22.333736Z","submitted_at":"2024-05-04T22:00:28Z","title":"Assessing Adversarial Robustness of Large Language Models: An Empirical Study","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.02764","snapshot_observed_at":"2026-08-15T21:29:16.427888Z","title":"Assessing adversarial robustness of large language models: An empirical study,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.09820","last_updated":"2025-05-14T21:50:46Z","snapshot_observed_at":"2026-08-17T08:41:23.776591Z","submitted_at":"2025-05-14T21:50:46Z","title":"Adversarial Attack on Large Language Models using Exponentiated Gradient Descent","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-15T21:29:16.427888Z"},"links":{"cited_paper":"/paper/2405.02764","citing_paper":"/paper/2505.09820"},"observation_digest":"sha256:0a2582bc07aff9984a1cdc0f7b47c09657bff77d25cc925bb308efd9d3e50ef3","observation_id":"45d0c3f6-4a6f-4b91-98f9-a86b9c764ba6","resolution":{"observed_at":"2026-08-15T21:29:16.427888Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:29:17.278603Z","title":"Geometric analysis and metric learning of instruction embeddings,","venue":null,"work_id":"38c456df-7a8a-4768-af3f-cfbe1e5b9b1f","year":2022},"citing_paper":{"arxiv_id":"2505.09820","last_updated":"2025-05-14T21:50:46Z","snapshot_observed_at":"2026-08-17T08:41:23.776591Z","submitted_at":"2025-05-14T21:50:46Z","title":"Adversarial Attack on Large Language Models using Exponentiated Gradient Descent","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-15T21:29:16.432783Z"},"links":{"citing_paper":"/paper/2505.09820"},"observation_digest":"sha256:18474230de7a69b57de570b5a159634ea40a9da82f948aa1b09f973ee1750989","observation_id":"cfe9e1c3-21d3-43a2-a2aa-694cabcdd200","resolution":{"observed_at":"2026-08-15T21:29:17.283105Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.07870","last_updated":"2023-11-07T16:28:33Z","snapshot_observed_at":"2026-08-16T15:16:00.040207Z","submitted_at":"2023-07-15T19:04:33Z","title":"Large Language Models as Superpositions of Cultural Perspectives","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.07870","snapshot_observed_at":"2026-08-15T21:29:16.437346Z","title":"Large language models as superpositions of cultural perspectives,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.09820","last_updated":"2025-05-14T21:50:46Z","snapshot_observed_at":"2026-08-17T08:41:23.776591Z","submitted_at":"2025-05-14T21:50:46Z","title":"Adversarial Attack on Large Language Models using Exponentiated Gradient Descent","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-15T21:29:16.437346Z"},"links":{"cited_paper":"/paper/2307.07870","citing_paper":"/paper/2505.09820"},"observation_digest":"sha256:6bbf388486739a6f208780abc63e8b3943bddd68942f829487fdea6345a2a1f3","observation_id":"03fff507-e944-4e25-a0ce-5f076953e413","resolution":{"observed_at":"2026-08-15T21:29:16.437346Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09288","last_updated":"2023-07-19T17:08:59Z","snapshot_observed_at":"2026-08-07T12:56:43.323460Z","submitted_at":"2023-07-18T14:31:57Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.09288","snapshot_observed_at":"2026-08-15T21:29:16.442750Z","title":"Llama 2: Open foundation and fine-tuned chat models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.09820","last_updated":"2025-05-14T21:50:46Z","snapshot_observed_at":"2026-08-17T08:41:23.776591Z","submitted_at":"2025-05-14T21:50:46Z","title":"Adversarial Attack on Large Language Models using Exponentiated Gradient Descent","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-15T21:29:16.442750Z"},"links":{"cited_paper":"/paper/2307.09288","citing_paper":"/paper/2505.09820"},"observation_digest":"sha256:e1b3a3bbb17227f3bb18602080ff30f99773312ed175d02e086eeaff4986d3d2","observation_id":"6ee496b2-3fb9-4b6c-b248-dafb5a595ebb","resolution":{"observed_at":"2026-08-15T21:29:16.442750Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1908.07125","last_updated":"2021-01-03T19:58:55Z","snapshot_observed_at":"2026-08-15T08:24:44.028513Z","submitted_at":"2019-08-20T01:51:40Z","title":"Universal Adversarial Triggers for Attacking and Analyzing NLP","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1908.07125","snapshot_observed_at":"2026-08-15T21:29:16.448110Z","title":"Universal adversarial triggers for attacking and analyzing nlp,","venue":null,"work_id":null,"year":1908},"citing_paper":{"arxiv_id":"2505.09820","last_updated":"2025-05-14T21:50:46Z","snapshot_observed_at":"2026-08-17T08:41:23.776591Z","submitted_at":"2025-05-14T21:50:46Z","title":"Adversarial Attack on Large Language Models using Exponentiated Gradient Descent","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-15T21:29:16.448110Z"},"links":{"cited_paper":"/paper/1908.07125","citing_paper":"/paper/2505.09820"},"observation_digest":"sha256:0758f5d19b3f69043d4fc0a28fd5b57931267fd5a8cf6d9b6d9ad8e0d3ad7f33","observation_id":"c26ca2eb-4355-42de-acb8-0add32eb973b","resolution":{"observed_at":"2026-08-15T21:29:16.448110Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1712.06751","last_updated":"2018-05-24T16:43:45Z","snapshot_observed_at":"2026-08-16T00:36:28.515339Z","submitted_at":"2017-12-19T02:15:19Z","title":"HotFlip: White-Box Adversarial Examples for Text Classification","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1712.06751","snapshot_observed_at":"2026-08-15T21:29:16.453009Z","title":"Hotflip: White-box adver- sarial examples for text classification,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.09820","last_updated":"2025-05-14T21:50:46Z","snapshot_observed_at":"2026-08-17T08:41:23.776591Z","submitted_at":"2025-05-14T21:50:46Z","title":"Adversarial Attack on Large Language Models using Exponentiated Gradient Descent","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-15T21:29:16.453009Z"},"links":{"cited_paper":"/paper/1712.06751","citing_paper":"/paper/2505.09820"},"observation_digest":"sha256:9fccd1a4eac43c84e1e324a65590d2323234f0c698238414cc6788a4a62898b2","observation_id":"5ecb55fd-450c-412a-8e07-68c412623829","resolution":{"observed_at":"2026-08-15T21:29:16.453009Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.07921","last_updated":"2024-11-24T18:03:43Z","snapshot_observed_at":"2026-08-16T14:01:39.676116Z","submitted_at":"2024-04-11T17:05:50Z","title":"AmpleGCG: Learning a Universal and Transferable Generative Model of Adversarial Suffixes for Jailbreaking Both Open and Closed LLMs","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.07921","snapshot_observed_at":"2026-08-15T21:29:16.457905Z","title":"Amplegcg: Learning a universal and transferable generative model of adversarial suffixes for jailbreaking both open and closed llms,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.09820","last_updated":"2025-05-14T21:50:46Z","snapshot_observed_at":"2026-08-17T08:41:23.776591Z","submitted_at":"2025-05-14T21:50:46Z","title":"Adversarial Attack on Large Language Models using Exponentiated Gradient Descent","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-15T21:29:16.457905Z"},"links":{"cited_paper":"/paper/2404.07921","citing_paper":"/paper/2505.09820"},"observation_digest":"sha256:1b643ceb7b7ed2731808743c42957e883eaeffeb76b2b3234c56d3fe47e6233b","observation_id":"031b59af-b7c5-40eb-ad2b-de002ad07537","resolution":{"observed_at":"2026-08-15T21:29:16.457905Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1706.06083","last_updated":"2019-09-04T18:53:10Z","snapshot_observed_at":"2026-08-07T14:27:46.872660Z","submitted_at":"2017-06-19T17:53:11Z","title":"Towards Deep Learning Models Resistant to Adversarial Attacks","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1706.06083","snapshot_observed_at":"2026-08-15T21:29:16.462733Z","title":"Towards deep learning models resistant to adversarial attacks,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.09820","last_updated":"2025-05-14T21:50:46Z","snapshot_observed_at":"2026-08-17T08:41:23.776591Z","submitted_at":"2025-05-14T21:50:46Z","title":"Adversarial Attack on Large Language Models using Exponentiated Gradient Descent","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-15T21:29:16.462733Z"},"links":{"cited_paper":"/paper/1706.06083","citing_paper":"/paper/2505.09820"},"observation_digest":"sha256:a87465914afaeb3e46eb1c91a14713768ab19cdfa647d407e0aadbd16ae323b4","observation_id":"d3308ecb-c694-4f5d-8543-3f71de6150ec","resolution":{"observed_at":"2026-08-15T21:29:16.462733Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:29:16.467755Z","title":"Efficient projections onto the l 1-ball for learning in high dimensions,","venue":null,"work_id":null,"year":2008},"citing_paper":{"arxiv_id":"2505.09820","last_updated":"2025-05-14T21:50:46Z","snapshot_observed_at":"2026-08-17T08:41:23.776591Z","submitted_at":"2025-05-14T21:50:46Z","title":"Adversarial Attack on Large Language Models using Exponentiated Gradient Descent","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-15T21:29:16.467755Z"},"links":{"citing_paper":"/paper/2505.09820"},"observation_digest":"sha256:ea02cb00e5dacda686ff27d1e3e991a342ac0998f57f4b7cd0bfcf335aa25a48","observation_id":"fdb3f88b-be62-4313-9720-d8d3ec6d2e2b","resolution":{"observed_at":"2026-08-15T21:29:16.467755Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:29:17.254951Z","title":"Crafting ad- versarial input sequences for recurrent neural networks,","venue":null,"work_id":"dfbc9ad2-0c6b-4f8e-bf98-5c27daccd9db","year":2016},"citing_paper":{"arxiv_id":"2505.09820","last_updated":"2025-05-14T21:50:46Z","snapshot_observed_at":"2026-08-17T08:41:23.776591Z","submitted_at":"2025-05-14T21:50:46Z","title":"Adversarial Attack on Large Language Models using Exponentiated Gradient Descent","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-15T21:29:16.472832Z"},"links":{"citing_paper":"/paper/2505.09820"},"observation_digest":"sha256:44e63e61e7f1896554af057ef27fc2950028ef8383fea2c2a7a52eb4ebaae48f","observation_id":"220e539b-b4b8-4f9a-9de6-08aaac1c4c78","resolution":{"observed_at":"2026-08-15T21:29:17.259076Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:29:17.241061Z","title":"Exponentiated gradient versus gradient descent for linear predictors,","venue":null,"work_id":"d36a1378-ae96-4e74-b86c-71bda839eb16","year":1997},"citing_paper":{"arxiv_id":"2505.09820","last_updated":"2025-05-14T21:50:46Z","snapshot_observed_at":"2026-08-17T08:41:23.776591Z","submitted_at":"2025-05-14T21:50:46Z","title":"Adversarial Attack on Large Language Models using Exponentiated Gradient Descent","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-15T21:29:16.478035Z"},"links":{"citing_paper":"/paper/2505.09820"},"observation_digest":"sha256:0b97e11d52f00d42fc8b1f28c85e553a36d67a5c80fa41625032354b8485cc0e","observation_id":"51c67002-a060-4470-90a3-029f7b96093b","resolution":{"observed_at":"2026-08-15T21:29:17.245280Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:29:17.225572Z","title":"Exponential gradient with momentum for online portfolio selection,","venue":null,"work_id":"f3f24ce0-698f-47fe-9f21-30d9183678a0","year":2022},"citing_paper":{"arxiv_id":"2505.09820","last_updated":"2025-05-14T21:50:46Z","snapshot_observed_at":"2026-08-17T08:41:23.776591Z","submitted_at":"2025-05-14T21:50:46Z","title":"Adversarial Attack on Large Language Models using Exponentiated Gradient Descent","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-15T21:29:16.482227Z"},"links":{"citing_paper":"/paper/2505.09820"},"observation_digest":"sha256:39f416bdd51e5881cbcbeb34b7b0baec3757148643b5d05f1314b103987536e1","observation_id":"1f0ac72d-5457-4369-a5b9-348e98340a84","resolution":{"observed_at":"2026-08-15T21:29:17.230310Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1412.6980","last_updated":"2017-01-30T01:27:54Z","snapshot_observed_at":"2026-08-14T18:51:16.666127Z","submitted_at":"2014-12-22T13:54:29Z","title":"Adam: A Method for Stochastic Optimization","version":9},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1412.6980","snapshot_observed_at":"2026-08-15T21:29:16.486996Z","title":"Adam: A method for stochastic optimization,","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2505.09820","last_updated":"2025-05-14T21:50:46Z","snapshot_observed_at":"2026-08-17T08:41:23.776591Z","submitted_at":"2025-05-14T21:50:46Z","title":"Adversarial Attack on Large Language Models using Exponentiated Gradient Descent","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-15T21:29:16.486996Z"},"links":{"cited_paper":"/paper/1412.6980","citing_paper":"/paper/2505.09820"},"observation_digest":"sha256:e17f2af09f4253de251c867f5394359521a36803cbd0d4569be4db6466a6bde5","observation_id":"eec37898-d42e-4b23-9078-219ed691a07c","resolution":{"observed_at":"2026-08-15T21:29:16.486996Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:29:16.491670Z","title":"The relaxation method of finding the common point of convex sets and its application to the solution of problems in convex programming,","venue":null,"work_id":null,"year":1967},"citing_paper":{"arxiv_id":"2505.09820","last_updated":"2025-05-14T21:50:46Z","snapshot_observed_at":"2026-08-17T08:41:23.776591Z","submitted_at":"2025-05-14T21:50:46Z","title":"Adversarial Attack on Large Language Models using Exponentiated Gradient Descent","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-15T21:29:16.491670Z"},"links":{"citing_paper":"/paper/2505.09820"},"observation_digest":"sha256:ad7dfc5cc042877799963654c77ab129a7a4a3a421ad9f1fb1bb198e14c6777b","observation_id":"610f98c6-7859-47c2-b45b-f20c3ab68553","resolution":{"observed_at":"2026-08-15T21:29:16.491670Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:29:17.211376Z","title":"Iterative bregman projections for regularized transportation problems,","venue":null,"work_id":"d2bbdfe1-42c4-4a78-a347-f90c22520d47","year":null},"citing_paper":{"arxiv_id":"2505.09820","last_updated":"2025-05-14T21:50:46Z","snapshot_observed_at":"2026-08-17T08:41:23.776591Z","submitted_at":"2025-05-14T21:50:46Z","title":"Adversarial Attack on Large Language Models using Exponentiated Gradient Descent","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-15T21:29:16.496633Z"},"links":{"citing_paper":"/paper/2505.09820"},"observation_digest":"sha256:cbd7d9391fb2d195febd5c89898f3a539fae6d047e06ed2333c124b25177831d","observation_id":"8e0d4897-07a3-4234-aedf-fdab31654c2a","resolution":{"observed_at":"2026-08-15T21:29:17.215871Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:29:17.195812Z","title":"An inertial forward-backward algorithm for the minimization of the sum of two nonconvex functions,","venue":null,"work_id":"1b93d745-dad7-4271-b844-aa250f73e587","year":null},"citing_paper":{"arxiv_id":"2505.09820","last_updated":"2025-05-14T21:50:46Z","snapshot_observed_at":"2026-08-17T08:41:23.776591Z","submitted_at":"2025-05-14T21:50:46Z","title":"Adversarial Attack on Large Language Models using Exponentiated Gradient Descent","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-15T21:29:16.506520Z"},"links":{"citing_paper":"/paper/2505.09820"},"observation_digest":"sha256:3f951ba286b7bcd1c6ffd949ef1a49834d62f33bdfd40b92454809e1e48fe214","observation_id":"6565e7be-3bc6-4dab-8688-02cda61b87ee","resolution":{"observed_at":"2026-08-15T21:29:17.200720Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1803.00567","last_updated":"2020-03-18T09:54:55Z","snapshot_observed_at":"2026-08-14T19:40:34.002536Z","submitted_at":"2018-03-01T18:28:43Z","title":"Computational Optimal Transport","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1803.00567","snapshot_observed_at":"2026-08-15T21:29:16.517082Z","title":"Computational optimal transport,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.09820","last_updated":"2025-05-14T21:50:46Z","snapshot_observed_at":"2026-08-17T08:41:23.776591Z","submitted_at":"2025-05-14T21:50:46Z","title":"Adversarial Attack on Large Language Models using Exponentiated Gradient Descent","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-15T21:29:16.517082Z"},"links":{"cited_paper":"/paper/1803.00567","citing_paper":"/paper/2505.09820"},"observation_digest":"sha256:cd446ad3c2909c8e0e7d776fa5ba550f8246b276f525124e4052cbbc0ca832ef","observation_id":"6bc92a63-76ee-409f-b546-87659bc84cd3","resolution":{"observed_at":"2026-08-15T21:29:16.517082Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1410.0641","last_updated":"2014-10-02T18:52:27Z","snapshot_observed_at":"2026-08-17T03:45:42.690601Z","submitted_at":"2014-10-02T18:52:27Z","title":"An inertial forward-backward algorithm for the minimization of the sum of two nonconvex functions","version":1},"cited_work":{"arxiv_id":"1410.0641","doi":null,"metadata_source":"pith","pith_arxiv_id":"1410.0641","snapshot_observed_at":"2026-08-15T21:29:16.721485Z","title":"An inertial forward-backward algorithm for the minimization of the sum of two nonconvex functions","venue":"math.OC","work_id":"baf3bfe8-a8d0-44b0-82a2-3402bab9bdba","year":2014},"citing_paper":{"arxiv_id":"2505.09820","last_updated":"2025-05-14T21:50:46Z","snapshot_observed_at":"2026-08-17T08:41:23.776591Z","submitted_at":"2025-05-14T21:50:46Z","title":"Adversarial Attack on Large Language Models using Exponentiated Gradient Descent","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-15T21:29:16.511844Z"},"links":{"cited_paper":"/paper/1410.0641","citing_paper":"/paper/2505.09820"},"observation_digest":"sha256:002429287418ba75ef2f6f69a991c78b7f300dc38220db25ab5f5ff54f165c30","observation_id":"6d20c213-c18d-423d-b8b9-3aa3f4a10790","resolution":{"observed_at":"2026-08-15T21:29:16.727783Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:29:17.181385Z","title":"Introducing mpt-7b: A new standard for open-source, commercially usable llms, 2023,","venue":null,"work_id":"b9f6d7fc-21b6-48cc-b44f-ed56f22c2222","year":2023},"citing_paper":{"arxiv_id":"2505.09820","last_updated":"2025-05-14T21:50:46Z","snapshot_observed_at":"2026-08-17T08:41:23.776591Z","submitted_at":"2025-05-14T21:50:46Z","title":"Adversarial Attack on Large Language Models using Exponentiated Gradient Descent","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-15T21:29:16.527859Z"},"links":{"citing_paper":"/paper/2505.09820"},"observation_digest":"sha256:b32cf9955c663f03711bdeaaefaf310f037cc167e78c9d600bafc6e69d6f22ff","observation_id":"de503318-da62-4e26-a0e7-2beb59d07e89","resolution":{"observed_at":"2026-08-15T21:29:17.186032Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.16867","last_updated":"2023-11-29T19:45:10Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-11-28T15:12:47Z","title":"The Falcon Series of Open Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.16867","snapshot_observed_at":"2026-08-15T21:29:16.522098Z","title":"The falcon series of open language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.09820","last_updated":"2025-05-14T21:50:46Z","snapshot_observed_at":"2026-08-17T08:41:23.776591Z","submitted_at":"2025-05-14T21:50:46Z","title":"Adversarial Attack on Large Language Models using Exponentiated Gradient Descent","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-15T21:29:16.522098Z"},"links":{"cited_paper":"/paper/2311.16867","citing_paper":"/paper/2505.09820"},"observation_digest":"sha256:4ce2c5cdbaef4624b34d87e3e024b7456ba780d3375573a6dccb983368a534d7","observation_id":"d2537125-b55c-4f03-bf93-4b0d1331be5b","resolution":{"observed_at":"2026-08-15T21:29:16.522098Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:29:17.166778Z","title":"Judging llm-as-a-judge with mt-bench and chatbot arena,","venue":null,"work_id":"8f1ff2b9-8d83-4c66-bbaa-b55a286be4d4","year":2024},"citing_paper":{"arxiv_id":"2505.09820","last_updated":"2025-05-14T21:50:46Z","snapshot_observed_at":"2026-08-17T08:41:23.776591Z","submitted_at":"2025-05-14T21:50:46Z","title":"Adversarial Attack on Large Language Models using Exponentiated Gradient Descent","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-15T21:29:16.537377Z"},"links":{"citing_paper":"/paper/2505.09820"},"observation_digest":"sha256:09803a5e9fe9d6fd879516badb327ad8376ff3db67f0574439b8ce11eebb0378","observation_id":"8dd98fed-e5d9-49b9-b7cc-b97fc133e0e5","resolution":{"observed_at":"2026-08-15T21:29:17.171571Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06825","last_updated":"2023-10-10T17:54:58Z","snapshot_observed_at":"2026-08-17T02:13:39.510069Z","submitted_at":"2023-10-10T17:54:58Z","title":"Mistral 7B","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.06825","snapshot_observed_at":"2026-08-15T21:29:16.532209Z","title":"Mistral 7b,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.09820","last_updated":"2025-05-14T21:50:46Z","snapshot_observed_at":"2026-08-17T08:41:23.776591Z","submitted_at":"2025-05-14T21:50:46Z","title":"Adversarial Attack on Large Language Models using Exponentiated Gradient Descent","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-15T21:29:16.532209Z"},"links":{"cited_paper":"/paper/2310.06825","citing_paper":"/paper/2505.09820"},"observation_digest":"sha256:9d039c7d1bc6601f4e994268365b9c2da628d5c1942c8503367955fb816c0953","observation_id":"7013ffd1-1a30-4f9b-b00a-6f29aeaddb9b","resolution":{"observed_at":"2026-08-15T21:29:16.532209Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.12773","last_updated":"2023-10-19T14:22:03Z","snapshot_observed_at":"2026-08-14T19:10:00.850271Z","submitted_at":"2023-10-19T14:22:03Z","title":"Safe RLHF: Safe Reinforcement Learning from Human Feedback","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.12773","snapshot_observed_at":"2026-08-15T21:29:16.549212Z","title":"Safe rlhf: Safe reinforcement learning from human feedback,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.09820","last_updated":"2025-05-14T21:50:46Z","snapshot_observed_at":"2026-08-17T08:41:23.776591Z","submitted_at":"2025-05-14T21:50:46Z","title":"Adversarial Attack on Large Language Models using Exponentiated Gradient Descent","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-15T21:29:16.549212Z"},"links":{"cited_paper":"/paper/2310.12773","citing_paper":"/paper/2505.09820"},"observation_digest":"sha256:439c8b95786d0c41d496cae32d0ae46566505786066ece4401d4e9ea9ba6a8a6","observation_id":"43df6081-4a84-4b9f-ac0b-2cd2f4fabcf6","resolution":{"observed_at":"2026-08-15T21:29:16.549212Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-08-13T17:20:44.002518Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-15T21:29:16.544087Z","title":"The llama 3 herd of models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.09820","last_updated":"2025-05-14T21:50:46Z","snapshot_observed_at":"2026-08-17T08:41:23.776591Z","submitted_at":"2025-05-14T21:50:46Z","title":"Adversarial Attack on Large Language Models using Exponentiated Gradient Descent","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-15T21:29:16.544087Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2505.09820"},"observation_digest":"sha256:396b3179182dd00f6ee53f9876fa87626064f52e6a09eb368cb7380c0cc933e4","observation_id":"86bb26c6-1c16-446a-b6d2-76881b89c8b9","resolution":{"observed_at":"2026-08-15T21:29:16.544087Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.01318","last_updated":"2024-10-31T22:26:40Z","snapshot_observed_at":"2026-08-11T16:28:21.917686Z","submitted_at":"2024-03-28T02:44:02Z","title":"JailbreakBench: An Open Robustness Benchmark for Jailbreaking Large Language Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.01318","snapshot_observed_at":"2026-08-15T21:29:16.560280Z","title":"Jailbreakbench: An open robustness benchmark for jailbreaking large language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.09820","last_updated":"2025-05-14T21:50:46Z","snapshot_observed_at":"2026-08-17T08:41:23.776591Z","submitted_at":"2025-05-14T21:50:46Z","title":"Adversarial Attack on Large Language Models using Exponentiated Gradient Descent","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-15T21:29:16.560280Z"},"links":{"cited_paper":"/paper/2404.01318","citing_paper":"/paper/2505.09820"},"observation_digest":"sha256:6f003096339417358330c2c8535d306a400cb9da24ba952c38d1ae905dc000ff","observation_id":"af923638-4bb1-4dd4-8a51-57cccc6e8d7f","resolution":{"observed_at":"2026-08-15T21:29:16.560280Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04249","last_updated":"2024-02-27T04:43:08Z","snapshot_observed_at":"2026-08-16T09:07:20.265665Z","submitted_at":"2024-02-06T18:59:08Z","title":"HarmBench: A Standardized Evaluation Framework for Automated Red Teaming and Robust Refusal","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.04249","snapshot_observed_at":"2026-08-15T21:29:16.555115Z","title":"Harmbench: A standardized evaluation framework for automated red teaming and robust refusal,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.09820","last_updated":"2025-05-14T21:50:46Z","snapshot_observed_at":"2026-08-17T08:41:23.776591Z","submitted_at":"2025-05-14T21:50:46Z","title":"Adversarial Attack on Large Language Models using Exponentiated Gradient Descent","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-15T21:29:16.555115Z"},"links":{"cited_paper":"/paper/2402.04249","citing_paper":"/paper/2505.09820"},"observation_digest":"sha256:5c0664fc7517f6aaa7cbcac846ba82b10c3fa30080f9a6627eea9102c592a41b","observation_id":"514f4c1d-22c2-4815-8c9f-08c0818c727f","resolution":{"observed_at":"2026-08-15T21:29:16.555115Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.19160","last_updated":"2024-10-24T21:01:45Z","snapshot_observed_at":"2026-08-16T13:06:07.559705Z","submitted_at":"2024-10-24T21:01:45Z","title":"Adversarial Attacks on Large Language Models Using Regularized Relaxation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.19160","snapshot_observed_at":"2026-08-15T21:29:16.565174Z","title":"Adversarial attacks on large language models using regularized relaxation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.09820","last_updated":"2025-05-14T21:50:46Z","snapshot_observed_at":"2026-08-17T08:41:23.776591Z","submitted_at":"2025-05-14T21:50:46Z","title":"Adversarial Attack on Large Language Models using Exponentiated Gradient Descent","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-15T21:29:16.565174Z"},"links":{"cited_paper":"/paper/2410.19160","citing_paper":"/paper/2505.09820"},"observation_digest":"sha256:39bab4b6f4a8d17a3563a50406f2e13a3d19d46d08a3d42a5465db6ec12075fc","observation_id":"2717cc57-55ef-4152-8970-3dcd38bde6d9","resolution":{"observed_at":"2026-08-15T21:29:16.565174Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1412.5154","last_updated":"2014-12-16T20:27:36Z","snapshot_observed_at":"2026-08-14T23:07:18.659831Z","submitted_at":"2014-12-16T20:27:36Z","title":"Iterative Bregman Projections for Regularized Transportation Problems","version":1},"cited_work":{"arxiv_id":"1412.5154","doi":null,"metadata_source":"pith","pith_arxiv_id":"1412.5154","snapshot_observed_at":"2026-08-15T21:29:16.743269Z","title":"Iterative Bregman Projections for Regularized Transportation Problems","venue":"math.NA","work_id":"2ba31d64-cfb3-4866-8592-c92b53d48916","year":2014},"citing_paper":{"arxiv_id":"2505.09820","last_updated":"2025-05-14T21:50:46Z","snapshot_observed_at":"2026-08-17T08:41:23.776591Z","submitted_at":"2025-05-14T21:50:46Z","title":"Adversarial Attack on Large Language Models using Exponentiated Gradient Descent","version":1},"reference_index":2014,"source":"pdf_text","source_observed_at":"2026-08-15T21:29:16.501185Z"},"links":{"cited_paper":"/paper/1412.5154","citing_paper":"/paper/2505.09820"},"observation_digest":"sha256:5082c39992c6917cfe220a9fb38294b50e518830afb49c8d7a544c6c3d34a3ad","observation_id":"e64fdc34-cb90-4957-ab86-426938272978","resolution":{"observed_at":"2026-08-15T21:29:16.747727Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2505.09820","last_updated":"2025-05-14T21:50:46Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-17T08:41:23.776591Z","submitted_at":"2025-05-14T21:50:46Z","title":"Adversarial Attack on Large Language Models using Exponentiated Gradient Descent"},"reference_resolution":{"displayed":53,"state_counts":{"malformed_identifier":0,"metadata_mismatch":2,"parse_uncertain":0,"unresolved":39,"verified_exact":0,"verified_fuzzy":12},"total_outbound_references":53},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"thesis":"As of 17 August 2026, this Paper Citation Record lists 53 of 53 outbound references and 0 inbound Pith citation observations for arXiv:2505.09820."}