Pith. sign in

Paper Citation Record · LEDGER

Learning-Based Automated Adversarial Red-Teaming for Robustness Evaluation of Large Language Models

As of 2 August 2026, this Paper Citation Record lists 26 of 26 outbound references and 4 inbound Pith citation observations for arXiv:2512.20677.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2512.20677 v4

Coverage vector

measured 26 of 26 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links, observed 2026-05-16T20:22:29.726790Z

measured 30 of 30 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-02T06:30:47.504484+00:00

measured 4 of 4 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links, observed 2026-07-14T17:36:18.728469Z

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: pith, observed 2026-07-03T15:28:33.588948Z

Reference resolution

26 of 26 outbound references displayed

  • verified exact2
  • verified fuzzy6
  • unresolved13
  • parse uncertain0
  • malformed identifier0
  • metadata mismatch5

External citation measurements

No source-named external measurement is stored.

Outbound references

Observation 246968f4-0ce8-41ff-baf0-d63653468f6e · outbound

This paper cites A General Language Assistant as a Laboratory for Alignment.

Learning-Based Automated Adversarial Red-Teaming for Robustness Evaluation of Large Language Models A General Language Assistant as a Laboratory for Alignment

Reference 1

Resolution
verified exact
local_arxiv, observed 2026-05-16T20:23:23.497793Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-02T06:30:47.504484+00:00.

source=pdf_text observed=2026-05-16T20:22:29.726790Z digest=sha256:6962d2715b8488e7974fd02b5d3f6d95502dd7ca24148dca9b3fea6deb60472a

Observation af39c7d1-2d5d-46ed-a085-41c01451a666 · outbound

This paper cites LLM-Safety Evaluations Lack Robustness.

Learning-Based Automated Adversarial Red-Teaming for Robustness Evaluation of Large Language Models LLM-Safety Evaluations Lack Robustness

Reference 2

Resolution
metadata mismatch
arxiv_id, observed 2026-05-16T20:23:23.493420Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-02T06:30:47.504484+00:00.

source=pdf_text observed=2026-05-16T20:22:29.726790Z digest=sha256:b133610e8eaf2ed9b4bd624b2c1d12506811d0602d31667556647be072239b7d

Observation ee97a497-fdd1-4c7f-b2cf-3da30878298e · outbound

This paper cites Measuring Massive Multitask Language Understanding.

Learning-Based Automated Adversarial Red-Teaming for Robustness Evaluation of Large Language Models Measuring Massive Multitask Language Understanding

Reference 3

Resolution
metadata mismatch
local_arxiv, observed 2026-05-16T20:23:23.502104Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-02T06:30:47.504484+00:00.

source=pdf_text observed=2026-05-16T20:22:29.726790Z digest=sha256:3d882d04865d765fd4f573d4188fc9a989253876b1fcffa14f955e44eeaf846d

Observation 7560045d-ed96-4102-be1d-3db6c289e96d · outbound

This paper cites Adversarial Machine Learning at Scale.

Learning-Based Automated Adversarial Red-Teaming for Robustness Evaluation of Large Language Models Adversarial Machine Learning at Scale

Reference 4

Resolution
metadata mismatch
local_arxiv, observed 2026-05-16T20:23:23.511333Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-02T06:30:47.504484+00:00.

source=pdf_text observed=2026-05-16T20:22:29.726790Z digest=sha256:c86ffd2427b8cbed963fe995f396d20ddd692250a1828e43a9f1e5e78b41d11f

Observation 580e4272-b477-4297-b2f3-b2c0e9b0c0e9 · outbound

This paper cites Paul Röttger, Hannah Rose Kirk, Bertie Vidgen, Giuseppe Attanasio, Federico Bianchi, and Dirk Hovy.

Learning-Based Automated Adversarial Red-Teaming for Robustness Evaluation of Large Language Models Paul Röttger, Hannah Rose Kirk, Bertie Vidgen, Giuseppe Attanasio, Federico Bianchi, and Dirk Hovy

Reference 5

Resolution
verified fuzzy
raw_fallback, observed 2026-05-16T20:23:24.137674Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-02T06:30:47.504484+00:00.

source=pdf_text observed=2026-05-16T20:22:29.726790Z digest=sha256:81d09500fb97518127120a28155dbeb7f806ae4e21afc42755dac0e4067218ed

Observation 04cb83cd-e566-4c35-a53d-72324df03873 · outbound

This paper cites Survey of Vulnerabilities in Large Language Models Revealed by Adversarial Attacks.

Learning-Based Automated Adversarial Red-Teaming for Robustness Evaluation of Large Language Models Survey of Vulnerabilities in Large Language Models Revealed by Adversarial Attacks

Reference 6

Resolution
metadata mismatch
arxiv_id, observed 2026-05-16T20:23:23.516334Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-02T06:30:47.504484+00:00.

source=pdf_text observed=2026-05-16T20:22:29.726790Z digest=sha256:e1c9d055461a62cc6cce424e876b0dc4966d6534a01835bc99aa2ecd7c87d19c

Observation bc2eb868-8ecd-46a3-9d65-9f2663b84adc · outbound

This paper cites PandaGuard: Systematic Evaluation of LLM Safety against Jailbreaking Attacks.

Learning-Based Automated Adversarial Red-Teaming for Robustness Evaluation of Large Language Models PandaGuard: Systematic Evaluation of LLM Safety against Jailbreaking Attacks

Reference 7

Resolution
verified exact
arxiv_id, observed 2026-05-16T20:23:23.520526Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-02T06:30:47.504484+00:00.

source=pdf_text observed=2026-05-16T20:22:29.726790Z digest=sha256:323bd056227c22df86cab345237e81c5921162e4f292f1414bf62e4f8a90a5b9

Observation d0c0a8d8-acc8-431d-a17c-b81bce96d53b · outbound

This paper cites Mujiangshan Wang, Yuqing Lin, Shiying Wang, and Meiyu Wang.

Learning-Based Automated Adversarial Red-Teaming for Robustness Evaluation of Large Language Models Mujiangshan Wang, Yuqing Lin, Shiying Wang, and Meiyu Wang

Reference 8

Resolution
verified fuzzy
raw_fallback, observed 2026-05-16T20:23:24.122226Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-02T06:30:47.504484+00:00.

source=pdf_text observed=2026-05-16T20:22:29.726790Z digest=sha256:8e8752bf3b649350a8977492e76601549fae62406f7dfd5ab376cfb7205480fe

Observation c678e7ef-4abf-4fc9-bb57-f588bb30f4c6 · outbound

This paper cites Mujiangshan Wang, Shuhao Xu, Jincheng Jiang, Dong Xiang, and Sun-Yuan Hsieh.

Learning-Based Automated Adversarial Red-Teaming for Robustness Evaluation of Large Language Models Mujiangshan Wang, Shuhao Xu, Jincheng Jiang, Dong Xiang, and Sun-Yuan Hsieh

Reference 9

Resolution
verified fuzzy
raw_fallback, observed 2026-05-16T20:23:24.140639Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-02T06:30:47.504484+00:00.

source=pdf_text observed=2026-05-16T20:22:29.726790Z digest=sha256:469184b67abe5dad893740d2dea31121d707c65d4fd684870e69304733b8a601

Observation 17ad310a-1dde-4d4c-abe3-e439c04b3187 · outbound

This paper cites Ethical and social risks of harm from Language Models.

Learning-Based Automated Adversarial Red-Teaming for Robustness Evaluation of Large Language Models Ethical and social risks of harm from Language Models

Reference 10

Resolution
metadata mismatch
local_arxiv, observed 2026-05-16T20:23:23.506473Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-02T06:30:47.504484+00:00.

source=pdf_text observed=2026-05-16T20:22:29.726790Z digest=sha256:c59ab9287c94adf310c15c7965bb0bff101c8300ac48039403e556eae06e9ef3

Observation 319ce88b-2abd-4e41-b083-0c7b5201173b · outbound

This paper cites an unresolved cited work.

Learning-Based Automated Adversarial Red-Teaming for Robustness Evaluation of Large Language Models Unresolved cited work

Reference 11

Resolution
unresolved
raw_fallback, observed 2026-05-16T20:23:24.119162Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-02T06:30:47.504484+00:00.

source=pdf_text observed=2026-05-16T20:22:29.726790Z digest=sha256:9ca488aedc82511e9d1db5141f693e00ed82cae471b2b1494c391f061438a256

Observation 4152c7c1-9b26-464d-ba8f-35c853a6d0e4 · outbound

This paper cites an unresolved cited work.

Learning-Based Automated Adversarial Red-Teaming for Robustness Evaluation of Large Language Models Unresolved cited work

Reference 12

Resolution
unresolved
raw_fallback, observed 2026-05-16T20:23:24.156340Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-02T06:30:47.504484+00:00.

source=pdf_text observed=2026-05-16T20:22:29.726790Z digest=sha256:2b7a4edcdab65342b87690ca5a9a932e2f1c118352d502a18888cc0e45dfdc17

Observation 5f81880f-7696-4e58-9b60-7b9d15a8c3a0 · outbound

This paper cites an unresolved cited work.

Learning-Based Automated Adversarial Red-Teaming for Robustness Evaluation of Large Language Models Unresolved cited work

Reference 13

Resolution
unresolved
raw_fallback, observed 2026-05-16T20:23:24.149116Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-02T06:30:47.504484+00:00.

source=pdf_text observed=2026-05-16T20:22:29.726790Z digest=sha256:6dd903c3572b9ad00f94d4a7ef3bd0858fa24146124c6f50d7a0640bb4c78be0

Observation 6b0ce669-c647-4e61-89b2-22f7f01fd34a · outbound

This paper cites "" 24returntemplate Listing 1: Data exfiltration attack generation template A.2 Sandbagging Templates 1defgenerate_sandbagging_template( task_domain): 2template = f.

Learning-Based Automated Adversarial Red-Teaming for Robustness Evaluation of Large Language Models "" 24returntemplate Listing 1: Data exfiltration attack generation template A.2 Sandbagging Templates 1defgenerate_sandbagging_template( task_domain): 2template = f

Reference 14

Resolution
verified fuzzy
raw_fallback, observed 2026-05-16T20:23:24.146486Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-02T06:30:47.504484+00:00.

source=pdf_text observed=2026-05-16T20:22:29.726790Z digest=sha256:2885f7c02bd11d6d55e727f965cb1a6618c4e92b3f72a43d91508e3b36a78547

Observation 3ecf64d1-1a65-4a2f-8ec6-73a8d7709b81 · outbound

This paper cites an unresolved cited work.

Learning-Based Automated Adversarial Red-Teaming for Robustness Evaluation of Large Language Models Unresolved cited work

Reference 15

Resolution
unresolved
raw_fallback, observed 2026-05-16T20:23:24.167205Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-02T06:30:47.504484+00:00.

source=pdf_text observed=2026-05-16T20:22:29.726790Z digest=sha256:13a1b26f840357d983179841887b8f8fc2220a51bf0795e907846499b527661d

Observation d4a66ce0-9bf3-47d4-beaf-be715c0d6fc1 · outbound

This paper cites an unresolved cited work.

Learning-Based Automated Adversarial Red-Teaming for Robustness Evaluation of Large Language Models Unresolved cited work

Reference 16

Resolution
unresolved
raw_fallback, observed 2026-05-16T20:23:24.164596Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-02T06:30:47.504484+00:00.

source=pdf_text observed=2026-05-16T20:22:29.726790Z digest=sha256:3d4c16860ee6b0c33e00651a3ddd27f5d38ab4f29a3eb968be250dd3698f88a6

Observation 51a8e40d-4412-4776-aace-6f9d3cf47f95 · outbound

This paper cites an unresolved cited work.

Learning-Based Automated Adversarial Red-Teaming for Robustness Evaluation of Large Language Models Unresolved cited work

Reference 17

Resolution
unresolved
raw_fallback, observed 2026-05-16T20:23:24.162165Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-02T06:30:47.504484+00:00.

source=pdf_text observed=2026-05-16T20:22:29.726790Z digest=sha256:00e870e2b26601d5add0bc253fd58091ac3b71a6a60ee59657586798387f17d6

Observation f9f49c49-dac6-4ffe-88f9-73f5b423d14a · outbound

This paper cites " 18returntemplate Listing 2: Sandbagging attack generation template A.3 Inappropriate Tool Use Templates 1defgenerate_tool_misuse_template(tool_name, usage_context): 2template = f.

Learning-Based Automated Adversarial Red-Teaming for Robustness Evaluation of Large Language Models " 18returntemplate Listing 2: Sandbagging attack generation template A.3 Inappropriate Tool Use Templates 1defgenerate_tool_misuse_template(tool_name, usage_context): 2template = f

Reference 18

Resolution
verified fuzzy
raw_fallback, observed 2026-05-16T20:23:24.125558Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-02T06:30:47.504484+00:00.

source=pdf_text observed=2026-05-16T20:22:29.726790Z digest=sha256:a07c8e65884505607fe9edd13d367955dba8aea1a0d226761166f522b84bc0e0

Observation a0342f47-783d-4eef-b45b-e25f06e9679b · outbound

This paper cites an unresolved cited work.

Learning-Based Automated Adversarial Red-Teaming for Robustness Evaluation of Large Language Models Unresolved cited work

Reference 19

Resolution
unresolved
raw_fallback, observed 2026-05-16T20:23:24.159220Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-02T06:30:47.504484+00:00.

source=pdf_text observed=2026-05-16T20:22:29.726790Z digest=sha256:f7d63678d48222eff63fd1cc4b7ee65c014f5188087e8d9aeab33bcf3a003849

Observation fed0c238-e3bc-47e8-ba31-efc09560a283 · outbound

This paper cites an unresolved cited work.

Learning-Based Automated Adversarial Red-Teaming for Robustness Evaluation of Large Language Models Unresolved cited work

Reference 20

Resolution
unresolved
raw_fallback, observed 2026-05-16T20:23:24.169730Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-02T06:30:47.504484+00:00.

source=pdf_text observed=2026-05-16T20:22:29.726790Z digest=sha256:b18dfe259afc01304181aaf7000d5888a83b2b311560295be4e8badd104f9127

Observation 50445822-c4d7-4d70-8c18-14b89c082b0d · outbound

This paper cites an unresolved cited work.

Learning-Based Automated Adversarial Red-Teaming for Robustness Evaluation of Large Language Models Unresolved cited work

Reference 21

Resolution
unresolved
raw_fallback, observed 2026-05-16T20:23:24.143369Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-02T06:30:47.504484+00:00.

source=pdf_text observed=2026-05-16T20:22:29.726790Z digest=sha256:f98ee7be96f19b20e91baecb2c4166cfc84c067fa5dc3fc417b60fa8822e53eb

Observation 0035dc87-f094-41d6-9b63-dc1c6b13028d · outbound

This paper cites an unresolved cited work.

Learning-Based Automated Adversarial Red-Teaming for Robustness Evaluation of Large Language Models Unresolved cited work

Reference 22

Resolution
unresolved
raw_fallback, observed 2026-05-16T20:23:24.128791Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-02T06:30:47.504484+00:00.

source=pdf_text observed=2026-05-16T20:22:29.726790Z digest=sha256:3f056c6a779b23053ab2ab71ed1eea590e6717a672497c06c5ab66e1101c80f7

Observation f21d96f9-a731-429b-ab46-f68e5fcba442 · outbound

This paper cites an unresolved cited work.

Learning-Based Automated Adversarial Red-Teaming for Robustness Evaluation of Large Language Models Unresolved cited work

Reference 23

Resolution
unresolved
raw_fallback, observed 2026-05-16T20:23:24.153692Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-02T06:30:47.504484+00:00.

source=pdf_text observed=2026-05-16T20:22:29.726790Z digest=sha256:ac0b1662a81badb2d0145710f43f74794cdc3763280f1e9d5be9f01fed9ed11f

Observation e5a2d740-7883-4945-bb99-eed0be85fbc9 · outbound

This paper cites an unresolved cited work.

Learning-Based Automated Adversarial Red-Teaming for Robustness Evaluation of Large Language Models Unresolved cited work

Reference 24

Resolution
unresolved
raw_fallback, observed 2026-05-16T20:23:24.134826Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-02T06:30:47.504484+00:00.

source=pdf_text observed=2026-05-16T20:22:29.726790Z digest=sha256:a07125b208af89a7e4158dc5579ba9ab5d915c55efcf0ae15612aec659125223

Observation 3a215295-4c8c-4d34-a6a9-ed4863ed8a08 · outbound

This paper cites an unresolved cited work.

Learning-Based Automated Adversarial Red-Teaming for Robustness Evaluation of Large Language Models Unresolved cited work

Reference 25

Resolution
unresolved
raw_fallback, observed 2026-05-16T20:23:24.151638Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-02T06:30:47.504484+00:00.

source=pdf_text observed=2026-05-16T20:22:29.726790Z digest=sha256:8488cc51b788599ce124c9a053acf49a7500d0e484cb8d33ae686cc86bd633af

Observation 47ced916-de59-45d9-aaa5-16391b75206a · outbound

This paper cites your-api-key-here.

Learning-Based Automated Adversarial Red-Teaming for Robustness Evaluation of Large Language Models your-api-key-here

Reference 26

Resolution
verified fuzzy
raw_fallback, observed 2026-05-16T20:23:24.132025Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-02T06:30:47.504484+00:00.

source=pdf_text observed=2026-05-16T20:22:29.726790Z digest=sha256:7805ea92380210a3b5ead888daf2cdc2fbd6cd56f8c34a3d2c5f94b69967e672

Pith citing papers

Observation 8bdc3a9f-8905-4235-95bc-bcdbf89d1307 · inbound

EVLA: An Electro-Aware Multimodal Assistant for Physically-Grounded Driving Reasoning and Control cites this paper.

EVLA: An Electro-Aware Multimodal Assistant for Physically-Grounded Driving Reasoning and Control Learning-Based Automated Adversarial Red-Teaming for Robustness Evaluation of Large Language Models

Reference 54

Resolution
verified exact
local_arxiv, observed 2026-06-30T10:04:36.332908Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-02T06:30:47.504484+00:00.

source=pdf_text observed=2026-06-30T09:57:12.402737Z digest=sha256:8661e812b36dd2d7f2baf93b296c6b0622fe34a3e777555a1ff1f474efb1ba41

Observation 2de3765d-1d6c-4f66-bac5-1998e88b5895 · inbound

A3M: Adaptive, Adversarial and Multi-Objective Learning for Strategic Bidding in Repeated Auctions cites this paper.

A3M: Adaptive, Adversarial and Multi-Objective Learning for Strategic Bidding in Repeated Auctions Learning-Based Automated Adversarial Red-Teaming for Robustness Evaluation of Large Language Models

Reference 18

Resolution
metadata mismatch
local_arxiv, observed 2026-06-30T09:54:34.414774Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-02T06:30:47.504484+00:00.

source=pdf_text observed=2026-06-30T09:54:05.683478Z digest=sha256:e9902995ec8e38cd36247c54d7d9978768e39f5edb1569a70c664a0fa32e3d6b

Observation c48e850b-fcdb-496f-885d-6be9914c966d · inbound

Beyond Skepticism: Evaluating LLMs Pedagogical Intent Reasoning with the Adaptive Pedagogical Vigilance Framework cites this paper.

Beyond Skepticism: Evaluating LLMs Pedagogical Intent Reasoning with the Adaptive Pedagogical Vigilance Framework Learning-Based Automated Adversarial Red-Teaming for Robustness Evaluation of Large Language Models

Reference 19

Resolution
metadata mismatch
local_arxiv, observed 2026-07-03T15:28:33.590391Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-02T06:30:47.504484+00:00.

source=pdf_text observed=2026-07-03T15:26:40.974564Z digest=sha256:ab0c29609527ebbaa62409decb792309b78a698a3a29cc0c2b492ac9a48d5aa0

Observation 58dfb0a0-46e7-4d5f-b52f-68758983d879 · inbound

FedCausal-Dyn: A Causal-Dynamic Paradigm for Federated Learning under Dynamic Feature Drift cites this paper.

FedCausal-Dyn: A Causal-Dynamic Paradigm for Federated Learning under Dynamic Feature Drift Learning-Based Automated Adversarial Red-Teaming for Robustness Evaluation of Large Language Models

Reference 14

Resolution
unresolved
no resolver link, observed 2026-07-14T17:36:18.728469Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-14T17:36:18.728469Z digest=sha256:0f003108454eac3ff040722492c8e74a4632b8b30eed148387935a1ec57be238