Pith. sign in

Paper Citation Record · LEDGER

FLIRT: Feedback Loop In-context Red Teaming

As of 20 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 10 inbound Pith citation observations for arXiv:2308.04265.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2308.04265 v2

Coverage vector

measured 0 of 0 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links

measured 10 of 10 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-20T06:33:59.587034+00:00

measured 10 of 10 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links, observed 2026-08-12T11:05:51.565841Z

measured 1 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: arxiv_reference, observed 2026-08-05T02:28:24.338817Z

Reference resolution

0 of 0 outbound references displayed

  • verified exact0
  • verified fuzzy0
  • unresolved0
  • parse uncertain0
  • malformed identifier0
  • metadata mismatch0

External citation measurements

2
arxiv_reference, observed 2026-08-05T02:28:24.338817Z

Outbound references

No outbound reference observations are available for this paper version.

Pith citing papers

Observation 0e7b5027-c20d-4e20-9579-fcdc3731d431 · inbound

Baseline Defenses for Adversarial Attacks Against Aligned Language Models cites this paper.

Baseline Defenses for Adversarial Attacks Against Aligned Language Models FLIRT: Feedback Loop In-context Red Teaming

Reference 35

Resolution
verified exact
arxiv_id, observed 2026-05-13T23:24:40.009575Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=arxiv_source observed=2026-05-13T23:24:39.835347Z digest=sha256:ec9e16163a6e43c6f2e359941f7d697440d921d8cc9b84bc8320f57136608d63

Observation cacdbdeb-e6c3-40b1-8b0c-c6a340e0b78b · inbound

Embodied Red Teaming for Auditing Robotic Foundation Models cites this paper.

Embodied Red Teaming for Auditing Robotic Foundation Models FLIRT: Feedback Loop In-context Red Teaming

Reference 13

Resolution
unresolved
no resolver link, observed 2026-08-12T11:05:51.565841Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T11:05:51.565841Z digest=sha256:508ca44b552109656c756c8690ec960c0569da255200eb0afc3ac9d47d629df0

Observation 09bbcd8c-7e3d-4ced-bf44-2009e7442633 · inbound

LIAR: Leveraging Inference Time Alignment (Best-of-N) to Jailbreak LLMs in Seconds cites this paper.

LIAR: Leveraging Inference Time Alignment (Best-of-N) to Jailbreak LLMs in Seconds FLIRT: Feedback Loop In-context Red Teaming

Reference 47

Resolution
unresolved
no resolver link, observed 2026-08-11T20:53:37.621009Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-11T20:53:37.621009Z digest=sha256:a50a166b8852f6eda3659c3f297a29d8bba4388e3d731c05343f13672cb5bc34

Observation 982ef8cc-470e-4f0a-bd50-3f8e1e46ee80 · inbound

Diverse and Effective Red Teaming with Auto-generated Rewards and Multi-step Reinforcement Learning cites this paper.

Diverse and Effective Red Teaming with Auto-generated Rewards and Multi-step Reinforcement Learning FLIRT: Feedback Loop In-context Red Teaming

Reference 12

Resolution
unresolved
no resolver link, observed 2026-08-11T04:38:36.687422Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-11T04:38:36.687422Z digest=sha256:1dbfc7e61fe6175ec4a15e96f73ee693e9ecfb108087461787ee4d7b2214217e

Observation e1bb9e20-a128-4da7-8e2a-d6ba569f63da · inbound

InfAlign: Inference-aware language model alignment cites this paper.

InfAlign: Inference-aware language model alignment FLIRT: Feedback Loop In-context Red Teaming

Reference 35

Resolution
unresolved
no resolver link, observed 2026-08-10T23:57:54.319477Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-10T23:57:54.319477Z digest=sha256:050111103bd6dc621c29f9514f635b7025814ec09b3bdf546258d6f3199aaeb1

Observation 6f6d8fb7-5a11-4b16-99ad-3b65eacf2707 · inbound

AdvAnchor: Enhancing Diffusion Model Unlearning with Adversarial Anchors cites this paper.

AdvAnchor: Enhancing Diffusion Model Unlearning with Adversarial Anchors FLIRT: Feedback Loop In-context Red Teaming

Reference 29

Resolution
unresolved
no resolver link, observed 2026-08-10T23:43:48.109080Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-10T23:43:48.109080Z digest=sha256:39a5833cb35129873445125b232b11c1193d8e7eeae67979dc7760e8ccf16b12

Observation 2fe14311-d545-4959-9c7f-6509a9fe045c · inbound

Text-Diffusion Red-Teaming of Large Language Models: Unveiling Harmful Behaviors with Proximity Constraints cites this paper.

Text-Diffusion Red-Teaming of Large Language Models: Unveiling Harmful Behaviors with Proximity Constraints FLIRT: Feedback Loop In-context Red Teaming

Reference 24

Resolution
unresolved
no resolver link, observed 2026-08-10T20:34:36.533947Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-10T20:34:36.533947Z digest=sha256:94509c537d240573e3f1fc832cbe633ff623d112d25ff1feed33ef6df5f5d90e

Observation 55a3f150-df7d-4a69-9811-372621586bb6 · inbound

Layer-Wise Perturbations via Sparse Autoencoders for Adversarial Text Generation cites this paper.

Layer-Wise Perturbations via Sparse Autoencoders for Adversarial Text Generation FLIRT: Feedback Loop In-context Red Teaming

Reference 108

Resolution
unresolved
no resolver link, observed 2026-08-05T20:31:42.956731Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-05T20:31:42.956731Z digest=sha256:46bbfdd49116a18105bbd456cd79cddfb0fc21699dcf1ab3d54e8a4dbc94f799

Observation dc764439-8a44-4e88-95b7-ec1d378ff20f · inbound

MoGU V2: Toward a Higher Pareto Frontier Between Model Usability and Security cites this paper.

MoGU V2: Toward a Higher Pareto Frontier Between Model Usability and Security FLIRT: Feedback Loop In-context Red Teaming

Reference 6

Resolution
unresolved
no resolver link, observed 2026-08-04T23:09:41.429359Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-04T23:09:41.429359Z digest=sha256:a8266004a45fe7cc3a93893641aad758c70f3a7ba5d5dd3e3c55dac8266bf43c

Observation 459c20a9-31fc-48e5-a54d-ebe6b21861b0 · inbound

Adversarial Diffusion Across Modalities: A Fusion Survey of Attacks, Defenses, and Evaluation for Text, Vision, and Vision-Language Models cites this paper.

Adversarial Diffusion Across Modalities: A Fusion Survey of Attacks, Defenses, and Evaluation for Text, Vision, and Vision-Language Models FLIRT: Feedback Loop In-context Red Teaming

Reference 45

Resolution
verified exact
arxiv_id, observed 2026-07-04T13:59:52.959926Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-06-26T04:35:51.583460Z digest=sha256:5f8e1db88309bb81b98a6ef2fd7cf59c2f3e922169a1c6b492d7f10441333411