Pith. sign in

Paper Citation Record · LEDGER

MTSA: Multi-turn Safety Alignment for LLMs through Multi-round Red-teaming

As of 7 August 2026, this Paper Citation Record lists 52 of 52 outbound references and 2 inbound Pith citation observations for arXiv:2505.17147.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2505.17147 v1

Coverage vector

measured 52 of 52 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links, observed 2026-08-07T15:10:00.855123Z

measured 54 of 54 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-07T06:34:17.273281+00:00

measured 2 of 2 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links, observed 2026-08-07T13:52:10.149504Z

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: arxiv_reference, observed 2026-05-12T00:51:14.865118Z

Reference resolution

52 of 52 outbound references displayed

  • verified exact0
  • verified fuzzy4
  • unresolved48
  • parse uncertain0
  • malformed identifier0
  • metadata mismatch0

External citation measurements

No source-named external measurement is stored.

Outbound references

Observation 370f6c27-0b54-4a7b-bc0b-ce73bdf917e4 · outbound

This paper cites URL: " 'urlintro :=.

MTSA: Multi-turn Safety Alignment for LLMs through Multi-round Red-teaming URL: " 'urlintro :=

Reference 1

Resolution
unresolved
no resolver link, observed 2026-08-07T15:09:56.963622Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T15:09:56.963622Z digest=sha256:a61c6cad0bb5e4e78d781298afe8cfced9935da9013ed64e9fbe1de0d33008e1

Observation 27ac559d-822e-45a7-abe1-9dacc21651a1 · outbound

This paper cites write newline.

MTSA: Multi-turn Safety Alignment for LLMs through Multi-round Red-teaming write newline

Reference 2

Resolution
unresolved
no resolver link, observed 2026-08-07T15:09:57.007507Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T15:09:57.007507Z digest=sha256:b549acb06c5e1d03970f1144d205642926543564d13a86e8dfb3e206c84dfe6f

Observation 07947925-13d9-4696-82d2-b06259c03b16 · outbound

This paper cites an unresolved cited work.

MTSA: Multi-turn Safety Alignment for LLMs through Multi-round Red-teaming Unresolved cited work

Reference 3

Resolution
unresolved
raw_fallback, observed 2026-08-07T15:10:06.715560Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=arxiv_source observed=2026-08-07T15:09:57.063650Z digest=sha256:73d50397bc5615fdd7e955874b53434f0f09d5c067b34166029bc22afe7b8659

Observation 2fb3b360-c282-4be5-b37b-6030c82cfd22 · outbound

This paper cites an unresolved cited work.

MTSA: Multi-turn Safety Alignment for LLMs through Multi-round Red-teaming Unresolved cited work

Reference 4

Resolution
unresolved
raw_fallback, observed 2026-08-07T15:10:06.499239Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=arxiv_source observed=2026-08-07T15:09:57.138929Z digest=sha256:5b0ba888e2ed8cb83efb424fd68464185687a0a2811781b19b40a08b34a1d252

Observation 9c403bfb-5285-4751-aa64-2441c5fbc7f0 · outbound

This paper cites an unresolved cited work.

MTSA: Multi-turn Safety Alignment for LLMs through Multi-round Red-teaming Unresolved cited work

Reference 5

Resolution
unresolved
raw_fallback, observed 2026-08-07T15:10:06.347583Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=arxiv_source observed=2026-08-07T15:09:57.180427Z digest=sha256:73ebbab4f56e8d2edc80866b9c8380363c49f9c6f1b3bf1b55380124b6d86890

Observation 634fa79b-81ca-4dbe-9899-d1b732efd882 · outbound

This paper cites Red-Teaming Large Language Models using Chain of Utterances for Safety-Alignment.

MTSA: Multi-turn Safety Alignment for LLMs through Multi-round Red-teaming Red-Teaming Large Language Models using Chain of Utterances for Safety-Alignment

Reference 6

Resolution
unresolved
no resolver link, observed 2026-08-07T15:09:57.250696Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T15:09:57.250696Z digest=sha256:7e8c3d22d361c7277411c5d972cba1735f99521da028dc1eb31c479cef275cb8

Observation eacdc5a2-025f-4210-b6b1-aa1da1ce19c1 · outbound

This paper cites On the Opportunities and Risks of Foundation Models.

MTSA: Multi-turn Safety Alignment for LLMs through Multi-round Red-teaming On the Opportunities and Risks of Foundation Models

Reference 7

Resolution
unresolved
no resolver link, observed 2026-08-07T15:09:57.354697Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T15:09:57.354697Z digest=sha256:fed130c49110b8dd7e488ca2c860ee70f8639b5345b8e72ef6f22b4c9913690b

Observation a21b1773-d13b-49e5-abfd-78712da6753c · outbound

This paper cites Jailbreaking Black Box Large Language Models in Twenty Queries.

MTSA: Multi-turn Safety Alignment for LLMs through Multi-round Red-teaming Jailbreaking Black Box Large Language Models in Twenty Queries

Reference 8

Resolution
unresolved
no resolver link, observed 2026-08-07T15:09:57.421212Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T15:09:57.421212Z digest=sha256:f90838770de187c6df0c96ed3949e251110f30cf2d72a28ef6a1978c06413a9c

Observation 5d848c47-51e3-4c7c-b205-b9ca331e406f · outbound

This paper cites Jordan, Joseph E.

MTSA: Multi-turn Safety Alignment for LLMs through Multi-round Red-teaming Jordan, Joseph E

Reference 9

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T15:10:06.198329Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=arxiv_source observed=2026-08-07T15:09:57.488202Z digest=sha256:386150d6e1e332da073365622259495f0f9f5cef13d20e41ee04290185baeb42

Observation 22001bba-9fe2-4c01-acdb-3d4481b544ac · outbound

This paper cites an unresolved cited work.

MTSA: Multi-turn Safety Alignment for LLMs through Multi-round Red-teaming Unresolved cited work

Reference 10

Resolution
unresolved
raw_fallback, observed 2026-08-07T15:10:06.012840Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=arxiv_source observed=2026-08-07T15:09:57.568999Z digest=sha256:0b8d0482d77d28b91ddc2ff1bf93604566206cd2cc5404e25217e22608b6fc3d

Observation 99d109ac-33cd-41ef-8dd2-50d3536f79cf · outbound

This paper cites an unresolved cited work.

MTSA: Multi-turn Safety Alignment for LLMs through Multi-round Red-teaming Unresolved cited work

Reference 11

Resolution
unresolved
raw_fallback, observed 2026-08-07T15:10:05.849993Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=arxiv_source observed=2026-08-07T15:09:57.669336Z digest=sha256:a4b7ba7dc7293c9aed1f481e094b8c7994ed8e6f5c2bade1aed7521835b76271

Observation 3923204f-6985-4d6d-a163-876ca658a468 · outbound

This paper cites an unresolved cited work.

MTSA: Multi-turn Safety Alignment for LLMs through Multi-round Red-teaming Unresolved cited work

Reference 12

Resolution
unresolved
no resolver link, observed 2026-08-07T15:09:57.774244Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T15:09:57.774244Z digest=sha256:2e5326bf05149026511a92764ca35269ddd8b1638f8fbfd8ded18525ed69557a

Observation c402c6f9-4ff3-4744-a270-c61aab2b1d75 · outbound

This paper cites an unresolved cited work.

MTSA: Multi-turn Safety Alignment for LLMs through Multi-round Red-teaming Unresolved cited work

Reference 13

Resolution
unresolved
raw_fallback, observed 2026-08-07T15:10:05.645151Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=arxiv_source observed=2026-08-07T15:09:57.865059Z digest=sha256:46745743fe24df18b0f1156a6326f2028b111fb1abe17b963be0f733ac1b9aaf

Observation 31ed0f54-2dde-41bf-8e3c-f3ce0bbd2c72 · outbound

This paper cites Hashimoto.

MTSA: Multi-turn Safety Alignment for LLMs through Multi-round Red-teaming Hashimoto

Reference 14

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T15:10:05.423535Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=arxiv_source observed=2026-08-07T15:09:57.930587Z digest=sha256:63bac15ad42eefa9a9b8a994b8c126b469966ec98fffa7861843623ce8f412bf

Observation f38d251a-7d53-45b6-b644-806c863f97f2 · outbound

This paper cites Red Teaming Language Models to Reduce Harms: Methods, Scaling Behaviors, and Lessons Learned.

MTSA: Multi-turn Safety Alignment for LLMs through Multi-round Red-teaming Red Teaming Language Models to Reduce Harms: Methods, Scaling Behaviors, and Lessons Learned

Reference 15

Resolution
unresolved
no resolver link, observed 2026-08-07T15:09:58.029795Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T15:09:58.029795Z digest=sha256:bb3e1e472bae0965b5c9b5ef5f515680035ac67d17bdcbeb8a0cad81341d3ae3

Observation b55d04a5-ee90-4a51-ac6e-0b1e20ca75a3 · outbound

This paper cites Andrew Bagnell, Jason D.

MTSA: Multi-turn Safety Alignment for LLMs through Multi-round Red-teaming Andrew Bagnell, Jason D

Reference 16

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T15:10:05.262986Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=arxiv_source observed=2026-08-07T15:09:58.127247Z digest=sha256:38e318a2b1660200ac6c46ec2f473933c0da0516dd57d10de1573a1fbc69d021

Observation b63126bd-5d10-465d-bd30-d7d590759502 · outbound

This paper cites Regressing the Relative Future: Efficient Policy Optimization for Multi-turn RLHF.

MTSA: Multi-turn Safety Alignment for LLMs through Multi-round Red-teaming Regressing the Relative Future: Efficient Policy Optimization for Multi-turn RLHF

Reference 17

Resolution
unresolved
no resolver link, observed 2026-08-07T15:09:58.196771Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T15:09:58.196771Z digest=sha256:421091e30d6ba705b0204c23b46e8e68f692708c04e965add3aeaab96bc4ef58

Observation d5062763-5daf-4bd9-8d69-e62c87e442e8 · outbound

This paper cites an unresolved cited work.

MTSA: Multi-turn Safety Alignment for LLMs through Multi-round Red-teaming Unresolved cited work

Reference 18

Resolution
unresolved
raw_fallback, observed 2026-08-07T15:10:04.983700Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=arxiv_source observed=2026-08-07T15:09:58.264264Z digest=sha256:697d20564bb08940ac696296232daa67a52f04dacb24d3f097dc911df13e3ead

Observation a2e2595a-006d-49e3-a101-166e2f6efd6e · outbound

This paper cites an unresolved cited work.

MTSA: Multi-turn Safety Alignment for LLMs through Multi-round Red-teaming Unresolved cited work

Reference 19

Resolution
unresolved
raw_fallback, observed 2026-08-07T15:10:04.767034Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=arxiv_source observed=2026-08-07T15:09:58.321337Z digest=sha256:8e8ae598e331d67a1e04c2a0a425c2025d66922e3792720c02e3039ebc450cf1

Observation 6f894b69-d7be-4710-a0a9-f5fe74358a9c · outbound

This paper cites Llama Guard: LLM-based Input-Output Safeguard for Human-AI Conversations.

MTSA: Multi-turn Safety Alignment for LLMs through Multi-round Red-teaming Llama Guard: LLM-based Input-Output Safeguard for Human-AI Conversations

Reference 20

Resolution
unresolved
no resolver link, observed 2026-08-07T15:09:58.418462Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T15:09:58.418462Z digest=sha256:e4b0895da89f708cc1cd284f2bd23d7d1e0523b8e63822db8f408773cebd5a86

Observation e349f15f-85a8-4845-a1ec-db80e8b5f095 · outbound

This paper cites PKU-SafeRLHF: Towards Multi-Level Safety Alignment for LLMs with Human Preference.

MTSA: Multi-turn Safety Alignment for LLMs through Multi-round Red-teaming PKU-SafeRLHF: Towards Multi-Level Safety Alignment for LLMs with Human Preference

Reference 21

Resolution
unresolved
no resolver link, observed 2026-08-07T15:09:58.475342Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T15:09:58.475342Z digest=sha256:84a4fbac7e85df850f674007d6195710e1df815dd6f9053d3e0ec13d574f2081

Observation 5702fe51-98d6-41a6-a27f-688b07977815 · outbound

This paper cites an unresolved cited work.

MTSA: Multi-turn Safety Alignment for LLMs through Multi-round Red-teaming Unresolved cited work

Reference 22

Resolution
unresolved
raw_fallback, observed 2026-08-07T15:10:04.493675Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=arxiv_source observed=2026-08-07T15:09:58.545108Z digest=sha256:9b9eb4c63f9994bd362f5124cf7005b8ef370f811a2eeece4097aab32ef33082

Observation 144e073f-4506-44e0-9c5e-f06ffb3a7060 · outbound

This paper cites RED QUEEN: Safeguarding Large Language Models against Concealed Multi-Turn Jailbreaking.

MTSA: Multi-turn Safety Alignment for LLMs through Multi-round Red-teaming RED QUEEN: Safeguarding Large Language Models against Concealed Multi-Turn Jailbreaking

Reference 23

Resolution
unresolved
no resolver link, observed 2026-08-07T15:09:58.602890Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T15:09:58.602890Z digest=sha256:64cd80c53eaee5190d2512c008ae7591797cdc681659c5a82b2a6b8da96b579c

Observation 616f2422-8b82-4055-896d-bd4797323f2f · outbound

This paper cites an unresolved cited work.

MTSA: Multi-turn Safety Alignment for LLMs through Multi-round Red-teaming Unresolved cited work

Reference 24

Resolution
unresolved
raw_fallback, observed 2026-08-07T15:10:04.236531Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=arxiv_source observed=2026-08-07T15:09:58.678082Z digest=sha256:957244a8a5d9f7c743a43eb76172305f73426e6bea08dcd8ce86cd5911148f61

Observation 72bacfc8-b1bf-48eb-979f-66cbf14f045e · outbound

This paper cites an unresolved cited work.

MTSA: Multi-turn Safety Alignment for LLMs through Multi-round Red-teaming Unresolved cited work

Reference 25

Resolution
unresolved
raw_fallback, observed 2026-08-07T15:10:04.064475Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=arxiv_source observed=2026-08-07T15:09:58.753646Z digest=sha256:c2fbcc6c804cc93ee2d15df94cdddcdff97a4efe9169e5866f9480fca68c0138

Observation ecb89aff-d995-4735-9d7b-8859bf9cf533 · outbound

This paper cites an unresolved cited work.

MTSA: Multi-turn Safety Alignment for LLMs through Multi-round Red-teaming Unresolved cited work

Reference 26

Resolution
unresolved
raw_fallback, observed 2026-08-07T15:10:03.923160Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=arxiv_source observed=2026-08-07T15:09:58.800204Z digest=sha256:d832ca36edc909dfec6fe8123ab04f9cacd822772497e677344602f8a3aff9b2

Observation d3962040-2111-4a15-87eb-fd55a83b7fa1 · outbound

This paper cites LLM Defenses Are Not Robust to Multi-Turn Human Jailbreaks Yet.

MTSA: Multi-turn Safety Alignment for LLMs through Multi-round Red-teaming LLM Defenses Are Not Robust to Multi-Turn Human Jailbreaks Yet

Reference 27

Resolution
unresolved
no resolver link, observed 2026-08-07T15:09:58.868771Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T15:09:58.868771Z digest=sha256:89326cec079b537810cb0dff3fdbd9555c0ed5ec07e17f1a26f327a775b65bb8

Observation c20827e5-dddc-4675-9d76-02d98d3062f6 · outbound

This paper cites Forsyth, and Dan Hendrycks.

MTSA: Multi-turn Safety Alignment for LLMs through Multi-round Red-teaming Forsyth, and Dan Hendrycks

Reference 28

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T15:10:03.775469Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=arxiv_source observed=2026-08-07T15:09:58.941758Z digest=sha256:f340ae05e91476c59d4602b9eca0e8e97853cded5a29cd273d447c73820a44d3

Observation fac77fe6-7328-4fc3-83ab-b5fb016e734b · outbound

This paper cites an unresolved cited work.

MTSA: Multi-turn Safety Alignment for LLMs through Multi-round Red-teaming Unresolved cited work

Reference 29

Resolution
unresolved
raw_fallback, observed 2026-08-07T15:10:03.633423Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=arxiv_source observed=2026-08-07T15:09:59.021839Z digest=sha256:60e630c24e938173f9e1ea2c24ce37c0c03e88d9e649796ff5b4264de5310533

Observation c0caadd6-b7f1-4635-bbc7-80f262a60f21 · outbound

This paper cites an unresolved cited work.

MTSA: Multi-turn Safety Alignment for LLMs through Multi-round Red-teaming Unresolved cited work

Reference 30

Resolution
unresolved
raw_fallback, observed 2026-08-07T15:10:03.511149Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=arxiv_source observed=2026-08-07T15:09:59.081474Z digest=sha256:53fe520ce05a03303f7ef67bde634b6917d066246bea8bde4de60e0b698d2de4

Observation 89468360-0c2b-4bec-ac43-f1e1f9f320ea · outbound

This paper cites an unresolved cited work.

MTSA: Multi-turn Safety Alignment for LLMs through Multi-round Red-teaming Unresolved cited work

Reference 31

Resolution
unresolved
raw_fallback, observed 2026-08-07T15:10:03.397297Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=arxiv_source observed=2026-08-07T15:09:59.139970Z digest=sha256:4f782986010dae84824a686d73c36739330fb26b7f7de29ad5bbecde0b4eaff4

Observation 5232bb5a-7382-4b1c-b01d-aa3c149f3f01 · outbound

This paper cites an unresolved cited work.

MTSA: Multi-turn Safety Alignment for LLMs through Multi-round Red-teaming Unresolved cited work

Reference 32

Resolution
unresolved
raw_fallback, observed 2026-08-07T15:10:03.254662Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=arxiv_source observed=2026-08-07T15:09:59.201509Z digest=sha256:68c4c6658d997b6266d2c879d168d413f02a5a5b47aa814d24dd1ccb7e7794f5

Observation 9d195be2-3133-4c57-b14d-3899e74a55da · outbound

This paper cites an unresolved cited work.

MTSA: Multi-turn Safety Alignment for LLMs through Multi-round Red-teaming Unresolved cited work

Reference 33

Resolution
unresolved
raw_fallback, observed 2026-08-07T15:10:03.079377Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=arxiv_source observed=2026-08-07T15:09:59.208815Z digest=sha256:ae3bcee254e4761a2adb6cac0e85ccec025f75f0a2c84b219b2d1adc85020c9a

Observation 869400ae-c070-4454-ac6f-fb30defd8f7f · outbound

This paper cites CodeAttack: Revealing Safety Generalization Challenges of Large Language Models via Code Completion.

MTSA: Multi-turn Safety Alignment for LLMs through Multi-round Red-teaming CodeAttack: Revealing Safety Generalization Challenges of Large Language Models via Code Completion

Reference 34

Resolution
unresolved
no resolver link, observed 2026-08-07T15:09:59.268315Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T15:09:59.268315Z digest=sha256:2886a918f3bd6ed55cbe0192bf7d5e88a695715745c1a8cc7711efc2079c7f03

Observation 74ad61f1-9b9b-4bd8-9595-6565181b8fa6 · outbound

This paper cites an unresolved cited work.

MTSA: Multi-turn Safety Alignment for LLMs through Multi-round Red-teaming Unresolved cited work

Reference 35

Resolution
unresolved
no resolver link, observed 2026-08-07T15:09:59.352531Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T15:09:59.352531Z digest=sha256:61b26c9082a84a049bf3b67d2aaad409f7723f2124e3971e57266538ac797f38

Observation bacfb82e-a93f-475f-b679-a0b2cfdb317d · outbound

This paper cites an unresolved cited work.

MTSA: Multi-turn Safety Alignment for LLMs through Multi-round Red-teaming Unresolved cited work

Reference 36

Resolution
unresolved
raw_fallback, observed 2026-08-07T15:10:02.935375Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=arxiv_source observed=2026-08-07T15:09:59.403344Z digest=sha256:4e12ea8bd1e22ad08ebd1fd6125115590aecc9e727086ce92faaf4a230033dec

Observation 645af586-99ea-45da-ade1-6c712a39fa56 · outbound

This paper cites an unresolved cited work.

MTSA: Multi-turn Safety Alignment for LLMs through Multi-round Red-teaming Unresolved cited work

Reference 37

Resolution
unresolved
raw_fallback, observed 2026-08-07T15:10:02.802459Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=arxiv_source observed=2026-08-07T15:09:59.486629Z digest=sha256:48d7c56dad37225b68cea3bc146c810c439ce3b5ccf0c12203a16d1d8c7e587c

Observation dfa55f94-2391-48d4-984f-40bb92c33aad · outbound

This paper cites Llama 2: Open Foundation and Fine-Tuned Chat Models.

MTSA: Multi-turn Safety Alignment for LLMs through Multi-round Red-teaming Llama 2: Open Foundation and Fine-Tuned Chat Models

Reference 38

Resolution
unresolved
no resolver link, observed 2026-08-07T15:09:59.567488Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T15:09:59.567488Z digest=sha256:8e45b929cc7f498efec4dfce593c27da35078335ca1d36bebb4d1e0bb1806e0d

Observation 23724971-57df-43b5-92ca-465cc323ef99 · outbound

This paper cites Zephyr: Direct Distillation of LM Alignment.

MTSA: Multi-turn Safety Alignment for LLMs through Multi-round Red-teaming Zephyr: Direct Distillation of LM Alignment

Reference 39

Resolution
unresolved
no resolver link, observed 2026-08-07T15:09:59.651113Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T15:09:59.651113Z digest=sha256:13e5c451b1db7718d3e1bfae396c65f4565f7529e39f313be70ce3e2c7fd438b

Observation e5b78338-d202-46a2-b22b-b62154034177 · outbound

This paper cites MRJ-Agent: An Effective Jailbreak Agent for Multi-Round Dialogue.

MTSA: Multi-turn Safety Alignment for LLMs through Multi-round Red-teaming MRJ-Agent: An Effective Jailbreak Agent for Multi-Round Dialogue

Reference 40

Resolution
unresolved
no resolver link, observed 2026-08-07T15:09:59.739555Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T15:09:59.739555Z digest=sha256:3351dc236b4a58e7d7ed8c653e589b31de1039622c705a161dd77cc739ca689f

Observation 3a1f95be-e5fa-4c68-99fa-1bd24cf02db7 · outbound

This paper cites an unresolved cited work.

MTSA: Multi-turn Safety Alignment for LLMs through Multi-round Red-teaming Unresolved cited work

Reference 41

Resolution
unresolved
raw_fallback, observed 2026-08-07T15:10:02.650315Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=arxiv_source observed=2026-08-07T15:09:59.837640Z digest=sha256:9898b95248aa8fab16fe7c900b18c7940f3b5f0491303c8fddbbc66e209c0ca8

Observation 338590b3-d24c-4faf-bf56-9d251942cf9c · outbound

This paper cites Interpretable Preferences via Multi-Objective Reward Modeling and Mixture-of-Experts.

MTSA: Multi-turn Safety Alignment for LLMs through Multi-round Red-teaming Interpretable Preferences via Multi-Objective Reward Modeling and Mixture-of-Experts

Reference 42

Resolution
unresolved
no resolver link, observed 2026-08-07T15:09:59.967922Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T15:09:59.967922Z digest=sha256:5b47fb5444f95e3e674d2bfa35fac4f50a599a7dd2497da5572000b18186fbef

Observation 4b235917-219e-4183-8206-cf381420c572 · outbound

This paper cites an unresolved cited work.

MTSA: Multi-turn Safety Alignment for LLMs through Multi-round Red-teaming Unresolved cited work

Reference 43

Resolution
unresolved
raw_fallback, observed 2026-08-07T15:10:02.498889Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=arxiv_source observed=2026-08-07T15:10:00.084624Z digest=sha256:617e9226444f9cbb428ab5ddf65744c031b32d9d04923cc5e89c0964bf277991

Observation 453c21f6-c9d4-4f28-9434-5ccbde68cfbc · outbound

This paper cites Chain of Attack: a Semantic-Driven Contextual Multi-Turn attacker for LLM.

MTSA: Multi-turn Safety Alignment for LLMs through Multi-round Red-teaming Chain of Attack: a Semantic-Driven Contextual Multi-Turn attacker for LLM

Reference 44

Resolution
unresolved
no resolver link, observed 2026-08-07T15:10:00.204245Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T15:10:00.204245Z digest=sha256:a2c79f5f2c191c2debfcbf52c0db1aff717877d43e5583cb07243fd15b4d1ea1

Observation 40452fce-84cf-4c57-b4d4-31100f728b75 · outbound

This paper cites an unresolved cited work.

MTSA: Multi-turn Safety Alignment for LLMs through Multi-round Red-teaming Unresolved cited work

Reference 45

Resolution
unresolved
raw_fallback, observed 2026-08-07T15:10:02.355727Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=arxiv_source observed=2026-08-07T15:10:00.280695Z digest=sha256:f7565bb156023974b80a1b8eda5d08e26197f7add1b577b7e38c70391c75f834

Observation fce1c202-ff39-4dc0-9fdb-aef83900a238 · outbound

This paper cites an unresolved cited work.

MTSA: Multi-turn Safety Alignment for LLMs through Multi-round Red-teaming Unresolved cited work

Reference 46

Resolution
unresolved
raw_fallback, observed 2026-08-07T15:10:02.214144Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=arxiv_source observed=2026-08-07T15:10:00.349424Z digest=sha256:8c027488011cb06ec3db6cba3ecee728eb288903fc6e7d9951aac6de9d3de033

Observation 58cfc874-e189-40d3-ac34-aa2f2e3f0fe3 · outbound

This paper cites an unresolved cited work.

MTSA: Multi-turn Safety Alignment for LLMs through Multi-round Red-teaming Unresolved cited work

Reference 47

Resolution
unresolved
raw_fallback, observed 2026-08-07T15:10:02.023586Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=arxiv_source observed=2026-08-07T15:10:00.414481Z digest=sha256:30fbea0945e54d7a550080323af8adc7325a30f7ed284596e11eae6f81d2a70b

Observation 8adf8ec1-bc0e-40b8-a5f0-d5e279bd62db · outbound

This paper cites an unresolved cited work.

MTSA: Multi-turn Safety Alignment for LLMs through Multi-round Red-teaming Unresolved cited work

Reference 48

Resolution
unresolved
raw_fallback, observed 2026-08-07T15:10:01.861238Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=arxiv_source observed=2026-08-07T15:10:00.474527Z digest=sha256:2b983703333135647ecd5f0a96f51a8b132d8dfcd21a1a7069ad055229ef3cc5

Observation 41e3c5a3-76bc-42c6-8527-d091cfe4607c · outbound

This paper cites an unresolved cited work.

MTSA: Multi-turn Safety Alignment for LLMs through Multi-round Red-teaming Unresolved cited work

Reference 49

Resolution
unresolved
raw_fallback, observed 2026-08-07T15:10:01.710331Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=arxiv_source observed=2026-08-07T15:10:00.535606Z digest=sha256:b7f70eadacb807b2451bf8b2d5fd57da1529f10e29e004d488f9fbaab316ef10

Observation 5cec1053-697b-454d-848e-be7376c889c7 · outbound

This paper cites Toward Optimal LLM Alignments Using Two-Player Games.

MTSA: Multi-turn Safety Alignment for LLMs through Multi-round Red-teaming Toward Optimal LLM Alignments Using Two-Player Games

Reference 50

Resolution
unresolved
no resolver link, observed 2026-08-07T15:10:00.597853Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T15:10:00.597853Z digest=sha256:e0b360b2e83906c3f973384791d8c2b2ad1421bfab6985b1aa1ff8cd000b8904

Observation 3c72e4ea-60aa-4739-8e22-890ddbbf8e9b · outbound

This paper cites Speak Out of Turn: Safety Vulnerability of Large Language Models in Multi-turn Dialogue.

MTSA: Multi-turn Safety Alignment for LLMs through Multi-round Red-teaming Speak Out of Turn: Safety Vulnerability of Large Language Models in Multi-turn Dialogue

Reference 51

Resolution
unresolved
no resolver link, observed 2026-08-07T15:10:00.679009Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T15:10:00.679009Z digest=sha256:be6abdd43a9a15faf160178ea665d80f86e1606a92cd083205c12c7a32f9a857

Observation f49d1f24-9748-486d-b97b-7b0191cdbc5f · outbound

This paper cites Universal and Transferable Adversarial Attacks on Aligned Language Models.

MTSA: Multi-turn Safety Alignment for LLMs through Multi-round Red-teaming Universal and Transferable Adversarial Attacks on Aligned Language Models

Reference 53

Resolution
unresolved
no resolver link, observed 2026-08-07T15:10:00.855123Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T15:10:00.855123Z digest=sha256:3ca1f552b6a601046cd4a4d9cbdaba27dfc2a5476f43622c8343288e67484de1

Pith citing papers

Observation af102b2c-da78-4133-a5bb-675f913bb89a · inbound

Multi-objective Large Language Model Alignment with Hierarchical Experts cites this paper.

Multi-objective Large Language Model Alignment with Hierarchical Experts MTSA: Multi-turn Safety Alignment for LLMs through Multi-round Red-teaming

Reference 14

Resolution
unresolved
no resolver link, observed 2026-08-07T13:52:10.149504Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T13:52:10.149504Z digest=sha256:b8a7713d5ed1a326972a902091b1343df3e03368d8ceabde07c4056e0bf21d89

Observation f6df5638-f913-4493-8d08-7943b385fb60 · inbound

Mitigating Many-shot Jailbreak Attacks with One Single Demonstration cites this paper.

Mitigating Many-shot Jailbreak Attacks with One Single Demonstration MTSA: Multi-turn Safety Alignment for LLMs through Multi-round Red-teaming

Reference 19

Resolution
verified exact
arxiv_id, observed 2026-05-12T00:51:14.868089Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-05-12T00:50:19.648405Z digest=sha256:d65bcc2c4358ff0f9e7c7f56ec5340d7dbdf671c6353b41d45cb562430767ece