Pith. sign in

Paper Citation Record · LEDGER

Step-by-Step Reasoning Attack: Revealing 'Erased' Knowledge in Large Language Models

As of 8 August 2026, this Paper Citation Record lists 25 of 25 outbound references and 3 inbound Pith citation observations for arXiv:2506.17279.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2506.17279 v1

Coverage vector

measured 25 of 25 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links, observed 2026-08-07T00:56:31.634491Z

measured 28 of 28 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-07T06:34:17.273281+00:00

measured 3 of 3 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links, observed 2026-08-05T10:39:08.021275Z

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: arxiv_reference, observed 2026-05-20T14:13:21.270655Z

Reference resolution

25 of 25 outbound references displayed

  • verified exact1
  • verified fuzzy1
  • unresolved23
  • parse uncertain0
  • malformed identifier0
  • metadata mismatch0

External citation measurements

No source-named external measurement is stored.

Outbound references

Observation bdc8e59c-a7b5-4908-9109-9b292287dc29 · outbound

This paper cites Do Unlearning Methods Remove Information from Language Model Weights?.

Step-by-Step Reasoning Attack: Revealing 'Erased' Knowledge in Large Language Models Do Unlearning Methods Remove Information from Language Model Weights?

Reference 1

Resolution
unresolved
no resolver link, observed 2026-08-07T00:56:31.527816Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T00:56:31.527816Z digest=sha256:6a9df57debd41e7719f59f27e4ad53f98a03637ac872937b41365f9247e450da

Observation 02947c08-5ca2-44d0-86cb-7613044fa35a · outbound

This paper cites Mechanistic Unlearning: Robust Knowledge Unlearning and Editing via Mechanistic Localization.

Step-by-Step Reasoning Attack: Revealing 'Erased' Knowledge in Large Language Models Mechanistic Unlearning: Robust Knowledge Unlearning and Editing via Mechanistic Localization

Reference 3

Resolution
unresolved
no resolver link, observed 2026-08-07T00:56:31.537395Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T00:56:31.537395Z digest=sha256:e9da16caff96334c0aa31b78ba7f548fe23154ad701f01fe7ae7462a5f04945b

Observation f77c2003-eba1-430b-a78a-010de4ae4e1f · outbound

This paper cites Intrinsic Test of Unlearning Using Parametric Knowledge Traces.

Step-by-Step Reasoning Attack: Revealing 'Erased' Knowledge in Large Language Models Intrinsic Test of Unlearning Using Parametric Knowledge Traces

Reference 4

Resolution
unresolved
no resolver link, observed 2026-08-07T00:56:31.542059Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T00:56:31.542059Z digest=sha256:6b19bf3d7f7a4dd5d6d0d7ec4a0f8fa9036eac79085d3d608d7bed83534173da

Observation 8b8d6f30-4f26-4db6-aaab-f247156245e1 · outbound

This paper cites Unlearning or Obfuscating? Jogging the Memory of Unlearned LLMs via Benign Relearning.

Step-by-Step Reasoning Attack: Revealing 'Erased' Knowledge in Large Language Models Unlearning or Obfuscating? Jogging the Memory of Unlearned LLMs via Benign Relearning

Reference 5

Resolution
unresolved
no resolver link, observed 2026-08-07T00:56:31.546933Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T00:56:31.546933Z digest=sha256:5e88a2501c08bc044789b8e1db989367bcaddeec05c25b80da177dc588549990

Observation 56a68388-89da-41c6-ba31-0d16da8edfdb · outbound

This paper cites On Effects of Steering Latent Representation for Large Language Model Unlearning.

Step-by-Step Reasoning Attack: Revealing 'Erased' Knowledge in Large Language Models On Effects of Steering Latent Representation for Large Language Model Unlearning

Reference 6

Resolution
unresolved
no resolver link, observed 2026-08-07T00:56:31.551842Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T00:56:31.551842Z digest=sha256:a383d310edd3daeb038c1ed9a73c18b2afa9a41c066729275bc3e7064121ce53

Observation 361f8a32-4eee-409d-9ea1-fe5c2f0c8023 · outbound

This paper cites Knowledge Unlearning for Mitigating Privacy Risks in Language Models.

Step-by-Step Reasoning Attack: Revealing 'Erased' Knowledge in Large Language Models Knowledge Unlearning for Mitigating Privacy Risks in Language Models

Reference 7

Resolution
unresolved
no resolver link, observed 2026-08-07T00:56:31.556982Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T00:56:31.556982Z digest=sha256:417f1be1342242c00a67ec0003209328dc3c7912f506b4fff42097015e435d1c

Observation d9edc7df-58a0-4387-9c96-75a07e6a84bd · outbound

This paper cites WAGLE: Strategic Weight Attribution for Effective and Modular Unlearning in Large Language Models.

Step-by-Step Reasoning Attack: Revealing 'Erased' Knowledge in Large Language Models WAGLE: Strategic Weight Attribution for Effective and Modular Unlearning in Large Language Models

Reference 8

Resolution
unresolved
no resolver link, observed 2026-08-07T00:56:31.561334Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T00:56:31.561334Z digest=sha256:97ce7ee451e6a5dd40a21b3dd8c54b40139ce6f40d7bef05fd2db454cd903cb8

Observation 97392904-e4f6-4862-91f5-2e0fae35a55f · outbound

This paper cites An Adversarial Perspective on Machine Unlearning for AI Safety.

Step-by-Step Reasoning Attack: Revealing 'Erased' Knowledge in Large Language Models An Adversarial Perspective on Machine Unlearning for AI Safety

Reference 11

Resolution
unresolved
no resolver link, observed 2026-08-07T00:56:31.574139Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T00:56:31.574139Z digest=sha256:f400d27fd6881c5a78ef31ddad0fb5ebb14a49b81f5c0c00ea2c3ec499623f52

Observation 978c6968-bb87-44a6-88ef-92275a37f82d · outbound

This paper cites Eight Methods to Evaluate Robust Unlearning in LLMs.

Step-by-Step Reasoning Attack: Revealing 'Erased' Knowledge in Large Language Models Eight Methods to Evaluate Robust Unlearning in LLMs

Reference 12

Resolution
unresolved
no resolver link, observed 2026-08-07T00:56:31.579425Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T00:56:31.579425Z digest=sha256:355fdd1cda9a53fd52c6fd596c15f8ae02e6b3b352cb0a147a7e4eaf6ccc3e47

Observation fe641c6d-bf13-4359-9fbe-835593427b04 · outbound

This paper cites Can Sensitive Information Be Deleted From LLMs? Objectives for Defending Against Extraction Attacks.

Step-by-Step Reasoning Attack: Revealing 'Erased' Knowledge in Large Language Models Can Sensitive Information Be Deleted From LLMs? Objectives for Defending Against Extraction Attacks

Reference 14

Resolution
unresolved
no resolver link, observed 2026-08-07T00:56:31.588211Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T00:56:31.588211Z digest=sha256:0ab944fed9e99876974c41d98bcfd2d6603da951e814dc8ba3adbed3a3efcfc4

Observation 8da2733b-f91e-450c-97a0-ffd03518c0a9 · outbound

This paper cites In-Context Unlearning: Language Models as Few Shot Unlearners.

Step-by-Step Reasoning Attack: Revealing 'Erased' Knowledge in Large Language Models In-Context Unlearning: Language Models as Few Shot Unlearners

Reference 15

Resolution
unresolved
no resolver link, observed 2026-08-07T00:56:31.592736Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T00:56:31.592736Z digest=sha256:ca8aa4ec6440097e6cc3eb7eeca74a9dd91dbc9af6ae0210f874769abe3be40d

Observation fa1ed3a2-4b3b-4bf8-8531-354b349b83b2 · outbound

This paper cites Latent Adversarial Training Improves Robustness to Persistent Harmful Behaviors in LLMs.

Step-by-Step Reasoning Attack: Revealing 'Erased' Knowledge in Large Language Models Latent Adversarial Training Improves Robustness to Persistent Harmful Behaviors in LLMs

Reference 16

Resolution
unresolved
no resolver link, observed 2026-08-07T00:56:31.597065Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T00:56:31.597065Z digest=sha256:be24d7e51ffe9fdefae969361b49c57414ab027dcd04339a73227746ca3792c4

Observation a31b78f2-c335-4ec7-ac2d-52202a74f28b · outbound

This paper cites UnStar: Unlearning with Self-Taught Anti-Sample Reasoning for LLMs.

Step-by-Step Reasoning Attack: Revealing 'Erased' Knowledge in Large Language Models UnStar: Unlearning with Self-Taught Anti-Sample Reasoning for LLMs

Reference 17

Resolution
unresolved
no resolver link, observed 2026-08-07T00:56:31.601190Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T00:56:31.601190Z digest=sha256:c74bf0d87d81c8b1446443fdf692ce38d9547e15e0427bbfe1cbf913813323c3

Observation a075f13e-8f9b-48b1-990d-36327b68a518 · outbound

This paper cites Tamper-Resistant Safeguards for Open-Weight LLMs.

Step-by-Step Reasoning Attack: Revealing 'Erased' Knowledge in Large Language Models Tamper-Resistant Safeguards for Open-Weight LLMs

Reference 18

Resolution
unresolved
no resolver link, observed 2026-08-07T00:56:31.605239Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T00:56:31.605239Z digest=sha256:8174606ac1ba86831bc96de134abf25f17f07ba657f6ba70ad30fca8056e679c

Observation a8f9395b-f403-41bb-9ab1-90b50e17e52b · outbound

This paper cites Guardrail Baselines for Unlearning in LLMs.

Step-by-Step Reasoning Attack: Revealing 'Erased' Knowledge in Large Language Models Guardrail Baselines for Unlearning in LLMs

Reference 19

Resolution
unresolved
no resolver link, observed 2026-08-07T00:56:31.609281Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T00:56:31.609281Z digest=sha256:365e6ec421d7cf5ee1fb436f90b8b1b308548562be3e2abef87ef98bddcdeddf

Observation 7297988f-0490-4414-81ec-4e5c231f4afc · outbound

This paper cites RKLD: Reverse KL-Divergence-based Knowledge Distillation for Unlearning Personal Information in Large Language Models.

Step-by-Step Reasoning Attack: Revealing 'Erased' Knowledge in Large Language Models RKLD: Reverse KL-Divergence-based Knowledge Distillation for Unlearning Personal Information in Large Language Models

Reference 20

Resolution
unresolved
no resolver link, observed 2026-08-07T00:56:31.613263Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T00:56:31.613263Z digest=sha256:e226232f73f74bb625b5a478afffc493fb74234757ca8e3485e3d4db06ff8a3d

Observation c7869cbf-9904-4d29-8fe1-05e08742e9da · outbound

This paper cites Machine Unlearning of Pre-trained Large Language Models.

Step-by-Step Reasoning Attack: Revealing 'Erased' Knowledge in Large Language Models Machine Unlearning of Pre-trained Large Language Models

Reference 22

Resolution
unresolved
no resolver link, observed 2026-08-07T00:56:31.621944Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T00:56:31.621944Z digest=sha256:dcc0fc1d0f23cdf9dcceb0ef1580ff8582b858f7a2d18fbe294a10323cd69059

Observation 9653f7ae-a93f-44f8-8e55-67e2c55d42d7 · outbound

This paper cites A Closer Look at Machine Unlearning for Large Language Models.

Step-by-Step Reasoning Attack: Revealing 'Erased' Knowledge in Large Language Models A Closer Look at Machine Unlearning for Large Language Models

Reference 23

Resolution
unresolved
no resolver link, observed 2026-08-07T00:56:31.626205Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T00:56:31.626205Z digest=sha256:35969c7eac76ac38c089a8e34ecd31c8fee8944a9358c6f96688df0317008332

Observation 0c27cbc1-2030-4101-be4d-824e2aef4e9f · outbound

This paper cites Negative Preference Optimization: From Catastrophic Collapse to Effective Unlearning.

Step-by-Step Reasoning Attack: Revealing 'Erased' Knowledge in Large Language Models Negative Preference Optimization: From Catastrophic Collapse to Effective Unlearning

Reference 24

Resolution
unresolved
no resolver link, observed 2026-08-07T00:56:31.630394Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T00:56:31.630394Z digest=sha256:10c591a570f39a218b8596507a6f5c115c0bfdf1f00553c8179d683e220caab5

Observation fe3ca931-590b-402e-badc-7c0433c9f1dc · outbound

This paper cites Harry Potter and the Philosopher 's Stone.

Step-by-Step Reasoning Attack: Revealing 'Erased' Knowledge in Large Language Models Harry Potter and the Philosopher 's Stone

Reference 25

Resolution
verified fuzzy
raw_fallback, observed 2026-08-07T00:56:32.043817Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-07T00:56:31.634491Z digest=sha256:2f7a035c3d3a72d3130066773c74d32c55bf962ae3733b60b322a88086cab357

Observation b0eeba5d-c419-48ce-8f02-52dd2272fcce · outbound

This paper cites DEPN: Detecting and Editing Privacy Neurons in Pretrained Language Models.

Step-by-Step Reasoning Attack: Revealing 'Erased' Knowledge in Large Language Models DEPN: Detecting and Editing Privacy Neurons in Pretrained Language Models

Reference 2020

Resolution
unresolved
no resolver link, observed 2026-08-07T00:56:31.617645Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T00:56:31.617645Z digest=sha256:4f755c9b6276940005a2a1df913adf72d011663c9513f57bb33ac9725504c8c2

Observation adab6b89-3101-4e7b-af52-fb0761ecab07 · outbound

This paper cites Large Language Models Relearn Removed Concepts.

Step-by-Step Reasoning Attack: Revealing 'Erased' Knowledge in Large Language Models Large Language Models Relearn Removed Concepts

Reference 2022

Resolution
verified exact
local_arxiv, observed 2026-08-07T00:56:31.893913Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-08-07T00:56:31.569889Z digest=sha256:657a7a753f349751590796abf205b7f3435ec9f8f9422a2ea02157d28f46aed3

Observation 1264694a-a6e3-4e3c-8563-3c883efaee09 · outbound

This paper cites The WMDP Benchmark: Measuring and Reducing Malicious Use With Unlearning.

Step-by-Step Reasoning Attack: Revealing 'Erased' Knowledge in Large Language Models The WMDP Benchmark: Measuring and Reducing Malicious Use With Unlearning

Reference 2023

Resolution
unresolved
no resolver link, observed 2026-08-07T00:56:31.565579Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T00:56:31.565579Z digest=sha256:49390934844441b90ed2cedfd84ea0da360f2fb28f375a382504dfe36c2201fe

Observation 5517323e-66d1-4394-acfb-2d87c6448f53 · outbound

This paper cites UNDIAL: Self-Distillation with Adjusted Logits for Robust Unlearning in Large Language Models.

Step-by-Step Reasoning Attack: Revealing 'Erased' Knowledge in Large Language Models UNDIAL: Self-Distillation with Adjusted Logits for Robust Unlearning in Large Language Models

Reference 2024

Resolution
unresolved
no resolver link, observed 2026-08-07T00:56:31.532882Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T00:56:31.532882Z digest=sha256:113bc3f6bb11572c3c11f9c7037da6ab25a564d804bd7c2af166fd7e751a88a2

Observation fbab28a2-d095-43d5-86cb-bb37dfc44c79 · outbound

This paper cites TOFU: A Task of Fictitious Unlearning for LLMs.

Step-by-Step Reasoning Attack: Revealing 'Erased' Knowledge in Large Language Models TOFU: A Task of Fictitious Unlearning for LLMs

Reference 2025

Resolution
unresolved
no resolver link, observed 2026-08-07T00:56:31.583991Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T00:56:31.583991Z digest=sha256:234c474d7dc9852ce609b1d725d1ae2f8f24363a86dc10f0320f89d4c608760d

Pith citing papers

Observation a956a9d4-9a7b-4fd9-9529-87d41fb15614 · inbound

A Comprehensive Survey on Trustworthiness in Reasoning with Large Language Models cites this paper.

A Comprehensive Survey on Trustworthiness in Reasoning with Large Language Models Step-by-Step Reasoning Attack: Revealing 'Erased' Knowledge in Large Language Models

Reference 215

Resolution
unresolved
no resolver link, observed 2026-08-05T10:39:08.021275Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-05T10:39:08.021275Z digest=sha256:8ec629a9064857c38df60b5d9c63f506da1029fe33f54ffe6ecf903aa4dc8d0a

Observation db9a6592-5d7f-4966-bf8f-5cbc40517d7c · inbound

Downgrade to Upgrade: Optimizer Simplification Enhances Robustness in LLM Unlearning cites this paper.

Downgrade to Upgrade: Optimizer Simplification Enhances Robustness in LLM Unlearning Step-by-Step Reasoning Attack: Revealing 'Erased' Knowledge in Large Language Models

Reference 32

Resolution
metadata mismatch
arxiv_id, observed 2026-05-18T10:46:17.063339Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-05-18T10:44:53.516653Z digest=sha256:ec5ff00411e4255f91541ce586131b5174b614da081dd85316378dbee6b4596a

Observation 720ea40d-07bb-423f-8a62-a48eff257b4d · inbound

Auditing Reasoning-Trace Memorization Claims after Unlearning with Head-Conditioned Canaries cites this paper.

Auditing Reasoning-Trace Memorization Claims after Unlearning with Head-Conditioned Canaries Step-by-Step Reasoning Attack: Revealing 'Erased' Knowledge in Large Language Models

Reference 12

Resolution
verified exact
arxiv_id, observed 2026-05-20T14:13:21.272205Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.

source=pdf_text observed=2026-05-20T14:10:50.885027Z digest=sha256:055754f625acf3a45b16a2c2f422f4b69be81f35fbab837c204978844c570a89