{"as_of":"2026-08-08T09:09:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:db46f5b3e6d20c942b2014d9c5a5ef87a1d538da8b807d9f1a76a8c3b4d7ca86","coverage":[{"denominator":48,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":48,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T00:18:53.661855Z","state":"measured"},{"denominator":48,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":48,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.01414/citation-record","integrity":"/paper/2608.01414/integrity","json":"/paper/2608.01414/citation-record.json","paper":"/paper/2608.01414"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2412.08905","last_updated":"2024-12-12T03:37:41Z","snapshot_observed_at":"2026-08-05T04:04:21.846023Z","submitted_at":"2024-12-12T03:37:41Z","title":"Phi-4 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.08905","snapshot_observed_at":"2026-08-06T00:18:47.641655Z","title":"Hewett, Mojan Javaheripi, Piero Kauffmann, et al","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.01414","last_updated":"2026-08-02T17:49:07Z","snapshot_observed_at":"2026-08-07T18:38:51.455203Z","submitted_at":"2026-08-02T17:49:07Z","title":"No Single Neuron of Failure: Distributed Safety Alignment Against White-Box Attacks","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T00:18:47.641655Z"},"links":{"cited_paper":"/paper/2412.08905","citing_paper":"/paper/2608.01414"},"observation_digest":"sha256:755f68ed80eca483f9434a6e597a53d8e29a9381f4279011c995cb11c0dcc864","observation_id":"1f600858-8d64-49c6-a2d6-d67d271eb025","resolution":{"observed_at":"2026-08-06T00:18:47.641655Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:19:01.041255Z","title":"Refusal in language models is mediated by a single direction","venue":null,"work_id":"f4768d55-3928-440b-9a8c-84c46c076245","year":2024},"citing_paper":{"arxiv_id":"2608.01414","last_updated":"2026-08-02T17:49:07Z","snapshot_observed_at":"2026-08-07T18:38:51.455203Z","submitted_at":"2026-08-02T17:49:07Z","title":"No Single Neuron of Failure: Distributed Safety Alignment Against White-Box Attacks","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T00:18:47.790026Z"},"links":{"citing_paper":"/paper/2608.01414"},"observation_digest":"sha256:ed4247a7355102271f2860069caf0e397e94cb49b4786fd522a5c9bad44ef0a3","observation_id":"90e3ad4a-aa29-4c3c-8322-fc053dbcbf88","resolution":{"observed_at":"2026-08-06T00:19:01.147174Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:18:47.909570Z","title":"Qwen technical report, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.01414","last_updated":"2026-08-02T17:49:07Z","snapshot_observed_at":"2026-08-07T18:38:51.455203Z","submitted_at":"2026-08-02T17:49:07Z","title":"No Single Neuron of Failure: Distributed Safety Alignment Against White-Box Attacks","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T00:18:47.909570Z"},"links":{"citing_paper":"/paper/2608.01414"},"observation_digest":"sha256:b8ad564a201bd906e3fa00790310f0d8359f23a4979c24773a30f05990c0b6b2","observation_id":"84f80de4-8a14-447b-9b6a-96163838e204","resolution":{"observed_at":"2026-08-06T00:18:47.909570Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:18:48.015481Z","title":"Qwen2.5-vl technical report, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.01414","last_updated":"2026-08-02T17:49:07Z","snapshot_observed_at":"2026-08-07T18:38:51.455203Z","submitted_at":"2026-08-02T17:49:07Z","title":"No Single Neuron of Failure: Distributed Safety Alignment Against White-Box Attacks","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T00:18:48.015481Z"},"links":{"citing_paper":"/paper/2608.01414"},"observation_digest":"sha256:f54c23eb80f4833314cd11377ec230c968ea7ff901c0201cb4b5d33df751b1de","observation_id":"4074e66f-a830-4527-aeae-d624851a7bd2","resolution":{"observed_at":"2026-08-06T00:18:48.015481Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2204.05862","last_updated":"2022-04-12T15:02:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-04-12T15:02:38Z","title":"Training a Helpful and Harmless Assistant with Reinforcement Learning from Human Feedback","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.05862","snapshot_observed_at":"2026-08-06T00:18:48.167155Z","title":"Training a helpful and harmless assistant with reinforcement learning from human feedback.arXiv preprint arXiv:2204.05862, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.01414","last_updated":"2026-08-02T17:49:07Z","snapshot_observed_at":"2026-08-07T18:38:51.455203Z","submitted_at":"2026-08-02T17:49:07Z","title":"No Single Neuron of Failure: Distributed Safety Alignment Against White-Box Attacks","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T00:18:48.167155Z"},"links":{"cited_paper":"/paper/2204.05862","citing_paper":"/paper/2608.01414"},"observation_digest":"sha256:e331fb22fb6f056674a5bea62eda2692bbdc96e74b02cad25d98d586bfb03369","observation_id":"1ce0f009-250b-4a6d-9397-5e55f263ec5f","resolution":{"observed_at":"2026-08-06T00:18:48.167155Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.14082","last_updated":"2024-08-23T23:02:28Z","snapshot_observed_at":"2026-07-06T18:03:38.397804Z","submitted_at":"2024-04-22T11:01:51Z","title":"Mechanistic Interpretability for AI Safety -- A Review","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.14082","snapshot_observed_at":"2026-08-06T00:18:48.335534Z","title":"Mechanistic interpretability for ai safety–a review.arXiv preprint arXiv:2404.14082, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.01414","last_updated":"2026-08-02T17:49:07Z","snapshot_observed_at":"2026-08-07T18:38:51.455203Z","submitted_at":"2026-08-02T17:49:07Z","title":"No Single Neuron of Failure: Distributed Safety Alignment Against White-Box Attacks","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T00:18:48.335534Z"},"links":{"cited_paper":"/paper/2404.14082","citing_paper":"/paper/2608.01414"},"observation_digest":"sha256:01cbfe1082e8c0af9a5969606b8b60b2b8ab8cfc25afe18b6fec88287d75ac3a","observation_id":"3c523e77-2bcf-4195-86f6-0f3d87f8611d","resolution":{"observed_at":"2026-08-06T00:18:48.335534Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:18:48.427125Z","title":"Language models are Homer simpson! safety re-alignment of fine-tuned language models through task arithmetic","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.01414","last_updated":"2026-08-02T17:49:07Z","snapshot_observed_at":"2026-08-07T18:38:51.455203Z","submitted_at":"2026-08-02T17:49:07Z","title":"No Single Neuron of Failure: Distributed Safety Alignment Against White-Box Attacks","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T00:18:48.427125Z"},"links":{"citing_paper":"/paper/2608.01414"},"observation_digest":"sha256:8e34a42cd84be31471fb88ed9b545cfaf1361081d5ff766f36fdc283328c4d60","observation_id":"3c2733ef-2b62-43f7-8dba-730a14994635","resolution":{"observed_at":"2026-08-06T00:18:48.427125Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.09662","last_updated":"2023-08-30T10:21:00Z","snapshot_observed_at":"2026-08-06T17:01:00.147032Z","submitted_at":"2023-08-18T16:27:04Z","title":"Red-Teaming Large Language Models using Chain of Utterances for Safety-Alignment","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.09662","snapshot_observed_at":"2026-08-06T00:18:48.516596Z","title":"Red-teaming large language models using chain of utterances for safety-alignment.arXiv preprint arXiv:2308.09662, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.01414","last_updated":"2026-08-02T17:49:07Z","snapshot_observed_at":"2026-08-07T18:38:51.455203Z","submitted_at":"2026-08-02T17:49:07Z","title":"No Single Neuron of Failure: Distributed Safety Alignment Against White-Box Attacks","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T00:18:48.516596Z"},"links":{"cited_paper":"/paper/2308.09662","citing_paper":"/paper/2608.01414"},"observation_digest":"sha256:4c74161d2c26c74be4722b5138cb14a2851d627102a5f24b68afca790341aabe","observation_id":"a8e4ed37-5070-4455-b867-09c47f93ea5b","resolution":{"observed_at":"2026-08-06T00:18:48.516596Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:19:00.666177Z","title":"Brown et al","venue":null,"work_id":"48970c7d-da05-4b85-ab58-0e1a98585915","year":1901},"citing_paper":{"arxiv_id":"2608.01414","last_updated":"2026-08-02T17:49:07Z","snapshot_observed_at":"2026-08-07T18:38:51.455203Z","submitted_at":"2026-08-02T17:49:07Z","title":"No Single Neuron of Failure: Distributed Safety Alignment Against White-Box Attacks","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T00:18:48.616841Z"},"links":{"citing_paper":"/paper/2608.01414"},"observation_digest":"sha256:90372f91463ee3a893364ad80a299ad75efb27618c88cce33e18e436337f1a56","observation_id":"392568be-bb36-4c6b-a44b-9b8c8ead0abb","resolution":{"observed_at":"2026-08-06T00:19:00.861651Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:19:00.373148Z","title":"Towards understanding safety alignment: A mechanistic perspective from safety neurons","venue":null,"work_id":"8f7b3473-2dcc-492b-9957-da667d3b4111","year":2025},"citing_paper":{"arxiv_id":"2608.01414","last_updated":"2026-08-02T17:49:07Z","snapshot_observed_at":"2026-08-07T18:38:51.455203Z","submitted_at":"2026-08-02T17:49:07Z","title":"No Single Neuron of Failure: Distributed Safety Alignment Against White-Box Attacks","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T00:18:48.747271Z"},"links":{"citing_paper":"/paper/2608.01414"},"observation_digest":"sha256:48550440c1efba8ea6b24fc093285230f2e2cf50050bcbd155152dfb72f5e44c","observation_id":"a82b5044-2036-4a88-b5c9-3d237b593f6e","resolution":{"observed_at":"2026-08-06T00:19:00.512350Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:18:59.956020Z","title":"Think you have solved question answering? try ARC, the AI2 reasoning challenge, 2018","venue":null,"work_id":"5089d025-a3ca-40ac-9a58-9079805b6948","year":2018},"citing_paper":{"arxiv_id":"2608.01414","last_updated":"2026-08-02T17:49:07Z","snapshot_observed_at":"2026-08-07T18:38:51.455203Z","submitted_at":"2026-08-02T17:49:07Z","title":"No Single Neuron of Failure: Distributed Safety Alignment Against White-Box Attacks","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T00:18:48.913473Z"},"links":{"citing_paper":"/paper/2608.01414"},"observation_digest":"sha256:0d9b800e11e9bb87df95e6c3324f3680a25b47e1c7240f38a3e1699f30d53dd9","observation_id":"099a1440-6997-43b3-840a-86ce3e9ea498","resolution":{"observed_at":"2026-08-06T00:19:00.155206Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:18:49.043158Z","title":"Training verifiers to solve math word problems, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.01414","last_updated":"2026-08-02T17:49:07Z","snapshot_observed_at":"2026-08-07T18:38:51.455203Z","submitted_at":"2026-08-02T17:49:07Z","title":"No Single Neuron of Failure: Distributed Safety Alignment Against White-Box Attacks","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T00:18:49.043158Z"},"links":{"citing_paper":"/paper/2608.01414"},"observation_digest":"sha256:82c2a5fa1f3a01aaba92d3a6ffea46fcc4605bca8074dc81660e14c355591ec5","observation_id":"d799eba4-ccc5-4f82-8abb-6a5162de9a0f","resolution":{"observed_at":"2026-08-06T00:18:49.043158Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:18:49.155369Z","title":"Dna: Uncovering universal latent forgery knowledge.arXiv preprint arXiv:2601.22515, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.01414","last_updated":"2026-08-02T17:49:07Z","snapshot_observed_at":"2026-08-07T18:38:51.455203Z","submitted_at":"2026-08-02T17:49:07Z","title":"No Single Neuron of Failure: Distributed Safety Alignment Against White-Box Attacks","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T00:18:49.155369Z"},"links":{"citing_paper":"/paper/2608.01414"},"observation_digest":"sha256:f4904013f496d1d7f0499994684891826ca0679ae78db2499ca1a993865ee8e0","observation_id":"9497005e-7db5-4842-bdde-59636bd6558f","resolution":{"observed_at":"2026-08-06T00:18:49.155369Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.08295","last_updated":"2024-04-16T12:52:47Z","snapshot_observed_at":"2026-08-03T03:29:01.959523Z","submitted_at":"2024-03-13T06:59:16Z","title":"Gemma: Open Models Based on Gemini Research and Technology","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.08295","snapshot_observed_at":"2026-08-06T00:18:49.251487Z","title":"Gemma: Open models based on gemini research and technology.arXiv preprint arXiv:2403.08295, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.01414","last_updated":"2026-08-02T17:49:07Z","snapshot_observed_at":"2026-08-07T18:38:51.455203Z","submitted_at":"2026-08-02T17:49:07Z","title":"No Single Neuron of Failure: Distributed Safety Alignment Against White-Box Attacks","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T00:18:49.251487Z"},"links":{"cited_paper":"/paper/2403.08295","citing_paper":"/paper/2608.01414"},"observation_digest":"sha256:12df6b1b7fc7f8b72d7cdb8fc415a30728f7b208c266d1f0f4da8bb20eefe9e2","observation_id":"7329596c-6e32-404e-8807-106b89078f3f","resolution":{"observed_at":"2026-08-06T00:18:49.251487Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:18:59.605984Z","title":"FigStep: Jailbreaking large vision-language models via typographic visual prompts","venue":null,"work_id":"b264fdbb-7253-41a0-95f9-4c9b44d122ce","year":2025},"citing_paper":{"arxiv_id":"2608.01414","last_updated":"2026-08-02T17:49:07Z","snapshot_observed_at":"2026-08-07T18:38:51.455203Z","submitted_at":"2026-08-02T17:49:07Z","title":"No Single Neuron of Failure: Distributed Safety Alignment Against White-Box Attacks","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T00:18:49.356894Z"},"links":{"citing_paper":"/paper/2608.01414"},"observation_digest":"sha256:efe4ac8b2896a2a96bc5d4f7443246adee3c1cd19601be500322f8fb487d36cf","observation_id":"afe3a815-d650-4634-8ae1-922834e6efcf","resolution":{"observed_at":"2026-08-06T00:18:59.736632Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:18:49.592647Z","title":"The llama 3 herd of models, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.01414","last_updated":"2026-08-02T17:49:07Z","snapshot_observed_at":"2026-08-07T18:38:51.455203Z","submitted_at":"2026-08-02T17:49:07Z","title":"No Single Neuron of Failure: Distributed Safety Alignment Against White-Box Attacks","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T00:18:49.592647Z"},"links":{"citing_paper":"/paper/2608.01414"},"observation_digest":"sha256:6234bb53ac7add55534eb6a9214347f31f104fd82d09ecf8fc043cb3af6742af","observation_id":"a3904cd3-be16-40e6-ab81-a1f911ef0b4f","resolution":{"observed_at":"2026-08-06T00:18:49.592647Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-06T00:18:49.709052Z","title":"DeepSeek-R1: Incentivizing reasoning capability in LLMs via reinforce- ment learning.arXiv preprint arXiv:2501.12948, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.01414","last_updated":"2026-08-02T17:49:07Z","snapshot_observed_at":"2026-08-07T18:38:51.455203Z","submitted_at":"2026-08-02T17:49:07Z","title":"No Single Neuron of Failure: Distributed Safety Alignment Against White-Box Attacks","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T00:18:49.709052Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2608.01414"},"observation_digest":"sha256:21e4b87a01c8d6f8bc8cca8e55f83c7b88aa89746cd61aa622f3dfd4ffae4a5b","observation_id":"965dcc06-edae-409d-a29e-d0eabdd9e20e","resolution":{"observed_at":"2026-08-06T00:18:49.709052Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:18:49.818291Z","title":"PKU-SafeRLHF: Towards multi- level safety alignment for LLMs with human preference","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.01414","last_updated":"2026-08-02T17:49:07Z","snapshot_observed_at":"2026-08-07T18:38:51.455203Z","submitted_at":"2026-08-02T17:49:07Z","title":"No Single Neuron of Failure: Distributed Safety Alignment Against White-Box Attacks","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T00:18:49.818291Z"},"links":{"citing_paper":"/paper/2608.01414"},"observation_digest":"sha256:3bf7d4fc4dc04b2a8f9cf2ef364259960f64d72c38196db62fba93467f4cb572","observation_id":"b3cac4d5-8985-4e00-974c-21b577d2d13d","resolution":{"observed_at":"2026-08-06T00:18:49.818291Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:18:59.371326Z","title":null,"venue":null,"work_id":"737a5e85-966f-44f4-ad9c-40931edcacfe","year":2023},"citing_paper":{"arxiv_id":"2608.01414","last_updated":"2026-08-02T17:49:07Z","snapshot_observed_at":"2026-08-07T18:38:51.455203Z","submitted_at":"2026-08-02T17:49:07Z","title":"No Single Neuron of Failure: Distributed Safety Alignment Against White-Box Attacks","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T00:18:49.948433Z"},"links":{"citing_paper":"/paper/2608.01414"},"observation_digest":"sha256:b1587c5fff55f3fd8cd030a8becb8dfbd95f282f9f5a0b49987db78e2a87ff37","observation_id":"a5a78fc4-7c1b-4f4b-8762-7559e5ee21e5","resolution":{"observed_at":"2026-08-06T00:18:59.462162Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:18:59.125298Z","title":"Li, Ann-Kathrin Dombrowski, Shashwat Goel, Long Phan, et al","venue":null,"work_id":"6ed11d06-689f-4aab-a9ed-8c44822a2846","year":2024},"citing_paper":{"arxiv_id":"2608.01414","last_updated":"2026-08-02T17:49:07Z","snapshot_observed_at":"2026-08-07T18:38:51.455203Z","submitted_at":"2026-08-02T17:49:07Z","title":"No Single Neuron of Failure: Distributed Safety Alignment Against White-Box Attacks","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T00:18:50.077899Z"},"links":{"citing_paper":"/paper/2608.01414"},"observation_digest":"sha256:2314cf16db4521b49cb4689bec498c10fd5994cf900e67373711e028ba42e3c5","observation_id":"9efe5ece-fc1d-4b04-a61f-183b40f76cd2","resolution":{"observed_at":"2026-08-06T00:18:59.246967Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:18:58.883754Z","title":"Images are achilles’ heel of alignment: Exploiting visual vulnerabilities for jailbreaking multimodal large language models","venue":null,"work_id":"6cfc9394-2456-4e19-8ffc-48237aa30ef9","year":2024},"citing_paper":{"arxiv_id":"2608.01414","last_updated":"2026-08-02T17:49:07Z","snapshot_observed_at":"2026-08-07T18:38:51.455203Z","submitted_at":"2026-08-02T17:49:07Z","title":"No Single Neuron of Failure: Distributed Safety Alignment Against White-Box Attacks","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T00:18:50.254018Z"},"links":{"citing_paper":"/paper/2608.01414"},"observation_digest":"sha256:7a5ff4da812e696597b2e91e9e2b1a597bd67e45ae6ddb4b4fc246832c4a2070","observation_id":"391afc04-b9e6-4eea-b279-73d6226f29f5","resolution":{"observed_at":"2026-08-06T00:18:59.008836Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:18:58.623968Z","title":"TruthfulQA: Measuring how models mimic human falsehoods","venue":null,"work_id":"e2a0977a-f925-46cc-a84a-1dcb9f92f688","year":2022},"citing_paper":{"arxiv_id":"2608.01414","last_updated":"2026-08-02T17:49:07Z","snapshot_observed_at":"2026-08-07T18:38:51.455203Z","submitted_at":"2026-08-02T17:49:07Z","title":"No Single Neuron of Failure: Distributed Safety Alignment Against White-Box Attacks","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T00:18:50.386078Z"},"links":{"citing_paper":"/paper/2608.01414"},"observation_digest":"sha256:26dc2affe6d86ee34f8e3640e6eb6f7fb625e2a6e53988d11574732835c5c3eb","observation_id":"95d81f17-dbd3-4b39-8784-51c43cd96727","resolution":{"observed_at":"2026-08-06T00:18:58.773225Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:18:50.496181Z","title":"Visual instruction tuning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.01414","last_updated":"2026-08-02T17:49:07Z","snapshot_observed_at":"2026-08-07T18:38:51.455203Z","submitted_at":"2026-08-02T17:49:07Z","title":"No Single Neuron of Failure: Distributed Safety Alignment Against White-Box Attacks","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T00:18:50.496181Z"},"links":{"citing_paper":"/paper/2608.01414"},"observation_digest":"sha256:6f39f9c9de08b47f592f2ae314ebb5a041b99d88114a804aa3e9d39ad7e7b8dd","observation_id":"b5f373f9-07a4-4730-bcde-6323a666b9bb","resolution":{"observed_at":"2026-08-06T00:18:50.496181Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:18:50.613801Z","title":"MMBench: Is your multi-modal model an all- around player?, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.01414","last_updated":"2026-08-02T17:49:07Z","snapshot_observed_at":"2026-08-07T18:38:51.455203Z","submitted_at":"2026-08-02T17:49:07Z","title":"No Single Neuron of Failure: Distributed Safety Alignment Against White-Box Attacks","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T00:18:50.613801Z"},"links":{"citing_paper":"/paper/2608.01414"},"observation_digest":"sha256:2f722621f7fa69390f527d65192d68dfc1b8a15324e1776d273245824c624352","observation_id":"642773eb-c65f-414d-ba00-0ccf0ba78eef","resolution":{"observed_at":"2026-08-06T00:18:50.613801Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:18:50.721583Z","title":"Decoupled weight decay regulariza- tion","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2608.01414","last_updated":"2026-08-02T17:49:07Z","snapshot_observed_at":"2026-08-07T18:38:51.455203Z","submitted_at":"2026-08-02T17:49:07Z","title":"No Single Neuron of Failure: Distributed Safety Alignment Against White-Box Attacks","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T00:18:50.721583Z"},"links":{"citing_paper":"/paper/2608.01414"},"observation_digest":"sha256:c3e8bc740b5d379c6e49f5ce8d357430af019ed750c31293b160e97359726fc4","observation_id":"517f68ac-7397-4396-b81b-ca04a9826e64","resolution":{"observed_at":"2026-08-06T00:18:50.721583Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:18:58.248084Z","title":"HarmBench: A standardized evaluation framework for automated red teaming and robust refusal","venue":null,"work_id":"1fe81288-a109-49bb-b2a3-d802d180024c","year":2024},"citing_paper":{"arxiv_id":"2608.01414","last_updated":"2026-08-02T17:49:07Z","snapshot_observed_at":"2026-08-07T18:38:51.455203Z","submitted_at":"2026-08-02T17:49:07Z","title":"No Single Neuron of Failure: Distributed Safety Alignment Against White-Box Attacks","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T00:18:50.847333Z"},"links":{"citing_paper":"/paper/2608.01414"},"observation_digest":"sha256:51d40d0a150e20e623d2dac09d3a14ec757d6a14c22853be3b0867a0f57449f6","observation_id":"36e0cc30-eb5d-471d-84cc-5cd5421fb6a2","resolution":{"observed_at":"2026-08-06T00:18:58.433158Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:18:57.857131Z","title":"Pruning convolutional neural networks for resource efficient inference","venue":null,"work_id":"926d0cb8-b2f1-40f9-8b23-8e43790c5b13","year":2017},"citing_paper":{"arxiv_id":"2608.01414","last_updated":"2026-08-02T17:49:07Z","snapshot_observed_at":"2026-08-07T18:38:51.455203Z","submitted_at":"2026-08-02T17:49:07Z","title":"No Single Neuron of Failure: Distributed Safety Alignment Against White-Box Attacks","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T00:18:50.993536Z"},"links":{"citing_paper":"/paper/2608.01414"},"observation_digest":"sha256:0158153a4b971f7b44afca30d27b907d9203c4ef96fa3aa8b478fccad097fadc","observation_id":"83054a01-f0cd-4ff9-a024-7392f6604c96","resolution":{"observed_at":"2026-08-06T00:18:58.072871Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:18:57.486839Z","title":"Training language models to follow instructions with human feedback","venue":null,"work_id":"2ac60df2-4bf5-4447-b5a4-74c4553ea29f","year":2022},"citing_paper":{"arxiv_id":"2608.01414","last_updated":"2026-08-02T17:49:07Z","snapshot_observed_at":"2026-08-07T18:38:51.455203Z","submitted_at":"2026-08-02T17:49:07Z","title":"No Single Neuron of Failure: Distributed Safety Alignment Against White-Box Attacks","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T00:18:51.108876Z"},"links":{"citing_paper":"/paper/2608.01414"},"observation_digest":"sha256:37defa31fbea0986e8f202f81f246bca39457549c086207a67418bda49c2027a","observation_id":"777b2304-c637-43ff-89cf-f44664ae95d7","resolution":{"observed_at":"2026-08-06T00:18:57.645617Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:18:57.087731Z","title":"Representation noising: A defence mech- anism against harmful finetuning","venue":null,"work_id":"3341c8c8-267d-404a-ac44-5b24d7b068e5","year":2024},"citing_paper":{"arxiv_id":"2608.01414","last_updated":"2026-08-02T17:49:07Z","snapshot_observed_at":"2026-08-07T18:38:51.455203Z","submitted_at":"2026-08-02T17:49:07Z","title":"No Single Neuron of Failure: Distributed Safety Alignment Against White-Box Attacks","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T00:18:51.280048Z"},"links":{"citing_paper":"/paper/2608.01414"},"observation_digest":"sha256:df7e5968e9f58693ed98efee57c7afc0414f778931674ef8a09f81cbb4e8e926","observation_id":"67ad9ef2-ede9-4589-83c2-ac872a61d6fc","resolution":{"observed_at":"2026-08-06T00:18:57.275855Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:18:56.794923Z","title":"XSTest: A test suite for identifying exaggerated safety behaviours in large language models","venue":null,"work_id":"39c08b6e-1137-41c8-a74c-80b76504c754","year":2024},"citing_paper":{"arxiv_id":"2608.01414","last_updated":"2026-08-02T17:49:07Z","snapshot_observed_at":"2026-08-07T18:38:51.455203Z","submitted_at":"2026-08-02T17:49:07Z","title":"No Single Neuron of Failure: Distributed Safety Alignment Against White-Box Attacks","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T00:18:51.435864Z"},"links":{"citing_paper":"/paper/2608.01414"},"observation_digest":"sha256:3af3381b1553c1976a0713369aebeb80de4937df485124716fbc606a263bc3e3","observation_id":"3874d651-a443-4ef3-a1ff-56db695739b6","resolution":{"observed_at":"2026-08-06T00:18:56.952210Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.15549","last_updated":"2025-07-29T09:37:22Z","snapshot_observed_at":"2026-08-06T22:31:48.025702Z","submitted_at":"2024-07-22T11:19:14Z","title":"Latent Adversarial Training Improves Robustness to Persistent Harmful Behaviors in LLMs","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.15549","snapshot_observed_at":"2026-08-06T00:18:51.590300Z","title":"Latent adversarial training improves robustness to persistent harmful behaviors in LLMs.arXiv preprint arXiv:2407.15549, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.01414","last_updated":"2026-08-02T17:49:07Z","snapshot_observed_at":"2026-08-07T18:38:51.455203Z","submitted_at":"2026-08-02T17:49:07Z","title":"No Single Neuron of Failure: Distributed Safety Alignment Against White-Box Attacks","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T00:18:51.590300Z"},"links":{"cited_paper":"/paper/2407.15549","citing_paper":"/paper/2608.01414"},"observation_digest":"sha256:503f88b12168f04486dbb9def5e394cba6f6813002346d5665fccf87b0986242","observation_id":"b45e36db-5e0f-406e-a599-c1632c39a1f4","resolution":{"observed_at":"2026-08-06T00:18:51.590300Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:18:51.980020Z","title":"Where culture fades: revealing the cultural gap in text-to-image generation.arXiv preprint arXiv:2511.17282, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.01414","last_updated":"2026-08-02T17:49:07Z","snapshot_observed_at":"2026-08-07T18:38:51.455203Z","submitted_at":"2026-08-02T17:49:07Z","title":"No Single Neuron of Failure: Distributed Safety Alignment Against White-Box Attacks","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T00:18:51.980020Z"},"links":{"citing_paper":"/paper/2608.01414"},"observation_digest":"sha256:b93d08f4208fa82af77609ab26637a30bf2e5ec637d59cfa3ac272cd2dccd6df","observation_id":"0382d27c-9de5-4212-a464-d3152fe14255","resolution":{"observed_at":"2026-08-06T00:18:51.980020Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:18:56.450100Z","title":"TraceRouter: Robust safety for large foundation models via path-level intervention","venue":null,"work_id":"15c80939-0e20-40b1-8d09-00ce26f8f9df","year":2026},"citing_paper":{"arxiv_id":"2608.01414","last_updated":"2026-08-02T17:49:07Z","snapshot_observed_at":"2026-08-07T18:38:51.455203Z","submitted_at":"2026-08-02T17:49:07Z","title":"No Single Neuron of Failure: Distributed Safety Alignment Against White-Box Attacks","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T00:18:52.226014Z"},"links":{"citing_paper":"/paper/2608.01414"},"observation_digest":"sha256:0d9209477fb406d1d1fd38ed92ce0748b00cfa4b70b43dbf9ada4aaff2f3da1a","observation_id":"f1ad0204-b8c7-497d-be98-9ce6e5cde755","resolution":{"observed_at":"2026-08-06T00:18:56.579897Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:18:52.311850Z","title":"Orthoeraser: coupled-neuron orthogonal projection for concept erasure.arXiv preprint arXiv:2603.11493, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.01414","last_updated":"2026-08-02T17:49:07Z","snapshot_observed_at":"2026-08-07T18:38:51.455203Z","submitted_at":"2026-08-02T17:49:07Z","title":"No Single Neuron of Failure: Distributed Safety Alignment Against White-Box Attacks","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T00:18:52.311850Z"},"links":{"citing_paper":"/paper/2608.01414"},"observation_digest":"sha256:80643cfb388ed109254ae7c2f78570e8e966d23a330aa4c9212a96f9fc246e8b","observation_id":"c64ee951-f054-4f4e-8519-3ab80e966c19","resolution":{"observed_at":"2026-08-06T00:18:52.311850Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.10260","last_updated":"2024-08-27T03:32:47Z","snapshot_observed_at":"2026-08-04T21:32:35.483431Z","submitted_at":"2024-02-15T18:58:09Z","title":"A StrongREJECT for Empty Jailbreaks","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.10260","snapshot_observed_at":"2026-08-06T00:18:52.404593Z","title":"A StrongREJECT for empty jailbreaks.arXiv preprint arXiv:2402.10260, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.01414","last_updated":"2026-08-02T17:49:07Z","snapshot_observed_at":"2026-08-07T18:38:51.455203Z","submitted_at":"2026-08-02T17:49:07Z","title":"No Single Neuron of Failure: Distributed Safety Alignment Against White-Box Attacks","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T00:18:52.404593Z"},"links":{"cited_paper":"/paper/2402.10260","citing_paper":"/paper/2608.01414"},"observation_digest":"sha256:424701195b46638c11543720348e14fece6eed22c2a1e9550b85cc48739e8c82","observation_id":"51dcc1f5-2ec3-4bba-abf7-f0e651ef2a17","resolution":{"observed_at":"2026-08-06T00:18:52.404593Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:18:52.471514Z","title":"Dropout: A simple way to prevent neural networks from overfitting.Journal of Machine Learning Research, 15(56):1929–1958, 2014","venue":null,"work_id":null,"year":1929},"citing_paper":{"arxiv_id":"2608.01414","last_updated":"2026-08-02T17:49:07Z","snapshot_observed_at":"2026-08-07T18:38:51.455203Z","submitted_at":"2026-08-02T17:49:07Z","title":"No Single Neuron of Failure: Distributed Safety Alignment Against White-Box Attacks","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T00:18:52.471514Z"},"links":{"citing_paper":"/paper/2608.01414"},"observation_digest":"sha256:bafd2646ba314770eab18f1498544d37558e3f23f5d2215b2805f5846576b4f0","observation_id":"7018b5b6-ffcc-434f-8f23-acb594ded70c","resolution":{"observed_at":"2026-08-06T00:18:52.471514Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:18:52.559100Z","title":"Zico Kolter","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.01414","last_updated":"2026-08-02T17:49:07Z","snapshot_observed_at":"2026-08-07T18:38:51.455203Z","submitted_at":"2026-08-02T17:49:07Z","title":"No Single Neuron of Failure: Distributed Safety Alignment Against White-Box Attacks","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T00:18:52.559100Z"},"links":{"citing_paper":"/paper/2608.01414"},"observation_digest":"sha256:20714c9754fb480ca4b56550a4e2bc5047ddb6413e511deccf32614a29256f4e","observation_id":"77401e9b-678a-40dc-9eaa-01507ef87998","resolution":{"observed_at":"2026-08-06T00:18:52.559100Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:18:56.048413Z","title":"Zico Kolter","venue":null,"work_id":"cef59576-5c89-4497-bbf6-5a20e7960490","year":2024},"citing_paper":{"arxiv_id":"2608.01414","last_updated":"2026-08-02T17:49:07Z","snapshot_observed_at":"2026-08-07T18:38:51.455203Z","submitted_at":"2026-08-02T17:49:07Z","title":"No Single Neuron of Failure: Distributed Safety Alignment Against White-Box Attacks","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-06T00:18:52.637182Z"},"links":{"citing_paper":"/paper/2608.01414"},"observation_digest":"sha256:b816b421c102d3b4fc666e17458b3b2a79cb38659f1ee6ab5f909a3130713952","observation_id":"3844070b-028c-4aed-b328-806cd2808c4f","resolution":{"observed_at":"2026-08-06T00:18:56.252598Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:18:52.703131Z","title":"SafeNeuron: Neuron- level safety alignment for large language models.arXiv preprint arXiv:2602.12158, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.01414","last_updated":"2026-08-02T17:49:07Z","snapshot_observed_at":"2026-08-07T18:38:51.455203Z","submitted_at":"2026-08-02T17:49:07Z","title":"No Single Neuron of Failure: Distributed Safety Alignment Against White-Box Attacks","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T00:18:52.703131Z"},"links":{"citing_paper":"/paper/2608.01414"},"observation_digest":"sha256:9793928eff018e1bb7ccdf3f715d6c0903b8a587ca2553fa23039ce769ed7e63","observation_id":"5881ff72-767d-43ea-ad4a-d7f368a58b0b","resolution":{"observed_at":"2026-08-06T00:18:52.703131Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:18:52.787762Z","title":"Taxonomy, opportunities, and challenges of representation engi- neering for large language models.arXiv preprint arXiv:2502.19649, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.01414","last_updated":"2026-08-02T17:49:07Z","snapshot_observed_at":"2026-08-07T18:38:51.455203Z","submitted_at":"2026-08-02T17:49:07Z","title":"No Single Neuron of Failure: Distributed Safety Alignment Against White-Box Attacks","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-06T00:18:52.787762Z"},"links":{"citing_paper":"/paper/2608.01414"},"observation_digest":"sha256:43c8f418eb9696a9a0283438dd722149c087e18a3950046f62f619d2959dffe2","observation_id":"4d07861b-3234-4a57-b119-647180c55b74","resolution":{"observed_at":"2026-08-06T00:18:52.787762Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:18:55.699679Z","title":"Jailbroken: How does LLM safety training fail? InAdvances in Neural Information Processing Systems, volume 36, 2023","venue":null,"work_id":"ebea8fe4-a797-40a5-bed4-149ff5380d72","year":2023},"citing_paper":{"arxiv_id":"2608.01414","last_updated":"2026-08-02T17:49:07Z","snapshot_observed_at":"2026-08-07T18:38:51.455203Z","submitted_at":"2026-08-02T17:49:07Z","title":"No Single Neuron of Failure: Distributed Safety Alignment Against White-Box Attacks","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-06T00:18:52.858768Z"},"links":{"citing_paper":"/paper/2608.01414"},"observation_digest":"sha256:34917c5ff09c9e135cefffdbc196290d8bf6e8fea221b01de9ca1b002c926629","observation_id":"b650a3e8-a2df-4c1a-b276-41f8ed9d33ba","resolution":{"observed_at":"2026-08-06T00:18:55.871548Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:18:55.214260Z","title":"NeuroStrike: Neuron-level attacks on aligned LLMs","venue":null,"work_id":"f646603f-d402-4976-93a9-e91aafdb5ce1","year":2026},"citing_paper":{"arxiv_id":"2608.01414","last_updated":"2026-08-02T17:49:07Z","snapshot_observed_at":"2026-08-07T18:38:51.455203Z","submitted_at":"2026-08-02T17:49:07Z","title":"No Single Neuron of Failure: Distributed Safety Alignment Against White-Box Attacks","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-06T00:18:52.926634Z"},"links":{"citing_paper":"/paper/2608.01414"},"observation_digest":"sha256:48ebd6ab636d379edcd7904b82664fc8de197e6af5bfe913e9300f7064c4821c","observation_id":"4f1293c3-bd93-43c6-a8d7-123bee059ef4","resolution":{"observed_at":"2026-08-06T00:18:55.461925Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:18:55.010846Z","title":"NLSR: Neuron-level safety realignment of large language 9 models against harmful fine-tuning","venue":null,"work_id":"6538d054-e1d3-46b2-9097-dbba1326e2e3","year":2025},"citing_paper":{"arxiv_id":"2608.01414","last_updated":"2026-08-02T17:49:07Z","snapshot_observed_at":"2026-08-07T18:38:51.455203Z","submitted_at":"2026-08-02T17:49:07Z","title":"No Single Neuron of Failure: Distributed Safety Alignment Against White-Box Attacks","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-06T00:18:52.993493Z"},"links":{"citing_paper":"/paper/2608.01414"},"observation_digest":"sha256:58a07e4032067277269ca09f7b2dc5437b762abd5516433a159501183330ff86","observation_id":"11b3413a-478c-4fd6-9f1d-e45d8ad267b3","resolution":{"observed_at":"2026-08-06T00:18:55.100559Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:18:54.813059Z","title":"Representation bending for large language model safety","venue":null,"work_id":"dae3d7a4-c6c4-408f-8aec-bd6cf917e8f6","year":2025},"citing_paper":{"arxiv_id":"2608.01414","last_updated":"2026-08-02T17:49:07Z","snapshot_observed_at":"2026-08-07T18:38:51.455203Z","submitted_at":"2026-08-02T17:49:07Z","title":"No Single Neuron of Failure: Distributed Safety Alignment Against White-Box Attacks","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-06T00:18:53.071474Z"},"links":{"citing_paper":"/paper/2608.01414"},"observation_digest":"sha256:13b353a2942017b5e7ca4dbf5f45c4232237bcf467258f7df72ce250d497965f","observation_id":"b4639a0e-6f5b-4dbe-8f57-3ad4a739267c","resolution":{"observed_at":"2026-08-06T00:18:54.924763Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:18:54.552356Z","title":"Weston, and Xian Li","venue":null,"work_id":"51dfb8e5-d05a-4f16-80c9-3f7f9d88253e","year":2025},"citing_paper":{"arxiv_id":"2608.01414","last_updated":"2026-08-02T17:49:07Z","snapshot_observed_at":"2026-08-07T18:38:51.455203Z","submitted_at":"2026-08-02T17:49:07Z","title":"No Single Neuron of Failure: Distributed Safety Alignment Against White-Box Attacks","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-06T00:18:53.303482Z"},"links":{"citing_paper":"/paper/2608.01414"},"observation_digest":"sha256:0824b9641322f008b50afe8e166a68fffc0f266447c03b329fcaf2335023257b","observation_id":"433c468d-dbc8-42b1-8e23-0e716e9f8166","resolution":{"observed_at":"2026-08-06T00:18:54.675581Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:18:54.355084Z","title":"Understanding and enhancing safety mechanisms of LLMs via safety-specific neuron","venue":null,"work_id":"1f544680-303c-4af6-9752-1387b947770b","year":2025},"citing_paper":{"arxiv_id":"2608.01414","last_updated":"2026-08-02T17:49:07Z","snapshot_observed_at":"2026-08-07T18:38:51.455203Z","submitted_at":"2026-08-02T17:49:07Z","title":"No Single Neuron of Failure: Distributed Safety Alignment Against White-Box Attacks","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-06T00:18:53.415568Z"},"links":{"citing_paper":"/paper/2608.01414"},"observation_digest":"sha256:3aea9117cf02a59aa0b5f66c61ef560e1addd4b217671d3602972a48ac65571d","observation_id":"dc92f761-cf4f-40ed-91ff-dfb68f534e9c","resolution":{"observed_at":"2026-08-06T00:18:54.473399Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.04313","last_updated":"2024-07-12T16:51:07Z","snapshot_observed_at":"2026-07-06T18:26:42.010940Z","submitted_at":"2024-06-06T17:57:04Z","title":"Improving Alignment and Robustness with Circuit Breakers","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.04313","snapshot_observed_at":"2026-08-06T00:18:53.554407Z","title":"Zico Kolter, Matt Fredrik- son, and Dan Hendrycks","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.01414","last_updated":"2026-08-02T17:49:07Z","snapshot_observed_at":"2026-08-07T18:38:51.455203Z","submitted_at":"2026-08-02T17:49:07Z","title":"No Single Neuron of Failure: Distributed Safety Alignment Against White-Box Attacks","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-06T00:18:53.554407Z"},"links":{"cited_paper":"/paper/2406.04313","citing_paper":"/paper/2608.01414"},"observation_digest":"sha256:cbdcfee0aae3b854c07e0a075dfe87f2274156f03bcd00b910c1000d3c26429e","observation_id":"552e4e83-f8bc-4208-a42c-770f591127eb","resolution":{"observed_at":"2026-08-06T00:18:53.554407Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.15043","last_updated":"2023-12-20T20:48:57Z","snapshot_observed_at":"2026-07-06T15:59:23.019044Z","submitted_at":"2023-07-27T17:49:12Z","title":"Universal and Transferable Adversarial Attacks on Aligned Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.15043","snapshot_observed_at":"2026-08-06T00:18:53.661855Z","title":"Zico Kolter, and Matt Fredrikson","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.01414","last_updated":"2026-08-02T17:49:07Z","snapshot_observed_at":"2026-08-07T18:38:51.455203Z","submitted_at":"2026-08-02T17:49:07Z","title":"No Single Neuron of Failure: Distributed Safety Alignment Against White-Box Attacks","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-06T00:18:53.661855Z"},"links":{"cited_paper":"/paper/2307.15043","citing_paper":"/paper/2608.01414"},"observation_digest":"sha256:5dd8566600ac07620893eb0962877eed1564ba132f64ac22b7de99d56b144015","observation_id":"c28e9822-e015-46e2-99c6-67dbb638237f","resolution":{"observed_at":"2026-08-06T00:18:53.661855Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2608.01414","last_updated":"2026-08-02T17:49:07Z","latest_version":1,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-07T18:38:51.455203Z","submitted_at":"2026-08-02T17:49:07Z","title":"No Single Neuron of Failure: Distributed Safety Alignment Against White-Box Attacks"},"reference_resolution":{"displayed":48,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":27,"verified_exact":0,"verified_fuzzy":21},"total_outbound_references":48},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 48 of 48 outbound references and 0 inbound Pith citation observations for arXiv:2608.01414."}