{"as_of":"2026-08-08T17:55:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:96c74777b0e111d5501c99b943870ed1339a23afc893706ed19050e9b80b3f44","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":11,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":11,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":11,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":11,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T22:03:52.256909Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-02T03:26:28.590637Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2403.05518","last_updated":"2025-06-26T19:29:49Z","snapshot_observed_at":"2026-07-06T17:41:42.995949Z","submitted_at":"2024-03-08T18:41:42Z","title":"Bias-Augmented Consistency Training Reduces Biased Reasoning in Chain-of-Thought","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.05518","snapshot_observed_at":"2026-08-06T22:03:52.256909Z","title":"R., Michael, J., Perez, E., and Turpin, M","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.22777","last_updated":"2025-07-13T15:36:35Z","snapshot_observed_at":"2026-08-06T21:55:34.287424Z","submitted_at":"2025-06-28T06:37:10Z","title":"Teaching Models to Verbalize Reward Hacking in Chain-of-Thought Reasoning","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T22:03:52.256909Z"},"links":{"cited_paper":"/paper/2403.05518","citing_paper":"/paper/2506.22777"},"observation_digest":"sha256:432757aa50b3b425e05af1b1973027f114f3ae89bc6149435b739d6cb17a3df7","observation_id":"246b518d-1ab1-4735-b78f-3311d85ac3f2","resolution":{"observed_at":"2026-08-06T22:03:52.256909Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.05518","last_updated":"2025-06-26T19:29:49Z","snapshot_observed_at":"2026-07-06T17:41:42.995949Z","submitted_at":"2024-03-08T18:41:42Z","title":"Bias-Augmented Consistency Training Reduces Biased Reasoning in Chain-of-Thought","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.05518","snapshot_observed_at":"2026-08-06T11:06:07.155650Z","title":"Bias-Augmented Consistency Training Reduces Biased Reasoning in Chain-of-Thought [Internet]","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.23146","last_updated":"2026-07-22T18:38:53Z","snapshot_observed_at":"2026-08-06T11:06:05.284236Z","submitted_at":"2025-07-30T22:48:34Z","title":"Lightweight Language Models are Prone to Reasoning Errors for Complex Computational Phenotyping Tasks","version":4},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T11:06:07.155650Z"},"links":{"cited_paper":"/paper/2403.05518","citing_paper":"/paper/2507.23146"},"observation_digest":"sha256:1e759e0e13387372543a1b24274e216bc511415a955f33e5c567bcd06659311d","observation_id":"024f890d-d398-4dd5-8c37-feb8dc44ad1d","resolution":{"observed_at":"2026-08-06T11:06:07.155650Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.05518","last_updated":"2025-06-26T19:29:49Z","snapshot_observed_at":"2026-07-06T17:41:42.995949Z","submitted_at":"2024-03-08T18:41:42Z","title":"Bias-Augmented Consistency Training Reduces Biased Reasoning in Chain-of-Thought","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.05518","snapshot_observed_at":"2026-08-05T16:57:07.932075Z","title":"Bowman, Julian Michael, Ethan Perez, and Miles Turpin","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.17511","last_updated":"2025-08-24T20:23:08Z","snapshot_observed_at":"2026-08-07T11:41:32.698391Z","submitted_at":"2025-08-24T20:23:08Z","title":"School of Reward Hacks: Hacking harmless tasks generalizes to misaligned behavior in LLMs","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-05T16:57:07.932075Z"},"links":{"cited_paper":"/paper/2403.05518","citing_paper":"/paper/2508.17511"},"observation_digest":"sha256:f5e4ede1f527ac049214921377856f00c12fddb8389838e1dcbcd376e95e14d6","observation_id":"d127ecec-5b7a-47ac-9555-212bc4cadb32","resolution":{"observed_at":"2026-08-05T16:57:07.932075Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.05518","last_updated":"2025-06-26T19:29:49Z","snapshot_observed_at":"2026-07-06T17:41:42.995949Z","submitted_at":"2024-03-08T18:41:42Z","title":"Bias-Augmented Consistency Training Reduces Biased Reasoning in Chain-of-Thought","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.05518","snapshot_observed_at":"2026-08-04T10:40:43.208031Z","title":"Bowman, Julian Michael, Ethan Perez, and Miles Turpin","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2510.09278","last_updated":"2026-06-28T16:27:56Z","snapshot_observed_at":"2026-08-06T21:12:15.673092Z","submitted_at":"2025-10-10T11:21:09Z","title":"CLARity: Reasoning Consistency Alone Can Teach Reinforced Experts","version":2},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-04T10:40:43.208031Z"},"links":{"cited_paper":"/paper/2403.05518","citing_paper":"/paper/2510.09278"},"observation_digest":"sha256:ed4149d96ded2d49d40ec30322d8fe93862ae74e904781e559d7223f9bbbdcad","observation_id":"7bba21fd-6a2b-42b2-9553-09838920feee","resolution":{"observed_at":"2026-08-04T10:40:43.208031Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.05518","last_updated":"2025-06-26T19:29:49Z","snapshot_observed_at":"2026-07-06T17:41:42.995949Z","submitted_at":"2024-03-08T18:41:42Z","title":"Bias-Augmented Consistency Training Reduces Biased Reasoning in Chain-of-Thought","version":3},"cited_work":{"arxiv_id":"2403.05518","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2403.05518","snapshot_observed_at":"2026-07-02T03:26:28.590637Z","title":"Bowman, Julian Michael, Ethan Perez, and Miles Turpin","venue":null,"work_id":"f7ca91d2-5a7e-4dbb-85d5-073b4c1cb68b","year":2024},"citing_paper":{"arxiv_id":"2605.03226","last_updated":"2026-06-08T16:31:56Z","snapshot_observed_at":"2026-08-05T18:36:29.800839Z","submitted_at":"2026-05-04T23:30:29Z","title":"Self-Mined Hardness for Safety Fine-Tuning","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-05-08T18:23:49.808496Z"},"links":{"cited_paper":"/paper/2403.05518","citing_paper":"/paper/2605.03226"},"observation_digest":"sha256:270b7f4688b05b7173489911638400a41fdf7969e6642e9442cd5de4ef9420ac","observation_id":"d62869b0-67d9-4927-ab27-37fd599b6578","resolution":{"observed_at":"2026-05-09T06:30:42.596013Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.05518","last_updated":"2025-06-26T19:29:49Z","snapshot_observed_at":"2026-07-06T17:41:42.995949Z","submitted_at":"2024-03-08T18:41:42Z","title":"Bias-Augmented Consistency Training Reduces Biased Reasoning in Chain-of-Thought","version":3},"cited_work":{"arxiv_id":"2403.05518","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2403.05518","snapshot_observed_at":"2026-07-02T03:26:28.590637Z","title":"Bowman, Julian Michael, Ethan Perez, and Miles Turpin","venue":null,"work_id":"f7ca91d2-5a7e-4dbb-85d5-073b4c1cb68b","year":2024},"citing_paper":{"arxiv_id":"2605.03226","last_updated":"2026-06-08T16:31:56Z","snapshot_observed_at":"2026-08-05T18:36:29.800839Z","submitted_at":"2026-05-04T23:30:29Z","title":"Self-Mined Hardness for Safety Fine-Tuning","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-06-30T23:56:36.068713Z"},"links":{"cited_paper":"/paper/2403.05518","citing_paper":"/paper/2605.03226"},"observation_digest":"sha256:14a58b28ca8ffa15c85355c97bacb441c8fe00e6fd1b2de8d00b38cbbbdc9e2c","observation_id":"75f0719d-4146-419f-aa94-141cfbe7a3df","resolution":{"observed_at":"2026-07-01T00:55:12.260584Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.05518","last_updated":"2025-06-26T19:29:49Z","snapshot_observed_at":"2026-07-06T17:41:42.995949Z","submitted_at":"2024-03-08T18:41:42Z","title":"Bias-Augmented Consistency Training Reduces Biased Reasoning in Chain-of-Thought","version":3},"cited_work":{"arxiv_id":"2403.05518","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2403.05518","snapshot_observed_at":"2026-07-02T03:26:28.590637Z","title":"Bowman, Julian Michael, Ethan Perez, and Miles Turpin","venue":null,"work_id":"f7ca91d2-5a7e-4dbb-85d5-073b4c1cb68b","year":2024},"citing_paper":{"arxiv_id":"2605.21834","last_updated":"2026-05-20T23:56:40Z","snapshot_observed_at":"2026-07-06T23:32:15.891169Z","submitted_at":"2026-05-20T23:56:40Z","title":"On-Policy Consistency Training Improves LLM Safety with Minimal Capability Degradation","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-22T08:39:02.671206Z"},"links":{"cited_paper":"/paper/2403.05518","citing_paper":"/paper/2605.21834"},"observation_digest":"sha256:e0ae5ec1b97eddeb124e9403158e3c710b938a4bbfc2f877d53c6a4dc516daff","observation_id":"005e25dd-55de-4a2b-9b48-e2d97c4e39db","resolution":{"observed_at":"2026-05-22T08:41:17.059273Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.05518","last_updated":"2025-06-26T19:29:49Z","snapshot_observed_at":"2026-07-06T17:41:42.995949Z","submitted_at":"2024-03-08T18:41:42Z","title":"Bias-Augmented Consistency Training Reduces Biased Reasoning in Chain-of-Thought","version":3},"cited_work":{"arxiv_id":"2403.05518","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2403.05518","snapshot_observed_at":"2026-07-02T03:26:28.590637Z","title":"Bowman, Julian Michael, Ethan Perez, and Miles Turpin","venue":null,"work_id":"f7ca91d2-5a7e-4dbb-85d5-073b4c1cb68b","year":2024},"citing_paper":{"arxiv_id":"2605.24279","last_updated":"2026-05-22T23:13:21Z","snapshot_observed_at":"2026-07-31T10:30:03.841807Z","submitted_at":"2026-05-22T23:13:21Z","title":"ContextEcho: A Benchmark for Persona Drift in Long Agentic-Coding Sessions","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-06-30T15:17:37.904831Z"},"links":{"cited_paper":"/paper/2403.05518","citing_paper":"/paper/2605.24279"},"observation_digest":"sha256:474512ca6f087c846425ec53bd4e5a9c31e125154783245cccdf81d06645038c","observation_id":"cc38c616-bde8-43e4-bd2d-9fd541271804","resolution":{"observed_at":"2026-06-30T15:34:48.444243Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.05518","last_updated":"2025-06-26T19:29:49Z","snapshot_observed_at":"2026-07-06T17:41:42.995949Z","submitted_at":"2024-03-08T18:41:42Z","title":"Bias-Augmented Consistency Training Reduces Biased Reasoning in Chain-of-Thought","version":3},"cited_work":{"arxiv_id":"2403.05518","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2403.05518","snapshot_observed_at":"2026-07-02T03:26:28.590637Z","title":"Bowman, Julian Michael, Ethan Perez, and Miles Turpin","venue":null,"work_id":"f7ca91d2-5a7e-4dbb-85d5-073b4c1cb68b","year":2024},"citing_paper":{"arxiv_id":"2605.28467","last_updated":"2026-05-27T13:33:26Z","snapshot_observed_at":"2026-08-05T22:05:24.662345Z","submitted_at":"2026-05-27T13:33:26Z","title":"Mitigating Adaptive Attacks against Reasoning Models with Activation Consistency Training","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-06-29T14:18:16.033063Z"},"links":{"cited_paper":"/paper/2403.05518","citing_paper":"/paper/2605.28467"},"observation_digest":"sha256:fd85f0986deb51dfe14bdf6c300c736f800b3a39be2f16ec0104c4f197dcfff8","observation_id":"75b436ba-9072-44e9-9cf1-b10b6796b2b6","resolution":{"observed_at":"2026-06-29T14:23:30.709678Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.05518","last_updated":"2025-06-26T19:29:49Z","snapshot_observed_at":"2026-07-06T17:41:42.995949Z","submitted_at":"2024-03-08T18:41:42Z","title":"Bias-Augmented Consistency Training Reduces Biased Reasoning in Chain-of-Thought","version":3},"cited_work":{"arxiv_id":"2403.05518","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2403.05518","snapshot_observed_at":"2026-07-02T03:26:28.590637Z","title":"Bowman, Julian Michael, Ethan Perez, and Miles Turpin","venue":null,"work_id":"f7ca91d2-5a7e-4dbb-85d5-073b4c1cb68b","year":2024},"citing_paper":{"arxiv_id":"2606.03810","last_updated":"2026-06-03T10:22:34Z","snapshot_observed_at":"2026-08-02T05:00:38.252385Z","submitted_at":"2026-06-02T15:54:24Z","title":"Consistency Training Can Entrench Misalignment","version":2},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-06-28T10:07:31.153337Z"},"links":{"cited_paper":"/paper/2403.05518","citing_paper":"/paper/2606.03810"},"observation_digest":"sha256:4581a6536186a172bbdb06bef25501abaa7b5b396215161fe88df79c6d7291bc","observation_id":"d6bd0c7c-2b81-4f69-b622-c169ec6ad9b8","resolution":{"observed_at":"2026-07-02T03:26:28.592210Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.05518","last_updated":"2025-06-26T19:29:49Z","snapshot_observed_at":"2026-07-06T17:41:42.995949Z","submitted_at":"2024-03-08T18:41:42Z","title":"Bias-Augmented Consistency Training Reduces Biased Reasoning in Chain-of-Thought","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.05518","snapshot_observed_at":"2026-08-01T08:36:28.549466Z","title":"and Michael, Julian and Perez, Ethan and Turpin, Miles , urldate =","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.21090","last_updated":"2026-07-23T09:20:38Z","snapshot_observed_at":"2026-08-06T22:04:57.750051Z","submitted_at":"2026-07-23T09:20:38Z","title":"Training Large Language Models for Self-Explanation Faithfulness","version":1},"reference_index":121,"source":"arxiv_source","source_observed_at":"2026-08-01T08:36:28.549466Z"},"links":{"cited_paper":"/paper/2403.05518","citing_paper":"/paper/2607.21090"},"observation_digest":"sha256:f9c858b0be2cab6ef8506718570a80cb336fe05a676c68c3cebb3a916aff0c1d","observation_id":"2ec7fa9d-9a25-48da-b92d-e016c4c1eeeb","resolution":{"observed_at":"2026-08-01T08:36:28.549466Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2403.05518/citation-record","integrity":"/paper/2403.05518/integrity","json":"/paper/2403.05518/citation-record.json","paper":"/paper/2403.05518"},"outbound":[],"paper":{"arxiv_id":"2403.05518","last_updated":"2025-06-26T19:29:49Z","latest_version":3,"primary_category":"cs.CL","snapshot_observed_at":"2026-07-06T17:41:42.995949Z","submitted_at":"2024-03-08T18:41:42Z","title":"Bias-Augmented Consistency Training Reduces Biased Reasoning in Chain-of-Thought"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 11 inbound Pith citation observations for arXiv:2403.05518."}