{"as_of":"2026-08-07T07:17:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:10f3b1c88483473e33831add9ba33fd3f76b124d42251a06fceb5c88dc67662f","coverage":[{"denominator":31,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":31,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T05:08:12.800621Z","state":"measured"},{"denominator":32,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":32,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-28T17:17:44.826139Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-06-28T17:22:25.112597Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2508.02186","last_updated":"2025-08-04T08:31:45Z","snapshot_observed_at":"2026-08-06T05:08:08.378701Z","submitted_at":"2025-08-04T08:31:45Z","title":"Failure Cases Are Better Learned But Boundary Says Sorry: Facilitating Smooth Perception Change for Accuracy-Robustness Trade-Off in Adversarial Training","version":1},"cited_work":{"arxiv_id":"2508.02186","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2508.02186","snapshot_observed_at":"2026-06-28T17:22:25.112597Z","title":"FailureCasesAreBetterLearnedButBoundarySaysSorry:Facilitating Smooth Perception Change for Accuracy-Robustness Trade-Off in Adversarial Training","venue":null,"work_id":"c608dd86-1ccf-4d50-a1c2-bee734a330fa","year":2025},"citing_paper":{"arxiv_id":"2606.01437","last_updated":"2026-05-31T20:17:13Z","snapshot_observed_at":"2026-08-01T21:00:36.921047Z","submitted_at":"2026-05-31T20:17:13Z","title":"CEAR: Certified Ensemble Adversarial Robustness in DNNs","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-06-28T17:17:44.826139Z"},"links":{"cited_paper":"/paper/2508.02186","citing_paper":"/paper/2606.01437"},"observation_digest":"sha256:58efc3ac08b119bf02322cdccd8ff2dff9ad09c51b22db1f7217fccc50220f3a","observation_id":"351497bb-0519-4a31-bf97-51810c72946f","resolution":{"observed_at":"2026-06-28T17:22:25.114443Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2508.02186/citation-record","integrity":"/paper/2508.02186/integrity","json":"/paper/2508.02186/citation-record.json","paper":"/paper/2508.02186"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2412.16720","last_updated":"2026-04-30T02:46:40Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-21T18:04:31Z","title":"OpenAI o1 System Card","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.16720","snapshot_observed_at":"2026-08-06T05:08:10.190896Z","title":"Openai o1 system card,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.02186","last_updated":"2025-08-04T08:31:45Z","snapshot_observed_at":"2026-08-06T05:08:08.378701Z","submitted_at":"2025-08-04T08:31:45Z","title":"Failure Cases Are Better Learned But Boundary Says Sorry: Facilitating Smooth Perception Change for Accuracy-Robustness Trade-Off in Adversarial Training","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T05:08:10.190896Z"},"links":{"cited_paper":"/paper/2412.16720","citing_paper":"/paper/2508.02186"},"observation_digest":"sha256:32b17209ee0fb9ae88963f66a6c78d3aa38ac84acd3e02e99c85820dd579f6f1","observation_id":"521ba75a-1329-4cd3-8f8d-ac40f3e50fdb","resolution":{"observed_at":"2026-08-06T05:08:10.190896Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-06T05:08:10.256798Z","title":"Deepseek-r1: Incentivizing reasoning capability in llms via reinforcement learning,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.02186","last_updated":"2025-08-04T08:31:45Z","snapshot_observed_at":"2026-08-06T05:08:08.378701Z","submitted_at":"2025-08-04T08:31:45Z","title":"Failure Cases Are Better Learned But Boundary Says Sorry: Facilitating Smooth Perception Change for Accuracy-Robustness Trade-Off in Adversarial Training","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T05:08:10.256798Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2508.02186"},"observation_digest":"sha256:6aaf8828f804d1634c1e180194ac90f39b9d5f110a72f29f4d06b624ddb7e5c0","observation_id":"40eaebf6-edc1-49c4-91ca-0bf36c606893","resolution":{"observed_at":"2026-08-06T05:08:10.256798Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.21187","last_updated":"2025-02-01T07:57:37Z","snapshot_observed_at":"2026-08-01T16:43:44.704797Z","submitted_at":"2024-12-30T18:55:12Z","title":"Do NOT Think That Much for 2+3=? On the Overthinking of o1-Like LLMs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.21187","snapshot_observed_at":"2026-08-06T05:08:10.374721Z","title":"Do not think that much for 2+ 3=? on the overthinking of o1-like llms,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.02186","last_updated":"2025-08-04T08:31:45Z","snapshot_observed_at":"2026-08-06T05:08:08.378701Z","submitted_at":"2025-08-04T08:31:45Z","title":"Failure Cases Are Better Learned But Boundary Says Sorry: Facilitating Smooth Perception Change for Accuracy-Robustness Trade-Off in Adversarial Training","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T05:08:10.374721Z"},"links":{"cited_paper":"/paper/2412.21187","citing_paper":"/paper/2508.02186"},"observation_digest":"sha256:e9f7fe5cb81ce618461b5a7be0c28de101c39542a1f507bf45206d1b50b70da5","observation_id":"d1eaec9f-8804-40ec-999b-ae1ddea56737","resolution":{"observed_at":"2026-08-06T05:08:10.374721Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.16419","last_updated":"2025-08-21T19:14:40Z","snapshot_observed_at":"2026-08-07T04:27:23.738927Z","submitted_at":"2025-03-20T17:59:38Z","title":"Stop Overthinking: A Survey on Efficient Reasoning for Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.16419","snapshot_observed_at":"2026-08-06T05:08:10.498742Z","title":"Stop overthinking: A survey on efficient reasoning for large language models,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.02186","last_updated":"2025-08-04T08:31:45Z","snapshot_observed_at":"2026-08-06T05:08:08.378701Z","submitted_at":"2025-08-04T08:31:45Z","title":"Failure Cases Are Better Learned But Boundary Says Sorry: Facilitating Smooth Perception Change for Accuracy-Robustness Trade-Off in Adversarial Training","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T05:08:10.498742Z"},"links":{"cited_paper":"/paper/2503.16419","citing_paper":"/paper/2508.02186"},"observation_digest":"sha256:0449ba2f2abd271a8c32d5643f6f99f1bf9600cd9f5284f8de67a04480db49d1","observation_id":"a327b30d-25c0-410c-ac2a-6739cbc9a188","resolution":{"observed_at":"2026-08-06T05:08:10.498742Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.12353","last_updated":"2025-06-14T05:30:09Z","snapshot_observed_at":"2026-08-07T00:49:40.964140Z","submitted_at":"2025-06-14T05:30:09Z","title":"Efficient Reasoning Through Suppression of Self-Affirmation Reflections in Large Reasoning Models","version":1},"cited_work":{"arxiv_id":"2506.12353","doi":null,"metadata_source":"pith","pith_arxiv_id":"2506.12353","snapshot_observed_at":"2026-08-06T05:08:13.018927Z","title":"Efficient Reasoning Through Suppression of Self-Affirmation Reflections in Large Reasoning Models","venue":"cs.CL","work_id":"fabd6448-6a85-4741-9d54-4f5fa5f6c36b","year":2025},"citing_paper":{"arxiv_id":"2508.02186","last_updated":"2025-08-04T08:31:45Z","snapshot_observed_at":"2026-08-06T05:08:08.378701Z","submitted_at":"2025-08-04T08:31:45Z","title":"Failure Cases Are Better Learned But Boundary Says Sorry: Facilitating Smooth Perception Change for Accuracy-Robustness Trade-Off in Adversarial Training","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T05:08:10.593722Z"},"links":{"cited_paper":"/paper/2506.12353","citing_paper":"/paper/2508.02186"},"observation_digest":"sha256:e797b9691c51fa82ae6c5a13cfd389053708b7ecf45917659983896610387f51","observation_id":"a2230aad-aa95-4a74-98f9-df858b7527ff","resolution":{"observed_at":"2026-08-06T05:08:13.098887Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:08:15.278343Z","title":"On reasoning strength planning in large reasoning models,","venue":null,"work_id":"a8323d3e-97ec-45f7-9370-752eb02676f9","year":2026},"citing_paper":{"arxiv_id":"2508.02186","last_updated":"2025-08-04T08:31:45Z","snapshot_observed_at":"2026-08-06T05:08:08.378701Z","submitted_at":"2025-08-04T08:31:45Z","title":"Failure Cases Are Better Learned But Boundary Says Sorry: Facilitating Smooth Perception Change for Accuracy-Robustness Trade-Off in Adversarial Training","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T05:08:10.679983Z"},"links":{"citing_paper":"/paper/2508.02186"},"observation_digest":"sha256:e494bfb3ee341a8fd2554fe85ae523d431e2bcd72c37b6174288375e7bd3e9ab","observation_id":"fab89506-7469-4de6-ab70-cddda240ce39","resolution":{"observed_at":"2026-08-06T05:08:15.343009Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.08343","last_updated":"2025-06-18T14:43:36Z","snapshot_observed_at":"2026-08-07T05:10:59.917329Z","submitted_at":"2025-06-10T01:54:04Z","title":"Wait, We Don't Need to \"Wait\"! Removing Thinking Tokens Improves Reasoning Efficiency","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.08343","snapshot_observed_at":"2026-08-06T05:08:10.743319Z","title":"Wait, we don’t need to","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.02186","last_updated":"2025-08-04T08:31:45Z","snapshot_observed_at":"2026-08-06T05:08:08.378701Z","submitted_at":"2025-08-04T08:31:45Z","title":"Failure Cases Are Better Learned But Boundary Says Sorry: Facilitating Smooth Perception Change for Accuracy-Robustness Trade-Off in Adversarial Training","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T05:08:10.743319Z"},"links":{"cited_paper":"/paper/2506.08343","citing_paper":"/paper/2508.02186"},"observation_digest":"sha256:65f2604c521cc67a0ad5bb25436ddc65c510a6096d42c3f32ee8f2be27d4632a","observation_id":"5ed0d81d-c867-47f4-adfa-3c9d21dd653a","resolution":{"observed_at":"2026-08-06T05:08:10.743319Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.18585","last_updated":"2025-02-18T16:51:53Z","snapshot_observed_at":"2026-07-06T20:28:33.378335Z","submitted_at":"2025-01-30T18:58:18Z","title":"Thoughts Are All Over the Place: On the Underthinking of o1-Like LLMs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.18585","snapshot_observed_at":"2026-08-06T05:08:10.807715Z","title":"Thoughts are all over the place: On the underthinking of o1-like llms,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.02186","last_updated":"2025-08-04T08:31:45Z","snapshot_observed_at":"2026-08-06T05:08:08.378701Z","submitted_at":"2025-08-04T08:31:45Z","title":"Failure Cases Are Better Learned But Boundary Says Sorry: Facilitating Smooth Perception Change for Accuracy-Robustness Trade-Off in Adversarial Training","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T05:08:10.807715Z"},"links":{"cited_paper":"/paper/2501.18585","citing_paper":"/paper/2508.02186"},"observation_digest":"sha256:171a76afae8198017ae388687809af8b4100d58bee655879c08e5d6ca4eb8c16","observation_id":"8858b52a-37b7-43a8-8586-e097cd95e7ea","resolution":{"observed_at":"2026-08-06T05:08:10.807715Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12570","last_updated":"2025-01-29T03:11:03Z","snapshot_observed_at":"2026-07-06T20:24:12.803909Z","submitted_at":"2025-01-22T01:35:11Z","title":"O1-Pruner: Length-Harmonizing Fine-Tuning for O1-Like Reasoning Pruning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12570","snapshot_observed_at":"2026-08-06T05:08:10.890536Z","title":"O1-pruner: Length-harmonizing fine-tuning for o1-like reasoning pruning,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.02186","last_updated":"2025-08-04T08:31:45Z","snapshot_observed_at":"2026-08-06T05:08:08.378701Z","submitted_at":"2025-08-04T08:31:45Z","title":"Failure Cases Are Better Learned But Boundary Says Sorry: Facilitating Smooth Perception Change for Accuracy-Robustness Trade-Off in Adversarial Training","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T05:08:10.890536Z"},"links":{"cited_paper":"/paper/2501.12570","citing_paper":"/paper/2508.02186"},"observation_digest":"sha256:62539ac5015cfeb243238b099fc2d980f43b61fc51efe8edeafee52d012f9df6","observation_id":"485334e8-46cf-4e65-9298-00594d41d28e","resolution":{"observed_at":"2026-08-06T05:08:10.890536Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:08:15.143486Z","title":"Training language models to reason effi- ciently,","venue":null,"work_id":"e5e5da95-d3f9-4359-bc4f-4aed4974bfac","year":2026},"citing_paper":{"arxiv_id":"2508.02186","last_updated":"2025-08-04T08:31:45Z","snapshot_observed_at":"2026-08-06T05:08:08.378701Z","submitted_at":"2025-08-04T08:31:45Z","title":"Failure Cases Are Better Learned But Boundary Says Sorry: Facilitating Smooth Perception Change for Accuracy-Robustness Trade-Off in Adversarial Training","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T05:08:10.976446Z"},"links":{"citing_paper":"/paper/2508.02186"},"observation_digest":"sha256:9a252f71568cd0d4e32e0ef2127a3281b58dc6fc7231e92b0573dafa9f8d453b","observation_id":"d05e6839-a82d-400a-8666-1d909cd41412","resolution":{"observed_at":"2026-08-06T05:08:15.210401Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:08:11.039341Z","title":"Chain-of-thought prompting elicits reasoning in large language models,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.02186","last_updated":"2025-08-04T08:31:45Z","snapshot_observed_at":"2026-08-06T05:08:08.378701Z","submitted_at":"2025-08-04T08:31:45Z","title":"Failure Cases Are Better Learned But Boundary Says Sorry: Facilitating Smooth Perception Change for Accuracy-Robustness Trade-Off in Adversarial Training","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T05:08:11.039341Z"},"links":{"citing_paper":"/paper/2508.02186"},"observation_digest":"sha256:2afc3c296787d48d3c879138186f8490075babb1d9f34273d1bef1738ebb36ef","observation_id":"9c2925d9-1ba6-46d9-beec-995c06c1c312","resolution":{"observed_at":"2026-08-06T05:08:11.039341Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:08:14.929263Z","title":"Reasoning with language model prompting: A survey,","venue":null,"work_id":"7ec28c98-f0b7-4d1d-ac13-834b3c6a2a71","year":2023},"citing_paper":{"arxiv_id":"2508.02186","last_updated":"2025-08-04T08:31:45Z","snapshot_observed_at":"2026-08-06T05:08:08.378701Z","submitted_at":"2025-08-04T08:31:45Z","title":"Failure Cases Are Better Learned But Boundary Says Sorry: Facilitating Smooth Perception Change for Accuracy-Robustness Trade-Off in Adversarial Training","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T05:08:11.105283Z"},"links":{"citing_paper":"/paper/2508.02186"},"observation_digest":"sha256:c11cf2ca8e80cce754cd0501879a6cc6dcac821fc8f9372fd818c639a9b53f22","observation_id":"1fb219ad-9146-41ce-8b08-f42b54d63bdd","resolution":{"observed_at":"2026-08-06T05:08:15.034304Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:08:14.735379Z","title":"Dast: Difficulty-adaptive slow-thinking for large reasoning models,","venue":null,"work_id":"5cbac596-f5af-4546-bb59-8b4aad6cf96f","year":2025},"citing_paper":{"arxiv_id":"2508.02186","last_updated":"2025-08-04T08:31:45Z","snapshot_observed_at":"2026-08-06T05:08:08.378701Z","submitted_at":"2025-08-04T08:31:45Z","title":"Failure Cases Are Better Learned But Boundary Says Sorry: Facilitating Smooth Perception Change for Accuracy-Robustness Trade-Off in Adversarial Training","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T05:08:11.229103Z"},"links":{"citing_paper":"/paper/2508.02186"},"observation_digest":"sha256:5dbb0d203c652a338b54da010a71599ad0da2ba0ceeafebf54a649ec4d0ac51e","observation_id":"88ebd071-3832-41d0-b71f-3cda71f6fc44","resolution":{"observed_at":"2026-08-06T05:08:14.806853Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.03234","last_updated":"2025-05-21T15:26:54Z","snapshot_observed_at":"2026-07-06T21:04:11.067292Z","submitted_at":"2025-04-04T07:34:01Z","title":"Think When You Need: Self-Adaptive Chain-of-Thought Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.03234","snapshot_observed_at":"2026-08-06T05:08:11.326869Z","title":"Think when you need: Self-adaptive chain- of-thought learning,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.02186","last_updated":"2025-08-04T08:31:45Z","snapshot_observed_at":"2026-08-06T05:08:08.378701Z","submitted_at":"2025-08-04T08:31:45Z","title":"Failure Cases Are Better Learned But Boundary Says Sorry: Facilitating Smooth Perception Change for Accuracy-Robustness Trade-Off in Adversarial Training","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T05:08:11.326869Z"},"links":{"cited_paper":"/paper/2504.03234","citing_paper":"/paper/2508.02186"},"observation_digest":"sha256:e5f39a288045e3b3678acfc943d6eed78fe2f2ec8d72ddfd02b5dff06d91b891","observation_id":"ded8afa0-bb66-4199-8e42-bfb85be62ee5","resolution":{"observed_at":"2026-08-06T05:08:11.326869Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:08:14.521824Z","title":"Token-budget- aware llm reasoning,","venue":null,"work_id":"07f6cfc2-7e0c-4ca2-bbe6-a7e722b6e899","year":2025},"citing_paper":{"arxiv_id":"2508.02186","last_updated":"2025-08-04T08:31:45Z","snapshot_observed_at":"2026-08-06T05:08:08.378701Z","submitted_at":"2025-08-04T08:31:45Z","title":"Failure Cases Are Better Learned But Boundary Says Sorry: Facilitating Smooth Perception Change for Accuracy-Robustness Trade-Off in Adversarial Training","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T05:08:11.416967Z"},"links":{"citing_paper":"/paper/2508.02186"},"observation_digest":"sha256:e9c0bd37be2a3df0d0222ed6489730aaea148db2a9a59776aaef6a5a3a6303dc","observation_id":"7eca2c49-f8f5-4cb1-8350-007051668f10","resolution":{"observed_at":"2026-08-06T05:08:14.624532Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:08:14.381836Z","title":"Can language models learn to skip steps?","venue":null,"work_id":"f1cfa920-e69b-406d-bf80-f38892cda1c1","year":2024},"citing_paper":{"arxiv_id":"2508.02186","last_updated":"2025-08-04T08:31:45Z","snapshot_observed_at":"2026-08-06T05:08:08.378701Z","submitted_at":"2025-08-04T08:31:45Z","title":"Failure Cases Are Better Learned But Boundary Says Sorry: Facilitating Smooth Perception Change for Accuracy-Robustness Trade-Off in Adversarial Training","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T05:08:11.510538Z"},"links":{"citing_paper":"/paper/2508.02186"},"observation_digest":"sha256:c7de3bd3515643ea193d164b34d281647a602e20181dbc5d456c00dd948e7733","observation_id":"cd454ec8-313d-4a27-aefd-16d204ee7e9e","resolution":{"observed_at":"2026-08-06T05:08:14.482819Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:08:14.222604Z","title":"Cot-valve: Length- compressible chain-of-thought tuning,","venue":null,"work_id":"c9510fed-f74b-4d6b-a06d-fc0a3d548e6a","year":2025},"citing_paper":{"arxiv_id":"2508.02186","last_updated":"2025-08-04T08:31:45Z","snapshot_observed_at":"2026-08-06T05:08:08.378701Z","submitted_at":"2025-08-04T08:31:45Z","title":"Failure Cases Are Better Learned But Boundary Says Sorry: Facilitating Smooth Perception Change for Accuracy-Robustness Trade-Off in Adversarial Training","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T05:08:11.581910Z"},"links":{"citing_paper":"/paper/2508.02186"},"observation_digest":"sha256:54ed91d8a648fac0b77dcb9a621481710b0c49922670e64e0da189052bc8010f","observation_id":"f6c42539-1989-485b-9672-74ad5a52148b","resolution":{"observed_at":"2026-08-06T05:08:14.306792Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:08:14.075673Z","title":"Data-efficient rein- forcement learning for complex nonlinear systems,","venue":null,"work_id":"b73af954-dda8-4e31-b7ca-00a045067008","year":2023},"citing_paper":{"arxiv_id":"2508.02186","last_updated":"2025-08-04T08:31:45Z","snapshot_observed_at":"2026-08-06T05:08:08.378701Z","submitted_at":"2025-08-04T08:31:45Z","title":"Failure Cases Are Better Learned But Boundary Says Sorry: Facilitating Smooth Perception Change for Accuracy-Robustness Trade-Off in Adversarial Training","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T05:08:11.695318Z"},"links":{"citing_paper":"/paper/2508.02186"},"observation_digest":"sha256:f166e120a503ab61fef98d33102e53bd8c33bc6a2d47cb3e8d75c1fd410c1261","observation_id":"dc59d6e1-9e2a-43e6-a6ce-631fc02fa798","resolution":{"observed_at":"2026-08-06T05:08:14.144549Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12599","last_updated":"2025-06-03T02:14:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T02:48:14Z","title":"Kimi k1.5: Scaling Reinforcement Learning with LLMs","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12599","snapshot_observed_at":"2026-08-06T05:08:11.793313Z","title":"Kimi k1. 5: Scaling reinforcement learning with llms,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.02186","last_updated":"2025-08-04T08:31:45Z","snapshot_observed_at":"2026-08-06T05:08:08.378701Z","submitted_at":"2025-08-04T08:31:45Z","title":"Failure Cases Are Better Learned But Boundary Says Sorry: Facilitating Smooth Perception Change for Accuracy-Robustness Trade-Off in Adversarial Training","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T05:08:11.793313Z"},"links":{"cited_paper":"/paper/2501.12599","citing_paper":"/paper/2508.02186"},"observation_digest":"sha256:d843f49c4c4cd5e78d41463bd59b247d161f3195af4057faf00a934f611906fb","observation_id":"c2c3d6d9-8ffb-4831-a490-47ee413b30a5","resolution":{"observed_at":"2026-08-06T05:08:11.793313Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.01296","last_updated":"2025-04-02T01:59:26Z","snapshot_observed_at":"2026-07-30T08:40:23.849282Z","submitted_at":"2025-04-02T01:59:26Z","title":"ThinkPrune: Pruning Long Chain-of-Thought of LLMs via Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.01296","snapshot_observed_at":"2026-08-06T05:08:11.890551Z","title":"Thinkprune: Pruning long chain-of-thought of llms via reinforcement learning,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.02186","last_updated":"2025-08-04T08:31:45Z","snapshot_observed_at":"2026-08-06T05:08:08.378701Z","submitted_at":"2025-08-04T08:31:45Z","title":"Failure Cases Are Better Learned But Boundary Says Sorry: Facilitating Smooth Perception Change for Accuracy-Robustness Trade-Off in Adversarial Training","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T05:08:11.890551Z"},"links":{"cited_paper":"/paper/2504.01296","citing_paper":"/paper/2508.02186"},"observation_digest":"sha256:2e720cb00635c6857b873b6abbfe0bcc3d130d5bbe867b8e4b674f28dc27e9e8","observation_id":"90cb4fe0-b8d8-4a98-adc4-35de0af72969","resolution":{"observed_at":"2026-08-06T05:08:11.890551Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.14755","last_updated":"2025-09-11T02:13:24Z","snapshot_observed_at":"2026-08-07T00:07:24.304900Z","submitted_at":"2025-06-17T17:50:16Z","title":"Optimizing Length Compression in Large Reasoning Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.14755","snapshot_observed_at":"2026-08-06T05:08:11.949845Z","title":"Optimizing length compression in large reasoning models,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.02186","last_updated":"2025-08-04T08:31:45Z","snapshot_observed_at":"2026-08-06T05:08:08.378701Z","submitted_at":"2025-08-04T08:31:45Z","title":"Failure Cases Are Better Learned But Boundary Says Sorry: Facilitating Smooth Perception Change for Accuracy-Robustness Trade-Off in Adversarial Training","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T05:08:11.949845Z"},"links":{"cited_paper":"/paper/2506.14755","citing_paper":"/paper/2508.02186"},"observation_digest":"sha256:460a02b15e4c18b4e61fff9dca1ff8a4d5bda46b5a929c3229ebefdc2afef721","observation_id":"e4466a45-860c-4843-ac05-09dab89649c4","resolution":{"observed_at":"2026-08-06T05:08:11.949845Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:08:13.928341Z","title":"Learn to reason efficiently with adaptive length-based reward shaping,","venue":null,"work_id":"7b7d9cde-1af3-4b3d-a24c-5306bdd7b3ef","year":2026},"citing_paper":{"arxiv_id":"2508.02186","last_updated":"2025-08-04T08:31:45Z","snapshot_observed_at":"2026-08-06T05:08:08.378701Z","submitted_at":"2025-08-04T08:31:45Z","title":"Failure Cases Are Better Learned But Boundary Says Sorry: Facilitating Smooth Perception Change for Accuracy-Robustness Trade-Off in Adversarial Training","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T05:08:12.039740Z"},"links":{"citing_paper":"/paper/2508.02186"},"observation_digest":"sha256:91638fc04a32b39679bce8ace2d0c7b427b4141c868d21512f56d32313725c0b","observation_id":"d6915e61-61a0-4f32-a12b-f985863a2d14","resolution":{"observed_at":"2026-08-06T05:08:14.016628Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:08:13.752373Z","title":"A survey on reinforcement learning for recommender systems,","venue":null,"work_id":"6e7502bb-da48-4e04-99b6-80907130fddf","year":2023},"citing_paper":{"arxiv_id":"2508.02186","last_updated":"2025-08-04T08:31:45Z","snapshot_observed_at":"2026-08-06T05:08:08.378701Z","submitted_at":"2025-08-04T08:31:45Z","title":"Failure Cases Are Better Learned But Boundary Says Sorry: Facilitating Smooth Perception Change for Accuracy-Robustness Trade-Off in Adversarial Training","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T05:08:12.135163Z"},"links":{"citing_paper":"/paper/2508.02186"},"observation_digest":"sha256:f0f710b3fa1a362656b2ad569a121c07c81c0aa654532d5c03c51a936d65ddfc","observation_id":"9801a469-2c31-4c57-9b23-11cecbb294cf","resolution":{"observed_at":"2026-08-06T05:08:13.855457Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.12022","last_updated":"2023-11-20T18:57:34Z","snapshot_observed_at":"2026-08-04T22:55:15.345443Z","submitted_at":"2023-11-20T18:57:34Z","title":"GPQA: A Graduate-Level Google-Proof Q&A Benchmark","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.12022","snapshot_observed_at":"2026-08-06T05:08:12.229405Z","title":"Gpqa: A graduate-level google-proof q&a benchmark,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.02186","last_updated":"2025-08-04T08:31:45Z","snapshot_observed_at":"2026-08-06T05:08:08.378701Z","submitted_at":"2025-08-04T08:31:45Z","title":"Failure Cases Are Better Learned But Boundary Says Sorry: Facilitating Smooth Perception Change for Accuracy-Robustness Trade-Off in Adversarial Training","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T05:08:12.229405Z"},"links":{"cited_paper":"/paper/2311.12022","citing_paper":"/paper/2508.02186"},"observation_digest":"sha256:baf99af0ad34d1d8ca0fb1fc4a94fc1262aa77aa11e7c099be7a798a8ee15600","observation_id":"adcddd72-8f26-4a80-82e7-625eca13fe55","resolution":{"observed_at":"2026-08-06T05:08:12.229405Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:08:13.592698Z","title":"Livecodebench: Holistic and contamination free evaluation of large language models for code,","venue":null,"work_id":"23d19cda-8302-4d18-8983-668c56e93018","year":2025},"citing_paper":{"arxiv_id":"2508.02186","last_updated":"2025-08-04T08:31:45Z","snapshot_observed_at":"2026-08-06T05:08:08.378701Z","submitted_at":"2025-08-04T08:31:45Z","title":"Failure Cases Are Better Learned But Boundary Says Sorry: Facilitating Smooth Perception Change for Accuracy-Robustness Trade-Off in Adversarial Training","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T05:08:12.320141Z"},"links":{"citing_paper":"/paper/2508.02186"},"observation_digest":"sha256:8386d3b771c674f8426d890b074532de047fee972c5c84c6358c3781fffd4595","observation_id":"0a138f5a-c56c-491b-9adc-c90a4f345df9","resolution":{"observed_at":"2026-08-06T05:08:13.680744Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:08:12.403992Z","title":"Hybridflow: A flexible and efficient rlhf framework,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.02186","last_updated":"2025-08-04T08:31:45Z","snapshot_observed_at":"2026-08-06T05:08:08.378701Z","submitted_at":"2025-08-04T08:31:45Z","title":"Failure Cases Are Better Learned But Boundary Says Sorry: Facilitating Smooth Perception Change for Accuracy-Robustness Trade-Off in Adversarial Training","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T05:08:12.403992Z"},"links":{"citing_paper":"/paper/2508.02186"},"observation_digest":"sha256:9104663d0c5cace62d6eae807b88e960e4cadc5b575b4da88027193078f14e99","observation_id":"3b018bbb-1ba5-45df-a54a-81943378ccf4","resolution":{"observed_at":"2026-08-06T05:08:12.403992Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03300","last_updated":"2024-04-27T15:25:53Z","snapshot_observed_at":"2026-08-06T14:58:42.911363Z","submitted_at":"2024-02-05T18:55:32Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.03300","snapshot_observed_at":"2026-08-06T05:08:12.506419Z","title":"Deepseekmath: Pushing the limits of mathematical reasoning in open language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.02186","last_updated":"2025-08-04T08:31:45Z","snapshot_observed_at":"2026-08-06T05:08:08.378701Z","submitted_at":"2025-08-04T08:31:45Z","title":"Failure Cases Are Better Learned But Boundary Says Sorry: Facilitating Smooth Perception Change for Accuracy-Robustness Trade-Off in Adversarial Training","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T05:08:12.506419Z"},"links":{"cited_paper":"/paper/2402.03300","citing_paper":"/paper/2508.02186"},"observation_digest":"sha256:a9a27076f46fb2beef93a0a6f75a5ad3131874f866646ac25f1f64619bbd66cc","observation_id":"d80eb73d-4078-4f53-a4f7-a30aba153225","resolution":{"observed_at":"2026-08-06T05:08:12.506419Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:08:13.378329Z","title":"Deepscaler: Surpassing o1-preview with a 1.5 b model by scaling rl,","venue":null,"work_id":"e1e377e5-4df8-4cd8-a9a3-d98a5abd430c","year":2025},"citing_paper":{"arxiv_id":"2508.02186","last_updated":"2025-08-04T08:31:45Z","snapshot_observed_at":"2026-08-06T05:08:08.378701Z","submitted_at":"2025-08-04T08:31:45Z","title":"Failure Cases Are Better Learned But Boundary Says Sorry: Facilitating Smooth Perception Change for Accuracy-Robustness Trade-Off in Adversarial Training","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T05:08:12.567366Z"},"links":{"citing_paper":"/paper/2508.02186"},"observation_digest":"sha256:d19de9570a8238a24ec42c00c24250176af96f4e9c4626e996cace53efad1ba5","observation_id":"31478fc7-1122-402e-a4c7-8698150747b5","resolution":{"observed_at":"2026-08-06T05:08:13.513040Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2110.14168","last_updated":"2021-11-18T00:23:45Z","snapshot_observed_at":"2026-08-07T01:45:38.840969Z","submitted_at":"2021-10-27T04:49:45Z","title":"Training Verifiers to Solve Math Word Problems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.14168","snapshot_observed_at":"2026-08-06T05:08:12.656410Z","title":"Training verifiers to solve math word problems,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2508.02186","last_updated":"2025-08-04T08:31:45Z","snapshot_observed_at":"2026-08-06T05:08:08.378701Z","submitted_at":"2025-08-04T08:31:45Z","title":"Failure Cases Are Better Learned But Boundary Says Sorry: Facilitating Smooth Perception Change for Accuracy-Robustness Trade-Off in Adversarial Training","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T05:08:12.656410Z"},"links":{"cited_paper":"/paper/2110.14168","citing_paper":"/paper/2508.02186"},"observation_digest":"sha256:1b5f9bbb6dd608e314108cc14a05bcf8c478669381c635c362844e66bb0a8448","observation_id":"63786440-f1d6-4606-b1ff-0d1a3c1875ed","resolution":{"observed_at":"2026-08-06T05:08:12.656410Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2103.03874","last_updated":"2021-11-08T21:30:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-03-05T18:59:39Z","title":"Measuring Mathematical Problem Solving With the MATH Dataset","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2103.03874","snapshot_observed_at":"2026-08-06T05:08:12.721234Z","title":"Measuring mathematical problem solving with the math dataset,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2508.02186","last_updated":"2025-08-04T08:31:45Z","snapshot_observed_at":"2026-08-06T05:08:08.378701Z","submitted_at":"2025-08-04T08:31:45Z","title":"Failure Cases Are Better Learned But Boundary Says Sorry: Facilitating Smooth Perception Change for Accuracy-Robustness Trade-Off in Adversarial Training","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T05:08:12.721234Z"},"links":{"cited_paper":"/paper/2103.03874","citing_paper":"/paper/2508.02186"},"observation_digest":"sha256:84d33870d79ee2ee01521a221a0f780d63592c5baa582321f4ce1956f7a89f57","observation_id":"6e2aa0cd-210c-4cb7-a7ed-892c32d24fc0","resolution":{"observed_at":"2026-08-06T05:08:12.721234Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:08:13.212942Z","title":"Mind the gap: Bridging thought leap for improved chain-of-thought tuning,","venue":null,"work_id":"6bfaa9d2-7268-4711-9d6f-134af308c842","year":2026},"citing_paper":{"arxiv_id":"2508.02186","last_updated":"2025-08-04T08:31:45Z","snapshot_observed_at":"2026-08-06T05:08:08.378701Z","submitted_at":"2025-08-04T08:31:45Z","title":"Failure Cases Are Better Learned But Boundary Says Sorry: Facilitating Smooth Perception Change for Accuracy-Robustness Trade-Off in Adversarial Training","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T05:08:12.800621Z"},"links":{"citing_paper":"/paper/2508.02186"},"observation_digest":"sha256:a953317eb07e41357c199cb5c5255073f845480f9235ab81dd258996ca68e5b1","observation_id":"a0524808-5450-43a3-a900-f615b561182c","resolution":{"observed_at":"2026-08-06T05:08:13.277511Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2508.02186","last_updated":"2025-08-04T08:31:45Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-06T05:08:08.378701Z","submitted_at":"2025-08-04T08:31:45Z","title":"Failure Cases Are Better Learned But Boundary Says Sorry: Facilitating Smooth Perception Change for Accuracy-Robustness Trade-Off in Adversarial Training"},"reference_resolution":{"displayed":31,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":17,"verified_exact":1,"verified_fuzzy":13},"total_outbound_references":31},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 31 of 31 outbound references and 1 inbound Pith citation observation for arXiv:2508.02186."}