{"as_of":"2026-08-15T03:34:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:f25e979faf289b36315ba582071cbb09d81fa3e7c9509fe6e65f513b1d7d85e1","coverage":[{"denominator":5,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":5,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-30T17:52:37.166936Z","state":"measured"},{"denominator":8,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":8,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-14T06:32:32.682623+00:00","state":"measured"},{"denominator":3,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":3,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-03T01:47:20.114106Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2605.19444","last_updated":"2026-05-27T03:12:51Z","snapshot_observed_at":"2026-07-06T23:30:11.337726Z","submitted_at":"2026-05-19T06:58:44Z","title":"Detecting and Mitigating the Correct-Answer Extinction Window in Test-Time Reinforcement Learning with Majority Voting","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.19444","snapshot_observed_at":"2026-08-02T04:39:49.059643Z","title":"When the majority votes wrong, the intervention timing for test-time reinforcement learning hides in the extinction window.arXiv preprint arXiv:2605.19444,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.13643","last_updated":"2026-07-15T09:39:32Z","snapshot_observed_at":"2026-08-12T22:30:16.480607Z","submitted_at":"2026-07-15T09:39:32Z","title":"Consensus as Privileged Context for Label-Free Self-Distillation","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-02T04:39:49.059643Z"},"links":{"cited_paper":"/paper/2605.19444","citing_paper":"/paper/2607.13643"},"observation_digest":"sha256:e7f31804587b5027ab341c04afbe6896e24b64a2bc597a2a9b6f02fdb8ae9631","observation_id":"ee19a5e7-7250-4a4d-ae9e-25eaa03c9f05","resolution":{"observed_at":"2026-08-02T04:39:49.059643Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.19444","last_updated":"2026-05-27T03:12:51Z","snapshot_observed_at":"2026-07-06T23:30:11.337726Z","submitted_at":"2026-05-19T06:58:44Z","title":"Detecting and Mitigating the Correct-Answer Extinction Window in Test-Time Reinforcement Learning with Majority Voting","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.19444","snapshot_observed_at":"2026-07-30T18:33:28.530199Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.26873","last_updated":"2026-07-31T13:09:25Z","snapshot_observed_at":"2026-08-13T19:56:21.477865Z","submitted_at":"2026-07-29T13:03:07Z","title":"SERPO: Self-Evolving Rubric Policy Optimization for Open-Ended Test-Time Reinforcement Learning","version":1},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-07-30T18:33:28.530199Z"},"links":{"cited_paper":"/paper/2605.19444","citing_paper":"/paper/2607.26873"},"observation_digest":"sha256:673c88a97bacc3de28a1ff8b5a4ef12e68f8516ad1b07e683b594667a1ea38bf","observation_id":"014dd7bd-b6c2-4c7b-85f0-60b57d5ea0c4","resolution":{"observed_at":"2026-07-30T18:33:28.530199Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.19444","last_updated":"2026-05-27T03:12:51Z","snapshot_observed_at":"2026-07-06T23:30:11.337726Z","submitted_at":"2026-05-19T06:58:44Z","title":"Detecting and Mitigating the Correct-Answer Extinction Window in Test-Time Reinforcement Learning with Majority Voting","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.19444","snapshot_observed_at":"2026-08-03T01:47:20.114106Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.26873","last_updated":"2026-07-31T13:09:25Z","snapshot_observed_at":"2026-08-13T19:56:21.477865Z","submitted_at":"2026-07-29T13:03:07Z","title":"SERPO: Self-Evolving Rubric Policy Optimization for Open-Ended Test-Time Reinforcement Learning","version":2},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-03T01:47:20.114106Z"},"links":{"cited_paper":"/paper/2605.19444","citing_paper":"/paper/2607.26873"},"observation_digest":"sha256:dc61ab21589636a7f876b9029eb4f0af19212f98ad4356bbcb609c1b2bcc1123","observation_id":"ded5be21-183a-439d-958b-55dc03842715","resolution":{"observed_at":"2026-08-03T01:47:20.114106Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2605.19444/citation-record","integrity":"/paper/2605.19444/integrity","json":"/paper/2605.19444/citation-record.json","paper":"/paper/2605.19444"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.09388","last_updated":"2025-05-14T13:41:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-14T13:41:34Z","title":"Qwen3 Technical Report","version":1},"cited_work":{"arxiv_id":"2505.09388","doi":"10.1016/j.aiopen.2022.12","metadata_source":"pith","pith_arxiv_id":"2505.09388","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Qwen3 Technical Report","venue":"cs.CL","work_id":"25a4e30c-1232-48e7-9925-02fa12ba7c9e","year":2025},"citing_paper":{"arxiv_id":"2605.19444","last_updated":"2026-05-27T03:12:51Z","snapshot_observed_at":"2026-07-06T23:30:11.337726Z","submitted_at":"2026-05-19T06:58:44Z","title":"Detecting and Mitigating the Correct-Answer Extinction Window in Test-Time Reinforcement Learning with Majority Voting","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-06-30T17:52:37.166936Z"},"links":{"cited_paper":"/paper/2505.09388","citing_paper":"/paper/2605.19444"},"observation_digest":"sha256:dc6f5ef0f648278e5a3384231f3bcd0135d49c00d83a249be01839e8dbaf5bfa","observation_id":"bfdd4ab9-0b54-4032-8e74-57b4d60b9a12","resolution":{"observed_at":"2026-06-30T17:54:57.761295Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T07:04:45.575134Z","title":null,"venue":null,"work_id":"79a74a74-7c6d-4a0e-9b18-a6c0feb98ce7","year":2024},"citing_paper":{"arxiv_id":"2605.19444","last_updated":"2026-05-27T03:12:51Z","snapshot_observed_at":"2026-07-06T23:30:11.337726Z","submitted_at":"2026-05-19T06:58:44Z","title":"Detecting and Mitigating the Correct-Answer Extinction Window in Test-Time Reinforcement Learning with Majority Voting","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-06-30T17:52:37.166936Z"},"links":{"citing_paper":"/paper/2605.19444"},"observation_digest":"sha256:eb999cc5041df0157975068288d3e7d7777de5f0fffa0ccd89869261f8628d2a","observation_id":"18ee2ccf-77e7-44d1-9772-d34b1478f902","resolution":{"observed_at":"2026-07-08T07:04:45.576514Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T07:04:45.577491Z","title":null,"venue":null,"work_id":"99edb8d9-f499-45f5-8acb-c76be4563692","year":2024},"citing_paper":{"arxiv_id":"2605.19444","last_updated":"2026-05-27T03:12:51Z","snapshot_observed_at":"2026-07-06T23:30:11.337726Z","submitted_at":"2026-05-19T06:58:44Z","title":"Detecting and Mitigating the Correct-Answer Extinction Window in Test-Time Reinforcement Learning with Majority Voting","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-06-30T17:52:37.166936Z"},"links":{"citing_paper":"/paper/2605.19444"},"observation_digest":"sha256:1bccc14f246ec0523ce3a6345fa4287edd49ac1bf7d807cec576b7b74e9e8718","observation_id":"acd6ac01-0db2-4693-ab09-5dd4b42604e7","resolution":{"observed_at":"2026-07-08T07:04:45.578970Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T07:04:45.579774Z","title":null,"venue":null,"work_id":"d9ddfef4-f8d4-4212-b63b-5ab4c95af47c","year":2024},"citing_paper":{"arxiv_id":"2605.19444","last_updated":"2026-05-27T03:12:51Z","snapshot_observed_at":"2026-07-06T23:30:11.337726Z","submitted_at":"2026-05-19T06:58:44Z","title":"Detecting and Mitigating the Correct-Answer Extinction Window in Test-Time Reinforcement Learning with Majority Voting","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-06-30T17:52:37.166936Z"},"links":{"citing_paper":"/paper/2605.19444"},"observation_digest":"sha256:c16129dc23bb9b11a7c7de592f5ed051d2a6bf9e1bb61786c8871ff08da5f888","observation_id":"ba09358b-3465-4b03-8fcd-de236cd61e0a","resolution":{"observed_at":"2026-07-08T07:04:45.581489Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T07:04:45.572846Z","title":null,"venue":null,"work_id":"3232a962-9dee-466f-beaa-5902615bb36d","year":null},"citing_paper":{"arxiv_id":"2605.19444","last_updated":"2026-05-27T03:12:51Z","snapshot_observed_at":"2026-07-06T23:30:11.337726Z","submitted_at":"2026-05-19T06:58:44Z","title":"Detecting and Mitigating the Correct-Answer Extinction Window in Test-Time Reinforcement Learning with Majority Voting","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-06-30T17:52:37.166936Z"},"links":{"citing_paper":"/paper/2605.19444"},"observation_digest":"sha256:a5a0411063374abbabfe1ea26aac1adf2d1b9136726a43a472e5ec01242c6094","observation_id":"a12378e6-147d-453b-adb1-11bff78866c8","resolution":{"observed_at":"2026-07-08T07:04:45.574304Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2605.19444","last_updated":"2026-05-27T03:12:51Z","latest_version":2,"primary_category":"cs.LG","snapshot_observed_at":"2026-07-06T23:30:11.337726Z","submitted_at":"2026-05-19T06:58:44Z","title":"Detecting and Mitigating the Correct-Answer Extinction Window in Test-Time Reinforcement Learning with Majority Voting"},"reference_resolution":{"displayed":5,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":4,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":5},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"thesis":"As of 15 August 2026, this Paper Citation Record lists 5 of 5 outbound references and 3 inbound Pith citation observations for arXiv:2605.19444."}