{"as_of":"2026-08-10T03:20:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:871ba65f39c6373c852ab728a7101f7bb78aa932250dae5debc6f0404c780df9","coverage":[{"denominator":54,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":54,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-01T05:59:13.631078Z","state":"measured"},{"denominator":54,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":54,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2606.32034/citation-record","integrity":"/paper/2606.32034/integrity","json":"/paper/2606.32034/citation-record.json","paper":"/paper/2606.32034"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-06T19:52:52.666865Z","title":null,"venue":null,"work_id":"3ead4acf-2248-4fb1-a39e-722d0a2d16de","year":null},"citing_paper":{"arxiv_id":"2606.32034","last_updated":"2026-06-30T17:58:23Z","snapshot_observed_at":"2026-08-06T15:45:44.038676Z","submitted_at":"2026-06-30T17:58:23Z","title":"QVal: Cheaply Evaluating Dense Supervision Signals for Long-Horizon LLM Agents","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-07-01T05:59:13.631078Z"},"links":{"citing_paper":"/paper/2606.32034"},"observation_digest":"sha256:b79c6fbf2b17fb56d1f7460b28b24d65468f5871e09163a7583a4cfb22f75230","observation_id":"a3933ee5-792b-4935-b865-81a560bc1ba5","resolution":{"observed_at":"2026-07-06T19:52:52.667924Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2603.22293","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-01T09:55:41.449462Z","title":"Tips: Turn-level information-potential reward shaping for search-augmented llms","venue":null,"work_id":"3f5e397e-5154-48ef-b1a9-7a4beb3c72d8","year":2026},"citing_paper":{"arxiv_id":"2606.32034","last_updated":"2026-06-30T17:58:23Z","snapshot_observed_at":"2026-08-06T15:45:44.038676Z","submitted_at":"2026-06-30T17:58:23Z","title":"QVal: Cheaply Evaluating Dense Supervision Signals for Long-Horizon LLM Agents","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-07-01T05:59:13.631078Z"},"links":{"citing_paper":"/paper/2606.32034"},"observation_digest":"sha256:98ef1256e3bb21c9b40e88effcfa726400d0dc54419930f540631548ed7ffcbc","observation_id":"ef38512a-5a30-4903-91a2-ef47d691f795","resolution":{"observed_at":"2026-07-01T09:55:41.451131Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-06T19:52:52.665081Z","title":null,"venue":null,"work_id":"5ed51915-99b1-42ed-ac7b-e1ff6200e534","year":null},"citing_paper":{"arxiv_id":"2606.32034","last_updated":"2026-06-30T17:58:23Z","snapshot_observed_at":"2026-08-06T15:45:44.038676Z","submitted_at":"2026-06-30T17:58:23Z","title":"QVal: Cheaply Evaluating Dense Supervision Signals for Long-Horizon LLM Agents","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-07-01T05:59:13.631078Z"},"links":{"citing_paper":"/paper/2606.32034"},"observation_digest":"sha256:c64953af83bb616d15763b46428cb322ef7d8bf3bf8c0eacdbbebaccf13ded04","observation_id":"24d96a52-7bdd-41a8-9869-d232d87dadc4","resolution":{"observed_at":"2026-07-06T19:52:52.666198Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-06T19:52:52.663450Z","title":"2026 , note=","venue":null,"work_id":"beac1b72-808e-4c89-a516-fa523b863465","year":2026},"citing_paper":{"arxiv_id":"2606.32034","last_updated":"2026-06-30T17:58:23Z","snapshot_observed_at":"2026-08-06T15:45:44.038676Z","submitted_at":"2026-06-30T17:58:23Z","title":"QVal: Cheaply Evaluating Dense Supervision Signals for Long-Horizon LLM Agents","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-07-01T05:59:13.631078Z"},"links":{"citing_paper":"/paper/2606.32034"},"observation_digest":"sha256:7613e34ae4601f1112acb86aaab70bf6e2e1a0e9ecd7804ee20ea59811bb9f7c","observation_id":"96454670-2fb3-47ab-ad08-5c9d83bb0b81","resolution":{"observed_at":"2026-07-06T19:52:52.664571Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2602.02482","doi":"10.48550/arxiv.2602.02482","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"arXiv preprint arXiv:2602.02482 , year=","venue":"Open MIND","work_id":"c9552e44-1e80-45df-b599-f8554214e923","year":2026},"citing_paper":{"arxiv_id":"2606.32034","last_updated":"2026-06-30T17:58:23Z","snapshot_observed_at":"2026-08-06T15:45:44.038676Z","submitted_at":"2026-06-30T17:58:23Z","title":"QVal: Cheaply Evaluating Dense Supervision Signals for Long-Horizon LLM Agents","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-07-01T05:59:13.631078Z"},"links":{"citing_paper":"/paper/2606.32034"},"observation_digest":"sha256:612fcdc5b0109415ced523d8d86b01fadd07c8534fa49f764439d8fe6cf6e718","observation_id":"67e868da-a636-4816-a9e4-b80fbf478087","resolution":{"observed_at":"2026-07-01T06:05:29.016277Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2601.19897","last_updated":"2026-08-07T16:19:50Z","snapshot_observed_at":"2026-08-10T03:13:10.456328Z","submitted_at":"2026-01-27T18:59:08Z","title":"Self-Distillation Enables Continual Learning","version":2},"cited_work":{"arxiv_id":"2601.19897","doi":"10.48550/arxiv.2601.19897","metadata_source":"pith","pith_arxiv_id":"2601.19897","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Self-Distillation Enables Continual Learning","venue":"cs.LG","work_id":"e9aa25e3-870c-46c8-8270-e4e5948d09f0","year":2026},"citing_paper":{"arxiv_id":"2606.32034","last_updated":"2026-06-30T17:58:23Z","snapshot_observed_at":"2026-08-06T15:45:44.038676Z","submitted_at":"2026-06-30T17:58:23Z","title":"QVal: Cheaply Evaluating Dense Supervision Signals for Long-Horizon LLM Agents","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-07-01T05:59:13.631078Z"},"links":{"cited_paper":"/paper/2601.19897","citing_paper":"/paper/2606.32034"},"observation_digest":"sha256:d7f37fb55b60eac11ebdeda4c29aae16ea10f984908a857a9011f5d18719ae39","observation_id":"f96846f6-2c49-4cdf-a1fc-80af05bb93cb","resolution":{"observed_at":"2026-07-01T06:05:29.019233Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-05-23T10:52:50.091537+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-23T10:52:50.091537+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-06T19:52:52.661519Z","title":"ICLR 2026 Workshop on Lifelong Agents: Learning, Aligning, Evolving , year=","venue":null,"work_id":"14dd6065-a30d-4ace-ac34-f614eecb7d5d","year":2026},"citing_paper":{"arxiv_id":"2606.32034","last_updated":"2026-06-30T17:58:23Z","snapshot_observed_at":"2026-08-06T15:45:44.038676Z","submitted_at":"2026-06-30T17:58:23Z","title":"QVal: Cheaply Evaluating Dense Supervision Signals for Long-Horizon LLM Agents","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-07-01T05:59:13.631078Z"},"links":{"citing_paper":"/paper/2606.32034"},"observation_digest":"sha256:5c0793280782e3a4817b9551fb2e2e4534eb09b0615dfe35505800bb38cac6a4","observation_id":"e7a39243-798b-460c-ba3f-c9c8dc242acb","resolution":{"observed_at":"2026-07-06T19:52:52.662913Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-06T19:52:52.668774Z","title":"and Shaw, Alexander Glenn and Carlini, Nicholas and Li, Boxuan and Raj, Harsh and Bercovich, Ivan and Shi, Lin and Shin, Jeong Yeon and Walshe, Thomas and Buchanan, E","venue":null,"work_id":"8d5aea8b-b0a4-4777-80db-4650e5ce3c51","year":null},"citing_paper":{"arxiv_id":"2606.32034","last_updated":"2026-06-30T17:58:23Z","snapshot_observed_at":"2026-08-06T15:45:44.038676Z","submitted_at":"2026-06-30T17:58:23Z","title":"QVal: Cheaply Evaluating Dense Supervision Signals for Long-Horizon LLM Agents","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-07-01T05:59:13.631078Z"},"links":{"citing_paper":"/paper/2606.32034"},"observation_digest":"sha256:137ee133092d50d3b2861333b6fbf368e44279398c21847df252fa9faf0185bb","observation_id":"5e1dbfb4-b4a2-49f4-bfee-b6c1c623549e","resolution":{"observed_at":"2026-07-06T19:52:52.669996Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-06T19:52:52.657576Z","title":"OpenApps: Simulating Environment Variations to Measure","venue":null,"work_id":"c64645b5-3906-4f86-b0da-1260aa90efdf","year":2026},"citing_paper":{"arxiv_id":"2606.32034","last_updated":"2026-06-30T17:58:23Z","snapshot_observed_at":"2026-08-06T15:45:44.038676Z","submitted_at":"2026-06-30T17:58:23Z","title":"QVal: Cheaply Evaluating Dense Supervision Signals for Long-Horizon LLM Agents","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-07-01T05:59:13.631078Z"},"links":{"citing_paper":"/paper/2606.32034"},"observation_digest":"sha256:a1004b69c5f8c4a9395d440b1eb8c53c02f358f3eabe8b24768d4f76d8a9458c","observation_id":"daf67a23-1f94-4e2e-97f8-499672aba2f5","resolution":{"observed_at":"2026-07-06T19:52:52.658886Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-06T19:52:52.654075Z","title":null,"venue":null,"work_id":"ea6ea37d-495c-462d-b9bb-6aa437507a0b","year":null},"citing_paper":{"arxiv_id":"2606.32034","last_updated":"2026-06-30T17:58:23Z","snapshot_observed_at":"2026-08-06T15:45:44.038676Z","submitted_at":"2026-06-30T17:58:23Z","title":"QVal: Cheaply Evaluating Dense Supervision Signals for Long-Horizon LLM Agents","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-07-01T05:59:13.631078Z"},"links":{"citing_paper":"/paper/2606.32034"},"observation_digest":"sha256:581518e7bb5a360cb0efff56b10c895da3a5facb61a148443f224385f886c540","observation_id":"ba6ae0ce-624a-4edc-b45f-379450f5e549","resolution":{"observed_at":"2026-07-06T19:52:52.655232Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-06T19:52:52.659597Z","title":"and Cola, Gianluca De and Deleu, Tristan and Goulão, Manuel and Andreas, Kallinteris and Krimmel, Markus and Kg, Arjun and Perez-Vicente, Rodrigo De Lazcano and Terry, J","venue":null,"work_id":"adad2a80-5db0-4d57-8b32-d88c4e7799e7","year":null},"citing_paper":{"arxiv_id":"2606.32034","last_updated":"2026-06-30T17:58:23Z","snapshot_observed_at":"2026-08-06T15:45:44.038676Z","submitted_at":"2026-06-30T17:58:23Z","title":"QVal: Cheaply Evaluating Dense Supervision Signals for Long-Horizon LLM Agents","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-07-01T05:59:13.631078Z"},"links":{"citing_paper":"/paper/2606.32034"},"observation_digest":"sha256:4962a75fb4e81ab329bd86c6cccb1d72f07c762f594d7454fda29099fb728cce","observation_id":"a441b8ee-c2e7-4c44-a8e7-286b6eb08e02","resolution":{"observed_at":"2026-07-06T19:52:52.660977Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-06T19:52:52.633607Z","title":null,"venue":null,"work_id":"f7287e69-30ef-4644-a147-f2cc8aeeff2a","year":null},"citing_paper":{"arxiv_id":"2606.32034","last_updated":"2026-06-30T17:58:23Z","snapshot_observed_at":"2026-08-06T15:45:44.038676Z","submitted_at":"2026-06-30T17:58:23Z","title":"QVal: Cheaply Evaluating Dense Supervision Signals for Long-Horizon LLM Agents","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-07-01T05:59:13.631078Z"},"links":{"citing_paper":"/paper/2606.32034"},"observation_digest":"sha256:da642f88ee028f9759865a5777050c724e9a03d755773cc45a396493448ecc31","observation_id":"d154a4ab-95d4-499e-b42d-7cf65972f9a9","resolution":{"observed_at":"2026-07-06T19:52:52.634891Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1093/biomet/33.3.239","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"1945 , pages =","venue":"Biometrika","work_id":"5e22c633-eac0-45d7-915a-00d21df11ece","year":1945},"citing_paper":{"arxiv_id":"2606.32034","last_updated":"2026-06-30T17:58:23Z","snapshot_observed_at":"2026-08-06T15:45:44.038676Z","submitted_at":"2026-06-30T17:58:23Z","title":"QVal: Cheaply Evaluating Dense Supervision Signals for Long-Horizon LLM Agents","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-07-01T05:59:13.631078Z"},"links":{"citing_paper":"/paper/2606.32034"},"observation_digest":"sha256:ed28690c24a2599c5225da7df8bf5c1ec2f7ad7108879fe26b17fa9bae419635","observation_id":"2b76f36d-c9eb-489f-a788-ed46e0424b0f","resolution":{"observed_at":"2026-07-01T06:05:29.021452Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-07-11T17:19:40.035445+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T17:19:40.035445+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.2307/2332226","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"A new measure of rank correlation.Biometrika","venue":"Biometrika","work_id":"76c8c7d6-14af-4d66-b5aa-670717589b73","year":1938},"citing_paper":{"arxiv_id":"2606.32034","last_updated":"2026-06-30T17:58:23Z","snapshot_observed_at":"2026-08-06T15:45:44.038676Z","submitted_at":"2026-06-30T17:58:23Z","title":"QVal: Cheaply Evaluating Dense Supervision Signals for Long-Horizon LLM Agents","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-07-01T05:59:13.631078Z"},"links":{"citing_paper":"/paper/2606.32034"},"observation_digest":"sha256:78c35af7a0d56c699564deec16f8618d9e71a9c386b73a2e9565e4c42c45df3c","observation_id":"109a2582-1c9c-4382-915c-09822e9203ab","resolution":{"observed_at":"2026-07-01T06:05:28.967805Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-08T21:08:07.441425+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-08T21:08:07.441425+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.2307/1412159","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"35 Aarohi Srivastava, Abhinav Rastogi, Abhishek Rao, Abu Awal Md Shoeb, Abubakar Abid, Adam Fisch, Adam R","venue":"The American Journal of Psychology","work_id":"08028e26-3a09-40db-93bb-8403db015860","year":1904},"citing_paper":{"arxiv_id":"2606.32034","last_updated":"2026-06-30T17:58:23Z","snapshot_observed_at":"2026-08-06T15:45:44.038676Z","submitted_at":"2026-06-30T17:58:23Z","title":"QVal: Cheaply Evaluating Dense Supervision Signals for Long-Horizon LLM Agents","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-07-01T05:59:13.631078Z"},"links":{"citing_paper":"/paper/2606.32034"},"observation_digest":"sha256:2b1bec0231321a35d88122ad3a938fedc038685e9716a595db0a02b7b35f17e2","observation_id":"f798e5e3-e701-412b-b403-254a28e52d86","resolution":{"observed_at":"2026-07-01T06:05:29.006831Z","resolver_source":"doi","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-07-12T21:19:58.749456+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-12T21:19:58.749456+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"1896.0007","doi":"10.1098/rsta.1896.0007","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"VII. Mathematical contributions to the theory of evolution.—III. Regression, heredity, and panmixia","venue":"Philosophical Transactions of the Royal Society of London Series A Containing Papers of a Mathematical or Physical Character","work_id":"9b2bc52f-55f2-47b8-8ce0-dfe10389c509","year":null},"citing_paper":{"arxiv_id":"2606.32034","last_updated":"2026-06-30T17:58:23Z","snapshot_observed_at":"2026-08-06T15:45:44.038676Z","submitted_at":"2026-06-30T17:58:23Z","title":"QVal: Cheaply Evaluating Dense Supervision Signals for Long-Horizon LLM Agents","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-07-01T05:59:13.631078Z"},"links":{"citing_paper":"/paper/2606.32034"},"observation_digest":"sha256:4bfb897d1d583f5a194700eb4b22ba39a1857e065c2c8a6923207174991b97d9","observation_id":"98a462d7-08f2-432a-8a94-b3e562f1a572","resolution":{"observed_at":"2026-07-01T06:05:29.004249Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-06T19:52:52.646462Z","title":null,"venue":null,"work_id":"f2198562-ad5c-4075-ad9f-bad6e53cc030","year":null},"citing_paper":{"arxiv_id":"2606.32034","last_updated":"2026-06-30T17:58:23Z","snapshot_observed_at":"2026-08-06T15:45:44.038676Z","submitted_at":"2026-06-30T17:58:23Z","title":"QVal: Cheaply Evaluating Dense Supervision Signals for Long-Horizon LLM Agents","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-07-01T05:59:13.631078Z"},"links":{"citing_paper":"/paper/2606.32034"},"observation_digest":"sha256:4a9a932dc8d47e9c5295713ee585f3b7ed90674fbb018db1a8012a3395419c63","observation_id":"7c0ab1c1-c8c5-47c0-8b53-ef24265f7dbf","resolution":{"observed_at":"2026-07-06T19:52:52.647959Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-06T19:52:52.649979Z","title":"2026 , author =","venue":null,"work_id":"c0179987-de0a-47f1-8dbc-a37d0021ef14","year":2026},"citing_paper":{"arxiv_id":"2606.32034","last_updated":"2026-06-30T17:58:23Z","snapshot_observed_at":"2026-08-06T15:45:44.038676Z","submitted_at":"2026-06-30T17:58:23Z","title":"QVal: Cheaply Evaluating Dense Supervision Signals for Long-Horizon LLM Agents","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-07-01T05:59:13.631078Z"},"links":{"citing_paper":"/paper/2606.32034"},"observation_digest":"sha256:1487ce30bb2468eb198ccdcda73f8c7b309670a2b5a5b419360db7750ae3a721","observation_id":"8f70c172-cc06-4cd3-b833-e878e5cf26ec","resolution":{"observed_at":"2026-07-06T19:52:52.651001Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-06T19:52:52.650444Z","title":null,"venue":null,"work_id":"1aaf10bb-db1e-4f42-8007-6effd2a2db7e","year":null},"citing_paper":{"arxiv_id":"2606.32034","last_updated":"2026-06-30T17:58:23Z","snapshot_observed_at":"2026-08-06T15:45:44.038676Z","submitted_at":"2026-06-30T17:58:23Z","title":"QVal: Cheaply Evaluating Dense Supervision Signals for Long-Horizon LLM Agents","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-07-01T05:59:13.631078Z"},"links":{"citing_paper":"/paper/2606.32034"},"observation_digest":"sha256:0682d88d95c04ec264f871c2d9fe1466e3e30b7fe5d0699916151fee5605cf40","observation_id":"0c81cebf-725e-4c8d-bf0d-d5cd7c9a24a5","resolution":{"observed_at":"2026-07-06T19:52:52.651699Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-06T19:52:52.652293Z","title":"and Barto, Andrew G","venue":null,"work_id":"d5247209-5bc2-4f1b-96dd-57b4967ea72a","year":null},"citing_paper":{"arxiv_id":"2606.32034","last_updated":"2026-06-30T17:58:23Z","snapshot_observed_at":"2026-08-06T15:45:44.038676Z","submitted_at":"2026-06-30T17:58:23Z","title":"QVal: Cheaply Evaluating Dense Supervision Signals for Long-Horizon LLM Agents","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-07-01T05:59:13.631078Z"},"links":{"citing_paper":"/paper/2606.32034"},"observation_digest":"sha256:3e782bed6a827095c5dd0bdc1978e9b2cf844035ab043d902a6e7ab6c053df27","observation_id":"7552923a-587b-436e-a514-29268ccb0c07","resolution":{"observed_at":"2026-07-06T19:52:52.653557Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"1070.2023","doi":"10.1109/iccv51070.2023","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"In: 2023 IEEE/CVF International Conference on Computer Vision (ICCV)","venue":null,"work_id":"b8a8bb9e-1d31-40e2-9cab-ae21e338dde6","year":2023},"citing_paper":{"arxiv_id":"2606.32034","last_updated":"2026-06-30T17:58:23Z","snapshot_observed_at":"2026-08-06T15:45:44.038676Z","submitted_at":"2026-06-30T17:58:23Z","title":"QVal: Cheaply Evaluating Dense Supervision Signals for Long-Horizon LLM Agents","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-07-01T05:59:13.631078Z"},"links":{"citing_paper":"/paper/2606.32034"},"observation_digest":"sha256:89af81b92d1c3c181c8dc6092018072591eff65d3de0a4bf427cbde3de25dad8","observation_id":"7e257c46-a4e5-4c07-a8fd-787ae06ea87d","resolution":{"observed_at":"2026-07-01T06:05:28.971294Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-07-11T15:53:34.217176+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T15:53:34.217176+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-06T19:52:52.672073Z","title":"Learning","venue":null,"work_id":"4046886d-2c25-4454-991a-26eeed31501e","year":null},"citing_paper":{"arxiv_id":"2606.32034","last_updated":"2026-06-30T17:58:23Z","snapshot_observed_at":"2026-08-06T15:45:44.038676Z","submitted_at":"2026-06-30T17:58:23Z","title":"QVal: Cheaply Evaluating Dense Supervision Signals for Long-Horizon LLM Agents","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-07-01T05:59:13.631078Z"},"links":{"citing_paper":"/paper/2606.32034"},"observation_digest":"sha256:d3de4e882d88ba4c862fa856b2fa44d4706e337f342aabb2188c2797b44938bc","observation_id":"bbe70db6-e0d6-44e5-bdc3-92f0b108fa86","resolution":{"observed_at":"2026-07-06T19:52:52.673133Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.09238","last_updated":"2024-03-30T15:35:16Z","snapshot_observed_at":"2026-08-04T11:24:59.308796Z","submitted_at":"2023-12-14T18:58:12Z","title":"Auto MC-Reward: Automated Dense Reward Design with Large Language Models for Minecraft","version":2},"cited_work":{"arxiv_id":"2312.09238","doi":"10.48550/arxiv.2312.09238","metadata_source":"arxiv_reference","pith_arxiv_id":"2312.09238","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":null,"venue":"arXiv (Cornell University)","work_id":"66867aca-6001-4bbb-a519-60234200dc3f","year":2024},"citing_paper":{"arxiv_id":"2606.32034","last_updated":"2026-06-30T17:58:23Z","snapshot_observed_at":"2026-08-06T15:45:44.038676Z","submitted_at":"2026-06-30T17:58:23Z","title":"QVal: Cheaply Evaluating Dense Supervision Signals for Long-Horizon LLM Agents","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-07-01T05:59:13.631078Z"},"links":{"cited_paper":"/paper/2312.09238","citing_paper":"/paper/2606.32034"},"observation_digest":"sha256:283e4987a54b03bf38b1414136ac3a1d25bb9a41df3af7116205f4d92f1f0bdd","observation_id":"fa7d6cf9-2de4-469a-9cbe-3017f2cee930","resolution":{"observed_at":"2026-07-01T06:05:29.000069Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04764","last_updated":"2024-02-07T11:27:45Z","snapshot_observed_at":"2026-08-05T18:35:49.744409Z","submitted_at":"2024-02-07T11:27:45Z","title":"Code as Reward: Empowering Reinforcement Learning with VLMs","version":1},"cited_work":{"arxiv_id":"2402.04764","doi":"10.48550/arxiv.2402.04764","metadata_source":"arxiv_reference","pith_arxiv_id":"2402.04764","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Code as reward: Empowering reinforcement learning with vlms.arXiv preprint arXiv:2402.04764, 2024","venue":"arXiv (Cornell University)","work_id":"5004569e-47ae-4516-a3ec-ddccfc79e2b1","year":2024},"citing_paper":{"arxiv_id":"2606.32034","last_updated":"2026-06-30T17:58:23Z","snapshot_observed_at":"2026-08-06T15:45:44.038676Z","submitted_at":"2026-06-30T17:58:23Z","title":"QVal: Cheaply Evaluating Dense Supervision Signals for Long-Horizon LLM Agents","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-07-01T05:59:13.631078Z"},"links":{"cited_paper":"/paper/2402.04764","citing_paper":"/paper/2606.32034"},"observation_digest":"sha256:f8486e869d44f7db74bd1291536f60e07d1a3deab62949212c39387ef3916a10","observation_id":"d7d7e84b-5cbe-4546-be36-ed692400209a","resolution":{"observed_at":"2026-07-01T06:05:28.982000Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03681","last_updated":"2024-06-14T21:10:32Z","snapshot_observed_at":"2026-08-02T19:29:16.535750Z","submitted_at":"2024-02-06T04:06:06Z","title":"RL-VLM-F: Reinforcement Learning from Vision Language Foundation Model Feedback","version":4},"cited_work":{"arxiv_id":"2402.03681","doi":"10.48550/arxiv.2402.03681","metadata_source":"pith","pith_arxiv_id":"2402.03681","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"RL-VLM-F: Reinforcement learn- ing from vision language foundation model feedback","venue":"cs.RO","work_id":"153aaaf7-64d1-4be4-9cff-b24aee0b45a4","year":2024},"citing_paper":{"arxiv_id":"2606.32034","last_updated":"2026-06-30T17:58:23Z","snapshot_observed_at":"2026-08-06T15:45:44.038676Z","submitted_at":"2026-06-30T17:58:23Z","title":"QVal: Cheaply Evaluating Dense Supervision Signals for Long-Horizon LLM Agents","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-07-01T05:59:13.631078Z"},"links":{"cited_paper":"/paper/2402.03681","citing_paper":"/paper/2606.32034"},"observation_digest":"sha256:058d2cd6017deb4a2cadcabaed4641892f3542b8dacd3bed42b36474edb3e8d8","observation_id":"f7fe787f-399f-467c-971e-38c5db5a2352","resolution":{"observed_at":"2026-07-01T06:05:28.995527Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2509.17321","doi":"10.48550/arxiv.2509.17321","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Opengvl: Benchmarking vi- sual temporal progress for data curation","venue":"Open MIND","work_id":"096fce8b-8d0e-4baa-9f09-5ee18aa43929","year":2026},"citing_paper":{"arxiv_id":"2606.32034","last_updated":"2026-06-30T17:58:23Z","snapshot_observed_at":"2026-08-06T15:45:44.038676Z","submitted_at":"2026-06-30T17:58:23Z","title":"QVal: Cheaply Evaluating Dense Supervision Signals for Long-Horizon LLM Agents","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-07-01T05:59:13.631078Z"},"links":{"citing_paper":"/paper/2606.32034"},"observation_digest":"sha256:cd5915033baa5a0589b8eae6335ff3519d7c87865f42058de03f528942f0ad96","observation_id":"2321afa4-da3a-4646-be53-7d7f2544ff96","resolution":{"observed_at":"2026-07-01T06:05:29.010527Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2512.20675","doi":"10.48550/arxiv.2512.20675","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Revisiting the","venue":"arXiv (Cornell University)","work_id":"e9087431-0776-4ab2-b384-aa444f3bd3e4","year":null},"citing_paper":{"arxiv_id":"2606.32034","last_updated":"2026-06-30T17:58:23Z","snapshot_observed_at":"2026-08-06T15:45:44.038676Z","submitted_at":"2026-06-30T17:58:23Z","title":"QVal: Cheaply Evaluating Dense Supervision Signals for Long-Horizon LLM Agents","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-07-01T05:59:13.631078Z"},"links":{"citing_paper":"/paper/2606.32034"},"observation_digest":"sha256:ddf21465e255c0f99eeed51705d4fe41c3f3d06d461087aeb987fa336e6f3663","observation_id":"f55c3edd-7944-43f9-bba1-96fdd379234e","resolution":{"observed_at":"2026-07-01T06:05:28.932214Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.13787","last_updated":"2024-06-08T16:40:12Z","snapshot_observed_at":"2026-08-02T18:11:57.036767Z","submitted_at":"2024-03-20T17:49:54Z","title":"RewardBench: Evaluating Reward Models for Language Modeling","version":2},"cited_work":{"arxiv_id":"2403.13787","doi":"10.48550/arxiv.2403.13787","metadata_source":"pith","pith_arxiv_id":"2403.13787","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Smith, and Hanna Hajishirzi","venue":"cs.LG","work_id":"ff1fdc14-8407-4029-a1e6-ce4921d8d7ae","year":2024},"citing_paper":{"arxiv_id":"2606.32034","last_updated":"2026-06-30T17:58:23Z","snapshot_observed_at":"2026-08-06T15:45:44.038676Z","submitted_at":"2026-06-30T17:58:23Z","title":"QVal: Cheaply Evaluating Dense Supervision Signals for Long-Horizon LLM Agents","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-07-01T05:59:13.631078Z"},"links":{"cited_paper":"/paper/2403.13787","citing_paper":"/paper/2606.32034"},"observation_digest":"sha256:a4c1a8b689a8b58da0a7c99753c289fbd6e20fb55cf2eace2105bbb4fb952cc9","observation_id":"157aae37-3740-48b6-9780-a27d40860516","resolution":{"observed_at":"2026-07-01T06:05:28.936347Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.01937","last_updated":"2026-04-23T14:42:19Z","snapshot_observed_at":"2026-07-06T21:35:12.872021Z","submitted_at":"2025-06-02T17:54:04Z","title":"RewardBench 2: Advancing Reward Model Evaluation","version":2},"cited_work":{"arxiv_id":"2506.01937","doi":"10.48550/arxiv.2506.01937","metadata_source":"pith","pith_arxiv_id":"2506.01937","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"RewardBench 2: Advancing Reward Model Evaluation","venue":"cs.CL","work_id":"cbae7eaf-ed34-46d3-9722-9c73b1ab5f5b","year":2025},"citing_paper":{"arxiv_id":"2606.32034","last_updated":"2026-06-30T17:58:23Z","snapshot_observed_at":"2026-08-06T15:45:44.038676Z","submitted_at":"2026-06-30T17:58:23Z","title":"QVal: Cheaply Evaluating Dense Supervision Signals for Long-Horizon LLM Agents","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-07-01T05:59:13.631078Z"},"links":{"cited_paper":"/paper/2506.01937","citing_paper":"/paper/2606.32034"},"observation_digest":"sha256:0a4e1fd11a69a253c61f4d86378b53301f434143baca41303d41092459a5d82e","observation_id":"79e1e772-0d04-4904-934a-bfae62d33953","resolution":{"observed_at":"2026-07-01T06:05:28.939461Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.16184","last_updated":"2024-10-21T16:48:26Z","snapshot_observed_at":"2026-08-05T17:52:20.244734Z","submitted_at":"2024-10-21T16:48:26Z","title":"RM-Bench: Benchmarking Reward Models of Language Models with Subtlety and Style","version":1},"cited_work":{"arxiv_id":"2410.16184","doi":"10.48550/arxiv.2410.16184","metadata_source":"arxiv_reference","pith_arxiv_id":"2410.16184","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Rm-bench: Benchmarking reward models of language models with subtlety and style","venue":"arXiv (Cornell University)","work_id":"35980c45-7ae9-44f8-b400-3617ad471a7f","year":2024},"citing_paper":{"arxiv_id":"2606.32034","last_updated":"2026-06-30T17:58:23Z","snapshot_observed_at":"2026-08-06T15:45:44.038676Z","submitted_at":"2026-06-30T17:58:23Z","title":"QVal: Cheaply Evaluating Dense Supervision Signals for Long-Horizon LLM Agents","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-07-01T05:59:13.631078Z"},"links":{"cited_paper":"/paper/2410.16184","citing_paper":"/paper/2606.32034"},"observation_digest":"sha256:0e3eba0501a3fabc90686fd20f67aae1830c60affa815a054ee022a0cef4eb34","observation_id":"0043aa8f-e713-4146-bdfc-67c29dfac921","resolution":{"observed_at":"2026-07-01T06:05:28.976511Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.17451","last_updated":"2025-06-02T05:46:18Z","snapshot_observed_at":"2026-07-06T19:57:18.481261Z","submitted_at":"2024-11-26T14:08:34Z","title":"VL-RewardBench: A Challenging Benchmark for Vision-Language Generative Reward Models","version":2},"cited_work":{"arxiv_id":"2411.17451","doi":"10.48550/arxiv.2411.17451","metadata_source":"arxiv_reference","pith_arxiv_id":"2411.17451","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"VLRewardBench: A challenging benchmark for vision-language generative reward models","venue":"arXiv (Cornell University)","work_id":"5bf55d99-82d0-4340-8169-ec473b92270e","year":2024},"citing_paper":{"arxiv_id":"2606.32034","last_updated":"2026-06-30T17:58:23Z","snapshot_observed_at":"2026-08-06T15:45:44.038676Z","submitted_at":"2026-06-30T17:58:23Z","title":"QVal: Cheaply Evaluating Dense Supervision Signals for Long-Horizon LLM Agents","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-07-01T05:59:13.631078Z"},"links":{"cited_paper":"/paper/2411.17451","citing_paper":"/paper/2606.32034"},"observation_digest":"sha256:13d2cb03f8bd202208248f186bf699d3ffa8bc2b800d0c164c6b986690a62e0d","observation_id":"35a99e2e-16d4-4109-8098-4ff0b1785f3f","resolution":{"observed_at":"2026-07-01T06:05:28.943625Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.14191","last_updated":"2025-02-20T01:48:13Z","snapshot_observed_at":"2026-08-07T18:03:15.507750Z","submitted_at":"2025-02-20T01:48:13Z","title":"Multimodal RewardBench: Holistic Evaluation of Reward Models for Vision Language Models","version":1},"cited_work":{"arxiv_id":"2502.14191","doi":"10.48550/arxiv.2502.14191","metadata_source":"arxiv_reference","pith_arxiv_id":"2502.14191","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Multimodal rewardbench: Holistic evaluation of reward models for vision language models","venue":"ArXiv.org","work_id":"bc36790d-ed2b-48af-a57b-4a8399efb59a","year":2025},"citing_paper":{"arxiv_id":"2606.32034","last_updated":"2026-06-30T17:58:23Z","snapshot_observed_at":"2026-08-06T15:45:44.038676Z","submitted_at":"2026-06-30T17:58:23Z","title":"QVal: Cheaply Evaluating Dense Supervision Signals for Long-Horizon LLM Agents","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-07-01T05:59:13.631078Z"},"links":{"cited_paper":"/paper/2502.14191","citing_paper":"/paper/2606.32034"},"observation_digest":"sha256:697bb5ff16500cd8ceddf3587f4a9e8c5c062ce367bbe9442131f7aedfcea854","observation_id":"5c822b84-a066-493a-a62b-baf5fcfee596","resolution":{"observed_at":"2026-07-01T06:05:29.027260Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2025.acl-long.50","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"First, I need to","venue":null,"work_id":"778f340e-0153-43cd-b934-7b0b26663b5f","year":2025},"citing_paper":{"arxiv_id":"2606.32034","last_updated":"2026-06-30T17:58:23Z","snapshot_observed_at":"2026-08-06T15:45:44.038676Z","submitted_at":"2026-06-30T17:58:23Z","title":"QVal: Cheaply Evaluating Dense Supervision Signals for Long-Horizon LLM Agents","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-07-01T05:59:13.631078Z"},"links":{"citing_paper":"/paper/2606.32034"},"observation_digest":"sha256:ee62d914da4fcd866c2b46659e34b8e224010ce137c45b8d0f11ad9898a22a00","observation_id":"02e219c0-c28a-4761-a0a1-eb3c2cf3efe4","resolution":{"observed_at":"2026-07-01T06:05:28.957262Z","resolver_source":"doi","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-07-14T11:49:48.309823+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-14T11:49:48.309823+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2025.acl-long.1230","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"PRMB ench: A fine-grained and challenging benchmark for process-level reward models","venue":null,"work_id":"09c5972b-64b0-4418-8e61-65bbafea00a8","year":2025},"citing_paper":{"arxiv_id":"2606.32034","last_updated":"2026-06-30T17:58:23Z","snapshot_observed_at":"2026-08-06T15:45:44.038676Z","submitted_at":"2026-06-30T17:58:23Z","title":"QVal: Cheaply Evaluating Dense Supervision Signals for Long-Horizon LLM Agents","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-07-01T05:59:13.631078Z"},"links":{"citing_paper":"/paper/2606.32034"},"observation_digest":"sha256:c0edd535e0e92ee3fec6c93e3bfc89dd2157564ea0298dcec2d94d9f6769a6bb","observation_id":"78bf6502-4272-4c30-887d-4a0b9246454d","resolution":{"observed_at":"2026-07-01T06:05:28.963802Z","resolver_source":"doi","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2023.emnlp-main.153","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T02:47:48.784249Z","title":"Proceedings of the 2023 Conference on Empirical Methods in Natural Language Processing","venue":"Proceedings of the 2023 Conference on Empirical Methods in Natural Language Processing","work_id":"08362103-dcc9-4e63-948e-05e60dd2d725","year":2023},"citing_paper":{"arxiv_id":"2606.32034","last_updated":"2026-06-30T17:58:23Z","snapshot_observed_at":"2026-08-06T15:45:44.038676Z","submitted_at":"2026-06-30T17:58:23Z","title":"QVal: Cheaply Evaluating Dense Supervision Signals for Long-Horizon LLM Agents","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-07-01T05:59:13.631078Z"},"links":{"citing_paper":"/paper/2606.32034"},"observation_digest":"sha256:13697817335600f11a874fdfef3d21d17910c42372f9c652fbccc1fa44836410","observation_id":"c796c31f-f67f-45d3-9f07-900d160670a2","resolution":{"observed_at":"2026-07-01T06:05:29.012936Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-03T15:08:48.208433+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-03T15:08:48.208433+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2601.20802","last_updated":"2026-02-16T14:49:34Z","snapshot_observed_at":"2026-07-29T19:52:32.104228Z","submitted_at":"2026-01-28T17:45:12Z","title":"Reinforcement Learning via Self-Distillation","version":2},"cited_work":{"arxiv_id":"2601.20802","doi":"10.48550/arxiv.2601.20802","metadata_source":"pith","pith_arxiv_id":"2601.20802","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Reinforcement Learning via Self-Distillation","venue":"cs.LG","work_id":"b193541d-5853-4ea4-8e4b-8e4c08617eb6","year":2026},"citing_paper":{"arxiv_id":"2606.32034","last_updated":"2026-06-30T17:58:23Z","snapshot_observed_at":"2026-08-06T15:45:44.038676Z","submitted_at":"2026-06-30T17:58:23Z","title":"QVal: Cheaply Evaluating Dense Supervision Signals for Long-Horizon LLM Agents","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-07-01T05:59:13.631078Z"},"links":{"cited_paper":"/paper/2601.20802","citing_paper":"/paper/2606.32034"},"observation_digest":"sha256:a0c1077f9aa3db065c5bef78660fa043919a630352d256d2c9af9893ebc3715f","observation_id":"5f83cd3e-390b-4f04-93a1-951548c57b07","resolution":{"observed_at":"2026-07-01T06:05:29.024306Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-05-21T06:23:12.649775+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-21T06:23:12.649775+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-06T19:52:52.637385Z","title":"Advances in Neural Information Processing Systems , author =","venue":null,"work_id":"461769da-dcfa-47ea-9864-4db08d7f3644","year":2023},"citing_paper":{"arxiv_id":"2606.32034","last_updated":"2026-06-30T17:58:23Z","snapshot_observed_at":"2026-08-06T15:45:44.038676Z","submitted_at":"2026-06-30T17:58:23Z","title":"QVal: Cheaply Evaluating Dense Supervision Signals for Long-Horizon LLM Agents","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-07-01T05:59:13.631078Z"},"links":{"citing_paper":"/paper/2606.32034"},"observation_digest":"sha256:303d63e5ad9af5bdf8c98a532cc6a60584c246acccdf1c9aecc736e520e2cfa8","observation_id":"51faed78-63b5-4e3f-8040-a7d39a312273","resolution":{"observed_at":"2026-07-06T19:52:52.638702Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2504.01005","doi":"10.48550/arxiv.2504.01005","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"When to solve, when to verify: Compute-optimal problem solving and generative verification for llm reasoning","venue":"ArXiv.org","work_id":"c758fd91-03c2-4da5-9de9-cfcc192aa8fd","year":2025},"citing_paper":{"arxiv_id":"2606.32034","last_updated":"2026-06-30T17:58:23Z","snapshot_observed_at":"2026-08-06T15:45:44.038676Z","submitted_at":"2026-06-30T17:58:23Z","title":"QVal: Cheaply Evaluating Dense Supervision Signals for Long-Horizon LLM Agents","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-07-01T05:59:13.631078Z"},"links":{"citing_paper":"/paper/2606.32034"},"observation_digest":"sha256:aa0910e369bd597c6f6677fb8bcbc43fbcee20b27d93990dc552d0b3439ab65b","observation_id":"54422670-1073-43a1-8d79-4666e20112a5","resolution":{"observed_at":"2026-07-01T06:05:28.950682Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2604.25235","last_updated":"2026-04-29T07:06:15Z","snapshot_observed_at":"2026-08-08T18:42:01.851595Z","submitted_at":"2026-04-28T05:30:18Z","title":"VLM Judges Can Rank but Cannot Score: Task-Dependent Uncertainty in Multimodal Evaluation","version":2},"cited_work":{"arxiv_id":"2604.25235","doi":"10.48550/arxiv.2604.25235","metadata_source":"pith","pith_arxiv_id":"2604.25235","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"VLM Judges Can Rank but Cannot Score: Task-Dependent Uncertainty in Multimodal Evaluation","venue":"cs.LG","work_id":"2e916185-a09b-437f-9da2-a654400ef1bd","year":2026},"citing_paper":{"arxiv_id":"2606.32034","last_updated":"2026-06-30T17:58:23Z","snapshot_observed_at":"2026-08-06T15:45:44.038676Z","submitted_at":"2026-06-30T17:58:23Z","title":"QVal: Cheaply Evaluating Dense Supervision Signals for Long-Horizon LLM Agents","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-07-01T05:59:13.631078Z"},"links":{"cited_paper":"/paper/2604.25235","citing_paper":"/paper/2606.32034"},"observation_digest":"sha256:07f521cc44445ab033a4181324a2db1aef60cf7b6774cc770ddf4825d92c396a","observation_id":"0d63806a-cc2d-4e0f-9087-897fe4c60099","resolution":{"observed_at":"2026-07-01T06:05:28.954751Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.14809","last_updated":"2024-06-01T07:46:28Z","snapshot_observed_at":"2026-08-09T15:29:40.218189Z","submitted_at":"2024-02-22T18:59:02Z","title":"CriticBench: Benchmarking LLMs for Critique-Correct Reasoning","version":4},"cited_work":{"arxiv_id":"2402.14809","doi":"10.48550/arxiv.2402.14809","metadata_source":"arxiv_reference","pith_arxiv_id":"2402.14809","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Criticbench: Benchmarking llms for critique-correct reasoning","venue":"arXiv (Cornell University)","work_id":"b5ef1ec4-cb36-4e3e-b7eb-d947e1808228","year":2024},"citing_paper":{"arxiv_id":"2606.32034","last_updated":"2026-06-30T17:58:23Z","snapshot_observed_at":"2026-08-06T15:45:44.038676Z","submitted_at":"2026-06-30T17:58:23Z","title":"QVal: Cheaply Evaluating Dense Supervision Signals for Long-Horizon LLM Agents","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-07-01T05:59:13.631078Z"},"links":{"cited_paper":"/paper/2402.14809","citing_paper":"/paper/2606.32034"},"observation_digest":"sha256:c72a170ac26429177d96c2c7854c46b2889de0aad252e21ddee8f44531b253fc","observation_id":"2578d05a-2c2a-45e4-9621-83c45bd0c98d","resolution":{"observed_at":"2026-07-01T06:05:29.030156Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2504.08942","doi":"10.48550/arxiv.2504.08942","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Agentrewardbench: Evaluating automatic evaluations of web agent trajectories","venue":"ArXiv.org","work_id":"4672f8c4-b6e4-4226-91be-6e4cb99e2669","year":2025},"citing_paper":{"arxiv_id":"2606.32034","last_updated":"2026-06-30T17:58:23Z","snapshot_observed_at":"2026-08-06T15:45:44.038676Z","submitted_at":"2026-06-30T17:58:23Z","title":"QVal: Cheaply Evaluating Dense Supervision Signals for Long-Horizon LLM Agents","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-07-01T05:59:13.631078Z"},"links":{"citing_paper":"/paper/2606.32034"},"observation_digest":"sha256:c600a62d3d28040ba72b18b8d7dffdcde9fb97eecf51f417937b79aefd3131dc","observation_id":"8c9d1108-cfc3-4cbe-90b6-a487b4ed7b84","resolution":{"observed_at":"2026-07-01T06:05:28.947305Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T17:56:26.114328Z","title":"International conference on machine learning , pages=","venue":null,"work_id":"1031f0f0-cd67-4170-83ad-9a088b363c67","year":2021},"citing_paper":{"arxiv_id":"2606.32034","last_updated":"2026-06-30T17:58:23Z","snapshot_observed_at":"2026-08-06T15:45:44.038676Z","submitted_at":"2026-06-30T17:58:23Z","title":"QVal: Cheaply Evaluating Dense Supervision Signals for Long-Horizon LLM Agents","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-07-01T05:59:13.631078Z"},"links":{"citing_paper":"/paper/2606.32034"},"observation_digest":"sha256:6dade4f83c125438751a1fc6d466e97a238e057a19e2b06ddc0808e138dc1893","observation_id":"40c48294-11f2-48b9-8d3c-8010f0ee2217","resolution":{"observed_at":"2026-07-06T19:52:52.643043Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T09:06:59.815536Z","title":"Proceedings of the IEEE/CVF international conference on computer vision , pages=","venue":null,"work_id":"b11a12d3-126b-481d-860c-b4505a55c5a4","year":null},"citing_paper":{"arxiv_id":"2606.32034","last_updated":"2026-06-30T17:58:23Z","snapshot_observed_at":"2026-08-06T15:45:44.038676Z","submitted_at":"2026-06-30T17:58:23Z","title":"QVal: Cheaply Evaluating Dense Supervision Signals for Long-Horizon LLM Agents","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-07-01T05:59:13.631078Z"},"links":{"citing_paper":"/paper/2606.32034"},"observation_digest":"sha256:f93818ddf94b8d9ec2a236dfec655f49f2e88563d4c7f2d400e017312266af49","observation_id":"0b30a001-f5e1-44ba-b581-2e162225353f","resolution":{"observed_at":"2026-07-06T19:52:52.645755Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-06T19:52:52.655816Z","title":"The Twelfth International Conference on Learning Representations , year=","venue":null,"work_id":"1f19281c-55d1-4e9e-bae8-41de182a314a","year":null},"citing_paper":{"arxiv_id":"2606.32034","last_updated":"2026-06-30T17:58:23Z","snapshot_observed_at":"2026-08-06T15:45:44.038676Z","submitted_at":"2026-06-30T17:58:23Z","title":"QVal: Cheaply Evaluating Dense Supervision Signals for Long-Horizon LLM Agents","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-07-01T05:59:13.631078Z"},"links":{"citing_paper":"/paper/2606.32034"},"observation_digest":"sha256:ab0b0045da6aade15841d25b7ed0678129558bdb84bed7d6dbf730c388c2f260","observation_id":"700856bb-44d7-4acf-b025-8dec6935e85f","resolution":{"observed_at":"2026-07-06T19:52:52.657052Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.09187","last_updated":"2024-07-12T21:14:32Z","snapshot_observed_at":"2026-07-06T17:02:01.491624Z","submitted_at":"2023-12-14T18:06:17Z","title":"Vision-Language Models as a Source of Rewards","version":3},"cited_work":{"arxiv_id":"2312.09187","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2312.09187","snapshot_observed_at":"2026-07-04T09:59:44.592995Z","title":"Vision- language models as a source of rewards.arXiv preprint arXiv:2312.09187, 2023","venue":null,"work_id":"409e0d53-77f4-4044-a24e-ccee77bf0ed8","year":2023},"citing_paper":{"arxiv_id":"2606.32034","last_updated":"2026-06-30T17:58:23Z","snapshot_observed_at":"2026-08-06T15:45:44.038676Z","submitted_at":"2026-06-30T17:58:23Z","title":"QVal: Cheaply Evaluating Dense Supervision Signals for Long-Horizon LLM Agents","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-07-01T05:59:13.631078Z"},"links":{"cited_paper":"/paper/2312.09187","citing_paper":"/paper/2606.32034"},"observation_digest":"sha256:936e73d3dca83aceff75f406335d05cd8433b08416b7be44a63c85d0e09820c7","observation_id":"5e767bed-48c0-49f0-b88f-1a9050aebd65","resolution":{"observed_at":"2026-07-01T09:55:41.445185Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.00030","last_updated":"2023-03-07T02:29:59Z","snapshot_observed_at":"2026-08-02T00:17:16.761436Z","submitted_at":"2022-09-30T18:14:07Z","title":"VIP: Towards Universal Visual Reward and Representation via Value-Implicit Pre-Training","version":2},"cited_work":{"arxiv_id":"2210.00030","doi":"10.48550/arxiv.2210.00030","metadata_source":"pith","pith_arxiv_id":"2210.00030","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"VIP: Towards Universal Visual Reward and Representation via Value-Implicit Pre-Training","venue":"cs.RO","work_id":"022de141-49ac-43d5-9667-e36913ec1950","year":2022},"citing_paper":{"arxiv_id":"2606.32034","last_updated":"2026-06-30T17:58:23Z","snapshot_observed_at":"2026-08-06T15:45:44.038676Z","submitted_at":"2026-06-30T17:58:23Z","title":"QVal: Cheaply Evaluating Dense Supervision Signals for Long-Horizon LLM Agents","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-07-01T05:59:13.631078Z"},"links":{"cited_paper":"/paper/2210.00030","citing_paper":"/paper/2606.32034"},"observation_digest":"sha256:6c2f1ec3a87295c4f245b7de01a757857c2f48c2fee529491e948e114d9ddfa1","observation_id":"d42b74b8-b49c-4651-902f-6dda65f2f3c7","resolution":{"observed_at":"2026-07-01T09:55:41.447835Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-06T19:52:52.639757Z","title":"International Conference on Machine Learning , pages=","venue":null,"work_id":"6ace32a0-07d3-4655-bc5e-a14488f5fd31","year":2023},"citing_paper":{"arxiv_id":"2606.32034","last_updated":"2026-06-30T17:58:23Z","snapshot_observed_at":"2026-08-06T15:45:44.038676Z","submitted_at":"2026-06-30T17:58:23Z","title":"QVal: Cheaply Evaluating Dense Supervision Signals for Long-Horizon LLM Agents","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-07-01T05:59:13.631078Z"},"links":{"citing_paper":"/paper/2606.32034"},"observation_digest":"sha256:ad73d5e37954f3e182cc8f3c84b49b578873bf66519ad7245df64139800f0f14","observation_id":"d243046e-b23c-4976-8c11-a0d711fcd871","resolution":{"observed_at":"2026-07-06T19:52:52.641682Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.11441","last_updated":"2023-11-06T07:39:49Z","snapshot_observed_at":"2026-08-04T03:29:49.409446Z","submitted_at":"2023-10-17T17:51:31Z","title":"Set-of-Mark Prompting Unleashes Extraordinary Visual Grounding in GPT-4V","version":2},"cited_work":{"arxiv_id":"2310.11441","doi":"10.48550/arxiv.2310.11441","metadata_source":"pith","pith_arxiv_id":"2310.11441","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Set-of-Mark Prompting Unleashes Extraordinary Visual Grounding in GPT-4V","venue":"cs.CV","work_id":"ddc8878e-ed0c-4a66-952a-254dce1c622a","year":2023},"citing_paper":{"arxiv_id":"2606.32034","last_updated":"2026-06-30T17:58:23Z","snapshot_observed_at":"2026-08-06T15:45:44.038676Z","submitted_at":"2026-06-30T17:58:23Z","title":"QVal: Cheaply Evaluating Dense Supervision Signals for Long-Horizon LLM Agents","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-07-01T05:59:13.631078Z"},"links":{"cited_paper":"/paper/2310.11441","citing_paper":"/paper/2606.32034"},"observation_digest":"sha256:0ca6f8e7ff86362181f605227dff2ce4ceb66eb81ed0d2c50106c9892ce9bcf8","observation_id":"c7d0a55a-ce8c-4cf5-9b85-4aff68ba3198","resolution":{"observed_at":"2026-07-01T09:55:41.450296Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-06T19:52:52.670542Z","title":"arXiv , year=","venue":null,"work_id":"2dad7f1c-518b-43bd-b6df-994fe4eade0f","year":null},"citing_paper":{"arxiv_id":"2606.32034","last_updated":"2026-06-30T17:58:23Z","snapshot_observed_at":"2026-08-06T15:45:44.038676Z","submitted_at":"2026-06-30T17:58:23Z","title":"QVal: Cheaply Evaluating Dense Supervision Signals for Long-Horizon LLM Agents","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-07-01T05:59:13.631078Z"},"links":{"citing_paper":"/paper/2606.32034"},"observation_digest":"sha256:6698612d93c3668d4063fb2091843f5e1ff66202cec7a6e1eace54bfe928a251","observation_id":"81d37c85-b869-4f01-98c6-68951a962b82","resolution":{"observed_at":"2026-07-06T19:52:52.671579Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T02:37:54.519855Z","title":null,"venue":null,"work_id":"72647878-5eae-4741-b770-5602b7561189","year":2026},"citing_paper":{"arxiv_id":"2606.32034","last_updated":"2026-06-30T17:58:23Z","snapshot_observed_at":"2026-08-06T15:45:44.038676Z","submitted_at":"2026-06-30T17:58:23Z","title":"QVal: Cheaply Evaluating Dense Supervision Signals for Long-Horizon LLM Agents","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-07-01T05:59:13.631078Z"},"links":{"citing_paper":"/paper/2606.32034"},"observation_digest":"sha256:31b3a8de6dea5d17b0d0ab2ac66041418a1f0cb7ceb5a7100fd022c8c978dbb0","observation_id":"a46c1e36-5960-43b4-b88c-c6591fa37774","resolution":{"observed_at":"2026-07-06T19:52:52.657843Z","resolver_source":"raw_fallback","status":"parse_uncertain"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-06T19:52:52.631785Z","title":"ICLR 2026 Workshop on Lifelong Agents: Learning, Aligning, Evolving , year=","venue":null,"work_id":"72f13109-fbea-49b1-89a8-dd9024aa5e5e","year":2026},"citing_paper":{"arxiv_id":"2606.32034","last_updated":"2026-06-30T17:58:23Z","snapshot_observed_at":"2026-08-06T15:45:44.038676Z","submitted_at":"2026-06-30T17:58:23Z","title":"QVal: Cheaply Evaluating Dense Supervision Signals for Long-Horizon LLM Agents","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-07-01T05:59:13.631078Z"},"links":{"citing_paper":"/paper/2606.32034"},"observation_digest":"sha256:762cd2698225c22b68015216249c3f133f2bc6eb5e82c094deaad4aa02400f05","observation_id":"793bbf91-964b-4960-809a-4217747d9850","resolution":{"observed_at":"2026-07-06T19:52:52.633049Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03300","last_updated":"2024-04-27T15:25:53Z","snapshot_observed_at":"2026-08-06T14:58:42.911363Z","submitted_at":"2024-02-05T18:55:32Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","version":3},"cited_work":{"arxiv_id":"2402.03300","doi":"10.1016/0004-3702(73)90011-8","metadata_source":"pith","pith_arxiv_id":"2402.03300","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","venue":"cs.CL","work_id":"c5006563-f3ec-438a-9e35-b7b484f34828","year":2024},"citing_paper":{"arxiv_id":"2606.32034","last_updated":"2026-06-30T17:58:23Z","snapshot_observed_at":"2026-08-06T15:45:44.038676Z","submitted_at":"2026-06-30T17:58:23Z","title":"QVal: Cheaply Evaluating Dense Supervision Signals for Long-Horizon LLM Agents","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-07-01T05:59:13.631078Z"},"links":{"cited_paper":"/paper/2402.03300","citing_paper":"/paper/2606.32034"},"observation_digest":"sha256:f721431e178b41e45d6cfb53c28897ea5fd58e0c633c8a2e467936ff54d4a670","observation_id":"fc746ef1-9153-4029-928b-ee10779f7395","resolution":{"observed_at":"2026-07-01T09:55:41.439661Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2601.03525","last_updated":"2026-05-26T16:39:06Z","snapshot_observed_at":"2026-08-06T03:27:45.707151Z","submitted_at":"2026-01-07T02:29:49Z","title":"Beyond Binary: Turning Partial Success into Dense Verifiable Rewards for Reinforcement Learning in Code Generation","version":3},"cited_work":{"arxiv_id":"2601.03525","doi":null,"metadata_source":"pith","pith_arxiv_id":"2601.03525","snapshot_observed_at":"2026-07-02T21:07:23.934381Z","title":"Beyond Binary: Turning Partial Success into Dense Verifiable Rewards for Reinforcement Learning in Code Generation","venue":"cs.LG","work_id":"891e1e22-0fb7-462e-a817-6d7351c367ee","year":2026},"citing_paper":{"arxiv_id":"2606.32034","last_updated":"2026-06-30T17:58:23Z","snapshot_observed_at":"2026-08-06T15:45:44.038676Z","submitted_at":"2026-06-30T17:58:23Z","title":"QVal: Cheaply Evaluating Dense Supervision Signals for Long-Horizon LLM Agents","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-07-01T05:59:13.631078Z"},"links":{"cited_paper":"/paper/2601.03525","citing_paper":"/paper/2606.32034"},"observation_digest":"sha256:1302c070283b337f798d5f0259a189f3e56fc859df3778c5a28bd733e0bddca9","observation_id":"c932ff6a-1a4f-4db7-9e44-49e581b9b330","resolution":{"observed_at":"2026-07-01T09:55:41.440160Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-06T19:52:52.635430Z","title":"Hasegawa-Johnson and Chang D","venue":null,"work_id":"78be5531-1858-4807-bc71-7aa9874c034f","year":null},"citing_paper":{"arxiv_id":"2606.32034","last_updated":"2026-06-30T17:58:23Z","snapshot_observed_at":"2026-08-06T15:45:44.038676Z","submitted_at":"2026-06-30T17:58:23Z","title":"QVal: Cheaply Evaluating Dense Supervision Signals for Long-Horizon LLM Agents","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-07-01T05:59:13.631078Z"},"links":{"citing_paper":"/paper/2606.32034"},"observation_digest":"sha256:c345095170fb7d152f3f030ba457e4861865454b8a7af3a6e7b0502d1f7ac3b7","observation_id":"83b96394-83ac-44a4-a155-fbf408ff7fc9","resolution":{"observed_at":"2026-07-06T19:52:52.636710Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2606.32034","last_updated":"2026-06-30T17:58:23Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-06T15:45:44.038676Z","submitted_at":"2026-06-30T17:58:23Z","title":"QVal: Cheaply Evaluating Dense Supervision Signals for Long-Horizon LLM Agents"},"reference_resolution":{"displayed":54,"state_counts":{"malformed_identifier":0,"metadata_mismatch":17,"parse_uncertain":1,"unresolved":6,"verified_exact":14,"verified_fuzzy":16},"total_outbound_references":54},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 54 of 54 outbound references and 0 inbound Pith citation observations for arXiv:2606.32034."}