{"as_of":"2026-08-09T20:51:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:1fa0ae0af874fa89034ea46d93d7ccbfa97bdf68592c4bce7d329f1a938e2ef0","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":14,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":14,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":14,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":14,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T12:59:26.281619Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-02T13:46:58.798974Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2504.09946","last_updated":"2025-04-18T02:05:38Z","snapshot_observed_at":"2026-08-07T16:06:00.056361Z","submitted_at":"2025-04-14T07:14:27Z","title":"Assessing Judging Bias in Large Reasoning Models: An Empirical Study","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.09946","snapshot_observed_at":"2026-08-07T12:59:26.281619Z","title":"Byrd Reasoning Models: An Empirical Study","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.22987","last_updated":"2025-07-17T20:04:13Z","snapshot_observed_at":"2026-08-08T02:09:32.171416Z","submitted_at":"2025-05-29T01:51:20Z","title":"Strategic Reflectivism In Intelligent Systems","version":2},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-07T12:59:26.281619Z"},"links":{"cited_paper":"/paper/2504.09946","citing_paper":"/paper/2505.22987"},"observation_digest":"sha256:906a3ae81731f5198e072835b8e19df03995efd5046326e0e9503a32c3227e1f","observation_id":"6f023a88-ad66-4856-bf90-666a5247da9f","resolution":{"observed_at":"2026-08-07T12:59:26.281619Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.09946","last_updated":"2025-04-18T02:05:38Z","snapshot_observed_at":"2026-08-07T16:06:00.056361Z","submitted_at":"2025-04-14T07:14:27Z","title":"Assessing Judging Bias in Large Reasoning Models: An Empirical Study","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.09946","snapshot_observed_at":"2026-08-07T10:57:11.379436Z","title":"Assessing judging bias in large reasoning models: An empirical study","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.03861","last_updated":"2025-07-08T06:24:13Z","snapshot_observed_at":"2026-08-09T20:30:39.331988Z","submitted_at":"2025-06-04T11:48:51Z","title":"PulseReddit: A Novel Reddit Dataset for Benchmarking MAS in High-Frequency Cryptocurrency Trading","version":2},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-07T10:57:11.379436Z"},"links":{"cited_paper":"/paper/2504.09946","citing_paper":"/paper/2506.03861"},"observation_digest":"sha256:2a8156c0f689802b8760a5fc417dc454705dd4fdafe11ff374c8dc5c0cc7144b","observation_id":"4602b950-ac16-45f8-9cdb-edb20ef4be25","resolution":{"observed_at":"2026-08-07T10:57:11.379436Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.09946","last_updated":"2025-04-18T02:05:38Z","snapshot_observed_at":"2026-08-07T16:06:00.056361Z","submitted_at":"2025-04-14T07:14:27Z","title":"Assessing Judging Bias in Large Reasoning Models: An Empirical Study","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.09946","snapshot_observed_at":"2026-08-07T04:18:39.012600Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.10903","last_updated":"2025-06-12T17:09:51Z","snapshot_observed_at":"2026-08-09T13:17:37.670421Z","submitted_at":"2025-06-12T17:09:51Z","title":"Beyond Gold Standards: Epistemic Ensemble of LLM Judges for Formal Mathematical Reasoning","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-07T04:18:39.012600Z"},"links":{"cited_paper":"/paper/2504.09946","citing_paper":"/paper/2506.10903"},"observation_digest":"sha256:cea7363eaef10d8a2a62a88d8ed986d87c272b0b7b08483953deb6559182a0f8","observation_id":"9c5711f3-5794-460f-a6df-54f652c3d180","resolution":{"observed_at":"2026-08-07T04:18:39.012600Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.09946","last_updated":"2025-04-18T02:05:38Z","snapshot_observed_at":"2026-08-07T16:06:00.056361Z","submitted_at":"2025-04-14T07:14:27Z","title":"Assessing Judging Bias in Large Reasoning Models: An Empirical Study","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.09946","snapshot_observed_at":"2026-08-06T18:15:39.513701Z","title":"Assessing judging bias in large reasoning models: An empirical study","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.08794","last_updated":"2026-06-11T04:21:36Z","snapshot_observed_at":"2026-08-06T18:06:40.369641Z","submitted_at":"2025-07-11T17:55:22Z","title":"One Token to Fool LLM-as-a-Judge","version":3},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-06T18:15:39.513701Z"},"links":{"cited_paper":"/paper/2504.09946","citing_paper":"/paper/2507.08794"},"observation_digest":"sha256:33af4b9969f6270df20a6d1bb38cb6baf84e7ae04833d12d56c37dc5a852106d","observation_id":"5c18f31d-decc-49ed-9033-a5fc6ef24b86","resolution":{"observed_at":"2026-08-06T18:15:39.513701Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.09946","last_updated":"2025-04-18T02:05:38Z","snapshot_observed_at":"2026-08-07T16:06:00.056361Z","submitted_at":"2025-04-14T07:14:27Z","title":"Assessing Judging Bias in Large Reasoning Models: An Empirical Study","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.09946","snapshot_observed_at":"2026-08-05T10:39:07.098978Z","title":"Assessing Judging Bias in Large Reasoning Models: An Empirical Study","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.03871","last_updated":"2025-09-04T04:12:31Z","snapshot_observed_at":"2026-08-08T03:54:26.940042Z","submitted_at":"2025-09-04T04:12:31Z","title":"A Comprehensive Survey on Trustworthiness in Reasoning with Large Language Models","version":1},"reference_index":177,"source":"pdf_text","source_observed_at":"2026-08-05T10:39:07.098978Z"},"links":{"cited_paper":"/paper/2504.09946","citing_paper":"/paper/2509.03871"},"observation_digest":"sha256:57c90190557b83ee335193718257d02ac815e4f72bea1159560612db7622176e","observation_id":"8bdcb376-98e8-4552-9ed3-189f805dad09","resolution":{"observed_at":"2026-08-05T10:39:07.098978Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.09946","last_updated":"2025-04-18T02:05:38Z","snapshot_observed_at":"2026-08-07T16:06:00.056361Z","submitted_at":"2025-04-14T07:14:27Z","title":"Assessing Judging Bias in Large Reasoning Models: An Empirical Study","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.09946","snapshot_observed_at":"2026-08-03T09:37:09.271466Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2601.13433","last_updated":"2026-05-29T00:45:48Z","snapshot_observed_at":"2026-08-03T09:37:04.326965Z","submitted_at":"2026-01-19T22:37:30Z","title":"Who Endorsed It? Measuring Authority Bias Across Expertise Levels in Language Models","version":4},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-03T09:37:09.271466Z"},"links":{"cited_paper":"/paper/2504.09946","citing_paper":"/paper/2601.13433"},"observation_digest":"sha256:feffdc542d27dc02d2fcf12aab7b6ee91fdd81c1f66f288827707314328c77db","observation_id":"38f9930e-ce24-4312-8ac3-6a5e0fb3a48c","resolution":{"observed_at":"2026-08-03T09:37:09.271466Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.09946","last_updated":"2025-04-18T02:05:38Z","snapshot_observed_at":"2026-08-07T16:06:00.056361Z","submitted_at":"2025-04-14T07:14:27Z","title":"Assessing Judging Bias in Large Reasoning Models: An Empirical Study","version":2},"cited_work":{"arxiv_id":"2504.09946","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2504.09946","snapshot_observed_at":"2026-07-02T13:46:58.798974Z","title":"Assessing judging bias in large reasoning models: An empirical study.arXiv preprint arXiv:2504.09946, 2025a","venue":null,"work_id":"c9624367-78fa-4f5b-84a1-604a4ae46c17","year":2025},"citing_paper":{"arxiv_id":"2603.03332","last_updated":"2026-04-16T23:41:41Z","snapshot_observed_at":"2026-08-04T02:21:24.392691Z","submitted_at":"2026-02-11T03:11:30Z","title":"Fragile Thoughts: How Large Language Models Handle Chain-of-Thought Perturbations","version":3},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-16T03:43:18.987241Z"},"links":{"cited_paper":"/paper/2504.09946","citing_paper":"/paper/2603.03332"},"observation_digest":"sha256:1800c73f1db4031246cbbc074f3f6a80adc35bf5fd57bd6ac5e4ee5e640982d9","observation_id":"079480e8-7c06-46c0-a94e-dc321e49ed16","resolution":{"observed_at":"2026-05-16T03:47:15.228860Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.09946","last_updated":"2025-04-18T02:05:38Z","snapshot_observed_at":"2026-08-07T16:06:00.056361Z","submitted_at":"2025-04-14T07:14:27Z","title":"Assessing Judging Bias in Large Reasoning Models: An Empirical Study","version":2},"cited_work":{"arxiv_id":"2504.09946","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2504.09946","snapshot_observed_at":"2026-07-02T13:46:58.798974Z","title":"Assessing judging bias in large reasoning models: An empirical study.arXiv preprint arXiv:2504.09946, 2025a","venue":null,"work_id":"c9624367-78fa-4f5b-84a1-604a4ae46c17","year":2025},"citing_paper":{"arxiv_id":"2604.02686","last_updated":"2026-04-03T03:30:34Z","snapshot_observed_at":"2026-08-02T18:52:24.780545Z","submitted_at":"2026-04-03T03:30:34Z","title":"Beyond Semantic Manipulation: Token-Space Attacks on Reward Models","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-13T20:29:31.354743Z"},"links":{"cited_paper":"/paper/2504.09946","citing_paper":"/paper/2604.02686"},"observation_digest":"sha256:9d305b518c9c0140b6d920936978c7efece6de619b8daafffc04b41253b2661b","observation_id":"8a2caa14-9a8c-4dca-b0f2-00ba14ba491e","resolution":{"observed_at":"2026-05-13T20:33:16.880554Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.09946","last_updated":"2025-04-18T02:05:38Z","snapshot_observed_at":"2026-08-07T16:06:00.056361Z","submitted_at":"2025-04-14T07:14:27Z","title":"Assessing Judging Bias in Large Reasoning Models: An Empirical Study","version":2},"cited_work":{"arxiv_id":"2504.09946","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2504.09946","snapshot_observed_at":"2026-07-02T13:46:58.798974Z","title":"Assessing judging bias in large reasoning models: An empirical study.arXiv preprint arXiv:2504.09946, 2025a","venue":null,"work_id":"c9624367-78fa-4f5b-84a1-604a4ae46c17","year":2025},"citing_paper":{"arxiv_id":"2604.05593","last_updated":"2026-04-07T08:43:30Z","snapshot_observed_at":"2026-07-06T22:54:16.913706Z","submitted_at":"2026-04-07T08:43:30Z","title":"Label Effects: Shared Heuristic Reliance in Trust Assessment by Humans and LLM-as-a-Judge","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-05-10T19:38:11.595077Z"},"links":{"cited_paper":"/paper/2504.09946","citing_paper":"/paper/2604.05593"},"observation_digest":"sha256:e4faa871252f567dabd6a9625858c956a98a4fff6d076a68ef33faa45e2f1e3a","observation_id":"c37bc6d8-22b6-47f0-9ab2-6df4471574f2","resolution":{"observed_at":"2026-05-10T22:40:51.715805Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.09946","last_updated":"2025-04-18T02:05:38Z","snapshot_observed_at":"2026-08-07T16:06:00.056361Z","submitted_at":"2025-04-14T07:14:27Z","title":"Assessing Judging Bias in Large Reasoning Models: An Empirical Study","version":2},"cited_work":{"arxiv_id":"2504.09946","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2504.09946","snapshot_observed_at":"2026-07-02T13:46:58.798974Z","title":"Assessing judging bias in large reasoning models: An empirical study.arXiv preprint arXiv:2504.09946, 2025a","venue":null,"work_id":"c9624367-78fa-4f5b-84a1-604a4ae46c17","year":2025},"citing_paper":{"arxiv_id":"2604.27727","last_updated":"2026-04-30T11:20:22Z","snapshot_observed_at":"2026-07-06T23:13:11.623453Z","submitted_at":"2026-04-30T11:20:22Z","title":"LLM-as-a-Judge for Human-AI Co-Creation: A Reliability-Aware Evaluation Framework for Coding","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-07T08:39:55.256518Z"},"links":{"cited_paper":"/paper/2504.09946","citing_paper":"/paper/2604.27727"},"observation_digest":"sha256:bd0c56431ef5b0100f83ded1670c276f3838b663af2d57309d3bcaf10ed61778","observation_id":"1fdf6cc4-d633-4575-a4fd-0dbcdededa35","resolution":{"observed_at":"2026-05-12T09:56:28.071739Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.09946","last_updated":"2025-04-18T02:05:38Z","snapshot_observed_at":"2026-08-07T16:06:00.056361Z","submitted_at":"2025-04-14T07:14:27Z","title":"Assessing Judging Bias in Large Reasoning Models: An Empirical Study","version":2},"cited_work":{"arxiv_id":"2504.09946","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2504.09946","snapshot_observed_at":"2026-07-02T13:46:58.798974Z","title":"Assessing judging bias in large reasoning models: An empirical study.arXiv preprint arXiv:2504.09946, 2025a","venue":null,"work_id":"c9624367-78fa-4f5b-84a1-604a4ae46c17","year":2025},"citing_paper":{"arxiv_id":"2605.06635","last_updated":"2026-05-07T17:46:45Z","snapshot_observed_at":"2026-07-06T23:19:05.764765Z","submitted_at":"2026-05-07T17:46:45Z","title":"Cited but Not Verified: Parsing and Evaluating Source Attribution in LLM Deep Research Agents","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-08T09:53:00.677605Z"},"links":{"cited_paper":"/paper/2504.09946","citing_paper":"/paper/2605.06635"},"observation_digest":"sha256:8498d631986644364c9b919f292f240a1127b5dd5a89615e00ba63962dff2912","observation_id":"04ef2b08-c858-4f54-97a1-7758616c055c","resolution":{"observed_at":"2026-05-11T20:16:08.764776Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.09946","last_updated":"2025-04-18T02:05:38Z","snapshot_observed_at":"2026-08-07T16:06:00.056361Z","submitted_at":"2025-04-14T07:14:27Z","title":"Assessing Judging Bias in Large Reasoning Models: An Empirical Study","version":2},"cited_work":{"arxiv_id":"2504.09946","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2504.09946","snapshot_observed_at":"2026-07-02T13:46:58.798974Z","title":"Assessing judging bias in large reasoning models: An empirical study.arXiv preprint arXiv:2504.09946, 2025a","venue":null,"work_id":"c9624367-78fa-4f5b-84a1-604a4ae46c17","year":2025},"citing_paper":{"arxiv_id":"2606.01462","last_updated":"2026-05-31T21:46:52Z","snapshot_observed_at":"2026-07-06T23:42:02.762832Z","submitted_at":"2026-05-31T21:46:52Z","title":"An Enigma of Artificial Reason: Investigating the Production-Evaluation Gap in Large Reasoning Models","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-06-28T16:45:33.046568Z"},"links":{"cited_paper":"/paper/2504.09946","citing_paper":"/paper/2606.01462"},"observation_digest":"sha256:4ad5825d3527b89465ce2446f3c4b6eb5f40a488acc2d1b7139fdb04e87a8576","observation_id":"de7ab540-249c-4c37-88ba-c09b73a8695a","resolution":{"observed_at":"2026-07-01T21:36:14.979242Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.09946","last_updated":"2025-04-18T02:05:38Z","snapshot_observed_at":"2026-08-07T16:06:00.056361Z","submitted_at":"2025-04-14T07:14:27Z","title":"Assessing Judging Bias in Large Reasoning Models: An Empirical Study","version":2},"cited_work":{"arxiv_id":"2504.09946","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2504.09946","snapshot_observed_at":"2026-07-02T13:46:58.798974Z","title":"Assessing judging bias in large reasoning models: An empirical study.arXiv preprint arXiv:2504.09946, 2025a","venue":null,"work_id":"c9624367-78fa-4f5b-84a1-604a4ae46c17","year":2025},"citing_paper":{"arxiv_id":"2606.04296","last_updated":"2026-06-02T23:54:27Z","snapshot_observed_at":"2026-08-04T09:35:32.620946Z","submitted_at":"2026-06-02T23:54:27Z","title":"The Saturation Trap and the Subjectivity of Intervention Timing: Why Affect-Based Triggers and LLM Judges Fail to Time Interventions on Autonomous Agents","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-06-28T09:27:48.400371Z"},"links":{"cited_paper":"/paper/2504.09946","citing_paper":"/paper/2606.04296"},"observation_digest":"sha256:d9cd06dbe77072cdad1918adb50d7baab80f46dbada5a5df52454be4ca16e7ba","observation_id":"5c98fb3c-8520-4226-b3ec-997ec28c0470","resolution":{"observed_at":"2026-07-02T04:06:35.117102Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.09946","last_updated":"2025-04-18T02:05:38Z","snapshot_observed_at":"2026-08-07T16:06:00.056361Z","submitted_at":"2025-04-14T07:14:27Z","title":"Assessing Judging Bias in Large Reasoning Models: An Empirical Study","version":2},"cited_work":{"arxiv_id":"2504.09946","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2504.09946","snapshot_observed_at":"2026-07-02T13:46:58.798974Z","title":"Assessing judging bias in large reasoning models: An empirical study.arXiv preprint arXiv:2504.09946, 2025a","venue":null,"work_id":"c9624367-78fa-4f5b-84a1-604a4ae46c17","year":2025},"citing_paper":{"arxiv_id":"2607.00415","last_updated":"2026-07-01T04:16:59Z","snapshot_observed_at":"2026-07-07T00:06:03.968882Z","submitted_at":"2026-07-01T04:16:59Z","title":"A Mechanistic View of Authority Hierarchy in LLM Sycophancy","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-07-02T13:41:18.279864Z"},"links":{"cited_paper":"/paper/2504.09946","citing_paper":"/paper/2607.00415"},"observation_digest":"sha256:c2eb10f555172e16d42060ee14cc5551af3f4ad75f1e8a89cc29d871b1d3fef3","observation_id":"2e2cdb51-dc98-4b39-ac21-03865044b9a3","resolution":{"observed_at":"2026-07-02T13:46:58.800444Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2504.09946/citation-record","integrity":"/paper/2504.09946/integrity","json":"/paper/2504.09946/citation-record.json","paper":"/paper/2504.09946"},"outbound":[],"paper":{"arxiv_id":"2504.09946","last_updated":"2025-04-18T02:05:38Z","latest_version":2,"primary_category":"cs.CY","snapshot_observed_at":"2026-08-07T16:06:00.056361Z","submitted_at":"2025-04-14T07:14:27Z","title":"Assessing Judging Bias in Large Reasoning Models: An Empirical Study"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 14 inbound Pith citation observations for arXiv:2504.09946."}