{"as_of":"2026-08-07T22:16:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:8996d7ef3ef1d176b08f1a150e6e7e8461c2816193179ef20a350369a6705ab2","coverage":[{"denominator":94,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":94,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T05:11:02.126578Z","state":"measured"},{"denominator":95,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":95,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-13T20:10:43.578904Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-13T20:13:13.699302Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2509.05852","last_updated":"2025-09-06T22:29:17Z","snapshot_observed_at":"2026-08-05T05:10:49.872306Z","submitted_at":"2025-09-06T22:29:17Z","title":"Fisher Random Walk: Automatic Debiasing Contextual Preference Inference for Large Language Model Evaluation","version":1},"cited_work":{"arxiv_id":"2509.05852","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2509.05852","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"X., Lu, J., and Xu, X","venue":null,"work_id":"03fd25b9-5ee4-4484-917a-a4ed13d2924a","year":2025},"citing_paper":{"arxiv_id":"2604.02507","last_updated":"2026-04-02T21:04:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-02T21:04:17Z","title":"Reinforcement Learning from Human Feedback: A Statistical Perspective","version":1},"reference_index":91,"source":"arxiv_source","source_observed_at":"2026-05-13T20:10:43.578904Z"},"links":{"cited_paper":"/paper/2509.05852","citing_paper":"/paper/2604.02507"},"observation_digest":"sha256:0f4e04b38cee19dc24f94b98d6bdc14ecc635809f70440dd60d0881630d21f3f","observation_id":"762b5558-c02e-4c32-9cd9-d5623d61e648","resolution":{"observed_at":"2026-05-13T20:13:13.701794Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2509.05852/citation-record","integrity":"/paper/2509.05852/integrity","json":"/paper/2509.05852/citation-record.json","paper":"/paper/2509.05852"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:10:59.404527Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.05852","last_updated":"2025-09-06T22:29:17Z","snapshot_observed_at":"2026-08-05T05:10:49.872306Z","submitted_at":"2025-09-06T22:29:17Z","title":"Fisher Random Walk: Automatic Debiasing Contextual Preference Inference for Large Language Model Evaluation","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-05T05:10:59.404527Z"},"links":{"citing_paper":"/paper/2509.05852"},"observation_digest":"sha256:67ff621ae8040592575efe9c8f7c18c2a852ee56a316d0fa80b82853c773248b","observation_id":"f9703767-2b0b-4c26-974b-7bbc764bcc81","resolution":{"observed_at":"2026-08-05T05:10:59.404527Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:10:59.478217Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2509.05852","last_updated":"2025-09-06T22:29:17Z","snapshot_observed_at":"2026-08-05T05:10:49.872306Z","submitted_at":"2025-09-06T22:29:17Z","title":"Fisher Random Walk: Automatic Debiasing Contextual Preference Inference for Large Language Model Evaluation","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-05T05:10:59.478217Z"},"links":{"citing_paper":"/paper/2509.05852"},"observation_digest":"sha256:24971b97605e4128fd4b5d8475beb5b709f19e275c39dfbd4f34a5149f4160e6","observation_id":"2da536a0-670a-4aee-8146-2b6cad35730c","resolution":{"observed_at":"2026-08-05T05:10:59.478217Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.04023","last_updated":"2023-11-28T09:01:12Z","snapshot_observed_at":"2026-08-07T14:17:12.140094Z","submitted_at":"2023-02-08T12:35:34Z","title":"A Multitask, Multilingual, Multimodal Evaluation of ChatGPT on Reasoning, Hallucination, and Interactivity","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.04023","snapshot_observed_at":"2026-08-05T05:10:59.534737Z","title":"Cahyawijaya, N","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.05852","last_updated":"2025-09-06T22:29:17Z","snapshot_observed_at":"2026-08-05T05:10:49.872306Z","submitted_at":"2025-09-06T22:29:17Z","title":"Fisher Random Walk: Automatic Debiasing Contextual Preference Inference for Large Language Model Evaluation","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-05T05:10:59.534737Z"},"links":{"cited_paper":"/paper/2302.04023","citing_paper":"/paper/2509.05852"},"observation_digest":"sha256:9835c89e2374e1cad2e410e588c1ec01ecdf4b0f7fa3b49437ed23958cc050d5","observation_id":"6a4d44b4-b054-48f8-b5fb-e89ad072dfd5","resolution":{"observed_at":"2026-08-05T05:10:59.534737Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:10:59.599503Z","title":null,"venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2509.05852","last_updated":"2025-09-06T22:29:17Z","snapshot_observed_at":"2026-08-05T05:10:49.872306Z","submitted_at":"2025-09-06T22:29:17Z","title":"Fisher Random Walk: Automatic Debiasing Contextual Preference Inference for Large Language Model Evaluation","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-05T05:10:59.599503Z"},"links":{"citing_paper":"/paper/2509.05852"},"observation_digest":"sha256:f0abf75123c69a3422adf7c8b2c46bfdc1fd6111fd4844fdb812770682e754d2","observation_id":"447d37be-e58c-48db-96f5-712c68bbb885","resolution":{"observed_at":"2026-08-05T05:10:59.599503Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:10:59.644699Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2509.05852","last_updated":"2025-09-06T22:29:17Z","snapshot_observed_at":"2026-08-05T05:10:49.872306Z","submitted_at":"2025-09-06T22:29:17Z","title":"Fisher Random Walk: Automatic Debiasing Contextual Preference Inference for Large Language Model Evaluation","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-05T05:10:59.644699Z"},"links":{"citing_paper":"/paper/2509.05852"},"observation_digest":"sha256:d4ee6abb8ef3fca82e1db3b5d92d96e94ac3c7a4045f70d05365fe381421f7fe","observation_id":"ee36c7fe-39f7-4526-9912-d31677346bb4","resolution":{"observed_at":"2026-08-05T05:10:59.644699Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:10:59.690507Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2509.05852","last_updated":"2025-09-06T22:29:17Z","snapshot_observed_at":"2026-08-05T05:10:49.872306Z","submitted_at":"2025-09-06T22:29:17Z","title":"Fisher Random Walk: Automatic Debiasing Contextual Preference Inference for Large Language Model Evaluation","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-05T05:10:59.690507Z"},"links":{"citing_paper":"/paper/2509.05852"},"observation_digest":"sha256:677296039e402bf6694570434fc7300a949e4ca08a5644c380129b0307e5b67d","observation_id":"cd069af7-a1e7-4a31-ade9-1cb4b9aef0c4","resolution":{"observed_at":"2026-08-05T05:10:59.690507Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.05961","last_updated":"2024-08-21T22:46:05Z","snapshot_observed_at":"2026-07-06T17:57:31.912970Z","submitted_at":"2024-04-09T02:51:05Z","title":"LLM2Vec: Large Language Models Are Secretly Powerful Text Encoders","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.05961","snapshot_observed_at":"2026-08-05T05:10:59.772222Z","title":"Adlakha, M","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.05852","last_updated":"2025-09-06T22:29:17Z","snapshot_observed_at":"2026-08-05T05:10:49.872306Z","submitted_at":"2025-09-06T22:29:17Z","title":"Fisher Random Walk: Automatic Debiasing Contextual Preference Inference for Large Language Model Evaluation","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-05T05:10:59.772222Z"},"links":{"cited_paper":"/paper/2404.05961","citing_paper":"/paper/2509.05852"},"observation_digest":"sha256:358bca6cd93997dd28589ce0797558c2ee1fe59b489dbbdaa7fd1569e749b463","observation_id":"88c899ea-67f1-44f1-abdf-aa60c151c162","resolution":{"observed_at":"2026-08-05T05:10:59.772222Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1806.01888","last_updated":"2018-06-10T15:21:13Z","snapshot_observed_at":"2026-08-05T06:50:41.291447Z","submitted_at":"2018-06-05T18:46:12Z","title":"High-Dimensional Econometrics and Regularized GMM","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1806.01888","snapshot_observed_at":"2026-08-05T05:10:59.806700Z","title":"Chernozhukov, D","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2509.05852","last_updated":"2025-09-06T22:29:17Z","snapshot_observed_at":"2026-08-05T05:10:49.872306Z","submitted_at":"2025-09-06T22:29:17Z","title":"Fisher Random Walk: Automatic Debiasing Contextual Preference Inference for Large Language Model Evaluation","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-05T05:10:59.806700Z"},"links":{"cited_paper":"/paper/1806.01888","citing_paper":"/paper/2509.05852"},"observation_digest":"sha256:02ccb10dfc9c4d4f706285843c2598d2385397759bbb017a1c88a2f9094b5bb3","observation_id":"53402e1b-10e0-4903-86bc-d24f223a7afa","resolution":{"observed_at":"2026-08-05T05:10:59.806700Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.02954","last_updated":"2024-01-05T18:59:13Z","snapshot_observed_at":"2026-08-02T13:11:16.882565Z","submitted_at":"2024-01-05T18:59:13Z","title":"DeepSeek LLM: Scaling Open-Source Language Models with Longtermism","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.02954","snapshot_observed_at":"2026-08-05T05:10:59.887001Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.05852","last_updated":"2025-09-06T22:29:17Z","snapshot_observed_at":"2026-08-05T05:10:49.872306Z","submitted_at":"2025-09-06T22:29:17Z","title":"Fisher Random Walk: Automatic Debiasing Contextual Preference Inference for Large Language Model Evaluation","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-05T05:10:59.887001Z"},"links":{"cited_paper":"/paper/2401.02954","citing_paper":"/paper/2509.05852"},"observation_digest":"sha256:7305939903cc316fdcd7a61743dc2941451e44df6e10dce70d19be436bca77d5","observation_id":"df318beb-1bf0-483f-9677-22065945fbe3","resolution":{"observed_at":"2026-08-05T05:10:59.887001Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:10:59.956613Z","title":null,"venue":null,"work_id":null,"year":1993},"citing_paper":{"arxiv_id":"2509.05852","last_updated":"2025-09-06T22:29:17Z","snapshot_observed_at":"2026-08-05T05:10:49.872306Z","submitted_at":"2025-09-06T22:29:17Z","title":"Fisher Random Walk: Automatic Debiasing Contextual Preference Inference for Large Language Model Evaluation","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-05T05:10:59.956613Z"},"links":{"citing_paper":"/paper/2509.05852"},"observation_digest":"sha256:59ae84ef3081d617f2b1d0d38524934895c10ce61fa2a98d9edc2f2a86db253f","observation_id":"30ebf890-e043-4344-b14f-59495e89d924","resolution":{"observed_at":"2026-08-05T05:10:59.956613Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:11:00.018352Z","title":"Liang, and T","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.05852","last_updated":"2025-09-06T22:29:17Z","snapshot_observed_at":"2026-08-05T05:10:49.872306Z","submitted_at":"2025-09-06T22:29:17Z","title":"Fisher Random Walk: Automatic Debiasing Contextual Preference Inference for Large Language Model Evaluation","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-05T05:11:00.018352Z"},"links":{"citing_paper":"/paper/2509.05852"},"observation_digest":"sha256:73447fb3427b0b337c30b77473f5acb88ed37d7c2d3258be5dd4915e17d6ce6e","observation_id":"ec89ffcd-1372-4574-ba44-3c3426f8f113","resolution":{"observed_at":"2026-08-05T05:11:00.018352Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:11:00.105530Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.05852","last_updated":"2025-09-06T22:29:17Z","snapshot_observed_at":"2026-08-05T05:10:49.872306Z","submitted_at":"2025-09-06T22:29:17Z","title":"Fisher Random Walk: Automatic Debiasing Contextual Preference Inference for Large Language Model Evaluation","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-05T05:11:00.105530Z"},"links":{"citing_paper":"/paper/2509.05852"},"observation_digest":"sha256:4255f7ae30158f35df378e02bd3e2d083391e28799be3c825a631d42635a2679","observation_id":"2cb57d7c-d02e-4926-9e5c-4a81387cd729","resolution":{"observed_at":"2026-08-05T05:11:00.105530Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:11:00.135354Z","title":null,"venue":null,"work_id":null,"year":1952},"citing_paper":{"arxiv_id":"2509.05852","last_updated":"2025-09-06T22:29:17Z","snapshot_observed_at":"2026-08-05T05:10:49.872306Z","submitted_at":"2025-09-06T22:29:17Z","title":"Fisher Random Walk: Automatic Debiasing Contextual Preference Inference for Large Language Model Evaluation","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-05T05:11:00.135354Z"},"links":{"citing_paper":"/paper/2509.05852"},"observation_digest":"sha256:244eed22bbcdd03ac6572b617dcbe39c65e23131fb25202ef477054e27ae6272","observation_id":"401de8ca-948d-41af-922f-d2d37a336d99","resolution":{"observed_at":"2026-08-05T05:11:00.135354Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:11:00.163615Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.05852","last_updated":"2025-09-06T22:29:17Z","snapshot_observed_at":"2026-08-05T05:10:49.872306Z","submitted_at":"2025-09-06T22:29:17Z","title":"Fisher Random Walk: Automatic Debiasing Contextual Preference Inference for Large Language Model Evaluation","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-05T05:11:00.163615Z"},"links":{"citing_paper":"/paper/2509.05852"},"observation_digest":"sha256:155c8bceeb597b2fbe03d9193b118b805d97f1b2762a92402677ea4e834eac50","observation_id":"6f1aa997-150b-4018-a9b3-e5595de7c611","resolution":{"observed_at":"2026-08-05T05:11:00.163615Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:11:00.192851Z","title":null,"venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2509.05852","last_updated":"2025-09-06T22:29:17Z","snapshot_observed_at":"2026-08-05T05:10:49.872306Z","submitted_at":"2025-09-06T22:29:17Z","title":"Fisher Random Walk: Automatic Debiasing Contextual Preference Inference for Large Language Model Evaluation","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-05T05:11:00.192851Z"},"links":{"citing_paper":"/paper/2509.05852"},"observation_digest":"sha256:9b754ff89e31b0019ac2889e23e4c2ef2ce91dd5e90b049c355aead2a02c5692","observation_id":"3cc26421-8b43-4dc0-a988-d11d6b53600a","resolution":{"observed_at":"2026-08-05T05:11:00.192851Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:11:00.308818Z","title":"Gao, and A","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.05852","last_updated":"2025-09-06T22:29:17Z","snapshot_observed_at":"2026-08-05T05:10:49.872306Z","submitted_at":"2025-09-06T22:29:17Z","title":"Fisher Random Walk: Automatic Debiasing Contextual Preference Inference for Large Language Model Evaluation","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-05T05:11:00.308818Z"},"links":{"citing_paper":"/paper/2509.05852"},"observation_digest":"sha256:a2fce7871b9b9a4557be235052c67e7c5e8104b133bc9342140ede0cc5f06958","observation_id":"9a72bcce-be7e-4366-b54b-61d31378cdb0","resolution":{"observed_at":"2026-08-05T05:11:00.308818Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:11:00.399730Z","title":"Chetverikov, M","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2509.05852","last_updated":"2025-09-06T22:29:17Z","snapshot_observed_at":"2026-08-05T05:10:49.872306Z","submitted_at":"2025-09-06T22:29:17Z","title":"Fisher Random Walk: Automatic Debiasing Contextual Preference Inference for Large Language Model Evaluation","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-05T05:11:00.399730Z"},"links":{"citing_paper":"/paper/2509.05852"},"observation_digest":"sha256:315de133a097d79a079c04a5e95c45ac003599a014d6f897567e2d8d9dc22fb8","observation_id":"edcb5384-a0c4-4715-988c-054109c48bdf","resolution":{"observed_at":"2026-08-05T05:11:00.399730Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:11:00.473334Z","title":"Chetverikov, and K","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2509.05852","last_updated":"2025-09-06T22:29:17Z","snapshot_observed_at":"2026-08-05T05:10:49.872306Z","submitted_at":"2025-09-06T22:29:17Z","title":"Fisher Random Walk: Automatic Debiasing Contextual Preference Inference for Large Language Model Evaluation","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-05T05:11:00.473334Z"},"links":{"citing_paper":"/paper/2509.05852"},"observation_digest":"sha256:cae51f2997f7a0c82351e97c0546e6a4affbf13cf371efa823c00d5425c08a5c","observation_id":"4d0c59ca-ea60-4944-a171-91badb84b6be","resolution":{"observed_at":"2026-08-05T05:11:00.473334Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:11:00.552250Z","title":"Newey, W","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.05852","last_updated":"2025-09-06T22:29:17Z","snapshot_observed_at":"2026-08-05T05:10:49.872306Z","submitted_at":"2025-09-06T22:29:17Z","title":"Fisher Random Walk: Automatic Debiasing Contextual Preference Inference for Large Language Model Evaluation","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-05T05:11:00.552250Z"},"links":{"citing_paper":"/paper/2509.05852"},"observation_digest":"sha256:34f884ecb3db5ec237191ea355bfb8249f8d510b4222793aea0446d8f2451c84","observation_id":"74555a3f-3ee3-4a05-a271-bc647d585bbe","resolution":{"observed_at":"2026-08-05T05:11:00.552250Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2104.14737","last_updated":"2024-03-14T20:38:25Z","snapshot_observed_at":"2026-07-06T11:05:01.545358Z","submitted_at":"2021-04-30T03:18:54Z","title":"Automatic Debiased Machine Learning via Riesz Regression","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.14737","snapshot_observed_at":"2026-08-05T05:11:00.679014Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2509.05852","last_updated":"2025-09-06T22:29:17Z","snapshot_observed_at":"2026-08-05T05:10:49.872306Z","submitted_at":"2025-09-06T22:29:17Z","title":"Fisher Random Walk: Automatic Debiasing Contextual Preference Inference for Large Language Model Evaluation","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-05T05:11:00.679014Z"},"links":{"cited_paper":"/paper/2104.14737","citing_paper":"/paper/2509.05852"},"observation_digest":"sha256:a5f47c56e96b60027cfe5856e33ed52b081009d7b19c490177777c6b8f9be6ad","observation_id":"813aaf2d-780f-4d19-88bf-0b8e1988c963","resolution":{"observed_at":"2026-08-05T05:11:00.679014Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:11:02.952159Z","title":null,"venue":null,"work_id":"6adac493-e381-40bc-85dd-f95f7662d69e","year":2022},"citing_paper":{"arxiv_id":"2509.05852","last_updated":"2025-09-06T22:29:17Z","snapshot_observed_at":"2026-08-05T05:10:49.872306Z","submitted_at":"2025-09-06T22:29:17Z","title":"Fisher Random Walk: Automatic Debiasing Contextual Preference Inference for Large Language Model Evaluation","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-05T05:11:00.748139Z"},"links":{"citing_paper":"/paper/2509.05852"},"observation_digest":"sha256:ee6888f3272b4ea1643dca5406f1edd60bb10bbdcadd007e0269415937fc5704","observation_id":"fe9b2944-d130-4d6e-944e-4f4aca095483","resolution":{"observed_at":"2026-08-05T05:11:02.954557Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.04132","last_updated":"2024-03-07T01:22:38Z","snapshot_observed_at":"2026-08-02T17:55:33.750637Z","submitted_at":"2024-03-07T01:22:38Z","title":"Chatbot Arena: An Open Platform for Evaluating LLMs by Human Preference","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.04132","snapshot_observed_at":"2026-08-05T05:11:00.893392Z","title":"Zheng, Y","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.05852","last_updated":"2025-09-06T22:29:17Z","snapshot_observed_at":"2026-08-05T05:10:49.872306Z","submitted_at":"2025-09-06T22:29:17Z","title":"Fisher Random Walk: Automatic Debiasing Contextual Preference Inference for Large Language Model Evaluation","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-05T05:11:00.893392Z"},"links":{"cited_paper":"/paper/2403.04132","citing_paper":"/paper/2509.05852"},"observation_digest":"sha256:b0a42e210a8402df5fe88d2ebbf1095c12675cf2579e7e54e16547f8c72e5971","observation_id":"ad5d5dcb-98de-4436-a9cd-69f0b1bebda3","resolution":{"observed_at":"2026-08-05T05:11:00.893392Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:11:02.945309Z","title":null,"venue":null,"work_id":"5d0aea26-94eb-457c-a49c-d6d01a4ced16","year":2017},"citing_paper":{"arxiv_id":"2509.05852","last_updated":"2025-09-06T22:29:17Z","snapshot_observed_at":"2026-08-05T05:10:49.872306Z","submitted_at":"2025-09-06T22:29:17Z","title":"Fisher Random Walk: Automatic Debiasing Contextual Preference Inference for Large Language Model Evaluation","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-05T05:11:00.956800Z"},"links":{"citing_paper":"/paper/2509.05852"},"observation_digest":"sha256:b2b811ce1a597864bac74e20c5928dca8903fd12f852fc3f3dee06fa067df01f","observation_id":"a406f8d8-577c-4d4e-8083-8da478c33c27","resolution":{"observed_at":"2026-08-05T05:11:02.947656Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:11:02.937625Z","title":null,"venue":null,"work_id":"230cce3a-da02-4b25-b05f-ad43b38b40aa","year":2024},"citing_paper":{"arxiv_id":"2509.05852","last_updated":"2025-09-06T22:29:17Z","snapshot_observed_at":"2026-08-05T05:10:49.872306Z","submitted_at":"2025-09-06T22:29:17Z","title":"Fisher Random Walk: Automatic Debiasing Contextual Preference Inference for Large Language Model Evaluation","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-05T05:11:01.055082Z"},"links":{"citing_paper":"/paper/2509.05852"},"observation_digest":"sha256:784af64a2661ac93de969a5f7b22587e6fe52c6121e3e071c73b88f422d511d8","observation_id":"951d491d-0861-48cb-a65e-8d375156961f","resolution":{"observed_at":"2026-08-05T05:11:02.940200Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.06331","last_updated":"2023-10-31T08:21:20Z","snapshot_observed_at":"2026-08-07T17:14:53.284938Z","submitted_at":"2023-06-10T02:01:02Z","title":"Investigating the Effectiveness of ChatGPT in Mathematical Reasoning and Problem Solving: Evidence from the Vietnamese National High School Graduation Examination","version":3},"cited_work":{"arxiv_id":"2306.06331","doi":null,"metadata_source":"pith","pith_arxiv_id":"2306.06331","snapshot_observed_at":"2026-08-05T05:11:02.412453Z","title":"Investigating the Effectiveness of ChatGPT in Mathematical Reasoning and Problem Solving: Evidence from the Vietnamese National High School Graduation Examination","venue":"cs.CL","work_id":"9857d244-57f5-4c93-9291-14be588e048e","year":2023},"citing_paper":{"arxiv_id":"2509.05852","last_updated":"2025-09-06T22:29:17Z","snapshot_observed_at":"2026-08-05T05:10:49.872306Z","submitted_at":"2025-09-06T22:29:17Z","title":"Fisher Random Walk: Automatic Debiasing Contextual Preference Inference for Large Language Model Evaluation","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-05T05:11:01.161847Z"},"links":{"cited_paper":"/paper/2306.06331","citing_paper":"/paper/2509.05852"},"observation_digest":"sha256:a7acc8af3bf6140ac2e050e04ad4d607ee64b9fd843326a8f15fd2034cd7c8a9","observation_id":"4ee0507a-5e75-4001-bd9d-29c1fbcc0d50","resolution":{"observed_at":"2026-08-05T05:11:02.415501Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:11:02.930497Z","title":null,"venue":null,"work_id":"0f7196f3-13d3-4e52-aa3f-b75d91f2d549","year":2007},"citing_paper":{"arxiv_id":"2509.05852","last_updated":"2025-09-06T22:29:17Z","snapshot_observed_at":"2026-08-05T05:10:49.872306Z","submitted_at":"2025-09-06T22:29:17Z","title":"Fisher Random Walk: Automatic Debiasing Contextual Preference Inference for Large Language Model Evaluation","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-05T05:11:01.223383Z"},"links":{"citing_paper":"/paper/2509.05852"},"observation_digest":"sha256:9ba4e7af24c399490ed7ce4331bd8ba930c86e81a182ea937117f360d2530b03","observation_id":"bf7ba6a0-d4fa-4db0-a4d7-ed4cb6a2816b","resolution":{"observed_at":"2026-08-05T05:11:02.932957Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:11:02.923580Z","title":null,"venue":null,"work_id":"66da43eb-23c5-4a8f-9d4f-73ac188b65c7","year":1960},"citing_paper":{"arxiv_id":"2509.05852","last_updated":"2025-09-06T22:29:17Z","snapshot_observed_at":"2026-08-05T05:10:49.872306Z","submitted_at":"2025-09-06T22:29:17Z","title":"Fisher Random Walk: Automatic Debiasing Contextual Preference Inference for Large Language Model Evaluation","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-05T05:11:01.240398Z"},"links":{"citing_paper":"/paper/2509.05852"},"observation_digest":"sha256:47ac953d031248371387f6f891c99cc4b4717babcd8247ecff01e7e3e7bf8c99","observation_id":"8e6946fc-9297-4357-aeb1-f1c983b13a1e","resolution":{"observed_at":"2026-08-05T05:11:02.925831Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.12205","last_updated":"2024-05-20T17:45:26Z","snapshot_observed_at":"2026-07-06T18:16:51.116432Z","submitted_at":"2024-05-20T17:45:26Z","title":"Metacognitive Capabilities of LLMs: An Exploration in Mathematical Problem Solving","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.12205","snapshot_observed_at":"2026-08-05T05:11:01.270284Z","title":"Goyal, N","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.05852","last_updated":"2025-09-06T22:29:17Z","snapshot_observed_at":"2026-08-05T05:10:49.872306Z","submitted_at":"2025-09-06T22:29:17Z","title":"Fisher Random Walk: Automatic Debiasing Contextual Preference Inference for Large Language Model Evaluation","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-05T05:11:01.270284Z"},"links":{"cited_paper":"/paper/2405.12205","citing_paper":"/paper/2509.05852"},"observation_digest":"sha256:f99d2af993cbfabf1d6ee8b669d445e2ff853e2892a199061524dc6f18ed5605","observation_id":"9d474cf3-6d6d-4746-9812-b397ede3e77b","resolution":{"observed_at":"2026-08-05T05:11:01.270284Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:11:02.916528Z","title":null,"venue":null,"work_id":"fe45ab42-0bff-418a-8fb7-7b8239d510af","year":1984},"citing_paper":{"arxiv_id":"2509.05852","last_updated":"2025-09-06T22:29:17Z","snapshot_observed_at":"2026-08-05T05:10:49.872306Z","submitted_at":"2025-09-06T22:29:17Z","title":"Fisher Random Walk: Automatic Debiasing Contextual Preference Inference for Large Language Model Evaluation","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-05T05:11:01.402599Z"},"links":{"citing_paper":"/paper/2509.05852"},"observation_digest":"sha256:fb8b6032ef3ebcd3149c08affd3a6faddc88fa5e1cbb2459cfd675632b0a6fcd","observation_id":"f83dac3f-644e-4f05-b5db-39147fe728a7","resolution":{"observed_at":"2026-08-05T05:11:02.918865Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:11:02.909698Z","title":"Knowles, H.-T","venue":null,"work_id":"94e26540-e43c-4a6d-8c45-ef3c9f56ff12","year":2013},"citing_paper":{"arxiv_id":"2509.05852","last_updated":"2025-09-06T22:29:17Z","snapshot_observed_at":"2026-08-05T05:10:49.872306Z","submitted_at":"2025-09-06T22:29:17Z","title":"Fisher Random Walk: Automatic Debiasing Contextual Preference Inference for Large Language Model Evaluation","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-05T05:11:01.540661Z"},"links":{"citing_paper":"/paper/2509.05852"},"observation_digest":"sha256:d13a0d6cd76f7cf4017b6ad2060255a1d8d49af5a16ca93713017c146dc586c6","observation_id":"dd8c0ba8-8449-48ae-8d17-ace9ab453dae","resolution":{"observed_at":"2026-08-05T05:11:02.912041Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:11:02.902714Z","title":"Gu, and W.-X","venue":null,"work_id":"9a93fba4-04a4-465e-b4bf-db0c3a9d1f0d","year":2024},"citing_paper":{"arxiv_id":"2509.05852","last_updated":"2025-09-06T22:29:17Z","snapshot_observed_at":"2026-08-05T05:10:49.872306Z","submitted_at":"2025-09-06T22:29:17Z","title":"Fisher Random Walk: Automatic Debiasing Contextual Preference Inference for Large Language Model Evaluation","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-05T05:11:01.614669Z"},"links":{"citing_paper":"/paper/2509.05852"},"observation_digest":"sha256:915659bd975c1df5d9a92fd750986a23941a438ae6091bb67b2e45456a4b1508","observation_id":"6c50aeba-793f-4602-a82a-08e97b8a5052","resolution":{"observed_at":"2026-08-05T05:11:02.905034Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:11:02.895673Z","title":"Hou, and M","venue":null,"work_id":"35a71cb0-3bb8-4be7-9887-05a4dfb5357b","year":2024},"citing_paper":{"arxiv_id":"2509.05852","last_updated":"2025-09-06T22:29:17Z","snapshot_observed_at":"2026-08-05T05:10:49.872306Z","submitted_at":"2025-09-06T22:29:17Z","title":"Fisher Random Walk: Automatic Debiasing Contextual Preference Inference for Large Language Model Evaluation","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-05T05:11:01.661049Z"},"links":{"citing_paper":"/paper/2509.05852"},"observation_digest":"sha256:e7f6161c6990fa3fe68ffd8c73abd3021000d44abd00bb15bb4fb39b5aa73b25","observation_id":"01c8a7ee-ea84-439d-af3c-37676d98dbc2","resolution":{"observed_at":"2026-08-05T05:11:02.897938Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:11:02.888776Z","title":"Ma, and Y","venue":null,"work_id":"f2a37331-136d-4c92-98ee-f1eaae69ff60","year":2020},"citing_paper":{"arxiv_id":"2509.05852","last_updated":"2025-09-06T22:29:17Z","snapshot_observed_at":"2026-08-05T05:10:49.872306Z","submitted_at":"2025-09-06T22:29:17Z","title":"Fisher Random Walk: Automatic Debiasing Contextual Preference Inference for Large Language Model Evaluation","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-05T05:11:01.768522Z"},"links":{"citing_paper":"/paper/2509.05852"},"observation_digest":"sha256:bc77d24b84552916e3d6cb848ffcfb72f7a2cae960deae90a07305518ed427f1","observation_id":"f775fa62-a216-43cc-9299-8f8f3b7666dc","resolution":{"observed_at":"2026-08-05T05:11:02.891051Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:11:02.881642Z","title":null,"venue":null,"work_id":"9d48fb92-a73f-4aaf-b168-b47e8db14b29","year":2021},"citing_paper":{"arxiv_id":"2509.05852","last_updated":"2025-09-06T22:29:17Z","snapshot_observed_at":"2026-08-05T05:10:49.872306Z","submitted_at":"2025-09-06T22:29:17Z","title":"Fisher Random Walk: Automatic Debiasing Contextual Preference Inference for Large Language Model Evaluation","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-05T05:11:01.824739Z"},"links":{"citing_paper":"/paper/2509.05852"},"observation_digest":"sha256:85690b42b3cab5e63339fbc2973345bc15a3013f9a741eeeec9b1922aff1594d","observation_id":"cc2da0fb-150f-4806-8e57-1fc24e0f6641","resolution":{"observed_at":"2026-08-05T05:11:02.884318Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:11:02.874675Z","title":null,"venue":null,"work_id":"ee7672aa-3076-47cd-a2ea-a0d081360edb","year":2023},"citing_paper":{"arxiv_id":"2509.05852","last_updated":"2025-09-06T22:29:17Z","snapshot_observed_at":"2026-08-05T05:10:49.872306Z","submitted_at":"2025-09-06T22:29:17Z","title":"Fisher Random Walk: Automatic Debiasing Contextual Preference Inference for Large Language Model Evaluation","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-05T05:11:01.930069Z"},"links":{"citing_paper":"/paper/2509.05852"},"observation_digest":"sha256:5566a56992f10ff2eac7c59ffe1f14149344c6a4a029360e4023bba91349809b","observation_id":"a0458d7b-0f05-4779-9438-bcf318c57b87","resolution":{"observed_at":"2026-08-05T05:11:02.877071Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:11:02.867844Z","title":"Shen, and A","venue":null,"work_id":"3bb4a66f-4bbc-46e3-a5aa-e0f6e27c63b6","year":2023},"citing_paper":{"arxiv_id":"2509.05852","last_updated":"2025-09-06T22:29:17Z","snapshot_observed_at":"2026-08-05T05:10:49.872306Z","submitted_at":"2025-09-06T22:29:17Z","title":"Fisher Random Walk: Automatic Debiasing Contextual Preference Inference for Large Language Model Evaluation","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-05T05:11:01.983069Z"},"links":{"citing_paper":"/paper/2509.05852"},"observation_digest":"sha256:84de78fe397f1c011cde1d3d0ef4756da30b4a7d145f40b0eaa8087f1a9b2c42","observation_id":"24bf469e-29b5-40fa-b55e-daf6475415ae","resolution":{"observed_at":"2026-08-05T05:11:02.870184Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:11:02.860831Z","title":null,"venue":null,"work_id":"73ee95a4-728b-42a8-a1b9-a8fd39a31dcf","year":2020},"citing_paper":{"arxiv_id":"2509.05852","last_updated":"2025-09-06T22:29:17Z","snapshot_observed_at":"2026-08-05T05:10:49.872306Z","submitted_at":"2025-09-06T22:29:17Z","title":"Fisher Random Walk: Automatic Debiasing Contextual Preference Inference for Large Language Model Evaluation","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-05T05:11:01.985647Z"},"links":{"citing_paper":"/paper/2509.05852"},"observation_digest":"sha256:2637bfc41e37dfa7b8b25d5c8ecde43b5aa61ba58105a18e9d289e8366ab990e","observation_id":"6067dd05-cf72-4c42-81b1-f84f20ea6454","resolution":{"observed_at":"2026-08-05T05:11:02.863192Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:11:02.853643Z","title":"Boyd, and A","venue":null,"work_id":"a322dc1b-59a4-4464-a940-6bc3b0aefe41","year":2008},"citing_paper":{"arxiv_id":"2509.05852","last_updated":"2025-09-06T22:29:17Z","snapshot_observed_at":"2026-08-05T05:10:49.872306Z","submitted_at":"2025-09-06T22:29:17Z","title":"Fisher Random Walk: Automatic Debiasing Contextual Preference Inference for Large Language Model Evaluation","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-05T05:11:01.987986Z"},"links":{"citing_paper":"/paper/2509.05852"},"observation_digest":"sha256:1394c6d09c89948c08fd1a117a86bfd550530c29b6568a0047f3527fc5ed52b4","observation_id":"231da27b-9dc8-4733-bf60-ca12893fc39f","resolution":{"observed_at":"2026-08-05T05:11:02.856150Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:11:02.846175Z","title":null,"venue":null,"work_id":"603a9731-1b8e-4141-bc77-13d84178d3cb","year":2023},"citing_paper":{"arxiv_id":"2509.05852","last_updated":"2025-09-06T22:29:17Z","snapshot_observed_at":"2026-08-05T05:10:49.872306Z","submitted_at":"2025-09-06T22:29:17Z","title":"Fisher Random Walk: Automatic Debiasing Contextual Preference Inference for Large Language Model Evaluation","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-05T05:11:01.990324Z"},"links":{"citing_paper":"/paper/2509.05852"},"observation_digest":"sha256:ac5798f448baba8c1a4c4c71565bc3276b15957fe08969e2c572eb2a4fd3a4ae","observation_id":"b1afe7fc-6761-43ec-b641-e09d161a222a","resolution":{"observed_at":"2026-08-05T05:11:02.848991Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:11:02.838812Z","title":"Resnick, and J","venue":null,"work_id":"4dcf89e1-d184-4414-80bc-394e947d8065","year":2013},"citing_paper":{"arxiv_id":"2509.05852","last_updated":"2025-09-06T22:29:17Z","snapshot_observed_at":"2026-08-05T05:10:49.872306Z","submitted_at":"2025-09-06T22:29:17Z","title":"Fisher Random Walk: Automatic Debiasing Contextual Preference Inference for Large Language Model Evaluation","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-05T05:11:01.992591Z"},"links":{"citing_paper":"/paper/2509.05852"},"observation_digest":"sha256:02749d6e34756d0c5e4d4102a90924f6f091db79ea0e76018dbebe4008f37f2f","observation_id":"02e8a853-40d1-4b71-8e85-44283e4b301a","resolution":{"observed_at":"2026-08-05T05:11:02.841203Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:11:02.831925Z","title":null,"venue":null,"work_id":"a795f28d-89d4-49cd-9072-2b6027fcbbee","year":2020},"citing_paper":{"arxiv_id":"2509.05852","last_updated":"2025-09-06T22:29:17Z","snapshot_observed_at":"2026-08-05T05:10:49.872306Z","submitted_at":"2025-09-06T22:29:17Z","title":"Fisher Random Walk: Automatic Debiasing Contextual Preference Inference for Large Language Model Evaluation","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-05T05:11:01.995156Z"},"links":{"citing_paper":"/paper/2509.05852"},"observation_digest":"sha256:89b653af34ac4a00da52303ed4748af0317bd372a6bd5f6d55cbae498444ae23","observation_id":"4c5d77e9-9a3a-4f31-b233-ac02c017dcd9","resolution":{"observed_at":"2026-08-05T05:11:02.834350Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:11:02.824619Z","title":"Price, and N","venue":null,"work_id":"1d03ab48-33f5-4ac4-b119-faa42ba418b9","year":2016},"citing_paper":{"arxiv_id":"2509.05852","last_updated":"2025-09-06T22:29:17Z","snapshot_observed_at":"2026-08-05T05:10:49.872306Z","submitted_at":"2025-09-06T22:29:17Z","title":"Fisher Random Walk: Automatic Debiasing Contextual Preference Inference for Large Language Model Evaluation","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-05T05:11:01.997358Z"},"links":{"citing_paper":"/paper/2509.05852"},"observation_digest":"sha256:5487e9b13d8063ac67310523fdb85b0498a947c52138f23d15caa8c721af86a5","observation_id":"91b97118-4279-4721-9a6c-31e086f7d42d","resolution":{"observed_at":"2026-08-05T05:11:02.827132Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2009.03300","last_updated":"2021-01-12T18:57:11Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-09-07T17:59:25Z","title":"Measuring Massive Multitask Language Understanding","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.03300","snapshot_observed_at":"2026-08-05T05:11:01.999796Z","title":"Burns, S","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2509.05852","last_updated":"2025-09-06T22:29:17Z","snapshot_observed_at":"2026-08-05T05:10:49.872306Z","submitted_at":"2025-09-06T22:29:17Z","title":"Fisher Random Walk: Automatic Debiasing Contextual Preference Inference for Large Language Model Evaluation","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-05T05:11:01.999796Z"},"links":{"cited_paper":"/paper/2009.03300","citing_paper":"/paper/2509.05852"},"observation_digest":"sha256:7f3e0219cbca98a757101addb981abfdf625ee1456c1bbf5514b51b70253787f","observation_id":"0344ac7a-87cf-4214-abef-1052afff391c","resolution":{"observed_at":"2026-08-05T05:11:01.999796Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:11:02.817719Z","title":null,"venue":null,"work_id":"4378f972-264a-41f8-858f-8e2f17e47a2a","year":2021},"citing_paper":{"arxiv_id":"2509.05852","last_updated":"2025-09-06T22:29:17Z","snapshot_observed_at":"2026-08-05T05:10:49.872306Z","submitted_at":"2025-09-06T22:29:17Z","title":"Fisher Random Walk: Automatic Debiasing Contextual Preference Inference for Large Language Model Evaluation","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-05T05:11:02.002246Z"},"links":{"citing_paper":"/paper/2509.05852"},"observation_digest":"sha256:81ca89c74d9d50f53085dac1a541a922797642e602d487d06ceffa6400fbf648","observation_id":"79db2412-d0c1-4b98-8555-38502cbb4ced","resolution":{"observed_at":"2026-08-05T05:11:02.820071Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:11:02.810938Z","title":null,"venue":null,"work_id":"d2321a97-fd20-4699-b238-bb816eeb96fd","year":2007},"citing_paper":{"arxiv_id":"2509.05852","last_updated":"2025-09-06T22:29:17Z","snapshot_observed_at":"2026-08-05T05:10:49.872306Z","submitted_at":"2025-09-06T22:29:17Z","title":"Fisher Random Walk: Automatic Debiasing Contextual Preference Inference for Large Language Model Evaluation","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-05T05:11:02.004521Z"},"links":{"citing_paper":"/paper/2509.05852"},"observation_digest":"sha256:3cf3a80b518f54d8dff7f1f7662331092065147aeb50f71317c81ccdf12ca8b3","observation_id":"99911f50-47b7-4032-beb2-1fd8dbc40ce8","resolution":{"observed_at":"2026-08-05T05:11:02.813266Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:11:02.803776Z","title":null,"venue":null,"work_id":"b7c39439-8ed0-4db5-9334-125094133f72","year":2022},"citing_paper":{"arxiv_id":"2509.05852","last_updated":"2025-09-06T22:29:17Z","snapshot_observed_at":"2026-08-05T05:10:49.872306Z","submitted_at":"2025-09-06T22:29:17Z","title":"Fisher Random Walk: Automatic Debiasing Contextual Preference Inference for Large Language Model Evaluation","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-05T05:11:02.006929Z"},"links":{"citing_paper":"/paper/2509.05852"},"observation_digest":"sha256:c84420d6a688e9b3d300f0152f2105a1f92765436e0e3cda0f46a744c8e16b64","observation_id":"c9f46a8a-0054-4733-8829-ed089f7ac636","resolution":{"observed_at":"2026-08-05T05:11:02.806186Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:11:02.796497Z","title":null,"venue":null,"work_id":"a4a870a9-0028-46aa-9647-0776fe0a1a1e","year":2014},"citing_paper":{"arxiv_id":"2509.05852","last_updated":"2025-09-06T22:29:17Z","snapshot_observed_at":"2026-08-05T05:10:49.872306Z","submitted_at":"2025-09-06T22:29:17Z","title":"Fisher Random Walk: Automatic Debiasing Contextual Preference Inference for Large Language Model Evaluation","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-05T05:11:02.009280Z"},"links":{"citing_paper":"/paper/2509.05852"},"observation_digest":"sha256:5b1001c50be44844c3dec7273cb8a2be366df12856b8261e9afd5216ef6e9bfe","observation_id":"14b93271-bac2-4ab2-835e-5ad5354b8525","resolution":{"observed_at":"2026-08-05T05:11:02.799202Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:11:02.789403Z","title":"Lepski, and A","venue":null,"work_id":"be607d1e-cf1a-4636-9330-e75bae238772","year":2009},"citing_paper":{"arxiv_id":"2509.05852","last_updated":"2025-09-06T22:29:17Z","snapshot_observed_at":"2026-08-05T05:10:49.872306Z","submitted_at":"2025-09-06T22:29:17Z","title":"Fisher Random Walk: Automatic Debiasing Contextual Preference Inference for Large Language Model Evaluation","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-05T05:11:02.011707Z"},"links":{"citing_paper":"/paper/2509.05852"},"observation_digest":"sha256:254e4f77bd6797db604e476281a7cc77db6beb298100503c16fb53d53d045210","observation_id":"d56ae1a4-f6b6-4ae4-b018-7a8d15596ef1","resolution":{"observed_at":"2026-08-05T05:11:02.791810Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:11:02.781881Z","title":"Hido, and M","venue":null,"work_id":"ca2ffa69-ee0d-4b9b-ac8a-eae23fc13c6e","year":2009},"citing_paper":{"arxiv_id":"2509.05852","last_updated":"2025-09-06T22:29:17Z","snapshot_observed_at":"2026-08-05T05:10:49.872306Z","submitted_at":"2025-09-06T22:29:17Z","title":"Fisher Random Walk: Automatic Debiasing Contextual Preference Inference for Large Language Model Evaluation","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-05T05:11:02.014137Z"},"links":{"citing_paper":"/paper/2509.05852"},"observation_digest":"sha256:a848cf4f833bd0272cf34045939a28e8c9a5021dfc91f60b74e87ff6fa3eb224","observation_id":"5a5f387c-4178-4b30-9347-3576c83119c0","resolution":{"observed_at":"2026-08-05T05:11:02.784362Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:11:02.774989Z","title":"Ohn, and D","venue":null,"work_id":"ba54eb29-616a-43b4-8506-ab1620e237db","year":2021},"citing_paper":{"arxiv_id":"2509.05852","last_updated":"2025-09-06T22:29:17Z","snapshot_observed_at":"2026-08-05T05:10:49.872306Z","submitted_at":"2025-09-06T22:29:17Z","title":"Fisher Random Walk: Automatic Debiasing Contextual Preference Inference for Large Language Model Evaluation","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-05T05:11:02.016527Z"},"links":{"citing_paper":"/paper/2509.05852"},"observation_digest":"sha256:7e19831a8fa2898dfb6f234a66e193a9d4bd28725201fb7199b7d4d7e928ed40","observation_id":"d9f23c53-9195-4fd6-827b-b0d62279af9c","resolution":{"observed_at":"2026-08-05T05:11:02.777258Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:11:02.767948Z","title":null,"venue":null,"work_id":"afab3f77-ae48-46c6-bd67-8de7cd4ca9f2","year":1993},"citing_paper":{"arxiv_id":"2509.05852","last_updated":"2025-09-06T22:29:17Z","snapshot_observed_at":"2026-08-05T05:10:49.872306Z","submitted_at":"2025-09-06T22:29:17Z","title":"Fisher Random Walk: Automatic Debiasing Contextual Preference Inference for Large Language Model Evaluation","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-05T05:11:02.019028Z"},"links":{"citing_paper":"/paper/2509.05852"},"observation_digest":"sha256:ea0773b94de6cfcf58ca37c026c8e20693889fec99975a805f887d9e3eb73e00","observation_id":"8d8853aa-1cf8-4c03-9f6f-a1a8298c3793","resolution":{"observed_at":"2026-08-05T05:11:02.770403Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:11:02.760538Z","title":null,"venue":null,"work_id":"a9922e93-cbe1-4b34-88e0-26886e77b852","year":2021},"citing_paper":{"arxiv_id":"2509.05852","last_updated":"2025-09-06T22:29:17Z","snapshot_observed_at":"2026-08-05T05:10:49.872306Z","submitted_at":"2025-09-06T22:29:17Z","title":"Fisher Random Walk: Automatic Debiasing Contextual Preference Inference for Large Language Model Evaluation","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-05T05:11:02.021376Z"},"links":{"citing_paper":"/paper/2509.05852"},"observation_digest":"sha256:1be69116c7e836d912efc665a9756d7d599c73b59910934238d0a5bf451432a4","observation_id":"a54f0b63-d63b-4d76-9c13-73d7a019d81e","resolution":{"observed_at":"2026-08-05T05:11:02.763368Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:11:02.753526Z","title":null,"venue":null,"work_id":"8ba174a4-ada5-4020-83fb-ec23e8a19983","year":2015},"citing_paper":{"arxiv_id":"2509.05852","last_updated":"2025-09-06T22:29:17Z","snapshot_observed_at":"2026-08-05T05:10:49.872306Z","submitted_at":"2025-09-06T22:29:17Z","title":"Fisher Random Walk: Automatic Debiasing Contextual Preference Inference for Large Language Model Evaluation","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-05T05:11:02.023624Z"},"links":{"citing_paper":"/paper/2509.05852"},"observation_digest":"sha256:e28e75dfe3d6968745076a64ac7de79849cc2d35d6951ae6ade5fe2fbbed663e","observation_id":"2ca4979b-d02f-48f6-bb6d-d1e5885874e4","resolution":{"observed_at":"2026-08-05T05:11:02.755966Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:11:02.746136Z","title":"Zhang, Y","venue":null,"work_id":"76064401-cc31-4305-b963-39aad33bba92","year":2023},"citing_paper":{"arxiv_id":"2509.05852","last_updated":"2025-09-06T22:29:17Z","snapshot_observed_at":"2026-08-05T05:10:49.872306Z","submitted_at":"2025-09-06T22:29:17Z","title":"Fisher Random Walk: Automatic Debiasing Contextual Preference Inference for Large Language Model Evaluation","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-05T05:11:02.025900Z"},"links":{"citing_paper":"/paper/2509.05852"},"observation_digest":"sha256:253d5ae8bd4249b2e77919d3dfefd93415b7bcbd66b3aa8e07c2ccb28f1f57f0","observation_id":"e2f4ba07-4bb9-43e0-a0db-871b7ec8d320","resolution":{"observed_at":"2026-08-05T05:11:02.748668Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:11:02.739092Z","title":null,"venue":null,"work_id":"34e9e0f1-c1c5-459f-a875-d78fae672ef2","year":2023},"citing_paper":{"arxiv_id":"2509.05852","last_updated":"2025-09-06T22:29:17Z","snapshot_observed_at":"2026-08-05T05:10:49.872306Z","submitted_at":"2025-09-06T22:29:17Z","title":"Fisher Random Walk: Automatic Debiasing Contextual Preference Inference for Large Language Model Evaluation","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-05T05:11:02.028750Z"},"links":{"citing_paper":"/paper/2509.05852"},"observation_digest":"sha256:4c03d35a5794057f8e3c65ba94fcdbe4b5e363ef7cb8f6dea69a8da393ef8737","observation_id":"24b56d2a-eb0f-4a41-a503-c49ed5eb7a54","resolution":{"observed_at":"2026-08-05T05:11:02.741635Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:11:02.732333Z","title":null,"venue":null,"work_id":"24fae57d-94f0-414a-888e-0a6affd71437","year":2023},"citing_paper":{"arxiv_id":"2509.05852","last_updated":"2025-09-06T22:29:17Z","snapshot_observed_at":"2026-08-05T05:10:49.872306Z","submitted_at":"2025-09-06T22:29:17Z","title":"Fisher Random Walk: Automatic Debiasing Contextual Preference Inference for Large Language Model Evaluation","version":1},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-05T05:11:02.031074Z"},"links":{"citing_paper":"/paper/2509.05852"},"observation_digest":"sha256:f0b019ca2011ffc5a6a627eecff8a203fcf06806adc0d5feb3aa91be9ffcb086","observation_id":"7e48eba7-ba55-4fe4-aeee-bed651916de3","resolution":{"observed_at":"2026-08-05T05:11:02.734609Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1608.04845","last_updated":"2016-08-17T03:38:37Z","snapshot_observed_at":"2026-08-07T06:44:21.432078Z","submitted_at":"2016-08-17T03:38:37Z","title":"Lecture Notes on Spectral Graph Methods","version":1},"cited_work":{"arxiv_id":"1608.04845","doi":null,"metadata_source":"pith","pith_arxiv_id":"1608.04845","snapshot_observed_at":"2026-08-05T05:11:02.386199Z","title":"Lecture Notes on Spectral Graph Methods","venue":"cs.DS","work_id":"dfefbe4e-2f74-4f6c-98a8-b23b2a8f7273","year":2016},"citing_paper":{"arxiv_id":"2509.05852","last_updated":"2025-09-06T22:29:17Z","snapshot_observed_at":"2026-08-05T05:10:49.872306Z","submitted_at":"2025-09-06T22:29:17Z","title":"Fisher Random Walk: Automatic Debiasing Contextual Preference Inference for Large Language Model Evaluation","version":1},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-05T05:11:02.033419Z"},"links":{"cited_paper":"/paper/1608.04845","citing_paper":"/paper/2509.05852"},"observation_digest":"sha256:48f280d241af41873eb3cc819f5c9def4ba553044ab51d605c34fa95de03f7d4","observation_id":"4482d9cb-5ac3-4857-8d1c-c33190328be6","resolution":{"observed_at":"2026-08-05T05:11:02.389702Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"0907.3740","last_updated":"2009-07-21T20:21:38Z","snapshot_observed_at":"2026-07-31T18:04:21.044437Z","submitted_at":"2009-07-21T20:21:38Z","title":"Empirical Bernstein Bounds and Sample Variance Penalization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"0907.3740","snapshot_observed_at":"2026-08-05T05:11:02.036118Z","title":null,"venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2509.05852","last_updated":"2025-09-06T22:29:17Z","snapshot_observed_at":"2026-08-05T05:10:49.872306Z","submitted_at":"2025-09-06T22:29:17Z","title":"Fisher Random Walk: Automatic Debiasing Contextual Preference Inference for Large Language Model Evaluation","version":1},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-08-05T05:11:02.036118Z"},"links":{"cited_paper":"/paper/0907.3740","citing_paper":"/paper/2509.05852"},"observation_digest":"sha256:1362131618e63ad4ce97cefdaf0612c43f1aaa7b06793ed0034a3c986389a44d","observation_id":"9645a4ca-1ccb-4476-9a02-44893112d1ba","resolution":{"observed_at":"2026-08-05T05:11:02.036118Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:11:02.725031Z","title":null,"venue":null,"work_id":"6d197bf6-17de-44da-8616-f53f8f5ada8a","year":2023},"citing_paper":{"arxiv_id":"2509.05852","last_updated":"2025-09-06T22:29:17Z","snapshot_observed_at":"2026-08-05T05:10:49.872306Z","submitted_at":"2025-09-06T22:29:17Z","title":"Fisher Random Walk: Automatic Debiasing Contextual Preference Inference for Large Language Model Evaluation","version":1},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-08-05T05:11:02.038751Z"},"links":{"citing_paper":"/paper/2509.05852"},"observation_digest":"sha256:2a113b7f9c1bd86c79eb38646aa06a44e51b9224eaa8e6788d1a8b177782b629","observation_id":"8342868f-181f-479c-b6af-904fbfff1120","resolution":{"observed_at":"2026-08-05T05:11:02.727363Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-05T05:11:02.041109Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.05852","last_updated":"2025-09-06T22:29:17Z","snapshot_observed_at":"2026-08-05T05:10:49.872306Z","submitted_at":"2025-09-06T22:29:17Z","title":"Fisher Random Walk: Automatic Debiasing Contextual Preference Inference for Large Language Model Evaluation","version":1},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-08-05T05:11:02.041109Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2509.05852"},"observation_digest":"sha256:7b645c25eeeb55ba1a393aba88035f02a82a7bd9420e04474f156904194771a9","observation_id":"702681ba-2ee7-485a-aef7-cd1852ab9acd","resolution":{"observed_at":"2026-08-05T05:11:02.041109Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:11:02.717437Z","title":null,"venue":null,"work_id":"6c67bc7d-8ccd-4c72-8f61-318b97068c31","year":2022},"citing_paper":{"arxiv_id":"2509.05852","last_updated":"2025-09-06T22:29:17Z","snapshot_observed_at":"2026-08-05T05:10:49.872306Z","submitted_at":"2025-09-06T22:29:17Z","title":"Fisher Random Walk: Automatic Debiasing Contextual Preference Inference for Large Language Model Evaluation","version":1},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-08-05T05:11:02.043665Z"},"links":{"citing_paper":"/paper/2509.05852"},"observation_digest":"sha256:757a1755cc52c318dd882f0d75e7b433c4a62aa21c1d2469dba63425a13ffa36","observation_id":"65256891-79b1-4ff0-811b-021e0bde7bcc","resolution":{"observed_at":"2026-08-05T05:11:02.719857Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:11:02.710321Z","title":"Morales, J","venue":null,"work_id":"8b96e0bf-5295-48c0-be7d-a78e284f2ecf","year":2023},"citing_paper":{"arxiv_id":"2509.05852","last_updated":"2025-09-06T22:29:17Z","snapshot_observed_at":"2026-08-05T05:10:49.872306Z","submitted_at":"2025-09-06T22:29:17Z","title":"Fisher Random Walk: Automatic Debiasing Contextual Preference Inference for Large Language Model Evaluation","version":1},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-08-05T05:11:02.045942Z"},"links":{"citing_paper":"/paper/2509.05852"},"observation_digest":"sha256:d55231293b7260a31595c7ba8d827959d01e103eada1cf1c3041a2483ea2e913","observation_id":"d55db2b1-2eec-4ba2-832d-749ee4bc067b","resolution":{"observed_at":"2026-08-05T05:11:02.712930Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:11:02.703563Z","title":null,"venue":null,"work_id":"325174f2-ed3c-47da-bee7-e073fddc1ab2","year":2019},"citing_paper":{"arxiv_id":"2509.05852","last_updated":"2025-09-06T22:29:17Z","snapshot_observed_at":"2026-08-05T05:10:49.872306Z","submitted_at":"2025-09-06T22:29:17Z","title":"Fisher Random Walk: Automatic Debiasing Contextual Preference Inference for Large Language Model Evaluation","version":1},"reference_index":63,"source":"arxiv_source","source_observed_at":"2026-08-05T05:11:02.048219Z"},"links":{"citing_paper":"/paper/2509.05852"},"observation_digest":"sha256:6de5f0dbbe411de9cebed0cfb7b3342d2e3bd25a1095bd0b30eac851e96890c2","observation_id":"12f1ecde-7f93-4a81-932f-91d416da2c17","resolution":{"observed_at":"2026-08-05T05:11:02.705877Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:11:02.696614Z","title":null,"venue":null,"work_id":"c0e9ddac-f10c-4207-bf6c-658de7d1f61e","year":2000},"citing_paper":{"arxiv_id":"2509.05852","last_updated":"2025-09-06T22:29:17Z","snapshot_observed_at":"2026-08-05T05:10:49.872306Z","submitted_at":"2025-09-06T22:29:17Z","title":"Fisher Random Walk: Automatic Debiasing Contextual Preference Inference for Large Language Model Evaluation","version":1},"reference_index":64,"source":"arxiv_source","source_observed_at":"2026-08-05T05:11:02.050499Z"},"links":{"citing_paper":"/paper/2509.05852"},"observation_digest":"sha256:489b30108327606982bf527339750184a6e9946feeae34a8ec796c2f37a42811","observation_id":"3af60d7c-6d3c-4a9a-bfa5-56c5f94989fb","resolution":{"observed_at":"2026-08-05T05:11:02.698915Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:11:02.689680Z","title":null,"venue":null,"work_id":"170ea02d-ebe8-4ad4-9971-4230aa794e61","year":1995},"citing_paper":{"arxiv_id":"2509.05852","last_updated":"2025-09-06T22:29:17Z","snapshot_observed_at":"2026-08-05T05:10:49.872306Z","submitted_at":"2025-09-06T22:29:17Z","title":"Fisher Random Walk: Automatic Debiasing Contextual Preference Inference for Large Language Model Evaluation","version":1},"reference_index":65,"source":"arxiv_source","source_observed_at":"2026-08-05T05:11:02.053122Z"},"links":{"citing_paper":"/paper/2509.05852"},"observation_digest":"sha256:252fa935f5d56c2c466c2b01d8ded9c361ad7e9deeae3069ee1f58ba104a181c","observation_id":"81ac3cac-9eaf-4421-8b28-a974ed95505e","resolution":{"observed_at":"2026-08-05T05:11:02.691942Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:11:02.682499Z","title":null,"venue":null,"work_id":"0e5a039b-68b7-44ed-99d4-0f0000ab5208","year":2020},"citing_paper":{"arxiv_id":"2509.05852","last_updated":"2025-09-06T22:29:17Z","snapshot_observed_at":"2026-08-05T05:10:49.872306Z","submitted_at":"2025-09-06T22:29:17Z","title":"Fisher Random Walk: Automatic Debiasing Contextual Preference Inference for Large Language Model Evaluation","version":1},"reference_index":66,"source":"arxiv_source","source_observed_at":"2026-08-05T05:11:02.055537Z"},"links":{"citing_paper":"/paper/2509.05852"},"observation_digest":"sha256:0daa9bc75c082ea73e4bfb16d05baab21589c886c4e5811f6e2bd29bdddccb53","observation_id":"0bd90be5-99d6-4007-a704-6d8a15002bf2","resolution":{"observed_at":"2026-08-05T05:11:02.684911Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:11:02.675343Z","title":null,"venue":null,"work_id":"00fa86db-2af4-4285-8ae3-495163b80a63","year":2022},"citing_paper":{"arxiv_id":"2509.05852","last_updated":"2025-09-06T22:29:17Z","snapshot_observed_at":"2026-08-05T05:10:49.872306Z","submitted_at":"2025-09-06T22:29:17Z","title":"Fisher Random Walk: Automatic Debiasing Contextual Preference Inference for Large Language Model Evaluation","version":1},"reference_index":67,"source":"arxiv_source","source_observed_at":"2026-08-05T05:11:02.057979Z"},"links":{"citing_paper":"/paper/2509.05852"},"observation_digest":"sha256:ebb436cb60a04ac123f726f3091ccbeb107873d07a2c782d0d9002964ed14fe9","observation_id":"8f7698c8-46ad-4e3e-ae45-505128d44cb6","resolution":{"observed_at":"2026-08-05T05:11:02.677678Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:11:02.668079Z","title":"and Y.-C","venue":null,"work_id":"e65bc358-e7f0-4efc-b3aa-13f3f28066a0","year":1998},"citing_paper":{"arxiv_id":"2509.05852","last_updated":"2025-09-06T22:29:17Z","snapshot_observed_at":"2026-08-05T05:10:49.872306Z","submitted_at":"2025-09-06T22:29:17Z","title":"Fisher Random Walk: Automatic Debiasing Contextual Preference Inference for Large Language Model Evaluation","version":1},"reference_index":68,"source":"arxiv_source","source_observed_at":"2026-08-05T05:11:02.060469Z"},"links":{"citing_paper":"/paper/2509.05852"},"observation_digest":"sha256:ed24775fbc9a5b61d0d756d81960a9ae3f0f6311b5f386c6da1569f942a5f39f","observation_id":"b0e30af0-a1b0-4150-a91d-59743bbb4e1b","resolution":{"observed_at":"2026-08-05T05:11:02.670557Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:11:02.661086Z","title":"Xu, and A","venue":null,"work_id":"d61d2a38-9fac-4668-913f-bb5d819c2b70","year":2024},"citing_paper":{"arxiv_id":"2509.05852","last_updated":"2025-09-06T22:29:17Z","snapshot_observed_at":"2026-08-05T05:10:49.872306Z","submitted_at":"2025-09-06T22:29:17Z","title":"Fisher Random Walk: Automatic Debiasing Contextual Preference Inference for Large Language Model Evaluation","version":1},"reference_index":69,"source":"arxiv_source","source_observed_at":"2026-08-05T05:11:02.063062Z"},"links":{"citing_paper":"/paper/2509.05852"},"observation_digest":"sha256:54cab49c1e440bbaab16b9be4b4555d33e98accd031d891c8935f0f4388af775","observation_id":"d813ba57-3540-4e62-a93b-e2c827416e6c","resolution":{"observed_at":"2026-08-05T05:11:02.663348Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:11:02.653387Z","title":null,"venue":null,"work_id":"c3efc66b-a47a-4ef1-99ba-b9306502db55","year":2012},"citing_paper":{"arxiv_id":"2509.05852","last_updated":"2025-09-06T22:29:17Z","snapshot_observed_at":"2026-08-05T05:10:49.872306Z","submitted_at":"2025-09-06T22:29:17Z","title":"Fisher Random Walk: Automatic Debiasing Contextual Preference Inference for Large Language Model Evaluation","version":1},"reference_index":70,"source":"arxiv_source","source_observed_at":"2026-08-05T05:11:02.066001Z"},"links":{"citing_paper":"/paper/2509.05852"},"observation_digest":"sha256:1406f97edeaf116ed0277d24ba2543a215e65117e3945eca7a9c2255bc6c4de1","observation_id":"f4007cdf-ffae-4136-bb8d-cb4a51efb93a","resolution":{"observed_at":"2026-08-05T05:11:02.656228Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:11:02.645920Z","title":null,"venue":null,"work_id":"1e00d99d-523e-46c9-abb9-ef414d8f5a14","year":2008},"citing_paper":{"arxiv_id":"2509.05852","last_updated":"2025-09-06T22:29:17Z","snapshot_observed_at":"2026-08-05T05:10:49.872306Z","submitted_at":"2025-09-06T22:29:17Z","title":"Fisher Random Walk: Automatic Debiasing Contextual Preference Inference for Large Language Model Evaluation","version":1},"reference_index":71,"source":"arxiv_source","source_observed_at":"2026-08-05T05:11:02.068338Z"},"links":{"citing_paper":"/paper/2509.05852"},"observation_digest":"sha256:70c5074a77cb083acf9618fbc8f3d5a842c2726ce31303febd77946706a42957","observation_id":"ede28535-2922-4697-9ec1-81fb520230b5","resolution":{"observed_at":"2026-08-05T05:11:02.648317Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:11:02.638789Z","title":"Ouyang, J","venue":null,"work_id":"35c9f201-dbd0-442c-8789-1167d10d0be8","year":2020},"citing_paper":{"arxiv_id":"2509.05852","last_updated":"2025-09-06T22:29:17Z","snapshot_observed_at":"2026-08-05T05:10:49.872306Z","submitted_at":"2025-09-06T22:29:17Z","title":"Fisher Random Walk: Automatic Debiasing Contextual Preference Inference for Large Language Model Evaluation","version":1},"reference_index":72,"source":"arxiv_source","source_observed_at":"2026-08-05T05:11:02.070677Z"},"links":{"citing_paper":"/paper/2509.05852"},"observation_digest":"sha256:9f18a44d88042ecd42de973adb6b4e7e2ba3c1eee3996cbe8a62c424bd5a92fa","observation_id":"f3c88199-0333-4b58-b44b-57c9b7119bbf","resolution":{"observed_at":"2026-08-05T05:11:02.641150Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:11:02.631625Z","title":null,"venue":null,"work_id":"c2c1cf59-4720-436d-b684-072b48989c50","year":2024},"citing_paper":{"arxiv_id":"2509.05852","last_updated":"2025-09-06T22:29:17Z","snapshot_observed_at":"2026-08-05T05:10:49.872306Z","submitted_at":"2025-09-06T22:29:17Z","title":"Fisher Random Walk: Automatic Debiasing Contextual Preference Inference for Large Language Model Evaluation","version":1},"reference_index":73,"source":"arxiv_source","source_observed_at":"2026-08-05T05:11:02.073126Z"},"links":{"citing_paper":"/paper/2509.05852"},"observation_digest":"sha256:c8aca16277f10a2800cebda47c485c1f6d7fbb31b7353a0e91ca8a09ee0067da","observation_id":"868e7e05-db61-4e0f-a3a1-6ce390db5a69","resolution":{"observed_at":"2026-08-05T05:11:02.633932Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09288","last_updated":"2023-07-19T17:08:59Z","snapshot_observed_at":"2026-08-07T12:56:43.323460Z","submitted_at":"2023-07-18T14:31:57Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.09288","snapshot_observed_at":"2026-08-05T05:11:02.075466Z","title":"Martin, K","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.05852","last_updated":"2025-09-06T22:29:17Z","snapshot_observed_at":"2026-08-05T05:10:49.872306Z","submitted_at":"2025-09-06T22:29:17Z","title":"Fisher Random Walk: Automatic Debiasing Contextual Preference Inference for Large Language Model Evaluation","version":1},"reference_index":74,"source":"arxiv_source","source_observed_at":"2026-08-05T05:11:02.075466Z"},"links":{"cited_paper":"/paper/2307.09288","citing_paper":"/paper/2509.05852"},"observation_digest":"sha256:998c9abedd98b39e4c6a52aee76ba49ce127861984da07390d89970358d0476d","observation_id":"738b108d-7924-4bd2-8b21-5cc3c9181aa2","resolution":{"observed_at":"2026-08-05T05:11:02.075466Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:11:02.624421Z","title":null,"venue":null,"work_id":"1b311545-9a5c-4507-a6b6-b7640ae2f7a5","year":2015},"citing_paper":{"arxiv_id":"2509.05852","last_updated":"2025-09-06T22:29:17Z","snapshot_observed_at":"2026-08-05T05:10:49.872306Z","submitted_at":"2025-09-06T22:29:17Z","title":"Fisher Random Walk: Automatic Debiasing Contextual Preference Inference for Large Language Model Evaluation","version":1},"reference_index":75,"source":"arxiv_source","source_observed_at":"2026-08-05T05:11:02.078255Z"},"links":{"citing_paper":"/paper/2509.05852"},"observation_digest":"sha256:594d646b2452cf3caefb0287e0807f7d7b9d791433e6610d4544772d4a24eb4a","observation_id":"a4698b98-5bf7-4692-9448-fb0aa4783a5f","resolution":{"observed_at":"2026-08-05T05:11:02.626807Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:11:02.080779Z","title":"Bibaut, N","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.05852","last_updated":"2025-09-06T22:29:17Z","snapshot_observed_at":"2026-08-05T05:10:49.872306Z","submitted_at":"2025-09-06T22:29:17Z","title":"Fisher Random Walk: Automatic Debiasing Contextual Preference Inference for Large Language Model Evaluation","version":1},"reference_index":76,"source":"arxiv_source","source_observed_at":"2026-08-05T05:11:02.080779Z"},"links":{"citing_paper":"/paper/2509.05852"},"observation_digest":"sha256:01aee8a2721513ae4abff0b01a866c7ddf450b330198a4767e137e16fb958d8b","observation_id":"ca5faf71-d5ac-40a8-ad29-cfdd08bf5b4d","resolution":{"observed_at":"2026-08-05T05:11:02.080779Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:11:02.616739Z","title":null,"venue":null,"work_id":"a6c132f5-f18b-409a-87d0-1dbf103b0f68","year":1996},"citing_paper":{"arxiv_id":"2509.05852","last_updated":"2025-09-06T22:29:17Z","snapshot_observed_at":"2026-08-05T05:10:49.872306Z","submitted_at":"2025-09-06T22:29:17Z","title":"Fisher Random Walk: Automatic Debiasing Contextual Preference Inference for Large Language Model Evaluation","version":1},"reference_index":77,"source":"arxiv_source","source_observed_at":"2026-08-05T05:11:02.083184Z"},"links":{"citing_paper":"/paper/2509.05852"},"observation_digest":"sha256:27552ddc303b40bb304a47ea9bfdae77564ac0eb703f0e4ff00054a40a98848a","observation_id":"56d8f9da-9300-4c8b-a255-1d23b993c8ee","resolution":{"observed_at":"2026-08-05T05:11:02.619658Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:11:02.085592Z","title":null,"venue":null,"work_id":null,"year":2000},"citing_paper":{"arxiv_id":"2509.05852","last_updated":"2025-09-06T22:29:17Z","snapshot_observed_at":"2026-08-05T05:10:49.872306Z","submitted_at":"2025-09-06T22:29:17Z","title":"Fisher Random Walk: Automatic Debiasing Contextual Preference Inference for Large Language Model Evaluation","version":1},"reference_index":78,"source":"arxiv_source","source_observed_at":"2026-08-05T05:11:02.085592Z"},"links":{"citing_paper":"/paper/2509.05852"},"observation_digest":"sha256:58ba6b347fbb5ca29a865ac746d87047c19f548b7cf8b4a919cef4b6e35914e9","observation_id":"c91fb128-c9dc-48e5-9a09-27f937861790","resolution":{"observed_at":"2026-08-05T05:11:02.085592Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:11:02.604041Z","title":null,"venue":null,"work_id":"c2cac6c0-fa32-4d9e-b0be-7030006a3061","year":2018},"citing_paper":{"arxiv_id":"2509.05852","last_updated":"2025-09-06T22:29:17Z","snapshot_observed_at":"2026-08-05T05:10:49.872306Z","submitted_at":"2025-09-06T22:29:17Z","title":"Fisher Random Walk: Automatic Debiasing Contextual Preference Inference for Large Language Model Evaluation","version":1},"reference_index":79,"source":"arxiv_source","source_observed_at":"2026-08-05T05:11:02.088181Z"},"links":{"citing_paper":"/paper/2509.05852"},"observation_digest":"sha256:2d32e03075e54e74181804e03bbad05aff41a2b2599a693c70311a5db4969371","observation_id":"fcfb42a7-1912-4931-9090-cb3ea487d1ef","resolution":{"observed_at":"2026-08-05T05:11:02.606559Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:11:02.596902Z","title":"He, and G","venue":null,"work_id":"b639b2e1-d645-4b86-b62d-56ba8abafdca","year":2020},"citing_paper":{"arxiv_id":"2509.05852","last_updated":"2025-09-06T22:29:17Z","snapshot_observed_at":"2026-08-05T05:10:49.872306Z","submitted_at":"2025-09-06T22:29:17Z","title":"Fisher Random Walk: Automatic Debiasing Contextual Preference Inference for Large Language Model Evaluation","version":1},"reference_index":80,"source":"arxiv_source","source_observed_at":"2026-08-05T05:11:02.090520Z"},"links":{"citing_paper":"/paper/2509.05852"},"observation_digest":"sha256:83c24cc68b9f8137fe0ed1fc594151501eb7db08f0edf403e47c501a606fda60","observation_id":"4b361c1e-d1ab-4b53-b0d0-4b4e92bc043e","resolution":{"observed_at":"2026-08-05T05:11:02.599394Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.12095","last_updated":"2023-08-29T05:34:25Z","snapshot_observed_at":"2026-08-05T13:57:45.408890Z","submitted_at":"2023-02-22T11:01:20Z","title":"On the Robustness of ChatGPT: An Adversarial and Out-of-distribution Perspective","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.12095","snapshot_observed_at":"2026-08-05T05:11:02.093125Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.05852","last_updated":"2025-09-06T22:29:17Z","snapshot_observed_at":"2026-08-05T05:10:49.872306Z","submitted_at":"2025-09-06T22:29:17Z","title":"Fisher Random Walk: Automatic Debiasing Contextual Preference Inference for Large Language Model Evaluation","version":1},"reference_index":81,"source":"arxiv_source","source_observed_at":"2026-08-05T05:11:02.093125Z"},"links":{"cited_paper":"/paper/2302.12095","citing_paper":"/paper/2509.05852"},"observation_digest":"sha256:88578f8ebf950da48efaaa8c601dab501f18616d65e9db319293eaebb0b88f6b","observation_id":"4f8ad8d9-7541-4fa5-9e39-919328917885","resolution":{"observed_at":"2026-08-05T05:11:02.093125Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.05506","last_updated":"2025-02-10T15:26:28Z","snapshot_observed_at":"2026-07-06T20:03:11.541819Z","submitted_at":"2024-12-07T02:34:30Z","title":"Confidence Diagram of Nonparametric Ranking for Uncertainty Assessment in Large Language Models Evaluation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.05506","snapshot_observed_at":"2026-08-05T05:11:02.095762Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.05852","last_updated":"2025-09-06T22:29:17Z","snapshot_observed_at":"2026-08-05T05:10:49.872306Z","submitted_at":"2025-09-06T22:29:17Z","title":"Fisher Random Walk: Automatic Debiasing Contextual Preference Inference for Large Language Model Evaluation","version":1},"reference_index":82,"source":"arxiv_source","source_observed_at":"2026-08-05T05:11:02.095762Z"},"links":{"cited_paper":"/paper/2412.05506","citing_paper":"/paper/2509.05852"},"observation_digest":"sha256:f844a794cde80c5dbd0ecd310b023ce856bb6a370db43108e7ea574cb3d44256","observation_id":"bd6fda09-d220-49a2-9312-6c89d9d6d9c3","resolution":{"observed_at":"2026-08-05T05:11:02.095762Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:11:02.589877Z","title":null,"venue":null,"work_id":"2d888a8f-f977-472b-ad6e-31d52b927c83","year":1973},"citing_paper":{"arxiv_id":"2509.05852","last_updated":"2025-09-06T22:29:17Z","snapshot_observed_at":"2026-08-05T05:10:49.872306Z","submitted_at":"2025-09-06T22:29:17Z","title":"Fisher Random Walk: Automatic Debiasing Contextual Preference Inference for Large Language Model Evaluation","version":1},"reference_index":83,"source":"arxiv_source","source_observed_at":"2026-08-05T05:11:02.098615Z"},"links":{"citing_paper":"/paper/2509.05852"},"observation_digest":"sha256:b0f67cfd2cea49fefc4029d45242e031d0c2ef7febc4fb9f5e19931c33789261","observation_id":"b9060034-b213-4637-901f-5da8da283c68","resolution":{"observed_at":"2026-08-05T05:11:02.592222Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:11:02.582441Z","title":"Suzuki, T","venue":null,"work_id":"5e293c52-bc70-4e3c-9396-6bd1130a2c40","year":2013},"citing_paper":{"arxiv_id":"2509.05852","last_updated":"2025-09-06T22:29:17Z","snapshot_observed_at":"2026-08-05T05:10:49.872306Z","submitted_at":"2025-09-06T22:29:17Z","title":"Fisher Random Walk: Automatic Debiasing Contextual Preference Inference for Large Language Model Evaluation","version":1},"reference_index":84,"source":"arxiv_source","source_observed_at":"2026-08-05T05:11:02.100940Z"},"links":{"citing_paper":"/paper/2509.05852"},"observation_digest":"sha256:ad934bae374c3a001109cdf7d71067c15089f9410f2c8aba42f62f249cacbb6c","observation_id":"68fcd20c-382d-42e5-a134-7e88d9859696","resolution":{"observed_at":"2026-08-05T05:11:02.584918Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.00228","last_updated":"2025-02-14T04:00:08Z","snapshot_observed_at":"2026-08-04T05:25:18.832194Z","submitted_at":"2023-04-01T05:04:06Z","title":"Accuracy and Political Bias of News Source Credibility Ratings by Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.00228","snapshot_observed_at":"2026-08-05T05:11:02.103514Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.05852","last_updated":"2025-09-06T22:29:17Z","snapshot_observed_at":"2026-08-05T05:10:49.872306Z","submitted_at":"2025-09-06T22:29:17Z","title":"Fisher Random Walk: Automatic Debiasing Contextual Preference Inference for Large Language Model Evaluation","version":1},"reference_index":85,"source":"arxiv_source","source_observed_at":"2026-08-05T05:11:02.103514Z"},"links":{"cited_paper":"/paper/2304.00228","citing_paper":"/paper/2509.05852"},"observation_digest":"sha256:eb6f5126c418cc34bd162cec3a82538977b1ba5c5ae278acc5e48deb4f2facba","observation_id":"c0356d62-4410-4fc4-b46c-5016a22cf186","resolution":{"observed_at":"2026-08-05T05:11:02.103514Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:11:02.574852Z","title":null,"venue":null,"work_id":"3a244176-4998-4439-a2d7-1d6dd7d8f33a","year":2013},"citing_paper":{"arxiv_id":"2509.05852","last_updated":"2025-09-06T22:29:17Z","snapshot_observed_at":"2026-08-05T05:10:49.872306Z","submitted_at":"2025-09-06T22:29:17Z","title":"Fisher Random Walk: Automatic Debiasing Contextual Preference Inference for Large Language Model Evaluation","version":1},"reference_index":86,"source":"arxiv_source","source_observed_at":"2026-08-05T05:11:02.106119Z"},"links":{"citing_paper":"/paper/2509.05852"},"observation_digest":"sha256:c86ef7a0a8769c6b115d7af14f0585702180353a1c007379e1c57340e393eedd","observation_id":"ea54b1c6-6b90-44c5-bc63-3125cc0f5b79","resolution":{"observed_at":"2026-08-05T05:11:02.577117Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:11:02.567637Z","title":null,"venue":null,"work_id":"d349a2df-1abd-4544-8738-6befb19bc5ef","year":2024},"citing_paper":{"arxiv_id":"2509.05852","last_updated":"2025-09-06T22:29:17Z","snapshot_observed_at":"2026-08-05T05:10:49.872306Z","submitted_at":"2025-09-06T22:29:17Z","title":"Fisher Random Walk: Automatic Debiasing Contextual Preference Inference for Large Language Model Evaluation","version":1},"reference_index":87,"source":"arxiv_source","source_observed_at":"2026-08-05T05:11:02.108561Z"},"links":{"citing_paper":"/paper/2509.05852"},"observation_digest":"sha256:ea4ee45c27ac2f4257d0ad87a9e52d8d677b06dc17c878baface07eac62cd2e3","observation_id":"934c2fde-59df-4a67-9502-d21baa4b64b6","resolution":{"observed_at":"2026-08-05T05:11:02.569983Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:11:02.559958Z","title":"Chiang, Y","venue":null,"work_id":"24b65611-1c92-4a40-b495-e3b50b103d56","year":2024},"citing_paper":{"arxiv_id":"2509.05852","last_updated":"2025-09-06T22:29:17Z","snapshot_observed_at":"2026-08-05T05:10:49.872306Z","submitted_at":"2025-09-06T22:29:17Z","title":"Fisher Random Walk: Automatic Debiasing Contextual Preference Inference for Large Language Model Evaluation","version":1},"reference_index":88,"source":"arxiv_source","source_observed_at":"2026-08-05T05:11:02.110993Z"},"links":{"citing_paper":"/paper/2509.05852"},"observation_digest":"sha256:15ce533ca215fc8d8c5f08c536f3fe32fef4c4d991d2f5387d2845c8c7287d27","observation_id":"5b56ac70-5145-46b3-9b38-aed1ea760977","resolution":{"observed_at":"2026-08-05T05:11:02.562588Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:11:02.552321Z","title":null,"venue":null,"work_id":"a88ff516-d233-4946-ac2c-375e06fd2dce","year":2024},"citing_paper":{"arxiv_id":"2509.05852","last_updated":"2025-09-06T22:29:17Z","snapshot_observed_at":"2026-08-05T05:10:49.872306Z","submitted_at":"2025-09-06T22:29:17Z","title":"Fisher Random Walk: Automatic Debiasing Contextual Preference Inference for Large Language Model Evaluation","version":1},"reference_index":89,"source":"arxiv_source","source_observed_at":"2026-08-05T05:11:02.113436Z"},"links":{"citing_paper":"/paper/2509.05852"},"observation_digest":"sha256:a5f3b9e90d41a4fd58920c07875a53ac6147458eeb024edc244cd9fcb318602e","observation_id":"ca980f21-9c1a-4841-bcd3-314d0a8bc2d8","resolution":{"observed_at":"2026-08-05T05:11:02.554701Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2301.12868","last_updated":"2023-03-09T11:01:02Z","snapshot_observed_at":"2026-07-06T14:46:02.951905Z","submitted_at":"2023-01-30T13:21:00Z","title":"On Robustness of Prompt-based Semantic Parsing with Large Pre-trained Language Model: An Empirical Study on Codex","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.12868","snapshot_observed_at":"2026-08-05T05:11:02.115951Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.05852","last_updated":"2025-09-06T22:29:17Z","snapshot_observed_at":"2026-08-05T05:10:49.872306Z","submitted_at":"2025-09-06T22:29:17Z","title":"Fisher Random Walk: Automatic Debiasing Contextual Preference Inference for Large Language Model Evaluation","version":1},"reference_index":90,"source":"arxiv_source","source_observed_at":"2026-08-05T05:11:02.115951Z"},"links":{"cited_paper":"/paper/2301.12868","citing_paper":"/paper/2509.05852"},"observation_digest":"sha256:e0d9adba7075f2004172fcfa012682fc186111269992b9c54a7b2e7d946fec54","observation_id":"9c5aec12-bc3e-4e92-a07f-bdb3b4ace84b","resolution":{"observed_at":"2026-08-05T05:11:02.115951Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:11:02.545020Z","title":null,"venue":null,"work_id":"2da958ff-6af0-4cf3-b8f7-6fa7b1968bde","year":2015},"citing_paper":{"arxiv_id":"2509.05852","last_updated":"2025-09-06T22:29:17Z","snapshot_observed_at":"2026-08-05T05:10:49.872306Z","submitted_at":"2025-09-06T22:29:17Z","title":"Fisher Random Walk: Automatic Debiasing Contextual Preference Inference for Large Language Model Evaluation","version":1},"reference_index":91,"source":"arxiv_source","source_observed_at":"2026-08-05T05:11:02.118644Z"},"links":{"citing_paper":"/paper/2509.05852"},"observation_digest":"sha256:cb826cfcda20245a86950fa95936828b9e01463ccb6d300460e9613e671e0c71","observation_id":"24ff086f-cedb-4505-aa36-f0a404806e68","resolution":{"observed_at":"2026-08-05T05:11:02.547464Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:11:02.120959Z","title":"@esa (Ref","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.05852","last_updated":"2025-09-06T22:29:17Z","snapshot_observed_at":"2026-08-05T05:10:49.872306Z","submitted_at":"2025-09-06T22:29:17Z","title":"Fisher Random Walk: Automatic Debiasing Contextual Preference Inference for Large Language Model Evaluation","version":1},"reference_index":92,"source":"arxiv_source","source_observed_at":"2026-08-05T05:11:02.120959Z"},"links":{"citing_paper":"/paper/2509.05852"},"observation_digest":"sha256:3c05b6b745c5501e076ca0c63042e09df21a68455395249e16fabbb9c7aa5a41","observation_id":"b22cebae-e25f-46a0-939b-df96b52d4dbd","resolution":{"observed_at":"2026-08-05T05:11:02.120959Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:11:02.123955Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.05852","last_updated":"2025-09-06T22:29:17Z","snapshot_observed_at":"2026-08-05T05:10:49.872306Z","submitted_at":"2025-09-06T22:29:17Z","title":"Fisher Random Walk: Automatic Debiasing Contextual Preference Inference for Large Language Model Evaluation","version":1},"reference_index":93,"source":"arxiv_source","source_observed_at":"2026-08-05T05:11:02.123955Z"},"links":{"citing_paper":"/paper/2509.05852"},"observation_digest":"sha256:4484a03c2e0048aa2b530fe6a34bf207b4794d65baf34a9b289e79c30a77a547","observation_id":"3330265b-f4cd-4f03-bcdb-1adebc15c723","resolution":{"observed_at":"2026-08-05T05:11:02.123955Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"plot/0000775","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:11:02.255060Z","title":"Q. @@ O B' ` n nC_hWZs @!Ns > ^ Jy","venue":null,"work_id":"a96dca63-0369-49bc-8b46-9068aaa9fac3","year":1999},"citing_paper":{"arxiv_id":"2509.05852","last_updated":"2025-09-06T22:29:17Z","snapshot_observed_at":"2026-08-05T05:10:49.872306Z","submitted_at":"2025-09-06T22:29:17Z","title":"Fisher Random Walk: Automatic Debiasing Contextual Preference Inference for Large Language Model Evaluation","version":1},"reference_index":94,"source":"arxiv_source","source_observed_at":"2026-08-05T05:11:02.126578Z"},"links":{"citing_paper":"/paper/2509.05852"},"observation_digest":"sha256:80fbcf3c70b0df71b2c33f1d6401ccdd92887fd58287fd9415b7be0d9f28df4d","observation_id":"30765249-1cf3-4838-8e3c-1aa3ac585cca","resolution":{"observed_at":"2026-08-05T05:11:02.260310Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2509.05852","last_updated":"2025-09-06T22:29:17Z","latest_version":1,"primary_category":"stat.ML","snapshot_observed_at":"2026-08-05T05:10:49.872306Z","submitted_at":"2025-09-06T22:29:17Z","title":"Fisher Random Walk: Automatic Debiasing Contextual Preference Inference for Large Language Model Evaluation"},"reference_resolution":{"displayed":94,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":72,"verified_exact":3,"verified_fuzzy":19},"total_outbound_references":94},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 94 of 94 outbound references and 1 inbound Pith citation observation for arXiv:2509.05852."}