{"as_of":"2026-08-08T11:04:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:ee1fc0cc199ba7346b181f1f32f9a78fe660b0d53814fea6f68def815ed66e5d","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":14,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":14,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":14,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":14,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T11:10:45.605360Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-23T17:35:43.819146Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2407.06551","last_updated":"2024-10-07T08:49:49Z","snapshot_observed_at":"2026-08-06T11:46:01.178597Z","submitted_at":"2024-07-09T05:16:22Z","title":"OffsetBias: Leveraging Debiased Data for Tuning Evaluators","version":2},"cited_work":{"arxiv_id":"2407.06551","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2407.06551","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Offsetbias: Leveraging debiased data for tuning evaluators","venue":null,"work_id":"20b54028-d2d7-4967-b675-fe17f61ae06a","year":2024},"citing_paper":{"arxiv_id":"2410.18451","last_updated":"2024-10-24T06:06:26Z","snapshot_observed_at":"2026-08-07T05:53:12.643515Z","submitted_at":"2024-10-24T06:06:26Z","title":"Skywork-Reward: Bag of Tricks for Reward Modeling in LLMs","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-17T16:18:01.560780Z"},"links":{"cited_paper":"/paper/2407.06551","citing_paper":"/paper/2410.18451"},"observation_digest":"sha256:c6d86918053afa51b03df844d0ce24e3e21f91887b63ae8530402e64b666c22f","observation_id":"b8114625-c371-4b9f-ba32-9776f8bf6193","resolution":{"observed_at":"2026-05-17T16:18:01.653875Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.06551","last_updated":"2024-10-07T08:49:49Z","snapshot_observed_at":"2026-08-06T11:46:01.178597Z","submitted_at":"2024-07-09T05:16:22Z","title":"OffsetBias: Leveraging Debiased Data for Tuning Evaluators","version":2},"cited_work":{"arxiv_id":"2407.06551","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2407.06551","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Offsetbias: Leveraging debiased data for tuning evaluators","venue":null,"work_id":"20b54028-d2d7-4967-b675-fe17f61ae06a","year":2024},"citing_paper":{"arxiv_id":"2411.15594","last_updated":"2025-10-19T10:32:43Z","snapshot_observed_at":"2026-08-02T10:23:50.881300Z","submitted_at":"2024-11-23T16:03:35Z","title":"A Survey on LLM-as-a-Judge","version":6},"reference_index":113,"source":"pdf_text","source_observed_at":"2026-05-23T17:33:13.394338Z"},"links":{"cited_paper":"/paper/2407.06551","citing_paper":"/paper/2411.15594"},"observation_digest":"sha256:7ce052f85789cb2b1bf6a942477e15f26b223e4f44ad2fab379ff51add279a13","observation_id":"6e23e892-f64e-402d-9d1a-76d508738a51","resolution":{"observed_at":"2026-05-23T17:35:43.821753Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.06551","last_updated":"2024-10-07T08:49:49Z","snapshot_observed_at":"2026-08-06T11:46:01.178597Z","submitted_at":"2024-07-09T05:16:22Z","title":"OffsetBias: Leveraging Debiased Data for Tuning Evaluators","version":2},"cited_work":{"arxiv_id":"2407.06551","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2407.06551","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Offsetbias: Leveraging debiased data for tuning evaluators","venue":null,"work_id":"20b54028-d2d7-4967-b675-fe17f61ae06a","year":2024},"citing_paper":{"arxiv_id":"2412.05579","last_updated":"2024-12-10T05:49:12Z","snapshot_observed_at":"2026-07-31T01:42:39.468673Z","submitted_at":"2024-12-07T08:07:24Z","title":"LLMs-as-Judges: A Comprehensive Survey on LLM-based Evaluation Methods","version":2},"reference_index":179,"source":"pdf_text","source_observed_at":"2026-05-11T23:08:34.312466Z"},"links":{"cited_paper":"/paper/2407.06551","citing_paper":"/paper/2412.05579"},"observation_digest":"sha256:dd28095c80316a36012d6f74738b89fdbb253ed88e949e5fc116a59f340cecb5","observation_id":"d10d3d48-12cd-4bb2-a8f7-0f6ab458808a","resolution":{"observed_at":"2026-05-11T23:11:13.149064Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.06551","last_updated":"2024-10-07T08:49:49Z","snapshot_observed_at":"2026-08-06T11:46:01.178597Z","submitted_at":"2024-07-09T05:16:22Z","title":"OffsetBias: Leveraging Debiased Data for Tuning Evaluators","version":2},"cited_work":{"arxiv_id":"2407.06551","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2407.06551","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Offsetbias: Leveraging debiased data for tuning evaluators","venue":null,"work_id":"20b54028-d2d7-4967-b675-fe17f61ae06a","year":2024},"citing_paper":{"arxiv_id":"2506.01937","last_updated":"2026-04-23T14:42:19Z","snapshot_observed_at":"2026-07-06T21:35:12.872021Z","submitted_at":"2025-06-02T17:54:04Z","title":"RewardBench 2: Advancing Reward Model Evaluation","version":2},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-05-19T11:18:03.965711Z"},"links":{"cited_paper":"/paper/2407.06551","citing_paper":"/paper/2506.01937"},"observation_digest":"sha256:45285fb233fb235d62daa0c9757b88209348e554fefb0185859491e1f51fa430","observation_id":"07db7b63-fc3d-4db5-8548-104e0b6028c1","resolution":{"observed_at":"2026-05-19T11:22:16.601136Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.06551","last_updated":"2024-10-07T08:49:49Z","snapshot_observed_at":"2026-08-06T11:46:01.178597Z","submitted_at":"2024-07-09T05:16:22Z","title":"OffsetBias: Leveraging Debiased Data for Tuning Evaluators","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.06551","snapshot_observed_at":"2026-08-07T11:10:45.605360Z","title":"Offsetbias: Leveraging debiased data for tuning evaluators.arXiv preprint arXiv:2407.06551, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.03332","last_updated":"2025-06-03T19:26:23Z","snapshot_observed_at":"2026-08-07T11:03:26.433661Z","submitted_at":"2025-06-03T19:26:23Z","title":"Helpful Agent Meets Deceptive Judge: Understanding Vulnerabilities in Agentic Workflows","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T11:10:45.605360Z"},"links":{"cited_paper":"/paper/2407.06551","citing_paper":"/paper/2506.03332"},"observation_digest":"sha256:7b89beff9162a469441aa83f03c6f0398c63cfa3d1f3ece2dace5d9b26552ba1","observation_id":"56114032-d189-4cae-8ef5-06c0cdd39060","resolution":{"observed_at":"2026-08-07T11:10:45.605360Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.06551","last_updated":"2024-10-07T08:49:49Z","snapshot_observed_at":"2026-08-06T11:46:01.178597Z","submitted_at":"2024-07-09T05:16:22Z","title":"OffsetBias: Leveraging Debiased Data for Tuning Evaluators","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.06551","snapshot_observed_at":"2026-08-07T11:04:06.819184Z","title":"Offsetbias: Leveraging debiased data for tuning evaluators,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.03637","last_updated":"2025-07-07T09:53:22Z","snapshot_observed_at":"2026-08-08T03:23:19.289933Z","submitted_at":"2025-06-04T07:30:16Z","title":"RewardAnything: Generalizable Principle-Following Reward Models","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T11:04:06.819184Z"},"links":{"cited_paper":"/paper/2407.06551","citing_paper":"/paper/2506.03637"},"observation_digest":"sha256:4239a10f1ed7e2b3c598a9b9880a000a64ef740e4550fb1ac12405442d49a27b","observation_id":"a27bbd21-8242-4092-b6a8-dd026c14e7e7","resolution":{"observed_at":"2026-08-07T11:04:06.819184Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.06551","last_updated":"2024-10-07T08:49:49Z","snapshot_observed_at":"2026-08-06T11:46:01.178597Z","submitted_at":"2024-07-09T05:16:22Z","title":"OffsetBias: Leveraging Debiased Data for Tuning Evaluators","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.06551","snapshot_observed_at":"2026-08-07T10:17:47.252751Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.10019","last_updated":"2025-06-06T11:09:46Z","snapshot_observed_at":"2026-08-07T20:45:05.929732Z","submitted_at":"2025-06-06T11:09:46Z","title":"A Survey of Automatic Evaluation Methods on Text, Visual and Speech Generations","version":1},"reference_index":287,"source":"pdf_text","source_observed_at":"2026-08-07T10:17:47.252751Z"},"links":{"cited_paper":"/paper/2407.06551","citing_paper":"/paper/2506.10019"},"observation_digest":"sha256:7bba5b8f40f93078b779b568932cef5f26cff5b3b9a1595e62d149625de2fff4","observation_id":"a6e2eded-492c-4857-b642-92f634971cc9","resolution":{"observed_at":"2026-08-07T10:17:47.252751Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.06551","last_updated":"2024-10-07T08:49:49Z","snapshot_observed_at":"2026-08-06T11:46:01.178597Z","submitted_at":"2024-07-09T05:16:22Z","title":"OffsetBias: Leveraging Debiased Data for Tuning Evaluators","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.06551","snapshot_observed_at":"2026-08-07T00:31:36.029108Z","title":"InProceedings of the 40th Annual Meeting of the Association for Compu- tational Linguistics, pages 311–318, Philadelphia, Pennsylvania, USA","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.13639","last_updated":"2025-06-16T16:04:43Z","snapshot_observed_at":"2026-08-07T00:26:19.217552Z","submitted_at":"2025-06-16T16:04:43Z","title":"An Empirical Study of LLM-as-a-Judge: How Design Choices Impact Evaluation Reliability","version":1},"reference_index":2002,"source":"pdf_text","source_observed_at":"2026-08-07T00:31:36.029108Z"},"links":{"cited_paper":"/paper/2407.06551","citing_paper":"/paper/2506.13639"},"observation_digest":"sha256:a248af558b4e5d3f308a6d20c9134c845d46c3cab2e67535a9bb4221e181a931","observation_id":"c125dec4-740c-4de0-b143-a7f6f052dd4f","resolution":{"observed_at":"2026-08-07T00:31:36.029108Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.06551","last_updated":"2024-10-07T08:49:49Z","snapshot_observed_at":"2026-08-06T11:46:01.178597Z","submitted_at":"2024-07-09T05:16:22Z","title":"OffsetBias: Leveraging Debiased Data for Tuning Evaluators","version":2},"cited_work":{"arxiv_id":"2407.06551","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2407.06551","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Offsetbias: Leveraging debiased data for tuning evaluators","venue":null,"work_id":"20b54028-d2d7-4967-b675-fe17f61ae06a","year":2024},"citing_paper":{"arxiv_id":"2507.06419","last_updated":"2026-06-04T20:44:16Z","snapshot_observed_at":"2026-08-06T19:02:44.982053Z","submitted_at":"2025-07-08T21:56:33Z","title":"Teach a Reward Model to Correct Itself: Reward Guided Adversarial Failure Discovery for Robust Reward Modeling","version":2},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-05-19T05:16:22.274580Z"},"links":{"cited_paper":"/paper/2407.06551","citing_paper":"/paper/2507.06419"},"observation_digest":"sha256:9629f0991022b52134e37df883e94b7fb44f2f4ff35baa0294fb7842c4b41204","observation_id":"0a394f64-376d-46e7-b9ed-4fdaf1a71a9c","resolution":{"observed_at":"2026-05-19T05:17:05.937026Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.06551","last_updated":"2024-10-07T08:49:49Z","snapshot_observed_at":"2026-08-06T11:46:01.178597Z","submitted_at":"2024-07-09T05:16:22Z","title":"OffsetBias: Leveraging Debiased Data for Tuning Evaluators","version":2},"cited_work":{"arxiv_id":"2407.06551","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2407.06551","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Offsetbias: Leveraging debiased data for tuning evaluators","venue":null,"work_id":"20b54028-d2d7-4967-b675-fe17f61ae06a","year":2024},"citing_paper":{"arxiv_id":"2509.23542","last_updated":"2026-04-19T04:59:30Z","snapshot_observed_at":"2026-08-03T18:10:00.237919Z","submitted_at":"2025-09-28T00:43:52Z","title":"On the Shelf Life of Fine-Tuned LLM-Judges: Future-Proofing, Backward-Compatibility, and Question Generalization","version":2},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-05-18T12:53:45.767341Z"},"links":{"cited_paper":"/paper/2407.06551","citing_paper":"/paper/2509.23542"},"observation_digest":"sha256:53e2ee7d3f13dc399e4b371033941320c6e13c4bae74527a9ade5081892ece55","observation_id":"0448b508-fee8-48e2-aa94-56507906638f","resolution":{"observed_at":"2026-05-18T12:56:24.550549Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.06551","last_updated":"2024-10-07T08:49:49Z","snapshot_observed_at":"2026-08-06T11:46:01.178597Z","submitted_at":"2024-07-09T05:16:22Z","title":"OffsetBias: Leveraging Debiased Data for Tuning Evaluators","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.06551","snapshot_observed_at":"2026-08-03T03:04:44.046679Z","title":"Offsetbias: Leveraging debiased data for tuning evaluators.arXiv preprint arXiv:2407.06551, 2024a","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.09305","last_updated":"2026-06-28T18:13:37Z","snapshot_observed_at":"2026-08-03T07:10:48.024369Z","submitted_at":"2026-02-10T00:45:24Z","title":"Reward Modeling for Reinforcement Learning-Based LLM Reasoning: Design, Challenges, and Evaluation","version":2},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-03T03:04:44.046679Z"},"links":{"cited_paper":"/paper/2407.06551","citing_paper":"/paper/2602.09305"},"observation_digest":"sha256:c864bd8b3ebf5e73c476a6742329a3986abde30d4586034c17d7466708c3b54e","observation_id":"5ef0d219-294c-4580-92d3-33a2f1d989a2","resolution":{"observed_at":"2026-08-03T03:04:44.046679Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.06551","last_updated":"2024-10-07T08:49:49Z","snapshot_observed_at":"2026-08-06T11:46:01.178597Z","submitted_at":"2024-07-09T05:16:22Z","title":"OffsetBias: Leveraging Debiased Data for Tuning Evaluators","version":2},"cited_work":{"arxiv_id":"2407.06551","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2407.06551","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Offsetbias: Leveraging debiased data for tuning evaluators","venue":null,"work_id":"20b54028-d2d7-4967-b675-fe17f61ae06a","year":2024},"citing_paper":{"arxiv_id":"2604.03264","last_updated":"2026-03-12T21:28:10Z","snapshot_observed_at":"2026-07-06T22:52:29.705312Z","submitted_at":"2026-03-12T21:28:10Z","title":"SafeScreen: A Safety-First Screening Framework for Personalized Video Retrieval for Vulnerable Users","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-15T11:23:43.022505Z"},"links":{"cited_paper":"/paper/2407.06551","citing_paper":"/paper/2604.03264"},"observation_digest":"sha256:28f5b8ac28412e17fb16b276427aedb8ebe859f82c0ec0d3addece64c95468a9","observation_id":"d2012570-b487-402f-af39-a05be86e5a6b","resolution":{"observed_at":"2026-05-15T11:25:30.934598Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.06551","last_updated":"2024-10-07T08:49:49Z","snapshot_observed_at":"2026-08-06T11:46:01.178597Z","submitted_at":"2024-07-09T05:16:22Z","title":"OffsetBias: Leveraging Debiased Data for Tuning Evaluators","version":2},"cited_work":{"arxiv_id":"2407.06551","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2407.06551","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Offsetbias: Leveraging debiased data for tuning evaluators","venue":null,"work_id":"20b54028-d2d7-4967-b675-fe17f61ae06a","year":2024},"citing_paper":{"arxiv_id":"2604.23178","last_updated":"2026-06-24T13:27:28Z","snapshot_observed_at":"2026-08-05T10:28:56.284877Z","submitted_at":"2026-04-25T07:18:30Z","title":"Judging the Judges: A Systematic Evaluation of Bias Mitigation Strategies in LLM-as-a-Judge Pipelines","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-08T08:14:18.535385Z"},"links":{"cited_paper":"/paper/2407.06551","citing_paper":"/paper/2604.23178"},"observation_digest":"sha256:f684764b4088eab3600ad518e842948a52c777a321fc1032aa74ab3b877ec03a","observation_id":"f60d5783-df58-4dea-be63-361f7b5252de","resolution":{"observed_at":"2026-05-11T20:41:14.032476Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.06551","last_updated":"2024-10-07T08:49:49Z","snapshot_observed_at":"2026-08-06T11:46:01.178597Z","submitted_at":"2024-07-09T05:16:22Z","title":"OffsetBias: Leveraging Debiased Data for Tuning Evaluators","version":2},"cited_work":{"arxiv_id":"2407.06551","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2407.06551","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Offsetbias: Leveraging debiased data for tuning evaluators","venue":null,"work_id":"20b54028-d2d7-4967-b675-fe17f61ae06a","year":2024},"citing_paper":{"arxiv_id":"2605.02765","last_updated":"2026-05-04T16:05:40Z","snapshot_observed_at":"2026-07-06T23:15:46.390406Z","submitted_at":"2026-05-04T16:05:40Z","title":"U-Define: Designing User Workflows for Hard and Soft Constraints in LLM-Based Planning","version":1},"reference_index":88,"source":"pdf_text","source_observed_at":"2026-05-08T18:19:55.849451Z"},"links":{"cited_paper":"/paper/2407.06551","citing_paper":"/paper/2605.02765"},"observation_digest":"sha256:5d12bd0d5b75ff887609cf23aae20da116dad2c43a93baeb3e6b333a958d54ec","observation_id":"e7a42db8-9698-428b-85c8-67fa49688360","resolution":{"observed_at":"2026-05-09T06:35:39.061387Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2407.06551/citation-record","integrity":"/paper/2407.06551/integrity","json":"/paper/2407.06551/citation-record.json","paper":"/paper/2407.06551"},"outbound":[],"paper":{"arxiv_id":"2407.06551","last_updated":"2024-10-07T08:49:49Z","latest_version":2,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-06T11:46:01.178597Z","submitted_at":"2024-07-09T05:16:22Z","title":"OffsetBias: Leveraging Debiased Data for Tuning Evaluators"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 14 inbound Pith citation observations for arXiv:2407.06551."}