{"as_of":"2026-08-10T00:11:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:47cab94acf36aaf623cc417143ab1567d0c0e5f25abe2f27066746b1aa490719","coverage":[{"denominator":127,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":100,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-09T10:26:07.196148Z","state":"measured"},{"denominator":101,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":101,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-12T08:40:40.910461Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-12T08:40:41.645465Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2502.02988","last_updated":"2025-02-05T08:35:55Z","snapshot_observed_at":"2026-08-09T19:33:12.301428Z","submitted_at":"2025-02-05T08:35:55Z","title":"Training an LLM-as-a-Judge Model: Pipeline, Insights, and Practical Lessons","version":1},"cited_work":{"arxiv_id":"2502.02988","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.02988","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Train- ing an llm-as-a-judge model: Pipeline, insights, and practical lessons","venue":null,"work_id":"b6522c86-4f7f-40b4-8b5c-67d8f5a32e18","year":2025},"citing_paper":{"arxiv_id":"2503.09567","last_updated":"2025-07-18T15:57:54Z","snapshot_observed_at":"2026-08-08T22:33:20.124926Z","submitted_at":"2025-03-12T17:35:03Z","title":"Towards Reasoning Era: A Survey of Long Chain-of-Thought for Reasoning Large Language Models","version":5},"reference_index":279,"source":"pdf_text","source_observed_at":"2026-05-12T08:40:40.910461Z"},"links":{"cited_paper":"/paper/2502.02988","citing_paper":"/paper/2503.09567"},"observation_digest":"sha256:2fd9070519329795687feeb17b9840847b62e2a2c070926d73a1e464254a9020","observation_id":"bf223e65-e5a7-4420-ac2d-3453d7ca8f34","resolution":{"observed_at":"2026-05-12T08:40:41.647942Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2502.02988/citation-record","integrity":"/paper/2502.02988/integrity","json":"/paper/2502.02988/citation-record.json","paper":"/paper/2502.02988"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:26:06.817210Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.02988","last_updated":"2025-02-05T08:35:55Z","snapshot_observed_at":"2026-08-09T19:33:12.301428Z","submitted_at":"2025-02-05T08:35:55Z","title":"Training an LLM-as-a-Judge Model: Pipeline, Insights, and Practical Lessons","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-09T10:26:06.817210Z"},"links":{"citing_paper":"/paper/2502.02988"},"observation_digest":"sha256:7c89d73dbe35fb6fbddf7a5f46a687b8058535bfa691cab593a97f049e6132f7","observation_id":"be3d46be-6a4b-4285-9b6a-01e813ce598f","resolution":{"observed_at":"2026-08-09T10:26:06.817210Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2204.05862","last_updated":"2022-04-12T15:02:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-04-12T15:02:38Z","title":"Training a Helpful and Harmless Assistant with Reinforcement Learning from Human Feedback","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.05862","snapshot_observed_at":"2026-08-09T10:26:06.822426Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.02988","last_updated":"2025-02-05T08:35:55Z","snapshot_observed_at":"2026-08-09T19:33:12.301428Z","submitted_at":"2025-02-05T08:35:55Z","title":"Training an LLM-as-a-Judge Model: Pipeline, Insights, and Practical Lessons","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-09T10:26:06.822426Z"},"links":{"cited_paper":"/paper/2204.05862","citing_paper":"/paper/2502.02988"},"observation_digest":"sha256:13ecfe337d236f4e49f762ba3a93e8a2ffd6605056cc3e5294513f77bf64314e","observation_id":"6b1f7a9a-3c21-478d-9009-a9fc405a9a4d","resolution":{"observed_at":"2026-08-09T10:26:06.822426Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:26:06.827012Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.02988","last_updated":"2025-02-05T08:35:55Z","snapshot_observed_at":"2026-08-09T19:33:12.301428Z","submitted_at":"2025-02-05T08:35:55Z","title":"Training an LLM-as-a-Judge Model: Pipeline, Insights, and Practical Lessons","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-09T10:26:06.827012Z"},"links":{"citing_paper":"/paper/2502.02988"},"observation_digest":"sha256:b3a6f8ffc490784542374591a643c600239ff630f5a53cc4dd76efaaf28307ec","observation_id":"0b5bcc2c-6a9c-466c-8c08-0f47f57d34b4","resolution":{"observed_at":"2026-08-09T10:26:06.827012Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.12744","last_updated":"2024-05-10T06:09:02Z","snapshot_observed_at":"2026-08-09T00:00:51.351254Z","submitted_at":"2024-04-19T09:44:51Z","title":"Beyond Human Norms: Unveiling Unique Values of Large Language Models through Interdisciplinary Approaches","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.12744","snapshot_observed_at":"2026-08-09T10:26:06.830821Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.02988","last_updated":"2025-02-05T08:35:55Z","snapshot_observed_at":"2026-08-09T19:33:12.301428Z","submitted_at":"2025-02-05T08:35:55Z","title":"Training an LLM-as-a-Judge Model: Pipeline, Insights, and Practical Lessons","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-09T10:26:06.830821Z"},"links":{"cited_paper":"/paper/2404.12744","citing_paper":"/paper/2502.02988"},"observation_digest":"sha256:7efa8b6a5ff747be2c0162169115624fe752926bd17733e92aa57b8f36b9fc38","observation_id":"b66b2701-1539-4dfd-b7cd-d72ca486d915","resolution":{"observed_at":"2026-08-09T10:26:06.830821Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.06644","last_updated":"2024-03-11T12:07:13Z","snapshot_observed_at":"2026-08-05T11:37:39.947874Z","submitted_at":"2024-03-11T12:07:13Z","title":"Elephants Never Forget: Testing Language Models for Memorization of Tabular Data","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.06644","snapshot_observed_at":"2026-08-09T10:26:06.835116Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.02988","last_updated":"2025-02-05T08:35:55Z","snapshot_observed_at":"2026-08-09T19:33:12.301428Z","submitted_at":"2025-02-05T08:35:55Z","title":"Training an LLM-as-a-Judge Model: Pipeline, Insights, and Practical Lessons","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-09T10:26:06.835116Z"},"links":{"cited_paper":"/paper/2403.06644","citing_paper":"/paper/2502.02988"},"observation_digest":"sha256:fc68c9d1bb844dd28e0a822f141954b0ac88c80ea8b1f254d728e47686835a6b","observation_id":"d31a6332-3d1c-43d1-bcbd-14e14b2cf2eb","resolution":{"observed_at":"2026-08-09T10:26:06.835116Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11813","last_updated":"2024-11-12T16:38:37Z","snapshot_observed_at":"2026-08-09T23:09:51.252481Z","submitted_at":"2024-06-17T17:54:40Z","title":"How Do Large Language Models Acquire Factual Knowledge During Pretraining?","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.11813","snapshot_observed_at":"2026-08-09T10:26:06.839189Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.02988","last_updated":"2025-02-05T08:35:55Z","snapshot_observed_at":"2026-08-09T19:33:12.301428Z","submitted_at":"2025-02-05T08:35:55Z","title":"Training an LLM-as-a-Judge Model: Pipeline, Insights, and Practical Lessons","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-09T10:26:06.839189Z"},"links":{"cited_paper":"/paper/2406.11813","citing_paper":"/paper/2502.02988"},"observation_digest":"sha256:09545166dbc282939f4d4175a63e3a760ec1cef51030e7dff20fc78ca24d692a","observation_id":"0defba75-5860-4040-ab04-8de92acdfea3","resolution":{"observed_at":"2026-08-09T10:26:06.839189Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2107.03374","last_updated":"2021-07-14T17:16:02Z","snapshot_observed_at":"2026-08-08T11:58:24.516369Z","submitted_at":"2021-07-07T17:41:24Z","title":"Evaluating Large Language Models Trained on Code","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2107.03374","snapshot_observed_at":"2026-08-09T10:26:06.843560Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.02988","last_updated":"2025-02-05T08:35:55Z","snapshot_observed_at":"2026-08-09T19:33:12.301428Z","submitted_at":"2025-02-05T08:35:55Z","title":"Training an LLM-as-a-Judge Model: Pipeline, Insights, and Practical Lessons","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-09T10:26:06.843560Z"},"links":{"cited_paper":"/paper/2107.03374","citing_paper":"/paper/2502.02988"},"observation_digest":"sha256:77da88025cae8dadacbb6593aa14ded459719682bd07bd31db9ef77adb2188c5","observation_id":"c48d21eb-34f5-4bb6-94fd-b0728f4f44e9","resolution":{"observed_at":"2026-08-09T10:26:06.843560Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.04132","last_updated":"2024-03-07T01:22:38Z","snapshot_observed_at":"2026-08-02T17:55:33.750637Z","submitted_at":"2024-03-07T01:22:38Z","title":"Chatbot Arena: An Open Platform for Evaluating LLMs by Human Preference","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.04132","snapshot_observed_at":"2026-08-09T10:26:06.848171Z","title":"Gonzalez, and Ion Stoica","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.02988","last_updated":"2025-02-05T08:35:55Z","snapshot_observed_at":"2026-08-09T19:33:12.301428Z","submitted_at":"2025-02-05T08:35:55Z","title":"Training an LLM-as-a-Judge Model: Pipeline, Insights, and Practical Lessons","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-09T10:26:06.848171Z"},"links":{"cited_paper":"/paper/2403.04132","citing_paper":"/paper/2502.02988"},"observation_digest":"sha256:ce741425ef9e605bd8e1f57d962e57bd812e549027240c53efae5c27c3306ea0","observation_id":"a37e6233-d4a7-427f-b753-92dc686d0203","resolution":{"observed_at":"2026-08-09T10:26:06.848171Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05492","last_updated":"2024-06-07T15:51:08Z","snapshot_observed_at":"2026-07-06T16:29:39.982733Z","submitted_at":"2023-10-09T07:56:16Z","title":"How Abilities in Large Language Models are Affected by Supervised Fine-tuning Data Composition","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.05492","snapshot_observed_at":"2026-08-09T10:26:06.852425Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.02988","last_updated":"2025-02-05T08:35:55Z","snapshot_observed_at":"2026-08-09T19:33:12.301428Z","submitted_at":"2025-02-05T08:35:55Z","title":"Training an LLM-as-a-Judge Model: Pipeline, Insights, and Practical Lessons","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-09T10:26:06.852425Z"},"links":{"cited_paper":"/paper/2310.05492","citing_paper":"/paper/2502.02988"},"observation_digest":"sha256:073914f584f6517000874d9cbcddb85fb5f44645c19d4e3a7ea14fce60987d0a","observation_id":"e8c9c9a1-1af3-4aec-bfe5-f8f37b16949f","resolution":{"observed_at":"2026-08-09T10:26:06.852425Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.00811","last_updated":"2024-10-03T21:07:09Z","snapshot_observed_at":"2026-08-08T08:46:33.573522Z","submitted_at":"2024-02-25T02:35:56Z","title":"Cognitive Bias in Decision-Making with LLMs","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.00811","snapshot_observed_at":"2026-08-09T10:26:06.856504Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.02988","last_updated":"2025-02-05T08:35:55Z","snapshot_observed_at":"2026-08-09T19:33:12.301428Z","submitted_at":"2025-02-05T08:35:55Z","title":"Training an LLM-as-a-Judge Model: Pipeline, Insights, and Practical Lessons","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-09T10:26:06.856504Z"},"links":{"cited_paper":"/paper/2403.00811","citing_paper":"/paper/2502.02988"},"observation_digest":"sha256:e37eef81ffee55cbc5d105fa7c3a970dbb7f34e836e598b01159caa513b442fd","observation_id":"9b4f2c8c-b709-419b-9656-9261b93f2d2c","resolution":{"observed_at":"2026-08-09T10:26:06.856504Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:26:06.860248Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.02988","last_updated":"2025-02-05T08:35:55Z","snapshot_observed_at":"2026-08-09T19:33:12.301428Z","submitted_at":"2025-02-05T08:35:55Z","title":"Training an LLM-as-a-Judge Model: Pipeline, Insights, and Practical Lessons","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-09T10:26:06.860248Z"},"links":{"citing_paper":"/paper/2502.02988"},"observation_digest":"sha256:53f221642c16ee6a5b4e37849dedc730f4c9bef8e606a769a57fda0c09ba0559","observation_id":"7f72c403-5571-4b72-b6e3-e6d91972face","resolution":{"observed_at":"2026-08-09T10:26:06.860248Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2009.03300","last_updated":"2021-01-12T18:57:11Z","snapshot_observed_at":"2026-08-09T10:28:06.906299Z","submitted_at":"2020-09-07T17:59:25Z","title":"Measuring Massive Multitask Language Understanding","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.03300","snapshot_observed_at":"2026-08-09T10:26:06.864124Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.02988","last_updated":"2025-02-05T08:35:55Z","snapshot_observed_at":"2026-08-09T19:33:12.301428Z","submitted_at":"2025-02-05T08:35:55Z","title":"Training an LLM-as-a-Judge Model: Pipeline, Insights, and Practical Lessons","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-09T10:26:06.864124Z"},"links":{"cited_paper":"/paper/2009.03300","citing_paper":"/paper/2502.02988"},"observation_digest":"sha256:eeb26d393e250b0a58118a48675156b948d875963a52e5eeb29fdaeac003ed08","observation_id":"add0e4ed-2a60-43b2-b9bf-7a7b564570ae","resolution":{"observed_at":"2026-08-09T10:26:06.864124Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:26:06.868011Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.02988","last_updated":"2025-02-05T08:35:55Z","snapshot_observed_at":"2026-08-09T19:33:12.301428Z","submitted_at":"2025-02-05T08:35:55Z","title":"Training an LLM-as-a-Judge Model: Pipeline, Insights, and Practical Lessons","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-09T10:26:06.868011Z"},"links":{"citing_paper":"/paper/2502.02988"},"observation_digest":"sha256:71bf93a2b7cf6a218e165a651d2a0fb58019d7fd9f097f2a941e27f10a4a9c40","observation_id":"caf00782-7f33-4abf-add2-4970e7ff18d6","resolution":{"observed_at":"2026-08-09T10:26:06.868011Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.08322","last_updated":"2023-11-06T13:24:16Z","snapshot_observed_at":"2026-08-08T19:03:09.038168Z","submitted_at":"2023-05-15T03:20:19Z","title":"C-Eval: A Multi-Level Multi-Discipline Chinese Evaluation Suite for Foundation Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.08322","snapshot_observed_at":"2026-08-09T10:26:06.871799Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.02988","last_updated":"2025-02-05T08:35:55Z","snapshot_observed_at":"2026-08-09T19:33:12.301428Z","submitted_at":"2025-02-05T08:35:55Z","title":"Training an LLM-as-a-Judge Model: Pipeline, Insights, and Practical Lessons","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-09T10:26:06.871799Z"},"links":{"cited_paper":"/paper/2305.08322","citing_paper":"/paper/2502.02988"},"observation_digest":"sha256:0afd54a5269a92a09dc665edb664f3593d1f1f5ad37355f56de7f88c3ae596ed","observation_id":"3cc9abd6-4204-43ca-ae8e-4404f0b0c694","resolution":{"observed_at":"2026-08-09T10:26:06.871799Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:26:06.875671Z","title":"Mercer, Lalit R","venue":null,"work_id":null,"year":1977},"citing_paper":{"arxiv_id":"2502.02988","last_updated":"2025-02-05T08:35:55Z","snapshot_observed_at":"2026-08-09T19:33:12.301428Z","submitted_at":"2025-02-05T08:35:55Z","title":"Training an LLM-as-a-Judge Model: Pipeline, Insights, and Practical Lessons","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-09T10:26:06.875671Z"},"links":{"citing_paper":"/paper/2502.02988"},"observation_digest":"sha256:3bf08aead9aab304ff068ab354df3e8f58772345c2427a3c903eed80ff07f19a","observation_id":"e6552762-4a13-4086-900c-10e6e65bf5f6","resolution":{"observed_at":"2026-08-09T10:26:06.875671Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.14230","last_updated":"2025-06-11T07:47:45Z","snapshot_observed_at":"2026-07-06T18:34:10.892335Z","submitted_at":"2024-06-20T11:51:00Z","title":"Raising the Bar: Investigating the Values of Large Language Models via Generative Evolving Testing","version":5},"cited_work":{"arxiv_id":"2406.14230","doi":null,"metadata_source":"pith","pith_arxiv_id":"2406.14230","snapshot_observed_at":"2026-08-09T10:26:07.554906Z","title":"Raising the Bar: Investigating the Values of Large Language Models via Generative Evolving Testing","venue":"cs.CL","work_id":"a6afa6c7-85bf-4580-a57c-e992766312ed","year":2024},"citing_paper":{"arxiv_id":"2502.02988","last_updated":"2025-02-05T08:35:55Z","snapshot_observed_at":"2026-08-09T19:33:12.301428Z","submitted_at":"2025-02-05T08:35:55Z","title":"Training an LLM-as-a-Judge Model: Pipeline, Insights, and Practical Lessons","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-09T10:26:06.879399Z"},"links":{"cited_paper":"/paper/2406.14230","citing_paper":"/paper/2502.02988"},"observation_digest":"sha256:d2f58cdd5157320a87d5bb323d5f5176f0c8953f8a0f644099d3540997b7d4ec","observation_id":"12331cd9-c807-45ff-a61d-642d9d7c5173","resolution":{"observed_at":"2026-08-09T10:26:07.561014Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2110.07574","last_updated":"2022-07-12T17:48:46Z","snapshot_observed_at":"2026-08-04T11:25:24.291696Z","submitted_at":"2021-10-14T17:38:12Z","title":"Can Machines Learn Morality? The Delphi Experiment","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.07574","snapshot_observed_at":"2026-08-09T10:26:06.883680Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.02988","last_updated":"2025-02-05T08:35:55Z","snapshot_observed_at":"2026-08-09T19:33:12.301428Z","submitted_at":"2025-02-05T08:35:55Z","title":"Training an LLM-as-a-Judge Model: Pipeline, Insights, and Practical Lessons","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-09T10:26:06.883680Z"},"links":{"cited_paper":"/paper/2110.07574","citing_paper":"/paper/2502.02988"},"observation_digest":"sha256:081f6c9179154da444e3b499599cd1fa02ce2071975c1b5803eda048310569fe","observation_id":"8e46a871-a14d-4854-aadb-9229148a2492","resolution":{"observed_at":"2026-08-09T10:26:06.883680Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:26:06.887711Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.02988","last_updated":"2025-02-05T08:35:55Z","snapshot_observed_at":"2026-08-09T19:33:12.301428Z","submitted_at":"2025-02-05T08:35:55Z","title":"Training an LLM-as-a-Judge Model: Pipeline, Insights, and Practical Lessons","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-09T10:26:06.887711Z"},"links":{"citing_paper":"/paper/2502.02988"},"observation_digest":"sha256:0f4dc3aa5788ec26ce3da63e869614fef780f34f87f157eab3a9a0329c8cf7e2","observation_id":"b509fb7f-c652-42f9-acda-d1d976c1a974","resolution":{"observed_at":"2026-08-09T10:26:06.887711Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:26:06.895858Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.02988","last_updated":"2025-02-05T08:35:55Z","snapshot_observed_at":"2026-08-09T19:33:12.301428Z","submitted_at":"2025-02-05T08:35:55Z","title":"Training an LLM-as-a-Judge Model: Pipeline, Insights, and Practical Lessons","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-09T10:26:06.895858Z"},"links":{"citing_paper":"/paper/2502.02988"},"observation_digest":"sha256:24ad88ff46bfce481ecb4eb734aca0742a87ea44a5a5218caa56ef0684161d83","observation_id":"f440211e-204c-4471-9d45-923ec4e592b1","resolution":{"observed_at":"2026-08-09T10:26:06.895858Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:26:06.899646Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.02988","last_updated":"2025-02-05T08:35:55Z","snapshot_observed_at":"2026-08-09T19:33:12.301428Z","submitted_at":"2025-02-05T08:35:55Z","title":"Training an LLM-as-a-Judge Model: Pipeline, Insights, and Practical Lessons","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-09T10:26:06.899646Z"},"links":{"citing_paper":"/paper/2502.02988"},"observation_digest":"sha256:20b33fc24fade1ca466118a623e034e3093201e8973c89c1ec083450665aba82","observation_id":"34399e51-cd30-47a2-aa20-dc9673f26f45","resolution":{"observed_at":"2026-08-09T10:26:06.899646Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.12032","last_updated":"2024-04-06T03:52:04Z","snapshot_observed_at":"2026-08-09T18:45:15.884087Z","submitted_at":"2023-08-23T09:45:29Z","title":"From Quantity to Quality: Boosting LLM Performance with Self-Guided Data Selection for Instruction Tuning","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.12032","snapshot_observed_at":"2026-08-09T10:26:06.907720Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.02988","last_updated":"2025-02-05T08:35:55Z","snapshot_observed_at":"2026-08-09T19:33:12.301428Z","submitted_at":"2025-02-05T08:35:55Z","title":"Training an LLM-as-a-Judge Model: Pipeline, Insights, and Practical Lessons","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-09T10:26:06.907720Z"},"links":{"cited_paper":"/paper/2308.12032","citing_paper":"/paper/2502.02988"},"observation_digest":"sha256:5111a40a4240d29355ee132e8951da7b1a17c28c8773c53b845baebb9bac73c0","observation_id":"08e40cce-7785-46dc-a878-6922821ff89f","resolution":{"observed_at":"2026-08-09T10:26:06.907720Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11939","last_updated":"2024-10-14T18:11:58Z","snapshot_observed_at":"2026-08-02T11:33:41.297984Z","submitted_at":"2024-06-17T17:26:10Z","title":"From Crowdsourced Data to High-Quality Benchmarks: Arena-Hard and BenchBuilder Pipeline","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.11939","snapshot_observed_at":"2026-08-09T10:26:06.912272Z","title":"Gonzalez, and Ion Stoica","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.02988","last_updated":"2025-02-05T08:35:55Z","snapshot_observed_at":"2026-08-09T19:33:12.301428Z","submitted_at":"2025-02-05T08:35:55Z","title":"Training an LLM-as-a-Judge Model: Pipeline, Insights, and Practical Lessons","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-09T10:26:06.912272Z"},"links":{"cited_paper":"/paper/2406.11939","citing_paper":"/paper/2502.02988"},"observation_digest":"sha256:013e20c198046627491766268556ac33b51bccc50c99e028d7a31017d17ac4bc","observation_id":"dc0bf80f-caa7-488a-8b38-6a5a8127e90f","resolution":{"observed_at":"2026-08-09T10:26:06.912272Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:26:06.916238Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.02988","last_updated":"2025-02-05T08:35:55Z","snapshot_observed_at":"2026-08-09T19:33:12.301428Z","submitted_at":"2025-02-05T08:35:55Z","title":"Training an LLM-as-a-Judge Model: Pipeline, Insights, and Practical Lessons","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-09T10:26:06.916238Z"},"links":{"citing_paper":"/paper/2502.02988"},"observation_digest":"sha256:d7c7c1299c6ee8b0b4115fbbdb318b9516ea70f1ec4e05a7ad780bc23c3b86df","observation_id":"f547d0bd-4731-4c1f-a920-f54ef4010caa","resolution":{"observed_at":"2026-08-09T10:26:06.916238Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:26:06.924394Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.02988","last_updated":"2025-02-05T08:35:55Z","snapshot_observed_at":"2026-08-09T19:33:12.301428Z","submitted_at":"2025-02-05T08:35:55Z","title":"Training an LLM-as-a-Judge Model: Pipeline, Insights, and Practical Lessons","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-09T10:26:06.924394Z"},"links":{"citing_paper":"/paper/2502.02988"},"observation_digest":"sha256:88f7ecba5cde46735f159cce166caf29b1b86c4432cb6c6eac6e24e54a74c4ed","observation_id":"6fd91538-2c06-44c8-93b7-3ce0d42b24ed","resolution":{"observed_at":"2026-08-09T10:26:06.924394Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:26:06.927917Z","title":null,"venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2502.02988","last_updated":"2025-02-05T08:35:55Z","snapshot_observed_at":"2026-08-09T19:33:12.301428Z","submitted_at":"2025-02-05T08:35:55Z","title":"Training an LLM-as-a-Judge Model: Pipeline, Insights, and Practical Lessons","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-09T10:26:06.927917Z"},"links":{"citing_paper":"/paper/2502.02988"},"observation_digest":"sha256:3a89a50af9cbbbcb6586fa06bf22dedf11866b0078dae95809b75759aed3383f","observation_id":"a6ce5c1b-10e3-4142-891d-a6383c32c97c","resolution":{"observed_at":"2026-08-09T10:26:06.927917Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.04770","last_updated":"2024-10-05T22:39:51Z","snapshot_observed_at":"2026-08-06T14:20:21.460707Z","submitted_at":"2024-06-07T09:15:44Z","title":"WildBench: Benchmarking LLMs with Challenging Tasks from Real Users in the Wild","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.04770","snapshot_observed_at":"2026-08-09T10:26:06.920314Z","title":"arXiv:2406.04770 [cs.CL]","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.02988","last_updated":"2025-02-05T08:35:55Z","snapshot_observed_at":"2026-08-09T19:33:12.301428Z","submitted_at":"2025-02-05T08:35:55Z","title":"Training an LLM-as-a-Judge Model: Pipeline, Insights, and Practical Lessons","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-09T10:26:06.920314Z"},"links":{"cited_paper":"/paper/2406.04770","citing_paper":"/paper/2502.02988"},"observation_digest":"sha256:17cab5a7323a6569e98f095f5806add3429baf4d2234fff92e3f4d0d37e880d2","observation_id":"4cb36887-c76c-494b-9193-9c12d2543941","resolution":{"observed_at":"2026-08-09T10:26:06.920314Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.08700","last_updated":"2024-10-02T07:26:40Z","snapshot_observed_at":"2026-07-31T15:25:35.406497Z","submitted_at":"2024-04-10T18:08:59Z","title":"DyKnow: Dynamically Verifying Time-Sensitive Factual Knowledge in LLMs","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.08700","snapshot_observed_at":"2026-08-09T10:26:06.935195Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.02988","last_updated":"2025-02-05T08:35:55Z","snapshot_observed_at":"2026-08-09T19:33:12.301428Z","submitted_at":"2025-02-05T08:35:55Z","title":"Training an LLM-as-a-Judge Model: Pipeline, Insights, and Practical Lessons","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-09T10:26:06.935195Z"},"links":{"cited_paper":"/paper/2404.08700","citing_paper":"/paper/2502.02988"},"observation_digest":"sha256:565e96f294dae57ac6f9170ef7948e25935f07d03a8e40294d29d4d1a845455d","observation_id":"02f74949-ed50-4efe-824d-4ee66f82934a","resolution":{"observed_at":"2026-08-09T10:26:06.935195Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.02707","last_updated":"2023-06-05T08:58:39Z","snapshot_observed_at":"2026-08-09T03:29:22.849759Z","submitted_at":"2023-06-05T08:58:39Z","title":"Orca: Progressive Learning from Complex Explanation Traces of GPT-4","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.02707","snapshot_observed_at":"2026-08-09T10:26:06.938927Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.02988","last_updated":"2025-02-05T08:35:55Z","snapshot_observed_at":"2026-08-09T19:33:12.301428Z","submitted_at":"2025-02-05T08:35:55Z","title":"Training an LLM-as-a-Judge Model: Pipeline, Insights, and Practical Lessons","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-09T10:26:06.938927Z"},"links":{"cited_paper":"/paper/2306.02707","citing_paper":"/paper/2502.02988"},"observation_digest":"sha256:0f25915ba5c2fa36d8b557479972fdc9168959f00f4185cd9b6cf4961b1733ca","observation_id":"ddc85e57-5157-4936-8c1c-80fdb85602a4","resolution":{"observed_at":"2026-08-09T10:26:06.938927Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.18743","last_updated":"2024-08-25T09:58:57Z","snapshot_observed_at":"2026-08-06T10:19:25.039692Z","submitted_at":"2023-11-30T17:41:30Z","title":"AlignBench: Benchmarking Chinese Alignment of Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.18743","snapshot_observed_at":"2026-08-09T10:26:06.931661Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.02988","last_updated":"2025-02-05T08:35:55Z","snapshot_observed_at":"2026-08-09T19:33:12.301428Z","submitted_at":"2025-02-05T08:35:55Z","title":"Training an LLM-as-a-Judge Model: Pipeline, Insights, and Practical Lessons","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-09T10:26:06.931661Z"},"links":{"cited_paper":"/paper/2311.18743","citing_paper":"/paper/2502.02988"},"observation_digest":"sha256:5228855c670480b601520e7b7dbd8f7581c89bf35a80b0588b7af94087f22aa8","observation_id":"2effc0c7-cc26-48f1-b2bd-3739b840c7f0","resolution":{"observed_at":"2026-08-09T10:26:06.931661Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.02155","last_updated":"2022-03-04T07:04:42Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-03-04T07:04:42Z","title":"Training language models to follow instructions with human feedback","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.02155","snapshot_observed_at":"2026-08-09T10:26:06.946505Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.02988","last_updated":"2025-02-05T08:35:55Z","snapshot_observed_at":"2026-08-09T19:33:12.301428Z","submitted_at":"2025-02-05T08:35:55Z","title":"Training an LLM-as-a-Judge Model: Pipeline, Insights, and Practical Lessons","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-09T10:26:06.946505Z"},"links":{"cited_paper":"/paper/2203.02155","citing_paper":"/paper/2502.02988"},"observation_digest":"sha256:15ccbd63f2a8dcb7ed29b1ba5e4e082eeeae1be00dfa55638948429c96f467aa","observation_id":"4f33ea1a-0123-4c43-b8ac-85cd8ad5d979","resolution":{"observed_at":"2026-08-09T10:26:06.946505Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.05934","last_updated":"2024-01-30T11:58:10Z","snapshot_observed_at":"2026-08-05T09:41:20.689942Z","submitted_at":"2023-12-10T16:52:00Z","title":"Fine-Tuning or Retrieval? Comparing Knowledge Injection in LLMs","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.05934","snapshot_observed_at":"2026-08-09T10:26:06.950598Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.02988","last_updated":"2025-02-05T08:35:55Z","snapshot_observed_at":"2026-08-09T19:33:12.301428Z","submitted_at":"2025-02-05T08:35:55Z","title":"Training an LLM-as-a-Judge Model: Pipeline, Insights, and Practical Lessons","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-09T10:26:06.950598Z"},"links":{"cited_paper":"/paper/2312.05934","citing_paper":"/paper/2502.02988"},"observation_digest":"sha256:321d10a00e027ca18b0ed9a5dbc84ec7a59d1e99c8c7e774a08913655d684e0a","observation_id":"86187629-cb05-4a5d-8900-6c9978297955","resolution":{"observed_at":"2026-08-09T10:26:06.950598Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-09T10:26:06.942790Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.02988","last_updated":"2025-02-05T08:35:55Z","snapshot_observed_at":"2026-08-09T19:33:12.301428Z","submitted_at":"2025-02-05T08:35:55Z","title":"Training an LLM-as-a-Judge Model: Pipeline, Insights, and Practical Lessons","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-09T10:26:06.942790Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2502.02988"},"observation_digest":"sha256:282d69a9863149a8cff1447bc5c9828f2bc8655ee7049742bc28f33fb3236fb1","observation_id":"5e99fb3d-655f-45eb-89af-5a4f17be4c4d","resolution":{"observed_at":"2026-08-09T10:26:06.942790Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:26:06.957794Z","title":"Peng, Xi Yang, Aokun Chen, Kaleb E","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.02988","last_updated":"2025-02-05T08:35:55Z","snapshot_observed_at":"2026-08-09T19:33:12.301428Z","submitted_at":"2025-02-05T08:35:55Z","title":"Training an LLM-as-a-Judge Model: Pipeline, Insights, and Practical Lessons","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-09T10:26:06.957794Z"},"links":{"citing_paper":"/paper/2502.02988"},"observation_digest":"sha256:29b1b6d0064471f139588adf019fcf9925132ae9c8d41e5a688f11265ba3ee27","observation_id":"8017578b-3cd1-40d4-bf43-65a3ce7a8fca","resolution":{"observed_at":"2026-08-09T10:26:06.957794Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:26:06.961369Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2502.02988","last_updated":"2025-02-05T08:35:55Z","snapshot_observed_at":"2026-08-09T19:33:12.301428Z","submitted_at":"2025-02-05T08:35:55Z","title":"Training an LLM-as-a-Judge Model: Pipeline, Insights, and Practical Lessons","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-09T10:26:06.961369Z"},"links":{"citing_paper":"/paper/2502.02988"},"observation_digest":"sha256:23d0cf0150abf25223ae753430391af2e7f08ce722c7530c50367446b1397560","observation_id":"a806afed-7b33-49fc-ae43-0d72fcf3fdcb","resolution":{"observed_at":"2026-08-09T10:26:06.961369Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:26:06.954234Z","title":null,"venue":null,"work_id":null,"year":2002},"citing_paper":{"arxiv_id":"2502.02988","last_updated":"2025-02-05T08:35:55Z","snapshot_observed_at":"2026-08-09T19:33:12.301428Z","submitted_at":"2025-02-05T08:35:55Z","title":"Training an LLM-as-a-Judge Model: Pipeline, Insights, and Practical Lessons","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-09T10:26:06.954234Z"},"links":{"citing_paper":"/paper/2502.02988"},"observation_digest":"sha256:c5f0a088e61a878a0fd9b6177738cf928bbaf70e5fb060e9e539893bbde30051","observation_id":"e882d754-624c-4928-8ab1-7c6b44fb55f9","resolution":{"observed_at":"2026-08-09T10:26:06.954234Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:26:06.968348Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.02988","last_updated":"2025-02-05T08:35:55Z","snapshot_observed_at":"2026-08-09T19:33:12.301428Z","submitted_at":"2025-02-05T08:35:55Z","title":"Training an LLM-as-a-Judge Model: Pipeline, Insights, and Practical Lessons","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-09T10:26:06.968348Z"},"links":{"citing_paper":"/paper/2502.02988"},"observation_digest":"sha256:a80d5b7688d452dbbf004a35ada147a4542f20c8b71c268b2f22d0522a5c93c8","observation_id":"dd2e88cc-510f-4582-9440-f23a7b92435e","resolution":{"observed_at":"2026-08-09T10:26:06.968348Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:26:06.971926Z","title":"Link, Roxana Daneshjou, and Nicolás W Cortés- Penfield","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.02988","last_updated":"2025-02-05T08:35:55Z","snapshot_observed_at":"2026-08-09T19:33:12.301428Z","submitted_at":"2025-02-05T08:35:55Z","title":"Training an LLM-as-a-Judge Model: Pipeline, Insights, and Practical Lessons","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-09T10:26:06.971926Z"},"links":{"citing_paper":"/paper/2502.02988"},"observation_digest":"sha256:b9d7716fd7bfe89281dbd39e7e35a2ef256460d4a9d6944675e8bce1c8f2cbcf","observation_id":"e1f4fd36-d6c1-444d-942d-401a9c7b59b1","resolution":{"observed_at":"2026-08-09T10:26:06.971926Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:26:06.964892Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.02988","last_updated":"2025-02-05T08:35:55Z","snapshot_observed_at":"2026-08-09T19:33:12.301428Z","submitted_at":"2025-02-05T08:35:55Z","title":"Training an LLM-as-a-Judge Model: Pipeline, Insights, and Practical Lessons","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-09T10:26:06.964892Z"},"links":{"citing_paper":"/paper/2502.02988"},"observation_digest":"sha256:14e0b0e1b1b5c0e644d7f2f23e086a515f6b128358f6bb281ab0777ef7eab691","observation_id":"67d14a92-6227-4e27-a194-ba2ce7f69ad5","resolution":{"observed_at":"2026-08-09T10:26:06.964892Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.05561","last_updated":"2024-09-30T10:17:12Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-01-10T22:07:21Z","title":"TrustLLM: Trustworthiness in Large Language Models","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.05561","snapshot_observed_at":"2026-08-09T10:26:06.983198Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.02988","last_updated":"2025-02-05T08:35:55Z","snapshot_observed_at":"2026-08-09T19:33:12.301428Z","submitted_at":"2025-02-05T08:35:55Z","title":"Training an LLM-as-a-Judge Model: Pipeline, Insights, and Practical Lessons","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-09T10:26:06.983198Z"},"links":{"cited_paper":"/paper/2401.05561","citing_paper":"/paper/2502.02988"},"observation_digest":"sha256:94b3f8d500b02421036b58d632a5bdaa6bdd9c44fb0e43a7e896194f12f59045","observation_id":"b447b56b-f7eb-43c7-9f15-7e07cc42e8c8","resolution":{"observed_at":"2026-08-09T10:26:06.983198Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:26:06.986899Z","title":"Hashimoto","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.02988","last_updated":"2025-02-05T08:35:55Z","snapshot_observed_at":"2026-08-09T19:33:12.301428Z","submitted_at":"2025-02-05T08:35:55Z","title":"Training an LLM-as-a-Judge Model: Pipeline, Insights, and Practical Lessons","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-09T10:26:06.986899Z"},"links":{"citing_paper":"/paper/2502.02988"},"observation_digest":"sha256:fe1063b4c7f2cdcc47172649e92ce7b0e2cdd32a15f923a793fd62cd37452b49","observation_id":"ba93b126-4dc7-4203-ad72-4e7c3eb6e680","resolution":{"observed_at":"2026-08-09T10:26:06.986899Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:26:06.975429Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.02988","last_updated":"2025-02-05T08:35:55Z","snapshot_observed_at":"2026-08-09T19:33:12.301428Z","submitted_at":"2025-02-05T08:35:55Z","title":"Training an LLM-as-a-Judge Model: Pipeline, Insights, and Practical Lessons","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-09T10:26:06.975429Z"},"links":{"citing_paper":"/paper/2502.02988"},"observation_digest":"sha256:a8aba63bfdb084e9db3e6d5fb7b3a55ebde5896ffbbc1560317d3b85897dae51","observation_id":"94dd0f13-a279-420c-9074-382b70b94005","resolution":{"observed_at":"2026-08-09T10:26:06.975429Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.14526","last_updated":"2024-06-03T06:48:34Z","snapshot_observed_at":"2026-08-06T08:12:08.343885Z","submitted_at":"2024-02-22T13:20:53Z","title":"Balanced Data Sampling for Language Model Training with Clustering","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.14526","snapshot_observed_at":"2026-08-09T10:26:06.979516Z","title":"arXiv:2402.14526 [cs.CL]","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.02988","last_updated":"2025-02-05T08:35:55Z","snapshot_observed_at":"2026-08-09T19:33:12.301428Z","submitted_at":"2025-02-05T08:35:55Z","title":"Training an LLM-as-a-Judge Model: Pipeline, Insights, and Practical Lessons","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-09T10:26:06.979516Z"},"links":{"cited_paper":"/paper/2402.14526","citing_paper":"/paper/2502.02988"},"observation_digest":"sha256:2a8af0286233d47e3a5a362dd98a073fe437dc0899c6f526f56d86fd25a1254b","observation_id":"449c8f6a-fd07-4389-968e-0a2d2e54d28b","resolution":{"observed_at":"2026-08-09T10:26:06.979516Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.10817","last_updated":"2024-07-15T15:33:45Z","snapshot_observed_at":"2026-07-06T18:46:31.112544Z","submitted_at":"2024-07-15T15:33:45Z","title":"Foundational Autoraters: Taming Large Language Models for Better Automatic Evaluation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.10817","snapshot_observed_at":"2026-08-09T10:26:06.997800Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.02988","last_updated":"2025-02-05T08:35:55Z","snapshot_observed_at":"2026-08-09T19:33:12.301428Z","submitted_at":"2025-02-05T08:35:55Z","title":"Training an LLM-as-a-Judge Model: Pipeline, Insights, and Practical Lessons","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-09T10:26:06.997800Z"},"links":{"cited_paper":"/paper/2407.10817","citing_paper":"/paper/2502.02988"},"observation_digest":"sha256:25108c3c6fcc0b2fc53625962930c56b20df9108a00d474a478a73ac7cb3ff62","observation_id":"af6ecb3f-2016-40f0-95d1-db9311c2b413","resolution":{"observed_at":"2026-08-09T10:26:06.997800Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.10560","last_updated":"2023-05-25T23:50:07Z","snapshot_observed_at":"2026-07-06T14:33:11.945106Z","submitted_at":"2022-12-20T18:59:19Z","title":"Self-Instruct: Aligning Language Models with Self-Generated Instructions","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.10560","snapshot_observed_at":"2026-08-09T10:26:07.001623Z","title":"Smith, Daniel Khashabi, and Hannaneh Hajishirzi","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.02988","last_updated":"2025-02-05T08:35:55Z","snapshot_observed_at":"2026-08-09T19:33:12.301428Z","submitted_at":"2025-02-05T08:35:55Z","title":"Training an LLM-as-a-Judge Model: Pipeline, Insights, and Practical Lessons","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-09T10:26:07.001623Z"},"links":{"cited_paper":"/paper/2212.10560","citing_paper":"/paper/2502.02988"},"observation_digest":"sha256:f2739089685f19e627ecfdd61289fdb9c9c12d272c535336919efcdac3af4d09","observation_id":"ebeebc30-5e2c-46d2-a248-aaab702056d3","resolution":{"observed_at":"2026-08-09T10:26:07.001623Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.11805","last_updated":"2025-05-09T21:04:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-12-19T02:39:27Z","title":"Gemini: A Family of Highly Capable Multimodal Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.11805","snapshot_observed_at":"2026-08-09T10:26:06.990380Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.02988","last_updated":"2025-02-05T08:35:55Z","snapshot_observed_at":"2026-08-09T19:33:12.301428Z","submitted_at":"2025-02-05T08:35:55Z","title":"Training an LLM-as-a-Judge Model: Pipeline, Insights, and Practical Lessons","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-09T10:26:06.990380Z"},"links":{"cited_paper":"/paper/2312.11805","citing_paper":"/paper/2502.02988"},"observation_digest":"sha256:f608a75f79c7220b680b59ac45b426b30871a903e5d7b6e74bf57be436479124","observation_id":"31178b6e-4d8f-4ba0-81a9-7f7a7ba630f5","resolution":{"observed_at":"2026-08-09T10:26:06.990380Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.10671","last_updated":"2024-09-10T13:25:53Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-07-15T12:35:42Z","title":"Qwen2 Technical Report","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.10671","snapshot_observed_at":"2026-08-09T10:26:06.994040Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.02988","last_updated":"2025-02-05T08:35:55Z","snapshot_observed_at":"2026-08-09T19:33:12.301428Z","submitted_at":"2025-02-05T08:35:55Z","title":"Training an LLM-as-a-Judge Model: Pipeline, Insights, and Practical Lessons","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-09T10:26:06.994040Z"},"links":{"cited_paper":"/paper/2407.10671","citing_paper":"/paper/2502.02988"},"observation_digest":"sha256:a655c8a9a2a861f7c1c698909b59c92ddc331a368308019622a2dfd1f7908a00","observation_id":"d5fa3378-1e24-4054-88d6-b8547c91307e","resolution":{"observed_at":"2026-08-09T10:26:06.994040Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:26:07.017644Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.02988","last_updated":"2025-02-05T08:35:55Z","snapshot_observed_at":"2026-08-09T19:33:12.301428Z","submitted_at":"2025-02-05T08:35:55Z","title":"Training an LLM-as-a-Judge Model: Pipeline, Insights, and Practical Lessons","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-09T10:26:07.017644Z"},"links":{"citing_paper":"/paper/2502.02988"},"observation_digest":"sha256:60f6b035fa772d4654cffbf5f5886a122dd33beefb3b1c6eb8bebe7cf544dcb7","observation_id":"41883e9e-f47e-41de-8fe4-7089df947271","resolution":{"observed_at":"2026-08-09T10:26:07.017644Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:26:07.025199Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2502.02988","last_updated":"2025-02-05T08:35:55Z","snapshot_observed_at":"2026-08-09T19:33:12.301428Z","submitted_at":"2025-02-05T08:35:55Z","title":"Training an LLM-as-a-Judge Model: Pipeline, Insights, and Practical Lessons","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-09T10:26:07.025199Z"},"links":{"citing_paper":"/paper/2502.02988"},"observation_digest":"sha256:b3a9243c6c1a514b4effc1d9a1a8d2683d5a7423f99d546c56d11685737cbe08","observation_id":"afc84953-b666-4491-a485-dd8475913de0","resolution":{"observed_at":"2026-08-09T10:26:07.025199Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:26:07.005480Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.02988","last_updated":"2025-02-05T08:35:55Z","snapshot_observed_at":"2026-08-09T19:33:12.301428Z","submitted_at":"2025-02-05T08:35:55Z","title":"Training an LLM-as-a-Judge Model: Pipeline, Insights, and Practical Lessons","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-09T10:26:07.005480Z"},"links":{"citing_paper":"/paper/2502.02988"},"observation_digest":"sha256:19973aa84c5a917b0458e718d9c88e88b39a9afbcd35fc6954b1eacff5fc4e6b","observation_id":"736eabad-522a-4488-8b12-0f99501b77ef","resolution":{"observed_at":"2026-08-09T10:26:07.005480Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:26:07.009288Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.02988","last_updated":"2025-02-05T08:35:55Z","snapshot_observed_at":"2026-08-09T19:33:12.301428Z","submitted_at":"2025-02-05T08:35:55Z","title":"Training an LLM-as-a-Judge Model: Pipeline, Insights, and Practical Lessons","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-09T10:26:07.009288Z"},"links":{"citing_paper":"/paper/2502.02988"},"observation_digest":"sha256:bcf5f96ad0e5e93177d212d3c256e39d2c9818ff07b076460a7717a915c99b29","observation_id":"dcdb9dd1-b7da-4657-910f-2a062a02b86d","resolution":{"observed_at":"2026-08-09T10:26:07.009288Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.07384","last_updated":"2024-12-05T18:47:47Z","snapshot_observed_at":"2026-08-09T19:39:26.298409Z","submitted_at":"2024-03-12T07:45:33Z","title":"SmallToLarge (S2L): Scalable Data Selection for Fine-tuning Large Language Models by Summarizing Training Trajectories of Small Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.07384","snapshot_observed_at":"2026-08-09T10:26:07.012786Z","title":"arXiv:2403.07384 [cs.CL]","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.02988","last_updated":"2025-02-05T08:35:55Z","snapshot_observed_at":"2026-08-09T19:33:12.301428Z","submitted_at":"2025-02-05T08:35:55Z","title":"Training an LLM-as-a-Judge Model: Pipeline, Insights, and Practical Lessons","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-09T10:26:07.012786Z"},"links":{"cited_paper":"/paper/2403.07384","citing_paper":"/paper/2502.02988"},"observation_digest":"sha256:09d4c78fc1e90240be37a2251619747a8da880f7c0634c162c94b66390b7908a","observation_id":"3cdad77c-5806-4c65-a766-405eb59b9d5f","resolution":{"observed_at":"2026-08-09T10:26:07.012786Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.06364","last_updated":"2023-09-18T14:23:02Z","snapshot_observed_at":"2026-08-07T12:51:50.861720Z","submitted_at":"2023-04-13T09:39:30Z","title":"AGIEval: A Human-Centric Benchmark for Evaluating Foundation Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.06364","snapshot_observed_at":"2026-08-09T10:26:07.043089Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.02988","last_updated":"2025-02-05T08:35:55Z","snapshot_observed_at":"2026-08-09T19:33:12.301428Z","submitted_at":"2025-02-05T08:35:55Z","title":"Training an LLM-as-a-Judge Model: Pipeline, Insights, and Practical Lessons","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-09T10:26:07.043089Z"},"links":{"cited_paper":"/paper/2304.06364","citing_paper":"/paper/2502.02988"},"observation_digest":"sha256:41e83d50a769dc55cd9b91f95a6e08bbaa02bf10f7b757b74b4eea9634dd312a","observation_id":"daa1fa42-6884-49d6-8aee-e3ace2c9d895","resolution":{"observed_at":"2026-08-09T10:26:07.043089Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.16952","last_updated":"2025-03-20T03:31:27Z","snapshot_observed_at":"2026-07-06T17:50:18.017647Z","submitted_at":"2024-03-25T17:14:00Z","title":"Data Mixing Laws: Optimizing Data Mixtures by Predicting Language Modeling Performance","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.16952","snapshot_observed_at":"2026-08-09T10:26:07.021278Z","title":"arXiv:2403.16952 [cs.CL]","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.02988","last_updated":"2025-02-05T08:35:55Z","snapshot_observed_at":"2026-08-09T19:33:12.301428Z","submitted_at":"2025-02-05T08:35:55Z","title":"Training an LLM-as-a-Judge Model: Pipeline, Insights, and Practical Lessons","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-09T10:26:07.021278Z"},"links":{"cited_paper":"/paper/2403.16952","citing_paper":"/paper/2502.02988"},"observation_digest":"sha256:e61661f666e92dd1a418adb0594f6c06184a51d1fac9a26ad9a676544d71e1ba","observation_id":"740895cd-dda9-4473-8fc9-dbb30f9541cd","resolution":{"observed_at":"2026-08-09T10:26:07.021278Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:26:07.028606Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.02988","last_updated":"2025-02-05T08:35:55Z","snapshot_observed_at":"2026-08-09T19:33:12.301428Z","submitted_at":"2025-02-05T08:35:55Z","title":"Training an LLM-as-a-Judge Model: Pipeline, Insights, and Practical Lessons","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-09T10:26:07.028606Z"},"links":{"citing_paper":"/paper/2502.02988"},"observation_digest":"sha256:907afd5d478ce4f47169bc0c70819903cfba9bf7649e8b0a3435260680967420","observation_id":"2a8e2467-5cb0-4dd7-b4cb-eaa0a4abcbc9","resolution":{"observed_at":"2026-08-09T10:26:07.028606Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.12491","last_updated":"2024-01-23T05:19:47Z","snapshot_observed_at":"2026-08-09T15:01:55.389999Z","submitted_at":"2024-01-23T05:19:47Z","title":"Assessing and Understanding Creativity in Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.12491","snapshot_observed_at":"2026-08-09T10:26:07.032116Z","title":"arXiv:2401.12491 [cs.CL]","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.02988","last_updated":"2025-02-05T08:35:55Z","snapshot_observed_at":"2026-08-09T19:33:12.301428Z","submitted_at":"2025-02-05T08:35:55Z","title":"Training an LLM-as-a-Judge Model: Pipeline, Insights, and Practical Lessons","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-09T10:26:07.032116Z"},"links":{"cited_paper":"/paper/2401.12491","citing_paper":"/paper/2502.02988"},"observation_digest":"sha256:326f1ab749b4c700a12d0470fcac393381b51d5cdf0d6be45cff86df8f3b3086","observation_id":"dc33ccdc-86ba-45bc-8512-66a8af32cd4b","resolution":{"observed_at":"2026-08-09T10:26:07.032116Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.11998","last_updated":"2024-03-10T19:34:57Z","snapshot_observed_at":"2026-07-06T16:21:45.588487Z","submitted_at":"2023-09-21T12:13:55Z","title":"LMSYS-Chat-1M: A Large-Scale Real-World LLM Conversation Dataset","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.11998","snapshot_observed_at":"2026-08-09T10:26:07.035838Z","title":"Xing, Joseph E","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.02988","last_updated":"2025-02-05T08:35:55Z","snapshot_observed_at":"2026-08-09T19:33:12.301428Z","submitted_at":"2025-02-05T08:35:55Z","title":"Training an LLM-as-a-Judge Model: Pipeline, Insights, and Practical Lessons","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-09T10:26:07.035838Z"},"links":{"cited_paper":"/paper/2309.11998","citing_paper":"/paper/2502.02988"},"observation_digest":"sha256:212fdddc129da2434686afc912a54aa159cc90d9e9428cd8bad89c4f7e9d5a77","observation_id":"e2406660-7881-4991-b79e-1e8687a5bc08","resolution":{"observed_at":"2026-08-09T10:26:07.035838Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:26:07.039751Z","title":"Gonzalez, and Ion Stoica","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.02988","last_updated":"2025-02-05T08:35:55Z","snapshot_observed_at":"2026-08-09T19:33:12.301428Z","submitted_at":"2025-02-05T08:35:55Z","title":"Training an LLM-as-a-Judge Model: Pipeline, Insights, and Practical Lessons","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-09T10:26:07.039751Z"},"links":{"citing_paper":"/paper/2502.02988"},"observation_digest":"sha256:7423d5dace2e6b62799058316e6dfc370bf598605dc81eb152a66a2ef0bb3a30","observation_id":"079248f0-27bb-4433-8901-4b813b7bc10b","resolution":{"observed_at":"2026-08-09T10:26:07.039751Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.01964","last_updated":"2023-11-03T14:59:54Z","snapshot_observed_at":"2026-08-06T10:56:05.075839Z","submitted_at":"2023-11-03T14:59:54Z","title":"Don't Make Your LLM an Evaluation Benchmark Cheater","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.01964","snapshot_observed_at":"2026-08-09T10:26:07.046518Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.02988","last_updated":"2025-02-05T08:35:55Z","snapshot_observed_at":"2026-08-09T19:33:12.301428Z","submitted_at":"2025-02-05T08:35:55Z","title":"Training an LLM-as-a-Judge Model: Pipeline, Insights, and Practical Lessons","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-09T10:26:07.046518Z"},"links":{"cited_paper":"/paper/2311.01964","citing_paper":"/paper/2502.02988"},"observation_digest":"sha256:45a0c78dd9887a198cdfb022495795a39ebb456c4ade8da3bf4ceb8fb206f0f5","observation_id":"baffcdb0-75e8-4e3c-ba63-4cef2ebc7c87","resolution":{"observed_at":"2026-08-09T10:26:07.046518Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:26:07.050876Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.02988","last_updated":"2025-02-05T08:35:55Z","snapshot_observed_at":"2026-08-09T19:33:12.301428Z","submitted_at":"2025-02-05T08:35:55Z","title":"Training an LLM-as-a-Judge Model: Pipeline, Insights, and Practical Lessons","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-09T10:26:07.050876Z"},"links":{"citing_paper":"/paper/2502.02988"},"observation_digest":"sha256:9e94c2da940f842f58580d48d8fcce3f71caad502d57eaf0a1a074fbff6875b2","observation_id":"474f3143-8449-4e7d-9abe-4fe56a3cbb6c","resolution":{"observed_at":"2026-08-09T10:26:07.050876Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:26:07.054391Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2502.02988","last_updated":"2025-02-05T08:35:55Z","snapshot_observed_at":"2026-08-09T19:33:12.301428Z","submitted_at":"2025-02-05T08:35:55Z","title":"Training an LLM-as-a-Judge Model: Pipeline, Insights, and Practical Lessons","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-09T10:26:07.054391Z"},"links":{"citing_paper":"/paper/2502.02988"},"observation_digest":"sha256:ac35d55050e6c7287b338342fcb9878f2a95c185f06179d986509520e4d5fd44","observation_id":"1385e0d1-96c9-44b5-a532-e660174ecd53","resolution":{"observed_at":"2026-08-09T10:26:07.054391Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:26:07.058052Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.02988","last_updated":"2025-02-05T08:35:55Z","snapshot_observed_at":"2026-08-09T19:33:12.301428Z","submitted_at":"2025-02-05T08:35:55Z","title":"Training an LLM-as-a-Judge Model: Pipeline, Insights, and Practical Lessons","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-09T10:26:07.058052Z"},"links":{"citing_paper":"/paper/2502.02988"},"observation_digest":"sha256:fc85bed4c097038ec15f13c1f0abf5fd64900118147f964ec587d609370094ac","observation_id":"a081cb06-f31d-42f6-9232-6a20dc5d78ef","resolution":{"observed_at":"2026-08-09T10:26:07.058052Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:26:07.061558Z","title":"3.Instruction compli- ance: The output should strictly follow the specific requirements of the instructions, including action steps and any constraints","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.02988","last_updated":"2025-02-05T08:35:55Z","snapshot_observed_at":"2026-08-09T19:33:12.301428Z","submitted_at":"2025-02-05T08:35:55Z","title":"Training an LLM-as-a-Judge Model: Pipeline, Insights, and Practical Lessons","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-09T10:26:07.061558Z"},"links":{"citing_paper":"/paper/2502.02988"},"observation_digest":"sha256:cdf138654f3227c8dfa52fc75a97d771a58f661913c32b112f2449b86ad9d714","observation_id":"e452ce85-2756-4dbe-b226-2ac1e1256bf9","resolution":{"observed_at":"2026-08-09T10:26:07.061558Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:26:07.064933Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.02988","last_updated":"2025-02-05T08:35:55Z","snapshot_observed_at":"2026-08-09T19:33:12.301428Z","submitted_at":"2025-02-05T08:35:55Z","title":"Training an LLM-as-a-Judge Model: Pipeline, Insights, and Practical Lessons","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-09T10:26:07.064933Z"},"links":{"citing_paper":"/paper/2502.02988"},"observation_digest":"sha256:b63b5cf325f369f8ec491cfb2fde8a03b2e2da22efdb4f75a846e225ed730808","observation_id":"2e46225c-6049-4568-817d-57d5cd8cd8b7","resolution":{"observed_at":"2026-08-09T10:26:07.064933Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:26:07.068681Z","title":"(9) Role-playing","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2502.02988","last_updated":"2025-02-05T08:35:55Z","snapshot_observed_at":"2026-08-09T19:33:12.301428Z","submitted_at":"2025-02-05T08:35:55Z","title":"Training an LLM-as-a-Judge Model: Pipeline, Insights, and Practical Lessons","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-09T10:26:07.068681Z"},"links":{"citing_paper":"/paper/2502.02988"},"observation_digest":"sha256:f44504937ab8b4df115ccdb2dcc917cae365e61db85b2efe818c55b61bedc552","observation_id":"8578f05c-7e30-4006-b069-2e162d1d0981","resolution":{"observed_at":"2026-08-09T10:26:07.068681Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:26:07.072732Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2502.02988","last_updated":"2025-02-05T08:35:55Z","snapshot_observed_at":"2026-08-09T19:33:12.301428Z","submitted_at":"2025-02-05T08:35:55Z","title":"Training an LLM-as-a-Judge Model: Pipeline, Insights, and Practical Lessons","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-09T10:26:07.072732Z"},"links":{"citing_paper":"/paper/2502.02988"},"observation_digest":"sha256:52de2d65b80714773817fa6f7ba9b81620d5f1fdc7468784bbaf321cf838e289","observation_id":"741285a0-f600-4d92-87e2-f91d2a239ee0","resolution":{"observed_at":"2026-08-09T10:26:07.072732Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:26:07.076622Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.02988","last_updated":"2025-02-05T08:35:55Z","snapshot_observed_at":"2026-08-09T19:33:12.301428Z","submitted_at":"2025-02-05T08:35:55Z","title":"Training an LLM-as-a-Judge Model: Pipeline, Insights, and Practical Lessons","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-09T10:26:07.076622Z"},"links":{"citing_paper":"/paper/2502.02988"},"observation_digest":"sha256:d409d7bab26eddb757f69b7aef49f8b1b8c0dbc7cc3a23d2302f9ab39f290336","observation_id":"6d9a6233-5b67-4724-899a-3605d6de5f27","resolution":{"observed_at":"2026-08-09T10:26:07.076622Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:26:07.080525Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.02988","last_updated":"2025-02-05T08:35:55Z","snapshot_observed_at":"2026-08-09T19:33:12.301428Z","submitted_at":"2025-02-05T08:35:55Z","title":"Training an LLM-as-a-Judge Model: Pipeline, Insights, and Practical Lessons","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-09T10:26:07.080525Z"},"links":{"citing_paper":"/paper/2502.02988"},"observation_digest":"sha256:92fc4d72c0e621c2f8aa4c9163cc660ed7ae5310661e508265383132b12ac0b2","observation_id":"158abd19-0ce3-40c9-b338-1e83da2ebcd4","resolution":{"observed_at":"2026-08-09T10:26:07.080525Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:26:07.084242Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.02988","last_updated":"2025-02-05T08:35:55Z","snapshot_observed_at":"2026-08-09T19:33:12.301428Z","submitted_at":"2025-02-05T08:35:55Z","title":"Training an LLM-as-a-Judge Model: Pipeline, Insights, and Practical Lessons","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-09T10:26:07.084242Z"},"links":{"citing_paper":"/paper/2502.02988"},"observation_digest":"sha256:468bc18ce8f9219bae350f531c30e148f53dec5ba305fa709a8b34b69edf8c79","observation_id":"dcc2aaa7-b9d5-4889-8098-81240d8e567e","resolution":{"observed_at":"2026-08-09T10:26:07.084242Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:26:07.087822Z","title":"The same output requirement and format as in Table 1","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.02988","last_updated":"2025-02-05T08:35:55Z","snapshot_observed_at":"2026-08-09T19:33:12.301428Z","submitted_at":"2025-02-05T08:35:55Z","title":"Training an LLM-as-a-Judge Model: Pipeline, Insights, and Practical Lessons","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-09T10:26:07.087822Z"},"links":{"citing_paper":"/paper/2502.02988"},"observation_digest":"sha256:cd7c539167c8261b80ff60f6b031b6508670ae188f02dab6c1ae96e002e129b2","observation_id":"35f1365f-ad6e-4aa5-bd0f-1b4ca5d1449f","resolution":{"observed_at":"2026-08-09T10:26:07.087822Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:26:07.091650Z","title":"Requirements for the scenario: Name: {scenario name } Definition: {scenario description } Reference Text: {reference text } Requirements:","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2502.02988","last_updated":"2025-02-05T08:35:55Z","snapshot_observed_at":"2026-08-09T19:33:12.301428Z","submitted_at":"2025-02-05T08:35:55Z","title":"Training an LLM-as-a-Judge Model: Pipeline, Insights, and Practical Lessons","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-09T10:26:07.091650Z"},"links":{"citing_paper":"/paper/2502.02988"},"observation_digest":"sha256:1ccb2077fb70a8f9de9e60806081b3e29d7abe4a63dfc98294a2e306326e4297","observation_id":"b51ba750-e9c9-4142-be8f-f013df2dd02f","resolution":{"observed_at":"2026-08-09T10:26:07.091650Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:26:07.095181Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.02988","last_updated":"2025-02-05T08:35:55Z","snapshot_observed_at":"2026-08-09T19:33:12.301428Z","submitted_at":"2025-02-05T08:35:55Z","title":"Training an LLM-as-a-Judge Model: Pipeline, Insights, and Practical Lessons","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-09T10:26:07.095181Z"},"links":{"citing_paper":"/paper/2502.02988"},"observation_digest":"sha256:d93b0d33b8830f9fc9f53f6310996699e9e06aef0d39a6793d731752c80f06c0","observation_id":"82af8738-c8e6-4739-a06e-fb9b18e8edb6","resolution":{"observed_at":"2026-08-09T10:26:07.095181Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:26:07.099401Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.02988","last_updated":"2025-02-05T08:35:55Z","snapshot_observed_at":"2026-08-09T19:33:12.301428Z","submitted_at":"2025-02-05T08:35:55Z","title":"Training an LLM-as-a-Judge Model: Pipeline, Insights, and Practical Lessons","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-09T10:26:07.099401Z"},"links":{"citing_paper":"/paper/2502.02988"},"observation_digest":"sha256:c6f1674b88a3e6d07d41f792853fc96639a961f52756ae7fee68bf8352b6fbda","observation_id":"578cf78f-f429-43c2-9a05-ba66a0076001","resolution":{"observed_at":"2026-08-09T10:26:07.099401Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:26:07.103621Z","title":"Sorry, this article does not contain enough information related to {scenario name } to generate relevant questions and answers","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.02988","last_updated":"2025-02-05T08:35:55Z","snapshot_observed_at":"2026-08-09T19:33:12.301428Z","submitted_at":"2025-02-05T08:35:55Z","title":"Training an LLM-as-a-Judge Model: Pipeline, Insights, and Practical Lessons","version":1},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-09T10:26:07.103621Z"},"links":{"citing_paper":"/paper/2502.02988"},"observation_digest":"sha256:6a098c047cee70c72e38d20e92ba692f7b944bc15ebb64f366b2e48dfab87aee","observation_id":"d6fd51ea-6759-4f9c-b3a6-83a42bbb3aa3","resolution":{"observed_at":"2026-08-09T10:26:07.103621Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:26:07.107062Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.02988","last_updated":"2025-02-05T08:35:55Z","snapshot_observed_at":"2026-08-09T19:33:12.301428Z","submitted_at":"2025-02-05T08:35:55Z","title":"Training an LLM-as-a-Judge Model: Pipeline, Insights, and Practical Lessons","version":1},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-09T10:26:07.107062Z"},"links":{"citing_paper":"/paper/2502.02988"},"observation_digest":"sha256:0ab4faee5876af30ab84fbb4896d4b0310d64457b300d02004c18e58c07d605b","observation_id":"41963ea3-372d-48d4-a8c9-70b3ad72f2ea","resolution":{"observed_at":"2026-08-09T10:26:07.107062Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:26:07.110270Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.02988","last_updated":"2025-02-05T08:35:55Z","snapshot_observed_at":"2026-08-09T19:33:12.301428Z","submitted_at":"2025-02-05T08:35:55Z","title":"Training an LLM-as-a-Judge Model: Pipeline, Insights, and Practical Lessons","version":1},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-09T10:26:07.110270Z"},"links":{"citing_paper":"/paper/2502.02988"},"observation_digest":"sha256:1a1bca8b6728c385f34e433786727ff718112254a6a7609bcc8ca3f17571323b","observation_id":"27935d7d-3675-4a21-9ae0-52f3815b7045","resolution":{"observed_at":"2026-08-09T10:26:07.110270Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:26:07.113484Z","title":"question","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2502.02988","last_updated":"2025-02-05T08:35:55Z","snapshot_observed_at":"2026-08-09T19:33:12.301428Z","submitted_at":"2025-02-05T08:35:55Z","title":"Training an LLM-as-a-Judge Model: Pipeline, Insights, and Practical Lessons","version":1},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-09T10:26:07.113484Z"},"links":{"citing_paper":"/paper/2502.02988"},"observation_digest":"sha256:fd8503a8246eab0ac3a5facc17d4234c4ca9a6941ba9f05a609a5a889ea3a1e1","observation_id":"42f63cfa-5dd8-4e39-91e2-a427376ebdb1","resolution":{"observed_at":"2026-08-09T10:26:07.113484Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:26:07.116888Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.02988","last_updated":"2025-02-05T08:35:55Z","snapshot_observed_at":"2026-08-09T19:33:12.301428Z","submitted_at":"2025-02-05T08:35:55Z","title":"Training an LLM-as-a-Judge Model: Pipeline, Insights, and Practical Lessons","version":1},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-08-09T10:26:07.116888Z"},"links":{"citing_paper":"/paper/2502.02988"},"observation_digest":"sha256:37aca77ce12e1decc47881dde938ff2214ef1263ad69337bd26f1e7e73285f52","observation_id":"a033202f-2a09-44b6-8d0d-5fcaf05cbf35","resolution":{"observed_at":"2026-08-09T10:26:07.116888Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:26:07.120376Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.02988","last_updated":"2025-02-05T08:35:55Z","snapshot_observed_at":"2026-08-09T19:33:12.301428Z","submitted_at":"2025-02-05T08:35:55Z","title":"Training an LLM-as-a-Judge Model: Pipeline, Insights, and Practical Lessons","version":1},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-08-09T10:26:07.120376Z"},"links":{"citing_paper":"/paper/2502.02988"},"observation_digest":"sha256:bf046581e387f45cff014fd3abf5bf8937706b84a61823b3bc1b951c2294d29f","observation_id":"da25a752-bb6c-40f8-acaf-29464a326859","resolution":{"observed_at":"2026-08-09T10:26:07.120376Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:26:07.123609Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.02988","last_updated":"2025-02-05T08:35:55Z","snapshot_observed_at":"2026-08-09T19:33:12.301428Z","submitted_at":"2025-02-05T08:35:55Z","title":"Training an LLM-as-a-Judge Model: Pipeline, Insights, and Practical Lessons","version":1},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-08-09T10:26:07.123609Z"},"links":{"citing_paper":"/paper/2502.02988"},"observation_digest":"sha256:4cd180ba02155f1d302a1196d0b28ff41129c81974048d73c2c08466c0eb4526","observation_id":"b71bebb5-c71d-4127-a373-ddd457bf2a1e","resolution":{"observed_at":"2026-08-09T10:26:07.123609Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:26:07.127171Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.02988","last_updated":"2025-02-05T08:35:55Z","snapshot_observed_at":"2026-08-09T19:33:12.301428Z","submitted_at":"2025-02-05T08:35:55Z","title":"Training an LLM-as-a-Judge Model: Pipeline, Insights, and Practical Lessons","version":1},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-08-09T10:26:07.127171Z"},"links":{"citing_paper":"/paper/2502.02988"},"observation_digest":"sha256:1d7e6fc39ae19e0d45b8ba698b0f5659542f9b28bd5ba5eb6176eaa3b7c5b2c0","observation_id":"4b9b8cf7-ef28-408b-b5ca-60c90db9940f","resolution":{"observed_at":"2026-08-09T10:26:07.127171Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:26:08.105846Z","title":null,"venue":null,"work_id":"5591c386-a133-42e9-af24-121abc425a03","year":null},"citing_paper":{"arxiv_id":"2502.02988","last_updated":"2025-02-05T08:35:55Z","snapshot_observed_at":"2026-08-09T19:33:12.301428Z","submitted_at":"2025-02-05T08:35:55Z","title":"Training an LLM-as-a-Judge Model: Pipeline, Insights, and Practical Lessons","version":1},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-08-09T10:26:07.130463Z"},"links":{"citing_paper":"/paper/2502.02988"},"observation_digest":"sha256:d25059402af4c9eb06848b44ba261c7cb17bd46bbec03f51486bd334bd3b8388","observation_id":"2d0f0a54-ae8e-48c0-ab30-f024d5bb9eb7","resolution":{"observed_at":"2026-08-09T10:26:08.109294Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:26:08.096188Z","title":null,"venue":null,"work_id":"d76ab787-7f2c-4710-8687-47b7a17f0eb9","year":null},"citing_paper":{"arxiv_id":"2502.02988","last_updated":"2025-02-05T08:35:55Z","snapshot_observed_at":"2026-08-09T19:33:12.301428Z","submitted_at":"2025-02-05T08:35:55Z","title":"Training an LLM-as-a-Judge Model: Pipeline, Insights, and Practical Lessons","version":1},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-08-09T10:26:07.133915Z"},"links":{"citing_paper":"/paper/2502.02988"},"observation_digest":"sha256:6ad767db6225ae0b25898bd881ab6ced3befe9a56c6809247337fff1fe7f4181","observation_id":"419b57d7-70fc-400e-9868-716ac2a79fcb","resolution":{"observed_at":"2026-08-09T10:26:08.099447Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:26:08.085766Z","title":null,"venue":null,"work_id":"f963d72a-9b74-4834-92b2-1c315c320cc1","year":null},"citing_paper":{"arxiv_id":"2502.02988","last_updated":"2025-02-05T08:35:55Z","snapshot_observed_at":"2026-08-09T19:33:12.301428Z","submitted_at":"2025-02-05T08:35:55Z","title":"Training an LLM-as-a-Judge Model: Pipeline, Insights, and Practical Lessons","version":1},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-08-09T10:26:07.137261Z"},"links":{"citing_paper":"/paper/2502.02988"},"observation_digest":"sha256:8f7358690d4839147bfe8b6c30c226458dd108fa8ea75477d782909443b01ed1","observation_id":"8fba1f61-0ca7-4ffa-bce1-ef08edc05161","resolution":{"observed_at":"2026-08-09T10:26:08.089628Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:26:08.075889Z","title":null,"venue":null,"work_id":"c621ff20-42bf-4dd9-af29-0b3c9b7e14b0","year":null},"citing_paper":{"arxiv_id":"2502.02988","last_updated":"2025-02-05T08:35:55Z","snapshot_observed_at":"2026-08-09T19:33:12.301428Z","submitted_at":"2025-02-05T08:35:55Z","title":"Training an LLM-as-a-Judge Model: Pipeline, Insights, and Practical Lessons","version":1},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-08-09T10:26:07.140462Z"},"links":{"citing_paper":"/paper/2502.02988"},"observation_digest":"sha256:bfc79a6f972d4f80bb95d2317e2018219d659bf75b188bfc71020d3166992a2d","observation_id":"d6f5a985-953c-453f-8a91-64ff1daeb949","resolution":{"observed_at":"2026-08-09T10:26:08.079165Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:26:08.066261Z","title":null,"venue":null,"work_id":"1bfe148c-b49b-458f-9035-6e80fbe4b942","year":null},"citing_paper":{"arxiv_id":"2502.02988","last_updated":"2025-02-05T08:35:55Z","snapshot_observed_at":"2026-08-09T19:33:12.301428Z","submitted_at":"2025-02-05T08:35:55Z","title":"Training an LLM-as-a-Judge Model: Pipeline, Insights, and Practical Lessons","version":1},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-08-09T10:26:07.143846Z"},"links":{"citing_paper":"/paper/2502.02988"},"observation_digest":"sha256:8de9307c8520674ff4f81944bbd75a03c66caf738defddeeec290b5f546b724f","observation_id":"5a6415ea-619f-42cc-ad9c-7c47c787752a","resolution":{"observed_at":"2026-08-09T10:26:08.069611Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:26:08.056146Z","title":"answering mathematical questions","venue":null,"work_id":"5d27adf6-0ee8-4b7f-b58d-420405e71ef9","year":2025},"citing_paper":{"arxiv_id":"2502.02988","last_updated":"2025-02-05T08:35:55Z","snapshot_observed_at":"2026-08-09T19:33:12.301428Z","submitted_at":"2025-02-05T08:35:55Z","title":"Training an LLM-as-a-Judge Model: Pipeline, Insights, and Practical Lessons","version":1},"reference_index":88,"source":"pdf_text","source_observed_at":"2026-08-09T10:26:07.147208Z"},"links":{"citing_paper":"/paper/2502.02988"},"observation_digest":"sha256:2e2661b5f0b7acda03a3db54a140619a90008d1a9ff171b706494359a78af948","observation_id":"7d92f8d6-27bf-4b39-85eb-919b89c6d79e","resolution":{"observed_at":"2026-08-09T10:26:08.059991Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:26:08.046847Z","title":null,"venue":null,"work_id":"e5283af6-8528-4cdc-a9e8-dcfed390c4cf","year":null},"citing_paper":{"arxiv_id":"2502.02988","last_updated":"2025-02-05T08:35:55Z","snapshot_observed_at":"2026-08-09T19:33:12.301428Z","submitted_at":"2025-02-05T08:35:55Z","title":"Training an LLM-as-a-Judge Model: Pipeline, Insights, and Practical Lessons","version":1},"reference_index":89,"source":"pdf_text","source_observed_at":"2026-08-09T10:26:07.150817Z"},"links":{"citing_paper":"/paper/2502.02988"},"observation_digest":"sha256:f6497d5192bdc03b8feaf43622183dcf360c0e99d2f2d101149b03227eea44ef","observation_id":"2f0e63f4-6606-4498-8e80-5be63eda0730","resolution":{"observed_at":"2026-08-09T10:26:08.049961Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:26:08.037178Z","title":null,"venue":null,"work_id":"383739e0-45eb-497e-bfaa-adead304f097","year":null},"citing_paper":{"arxiv_id":"2502.02988","last_updated":"2025-02-05T08:35:55Z","snapshot_observed_at":"2026-08-09T19:33:12.301428Z","submitted_at":"2025-02-05T08:35:55Z","title":"Training an LLM-as-a-Judge Model: Pipeline, Insights, and Practical Lessons","version":1},"reference_index":90,"source":"pdf_text","source_observed_at":"2026-08-09T10:26:07.154679Z"},"links":{"citing_paper":"/paper/2502.02988"},"observation_digest":"sha256:f1702818f4ab9fccf48f9e1b6efa4e5484ed7a8ad803c1fc1792f2271a9bdbea","observation_id":"bee8ab36-431f-4d95-a01c-d69b02d92d48","resolution":{"observed_at":"2026-08-09T10:26:08.040625Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:26:08.027796Z","title":null,"venue":null,"work_id":"d8d8a8b1-fe08-4447-9207-c9935c16ed1d","year":null},"citing_paper":{"arxiv_id":"2502.02988","last_updated":"2025-02-05T08:35:55Z","snapshot_observed_at":"2026-08-09T19:33:12.301428Z","submitted_at":"2025-02-05T08:35:55Z","title":"Training an LLM-as-a-Judge Model: Pipeline, Insights, and Practical Lessons","version":1},"reference_index":91,"source":"pdf_text","source_observed_at":"2026-08-09T10:26:07.158121Z"},"links":{"citing_paper":"/paper/2502.02988"},"observation_digest":"sha256:26e101ac2de5b3b019be78b44f6aff3b62b01610ec7cf400f9048bb403a3fadc","observation_id":"77247908-1df8-488d-9bca-d5aeaf148899","resolution":{"observed_at":"2026-08-09T10:26:08.030964Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:26:08.018470Z","title":null,"venue":null,"work_id":"82b16ab7-b461-47fe-b869-35aa0ebee33b","year":null},"citing_paper":{"arxiv_id":"2502.02988","last_updated":"2025-02-05T08:35:55Z","snapshot_observed_at":"2026-08-09T19:33:12.301428Z","submitted_at":"2025-02-05T08:35:55Z","title":"Training an LLM-as-a-Judge Model: Pipeline, Insights, and Practical Lessons","version":1},"reference_index":92,"source":"pdf_text","source_observed_at":"2026-08-09T10:26:07.161630Z"},"links":{"citing_paper":"/paper/2502.02988"},"observation_digest":"sha256:42efa9ef8b33c17897f2c0f147636ae333308787e04bbc5ca8df180997557b1b","observation_id":"ad00961e-cbf8-4957-be63-01bf446f8a09","resolution":{"observed_at":"2026-08-09T10:26:08.021706Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:26:08.008771Z","title":null,"venue":null,"work_id":"50e0eada-a5e3-4349-937e-26afbca7b4cf","year":null},"citing_paper":{"arxiv_id":"2502.02988","last_updated":"2025-02-05T08:35:55Z","snapshot_observed_at":"2026-08-09T19:33:12.301428Z","submitted_at":"2025-02-05T08:35:55Z","title":"Training an LLM-as-a-Judge Model: Pipeline, Insights, and Practical Lessons","version":1},"reference_index":93,"source":"pdf_text","source_observed_at":"2026-08-09T10:26:07.165059Z"},"links":{"citing_paper":"/paper/2502.02988"},"observation_digest":"sha256:09cae3f7e5e82a7a4c843bdc3a41fdc3bc9ff4e05fd8a5d8c66025509a0cad8a","observation_id":"ba33ef3a-c86e-445a-a03e-f93ddd0c2eea","resolution":{"observed_at":"2026-08-09T10:26:08.011969Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:26:07.998904Z","title":null,"venue":null,"work_id":"f363d98d-f1c2-47ff-96cc-29acf84fe2b8","year":null},"citing_paper":{"arxiv_id":"2502.02988","last_updated":"2025-02-05T08:35:55Z","snapshot_observed_at":"2026-08-09T19:33:12.301428Z","submitted_at":"2025-02-05T08:35:55Z","title":"Training an LLM-as-a-Judge Model: Pipeline, Insights, and Practical Lessons","version":1},"reference_index":94,"source":"pdf_text","source_observed_at":"2026-08-09T10:26:07.168408Z"},"links":{"citing_paper":"/paper/2502.02988"},"observation_digest":"sha256:40b9c354eb96f0ed787c2376e74e50f9c78d71966bf53c6e3cc12b165c87fc2f","observation_id":"4a783726-0f8b-45b7-997f-45b635ae97d6","resolution":{"observed_at":"2026-08-09T10:26:08.002138Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:26:07.989195Z","title":"answering mathematical questions","venue":null,"work_id":"e514409e-a695-43be-b4e9-893c40c08949","year":null},"citing_paper":{"arxiv_id":"2502.02988","last_updated":"2025-02-05T08:35:55Z","snapshot_observed_at":"2026-08-09T19:33:12.301428Z","submitted_at":"2025-02-05T08:35:55Z","title":"Training an LLM-as-a-Judge Model: Pipeline, Insights, and Practical Lessons","version":1},"reference_index":95,"source":"pdf_text","source_observed_at":"2026-08-09T10:26:07.171943Z"},"links":{"citing_paper":"/paper/2502.02988"},"observation_digest":"sha256:e9f98bef225ad7144e29ef3e140f6e1e59bf98eb6039fee24817e2e6cf358b89","observation_id":"b5e25f44-9539-4884-a32d-ef4e0143c4a9","resolution":{"observed_at":"2026-08-09T10:26:07.992644Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:26:07.979390Z","title":null,"venue":null,"work_id":"41f55480-0f38-41b8-a8b5-a5c2e1da5faf","year":null},"citing_paper":{"arxiv_id":"2502.02988","last_updated":"2025-02-05T08:35:55Z","snapshot_observed_at":"2026-08-09T19:33:12.301428Z","submitted_at":"2025-02-05T08:35:55Z","title":"Training an LLM-as-a-Judge Model: Pipeline, Insights, and Practical Lessons","version":1},"reference_index":96,"source":"pdf_text","source_observed_at":"2026-08-09T10:26:07.175557Z"},"links":{"citing_paper":"/paper/2502.02988"},"observation_digest":"sha256:ec8cf2cf0c36fb9732d671a26dba1a30b8963cc0ad808ecaf477ed1b2289b62e","observation_id":"82c591b6-5a96-46c1-a092-56d85dfb17cc","resolution":{"observed_at":"2026-08-09T10:26:07.982876Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:26:07.969473Z","title":null,"venue":null,"work_id":"71963a7e-57f3-4a7f-8c37-318854828fe8","year":null},"citing_paper":{"arxiv_id":"2502.02988","last_updated":"2025-02-05T08:35:55Z","snapshot_observed_at":"2026-08-09T19:33:12.301428Z","submitted_at":"2025-02-05T08:35:55Z","title":"Training an LLM-as-a-Judge Model: Pipeline, Insights, and Practical Lessons","version":1},"reference_index":97,"source":"pdf_text","source_observed_at":"2026-08-09T10:26:07.179032Z"},"links":{"citing_paper":"/paper/2502.02988"},"observation_digest":"sha256:5b972b3d4e29c959ad5c1a4262426c204c67bb92c7d0c7782f54d9b8fe87433f","observation_id":"6b597b12-3ee6-46d2-846b-c291354a95d4","resolution":{"observed_at":"2026-08-09T10:26:07.973017Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:26:07.959365Z","title":null,"venue":null,"work_id":"4075b0d8-20c1-419a-b61b-519902bd22ef","year":null},"citing_paper":{"arxiv_id":"2502.02988","last_updated":"2025-02-05T08:35:55Z","snapshot_observed_at":"2026-08-09T19:33:12.301428Z","submitted_at":"2025-02-05T08:35:55Z","title":"Training an LLM-as-a-Judge Model: Pipeline, Insights, and Practical Lessons","version":1},"reference_index":98,"source":"pdf_text","source_observed_at":"2026-08-09T10:26:07.182542Z"},"links":{"citing_paper":"/paper/2502.02988"},"observation_digest":"sha256:ff382457b20332a6f61c79886511c72414430be41cf61d71a69968698d527970","observation_id":"d5f4c378-aaa6-404d-a1ff-5b99e76dc791","resolution":{"observed_at":"2026-08-09T10:26:07.962812Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:26:07.949661Z","title":"Think carefully for a moment, then give your conclusion","venue":null,"work_id":"20c2a26c-2078-476d-86a9-109e888140b0","year":null},"citing_paper":{"arxiv_id":"2502.02988","last_updated":"2025-02-05T08:35:55Z","snapshot_observed_at":"2026-08-09T19:33:12.301428Z","submitted_at":"2025-02-05T08:35:55Z","title":"Training an LLM-as-a-Judge Model: Pipeline, Insights, and Practical Lessons","version":1},"reference_index":99,"source":"pdf_text","source_observed_at":"2026-08-09T10:26:07.185935Z"},"links":{"citing_paper":"/paper/2502.02988"},"observation_digest":"sha256:43ea589cd9c440467b53025a3e7fb4d65dd829ccb48652091c273d52ac688e0b","observation_id":"905e1a75-c732-4d9b-b8a0-d610f199af37","resolution":{"observed_at":"2026-08-09T10:26:07.953122Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:26:07.939373Z","title":null,"venue":null,"work_id":"2f7022a1-5c4b-4005-9460-d3fde28ccef7","year":null},"citing_paper":{"arxiv_id":"2502.02988","last_updated":"2025-02-05T08:35:55Z","snapshot_observed_at":"2026-08-09T19:33:12.301428Z","submitted_at":"2025-02-05T08:35:55Z","title":"Training an LLM-as-a-Judge Model: Pipeline, Insights, and Practical Lessons","version":1},"reference_index":100,"source":"pdf_text","source_observed_at":"2026-08-09T10:26:07.189312Z"},"links":{"citing_paper":"/paper/2502.02988"},"observation_digest":"sha256:4e5fdca819abc6cfe561d0587254b6a29bf2197bf885552ffecac753ed56c5d3","observation_id":"a0bf0c0e-4abe-4396-b4e5-128b6049f4b9","resolution":{"observed_at":"2026-08-09T10:26:07.943013Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:26:07.928601Z","title":"GPT-4’s response I believe the overall rating for this reply is [[1]] for the following reasons: Advantages of the current reply:","venue":null,"work_id":"1683aca0-375f-4cfd-bbb2-23630c3f7147","year":2025},"citing_paper":{"arxiv_id":"2502.02988","last_updated":"2025-02-05T08:35:55Z","snapshot_observed_at":"2026-08-09T19:33:12.301428Z","submitted_at":"2025-02-05T08:35:55Z","title":"Training an LLM-as-a-Judge Model: Pipeline, Insights, and Practical Lessons","version":1},"reference_index":101,"source":"pdf_text","source_observed_at":"2026-08-09T10:26:07.192887Z"},"links":{"citing_paper":"/paper/2502.02988"},"observation_digest":"sha256:03ba5819d1f3919870fad35a576508aee6679a95c8eec192ad5a6a98878acd6d","observation_id":"b8cfcbf2-c3c9-4af4-897f-8e72c222cebc","resolution":{"observed_at":"2026-08-09T10:26:07.933203Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:26:07.917614Z","title":"[[3]] Shortcomings of the current reply:","venue":null,"work_id":"dfb89844-845f-4fc1-b6ef-7c78f2c667d8","year":null},"citing_paper":{"arxiv_id":"2502.02988","last_updated":"2025-02-05T08:35:55Z","snapshot_observed_at":"2026-08-09T19:33:12.301428Z","submitted_at":"2025-02-05T08:35:55Z","title":"Training an LLM-as-a-Judge Model: Pipeline, Insights, and Practical Lessons","version":1},"reference_index":102,"source":"pdf_text","source_observed_at":"2026-08-09T10:26:07.196148Z"},"links":{"citing_paper":"/paper/2502.02988"},"observation_digest":"sha256:cb235c508135b0871ace5268462f0eaf5014775a89462f8a0b44220887812bd0","observation_id":"26c1c9bf-8dc7-4568-bb35-c477c232a335","resolution":{"observed_at":"2026-08-09T10:26:07.921431Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2502.02988","last_updated":"2025-02-05T08:35:55Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-09T19:33:12.301428Z","submitted_at":"2025-02-05T08:35:55Z","title":"Training an LLM-as-a-Judge Model: Pipeline, Insights, and Practical Lessons"},"reference_resolution":{"displayed":100,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":94,"verified_exact":1,"verified_fuzzy":5},"total_outbound_references":127},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 100 of 127 outbound references and 1 inbound Pith citation observation for arXiv:2502.02988."}