{"as_of":"2026-08-06T06:15:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:ad36a44906cff0ce62d1d7aca407bd9e629b2e87cb20013b0978015386b42a5f","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":12,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":12,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-05T06:32:48.257954+00:00","state":"measured"},{"denominator":12,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":12,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T23:06:49.698152Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"arxiv_reference","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":2,"observed_at":"2026-08-05T02:28:24.338817Z","source":"arxiv_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2407.19594","last_updated":"2024-07-30T01:38:06Z","snapshot_observed_at":"2026-07-06T18:53:00.965448Z","submitted_at":"2024-07-28T21:58:28Z","title":"Meta-Rewarding Language Models: Self-Improving Alignment with LLM-as-a-Meta-Judge","version":2},"cited_work":{"arxiv_id":"2407.19594","doi":"10.48550/arxiv.2407.19594","metadata_source":"arxiv_reference","pith_arxiv_id":"2407.19594","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"CoRR , volume =","venue":"arXiv (Cornell University)","work_id":"39d1c338-cf2d-4782-ac04-5fa28470bef1","year":2024},"citing_paper":{"arxiv_id":"2412.05579","last_updated":"2024-12-10T05:49:12Z","snapshot_observed_at":"2026-07-31T01:42:39.468673Z","submitted_at":"2024-12-07T08:07:24Z","title":"LLMs-as-Judges: A Comprehensive Survey on LLM-based Evaluation Methods","version":2},"reference_index":254,"source":"pdf_text","source_observed_at":"2026-05-11T23:08:34.312466Z"},"links":{"cited_paper":"/paper/2407.19594","citing_paper":"/paper/2412.05579"},"observation_digest":"sha256:7f9974a3d753e054e1d47fc8693dbc55b92be76771bbe301da3ae5596995e35e","observation_id":"ca078fb9-faad-404f-8986-e3a52e6b7170","resolution":{"observed_at":"2026-05-11T23:08:35.709019Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.19594","last_updated":"2024-07-30T01:38:06Z","snapshot_observed_at":"2026-07-06T18:53:00.965448Z","submitted_at":"2024-07-28T21:58:28Z","title":"Meta-Rewarding Language Models: Self-Improving Alignment with LLM-as-a-Meta-Judge","version":2},"cited_work":{"arxiv_id":"2407.19594","doi":"10.48550/arxiv.2407.19594","metadata_source":"arxiv_reference","pith_arxiv_id":"2407.19594","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"CoRR , volume =","venue":"arXiv (Cornell University)","work_id":"39d1c338-cf2d-4782-ac04-5fa28470bef1","year":2024},"citing_paper":{"arxiv_id":"2502.03387","last_updated":"2025-07-29T16:23:02Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-05T17:23:45Z","title":"LIMO: Less is More for Reasoning","version":3},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-05-17T02:11:36.932541Z"},"links":{"cited_paper":"/paper/2407.19594","citing_paper":"/paper/2502.03387"},"observation_digest":"sha256:98fa8e69566127563bd08cf1e8cc9d8e5b09d31c919ce7442d2199eb51f26f80","observation_id":"52402e35-8588-418a-9cd3-f34ca807c882","resolution":{"observed_at":"2026-05-17T02:11:37.211488Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.19594","last_updated":"2024-07-30T01:38:06Z","snapshot_observed_at":"2026-07-06T18:53:00.965448Z","submitted_at":"2024-07-28T21:58:28Z","title":"Meta-Rewarding Language Models: Self-Improving Alignment with LLM-as-a-Meta-Judge","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.19594","snapshot_observed_at":"2026-08-05T23:06:49.698152Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.06026","last_updated":"2025-08-08T05:25:54Z","snapshot_observed_at":"2026-08-05T23:06:47.763233Z","submitted_at":"2025-08-08T05:25:54Z","title":"Temporal Self-Rewarding Language Models: Decoupling Chosen-Rejected via Past-Future","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-05T23:06:49.698152Z"},"links":{"cited_paper":"/paper/2407.19594","citing_paper":"/paper/2508.06026"},"observation_digest":"sha256:0649e8958bf75274f4a0aa81c9eed3bc53fe3229e661e68a11611813bebf24b2","observation_id":"71b2bf67-f471-482f-ba00-5427082fa2ee","resolution":{"observed_at":"2026-08-05T23:06:49.698152Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.19594","last_updated":"2024-07-30T01:38:06Z","snapshot_observed_at":"2026-07-06T18:53:00.965448Z","submitted_at":"2024-07-28T21:58:28Z","title":"Meta-Rewarding Language Models: Self-Improving Alignment with LLM-as-a-Meta-Judge","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.19594","snapshot_observed_at":"2026-08-05T22:54:25.666027Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.06225","last_updated":"2025-08-18T12:00:32Z","snapshot_observed_at":"2026-08-05T22:54:04.098120Z","submitted_at":"2025-08-08T11:11:22Z","title":"Overconfidence in LLM-as-a-Judge: Diagnosis and Confidence-Driven Solution","version":3},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-05T22:54:25.666027Z"},"links":{"cited_paper":"/paper/2407.19594","citing_paper":"/paper/2508.06225"},"observation_digest":"sha256:d0a07c10e764513cfa260b578e40d8c35c52d17512af371b91205e0d1c51a23b","observation_id":"c4ab6dcc-ad00-4bb4-8283-79b3df2fef12","resolution":{"observed_at":"2026-08-05T22:54:25.666027Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.19594","last_updated":"2024-07-30T01:38:06Z","snapshot_observed_at":"2026-07-06T18:53:00.965448Z","submitted_at":"2024-07-28T21:58:28Z","title":"Meta-Rewarding Language Models: Self-Improving Alignment with LLM-as-a-Meta-Judge","version":2},"cited_work":{"arxiv_id":"2407.19594","doi":"10.48550/arxiv.2407.19594","metadata_source":"arxiv_reference","pith_arxiv_id":"2407.19594","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"CoRR , volume =","venue":"arXiv (Cornell University)","work_id":"39d1c338-cf2d-4782-ac04-5fa28470bef1","year":2024},"citing_paper":{"arxiv_id":"2512.23213","last_updated":"2026-04-25T15:41:44Z","snapshot_observed_at":"2026-08-02T22:41:07.172721Z","submitted_at":"2025-12-29T05:25:49Z","title":"Scoring, Reasoning, and Selecting the Best! Ensembling Large Language Models via a Peer-Review Process","version":3},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-05-16T19:57:03.999154Z"},"links":{"cited_paper":"/paper/2407.19594","citing_paper":"/paper/2512.23213"},"observation_digest":"sha256:bdc95f3d94aaeade35157cba54cf930e4bb6c8c795056d6ca842b105a3165694","observation_id":"388d9b6e-b63c-45f9-90f4-387e4da831d4","resolution":{"observed_at":"2026-05-16T19:58:22.687864Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.19594","last_updated":"2024-07-30T01:38:06Z","snapshot_observed_at":"2026-07-06T18:53:00.965448Z","submitted_at":"2024-07-28T21:58:28Z","title":"Meta-Rewarding Language Models: Self-Improving Alignment with LLM-as-a-Meta-Judge","version":2},"cited_work":{"arxiv_id":"2407.19594","doi":"10.48550/arxiv.2407.19594","metadata_source":"arxiv_reference","pith_arxiv_id":"2407.19594","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"CoRR , volume =","venue":"arXiv (Cornell University)","work_id":"39d1c338-cf2d-4782-ac04-5fa28470bef1","year":2024},"citing_paper":{"arxiv_id":"2604.03993","last_updated":"2026-04-05T06:30:50Z","snapshot_observed_at":"2026-07-06T22:53:01.835843Z","submitted_at":"2026-04-05T06:30:50Z","title":"Can LLMs Learn to Reason Robustly under Noisy Supervision?","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-13T16:58:42.129870Z"},"links":{"cited_paper":"/paper/2407.19594","citing_paper":"/paper/2604.03993"},"observation_digest":"sha256:3b058661ad2411d0c24931963ceb878048ff21172c4aa26018bef31b219df64b","observation_id":"03b422e5-c77a-4319-b3bd-13d999609f2d","resolution":{"observed_at":"2026-05-13T17:08:01.288616Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.19594","last_updated":"2024-07-30T01:38:06Z","snapshot_observed_at":"2026-07-06T18:53:00.965448Z","submitted_at":"2024-07-28T21:58:28Z","title":"Meta-Rewarding Language Models: Self-Improving Alignment with LLM-as-a-Meta-Judge","version":2},"cited_work":{"arxiv_id":"2407.19594","doi":"10.48550/arxiv.2407.19594","metadata_source":"arxiv_reference","pith_arxiv_id":"2407.19594","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"CoRR , volume =","venue":"arXiv (Cornell University)","work_id":"39d1c338-cf2d-4782-ac04-5fa28470bef1","year":2024},"citing_paper":{"arxiv_id":"2604.22597","last_updated":"2026-04-24T14:25:01Z","snapshot_observed_at":"2026-07-06T23:08:56.419589Z","submitted_at":"2026-04-24T14:25:01Z","title":"Rethinking Math Reasoning Evaluation: A Robust LLM-as-a-Judge Framework Beyond Symbolic Rigidity","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-05-08T11:45:54.181019Z"},"links":{"cited_paper":"/paper/2407.19594","citing_paper":"/paper/2604.22597"},"observation_digest":"sha256:0ee2d27140dc0e62090c507277c8c627969db405d4ccc28c6f215ff9e50eb3d5","observation_id":"fcf5096a-b107-46f8-ab63-0b466d348d59","resolution":{"observed_at":"2026-05-11T19:31:09.407696Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.19594","last_updated":"2024-07-30T01:38:06Z","snapshot_observed_at":"2026-07-06T18:53:00.965448Z","submitted_at":"2024-07-28T21:58:28Z","title":"Meta-Rewarding Language Models: Self-Improving Alignment with LLM-as-a-Meta-Judge","version":2},"cited_work":{"arxiv_id":"2407.19594","doi":"10.48550/arxiv.2407.19594","metadata_source":"arxiv_reference","pith_arxiv_id":"2407.19594","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"CoRR , volume =","venue":"arXiv (Cornell University)","work_id":"39d1c338-cf2d-4782-ac04-5fa28470bef1","year":2024},"citing_paper":{"arxiv_id":"2606.00424","last_updated":"2026-05-29T23:21:48Z","snapshot_observed_at":"2026-08-02T07:23:01.039858Z","submitted_at":"2026-05-29T23:21:48Z","title":"Weak Critics Make Strong Learners: On-Policy Critique Distillation for Scalable Oversight","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-06-28T21:55:58.645062Z"},"links":{"cited_paper":"/paper/2407.19594","citing_paper":"/paper/2606.00424"},"observation_digest":"sha256:1f0bcf63547308ed3262ad6586e865db828c85ff66ca15791d717abb7a981e00","observation_id":"8da6dbac-c112-4210-853b-3ca4df8d9d87","resolution":{"observed_at":"2026-07-01T19:56:10.972571Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.19594","last_updated":"2024-07-30T01:38:06Z","snapshot_observed_at":"2026-07-06T18:53:00.965448Z","submitted_at":"2024-07-28T21:58:28Z","title":"Meta-Rewarding Language Models: Self-Improving Alignment with LLM-as-a-Meta-Judge","version":2},"cited_work":{"arxiv_id":"2407.19594","doi":"10.48550/arxiv.2407.19594","metadata_source":"arxiv_reference","pith_arxiv_id":"2407.19594","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"CoRR , volume =","venue":"arXiv (Cornell University)","work_id":"39d1c338-cf2d-4782-ac04-5fa28470bef1","year":2024},"citing_paper":{"arxiv_id":"2606.01249","last_updated":"2026-06-17T04:44:10Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-05-31T14:04:51Z","title":"Trust Region On-Policy Distillation","version":3},"reference_index":76,"source":"arxiv_source","source_observed_at":"2026-06-28T17:38:50.313305Z"},"links":{"cited_paper":"/paper/2407.19594","citing_paper":"/paper/2606.01249"},"observation_digest":"sha256:05e8aaea65049d7c00cd80a35d138dcdcf1d78d633e6139700e03523bbc8bf85","observation_id":"3efc4b0a-cf2d-4b52-9170-587accd10d67","resolution":{"observed_at":"2026-07-01T20:56:13.295277Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.19594","last_updated":"2024-07-30T01:38:06Z","snapshot_observed_at":"2026-07-06T18:53:00.965448Z","submitted_at":"2024-07-28T21:58:28Z","title":"Meta-Rewarding Language Models: Self-Improving Alignment with LLM-as-a-Meta-Judge","version":2},"cited_work":{"arxiv_id":"2407.19594","doi":"10.48550/arxiv.2407.19594","metadata_source":"arxiv_reference","pith_arxiv_id":"2407.19594","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"CoRR , volume =","venue":"arXiv (Cornell University)","work_id":"39d1c338-cf2d-4782-ac04-5fa28470bef1","year":2024},"citing_paper":{"arxiv_id":"2606.11470","last_updated":"2026-06-09T21:59:37Z","snapshot_observed_at":"2026-07-06T23:50:35.052764Z","submitted_at":"2026-06-09T21:59:37Z","title":"The Periodic Table of LLM Reasoning: A Structured Survey of Reasoning Paradigms, Methods, and Failure Modes","version":1},"reference_index":264,"source":"arxiv_source","source_observed_at":"2026-06-27T12:59:51.091008Z"},"links":{"cited_paper":"/paper/2407.19594","citing_paper":"/paper/2606.11470"},"observation_digest":"sha256:2ab2fa67d0455add0f73fe76aadd67c9d4e3e568abf97ade16c661277e554da6","observation_id":"2f98913a-87b1-4de3-8e53-0b135e21af01","resolution":{"observed_at":"2026-07-03T05:57:41.551756Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.19594","last_updated":"2024-07-30T01:38:06Z","snapshot_observed_at":"2026-07-06T18:53:00.965448Z","submitted_at":"2024-07-28T21:58:28Z","title":"Meta-Rewarding Language Models: Self-Improving Alignment with LLM-as-a-Meta-Judge","version":2},"cited_work":{"arxiv_id":"2407.19594","doi":"10.48550/arxiv.2407.19594","metadata_source":"arxiv_reference","pith_arxiv_id":"2407.19594","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"CoRR , volume =","venue":"arXiv (Cornell University)","work_id":"39d1c338-cf2d-4782-ac04-5fa28470bef1","year":2024},"citing_paper":{"arxiv_id":"2606.22873","last_updated":"2026-06-25T18:44:01Z","snapshot_observed_at":"2026-08-02T23:29:21.699637Z","submitted_at":"2026-06-22T05:37:43Z","title":"SingGuard: A Policy-Adaptive Multimodal LLM Guardrail with Dynamic Reasoning","version":2},"reference_index":218,"source":"arxiv_source","source_observed_at":"2026-06-26T09:19:50.623741Z"},"links":{"cited_paper":"/paper/2407.19594","citing_paper":"/paper/2606.22873"},"observation_digest":"sha256:1a00da279dca6605a5790154209fac3c33ef6b11cfefc56045ccd808dc838dc4","observation_id":"103da097-1211-4c59-961f-d31d121ebf1d","resolution":{"observed_at":"2026-07-04T09:59:44.789963Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.19594","last_updated":"2024-07-30T01:38:06Z","snapshot_observed_at":"2026-07-06T18:53:00.965448Z","submitted_at":"2024-07-28T21:58:28Z","title":"Meta-Rewarding Language Models: Self-Improving Alignment with LLM-as-a-Meta-Judge","version":2},"cited_work":{"arxiv_id":"2407.19594","doi":"10.48550/arxiv.2407.19594","metadata_source":"arxiv_reference","pith_arxiv_id":"2407.19594","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"CoRR , volume =","venue":"arXiv (Cornell University)","work_id":"39d1c338-cf2d-4782-ac04-5fa28470bef1","year":2024},"citing_paper":{"arxiv_id":"2606.22873","last_updated":"2026-06-25T18:44:01Z","snapshot_observed_at":"2026-08-02T23:29:21.699637Z","submitted_at":"2026-06-22T05:37:43Z","title":"SingGuard: A Policy-Adaptive Multimodal LLM Guardrail with Dynamic Reasoning","version":3},"reference_index":217,"source":"arxiv_source","source_observed_at":"2026-06-29T01:18:19.195007Z"},"links":{"cited_paper":"/paper/2407.19594","citing_paper":"/paper/2606.22873"},"observation_digest":"sha256:a757c914319404049f75dc9688db1f7c5d6af8e3a81c3dd92fce8d370bb44f53","observation_id":"99a6daa6-1d24-418e-b7ff-d2b1e72ebef6","resolution":{"observed_at":"2026-07-01T18:55:59.731218Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2407.19594/citation-record","integrity":"/paper/2407.19594/integrity","json":"/paper/2407.19594/citation-record.json","paper":"/paper/2407.19594"},"outbound":[],"paper":{"arxiv_id":"2407.19594","last_updated":"2024-07-30T01:38:06Z","latest_version":2,"primary_category":"cs.CL","snapshot_observed_at":"2026-07-06T18:53:00.965448Z","submitted_at":"2024-07-28T21:58:28Z","title":"Meta-Rewarding Language Models: Self-Improving Alignment with LLM-as-a-Meta-Judge"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"thesis":"As of 6 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 12 inbound Pith citation observations for arXiv:2407.19594."}