{"as_of":"2026-08-18T21:31:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:09d46226236e84cfefaaa5c424920a02697140c68cfbf8cb9d65b43b7e0b28e7","coverage":[{"denominator":47,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":47,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-02T05:30:04.755723Z","state":"measured"},{"denominator":48,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":48,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-18T06:34:40.430872+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-01T09:29:49.561922Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2607.13347","last_updated":"2026-07-16T21:13:23Z","snapshot_observed_at":"2026-08-13T05:59:12.760431Z","submitted_at":"2026-07-15T00:14:31Z","title":"LLM-as-a-Judge Scores Are Unreliable Optimization Signals in Closed-Loop Table Recognition","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2607.13347","snapshot_observed_at":"2026-08-01T09:29:49.561922Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.20768","last_updated":"2026-07-22T22:34:57Z","snapshot_observed_at":"2026-08-15T17:38:19.627117Z","submitted_at":"2026-07-22T22:34:57Z","title":"Are Diversity Metrics Measuring Diversity? A Capability-Controlled Audit of Majority-Vote Gain in LLM Ensembles","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-01T09:29:49.561922Z"},"links":{"cited_paper":"/paper/2607.13347","citing_paper":"/paper/2607.20768"},"observation_digest":"sha256:3dba3e5a8d385112c8dc243bc4f483d9ef559506a7716f42bd61ebf11959f5ac","observation_id":"7be6c274-ce03-4e81-9ee7-f1e52c8bdeff","resolution":{"observed_at":"2026-08-01T09:29:49.561922Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2607.13347/citation-record","integrity":"/paper/2607.13347/integrity","json":"/paper/2607.13347/citation-record.json","paper":"/paper/2607.13347"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T05:29:59.460677Z","title":"Surikuchi, Ece Takmaz, and Alberto Testoni","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.13347","last_updated":"2026-07-16T21:13:23Z","snapshot_observed_at":"2026-08-13T05:59:12.760431Z","submitted_at":"2026-07-15T00:14:31Z","title":"LLM-as-a-Judge Scores Are Unreliable Optimization Signals in Closed-Loop Table Recognition","version":2},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-02T05:29:59.460677Z"},"links":{"citing_paper":"/paper/2607.13347"},"observation_digest":"sha256:451469a2b816b5f77baf6b3b18805ee092345d1439366fa0e01822b49d4599e2","observation_id":"6970fad3-7f24-4f5d-97be-ec2017a8c22c","resolution":{"observed_at":"2026-08-02T05:29:59.460677Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T05:29:59.668652Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.13347","last_updated":"2026-07-16T21:13:23Z","snapshot_observed_at":"2026-08-13T05:59:12.760431Z","submitted_at":"2026-07-15T00:14:31Z","title":"LLM-as-a-Judge Scores Are Unreliable Optimization Signals in Closed-Loop Table Recognition","version":2},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-02T05:29:59.668652Z"},"links":{"citing_paper":"/paper/2607.13347"},"observation_digest":"sha256:f8bff5ba2e9523abd15e5fad6a059545c231a1ee24fa7b13861a0e15c412b96c","observation_id":"63ed05f1-1f15-4de9-86e2-86ab607fc275","resolution":{"observed_at":"2026-08-02T05:29:59.668652Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.14168","last_updated":"2021-11-18T00:23:45Z","snapshot_observed_at":"2026-08-14T02:43:01.480086Z","submitted_at":"2021-10-27T04:49:45Z","title":"Training Verifiers to Solve Math Word Problems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.14168","snapshot_observed_at":"2026-08-02T05:29:59.811281Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.13347","last_updated":"2026-07-16T21:13:23Z","snapshot_observed_at":"2026-08-13T05:59:12.760431Z","submitted_at":"2026-07-15T00:14:31Z","title":"LLM-as-a-Judge Scores Are Unreliable Optimization Signals in Closed-Loop Table Recognition","version":2},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-02T05:29:59.811281Z"},"links":{"cited_paper":"/paper/2110.14168","citing_paper":"/paper/2607.13347"},"observation_digest":"sha256:90bf5eb48dbdf9c1531d4ff971991ac1690fe47679aae1daeaae80c2b0914c0b","observation_id":"c4fdd783-9c94-48e1-8f14-50796b705ed2","resolution":{"observed_at":"2026-08-02T05:29:59.811281Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.10760","last_updated":"2022-10-19T17:56:10Z","snapshot_observed_at":"2026-07-06T14:07:50.468967Z","submitted_at":"2022-10-19T17:56:10Z","title":"Scaling Laws for Reward Model Overoptimization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.10760","snapshot_observed_at":"2026-08-02T05:29:59.895501Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.13347","last_updated":"2026-07-16T21:13:23Z","snapshot_observed_at":"2026-08-13T05:59:12.760431Z","submitted_at":"2026-07-15T00:14:31Z","title":"LLM-as-a-Judge Scores Are Unreliable Optimization Signals in Closed-Loop Table Recognition","version":2},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-02T05:29:59.895501Z"},"links":{"cited_paper":"/paper/2210.10760","citing_paper":"/paper/2607.13347"},"observation_digest":"sha256:2f7c89b495079334425d979b0f4971ca0c74edc6e9d79a6d64e8cbf44236f31d","observation_id":"063cdf7d-ef8a-472c-9907-89a12180aee8","resolution":{"observed_at":"2026-08-02T05:29:59.895501Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T05:30:00.081154Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.13347","last_updated":"2026-07-16T21:13:23Z","snapshot_observed_at":"2026-08-13T05:59:12.760431Z","submitted_at":"2026-07-15T00:14:31Z","title":"LLM-as-a-Judge Scores Are Unreliable Optimization Signals in Closed-Loop Table Recognition","version":2},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-02T05:30:00.081154Z"},"links":{"citing_paper":"/paper/2607.13347"},"observation_digest":"sha256:4e73659516d62d93da697efd2920264aef81553229ba5c27000175d1b699eb2e","observation_id":"85e6d35e-0e8f-41e9-b60d-136d2941a2ac","resolution":{"observed_at":"2026-08-02T05:30:00.081154Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T05:30:00.181274Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.13347","last_updated":"2026-07-16T21:13:23Z","snapshot_observed_at":"2026-08-13T05:59:12.760431Z","submitted_at":"2026-07-15T00:14:31Z","title":"LLM-as-a-Judge Scores Are Unreliable Optimization Signals in Closed-Loop Table Recognition","version":2},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-02T05:30:00.181274Z"},"links":{"citing_paper":"/paper/2607.13347"},"observation_digest":"sha256:786c750a3a454941ef9f2aeb0225f93a3cb68c77d544c5d825fbcf4f909d5c9d","observation_id":"67a1e79d-721f-4446-92fc-9eae1e6e064b","resolution":{"observed_at":"2026-08-02T05:30:00.181274Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2510.27106","last_updated":"2025-10-31T02:06:37Z","snapshot_observed_at":"2026-08-04T23:39:36.848150Z","submitted_at":"2025-10-31T02:06:37Z","title":"Rating Roulette: Self-Inconsistency in LLM-As-A-Judge Frameworks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2510.27106","snapshot_observed_at":"2026-08-02T05:30:00.268539Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.13347","last_updated":"2026-07-16T21:13:23Z","snapshot_observed_at":"2026-08-13T05:59:12.760431Z","submitted_at":"2026-07-15T00:14:31Z","title":"LLM-as-a-Judge Scores Are Unreliable Optimization Signals in Closed-Loop Table Recognition","version":2},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-02T05:30:00.268539Z"},"links":{"cited_paper":"/paper/2510.27106","citing_paper":"/paper/2607.13347"},"observation_digest":"sha256:dd6d14ae3755a0b068160f05ccbb41ff50ee5b94f6ab11cabe85e148533073ee","observation_id":"8ac2bf8b-29a6-473b-b460-be714b2779b0","resolution":{"observed_at":"2026-08-02T05:30:00.268539Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2603.18652","last_updated":"2026-06-01T12:43:40Z","snapshot_observed_at":"2026-08-11T18:52:29.360760Z","submitted_at":"2026-03-19T09:17:21Z","title":"Beyond String Matching: Semantic Evaluation of PDF Table Extraction","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2603.18652","snapshot_observed_at":"2026-08-02T05:30:00.376334Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.13347","last_updated":"2026-07-16T21:13:23Z","snapshot_observed_at":"2026-08-13T05:59:12.760431Z","submitted_at":"2026-07-15T00:14:31Z","title":"LLM-as-a-Judge Scores Are Unreliable Optimization Signals in Closed-Loop Table Recognition","version":2},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-02T05:30:00.376334Z"},"links":{"cited_paper":"/paper/2603.18652","citing_paper":"/paper/2607.13347"},"observation_digest":"sha256:eeb8bb020bcd2a3a09b44407633193d2e183b921ef45b88edc0297728edf0fb2","observation_id":"9ee16917-487c-46ed-9f5b-f1df8f0db0db","resolution":{"observed_at":"2026-08-02T05:30:00.376334Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.02839","last_updated":"2025-05-30T12:01:03Z","snapshot_observed_at":"2026-08-18T15:39:21.338441Z","submitted_at":"2024-03-05T10:20:52Z","title":"An Empirical Study of LLM-as-a-Judge for LLM Evaluation: Fine-tuned Judge Model is not a General Substitute for GPT-4","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.02839","snapshot_observed_at":"2026-08-02T05:30:00.492775Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.13347","last_updated":"2026-07-16T21:13:23Z","snapshot_observed_at":"2026-08-13T05:59:12.760431Z","submitted_at":"2026-07-15T00:14:31Z","title":"LLM-as-a-Judge Scores Are Unreliable Optimization Signals in Closed-Loop Table Recognition","version":2},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-02T05:30:00.492775Z"},"links":{"cited_paper":"/paper/2403.02839","citing_paper":"/paper/2607.13347"},"observation_digest":"sha256:aa30b1989d91fe0ae3ea100e100540917a154af92ffafa4af223fba962c59368","observation_id":"bd79bc58-d3bd-4eb0-8bed-8afeccf7dde5","resolution":{"observed_at":"2026-08-02T05:30:00.492775Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.01798","last_updated":"2024-03-14T04:27:52Z","snapshot_observed_at":"2026-08-13T03:11:04.678829Z","submitted_at":"2023-10-03T04:56:12Z","title":"Large Language Models Cannot Self-Correct Reasoning Yet","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.01798","snapshot_observed_at":"2026-08-02T05:30:00.658188Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.13347","last_updated":"2026-07-16T21:13:23Z","snapshot_observed_at":"2026-08-13T05:59:12.760431Z","submitted_at":"2026-07-15T00:14:31Z","title":"LLM-as-a-Judge Scores Are Unreliable Optimization Signals in Closed-Loop Table Recognition","version":2},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-02T05:30:00.658188Z"},"links":{"cited_paper":"/paper/2310.01798","citing_paper":"/paper/2607.13347"},"observation_digest":"sha256:ebb5a8e9233ddbdbca1ed240713d4cb3080868e79b590d3ff5c5437646515e41","observation_id":"e25c95bb-291f-45e8-bb72-6fcbf4f87306","resolution":{"observed_at":"2026-08-02T05:30:00.658188Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T05:30:00.788948Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.13347","last_updated":"2026-07-16T21:13:23Z","snapshot_observed_at":"2026-08-13T05:59:12.760431Z","submitted_at":"2026-07-15T00:14:31Z","title":"LLM-as-a-Judge Scores Are Unreliable Optimization Signals in Closed-Loop Table Recognition","version":2},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-02T05:30:00.788948Z"},"links":{"citing_paper":"/paper/2607.13347"},"observation_digest":"sha256:8e92e9b969a0e984bac2717473acbd5b2a4b0cf700d8e08c66f375a8ee9ea3a8","observation_id":"06ab8d62-8c7f-4833-b970-fc3287d07c32","resolution":{"observed_at":"2026-08-02T05:30:00.788948Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.01297","last_updated":"2024-12-03T19:14:06Z","snapshot_observed_at":"2026-08-18T10:44:14.134406Z","submitted_at":"2024-06-03T13:05:46Z","title":"When Can LLMs Actually Correct Their Own Mistakes? A Critical Survey of Self-Correction of LLMs","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.01297","snapshot_observed_at":"2026-08-02T05:30:00.881954Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.13347","last_updated":"2026-07-16T21:13:23Z","snapshot_observed_at":"2026-08-13T05:59:12.760431Z","submitted_at":"2026-07-15T00:14:31Z","title":"LLM-as-a-Judge Scores Are Unreliable Optimization Signals in Closed-Loop Table Recognition","version":2},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-02T05:30:00.881954Z"},"links":{"cited_paper":"/paper/2406.01297","citing_paper":"/paper/2607.13347"},"observation_digest":"sha256:2d6a103119b3e1a5b222c3931efcf7326bc552432c7f4b044a7dd666ecf126f4","observation_id":"eb4fb963-1868-4733-af0d-eaa11a3e8fa9","resolution":{"observed_at":"2026-08-02T05:30:00.881954Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T05:30:00.967761Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.13347","last_updated":"2026-07-16T21:13:23Z","snapshot_observed_at":"2026-08-13T05:59:12.760431Z","submitted_at":"2026-07-15T00:14:31Z","title":"LLM-as-a-Judge Scores Are Unreliable Optimization Signals in Closed-Loop Table Recognition","version":2},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-02T05:30:00.967761Z"},"links":{"citing_paper":"/paper/2607.13347"},"observation_digest":"sha256:1835dc1a3760787931895bc64312973f9cc0a62cce69784070388334639ee8ce","observation_id":"51fc8f21-76a6-47ad-8ce0-91858d9c8e51","resolution":{"observed_at":"2026-08-02T05:30:00.967761Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T05:30:01.190743Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.13347","last_updated":"2026-07-16T21:13:23Z","snapshot_observed_at":"2026-08-13T05:59:12.760431Z","submitted_at":"2026-07-15T00:14:31Z","title":"LLM-as-a-Judge Scores Are Unreliable Optimization Signals in Closed-Loop Table Recognition","version":2},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-02T05:30:01.190743Z"},"links":{"citing_paper":"/paper/2607.13347"},"observation_digest":"sha256:06aaf90196805dc49f20072737a8a1f07b3c0939c9fbaf2c028e96048e58aea3","observation_id":"dd641cae-5a74-4c96-907d-06d8423e45df","resolution":{"observed_at":"2026-08-02T05:30:01.190743Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.20050","last_updated":"2023-05-31T17:24:00Z","snapshot_observed_at":"2026-08-17T09:42:34.746112Z","submitted_at":"2023-05-31T17:24:00Z","title":"Let's Verify Step by Step","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.20050","snapshot_observed_at":"2026-08-02T05:30:01.341930Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.13347","last_updated":"2026-07-16T21:13:23Z","snapshot_observed_at":"2026-08-13T05:59:12.760431Z","submitted_at":"2026-07-15T00:14:31Z","title":"LLM-as-a-Judge Scores Are Unreliable Optimization Signals in Closed-Loop Table Recognition","version":2},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-02T05:30:01.341930Z"},"links":{"cited_paper":"/paper/2305.20050","citing_paper":"/paper/2607.13347"},"observation_digest":"sha256:62dc8e576e86ca558df91392fdf3489236292aa30592e530526acdda3a878628","observation_id":"27d41115-94a2-4d06-9ebb-9d17b1f05689","resolution":{"observed_at":"2026-08-02T05:30:01.341930Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T05:30:01.434969Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.13347","last_updated":"2026-07-16T21:13:23Z","snapshot_observed_at":"2026-08-13T05:59:12.760431Z","submitted_at":"2026-07-15T00:14:31Z","title":"LLM-as-a-Judge Scores Are Unreliable Optimization Signals in Closed-Loop Table Recognition","version":2},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-02T05:30:01.434969Z"},"links":{"citing_paper":"/paper/2607.13347"},"observation_digest":"sha256:9e3ecfb3ee1ad4277b736fb7adb56ddc73fffb6dc46cf0179feb0789becda612","observation_id":"8fbdd9ef-86d9-44ae-ba40-b94326a2a7c1","resolution":{"observed_at":"2026-08-02T05:30:01.434969Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2512.02304","last_updated":"2026-04-21T03:02:32Z","snapshot_observed_at":"2026-08-15T14:50:43.984376Z","submitted_at":"2025-12-02T00:51:14Z","title":"When Does Verification Pay Off? A Closer Look at LLMs as Solution Verifiers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2512.02304","snapshot_observed_at":"2026-08-02T05:30:01.547918Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.13347","last_updated":"2026-07-16T21:13:23Z","snapshot_observed_at":"2026-08-13T05:59:12.760431Z","submitted_at":"2026-07-15T00:14:31Z","title":"LLM-as-a-Judge Scores Are Unreliable Optimization Signals in Closed-Loop Table Recognition","version":2},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-02T05:30:01.547918Z"},"links":{"cited_paper":"/paper/2512.02304","citing_paper":"/paper/2607.13347"},"observation_digest":"sha256:bcfc697929d4504e0d70996f93598e3d6fee8cbb34593cba5c2d667867e0ffc4","observation_id":"4be6b76c-3030-494e-91d8-6ee89653d025","resolution":{"observed_at":"2026-08-02T05:30:01.547918Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.03393","last_updated":"2023-05-05T09:38:47Z","snapshot_observed_at":"2026-08-16T15:35:24.104829Z","submitted_at":"2023-05-05T09:38:47Z","title":"Optimized Table Tokenization for Table Structure Recognition","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.03393","snapshot_observed_at":"2026-08-02T05:30:01.657101Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.13347","last_updated":"2026-07-16T21:13:23Z","snapshot_observed_at":"2026-08-13T05:59:12.760431Z","submitted_at":"2026-07-15T00:14:31Z","title":"LLM-as-a-Judge Scores Are Unreliable Optimization Signals in Closed-Loop Table Recognition","version":2},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-02T05:30:01.657101Z"},"links":{"cited_paper":"/paper/2305.03393","citing_paper":"/paper/2607.13347"},"observation_digest":"sha256:4b957c56ca02e63cb1c7000dbfb49764a736a4b2e2111885770fec62ba5290ab","observation_id":"0228b135-2bd8-4f0d-908c-0136c0249b06","resolution":{"observed_at":"2026-08-02T05:30:01.657101Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.17651","last_updated":"2023-05-25T19:13:47Z","snapshot_observed_at":"2026-08-17T09:48:37.358540Z","submitted_at":"2023-03-30T18:30:01Z","title":"Self-Refine: Iterative Refinement with Self-Feedback","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.17651","snapshot_observed_at":"2026-08-02T05:30:01.760982Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.13347","last_updated":"2026-07-16T21:13:23Z","snapshot_observed_at":"2026-08-13T05:59:12.760431Z","submitted_at":"2026-07-15T00:14:31Z","title":"LLM-as-a-Judge Scores Are Unreliable Optimization Signals in Closed-Loop Table Recognition","version":2},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-02T05:30:01.760982Z"},"links":{"cited_paper":"/paper/2303.17651","citing_paper":"/paper/2607.13347"},"observation_digest":"sha256:5cd504e127adcaace521d8c81ea00e49a3a20f2ebea27fcfd56754eb9f5d6b10","observation_id":"696412b8-f9c7-45ae-9825-851d42cedbc2","resolution":{"observed_at":"2026-08-02T05:30:01.760982Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.09324","last_updated":"2025-08-12T20:16:41Z","snapshot_observed_at":"2026-08-14T11:04:25.188871Z","submitted_at":"2025-08-12T20:16:41Z","title":"TEN: Table Explicitization, Neurosymbolically","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.09324","snapshot_observed_at":"2026-08-02T05:30:01.912409Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.13347","last_updated":"2026-07-16T21:13:23Z","snapshot_observed_at":"2026-08-13T05:59:12.760431Z","submitted_at":"2026-07-15T00:14:31Z","title":"LLM-as-a-Judge Scores Are Unreliable Optimization Signals in Closed-Loop Table Recognition","version":2},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-02T05:30:01.912409Z"},"links":{"cited_paper":"/paper/2508.09324","citing_paper":"/paper/2607.13347"},"observation_digest":"sha256:3e865f9d71e410bdd74b447a54b73d08f37310ff3c7a28c55e5c7e004d3dd8d3","observation_id":"42eb22b1-5ca2-4d90-a77b-4ca2e0303008","resolution":{"observed_at":"2026-08-02T05:30:01.912409Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T05:30:02.022622Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.13347","last_updated":"2026-07-16T21:13:23Z","snapshot_observed_at":"2026-08-13T05:59:12.760431Z","submitted_at":"2026-07-15T00:14:31Z","title":"LLM-as-a-Judge Scores Are Unreliable Optimization Signals in Closed-Loop Table Recognition","version":2},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-02T05:30:02.022622Z"},"links":{"citing_paper":"/paper/2607.13347"},"observation_digest":"sha256:9a5ac3d7fe9678d8d5812095a912a02978fba762cd9c09430eb3e81160342a32","observation_id":"c11037a8-27f6-4085-b147-a88ac08cd889","resolution":{"observed_at":"2026-08-02T05:30:02.022622Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T05:30:02.232688Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.13347","last_updated":"2026-07-16T21:13:23Z","snapshot_observed_at":"2026-08-13T05:59:12.760431Z","submitted_at":"2026-07-15T00:14:31Z","title":"LLM-as-a-Judge Scores Are Unreliable Optimization Signals in Closed-Loop Table Recognition","version":2},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-02T05:30:02.232688Z"},"links":{"citing_paper":"/paper/2607.13347"},"observation_digest":"sha256:93bcc604533647cf2d90c1da233561f39f88bc526dbba55577cc1d4659c1e162","observation_id":"919ad2e9-237f-467d-b443-adfeafc70dc6","resolution":{"observed_at":"2026-08-02T05:30:02.232688Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.04549","last_updated":"2024-07-05T14:34:50Z","snapshot_observed_at":"2026-08-16T13:36:45.837914Z","submitted_at":"2024-07-05T14:34:50Z","title":"Spontaneous Reward Hacking in Iterative Self-Refinement","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.04549","snapshot_observed_at":"2026-08-02T05:30:02.285651Z","title":"Bowman, and Shi Feng","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.13347","last_updated":"2026-07-16T21:13:23Z","snapshot_observed_at":"2026-08-13T05:59:12.760431Z","submitted_at":"2026-07-15T00:14:31Z","title":"LLM-as-a-Judge Scores Are Unreliable Optimization Signals in Closed-Loop Table Recognition","version":2},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-02T05:30:02.285651Z"},"links":{"cited_paper":"/paper/2407.04549","citing_paper":"/paper/2607.13347"},"observation_digest":"sha256:b963945a60d7e6186e1b6b9db56b0e34f30620c78dbbbc6de5423b2e63c58699","observation_id":"925c1d8d-086f-46ad-9bee-321ec6fd14d2","resolution":{"observed_at":"2026-08-02T05:30:02.285651Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T05:30:02.376067Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.13347","last_updated":"2026-07-16T21:13:23Z","snapshot_observed_at":"2026-08-13T05:59:12.760431Z","submitted_at":"2026-07-15T00:14:31Z","title":"LLM-as-a-Judge Scores Are Unreliable Optimization Signals in Closed-Loop Table Recognition","version":2},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-02T05:30:02.376067Z"},"links":{"citing_paper":"/paper/2607.13347"},"observation_digest":"sha256:103d48a4fde2325f100cd55b05e0a01840aad3ac01fb4a8e2e20e698d50619d8","observation_id":"65e8981e-e48d-4047-9536-e65929466467","resolution":{"observed_at":"2026-08-02T05:30:02.376067Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T05:30:02.445402Z","title":"Kelly Buchanan, Mayee F","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.13347","last_updated":"2026-07-16T21:13:23Z","snapshot_observed_at":"2026-08-13T05:59:12.760431Z","submitted_at":"2026-07-15T00:14:31Z","title":"LLM-as-a-Judge Scores Are Unreliable Optimization Signals in Closed-Loop Table Recognition","version":2},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-02T05:30:02.445402Z"},"links":{"citing_paper":"/paper/2607.13347"},"observation_digest":"sha256:f2d9283ca56a782e10c52d1c3e53d361957c733d59fe2c5abb4d913866ce8aa7","observation_id":"dadb9c46-bfb1-4024-b796-34f6b99a304c","resolution":{"observed_at":"2026-08-02T05:30:02.445402Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T05:30:02.545477Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.13347","last_updated":"2026-07-16T21:13:23Z","snapshot_observed_at":"2026-08-13T05:59:12.760431Z","submitted_at":"2026-07-15T00:14:31Z","title":"LLM-as-a-Judge Scores Are Unreliable Optimization Signals in Closed-Loop Table Recognition","version":2},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-02T05:30:02.545477Z"},"links":{"citing_paper":"/paper/2607.13347"},"observation_digest":"sha256:fe4ac99872d67cbbd32893405c193dda8ca20eb4f620cb22ecd72025e1be3ac2","observation_id":"4af724ca-23c2-4dc9-9237-42e65ab813a8","resolution":{"observed_at":"2026-08-02T05:30:02.545477Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2026.surgellm-1.19","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T05:33:34.712313Z","title":null,"venue":null,"work_id":"b6252f1b-48d9-4118-ac7c-87e4e6febebf","year":2026},"citing_paper":{"arxiv_id":"2607.13347","last_updated":"2026-07-16T21:13:23Z","snapshot_observed_at":"2026-08-13T05:59:12.760431Z","submitted_at":"2026-07-15T00:14:31Z","title":"LLM-as-a-Judge Scores Are Unreliable Optimization Signals in Closed-Loop Table Recognition","version":2},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-02T05:30:02.632168Z"},"links":{"citing_paper":"/paper/2607.13347"},"observation_digest":"sha256:0de92f7c077b09bf3d97f8237fc9f1afbf4ae8d56124427ae160faa31269e1f0","observation_id":"6b8cb060-e586-4a46-b9dc-4bec9fcb6873","resolution":{"observed_at":"2026-08-02T05:33:34.906795Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T05:30:02.804383Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.13347","last_updated":"2026-07-16T21:13:23Z","snapshot_observed_at":"2026-08-13T05:59:12.760431Z","submitted_at":"2026-07-15T00:14:31Z","title":"LLM-as-a-Judge Scores Are Unreliable Optimization Signals in Closed-Loop Table Recognition","version":2},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-02T05:30:02.804383Z"},"links":{"citing_paper":"/paper/2607.13347"},"observation_digest":"sha256:810548ed933b5615435fe6aed4e2444d0de0411c8ed88443ff4b1dbc1074ee6f","observation_id":"935af909-d024-4f37-9004-dd04e791bcc5","resolution":{"observed_at":"2026-08-02T05:30:02.804383Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T05:30:02.880383Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.13347","last_updated":"2026-07-16T21:13:23Z","snapshot_observed_at":"2026-08-13T05:59:12.760431Z","submitted_at":"2026-07-15T00:14:31Z","title":"LLM-as-a-Judge Scores Are Unreliable Optimization Signals in Closed-Loop Table Recognition","version":2},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-02T05:30:02.880383Z"},"links":{"citing_paper":"/paper/2607.13347"},"observation_digest":"sha256:a2dd426620ba7961cb283f830da1b651f55fd1f06590721078254e305add5fd3","observation_id":"0506cba1-8b80-47f1-9224-9a7ea00e7d3c","resolution":{"observed_at":"2026-08-02T05:30:02.880383Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.00716","last_updated":"2023-05-23T18:57:24Z","snapshot_observed_at":"2026-08-16T15:51:37.648165Z","submitted_at":"2023-03-01T18:20:24Z","title":"Aligning benchmark datasets for table structure recognition","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.00716","snapshot_observed_at":"2026-08-02T05:30:03.007689Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.13347","last_updated":"2026-07-16T21:13:23Z","snapshot_observed_at":"2026-08-13T05:59:12.760431Z","submitted_at":"2026-07-15T00:14:31Z","title":"LLM-as-a-Judge Scores Are Unreliable Optimization Signals in Closed-Loop Table Recognition","version":2},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-02T05:30:03.007689Z"},"links":{"cited_paper":"/paper/2303.00716","citing_paper":"/paper/2607.13347"},"observation_digest":"sha256:d3a91d3cf07ea18a87975dea2ba9d9d2b5d4f1c910989fb7292a07094df45892","observation_id":"5dbd6d8c-715f-4d96-9be3-dec537a15f69","resolution":{"observed_at":"2026-08-02T05:30:03.007689Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.12555","last_updated":"2023-05-23T18:47:12Z","snapshot_observed_at":"2026-08-18T03:04:18.839778Z","submitted_at":"2022-03-23T17:14:03Z","title":"GriTS: Grid table similarity metric for table structure recognition","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.12555","snapshot_observed_at":"2026-08-02T05:30:03.111252Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.13347","last_updated":"2026-07-16T21:13:23Z","snapshot_observed_at":"2026-08-13T05:59:12.760431Z","submitted_at":"2026-07-15T00:14:31Z","title":"LLM-as-a-Judge Scores Are Unreliable Optimization Signals in Closed-Loop Table Recognition","version":2},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-02T05:30:03.111252Z"},"links":{"cited_paper":"/paper/2203.12555","citing_paper":"/paper/2607.13347"},"observation_digest":"sha256:a933e16c5ce564abdf5850fd71dd058071fba351540664e592e031195652dd79","observation_id":"62eb7816-4eb1-4673-b774-54d36db3be00","resolution":{"observed_at":"2026-08-02T05:30:03.111252Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.01632","last_updated":"2024-11-06T18:04:35Z","snapshot_observed_at":"2026-08-16T14:13:17.418884Z","submitted_at":"2024-03-03T22:38:35Z","title":"SynCode: LLM Generation with Grammar Augmentation","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.01632","snapshot_observed_at":"2026-08-02T05:30:03.266859Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.13347","last_updated":"2026-07-16T21:13:23Z","snapshot_observed_at":"2026-08-13T05:59:12.760431Z","submitted_at":"2026-07-15T00:14:31Z","title":"LLM-as-a-Judge Scores Are Unreliable Optimization Signals in Closed-Loop Table Recognition","version":2},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-02T05:30:03.266859Z"},"links":{"cited_paper":"/paper/2403.01632","citing_paper":"/paper/2607.13347"},"observation_digest":"sha256:8a81b40f22b109be888f50aec6e9c25465d8b4d9249f396ede3325145c75a4c9","observation_id":"8c3e718e-7925-41d8-af20-9d62bc090ce7","resolution":{"observed_at":"2026-08-02T05:30:03.266859Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T05:30:03.415974Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.13347","last_updated":"2026-07-16T21:13:23Z","snapshot_observed_at":"2026-08-13T05:59:12.760431Z","submitted_at":"2026-07-15T00:14:31Z","title":"LLM-as-a-Judge Scores Are Unreliable Optimization Signals in Closed-Loop Table Recognition","version":2},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-02T05:30:03.415974Z"},"links":{"citing_paper":"/paper/2607.13347"},"observation_digest":"sha256:f65ce16d378e099cef246e83d8d78f31d866e17f2b21501bc1360b94582c9358","observation_id":"470e3904-5b98-497d-9b01-e2604a09c953","resolution":{"observed_at":"2026-08-02T05:30:03.415974Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2026.acl-long.1092","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T05:33:34.476615Z","title":null,"venue":null,"work_id":"29c8ce40-bd62-4a35-8896-55c4d38e5111","year":2026},"citing_paper":{"arxiv_id":"2607.13347","last_updated":"2026-07-16T21:13:23Z","snapshot_observed_at":"2026-08-13T05:59:12.760431Z","submitted_at":"2026-07-15T00:14:31Z","title":"LLM-as-a-Judge Scores Are Unreliable Optimization Signals in Closed-Loop Table Recognition","version":2},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-02T05:30:03.480135Z"},"links":{"citing_paper":"/paper/2607.13347"},"observation_digest":"sha256:143586d024a323f404b58a73d44d8dd3fb9c73be847a7076e3d9817cea348848","observation_id":"ac5739a1-78f4-4a1a-8fad-a6da8a0a24c9","resolution":{"observed_at":"2026-08-02T05:33:34.669074Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T05:30:03.626698Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.13347","last_updated":"2026-07-16T21:13:23Z","snapshot_observed_at":"2026-08-13T05:59:12.760431Z","submitted_at":"2026-07-15T00:14:31Z","title":"LLM-as-a-Judge Scores Are Unreliable Optimization Signals in Closed-Loop Table Recognition","version":2},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-02T05:30:03.626698Z"},"links":{"citing_paper":"/paper/2607.13347"},"observation_digest":"sha256:a65e339bec316e3d25791378b490a4cceefc1e300343c2a39ac918bc26092533","observation_id":"50da801b-6989-44fc-ada2-191f393a3399","resolution":{"observed_at":"2026-08-02T05:30:03.626698Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T05:30:03.778082Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.13347","last_updated":"2026-07-16T21:13:23Z","snapshot_observed_at":"2026-08-13T05:59:12.760431Z","submitted_at":"2026-07-15T00:14:31Z","title":"LLM-as-a-Judge Scores Are Unreliable Optimization Signals in Closed-Loop Table Recognition","version":2},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-02T05:30:03.778082Z"},"links":{"citing_paper":"/paper/2607.13347"},"observation_digest":"sha256:3045051540e1c3e6acbc9abf407027ffbaa6750c1c03b4416dbbf7869e3359f3","observation_id":"7b48686a-ac41-4dd9-bdd7-be10960e65fa","resolution":{"observed_at":"2026-08-02T05:30:03.778082Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2026.gem-main.19","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T05:33:34.253935Z","title":null,"venue":null,"work_id":"76696bb1-d392-4166-a116-1be6a7cb47a1","year":2026},"citing_paper":{"arxiv_id":"2607.13347","last_updated":"2026-07-16T21:13:23Z","snapshot_observed_at":"2026-08-13T05:59:12.760431Z","submitted_at":"2026-07-15T00:14:31Z","title":"LLM-as-a-Judge Scores Are Unreliable Optimization Signals in Closed-Loop Table Recognition","version":2},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-02T05:30:03.853188Z"},"links":{"citing_paper":"/paper/2607.13347"},"observation_digest":"sha256:7f8e298dedc1c0188fa808315e7f161a029db3661d1bc938eee38b8abe4dc1a1","observation_id":"48c4dd79-fbef-4919-818a-d6be750161bf","resolution":{"observed_at":"2026-08-02T05:33:34.420662Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T05:30:03.952979Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.13347","last_updated":"2026-07-16T21:13:23Z","snapshot_observed_at":"2026-08-13T05:59:12.760431Z","submitted_at":"2026-07-15T00:14:31Z","title":"LLM-as-a-Judge Scores Are Unreliable Optimization Signals in Closed-Loop Table Recognition","version":2},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-02T05:30:03.952979Z"},"links":{"citing_paper":"/paper/2607.13347"},"observation_digest":"sha256:c608653b24e3ed48007be278f510aa7501f6d60ad5f233bc30d9412bceabab02","observation_id":"27366696-8c64-4c81-aa1d-18eb06cad908","resolution":{"observed_at":"2026-08-02T05:30:03.952979Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T05:30:04.029139Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.13347","last_updated":"2026-07-16T21:13:23Z","snapshot_observed_at":"2026-08-13T05:59:12.760431Z","submitted_at":"2026-07-15T00:14:31Z","title":"LLM-as-a-Judge Scores Are Unreliable Optimization Signals in Closed-Loop Table Recognition","version":2},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-02T05:30:04.029139Z"},"links":{"citing_paper":"/paper/2607.13347"},"observation_digest":"sha256:e633db17aad39af7e6f057610a2b585b0ab2397d28b7c978e21bda2ea1cb64bd","observation_id":"c8230fa8-9dc8-46e1-ac56-1cd08f0239e0","resolution":{"observed_at":"2026-08-02T05:30:04.029139Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.07688","last_updated":"2023-09-14T13:04:46Z","snapshot_observed_at":"2026-08-16T15:00:44.144052Z","submitted_at":"2023-09-14T13:04:46Z","title":"Nanoscale Cathodoluminescence Spectroscopy Probing the Nitride Quantum Wells in an Electron Microcope","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.07688","snapshot_observed_at":"2026-08-02T05:30:04.099899Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.13347","last_updated":"2026-07-16T21:13:23Z","snapshot_observed_at":"2026-08-13T05:59:12.760431Z","submitted_at":"2026-07-15T00:14:31Z","title":"LLM-as-a-Judge Scores Are Unreliable Optimization Signals in Closed-Loop Table Recognition","version":2},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-02T05:30:04.099899Z"},"links":{"cited_paper":"/paper/2309.07688","citing_paper":"/paper/2607.13347"},"observation_digest":"sha256:4f9ba9400018449cda793a09323941b40a8a5eb02edf503eb41bc137b89550f3","observation_id":"696615e4-bca2-44fe-bc36-216bb0779fef","resolution":{"observed_at":"2026-08-02T05:30:04.099899Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.15240","last_updated":"2025-02-22T10:21:46Z","snapshot_observed_at":"2026-08-17T07:45:48.419891Z","submitted_at":"2024-08-27T17:57:45Z","title":"Generative Verifiers: Reward Modeling as Next-Token Prediction","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.15240","snapshot_observed_at":"2026-08-02T05:30:04.190121Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.13347","last_updated":"2026-07-16T21:13:23Z","snapshot_observed_at":"2026-08-13T05:59:12.760431Z","submitted_at":"2026-07-15T00:14:31Z","title":"LLM-as-a-Judge Scores Are Unreliable Optimization Signals in Closed-Loop Table Recognition","version":2},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-02T05:30:04.190121Z"},"links":{"cited_paper":"/paper/2408.15240","citing_paper":"/paper/2607.13347"},"observation_digest":"sha256:9c597fcecc1c294d2550c7f925879ad33f072f2d8f2ec94e45c41572b1af6271","observation_id":"5b10c82e-cd9d-4394-a16e-ee2ee5983872","resolution":{"observed_at":"2026-08-02T05:30:04.190121Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.05685","last_updated":"2023-12-24T02:01:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-06-09T05:55:52Z","title":"Judging LLM-as-a-Judge with MT-Bench and Chatbot Arena","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.05685","snapshot_observed_at":"2026-08-02T05:30:04.258677Z","title":"Xing, Hao Zhang, Joseph E","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.13347","last_updated":"2026-07-16T21:13:23Z","snapshot_observed_at":"2026-08-13T05:59:12.760431Z","submitted_at":"2026-07-15T00:14:31Z","title":"LLM-as-a-Judge Scores Are Unreliable Optimization Signals in Closed-Loop Table Recognition","version":2},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-02T05:30:04.258677Z"},"links":{"cited_paper":"/paper/2306.05685","citing_paper":"/paper/2607.13347"},"observation_digest":"sha256:caebbe87dae7fe446c7fe2ce22f0d6491ac9848b2ced1f70b2a161753aedf3b8","observation_id":"9addce6a-7735-411c-8cd4-eda301a81d2b","resolution":{"observed_at":"2026-08-02T05:30:04.258677Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T05:30:04.341034Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.13347","last_updated":"2026-07-16T21:13:23Z","snapshot_observed_at":"2026-08-13T05:59:12.760431Z","submitted_at":"2026-07-15T00:14:31Z","title":"LLM-as-a-Judge Scores Are Unreliable Optimization Signals in Closed-Loop Table Recognition","version":2},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-02T05:30:04.341034Z"},"links":{"citing_paper":"/paper/2607.13347"},"observation_digest":"sha256:b508fce6c59281199f157a6909b836d55585aa0e89022d452bba2e16005a0458","observation_id":"4d5f947c-e91d-4acb-88b4-6eec6aa322ce","resolution":{"observed_at":"2026-08-02T05:30:04.341034Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1911.10683","last_updated":"2020-03-04T02:38:07Z","snapshot_observed_at":"2026-08-15T18:43:31.997423Z","submitted_at":"2019-11-25T03:25:03Z","title":"Image-based table recognition: data, model, and evaluation","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1911.10683","snapshot_observed_at":"2026-08-02T05:30:04.435825Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.13347","last_updated":"2026-07-16T21:13:23Z","snapshot_observed_at":"2026-08-13T05:59:12.760431Z","submitted_at":"2026-07-15T00:14:31Z","title":"LLM-as-a-Judge Scores Are Unreliable Optimization Signals in Closed-Loop Table Recognition","version":2},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-02T05:30:04.435825Z"},"links":{"cited_paper":"/paper/1911.10683","citing_paper":"/paper/2607.13347"},"observation_digest":"sha256:82e35f9d9ff49ef1fdd179b6d583b291a1a8b1f7318b784be34014c4f2124269","observation_id":"ae1d7950-092f-426b-baee-9221d1bed747","resolution":{"observed_at":"2026-08-02T05:30:04.435825Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2607.05904","last_updated":"2026-07-07T06:59:30Z","snapshot_observed_at":"2026-08-15T07:14:25.601844Z","submitted_at":"2026-07-07T06:59:30Z","title":"More Convincing, Not More Correct: Self-Play Reward Hacking of Reference-Free LLM Judges","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2607.05904","snapshot_observed_at":"2026-08-02T05:30:04.547511Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.13347","last_updated":"2026-07-16T21:13:23Z","snapshot_observed_at":"2026-08-13T05:59:12.760431Z","submitted_at":"2026-07-15T00:14:31Z","title":"LLM-as-a-Judge Scores Are Unreliable Optimization Signals in Closed-Loop Table Recognition","version":2},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-02T05:30:04.547511Z"},"links":{"cited_paper":"/paper/2607.05904","citing_paper":"/paper/2607.13347"},"observation_digest":"sha256:fb3b426bfe3e97bd9e7e99b6e6f28dbadcc923feb5919d86dfecebfe63a356eb","observation_id":"c00c37c5-f72f-4540-aa54-4c93eb9684bd","resolution":{"observed_at":"2026-08-02T05:30:04.547511Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.20662","last_updated":"2025-05-30T02:29:17Z","snapshot_observed_at":"2026-08-14T05:03:54.188390Z","submitted_at":"2024-12-30T02:40:19Z","title":"Enhancing Table Recognition with Vision LLMs: A Benchmark and Neighbor-Guided Toolchain Reasoner","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.20662","snapshot_observed_at":"2026-08-02T05:30:04.657199Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.13347","last_updated":"2026-07-16T21:13:23Z","snapshot_observed_at":"2026-08-13T05:59:12.760431Z","submitted_at":"2026-07-15T00:14:31Z","title":"LLM-as-a-Judge Scores Are Unreliable Optimization Signals in Closed-Loop Table Recognition","version":2},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-02T05:30:04.657199Z"},"links":{"cited_paper":"/paper/2412.20662","citing_paper":"/paper/2607.13347"},"observation_digest":"sha256:8e9ed0266c041a98b60ee9b47c1b1182443f810881f9e18493e3efa195217d52","observation_id":"41700b40-250f-4351-a40b-518bf1cb5984","resolution":{"observed_at":"2026-08-02T05:30:04.657199Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.17631","last_updated":"2025-03-01T17:06:43Z","snapshot_observed_at":"2026-08-18T04:53:42.954410Z","submitted_at":"2023-10-26T17:48:58Z","title":"JudgeLM: Fine-tuned Large Language Models are Scalable Judges","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.17631","snapshot_observed_at":"2026-08-02T05:30:04.755723Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.13347","last_updated":"2026-07-16T21:13:23Z","snapshot_observed_at":"2026-08-13T05:59:12.760431Z","submitted_at":"2026-07-15T00:14:31Z","title":"LLM-as-a-Judge Scores Are Unreliable Optimization Signals in Closed-Loop Table Recognition","version":2},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-02T05:30:04.755723Z"},"links":{"cited_paper":"/paper/2310.17631","citing_paper":"/paper/2607.13347"},"observation_digest":"sha256:6da61de9dfc98f6cba786aa3e84f27e3eb066ea8426101274c020176c36505f3","observation_id":"7660ba61-ab08-49eb-80ce-c415e1ddf896","resolution":{"observed_at":"2026-08-02T05:30:04.755723Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.13347","last_updated":"2026-07-16T21:13:23Z","latest_version":2,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-13T05:59:12.760431Z","submitted_at":"2026-07-15T00:14:31Z","title":"LLM-as-a-Judge Scores Are Unreliable Optimization Signals in Closed-Loop Table Recognition"},"reference_resolution":{"displayed":47,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":44,"verified_exact":3,"verified_fuzzy":0},"total_outbound_references":47},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"thesis":"As of 18 August 2026, this Paper Citation Record lists 47 of 47 outbound references and 1 inbound Pith citation observation for arXiv:2607.13347."}