{"as_of":"2026-08-10T03:03:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:5422be72b2ecb0b6c0272119871e1212c2af7c0012dceaaf3b74711f3561156a","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":20,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":20,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":20,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":20,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-09T04:23:01.041270Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"pith","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":5,"observed_at":"2026-08-05T02:28:24.338817Z","source":"pith"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2402.04788","last_updated":"2024-06-11T06:21:46Z","snapshot_observed_at":"2026-08-05T04:13:25.261876Z","submitted_at":"2024-02-07T12:28:32Z","title":"MLLM-as-a-Judge: Assessing Multimodal LLM-as-a-Judge with Vision-Language Benchmark","version":3},"cited_work":{"arxiv_id":"2402.04788","doi":"10.48550/arxiv.2402.04788","metadata_source":"pith","pith_arxiv_id":"2402.04788","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"CoRR , volume =","venue":"cs.CL","work_id":"a9be674b-05ec-466a-997e-c530c6bdf0a1","year":2024},"citing_paper":{"arxiv_id":"2412.05579","last_updated":"2024-12-10T05:49:12Z","snapshot_observed_at":"2026-07-31T01:42:39.468673Z","submitted_at":"2024-12-07T08:07:24Z","title":"LLMs-as-Judges: A Comprehensive Survey on LLM-based Evaluation Methods","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-11T23:08:34.312466Z"},"links":{"cited_paper":"/paper/2402.04788","citing_paper":"/paper/2412.05579"},"observation_digest":"sha256:2653d54f70ec44d6374ac87425625b1a06b1fcf92c3d1ea867708424c3192a06","observation_id":"cb499709-1d31-4e76-9d12-ef6c59a6eaeb","resolution":{"observed_at":"2026-05-11T23:08:36.075491Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-05-24T14:25:06.426743+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-24T14:25:06.426743+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04788","last_updated":"2024-06-11T06:21:46Z","snapshot_observed_at":"2026-08-05T04:13:25.261876Z","submitted_at":"2024-02-07T12:28:32Z","title":"MLLM-as-a-Judge: Assessing Multimodal LLM-as-a-Judge with Vision-Language Benchmark","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.04788","snapshot_observed_at":"2026-08-09T04:23:01.041270Z","title":"Mllm-as-a-judge: Assessing multimodal llm-as-a-judge with vision-language benchmark","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.03629","last_updated":"2025-04-29T00:30:03Z","snapshot_observed_at":"2026-08-09T05:59:13.183608Z","submitted_at":"2025-02-05T21:35:48Z","title":"REALEDIT: Reddit Edits As a Large-scale Empirical Dataset for Image Transformations","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-09T04:23:01.041270Z"},"links":{"cited_paper":"/paper/2402.04788","citing_paper":"/paper/2502.03629"},"observation_digest":"sha256:199bf05fb4fa0c59ed298f0867c394023e8944be93e0924aae9f88c77a620b5c","observation_id":"85009f16-0f8c-42a4-9efe-30768a7fe44c","resolution":{"observed_at":"2026-08-09T04:23:01.041270Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04788","last_updated":"2024-06-11T06:21:46Z","snapshot_observed_at":"2026-08-05T04:13:25.261876Z","submitted_at":"2024-02-07T12:28:32Z","title":"MLLM-as-a-Judge: Assessing Multimodal LLM-as-a-Judge with Vision-Language Benchmark","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.04788","snapshot_observed_at":"2026-08-08T21:12:23.258498Z","title":"Mllm- as-a-judge: Assessing multimodal llm-as-a-judge with vision-language benchmark","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.05240","last_updated":"2025-02-12T14:43:02Z","snapshot_observed_at":"2026-08-10T00:38:45.519768Z","submitted_at":"2025-02-07T12:18:20Z","title":"Survey on AI-Generated Media Detection: From Non-MLLM to MLLM","version":2},"reference_index":196,"source":"pdf_text","source_observed_at":"2026-08-08T21:12:23.258498Z"},"links":{"cited_paper":"/paper/2402.04788","citing_paper":"/paper/2502.05240"},"observation_digest":"sha256:5ed1ee050d2427fef3e5af602db233d91ff8f7cf70364b58fdfbbfa78a474079","observation_id":"482411d4-fa0d-4e8a-8461-2d9a13dd25dd","resolution":{"observed_at":"2026-08-08T21:12:23.258498Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04788","last_updated":"2024-06-11T06:21:46Z","snapshot_observed_at":"2026-08-05T04:13:25.261876Z","submitted_at":"2024-02-07T12:28:32Z","title":"MLLM-as-a-Judge: Assessing Multimodal LLM-as-a-Judge with Vision-Language Benchmark","version":3},"cited_work":{"arxiv_id":"2402.04788","doi":"10.48550/arxiv.2402.04788","metadata_source":"pith","pith_arxiv_id":"2402.04788","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"CoRR , volume =","venue":"cs.CL","work_id":"a9be674b-05ec-466a-997e-c530c6bdf0a1","year":2024},"citing_paper":{"arxiv_id":"2502.18864","last_updated":"2025-02-26T06:17:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-26T06:17:13Z","title":"Towards an AI co-scientist","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-05-11T13:02:43.571234Z"},"links":{"cited_paper":"/paper/2402.04788","citing_paper":"/paper/2502.18864"},"observation_digest":"sha256:b4a6468737662aaebd15e0feeb3897d4ef6aed6ae37039daffc85b0ea985ca9c","observation_id":"e68f6283-fb80-43fa-ac1c-763f9e4bb065","resolution":{"observed_at":"2026-05-11T13:02:44.420423Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-05-24T14:25:06.426743+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-24T14:25:06.426743+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04788","last_updated":"2024-06-11T06:21:46Z","snapshot_observed_at":"2026-08-05T04:13:25.261876Z","submitted_at":"2024-02-07T12:28:32Z","title":"MLLM-as-a-Judge: Assessing Multimodal LLM-as-a-Judge with Vision-Language Benchmark","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.04788","snapshot_observed_at":"2026-08-07T15:03:36.345971Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.16425","last_updated":"2025-05-22T09:10:09Z","snapshot_observed_at":"2026-08-09T16:14:10.026741Z","submitted_at":"2025-05-22T09:10:09Z","title":"$I^2G$: Generating Instructional Illustrations via Text-Conditioned Diffusion","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-07T15:03:36.345971Z"},"links":{"cited_paper":"/paper/2402.04788","citing_paper":"/paper/2505.16425"},"observation_digest":"sha256:24142d39d72d1c44e9e6877144bb32a69f51ef598e14c9c4581cceb786350073","observation_id":"b34f1779-4abc-4d04-83ea-91e003946f69","resolution":{"observed_at":"2026-08-07T15:03:36.345971Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04788","last_updated":"2024-06-11T06:21:46Z","snapshot_observed_at":"2026-08-05T04:13:25.261876Z","submitted_at":"2024-02-07T12:28:32Z","title":"MLLM-as-a-Judge: Assessing Multimodal LLM-as-a-Judge with Vision-Language Benchmark","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.04788","snapshot_observed_at":"2026-08-07T14:53:05.448409Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17374","last_updated":"2025-05-23T01:12:57Z","snapshot_observed_at":"2026-08-07T21:48:37.451690Z","submitted_at":"2025-05-23T01:12:57Z","title":"Chart-to-Experience: Benchmarking Multimodal LLMs for Predicting Experiential Impact of Charts","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T14:53:05.448409Z"},"links":{"cited_paper":"/paper/2402.04788","citing_paper":"/paper/2505.17374"},"observation_digest":"sha256:209e93fcb7146b46f684bef78a7232d88bebc0c0d599eecdd9348db98acd05dc","observation_id":"983eec7b-6599-4169-9aea-8f3adc1d6000","resolution":{"observed_at":"2026-08-07T14:53:05.448409Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04788","last_updated":"2024-06-11T06:21:46Z","snapshot_observed_at":"2026-08-05T04:13:25.261876Z","submitted_at":"2024-02-07T12:28:32Z","title":"MLLM-as-a-Judge: Assessing Multimodal LLM-as-a-Judge with Vision-Language Benchmark","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.04788","snapshot_observed_at":"2026-08-07T12:55:50.251731Z","title":"Mllm-as-a-judge: Assessing multimodal llm-as-a-judge with vision-language benchmark","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.23186","last_updated":"2025-08-10T11:39:05Z","snapshot_observed_at":"2026-08-07T12:49:01.610117Z","submitted_at":"2025-05-29T07:23:40Z","title":"HiGarment: Cross-modal Harmony Based Diffusion Model for Flat Sketch to Realistic Garment Image","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T12:55:50.251731Z"},"links":{"cited_paper":"/paper/2402.04788","citing_paper":"/paper/2505.23186"},"observation_digest":"sha256:57dcb2ed2c6635350e64ac8f0bdec6ec7e284153a147c02d8bdb9942b8de9366","observation_id":"9b0b113d-24da-4dca-943b-db2765bbe411","resolution":{"observed_at":"2026-08-07T12:55:50.251731Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04788","last_updated":"2024-06-11T06:21:46Z","snapshot_observed_at":"2026-08-05T04:13:25.261876Z","submitted_at":"2024-02-07T12:28:32Z","title":"MLLM-as-a-Judge: Assessing Multimodal LLM-as-a-Judge with Vision-Language Benchmark","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.04788","snapshot_observed_at":"2026-08-07T12:02:10.486815Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00806","last_updated":"2025-06-01T03:15:29Z","snapshot_observed_at":"2026-08-09T07:52:39.727951Z","submitted_at":"2025-06-01T03:15:29Z","title":"Fast or Slow? Integrating Fast Intuition and Deliberate Thinking for Enhancing Visual Question Answering","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-07T12:02:10.486815Z"},"links":{"cited_paper":"/paper/2402.04788","citing_paper":"/paper/2506.00806"},"observation_digest":"sha256:107efc44135770f931f47a3921f276a37f7546581461eb32b2c82256a0662bff","observation_id":"206b4e58-b2e4-4ecb-9bce-193702e95578","resolution":{"observed_at":"2026-08-07T12:02:10.486815Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04788","last_updated":"2024-06-11T06:21:46Z","snapshot_observed_at":"2026-08-05T04:13:25.261876Z","submitted_at":"2024-02-07T12:28:32Z","title":"MLLM-as-a-Judge: Assessing Multimodal LLM-as-a-Judge with Vision-Language Benchmark","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.04788","snapshot_observed_at":"2026-08-06T23:20:54.855811Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.18407","last_updated":"2025-09-09T12:36:01Z","snapshot_observed_at":"2026-08-10T02:30:04.581298Z","submitted_at":"2025-06-23T08:42:57Z","title":"IntuiTF: MLLM-Guided Transfer Function Optimization for Direct Volume Rendering","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T23:20:54.855811Z"},"links":{"cited_paper":"/paper/2402.04788","citing_paper":"/paper/2506.18407"},"observation_digest":"sha256:4fe2f5b81a1a9112e863cf88081cfc66b89aaa0f9d0c0fba254bf9cb2a75b9a3","observation_id":"fa370235-2ae2-4352-96ee-a0c211d7ee3a","resolution":{"observed_at":"2026-08-06T23:20:54.855811Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04788","last_updated":"2024-06-11T06:21:46Z","snapshot_observed_at":"2026-08-05T04:13:25.261876Z","submitted_at":"2024-02-07T12:28:32Z","title":"MLLM-as-a-Judge: Assessing Multimodal LLM-as-a-Judge with Vision-Language Benchmark","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.04788","snapshot_observed_at":"2026-08-06T14:56:03.479513Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.17788","last_updated":"2025-07-23T09:54:44Z","snapshot_observed_at":"2026-08-07T18:36:05.499573Z","submitted_at":"2025-07-23T09:54:44Z","title":"Adaptive Repetition for Mitigating Position Bias in LLM-Based Ranking","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T14:56:03.479513Z"},"links":{"cited_paper":"/paper/2402.04788","citing_paper":"/paper/2507.17788"},"observation_digest":"sha256:9dfedc5664a9d255220c88b81cc604a97dccac51bb3d3eb5a0608d854b95c5f9","observation_id":"1a200616-6228-4a03-a1ee-4fe5f100a1a2","resolution":{"observed_at":"2026-08-06T14:56:03.479513Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04788","last_updated":"2024-06-11T06:21:46Z","snapshot_observed_at":"2026-08-05T04:13:25.261876Z","submitted_at":"2024-02-07T12:28:32Z","title":"MLLM-as-a-Judge: Assessing Multimodal LLM-as-a-Judge with Vision-Language Benchmark","version":3},"cited_work":{"arxiv_id":"2402.04788","doi":"10.48550/arxiv.2402.04788","metadata_source":"pith","pith_arxiv_id":"2402.04788","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"CoRR , volume =","venue":"cs.CL","work_id":"a9be674b-05ec-466a-997e-c530c6bdf0a1","year":2024},"citing_paper":{"arxiv_id":"2604.05955","last_updated":"2026-04-07T14:47:27Z","snapshot_observed_at":"2026-07-06T22:54:34.877944Z","submitted_at":"2026-04-07T14:47:27Z","title":"Does Pass Rate Tell the Whole Story? Evaluating Design Constraint Compliance in LLM-based Issue Resolution","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-10T18:45:06.682021Z"},"links":{"cited_paper":"/paper/2402.04788","citing_paper":"/paper/2604.05955"},"observation_digest":"sha256:486e8bf006a46208b3eeb549e7340a760cfc623185fe8929ac7f514202948d1b","observation_id":"a5e47dc2-c021-40db-aded-c3635a193cdb","resolution":{"observed_at":"2026-05-10T18:45:43.535505Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-05-24T14:25:06.426743+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-24T14:25:06.426743+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04788","last_updated":"2024-06-11T06:21:46Z","snapshot_observed_at":"2026-08-05T04:13:25.261876Z","submitted_at":"2024-02-07T12:28:32Z","title":"MLLM-as-a-Judge: Assessing Multimodal LLM-as-a-Judge with Vision-Language Benchmark","version":3},"cited_work":{"arxiv_id":"2402.04788","doi":"10.48550/arxiv.2402.04788","metadata_source":"pith","pith_arxiv_id":"2402.04788","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"CoRR , volume =","venue":"cs.CL","work_id":"a9be674b-05ec-466a-997e-c530c6bdf0a1","year":2024},"citing_paper":{"arxiv_id":"2605.15300","last_updated":"2026-05-14T18:14:15Z","snapshot_observed_at":"2026-07-06T23:26:37.362117Z","submitted_at":"2026-05-14T18:14:15Z","title":"Deep Pre-Alignment for VLMs","version":1},"reference_index":75,"source":"arxiv_source","source_observed_at":"2026-05-19T16:26:41.094936Z"},"links":{"cited_paper":"/paper/2402.04788","citing_paper":"/paper/2605.15300"},"observation_digest":"sha256:5ed5ccada16d60765af93a2890a66b07f00e75af9bf12cc893a742a477219d9b","observation_id":"c474bfe6-1dca-4c9c-a17f-4b61f9cf7df5","resolution":{"observed_at":"2026-05-19T16:27:39.161323Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-05-24T14:25:06.426743+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-24T14:25:06.426743+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04788","last_updated":"2024-06-11T06:21:46Z","snapshot_observed_at":"2026-08-05T04:13:25.261876Z","submitted_at":"2024-02-07T12:28:32Z","title":"MLLM-as-a-Judge: Assessing Multimodal LLM-as-a-Judge with Vision-Language Benchmark","version":3},"cited_work":{"arxiv_id":"2402.04788","doi":"10.48550/arxiv.2402.04788","metadata_source":"pith","pith_arxiv_id":"2402.04788","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"CoRR , volume =","venue":"cs.CL","work_id":"a9be674b-05ec-466a-997e-c530c6bdf0a1","year":2024},"citing_paper":{"arxiv_id":"2606.04773","last_updated":"2026-06-03T11:53:57Z","snapshot_observed_at":"2026-08-07T06:09:02.341844Z","submitted_at":"2026-06-03T11:53:57Z","title":"NextMotionQA: Benchmarking and Judging Human Motion Understanding with Vision-Language Models","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-06-28T06:55:22.332372Z"},"links":{"cited_paper":"/paper/2402.04788","citing_paper":"/paper/2606.04773"},"observation_digest":"sha256:30e2b577b5741507f7920dd296e1b7d8a02d9a6532b4a8e6362d099f3771a1b7","observation_id":"f58c1f56-4a97-4173-a55b-6348d1112e3b","resolution":{"observed_at":"2026-07-02T07:26:46.211206Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-05-24T14:25:06.426743+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-24T14:25:06.426743+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04788","last_updated":"2024-06-11T06:21:46Z","snapshot_observed_at":"2026-08-05T04:13:25.261876Z","submitted_at":"2024-02-07T12:28:32Z","title":"MLLM-as-a-Judge: Assessing Multimodal LLM-as-a-Judge with Vision-Language Benchmark","version":3},"cited_work":{"arxiv_id":"2402.04788","doi":"10.48550/arxiv.2402.04788","metadata_source":"pith","pith_arxiv_id":"2402.04788","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"CoRR , volume =","venue":"cs.CL","work_id":"a9be674b-05ec-466a-997e-c530c6bdf0a1","year":2024},"citing_paper":{"arxiv_id":"2606.25432","last_updated":"2026-06-29T19:08:38Z","snapshot_observed_at":"2026-08-06T21:03:12.899914Z","submitted_at":"2026-06-24T05:50:28Z","title":"Brevity is the Soul of Inference Efficiency: Inducing Concision in VLMs via Data Curation","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-06-25T21:05:36.836361Z"},"links":{"cited_paper":"/paper/2402.04788","citing_paper":"/paper/2606.25432"},"observation_digest":"sha256:8562f09bfbd1e6b5866093a2c2d68759114d2493600a2d52b260277d6a33d5bd","observation_id":"43aab11e-2796-4f18-aa2a-f935279c612a","resolution":{"observed_at":"2026-07-04T19:40:07.108811Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-05-24T14:25:06.426743+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-24T14:25:06.426743+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04788","last_updated":"2024-06-11T06:21:46Z","snapshot_observed_at":"2026-08-05T04:13:25.261876Z","submitted_at":"2024-02-07T12:28:32Z","title":"MLLM-as-a-Judge: Assessing Multimodal LLM-as-a-Judge with Vision-Language Benchmark","version":3},"cited_work":{"arxiv_id":"2402.04788","doi":"10.48550/arxiv.2402.04788","metadata_source":"pith","pith_arxiv_id":"2402.04788","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"CoRR , volume =","venue":"cs.CL","work_id":"a9be674b-05ec-466a-997e-c530c6bdf0a1","year":2024},"citing_paper":{"arxiv_id":"2606.25432","last_updated":"2026-06-29T19:08:38Z","snapshot_observed_at":"2026-08-06T21:03:12.899914Z","submitted_at":"2026-06-24T05:50:28Z","title":"Brevity is the Soul of Inference Efficiency: Inducing Concision in VLMs via Data Curation","version":2},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-07-01T06:30:27.178950Z"},"links":{"cited_paper":"/paper/2402.04788","citing_paper":"/paper/2606.25432"},"observation_digest":"sha256:353ec45c533457f5d45bbb6c6ea687c63bf2ca161badd5c4899c66835272b834","observation_id":"4ae4865e-347b-4249-823b-2178a3383d0d","resolution":{"observed_at":"2026-07-01T09:35:39.554250Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-05-24T14:25:06.426743+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-24T14:25:06.426743+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04788","last_updated":"2024-06-11T06:21:46Z","snapshot_observed_at":"2026-08-05T04:13:25.261876Z","submitted_at":"2024-02-07T12:28:32Z","title":"MLLM-as-a-Judge: Assessing Multimodal LLM-as-a-Judge with Vision-Language Benchmark","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.04788","snapshot_observed_at":"2026-07-12T01:50:59.184754Z","title":"arXiv preprint arXiv:2402.04788 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.03530","last_updated":"2026-07-03T17:59:58Z","snapshot_observed_at":"2026-08-04T18:44:44.436706Z","submitted_at":"2026-07-03T17:59:58Z","title":"MentalThink: Shaping Thoughts in Mental SVG World","version":1},"reference_index":229,"source":"arxiv_source","source_observed_at":"2026-07-12T01:50:59.184754Z"},"links":{"cited_paper":"/paper/2402.04788","citing_paper":"/paper/2607.03530"},"observation_digest":"sha256:e27b999fb5c647131feb7645411e00de5be95070f2f2d87342c99de656f179f8","observation_id":"4c088528-20a4-49ec-af11-57dd9238495d","resolution":{"observed_at":"2026-07-12T01:50:59.184754Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04788","last_updated":"2024-06-11T06:21:46Z","snapshot_observed_at":"2026-08-05T04:13:25.261876Z","submitted_at":"2024-02-07T12:28:32Z","title":"MLLM-as-a-Judge: Assessing Multimodal LLM-as-a-Judge with Vision-Language Benchmark","version":3},"cited_work":{"arxiv_id":"2402.04788","doi":"10.48550/arxiv.2402.04788","metadata_source":"pith","pith_arxiv_id":"2402.04788","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"CoRR , volume =","venue":"cs.CL","work_id":"a9be674b-05ec-466a-997e-c530c6bdf0a1","year":2024},"citing_paper":{"arxiv_id":"2607.05391","last_updated":"2026-07-07T17:26:37Z","snapshot_observed_at":"2026-08-06T03:00:58.001418Z","submitted_at":"2026-07-06T17:59:35Z","title":"LLM-as-a-Verifier: A General-Purpose Verification Framework","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-07-07T12:47:29.552283Z"},"links":{"cited_paper":"/paper/2402.04788","citing_paper":"/paper/2607.05391"},"observation_digest":"sha256:d68dffb2c4765a18ddba6fa3b476a54f5bca9b388bca999064fb23d6eb18fa09","observation_id":"0f92b4b2-4ed7-4543-910f-cf5899c7687a","resolution":{"observed_at":"2026-07-07T12:53:50.221998Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-05-24T14:25:06.426743+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-24T14:25:06.426743+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04788","last_updated":"2024-06-11T06:21:46Z","snapshot_observed_at":"2026-08-05T04:13:25.261876Z","submitted_at":"2024-02-07T12:28:32Z","title":"MLLM-as-a-Judge: Assessing Multimodal LLM-as-a-Judge with Vision-Language Benchmark","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.04788","snapshot_observed_at":"2026-07-11T07:02:51.850836Z","title":"MLLM-as-a-judge: Assessing multimodal LLM-as-a-judge with vision-language benchmark, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.05391","last_updated":"2026-07-07T17:26:37Z","snapshot_observed_at":"2026-08-06T03:00:58.001418Z","submitted_at":"2026-07-06T17:59:35Z","title":"LLM-as-a-Verifier: A General-Purpose Verification Framework","version":2},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-07-11T07:02:51.850836Z"},"links":{"cited_paper":"/paper/2402.04788","citing_paper":"/paper/2607.05391"},"observation_digest":"sha256:7a55c0ac795414dbd5fac44a5547ab28945116747b22e18b4a066adbee427f0f","observation_id":"7fe4ef8e-7ef3-4cbb-90fe-4457cebebf50","resolution":{"observed_at":"2026-07-11T07:02:51.850836Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04788","last_updated":"2024-06-11T06:21:46Z","snapshot_observed_at":"2026-08-05T04:13:25.261876Z","submitted_at":"2024-02-07T12:28:32Z","title":"MLLM-as-a-Judge: Assessing Multimodal LLM-as-a-Judge with Vision-Language Benchmark","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.04788","snapshot_observed_at":"2026-07-31T02:18:01.617281Z","title":"Mllm-as-a-judge: Assessing multimodal llm-as-a-judge with vision-language benchmark, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.28609","last_updated":"2026-08-06T17:55:59Z","snapshot_observed_at":"2026-08-09T23:12:22.871674Z","submitted_at":"2026-07-30T17:57:41Z","title":"OSReward: Instituting Standardized Evaluation for Cross-Platform Computer-Use Reward Models","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-07-31T02:18:01.617281Z"},"links":{"cited_paper":"/paper/2402.04788","citing_paper":"/paper/2607.28609"},"observation_digest":"sha256:60e27d23de8e682250dd7627e81b792d1f0d9d2b4c7ed2699365d2d31eb43159","observation_id":"50983d72-a1f0-41fc-9126-68fad673c8f0","resolution":{"observed_at":"2026-07-31T02:18:01.617281Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04788","last_updated":"2024-06-11T06:21:46Z","snapshot_observed_at":"2026-08-05T04:13:25.261876Z","submitted_at":"2024-02-07T12:28:32Z","title":"MLLM-as-a-Judge: Assessing Multimodal LLM-as-a-Judge with Vision-Language Benchmark","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.04788","snapshot_observed_at":"2026-08-03T00:55:42.558312Z","title":"arXiv preprint arXiv:2402.04788 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28636","last_updated":"2026-05-19T13:56:13Z","snapshot_observed_at":"2026-08-06T00:38:04.006327Z","submitted_at":"2026-05-19T13:56:13Z","title":"Chain-of-Models: Cross-Model Auditing for Bias-Robust LLM Judges","version":1},"reference_index":288,"source":"arxiv_source","source_observed_at":"2026-08-03T00:55:42.558312Z"},"links":{"cited_paper":"/paper/2402.04788","citing_paper":"/paper/2607.28636"},"observation_digest":"sha256:1ad925ba18049a4e3f916004939acabbc8156a3f88d727591327a77b3e65a226","observation_id":"646e77bc-12dd-4ed3-8be8-7c4c6a2375ff","resolution":{"observed_at":"2026-08-03T00:55:42.558312Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2402.04788/citation-record","integrity":"/paper/2402.04788/integrity","json":"/paper/2402.04788/citation-record.json","paper":"/paper/2402.04788"},"outbound":[],"paper":{"arxiv_id":"2402.04788","last_updated":"2024-06-11T06:21:46Z","latest_version":3,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-05T04:13:25.261876Z","submitted_at":"2024-02-07T12:28:32Z","title":"MLLM-as-a-Judge: Assessing Multimodal LLM-as-a-Judge with Vision-Language Benchmark"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 20 inbound Pith citation observations for arXiv:2402.04788."}