{"as_of":"2026-08-07T16:43:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:d9cf043b7cd1d271714b16b8550845893c7c01ae4f1f8a5d212b8160e3590367","coverage":[{"denominator":52,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":52,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-26T09:04:23.965554Z","state":"measured"},{"denominator":53,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":53,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-09T03:36:57.168246Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-07-09T03:45:55.380810Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2606.22918","last_updated":"2026-06-22T06:58:39Z","snapshot_observed_at":"2026-07-06T23:57:42.632111Z","submitted_at":"2026-06-22T06:58:39Z","title":"Each Judge Its Own Yardstick: Discovering Per-VLM Taxonomies for Physical Video Evaluation","version":1},"cited_work":{"arxiv_id":"2606.22918","doi":null,"metadata_source":"pith","pith_arxiv_id":"2606.22918","snapshot_observed_at":"2026-07-09T03:45:55.380810Z","title":"Each Judge Its Own Yardstick: Discovering Per-VLM Taxonomies for Physical Video Evaluation","venue":"cs.CV","work_id":"5c482a5b-e532-4b6b-a29b-25ad2ea52aa8","year":2026},"citing_paper":{"arxiv_id":"2607.07663","last_updated":"2026-07-08T17:19:50Z","snapshot_observed_at":"2026-07-30T01:44:04.256851Z","submitted_at":"2026-07-08T17:19:50Z","title":"Recursive Self-Improvement in AI: From Bounded Self-Refinement to Autonomous Research Loops","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-07-09T03:36:57.168246Z"},"links":{"cited_paper":"/paper/2606.22918","citing_paper":"/paper/2607.07663"},"observation_digest":"sha256:99c874f33df713b54f9087ef66b5aa9bbe3e1eb572d813894e06eb2141042837","observation_id":"b13de402-a511-4b9c-9cb1-ffef1cdc9121","resolution":{"observed_at":"2026-07-09T03:45:55.382139Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2606.22918/citation-record","integrity":"/paper/2606.22918/integrity","json":"/paper/2606.22918/citation-record.json","paper":"/paper/2606.22918"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T09:04:23.965554Z","title":"Advances in neural information processing systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.22918","last_updated":"2026-06-22T06:58:39Z","snapshot_observed_at":"2026-07-06T23:57:42.632111Z","submitted_at":"2026-06-22T06:58:39Z","title":"Each Judge Its Own Yardstick: Discovering Per-VLM Taxonomies for Physical Video Evaluation","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-06-26T09:04:23.965554Z"},"links":{"citing_paper":"/paper/2606.22918"},"observation_digest":"sha256:4349e08745ed219752244647857bb4bd2ab9a1d6340e4ecce6c824b6c3759875","observation_id":"3fa1e195-0410-4090-a25f-26bd0b8457de","resolution":{"observed_at":"2026-06-26T09:04:23.965554Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T09:04:23.965554Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.22918","last_updated":"2026-06-22T06:58:39Z","snapshot_observed_at":"2026-07-06T23:57:42.632111Z","submitted_at":"2026-06-22T06:58:39Z","title":"Each Judge Its Own Yardstick: Discovering Per-VLM Taxonomies for Physical Video Evaluation","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-06-26T09:04:23.965554Z"},"links":{"citing_paper":"/paper/2606.22918"},"observation_digest":"sha256:6a27a7f59c595ebebd17dc7503c8ed610d0e220ff905eb3d25a21cb7d3ccf186","observation_id":"e36bdf9e-9c82-4a6e-9485-1d2255626418","resolution":{"observed_at":"2026-06-26T09:04:23.965554Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T09:04:23.965554Z","title":"Forty-first International Conference on Machine Learning , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.22918","last_updated":"2026-06-22T06:58:39Z","snapshot_observed_at":"2026-07-06T23:57:42.632111Z","submitted_at":"2026-06-22T06:58:39Z","title":"Each Judge Its Own Yardstick: Discovering Per-VLM Taxonomies for Physical Video Evaluation","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-06-26T09:04:23.965554Z"},"links":{"citing_paper":"/paper/2606.22918"},"observation_digest":"sha256:608e73c545d86b73fadc8c2e29e5546037bb35605061f22f14bbadd04fd5c91d","observation_id":"30b6aa39-fd90-4d17-9024-cbe711ee770c","resolution":{"observed_at":"2026-06-26T09:04:23.965554Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T09:04:23.965554Z","title":"Proceedings of the 2024 Conference on Empirical Methods in Natural Language Processing , pages=","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.22918","last_updated":"2026-06-22T06:58:39Z","snapshot_observed_at":"2026-07-06T23:57:42.632111Z","submitted_at":"2026-06-22T06:58:39Z","title":"Each Judge Its Own Yardstick: Discovering Per-VLM Taxonomies for Physical Video Evaluation","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-06-26T09:04:23.965554Z"},"links":{"citing_paper":"/paper/2606.22918"},"observation_digest":"sha256:0d7fac952f4561a9a622fe123348d1090b80937f253a5cbf876ce43c80b23a70","observation_id":"5ad7ef0b-6a1b-4b12-8b76-d58c6558ba00","resolution":{"observed_at":"2026-06-26T09:04:23.965554Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T09:04:23.965554Z","title":"International Conference on Learning Representations , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.22918","last_updated":"2026-06-22T06:58:39Z","snapshot_observed_at":"2026-07-06T23:57:42.632111Z","submitted_at":"2026-06-22T06:58:39Z","title":"Each Judge Its Own Yardstick: Discovering Per-VLM Taxonomies for Physical Video Evaluation","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-06-26T09:04:23.965554Z"},"links":{"citing_paper":"/paper/2606.22918"},"observation_digest":"sha256:fd115398e78f073880e51270fb5ff23e77d4d712fb884c565669abef0f05a228","observation_id":"29b6d170-03aa-4c78-87ac-fc97d0768f03","resolution":{"observed_at":"2026-06-26T09:04:23.965554Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2509.08826","last_updated":"2025-09-10T17:59:31Z","snapshot_observed_at":"2026-08-07T13:58:40.131270Z","submitted_at":"2025-09-10T17:59:31Z","title":"RewardDance: Reward Scaling in Visual Generation","version":1},"cited_work":{"arxiv_id":"2509.08826","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2509.08826","snapshot_observed_at":"2026-07-04T10:39:45.924030Z","title":"Rewarddance: Reward scaling in visual generation","venue":null,"work_id":"eb1c8722-7fb8-4284-9c9d-37b91aa2cebf","year":2025},"citing_paper":{"arxiv_id":"2606.22918","last_updated":"2026-06-22T06:58:39Z","snapshot_observed_at":"2026-07-06T23:57:42.632111Z","submitted_at":"2026-06-22T06:58:39Z","title":"Each Judge Its Own Yardstick: Discovering Per-VLM Taxonomies for Physical Video Evaluation","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-06-26T09:04:23.965554Z"},"links":{"cited_paper":"/paper/2509.08826","citing_paper":"/paper/2606.22918"},"observation_digest":"sha256:53b90ba1e68cf09703fc972272d07a20fa24f449c59d9c7f2a1677da50efcb9c","observation_id":"494cc52e-0a45-4538-8d3d-0487d70aa0d5","resolution":{"observed_at":"2026-07-04T10:09:45.413050Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T09:04:23.965554Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.22918","last_updated":"2026-06-22T06:58:39Z","snapshot_observed_at":"2026-07-06T23:57:42.632111Z","submitted_at":"2026-06-22T06:58:39Z","title":"Each Judge Its Own Yardstick: Discovering Per-VLM Taxonomies for Physical Video Evaluation","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-06-26T09:04:23.965554Z"},"links":{"citing_paper":"/paper/2606.22918"},"observation_digest":"sha256:4cee85144e531b43d6439924974f43c5f34983340e39f77ae0e57b8b76a87738","observation_id":"a3284172-76c9-4e98-8737-2e9cf1dbdfdb","resolution":{"observed_at":"2026-06-26T09:04:23.965554Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T09:04:23.965554Z","title":"Proceedings of the 62nd Annual Meeting of the Association for Computational Linguistics (Volume 1: Long Papers) , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.22918","last_updated":"2026-06-22T06:58:39Z","snapshot_observed_at":"2026-07-06T23:57:42.632111Z","submitted_at":"2026-06-22T06:58:39Z","title":"Each Judge Its Own Yardstick: Discovering Per-VLM Taxonomies for Physical Video Evaluation","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-06-26T09:04:23.965554Z"},"links":{"citing_paper":"/paper/2606.22918"},"observation_digest":"sha256:b42aaec915f299f5580a08483e407063ec3680fadc161af5caeab16265d713b0","observation_id":"241084a7-a459-49df-b380-c974c7fd611b","resolution":{"observed_at":"2026-06-26T09:04:23.965554Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T09:04:23.965554Z","title":"Proceedings of the 2024 joint international conference on computational linguistics, language resources and evaluation (lrec-coling 2024) , pages=","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.22918","last_updated":"2026-06-22T06:58:39Z","snapshot_observed_at":"2026-07-06T23:57:42.632111Z","submitted_at":"2026-06-22T06:58:39Z","title":"Each Judge Its Own Yardstick: Discovering Per-VLM Taxonomies for Physical Video Evaluation","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-06-26T09:04:23.965554Z"},"links":{"citing_paper":"/paper/2606.22918"},"observation_digest":"sha256:365eb4e66ab87bbaa1d9ff0eec0e20a2a2815774487ac6e6b865c341e17864f0","observation_id":"61ded28d-8c76-4788-bd65-0c52ce2c9b9d","resolution":{"observed_at":"2026-06-26T09:04:23.965554Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T09:04:23.965554Z","title":"International Conference on Learning Representations , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.22918","last_updated":"2026-06-22T06:58:39Z","snapshot_observed_at":"2026-07-06T23:57:42.632111Z","submitted_at":"2026-06-22T06:58:39Z","title":"Each Judge Its Own Yardstick: Discovering Per-VLM Taxonomies for Physical Video Evaluation","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-06-26T09:04:23.965554Z"},"links":{"citing_paper":"/paper/2606.22918"},"observation_digest":"sha256:7f0a0e4298e40d7cf108d5603d7e2cf1030b8abdcfa8583702deb9c916e05c19","observation_id":"41d5d8ca-bd75-482f-8c81-3bf71f6868f1","resolution":{"observed_at":"2026-06-26T09:04:23.965554Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.06800","last_updated":"2025-03-09T22:49:12Z","snapshot_observed_at":"2026-08-04T19:41:18.206234Z","submitted_at":"2025-03-09T22:49:12Z","title":"VideoPhy-2: A Challenging Action-Centric Physical Commonsense Evaluation in Video Generation","version":1},"cited_work":{"arxiv_id":"2503.06800","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2503.06800","snapshot_observed_at":"2026-07-04T13:19:51.020711Z","title":"Videophy-2: A challenging action-centric physical commonsense evaluation in video generation","venue":null,"work_id":"4dfe3980-dfd5-4917-95e9-179c29e4eb18","year":2025},"citing_paper":{"arxiv_id":"2606.22918","last_updated":"2026-06-22T06:58:39Z","snapshot_observed_at":"2026-07-06T23:57:42.632111Z","submitted_at":"2026-06-22T06:58:39Z","title":"Each Judge Its Own Yardstick: Discovering Per-VLM Taxonomies for Physical Video Evaluation","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-06-26T09:04:23.965554Z"},"links":{"cited_paper":"/paper/2503.06800","citing_paper":"/paper/2606.22918"},"observation_digest":"sha256:72ef8d11b69ddd4d90b717881d53430a29cbf1bf8304cf00a952281d7f48129a","observation_id":"7e2c8aa6-6fec-46e8-a275-c5d9d023e5a7","resolution":{"observed_at":"2026-07-04T10:09:45.415761Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.05363","last_updated":"2024-10-07T17:56:04Z","snapshot_observed_at":"2026-07-06T19:29:14.335016Z","submitted_at":"2024-10-07T17:56:04Z","title":"Towards World Simulator: Crafting Physical Commonsense-Based Benchmark for Video Generation","version":1},"cited_work":{"arxiv_id":"2410.05363","doi":null,"metadata_source":"pith","pith_arxiv_id":"2410.05363","snapshot_observed_at":"2026-07-08T07:14:45.198485Z","title":"Towards World Simulator: Crafting Physical Commonsense-Based Benchmark for Video Generation","venue":"cs.CV","work_id":"644e2886-7387-436d-ac11-d848af5fcc71","year":2024},"citing_paper":{"arxiv_id":"2606.22918","last_updated":"2026-06-22T06:58:39Z","snapshot_observed_at":"2026-07-06T23:57:42.632111Z","submitted_at":"2026-06-22T06:58:39Z","title":"Each Judge Its Own Yardstick: Discovering Per-VLM Taxonomies for Physical Video Evaluation","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-06-26T09:04:23.965554Z"},"links":{"cited_paper":"/paper/2410.05363","citing_paper":"/paper/2606.22918"},"observation_digest":"sha256:12175ce5d8cecfe1603c78788a61369809090c3160cd0042097ef6848b8d2197","observation_id":"20dc1c54-c996-4481-9989-2822646f30e4","resolution":{"observed_at":"2026-07-04T10:09:45.403074Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T09:04:23.965554Z","title":"International Conference on Learning Representations , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.22918","last_updated":"2026-06-22T06:58:39Z","snapshot_observed_at":"2026-07-06T23:57:42.632111Z","submitted_at":"2026-06-22T06:58:39Z","title":"Each Judge Its Own Yardstick: Discovering Per-VLM Taxonomies for Physical Video Evaluation","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-06-26T09:04:23.965554Z"},"links":{"citing_paper":"/paper/2606.22918"},"observation_digest":"sha256:466480a5f3f2ac7124114b727addf98ad6ab0041f8efeb37db7e9c439d9c9696","observation_id":"b3105f87-db35-4e0b-885f-536f07b39ce1","resolution":{"observed_at":"2026-06-26T09:04:23.965554Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T09:04:23.965554Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.22918","last_updated":"2026-06-22T06:58:39Z","snapshot_observed_at":"2026-07-06T23:57:42.632111Z","submitted_at":"2026-06-22T06:58:39Z","title":"Each Judge Its Own Yardstick: Discovering Per-VLM Taxonomies for Physical Video Evaluation","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-06-26T09:04:23.965554Z"},"links":{"citing_paper":"/paper/2606.22918"},"observation_digest":"sha256:617dd97e3656d6b0fab3dcec531ae4a22f89b96e6fe636219bed829c4d8159db","observation_id":"eea4db30-50e9-4def-bb2f-c53b9546051d","resolution":{"observed_at":"2026-06-26T09:04:23.965554Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T09:04:23.965554Z","title":"Proceedings of the IEEE/CVF Winter Conference on Applications of Computer Vision , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.22918","last_updated":"2026-06-22T06:58:39Z","snapshot_observed_at":"2026-07-06T23:57:42.632111Z","submitted_at":"2026-06-22T06:58:39Z","title":"Each Judge Its Own Yardstick: Discovering Per-VLM Taxonomies for Physical Video Evaluation","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-06-26T09:04:23.965554Z"},"links":{"citing_paper":"/paper/2606.22918"},"observation_digest":"sha256:61dbeca241d37a8f7109e9a7dd6c0c75a5eb43162bf915a6734c4f14dc2e7afb","observation_id":"4461a237-7e30-4f1a-bb94-b22d22454f3c","resolution":{"observed_at":"2026-06-26T09:04:23.965554Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T09:04:23.965554Z","title":"International Conference on Learning Representations , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.22918","last_updated":"2026-06-22T06:58:39Z","snapshot_observed_at":"2026-07-06T23:57:42.632111Z","submitted_at":"2026-06-22T06:58:39Z","title":"Each Judge Its Own Yardstick: Discovering Per-VLM Taxonomies for Physical Video Evaluation","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-06-26T09:04:23.965554Z"},"links":{"citing_paper":"/paper/2606.22918"},"observation_digest":"sha256:614a1c5495d05a9bab3ed414a0156b9a92b828b041462814100f8a60d867721a","observation_id":"f9b1df0d-c172-496a-b3e2-a66e25e8ed6b","resolution":{"observed_at":"2026-06-26T09:04:23.965554Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T09:04:23.965554Z","title":"gradient descent","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.22918","last_updated":"2026-06-22T06:58:39Z","snapshot_observed_at":"2026-07-06T23:57:42.632111Z","submitted_at":"2026-06-22T06:58:39Z","title":"Each Judge Its Own Yardstick: Discovering Per-VLM Taxonomies for Physical Video Evaluation","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-06-26T09:04:23.965554Z"},"links":{"citing_paper":"/paper/2606.22918"},"observation_digest":"sha256:b861bfcc0b1fdd9c25fd8adb618047232b92d7e57595db44fe92f4692ca9d178","observation_id":"fedd28fe-db03-499e-aefb-2a52033aac42","resolution":{"observed_at":"2026-06-26T09:04:23.965554Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T09:04:23.965554Z","title":"Nature , volume=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.22918","last_updated":"2026-06-22T06:58:39Z","snapshot_observed_at":"2026-07-06T23:57:42.632111Z","submitted_at":"2026-06-22T06:58:39Z","title":"Each Judge Its Own Yardstick: Discovering Per-VLM Taxonomies for Physical Video Evaluation","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-06-26T09:04:23.965554Z"},"links":{"citing_paper":"/paper/2606.22918"},"observation_digest":"sha256:c0471b3cf6ee392465437bf526ca9905262f6c9eb8b30f0039f95850c60c3a96","observation_id":"4d9ea69d-8c20-4ec2-8935-8226e7226208","resolution":{"observed_at":"2026-06-26T09:04:23.965554Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.03714","last_updated":"2023-10-05T17:37:25Z","snapshot_observed_at":"2026-08-04T05:21:05.846165Z","submitted_at":"2023-10-05T17:37:25Z","title":"DSPy: Compiling Declarative Language Model Calls into Self-Improving Pipelines","version":1},"cited_work":{"arxiv_id":"2310.03714","doi":"10.48550/arxiv.2310.03714","metadata_source":"pith","pith_arxiv_id":"2310.03714","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"DSPy: Compiling Declarative Language Model Calls into Self-Improving Pipelines","venue":"cs.CL","work_id":"d490f594-f5fc-47b0-ae6a-6550e50fe095","year":2023},"citing_paper":{"arxiv_id":"2606.22918","last_updated":"2026-06-22T06:58:39Z","snapshot_observed_at":"2026-07-06T23:57:42.632111Z","submitted_at":"2026-06-22T06:58:39Z","title":"Each Judge Its Own Yardstick: Discovering Per-VLM Taxonomies for Physical Video Evaluation","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-06-26T09:04:23.965554Z"},"links":{"cited_paper":"/paper/2310.03714","citing_paper":"/paper/2606.22918"},"observation_digest":"sha256:d17cd1d337ebd17381d2a95f7541d6bf6d961c32645c02c445c8ff62caca4a76","observation_id":"1f00d957-9c79-4efb-8515-20fc65ced53e","resolution":{"observed_at":"2026-07-04T10:09:45.405545Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T09:04:23.965554Z","title":"Proceedings of the 37th Annual ACM Symposium on User Interface Software and Technology , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.22918","last_updated":"2026-06-22T06:58:39Z","snapshot_observed_at":"2026-07-06T23:57:42.632111Z","submitted_at":"2026-06-22T06:58:39Z","title":"Each Judge Its Own Yardstick: Discovering Per-VLM Taxonomies for Physical Video Evaluation","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-06-26T09:04:23.965554Z"},"links":{"citing_paper":"/paper/2606.22918"},"observation_digest":"sha256:b6287d3a7098af30836d19a6bf360f05d1a4226a8b601434a5521946e8fbc3df","observation_id":"c716a776-ab15-4099-8577-59dbe79dc274","resolution":{"observed_at":"2026-06-26T09:04:23.965554Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T09:04:23.965554Z","title":"Proceedings of the 62nd Annual Meeting of the Association for Computational Linguistics (Volume 1: Long Papers) , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.22918","last_updated":"2026-06-22T06:58:39Z","snapshot_observed_at":"2026-07-06T23:57:42.632111Z","submitted_at":"2026-06-22T06:58:39Z","title":"Each Judge Its Own Yardstick: Discovering Per-VLM Taxonomies for Physical Video Evaluation","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-06-26T09:04:23.965554Z"},"links":{"citing_paper":"/paper/2606.22918"},"observation_digest":"sha256:ef1b99c0482e15ca3d9d219daa2bbfb4ebe672962ec4c8b878aee0d89f211459","observation_id":"437048b5-1ff6-47fa-ad62-3cf699ca5278","resolution":{"observed_at":"2026-06-26T09:04:23.965554Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T09:04:23.965554Z","title":"Findings of the Association for Computational Linguistics: EACL 2026 , pages=","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2606.22918","last_updated":"2026-06-22T06:58:39Z","snapshot_observed_at":"2026-07-06T23:57:42.632111Z","submitted_at":"2026-06-22T06:58:39Z","title":"Each Judge Its Own Yardstick: Discovering Per-VLM Taxonomies for Physical Video Evaluation","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-06-26T09:04:23.965554Z"},"links":{"citing_paper":"/paper/2606.22918"},"observation_digest":"sha256:4c11c97f1c649a313dd953bf4f274f00daeb06414881ba976feaefeb1aab3f04","observation_id":"23827514-c182-44a0-87d3-e900c8d13ea4","resolution":{"observed_at":"2026-06-26T09:04:23.965554Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T09:04:23.965554Z","title":"OpenAI Blog , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.22918","last_updated":"2026-06-22T06:58:39Z","snapshot_observed_at":"2026-07-06T23:57:42.632111Z","submitted_at":"2026-06-22T06:58:39Z","title":"Each Judge Its Own Yardstick: Discovering Per-VLM Taxonomies for Physical Video Evaluation","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-06-26T09:04:23.965554Z"},"links":{"citing_paper":"/paper/2606.22918"},"observation_digest":"sha256:0bf46b21f984f3306eff74c0ecf71de1edca133234ff43a856edc7bebd519237","observation_id":"bac4984d-99b4-4276-9ddd-1da867e6d44a","resolution":{"observed_at":"2026-06-26T09:04:23.965554Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T09:04:23.965554Z","title":"International Conference on Learning Representations , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.22918","last_updated":"2026-06-22T06:58:39Z","snapshot_observed_at":"2026-07-06T23:57:42.632111Z","submitted_at":"2026-06-22T06:58:39Z","title":"Each Judge Its Own Yardstick: Discovering Per-VLM Taxonomies for Physical Video Evaluation","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-06-26T09:04:23.965554Z"},"links":{"citing_paper":"/paper/2606.22918"},"observation_digest":"sha256:5a9ab67e4a165a89b3d6237efa1530853b5341aea88c47e0a8995045fde6c796","observation_id":"26288eb9-43ce-4143-b51e-7d318b5734b5","resolution":{"observed_at":"2026-06-26T09:04:23.965554Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.20314","last_updated":"2025-04-19T02:22:42Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-26T08:25:43Z","title":"Wan: Open and Advanced Large-Scale Video Generative Models","version":2},"cited_work":{"arxiv_id":"2503.20314","doi":"10.1109/19.492748","metadata_source":"pith","pith_arxiv_id":"2503.20314","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Wan: Open and Advanced Large-Scale Video Generative Models","venue":"cs.CV","work_id":"ad3ebc3b-4224-46c9-b61d-bcf135da0a7c","year":2025},"citing_paper":{"arxiv_id":"2606.22918","last_updated":"2026-06-22T06:58:39Z","snapshot_observed_at":"2026-07-06T23:57:42.632111Z","submitted_at":"2026-06-22T06:58:39Z","title":"Each Judge Its Own Yardstick: Discovering Per-VLM Taxonomies for Physical Video Evaluation","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-06-26T09:04:23.965554Z"},"links":{"cited_paper":"/paper/2503.20314","citing_paper":"/paper/2606.22918"},"observation_digest":"sha256:5c223097e1e64211e9fa5b6fe90cb4ba64cd65209e2113ea028ff270bf9c0c9c","observation_id":"0a2cbf08-4983-4889-8867-ab8430126b03","resolution":{"observed_at":"2026-07-04T10:09:45.408052Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"cited_work":{"arxiv_id":"2501.03575","doi":"10.48550/arxiv.2501.03575","metadata_source":"pith","pith_arxiv_id":"2501.03575","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Cosmos World Foundation Model Platform for Physical AI","venue":"cs.CV","work_id":"a2dba24c-318d-476a-8b21-4289c265810c","year":2025},"citing_paper":{"arxiv_id":"2606.22918","last_updated":"2026-06-22T06:58:39Z","snapshot_observed_at":"2026-07-06T23:57:42.632111Z","submitted_at":"2026-06-22T06:58:39Z","title":"Each Judge Its Own Yardstick: Discovering Per-VLM Taxonomies for Physical Video Evaluation","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-06-26T09:04:23.965554Z"},"links":{"cited_paper":"/paper/2501.03575","citing_paper":"/paper/2606.22918"},"observation_digest":"sha256:9188bed9771c11999ee56aaaef6ef525f577bdef09d0748ce4b3b24e4d1ec008","observation_id":"23496bee-bbf9-46b7-8e5e-63b51adc5918","resolution":{"observed_at":"2026-07-04T10:09:45.410512Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-07-11T15:53:29.560535+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T15:53:29.560535+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T09:04:23.965554Z","title":"Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.22918","last_updated":"2026-06-22T06:58:39Z","snapshot_observed_at":"2026-07-06T23:57:42.632111Z","submitted_at":"2026-06-22T06:58:39Z","title":"Each Judge Its Own Yardstick: Discovering Per-VLM Taxonomies for Physical Video Evaluation","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-06-26T09:04:23.965554Z"},"links":{"citing_paper":"/paper/2606.22918"},"observation_digest":"sha256:0f17ca9605c2f16f532f17fd63cbb332f8b0ea50fd8ed3da520242ef70356c84","observation_id":"176a50ab-593a-4a1d-9db5-a7c69c2ea82d","resolution":{"observed_at":"2026-06-26T09:04:23.965554Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T09:04:23.965554Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.22918","last_updated":"2026-06-22T06:58:39Z","snapshot_observed_at":"2026-07-06T23:57:42.632111Z","submitted_at":"2026-06-22T06:58:39Z","title":"Each Judge Its Own Yardstick: Discovering Per-VLM Taxonomies for Physical Video Evaluation","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-06-26T09:04:23.965554Z"},"links":{"citing_paper":"/paper/2606.22918"},"observation_digest":"sha256:83a181343fe688abd48d279a0a708e4c3c8358d9f3c15190a8be83768ebf7e4c","observation_id":"46e0f90e-ddc4-4cc1-ab87-14bd99cc6de1","resolution":{"observed_at":"2026-06-26T09:04:23.965554Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T09:04:23.965554Z","title":"International Conference on Machine Learning , pages=","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.22918","last_updated":"2026-06-22T06:58:39Z","snapshot_observed_at":"2026-07-06T23:57:42.632111Z","submitted_at":"2026-06-22T06:58:39Z","title":"Each Judge Its Own Yardstick: Discovering Per-VLM Taxonomies for Physical Video Evaluation","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-06-26T09:04:23.965554Z"},"links":{"citing_paper":"/paper/2606.22918"},"observation_digest":"sha256:46df136884794094e70a30682c8a7838058017a6c1c103ccc147a1287001c261","observation_id":"9796e430-13f9-4d33-86fe-1f9dc27e9644","resolution":{"observed_at":"2026-06-26T09:04:23.965554Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T09:04:23.965554Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.22918","last_updated":"2026-06-22T06:58:39Z","snapshot_observed_at":"2026-07-06T23:57:42.632111Z","submitted_at":"2026-06-22T06:58:39Z","title":"Each Judge Its Own Yardstick: Discovering Per-VLM Taxonomies for Physical Video Evaluation","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-06-26T09:04:23.965554Z"},"links":{"citing_paper":"/paper/2606.22918"},"observation_digest":"sha256:3b481e60006f2e9e8a0bb53a10335d60f3b4d0dcf99a65ad8ec65af65288792c","observation_id":"1428e4e6-ad3d-4e68-ae04-b8b0c34fc3f7","resolution":{"observed_at":"2026-06-26T09:04:23.965554Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2106.08261","last_updated":"2022-06-20T14:27:21Z","snapshot_observed_at":"2026-08-01T17:46:40.019621Z","submitted_at":"2021-06-15T16:13:39Z","title":"Physion: Evaluating Physical Prediction from Vision in Humans and Machines","version":3},"cited_work":{"arxiv_id":"2106.08261","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2106.08261","snapshot_observed_at":"2026-07-04T13:19:51.051888Z","title":"Blattmann, A., Dockhorn, T., Kulal, S., Mendelevitch, D., Kilian, M., Lorenz, D., Levi, Y ., English, Z., V oleti, V ., Letts, A., Jampani, V ., and Rombach, R","venue":null,"work_id":"8077bdbc-fa73-44a4-a120-92725975df49","year":2021},"citing_paper":{"arxiv_id":"2606.22918","last_updated":"2026-06-22T06:58:39Z","snapshot_observed_at":"2026-07-06T23:57:42.632111Z","submitted_at":"2026-06-22T06:58:39Z","title":"Each Judge Its Own Yardstick: Discovering Per-VLM Taxonomies for Physical Video Evaluation","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-06-26T09:04:23.965554Z"},"links":{"cited_paper":"/paper/2106.08261","citing_paper":"/paper/2606.22918"},"observation_digest":"sha256:da0c06e0205983647a7b4035a29888867ac69d368058a7faab2f85be110413e1","observation_id":"25a2699a-c807-4827-b3ba-3709e6521e66","resolution":{"observed_at":"2026-07-04T10:09:45.397902Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T09:04:23.965554Z","title":"National Science Review , volume=","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.22918","last_updated":"2026-06-22T06:58:39Z","snapshot_observed_at":"2026-07-06T23:57:42.632111Z","submitted_at":"2026-06-22T06:58:39Z","title":"Each Judge Its Own Yardstick: Discovering Per-VLM Taxonomies for Physical Video Evaluation","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-06-26T09:04:23.965554Z"},"links":{"citing_paper":"/paper/2606.22918"},"observation_digest":"sha256:be9b0212b0d73a588c7ec11ed477fb2b5afbee22711117dbebcf26b157ef73ff","observation_id":"07c8475d-4031-4873-99d7-e59afc091e73","resolution":{"observed_at":"2026-06-26T09:04:23.965554Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T09:04:23.965554Z","title":"Advances in neural information processing systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.22918","last_updated":"2026-06-22T06:58:39Z","snapshot_observed_at":"2026-07-06T23:57:42.632111Z","submitted_at":"2026-06-22T06:58:39Z","title":"Each Judge Its Own Yardstick: Discovering Per-VLM Taxonomies for Physical Video Evaluation","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-06-26T09:04:23.965554Z"},"links":{"citing_paper":"/paper/2606.22918"},"observation_digest":"sha256:004a9a59127cd5c7be7faa5a32a32c96e0b80b6312541709366066a157393509","observation_id":"b09ebf83-6f65-4d28-b6eb-ddca72354101","resolution":{"observed_at":"2026-06-26T09:04:23.965554Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T09:04:23.965554Z","title":"Advances in neural information processing systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.22918","last_updated":"2026-06-22T06:58:39Z","snapshot_observed_at":"2026-07-06T23:57:42.632111Z","submitted_at":"2026-06-22T06:58:39Z","title":"Each Judge Its Own Yardstick: Discovering Per-VLM Taxonomies for Physical Video Evaluation","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-06-26T09:04:23.965554Z"},"links":{"citing_paper":"/paper/2606.22918"},"observation_digest":"sha256:8450376fc74d193d33763380025068f8c162f7d05c4bfc863b66059f5f9ac68e","observation_id":"cdf67d8b-0149-4d29-b0ce-32027f5fa003","resolution":{"observed_at":"2026-06-26T09:04:23.965554Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T09:04:23.965554Z","title":", author=","venue":null,"work_id":null,"year":1920},"citing_paper":{"arxiv_id":"2606.22918","last_updated":"2026-06-22T06:58:39Z","snapshot_observed_at":"2026-07-06T23:57:42.632111Z","submitted_at":"2026-06-22T06:58:39Z","title":"Each Judge Its Own Yardstick: Discovering Per-VLM Taxonomies for Physical Video Evaluation","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-06-26T09:04:23.965554Z"},"links":{"citing_paper":"/paper/2606.22918"},"observation_digest":"sha256:d153abfc0dd080143061c346fcec9d15f0426e54c58d74f5ac8f15b96007c64f","observation_id":"6b677d57-e800-4e68-b2f3-f4cb44caf89a","resolution":{"observed_at":"2026-06-26T09:04:23.965554Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T09:04:23.965554Z","title":"2025 , publisher=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.22918","last_updated":"2026-06-22T06:58:39Z","snapshot_observed_at":"2026-07-06T23:57:42.632111Z","submitted_at":"2026-06-22T06:58:39Z","title":"Each Judge Its Own Yardstick: Discovering Per-VLM Taxonomies for Physical Video Evaluation","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-06-26T09:04:23.965554Z"},"links":{"citing_paper":"/paper/2606.22918"},"observation_digest":"sha256:cf79f7c6a187309593f12729286148557ebd09c33281b35fb01688052bbb51c7","observation_id":"45cfb269-8d39-407f-8bb9-069e40334903","resolution":{"observed_at":"2026-06-26T09:04:23.965554Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T09:04:23.965554Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.22918","last_updated":"2026-06-22T06:58:39Z","snapshot_observed_at":"2026-07-06T23:57:42.632111Z","submitted_at":"2026-06-22T06:58:39Z","title":"Each Judge Its Own Yardstick: Discovering Per-VLM Taxonomies for Physical Video Evaluation","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-06-26T09:04:23.965554Z"},"links":{"citing_paper":"/paper/2606.22918"},"observation_digest":"sha256:95d2e445a96cf2eb927b488388c6cfca3430c011180c6c902b76b1c688d323da","observation_id":"07dd1311-cdcb-43f4-b5d2-e9ff8189d266","resolution":{"observed_at":"2026-06-26T09:04:23.965554Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.21819","last_updated":"2025-06-21T08:39:06Z","snapshot_observed_at":"2026-08-04T18:30:37.623897Z","submitted_at":"2024-10-29T07:42:18Z","title":"Self-Preference Bias in LLM-as-a-Judge","version":2},"cited_work":{"arxiv_id":"2410.21819","doi":"10.48550/arxiv.2410.21819","metadata_source":"pith","pith_arxiv_id":"2410.21819","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Self-Preference Bias in LLM-as-a-Judge","venue":"cs.CL","work_id":"b98a1723-3323-42b3-a741-8b6785806d2d","year":2024},"citing_paper":{"arxiv_id":"2606.22918","last_updated":"2026-06-22T06:58:39Z","snapshot_observed_at":"2026-07-06T23:57:42.632111Z","submitted_at":"2026-06-22T06:58:39Z","title":"Each Judge Its Own Yardstick: Discovering Per-VLM Taxonomies for Physical Video Evaluation","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-06-26T09:04:23.965554Z"},"links":{"cited_paper":"/paper/2410.21819","citing_paper":"/paper/2606.22918"},"observation_digest":"sha256:3e97f8895c38771caf871d873ac9e9b8663f1c747c430eec380b9f371a2e2f46","observation_id":"489486a7-4f82-4188-9c35-71fd15165286","resolution":{"observed_at":"2026-07-04T10:09:45.398381Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T09:04:23.965554Z","title":"The Innovation , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.22918","last_updated":"2026-06-22T06:58:39Z","snapshot_observed_at":"2026-07-06T23:57:42.632111Z","submitted_at":"2026-06-22T06:58:39Z","title":"Each Judge Its Own Yardstick: Discovering Per-VLM Taxonomies for Physical Video Evaluation","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-06-26T09:04:23.965554Z"},"links":{"citing_paper":"/paper/2606.22918"},"observation_digest":"sha256:fdbb6ede688d3e8e34f9c32818d2d1d373c736e2ab710b97cf5298c104438763","observation_id":"8685f739-d0bb-41c3-ae59-150e98a4f3f0","resolution":{"observed_at":"2026-06-26T09:04:23.965554Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.05579","last_updated":"2024-12-10T05:49:12Z","snapshot_observed_at":"2026-07-31T01:42:39.468673Z","submitted_at":"2024-12-07T08:07:24Z","title":"LLMs-as-Judges: A Comprehensive Survey on LLM-based Evaluation Methods","version":2},"cited_work":{"arxiv_id":"2412.05579","doi":"10.48550/arxiv.2412.05579","metadata_source":"pith","pith_arxiv_id":"2412.05579","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"LLMs-as-Judges: A Comprehensive Survey on LLM-based Evaluation Methods","venue":"cs.CL","work_id":"377b190f-39ed-4db3-9747-433802e5303c","year":2024},"citing_paper":{"arxiv_id":"2606.22918","last_updated":"2026-06-22T06:58:39Z","snapshot_observed_at":"2026-07-06T23:57:42.632111Z","submitted_at":"2026-06-22T06:58:39Z","title":"Each Judge Its Own Yardstick: Discovering Per-VLM Taxonomies for Physical Video Evaluation","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-06-26T09:04:23.965554Z"},"links":{"cited_paper":"/paper/2412.05579","citing_paper":"/paper/2606.22918"},"observation_digest":"sha256:857d9816d407b10f5d1d216780e6bb7f117af14a9e3a6f1d931252c339cbe847","observation_id":"c9357fad-2f84-4966-be0c-1e7548bfaad4","resolution":{"observed_at":"2026-07-04T10:09:45.400919Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-03T15:08:45.340409+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-03T15:08:45.340409+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.06261","last_updated":"2025-12-19T14:25:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-07-07T17:36:04Z","title":"Gemini 2.5: Pushing the Frontier with Advanced Reasoning, Multimodality, Long Context, and Next Generation Agentic Capabilities","version":6},"cited_work":{"arxiv_id":"2507.06261","doi":"10.48550/arxiv.2503.19","metadata_source":"pith","pith_arxiv_id":"2507.06261","snapshot_observed_at":"2026-07-11T03:17:51.364436Z","title":"Gemini 2.5: Pushing the Frontier with Advanced Reasoning, Multimodality, Long Context, and Next Generation Agentic Capabilities","venue":"cs.CL","work_id":"008df105-2fdd-45d8-857a-8e35868aecb6","year":2025},"citing_paper":{"arxiv_id":"2606.22918","last_updated":"2026-06-22T06:58:39Z","snapshot_observed_at":"2026-07-06T23:57:42.632111Z","submitted_at":"2026-06-22T06:58:39Z","title":"Each Judge Its Own Yardstick: Discovering Per-VLM Taxonomies for Physical Video Evaluation","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-06-26T09:04:23.965554Z"},"links":{"cited_paper":"/paper/2507.06261","citing_paper":"/paper/2606.22918"},"observation_digest":"sha256:847cac7ba91cfcf6e4038e5a074fb84d92be109ffac5f58c862059cf4dabc7df","observation_id":"cdd19e54-f1a5-456e-ba82-cb661052651d","resolution":{"observed_at":"2026-07-04T10:09:45.381901Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.13923","last_updated":"2025-02-19T18:00:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-19T18:00:14Z","title":"Qwen2.5-VL Technical Report","version":1},"cited_work":{"arxiv_id":"2502.13923","doi":"10.48550/arxiv.2502.13923","metadata_source":"pith","pith_arxiv_id":"2502.13923","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Qwen2.5-VL Technical Report","venue":"cs.CV","work_id":"69dffacb-bfe8-442d-be86-48624c60426f","year":2025},"citing_paper":{"arxiv_id":"2606.22918","last_updated":"2026-06-22T06:58:39Z","snapshot_observed_at":"2026-07-06T23:57:42.632111Z","submitted_at":"2026-06-22T06:58:39Z","title":"Each Judge Its Own Yardstick: Discovering Per-VLM Taxonomies for Physical Video Evaluation","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-06-26T09:04:23.965554Z"},"links":{"cited_paper":"/paper/2502.13923","citing_paper":"/paper/2606.22918"},"observation_digest":"sha256:e8b0f97263bf30d37e757e98f66853f202df48ddc547cbf846f10395ef3c806f","observation_id":"a587c4a7-890e-4681-8f9e-ceb2e6b8d930","resolution":{"observed_at":"2026-07-04T10:09:45.384588Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-07-12T05:19:13.082554+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-12T05:19:13.082554+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T09:04:23.965554Z","title":"2025 , url=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.22918","last_updated":"2026-06-22T06:58:39Z","snapshot_observed_at":"2026-07-06T23:57:42.632111Z","submitted_at":"2026-06-22T06:58:39Z","title":"Each Judge Its Own Yardstick: Discovering Per-VLM Taxonomies for Physical Video Evaluation","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-06-26T09:04:23.965554Z"},"links":{"citing_paper":"/paper/2606.22918"},"observation_digest":"sha256:c85f7a354e39accc0889804cac3e057c95fa06b231d919cdc3b4d23ee4e9de3c","observation_id":"4871c82a-d972-4481-b820-e6cf241c6eb9","resolution":{"observed_at":"2026-06-26T09:04:23.965554Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.12387","last_updated":"2024-04-18T17:59:48Z","snapshot_observed_at":"2026-07-06T18:02:19.428801Z","submitted_at":"2024-04-18T17:59:48Z","title":"Reka Core, Flash, and Edge: A Series of Powerful Multimodal Language Models","version":1},"cited_work":{"arxiv_id":"2404.12387","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2404.12387","snapshot_observed_at":"2026-07-04T10:09:45.386126Z","title":"arXiv preprint arXiv:2404.12387 , year=","venue":null,"work_id":"e8a6f1f4-737f-4845-a995-3910ae4edc61","year":2024},"citing_paper":{"arxiv_id":"2606.22918","last_updated":"2026-06-22T06:58:39Z","snapshot_observed_at":"2026-07-06T23:57:42.632111Z","submitted_at":"2026-06-22T06:58:39Z","title":"Each Judge Its Own Yardstick: Discovering Per-VLM Taxonomies for Physical Video Evaluation","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-06-26T09:04:23.965554Z"},"links":{"cited_paper":"/paper/2404.12387","citing_paper":"/paper/2606.22918"},"observation_digest":"sha256:800ede2ded08301252aedb08c8c1f523b5c973da788c01b301e7444b5644b6cf","observation_id":"9459c624-962d-4ac2-9a33-916af85596d5","resolution":{"observed_at":"2026-07-04T10:09:45.387734Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.01006","last_updated":"2026-01-01T13:07:25Z","snapshot_observed_at":"2026-08-03T18:50:30.558321Z","submitted_at":"2025-07-01T17:55:04Z","title":"GLM-4.5V and GLM-4.1V-Thinking: Towards Versatile Multimodal Reasoning with Scalable Reinforcement Learning","version":6},"cited_work":{"arxiv_id":"2507.01006","doi":"10.48550/arxiv.2507.01006","metadata_source":"pith","pith_arxiv_id":"2507.01006","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"GLM-4.5V and GLM-4.1V-Thinking: Towards Versatile Multimodal Reasoning with Scalable Reinforcement Learning","venue":"cs.CV","work_id":"366607ba-e4ea-4726-98c3-63356e32351c","year":2025},"citing_paper":{"arxiv_id":"2606.22918","last_updated":"2026-06-22T06:58:39Z","snapshot_observed_at":"2026-07-06T23:57:42.632111Z","submitted_at":"2026-06-22T06:58:39Z","title":"Each Judge Its Own Yardstick: Discovering Per-VLM Taxonomies for Physical Video Evaluation","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-06-26T09:04:23.965554Z"},"links":{"cited_paper":"/paper/2507.01006","citing_paper":"/paper/2606.22918"},"observation_digest":"sha256:98d14b2b6521b2672455039b3a89f2ffb5298fc1af739b4c334b64377dc3b081","observation_id":"96cebcdd-7c19-45d3-8412-3c11d3bae0d3","resolution":{"observed_at":"2026-07-04T10:09:45.400481Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2601.02780","last_updated":"2026-01-08T05:52:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-01-06T07:31:47Z","title":"MiMo-V2-Flash Technical Report","version":2},"cited_work":{"arxiv_id":"2601.02780","doi":"10.48550/arxiv.2601.02780","metadata_source":"pith","pith_arxiv_id":"2601.02780","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"MiMo-V2-Flash Technical Report","venue":"cs.CL","work_id":"1f3df90c-4bc3-49b1-ad9b-7f3b34e4ffba","year":2026},"citing_paper":{"arxiv_id":"2606.22918","last_updated":"2026-06-22T06:58:39Z","snapshot_observed_at":"2026-07-06T23:57:42.632111Z","submitted_at":"2026-06-22T06:58:39Z","title":"Each Judge Its Own Yardstick: Discovering Per-VLM Taxonomies for Physical Video Evaluation","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-06-26T09:04:23.965554Z"},"links":{"cited_paper":"/paper/2601.02780","citing_paper":"/paper/2606.22918"},"observation_digest":"sha256:ff2fdbe3c1fe45cc96d3b90837d45c36c27cc6f828a79440e6d1b438ae10cc14","observation_id":"63d9d7b2-0f37-4d96-aa70-c65315c8022a","resolution":{"observed_at":"2026-07-04T10:09:45.379383Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-05-23T10:52:49.766877+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-23T10:52:49.766877+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2604.26752","last_updated":"2026-05-12T15:07:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-29T14:49:37Z","title":"GLM-5V-Turbo: Toward a Native Foundation Model for Multimodal Agents","version":3},"cited_work":{"arxiv_id":"2604.26752","doi":null,"metadata_source":"pith","pith_arxiv_id":"2604.26752","snapshot_observed_at":"2026-07-04T10:09:45.391749Z","title":"GLM-5V-Turbo: Toward a Native Foundation Model for Multimodal Agents","venue":"cs.CV","work_id":"0b17ea7d-55ea-42eb-b903-68fb980f9a60","year":2026},"citing_paper":{"arxiv_id":"2606.22918","last_updated":"2026-06-22T06:58:39Z","snapshot_observed_at":"2026-07-06T23:57:42.632111Z","submitted_at":"2026-06-22T06:58:39Z","title":"Each Judge Its Own Yardstick: Discovering Per-VLM Taxonomies for Physical Video Evaluation","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-06-26T09:04:23.965554Z"},"links":{"cited_paper":"/paper/2604.26752","citing_paper":"/paper/2606.22918"},"observation_digest":"sha256:fc12dfb614f7e5883034ec5da3be0cb38858e5ee80b1e0a4be888ba9c0e36f04","observation_id":"32b6dc1d-40a6-4d08-98ea-c2237b1e8d06","resolution":{"observed_at":"2026-07-04T10:09:45.392896Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.03326","last_updated":"2024-10-26T16:35:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-08-06T17:59:44Z","title":"LLaVA-OneVision: Easy Visual Task Transfer","version":3},"cited_work":{"arxiv_id":"2408.03326","doi":"10.48550/arxiv.2408.03326","metadata_source":"pith","pith_arxiv_id":"2408.03326","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"LLaVA-OneVision: Easy Visual Task Transfer","venue":"cs.CV","work_id":"f5f2452b-f2a9-49ac-b38d-c76e18cdfe49","year":2024},"citing_paper":{"arxiv_id":"2606.22918","last_updated":"2026-06-22T06:58:39Z","snapshot_observed_at":"2026-07-06T23:57:42.632111Z","submitted_at":"2026-06-22T06:58:39Z","title":"Each Judge Its Own Yardstick: Discovering Per-VLM Taxonomies for Physical Video Evaluation","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-06-26T09:04:23.965554Z"},"links":{"cited_paper":"/paper/2408.03326","citing_paper":"/paper/2606.22918"},"observation_digest":"sha256:d3127c986c266ec1bd7dd98daacad8246726d87d0a04afc323f2f67026ff6a92","observation_id":"ee87e926-2255-4588-99be-f355ade85a53","resolution":{"observed_at":"2026-07-04T10:09:45.373865Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.10479","last_updated":"2025-04-19T03:47:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-14T17:59:25Z","title":"InternVL3: Exploring Advanced Training and Test-Time Recipes for Open-Source Multimodal Models","version":3},"cited_work":{"arxiv_id":"2504.10479","doi":"10.48550/arxiv.2504.10479","metadata_source":"pith","pith_arxiv_id":"2504.10479","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"InternVL3: Exploring Advanced Training and Test-Time Recipes for Open-Source Multimodal Models","venue":"cs.CV","work_id":"fe8637aa-12bc-4434-8d36-9f57b5eebcbe","year":2025},"citing_paper":{"arxiv_id":"2606.22918","last_updated":"2026-06-22T06:58:39Z","snapshot_observed_at":"2026-07-06T23:57:42.632111Z","submitted_at":"2026-06-22T06:58:39Z","title":"Each Judge Its Own Yardstick: Discovering Per-VLM Taxonomies for Physical Video Evaluation","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-06-26T09:04:23.965554Z"},"links":{"cited_paper":"/paper/2504.10479","citing_paper":"/paper/2606.22918"},"observation_digest":"sha256:1ae8c374fa5a4954debe66f8674f163b7e692f7444b493ac2d68d9a79f4ea65c","observation_id":"3092ff16-01cf-481f-b55d-6da7dbc23ca7","resolution":{"observed_at":"2026-07-04T10:09:45.376942Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-05-20T07:54:09.017512+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-20T07:54:09.017512+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T09:04:23.965554Z","title":"2025 , institution=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.22918","last_updated":"2026-06-22T06:58:39Z","snapshot_observed_at":"2026-07-06T23:57:42.632111Z","submitted_at":"2026-06-22T06:58:39Z","title":"Each Judge Its Own Yardstick: Discovering Per-VLM Taxonomies for Physical Video Evaluation","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-06-26T09:04:23.965554Z"},"links":{"citing_paper":"/paper/2606.22918"},"observation_digest":"sha256:eadd29c4f3ddd3244ad38ea4648d202ce9c67fe6f20af388b1d5daca95a86600","observation_id":"7fa45d1c-3aa2-461c-ab5a-4eac91214b88","resolution":{"observed_at":"2026-06-26T09:04:23.965554Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T09:04:23.965554Z","title":"0 model card: Towards intelligence frontier for real-world complexity , author=","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2606.22918","last_updated":"2026-06-22T06:58:39Z","snapshot_observed_at":"2026-07-06T23:57:42.632111Z","submitted_at":"2026-06-22T06:58:39Z","title":"Each Judge Its Own Yardstick: Discovering Per-VLM Taxonomies for Physical Video Evaluation","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-06-26T09:04:23.965554Z"},"links":{"citing_paper":"/paper/2606.22918"},"observation_digest":"sha256:05c3425c5f06d56036a75ca1c22801518d8c839db858c8abe75b8a483c5842fe","observation_id":"2be9efe6-998e-4526-b09f-226059d7dc6b","resolution":{"observed_at":"2026-06-26T09:04:23.965554Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T09:04:23.965554Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2606.22918","last_updated":"2026-06-22T06:58:39Z","snapshot_observed_at":"2026-07-06T23:57:42.632111Z","submitted_at":"2026-06-22T06:58:39Z","title":"Each Judge Its Own Yardstick: Discovering Per-VLM Taxonomies for Physical Video Evaluation","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-06-26T09:04:23.965554Z"},"links":{"citing_paper":"/paper/2606.22918"},"observation_digest":"sha256:2c09b573853f2313947be190ac862b665232a557c82a8b50ded6952c242af5b1","observation_id":"76d5b84b-d5a9-4b35-9ad7-37cccffdcd39","resolution":{"observed_at":"2026-06-26T09:04:23.965554Z","resolver_source":null,"status":"parse_uncertain"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2606.22918","last_updated":"2026-06-22T06:58:39Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-07-06T23:57:42.632111Z","submitted_at":"2026-06-22T06:58:39Z","title":"Each Judge Its Own Yardstick: Discovering Per-VLM Taxonomies for Physical Video Evaluation"},"reference_resolution":{"displayed":52,"state_counts":{"malformed_identifier":0,"metadata_mismatch":15,"parse_uncertain":1,"unresolved":34,"verified_exact":2,"verified_fuzzy":0},"total_outbound_references":52},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 52 of 52 outbound references and 1 inbound Pith citation observation for arXiv:2606.22918."}