{"as_of":"2026-08-06T17:02:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:6384f0afa6d3c7b0b2d6a86b2920eaf908cf246bf042ed21e428c9ac79142703","coverage":[{"denominator":50,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":50,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-13T07:28:45.811192Z","state":"measured"},{"denominator":61,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":61,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-06T06:34:29.942622+00:00","state":"measured"},{"denominator":11,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":11,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T18:29:09.689924Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-07-04T10:09:45.391749Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2604.26752","last_updated":"2026-05-12T15:07:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-29T14:49:37Z","title":"GLM-5V-Turbo: Toward a Native Foundation Model for Multimodal Agents","version":3},"cited_work":{"arxiv_id":"2604.26752","doi":null,"metadata_source":"pith","pith_arxiv_id":"2604.26752","snapshot_observed_at":"2026-07-04T10:09:45.391749Z","title":"GLM-5V-Turbo: Toward a Native Foundation Model for Multimodal Agents","venue":"cs.CV","work_id":"0b17ea7d-55ea-42eb-b903-68fb980f9a60","year":2026},"citing_paper":{"arxiv_id":"2605.13193","last_updated":"2026-05-19T13:19:30Z","snapshot_observed_at":"2026-08-02T12:32:32.711675Z","submitted_at":"2026-05-13T08:49:51Z","title":"FIKA-Bench: From Fine-grained Recognition to Fine-Grained Knowledge Acquisition","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-14T20:25:36.746335Z"},"links":{"cited_paper":"/paper/2604.26752","citing_paper":"/paper/2605.13193"},"observation_digest":"sha256:5120d10bae9806da6f95a83bffc298ab35017a4166217cda41ea6fa195df0cd7","observation_id":"30a7c1fb-bb69-4545-af51-6199506411ee","resolution":{"observed_at":"2026-05-14T20:42:58.694201Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2604.26752","last_updated":"2026-05-12T15:07:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-29T14:49:37Z","title":"GLM-5V-Turbo: Toward a Native Foundation Model for Multimodal Agents","version":3},"cited_work":{"arxiv_id":"2604.26752","doi":null,"metadata_source":"pith","pith_arxiv_id":"2604.26752","snapshot_observed_at":"2026-07-04T10:09:45.391749Z","title":"GLM-5V-Turbo: Toward a Native Foundation Model for Multimodal Agents","venue":"cs.CV","work_id":"0b17ea7d-55ea-42eb-b903-68fb980f9a60","year":2026},"citing_paper":{"arxiv_id":"2605.13193","last_updated":"2026-05-19T13:19:30Z","snapshot_observed_at":"2026-08-02T12:32:32.711675Z","submitted_at":"2026-05-13T08:49:51Z","title":"FIKA-Bench: From Fine-grained Recognition to Fine-Grained Knowledge Acquisition","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-20T22:02:19.717335Z"},"links":{"cited_paper":"/paper/2604.26752","citing_paper":"/paper/2605.13193"},"observation_digest":"sha256:21cf0ca6056dd0726fa5aeb39715bf41ab9787de13909e7ceff48957a24ef8af","observation_id":"e1d0bad3-e998-42c7-921b-d2ad3e9686bc","resolution":{"observed_at":"2026-05-20T22:03:47.187415Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2604.26752","last_updated":"2026-05-12T15:07:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-29T14:49:37Z","title":"GLM-5V-Turbo: Toward a Native Foundation Model for Multimodal Agents","version":3},"cited_work":{"arxiv_id":"2604.26752","doi":null,"metadata_source":"pith","pith_arxiv_id":"2604.26752","snapshot_observed_at":"2026-07-04T10:09:45.391749Z","title":"GLM-5V-Turbo: Toward a Native Foundation Model for Multimodal Agents","venue":"cs.CV","work_id":"0b17ea7d-55ea-42eb-b903-68fb980f9a60","year":2026},"citing_paper":{"arxiv_id":"2605.16079","last_updated":"2026-05-15T15:43:28Z","snapshot_observed_at":"2026-07-06T23:27:15.745896Z","submitted_at":"2026-05-15T15:43:28Z","title":"VideoSeeker: Incentivizing Instance-level Video Understanding via Native Agentic Tool Invocation","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-20T19:37:09.244578Z"},"links":{"cited_paper":"/paper/2604.26752","citing_paper":"/paper/2605.16079"},"observation_digest":"sha256:ffdb2d7d0dfa009798e6368f14c8ff64dcad86bf49cb37cf70a4a199f8bb26e9","observation_id":"724b1f36-3924-465b-8c8d-8c3e27935671","resolution":{"observed_at":"2026-05-20T19:38:56.204131Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2604.26752","last_updated":"2026-05-12T15:07:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-29T14:49:37Z","title":"GLM-5V-Turbo: Toward a Native Foundation Model for Multimodal Agents","version":3},"cited_work":{"arxiv_id":"2604.26752","doi":null,"metadata_source":"pith","pith_arxiv_id":"2604.26752","snapshot_observed_at":"2026-07-04T10:09:45.391749Z","title":"GLM-5V-Turbo: Toward a Native Foundation Model for Multimodal Agents","venue":"cs.CV","work_id":"0b17ea7d-55ea-42eb-b903-68fb980f9a60","year":2026},"citing_paper":{"arxiv_id":"2605.31148","last_updated":"2026-05-29T10:59:26Z","snapshot_observed_at":"2026-07-06T23:40:22.583302Z","submitted_at":"2026-05-29T10:59:26Z","title":"SpatialAct: Probing Spatial Reasoning-to-Action Capabilities of VLM Agents in 3D Scenes","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-06-28T22:47:46.542267Z"},"links":{"cited_paper":"/paper/2604.26752","citing_paper":"/paper/2605.31148"},"observation_digest":"sha256:b5f3f0792c78a9ca125cee480909030b68adf6c9330f9613ac2424cc021a636c","observation_id":"58e58408-69c2-4b73-bdf8-af4a224bb64d","resolution":{"observed_at":"2026-06-28T22:52:45.651730Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2604.26752","last_updated":"2026-05-12T15:07:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-29T14:49:37Z","title":"GLM-5V-Turbo: Toward a Native Foundation Model for Multimodal Agents","version":3},"cited_work":{"arxiv_id":"2604.26752","doi":null,"metadata_source":"pith","pith_arxiv_id":"2604.26752","snapshot_observed_at":"2026-07-04T10:09:45.391749Z","title":"GLM-5V-Turbo: Toward a Native Foundation Model for Multimodal Agents","venue":"cs.CV","work_id":"0b17ea7d-55ea-42eb-b903-68fb980f9a60","year":2026},"citing_paper":{"arxiv_id":"2606.02449","last_updated":"2026-06-01T16:20:45Z","snapshot_observed_at":"2026-07-06T23:42:49.173711Z","submitted_at":"2026-06-01T16:20:45Z","title":"HLL: Can Agents Cross Humanity's Last Line of Verification?","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-06-28T14:57:57.218669Z"},"links":{"cited_paper":"/paper/2604.26752","citing_paper":"/paper/2606.02449"},"observation_digest":"sha256:c945b63687ff4be52881eb50b9b01324912410aee990929eb620e7f504d2fd89","observation_id":"94c8a7d4-22c8-44fb-a145-7a4b507290c7","resolution":{"observed_at":"2026-07-01T22:56:19.632650Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2604.26752","last_updated":"2026-05-12T15:07:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-29T14:49:37Z","title":"GLM-5V-Turbo: Toward a Native Foundation Model for Multimodal Agents","version":3},"cited_work":{"arxiv_id":"2604.26752","doi":null,"metadata_source":"pith","pith_arxiv_id":"2604.26752","snapshot_observed_at":"2026-07-04T10:09:45.391749Z","title":"GLM-5V-Turbo: Toward a Native Foundation Model for Multimodal Agents","venue":"cs.CV","work_id":"0b17ea7d-55ea-42eb-b903-68fb980f9a60","year":2026},"citing_paper":{"arxiv_id":"2606.05769","last_updated":"2026-06-04T06:53:19Z","snapshot_observed_at":"2026-08-03T03:37:13.228116Z","submitted_at":"2026-06-04T06:53:19Z","title":"Imagine Before You Predict: Interleaved Latent Visual Reasoning for Video Event Prediction","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-06-28T02:46:50.373450Z"},"links":{"cited_paper":"/paper/2604.26752","citing_paper":"/paper/2606.05769"},"observation_digest":"sha256:511a201d57e7d076b0dcbee383ca9a59331e6001bfeced4f70048e8d01e12971","observation_id":"fe227577-00b1-4251-9126-b9ecf423a76a","resolution":{"observed_at":"2026-07-02T11:56:55.439810Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2604.26752","last_updated":"2026-05-12T15:07:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-29T14:49:37Z","title":"GLM-5V-Turbo: Toward a Native Foundation Model for Multimodal Agents","version":3},"cited_work":{"arxiv_id":"2604.26752","doi":null,"metadata_source":"pith","pith_arxiv_id":"2604.26752","snapshot_observed_at":"2026-07-04T10:09:45.391749Z","title":"GLM-5V-Turbo: Toward a Native Foundation Model for Multimodal Agents","venue":"cs.CV","work_id":"0b17ea7d-55ea-42eb-b903-68fb980f9a60","year":2026},"citing_paper":{"arxiv_id":"2606.22918","last_updated":"2026-06-22T06:58:39Z","snapshot_observed_at":"2026-07-06T23:57:42.632111Z","submitted_at":"2026-06-22T06:58:39Z","title":"Each Judge Its Own Yardstick: Discovering Per-VLM Taxonomies for Physical Video Evaluation","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-06-26T09:04:23.965554Z"},"links":{"cited_paper":"/paper/2604.26752","citing_paper":"/paper/2606.22918"},"observation_digest":"sha256:a59b3a0ee8839ff1a0d379e6376f1f51208ec0595e03ab33f26d304e6b7fdfdc","observation_id":"32b6dc1d-40a6-4d08-98ea-c2237b1e8d06","resolution":{"observed_at":"2026-07-04T10:09:45.392896Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2604.26752","last_updated":"2026-05-12T15:07:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-29T14:49:37Z","title":"GLM-5V-Turbo: Toward a Native Foundation Model for Multimodal Agents","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.26752","snapshot_observed_at":"2026-08-01T22:32:28.819129Z","title":"arXiv preprint arXiv:2604.26752 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.15732","last_updated":"2026-08-03T00:43:08Z","snapshot_observed_at":"2026-08-06T16:21:56.961541Z","submitted_at":"2026-07-17T08:13:01Z","title":"IoU-PD: IoU-Aware Privileged Distillation for Visual Grounding with Multimodal Large Language Models","version":1},"reference_index":118,"source":"arxiv_source","source_observed_at":"2026-08-01T22:32:28.819129Z"},"links":{"cited_paper":"/paper/2604.26752","citing_paper":"/paper/2607.15732"},"observation_digest":"sha256:53db767ecddd8124465e795dd57474b573303cc659301b75654ed60f936cf65a","observation_id":"50ddd35e-7d1a-4186-833c-81f995e28d4a","resolution":{"observed_at":"2026-08-01T22:32:28.819129Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2604.26752","last_updated":"2026-05-12T15:07:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-29T14:49:37Z","title":"GLM-5V-Turbo: Toward a Native Foundation Model for Multimodal Agents","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.26752","snapshot_observed_at":"2026-08-04T04:21:09.624375Z","title":"arXiv preprint arXiv:2604.26752 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.15732","last_updated":"2026-08-03T00:43:08Z","snapshot_observed_at":"2026-08-06T16:21:56.961541Z","submitted_at":"2026-07-17T08:13:01Z","title":"IoU-PD: IoU-Aware Privileged Distillation for Visual Grounding with Multimodal Large Language Models","version":2},"reference_index":118,"source":"arxiv_source","source_observed_at":"2026-08-04T04:21:09.624375Z"},"links":{"cited_paper":"/paper/2604.26752","citing_paper":"/paper/2607.15732"},"observation_digest":"sha256:34ccfcb2bf99baffb414d3ec2e1d0610d13b36e92aefacd3e620a2c56d1eb799","observation_id":"ee087e6f-e510-400a-89b9-aab1a6c49c5c","resolution":{"observed_at":"2026-08-04T04:21:09.624375Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2604.26752","last_updated":"2026-05-12T15:07:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-29T14:49:37Z","title":"GLM-5V-Turbo: Toward a Native Foundation Model for Multimodal Agents","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.26752","snapshot_observed_at":"2026-07-31T19:54:08.429432Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.28033","last_updated":"2026-07-30T11:17:27Z","snapshot_observed_at":"2026-08-05T02:42:56.093326Z","submitted_at":"2026-07-30T11:17:27Z","title":"DataClawEval: A Benchmark for Data Engineering Agents in Real Industrial Harness","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-07-31T19:54:08.429432Z"},"links":{"cited_paper":"/paper/2604.26752","citing_paper":"/paper/2607.28033"},"observation_digest":"sha256:fb9044126a360413c281e79d28d27dcbaa011a0bc05129ff25edc69c8dbc2927","observation_id":"1b7798bc-7e88-48d5-b255-6f7969674115","resolution":{"observed_at":"2026-07-31T19:54:08.429432Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2604.26752","last_updated":"2026-05-12T15:07:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-29T14:49:37Z","title":"GLM-5V-Turbo: Toward a Native Foundation Model for Multimodal Agents","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.26752","snapshot_observed_at":"2026-08-05T18:29:09.689924Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.03474","last_updated":"2026-08-04T11:14:00Z","snapshot_observed_at":"2026-08-06T15:36:49.837248Z","submitted_at":"2026-08-04T11:14:00Z","title":"MT-Web2Code: Benchmarking Coding Agents on Multi-Turn Regional Reconstruction and Localized Modification","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-05T18:29:09.689924Z"},"links":{"cited_paper":"/paper/2604.26752","citing_paper":"/paper/2608.03474"},"observation_digest":"sha256:bc647fed5bde68e7c8a7ecad8902b318dc735aaeb784dbc71dbed5bc0a5dec7f","observation_id":"646ae864-2019-4381-ab51-528c0f5a518f","resolution":{"observed_at":"2026-08-05T18:29:09.689924Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2604.26752/citation-record","integrity":"/paper/2604.26752/integrity","json":"/paper/2604.26752/citation-record.json","paper":"/paper/2604.26752"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"03093ea4-12fa-4f62-890d-1ba7440b7d79","year":null},"citing_paper":{"arxiv_id":"2604.26752","last_updated":"2026-05-12T15:07:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-29T14:49:37Z","title":"GLM-5V-Turbo: Toward a Native Foundation Model for Multimodal Agents","version":3},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-13T07:28:45.811192Z"},"links":{"citing_paper":"/paper/2604.26752"},"observation_digest":"sha256:ea11f5d0d5e410303dbe52f4fff137254412a0688aae013cc2f068494f93dc25","observation_id":"7b9a8539-f951-4d70-9963-5d5d3a9bde4e","resolution":{"observed_at":"2026-05-13T08:22:31.829238Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"b0e514b8-550d-4c1b-ac0b-fa49b54a0187","year":null},"citing_paper":{"arxiv_id":"2604.26752","last_updated":"2026-05-12T15:07:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-29T14:49:37Z","title":"GLM-5V-Turbo: Toward a Native Foundation Model for Multimodal Agents","version":3},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-13T07:28:45.811192Z"},"links":{"citing_paper":"/paper/2604.26752"},"observation_digest":"sha256:77827ff603dc457498b4dc3163afa38d523e175e1b9a437af068c4695924ecb9","observation_id":"c1e945f5-2814-42fd-be52-822e0eb00f7c","resolution":{"observed_at":"2026-05-13T08:22:31.833444Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Claude code: Ai-powered coding assistant","venue":null,"work_id":"c10c97e3-2b5a-413d-a3c9-5874aae607bc","year":2025},"citing_paper":{"arxiv_id":"2604.26752","last_updated":"2026-05-12T15:07:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-29T14:49:37Z","title":"GLM-5V-Turbo: Toward a Native Foundation Model for Multimodal Agents","version":3},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-13T07:28:45.811192Z"},"links":{"citing_paper":"/paper/2604.26752"},"observation_digest":"sha256:834a9931ba2ab526a54b1070492b8c5c92bf18d0bc0cf9743047742be2e292b4","observation_id":"65b6a156-f19a-49b0-9a13-9780d42058cb","resolution":{"observed_at":"2026-05-13T08:22:31.817731Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Introducing claude opus 4.6","venue":null,"work_id":"8556a670-2d63-453c-9d39-0076633eda16","year":2026},"citing_paper":{"arxiv_id":"2604.26752","last_updated":"2026-05-12T15:07:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-29T14:49:37Z","title":"GLM-5V-Turbo: Toward a Native Foundation Model for Multimodal Agents","version":3},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-13T07:28:45.811192Z"},"links":{"citing_paper":"/paper/2604.26752"},"observation_digest":"sha256:7485c37f1c7a69b9d0724563d6a98493eb8ce9a307e3390b3518c17b78c86f0d","observation_id":"7a033d59-b5ab-427b-9e86-075d527e4a53","resolution":{"observed_at":"2026-05-13T08:22:31.822621Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Seed2.0 model card: Towards intelligence frontier for real-world complexity","venue":null,"work_id":"1aea114c-86da-41d9-a546-4f5f8280966f","year":2026},"citing_paper":{"arxiv_id":"2604.26752","last_updated":"2026-05-12T15:07:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-29T14:49:37Z","title":"GLM-5V-Turbo: Toward a Native Foundation Model for Multimodal Agents","version":3},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-13T07:28:45.811192Z"},"links":{"citing_paper":"/paper/2604.26752"},"observation_digest":"sha256:ec09461cfddf09ac041e7bf0f55a41416750e1292fdd0349cbeae33363711830","observation_id":"548ef287-21c9-48d0-bed3-a8582483d2e9","resolution":{"observed_at":"2026-05-13T08:22:31.929610Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09990","last_updated":"2025-05-16T18:37:26Z","snapshot_observed_at":"2026-08-05T04:58:41.633559Z","submitted_at":"2025-05-15T06:04:42Z","title":"PointArena: Probing Multimodal Grounding Through Language-Guided Pointing","version":2},"cited_work":{"arxiv_id":"2505.09990","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.09990","snapshot_observed_at":"2026-07-04T04:29:35.800189Z","title":"Cheng, J","venue":null,"work_id":"f838c149-a8e1-4ada-ad52-1fbdb7fef0c1","year":2025},"citing_paper":{"arxiv_id":"2604.26752","last_updated":"2026-05-12T15:07:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-29T14:49:37Z","title":"GLM-5V-Turbo: Toward a Native Foundation Model for Multimodal Agents","version":3},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-13T07:28:45.811192Z"},"links":{"cited_paper":"/paper/2505.09990","citing_paper":"/paper/2604.26752"},"observation_digest":"sha256:cf168f511eafa21059e8905d72cf5ff673269b861b22af093ab9911737a4070d","observation_id":"ccd375ba-116a-4bfe-b769-a790e05b02b3","resolution":{"observed_at":"2026-05-13T07:32:30.501953Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Cheng, W","venue":null,"work_id":"2dbc56a7-6234-4fbe-9595-4dfbaca61e70","year":2025},"citing_paper":{"arxiv_id":"2604.26752","last_updated":"2026-05-12T15:07:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-29T14:49:37Z","title":"GLM-5V-Turbo: Toward a Native Foundation Model for Multimodal Agents","version":3},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-13T07:28:45.811192Z"},"links":{"citing_paper":"/paper/2604.26752"},"observation_digest":"sha256:4a469db902ca71b9accb8430264819050817799ceef189f94f9ddbae3f341c64","observation_id":"f14c9e75-5b69-4420-8b4a-ceb15b4045f8","resolution":{"observed_at":"2026-05-13T08:22:31.976624Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"defb64d0-120a-4be5-aaea-8b3df3128d35","year":2026},"citing_paper":{"arxiv_id":"2604.26752","last_updated":"2026-05-12T15:07:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-29T14:49:37Z","title":"GLM-5V-Turbo: Toward a Native Foundation Model for Multimodal Agents","version":3},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-13T07:28:45.811192Z"},"links":{"citing_paper":"/paper/2604.26752"},"observation_digest":"sha256:6aa159fb846f84ebb349b6fd94bbb988b1b947cd64114a6f43c42725042a0a4d","observation_id":"39e2e7ab-185a-4c36-a54e-3de3e5657c33","resolution":{"observed_at":"2026-05-13T08:22:31.907499Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.01619","last_updated":"2025-03-03T14:54:01Z","snapshot_observed_at":"2026-08-02T16:05:54.843255Z","submitted_at":"2025-03-03T14:54:01Z","title":"Advancing vision-language models in front-end development via data synthesis","version":1},"cited_work":{"arxiv_id":"2503.01619","doi":null,"metadata_source":"pith","pith_arxiv_id":"2503.01619","snapshot_observed_at":"2026-07-08T11:14:55.155420Z","title":"Advancing vision-language models in front-end development via data synthesis","venue":"cs.CV","work_id":"fb44047d-9b67-4e96-af54-cccadee8dfc1","year":2025},"citing_paper":{"arxiv_id":"2604.26752","last_updated":"2026-05-12T15:07:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-29T14:49:37Z","title":"GLM-5V-Turbo: Toward a Native Foundation Model for Multimodal Agents","version":3},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-13T07:28:45.811192Z"},"links":{"cited_paper":"/paper/2503.01619","citing_paper":"/paper/2604.26752"},"observation_digest":"sha256:9a0625701625b56624a7437104f2be1ec8db15e68dfd745e719cd11be43d10a6","observation_id":"583f0bc7-6720-470c-bd68-ca9fa9f61f47","resolution":{"observed_at":"2026-05-13T07:32:30.478163Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"cfecb18a-4ced-488f-993a-a6ea30c400ad","year":2025},"citing_paper":{"arxiv_id":"2604.26752","last_updated":"2026-05-12T15:07:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-29T14:49:37Z","title":"GLM-5V-Turbo: Toward a Native Foundation Model for Multimodal Agents","version":3},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-13T07:28:45.811192Z"},"links":{"citing_paper":"/paper/2604.26752"},"observation_digest":"sha256:39c0643c3891ab54b8635c022cf50cb670a3d25c808d3ffd24139d8eb30c1875","observation_id":"85503728-ddb0-469f-9871-fbf347707b04","resolution":{"observed_at":"2026-05-13T08:22:31.961224Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.19737","last_updated":"2024-04-30T17:33:57Z","snapshot_observed_at":"2026-08-03T23:22:09.849239Z","submitted_at":"2024-04-30T17:33:57Z","title":"Better & Faster Large Language Models via Multi-token Prediction","version":1},"cited_work":{"arxiv_id":"2404.19737","doi":"10.48550/arxiv.2404.19737","metadata_source":"pith","pith_arxiv_id":"2404.19737","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Better & Faster Large Language Models via Multi-token Prediction","venue":"cs.CL","work_id":"7235774b-df35-4d85-a7ef-7deebd473172","year":2024},"citing_paper":{"arxiv_id":"2604.26752","last_updated":"2026-05-12T15:07:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-29T14:49:37Z","title":"GLM-5V-Turbo: Toward a Native Foundation Model for Multimodal Agents","version":3},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-13T07:28:45.811192Z"},"links":{"cited_paper":"/paper/2404.19737","citing_paper":"/paper/2604.26752"},"observation_digest":"sha256:0a9fafa3544455c44cbc5ef0712e6bfdf6a1a8c9f71fa35bbad909a6e1e169b7","observation_id":"2cf6ea7a-5137-4d1b-b155-fb6adbbf446c","resolution":{"observed_at":"2026-05-16T12:26:09.884823Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"The latest updates for Deep Research in Gemini","venue":null,"work_id":"1774b07e-1f99-447e-be24-843a1d014783","year":2025},"citing_paper":{"arxiv_id":"2604.26752","last_updated":"2026-05-12T15:07:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-29T14:49:37Z","title":"GLM-5V-Turbo: Toward a Native Foundation Model for Multimodal Agents","version":3},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-13T07:28:45.811192Z"},"links":{"citing_paper":"/paper/2604.26752"},"observation_digest":"sha256:879a4f700aef6e37cd68c0a2b9e271a5363f3ffc2f2a8103c5ad46fee1689465","observation_id":"788a719c-2428-455b-b46a-03f1e11b1812","resolution":{"observed_at":"2026-05-13T08:22:31.925182Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.13919","last_updated":"2024-06-06T18:37:34Z","snapshot_observed_at":"2026-07-06T17:20:11.913242Z","submitted_at":"2024-01-25T03:33:18Z","title":"WebVoyager: Building an End-to-End Web Agent with Large Multimodal Models","version":4},"cited_work":{"arxiv_id":"2401.13919","doi":"10.48550/arxiv.2401.13919","metadata_source":"pith","pith_arxiv_id":"2401.13919","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"WebVoyager: Building an End-to-End Web Agent with Large Multimodal Models","venue":"cs.CL","work_id":"12c1d840-af20-4a4e-8750-6b9c6266638f","year":2024},"citing_paper":{"arxiv_id":"2604.26752","last_updated":"2026-05-12T15:07:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-29T14:49:37Z","title":"GLM-5V-Turbo: Toward a Native Foundation Model for Multimodal Agents","version":3},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-13T07:28:45.811192Z"},"links":{"cited_paper":"/paper/2401.13919","citing_paper":"/paper/2604.26752"},"observation_digest":"sha256:1024cc600796325d87513ac9344b3fb5f1bf8c065fbcb6c5ec2f28c48a991fdd","observation_id":"7d95dfef-c728-4961-99a9-31136c0df393","resolution":{"observed_at":"2026-05-15T22:43:35.479641Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2603.26648","last_updated":"2026-07-20T07:35:15Z","snapshot_observed_at":"2026-08-04T14:33:11.924362Z","submitted_at":"2026-03-27T17:50:45Z","title":"Vision2Web: A Hierarchical Benchmark for Visual Website Development with Agent Verification","version":3},"cited_work":{"arxiv_id":"2603.26648","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2603.26648","snapshot_observed_at":"2026-07-21T02:21:34.388156Z","title":"Vision2web: A hierarchical benchmark for visual website development with agent verification","venue":null,"work_id":"856a6bf8-7982-4891-9224-a4697f28614a","year":2026},"citing_paper":{"arxiv_id":"2604.26752","last_updated":"2026-05-12T15:07:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-29T14:49:37Z","title":"GLM-5V-Turbo: Toward a Native Foundation Model for Multimodal Agents","version":3},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-13T07:28:45.811192Z"},"links":{"cited_paper":"/paper/2603.26648","citing_paper":"/paper/2604.26752"},"observation_digest":"sha256:e12f46b8833620fe5ceddcd40e7450de2a11f28c6d421b17cdf4ce6f90deafcd","observation_id":"8044785c-a366-47f7-8a06-b3906713e3a0","resolution":{"observed_at":"2026-07-21T02:21:34.388156Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Henry, P","venue":null,"work_id":"602ef510-209b-4e18-adae-ed9bdcdb161a","year":2020},"citing_paper":{"arxiv_id":"2604.26752","last_updated":"2026-05-12T15:07:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-29T14:49:37Z","title":"GLM-5V-Turbo: Toward a Native Foundation Model for Multimodal Agents","version":3},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-13T07:28:45.811192Z"},"links":{"citing_paper":"/paper/2604.26752"},"observation_digest":"sha256:e19ebddfecaf48c6ee7adc0012949b154150289fdb42cb91c733b6a8d0abfb63","observation_id":"cccd50e1-4b82-4fca-8413-fdd5073d306b","resolution":{"observed_at":"2026-05-13T08:22:31.921453Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"72dd1974-c78d-4ed3-af40-7478dae297bd","year":2024},"citing_paper":{"arxiv_id":"2604.26752","last_updated":"2026-05-12T15:07:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-29T14:49:37Z","title":"GLM-5V-Turbo: Toward a Native Foundation Model for Multimodal Agents","version":3},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-13T07:28:45.811192Z"},"links":{"citing_paper":"/paper/2604.26752"},"observation_digest":"sha256:ac87b5fca0f764c83e20241630023c79a396d137247cf5b45a7b5b647b57a277","observation_id":"d3bab311-fcc7-45ac-b287-6c2d332cdf6c","resolution":{"observed_at":"2026-05-13T08:22:31.899443Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Jacovi, A","venue":null,"work_id":"c72540d5-dcbb-4eb5-9399-d3b0681358bd","year":null},"citing_paper":{"arxiv_id":"2604.26752","last_updated":"2026-05-12T15:07:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-29T14:49:37Z","title":"GLM-5V-Turbo: Toward a Native Foundation Model for Multimodal Agents","version":3},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-13T07:28:45.811192Z"},"links":{"citing_paper":"/paper/2604.26752"},"observation_digest":"sha256:89911dc0e071c4623e734279a5001fc866a51509444d5304925249ebe7a1e38d","observation_id":"1c35be63-ea6c-4b22-b0e9-257358ae17b7","resolution":{"observed_at":"2026-05-13T08:22:31.937846Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"279a7835-45d5-4d55-bef2-15d7c3b47cdb","year":null},"citing_paper":{"arxiv_id":"2604.26752","last_updated":"2026-05-12T15:07:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-29T14:49:37Z","title":"GLM-5V-Turbo: Toward a Native Foundation Model for Multimodal Agents","version":3},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-13T07:28:45.811192Z"},"links":{"citing_paper":"/paper/2604.26752"},"observation_digest":"sha256:d9809ce9a10c06bd38d45777b153d63515bfe4e5ab2f28b73808c5d8af0dc436","observation_id":"c4be0e21-1769-403b-b0ef-76bcf45e8a62","resolution":{"observed_at":"2026-05-13T08:22:31.933589Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12959","last_updated":"2024-11-27T08:49:12Z","snapshot_observed_at":"2026-07-06T19:18:17.523057Z","submitted_at":"2024-09-19T17:59:45Z","title":"MMSearch: Benchmarking the Potential of Large Models as Multi-modal Search Engines","version":2},"cited_work":{"arxiv_id":"2409.12959","doi":"10.48550/arxiv.2409.12959","metadata_source":"arxiv_reference","pith_arxiv_id":"2409.12959","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Bowen Jin, Hansi Zeng, Zhenrui Yue, Jinsung Yoon, Sercan Arik, Dong Wang, Hamed Zamani, and Jiawei Han","venue":"arXiv (Cornell University)","work_id":"d0ff946f-7130-4450-bc8f-42251af6e2c8","year":2025},"citing_paper":{"arxiv_id":"2604.26752","last_updated":"2026-05-12T15:07:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-29T14:49:37Z","title":"GLM-5V-Turbo: Toward a Native Foundation Model for Multimodal Agents","version":3},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-13T07:28:45.811192Z"},"links":{"cited_paper":"/paper/2409.12959","citing_paper":"/paper/2604.26752"},"observation_digest":"sha256:9d2fd50ec81cb60862feb79943cec064442efd61986ef4dd4b1fec23b6b9273a","observation_id":"04ced225-e5a5-4043-81f2-d4b0bc912c05","resolution":{"observed_at":"2026-05-13T07:32:30.516597Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06770","last_updated":"2024-11-11T23:05:04Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-10-10T16:47:29Z","title":"SWE-bench: Can Language Models Resolve Real-World GitHub Issues?","version":3},"cited_work":{"arxiv_id":"2310.06770","doi":"10.1145/512927.512945","metadata_source":"pith","pith_arxiv_id":"2310.06770","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"SWE-bench: Can Language Models Resolve Real-World GitHub Issues?","venue":"cs.CL","work_id":"d0effe15-a689-441a-8e3f-ea35f1c4e4b1","year":2023},"citing_paper":{"arxiv_id":"2604.26752","last_updated":"2026-05-12T15:07:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-29T14:49:37Z","title":"GLM-5V-Turbo: Toward a Native Foundation Model for Multimodal Agents","version":3},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-13T07:28:45.811192Z"},"links":{"cited_paper":"/paper/2310.06770","citing_paper":"/paper/2604.26752"},"observation_digest":"sha256:c0d9d8d27bbe03e79dcfef8a817356f42d36302ea13ae10d54b520cfdcd52268","observation_id":"72e1e3df-a385-4b94-8552-71b7a38dc9b4","resolution":{"observed_at":"2026-05-13T07:32:30.511303Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Jordan et al","venue":null,"work_id":"2cfa07bd-cae3-48c6-b7ea-06aa4cd8dc94","year":2024},"citing_paper":{"arxiv_id":"2604.26752","last_updated":"2026-05-12T15:07:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-29T14:49:37Z","title":"GLM-5V-Turbo: Toward a Native Foundation Model for Multimodal Agents","version":3},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-13T07:28:45.811192Z"},"links":{"citing_paper":"/paper/2604.26752"},"observation_digest":"sha256:a5e76ca80f355e690016f5da4df6afcd587ff0f8346c6e772dcfc99c1b0f7f29","observation_id":"d1e75dff-b34f-4adb-88c4-6707198e5b70","resolution":{"observed_at":"2026-05-13T08:22:31.873355Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Karpathy","venue":null,"work_id":"a432f398-213b-454a-962b-2ab8209c30d5","year":2026},"citing_paper":{"arxiv_id":"2604.26752","last_updated":"2026-05-12T15:07:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-29T14:49:37Z","title":"GLM-5V-Turbo: Toward a Native Foundation Model for Multimodal Agents","version":3},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-13T07:28:45.811192Z"},"links":{"citing_paper":"/paper/2604.26752"},"observation_digest":"sha256:5567a3e302b8298bbda631b15704af16b4b3918d1a242b56842b5a9005583fc6","observation_id":"63327540-69cf-474d-85ca-5ae7722d5909","resolution":{"observed_at":"2026-05-13T08:22:31.887491Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Kazemzadeh, V","venue":null,"work_id":"567294e1-24b7-4568-bffa-0021532603bb","year":2014},"citing_paper":{"arxiv_id":"2604.26752","last_updated":"2026-05-12T15:07:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-29T14:49:37Z","title":"GLM-5V-Turbo: Toward a Native Foundation Model for Multimodal Agents","version":3},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-13T07:28:45.811192Z"},"links":{"citing_paper":"/paper/2604.26752"},"observation_digest":"sha256:a91d8568a43d6c7fdafc3e44940d691ee806007920e2b71cab4c80efafcdc331","observation_id":"8032fc12-1d0f-42fc-b297-06912179d0d2","resolution":{"observed_at":"2026-05-13T08:22:31.948392Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"88bf264c-15b6-4d86-a174-2a102991f8f6","year":2024},"citing_paper":{"arxiv_id":"2604.26752","last_updated":"2026-05-12T15:07:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-29T14:49:37Z","title":"GLM-5V-Turbo: Toward a Native Foundation Model for Multimodal Agents","version":3},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-13T07:28:45.811192Z"},"links":{"citing_paper":"/paper/2604.26752"},"observation_digest":"sha256:3339f093dd4c37c226a0d19002e396c30974916fc0eccd888018c57bfb6d1fd2","observation_id":"74a82e5c-e2e3-49fc-aed2-5bae51e21725","resolution":{"observed_at":"2026-05-13T08:22:31.891311Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"4943cdfa-79bc-4160-afa0-178fe03d8bdc","year":2024},"citing_paper":{"arxiv_id":"2604.26752","last_updated":"2026-05-12T15:07:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-29T14:49:37Z","title":"GLM-5V-Turbo: Toward a Native Foundation Model for Multimodal Agents","version":3},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-13T07:28:45.811192Z"},"links":{"citing_paper":"/paper/2604.26752"},"observation_digest":"sha256:4dbaa320e09aab4132b7f21b562c15b753570909facfc662b367f22975634517","observation_id":"97d527d8-2777-453e-aa2c-c2a68924178e","resolution":{"observed_at":"2026-05-13T08:22:31.915735Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.02255","last_updated":"2024-01-21T03:47:06Z","snapshot_observed_at":"2026-07-06T16:27:15.027202Z","submitted_at":"2023-10-03T17:57:24Z","title":"MathVista: Evaluating Mathematical Reasoning of Foundation Models in Visual Contexts","version":3},"cited_work":{"arxiv_id":"2310.02255","doi":"10.1109/cvpr52734.2025.01245","metadata_source":"pith","pith_arxiv_id":"2310.02255","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"MathVista: Evaluating Mathematical Reasoning of Foundation Models in Visual Contexts","venue":"cs.CV","work_id":"e22c3789-9e71-4242-b6ea-3e60e06e2b66","year":2023},"citing_paper":{"arxiv_id":"2604.26752","last_updated":"2026-05-12T15:07:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-29T14:49:37Z","title":"GLM-5V-Turbo: Toward a Native Foundation Model for Multimodal Agents","version":3},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-13T07:28:45.811192Z"},"links":{"cited_paper":"/paper/2310.02255","citing_paper":"/paper/2604.26752"},"observation_digest":"sha256:5690c89b45d576440103f44a53b7d5479a4702a843ce2920c411f4ddc244e4d3","observation_id":"d940ec69-a774-429d-85b8-647a5ce27db8","resolution":{"observed_at":"2026-05-13T07:32:30.492606Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Introducing deep research","venue":null,"work_id":"06de004a-ac1a-43bd-b1b1-be45a84ec3c9","year":2025},"citing_paper":{"arxiv_id":"2604.26752","last_updated":"2026-05-12T15:07:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-29T14:49:37Z","title":"GLM-5V-Turbo: Toward a Native Foundation Model for Multimodal Agents","version":3},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-13T07:28:45.811192Z"},"links":{"citing_paper":"/paper/2604.26752"},"observation_digest":"sha256:d862b3095129db9c456e065c577ea86d614771606636761ee0bea1103ff6d5c0","observation_id":"020f7443-44c9-4e68-8d45-cf64e653bc68","resolution":{"observed_at":"2026-05-13T08:22:31.878966Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Introducing gpt-5.4","venue":null,"work_id":"af572363-2755-4108-b5d0-8c4254fdb6b7","year":null},"citing_paper":{"arxiv_id":"2604.26752","last_updated":"2026-05-12T15:07:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-29T14:49:37Z","title":"GLM-5V-Turbo: Toward a Native Foundation Model for Multimodal Agents","version":3},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-05-13T07:28:45.811192Z"},"links":{"citing_paper":"/paper/2604.26752"},"observation_digest":"sha256:fec29eaf37be1a053bc6b7a830209404b3d53837bbb2f2995b1dc2e6ff4ca7ca","observation_id":"efe4ac10-86f7-4d1a-860b-858c42d38e66","resolution":{"observed_at":"2026-05-13T08:22:31.944672Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"1667f344-0e0a-47a0-96b7-bfb58513b16d","year":2026},"citing_paper":{"arxiv_id":"2604.26752","last_updated":"2026-05-12T15:07:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-29T14:49:37Z","title":"GLM-5V-Turbo: Toward a Native Foundation Model for Multimodal Agents","version":3},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-13T07:28:45.811192Z"},"links":{"citing_paper":"/paper/2604.26752"},"observation_digest":"sha256:92be56d50cad1e09f524b566efdf7b1c53f5e4d0c895c0292606abe59505f9ea","observation_id":"a75a3a08-f7ce-4566-bbe8-2f24627a0627","resolution":{"observed_at":"2026-05-13T08:22:31.856442Z","resolver_source":"raw_fallback","status":"parse_uncertain"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Openclaw","venue":null,"work_id":"7903ec62-4c01-4e31-9625-f9abce7d0e7b","year":2026},"citing_paper":{"arxiv_id":"2604.26752","last_updated":"2026-05-12T15:07:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-29T14:49:37Z","title":"GLM-5V-Turbo: Toward a Native Foundation Model for Multimodal Agents","version":3},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-05-13T07:28:45.811192Z"},"links":{"citing_paper":"/paper/2604.26752"},"observation_digest":"sha256:367bc21ff2b28a19986a138a8f4ee5bf193e528005a2d74d76215afa6dc3b419","observation_id":"39674ea6-dbf5-4041-9617-34620976d8b1","resolution":{"observed_at":"2026-05-13T08:22:31.849831Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.14573","last_updated":"2025-04-06T20:37:50Z","snapshot_observed_at":"2026-07-06T18:18:39.093732Z","submitted_at":"2024-05-23T13:48:54Z","title":"AndroidWorld: A Dynamic Benchmarking Environment for Autonomous Agents","version":5},"cited_work":{"arxiv_id":"2405.14573","doi":"10.48550/arxiv.2405.14573","metadata_source":"pith","pith_arxiv_id":"2405.14573","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"AndroidWorld: A Dynamic Benchmarking Environment for Autonomous Agents","venue":"cs.AI","work_id":"c5116d19-d3d3-40fd-9620-f7489812a9ba","year":2024},"citing_paper":{"arxiv_id":"2604.26752","last_updated":"2026-05-12T15:07:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-29T14:49:37Z","title":"GLM-5V-Turbo: Toward a Native Foundation Model for Multimodal Agents","version":3},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-05-13T07:28:45.811192Z"},"links":{"cited_paper":"/paper/2405.14573","citing_paper":"/paper/2604.26752"},"observation_digest":"sha256:8183c3d4c663a314fa2b52e2a2ca935c8a5b99e9589080d757e1a06748d0f5c1","observation_id":"f68eaf73-8d46-4d06-b138-ace89458a825","resolution":{"observed_at":"2026-05-13T12:06:13.928391Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"b7c086a6-6503-4fde-b1f0-5ad5bc6e9789","year":2025},"citing_paper":{"arxiv_id":"2604.26752","last_updated":"2026-05-12T15:07:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-29T14:49:37Z","title":"GLM-5V-Turbo: Toward a Native Foundation Model for Multimodal Agents","version":3},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-05-13T07:28:45.811192Z"},"links":{"citing_paper":"/paper/2604.26752"},"observation_digest":"sha256:f56a158656f1c37aa733088cf1b96f244f691685d95a07faa936460fbfd0fbd5","observation_id":"56360865-4f98-418e-a710-d62142d06158","resolution":{"observed_at":"2026-05-13T08:22:31.883517Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.10104","last_updated":"2025-08-13T18:00:55Z","snapshot_observed_at":"2026-07-06T22:12:35.584339Z","submitted_at":"2025-08-13T18:00:55Z","title":"DINOv3","version":1},"cited_work":{"arxiv_id":"2508.10104","doi":"10.1055/a-2487-1252","metadata_source":"pith","pith_arxiv_id":"2508.10104","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"DINOv3","venue":"cs.CV","work_id":"c8b07deb-8fe7-4e18-9620-f3569d3529ce","year":2025},"citing_paper":{"arxiv_id":"2604.26752","last_updated":"2026-05-12T15:07:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-29T14:49:37Z","title":"GLM-5V-Turbo: Toward a Native Foundation Model for Multimodal Agents","version":3},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-05-13T07:28:45.811192Z"},"links":{"cited_paper":"/paper/2508.10104","citing_paper":"/paper/2604.26752"},"observation_digest":"sha256:cbfabfadf8590ac609e6b203768173dfe7e33257511b159be12416659abe949e","observation_id":"001477c9-59e8-4d72-97d2-37efd0f58d59","resolution":{"observed_at":"2026-05-13T07:32:30.521833Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"49d0d2ef-222d-4150-8718-c09221c13fdf","year":2015},"citing_paper":{"arxiv_id":"2604.26752","last_updated":"2026-05-12T15:07:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-29T14:49:37Z","title":"GLM-5V-Turbo: Toward a Native Foundation Model for Multimodal Agents","version":3},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-05-13T07:28:45.811192Z"},"links":{"citing_paper":"/paper/2604.26752"},"observation_digest":"sha256:be219525e5e2c8816902992303a833acc04a1b5130c763a7ba34c5a912af0fb8","observation_id":"00dad2d1-1596-4bc3-b8d7-f5efa9e4c75c","resolution":{"observed_at":"2026-05-13T08:22:31.912002Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Steinberger","venue":null,"work_id":"581a4329-d2a4-41ba-a6e0-2a791c168748","year":2026},"citing_paper":{"arxiv_id":"2604.26752","last_updated":"2026-05-12T15:07:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-29T14:49:37Z","title":"GLM-5V-Turbo: Toward a Native Foundation Model for Multimodal Agents","version":3},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-05-13T07:28:45.811192Z"},"links":{"citing_paper":"/paper/2604.26752"},"observation_digest":"sha256:d272e76b2b044292b39b27df00f6d271063c03f21cfea53166a719cb08468c5e","observation_id":"69b90f8b-7e84-472a-a570-fcc1a3d0c9b4","resolution":{"observed_at":"2026-05-13T08:22:31.956681Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2508.21475","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-01T09:55:40.994136Z","title":"arXiv preprint arXiv:2508.21475 , year=","venue":null,"work_id":"efdffdff-d55d-4d19-b563-a230dc2ace36","year":2025},"citing_paper":{"arxiv_id":"2604.26752","last_updated":"2026-05-12T15:07:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-29T14:49:37Z","title":"GLM-5V-Turbo: Toward a Native Foundation Model for Multimodal Agents","version":3},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-05-13T07:28:45.811192Z"},"links":{"citing_paper":"/paper/2604.26752"},"observation_digest":"sha256:121a6876c4916b7b64b3b715ca139a29f480be658dab02aee68ed946a1d769a6","observation_id":"3cf1a700-f4ee-48a7-9881-33b27a616b5a","resolution":{"observed_at":"2026-05-13T07:32:30.497430Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"a0b6e20f-de13-4edb-acbb-4f92557bb76b","year":2026},"citing_paper":{"arxiv_id":"2604.26752","last_updated":"2026-05-12T15:07:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-29T14:49:37Z","title":"GLM-5V-Turbo: Toward a Native Foundation Model for Multimodal Agents","version":3},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-05-13T07:28:45.811192Z"},"links":{"citing_paper":"/paper/2604.26752"},"observation_digest":"sha256:9d08362b97a6a96e11656239cec520948c205636aef17137aafeacbafb894274","observation_id":"9b89c985-455c-4915-9bc6-edad5de5e81f","resolution":{"observed_at":"2026-05-13T08:22:31.941305Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"5fadc807-d902-4d86-820a-2c8b68f97a67","year":2025},"citing_paper":{"arxiv_id":"2604.26752","last_updated":"2026-05-12T15:07:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-29T14:49:37Z","title":"GLM-5V-Turbo: Toward a Native Foundation Model for Multimodal Agents","version":3},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-05-13T07:28:45.811192Z"},"links":{"citing_paper":"/paper/2604.26752"},"observation_digest":"sha256:55d4d88ad6840b0d96ad19fd16a85d1b067ec35e0c74daa0822b62f586b520df","observation_id":"56d8f400-7760-4ecb-b2e2-6b6a92b3de0f","resolution":{"observed_at":"2026-05-13T08:22:31.866681Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"6508efc4-50aa-40b7-a143-d8b5e235b31c","year":2026},"citing_paper":{"arxiv_id":"2604.26752","last_updated":"2026-05-12T15:07:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-29T14:49:37Z","title":"GLM-5V-Turbo: Toward a Native Foundation Model for Multimodal Agents","version":3},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-05-13T07:28:45.811192Z"},"links":{"citing_paper":"/paper/2604.26752"},"observation_digest":"sha256:b96d81936130db548ec36c6441b5c7e89c6725a89c7b57a0ba78842574a5fe34","observation_id":"2fcd0186-b73f-4f1e-8cae-a3549625a314","resolution":{"observed_at":"2026-05-13T08:22:31.965187Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.14786","last_updated":"2025-02-20T18:08:29Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-20T18:08:29Z","title":"SigLIP 2: Multilingual Vision-Language Encoders with Improved Semantic Understanding, Localization, and Dense Features","version":1},"cited_work":{"arxiv_id":"2502.14786","doi":"10.48550/arxiv.2502.14786","metadata_source":"pith","pith_arxiv_id":"2502.14786","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"SigLIP 2: Multilingual Vision-Language Encoders with Improved Semantic Understanding, Localization, and Dense Features","venue":"cs.CV","work_id":"50eec732-2d41-432f-9dcf-ac7fff235ea5","year":2025},"citing_paper":{"arxiv_id":"2604.26752","last_updated":"2026-05-12T15:07:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-29T14:49:37Z","title":"GLM-5V-Turbo: Toward a Native Foundation Model for Multimodal Agents","version":3},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-05-13T07:28:45.811192Z"},"links":{"cited_paper":"/paper/2502.14786","citing_paper":"/paper/2604.26752"},"observation_digest":"sha256:a7ac5ea9e1aab677367bcceda7bd314271bb8e0be6becbb4c86a995887cd1586","observation_id":"7c2f6dea-184e-48f9-9cbb-69ddb766d874","resolution":{"observed_at":"2026-05-13T07:32:30.482826Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-07-10T23:49:08.777694+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-10T23:49:08.777694+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"0160f16a-22af-48d3-a35e-8b8f27fc817b","year":2024},"citing_paper":{"arxiv_id":"2604.26752","last_updated":"2026-05-12T15:07:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-29T14:49:37Z","title":"GLM-5V-Turbo: Toward a Native Foundation Model for Multimodal Agents","version":3},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-05-13T07:28:45.811192Z"},"links":{"citing_paper":"/paper/2604.26752"},"observation_digest":"sha256:132d3d0bb70eee2bd497572c01af20499df40a4ee6ee06d49d69347430e68b6a","observation_id":"7b904547-73b8-42aa-9c62-72af4e4b2476","resolution":{"observed_at":"2026-05-13T08:22:31.895168Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Wu and S","venue":null,"work_id":"25900109-03b0-4585-b734-00c187746140","year":2023},"citing_paper":{"arxiv_id":"2604.26752","last_updated":"2026-05-12T15:07:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-29T14:49:37Z","title":"GLM-5V-Turbo: Toward a Native Foundation Model for Multimodal Agents","version":3},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-05-13T07:28:45.811192Z"},"links":{"citing_paper":"/paper/2604.26752"},"observation_digest":"sha256:a4b3f14b335a647c674dc10d8c988e2e5a1a6b269d86e9f257833c83ca4a3e02","observation_id":"05ff0976-06b0-42d7-9706-6cf44db719bf","resolution":{"observed_at":"2026-05-13T08:22:31.951611Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.04973","last_updated":"2024-07-06T06:48:16Z","snapshot_observed_at":"2026-07-06T18:42:18.289966Z","submitted_at":"2024-07-06T06:48:16Z","title":"LogicVista: Multimodal LLM Logical Reasoning Benchmark in Visual Contexts","version":1},"cited_work":{"arxiv_id":"2407.04973","doi":"10.48550/arxiv.2407.04973","metadata_source":"pith","pith_arxiv_id":"2407.04973","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"LogicVista: Multimodal LLM Logical Reasoning Benchmark in Visual Contexts","venue":"cs.AI","work_id":"d1811506-9b67-4c64-ae5a-4abeaaec10f3","year":2024},"citing_paper":{"arxiv_id":"2604.26752","last_updated":"2026-05-12T15:07:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-29T14:49:37Z","title":"GLM-5V-Turbo: Toward a Native Foundation Model for Multimodal Agents","version":3},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-05-13T07:28:45.811192Z"},"links":{"cited_paper":"/paper/2407.04973","citing_paper":"/paper/2604.26752"},"observation_digest":"sha256:9feea5af99210d2d1d9c4951f3d95732908836a790b1e4f22f28ad4613fbf0ec","observation_id":"c8219ebd-e58b-426c-b3f8-886806d4afdd","resolution":{"observed_at":"2026-05-16T02:47:26.275168Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"e1b657c7-61c3-4391-b755-ca4f0a7b0ad5","year":2024},"citing_paper":{"arxiv_id":"2604.26752","last_updated":"2026-05-12T15:07:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-29T14:49:37Z","title":"GLM-5V-Turbo: Toward a Native Foundation Model for Multimodal Agents","version":3},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-05-13T07:28:45.811192Z"},"links":{"citing_paper":"/paper/2604.26752"},"observation_digest":"sha256:a7ec949ac6761a3622adcdf8829f5da357c6aa288334cbb0e98b974f2e1153ec","observation_id":"a5e7b4c9-6cb9-40b5-a2c9-03c3a879c87e","resolution":{"observed_at":"2026-05-13T08:22:31.972715Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"348a8260-f077-4ae3-acf9-58ce8c87183d","year":2025},"citing_paper":{"arxiv_id":"2604.26752","last_updated":"2026-05-12T15:07:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-29T14:49:37Z","title":"GLM-5V-Turbo: Toward a Native Foundation Model for Multimodal Agents","version":3},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-05-13T07:28:45.811192Z"},"links":{"citing_paper":"/paper/2604.26752"},"observation_digest":"sha256:b5ca983e8d9da4fbab60688fd77bb3d611929b5074c1c9f8d55b952f9dd81986","observation_id":"23c4db89-6517-41ff-8a43-10afd7ea51fc","resolution":{"observed_at":"2026-05-13T08:22:31.841580Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2604.06132","last_updated":"2026-05-07T14:06:23Z","snapshot_observed_at":"2026-07-06T22:54:40.349479Z","submitted_at":"2026-04-07T17:43:18Z","title":"Claw-Eval: Towards Trustworthy Evaluation of Autonomous Agents","version":3},"cited_work":{"arxiv_id":"2604.06132","doi":"10.48550/arxiv.2604.06132","metadata_source":"pith","pith_arxiv_id":"2604.06132","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"Claw-Eval: Towards Trustworthy Evaluation of Autonomous Agents","venue":"cs.AI","work_id":"57acc3ec-f4c3-49ab-bd0f-5aab91002df9","year":2026},"citing_paper":{"arxiv_id":"2604.26752","last_updated":"2026-05-12T15:07:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-29T14:49:37Z","title":"GLM-5V-Turbo: Toward a Native Foundation Model for Multimodal Agents","version":3},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-05-13T07:28:45.811192Z"},"links":{"cited_paper":"/paper/2604.06132","citing_paper":"/paper/2604.26752"},"observation_digest":"sha256:8e32eda50d89345e9b5c4abca4978224afaffe9e59c61df1f429ecbfce01e02e","observation_id":"08777abb-c136-4bc5-be92-5ce72b479e1f","resolution":{"observed_at":"2026-05-13T07:32:30.468067Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"d534285b-3fcb-4f15-b408-2cf66d291a64","year":2024},"citing_paper":{"arxiv_id":"2604.26752","last_updated":"2026-05-12T15:07:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-29T14:49:37Z","title":"GLM-5V-Turbo: Toward a Native Foundation Model for Multimodal Agents","version":3},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-05-13T07:28:45.811192Z"},"links":{"citing_paper":"/paper/2604.26752"},"observation_digest":"sha256:cab730c5fb8183ae17ff766cf2a8519cbdeca4f1c280a02468e625fc7a6c233d","observation_id":"be2727da-8678-4532-9815-1cec332654e9","resolution":{"observed_at":"2026-05-13T08:22:31.862949Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"ab99ff48-d22c-4df6-af00-dd33588e6e71","year":2025},"citing_paper":{"arxiv_id":"2604.26752","last_updated":"2026-05-12T15:07:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-29T14:49:37Z","title":"GLM-5V-Turbo: Toward a Native Foundation Model for Multimodal Agents","version":3},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-05-13T07:28:45.811192Z"},"links":{"citing_paper":"/paper/2604.26752"},"observation_digest":"sha256:4ffe3f3e42655eaf58ed46716676b4eece564afe1d073268c475dfe15d1e9e4f","observation_id":"383e5d36-29e3-4326-bd79-a3869a31fec2","resolution":{"observed_at":"2026-05-13T08:22:31.969030Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2602.15763","last_updated":"2026-02-24T10:44:44Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-02-17T17:50:56Z","title":"GLM-5: from Vibe Coding to Agentic Engineering","version":2},"cited_work":{"arxiv_id":"2602.15763","doi":"10.48550/arxiv.2602.15763","metadata_source":"pith","pith_arxiv_id":"2602.15763","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"GLM-5: from Vibe Coding to Agentic Engineering","venue":"cs.LG","work_id":"ad29b1a2-bf77-46b3-9ead-fb62b1d2c6fe","year":2026},"citing_paper":{"arxiv_id":"2604.26752","last_updated":"2026-05-12T15:07:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-29T14:49:37Z","title":"GLM-5V-Turbo: Toward a Native Foundation Model for Multimodal Agents","version":3},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-05-13T07:28:45.811192Z"},"links":{"cited_paper":"/paper/2602.15763","citing_paper":"/paper/2604.26752"},"observation_digest":"sha256:6333ea29e99cb14a3b4efb5a184909820be7347b6afa24f427658f604fd2ba6f","observation_id":"70f5e44f-5313-4d0e-87d2-6cf20fcdcb31","resolution":{"observed_at":"2026-05-13T07:32:30.526949Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"About Brand","venue":null,"work_id":"e97d0bf9-c442-48f1-ad0a-03d82335249a","year":2026},"citing_paper":{"arxiv_id":"2604.26752","last_updated":"2026-05-12T15:07:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-29T14:49:37Z","title":"GLM-5V-Turbo: Toward a Native Foundation Model for Multimodal Agents","version":3},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-05-13T07:28:45.811192Z"},"links":{"citing_paper":"/paper/2604.26752"},"observation_digest":"sha256:1fce2168d6d22a8ac3e313fa5aa6b71b4673bb8d6aa2dd3c110d3788ff7b344c","observation_id":"4ef9b497-3b47-465f-ad10-88be1b092388","resolution":{"observed_at":"2026-05-13T08:22:31.845986Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2604.26752","last_updated":"2026-05-12T15:07:13Z","latest_version":3,"primary_category":"cs.CV","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-29T14:49:37Z","title":"GLM-5V-Turbo: Toward a Native Foundation Model for Multimodal Agents"},"reference_resolution":{"displayed":50,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":1,"unresolved":18,"verified_exact":15,"verified_fuzzy":16},"total_outbound_references":50},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"thesis":"As of 6 August 2026, this Paper Citation Record lists 50 of 50 outbound references and 11 inbound Pith citation observations for arXiv:2604.26752."}