{"as_of":"2026-08-08T11:16:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:5b12a3ce154338ab7270ef32c9a244cb5c40888de8b47962bc71c19e40385a08","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":23,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":23,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":23,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":23,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T13:50:32.927998Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-04T09:09:43.184299Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2504.10342","last_updated":"2025-04-30T14:45:01Z","snapshot_observed_at":"2026-08-07T16:05:50.340309Z","submitted_at":"2025-04-14T15:50:39Z","title":"VisualPuzzles: Decoupling Multimodal Reasoning Evaluation from Domain Knowledge","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.10342","snapshot_observed_at":"2026-08-07T13:50:32.927998Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.20728","last_updated":"2025-08-26T03:25:38Z","snapshot_observed_at":"2026-08-07T13:45:31.054843Z","submitted_at":"2025-05-27T05:17:41Z","title":"Jigsaw-Puzzles: From Seeing to Understanding to Reasoning in Vision-Language Models","version":4},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-07T13:50:32.927998Z"},"links":{"cited_paper":"/paper/2504.10342","citing_paper":"/paper/2505.20728"},"observation_digest":"sha256:c480cdd9b9a84c7cac6f84dd4d41b88418b0b2a385a2fb528c2ef08574e325ca","observation_id":"dc85e25c-5131-46e0-a594-a8fb0bacfe77","resolution":{"observed_at":"2026-08-07T13:50:32.927998Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.10342","last_updated":"2025-04-30T14:45:01Z","snapshot_observed_at":"2026-08-07T16:05:50.340309Z","submitted_at":"2025-04-14T15:50:39Z","title":"VisualPuzzles: Decoupling Multimodal Reasoning Evaluation from Domain Knowledge","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.10342","snapshot_observed_at":"2026-08-07T13:35:59.800576Z","title":"Visualpuzzles: Decoupling multimodal reasoning evaluation from domain knowledge","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.21327","last_updated":"2025-05-27T15:23:23Z","snapshot_observed_at":"2026-08-07T13:27:31.159147Z","submitted_at":"2025-05-27T15:23:23Z","title":"MME-Reasoning: A Comprehensive Benchmark for Logical Reasoning in MLLMs","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-07T13:35:59.800576Z"},"links":{"cited_paper":"/paper/2504.10342","citing_paper":"/paper/2505.21327"},"observation_digest":"sha256:0c491e82926472bffd46b4938ea28a425db7420f54ad359a842ae877c202be75","observation_id":"e8aab8db-8a7b-4c70-acd6-5180a716456b","resolution":{"observed_at":"2026-08-07T13:35:59.800576Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.10342","last_updated":"2025-04-30T14:45:01Z","snapshot_observed_at":"2026-08-07T16:05:50.340309Z","submitted_at":"2025-04-14T15:50:39Z","title":"VisualPuzzles: Decoupling Multimodal Reasoning Evaluation from Domain Knowledge","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.10342","snapshot_observed_at":"2026-08-07T12:42:18.894158Z","title":"Visualpuz- zles: Decoupling multimodal reasoning evaluation from domain knowledge","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.23977","last_updated":"2025-05-29T20:08:36Z","snapshot_observed_at":"2026-08-08T06:23:16.428039Z","submitted_at":"2025-05-29T20:08:36Z","title":"VisualSphinx: Large-Scale Synthetic Vision Logic Puzzles for RL","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T12:42:18.894158Z"},"links":{"cited_paper":"/paper/2504.10342","citing_paper":"/paper/2505.23977"},"observation_digest":"sha256:0066c8e8fcd4fcc6d2009fd7575060943bb593fcbe8ce2a3b77d1de27b295b83","observation_id":"0299d2e3-07dc-4d17-91fe-4aac498c87bb","resolution":{"observed_at":"2026-08-07T12:42:18.894158Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.10342","last_updated":"2025-04-30T14:45:01Z","snapshot_observed_at":"2026-08-07T16:05:50.340309Z","submitted_at":"2025-04-14T15:50:39Z","title":"VisualPuzzles: Decoupling Multimodal Reasoning Evaluation from Domain Knowledge","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.10342","snapshot_observed_at":"2026-08-06T18:31:31.285831Z","title":"Vi- sualpuzzles: Decoupling multimodal reasoning evaluation from domain knowledge","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.07998","last_updated":"2025-08-27T07:42:56Z","snapshot_observed_at":"2026-08-07T15:21:56.692035Z","submitted_at":"2025-07-10T17:59:55Z","title":"PyVision: Agentic Vision with Dynamic Tooling","version":3},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-06T18:31:31.285831Z"},"links":{"cited_paper":"/paper/2504.10342","citing_paper":"/paper/2507.07998"},"observation_digest":"sha256:6bf8a53c624d54c947a64c096fde510473c1295667cceeebfea36264695e5e84","observation_id":"1bd79913-9728-404c-a379-a26deb8e6c40","resolution":{"observed_at":"2026-08-06T18:31:31.285831Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.10342","last_updated":"2025-04-30T14:45:01Z","snapshot_observed_at":"2026-08-07T16:05:50.340309Z","submitted_at":"2025-04-14T15:50:39Z","title":"VisualPuzzles: Decoupling Multimodal Reasoning Evaluation from Domain Knowledge","version":3},"cited_work":{"arxiv_id":"2504.10342","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2504.10342","snapshot_observed_at":"2026-07-04T09:09:43.184299Z","title":"Visualpuz- zles: Decoupling multimodal reasoning evaluation from domain knowledge","venue":null,"work_id":"98a56c91-cb1d-437e-b69a-3f8fca36abfc","year":2025},"citing_paper":{"arxiv_id":"2602.18600","last_updated":"2026-07-29T09:42:45Z","snapshot_observed_at":"2026-08-02T22:00:02.664173Z","submitted_at":"2026-02-20T20:22:18Z","title":"MapTab: A Diagnostic Benchmark for Long-Horizon Multi-Criteria Multimodal Reasoning on Heterogeneous Topological Graphs","version":2},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-05-15T20:12:46.385646Z"},"links":{"cited_paper":"/paper/2504.10342","citing_paper":"/paper/2602.18600"},"observation_digest":"sha256:bea713fbfc5cdeaefb8c7ed210dd13f9f8cec69cc1b8c05e67647a10b8ff919a","observation_id":"157d773d-61dd-4579-a0a3-75a727390367","resolution":{"observed_at":"2026-05-15T20:16:34.725580Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.10342","last_updated":"2025-04-30T14:45:01Z","snapshot_observed_at":"2026-08-07T16:05:50.340309Z","submitted_at":"2025-04-14T15:50:39Z","title":"VisualPuzzles: Decoupling Multimodal Reasoning Evaluation from Domain Knowledge","version":3},"cited_work":{"arxiv_id":"2504.10342","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2504.10342","snapshot_observed_at":"2026-07-04T09:09:43.184299Z","title":"Visualpuz- zles: Decoupling multimodal reasoning evaluation from domain knowledge","venue":null,"work_id":"98a56c91-cb1d-437e-b69a-3f8fca36abfc","year":2025},"citing_paper":{"arxiv_id":"2602.18600","last_updated":"2026-07-29T09:42:45Z","snapshot_observed_at":"2026-08-02T22:00:02.664173Z","submitted_at":"2026-02-20T20:22:18Z","title":"MapTab: A Diagnostic Benchmark for Long-Horizon Multi-Criteria Multimodal Reasoning on Heterogeneous Topological Graphs","version":3},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-05-22T10:30:06.829915Z"},"links":{"cited_paper":"/paper/2504.10342","citing_paper":"/paper/2602.18600"},"observation_digest":"sha256:050a3f08ff324d35cef8cf849b632837153463115113f7e503c9d8f68f0058bd","observation_id":"14012aca-e9b3-4b09-ba82-9391edd17e32","resolution":{"observed_at":"2026-05-22T10:31:25.285893Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.10342","last_updated":"2025-04-30T14:45:01Z","snapshot_observed_at":"2026-08-07T16:05:50.340309Z","submitted_at":"2025-04-14T15:50:39Z","title":"VisualPuzzles: Decoupling Multimodal Reasoning Evaluation from Domain Knowledge","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.10342","snapshot_observed_at":"2026-08-02T22:00:09.028700Z","title":"Visualpuz- zles: Decoupling multimodal reasoning evaluation from domain knowledge.arXiv preprint arXiv:2504.10342, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.18600","last_updated":"2026-07-29T09:42:45Z","snapshot_observed_at":"2026-08-02T22:00:02.664173Z","submitted_at":"2026-02-20T20:22:18Z","title":"MapTab: A Diagnostic Benchmark for Long-Horizon Multi-Criteria Multimodal Reasoning on Heterogeneous Topological Graphs","version":5},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-02T22:00:09.028700Z"},"links":{"cited_paper":"/paper/2504.10342","citing_paper":"/paper/2602.18600"},"observation_digest":"sha256:f6161a359371e9f8a44b0e33bba0bd3841fedd6fd14d0306f9e1f5be1248d919","observation_id":"36dc0cea-f4ce-4c15-8b78-2988d4cbaf90","resolution":{"observed_at":"2026-08-02T22:00:09.028700Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.10342","last_updated":"2025-04-30T14:45:01Z","snapshot_observed_at":"2026-08-07T16:05:50.340309Z","submitted_at":"2025-04-14T15:50:39Z","title":"VisualPuzzles: Decoupling Multimodal Reasoning Evaluation from Domain Knowledge","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.10342","snapshot_observed_at":"2026-07-13T19:19:52.557913Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.26779","last_updated":"2026-05-31T01:38:33Z","snapshot_observed_at":"2026-08-06T23:53:55.163569Z","submitted_at":"2026-03-25T01:17:13Z","title":"Limits of Spatial Imagery Reasoning in Frontier LLM Models","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-07-13T19:19:52.557913Z"},"links":{"cited_paper":"/paper/2504.10342","citing_paper":"/paper/2603.26779"},"observation_digest":"sha256:342bfa639edd3f86941e9f9965195205587d11f9d6c130383e650ab94eb5f712","observation_id":"28dea71a-aa68-40be-9c65-92537819bd3b","resolution":{"observed_at":"2026-07-13T19:19:52.557913Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.10342","last_updated":"2025-04-30T14:45:01Z","snapshot_observed_at":"2026-08-07T16:05:50.340309Z","submitted_at":"2025-04-14T15:50:39Z","title":"VisualPuzzles: Decoupling Multimodal Reasoning Evaluation from Domain Knowledge","version":3},"cited_work":{"arxiv_id":"2504.10342","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2504.10342","snapshot_observed_at":"2026-07-04T09:09:43.184299Z","title":"Visualpuz- zles: Decoupling multimodal reasoning evaluation from domain knowledge","venue":null,"work_id":"98a56c91-cb1d-437e-b69a-3f8fca36abfc","year":2025},"citing_paper":{"arxiv_id":"2604.06247","last_updated":"2026-04-06T16:29:05Z","snapshot_observed_at":"2026-07-06T22:54:48.916799Z","submitted_at":"2026-04-06T16:29:05Z","title":"SALLIE: Safeguarding Against Latent Language & Image Exploits","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-10T19:04:46.426969Z"},"links":{"cited_paper":"/paper/2504.10342","citing_paper":"/paper/2604.06247"},"observation_digest":"sha256:bdae0b18fa2d0e567ebcd43a8f92f9ae722959d0f8b71c4eaf813405a65329ae","observation_id":"8c9eab83-c05a-49e5-9dea-746e01f64a12","resolution":{"observed_at":"2026-05-10T23:30:51.295449Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.10342","last_updated":"2025-04-30T14:45:01Z","snapshot_observed_at":"2026-08-07T16:05:50.340309Z","submitted_at":"2025-04-14T15:50:39Z","title":"VisualPuzzles: Decoupling Multimodal Reasoning Evaluation from Domain Knowledge","version":3},"cited_work":{"arxiv_id":"2504.10342","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2504.10342","snapshot_observed_at":"2026-07-04T09:09:43.184299Z","title":"Visualpuz- zles: Decoupling multimodal reasoning evaluation from domain knowledge","venue":null,"work_id":"98a56c91-cb1d-437e-b69a-3f8fca36abfc","year":2025},"citing_paper":{"arxiv_id":"2604.10999","last_updated":"2026-06-06T02:58:48Z","snapshot_observed_at":"2026-08-08T01:31:41.325067Z","submitted_at":"2026-04-13T04:58:52Z","title":"TraversalBench: Challenging Paths to Follow for Vision Language Models","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-10T15:25:38.215013Z"},"links":{"cited_paper":"/paper/2504.10342","citing_paper":"/paper/2604.10999"},"observation_digest":"sha256:c865401a5a5bc118b2e8893e629c5d164e60193df8cb445c68a967c1c45e20c4","observation_id":"32710ea2-6bc0-4cea-a032-ea0f33c017a4","resolution":{"observed_at":"2026-05-11T10:36:02.685510Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.10342","last_updated":"2025-04-30T14:45:01Z","snapshot_observed_at":"2026-08-07T16:05:50.340309Z","submitted_at":"2025-04-14T15:50:39Z","title":"VisualPuzzles: Decoupling Multimodal Reasoning Evaluation from Domain Knowledge","version":3},"cited_work":{"arxiv_id":"2504.10342","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2504.10342","snapshot_observed_at":"2026-07-04T09:09:43.184299Z","title":"Visualpuz- zles: Decoupling multimodal reasoning evaluation from domain knowledge","venue":null,"work_id":"98a56c91-cb1d-437e-b69a-3f8fca36abfc","year":2025},"citing_paper":{"arxiv_id":"2605.09262","last_updated":"2026-05-10T02:17:14Z","snapshot_observed_at":"2026-07-06T23:21:21.560069Z","submitted_at":"2026-05-10T02:17:14Z","title":"Reinforcing Multimodal Reasoning Against Visual Degradation","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-05-12T04:37:21.451146Z"},"links":{"cited_paper":"/paper/2504.10342","citing_paper":"/paper/2605.09262"},"observation_digest":"sha256:43e54cec0f312b4da55a7c9f71f63b4dc9818c57b49fc32505e093682602c552","observation_id":"7a59ac05-a125-454e-ae97-d8497ee5de87","resolution":{"observed_at":"2026-05-12T06:06:25.204696Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.10342","last_updated":"2025-04-30T14:45:01Z","snapshot_observed_at":"2026-08-07T16:05:50.340309Z","submitted_at":"2025-04-14T15:50:39Z","title":"VisualPuzzles: Decoupling Multimodal Reasoning Evaluation from Domain Knowledge","version":3},"cited_work":{"arxiv_id":"2504.10342","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2504.10342","snapshot_observed_at":"2026-07-04T09:09:43.184299Z","title":"Visualpuz- zles: Decoupling multimodal reasoning evaluation from domain knowledge","venue":null,"work_id":"98a56c91-cb1d-437e-b69a-3f8fca36abfc","year":2025},"citing_paper":{"arxiv_id":"2605.12163","last_updated":"2026-05-13T02:23:44Z","snapshot_observed_at":"2026-08-02T15:57:40.981833Z","submitted_at":"2026-05-12T14:13:08Z","title":"Self-Consistent Latent Reasoning: Long Latent Sequence Reasoning for Vision-Language Model","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-05-13T07:14:48.918959Z"},"links":{"cited_paper":"/paper/2504.10342","citing_paper":"/paper/2605.12163"},"observation_digest":"sha256:25fd7ea601dddfc4c7f4f796ae2ae0290becafae3b69b1d5b7fe5700e8b7262e","observation_id":"17dca504-fc9a-489b-bffe-4dcc82decf55","resolution":{"observed_at":"2026-05-13T07:17:29.199028Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.10342","last_updated":"2025-04-30T14:45:01Z","snapshot_observed_at":"2026-08-07T16:05:50.340309Z","submitted_at":"2025-04-14T15:50:39Z","title":"VisualPuzzles: Decoupling Multimodal Reasoning Evaluation from Domain Knowledge","version":3},"cited_work":{"arxiv_id":"2504.10342","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2504.10342","snapshot_observed_at":"2026-07-04T09:09:43.184299Z","title":"Visualpuz- zles: Decoupling multimodal reasoning evaluation from domain knowledge","venue":null,"work_id":"98a56c91-cb1d-437e-b69a-3f8fca36abfc","year":2025},"citing_paper":{"arxiv_id":"2605.12163","last_updated":"2026-05-13T02:23:44Z","snapshot_observed_at":"2026-08-02T15:57:40.981833Z","submitted_at":"2026-05-12T14:13:08Z","title":"Self-Consistent Latent Reasoning: Long Latent Sequence Reasoning for Vision-Language Model","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-05-14T21:47:50.595481Z"},"links":{"cited_paper":"/paper/2504.10342","citing_paper":"/paper/2605.12163"},"observation_digest":"sha256:71520ec5714b2be2c0df0abb25b9636da4a0ded00408ebfe093d79a50b7faf5b","observation_id":"048ff051-86d8-4ffa-9f85-f94b1affb024","resolution":{"observed_at":"2026-05-14T21:48:00.572342Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.10342","last_updated":"2025-04-30T14:45:01Z","snapshot_observed_at":"2026-08-07T16:05:50.340309Z","submitted_at":"2025-04-14T15:50:39Z","title":"VisualPuzzles: Decoupling Multimodal Reasoning Evaluation from Domain Knowledge","version":3},"cited_work":{"arxiv_id":"2504.10342","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2504.10342","snapshot_observed_at":"2026-07-04T09:09:43.184299Z","title":"Visualpuz- zles: Decoupling multimodal reasoning evaluation from domain knowledge","venue":null,"work_id":"98a56c91-cb1d-437e-b69a-3f8fca36abfc","year":2025},"citing_paper":{"arxiv_id":"2605.19342","last_updated":"2026-05-27T02:07:05Z","snapshot_observed_at":"2026-08-03T16:06:14.906537Z","submitted_at":"2026-05-19T04:29:33Z","title":"Semantic-Enriched Latent Visual Reasoning","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-20T06:40:55.537488Z"},"links":{"cited_paper":"/paper/2504.10342","citing_paper":"/paper/2605.19342"},"observation_digest":"sha256:24cf368cf563300e3c2302bca0e267a6314130ad8cd7f810a348495d164a20e2","observation_id":"4cd7d506-de3d-4848-95b4-e600246450b2","resolution":{"observed_at":"2026-05-20T06:43:05.875829Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.10342","last_updated":"2025-04-30T14:45:01Z","snapshot_observed_at":"2026-08-07T16:05:50.340309Z","submitted_at":"2025-04-14T15:50:39Z","title":"VisualPuzzles: Decoupling Multimodal Reasoning Evaluation from Domain Knowledge","version":3},"cited_work":{"arxiv_id":"2504.10342","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2504.10342","snapshot_observed_at":"2026-07-04T09:09:43.184299Z","title":"Visualpuz- zles: Decoupling multimodal reasoning evaluation from domain knowledge","venue":null,"work_id":"98a56c91-cb1d-437e-b69a-3f8fca36abfc","year":2025},"citing_paper":{"arxiv_id":"2605.19342","last_updated":"2026-05-27T02:07:05Z","snapshot_observed_at":"2026-08-03T16:06:14.906537Z","submitted_at":"2026-05-19T04:29:33Z","title":"Semantic-Enriched Latent Visual Reasoning","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-06-30T18:48:04.370230Z"},"links":{"cited_paper":"/paper/2504.10342","citing_paper":"/paper/2605.19342"},"observation_digest":"sha256:cdbea77dcce1f0fa0d92bf1ebd8a87e22db4d7ade58f8925902a475b9a7219a4","observation_id":"db4ee2f6-c4f7-4e38-97bb-966aba36fff3","resolution":{"observed_at":"2026-06-30T18:55:00.779176Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.10342","last_updated":"2025-04-30T14:45:01Z","snapshot_observed_at":"2026-08-07T16:05:50.340309Z","submitted_at":"2025-04-14T15:50:39Z","title":"VisualPuzzles: Decoupling Multimodal Reasoning Evaluation from Domain Knowledge","version":3},"cited_work":{"arxiv_id":"2504.10342","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2504.10342","snapshot_observed_at":"2026-07-04T09:09:43.184299Z","title":"Visualpuz- zles: Decoupling multimodal reasoning evaluation from domain knowledge","venue":null,"work_id":"98a56c91-cb1d-437e-b69a-3f8fca36abfc","year":2025},"citing_paper":{"arxiv_id":"2606.00148","last_updated":"2026-05-29T03:20:05Z","snapshot_observed_at":"2026-07-06T23:40:51.363776Z","submitted_at":"2026-05-29T03:20:05Z","title":"StemBind: When MLLMs Get Lost Between Rules and Instances in Abstract Visual Reasoning","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-06-28T23:15:56.598968Z"},"links":{"cited_paper":"/paper/2504.10342","citing_paper":"/paper/2606.00148"},"observation_digest":"sha256:abb7c5406b235451154fea9cbab8474e7e95b738a1c80f825d4207f98261c41c","observation_id":"6b9996d1-738b-4331-a89d-f3355faf8ac1","resolution":{"observed_at":"2026-06-29T00:12:50.317499Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.10342","last_updated":"2025-04-30T14:45:01Z","snapshot_observed_at":"2026-08-07T16:05:50.340309Z","submitted_at":"2025-04-14T15:50:39Z","title":"VisualPuzzles: Decoupling Multimodal Reasoning Evaluation from Domain Knowledge","version":3},"cited_work":{"arxiv_id":"2504.10342","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2504.10342","snapshot_observed_at":"2026-07-04T09:09:43.184299Z","title":"Visualpuz- zles: Decoupling multimodal reasoning evaluation from domain knowledge","venue":null,"work_id":"98a56c91-cb1d-437e-b69a-3f8fca36abfc","year":2025},"citing_paper":{"arxiv_id":"2606.18216","last_updated":"2026-06-16T17:46:02Z","snapshot_observed_at":"2026-07-06T23:53:40.698123Z","submitted_at":"2026-06-16T17:46:02Z","title":"Zone of Proximal Policy Optimization: Teacher in Prompts, Not Gradients","version":1},"reference_index":141,"source":"pdf_text","source_observed_at":"2026-06-27T01:08:52.981296Z"},"links":{"cited_paper":"/paper/2504.10342","citing_paper":"/paper/2606.18216"},"observation_digest":"sha256:c9b9d8b4eb0476d04df6fb8bacbdf86f491a1a76a4a2836a28ef50e5068e52f3","observation_id":"0d4afd7a-2761-4209-b41e-ba36b85a72e4","resolution":{"observed_at":"2026-07-03T20:48:56.116501Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.10342","last_updated":"2025-04-30T14:45:01Z","snapshot_observed_at":"2026-08-07T16:05:50.340309Z","submitted_at":"2025-04-14T15:50:39Z","title":"VisualPuzzles: Decoupling Multimodal Reasoning Evaluation from Domain Knowledge","version":3},"cited_work":{"arxiv_id":"2504.10342","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2504.10342","snapshot_observed_at":"2026-07-04T09:09:43.184299Z","title":"Visualpuz- zles: Decoupling multimodal reasoning evaluation from domain knowledge","venue":null,"work_id":"98a56c91-cb1d-437e-b69a-3f8fca36abfc","year":2025},"citing_paper":{"arxiv_id":"2606.22565","last_updated":"2026-06-21T15:59:41Z","snapshot_observed_at":"2026-08-06T21:11:27.037310Z","submitted_at":"2026-06-21T15:59:41Z","title":"Look Light, Think Heavy: What Multimodal Chain-of-Thought Reasoning Can and Cannot Do","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-06-26T10:27:43.396559Z"},"links":{"cited_paper":"/paper/2504.10342","citing_paper":"/paper/2606.22565"},"observation_digest":"sha256:55a9f8f7987a762fece3228036d8c615307585490e427f64f8c509dafc9281a8","observation_id":"91627fbf-52d5-4376-b522-4392b0c57f4a","resolution":{"observed_at":"2026-07-04T09:09:43.185822Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.10342","last_updated":"2025-04-30T14:45:01Z","snapshot_observed_at":"2026-08-07T16:05:50.340309Z","submitted_at":"2025-04-14T15:50:39Z","title":"VisualPuzzles: Decoupling Multimodal Reasoning Evaluation from Domain Knowledge","version":3},"cited_work":{"arxiv_id":"2504.10342","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2504.10342","snapshot_observed_at":"2026-07-04T09:09:43.184299Z","title":"Visualpuz- zles: Decoupling multimodal reasoning evaluation from domain knowledge","venue":null,"work_id":"98a56c91-cb1d-437e-b69a-3f8fca36abfc","year":2025},"citing_paper":{"arxiv_id":"2607.02032","last_updated":"2026-07-06T17:18:28Z","snapshot_observed_at":"2026-08-06T15:12:20.089291Z","submitted_at":"2026-07-02T10:59:03Z","title":"PACE: A Proxy for Agentic Capability Evaluation","version":1},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-07-03T13:34:39.350893Z"},"links":{"cited_paper":"/paper/2504.10342","citing_paper":"/paper/2607.02032"},"observation_digest":"sha256:3e2eff70f53026480cdd4359920a49ffb4160c82a4b69304598de96a63873652","observation_id":"843e4628-03f0-49c5-80f1-819965140d95","resolution":{"observed_at":"2026-07-03T13:38:18.468017Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.10342","last_updated":"2025-04-30T14:45:01Z","snapshot_observed_at":"2026-08-07T16:05:50.340309Z","submitted_at":"2025-04-14T15:50:39Z","title":"VisualPuzzles: Decoupling Multimodal Reasoning Evaluation from Domain Knowledge","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.10342","snapshot_observed_at":"2026-07-12T08:29:58.561496Z","title":"arXiv preprint arXiv:2504.10342 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.02032","last_updated":"2026-07-06T17:18:28Z","snapshot_observed_at":"2026-08-06T15:12:20.089291Z","submitted_at":"2026-07-02T10:59:03Z","title":"PACE: A Proxy for Agentic Capability Evaluation","version":2},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-07-12T08:29:58.561496Z"},"links":{"cited_paper":"/paper/2504.10342","citing_paper":"/paper/2607.02032"},"observation_digest":"sha256:05ca6bb0765c25d077168c0d6bf2f0cb960270c3edc138934baf5eb0644be9a5","observation_id":"ef855c3d-5503-47e4-8adb-f9d5f82bc823","resolution":{"observed_at":"2026-07-12T08:29:58.561496Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.10342","last_updated":"2025-04-30T14:45:01Z","snapshot_observed_at":"2026-08-07T16:05:50.340309Z","submitted_at":"2025-04-14T15:50:39Z","title":"VisualPuzzles: Decoupling Multimodal Reasoning Evaluation from Domain Knowledge","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.10342","snapshot_observed_at":"2026-08-01T11:47:26.293957Z","title":"VisualPuz- zles: Decoupling multimodal reasoning evaluation from domain knowledge.arXiv preprint arXiv:2504.10342, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.19790","last_updated":"2026-07-22T06:17:57Z","snapshot_observed_at":"2026-08-06T04:55:07.559078Z","submitted_at":"2026-07-22T06:17:57Z","title":"Trace: A Taxonomy-Guided Environment for Multidomain Visual Reasoning","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-01T11:47:26.293957Z"},"links":{"cited_paper":"/paper/2504.10342","citing_paper":"/paper/2607.19790"},"observation_digest":"sha256:7e7522f9fb2ef4a2c02fb8b21a07339b5c7c4f50ab0ea677a63bb3f806cbae78","observation_id":"ca6f6a0e-2630-43d9-9ccf-325d95d6ef81","resolution":{"observed_at":"2026-08-01T11:47:26.293957Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.10342","last_updated":"2025-04-30T14:45:01Z","snapshot_observed_at":"2026-08-07T16:05:50.340309Z","submitted_at":"2025-04-14T15:50:39Z","title":"VisualPuzzles: Decoupling Multimodal Reasoning Evaluation from Domain Knowledge","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.10342","snapshot_observed_at":"2026-07-31T02:45:28.647722Z","title":"Visualpuz- zles: Decoupling multimodal reasoning evaluation from domain knowledge.arXiv preprint arXiv:2504.10342, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.28595","last_updated":"2026-07-30T17:46:55Z","snapshot_observed_at":"2026-08-03T15:42:49.918444Z","submitted_at":"2026-07-30T17:46:55Z","title":"Beacon: Knowing When and How to Perform Agentic Visual Reasoning","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-07-31T02:45:28.647722Z"},"links":{"cited_paper":"/paper/2504.10342","citing_paper":"/paper/2607.28595"},"observation_digest":"sha256:8471a3b075fb212a1fab5673d5249274b5b250d7d900c9a02f00b352c47dc20a","observation_id":"6b89ba06-8336-4c64-8b10-f79a53b39f0d","resolution":{"observed_at":"2026-07-31T02:45:28.647722Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.10342","last_updated":"2025-04-30T14:45:01Z","snapshot_observed_at":"2026-08-07T16:05:50.340309Z","submitted_at":"2025-04-14T15:50:39Z","title":"VisualPuzzles: Decoupling Multimodal Reasoning Evaluation from Domain Knowledge","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.10342","snapshot_observed_at":"2026-08-05T00:28:16.463177Z","title":"Tong,J.;Gu,J.;Lou,Y.;Fan,L.;Zou,Y.;Wu,Y.;Ye,J.;and Li,R.2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.00743","last_updated":"2026-08-01T16:27:45Z","snapshot_observed_at":"2026-08-08T04:13:13.963441Z","submitted_at":"2026-08-01T16:27:45Z","title":"LUT: Latent Utility Training for Visual Reasoning","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-05T00:28:16.463177Z"},"links":{"cited_paper":"/paper/2504.10342","citing_paper":"/paper/2608.00743"},"observation_digest":"sha256:c49b7bfbe70fbfa63a7dad62f2969427b83afaf7a65988ae42174c98f6f90be3","observation_id":"911b0bbe-095d-4888-802d-e7e9880745fa","resolution":{"observed_at":"2026-08-05T00:28:16.463177Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2504.10342/citation-record","integrity":"/paper/2504.10342/integrity","json":"/paper/2504.10342/citation-record.json","paper":"/paper/2504.10342"},"outbound":[],"paper":{"arxiv_id":"2504.10342","last_updated":"2025-04-30T14:45:01Z","latest_version":3,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-07T16:05:50.340309Z","submitted_at":"2025-04-14T15:50:39Z","title":"VisualPuzzles: Decoupling Multimodal Reasoning Evaluation from Domain Knowledge"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 23 inbound Pith citation observations for arXiv:2504.10342."}