{"as_of":"2026-08-08T18:58:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:f2a14fa5939fb0b06638fffbb850089ebaaebbf0aa1af35ce277afa2501ffa9c","coverage":[{"denominator":45,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":45,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T10:53:20.673277Z","state":"measured"},{"denominator":45,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":45,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2507.23382/citation-record","integrity":"/paper/2507.23382/integrity","json":"/paper/2507.23382/citation-record.json","paper":"/paper/2507.23382"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:53:21.516059Z","title":"Gpt-4 technical report","venue":null,"work_id":"74b1f5e8-ad0b-4717-9cda-65374e2b2e96","year":2023},"citing_paper":{"arxiv_id":"2507.23382","last_updated":"2025-07-31T09:59:17Z","snapshot_observed_at":"2026-08-07T11:02:57.710023Z","submitted_at":"2025-07-31T09:59:17Z","title":"MPCC: A Novel Benchmark for Multimodal Planning with Complex Constraints in Multimodal Large Language Models","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T10:53:20.497524Z"},"links":{"citing_paper":"/paper/2507.23382"},"observation_digest":"sha256:51101537047e73cb9ee842ae09aa220a94c43ced8ed61742ff87a5f738fafea2","observation_id":"38f6022c-3e77-4d45-b575-8e1ee440fa5a","resolution":{"observed_at":"2026-08-06T10:53:21.519968Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.09567","last_updated":"2025-07-18T15:57:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-12T17:35:03Z","title":"Towards Reasoning Era: A Survey of Long Chain-of-Thought for Reasoning Large Language Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.09567","snapshot_observed_at":"2026-08-06T10:53:20.502152Z","title":"Towards reasoning era: A survey of long chain-of-thought for reasoning large language models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.23382","last_updated":"2025-07-31T09:59:17Z","snapshot_observed_at":"2026-08-07T11:02:57.710023Z","submitted_at":"2025-07-31T09:59:17Z","title":"MPCC: A Novel Benchmark for Multimodal Planning with Complex Constraints in Multimodal Large Language Models","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T10:53:20.502152Z"},"links":{"cited_paper":"/paper/2503.09567","citing_paper":"/paper/2507.23382"},"observation_digest":"sha256:893f35799ba43f028d24750f9ef86c7165562ec92829a2b90f05decb9265d7a7","observation_id":"dfc13025-eb1c-4a87-88b3-7fc3ede17fa9","resolution":{"observed_at":"2026-08-06T10:53:20.502152Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:53:20.506901Z","title":"Ecm: A unified electronic circuit model for explaining the emergence of in-context learning and chain-of-thought in large language model.arXiv preprint arXiv:2502.03325, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.23382","last_updated":"2025-07-31T09:59:17Z","snapshot_observed_at":"2026-08-07T11:02:57.710023Z","submitted_at":"2025-07-31T09:59:17Z","title":"MPCC: A Novel Benchmark for Multimodal Planning with Complex Constraints in Multimodal Large Language Models","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T10:53:20.506901Z"},"links":{"citing_paper":"/paper/2507.23382"},"observation_digest":"sha256:8a12886755174a8fc54cfa27458467a48e72528b5166881957f5a291ba9e4bc8","observation_id":"7d024f42-d35d-4b7d-92ee-16babd56faaf","resolution":{"observed_at":"2026-08-06T10:53:20.506901Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:53:21.502393Z","title":"Un- locking the capabilities of thought: A reasoning boundary framework to quantify and optimize chain-of-thought","venue":null,"work_id":"5bc204b8-a8d8-44cb-b50a-18a8771e0228","year":2024},"citing_paper":{"arxiv_id":"2507.23382","last_updated":"2025-07-31T09:59:17Z","snapshot_observed_at":"2026-08-07T11:02:57.710023Z","submitted_at":"2025-07-31T09:59:17Z","title":"MPCC: A Novel Benchmark for Multimodal Planning with Complex Constraints in Multimodal Large Language Models","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T10:53:20.511551Z"},"links":{"citing_paper":"/paper/2507.23382"},"observation_digest":"sha256:fae24823b6415f377fa5a223e1408a09d4d55ad7da39996b47d3b31fd047f453","observation_id":"13f70436-3fe5-434d-90c7-e59b42e12ad9","resolution":{"observed_at":"2026-08-06T10:53:21.507106Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:53:21.489528Z","title":"M 3 cot: A novel benchmark for multi-domain multi-step multi-modal chain-of- thought","venue":null,"work_id":"503cc7bf-c135-4fc9-a355-8be8625cb49b","year":2024},"citing_paper":{"arxiv_id":"2507.23382","last_updated":"2025-07-31T09:59:17Z","snapshot_observed_at":"2026-08-07T11:02:57.710023Z","submitted_at":"2025-07-31T09:59:17Z","title":"MPCC: A Novel Benchmark for Multimodal Planning with Complex Constraints in Multimodal Large Language Models","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T10:53:20.515644Z"},"links":{"citing_paper":"/paper/2507.23382"},"observation_digest":"sha256:f804d8b1a3274ef2fc35e3523241c2863a7010520cb5cb4162c986499f202726","observation_id":"7d3e216e-b486-4320-a1fe-67023c648907","resolution":{"observed_at":"2026-08-06T10:53:21.493455Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:53:21.475307Z","title":"Egoplan-bench: Benchmarking egocentric embodied planning with multimodal large language models.CoRR, 2023","venue":null,"work_id":"24c558ca-a96b-47f6-8436-f8aa0ec2143e","year":2023},"citing_paper":{"arxiv_id":"2507.23382","last_updated":"2025-07-31T09:59:17Z","snapshot_observed_at":"2026-08-07T11:02:57.710023Z","submitted_at":"2025-07-31T09:59:17Z","title":"MPCC: A Novel Benchmark for Multimodal Planning with Complex Constraints in Multimodal Large Language Models","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T10:53:20.519787Z"},"links":{"citing_paper":"/paper/2507.23382"},"observation_digest":"sha256:c806a3c5e4b37315f9c8887aa613f020fcd8d1dc2cbb11c2872e035b86d1308b","observation_id":"4a376083-56d5-406a-b71c-5c2c975fcac7","resolution":{"observed_at":"2026-08-06T10:53:21.479982Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:53:21.460311Z","title":"Internvl: Scaling up vision foundation models and aligning for generic visual-linguistic tasks","venue":null,"work_id":"492a6bdf-b706-48d8-89f7-7e17e834cf23","year":2024},"citing_paper":{"arxiv_id":"2507.23382","last_updated":"2025-07-31T09:59:17Z","snapshot_observed_at":"2026-08-07T11:02:57.710023Z","submitted_at":"2025-07-31T09:59:17Z","title":"MPCC: A Novel Benchmark for Multimodal Planning with Complex Constraints in Multimodal Large Language Models","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T10:53:20.524370Z"},"links":{"citing_paper":"/paper/2507.23382"},"observation_digest":"sha256:f5ee1f0da4e9915c9fb90163596915972285c68c2643c28903449855eb74a406","observation_id":"03ca3a9d-8cff-4683-9d69-15435d998f64","resolution":{"observed_at":"2026-08-06T10:53:21.464734Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:53:20.528393Z","title":"Visual thoughts: A unified perspective of understanding multimodal chain-of-thought.arXiv preprint arXiv:2505.15510, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.23382","last_updated":"2025-07-31T09:59:17Z","snapshot_observed_at":"2026-08-07T11:02:57.710023Z","submitted_at":"2025-07-31T09:59:17Z","title":"MPCC: A Novel Benchmark for Multimodal Planning with Complex Constraints in Multimodal Large Language Models","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T10:53:20.528393Z"},"links":{"citing_paper":"/paper/2507.23382"},"observation_digest":"sha256:5be618151a93d645478e99e93f3adb58a849c39de0275afdd309a3e87bb41cc5","observation_id":"71c564ea-345e-4f30-a3cc-ae076c1446f7","resolution":{"observed_at":"2026-08-06T10:53:20.528393Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:53:21.447145Z","title":"Comt: A novel benchmark for chain of multi-modal thought on large vision-language models","venue":null,"work_id":"34d81202-b033-4d23-ab19-d64db5e3a8fd","year":2025},"citing_paper":{"arxiv_id":"2507.23382","last_updated":"2025-07-31T09:59:17Z","snapshot_observed_at":"2026-08-07T11:02:57.710023Z","submitted_at":"2025-07-31T09:59:17Z","title":"MPCC: A Novel Benchmark for Multimodal Planning with Complex Constraints in Multimodal Large Language Models","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T10:53:20.532223Z"},"links":{"citing_paper":"/paper/2507.23382"},"observation_digest":"sha256:8f3e03d2fbdbc26404d0d7a0f7b70303440f8b0daf972e4eab96e4d0faeac912","observation_id":"f1690525-f2cc-429f-a8e7-a80942b28811","resolution":{"observed_at":"2026-08-06T10:53:21.451184Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2301.00234","last_updated":"2024-10-05T11:47:02Z","snapshot_observed_at":"2026-07-06T14:36:25.690733Z","submitted_at":"2022-12-31T15:57:09Z","title":"A Survey on In-context Learning","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.00234","snapshot_observed_at":"2026-08-06T10:53:20.535987Z","title":"A survey on in-context learning","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.23382","last_updated":"2025-07-31T09:59:17Z","snapshot_observed_at":"2026-08-07T11:02:57.710023Z","submitted_at":"2025-07-31T09:59:17Z","title":"MPCC: A Novel Benchmark for Multimodal Planning with Complex Constraints in Multimodal Large Language Models","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T10:53:20.535987Z"},"links":{"cited_paper":"/paper/2301.00234","citing_paper":"/paper/2507.23382"},"observation_digest":"sha256:8b99ef87517ff01340172f69a727d1749992d0eb7dd34fd8f25bfef0db65e935","observation_id":"c27c78a9-7cd2-4fe4-9320-b1a8af5c589a","resolution":{"observed_at":"2026-08-06T10:53:20.535987Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:53:21.432882Z","title":"Vlmevalkit: An open- source toolkit for evaluating large multi-modality models","venue":null,"work_id":"c99c3dc1-c8bf-45ef-ac47-824daac6b89d","year":2024},"citing_paper":{"arxiv_id":"2507.23382","last_updated":"2025-07-31T09:59:17Z","snapshot_observed_at":"2026-08-07T11:02:57.710023Z","submitted_at":"2025-07-31T09:59:17Z","title":"MPCC: A Novel Benchmark for Multimodal Planning with Complex Constraints in Multimodal Large Language Models","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T10:53:20.540500Z"},"links":{"citing_paper":"/paper/2507.23382"},"observation_digest":"sha256:ddf8bffa1145a30c2909ca599d91d1ea08db327f84d18caf17ecb8b423df320a","observation_id":"5d2493a2-9ab8-4f45-b2f6-a97da016bfb0","resolution":{"observed_at":"2026-08-06T10:53:21.438119Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-06T10:53:20.544678Z","title":"Deepseek-r1: Incen- tivizing reasoning capability in llms via reinforcement learning.arXiv preprint arXiv:2501.12948, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.23382","last_updated":"2025-07-31T09:59:17Z","snapshot_observed_at":"2026-08-07T11:02:57.710023Z","submitted_at":"2025-07-31T09:59:17Z","title":"MPCC: A Novel Benchmark for Multimodal Planning with Complex Constraints in Multimodal Large Language Models","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T10:53:20.544678Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2507.23382"},"observation_digest":"sha256:e050048793d296f2058000a7be40c4ee74ff1118bce8f771d3d2f728b7e99fe2","observation_id":"ef8c7bb5-9147-4a2e-8615-507acd7add9b","resolution":{"observed_at":"2026-08-06T10:53:20.544678Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:53:21.419871Z","title":"Mllm-compbench: A compara- tive reasoning benchmark for multimodal llms","venue":null,"work_id":"8964b9f8-85ee-4277-b898-914b6a786370","year":2024},"citing_paper":{"arxiv_id":"2507.23382","last_updated":"2025-07-31T09:59:17Z","snapshot_observed_at":"2026-08-07T11:02:57.710023Z","submitted_at":"2025-07-31T09:59:17Z","title":"MPCC: A Novel Benchmark for Multimodal Planning with Complex Constraints in Multimodal Large Language Models","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T10:53:20.548904Z"},"links":{"citing_paper":"/paper/2507.23382"},"observation_digest":"sha256:334cd89806eae779ea4170b27e45f09ffd57c693730c978767890b24ac8a94fb","observation_id":"e9cfd071-65c8-4457-a939-78342128c09f","resolution":{"observed_at":"2026-08-06T10:53:21.423840Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.13649","last_updated":"2024-06-06T02:01:09Z","snapshot_observed_at":"2026-08-05T16:01:54.847394Z","submitted_at":"2024-01-24T18:35:21Z","title":"VisualWebArena: Evaluating Multimodal Agents on Realistic Visual Web Tasks","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.13649","snapshot_observed_at":"2026-08-06T10:53:20.552721Z","title":"Visualwebarena: Evaluating multimodal agents on realistic visual web tasks","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.23382","last_updated":"2025-07-31T09:59:17Z","snapshot_observed_at":"2026-08-07T11:02:57.710023Z","submitted_at":"2025-07-31T09:59:17Z","title":"MPCC: A Novel Benchmark for Multimodal Planning with Complex Constraints in Multimodal Large Language Models","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T10:53:20.552721Z"},"links":{"cited_paper":"/paper/2401.13649","citing_paper":"/paper/2507.23382"},"observation_digest":"sha256:7860a5f3c04676800e223761513e70eaf82088ee68b8b2528ce02fcdcae48423","observation_id":"e13ced5d-1622-4e0f-827e-a450a91147f7","resolution":{"observed_at":"2026-08-06T10:53:20.552721Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:53:21.406809Z","title":"Tree search for language model agents, 2024","venue":null,"work_id":"d2d74021-5a38-48e4-80d0-872ce8bbebd3","year":2024},"citing_paper":{"arxiv_id":"2507.23382","last_updated":"2025-07-31T09:59:17Z","snapshot_observed_at":"2026-08-07T11:02:57.710023Z","submitted_at":"2025-07-31T09:59:17Z","title":"MPCC: A Novel Benchmark for Multimodal Planning with Complex Constraints in Multimodal Large Language Models","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T10:53:20.556992Z"},"links":{"citing_paper":"/paper/2507.23382"},"observation_digest":"sha256:42f6adbe45bc4527f0bff4bface84d18fa1657a59c04827e6d93ffbef2c5e563","observation_id":"88aabee3-7b5a-49bd-a6d3-f42ca4afb14d","resolution":{"observed_at":"2026-08-06T10:53:21.410865Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:53:20.560926Z","title":"Large language models are zero-shot reasoners, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.23382","last_updated":"2025-07-31T09:59:17Z","snapshot_observed_at":"2026-08-07T11:02:57.710023Z","submitted_at":"2025-07-31T09:59:17Z","title":"MPCC: A Novel Benchmark for Multimodal Planning with Complex Constraints in Multimodal Large Language Models","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T10:53:20.560926Z"},"links":{"citing_paper":"/paper/2507.23382"},"observation_digest":"sha256:9508934d84c8beee5a6c23083789a036983c2487dcdb24814a8375283cc459c3","observation_id":"b3647e32-7be7-471a-a0b0-f4b92f9b4980","resolution":{"observed_at":"2026-08-06T10:53:20.560926Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:53:20.564766Z","title":"Llava-onevision: Easy visual task transfer, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.23382","last_updated":"2025-07-31T09:59:17Z","snapshot_observed_at":"2026-08-07T11:02:57.710023Z","submitted_at":"2025-07-31T09:59:17Z","title":"MPCC: A Novel Benchmark for Multimodal Planning with Complex Constraints in Multimodal Large Language Models","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T10:53:20.564766Z"},"links":{"citing_paper":"/paper/2507.23382"},"observation_digest":"sha256:6e55cece3317d3057a90855e8562142944dae2e5233b48f1e51e9f00cd97eddb","observation_id":"07d3ce67-45a7-4c52-8f9e-b251c317ace6","resolution":{"observed_at":"2026-08-06T10:53:20.564766Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:53:21.375720Z","title":"Seed-bench: Benchmarking multimodal large language models","venue":null,"work_id":"11c87dbb-b617-4182-9b60-9649ea1d55fb","year":2024},"citing_paper":{"arxiv_id":"2507.23382","last_updated":"2025-07-31T09:59:17Z","snapshot_observed_at":"2026-08-07T11:02:57.710023Z","submitted_at":"2025-07-31T09:59:17Z","title":"MPCC: A Novel Benchmark for Multimodal Planning with Complex Constraints in Multimodal Large Language Models","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T10:53:20.568470Z"},"links":{"citing_paper":"/paper/2507.23382"},"observation_digest":"sha256:0a27f1951247c30d0e70b4743a946063e69d5773d0522194ab7856f9f44472fb","observation_id":"f00ebf18-11f2-4a6c-95a1-5e526fe0e5a2","resolution":{"observed_at":"2026-08-06T10:53:21.379683Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:53:20.572100Z","title":"Behavior-1k: A benchmark for embodied ai with 1,000 everyday activities and realistic simulation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.23382","last_updated":"2025-07-31T09:59:17Z","snapshot_observed_at":"2026-08-07T11:02:57.710023Z","submitted_at":"2025-07-31T09:59:17Z","title":"MPCC: A Novel Benchmark for Multimodal Planning with Complex Constraints in Multimodal Large Language Models","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T10:53:20.572100Z"},"links":{"citing_paper":"/paper/2507.23382"},"observation_digest":"sha256:cded9255575d8ffe1b9f93dfcaf6590d67b8fcab4b17148e6b3f4de673828dac","observation_id":"f2526b6e-39a8-41ed-b38b-492360bdee11","resolution":{"observed_at":"2026-08-06T10:53:20.572100Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:53:21.352388Z","title":"Ferret-ui 2: Mastering universal user interface understanding across platforms, 2024","venue":null,"work_id":"79e7643b-38b9-4eb9-82b4-6a23de47cc77","year":2024},"citing_paper":{"arxiv_id":"2507.23382","last_updated":"2025-07-31T09:59:17Z","snapshot_observed_at":"2026-08-07T11:02:57.710023Z","submitted_at":"2025-07-31T09:59:17Z","title":"MPCC: A Novel Benchmark for Multimodal Planning with Complex Constraints in Multimodal Large Language Models","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T10:53:20.576092Z"},"links":{"citing_paper":"/paper/2507.23382"},"observation_digest":"sha256:6e6669e2d6a5bed852d0b9596aba8e9a137f6b0cb026f00b35f58429f3f5257d","observation_id":"20607dfc-846e-443e-8f8b-8454ead93101","resolution":{"observed_at":"2026-08-06T10:53:21.357032Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.04929","last_updated":"2024-06-08T10:31:18Z","snapshot_observed_at":"2026-08-04T19:54:53.058126Z","submitted_at":"2024-04-07T12:05:47Z","title":"RoboMP$^2$: A Robotic Multimodal Perception-Planning Framework with Multimodal Large Language Models","version":2},"cited_work":{"arxiv_id":"2404.04929","doi":null,"metadata_source":"pith","pith_arxiv_id":"2404.04929","snapshot_observed_at":"2026-08-06T10:53:20.851004Z","title":"RoboMP$^2$: A Robotic Multimodal Perception-Planning Framework with Multimodal Large Language Models","venue":"cs.RO","work_id":"dc5e174c-ec71-4126-acfc-0dff50af445b","year":2024},"citing_paper":{"arxiv_id":"2507.23382","last_updated":"2025-07-31T09:59:17Z","snapshot_observed_at":"2026-08-07T11:02:57.710023Z","submitted_at":"2025-07-31T09:59:17Z","title":"MPCC: A Novel Benchmark for Multimodal Planning with Complex Constraints in Multimodal Large Language Models","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T10:53:20.579657Z"},"links":{"cited_paper":"/paper/2404.04929","citing_paper":"/paper/2507.23382"},"observation_digest":"sha256:a78d82b10419ee4de23db8138a6824caf6dd80daa5a8eb7b308c8a100cd4f031","observation_id":"80832cb4-1839-4aab-a06d-2149fd8c6fc6","resolution":{"observed_at":"2026-08-06T10:53:20.857484Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.07975","last_updated":"2025-03-24T08:33:32Z","snapshot_observed_at":"2026-07-06T19:49:17.129421Z","submitted_at":"2024-11-12T17:55:10Z","title":"JanusFlow: Harmonizing Autoregression and Rectified Flow for Unified Multimodal Understanding and Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.07975","snapshot_observed_at":"2026-08-06T10:53:20.583635Z","title":"Janusflow: Harmo- nizing autoregression and rectified flow for unified multimodal understanding and generation.arXiv preprint arXiv:2411.07975, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.23382","last_updated":"2025-07-31T09:59:17Z","snapshot_observed_at":"2026-08-07T11:02:57.710023Z","submitted_at":"2025-07-31T09:59:17Z","title":"MPCC: A Novel Benchmark for Multimodal Planning with Complex Constraints in Multimodal Large Language Models","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T10:53:20.583635Z"},"links":{"cited_paper":"/paper/2411.07975","citing_paper":"/paper/2507.23382"},"observation_digest":"sha256:ce9dca159e789355d7f80412c82c341da80ad90a05f2550af22aaff72fa13918","observation_id":"b2cb7bce-9da2-403c-a023-6a9b43a115c2","resolution":{"observed_at":"2026-08-06T10:53:20.583635Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:53:21.338533Z","title":"m & m’s: A benchmark to evaluate tool-use for m ulti-step m ulti-modal tasks","venue":null,"work_id":"2f89c9b4-b1b4-467b-859c-868439c0fdcd","year":2024},"citing_paper":{"arxiv_id":"2507.23382","last_updated":"2025-07-31T09:59:17Z","snapshot_observed_at":"2026-08-07T11:02:57.710023Z","submitted_at":"2025-07-31T09:59:17Z","title":"MPCC: A Novel Benchmark for Multimodal Planning with Complex Constraints in Multimodal Large Language Models","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T10:53:20.587553Z"},"links":{"citing_paper":"/paper/2507.23382"},"observation_digest":"sha256:404e242b00c43d95d4f728502711b3f7a865178711453f9191f6e3bc8a8de2ec","observation_id":"2d7c84d5-0e23-4ef3-90af-b17f03632481","resolution":{"observed_at":"2026-08-06T10:53:21.342611Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:53:21.325137Z","title":"Perception test: A diagnostic benchmark for multimodal video models","venue":null,"work_id":"67c4b713-9269-40b8-8296-5a4659829459","year":2023},"citing_paper":{"arxiv_id":"2507.23382","last_updated":"2025-07-31T09:59:17Z","snapshot_observed_at":"2026-08-07T11:02:57.710023Z","submitted_at":"2025-07-31T09:59:17Z","title":"MPCC: A Novel Benchmark for Multimodal Planning with Complex Constraints in Multimodal Large Language Models","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T10:53:20.591223Z"},"links":{"citing_paper":"/paper/2507.23382"},"observation_digest":"sha256:04d3667e4764d25d3928fb44b3c049ef7d860051882d9f2c2d6b2bc0a8aec7be","observation_id":"e18d92fa-a9c9-4f16-9239-96f48aad6669","resolution":{"observed_at":"2026-08-06T10:53:21.329216Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.20482","last_updated":"2024-10-27T15:37:51Z","snapshot_observed_at":"2026-07-06T19:40:21.797132Z","submitted_at":"2024-10-27T15:37:51Z","title":"What Factors Affect Multi-Modal In-Context Learning? An In-Depth Exploration","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.20482","snapshot_observed_at":"2026-08-06T10:53:20.594935Z","title":"What factors affect multi-modal in-context learning? an in-depth exploration.arXiv preprint arXiv:2410.20482, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.23382","last_updated":"2025-07-31T09:59:17Z","snapshot_observed_at":"2026-08-07T11:02:57.710023Z","submitted_at":"2025-07-31T09:59:17Z","title":"MPCC: A Novel Benchmark for Multimodal Planning with Complex Constraints in Multimodal Large Language Models","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T10:53:20.594935Z"},"links":{"cited_paper":"/paper/2410.20482","citing_paper":"/paper/2507.23382"},"observation_digest":"sha256:fd807876b532a5d69caaea8069013e8101fad3514ca14f5d221598f3ce1d4950","observation_id":"3b11e0bc-ef44-4a5c-b56b-fb42a421b34a","resolution":{"observed_at":"2026-08-06T10:53:20.594935Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:53:21.311710Z","title":"Mementos: System support for long-running computation on rfid-scale devices","venue":null,"work_id":"42cfe3ae-542e-4d98-9a28-33f864ecc12e","year":2011},"citing_paper":{"arxiv_id":"2507.23382","last_updated":"2025-07-31T09:59:17Z","snapshot_observed_at":"2026-08-07T11:02:57.710023Z","submitted_at":"2025-07-31T09:59:17Z","title":"MPCC: A Novel Benchmark for Multimodal Planning with Complex Constraints in Multimodal Large Language Models","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T10:53:20.598656Z"},"links":{"citing_paper":"/paper/2507.23382"},"observation_digest":"sha256:a668d703df571337f25fcab27d10ec0f635c60e2a7221c280feb0f4529754009","observation_id":"e1663673-4322-4823-b7ba-ef621e7f5a66","resolution":{"observed_at":"2026-08-06T10:53:21.315978Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:53:21.297817Z","title":"Alfred: A benchmark for interpreting grounded instructions for everyday tasks","venue":null,"work_id":"08410bde-b8e3-4fd2-b3a1-23ab4840565a","year":2020},"citing_paper":{"arxiv_id":"2507.23382","last_updated":"2025-07-31T09:59:17Z","snapshot_observed_at":"2026-08-07T11:02:57.710023Z","submitted_at":"2025-07-31T09:59:17Z","title":"MPCC: A Novel Benchmark for Multimodal Planning with Complex Constraints in Multimodal Large Language Models","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T10:53:20.602259Z"},"links":{"citing_paper":"/paper/2507.23382"},"observation_digest":"sha256:b7a850787ebd59eb5952dd854bcd7d34ab552a4f5a2f815f4dd46318368c6f17","observation_id":"fdb76c80-db26-41c4-824f-56969aaf932b","resolution":{"observed_at":"2026-08-06T10:53:21.302254Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.11805","last_updated":"2025-05-09T21:04:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-12-19T02:39:27Z","title":"Gemini: A Family of Highly Capable Multimodal Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.11805","snapshot_observed_at":"2026-08-06T10:53:20.606796Z","title":"Gemini: a family of highly capable multimodal models.arXiv preprint arXiv:2312.11805, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.23382","last_updated":"2025-07-31T09:59:17Z","snapshot_observed_at":"2026-08-07T11:02:57.710023Z","submitted_at":"2025-07-31T09:59:17Z","title":"MPCC: A Novel Benchmark for Multimodal Planning with Complex Constraints in Multimodal Large Language Models","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T10:53:20.606796Z"},"links":{"cited_paper":"/paper/2312.11805","citing_paper":"/paper/2507.23382"},"observation_digest":"sha256:8cc05d4cf1a4588d6e941eeb9c707b0c3437b281100fe72702473763cc34a611","observation_id":"4300e1d5-9a33-4489-a7f5-b3b29cf42ef6","resolution":{"observed_at":"2026-08-06T10:53:20.606796Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:53:21.283471Z","title":"Qvq: To see the world with wisdom, 2024","venue":null,"work_id":"dc4b1657-a0b8-44f3-9d0e-eb4c627dd04f","year":2024},"citing_paper":{"arxiv_id":"2507.23382","last_updated":"2025-07-31T09:59:17Z","snapshot_observed_at":"2026-08-07T11:02:57.710023Z","submitted_at":"2025-07-31T09:59:17Z","title":"MPCC: A Novel Benchmark for Multimodal Planning with Complex Constraints in Multimodal Large Language Models","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T10:53:20.610677Z"},"links":{"citing_paper":"/paper/2507.23382"},"observation_digest":"sha256:1763023899d9c817e66a11a3e2d4162b566651832174f78d466e006c01228850","observation_id":"d6e7aed5-07cf-4a4c-988a-d32486c2c349","resolution":{"observed_at":"2026-08-06T10:53:21.287495Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:53:20.614626Z","title":"Planbench: An extensible benchmark for evaluating large language models on planning and reasoning about change, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.23382","last_updated":"2025-07-31T09:59:17Z","snapshot_observed_at":"2026-08-07T11:02:57.710023Z","submitted_at":"2025-07-31T09:59:17Z","title":"MPCC: A Novel Benchmark for Multimodal Planning with Complex Constraints in Multimodal Large Language Models","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T10:53:20.614626Z"},"links":{"citing_paper":"/paper/2507.23382"},"observation_digest":"sha256:5da46acd296ee3cb94aecf16710e3657e9cf7ab0610d2d765420e68dddfc9979","observation_id":"415ebad2-08aa-44e8-8832-4fc3bfd011b0","resolution":{"observed_at":"2026-08-06T10:53:20.614626Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:53:21.260770Z","title":"Xlrs-bench: Could your multimodal llms understand extremely large ultra-high-resolution remote sensing imagery?, 2025","venue":null,"work_id":"410f4ffa-fe2f-4b64-b299-b873d5b6a9ea","year":2025},"citing_paper":{"arxiv_id":"2507.23382","last_updated":"2025-07-31T09:59:17Z","snapshot_observed_at":"2026-08-07T11:02:57.710023Z","submitted_at":"2025-07-31T09:59:17Z","title":"MPCC: A Novel Benchmark for Multimodal Planning with Complex Constraints in Multimodal Large Language Models","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T10:53:20.618401Z"},"links":{"citing_paper":"/paper/2507.23382"},"observation_digest":"sha256:0ef8487494d83a440912252a3b4d2f1c7af4ac8360f061bb09064f96e5dcbbc8","observation_id":"175ce598-3c26-41fd-a595-99bdebe0ef8d","resolution":{"observed_at":"2026-08-06T10:53:21.264906Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.04091","last_updated":"2023-05-26T07:06:48Z","snapshot_observed_at":"2026-07-06T15:24:07.662207Z","submitted_at":"2023-05-06T16:34:37Z","title":"Plan-and-Solve Prompting: Improving Zero-Shot Chain-of-Thought Reasoning by Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.04091","snapshot_observed_at":"2026-08-06T10:53:20.622273Z","title":"Plan-and-solve prompting: Improving zero-shot chain-of-thought reasoning by large language models.arXiv preprint arXiv:2305.04091, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.23382","last_updated":"2025-07-31T09:59:17Z","snapshot_observed_at":"2026-08-07T11:02:57.710023Z","submitted_at":"2025-07-31T09:59:17Z","title":"MPCC: A Novel Benchmark for Multimodal Planning with Complex Constraints in Multimodal Large Language Models","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T10:53:20.622273Z"},"links":{"cited_paper":"/paper/2305.04091","citing_paper":"/paper/2507.23382"},"observation_digest":"sha256:59c0f5d9d135de09138fb1720065040d592294060b656773dc0e20e7d15bf1f4","observation_id":"64d6f275-87ee-4f1c-944e-b2e104f60ad3","resolution":{"observed_at":"2026-08-06T10:53:20.622273Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12191","last_updated":"2024-10-03T15:54:49Z","snapshot_observed_at":"2026-08-06T05:35:29.109022Z","submitted_at":"2024-09-18T17:59:32Z","title":"Qwen2-VL: Enhancing Vision-Language Model's Perception of the World at Any Resolution","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.12191","snapshot_observed_at":"2026-08-06T10:53:20.626682Z","title":"Qwen2-vl: Enhancing vision-language model’s perception of the world at any resolution.arXiv preprint arXiv:2409.12191, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.23382","last_updated":"2025-07-31T09:59:17Z","snapshot_observed_at":"2026-08-07T11:02:57.710023Z","submitted_at":"2025-07-31T09:59:17Z","title":"MPCC: A Novel Benchmark for Multimodal Planning with Complex Constraints in Multimodal Large Language Models","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T10:53:20.626682Z"},"links":{"cited_paper":"/paper/2409.12191","citing_paper":"/paper/2507.23382"},"observation_digest":"sha256:32f8e23af885174daf8d870941d53c64ec6c8281ab2a8c703c47e6752a2cc94f","observation_id":"a43f15a6-d6dd-4aec-9a8f-94076181df54","resolution":{"observed_at":"2026-08-06T10:53:20.626682Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:53:21.247278Z","title":"S3 agent: Unlocking the power of vllm for zero-shot multi-modal sarcasm detection.ACM Transactions on Multimedia Computing, Communications and Applications, 2024","venue":null,"work_id":"03865288-8524-4bb5-bf27-4c055753a41f","year":2024},"citing_paper":{"arxiv_id":"2507.23382","last_updated":"2025-07-31T09:59:17Z","snapshot_observed_at":"2026-08-07T11:02:57.710023Z","submitted_at":"2025-07-31T09:59:17Z","title":"MPCC: A Novel Benchmark for Multimodal Planning with Complex Constraints in Multimodal Large Language Models","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T10:53:20.630864Z"},"links":{"citing_paper":"/paper/2507.23382"},"observation_digest":"sha256:db4c4d8c35b386939b30fa337ec89b7b219aee4dacb1fbcc18dafcac737653de","observation_id":"e25a1a96-ca37-46a9-a969-d45c7963374c","resolution":{"observed_at":"2026-08-06T10:53:21.251436Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:53:21.233015Z","title":"Chain-of-thought prompting elicits reasoning in large language models","venue":null,"work_id":"aff14fcb-3a69-45f3-bae7-18324e483369","year":2022},"citing_paper":{"arxiv_id":"2507.23382","last_updated":"2025-07-31T09:59:17Z","snapshot_observed_at":"2026-08-07T11:02:57.710023Z","submitted_at":"2025-07-31T09:59:17Z","title":"MPCC: A Novel Benchmark for Multimodal Planning with Complex Constraints in Multimodal Large Language Models","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T10:53:20.634494Z"},"links":{"citing_paper":"/paper/2507.23382"},"observation_digest":"sha256:bf463ec74fcb789a6c2bbe76535a3e5f5ab960b804da6dae97206a102b72b8ae","observation_id":"31d4ee66-0bea-495b-95af-e3346d405260","resolution":{"observed_at":"2026-08-06T10:53:21.237662Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.13848","last_updated":"2024-10-17T17:58:37Z","snapshot_observed_at":"2026-08-03T03:16:45.693966Z","submitted_at":"2024-10-17T17:58:37Z","title":"Janus: Decoupling Visual Encoding for Unified Multimodal Understanding and Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.13848","snapshot_observed_at":"2026-08-06T10:53:20.638489Z","title":"Janus: Decoupling visual encoding for unified multimodal understanding and generation.arXiv preprint arXiv:2410.13848, 2024","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.23382","last_updated":"2025-07-31T09:59:17Z","snapshot_observed_at":"2026-08-07T11:02:57.710023Z","submitted_at":"2025-07-31T09:59:17Z","title":"MPCC: A Novel Benchmark for Multimodal Planning with Complex Constraints in Multimodal Large Language Models","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T10:53:20.638489Z"},"links":{"cited_paper":"/paper/2410.13848","citing_paper":"/paper/2507.23382"},"observation_digest":"sha256:1218ee7bee5038e8fa1095c5f772bb350efb396ff9a3d84c6892fb950d52aed5","observation_id":"e098dcdc-292b-4deb-9cea-d21e07d50b92","resolution":{"observed_at":"2026-08-06T10:53:20.638489Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.10302","last_updated":"2024-12-13T17:37:48Z","snapshot_observed_at":"2026-08-07T03:01:29.031129Z","submitted_at":"2024-12-13T17:37:48Z","title":"DeepSeek-VL2: Mixture-of-Experts Vision-Language Models for Advanced Multimodal Understanding","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.10302","snapshot_observed_at":"2026-08-06T10:53:20.642627Z","title":"Deepseek-vl2: Mixture-of-experts vision-language models for advanced multimodal under- standing.arXiv preprint arXiv:2412.10302, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.23382","last_updated":"2025-07-31T09:59:17Z","snapshot_observed_at":"2026-08-07T11:02:57.710023Z","submitted_at":"2025-07-31T09:59:17Z","title":"MPCC: A Novel Benchmark for Multimodal Planning with Complex Constraints in Multimodal Large Language Models","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T10:53:20.642627Z"},"links":{"cited_paper":"/paper/2412.10302","citing_paper":"/paper/2507.23382"},"observation_digest":"sha256:3a8cfcb5715ecedc2901b1af172de06044a2299e2eb82c0f56222383829092e0","observation_id":"8dad09c2-d8f5-4d26-a6bf-c430b5b79682","resolution":{"observed_at":"2026-08-06T10:53:20.642627Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.04973","last_updated":"2024-07-06T06:48:16Z","snapshot_observed_at":"2026-07-06T18:42:18.289966Z","submitted_at":"2024-07-06T06:48:16Z","title":"LogicVista: Multimodal LLM Logical Reasoning Benchmark in Visual Contexts","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.04973","snapshot_observed_at":"2026-08-06T10:53:20.646437Z","title":"Logicvista: Multimodal llm logical reasoning benchmark in visual contexts.arXiv preprint arXiv:2407.04973, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.23382","last_updated":"2025-07-31T09:59:17Z","snapshot_observed_at":"2026-08-07T11:02:57.710023Z","submitted_at":"2025-07-31T09:59:17Z","title":"MPCC: A Novel Benchmark for Multimodal Planning with Complex Constraints in Multimodal Large Language Models","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-06T10:53:20.646437Z"},"links":{"cited_paper":"/paper/2407.04973","citing_paper":"/paper/2507.23382"},"observation_digest":"sha256:17dd3a6765a1f9839ea53d9dbb07f919d6dc069bb084c20ca8cef43143f9d98f","observation_id":"40164780-a8fd-448a-b20b-6e7c10104746","resolution":{"observed_at":"2026-08-06T10:53:20.646437Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:53:21.218100Z","title":"Osworld: Benchmarking multimodal agents for open-ended tasks in real computer envi- ronments","venue":null,"work_id":"28777705-e305-45f0-80ce-e76c4e045f76","year":2024},"citing_paper":{"arxiv_id":"2507.23382","last_updated":"2025-07-31T09:59:17Z","snapshot_observed_at":"2026-08-07T11:02:57.710023Z","submitted_at":"2025-07-31T09:59:17Z","title":"MPCC: A Novel Benchmark for Multimodal Planning with Complex Constraints in Multimodal Large Language Models","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T10:53:20.650321Z"},"links":{"citing_paper":"/paper/2507.23382"},"observation_digest":"sha256:795a631c65415066627c00aa9d0a5754a64c3aae32ee2c151ffb2d1addbbf70a","observation_id":"9fbe474f-7f41-4e34-8c20-c37f16660a2e","resolution":{"observed_at":"2026-08-06T10:53:21.222379Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:53:21.204427Z","title":"Mm-react: Prompt- ing chatgpt for multimodal reasoning and action, 2023","venue":null,"work_id":"ffe0469e-1b40-4219-9802-a33db314deee","year":2023},"citing_paper":{"arxiv_id":"2507.23382","last_updated":"2025-07-31T09:59:17Z","snapshot_observed_at":"2026-08-07T11:02:57.710023Z","submitted_at":"2025-07-31T09:59:17Z","title":"MPCC: A Novel Benchmark for Multimodal Planning with Complex Constraints in Multimodal Large Language Models","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-06T10:53:20.653970Z"},"links":{"citing_paper":"/paper/2507.23382"},"observation_digest":"sha256:ace62b0c3294cb287faeee335e1a81a99e19dda551a6fb255ac91737aa662fdd","observation_id":"85312a74-d55f-422f-afab-0aded02c8247","resolution":{"observed_at":"2026-08-06T10:53:21.208589Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.16006","last_updated":"2024-04-24T17:37:05Z","snapshot_observed_at":"2026-07-06T18:05:03.284784Z","submitted_at":"2024-04-24T17:37:05Z","title":"MMT-Bench: A Comprehensive Multimodal Benchmark for Evaluating Large Vision-Language Models Towards Multitask AGI","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.16006","snapshot_observed_at":"2026-08-06T10:53:20.657760Z","title":"Mmt-bench: A comprehensive multimodal benchmark for evaluating large vision-language models towards multitask agi.arXiv preprint arXiv:2404.16006, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.23382","last_updated":"2025-07-31T09:59:17Z","snapshot_observed_at":"2026-08-07T11:02:57.710023Z","submitted_at":"2025-07-31T09:59:17Z","title":"MPCC: A Novel Benchmark for Multimodal Planning with Complex Constraints in Multimodal Large Language Models","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-06T10:53:20.657760Z"},"links":{"cited_paper":"/paper/2404.16006","citing_paper":"/paper/2507.23382"},"observation_digest":"sha256:fa62d28b582c164542b7d9bb0239ff1446fc793d772591587272259bc6f803a3","observation_id":"26a3a3dc-d9ba-4060-ba7c-8bd3e211a70c","resolution":{"observed_at":"2026-08-06T10:53:20.657760Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:53:21.189255Z","title":"Mmmu: A massive multi-discipline multimodal understanding and reasoning benchmark for expert agi","venue":null,"work_id":"1833f208-6eb7-492a-8ec4-59eb80f426c1","year":2024},"citing_paper":{"arxiv_id":"2507.23382","last_updated":"2025-07-31T09:59:17Z","snapshot_observed_at":"2026-08-07T11:02:57.710023Z","submitted_at":"2025-07-31T09:59:17Z","title":"MPCC: A Novel Benchmark for Multimodal Planning with Complex Constraints in Multimodal Large Language Models","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-06T10:53:20.661802Z"},"links":{"citing_paper":"/paper/2507.23382"},"observation_digest":"sha256:b8dd8d4993f7c5a5f545c85c23f6b63803c9601bd504dc6bed2d68613cf45dd3","observation_id":"bb719f0c-e043-4363-9b71-a54dc0b829d1","resolution":{"observed_at":"2026-08-06T10:53:21.194795Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:53:21.176048Z","title":"Open3dvqa: A benchmark for comprehensive spatial reasoning with multimodal large language model in open space, 2025","venue":null,"work_id":"fc9a8040-0bce-4840-bfd2-fb9663c37f40","year":2025},"citing_paper":{"arxiv_id":"2507.23382","last_updated":"2025-07-31T09:59:17Z","snapshot_observed_at":"2026-08-07T11:02:57.710023Z","submitted_at":"2025-07-31T09:59:17Z","title":"MPCC: A Novel Benchmark for Multimodal Planning with Complex Constraints in Multimodal Large Language Models","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-06T10:53:20.665367Z"},"links":{"citing_paper":"/paper/2507.23382"},"observation_digest":"sha256:e4ad5a8297b818c17fda7ca95b4c05bce7ca0c0ba9bb689370f145e611ac0225","observation_id":"df3b235e-10dd-4c5d-a6ab-30a1188db3d8","resolution":{"observed_at":"2026-08-06T10:53:21.180213Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T10:53:21.163203Z","title":"Le, Ed H","venue":null,"work_id":"b9ea999b-c671-48f9-b4d3-0215f0c6425c","year":2024},"citing_paper":{"arxiv_id":"2507.23382","last_updated":"2025-07-31T09:59:17Z","snapshot_observed_at":"2026-08-07T11:02:57.710023Z","submitted_at":"2025-07-31T09:59:17Z","title":"MPCC: A Novel Benchmark for Multimodal Planning with Complex Constraints in Multimodal Large Language Models","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-06T10:53:20.669515Z"},"links":{"citing_paper":"/paper/2507.23382"},"observation_digest":"sha256:f6d98ec195fcc245dfaff5668524d321c475aac77df817ed4bbb6cbf5bc41f48","observation_id":"54c936e4-ef99-4a58-a577-45b9aa36009a","resolution":{"observed_at":"2026-08-06T10:53:21.167018Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.13854","last_updated":"2024-04-16T15:13:18Z","snapshot_observed_at":"2026-08-06T12:47:01.809185Z","submitted_at":"2023-07-25T22:59:32Z","title":"WebArena: A Realistic Web Environment for Building Autonomous Agents","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.13854","snapshot_observed_at":"2026-08-06T10:53:20.673277Z","title":"Webarena: A realistic web environment for building autonomous agents.arXiv preprint arXiv:2307.13854, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.23382","last_updated":"2025-07-31T09:59:17Z","snapshot_observed_at":"2026-08-07T11:02:57.710023Z","submitted_at":"2025-07-31T09:59:17Z","title":"MPCC: A Novel Benchmark for Multimodal Planning with Complex Constraints in Multimodal Large Language Models","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-06T10:53:20.673277Z"},"links":{"cited_paper":"/paper/2307.13854","citing_paper":"/paper/2507.23382"},"observation_digest":"sha256:d445204e0f137473993321cf996511f1e3fa08508663eba35815715b3e8f679d","observation_id":"bb16c00f-dbbe-4255-910c-68e64810b32f","resolution":{"observed_at":"2026-08-06T10:53:20.673277Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2507.23382","last_updated":"2025-07-31T09:59:17Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-07T11:02:57.710023Z","submitted_at":"2025-07-31T09:59:17Z","title":"MPCC: A Novel Benchmark for Multimodal Planning with Complex Constraints in Multimodal Large Language Models"},"reference_resolution":{"displayed":45,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":20,"verified_exact":1,"verified_fuzzy":24},"total_outbound_references":45},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 45 of 45 outbound references and 0 inbound Pith citation observations for arXiv:2507.23382."}