{"as_of":"2026-08-06T07:12:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:1bf9e8c58348aa80272b54b3a6f9578c0f101d6e6a1563eacdb865df6173ee96","coverage":[{"denominator":20,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":20,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-04T09:00:36.314865Z","state":"measured"},{"denominator":28,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":28,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-06T06:34:29.942622+00:00","state":"measured"},{"denominator":8,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":8,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-03T16:27:33.138727Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-03T05:47:41.129979Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2510.17801","last_updated":"2026-07-05T08:09:46Z","snapshot_observed_at":"2026-08-04T09:00:31.615678Z","submitted_at":"2025-10-20T17:59:03Z","title":"Robobench: A Comprehensive Evaluation Benchmark for Multimodal Large Language Models as Embodied Brain","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2510.17801","snapshot_observed_at":"2026-08-03T16:27:33.138727Z","title":"Robobench: A com- prehensive evaluation benchmark for multimodal large language models as embodied brain.arXiv preprint arXiv:2510.17801, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2512.13660","last_updated":"2026-07-03T09:12:21Z","snapshot_observed_at":"2026-08-03T16:27:22.621857Z","submitted_at":"2025-12-15T18:52:43Z","title":"Towards Spatial Trace with Reasoning in Vision-Language Models for Robotics","version":4},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-03T16:27:33.138727Z"},"links":{"cited_paper":"/paper/2510.17801","citing_paper":"/paper/2512.13660"},"observation_digest":"sha256:da2830730f536e224b8ad57a4443bd9c299af20ee982e459c52eae379dcb5300","observation_id":"be51f4da-5231-4b67-ba5c-38f17e40056b","resolution":{"observed_at":"2026-08-03T16:27:33.138727Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2510.17801","last_updated":"2026-07-05T08:09:46Z","snapshot_observed_at":"2026-08-04T09:00:31.615678Z","submitted_at":"2025-10-20T17:59:03Z","title":"Robobench: A Comprehensive Evaluation Benchmark for Multimodal Large Language Models as Embodied Brain","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2510.17801","snapshot_observed_at":"2026-08-03T13:29:52.299425Z","title":"Robobench: A com- prehensive evaluation benchmark for multimodal large language models as embodied brain,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2512.24125","last_updated":"2026-07-26T09:02:49Z","snapshot_observed_at":"2026-08-04T11:27:48.952895Z","submitted_at":"2025-12-30T10:18:42Z","title":"Unified Embodied VLM Reasoning with Robotic Action via Autoregressive Discretized Pre-training","version":3},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-03T13:29:52.299425Z"},"links":{"cited_paper":"/paper/2510.17801","citing_paper":"/paper/2512.24125"},"observation_digest":"sha256:e781b2f726bc2e84ae1f14120ab5ae26744185fb3d3e142d0a8c47823393610d","observation_id":"3f4e115a-db87-41b1-a1fd-c8b5d6ec3795","resolution":{"observed_at":"2026-08-03T13:29:52.299425Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2510.17801","last_updated":"2026-07-05T08:09:46Z","snapshot_observed_at":"2026-08-04T09:00:31.615678Z","submitted_at":"2025-10-20T17:59:03Z","title":"Robobench: A Comprehensive Evaluation Benchmark for Multimodal Large Language Models as Embodied Brain","version":2},"cited_work":{"arxiv_id":"2510.17801","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2510.17801","snapshot_observed_at":"2026-07-07T03:18:10.074313Z","title":"Robobench: A com- prehensive evaluation benchmark for multimodal large language models as embodied brain","venue":null,"work_id":"69e91bbc-a8c0-4c65-b917-43f5f097f0a9","year":2025},"citing_paper":{"arxiv_id":"2604.07774","last_updated":"2026-04-09T04:01:27Z","snapshot_observed_at":"2026-07-06T22:57:00.904627Z","submitted_at":"2026-04-09T04:01:27Z","title":"RoboAgent: Chaining Basic Capabilities for Embodied Task Planning","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-05-10T18:15:08.727921Z"},"links":{"cited_paper":"/paper/2510.17801","citing_paper":"/paper/2604.07774"},"observation_digest":"sha256:457d80965255b0ae3e2a957be47ce934197112bbbde4f0b0225c4e6c026b6608","observation_id":"cc83dbe7-2448-4b0a-81c0-00059d24958e","resolution":{"observed_at":"2026-07-07T03:18:10.074313Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2510.17801","last_updated":"2026-07-05T08:09:46Z","snapshot_observed_at":"2026-08-04T09:00:31.615678Z","submitted_at":"2025-10-20T17:59:03Z","title":"Robobench: A Comprehensive Evaluation Benchmark for Multimodal Large Language Models as Embodied Brain","version":2},"cited_work":{"arxiv_id":"2510.17801","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2510.17801","snapshot_observed_at":"2026-07-07T03:18:10.074313Z","title":"Robobench: A com- prehensive evaluation benchmark for multimodal large language models as embodied brain","venue":null,"work_id":"69e91bbc-a8c0-4c65-b917-43f5f097f0a9","year":2025},"citing_paper":{"arxiv_id":"2605.31196","last_updated":"2026-05-29T12:04:38Z","snapshot_observed_at":"2026-08-06T02:48:40.278176Z","submitted_at":"2026-05-29T12:04:38Z","title":"Probing Collision Grounding in Vision-Language Models for Safe Human-Robot Collaboration","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-06-28T23:17:23.965554Z"},"links":{"cited_paper":"/paper/2510.17801","citing_paper":"/paper/2605.31196"},"observation_digest":"sha256:a833642901e0807cb6592663df11951e39d3aefc47bca171e57b940734ea0c3d","observation_id":"a8abd85b-21ab-4888-b00b-50d8bb0e32f2","resolution":{"observed_at":"2026-07-07T03:18:10.074313Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2510.17801","last_updated":"2026-07-05T08:09:46Z","snapshot_observed_at":"2026-08-04T09:00:31.615678Z","submitted_at":"2025-10-20T17:59:03Z","title":"Robobench: A Comprehensive Evaluation Benchmark for Multimodal Large Language Models as Embodied Brain","version":2},"cited_work":{"arxiv_id":"2510.17801","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2510.17801","snapshot_observed_at":"2026-07-07T03:18:10.074313Z","title":"Robobench: A com- prehensive evaluation benchmark for multimodal large language models as embodied brain","venue":null,"work_id":"69e91bbc-a8c0-4c65-b917-43f5f097f0a9","year":2025},"citing_paper":{"arxiv_id":"2606.03890","last_updated":"2026-06-02T16:51:32Z","snapshot_observed_at":"2026-07-06T23:44:05.167767Z","submitted_at":"2026-06-02T16:51:32Z","title":"OVO-S-Bench: A Hierarchical Benchmark for Streaming Spatial Intelligence in Multimodal LLMs","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-06-28T11:02:07.122615Z"},"links":{"cited_paper":"/paper/2510.17801","citing_paper":"/paper/2606.03890"},"observation_digest":"sha256:81bdc54d5f184b3c23bfbd06493d7eb971d91cd29cd4f418be36db5b532b7cee","observation_id":"6a493a0e-a8dd-481a-a268-491f09f63228","resolution":{"observed_at":"2026-07-07T03:18:10.074313Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2510.17801","last_updated":"2026-07-05T08:09:46Z","snapshot_observed_at":"2026-08-04T09:00:31.615678Z","submitted_at":"2025-10-20T17:59:03Z","title":"Robobench: A Comprehensive Evaluation Benchmark for Multimodal Large Language Models as Embodied Brain","version":2},"cited_work":{"arxiv_id":"2510.17801","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2510.17801","snapshot_observed_at":"2026-07-07T03:18:10.074313Z","title":"Robobench: A com- prehensive evaluation benchmark for multimodal large language models as embodied brain","venue":null,"work_id":"69e91bbc-a8c0-4c65-b917-43f5f097f0a9","year":2025},"citing_paper":{"arxiv_id":"2606.10366","last_updated":"2026-06-09T03:25:02Z","snapshot_observed_at":"2026-08-05T23:08:04.206475Z","submitted_at":"2026-06-09T03:25:02Z","title":"A Practical Recipe Towards Improving Sim-and-Real Correlation for VLA Evaluation","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-06-27T13:06:35.282837Z"},"links":{"cited_paper":"/paper/2510.17801","citing_paper":"/paper/2606.10366"},"observation_digest":"sha256:3e46bcf0feafb21fa0640125a3221bcc6bb7dc627fe856405bb3f8d7053f4922","observation_id":"89b38ef5-34e2-47ba-a8af-e4f612b55800","resolution":{"observed_at":"2026-07-07T03:18:10.074313Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2510.17801","last_updated":"2026-07-05T08:09:46Z","snapshot_observed_at":"2026-08-04T09:00:31.615678Z","submitted_at":"2025-10-20T17:59:03Z","title":"Robobench: A Comprehensive Evaluation Benchmark for Multimodal Large Language Models as Embodied Brain","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2510.17801","snapshot_observed_at":"2026-08-01T21:12:05.853271Z","title":"RoboBench: Acomprehensiveevaluationbenchmarkformultimodallargelanguagemodelsasembodied brain.arXiv preprint arXiv:2510.17801, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.16165","last_updated":"2026-07-17T17:46:23Z","snapshot_observed_at":"2026-08-05T12:06:47.948888Z","submitted_at":"2026-07-17T17:46:23Z","title":"An Exam for Active Observers","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-01T21:12:05.853271Z"},"links":{"cited_paper":"/paper/2510.17801","citing_paper":"/paper/2607.16165"},"observation_digest":"sha256:d97d4493cd94bdf78cb703952390505c11a81e77ebe44f708ede1118f8d39a7a","observation_id":"e5b6e00e-09eb-4701-ac5a-1b1d7c508c25","resolution":{"observed_at":"2026-08-01T21:12:05.853271Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2510.17801","last_updated":"2026-07-05T08:09:46Z","snapshot_observed_at":"2026-08-04T09:00:31.615678Z","submitted_at":"2025-10-20T17:59:03Z","title":"Robobench: A Comprehensive Evaluation Benchmark for Multimodal Large Language Models as Embodied Brain","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2510.17801","snapshot_observed_at":"2026-08-01T14:39:39.830975Z","title":"Luo, C.-K","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.18709","last_updated":"2026-07-22T05:33:17Z","snapshot_observed_at":"2026-08-04T15:25:40.989347Z","submitted_at":"2026-07-21T05:05:01Z","title":"RoboInter1.5: A Holistic Intermediate Representation Suite for Embodied World Modeling and Robotic Manipulation","version":2},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-08-01T14:39:39.830975Z"},"links":{"cited_paper":"/paper/2510.17801","citing_paper":"/paper/2607.18709"},"observation_digest":"sha256:9a69b256985fe44afc7df0878d97b89bb28b804e7fbdbf9a408e875cd2df177d","observation_id":"66e2f8f5-ce85-4015-be69-3d36cf187479","resolution":{"observed_at":"2026-08-01T14:39:39.830975Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2510.17801/citation-record","integrity":"/paper/2510.17801/integrity","json":"/paper/2510.17801/citation-record.json","paper":"/paper/2510.17801"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:00:36.225393Z","title":"Three prompts are used to cover different robot types: single-arm, dual-arm, and mobile-manipulator robots, shown in Figure 13, 14 and 15","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2510.17801","last_updated":"2026-07-05T08:09:46Z","snapshot_observed_at":"2026-08-04T09:00:31.615678Z","submitted_at":"2025-10-20T17:59:03Z","title":"Robobench: A Comprehensive Evaluation Benchmark for Multimodal Large Language Models as Embodied Brain","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-04T09:00:36.225393Z"},"links":{"citing_paper":"/paper/2510.17801"},"observation_digest":"sha256:ef0a8c73a026678f1d726f2366c9e96ef0a1d2d38fd2da645087503bc2e2f52b","observation_id":"d667513c-a550-433f-94da-44e012a285ef","resolution":{"observed_at":"2026-08-04T09:00:36.225393Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:00:36.230218Z","title":"Two function lists are used: Manipulation (Figure 16) and Navigation (Figure 17), followed by a conversion prompt (Figure 18) referencing these lists","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2510.17801","last_updated":"2026-07-05T08:09:46Z","snapshot_observed_at":"2026-08-04T09:00:31.615678Z","submitted_at":"2025-10-20T17:59:03Z","title":"Robobench: A Comprehensive Evaluation Benchmark for Multimodal Large Language Models as Embodied Brain","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-04T09:00:36.230218Z"},"links":{"citing_paper":"/paper/2510.17801"},"observation_digest":"sha256:5718dc8e619e74d761490946b8376efe9e8ccee1ff40586b99de5aa0e862461a","observation_id":"3dac44f3-67a7-4442-99ec-953a287a71c8","resolution":{"observed_at":"2026-08-04T09:00:36.230218Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:00:36.234198Z","title":"The prompt is presented in Figure 19","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2510.17801","last_updated":"2026-07-05T08:09:46Z","snapshot_observed_at":"2026-08-04T09:00:31.615678Z","submitted_at":"2025-10-20T17:59:03Z","title":"Robobench: A Comprehensive Evaluation Benchmark for Multimodal Large Language Models as Embodied Brain","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-04T09:00:36.234198Z"},"links":{"citing_paper":"/paper/2510.17801"},"observation_digest":"sha256:c58596089f6c7911a3f94215f757a53f9a54356b0151c36b69b79cdef109851b","observation_id":"a4351abd-0bef-4cd4-9c6b-62aa1e7cf17c","resolution":{"observed_at":"2026-08-04T09:00:36.234198Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:00:36.239111Z","title":"21 RoboBench Figure 9: Frequency of each action name in RoboBench planning tasks","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2510.17801","last_updated":"2026-07-05T08:09:46Z","snapshot_observed_at":"2026-08-04T09:00:31.615678Z","submitted_at":"2025-10-20T17:59:03Z","title":"Robobench: A Comprehensive Evaluation Benchmark for Multimodal Large Language Models as Embodied Brain","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-04T09:00:36.239111Z"},"links":{"citing_paper":"/paper/2510.17801"},"observation_digest":"sha256:bffa350b52c100b024a625b992be8d8aba1543f093a7e78bee34569f98e246c3","observation_id":"6b5c6ec6-2f8f-47e8-9532-d02ffb71f183","resolution":{"observed_at":"2026-08-04T09:00:36.239111Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:00:36.244189Z","title":"These structured annotations provide the foundation for evaluating compositional reasoning and downstream task performance","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2510.17801","last_updated":"2026-07-05T08:09:46Z","snapshot_observed_at":"2026-08-04T09:00:31.615678Z","submitted_at":"2025-10-20T17:59:03Z","title":"Robobench: A Comprehensive Evaluation Benchmark for Multimodal Large Language Models as Embodied Brain","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-04T09:00:36.244189Z"},"links":{"citing_paper":"/paper/2510.17801"},"observation_digest":"sha256:4573d117619c8e8f3ef240073243f29d045a876fbbd63c5d55e77efa1a9ab261","observation_id":"9a1a724d-46d9-43d2-b77a-916f35a69c2b","resolution":{"observed_at":"2026-08-04T09:00:36.244189Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:00:36.249445Z","title":"This task could be a clear goal or a series of related activities (e.g., assembling furniture, repairing equipment, preparing food, etc.)","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2510.17801","last_updated":"2026-07-05T08:09:46Z","snapshot_observed_at":"2026-08-04T09:00:31.615678Z","submitted_at":"2025-10-20T17:59:03Z","title":"Robobench: A Comprehensive Evaluation Benchmark for Multimodal Large Language Models as Embodied Brain","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-04T09:00:36.249445Z"},"links":{"citing_paper":"/paper/2510.17801"},"observation_digest":"sha256:1ffc2dfdc264d382924902fdebb4b619518c380d72e7b644ef99fc3e07d7239f","observation_id":"1dca2ab3-8131-4bde-9d70-5eb51a1a57f7","resolution":{"observed_at":"2026-08-04T09:00:36.249445Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:00:36.253874Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2510.17801","last_updated":"2026-07-05T08:09:46Z","snapshot_observed_at":"2026-08-04T09:00:31.615678Z","submitted_at":"2025-10-20T17:59:03Z","title":"Robobench: A Comprehensive Evaluation Benchmark for Multimodal Large Language Models as Embodied Brain","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-04T09:00:36.253874Z"},"links":{"citing_paper":"/paper/2510.17801"},"observation_digest":"sha256:a5685b7793635d51ec47597093c2365f24e6b54acaaa4e80f4d81b8f1d6993d5","observation_id":"1d7fd7d6-90ab-4160-b542-5ac31a49375a","resolution":{"observed_at":"2026-08-04T09:00:36.253874Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:00:36.258872Z","title":"task_summary","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2510.17801","last_updated":"2026-07-05T08:09:46Z","snapshot_observed_at":"2026-08-04T09:00:31.615678Z","submitted_at":"2025-10-20T17:59:03Z","title":"Robobench: A Comprehensive Evaluation Benchmark for Multimodal Large Language Models as Embodied Brain","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-04T09:00:36.258872Z"},"links":{"citing_paper":"/paper/2510.17801"},"observation_digest":"sha256:1087f7a0458b80914a8f43c0b3d9a5c361cd2407a06674030301468a6993ebcd","observation_id":"d5bd8d9b-1fef-49dd-ad50-5ea58423d80e","resolution":{"observed_at":"2026-08-04T09:00:36.258872Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:00:36.263613Z","title":"Your first task is to accurately identify which hand is the left arm ([left]) and which hand is the right arm ([right])","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2510.17801","last_updated":"2026-07-05T08:09:46Z","snapshot_observed_at":"2026-08-04T09:00:31.615678Z","submitted_at":"2025-10-20T17:59:03Z","title":"Robobench: A Comprehensive Evaluation Benchmark for Multimodal Large Language Models as Embodied Brain","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-04T09:00:36.263613Z"},"links":{"citing_paper":"/paper/2510.17801"},"observation_digest":"sha256:9e902f9896d50d33ae9ef78fcd7247ab71eefa50c7ff863682c0784cf1b91e50","observation_id":"9908cf5c-9e6e-4e55-ae4e-2997fd68188d","resolution":{"observed_at":"2026-08-04T09:00:36.263613Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:00:36.268231Z","title":"This task could be a clear goal or a series of related activities (e.g., assembling furniture, repairing equipment, preparing food, etc.)","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2510.17801","last_updated":"2026-07-05T08:09:46Z","snapshot_observed_at":"2026-08-04T09:00:31.615678Z","submitted_at":"2025-10-20T17:59:03Z","title":"Robobench: A Comprehensive Evaluation Benchmark for Multimodal Large Language Models as Embodied Brain","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-04T09:00:36.268231Z"},"links":{"citing_paper":"/paper/2510.17801"},"observation_digest":"sha256:46f2e9f2d4a2a603a225f2df02431573d68af22b37bce36c2aa1a9ca1cd13326","observation_id":"b93b7e5a-9f5b-481f-a0b4-eb8f9ddfe2de","resolution":{"observed_at":"2026-08-04T09:00:36.268231Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:00:36.273035Z","title":"task_summary","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2510.17801","last_updated":"2026-07-05T08:09:46Z","snapshot_observed_at":"2026-08-04T09:00:31.615678Z","submitted_at":"2025-10-20T17:59:03Z","title":"Robobench: A Comprehensive Evaluation Benchmark for Multimodal Large Language Models as Embodied Brain","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-04T09:00:36.273035Z"},"links":{"citing_paper":"/paper/2510.17801"},"observation_digest":"sha256:58c9a03d215ce7bdfa58867932077367fc8f99a748919ca1f749aea59054ee64","observation_id":"026a675b-a3e7-444b-ad19-2fef8d6f2f21","resolution":{"observed_at":"2026-08-04T09:00:36.273035Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:00:36.278201Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2510.17801","last_updated":"2026-07-05T08:09:46Z","snapshot_observed_at":"2026-08-04T09:00:31.615678Z","submitted_at":"2025-10-20T17:59:03Z","title":"Robobench: A Comprehensive Evaluation Benchmark for Multimodal Large Language Models as Embodied Brain","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-04T09:00:36.278201Z"},"links":{"citing_paper":"/paper/2510.17801"},"observation_digest":"sha256:63cf5ac6e4c40cab8f2954773fe64f4036f1592be95f1121a7d7b169ea66e8b1","observation_id":"0282a178-a095-4a31-97f0-a815ff0ac538","resolution":{"observed_at":"2026-08-04T09:00:36.278201Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:00:36.283081Z","title":"Primary Tag","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2510.17801","last_updated":"2026-07-05T08:09:46Z","snapshot_observed_at":"2026-08-04T09:00:31.615678Z","submitted_at":"2025-10-20T17:59:03Z","title":"Robobench: A Comprehensive Evaluation Benchmark for Multimodal Large Language Models as Embodied Brain","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-04T09:00:36.283081Z"},"links":{"citing_paper":"/paper/2510.17801"},"observation_digest":"sha256:4beee5c498ace196b3a897f7510ac4611909c3661c562a120e37c5ce1d809435","observation_id":"ef552541-521b-4611-a444-b2af21913cab","resolution":{"observed_at":"2026-08-04T09:00:36.283081Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:00:36.287053Z","title":"task summary","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2510.17801","last_updated":"2026-07-05T08:09:46Z","snapshot_observed_at":"2026-08-04T09:00:31.615678Z","submitted_at":"2025-10-20T17:59:03Z","title":"Robobench: A Comprehensive Evaluation Benchmark for Multimodal Large Language Models as Embodied Brain","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-04T09:00:36.287053Z"},"links":{"citing_paper":"/paper/2510.17801"},"observation_digest":"sha256:a987f1de009374c8b3be1b1668b6c50f7a10d98bb29d62a18eead268f3b6fd85","observation_id":"53e7a689-4731-452d-b6b3-9f001b84ae72","resolution":{"observed_at":"2026-08-04T09:00:36.287053Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:00:36.292274Z","title":"plan step","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2510.17801","last_updated":"2026-07-05T08:09:46Z","snapshot_observed_at":"2026-08-04T09:00:31.615678Z","submitted_at":"2025-10-20T17:59:03Z","title":"Robobench: A Comprehensive Evaluation Benchmark for Multimodal Large Language Models as Embodied Brain","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-04T09:00:36.292274Z"},"links":{"citing_paper":"/paper/2510.17801"},"observation_digest":"sha256:f984c2376cd9e3d8da665d37545fdd43c180238bdb5837f0a631caf6cd523d6d","observation_id":"48902fc9-4523-415e-b4cf-0771f98c0040","resolution":{"observed_at":"2026-08-04T09:00:36.292274Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:00:36.297718Z","title":"reason\" field explaining how the","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2510.17801","last_updated":"2026-07-05T08:09:46Z","snapshot_observed_at":"2026-08-04T09:00:31.615678Z","submitted_at":"2025-10-20T17:59:03Z","title":"Robobench: A Comprehensive Evaluation Benchmark for Multimodal Large Language Models as Embodied Brain","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-04T09:00:36.297718Z"},"links":{"citing_paper":"/paper/2510.17801"},"observation_digest":"sha256:48749d94660140e581354e8ad2b6f4760e9f58334af6e4fcc02f90742aa537c9","observation_id":"22f04677-d00b-41e2-b6a9-f631545e506c","resolution":{"observed_at":"2026-08-04T09:00:36.297718Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:00:36.302289Z","title":"Flexible matching in Standard Mode; strict in CSS Mode","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2510.17801","last_updated":"2026-07-05T08:09:46Z","snapshot_observed_at":"2026-08-04T09:00:31.615678Z","submitted_at":"2025-10-20T17:59:03Z","title":"Robobench: A Comprehensive Evaluation Benchmark for Multimodal Large Language Models as Embodied Brain","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-04T09:00:36.302289Z"},"links":{"citing_paper":"/paper/2510.17801"},"observation_digest":"sha256:e2fe4c0cd77ba7deef1eab135c961c2625b16a27920c1c916f3afc0f475047ee","observation_id":"e2a64143-9eab-458c-a25c-9fa6d7adec80","resolution":{"observed_at":"2026-08-04T09:00:36.302289Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:00:36.306227Z","title":"node_correctness","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2510.17801","last_updated":"2026-07-05T08:09:46Z","snapshot_observed_at":"2026-08-04T09:00:31.615678Z","submitted_at":"2025-10-20T17:59:03Z","title":"Robobench: A Comprehensive Evaluation Benchmark for Multimodal Large Language Models as Embodied Brain","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-04T09:00:36.306227Z"},"links":{"citing_paper":"/paper/2510.17801"},"observation_digest":"sha256:560093010a30f99f2560727d3d4e47734677d24d7c5777e6d8349a6f65179957","observation_id":"89b42c28-34a1-4c92-a5d6-79f6a9984861","resolution":{"observed_at":"2026-08-04T09:00:36.306227Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:00:36.311102Z","title":"Award 1 iff the skills are exactly identical (strict match after normalization); otherwise award0","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2510.17801","last_updated":"2026-07-05T08:09:46Z","snapshot_observed_at":"2026-08-04T09:00:31.615678Z","submitted_at":"2025-10-20T17:59:03Z","title":"Robobench: A Comprehensive Evaluation Benchmark for Multimodal Large Language Models as Embodied Brain","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-04T09:00:36.311102Z"},"links":{"citing_paper":"/paper/2510.17801"},"observation_digest":"sha256:0b82a328c5ee618a03ea59aadba6e4021620f378a304814fa85609053e965132","observation_id":"47f5e79d-fadc-4038-8540-d4da43d07bb6","resolution":{"observed_at":"2026-08-04T09:00:36.311102Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T09:00:36.314865Z","title":"skill_usage_accuracy","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2510.17801","last_updated":"2026-07-05T08:09:46Z","snapshot_observed_at":"2026-08-04T09:00:31.615678Z","submitted_at":"2025-10-20T17:59:03Z","title":"Robobench: A Comprehensive Evaluation Benchmark for Multimodal Large Language Models as Embodied Brain","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-04T09:00:36.314865Z"},"links":{"citing_paper":"/paper/2510.17801"},"observation_digest":"sha256:e62239fa0fecd3303dd4ad4f01b41d8c83818a96b3da68987e80bbe5033439d6","observation_id":"31025de2-aefd-4c0f-97d6-1e70bf37a351","resolution":{"observed_at":"2026-08-04T09:00:36.314865Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2510.17801","last_updated":"2026-07-05T08:09:46Z","latest_version":2,"primary_category":"cs.RO","snapshot_observed_at":"2026-08-04T09:00:31.615678Z","submitted_at":"2025-10-20T17:59:03Z","title":"Robobench: A Comprehensive Evaluation Benchmark for Multimodal Large Language Models as Embodied Brain"},"reference_resolution":{"displayed":20,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":20,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":20},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"thesis":"As of 6 August 2026, this Paper Citation Record lists 20 of 20 outbound references and 8 inbound Pith citation observations for arXiv:2510.17801."}