{"as_of":"2026-08-05T10:58:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:53fdd3e87ee43d5ef11f4a6ffb6640b68964b9a995b3b799559be5e06c743c7b","coverage":[{"denominator":34,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":34,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-10T10:53:48.374637Z","state":"measured"},{"denominator":34,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":34,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-05T06:32:48.257954+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2604.14785/citation-record","integrity":"/paper/2604.14785/integrity","json":"/paper/2604.14785/citation-record.json","paper":"/paper/2604.14785"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-06T00:51:40.002813Z","title":"Visual instruction tuning","venue":null,"work_id":"3f6f1967-f1cd-4a08-a0a3-0551f9712545","year":2023},"citing_paper":{"arxiv_id":"2604.14785","last_updated":"2026-04-22T14:57:48Z","snapshot_observed_at":"2026-07-06T23:02:27.141640Z","submitted_at":"2026-04-16T08:45:34Z","title":"MirrorBench: Evaluating Self-centric Intelligence in MLLMs by Introducing a Mirror","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-10T10:53:48.374637Z"},"links":{"citing_paper":"/paper/2604.14785"},"observation_digest":"sha256:8fb4410b801c488f0bd1e7937321a483a1872bc33cc8edd119efc1edf1f5f0da","observation_id":"57ddbc5c-d3b1-4f89-a98b-6e99a32b5679","resolution":{"observed_at":"2026-05-19T17:43:10.227858Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.11805","last_updated":"2025-05-09T21:04:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-12-19T02:39:27Z","title":"Gemini: A Family of Highly Capable Multimodal Models","version":5},"cited_work":{"arxiv_id":"2312.11805","doi":"10.1038/nrn2888","metadata_source":"pith","pith_arxiv_id":"2312.11805","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Gemini: A Family of Highly Capable Multimodal Models","venue":"cs.CL","work_id":"83f7c85b-3f11-450f-ac0c-64d9745220b2","year":2023},"citing_paper":{"arxiv_id":"2604.14785","last_updated":"2026-04-22T14:57:48Z","snapshot_observed_at":"2026-07-06T23:02:27.141640Z","submitted_at":"2026-04-16T08:45:34Z","title":"MirrorBench: Evaluating Self-centric Intelligence in MLLMs by Introducing a Mirror","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-10T10:53:48.374637Z"},"links":{"cited_paper":"/paper/2312.11805","citing_paper":"/paper/2604.14785"},"observation_digest":"sha256:dd66ebf05545048c72fa49d1359963a6c26510610d1b228c479045bc75d1de36","observation_id":"03906dbd-5c88-40eb-af1b-0939f6dce188","resolution":{"observed_at":"2026-05-10T10:55:03.975608Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":"2303.08774","doi":"10.1002/tea.20265","metadata_source":"pith","pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"GPT-4 Technical Report","venue":"cs.CL","work_id":"b928e041-6991-4c08-8c81-0359e4097c7b","year":2023},"citing_paper":{"arxiv_id":"2604.14785","last_updated":"2026-04-22T14:57:48Z","snapshot_observed_at":"2026-07-06T23:02:27.141640Z","submitted_at":"2026-04-16T08:45:34Z","title":"MirrorBench: Evaluating Self-centric Intelligence in MLLMs by Introducing a Mirror","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-10T10:53:48.374637Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2604.14785"},"observation_digest":"sha256:b575881ecf2ff165d6e244194becb28ef27618f4eab3c4c6c45697202b84097b","observation_id":"d247893e-83cb-45e9-b57d-83575cfbb727","resolution":{"observed_at":"2026-05-10T10:55:03.973223Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Alfred: A benchmark for interpret- ing grounded instructions for everyday tasks","venue":null,"work_id":"6862daf3-e3a5-42d3-83ec-31a2629fae39","year":2020},"citing_paper":{"arxiv_id":"2604.14785","last_updated":"2026-04-22T14:57:48Z","snapshot_observed_at":"2026-07-06T23:02:27.141640Z","submitted_at":"2026-04-16T08:45:34Z","title":"MirrorBench: Evaluating Self-centric Intelligence in MLLMs by Introducing a Mirror","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-10T10:53:48.374637Z"},"links":{"citing_paper":"/paper/2604.14785"},"observation_digest":"sha256:aa1558eefaf7ba357ba1b46b47db140db7c7a304c1b839ffdc0ca1999771c7f6","observation_id":"df17cee4-da76-4b57-b13f-9fcba6fadf10","resolution":{"observed_at":"2026-05-19T17:43:10.234785Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.09227","last_updated":"2024-03-14T09:48:36Z","snapshot_observed_at":"2026-08-01T18:11:37.998349Z","submitted_at":"2024-03-14T09:48:36Z","title":"BEHAVIOR-1K: A Human-Centered, Embodied AI Benchmark with 1,000 Everyday Activities and Realistic Simulation","version":1},"cited_work":{"arxiv_id":"2403.09227","doi":null,"metadata_source":"pith","pith_arxiv_id":"2403.09227","snapshot_observed_at":"2026-07-10T23:17:45.369340Z","title":"BEHAVIOR-1K: A Human-Centered, Embodied AI Benchmark with 1,000 Everyday Activities and Realistic Simulation","venue":"cs.RO","work_id":"6b62f6a4-fd69-4dd7-b480-b27f0bf09632","year":2024},"citing_paper":{"arxiv_id":"2604.14785","last_updated":"2026-04-22T14:57:48Z","snapshot_observed_at":"2026-07-06T23:02:27.141640Z","submitted_at":"2026-04-16T08:45:34Z","title":"MirrorBench: Evaluating Self-centric Intelligence in MLLMs by Introducing a Mirror","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-10T10:53:48.374637Z"},"links":{"cited_paper":"/paper/2403.09227","citing_paper":"/paper/2604.14785"},"observation_digest":"sha256:56c9e8a17278b333636dbebf7a86a881aa8388c01c38dcdc0760d82abe35ba30","observation_id":"cd0a1f15-ee4a-4c7d-9f47-6f513f4f7d76","resolution":{"observed_at":"2026-05-16T23:38:01.037356Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.11858","last_updated":"2025-04-11T04:26:42Z","snapshot_observed_at":"2026-07-06T20:23:40.374376Z","submitted_at":"2025-01-21T03:22:10Z","title":"EmbodiedEval: Evaluate Multimodal LLMs as Embodied Agents","version":2},"cited_work":{"arxiv_id":"2501.11858","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.11858","snapshot_observed_at":"2026-07-03T11:58:05.933512Z","title":"Embodiedeval: Evaluate multimodal llms as embodied agents","venue":null,"work_id":"cb8040b1-89b3-4605-969a-34d69216c684","year":2025},"citing_paper":{"arxiv_id":"2604.14785","last_updated":"2026-04-22T14:57:48Z","snapshot_observed_at":"2026-07-06T23:02:27.141640Z","submitted_at":"2026-04-16T08:45:34Z","title":"MirrorBench: Evaluating Self-centric Intelligence in MLLMs by Introducing a Mirror","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-10T10:53:48.374637Z"},"links":{"cited_paper":"/paper/2501.11858","citing_paper":"/paper/2604.14785"},"observation_digest":"sha256:54443724588f32fd1aab70a99fc6bee58f934b26763c437dd192b1899156e063","observation_id":"b2d0b7e8-0728-4d47-ab7e-ed7da9cde4fd","resolution":{"observed_at":"2026-05-10T10:55:03.980749Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.01031","last_updated":"2025-06-01T14:21:02Z","snapshot_observed_at":"2026-07-06T21:34:34.091508Z","submitted_at":"2025-06-01T14:21:02Z","title":"NavBench: Probing Multimodal Large Language Models for Embodied Navigation","version":1},"cited_work":{"arxiv_id":"2506.01031","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.01031","snapshot_observed_at":"2026-07-02T02:16:27.244688Z","title":"Navbench: Probing multimodal large language models for embodied navigation","venue":null,"work_id":"07e95eaf-1654-48cd-afae-50e9d01b313f","year":2025},"citing_paper":{"arxiv_id":"2604.14785","last_updated":"2026-04-22T14:57:48Z","snapshot_observed_at":"2026-07-06T23:02:27.141640Z","submitted_at":"2026-04-16T08:45:34Z","title":"MirrorBench: Evaluating Self-centric Intelligence in MLLMs by Introducing a Mirror","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-10T10:53:48.374637Z"},"links":{"cited_paper":"/paper/2506.01031","citing_paper":"/paper/2604.14785"},"observation_digest":"sha256:6aa3859253358f09ffce7c1959a7972f7a7f435469934fc0d33552ca60ed4676","observation_id":"63e27b80-1468-4662-91e6-5979965a309b","resolution":{"observed_at":"2026-05-10T10:55:03.971070Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Vlabench: A large-scale benchmark for language- conditioned robotics manipulation with long-horizon reasoning tasks","venue":null,"work_id":"63802825-bc17-4b62-b325-3cb79a9c0989","year":2025},"citing_paper":{"arxiv_id":"2604.14785","last_updated":"2026-04-22T14:57:48Z","snapshot_observed_at":"2026-07-06T23:02:27.141640Z","submitted_at":"2026-04-16T08:45:34Z","title":"MirrorBench: Evaluating Self-centric Intelligence in MLLMs by Introducing a Mirror","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-10T10:53:48.374637Z"},"links":{"citing_paper":"/paper/2604.14785"},"observation_digest":"sha256:6ac5b023e111728974b3768fc0c6d06622cb437f0b0c1411f41f0996a2b8b537","observation_id":"4d257cb3-da57-4b6c-9655-fc5f0270a7bd","resolution":{"observed_at":"2026-05-19T17:43:10.244840Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"A theory of objective self awareness","venue":null,"work_id":"101038b2-297d-4a1c-b4f7-1873ecb11ebe","year":1972},"citing_paper":{"arxiv_id":"2604.14785","last_updated":"2026-04-22T14:57:48Z","snapshot_observed_at":"2026-07-06T23:02:27.141640Z","submitted_at":"2026-04-16T08:45:34Z","title":"MirrorBench: Evaluating Self-centric Intelligence in MLLMs by Introducing a Mirror","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-10T10:53:48.374637Z"},"links":{"citing_paper":"/paper/2604.14785"},"observation_digest":"sha256:633d4e865f27290c931107d516ce418c32944e6a7e756eef8340624e32ce723b","observation_id":"7e334a72-3acb-4fef-9963-176d66a47274","resolution":{"observed_at":"2026-05-19T17:43:10.215021Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Chimpanzees: self-recognition","venue":null,"work_id":"fea40e0b-faf7-4fdb-bcc4-6b43b294d2fa","year":1970},"citing_paper":{"arxiv_id":"2604.14785","last_updated":"2026-04-22T14:57:48Z","snapshot_observed_at":"2026-07-06T23:02:27.141640Z","submitted_at":"2026-04-16T08:45:34Z","title":"MirrorBench: Evaluating Self-centric Intelligence in MLLMs by Introducing a Mirror","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-10T10:53:48.374637Z"},"links":{"citing_paper":"/paper/2604.14785"},"observation_digest":"sha256:05a22847e98be786bf425367875bb2c60c5906f1dcd0ff201c1366c93cddfb66","observation_id":"a1558671-11df-419a-81c2-c36ae903b250","resolution":{"observed_at":"2026-05-19T17:43:10.212860Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Mirror self-image reactions before age two","venue":null,"work_id":"13794952-6a3e-434d-bb5d-eed8df9a7378","year":1972},"citing_paper":{"arxiv_id":"2604.14785","last_updated":"2026-04-22T14:57:48Z","snapshot_observed_at":"2026-07-06T23:02:27.141640Z","submitted_at":"2026-04-16T08:45:34Z","title":"MirrorBench: Evaluating Self-centric Intelligence in MLLMs by Introducing a Mirror","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-10T10:53:48.374637Z"},"links":{"citing_paper":"/paper/2604.14785"},"observation_digest":"sha256:3c0c441f2ed54d52009e659efb39c88ac19c9acf45ba60c5892acf80eea96df9","observation_id":"a93e2b4a-b3e2-4d41-bd6c-0544b816e503","resolution":{"observed_at":"2026-05-19T17:43:10.238946Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Aibench: Towards trustworthy evaluation under the 45° law","venue":null,"work_id":"b476de92-a5c8-47fd-a967-8205605a4621","year":2025},"citing_paper":{"arxiv_id":"2604.14785","last_updated":"2026-04-22T14:57:48Z","snapshot_observed_at":"2026-07-06T23:02:27.141640Z","submitted_at":"2026-04-16T08:45:34Z","title":"MirrorBench: Evaluating Self-centric Intelligence in MLLMs by Introducing a Mirror","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-10T10:53:48.374637Z"},"links":{"citing_paper":"/paper/2604.14785"},"observation_digest":"sha256:d26ce756b9b409492b4e98d6551560130e16a6e2bccc829f9b734e5761ead3a3","observation_id":"fa7a7d37-e55d-4754-a14a-08a846b6795a","resolution":{"observed_at":"2026-05-19T17:43:10.226727Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Large multimodal models evaluation: A survey","venue":null,"work_id":"09135a04-8e5e-4de8-a63a-e8939b688a83","year":2025},"citing_paper":{"arxiv_id":"2604.14785","last_updated":"2026-04-22T14:57:48Z","snapshot_observed_at":"2026-07-06T23:02:27.141640Z","submitted_at":"2026-04-16T08:45:34Z","title":"MirrorBench: Evaluating Self-centric Intelligence in MLLMs by Introducing a Mirror","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-10T10:53:48.374637Z"},"links":{"citing_paper":"/paper/2604.14785"},"observation_digest":"sha256:ecfcf5e93f463107346bdf0276f999007ee5268b80c98a29ec6f7e9bd46b06ac","observation_id":"475c35f5-c7cb-40f9-af99-506ca6e828e0","resolution":{"observed_at":"2026-05-19T17:43:10.250069Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Ok-vqa: A visual question answering benchmark requiring external knowledge","venue":null,"work_id":"6217912e-32cd-4c8f-8177-c33143d76841","year":2019},"citing_paper":{"arxiv_id":"2604.14785","last_updated":"2026-04-22T14:57:48Z","snapshot_observed_at":"2026-07-06T23:02:27.141640Z","submitted_at":"2026-04-16T08:45:34Z","title":"MirrorBench: Evaluating Self-centric Intelligence in MLLMs by Introducing a Mirror","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-10T10:53:48.374637Z"},"links":{"citing_paper":"/paper/2604.14785"},"observation_digest":"sha256:6d01fa17d10ee2781f8ec90b72b28ec1d58de49bfb5af831b5a9c3e51c3678a1","observation_id":"735c7a9f-38d0-406f-8f86-a90777c07d1c","resolution":{"observed_at":"2026-05-19T17:43:10.240818Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.02490","last_updated":"2024-12-01T05:46:03Z","snapshot_observed_at":"2026-07-06T16:02:39.154387Z","submitted_at":"2023-08-04T17:59:47Z","title":"MM-Vet: Evaluating Large Multimodal Models for Integrated Capabilities","version":4},"cited_work":{"arxiv_id":"2308.02490","doi":null,"metadata_source":"pith","pith_arxiv_id":"2308.02490","snapshot_observed_at":"2026-07-10T09:37:00.827227Z","title":"MM-Vet: Evaluating Large Multimodal Models for Integrated Capabilities","venue":"cs.AI","work_id":"7f3bac41-a0a5-4a7a-bfd2-526b616db745","year":2023},"citing_paper":{"arxiv_id":"2604.14785","last_updated":"2026-04-22T14:57:48Z","snapshot_observed_at":"2026-07-06T23:02:27.141640Z","submitted_at":"2026-04-16T08:45:34Z","title":"MirrorBench: Evaluating Self-centric Intelligence in MLLMs by Introducing a Mirror","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-10T10:53:48.374637Z"},"links":{"cited_paper":"/paper/2308.02490","citing_paper":"/paper/2604.14785"},"observation_digest":"sha256:3cd59456cfb9cc74e275e356c0fe33e84d83ed5ff06e1bcb50873074716a1e38","observation_id":"16a38dec-814b-43f2-8955-3165216bb578","resolution":{"observed_at":"2026-05-11T11:54:12.369348Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Mmmu: A massive multi-discipline multimodal understanding and reasoning benchmark for expert agi","venue":null,"work_id":"b9d401ab-6f00-4391-9e14-02e19de8102d","year":2024},"citing_paper":{"arxiv_id":"2604.14785","last_updated":"2026-04-22T14:57:48Z","snapshot_observed_at":"2026-07-06T23:02:27.141640Z","submitted_at":"2026-04-16T08:45:34Z","title":"MirrorBench: Evaluating Self-centric Intelligence in MLLMs by Introducing a Mirror","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-10T10:53:48.374637Z"},"links":{"citing_paper":"/paper/2604.14785"},"observation_digest":"sha256:f828f87996ae4b4fa66be1c42c7e99122a3470e5a9f7e2879d522e59299b6406","observation_id":"73127581-c966-432e-9668-21c8cd4e63cc","resolution":{"observed_at":"2026-05-19T17:43:10.234982Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Nocaps: Novel object captioning at scale","venue":null,"work_id":"eeb4c63b-0210-41db-acdc-1ada02d82843","year":2019},"citing_paper":{"arxiv_id":"2604.14785","last_updated":"2026-04-22T14:57:48Z","snapshot_observed_at":"2026-07-06T23:02:27.141640Z","submitted_at":"2026-04-16T08:45:34Z","title":"MirrorBench: Evaluating Self-centric Intelligence in MLLMs by Introducing a Mirror","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-10T10:53:48.374637Z"},"links":{"citing_paper":"/paper/2604.14785"},"observation_digest":"sha256:9c6ff9f01b4a5cb7fbcf3baea63b509d57b25b1ef09276e6cb9ecc08e2fa42f1","observation_id":"938b1701-3208-45de-9500-93ea79bbe8e0","resolution":{"observed_at":"2026-05-19T17:43:10.238423Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Mme: A comprehensive evaluation benchmark for multimodal large language models","venue":null,"work_id":"ececec6c-d4aa-4d3e-af41-1180ca945e77","year":2025},"citing_paper":{"arxiv_id":"2604.14785","last_updated":"2026-04-22T14:57:48Z","snapshot_observed_at":"2026-07-06T23:02:27.141640Z","submitted_at":"2026-04-16T08:45:34Z","title":"MirrorBench: Evaluating Self-centric Intelligence in MLLMs by Introducing a Mirror","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-10T10:53:48.374637Z"},"links":{"citing_paper":"/paper/2604.14785"},"observation_digest":"sha256:d3a2736810ab260b6b055e7aeb66b64c8c78737460110a536488c88d82b7b16c","observation_id":"c7fe658a-af48-4813-823f-e6329bce2f20","resolution":{"observed_at":"2026-05-19T17:43:10.246707Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Gqa: A new dataset for real-world visual reasoning and compositional question answering","venue":null,"work_id":"b7d5e21a-0889-486f-8fd8-f28f94c4770d","year":2019},"citing_paper":{"arxiv_id":"2604.14785","last_updated":"2026-04-22T14:57:48Z","snapshot_observed_at":"2026-07-06T23:02:27.141640Z","submitted_at":"2026-04-16T08:45:34Z","title":"MirrorBench: Evaluating Self-centric Intelligence in MLLMs by Introducing a Mirror","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-10T10:53:48.374637Z"},"links":{"citing_paper":"/paper/2604.14785"},"observation_digest":"sha256:36f6eeeff922a7809f3b383c90a357a67da597016132b8fc7646ee801a959181","observation_id":"869ca250-2895-462f-b6da-2d1209891df5","resolution":{"observed_at":"2026-05-19T17:43:10.224494Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.16770","last_updated":"2025-05-23T15:40:22Z","snapshot_observed_at":"2026-07-06T21:28:33.821060Z","submitted_at":"2025-05-22T15:11:57Z","title":"RBench-V: A Primary Assessment for Visual Reasoning Models with Multi-modal Outputs","version":2},"cited_work":{"arxiv_id":"2505.16770","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.16770","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Rbench-v: A primary assess- ment for visual reasoning models with multi-modal outputs","venue":null,"work_id":"0748c18f-3ac0-426c-9a52-1a0542a2d72b","year":2025},"citing_paper":{"arxiv_id":"2604.14785","last_updated":"2026-04-22T14:57:48Z","snapshot_observed_at":"2026-07-06T23:02:27.141640Z","submitted_at":"2026-04-16T08:45:34Z","title":"MirrorBench: Evaluating Self-centric Intelligence in MLLMs by Introducing a Mirror","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-10T10:53:48.374637Z"},"links":{"cited_paper":"/paper/2505.16770","citing_paper":"/paper/2604.14785"},"observation_digest":"sha256:07292e92dab6a65dd7419535bda62523d4db3ed89922f49040271758b11421df","observation_id":"de42cd0b-6bff-4d75-83f7-85a11b32bf67","resolution":{"observed_at":"2026-05-10T10:55:03.963248Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Embodied question answering","venue":null,"work_id":"10a6233c-b581-43e5-8358-6b122d3e87fb","year":2018},"citing_paper":{"arxiv_id":"2604.14785","last_updated":"2026-04-22T14:57:48Z","snapshot_observed_at":"2026-07-06T23:02:27.141640Z","submitted_at":"2026-04-16T08:45:34Z","title":"MirrorBench: Evaluating Self-centric Intelligence in MLLMs by Introducing a Mirror","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-10T10:53:48.374637Z"},"links":{"citing_paper":"/paper/2604.14785"},"observation_digest":"sha256:90ca4dc52feb046dbd635ba9a85138f61002ecb6ec6902ddfb026d14742a7323","observation_id":"37bfb6e8-c08b-4815-a2b5-0553a5d9e9cf","resolution":{"observed_at":"2026-05-19T17:43:10.244841Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.09560","last_updated":"2025-06-05T07:22:50Z","snapshot_observed_at":"2026-07-06T20:36:12.548343Z","submitted_at":"2025-02-13T18:11:34Z","title":"EmbodiedBench: Comprehensive Benchmarking Multi-modal Large Language Models for Vision-Driven Embodied Agents","version":3},"cited_work":{"arxiv_id":"2502.09560","doi":"10.48550/arxiv.2502.09560","metadata_source":"pith","pith_arxiv_id":"2502.09560","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"EmbodiedBench: Comprehensive Benchmarking Multi-modal Large Language Models for Vision-Driven Embodied Agents","venue":"cs.AI","work_id":"b1e694c6-fe5b-477f-ab8f-801e0fb0412f","year":2025},"citing_paper":{"arxiv_id":"2604.14785","last_updated":"2026-04-22T14:57:48Z","snapshot_observed_at":"2026-07-06T23:02:27.141640Z","submitted_at":"2026-04-16T08:45:34Z","title":"MirrorBench: Evaluating Self-centric Intelligence in MLLMs by Introducing a Mirror","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-10T10:53:48.374637Z"},"links":{"cited_paper":"/paper/2502.09560","citing_paper":"/paper/2604.14785"},"observation_digest":"sha256:c413d4ee24822bf0d9bd4ce02d456da80abda3aba622e6c3124c5c764af47051","observation_id":"e4e02e69-4502-4cd0-a939-dcc4063492cc","resolution":{"observed_at":"2026-05-17T00:24:45.426358Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Towards a logic-based analysis and simulation of the mirror test","venue":null,"work_id":"2b8cea88-f000-4ff8-885d-85fb541f09ef","year":2011},"citing_paper":{"arxiv_id":"2604.14785","last_updated":"2026-04-22T14:57:48Z","snapshot_observed_at":"2026-07-06T23:02:27.141640Z","submitted_at":"2026-04-16T08:45:34Z","title":"MirrorBench: Evaluating Self-centric Intelligence in MLLMs by Introducing a Mirror","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-10T10:53:48.374637Z"},"links":{"citing_paper":"/paper/2604.14785"},"observation_digest":"sha256:148f83d6539f52c247d07a497caa7a05b42154791029b16ebf2d0b06d07de593","observation_id":"eb9c00ff-0122-4780-8a62-7d5fb4afceea","resolution":{"observed_at":"2026-05-19T17:43:10.242541Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Robot passes the mirror test by inner speech","venue":null,"work_id":"5d489fd4-ca61-48de-aa52-765f7b39d2e3","year":2021},"citing_paper":{"arxiv_id":"2604.14785","last_updated":"2026-04-22T14:57:48Z","snapshot_observed_at":"2026-07-06T23:02:27.141640Z","submitted_at":"2026-04-16T08:45:34Z","title":"MirrorBench: Evaluating Self-centric Intelligence in MLLMs by Introducing a Mirror","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-10T10:53:48.374637Z"},"links":{"citing_paper":"/paper/2604.14785"},"observation_digest":"sha256:9e3958201fdf4f9b0b3ef2481fc538cdf9ed709febe8d889abd459990e06a5f5","observation_id":"3165ee4c-e18a-4784-b294-1819a6794e42","resolution":{"observed_at":"2026-05-19T17:43:10.236509Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"The robot in the mirror","venue":null,"work_id":"2b5afb63-1f06-4020-bf02-c43ce2684495","year":2008},"citing_paper":{"arxiv_id":"2604.14785","last_updated":"2026-04-22T14:57:48Z","snapshot_observed_at":"2026-07-06T23:02:27.141640Z","submitted_at":"2026-04-16T08:45:34Z","title":"MirrorBench: Evaluating Self-centric Intelligence in MLLMs by Introducing a Mirror","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-10T10:53:48.374637Z"},"links":{"citing_paper":"/paper/2604.14785"},"observation_digest":"sha256:53806ff3fbd4f5583a460646d319b9d5e8cd3a478c61c1835b8365f6eb759f84","observation_id":"4d053e4c-c3e5-4803-a7a7-e7ab6e007d43","resolution":{"observed_at":"2026-05-19T17:43:10.222078Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Robot in the mirror: Toward an embodied computational model of mirror self- recognition","venue":null,"work_id":"c35ae48c-b35a-4810-a256-20fc07cd0f1c","year":2021},"citing_paper":{"arxiv_id":"2604.14785","last_updated":"2026-04-22T14:57:48Z","snapshot_observed_at":"2026-07-06T23:02:27.141640Z","submitted_at":"2026-04-16T08:45:34Z","title":"MirrorBench: Evaluating Self-centric Intelligence in MLLMs by Introducing a Mirror","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-10T10:53:48.374637Z"},"links":{"citing_paper":"/paper/2604.14785"},"observation_digest":"sha256:7288484a1d0508dfac81b2ca2060da3b95af7dc9e01564761168d982494e2187","observation_id":"4f37163d-fa3a-4632-b503-150a89f721db","resolution":{"observed_at":"2026-05-19T17:43:10.242718Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.06261","last_updated":"2025-12-19T14:25:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-07-07T17:36:04Z","title":"Gemini 2.5: Pushing the Frontier with Advanced Reasoning, Multimodality, Long Context, and Next Generation Agentic Capabilities","version":6},"cited_work":{"arxiv_id":"2507.06261","doi":"10.48550/arxiv.2503.19","metadata_source":"pith","pith_arxiv_id":"2507.06261","snapshot_observed_at":"2026-07-11T03:17:51.364436Z","title":"Gemini 2.5: Pushing the Frontier with Advanced Reasoning, Multimodality, Long Context, and Next Generation Agentic Capabilities","venue":"cs.CL","work_id":"008df105-2fdd-45d8-857a-8e35868aecb6","year":2025},"citing_paper":{"arxiv_id":"2604.14785","last_updated":"2026-04-22T14:57:48Z","snapshot_observed_at":"2026-07-06T23:02:27.141640Z","submitted_at":"2026-04-16T08:45:34Z","title":"MirrorBench: Evaluating Self-centric Intelligence in MLLMs by Introducing a Mirror","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-10T10:53:48.374637Z"},"links":{"cited_paper":"/paper/2507.06261","citing_paper":"/paper/2604.14785"},"observation_digest":"sha256:fc965646979f17058d1e024ae076ffca7bae27df67b21572f540a4dace1171cc","observation_id":"fb247dcc-be46-4413-bbf9-9f1a269edea9","resolution":{"observed_at":"2026-05-10T10:55:03.951625Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Gpt-4o system card","venue":null,"work_id":"29dcec32-6acf-4805-8313-5049467706b9","year":2024},"citing_paper":{"arxiv_id":"2604.14785","last_updated":"2026-04-22T14:57:48Z","snapshot_observed_at":"2026-07-06T23:02:27.141640Z","submitted_at":"2026-04-16T08:45:34Z","title":"MirrorBench: Evaluating Self-centric Intelligence in MLLMs by Introducing a Mirror","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-10T10:53:48.374637Z"},"links":{"citing_paper":"/paper/2604.14785"},"observation_digest":"sha256:0d6cce88fe8c039bd2252216e0305df22464351cdbf223a4422e20909ea4e4e1","observation_id":"f3389036-61ea-42c6-9d48-244bcd07d108","resolution":{"observed_at":"2026-05-19T17:43:10.217031Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Introducing claude sonnet 4.5","venue":null,"work_id":"fd98dd90-4a2e-4e73-8df8-feedeb861d16","year":2025},"citing_paper":{"arxiv_id":"2604.14785","last_updated":"2026-04-22T14:57:48Z","snapshot_observed_at":"2026-07-06T23:02:27.141640Z","submitted_at":"2026-04-16T08:45:34Z","title":"MirrorBench: Evaluating Self-centric Intelligence in MLLMs by Introducing a Mirror","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-05-10T10:53:48.374637Z"},"links":{"citing_paper":"/paper/2604.14785"},"observation_digest":"sha256:5a3b96c35b0852c53270ae58d9e2e9793503a0aae06ea17b0710fc992c3f13db","observation_id":"a90ccf69-6d2b-48c9-a7de-8e6c6f2982f9","resolution":{"observed_at":"2026-05-19T17:43:10.225944Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.12966","last_updated":"2023-10-13T02:41:28Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-08-24T17:59:17Z","title":"Qwen-VL: A Versatile Vision-Language Model for Understanding, Localization, Text Reading, and Beyond","version":3},"cited_work":{"arxiv_id":"2308.12966","doi":"10.48550/arxiv.2308.12966","metadata_source":"pith","pith_arxiv_id":"2308.12966","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Qwen-VL: A Versatile Vision-Language Model for Understanding, Localization, Text Reading, and Beyond","venue":"cs.CV","work_id":"cbc2bb21-b6bb-46c0-80bf-107e195ffe10","year":2023},"citing_paper":{"arxiv_id":"2604.14785","last_updated":"2026-04-22T14:57:48Z","snapshot_observed_at":"2026-07-06T23:02:27.141640Z","submitted_at":"2026-04-16T08:45:34Z","title":"MirrorBench: Evaluating Self-centric Intelligence in MLLMs by Introducing a Mirror","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-10T10:53:48.374637Z"},"links":{"cited_paper":"/paper/2308.12966","citing_paper":"/paper/2604.14785"},"observation_digest":"sha256:d277c195002c9f1ce5ea9c39763785b8f3c6097c11f654732c204e669a8b65ee","observation_id":"af135106-a054-4527-bab3-b775247b11b3","resolution":{"observed_at":"2026-05-10T12:48:40.999279Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.13923","last_updated":"2025-02-19T18:00:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-19T18:00:14Z","title":"Qwen2.5-VL Technical Report","version":1},"cited_work":{"arxiv_id":"2502.13923","doi":"10.48550/arxiv.2502.13923","metadata_source":"pith","pith_arxiv_id":"2502.13923","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Qwen2.5-VL Technical Report","venue":"cs.CV","work_id":"69dffacb-bfe8-442d-be86-48624c60426f","year":2025},"citing_paper":{"arxiv_id":"2604.14785","last_updated":"2026-04-22T14:57:48Z","snapshot_observed_at":"2026-07-06T23:02:27.141640Z","submitted_at":"2026-04-16T08:45:34Z","title":"MirrorBench: Evaluating Self-centric Intelligence in MLLMs by Introducing a Mirror","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-05-10T10:53:48.374637Z"},"links":{"cited_paper":"/paper/2502.13923","citing_paper":"/paper/2604.14785"},"observation_digest":"sha256:33c48093949fd9564de81790c75d1fe1633bfb3c40e108d893c5fb287e8e57cc","observation_id":"c7ea36ea-ad32-4b72-8024-397b29f0f04d","resolution":{"observed_at":"2026-05-10T10:55:03.965790Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-07-12T05:19:13.082554+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-12T05:19:13.082554+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.18265","last_updated":"2025-08-27T14:39:45Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-08-25T17:58:17Z","title":"InternVL3.5: Advancing Open-Source Multimodal Models in Versatility, Reasoning, and Efficiency","version":2},"cited_work":{"arxiv_id":"2508.18265","doi":"10.48550/arxiv.2508.18265","metadata_source":"pith","pith_arxiv_id":"2508.18265","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"InternVL3.5: Advancing Open-Source Multimodal Models in Versatility, Reasoning, and Efficiency","venue":"cs.CV","work_id":"b8f5e260-fff5-444e-bcf5-2c42cfefd83d","year":2025},"citing_paper":{"arxiv_id":"2604.14785","last_updated":"2026-04-22T14:57:48Z","snapshot_observed_at":"2026-07-06T23:02:27.141640Z","submitted_at":"2026-04-16T08:45:34Z","title":"MirrorBench: Evaluating Self-centric Intelligence in MLLMs by Introducing a Mirror","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-05-10T10:53:48.374637Z"},"links":{"cited_paper":"/paper/2508.18265","citing_paper":"/paper/2604.14785"},"observation_digest":"sha256:8e97ccea58ae658bc2eed87e672747e60dfc941f0742bd451d212f1f28ea1d21","observation_id":"82b7f61c-dbb9-4d0c-9ed1-6cd63f18c881","resolution":{"observed_at":"2026-05-10T11:58:59.417668Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Llava-next: Improved reasoning, ocr, and world knowledge","venue":null,"work_id":"7ae95b75-fc31-4c28-a6b7-7d2fbaa91e0e","year":2024},"citing_paper":{"arxiv_id":"2604.14785","last_updated":"2026-04-22T14:57:48Z","snapshot_observed_at":"2026-07-06T23:02:27.141640Z","submitted_at":"2026-04-16T08:45:34Z","title":"MirrorBench: Evaluating Self-centric Intelligence in MLLMs by Introducing a Mirror","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-05-10T10:53:48.374637Z"},"links":{"citing_paper":"/paper/2604.14785"},"observation_digest":"sha256:33a7acde00cc2b29c487d27e82ca0857cf53f764ee586c304d524ccfa6f2f33b","observation_id":"f65fa9f9-13f4-48e2-bb6f-73624afd592a","resolution":{"observed_at":"2026-05-19T17:43:10.248405Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.01006","last_updated":"2026-01-01T13:07:25Z","snapshot_observed_at":"2026-08-03T18:50:30.558321Z","submitted_at":"2025-07-01T17:55:04Z","title":"GLM-4.5V and GLM-4.1V-Thinking: Towards Versatile Multimodal Reasoning with Scalable Reinforcement Learning","version":6},"cited_work":{"arxiv_id":"2507.01006","doi":"10.48550/arxiv.2507.01006","metadata_source":"pith","pith_arxiv_id":"2507.01006","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"GLM-4.5V and GLM-4.1V-Thinking: Towards Versatile Multimodal Reasoning with Scalable Reinforcement Learning","venue":"cs.CV","work_id":"366607ba-e4ea-4726-98c3-63356e32351c","year":2025},"citing_paper":{"arxiv_id":"2604.14785","last_updated":"2026-04-22T14:57:48Z","snapshot_observed_at":"2026-07-06T23:02:27.141640Z","submitted_at":"2026-04-16T08:45:34Z","title":"MirrorBench: Evaluating Self-centric Intelligence in MLLMs by Introducing a Mirror","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-05-10T10:53:48.374637Z"},"links":{"cited_paper":"/paper/2507.01006","citing_paper":"/paper/2604.14785"},"observation_digest":"sha256:66c1a6d44fec9f908606b6f79e2500591285e700a773378419ada4a3a8dbbeb5","observation_id":"9b7a13d4-c3cb-4a69-887b-cdbc26a71b74","resolution":{"observed_at":"2026-05-11T04:48:27.616218Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2604.14785","last_updated":"2026-04-22T14:57:48Z","latest_version":2,"primary_category":"cs.AI","snapshot_observed_at":"2026-07-06T23:02:27.141640Z","submitted_at":"2026-04-16T08:45:34Z","title":"MirrorBench: Evaluating Self-centric Intelligence in MLLMs by Introducing a Mirror"},"reference_resolution":{"displayed":34,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":13,"verified_fuzzy":21},"total_outbound_references":34},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"thesis":"As of 5 August 2026, this Paper Citation Record lists 34 of 34 outbound references and 0 inbound Pith citation observations for arXiv:2604.14785."}