{"as_of":"2026-08-09T07:18:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:c2196db1c3036cb7aee99ea3439d79579d8b39ed2060c502b17808d461013019","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":11,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":11,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":11,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":11,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-08T12:54:56.363353Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-22T09:27:44.030871Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2410.07177","last_updated":"2025-04-13T12:27:56Z","snapshot_observed_at":"2026-08-09T06:47:11.559636Z","submitted_at":"2024-10-09T17:59:59Z","title":"MM-Ego: Towards Building Egocentric Multimodal LLMs for Video QA","version":2},"cited_work":{"arxiv_id":"2410.07177","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2410.07177","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Mm-ego: Towards building ego- centric multimodal llms","venue":null,"work_id":"0ffcdd3d-2058-4116-b522-f3577072a067","year":2024},"citing_paper":{"arxiv_id":"2412.14171","last_updated":"2025-07-02T21:00:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-18T18:59:54Z","title":"Thinking in Space: How Multimodal Large Language Models See, Remember, and Recall Spaces","version":2},"reference_index":96,"source":"pdf_text","source_observed_at":"2026-05-22T09:27:43.919941Z"},"links":{"cited_paper":"/paper/2410.07177","citing_paper":"/paper/2412.14171"},"observation_digest":"sha256:218d33b0cb86696c0ea21469300c6712ffd8acb64fbc82218a85f6e70f8d17a6","observation_id":"5dd15c1c-9360-4df2-991e-28a84b51cac1","resolution":{"observed_at":"2026-05-22T09:27:44.034466Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.07177","last_updated":"2025-04-13T12:27:56Z","snapshot_observed_at":"2026-08-09T06:47:11.559636Z","submitted_at":"2024-10-09T17:59:59Z","title":"MM-Ego: Towards Building Egocentric Multimodal LLMs for Video QA","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.07177","snapshot_observed_at":"2026-08-08T12:54:56.363353Z","title":"Mm-ego: To- wards building egocentric multimodal llms","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.07411","last_updated":"2025-03-21T14:21:30Z","snapshot_observed_at":"2026-08-09T03:53:20.137366Z","submitted_at":"2025-02-11T09:45:06Z","title":"EgoTextVQA: Towards Egocentric Scene-Text Aware Video Question Answering","version":2},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-08T12:54:56.363353Z"},"links":{"cited_paper":"/paper/2410.07177","citing_paper":"/paper/2502.07411"},"observation_digest":"sha256:f82d9d362b3fe5d14345bed9d5e2b155f0eca8fce0f3bf5437db86d85869bbc3","observation_id":"eb601c86-bfa8-4d66-b3ba-f2c41546f759","resolution":{"observed_at":"2026-08-08T12:54:56.363353Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.07177","last_updated":"2025-04-13T12:27:56Z","snapshot_observed_at":"2026-08-09T06:47:11.559636Z","submitted_at":"2024-10-09T17:59:59Z","title":"MM-Ego: Towards Building Egocentric Multimodal LLMs for Video QA","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.07177","snapshot_observed_at":"2026-08-06T10:08:00.839120Z","title":"Daxberger, Lin Chen, Zongyu Lin, Yanghao Li, Bowen Zhang, Haoxuan You, Dan Xu, Zhe Gan, Jiasen Lu, and Yinfei Yang","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.00531","last_updated":"2025-08-01T11:13:25Z","snapshot_observed_at":"2026-08-08T01:59:23.324756Z","submitted_at":"2025-08-01T11:13:25Z","title":"The Repeated-Stimulus Confound in Electroencephalography","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-06T10:08:00.839120Z"},"links":{"cited_paper":"/paper/2410.07177","citing_paper":"/paper/2508.00531"},"observation_digest":"sha256:40945fd2f27a02d99338b3b428153c91bb665a9acd1a1d58d91d6c9920255095","observation_id":"70d551c0-45c3-408b-9516-84314d43b4e0","resolution":{"observed_at":"2026-08-06T10:08:00.839120Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.07177","last_updated":"2025-04-13T12:27:56Z","snapshot_observed_at":"2026-08-09T06:47:11.559636Z","submitted_at":"2024-10-09T17:59:59Z","title":"MM-Ego: Towards Building Egocentric Multimodal LLMs for Video QA","version":2},"cited_work":{"arxiv_id":"2410.07177","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2410.07177","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Mm-ego: Towards building ego- centric multimodal llms","venue":null,"work_id":"0ffcdd3d-2058-4116-b522-f3577072a067","year":2024},"citing_paper":{"arxiv_id":"2602.14122","last_updated":"2026-04-18T15:08:17Z","snapshot_observed_at":"2026-08-02T05:18:20.195131Z","submitted_at":"2026-02-15T12:46:35Z","title":"EgoSound: Benchmarking Sound Understanding in Egocentric Videos","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-05-15T21:44:47.636912Z"},"links":{"cited_paper":"/paper/2410.07177","citing_paper":"/paper/2602.14122"},"observation_digest":"sha256:24a1e4eb60c67151dbb6d5326363a08d9c8e4a7de1a26acfafe6ece8e272d188","observation_id":"51dae55d-cb6b-4bb9-964f-d6d64d461878","resolution":{"observed_at":"2026-05-15T21:46:42.523208Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.07177","last_updated":"2025-04-13T12:27:56Z","snapshot_observed_at":"2026-08-09T06:47:11.559636Z","submitted_at":"2024-10-09T17:59:59Z","title":"MM-Ego: Towards Building Egocentric Multimodal LLMs for Video QA","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.07177","snapshot_observed_at":"2026-08-04T05:50:27.273604Z","title":"arXiv preprint arXiv:2410.07177 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2603.12147","last_updated":"2026-08-03T09:43:55Z","snapshot_observed_at":"2026-08-08T20:08:07.326425Z","submitted_at":"2026-03-12T16:46:01Z","title":"EgoIntent: A Pre-Outcome Micro-Step Benchmark for Understanding What, Why, and Next","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-04T05:50:27.273604Z"},"links":{"cited_paper":"/paper/2410.07177","citing_paper":"/paper/2603.12147"},"observation_digest":"sha256:b50a74bc3b504cd929898620ab9453cf607050815ca69e64e08d9d6394e8a18e","observation_id":"1579ba76-ac98-4aba-943d-addc31974519","resolution":{"observed_at":"2026-08-04T05:50:27.273604Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.07177","last_updated":"2025-04-13T12:27:56Z","snapshot_observed_at":"2026-08-09T06:47:11.559636Z","submitted_at":"2024-10-09T17:59:59Z","title":"MM-Ego: Towards Building Egocentric Multimodal LLMs for Video QA","version":2},"cited_work":{"arxiv_id":"2410.07177","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2410.07177","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Mm-ego: Towards building ego- centric multimodal llms","venue":null,"work_id":"0ffcdd3d-2058-4116-b522-f3577072a067","year":2024},"citing_paper":{"arxiv_id":"2605.04227","last_updated":"2026-08-01T20:12:35Z","snapshot_observed_at":"2026-08-06T23:24:38.697717Z","submitted_at":"2026-05-05T19:12:11Z","title":"Pro$^2$Assist: Continuous Step-aware Proactive Assistance with Multi-modal Egocentric Perception for Long-horizon Procedural Tasks","version":1},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-05-08T17:16:31.820718Z"},"links":{"cited_paper":"/paper/2410.07177","citing_paper":"/paper/2605.04227"},"observation_digest":"sha256:d31caee16e74ee29c2955b0af86f492163108f7a816f958cae1c196ee97dedd3","observation_id":"02537c44-2174-47a2-9657-393e8f3df8ca","resolution":{"observed_at":"2026-05-11T17:46:06.630701Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.07177","last_updated":"2025-04-13T12:27:56Z","snapshot_observed_at":"2026-08-09T06:47:11.559636Z","submitted_at":"2024-10-09T17:59:59Z","title":"MM-Ego: Towards Building Egocentric Multimodal LLMs for Video QA","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.07177","snapshot_observed_at":"2026-08-04T05:19:56.331819Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2605.04227","last_updated":"2026-08-01T20:12:35Z","snapshot_observed_at":"2026-08-06T23:24:38.697717Z","submitted_at":"2026-05-05T19:12:11Z","title":"Pro$^2$Assist: Continuous Step-aware Proactive Assistance with Multi-modal Egocentric Perception for Long-horizon Procedural Tasks","version":2},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-08-04T05:19:56.331819Z"},"links":{"cited_paper":"/paper/2410.07177","citing_paper":"/paper/2605.04227"},"observation_digest":"sha256:a8565ab978fdecb8eb1a42d350ee9df07a67de299e99700a870340a5c9e79a8b","observation_id":"f6c91d06-c0bd-4ca6-9c1a-427c92d69b0a","resolution":{"observed_at":"2026-08-04T05:19:56.331819Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.07177","last_updated":"2025-04-13T12:27:56Z","snapshot_observed_at":"2026-08-09T06:47:11.559636Z","submitted_at":"2024-10-09T17:59:59Z","title":"MM-Ego: Towards Building Egocentric Multimodal LLMs for Video QA","version":2},"cited_work":{"arxiv_id":"2410.07177","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2410.07177","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Mm-ego: Towards building ego- centric multimodal llms","venue":null,"work_id":"0ffcdd3d-2058-4116-b522-f3577072a067","year":2024},"citing_paper":{"arxiv_id":"2605.17262","last_updated":"2026-05-17T05:05:29Z","snapshot_observed_at":"2026-08-03T00:10:03.463200Z","submitted_at":"2026-05-17T05:05:29Z","title":"EgoIntrospect: An Egocentric Dataset and Benchmark for User-Centric Internal State Reasoning","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-20T14:48:12.091885Z"},"links":{"cited_paper":"/paper/2410.07177","citing_paper":"/paper/2605.17262"},"observation_digest":"sha256:8db0689bf939a6793ae5d42cb983db8462e7d26b637e6dd5238707ddfd114e96","observation_id":"36593094-7e0d-4fb6-bf5c-bedde56fc7a7","resolution":{"observed_at":"2026-05-20T14:48:23.168692Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.07177","last_updated":"2025-04-13T12:27:56Z","snapshot_observed_at":"2026-08-09T06:47:11.559636Z","submitted_at":"2024-10-09T17:59:59Z","title":"MM-Ego: Towards Building Egocentric Multimodal LLMs for Video QA","version":2},"cited_work":{"arxiv_id":"2410.07177","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2410.07177","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Mm-ego: Towards building ego- centric multimodal llms","venue":null,"work_id":"0ffcdd3d-2058-4116-b522-f3577072a067","year":2024},"citing_paper":{"arxiv_id":"2605.18431","last_updated":"2026-05-19T05:12:41Z","snapshot_observed_at":"2026-07-06T23:29:20.279470Z","submitted_at":"2026-05-18T14:04:26Z","title":"Seeing Together: Multi-Robot Cooperative Egocentric Spatial Reasoning with Multimodal Large Language Models","version":2},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-05-20T10:36:20.388169Z"},"links":{"cited_paper":"/paper/2410.07177","citing_paper":"/paper/2605.18431"},"observation_digest":"sha256:cb9e92012ae8dbaee7dcd8574465e36c3770c4467667bef6e7e2cc7e3eb8d0d4","observation_id":"82c2559e-64ed-4b5a-a851-f257df6fb9c5","resolution":{"observed_at":"2026-05-20T10:38:12.494220Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.07177","last_updated":"2025-04-13T12:27:56Z","snapshot_observed_at":"2026-08-09T06:47:11.559636Z","submitted_at":"2024-10-09T17:59:59Z","title":"MM-Ego: Towards Building Egocentric Multimodal LLMs for Video QA","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.07177","snapshot_observed_at":"2026-08-02T01:59:17.934979Z","title":"Mm-ego: Towards building egocentric multimodal llms for video qa","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.14497","last_updated":"2026-07-16T02:22:26Z","snapshot_observed_at":"2026-08-09T06:47:20.758759Z","submitted_at":"2026-07-16T02:22:26Z","title":"Reinforcing Egocentric Spatial Perception in Multimodal Large Language Models via Ego Scene Augmentation","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-02T01:59:17.934979Z"},"links":{"cited_paper":"/paper/2410.07177","citing_paper":"/paper/2607.14497"},"observation_digest":"sha256:533621e5ab85fa9a9a37545b00a1d6ef730eea97337aac075522e330a4f69d50","observation_id":"9a8cce54-98b9-488c-ad2a-3b209436c2fe","resolution":{"observed_at":"2026-08-02T01:59:17.934979Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.07177","last_updated":"2025-04-13T12:27:56Z","snapshot_observed_at":"2026-08-09T06:47:11.559636Z","submitted_at":"2024-10-09T17:59:59Z","title":"MM-Ego: Towards Building Egocentric Multimodal LLMs for Video QA","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.07177","snapshot_observed_at":"2026-08-01T22:44:01.350884Z","title":"Mm-ego: Towards building egocentric multimodal llms for video qa.arXiv preprint arXiv:2410.07177, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.15657","last_updated":"2026-07-17T06:05:17Z","snapshot_observed_at":"2026-08-08T02:14:12.766320Z","submitted_at":"2026-07-17T06:05:17Z","title":"Do Agents Dream of False Memories? Black-box Visual Attacks on Long-term Memory in Multimodal AI Agents","version":1},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-01T22:44:01.350884Z"},"links":{"cited_paper":"/paper/2410.07177","citing_paper":"/paper/2607.15657"},"observation_digest":"sha256:221bf04c06b336ea98899b0f62ac8b73f07f62373a8b0cf208d35351f1eb86e3","observation_id":"687e6591-edcf-4b2a-b4e5-32cabf53b413","resolution":{"observed_at":"2026-08-01T22:44:01.350884Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2410.07177/citation-record","integrity":"/paper/2410.07177/integrity","json":"/paper/2410.07177/citation-record.json","paper":"/paper/2410.07177"},"outbound":[],"paper":{"arxiv_id":"2410.07177","last_updated":"2025-04-13T12:27:56Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-09T06:47:11.559636Z","submitted_at":"2024-10-09T17:59:59Z","title":"MM-Ego: Towards Building Egocentric Multimodal LLMs for Video QA"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 11 inbound Pith citation observations for arXiv:2410.07177."}