{"as_of":"2026-08-19T14:27:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:e9de65de2a8419f442033bc98c303f35912f3455dec1d8289c2ce2cbbc85eeb5","coverage":[{"denominator":30,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":30,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T20:31:05.255901Z","state":"measured"},{"denominator":30,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":30,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-19T06:32:44.657259+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2505.12782/citation-record","integrity":"/paper/2505.12782/integrity","json":"/paper/2505.12782/citation-record.json","paper":"/paper/2505.12782"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:31:05.732846Z","title":"From Redundancy to Relevance: Information Flow in LVLMs Across Reasoning Tasks","venue":null,"work_id":"0de9e4da-0fae-45ba-913e-3cee6797ce7d","year":2024},"citing_paper":{"arxiv_id":"2505.12782","last_updated":"2025-05-19T07:11:07Z","snapshot_observed_at":"2026-08-16T22:30:48.287131Z","submitted_at":"2025-05-19T07:11:07Z","title":"AdaToken-3D: Dynamic Spatial Gating for Efficient 3D Large Multimodal-Models Reasoning","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-15T20:31:05.118613Z"},"links":{"citing_paper":"/paper/2505.12782"},"observation_digest":"sha256:3e81e0583c7d0f6e7460251383176baa4c2b53cd2bcd5c5c2bd79e5aa4f44aca","observation_id":"56def660-3266-4c58-9164-0b2cd8b21c6b","resolution":{"observed_at":"2026-08-15T20:31:05.737480Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:31:05.718304Z","title":"An Image is Worth 1/2 Tokens After Layer 2: Plug- and-Play Inference Acceleration for Large Vision-Language Models","venue":null,"work_id":"55c5ab82-9f60-4601-9e18-20e62a501494","year":2024},"citing_paper":{"arxiv_id":"2505.12782","last_updated":"2025-05-19T07:11:07Z","snapshot_observed_at":"2026-08-16T22:30:48.287131Z","submitted_at":"2025-05-19T07:11:07Z","title":"AdaToken-3D: Dynamic Spatial Gating for Efficient 3D Large Multimodal-Models Reasoning","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-15T20:31:05.123823Z"},"links":{"citing_paper":"/paper/2505.12782"},"observation_digest":"sha256:1b9685f113607cb5bef226513e8814e700ddd11c4ad5e20af74a437487fc458c","observation_id":"e579f04d-2e33-4b9b-8115-b8f22369b59d","resolution":{"observed_at":"2026-08-15T20:31:05.723133Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.11401","last_updated":"2024-03-22T18:52:51Z","snapshot_observed_at":"2026-08-17T15:42:36.096154Z","submitted_at":"2024-03-18T01:18:48Z","title":"Scene-LLM: Extending Language Model for 3D Visual Understanding and Reasoning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.11401","snapshot_observed_at":"2026-08-15T20:31:05.128481Z","title":"Scene-LLM: Extending Language Model for 3D Visual Understanding and Reasoning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.12782","last_updated":"2025-05-19T07:11:07Z","snapshot_observed_at":"2026-08-16T22:30:48.287131Z","submitted_at":"2025-05-19T07:11:07Z","title":"AdaToken-3D: Dynamic Spatial Gating for Efficient 3D Large Multimodal-Models Reasoning","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-15T20:31:05.128481Z"},"links":{"cited_paper":"/paper/2403.11401","citing_paper":"/paper/2505.12782"},"observation_digest":"sha256:ac590efeffd789c2f0700d7019d75ea067218351902894a5c4b24bfa3294f8e7","observation_id":"638f2633-cc42-41e2-8375-3de6606efa66","resolution":{"observed_at":"2026-08-15T20:31:05.128481Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.16886","last_updated":"2023-12-30T04:59:21Z","snapshot_observed_at":"2026-07-29T22:12:01.108911Z","submitted_at":"2023-12-28T08:21:24Z","title":"MobileVLM : A Fast, Strong and Open Vision Language Assistant for Mobile Devices","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.16886","snapshot_observed_at":"2026-08-15T20:31:05.133612Z","title":"MobileVLM : A Fast, Strong and Open Vision Language Assistant for Mobile Devices","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.12782","last_updated":"2025-05-19T07:11:07Z","snapshot_observed_at":"2026-08-16T22:30:48.287131Z","submitted_at":"2025-05-19T07:11:07Z","title":"AdaToken-3D: Dynamic Spatial Gating for Efficient 3D Large Multimodal-Models Reasoning","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-15T20:31:05.133612Z"},"links":{"cited_paper":"/paper/2312.16886","citing_paper":"/paper/2505.12782"},"observation_digest":"sha256:a3279c768199e17f579e8156b543a6c3735c12cd95b3330fd8527334248e2218","observation_id":"302ce6b4-a0ea-4dc1-9c60-2a96ea9ef424","resolution":{"observed_at":"2026-08-15T20:31:05.133612Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:31:05.703162Z","title":"Chat-Scene: Bridging 3D Scene and Large Lan- guage Models with Object Identifiers","venue":null,"work_id":"b4553763-525d-413e-8298-1e16e9c07cf7","year":2023},"citing_paper":{"arxiv_id":"2505.12782","last_updated":"2025-05-19T07:11:07Z","snapshot_observed_at":"2026-08-16T22:30:48.287131Z","submitted_at":"2025-05-19T07:11:07Z","title":"AdaToken-3D: Dynamic Spatial Gating for Efficient 3D Large Multimodal-Models Reasoning","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-15T20:31:05.138606Z"},"links":{"citing_paper":"/paper/2505.12782"},"observation_digest":"sha256:7435169375200b781617d9b9ed128964daa22b4559f48b0f2b976a9474010fc2","observation_id":"6bb40e64-be28-4b76-99a2-56491e8a5bc0","resolution":{"observed_at":"2026-08-15T20:31:05.708431Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.05525","last_updated":"2024-03-11T16:47:41Z","snapshot_observed_at":"2026-08-11T01:38:59.827005Z","submitted_at":"2024-03-08T18:46:00Z","title":"DeepSeek-VL: Towards Real-World Vision-Language Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.05525","snapshot_observed_at":"2026-08-15T20:31:05.148435Z","title":"DeepSeek-VL: Towards Real-World Vision-Language Understanding","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.12782","last_updated":"2025-05-19T07:11:07Z","snapshot_observed_at":"2026-08-16T22:30:48.287131Z","submitted_at":"2025-05-19T07:11:07Z","title":"AdaToken-3D: Dynamic Spatial Gating for Efficient 3D Large Multimodal-Models Reasoning","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-15T20:31:05.148435Z"},"links":{"cited_paper":"/paper/2403.05525","citing_paper":"/paper/2505.12782"},"observation_digest":"sha256:2b9ccc5dc1178f5098270514ca8aeb374dba823640d37503a598100b657e9c70","observation_id":"0222e24d-a6e9-4c73-9f73-2ddbd3d47931","resolution":{"observed_at":"2026-08-15T20:31:05.148435Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.01428","last_updated":"2025-03-11T07:54:04Z","snapshot_observed_at":"2026-08-15T04:16:11.827389Z","submitted_at":"2025-01-02T18:59:59Z","title":"GPT4Scene: Understand 3D Scenes from Videos with Vision-Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.01428","snapshot_observed_at":"2026-08-15T20:31:05.152574Z","title":"GPT4Scene: Understand 3D Scenes from Videos with Vision-Language Models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.12782","last_updated":"2025-05-19T07:11:07Z","snapshot_observed_at":"2026-08-16T22:30:48.287131Z","submitted_at":"2025-05-19T07:11:07Z","title":"AdaToken-3D: Dynamic Spatial Gating for Efficient 3D Large Multimodal-Models Reasoning","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-15T20:31:05.152574Z"},"links":{"cited_paper":"/paper/2501.01428","citing_paper":"/paper/2505.12782"},"observation_digest":"sha256:762a50572c17b563f234e04ec0112259ea9c6a1694f20be3f1e0100fcbfb6b39","observation_id":"df2a323b-8a9f-4f91-a7f2-1b967d81d89a","resolution":{"observed_at":"2026-08-15T20:31:05.152574Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:31:05.688846Z","title":"LL3DA: Visual Interactive Instruction Tuning for Omni-3D Understanding, Reasoning, and Planning","venue":null,"work_id":"9db2e1e4-ee05-4f6c-8144-b4e92da88e2c","year":2023},"citing_paper":{"arxiv_id":"2505.12782","last_updated":"2025-05-19T07:11:07Z","snapshot_observed_at":"2026-08-16T22:30:48.287131Z","submitted_at":"2025-05-19T07:11:07Z","title":"AdaToken-3D: Dynamic Spatial Gating for Efficient 3D Large Multimodal-Models Reasoning","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-15T20:31:05.156671Z"},"links":{"citing_paper":"/paper/2505.12782"},"observation_digest":"sha256:48a6f47d492c5c15a83defdbf37c31b45721fd695b6ea2dcf099cccb8afb73ac","observation_id":"e3defb45-a16e-4060-a2fa-c09f3c08973e","resolution":{"observed_at":"2026-08-15T20:31:05.693581Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.03836","last_updated":"2024-04-04T23:38:45Z","snapshot_observed_at":"2026-08-16T14:03:28.791216Z","submitted_at":"2024-04-04T23:38:45Z","title":"PARIS3D: Reasoning-based 3D Part Segmentation Using Large Multimodal Model","version":1},"cited_work":{"arxiv_id":"2404.03836","doi":null,"metadata_source":"pith","pith_arxiv_id":"2404.03836","snapshot_observed_at":"2026-08-15T20:31:05.471406Z","title":"PARIS3D: Reasoning-based 3D Part Segmentation Using Large Multimodal Model","venue":"cs.CV","work_id":"205bd050-bef9-4dfe-ba14-2a8ce1d9df0e","year":2024},"citing_paper":{"arxiv_id":"2505.12782","last_updated":"2025-05-19T07:11:07Z","snapshot_observed_at":"2026-08-16T22:30:48.287131Z","submitted_at":"2025-05-19T07:11:07Z","title":"AdaToken-3D: Dynamic Spatial Gating for Efficient 3D Large Multimodal-Models Reasoning","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-15T20:31:05.160459Z"},"links":{"cited_paper":"/paper/2404.03836","citing_paper":"/paper/2505.12782"},"observation_digest":"sha256:09f70e3bab39516904b1d024596ad9e9af1077b8da254c935dc314a869a91b9c","observation_id":"ba1aa080-459e-4651-9dfe-03c22bba5450","resolution":{"observed_at":"2026-08-15T20:31:05.479018Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.09968","last_updated":"2024-11-15T05:51:29Z","snapshot_observed_at":"2026-08-18T12:56:24.009168Z","submitted_at":"2024-11-15T05:51:29Z","title":"Seeing Clearly by Layer Two: Enhancing Attention Heads to Alleviate Hallucination in LVLMs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.09968","snapshot_observed_at":"2026-08-15T20:31:05.165089Z","title":"Seeing Clearly by Layer Two: Enhanc- ing Attention Heads to Alleviate Hallucination in LVLMs","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.12782","last_updated":"2025-05-19T07:11:07Z","snapshot_observed_at":"2026-08-16T22:30:48.287131Z","submitted_at":"2025-05-19T07:11:07Z","title":"AdaToken-3D: Dynamic Spatial Gating for Efficient 3D Large Multimodal-Models Reasoning","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-15T20:31:05.165089Z"},"links":{"cited_paper":"/paper/2411.09968","citing_paper":"/paper/2505.12782"},"observation_digest":"sha256:0900fa3c8471d9656fd0c3b903372bb61abb87a9587b7dc35ffbd0d4d08e80f5","observation_id":"7463f6bb-1c9c-40a1-abb4-6ed749c3beee","resolution":{"observed_at":"2026-08-15T20:31:05.165089Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.17247","last_updated":"2025-02-27T11:16:33Z","snapshot_observed_at":"2026-08-12T14:42:48.682739Z","submitted_at":"2024-10-22T17:59:53Z","title":"PyramidDrop: Accelerating Your Large Vision-Language Models via Pyramid Visual Redundancy Reduction","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.17247","snapshot_observed_at":"2026-08-15T20:31:05.170020Z","title":"PyramidDrop: Accelerating Your Large Vision- Language Models via Pyramid Visual Redundancy Reduction","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.12782","last_updated":"2025-05-19T07:11:07Z","snapshot_observed_at":"2026-08-16T22:30:48.287131Z","submitted_at":"2025-05-19T07:11:07Z","title":"AdaToken-3D: Dynamic Spatial Gating for Efficient 3D Large Multimodal-Models Reasoning","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-15T20:31:05.170020Z"},"links":{"cited_paper":"/paper/2410.17247","citing_paper":"/paper/2505.12782"},"observation_digest":"sha256:41bf0379f36f00c8ba53e07ebb88e84efa3a975e884b69f9e21eca5daaf89547","observation_id":"3b770b20-6d97-4f69-b9c6-d5b74645adb0","resolution":{"observed_at":"2026-08-15T20:31:05.170020Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.07895","last_updated":"2024-07-28T19:58:08Z","snapshot_observed_at":"2026-08-13T00:09:23.835117Z","submitted_at":"2024-07-10T17:59:43Z","title":"LLaVA-NeXT-Interleave: Tackling Multi-image, Video, and 3D in Large Multimodal Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.07895","snapshot_observed_at":"2026-08-15T20:31:05.174504Z","title":"LLaV A-NeXT-Interleave: Tackling Multi-image, Video, and 3D in Large Multimodal Models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.12782","last_updated":"2025-05-19T07:11:07Z","snapshot_observed_at":"2026-08-16T22:30:48.287131Z","submitted_at":"2025-05-19T07:11:07Z","title":"AdaToken-3D: Dynamic Spatial Gating for Efficient 3D Large Multimodal-Models Reasoning","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-15T20:31:05.174504Z"},"links":{"cited_paper":"/paper/2407.07895","citing_paper":"/paper/2505.12782"},"observation_digest":"sha256:c0d5c948f9c5f667d2f0893f7d83feace0aff54324045dc7436842580df402fd","observation_id":"4071c773-4852-4b63-947a-6245f352b2ab","resolution":{"observed_at":"2026-08-15T20:31:05.174504Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2106.02034","last_updated":"2021-10-26T13:37:53Z","snapshot_observed_at":"2026-08-16T18:19:51.559179Z","submitted_at":"2021-06-03T17:57:41Z","title":"DynamicViT: Efficient Vision Transformers with Dynamic Token Sparsification","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.02034","snapshot_observed_at":"2026-08-15T20:31:05.178951Z","title":"DynamicViT: Efficient Vision Transformers with Dynamic Token Sparsification","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.12782","last_updated":"2025-05-19T07:11:07Z","snapshot_observed_at":"2026-08-16T22:30:48.287131Z","submitted_at":"2025-05-19T07:11:07Z","title":"AdaToken-3D: Dynamic Spatial Gating for Efficient 3D Large Multimodal-Models Reasoning","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-15T20:31:05.178951Z"},"links":{"cited_paper":"/paper/2106.02034","citing_paper":"/paper/2505.12782"},"observation_digest":"sha256:43d7dfed9a3d8ab5f8d00e11ca9c84d3594890cea4d15557772c8027943f97f9","observation_id":"fd9ad6c1-c18f-422a-84c5-510fe19d8567","resolution":{"observed_at":"2026-08-15T20:31:05.178951Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:31:05.673835Z","title":"AdaViT: Adaptive Vision Transformers for Ef- ficient Image Recognition","venue":null,"work_id":"54f0e44c-f49b-4b70-aa18-9099436313fa","year":2021},"citing_paper":{"arxiv_id":"2505.12782","last_updated":"2025-05-19T07:11:07Z","snapshot_observed_at":"2026-08-16T22:30:48.287131Z","submitted_at":"2025-05-19T07:11:07Z","title":"AdaToken-3D: Dynamic Spatial Gating for Efficient 3D Large Multimodal-Models Reasoning","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-15T20:31:05.183399Z"},"links":{"citing_paper":"/paper/2505.12782"},"observation_digest":"sha256:c021b2259dc1bf4f66c52aa976b6b1b73f52218388231bdbb5edfe7cf64fa27c","observation_id":"f1d999d2-4c1e-4f58-bf4b-f38d98445c9d","resolution":{"observed_at":"2026-08-15T20:31:05.679111Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.18125","last_updated":"2025-04-27T06:50:23Z","snapshot_observed_at":"2026-08-16T13:15:01.097068Z","submitted_at":"2024-09-26T17:59:11Z","title":"LLaVA-3D: A Simple yet Effective Pathway to Empowering LMMs with 3D-awareness","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.18125","snapshot_observed_at":"2026-08-15T20:31:05.187631Z","title":"LLaV A-3D: A Simple yet Effective Pathway to Empowering LMMs with 3D-awareness","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.12782","last_updated":"2025-05-19T07:11:07Z","snapshot_observed_at":"2026-08-16T22:30:48.287131Z","submitted_at":"2025-05-19T07:11:07Z","title":"AdaToken-3D: Dynamic Spatial Gating for Efficient 3D Large Multimodal-Models Reasoning","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-15T20:31:05.187631Z"},"links":{"cited_paper":"/paper/2409.18125","citing_paper":"/paper/2505.12782"},"observation_digest":"sha256:3013bebf3f4c3703c581a2d49b2d76b2f942ab33b07d1e8f2b9e976f5fe0949f","observation_id":"0c8f83c0-ce17-4808-9c0d-ae35edc25aad","resolution":{"observed_at":"2026-08-15T20:31:05.187631Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.08485","last_updated":"2023-12-11T17:46:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-04-17T17:59:25Z","title":"Visual Instruction Tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.08485","snapshot_observed_at":"2026-08-15T20:31:05.192332Z","title":"Visual Instruction Tuning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.12782","last_updated":"2025-05-19T07:11:07Z","snapshot_observed_at":"2026-08-16T22:30:48.287131Z","submitted_at":"2025-05-19T07:11:07Z","title":"AdaToken-3D: Dynamic Spatial Gating for Efficient 3D Large Multimodal-Models Reasoning","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-15T20:31:05.192332Z"},"links":{"cited_paper":"/paper/2304.08485","citing_paper":"/paper/2505.12782"},"observation_digest":"sha256:b0112e441e07d22f37c4b9a231aa7790612008adae13b8d1f651ccf1aba325c5","observation_id":"204872f8-6abc-4d74-8419-7f6ac519380a","resolution":{"observed_at":"2026-08-15T20:31:05.192332Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.07474","last_updated":"2023-04-12T20:05:41Z","snapshot_observed_at":"2026-08-16T22:30:06.161719Z","submitted_at":"2022-10-14T02:52:26Z","title":"SQA3D: Situated Question Answering in 3D Scenes","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.07474","snapshot_observed_at":"2026-08-15T20:31:05.196777Z","title":"SQA3D: Situated Question Answering in 3D Scenes","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.12782","last_updated":"2025-05-19T07:11:07Z","snapshot_observed_at":"2026-08-16T22:30:48.287131Z","submitted_at":"2025-05-19T07:11:07Z","title":"AdaToken-3D: Dynamic Spatial Gating for Efficient 3D Large Multimodal-Models Reasoning","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-15T20:31:05.196777Z"},"links":{"cited_paper":"/paper/2210.07474","citing_paper":"/paper/2505.12782"},"observation_digest":"sha256:03db25101572e4693a96934c6ea47c838978cf2801bb27c4679ffc5b23deb125","observation_id":"1f6ad87a-adb8-4a2f-bf28-f37fa25e739c","resolution":{"observed_at":"2026-08-15T20:31:05.196777Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:31:05.659266Z","title":"ScanQA: 3D Question Answering for Spatial Scene Understanding","venue":null,"work_id":"2b04b07c-ee02-4659-9d2f-afefa58c492a","year":2021},"citing_paper":{"arxiv_id":"2505.12782","last_updated":"2025-05-19T07:11:07Z","snapshot_observed_at":"2026-08-16T22:30:48.287131Z","submitted_at":"2025-05-19T07:11:07Z","title":"AdaToken-3D: Dynamic Spatial Gating for Efficient 3D Large Multimodal-Models Reasoning","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-15T20:31:05.201270Z"},"links":{"citing_paper":"/paper/2505.12782"},"observation_digest":"sha256:44e71df1127fb5fa74410fb89cc0d406ec9f1ef6b32b27092de292bd927633ae","observation_id":"7cf0d9e2-c9d4-40d9-9e6a-de648d98ec4f","resolution":{"observed_at":"2026-08-15T20:31:05.664103Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.05271","last_updated":"2025-09-26T12:52:41Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-06T18:57:08Z","title":"Expanding Performance Boundaries of Open-Source Multimodal Models with Model, Data, and Test-Time Scaling","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.05271","snapshot_observed_at":"2026-08-15T20:31:05.206553Z","title":"Expanding Performance Boundaries of Open-Source Multimodal Models with Model, Data, and Test-Time Scaling","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.12782","last_updated":"2025-05-19T07:11:07Z","snapshot_observed_at":"2026-08-16T22:30:48.287131Z","submitted_at":"2025-05-19T07:11:07Z","title":"AdaToken-3D: Dynamic Spatial Gating for Efficient 3D Large Multimodal-Models Reasoning","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-15T20:31:05.206553Z"},"links":{"cited_paper":"/paper/2412.05271","citing_paper":"/paper/2505.12782"},"observation_digest":"sha256:b9decb46719eb228cdb6a4848ed18c71a8e62d8d40ec861ccdbef46d7a56148a","observation_id":"2c9221f1-66b0-4ce0-84e9-beec620f3d1e","resolution":{"observed_at":"2026-08-15T20:31:05.206553Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:31:05.643400Z","title":"Qwen-VL: A Versatile Vision-Language Model for Understanding, Localization, Text Reading, and Beyond","venue":null,"work_id":"e27936d9-15ce-4557-a599-9fa057c15877","year":2023},"citing_paper":{"arxiv_id":"2505.12782","last_updated":"2025-05-19T07:11:07Z","snapshot_observed_at":"2026-08-16T22:30:48.287131Z","submitted_at":"2025-05-19T07:11:07Z","title":"AdaToken-3D: Dynamic Spatial Gating for Efficient 3D Large Multimodal-Models Reasoning","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-15T20:31:05.211805Z"},"links":{"citing_paper":"/paper/2505.12782"},"observation_digest":"sha256:37f0c733d9a3554e4d66e0697ddbfc6bbb90b116a7fe6f45f36dfc9f959a89ac","observation_id":"a2133ca6-7b57-4f60-92ff-c49007c09683","resolution":{"observed_at":"2026-08-15T20:31:05.648915Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1912.08830","last_updated":"2020-11-11T09:33:31Z","snapshot_observed_at":"2026-08-15T13:56:28.830963Z","submitted_at":"2019-12-18T19:00:49Z","title":"ScanRefer: 3D Object Localization in RGB-D Scans using Natural Language","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1912.08830","snapshot_observed_at":"2026-08-15T20:31:05.216059Z","title":"ScanRefer: 3D Object Localization in RGB- D Scans using Natural Language","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.12782","last_updated":"2025-05-19T07:11:07Z","snapshot_observed_at":"2026-08-16T22:30:48.287131Z","submitted_at":"2025-05-19T07:11:07Z","title":"AdaToken-3D: Dynamic Spatial Gating for Efficient 3D Large Multimodal-Models Reasoning","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-15T20:31:05.216059Z"},"links":{"cited_paper":"/paper/1912.08830","citing_paper":"/paper/2505.12782"},"observation_digest":"sha256:96255e8f22734b2d01fc5bd70992db9635d7d0cfbb2bc21ca43b09c1a1fe0014","observation_id":"3d291220-caee-4549-8878-79b83702ea1d","resolution":{"observed_at":"2026-08-15T20:31:05.216059Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:31:05.626967Z","title":"Scan2Cap: Context-aware Dense Captioning in RGB-D Scans","venue":null,"work_id":"7efacb9d-c847-42b3-8f95-0bc585a05341","year":2020},"citing_paper":{"arxiv_id":"2505.12782","last_updated":"2025-05-19T07:11:07Z","snapshot_observed_at":"2026-08-16T22:30:48.287131Z","submitted_at":"2025-05-19T07:11:07Z","title":"AdaToken-3D: Dynamic Spatial Gating for Efficient 3D Large Multimodal-Models Reasoning","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-15T20:31:05.220738Z"},"links":{"citing_paper":"/paper/2505.12782"},"observation_digest":"sha256:d57e6386115664ad7f05286cfa0200ff867cc678e05385887796a9a8d88bfd6f","observation_id":"9c33042b-5f41-4545-a16f-9dfe5339599a","resolution":{"observed_at":"2026-08-15T20:31:05.631965Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.02490","last_updated":"2024-12-01T05:46:03Z","snapshot_observed_at":"2026-08-18T03:16:44.825874Z","submitted_at":"2023-08-04T17:59:47Z","title":"MM-Vet: Evaluating Large Multimodal Models for Integrated Capabilities","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.02490","snapshot_observed_at":"2026-08-15T20:31:05.225119Z","title":"MM-Vet: Evaluating Large Multimodal Models for Integrated Capabilities","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.12782","last_updated":"2025-05-19T07:11:07Z","snapshot_observed_at":"2026-08-16T22:30:48.287131Z","submitted_at":"2025-05-19T07:11:07Z","title":"AdaToken-3D: Dynamic Spatial Gating for Efficient 3D Large Multimodal-Models Reasoning","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-15T20:31:05.225119Z"},"links":{"cited_paper":"/paper/2308.02490","citing_paper":"/paper/2505.12782"},"observation_digest":"sha256:ba649c3cf21fed6695de25db6be687cda0a0c791c686add202deecfa9c0d6dbe","observation_id":"e79c0fb3-7bf1-4068-ae3c-0317a56af95c","resolution":{"observed_at":"2026-08-15T20:31:05.225119Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.13394","last_updated":"2025-10-24T02:45:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-06-23T09:22:36Z","title":"MME: A Comprehensive Evaluation Benchmark for Multimodal Large Language Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.13394","snapshot_observed_at":"2026-08-15T20:31:05.229575Z","title":"MME: A Comprehensive Evaluation Benchmark for Multimodal Large Language Models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.12782","last_updated":"2025-05-19T07:11:07Z","snapshot_observed_at":"2026-08-16T22:30:48.287131Z","submitted_at":"2025-05-19T07:11:07Z","title":"AdaToken-3D: Dynamic Spatial Gating for Efficient 3D Large Multimodal-Models Reasoning","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-15T20:31:05.229575Z"},"links":{"cited_paper":"/paper/2306.13394","citing_paper":"/paper/2505.12782"},"observation_digest":"sha256:8f4dd264bc876cc2f47773dce0f146a402fad84fdaeeecd39badac6210926fa5","observation_id":"e90af53e-3e81-4494-849d-ec53440de956","resolution":{"observed_at":"2026-08-15T20:31:05.229575Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:31:05.612087Z","title":"MMBench: Is Your Multi-modal Model an All-around Player?","venue":null,"work_id":"d6388456-db7a-4633-b943-273ae2dc4fca","year":2023},"citing_paper":{"arxiv_id":"2505.12782","last_updated":"2025-05-19T07:11:07Z","snapshot_observed_at":"2026-08-16T22:30:48.287131Z","submitted_at":"2025-05-19T07:11:07Z","title":"AdaToken-3D: Dynamic Spatial Gating for Efficient 3D Large Multimodal-Models Reasoning","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-15T20:31:05.233935Z"},"links":{"citing_paper":"/paper/2505.12782"},"observation_digest":"sha256:96abf8de7fa81d75301301aa73522c52222252f07db29fd5bbdee3495821f0f8","observation_id":"efbfc9bc-c617-4a63-a4ce-5f5167622f0b","resolution":{"observed_at":"2026-08-15T20:31:05.617033Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:31:05.597063Z","title":"Making the V in VQA Matter: Elevating the Role of Image Understanding in Visual Question Answering","venue":null,"work_id":"45499943-5bdc-4905-b7bc-f76405e05142","year":2016},"citing_paper":{"arxiv_id":"2505.12782","last_updated":"2025-05-19T07:11:07Z","snapshot_observed_at":"2026-08-16T22:30:48.287131Z","submitted_at":"2025-05-19T07:11:07Z","title":"AdaToken-3D: Dynamic Spatial Gating for Efficient 3D Large Multimodal-Models Reasoning","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-15T20:31:05.238630Z"},"links":{"citing_paper":"/paper/2505.12782"},"observation_digest":"sha256:733323caead215ee82f518ae5241ad065ad14a7c57d1fe7834ea480b6766c2f1","observation_id":"a2e4980f-f42a-4fd9-8eee-0b43c8b9dbb5","resolution":{"observed_at":"2026-08-15T20:31:05.601871Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.04801","last_updated":"2025-02-09T19:38:18Z","snapshot_observed_at":"2026-08-18T17:46:13.412024Z","submitted_at":"2024-03-05T19:32:01Z","title":"Alpaca against Vicuna: Using LLMs to Uncover Memorization of LLMs","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.04801","snapshot_observed_at":"2026-08-15T20:31:05.243254Z","title":"Alpaca against Vicuna: Using LLMs to Uncover Memorization of LLMs","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.12782","last_updated":"2025-05-19T07:11:07Z","snapshot_observed_at":"2026-08-16T22:30:48.287131Z","submitted_at":"2025-05-19T07:11:07Z","title":"AdaToken-3D: Dynamic Spatial Gating for Efficient 3D Large Multimodal-Models Reasoning","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-15T20:31:05.243254Z"},"links":{"cited_paper":"/paper/2403.04801","citing_paper":"/paper/2505.12782"},"observation_digest":"sha256:6da96f78084b9dd40e05af1d5882fe5c05e260de48d81004fdcf06ff18d56933","observation_id":"942b5564-4a52-4882-ba91-b7bd3d85e9af","resolution":{"observed_at":"2026-08-15T20:31:05.243254Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:31:05.581146Z","title":"ScanNet: Richly-Annotated 3D Reconstructions of Indoor Scenes","venue":null,"work_id":"c8b06178-4fbd-4135-9f2b-b184aa140111","year":2017},"citing_paper":{"arxiv_id":"2505.12782","last_updated":"2025-05-19T07:11:07Z","snapshot_observed_at":"2026-08-16T22:30:48.287131Z","submitted_at":"2025-05-19T07:11:07Z","title":"AdaToken-3D: Dynamic Spatial Gating for Efficient 3D Large Multimodal-Models Reasoning","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-15T20:31:05.247912Z"},"links":{"citing_paper":"/paper/2505.12782"},"observation_digest":"sha256:b8c3bf4e76f4286e494fdfdcbf67667c02b9631181994c5e57d34a8e6d8176b1","observation_id":"119f14b7-d3ee-40b8-bc45-1ac6565513ac","resolution":{"observed_at":"2026-08-15T20:31:05.586560Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:31:05.565617Z","title":"GPT-4 Technical Report","venue":null,"work_id":"4213535f-0c0e-4420-ad82-31177a096c50","year":2023},"citing_paper":{"arxiv_id":"2505.12782","last_updated":"2025-05-19T07:11:07Z","snapshot_observed_at":"2026-08-16T22:30:48.287131Z","submitted_at":"2025-05-19T07:11:07Z","title":"AdaToken-3D: Dynamic Spatial Gating for Efficient 3D Large Multimodal-Models Reasoning","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-15T20:31:05.252112Z"},"links":{"citing_paper":"/paper/2505.12782"},"observation_digest":"sha256:45e8447c7d5d66a5d49f8a6b4d0b24a65edae731b28138b45af7d47f2d92ea64","observation_id":"943b41ae-712a-4f4d-9507-74212e377eab","resolution":{"observed_at":"2026-08-15T20:31:05.570825Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.12871","last_updated":"2024-05-09T17:35:44Z","snapshot_observed_at":"2026-08-05T10:01:43.401012Z","submitted_at":"2023-11-18T01:21:38Z","title":"An Embodied Generalist Agent in 3D World","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.12871","snapshot_observed_at":"2026-08-15T20:31:05.255901Z","title":"An Embodied Generalist Agent in 3D World","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.12782","last_updated":"2025-05-19T07:11:07Z","snapshot_observed_at":"2026-08-16T22:30:48.287131Z","submitted_at":"2025-05-19T07:11:07Z","title":"AdaToken-3D: Dynamic Spatial Gating for Efficient 3D Large Multimodal-Models Reasoning","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-15T20:31:05.255901Z"},"links":{"cited_paper":"/paper/2311.12871","citing_paper":"/paper/2505.12782"},"observation_digest":"sha256:630fd1c8fafc356077c1f2d23fa59b152d2e336e030fe424055f5fa9d25c4a94","observation_id":"ae47147b-84fa-4183-9750-119855bb3d41","resolution":{"observed_at":"2026-08-15T20:31:05.255901Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2505.12782","last_updated":"2025-05-19T07:11:07Z","latest_version":1,"primary_category":"cs.GR","snapshot_observed_at":"2026-08-16T22:30:48.287131Z","submitted_at":"2025-05-19T07:11:07Z","title":"AdaToken-3D: Dynamic Spatial Gating for Efficient 3D Large Multimodal-Models Reasoning"},"reference_resolution":{"displayed":30,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":17,"verified_exact":1,"verified_fuzzy":12},"total_outbound_references":30},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"thesis":"As of 19 August 2026, this Paper Citation Record lists 30 of 30 outbound references and 0 inbound Pith citation observations for arXiv:2505.12782."}