{"as_of":"2026-08-08T03:38:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:0138d70620a1522146a44ca7cb7095817f440870aa3f08c686bca0514dc7b77a","coverage":[{"denominator":33,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":33,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-02T05:13:03.048047Z","state":"measured"},{"denominator":33,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":33,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.13454/citation-record","integrity":"/paper/2607.13454/integrity","json":"/paper/2607.13454/citation-record.json","paper":"/paper/2607.13454"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2511.07403","last_updated":"2026-07-02T19:21:24Z","snapshot_observed_at":"2026-08-07T07:35:15.256090Z","submitted_at":"2025-11-10T18:52:47Z","title":"SpatialThinker: Reinforcing Scene Graph-Grounded Spatial Reasoning via Dense Rewards","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2511.07403","snapshot_observed_at":"2026-08-02T05:12:59.576553Z","title":"Spatialthinker: Reinforcing 3d reasoning in multimodal llms via spatial rewards.arXiv preprint arXiv:2511.07403,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.13454","last_updated":"2026-07-28T06:55:44Z","snapshot_observed_at":"2026-08-07T07:43:16.636685Z","submitted_at":"2026-07-15T05:27:37Z","title":"GeoAnchor: Collaborative Reasoning via Latent Decomposition for 3D Spatial Understanding","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-02T05:12:59.576553Z"},"links":{"cited_paper":"/paper/2511.07403","citing_paper":"/paper/2607.13454"},"observation_digest":"sha256:2fa22bc250a7c3500ce094d7c9dfa131fcc75664a81981b0cb57698e08ecee0f","observation_id":"9f830fba-1192-4c41-a984-bf514729bb13","resolution":{"observed_at":"2026-08-02T05:12:59.576553Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T05:12:59.647559Z","title":"Soft tokens, hard truths.arXiv preprint arXiv:2509.19170,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.13454","last_updated":"2026-07-28T06:55:44Z","snapshot_observed_at":"2026-08-07T07:43:16.636685Z","submitted_at":"2026-07-15T05:27:37Z","title":"GeoAnchor: Collaborative Reasoning via Latent Decomposition for 3D Spatial Understanding","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-02T05:12:59.647559Z"},"links":{"citing_paper":"/paper/2607.13454"},"observation_digest":"sha256:d245a1be967a3ab1081f5c177c891577e11edf1c153d96b32c5811a654719e14","observation_id":"d27a13e4-4883-4a90-b8cd-70b863307daa","resolution":{"observed_at":"2026-08-02T05:12:59.647559Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T05:12:59.730134Z","title":"Scaling spatial intelligence with multimodal foundation models.arXiv preprint arXiv:2511.13719,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.13454","last_updated":"2026-07-28T06:55:44Z","snapshot_observed_at":"2026-08-07T07:43:16.636685Z","submitted_at":"2026-07-15T05:27:37Z","title":"GeoAnchor: Collaborative Reasoning via Latent Decomposition for 3D Spatial Understanding","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-02T05:12:59.730134Z"},"links":{"citing_paper":"/paper/2607.13454"},"observation_digest":"sha256:46ab1b0e1406ccd983a5a55b0746d5f055961133fccef56db6f16798977ec6a3","observation_id":"aa696c81-f94e-427b-bca0-b76088feee30","resolution":{"observed_at":"2026-08-02T05:12:59.730134Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2601.10611","last_updated":"2026-04-02T16:01:02Z","snapshot_observed_at":"2026-08-02T06:45:30.387180Z","submitted_at":"2026-01-15T17:27:44Z","title":"Molmo2: Open Weights and Data for Vision-Language Models with Video Understanding and Grounding","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2601.10611","snapshot_observed_at":"2026-08-02T05:12:59.872051Z","title":"Molmo2: Open weights and data for vision-language models with video understanding and grounding.arXiv preprint arXiv:2601.10611,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.13454","last_updated":"2026-07-28T06:55:44Z","snapshot_observed_at":"2026-08-07T07:43:16.636685Z","submitted_at":"2026-07-15T05:27:37Z","title":"GeoAnchor: Collaborative Reasoning via Latent Decomposition for 3D Spatial Understanding","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-02T05:12:59.872051Z"},"links":{"cited_paper":"/paper/2601.10611","citing_paper":"/paper/2607.13454"},"observation_digest":"sha256:24614e00a6e775015ebc876fd426e4d780e1895f9b4415d066e035b3577a2336","observation_id":"5a937bb6-9ac9-4e67-8d4a-aed2323ec226","resolution":{"observed_at":"2026-08-02T05:12:59.872051Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.20279","last_updated":"2026-04-21T02:48:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-26T17:56:30Z","title":"VLM-3R: Vision-Language Models Augmented with Instruction-Aligned 3D Reconstruction","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.20279","snapshot_observed_at":"2026-08-02T05:13:00.188880Z","title":"Vlm-3r: Vision-language models augmented with instruction-aligned 3d reconstruction.arXiv preprint arXiv:2505.20279,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.13454","last_updated":"2026-07-28T06:55:44Z","snapshot_observed_at":"2026-08-07T07:43:16.636685Z","submitted_at":"2026-07-15T05:27:37Z","title":"GeoAnchor: Collaborative Reasoning via Latent Decomposition for 3D Spatial Understanding","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-02T05:13:00.188880Z"},"links":{"cited_paper":"/paper/2505.20279","citing_paper":"/paper/2607.13454"},"observation_digest":"sha256:5764cee052867192e56cddab1a19384b4c24e54ece854ec02bf04cd3d3ac7c4e","observation_id":"b5130446-0bca-45bf-bbb3-b20c569965ec","resolution":{"observed_at":"2026-08-02T05:13:00.188880Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T05:13:00.376667Z","title":"Spatial reasoning with vision-language models in ego-centric multi-view scenes.arXiv preprint arXiv:2509.06266,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.13454","last_updated":"2026-07-28T06:55:44Z","snapshot_observed_at":"2026-08-07T07:43:16.636685Z","submitted_at":"2026-07-15T05:27:37Z","title":"GeoAnchor: Collaborative Reasoning via Latent Decomposition for 3D Spatial Understanding","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-02T05:13:00.376667Z"},"links":{"citing_paper":"/paper/2607.13454"},"observation_digest":"sha256:8d179a1d9d9a61aa64f51375ff65d15a43f975fe71a67d43eeca466884425f11","observation_id":"4b9345b0-2bcf-4a47-8fb6-abcd4d5ca5f1","resolution":{"observed_at":"2026-08-02T05:13:00.376667Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.01006","last_updated":"2026-01-01T13:07:25Z","snapshot_observed_at":"2026-08-03T18:50:30.558321Z","submitted_at":"2025-07-01T17:55:04Z","title":"GLM-4.5V and GLM-4.1V-Thinking: Towards Versatile Multimodal Reasoning with Scalable Reinforcement Learning","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.01006","snapshot_observed_at":"2026-08-02T05:13:00.498158Z","title":"Wenyi Hong, Wenmeng Yu, Xiaotao Gu, Guo Wang, Guobing Gan, Haomiao Tang, Jiale Cheng, Ji Qi, Junhui Ji, Lihang Pan, et al","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.13454","last_updated":"2026-07-28T06:55:44Z","snapshot_observed_at":"2026-08-07T07:43:16.636685Z","submitted_at":"2026-07-15T05:27:37Z","title":"GeoAnchor: Collaborative Reasoning via Latent Decomposition for 3D Spatial Understanding","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-02T05:13:00.498158Z"},"links":{"cited_paper":"/paper/2507.01006","citing_paper":"/paper/2607.13454"},"observation_digest":"sha256:58e00e515cbc8966002a771803204abe4fd46c51d22448bb67c0054f3d03ac72","observation_id":"ac685a44-b862-4573-ad0a-9f794319a084","resolution":{"observed_at":"2026-08-02T05:13:00.498158Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T05:13:00.617516Z","title":"G2vlm: Geometry grounded vision language model with unified 3d reconstruction and spatial reasoning.arXiv preprint arXiv:2511.21688,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.13454","last_updated":"2026-07-28T06:55:44Z","snapshot_observed_at":"2026-08-07T07:43:16.636685Z","submitted_at":"2026-07-15T05:27:37Z","title":"GeoAnchor: Collaborative Reasoning via Latent Decomposition for 3D Spatial Understanding","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-02T05:13:00.617516Z"},"links":{"citing_paper":"/paper/2607.13454"},"observation_digest":"sha256:6bf5c3afc945b255c59609481a9ed2e70f240ff3899f0f955db6fb842f214486","observation_id":"2d19e706-2726-4381-9de0-7ee0b2d129a1","resolution":{"observed_at":"2026-08-02T05:13:00.617516Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.21276","last_updated":"2024-10-25T17:43:01Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-10-25T17:43:01Z","title":"GPT-4o System Card","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.21276","snapshot_observed_at":"2026-08-02T05:13:00.745381Z","title":"Gpt-4o system card.arXiv preprint arXiv:2410.21276,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.13454","last_updated":"2026-07-28T06:55:44Z","snapshot_observed_at":"2026-08-07T07:43:16.636685Z","submitted_at":"2026-07-15T05:27:37Z","title":"GeoAnchor: Collaborative Reasoning via Latent Decomposition for 3D Spatial Understanding","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-02T05:13:00.745381Z"},"links":{"cited_paper":"/paper/2410.21276","citing_paper":"/paper/2607.13454"},"observation_digest":"sha256:ec0700644defa06671eb457811ced4c7ca2356c763ca5a967fabf4b1b8c63e86","observation_id":"1c0d6f58-dbcb-4685-abaa-a65754c6ac6c","resolution":{"observed_at":"2026-08-02T05:13:00.745381Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.23262","last_updated":"2025-09-23T04:19:59Z","snapshot_observed_at":"2026-08-05T06:31:46.069300Z","submitted_at":"2024-10-30T17:46:31Z","title":"EMMA: End-to-End Multimodal Model for Autonomous Driving","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.23262","snapshot_observed_at":"2026-08-02T05:13:00.881819Z","title":"Emma: End-to-end multimodal model for autonomous driving.arXiv preprint arXiv:2410.23262,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.13454","last_updated":"2026-07-28T06:55:44Z","snapshot_observed_at":"2026-08-07T07:43:16.636685Z","submitted_at":"2026-07-15T05:27:37Z","title":"GeoAnchor: Collaborative Reasoning via Latent Decomposition for 3D Spatial Understanding","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-02T05:13:00.881819Z"},"links":{"cited_paper":"/paper/2410.23262","citing_paper":"/paper/2607.13454"},"observation_digest":"sha256:c5315f6c42c73b7e09d524fabbe8cc3c93ed73644f68f5d33e8769dec8ecfd83","observation_id":"6da3774b-50c6-4122-837f-87c520cd1b58","resolution":{"observed_at":"2026-08-02T05:13:00.881819Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.09246","last_updated":"2024-09-05T19:46:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-06-13T15:46:55Z","title":"OpenVLA: An Open-Source Vision-Language-Action Model","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.09246","snapshot_observed_at":"2026-08-02T05:13:01.022685Z","title":"Openvla: An open-source vision-language-action model.arXiv preprint arXiv:2406.09246,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.13454","last_updated":"2026-07-28T06:55:44Z","snapshot_observed_at":"2026-08-07T07:43:16.636685Z","submitted_at":"2026-07-15T05:27:37Z","title":"GeoAnchor: Collaborative Reasoning via Latent Decomposition for 3D Spatial Understanding","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-02T05:13:01.022685Z"},"links":{"cited_paper":"/paper/2406.09246","citing_paper":"/paper/2607.13454"},"observation_digest":"sha256:22ffae493d2e105380c327edb9df0be2dd97b393af3f0ef1d795c4b993b73dcb","observation_id":"3af0ba7c-f356-4699-b51e-a54e6684747e","resolution":{"observed_at":"2026-08-02T05:13:01.022685Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1412.6980","last_updated":"2017-01-30T01:27:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2014-12-22T13:54:29Z","title":"Adam: A Method for Stochastic Optimization","version":9},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1412.6980","snapshot_observed_at":"2026-08-02T05:13:01.124562Z","title":"Adam: A method for stochastic optimization.arXiv preprint arXiv:1412.6980,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.13454","last_updated":"2026-07-28T06:55:44Z","snapshot_observed_at":"2026-08-07T07:43:16.636685Z","submitted_at":"2026-07-15T05:27:37Z","title":"GeoAnchor: Collaborative Reasoning via Latent Decomposition for 3D Spatial Understanding","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-02T05:13:01.124562Z"},"links":{"cited_paper":"/paper/1412.6980","citing_paper":"/paper/2607.13454"},"observation_digest":"sha256:9382fab0e5716222c5dc05f2069cbec2b04aebe97f3b59ffa550b8c2d92ed526","observation_id":"012478ce-c84e-46e1-8077-4b2acc060b98","resolution":{"observed_at":"2026-08-02T05:13:01.124562Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T05:13:01.342190Z","title":"Ssr: Enhancing depth perception in vision-language models via rationale-guided spatial reasoning.arXiv preprint arXiv:2505.12448, 2025a","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.13454","last_updated":"2026-07-28T06:55:44Z","snapshot_observed_at":"2026-08-07T07:43:16.636685Z","submitted_at":"2026-07-15T05:27:37Z","title":"GeoAnchor: Collaborative Reasoning via Latent Decomposition for 3D Spatial Understanding","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-02T05:13:01.342190Z"},"links":{"citing_paper":"/paper/2607.13454"},"observation_digest":"sha256:60c671091c26aa47b672ee9cf7a822a68b1682891eeb88cae092330314944ae5","observation_id":"d1ac438b-264c-493e-8971-c79ff0cd1555","resolution":{"observed_at":"2026-08-02T05:13:01.342190Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.01805","last_updated":"2025-05-21T09:38:44Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-02T15:12:17Z","title":"SpaceR: Reinforcing MLLMs in Video Spatial Reasoning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.01805","snapshot_observed_at":"2026-08-02T05:13:01.445112Z","title":"Spacer: Reinforcing mllms in video spatial reasoning.arXiv preprint arXiv:2504.01805,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.13454","last_updated":"2026-07-28T06:55:44Z","snapshot_observed_at":"2026-08-07T07:43:16.636685Z","submitted_at":"2026-07-15T05:27:37Z","title":"GeoAnchor: Collaborative Reasoning via Latent Decomposition for 3D Spatial Understanding","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-02T05:13:01.445112Z"},"links":{"cited_paper":"/paper/2504.01805","citing_paper":"/paper/2607.13454"},"observation_digest":"sha256:68b9f446e902fbf4c382b849fbf711d7e04ca382a5a7283361fded197a8cc17d","observation_id":"cb81cc5e-792d-4694-afd4-d8e4f90e70d1","resolution":{"observed_at":"2026-08-02T05:13:01.445112Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.09747","last_updated":"2025-01-16T18:57:04Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-16T18:57:04Z","title":"FAST: Efficient Action Tokenization for Vision-Language-Action Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.09747","snapshot_observed_at":"2026-08-02T05:13:01.546395Z","title":"Fast: Efficient action tokenization for vision-language-action models.arXiv preprint arXiv:2501.09747,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.13454","last_updated":"2026-07-28T06:55:44Z","snapshot_observed_at":"2026-08-07T07:43:16.636685Z","submitted_at":"2026-07-15T05:27:37Z","title":"GeoAnchor: Collaborative Reasoning via Latent Decomposition for 3D Spatial Understanding","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-02T05:13:01.546395Z"},"links":{"cited_paper":"/paper/2501.09747","citing_paper":"/paper/2607.13454"},"observation_digest":"sha256:0762f3394582ae19dd5c597274e7e79e4b5849573a6d9516bfab0809f226e0f1","observation_id":"83169f78-f8d3-4613-8a7f-aabc70c93337","resolution":{"observed_at":"2026-08-02T05:13:01.546395Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T05:13:01.670170Z","title":"Chain-of-visual-thought: Teaching vlms to see and think better with continuous visual tokens.arXiv preprint arXiv:2511.19418,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.13454","last_updated":"2026-07-28T06:55:44Z","snapshot_observed_at":"2026-08-07T07:43:16.636685Z","submitted_at":"2026-07-15T05:27:37Z","title":"GeoAnchor: Collaborative Reasoning via Latent Decomposition for 3D Spatial Understanding","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-02T05:13:01.670170Z"},"links":{"citing_paper":"/paper/2607.13454"},"observation_digest":"sha256:38b17c2ee574b07deff9ceba87f8364ff61ec4586798cdc1cdf7856fcb80a819","observation_id":"e85cf415-e08d-4e57-a700-d08da279d0c3","resolution":{"observed_at":"2026-08-02T05:13:01.670170Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2512.10941","last_updated":"2026-04-30T17:59:42Z","snapshot_observed_at":"2026-07-06T22:38:45.907386Z","submitted_at":"2025-12-11T18:59:08Z","title":"Mull-Tokens: Modality-Agnostic Latent Thinking","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2512.10941","snapshot_observed_at":"2026-08-02T05:13:01.783341Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.13454","last_updated":"2026-07-28T06:55:44Z","snapshot_observed_at":"2026-08-07T07:43:16.636685Z","submitted_at":"2026-07-15T05:27:37Z","title":"GeoAnchor: Collaborative Reasoning via Latent Decomposition for 3D Spatial Understanding","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-02T05:13:01.783341Z"},"links":{"cited_paper":"/paper/2512.10941","citing_paper":"/paper/2607.13454"},"observation_digest":"sha256:a63411ab19233866bd091f6548432205cfc77b5600f7a5910ffeae418302c16a","observation_id":"b63b2438-1afb-4c6e-bf3e-4e3b25b09365","resolution":{"observed_at":"2026-08-02T05:13:01.783341Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03300","last_updated":"2024-04-27T15:25:53Z","snapshot_observed_at":"2026-08-06T14:58:42.911363Z","submitted_at":"2024-02-05T18:55:32Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.03300","snapshot_observed_at":"2026-08-02T05:13:01.920551Z","title":"Deepseekmath: Pushing the limits of mathematical reasoning in open language models.arXiv preprint arXiv:2402.03300,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.13454","last_updated":"2026-07-28T06:55:44Z","snapshot_observed_at":"2026-08-07T07:43:16.636685Z","submitted_at":"2026-07-15T05:27:37Z","title":"GeoAnchor: Collaborative Reasoning via Latent Decomposition for 3D Spatial Understanding","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-02T05:13:01.920551Z"},"links":{"cited_paper":"/paper/2402.03300","citing_paper":"/paper/2607.13454"},"observation_digest":"sha256:0e1b1708c10599cfce27271f99593c00b258a528125352de623a7e9c523f0d5f","observation_id":"65accdca-c282-4c11-b649-9d46eeaec6f1","resolution":{"observed_at":"2026-08-02T05:13:01.920551Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T05:13:02.063237Z","title":"Codi: Compressing chain-of-thought into continuous space via self-distillation","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.13454","last_updated":"2026-07-28T06:55:44Z","snapshot_observed_at":"2026-08-07T07:43:16.636685Z","submitted_at":"2026-07-15T05:27:37Z","title":"GeoAnchor: Collaborative Reasoning via Latent Decomposition for 3D Spatial Understanding","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-02T05:13:02.063237Z"},"links":{"citing_paper":"/paper/2607.13454"},"observation_digest":"sha256:13764f2d4f45aa0dc4cc59ae2fb243fd0eb7ca81be31a519aa9969816d021b46","observation_id":"84afe5c0-7bd6-4162-9ebc-116d2bfc2af5","resolution":{"observed_at":"2026-08-02T05:13:02.063237Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.07491","last_updated":"2025-06-23T13:45:50Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-10T06:48:26Z","title":"Kimi-VL Technical Report","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.07491","snapshot_observed_at":"2026-08-02T05:13:02.171088Z","title":"Kimi-vl technical report.arXiv preprint arXiv:2504.07491,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.13454","last_updated":"2026-07-28T06:55:44Z","snapshot_observed_at":"2026-08-07T07:43:16.636685Z","submitted_at":"2026-07-15T05:27:37Z","title":"GeoAnchor: Collaborative Reasoning via Latent Decomposition for 3D Spatial Understanding","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-02T05:13:02.171088Z"},"links":{"cited_paper":"/paper/2504.07491","citing_paper":"/paper/2607.13454"},"observation_digest":"sha256:e5aa1568f4f41367f5103dc21c71d0ad8aff66e8da472a180431f52e47907096","observation_id":"d577dd1f-b3ce-4a15-a634-c20e2d2f125b","resolution":{"observed_at":"2026-08-02T05:13:02.171088Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.23747","last_updated":"2026-05-19T02:23:16Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-29T17:59:04Z","title":"Spatial-MLLM: Boosting MLLM Capabilities in Visual-based Spatial Intelligence","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.23747","snapshot_observed_at":"2026-08-02T05:13:02.444123Z","title":"Spatial-mllm: Boosting mllm capabilities in visual-based spatial intelligence.arXiv preprint arXiv:2505.23747, 2025a","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.13454","last_updated":"2026-07-28T06:55:44Z","snapshot_observed_at":"2026-08-07T07:43:16.636685Z","submitted_at":"2026-07-15T05:27:37Z","title":"GeoAnchor: Collaborative Reasoning via Latent Decomposition for 3D Spatial Understanding","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-02T05:13:02.444123Z"},"links":{"cited_paper":"/paper/2505.23747","citing_paper":"/paper/2607.13454"},"observation_digest":"sha256:00789b25ce601e7b458f6b5c6d3e4a56aba50ac38e404579ff72e41f23913254","observation_id":"a362f8e3-357b-4a03-bca3-a3ac9684237d","resolution":{"observed_at":"2026-08-02T05:13:02.444123Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09388","last_updated":"2025-05-14T13:41:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-14T13:41:34Z","title":"Qwen3 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.09388","snapshot_observed_at":"2026-08-02T05:13:02.505171Z","title":"Qwen3 technical report.arXiv preprint arXiv:2505.09388, 2025a","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.13454","last_updated":"2026-07-28T06:55:44Z","snapshot_observed_at":"2026-08-07T07:43:16.636685Z","submitted_at":"2026-07-15T05:27:37Z","title":"GeoAnchor: Collaborative Reasoning via Latent Decomposition for 3D Spatial Understanding","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-02T05:13:02.505171Z"},"links":{"cited_paper":"/paper/2505.09388","citing_paper":"/paper/2607.13454"},"observation_digest":"sha256:34a975314e0091bff159e8f3f1ad4de7ccc78e677eb4b2601a01adb12ed5a1f5","observation_id":"46687d1a-b2bc-461c-9825-60bfcf0a2c87","resolution":{"observed_at":"2026-08-02T05:13:02.505171Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T05:13:02.702742Z","title":"Hybrid latent reasoning via reinforcement learning.arXiv preprint arXiv:2505.18454,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.13454","last_updated":"2026-07-28T06:55:44Z","snapshot_observed_at":"2026-08-07T07:43:16.636685Z","submitted_at":"2026-07-15T05:27:37Z","title":"GeoAnchor: Collaborative Reasoning via Latent Decomposition for 3D Spatial Understanding","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-02T05:13:02.702742Z"},"links":{"citing_paper":"/paper/2607.13454"},"observation_digest":"sha256:cb0cfd1eecdbc003c5e90762a6852e3700995a892ca0357d4b6a4428a1e6dcb3","observation_id":"79f04a1f-99e6-4ac1-8df3-3fe1e8824fc0","resolution":{"observed_at":"2026-08-02T05:13:02.702742Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T05:13:02.842600Z","title":"Actial: Activate spatial reasoning ability of multimodal large language models.arXiv preprint arXiv:2511.01618,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.13454","last_updated":"2026-07-28T06:55:44Z","snapshot_observed_at":"2026-08-07T07:43:16.636685Z","submitted_at":"2026-07-15T05:27:37Z","title":"GeoAnchor: Collaborative Reasoning via Latent Decomposition for 3D Spatial Understanding","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-02T05:13:02.842600Z"},"links":{"citing_paper":"/paper/2607.13454"},"observation_digest":"sha256:ed357ae1080080f40d4304a2cef0fcecbda3af54e44926c9b0b8d242a26d7fa2","observation_id":"3c1693b7-4b09-4a07-badc-558dd47c46d3","resolution":{"observed_at":"2026-08-02T05:13:02.842600Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T05:13:02.952820Z","title":"Spatial understanding from videos: Structured prompts meet simulation data.arXiv preprint arXiv:2506.03642, 2025a","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.13454","last_updated":"2026-07-28T06:55:44Z","snapshot_observed_at":"2026-08-07T07:43:16.636685Z","submitted_at":"2026-07-15T05:27:37Z","title":"GeoAnchor: Collaborative Reasoning via Latent Decomposition for 3D Spatial Understanding","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-02T05:13:02.952820Z"},"links":{"citing_paper":"/paper/2607.13454"},"observation_digest":"sha256:74a6bd97575e7918335036adc4041df955adef13ead0af028abadcac957f4762","observation_id":"a058b1e4-6c2f-4787-8c1f-888e75b5b47c","resolution":{"observed_at":"2026-08-02T05:13:02.952820Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T05:13:02.347735Z","title":"Vggt: Visual geometry grounded transformer","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.13454","last_updated":"2026-07-28T06:55:44Z","snapshot_observed_at":"2026-08-07T07:43:16.636685Z","submitted_at":"2026-07-15T05:27:37Z","title":"GeoAnchor: Collaborative Reasoning via Latent Decomposition for 3D Spatial Understanding","version":2},"reference_index":2008,"source":"pdf_text","source_observed_at":"2026-08-02T05:13:02.347735Z"},"links":{"citing_paper":"/paper/2607.13454"},"observation_digest":"sha256:ac3b88e1f7f6f77477f78b3393fbcd6175f389ba423923d33f290786828750ee","observation_id":"c498deb9-e932-494f-8210-163f23dcd107","resolution":{"observed_at":"2026-08-02T05:13:02.347735Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2509.24251","last_updated":"2025-10-05T04:01:18Z","snapshot_observed_at":"2026-07-06T22:31:00.843452Z","submitted_at":"2025-09-29T03:52:01Z","title":"Latent Visual Reasoning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.24251","snapshot_observed_at":"2026-08-02T05:13:01.210403Z","title":"Latent visual reasoning.arXiv preprint arXiv:2509.24251, 2025a","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.13454","last_updated":"2026-07-28T06:55:44Z","snapshot_observed_at":"2026-08-07T07:43:16.636685Z","submitted_at":"2026-07-15T05:27:37Z","title":"GeoAnchor: Collaborative Reasoning via Latent Decomposition for 3D Spatial Understanding","version":2},"reference_index":2014,"source":"pdf_text","source_observed_at":"2026-08-02T05:13:01.210403Z"},"links":{"cited_paper":"/paper/2509.24251","citing_paper":"/paper/2607.13454"},"observation_digest":"sha256:f55d95c4d0b335efb7476b5c8f9d9b59c1da14b9a415171e986b273ef4a6d4d5","observation_id":"84c5eb08-11f7-462e-a2b1-a56bb58fe48d","resolution":{"observed_at":"2026-08-02T05:13:01.210403Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T05:13:00.020117Z","title":"Graid: Enhancing spatial reasoning of vlms through high-fidelity data generation.arXiv preprint arXiv:2510.22118,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.13454","last_updated":"2026-07-28T06:55:44Z","snapshot_observed_at":"2026-08-07T07:43:16.636685Z","submitted_at":"2026-07-15T05:27:37Z","title":"GeoAnchor: Collaborative Reasoning via Latent Decomposition for 3D Spatial Understanding","version":2},"reference_index":2017,"source":"pdf_text","source_observed_at":"2026-08-02T05:13:00.020117Z"},"links":{"citing_paper":"/paper/2607.13454"},"observation_digest":"sha256:927451af75ad904717936aed8daf7cc7170dbb395b7c8526f40c8ffa79776f3a","observation_id":"80401e07-62d6-4c6b-a4ef-94dacd8b316f","resolution":{"observed_at":"2026-08-02T05:13:00.020117Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T05:13:03.048047Z","title":"Opendrivevla: Towards end-to-end autonomous driving with large vision language action model.arXiv preprint arXiv:2503.23463,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.13454","last_updated":"2026-07-28T06:55:44Z","snapshot_observed_at":"2026-08-07T07:43:16.636685Z","submitted_at":"2026-07-15T05:27:37Z","title":"GeoAnchor: Collaborative Reasoning via Latent Decomposition for 3D Spatial Understanding","version":2},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-02T05:13:03.048047Z"},"links":{"citing_paper":"/paper/2607.13454"},"observation_digest":"sha256:8fa4af7c4fa079b5cc3a1cc887dadc7eb78d25a21905c09a21cbd6f5e6cbad9c","observation_id":"63c4b4d8-06fe-4a29-b3fd-6626344d05cb","resolution":{"observed_at":"2026-08-02T05:13:03.048047Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2509.18154","last_updated":"2025-09-16T19:41:48Z","snapshot_observed_at":"2026-07-06T22:30:31.933240Z","submitted_at":"2025-09-16T19:41:48Z","title":"MiniCPM-V 4.5: Cooking Efficient MLLMs via Architecture, Data, and Training Recipe","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.18154","snapshot_observed_at":"2026-08-02T05:13:02.571379Z","title":"Minicpm-v 4.5: Cooking efficient mllms via architecture, data, and training recipe","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.13454","last_updated":"2026-07-28T06:55:44Z","snapshot_observed_at":"2026-08-07T07:43:16.636685Z","submitted_at":"2026-07-15T05:27:37Z","title":"GeoAnchor: Collaborative Reasoning via Latent Decomposition for 3D Spatial Understanding","version":2},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-02T05:13:02.571379Z"},"links":{"cited_paper":"/paper/2509.18154","citing_paper":"/paper/2607.13454"},"observation_digest":"sha256:d3b74e1af10da2fa479bcf30758dbc8fd77c216b38d79a1cfcdbda379b310b63","observation_id":"f1baf7cb-ef3d-40fe-88c4-3094ca8bbabe","resolution":{"observed_at":"2026-08-02T05:13:02.571379Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T05:12:59.807112Z","title":"Think with 3d: Geometric imagination grounded spatial reasoning from limited views.arXiv preprint arXiv:2510.18632,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.13454","last_updated":"2026-07-28T06:55:44Z","snapshot_observed_at":"2026-08-07T07:43:16.636685Z","submitted_at":"2026-07-15T05:27:37Z","title":"GeoAnchor: Collaborative Reasoning via Latent Decomposition for 3D Spatial Understanding","version":2},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-02T05:12:59.807112Z"},"links":{"citing_paper":"/paper/2607.13454"},"observation_digest":"sha256:c085627dd25fb218f4c085fc6f3416f12f0f8edec34320ddd157648fb5bc44e4","observation_id":"1b1fa2a2-9bac-4603-af20-2f64ab9fd959","resolution":{"observed_at":"2026-08-02T05:12:59.807112Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2509.23661","last_updated":"2025-12-14T14:18:43Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-28T05:52:55Z","title":"LLaVA-OneVision-1.5: Fully Open Framework for Democratized Multimodal Training","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.23661","snapshot_observed_at":"2026-08-02T05:12:59.503508Z","title":"Llava-onevision-1.5: Fully open framework for democratized multimodal training.arXiv preprint arXiv:2509.23661,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.13454","last_updated":"2026-07-28T06:55:44Z","snapshot_observed_at":"2026-08-07T07:43:16.636685Z","submitted_at":"2026-07-15T05:27:37Z","title":"GeoAnchor: Collaborative Reasoning via Latent Decomposition for 3D Spatial Understanding","version":2},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-02T05:12:59.503508Z"},"links":{"cited_paper":"/paper/2509.23661","citing_paper":"/paper/2607.13454"},"observation_digest":"sha256:0c21cf23bacbe82484851acb0047a8714d95a7d0f2b6f227f487ce474093122e","observation_id":"4558eb28-bc29-4053-b55c-2fcfc8cfab53","resolution":{"observed_at":"2026-08-02T05:12:59.503508Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.06261","last_updated":"2025-12-19T14:25:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-07-07T17:36:04Z","title":"Gemini 2.5: Pushing the Frontier with Advanced Reasoning, Multimodality, Long Context, and Next Generation Agentic Capabilities","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.06261","snapshot_observed_at":"2026-08-02T05:12:59.937620Z","title":"Gemini 2.5: Pushing the frontier with advanced reasoning, multimodality, long context, and next generation agentic capabilities.arXiv preprint arXiv:2507.06261,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.13454","last_updated":"2026-07-28T06:55:44Z","snapshot_observed_at":"2026-08-07T07:43:16.636685Z","submitted_at":"2026-07-15T05:27:37Z","title":"GeoAnchor: Collaborative Reasoning via Latent Decomposition for 3D Spatial Understanding","version":2},"reference_index":2026,"source":"pdf_text","source_observed_at":"2026-08-02T05:12:59.937620Z"},"links":{"cited_paper":"/paper/2507.06261","citing_paper":"/paper/2607.13454"},"observation_digest":"sha256:e636978edf6b27494ba62e3fefdabd4f9d5c8c40dc0d02edbfe0fe02a8fb9dcd","observation_id":"1bf4be5f-a395-4788-b00b-d8cc8d28b629","resolution":{"observed_at":"2026-08-02T05:12:59.937620Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.13454","last_updated":"2026-07-28T06:55:44Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-07T07:43:16.636685Z","submitted_at":"2026-07-15T05:27:37Z","title":"GeoAnchor: Collaborative Reasoning via Latent Decomposition for 3D Spatial Understanding"},"reference_resolution":{"displayed":33,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":33,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":33},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 33 of 33 outbound references and 0 inbound Pith citation observations for arXiv:2607.13454."}