{"as_of":"2026-08-07T22:34:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:2b3477801d9b4f6ba759ff8c50592b0be45bcab4a79acafbe2f8d68966dd6071","coverage":[{"denominator":20,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":20,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-01T17:25:11.020656Z","state":"measured"},{"denominator":20,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":20,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.17657/citation-record","integrity":"/paper/2607.17657/integrity","json":"/paper/2607.17657/citation-record.json","paper":"/paper/2607.17657"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:25:08.726525Z","title":"Cheng, A.; Yin, H.; Fu, Y.; Guo, Q.; Yang, R.; Kautz, J.; Wang, X.; and Liu, S","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.17657","last_updated":"2026-07-20T08:07:22Z","snapshot_observed_at":"2026-08-07T07:38:23.550463Z","submitted_at":"2026-07-20T08:07:22Z","title":"OrientSAM: Mitigating Camera-Centric Shortcut in Multimodal Spatial Reasoning via Orientation-Aware Spatial Alignment","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-01T17:25:08.726525Z"},"links":{"citing_paper":"/paper/2607.17657"},"observation_digest":"sha256:0200fec0b2bf265a178071a9cb1e567a0fbda7aa8509f9870b8fb137190f95b8","observation_id":"8f764f63-b7f1-4728-9c66-9ed249606acf","resolution":{"observed_at":"2026-08-01T17:25:08.726525Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12969","last_updated":"2024-09-02T16:32:03Z","snapshot_observed_at":"2026-07-06T19:18:21.930632Z","submitted_at":"2024-09-02T16:32:03Z","title":"Seeing Through Their Eyes: Evaluating Visual Perspective Taking in Vision Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.12969","snapshot_observed_at":"2026-08-01T17:25:08.858467Z","title":"Huang, X.; Wu, J.; Xie, Q.; and Han, K","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.17657","last_updated":"2026-07-20T08:07:22Z","snapshot_observed_at":"2026-08-07T07:38:23.550463Z","submitted_at":"2026-07-20T08:07:22Z","title":"OrientSAM: Mitigating Camera-Centric Shortcut in Multimodal Spatial Reasoning via Orientation-Aware Spatial Alignment","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-01T17:25:08.858467Z"},"links":{"cited_paper":"/paper/2409.12969","citing_paper":"/paper/2607.17657"},"observation_digest":"sha256:c677d837e2d1d9f30c772c7936d7d6efae6341e5b6d96e30bedfb961aaf4dd31","observation_id":"ddfef86b-3caf-473e-8dcd-de220ca8190d","resolution":{"observed_at":"2026-08-01T17:25:08.858467Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:25:08.952456Z","title":"InIEEE/CVF Con- ferenceonComputerVisionandPatternRecognition,CVPR 2025, Nashville, TN, USA, June 11-15, 2025, 14257–14267","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.17657","last_updated":"2026-07-20T08:07:22Z","snapshot_observed_at":"2026-08-07T07:38:23.550463Z","submitted_at":"2026-07-20T08:07:22Z","title":"OrientSAM: Mitigating Camera-Centric Shortcut in Multimodal Spatial Reasoning via Orientation-Aware Spatial Alignment","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-01T17:25:08.952456Z"},"links":{"citing_paper":"/paper/2607.17657"},"observation_digest":"sha256:8751c5c3c9c80b5a1067389bc87b246ffc2764e6386e72b874891bfe8f75e4de","observation_id":"bf9024fa-5cf6-4dfe-8c86-06e7c40db922","resolution":{"observed_at":"2026-08-01T17:25:08.952456Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.17207","last_updated":"2025-04-24T02:41:34Z","snapshot_observed_at":"2026-08-07T15:59:40.905046Z","submitted_at":"2025-04-24T02:41:34Z","title":"Perspective-Aware Reasoning in Vision-Language Models via Mental Imagery Simulation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.17207","snapshot_observed_at":"2026-08-01T17:25:09.238556Z","title":"Leonard, B.; and Murray, S","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.17657","last_updated":"2026-07-20T08:07:22Z","snapshot_observed_at":"2026-08-07T07:38:23.550463Z","submitted_at":"2026-07-20T08:07:22Z","title":"OrientSAM: Mitigating Camera-Centric Shortcut in Multimodal Spatial Reasoning via Orientation-Aware Spatial Alignment","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-01T17:25:09.238556Z"},"links":{"cited_paper":"/paper/2504.17207","citing_paper":"/paper/2607.17657"},"observation_digest":"sha256:35efcac1f48363126669e6ab6aa6b89b4d810e22c11c7474e0cea144c45a06b7","observation_id":"777b7497-fe99-4b9e-8ca4-f9ceb53ecb06","resolution":{"observed_at":"2026-08-01T17:25:09.238556Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:25:09.490748Z","title":"InThe Thirteenth International Conference on Learning Representations, ICLR 2025, Singapore, April 24-28,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.17657","last_updated":"2026-07-20T08:07:22Z","snapshot_observed_at":"2026-08-07T07:38:23.550463Z","submitted_at":"2026-07-20T08:07:22Z","title":"OrientSAM: Mitigating Camera-Centric Shortcut in Multimodal Spatial Reasoning via Orientation-Aware Spatial Alignment","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-01T17:25:09.490748Z"},"links":{"citing_paper":"/paper/2607.17657"},"observation_digest":"sha256:f7a155c3eeade4fb48848d22125e6874d75e797e055c04e6518e0a658a92f80d","observation_id":"4587a9e4-2e09-4ceb-a6dd-915d8c547286","resolution":{"observed_at":"2026-08-01T17:25:09.490748Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:25:09.626774Z","title":"Liu, F.; Emerson, G.; and Collier, N","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.17657","last_updated":"2026-07-20T08:07:22Z","snapshot_observed_at":"2026-08-07T07:38:23.550463Z","submitted_at":"2026-07-20T08:07:22Z","title":"OrientSAM: Mitigating Camera-Centric Shortcut in Multimodal Spatial Reasoning via Orientation-Aware Spatial Alignment","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-01T17:25:09.626774Z"},"links":{"citing_paper":"/paper/2607.17657"},"observation_digest":"sha256:09e250976ab8beebb6814260211124b1c24cbab5a26b9eb6ac3e68fe2304df77","observation_id":"8049206c-03f8-4502-968a-ecef3a0e354f","resolution":{"observed_at":"2026-08-01T17:25:09.626774Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:25:09.770555Z","title":"Liu,H.;Li,C.;Li,Y.;andLee,Y.J.2024a","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.17657","last_updated":"2026-07-20T08:07:22Z","snapshot_observed_at":"2026-08-07T07:38:23.550463Z","submitted_at":"2026-07-20T08:07:22Z","title":"OrientSAM: Mitigating Camera-Centric Shortcut in Multimodal Spatial Reasoning via Orientation-Aware Spatial Alignment","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-01T17:25:09.770555Z"},"links":{"citing_paper":"/paper/2607.17657"},"observation_digest":"sha256:88a27d8b59b9088097c7698f2ddd851200978941b6afd49a97cc7938a00a1648","observation_id":"91615f74-e252-4ec5-91c1-4f5fd73cfea9","resolution":{"observed_at":"2026-08-01T17:25:09.770555Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:25:09.949615Z","title":"In Christodoulopoulos, C.; Chakraborty, T.; Rose, C.; and Peng, V., eds.,Proceedings of the 2025 Conference on Empirical Methods in Natural Language Processing, 26757–26781","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.17657","last_updated":"2026-07-20T08:07:22Z","snapshot_observed_at":"2026-08-07T07:38:23.550463Z","submitted_at":"2026-07-20T08:07:22Z","title":"OrientSAM: Mitigating Camera-Centric Shortcut in Multimodal Spatial Reasoning via Orientation-Aware Spatial Alignment","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-01T17:25:09.949615Z"},"links":{"citing_paper":"/paper/2607.17657"},"observation_digest":"sha256:9b174e812943bbcc067a38e8c041955f274013ed682686ada3538242b4711058","observation_id":"4487cb12-c8f1-4a8d-be0f-d1836dc1c7da","resolution":{"observed_at":"2026-08-01T17:25:09.949615Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-01T17:25:10.174870Z","title":"Rajabi, N.; and Kosecka, J","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.17657","last_updated":"2026-07-20T08:07:22Z","snapshot_observed_at":"2026-08-07T07:38:23.550463Z","submitted_at":"2026-07-20T08:07:22Z","title":"OrientSAM: Mitigating Camera-Centric Shortcut in Multimodal Spatial Reasoning via Orientation-Aware Spatial Alignment","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-01T17:25:10.174870Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2607.17657"},"observation_digest":"sha256:a412a85bf1dae1fe5ff3127cac73b01a5514edb3be8ccde96e3763eff367d368","observation_id":"eb52160c-0a7c-4ba6-92fd-ca15fdeaa829","resolution":{"observed_at":"2026-08-01T17:25:10.174870Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.13246","last_updated":"2024-10-10T22:22:52Z","snapshot_observed_at":"2026-07-06T18:33:28.511600Z","submitted_at":"2024-06-19T06:15:26Z","title":"GSR-BENCH: A Benchmark for Grounded Spatial Reasoning Evaluation via Multimodal LLMs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.13246","snapshot_observed_at":"2026-08-01T17:25:10.364521Z","title":"Shiri, F.; Guo, X.; Far, M.; Yu, X.; Haf, R.; and Li, Y","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.17657","last_updated":"2026-07-20T08:07:22Z","snapshot_observed_at":"2026-08-07T07:38:23.550463Z","submitted_at":"2026-07-20T08:07:22Z","title":"OrientSAM: Mitigating Camera-Centric Shortcut in Multimodal Spatial Reasoning via Orientation-Aware Spatial Alignment","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-01T17:25:10.364521Z"},"links":{"cited_paper":"/paper/2406.13246","citing_paper":"/paper/2607.17657"},"observation_digest":"sha256:ff59d7b292b44ba70a56b17a5cd9deff9e030994e9eefa690ee5a62b12582303","observation_id":"38c0ecac-c0f6-45e4-b746-10468fb2fc2c","resolution":{"observed_at":"2026-08-01T17:25:10.364521Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:25:10.464660Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.17657","last_updated":"2026-07-20T08:07:22Z","snapshot_observed_at":"2026-08-07T07:38:23.550463Z","submitted_at":"2026-07-20T08:07:22Z","title":"OrientSAM: Mitigating Camera-Centric Shortcut in Multimodal Spatial Reasoning via Orientation-Aware Spatial Alignment","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-01T17:25:10.464660Z"},"links":{"citing_paper":"/paper/2607.17657"},"observation_digest":"sha256:c948f8490dc2130fa9c2fbfc739732264818f29e5a9eeec1c10fb54e0cbc1bf0","observation_id":"0a7740ac-eae8-4c99-b56a-60471369688a","resolution":{"observed_at":"2026-08-01T17:25:10.464660Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:25:10.563001Z","title":"InIEEE/CVFConferenceonComputerVisionand Pattern Recognition, CVPR 2025, Nashville, TN, USA, June 11-15, 2025, 15768–15780","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.17657","last_updated":"2026-07-20T08:07:22Z","snapshot_observed_at":"2026-08-07T07:38:23.550463Z","submitted_at":"2026-07-20T08:07:22Z","title":"OrientSAM: Mitigating Camera-Centric Shortcut in Multimodal Spatial Reasoning via Orientation-Aware Spatial Alignment","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-01T17:25:10.563001Z"},"links":{"citing_paper":"/paper/2607.17657"},"observation_digest":"sha256:83db944493ae13078e91ce3c348ab0c28c0928917e045cb098846bcb0c2885df","observation_id":"c2f51754-c81c-4b5a-85b2-546d848b650b","resolution":{"observed_at":"2026-08-01T17:25:10.563001Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.19707","last_updated":"2025-03-25T14:34:06Z","snapshot_observed_at":"2026-08-07T16:38:11.702011Z","submitted_at":"2025-03-25T14:34:06Z","title":"Mind the Gap: Benchmarking Spatial Reasoning in Vision-Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.19707","snapshot_observed_at":"2026-08-01T17:25:10.666535Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.17657","last_updated":"2026-07-20T08:07:22Z","snapshot_observed_at":"2026-08-07T07:38:23.550463Z","submitted_at":"2026-07-20T08:07:22Z","title":"OrientSAM: Mitigating Camera-Centric Shortcut in Multimodal Spatial Reasoning via Orientation-Aware Spatial Alignment","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-01T17:25:10.666535Z"},"links":{"cited_paper":"/paper/2503.19707","citing_paper":"/paper/2607.17657"},"observation_digest":"sha256:aff2c3e788060ff9fb9bf4f839f85d9e8c3046759b0a155119f1fb120d8f2d05","observation_id":"a2f61674-1d1c-4f5f-9868-4bde23c20bfe","resolution":{"observed_at":"2026-08-01T17:25:10.666535Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:25:10.774431Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.17657","last_updated":"2026-07-20T08:07:22Z","snapshot_observed_at":"2026-08-07T07:38:23.550463Z","submitted_at":"2026-07-20T08:07:22Z","title":"OrientSAM: Mitigating Camera-Centric Shortcut in Multimodal Spatial Reasoning via Orientation-Aware Spatial Alignment","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-01T17:25:10.774431Z"},"links":{"citing_paper":"/paper/2607.17657"},"observation_digest":"sha256:273d4ba75d3cdb1c0a4f9820652dd63c0fd089300f51dc4c3e09ed336a70d7ee","observation_id":"05ae453b-0df1-46c9-acdb-12f2a1bd7226","resolution":{"observed_at":"2026-08-01T17:25:10.774431Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:25:10.886557Z","title":"InIEEE/CVF Conference on Computer Vision and Pattern Recognition, CVPR 2025, Nashville, TN, USA, June 11-15, 2025, 10632–10643","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.17657","last_updated":"2026-07-20T08:07:22Z","snapshot_observed_at":"2026-08-07T07:38:23.550463Z","submitted_at":"2026-07-20T08:07:22Z","title":"OrientSAM: Mitigating Camera-Centric Shortcut in Multimodal Spatial Reasoning via Orientation-Aware Spatial Alignment","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-01T17:25:10.886557Z"},"links":{"citing_paper":"/paper/2607.17657"},"observation_digest":"sha256:1b4ae8cdc31664188d67441e27243d4ddb48c06f6fb35f43fb7349690bed7fc6","observation_id":"4ec58ee7-1477-4e61-af17-9b3b2371c9a6","resolution":{"observed_at":"2026-08-01T17:25:10.886557Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:25:11.020656Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.17657","last_updated":"2026-07-20T08:07:22Z","snapshot_observed_at":"2026-08-07T07:38:23.550463Z","submitted_at":"2026-07-20T08:07:22Z","title":"OrientSAM: Mitigating Camera-Centric Shortcut in Multimodal Spatial Reasoning via Orientation-Aware Spatial Alignment","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-01T17:25:11.020656Z"},"links":{"citing_paper":"/paper/2607.17657"},"observation_digest":"sha256:f97c2b3f1a08a4e3f73eba6037572050c61930f947e6ef2f0e1450dd8ea60aa9","observation_id":"b9e21df2-38a0-4ddd-a3d8-d13f53394d14","resolution":{"observed_at":"2026-08-01T17:25:11.020656Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:25:09.052254Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.17657","last_updated":"2026-07-20T08:07:22Z","snapshot_observed_at":"2026-08-07T07:38:23.550463Z","submitted_at":"2026-07-20T08:07:22Z","title":"OrientSAM: Mitigating Camera-Centric Shortcut in Multimodal Spatial Reasoning via Orientation-Aware Spatial Alignment","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-01T17:25:09.052254Z"},"links":{"citing_paper":"/paper/2607.17657"},"observation_digest":"sha256:6adaff08688ff930ff7223fd2d83d2f9f3b512c7359ad5eb632e2629b91f2592","observation_id":"c4307d45-4845-4a9a-a639-4a50ab4cd1f8","resolution":{"observed_at":"2026-08-01T17:25:09.052254Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:25:08.394847Z","title":"In IEEE/CVF Conference on Computer Vision and Pattern Recognition, CVPR 2024, Seattle, WA, USA, June 16-22, 2024, 14455–14465","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.17657","last_updated":"2026-07-20T08:07:22Z","snapshot_observed_at":"2026-08-07T07:38:23.550463Z","submitted_at":"2026-07-20T08:07:22Z","title":"OrientSAM: Mitigating Camera-Centric Shortcut in Multimodal Spatial Reasoning via Orientation-Aware Spatial Alignment","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-01T17:25:08.394847Z"},"links":{"citing_paper":"/paper/2607.17657"},"observation_digest":"sha256:712c5ac3438259710ff02239b5d9354e64e2ba996ba1b1447896e678494212e2","observation_id":"4a99e4ee-9075-4c76-a270-34a11058ad3b","resolution":{"observed_at":"2026-08-01T17:25:08.394847Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:25:08.501734Z","title":"Cheng, A.; Fu, Y.; Chen, Y.; Liu, Z.; Li, X.; Radhakrishnan, S.;Han,S.;Lu,Y.;Kautz,J.;Molchanov,P.;Yin,H.;Wang, X.; and Liu, S","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.17657","last_updated":"2026-07-20T08:07:22Z","snapshot_observed_at":"2026-08-07T07:38:23.550463Z","submitted_at":"2026-07-20T08:07:22Z","title":"OrientSAM: Mitigating Camera-Centric Shortcut in Multimodal Spatial Reasoning via Orientation-Aware Spatial Alignment","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-01T17:25:08.501734Z"},"links":{"citing_paper":"/paper/2607.17657"},"observation_digest":"sha256:19ce6f748ace825a95af75b3bbe609862ad2e3614168568152502e73e2f97908","observation_id":"0b4ef19f-bc0e-446d-829c-050b25af6be7","resolution":{"observed_at":"2026-08-01T17:25:08.501734Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T17:25:09.394851Z","title":"CoRR, abs/2601.16378","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.17657","last_updated":"2026-07-20T08:07:22Z","snapshot_observed_at":"2026-08-07T07:38:23.550463Z","submitted_at":"2026-07-20T08:07:22Z","title":"OrientSAM: Mitigating Camera-Centric Shortcut in Multimodal Spatial Reasoning via Orientation-Aware Spatial Alignment","version":1},"reference_index":2026,"source":"pdf_text","source_observed_at":"2026-08-01T17:25:09.394851Z"},"links":{"citing_paper":"/paper/2607.17657"},"observation_digest":"sha256:eb7360598e0aca386ce1b9cd90d16c54f9782aba5a6237b09dd980693ba9cbfe","observation_id":"ea456581-0fa1-4586-9475-ff8763e8e377","resolution":{"observed_at":"2026-08-01T17:25:09.394851Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.17657","last_updated":"2026-07-20T08:07:22Z","latest_version":1,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-07T07:38:23.550463Z","submitted_at":"2026-07-20T08:07:22Z","title":"OrientSAM: Mitigating Camera-Centric Shortcut in Multimodal Spatial Reasoning via Orientation-Aware Spatial Alignment"},"reference_resolution":{"displayed":20,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":20,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":20},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 20 of 20 outbound references and 0 inbound Pith citation observations for arXiv:2607.17657."}