{"as_of":"2026-08-23T17:01:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:415445d3c0f6f1cd939c6de9b09c6a5dccc724afb1013d3f1d71dc9f6eeb2a01","coverage":[{"denominator":69,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":69,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T14:53:37.087686Z","state":"measured"},{"denominator":69,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":69,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-23T06:30:58.430688+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2412.11540/citation-record","integrity":"/paper/2412.11540/integrity","json":"/paper/2412.11540/citation-record.json","paper":"/paper/2412.11540"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:53:41.153135Z","title":"3d semantic parsing of large-scale indoor spaces","venue":null,"work_id":"89c5071c-d110-4aea-9e3d-b739eea911eb","year":2016},"citing_paper":{"arxiv_id":"2412.11540","last_updated":"2025-07-11T10:38:22Z","snapshot_observed_at":"2026-08-20T10:49:17.790529Z","submitted_at":"2024-12-16T08:21:09Z","title":"SP$^2$T: Sparse Proxy Attention for Dual-stream Point Transformer","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-11T14:53:35.119756Z"},"links":{"citing_paper":"/paper/2412.11540"},"observation_digest":"sha256:3b2c3fdd89c74c5cb3dd636b8a41cd7ec23ef8237a25a10a64116619f331687c","observation_id":"ebc8c32c-c30c-4850-adc2-48ec6921aacb","resolution":{"observed_at":"2026-08-11T14:53:41.182592Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:53:41.130862Z","title":"Semantickitti: A dataset for semantic scene understanding of lidar sequences","venue":null,"work_id":"dcb7a757-4c16-49bc-ab89-df8275f6397e","year":2019},"citing_paper":{"arxiv_id":"2412.11540","last_updated":"2025-07-11T10:38:22Z","snapshot_observed_at":"2026-08-20T10:49:17.790529Z","submitted_at":"2024-12-16T08:21:09Z","title":"SP$^2$T: Sparse Proxy Attention for Dual-stream Point Transformer","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-11T14:53:35.126419Z"},"links":{"citing_paper":"/paper/2412.11540"},"observation_digest":"sha256:29958f10b9145919e5e301919601b1b332e766ae1c430612b53a387f0e8ad2f5","observation_id":"5754c291-7c3a-418c-b5bd-81fa1f456452","resolution":{"observed_at":"2026-08-11T14:53:41.138864Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:53:41.108023Z","title":"The lov ´asz-softmax loss: A tractable surrogate for the optimization of the intersection-over-union measure in neural networks","venue":null,"work_id":"d49b63f2-016e-47b8-bfe3-12f24b31ffba","year":null},"citing_paper":{"arxiv_id":"2412.11540","last_updated":"2025-07-11T10:38:22Z","snapshot_observed_at":"2026-08-20T10:49:17.790529Z","submitted_at":"2024-12-16T08:21:09Z","title":"SP$^2$T: Sparse Proxy Attention for Dual-stream Point Transformer","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-11T14:53:35.132123Z"},"links":{"citing_paper":"/paper/2412.11540"},"observation_digest":"sha256:de957946bee551f02ebdafd83222d0f80e16a56626d127fd505a591e5ae7b643","observation_id":"0916ed4f-8ccd-4f4a-a69a-696974d71b50","resolution":{"observed_at":"2026-08-11T14:53:41.114801Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:53:41.083742Z","title":"nuscenes: A multi- modal dataset for autonomous driving","venue":null,"work_id":"f5b09d43-c74f-4a0c-a26c-2b6ce2d20d71","year":2020},"citing_paper":{"arxiv_id":"2412.11540","last_updated":"2025-07-11T10:38:22Z","snapshot_observed_at":"2026-08-20T10:49:17.790529Z","submitted_at":"2024-12-16T08:21:09Z","title":"SP$^2$T: Sparse Proxy Attention for Dual-stream Point Transformer","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-11T14:53:35.153475Z"},"links":{"citing_paper":"/paper/2412.11540"},"observation_digest":"sha256:c597041089f6dd83c45a7dabe3c42dccdd7d36b7230fdee064846a2ec602e252","observation_id":"9b6047df-b8f3-45a2-909a-684889845c16","resolution":{"observed_at":"2026-08-11T14:53:41.093042Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:53:41.056993Z","title":"Multi-view 3d object detection network for autonomous driv- ing","venue":null,"work_id":"db59beed-3c98-48f1-bf87-9b3d55f36b35","year":1907},"citing_paper":{"arxiv_id":"2412.11540","last_updated":"2025-07-11T10:38:22Z","snapshot_observed_at":"2026-08-20T10:49:17.790529Z","submitted_at":"2024-12-16T08:21:09Z","title":"SP$^2$T: Sparse Proxy Attention for Dual-stream Point Transformer","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-11T14:53:35.233806Z"},"links":{"citing_paper":"/paper/2412.11540"},"observation_digest":"sha256:0e028ee73ac4af8cbd24a61a09b95490a9198a17db3ce7ebfd189f6076f51298","observation_id":"333daa3a-9db7-4bc0-b6ec-7a5e5ca41e6c","resolution":{"observed_at":"2026-08-11T14:53:41.064069Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:53:40.942059Z","title":"Mobile-former: Bridging mobilenet and transformer","venue":null,"work_id":"5430ce9e-4811-4277-b0b6-7068bd09cb4b","year":2022},"citing_paper":{"arxiv_id":"2412.11540","last_updated":"2025-07-11T10:38:22Z","snapshot_observed_at":"2026-08-20T10:49:17.790529Z","submitted_at":"2024-12-16T08:21:09Z","title":"SP$^2$T: Sparse Proxy Attention for Dual-stream Point Transformer","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-11T14:53:35.363264Z"},"links":{"citing_paper":"/paper/2412.11540"},"observation_digest":"sha256:f30a294a3db2a989dcf5a4b60136b1653f7b942ab824c31a927344da4c9d2e33","observation_id":"e3c97b1d-354d-4935-8923-df7958434e78","resolution":{"observed_at":"2026-08-11T14:53:41.018991Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:53:40.797816Z","title":"V oxelnext: Fully sparse voxelnet for 3d object detection and tracking","venue":null,"work_id":"8d77c341-f5b4-4eca-afd3-68c6fa63418f","year":2023},"citing_paper":{"arxiv_id":"2412.11540","last_updated":"2025-07-11T10:38:22Z","snapshot_observed_at":"2026-08-20T10:49:17.790529Z","submitted_at":"2024-12-16T08:21:09Z","title":"SP$^2$T: Sparse Proxy Attention for Dual-stream Point Transformer","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-11T14:53:35.459811Z"},"links":{"citing_paper":"/paper/2412.11540"},"observation_digest":"sha256:f3cdb944519b87e8c280b4743a3e5a5a4b9f7180517b44206d01ccf0a8d6a956","observation_id":"4f4dd876-66b2-461b-acb8-dd149127e9de","resolution":{"observed_at":"2026-08-11T14:53:40.881126Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:53:40.775798Z","title":"2-s3net: Attentive feature fusion with adaptive feature selection for sparse semantic segmentation network","venue":null,"work_id":"1232a551-60d6-49cb-b7ef-1ac1908b7ba3","year":2021},"citing_paper":{"arxiv_id":"2412.11540","last_updated":"2025-07-11T10:38:22Z","snapshot_observed_at":"2026-08-20T10:49:17.790529Z","submitted_at":"2024-12-16T08:21:09Z","title":"SP$^2$T: Sparse Proxy Attention for Dual-stream Point Transformer","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-11T14:53:35.509348Z"},"links":{"citing_paper":"/paper/2412.11540"},"observation_digest":"sha256:51b8a3d74b951fb14acf36ea65c9764e0afe901c939663086faf1e976d0d5cd2","observation_id":"3bdbf254-a98e-40be-a689-e14690678491","resolution":{"observed_at":"2026-08-11T14:53:40.782283Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:53:35.516615Z","title":"4d spatio-temporal convnets: Minkowski convolutional neural networks","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.11540","last_updated":"2025-07-11T10:38:22Z","snapshot_observed_at":"2026-08-20T10:49:17.790529Z","submitted_at":"2024-12-16T08:21:09Z","title":"SP$^2$T: Sparse Proxy Attention for Dual-stream Point Transformer","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-11T14:53:35.516615Z"},"links":{"citing_paper":"/paper/2412.11540"},"observation_digest":"sha256:ae7d79527bff2470ac02fd6e9a40e68a0857aa4b621b74c6c1abd0d8c9c3c555","observation_id":"03cb0b27-57c8-4c36-9898-5e03e5b9279d","resolution":{"observed_at":"2026-08-11T14:53:35.516615Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:53:40.737793Z","title":"Pointcept: A codebase for point cloud perception research","venue":null,"work_id":"6eeb2ac5-0e39-41b2-ac93-db7e1903dd3a","year":2023},"citing_paper":{"arxiv_id":"2412.11540","last_updated":"2025-07-11T10:38:22Z","snapshot_observed_at":"2026-08-20T10:49:17.790529Z","submitted_at":"2024-12-16T08:21:09Z","title":"SP$^2$T: Sparse Proxy Attention for Dual-stream Point Transformer","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-11T14:53:35.525372Z"},"links":{"citing_paper":"/paper/2412.11540"},"observation_digest":"sha256:d9af7cc9910717679ddb3b9ddd2c1bb38d39357f655034bb254b002f6e1ceac4","observation_id":"73313cda-adbb-40f2-8064-617fc0c7bc84","resolution":{"observed_at":"2026-08-11T14:53:40.745016Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:53:40.710595Z","title":"Scannet: Richly-annotated 3d reconstructions of indoor scenes","venue":null,"work_id":"9283382f-2700-4b8d-857c-f53b879bfa3c","year":2017},"citing_paper":{"arxiv_id":"2412.11540","last_updated":"2025-07-11T10:38:22Z","snapshot_observed_at":"2026-08-20T10:49:17.790529Z","submitted_at":"2024-12-16T08:21:09Z","title":"SP$^2$T: Sparse Proxy Attention for Dual-stream Point Transformer","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-11T14:53:35.531784Z"},"links":{"citing_paper":"/paper/2412.11540"},"observation_digest":"sha256:c907d39aca28a2f4a9748f5e6252dd63b40b736ef3206328fe95f7ee4432feee","observation_id":"daf6abae-a30a-443e-b0ec-47082f8fd0b3","resolution":{"observed_at":"2026-08-11T14:53:40.717929Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.16588","last_updated":"2024-04-12T09:38:33Z","snapshot_observed_at":"2026-08-07T09:40:32.614733Z","submitted_at":"2023-09-28T16:45:46Z","title":"Vision Transformers Need Registers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.16588","snapshot_observed_at":"2026-08-11T14:53:35.537696Z","title":"Vision transformers need registers","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.11540","last_updated":"2025-07-11T10:38:22Z","snapshot_observed_at":"2026-08-20T10:49:17.790529Z","submitted_at":"2024-12-16T08:21:09Z","title":"SP$^2$T: Sparse Proxy Attention for Dual-stream Point Transformer","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-11T14:53:35.537696Z"},"links":{"cited_paper":"/paper/2309.16588","citing_paper":"/paper/2412.11540"},"observation_digest":"sha256:b63ff1508a7a03d2346861123c1871c5108f887ea95082c0afeb4fe0e4ffdf02","observation_id":"89bb9a01-45d8-44b4-9d09-31c05e036830","resolution":{"observed_at":"2026-08-11T14:53:35.537696Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:53:40.688826Z","title":"Em- bracing single stride 3d object detector with sparse trans- former","venue":null,"work_id":"3a039e90-301c-4227-bb58-0b8cc798a723","year":2022},"citing_paper":{"arxiv_id":"2412.11540","last_updated":"2025-07-11T10:38:22Z","snapshot_observed_at":"2026-08-20T10:49:17.790529Z","submitted_at":"2024-12-16T08:21:09Z","title":"SP$^2$T: Sparse Proxy Attention for Dual-stream Point Transformer","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-11T14:53:35.543843Z"},"links":{"citing_paper":"/paper/2412.11540"},"observation_digest":"sha256:c3e0fde8c3f7436631fa845b455d514905bf86c33c3bbb17c588d7bfb7570be3","observation_id":"ffcf564e-c854-49a8-90ee-9be57e793e6c","resolution":{"observed_at":"2026-08-11T14:53:40.695362Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:53:40.655335Z","title":"Efficient graph-based image segmentation","venue":null,"work_id":"6e20b6d9-ec33-42ab-88e5-d9a3957ae4b3","year":2004},"citing_paper":{"arxiv_id":"2412.11540","last_updated":"2025-07-11T10:38:22Z","snapshot_observed_at":"2026-08-20T10:49:17.790529Z","submitted_at":"2024-12-16T08:21:09Z","title":"SP$^2$T: Sparse Proxy Attention for Dual-stream Point Transformer","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-11T14:53:35.551599Z"},"links":{"citing_paper":"/paper/2412.11540"},"observation_digest":"sha256:952b7b73bdf35eb72b9445cf44472fc4fa13421e8404eb3e034a0fb67009be6d","observation_id":"c214f45d-618e-4fdd-8e92-ca51c7dd8bea","resolution":{"observed_at":"2026-08-11T14:53:40.674064Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.08874","last_updated":"2024-07-15T09:42:48Z","snapshot_observed_at":"2026-08-16T14:34:42.160375Z","submitted_at":"2023-12-14T16:26:29Z","title":"Agent Attention: On the Integration of Softmax and Linear Attention","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.08874","snapshot_observed_at":"2026-08-11T14:53:35.558242Z","title":"Agent attention: On the integration of softmax and linear attention","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.11540","last_updated":"2025-07-11T10:38:22Z","snapshot_observed_at":"2026-08-20T10:49:17.790529Z","submitted_at":"2024-12-16T08:21:09Z","title":"SP$^2$T: Sparse Proxy Attention for Dual-stream Point Transformer","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-11T14:53:35.558242Z"},"links":{"cited_paper":"/paper/2312.08874","citing_paper":"/paper/2412.11540"},"observation_digest":"sha256:f3d499eac04a36927552b7c4ffc876f1cb42786f503ab272ae53b8a31dbd38b1","observation_id":"d0c723b0-d400-4812-aba7-18b736144a1c","resolution":{"observed_at":"2026-08-11T14:53:35.558242Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:53:40.502014Z","title":"A survey on vision transformer","venue":null,"work_id":"b812dda8-0630-4aeb-94a5-bfd5ceb8675d","year":2022},"citing_paper":{"arxiv_id":"2412.11540","last_updated":"2025-07-11T10:38:22Z","snapshot_observed_at":"2026-08-20T10:49:17.790529Z","submitted_at":"2024-12-16T08:21:09Z","title":"SP$^2$T: Sparse Proxy Attention for Dual-stream Point Transformer","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-11T14:53:35.564061Z"},"links":{"citing_paper":"/paper/2412.11540"},"observation_digest":"sha256:fee9712d77ff9c6436c26f3c996c5cf5d3a836fd91d3c9bae9f13557f679d43e","observation_id":"bcc91051-417f-4076-9293-8dfe911867fe","resolution":{"observed_at":"2026-08-11T14:53:40.524528Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:53:40.475558Z","title":"Mapdistill: Boosting efficient camera-based hd map construction via camera-lidar fusion model distillation","venue":null,"work_id":"2c6bf24f-3d21-45ac-9c53-3f672dbe137e","year":2024},"citing_paper":{"arxiv_id":"2412.11540","last_updated":"2025-07-11T10:38:22Z","snapshot_observed_at":"2026-08-20T10:49:17.790529Z","submitted_at":"2024-12-16T08:21:09Z","title":"SP$^2$T: Sparse Proxy Attention for Dual-stream Point Transformer","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-11T14:53:35.569262Z"},"links":{"citing_paper":"/paper/2412.11540"},"observation_digest":"sha256:36a1cfe3fd8967fa3692952759d9f65d3e2be0f9de0875b2afdd697c223052ac","observation_id":"ca474e66-8412-4ca4-9d1f-b9a411f6dd03","resolution":{"observed_at":"2026-08-11T14:53:40.486585Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.00912","last_updated":"2024-07-18T06:02:45Z","snapshot_observed_at":"2026-08-16T14:30:33.219782Z","submitted_at":"2024-01-01T02:29:59Z","title":"ScatterFormer: Efficient Voxel Transformer with Scattered Linear Attention","version":2},"cited_work":{"arxiv_id":"2401.00912","doi":null,"metadata_source":"pith","pith_arxiv_id":"2401.00912","snapshot_observed_at":"2026-08-11T14:53:37.306654Z","title":"ScatterFormer: Efficient Voxel Transformer with Scattered Linear Attention","venue":"cs.CV","work_id":"789f8827-08e7-40ac-ab0a-e0f61d12eeed","year":2024},"citing_paper":{"arxiv_id":"2412.11540","last_updated":"2025-07-11T10:38:22Z","snapshot_observed_at":"2026-08-20T10:49:17.790529Z","submitted_at":"2024-12-16T08:21:09Z","title":"SP$^2$T: Sparse Proxy Attention for Dual-stream Point Transformer","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-11T14:53:35.575919Z"},"links":{"cited_paper":"/paper/2401.00912","citing_paper":"/paper/2412.11540"},"observation_digest":"sha256:890f97ab8e5879898d482b0813d1b9c0144c2d5945dfed0caec5875ab345dc14","observation_id":"812c8c26-ec63-47b3-a2e1-487b4f62e3ae","resolution":{"observed_at":"2026-08-11T14:53:37.408749Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:53:40.448718Z","title":"Vision transformer with super token sampling","venue":null,"work_id":"93a35bad-dedd-4ca8-aa93-95441583c847","year":2023},"citing_paper":{"arxiv_id":"2412.11540","last_updated":"2025-07-11T10:38:22Z","snapshot_observed_at":"2026-08-20T10:49:17.790529Z","submitted_at":"2024-12-16T08:21:09Z","title":"SP$^2$T: Sparse Proxy Attention for Dual-stream Point Transformer","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-11T14:53:35.581272Z"},"links":{"citing_paper":"/paper/2412.11540"},"observation_digest":"sha256:c78cfffbb437902849f1fe28e96561d5ab9ca20ddbb6dd2f7ca6063e6bf12cad","observation_id":"ce6d129b-78d9-4330-b58a-4f4c944538a8","resolution":{"observed_at":"2026-08-11T14:53:40.456243Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2107.14795","last_updated":"2022-03-15T22:37:19Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-07-30T17:53:34Z","title":"Perceiver IO: A General Architecture for Structured Inputs & Outputs","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2107.14795","snapshot_observed_at":"2026-08-11T14:53:35.586968Z","title":"Perceiver io: A general architecture for structured inputs & outputs","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.11540","last_updated":"2025-07-11T10:38:22Z","snapshot_observed_at":"2026-08-20T10:49:17.790529Z","submitted_at":"2024-12-16T08:21:09Z","title":"SP$^2$T: Sparse Proxy Attention for Dual-stream Point Transformer","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-11T14:53:35.586968Z"},"links":{"cited_paper":"/paper/2107.14795","citing_paper":"/paper/2412.11540"},"observation_digest":"sha256:b06340d5c8f07925b0a513616e2eaf005a950dcc7a52beb495af67a150b5a73b","observation_id":"fbfb5c18-cc43-4cf5-8997-0578de24ae1f","resolution":{"observed_at":"2026-08-11T14:53:35.586968Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:53:40.416938Z","title":"Perceiver: General perception with iterative attention","venue":null,"work_id":"fd462f91-1e0f-4a10-b917-de2457d7178b","year":2021},"citing_paper":{"arxiv_id":"2412.11540","last_updated":"2025-07-11T10:38:22Z","snapshot_observed_at":"2026-08-20T10:49:17.790529Z","submitted_at":"2024-12-16T08:21:09Z","title":"SP$^2$T: Sparse Proxy Attention for Dual-stream Point Transformer","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-11T14:53:35.647431Z"},"links":{"citing_paper":"/paper/2412.11540"},"observation_digest":"sha256:ce671366ba04835c76af6346e668fb2601c625279827caf6f75a6326f140e3b1","observation_id":"f3171ee3-1fcc-42c1-8f75-4d2fc603a0fd","resolution":{"observed_at":"2026-08-11T14:53:40.423977Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:53:40.318842Z","title":"Pointgroup: Dual-set point group- ing for 3d instance segmentation","venue":null,"work_id":"bc9b5f52-0845-4df4-b28c-e07e00f47744","year":2020},"citing_paper":{"arxiv_id":"2412.11540","last_updated":"2025-07-11T10:38:22Z","snapshot_observed_at":"2026-08-20T10:49:17.790529Z","submitted_at":"2024-12-16T08:21:09Z","title":"SP$^2$T: Sparse Proxy Attention for Dual-stream Point Transformer","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-11T14:53:35.749503Z"},"links":{"citing_paper":"/paper/2412.11540"},"observation_digest":"sha256:aee3fea97a52e76c1004045c0a58bece28362bc0af0ac1e219b527e4b43ba520","observation_id":"4ee5ee19-deec-435b-8839-21bb90349064","resolution":{"observed_at":"2026-08-11T14:53:40.397777Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:53:40.107941Z","title":"Transformers in vision: A survey","venue":null,"work_id":"4518189b-b3d1-4480-a6ea-4c318a9db457","year":2022},"citing_paper":{"arxiv_id":"2412.11540","last_updated":"2025-07-11T10:38:22Z","snapshot_observed_at":"2026-08-20T10:49:17.790529Z","submitted_at":"2024-12-16T08:21:09Z","title":"SP$^2$T: Sparse Proxy Attention for Dual-stream Point Transformer","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-11T14:53:35.909816Z"},"links":{"citing_paper":"/paper/2412.11540"},"observation_digest":"sha256:29fccf1d329a217ab182b9f02fff9ee6c1d230857eccc8590df15daf5d941afb","observation_id":"3a5e8ae4-3027-40e1-8062-515a0c7f28f5","resolution":{"observed_at":"2026-08-11T14:53:40.232291Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:53:40.009844Z","title":"Stratified trans- former for 3d point cloud segmentation","venue":null,"work_id":"4b6ff7b5-bdc7-4351-bd67-069a3783018a","year":2022},"citing_paper":{"arxiv_id":"2412.11540","last_updated":"2025-07-11T10:38:22Z","snapshot_observed_at":"2026-08-20T10:49:17.790529Z","submitted_at":"2024-12-16T08:21:09Z","title":"SP$^2$T: Sparse Proxy Attention for Dual-stream Point Transformer","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-11T14:53:35.976427Z"},"links":{"citing_paper":"/paper/2412.11540"},"observation_digest":"sha256:81bd1b7d307cfdea7476c0a1b654870baa7b5a16b5a3a6d50d270af5b611535a","observation_id":"7b7ab77f-5129-48b0-9d60-904404ea0856","resolution":{"observed_at":"2026-08-11T14:53:40.015288Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:53:39.990287Z","title":"Spherical transformer for lidar-based 3d recognition","venue":null,"work_id":"de168d7a-9e42-499e-90e2-f289810d72db","year":2023},"citing_paper":{"arxiv_id":"2412.11540","last_updated":"2025-07-11T10:38:22Z","snapshot_observed_at":"2026-08-20T10:49:17.790529Z","submitted_at":"2024-12-16T08:21:09Z","title":"SP$^2$T: Sparse Proxy Attention for Dual-stream Point Transformer","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-11T14:53:35.982876Z"},"links":{"citing_paper":"/paper/2412.11540"},"observation_digest":"sha256:e618e66fb5fcc6e8adfcede970d20c553fa83b86ff366fc3bb9dc0e25f007fd0","observation_id":"92e7a3b7-e215-457b-8c0a-edbd7b215fa4","resolution":{"observed_at":"2026-08-11T14:53:39.996625Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:53:35.989184Z","title":"Pointpillars: Fast encoders for object detection from point clouds","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2412.11540","last_updated":"2025-07-11T10:38:22Z","snapshot_observed_at":"2026-08-20T10:49:17.790529Z","submitted_at":"2024-12-16T08:21:09Z","title":"SP$^2$T: Sparse Proxy Attention for Dual-stream Point Transformer","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-11T14:53:35.989184Z"},"links":{"citing_paper":"/paper/2412.11540"},"observation_digest":"sha256:cf5c5edf3d595b7dded27912aaa1c790cec2011af84bb01f5445398d3419968c","observation_id":"1daaa595-4a64-4ed7-bb42-323e499f81ca","resolution":{"observed_at":"2026-08-11T14:53:35.989184Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:53:39.954841Z","title":"Set transformer: A frame- work for attention-based permutation-invariant neural net- works","venue":null,"work_id":"ab24ef64-a3d1-4567-bd4f-812256dde9ff","year":2019},"citing_paper":{"arxiv_id":"2412.11540","last_updated":"2025-07-11T10:38:22Z","snapshot_observed_at":"2026-08-20T10:49:17.790529Z","submitted_at":"2024-12-16T08:21:09Z","title":"SP$^2$T: Sparse Proxy Attention for Dual-stream Point Transformer","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-11T14:53:35.995053Z"},"links":{"citing_paper":"/paper/2412.11540"},"observation_digest":"sha256:a6c3f6268f42a3febce383f2c082ded00936bda9b46f5079bfe6835a1b8c2966","observation_id":"e9f83792-065e-4db2-8f80-c8d20d2f084b","resolution":{"observed_at":"2026-08-11T14:53:39.961791Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1608.07916","last_updated":"2016-08-29T05:57:36Z","snapshot_observed_at":"2026-08-14T21:42:26.871054Z","submitted_at":"2016-08-29T05:57:36Z","title":"Vehicle Detection from 3D Lidar Using Fully Convolutional Network","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1608.07916","snapshot_observed_at":"2026-08-11T14:53:36.001949Z","title":"Vehicle detection from 3d lidar using fully convolutional network","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2412.11540","last_updated":"2025-07-11T10:38:22Z","snapshot_observed_at":"2026-08-20T10:49:17.790529Z","submitted_at":"2024-12-16T08:21:09Z","title":"SP$^2$T: Sparse Proxy Attention for Dual-stream Point Transformer","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-11T14:53:36.001949Z"},"links":{"cited_paper":"/paper/1608.07916","citing_paper":"/paper/2412.11540"},"observation_digest":"sha256:c276b939fda98b571fcbf90053724de32316c44ffc052ca64e6a39af3996ff3b","observation_id":"08113e38-14c8-42c7-90e2-f94a4bc04303","resolution":{"observed_at":"2026-08-11T14:53:36.001949Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:53:39.933190Z","title":"E-mlp: Effortless online hd map construction with linear priors","venue":null,"work_id":"9a1a30fe-b65e-4ff9-b409-02630293f409","year":2024},"citing_paper":{"arxiv_id":"2412.11540","last_updated":"2025-07-11T10:38:22Z","snapshot_observed_at":"2026-08-20T10:49:17.790529Z","submitted_at":"2024-12-16T08:21:09Z","title":"SP$^2$T: Sparse Proxy Attention for Dual-stream Point Transformer","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-11T14:53:36.008631Z"},"links":{"citing_paper":"/paper/2412.11540"},"observation_digest":"sha256:58578246b4bb989541946175bfb42c4c717d92d57d28c73278eb3bc3dc04c16f","observation_id":"5cc9c972-6718-47e9-b2e0-cafb95459f6b","resolution":{"observed_at":"2026-08-11T14:53:39.938931Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:53:39.915413Z","title":"Meta architecture for point cloud analysis","venue":null,"work_id":"8f1d747d-3432-4cb5-ae8e-0d89fa9c6eea","year":2023},"citing_paper":{"arxiv_id":"2412.11540","last_updated":"2025-07-11T10:38:22Z","snapshot_observed_at":"2026-08-20T10:49:17.790529Z","submitted_at":"2024-12-16T08:21:09Z","title":"SP$^2$T: Sparse Proxy Attention for Dual-stream Point Transformer","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-11T14:53:36.015521Z"},"links":{"citing_paper":"/paper/2412.11540"},"observation_digest":"sha256:ae41c041380537432194048951ea8b71290a9f61ad0f925b93cc59e24b55d8bb","observation_id":"224c9cab-57be-4caa-b6ce-ce741d8d2781","resolution":{"observed_at":"2026-08-11T14:53:39.920519Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:53:39.896829Z","title":"Swin transformer: Hierarchical vision transformer using shifted windows","venue":null,"work_id":"11af9522-991a-4ad4-a799-f1de8782db72","year":2021},"citing_paper":{"arxiv_id":"2412.11540","last_updated":"2025-07-11T10:38:22Z","snapshot_observed_at":"2026-08-20T10:49:17.790529Z","submitted_at":"2024-12-16T08:21:09Z","title":"SP$^2$T: Sparse Proxy Attention for Dual-stream Point Transformer","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-11T14:53:36.023659Z"},"links":{"citing_paper":"/paper/2412.11540"},"observation_digest":"sha256:e712a2e0fca0ecc066211bc6adca83bfb57cb3058026cc69c175bfe433b6f9d8","observation_id":"77c90574-4246-45bd-adeb-6b88e0abfd2a","resolution":{"observed_at":"2026-08-11T14:53:39.903244Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:53:39.877893Z","title":"Swin transformer v2: Scaling up capacity and resolution","venue":null,"work_id":"0e5da5fb-aeca-481c-a089-a1bc91e3dde1","year":2022},"citing_paper":{"arxiv_id":"2412.11540","last_updated":"2025-07-11T10:38:22Z","snapshot_observed_at":"2026-08-20T10:49:17.790529Z","submitted_at":"2024-12-16T08:21:09Z","title":"SP$^2$T: Sparse Proxy Attention for Dual-stream Point Transformer","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-11T14:53:36.031305Z"},"links":{"citing_paper":"/paper/2412.11540"},"observation_digest":"sha256:1ae95a8911c3bb9e546d10e4f8fc484afbec2aa6c45b77c4e619f64f69378323","observation_id":"5e9e06b6-b4a6-4616-81fc-63fd592ea265","resolution":{"observed_at":"2026-08-11T14:53:39.884166Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:53:39.788849Z","title":"Uedg: uncertainty-edge dual guided camou- flage object detection","venue":null,"work_id":"8f02fdae-e8c3-4a9a-bdd7-ad84523ba51e","year":2023},"citing_paper":{"arxiv_id":"2412.11540","last_updated":"2025-07-11T10:38:22Z","snapshot_observed_at":"2026-08-20T10:49:17.790529Z","submitted_at":"2024-12-16T08:21:09Z","title":"SP$^2$T: Sparse Proxy Attention for Dual-stream Point Transformer","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-11T14:53:36.038297Z"},"links":{"citing_paper":"/paper/2412.11540"},"observation_digest":"sha256:0c47e5e19e4e91231efe745f362b654fdfa4106ea82d73fa32671986db3fbd2a","observation_id":"e809885e-8805-4f24-bd81-055cbfe46256","resolution":{"observed_at":"2026-08-11T14:53:39.855899Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:53:39.737602Z","title":"Dual- stream network for visual recognition","venue":null,"work_id":"80e8a0b0-b4fb-4148-bbd4-04dad0c56f87","year":2021},"citing_paper":{"arxiv_id":"2412.11540","last_updated":"2025-07-11T10:38:22Z","snapshot_observed_at":"2026-08-20T10:49:17.790529Z","submitted_at":"2024-12-16T08:21:09Z","title":"SP$^2$T: Sparse Proxy Attention for Dual-stream Point Transformer","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-11T14:53:36.044524Z"},"links":{"citing_paper":"/paper/2412.11540"},"observation_digest":"sha256:8145ce029d62f9ea1f2fb396a8fb44888fea2dd5bfcdabc00b550cdb76446248","observation_id":"0feb94d5-f5b6-4085-8440-8ab1a5846553","resolution":{"observed_at":"2026-08-11T14:53:39.745374Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:53:39.716261Z","title":"V oxnet: A 3d convo- lutional neural network for real-time object recognition","venue":null,"work_id":"09df91be-af35-443f-bf70-bead75cba581","year":2015},"citing_paper":{"arxiv_id":"2412.11540","last_updated":"2025-07-11T10:38:22Z","snapshot_observed_at":"2026-08-20T10:49:17.790529Z","submitted_at":"2024-12-16T08:21:09Z","title":"SP$^2$T: Sparse Proxy Attention for Dual-stream Point Transformer","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-11T14:53:36.050600Z"},"links":{"citing_paper":"/paper/2412.11540"},"observation_digest":"sha256:ec483eb8c1717d68f4ab4b3525ccdd6859014cbaedb8d414da441b31ec94abc2","observation_id":"a4966d4a-5fe6-4c8e-a197-96b32c9ad3ff","resolution":{"observed_at":"2026-08-11T14:53:39.723718Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:53:39.695139Z","title":"Mix3d: Out-of-context data augmenta- tion for 3d scenes","venue":null,"work_id":"cb79e933-f31c-4209-a175-2d4a2c359ccb","year":2021},"citing_paper":{"arxiv_id":"2412.11540","last_updated":"2025-07-11T10:38:22Z","snapshot_observed_at":"2026-08-20T10:49:17.790529Z","submitted_at":"2024-12-16T08:21:09Z","title":"SP$^2$T: Sparse Proxy Attention for Dual-stream Point Transformer","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-11T14:53:36.057291Z"},"links":{"citing_paper":"/paper/2412.11540"},"observation_digest":"sha256:7c9bb85f18e1732ed32bb84b201fbd58628860ab18cd6608f04500c0f9bbe8f5","observation_id":"bc5c8c6e-7343-4535-a43c-74bf49a235b4","resolution":{"observed_at":"2026-08-11T14:53:39.702678Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:53:39.675116Z","title":"Fast point transformer","venue":null,"work_id":"95e51c61-dcd4-4582-9e7a-f715c7e3676e","year":2022},"citing_paper":{"arxiv_id":"2412.11540","last_updated":"2025-07-11T10:38:22Z","snapshot_observed_at":"2026-08-20T10:49:17.790529Z","submitted_at":"2024-12-16T08:21:09Z","title":"SP$^2$T: Sparse Proxy Attention for Dual-stream Point Transformer","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-11T14:53:36.062567Z"},"links":{"citing_paper":"/paper/2412.11540"},"observation_digest":"sha256:3d4a0ddc9146dbd3d7f6bc85563a7ea856cb8b1485ac34fb1e2bcb7c1efb2036","observation_id":"68750aa9-8d4c-4a7c-83ba-9cd0143680fd","resolution":{"observed_at":"2026-08-11T14:53:39.681237Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:53:39.632019Z","title":"Self-positioning point-based transformer for point cloud understanding","venue":null,"work_id":"64048e99-6763-4d86-98a7-8db2ada35aed","year":2023},"citing_paper":{"arxiv_id":"2412.11540","last_updated":"2025-07-11T10:38:22Z","snapshot_observed_at":"2026-08-20T10:49:17.790529Z","submitted_at":"2024-12-16T08:21:09Z","title":"SP$^2$T: Sparse Proxy Attention for Dual-stream Point Transformer","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-11T14:53:36.170349Z"},"links":{"citing_paper":"/paper/2412.11540"},"observation_digest":"sha256:208236e68633bc415e6a559c138e6ce44befde38400e1e3cea62e36afdc2e155","observation_id":"f44c808e-aaa4-40e1-b3b8-1a86401f8179","resolution":{"observed_at":"2026-08-11T14:53:39.659875Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2202.06709","last_updated":"2022-06-08T12:41:38Z","snapshot_observed_at":"2026-08-18T22:51:18.812654Z","submitted_at":"2022-02-14T13:58:43Z","title":"How Do Vision Transformers Work?","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2202.06709","snapshot_observed_at":"2026-08-11T14:53:36.321211Z","title":"How do vision transformers work? arXiv preprint arXiv:2202.06709, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.11540","last_updated":"2025-07-11T10:38:22Z","snapshot_observed_at":"2026-08-20T10:49:17.790529Z","submitted_at":"2024-12-16T08:21:09Z","title":"SP$^2$T: Sparse Proxy Attention for Dual-stream Point Transformer","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-11T14:53:36.321211Z"},"links":{"cited_paper":"/paper/2202.06709","citing_paper":"/paper/2412.11540"},"observation_digest":"sha256:d9056ae5dd181e445f022d17cbde6278d0437469d724b8373d2005d03f180ba3","observation_id":"4a6a50fc-4cfb-4b32-bc6b-ad6063d83578","resolution":{"observed_at":"2026-08-11T14:53:36.321211Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:53:36.457777Z","title":"Pointnet: Deep learning on point sets for 3d classification and segmentation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.11540","last_updated":"2025-07-11T10:38:22Z","snapshot_observed_at":"2026-08-20T10:49:17.790529Z","submitted_at":"2024-12-16T08:21:09Z","title":"SP$^2$T: Sparse Proxy Attention for Dual-stream Point Transformer","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-11T14:53:36.457777Z"},"links":{"citing_paper":"/paper/2412.11540"},"observation_digest":"sha256:09954829290095962e4338b4bd3f8ee978692a0c751750fe40bc131ede599505","observation_id":"714efc3c-1674-41b6-af67-06cfbf434771","resolution":{"observed_at":"2026-08-11T14:53:36.457777Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:53:36.465214Z","title":"Pointnet++: Deep hierarchical feature learning on point sets in a metric space","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2412.11540","last_updated":"2025-07-11T10:38:22Z","snapshot_observed_at":"2026-08-20T10:49:17.790529Z","submitted_at":"2024-12-16T08:21:09Z","title":"SP$^2$T: Sparse Proxy Attention for Dual-stream Point Transformer","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-11T14:53:36.465214Z"},"links":{"citing_paper":"/paper/2412.11540"},"observation_digest":"sha256:407faa131f16151ba469a281cc1c12a9792ff1bfd5211b83d17d8db4e20a20ff","observation_id":"e6afd995-7ada-47b9-8b61-b6eae6238990","resolution":{"observed_at":"2026-08-11T14:53:36.465214Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:53:39.466243Z","title":"Point- next: Revisiting pointnet++ with improved training and scal- ing strategies","venue":null,"work_id":"59e8bdfd-4dec-46f1-af90-3b68c99c5efa","year":2022},"citing_paper":{"arxiv_id":"2412.11540","last_updated":"2025-07-11T10:38:22Z","snapshot_observed_at":"2026-08-20T10:49:17.790529Z","submitted_at":"2024-12-16T08:21:09Z","title":"SP$^2$T: Sparse Proxy Attention for Dual-stream Point Transformer","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-11T14:53:36.471958Z"},"links":{"citing_paper":"/paper/2412.11540"},"observation_digest":"sha256:bf4d77760587abd9f8881a9a4e33bd3a2043a6bda30cb9f8a0e9c77ad6965f62","observation_id":"6279dfc0-7eac-4886-b417-97f3600bdc9b","resolution":{"observed_at":"2026-08-11T14:53:39.531011Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:53:39.437063Z","title":"Language- grounded indoor 3d semantic segmentation in the wild","venue":null,"work_id":"f8e416a8-5c6b-4e3c-b01f-a4b14978d4dd","year":2022},"citing_paper":{"arxiv_id":"2412.11540","last_updated":"2025-07-11T10:38:22Z","snapshot_observed_at":"2026-08-20T10:49:17.790529Z","submitted_at":"2024-12-16T08:21:09Z","title":"SP$^2$T: Sparse Proxy Attention for Dual-stream Point Transformer","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-11T14:53:36.478940Z"},"links":{"citing_paper":"/paper/2412.11540"},"observation_digest":"sha256:9779d68e37babbdb50c7f4b8e9b77b5eaee290b90223fe505264a2568e07ecfc","observation_id":"21ece717-f9ae-4786-bd01-719f09e97c19","resolution":{"observed_at":"2026-08-11T14:53:39.444161Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:53:39.411204Z","title":"Mask3d: Mask trans- former for 3d semantic instance segmentation","venue":null,"work_id":"2346741c-ed94-48e9-a177-9652992fc0c2","year":2023},"citing_paper":{"arxiv_id":"2412.11540","last_updated":"2025-07-11T10:38:22Z","snapshot_observed_at":"2026-08-20T10:49:17.790529Z","submitted_at":"2024-12-16T08:21:09Z","title":"SP$^2$T: Sparse Proxy Attention for Dual-stream Point Transformer","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-11T14:53:36.486948Z"},"links":{"citing_paper":"/paper/2412.11540"},"observation_digest":"sha256:7eaae3bfe36f8e85f4a0ccc32721044601e58404fde80d039315c48a4f10174e","observation_id":"32590934-f4fd-4ef4-a23e-6c33d09f7389","resolution":{"observed_at":"2026-08-11T14:53:39.419364Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:53:39.362505Z","title":"Semantic scene comple- tion from a single depth image","venue":null,"work_id":"0c38d679-8cb4-4835-abc7-639a34b85e29","year":2017},"citing_paper":{"arxiv_id":"2412.11540","last_updated":"2025-07-11T10:38:22Z","snapshot_observed_at":"2026-08-20T10:49:17.790529Z","submitted_at":"2024-12-16T08:21:09Z","title":"SP$^2$T: Sparse Proxy Attention for Dual-stream Point Transformer","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-11T14:53:36.494008Z"},"links":{"citing_paper":"/paper/2412.11540"},"observation_digest":"sha256:8a34b428b4522e1ef4800f159acf6c25fca3e0f3952a1a0b3f19c02eadffabe4","observation_id":"b5434eea-93ce-4247-a3da-f99223f8f452","resolution":{"observed_at":"2026-08-11T14:53:39.392347Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:53:39.233267Z","title":"Dropout: a simple way to prevent neural networks from overfitting","venue":null,"work_id":"3ca8cd89-0399-41e0-8f3c-18f5c12d26e3","year":1929},"citing_paper":{"arxiv_id":"2412.11540","last_updated":"2025-07-11T10:38:22Z","snapshot_observed_at":"2026-08-20T10:49:17.790529Z","submitted_at":"2024-12-16T08:21:09Z","title":"SP$^2$T: Sparse Proxy Attention for Dual-stream Point Transformer","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-11T14:53:36.500414Z"},"links":{"citing_paper":"/paper/2412.11540"},"observation_digest":"sha256:669352c45ad8cd41e2ee5303b16a710e1758193cc39d2f1fab6358c282cb9079","observation_id":"0b666216-a00e-468b-ac85-7aec4124409d","resolution":{"observed_at":"2026-08-11T14:53:39.299288Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:53:39.211506Z","title":"Multi-view convolutional neural networks for 3d shape recognition","venue":null,"work_id":"f046ba46-73e6-434c-b90b-183cdbb914aa","year":2015},"citing_paper":{"arxiv_id":"2412.11540","last_updated":"2025-07-11T10:38:22Z","snapshot_observed_at":"2026-08-20T10:49:17.790529Z","submitted_at":"2024-12-16T08:21:09Z","title":"SP$^2$T: Sparse Proxy Attention for Dual-stream Point Transformer","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-11T14:53:36.507303Z"},"links":{"citing_paper":"/paper/2412.11540"},"observation_digest":"sha256:4f1b66ad41a2e1742868e0eed27137d790e443fb4e37b95d92f626096bab68b0","observation_id":"75840adc-8424-4a81-9778-5556a80b34cf","resolution":{"observed_at":"2026-08-11T14:53:39.219616Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:53:39.033803Z","title":"Scalability in perception for autonomous driving: Waymo open dataset","venue":null,"work_id":"7ceffcd7-b192-4489-b35f-37814fa3bfea","year":2020},"citing_paper":{"arxiv_id":"2412.11540","last_updated":"2025-07-11T10:38:22Z","snapshot_observed_at":"2026-08-20T10:49:17.790529Z","submitted_at":"2024-12-16T08:21:09Z","title":"SP$^2$T: Sparse Proxy Attention for Dual-stream Point Transformer","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-11T14:53:36.513407Z"},"links":{"citing_paper":"/paper/2412.11540"},"observation_digest":"sha256:cdd3c2fa0caebff02422fef8270226ef70be7cd072ac569d58be51fec2986c97","observation_id":"12b507b6-a6b2-4b75-9cdd-84d54d7865ef","resolution":{"observed_at":"2026-08-11T14:53:39.128620Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:53:38.918793Z","title":"A brief review of nearest neighbor algorithm for learning and classification","venue":null,"work_id":"1b3882a1-813f-4051-97fa-0d00b05d5bce","year":2019},"citing_paper":{"arxiv_id":"2412.11540","last_updated":"2025-07-11T10:38:22Z","snapshot_observed_at":"2026-08-20T10:49:17.790529Z","submitted_at":"2024-12-16T08:21:09Z","title":"SP$^2$T: Sparse Proxy Attention for Dual-stream Point Transformer","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-11T14:53:36.519132Z"},"links":{"citing_paper":"/paper/2412.11540"},"observation_digest":"sha256:2fbe5e34f40db79efc3c947d6bf1a9b4c649f223488b47c07a969a56066bcc13","observation_id":"da97ed99-d76c-4945-88d7-898b04db489a","resolution":{"observed_at":"2026-08-11T14:53:38.977522Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:53:36.614273Z","title":"Attention is all you need","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2412.11540","last_updated":"2025-07-11T10:38:22Z","snapshot_observed_at":"2026-08-20T10:49:17.790529Z","submitted_at":"2024-12-16T08:21:09Z","title":"SP$^2$T: Sparse Proxy Attention for Dual-stream Point Transformer","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-11T14:53:36.614273Z"},"links":{"citing_paper":"/paper/2412.11540"},"observation_digest":"sha256:115d8b3ff87485976d07895aee4aeb9aac2f6ec8ad5d1f03b016d6ad7f027a58","observation_id":"496132e6-1426-4bfa-9070-7bf9f235504f","resolution":{"observed_at":"2026-08-11T14:53:36.614273Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:53:38.748193Z","title":"Dsvt: Dynamic sparse voxel transformer with rotated sets","venue":null,"work_id":"1f7ab59a-c542-4154-a1ed-d427d56fa6d7","year":2023},"citing_paper":{"arxiv_id":"2412.11540","last_updated":"2025-07-11T10:38:22Z","snapshot_observed_at":"2026-08-20T10:49:17.790529Z","submitted_at":"2024-12-16T08:21:09Z","title":"SP$^2$T: Sparse Proxy Attention for Dual-stream Point Transformer","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-11T14:53:36.733887Z"},"links":{"citing_paper":"/paper/2412.11540"},"observation_digest":"sha256:b07881eb48e9b9fa427a8775f324e359402022d705a43e1a9825f523245f26fd","observation_id":"3b477fa5-d9c1-476e-845c-320aff9d9092","resolution":{"observed_at":"2026-08-11T14:53:38.831501Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:53:38.710208Z","title":"Octformer: Octree-based transformers for 3d point clouds","venue":null,"work_id":"68d9e277-e52a-4ef7-9dc9-93ca10ef83e3","year":2023},"citing_paper":{"arxiv_id":"2412.11540","last_updated":"2025-07-11T10:38:22Z","snapshot_observed_at":"2026-08-20T10:49:17.790529Z","submitted_at":"2024-12-16T08:21:09Z","title":"SP$^2$T: Sparse Proxy Attention for Dual-stream Point Transformer","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-11T14:53:36.820571Z"},"links":{"citing_paper":"/paper/2412.11540"},"observation_digest":"sha256:f6409fe5ff89af63238797733f251e4ce1535584145e92bf510540ba21926769","observation_id":"b710a350-ca24-4521-9fed-b1b09784127e","resolution":{"observed_at":"2026-08-11T14:53:38.734614Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2006.04768","last_updated":"2020-06-14T08:15:54Z","snapshot_observed_at":"2026-07-06T09:27:03.809621Z","submitted_at":"2020-06-08T17:37:52Z","title":"Linformer: Self-Attention with Linear Complexity","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2006.04768","snapshot_observed_at":"2026-08-11T14:53:36.827467Z","title":"Linformer: Self-attention with linear complexity","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2412.11540","last_updated":"2025-07-11T10:38:22Z","snapshot_observed_at":"2026-08-20T10:49:17.790529Z","submitted_at":"2024-12-16T08:21:09Z","title":"SP$^2$T: Sparse Proxy Attention for Dual-stream Point Transformer","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-11T14:53:36.827467Z"},"links":{"cited_paper":"/paper/2006.04768","citing_paper":"/paper/2412.11540"},"observation_digest":"sha256:a4a26c3385afdbb89189d9d2b662f66a44df6d18f889f0ec88a5c9f3cc0ea7ae","observation_id":"5ff918b5-b09c-4811-b0e9-44ee1ea4cbdb","resolution":{"observed_at":"2026-08-11T14:53:36.827467Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:53:38.603910Z","title":"Detr3d: 3d object detection from multi-view images via 3d-to-2d queries","venue":null,"work_id":"86e81bf5-9793-4a8b-b133-cb3129f6b69b","year":null},"citing_paper":{"arxiv_id":"2412.11540","last_updated":"2025-07-11T10:38:22Z","snapshot_observed_at":"2026-08-20T10:49:17.790529Z","submitted_at":"2024-12-16T08:21:09Z","title":"SP$^2$T: Sparse Proxy Attention for Dual-stream Point Transformer","version":2},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-11T14:53:36.840077Z"},"links":{"citing_paper":"/paper/2412.11540"},"observation_digest":"sha256:72d2618540b7d8ca737f44bf1c128d170526399a4d031a3f96381536b2567d9e","observation_id":"d10e7c43-b067-42b9-aff3-5367438adf2d","resolution":{"observed_at":"2026-08-11T14:53:38.622954Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:53:38.554230Z","title":"Point transformer v2: Grouped vector attention and partition-based pooling","venue":null,"work_id":"313fcf62-12b4-4a72-b6a2-e28b863b8ebe","year":2022},"citing_paper":{"arxiv_id":"2412.11540","last_updated":"2025-07-11T10:38:22Z","snapshot_observed_at":"2026-08-20T10:49:17.790529Z","submitted_at":"2024-12-16T08:21:09Z","title":"SP$^2$T: Sparse Proxy Attention for Dual-stream Point Transformer","version":2},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-11T14:53:36.846950Z"},"links":{"citing_paper":"/paper/2412.11540"},"observation_digest":"sha256:c14d26dfff92afee3d2207ddd8c82998691586cd7642e8c6e19b9ed210134b86","observation_id":"07a65b1e-02c7-4a9f-ac8c-63d5d8501136","resolution":{"observed_at":"2026-08-11T14:53:38.578623Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:53:38.416827Z","title":"Point transformer v3: Simpler faster stronger","venue":null,"work_id":"4db50601-ca6f-48d1-b5aa-dc7bf9da9c44","year":2024},"citing_paper":{"arxiv_id":"2412.11540","last_updated":"2025-07-11T10:38:22Z","snapshot_observed_at":"2026-08-20T10:49:17.790529Z","submitted_at":"2024-12-16T08:21:09Z","title":"SP$^2$T: Sparse Proxy Attention for Dual-stream Point Transformer","version":2},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-11T14:53:36.854106Z"},"links":{"citing_paper":"/paper/2412.11540"},"observation_digest":"sha256:db470e3d9210b5f68f745fff9556f20babb550ba285021f7df966940ce901a3d","observation_id":"6565cde5-f08e-4629-9258-89ba41530ea7","resolution":{"observed_at":"2026-08-11T14:53:38.455470Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:53:38.390271Z","title":"Pointasnl: Robust point clouds processing using nonlocal neural networks with adaptive sampling","venue":null,"work_id":"b28216c1-bbe0-4d3f-b39b-02e8f75006e4","year":2020},"citing_paper":{"arxiv_id":"2412.11540","last_updated":"2025-07-11T10:38:22Z","snapshot_observed_at":"2026-08-20T10:49:17.790529Z","submitted_at":"2024-12-16T08:21:09Z","title":"SP$^2$T: Sparse Proxy Attention for Dual-stream Point Transformer","version":2},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-11T14:53:36.860396Z"},"links":{"citing_paper":"/paper/2412.11540"},"observation_digest":"sha256:4b0bf718bcf43e8da35a859abded3f80e424da519632038010e7f162981fa203","observation_id":"4f154710-c38b-4b75-9039-6fbd198b5fca","resolution":{"observed_at":"2026-08-11T14:53:38.400911Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:53:38.361072Z","title":"2dpass: 2d priors assisted semantic segmentation on lidar point clouds","venue":null,"work_id":"f0e324c7-e738-4483-ae50-36c9d4792e83","year":null},"citing_paper":{"arxiv_id":"2412.11540","last_updated":"2025-07-11T10:38:22Z","snapshot_observed_at":"2026-08-20T10:49:17.790529Z","submitted_at":"2024-12-16T08:21:09Z","title":"SP$^2$T: Sparse Proxy Attention for Dual-stream Point Transformer","version":2},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-11T14:53:36.868087Z"},"links":{"citing_paper":"/paper/2412.11540"},"observation_digest":"sha256:30ddc9d0264b2d6c96be58ac07674404dcb10f36a6b95f866c9017379eb229d3","observation_id":"278ff71f-b1c6-416a-a130-82f58a84d463","resolution":{"observed_at":"2026-08-11T14:53:38.369664Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.06906","last_updated":"2023-08-16T01:53:02Z","snapshot_observed_at":"2026-08-16T15:40:32.295998Z","submitted_at":"2023-04-14T02:49:08Z","title":"Swin3D: A Pretrained Transformer Backbone for 3D Indoor Scene Understanding","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.06906","snapshot_observed_at":"2026-08-11T14:53:36.875321Z","title":"Swin3d: A pretrained transformer backbone for 3d indoor scene under- standing","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.11540","last_updated":"2025-07-11T10:38:22Z","snapshot_observed_at":"2026-08-20T10:49:17.790529Z","submitted_at":"2024-12-16T08:21:09Z","title":"SP$^2$T: Sparse Proxy Attention for Dual-stream Point Transformer","version":2},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-11T14:53:36.875321Z"},"links":{"cited_paper":"/paper/2304.06906","citing_paper":"/paper/2412.11540"},"observation_digest":"sha256:d56890043b555634eddd76eba7b905a643427a00b8ae5aacce4239601c0005f1","observation_id":"7bbc0605-e7fb-47ca-bbf2-1b0cf901de9a","resolution":{"observed_at":"2026-08-11T14:53:36.875321Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:53:38.269068Z","title":"Center- based 3d object detection and tracking","venue":null,"work_id":"15e0da10-303d-434e-bb82-6abbfb20d1a4","year":2021},"citing_paper":{"arxiv_id":"2412.11540","last_updated":"2025-07-11T10:38:22Z","snapshot_observed_at":"2026-08-20T10:49:17.790529Z","submitted_at":"2024-12-16T08:21:09Z","title":"SP$^2$T: Sparse Proxy Attention for Dual-stream Point Transformer","version":2},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-11T14:53:36.883792Z"},"links":{"citing_paper":"/paper/2412.11540"},"observation_digest":"sha256:d0677b29f5617b6fde65627e2f2b50f9d567aee0c56c6edea29bf80094696a70","observation_id":"19a20a92-d282-424e-b02a-8e6eec4956d4","resolution":{"observed_at":"2026-08-11T14:53:38.309981Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:53:38.181537Z","title":"Safdnet: A simple and effective net- work for fully sparse 3d object detection","venue":null,"work_id":"0cdaf275-cd0e-462d-a47c-4634981c5f8e","year":2024},"citing_paper":{"arxiv_id":"2412.11540","last_updated":"2025-07-11T10:38:22Z","snapshot_observed_at":"2026-08-20T10:49:17.790529Z","submitted_at":"2024-12-16T08:21:09Z","title":"SP$^2$T: Sparse Proxy Attention for Dual-stream Point Transformer","version":2},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-11T14:53:36.890842Z"},"links":{"citing_paper":"/paper/2412.11540"},"observation_digest":"sha256:dd115ff1387d0c166a2fb94042bfca94bba55f6e1604ef34b96ad41ddf061df7","observation_id":"25338571-8cc2-49e6-86fe-ee181fe48b5c","resolution":{"observed_at":"2026-08-11T14:53:38.193156Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:53:38.158745Z","title":"Sparse agent transformer for unified voxel and image feature extraction and fusion","venue":null,"work_id":"7c951bc9-68bb-4632-bd5d-b829ccd88040","year":2024},"citing_paper":{"arxiv_id":"2412.11540","last_updated":"2025-07-11T10:38:22Z","snapshot_observed_at":"2026-08-20T10:49:17.790529Z","submitted_at":"2024-12-16T08:21:09Z","title":"SP$^2$T: Sparse Proxy Attention for Dual-stream Point Transformer","version":2},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-11T14:53:37.000290Z"},"links":{"citing_paper":"/paper/2412.11540"},"observation_digest":"sha256:cd31c4e808955ddcbb43590a569e0dbddea6bf0f0578887730b21bc0a3d24bf1","observation_id":"ce820dbd-47aa-462b-8042-47dc4f2e602d","resolution":{"observed_at":"2026-08-11T14:53:38.164849Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:53:38.128831Z","title":"P2ftrack: Multi-object tracking with motion prior and feature posterior","venue":null,"work_id":"5c3e76c1-c95f-4b48-a2ff-bd8c6f884753","year":2024},"citing_paper":{"arxiv_id":"2412.11540","last_updated":"2025-07-11T10:38:22Z","snapshot_observed_at":"2026-08-20T10:49:17.790529Z","submitted_at":"2024-12-16T08:21:09Z","title":"SP$^2$T: Sparse Proxy Attention for Dual-stream Point Transformer","version":2},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-11T14:53:37.043693Z"},"links":{"citing_paper":"/paper/2412.11540"},"observation_digest":"sha256:a7877356283d8c0b616ca393c33fe8cea39cf48418438ba78fd9be5753f55995","observation_id":"5cdd7812-378a-455d-ade6-35c4f0b05071","resolution":{"observed_at":"2026-08-11T14:53:38.137388Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:53:37.922916Z","title":"Coddiff: Prior leading diffusion model for camouflage object detection","venue":null,"work_id":"5c648afe-0b1e-4536-9c3e-b7650d78204f","year":2025},"citing_paper":{"arxiv_id":"2412.11540","last_updated":"2025-07-11T10:38:22Z","snapshot_observed_at":"2026-08-20T10:49:17.790529Z","submitted_at":"2024-12-16T08:21:09Z","title":"SP$^2$T: Sparse Proxy Attention for Dual-stream Point Transformer","version":2},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-11T14:53:37.049898Z"},"links":{"citing_paper":"/paper/2412.11540"},"observation_digest":"sha256:7da18265999c1650c5ac03946d0abf8e31cc4a1466a8f61274725e953a829c0e","observation_id":"6c65b0ef-3213-4592-9a6e-ef5f5cfa334b","resolution":{"observed_at":"2026-08-11T14:53:38.034604Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:53:37.845854Z","title":"Awaretrack: Object awareness for visual tracking via templates interaction","venue":null,"work_id":"3a75d209-9dea-4910-be26-f9a7ee7c1d6f","year":2025},"citing_paper":{"arxiv_id":"2412.11540","last_updated":"2025-07-11T10:38:22Z","snapshot_observed_at":"2026-08-20T10:49:17.790529Z","submitted_at":"2024-12-16T08:21:09Z","title":"SP$^2$T: Sparse Proxy Attention for Dual-stream Point Transformer","version":2},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-11T14:53:37.057987Z"},"links":{"citing_paper":"/paper/2412.11540"},"observation_digest":"sha256:026b2f22e51f029103838400198687b5cd71b0eed6e10b25500cf8cdf1e9273f","observation_id":"336b3d1f-3a55-432c-b602-0ca95d8b928e","resolution":{"observed_at":"2026-08-11T14:53:37.854675Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2111.10332","last_updated":"2022-05-16T02:22:01Z","snapshot_observed_at":"2026-08-16T17:40:37.742555Z","submitted_at":"2021-11-19T17:25:54Z","title":"DSPoint: Dual-scale Point Cloud Recognition with High-frequency Fusion","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2111.10332","snapshot_observed_at":"2026-08-11T14:53:37.063471Z","title":"Dspoint: Dual-scale point cloud recognition with high-frequency fusion","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.11540","last_updated":"2025-07-11T10:38:22Z","snapshot_observed_at":"2026-08-20T10:49:17.790529Z","submitted_at":"2024-12-16T08:21:09Z","title":"SP$^2$T: Sparse Proxy Attention for Dual-stream Point Transformer","version":2},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-11T14:53:37.063471Z"},"links":{"cited_paper":"/paper/2111.10332","citing_paper":"/paper/2412.11540"},"observation_digest":"sha256:22df86b353a45618ba371890edc6f377f87667d4995ef84f0f8f280f80129dfa","observation_id":"cbb868b7-371e-4307-8f85-13b673f65c73","resolution":{"observed_at":"2026-08-11T14:53:37.063471Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:53:37.820203Z","title":"Pointweb: Enhancing local neighborhood features for point cloud processing","venue":null,"work_id":"47e5634d-d2f3-498a-9ec4-a71c52b61e31","year":2019},"citing_paper":{"arxiv_id":"2412.11540","last_updated":"2025-07-11T10:38:22Z","snapshot_observed_at":"2026-08-20T10:49:17.790529Z","submitted_at":"2024-12-16T08:21:09Z","title":"SP$^2$T: Sparse Proxy Attention for Dual-stream Point Transformer","version":2},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-11T14:53:37.073696Z"},"links":{"citing_paper":"/paper/2412.11540"},"observation_digest":"sha256:491e5300688e81fa66b39988b0377a121c06550b48a34815d23ba8fd18ddedf6","observation_id":"4a20851a-d781-4a2b-a3bf-322fa24ee80c","resolution":{"observed_at":"2026-08-11T14:53:37.828395Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:53:37.772290Z","title":"Point transformer","venue":null,"work_id":"1082669f-9b7b-4896-8963-9d2e0067a844","year":2021},"citing_paper":{"arxiv_id":"2412.11540","last_updated":"2025-07-11T10:38:22Z","snapshot_observed_at":"2026-08-20T10:49:17.790529Z","submitted_at":"2024-12-16T08:21:09Z","title":"SP$^2$T: Sparse Proxy Attention for Dual-stream Point Transformer","version":2},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-11T14:53:37.080635Z"},"links":{"citing_paper":"/paper/2412.11540"},"observation_digest":"sha256:d1c64f3c90a505e868bfebecd67b45c7efe49f7b42cb59af9b82ecb1f263d505","observation_id":"0d74413d-b1e0-4d3d-b19b-b46cc0040533","resolution":{"observed_at":"2026-08-11T14:53:37.805735Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T14:53:37.500858Z","title":"V oxelnet: End-to-end learning for point cloud based 3d object detection","venue":null,"work_id":"c01734ef-2dab-49d8-af2c-a4c5bfb6b644","year":2018},"citing_paper":{"arxiv_id":"2412.11540","last_updated":"2025-07-11T10:38:22Z","snapshot_observed_at":"2026-08-20T10:49:17.790529Z","submitted_at":"2024-12-16T08:21:09Z","title":"SP$^2$T: Sparse Proxy Attention for Dual-stream Point Transformer","version":2},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-11T14:53:37.087686Z"},"links":{"citing_paper":"/paper/2412.11540"},"observation_digest":"sha256:2f3c0d4303def716ba1116a8ec889908f78ad2c6c894fd20be78b5194b570168","observation_id":"3f0ac3d8-29d5-48a8-b04e-a322b412a37b","resolution":{"observed_at":"2026-08-11T14:53:37.630593Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2412.11540","last_updated":"2025-07-11T10:38:22Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-20T10:49:17.790529Z","submitted_at":"2024-12-16T08:21:09Z","title":"SP$^2$T: Sparse Proxy Attention for Dual-stream Point Transformer"},"reference_resolution":{"displayed":69,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":13,"verified_exact":1,"verified_fuzzy":55},"total_outbound_references":69},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"thesis":"As of 23 August 2026, this Paper Citation Record lists 69 of 69 outbound references and 0 inbound Pith citation observations for arXiv:2412.11540."}