{"as_of":"2026-08-08T22:37:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:d60cf948168737894ed358a7f03e293637156bd3cd4650610ecf73e6d2cd1581","coverage":[{"denominator":70,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":70,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-08T13:40:59.697257Z","state":"measured"},{"denominator":72,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":72,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-10T00:09:29.861387Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-10T00:14:46.936853Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2502.07161","last_updated":"2025-02-11T00:59:30Z","snapshot_observed_at":"2026-08-08T14:30:30.242810Z","submitted_at":"2025-02-11T00:59:30Z","title":"A Survey on Mamba Architecture for Vision Applications","version":1},"cited_work":{"arxiv_id":"2502.07161","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.07161","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"arXiv preprint arXiv:2502.07161 (2025)","venue":null,"work_id":"3a1f57dd-c586-4c00-a9b9-2cda200f039a","year":2025},"citing_paper":{"arxiv_id":"2604.20606","last_updated":"2026-04-22T14:20:59Z","snapshot_observed_at":"2026-07-06T23:07:14.243878Z","submitted_at":"2026-04-22T14:20:59Z","title":"Beyond ZOH: Advanced Discretization Strategies for Vision Mamba","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-10T00:09:29.861387Z"},"links":{"cited_paper":"/paper/2502.07161","citing_paper":"/paper/2604.20606"},"observation_digest":"sha256:f78a06a5927ce6130d889b991ad365cd0caae9b77e45bd4cb0d29c8cc092edcc","observation_id":"e85c4644-c370-440e-9e89-e0515dcc2b74","resolution":{"observed_at":"2026-05-10T00:14:46.940321Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.07161","last_updated":"2025-02-11T00:59:30Z","snapshot_observed_at":"2026-08-08T14:30:30.242810Z","submitted_at":"2025-02-11T00:59:30Z","title":"A Survey on Mamba Architecture for Vision Applications","version":1},"cited_work":{"arxiv_id":"2502.07161","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.07161","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"arXiv preprint arXiv:2502.07161 (2025)","venue":null,"work_id":"3a1f57dd-c586-4c00-a9b9-2cda200f039a","year":2025},"citing_paper":{"arxiv_id":"2605.01935","last_updated":"2026-05-03T15:32:05Z","snapshot_observed_at":"2026-07-06T23:15:07.159340Z","submitted_at":"2026-05-03T15:32:05Z","title":"ViM-Q: Scalable Algorithm-Hardware Co-Design for Vision Mamba Model Inference on FPGA","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-08T19:35:49.344473Z"},"links":{"cited_paper":"/paper/2502.07161","citing_paper":"/paper/2605.01935"},"observation_digest":"sha256:fda4dc981819f5a2e411954d9a1007e3ddfc61ee985353982e1763ed6ee061fb","observation_id":"5179b57a-776a-44ce-8f68-d0ef73bf5b05","resolution":{"observed_at":"2026-05-09T05:45:22.488102Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2502.07161/citation-record","integrity":"/paper/2502.07161/integrity","json":"/paper/2502.07161/citation-record.json","paper":"/paper/2502.07161"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2210.09298","last_updated":"2022-10-17T17:53:29Z","snapshot_observed_at":"2026-07-30T22:56:49.514336Z","submitted_at":"2022-10-17T17:53:29Z","title":"What Makes Convolutional Models Great on Long Sequence Modeling?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.09298","snapshot_observed_at":"2026-08-08T13:40:59.367565Z","title":"What makes con- volutional models great on long sequence modeling?","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.07161","last_updated":"2025-02-11T00:59:30Z","snapshot_observed_at":"2026-08-08T14:30:30.242810Z","submitted_at":"2025-02-11T00:59:30Z","title":"A Survey on Mamba Architecture for Vision Applications","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-08T13:40:59.367565Z"},"links":{"cited_paper":"/paper/2210.09298","citing_paper":"/paper/2502.07161"},"observation_digest":"sha256:0a50f76088b81cf260479f194dc780b31145bd0ce56992e90fc00538428461d5","observation_id":"cefe63ef-ecd6-4495-a063-88fd25eaa985","resolution":{"observed_at":"2026-08-08T13:40:59.367565Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T13:41:01.058037Z","title":"Time-aware large kernel convolutions,","venue":null,"work_id":"7ceff4a1-3d90-4814-850d-13c5c7391626","year":2020},"citing_paper":{"arxiv_id":"2502.07161","last_updated":"2025-02-11T00:59:30Z","snapshot_observed_at":"2026-08-08T14:30:30.242810Z","submitted_at":"2025-02-11T00:59:30Z","title":"A Survey on Mamba Architecture for Vision Applications","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-08T13:40:59.373496Z"},"links":{"citing_paper":"/paper/2502.07161"},"observation_digest":"sha256:2f1938d5134c679956609e7d460aca1e3f4f6dde9a0d147cbfd7ae17e16c98a4","observation_id":"946b2f0e-dbd5-4ace-8480-4479084deecf","resolution":{"observed_at":"2026-08-08T13:41:01.062723Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T13:41:01.042518Z","title":"Depth-wise convolutions in vision transformers for efficient training on small datasets,","venue":null,"work_id":"66f9bebb-8e14-46e0-bb28-bb5227b1387c","year":2025},"citing_paper":{"arxiv_id":"2502.07161","last_updated":"2025-02-11T00:59:30Z","snapshot_observed_at":"2026-08-08T14:30:30.242810Z","submitted_at":"2025-02-11T00:59:30Z","title":"A Survey on Mamba Architecture for Vision Applications","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-08T13:40:59.378337Z"},"links":{"citing_paper":"/paper/2502.07161"},"observation_digest":"sha256:c77f2b9ea3af66ab1b631ad7d4c2b0d4fa44ac1fdd17355e28aed8591129a38c","observation_id":"9aa4553e-9c9b-4844-9f33-e0c09463311c","resolution":{"observed_at":"2026-08-08T13:41:01.047661Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T13:40:59.383401Z","title":"Attention is all you need,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2502.07161","last_updated":"2025-02-11T00:59:30Z","snapshot_observed_at":"2026-08-08T14:30:30.242810Z","submitted_at":"2025-02-11T00:59:30Z","title":"A Survey on Mamba Architecture for Vision Applications","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-08T13:40:59.383401Z"},"links":{"citing_paper":"/paper/2502.07161"},"observation_digest":"sha256:1f4373c095391cfffc300a463d898658702fcf105e05b85c5965c137b482e13a","observation_id":"93632301-974e-4a00-8c12-b935852a7420","resolution":{"observed_at":"2026-08-08T13:40:59.383401Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2010.11929","last_updated":"2021-06-03T13:08:56Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-10-22T17:55:59Z","title":"An Image is Worth 16x16 Words: Transformers for Image Recognition at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.11929","snapshot_observed_at":"2026-08-08T13:40:59.388076Z","title":"An image is worth 16x16 words: Transformers for image recognition at scale,","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2502.07161","last_updated":"2025-02-11T00:59:30Z","snapshot_observed_at":"2026-08-08T14:30:30.242810Z","submitted_at":"2025-02-11T00:59:30Z","title":"A Survey on Mamba Architecture for Vision Applications","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-08T13:40:59.388076Z"},"links":{"cited_paper":"/paper/2010.11929","citing_paper":"/paper/2502.07161"},"observation_digest":"sha256:09280b4a6b29d9c77bc06500a4433c666683ea77a9ed06bf94804f496d6bf616","observation_id":"a8cfab20-75bd-4410-9d36-bf70a350d342","resolution":{"observed_at":"2026-08-08T13:40:59.388076Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T13:41:01.016650Z","title":"Predicting therapeutic response to hypoglossal nerve stimulation using deep learning,","venue":null,"work_id":"279a6896-ff8f-4865-bfd1-496d6ac3170c","year":2024},"citing_paper":{"arxiv_id":"2502.07161","last_updated":"2025-02-11T00:59:30Z","snapshot_observed_at":"2026-08-08T14:30:30.242810Z","submitted_at":"2025-02-11T00:59:30Z","title":"A Survey on Mamba Architecture for Vision Applications","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-08T13:40:59.393003Z"},"links":{"citing_paper":"/paper/2502.07161"},"observation_digest":"sha256:8b310902bf8e93b778d3c43377eade836f0d152ee1c935b57f06c3b44664a5e9","observation_id":"0aeee6dc-2f9c-4baf-9e66-8639063747db","resolution":{"observed_at":"2026-08-08T13:41:01.021821Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T13:41:00.999672Z","title":"Aphid cluster recognition and detection in the wild using deep learning models,","venue":null,"work_id":"c5cc44ae-d101-47b0-94e7-ee904db53fd1","year":2023},"citing_paper":{"arxiv_id":"2502.07161","last_updated":"2025-02-11T00:59:30Z","snapshot_observed_at":"2026-08-08T14:30:30.242810Z","submitted_at":"2025-02-11T00:59:30Z","title":"A Survey on Mamba Architecture for Vision Applications","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-08T13:40:59.398536Z"},"links":{"citing_paper":"/paper/2502.07161"},"observation_digest":"sha256:d4b1070abb792126d010b1d9369722cd7075f39de1288897f5b4f1eb717b939e","observation_id":"dc57be17-aa17-400e-ac97-75378015f307","resolution":{"observed_at":"2026-08-08T13:41:01.005640Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T13:41:00.982333Z","title":"A new dataset and comparative study for aphid cluster detection and segmentation in sorghum fields,","venue":null,"work_id":"b8f213ce-3ae5-4014-9c57-1e1b0cf817b2","year":2024},"citing_paper":{"arxiv_id":"2502.07161","last_updated":"2025-02-11T00:59:30Z","snapshot_observed_at":"2026-08-08T14:30:30.242810Z","submitted_at":"2025-02-11T00:59:30Z","title":"A Survey on Mamba Architecture for Vision Applications","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-08T13:40:59.403032Z"},"links":{"citing_paper":"/paper/2502.07161"},"observation_digest":"sha256:cd420e3b80b9e6e12529c51ca1beeed0f696b8bc336f9c7ea17ec1b06549b0da","observation_id":"78c84e5c-baa4-48fa-9fdb-f5daddf8194d","resolution":{"observed_at":"2026-08-08T13:41:00.988111Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T13:41:00.964322Z","title":"Edge-aware multi-task network for integrating quantification segmentation and uncertainty prediction of liver tumor on multi-modality non-contrast mri,","venue":null,"work_id":"2b338846-9acc-42f2-8362-99ee79530b91","year":2023},"citing_paper":{"arxiv_id":"2502.07161","last_updated":"2025-02-11T00:59:30Z","snapshot_observed_at":"2026-08-08T14:30:30.242810Z","submitted_at":"2025-02-11T00:59:30Z","title":"A Survey on Mamba Architecture for Vision Applications","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-08T13:40:59.407984Z"},"links":{"citing_paper":"/paper/2502.07161"},"observation_digest":"sha256:5ea2f3c5bd6f520f1afd5f2b2c703fc80d05db22bec5be9cbc0c25e9fc40f928","observation_id":"be81930b-5d87-47e4-96f6-f21c0be41304","resolution":{"observed_at":"2026-08-08T13:41:00.970424Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T13:40:59.413049Z","title":"Deep residual learning for image recognition,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2502.07161","last_updated":"2025-02-11T00:59:30Z","snapshot_observed_at":"2026-08-08T14:30:30.242810Z","submitted_at":"2025-02-11T00:59:30Z","title":"A Survey on Mamba Architecture for Vision Applications","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-08T13:40:59.413049Z"},"links":{"citing_paper":"/paper/2502.07161"},"observation_digest":"sha256:dcfe4c8e57bca34cef6c4317b9bc9a9493e7414952eb044cc3865a5aebbf58f7","observation_id":"b298cb7a-af43-4d37-b9a1-9bb63d597aee","resolution":{"observed_at":"2026-08-08T13:40:59.413049Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T13:40:59.417727Z","title":"Is space-time attention all you need for video understanding?","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.07161","last_updated":"2025-02-11T00:59:30Z","snapshot_observed_at":"2026-08-08T14:30:30.242810Z","submitted_at":"2025-02-11T00:59:30Z","title":"A Survey on Mamba Architecture for Vision Applications","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-08T13:40:59.417727Z"},"links":{"citing_paper":"/paper/2502.07161"},"observation_digest":"sha256:c468d04fd321f1c14765ea520348076faa06a3e1f337d7b08aafbd4f15906789","observation_id":"a14e83cd-fe0e-49e7-b33e-ea10188ca7fc","resolution":{"observed_at":"2026-08-08T13:40:59.417727Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1904.10509","last_updated":"2019-04-23T19:29:47Z","snapshot_observed_at":"2026-08-06T08:05:35.311510Z","submitted_at":"2019-04-23T19:29:47Z","title":"Generating Long Sequences with Sparse Transformers","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1904.10509","snapshot_observed_at":"2026-08-08T13:40:59.422136Z","title":"Generating long sequences with sparse transformers,","venue":null,"work_id":null,"year":1904},"citing_paper":{"arxiv_id":"2502.07161","last_updated":"2025-02-11T00:59:30Z","snapshot_observed_at":"2026-08-08T14:30:30.242810Z","submitted_at":"2025-02-11T00:59:30Z","title":"A Survey on Mamba Architecture for Vision Applications","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-08T13:40:59.422136Z"},"links":{"cited_paper":"/paper/1904.10509","citing_paper":"/paper/2502.07161"},"observation_digest":"sha256:9509fc18df203cc6b55d841b9985a4dc55cb4fe39dc50d45ffc9c4e895e5c52f","observation_id":"ddb7fb22-0ed0-4074-bd5d-6897ab9498cb","resolution":{"observed_at":"2026-08-08T13:40:59.422136Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T13:41:00.927740Z","title":"Xcit: Cross- covariance image transformers,","venue":null,"work_id":"52a09233-67bb-40aa-8b6e-a2c47cd5770f","year":2021},"citing_paper":{"arxiv_id":"2502.07161","last_updated":"2025-02-11T00:59:30Z","snapshot_observed_at":"2026-08-08T14:30:30.242810Z","submitted_at":"2025-02-11T00:59:30Z","title":"A Survey on Mamba Architecture for Vision Applications","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-08T13:40:59.427145Z"},"links":{"citing_paper":"/paper/2502.07161"},"observation_digest":"sha256:f59a35d1760ecb287d5d89cc7960dc356c4713236a0a8cf4011b74eef779be50","observation_id":"effa2afa-7e40-4027-ac66-3d2b4231d98b","resolution":{"observed_at":"2026-08-08T13:41:00.933491Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.00752","last_updated":"2024-05-31T17:55:27Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-12-01T18:01:34Z","title":"Mamba: Linear-Time Sequence Modeling with Selective State Spaces","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.00752","snapshot_observed_at":"2026-08-08T13:40:59.431786Z","title":"Mamba: Linear-time sequence modeling with selective state spaces,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.07161","last_updated":"2025-02-11T00:59:30Z","snapshot_observed_at":"2026-08-08T14:30:30.242810Z","submitted_at":"2025-02-11T00:59:30Z","title":"A Survey on Mamba Architecture for Vision Applications","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-08T13:40:59.431786Z"},"links":{"cited_paper":"/paper/2312.00752","citing_paper":"/paper/2502.07161"},"observation_digest":"sha256:2bce9efdd8d0e15d14945481472e0bec3b28592cde259937c7b7cc017d9efecb","observation_id":"2b424ceb-5029-4eb2-9119-b51543955b54","resolution":{"observed_at":"2026-08-08T13:40:59.431786Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.09417","last_updated":"2024-11-14T02:00:33Z","snapshot_observed_at":"2026-07-06T17:16:59.193820Z","submitted_at":"2024-01-17T18:56:18Z","title":"Vision Mamba: Efficient Visual Representation Learning with Bidirectional State Space Model","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.09417","snapshot_observed_at":"2026-08-08T13:40:59.436447Z","title":"Vision mamba: Efficient visual representation learning with bidirectional state space model,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.07161","last_updated":"2025-02-11T00:59:30Z","snapshot_observed_at":"2026-08-08T14:30:30.242810Z","submitted_at":"2025-02-11T00:59:30Z","title":"A Survey on Mamba Architecture for Vision Applications","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-08T13:40:59.436447Z"},"links":{"cited_paper":"/paper/2401.09417","citing_paper":"/paper/2502.07161"},"observation_digest":"sha256:be54b6a81febf54ff8a09cdb1483e69f67eddbf1757722f6fbda67df15a95182","observation_id":"79fa4be1-de52-46e9-ba8f-2b9654e433a6","resolution":{"observed_at":"2026-08-08T13:40:59.436447Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T13:41:00.911250Z","title":"Videomamba: State space model for efficient video understanding,","venue":null,"work_id":"ea5f4b7a-99ae-4b66-b8e2-0da5b2d52bd4","year":2025},"citing_paper":{"arxiv_id":"2502.07161","last_updated":"2025-02-11T00:59:30Z","snapshot_observed_at":"2026-08-08T14:30:30.242810Z","submitted_at":"2025-02-11T00:59:30Z","title":"A Survey on Mamba Architecture for Vision Applications","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-08T13:40:59.441307Z"},"links":{"citing_paper":"/paper/2502.07161"},"observation_digest":"sha256:abf86639c7bb683dc03c2ff48e82f8af59e932af389f4e2f6aa6045168b1e3b5","observation_id":"790f8a8a-894f-4dc3-a087-65cadd65e5b0","resolution":{"observed_at":"2026-08-08T13:41:00.916939Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.01129","last_updated":"2026-04-06T02:10:55Z","snapshot_observed_at":"2026-07-30T06:31:55.204130Z","submitted_at":"2024-08-02T09:18:41Z","title":"A Survey of Mamba","version":8},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.01129","snapshot_observed_at":"2026-08-08T13:40:59.445760Z","title":"A survey of mamba,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.07161","last_updated":"2025-02-11T00:59:30Z","snapshot_observed_at":"2026-08-08T14:30:30.242810Z","submitted_at":"2025-02-11T00:59:30Z","title":"A Survey on Mamba Architecture for Vision Applications","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-08T13:40:59.445760Z"},"links":{"cited_paper":"/paper/2408.01129","citing_paper":"/paper/2502.07161"},"observation_digest":"sha256:c2336743006cc29241f5b7d0a406248e468dca99a647db1b06e48ebc41b43c39","observation_id":"28839067-d9f1-4609-8c4f-c7f713aa9cb3","resolution":{"observed_at":"2026-08-08T13:40:59.445760Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.16112","last_updated":"2024-04-24T18:10:31Z","snapshot_observed_at":"2026-08-08T08:03:41.810567Z","submitted_at":"2024-04-24T18:10:31Z","title":"Mamba-360: Survey of State Space Models as Transformer Alternative for Long Sequence Modelling: Methods, Applications, and Challenges","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.16112","snapshot_observed_at":"2026-08-08T13:40:59.450778Z","title":"Mamba-360: Survey of state space models as transformer alternative for long sequence modelling: Methods, applications, and challenges,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.07161","last_updated":"2025-02-11T00:59:30Z","snapshot_observed_at":"2026-08-08T14:30:30.242810Z","submitted_at":"2025-02-11T00:59:30Z","title":"A Survey on Mamba Architecture for Vision Applications","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-08T13:40:59.450778Z"},"links":{"cited_paper":"/paper/2404.16112","citing_paper":"/paper/2502.07161"},"observation_digest":"sha256:26dbc6f3a57ee4acc07e53cc965b04ba7e54d2153e4e011c3e3610043f4a54aa","observation_id":"84847436-d64a-4607-be1f-9182ccbe17d0","resolution":{"observed_at":"2026-08-08T13:40:59.450778Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.03849","last_updated":"2024-09-29T03:55:46Z","snapshot_observed_at":"2026-08-04T18:38:48.993581Z","submitted_at":"2024-03-06T16:49:33Z","title":"MedMamba: Vision Mamba for Medical Image Classification","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.03849","snapshot_observed_at":"2026-08-08T13:40:59.455621Z","title":"Medmamba: Vision mamba for medical image classification,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.07161","last_updated":"2025-02-11T00:59:30Z","snapshot_observed_at":"2026-08-08T14:30:30.242810Z","submitted_at":"2025-02-11T00:59:30Z","title":"A Survey on Mamba Architecture for Vision Applications","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-08T13:40:59.455621Z"},"links":{"cited_paper":"/paper/2403.03849","citing_paper":"/paper/2502.07161"},"observation_digest":"sha256:d5fefea3522732a18df81f16863b8332fb308052479a200cf85b84940bb13615","observation_id":"eb8b7b09-1e22-4e4d-a9a4-04db05f7b940","resolution":{"observed_at":"2026-08-08T13:40:59.455621Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T13:40:59.460364Z","title":"A comprehensive survey of mamba architectures for medical image analysis: Classification, segmentation, restoration and beyond,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.07161","last_updated":"2025-02-11T00:59:30Z","snapshot_observed_at":"2026-08-08T14:30:30.242810Z","submitted_at":"2025-02-11T00:59:30Z","title":"A Survey on Mamba Architecture for Vision Applications","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-08T13:40:59.460364Z"},"links":{"citing_paper":"/paper/2502.07161"},"observation_digest":"sha256:ba51f97d6da30f884729067c4903b09b5f53a4f34c9e01789b12144861a3530d","observation_id":"ef036012-28e5-472a-99a7-02689247054b","resolution":{"observed_at":"2026-08-08T13:40:59.460364Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.18861","last_updated":"2024-11-10T15:06:53Z","snapshot_observed_at":"2026-08-01T16:45:51.786403Z","submitted_at":"2024-04-29T16:51:30Z","title":"Visual Mamba: A Survey and New Outlooks","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.18861","snapshot_observed_at":"2026-08-08T13:40:59.464933Z","title":"A survey on vision mamba: Models, applications and challenges,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.07161","last_updated":"2025-02-11T00:59:30Z","snapshot_observed_at":"2026-08-08T14:30:30.242810Z","submitted_at":"2025-02-11T00:59:30Z","title":"A Survey on Mamba Architecture for Vision Applications","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-08T13:40:59.464933Z"},"links":{"cited_paper":"/paper/2404.18861","citing_paper":"/paper/2502.07161"},"observation_digest":"sha256:bdd1f12ba959925dab8866132991866fc3e5bdd37ab7f1a225206a39f9ba9a67","observation_id":"dd98d46c-61c6-4ba6-82ba-c6b1683e7117","resolution":{"observed_at":"2026-08-08T13:40:59.464933Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T13:40:59.469797Z","title":"A survey on visual mamba,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.07161","last_updated":"2025-02-11T00:59:30Z","snapshot_observed_at":"2026-08-08T14:30:30.242810Z","submitted_at":"2025-02-11T00:59:30Z","title":"A Survey on Mamba Architecture for Vision Applications","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-08T13:40:59.469797Z"},"links":{"citing_paper":"/paper/2502.07161"},"observation_digest":"sha256:ab8aae594fa0f9f18c8a8276ca074170eec5d61205a00d39d9ca22e01c923586","observation_id":"209bdb1a-5b3b-4531-b31e-9ced1b8ffc40","resolution":{"observed_at":"2026-08-08T13:40:59.469797Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T13:41:00.886614Z","title":"Comparison between first-order hold with zero-order hold in discretization of input-delay nonlinear systems,","venue":null,"work_id":"74340d37-7b20-4d03-b946-8f2886acf288","year":2007},"citing_paper":{"arxiv_id":"2502.07161","last_updated":"2025-02-11T00:59:30Z","snapshot_observed_at":"2026-08-08T14:30:30.242810Z","submitted_at":"2025-02-11T00:59:30Z","title":"A Survey on Mamba Architecture for Vision Applications","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-08T13:40:59.474192Z"},"links":{"citing_paper":"/paper/2502.07161"},"observation_digest":"sha256:2bbff30cdf9a463fc6cc6370cad4aaac35794be7374fcc2fc40c671851623c8b","observation_id":"ca2b8b02-d2b3-4aaf-9a01-bc324c755d88","resolution":{"observed_at":"2026-08-08T13:41:00.891438Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.10166","last_updated":"2024-12-29T14:57:13Z","snapshot_observed_at":"2026-07-06T17:17:31.008185Z","submitted_at":"2024-01-18T17:55:39Z","title":"VMamba: Visual State Space Model","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.10166","snapshot_observed_at":"2026-08-08T13:40:59.478823Z","title":"Vmamba: Visual state space model,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.07161","last_updated":"2025-02-11T00:59:30Z","snapshot_observed_at":"2026-08-08T14:30:30.242810Z","submitted_at":"2025-02-11T00:59:30Z","title":"A Survey on Mamba Architecture for Vision Applications","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-08T13:40:59.478823Z"},"links":{"cited_paper":"/paper/2401.10166","citing_paper":"/paper/2502.07161"},"observation_digest":"sha256:a9f1933546ddb855d03103262dcb61f4906bf96a06f8cd75414d37fcc7fd11ad","observation_id":"4178db16-4df7-48bd-bd70-7499ba93dcfa","resolution":{"observed_at":"2026-08-08T13:40:59.478823Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.14858","last_updated":"2025-05-30T00:13:05Z","snapshot_observed_at":"2026-08-03T14:30:52.105832Z","submitted_at":"2024-05-23T17:58:43Z","title":"Mamba-R: Vision Mamba ALSO Needs Registers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.14858","snapshot_observed_at":"2026-08-08T13:40:59.483832Z","title":"Mamba-r: Vision mamba also needs registers,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.07161","last_updated":"2025-02-11T00:59:30Z","snapshot_observed_at":"2026-08-08T14:30:30.242810Z","submitted_at":"2025-02-11T00:59:30Z","title":"A Survey on Mamba Architecture for Vision Applications","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-08T13:40:59.483832Z"},"links":{"cited_paper":"/paper/2405.14858","citing_paper":"/paper/2502.07161"},"observation_digest":"sha256:e0ce541e71b462807bdb4a78e2f3e171d01c7689dc84687c3cb6cfd37d43a3f6","observation_id":"71d6637c-3fbe-48c3-903f-27798fb6665f","resolution":{"observed_at":"2026-08-08T13:40:59.483832Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.18559","last_updated":"2024-08-04T04:08:59Z","snapshot_observed_at":"2026-07-06T18:52:16.703107Z","submitted_at":"2024-07-26T07:16:52Z","title":"VSSD: Vision Mamba with Non-Causal State Space Duality","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.18559","snapshot_observed_at":"2026-08-08T13:40:59.488875Z","title":"Vssd: Vision mamba with non- causal state space duality,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.07161","last_updated":"2025-02-11T00:59:30Z","snapshot_observed_at":"2026-08-08T14:30:30.242810Z","submitted_at":"2025-02-11T00:59:30Z","title":"A Survey on Mamba Architecture for Vision Applications","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-08T13:40:59.488875Z"},"links":{"cited_paper":"/paper/2407.18559","citing_paper":"/paper/2502.07161"},"observation_digest":"sha256:e25775259934ba5c29ca38351000fb8d9e1ef567498f1d3060648d8d521239d4","observation_id":"575f7fcb-4d09-475b-bf49-3b94dd235682","resolution":{"observed_at":"2026-08-08T13:40:59.488875Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.09338","last_updated":"2024-03-14T12:32:40Z","snapshot_observed_at":"2026-08-06T04:08:34.950441Z","submitted_at":"2024-03-14T12:32:40Z","title":"LocalMamba: Visual State Space Model with Windowed Selective Scan","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.09338","snapshot_observed_at":"2026-08-08T13:40:59.493735Z","title":"Localmamba: Visual state space model with windowed selective scan,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.07161","last_updated":"2025-02-11T00:59:30Z","snapshot_observed_at":"2026-08-08T14:30:30.242810Z","submitted_at":"2025-02-11T00:59:30Z","title":"A Survey on Mamba Architecture for Vision Applications","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-08T13:40:59.493735Z"},"links":{"cited_paper":"/paper/2403.09338","citing_paper":"/paper/2502.07161"},"observation_digest":"sha256:77af3b5e0710344fe8d50a3654b222aaeaa0b25bc9e39fe8f161bc84d4875fd0","observation_id":"2e9b1379-f5ff-477a-bfad-fc34f214b0fc","resolution":{"observed_at":"2026-08-08T13:40:59.493735Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T13:40:59.498453Z","title":"Mamba2d: A natively multi-dimensional state-space model for vision tasks,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.07161","last_updated":"2025-02-11T00:59:30Z","snapshot_observed_at":"2026-08-08T14:30:30.242810Z","submitted_at":"2025-02-11T00:59:30Z","title":"A Survey on Mamba Architecture for Vision Applications","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-08T13:40:59.498453Z"},"links":{"citing_paper":"/paper/2502.07161"},"observation_digest":"sha256:5eb2122423536bef061a4b1513770b3e99d6df52ed5c30175bd9a65cda807dac","observation_id":"bb0b2c40-ee28-4d2a-be3b-30faf05b9f70","resolution":{"observed_at":"2026-08-08T13:40:59.498453Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.15241","last_updated":"2025-03-22T02:46:19Z","snapshot_observed_at":"2026-07-06T19:55:42.238611Z","submitted_at":"2024-11-22T02:02:06Z","title":"EfficientViM: Efficient Vision Mamba with Hidden State Mixer based State Space Duality","version":2},"cited_work":{"arxiv_id":"2411.15241","doi":null,"metadata_source":"pith","pith_arxiv_id":"2411.15241","snapshot_observed_at":"2026-08-08T13:41:00.351566Z","title":"EfficientViM: Efficient Vision Mamba with Hidden State Mixer based State Space Duality","venue":"cs.CV","work_id":"b5cbce10-a12a-4693-ab49-1f1b15ec8b08","year":2024},"citing_paper":{"arxiv_id":"2502.07161","last_updated":"2025-02-11T00:59:30Z","snapshot_observed_at":"2026-08-08T14:30:30.242810Z","submitted_at":"2025-02-11T00:59:30Z","title":"A Survey on Mamba Architecture for Vision Applications","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-08T13:40:59.502890Z"},"links":{"cited_paper":"/paper/2411.15241","citing_paper":"/paper/2502.07161"},"observation_digest":"sha256:6d09c69700d5c747e62d65c4757486d318f0cdd59245b9e7c863653f5e471f81","observation_id":"2ba82ae4-3dde-4f04-80c6-c3ae013c5d22","resolution":{"observed_at":"2026-08-08T13:41:00.356683Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.21060","last_updated":"2024-05-31T17:50:01Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-05-31T17:50:01Z","title":"Transformers are SSMs: Generalized Models and Efficient Algorithms Through Structured State Space Duality","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.21060","snapshot_observed_at":"2026-08-08T13:40:59.507730Z","title":"Transformers are ssms: Generalized models and ef- ficient algorithms through structured state space duality,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.07161","last_updated":"2025-02-11T00:59:30Z","snapshot_observed_at":"2026-08-08T14:30:30.242810Z","submitted_at":"2025-02-11T00:59:30Z","title":"A Survey on Mamba Architecture for Vision Applications","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-08T13:40:59.507730Z"},"links":{"cited_paper":"/paper/2405.21060","citing_paper":"/paper/2502.07161"},"observation_digest":"sha256:acdcb9af1e1441d0c7238fddc7d4d05a24315e10d3633ab12ebefdd9b59277fc","observation_id":"52e3f2ff-15d6-47ed-a90d-4a5e1fa59d20","resolution":{"observed_at":"2026-08-08T13:40:59.507730Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T13:40:59.512620Z","title":"Vivit: A video vision transformer,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.07161","last_updated":"2025-02-11T00:59:30Z","snapshot_observed_at":"2026-08-08T14:30:30.242810Z","submitted_at":"2025-02-11T00:59:30Z","title":"A Survey on Mamba Architecture for Vision Applications","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-08T13:40:59.512620Z"},"links":{"citing_paper":"/paper/2502.07161"},"observation_digest":"sha256:f137fc361ac38c18912c6cee4e6f31772309f74cc4a8cd86c818c8ba72fdc106","observation_id":"971af3c4-120e-49d2-bcac-589d806e7f38","resolution":{"observed_at":"2026-08-08T13:40:59.512620Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.19006","last_updated":"2024-11-13T10:56:14Z","snapshot_observed_at":"2026-08-08T17:44:58.573773Z","submitted_at":"2024-06-27T08:45:31Z","title":"Snakes and Ladders: Two Steps Up for VideoMamba","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.19006","snapshot_observed_at":"2026-08-08T13:40:59.517392Z","title":"Videomambapro: A leap forward for mamba in video understanding,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.07161","last_updated":"2025-02-11T00:59:30Z","snapshot_observed_at":"2026-08-08T14:30:30.242810Z","submitted_at":"2025-02-11T00:59:30Z","title":"A Survey on Mamba Architecture for Vision Applications","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-08T13:40:59.517392Z"},"links":{"cited_paper":"/paper/2406.19006","citing_paper":"/paper/2502.07161"},"observation_digest":"sha256:35cab61e8fdb0ae95ac2bde920f05a4574b1c2ae0d9784e8c8df59ff9d57322f","observation_id":"94e6b906-42fc-491c-937f-b05e4922fbe3","resolution":{"observed_at":"2026-08-08T13:40:59.517392Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.09626","last_updated":"2024-03-14T17:57:07Z","snapshot_observed_at":"2026-07-06T17:44:45.924645Z","submitted_at":"2024-03-14T17:57:07Z","title":"Video Mamba Suite: State Space Model as a Versatile Alternative for Video Understanding","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.09626","snapshot_observed_at":"2026-08-08T13:40:59.522333Z","title":"Video mamba suite: State space model as a versatile alternative for video understanding,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.07161","last_updated":"2025-02-11T00:59:30Z","snapshot_observed_at":"2026-08-08T14:30:30.242810Z","submitted_at":"2025-02-11T00:59:30Z","title":"A Survey on Mamba Architecture for Vision Applications","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-08T13:40:59.522333Z"},"links":{"cited_paper":"/paper/2403.09626","citing_paper":"/paper/2502.07161"},"observation_digest":"sha256:0251b4b7514dd92bad31a32a251f8ee22b1a20041dc33a14f98d74ccfb54be7a","observation_id":"d0446e20-d227-437c-8b4e-437b6bc0d3e1","resolution":{"observed_at":"2026-08-08T13:40:59.522333Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.14168","last_updated":"2024-08-01T15:56:43Z","snapshot_observed_at":"2026-07-06T17:20:25.138890Z","submitted_at":"2024-01-25T13:27:03Z","title":"Vivim: a Video Vision Mamba for Medical Video Segmentation","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.14168","snapshot_observed_at":"2026-08-08T13:40:59.527417Z","title":"Vivim: a video vision mamba for medical video object segmentation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.07161","last_updated":"2025-02-11T00:59:30Z","snapshot_observed_at":"2026-08-08T14:30:30.242810Z","submitted_at":"2025-02-11T00:59:30Z","title":"A Survey on Mamba Architecture for Vision Applications","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-08T13:40:59.527417Z"},"links":{"cited_paper":"/paper/2401.14168","citing_paper":"/paper/2502.07161"},"observation_digest":"sha256:abc19675424cf88218bdc1fd41af6ef8e38b7172c660707e2054eefed4cc5792","observation_id":"47fba5fc-418b-4aa9-ad4e-4b70fa6bacaf","resolution":{"observed_at":"2026-08-08T13:40:59.527417Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T13:40:59.532223Z","title":"Imagenet classification with deep convolutional neural networks,","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2502.07161","last_updated":"2025-02-11T00:59:30Z","snapshot_observed_at":"2026-08-08T14:30:30.242810Z","submitted_at":"2025-02-11T00:59:30Z","title":"A Survey on Mamba Architecture for Vision Applications","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-08T13:40:59.532223Z"},"links":{"citing_paper":"/paper/2502.07161"},"observation_digest":"sha256:3e1eb32505c54426b52de479c94c0cc24d030db2a143caa0a0a22052408f616e","observation_id":"0b6d21ac-d807-4230-8ab2-42e52d94e3b5","resolution":{"observed_at":"2026-08-08T13:40:59.532223Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T13:40:59.536747Z","title":"Object detection with deep learning: A review,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2502.07161","last_updated":"2025-02-11T00:59:30Z","snapshot_observed_at":"2026-08-08T14:30:30.242810Z","submitted_at":"2025-02-11T00:59:30Z","title":"A Survey on Mamba Architecture for Vision Applications","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-08T13:40:59.536747Z"},"links":{"citing_paper":"/paper/2502.07161"},"observation_digest":"sha256:729f3adfc177e485c0caa2adda3f59001f1834f94aff45f0e4ed49e63217f1b4","observation_id":"b7938c73-9912-4c92-bcfc-5042630e53e6","resolution":{"observed_at":"2026-08-08T13:40:59.536747Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T13:40:59.541327Z","title":"Unified perceptual parsing for scene understanding,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2502.07161","last_updated":"2025-02-11T00:59:30Z","snapshot_observed_at":"2026-08-08T14:30:30.242810Z","submitted_at":"2025-02-11T00:59:30Z","title":"A Survey on Mamba Architecture for Vision Applications","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-08T13:40:59.541327Z"},"links":{"citing_paper":"/paper/2502.07161"},"observation_digest":"sha256:ac51e8844737eb56795a548a9c46ea65f41b4d87100451c49b4aacfdf26120c7","observation_id":"5854be4b-aa08-4cf7-846a-5f0baa6b7272","resolution":{"observed_at":"2026-08-08T13:40:59.541327Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T13:41:00.833290Z","title":"Meth- ods and datasets on semantic segmentation: A review,","venue":null,"work_id":"8f938851-173f-44f8-acf1-cb0bddf8ce57","year":2018},"citing_paper":{"arxiv_id":"2502.07161","last_updated":"2025-02-11T00:59:30Z","snapshot_observed_at":"2026-08-08T14:30:30.242810Z","submitted_at":"2025-02-11T00:59:30Z","title":"A Survey on Mamba Architecture for Vision Applications","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-08T13:40:59.546401Z"},"links":{"citing_paper":"/paper/2502.07161"},"observation_digest":"sha256:83075b4c26056123d795073a57c74023e357e3f86a68efa79916a43b04ed6ddb","observation_id":"9fc27851-cfc1-456d-af44-1a5e01e85e99","resolution":{"observed_at":"2026-08-08T13:41:00.838620Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T13:40:59.551303Z","title":"A brief survey on semantic segmentation with deep learning,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2502.07161","last_updated":"2025-02-11T00:59:30Z","snapshot_observed_at":"2026-08-08T14:30:30.242810Z","submitted_at":"2025-02-11T00:59:30Z","title":"A Survey on Mamba Architecture for Vision Applications","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-08T13:40:59.551303Z"},"links":{"citing_paper":"/paper/2502.07161"},"observation_digest":"sha256:d7de70944dbe84feacfcbd8d1ae87cace783784387e928bdeb01ce88975f9a9d","observation_id":"2709c6f9-7e44-42e3-9b95-3439d6531afa","resolution":{"observed_at":"2026-08-08T13:40:59.551303Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.05743","last_updated":"2024-09-10T09:07:35Z","snapshot_observed_at":"2026-07-06T18:59:21.352885Z","submitted_at":"2024-08-11T10:42:22Z","title":"Neural Architecture Search based Global-local Vision Mamba for Palm-Vein Recognition","version":4},"cited_work":{"arxiv_id":"2408.05743","doi":null,"metadata_source":"pith","pith_arxiv_id":"2408.05743","snapshot_observed_at":"2026-08-08T13:41:00.267996Z","title":"Neural Architecture Search based Global-local Vision Mamba for Palm-Vein Recognition","venue":"cs.CV","work_id":"f39bec55-206b-4c9a-a88e-9e24aad3c6f5","year":2024},"citing_paper":{"arxiv_id":"2502.07161","last_updated":"2025-02-11T00:59:30Z","snapshot_observed_at":"2026-08-08T14:30:30.242810Z","submitted_at":"2025-02-11T00:59:30Z","title":"A Survey on Mamba Architecture for Vision Applications","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-08T13:40:59.555796Z"},"links":{"cited_paper":"/paper/2408.05743","citing_paper":"/paper/2502.07161"},"observation_digest":"sha256:8ff56128f594678d00e1efe300745a6e5222ea37df634f026c99c03630b50ff2","observation_id":"ad883d6d-6d29-4db0-a921-0bba7ab9c90b","resolution":{"observed_at":"2026-08-08T13:41:00.274007Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.16722","last_updated":"2024-06-24T15:27:21Z","snapshot_observed_at":"2026-07-06T18:36:07.983955Z","submitted_at":"2024-06-24T15:27:21Z","title":"Venturing into Uncharted Waters: The Navigation Compass from Transformer to Mamba","version":1},"cited_work":{"arxiv_id":"2406.16722","doi":null,"metadata_source":"pith","pith_arxiv_id":"2406.16722","snapshot_observed_at":"2026-08-08T13:41:00.247083Z","title":"Venturing into Uncharted Waters: The Navigation Compass from Transformer to Mamba","venue":"cs.CL","work_id":"bb1e123c-ef5c-4c85-ab0b-31e2b8544d84","year":2024},"citing_paper":{"arxiv_id":"2502.07161","last_updated":"2025-02-11T00:59:30Z","snapshot_observed_at":"2026-08-08T14:30:30.242810Z","submitted_at":"2025-02-11T00:59:30Z","title":"A Survey on Mamba Architecture for Vision Applications","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-08T13:40:59.560749Z"},"links":{"cited_paper":"/paper/2406.16722","citing_paper":"/paper/2502.07161"},"observation_digest":"sha256:6d8bee3c35f885a2bf02895fd29325d2422d30e1b36359c8ea4ac5c96e777027","observation_id":"4754307d-0ad8-4e5f-947a-81b62369a1ea","resolution":{"observed_at":"2026-08-08T13:41:00.252432Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.12673","last_updated":"2026-05-23T15:37:31Z","snapshot_observed_at":"2026-08-01T04:56:58.811886Z","submitted_at":"2024-10-16T15:37:29Z","title":"MambaBEV: An EV-based 3D detection model with Mamba2","version":3},"cited_work":{"arxiv_id":"2410.12673","doi":null,"metadata_source":"pith","pith_arxiv_id":"2410.12673","snapshot_observed_at":"2026-08-08T13:41:00.224755Z","title":"MambaBEV: An EV-based 3D detection model with Mamba2","venue":"cs.CV","work_id":"f01184fd-ec6a-48e8-9960-e5e28092262b","year":2024},"citing_paper":{"arxiv_id":"2502.07161","last_updated":"2025-02-11T00:59:30Z","snapshot_observed_at":"2026-08-08T14:30:30.242810Z","submitted_at":"2025-02-11T00:59:30Z","title":"A Survey on Mamba Architecture for Vision Applications","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-08T13:40:59.565831Z"},"links":{"cited_paper":"/paper/2410.12673","citing_paper":"/paper/2502.07161"},"observation_digest":"sha256:b9fc9974a027a5cf6f1c90619f17922b7941aba9680c05d373972a89b9a6f5e7","observation_id":"26a8c319-3df8-4730-864f-38db2a855715","resolution":{"observed_at":"2026-08-08T13:41:00.230117Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.17695","last_updated":"2024-08-15T14:30:02Z","snapshot_observed_at":"2026-08-08T14:30:13.287782Z","submitted_at":"2024-03-26T13:35:10Z","title":"PlainMamba: Improving Non-Hierarchical Mamba in Visual Recognition","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.17695","snapshot_observed_at":"2026-08-08T13:40:59.570969Z","title":"Plainmamba: Improving non-hierarchical mamba in visual recognition,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.07161","last_updated":"2025-02-11T00:59:30Z","snapshot_observed_at":"2026-08-08T14:30:30.242810Z","submitted_at":"2025-02-11T00:59:30Z","title":"A Survey on Mamba Architecture for Vision Applications","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-08T13:40:59.570969Z"},"links":{"cited_paper":"/paper/2403.17695","citing_paper":"/paper/2502.07161"},"observation_digest":"sha256:35594ad8bf0740147b5b5210b5a7fcde5bfb944da67e243743a39d4ec18ce6f6","observation_id":"3cd8286c-9eff-4435-a197-d8b359240a3c","resolution":{"observed_at":"2026-08-08T13:40:59.570969Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.15091","last_updated":"2025-02-26T14:20:02Z","snapshot_observed_at":"2026-07-06T19:36:27.984192Z","submitted_at":"2024-10-19T12:56:58Z","title":"Spatial-Mamba: Effective Visual State Space Models via Structure-aware State Fusion","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.15091","snapshot_observed_at":"2026-08-08T13:40:59.575695Z","title":"Spatial-mamba: Effective visual state space models via structure-aware state fusion,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.07161","last_updated":"2025-02-11T00:59:30Z","snapshot_observed_at":"2026-08-08T14:30:30.242810Z","submitted_at":"2025-02-11T00:59:30Z","title":"A Survey on Mamba Architecture for Vision Applications","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-08T13:40:59.575695Z"},"links":{"cited_paper":"/paper/2410.15091","citing_paper":"/paper/2502.07161"},"observation_digest":"sha256:ea8dd2239a264c3d9bf6abcaf75db118cb480aac29da14a3698e3db17bb4102a","observation_id":"288e5ca1-92af-4478-9942-a9a8e1dc6137","resolution":{"observed_at":"2026-08-08T13:40:59.575695Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.09808","last_updated":"2024-10-06T16:34:48Z","snapshot_observed_at":"2026-08-04T21:59:46.369927Z","submitted_at":"2024-09-15T18:02:26Z","title":"Famba-V: Fast Vision Mamba with Cross-Layer Token Fusion","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.09808","snapshot_observed_at":"2026-08-08T13:40:59.580532Z","title":"Famba-v: Fast vision mamba with cross-layer token fusion,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.07161","last_updated":"2025-02-11T00:59:30Z","snapshot_observed_at":"2026-08-08T14:30:30.242810Z","submitted_at":"2025-02-11T00:59:30Z","title":"A Survey on Mamba Architecture for Vision Applications","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-08T13:40:59.580532Z"},"links":{"cited_paper":"/paper/2409.09808","citing_paper":"/paper/2502.07161"},"observation_digest":"sha256:743585478eb4e83213cdfe6a4c0bc47e220d729da46076bebe9504c28a2b32d2","observation_id":"a2cdb792-40f2-4704-bd79-15df2e205a70","resolution":{"observed_at":"2026-08-08T13:40:59.580532Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T13:40:59.585301Z","title":"Towards accurate post-training quantization for vision transformer,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.07161","last_updated":"2025-02-11T00:59:30Z","snapshot_observed_at":"2026-08-08T14:30:30.242810Z","submitted_at":"2025-02-11T00:59:30Z","title":"A Survey on Mamba Architecture for Vision Applications","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-08T13:40:59.585301Z"},"links":{"citing_paper":"/paper/2502.07161"},"observation_digest":"sha256:0e2369613c5e3889de0da63af2b26d8c669aa404a22d01a2c0bdcaa0be10d1bc","observation_id":"e348e3e8-bf82-49c4-8df9-a58e5327f133","resolution":{"observed_at":"2026-08-08T13:40:59.585301Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.09461","last_updated":"2023-03-01T19:45:11Z","snapshot_observed_at":"2026-07-06T14:06:56.291161Z","submitted_at":"2022-10-17T22:23:40Z","title":"Token Merging: Your ViT But Faster","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.09461","snapshot_observed_at":"2026-08-08T13:40:59.589697Z","title":"Token merging: Your vit but faster,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.07161","last_updated":"2025-02-11T00:59:30Z","snapshot_observed_at":"2026-08-08T14:30:30.242810Z","submitted_at":"2025-02-11T00:59:30Z","title":"A Survey on Mamba Architecture for Vision Applications","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-08T13:40:59.589697Z"},"links":{"cited_paper":"/paper/2210.09461","citing_paper":"/paper/2502.07161"},"observation_digest":"sha256:24a0cd48ee5a9f15953daeaf9006f3a3f5004008e6ebf1fb3a08e8efe1d99dcd","observation_id":"3dd8351c-d96c-4f16-8722-4438b50dd360","resolution":{"observed_at":"2026-08-08T13:40:59.589697Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.17530","last_updated":"2023-05-27T17:16:27Z","snapshot_observed_at":"2026-07-06T15:34:21.966171Z","submitted_at":"2023-05-27T17:16:27Z","title":"PuMer: Pruning and Merging Tokens for Efficient Vision Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.17530","snapshot_observed_at":"2026-08-08T13:40:59.594437Z","title":"Pumer: Pruning and merg- ing tokens for efficient vision language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.07161","last_updated":"2025-02-11T00:59:30Z","snapshot_observed_at":"2026-08-08T14:30:30.242810Z","submitted_at":"2025-02-11T00:59:30Z","title":"A Survey on Mamba Architecture for Vision Applications","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-08T13:40:59.594437Z"},"links":{"cited_paper":"/paper/2305.17530","citing_paper":"/paper/2502.07161"},"observation_digest":"sha256:de19f374a627c88793f2397279733468702f451ca3835e205d93c83bd06e5a30","observation_id":"c2cc6f93-3ff4-4c25-a630-e9e490d7563b","resolution":{"observed_at":"2026-08-08T13:40:59.594437Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.10140","last_updated":"2024-10-14T04:15:04Z","snapshot_observed_at":"2026-07-06T19:32:46.742766Z","submitted_at":"2024-10-14T04:15:04Z","title":"Hi-Mamba: Hierarchical Mamba for Efficient Image Super-Resolution","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.10140","snapshot_observed_at":"2026-08-08T13:40:59.598951Z","title":"Hi-mamba: Hierarchical mamba for efficient image super-resolution,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.07161","last_updated":"2025-02-11T00:59:30Z","snapshot_observed_at":"2026-08-08T14:30:30.242810Z","submitted_at":"2025-02-11T00:59:30Z","title":"A Survey on Mamba Architecture for Vision Applications","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-08T13:40:59.598951Z"},"links":{"cited_paper":"/paper/2410.10140","citing_paper":"/paper/2502.07161"},"observation_digest":"sha256:8980889552a1e63f868b48962b4a3e2d9decd52d7f1694f3864d0723759aa215","observation_id":"c526bfd0-aa12-4f97-8638-f3d729e9a41d","resolution":{"observed_at":"2026-08-08T13:40:59.598951Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2111.00396","last_updated":"2022-08-05T17:54:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-10-31T03:32:18Z","title":"Efficiently Modeling Long Sequences with Structured State Spaces","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2111.00396","snapshot_observed_at":"2026-08-08T13:40:59.603952Z","title":"Efficiently modeling long sequences with structured state spaces,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.07161","last_updated":"2025-02-11T00:59:30Z","snapshot_observed_at":"2026-08-08T14:30:30.242810Z","submitted_at":"2025-02-11T00:59:30Z","title":"A Survey on Mamba Architecture for Vision Applications","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-08T13:40:59.603952Z"},"links":{"cited_paper":"/paper/2111.00396","citing_paper":"/paper/2502.07161"},"observation_digest":"sha256:6cdd6c3818ff5cbab17ec4feb3a84ec42225b2d6ec60211fe361aaa5b14697bf","observation_id":"d33a8e67-4932-4eb1-a354-e2994e19ab3a","resolution":{"observed_at":"2026-08-08T13:40:59.603952Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T13:40:59.608796Z","title":"Mask r-cnn,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2502.07161","last_updated":"2025-02-11T00:59:30Z","snapshot_observed_at":"2026-08-08T14:30:30.242810Z","submitted_at":"2025-02-11T00:59:30Z","title":"A Survey on Mamba Architecture for Vision Applications","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-08T13:40:59.608796Z"},"links":{"citing_paper":"/paper/2502.07161"},"observation_digest":"sha256:96846ff7573a43d22c3f294505c7b8bd64f10f058b5e6f3c65b73f3f2058e92e","observation_id":"ef1cd1dd-f80a-4607-b975-bdf65f8667e4","resolution":{"observed_at":"2026-08-08T13:40:59.608796Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T13:40:59.613074Z","title":"Imagenet: A large-scale hierarchical image database,","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2502.07161","last_updated":"2025-02-11T00:59:30Z","snapshot_observed_at":"2026-08-08T14:30:30.242810Z","submitted_at":"2025-02-11T00:59:30Z","title":"A Survey on Mamba Architecture for Vision Applications","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-08T13:40:59.613074Z"},"links":{"citing_paper":"/paper/2502.07161"},"observation_digest":"sha256:e30d982fd58603cfd29b1af26abbd8f6af85235512fd3f489e2b8378620dd200","observation_id":"07bb3982-387a-4388-b724-9f9c0b173966","resolution":{"observed_at":"2026-08-08T13:40:59.613074Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T13:40:59.617404Z","title":"Semantic understanding of scenes through the ade20k dataset,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2502.07161","last_updated":"2025-02-11T00:59:30Z","snapshot_observed_at":"2026-08-08T14:30:30.242810Z","submitted_at":"2025-02-11T00:59:30Z","title":"A Survey on Mamba Architecture for Vision Applications","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-08T13:40:59.617404Z"},"links":{"citing_paper":"/paper/2502.07161"},"observation_digest":"sha256:773261db7dda8b71d0521aa136e65cd17362df1f8e07f02fe36957633a814343","observation_id":"aa0e6627-1a06-4706-97a2-d376a09ae8e6","resolution":{"observed_at":"2026-08-08T13:40:59.617404Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T13:40:59.622115Z","title":"Microsoft coco: Common objects in context,","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2502.07161","last_updated":"2025-02-11T00:59:30Z","snapshot_observed_at":"2026-08-08T14:30:30.242810Z","submitted_at":"2025-02-11T00:59:30Z","title":"A Survey on Mamba Architecture for Vision Applications","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-08T13:40:59.622115Z"},"links":{"citing_paper":"/paper/2502.07161"},"observation_digest":"sha256:63e472bab1a8ff97a33ae12fd9309a6a31fc080c39ecd5711bbb805b7101fee9","observation_id":"45e729d5-c3b4-4c09-99ac-bd511b3632e1","resolution":{"observed_at":"2026-08-08T13:40:59.622115Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1705.06950","last_updated":"2017-05-19T12:07:01Z","snapshot_observed_at":"2026-08-08T17:46:50.107463Z","submitted_at":"2017-05-19T12:07:01Z","title":"The Kinetics Human Action Video Dataset","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1705.06950","snapshot_observed_at":"2026-08-08T13:40:59.626623Z","title":"The kinetics human action video dataset,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2502.07161","last_updated":"2025-02-11T00:59:30Z","snapshot_observed_at":"2026-08-08T14:30:30.242810Z","submitted_at":"2025-02-11T00:59:30Z","title":"A Survey on Mamba Architecture for Vision Applications","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-08T13:40:59.626623Z"},"links":{"cited_paper":"/paper/1705.06950","citing_paper":"/paper/2502.07161"},"observation_digest":"sha256:37fad8185c347a309c25b49dfa4fc1e5f970e15dfec7fb0d1dc3b700ac07a084","observation_id":"aa0d2196-c9df-48fe-8bb3-a07933ead893","resolution":{"observed_at":"2026-08-08T13:40:59.626623Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T13:41:00.759711Z","title":"Quo vadis, action recognition? a new model and the kinetics dataset,","venue":null,"work_id":"d8a12d08-9328-410d-b877-39b8034e05fe","year":2017},"citing_paper":{"arxiv_id":"2502.07161","last_updated":"2025-02-11T00:59:30Z","snapshot_observed_at":"2026-08-08T14:30:30.242810Z","submitted_at":"2025-02-11T00:59:30Z","title":"A Survey on Mamba Architecture for Vision Applications","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-08T13:40:59.631219Z"},"links":{"citing_paper":"/paper/2502.07161"},"observation_digest":"sha256:d7ba82a29d39c7b068c1b3b6ee593da6f11f9ee53d43873185abc508e769e6cb","observation_id":"bdeab26d-9ee4-4718-88d6-ae526c667bb2","resolution":{"observed_at":"2026-08-08T13:41:00.764866Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T13:41:00.744061Z","title":"The” something something","venue":null,"work_id":"d217684e-3a4f-4924-ad85-05aaa0e785c3","year":2017},"citing_paper":{"arxiv_id":"2502.07161","last_updated":"2025-02-11T00:59:30Z","snapshot_observed_at":"2026-08-08T14:30:30.242810Z","submitted_at":"2025-02-11T00:59:30Z","title":"A Survey on Mamba Architecture for Vision Applications","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-08T13:40:59.635841Z"},"links":{"citing_paper":"/paper/2502.07161"},"observation_digest":"sha256:906ac6f3b537c5aaab5edac5a4b0060da12f27400c2f71edc31c002c8cf64cf5","observation_id":"579b4497-7fdd-4bcb-8b86-c4c1e5b0cb38","resolution":{"observed_at":"2026-08-08T13:41:00.749265Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T13:40:59.640667Z","title":"Masked-attention mask transformer for universal image segmentation,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.07161","last_updated":"2025-02-11T00:59:30Z","snapshot_observed_at":"2026-08-08T14:30:30.242810Z","submitted_at":"2025-02-11T00:59:30Z","title":"A Survey on Mamba Architecture for Vision Applications","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-08T13:40:59.640667Z"},"links":{"citing_paper":"/paper/2502.07161"},"observation_digest":"sha256:0f9983130ba73ec29a04c428ebf9df60bbe3e1896fc3630f29a5a9fb04980e59","observation_id":"cebced32-002d-4a55-891c-36a33637cca8","resolution":{"observed_at":"2026-08-08T13:40:59.640667Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.17366","last_updated":"2024-12-23T08:03:59Z","snapshot_observed_at":"2026-07-06T20:12:00.084345Z","submitted_at":"2024-12-23T08:03:59Z","title":"FlowMamba: Learning Point Cloud Scene Flow with Global Motion Propagation","version":1},"cited_work":{"arxiv_id":"2412.17366","doi":null,"metadata_source":"pith","pith_arxiv_id":"2412.17366","snapshot_observed_at":"2026-08-08T13:41:00.076691Z","title":"FlowMamba: Learning Point Cloud Scene Flow with Global Motion Propagation","venue":"cs.CV","work_id":"7bc407b4-0d46-482d-83d1-31932c2b8f72","year":2024},"citing_paper":{"arxiv_id":"2502.07161","last_updated":"2025-02-11T00:59:30Z","snapshot_observed_at":"2026-08-08T14:30:30.242810Z","submitted_at":"2025-02-11T00:59:30Z","title":"A Survey on Mamba Architecture for Vision Applications","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-08T13:40:59.645248Z"},"links":{"cited_paper":"/paper/2412.17366","citing_paper":"/paper/2502.07161"},"observation_digest":"sha256:9e999c349133a377eb3e7a8db8ca38f16d6c6c08ce27b503a539c2f83d7a48a7","observation_id":"41ec4869-cbb5-4a6e-a287-54e6f475e483","resolution":{"observed_at":"2026-08-08T13:41:00.082057Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T13:41:00.719669Z","title":"Pv-ssm: Exploring pure visual state space model for high-dimensional medical data analysis,","venue":null,"work_id":"1ae5bdc1-ef20-4ab4-9f66-50fe6efe17ed","year":2024},"citing_paper":{"arxiv_id":"2502.07161","last_updated":"2025-02-11T00:59:30Z","snapshot_observed_at":"2026-08-08T14:30:30.242810Z","submitted_at":"2025-02-11T00:59:30Z","title":"A Survey on Mamba Architecture for Vision Applications","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-08T13:40:59.650010Z"},"links":{"citing_paper":"/paper/2502.07161"},"observation_digest":"sha256:48052954164d7874a80b1fe4891feec580f901eec46385fc9d174c5e2a895c61","observation_id":"d35c39d5-109c-4a77-b87f-628952b870c5","resolution":{"observed_at":"2026-08-08T13:41:00.724609Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.01405","last_updated":"2024-12-02T11:49:49Z","snapshot_observed_at":"2026-07-06T20:00:09.775334Z","submitted_at":"2024-12-02T11:49:49Z","title":"MambaU-Lite: A Lightweight Model based on Mamba and Integrated Channel-Spatial Attention for Skin Lesion Segmentation","version":1},"cited_work":{"arxiv_id":"2412.01405","doi":null,"metadata_source":"pith","pith_arxiv_id":"2412.01405","snapshot_observed_at":"2026-08-08T13:41:00.053823Z","title":"MambaU-Lite: A Lightweight Model based on Mamba and Integrated Channel-Spatial Attention for Skin Lesion Segmentation","venue":"cs.CV","work_id":"cc3e49ba-b2a2-4b17-80f8-0a3c38819604","year":2024},"citing_paper":{"arxiv_id":"2502.07161","last_updated":"2025-02-11T00:59:30Z","snapshot_observed_at":"2026-08-08T14:30:30.242810Z","submitted_at":"2025-02-11T00:59:30Z","title":"A Survey on Mamba Architecture for Vision Applications","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-08T13:40:59.654508Z"},"links":{"cited_paper":"/paper/2412.01405","citing_paper":"/paper/2502.07161"},"observation_digest":"sha256:04ca1bc3905e4294c006784865f91ba0300f66b3d999f08d177eec385ed85852","observation_id":"4a12e345-f469-4ac2-839f-8cfb3582ea43","resolution":{"observed_at":"2026-08-08T13:41:00.058940Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T13:40:59.659094Z","title":"Shuffle mamba: State space models with random shuffle for multi-modal image fusion,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.07161","last_updated":"2025-02-11T00:59:30Z","snapshot_observed_at":"2026-08-08T14:30:30.242810Z","submitted_at":"2025-02-11T00:59:30Z","title":"A Survey on Mamba Architecture for Vision Applications","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-08T13:40:59.659094Z"},"links":{"citing_paper":"/paper/2502.07161"},"observation_digest":"sha256:eba6d5843b69749bc9b1c448bb26c78ab7d2841adf6998f44aa8686a65defbf0","observation_id":"521a8c6a-ac4e-48a3-a2f2-faaade30ec32","resolution":{"observed_at":"2026-08-08T13:40:59.659094Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.15015","last_updated":"2024-10-19T07:08:40Z","snapshot_observed_at":"2026-07-06T19:36:23.905725Z","submitted_at":"2024-10-19T07:08:40Z","title":"MambaSOD: Dual Mamba-Driven Cross-Modal Fusion Network for RGB-D Salient Object Detection","version":1},"cited_work":{"arxiv_id":"2410.15015","doi":null,"metadata_source":"pith","pith_arxiv_id":"2410.15015","snapshot_observed_at":"2026-08-08T13:40:59.947214Z","title":"MambaSOD: Dual Mamba-Driven Cross-Modal Fusion Network for RGB-D Salient Object Detection","venue":"cs.CV","work_id":"6218e97d-8e84-4779-8a32-b1614cac18d7","year":2024},"citing_paper":{"arxiv_id":"2502.07161","last_updated":"2025-02-11T00:59:30Z","snapshot_observed_at":"2026-08-08T14:30:30.242810Z","submitted_at":"2025-02-11T00:59:30Z","title":"A Survey on Mamba Architecture for Vision Applications","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-08T13:40:59.664159Z"},"links":{"cited_paper":"/paper/2410.15015","citing_paper":"/paper/2502.07161"},"observation_digest":"sha256:f0b6caa878ac2a93b1fe81cbd9c3d0dc092cef5bfa31e6b949125022ba216f41","observation_id":"47bc694a-3889-4e68-bca2-6584b7fd8294","resolution":{"observed_at":"2026-08-08T13:40:59.952427Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.00151","last_updated":"2024-10-31T18:58:40Z","snapshot_observed_at":"2026-08-07T17:08:31.625744Z","submitted_at":"2024-10-31T18:58:40Z","title":"NIMBA: Towards Robust and Principled Processing of Point Clouds With SSMs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.00151","snapshot_observed_at":"2026-08-08T13:40:59.668993Z","title":"Nimba: Towards robust and principled processing of point clouds with ssms,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.07161","last_updated":"2025-02-11T00:59:30Z","snapshot_observed_at":"2026-08-08T14:30:30.242810Z","submitted_at":"2025-02-11T00:59:30Z","title":"A Survey on Mamba Architecture for Vision Applications","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-08T13:40:59.668993Z"},"links":{"cited_paper":"/paper/2411.00151","citing_paper":"/paper/2502.07161"},"observation_digest":"sha256:f45388f796f798f4c69fc6e22aa95c294d3488525c654047d3d0197852c72f13","observation_id":"61474d01-7a16-4996-9b52-af9784f6ee83","resolution":{"observed_at":"2026-08-08T13:40:59.668993Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.12319","last_updated":"2024-07-17T05:26:58Z","snapshot_observed_at":"2026-07-06T18:47:37.971415Z","submitted_at":"2024-07-17T05:26:58Z","title":"Serialized Point Mamba: A Serialized Point Cloud Mamba Segmentation Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.12319","snapshot_observed_at":"2026-08-08T13:40:59.673820Z","title":"Serialized point mamba: A serialized point cloud mamba segmentation model,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.07161","last_updated":"2025-02-11T00:59:30Z","snapshot_observed_at":"2026-08-08T14:30:30.242810Z","submitted_at":"2025-02-11T00:59:30Z","title":"A Survey on Mamba Architecture for Vision Applications","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-08T13:40:59.673820Z"},"links":{"cited_paper":"/paper/2407.12319","citing_paper":"/paper/2502.07161"},"observation_digest":"sha256:05be1bde07b7cff1c81560bb70d8dbfde00725e13e33558288f2655d97e958b7","observation_id":"e9a7d187-c4ef-4ffd-8134-5ccaa0547388","resolution":{"observed_at":"2026-08-08T13:40:59.673820Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.05835","last_updated":"2024-12-14T03:50:47Z","snapshot_observed_at":"2026-07-06T18:27:50.189771Z","submitted_at":"2024-06-09T15:56:19Z","title":"Mamba YOLO: A Simple Baseline for Object Detection with State Space Model","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.05835","snapshot_observed_at":"2026-08-08T13:40:59.678691Z","title":"Mamba yolo: Ssms-based yolo for object detection,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.07161","last_updated":"2025-02-11T00:59:30Z","snapshot_observed_at":"2026-08-08T14:30:30.242810Z","submitted_at":"2025-02-11T00:59:30Z","title":"A Survey on Mamba Architecture for Vision Applications","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-08T13:40:59.678691Z"},"links":{"cited_paper":"/paper/2406.05835","citing_paper":"/paper/2502.07161"},"observation_digest":"sha256:6c9907a9ff561cfb8c96d10f084ed85dbed414f25a3a469ecd92c3300d66a308","observation_id":"a3fd4c72-53c0-45d0-aa1d-0414c9a00486","resolution":{"observed_at":"2026-08-08T13:40:59.678691Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T13:41:00.704543Z","title":"Pillarmamba: A lightweight mamba-based model for 3d object detection,","venue":null,"work_id":"025ef5c9-419e-4360-820b-56b2986b3e28","year":2024},"citing_paper":{"arxiv_id":"2502.07161","last_updated":"2025-02-11T00:59:30Z","snapshot_observed_at":"2026-08-08T14:30:30.242810Z","submitted_at":"2025-02-11T00:59:30Z","title":"A Survey on Mamba Architecture for Vision Applications","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-08T13:40:59.683426Z"},"links":{"citing_paper":"/paper/2502.07161"},"observation_digest":"sha256:cf77c2a9763ac5ccea263700f9db36fb8d6667693671a7d534edc5ce76694f8a","observation_id":"88371fa8-2444-4bb9-abf7-d92e7dc96143","resolution":{"observed_at":"2026-08-08T13:41:00.709417Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.13628","last_updated":"2024-11-20T14:47:18Z","snapshot_observed_at":"2026-07-06T19:53:25.777341Z","submitted_at":"2024-11-20T14:47:18Z","title":"MambaDETR: Query-based Temporal Modeling using State Space Model for Multi-View 3D Object Detection","version":1},"cited_work":{"arxiv_id":"2411.13628","doi":null,"metadata_source":"pith","pith_arxiv_id":"2411.13628","snapshot_observed_at":"2026-08-08T13:40:59.880710Z","title":"MambaDETR: Query-based Temporal Modeling using State Space Model for Multi-View 3D Object Detection","venue":"cs.CV","work_id":"4363b489-b813-488a-91c8-d0f38ae0b1bd","year":2024},"citing_paper":{"arxiv_id":"2502.07161","last_updated":"2025-02-11T00:59:30Z","snapshot_observed_at":"2026-08-08T14:30:30.242810Z","submitted_at":"2025-02-11T00:59:30Z","title":"A Survey on Mamba Architecture for Vision Applications","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-08T13:40:59.687757Z"},"links":{"cited_paper":"/paper/2411.13628","citing_paper":"/paper/2502.07161"},"observation_digest":"sha256:1aa953eba227c6e38d74fe7eb549da094207ca5b113302deaa3f1164e2705813","observation_id":"e5a74ee5-a612-4744-ac26-c9103f4cc6ab","resolution":{"observed_at":"2026-08-08T13:40:59.885828Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.16384","last_updated":"2025-01-25T05:25:20Z","snapshot_observed_at":"2026-07-06T20:27:00.165620Z","submitted_at":"2025-01-25T05:25:20Z","title":"MambaTron: Efficient Cross-Modal Point Cloud Enhancement using Aggregate Selective State Space Modeling","version":1},"cited_work":{"arxiv_id":"2501.16384","doi":null,"metadata_source":"pith","pith_arxiv_id":"2501.16384","snapshot_observed_at":"2026-08-08T13:40:59.856378Z","title":"MambaTron: Efficient Cross-Modal Point Cloud Enhancement using Aggregate Selective State Space Modeling","venue":"cs.CV","work_id":"d5117f04-29f2-4866-93d1-d157868d080d","year":2025},"citing_paper":{"arxiv_id":"2502.07161","last_updated":"2025-02-11T00:59:30Z","snapshot_observed_at":"2026-08-08T14:30:30.242810Z","submitted_at":"2025-02-11T00:59:30Z","title":"A Survey on Mamba Architecture for Vision Applications","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-08T13:40:59.692593Z"},"links":{"cited_paper":"/paper/2501.16384","citing_paper":"/paper/2502.07161"},"observation_digest":"sha256:335460f4520bc080c61d00945f5353dcc97d5ee440518c021f722b4b7c080479","observation_id":"fad22f8c-1f0f-407d-a562-b8863431b45a","resolution":{"observed_at":"2026-08-08T13:40:59.863551Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T13:40:59.697257Z","title":"Ms-temba: Multi- scale temporal mamba for efficient temporal action detection,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2502.07161","last_updated":"2025-02-11T00:59:30Z","snapshot_observed_at":"2026-08-08T14:30:30.242810Z","submitted_at":"2025-02-11T00:59:30Z","title":"A Survey on Mamba Architecture for Vision Applications","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-08T13:40:59.697257Z"},"links":{"citing_paper":"/paper/2502.07161"},"observation_digest":"sha256:47a024e5c7bf67ac9ae1460fb96ed9f59c6c76ce439e8ebe8f0a6453985b248a","observation_id":"27d0e446-e4db-45be-a137-e12ba369ea14","resolution":{"observed_at":"2026-08-08T13:40:59.697257Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2502.07161","last_updated":"2025-02-11T00:59:30Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-08T14:30:30.242810Z","submitted_at":"2025-02-11T00:59:30Z","title":"A Survey on Mamba Architecture for Vision Applications"},"reference_resolution":{"displayed":70,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":47,"verified_exact":9,"verified_fuzzy":14},"total_outbound_references":70},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 70 of 70 outbound references and 2 inbound Pith citation observations for arXiv:2502.07161."}