{"as_of":"2026-08-08T13:11:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:d0526a6c96268eb1f26eb57d1cbebfcffefdad9ceead1ad8c77bbc4f25d5a89e","coverage":[{"denominator":36,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":36,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T05:21:37.303004Z","state":"measured"},{"denominator":38,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":38,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-02T01:25:52.762836Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-13T07:17:29.550333Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.08297","last_updated":"2026-07-16T07:47:36Z","snapshot_observed_at":"2026-08-07T05:11:43.450115Z","submitted_at":"2025-06-10T00:03:19Z","title":"SEMA: a Scalable and Efficient Mamba like Attention via Token Localization and Averaging","version":2},"cited_work":{"arxiv_id":"2506.08297","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.08297","snapshot_observed_at":"2026-07-17T01:20:35.902956Z","title":"arXiv:2506.08297, to appear in Intern","venue":null,"work_id":"45ef6f13-acb1-4130-b443-3496eabdaa44","year":2026},"citing_paper":{"arxiv_id":"2605.11131","last_updated":"2026-05-11T18:40:13Z","snapshot_observed_at":"2026-07-06T23:23:02.025664Z","submitted_at":"2026-05-11T18:40:13Z","title":"USEMA: a Scalable Efficient Mamba Like Attention for Medical Image Segmentation","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-13T07:13:37.134769Z"},"links":{"cited_paper":"/paper/2506.08297","citing_paper":"/paper/2605.11131"},"observation_digest":"sha256:054c6a64d4b0a80b32cd17ee3946a95ffcaeaa8fa2925928b474d264bd3c4ce7","observation_id":"23b7e9c4-8eda-424e-8658-2c99eec65b92","resolution":{"observed_at":"2026-07-17T01:20:35.902956Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.08297","last_updated":"2026-07-16T07:47:36Z","snapshot_observed_at":"2026-08-07T05:11:43.450115Z","submitted_at":"2025-06-10T00:03:19Z","title":"SEMA: a Scalable and Efficient Mamba like Attention via Token Localization and Averaging","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.08297","snapshot_observed_at":"2026-08-02T01:25:52.762836Z","title":"SEMA: a scalable and efﬁcient mamba like attent ion via token localization and averaging","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.14711","last_updated":"2026-07-17T20:57:29Z","snapshot_observed_at":"2026-08-02T01:25:50.435266Z","submitted_at":"2026-07-16T08:22:08Z","title":"VideoSEMA: a scalable and efficient Mamba-like attention for video understanding","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-02T01:25:52.762836Z"},"links":{"cited_paper":"/paper/2506.08297","citing_paper":"/paper/2607.14711"},"observation_digest":"sha256:85b4055ea1b81f51212ead05386e1ff64b7ecc0251c83594505851c2782162e8","observation_id":"d450261e-6653-4083-8fbe-c18cfce826a2","resolution":{"observed_at":"2026-08-02T01:25:52.762836Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2506.08297/citation-record","integrity":"/paper/2506.08297/integrity","json":"/paper/2506.08297/citation-record.json","paper":"/paper/2506.08297"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2004.05150","last_updated":"2020-12-02T17:52:35Z","snapshot_observed_at":"2026-07-31T17:17:17.205582Z","submitted_at":"2020-04-10T17:54:09Z","title":"Longformer: The Long-Document Transformer","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2004.05150","snapshot_observed_at":"2026-08-07T05:21:37.177006Z","title":"Peters, and Arman Cohan","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2506.08297","last_updated":"2026-07-16T07:47:36Z","snapshot_observed_at":"2026-08-07T05:11:43.450115Z","submitted_at":"2025-06-10T00:03:19Z","title":"SEMA: a Scalable and Efficient Mamba like Attention via Token Localization and Averaging","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T05:21:37.177006Z"},"links":{"cited_paper":"/paper/2004.05150","citing_paper":"/paper/2506.08297"},"observation_digest":"sha256:306715a67498dea690f403a9c5cd67976506eeb1953ab19f152d3dcf525a7d4d","observation_id":"17eec38e-970e-4841-86b9-4a4260f6edae","resolution":{"observed_at":"2026-08-07T05:21:37.177006Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:21:37.685721Z","title":"Mixformer: Mixing features across windows and dimensions.CVPR, 2022","venue":null,"work_id":"de390aaf-18cd-486d-8697-f6c4b957d8f0","year":2022},"citing_paper":{"arxiv_id":"2506.08297","last_updated":"2026-07-16T07:47:36Z","snapshot_observed_at":"2026-08-07T05:11:43.450115Z","submitted_at":"2025-06-10T00:03:19Z","title":"SEMA: a Scalable and Efficient Mamba like Attention via Token Localization and Averaging","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T05:21:37.181529Z"},"links":{"citing_paper":"/paper/2506.08297"},"observation_digest":"sha256:2037c4d4fcc7afa68515a1605d6e151faf75ede94951f3b7ce60f0a4498a2843","observation_id":"028da89c-ac47-47fe-8c62-1c8bd009f584","resolution":{"observed_at":"2026-08-07T05:21:37.689519Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:21:37.674629Z","title":"Conditional positional encodings for vision transformers.ICLR, 2023","venue":null,"work_id":"9b2d3449-3005-43a5-9d45-406928a43f9e","year":2023},"citing_paper":{"arxiv_id":"2506.08297","last_updated":"2026-07-16T07:47:36Z","snapshot_observed_at":"2026-08-07T05:11:43.450115Z","submitted_at":"2025-06-10T00:03:19Z","title":"SEMA: a Scalable and Efficient Mamba like Attention via Token Localization and Averaging","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T05:21:37.185167Z"},"links":{"citing_paper":"/paper/2506.08297"},"observation_digest":"sha256:0a207f0246d8b3eb29cd6f2b16d65ff056e87c68a03cab489eec80c7816493b5","observation_id":"1e87e9eb-9736-463b-ad54-d0110feccec6","resolution":{"observed_at":"2026-08-07T05:21:37.678492Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:21:37.663199Z","title":"Randaugment: Practical automated data augmentation with a reduced search space","venue":null,"work_id":"b858545e-19ed-4ce6-a942-34fb85e91e3d","year":2020},"citing_paper":{"arxiv_id":"2506.08297","last_updated":"2026-07-16T07:47:36Z","snapshot_observed_at":"2026-08-07T05:11:43.450115Z","submitted_at":"2025-06-10T00:03:19Z","title":"SEMA: a Scalable and Efficient Mamba like Attention via Token Localization and Averaging","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T05:21:37.188856Z"},"links":{"citing_paper":"/paper/2506.08297"},"observation_digest":"sha256:9eddda32161e7506bc832820cdf198cb671568ffaa3a4cdcfc99ac3612ce27e0","observation_id":"326e51c8-4c24-4323-ae38-3fb11ad92c1e","resolution":{"observed_at":"2026-08-07T05:21:37.666937Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:21:37.192332Z","title":"Imagenet: A large- scale hierarchical image database","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2506.08297","last_updated":"2026-07-16T07:47:36Z","snapshot_observed_at":"2026-08-07T05:11:43.450115Z","submitted_at":"2025-06-10T00:03:19Z","title":"SEMA: a Scalable and Efficient Mamba like Attention via Token Localization and Averaging","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T05:21:37.192332Z"},"links":{"citing_paper":"/paper/2506.08297"},"observation_digest":"sha256:93f45beb3a797168edc4ece7b0f4e2b275fa594d2c79717ea2904319a29141c5","observation_id":"9b7f7022-8213-404e-89a5-1a0f44227130","resolution":{"observed_at":"2026-08-07T05:21:37.192332Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:21:37.645590Z","title":"Cswin transformer: A general vision transformer backbone with cross-shaped windows.CVPR, 2022","venue":null,"work_id":"827bdb93-f1c6-4918-8e09-fe1f69cac554","year":2022},"citing_paper":{"arxiv_id":"2506.08297","last_updated":"2026-07-16T07:47:36Z","snapshot_observed_at":"2026-08-07T05:11:43.450115Z","submitted_at":"2025-06-10T00:03:19Z","title":"SEMA: a Scalable and Efficient Mamba like Attention via Token Localization and Averaging","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T05:21:37.197511Z"},"links":{"citing_paper":"/paper/2506.08297"},"observation_digest":"sha256:e4ba299931d2eb58aa994e063b1ae47d68cc9ec4b6da1ed97b51d13da0c53110","observation_id":"75ce774c-c806-4713-83db-669966a8bd83","resolution":{"observed_at":"2026-08-07T05:21:37.648836Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:21:37.201226Z","title":"An image is worth 16x16 words: Transformers for image recognition at scale","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.08297","last_updated":"2026-07-16T07:47:36Z","snapshot_observed_at":"2026-08-07T05:11:43.450115Z","submitted_at":"2025-06-10T00:03:19Z","title":"SEMA: a Scalable and Efficient Mamba like Attention via Token Localization and Averaging","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T05:21:37.201226Z"},"links":{"citing_paper":"/paper/2506.08297"},"observation_digest":"sha256:2c6c082ebb85d0737566d0d9a394a44b4f550c1a7f7f39fab0b68bb7ce407c88","observation_id":"769f58d7-3b85-45c9-8a67-c08a523d2e17","resolution":{"observed_at":"2026-08-07T05:21:37.201226Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:21:37.204961Z","title":"Mamba: Linear-time sequence modeling with selective state spaces","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.08297","last_updated":"2026-07-16T07:47:36Z","snapshot_observed_at":"2026-08-07T05:11:43.450115Z","submitted_at":"2025-06-10T00:03:19Z","title":"SEMA: a Scalable and Efficient Mamba like Attention via Token Localization and Averaging","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T05:21:37.204961Z"},"links":{"citing_paper":"/paper/2506.08297"},"observation_digest":"sha256:27f3115f8c99e562e3fa0bf6ab4a1d906a5783463011de70522950be93768a09","observation_id":"e2f4d272-16da-4a81-b30f-57b939427d4f","resolution":{"observed_at":"2026-08-07T05:21:37.204961Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:21:37.621843Z","title":"Hippo: Recurrent memory with optimal polynomial projections.NeurIPS, 2020","venue":null,"work_id":"90ad92a5-3862-4906-9a5e-c50d58769267","year":2020},"citing_paper":{"arxiv_id":"2506.08297","last_updated":"2026-07-16T07:47:36Z","snapshot_observed_at":"2026-08-07T05:11:43.450115Z","submitted_at":"2025-06-10T00:03:19Z","title":"SEMA: a Scalable and Efficient Mamba like Attention via Token Localization and Averaging","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T05:21:37.208667Z"},"links":{"citing_paper":"/paper/2506.08297"},"observation_digest":"sha256:002fe608db521c3743ad531f235e7a682ded2d89e3cf122f7fa6344b1bf8b418","observation_id":"d1dcecac-1f1e-4cf5-9e20-c1c3c6fa2bb7","resolution":{"observed_at":"2026-08-07T05:21:37.625199Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:21:37.611584Z","title":null,"venue":null,"work_id":"54aa826a-5c5b-468c-ad3d-3c552cddeb79","year":2023},"citing_paper":{"arxiv_id":"2506.08297","last_updated":"2026-07-16T07:47:36Z","snapshot_observed_at":"2026-08-07T05:11:43.450115Z","submitted_at":"2025-06-10T00:03:19Z","title":"SEMA: a Scalable and Efficient Mamba like Attention via Token Localization and Averaging","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T05:21:37.211934Z"},"links":{"citing_paper":"/paper/2506.08297"},"observation_digest":"sha256:0456aaa40c556532977b5b440e5d2c4f6b84706e4bf10f372ed5c87cb5987c0d","observation_id":"449eeeb3-eb32-4b13-a4fe-69c308cc5e62","resolution":{"observed_at":"2026-08-07T05:21:37.614868Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:21:37.600076Z","title":"Flatten transformer: Vision transformer using focused linear attention.ICCV, 2023","venue":null,"work_id":"0f0fda74-e897-432b-8808-6b593f2212e7","year":2023},"citing_paper":{"arxiv_id":"2506.08297","last_updated":"2026-07-16T07:47:36Z","snapshot_observed_at":"2026-08-07T05:11:43.450115Z","submitted_at":"2025-06-10T00:03:19Z","title":"SEMA: a Scalable and Efficient Mamba like Attention via Token Localization and Averaging","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T05:21:37.215105Z"},"links":{"citing_paper":"/paper/2506.08297"},"observation_digest":"sha256:dfc44b7bfb7f74745de5de635bb4223f8e67be42c7612be63cb3cb6e1c606923","observation_id":"c5f13aab-e2dd-4af2-9d94-196aeb842777","resolution":{"observed_at":"2026-08-07T05:21:37.603975Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:21:37.588547Z","title":"Bridging the divide: Reconsidering softmax and linear attention","venue":null,"work_id":"c9a15fe9-bce4-419f-b0e1-2625e71394e3","year":2024},"citing_paper":{"arxiv_id":"2506.08297","last_updated":"2026-07-16T07:47:36Z","snapshot_observed_at":"2026-08-07T05:11:43.450115Z","submitted_at":"2025-06-10T00:03:19Z","title":"SEMA: a Scalable and Efficient Mamba like Attention via Token Localization and Averaging","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T05:21:37.218655Z"},"links":{"citing_paper":"/paper/2506.08297"},"observation_digest":"sha256:fba17ab3beb5e0d0fe2a7470a7b69ff148908f88dbbd9b01fc5d7f9d2d25cfb7","observation_id":"afff5472-db83-4516-acba-6f2c2dd7a5f4","resolution":{"observed_at":"2026-08-07T05:21:37.592306Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:21:37.577510Z","title":"Demystify Mamba in Vision: A Linear Attention Perspective","venue":null,"work_id":"0b1b2725-21d0-4198-b632-e6020e8d3227","year":2024},"citing_paper":{"arxiv_id":"2506.08297","last_updated":"2026-07-16T07:47:36Z","snapshot_observed_at":"2026-08-07T05:11:43.450115Z","submitted_at":"2025-06-10T00:03:19Z","title":"SEMA: a Scalable and Efficient Mamba like Attention via Token Localization and Averaging","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T05:21:37.222142Z"},"links":{"citing_paper":"/paper/2506.08297"},"observation_digest":"sha256:76e7b09f8145b8caf6c65494915cda6651a8c38ac3ad55b2ef06e223138d925b","observation_id":"b2449e63-aa77-450c-9f9b-cda0edbed132","resolution":{"observed_at":"2026-08-07T05:21:37.581261Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:21:37.566689Z","title":"Neighborhood attention transformer","venue":null,"work_id":"e47c33bc-797b-4438-a8a8-d93823189a21","year":2023},"citing_paper":{"arxiv_id":"2506.08297","last_updated":"2026-07-16T07:47:36Z","snapshot_observed_at":"2026-08-07T05:11:43.450115Z","submitted_at":"2025-06-10T00:03:19Z","title":"SEMA: a Scalable and Efficient Mamba like Attention via Token Localization and Averaging","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T05:21:37.225894Z"},"links":{"citing_paper":"/paper/2506.08297"},"observation_digest":"sha256:664096c3356ed6b68ddf8543adaf8a988946a1695a1360a0de550b0c32ba2a47","observation_id":"e2df83a4-6a23-4a88-8a8a-91d2a7d31b2b","resolution":{"observed_at":"2026-08-07T05:21:37.570131Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.09338","last_updated":"2024-03-14T12:32:40Z","snapshot_observed_at":"2026-08-06T04:08:34.950441Z","submitted_at":"2024-03-14T12:32:40Z","title":"LocalMamba: Visual State Space Model with Windowed Selective Scan","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.09338","snapshot_observed_at":"2026-08-07T05:21:37.230687Z","title":"Localmamba: Visual state space model with windowed selective scan.arXiv:2403.09338, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.08297","last_updated":"2026-07-16T07:47:36Z","snapshot_observed_at":"2026-08-07T05:11:43.450115Z","submitted_at":"2025-06-10T00:03:19Z","title":"SEMA: a Scalable and Efficient Mamba like Attention via Token Localization and Averaging","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T05:21:37.230687Z"},"links":{"cited_paper":"/paper/2403.09338","citing_paper":"/paper/2506.08297"},"observation_digest":"sha256:cd9ae4e397829ee67f156d429beff07867d500b25b212816ae9ddb3b57d4d3c1","observation_id":"8eaa44d6-77d3-43c4-8d4f-c9721408cbcd","resolution":{"observed_at":"2026-08-07T05:21:37.230687Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:21:37.556678Z","title":"Katharopoulos, A","venue":null,"work_id":"01259228-d786-40a7-8229-4e7f5f6a9b43","year":2020},"citing_paper":{"arxiv_id":"2506.08297","last_updated":"2026-07-16T07:47:36Z","snapshot_observed_at":"2026-08-07T05:11:43.450115Z","submitted_at":"2025-06-10T00:03:19Z","title":"SEMA: a Scalable and Efficient Mamba like Attention via Token Localization and Averaging","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T05:21:37.234331Z"},"links":{"citing_paper":"/paper/2506.08297"},"observation_digest":"sha256:78ddc8eb3aaf6a5a894bbdb20cf0969e77aa2699af98ae6ff6a129c6c142c091","observation_id":"5688884a-c318-48db-b8d5-fa120a1bd0c6","resolution":{"observed_at":"2026-08-07T05:21:37.560149Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2007.14902","last_updated":"2020-08-20T05:43:22Z","snapshot_observed_at":"2026-07-06T09:42:50.141448Z","submitted_at":"2020-07-29T15:18:46Z","title":"Linear Attention Mechanism: An Efficient Attention for Semantic Segmentation","version":3},"cited_work":{"arxiv_id":"2007.14902","doi":null,"metadata_source":"pith","pith_arxiv_id":"2007.14902","snapshot_observed_at":"2026-08-07T05:21:37.385319Z","title":"Linear Attention Mechanism: An Efficient Attention for Semantic Segmentation","venue":"cs.CV","work_id":"56dc6316-add6-4ef1-960c-a076d95bacd7","year":2020},"citing_paper":{"arxiv_id":"2506.08297","last_updated":"2026-07-16T07:47:36Z","snapshot_observed_at":"2026-08-07T05:11:43.450115Z","submitted_at":"2025-06-10T00:03:19Z","title":"SEMA: a Scalable and Efficient Mamba like Attention via Token Localization and Averaging","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T05:21:37.238100Z"},"links":{"cited_paper":"/paper/2007.14902","citing_paper":"/paper/2506.08297"},"observation_digest":"sha256:bf44bf3334b55fb0b206f4a4c0b45244eab12188f54f69095d6dc8f85d95e536","observation_id":"0ac28da9-62f4-44db-b904-ca9b569171bb","resolution":{"observed_at":"2026-08-07T05:21:37.389145Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:21:37.546516Z","title":"Rethinking vision transformers for MobileNet size and speed.ICCV, 2023","venue":null,"work_id":"177b73d7-5245-40b2-b938-ff7b09a9c8a1","year":2023},"citing_paper":{"arxiv_id":"2506.08297","last_updated":"2026-07-16T07:47:36Z","snapshot_observed_at":"2026-08-07T05:11:43.450115Z","submitted_at":"2025-06-10T00:03:19Z","title":"SEMA: a Scalable and Efficient Mamba like Attention via Token Localization and Averaging","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T05:21:37.241622Z"},"links":{"citing_paper":"/paper/2506.08297"},"observation_digest":"sha256:3a6b8b02f49146d7e0e82a808bd57ec5c1480566c18ca7bc99204437752badf3","observation_id":"628aed8e-e36d-4422-92e4-b1f54f324239","resolution":{"observed_at":"2026-08-07T05:21:37.549811Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:21:37.244862Z","title":"Lawrence Zitnick","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2506.08297","last_updated":"2026-07-16T07:47:36Z","snapshot_observed_at":"2026-08-07T05:11:43.450115Z","submitted_at":"2025-06-10T00:03:19Z","title":"SEMA: a Scalable and Efficient Mamba like Attention via Token Localization and Averaging","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T05:21:37.244862Z"},"links":{"citing_paper":"/paper/2506.08297"},"observation_digest":"sha256:4f26d63cde70d936df5a7711fac05e601cf92f5e8b9fb30455976ec6c43343dc","observation_id":"970b95eb-ad57-40b6-ae6d-d3a236a3f754","resolution":{"observed_at":"2026-08-07T05:21:37.244862Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.05794","last_updated":"2025-04-08T08:22:54Z","snapshot_observed_at":"2026-08-08T05:09:49.581755Z","submitted_at":"2025-04-08T08:22:54Z","title":"DefMamba: Deformable Visual State Space Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.05794","snapshot_observed_at":"2026-08-07T05:21:37.248020Z","title":"Def- Mamba: Deformable visual state space model.arXiv:2504.05794, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.08297","last_updated":"2026-07-16T07:47:36Z","snapshot_observed_at":"2026-08-07T05:11:43.450115Z","submitted_at":"2025-06-10T00:03:19Z","title":"SEMA: a Scalable and Efficient Mamba like Attention via Token Localization and Averaging","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T05:21:37.248020Z"},"links":{"cited_paper":"/paper/2504.05794","citing_paper":"/paper/2506.08297"},"observation_digest":"sha256:75597092e3fc3d2e1621b3a6c8f538ef2298ecb5ec2cc54965c95fcff8a59752","observation_id":"34def07f-1070-4096-b482-f6673a87550b","resolution":{"observed_at":"2026-08-07T05:21:37.248020Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:21:37.530106Z","title":"VMamba: Visual State Space Model.NeurIPS, 2024","venue":null,"work_id":"b0c2d4d6-a4a4-4753-b22b-7f5efcd9065b","year":2024},"citing_paper":{"arxiv_id":"2506.08297","last_updated":"2026-07-16T07:47:36Z","snapshot_observed_at":"2026-08-07T05:11:43.450115Z","submitted_at":"2025-06-10T00:03:19Z","title":"SEMA: a Scalable and Efficient Mamba like Attention via Token Localization and Averaging","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T05:21:37.251516Z"},"links":{"citing_paper":"/paper/2506.08297"},"observation_digest":"sha256:5fd89d7da79d450b9ab0840a42548f728fbd629ac9430b7f38d3fac9ebd55b43","observation_id":"f2b6eb66-10ce-4df8-9149-3972c38f971c","resolution":{"observed_at":"2026-08-07T05:21:37.533726Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:21:37.520514Z","title":"Swin transformer: Hierarchical vision transformer using shifted windows","venue":null,"work_id":"4379f6e6-3c18-43f7-bb2c-e94aa054ae69","year":2021},"citing_paper":{"arxiv_id":"2506.08297","last_updated":"2026-07-16T07:47:36Z","snapshot_observed_at":"2026-08-07T05:11:43.450115Z","submitted_at":"2025-06-10T00:03:19Z","title":"SEMA: a Scalable and Efficient Mamba like Attention via Token Localization and Averaging","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T05:21:37.254722Z"},"links":{"citing_paper":"/paper/2506.08297"},"observation_digest":"sha256:d4c94d926b9aa131dc04b0a3a28b5eb9446e8ce6ca20c4455d10a7814da38f11","observation_id":"0b5da0a6-c366-47f3-a41b-df4791035a89","resolution":{"observed_at":"2026-08-07T05:21:37.523646Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:21:37.511000Z","title":"A ConvNet for the 2020s","venue":null,"work_id":"13ad0aaa-d920-4afa-a7ad-4c9e89dc5146","year":2022},"citing_paper":{"arxiv_id":"2506.08297","last_updated":"2026-07-16T07:47:36Z","snapshot_observed_at":"2026-08-07T05:11:43.450115Z","submitted_at":"2025-06-10T00:03:19Z","title":"SEMA: a Scalable and Efficient Mamba like Attention via Token Localization and Averaging","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T05:21:37.257984Z"},"links":{"citing_paper":"/paper/2506.08297"},"observation_digest":"sha256:5d0803468b866db74782d87eb971744fffdd03260c9bd8ed047931fe9f9bec85","observation_id":"c969419d-0594-45d1-8fa1-a9e44e1ea066","resolution":{"observed_at":"2026-08-07T05:21:37.514030Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:21:37.261469Z","title":"Decoupled weight decay regularization","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.08297","last_updated":"2026-07-16T07:47:36Z","snapshot_observed_at":"2026-08-07T05:11:43.450115Z","submitted_at":"2025-06-10T00:03:19Z","title":"SEMA: a Scalable and Efficient Mamba like Attention via Token Localization and Averaging","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T05:21:37.261469Z"},"links":{"citing_paper":"/paper/2506.08297"},"observation_digest":"sha256:0a93c26fd319cf5c0867fd389b2d2b45c82b30006540b808cd70858c2d36e7cd","observation_id":"d36abdc7-aafc-4fdb-bc7a-9948e0a163c8","resolution":{"observed_at":"2026-08-07T05:21:37.261469Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:21:37.494288Z","title":null,"venue":null,"work_id":"31293eee-8aa2-4c14-9105-738bb803f411","year":2015},"citing_paper":{"arxiv_id":"2506.08297","last_updated":"2026-07-16T07:47:36Z","snapshot_observed_at":"2026-08-07T05:11:43.450115Z","submitted_at":"2025-06-10T00:03:19Z","title":"SEMA: a Scalable and Efficient Mamba like Attention via Token Localization and Averaging","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T05:21:37.264794Z"},"links":{"citing_paper":"/paper/2506.08297"},"observation_digest":"sha256:14720e544fe87fbb866f0daee76f19b141e627d8b98f0e248d72b536d52998d2","observation_id":"3160762b-4e03-4274-b040-06cd21b9839b","resolution":{"observed_at":"2026-08-07T05:21:37.497473Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:21:37.484510Z","title":null,"venue":null,"work_id":"8a77d5b5-1077-4557-84d0-8349413b71d0","year":2019},"citing_paper":{"arxiv_id":"2506.08297","last_updated":"2026-07-16T07:47:36Z","snapshot_observed_at":"2026-08-07T05:11:43.450115Z","submitted_at":"2025-06-10T00:03:19Z","title":"SEMA: a Scalable and Efficient Mamba like Attention via Token Localization and Averaging","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T05:21:37.267758Z"},"links":{"citing_paper":"/paper/2506.08297"},"observation_digest":"sha256:999def3949ad429a0c0000276f11c13c7d160873436599f7f6c8b053fa3df267","observation_id":"550f8bdc-60de-4c53-9679-f5fa3973efb1","resolution":{"observed_at":"2026-08-07T05:21:37.487795Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:21:37.473699Z","title":"Roformer: Enhanced transformer with rotary position embedding.Neurocomputing, 2024","venue":null,"work_id":"b7adba8c-e43a-4d87-8d69-006f8f912c99","year":2024},"citing_paper":{"arxiv_id":"2506.08297","last_updated":"2026-07-16T07:47:36Z","snapshot_observed_at":"2026-08-07T05:11:43.450115Z","submitted_at":"2025-06-10T00:03:19Z","title":"SEMA: a Scalable and Efficient Mamba like Attention via Token Localization and Averaging","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T05:21:37.270936Z"},"links":{"citing_paper":"/paper/2506.08297"},"observation_digest":"sha256:8903c00404f3935f5f9e6c097e44cd00f9011e3f5b60ebe5ea59ea7f7f08c0c6","observation_id":"7754fbea-310d-4bbf-b10b-172eef1fbd89","resolution":{"observed_at":"2026-08-07T05:21:37.477163Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:21:37.463432Z","title":"Vaswani, N","venue":null,"work_id":"eee84717-2d60-4422-9f9d-fbd7e0087c48","year":2017},"citing_paper":{"arxiv_id":"2506.08297","last_updated":"2026-07-16T07:47:36Z","snapshot_observed_at":"2026-08-07T05:11:43.450115Z","submitted_at":"2025-06-10T00:03:19Z","title":"SEMA: a Scalable and Efficient Mamba like Attention via Token Localization and Averaging","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T05:21:37.274626Z"},"links":{"citing_paper":"/paper/2506.08297"},"observation_digest":"sha256:8168d98661fdb7a7919169a842ae8e9173ad207af5127175b3a384c9882db388","observation_id":"37608d6b-0855-4eaa-8cf7-363ecf9b5e56","resolution":{"observed_at":"2026-08-07T05:21:37.466786Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.01104","last_updated":"2025-05-30T23:46:05Z","snapshot_observed_at":"2026-08-04T01:13:18.607682Z","submitted_at":"2024-10-01T22:22:35Z","title":"Softmax is not Enough (for Sharp Size Generalisation)","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.01104","snapshot_observed_at":"2026-08-07T05:21:37.278432Z","title":"softmax is not enough (for sharp out-of-distribution).arXiv:2410.01104, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.08297","last_updated":"2026-07-16T07:47:36Z","snapshot_observed_at":"2026-08-07T05:11:43.450115Z","submitted_at":"2025-06-10T00:03:19Z","title":"SEMA: a Scalable and Efficient Mamba like Attention via Token Localization and Averaging","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T05:21:37.278432Z"},"links":{"cited_paper":"/paper/2410.01104","citing_paper":"/paper/2506.08297"},"observation_digest":"sha256:6bfd3a362b7d0e2bc4f3a46df385e7d6ad4ba26812c01c8dc1ca0ac57cc90575","observation_id":"91d006b8-d3e3-4789-b1d6-b19fb5fe7d0a","resolution":{"observed_at":"2026-08-07T05:21:37.278432Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:21:37.282042Z","title":"Pvt v2: Improved baselines with pyramid vision transformer","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.08297","last_updated":"2026-07-16T07:47:36Z","snapshot_observed_at":"2026-08-07T05:11:43.450115Z","submitted_at":"2025-06-10T00:03:19Z","title":"SEMA: a Scalable and Efficient Mamba like Attention via Token Localization and Averaging","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T05:21:37.282042Z"},"links":{"citing_paper":"/paper/2506.08297"},"observation_digest":"sha256:83b1ef0033234a319723c75a010d85c288ad9cdb1ef104a30fd5f00e91031bf3","observation_id":"5b19aba5-9c12-4583-a343-b6d4f58970cc","resolution":{"observed_at":"2026-08-07T05:21:37.282042Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05026","last_updated":"2025-06-03T08:39:28Z","snapshot_observed_at":"2026-08-06T19:38:37.104445Z","submitted_at":"2023-10-08T06:10:09Z","title":"Low-Resolution Self-Attention for Semantic Segmentation","version":3},"cited_work":{"arxiv_id":"2310.05026","doi":null,"metadata_source":"pith","pith_arxiv_id":"2310.05026","snapshot_observed_at":"2026-08-07T05:21:37.345766Z","title":"Low-Resolution Self-Attention for Semantic Segmentation","venue":"cs.CV","work_id":"32a3d966-fda0-4d1d-aecf-3d8f5ab8e52d","year":2023},"citing_paper":{"arxiv_id":"2506.08297","last_updated":"2026-07-16T07:47:36Z","snapshot_observed_at":"2026-08-07T05:11:43.450115Z","submitted_at":"2025-06-10T00:03:19Z","title":"SEMA: a Scalable and Efficient Mamba like Attention via Token Localization and Averaging","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T05:21:37.285548Z"},"links":{"cited_paper":"/paper/2310.05026","citing_paper":"/paper/2506.08297"},"observation_digest":"sha256:89b99db0450b97efa3042700cf03f6ae4103620cc02dcd43b59ecb7142fe7bd1","observation_id":"e39e43ae-5d97-45aa-b055-0bd67f66f035","resolution":{"observed_at":"2026-08-07T05:21:37.351539Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.05258","last_updated":"2025-04-07T12:04:28Z","snapshot_observed_at":"2026-08-03T16:01:59.392774Z","submitted_at":"2024-10-07T17:57:38Z","title":"Differential Transformer","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.05258","snapshot_observed_at":"2026-08-07T05:21:37.289088Z","title":"Differential transformer.arXiv:2410.05258, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.08297","last_updated":"2026-07-16T07:47:36Z","snapshot_observed_at":"2026-08-07T05:11:43.450115Z","submitted_at":"2025-06-10T00:03:19Z","title":"SEMA: a Scalable and Efficient Mamba like Attention via Token Localization and Averaging","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T05:21:37.289088Z"},"links":{"cited_paper":"/paper/2410.05258","citing_paper":"/paper/2506.08297"},"observation_digest":"sha256:c6b1c3207d32e1c8d696e02f29f00ad04ed3d81b5601cb1e3ebd9560ea39ae60","observation_id":"bba0ff3f-6533-4a6d-ade0-88923297aa26","resolution":{"observed_at":"2026-08-07T05:21:37.289088Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:21:37.445390Z","title":"Mambaout: Do We Really Need Mamba for Vision?CVPR, 2025","venue":null,"work_id":"a81ad292-1a66-4406-b10b-f428a69bdf10","year":2025},"citing_paper":{"arxiv_id":"2506.08297","last_updated":"2026-07-16T07:47:36Z","snapshot_observed_at":"2026-08-07T05:11:43.450115Z","submitted_at":"2025-06-10T00:03:19Z","title":"SEMA: a Scalable and Efficient Mamba like Attention via Token Localization and Averaging","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T05:21:37.292716Z"},"links":{"citing_paper":"/paper/2506.08297"},"observation_digest":"sha256:117c016ab5b8f83ddb7f26077c7ee206e3bb686d02e27eb6b56d7f26f1cdba38","observation_id":"929a87d8-6f75-45fb-8f23-c1cdd8fab411","resolution":{"observed_at":"2026-08-07T05:21:37.449035Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:21:37.435265Z","title":"Cutmix: Regularization strategy to train strong classifiers with localizable features","venue":null,"work_id":"49746c73-79dc-4363-a21e-94444272abfd","year":2019},"citing_paper":{"arxiv_id":"2506.08297","last_updated":"2026-07-16T07:47:36Z","snapshot_observed_at":"2026-08-07T05:11:43.450115Z","submitted_at":"2025-06-10T00:03:19Z","title":"SEMA: a Scalable and Efficient Mamba like Attention via Token Localization and Averaging","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T05:21:37.295984Z"},"links":{"citing_paper":"/paper/2506.08297"},"observation_digest":"sha256:8e757f38260a9e3db1ef959f5996d69c653c0ae519618863c6ca6491e2b7a03e","observation_id":"032dfc7a-7f09-4bc9-a878-b04b6fa0885b","resolution":{"observed_at":"2026-08-07T05:21:37.438544Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:21:37.299441Z","title":"Dauphin, and David Lopez-Paz","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.08297","last_updated":"2026-07-16T07:47:36Z","snapshot_observed_at":"2026-08-07T05:11:43.450115Z","submitted_at":"2025-06-10T00:03:19Z","title":"SEMA: a Scalable and Efficient Mamba like Attention via Token Localization and Averaging","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T05:21:37.299441Z"},"links":{"citing_paper":"/paper/2506.08297"},"observation_digest":"sha256:03a5a4996b5b3c37c673170cce8089d2ba8a2d22aa212acab92e4601f0c292ec","observation_id":"2b816775-70c4-4c33-9274-670a57a9ef69","resolution":{"observed_at":"2026-08-07T05:21:37.299441Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:21:37.417599Z","title":"dim64 head2 window size7 # ×2 2 28×28 downsampling, 128","venue":null,"work_id":"dd5d8370-7936-4f00-a242-065fef24d306","year":2020},"citing_paper":{"arxiv_id":"2506.08297","last_updated":"2026-07-16T07:47:36Z","snapshot_observed_at":"2026-08-07T05:11:43.450115Z","submitted_at":"2025-06-10T00:03:19Z","title":"SEMA: a Scalable and Efficient Mamba like Attention via Token Localization and Averaging","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T05:21:37.303004Z"},"links":{"citing_paper":"/paper/2506.08297"},"observation_digest":"sha256:c3e4e0bf9c47d1c23519ddbaefac52f662da748aafa29000ba2470799fc735ac","observation_id":"d46073f1-c934-4e35-a544-4105251465d1","resolution":{"observed_at":"2026-08-07T05:21:37.421138Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2506.08297","last_updated":"2026-07-16T07:47:36Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-07T05:11:43.450115Z","submitted_at":"2025-06-10T00:03:19Z","title":"SEMA: a Scalable and Efficient Mamba like Attention via Token Localization and Averaging"},"reference_resolution":{"displayed":36,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":15,"verified_exact":2,"verified_fuzzy":19},"total_outbound_references":36},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 36 of 36 outbound references and 2 inbound Pith citation observations for arXiv:2506.08297."}