{"as_of":"2026-08-09T12:28:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:c2b833d0d4fd7aa9ffd6c4bca268aa040838a1b4e53e1a63f8cc1d99f7feba8a","coverage":[{"denominator":54,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":54,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T05:58:39.562084Z","state":"measured"},{"denominator":54,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":54,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2509.04669/citation-record","integrity":"/paper/2509.04669/integrity","json":"/paper/2509.04669/citation-record.json","paper":"/paper/2509.04669"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"1607.06450","last_updated":"2016-07-21T19:57:52Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2016-07-21T19:57:52Z","title":"Layer Normalization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1607.06450","snapshot_observed_at":"2026-08-05T05:58:34.501078Z","title":"Layer normalization.arXiv preprint arXiv:1607.06450,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.04669","last_updated":"2025-09-04T21:32:27Z","snapshot_observed_at":"2026-08-08T10:50:30.388762Z","submitted_at":"2025-09-04T21:32:27Z","title":"VCMamba: Bridging Convolutions with Multi-Directional Mamba for Efficient Visual Representation","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-05T05:58:34.501078Z"},"links":{"cited_paper":"/paper/1607.06450","citing_paper":"/paper/2509.04669"},"observation_digest":"sha256:ce25e231cc15577ca2731a643a9c17e4f97879f168d820449d2084c11d488d3e","observation_id":"1ee1ba64-e4a6-4466-9dac-41466871343a","resolution":{"observed_at":"2026-08-05T05:58:34.501078Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:58:46.252029Z","title":"Mobile- former: Bridging mobilenet and transformer","venue":null,"work_id":"b7b3c43e-8e5a-464f-9ebe-2e302f0a56a0","year":2022},"citing_paper":{"arxiv_id":"2509.04669","last_updated":"2025-09-04T21:32:27Z","snapshot_observed_at":"2026-08-08T10:50:30.388762Z","submitted_at":"2025-09-04T21:32:27Z","title":"VCMamba: Bridging Convolutions with Multi-Directional Mamba for Efficient Visual Representation","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-05T05:58:34.643282Z"},"links":{"citing_paper":"/paper/2509.04669"},"observation_digest":"sha256:b99a70b3f374e4944dfe46c75023fe39631cc1f8cda4bc4c91f66923f91e9398","observation_id":"ae4f6a31-1ae4-43c9-9c24-2adc8e095960","resolution":{"observed_at":"2026-08-05T05:58:46.329996Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.20386","last_updated":"2025-04-07T13:30:39Z","snapshot_observed_at":"2026-08-08T19:54:27.875018Z","submitted_at":"2024-12-29T07:21:33Z","title":"PTQ4VM: Post-Training Quantization for Visual Mamba","version":2},"cited_work":{"arxiv_id":"2412.20386","doi":null,"metadata_source":"pith","pith_arxiv_id":"2412.20386","snapshot_observed_at":"2026-08-05T05:58:40.039551Z","title":"PTQ4VM: Post-Training Quantization for Visual Mamba","venue":"cs.CV","work_id":"4c44a223-aec6-4bc2-84b1-88f4fa69df05","year":2024},"citing_paper":{"arxiv_id":"2509.04669","last_updated":"2025-09-04T21:32:27Z","snapshot_observed_at":"2026-08-08T10:50:30.388762Z","submitted_at":"2025-09-04T21:32:27Z","title":"VCMamba: Bridging Convolutions with Multi-Directional Mamba for Efficient Visual Representation","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-05T05:58:34.691912Z"},"links":{"cited_paper":"/paper/2412.20386","citing_paper":"/paper/2509.04669"},"observation_digest":"sha256:96441c68392a10fb4e4b585b5897554c95fde6337b284ee464ea8e75d36805fc","observation_id":"76c4b244-1078-472b-a522-23b7aea4cc59","resolution":{"observed_at":"2026-08-05T05:58:40.113725Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:58:46.046937Z","title":"Randaugment: Practical automated data augmen- tation with a reduced search space","venue":null,"work_id":"1cf896b8-b9d0-4359-bc2b-f18f75bf634c","year":2020},"citing_paper":{"arxiv_id":"2509.04669","last_updated":"2025-09-04T21:32:27Z","snapshot_observed_at":"2026-08-08T10:50:30.388762Z","submitted_at":"2025-09-04T21:32:27Z","title":"VCMamba: Bridging Convolutions with Multi-Directional Mamba for Efficient Visual Representation","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-05T05:58:34.853319Z"},"links":{"citing_paper":"/paper/2509.04669"},"observation_digest":"sha256:8f8dbe380e184a72f81aa842cb6a7c2d7c0064424707149a8f0e95b07133bdf8","observation_id":"1122c7cc-99f5-472d-81a6-660fa885fa21","resolution":{"observed_at":"2026-08-05T05:58:46.161982Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:58:45.844136Z","title":"Coatnet: Marrying convolution and attention for all data sizes.Advances in neural information processing systems, 34:3965–3977, 2021","venue":null,"work_id":"60b2aa6f-8e61-46f5-a669-057a3184da27","year":2021},"citing_paper":{"arxiv_id":"2509.04669","last_updated":"2025-09-04T21:32:27Z","snapshot_observed_at":"2026-08-08T10:50:30.388762Z","submitted_at":"2025-09-04T21:32:27Z","title":"VCMamba: Bridging Convolutions with Multi-Directional Mamba for Efficient Visual Representation","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-05T05:58:35.003741Z"},"links":{"citing_paper":"/paper/2509.04669"},"observation_digest":"sha256:43a14bfe89567c717780e7956001b5fb97cda07b2aae69476658ea2ff9335a04","observation_id":"15d565b8-94a3-4d3c-952b-c6a1d31c9aca","resolution":{"observed_at":"2026-08-05T05:58:45.948731Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:58:45.649447Z","title":"Imagenet: A large-scale hierarchical image database","venue":null,"work_id":"246bf270-3de6-4363-85b7-4aa2cf0a656d","year":2009},"citing_paper":{"arxiv_id":"2509.04669","last_updated":"2025-09-04T21:32:27Z","snapshot_observed_at":"2026-08-08T10:50:30.388762Z","submitted_at":"2025-09-04T21:32:27Z","title":"VCMamba: Bridging Convolutions with Multi-Directional Mamba for Efficient Visual Representation","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-05T05:58:35.039319Z"},"links":{"citing_paper":"/paper/2509.04669"},"observation_digest":"sha256:b8318e02188db13e860e261f43036cff70648a67a0481b2ddf533ffe58438ef7","observation_id":"4617beef-9611-4c1c-82a2-34ecf34fc26a","resolution":{"observed_at":"2026-08-05T05:58:45.752283Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2010.11929","last_updated":"2021-06-03T13:08:56Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-10-22T17:55:59Z","title":"An Image is Worth 16x16 Words: Transformers for Image Recognition at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.11929","snapshot_observed_at":"2026-08-05T05:58:35.117604Z","title":"An image is worth 16x16 words: Transformers for image recognition at scale.arXiv preprint arXiv:2010.11929, 2020","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2509.04669","last_updated":"2025-09-04T21:32:27Z","snapshot_observed_at":"2026-08-08T10:50:30.388762Z","submitted_at":"2025-09-04T21:32:27Z","title":"VCMamba: Bridging Convolutions with Multi-Directional Mamba for Efficient Visual Representation","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-05T05:58:35.117604Z"},"links":{"cited_paper":"/paper/2010.11929","citing_paper":"/paper/2509.04669"},"observation_digest":"sha256:682bd619fe9f0dd8ea019ad07a69f2b7fc8d58339e187de29bdd58ac850b40b7","observation_id":"f8477be4-2b23-4b5a-9dd1-7fca5800c8cc","resolution":{"observed_at":"2026-08-05T05:58:35.117604Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:58:35.238441Z","title":"Sigmoid- weighted linear units for neural network function approxima- tion in reinforcement learning.Neural networks, 107:3–11,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.04669","last_updated":"2025-09-04T21:32:27Z","snapshot_observed_at":"2026-08-08T10:50:30.388762Z","submitted_at":"2025-09-04T21:32:27Z","title":"VCMamba: Bridging Convolutions with Multi-Directional Mamba for Efficient Visual Representation","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-05T05:58:35.238441Z"},"links":{"citing_paper":"/paper/2509.04669"},"observation_digest":"sha256:59141576f1ebf37616b882aded103f87f04597d10ef7f8462dc793b3b38ca6d6","observation_id":"44168f73-83a5-4f78-8313-984784ef2f27","resolution":{"observed_at":"2026-08-05T05:58:35.238441Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.00752","last_updated":"2024-05-31T17:55:27Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-12-01T18:01:34Z","title":"Mamba: Linear-Time Sequence Modeling with Selective State Spaces","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.00752","snapshot_observed_at":"2026-08-05T05:58:35.316363Z","title":"Mamba: Linear-time sequence modeling with selective state spaces.arXiv preprint arXiv:2312.00752, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.04669","last_updated":"2025-09-04T21:32:27Z","snapshot_observed_at":"2026-08-08T10:50:30.388762Z","submitted_at":"2025-09-04T21:32:27Z","title":"VCMamba: Bridging Convolutions with Multi-Directional Mamba for Efficient Visual Representation","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-05T05:58:35.316363Z"},"links":{"cited_paper":"/paper/2312.00752","citing_paper":"/paper/2509.04669"},"observation_digest":"sha256:43a90badaabe90d3cc3fdd183eb114b9df15472f9197d309078016e01d7341d1","observation_id":"65e70e26-09fb-46d2-b757-ca06bbbd20b2","resolution":{"observed_at":"2026-08-05T05:58:35.316363Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.09546","last_updated":"2025-05-29T10:43:45Z","snapshot_observed_at":"2026-08-08T12:29:04.789223Z","submitted_at":"2024-06-13T19:21:01Z","title":"QMamba: On First Exploration of Vision Mamba for Image Quality Assessment","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.09546","snapshot_observed_at":"2026-08-05T05:58:35.480046Z","title":"Q-mamba: On first exploration of vision mamba for image quality assessment.arXiv preprint arXiv:2406.09546, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.04669","last_updated":"2025-09-04T21:32:27Z","snapshot_observed_at":"2026-08-08T10:50:30.388762Z","submitted_at":"2025-09-04T21:32:27Z","title":"VCMamba: Bridging Convolutions with Multi-Directional Mamba for Efficient Visual Representation","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-05T05:58:35.480046Z"},"links":{"cited_paper":"/paper/2406.09546","citing_paper":"/paper/2509.04669"},"observation_digest":"sha256:f8d13ffe2eb4a2ad27d5d8d3a101859f1ed148538e763700849987a2f63ed9ff","observation_id":"9725620b-995b-48be-869f-38d94ba74a99","resolution":{"observed_at":"2026-08-05T05:58:35.480046Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.16605","last_updated":"2024-12-02T08:41:46Z","snapshot_observed_at":"2026-07-06T18:20:09.790181Z","submitted_at":"2024-05-26T15:31:09Z","title":"Demystify Mamba in Vision: A Linear Attention Perspective","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.16605","snapshot_observed_at":"2026-08-05T05:58:35.566295Z","title":"Demystify mamba in vision: A linear attention perspective.arXiv preprint arXiv:2405.16605, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.04669","last_updated":"2025-09-04T21:32:27Z","snapshot_observed_at":"2026-08-08T10:50:30.388762Z","submitted_at":"2025-09-04T21:32:27Z","title":"VCMamba: Bridging Convolutions with Multi-Directional Mamba for Efficient Visual Representation","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-05T05:58:35.566295Z"},"links":{"cited_paper":"/paper/2405.16605","citing_paper":"/paper/2509.04669"},"observation_digest":"sha256:9ab33c7f9410a4bd85e5f8172c449d2fb130286e77f8bcb3059962ebeb4fff5a","observation_id":"d136d334-c730-4244-8e58-e34f87b8bbd8","resolution":{"observed_at":"2026-08-05T05:58:35.566295Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2206.00272","last_updated":"2022-11-04T14:45:03Z","snapshot_observed_at":"2026-07-06T13:16:13.214340Z","submitted_at":"2022-06-01T07:01:04Z","title":"Vision GNN: An Image is Worth Graph of Nodes","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2206.00272","snapshot_observed_at":"2026-08-05T05:58:35.664094Z","title":"Vision gnn: An image is worth graph of nodes","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.04669","last_updated":"2025-09-04T21:32:27Z","snapshot_observed_at":"2026-08-08T10:50:30.388762Z","submitted_at":"2025-09-04T21:32:27Z","title":"VCMamba: Bridging Convolutions with Multi-Directional Mamba for Efficient Visual Representation","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-05T05:58:35.664094Z"},"links":{"cited_paper":"/paper/2206.00272","citing_paper":"/paper/2509.04669"},"observation_digest":"sha256:4d75c39dba3059077a99b98ad9ab5376a41ebdb986fd0f93d5e4ccb51b590c11","observation_id":"70888f7e-560d-4128-bcb0-6aaff6ea2916","resolution":{"observed_at":"2026-08-05T05:58:35.664094Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.08083","last_updated":"2025-03-25T17:54:37Z","snapshot_observed_at":"2026-08-06T23:38:21.068023Z","submitted_at":"2024-07-10T23:02:45Z","title":"MambaVision: A Hybrid Mamba-Transformer Vision Backbone","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.08083","snapshot_observed_at":"2026-08-05T05:58:35.764365Z","title":"Mambavision: A hy- brid mamba-transformer vision backbone.arXiv preprint arXiv:2407.08083, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.04669","last_updated":"2025-09-04T21:32:27Z","snapshot_observed_at":"2026-08-08T10:50:30.388762Z","submitted_at":"2025-09-04T21:32:27Z","title":"VCMamba: Bridging Convolutions with Multi-Directional Mamba for Efficient Visual Representation","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-05T05:58:35.764365Z"},"links":{"cited_paper":"/paper/2407.08083","citing_paper":"/paper/2509.04669"},"observation_digest":"sha256:bc0cf90656c29ffde5e9c0d236443acba5959bb5d3db08b952f1579020b16992","observation_id":"b453b477-7b23-486b-9b93-a74f861f585d","resolution":{"observed_at":"2026-08-05T05:58:35.764365Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:58:45.413884Z","title":"Deep residual learning for image recognition","venue":null,"work_id":"f52a5f3f-975a-44ca-8cb3-e0c62750cab0","year":2016},"citing_paper":{"arxiv_id":"2509.04669","last_updated":"2025-09-04T21:32:27Z","snapshot_observed_at":"2026-08-08T10:50:30.388762Z","submitted_at":"2025-09-04T21:32:27Z","title":"VCMamba: Bridging Convolutions with Multi-Directional Mamba for Efficient Visual Representation","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-05T05:58:35.860038Z"},"links":{"citing_paper":"/paper/2509.04669"},"observation_digest":"sha256:1980cc2e93d41fbb3eee0d9b42589b7c35971fe537ec2e4e3861e393441243d9","observation_id":"0654394c-ec1e-4e87-82c0-c1afa0c574c1","resolution":{"observed_at":"2026-08-05T05:58:45.511704Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1606.08415","last_updated":"2023-06-06T01:53:32Z","snapshot_observed_at":"2026-07-06T05:01:27.910364Z","submitted_at":"2016-06-27T19:20:40Z","title":"Gaussian Error Linear Units (GELUs)","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1606.08415","snapshot_observed_at":"2026-08-05T05:58:35.973378Z","title":"Gaussian error linear units (gelus).arXiv preprint arXiv:1606.08415, 2016","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2509.04669","last_updated":"2025-09-04T21:32:27Z","snapshot_observed_at":"2026-08-08T10:50:30.388762Z","submitted_at":"2025-09-04T21:32:27Z","title":"VCMamba: Bridging Convolutions with Multi-Directional Mamba for Efficient Visual Representation","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-05T05:58:35.973378Z"},"links":{"cited_paper":"/paper/1606.08415","citing_paper":"/paper/2509.04669"},"observation_digest":"sha256:69bdd29e5f804222c3c0fd10348f205890160b4598c0b3ed92eaf4fc37cf0448","observation_id":"e3f9b8ce-6014-4408-94e1-bb78b6f26d8d","resolution":{"observed_at":"2026-08-05T05:58:35.973378Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1704.04861","last_updated":"2017-04-17T03:57:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-04-17T03:57:34Z","title":"MobileNets: Efficient Convolutional Neural Networks for Mobile Vision Applications","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1704.04861","snapshot_observed_at":"2026-08-05T05:58:36.061756Z","title":"Mobilenets: Efficient convolu- tional neural networks for mobile vision applications.arXiv preprint arXiv:1704.04861, 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2509.04669","last_updated":"2025-09-04T21:32:27Z","snapshot_observed_at":"2026-08-08T10:50:30.388762Z","submitted_at":"2025-09-04T21:32:27Z","title":"VCMamba: Bridging Convolutions with Multi-Directional Mamba for Efficient Visual Representation","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-05T05:58:36.061756Z"},"links":{"cited_paper":"/paper/1704.04861","citing_paper":"/paper/2509.04669"},"observation_digest":"sha256:477dd92ebaee91f73f64a2f1e664467faab7dab73bfd5a8e0c617cbfad14a19b","observation_id":"e02ed127-91f3-4eb9-bbb3-96ba1df54a7a","resolution":{"observed_at":"2026-08-05T05:58:36.061756Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:58:45.201213Z","title":"Batch normalization: Accelerating deep network training by reducing internal co- variate shift","venue":null,"work_id":"f182dbd3-8e74-4a1d-9deb-9bb3c02c96eb","year":2015},"citing_paper":{"arxiv_id":"2509.04669","last_updated":"2025-09-04T21:32:27Z","snapshot_observed_at":"2026-08-08T10:50:30.388762Z","submitted_at":"2025-09-04T21:32:27Z","title":"VCMamba: Bridging Convolutions with Multi-Directional Mamba for Efficient Visual Representation","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-05T05:58:36.184124Z"},"links":{"citing_paper":"/paper/2509.04669"},"observation_digest":"sha256:9b4883bc5bdee2459d25ed5a209804043940e1492b915243f36f6a9fc2ef5b53","observation_id":"e991f93b-79ea-4b4a-982c-62fa528071d7","resolution":{"observed_at":"2026-08-05T05:58:45.313549Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:58:44.962561Z","title":"Panoptic feature pyramid networks","venue":null,"work_id":"d775b69a-79eb-4b2e-8f86-3b216538ebbd","year":2019},"citing_paper":{"arxiv_id":"2509.04669","last_updated":"2025-09-04T21:32:27Z","snapshot_observed_at":"2026-08-08T10:50:30.388762Z","submitted_at":"2025-09-04T21:32:27Z","title":"VCMamba: Bridging Convolutions with Multi-Directional Mamba for Efficient Visual Representation","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-05T05:58:36.295349Z"},"links":{"citing_paper":"/paper/2509.04669"},"observation_digest":"sha256:a1e3ac15b89342f73258de95cdd68616b45532609d4a350418cc358f18946971","observation_id":"47d10050-ac09-478a-8a88-5762c33db0e4","resolution":{"observed_at":"2026-08-05T05:58:45.071469Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:58:44.717409Z","title":"Imagenet classification with deep convolutional neural net- works.Advances in neural information processing systems, 25, 2012","venue":null,"work_id":"b8f004ee-6f92-4589-9612-824a6effefcc","year":2012},"citing_paper":{"arxiv_id":"2509.04669","last_updated":"2025-09-04T21:32:27Z","snapshot_observed_at":"2026-08-08T10:50:30.388762Z","submitted_at":"2025-09-04T21:32:27Z","title":"VCMamba: Bridging Convolutions with Multi-Directional Mamba for Efficient Visual Representation","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-05T05:58:36.389134Z"},"links":{"citing_paper":"/paper/2509.04669"},"observation_digest":"sha256:6d93c62785449e24867dd04b3b3e0ffb9f26c70f6c7f2b816fe8440d2145684c","observation_id":"751592e1-6aac-4b3d-bd7f-ee307d6c455b","resolution":{"observed_at":"2026-08-05T05:58:44.832512Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:58:44.418725Z","title":"Gradient-based learning applied to document recog- nition.Proceedings of the IEEE, 86(11):2278–2324, 1998","venue":null,"work_id":"bd440a69-5475-4753-8c9f-aeb974d9af9f","year":1998},"citing_paper":{"arxiv_id":"2509.04669","last_updated":"2025-09-04T21:32:27Z","snapshot_observed_at":"2026-08-08T10:50:30.388762Z","submitted_at":"2025-09-04T21:32:27Z","title":"VCMamba: Bridging Convolutions with Multi-Directional Mamba for Efficient Visual Representation","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-05T05:58:36.478762Z"},"links":{"citing_paper":"/paper/2509.04669"},"observation_digest":"sha256:5d1ecf539df82c477666d7d9404765d6a9b1a97be179deb4a63ae03e930e7689","observation_id":"b9166290-5035-4e33-b157-72ace97c8f48","resolution":{"observed_at":"2026-08-05T05:58:44.544959Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:58:44.054799Z","title":"Videomamba: State space model for efficient video understanding","venue":null,"work_id":"db0487ee-5410-4c6d-897b-cac0b752574e","year":2024},"citing_paper":{"arxiv_id":"2509.04669","last_updated":"2025-09-04T21:32:27Z","snapshot_observed_at":"2026-08-08T10:50:30.388762Z","submitted_at":"2025-09-04T21:32:27Z","title":"VCMamba: Bridging Convolutions with Multi-Directional Mamba for Efficient Visual Representation","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-05T05:58:36.606296Z"},"links":{"citing_paper":"/paper/2509.04669"},"observation_digest":"sha256:4bca852f2143310e6c0e1927e13d04003a4ea37e4357ffb8709fedbcb5f57d93","observation_id":"3ae3f516-10da-4203-929a-83766dbc747b","resolution":{"observed_at":"2026-08-05T05:58:44.206115Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.08059","last_updated":"2023-09-04T12:47:28Z","snapshot_observed_at":"2026-08-05T01:05:14.403355Z","submitted_at":"2022-12-15T18:59:12Z","title":"Rethinking Vision Transformers for MobileNet Size and Speed","version":2},"cited_work":{"arxiv_id":"2212.08059","doi":null,"metadata_source":"pith","pith_arxiv_id":"2212.08059","snapshot_observed_at":"2026-08-05T05:58:39.779072Z","title":"Rethinking Vision Transformers for MobileNet Size and Speed","venue":"cs.CV","work_id":"bafb34c1-cba1-47ad-b6e9-c9f618435ef2","year":2022},"citing_paper":{"arxiv_id":"2509.04669","last_updated":"2025-09-04T21:32:27Z","snapshot_observed_at":"2026-08-08T10:50:30.388762Z","submitted_at":"2025-09-04T21:32:27Z","title":"VCMamba: Bridging Convolutions with Multi-Directional Mamba for Efficient Visual Representation","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-05T05:58:36.730352Z"},"links":{"cited_paper":"/paper/2212.08059","citing_paper":"/paper/2509.04669"},"observation_digest":"sha256:e3dcc50323e6875e29da843c64407ed1eb122a888830cff8cf22e697b08234d3","observation_id":"f3483c8f-8267-46e6-93ff-0f99e5820c1f","resolution":{"observed_at":"2026-08-05T05:58:39.830062Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2206.01191","last_updated":"2022-10-11T03:06:16Z","snapshot_observed_at":"2026-07-06T13:16:54.118645Z","submitted_at":"2022-06-02T17:51:03Z","title":"EfficientFormer: Vision Transformers at MobileNet Speed","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2206.01191","snapshot_observed_at":"2026-08-05T05:58:36.856982Z","title":"Effi- cientformer: Vision transformers at mobilenet speed.arXiv preprint arXiv:2206.01191, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.04669","last_updated":"2025-09-04T21:32:27Z","snapshot_observed_at":"2026-08-08T10:50:30.388762Z","submitted_at":"2025-09-04T21:32:27Z","title":"VCMamba: Bridging Convolutions with Multi-Directional Mamba for Efficient Visual Representation","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-05T05:58:36.856982Z"},"links":{"cited_paper":"/paper/2206.01191","citing_paper":"/paper/2509.04669"},"observation_digest":"sha256:034ded098fef98412da01304de6a9e2fa7abf07bb516639a881cff80bc0a6181","observation_id":"368cf7c8-8827-4a50-be14-c05d87904c03","resolution":{"observed_at":"2026-08-05T05:58:36.856982Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.04404","last_updated":"2024-05-07T15:30:14Z","snapshot_observed_at":"2026-08-07T03:58:18.630260Z","submitted_at":"2024-05-07T15:30:14Z","title":"Vision Mamba: A Comprehensive Survey and Taxonomy","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.04404","snapshot_observed_at":"2026-08-05T05:58:36.974497Z","title":"Vision mamba: A comprehensive survey and taxonomy.arXiv preprint arXiv:2405.04404, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.04669","last_updated":"2025-09-04T21:32:27Z","snapshot_observed_at":"2026-08-08T10:50:30.388762Z","submitted_at":"2025-09-04T21:32:27Z","title":"VCMamba: Bridging Convolutions with Multi-Directional Mamba for Efficient Visual Representation","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-05T05:58:36.974497Z"},"links":{"cited_paper":"/paper/2405.04404","citing_paper":"/paper/2509.04669"},"observation_digest":"sha256:63ca1f163ae8ef058df2fb34103a3969787ab826dc77df90ea6b29451e87cca1","observation_id":"e8f9e3f9-8ca7-4705-b6fe-9f80e6a2b6cd","resolution":{"observed_at":"2026-08-05T05:58:36.974497Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:58:43.748530Z","title":"Vmamba: Visual state space model.Advances in neural information processing systems, 37:103031–103063, 2024","venue":null,"work_id":"66caf389-b8b2-449b-9c67-5efd51619b34","year":2024},"citing_paper":{"arxiv_id":"2509.04669","last_updated":"2025-09-04T21:32:27Z","snapshot_observed_at":"2026-08-08T10:50:30.388762Z","submitted_at":"2025-09-04T21:32:27Z","title":"VCMamba: Bridging Convolutions with Multi-Directional Mamba for Efficient Visual Representation","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-05T05:58:37.071587Z"},"links":{"citing_paper":"/paper/2509.04669"},"observation_digest":"sha256:517001fabe95dc9e7637b722a2655307054290e7bd88cd168e466506355a6472","observation_id":"936224c9-be73-481f-a6d1-ef993772d01f","resolution":{"observed_at":"2026-08-05T05:58:43.881910Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:58:37.181206Z","title":"Swin transformer: Hierarchical vision transformer using shifted windows","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2509.04669","last_updated":"2025-09-04T21:32:27Z","snapshot_observed_at":"2026-08-08T10:50:30.388762Z","submitted_at":"2025-09-04T21:32:27Z","title":"VCMamba: Bridging Convolutions with Multi-Directional Mamba for Efficient Visual Representation","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-05T05:58:37.181206Z"},"links":{"citing_paper":"/paper/2509.04669"},"observation_digest":"sha256:4d7f7cd234eefd807a8baeef9e4375846fe9995e802db7f2cc967c535ff81a77","observation_id":"20306d8c-19f8-4b77-bf23-59046d1a6584","resolution":{"observed_at":"2026-08-05T05:58:37.181206Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:58:37.303681Z","title":"A convnet for the 2020s","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.04669","last_updated":"2025-09-04T21:32:27Z","snapshot_observed_at":"2026-08-08T10:50:30.388762Z","submitted_at":"2025-09-04T21:32:27Z","title":"VCMamba: Bridging Convolutions with Multi-Directional Mamba for Efficient Visual Representation","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-05T05:58:37.303681Z"},"links":{"citing_paper":"/paper/2509.04669"},"observation_digest":"sha256:f05e6fefaf54b5a458e5c923487f24c56ce214a71b5d4fcaa614717c815cbb2b","observation_id":"348259d3-ce1b-4458-86d5-5273198273f1","resolution":{"observed_at":"2026-08-05T05:58:37.303681Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1711.05101","last_updated":"2019-01-04T21:01:49Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-11-14T14:24:06Z","title":"Decoupled Weight Decay Regularization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1711.05101","snapshot_observed_at":"2026-08-05T05:58:37.413506Z","title":"Decoupled weight decay regularization.arXiv preprint arXiv:1711.05101, 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2509.04669","last_updated":"2025-09-04T21:32:27Z","snapshot_observed_at":"2026-08-08T10:50:30.388762Z","submitted_at":"2025-09-04T21:32:27Z","title":"VCMamba: Bridging Convolutions with Multi-Directional Mamba for Efficient Visual Representation","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-05T05:58:37.413506Z"},"links":{"cited_paper":"/paper/1711.05101","citing_paper":"/paper/2509.04669"},"observation_digest":"sha256:bb66046a9891a51058ef94518c4c1957024bfa401e370fee53fa8199bc0e3b94","observation_id":"1108aeb2-5462-4fcd-9e39-21d83dfca2c3","resolution":{"observed_at":"2026-08-05T05:58:37.413506Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.02178","last_updated":"2022-03-04T17:17:31Z","snapshot_observed_at":"2026-07-06T11:54:38.041673Z","submitted_at":"2021-10-05T17:07:53Z","title":"MobileViT: Light-weight, General-purpose, and Mobile-friendly Vision Transformer","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.02178","snapshot_observed_at":"2026-08-05T05:58:37.547248Z","title":"Mobilevit: light- weight, general-purpose, and mobile-friendly vision trans- former.arXiv preprint arXiv:2110.02178, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2509.04669","last_updated":"2025-09-04T21:32:27Z","snapshot_observed_at":"2026-08-08T10:50:30.388762Z","submitted_at":"2025-09-04T21:32:27Z","title":"VCMamba: Bridging Convolutions with Multi-Directional Mamba for Efficient Visual Representation","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-05T05:58:37.547248Z"},"links":{"cited_paper":"/paper/2110.02178","citing_paper":"/paper/2509.04669"},"observation_digest":"sha256:3c637ac7acf25dd0376ed4f234ab7c75874a42d4731da3392be87ab4c4f08f3f","observation_id":"19d5b4a8-c25f-4541-a607-e49b0be41cd8","resolution":{"observed_at":"2026-08-05T05:58:37.547248Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2206.02680","last_updated":"2022-06-06T15:31:35Z","snapshot_observed_at":"2026-08-03T05:32:57.281028Z","submitted_at":"2022-06-06T15:31:35Z","title":"Separable Self-attention for Mobile Vision Transformers","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2206.02680","snapshot_observed_at":"2026-08-05T05:58:37.681478Z","title":"Separable self- attention for mobile vision transformers.arXiv preprint arXiv:2206.02680, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.04669","last_updated":"2025-09-04T21:32:27Z","snapshot_observed_at":"2026-08-08T10:50:30.388762Z","submitted_at":"2025-09-04T21:32:27Z","title":"VCMamba: Bridging Convolutions with Multi-Directional Mamba for Efficient Visual Representation","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-05T05:58:37.681478Z"},"links":{"cited_paper":"/paper/2206.02680","citing_paper":"/paper/2509.04669"},"observation_digest":"sha256:7abb8a31ae1fde757c973f37726b55cd8f249eb118b2d26492f67e08c9df331f","observation_id":"79c8756f-1f73-4f5d-b01f-17d17222a623","resolution":{"observed_at":"2026-08-05T05:58:37.681478Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:58:43.445927Z","title":"Mo- bilevig: Graph-based sparse attention for mobile vision ap- plications","venue":null,"work_id":"a8e50717-c0ff-48b5-87fe-cbaf324a0f32","year":2023},"citing_paper":{"arxiv_id":"2509.04669","last_updated":"2025-09-04T21:32:27Z","snapshot_observed_at":"2026-08-08T10:50:30.388762Z","submitted_at":"2025-09-04T21:32:27Z","title":"VCMamba: Bridging Convolutions with Multi-Directional Mamba for Efficient Visual Representation","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-05T05:58:37.774218Z"},"links":{"citing_paper":"/paper/2509.04669"},"observation_digest":"sha256:8b7b5f22f4c940106316b8b33c71373873ffea1961f92f5862f9db86dd8aa7ea","observation_id":"48c5ed50-5bde-4cbc-b5a0-6922891ba141","resolution":{"observed_at":"2026-08-05T05:58:43.603905Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:58:43.237253Z","title":"Greedyvig: Dynamic axial graph construction for efficient vision gnns","venue":null,"work_id":"d7437e01-29df-4646-ac1b-2473f26f3ccb","year":2024},"citing_paper":{"arxiv_id":"2509.04669","last_updated":"2025-09-04T21:32:27Z","snapshot_observed_at":"2026-08-08T10:50:30.388762Z","submitted_at":"2025-09-04T21:32:27Z","title":"VCMamba: Bridging Convolutions with Multi-Directional Mamba for Efficient Visual Representation","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-05T05:58:37.887405Z"},"links":{"citing_paper":"/paper/2509.04669"},"observation_digest":"sha256:e6a209f3ccebbfc5519683833c07bf1fd2193d14bbc8a07e5225beb106f8aff6","observation_id":"2ef09ccb-7d4c-4bc6-82c5-f58431b6e600","resolution":{"observed_at":"2026-08-05T05:58:43.304071Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:58:42.969148Z","title":"Rapidnet: Multi-level dilated convolution based mobile backbone","venue":null,"work_id":"95b87503-5b21-41df-8163-dbb7b0b18560","year":2025},"citing_paper":{"arxiv_id":"2509.04669","last_updated":"2025-09-04T21:32:27Z","snapshot_observed_at":"2026-08-08T10:50:30.388762Z","submitted_at":"2025-09-04T21:32:27Z","title":"VCMamba: Bridging Convolutions with Multi-Directional Mamba for Efficient Visual Representation","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-05T05:58:38.027571Z"},"links":{"citing_paper":"/paper/2509.04669"},"observation_digest":"sha256:2415ba44aeef8b8a45b5a51e54f7faa03ef0a52b7a33d46ccb20f7ab4967fa7b","observation_id":"d5d6544a-da93-4228-9a24-bef4fd93f228","resolution":{"observed_at":"2026-08-05T05:58:43.103711Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:58:42.775292Z","title":"Rectified linear units im- prove restricted boltzmann machines","venue":null,"work_id":"3fd7c8f4-a918-46fa-906a-6083918b3e59","year":2010},"citing_paper":{"arxiv_id":"2509.04669","last_updated":"2025-09-04T21:32:27Z","snapshot_observed_at":"2026-08-08T10:50:30.388762Z","submitted_at":"2025-09-04T21:32:27Z","title":"VCMamba: Bridging Convolutions with Multi-Directional Mamba for Efficient Visual Representation","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-05T05:58:38.165862Z"},"links":{"citing_paper":"/paper/2509.04669"},"observation_digest":"sha256:2d5200392acdd9a896fc61d2db3b5877c48fb6cf8be76793f0f5e44c63a007ee","observation_id":"f3e2d82f-a55e-42f9-9a62-adb617efdce8","resolution":{"observed_at":"2026-08-05T05:58:42.849443Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.10640","last_updated":"2025-04-21T21:01:00Z","snapshot_observed_at":"2026-07-06T20:22:45.422714Z","submitted_at":"2025-01-18T02:59:10Z","title":"ClusterViG: Efficient Globally Aware Vision GNNs via Image Partitioning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.10640","snapshot_observed_at":"2026-08-05T05:58:38.203912Z","title":"Clustervig: Efficient globally aware vision gnns via image partitioning.arXiv preprint arXiv:2501.10640, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.04669","last_updated":"2025-09-04T21:32:27Z","snapshot_observed_at":"2026-08-08T10:50:30.388762Z","submitted_at":"2025-09-04T21:32:27Z","title":"VCMamba: Bridging Convolutions with Multi-Directional Mamba for Efficient Visual Representation","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-05T05:58:38.203912Z"},"links":{"cited_paper":"/paper/2501.10640","citing_paper":"/paper/2509.04669"},"observation_digest":"sha256:2296c9a5a4f6900e2e211221a2e96267caf4434f7946f7fac82d388ad18fe47e","observation_id":"32ddb340-de77-4452-9394-2f6d399e3841","resolution":{"observed_at":"2026-08-05T05:58:38.203912Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:58:42.618716Z","title":"Pytorch: An imperative style, high- performance deep learning library.Advances in neural in- formation processing systems, 32, 2019","venue":null,"work_id":"ec8a791c-3ba5-4e08-8dfb-ae89c3aa1542","year":2019},"citing_paper":{"arxiv_id":"2509.04669","last_updated":"2025-09-04T21:32:27Z","snapshot_observed_at":"2026-08-08T10:50:30.388762Z","submitted_at":"2025-09-04T21:32:27Z","title":"VCMamba: Bridging Convolutions with Multi-Directional Mamba for Efficient Visual Representation","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-05T05:58:38.332819Z"},"links":{"citing_paper":"/paper/2509.04669"},"observation_digest":"sha256:cdc813f91ec0fd69159b894c2cfb3a8def1ec84785c37f28d994e57a7914026c","observation_id":"702b9af9-06ac-4268-b871-c0275d2327e4","resolution":{"observed_at":"2026-08-05T05:58:42.697527Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:58:42.417944Z","title":"Mobilenetv2: Inverted residuals and linear bottlenecks","venue":null,"work_id":"6d5fb048-fd06-4c3d-9737-07fcc9ac46c5","year":2018},"citing_paper":{"arxiv_id":"2509.04669","last_updated":"2025-09-04T21:32:27Z","snapshot_observed_at":"2026-08-08T10:50:30.388762Z","submitted_at":"2025-09-04T21:32:27Z","title":"VCMamba: Bridging Convolutions with Multi-Directional Mamba for Efficient Visual Representation","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-05T05:58:38.448490Z"},"links":{"citing_paper":"/paper/2509.04669"},"observation_digest":"sha256:d39289cdb73cf476ff97e6bc72e0db5ee849cd394957761fda584a800a42faf6","observation_id":"d486ca89-4361-4dd9-9e4a-00358841a1b1","resolution":{"observed_at":"2026-08-05T05:58:42.507376Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1409.1556","last_updated":"2015-04-10T16:25:04Z","snapshot_observed_at":"2026-07-06T03:53:32.549552Z","submitted_at":"2014-09-04T19:48:04Z","title":"Very Deep Convolutional Networks for Large-Scale Image Recognition","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1409.1556","snapshot_observed_at":"2026-08-05T05:58:38.563887Z","title":"Very deep convo- lutional networks for large-scale image recognition.arXiv preprint arXiv:1409.1556, 2014","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2509.04669","last_updated":"2025-09-04T21:32:27Z","snapshot_observed_at":"2026-08-08T10:50:30.388762Z","submitted_at":"2025-09-04T21:32:27Z","title":"VCMamba: Bridging Convolutions with Multi-Directional Mamba for Efficient Visual Representation","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-05T05:58:38.563887Z"},"links":{"cited_paper":"/paper/1409.1556","citing_paper":"/paper/2509.04669"},"observation_digest":"sha256:dddc43fba7d8d8e6e8ff84e318411f84af7706217c25493ec7d4ed8a56361971","observation_id":"a3739f46-e632-4c9c-b9a1-3f70e487841a","resolution":{"observed_at":"2026-08-05T05:58:38.563887Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:58:42.273082Z","title":"Wignet: Windowed vi- sion graph neural network","venue":null,"work_id":"9d657300-3749-48ae-ab7c-d9f44e787704","year":2025},"citing_paper":{"arxiv_id":"2509.04669","last_updated":"2025-09-04T21:32:27Z","snapshot_observed_at":"2026-08-08T10:50:30.388762Z","submitted_at":"2025-09-04T21:32:27Z","title":"VCMamba: Bridging Convolutions with Multi-Directional Mamba for Efficient Visual Representation","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-05T05:58:38.673012Z"},"links":{"citing_paper":"/paper/2509.04669"},"observation_digest":"sha256:c83de6391ff9213e634d348cd47fd0a8f6a306b810225b9c7cc24cfd9defcecc","observation_id":"433e61f8-cd0a-43aa-a62f-a48213a6a185","resolution":{"observed_at":"2026-08-05T05:58:42.326216Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:58:38.767608Z","title":"Efficientnet: Rethinking model scaling for convolutional neural networks","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.04669","last_updated":"2025-09-04T21:32:27Z","snapshot_observed_at":"2026-08-08T10:50:30.388762Z","submitted_at":"2025-09-04T21:32:27Z","title":"VCMamba: Bridging Convolutions with Multi-Directional Mamba for Efficient Visual Representation","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-05T05:58:38.767608Z"},"links":{"citing_paper":"/paper/2509.04669"},"observation_digest":"sha256:1f74682f252483ce6056aecec1262028fd3909bf29b1c637deb536d75291fb75","observation_id":"15c407fa-fa22-41c1-914d-7959899ce7f5","resolution":{"observed_at":"2026-08-05T05:58:38.767608Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:58:42.076969Z","title":"Training data-efficient image transformers & distillation through at- tention","venue":null,"work_id":"b1cb26ca-5d98-4df3-a831-004ce640c2be","year":2021},"citing_paper":{"arxiv_id":"2509.04669","last_updated":"2025-09-04T21:32:27Z","snapshot_observed_at":"2026-08-08T10:50:30.388762Z","submitted_at":"2025-09-04T21:32:27Z","title":"VCMamba: Bridging Convolutions with Multi-Directional Mamba for Efficient Visual Representation","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-05T05:58:38.795749Z"},"links":{"citing_paper":"/paper/2509.04669"},"observation_digest":"sha256:bdae8275259ff1cc9a66a285194e8cd774b57412b9f0e19d1ee63242a2106603","observation_id":"7433c584-105b-4bc9-81da-a77f29a8600f","resolution":{"observed_at":"2026-08-05T05:58:42.154466Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:58:41.907132Z","title":"Fastvit: A fast hybrid vision transformer using structural reparameterization","venue":null,"work_id":"64f669d7-d5e2-4c0b-8e04-e27e7e15c114","year":2023},"citing_paper":{"arxiv_id":"2509.04669","last_updated":"2025-09-04T21:32:27Z","snapshot_observed_at":"2026-08-08T10:50:30.388762Z","submitted_at":"2025-09-04T21:32:27Z","title":"VCMamba: Bridging Convolutions with Multi-Directional Mamba for Efficient Visual Representation","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-05T05:58:38.849132Z"},"links":{"citing_paper":"/paper/2509.04669"},"observation_digest":"sha256:cb26454308cd9501badb2ed7ac4643ca44cc8f3602a7b8716de2d6e7f1b9d63a","observation_id":"04c9c0a7-63c6-4ed2-bc4e-72c1ad5bd3b1","resolution":{"observed_at":"2026-08-05T05:58:41.984843Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:58:41.684965Z","title":"Attention is all you need.Advances in neural information processing systems, 30, 2017","venue":null,"work_id":"ed27f437-1e16-4790-8d34-caa5f10ba36e","year":2017},"citing_paper":{"arxiv_id":"2509.04669","last_updated":"2025-09-04T21:32:27Z","snapshot_observed_at":"2026-08-08T10:50:30.388762Z","submitted_at":"2025-09-04T21:32:27Z","title":"VCMamba: Bridging Convolutions with Multi-Directional Mamba for Efficient Visual Representation","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-05T05:58:38.919068Z"},"links":{"citing_paper":"/paper/2509.04669"},"observation_digest":"sha256:b468bc55ff27315bd622df782fdd05bafb99e8023c080f7482bcf8d714c9823b","observation_id":"dbe7b6c8-9b96-4d34-b570-3827d060de11","resolution":{"observed_at":"2026-08-05T05:58:41.761150Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:58:41.518674Z","title":"Repvit: Revisiting mobile cnn from vit perspective","venue":null,"work_id":"3c6f0b3d-dd63-41c0-a8d5-ba0ef49ef243","year":2024},"citing_paper":{"arxiv_id":"2509.04669","last_updated":"2025-09-04T21:32:27Z","snapshot_observed_at":"2026-08-08T10:50:30.388762Z","submitted_at":"2025-09-04T21:32:27Z","title":"VCMamba: Bridging Convolutions with Multi-Directional Mamba for Efficient Visual Representation","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-05T05:58:38.991538Z"},"links":{"citing_paper":"/paper/2509.04669"},"observation_digest":"sha256:bdd6ed2ed943c7f0ddf2e1a2bf6fdbc78c36050725ab582ab8f4dc05ff54b6bb","observation_id":"ce0a5746-5951-4995-9755-23b4a3e40840","resolution":{"observed_at":"2026-08-05T05:58:41.596385Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:58:41.265123Z","title":"Pyramid vision transformer: A versatile backbone for dense prediction without convolutions","venue":null,"work_id":"a9d7a44c-8a65-4818-9635-098a593c3d3b","year":2021},"citing_paper":{"arxiv_id":"2509.04669","last_updated":"2025-09-04T21:32:27Z","snapshot_observed_at":"2026-08-08T10:50:30.388762Z","submitted_at":"2025-09-04T21:32:27Z","title":"VCMamba: Bridging Convolutions with Multi-Directional Mamba for Efficient Visual Representation","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-05T05:58:39.099174Z"},"links":{"citing_paper":"/paper/2509.04669"},"observation_digest":"sha256:34542f58ff0700f32b42a6d6400d4b5547d0380eb5c7c6c6d918813a8e79be1d","observation_id":"ca8a8dfd-cb6e-4dbf-8a85-2efe9af0f6c7","resolution":{"observed_at":"2026-08-05T05:58:41.356578Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:58:41.095430Z","title":"PyTorch Image Models.https : / / github","venue":null,"work_id":"29c2cd93-73e1-4fe5-80da-40e7a3320d24","year":2019},"citing_paper":{"arxiv_id":"2509.04669","last_updated":"2025-09-04T21:32:27Z","snapshot_observed_at":"2026-08-08T10:50:30.388762Z","submitted_at":"2025-09-04T21:32:27Z","title":"VCMamba: Bridging Convolutions with Multi-Directional Mamba for Efficient Visual Representation","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-05T05:58:39.148372Z"},"links":{"citing_paper":"/paper/2509.04669"},"observation_digest":"sha256:94bb3a861110b060faf9949cc97c7dda940aff7d593d96b27571cc7f1080467b","observation_id":"8d9df2df-93f6-4551-bb7c-fc1ca0b1ac67","resolution":{"observed_at":"2026-08-05T05:58:41.172195Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.17695","last_updated":"2024-08-15T14:30:02Z","snapshot_observed_at":"2026-08-08T14:30:13.287782Z","submitted_at":"2024-03-26T13:35:10Z","title":"PlainMamba: Improving Non-Hierarchical Mamba in Visual Recognition","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.17695","snapshot_observed_at":"2026-08-05T05:58:39.177250Z","title":"Plainmamba: Improving non-hierarchical mamba in visual recognition.arXiv preprint arXiv:2403.17695, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.04669","last_updated":"2025-09-04T21:32:27Z","snapshot_observed_at":"2026-08-08T10:50:30.388762Z","submitted_at":"2025-09-04T21:32:27Z","title":"VCMamba: Bridging Convolutions with Multi-Directional Mamba for Efficient Visual Representation","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-05T05:58:39.177250Z"},"links":{"cited_paper":"/paper/2403.17695","citing_paper":"/paper/2509.04669"},"observation_digest":"sha256:f69bb05042a3be8e755eab3064bbd36feb1c4ec1915a06936c5c74d98d65ceb6","observation_id":"277c4e8a-72b0-4200-b228-da2329e3794c","resolution":{"observed_at":"2026-08-05T05:58:39.177250Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.07992","last_updated":"2024-05-20T16:36:21Z","snapshot_observed_at":"2026-07-06T18:13:42.288757Z","submitted_at":"2024-05-13T17:59:56Z","title":"MambaOut: Do We Really Need Mamba for Vision?","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.07992","snapshot_observed_at":"2026-08-05T05:58:39.217128Z","title":"Mambaout: Do we really need mamba for vision?arXiv preprint arXiv:2405.07992,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.04669","last_updated":"2025-09-04T21:32:27Z","snapshot_observed_at":"2026-08-08T10:50:30.388762Z","submitted_at":"2025-09-04T21:32:27Z","title":"VCMamba: Bridging Convolutions with Multi-Directional Mamba for Efficient Visual Representation","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-05T05:58:39.217128Z"},"links":{"cited_paper":"/paper/2405.07992","citing_paper":"/paper/2509.04669"},"observation_digest":"sha256:ae6250aacde95b8944f0a6f3f188d867275aa83d4ffcb7b1b9b5b25e126caf6a","observation_id":"36052a3a-3299-4037-9ca8-988c60a224be","resolution":{"observed_at":"2026-08-05T05:58:39.217128Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:58:40.890383Z","title":"Metaformer is actually what you need for vision","venue":null,"work_id":"85108519-b491-4dac-88b2-a69d04e0441f","year":2022},"citing_paper":{"arxiv_id":"2509.04669","last_updated":"2025-09-04T21:32:27Z","snapshot_observed_at":"2026-08-08T10:50:30.388762Z","submitted_at":"2025-09-04T21:32:27Z","title":"VCMamba: Bridging Convolutions with Multi-Directional Mamba for Efficient Visual Representation","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-05T05:58:39.249945Z"},"links":{"citing_paper":"/paper/2509.04669"},"observation_digest":"sha256:e0ef0216615cbc005c4bf44307d4bcbfb9e875e6db1061764bde35c4f234c81f","observation_id":"bf57f865-6435-4885-ab58-5eee5e2b3aea","resolution":{"observed_at":"2026-08-05T05:58:40.999485Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:58:40.741292Z","title":"Cutmix: Regu- larization strategy to train strong classifiers with localizable features","venue":null,"work_id":"87db9e24-1be2-4d28-b3b8-1dedeff8fee1","year":2019},"citing_paper":{"arxiv_id":"2509.04669","last_updated":"2025-09-04T21:32:27Z","snapshot_observed_at":"2026-08-08T10:50:30.388762Z","submitted_at":"2025-09-04T21:32:27Z","title":"VCMamba: Bridging Convolutions with Multi-Directional Mamba for Efficient Visual Representation","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-05T05:58:39.296887Z"},"links":{"citing_paper":"/paper/2509.04669"},"observation_digest":"sha256:b7843cdea295fae32bfc8f8fe0fd8dee46cfd8b614063fc97572d7891d575b68","observation_id":"981e8379-2f7a-49e4-8864-d796b4879b29","resolution":{"observed_at":"2026-08-05T05:58:40.818367Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:58:40.585057Z","title":"Dauphin, and David Lopez-Paz","venue":null,"work_id":"d6a69d61-de96-42e0-8250-89a27f86986a","year":2018},"citing_paper":{"arxiv_id":"2509.04669","last_updated":"2025-09-04T21:32:27Z","snapshot_observed_at":"2026-08-08T10:50:30.388762Z","submitted_at":"2025-09-04T21:32:27Z","title":"VCMamba: Bridging Convolutions with Multi-Directional Mamba for Efficient Visual Representation","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-05T05:58:39.340206Z"},"links":{"citing_paper":"/paper/2509.04669"},"observation_digest":"sha256:05e73db6b39544cc66a931f8be928a7fee3269d498bd2d884ad4783702c14da1","observation_id":"82870f97-73e4-414b-aff7-60e65a1f824e","resolution":{"observed_at":"2026-08-05T05:58:40.663010Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:58:40.404418Z","title":"Random erasing data augmentation","venue":null,"work_id":"c4cf9a86-df77-4dcd-b26d-b1f12a58be72","year":2020},"citing_paper":{"arxiv_id":"2509.04669","last_updated":"2025-09-04T21:32:27Z","snapshot_observed_at":"2026-08-08T10:50:30.388762Z","submitted_at":"2025-09-04T21:32:27Z","title":"VCMamba: Bridging Convolutions with Multi-Directional Mamba for Efficient Visual Representation","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-05T05:58:39.435994Z"},"links":{"citing_paper":"/paper/2509.04669"},"observation_digest":"sha256:c73d2d028ea657b4bae33a3d1775d7a2afa0b3bfddcb7b4a51a48f766f71b655","observation_id":"08ab17e0-1696-4aa5-8291-6ec385f1d4fa","resolution":{"observed_at":"2026-08-05T05:58:40.462242Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:58:39.483221Z","title":"Scene parsing through ade20k dataset","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.04669","last_updated":"2025-09-04T21:32:27Z","snapshot_observed_at":"2026-08-08T10:50:30.388762Z","submitted_at":"2025-09-04T21:32:27Z","title":"VCMamba: Bridging Convolutions with Multi-Directional Mamba for Efficient Visual Representation","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-05T05:58:39.483221Z"},"links":{"citing_paper":"/paper/2509.04669"},"observation_digest":"sha256:ffad0425fe8fda0b7fbe9cb577a537177a2298612f44e661431fc383e438f0a1","observation_id":"bbf0b4bb-6de7-4169-a3d5-cce2fa52c974","resolution":{"observed_at":"2026-08-05T05:58:39.483221Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:58:40.211241Z","title":"Vision mamba: Efficient visual representation learning with bidirectional state space model","venue":null,"work_id":"4851ecaf-d2b6-402a-b6d5-570b21812a81","year":null},"citing_paper":{"arxiv_id":"2509.04669","last_updated":"2025-09-04T21:32:27Z","snapshot_observed_at":"2026-08-08T10:50:30.388762Z","submitted_at":"2025-09-04T21:32:27Z","title":"VCMamba: Bridging Convolutions with Multi-Directional Mamba for Efficient Visual Representation","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-05T05:58:39.562084Z"},"links":{"citing_paper":"/paper/2509.04669"},"observation_digest":"sha256:3ee8ee2535c43636321ec742ea0cad59afdef908098ce805f3c20089c843731b","observation_id":"22a9ae4d-183f-4311-8134-03a8e2e73197","resolution":{"observed_at":"2026-08-05T05:58:40.296591Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2509.04669","last_updated":"2025-09-04T21:32:27Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-08T10:50:30.388762Z","submitted_at":"2025-09-04T21:32:27Z","title":"VCMamba: Bridging Convolutions with Multi-Directional Mamba for Efficient Visual Representation"},"reference_resolution":{"displayed":54,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":23,"verified_exact":2,"verified_fuzzy":29},"total_outbound_references":54},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 54 of 54 outbound references and 0 inbound Pith citation observations for arXiv:2509.04669."}