{"as_of":"2026-08-09T11:37:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:b7504fd1903c1fdaf4f8b7868783e98a6476f9b0749eb1495047b9dde3870f39","coverage":[{"denominator":27,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":27,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-08T17:58:04.812467Z","state":"measured"},{"denominator":27,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":27,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2502.05800/citation-record","integrity":"/paper/2502.05800/integrity","json":"/paper/2502.05800/citation-record.json","paper":"/paper/2502.05800"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2010.11929","last_updated":"2021-06-03T13:08:56Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-10-22T17:55:59Z","title":"An Image is Worth 16x16 Words: Transformers for Image Recognition at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.11929","snapshot_observed_at":"2026-08-08T17:58:04.741398Z","title":"An image is worth 16x16 words: Transformers for image recognition at scale,","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2502.05800","last_updated":"2025-02-09T08:04:39Z","snapshot_observed_at":"2026-08-08T17:50:58.506903Z","submitted_at":"2025-02-09T08:04:39Z","title":"MicroViT: A Vision Transformer with Low Complexity Self Attention for Edge Device","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-08T17:58:04.741398Z"},"links":{"cited_paper":"/paper/2010.11929","citing_paper":"/paper/2502.05800"},"observation_digest":"sha256:aab0a0d73e6909cdd096ad0a4369169ab184398608a37453112d0257f343654c","observation_id":"59f2a237-cb68-4b2d-9a11-6b2163b479ad","resolution":{"observed_at":"2026-08-08T17:58:04.741398Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:58:05.028868Z","title":"Multi- stage vision transformer for batik classification,","venue":null,"work_id":"32c48982-ad2a-464f-a519-f93e48fa0533","year":2024},"citing_paper":{"arxiv_id":"2502.05800","last_updated":"2025-02-09T08:04:39Z","snapshot_observed_at":"2026-08-08T17:50:58.506903Z","submitted_at":"2025-02-09T08:04:39Z","title":"MicroViT: A Vision Transformer with Low Complexity Self Attention for Edge Device","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-08T17:58:04.745255Z"},"links":{"citing_paper":"/paper/2502.05800"},"observation_digest":"sha256:857661b58d3b9fd23c60adbfed8b0b01af91d5c3e412d3882e7d9f4c1488d65e","observation_id":"02d8c1bb-691b-40af-9e26-bd22e4f25a0a","resolution":{"observed_at":"2026-08-08T17:58:05.031828Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:58:05.020167Z","title":"Swin transformer for pedestrian and occluded pedestrian detection,","venue":null,"work_id":"cbc7c939-c9d1-4fe6-a297-4c024ae54c84","year":2024},"citing_paper":{"arxiv_id":"2502.05800","last_updated":"2025-02-09T08:04:39Z","snapshot_observed_at":"2026-08-08T17:50:58.506903Z","submitted_at":"2025-02-09T08:04:39Z","title":"MicroViT: A Vision Transformer with Low Complexity Self Attention for Edge Device","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-08T17:58:04.748141Z"},"links":{"citing_paper":"/paper/2502.05800"},"observation_digest":"sha256:a6516c81d7f6410d9a394618c181f0c0be96a7a04ef8c39d359ac69b393d9048","observation_id":"893f065f-bec7-434f-9727-8170cc21939e","resolution":{"observed_at":"2026-08-08T17:58:05.023404Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:58:05.011149Z","title":"Metformer: A motion enhanced transformer for multiple object tracking,","venue":null,"work_id":"22b379fd-707a-4a36-81ca-ad69c784344a","year":2023},"citing_paper":{"arxiv_id":"2502.05800","last_updated":"2025-02-09T08:04:39Z","snapshot_observed_at":"2026-08-08T17:50:58.506903Z","submitted_at":"2025-02-09T08:04:39Z","title":"MicroViT: A Vision Transformer with Low Complexity Self Attention for Edge Device","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-08T17:58:04.751246Z"},"links":{"citing_paper":"/paper/2502.05800"},"observation_digest":"sha256:8c8c2aee3f66e3cbb69aae438d05d66ce5ddb9fd998a31b6a4c039377ae7c07b","observation_id":"44950125-f96b-4378-a066-0bc494b8c56a","resolution":{"observed_at":"2026-08-08T17:58:05.014185Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:58:05.001764Z","title":"Spik- ingvit: a multi-scale spiking vision transformer model for event-based object detection,","venue":null,"work_id":"54d63af5-ce8b-4595-9b21-c6448d7e9a4e","year":2024},"citing_paper":{"arxiv_id":"2502.05800","last_updated":"2025-02-09T08:04:39Z","snapshot_observed_at":"2026-08-08T17:50:58.506903Z","submitted_at":"2025-02-09T08:04:39Z","title":"MicroViT: A Vision Transformer with Low Complexity Self Attention for Edge Device","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-08T17:58:04.754302Z"},"links":{"citing_paper":"/paper/2502.05800"},"observation_digest":"sha256:0aff0c94d88e75004f8070cd4e70eb85715d54b21a2c052bced466affc76986b","observation_id":"7cd0ea31-ccd1-4af8-b2b9-035e86b55364","resolution":{"observed_at":"2026-08-08T17:58:05.005810Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:58:04.993232Z","title":"Inpainting diffusion synthetic and data augment with feature keypoints for tiny partial fingerprints,","venue":null,"work_id":"6096cfad-5c9d-4fff-b49e-7350d2edc5c0","year":2024},"citing_paper":{"arxiv_id":"2502.05800","last_updated":"2025-02-09T08:04:39Z","snapshot_observed_at":"2026-08-08T17:50:58.506903Z","submitted_at":"2025-02-09T08:04:39Z","title":"MicroViT: A Vision Transformer with Low Complexity Self Attention for Edge Device","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-08T17:58:04.757138Z"},"links":{"citing_paper":"/paper/2502.05800"},"observation_digest":"sha256:16c33e2214c512555d31aab0eb62558c45bc986be9d184f01d6a76e25e2f472b","observation_id":"e424e00b-a465-49e6-9670-1a6be41219a2","resolution":{"observed_at":"2026-08-08T17:58:04.996358Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:58:04.984860Z","title":"Fpga-based batik classification using quantization aware training of mobilenet and data- flow implementation,","venue":null,"work_id":"214167de-9e1e-44ab-84dc-8666e864d9de","year":2024},"citing_paper":{"arxiv_id":"2502.05800","last_updated":"2025-02-09T08:04:39Z","snapshot_observed_at":"2026-08-08T17:50:58.506903Z","submitted_at":"2025-02-09T08:04:39Z","title":"MicroViT: A Vision Transformer with Low Complexity Self Attention for Edge Device","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-08T17:58:04.760387Z"},"links":{"citing_paper":"/paper/2502.05800"},"observation_digest":"sha256:21b1e78f1062b4e68711d59e376e5e587f5e4d22e9f2be25fa096150cf63709b","observation_id":"43282867-5fe8-47b2-94ce-f28008cd6305","resolution":{"observed_at":"2026-08-08T17:58:04.987979Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2110.02178","last_updated":"2022-03-04T17:17:31Z","snapshot_observed_at":"2026-07-06T11:54:38.041673Z","submitted_at":"2021-10-05T17:07:53Z","title":"MobileViT: Light-weight, General-purpose, and Mobile-friendly Vision Transformer","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.02178","snapshot_observed_at":"2026-08-08T17:58:04.763070Z","title":"Mobilevit: light-weight, general- purpose, and mobile-friendly vision transformer,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.05800","last_updated":"2025-02-09T08:04:39Z","snapshot_observed_at":"2026-08-08T17:50:58.506903Z","submitted_at":"2025-02-09T08:04:39Z","title":"MicroViT: A Vision Transformer with Low Complexity Self Attention for Edge Device","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-08T17:58:04.763070Z"},"links":{"cited_paper":"/paper/2110.02178","citing_paper":"/paper/2502.05800"},"observation_digest":"sha256:1e9bb7a6939d0f9dc79c821a5e6b750261446052740f0e09fa60a7297e3d7636","observation_id":"c8fa5d7b-7fe6-49ab-957a-6935cc2713fb","resolution":{"observed_at":"2026-08-08T17:58:04.763070Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:58:04.976575Z","title":"Cvt: Introducing convolutions to vision transformers,","venue":null,"work_id":"9031bbe3-d888-49d5-b981-30fdd4dbb073","year":2021},"citing_paper":{"arxiv_id":"2502.05800","last_updated":"2025-02-09T08:04:39Z","snapshot_observed_at":"2026-08-08T17:50:58.506903Z","submitted_at":"2025-02-09T08:04:39Z","title":"MicroViT: A Vision Transformer with Low Complexity Self Attention for Edge Device","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-08T17:58:04.766166Z"},"links":{"citing_paper":"/paper/2502.05800"},"observation_digest":"sha256:2ef65cfdb4f51bf36b5648a74a8e8b77fe3c9b946d72aea87950b031c175a673","observation_id":"40422421-87ef-4adb-bd36-4dac391f8c7e","resolution":{"observed_at":"2026-08-08T17:58:04.979546Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:58:04.768393Z","title":"Mobilenetv2: Inverted residuals and linear bottlenecks,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2502.05800","last_updated":"2025-02-09T08:04:39Z","snapshot_observed_at":"2026-08-08T17:50:58.506903Z","submitted_at":"2025-02-09T08:04:39Z","title":"MicroViT: A Vision Transformer with Low Complexity Self Attention for Edge Device","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-08T17:58:04.768393Z"},"links":{"citing_paper":"/paper/2502.05800"},"observation_digest":"sha256:7beb31976f40ec9af5dfdf489495e9d61f1baff1c7f88264670fa268ed82bb95","observation_id":"779b7e31-0bf1-491f-abca-6041f982f8d2","resolution":{"observed_at":"2026-08-08T17:58:04.768393Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:58:04.963855Z","title":"Pyramid vision transformer: A versatile backbone for dense prediction without convolutions,","venue":null,"work_id":"858363fb-66ff-4c18-9920-f850a0e20c26","year":2021},"citing_paper":{"arxiv_id":"2502.05800","last_updated":"2025-02-09T08:04:39Z","snapshot_observed_at":"2026-08-08T17:50:58.506903Z","submitted_at":"2025-02-09T08:04:39Z","title":"MicroViT: A Vision Transformer with Low Complexity Self Attention for Edge Device","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-08T17:58:04.770613Z"},"links":{"citing_paper":"/paper/2502.05800"},"observation_digest":"sha256:dfdcc30754a626447d6fa256ef9c79aa1a4e04a5f552bec754e4f7e24aebcce4","observation_id":"4e998098-5081-49fc-8451-52e5270c983a","resolution":{"observed_at":"2026-08-08T17:58:04.966794Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2206.02680","last_updated":"2022-06-06T15:31:35Z","snapshot_observed_at":"2026-08-03T05:32:57.281028Z","submitted_at":"2022-06-06T15:31:35Z","title":"Separable Self-attention for Mobile Vision Transformers","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2206.02680","snapshot_observed_at":"2026-08-08T17:58:04.772771Z","title":"Separable self-attention for mobile vision transformers,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.05800","last_updated":"2025-02-09T08:04:39Z","snapshot_observed_at":"2026-08-08T17:50:58.506903Z","submitted_at":"2025-02-09T08:04:39Z","title":"MicroViT: A Vision Transformer with Low Complexity Self Attention for Edge Device","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-08T17:58:04.772771Z"},"links":{"cited_paper":"/paper/2206.02680","citing_paper":"/paper/2502.05800"},"observation_digest":"sha256:df888c494f1e55740cb5d26b4e8c6385f80580d0fba3efb18500ab307922cacc","observation_id":"89bc9b10-f41a-4a18-bc44-be5888c6bac9","resolution":{"observed_at":"2026-08-08T17:58:04.772771Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:58:04.955240Z","title":"Edgenext: efficiently amalgamated cnn- transformer architecture for mobile vision applications,","venue":null,"work_id":"fa1cc5f3-2fde-4a2b-857d-61fe5380cea5","year":2022},"citing_paper":{"arxiv_id":"2502.05800","last_updated":"2025-02-09T08:04:39Z","snapshot_observed_at":"2026-08-08T17:50:58.506903Z","submitted_at":"2025-02-09T08:04:39Z","title":"MicroViT: A Vision Transformer with Low Complexity Self Attention for Edge Device","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-08T17:58:04.775479Z"},"links":{"citing_paper":"/paper/2502.05800"},"observation_digest":"sha256:37204747b13fe063fa7220ba138ff4791cbcafd0bb7a9b7e6cad96173e6c9579","observation_id":"5ad7cba3-fc11-41d0-ba66-9a268ce4dd23","resolution":{"observed_at":"2026-08-08T17:58:04.958514Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:58:04.946778Z","title":"Fastvit: A fast hybrid vision transformer using structural reparameterization,","venue":null,"work_id":"131ab519-7594-4ac4-86cf-77c5771fd22b","year":2023},"citing_paper":{"arxiv_id":"2502.05800","last_updated":"2025-02-09T08:04:39Z","snapshot_observed_at":"2026-08-08T17:50:58.506903Z","submitted_at":"2025-02-09T08:04:39Z","title":"MicroViT: A Vision Transformer with Low Complexity Self Attention for Edge Device","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-08T17:58:04.777740Z"},"links":{"citing_paper":"/paper/2502.05800"},"observation_digest":"sha256:20951cc8bcfcfb53b2afc4299f161cbfda35dcb051d0f6a1befe85addbeceff2","observation_id":"45607b23-9e98-4076-ade5-f0f04e6103f9","resolution":{"observed_at":"2026-08-08T17:58:04.949857Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:58:04.938769Z","title":"Rethinking vision transformers for mobilenet size and speed,","venue":null,"work_id":"48d6766e-85fc-430a-97fa-060342b85c90","year":2023},"citing_paper":{"arxiv_id":"2502.05800","last_updated":"2025-02-09T08:04:39Z","snapshot_observed_at":"2026-08-08T17:50:58.506903Z","submitted_at":"2025-02-09T08:04:39Z","title":"MicroViT: A Vision Transformer with Low Complexity Self Attention for Edge Device","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-08T17:58:04.779794Z"},"links":{"citing_paper":"/paper/2502.05800"},"observation_digest":"sha256:9c370483bbbca2be6ce99c8a76fae76560ef62308f9d597927c0d96a3e59dad2","observation_id":"651a5058-6dd5-47e2-9c60-42eab5284bae","resolution":{"observed_at":"2026-08-08T17:58:04.941525Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:58:04.931351Z","title":"Mobileone: An improved one millisecond mobile backbone,","venue":null,"work_id":"9a397586-c201-4a30-9b51-d4b6f4254ffc","year":2023},"citing_paper":{"arxiv_id":"2502.05800","last_updated":"2025-02-09T08:04:39Z","snapshot_observed_at":"2026-08-08T17:50:58.506903Z","submitted_at":"2025-02-09T08:04:39Z","title":"MicroViT: A Vision Transformer with Low Complexity Self Attention for Edge Device","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-08T17:58:04.782008Z"},"links":{"citing_paper":"/paper/2502.05800"},"observation_digest":"sha256:017c50cd5ba7eef272483dee097a497e386d876e3bf7881704290892bb864d2e","observation_id":"2d09db95-a630-421d-9765-c5fc124de584","resolution":{"observed_at":"2026-08-08T17:58:04.934011Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:58:04.924025Z","title":"Shvit: Single-head vision transformer with memory efficient macro design,","venue":null,"work_id":"46a3403f-823d-40a4-b1d2-d54edab56671","year":2024},"citing_paper":{"arxiv_id":"2502.05800","last_updated":"2025-02-09T08:04:39Z","snapshot_observed_at":"2026-08-08T17:50:58.506903Z","submitted_at":"2025-02-09T08:04:39Z","title":"MicroViT: A Vision Transformer with Low Complexity Self Attention for Edge Device","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-08T17:58:04.784275Z"},"links":{"citing_paper":"/paper/2502.05800"},"observation_digest":"sha256:bdcb92c1afc5001acb6e3d0fa3f2ae362ac581c9e089910d25a11c3a0cdd027c","observation_id":"481e8bdf-a5aa-4cf4-9b1a-ff107e5911f0","resolution":{"observed_at":"2026-08-08T17:58:04.926600Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:58:04.916586Z","title":"Metaformer is actually what you need for vision,","venue":null,"work_id":"d820d10b-6ab8-4c27-bd4b-2856f55f1c7e","year":2022},"citing_paper":{"arxiv_id":"2502.05800","last_updated":"2025-02-09T08:04:39Z","snapshot_observed_at":"2026-08-08T17:50:58.506903Z","submitted_at":"2025-02-09T08:04:39Z","title":"MicroViT: A Vision Transformer with Low Complexity Self Attention for Edge Device","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-08T17:58:04.786905Z"},"links":{"citing_paper":"/paper/2502.05800"},"observation_digest":"sha256:8df7019e1f4a788ed62dd5dc45a0dc2f7a4d8d3eac59a0d4e52d328f7a349d08","observation_id":"84d60219-f959-4ae8-9e52-1a3ccfc43970","resolution":{"observed_at":"2026-08-08T17:58:04.919035Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:58:04.789639Z","title":"Imagenet large scale visual recognition challenge,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2502.05800","last_updated":"2025-02-09T08:04:39Z","snapshot_observed_at":"2026-08-08T17:50:58.506903Z","submitted_at":"2025-02-09T08:04:39Z","title":"MicroViT: A Vision Transformer with Low Complexity Self Attention for Edge Device","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-08T17:58:04.789639Z"},"links":{"citing_paper":"/paper/2502.05800"},"observation_digest":"sha256:677e95013d305002948d4508ac3075bee366e4aceac852927b2637614dda63f1","observation_id":"6bc7049b-3b0b-48dd-bbca-f40d213174d2","resolution":{"observed_at":"2026-08-08T17:58:04.789639Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:58:04.792540Z","title":"Training data-efficient image transformers & distillation through attention,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.05800","last_updated":"2025-02-09T08:04:39Z","snapshot_observed_at":"2026-08-08T17:50:58.506903Z","submitted_at":"2025-02-09T08:04:39Z","title":"MicroViT: A Vision Transformer with Low Complexity Self Attention for Edge Device","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-08T17:58:04.792540Z"},"links":{"citing_paper":"/paper/2502.05800"},"observation_digest":"sha256:1c4a94fce65a8b702082418ddd92e8db2ddaa3d66825ef98fa03430aded1a569","observation_id":"99ff4849-dd3e-45b3-b0b7-ac3a3e64d89b","resolution":{"observed_at":"2026-08-08T17:58:04.792540Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1711.05101","last_updated":"2019-01-04T21:01:49Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-11-14T14:24:06Z","title":"Decoupled Weight Decay Regularization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1711.05101","snapshot_observed_at":"2026-08-08T17:58:04.795604Z","title":"Decoupled weight decay regularization,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2502.05800","last_updated":"2025-02-09T08:04:39Z","snapshot_observed_at":"2026-08-08T17:50:58.506903Z","submitted_at":"2025-02-09T08:04:39Z","title":"MicroViT: A Vision Transformer with Low Complexity Self Attention for Edge Device","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-08T17:58:04.795604Z"},"links":{"cited_paper":"/paper/1711.05101","citing_paper":"/paper/2502.05800"},"observation_digest":"sha256:c6ae28af1a43ff852a6f738f346908d1836cf6ce3ea98934fecb1037e6c5c1c2","observation_id":"a60f83fd-5124-44a5-91e1-dd61261d6aaf","resolution":{"observed_at":"2026-08-08T17:58:04.795604Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:58:04.798731Z","title":"Microsoft coco: Common objects in context,","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2502.05800","last_updated":"2025-02-09T08:04:39Z","snapshot_observed_at":"2026-08-08T17:50:58.506903Z","submitted_at":"2025-02-09T08:04:39Z","title":"MicroViT: A Vision Transformer with Low Complexity Self Attention for Edge Device","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-08T17:58:04.798731Z"},"links":{"citing_paper":"/paper/2502.05800"},"observation_digest":"sha256:c37f51df67fb05e388b75372200c7f261b9decbb3c2c3f7b5a222e8811de88a3","observation_id":"fece45c9-eec0-4789-9647-762611ce9455","resolution":{"observed_at":"2026-08-08T17:58:04.798731Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:58:04.894907Z","title":"Focal loss for dense object detection,","venue":null,"work_id":"c4d9ac68-3b82-487f-8212-415134d8267b","year":2017},"citing_paper":{"arxiv_id":"2502.05800","last_updated":"2025-02-09T08:04:39Z","snapshot_observed_at":"2026-08-08T17:50:58.506903Z","submitted_at":"2025-02-09T08:04:39Z","title":"MicroViT: A Vision Transformer with Low Complexity Self Attention for Edge Device","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-08T17:58:04.801433Z"},"links":{"citing_paper":"/paper/2502.05800"},"observation_digest":"sha256:d634ed30747c0cdb1279303a53ec8cceee7a8c35ab17152c1e6bf305bf9449fb","observation_id":"8e64271d-fd3b-43eb-b015-d5e72d487e34","resolution":{"observed_at":"2026-08-08T17:58:04.897883Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:58:04.886409Z","title":"Efficientvit: Memory efficient vision transformer with cascaded group attention,","venue":null,"work_id":"6c67ecb2-5e21-4b2a-b6db-830fa4280488","year":2023},"citing_paper":{"arxiv_id":"2502.05800","last_updated":"2025-02-09T08:04:39Z","snapshot_observed_at":"2026-08-08T17:50:58.506903Z","submitted_at":"2025-02-09T08:04:39Z","title":"MicroViT: A Vision Transformer with Low Complexity Self Attention for Edge Device","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-08T17:58:04.804088Z"},"links":{"citing_paper":"/paper/2502.05800"},"observation_digest":"sha256:15cd72ee6177f0e9c0cf8d7ef8764b72c73cdfa8da8542f4b8669f9175f3ae06","observation_id":"4354da48-9042-41ab-9c3b-aa0c01f680ee","resolution":{"observed_at":"2026-08-08T17:58:04.889689Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1906.07155","last_updated":"2019-06-17T17:58:12Z","snapshot_observed_at":"2026-08-03T13:01:27.142233Z","submitted_at":"2019-06-17T17:58:12Z","title":"MMDetection: Open MMLab Detection Toolbox and Benchmark","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1906.07155","snapshot_observed_at":"2026-08-08T17:58:04.806808Z","title":"MMDetection: Open mmlab detection toolbox and benchmark,","venue":null,"work_id":null,"year":1906},"citing_paper":{"arxiv_id":"2502.05800","last_updated":"2025-02-09T08:04:39Z","snapshot_observed_at":"2026-08-08T17:50:58.506903Z","submitted_at":"2025-02-09T08:04:39Z","title":"MicroViT: A Vision Transformer with Low Complexity Self Attention for Edge Device","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-08T17:58:04.806808Z"},"links":{"cited_paper":"/paper/1906.07155","citing_paper":"/paper/2502.05800"},"observation_digest":"sha256:c3bce9534ad737e70b1aad19b4fc4ff73e6afe38de5f25f50507015e0460e041","observation_id":"72950951-9fca-4b79-a371-d41afdd6b872","resolution":{"observed_at":"2026-08-08T17:58:04.806808Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:58:04.877904Z","title":"Run, don’t walk: chasing higher flops for faster neural networks,","venue":null,"work_id":"e309c6da-9545-4086-9976-46e55f8be356","year":2023},"citing_paper":{"arxiv_id":"2502.05800","last_updated":"2025-02-09T08:04:39Z","snapshot_observed_at":"2026-08-08T17:50:58.506903Z","submitted_at":"2025-02-09T08:04:39Z","title":"MicroViT: A Vision Transformer with Low Complexity Self Attention for Edge Device","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-08T17:58:04.809847Z"},"links":{"citing_paper":"/paper/2502.05800"},"observation_digest":"sha256:27ef68319463dc1dba85c34bc03f911929c8855163df8d82cc3ab6fe5ff42096","observation_id":"a0c0c8e7-2e6f-4d46-86e6-a88dd0681219","resolution":{"observed_at":"2026-08-08T17:58:04.881205Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T17:58:04.868884Z","title":"Searching for mobilenetv3,","venue":null,"work_id":"e49d97ad-7d7d-4473-847c-27e2d5c0ec65","year":2019},"citing_paper":{"arxiv_id":"2502.05800","last_updated":"2025-02-09T08:04:39Z","snapshot_observed_at":"2026-08-08T17:50:58.506903Z","submitted_at":"2025-02-09T08:04:39Z","title":"MicroViT: A Vision Transformer with Low Complexity Self Attention for Edge Device","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-08T17:58:04.812467Z"},"links":{"citing_paper":"/paper/2502.05800"},"observation_digest":"sha256:0c08759c867822025d22f570b9fb135cada3c9a6a74afa1369a5976fb1f25c05","observation_id":"48a1eb33-7b5c-491f-9532-63207fd1351d","resolution":{"observed_at":"2026-08-08T17:58:04.872576Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2502.05800","last_updated":"2025-02-09T08:04:39Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-08T17:50:58.506903Z","submitted_at":"2025-02-09T08:04:39Z","title":"MicroViT: A Vision Transformer with Low Complexity Self Attention for Edge Device"},"reference_resolution":{"displayed":27,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":9,"verified_exact":0,"verified_fuzzy":18},"total_outbound_references":27},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 27 of 27 outbound references and 0 inbound Pith citation observations for arXiv:2502.05800."}