{"as_of":"2026-08-20T23:57:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:3f7e9ac70743b7318bea7ec45609d33bbe5659c6fbf70712ad4cad20a5e5a56a","coverage":[{"denominator":44,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":44,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T23:37:45.207426Z","state":"measured"},{"denominator":44,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":44,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-20T06:33:59.587034+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2412.02344/citation-record","integrity":"/paper/2412.02344/integrity","json":"/paper/2412.02344/citation-record.json","paper":"/paper/2412.02344"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:37:45.936550Z","title":"GQA: training generalized multi-query transformer models from multi-head checkpoints","venue":null,"work_id":"6f807c4a-dd19-4ca1-8ffd-9466e2455002","year":2023},"citing_paper":{"arxiv_id":"2412.02344","last_updated":"2024-12-03T10:04:15Z","snapshot_observed_at":"2026-08-20T22:54:05.239556Z","submitted_at":"2024-12-03T10:04:15Z","title":"UniForm: A Reuse Attention Mechanism Optimized for Efficient Vision Transformers on Edge Devices","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-11T23:37:44.865758Z"},"links":{"citing_paper":"/paper/2412.02344"},"observation_digest":"sha256:bb46c70e8d96a5b7f3217b67f691966ff8b1cea8027a7f6c8d4e5c4ce7537110","observation_id":"115d185e-133f-405b-8745-79f331cd7c3f","resolution":{"observed_at":"2026-08-11T23:37:45.941493Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.12981","last_updated":"2024-05-21T17:59:29Z","snapshot_observed_at":"2026-08-20T10:03:23.466960Z","submitted_at":"2024-05-21T17:59:29Z","title":"Reducing Transformer Key-Value Cache Size with Cross-Layer Attention","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.12981","snapshot_observed_at":"2026-08-11T23:37:44.871522Z","title":"Reducing transformer key-value cache size with cross-layer attention","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.02344","last_updated":"2024-12-03T10:04:15Z","snapshot_observed_at":"2026-08-20T22:54:05.239556Z","submitted_at":"2024-12-03T10:04:15Z","title":"UniForm: A Reuse Attention Mechanism Optimized for Efficient Vision Transformers on Edge Devices","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-11T23:37:44.871522Z"},"links":{"cited_paper":"/paper/2405.12981","citing_paper":"/paper/2412.02344"},"observation_digest":"sha256:ab47d6e1f4fd49ab94fd331315d4d817a58b8e19a7ab6a3fa38e2c5b9e8ba95f","observation_id":"a0785f33-eacf-4f05-ab0a-3c3e6e476661","resolution":{"observed_at":"2026-08-11T23:37:44.871522Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1906.07155","last_updated":"2019-06-17T17:58:12Z","snapshot_observed_at":"2026-08-16T03:32:25.570081Z","submitted_at":"2019-06-17T17:58:12Z","title":"MMDetection: Open MMLab Detection Toolbox and Benchmark","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1906.07155","snapshot_observed_at":"2026-08-11T23:37:44.876909Z","title":"MMDetection: Open mmlab detection toolbox and benchmark","venue":null,"work_id":null,"year":1906},"citing_paper":{"arxiv_id":"2412.02344","last_updated":"2024-12-03T10:04:15Z","snapshot_observed_at":"2026-08-20T22:54:05.239556Z","submitted_at":"2024-12-03T10:04:15Z","title":"UniForm: A Reuse Attention Mechanism Optimized for Efficient Vision Transformers on Edge Devices","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-11T23:37:44.876909Z"},"links":{"cited_paper":"/paper/1906.07155","citing_paper":"/paper/2412.02344"},"observation_digest":"sha256:517fb766986a992bcf36638c155e03f6edb89f350300bf035dbf77c7d15a664d","observation_id":"9c55382f-fa02-4a3c-9d87-5f310e9091f1","resolution":{"observed_at":"2026-08-11T23:37:44.876909Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:37:45.920698Z","title":"Mobile- former: Bridging mobilenet and transformer","venue":null,"work_id":"5944b416-5914-4bd7-a804-05c89b5a8928","year":2022},"citing_paper":{"arxiv_id":"2412.02344","last_updated":"2024-12-03T10:04:15Z","snapshot_observed_at":"2026-08-20T22:54:05.239556Z","submitted_at":"2024-12-03T10:04:15Z","title":"UniForm: A Reuse Attention Mechanism Optimized for Efficient Vision Transformers on Edge Devices","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-11T23:37:44.882661Z"},"links":{"citing_paper":"/paper/2412.02344"},"observation_digest":"sha256:7cec2b375eef198e88b31d5b51803e1a6bf2d42084312193f26d879835e25acb","observation_id":"8f22fb60-41dc-4ea7-bcc4-de5857081eb7","resolution":{"observed_at":"2026-08-11T23:37:45.925911Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:37:45.903762Z","title":"DHA: learning decoupled-head attention from transformer checkpoints via adaptive heads fusion","venue":null,"work_id":"8a1ed96a-bbb0-4bbb-ae48-334cdf6242e1","year":2024},"citing_paper":{"arxiv_id":"2412.02344","last_updated":"2024-12-03T10:04:15Z","snapshot_observed_at":"2026-08-20T22:54:05.239556Z","submitted_at":"2024-12-03T10:04:15Z","title":"UniForm: A Reuse Attention Mechanism Optimized for Efficient Vision Transformers on Edge Devices","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-11T23:37:44.887984Z"},"links":{"citing_paper":"/paper/2412.02344"},"observation_digest":"sha256:174733e23026dd390becd89caa768a30b2b8dec5ef1b14b6956ed4a115ecec54","observation_id":"03d320f3-9701-4447-9d92-b704087f98f1","resolution":{"observed_at":"2026-08-11T23:37:45.909336Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:37:45.888441Z","title":"Openmmlab’s pre-training tool- box and benchmark","venue":null,"work_id":"5f46deaa-a5a6-4efd-af0c-8ed5ee82757b","year":2023},"citing_paper":{"arxiv_id":"2412.02344","last_updated":"2024-12-03T10:04:15Z","snapshot_observed_at":"2026-08-20T22:54:05.239556Z","submitted_at":"2024-12-03T10:04:15Z","title":"UniForm: A Reuse Attention Mechanism Optimized for Efficient Vision Transformers on Edge Devices","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-11T23:37:44.893209Z"},"links":{"citing_paper":"/paper/2412.02344"},"observation_digest":"sha256:68b27a81860e59be7d95c489fb3384380e49560f18e6f88304a57bb9c113c4da","observation_id":"20a207a9-ac2f-40dd-9478-be88d10dade4","resolution":{"observed_at":"2026-08-11T23:37:45.893461Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:37:45.873186Z","title":"Fu, Stefano Ermon, Atri Rudra, and Christopher R ´e","venue":null,"work_id":"265e32a7-2d6c-4c8b-b91c-2a6ee1ce02e6","year":2022},"citing_paper":{"arxiv_id":"2412.02344","last_updated":"2024-12-03T10:04:15Z","snapshot_observed_at":"2026-08-20T22:54:05.239556Z","submitted_at":"2024-12-03T10:04:15Z","title":"UniForm: A Reuse Attention Mechanism Optimized for Efficient Vision Transformers on Edge Devices","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-11T23:37:44.898975Z"},"links":{"citing_paper":"/paper/2412.02344"},"observation_digest":"sha256:0f97707d56e25e73a38d22bab3cd92763043f55fe5bbbc47a3c9b361df858893","observation_id":"75828587-45a7-4336-bf9c-6005283c7f57","resolution":{"observed_at":"2026-08-11T23:37:45.878079Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:37:45.857442Z","title":"Imagenet: A large-scale hierarchical image database","venue":null,"work_id":"2bb5b209-7cd0-40ea-974e-05ba8b427560","year":2009},"citing_paper":{"arxiv_id":"2412.02344","last_updated":"2024-12-03T10:04:15Z","snapshot_observed_at":"2026-08-20T22:54:05.239556Z","submitted_at":"2024-12-03T10:04:15Z","title":"UniForm: A Reuse Attention Mechanism Optimized for Efficient Vision Transformers on Edge Devices","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-11T23:37:44.904024Z"},"links":{"citing_paper":"/paper/2412.02344"},"observation_digest":"sha256:82d992bb160fb827150b5ee8a03c4829c2329d41006ff02a51ab4c2ca3857c67","observation_id":"7eac38ef-0612-4a29-a661-ff356b7e8811","resolution":{"observed_at":"2026-08-11T23:37:45.862602Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:37:45.840041Z","title":"The case for 4-bit pre- cision: k-bit inference scaling laws","venue":null,"work_id":"257032fa-00d1-43c2-9c69-d18adb295aa4","year":2023},"citing_paper":{"arxiv_id":"2412.02344","last_updated":"2024-12-03T10:04:15Z","snapshot_observed_at":"2026-08-20T22:54:05.239556Z","submitted_at":"2024-12-03T10:04:15Z","title":"UniForm: A Reuse Attention Mechanism Optimized for Efficient Vision Transformers on Edge Devices","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-11T23:37:44.908697Z"},"links":{"citing_paper":"/paper/2412.02344"},"observation_digest":"sha256:992677dc9a51f0f38e55827c5a4f87ed54d5198d01f81c4f0a20cd4ca4c0f7a4","observation_id":"5c15eb1b-bf6c-479e-b716-c66630130bd1","resolution":{"observed_at":"2026-08-11T23:37:45.845872Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:37:45.823037Z","title":"Speeddetr: Speed-aware transformers for end-to-end object detection","venue":null,"work_id":"3ab6642e-7f0c-40a1-9d23-1e70aa8b9d86","year":2023},"citing_paper":{"arxiv_id":"2412.02344","last_updated":"2024-12-03T10:04:15Z","snapshot_observed_at":"2026-08-20T22:54:05.239556Z","submitted_at":"2024-12-03T10:04:15Z","title":"UniForm: A Reuse Attention Mechanism Optimized for Efficient Vision Transformers on Edge Devices","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-11T23:37:44.913609Z"},"links":{"citing_paper":"/paper/2412.02344"},"observation_digest":"sha256:716cbb7c760054b1edd790da462bacbd6a10483b9ddde55779a20add07cc2518","observation_id":"5f59e18d-4add-43c5-a97f-87582eacb50b","resolution":{"observed_at":"2026-08-11T23:37:45.828089Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.02803","last_updated":"2024-05-05T03:25:25Z","snapshot_observed_at":"2026-08-19T15:38:47.757063Z","submitted_at":"2024-05-05T03:25:25Z","title":"Is Flash Attention Stable?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.02803","snapshot_observed_at":"2026-08-11T23:37:44.918559Z","title":"Is flash attention stable? CoRR, abs/2405.02803, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.02344","last_updated":"2024-12-03T10:04:15Z","snapshot_observed_at":"2026-08-20T22:54:05.239556Z","submitted_at":"2024-12-03T10:04:15Z","title":"UniForm: A Reuse Attention Mechanism Optimized for Efficient Vision Transformers on Edge Devices","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-11T23:37:44.918559Z"},"links":{"cited_paper":"/paper/2405.02803","citing_paper":"/paper/2412.02344"},"observation_digest":"sha256:1f12cc396a1e0df16e7e04f6fe36e4708720bb319b3196251a38190c0545216f","observation_id":"9d49a3f3-fb76-45c5-bdab-4fa510b14b6c","resolution":{"observed_at":"2026-08-11T23:37:44.918559Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:37:45.806481Z","title":"Levit: a vision transformer in convnet’s clothing for faster inference","venue":null,"work_id":"f8184e70-126e-415c-b125-f54a56c1bab8","year":2021},"citing_paper":{"arxiv_id":"2412.02344","last_updated":"2024-12-03T10:04:15Z","snapshot_observed_at":"2026-08-20T22:54:05.239556Z","submitted_at":"2024-12-03T10:04:15Z","title":"UniForm: A Reuse Attention Mechanism Optimized for Efficient Vision Transformers on Edge Devices","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-11T23:37:44.924417Z"},"links":{"citing_paper":"/paper/2412.02344"},"observation_digest":"sha256:85353d4ad664faa4c54d68da5d8fc6950c23c076d34a49af86f3b79e2d578ad3","observation_id":"b34bae7e-6cd1-44be-99f5-91cc2b1f460b","resolution":{"observed_at":"2026-08-11T23:37:45.811646Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:37:45.790376Z","title":"Flatten transformer: Vision transformer using fo- cused linear attention","venue":null,"work_id":"f6f5d5b2-0dd7-4cbe-91fb-43c7a30fb367","year":2023},"citing_paper":{"arxiv_id":"2412.02344","last_updated":"2024-12-03T10:04:15Z","snapshot_observed_at":"2026-08-20T22:54:05.239556Z","submitted_at":"2024-12-03T10:04:15Z","title":"UniForm: A Reuse Attention Mechanism Optimized for Efficient Vision Transformers on Edge Devices","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-11T23:37:44.929382Z"},"links":{"citing_paper":"/paper/2412.02344"},"observation_digest":"sha256:6f46f7ca55154270370f2be10e0598b7686dab63580eef6c9e9840c934864fef","observation_id":"8f15f93a-65cc-48ae-8a37-440b9bf04806","resolution":{"observed_at":"2026-08-11T23:37:45.795490Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:37:45.773823Z","title":"Le, Mark Sandler, Bo Chen, Weijun Wang, Liang-Chieh Chen, Mingxing Tan, Grace Chu, Vijay Vasudevan, and Yukun Zhu","venue":null,"work_id":"e2216140-f4c1-44be-a87e-7ee9c6b23019","year":2019},"citing_paper":{"arxiv_id":"2412.02344","last_updated":"2024-12-03T10:04:15Z","snapshot_observed_at":"2026-08-20T22:54:05.239556Z","submitted_at":"2024-12-03T10:04:15Z","title":"UniForm: A Reuse Attention Mechanism Optimized for Efficient Vision Transformers on Edge Devices","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-11T23:37:44.934077Z"},"links":{"citing_paper":"/paper/2412.02344"},"observation_digest":"sha256:0c723f36c31972515a4708e88af4f26714642f7510f4b52a2012501855396c75","observation_id":"4bacec5c-2502-46e5-8791-9a538470a3a7","resolution":{"observed_at":"2026-08-11T23:37:45.779729Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:37:45.757724Z","title":"Transformers are rnns: Fast autoregressive transformers with linear attention","venue":null,"work_id":"365cf16a-3dee-474a-9da7-055d1273fcf0","year":2020},"citing_paper":{"arxiv_id":"2412.02344","last_updated":"2024-12-03T10:04:15Z","snapshot_observed_at":"2026-08-20T22:54:05.239556Z","submitted_at":"2024-12-03T10:04:15Z","title":"UniForm: A Reuse Attention Mechanism Optimized for Efficient Vision Transformers on Edge Devices","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-11T23:37:44.938924Z"},"links":{"citing_paper":"/paper/2412.02344"},"observation_digest":"sha256:e355595a08368b5b35ccbde45dd430c30e9795b00af24cc096285a1437bc192e","observation_id":"920601be-9c5a-485f-9ffe-f363203b12e6","resolution":{"observed_at":"2026-08-11T23:37:45.763084Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:37:44.944394Z","title":"Spvit: Enabling faster vision transformers via latency-aware soft token pruning","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.02344","last_updated":"2024-12-03T10:04:15Z","snapshot_observed_at":"2026-08-20T22:54:05.239556Z","submitted_at":"2024-12-03T10:04:15Z","title":"UniForm: A Reuse Attention Mechanism Optimized for Efficient Vision Transformers on Edge Devices","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-11T23:37:44.944394Z"},"links":{"citing_paper":"/paper/2412.02344"},"observation_digest":"sha256:7e99ea4f948a76b7b153cdd71f4398b8fe95e44ffcac0373b7466512f0105557","observation_id":"07702df4-cfec-49b4-9eb7-689a7cbef7d9","resolution":{"observed_at":"2026-08-11T23:37:44.944394Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:37:45.730356Z","title":"Couplformer: Rethinking vision transformer with cou- pling attention","venue":null,"work_id":"366da414-3af0-4f23-9e17-aff65abe036b","year":2023},"citing_paper":{"arxiv_id":"2412.02344","last_updated":"2024-12-03T10:04:15Z","snapshot_observed_at":"2026-08-20T22:54:05.239556Z","submitted_at":"2024-12-03T10:04:15Z","title":"UniForm: A Reuse Attention Mechanism Optimized for Efficient Vision Transformers on Edge Devices","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-11T23:37:44.950764Z"},"links":{"citing_paper":"/paper/2412.02344"},"observation_digest":"sha256:ce9a5cab44a7ec85aac0dd2725c0bc5008d1e5f506fc15620d80c744fba94e76","observation_id":"bd0c4f49-4a14-4bc8-9b69-6cfe4a4a1c25","resolution":{"observed_at":"2026-08-11T23:37:45.735447Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:37:45.713242Z","title":"Re- thinking vision transformers for mobilenet size and speed","venue":null,"work_id":"6a26cc77-609a-4db0-81dd-2d25e6f06b1f","year":2023},"citing_paper":{"arxiv_id":"2412.02344","last_updated":"2024-12-03T10:04:15Z","snapshot_observed_at":"2026-08-20T22:54:05.239556Z","submitted_at":"2024-12-03T10:04:15Z","title":"UniForm: A Reuse Attention Mechanism Optimized for Efficient Vision Transformers on Edge Devices","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-11T23:37:44.958014Z"},"links":{"citing_paper":"/paper/2412.02344"},"observation_digest":"sha256:13dd6ff16db4d9b8dc7ff1ab30970222b626f4fb5b40f2050929cadaf4a40fdb","observation_id":"7eff0da1-9c8a-4987-9eb4-f36003f1b53c","resolution":{"observed_at":"2026-08-11T23:37:45.718491Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:37:45.696822Z","title":"Re- thinking vision transformers for mobilenet size and speed","venue":null,"work_id":"da2e9bd6-1f15-4d09-8bad-d72f6cbcc8c8","year":2023},"citing_paper":{"arxiv_id":"2412.02344","last_updated":"2024-12-03T10:04:15Z","snapshot_observed_at":"2026-08-20T22:54:05.239556Z","submitted_at":"2024-12-03T10:04:15Z","title":"UniForm: A Reuse Attention Mechanism Optimized for Efficient Vision Transformers on Edge Devices","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-11T23:37:44.963388Z"},"links":{"citing_paper":"/paper/2412.02344"},"observation_digest":"sha256:cc1ed188e83621abdb02d4f751ba100a12d9c9e70b093a53253a3b3f5111a19c","observation_id":"9b7cc2ba-8284-484f-9584-ac7b60c54d9e","resolution":{"observed_at":"2026-08-11T23:37:45.702051Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:37:45.087669Z","title":"Belongie, James Hays, Pietro Perona, Deva Ramanan, Piotr Doll ´ar, and C","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2412.02344","last_updated":"2024-12-03T10:04:15Z","snapshot_observed_at":"2026-08-20T22:54:05.239556Z","submitted_at":"2024-12-03T10:04:15Z","title":"UniForm: A Reuse Attention Mechanism Optimized for Efficient Vision Transformers on Edge Devices","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-11T23:37:45.087669Z"},"links":{"citing_paper":"/paper/2412.02344"},"observation_digest":"sha256:f4d9d617cea1d2fa4962d4927a4fabe1d4b3d42a9c7c9454d827abf6b2f7b1e5","observation_id":"bba27326-72e4-43c1-9ba7-c70ae7d76c64","resolution":{"observed_at":"2026-08-11T23:37:45.087669Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:37:45.669677Z","title":"Efficientvit: Memory effi- cient vision transformer with cascaded group attention","venue":null,"work_id":"ba121a08-1c3e-4238-9518-7c8c960d2b2f","year":2023},"citing_paper":{"arxiv_id":"2412.02344","last_updated":"2024-12-03T10:04:15Z","snapshot_observed_at":"2026-08-20T22:54:05.239556Z","submitted_at":"2024-12-03T10:04:15Z","title":"UniForm: A Reuse Attention Mechanism Optimized for Efficient Vision Transformers on Edge Devices","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-11T23:37:45.092825Z"},"links":{"citing_paper":"/paper/2412.02344"},"observation_digest":"sha256:ff287ba9b1d0f6c249bd1f02581fe80356a9937f605a6986693b52b1ffba16a5","observation_id":"a266d22a-11a4-4560-b8c5-b53f7307e182","resolution":{"observed_at":"2026-08-11T23:37:45.675085Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:37:45.653530Z","title":"Swin transformer: Hierarchical vision transformer using shifted windows","venue":null,"work_id":"43236012-cf33-4be4-814b-3d648fd6ce80","year":2021},"citing_paper":{"arxiv_id":"2412.02344","last_updated":"2024-12-03T10:04:15Z","snapshot_observed_at":"2026-08-20T22:54:05.239556Z","submitted_at":"2024-12-03T10:04:15Z","title":"UniForm: A Reuse Attention Mechanism Optimized for Efficient Vision Transformers on Edge Devices","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-11T23:37:45.097648Z"},"links":{"citing_paper":"/paper/2412.02344"},"observation_digest":"sha256:7d63b8c2503835afeebfcf14ae38e351a23e26b10a5b47ee5fc8d5d5bc0f975f","observation_id":"73d9e24c-336f-41f9-bba3-41ec18c4e490","resolution":{"observed_at":"2026-08-11T23:37:45.658852Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:37:45.637760Z","title":"SGDR: stochastic gradient descent with warm restarts","venue":null,"work_id":"6403f8e4-d5c0-4ef1-8560-89322af0bbbf","year":2017},"citing_paper":{"arxiv_id":"2412.02344","last_updated":"2024-12-03T10:04:15Z","snapshot_observed_at":"2026-08-20T22:54:05.239556Z","submitted_at":"2024-12-03T10:04:15Z","title":"UniForm: A Reuse Attention Mechanism Optimized for Efficient Vision Transformers on Edge Devices","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-11T23:37:45.103079Z"},"links":{"citing_paper":"/paper/2412.02344"},"observation_digest":"sha256:42521267eea35ddedac888f0e04ea210501692d73c04aa328aebb885bbe6bff8","observation_id":"62703f45-bda1-4823-a8d3-68f99f218d47","resolution":{"observed_at":"2026-08-11T23:37:45.643073Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:37:45.108127Z","title":"Decoupled weight decay regularization","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2412.02344","last_updated":"2024-12-03T10:04:15Z","snapshot_observed_at":"2026-08-20T22:54:05.239556Z","submitted_at":"2024-12-03T10:04:15Z","title":"UniForm: A Reuse Attention Mechanism Optimized for Efficient Vision Transformers on Edge Devices","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-11T23:37:45.108127Z"},"links":{"citing_paper":"/paper/2412.02344"},"observation_digest":"sha256:0130f8595a8b3c67fed61dc273a02ead11e256fd2a0099552fd7c16c382f8040","observation_id":"b465f632-8ac8-4e01-96d5-32c0fdff9252","resolution":{"observed_at":"2026-08-11T23:37:45.108127Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:37:45.611460Z","title":"SOFT: softmax-free transformer with linear complexity","venue":null,"work_id":"922c63eb-c62c-4953-931d-13c1c0a966c1","year":2021},"citing_paper":{"arxiv_id":"2412.02344","last_updated":"2024-12-03T10:04:15Z","snapshot_observed_at":"2026-08-20T22:54:05.239556Z","submitted_at":"2024-12-03T10:04:15Z","title":"UniForm: A Reuse Attention Mechanism Optimized for Efficient Vision Transformers on Edge Devices","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-11T23:37:45.113041Z"},"links":{"citing_paper":"/paper/2412.02344"},"observation_digest":"sha256:7a0472127380be6166c32c92ac84c416133ff38896fed382f3a41a492095a96d","observation_id":"ce25b416-6418-4328-b726-1eea84e7f7dc","resolution":{"observed_at":"2026-08-11T23:37:45.616599Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:37:45.595521Z","title":"Delight: Deep and light-weight transformer","venue":null,"work_id":"7789e7e3-4969-4d1e-bf37-b4e50f622b69","year":2021},"citing_paper":{"arxiv_id":"2412.02344","last_updated":"2024-12-03T10:04:15Z","snapshot_observed_at":"2026-08-20T22:54:05.239556Z","submitted_at":"2024-12-03T10:04:15Z","title":"UniForm: A Reuse Attention Mechanism Optimized for Efficient Vision Transformers on Edge Devices","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-11T23:37:45.118026Z"},"links":{"citing_paper":"/paper/2412.02344"},"observation_digest":"sha256:5b1ff28700cf9cba2403e835f9144d7a412ceaf021b23ce59f9d5b2a22086803","observation_id":"00a31972-8b43-495e-af6e-ddf48284123c","resolution":{"observed_at":"2026-08-11T23:37:45.600778Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:37:45.578811Z","title":null,"venue":null,"work_id":"5acef929-62a9-4520-bd24-c0c5a785f4d8","year":2019},"citing_paper":{"arxiv_id":"2412.02344","last_updated":"2024-12-03T10:04:15Z","snapshot_observed_at":"2026-08-20T22:54:05.239556Z","submitted_at":"2024-12-03T10:04:15Z","title":"UniForm: A Reuse Attention Mechanism Optimized for Efficient Vision Transformers on Edge Devices","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-11T23:37:45.123237Z"},"links":{"citing_paper":"/paper/2412.02344"},"observation_digest":"sha256:f09dc3cb2328e5a6f13435a4c697762983186fe7dc805b94629ff8380c073d4e","observation_id":"cc8b1108-9104-43b2-9b9e-fd51b2930e9d","resolution":{"observed_at":"2026-08-11T23:37:45.584158Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:37:45.562734Z","title":"Fast vi- sion transformers with hilo attention","venue":null,"work_id":"41af17c8-1c41-496c-b610-bd7ddbac2695","year":2022},"citing_paper":{"arxiv_id":"2412.02344","last_updated":"2024-12-03T10:04:15Z","snapshot_observed_at":"2026-08-20T22:54:05.239556Z","submitted_at":"2024-12-03T10:04:15Z","title":"UniForm: A Reuse Attention Mechanism Optimized for Efficient Vision Transformers on Edge Devices","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-11T23:37:45.128515Z"},"links":{"citing_paper":"/paper/2412.02344"},"observation_digest":"sha256:74ef32788118021a25e3cff45a0092355070aa336f3a36348db0c1f9e63bdbe8","observation_id":"63b31029-7cab-4f49-a2f1-5c2435f279be","resolution":{"observed_at":"2026-08-11T23:37:45.567746Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:37:45.546677Z","title":"Yang, Zachary DeVito, Mar- tin Raison, Alykhan Tejani, Sasank Chilamkurthy, Benoit Steiner, Lu Fang, Junjie Bai, and Soumith Chintala","venue":null,"work_id":"47404bec-dcfa-4d5e-b793-85f19d21385b","year":2019},"citing_paper":{"arxiv_id":"2412.02344","last_updated":"2024-12-03T10:04:15Z","snapshot_observed_at":"2026-08-20T22:54:05.239556Z","submitted_at":"2024-12-03T10:04:15Z","title":"UniForm: A Reuse Attention Mechanism Optimized for Efficient Vision Transformers on Edge Devices","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-11T23:37:45.133710Z"},"links":{"citing_paper":"/paper/2412.02344"},"observation_digest":"sha256:8cd6ce5b59b535cdafd433a7f55864d8fdf8e0d61f987a85115d315d15aaeac6","observation_id":"19b41a4c-9a05-4cfa-8983-783dc5118be9","resolution":{"observed_at":"2026-08-11T23:37:45.552094Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:37:45.530512Z","title":"Efficient neural net- works: From algorithm design to practical mobile deploy- ment","venue":null,"work_id":"9ebc3324-e9ac-4457-a91c-9452c9b66baf","year":2023},"citing_paper":{"arxiv_id":"2412.02344","last_updated":"2024-12-03T10:04:15Z","snapshot_observed_at":"2026-08-20T22:54:05.239556Z","submitted_at":"2024-12-03T10:04:15Z","title":"UniForm: A Reuse Attention Mechanism Optimized for Efficient Vision Transformers on Edge Devices","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-11T23:37:45.139325Z"},"links":{"citing_paper":"/paper/2412.02344"},"observation_digest":"sha256:ac921b096723798d6877b332993f92ca796131d06a09fb2e9fdcfe5efacc920f","observation_id":"53c4221c-aa03-4037-acea-ffdab4123326","resolution":{"observed_at":"2026-08-11T23:37:45.536254Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:37:45.514446Z","title":"Sparq attention: Bandwidth-efficient LLM inference","venue":null,"work_id":"229cd89c-7c0c-4ea4-b82b-f6ca55c11580","year":2024},"citing_paper":{"arxiv_id":"2412.02344","last_updated":"2024-12-03T10:04:15Z","snapshot_observed_at":"2026-08-20T22:54:05.239556Z","submitted_at":"2024-12-03T10:04:15Z","title":"UniForm: A Reuse Attention Mechanism Optimized for Efficient Vision Transformers on Edge Devices","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-11T23:37:45.144108Z"},"links":{"citing_paper":"/paper/2412.02344"},"observation_digest":"sha256:60c90f202f24b9733b293f2e203805365c4511bdb89d44a06d6ed8f12f60fe1f","observation_id":"6af8a02c-03ad-47ec-8cb5-8acfe6983018","resolution":{"observed_at":"2026-08-11T23:37:45.519799Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:37:45.498478Z","title":"Linear transformers are secretly fast weight programmers","venue":null,"work_id":"fead48f7-81d1-4c3f-a024-264fd12ce1bf","year":2021},"citing_paper":{"arxiv_id":"2412.02344","last_updated":"2024-12-03T10:04:15Z","snapshot_observed_at":"2026-08-20T22:54:05.239556Z","submitted_at":"2024-12-03T10:04:15Z","title":"UniForm: A Reuse Attention Mechanism Optimized for Efficient Vision Transformers on Edge Devices","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-11T23:37:45.149077Z"},"links":{"citing_paper":"/paper/2412.02344"},"observation_digest":"sha256:a6b010373dee363804ea4c996a1b2e246d5dca7f4dc1fce78c875167f9519786","observation_id":"ca1ca2da-9abf-40f3-ade3-ee764ac3a30a","resolution":{"observed_at":"2026-08-11T23:37:45.503737Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:37:45.482435Z","title":"Efficient attention: Attention with linear complexities","venue":null,"work_id":"b9ff95d1-0531-4ae7-8c7a-2585ece5fe1d","year":2021},"citing_paper":{"arxiv_id":"2412.02344","last_updated":"2024-12-03T10:04:15Z","snapshot_observed_at":"2026-08-20T22:54:05.239556Z","submitted_at":"2024-12-03T10:04:15Z","title":"UniForm: A Reuse Attention Mechanism Optimized for Efficient Vision Transformers on Edge Devices","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-11T23:37:45.153947Z"},"links":{"citing_paper":"/paper/2412.02344"},"observation_digest":"sha256:2079a3ade0b115d9f3e5f846b6570b76cd8b5821048de7b298be2214bbe0b6c8","observation_id":"627a7651-6f45-4e02-9894-969175dba4df","resolution":{"observed_at":"2026-08-11T23:37:45.487596Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2301.12444","last_updated":"2023-01-29T13:38:45Z","snapshot_observed_at":"2026-08-17T15:35:38.762486Z","submitted_at":"2023-01-29T13:38:45Z","title":"Exploring Attention Map Reuse for Efficient Transformer Neural Networks","version":1},"cited_work":{"arxiv_id":"2301.12444","doi":null,"metadata_source":"pith","pith_arxiv_id":"2301.12444","snapshot_observed_at":"2026-08-11T23:37:45.245760Z","title":"Exploring Attention Map Reuse for Efficient Transformer Neural Networks","venue":"cs.AI","work_id":"b49f7d16-edf6-4ff8-9102-9854ab02d7e4","year":2023},"citing_paper":{"arxiv_id":"2412.02344","last_updated":"2024-12-03T10:04:15Z","snapshot_observed_at":"2026-08-20T22:54:05.239556Z","submitted_at":"2024-12-03T10:04:15Z","title":"UniForm: A Reuse Attention Mechanism Optimized for Efficient Vision Transformers on Edge Devices","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-11T23:37:45.158888Z"},"links":{"cited_paper":"/paper/2301.12444","citing_paper":"/paper/2412.02344"},"observation_digest":"sha256:0f6828ae39bb7592ca51baaa09c32b74f38ae2eb0c28f4fc54063b5cf49d0541","observation_id":"dc897709-8af5-44b7-a8d6-bb4ed3e50429","resolution":{"observed_at":"2026-08-11T23:37:45.254347Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:37:45.464279Z","title":"Reed, Dragomir Anguelov, Dumitru Erhan, Vincent Vanhoucke, and Andrew Rabinovich","venue":null,"work_id":"20a1febf-5ea0-44f5-a6c0-c231749dc785","year":2015},"citing_paper":{"arxiv_id":"2412.02344","last_updated":"2024-12-03T10:04:15Z","snapshot_observed_at":"2026-08-20T22:54:05.239556Z","submitted_at":"2024-12-03T10:04:15Z","title":"UniForm: A Reuse Attention Mechanism Optimized for Efficient Vision Transformers on Edge Devices","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-11T23:37:45.164128Z"},"links":{"citing_paper":"/paper/2412.02344"},"observation_digest":"sha256:cdbe388e88042e028bdc2f46ae56e0733ab42d11497f53de2754e9690d923996","observation_id":"c595d9b0-5b17-4eac-b069-46e6e8d8c660","resolution":{"observed_at":"2026-08-11T23:37:45.469925Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:37:45.447430Z","title":null,"venue":null,"work_id":"fa4ba9a2-acb4-4a0f-a0d5-bf7175440328","year":2019},"citing_paper":{"arxiv_id":"2412.02344","last_updated":"2024-12-03T10:04:15Z","snapshot_observed_at":"2026-08-20T22:54:05.239556Z","submitted_at":"2024-12-03T10:04:15Z","title":"UniForm: A Reuse Attention Mechanism Optimized for Efficient Vision Transformers on Edge Devices","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-11T23:37:45.169417Z"},"links":{"citing_paper":"/paper/2412.02344"},"observation_digest":"sha256:8e0b81c287bf6b33e8e071a7158dfd10547735a0314efda88d458ef9741de7b0","observation_id":"3716c511-ce3c-4e6d-92b6-997665f3eefa","resolution":{"observed_at":"2026-08-11T23:37:45.452375Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:37:45.431261Z","title":"Gomez, Lukasz Kaiser, and Illia Polosukhin","venue":null,"work_id":"078e5d16-2234-49b1-988f-95b3895f1e48","year":2017},"citing_paper":{"arxiv_id":"2412.02344","last_updated":"2024-12-03T10:04:15Z","snapshot_observed_at":"2026-08-20T22:54:05.239556Z","submitted_at":"2024-12-03T10:04:15Z","title":"UniForm: A Reuse Attention Mechanism Optimized for Efficient Vision Transformers on Edge Devices","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-11T23:37:45.174388Z"},"links":{"citing_paper":"/paper/2412.02344"},"observation_digest":"sha256:2516ca56ce3a41198c4de3f0a313db684ce3b48396253331ae27c1c1b39a1e81","observation_id":"0a90eb49-c657-4b8a-8e8f-c2307f9137bf","resolution":{"observed_at":"2026-08-11T23:37:45.436251Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:37:45.415071Z","title":"Pyra- mid vision transformer: A versatile backbone for dense pre- diction without convolutions","venue":null,"work_id":"ea5be438-17ea-4bf4-a9fa-e2bf69af86dc","year":2021},"citing_paper":{"arxiv_id":"2412.02344","last_updated":"2024-12-03T10:04:15Z","snapshot_observed_at":"2026-08-20T22:54:05.239556Z","submitted_at":"2024-12-03T10:04:15Z","title":"UniForm: A Reuse Attention Mechanism Optimized for Efficient Vision Transformers on Edge Devices","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-11T23:37:45.179298Z"},"links":{"citing_paper":"/paper/2412.02344"},"observation_digest":"sha256:b4104f62b5d1acfe896cba6d1812f9ff1f64da06618d983fecd5f6c1cc35c623","observation_id":"ff97624e-519a-4e4b-9726-6ce86af9f37c","resolution":{"observed_at":"2026-08-11T23:37:45.420308Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:37:45.398440Z","title":"Global vision trans- former pruning with hessian-aware saliency","venue":null,"work_id":"ceee12cb-ed68-47c8-aeb7-3bec9b313313","year":2023},"citing_paper":{"arxiv_id":"2412.02344","last_updated":"2024-12-03T10:04:15Z","snapshot_observed_at":"2026-08-20T22:54:05.239556Z","submitted_at":"2024-12-03T10:04:15Z","title":"UniForm: A Reuse Attention Mechanism Optimized for Efficient Vision Transformers on Edge Devices","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-11T23:37:45.184045Z"},"links":{"citing_paper":"/paper/2412.02344"},"observation_digest":"sha256:65938b8685d643f28f1de686ac13617fec7bac8b99f3a860b4a7c85766764129","observation_id":"bdaa9991-b01b-4350-a6a2-44ea9089d90d","resolution":{"observed_at":"2026-08-11T23:37:45.404201Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:37:45.381993Z","title":"Cutmix: Regulariza- tion strategy to train strong classifiers with localizable fea- tures","venue":null,"work_id":"d47f1d16-c6b3-405f-a39e-cfe346dae4f5","year":2019},"citing_paper":{"arxiv_id":"2412.02344","last_updated":"2024-12-03T10:04:15Z","snapshot_observed_at":"2026-08-20T22:54:05.239556Z","submitted_at":"2024-12-03T10:04:15Z","title":"UniForm: A Reuse Attention Mechanism Optimized for Efficient Vision Transformers on Edge Devices","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-11T23:37:45.188645Z"},"links":{"citing_paper":"/paper/2412.02344"},"observation_digest":"sha256:f7abc36039e9c213d475bec3d7d0079d22af6e3349f924ca2b629dfc41e168ef","observation_id":"23d61166-30d0-4c91-84c8-1051aa8b1985","resolution":{"observed_at":"2026-08-11T23:37:45.387382Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:37:45.193416Z","title":"Dauphin, and David Lopez-Paz","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2412.02344","last_updated":"2024-12-03T10:04:15Z","snapshot_observed_at":"2026-08-20T22:54:05.239556Z","submitted_at":"2024-12-03T10:04:15Z","title":"UniForm: A Reuse Attention Mechanism Optimized for Efficient Vision Transformers on Edge Devices","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-11T23:37:45.193416Z"},"links":{"citing_paper":"/paper/2412.02344"},"observation_digest":"sha256:c0a8dc593907bdb0c3f22c4a50b42851053ebc00593ca22b0cf4bff08213c3f3","observation_id":"c3ef1511-5624-4d2d-a302-56e7b3d4242d","resolution":{"observed_at":"2026-08-11T23:37:45.193416Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:37:45.354509Z","title":"Minivit: Compressing vi- sion transformers with weight multiplexing","venue":null,"work_id":"05bcd93a-cce2-47c7-844b-cf738bba7103","year":2022},"citing_paper":{"arxiv_id":"2412.02344","last_updated":"2024-12-03T10:04:15Z","snapshot_observed_at":"2026-08-20T22:54:05.239556Z","submitted_at":"2024-12-03T10:04:15Z","title":"UniForm: A Reuse Attention Mechanism Optimized for Efficient Vision Transformers on Edge Devices","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-11T23:37:45.197888Z"},"links":{"citing_paper":"/paper/2412.02344"},"observation_digest":"sha256:f5d7a7e28e4e47a1fbb708b5ff7dd11500cc039fe082b1582a82d6cd0904ed0d","observation_id":"e88658a0-984e-432a-bbb9-b33942845987","resolution":{"observed_at":"2026-08-11T23:37:45.359740Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:37:45.337626Z","title":"Lightweight vision transformer with spatial and channel enhanced self-attention","venue":null,"work_id":"27c65e81-986b-4231-b1a2-32e723b0aa74","year":2023},"citing_paper":{"arxiv_id":"2412.02344","last_updated":"2024-12-03T10:04:15Z","snapshot_observed_at":"2026-08-20T22:54:05.239556Z","submitted_at":"2024-12-03T10:04:15Z","title":"UniForm: A Reuse Attention Mechanism Optimized for Efficient Vision Transformers on Edge Devices","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-11T23:37:45.202517Z"},"links":{"citing_paper":"/paper/2412.02344"},"observation_digest":"sha256:16f407aee078a5f6d3450484176a7a208841e4048f14f795e71070ab2af3d9f6","observation_id":"abb6826e-388e-44da-bcdb-1475714d132a","resolution":{"observed_at":"2026-08-11T23:37:45.343351Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:37:45.320370Z","title":"Random erasing data augmentation","venue":null,"work_id":"f6c6e864-eb46-4b32-b93b-aae196e81801","year":2020},"citing_paper":{"arxiv_id":"2412.02344","last_updated":"2024-12-03T10:04:15Z","snapshot_observed_at":"2026-08-20T22:54:05.239556Z","submitted_at":"2024-12-03T10:04:15Z","title":"UniForm: A Reuse Attention Mechanism Optimized for Efficient Vision Transformers on Edge Devices","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-11T23:37:45.207426Z"},"links":{"citing_paper":"/paper/2412.02344"},"observation_digest":"sha256:3283d613f7c8601b9f38dd2c2b1a799584c1bd9c356503ab837d51d5b49c8f61","observation_id":"91eca322-c52b-49ef-af19-0ee2576a7124","resolution":{"observed_at":"2026-08-11T23:37:45.325514Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2412.02344","last_updated":"2024-12-03T10:04:15Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-20T22:54:05.239556Z","submitted_at":"2024-12-03T10:04:15Z","title":"UniForm: A Reuse Attention Mechanism Optimized for Efficient Vision Transformers on Edge Devices"},"reference_resolution":{"displayed":44,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":8,"verified_exact":1,"verified_fuzzy":34},"total_outbound_references":44},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"thesis":"As of 20 August 2026, this Paper Citation Record lists 44 of 44 outbound references and 0 inbound Pith citation observations for arXiv:2412.02344."}