{"as_of":"2026-08-10T03:39:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:aacf94478a5480eaea94f3816aeafd5ecf3e85c9db4c374eed2a84717049f139","coverage":[{"denominator":36,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":36,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-09T10:41:01.420244Z","state":"measured"},{"denominator":36,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":36,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2502.02919/citation-record","integrity":"/paper/2502.02919/integrity","json":"/paper/2502.02919/citation-record.json","paper":"/paper/2502.02919"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"1607.06450","last_updated":"2016-07-21T19:57:52Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2016-07-21T19:57:52Z","title":"Layer Normalization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1607.06450","snapshot_observed_at":"2026-08-09T10:41:01.239337Z","title":"L.; Kiros, J","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2502.02919","last_updated":"2025-02-05T06:29:05Z","snapshot_observed_at":"2026-08-10T03:12:47.536782Z","submitted_at":"2025-02-05T06:29:05Z","title":"Maximizing the Position Embedding for Vision Transformers with Global Average Pooling","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-09T10:41:01.239337Z"},"links":{"cited_paper":"/paper/1607.06450","citing_paper":"/paper/2502.02919"},"observation_digest":"sha256:aca54a6bb029617b66ae299830c40eba7f00e2d085dcf75a0c1fe47e80eb8a68","observation_id":"e661855d-07eb-4557-b828-2c81dc1a4a5c","resolution":{"observed_at":"2026-08-09T10:41:01.239337Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:41:02.004120Z","title":null,"venue":null,"work_id":"e2f9c7df-fab7-4092-b9b8-ed977f467dbb","year":2019},"citing_paper":{"arxiv_id":"2502.02919","last_updated":"2025-02-05T06:29:05Z","snapshot_observed_at":"2026-08-10T03:12:47.536782Z","submitted_at":"2025-02-05T06:29:05Z","title":"Maximizing the Position Embedding for Vision Transformers with Global Average Pooling","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-09T10:41:01.246337Z"},"links":{"citing_paper":"/paper/2502.02919"},"observation_digest":"sha256:dbd9159e6b7f6418ab7373deb89023b96e2c90a998fc45565327eab25ac422bf","observation_id":"ec137b26-5003-4bd1-b0fd-29606f6bfc7d","resolution":{"observed_at":"2026-08-09T10:41:02.009344Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:41:01.251977Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2502.02919","last_updated":"2025-02-05T06:29:05Z","snapshot_observed_at":"2026-08-10T03:12:47.536782Z","submitted_at":"2025-02-05T06:29:05Z","title":"Maximizing the Position Embedding for Vision Transformers with Global Average Pooling","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-09T10:41:01.251977Z"},"links":{"citing_paper":"/paper/2502.02919"},"observation_digest":"sha256:a237ca4fdd4c8762eed9b90cc89c6815b3adc9785f961c6c81f432403b7c5da4","observation_id":"ec6f87cd-03b7-44fe-8263-539446193a3d","resolution":{"observed_at":"2026-08-09T10:41:01.251977Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:41:01.977777Z","title":"J.; Jin, R.; and Shou, M","venue":null,"work_id":"8235bb47-76f9-4114-becf-f465026ac972","year":2023},"citing_paper":{"arxiv_id":"2502.02919","last_updated":"2025-02-05T06:29:05Z","snapshot_observed_at":"2026-08-10T03:12:47.536782Z","submitted_at":"2025-02-05T06:29:05Z","title":"Maximizing the Position Embedding for Vision Transformers with Global Average Pooling","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-09T10:41:01.257588Z"},"links":{"citing_paper":"/paper/2502.02919"},"observation_digest":"sha256:8af6e13ceb6965ed2504d27ad54dd1fab74abb4add347db768a14d5207fe64e5","observation_id":"16c3790a-fb14-424e-8ea9-bc6217ab2907","resolution":{"observed_at":"2026-08-09T10:41:01.982712Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1906.07155","last_updated":"2019-06-17T17:58:12Z","snapshot_observed_at":"2026-08-03T13:01:27.142233Z","submitted_at":"2019-06-17T17:58:12Z","title":"MMDetection: Open MMLab Detection Toolbox and Benchmark","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1906.07155","snapshot_observed_at":"2026-08-09T10:41:01.262696Z","title":"C.; and Lin, D","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2502.02919","last_updated":"2025-02-05T06:29:05Z","snapshot_observed_at":"2026-08-10T03:12:47.536782Z","submitted_at":"2025-02-05T06:29:05Z","title":"Maximizing the Position Embedding for Vision Transformers with Global Average Pooling","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-09T10:41:01.262696Z"},"links":{"cited_paper":"/paper/1906.07155","citing_paper":"/paper/2502.02919"},"observation_digest":"sha256:52619d5d129eff506cd358d57b1b5e6f9986f976e45ac64b4705725ea8101aa4","observation_id":"6ee06156-ff64-425f-b760-4c1971901098","resolution":{"observed_at":"2026-08-09T10:41:01.262696Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2205.08534","last_updated":"2023-02-13T15:50:22Z","snapshot_observed_at":"2026-08-07T21:44:39.930046Z","submitted_at":"2022-05-17T17:59:11Z","title":"Vision Transformer Adapter for Dense Predictions","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.08534","snapshot_observed_at":"2026-08-09T10:41:01.268204Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.02919","last_updated":"2025-02-05T06:29:05Z","snapshot_observed_at":"2026-08-10T03:12:47.536782Z","submitted_at":"2025-02-05T06:29:05Z","title":"Maximizing the Position Embedding for Vision Transformers with Global Average Pooling","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-09T10:41:01.268204Z"},"links":{"cited_paper":"/paper/2205.08534","citing_paper":"/paper/2502.02919"},"observation_digest":"sha256:cd1377d2901cddca95d3c757c8d057d886022a2f0c009964e3fdc2b6f3b6d0a2","observation_id":"963676bc-1edb-48fd-922d-7aef6b7701bd","resolution":{"observed_at":"2026-08-09T10:41:01.268204Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:41:01.959348Z","title":null,"venue":null,"work_id":"41e1afe6-95d3-4e08-9f1e-8998ea88bd1f","year":2021},"citing_paper":{"arxiv_id":"2502.02919","last_updated":"2025-02-05T06:29:05Z","snapshot_observed_at":"2026-08-10T03:12:47.536782Z","submitted_at":"2025-02-05T06:29:05Z","title":"Maximizing the Position Embedding for Vision Transformers with Global Average Pooling","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-09T10:41:01.274027Z"},"links":{"citing_paper":"/paper/2502.02919"},"observation_digest":"sha256:0dc4f8ca8a14891b1423a7a4afced97b4d0110b1465a510c0c1a205ffd1ffb1a","observation_id":"eefb3eef-0b7d-4a45-8348-3a7a6d85e486","resolution":{"observed_at":"2026-08-09T10:41:01.966546Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2102.10882","last_updated":"2023-02-13T01:19:57Z","snapshot_observed_at":"2026-08-06T12:12:32.479948Z","submitted_at":"2021-02-22T10:29:55Z","title":"Conditional Positional Encodings for Vision Transformers","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2102.10882","snapshot_observed_at":"2026-08-09T10:41:01.278794Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.02919","last_updated":"2025-02-05T06:29:05Z","snapshot_observed_at":"2026-08-10T03:12:47.536782Z","submitted_at":"2025-02-05T06:29:05Z","title":"Maximizing the Position Embedding for Vision Transformers with Global Average Pooling","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-09T10:41:01.278794Z"},"links":{"cited_paper":"/paper/2102.10882","citing_paper":"/paper/2502.02919"},"observation_digest":"sha256:38c9227eeb176b1c093927b267529001e8758aa71489b3a7b79101f2863067cb","observation_id":"2a89c1d7-1ebc-4665-b812-c104c6b8916a","resolution":{"observed_at":"2026-08-09T10:41:01.278794Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:41:01.944229Z","title":null,"venue":null,"work_id":"3f05d502-3b6f-4634-8c65-471a774b0084","year":2020},"citing_paper":{"arxiv_id":"2502.02919","last_updated":"2025-02-05T06:29:05Z","snapshot_observed_at":"2026-08-10T03:12:47.536782Z","submitted_at":"2025-02-05T06:29:05Z","title":"Maximizing the Position Embedding for Vision Transformers with Global Average Pooling","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-09T10:41:01.284003Z"},"links":{"citing_paper":"/paper/2502.02919"},"observation_digest":"sha256:01d9de1af0cd4635c88837921618aabb220541d5849f1db8298cc32057aafea1","observation_id":"0e20669a-ab27-43aa-bf4a-b58d34e2d938","resolution":{"observed_at":"2026-08-09T10:41:01.949151Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:41:01.288513Z","title":null,"venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2502.02919","last_updated":"2025-02-05T06:29:05Z","snapshot_observed_at":"2026-08-10T03:12:47.536782Z","submitted_at":"2025-02-05T06:29:05Z","title":"Maximizing the Position Embedding for Vision Transformers with Global Average Pooling","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-09T10:41:01.288513Z"},"links":{"citing_paper":"/paper/2502.02919"},"observation_digest":"sha256:da7b2007862da41785230736d957ed439df686af1c6112b556265e814d51ec20","observation_id":"f6cab2d6-8f57-4e7f-9bce-75c1ea147823","resolution":{"observed_at":"2026-08-09T10:41:01.288513Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2010.11929","last_updated":"2021-06-03T13:08:56Z","snapshot_observed_at":"2026-08-10T01:12:16.468283Z","submitted_at":"2020-10-22T17:55:59Z","title":"An Image is Worth 16x16 Words: Transformers for Image Recognition at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.11929","snapshot_observed_at":"2026-08-09T10:41:01.293518Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2502.02919","last_updated":"2025-02-05T06:29:05Z","snapshot_observed_at":"2026-08-10T03:12:47.536782Z","submitted_at":"2025-02-05T06:29:05Z","title":"Maximizing the Position Embedding for Vision Transformers with Global Average Pooling","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-09T10:41:01.293518Z"},"links":{"cited_paper":"/paper/2010.11929","citing_paper":"/paper/2502.02919"},"observation_digest":"sha256:a066902c5eda72777b78afcee5b79a311f5a45a66f8bc18319680328a1393be4","observation_id":"591e8f8a-cc38-47e5-9a9f-73e7ee6af321","resolution":{"observed_at":"2026-08-09T10:41:01.293518Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2104.05704","last_updated":"2022-06-07T19:25:30Z","snapshot_observed_at":"2026-08-10T03:12:27.237826Z","submitted_at":"2021-04-12T17:58:56Z","title":"Escaping the Big Data Paradigm with Compact Transformers","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.05704","snapshot_observed_at":"2026-08-09T10:41:01.298875Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.02919","last_updated":"2025-02-05T06:29:05Z","snapshot_observed_at":"2026-08-10T03:12:47.536782Z","submitted_at":"2025-02-05T06:29:05Z","title":"Maximizing the Position Embedding for Vision Transformers with Global Average Pooling","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-09T10:41:01.298875Z"},"links":{"cited_paper":"/paper/2104.05704","citing_paper":"/paper/2502.02919"},"observation_digest":"sha256:8f0d104820666fed47182fa2ccde0e76ccea6acec986dc1b96759fac8c0a6c80","observation_id":"717870e9-5ab3-4364-a5f6-c01970772fe0","resolution":{"observed_at":"2026-08-09T10:41:01.298875Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:41:01.303810Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2502.02919","last_updated":"2025-02-05T06:29:05Z","snapshot_observed_at":"2026-08-10T03:12:47.536782Z","submitted_at":"2025-02-05T06:29:05Z","title":"Maximizing the Position Embedding for Vision Transformers with Global Average Pooling","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-09T10:41:01.303810Z"},"links":{"citing_paper":"/paper/2502.02919"},"observation_digest":"sha256:03d70452125a728aec833cd8401d5bf66a6dd6efac5fe364afe5d6544422caba","observation_id":"2068eef1-69cf-4add-b4fb-0f2d8febc9c1","resolution":{"observed_at":"2026-08-09T10:41:01.303810Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.13298","last_updated":"2024-07-16T04:54:56Z","snapshot_observed_at":"2026-07-06T17:47:30.518562Z","submitted_at":"2024-03-20T04:47:13Z","title":"Rotary Position Embedding for Vision Transformer","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.13298","snapshot_observed_at":"2026-08-09T10:41:01.308538Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.02919","last_updated":"2025-02-05T06:29:05Z","snapshot_observed_at":"2026-08-10T03:12:47.536782Z","submitted_at":"2025-02-05T06:29:05Z","title":"Maximizing the Position Embedding for Vision Transformers with Global Average Pooling","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-09T10:41:01.308538Z"},"links":{"cited_paper":"/paper/2403.13298","citing_paper":"/paper/2502.02919"},"observation_digest":"sha256:b4d7193788459702960cd8653320e1f498af94e25155a628438e0b717d6dd075","observation_id":"f6034912-b7f0-4ccc-b819-7b146fb90ef1","resolution":{"observed_at":"2026-08-09T10:41:01.308538Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:41:01.313341Z","title":null,"venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2502.02919","last_updated":"2025-02-05T06:29:05Z","snapshot_observed_at":"2026-08-10T03:12:47.536782Z","submitted_at":"2025-02-05T06:29:05Z","title":"Maximizing the Position Embedding for Vision Transformers with Global Average Pooling","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-09T10:41:01.313341Z"},"links":{"citing_paper":"/paper/2502.02919"},"observation_digest":"sha256:b23388b32cf5fd4f36bdf9d5ab87faa288236a81205ae739996c56bdd23dea25","observation_id":"0df307c7-248e-4f89-b52d-40080797030a","resolution":{"observed_at":"2026-08-09T10:41:01.313341Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:41:01.318568Z","title":null,"venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2502.02919","last_updated":"2025-02-05T06:29:05Z","snapshot_observed_at":"2026-08-10T03:12:47.536782Z","submitted_at":"2025-02-05T06:29:05Z","title":"Maximizing the Position Embedding for Vision Transformers with Global Average Pooling","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-09T10:41:01.318568Z"},"links":{"citing_paper":"/paper/2502.02919"},"observation_digest":"sha256:a64c31a39b1949e3aeb80d5901a1903cbf25c3878e65fa9d089ba3929e7ddb2a","observation_id":"de472f31-358d-4b32-9ad3-a6e256d5b830","resolution":{"observed_at":"2026-08-09T10:41:01.318568Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:41:01.323421Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.02919","last_updated":"2025-02-05T06:29:05Z","snapshot_observed_at":"2026-08-10T03:12:47.536782Z","submitted_at":"2025-02-05T06:29:05Z","title":"Maximizing the Position Embedding for Vision Transformers with Global Average Pooling","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-09T10:41:01.323421Z"},"links":{"citing_paper":"/paper/2502.02919"},"observation_digest":"sha256:9f34246181ee4de3f03c671056ea975fe77a1458560c2abea00fd6e32be6d225","observation_id":"21c0907a-0ba6-42d3-8c64-ad4e73036f87","resolution":{"observed_at":"2026-08-09T10:41:01.323421Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:41:01.328114Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2502.02919","last_updated":"2025-02-05T06:29:05Z","snapshot_observed_at":"2026-08-10T03:12:47.536782Z","submitted_at":"2025-02-05T06:29:05Z","title":"Maximizing the Position Embedding for Vision Transformers with Global Average Pooling","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-09T10:41:01.328114Z"},"links":{"citing_paper":"/paper/2502.02919"},"observation_digest":"sha256:42210afa40804b582b089116dcf6476563f406cd6a82b4df14f49e0df557ac18","observation_id":"5a1140ae-6822-40c5-b119-1a01ee5eb784","resolution":{"observed_at":"2026-08-09T10:41:01.328114Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:41:01.332753Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.02919","last_updated":"2025-02-05T06:29:05Z","snapshot_observed_at":"2026-08-10T03:12:47.536782Z","submitted_at":"2025-02-05T06:29:05Z","title":"Maximizing the Position Embedding for Vision Transformers with Global Average Pooling","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-09T10:41:01.332753Z"},"links":{"citing_paper":"/paper/2502.02919"},"observation_digest":"sha256:acdc98ab760e20171aaf74ba48be2c0112e64700b9bd61d89837a1238f2d0895","observation_id":"47b62d92-d59e-4398-9df3-b27b436c0e61","resolution":{"observed_at":"2026-08-09T10:41:01.332753Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1803.02155","last_updated":"2018-04-12T18:51:33Z","snapshot_observed_at":"2026-07-06T06:26:51.386842Z","submitted_at":"2018-03-06T13:13:11Z","title":"Self-Attention with Relative Position Representations","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1803.02155","snapshot_observed_at":"2026-08-09T10:41:01.337970Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2502.02919","last_updated":"2025-02-05T06:29:05Z","snapshot_observed_at":"2026-08-10T03:12:47.536782Z","submitted_at":"2025-02-05T06:29:05Z","title":"Maximizing the Position Embedding for Vision Transformers with Global Average Pooling","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-09T10:41:01.337970Z"},"links":{"cited_paper":"/paper/1803.02155","citing_paper":"/paper/2502.02919"},"observation_digest":"sha256:43f558b68da5521b119332dc234e8290380b0ec49cd21d0e2e394111bbf15f91","observation_id":"14eaa9f1-5f2c-4801-9767-c27a832e012b","resolution":{"observed_at":"2026-08-09T10:41:01.337970Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:41:01.343091Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.02919","last_updated":"2025-02-05T06:29:05Z","snapshot_observed_at":"2026-08-10T03:12:47.536782Z","submitted_at":"2025-02-05T06:29:05Z","title":"Maximizing the Position Embedding for Vision Transformers with Global Average Pooling","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-09T10:41:01.343091Z"},"links":{"citing_paper":"/paper/2502.02919"},"observation_digest":"sha256:f39a51c6dcb7a2a9b1d00d1b200542da7c40fcc476435cfcf919fc9a4598916f","observation_id":"f0fedcb6-1420-47ea-96b3-e9e676f782b9","resolution":{"observed_at":"2026-08-09T10:41:01.343091Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:41:01.347656Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.02919","last_updated":"2025-02-05T06:29:05Z","snapshot_observed_at":"2026-08-10T03:12:47.536782Z","submitted_at":"2025-02-05T06:29:05Z","title":"Maximizing the Position Embedding for Vision Transformers with Global Average Pooling","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-09T10:41:01.347656Z"},"links":{"citing_paper":"/paper/2502.02919"},"observation_digest":"sha256:319e359a5de131d88904c2164919404072797b857d4c9a3b0d295959871594a9","observation_id":"487896cd-b4f6-4c1d-b708-342e75481ac1","resolution":{"observed_at":"2026-08-09T10:41:01.347656Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:41:01.355182Z","title":"N.; Kaiser, .; and Polosukhin, I","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2502.02919","last_updated":"2025-02-05T06:29:05Z","snapshot_observed_at":"2026-08-10T03:12:47.536782Z","submitted_at":"2025-02-05T06:29:05Z","title":"Maximizing the Position Embedding for Vision Transformers with Global Average Pooling","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-09T10:41:01.355182Z"},"links":{"citing_paper":"/paper/2502.02919"},"observation_digest":"sha256:1a0fcc6323f0c066778dcbb51c7f470f084555797ecfeeb1f69d6057c1556aec","observation_id":"e051b9ba-25d3-496d-825d-f5af358bf046","resolution":{"observed_at":"2026-08-09T10:41:01.355182Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:41:01.810055Z","title":null,"venue":null,"work_id":"73b2e17f-0cc2-4eff-a7bb-b5fe4b41d9c1","year":2021},"citing_paper":{"arxiv_id":"2502.02919","last_updated":"2025-02-05T06:29:05Z","snapshot_observed_at":"2026-08-10T03:12:47.536782Z","submitted_at":"2025-02-05T06:29:05Z","title":"Maximizing the Position Embedding for Vision Transformers with Global Average Pooling","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-09T10:41:01.360381Z"},"links":{"citing_paper":"/paper/2502.02919"},"observation_digest":"sha256:1c6c98a2618d0b011078f3d7acc9159662369388f8607faa642ba94eda154e7e","observation_id":"85715c03-046f-4f1c-a2f1-ebb7ab802e61","resolution":{"observed_at":"2026-08-09T10:41:01.815849Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:41:01.792285Z","title":null,"venue":null,"work_id":"cb19443e-adbb-4fec-8501-f6d5bec90cd6","year":2021},"citing_paper":{"arxiv_id":"2502.02919","last_updated":"2025-02-05T06:29:05Z","snapshot_observed_at":"2026-08-10T03:12:47.536782Z","submitted_at":"2025-02-05T06:29:05Z","title":"Maximizing the Position Embedding for Vision Transformers with Global Average Pooling","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-09T10:41:01.365788Z"},"links":{"citing_paper":"/paper/2502.02919"},"observation_digest":"sha256:38e939671fcd6f1828c3f0909f5c83ad7e4be3763105567d9ec70346ca99dc42","observation_id":"f91d2907-7005-45c4-af58-0edc020bdebb","resolution":{"observed_at":"2026-08-09T10:41:01.797329Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:41:01.774520Z","title":null,"venue":null,"work_id":"81fae7bf-93c5-4dbf-9610-799ffeb4428b","year":2018},"citing_paper":{"arxiv_id":"2502.02919","last_updated":"2025-02-05T06:29:05Z","snapshot_observed_at":"2026-08-10T03:12:47.536782Z","submitted_at":"2025-02-05T06:29:05Z","title":"Maximizing the Position Embedding for Vision Transformers with Global Average Pooling","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-09T10:41:01.370892Z"},"links":{"citing_paper":"/paper/2502.02919"},"observation_digest":"sha256:e69451c637b48b378603253a4b750eb0195f38b01c04d50ce9fd50c17d942d75","observation_id":"81bbc29a-c45d-4554-9e30-7dffb78d04f7","resolution":{"observed_at":"2026-08-09T10:41:01.779959Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:41:01.757259Z","title":null,"venue":null,"work_id":"a059f7b1-66e8-455c-92e4-29e48c6191be","year":2024},"citing_paper":{"arxiv_id":"2502.02919","last_updated":"2025-02-05T06:29:05Z","snapshot_observed_at":"2026-08-10T03:12:47.536782Z","submitted_at":"2025-02-05T06:29:05Z","title":"Maximizing the Position Embedding for Vision Transformers with Global Average Pooling","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-09T10:41:01.375825Z"},"links":{"citing_paper":"/paper/2502.02919"},"observation_digest":"sha256:f680e0d9b610b0d076c5f4dcbaff6bcce7cee08f1d48f4aeb5d19a67ff24ff13","observation_id":"d8969e2a-c39c-4bc5-a0a5-1f28b1d91e35","resolution":{"observed_at":"2026-08-09T10:41:01.762467Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:41:01.736135Z","title":null,"venue":null,"work_id":"3989dc54-5613-4332-b0aa-88f1718830f3","year":2023},"citing_paper":{"arxiv_id":"2502.02919","last_updated":"2025-02-05T06:29:05Z","snapshot_observed_at":"2026-08-10T03:12:47.536782Z","submitted_at":"2025-02-05T06:29:05Z","title":"Maximizing the Position Embedding for Vision Transformers with Global Average Pooling","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-09T10:41:01.380740Z"},"links":{"citing_paper":"/paper/2502.02919"},"observation_digest":"sha256:1a850487903128810ee25a91ab7e7a3e80ec58614ccdfc95b7a51cda38ddfb0c","observation_id":"ee22e8d4-7482-4705-8de2-fd414c093775","resolution":{"observed_at":"2026-08-09T10:41:01.742833Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:41:01.719322Z","title":null,"venue":null,"work_id":"a9fe0f6a-5e33-4452-9811-64d8809d0bae","year":2021},"citing_paper":{"arxiv_id":"2502.02919","last_updated":"2025-02-05T06:29:05Z","snapshot_observed_at":"2026-08-10T03:12:47.536782Z","submitted_at":"2025-02-05T06:29:05Z","title":"Maximizing the Position Embedding for Vision Transformers with Global Average Pooling","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-09T10:41:01.385331Z"},"links":{"citing_paper":"/paper/2502.02919"},"observation_digest":"sha256:07166cea7fda56d1152dec564f763785bb76306fcde2943aa896d0baf417283a","observation_id":"7903436a-3741-458a-9701-761b25010063","resolution":{"observed_at":"2026-08-09T10:41:01.724563Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:41:01.703409Z","title":"E.; Feng, J.; and Yan, S","venue":null,"work_id":"3e5ee391-2c5b-4078-a7e0-717d98913d5a","year":2021},"citing_paper":{"arxiv_id":"2502.02919","last_updated":"2025-02-05T06:29:05Z","snapshot_observed_at":"2026-08-10T03:12:47.536782Z","submitted_at":"2025-02-05T06:29:05Z","title":"Maximizing the Position Embedding for Vision Transformers with Global Average Pooling","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-09T10:41:01.390265Z"},"links":{"citing_paper":"/paper/2502.02919"},"observation_digest":"sha256:25c6ee4562d7008e65ca4e0c38a0b622e76421f0ff0783e7817f30f8a95e97e5","observation_id":"4ecedc5b-3b8d-46ea-bf31-0f6c09762449","resolution":{"observed_at":"2026-08-09T10:41:01.708349Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:41:01.687360Z","title":null,"venue":null,"work_id":"78bd2c3f-ce9b-40d3-a064-701494921516","year":2022},"citing_paper":{"arxiv_id":"2502.02919","last_updated":"2025-02-05T06:29:05Z","snapshot_observed_at":"2026-08-10T03:12:47.536782Z","submitted_at":"2025-02-05T06:29:05Z","title":"Maximizing the Position Embedding for Vision Transformers with Global Average Pooling","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-09T10:41:01.394845Z"},"links":{"citing_paper":"/paper/2502.02919"},"observation_digest":"sha256:5912c277c97feac6166649f9e67d3a569a729fa384fc4bffd45d438ee7baaf16","observation_id":"74b25d0e-f68f-4fb9-9f03-765cd1e38a1b","resolution":{"observed_at":"2026-08-09T10:41:01.692463Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:41:01.399466Z","title":"H.; et al","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.02919","last_updated":"2025-02-05T06:29:05Z","snapshot_observed_at":"2026-08-10T03:12:47.536782Z","submitted_at":"2025-02-05T06:29:05Z","title":"Maximizing the Position Embedding for Vision Transformers with Global Average Pooling","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-09T10:41:01.399466Z"},"links":{"citing_paper":"/paper/2502.02919"},"observation_digest":"sha256:72f5466fb6c1c64582d9025bf9f208b88a89f558c1f5cf0bafc28dda3de86826","observation_id":"b5f0ee3c-3f15-45f1-a2e3-e3ca2ab611fa","resolution":{"observed_at":"2026-08-09T10:41:01.399466Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:41:01.658292Z","title":null,"venue":null,"work_id":"5be83c60-ae27-47be-815e-2192aec5c526","year":2019},"citing_paper":{"arxiv_id":"2502.02919","last_updated":"2025-02-05T06:29:05Z","snapshot_observed_at":"2026-08-10T03:12:47.536782Z","submitted_at":"2025-02-05T06:29:05Z","title":"Maximizing the Position Embedding for Vision Transformers with Global Average Pooling","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-09T10:41:01.404419Z"},"links":{"citing_paper":"/paper/2502.02919"},"observation_digest":"sha256:1c14acad23c62fa39fcf2e5b8683628532b149e317cecaca64760175fc80d530","observation_id":"de705d0b-0541-444a-ac28-c90a3343f01d","resolution":{"observed_at":"2026-08-09T10:41:01.664832Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2010.04159","last_updated":"2021-03-18T03:14:26Z","snapshot_observed_at":"2026-07-06T10:02:45.105181Z","submitted_at":"2020-10-08T17:59:21Z","title":"Deformable DETR: Deformable Transformers for End-to-End Object Detection","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.04159","snapshot_observed_at":"2026-08-09T10:41:01.409443Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2502.02919","last_updated":"2025-02-05T06:29:05Z","snapshot_observed_at":"2026-08-10T03:12:47.536782Z","submitted_at":"2025-02-05T06:29:05Z","title":"Maximizing the Position Embedding for Vision Transformers with Global Average Pooling","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-09T10:41:01.409443Z"},"links":{"cited_paper":"/paper/2010.04159","citing_paper":"/paper/2502.02919"},"observation_digest":"sha256:9f229cd06df740ea10ca9d09b1a4cd1d9a7d7edb37cbc8d4beacf42b20c1f8b4","observation_id":"f502618b-00cb-4b64-a0d0-66b3b71f479f","resolution":{"observed_at":"2026-08-09T10:41:01.409443Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:41:01.414853Z","title":", \" * write output.state after.block = add.period write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.02919","last_updated":"2025-02-05T06:29:05Z","snapshot_observed_at":"2026-08-10T03:12:47.536782Z","submitted_at":"2025-02-05T06:29:05Z","title":"Maximizing the Position Embedding for Vision Transformers with Global Average Pooling","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-09T10:41:01.414853Z"},"links":{"citing_paper":"/paper/2502.02919"},"observation_digest":"sha256:db7b42d6d3d6e175a1d1c083613077501ff0f26728349dd4a5c4dc356a60b310","observation_id":"6cdc534d-677f-4fea-80a0-f0de778b9d9a","resolution":{"observed_at":"2026-08-09T10:41:01.414853Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T10:41:01.420244Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.02919","last_updated":"2025-02-05T06:29:05Z","snapshot_observed_at":"2026-08-10T03:12:47.536782Z","submitted_at":"2025-02-05T06:29:05Z","title":"Maximizing the Position Embedding for Vision Transformers with Global Average Pooling","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-09T10:41:01.420244Z"},"links":{"citing_paper":"/paper/2502.02919"},"observation_digest":"sha256:ee9d2783f99ef2b0d6ebe1a444a8621edad9cbb1a0921c3169d51d771955d2a7","observation_id":"4efd5ca3-de0c-45f2-9cb1-559c22e23405","resolution":{"observed_at":"2026-08-09T10:41:01.420244Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2502.02919","last_updated":"2025-02-05T06:29:05Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-10T03:12:47.536782Z","submitted_at":"2025-02-05T06:29:05Z","title":"Maximizing the Position Embedding for Vision Transformers with Global Average Pooling"},"reference_resolution":{"displayed":36,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":34,"verified_exact":0,"verified_fuzzy":2},"total_outbound_references":36},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 36 of 36 outbound references and 0 inbound Pith citation observations for arXiv:2502.02919."}