{"as_of":"2026-08-08T05:11:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:6b5a93f5e3e70a166a860a2593a15aa739e81df345d09a2928d421080c8f4d4c","coverage":[{"denominator":10,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":10,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T11:45:38.488796Z","state":"measured"},{"denominator":11,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":11,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-08T14:55:14.443863Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-11T18:36:09.118436Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.01519","last_updated":"2025-06-02T10:34:55Z","snapshot_observed_at":"2026-08-07T11:37:04.301585Z","submitted_at":"2025-06-02T10:34:55Z","title":"Speed-up of Vision Transformer Models by Attention-aware Token Filtering","version":1},"cited_work":{"arxiv_id":"2506.01519","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.01519","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Speed-up of vision transformer models by attention-aware token filtering","venue":null,"work_id":"7b257ee4-ae9c-4a25-85fd-83e5e76ebc9d","year":2025},"citing_paper":{"arxiv_id":"2605.05804","last_updated":"2026-05-07T07:42:03Z","snapshot_observed_at":"2026-08-02T09:05:31.834942Z","submitted_at":"2026-05-07T07:42:03Z","title":"Na-IRSTD: Enhancing Infrared Small Target Detection via Native-Resolution Feature Selection and Fusion","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-05-08T14:55:14.443863Z"},"links":{"cited_paper":"/paper/2506.01519","citing_paper":"/paper/2605.05804"},"observation_digest":"sha256:8bbc059ca9b8e749c4afeb63d1c5b3c08b60bad1310c14aba92a9c6864b2b7e9","observation_id":"c389c818-723b-4317-a021-f0ec666b7b20","resolution":{"observed_at":"2026-05-11T18:36:09.120166Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2506.01519/citation-record","integrity":"/paper/2506.01519/integrity","json":"/paper/2506.01519/citation-record.json","paper":"/paper/2506.01519"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:46:58.280344Z","title":"An image is worth 16x16 words: Transformers for image recognition at scale","venue":null,"work_id":"150ddcf9-ab41-4fa9-845f-dc0fbac1b344","year":2021},"citing_paper":{"arxiv_id":"2506.01519","last_updated":"2025-06-02T10:34:55Z","snapshot_observed_at":"2026-08-07T11:37:04.301585Z","submitted_at":"2025-06-02T10:34:55Z","title":"Speed-up of Vision Transformer Models by Attention-aware Token Filtering","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T11:45:38.325953Z"},"links":{"citing_paper":"/paper/2506.01519"},"observation_digest":"sha256:7994a237f34fcc5e72ae30f463c2effe54aa6ae541ff5038537802596314bc6c","observation_id":"1da65384-bf2b-4f70-9124-460792beeed2","resolution":{"observed_at":"2026-08-07T11:46:58.292790Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:46:58.239365Z","title":"Self- support few-shot semantic segmentation","venue":null,"work_id":"b740a65a-000c-4c91-a917-b4cd0720b35e","year":2022},"citing_paper":{"arxiv_id":"2506.01519","last_updated":"2025-06-02T10:34:55Z","snapshot_observed_at":"2026-08-07T11:37:04.301585Z","submitted_at":"2025-06-02T10:34:55Z","title":"Speed-up of Vision Transformer Models by Attention-aware Token Filtering","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T11:45:38.341532Z"},"links":{"citing_paper":"/paper/2506.01519"},"observation_digest":"sha256:913c771eded0fbfea4eeea7da96b2d1e85cb35793c9eb0f62dd20aabcd0ae5cb","observation_id":"49d7ed3d-4c1f-4c44-ae46-04ad7d014e97","resolution":{"observed_at":"2026-08-07T11:46:58.255749Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:45:38.360395Z","title":"Deep residual learning for image recognition","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2506.01519","last_updated":"2025-06-02T10:34:55Z","snapshot_observed_at":"2026-08-07T11:37:04.301585Z","submitted_at":"2025-06-02T10:34:55Z","title":"Speed-up of Vision Transformer Models by Attention-aware Token Filtering","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T11:45:38.360395Z"},"links":{"citing_paper":"/paper/2506.01519"},"observation_digest":"sha256:be4d4d3539177d77273ef8747d891b323fb067f420ba31f9125a3ace207e373e","observation_id":"ff6becbd-4ddd-4c28-9f86-c252d6282a39","resolution":{"observed_at":"2026-08-07T11:45:38.360395Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:46:58.185738Z","title":"TextOCR: Towards large- scale end-to-end reasoning for arbitrary-shaped scene text","venue":null,"work_id":"9ee51097-f006-4c7a-a259-086bf907edb9","year":null},"citing_paper":{"arxiv_id":"2506.01519","last_updated":"2025-06-02T10:34:55Z","snapshot_observed_at":"2026-08-07T11:37:04.301585Z","submitted_at":"2025-06-02T10:34:55Z","title":"Speed-up of Vision Transformer Models by Attention-aware Token Filtering","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T11:45:38.384059Z"},"links":{"citing_paper":"/paper/2506.01519"},"observation_digest":"sha256:c53a25b93db7dda78e623dcd2a14cae1a89d1468a3d4b51632f7f6e2686a2f8c","observation_id":"baf1294f-600a-4ce8-a144-ed2fefc9c090","resolution":{"observed_at":"2026-08-07T11:46:58.203522Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:46:58.154495Z","title":"Training data-efficient image transformers & distillation through at- tention","venue":null,"work_id":"82dc0da7-30cf-48fd-b5c0-b50096c90404","year":2021},"citing_paper":{"arxiv_id":"2506.01519","last_updated":"2025-06-02T10:34:55Z","snapshot_observed_at":"2026-08-07T11:37:04.301585Z","submitted_at":"2025-06-02T10:34:55Z","title":"Speed-up of Vision Transformer Models by Attention-aware Token Filtering","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T11:45:38.395129Z"},"links":{"citing_paper":"/paper/2506.01519"},"observation_digest":"sha256:39d13f0ebcd8e606b4f2ee78f41a1af55b9ed8dca572feed2010f3fe51e5ae5f","observation_id":"06bb5ac2-1afd-491b-8c9f-752d13440551","resolution":{"observed_at":"2026-08-07T11:46:58.164762Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:46:58.104776Z","title":"Attention is all you need","venue":null,"work_id":"04db7fc6-a1bf-4892-9f0c-dbdf5cf8c486","year":2017},"citing_paper":{"arxiv_id":"2506.01519","last_updated":"2025-06-02T10:34:55Z","snapshot_observed_at":"2026-08-07T11:37:04.301585Z","submitted_at":"2025-06-02T10:34:55Z","title":"Speed-up of Vision Transformer Models by Attention-aware Token Filtering","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T11:45:38.415416Z"},"links":{"citing_paper":"/paper/2506.01519"},"observation_digest":"sha256:ca949963e6fd94f083ac77e6f2432dd73509d25b00d55e324ea584d0f33e78b1","observation_id":"9ff10201-00be-4457-9df1-8b81a9bac819","resolution":{"observed_at":"2026-08-07T11:46:58.126136Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:46:58.023826Z","title":"Alvarez, Arun Mallya, Jan Kautz, and Pavlo Molchanov","venue":null,"work_id":"c711c1e2-6999-4ae9-a2e3-e0588fe10dc5","year":2022},"citing_paper":{"arxiv_id":"2506.01519","last_updated":"2025-06-02T10:34:55Z","snapshot_observed_at":"2026-08-07T11:37:04.301585Z","submitted_at":"2025-06-02T10:34:55Z","title":"Speed-up of Vision Transformer Models by Attention-aware Token Filtering","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T11:45:38.433648Z"},"links":{"citing_paper":"/paper/2506.01519"},"observation_digest":"sha256:57d3549c9beff7eca05aa5edeed2b7ce400feb078e3ca5b4fbfc587d187180b9","observation_id":"d760dc07-99a2-477a-876d-3fe6a7bf3c6e","resolution":{"observed_at":"2026-08-07T11:46:58.057829Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:46:57.946456Z","title":"Scaling vision transformers","venue":null,"work_id":"28ef76e3-0e56-4170-8b8f-71135f345632","year":2022},"citing_paper":{"arxiv_id":"2506.01519","last_updated":"2025-06-02T10:34:55Z","snapshot_observed_at":"2026-08-07T11:37:04.301585Z","submitted_at":"2025-06-02T10:34:55Z","title":"Speed-up of Vision Transformer Models by Attention-aware Token Filtering","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T11:45:38.448241Z"},"links":{"citing_paper":"/paper/2506.01519"},"observation_digest":"sha256:ce7af032adcbb77669aa766072086060a7eb6283dcc62a5cc0ecdd9d7d704f79","observation_id":"7a7cdcb0-9e6c-4548-9b6e-54f787788243","resolution":{"observed_at":"2026-08-07T11:46:57.975447Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:46:56.257629Z","title":"Sigmoid loss for language image pre-training","venue":null,"work_id":"c63d3c83-8739-4ca4-99c0-e9a5f52a772d","year":2023},"citing_paper":{"arxiv_id":"2506.01519","last_updated":"2025-06-02T10:34:55Z","snapshot_observed_at":"2026-08-07T11:37:04.301585Z","submitted_at":"2025-06-02T10:34:55Z","title":"Speed-up of Vision Transformer Models by Attention-aware Token Filtering","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T11:45:38.468493Z"},"links":{"citing_paper":"/paper/2506.01519"},"observation_digest":"sha256:a7d08a29ac5b5b85318060ea83feb66017d62d80b7d5124079433f67530f784f","observation_id":"edd70139-a132-4940-9d7a-5052c6c79b32","resolution":{"observed_at":"2026-08-07T11:46:57.913746Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:45:38.540993Z","title":"Pyramid scene parsing network","venue":null,"work_id":"f4ba9525-355f-4578-8c47-b98923ea5697","year":2017},"citing_paper":{"arxiv_id":"2506.01519","last_updated":"2025-06-02T10:34:55Z","snapshot_observed_at":"2026-08-07T11:37:04.301585Z","submitted_at":"2025-06-02T10:34:55Z","title":"Speed-up of Vision Transformer Models by Attention-aware Token Filtering","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T11:45:38.488796Z"},"links":{"citing_paper":"/paper/2506.01519"},"observation_digest":"sha256:360240bd959611b4e9f9d8875a42d30c52f9778c66267362a9da85f78b9ade04","observation_id":"8a39d86f-2b83-4a84-90c1-8b0e9bfa7931","resolution":{"observed_at":"2026-08-07T11:46:21.633062Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2506.01519","last_updated":"2025-06-02T10:34:55Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-07T11:37:04.301585Z","submitted_at":"2025-06-02T10:34:55Z","title":"Speed-up of Vision Transformer Models by Attention-aware Token Filtering"},"reference_resolution":{"displayed":10,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":1,"verified_exact":0,"verified_fuzzy":9},"total_outbound_references":10},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 10 of 10 outbound references and 1 inbound Pith citation observation for arXiv:2506.01519."}