{"as_of":"2026-08-18T23:22:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:c3671c1d94c17aff351fd810397655b5048d49e0d4187722341dcecd5520359c","coverage":[{"denominator":70,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":70,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T17:59:25.515340Z","state":"measured"},{"denominator":70,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":70,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-18T06:34:40.430872+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2507.19409/citation-record","integrity":"/paper/2507.19409/integrity","json":"/paper/2507.19409/citation-record.json","paper":"/paper/2507.19409"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:59:26.499815Z","title":"GQA: Training gener- alized multi-query transformer models from multi-head checkpoints","venue":null,"work_id":"8dcde80e-8412-443d-90ec-0e111d05f507","year":2023},"citing_paper":{"arxiv_id":"2507.19409","last_updated":"2025-07-25T16:19:47Z","snapshot_observed_at":"2026-08-18T12:17:21.005000Z","submitted_at":"2025-07-25T16:19:47Z","title":"Modality Agnostic Efficient Long Range Encoder","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-15T17:59:25.215137Z"},"links":{"citing_paper":"/paper/2507.19409"},"observation_digest":"sha256:d97ff3f7ed8947889786838f6c62eaab0171b94150d0ed2da229d5881cc02fcd","observation_id":"40c324da-9dd3-4fb6-a6e1-339eec8d53bd","resolution":{"observed_at":"2026-08-15T17:59:26.504863Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:59:26.485722Z","title":"Flamingo: a visual language model for few-shot learning","venue":null,"work_id":"c37dfe08-590b-4640-8bb2-df497842b0f4","year":2022},"citing_paper":{"arxiv_id":"2507.19409","last_updated":"2025-07-25T16:19:47Z","snapshot_observed_at":"2026-08-18T12:17:21.005000Z","submitted_at":"2025-07-25T16:19:47Z","title":"Modality Agnostic Efficient Long Range Encoder","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-15T17:59:25.220029Z"},"links":{"citing_paper":"/paper/2507.19409"},"observation_digest":"sha256:722debbdbfd93597dcdb683afda542ce4595846e98b70b636b5441b135bb69cf","observation_id":"d637edb3-9b63-4b0e-b8ee-fb77545f0f22","resolution":{"observed_at":"2026-08-15T17:59:26.490859Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2004.05150","last_updated":"2020-12-02T17:52:35Z","snapshot_observed_at":"2026-07-31T17:17:17.205582Z","submitted_at":"2020-04-10T17:54:09Z","title":"Longformer: The Long-Document Transformer","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2004.05150","snapshot_observed_at":"2026-08-15T17:59:25.224593Z","title":"Longformer: The long-document transformer","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2507.19409","last_updated":"2025-07-25T16:19:47Z","snapshot_observed_at":"2026-08-18T12:17:21.005000Z","submitted_at":"2025-07-25T16:19:47Z","title":"Modality Agnostic Efficient Long Range Encoder","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-15T17:59:25.224593Z"},"links":{"cited_paper":"/paper/2004.05150","citing_paper":"/paper/2507.19409"},"observation_digest":"sha256:75e481ab01491a28f5e91a0b16d80ec4c0df046afd46b00f5ed683ea54516cbb","observation_id":"2ebd3bc5-ce57-4ab1-a20c-71e9b69b887a","resolution":{"observed_at":"2026-08-15T17:59:25.224593Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.09461","last_updated":"2023-03-01T19:45:11Z","snapshot_observed_at":"2026-08-13T04:00:22.647615Z","submitted_at":"2022-10-17T22:23:40Z","title":"Token Merging: Your ViT But Faster","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.09461","snapshot_observed_at":"2026-08-15T17:59:25.229873Z","title":"Token merging: Your vit but faster","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.19409","last_updated":"2025-07-25T16:19:47Z","snapshot_observed_at":"2026-08-18T12:17:21.005000Z","submitted_at":"2025-07-25T16:19:47Z","title":"Modality Agnostic Efficient Long Range Encoder","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-15T17:59:25.229873Z"},"links":{"cited_paper":"/paper/2210.09461","citing_paper":"/paper/2507.19409"},"observation_digest":"sha256:257f25250d0b21c3f8c0c9fe86fa1868387fc539b78760c4a9bfe6799ec0ea87","observation_id":"98a3b113-6bca-41bf-b8dd-b33dc0e8ff24","resolution":{"observed_at":"2026-08-15T17:59:25.229873Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.11062","last_updated":"2024-02-06T10:16:54Z","snapshot_observed_at":"2026-08-18T06:13:07.728363Z","submitted_at":"2023-04-19T16:18:54Z","title":"Scaling Transformer to 1M tokens and beyond with RMT","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.11062","snapshot_observed_at":"2026-08-15T17:59:25.234525Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.19409","last_updated":"2025-07-25T16:19:47Z","snapshot_observed_at":"2026-08-18T12:17:21.005000Z","submitted_at":"2025-07-25T16:19:47Z","title":"Modality Agnostic Efficient Long Range Encoder","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-15T17:59:25.234525Z"},"links":{"cited_paper":"/paper/2304.11062","citing_paper":"/paper/2507.19409"},"observation_digest":"sha256:4b4395a212ddc30024cbd4b75a7c55297103130207fecd7c42b2a1e6dfc9a5e3","observation_id":"1383d3df-aadf-4b0f-8eb1-7afe67b8464e","resolution":{"observed_at":"2026-08-15T17:59:25.234525Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:59:26.471900Z","title":"Vggsound: A large-scale audio-visual dataset","venue":null,"work_id":"7bac10fe-cb79-406e-a2a6-5236df0cc576","year":2020},"citing_paper":{"arxiv_id":"2507.19409","last_updated":"2025-07-25T16:19:47Z","snapshot_observed_at":"2026-08-18T12:17:21.005000Z","submitted_at":"2025-07-25T16:19:47Z","title":"Modality Agnostic Efficient Long Range Encoder","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-15T17:59:25.239060Z"},"links":{"citing_paper":"/paper/2507.19409"},"observation_digest":"sha256:a58ba81a2f1097ad1049322aa73a5461f63cd38c393263f499e6d4a074fc48e1","observation_id":"e2ea8a0c-c9a0-4e14-ad68-0f5fd9b360b9","resolution":{"observed_at":"2026-08-15T17:59:26.476645Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:59:26.458157Z","title":"Classification of long sequential data using circular dilated convolutional neural networks","venue":null,"work_id":"6e28b6cb-1293-40ef-8268-0f6a7119215d","year":2023},"citing_paper":{"arxiv_id":"2507.19409","last_updated":"2025-07-25T16:19:47Z","snapshot_observed_at":"2026-08-18T12:17:21.005000Z","submitted_at":"2025-07-25T16:19:47Z","title":"Modality Agnostic Efficient Long Range Encoder","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-15T17:59:25.244652Z"},"links":{"citing_paper":"/paper/2507.19409"},"observation_digest":"sha256:ab832f25c74dbf8b32d53ae47701a5e22b0a7a4509ae6acf19b11ab2fe594dba","observation_id":"ce372dc8-eff8-473a-81cb-b13e67c1066e","resolution":{"observed_at":"2026-08-15T17:59:26.462757Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1904.10509","last_updated":"2019-04-23T19:29:47Z","snapshot_observed_at":"2026-08-16T10:03:03.268538Z","submitted_at":"2019-04-23T19:29:47Z","title":"Generating Long Sequences with Sparse Transformers","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1904.10509","snapshot_observed_at":"2026-08-15T17:59:25.248806Z","title":"Gen- erating long sequences with sparse transformers","venue":null,"work_id":null,"year":1904},"citing_paper":{"arxiv_id":"2507.19409","last_updated":"2025-07-25T16:19:47Z","snapshot_observed_at":"2026-08-18T12:17:21.005000Z","submitted_at":"2025-07-25T16:19:47Z","title":"Modality Agnostic Efficient Long Range Encoder","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-15T17:59:25.248806Z"},"links":{"cited_paper":"/paper/1904.10509","citing_paper":"/paper/2507.19409"},"observation_digest":"sha256:247c0eeb4bbcffb446179b2cec8d8a57dd00fbcfcbaeaf0cc81c492161845ef2","observation_id":"3a3eded5-c146-4be6-b11e-5a5788db84ae","resolution":{"observed_at":"2026-08-15T17:59:25.248806Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:59:26.444851Z","title":"Rethinking attention with performers","venue":null,"work_id":"7f23991f-91fb-4011-903e-3d9decb66e51","year":2021},"citing_paper":{"arxiv_id":"2507.19409","last_updated":"2025-07-25T16:19:47Z","snapshot_observed_at":"2026-08-18T12:17:21.005000Z","submitted_at":"2025-07-25T16:19:47Z","title":"Modality Agnostic Efficient Long Range Encoder","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-15T17:59:25.253515Z"},"links":{"citing_paper":"/paper/2507.19409"},"observation_digest":"sha256:7844f7964aa75683b4545e26ecc90314a2da34ebf88cf43017857eab14091d89","observation_id":"74a40dab-c92e-4313-884e-350194cfaae4","resolution":{"observed_at":"2026-08-15T17:59:26.449170Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:59:26.431153Z","title":"Ran- daugment: Practical automated data augmentation with a reduced search space","venue":null,"work_id":"9475e606-f084-47bc-9b4b-07c6eab94fab","year":2020},"citing_paper":{"arxiv_id":"2507.19409","last_updated":"2025-07-25T16:19:47Z","snapshot_observed_at":"2026-08-18T12:17:21.005000Z","submitted_at":"2025-07-25T16:19:47Z","title":"Modality Agnostic Efficient Long Range Encoder","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-15T17:59:25.258004Z"},"links":{"citing_paper":"/paper/2507.19409"},"observation_digest":"sha256:c71b76be4aef684cf5f9d07d5edec865ca311af9c92d6bd1b82651989f13f7d1","observation_id":"6fc60df1-913f-441c-ac32-a11e3238eccb","resolution":{"observed_at":"2026-08-15T17:59:26.435665Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:59:26.417706Z","title":null,"venue":null,"work_id":"0fedf8a0-94b7-4d8e-80b9-d394f7863269","year":2020},"citing_paper":{"arxiv_id":"2507.19409","last_updated":"2025-07-25T16:19:47Z","snapshot_observed_at":"2026-08-18T12:17:21.005000Z","submitted_at":"2025-07-25T16:19:47Z","title":"Modality Agnostic Efficient Long Range Encoder","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-15T17:59:25.263129Z"},"links":{"citing_paper":"/paper/2507.19409"},"observation_digest":"sha256:6557b5cb09b9cad07dde462a66b429cb39889623a8e1f9dff3d512a771a9cb5b","observation_id":"472b63c3-65ce-451d-b6bf-37fd00998efa","resolution":{"observed_at":"2026-08-15T17:59:26.422263Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:59:26.403331Z","title":"FlashAttention-2: Faster attention with better parallelism and work partitioning","venue":null,"work_id":"e49a2cd3-86b0-4d72-a810-10f1ab20e86e","year":2024},"citing_paper":{"arxiv_id":"2507.19409","last_updated":"2025-07-25T16:19:47Z","snapshot_observed_at":"2026-08-18T12:17:21.005000Z","submitted_at":"2025-07-25T16:19:47Z","title":"Modality Agnostic Efficient Long Range Encoder","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-15T17:59:25.267331Z"},"links":{"citing_paper":"/paper/2507.19409"},"observation_digest":"sha256:6319343032bf84cf5dab4cb18bc2a2655b6f5e7942647864fcd89452834bb21a","observation_id":"17a97211-7920-42c0-b8bd-8b9d13558edf","resolution":{"observed_at":"2026-08-15T17:59:26.408224Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:59:26.389823Z","title":"Fu, Stefano Ermon, Atri Rudra, and Christopher R´e","venue":null,"work_id":"c61a68f5-0b3c-4d4d-b089-a7fb523b395e","year":2022},"citing_paper":{"arxiv_id":"2507.19409","last_updated":"2025-07-25T16:19:47Z","snapshot_observed_at":"2026-08-18T12:17:21.005000Z","submitted_at":"2025-07-25T16:19:47Z","title":"Modality Agnostic Efficient Long Range Encoder","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-15T17:59:25.271441Z"},"links":{"citing_paper":"/paper/2507.19409"},"observation_digest":"sha256:cca31f2969e3c94d85954234555a58ee35a915324ea548b800965a91a73616b7","observation_id":"7f27df0e-d055-413b-b62c-5d5f15659eab","resolution":{"observed_at":"2026-08-15T17:59:26.394228Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:59:26.376165Z","title":"The ucr time series classifica- tion archive, 2019","venue":null,"work_id":"9b3728dc-77f0-4e0d-ba24-5102a3c66143","year":2019},"citing_paper":{"arxiv_id":"2507.19409","last_updated":"2025-07-25T16:19:47Z","snapshot_observed_at":"2026-08-18T12:17:21.005000Z","submitted_at":"2025-07-25T16:19:47Z","title":"Modality Agnostic Efficient Long Range Encoder","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-15T17:59:25.276528Z"},"links":{"citing_paper":"/paper/2507.19409"},"observation_digest":"sha256:1983dab51ec9232f0277a36999135b8d11093214517b2c25c645e2399fe92bac","observation_id":"1df443de-fc46-4f88-82e7-b5a1c91349ce","resolution":{"observed_at":"2026-08-15T17:59:26.380830Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.04434","last_updated":"2024-06-19T06:04:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-05-07T15:56:43Z","title":"DeepSeek-V2: A Strong, Economical, and Efficient Mixture-of-Experts Language Model","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.04434","snapshot_observed_at":"2026-08-15T17:59:25.280766Z","title":"Deepseek-v2: A strong, economical, and efficient mixture-of-experts language model","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.19409","last_updated":"2025-07-25T16:19:47Z","snapshot_observed_at":"2026-08-18T12:17:21.005000Z","submitted_at":"2025-07-25T16:19:47Z","title":"Modality Agnostic Efficient Long Range Encoder","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-15T17:59:25.280766Z"},"links":{"cited_paper":"/paper/2405.04434","citing_paper":"/paper/2507.19409"},"observation_digest":"sha256:de586ccf8483d06c1c00844630dce31c001d32b44ea4ebf6db9a8f8d0572b899","observation_id":"70b88857-625a-4ccc-a378-f427f406048f","resolution":{"observed_at":"2026-08-15T17:59:25.280766Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:59:26.362628Z","title":"Imagenet: A large-scale hierarchical image database","venue":null,"work_id":"077857e2-c59e-4603-bff7-7e74cbf27d06","year":2009},"citing_paper":{"arxiv_id":"2507.19409","last_updated":"2025-07-25T16:19:47Z","snapshot_observed_at":"2026-08-18T12:17:21.005000Z","submitted_at":"2025-07-25T16:19:47Z","title":"Modality Agnostic Efficient Long Range Encoder","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-15T17:59:25.285702Z"},"links":{"citing_paper":"/paper/2507.19409"},"observation_digest":"sha256:3e6467a52e4da4aa4b1678631c9500d7e2d11c0b55c2a35a118b2704d8cfa2f0","observation_id":"9812f137-9952-4b9d-b4cb-9ff28c92b788","resolution":{"observed_at":"2026-08-15T17:59:26.367324Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:59:26.348745Z","title":"fvcore: A collection of core libraries for com- puter vision","venue":null,"work_id":"3095468e-84d8-4eb5-84d6-26009d32f914","year":2019},"citing_paper":{"arxiv_id":"2507.19409","last_updated":"2025-07-25T16:19:47Z","snapshot_observed_at":"2026-08-18T12:17:21.005000Z","submitted_at":"2025-07-25T16:19:47Z","title":"Modality Agnostic Efficient Long Range Encoder","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-15T17:59:25.290213Z"},"links":{"citing_paper":"/paper/2507.19409"},"observation_digest":"sha256:8fe935ed744c6205809ebf8ec9fe8a89552c32e0dc1973ec6bdfa7fc2a3e7391","observation_id":"a36df706-28d2-411a-9e10-fe7894b98148","resolution":{"observed_at":"2026-08-15T17:59:26.353386Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:59:26.335638Z","title":"Multiscale vision transformers","venue":null,"work_id":"c3d3e417-1278-45f2-a246-2d9e8743e06a","year":2021},"citing_paper":{"arxiv_id":"2507.19409","last_updated":"2025-07-25T16:19:47Z","snapshot_observed_at":"2026-08-18T12:17:21.005000Z","submitted_at":"2025-07-25T16:19:47Z","title":"Modality Agnostic Efficient Long Range Encoder","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-15T17:59:25.294296Z"},"links":{"citing_paper":"/paper/2507.19409"},"observation_digest":"sha256:4fd3b73371abe20dfc4d147b05a2cf3dfe5c657c18c8f36ca73fe9434b2b99b1","observation_id":"e9652e75-ee4d-4152-9a9b-e8763c39efae","resolution":{"observed_at":"2026-08-15T17:59:26.339847Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.14052","last_updated":"2023-04-29T03:18:40Z","snapshot_observed_at":"2026-08-18T19:17:21.619873Z","submitted_at":"2022-12-28T17:56:03Z","title":"Hungry Hungry Hippos: Towards Language Modeling with State Space Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.14052","snapshot_observed_at":"2026-08-15T17:59:25.298833Z","title":"Fu, Tri Dao, Khaled K","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.19409","last_updated":"2025-07-25T16:19:47Z","snapshot_observed_at":"2026-08-18T12:17:21.005000Z","submitted_at":"2025-07-25T16:19:47Z","title":"Modality Agnostic Efficient Long Range Encoder","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-15T17:59:25.298833Z"},"links":{"cited_paper":"/paper/2212.14052","citing_paper":"/paper/2507.19409"},"observation_digest":"sha256:52ab17b626857e00cc725e218638fb50ed8ace7aeba0691acf424ae35c1ac6cd","observation_id":"2b5b81ca-432e-4d31-b44e-3f67d8965325","resolution":{"observed_at":"2026-08-15T17:59:25.298833Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.14767","last_updated":"2023-10-13T19:01:20Z","snapshot_observed_at":"2026-08-16T15:37:00.428813Z","submitted_at":"2023-04-28T11:26:17Z","title":"Dissecting Recall of Factual Associations in Auto-Regressive Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.14767","snapshot_observed_at":"2026-08-15T17:59:25.303243Z","title":"Dissecting recall of factual associations in auto-regressive language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.19409","last_updated":"2025-07-25T16:19:47Z","snapshot_observed_at":"2026-08-18T12:17:21.005000Z","submitted_at":"2025-07-25T16:19:47Z","title":"Modality Agnostic Efficient Long Range Encoder","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-15T17:59:25.303243Z"},"links":{"cited_paper":"/paper/2304.14767","citing_paper":"/paper/2507.19409"},"observation_digest":"sha256:adfa5e8deb32832a8b21433d09c559e76849625537885e8c62a324aa9287a96f","observation_id":"76069de1-ba93-41d0-8855-dc3cca94f696","resolution":{"observed_at":"2026-08-15T17:59:25.303243Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:59:26.322750Z","title":"Liu, David Har- wath, Leonid Karlinsky, Hilde Kuehne, and James R","venue":null,"work_id":"476bd8ce-52c8-40e1-954d-f1b40adf9f52","year":2023},"citing_paper":{"arxiv_id":"2507.19409","last_updated":"2025-07-25T16:19:47Z","snapshot_observed_at":"2026-08-18T12:17:21.005000Z","submitted_at":"2025-07-25T16:19:47Z","title":"Modality Agnostic Efficient Long Range Encoder","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-15T17:59:25.307614Z"},"links":{"citing_paper":"/paper/2507.19409"},"observation_digest":"sha256:14b87a05b721865733d88fecb8f438cabf7894265ac08b9e5942c19596bd0912","observation_id":"6a1df863-2b17-47de-9a55-b342cc01a06b","resolution":{"observed_at":"2026-08-15T17:59:26.326851Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:59:26.309068Z","title":"Choudhury, Saurabh M","venue":null,"work_id":"833e51c4-2b02-4352-8f3a-bf0168a75442","year":2020},"citing_paper":{"arxiv_id":"2507.19409","last_updated":"2025-07-25T16:19:47Z","snapshot_observed_at":"2026-08-18T12:17:21.005000Z","submitted_at":"2025-07-25T16:19:47Z","title":"Modality Agnostic Efficient Long Range Encoder","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-15T17:59:25.311632Z"},"links":{"citing_paper":"/paper/2507.19409"},"observation_digest":"sha256:6d4d79e4096553181b0c633d52bfe6d531827a61ce1042717d996ab575e58b8f","observation_id":"832d6e1b-4a4b-44ba-9953-49dd3ec803f7","resolution":{"observed_at":"2026-08-15T17:59:26.313722Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:59:26.296111Z","title":"Levit: a vision transformer in convnet’s clothing for faster inference","venue":null,"work_id":"5fac329a-65bc-449e-bf82-7f91abd2f7a1","year":2021},"citing_paper":{"arxiv_id":"2507.19409","last_updated":"2025-07-25T16:19:47Z","snapshot_observed_at":"2026-08-18T12:17:21.005000Z","submitted_at":"2025-07-25T16:19:47Z","title":"Modality Agnostic Efficient Long Range Encoder","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-15T17:59:25.315688Z"},"links":{"citing_paper":"/paper/2507.19409"},"observation_digest":"sha256:1b49114ac53c4be0b0756090d5ca1901a112347babf9a2876b6716e34ff93eca","observation_id":"eca2bdb5-abcb-42e0-b621-7cea2e99dad0","resolution":{"observed_at":"2026-08-15T17:59:26.300518Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.00752","last_updated":"2024-05-31T17:55:27Z","snapshot_observed_at":"2026-08-17T20:47:46.242385Z","submitted_at":"2023-12-01T18:01:34Z","title":"Mamba: Linear-Time Sequence Modeling with Selective State Spaces","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.00752","snapshot_observed_at":"2026-08-15T17:59:25.319687Z","title":"Mamba: Linear-time sequence modeling with selective state spaces","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.19409","last_updated":"2025-07-25T16:19:47Z","snapshot_observed_at":"2026-08-18T12:17:21.005000Z","submitted_at":"2025-07-25T16:19:47Z","title":"Modality Agnostic Efficient Long Range Encoder","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-15T17:59:25.319687Z"},"links":{"cited_paper":"/paper/2312.00752","citing_paper":"/paper/2507.19409"},"observation_digest":"sha256:e2de0cb179c2ced8620ead0ee822a03187f8cb142cf85b24ca100ba975a722be","observation_id":"3598c43a-b2cc-4556-a459-144cd849f4f0","resolution":{"observed_at":"2026-08-15T17:59:25.319687Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:59:26.282829Z","title":"Longt5: Efficient text-to-text transformer for long sequences","venue":null,"work_id":"f80a9b26-98a8-485f-9d43-f108fcda962c","year":2022},"citing_paper":{"arxiv_id":"2507.19409","last_updated":"2025-07-25T16:19:47Z","snapshot_observed_at":"2026-08-18T12:17:21.005000Z","submitted_at":"2025-07-25T16:19:47Z","title":"Modality Agnostic Efficient Long Range Encoder","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-15T17:59:25.323970Z"},"links":{"citing_paper":"/paper/2507.19409"},"observation_digest":"sha256:4010c9dd82fe92660ccc42bca079ef09686b00ed49083798854a25e61d74081c","observation_id":"f192dcbc-ca27-40f6-8fa0-9b4667330089","resolution":{"observed_at":"2026-08-15T17:59:26.287274Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:59:26.268990Z","title":"Flatten transformer: Vision transformer using focused linear atten- tion","venue":null,"work_id":"28b82441-51cd-4525-941d-317877893400","year":2023},"citing_paper":{"arxiv_id":"2507.19409","last_updated":"2025-07-25T16:19:47Z","snapshot_observed_at":"2026-08-18T12:17:21.005000Z","submitted_at":"2025-07-25T16:19:47Z","title":"Modality Agnostic Efficient Long Range Encoder","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-15T17:59:25.327908Z"},"links":{"citing_paper":"/paper/2507.19409"},"observation_digest":"sha256:397f21b46d94b3e6ff9d9dde8b30ff829360d81d06f019226c5fd5690fa818a9","observation_id":"b4763ef0-e95b-4a4e-b44d-067276310a14","resolution":{"observed_at":"2026-08-15T17:59:26.273407Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:59:26.256166Z","title":"Masked autoencoders are scalable vision learn- ers","venue":null,"work_id":"d762582d-ab8d-46e5-8f31-2df636828b49","year":2022},"citing_paper":{"arxiv_id":"2507.19409","last_updated":"2025-07-25T16:19:47Z","snapshot_observed_at":"2026-08-18T12:17:21.005000Z","submitted_at":"2025-07-25T16:19:47Z","title":"Modality Agnostic Efficient Long Range Encoder","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-15T17:59:25.332340Z"},"links":{"citing_paper":"/paper/2507.19409"},"observation_digest":"sha256:7162b5aaf6fd7e827264a4d3832d9ca04a69f33b33fe89eadf978c9db5956187","observation_id":"6709e51d-7c88-4e42-be09-80c2fc9eafba","resolution":{"observed_at":"2026-08-15T17:59:26.260553Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:59:26.243124Z","title":"Rethinking spatial dimensions of vision transformers","venue":null,"work_id":"399579fd-1bb0-4662-8775-771d9e7f7ab5","year":2021},"citing_paper":{"arxiv_id":"2507.19409","last_updated":"2025-07-25T16:19:47Z","snapshot_observed_at":"2026-08-18T12:17:21.005000Z","submitted_at":"2025-07-25T16:19:47Z","title":"Modality Agnostic Efficient Long Range Encoder","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-15T17:59:25.336473Z"},"links":{"citing_paper":"/paper/2507.19409"},"observation_digest":"sha256:cff95e06608978fd9d160d0623e9fff6eaa9fca79ecb2e8170a3040e10858e95","observation_id":"f215666b-23e2-43db-b069-4e43ac9dcf0f","resolution":{"observed_at":"2026-08-15T17:59:26.247518Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:59:26.228609Z","title":null,"venue":null,"work_id":"8b1a8f7e-346d-4dc1-9239-d3874bce933b","year":2008},"citing_paper":{"arxiv_id":"2507.19409","last_updated":"2025-07-25T16:19:47Z","snapshot_observed_at":"2026-08-18T12:17:21.005000Z","submitted_at":"2025-07-25T16:19:47Z","title":"Modality Agnostic Efficient Long Range Encoder","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-15T17:59:25.340570Z"},"links":{"citing_paper":"/paper/2507.19409"},"observation_digest":"sha256:0ca183a4502ad857bf77f83ea6b8b5293f825e313b4acb09784a1d3706716c2c","observation_id":"a773974a-63ca-4161-be25-957645d5e75d","resolution":{"observed_at":"2026-08-15T17:59:26.233896Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:59:26.214842Z","title":"Deep networks with stochastic depth","venue":null,"work_id":"59461bee-00dc-4e15-82f2-8b62840b4569","year":2016},"citing_paper":{"arxiv_id":"2507.19409","last_updated":"2025-07-25T16:19:47Z","snapshot_observed_at":"2026-08-18T12:17:21.005000Z","submitted_at":"2025-07-25T16:19:47Z","title":"Modality Agnostic Efficient Long Range Encoder","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-15T17:59:25.344819Z"},"links":{"citing_paper":"/paper/2507.19409"},"observation_digest":"sha256:976808182cd291d66e5cc67375689742839897f7ebc1053cdf55c47d246a6d75","observation_id":"38e4425a-a289-466f-888a-9a71f47c3090","resolution":{"observed_at":"2026-08-15T17:59:26.219846Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:59:26.200683Z","title":"Transformers: State-of-the-art machine learning for pytorch, tensorflow, and jax","venue":null,"work_id":"41ee3567-d415-4c94-8907-da678287315e","year":2023},"citing_paper":{"arxiv_id":"2507.19409","last_updated":"2025-07-25T16:19:47Z","snapshot_observed_at":"2026-08-18T12:17:21.005000Z","submitted_at":"2025-07-25T16:19:47Z","title":"Modality Agnostic Efficient Long Range Encoder","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-15T17:59:25.348878Z"},"links":{"citing_paper":"/paper/2507.19409"},"observation_digest":"sha256:d9636197a9eea5e29a571d3a65a18d642804e1b015e8f79b2efe474c60ef4d23","observation_id":"b35ca5c3-3979-435c-8e28-49b8e3f78cfc","resolution":{"observed_at":"2026-08-15T17:59:26.205532Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:59:26.186643Z","title":"An empirical survey of data augmentation for time series classification with neural networks","venue":null,"work_id":"5bd8cbec-802e-4ae1-bb6b-dc22e946bb0e","year":2021},"citing_paper":{"arxiv_id":"2507.19409","last_updated":"2025-07-25T16:19:47Z","snapshot_observed_at":"2026-08-18T12:17:21.005000Z","submitted_at":"2025-07-25T16:19:47Z","title":"Modality Agnostic Efficient Long Range Encoder","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-15T17:59:25.352830Z"},"links":{"citing_paper":"/paper/2507.19409"},"observation_digest":"sha256:e765aaa4ce411cb43919ade7f79e88e4bd76fe8620dc0943730fce7987f02a94","observation_id":"a8d10155-e7e8-4edf-b305-c51f4b269ddc","resolution":{"observed_at":"2026-08-15T17:59:26.191554Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:59:26.173214Z","title":"Katharopoulos, A","venue":null,"work_id":"7106be14-9327-4aec-b75b-9f469b2a1b81","year":2020},"citing_paper":{"arxiv_id":"2507.19409","last_updated":"2025-07-25T16:19:47Z","snapshot_observed_at":"2026-08-18T12:17:21.005000Z","submitted_at":"2025-07-25T16:19:47Z","title":"Modality Agnostic Efficient Long Range Encoder","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-15T17:59:25.357165Z"},"links":{"citing_paper":"/paper/2507.19409"},"observation_digest":"sha256:633e55e7e7392fd76f47f8b9f4b29248ad528f5d72cb0095892bc68e36752b2f","observation_id":"2e913e1d-44f5-4c50-98d0-0ec554898e92","resolution":{"observed_at":"2026-08-15T17:59:26.177627Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:59:26.159963Z","title":"Reformer: The efficient transformer","venue":null,"work_id":"051634d7-aa44-4b28-9441-b509c61bcb2a","year":2020},"citing_paper":{"arxiv_id":"2507.19409","last_updated":"2025-07-25T16:19:47Z","snapshot_observed_at":"2026-08-18T12:17:21.005000Z","submitted_at":"2025-07-25T16:19:47Z","title":"Modality Agnostic Efficient Long Range Encoder","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-15T17:59:25.361347Z"},"links":{"citing_paper":"/paper/2507.19409"},"observation_digest":"sha256:a191ce5efda602366aeecdfda252b8cbe896a4b1d81573bc6af04c80d9ed44e1","observation_id":"09c1b765-c89c-42dc-8aba-31811d20d31c","resolution":{"observed_at":"2026-08-15T17:59:26.164371Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:59:26.146092Z","title":"Sequence parallelism: Long sequence training from sys- tem perspective","venue":null,"work_id":"371e00db-ca7a-4d65-bfd8-41716e534fc3","year":2023},"citing_paper":{"arxiv_id":"2507.19409","last_updated":"2025-07-25T16:19:47Z","snapshot_observed_at":"2026-08-18T12:17:21.005000Z","submitted_at":"2025-07-25T16:19:47Z","title":"Modality Agnostic Efficient Long Range Encoder","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-15T17:59:25.365969Z"},"links":{"citing_paper":"/paper/2507.19409"},"observation_digest":"sha256:64e1aea76c865940f362f9d347b6f55a33d1c36f30d66ed646729ff02282a4c5","observation_id":"f2a17ed6-74b4-4c32-97ab-2dc84f820da3","resolution":{"observed_at":"2026-08-15T17:59:26.151210Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:59:26.132325Z","title":"Mvitv2: Im- proved multiscale vision transformers for classification and detec- tion","venue":null,"work_id":"068f3eb3-87f0-46a2-9d10-ecf683b7b1d4","year":2022},"citing_paper":{"arxiv_id":"2507.19409","last_updated":"2025-07-25T16:19:47Z","snapshot_observed_at":"2026-08-18T12:17:21.005000Z","submitted_at":"2025-07-25T16:19:47Z","title":"Modality Agnostic Efficient Long Range Encoder","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-15T17:59:25.370122Z"},"links":{"citing_paper":"/paper/2507.19409"},"observation_digest":"sha256:8711cda510b993750737fe38724359bc01b7d08af0aa17217716be79f1994b38","observation_id":"8b3e01ac-e52f-415a-a6f3-2454d57caa58","resolution":{"observed_at":"2026-08-15T17:59:26.137162Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:59:26.119677Z","title":"Efficientformer: Vi- sion transformers at mobilenet speed","venue":null,"work_id":"46690385-87ea-4836-9ccf-4665a790c786","year":2022},"citing_paper":{"arxiv_id":"2507.19409","last_updated":"2025-07-25T16:19:47Z","snapshot_observed_at":"2026-08-18T12:17:21.005000Z","submitted_at":"2025-07-25T16:19:47Z","title":"Modality Agnostic Efficient Long Range Encoder","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-15T17:59:25.374058Z"},"links":{"citing_paper":"/paper/2507.19409"},"observation_digest":"sha256:bb36d55ea76e4f1af0d2a533021e3c0b2d008008db50255c9d02ff457b7fe1e2","observation_id":"bb17e37d-ac4b-43f8-8176-fa7524e45327","resolution":{"observed_at":"2026-08-15T17:59:26.123873Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.01889","last_updated":"2023-11-27T06:38:47Z","snapshot_observed_at":"2026-08-14T10:14:18.862721Z","submitted_at":"2023-10-03T08:44:50Z","title":"Ring Attention with Blockwise Transformers for Near-Infinite Context","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.01889","snapshot_observed_at":"2026-08-15T17:59:25.378070Z","title":"Ring attention with blockwise transformers for near-infinite context","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.19409","last_updated":"2025-07-25T16:19:47Z","snapshot_observed_at":"2026-08-18T12:17:21.005000Z","submitted_at":"2025-07-25T16:19:47Z","title":"Modality Agnostic Efficient Long Range Encoder","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-15T17:59:25.378070Z"},"links":{"cited_paper":"/paper/2310.01889","citing_paper":"/paper/2507.19409"},"observation_digest":"sha256:a93d5a0378c629079bd4d8600ad852543ac2981ca837249f39f0ced7504b268a","observation_id":"f6ee13b4-36fc-43fa-b932-88a4db6f26c0","resolution":{"observed_at":"2026-08-15T17:59:25.378070Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1907.11692","last_updated":"2019-07-26T17:48:29Z","snapshot_observed_at":"2026-08-16T14:33:50.657682Z","submitted_at":"2019-07-26T17:48:29Z","title":"RoBERTa: A Robustly Optimized BERT Pretraining Approach","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1907.11692","snapshot_observed_at":"2026-08-15T17:59:25.382444Z","title":"Roberta: A robustly optimized bert pretraining approach","venue":null,"work_id":null,"year":1907},"citing_paper":{"arxiv_id":"2507.19409","last_updated":"2025-07-25T16:19:47Z","snapshot_observed_at":"2026-08-18T12:17:21.005000Z","submitted_at":"2025-07-25T16:19:47Z","title":"Modality Agnostic Efficient Long Range Encoder","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-15T17:59:25.382444Z"},"links":{"cited_paper":"/paper/1907.11692","citing_paper":"/paper/2507.19409"},"observation_digest":"sha256:33645fe95af335587739a577f6c3b0e0baa41c6de2f4df3f135b32dcfc9fd9f8","observation_id":"7b8adc2b-ecdf-4c52-8683-59e0fadc48ae","resolution":{"observed_at":"2026-08-15T17:59:25.382444Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:59:26.106895Z","title":"Swin transformer: Hierarchical vision transformer using shifted windows","venue":null,"work_id":"2646573c-de02-4e1a-ae15-9e1821dca06d","year":2021},"citing_paper":{"arxiv_id":"2507.19409","last_updated":"2025-07-25T16:19:47Z","snapshot_observed_at":"2026-08-18T12:17:21.005000Z","submitted_at":"2025-07-25T16:19:47Z","title":"Modality Agnostic Efficient Long Range Encoder","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-15T17:59:25.386674Z"},"links":{"citing_paper":"/paper/2507.19409"},"observation_digest":"sha256:b87252ab4c0d08a05b07bdf32cea6e895bf16b6207581701b28999f2e83ea1c0","observation_id":"918ca2aa-219e-424f-8732-02491fe6a18d","resolution":{"observed_at":"2026-08-15T17:59:26.111004Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:59:26.093198Z","title":"Sgdr: Stochastic gradient descent with warm restarts","venue":null,"work_id":"4a132273-e124-47ac-8c01-adb3c5bef4d7","year":2017},"citing_paper":{"arxiv_id":"2507.19409","last_updated":"2025-07-25T16:19:47Z","snapshot_observed_at":"2026-08-18T12:17:21.005000Z","submitted_at":"2025-07-25T16:19:47Z","title":"Modality Agnostic Efficient Long Range Encoder","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-15T17:59:25.390792Z"},"links":{"citing_paper":"/paper/2507.19409"},"observation_digest":"sha256:7656ef231a846f42436033bd83b8c72cbaefe4492eb0160442e98c08a6332ce9","observation_id":"23d30d51-e82c-401f-9cf4-4f67d03a0e5d","resolution":{"observed_at":"2026-08-15T17:59:26.097838Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:59:26.078857Z","title":"Decoupled weight decay regular- ization","venue":null,"work_id":"58e60a81-f0a7-4913-87ed-29798eeda1f8","year":null},"citing_paper":{"arxiv_id":"2507.19409","last_updated":"2025-07-25T16:19:47Z","snapshot_observed_at":"2026-08-18T12:17:21.005000Z","submitted_at":"2025-07-25T16:19:47Z","title":"Modality Agnostic Efficient Long Range Encoder","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-15T17:59:25.394907Z"},"links":{"citing_paper":"/paper/2507.19409"},"observation_digest":"sha256:70b14dface536d489fb4e7971ffda864b6844d46331c6acca30270b1c74d0927","observation_id":"afaefcc2-3ff1-45a9-85a1-e3a223656ba1","resolution":{"observed_at":"2026-08-15T17:59:26.083666Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:59:26.064544Z","title":"Token pooling in vi- sion transformers for image classification","venue":null,"work_id":"5ca04c0c-cc17-42f1-ba4d-5b970d87f544","year":2023},"citing_paper":{"arxiv_id":"2507.19409","last_updated":"2025-07-25T16:19:47Z","snapshot_observed_at":"2026-08-18T12:17:21.005000Z","submitted_at":"2025-07-25T16:19:47Z","title":"Modality Agnostic Efficient Long Range Encoder","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-15T17:59:25.399303Z"},"links":{"citing_paper":"/paper/2507.19409"},"observation_digest":"sha256:dec96462d49e5c71ec7daf7b419b7f080bec11b547204e32c66fa941433795b7","observation_id":"d6781f67-41c5-4bf6-b199-d4e5fac58704","resolution":{"observed_at":"2026-08-15T17:59:26.069938Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:59:26.051506Z","title":"Lo- cating and editing factual associations in gpt","venue":null,"work_id":"362762ef-da59-4959-95a3-a1cfd1ea0703","year":null},"citing_paper":{"arxiv_id":"2507.19409","last_updated":"2025-07-25T16:19:47Z","snapshot_observed_at":"2026-08-18T12:17:21.005000Z","submitted_at":"2025-07-25T16:19:47Z","title":"Modality Agnostic Efficient Long Range Encoder","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-15T17:59:25.403328Z"},"links":{"citing_paper":"/paper/2507.19409"},"observation_digest":"sha256:6832aeab03802e36326f09172675e4503d5f3822f2480dfab28e5950d1a077a8","observation_id":"ded4bb0b-b8c5-43c3-ad37-3e8c7564c964","resolution":{"observed_at":"2026-08-15T17:59:26.055908Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:59:26.038486Z","title":"Scalable vision transformers with hierarchical pooling","venue":null,"work_id":"696958c3-d505-4c88-8b20-0c801a30eed8","year":2021},"citing_paper":{"arxiv_id":"2507.19409","last_updated":"2025-07-25T16:19:47Z","snapshot_observed_at":"2026-08-18T12:17:21.005000Z","submitted_at":"2025-07-25T16:19:47Z","title":"Modality Agnostic Efficient Long Range Encoder","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-15T17:59:25.407321Z"},"links":{"citing_paper":"/paper/2507.19409"},"observation_digest":"sha256:4b71ada553f63e67b53c79c16ed10af2fc31e21b3237dcd31a1485fa00b15d87","observation_id":"de3fd62f-775f-42dc-bcbe-5e061e48957c","resolution":{"observed_at":"2026-08-15T17:59:26.042794Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:59:26.024386Z","title":"Investigating efficiently ex- tending transformers for long input summarization","venue":null,"work_id":"f681cb2b-2525-4e90-b4c4-50bd3b3ff714","year":2023},"citing_paper":{"arxiv_id":"2507.19409","last_updated":"2025-07-25T16:19:47Z","snapshot_observed_at":"2026-08-18T12:17:21.005000Z","submitted_at":"2025-07-25T16:19:47Z","title":"Modality Agnostic Efficient Long Range Encoder","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-15T17:59:25.411439Z"},"links":{"citing_paper":"/paper/2507.19409"},"observation_digest":"sha256:5641b72022c9adcfd83a3f645e6971c08aaa0147b2574130459ce2b50b3efa95","observation_id":"e5223b9e-3647-40da-982b-cb780d597be6","resolution":{"observed_at":"2026-08-15T17:59:26.029374Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2112.05682","last_updated":"2022-10-10T16:36:47Z","snapshot_observed_at":"2026-08-18T08:33:42.893303Z","submitted_at":"2021-12-10T17:25:07Z","title":"Self-attention Does Not Need $O(n^2)$ Memory","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2112.05682","snapshot_observed_at":"2026-08-15T17:59:25.415528Z","title":"Rabe and Charles Staats","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.19409","last_updated":"2025-07-25T16:19:47Z","snapshot_observed_at":"2026-08-18T12:17:21.005000Z","submitted_at":"2025-07-25T16:19:47Z","title":"Modality Agnostic Efficient Long Range Encoder","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-15T17:59:25.415528Z"},"links":{"cited_paper":"/paper/2112.05682","citing_paper":"/paper/2507.19409"},"observation_digest":"sha256:1e469d4c2eaf5195c364d3878828b673d9a6054def39afbf1f2882340e820bb3","observation_id":"43ac81ea-8578-4a32-91fe-38ac259db8fc","resolution":{"observed_at":"2026-08-15T17:59:25.415528Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2103.00020","last_updated":"2021-02-26T19:04:58Z","snapshot_observed_at":"2026-07-06T10:45:03.059688Z","submitted_at":"2021-02-26T19:04:58Z","title":"Learning Transferable Visual Models From Natural Language Supervision","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2103.00020","snapshot_observed_at":"2026-08-15T17:59:25.419888Z","title":"Learning transferable visual models from natural language supervi- sion","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.19409","last_updated":"2025-07-25T16:19:47Z","snapshot_observed_at":"2026-08-18T12:17:21.005000Z","submitted_at":"2025-07-25T16:19:47Z","title":"Modality Agnostic Efficient Long Range Encoder","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-15T17:59:25.419888Z"},"links":{"cited_paper":"/paper/2103.00020","citing_paper":"/paper/2507.19409"},"observation_digest":"sha256:328bdf8129a983f3d660597497e8ae0a5c7698af45a8b8712c7e25065a12b663","observation_id":"ea68c8ca-08bd-443e-9ac4-bcea0df233a0","resolution":{"observed_at":"2026-08-15T17:59:25.419888Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1911.02150","last_updated":"2019-11-06T00:19:05Z","snapshot_observed_at":"2026-07-06T08:35:01.386074Z","submitted_at":"2019-11-06T00:19:05Z","title":"Fast Transformer Decoding: One Write-Head is All You Need","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1911.02150","snapshot_observed_at":"2026-08-15T17:59:25.424102Z","title":"Fast transformer decoding: One write-head is all you need","venue":null,"work_id":null,"year":1911},"citing_paper":{"arxiv_id":"2507.19409","last_updated":"2025-07-25T16:19:47Z","snapshot_observed_at":"2026-08-18T12:17:21.005000Z","submitted_at":"2025-07-25T16:19:47Z","title":"Modality Agnostic Efficient Long Range Encoder","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-15T17:59:25.424102Z"},"links":{"cited_paper":"/paper/1911.02150","citing_paper":"/paper/2507.19409"},"observation_digest":"sha256:aad6d6bd919f24f838eb20add84471278754438ac6d72fb8faeb1fa089f71126","observation_id":"cf490f3b-ba2d-4c84-bc08-b07d41e60581","resolution":{"observed_at":"2026-08-15T17:59:25.424102Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:59:26.011047Z","title":"Dropout: A simple way to prevent neural networks from overfitting","venue":null,"work_id":"c4dcbe9d-7c75-49f0-97de-61047c7a94b9","year":1929},"citing_paper":{"arxiv_id":"2507.19409","last_updated":"2025-07-25T16:19:47Z","snapshot_observed_at":"2026-08-18T12:17:21.005000Z","submitted_at":"2025-07-25T16:19:47Z","title":"Modality Agnostic Efficient Long Range Encoder","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-15T17:59:25.428525Z"},"links":{"citing_paper":"/paper/2507.19409"},"observation_digest":"sha256:d2abd88723b7dadf8ea69b63249d008b4cc4c4ca4e7dbf94edd62f062c696dbf","observation_id":"8e568b0c-f1df-468c-a9e3-1b02f0a5ae8c","resolution":{"observed_at":"2026-08-15T17:59:26.015343Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.13739","last_updated":"2024-07-18T17:46:02Z","snapshot_observed_at":"2026-08-16T13:32:57.459072Z","submitted_at":"2024-07-18T17:46:02Z","title":"Scaling Granite Code Models to 128K Context","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.13739","snapshot_observed_at":"2026-08-15T17:59:25.433055Z","title":"Cox, Ruchir Puri, and Rameswar Panda","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.19409","last_updated":"2025-07-25T16:19:47Z","snapshot_observed_at":"2026-08-18T12:17:21.005000Z","submitted_at":"2025-07-25T16:19:47Z","title":"Modality Agnostic Efficient Long Range Encoder","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-15T17:59:25.433055Z"},"links":{"cited_paper":"/paper/2407.13739","citing_paper":"/paper/2507.19409"},"observation_digest":"sha256:a849b1161687ff5c84463fcbf243d1f6c6f1a854468d883479103eee9e90dda2","observation_id":"d6b1d789-7f89-4778-bc55-3f9a920933e9","resolution":{"observed_at":"2026-08-15T17:59:25.433055Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:59:25.997670Z","title":"Rethinking the inception architecture for computer vision","venue":null,"work_id":"bba9af7f-55dc-4b8e-808b-151c12ed4a9b","year":2016},"citing_paper":{"arxiv_id":"2507.19409","last_updated":"2025-07-25T16:19:47Z","snapshot_observed_at":"2026-08-18T12:17:21.005000Z","submitted_at":"2025-07-25T16:19:47Z","title":"Modality Agnostic Efficient Long Range Encoder","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-15T17:59:25.438136Z"},"links":{"citing_paper":"/paper/2507.19409"},"observation_digest":"sha256:87d90dae66f3c93b9a6444f794482c15bfba48f5bce7c11dd30767bb0be1517c","observation_id":"8b34aa8f-5245-4abd-bf37-e9ac6d438833","resolution":{"observed_at":"2026-08-15T17:59:26.002442Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:59:25.984518Z","title":"Sparse sinkhorn attention","venue":null,"work_id":"9762e5b3-0b29-4ed6-908e-8563f65acf5a","year":2020},"citing_paper":{"arxiv_id":"2507.19409","last_updated":"2025-07-25T16:19:47Z","snapshot_observed_at":"2026-08-18T12:17:21.005000Z","submitted_at":"2025-07-25T16:19:47Z","title":"Modality Agnostic Efficient Long Range Encoder","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-15T17:59:25.442255Z"},"links":{"citing_paper":"/paper/2507.19409"},"observation_digest":"sha256:05eb111dc697a956254bc3b2d139c4903e49f8010ee8bf4e542e893fd6a1e1ee","observation_id":"27c25218-4a4c-4e58-b892-c55857594733","resolution":{"observed_at":"2026-08-15T17:59:25.988808Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:59:25.971461Z","title":"Long range arena: A benchmark for efficient transformers","venue":null,"work_id":"eb1c7ca7-16a0-4b6b-8b8e-90536641d6a4","year":2021},"citing_paper":{"arxiv_id":"2507.19409","last_updated":"2025-07-25T16:19:47Z","snapshot_observed_at":"2026-08-18T12:17:21.005000Z","submitted_at":"2025-07-25T16:19:47Z","title":"Modality Agnostic Efficient Long Range Encoder","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-15T17:59:25.446268Z"},"links":{"citing_paper":"/paper/2507.19409"},"observation_digest":"sha256:049fab62a0eeee1c8d1e9959ee3a1d1231534c281d4420e73c8675dba6ecf9a3","observation_id":"c568d9a2-a81d-4380-97b2-11a0af045455","resolution":{"observed_at":"2026-08-15T17:59:25.975646Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:59:25.957888Z","title":"Atten- tion is all you need","venue":null,"work_id":"5ca82842-b9af-4647-a62e-d292006a9fab","year":2017},"citing_paper":{"arxiv_id":"2507.19409","last_updated":"2025-07-25T16:19:47Z","snapshot_observed_at":"2026-08-18T12:17:21.005000Z","submitted_at":"2025-07-25T16:19:47Z","title":"Modality Agnostic Efficient Long Range Encoder","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-15T17:59:25.450471Z"},"links":{"citing_paper":"/paper/2507.19409"},"observation_digest":"sha256:56ac0caa87f19850b024f2bcd0e8b09681859bba5e5857883df30d1b04289095","observation_id":"9b3e551d-34f2-4704-b71c-0c858959ce64","resolution":{"observed_at":"2026-08-15T17:59:25.962476Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.00593","last_updated":"2022-11-01T17:08:44Z","snapshot_observed_at":"2026-08-05T06:04:21.031867Z","submitted_at":"2022-11-01T17:08:44Z","title":"Interpretability in the Wild: a Circuit for Indirect Object Identification in GPT-2 small","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.00593","snapshot_observed_at":"2026-08-15T17:59:25.454731Z","title":"Interpretability in the wild: a circuit for indirect object identification in gpt-2 small","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.19409","last_updated":"2025-07-25T16:19:47Z","snapshot_observed_at":"2026-08-18T12:17:21.005000Z","submitted_at":"2025-07-25T16:19:47Z","title":"Modality Agnostic Efficient Long Range Encoder","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-15T17:59:25.454731Z"},"links":{"cited_paper":"/paper/2211.00593","citing_paper":"/paper/2507.19409"},"observation_digest":"sha256:c37583f8350dd076ef1c19b949c11676eb142d5208ada37b04076e33f00693f5","observation_id":"27f9710a-aefa-4135-8eab-6c0349fa9bd2","resolution":{"observed_at":"2026-08-15T17:59:25.454731Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:59:25.943443Z","title":"Huang, Krzysztof Choromanski, Valerii Likhosherstov, and Adrian Weller","venue":null,"work_id":"b7ef39c3-e34c-42e0-9f6a-ba7beaf5287d","year":null},"citing_paper":{"arxiv_id":"2507.19409","last_updated":"2025-07-25T16:19:47Z","snapshot_observed_at":"2026-08-18T12:17:21.005000Z","submitted_at":"2025-07-25T16:19:47Z","title":"Modality Agnostic Efficient Long Range Encoder","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-15T17:59:25.459274Z"},"links":{"citing_paper":"/paper/2507.19409"},"observation_digest":"sha256:8aa4fcd11a35c37c4332f281c78149d2349561e15f103e24eee2e8b9ca863ec6","observation_id":"d3cefd6b-9bfa-48fd-bdbe-9f1891eb5021","resolution":{"observed_at":"2026-08-15T17:59:25.948665Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2204.13604","last_updated":"2022-04-28T16:04:20Z","snapshot_observed_at":"2026-08-16T17:03:54.182706Z","submitted_at":"2022-04-28T16:04:20Z","title":"MeSHup: A Corpus for Full Text Biomedical Document Indexing","version":1},"cited_work":{"arxiv_id":"2204.13604","doi":null,"metadata_source":"pith","pith_arxiv_id":"2204.13604","snapshot_observed_at":"2026-08-15T17:59:25.600814Z","title":"MeSHup: A Corpus for Full Text Biomedical Document Indexing","venue":"cs.CL","work_id":"f430634b-8318-4290-84e5-aa543c228a24","year":2022},"citing_paper":{"arxiv_id":"2507.19409","last_updated":"2025-07-25T16:19:47Z","snapshot_observed_at":"2026-08-18T12:17:21.005000Z","submitted_at":"2025-07-25T16:19:47Z","title":"Modality Agnostic Efficient Long Range Encoder","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-15T17:59:25.464664Z"},"links":{"cited_paper":"/paper/2204.13604","citing_paper":"/paper/2507.19409"},"observation_digest":"sha256:1d461006a512a92be5a3f47d65b6fba63b59c2c388f929b42c09fa58a78922b0","observation_id":"205864dc-13d0-4511-9f0b-658740b3868d","resolution":{"observed_at":"2026-08-15T17:59:25.605672Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:59:25.929566Z","title":"Pytorch image models","venue":null,"work_id":"e00f22db-3b13-4caf-9f23-bbbc4d63d2f0","year":2019},"citing_paper":{"arxiv_id":"2507.19409","last_updated":"2025-07-25T16:19:47Z","snapshot_observed_at":"2026-08-18T12:17:21.005000Z","submitted_at":"2025-07-25T16:19:47Z","title":"Modality Agnostic Efficient Long Range Encoder","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-15T17:59:25.469293Z"},"links":{"citing_paper":"/paper/2507.19409"},"observation_digest":"sha256:65edcceba8a77576394b66aabb37354c9ad55746a11124d9c1a2d1b8d0d061d1","observation_id":"aed7673b-bfe3-4ea9-8b30-3d74e96e3ed5","resolution":{"observed_at":"2026-08-15T17:59:25.934518Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:59:25.915805Z","title":"Ef- fective long-context scaling of foundation models","venue":null,"work_id":"40a13d5b-7825-4e2f-87da-fa83d0d0a689","year":2024},"citing_paper":{"arxiv_id":"2507.19409","last_updated":"2025-07-25T16:19:47Z","snapshot_observed_at":"2026-08-18T12:17:21.005000Z","submitted_at":"2025-07-25T16:19:47Z","title":"Modality Agnostic Efficient Long Range Encoder","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-15T17:59:25.473274Z"},"links":{"citing_paper":"/paper/2507.19409"},"observation_digest":"sha256:bdc8127cf8da035f4f8f70643372da735e41b57e7fe9957af816b48ffec678f2","observation_id":"e5fe8155-0781-420d-a003-e7eaaacebf1c","resolution":{"observed_at":"2026-08-15T17:59:25.920457Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:59:25.902417Z","title":"A-vit: Adaptive tokens for efficient vision transformer","venue":null,"work_id":"aa126dc7-263d-4613-836d-2dade4cbaa5a","year":null},"citing_paper":{"arxiv_id":"2507.19409","last_updated":"2025-07-25T16:19:47Z","snapshot_observed_at":"2026-08-18T12:17:21.005000Z","submitted_at":"2025-07-25T16:19:47Z","title":"Modality Agnostic Efficient Long Range Encoder","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-15T17:59:25.477372Z"},"links":{"citing_paper":"/paper/2507.19409"},"observation_digest":"sha256:c251fbcc83364a4cc7336cd9cb234a495a43ba7dc20c1235ad3eb3593fb89d13","observation_id":"1da600db-4868-46d7-ac0d-f7ffa5f80bf4","resolution":{"observed_at":"2026-08-15T17:59:25.906773Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.07185","last_updated":"2023-05-19T21:09:11Z","snapshot_observed_at":"2026-08-16T15:33:42.352919Z","submitted_at":"2023-05-12T00:55:41Z","title":"MEGABYTE: Predicting Million-byte Sequences with Multiscale Transformers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.07185","snapshot_observed_at":"2026-08-15T17:59:25.481718Z","title":"Megabyte: Predicting million- byte sequences with multiscale transformers","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.19409","last_updated":"2025-07-25T16:19:47Z","snapshot_observed_at":"2026-08-18T12:17:21.005000Z","submitted_at":"2025-07-25T16:19:47Z","title":"Modality Agnostic Efficient Long Range Encoder","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-15T17:59:25.481718Z"},"links":{"cited_paper":"/paper/2305.07185","citing_paper":"/paper/2507.19409"},"observation_digest":"sha256:4f8908de801507dd708cf5bdfff3584a926bb3a11197a3d670ed096fc1a682b5","observation_id":"65337461-5d63-4e10-b756-0c38205a0dbe","resolution":{"observed_at":"2026-08-15T17:59:25.481718Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:59:25.887865Z","title":"Metaformer is actually what you need for vision","venue":null,"work_id":"d5ae0355-da5f-4a37-8b00-b66934ab9020","year":2022},"citing_paper":{"arxiv_id":"2507.19409","last_updated":"2025-07-25T16:19:47Z","snapshot_observed_at":"2026-08-18T12:17:21.005000Z","submitted_at":"2025-07-25T16:19:47Z","title":"Modality Agnostic Efficient Long Range Encoder","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-15T17:59:25.486110Z"},"links":{"citing_paper":"/paper/2507.19409"},"observation_digest":"sha256:47263e93986ae8c829bb0e2517d259518dca94f87702d627a9230a6cce3c603f","observation_id":"b1a65efb-5ebd-44f3-bf4f-7a6b80d8256e","resolution":{"observed_at":"2026-08-15T17:59:25.892725Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:59:25.872067Z","title":"Cutmix: Regularization strategy to train strong classifiers with localizable features","venue":null,"work_id":"4f7ffca0-39f8-4992-bc0f-fc5b2f0e9cec","year":2019},"citing_paper":{"arxiv_id":"2507.19409","last_updated":"2025-07-25T16:19:47Z","snapshot_observed_at":"2026-08-18T12:17:21.005000Z","submitted_at":"2025-07-25T16:19:47Z","title":"Modality Agnostic Efficient Long Range Encoder","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-15T17:59:25.490295Z"},"links":{"citing_paper":"/paper/2507.19409"},"observation_digest":"sha256:148fb7c2d26009b6198b66774d90dd49754b8d148d33b0c884b210373f8ed56a","observation_id":"c4b9783c-bed3-400d-8f7c-dd4510e5d740","resolution":{"observed_at":"2026-08-15T17:59:25.877463Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:59:25.858693Z","title":"Big bird: Trans- formers for longer sequences","venue":null,"work_id":"87b93f15-4c8a-4acb-973b-a40a5133e23b","year":2020},"citing_paper":{"arxiv_id":"2507.19409","last_updated":"2025-07-25T16:19:47Z","snapshot_observed_at":"2026-08-18T12:17:21.005000Z","submitted_at":"2025-07-25T16:19:47Z","title":"Modality Agnostic Efficient Long Range Encoder","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-15T17:59:25.494565Z"},"links":{"citing_paper":"/paper/2507.19409"},"observation_digest":"sha256:c4924166a70f2f9c82107703f00521ce7fac3a529f1679bf4d6dc31dddb8d489","observation_id":"1768df0d-4863-4051-8548-0f4155c2aea5","resolution":{"observed_at":"2026-08-15T17:59:25.863098Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:59:25.845015Z","title":"mixup: Beyond empirical risk minimization","venue":null,"work_id":"ba233df3-d23b-422d-9654-62c63a80d6e6","year":2018},"citing_paper":{"arxiv_id":"2507.19409","last_updated":"2025-07-25T16:19:47Z","snapshot_observed_at":"2026-08-18T12:17:21.005000Z","submitted_at":"2025-07-25T16:19:47Z","title":"Modality Agnostic Efficient Long Range Encoder","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-15T17:59:25.498610Z"},"links":{"citing_paper":"/paper/2507.19409"},"observation_digest":"sha256:9b8d643e92b8446dd6de30b661528624cf8f337e39fc35b3d14e8fde1e800cc0","observation_id":"c6651615-4d64-4f29-b1cc-0edb604dc96f","resolution":{"observed_at":"2026-08-15T17:59:25.849604Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2205.01068","last_updated":"2022-06-21T17:04:40Z","snapshot_observed_at":"2026-08-06T03:13:37.403059Z","submitted_at":"2022-05-02T17:49:50Z","title":"OPT: Open Pre-trained Transformer Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.01068","snapshot_observed_at":"2026-08-15T17:59:25.502868Z","title":"Opt: Open pre-trained transformer language models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.19409","last_updated":"2025-07-25T16:19:47Z","snapshot_observed_at":"2026-08-18T12:17:21.005000Z","submitted_at":"2025-07-25T16:19:47Z","title":"Modality Agnostic Efficient Long Range Encoder","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-15T17:59:25.502868Z"},"links":{"cited_paper":"/paper/2205.01068","citing_paper":"/paper/2507.19409"},"observation_digest":"sha256:a0af2008a745845b5715179b845ebfa9b95f7e685dc8e1d5946161194ee40791","observation_id":"39cd3b71-1fcd-483c-8f13-9eaaa2c1e444","resolution":{"observed_at":"2026-08-15T17:59:25.502868Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:59:25.831369Z","title":"Adavit: Adaptive vision transformers for efficient image recognition","venue":null,"work_id":"5a265575-c64d-4618-8219-cbfcd25ea0bc","year":2022},"citing_paper":{"arxiv_id":"2507.19409","last_updated":"2025-07-25T16:19:47Z","snapshot_observed_at":"2026-08-18T12:17:21.005000Z","submitted_at":"2025-07-25T16:19:47Z","title":"Modality Agnostic Efficient Long Range Encoder","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-15T17:59:25.507154Z"},"links":{"citing_paper":"/paper/2507.19409"},"observation_digest":"sha256:932322b778be67626781089fb7d512811de7a5fece482caab137108c7e338dc3","observation_id":"9db88336-7389-4943-966a-6d4c20ab901c","resolution":{"observed_at":"2026-08-15T17:59:25.835846Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:59:25.817599Z","title":"Long-short transformer: Efficient transformers for language and vision","venue":null,"work_id":"a4d7038e-9e6c-4e90-928d-6e5c3c351664","year":2021},"citing_paper":{"arxiv_id":"2507.19409","last_updated":"2025-07-25T16:19:47Z","snapshot_observed_at":"2026-08-18T12:17:21.005000Z","submitted_at":"2025-07-25T16:19:47Z","title":"Modality Agnostic Efficient Long Range Encoder","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-15T17:59:25.511224Z"},"links":{"citing_paper":"/paper/2507.19409"},"observation_digest":"sha256:9cfce394fca5059b3cdf93669274d1c2318fcf611418e88361b30dd2c7eddea9","observation_id":"27b8126e-4ca5-4088-86e3-ad1eaa430b5f","resolution":{"observed_at":"2026-08-15T17:59:25.822039Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.10757","last_updated":"2023-03-19T20:21:29Z","snapshot_observed_at":"2026-08-16T15:47:03.309819Z","submitted_at":"2023-03-19T20:21:29Z","title":"Multiscale Audio Spectrogram Transformer for Efficient Audio Classification","version":1},"cited_work":{"arxiv_id":"2303.10757","doi":null,"metadata_source":"pith","pith_arxiv_id":"2303.10757","snapshot_observed_at":"2026-08-15T17:59:25.550292Z","title":"Multiscale Audio Spectrogram Transformer for Efficient Audio Classification","venue":"cs.SD","work_id":"052a83a4-f709-48f8-b97d-d598116f47e6","year":2023},"citing_paper":{"arxiv_id":"2507.19409","last_updated":"2025-07-25T16:19:47Z","snapshot_observed_at":"2026-08-18T12:17:21.005000Z","submitted_at":"2025-07-25T16:19:47Z","title":"Modality Agnostic Efficient Long Range Encoder","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-15T17:59:25.515340Z"},"links":{"cited_paper":"/paper/2303.10757","citing_paper":"/paper/2507.19409"},"observation_digest":"sha256:73c5aef2a2de98c68dfd5b3fe322068b9f85038b7db85164be57d2b1b2495bcc","observation_id":"feabdaa6-8dd1-42ba-857f-21e471ac9c98","resolution":{"observed_at":"2026-08-15T17:59:25.556777Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2507.19409","last_updated":"2025-07-25T16:19:47Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-18T12:17:21.005000Z","submitted_at":"2025-07-25T16:19:47Z","title":"Modality Agnostic Efficient Long Range Encoder"},"reference_resolution":{"displayed":70,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":19,"verified_exact":2,"verified_fuzzy":49},"total_outbound_references":70},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"thesis":"As of 18 August 2026, this Paper Citation Record lists 70 of 70 outbound references and 0 inbound Pith citation observations for arXiv:2507.19409."}