{"as_of":"2026-08-08T21:33:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:ea694b93f314b72bfbf1d90db199b06dc9e355ae3089e536be0877526e82374d","coverage":[{"denominator":40,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":40,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T13:39:11.853587Z","state":"measured"},{"denominator":42,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":42,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-03T11:22:14.762729Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2507.20453","last_updated":"2025-09-06T03:33:17Z","snapshot_observed_at":"2026-08-08T11:33:57.877406Z","submitted_at":"2025-07-28T01:07:22Z","title":"Your Attention Matters: to Improve Model Robustness to Noise and Spurious Correlations","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.20453","snapshot_observed_at":"2026-08-03T11:22:14.762729Z","title":"Rohan Taori, Achal Dave, Vaishaal Shankar, Nicholas Carlini, Benjamin Recht, and Ludwig Schmidt","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2601.06891","last_updated":"2026-06-29T13:35:54Z","snapshot_observed_at":"2026-08-08T06:26:16.337039Z","submitted_at":"2026-01-11T12:31:55Z","title":"CLIMP: Contrastive Language-Image Mamba Pretraining","version":2},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-03T11:22:14.762729Z"},"links":{"cited_paper":"/paper/2507.20453","citing_paper":"/paper/2601.06891"},"observation_digest":"sha256:7e762edbffb08b83c798bbe678f9ddbd2e5a94741e99bdc5114676a20887394a","observation_id":"6c55fbb0-586e-4a8d-b505-a02be515a64a","resolution":{"observed_at":"2026-08-03T11:22:14.762729Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.20453","last_updated":"2025-09-06T03:33:17Z","snapshot_observed_at":"2026-08-08T11:33:57.877406Z","submitted_at":"2025-07-28T01:07:22Z","title":"Your Attention Matters: to Improve Model Robustness to Noise and Spurious Correlations","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.20453","snapshot_observed_at":"2026-08-01T17:31:49.632661Z","title":"Your attention matters: to improve model robustness to noise and spurious correlations.arXiv:2507.20453,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.17624","last_updated":"2026-07-20T07:26:17Z","snapshot_observed_at":"2026-08-07T13:43:21.717264Z","submitted_at":"2026-07-20T07:26:17Z","title":"Can Transformers Really Do It All? On the Compatibility of Inductive Biases Across Tasks","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-01T17:31:49.632661Z"},"links":{"cited_paper":"/paper/2507.20453","citing_paper":"/paper/2607.17624"},"observation_digest":"sha256:045c48c6b112358701024130d4f3a8652f407302986e3e9399c285e3e2fda149","observation_id":"55d62c7f-84ec-4740-825a-6bdaab62d682","resolution":{"observed_at":"2026-08-01T17:31:49.632661Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2507.20453/citation-record","integrity":"/paper/2507.20453/integrity","json":"/paper/2507.20453/citation-record.json","paper":"/paper/2507.20453"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:39:07.441503Z","title":"Flamingo: a visual language model for few-shot learning.Advances in neural information processing systems, 35:23716–23736, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.20453","last_updated":"2025-09-06T03:33:17Z","snapshot_observed_at":"2026-08-08T11:33:57.877406Z","submitted_at":"2025-07-28T01:07:22Z","title":"Your Attention Matters: to Improve Model Robustness to Noise and Spurious Correlations","version":3},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T13:39:07.441503Z"},"links":{"citing_paper":"/paper/2507.20453"},"observation_digest":"sha256:bf367d0a8bee66fa8a20cc89d46163874189fa09bea4f73317380d2f543729fa","observation_id":"5870c6bf-742b-4fee-a443-1a95d21e4d52","resolution":{"observed_at":"2026-08-06T13:39:07.441503Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:39:14.813991Z","title":"Understanding robustness of transformers for image classification","venue":null,"work_id":"7e51d62d-f49e-439b-b056-f1e7bec1cdcf","year":2021},"citing_paper":{"arxiv_id":"2507.20453","last_updated":"2025-09-06T03:33:17Z","snapshot_observed_at":"2026-08-08T11:33:57.877406Z","submitted_at":"2025-07-28T01:07:22Z","title":"Your Attention Matters: to Improve Model Robustness to Noise and Spurious Correlations","version":3},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T13:39:07.515077Z"},"links":{"citing_paper":"/paper/2507.20453"},"observation_digest":"sha256:31453a95764154c549bde2dbe49980322dc49be7136d5ce88ee83112d00e1e91","observation_id":"22a9e9b6-89f2-4f9b-8eba-bfb12d1bd8e1","resolution":{"observed_at":"2026-08-06T13:39:14.965696Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:39:07.600611Z","title":"End-to-end object detection with transformers","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.20453","last_updated":"2025-09-06T03:33:17Z","snapshot_observed_at":"2026-08-08T11:33:57.877406Z","submitted_at":"2025-07-28T01:07:22Z","title":"Your Attention Matters: to Improve Model Robustness to Noise and Spurious Correlations","version":3},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T13:39:07.600611Z"},"links":{"citing_paper":"/paper/2507.20453"},"observation_digest":"sha256:52b3dd55de66753f3a5c1633cd65acb6937edcba2b2e05e4fe10c5f8deda8dc1","observation_id":"0f3f48ad-df09-4c95-a872-7c1e59b22d4a","resolution":{"observed_at":"2026-08-06T13:39:07.600611Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2009.14794","last_updated":"2022-11-19T12:45:21Z","snapshot_observed_at":"2026-08-08T20:36:21.234658Z","submitted_at":"2020-09-30T17:09:09Z","title":"Rethinking Attention with Performers","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.14794","snapshot_observed_at":"2026-08-06T13:39:07.725621Z","title":"Rethinking attention with performers","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2507.20453","last_updated":"2025-09-06T03:33:17Z","snapshot_observed_at":"2026-08-08T11:33:57.877406Z","submitted_at":"2025-07-28T01:07:22Z","title":"Your Attention Matters: to Improve Model Robustness to Noise and Spurious Correlations","version":3},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T13:39:07.725621Z"},"links":{"cited_paper":"/paper/2009.14794","citing_paper":"/paper/2507.20453"},"observation_digest":"sha256:3d39de17ed94328e85dc94ddeffac278e28c467d048f56165c33ae2db7b9fb78","observation_id":"2882d72b-abbe-4bdc-a7db-d554fc2279aa","resolution":{"observed_at":"2026-08-06T13:39:07.725621Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:39:07.839052Z","title":"Autoaugment: Learning augmentation strategies from data","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2507.20453","last_updated":"2025-09-06T03:33:17Z","snapshot_observed_at":"2026-08-08T11:33:57.877406Z","submitted_at":"2025-07-28T01:07:22Z","title":"Your Attention Matters: to Improve Model Robustness to Noise and Spurious Correlations","version":3},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T13:39:07.839052Z"},"links":{"citing_paper":"/paper/2507.20453"},"observation_digest":"sha256:d7e258437df1d3859ae9724a18901ae6b5fbbafa6c5e309dfb99962d3f3a042d","observation_id":"9bd29eca-f9cb-4cc2-b7cb-120d481ac684","resolution":{"observed_at":"2026-08-06T13:39:07.839052Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:39:07.904746Z","title":"Bert: Pre-training of deep bidi- rectional transformers for language understanding","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2507.20453","last_updated":"2025-09-06T03:33:17Z","snapshot_observed_at":"2026-08-08T11:33:57.877406Z","submitted_at":"2025-07-28T01:07:22Z","title":"Your Attention Matters: to Improve Model Robustness to Noise and Spurious Correlations","version":3},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T13:39:07.904746Z"},"links":{"citing_paper":"/paper/2507.20453"},"observation_digest":"sha256:2090b5d75f58747c5f2d7bd1f4d2c6d00f5d132860cb2b1eef6125bdb6bb74b6","observation_id":"4c832bd2-53c7-456c-85e3-c39bd04f6224","resolution":{"observed_at":"2026-08-06T13:39:07.904746Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1708.04552","last_updated":"2017-11-29T14:51:40Z","snapshot_observed_at":"2026-07-06T05:55:22.966528Z","submitted_at":"2017-08-15T15:21:53Z","title":"Improved Regularization of Convolutional Neural Networks with Cutout","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1708.04552","snapshot_observed_at":"2026-08-06T13:39:08.033556Z","title":"Improved regularization of convolutional neural networks with cutout.arXiv preprint arXiv:1708.04552, 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2507.20453","last_updated":"2025-09-06T03:33:17Z","snapshot_observed_at":"2026-08-08T11:33:57.877406Z","submitted_at":"2025-07-28T01:07:22Z","title":"Your Attention Matters: to Improve Model Robustness to Noise and Spurious Correlations","version":3},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T13:39:08.033556Z"},"links":{"cited_paper":"/paper/1708.04552","citing_paper":"/paper/2507.20453"},"observation_digest":"sha256:267305ceed103845a9d1a02f393ce18b3a056fc2f7f34343453878a8b171aadc","observation_id":"7edc3bca-a5e1-4e6b-8ae8-2835fddf658d","resolution":{"observed_at":"2026-08-06T13:39:08.033556Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2010.11929","last_updated":"2021-06-03T13:08:56Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-10-22T17:55:59Z","title":"An Image is Worth 16x16 Words: Transformers for Image Recognition at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.11929","snapshot_observed_at":"2026-08-06T13:39:08.207466Z","title":"An image is worth 16x16 words: Transformers for image recognition at scale.arXiv preprint arXiv:2010.11929, 2020","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2507.20453","last_updated":"2025-09-06T03:33:17Z","snapshot_observed_at":"2026-08-08T11:33:57.877406Z","submitted_at":"2025-07-28T01:07:22Z","title":"Your Attention Matters: to Improve Model Robustness to Noise and Spurious Correlations","version":3},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T13:39:08.207466Z"},"links":{"cited_paper":"/paper/2010.11929","citing_paper":"/paper/2507.20453"},"observation_digest":"sha256:0d4534c1b09701a76163a9e7e77cc305b51eca4ae6222e2278b7ae0f45e45528","observation_id":"3b24ecae-da8e-44fa-a01d-3f9abed2507c","resolution":{"observed_at":"2026-08-06T13:39:08.207466Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:39:08.350999Z","title":"Imagenet-trained cnns are biased towards texture; increasing shape bias improves accuracy and robustness","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2507.20453","last_updated":"2025-09-06T03:33:17Z","snapshot_observed_at":"2026-08-08T11:33:57.877406Z","submitted_at":"2025-07-28T01:07:22Z","title":"Your Attention Matters: to Improve Model Robustness to Noise and Spurious Correlations","version":3},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T13:39:08.350999Z"},"links":{"citing_paper":"/paper/2507.20453"},"observation_digest":"sha256:ce71b1bd6b05c5e06a3d6d21bfb0d8a1662afc441b6ee4af672f407ea13d3803","observation_id":"e16ae978-1952-4651-ac2e-7c5851014a6d","resolution":{"observed_at":"2026-08-06T13:39:08.350999Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2104.01778","last_updated":"2021-07-08T20:16:28Z","snapshot_observed_at":"2026-08-08T11:33:21.735489Z","submitted_at":"2021-04-05T05:26:29Z","title":"AST: Audio Spectrogram Transformer","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.01778","snapshot_observed_at":"2026-08-06T13:39:08.440360Z","title":"Ast: Audio spectrogram transformer.arXiv preprint arXiv:2104.01778, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.20453","last_updated":"2025-09-06T03:33:17Z","snapshot_observed_at":"2026-08-08T11:33:57.877406Z","submitted_at":"2025-07-28T01:07:22Z","title":"Your Attention Matters: to Improve Model Robustness to Noise and Spurious Correlations","version":3},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T13:39:08.440360Z"},"links":{"cited_paper":"/paper/2104.01778","citing_paper":"/paper/2507.20453"},"observation_digest":"sha256:d3129766ea544c48621a5dab17c184bc8c7648288028eec058333292aa1c4b9d","observation_id":"8517328c-d79c-4fe0-ab3a-4c568edbdbc9","resolution":{"observed_at":"2026-08-06T13:39:08.440360Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1412.6572","last_updated":"2015-03-20T20:19:16Z","snapshot_observed_at":"2026-07-06T04:04:16.777653Z","submitted_at":"2014-12-20T01:17:12Z","title":"Explaining and Harnessing Adversarial Examples","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1412.6572","snapshot_observed_at":"2026-08-06T13:39:08.572368Z","title":"Explaining and harnessing adversarial examples","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2507.20453","last_updated":"2025-09-06T03:33:17Z","snapshot_observed_at":"2026-08-08T11:33:57.877406Z","submitted_at":"2025-07-28T01:07:22Z","title":"Your Attention Matters: to Improve Model Robustness to Noise and Spurious Correlations","version":3},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T13:39:08.572368Z"},"links":{"cited_paper":"/paper/1412.6572","citing_paper":"/paper/2507.20453"},"observation_digest":"sha256:c4b9af02b0ef41d6c6e83aeb31203890b56fb37b303d8e23073cfa3345552f53","observation_id":"7fd47f6c-1443-4dce-9fc5-14005e8b750a","resolution":{"observed_at":"2026-08-06T13:39:08.572368Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:39:08.649221Z","title":"Deep residual learning for image recognition","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2507.20453","last_updated":"2025-09-06T03:33:17Z","snapshot_observed_at":"2026-08-08T11:33:57.877406Z","submitted_at":"2025-07-28T01:07:22Z","title":"Your Attention Matters: to Improve Model Robustness to Noise and Spurious Correlations","version":3},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T13:39:08.649221Z"},"links":{"citing_paper":"/paper/2507.20453"},"observation_digest":"sha256:3649462437fbcc3640b6d07e04d2c73b5f37ae5b686cc56f862df91577b3e57c","observation_id":"a5d92a85-4446-453a-99f4-beb937c84657","resolution":{"observed_at":"2026-08-06T13:39:08.649221Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1903.12261","last_updated":"2019-03-28T20:56:37Z","snapshot_observed_at":"2026-08-02T09:01:28.869881Z","submitted_at":"2019-03-28T20:56:37Z","title":"Benchmarking Neural Network Robustness to Common Corruptions and Perturbations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1903.12261","snapshot_observed_at":"2026-08-06T13:39:08.726255Z","title":"Benchmarking neural network robustness to common corruptions and perturbations.arXiv preprint arXiv:1903.12261, 2019","venue":null,"work_id":null,"year":1903},"citing_paper":{"arxiv_id":"2507.20453","last_updated":"2025-09-06T03:33:17Z","snapshot_observed_at":"2026-08-08T11:33:57.877406Z","submitted_at":"2025-07-28T01:07:22Z","title":"Your Attention Matters: to Improve Model Robustness to Noise and Spurious Correlations","version":3},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T13:39:08.726255Z"},"links":{"cited_paper":"/paper/1903.12261","citing_paper":"/paper/2507.20453"},"observation_digest":"sha256:0b2a15863c8401dd4868f7f4ffac339444ca6b716acfb0847eb1c66f5cac5b6e","observation_id":"40677a84-cce1-4580-b2ee-df15b1dbe1af","resolution":{"observed_at":"2026-08-06T13:39:08.726255Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:39:14.546855Z","title":"Imagenette: A smaller subset of 10 easily classified classes from imagenet","venue":null,"work_id":"76859826-1625-4549-9a11-2ca984f5e931","year":2019},"citing_paper":{"arxiv_id":"2507.20453","last_updated":"2025-09-06T03:33:17Z","snapshot_observed_at":"2026-08-08T11:33:57.877406Z","submitted_at":"2025-07-28T01:07:22Z","title":"Your Attention Matters: to Improve Model Robustness to Noise and Spurious Correlations","version":3},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T13:39:08.816067Z"},"links":{"citing_paper":"/paper/2507.20453"},"observation_digest":"sha256:6945392f4e961b2aa45c77615edda4ee2b11f64ff3e791a757a44c024f6fb335","observation_id":"0e78be30-efab-4974-89d9-c45413ca3e58","resolution":{"observed_at":"2026-08-06T13:39:14.677106Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:39:08.967669Z","title":"Batch normalization: Accelerating deep network training by reducing internal covariate shift","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2507.20453","last_updated":"2025-09-06T03:33:17Z","snapshot_observed_at":"2026-08-08T11:33:57.877406Z","submitted_at":"2025-07-28T01:07:22Z","title":"Your Attention Matters: to Improve Model Robustness to Noise and Spurious Correlations","version":3},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T13:39:08.967669Z"},"links":{"citing_paper":"/paper/2507.20453"},"observation_digest":"sha256:2f356c9c47284c8869a02b2aeeba60d13bb83542b27f6e34d59bc0a64ad84da4","observation_id":"477624a4-e0b4-47ea-bfb1-3fe4620f2a6f","resolution":{"observed_at":"2026-08-06T13:39:08.967669Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:39:09.045191Z","title":"Transformers are rnns: Fast autoregressive transformers with linear attention","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.20453","last_updated":"2025-09-06T03:33:17Z","snapshot_observed_at":"2026-08-08T11:33:57.877406Z","submitted_at":"2025-07-28T01:07:22Z","title":"Your Attention Matters: to Improve Model Robustness to Noise and Spurious Correlations","version":3},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T13:39:09.045191Z"},"links":{"citing_paper":"/paper/2507.20453"},"observation_digest":"sha256:edae36386bbf41aecb220c376ba703cbff5b060f01a4bcd597b3dd4e6ecd8754","observation_id":"506b581b-65f8-401f-85ac-ef834d2e0caa","resolution":{"observed_at":"2026-08-06T13:39:09.045191Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:39:09.169731Z","title":"Vilt: Vision-and-language transformer without convolution or region supervision","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.20453","last_updated":"2025-09-06T03:33:17Z","snapshot_observed_at":"2026-08-08T11:33:57.877406Z","submitted_at":"2025-07-28T01:07:22Z","title":"Your Attention Matters: to Improve Model Robustness to Noise and Spurious Correlations","version":3},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T13:39:09.169731Z"},"links":{"citing_paper":"/paper/2507.20453"},"observation_digest":"sha256:82192b65c69804381c731e7e488d40518a96ad1c1e0f0e2d05de6557bd37a0e3","observation_id":"846dee64-4276-434e-a023-b7f9698855f2","resolution":{"observed_at":"2026-08-06T13:39:09.169731Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:39:09.255703Z","title":"Learning multiple layers of features from tiny images","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2507.20453","last_updated":"2025-09-06T03:33:17Z","snapshot_observed_at":"2026-08-08T11:33:57.877406Z","submitted_at":"2025-07-28T01:07:22Z","title":"Your Attention Matters: to Improve Model Robustness to Noise and Spurious Correlations","version":3},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T13:39:09.255703Z"},"links":{"citing_paper":"/paper/2507.20453"},"observation_digest":"sha256:53c850bff10946c1a2d3801c5ec0853d42dc06668541b1ffe38b92249451a08f","observation_id":"160786ee-16c0-452e-a040-65e79d35b843","resolution":{"observed_at":"2026-08-06T13:39:09.255703Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:39:14.234383Z","title":"Imagenet classification with deep convolutional neural networks","venue":null,"work_id":"c0ef6035-5669-4454-83ea-275e3e34851c","year":2012},"citing_paper":{"arxiv_id":"2507.20453","last_updated":"2025-09-06T03:33:17Z","snapshot_observed_at":"2026-08-08T11:33:57.877406Z","submitted_at":"2025-07-28T01:07:22Z","title":"Your Attention Matters: to Improve Model Robustness to Noise and Spurious Correlations","version":3},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T13:39:09.324084Z"},"links":{"citing_paper":"/paper/2507.20453"},"observation_digest":"sha256:0ff56cf73c9866953e9288abf488152f180dce56c83ac84c0d7aa49a8dd90cb1","observation_id":"a45f5797-fc5a-4f97-b563-d9f4efdff127","resolution":{"observed_at":"2026-08-06T13:39:14.323587Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:39:14.008600Z","title":"Doubly stochastic normalization of the gaussian kernel is robust to heteroskedastic noise.SIAM journal on mathematics of data science, 3(1):388–413, 2021","venue":null,"work_id":"91103cc8-6fe8-4caf-9e25-6158cf245d8a","year":2021},"citing_paper":{"arxiv_id":"2507.20453","last_updated":"2025-09-06T03:33:17Z","snapshot_observed_at":"2026-08-08T11:33:57.877406Z","submitted_at":"2025-07-28T01:07:22Z","title":"Your Attention Matters: to Improve Model Robustness to Noise and Spurious Correlations","version":3},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T13:39:09.469234Z"},"links":{"citing_paper":"/paper/2507.20453"},"observation_digest":"sha256:75ec12de67bed54feead5de4bf4e43ffc36f3c4d82884ae65662ab70cad4dbf9","observation_id":"d2290f4a-af96-4315-b66f-db674b25f533","resolution":{"observed_at":"2026-08-06T13:39:14.091118Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:39:09.566945Z","title":"Gradient-based learning applied to document recognition.Proceedings of the IEEE, 86(11):2278–2324, 1998","venue":null,"work_id":null,"year":1998},"citing_paper":{"arxiv_id":"2507.20453","last_updated":"2025-09-06T03:33:17Z","snapshot_observed_at":"2026-08-08T11:33:57.877406Z","submitted_at":"2025-07-28T01:07:22Z","title":"Your Attention Matters: to Improve Model Robustness to Noise and Spurious Correlations","version":3},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T13:39:09.566945Z"},"links":{"citing_paper":"/paper/2507.20453"},"observation_digest":"sha256:4b0f3f4bcc982215cdcdb4e15e5860d65f87deae94bb1671347d2c4f490b8f03","observation_id":"d800f262-9164-4660-9d08-d8369c09c8e5","resolution":{"observed_at":"2026-08-06T13:39:09.566945Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:39:09.646704Z","title":"Swin transformer: Hierarchical vision transformer using shifted windows","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.20453","last_updated":"2025-09-06T03:33:17Z","snapshot_observed_at":"2026-08-08T11:33:57.877406Z","submitted_at":"2025-07-28T01:07:22Z","title":"Your Attention Matters: to Improve Model Robustness to Noise and Spurious Correlations","version":3},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T13:39:09.646704Z"},"links":{"citing_paper":"/paper/2507.20453"},"observation_digest":"sha256:8492ccb9e13e08ffffaf1cad8c87b5df28a1da83dbaa2947679e3e872dc54223","observation_id":"d842f138-7091-43e1-b584-b1662f41d283","resolution":{"observed_at":"2026-08-06T13:39:09.646704Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1706.06083","last_updated":"2019-09-04T18:53:10Z","snapshot_observed_at":"2026-08-07T14:27:46.872660Z","submitted_at":"2017-06-19T17:53:11Z","title":"Towards Deep Learning Models Resistant to Adversarial Attacks","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1706.06083","snapshot_observed_at":"2026-08-06T13:39:09.777205Z","title":"Towards deep learning models resistant to adversarial attacks.arXiv preprint arXiv:1706.06083, 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2507.20453","last_updated":"2025-09-06T03:33:17Z","snapshot_observed_at":"2026-08-08T11:33:57.877406Z","submitted_at":"2025-07-28T01:07:22Z","title":"Your Attention Matters: to Improve Model Robustness to Noise and Spurious Correlations","version":3},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T13:39:09.777205Z"},"links":{"cited_paper":"/paper/1706.06083","citing_paper":"/paper/2507.20453"},"observation_digest":"sha256:8e76684236115c7710ecd66018b346470c14021b8ecf58d7a4c0dd93acccc5a2","observation_id":"6c878e9e-a404-448d-8fe3-7ef637b374f8","resolution":{"observed_at":"2026-08-06T13:39:09.777205Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2409.18747","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:39:12.569923Z","title":"Cottention: Linear transformers with cosine attention","venue":null,"work_id":"a4944e0c-9cab-4eeb-8e7c-3143a56a2d9c","year":2024},"citing_paper":{"arxiv_id":"2507.20453","last_updated":"2025-09-06T03:33:17Z","snapshot_observed_at":"2026-08-08T11:33:57.877406Z","submitted_at":"2025-07-28T01:07:22Z","title":"Your Attention Matters: to Improve Model Robustness to Noise and Spurious Correlations","version":3},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T13:39:09.865025Z"},"links":{"citing_paper":"/paper/2507.20453"},"observation_digest":"sha256:79db19836a4da3e52ff9f3878c429268158165e65b581cc18fd4fc61620b8b76","observation_id":"338a7bd0-8533-48cc-b072-52b0782fa78e","resolution":{"observed_at":"2026-08-06T13:39:12.674747Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1911.03875","last_updated":"2020-10-29T06:17:11Z","snapshot_observed_at":"2026-07-06T08:35:53.531562Z","submitted_at":"2019-11-10T08:17:11Z","title":"Rethinking Self-Attention: Towards Interpretability in Neural Parsing","version":3},"cited_work":{"arxiv_id":"1911.03875","doi":null,"metadata_source":"pith","pith_arxiv_id":"1911.03875","snapshot_observed_at":"2026-08-06T13:39:12.234447Z","title":"Rethinking Self-Attention: Towards Interpretability in Neural Parsing","venue":"cs.CL","work_id":"6b3e32bc-c75f-48c2-ba8f-0ef469514482","year":2019},"citing_paper":{"arxiv_id":"2507.20453","last_updated":"2025-09-06T03:33:17Z","snapshot_observed_at":"2026-08-08T11:33:57.877406Z","submitted_at":"2025-07-28T01:07:22Z","title":"Your Attention Matters: to Improve Model Robustness to Noise and Spurious Correlations","version":3},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T13:39:09.973995Z"},"links":{"cited_paper":"/paper/1911.03875","citing_paper":"/paper/2507.20453"},"observation_digest":"sha256:229a298d56252258341d2728210881899dd21ab0c242085a61a2e1549862e891","observation_id":"17c4307d-a460-412f-bda6-6b8bf80c940e","resolution":{"observed_at":"2026-08-06T13:39:12.320656Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:39:10.085428Z","title":"Vision transformers are robust learners","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.20453","last_updated":"2025-09-06T03:33:17Z","snapshot_observed_at":"2026-08-08T11:33:57.877406Z","submitted_at":"2025-07-28T01:07:22Z","title":"Your Attention Matters: to Improve Model Robustness to Noise and Spurious Correlations","version":3},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T13:39:10.085428Z"},"links":{"citing_paper":"/paper/2507.20453"},"observation_digest":"sha256:85b652b6b5e7683766989c6cd3467ae7c97451d57a555ac390119f68f7803de0","observation_id":"83021d80-2f89-4118-9b5f-0cddb464e601","resolution":{"observed_at":"2026-08-06T13:39:10.085428Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:39:10.190723Z","title":"Improving language understanding by generative pre-training","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2507.20453","last_updated":"2025-09-06T03:33:17Z","snapshot_observed_at":"2026-08-08T11:33:57.877406Z","submitted_at":"2025-07-28T01:07:22Z","title":"Your Attention Matters: to Improve Model Robustness to Noise and Spurious Correlations","version":3},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T13:39:10.190723Z"},"links":{"citing_paper":"/paper/2507.20453"},"observation_digest":"sha256:5611a0f9e6e3e1de59100b4fd7080736e9cd0252497d1263ceff8f63327add94","observation_id":"fb055d8d-21a3-419a-84d6-859cd562eae6","resolution":{"observed_at":"2026-08-06T13:39:10.190723Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:39:10.291889Z","title":"Robust speech recognition via large-scale weak supervision","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.20453","last_updated":"2025-09-06T03:33:17Z","snapshot_observed_at":"2026-08-08T11:33:57.877406Z","submitted_at":"2025-07-28T01:07:22Z","title":"Your Attention Matters: to Improve Model Robustness to Noise and Spurious Correlations","version":3},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T13:39:10.291889Z"},"links":{"citing_paper":"/paper/2507.20453"},"observation_digest":"sha256:a61b5d2c816034386e3fef28c6608c46fa0af23f74ff405b4bae174e5698afc0","observation_id":"63e5b590-c494-4205-96df-d5e168bdf421","resolution":{"observed_at":"2026-08-06T13:39:10.291889Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.04431","last_updated":"2025-01-22T01:18:51Z","snapshot_observed_at":"2026-07-06T19:11:40.618767Z","submitted_at":"2024-09-06T17:53:26Z","title":"Theory, Analysis, and Best Practices for Sigmoid Self-Attention","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.04431","snapshot_observed_at":"2026-08-06T13:39:10.426250Z","title":"Theory, analysis, and best practices for sigmoid self-attention.arXiv preprint arXiv:2409.04431, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.20453","last_updated":"2025-09-06T03:33:17Z","snapshot_observed_at":"2026-08-08T11:33:57.877406Z","submitted_at":"2025-07-28T01:07:22Z","title":"Your Attention Matters: to Improve Model Robustness to Noise and Spurious Correlations","version":3},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T13:39:10.426250Z"},"links":{"cited_paper":"/paper/2409.04431","citing_paper":"/paper/2507.20453"},"observation_digest":"sha256:233c49c4b30d0a0e661a9ecce675f977b36283def7f3172f96f5eb5c60416171","observation_id":"3b93fb8e-4c74-4dcb-aca6-d41795f98465","resolution":{"observed_at":"2026-08-06T13:39:10.426250Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2205.06175","last_updated":"2022-11-11T10:04:29Z","snapshot_observed_at":"2026-08-08T03:18:33.595658Z","submitted_at":"2022-05-12T16:03:26Z","title":"A Generalist Agent","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.06175","snapshot_observed_at":"2026-08-06T13:39:10.522584Z","title":"A generalist agent","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.20453","last_updated":"2025-09-06T03:33:17Z","snapshot_observed_at":"2026-08-08T11:33:57.877406Z","submitted_at":"2025-07-28T01:07:22Z","title":"Your Attention Matters: to Improve Model Robustness to Noise and Spurious Correlations","version":3},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T13:39:10.522584Z"},"links":{"cited_paper":"/paper/2205.06175","citing_paper":"/paper/2507.20453"},"observation_digest":"sha256:0e66fd24c9766dcbe417541971b6d3d748d68c2d54f3531d97aa0f7619e1a748","observation_id":"1c0dedde-95e7-4240-995e-f60e99e48247","resolution":{"observed_at":"2026-08-06T13:39:10.522584Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:39:13.698445Z","title":"Sinkformers: Transformers with doubly stochastic attention","venue":null,"work_id":"a19d3604-7c6b-496b-8c16-adc145bd5814","year":2022},"citing_paper":{"arxiv_id":"2507.20453","last_updated":"2025-09-06T03:33:17Z","snapshot_observed_at":"2026-08-08T11:33:57.877406Z","submitted_at":"2025-07-28T01:07:22Z","title":"Your Attention Matters: to Improve Model Robustness to Noise and Spurious Correlations","version":3},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T13:39:10.674647Z"},"links":{"citing_paper":"/paper/2507.20453"},"observation_digest":"sha256:0306213da81dd6afd25b03c21350b64eddfc930973b8933be639b0c0a6c5e3e1","observation_id":"93f6a0de-7e0c-4a79-815b-c8d64170f2c3","resolution":{"observed_at":"2026-08-06T13:39:13.796855Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1409.1556","last_updated":"2015-04-10T16:25:04Z","snapshot_observed_at":"2026-07-06T03:53:32.549552Z","submitted_at":"2014-09-04T19:48:04Z","title":"Very Deep Convolutional Networks for Large-Scale Image Recognition","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1409.1556","snapshot_observed_at":"2026-08-06T13:39:11.028293Z","title":"Very deep convolutional networks for large-scale image recogni- tion.arXiv preprint arXiv:1409.1556, 2014","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2507.20453","last_updated":"2025-09-06T03:33:17Z","snapshot_observed_at":"2026-08-08T11:33:57.877406Z","submitted_at":"2025-07-28T01:07:22Z","title":"Your Attention Matters: to Improve Model Robustness to Noise and Spurious Correlations","version":3},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T13:39:11.028293Z"},"links":{"cited_paper":"/paper/1409.1556","citing_paper":"/paper/2507.20453"},"observation_digest":"sha256:21036e12b95d57f35b8d104d2f73074e45633f3c7a05ba3a63c201198bca480a","observation_id":"a10c65a9-c1e8-49c2-acfb-b45946385079","resolution":{"observed_at":"2026-08-06T13:39:11.028293Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:39:13.488408Z","title":"Dropout: a simple way to prevent neural networks from overfitting.The journal of machine learning research, 15(1): 1929–1958, 2014","venue":null,"work_id":"f4d29206-120c-4070-b2cf-3033fb0366dc","year":1929},"citing_paper":{"arxiv_id":"2507.20453","last_updated":"2025-09-06T03:33:17Z","snapshot_observed_at":"2026-08-08T11:33:57.877406Z","submitted_at":"2025-07-28T01:07:22Z","title":"Your Attention Matters: to Improve Model Robustness to Noise and Spurious Correlations","version":3},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T13:39:11.201379Z"},"links":{"citing_paper":"/paper/2507.20453"},"observation_digest":"sha256:36a20fe172e648badda4fbce4e667df3e0ae84b3bc4a929395fff0857b1b636f","observation_id":"0775cff6-db90-4bcc-85b5-e8c23c85225d","resolution":{"observed_at":"2026-08-06T13:39:13.567812Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:39:11.337832Z","title":"Going deeper with convolutions","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2507.20453","last_updated":"2025-09-06T03:33:17Z","snapshot_observed_at":"2026-08-08T11:33:57.877406Z","submitted_at":"2025-07-28T01:07:22Z","title":"Your Attention Matters: to Improve Model Robustness to Noise and Spurious Correlations","version":3},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T13:39:11.337832Z"},"links":{"citing_paper":"/paper/2507.20453"},"observation_digest":"sha256:c704e3f7265c1da24363c09c65e9235a1e9dd514d5a7e26afce703383775258b","observation_id":"1aae96fa-9a07-4f43-9be8-42ce4733c9e2","resolution":{"observed_at":"2026-08-06T13:39:11.337832Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:39:11.420842Z","title":"Mean teachers are better role models: Weight-averaged consistency targets improve semi-supervised deep learning results.Advances in neural information processing systems, 30, 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2507.20453","last_updated":"2025-09-06T03:33:17Z","snapshot_observed_at":"2026-08-08T11:33:57.877406Z","submitted_at":"2025-07-28T01:07:22Z","title":"Your Attention Matters: to Improve Model Robustness to Noise and Spurious Correlations","version":3},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T13:39:11.420842Z"},"links":{"citing_paper":"/paper/2507.20453"},"observation_digest":"sha256:af7d3cc0f27e21911ba3960e57f904917de91aeb045c35d9b1dde93d9ca528d0","observation_id":"5cd4e59c-24fb-4e2c-a0fb-6e0998e46276","resolution":{"observed_at":"2026-08-06T13:39:11.420842Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:39:11.508627Z","title":"Going deeper with image transformers","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.20453","last_updated":"2025-09-06T03:33:17Z","snapshot_observed_at":"2026-08-08T11:33:57.877406Z","submitted_at":"2025-07-28T01:07:22Z","title":"Your Attention Matters: to Improve Model Robustness to Noise and Spurious Correlations","version":3},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T13:39:11.508627Z"},"links":{"citing_paper":"/paper/2507.20453"},"observation_digest":"sha256:cf1abefb73a00ecf9d9e940b7b0281396612815dc1969360c9b338bb8f302b7c","observation_id":"f8afc304-6734-488c-93a5-9858e8529c69","resolution":{"observed_at":"2026-08-06T13:39:11.508627Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:39:11.592745Z","title":"Attention is all you need.Advances in neural information processing systems, 30, 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2507.20453","last_updated":"2025-09-06T03:33:17Z","snapshot_observed_at":"2026-08-08T11:33:57.877406Z","submitted_at":"2025-07-28T01:07:22Z","title":"Your Attention Matters: to Improve Model Robustness to Noise and Spurious Correlations","version":3},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T13:39:11.592745Z"},"links":{"citing_paper":"/paper/2507.20453"},"observation_digest":"sha256:7e3bf98951085f27b1e4f29d5b2a65f3abfbcd7847a920108305183ba5d2e516","observation_id":"c002362e-e902-4d44-a217-e30dc6a985b5","resolution":{"observed_at":"2026-08-06T13:39:11.592745Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2006.04768","last_updated":"2020-06-14T08:15:54Z","snapshot_observed_at":"2026-07-06T09:27:03.809621Z","submitted_at":"2020-06-08T17:37:52Z","title":"Linformer: Self-Attention with Linear Complexity","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2006.04768","snapshot_observed_at":"2026-08-06T13:39:11.691599Z","title":"Linformer: Self-attention with linear complexity.arXiv preprint arXiv:2006.04768, 2020","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2507.20453","last_updated":"2025-09-06T03:33:17Z","snapshot_observed_at":"2026-08-08T11:33:57.877406Z","submitted_at":"2025-07-28T01:07:22Z","title":"Your Attention Matters: to Improve Model Robustness to Noise and Spurious Correlations","version":3},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-06T13:39:11.691599Z"},"links":{"cited_paper":"/paper/2006.04768","citing_paper":"/paper/2507.20453"},"observation_digest":"sha256:87fb07d5bc357edbcfcc8317ac81c8d9ddf1c54e4d8f0def29316a5e638f9172","observation_id":"8e0abeff-b491-4245-9253-cf4cb223b71e","resolution":{"observed_at":"2026-08-06T13:39:11.691599Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:39:13.160897Z","title":"Xlnet: Generalized autoregressive pretraining for language understanding.Advances in neural information processing systems, 32, 2019","venue":null,"work_id":"efeabff5-e5ab-4179-8876-9cb6bb234b5d","year":2019},"citing_paper":{"arxiv_id":"2507.20453","last_updated":"2025-09-06T03:33:17Z","snapshot_observed_at":"2026-08-08T11:33:57.877406Z","submitted_at":"2025-07-28T01:07:22Z","title":"Your Attention Matters: to Improve Model Robustness to Noise and Spurious Correlations","version":3},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T13:39:11.771132Z"},"links":{"citing_paper":"/paper/2507.20453"},"observation_digest":"sha256:77b5655f2f1603ddb0cf933698015a2516aced548507e8d9abb40d4747720f66","observation_id":"531b80a2-f7b0-496f-83b6-a5eaf0c6387e","resolution":{"observed_at":"2026-08-06T13:39:13.289835Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1710.09412","last_updated":"2018-04-27T21:39:25Z","snapshot_observed_at":"2026-08-08T10:28:19.597631Z","submitted_at":"2017-10-25T18:30:49Z","title":"mixup: Beyond Empirical Risk Minimization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1710.09412","snapshot_observed_at":"2026-08-06T13:39:11.853587Z","title":"mixup: Beyond empirical risk minimization.arXiv preprint arXiv:1710.09412, 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2507.20453","last_updated":"2025-09-06T03:33:17Z","snapshot_observed_at":"2026-08-08T11:33:57.877406Z","submitted_at":"2025-07-28T01:07:22Z","title":"Your Attention Matters: to Improve Model Robustness to Noise and Spurious Correlations","version":3},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-06T13:39:11.853587Z"},"links":{"cited_paper":"/paper/1710.09412","citing_paper":"/paper/2507.20453"},"observation_digest":"sha256:ebc279f48bd9f923fafb89f9dcdb113b83d72122f99545d026a9abe440e37507","observation_id":"3a2d5546-4a36-4862-90a1-54095ba2982a","resolution":{"observed_at":"2026-08-06T13:39:11.853587Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2507.20453","last_updated":"2025-09-06T03:33:17Z","latest_version":3,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-08T11:33:57.877406Z","submitted_at":"2025-07-28T01:07:22Z","title":"Your Attention Matters: to Improve Model Robustness to Noise and Spurious Correlations"},"reference_resolution":{"displayed":40,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":31,"verified_exact":2,"verified_fuzzy":7},"total_outbound_references":40},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 40 of 40 outbound references and 2 inbound Pith citation observations for arXiv:2507.20453."}