{"as_of":"2026-08-05T02:55:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:be0a8c914db552ad7663582625064d781342c2f445d02e18109aa368285bd161","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":10,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":10,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-04T06:34:03.388597+00:00","state":"measured"},{"denominator":10,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":10,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-29T14:24:54.942194Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-04T12:39:50.016990Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2103.02143","last_updated":"2021-03-19T21:24:06Z","snapshot_observed_at":"2026-08-04T23:37:38.910806Z","submitted_at":"2021-03-03T02:48:56Z","title":"Random Feature Attention","version":2},"cited_work":{"arxiv_id":"2103.02143","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2103.02143","snapshot_observed_at":"2026-07-04T12:39:50.016990Z","title":"Random feature attention.arXiv preprint arXiv:2103.02143","venue":null,"work_id":"1bd373e4-ab9a-4e64-8e88-1c304897525b","year":2021},"citing_paper":{"arxiv_id":"2312.06635","last_updated":"2024-08-27T01:27:29Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-12-11T18:51:59Z","title":"Gated Linear Attention Transformers with Hardware-Efficient Training","version":6},"reference_index":65,"source":"arxiv_source","source_observed_at":"2026-05-15T01:15:13.991219Z"},"links":{"cited_paper":"/paper/2103.02143","citing_paper":"/paper/2312.06635"},"observation_digest":"sha256:f103244a797c47428c4891227f411acf9c92f9ea5d7281221ba756ca849e3c4a","observation_id":"65595d49-61e1-4526-81a7-73094e8ddd77","resolution":{"observed_at":"2026-05-15T01:15:14.165236Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2103.02143","last_updated":"2021-03-19T21:24:06Z","snapshot_observed_at":"2026-08-04T23:37:38.910806Z","submitted_at":"2021-03-03T02:48:56Z","title":"Random Feature Attention","version":2},"cited_work":{"arxiv_id":"2103.02143","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2103.02143","snapshot_observed_at":"2026-07-04T12:39:50.016990Z","title":"Random feature attention.arXiv preprint arXiv:2103.02143","venue":null,"work_id":"1bd373e4-ab9a-4e64-8e88-1c304897525b","year":2021},"citing_paper":{"arxiv_id":"2510.27258","last_updated":"2026-05-14T15:35:59Z","snapshot_observed_at":"2026-07-06T22:34:33.419178Z","submitted_at":"2025-10-31T07:54:37Z","title":"Higher-order Linear Attention","version":3},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-18T03:05:35.823369Z"},"links":{"cited_paper":"/paper/2103.02143","citing_paper":"/paper/2510.27258"},"observation_digest":"sha256:8cf17206a0d6ca42a05bb30d578efca0bf0f60dc7ed30475b64cbede8b5bbc04","observation_id":"1865fa0f-edf9-42f0-b85e-c746f26b013c","resolution":{"observed_at":"2026-05-18T03:05:47.388067Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2103.02143","last_updated":"2021-03-19T21:24:06Z","snapshot_observed_at":"2026-08-04T23:37:38.910806Z","submitted_at":"2021-03-03T02:48:56Z","title":"Random Feature Attention","version":2},"cited_work":{"arxiv_id":"2103.02143","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2103.02143","snapshot_observed_at":"2026-07-04T12:39:50.016990Z","title":"Random feature attention.arXiv preprint arXiv:2103.02143","venue":null,"work_id":"1bd373e4-ab9a-4e64-8e88-1c304897525b","year":2021},"citing_paper":{"arxiv_id":"2603.14360","last_updated":"2026-05-13T23:29:01Z","snapshot_observed_at":"2026-08-01T09:38:25.349230Z","submitted_at":"2026-03-15T12:53:09Z","title":"M$^2$RNN: Non-Linear RNNs with Matrix-Valued States for Scalable Language Modeling","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-15T11:35:43.088803Z"},"links":{"cited_paper":"/paper/2103.02143","citing_paper":"/paper/2603.14360"},"observation_digest":"sha256:8651cd093b90a9bc9ccd827d7aa77302a09d6cc35031f74f31a51d419aff586b","observation_id":"1709028a-4e5e-4697-a44f-96e5c5909aa8","resolution":{"observed_at":"2026-05-15T11:39:59.259044Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2103.02143","last_updated":"2021-03-19T21:24:06Z","snapshot_observed_at":"2026-08-04T23:37:38.910806Z","submitted_at":"2021-03-03T02:48:56Z","title":"Random Feature Attention","version":2},"cited_work":{"arxiv_id":"2103.02143","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2103.02143","snapshot_observed_at":"2026-07-04T12:39:50.016990Z","title":"Random feature attention.arXiv preprint arXiv:2103.02143","venue":null,"work_id":"1bd373e4-ab9a-4e64-8e88-1c304897525b","year":2021},"citing_paper":{"arxiv_id":"2604.14191","last_updated":"2026-04-01T09:23:08Z","snapshot_observed_at":"2026-07-06T23:02:00.082783Z","submitted_at":"2026-04-01T09:23:08Z","title":"Attention to Mamba: A Recipe for Cross-Architecture Distillation","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-13T23:07:41.022051Z"},"links":{"cited_paper":"/paper/2103.02143","citing_paper":"/paper/2604.14191"},"observation_digest":"sha256:a13f61de63966c9d9c66623bf0f88d9b7e2afa8c3a15ffe7aa001aba8512bfa3","observation_id":"e6d84347-504f-4770-8481-2c82ada2edb6","resolution":{"observed_at":"2026-05-13T23:08:24.880040Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2103.02143","last_updated":"2021-03-19T21:24:06Z","snapshot_observed_at":"2026-08-04T23:37:38.910806Z","submitted_at":"2021-03-03T02:48:56Z","title":"Random Feature Attention","version":2},"cited_work":{"arxiv_id":"2103.02143","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2103.02143","snapshot_observed_at":"2026-07-04T12:39:50.016990Z","title":"Random feature attention.arXiv preprint arXiv:2103.02143","venue":null,"work_id":"1bd373e4-ab9a-4e64-8e88-1c304897525b","year":2021},"citing_paper":{"arxiv_id":"2605.09905","last_updated":"2026-05-11T02:48:06Z","snapshot_observed_at":"2026-07-06T23:21:54.140120Z","submitted_at":"2026-05-11T02:48:06Z","title":"Rethinking Random Transformers as Adaptive Sequence Smoothers for Sleep Staging","version":1},"reference_index":81,"source":"arxiv_source","source_observed_at":"2026-05-12T04:41:48.085125Z"},"links":{"cited_paper":"/paper/2103.02143","citing_paper":"/paper/2605.09905"},"observation_digest":"sha256:eb836510dad4fcf8db8fd6f6da26b91af518e087f6f3ed6ef9aed6b2c2dc6e51","observation_id":"ac6a2fc1-9c13-4536-92f9-ce5530d52002","resolution":{"observed_at":"2026-05-12T06:01:24.149112Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2103.02143","last_updated":"2021-03-19T21:24:06Z","snapshot_observed_at":"2026-08-04T23:37:38.910806Z","submitted_at":"2021-03-03T02:48:56Z","title":"Random Feature Attention","version":2},"cited_work":{"arxiv_id":"2103.02143","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2103.02143","snapshot_observed_at":"2026-07-04T12:39:50.016990Z","title":"Random feature attention.arXiv preprint arXiv:2103.02143","venue":null,"work_id":"1bd373e4-ab9a-4e64-8e88-1c304897525b","year":2021},"citing_paper":{"arxiv_id":"2605.12491","last_updated":"2026-05-12T17:59:26Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-05-12T17:59:26Z","title":"Elastic Attention Cores for Scalable Vision Transformers","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-05-13T06:02:40.158866Z"},"links":{"cited_paper":"/paper/2103.02143","citing_paper":"/paper/2605.12491"},"observation_digest":"sha256:15de781227fae3ff8ebefbba2f8019d7905495ede35ec9fe50b556c590bb261e","observation_id":"f5259d0a-2e5f-4856-8263-eefee22d8af7","resolution":{"observed_at":"2026-05-13T06:07:22.876757Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2103.02143","last_updated":"2021-03-19T21:24:06Z","snapshot_observed_at":"2026-08-04T23:37:38.910806Z","submitted_at":"2021-03-03T02:48:56Z","title":"Random Feature Attention","version":2},"cited_work":{"arxiv_id":"2103.02143","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2103.02143","snapshot_observed_at":"2026-07-04T12:39:50.016990Z","title":"Random feature attention.arXiv preprint arXiv:2103.02143","venue":null,"work_id":"1bd373e4-ab9a-4e64-8e88-1c304897525b","year":2021},"citing_paper":{"arxiv_id":"2605.28769","last_updated":"2026-05-27T17:26:09Z","snapshot_observed_at":"2026-07-06T23:38:19.096349Z","submitted_at":"2026-05-27T17:26:09Z","title":"Multi-Mixer Models: Flexible Sequence Modeling with Shared Representations","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-06-29T14:24:54.942194Z"},"links":{"cited_paper":"/paper/2103.02143","citing_paper":"/paper/2605.28769"},"observation_digest":"sha256:30a18c6fc04c233320ef5f46617c2f00e17738b588b41124e4df5aaf4d609e95","observation_id":"9d20a8b4-375d-4971-9044-4084fc837fc2","resolution":{"observed_at":"2026-06-29T14:33:30.785124Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2103.02143","last_updated":"2021-03-19T21:24:06Z","snapshot_observed_at":"2026-08-04T23:37:38.910806Z","submitted_at":"2021-03-03T02:48:56Z","title":"Random Feature Attention","version":2},"cited_work":{"arxiv_id":"2103.02143","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2103.02143","snapshot_observed_at":"2026-07-04T12:39:50.016990Z","title":"Random feature attention.arXiv preprint arXiv:2103.02143","venue":null,"work_id":"1bd373e4-ab9a-4e64-8e88-1c304897525b","year":2021},"citing_paper":{"arxiv_id":"2606.00746","last_updated":"2026-05-30T14:29:43Z","snapshot_observed_at":"2026-07-06T23:41:24.911421Z","submitted_at":"2026-05-30T14:29:43Z","title":"Scaling Parallel Sequence Models to Foundation-Scale Vision Encoders","version":1},"reference_index":107,"source":"arxiv_source","source_observed_at":"2026-06-28T19:23:08.100056Z"},"links":{"cited_paper":"/paper/2103.02143","citing_paper":"/paper/2606.00746"},"observation_digest":"sha256:f9475a54fee4e74b123319d40f4987e704bb384ea3fd5c502b043d8ef0495b95","observation_id":"dd0430b4-0fe0-4cdc-bc21-683598987f09","resolution":{"observed_at":"2026-06-28T19:32:35.233826Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2103.02143","last_updated":"2021-03-19T21:24:06Z","snapshot_observed_at":"2026-08-04T23:37:38.910806Z","submitted_at":"2021-03-03T02:48:56Z","title":"Random Feature Attention","version":2},"cited_work":{"arxiv_id":"2103.02143","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2103.02143","snapshot_observed_at":"2026-07-04T12:39:50.016990Z","title":"Random feature attention.arXiv preprint arXiv:2103.02143","venue":null,"work_id":"1bd373e4-ab9a-4e64-8e88-1c304897525b","year":2021},"citing_paper":{"arxiv_id":"2606.09862","last_updated":"2026-05-31T17:43:06Z","snapshot_observed_at":"2026-08-03T01:37:13.983372Z","submitted_at":"2026-05-31T17:43:06Z","title":"Blurry Window Attention","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-06-28T17:43:34.429061Z"},"links":{"cited_paper":"/paper/2103.02143","citing_paper":"/paper/2606.09862"},"observation_digest":"sha256:6ce7cd6fd3365efc8195c76a8929253f598aaa29a0519c07e1ff1a8c36de56a5","observation_id":"fca26131-b39e-4f38-a51e-e9c5487e29f5","resolution":{"observed_at":"2026-07-01T20:46:14.012497Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2103.02143","last_updated":"2021-03-19T21:24:06Z","snapshot_observed_at":"2026-08-04T23:37:38.910806Z","submitted_at":"2021-03-03T02:48:56Z","title":"Random Feature Attention","version":2},"cited_work":{"arxiv_id":"2103.02143","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2103.02143","snapshot_observed_at":"2026-07-04T12:39:50.016990Z","title":"Random feature attention.arXiv preprint arXiv:2103.02143","venue":null,"work_id":"1bd373e4-ab9a-4e64-8e88-1c304897525b","year":2021},"citing_paper":{"arxiv_id":"2606.23159","last_updated":"2026-06-22T11:02:40Z","snapshot_observed_at":"2026-08-03T14:28:32.906389Z","submitted_at":"2026-06-22T11:02:40Z","title":"General-Purpose Nonlinear Function Approximation via Linear Integrated Photonics","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-06-26T06:12:43.253235Z"},"links":{"cited_paper":"/paper/2103.02143","citing_paper":"/paper/2606.23159"},"observation_digest":"sha256:ef3526aba4b449d52ad6fe313a0b1cd3e2b0b8f9dc8a43eac96e13a26168cfbf","observation_id":"d4a862c6-363d-44a5-a5a0-db551698921f","resolution":{"observed_at":"2026-07-04T12:39:50.018405Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2103.02143/citation-record","integrity":"/paper/2103.02143/integrity","json":"/paper/2103.02143/citation-record.json","paper":"/paper/2103.02143"},"outbound":[],"paper":{"arxiv_id":"2103.02143","last_updated":"2021-03-19T21:24:06Z","latest_version":2,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-04T23:37:38.910806Z","submitted_at":"2021-03-03T02:48:56Z","title":"Random Feature Attention"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"thesis":"As of 5 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 10 inbound Pith citation observations for arXiv:2103.02143."}