{"as_of":"2026-08-18T18:17:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:bbfae83ad0947fa0e956bae2231582f46612d665c6afa123a2d6db8603fdfc56","coverage":[{"denominator":56,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":56,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T20:41:59.413605Z","state":"measured"},{"denominator":56,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":56,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-18T06:34:40.430872+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2505.12252/citation-record","integrity":"/paper/2505.12252/integrity","json":"/paper/2505.12252/citation-record.json","paper":"/paper/2505.12252"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:41:58.936962Z","title":"Neural machine translation by jointly learning to align and translate","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2505.12252","last_updated":"2025-05-18T06:16:46Z","snapshot_observed_at":"2026-08-15T20:35:21.516263Z","submitted_at":"2025-05-18T06:16:46Z","title":"SchoenbAt: Rethinking Attention with Polynomial basis","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-15T20:41:58.936962Z"},"links":{"citing_paper":"/paper/2505.12252"},"observation_digest":"sha256:cf959f6a37df4f22027d44774044a5f6e268127f973ed3dbbea4a0ebfeba07f0","observation_id":"a451df90-379b-4319-a91d-32e8abd6cb23","resolution":{"observed_at":"2026-08-15T20:41:58.936962Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:42:01.170312Z","title":"Cross-lingual language model pretraining","venue":null,"work_id":"27f781ad-4c80-4044-8acc-9239a3e91f46","year":2019},"citing_paper":{"arxiv_id":"2505.12252","last_updated":"2025-05-18T06:16:46Z","snapshot_observed_at":"2026-08-15T20:35:21.516263Z","submitted_at":"2025-05-18T06:16:46Z","title":"SchoenbAt: Rethinking Attention with Polynomial basis","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-15T20:41:58.947652Z"},"links":{"citing_paper":"/paper/2505.12252"},"observation_digest":"sha256:8e7f60a89dc9beae48908465e23e682a4dbeab5969b5d7d1094ad20476192cac","observation_id":"891b3d9e-0022-4faa-a32d-1a4b0a4ae00a","resolution":{"observed_at":"2026-08-15T20:42:01.182626Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:41:58.955393Z","title":"Switch transformers: Scaling to trillion parameter models with simple and efficient sparsity.Journal of Machine Learning Research, 23(120):1–39, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.12252","last_updated":"2025-05-18T06:16:46Z","snapshot_observed_at":"2026-08-15T20:35:21.516263Z","submitted_at":"2025-05-18T06:16:46Z","title":"SchoenbAt: Rethinking Attention with Polynomial basis","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-15T20:41:58.955393Z"},"links":{"citing_paper":"/paper/2505.12252"},"observation_digest":"sha256:20e25e28df29eb18d150abb3a24342ddcbbbb84d6cd3d519bb225b48d9350898","observation_id":"44195066-9c01-4f58-9f60-6870488e188c","resolution":{"observed_at":"2026-08-15T20:41:58.955393Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:42:01.123728Z","title":"Training language models to follow instructions with human feedback","venue":null,"work_id":"0b866043-858b-4761-8413-7dbac17e0f00","year":2022},"citing_paper":{"arxiv_id":"2505.12252","last_updated":"2025-05-18T06:16:46Z","snapshot_observed_at":"2026-08-15T20:35:21.516263Z","submitted_at":"2025-05-18T06:16:46Z","title":"SchoenbAt: Rethinking Attention with Polynomial basis","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-15T20:41:58.961646Z"},"links":{"citing_paper":"/paper/2505.12252"},"observation_digest":"sha256:7528a887ad8209f30af326feb8b70ab35e7526eece6da40d365d940909935cf2","observation_id":"3f448061-c72f-4d95-8a5b-badc5a5e1fcd","resolution":{"observed_at":"2026-08-15T20:42:01.129651Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:42:01.099595Z","title":"Dynamic perceiver for efficient visual recognition","venue":null,"work_id":"bbb9366b-00c0-45a8-bb1f-bae6145cb4ba","year":2023},"citing_paper":{"arxiv_id":"2505.12252","last_updated":"2025-05-18T06:16:46Z","snapshot_observed_at":"2026-08-15T20:35:21.516263Z","submitted_at":"2025-05-18T06:16:46Z","title":"SchoenbAt: Rethinking Attention with Polynomial basis","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-15T20:41:58.967584Z"},"links":{"citing_paper":"/paper/2505.12252"},"observation_digest":"sha256:b25088a571497ca8d5a5a11101cbf637977747d55823942b534b0bb5515cc5ba","observation_id":"299efb8a-f81c-40d7-b5d6-e9aedae152a1","resolution":{"observed_at":"2026-08-15T20:42:01.106164Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:42:01.072472Z","title":"Learning to weight samples for dynamic early-exiting networks","venue":null,"work_id":"0847996e-5260-4c4d-b81d-4d08de47ab0b","year":2022},"citing_paper":{"arxiv_id":"2505.12252","last_updated":"2025-05-18T06:16:46Z","snapshot_observed_at":"2026-08-15T20:35:21.516263Z","submitted_at":"2025-05-18T06:16:46Z","title":"SchoenbAt: Rethinking Attention with Polynomial basis","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-15T20:41:58.972961Z"},"links":{"citing_paper":"/paper/2505.12252"},"observation_digest":"sha256:e95f333e4209a46f821799e8c642e5c9fcf9e00884610c48135ae315f6020457","observation_id":"2271a6c9-8802-4483-91db-87bec503908e","resolution":{"observed_at":"2026-08-15T20:42:01.078662Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:42:01.049484Z","title":"Contrastive language-image pre- training with knowledge graphs.NeurIPS 35, 2022","venue":null,"work_id":"533e4d06-119a-41f3-81a7-6800cf20a019","year":2022},"citing_paper":{"arxiv_id":"2505.12252","last_updated":"2025-05-18T06:16:46Z","snapshot_observed_at":"2026-08-15T20:35:21.516263Z","submitted_at":"2025-05-18T06:16:46Z","title":"SchoenbAt: Rethinking Attention with Polynomial basis","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-15T20:41:58.983129Z"},"links":{"citing_paper":"/paper/2505.12252"},"observation_digest":"sha256:2076ec3aa9fe569cd4ecc16c156ff7aacd5f75c8c388b8c6b503c2531aa8b1e0","observation_id":"18ab731a-7b7b-44e7-a53c-7394a5896d9b","resolution":{"observed_at":"2026-08-15T20:42:01.056653Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:41:58.988651Z","title":"Gsva: Generalized segmentation via multimodal large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.12252","last_updated":"2025-05-18T06:16:46Z","snapshot_observed_at":"2026-08-15T20:35:21.516263Z","submitted_at":"2025-05-18T06:16:46Z","title":"SchoenbAt: Rethinking Attention with Polynomial basis","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-15T20:41:58.988651Z"},"links":{"citing_paper":"/paper/2505.12252"},"observation_digest":"sha256:e40ed8b7bbde8eaf1e77ae267bcacf943a78da5205735ad57b270514db6ec152","observation_id":"fe67d51f-4385-442c-bb7c-46af1b92f2f5","resolution":{"observed_at":"2026-08-15T20:41:58.988651Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:42:01.006883Z","title":"ResaPred: A deep residual network with self-attention to predict protein flexibility","venue":null,"work_id":"7de139a9-3766-4dc3-8209-c0153978eca0","year":2025},"citing_paper":{"arxiv_id":"2505.12252","last_updated":"2025-05-18T06:16:46Z","snapshot_observed_at":"2026-08-15T20:35:21.516263Z","submitted_at":"2025-05-18T06:16:46Z","title":"SchoenbAt: Rethinking Attention with Polynomial basis","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-15T20:41:58.996136Z"},"links":{"citing_paper":"/paper/2505.12252"},"observation_digest":"sha256:e45c2327ba3958237d2227650bad116d8b192011039b85f04d6d0c0ebf2848d0","observation_id":"b2585b4d-29d4-4c72-94aa-f0195c09c194","resolution":{"observed_at":"2026-08-15T20:42:01.012571Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:42:00.978759Z","title":"MCHAN: Prediction of human microbe- drug associations based on multiview contrastive hypergraph attention network.Current Bioinformatics, 20(1):70–86, 2025","venue":null,"work_id":"5f088e36-ce79-4f39-be8c-3f1c3418e695","year":2025},"citing_paper":{"arxiv_id":"2505.12252","last_updated":"2025-05-18T06:16:46Z","snapshot_observed_at":"2026-08-15T20:35:21.516263Z","submitted_at":"2025-05-18T06:16:46Z","title":"SchoenbAt: Rethinking Attention with Polynomial basis","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-15T20:41:59.004796Z"},"links":{"citing_paper":"/paper/2505.12252"},"observation_digest":"sha256:ec99d32a09533e203e24e7cc59f61b2962f10007386ede834ada6be2a9118364","observation_id":"df4ab51d-ec31-4989-8ac6-950879d72e44","resolution":{"observed_at":"2026-08-15T20:42:00.991503Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:42:00.946828Z","title":"Addressing scalability and managing sparsity and dropout events in single-cell representation identification with ZIGACL.Briefings in Bioinformatics, 26(1):bbae703, 2025","venue":null,"work_id":"1fafce4a-a856-4f2d-992e-e2582e0fc50a","year":2025},"citing_paper":{"arxiv_id":"2505.12252","last_updated":"2025-05-18T06:16:46Z","snapshot_observed_at":"2026-08-15T20:35:21.516263Z","submitted_at":"2025-05-18T06:16:46Z","title":"SchoenbAt: Rethinking Attention with Polynomial basis","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-15T20:41:59.011798Z"},"links":{"citing_paper":"/paper/2505.12252"},"observation_digest":"sha256:26de9617146123978feaeb9fd25b6449c2abcc4840effc2ac9d6d63470d097d1","observation_id":"89709b69-2686-4ccc-866e-15d40614e883","resolution":{"observed_at":"2026-08-15T20:42:00.953910Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:42:00.921591Z","title":"Attention is all you need","venue":null,"work_id":"0a7cb182-cca2-40a2-8733-fe65388e8662","year":2017},"citing_paper":{"arxiv_id":"2505.12252","last_updated":"2025-05-18T06:16:46Z","snapshot_observed_at":"2026-08-15T20:35:21.516263Z","submitted_at":"2025-05-18T06:16:46Z","title":"SchoenbAt: Rethinking Attention with Polynomial basis","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-15T20:41:59.023978Z"},"links":{"citing_paper":"/paper/2505.12252"},"observation_digest":"sha256:df262a6396a34a4354dc2c5d251adaaf5d8008a8471756adcb195c64a53b9e04","observation_id":"002d93e5-b2ea-4427-b4b7-cfe5bb86b173","resolution":{"observed_at":"2026-08-15T20:42:00.927253Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:42:00.901988Z","title":"A brief overview of ChatGPT: The history, status quo and potential future development.IEEE/CAA Journal of Automatica Sinica, 10(5):1122–1136, 2023","venue":null,"work_id":"3feb4927-3f87-4654-bfdd-5111fe41fd39","year":2023},"citing_paper":{"arxiv_id":"2505.12252","last_updated":"2025-05-18T06:16:46Z","snapshot_observed_at":"2026-08-15T20:35:21.516263Z","submitted_at":"2025-05-18T06:16:46Z","title":"SchoenbAt: Rethinking Attention with Polynomial basis","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-15T20:41:59.032509Z"},"links":{"citing_paper":"/paper/2505.12252"},"observation_digest":"sha256:4d7b16872f969f507a54b0c757ff5aaf89a5a1321f5c3b156aec5b985a568950","observation_id":"93ddd025-9fa0-4ae3-b232-dcc1a245de55","resolution":{"observed_at":"2026-08-15T20:42:00.907798Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.19437","last_updated":"2025-02-18T17:26:38Z","snapshot_observed_at":"2026-08-15T17:27:11.980940Z","submitted_at":"2024-12-27T04:03:16Z","title":"DeepSeek-V3 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.19437","snapshot_observed_at":"2026-08-15T20:41:59.052473Z","title":"Deepseek-v3 technical report.arXiv:2412.19437, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.12252","last_updated":"2025-05-18T06:16:46Z","snapshot_observed_at":"2026-08-15T20:35:21.516263Z","submitted_at":"2025-05-18T06:16:46Z","title":"SchoenbAt: Rethinking Attention with Polynomial basis","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-15T20:41:59.052473Z"},"links":{"cited_paper":"/paper/2412.19437","citing_paper":"/paper/2505.12252"},"observation_digest":"sha256:25b43340861c2163cdcf0191160a614fe22c89028e771a83993fcf96d6bc7bff","observation_id":"e312b790-5829-496f-8de5-2179a4e4ee42","resolution":{"observed_at":"2026-08-15T20:41:59.052473Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15115","last_updated":"2025-01-03T02:18:21Z","snapshot_observed_at":"2026-08-17T18:50:07.059564Z","submitted_at":"2024-12-19T17:56:09Z","title":"Qwen2.5 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.15115","snapshot_observed_at":"2026-08-15T20:41:59.062051Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.12252","last_updated":"2025-05-18T06:16:46Z","snapshot_observed_at":"2026-08-15T20:35:21.516263Z","submitted_at":"2025-05-18T06:16:46Z","title":"SchoenbAt: Rethinking Attention with Polynomial basis","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-15T20:41:59.062051Z"},"links":{"cited_paper":"/paper/2412.15115","citing_paper":"/paper/2505.12252"},"observation_digest":"sha256:1892ace7553e2a8aafc75569cfe6521d838483cf90784d0eee70d92371db5a56","observation_id":"2e92d150-9f6c-4b6a-a096-c1ff539dbd7e","resolution":{"observed_at":"2026-08-15T20:41:59.062051Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:42:00.882977Z","title":"Transformers are Rnns: fast autoregressive transformers with linear attention","venue":null,"work_id":"3f6b4acd-96bd-4e94-9197-884ff472a37f","year":2020},"citing_paper":{"arxiv_id":"2505.12252","last_updated":"2025-05-18T06:16:46Z","snapshot_observed_at":"2026-08-15T20:35:21.516263Z","submitted_at":"2025-05-18T06:16:46Z","title":"SchoenbAt: Rethinking Attention with Polynomial basis","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-15T20:41:59.067910Z"},"links":{"citing_paper":"/paper/2505.12252"},"observation_digest":"sha256:b87ae24742edbfb1f942f7bc4a6f2b1e37537de7d955a282c27feddb984022ab","observation_id":"c43513b6-50a4-4749-b8b4-1b929fdab06a","resolution":{"observed_at":"2026-08-15T20:42:00.888367Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:42:00.860357Z","title":"Transformer dissection: An unified understanding for transformer‘s attention via the lens of kernel","venue":null,"work_id":"d81cb037-c28e-40d0-948c-04e4aaf41fec","year":2019},"citing_paper":{"arxiv_id":"2505.12252","last_updated":"2025-05-18T06:16:46Z","snapshot_observed_at":"2026-08-15T20:35:21.516263Z","submitted_at":"2025-05-18T06:16:46Z","title":"SchoenbAt: Rethinking Attention with Polynomial basis","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-15T20:41:59.073059Z"},"links":{"citing_paper":"/paper/2505.12252"},"observation_digest":"sha256:3dde082f23a365da203aebf97f31e0ba4f56e72a42bcf0d9d6dcdc06527cc6ac","observation_id":"d69ef8cf-5b1f-41e9-9e1f-c93bf171836c","resolution":{"observed_at":"2026-08-15T20:42:00.866802Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2006.04768","last_updated":"2020-06-14T08:15:54Z","snapshot_observed_at":"2026-07-06T09:27:03.809621Z","submitted_at":"2020-06-08T17:37:52Z","title":"Linformer: Self-Attention with Linear Complexity","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2006.04768","snapshot_observed_at":"2026-08-15T20:41:59.080371Z","title":"Li, Madian Khabsa, Han Fang, and Hao Ma","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2505.12252","last_updated":"2025-05-18T06:16:46Z","snapshot_observed_at":"2026-08-15T20:35:21.516263Z","submitted_at":"2025-05-18T06:16:46Z","title":"SchoenbAt: Rethinking Attention with Polynomial basis","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-15T20:41:59.080371Z"},"links":{"cited_paper":"/paper/2006.04768","citing_paper":"/paper/2505.12252"},"observation_digest":"sha256:4e4b6f0d61fe3b2487842945029ac3f56fcddf836048e07dde0c88f711dd67a0","observation_id":"ef8172c6-c765-497f-9fa1-1113e83ccd33","resolution":{"observed_at":"2026-08-15T20:41:59.080371Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:41:59.092688Z","title":"Nyströmformer: A nyström-based algorithm for approximating self-attention","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.12252","last_updated":"2025-05-18T06:16:46Z","snapshot_observed_at":"2026-08-15T20:35:21.516263Z","submitted_at":"2025-05-18T06:16:46Z","title":"SchoenbAt: Rethinking Attention with Polynomial basis","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-15T20:41:59.092688Z"},"links":{"citing_paper":"/paper/2505.12252"},"observation_digest":"sha256:84d93bf87396d42697a3ff48aaacdfbdbeee0079a014849d3362a91c1011cec5","observation_id":"90db95bd-b5f3-48d7-b604-ae0c7cc31070","resolution":{"observed_at":"2026-08-15T20:41:59.092688Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:42:00.808919Z","title":"Skyformer: Remodel self-attention with gaussian kernel and Nyström method","venue":null,"work_id":"9965774e-0cd1-4c61-a3fa-69dc3c044ef0","year":2021},"citing_paper":{"arxiv_id":"2505.12252","last_updated":"2025-05-18T06:16:46Z","snapshot_observed_at":"2026-08-15T20:35:21.516263Z","submitted_at":"2025-05-18T06:16:46Z","title":"SchoenbAt: Rethinking Attention with Polynomial basis","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-15T20:41:59.101578Z"},"links":{"citing_paper":"/paper/2505.12252"},"observation_digest":"sha256:33512ffbea5a05722972991f42c02a32436b2b2e73a9584b87c02b91fa25bdb3","observation_id":"1870d000-f2f5-4833-890c-6619f4cad313","resolution":{"observed_at":"2026-08-15T20:42:00.824103Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:42:00.784671Z","title":"Primal-attention: Self-attention through asymmetric kernel svd in primal representation","venue":null,"work_id":"de5156e1-e9b0-43a7-92c5-dbe57512b707","year":2024},"citing_paper":{"arxiv_id":"2505.12252","last_updated":"2025-05-18T06:16:46Z","snapshot_observed_at":"2026-08-15T20:35:21.516263Z","submitted_at":"2025-05-18T06:16:46Z","title":"SchoenbAt: Rethinking Attention with Polynomial basis","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-15T20:41:59.108080Z"},"links":{"citing_paper":"/paper/2505.12252"},"observation_digest":"sha256:dc51afc22f05a87a91ce715be6a476f8370a6d31cce13575f8ee0efd039a58fe","observation_id":"cb6de7a4-008e-4389-ab87-f23ffabeefa9","resolution":{"observed_at":"2026-08-15T20:42:00.793031Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:42:00.756574Z","title":"Large-kernel attention for 3D medical image segmentation.Cognitive Computation, 16(4):2063–2077, 2024","venue":null,"work_id":"eebcfa57-a2d1-46da-8891-fd348e95e976","year":2024},"citing_paper":{"arxiv_id":"2505.12252","last_updated":"2025-05-18T06:16:46Z","snapshot_observed_at":"2026-08-15T20:35:21.516263Z","submitted_at":"2025-05-18T06:16:46Z","title":"SchoenbAt: Rethinking Attention with Polynomial basis","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-15T20:41:59.115540Z"},"links":{"citing_paper":"/paper/2505.12252"},"observation_digest":"sha256:b467b2fc03c421698b01323171f0c0b12783f8f6eca90974bd40287785665c2b","observation_id":"4cfe2420-d57d-4fc8-8e09-60e89b7cac37","resolution":{"observed_at":"2026-08-15T20:42:00.767028Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:42:00.733169Z","title":"Large kernel spectral and spatial attention networks for hyperspectral image classification.IEEE Transactions on Geoscience and Remote Sensing, 61:1–15, 2023","venue":null,"work_id":"502013d8-27f3-44e6-8991-db9a978ca3ce","year":2023},"citing_paper":{"arxiv_id":"2505.12252","last_updated":"2025-05-18T06:16:46Z","snapshot_observed_at":"2026-08-15T20:35:21.516263Z","submitted_at":"2025-05-18T06:16:46Z","title":"SchoenbAt: Rethinking Attention with Polynomial basis","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-15T20:41:59.122845Z"},"links":{"citing_paper":"/paper/2505.12252"},"observation_digest":"sha256:db5384bf1786bac750965fddb155d6132e153bc54c0ca0dab65c4cb127bfccf9","observation_id":"2e872adf-9a76-4a0e-bc03-9935a64690da","resolution":{"observed_at":"2026-08-15T20:42:00.740310Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:42:00.706461Z","title":"Interscience Publishers, 1962","venue":null,"work_id":"dba744f4-4f28-464a-9f31-3f27fa65423b","year":1962},"citing_paper":{"arxiv_id":"2505.12252","last_updated":"2025-05-18T06:16:46Z","snapshot_observed_at":"2026-08-15T20:35:21.516263Z","submitted_at":"2025-05-18T06:16:46Z","title":"SchoenbAt: Rethinking Attention with Polynomial basis","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-15T20:41:59.129405Z"},"links":{"citing_paper":"/paper/2505.12252"},"observation_digest":"sha256:800f62837a6aa0d26c921f4161ad241e777703f0ca45a120e3e7cba59682f1d1","observation_id":"beb22dca-f76a-4dc4-b524-2ab03cfe66c5","resolution":{"observed_at":"2026-08-15T20:42:00.718683Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:42:00.666996Z","title":"Random features for large-scale kernel machines.NeurIPS 20, 2007","venue":null,"work_id":"4c01c01f-ab8c-4fb5-bfc8-510e32611131","year":2007},"citing_paper":{"arxiv_id":"2505.12252","last_updated":"2025-05-18T06:16:46Z","snapshot_observed_at":"2026-08-15T20:35:21.516263Z","submitted_at":"2025-05-18T06:16:46Z","title":"SchoenbAt: Rethinking Attention with Polynomial basis","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-15T20:41:59.136028Z"},"links":{"citing_paper":"/paper/2505.12252"},"observation_digest":"sha256:d7a8da395fb2f723d15a8045ec99ec6fe60ff224c35dee75903e23762fe3b4c8","observation_id":"6d99fe29-fed0-402b-9c92-bfa3cfaa2ee9","resolution":{"observed_at":"2026-08-15T20:42:00.674121Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:42:00.638968Z","title":"Learning with SGD and random features","venue":null,"work_id":"0be1137a-240e-45fa-b3ef-dac4c6a0ded7","year":2018},"citing_paper":{"arxiv_id":"2505.12252","last_updated":"2025-05-18T06:16:46Z","snapshot_observed_at":"2026-08-15T20:35:21.516263Z","submitted_at":"2025-05-18T06:16:46Z","title":"SchoenbAt: Rethinking Attention with Polynomial basis","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-15T20:41:59.144466Z"},"links":{"citing_paper":"/paper/2505.12252"},"observation_digest":"sha256:b341ea0d0ff8afa2f59aba2264fd8afa6e8ed5e9a430454cb343f4481bbda698","observation_id":"7874cc0c-906e-4af3-8c3a-a76e189c87f3","resolution":{"observed_at":"2026-08-15T20:42:00.648462Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:42:00.610467Z","title":"Local random feature approximations of the Gaussian kernel","venue":null,"work_id":"2aae34a3-030a-405e-beeb-68de572497fb","year":2022},"citing_paper":{"arxiv_id":"2505.12252","last_updated":"2025-05-18T06:16:46Z","snapshot_observed_at":"2026-08-15T20:35:21.516263Z","submitted_at":"2025-05-18T06:16:46Z","title":"SchoenbAt: Rethinking Attention with Polynomial basis","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-15T20:41:59.153754Z"},"links":{"citing_paper":"/paper/2505.12252"},"observation_digest":"sha256:7bd66ef16f063fe962c802eb9126e346e4adb1d1e1ac4077e91430b892e55890","observation_id":"9b75e08d-67ff-4d87-b5bc-9870c02d6948","resolution":{"observed_at":"2026-08-15T20:42:00.616340Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:41:59.161168Z","title":"New random projections for isotropic kernels using stable spectral distributions.arXiv:2411.02770, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.12252","last_updated":"2025-05-18T06:16:46Z","snapshot_observed_at":"2026-08-15T20:35:21.516263Z","submitted_at":"2025-05-18T06:16:46Z","title":"SchoenbAt: Rethinking Attention with Polynomial basis","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-15T20:41:59.161168Z"},"links":{"citing_paper":"/paper/2505.12252"},"observation_digest":"sha256:fea842815d8a987542208c98b3c845eae3822cb0a4be5394461fa007e301781f","observation_id":"80c5a9fa-79c1-4099-9ed4-0f0652479112","resolution":{"observed_at":"2026-08-15T20:41:59.161168Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:42:00.584309Z","title":"Random feature maps for the itemset kernel","venue":null,"work_id":"10e19ec8-f8fe-4bb5-b3cb-ead5bab0de88","year":2019},"citing_paper":{"arxiv_id":"2505.12252","last_updated":"2025-05-18T06:16:46Z","snapshot_observed_at":"2026-08-15T20:35:21.516263Z","submitted_at":"2025-05-18T06:16:46Z","title":"SchoenbAt: Rethinking Attention with Polynomial basis","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-15T20:41:59.170577Z"},"links":{"citing_paper":"/paper/2505.12252"},"observation_digest":"sha256:3013f86929275297b116f375451f4fae913522ae14c4007f8fa79f3c2f372648","observation_id":"fe861e8f-cc83-4d3e-a9ba-2fd9c4e57fb2","resolution":{"observed_at":"2026-08-15T20:42:00.592464Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1109.4603","last_updated":"2011-09-21T18:11:05Z","snapshot_observed_at":"2026-08-15T04:34:37.645873Z","submitted_at":"2011-09-21T18:11:05Z","title":"Explicit Approximations of the Gaussian Kernel","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1109.4603","snapshot_observed_at":"2026-08-15T20:41:59.181953Z","title":"Explicit approximations of the Gaussian kernel","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2505.12252","last_updated":"2025-05-18T06:16:46Z","snapshot_observed_at":"2026-08-15T20:35:21.516263Z","submitted_at":"2025-05-18T06:16:46Z","title":"SchoenbAt: Rethinking Attention with Polynomial basis","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-15T20:41:59.181953Z"},"links":{"cited_paper":"/paper/1109.4603","citing_paper":"/paper/2505.12252"},"observation_digest":"sha256:9fd04233c2267494f3bbd802f817dfe4e948ee0468b41805a0f0b88f016f7af4","observation_id":"261c71d1-4af2-4a53-9486-c65f3af1b9e3","resolution":{"observed_at":"2026-08-15T20:41:59.181953Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:42:00.558639Z","title":"Random feature attention","venue":null,"work_id":"a015b244-0086-4898-acec-fc6ef69a332b","year":2021},"citing_paper":{"arxiv_id":"2505.12252","last_updated":"2025-05-18T06:16:46Z","snapshot_observed_at":"2026-08-15T20:35:21.516263Z","submitted_at":"2025-05-18T06:16:46Z","title":"SchoenbAt: Rethinking Attention with Polynomial basis","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-15T20:41:59.194157Z"},"links":{"citing_paper":"/paper/2505.12252"},"observation_digest":"sha256:bb35f89cb865459e695af3453be8a9dad1ad14f0e153a6e9ef9720064b10848c","observation_id":"779411db-657f-4e46-92e1-8f93d2c633b6","resolution":{"observed_at":"2026-08-15T20:42:00.565170Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:41:59.204180Z","title":"Rethinking attention with performers","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.12252","last_updated":"2025-05-18T06:16:46Z","snapshot_observed_at":"2026-08-15T20:35:21.516263Z","submitted_at":"2025-05-18T06:16:46Z","title":"SchoenbAt: Rethinking Attention with Polynomial basis","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-15T20:41:59.204180Z"},"links":{"citing_paper":"/paper/2505.12252"},"observation_digest":"sha256:cf1818d1bcdb95a3f9d18d1f41a9045ffa8e9b49fd913fd1d0e1c67c5093e2f0","observation_id":"a8d8c44f-d005-42d0-970e-e812faf042fd","resolution":{"observed_at":"2026-08-15T20:41:59.204180Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.19468","last_updated":"2026-06-19T09:53:31Z","snapshot_observed_at":"2026-08-16T22:59:06.190040Z","submitted_at":"2024-11-29T04:38:12Z","title":"Learning Expressive Random Feature Models via Parametrized Activations","version":4},"cited_work":{"arxiv_id":"2411.19468","doi":null,"metadata_source":"pith","pith_arxiv_id":"2411.19468","snapshot_observed_at":"2026-08-15T20:41:59.642580Z","title":"Learning Expressive Random Feature Models via Parametrized Activations","venue":"cs.LG","work_id":"010437be-2267-4cfc-bc97-d5fdbfb04776","year":2024},"citing_paper":{"arxiv_id":"2505.12252","last_updated":"2025-05-18T06:16:46Z","snapshot_observed_at":"2026-08-15T20:35:21.516263Z","submitted_at":"2025-05-18T06:16:46Z","title":"SchoenbAt: Rethinking Attention with Polynomial basis","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-15T20:41:59.213577Z"},"links":{"cited_paper":"/paper/2411.19468","citing_paper":"/paper/2505.12252"},"observation_digest":"sha256:c2be59dbf96a35d2b0db95226dee31bbe27cd3acf81b36d1b3a0e921236e27ce","observation_id":"b8cf9eaf-4b57-4f89-b454-4814bee2237c","resolution":{"observed_at":"2026-08-15T20:41:59.655815Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:42:00.515585Z","title":"Random maclaurin feature-based fuzzy clustering","venue":null,"work_id":"f64dee82-bfac-475d-bd73-01885d464b2b","year":2020},"citing_paper":{"arxiv_id":"2505.12252","last_updated":"2025-05-18T06:16:46Z","snapshot_observed_at":"2026-08-15T20:35:21.516263Z","submitted_at":"2025-05-18T06:16:46Z","title":"SchoenbAt: Rethinking Attention with Polynomial basis","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-15T20:41:59.221229Z"},"links":{"citing_paper":"/paper/2505.12252"},"observation_digest":"sha256:ea37d91f4407cb386ca6f870e8495b2f3e9cd8c388a1a3c7db68937bfde783ce","observation_id":"20281c9b-6603-4017-81ab-1c5a2c03e1b3","resolution":{"observed_at":"2026-08-15T20:42:00.523945Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:42:00.490829Z","title":"Learning dot-product polynomials for multiclass problems","venue":null,"work_id":"0d1f210c-6675-4572-a3f9-d88fbdce0b16","year":2017},"citing_paper":{"arxiv_id":"2505.12252","last_updated":"2025-05-18T06:16:46Z","snapshot_observed_at":"2026-08-15T20:35:21.516263Z","submitted_at":"2025-05-18T06:16:46Z","title":"SchoenbAt: Rethinking Attention with Polynomial basis","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-15T20:41:59.230135Z"},"links":{"citing_paper":"/paper/2505.12252"},"observation_digest":"sha256:0864b06a246af9cb62563f095a83b80add1010116d0cecae1e7fa75406668f8e","observation_id":"088ead41-4f30-485a-8b29-cb46d1c111ec","resolution":{"observed_at":"2026-08-15T20:42:00.497380Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2405.15310","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:41:59.594726Z","title":null,"venue":null,"work_id":"74308f8f-5fc0-4804-9d07-774cb01b19b7","year":2024},"citing_paper":{"arxiv_id":"2505.12252","last_updated":"2025-05-18T06:16:46Z","snapshot_observed_at":"2026-08-15T20:35:21.516263Z","submitted_at":"2025-05-18T06:16:46Z","title":"SchoenbAt: Rethinking Attention with Polynomial basis","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-15T20:41:59.238411Z"},"links":{"citing_paper":"/paper/2505.12252"},"observation_digest":"sha256:4f4476f8bd4bb3b822f561b3e4df786bd9480e4956b04594fe243412c8280c32","observation_id":"0a757518-a59e-4a21-9d3b-e07ad3d24e6e","resolution":{"observed_at":"2026-08-15T20:41:59.607146Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:42:00.464509Z","title":"Positive definite functions on spheres.Duke Mathematical Journal, 9(1):96–108, 1942","venue":null,"work_id":"ccf0c000-85d2-4270-bda8-cc581527d24b","year":1942},"citing_paper":{"arxiv_id":"2505.12252","last_updated":"2025-05-18T06:16:46Z","snapshot_observed_at":"2026-08-15T20:35:21.516263Z","submitted_at":"2025-05-18T06:16:46Z","title":"SchoenbAt: Rethinking Attention with Polynomial basis","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-15T20:41:59.245800Z"},"links":{"citing_paper":"/paper/2505.12252"},"observation_digest":"sha256:5726047000835f88fd02c214bbe035abfdf263ea03bf5bdb391e4f48d9598347","observation_id":"92a90440-c814-4977-ae61-b025a30f6b37","resolution":{"observed_at":"2026-08-15T20:42:00.472794Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:42:00.441233Z","title":"Functions of positive and negative type, and their connection with the theory of integral equations.Philosophical Transactions of the Royal Society A, 209:415–446, 1909","venue":null,"work_id":"6885f75f-5edc-4750-bb01-26853b40d579","year":1909},"citing_paper":{"arxiv_id":"2505.12252","last_updated":"2025-05-18T06:16:46Z","snapshot_observed_at":"2026-08-15T20:35:21.516263Z","submitted_at":"2025-05-18T06:16:46Z","title":"SchoenbAt: Rethinking Attention with Polynomial basis","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-15T20:41:59.253646Z"},"links":{"citing_paper":"/paper/2505.12252"},"observation_digest":"sha256:b8378fdb4a7f295c5e3d0894e8862e4e93a67dc222aff59735dac6c31d88643c","observation_id":"89aed372-8bef-484b-b417-922bca5b7c73","resolution":{"observed_at":"2026-08-15T20:42:00.447516Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:42:00.419081Z","title":"Random feature maps for dot product kernels","venue":null,"work_id":"a0a53289-e6d9-4806-8750-cf14e0b9c2bd","year":2012},"citing_paper":{"arxiv_id":"2505.12252","last_updated":"2025-05-18T06:16:46Z","snapshot_observed_at":"2026-08-15T20:35:21.516263Z","submitted_at":"2025-05-18T06:16:46Z","title":"SchoenbAt: Rethinking Attention with Polynomial basis","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-15T20:41:59.261745Z"},"links":{"citing_paper":"/paper/2505.12252"},"observation_digest":"sha256:500f5c001e95e4843085140b72eb33e5eb15c4d60d9a0fb6ab8ea960141e56c1","observation_id":"55ffde62-d332-4be7-a505-249115280987","resolution":{"observed_at":"2026-08-15T20:42:00.424531Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:42:00.390432Z","title":"Batch normalization: accelerating deep network training by reducing internal covariate shift","venue":null,"work_id":"9cce3ee5-d489-4fbd-bf83-2a730d626fb9","year":2015},"citing_paper":{"arxiv_id":"2505.12252","last_updated":"2025-05-18T06:16:46Z","snapshot_observed_at":"2026-08-15T20:35:21.516263Z","submitted_at":"2025-05-18T06:16:46Z","title":"SchoenbAt: Rethinking Attention with Polynomial basis","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-15T20:41:59.269954Z"},"links":{"citing_paper":"/paper/2505.12252"},"observation_digest":"sha256:8c7720cb292a8eea990c67546289ea168c3d8bb6f0ecf2cd503a4e52b7e132ec","observation_id":"a3103237-51ae-4025-9b5c-0112d8e2b255","resolution":{"observed_at":"2026-08-15T20:42:00.403101Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:42:00.354507Z","title":"Long range arena : A benchmark for efficient transformers","venue":null,"work_id":"e92ad83a-b5fd-489b-a80a-30df6e8afc3f","year":2021},"citing_paper":{"arxiv_id":"2505.12252","last_updated":"2025-05-18T06:16:46Z","snapshot_observed_at":"2026-08-15T20:35:21.516263Z","submitted_at":"2025-05-18T06:16:46Z","title":"SchoenbAt: Rethinking Attention with Polynomial basis","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-15T20:41:59.282998Z"},"links":{"citing_paper":"/paper/2505.12252"},"observation_digest":"sha256:f3831da7ecd5dba31f588715e33719fc6f03b81c4ca54c20fc1415df717ba422","observation_id":"73ec74d4-90d3-4530-943d-b4594800a385","resolution":{"observed_at":"2026-08-15T20:42:00.366251Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:42:00.328232Z","title":"Maas, Raymond E","venue":null,"work_id":"942ad3b5-7240-427f-ba05-0c40dbfccad4","year":2011},"citing_paper":{"arxiv_id":"2505.12252","last_updated":"2025-05-18T06:16:46Z","snapshot_observed_at":"2026-08-15T20:35:21.516263Z","submitted_at":"2025-05-18T06:16:46Z","title":"SchoenbAt: Rethinking Attention with Polynomial basis","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-15T20:41:59.293919Z"},"links":{"citing_paper":"/paper/2505.12252"},"observation_digest":"sha256:253d4638045fba77875cc1e75bab4e0a1b22cb294c4d4751dc813576ac53ccde","observation_id":"a5b33cb3-ced1-423b-9b0f-9bf82bba3831","resolution":{"observed_at":"2026-08-15T20:42:00.335034Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:42:00.302115Z","title":"ListOps: A diagnostic dataset for latent tree learning","venue":null,"work_id":"491e466e-5137-489e-9535-780aee355992","year":2018},"citing_paper":{"arxiv_id":"2505.12252","last_updated":"2025-05-18T06:16:46Z","snapshot_observed_at":"2026-08-15T20:35:21.516263Z","submitted_at":"2025-05-18T06:16:46Z","title":"SchoenbAt: Rethinking Attention with Polynomial basis","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-15T20:41:59.303097Z"},"links":{"citing_paper":"/paper/2505.12252"},"observation_digest":"sha256:5edc1dfd472e96ab199f58ddd23d6782df3c2fa53e7bafc8530d5f27bfb92fae","observation_id":"ed0ef5d4-f11e-451d-b594-23add7b2cb45","resolution":{"observed_at":"2026-08-15T20:42:00.309320Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:42:00.273057Z","title":"Radev, Pradeep Muthukrishnan, and Vahed Qazvinian","venue":null,"work_id":"80b51d69-355e-4805-ba16-4e71eaf7eff5","year":2009},"citing_paper":{"arxiv_id":"2505.12252","last_updated":"2025-05-18T06:16:46Z","snapshot_observed_at":"2026-08-15T20:35:21.516263Z","submitted_at":"2025-05-18T06:16:46Z","title":"SchoenbAt: Rethinking Attention with Polynomial basis","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-15T20:41:59.308442Z"},"links":{"citing_paper":"/paper/2505.12252"},"observation_digest":"sha256:6c6cf08d75da788077d83b115c520b3f250b132dec426ffe6416551401d708b0","observation_id":"0a744a1d-7629-4cdc-9ced-961216b679d2","resolution":{"observed_at":"2026-08-15T20:42:00.283544Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:42:00.251789Z","title":"Houtkamp and P","venue":null,"work_id":"49cf0d80-149a-4ac8-8fff-1e893920d49a","year":2010},"citing_paper":{"arxiv_id":"2505.12252","last_updated":"2025-05-18T06:16:46Z","snapshot_observed_at":"2026-08-15T20:35:21.516263Z","submitted_at":"2025-05-18T06:16:46Z","title":"SchoenbAt: Rethinking Attention with Polynomial basis","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-15T20:41:59.314682Z"},"links":{"citing_paper":"/paper/2505.12252"},"observation_digest":"sha256:ce1b86e2a490530bddb991de212f5324de9d3c1898eac15608eba59dc11d3f0b","observation_id":"6d62ec5d-cd2d-4515-979f-69680d114881","resolution":{"observed_at":"2026-08-15T20:42:00.259411Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:41:59.323089Z","title":"Learning multiple layers of features from tiny images","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2505.12252","last_updated":"2025-05-18T06:16:46Z","snapshot_observed_at":"2026-08-15T20:35:21.516263Z","submitted_at":"2025-05-18T06:16:46Z","title":"SchoenbAt: Rethinking Attention with Polynomial basis","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-15T20:41:59.323089Z"},"links":{"citing_paper":"/paper/2505.12252"},"observation_digest":"sha256:3197fc7d42bd8b7d51edf904f8770489d29913ff6995f9d92aa2a178d80344c7","observation_id":"933b85e6-ece4-419a-9494-3b6e15badf51","resolution":{"observed_at":"2026-08-15T20:41:59.323089Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:42:00.196011Z","title":"Softmax-free linear transformers.International Journal of Computer Vision, 132(8):3355–3374, 2024","venue":null,"work_id":"bd4f40ae-ab9a-4f55-9fd0-d88687087553","year":2024},"citing_paper":{"arxiv_id":"2505.12252","last_updated":"2025-05-18T06:16:46Z","snapshot_observed_at":"2026-08-15T20:35:21.516263Z","submitted_at":"2025-05-18T06:16:46Z","title":"SchoenbAt: Rethinking Attention with Polynomial basis","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-15T20:41:59.329757Z"},"links":{"citing_paper":"/paper/2505.12252"},"observation_digest":"sha256:04a8d9c25f5e2ca48339e58d0cda77f7b1232fa4077b7305a0ee80bff401ca8f","observation_id":"cae22f7c-2a14-444c-a1a5-56226a9a35aa","resolution":{"observed_at":"2026-08-15T20:42:00.203414Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:42:00.160590Z","title":"Informer: Beyond efficient transformer for long sequence time-series forecasting","venue":null,"work_id":"195b62c3-dfc0-42d2-ad60-ee7c4e242bb6","year":2020},"citing_paper":{"arxiv_id":"2505.12252","last_updated":"2025-05-18T06:16:46Z","snapshot_observed_at":"2026-08-15T20:35:21.516263Z","submitted_at":"2025-05-18T06:16:46Z","title":"SchoenbAt: Rethinking Attention with Polynomial basis","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-15T20:41:59.337509Z"},"links":{"citing_paper":"/paper/2505.12252"},"observation_digest":"sha256:f8bd1f19af34a9a2f35a86ae04aa686ff3df0ca638baa7a1e578f20289ecc581","observation_id":"3a22770e-3d54-4f08-9992-9c0133212f5d","resolution":{"observed_at":"2026-08-15T20:42:00.170356Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:42:00.122614Z","title":"CMAC neural network as an SVM with B-spline kernel functions","venue":null,"work_id":"5391a347-532c-41e5-940f-b695704c9630","year":2003},"citing_paper":{"arxiv_id":"2505.12252","last_updated":"2025-05-18T06:16:46Z","snapshot_observed_at":"2026-08-15T20:35:21.516263Z","submitted_at":"2025-05-18T06:16:46Z","title":"SchoenbAt: Rethinking Attention with Polynomial basis","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-15T20:41:59.347356Z"},"links":{"citing_paper":"/paper/2505.12252"},"observation_digest":"sha256:fb67c5f9af069edda515c15057f23e08db490f80e43ca6838c4a825382ef722a","observation_id":"d5405bf4-3646-4eea-b227-23428297c88f","resolution":{"observed_at":"2026-08-15T20:42:00.134581Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:42:00.096524Z","title":"Kernel methods for deep learning","venue":null,"work_id":"488be68e-a598-4681-935b-60d7a4dbc1e4","year":2009},"citing_paper":{"arxiv_id":"2505.12252","last_updated":"2025-05-18T06:16:46Z","snapshot_observed_at":"2026-08-15T20:35:21.516263Z","submitted_at":"2025-05-18T06:16:46Z","title":"SchoenbAt: Rethinking Attention with Polynomial basis","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-15T20:41:59.354342Z"},"links":{"citing_paper":"/paper/2505.12252"},"observation_digest":"sha256:c759d86b6d5a905860689e1cf84fc37a8e6fbdb4c1628877b712bc2a4c0c15e1","observation_id":"16836c42-bb3e-4a33-85d1-916c2c3fff3f","resolution":{"observed_at":"2026-08-15T20:42:00.105125Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:42:00.064916Z","title":"Wavelet support vector machine.IEEE Transactions on Systems, Man, and Cybernetics, 34(1):34–39, 2004","venue":null,"work_id":"a826b47f-ec9e-4bd4-b3ac-504f4831f2f5","year":2004},"citing_paper":{"arxiv_id":"2505.12252","last_updated":"2025-05-18T06:16:46Z","snapshot_observed_at":"2026-08-15T20:35:21.516263Z","submitted_at":"2025-05-18T06:16:46Z","title":"SchoenbAt: Rethinking Attention with Polynomial basis","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-15T20:41:59.363023Z"},"links":{"citing_paper":"/paper/2505.12252"},"observation_digest":"sha256:b028f74d984f345af4cbea2b193c8effe9f94c4107e83bfc32e2bc9f1380fd42","observation_id":"2b852b2d-cfec-4ae0-bc8f-6241e7436953","resolution":{"observed_at":"2026-08-15T20:42:00.072825Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:42:00.034008Z","title":"An explicit description of the reproducing kernel Hilbert spaces of Gaussian RBF kernels.IEEE Transactions on Information Theory, 52(10):4635–4643, 2006","venue":null,"work_id":"fe2e59ff-7e70-4aa3-8a38-f022468dd0f3","year":2006},"citing_paper":{"arxiv_id":"2505.12252","last_updated":"2025-05-18T06:16:46Z","snapshot_observed_at":"2026-08-15T20:35:21.516263Z","submitted_at":"2025-05-18T06:16:46Z","title":"SchoenbAt: Rethinking Attention with Polynomial basis","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-15T20:41:59.372297Z"},"links":{"citing_paper":"/paper/2505.12252"},"observation_digest":"sha256:a53c4e6e33cd9562da5bd26ff35a612f3cb7da24ac6431b83a7476b11bcf0e4a","observation_id":"dcd03bbd-97ff-4009-a762-7b8e0e9194f2","resolution":{"observed_at":"2026-08-15T20:42:00.043171Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:42:00.009701Z","title":"Multi30K: Multilingual English-German image descriptions","venue":null,"work_id":"4f524f63-95c5-4f73-8d7d-f6137ec89766","year":2016},"citing_paper":{"arxiv_id":"2505.12252","last_updated":"2025-05-18T06:16:46Z","snapshot_observed_at":"2026-08-15T20:35:21.516263Z","submitted_at":"2025-05-18T06:16:46Z","title":"SchoenbAt: Rethinking Attention with Polynomial basis","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-15T20:41:59.382669Z"},"links":{"citing_paper":"/paper/2505.12252"},"observation_digest":"sha256:744ae97ef40241a0841bf738cfcd2f8a38c79858f0a11c36f9c069f7a37b14fc","observation_id":"c64d06a9-45e5-41dd-88b2-00547512a989","resolution":{"observed_at":"2026-08-15T20:42:00.016651Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:41:59.971998Z","title":"Reformer: The efficient transformer","venue":null,"work_id":"dfe8f82c-9ee0-4432-a219-401814edd910","year":2020},"citing_paper":{"arxiv_id":"2505.12252","last_updated":"2025-05-18T06:16:46Z","snapshot_observed_at":"2026-08-15T20:35:21.516263Z","submitted_at":"2025-05-18T06:16:46Z","title":"SchoenbAt: Rethinking Attention with Polynomial basis","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-15T20:41:59.392503Z"},"links":{"citing_paper":"/paper/2505.12252"},"observation_digest":"sha256:29dd2d7ce89094ce2fb27a34dd7029e00018090a3a56e1107105c5db4ee6c2ab","observation_id":"3f64ced8-50ef-4a5a-ad75-1175f459fa7a","resolution":{"observed_at":"2026-08-15T20:41:59.987430Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:41:59.937511Z","title":"Big bird: Transformers for longer sequences","venue":null,"work_id":"28b38f0f-8caa-4e4d-acf8-64f901f91c21","year":2020},"citing_paper":{"arxiv_id":"2505.12252","last_updated":"2025-05-18T06:16:46Z","snapshot_observed_at":"2026-08-15T20:35:21.516263Z","submitted_at":"2025-05-18T06:16:46Z","title":"SchoenbAt: Rethinking Attention with Polynomial basis","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-15T20:41:59.404202Z"},"links":{"citing_paper":"/paper/2505.12252"},"observation_digest":"sha256:27e2a8f1a325723e810ef5e878225d37e7ffcf4a26fe58b1bce4bf4523b17122","observation_id":"cc81dffd-9133-419d-872b-27ad4a10607b","resolution":{"observed_at":"2026-08-15T20:41:59.944776Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2202.08791","last_updated":"2022-02-17T17:53:48Z","snapshot_observed_at":"2026-08-16T17:20:30.741976Z","submitted_at":"2022-02-17T17:53:48Z","title":"cosFormer: Rethinking Softmax in Attention","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2202.08791","snapshot_observed_at":"2026-08-15T20:41:59.413605Z","title":"cosformer: Rethinking softmax in attention.arXiv preprint arXiv:2202.08791, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.12252","last_updated":"2025-05-18T06:16:46Z","snapshot_observed_at":"2026-08-15T20:35:21.516263Z","submitted_at":"2025-05-18T06:16:46Z","title":"SchoenbAt: Rethinking Attention with Polynomial basis","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-15T20:41:59.413605Z"},"links":{"cited_paper":"/paper/2202.08791","citing_paper":"/paper/2505.12252"},"observation_digest":"sha256:16567c783437700cfdc63d5138660c753ee3199360d0ab787cfe182d232c68b1","observation_id":"f748f79e-0463-4ae3-8101-166f994583a0","resolution":{"observed_at":"2026-08-15T20:41:59.413605Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2505.12252","last_updated":"2025-05-18T06:16:46Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-15T20:35:21.516263Z","submitted_at":"2025-05-18T06:16:46Z","title":"SchoenbAt: Rethinking Attention with Polynomial basis"},"reference_resolution":{"displayed":56,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":12,"verified_exact":2,"verified_fuzzy":42},"total_outbound_references":56},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"thesis":"As of 18 August 2026, this Paper Citation Record lists 56 of 56 outbound references and 0 inbound Pith citation observations for arXiv:2505.12252."}