{"as_of":"2026-08-17T22:22:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:4d5a644759e01eeaba5d4a4bcbbb07e98c26ff2579fcdfb4a1104810a53e6dd7","coverage":[{"denominator":40,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":40,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T23:05:48.216818Z","state":"measured"},{"denominator":41,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":41,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-17T06:30:58.91139+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T18:59:54.322245Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-15T18:59:54.635926Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.07862","last_updated":"2025-05-09T00:13:23Z","snapshot_observed_at":"2026-08-17T16:57:30.712281Z","submitted_at":"2025-05-09T00:13:23Z","title":"Graph Laplacian Wavelet Transformer via Learnable Spectral Decomposition","version":1},"cited_work":{"arxiv_id":"2505.07862","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.07862","snapshot_observed_at":"2026-08-15T18:59:54.635926Z","title":"Graph Laplacian Wavelet Transformer via Learnable Spectral Decomposition","venue":"cs.CL","work_id":"dc47e346-9a18-41ed-b352-de3ff4a1462c","year":2025},"citing_paper":{"arxiv_id":"2506.18943","last_updated":"2025-06-22T23:48:02Z","snapshot_observed_at":"2026-08-17T11:22:56.143165Z","submitted_at":"2025-06-22T23:48:02Z","title":"From Pixels and Words to Waves: A Unified Framework for Spectral Dictionary vLLMs","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-15T18:59:54.322245Z"},"links":{"cited_paper":"/paper/2505.07862","citing_paper":"/paper/2506.18943"},"observation_digest":"sha256:21747f1f09d9095998487fd18a1ae18c3e5b79e46d062dfdb76181bc18fa1ad2","observation_id":"ebc0e09d-eebc-4d07-bae4-6eb39d826f7c","resolution":{"observed_at":"2026-08-15T18:59:54.642057Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2505.07862/citation-record","integrity":"/paper/2505.07862/integrity","json":"/paper/2505.07862/citation-record.json","paper":"/paper/2505.07862"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:05:48.771457Z","title":"K-svd: An algorithm for designing overcomplete dictionaries for sparse representation.IEEE Transactions on Signal Process- ing, 54(11):4311–4322, 2006","venue":null,"work_id":"2d6b9317-31dd-4085-9476-6d1203c445e7","year":2006},"citing_paper":{"arxiv_id":"2505.07862","last_updated":"2025-05-09T00:13:23Z","snapshot_observed_at":"2026-08-17T16:57:30.712281Z","submitted_at":"2025-05-09T00:13:23Z","title":"Graph Laplacian Wavelet Transformer via Learnable Spectral Decomposition","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-15T23:05:48.053662Z"},"links":{"citing_paper":"/paper/2505.07862"},"observation_digest":"sha256:774310764d421ec91b131095e0cc8b746be12eb14b5fd65b88159c96f44881ea","observation_id":"82ec892e-c223-4d0e-a20d-bafb43b4f725","resolution":{"observed_at":"2026-08-15T23:05:48.776432Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:05:48.756827Z","title":"Allen and Lawrence R","venue":null,"work_id":"71cb1965-d19d-4329-8c8c-43b1eaefb975","year":1977},"citing_paper":{"arxiv_id":"2505.07862","last_updated":"2025-05-09T00:13:23Z","snapshot_observed_at":"2026-08-17T16:57:30.712281Z","submitted_at":"2025-05-09T00:13:23Z","title":"Graph Laplacian Wavelet Transformer via Learnable Spectral Decomposition","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-15T23:05:48.058972Z"},"links":{"citing_paper":"/paper/2505.07862"},"observation_digest":"sha256:15ece2d40000abc57c3a2706c712d9badd5464c49bd0725d123c801393ee3140","observation_id":"5f8c09f1-e76f-455b-b4c7-ef162e87dbbb","resolution":{"observed_at":"2026-08-15T23:05:48.761377Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:05:48.743802Z","title":"Graph convolutional encoders for syntax-aware neural machine translation","venue":null,"work_id":"057d00c9-2d89-42cf-90bb-b34b9e98e73c","year":1957},"citing_paper":{"arxiv_id":"2505.07862","last_updated":"2025-05-09T00:13:23Z","snapshot_observed_at":"2026-08-17T16:57:30.712281Z","submitted_at":"2025-05-09T00:13:23Z","title":"Graph Laplacian Wavelet Transformer via Learnable Spectral Decomposition","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-15T23:05:48.063257Z"},"links":{"citing_paper":"/paper/2505.07862"},"observation_digest":"sha256:cdffe2075591205076e3446b43fdf91b3a6435de103a1dd18ff69d1d99dd0bc9","observation_id":"5e3c8e05-b311-48ba-a086-6a6121824ff3","resolution":{"observed_at":"2026-08-15T23:05:48.747756Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:05:48.731220Z","title":"Peters, and Arman Cohan","venue":null,"work_id":"ce419968-1d9c-4017-9f98-7cac91974ee2","year":2020},"citing_paper":{"arxiv_id":"2505.07862","last_updated":"2025-05-09T00:13:23Z","snapshot_observed_at":"2026-08-17T16:57:30.712281Z","submitted_at":"2025-05-09T00:13:23Z","title":"Graph Laplacian Wavelet Transformer via Learnable Spectral Decomposition","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-15T23:05:48.067473Z"},"links":{"citing_paper":"/paper/2505.07862"},"observation_digest":"sha256:8e81721d02b5621b6d0dd730500ffe27b78cb09be120d24ab81904a1874e6439","observation_id":"7d82d61a-a165-4f14-8e84-d4437d91608f","resolution":{"observed_at":"2026-08-15T23:05:48.735065Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2005.14165","last_updated":"2020-07-22T19:47:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-05-28T17:29:03Z","title":"Language Models are Few-Shot Learners","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2005.14165","snapshot_observed_at":"2026-08-15T23:05:48.072082Z","title":"Brown, Benjamin Mann, Nick Ryder, Melanie Subbiah, Jared Kaplan, Prafulla Dhariwal, Arvind Neelakantan, Pranav Shyam, Girish Sastry, Amanda Askell, et al","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2505.07862","last_updated":"2025-05-09T00:13:23Z","snapshot_observed_at":"2026-08-17T16:57:30.712281Z","submitted_at":"2025-05-09T00:13:23Z","title":"Graph Laplacian Wavelet Transformer via Learnable Spectral Decomposition","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-15T23:05:48.072082Z"},"links":{"cited_paper":"/paper/2005.14165","citing_paper":"/paper/2505.07862"},"observation_digest":"sha256:59dd7fc593a2fc1698831e83a062719855fee5641d72735b3af6f6ad00555333","observation_id":"40330474-a7cf-4c20-9630-db9b0cf21379","resolution":{"observed_at":"2026-08-15T23:05:48.072082Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1312.6203","last_updated":"2014-05-21T16:27:09Z","snapshot_observed_at":"2026-08-14T23:50:42.645895Z","submitted_at":"2013-12-21T04:25:53Z","title":"Spectral Networks and Locally Connected Networks on Graphs","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1312.6203","snapshot_observed_at":"2026-08-15T23:05:48.076532Z","title":"Spectral networks and locally connected networks on graphs","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2505.07862","last_updated":"2025-05-09T00:13:23Z","snapshot_observed_at":"2026-08-17T16:57:30.712281Z","submitted_at":"2025-05-09T00:13:23Z","title":"Graph Laplacian Wavelet Transformer via Learnable Spectral Decomposition","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-15T23:05:48.076532Z"},"links":{"cited_paper":"/paper/1312.6203","citing_paper":"/paper/2505.07862"},"observation_digest":"sha256:9587ceec144707c08318cfd0ea8a3ef9bf4eea30fb9a50948b432e0246cf6f44","observation_id":"85cc646d-1097-4fcf-8aa7-987573064c87","resolution":{"observed_at":"2026-08-15T23:05:48.076532Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2107.00645","last_updated":"2021-10-26T13:21:45Z","snapshot_observed_at":"2026-08-16T18:12:55.981599Z","submitted_at":"2021-07-01T17:58:16Z","title":"Global Filter Networks for Image Classification","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2107.00645","snapshot_observed_at":"2026-08-15T23:05:48.081799Z","title":"Gfnet: Global filter networks for image classification.arXiv preprint arXiv:2107.00645, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.07862","last_updated":"2025-05-09T00:13:23Z","snapshot_observed_at":"2026-08-17T16:57:30.712281Z","submitted_at":"2025-05-09T00:13:23Z","title":"Graph Laplacian Wavelet Transformer via Learnable Spectral Decomposition","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-15T23:05:48.081799Z"},"links":{"cited_paper":"/paper/2107.00645","citing_paper":"/paper/2505.07862"},"observation_digest":"sha256:5e028b973f9ee190bbe684734e947778a018c3862f0fc5d2d04f69d1742edd30","observation_id":"b007999c-24c7-44aa-95c9-8b4d0b0ce630","resolution":{"observed_at":"2026-08-15T23:05:48.081799Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:05:48.718492Z","title":"Generating long sequences with sparse transformers","venue":null,"work_id":"08210566-8723-40ac-9c23-23e2f9c121dd","year":2019},"citing_paper":{"arxiv_id":"2505.07862","last_updated":"2025-05-09T00:13:23Z","snapshot_observed_at":"2026-08-17T16:57:30.712281Z","submitted_at":"2025-05-09T00:13:23Z","title":"Graph Laplacian Wavelet Transformer via Learnable Spectral Decomposition","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-15T23:05:48.085837Z"},"links":{"citing_paper":"/paper/2505.07862"},"observation_digest":"sha256:443f4c110c4182895412eef33bb0d21aa992040d1cff5b22f41457fe3dd28d60","observation_id":"c22aab96-55f2-459d-a573-4f0fb2b3ff96","resolution":{"observed_at":"2026-08-15T23:05:48.722370Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1904.10509","last_updated":"2019-04-23T19:29:47Z","snapshot_observed_at":"2026-08-16T10:03:03.268538Z","submitted_at":"2019-04-23T19:29:47Z","title":"Generating Long Sequences with Sparse Transformers","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1904.10509","snapshot_observed_at":"2026-08-15T23:05:48.089510Z","title":"Generating long sequences with sparse transformers","venue":null,"work_id":null,"year":1904},"citing_paper":{"arxiv_id":"2505.07862","last_updated":"2025-05-09T00:13:23Z","snapshot_observed_at":"2026-08-17T16:57:30.712281Z","submitted_at":"2025-05-09T00:13:23Z","title":"Graph Laplacian Wavelet Transformer via Learnable Spectral Decomposition","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-15T23:05:48.089510Z"},"links":{"cited_paper":"/paper/1904.10509","citing_paper":"/paper/2505.07862"},"observation_digest":"sha256:b4d5c1559001e933e8a5954c477028c6f4c2f7437fe5ce29b6f8a98be538f191","observation_id":"281bf1c7-9fc6-4720-9e5b-f4cd31352d1d","resolution":{"observed_at":"2026-08-15T23:05:48.089510Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:05:48.704858Z","title":"Rethinking attention with performers","venue":null,"work_id":"3884ad0a-d7be-4326-8f6a-76d823e10efc","year":2021},"citing_paper":{"arxiv_id":"2505.07862","last_updated":"2025-05-09T00:13:23Z","snapshot_observed_at":"2026-08-17T16:57:30.712281Z","submitted_at":"2025-05-09T00:13:23Z","title":"Graph Laplacian Wavelet Transformer via Learnable Spectral Decomposition","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-15T23:05:48.093500Z"},"links":{"citing_paper":"/paper/2505.07862"},"observation_digest":"sha256:8388cdfaf5294f0aeca63f3bdd5c2b3daf58335e7bd09500092e8b6f8818b6b9","observation_id":"9b4368c5-8d3e-4903-8e54-1f89f0fcdbf1","resolution":{"observed_at":"2026-08-15T23:05:48.709161Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:05:48.690381Z","title":"Coifman and Mauro Maggioni","venue":null,"work_id":"0d3e5be1-7e4a-4d48-ba02-288e4c0558ae","year":2006},"citing_paper":{"arxiv_id":"2505.07862","last_updated":"2025-05-09T00:13:23Z","snapshot_observed_at":"2026-08-17T16:57:30.712281Z","submitted_at":"2025-05-09T00:13:23Z","title":"Graph Laplacian Wavelet Transformer via Learnable Spectral Decomposition","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-15T23:05:48.097031Z"},"links":{"citing_paper":"/paper/2505.07862"},"observation_digest":"sha256:345fb044940580972912ae228c7d6175cc44c60b8b7dadce7cfede3c2985e044","observation_id":"a89599a4-5638-4798-b67f-884a2da2c648","resolution":{"observed_at":"2026-08-15T23:05:48.695357Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:05:48.676491Z","title":"Bert: Pre-training of deep bidirectional transformers for language understanding","venue":null,"work_id":"8bd0949c-6bd6-4e3e-bed0-c5a97569609c","year":2019},"citing_paper":{"arxiv_id":"2505.07862","last_updated":"2025-05-09T00:13:23Z","snapshot_observed_at":"2026-08-17T16:57:30.712281Z","submitted_at":"2025-05-09T00:13:23Z","title":"Graph Laplacian Wavelet Transformer via Learnable Spectral Decomposition","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-15T23:05:48.100668Z"},"links":{"citing_paper":"/paper/2505.07862"},"observation_digest":"sha256:b9746694ca7d850d8cc52525a2b9d1c675973e89464d0c7f4cf581b5f098f230","observation_id":"ce05a8c0-41f0-4649-a3a7-7f11d06177f6","resolution":{"observed_at":"2026-08-15T23:05:48.681072Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:05:48.661335Z","title":"Generalization of transformer networks to graphs","venue":null,"work_id":"5f4ed226-ee84-4277-abd8-25e0f84e11e1","year":2020},"citing_paper":{"arxiv_id":"2505.07862","last_updated":"2025-05-09T00:13:23Z","snapshot_observed_at":"2026-08-17T16:57:30.712281Z","submitted_at":"2025-05-09T00:13:23Z","title":"Graph Laplacian Wavelet Transformer via Learnable Spectral Decomposition","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-15T23:05:48.104621Z"},"links":{"citing_paper":"/paper/2505.07862"},"observation_digest":"sha256:fb8ac5c6c0d7dd1a48179b9a6e8bd32fbca887368e19824b43ce9559526e5ca5","observation_id":"5947b40a-9f3b-41cc-b06e-27d37748798a","resolution":{"observed_at":"2026-08-15T23:05:48.666441Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2101.03961","last_updated":"2022-06-16T20:36:07Z","snapshot_observed_at":"2026-08-14T22:45:56.335948Z","submitted_at":"2021-01-11T16:11:52Z","title":"Switch Transformers: Scaling to Trillion Parameter Models with Simple and Efficient Sparsity","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2101.03961","snapshot_observed_at":"2026-08-15T23:05:48.108072Z","title":"Switch transformers: Scaling to trillion parameter models with simple and efficient sparsity.arXiv preprint arXiv:2101.03961, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.07862","last_updated":"2025-05-09T00:13:23Z","snapshot_observed_at":"2026-08-17T16:57:30.712281Z","submitted_at":"2025-05-09T00:13:23Z","title":"Graph Laplacian Wavelet Transformer via Learnable Spectral Decomposition","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-15T23:05:48.108072Z"},"links":{"cited_paper":"/paper/2101.03961","citing_paper":"/paper/2505.07862"},"observation_digest":"sha256:d85be6f2bd3be6d79d24c5bef612e819fc89304a3f5e94d682ac45a38f511cbd","observation_id":"43317a52-ab66-4836-9132-59beb4dc2fbd","resolution":{"observed_at":"2026-08-15T23:05:48.108072Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:05:48.646282Z","title":"Griffin and Jae S","venue":null,"work_id":"025f8e07-2aaf-4734-95a5-a518ef444a44","year":1984},"citing_paper":{"arxiv_id":"2505.07862","last_updated":"2025-05-09T00:13:23Z","snapshot_observed_at":"2026-08-17T16:57:30.712281Z","submitted_at":"2025-05-09T00:13:23Z","title":"Graph Laplacian Wavelet Transformer via Learnable Spectral Decomposition","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-15T23:05:48.112340Z"},"links":{"citing_paper":"/paper/2505.07862"},"observation_digest":"sha256:55b0e1b0326d64fbc30a8566aa5a51af4c3c4dce03d695a4156afc068aceeb5f","observation_id":"1ba0a73f-652a-4c7b-b5f5-54814d6c2528","resolution":{"observed_at":"2026-08-15T23:05:48.650817Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:05:48.632005Z","title":"Afno: Adaptive fourier neural operator for long-range sequence modeling","venue":null,"work_id":"0312a702-f4eb-43b3-8096-ad0c11910276","year":2022},"citing_paper":{"arxiv_id":"2505.07862","last_updated":"2025-05-09T00:13:23Z","snapshot_observed_at":"2026-08-17T16:57:30.712281Z","submitted_at":"2025-05-09T00:13:23Z","title":"Graph Laplacian Wavelet Transformer via Learnable Spectral Decomposition","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-15T23:05:48.116280Z"},"links":{"citing_paper":"/paper/2505.07862"},"observation_digest":"sha256:e3d923921135852a49c2a94cecef14a08f6732a501b43ec165b330787d8fa867","observation_id":"d820a659-09a0-4fbe-a59d-92a919b44fb2","resolution":{"observed_at":"2026-08-15T23:05:48.636643Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:05:48.618070Z","title":"Hammond, Pierre Vandergheynst, and Rémi Gribonval","venue":null,"work_id":"bcd7163f-6ce8-4b4a-af24-ebbef4420572","year":2011},"citing_paper":{"arxiv_id":"2505.07862","last_updated":"2025-05-09T00:13:23Z","snapshot_observed_at":"2026-08-17T16:57:30.712281Z","submitted_at":"2025-05-09T00:13:23Z","title":"Graph Laplacian Wavelet Transformer via Learnable Spectral Decomposition","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-15T23:05:48.120640Z"},"links":{"citing_paper":"/paper/2505.07862"},"observation_digest":"sha256:6429c133a1a7e69d5b4130954658cbd3364f756a0d1e52a2b0637e44a13d6ba9","observation_id":"99995e37-6db7-49bb-b9aa-344388833a5b","resolution":{"observed_at":"2026-08-15T23:05:48.622864Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:05:48.603381Z","title":"Statistical methods for speech recognition.MIT Press, 1977","venue":null,"work_id":"1db392b9-a1c5-4ea9-8f9d-d81da169c7b8","year":1977},"citing_paper":{"arxiv_id":"2505.07862","last_updated":"2025-05-09T00:13:23Z","snapshot_observed_at":"2026-08-17T16:57:30.712281Z","submitted_at":"2025-05-09T00:13:23Z","title":"Graph Laplacian Wavelet Transformer via Learnable Spectral Decomposition","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-15T23:05:48.124774Z"},"links":{"citing_paper":"/paper/2505.07862"},"observation_digest":"sha256:fb854dbabd09e671cc5e77cac481829e2ddc0c1c4079b475409d1763480a2819","observation_id":"a7ee2c24-df20-4168-8523-f5fac174a30d","resolution":{"observed_at":"2026-08-15T23:05:48.608645Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:05:48.588755Z","title":"Transformers are rnns: Fast autoregressive transformers with linear attention","venue":null,"work_id":"4d504860-0d0b-48ee-9c21-55883c0556c8","year":2020},"citing_paper":{"arxiv_id":"2505.07862","last_updated":"2025-05-09T00:13:23Z","snapshot_observed_at":"2026-08-17T16:57:30.712281Z","submitted_at":"2025-05-09T00:13:23Z","title":"Graph Laplacian Wavelet Transformer via Learnable Spectral Decomposition","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-15T23:05:48.128860Z"},"links":{"citing_paper":"/paper/2505.07862"},"observation_digest":"sha256:c6736fd6df304524c017e6e581710185c2f84610276798948bc1b3c23ea0a963","observation_id":"4c0db23c-e588-4775-95f6-1cba276f0734","resolution":{"observed_at":"2026-08-15T23:05:48.593489Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1412.6980","last_updated":"2017-01-30T01:27:54Z","snapshot_observed_at":"2026-08-17T19:26:44.032537Z","submitted_at":"2014-12-22T13:54:29Z","title":"Adam: A Method for Stochastic Optimization","version":9},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1412.6980","snapshot_observed_at":"2026-08-15T23:05:48.132849Z","title":"Kingma and Jimmy Ba","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2505.07862","last_updated":"2025-05-09T00:13:23Z","snapshot_observed_at":"2026-08-17T16:57:30.712281Z","submitted_at":"2025-05-09T00:13:23Z","title":"Graph Laplacian Wavelet Transformer via Learnable Spectral Decomposition","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-15T23:05:48.132849Z"},"links":{"cited_paper":"/paper/1412.6980","citing_paper":"/paper/2505.07862"},"observation_digest":"sha256:7e8a4f4c8c3b3a514bb7cda3cb8d6c3ecf4ac39ca908b5fd4a70cf3097ff2f23","observation_id":"902b4e81-3f6b-4f92-b0ce-c20eb3eda8e7","resolution":{"observed_at":"2026-08-15T23:05:48.132849Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:05:48.137717Z","title":"Kipf and Max Welling","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.07862","last_updated":"2025-05-09T00:13:23Z","snapshot_observed_at":"2026-08-17T16:57:30.712281Z","submitted_at":"2025-05-09T00:13:23Z","title":"Graph Laplacian Wavelet Transformer via Learnable Spectral Decomposition","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-15T23:05:48.137717Z"},"links":{"citing_paper":"/paper/2505.07862"},"observation_digest":"sha256:4a9974b46b59a4934b340fef01381294a416fbfebaa454bb88299a8aad97a88c","observation_id":"f2d29473-e6e8-4a96-a221-0fa911a595e3","resolution":{"observed_at":"2026-08-15T23:05:48.137717Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.03821","last_updated":"2025-04-04T17:11:04Z","snapshot_observed_at":"2026-08-16T12:43:53.767097Z","submitted_at":"2025-04-04T17:11:04Z","title":"A Hybrid Wavelet-Fourier Method for Next-Generation Conditional Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.03821","snapshot_observed_at":"2026-08-15T23:05:48.141846Z","title":"Learnable multi-scale wavelet transformer: A novel alternative to self-attention","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.07862","last_updated":"2025-05-09T00:13:23Z","snapshot_observed_at":"2026-08-17T16:57:30.712281Z","submitted_at":"2025-05-09T00:13:23Z","title":"Graph Laplacian Wavelet Transformer via Learnable Spectral Decomposition","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-15T23:05:48.141846Z"},"links":{"cited_paper":"/paper/2504.03821","citing_paper":"/paper/2505.07862"},"observation_digest":"sha256:ee10d2b083afbaa6179827a96f91b5136c567d0ba168d2f24f15fcf746306820","observation_id":"95e17c4a-199c-4cb3-9525-55239318196a","resolution":{"observed_at":"2026-08-15T23:05:48.141846Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:05:48.565314Z","title":"Reformer: The efficient transformer","venue":null,"work_id":"cd841d7a-1055-466b-a80d-e92fd0bad49f","year":2020},"citing_paper":{"arxiv_id":"2505.07862","last_updated":"2025-05-09T00:13:23Z","snapshot_observed_at":"2026-08-17T16:57:30.712281Z","submitted_at":"2025-05-09T00:13:23Z","title":"Graph Laplacian Wavelet Transformer via Learnable Spectral Decomposition","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-15T23:05:48.146231Z"},"links":{"citing_paper":"/paper/2505.07862"},"observation_digest":"sha256:9aaae113ddd0aabc609dc9d6c04e44a575121e70d1aa4895ef30419821a5ec6e","observation_id":"48d8674e-fa8e-4182-bdc5-7812c807ed59","resolution":{"observed_at":"2026-08-15T23:05:48.569211Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:05:48.551872Z","title":"Fnet: Mixing to- kens with fourier transforms","venue":null,"work_id":"8ecfbdc9-8b75-4ffc-b24c-eb0e3e2f290c","year":2022},"citing_paper":{"arxiv_id":"2505.07862","last_updated":"2025-05-09T00:13:23Z","snapshot_observed_at":"2026-08-17T16:57:30.712281Z","submitted_at":"2025-05-09T00:13:23Z","title":"Graph Laplacian Wavelet Transformer via Learnable Spectral Decomposition","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-15T23:05:48.150434Z"},"links":{"citing_paper":"/paper/2505.07862"},"observation_digest":"sha256:6b341150a519418439fcced3c38d9d92d23bbafe142ab92543d5f591e0d7fe03","observation_id":"bb1478bb-4d4d-45ed-a6d8-ca82c71b0940","resolution":{"observed_at":"2026-08-15T23:05:48.555844Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:05:48.539523Z","title":"Academic Press, 1999","venue":null,"work_id":"32b7068f-504c-4c51-8494-89f518983c86","year":1999},"citing_paper":{"arxiv_id":"2505.07862","last_updated":"2025-05-09T00:13:23Z","snapshot_observed_at":"2026-08-17T16:57:30.712281Z","submitted_at":"2025-05-09T00:13:23Z","title":"Graph Laplacian Wavelet Transformer via Learnable Spectral Decomposition","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-15T23:05:48.154634Z"},"links":{"citing_paper":"/paper/2505.07862"},"observation_digest":"sha256:ba3e54a2d9816dc6638ff01235d7eeec7d57c6cbed62f7bf3fb4b9cb46d34841","observation_id":"0270cb77-89b9-421a-bc12-dbce656d9cbc","resolution":{"observed_at":"2026-08-15T23:05:48.543121Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:05:48.526131Z","title":"Manning, Mihai Surdeanu, John Bauer, Jenny Finkel, Steven Bethard, and David McClosky","venue":null,"work_id":"1f222193-79fd-4430-9cfc-53608147fde5","year":2014},"citing_paper":{"arxiv_id":"2505.07862","last_updated":"2025-05-09T00:13:23Z","snapshot_observed_at":"2026-08-17T16:57:30.712281Z","submitted_at":"2025-05-09T00:13:23Z","title":"Graph Laplacian Wavelet Transformer via Learnable Spectral Decomposition","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-15T23:05:48.158756Z"},"links":{"citing_paper":"/paper/2505.07862"},"observation_digest":"sha256:874fc66bfb262c1c406243e4c5e8cebd13384d67fd1c2d30a545a875971de080","observation_id":"8c37a2d9-403b-4d12-adaa-3b3124774188","resolution":{"observed_at":"2026-08-15T23:05:48.530731Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:05:48.511976Z","title":"Marcus, Mary Ann Marcinkiewicz, and Beatrice Santorini","venue":null,"work_id":"6dc303bb-47ff-44d3-8c3f-9e5acd980bc3","year":1993},"citing_paper":{"arxiv_id":"2505.07862","last_updated":"2025-05-09T00:13:23Z","snapshot_observed_at":"2026-08-17T16:57:30.712281Z","submitted_at":"2025-05-09T00:13:23Z","title":"Graph Laplacian Wavelet Transformer via Learnable Spectral Decomposition","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-15T23:05:48.163140Z"},"links":{"citing_paper":"/paper/2505.07862"},"observation_digest":"sha256:bc510b1b685c89bab4d17a6f5b021167fae51822d3be15a635daf03b6e2f7d4a","observation_id":"7c0ae43b-8245-4f4f-a279-7efc75b137be","resolution":{"observed_at":"2026-08-15T23:05:48.516757Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1708.02182","last_updated":"2017-08-07T16:03:44Z","snapshot_observed_at":"2026-08-14T20:42:45.344345Z","submitted_at":"2017-08-07T16:03:44Z","title":"Regularizing and Optimizing LSTM Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1708.02182","snapshot_observed_at":"2026-08-15T23:05:48.167320Z","title":"Regularizing and optimizing lstm language models.arXiv preprint arXiv:1708.02182, 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.07862","last_updated":"2025-05-09T00:13:23Z","snapshot_observed_at":"2026-08-17T16:57:30.712281Z","submitted_at":"2025-05-09T00:13:23Z","title":"Graph Laplacian Wavelet Transformer via Learnable Spectral Decomposition","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-15T23:05:48.167320Z"},"links":{"cited_paper":"/paper/1708.02182","citing_paper":"/paper/2505.07862"},"observation_digest":"sha256:7f8faed2ff33d25784b045379d9f31b1633acc447a71341b860444466a3c8c75","observation_id":"582e4845-4a97-406b-83e9-1d8522ac6e1a","resolution":{"observed_at":"2026-08-15T23:05:48.167320Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:05:48.496671Z","title":"A call for clarity in reporting bleu scores","venue":null,"work_id":"84292260-89ff-44af-851a-7784816e874c","year":null},"citing_paper":{"arxiv_id":"2505.07862","last_updated":"2025-05-09T00:13:23Z","snapshot_observed_at":"2026-08-17T16:57:30.712281Z","submitted_at":"2025-05-09T00:13:23Z","title":"Graph Laplacian Wavelet Transformer via Learnable Spectral Decomposition","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-15T23:05:48.171875Z"},"links":{"citing_paper":"/paper/2505.07862"},"observation_digest":"sha256:b35834afef37b408a752e8625b0c12eb45f2ea9146aa94d6a7b1fe5e5159c40c","observation_id":"c797a4a3-82ae-432a-b535-ed0e81ff7463","resolution":{"observed_at":"2026-08-15T23:05:48.501772Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:05:48.180124Z","title":"Improving language understanding by generative pre-training","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2505.07862","last_updated":"2025-05-09T00:13:23Z","snapshot_observed_at":"2026-08-17T16:57:30.712281Z","submitted_at":"2025-05-09T00:13:23Z","title":"Graph Laplacian Wavelet Transformer via Learnable Spectral Decomposition","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-15T23:05:48.180124Z"},"links":{"citing_paper":"/paper/2505.07862"},"observation_digest":"sha256:74667ae4677a35c86f9bf07453248361b3f7e8f1cc6771fd97911ee63e0d1282","observation_id":"78c663fa-998e-4d2f-96af-2989d85f92b7","resolution":{"observed_at":"2026-08-15T23:05:48.180124Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:05:48.464777Z","title":"Language models are unsupervised multitask learners.OpenAI Blog, 2019","venue":null,"work_id":"ede0a9b2-dbeb-4559-a4df-e3acea9fc16b","year":2019},"citing_paper":{"arxiv_id":"2505.07862","last_updated":"2025-05-09T00:13:23Z","snapshot_observed_at":"2026-08-17T16:57:30.712281Z","submitted_at":"2025-05-09T00:13:23Z","title":"Graph Laplacian Wavelet Transformer via Learnable Spectral Decomposition","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-15T23:05:48.184517Z"},"links":{"citing_paper":"/paper/2505.07862"},"observation_digest":"sha256:8bab0bcc2b3d025bbc51c681a9e14847fc26764028c980d18f45c275484a0bf4","observation_id":"c6bae719-d5d5-43ef-9a53-e523bb475698","resolution":{"observed_at":"2026-08-15T23:05:48.469708Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:05:48.450518Z","title":"Reynolds","venue":null,"work_id":"84975f8e-f91b-4639-975b-0f8a0a829bcd","year":2009},"citing_paper":{"arxiv_id":"2505.07862","last_updated":"2025-05-09T00:13:23Z","snapshot_observed_at":"2026-08-17T16:57:30.712281Z","submitted_at":"2025-05-09T00:13:23Z","title":"Graph Laplacian Wavelet Transformer via Learnable Spectral Decomposition","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-15T23:05:48.188507Z"},"links":{"citing_paper":"/paper/2505.07862"},"observation_digest":"sha256:44aaa941312ffdd462c69cd15952b23168bf6228f381ec8e320ddaa92786f772","observation_id":"864af5d1-bc9f-4411-99ba-13c69b116e4e","resolution":{"observed_at":"2026-08-15T23:05:48.455012Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:05:48.435761Z","title":"Hybrid fourier-transformer for efficient sequence modeling","venue":null,"work_id":"7fc72900-ca3e-4ec4-ab27-b9316f1cb7f0","year":2021},"citing_paper":{"arxiv_id":"2505.07862","last_updated":"2025-05-09T00:13:23Z","snapshot_observed_at":"2026-08-17T16:57:30.712281Z","submitted_at":"2025-05-09T00:13:23Z","title":"Graph Laplacian Wavelet Transformer via Learnable Spectral Decomposition","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-15T23:05:48.192271Z"},"links":{"citing_paper":"/paper/2505.07862"},"observation_digest":"sha256:c732973286af37ecdf5eb857b77c92636942e2671d228c0b47fb90d419ac025e","observation_id":"9f62cc15-d40c-480f-953f-51c93f145965","resolution":{"observed_at":"2026-08-15T23:05:48.440351Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2009.06732","last_updated":"2022-03-14T10:35:35Z","snapshot_observed_at":"2026-08-14T10:35:34.660420Z","submitted_at":"2020-09-14T20:38:14Z","title":"Efficient Transformers: A Survey","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.06732","snapshot_observed_at":"2026-08-15T23:05:48.196439Z","title":"Efficient transformers: A survey.arXiv preprint arXiv:2009.06732, 2020","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2505.07862","last_updated":"2025-05-09T00:13:23Z","snapshot_observed_at":"2026-08-17T16:57:30.712281Z","submitted_at":"2025-05-09T00:13:23Z","title":"Graph Laplacian Wavelet Transformer via Learnable Spectral Decomposition","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-15T23:05:48.196439Z"},"links":{"cited_paper":"/paper/2009.06732","citing_paper":"/paper/2505.07862"},"observation_digest":"sha256:c5f824e860a74aafab85b1ca0761f0bf0dee68811f536e10fa86043678641a84","observation_id":"22529b86-0601-41c2-8e47-174adc06ada2","resolution":{"observed_at":"2026-08-15T23:05:48.196439Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:05:48.421465Z","title":"Gomez, Łukasz Kaiser, and Illia Polosukhin","venue":null,"work_id":"a60d18a6-a8c3-4596-bcd9-74d701182592","year":2017},"citing_paper":{"arxiv_id":"2505.07862","last_updated":"2025-05-09T00:13:23Z","snapshot_observed_at":"2026-08-17T16:57:30.712281Z","submitted_at":"2025-05-09T00:13:23Z","title":"Graph Laplacian Wavelet Transformer via Learnable Spectral Decomposition","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-15T23:05:48.200766Z"},"links":{"citing_paper":"/paper/2505.07862"},"observation_digest":"sha256:558fc395bf31a619b2f7a0441195c4f5f1fa87844f78b1e2335fa7c8d649a7d0","observation_id":"c0e690fa-939b-45be-8f36-9c158df43fc4","resolution":{"observed_at":"2026-08-15T23:05:48.425991Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:05:48.204978Z","title":"Graph attention networks","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2505.07862","last_updated":"2025-05-09T00:13:23Z","snapshot_observed_at":"2026-08-17T16:57:30.712281Z","submitted_at":"2025-05-09T00:13:23Z","title":"Graph Laplacian Wavelet Transformer via Learnable Spectral Decomposition","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-15T23:05:48.204978Z"},"links":{"citing_paper":"/paper/2505.07862"},"observation_digest":"sha256:fb83160e3bd782a1a31c64d61d59e60165c8b6eeae815a15fa6ce7ba7fc70887","observation_id":"69ded735-14bd-46e8-bbf8-fc4f27ae00a6","resolution":{"observed_at":"2026-08-15T23:05:48.204978Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2006.04768","last_updated":"2020-06-14T08:15:54Z","snapshot_observed_at":"2026-07-06T09:27:03.809621Z","submitted_at":"2020-06-08T17:37:52Z","title":"Linformer: Self-Attention with Linear Complexity","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2006.04768","snapshot_observed_at":"2026-08-15T23:05:48.209182Z","title":"Li, Madian Khabsa, Han Fang, and Hao Ma","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2505.07862","last_updated":"2025-05-09T00:13:23Z","snapshot_observed_at":"2026-08-17T16:57:30.712281Z","submitted_at":"2025-05-09T00:13:23Z","title":"Graph Laplacian Wavelet Transformer via Learnable Spectral Decomposition","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-15T23:05:48.209182Z"},"links":{"cited_paper":"/paper/2006.04768","citing_paper":"/paper/2505.07862"},"observation_digest":"sha256:756e239bd7570820d714e94b561b26c336f7a447c02b21eb03912794a19032dc","observation_id":"13841dd1-cfde-4490-9ba0-567eeecf6085","resolution":{"observed_at":"2026-08-15T23:05:48.209182Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:05:48.398949Z","title":"Le, and Yuxin Lu","venue":null,"work_id":"d15560b7-2c4b-4a6d-9ffb-169667c8a5ae","year":2021},"citing_paper":{"arxiv_id":"2505.07862","last_updated":"2025-05-09T00:13:23Z","snapshot_observed_at":"2026-08-17T16:57:30.712281Z","submitted_at":"2025-05-09T00:13:23Z","title":"Graph Laplacian Wavelet Transformer via Learnable Spectral Decomposition","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-15T23:05:48.213300Z"},"links":{"citing_paper":"/paper/2505.07862"},"observation_digest":"sha256:e65d8e0fc81530948d3fbc1d241907ef3dd0968c77d885c6da5d7ddd0ee839da","observation_id":"4e540942-f545-46f8-a2a9-2ee94e03fdbc","resolution":{"observed_at":"2026-08-15T23:05:48.402575Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:05:48.384100Z","title":"Big bird: Trans- formers for longer sequences","venue":null,"work_id":"79f01444-4337-46e1-b1a3-52ddf247aee6","year":2020},"citing_paper":{"arxiv_id":"2505.07862","last_updated":"2025-05-09T00:13:23Z","snapshot_observed_at":"2026-08-17T16:57:30.712281Z","submitted_at":"2025-05-09T00:13:23Z","title":"Graph Laplacian Wavelet Transformer via Learnable Spectral Decomposition","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-15T23:05:48.216818Z"},"links":{"citing_paper":"/paper/2505.07862"},"observation_digest":"sha256:b984b1780b93f9de11c748980979ac358f8b4220cfea9e62e1732ca5ddc3917b","observation_id":"54217300-4cde-43ac-ac24-f3fb48aede70","resolution":{"observed_at":"2026-08-15T23:05:48.389720Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:05:48.176150Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.07862","last_updated":"2025-05-09T00:13:23Z","snapshot_observed_at":"2026-08-17T16:57:30.712281Z","submitted_at":"2025-05-09T00:13:23Z","title":"Graph Laplacian Wavelet Transformer via Learnable Spectral Decomposition","version":1},"reference_index":2018,"source":"pdf_text","source_observed_at":"2026-08-15T23:05:48.176150Z"},"links":{"citing_paper":"/paper/2505.07862"},"observation_digest":"sha256:10c0e14142c940fd84468b2a0ac29510ab1dd193ea7c40fe787503e59b9dbfee","observation_id":"14259d95-990c-401a-bd67-675396d9dfe8","resolution":{"observed_at":"2026-08-15T23:05:48.176150Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2505.07862","last_updated":"2025-05-09T00:13:23Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-17T16:57:30.712281Z","submitted_at":"2025-05-09T00:13:23Z","title":"Graph Laplacian Wavelet Transformer via Learnable Spectral Decomposition"},"reference_resolution":{"displayed":40,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":14,"verified_exact":0,"verified_fuzzy":26},"total_outbound_references":40},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"thesis":"As of 17 August 2026, this Paper Citation Record lists 40 of 40 outbound references and 1 inbound Pith citation observation for arXiv:2505.07862."}