{"as_of":"2026-08-14T00:56:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:22c8a1fea1834b9a4a1291b375a31fcab247fd6946654f6a8993bfb7b80ac190","coverage":[{"denominator":45,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":45,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-12T17:05:46.879487Z","state":"measured"},{"denominator":48,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":48,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-13T06:32:02.005865+00:00","state":"measured"},{"denominator":3,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":3,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-12T13:22:32.375169Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-25T04:55:23.296689Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2411.13028","last_updated":"2024-11-20T04:20:17Z","snapshot_observed_at":"2026-08-13T18:48:06.562717Z","submitted_at":"2024-11-20T04:20:17Z","title":"A Theory for Compressibility of Graph Transformers for Transductive Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.13028","snapshot_observed_at":"2026-08-12T13:22:32.375169Z","title":"P., and Sutherland, D","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.16278","last_updated":"2024-11-25T10:59:25Z","snapshot_observed_at":"2026-08-13T09:21:10.155041Z","submitted_at":"2024-11-25T10:59:25Z","title":"Even Sparser Graph Transformers","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-12T13:22:32.375169Z"},"links":{"cited_paper":"/paper/2411.13028","citing_paper":"/paper/2411.16278"},"observation_digest":"sha256:d5aa349ec7a398518fa7d46f1376810e806cea4f78d677d20c498768899e9d76","observation_id":"5c315e0f-6257-48a1-936e-451c64faaca7","resolution":{"observed_at":"2026-08-12T13:22:32.375169Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.13028","last_updated":"2024-11-20T04:20:17Z","snapshot_observed_at":"2026-08-13T18:48:06.562717Z","submitted_at":"2024-11-20T04:20:17Z","title":"A Theory for Compressibility of Graph Transformers for Transductive Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.13028","snapshot_observed_at":"2026-08-07T15:32:43.545613Z","title":"A theory for compressibility of graph transformers for transductive learning.arXiv preprint arXiv:2411.13028, 2024a","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14919","last_updated":"2025-05-20T21:13:23Z","snapshot_observed_at":"2026-08-13T10:10:50.742823Z","submitted_at":"2025-05-20T21:13:23Z","title":"TxPert: Leveraging Biochemical Relationships for Out-of-Distribution Transcriptomic Perturbation Prediction","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T15:32:43.545613Z"},"links":{"cited_paper":"/paper/2411.13028","citing_paper":"/paper/2505.14919"},"observation_digest":"sha256:c1cd6896f2073af33eaf561d0793712079db06a5c46bee46f324245ec25d371e","observation_id":"31f77bde-ec7e-40cc-b9af-8444f9176e7d","resolution":{"observed_at":"2026-08-07T15:32:43.545613Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.13028","last_updated":"2024-11-20T04:20:17Z","snapshot_observed_at":"2026-08-13T18:48:06.562717Z","submitted_at":"2024-11-20T04:20:17Z","title":"A Theory for Compressibility of Graph Transformers for Transductive Learning","version":1},"cited_work":{"arxiv_id":"2411.13028","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2411.13028","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"A theory for compressibility of graph transformers for transductive learning.arXiv preprint arXiv:2411.13028, 2024a","venue":null,"work_id":"c22fd6f3-4a75-4dc6-86ca-67af95ecdb33","year":null},"citing_paper":{"arxiv_id":"2605.23753","last_updated":"2026-05-22T15:26:31Z","snapshot_observed_at":"2026-08-13T22:35:49.423722Z","submitted_at":"2026-05-22T15:26:31Z","title":"SeedER: Seed-and-Expand Retrieval from Knowledge Graphs","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-25T04:53:52.372584Z"},"links":{"cited_paper":"/paper/2411.13028","citing_paper":"/paper/2605.23753"},"observation_digest":"sha256:12dae971a1f89514a5c4a7d11fcfed2f998746b11a651c5d73bb83beb87eea06","observation_id":"88127997-c386-462f-8de5-662ba8b60a38","resolution":{"observed_at":"2026-05-25T04:55:23.299964Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2411.13028/citation-record","integrity":"/paper/2411.13028/integrity","json":"/paper/2411.13028/citation-record.json","paper":"/paper/2411.13028"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:05:47.439071Z","title":null,"venue":null,"work_id":"58894483-1fbb-4a38-a002-29138a7a69ea","year":2018},"citing_paper":{"arxiv_id":"2411.13028","last_updated":"2024-11-20T04:20:17Z","snapshot_observed_at":"2026-08-13T18:48:06.562717Z","submitted_at":"2024-11-20T04:20:17Z","title":"A Theory for Compressibility of Graph Transformers for Transductive Learning","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-12T17:05:46.722142Z"},"links":{"citing_paper":"/paper/2411.13028"},"observation_digest":"sha256:6eafd352a3fb122adc5d6966c4a720b5a8d152c16db044d49d83972e320b344b","observation_id":"726295ea-2664-4513-9055-07a51639c0fe","resolution":{"observed_at":"2026-08-12T17:05:47.442197Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:05:47.429662Z","title":"and Price, E","venue":null,"work_id":"70ab7503-573d-4a5f-b840-a6b47cf6788d","year":2019},"citing_paper":{"arxiv_id":"2411.13028","last_updated":"2024-11-20T04:20:17Z","snapshot_observed_at":"2026-08-13T18:48:06.562717Z","submitted_at":"2024-11-20T04:20:17Z","title":"A Theory for Compressibility of Graph Transformers for Transductive Learning","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-12T17:05:46.726702Z"},"links":{"citing_paper":"/paper/2411.13028"},"observation_digest":"sha256:5ae716954dca897fe89115e71bb1cd48ad49deb706926615c1f77ae5a9db9638","observation_id":"52c1a057-2c06-4485-996d-b4f9998bb52f","resolution":{"observed_at":"2026-08-12T17:05:47.432645Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.01232","last_updated":"2024-04-06T23:26:26Z","snapshot_observed_at":"2026-08-13T04:04:58.080208Z","submitted_at":"2024-03-02T15:32:01Z","title":"Polynormer: Polynomial-Expressive Graph Transformer in Linear Time","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.01232","snapshot_observed_at":"2026-08-12T17:05:46.730973Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.13028","last_updated":"2024-11-20T04:20:17Z","snapshot_observed_at":"2026-08-13T18:48:06.562717Z","submitted_at":"2024-11-20T04:20:17Z","title":"A Theory for Compressibility of Graph Transformers for Transductive Learning","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-12T17:05:46.730973Z"},"links":{"cited_paper":"/paper/2403.01232","citing_paper":"/paper/2411.13028"},"observation_digest":"sha256:811a36c14a484d8c74491fc458df8f9bac7aa29995d3a59b2d56e768c11e3070","observation_id":"e91b557a-0937-405c-8d96-bb599f087c94","resolution":{"observed_at":"2026-08-12T17:05:46.730973Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1810.04805","last_updated":"2019-05-24T20:37:26Z","snapshot_observed_at":"2026-07-30T09:12:38.100527Z","submitted_at":"2018-10-11T00:50:01Z","title":"BERT: Pre-training of Deep Bidirectional Transformers for Language Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1810.04805","snapshot_observed_at":"2026-08-12T17:05:46.735015Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2411.13028","last_updated":"2024-11-20T04:20:17Z","snapshot_observed_at":"2026-08-13T18:48:06.562717Z","submitted_at":"2024-11-20T04:20:17Z","title":"A Theory for Compressibility of Graph Transformers for Transductive Learning","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-12T17:05:46.735015Z"},"links":{"cited_paper":"/paper/1810.04805","citing_paper":"/paper/2411.13028"},"observation_digest":"sha256:cf595a18cb905c3f552f6a0785839ed64ec7dc4da2809c76d14db237d3c7b5d9","observation_id":"f73ad74d-0324-4d8c-9471-d8dc17ee1c93","resolution":{"observed_at":"2026-08-12T17:05:46.735015Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:05:47.419594Z","title":null,"venue":null,"work_id":"19b252fd-eef9-4a67-be0e-80b4fa39cc14","year":2021},"citing_paper":{"arxiv_id":"2411.13028","last_updated":"2024-11-20T04:20:17Z","snapshot_observed_at":"2026-08-13T18:48:06.562717Z","submitted_at":"2024-11-20T04:20:17Z","title":"A Theory for Compressibility of Graph Transformers for Transductive Learning","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-12T17:05:46.739037Z"},"links":{"citing_paper":"/paper/2411.13028"},"observation_digest":"sha256:661e89d42b88c8d784dbb31e76c41979d507ca3b5f5b159357827305d3882985","observation_id":"4e51d70c-6d3e-4516-a0cd-074da7aa8a95","resolution":{"observed_at":"2026-08-12T17:05:47.423019Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2010.11929","last_updated":"2021-06-03T13:08:56Z","snapshot_observed_at":"2026-08-13T14:19:26.598265Z","submitted_at":"2020-10-22T17:55:59Z","title":"An Image is Worth 16x16 Words: Transformers for Image Recognition at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.11929","snapshot_observed_at":"2026-08-12T17:05:46.742691Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2411.13028","last_updated":"2024-11-20T04:20:17Z","snapshot_observed_at":"2026-08-13T18:48:06.562717Z","submitted_at":"2024-11-20T04:20:17Z","title":"A Theory for Compressibility of Graph Transformers for Transductive Learning","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-12T17:05:46.742691Z"},"links":{"cited_paper":"/paper/2010.11929","citing_paper":"/paper/2411.13028"},"observation_digest":"sha256:1f94dca7a60d3ab1c73f7a2fe558e7b1d6303565b8173f9977c3c4b1b20a544e","observation_id":"f6f43ea0-016f-48f1-b793-0a24bb15107c","resolution":{"observed_at":"2026-08-12T17:05:46.742691Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2012.09699","last_updated":"2021-01-24T09:38:54Z","snapshot_observed_at":"2026-08-05T19:35:00.334774Z","submitted_at":"2020-12-17T16:11:47Z","title":"A Generalization of Transformer Networks to Graphs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2012.09699","snapshot_observed_at":"2026-08-12T17:05:46.746635Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2411.13028","last_updated":"2024-11-20T04:20:17Z","snapshot_observed_at":"2026-08-13T18:48:06.562717Z","submitted_at":"2024-11-20T04:20:17Z","title":"A Theory for Compressibility of Graph Transformers for Transductive Learning","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-12T17:05:46.746635Z"},"links":{"cited_paper":"/paper/2012.09699","citing_paper":"/paper/2411.13028"},"observation_digest":"sha256:7df325d8ff2f96294f17646236fbec1b983b350d4120585abf90a814040d4db2","observation_id":"5d00ffff-eebe-47d4-926a-69da9ad70a28","resolution":{"observed_at":"2026-08-12T17:05:46.746635Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:05:46.750020Z","title":"and Lenssen, J","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2411.13028","last_updated":"2024-11-20T04:20:17Z","snapshot_observed_at":"2026-08-13T18:48:06.562717Z","submitted_at":"2024-11-20T04:20:17Z","title":"A Theory for Compressibility of Graph Transformers for Transductive Learning","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-12T17:05:46.750020Z"},"links":{"citing_paper":"/paper/2411.13028"},"observation_digest":"sha256:330a8b2561272f14bd147fe1bcda00019370b2f17e9240d55d79acc7e24f784b","observation_id":"e863078e-2048-4497-910b-04a1e2071fab","resolution":{"observed_at":"2026-08-12T17:05:46.750020Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:05:46.753611Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2411.13028","last_updated":"2024-11-20T04:20:17Z","snapshot_observed_at":"2026-08-13T18:48:06.562717Z","submitted_at":"2024-11-20T04:20:17Z","title":"A Theory for Compressibility of Graph Transformers for Transductive Learning","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-12T17:05:46.753611Z"},"links":{"citing_paper":"/paper/2411.13028"},"observation_digest":"sha256:3a42822e02f0d90f7a41bd3f13da93362a98bb1b0d785268d1506efd6041c24a","observation_id":"fa458707-0ece-49c8-b58e-650e2b6a952d","resolution":{"observed_at":"2026-08-12T17:05:46.753611Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2103.09430","last_updated":"2021-10-20T22:40:40Z","snapshot_observed_at":"2026-08-06T03:47:37.849087Z","submitted_at":"2021-03-17T04:08:03Z","title":"OGB-LSC: A Large-Scale Challenge for Machine Learning on Graphs","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2103.09430","snapshot_observed_at":"2026-08-12T17:05:46.756901Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2411.13028","last_updated":"2024-11-20T04:20:17Z","snapshot_observed_at":"2026-08-13T18:48:06.562717Z","submitted_at":"2024-11-20T04:20:17Z","title":"A Theory for Compressibility of Graph Transformers for Transductive Learning","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-12T17:05:46.756901Z"},"links":{"cited_paper":"/paper/2103.09430","citing_paper":"/paper/2411.13028"},"observation_digest":"sha256:15ead0e9dbdc1c72c593164515af2437a1dae319f53f0477b5e44459b0491fcb","observation_id":"cb047a84-49c7-4002-a96e-bb93e93e5d87","resolution":{"observed_at":"2026-08-12T17:05:46.756901Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:05:46.760621Z","title":null,"venue":null,"work_id":null,"year":1984},"citing_paper":{"arxiv_id":"2411.13028","last_updated":"2024-11-20T04:20:17Z","snapshot_observed_at":"2026-08-13T18:48:06.562717Z","submitted_at":"2024-11-20T04:20:17Z","title":"A Theory for Compressibility of Graph Transformers for Transductive Learning","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-12T17:05:46.760621Z"},"links":{"citing_paper":"/paper/2411.13028"},"observation_digest":"sha256:e0c7c6173ea29e36b4aa9e66a55e3032e9980ce146af4692813b1c41af7ed03a","observation_id":"413ba3b7-3668-46e7-aab6-1a8612d9e95f","resolution":{"observed_at":"2026-08-12T17:05:46.760621Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:05:46.764764Z","title":"and Shakhnarovich, G","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2411.13028","last_updated":"2024-11-20T04:20:17Z","snapshot_observed_at":"2026-08-13T18:48:06.562717Z","submitted_at":"2024-11-20T04:20:17Z","title":"A Theory for Compressibility of Graph Transformers for Transductive Learning","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-12T17:05:46.764764Z"},"links":{"citing_paper":"/paper/2411.13028"},"observation_digest":"sha256:96a5600459ab72a1f2f87c29987acd0ef1192e146f9d9fd30907eda4888e13d6","observation_id":"4686c4c3-9a4d-4883-808b-db285a305924","resolution":{"observed_at":"2026-08-12T17:05:46.764764Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1609.02907","last_updated":"2017-02-22T09:55:36Z","snapshot_observed_at":"2026-08-13T11:38:10.906031Z","submitted_at":"2016-09-09T19:48:41Z","title":"Semi-Supervised Classification with Graph Convolutional Networks","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1609.02907","snapshot_observed_at":"2026-08-12T17:05:46.767940Z","title":null,"venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2411.13028","last_updated":"2024-11-20T04:20:17Z","snapshot_observed_at":"2026-08-13T18:48:06.562717Z","submitted_at":"2024-11-20T04:20:17Z","title":"A Theory for Compressibility of Graph Transformers for Transductive Learning","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-12T17:05:46.767940Z"},"links":{"cited_paper":"/paper/1609.02907","citing_paper":"/paper/2411.13028"},"observation_digest":"sha256:0b5df0c352472b856f4d24426aaafcdd257ea03155f6add65c004a2a9384e104","observation_id":"28ca2c38-86a2-4b8e-9b0c-7ff707cf9de1","resolution":{"observed_at":"2026-08-12T17:05:46.767940Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2106.03893","last_updated":"2021-10-27T16:09:50Z","snapshot_observed_at":"2026-08-13T19:08:19.854755Z","submitted_at":"2021-06-07T18:11:11Z","title":"Rethinking Graph Transformers with Spectral Attention","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.03893","snapshot_observed_at":"2026-08-12T17:05:46.771587Z","title":"L., L \\'e tourneau, V., and Tossou, P","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2411.13028","last_updated":"2024-11-20T04:20:17Z","snapshot_observed_at":"2026-08-13T18:48:06.562717Z","submitted_at":"2024-11-20T04:20:17Z","title":"A Theory for Compressibility of Graph Transformers for Transductive Learning","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-12T17:05:46.771587Z"},"links":{"cited_paper":"/paper/2106.03893","citing_paper":"/paper/2411.13028"},"observation_digest":"sha256:4d88e2a60bc64e3846c23b6bddf99d872969d911f4d1d389a868577bbfbe819f","observation_id":"4552ca4e-142a-4712-a62f-0045680b330d","resolution":{"observed_at":"2026-08-12T17:05:46.771587Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:05:47.383833Z","title":null,"venue":null,"work_id":"f9bb384d-e9df-4570-a056-1f287e78bf6a","year":2014},"citing_paper":{"arxiv_id":"2411.13028","last_updated":"2024-11-20T04:20:17Z","snapshot_observed_at":"2026-08-13T18:48:06.562717Z","submitted_at":"2024-11-20T04:20:17Z","title":"A Theory for Compressibility of Graph Transformers for Transductive Learning","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-12T17:05:46.774929Z"},"links":{"citing_paper":"/paper/2411.13028"},"observation_digest":"sha256:d9c58ca02ba62ff87f101c083a085d515b24cee46550535ecc3af9ae2cf92170","observation_id":"f4192465-96b8-453f-b989-adbf9707cb5a","resolution":{"observed_at":"2026-08-12T17:05:47.387362Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2106.03764","last_updated":"2021-06-08T10:02:26Z","snapshot_observed_at":"2026-08-13T19:08:28.794751Z","submitted_at":"2021-06-07T16:30:28Z","title":"On the Expressive Power of Self-Attention Matrices","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.03764","snapshot_observed_at":"2026-08-12T17:05:46.778144Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2411.13028","last_updated":"2024-11-20T04:20:17Z","snapshot_observed_at":"2026-08-13T18:48:06.562717Z","submitted_at":"2024-11-20T04:20:17Z","title":"A Theory for Compressibility of Graph Transformers for Transductive Learning","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-12T17:05:46.778144Z"},"links":{"cited_paper":"/paper/2106.03764","citing_paper":"/paper/2411.13028"},"observation_digest":"sha256:8bd9c053db3ed6b6bb94bac32eae5f51b29d2d1f3f32149a6326e11ef60ffb24","observation_id":"e438c3b7-fe55-4df0-8a73-d28372071b9c","resolution":{"observed_at":"2026-08-12T17:05:46.778144Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2204.07321","last_updated":"2023-06-22T15:00:07Z","snapshot_observed_at":"2026-08-13T16:02:00.956997Z","submitted_at":"2022-04-15T04:02:06Z","title":"Graph Pooling for Graph Neural Networks: Progress, Challenges, and Opportunities","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.07321","snapshot_observed_at":"2026-08-12T17:05:46.782138Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.13028","last_updated":"2024-11-20T04:20:17Z","snapshot_observed_at":"2026-08-13T18:48:06.562717Z","submitted_at":"2024-11-20T04:20:17Z","title":"A Theory for Compressibility of Graph Transformers for Transductive Learning","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-12T17:05:46.782138Z"},"links":{"cited_paper":"/paper/2204.07321","citing_paper":"/paper/2411.13028"},"observation_digest":"sha256:01b7662adfcd45eee9ee48079aeed43f91871c25fe76e32c147a0118a5123c82","observation_id":"87d6db91-d27a-4c05-bee3-26dfb9d01d8b","resolution":{"observed_at":"2026-08-12T17:05:46.782138Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1608.03983","last_updated":"2017-05-03T16:28:09Z","snapshot_observed_at":"2026-07-06T05:06:55.589962Z","submitted_at":"2016-08-13T13:46:05Z","title":"SGDR: Stochastic Gradient Descent with Warm Restarts","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1608.03983","snapshot_observed_at":"2026-08-12T17:05:46.785980Z","title":"and Hutter, F","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2411.13028","last_updated":"2024-11-20T04:20:17Z","snapshot_observed_at":"2026-08-13T18:48:06.562717Z","submitted_at":"2024-11-20T04:20:17Z","title":"A Theory for Compressibility of Graph Transformers for Transductive Learning","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-12T17:05:46.785980Z"},"links":{"cited_paper":"/paper/1608.03983","citing_paper":"/paper/2411.13028"},"observation_digest":"sha256:3f1c5d33bfc3f1a4fd149882d1743d638e6e48c2a1a450dff34fb513f8fd5be9","observation_id":"16781d6d-d5b5-42e8-b749-0c9c041c715e","resolution":{"observed_at":"2026-08-12T17:05:46.785980Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1711.05101","last_updated":"2019-01-04T21:01:49Z","snapshot_observed_at":"2026-08-09T20:34:52.923500Z","submitted_at":"2017-11-14T14:24:06Z","title":"Decoupled Weight Decay Regularization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1711.05101","snapshot_observed_at":"2026-08-12T17:05:46.790234Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2411.13028","last_updated":"2024-11-20T04:20:17Z","snapshot_observed_at":"2026-08-13T18:48:06.562717Z","submitted_at":"2024-11-20T04:20:17Z","title":"A Theory for Compressibility of Graph Transformers for Transductive Learning","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-12T17:05:46.790234Z"},"links":{"cited_paper":"/paper/1711.05101","citing_paper":"/paper/2411.13028"},"observation_digest":"sha256:53f52cc914b9c4bd1c380525b5150f5e99ba7dd7397ecfbdfa71adc6455b767d","observation_id":"2543d69a-b214-440a-9901-7572b5445306","resolution":{"observed_at":"2026-08-12T17:05:46.790234Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1907.03199","last_updated":"2020-01-28T13:24:15Z","snapshot_observed_at":"2026-08-13T21:13:54.414749Z","submitted_at":"2019-07-06T22:26:17Z","title":"What graph neural networks cannot learn: depth vs width","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1907.03199","snapshot_observed_at":"2026-08-12T17:05:46.794392Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2411.13028","last_updated":"2024-11-20T04:20:17Z","snapshot_observed_at":"2026-08-13T18:48:06.562717Z","submitted_at":"2024-11-20T04:20:17Z","title":"A Theory for Compressibility of Graph Transformers for Transductive Learning","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-12T17:05:46.794392Z"},"links":{"cited_paper":"/paper/1907.03199","citing_paper":"/paper/2411.13028"},"observation_digest":"sha256:ea94a386be059401fa282561cfa3f04adda1eae925d65a2c1c8b1834b5ba3c29","observation_id":"a4e2f6c4-5333-4641-9b95-9622595d5936","resolution":{"observed_at":"2026-08-12T17:05:46.794392Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:05:47.373400Z","title":null,"venue":null,"work_id":"bba997ed-09f1-42da-9e0b-046af50748f8","year":2015},"citing_paper":{"arxiv_id":"2411.13028","last_updated":"2024-11-20T04:20:17Z","snapshot_observed_at":"2026-08-13T18:48:06.562717Z","submitted_at":"2024-11-20T04:20:17Z","title":"A Theory for Compressibility of Graph Transformers for Transductive Learning","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-12T17:05:46.798219Z"},"links":{"citing_paper":"/paper/2411.13028"},"observation_digest":"sha256:b2951fc9482fa819adc6dccebe5404fab13ef5ecba994ebb96132e3b21cdc8d9","observation_id":"d60be399-b499-4561-9b87-50d7ac2cc23e","resolution":{"observed_at":"2026-08-12T17:05:47.377017Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.04181","last_updated":"2024-03-28T19:35:01Z","snapshot_observed_at":"2026-08-13T12:48:39.692046Z","submitted_at":"2023-02-08T16:40:11Z","title":"Attending to Graph Transformers","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.04181","snapshot_observed_at":"2026-08-12T17:05:46.801789Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.13028","last_updated":"2024-11-20T04:20:17Z","snapshot_observed_at":"2026-08-13T18:48:06.562717Z","submitted_at":"2024-11-20T04:20:17Z","title":"A Theory for Compressibility of Graph Transformers for Transductive Learning","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-12T17:05:46.801789Z"},"links":{"cited_paper":"/paper/2302.04181","citing_paper":"/paper/2411.13028"},"observation_digest":"sha256:c4ccd17936529d9a68845387644bdf19e2a692363ebb1789d1320d2faede4372","observation_id":"7aaaadd8-bd1c-4dde-916c-1a306ae61845","resolution":{"observed_at":"2026-08-12T17:05:46.801789Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:05:47.362655Z","title":"P., and Yasuda, T","venue":null,"work_id":"7475d881-f06f-411c-a917-5c12ef7f3ad1","year":2022},"citing_paper":{"arxiv_id":"2411.13028","last_updated":"2024-11-20T04:20:17Z","snapshot_observed_at":"2026-08-13T18:48:06.562717Z","submitted_at":"2024-11-20T04:20:17Z","title":"A Theory for Compressibility of Graph Transformers for Transductive Learning","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-12T17:05:46.805364Z"},"links":{"citing_paper":"/paper/2411.13028"},"observation_digest":"sha256:8939bce530c0935db4359591b8d34e7c5f7d58915424a86e4f2a15ddc822e357","observation_id":"44ab4783-73a8-4fd2-a5cf-bd6ce32b8bc4","resolution":{"observed_at":"2026-08-12T17:05:47.366207Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1905.09550","last_updated":"2019-05-26T05:21:04Z","snapshot_observed_at":"2026-07-06T07:54:54.802338Z","submitted_at":"2019-05-23T09:27:21Z","title":"Revisiting Graph Neural Networks: All We Have is Low-Pass Filters","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1905.09550","snapshot_observed_at":"2026-08-12T17:05:46.808690Z","title":"and Maehara, T","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2411.13028","last_updated":"2024-11-20T04:20:17Z","snapshot_observed_at":"2026-08-13T18:48:06.562717Z","submitted_at":"2024-11-20T04:20:17Z","title":"A Theory for Compressibility of Graph Transformers for Transductive Learning","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-12T17:05:46.808690Z"},"links":{"cited_paper":"/paper/1905.09550","citing_paper":"/paper/2411.13028"},"observation_digest":"sha256:7c119edfe36d5181dc65258b2b39016008a1ef052da73ff201d3e0c7b8059be6","observation_id":"66f46084-30e1-48ae-afb0-311c4b39305a","resolution":{"observed_at":"2026-08-12T17:05:46.808690Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1905.10947","last_updated":"2021-01-06T13:32:14Z","snapshot_observed_at":"2026-08-10T11:37:17.761481Z","submitted_at":"2019-05-27T02:59:06Z","title":"Graph Neural Networks Exponentially Lose Expressive Power for Node Classification","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1905.10947","snapshot_observed_at":"2026-08-12T17:05:46.812455Z","title":"and Suzuki, T","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2411.13028","last_updated":"2024-11-20T04:20:17Z","snapshot_observed_at":"2026-08-13T18:48:06.562717Z","submitted_at":"2024-11-20T04:20:17Z","title":"A Theory for Compressibility of Graph Transformers for Transductive Learning","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-12T17:05:46.812455Z"},"links":{"cited_paper":"/paper/1905.10947","citing_paper":"/paper/2411.13028"},"observation_digest":"sha256:200474fb38764726b8f6dd4d597bac683e90d8b21eeffe4d7f6abe4eef9c2c7d","observation_id":"dcc4bf8b-7030-482f-94f3-817a642cc571","resolution":{"observed_at":"2026-08-12T17:05:46.812455Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.11640","last_updated":"2024-03-02T21:17:13Z","snapshot_observed_at":"2026-08-13T12:39:14.570583Z","submitted_at":"2023-02-22T20:32:59Z","title":"A critical look at the evaluation of GNNs under heterophily: Are we really making progress?","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.11640","snapshot_observed_at":"2026-08-12T17:05:46.816309Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.13028","last_updated":"2024-11-20T04:20:17Z","snapshot_observed_at":"2026-08-13T18:48:06.562717Z","submitted_at":"2024-11-20T04:20:17Z","title":"A Theory for Compressibility of Graph Transformers for Transductive Learning","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-12T17:05:46.816309Z"},"links":{"cited_paper":"/paper/2302.11640","citing_paper":"/paper/2411.13028"},"observation_digest":"sha256:3621c43771aa145e2e921bf13fab4514465c5e104d18a1007e1449fc915355a4","observation_id":"07605304-cfbb-4681-bcb1-6bbd7a12e925","resolution":{"observed_at":"2026-08-12T17:05:46.816309Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:05:46.820314Z","title":"P., Luu, A","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.13028","last_updated":"2024-11-20T04:20:17Z","snapshot_observed_at":"2026-08-13T18:48:06.562717Z","submitted_at":"2024-11-20T04:20:17Z","title":"A Theory for Compressibility of Graph Transformers for Transductive Learning","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-12T17:05:46.820314Z"},"links":{"citing_paper":"/paper/2411.13028"},"observation_digest":"sha256:d8e1bdc1cf9117dd36cd87e698de54f5a20c503fa502bd99671a97afa2d647f5","observation_id":"88b9c471-4d58-41e0-941e-5aad642bf858","resolution":{"observed_at":"2026-08-12T17:05:46.820314Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.11504","last_updated":"2024-12-09T14:03:33Z","snapshot_observed_at":"2026-08-12T22:42:57.145071Z","submitted_at":"2024-09-17T19:16:03Z","title":"Preventing Representational Rank Collapse in MPNNs by Splitting the Computational Graph","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.11504","snapshot_observed_at":"2026-08-12T17:05:46.823721Z","title":"M., and Liebig, T","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.13028","last_updated":"2024-11-20T04:20:17Z","snapshot_observed_at":"2026-08-13T18:48:06.562717Z","submitted_at":"2024-11-20T04:20:17Z","title":"A Theory for Compressibility of Graph Transformers for Transductive Learning","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-12T17:05:46.823721Z"},"links":{"cited_paper":"/paper/2409.11504","citing_paper":"/paper/2411.13028"},"observation_digest":"sha256:f231d1110a2377d9ca7c50e829e6a83d8bf641ee1e26f8c6f8e444a0aefb0a52","observation_id":"27a6a294-9f3a-42b6-8f9c-34fb8129631a","resolution":{"observed_at":"2026-08-12T17:05:46.823721Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.18512","last_updated":"2024-05-28T18:31:14Z","snapshot_observed_at":"2026-08-12T23:55:48.932051Z","submitted_at":"2024-05-28T18:31:14Z","title":"Understanding Transformer Reasoning Capabilities via Graph Algorithms","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.18512","snapshot_observed_at":"2026-08-12T17:05:46.827097Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.13028","last_updated":"2024-11-20T04:20:17Z","snapshot_observed_at":"2026-08-13T18:48:06.562717Z","submitted_at":"2024-11-20T04:20:17Z","title":"A Theory for Compressibility of Graph Transformers for Transductive Learning","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-12T17:05:46.827097Z"},"links":{"cited_paper":"/paper/2405.18512","citing_paper":"/paper/2411.13028"},"observation_digest":"sha256:df2998022524fd01262583d88425b0bf718aa61bc205f06e0428720835f0cd39","observation_id":"91ddec12-cd19-477e-a5da-070f062534e9","resolution":{"observed_at":"2026-08-12T17:05:46.827097Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.09268","last_updated":"2024-02-14T15:54:55Z","snapshot_observed_at":"2026-08-13T04:19:00.856432Z","submitted_at":"2024-02-14T15:54:55Z","title":"Transformers, parallel computation, and logarithmic depth","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.09268","snapshot_observed_at":"2026-08-12T17:05:46.830380Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.13028","last_updated":"2024-11-20T04:20:17Z","snapshot_observed_at":"2026-08-13T18:48:06.562717Z","submitted_at":"2024-11-20T04:20:17Z","title":"A Theory for Compressibility of Graph Transformers for Transductive Learning","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-12T17:05:46.830380Z"},"links":{"cited_paper":"/paper/2402.09268","citing_paper":"/paper/2411.13028"},"observation_digest":"sha256:a00c85cc1a781a8fa66aa22fa87979e766aa579910b119ccf8356fe6b6178286","observation_id":"ab793125-4774-4c0d-be2a-16eed88b2c64","resolution":{"observed_at":"2026-08-12T17:05:46.830380Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:05:47.344927Z","title":"J., and Telgarsky, M","venue":null,"work_id":"e125a476-266d-4363-a467-12b67ed1f295","year":2024},"citing_paper":{"arxiv_id":"2411.13028","last_updated":"2024-11-20T04:20:17Z","snapshot_observed_at":"2026-08-13T18:48:06.562717Z","submitted_at":"2024-11-20T04:20:17Z","title":"A Theory for Compressibility of Graph Transformers for Transductive Learning","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-12T17:05:46.833579Z"},"links":{"citing_paper":"/paper/2411.13028"},"observation_digest":"sha256:3d544cf9c7011676ee241e1702dcaff1eeb01540e161b8143f47b05145cb84da","observation_id":"392fca21-a569-45bb-a378-152e09183ea2","resolution":{"observed_at":"2026-08-12T17:05:47.348450Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1811.05868","last_updated":"2019-06-18T13:15:39Z","snapshot_observed_at":"2026-08-10T09:46:29.797564Z","submitted_at":"2018-11-14T15:53:19Z","title":"Pitfalls of Graph Neural Network Evaluation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1811.05868","snapshot_observed_at":"2026-08-12T17:05:46.836867Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2411.13028","last_updated":"2024-11-20T04:20:17Z","snapshot_observed_at":"2026-08-13T18:48:06.562717Z","submitted_at":"2024-11-20T04:20:17Z","title":"A Theory for Compressibility of Graph Transformers for Transductive Learning","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-12T17:05:46.836867Z"},"links":{"cited_paper":"/paper/1811.05868","citing_paper":"/paper/2411.13028"},"observation_digest":"sha256:dd23064ecd0f40b76ade6616d158bcada8aa96ddf49e0224824099d4d2d886e3","observation_id":"99b30cdf-42a9-448a-800f-7a0bff882693","resolution":{"observed_at":"2026-08-12T17:05:46.836867Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:05:47.334220Z","title":null,"venue":null,"work_id":"f63a78cb-5c1c-4a88-a8ff-7e72eb9dc1c4","year":2024},"citing_paper":{"arxiv_id":"2411.13028","last_updated":"2024-11-20T04:20:17Z","snapshot_observed_at":"2026-08-13T18:48:06.562717Z","submitted_at":"2024-11-20T04:20:17Z","title":"A Theory for Compressibility of Graph Transformers for Transductive Learning","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-12T17:05:46.840225Z"},"links":{"citing_paper":"/paper/2411.13028"},"observation_digest":"sha256:0eca88b10eb69c30bb939291beb63b6c2112a0a1743904322e52756fc80bb0a0","observation_id":"ec5c4046-b428-4cfa-aac7-fc78a86e5368","resolution":{"observed_at":"2026-08-12T17:05:47.337846Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:05:46.843474Z","title":"J., and Sinop, A","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.13028","last_updated":"2024-11-20T04:20:17Z","snapshot_observed_at":"2026-08-13T18:48:06.562717Z","submitted_at":"2024-11-20T04:20:17Z","title":"A Theory for Compressibility of Graph Transformers for Transductive Learning","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-12T17:05:46.843474Z"},"links":{"citing_paper":"/paper/2411.13028"},"observation_digest":"sha256:2289ce9a25fcd75333e49c0daf5d7334f2e78f575674f5cf889130f1818ebd2d","observation_id":"8629bff1-af7f-4c28-a773-2cd4d9611515","resolution":{"observed_at":"2026-08-12T17:05:46.843474Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:05:46.846880Z","title":"N., Kaiser, L., and Polosukhin, I","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2411.13028","last_updated":"2024-11-20T04:20:17Z","snapshot_observed_at":"2026-08-13T18:48:06.562717Z","submitted_at":"2024-11-20T04:20:17Z","title":"A Theory for Compressibility of Graph Transformers for Transductive Learning","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-12T17:05:46.846880Z"},"links":{"citing_paper":"/paper/2411.13028"},"observation_digest":"sha256:756dadd31ae955ce184b10acb66991a934b60b67c732af14e476d01d90df4ae6","observation_id":"dd8c1e6b-7912-440a-ac74-bde8af4158d6","resolution":{"observed_at":"2026-08-12T17:05:46.846880Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:05:46.849929Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2411.13028","last_updated":"2024-11-20T04:20:17Z","snapshot_observed_at":"2026-08-13T18:48:06.562717Z","submitted_at":"2024-11-20T04:20:17Z","title":"A Theory for Compressibility of Graph Transformers for Transductive Learning","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-12T17:05:46.849929Z"},"links":{"citing_paper":"/paper/2411.13028"},"observation_digest":"sha256:18334fc07955f59e89df40794d12a448653912ce2aa5a27cd2b513c9adb6df55","observation_id":"78a4aa94-d3d7-476c-a0e3-96fa5f679c4e","resolution":{"observed_at":"2026-08-12T17:05:46.849929Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1909.01315","last_updated":"2020-08-25T15:46:13Z","snapshot_observed_at":"2026-07-06T08:18:46.549511Z","submitted_at":"2019-09-03T17:10:28Z","title":"Deep Graph Library: A Graph-Centric, Highly-Performant Package for Graph Neural Networks","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1909.01315","snapshot_observed_at":"2026-08-12T17:05:46.852927Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2411.13028","last_updated":"2024-11-20T04:20:17Z","snapshot_observed_at":"2026-08-13T18:48:06.562717Z","submitted_at":"2024-11-20T04:20:17Z","title":"A Theory for Compressibility of Graph Transformers for Transductive Learning","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-12T17:05:46.852927Z"},"links":{"cited_paper":"/paper/1909.01315","citing_paper":"/paper/2411.13028"},"observation_digest":"sha256:2cae7160fe7b38985820670b86f9ec061ad7a3cd76fe397a3d71b2e6fe08e721","observation_id":"d3126caa-14a9-4315-930f-84b33ebbbf4a","resolution":{"observed_at":"2026-08-12T17:05:46.852927Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2006.04768","last_updated":"2020-06-14T08:15:54Z","snapshot_observed_at":"2026-07-06T09:27:03.809621Z","submitted_at":"2020-06-08T17:37:52Z","title":"Linformer: Self-Attention with Linear Complexity","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2006.04768","snapshot_observed_at":"2026-08-12T17:05:46.856049Z","title":"Z., Khabsa, M., Fang, H., and Ma, H","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2411.13028","last_updated":"2024-11-20T04:20:17Z","snapshot_observed_at":"2026-08-13T18:48:06.562717Z","submitted_at":"2024-11-20T04:20:17Z","title":"A Theory for Compressibility of Graph Transformers for Transductive Learning","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-12T17:05:46.856049Z"},"links":{"cited_paper":"/paper/2006.04768","citing_paper":"/paper/2411.13028"},"observation_digest":"sha256:920fd50c353d8dc0d2cfc10b6beafdfbe5682de2a8b96e411d8a9020a3e076db","observation_id":"952657f3-3394-4ea8-b6da-6626f01fb363","resolution":{"observed_at":"2026-08-12T17:05:46.856049Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:05:47.301691Z","title":null,"venue":null,"work_id":"e38a3fe0-c7d6-4944-9b55-fe64f7be844c","year":2014},"citing_paper":{"arxiv_id":"2411.13028","last_updated":"2024-11-20T04:20:17Z","snapshot_observed_at":"2026-08-13T18:48:06.562717Z","submitted_at":"2024-11-20T04:20:17Z","title":"A Theory for Compressibility of Graph Transformers for Transductive Learning","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-12T17:05:46.859209Z"},"links":{"citing_paper":"/paper/2411.13028"},"observation_digest":"sha256:0517950af380cd9019aa540f3703bff3da4199fd27ea659e78414b446d9f79f1","observation_id":"bf6274b9-93cc-4cc7-a559-7ad564acd163","resolution":{"observed_at":"2026-08-12T17:05:47.307089Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:05:46.861996Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2411.13028","last_updated":"2024-11-20T04:20:17Z","snapshot_observed_at":"2026-08-13T18:48:06.562717Z","submitted_at":"2024-11-20T04:20:17Z","title":"A Theory for Compressibility of Graph Transformers for Transductive Learning","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-12T17:05:46.861996Z"},"links":{"citing_paper":"/paper/2411.13028"},"observation_digest":"sha256:26bad36c7f0501dbf29e0b1ab4fba7c16f0fe22a289abbf09b7d8fad6ee7b451","observation_id":"35be007d-a992-4bb8-8cfa-2605db5f9718","resolution":{"observed_at":"2026-08-12T17:05:46.861996Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2301.09474","last_updated":"2023-05-28T09:19:49Z","snapshot_observed_at":"2026-08-13T12:59:35.404748Z","submitted_at":"2023-01-23T15:18:54Z","title":"DIFFormer: Scalable (Graph) Transformers Induced by Energy Constrained Diffusion","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.09474","snapshot_observed_at":"2026-08-12T17:05:46.865095Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.13028","last_updated":"2024-11-20T04:20:17Z","snapshot_observed_at":"2026-08-13T18:48:06.562717Z","submitted_at":"2024-11-20T04:20:17Z","title":"A Theory for Compressibility of Graph Transformers for Transductive Learning","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-12T17:05:46.865095Z"},"links":{"cited_paper":"/paper/2301.09474","citing_paper":"/paper/2411.13028"},"observation_digest":"sha256:b21fbec06a99bdd2dbb6c19606e1a52c4cdda5ca04933eb84ed31031539a543c","observation_id":"98f95dc5-a8b8-42b8-8da6-f00a21135288","resolution":{"observed_at":"2026-08-12T17:05:46.865095Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:05:46.868519Z","title":"P., and Yan, J","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.13028","last_updated":"2024-11-20T04:20:17Z","snapshot_observed_at":"2026-08-13T18:48:06.562717Z","submitted_at":"2024-11-20T04:20:17Z","title":"A Theory for Compressibility of Graph Transformers for Transductive Learning","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-12T17:05:46.868519Z"},"links":{"citing_paper":"/paper/2411.13028"},"observation_digest":"sha256:52bc104516a29834cf444b91dee8f76cc2d8cbd0e76141ad3878070e3557ff2e","observation_id":"ff8fc27c-0378-462a-b836-fb3740e6f2fd","resolution":{"observed_at":"2026-08-12T17:05:46.868519Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:05:46.872287Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.13028","last_updated":"2024-11-20T04:20:17Z","snapshot_observed_at":"2026-08-13T18:48:06.562717Z","submitted_at":"2024-11-20T04:20:17Z","title":"A Theory for Compressibility of Graph Transformers for Transductive Learning","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-12T17:05:46.872287Z"},"links":{"citing_paper":"/paper/2411.13028"},"observation_digest":"sha256:4d3c28fa8b66dddc541876acf1c37042a2bbb28dd27bde37faf2456a4e9f6641","observation_id":"64b8f0f2-adde-4ac1-a883-54605fe4aeea","resolution":{"observed_at":"2026-08-12T17:05:46.872287Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2106.05234","last_updated":"2021-11-24T01:39:16Z","snapshot_observed_at":"2026-08-13T19:06:58.256921Z","submitted_at":"2021-06-09T17:18:52Z","title":"Do Transformers Really Perform Bad for Graph Representation?","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.05234","snapshot_observed_at":"2026-08-12T17:05:46.875599Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2411.13028","last_updated":"2024-11-20T04:20:17Z","snapshot_observed_at":"2026-08-13T18:48:06.562717Z","submitted_at":"2024-11-20T04:20:17Z","title":"A Theory for Compressibility of Graph Transformers for Transductive Learning","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-12T17:05:46.875599Z"},"links":{"cited_paper":"/paper/2106.05234","citing_paper":"/paper/2411.13028"},"observation_digest":"sha256:cef9a2028ad7ad0a598234abb4e49c2c54b0eebb7c2d37e6966ad7b3db3a37f9","observation_id":"7589b553-6c72-457e-a1ea-30c121dff50b","resolution":{"observed_at":"2026-08-12T17:05:46.875599Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:05:46.879487Z","title":"A., Ainslie, J., Alberti, C., Ontanon, S., Pham, P., Ravula, A., Wang, Q., Yang, L., et al","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2411.13028","last_updated":"2024-11-20T04:20:17Z","snapshot_observed_at":"2026-08-13T18:48:06.562717Z","submitted_at":"2024-11-20T04:20:17Z","title":"A Theory for Compressibility of Graph Transformers for Transductive Learning","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-12T17:05:46.879487Z"},"links":{"citing_paper":"/paper/2411.13028"},"observation_digest":"sha256:446cc66f55de35d4734b933462f846e69fdf597e7f55f3c26848c7dbcf7bbb7f","observation_id":"38212b63-321e-40c3-9dba-aef51f58b573","resolution":{"observed_at":"2026-08-12T17:05:46.879487Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2411.13028","last_updated":"2024-11-20T04:20:17Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-13T18:48:06.562717Z","submitted_at":"2024-11-20T04:20:17Z","title":"A Theory for Compressibility of Graph Transformers for Transductive Learning"},"reference_resolution":{"displayed":45,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":42,"verified_exact":0,"verified_fuzzy":3},"total_outbound_references":45},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"thesis":"As of 14 August 2026, this Paper Citation Record lists 45 of 45 outbound references and 3 inbound Pith citation observations for arXiv:2411.13028."}