{"as_of":"2026-08-08T06:15:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:2fb4c0642ceeaf682bea0fb28a8ad944ceb6fa9577d042ea1963e5539532a0a1","coverage":[{"denominator":27,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":27,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T21:45:27.755223Z","state":"measured"},{"denominator":27,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":27,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.03294/citation-record","integrity":"/paper/2608.03294/integrity","json":"/paper/2608.03294/citation-record.json","paper":"/paper/2608.03294"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2601.16873","last_updated":"2026-05-04T15:43:18Z","snapshot_observed_at":"2026-07-06T22:42:48.338004Z","submitted_at":"2026-01-23T16:28:22Z","title":"Provably Learning Attention with Queries","version":2},"cited_work":{"arxiv_id":"2601.16873","doi":null,"metadata_source":"pith","pith_arxiv_id":"2601.16873","snapshot_observed_at":"2026-08-05T21:45:27.866030Z","title":"Provably Learning Attention with Queries","venue":"cs.LG","work_id":"26b0f773-a053-4fc9-a0a5-20618e0bd879","year":2026},"citing_paper":{"arxiv_id":"2608.03294","last_updated":"2026-08-04T08:06:15Z","snapshot_observed_at":"2026-08-07T23:10:52.348739Z","submitted_at":"2026-08-04T08:06:15Z","title":"Provably Learning Multi-Head Attention with Queries","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-05T21:45:25.605280Z"},"links":{"cited_paper":"/paper/2601.16873","citing_paper":"/paper/2608.03294"},"observation_digest":"sha256:60eede5304870f427be1444c125f19db8402dc2275f40af7e995ae7ce9c44e00","observation_id":"8f68faf1-d7e6-47ae-95e3-a6d59ad413af","resolution":{"observed_at":"2026-08-05T21:45:27.926863Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:45:25.674045Z","title":"Advances in neural information processing systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03294","last_updated":"2026-08-04T08:06:15Z","snapshot_observed_at":"2026-08-07T23:10:52.348739Z","submitted_at":"2026-08-04T08:06:15Z","title":"Provably Learning Multi-Head Attention with Queries","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-05T21:45:25.674045Z"},"links":{"citing_paper":"/paper/2608.03294"},"observation_digest":"sha256:5471a8d3b0fc4f8643cbca5816d140068cf9584b945e7e6d12dba87f04ebf749","observation_id":"def06a70-a555-4e4d-8413-9a427295feee","resolution":{"observed_at":"2026-08-05T21:45:25.674045Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:45:32.523604Z","title":"Tony and Zhang, Anru , title =","venue":null,"work_id":"811a39c1-ea80-43f9-b396-02322203af20","year":2015},"citing_paper":{"arxiv_id":"2608.03294","last_updated":"2026-08-04T08:06:15Z","snapshot_observed_at":"2026-08-07T23:10:52.348739Z","submitted_at":"2026-08-04T08:06:15Z","title":"Provably Learning Multi-Head Attention with Queries","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-05T21:45:25.782391Z"},"links":{"citing_paper":"/paper/2608.03294"},"observation_digest":"sha256:cfcda537d7b1d3c87acffa1ac72662e6c3571d74bbd00d5796f7325eb6c1ae40","observation_id":"4cba1064-ada3-4646-9f68-71581ec782fa","resolution":{"observed_at":"2026-08-05T21:45:32.653834Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:45:32.219045Z","title":"International Conference on Learning Representations , year =","venue":null,"work_id":"2750993f-de97-4554-a388-e53f9aca5c83","year":null},"citing_paper":{"arxiv_id":"2608.03294","last_updated":"2026-08-04T08:06:15Z","snapshot_observed_at":"2026-08-07T23:10:52.348739Z","submitted_at":"2026-08-04T08:06:15Z","title":"Provably Learning Multi-Head Attention with Queries","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-05T21:45:25.859870Z"},"links":{"citing_paper":"/paper/2608.03294"},"observation_digest":"sha256:58f0653e43c7b1b767646bb69791b35093d1752c4eab346211efd78ca613dd81","observation_id":"5429f7c7-d942-468b-ad8f-fc38e64de286","resolution":{"observed_at":"2026-08-05T21:45:32.387892Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:45:31.964486Z","title":"Forty-third International Conference on Machine Learning , year=","venue":null,"work_id":"8e2d8526-9a4e-42d5-90ac-f0c389e5417f","year":null},"citing_paper":{"arxiv_id":"2608.03294","last_updated":"2026-08-04T08:06:15Z","snapshot_observed_at":"2026-08-07T23:10:52.348739Z","submitted_at":"2026-08-04T08:06:15Z","title":"Provably Learning Multi-Head Attention with Queries","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-05T21:45:25.940069Z"},"links":{"citing_paper":"/paper/2608.03294"},"observation_digest":"sha256:57c3c08344404f8a87f78dceb1c3c8cd9c66ed6e62373f8fe0f3d89ae6d849e8","observation_id":"f86d90be-32a6-46df-9f5e-de60c714eaca","resolution":{"observed_at":"2026-08-05T21:45:32.074437Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:45:31.777728Z","title":"Proceedings of the 57th Annual ACM Symposium on Theory of Computing , year =","venue":null,"work_id":"7029b42d-cf76-495f-8dac-1508646d0ecc","year":null},"citing_paper":{"arxiv_id":"2608.03294","last_updated":"2026-08-04T08:06:15Z","snapshot_observed_at":"2026-08-07T23:10:52.348739Z","submitted_at":"2026-08-04T08:06:15Z","title":"Provably Learning Multi-Head Attention with Queries","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-05T21:45:26.022459Z"},"links":{"citing_paper":"/paper/2608.03294"},"observation_digest":"sha256:f2bfff04d7863b5493bfe413a8bbb17ae065de87c324809c66c13eb04604f781","observation_id":"cffd3355-52ee-4f8d-bdfe-8fc6a22e082a","resolution":{"observed_at":"2026-08-05T21:45:31.873705Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:45:31.511186Z","title":"2025 , eprint =","venue":null,"work_id":"0362f0f3-7c85-4010-b803-3570749c726e","year":2025},"citing_paper":{"arxiv_id":"2608.03294","last_updated":"2026-08-04T08:06:15Z","snapshot_observed_at":"2026-08-07T23:10:52.348739Z","submitted_at":"2026-08-04T08:06:15Z","title":"Provably Learning Multi-Head Attention with Queries","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-05T21:45:26.112860Z"},"links":{"citing_paper":"/paper/2608.03294"},"observation_digest":"sha256:011adce26c566e1c3118dae22b11263cb0dbf8431cd6e179d0fd615b269bd3f9","observation_id":"bd961b1b-3ad7-4c5e-bebc-c7972d4a33e1","resolution":{"observed_at":"2026-08-05T21:45:31.643356Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:45:26.185952Z","title":"2025 , eprint =","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.03294","last_updated":"2026-08-04T08:06:15Z","snapshot_observed_at":"2026-08-07T23:10:52.348739Z","submitted_at":"2026-08-04T08:06:15Z","title":"Provably Learning Multi-Head Attention with Queries","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-05T21:45:26.185952Z"},"links":{"citing_paper":"/paper/2608.03294"},"observation_digest":"sha256:a5b3c8fb57ad5cdcd6b165256c05a4a96a5d54aa3f0c93cd5772afbafc0fc228","observation_id":"9da00bee-8195-460f-93ea-2aa78bc475ba","resolution":{"observed_at":"2026-08-05T21:45:26.185952Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:45:31.218331Z","title":"Linear Algebra and its Applications , volume =","venue":null,"work_id":"d4b6a2e3-eabe-4021-a79c-957f23da4b33","year":2018},"citing_paper":{"arxiv_id":"2608.03294","last_updated":"2026-08-04T08:06:15Z","snapshot_observed_at":"2026-08-07T23:10:52.348739Z","submitted_at":"2026-08-04T08:06:15Z","title":"Provably Learning Multi-Head Attention with Queries","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-05T21:45:26.289950Z"},"links":{"citing_paper":"/paper/2608.03294"},"observation_digest":"sha256:fd0d765b54f684bd099466707e07efbe8cef740d6536d9453fe2bcd22dffce41","observation_id":"eb052436-c563-4b2f-9fa9-f10075fbf26e","resolution":{"observed_at":"2026-08-05T21:45:31.333929Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:45:30.940872Z","title":"Applied and Computational Harmonic Analysis , volume =","venue":null,"work_id":"555d8a9c-a338-4627-8310-86dc47379a9e","year":2024},"citing_paper":{"arxiv_id":"2608.03294","last_updated":"2026-08-04T08:06:15Z","snapshot_observed_at":"2026-08-07T23:10:52.348739Z","submitted_at":"2026-08-04T08:06:15Z","title":"Provably Learning Multi-Head Attention with Queries","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-05T21:45:26.377785Z"},"links":{"citing_paper":"/paper/2608.03294"},"observation_digest":"sha256:9d9332f26946662134d5cb1daa7be4eab57fc1eb68346e8ea9023d81bea93a1e","observation_id":"741433eb-9772-4bae-9b73-dfc3244ed3cf","resolution":{"observed_at":"2026-08-05T21:45:31.112027Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:45:30.766074Z","title":"Proceedings of the 42nd International Conference on Machine Learning , pages =","venue":null,"work_id":"ae3d47ff-fc72-431a-bb82-92a99288bc47","year":2025},"citing_paper":{"arxiv_id":"2608.03294","last_updated":"2026-08-04T08:06:15Z","snapshot_observed_at":"2026-08-07T23:10:52.348739Z","submitted_at":"2026-08-04T08:06:15Z","title":"Provably Learning Multi-Head Attention with Queries","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-05T21:45:26.435502Z"},"links":{"citing_paper":"/paper/2608.03294"},"observation_digest":"sha256:9e7a01001f7a4ab011888b2a0967d131e46592686cc90c221673fd9b5bc165c0","observation_id":"696c57d5-b692-4aeb-a8a6-9b2441e963c6","resolution":{"observed_at":"2026-08-05T21:45:30.863713Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:45:30.527998Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":"6096741e-82e6-4ba6-a5db-ed898f87fb9c","year":null},"citing_paper":{"arxiv_id":"2608.03294","last_updated":"2026-08-04T08:06:15Z","snapshot_observed_at":"2026-08-07T23:10:52.348739Z","submitted_at":"2026-08-04T08:06:15Z","title":"Provably Learning Multi-Head Attention with Queries","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-05T21:45:26.486140Z"},"links":{"citing_paper":"/paper/2608.03294"},"observation_digest":"sha256:24fee0aa6636d828ba11d296a5d60f8b41dba9003a7374bbc2090e769f811bab","observation_id":"c219d0ed-c8bb-45db-ad4a-781f392fd185","resolution":{"observed_at":"2026-08-05T21:45:30.628122Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:45:30.371947Z","title":"Machine Learning , volume =","venue":null,"work_id":"720865b2-7084-44d9-90f2-14d99e7ea55f","year":1988},"citing_paper":{"arxiv_id":"2608.03294","last_updated":"2026-08-04T08:06:15Z","snapshot_observed_at":"2026-08-07T23:10:52.348739Z","submitted_at":"2026-08-04T08:06:15Z","title":"Provably Learning Multi-Head Attention with Queries","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-05T21:45:26.546507Z"},"links":{"citing_paper":"/paper/2608.03294"},"observation_digest":"sha256:98be4b66b1846ad541f3122be3b999b6ba00571995868c287b009000e3ed83df","observation_id":"7dd9e61a-9d9d-4047-a73d-1c4c1c7bd083","resolution":{"observed_at":"2026-08-05T21:45:30.425987Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:45:30.215566Z","title":"Advances in Neural Information Processing Systems , editor =","venue":null,"work_id":"4a62118a-3de1-4d98-9966-71a454efd8a9","year":1993},"citing_paper":{"arxiv_id":"2608.03294","last_updated":"2026-08-04T08:06:15Z","snapshot_observed_at":"2026-08-07T23:10:52.348739Z","submitted_at":"2026-08-04T08:06:15Z","title":"Provably Learning Multi-Head Attention with Queries","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-05T21:45:26.642448Z"},"links":{"citing_paper":"/paper/2608.03294"},"observation_digest":"sha256:641fb0981edee7d2c4a0b46dacefc721e387ba6c26fed5561441b3d0ed9719e1","observation_id":"59bef458-5020-454b-a6c3-5f2d851f9327","resolution":{"observed_at":"2026-08-05T21:45:30.295955Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:45:29.991014Z","title":"and Meka, Raghu , booktitle =","venue":null,"work_id":"fed50522-6248-4482-b09d-c07c1e75d364","year":null},"citing_paper":{"arxiv_id":"2608.03294","last_updated":"2026-08-04T08:06:15Z","snapshot_observed_at":"2026-08-07T23:10:52.348739Z","submitted_at":"2026-08-04T08:06:15Z","title":"Provably Learning Multi-Head Attention with Queries","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-05T21:45:26.699013Z"},"links":{"citing_paper":"/paper/2608.03294"},"observation_digest":"sha256:ae811f66e01847142103fd37775ca34c4d675de57f91ebc70c3295f248cd0917","observation_id":"75ec6b7d-8a25-44ec-abad-c6b2afc3e984","resolution":{"observed_at":"2026-08-05T21:45:30.060348Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:45:29.795831Z","title":"An Exact Poly-Time Membership-Queries Algorithm for Extracting a Three-Layer","venue":null,"work_id":"bfc8badc-92d9-4487-9c01-c864192b218d","year":null},"citing_paper":{"arxiv_id":"2608.03294","last_updated":"2026-08-04T08:06:15Z","snapshot_observed_at":"2026-08-07T23:10:52.348739Z","submitted_at":"2026-08-04T08:06:15Z","title":"Provably Learning Multi-Head Attention with Queries","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-05T21:45:26.780710Z"},"links":{"citing_paper":"/paper/2608.03294"},"observation_digest":"sha256:59191567023f06cae02079526f98aaf9e7b00001e240b25667ecf9354465f3dd","observation_id":"0be62352-4cd7-4f80-ad81-d318791a628a","resolution":{"observed_at":"2026-08-05T21:45:29.871064Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:45:29.646598Z","title":"Stealing Machine Learning Models via Prediction","venue":null,"work_id":"47116973-6f89-400c-bfed-97d7484602ef","year":2016},"citing_paper":{"arxiv_id":"2608.03294","last_updated":"2026-08-04T08:06:15Z","snapshot_observed_at":"2026-08-07T23:10:52.348739Z","submitted_at":"2026-08-04T08:06:15Z","title":"Provably Learning Multi-Head Attention with Queries","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-05T21:45:26.857514Z"},"links":{"citing_paper":"/paper/2608.03294"},"observation_digest":"sha256:e856e13b64ca61728b356187f2d3ce062152b740f72232d37bb14e1e8caf966e","observation_id":"e8084e1f-136e-4f5b-b890-eff846d67eed","resolution":{"observed_at":"2026-08-05T21:45:29.735148Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:45:29.507779Z","title":"29th USENIX Security Symposium (USENIX Security 20) , pages =","venue":null,"work_id":"28fcb8c6-85a9-40f2-a90e-8cc377580f13","year":2020},"citing_paper":{"arxiv_id":"2608.03294","last_updated":"2026-08-04T08:06:15Z","snapshot_observed_at":"2026-08-07T23:10:52.348739Z","submitted_at":"2026-08-04T08:06:15Z","title":"Provably Learning Multi-Head Attention with Queries","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-05T21:45:26.943094Z"},"links":{"citing_paper":"/paper/2608.03294"},"observation_digest":"sha256:d35c4d782b8369fd3fda4803791ed6911cbfced01e59d38361ff3b07cd0e2262","observation_id":"0f1def0a-056e-4783-a56f-47541776677b","resolution":{"observed_at":"2026-08-05T21:45:29.581621Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:45:29.308602Z","title":"Proceedings of the 41st International Conference on Machine Learning , series =","venue":null,"work_id":"42cafb53-a3d7-4756-b25c-4981fba8a54a","year":2024},"citing_paper":{"arxiv_id":"2608.03294","last_updated":"2026-08-04T08:06:15Z","snapshot_observed_at":"2026-08-07T23:10:52.348739Z","submitted_at":"2026-08-04T08:06:15Z","title":"Provably Learning Multi-Head Attention with Queries","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-05T21:45:27.020995Z"},"links":{"citing_paper":"/paper/2608.03294"},"observation_digest":"sha256:0c035e623894134fe398d47ee14d702d77bdd8f233d08c63167217b4e91e3e25","observation_id":"44cbde23-6904-4e18-b5b8-5b54f672b1dc","resolution":{"observed_at":"2026-08-05T21:45:29.407183Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:45:29.148038Z","title":"Advances in Cryptology -- EUROCRYPT 2025 , editor =","venue":null,"work_id":"87a704b3-9b14-42d4-bad8-fa0283229cb0","year":2025},"citing_paper":{"arxiv_id":"2608.03294","last_updated":"2026-08-04T08:06:15Z","snapshot_observed_at":"2026-08-07T23:10:52.348739Z","submitted_at":"2026-08-04T08:06:15Z","title":"Provably Learning Multi-Head Attention with Queries","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-05T21:45:27.105212Z"},"links":{"citing_paper":"/paper/2608.03294"},"observation_digest":"sha256:6b820dd77c9f34b0cce7c1de1cbb279bd9c9da18615c43a8ace9eb9c16687d85","observation_id":"52eb2794-0807-4ac1-820b-0f34f9a6f394","resolution":{"observed_at":"2026-08-05T21:45:29.226127Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:45:28.890796Z","title":"2026 , howpublished =","venue":null,"work_id":"66ac1c16-8c33-4b09-a6d0-2b8a0a84cdc1","year":2026},"citing_paper":{"arxiv_id":"2608.03294","last_updated":"2026-08-04T08:06:15Z","snapshot_observed_at":"2026-08-07T23:10:52.348739Z","submitted_at":"2026-08-04T08:06:15Z","title":"Provably Learning Multi-Head Attention with Queries","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-05T21:45:27.215109Z"},"links":{"citing_paper":"/paper/2608.03294"},"observation_digest":"sha256:5741999b41031e12244ca6e8f905ff4d9f12bcf275e5a3a959b53cf9857ccb4c","observation_id":"26ceb99d-cacc-45ff-8dfe-881b4859483f","resolution":{"observed_at":"2026-08-05T21:45:29.054148Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:45:28.640750Z","title":"2026 , howpublished =","venue":null,"work_id":"75b5cabc-1979-44e0-a29b-90ec900880d1","year":2026},"citing_paper":{"arxiv_id":"2608.03294","last_updated":"2026-08-04T08:06:15Z","snapshot_observed_at":"2026-08-07T23:10:52.348739Z","submitted_at":"2026-08-04T08:06:15Z","title":"Provably Learning Multi-Head Attention with Queries","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-05T21:45:27.302163Z"},"links":{"citing_paper":"/paper/2608.03294"},"observation_digest":"sha256:08bbc07c80bcf96765df449af65139ba29c60c8fed29de5f04ae65ce5bf93fe9","observation_id":"e5ce0fb5-27f7-4543-a21a-576e59933bdd","resolution":{"observed_at":"2026-08-05T21:45:28.726334Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:45:28.553945Z","title":null,"venue":null,"work_id":"3a0ac4e4-c7f5-4298-a627-e6ce2d2163ac","year":2019},"citing_paper":{"arxiv_id":"2608.03294","last_updated":"2026-08-04T08:06:15Z","snapshot_observed_at":"2026-08-07T23:10:52.348739Z","submitted_at":"2026-08-04T08:06:15Z","title":"Provably Learning Multi-Head Attention with Queries","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-05T21:45:27.379184Z"},"links":{"citing_paper":"/paper/2608.03294"},"observation_digest":"sha256:cf7555b2bd39bd722f23fae6dcea927c6ccf9c9a04769368a9cb3021f24bb0cb","observation_id":"29584e01-e485-4745-b97f-c41636198fd9","resolution":{"observed_at":"2026-08-05T21:45:28.635575Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:45:28.381022Z","title":"Dragan and Moritz Hardt , title =","venue":null,"work_id":"4e73d01a-4e36-446a-a72d-7f6c46a8e9c5","year":2019},"citing_paper":{"arxiv_id":"2608.03294","last_updated":"2026-08-04T08:06:15Z","snapshot_observed_at":"2026-08-07T23:10:52.348739Z","submitted_at":"2026-08-04T08:06:15Z","title":"Provably Learning Multi-Head Attention with Queries","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-05T21:45:27.489628Z"},"links":{"citing_paper":"/paper/2608.03294"},"observation_digest":"sha256:d69cab461e352c6d01cc2f77fc52dd25263b44e2fb2069eb4d1c274d245ba288","observation_id":"6ea01fa4-7de5-47fa-9e95-62f1b3e00b12","resolution":{"observed_at":"2026-08-05T21:45:28.463030Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:45:28.215299Z","title":"International Conference on the Theory and Application of Cryptology and Information Security , pages=","venue":null,"work_id":"85c84b6a-8623-4d68-a5e1-af8ee0f6b69a","year":2024},"citing_paper":{"arxiv_id":"2608.03294","last_updated":"2026-08-04T08:06:15Z","snapshot_observed_at":"2026-08-07T23:10:52.348739Z","submitted_at":"2026-08-04T08:06:15Z","title":"Provably Learning Multi-Head Attention with Queries","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-05T21:45:27.581017Z"},"links":{"citing_paper":"/paper/2608.03294"},"observation_digest":"sha256:1d12ec62bf7a40367d6ef0565864fc2cd258a5d7aea91b7a8b2309f9448b395a","observation_id":"436c34f2-858a-4c92-9c44-d5b2fd2eb374","resolution":{"observed_at":"2026-08-05T21:45:28.296308Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1908.04211","last_updated":"2020-02-07T17:44:52Z","snapshot_observed_at":"2026-08-07T04:06:07.378080Z","submitted_at":"2019-08-12T15:48:34Z","title":"On Identifiability in Transformers","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1908.04211","snapshot_observed_at":"2026-08-05T21:45:27.642304Z","title":"arXiv preprint arXiv:1908.04211 , year=","venue":null,"work_id":null,"year":1908},"citing_paper":{"arxiv_id":"2608.03294","last_updated":"2026-08-04T08:06:15Z","snapshot_observed_at":"2026-08-07T23:10:52.348739Z","submitted_at":"2026-08-04T08:06:15Z","title":"Provably Learning Multi-Head Attention with Queries","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-05T21:45:27.642304Z"},"links":{"cited_paper":"/paper/1908.04211","citing_paper":"/paper/2608.03294"},"observation_digest":"sha256:3ddf34b15c29f4cb1edb2231fb7539c69bb0a67abc2dcd506c9ad324e6ef2cfb","observation_id":"8d1c3292-16c8-45b7-b35b-d0d3fd1a8c07","resolution":{"observed_at":"2026-08-05T21:45:27.642304Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:45:28.042085Z","title":"Annual international cryptology conference , pages=","venue":null,"work_id":"b4ddcc7a-2257-48d3-bf89-88cff252fa06","year":2020},"citing_paper":{"arxiv_id":"2608.03294","last_updated":"2026-08-04T08:06:15Z","snapshot_observed_at":"2026-08-07T23:10:52.348739Z","submitted_at":"2026-08-04T08:06:15Z","title":"Provably Learning Multi-Head Attention with Queries","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-05T21:45:27.755223Z"},"links":{"citing_paper":"/paper/2608.03294"},"observation_digest":"sha256:bd44e3305ef9a5695c2ed16261efd18359579b5b931e06b842df767bf6105d38","observation_id":"3e286677-85b4-4463-acb6-b0cec39a053b","resolution":{"observed_at":"2026-08-05T21:45:28.121572Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2608.03294","last_updated":"2026-08-04T08:06:15Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-07T23:10:52.348739Z","submitted_at":"2026-08-04T08:06:15Z","title":"Provably Learning Multi-Head Attention with Queries"},"reference_resolution":{"displayed":27,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":4,"verified_exact":1,"verified_fuzzy":22},"total_outbound_references":27},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 27 of 27 outbound references and 0 inbound Pith citation observations for arXiv:2608.03294."}