{"as_of":"2026-08-09T12:04:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:71b30f31f392de47eebd37fb14a8f557e71e2681402f50aa66281c4db43cab5c","coverage":[{"denominator":18,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":18,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-27T17:09:04.556446Z","state":"measured"},{"denominator":18,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":18,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2606.09951/citation-record","integrity":"/paper/2606.09951/integrity","json":"/paper/2606.09951/citation-record.json","paper":"/paper/2606.09951"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"1706.03762","last_updated":"2023-08-02T00:41:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-06-12T17:57:34Z","title":"Attention Is All You Need","version":7},"cited_work":{"arxiv_id":"1706.03762","doi":"10.1186/s13550-021-00830-6","metadata_source":"pith","pith_arxiv_id":"1706.03762","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Attention Is All You Need","venue":"cs.CL","work_id":"baafb5a2-5272-43bc-932f-09fa9ffe5316","year":2017},"citing_paper":{"arxiv_id":"2606.09951","last_updated":"2026-06-08T09:27:47Z","snapshot_observed_at":"2026-08-08T05:37:34.221439Z","submitted_at":"2026-06-08T09:27:47Z","title":"Hasse Diagrams for Attention: A Partial Order Framework for Designing Transformer Masks","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-06-27T17:09:04.556446Z"},"links":{"cited_paper":"/paper/1706.03762","citing_paper":"/paper/2606.09951"},"observation_digest":"sha256:05c4e76e6c30abb85a324ca0be60b91ac02626d39c866b8196125068d186f285","observation_id":"6484a644-da04-4d89-b614-715c6ec52c2f","resolution":{"observed_at":"2026-07-03T00:27:30.085157Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1810.04805","last_updated":"2019-05-24T20:37:26Z","snapshot_observed_at":"2026-07-30T09:12:38.100527Z","submitted_at":"2018-10-11T00:50:01Z","title":"BERT: Pre-training of Deep Bidirectional Transformers for Language Understanding","version":2},"cited_work":{"arxiv_id":"1810.04805","doi":"10.1111/jofi.12885","metadata_source":"pith","pith_arxiv_id":"1810.04805","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"BERT: Pre-training of Deep Bidirectional Transformers for Language Understanding","venue":"cs.CL","work_id":"ed240a10-5b19-406c-baa5-30803f465785","year":2018},"citing_paper":{"arxiv_id":"2606.09951","last_updated":"2026-06-08T09:27:47Z","snapshot_observed_at":"2026-08-08T05:37:34.221439Z","submitted_at":"2026-06-08T09:27:47Z","title":"Hasse Diagrams for Attention: A Partial Order Framework for Designing Transformer Masks","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-06-27T17:09:04.556446Z"},"links":{"cited_paper":"/paper/1810.04805","citing_paper":"/paper/2606.09951"},"observation_digest":"sha256:d6b6bcf935ee5b54782814b4773253faafaebb46c7c52d453fffad4193fdee29","observation_id":"aedcc1a1-a5a2-413c-acb5-47dd59c59ad7","resolution":{"observed_at":"2026-07-03T00:27:30.080438Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T17:09:04.556446Z","title":"2018 , url=","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2606.09951","last_updated":"2026-06-08T09:27:47Z","snapshot_observed_at":"2026-08-08T05:37:34.221439Z","submitted_at":"2026-06-08T09:27:47Z","title":"Hasse Diagrams for Attention: A Partial Order Framework for Designing Transformer Masks","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-06-27T17:09:04.556446Z"},"links":{"citing_paper":"/paper/2606.09951"},"observation_digest":"sha256:752903f7ee66f60d21feca02aee245fda3cdbbda3624fa0a766dcc9ccdf103c1","observation_id":"fc98b9df-e039-42b6-897b-6d953808e8f6","resolution":{"observed_at":"2026-06-27T17:09:04.556446Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1906.08237","last_updated":"2020-01-02T12:48:08Z","snapshot_observed_at":"2026-07-31T22:49:43.034741Z","submitted_at":"2019-06-19T17:35:48Z","title":"XLNet: Generalized Autoregressive Pretraining for Language Understanding","version":2},"cited_work":{"arxiv_id":"1906.08237","doi":null,"metadata_source":"pith","pith_arxiv_id":"1906.08237","snapshot_observed_at":"2026-07-04T15:59:56.634362Z","title":"XLNet: Generalized Autoregressive Pretraining for Language Understanding","venue":"cs.CL","work_id":"cc2a714a-4036-4500-8361-52cc81c24a4c","year":2019},"citing_paper":{"arxiv_id":"2606.09951","last_updated":"2026-06-08T09:27:47Z","snapshot_observed_at":"2026-08-08T05:37:34.221439Z","submitted_at":"2026-06-08T09:27:47Z","title":"Hasse Diagrams for Attention: A Partial Order Framework for Designing Transformer Masks","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-06-27T17:09:04.556446Z"},"links":{"cited_paper":"/paper/1906.08237","citing_paper":"/paper/2606.09951"},"observation_digest":"sha256:87caced9157f6b2bb7ce70b8bfe3818891021b4b8548cf12c873b26bed649ffd","observation_id":"b088cb70-4443-49ac-bfcd-204bf014d228","resolution":{"observed_at":"2026-07-03T00:27:30.082922Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T17:09:04.556446Z","title":"FlexAttention: A Programming Model for Generating Fused Attention Variants","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.09951","last_updated":"2026-06-08T09:27:47Z","snapshot_observed_at":"2026-08-08T05:37:34.221439Z","submitted_at":"2026-06-08T09:27:47Z","title":"Hasse Diagrams for Attention: A Partial Order Framework for Designing Transformer Masks","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-06-27T17:09:04.556446Z"},"links":{"citing_paper":"/paper/2606.09951"},"observation_digest":"sha256:589072d313a2948d0262aa40ef8ce8244b75609b7fe772f234f514ca6d29e369","observation_id":"916d4191-dba7-4c4e-b529-277a83756448","resolution":{"observed_at":"2026-06-27T17:09:04.556446Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T17:09:04.556446Z","title":"2020 , eprint=","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2606.09951","last_updated":"2026-06-08T09:27:47Z","snapshot_observed_at":"2026-08-08T05:37:34.221439Z","submitted_at":"2026-06-08T09:27:47Z","title":"Hasse Diagrams for Attention: A Partial Order Framework for Designing Transformer Masks","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-06-27T17:09:04.556446Z"},"links":{"citing_paper":"/paper/2606.09951"},"observation_digest":"sha256:c42c0c7f9f6a5ff085601ee9f7197ec2205a357a6517bc2973b08e45363bf650","observation_id":"9e7d3d73-8d0d-4e40-b702-f09211e6f958","resolution":{"observed_at":"2026-06-27T17:09:04.556446Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2004.09297","last_updated":"2020-11-02T06:54:52Z","snapshot_observed_at":"2026-08-07T07:19:41.700353Z","submitted_at":"2020-04-20T13:54:12Z","title":"MPNet: Masked and Permuted Pre-training for Language Understanding","version":2},"cited_work":{"arxiv_id":"2004.09297","doi":"10.48550/arxiv.2004.09297","metadata_source":"arxiv_reference","pith_arxiv_id":"2004.09297","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Mpnet: Masked and permuted pre-training for language understanding","venue":"arXiv (Cornell University)","work_id":"050f40ae-5260-44ad-a7c7-59341223c179","year":2020},"citing_paper":{"arxiv_id":"2606.09951","last_updated":"2026-06-08T09:27:47Z","snapshot_observed_at":"2026-08-08T05:37:34.221439Z","submitted_at":"2026-06-08T09:27:47Z","title":"Hasse Diagrams for Attention: A Partial Order Framework for Designing Transformer Masks","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-06-27T17:09:04.556446Z"},"links":{"cited_paper":"/paper/2004.09297","citing_paper":"/paper/2606.09951"},"observation_digest":"sha256:f4aec9c66167a507b8b0a4691e4e83ddceeaeae4dc250b77f2e75dffedfefbef","observation_id":"19400ac9-16ab-4328-90d3-e9d41e1ec3fa","resolution":{"observed_at":"2026-07-03T00:27:30.090056Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-03T16:08:11.069814+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-03T16:08:11.069814+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T17:09:04.556446Z","title":"Applied Sciences , VOLUME =","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.09951","last_updated":"2026-06-08T09:27:47Z","snapshot_observed_at":"2026-08-08T05:37:34.221439Z","submitted_at":"2026-06-08T09:27:47Z","title":"Hasse Diagrams for Attention: A Partial Order Framework for Designing Transformer Masks","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-06-27T17:09:04.556446Z"},"links":{"citing_paper":"/paper/2606.09951"},"observation_digest":"sha256:72e9d79e079ee76c396e9f740a942f076cd4d39eca7fb3c02878d18d6f692267","observation_id":"69f6fd64-af6d-47be-9569-a5665b93ca8b","resolution":{"observed_at":"2026-06-27T17:09:04.556446Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T17:09:04.556446Z","title":"2022 , eprint=","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2606.09951","last_updated":"2026-06-08T09:27:47Z","snapshot_observed_at":"2026-08-08T05:37:34.221439Z","submitted_at":"2026-06-08T09:27:47Z","title":"Hasse Diagrams for Attention: A Partial Order Framework for Designing Transformer Masks","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-06-27T17:09:04.556446Z"},"links":{"citing_paper":"/paper/2606.09951"},"observation_digest":"sha256:669b9e492c064f2de4673e8c741ec1bcafc109ad40e492e94c0356f78901e9f6","observation_id":"1873750d-8e03-4314-b0cf-5f0e0e6a716f","resolution":{"observed_at":"2026-06-27T17:09:04.556446Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T17:09:04.556446Z","title":"Fu and Stefano Ermon and A","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.09951","last_updated":"2026-06-08T09:27:47Z","snapshot_observed_at":"2026-08-08T05:37:34.221439Z","submitted_at":"2026-06-08T09:27:47Z","title":"Hasse Diagrams for Attention: A Partial Order Framework for Designing Transformer Masks","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-06-27T17:09:04.556446Z"},"links":{"citing_paper":"/paper/2606.09951"},"observation_digest":"sha256:72527368cb679ede878401b2597d12c41d71c4c5ce5a2fa51cd2846af4a610b5","observation_id":"3cbc2c33-30a4-4007-b141-60507853faa8","resolution":{"observed_at":"2026-06-27T17:09:04.556446Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T17:09:04.556446Z","title":"2020 , eprint=","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2606.09951","last_updated":"2026-06-08T09:27:47Z","snapshot_observed_at":"2026-08-08T05:37:34.221439Z","submitted_at":"2026-06-08T09:27:47Z","title":"Hasse Diagrams for Attention: A Partial Order Framework for Designing Transformer Masks","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-06-27T17:09:04.556446Z"},"links":{"citing_paper":"/paper/2606.09951"},"observation_digest":"sha256:e83d7cbea0564d1cf7e1424ed60f300b27461d46bb4b8865428d7dc6b67b0476","observation_id":"ab5a37ed-f229-41ce-9748-a5dd5d4f6db0","resolution":{"observed_at":"2026-06-27T17:09:04.556446Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2007.14062","last_updated":"2021-01-08T07:41:50Z","snapshot_observed_at":"2026-07-06T09:42:23.296738Z","submitted_at":"2020-07-28T08:34:04Z","title":"Big Bird: Transformers for Longer Sequences","version":2},"cited_work":{"arxiv_id":"2007.14062","doi":"10.48550/arxiv.2007.14062","metadata_source":"pith","pith_arxiv_id":"2007.14062","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Big Bird: Transformers for Longer Sequences","venue":"cs.LG","work_id":"605bd800-a1a3-4bcc-b188-604145af1773","year":2020},"citing_paper":{"arxiv_id":"2606.09951","last_updated":"2026-06-08T09:27:47Z","snapshot_observed_at":"2026-08-08T05:37:34.221439Z","submitted_at":"2026-06-08T09:27:47Z","title":"Hasse Diagrams for Attention: A Partial Order Framework for Designing Transformer Masks","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-06-27T17:09:04.556446Z"},"links":{"cited_paper":"/paper/2007.14062","citing_paper":"/paper/2606.09951"},"observation_digest":"sha256:8a7fd185c818938caffc515ae3f4956cd40f5e95ad9b5ad2d480320c18cabd6b","observation_id":"f8b1a2b4-7816-470a-b20a-bcd7da18b414","resolution":{"observed_at":"2026-07-03T00:27:30.092286Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-07-12T21:50:04.522608+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-12T21:50:04.522608+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T17:09:04.556446Z","title":"2025 , eprint=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.09951","last_updated":"2026-06-08T09:27:47Z","snapshot_observed_at":"2026-08-08T05:37:34.221439Z","submitted_at":"2026-06-08T09:27:47Z","title":"Hasse Diagrams for Attention: A Partial Order Framework for Designing Transformer Masks","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-06-27T17:09:04.556446Z"},"links":{"citing_paper":"/paper/2606.09951"},"observation_digest":"sha256:7cf8c27673f6c0d84915875df9d93901b81f4ee15563812fa355b3b9eff908c9","observation_id":"de23391e-c7ad-432f-812b-cc9707ec3eb5","resolution":{"observed_at":"2026-06-27T17:09:04.556446Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T17:09:04.556446Z","title":"2025 , eprint=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.09951","last_updated":"2026-06-08T09:27:47Z","snapshot_observed_at":"2026-08-08T05:37:34.221439Z","submitted_at":"2026-06-08T09:27:47Z","title":"Hasse Diagrams for Attention: A Partial Order Framework for Designing Transformer Masks","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-06-27T17:09:04.556446Z"},"links":{"citing_paper":"/paper/2606.09951"},"observation_digest":"sha256:4d2243f45dce1c54e82e74018b69458b3f72d73319dbc224b13ffb988553adc1","observation_id":"35a2fb33-1fb7-4b58-85b6-856dee8f2462","resolution":{"observed_at":"2026-06-27T17:09:04.556446Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2004.05150","last_updated":"2020-12-02T17:52:35Z","snapshot_observed_at":"2026-07-31T17:17:17.205582Z","submitted_at":"2020-04-10T17:54:09Z","title":"Longformer: The Long-Document Transformer","version":2},"cited_work":{"arxiv_id":"2004.05150","doi":"10.48550/arxiv.2004.05150","metadata_source":"pith","pith_arxiv_id":"2004.05150","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Longformer: The Long-Document Transformer","venue":"cs.CL","work_id":"abea7a44-6668-4de7-aab6-f53a6e5aa088","year":2020},"citing_paper":{"arxiv_id":"2606.09951","last_updated":"2026-06-08T09:27:47Z","snapshot_observed_at":"2026-08-08T05:37:34.221439Z","submitted_at":"2026-06-08T09:27:47Z","title":"Hasse Diagrams for Attention: A Partial Order Framework for Designing Transformer Masks","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-06-27T17:09:04.556446Z"},"links":{"cited_paper":"/paper/2004.05150","citing_paper":"/paper/2606.09951"},"observation_digest":"sha256:88794f23864249b7dcd74750383eb61d23ba2d64174f36e9d4530983ed6d0f1f","observation_id":"6ca32e56-ea3a-482e-b073-a03e17e780a8","resolution":{"observed_at":"2026-07-03T00:27:30.087523Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-07-12T21:49:59.161233+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-12T21:49:59.161233+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T17:09:04.556446Z","title":"2025 , url =","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.09951","last_updated":"2026-06-08T09:27:47Z","snapshot_observed_at":"2026-08-08T05:37:34.221439Z","submitted_at":"2026-06-08T09:27:47Z","title":"Hasse Diagrams for Attention: A Partial Order Framework for Designing Transformer Masks","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-06-27T17:09:04.556446Z"},"links":{"citing_paper":"/paper/2606.09951"},"observation_digest":"sha256:97059544c83c73f44dc21fde05e1354f9f88798cb9fea97d43f757a0f97132a4","observation_id":"ee077be0-59d8-40a3-ae5a-b02359ddb779","resolution":{"observed_at":"2026-06-27T17:09:04.556446Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T17:09:04.556446Z","title":"Proceedings of the 42nd International Conference on Machine Learning (ICML) , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.09951","last_updated":"2026-06-08T09:27:47Z","snapshot_observed_at":"2026-08-08T05:37:34.221439Z","submitted_at":"2026-06-08T09:27:47Z","title":"Hasse Diagrams for Attention: A Partial Order Framework for Designing Transformer Masks","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-06-27T17:09:04.556446Z"},"links":{"citing_paper":"/paper/2606.09951"},"observation_digest":"sha256:319b6e61a412ffdacf3afcd55fb4e2ace36852b805bae7ee4fd11c056df211e5","observation_id":"4d246217-9510-4fda-9c80-b023238bfc71","resolution":{"observed_at":"2026-06-27T17:09:04.556446Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T17:09:04.556446Z","title":"International Conference on Learning Representations (ICLR) , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.09951","last_updated":"2026-06-08T09:27:47Z","snapshot_observed_at":"2026-08-08T05:37:34.221439Z","submitted_at":"2026-06-08T09:27:47Z","title":"Hasse Diagrams for Attention: A Partial Order Framework for Designing Transformer Masks","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-06-27T17:09:04.556446Z"},"links":{"citing_paper":"/paper/2606.09951"},"observation_digest":"sha256:08fcf2b854f263d55d202fe01fda20ed778cf0564de03cf93976bf6b95f99153","observation_id":"287bf3c9-1629-4d67-8291-bb200fa2f5ec","resolution":{"observed_at":"2026-06-27T17:09:04.556446Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2606.09951","last_updated":"2026-06-08T09:27:47Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-08T05:37:34.221439Z","submitted_at":"2026-06-08T09:27:47Z","title":"Hasse Diagrams for Attention: A Partial Order Framework for Designing Transformer Masks"},"reference_resolution":{"displayed":18,"state_counts":{"malformed_identifier":0,"metadata_mismatch":3,"parse_uncertain":0,"unresolved":12,"verified_exact":3,"verified_fuzzy":0},"total_outbound_references":18},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 18 of 18 outbound references and 0 inbound Pith citation observations for arXiv:2606.09951."}