{"as_of":"2026-08-11T05:11:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:e08e0dc79ab2cac26ddbcb906568da301ed7b0ec51d47e198a9bea8422757a59","coverage":[{"denominator":35,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":35,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-08T00:18:45.340289Z","state":"measured"},{"denominator":35,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":35,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.04213/citation-record","integrity":"/paper/2608.04213/integrity","json":"/paper/2608.04213/citation-record.json","paper":"/paper/2608.04213"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:18:44.792265Z","title":"Advances in Neural Information Processing Systems , volume =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04213","last_updated":"2026-08-04T20:26:12Z","snapshot_observed_at":"2026-08-10T12:23:12.291566Z","submitted_at":"2026-08-04T20:26:12Z","title":"Attention-Only White-Box Transformer via LeJEPA-Based Self-Supervised Pretraining","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-08T00:18:44.792265Z"},"links":{"citing_paper":"/paper/2608.04213"},"observation_digest":"sha256:4edf151712abff934d352dd4adece5e7f094e3594bf1e50fe97d3526abd7f80d","observation_id":"77a89cac-a733-4df7-8b0b-37b0af407447","resolution":{"observed_at":"2026-08-08T00:18:44.792265Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:18:46.644967Z","title":"Advances in Neural Information Processing Systems , volume =","venue":null,"work_id":"7fd3f15d-c409-4521-8672-4c6f454ea595","year":null},"citing_paper":{"arxiv_id":"2608.04213","last_updated":"2026-08-04T20:26:12Z","snapshot_observed_at":"2026-08-10T12:23:12.291566Z","submitted_at":"2026-08-04T20:26:12Z","title":"Attention-Only White-Box Transformer via LeJEPA-Based Self-Supervised Pretraining","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-08T00:18:44.873795Z"},"links":{"citing_paper":"/paper/2608.04213"},"observation_digest":"sha256:fdb7c8749558431d8161500c5e152a00c71186fb96318ace07f79522a79e0fbe","observation_id":"bad07fbf-2434-4149-b688-29faf4ee90b1","resolution":{"observed_at":"2026-08-08T00:18:46.650898Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:18:46.629585Z","title":"Proceedings of the 37th International Conference on Machine Learning , series =","venue":null,"work_id":"83f55a2b-9528-4a86-81d1-94ed85ddc8e0","year":2020},"citing_paper":{"arxiv_id":"2608.04213","last_updated":"2026-08-04T20:26:12Z","snapshot_observed_at":"2026-08-10T12:23:12.291566Z","submitted_at":"2026-08-04T20:26:12Z","title":"Attention-Only White-Box Transformer via LeJEPA-Based Self-Supervised Pretraining","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-08T00:18:44.931537Z"},"links":{"citing_paper":"/paper/2608.04213"},"observation_digest":"sha256:1280c9b38b2077c3df0bdfb8bba086df287fc4d782a26d36d81480df06dae7ba","observation_id":"3a96e4b2-0a7c-442f-be67-ca24d4580dc5","resolution":{"observed_at":"2026-08-08T00:18:46.634329Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:18:44.956656Z","title":"Advances in Neural Information Processing Systems , volume =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04213","last_updated":"2026-08-04T20:26:12Z","snapshot_observed_at":"2026-08-10T12:23:12.291566Z","submitted_at":"2026-08-04T20:26:12Z","title":"Attention-Only White-Box Transformer via LeJEPA-Based Self-Supervised Pretraining","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-08T00:18:44.956656Z"},"links":{"citing_paper":"/paper/2608.04213"},"observation_digest":"sha256:335d03f348a70a09ec157477e9459c1911deadcb96b3a434747289ba9c72f09d","observation_id":"d9ad3b3b-f4a9-479b-87f9-e39169cb6749","resolution":{"observed_at":"2026-08-08T00:18:44.956656Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:18:45.029760Z","title":"Proceedings of the IEEE/CVF International Conference on Computer Vision , pages =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04213","last_updated":"2026-08-04T20:26:12Z","snapshot_observed_at":"2026-08-10T12:23:12.291566Z","submitted_at":"2026-08-04T20:26:12Z","title":"Attention-Only White-Box Transformer via LeJEPA-Based Self-Supervised Pretraining","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-08T00:18:45.029760Z"},"links":{"citing_paper":"/paper/2608.04213"},"observation_digest":"sha256:c4722ad3c733f3c4f7a06dbbbf2f153df4d3ea280c751ca832ee8304cce9c40d","observation_id":"b02117a2-826e-4f27-ba81-fc03aec4b06a","resolution":{"observed_at":"2026-08-08T00:18:45.029760Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:18:46.592545Z","title":"Proceedings of the 38th International Conference on Machine Learning , series =","venue":null,"work_id":"25fb4181-0345-4b61-a847-7b9304649079","year":2021},"citing_paper":{"arxiv_id":"2608.04213","last_updated":"2026-08-04T20:26:12Z","snapshot_observed_at":"2026-08-10T12:23:12.291566Z","submitted_at":"2026-08-04T20:26:12Z","title":"Attention-Only White-Box Transformer via LeJEPA-Based Self-Supervised Pretraining","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-08T00:18:45.090726Z"},"links":{"citing_paper":"/paper/2608.04213"},"observation_digest":"sha256:3c7807fc81f8df8d94e69e2a275e60a2ef7f511dea45690b64be424a761af0ab","observation_id":"3038ff0c-6712-45fa-b6f8-f709151f42c8","resolution":{"observed_at":"2026-08-08T00:18:46.597649Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:18:45.095929Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04213","last_updated":"2026-08-04T20:26:12Z","snapshot_observed_at":"2026-08-10T12:23:12.291566Z","submitted_at":"2026-08-04T20:26:12Z","title":"Attention-Only White-Box Transformer via LeJEPA-Based Self-Supervised Pretraining","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-08T00:18:45.095929Z"},"links":{"citing_paper":"/paper/2608.04213"},"observation_digest":"sha256:be0fa3ab18b36f555e067587e2c0ed7a80a9b88e721139ae07b6f2740701ca95","observation_id":"b53b90a2-0d01-4350-88ae-9e349fb41a21","resolution":{"observed_at":"2026-08-08T00:18:45.095929Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:18:45.102094Z","title":"Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition , pages =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04213","last_updated":"2026-08-04T20:26:12Z","snapshot_observed_at":"2026-08-10T12:23:12.291566Z","submitted_at":"2026-08-04T20:26:12Z","title":"Attention-Only White-Box Transformer via LeJEPA-Based Self-Supervised Pretraining","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-08T00:18:45.102094Z"},"links":{"citing_paper":"/paper/2608.04213"},"observation_digest":"sha256:7d93727074b298560cbb7f356864fddf8b14bcb3d2d2a77c01bd7a871e7307aa","observation_id":"f3bb4ad2-770b-4d89-91be-f71e59054333","resolution":{"observed_at":"2026-08-08T00:18:45.102094Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:18:46.554628Z","title":"Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition , pages =","venue":null,"work_id":"18904388-46d1-4376-920a-ec8da6098e3e","year":null},"citing_paper":{"arxiv_id":"2608.04213","last_updated":"2026-08-04T20:26:12Z","snapshot_observed_at":"2026-08-10T12:23:12.291566Z","submitted_at":"2026-08-04T20:26:12Z","title":"Attention-Only White-Box Transformer via LeJEPA-Based Self-Supervised Pretraining","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-08T00:18:45.107653Z"},"links":{"citing_paper":"/paper/2608.04213"},"observation_digest":"sha256:c3181d80c47956455d7132fd7273ff94f9ae676d06331d0345375219334b1233","observation_id":"05070b09-9a91-41d8-b4d3-11a79415307d","resolution":{"observed_at":"2026-08-08T00:18:46.560324Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:18:46.536002Z","title":"Proceedings of the IEEE/CVF International Conference on Computer Vision , pages =","venue":null,"work_id":"0f156c91-27f0-4817-aa10-dae723ede9c4","year":null},"citing_paper":{"arxiv_id":"2608.04213","last_updated":"2026-08-04T20:26:12Z","snapshot_observed_at":"2026-08-10T12:23:12.291566Z","submitted_at":"2026-08-04T20:26:12Z","title":"Attention-Only White-Box Transformer via LeJEPA-Based Self-Supervised Pretraining","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-08T00:18:45.111997Z"},"links":{"citing_paper":"/paper/2608.04213"},"observation_digest":"sha256:d8f933da935dc19347a3b9178a41503b149402028264e9d3b8c2ee5cc1aafe3a","observation_id":"b7c45e48-fb6d-4112-b4d0-1de75f7a3a0b","resolution":{"observed_at":"2026-08-08T00:18:46.542406Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:18:46.521356Z","title":"Proceedings of the 38th International Conference on Machine Learning , series =","venue":null,"work_id":"4dd0f949-47a2-4d4e-9257-51ec1188b232","year":2021},"citing_paper":{"arxiv_id":"2608.04213","last_updated":"2026-08-04T20:26:12Z","snapshot_observed_at":"2026-08-10T12:23:12.291566Z","submitted_at":"2026-08-04T20:26:12Z","title":"Attention-Only White-Box Transformer via LeJEPA-Based Self-Supervised Pretraining","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-08T00:18:45.116631Z"},"links":{"citing_paper":"/paper/2608.04213"},"observation_digest":"sha256:69ad4312f95bfa91260fd75de373a7bcc721eb0d012edc35d6d08ba0cca25e4e","observation_id":"c9bdbd74-b4c6-47ad-9b2b-9ae6d771dbec","resolution":{"observed_at":"2026-08-08T00:18:46.525885Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:18:46.505930Z","title":"International Conference on Learning Representations , year =","venue":null,"work_id":"bc60ff62-70c9-4565-8589-1186fc4cb4d2","year":null},"citing_paper":{"arxiv_id":"2608.04213","last_updated":"2026-08-04T20:26:12Z","snapshot_observed_at":"2026-08-10T12:23:12.291566Z","submitted_at":"2026-08-04T20:26:12Z","title":"Attention-Only White-Box Transformer via LeJEPA-Based Self-Supervised Pretraining","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-08T00:18:45.121605Z"},"links":{"citing_paper":"/paper/2608.04213"},"observation_digest":"sha256:29ba7e918754c1c57b5fbabc80aa31740239575daada4a19e63a37328cb554c2","observation_id":"f1b76751-bca4-487c-aaac-e89c0017ed2f","resolution":{"observed_at":"2026-08-08T00:18:46.510739Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:18:46.439370Z","title":"Proceedings of the 27th International Conference on Machine Learning , pages =","venue":null,"work_id":"459a4d1b-3001-4bf8-ace8-fbd5b1ea33e3","year":null},"citing_paper":{"arxiv_id":"2608.04213","last_updated":"2026-08-04T20:26:12Z","snapshot_observed_at":"2026-08-10T12:23:12.291566Z","submitted_at":"2026-08-04T20:26:12Z","title":"Attention-Only White-Box Transformer via LeJEPA-Based Self-Supervised Pretraining","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-08T00:18:45.126285Z"},"links":{"citing_paper":"/paper/2608.04213"},"observation_digest":"sha256:eb4980b316f3b77984f5fb27f1664006fe84993de121231e8a358722b60676a7","observation_id":"d2b8de9b-7a05-4e7a-9ada-4f84dba766aa","resolution":{"observed_at":"2026-08-08T00:18:46.472031Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:18:46.302700Z","title":"SIAM Journal on Imaging Sciences , volume =","venue":null,"work_id":"63f962bc-4750-4202-85ad-63898debb37c","year":2009},"citing_paper":{"arxiv_id":"2608.04213","last_updated":"2026-08-04T20:26:12Z","snapshot_observed_at":"2026-08-10T12:23:12.291566Z","submitted_at":"2026-08-04T20:26:12Z","title":"Attention-Only White-Box Transformer via LeJEPA-Based Self-Supervised Pretraining","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-08T00:18:45.131265Z"},"links":{"citing_paper":"/paper/2608.04213"},"observation_digest":"sha256:9f96452590a1b00085f4581efcdf9b6e7290ef00272e9e574fde677e17ffcf25","observation_id":"b1b2b08b-2536-4e38-bbdb-dd1c79f7cabc","resolution":{"observed_at":"2026-08-08T00:18:46.361915Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:18:46.288282Z","title":"SIAM Journal on Scientific Computing , volume =","venue":null,"work_id":"35ab65e8-3004-43d3-bf81-b774eacd6a60","year":1998},"citing_paper":{"arxiv_id":"2608.04213","last_updated":"2026-08-04T20:26:12Z","snapshot_observed_at":"2026-08-10T12:23:12.291566Z","submitted_at":"2026-08-04T20:26:12Z","title":"Attention-Only White-Box Transformer via LeJEPA-Based Self-Supervised Pretraining","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-08T00:18:45.136361Z"},"links":{"citing_paper":"/paper/2608.04213"},"observation_digest":"sha256:91fa89be8800f41939c7554d87fd3955072754d5b67717f076b936d85ef284c0","observation_id":"f9e93872-8a7f-4623-a730-9ee5dcc9fff1","resolution":{"observed_at":"2026-08-08T00:18:46.292743Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:18:46.273512Z","title":"Foundations and Trends in Optimization , volume =","venue":null,"work_id":"f8f55576-b351-4d8f-8778-33e6d258ccf0","year":2014},"citing_paper":{"arxiv_id":"2608.04213","last_updated":"2026-08-04T20:26:12Z","snapshot_observed_at":"2026-08-10T12:23:12.291566Z","submitted_at":"2026-08-04T20:26:12Z","title":"Attention-Only White-Box Transformer via LeJEPA-Based Self-Supervised Pretraining","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-08T00:18:45.141304Z"},"links":{"citing_paper":"/paper/2608.04213"},"observation_digest":"sha256:6a56e08cbd92ecc6d04dd9547f30fe2bd2ff438f9d8fba4d412a91c7eb5266d0","observation_id":"1cc2f94d-cae9-4359-8e8b-b69b142e2120","resolution":{"observed_at":"2026-08-08T00:18:46.277915Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:18:46.258100Z","title":"Communications on Pure and Applied Mathematics , volume =","venue":null,"work_id":"49cc97d1-7647-4a7f-83b4-b603103b9433","year":2004},"citing_paper":{"arxiv_id":"2608.04213","last_updated":"2026-08-04T20:26:12Z","snapshot_observed_at":"2026-08-10T12:23:12.291566Z","submitted_at":"2026-08-04T20:26:12Z","title":"Attention-Only White-Box Transformer via LeJEPA-Based Self-Supervised Pretraining","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-08T00:18:45.147379Z"},"links":{"citing_paper":"/paper/2608.04213"},"observation_digest":"sha256:0121febb6c77ff209a6b00930b5529bb2824776a887cbb5084f994f9f2c6f686","observation_id":"5059f939-08f1-4666-acc4-0146a1307362","resolution":{"observed_at":"2026-08-08T00:18:46.263234Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:18:46.185738Z","title":"SIAM Journal on Imaging Sciences , volume =","venue":null,"work_id":"cb3b44ef-c0ae-47d4-a05c-fcbf2ffe182e","year":2015},"citing_paper":{"arxiv_id":"2608.04213","last_updated":"2026-08-04T20:26:12Z","snapshot_observed_at":"2026-08-10T12:23:12.291566Z","submitted_at":"2026-08-04T20:26:12Z","title":"Attention-Only White-Box Transformer via LeJEPA-Based Self-Supervised Pretraining","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-08T00:18:45.151804Z"},"links":{"citing_paper":"/paper/2608.04213"},"observation_digest":"sha256:d285d16d46e1b5d6ad843db9a3c1a7a83aa8113366a347b824661513626dde4e","observation_id":"0741ef80-521a-4617-8c44-f9a5c088b250","resolution":{"observed_at":"2026-08-08T00:18:46.245334Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:18:46.058647Z","title":"Mathematical Programming , volume =","venue":null,"work_id":"a2740a41-d71f-4727-801f-84fdb6a63a82","year":1992},"citing_paper":{"arxiv_id":"2608.04213","last_updated":"2026-08-04T20:26:12Z","snapshot_observed_at":"2026-08-10T12:23:12.291566Z","submitted_at":"2026-08-04T20:26:12Z","title":"Attention-Only White-Box Transformer via LeJEPA-Based Self-Supervised Pretraining","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-08T00:18:45.157251Z"},"links":{"citing_paper":"/paper/2608.04213"},"observation_digest":"sha256:51e28ae8228d5f4baedeb7d1ea4da1c7082c0c31e6fcf5073f9124c9f764edb8","observation_id":"eac4bf23-1f05-48f4-a4e3-f1a153017814","resolution":{"observed_at":"2026-08-08T00:18:46.107986Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1607.06450","last_updated":"2016-07-21T19:57:52Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2016-07-21T19:57:52Z","title":"Layer Normalization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1607.06450","snapshot_observed_at":"2026-08-08T00:18:45.161584Z","title":"arXiv preprint arXiv:1607.06450 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04213","last_updated":"2026-08-04T20:26:12Z","snapshot_observed_at":"2026-08-10T12:23:12.291566Z","submitted_at":"2026-08-04T20:26:12Z","title":"Attention-Only White-Box Transformer via LeJEPA-Based Self-Supervised Pretraining","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-08T00:18:45.161584Z"},"links":{"cited_paper":"/paper/1607.06450","citing_paper":"/paper/2608.04213"},"observation_digest":"sha256:dfc7af35971d06d95db51a870f4b38d2368f7a07a32ef56ebbf2430586f9936a","observation_id":"771a865b-0e3e-49ad-8f77-17267f27d793","resolution":{"observed_at":"2026-08-08T00:18:45.161584Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:18:46.039736Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":"e5a30e84-91c8-4615-9eaa-3211c516bef3","year":null},"citing_paper":{"arxiv_id":"2608.04213","last_updated":"2026-08-04T20:26:12Z","snapshot_observed_at":"2026-08-10T12:23:12.291566Z","submitted_at":"2026-08-04T20:26:12Z","title":"Attention-Only White-Box Transformer via LeJEPA-Based Self-Supervised Pretraining","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-08T00:18:45.185600Z"},"links":{"citing_paper":"/paper/2608.04213"},"observation_digest":"sha256:6c6c957ecc096fb4d060eea80ec6a991ef74c1565dc8614dd2038dab5f2ffc82","observation_id":"6182ec22-1a98-4799-9d13-233ab99ed9d7","resolution":{"observed_at":"2026-08-08T00:18:46.044304Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.20299","last_updated":"2025-01-14T16:38:36Z","snapshot_observed_at":"2026-08-08T14:38:53.836623Z","submitted_at":"2024-05-30T17:46:23Z","title":"Scaling White-Box Transformers for Vision","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.20299","snapshot_observed_at":"2026-08-08T00:18:45.227009Z","title":"arXiv preprint arXiv:2405.20299 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04213","last_updated":"2026-08-04T20:26:12Z","snapshot_observed_at":"2026-08-10T12:23:12.291566Z","submitted_at":"2026-08-04T20:26:12Z","title":"Attention-Only White-Box Transformer via LeJEPA-Based Self-Supervised Pretraining","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-08T00:18:45.227009Z"},"links":{"cited_paper":"/paper/2405.20299","citing_paper":"/paper/2608.04213"},"observation_digest":"sha256:80ce29ed5c764a92c563634e7ae4bd8444db4dbf6745036b3931177aeeeed2ec","observation_id":"1684edfe-48e2-4086-8002-56413e8af616","resolution":{"observed_at":"2026-08-08T00:18:45.227009Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.17810","last_updated":"2024-12-23T18:59:21Z","snapshot_observed_at":"2026-08-11T05:06:17.928807Z","submitted_at":"2024-12-23T18:59:21Z","title":"Token Statistics Transformer: Linear-Time Attention via Variational Rate Reduction","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.17810","snapshot_observed_at":"2026-08-08T00:18:45.283513Z","title":"arXiv preprint arXiv:2412.17810 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04213","last_updated":"2026-08-04T20:26:12Z","snapshot_observed_at":"2026-08-10T12:23:12.291566Z","submitted_at":"2026-08-04T20:26:12Z","title":"Attention-Only White-Box Transformer via LeJEPA-Based Self-Supervised Pretraining","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-08T00:18:45.283513Z"},"links":{"cited_paper":"/paper/2412.17810","citing_paper":"/paper/2608.04213"},"observation_digest":"sha256:2682baee4ba8ff2db40263819a686c6af438a4a8170fa0740e5025da2e1ec885","observation_id":"3f0da1ef-0189-4438-a92f-1393e4089ff7","resolution":{"observed_at":"2026-08-08T00:18:45.283513Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.16271","last_updated":"2023-08-30T19:02:17Z","snapshot_observed_at":"2026-08-05T20:26:32.082138Z","submitted_at":"2023-08-30T19:02:17Z","title":"Emergence of Segmentation with Minimalistic White-Box Transformers","version":1},"cited_work":{"arxiv_id":"2308.16271","doi":null,"metadata_source":"pith","pith_arxiv_id":"2308.16271","snapshot_observed_at":"2026-08-08T00:18:45.444138Z","title":"Emergence of Segmentation with Minimalistic White-Box Transformers","venue":"cs.CV","work_id":"ba21de93-b3b3-4b0f-91d2-c91829c04a26","year":2023},"citing_paper":{"arxiv_id":"2608.04213","last_updated":"2026-08-04T20:26:12Z","snapshot_observed_at":"2026-08-10T12:23:12.291566Z","submitted_at":"2026-08-04T20:26:12Z","title":"Attention-Only White-Box Transformer via LeJEPA-Based Self-Supervised Pretraining","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-08T00:18:45.289502Z"},"links":{"cited_paper":"/paper/2308.16271","citing_paper":"/paper/2608.04213"},"observation_digest":"sha256:5b136ac3aa9012a33515f75e5ea007ac5326eed5c2209af8386e5c33ff36673e","observation_id":"34b42e2c-3807-4cb3-9fe5-1eac94074b56","resolution":{"observed_at":"2026-08-08T00:18:45.505371Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:18:46.023130Z","title":"International Conference on Learning Representations , year=","venue":null,"work_id":"ecefce82-4de2-401b-a74d-62261c76c1d0","year":null},"citing_paper":{"arxiv_id":"2608.04213","last_updated":"2026-08-04T20:26:12Z","snapshot_observed_at":"2026-08-10T12:23:12.291566Z","submitted_at":"2026-08-04T20:26:12Z","title":"Attention-Only White-Box Transformer via LeJEPA-Based Self-Supervised Pretraining","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-08T00:18:45.294186Z"},"links":{"citing_paper":"/paper/2608.04213"},"observation_digest":"sha256:8e84d18d3d5a8d4466cd4824ca4871945f456e67286a3458b562c739548775a2","observation_id":"ac580f71-88f9-49ca-aa0e-47bdcf7a28d5","resolution":{"observed_at":"2026-08-08T00:18:46.028794Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:18:46.007143Z","title":null,"venue":null,"work_id":"6a9f9627-7c8c-48a6-9635-65d1cd3da88f","year":null},"citing_paper":{"arxiv_id":"2608.04213","last_updated":"2026-08-04T20:26:12Z","snapshot_observed_at":"2026-08-10T12:23:12.291566Z","submitted_at":"2026-08-04T20:26:12Z","title":"Attention-Only White-Box Transformer via LeJEPA-Based Self-Supervised Pretraining","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-08T00:18:45.298848Z"},"links":{"citing_paper":"/paper/2608.04213"},"observation_digest":"sha256:c8c624639611f41536f663940106622d96dd527067b31aef703fb2791ebcf4d0","observation_id":"0e26e5d9-a4bb-40fe-958d-c6322737305e","resolution":{"observed_at":"2026-08-08T00:18:46.012652Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:18:45.991050Z","title":null,"venue":null,"work_id":"d6d82907-9c44-4ad6-8e1c-b5d40076ebaa","year":null},"citing_paper":{"arxiv_id":"2608.04213","last_updated":"2026-08-04T20:26:12Z","snapshot_observed_at":"2026-08-10T12:23:12.291566Z","submitted_at":"2026-08-04T20:26:12Z","title":"Attention-Only White-Box Transformer via LeJEPA-Based Self-Supervised Pretraining","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-08T00:18:45.303697Z"},"links":{"citing_paper":"/paper/2608.04213"},"observation_digest":"sha256:7812a3ac69465eb77ffe0b63bf3ce4c9553483165cf161340fdf89bcbdd2e187","observation_id":"2476c983-766b-4aaf-ba13-89dcc56a495d","resolution":{"observed_at":"2026-08-08T00:18:45.996170Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:18:45.888434Z","title":"Proceedings of the 42nd International Conference on Machine Learning , series=","venue":null,"work_id":"d7eb5e1f-4fc6-473c-a07c-38c9fc2855ac","year":null},"citing_paper":{"arxiv_id":"2608.04213","last_updated":"2026-08-04T20:26:12Z","snapshot_observed_at":"2026-08-10T12:23:12.291566Z","submitted_at":"2026-08-04T20:26:12Z","title":"Attention-Only White-Box Transformer via LeJEPA-Based Self-Supervised Pretraining","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-08T00:18:45.308227Z"},"links":{"citing_paper":"/paper/2608.04213"},"observation_digest":"sha256:8918a964856d0cc2245fe97ff63816ce86e8e9e4f2303786044af8dbee66448a","observation_id":"73d3f50d-a107-49a9-ac14-1715a44343e3","resolution":{"observed_at":"2026-08-08T00:18:45.980770Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:18:45.312651Z","title":"Foundations and Trends in Machine Learning , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04213","last_updated":"2026-08-04T20:26:12Z","snapshot_observed_at":"2026-08-10T12:23:12.291566Z","submitted_at":"2026-08-04T20:26:12Z","title":"Attention-Only White-Box Transformer via LeJEPA-Based Self-Supervised Pretraining","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-08T00:18:45.312651Z"},"links":{"citing_paper":"/paper/2608.04213"},"observation_digest":"sha256:8b6d4f1bebf4b2031ea075e9122699b32eeabdbc64bf37fc05c91c5094383bc4","observation_id":"4d44309d-065b-4d18-8299-9ac2c9551bf9","resolution":{"observed_at":"2026-08-08T00:18:45.312651Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:18:45.317258Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04213","last_updated":"2026-08-04T20:26:12Z","snapshot_observed_at":"2026-08-10T12:23:12.291566Z","submitted_at":"2026-08-04T20:26:12Z","title":"Attention-Only White-Box Transformer via LeJEPA-Based Self-Supervised Pretraining","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-08T00:18:45.317258Z"},"links":{"citing_paper":"/paper/2608.04213"},"observation_digest":"sha256:e0b2eabb07e2d32963af451de6c7f4de5cc98de90ab1e2ab6d0c5f6e336ad2ff","observation_id":"12ba24be-45ac-4037-958f-e84cedc5406c","resolution":{"observed_at":"2026-08-08T00:18:45.317258Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:18:45.769514Z","title":"IEEE Conference on Computer Vision and Pattern Recognition , pages=","venue":null,"work_id":"8d331158-10a4-4511-b224-57047e54db8b","year":null},"citing_paper":{"arxiv_id":"2608.04213","last_updated":"2026-08-04T20:26:12Z","snapshot_observed_at":"2026-08-10T12:23:12.291566Z","submitted_at":"2026-08-04T20:26:12Z","title":"Attention-Only White-Box Transformer via LeJEPA-Based Self-Supervised Pretraining","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-08T00:18:45.322108Z"},"links":{"citing_paper":"/paper/2608.04213"},"observation_digest":"sha256:2d3d77c8a2adde2630b46fd8fde9c7a0d1bc23c87277ef70fc91d3719fabb624","observation_id":"63d433d6-ddf7-4472-93e1-d63dafe77812","resolution":{"observed_at":"2026-08-08T00:18:45.805662Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:18:45.326422Z","title":"International Conference on Learning Representations , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04213","last_updated":"2026-08-04T20:26:12Z","snapshot_observed_at":"2026-08-10T12:23:12.291566Z","submitted_at":"2026-08-04T20:26:12Z","title":"Attention-Only White-Box Transformer via LeJEPA-Based Self-Supervised Pretraining","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-08T00:18:45.326422Z"},"links":{"citing_paper":"/paper/2608.04213"},"observation_digest":"sha256:f6f8852b15323216b42ec4e4aeb6a2293c80fc85d8bf3e3c6aec2d56fa45dfb2","observation_id":"b7c75a22-c47a-4753-8241-e6da26a6e859","resolution":{"observed_at":"2026-08-08T00:18:45.326422Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:18:45.330955Z","title":"International Conference on Learning Representations , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04213","last_updated":"2026-08-04T20:26:12Z","snapshot_observed_at":"2026-08-10T12:23:12.291566Z","submitted_at":"2026-08-04T20:26:12Z","title":"Attention-Only White-Box Transformer via LeJEPA-Based Self-Supervised Pretraining","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-08T00:18:45.330955Z"},"links":{"citing_paper":"/paper/2608.04213"},"observation_digest":"sha256:35345487769a9183ba32cc13b2e6dcb904456099960192ead5b1f5c7e435b99f","observation_id":"a6c21245-a577-40ea-bba6-76d09dca3a00","resolution":{"observed_at":"2026-08-08T00:18:45.330955Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:18:45.721502Z","title":"International Conference on Machine Learning , pages=","venue":null,"work_id":"6c7272ee-580a-4684-966f-95dad36604e3","year":null},"citing_paper":{"arxiv_id":"2608.04213","last_updated":"2026-08-04T20:26:12Z","snapshot_observed_at":"2026-08-10T12:23:12.291566Z","submitted_at":"2026-08-04T20:26:12Z","title":"Attention-Only White-Box Transformer via LeJEPA-Based Self-Supervised Pretraining","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-08T00:18:45.335506Z"},"links":{"citing_paper":"/paper/2608.04213"},"observation_digest":"sha256:8fcd0b7ef769e0a76b2ad0b748dedb73d48db2a1a0a4cc679bd42a3884e7aa27","observation_id":"19e5219d-a2bf-4b13-9695-c13a3313485b","resolution":{"observed_at":"2026-08-08T00:18:45.736420Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:18:45.598799Z","title":"SIAM Journal on Scientific Computing , volume =","venue":null,"work_id":"8c17d7cd-53e6-4c81-8dfa-c4193f4b536b","year":null},"citing_paper":{"arxiv_id":"2608.04213","last_updated":"2026-08-04T20:26:12Z","snapshot_observed_at":"2026-08-10T12:23:12.291566Z","submitted_at":"2026-08-04T20:26:12Z","title":"Attention-Only White-Box Transformer via LeJEPA-Based Self-Supervised Pretraining","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-08T00:18:45.340289Z"},"links":{"citing_paper":"/paper/2608.04213"},"observation_digest":"sha256:2aebdeda60fa26fd0ba0b980bd8e3081f5a19a3b186645ed81aa06fca95bf2fc","observation_id":"b5dcc336-cf34-493a-b4a7-9dbdbbfb9d36","resolution":{"observed_at":"2026-08-08T00:18:45.648743Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2608.04213","last_updated":"2026-08-04T20:26:12Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-10T12:23:12.291566Z","submitted_at":"2026-08-04T20:26:12Z","title":"Attention-Only White-Box Transformer via LeJEPA-Based Self-Supervised Pretraining"},"reference_resolution":{"displayed":35,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":14,"verified_exact":0,"verified_fuzzy":20},"total_outbound_references":35},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 11 August 2026, this Paper Citation Record lists 35 of 35 outbound references and 0 inbound Pith citation observations for arXiv:2608.04213."}