{"as_of":"2026-08-12T03:06:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:8d572cbdf62bb455b99cefdc83ba3a3a85aec3c59c72835b2ef387e12339803d","coverage":[{"denominator":27,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":27,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T16:45:21.694977Z","state":"measured"},{"denominator":27,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":27,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-11T06:34:44.6726+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2412.09925/citation-record","integrity":"/paper/2412.09925/integrity","json":"/paper/2412.09925/citation-record.json","paper":"/paper/2412.09925"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:45:21.598030Z","title":"URL: \" 'urlintro :=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.09925","last_updated":"2025-06-26T13:41:24Z","snapshot_observed_at":"2026-08-12T01:19:23.481156Z","submitted_at":"2024-12-13T07:27:42Z","title":"Simulating Hard Attention Using Soft Attention","version":2},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-11T16:45:21.598030Z"},"links":{"citing_paper":"/paper/2412.09925"},"observation_digest":"sha256:33710128cd556979784e90c0d38f685cd2dc1a639906bc223f62db2ae9bc3b01","observation_id":"fc746193-8ab0-4d0b-b917-27c07164b826","resolution":{"observed_at":"2026-08-11T16:45:21.598030Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:45:21.602394Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.09925","last_updated":"2025-06-26T13:41:24Z","snapshot_observed_at":"2026-08-12T01:19:23.481156Z","submitted_at":"2024-12-13T07:27:42Z","title":"Simulating Hard Attention Using Soft Attention","version":2},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-11T16:45:21.602394Z"},"links":{"citing_paper":"/paper/2412.09925"},"observation_digest":"sha256:ab46ebc03e38a7fcec7aa841b9ceed8086938fdeff45a752984a8e15f7258e10","observation_id":"513f3b9b-0eba-4af3-90d6-d6dee17203a6","resolution":{"observed_at":"2026-08-11T16:45:21.602394Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1607.06450","last_updated":"2016-07-21T19:57:52Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2016-07-21T19:57:52Z","title":"Layer Normalization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1607.06450","snapshot_observed_at":"2026-08-11T16:45:21.606676Z","title":null,"venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2412.09925","last_updated":"2025-06-26T13:41:24Z","snapshot_observed_at":"2026-08-12T01:19:23.481156Z","submitted_at":"2024-12-13T07:27:42Z","title":"Simulating Hard Attention Using Soft Attention","version":2},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-11T16:45:21.606676Z"},"links":{"cited_paper":"/paper/1607.06450","citing_paper":"/paper/2412.09925"},"observation_digest":"sha256:c52d0aed790b403504d258347619b905f4f43afcee4d6f2d7a2c946e23d347a9","observation_id":"70dc9865-7c46-40ec-a6f3-34b4266c583b","resolution":{"observed_at":"2026-08-11T16:45:21.606676Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1409.0473","last_updated":"2016-05-19T21:53:22Z","snapshot_observed_at":"2026-07-06T03:53:10.336430Z","submitted_at":"2014-09-01T16:33:02Z","title":"Neural Machine Translation by Jointly Learning to Align and Translate","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1409.0473","snapshot_observed_at":"2026-08-11T16:45:21.611105Z","title":null,"venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2412.09925","last_updated":"2025-06-26T13:41:24Z","snapshot_observed_at":"2026-08-12T01:19:23.481156Z","submitted_at":"2024-12-13T07:27:42Z","title":"Simulating Hard Attention Using Soft Attention","version":2},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-11T16:45:21.611105Z"},"links":{"cited_paper":"/paper/1409.0473","citing_paper":"/paper/2412.09925"},"observation_digest":"sha256:d018b807b29492018d1143a832d7fe0d7bad5f110007eda04df07bc3d79af8e0","observation_id":"a95aad9d-3eef-474d-b46e-f7af00aec75d","resolution":{"observed_at":"2026-08-11T16:45:21.611105Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:45:21.956766Z","title":null,"venue":null,"work_id":"ec83ba08-4780-4202-a828-43b8a9a8a43d","year":2024},"citing_paper":{"arxiv_id":"2412.09925","last_updated":"2025-06-26T13:41:24Z","snapshot_observed_at":"2026-08-12T01:19:23.481156Z","submitted_at":"2024-12-13T07:27:42Z","title":"Simulating Hard Attention Using Soft Attention","version":2},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-11T16:45:21.616400Z"},"links":{"citing_paper":"/paper/2412.09925"},"observation_digest":"sha256:49746c371340b08ba190d319b5bd1c98f8a8ad8a745b50a878ffc0308919daf5","observation_id":"e7ab3a21-0e8f-42ae-b5cd-9df62de8794c","resolution":{"observed_at":"2026-08-11T16:45:21.960284Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:45:21.619715Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.09925","last_updated":"2025-06-26T13:41:24Z","snapshot_observed_at":"2026-08-12T01:19:23.481156Z","submitted_at":"2024-12-13T07:27:42Z","title":"Simulating Hard Attention Using Soft Attention","version":2},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-11T16:45:21.619715Z"},"links":{"citing_paper":"/paper/2412.09925"},"observation_digest":"sha256:df28051a5b4120c8ecda1b0abd54b2751a709b437f2c7b3873e9b2215dab0ffe","observation_id":"8b589903-6ac4-450a-84ec-07cf85f3dbf7","resolution":{"observed_at":"2026-08-11T16:45:21.619715Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:45:21.947005Z","title":null,"venue":null,"work_id":"d11afdf2-13b1-4675-9f97-fc465ac28fcb","year":2022},"citing_paper":{"arxiv_id":"2412.09925","last_updated":"2025-06-26T13:41:24Z","snapshot_observed_at":"2026-08-12T01:19:23.481156Z","submitted_at":"2024-12-13T07:27:42Z","title":"Simulating Hard Attention Using Soft Attention","version":2},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-11T16:45:21.623208Z"},"links":{"citing_paper":"/paper/2412.09925"},"observation_digest":"sha256:8c63f87a981c598b9ac4df3ba17b02d7306cb1359e5076382ea96e72a173e018","observation_id":"5f033e19-ec88-490d-bdf2-800349a2abde","resolution":{"observed_at":"2026-08-11T16:45:21.950421Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:45:21.936426Z","title":"Edelman, Surbhi Goel, Sham Kakade, and Cyril Zhang","venue":null,"work_id":"d2392de6-e845-49f4-8bf7-df139f44a9b9","year":2022},"citing_paper":{"arxiv_id":"2412.09925","last_updated":"2025-06-26T13:41:24Z","snapshot_observed_at":"2026-08-12T01:19:23.481156Z","submitted_at":"2024-12-13T07:27:42Z","title":"Simulating Hard Attention Using Soft Attention","version":2},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-11T16:45:21.626867Z"},"links":{"citing_paper":"/paper/2412.09925"},"observation_digest":"sha256:9a981809d07a0055c25b4793939dc62e78a7b58e43d7dac7acfc4f82869dba5e","observation_id":"dcc402b6-1a52-41da-97dc-534f28e6610f","resolution":{"observed_at":"2026-08-11T16:45:21.940187Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:45:21.925785Z","title":null,"venue":null,"work_id":"cd0dc327-a817-4779-88e1-e7f25513bff6","year":2021},"citing_paper":{"arxiv_id":"2412.09925","last_updated":"2025-06-26T13:41:24Z","snapshot_observed_at":"2026-08-12T01:19:23.481156Z","submitted_at":"2024-12-13T07:27:42Z","title":"Simulating Hard Attention Using Soft Attention","version":2},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-11T16:45:21.630625Z"},"links":{"citing_paper":"/paper/2412.09925"},"observation_digest":"sha256:b44a81ebc0dd0a51e4e3a668057180d46e51ac65e4ef425f2958e22706c99eff","observation_id":"7489f6ca-651e-4671-8838-34e92de1c76e","resolution":{"observed_at":"2026-08-11T16:45:21.929742Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:45:21.913221Z","title":null,"venue":null,"work_id":"b3c8db8b-41d3-4829-93a3-cd3570b73652","year":2023},"citing_paper":{"arxiv_id":"2412.09925","last_updated":"2025-06-26T13:41:24Z","snapshot_observed_at":"2026-08-12T01:19:23.481156Z","submitted_at":"2024-12-13T07:27:42Z","title":"Simulating Hard Attention Using Soft Attention","version":2},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-11T16:45:21.633468Z"},"links":{"citing_paper":"/paper/2412.09925"},"observation_digest":"sha256:5e53a95e197dc44ce570dc616b78eef4903d8d59d488857664a47675aa4759ae","observation_id":"6449b585-9984-4c92-80c1-093305828869","resolution":{"observed_at":"2026-08-11T16:45:21.917641Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:45:21.636394Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.09925","last_updated":"2025-06-26T13:41:24Z","snapshot_observed_at":"2026-08-12T01:19:23.481156Z","submitted_at":"2024-12-13T07:27:42Z","title":"Simulating Hard Attention Using Soft Attention","version":2},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-11T16:45:21.636394Z"},"links":{"citing_paper":"/paper/2412.09925"},"observation_digest":"sha256:d9a6b71a641d1b1e0900812f4855ebf6965d8239d76e4577879af697e72837c2","observation_id":"af56f96b-edda-4456-bf21-0f70676e0fe4","resolution":{"observed_at":"2026-08-11T16:45:21.636394Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:45:21.640078Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.09925","last_updated":"2025-06-26T13:41:24Z","snapshot_observed_at":"2026-08-12T01:19:23.481156Z","submitted_at":"2024-12-13T07:27:42Z","title":"Simulating Hard Attention Using Soft Attention","version":2},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-11T16:45:21.640078Z"},"links":{"citing_paper":"/paper/2412.09925"},"observation_digest":"sha256:252dfc3be435939e280747c18d7688bff5e5241e99dd8339ef3d90bdb4ce2171","observation_id":"b00df638-9b2f-4d19-9266-6eb17c3a28c6","resolution":{"observed_at":"2026-08-11T16:45:21.640078Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:45:21.901856Z","title":null,"venue":null,"work_id":"b16c00f9-4b8b-4cdf-b3a4-2794abd8a31a","year":2024},"citing_paper":{"arxiv_id":"2412.09925","last_updated":"2025-06-26T13:41:24Z","snapshot_observed_at":"2026-08-12T01:19:23.481156Z","submitted_at":"2024-12-13T07:27:42Z","title":"Simulating Hard Attention Using Soft Attention","version":2},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-11T16:45:21.643862Z"},"links":{"citing_paper":"/paper/2412.09925"},"observation_digest":"sha256:8055b282d3695eaf56e00f4e3bd45f97afeac7992ecf2676e6f940812553c412","observation_id":"06a64900-5653-45d5-bd8d-c78065e5774a","resolution":{"observed_at":"2026-08-11T16:45:21.905876Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:45:21.891425Z","title":null,"venue":null,"work_id":"68475ac0-b8f4-4cf4-b768-10857f6ab1eb","year":2023},"citing_paper":{"arxiv_id":"2412.09925","last_updated":"2025-06-26T13:41:24Z","snapshot_observed_at":"2026-08-12T01:19:23.481156Z","submitted_at":"2024-12-13T07:27:42Z","title":"Simulating Hard Attention Using Soft Attention","version":2},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-11T16:45:21.647886Z"},"links":{"citing_paper":"/paper/2412.09925"},"observation_digest":"sha256:f64f37e0d4407727889fb07544929c236ea3bcb717757f60100dda4bf7847f14","observation_id":"d6e10374-a625-49fa-9d37-f79603c721f3","resolution":{"observed_at":"2026-08-11T16:45:21.894957Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:45:21.881562Z","title":"Ash, Surbhi Goel, Akshay Krishnamurthy, and Cyril Zhang","venue":null,"work_id":"0f13a8db-5259-40d3-9e06-22e2468a12c3","year":2023},"citing_paper":{"arxiv_id":"2412.09925","last_updated":"2025-06-26T13:41:24Z","snapshot_observed_at":"2026-08-12T01:19:23.481156Z","submitted_at":"2024-12-13T07:27:42Z","title":"Simulating Hard Attention Using Soft Attention","version":2},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-11T16:45:21.651513Z"},"links":{"citing_paper":"/paper/2412.09925"},"observation_digest":"sha256:6a7aaba0301d8c16a0ba8f057080ef6ed21079bc58f1bc043f31f5fb5cadeec4","observation_id":"564164b7-59db-45a0-8c86-8c54e68e425a","resolution":{"observed_at":"2026-08-11T16:45:21.884538Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:45:21.872765Z","title":null,"venue":null,"work_id":"c3d179e6-875e-49f4-9ef6-72aa63eba847","year":2016},"citing_paper":{"arxiv_id":"2412.09925","last_updated":"2025-06-26T13:41:24Z","snapshot_observed_at":"2026-08-12T01:19:23.481156Z","submitted_at":"2024-12-13T07:27:42Z","title":"Simulating Hard Attention Using Soft Attention","version":2},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-11T16:45:21.655005Z"},"links":{"citing_paper":"/paper/2412.09925"},"observation_digest":"sha256:ddc59f8586ba65c4875e8ce8857fedc0f49ae362794b21ca43688c52b6b7038b","observation_id":"c07933f9-8433-4a2f-8e7e-40a32ce95b4e","resolution":{"observed_at":"2026-08-11T16:45:21.875502Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:45:21.862027Z","title":null,"venue":null,"work_id":"5e85ac16-096b-4f25-aa6a-a066f49b2638","year":2024},"citing_paper":{"arxiv_id":"2412.09925","last_updated":"2025-06-26T13:41:24Z","snapshot_observed_at":"2026-08-12T01:19:23.481156Z","submitted_at":"2024-12-13T07:27:42Z","title":"Simulating Hard Attention Using Soft Attention","version":2},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-11T16:45:21.658478Z"},"links":{"citing_paper":"/paper/2412.09925"},"observation_digest":"sha256:a018512239ba661995d127beac618a038ac508655e83bbbf41238f9f2bfa2ee5","observation_id":"b6c2f6e4-19f4-47c9-a261-5181657cebf0","resolution":{"observed_at":"2026-08-11T16:45:21.865800Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:45:21.661635Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.09925","last_updated":"2025-06-26T13:41:24Z","snapshot_observed_at":"2026-08-12T01:19:23.481156Z","submitted_at":"2024-12-13T07:27:42Z","title":"Simulating Hard Attention Using Soft Attention","version":2},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-11T16:45:21.661635Z"},"links":{"citing_paper":"/paper/2412.09925"},"observation_digest":"sha256:d0ade970acf5c7b4c25a13bbf906ea5fe452d12a33efcc992ccb7867b63b6695","observation_id":"908619ad-2712-4af5-a0c4-84a0aa5b4ad0","resolution":{"observed_at":"2026-08-11T16:45:21.661635Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:45:21.851282Z","title":null,"venue":null,"work_id":"9449debb-8150-4944-882a-3a273bc55796","year":2019},"citing_paper":{"arxiv_id":"2412.09925","last_updated":"2025-06-26T13:41:24Z","snapshot_observed_at":"2026-08-12T01:19:23.481156Z","submitted_at":"2024-12-13T07:27:42Z","title":"Simulating Hard Attention Using Soft Attention","version":2},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-11T16:45:21.665107Z"},"links":{"citing_paper":"/paper/2412.09925"},"observation_digest":"sha256:dd467d63b5c54108e2d319716078a6886e657f8883f4e4aeec423f6fb9086e34","observation_id":"d2663245-fd0f-4304-b6a2-0d3215ae56ff","resolution":{"observed_at":"2026-08-11T16:45:21.854746Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:45:21.841229Z","title":null,"venue":null,"work_id":"e26922c7-3594-49df-bfae-188300f9211c","year":2024},"citing_paper":{"arxiv_id":"2412.09925","last_updated":"2025-06-26T13:41:24Z","snapshot_observed_at":"2026-08-12T01:19:23.481156Z","submitted_at":"2024-12-13T07:27:42Z","title":"Simulating Hard Attention Using Soft Attention","version":2},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-11T16:45:21.668594Z"},"links":{"citing_paper":"/paper/2412.09925"},"observation_digest":"sha256:68f1b181fe3e5f2516b7ac0fb71aa4031e981b76263542c3a8d8c0bf12ad456f","observation_id":"cedf00c5-ee7e-4191-9869-19bd65ece0b7","resolution":{"observed_at":"2026-08-11T16:45:21.844608Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.02040","last_updated":"2024-11-05T18:27:28Z","snapshot_observed_at":"2026-08-07T20:09:03.345227Z","submitted_at":"2024-04-02T15:34:47Z","title":"Transformers as Transducers","version":3},"cited_work":{"arxiv_id":"2404.02040","doi":null,"metadata_source":"pith","pith_arxiv_id":"2404.02040","snapshot_observed_at":"2026-08-11T16:45:21.786654Z","title":"Transformers as Transducers","venue":"cs.FL","work_id":"0d6b22b6-3b93-413c-8309-6f1ae9db9a7f","year":2024},"citing_paper":{"arxiv_id":"2412.09925","last_updated":"2025-06-26T13:41:24Z","snapshot_observed_at":"2026-08-12T01:19:23.481156Z","submitted_at":"2024-12-13T07:27:42Z","title":"Simulating Hard Attention Using Soft Attention","version":2},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-11T16:45:21.672238Z"},"links":{"cited_paper":"/paper/2404.02040","citing_paper":"/paper/2412.09925"},"observation_digest":"sha256:0fe485e9fc619f4e0439f4ec5f9640642a9fd46dd5469625ad15fde8c3ff9595","observation_id":"4b2f8fc6-3885-4856-b761-999a7ba8ff70","resolution":{"observed_at":"2026-08-11T16:45:21.791383Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:45:21.830552Z","title":null,"venue":null,"work_id":"910e7ab9-01bf-4548-93e2-1bc57641e8a2","year":2024},"citing_paper":{"arxiv_id":"2412.09925","last_updated":"2025-06-26T13:41:24Z","snapshot_observed_at":"2026-08-12T01:19:23.481156Z","submitted_at":"2024-12-13T07:27:42Z","title":"Simulating Hard Attention Using Soft Attention","version":2},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-11T16:45:21.676000Z"},"links":{"citing_paper":"/paper/2412.09925"},"observation_digest":"sha256:4d383da2061553c79e741a04e51ef8b51132f62ef232430979f2245aa7185590","observation_id":"ab19734f-bf2f-4650-bf1c-ba490bae9090","resolution":{"observed_at":"2026-08-11T16:45:21.834176Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1509.08101","last_updated":"2015-09-29T13:44:37Z","snapshot_observed_at":"2026-08-03T18:23:00.117102Z","submitted_at":"2015-09-27T15:26:58Z","title":"Representation Benefits of Deep Feedforward Networks","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1509.08101","snapshot_observed_at":"2026-08-11T16:45:21.679501Z","title":null,"venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2412.09925","last_updated":"2025-06-26T13:41:24Z","snapshot_observed_at":"2026-08-12T01:19:23.481156Z","submitted_at":"2024-12-13T07:27:42Z","title":"Simulating Hard Attention Using Soft Attention","version":2},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-11T16:45:21.679501Z"},"links":{"cited_paper":"/paper/1509.08101","citing_paper":"/paper/2412.09925"},"observation_digest":"sha256:5e678d1f44ad1c3ae62f3780961d3a19931a98f560967019c20c66c35e823322","observation_id":"88251523-fb4e-428b-b060-eca9597b8be0","resolution":{"observed_at":"2026-08-11T16:45:21.679501Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:45:21.819347Z","title":"Gomez, Lukasz Kaiser, and Illia Polosukhin","venue":null,"work_id":"ee41c743-1d34-4618-a445-d5c6240d92d7","year":2017},"citing_paper":{"arxiv_id":"2412.09925","last_updated":"2025-06-26T13:41:24Z","snapshot_observed_at":"2026-08-12T01:19:23.481156Z","submitted_at":"2024-12-13T07:27:42Z","title":"Simulating Hard Attention Using Soft Attention","version":2},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-11T16:45:21.683273Z"},"links":{"citing_paper":"/paper/2412.09925"},"observation_digest":"sha256:96ca7f03c5863b238de1b20bbcaf5b833562219c85dec29572057141013a1123","observation_id":"17b35648-ebd6-439c-b75a-91d3d7ea4a84","resolution":{"observed_at":"2026-08-11T16:45:21.823541Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:45:21.808789Z","title":null,"venue":null,"work_id":"656fd10d-d5fd-42a1-a219-438f6c3db5ad","year":2024},"citing_paper":{"arxiv_id":"2412.09925","last_updated":"2025-06-26T13:41:24Z","snapshot_observed_at":"2026-08-12T01:19:23.481156Z","submitted_at":"2024-12-13T07:27:42Z","title":"Simulating Hard Attention Using Soft Attention","version":2},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-11T16:45:21.687590Z"},"links":{"citing_paper":"/paper/2412.09925"},"observation_digest":"sha256:4af3c4257b9dfafcbd26a69b7784f76d885f824eafc64bd42bc236e95691fcc8","observation_id":"cd0aabee-d51e-4e33-996c-26979800f18d","resolution":{"observed_at":"2026-08-11T16:45:21.812374Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.13897","last_updated":"2024-10-30T00:44:17Z","snapshot_observed_at":"2026-08-12T01:19:05.611057Z","submitted_at":"2023-10-21T03:26:39Z","title":"Masked Hard-Attention Transformers Recognize Exactly the Star-Free Languages","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.13897","snapshot_observed_at":"2026-08-11T16:45:21.691099Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.09925","last_updated":"2025-06-26T13:41:24Z","snapshot_observed_at":"2026-08-12T01:19:23.481156Z","submitted_at":"2024-12-13T07:27:42Z","title":"Simulating Hard Attention Using Soft Attention","version":2},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-11T16:45:21.691099Z"},"links":{"cited_paper":"/paper/2310.13897","citing_paper":"/paper/2412.09925"},"observation_digest":"sha256:c8e71d42e6d104ead8a67ca2d39a022a539c0439e7b4a4b5ffab8e4871f0e3b8","observation_id":"20b52a19-3641-4306-80c0-9966ca096522","resolution":{"observed_at":"2026-08-11T16:45:21.691099Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:45:21.694977Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.09925","last_updated":"2025-06-26T13:41:24Z","snapshot_observed_at":"2026-08-12T01:19:23.481156Z","submitted_at":"2024-12-13T07:27:42Z","title":"Simulating Hard Attention Using Soft Attention","version":2},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-11T16:45:21.694977Z"},"links":{"citing_paper":"/paper/2412.09925"},"observation_digest":"sha256:2e27566c3ed570ef3133792d5916c887a644463bc53b8b789fc7fbf7f0955837","observation_id":"678c4654-9b59-470f-b112-36cd264db267","resolution":{"observed_at":"2026-08-11T16:45:21.694977Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2412.09925","last_updated":"2025-06-26T13:41:24Z","latest_version":2,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-12T01:19:23.481156Z","submitted_at":"2024-12-13T07:27:42Z","title":"Simulating Hard Attention Using Soft Attention"},"reference_resolution":{"displayed":27,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":23,"verified_exact":1,"verified_fuzzy":3},"total_outbound_references":27},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"thesis":"As of 12 August 2026, this Paper Citation Record lists 27 of 27 outbound references and 0 inbound Pith citation observations for arXiv:2412.09925."}