{"as_of":"2026-08-11T11:21:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:177a4578ec7342bfec175a4521d1f891158ee7e372ca0de5bca157aecdb0205c","coverage":[{"denominator":71,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":71,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-10T20:40:46.401242Z","state":"measured"},{"denominator":72,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":72,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-11T06:34:44.6726+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-27T01:49:57.105358Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"arxiv_reference","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":0,"observed_at":"2026-08-05T02:28:24.338817Z","source":"arxiv_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2501.07670","last_updated":"2025-01-13T20:08:52Z","snapshot_observed_at":"2026-08-10T20:35:19.202169Z","submitted_at":"2025-01-13T20:08:52Z","title":"A Survey of Early Exit Deep Neural Networks in NLP","version":1},"cited_work":{"arxiv_id":"2501.07670","doi":"10.48550/arxiv.2501.07670","metadata_source":"arxiv_reference","pith_arxiv_id":"2501.07670","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"32 Published by FaceMind Research Asia Yeskendir Koishekenov, Aldo Lipani, and Nicola Cancedda","venue":"ArXiv.org","work_id":"803c1769-4b1c-4547-b827-eeb4c671e8fa","year":null},"citing_paper":{"arxiv_id":"2606.18208","last_updated":"2026-06-16T17:37:27Z","snapshot_observed_at":"2026-07-06T23:53:40.698123Z","submitted_at":"2026-06-16T17:37:27Z","title":"Looped World Models","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-06-27T01:49:57.105358Z"},"links":{"cited_paper":"/paper/2501.07670","citing_paper":"/paper/2606.18208"},"observation_digest":"sha256:6ad0272019f2f944be21732bd069e5feaad875dac358dc51e7a9dbe9c160e21c","observation_id":"9af41f93-e68f-4d34-8c70-3b83e079b032","resolution":{"observed_at":"2026-06-27T01:50:21.210673Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2501.07670/citation-record","integrity":"/paper/2501.07670/integrity","json":"/paper/2501.07670/citation-record.json","paper":"/paper/2501.07670"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:40:46.124828Z","title":"online\" 'onlinestring :=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.07670","last_updated":"2025-01-13T20:08:52Z","snapshot_observed_at":"2026-08-10T20:35:19.202169Z","submitted_at":"2025-01-13T20:08:52Z","title":"A Survey of Early Exit Deep Neural Networks in NLP","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-10T20:40:46.124828Z"},"links":{"citing_paper":"/paper/2501.07670"},"observation_digest":"sha256:47c63ff838f499897df12704dd235f2405e42ed17a7df63c9f9e14857639070c","observation_id":"8569da22-38aa-4071-8256-f2423566a68d","resolution":{"observed_at":"2026-08-10T20:40:46.124828Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:40:46.129649Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.07670","last_updated":"2025-01-13T20:08:52Z","snapshot_observed_at":"2026-08-10T20:35:19.202169Z","submitted_at":"2025-01-13T20:08:52Z","title":"A Survey of Early Exit Deep Neural Networks in NLP","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-10T20:40:46.129649Z"},"links":{"citing_paper":"/paper/2501.07670"},"observation_digest":"sha256:1b228df1978755b739e181cda90016b89d0caff962ae7e4068380bb5245ba60f","observation_id":"65bf3244-c9ba-4414-8c15-eba13c29d0eb","resolution":{"observed_at":"2026-08-10T20:40:46.129649Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2010.11929","last_updated":"2021-06-03T13:08:56Z","snapshot_observed_at":"2026-08-10T01:12:16.468283Z","submitted_at":"2020-10-22T17:55:59Z","title":"An Image is Worth 16x16 Words: Transformers for Image Recognition at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.11929","snapshot_observed_at":"2026-08-10T20:40:46.136185Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2501.07670","last_updated":"2025-01-13T20:08:52Z","snapshot_observed_at":"2026-08-10T20:35:19.202169Z","submitted_at":"2025-01-13T20:08:52Z","title":"A Survey of Early Exit Deep Neural Networks in NLP","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-10T20:40:46.136185Z"},"links":{"cited_paper":"/paper/2010.11929","citing_paper":"/paper/2501.07670"},"observation_digest":"sha256:2c1902548b52e06a534005f3aa9eebeafbba3ff6ca7ea7b2ec80a57d32e56c01","observation_id":"7d36ebf8-17b1-4c98-8887-38aee13752c6","resolution":{"observed_at":"2026-08-10T20:40:46.136185Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2012.15701","last_updated":"2021-07-22T13:13:45Z","snapshot_observed_at":"2026-08-09T15:34:02.499941Z","submitted_at":"2020-12-31T16:34:54Z","title":"BinaryBERT: Pushing the Limit of BERT Quantization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2012.15701","snapshot_observed_at":"2026-08-10T20:40:46.140692Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2501.07670","last_updated":"2025-01-13T20:08:52Z","snapshot_observed_at":"2026-08-10T20:35:19.202169Z","submitted_at":"2025-01-13T20:08:52Z","title":"A Survey of Early Exit Deep Neural Networks in NLP","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-10T20:40:46.140692Z"},"links":{"cited_paper":"/paper/2012.15701","citing_paper":"/paper/2501.07670"},"observation_digest":"sha256:1081b878c40b3bb3c5a22889bbcda69e1b518f7a1a918ecd9db1b47592a169fc","observation_id":"98351e76-4b45-4ec3-b6db-2b9f88d4b689","resolution":{"observed_at":"2026-08-10T20:40:46.140692Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.09195","last_updated":"2023-09-17T07:48:22Z","snapshot_observed_at":"2026-08-08T19:10:40.435839Z","submitted_at":"2023-09-17T07:48:22Z","title":"SplitEE: Early Exit in Deep Neural Networks with Split Computing","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.09195","snapshot_observed_at":"2026-08-10T20:40:46.145371Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.07670","last_updated":"2025-01-13T20:08:52Z","snapshot_observed_at":"2026-08-10T20:35:19.202169Z","submitted_at":"2025-01-13T20:08:52Z","title":"A Survey of Early Exit Deep Neural Networks in NLP","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-10T20:40:46.145371Z"},"links":{"cited_paper":"/paper/2309.09195","citing_paper":"/paper/2501.07670"},"observation_digest":"sha256:db5580da8df49115cdf00634077039384a2e092cd9a4c30f0d0f2f20fd8244ea","observation_id":"d3197e18-06c0-405c-a748-a5de51affcbc","resolution":{"observed_at":"2026-08-10T20:40:46.145371Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.04433","last_updated":"2024-10-06T10:05:01Z","snapshot_observed_at":"2026-08-10T19:28:15.786965Z","submitted_at":"2024-10-06T10:05:01Z","title":"CAPEEN: Image Captioning with Early Exits and Knowledge Distillation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.04433","snapshot_observed_at":"2026-08-10T20:40:46.149808Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.07670","last_updated":"2025-01-13T20:08:52Z","snapshot_observed_at":"2026-08-10T20:35:19.202169Z","submitted_at":"2025-01-13T20:08:52Z","title":"A Survey of Early Exit Deep Neural Networks in NLP","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-10T20:40:46.149808Z"},"links":{"cited_paper":"/paper/2410.04433","citing_paper":"/paper/2501.07670"},"observation_digest":"sha256:a5f5f06520508cf8f4eab81504f4d8a48879ae2f722030a4e9152a61c8daa6b5","observation_id":"66eb75ea-6995-4b90-bf71-4dfdb4b544ec","resolution":{"observed_at":"2026-08-10T20:40:46.149808Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:40:47.129339Z","title":null,"venue":null,"work_id":"6ccc94a0-50dc-44f9-8287-67bc64dab0ab","year":2024},"citing_paper":{"arxiv_id":"2501.07670","last_updated":"2025-01-13T20:08:52Z","snapshot_observed_at":"2026-08-10T20:35:19.202169Z","submitted_at":"2025-01-13T20:08:52Z","title":"A Survey of Early Exit Deep Neural Networks in NLP","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-10T20:40:46.154055Z"},"links":{"citing_paper":"/paper/2501.07670"},"observation_digest":"sha256:0485e627227ef5f4d4dd60e635840443ba1fa95e2e166f7a4a4316aff8de28b9","observation_id":"1cdb7ac1-9464-4483-8685-a5e226ae444b","resolution":{"observed_at":"2026-08-10T20:40:47.133364Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.04424","last_updated":"2024-10-06T09:44:58Z","snapshot_observed_at":"2026-08-11T03:36:41.723649Z","submitted_at":"2024-10-06T09:44:58Z","title":"DAdEE: Unsupervised Domain Adaptation in Early Exit PLMs","version":1},"cited_work":{"arxiv_id":"2410.04424","doi":null,"metadata_source":"pith","pith_arxiv_id":"2410.04424","snapshot_observed_at":"2026-08-10T20:40:46.719726Z","title":"DAdEE: Unsupervised Domain Adaptation in Early Exit PLMs","venue":"cs.CL","work_id":"8c76c506-c33f-4bda-b69a-57fad10265e9","year":2024},"citing_paper":{"arxiv_id":"2501.07670","last_updated":"2025-01-13T20:08:52Z","snapshot_observed_at":"2026-08-10T20:35:19.202169Z","submitted_at":"2025-01-13T20:08:52Z","title":"A Survey of Early Exit Deep Neural Networks in NLP","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-10T20:40:46.158039Z"},"links":{"cited_paper":"/paper/2410.04424","citing_paper":"/paper/2501.07670"},"observation_digest":"sha256:765060af191b47c53a3298db8c65362a671e09efbe40ea23a791ac19a67eacb7","observation_id":"2ad2259b-f6aa-4a2e-a4f0-8d26cd114eb0","resolution":{"observed_at":"2026-08-10T20:40:46.723934Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.10541","last_updated":"2024-01-19T07:44:32Z","snapshot_observed_at":"2026-07-06T17:17:44.177514Z","submitted_at":"2024-01-19T07:44:32Z","title":"I-SplitEE: Image classification in Split Computing DNNs with Early Exits","version":1},"cited_work":{"arxiv_id":"2401.10541","doi":null,"metadata_source":"pith","pith_arxiv_id":"2401.10541","snapshot_observed_at":"2026-08-10T20:40:46.705289Z","title":"I-SplitEE: Image classification in Split Computing DNNs with Early Exits","venue":"cs.LG","work_id":"30b6c202-e3aa-4cb0-8f91-c8a86d096886","year":2024},"citing_paper":{"arxiv_id":"2501.07670","last_updated":"2025-01-13T20:08:52Z","snapshot_observed_at":"2026-08-10T20:35:19.202169Z","submitted_at":"2025-01-13T20:08:52Z","title":"A Survey of Early Exit Deep Neural Networks in NLP","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-10T20:40:46.162386Z"},"links":{"cited_paper":"/paper/2401.10541","citing_paper":"/paper/2501.07670"},"observation_digest":"sha256:7229a0c7bb7ca79ff5f4823ce8b7622e46aae3660d5e3f6a6ddc4af6c8de8ccf","observation_id":"998cc106-657d-4234-8bcb-68e850c55ed4","resolution":{"observed_at":"2026-08-10T20:40:46.709285Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:40:47.118150Z","title":null,"venue":null,"work_id":"37bf53e7-abe4-42e7-bee7-b951e4228570","year":2022},"citing_paper":{"arxiv_id":"2501.07670","last_updated":"2025-01-13T20:08:52Z","snapshot_observed_at":"2026-08-10T20:35:19.202169Z","submitted_at":"2025-01-13T20:08:52Z","title":"A Survey of Early Exit Deep Neural Networks in NLP","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-10T20:40:46.166222Z"},"links":{"citing_paper":"/paper/2501.07670"},"observation_digest":"sha256:a28ca21e48b14942909f3644a52095f8b9d1526b6321ae77a31fa988be188f90","observation_id":"8aa0e950-c8a2-41e5-abe9-9f2c1bd5a4e8","resolution":{"observed_at":"2026-08-10T20:40:47.122051Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2002.07106","last_updated":"2020-04-16T15:01:45Z","snapshot_observed_at":"2026-08-11T08:13:57.273900Z","submitted_at":"2020-02-17T17:54:27Z","title":"Controlling Computation versus Quality for Neural Sequence Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2002.07106","snapshot_observed_at":"2026-08-10T20:40:46.170003Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2501.07670","last_updated":"2025-01-13T20:08:52Z","snapshot_observed_at":"2026-08-10T20:35:19.202169Z","submitted_at":"2025-01-13T20:08:52Z","title":"A Survey of Early Exit Deep Neural Networks in NLP","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-10T20:40:46.170003Z"},"links":{"cited_paper":"/paper/2002.07106","citing_paper":"/paper/2501.07670"},"observation_digest":"sha256:ced22bcf1f12cc1c10638e2762035bb23f685b087ad9c78c7723a206d21914a8","observation_id":"9732b43d-7004-40da-933a-3493a13af5b0","resolution":{"observed_at":"2026-08-10T20:40:46.170003Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:40:47.106415Z","title":null,"venue":null,"work_id":"bd682838-c7e6-4973-84ca-3ef1aa0a1987","year":2023},"citing_paper":{"arxiv_id":"2501.07670","last_updated":"2025-01-13T20:08:52Z","snapshot_observed_at":"2026-08-10T20:35:19.202169Z","submitted_at":"2025-01-13T20:08:52Z","title":"A Survey of Early Exit Deep Neural Networks in NLP","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-10T20:40:46.174090Z"},"links":{"citing_paper":"/paper/2501.07670"},"observation_digest":"sha256:7c7d5624222cafa7cf55a32c10beadfbe04fbe2ab3523c2b12b8535fa3bfac63","observation_id":"c82058d1-2568-4479-acbb-d76104c25aaf","resolution":{"observed_at":"2026-08-10T20:40:47.110117Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:40:47.094684Z","title":null,"venue":null,"work_id":"e7964b49-dc1c-46b0-ab73-934a88051f36","year":2020},"citing_paper":{"arxiv_id":"2501.07670","last_updated":"2025-01-13T20:08:52Z","snapshot_observed_at":"2026-08-10T20:35:19.202169Z","submitted_at":"2025-01-13T20:08:52Z","title":"A Survey of Early Exit Deep Neural Networks in NLP","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-10T20:40:46.177792Z"},"links":{"citing_paper":"/paper/2501.07670"},"observation_digest":"sha256:74dac0233ae7a560c8f9d997d369e1684737abbe7d859c779425f12de63d02ef","observation_id":"a7fb05f3-fa95-464c-bc96-206572b80a6b","resolution":{"observed_at":"2026-08-10T20:40:47.098591Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1810.04805","last_updated":"2019-05-24T20:37:26Z","snapshot_observed_at":"2026-07-30T09:12:38.100527Z","submitted_at":"2018-10-11T00:50:01Z","title":"BERT: Pre-training of Deep Bidirectional Transformers for Language Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1810.04805","snapshot_observed_at":"2026-08-10T20:40:46.181630Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2501.07670","last_updated":"2025-01-13T20:08:52Z","snapshot_observed_at":"2026-08-10T20:35:19.202169Z","submitted_at":"2025-01-13T20:08:52Z","title":"A Survey of Early Exit Deep Neural Networks in NLP","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-10T20:40:46.181630Z"},"links":{"cited_paper":"/paper/1810.04805","citing_paper":"/paper/2501.07670"},"observation_digest":"sha256:d7f615c9dbec61d43edbd5f1bfe0da042dfe46bc0040070c42317369d1c7fbb0","observation_id":"95372b1a-6e1c-4277-8f98-c5dc131c6940","resolution":{"observed_at":"2026-08-10T20:40:46.181630Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1910.10073","last_updated":"2020-02-14T20:49:40Z","snapshot_observed_at":"2026-07-06T08:31:23.192830Z","submitted_at":"2019-10-22T16:15:58Z","title":"Depth-Adaptive Transformer","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1910.10073","snapshot_observed_at":"2026-08-10T20:40:46.185430Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2501.07670","last_updated":"2025-01-13T20:08:52Z","snapshot_observed_at":"2026-08-10T20:35:19.202169Z","submitted_at":"2025-01-13T20:08:52Z","title":"A Survey of Early Exit Deep Neural Networks in NLP","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-10T20:40:46.185430Z"},"links":{"cited_paper":"/paper/1910.10073","citing_paper":"/paper/2501.07670"},"observation_digest":"sha256:f3515c5afa8b89c7606c683a3cc20ab980a5e5e58b8aa10ab9c86520e8c7094d","observation_id":"829eb60d-3992-4d66-9195-7bb6e8fc0855","resolution":{"observed_at":"2026-08-10T20:40:46.185430Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.16710","last_updated":"2024-10-18T04:02:31Z","snapshot_observed_at":"2026-08-08T01:15:44.293937Z","submitted_at":"2024-04-25T16:20:23Z","title":"LayerSkip: Enabling Early Exit Inference and Self-Speculative Decoding","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.16710","snapshot_observed_at":"2026-08-10T20:40:46.189495Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.07670","last_updated":"2025-01-13T20:08:52Z","snapshot_observed_at":"2026-08-10T20:35:19.202169Z","submitted_at":"2025-01-13T20:08:52Z","title":"A Survey of Early Exit Deep Neural Networks in NLP","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-10T20:40:46.189495Z"},"links":{"cited_paper":"/paper/2404.16710","citing_paper":"/paper/2501.07670"},"observation_digest":"sha256:f94176c9acd514f4ad0e278122d68dcca2cca4625b39ecf6e1b7c5a3e4991b75","observation_id":"98a0bae7-59f2-43f2-bc4a-6243a67ecee0","resolution":{"observed_at":"2026-08-10T20:40:46.189495Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1909.11556","last_updated":"2019-09-25T15:35:03Z","snapshot_observed_at":"2026-08-08T18:02:18.011077Z","submitted_at":"2019-09-25T15:35:03Z","title":"Reducing Transformer Depth on Demand with Structured Dropout","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1909.11556","snapshot_observed_at":"2026-08-10T20:40:46.193614Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2501.07670","last_updated":"2025-01-13T20:08:52Z","snapshot_observed_at":"2026-08-10T20:35:19.202169Z","submitted_at":"2025-01-13T20:08:52Z","title":"A Survey of Early Exit Deep Neural Networks in NLP","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-10T20:40:46.193614Z"},"links":{"cited_paper":"/paper/1909.11556","citing_paper":"/paper/2501.07670"},"observation_digest":"sha256:40fc8b208c5688f1c014cde3103af723bb2d19b3dc32930108e9e0e6ae3f524e","observation_id":"ceaef5c6-74c2-46b4-a15d-bc232534057d","resolution":{"observed_at":"2026-08-10T20:40:46.193614Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:40:47.083459Z","title":null,"venue":null,"work_id":"57fd4129-6548-43dd-a4b2-0958e0c6943c","year":2020},"citing_paper":{"arxiv_id":"2501.07670","last_updated":"2025-01-13T20:08:52Z","snapshot_observed_at":"2026-08-10T20:35:19.202169Z","submitted_at":"2025-01-13T20:08:52Z","title":"A Survey of Early Exit Deep Neural Networks in NLP","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-10T20:40:46.197594Z"},"links":{"citing_paper":"/paper/2501.07670"},"observation_digest":"sha256:076b7f2935ebaf5dd7523a7a0279ebd983f5b03c6579524be068ffc14f5809de","observation_id":"cc12a7ed-d139-449b-8493-d692723205b4","resolution":{"observed_at":"2026-08-10T20:40:47.087220Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:40:46.201924Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.07670","last_updated":"2025-01-13T20:08:52Z","snapshot_observed_at":"2026-08-10T20:35:19.202169Z","submitted_at":"2025-01-13T20:08:52Z","title":"A Survey of Early Exit Deep Neural Networks in NLP","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-10T20:40:46.201924Z"},"links":{"citing_paper":"/paper/2501.07670"},"observation_digest":"sha256:1847e33767109f5d3ab57da62082499ffc8c2cb1e3383aa496a9ae4c0c05c21d","observation_id":"b63d0995-ad05-4e0a-b642-d3cb4f7687a4","resolution":{"observed_at":"2026-08-10T20:40:46.201924Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:40:47.065251Z","title":null,"venue":null,"work_id":"b624ff81-d9a6-498e-940c-77a9fedb5dc6","year":2023},"citing_paper":{"arxiv_id":"2501.07670","last_updated":"2025-01-13T20:08:52Z","snapshot_observed_at":"2026-08-10T20:35:19.202169Z","submitted_at":"2025-01-13T20:08:52Z","title":"A Survey of Early Exit Deep Neural Networks in NLP","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-10T20:40:46.205789Z"},"links":{"citing_paper":"/paper/2501.07670"},"observation_digest":"sha256:e1635975b8528a4dd0d8374d2a6b5b7e38a8000218fdff69ce9c6972bcaa9e60","observation_id":"5cce75d1-4bc0-41ed-9ce6-e3e36e54ec04","resolution":{"observed_at":"2026-08-10T20:40:47.069178Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2101.09755","last_updated":"2021-01-24T17:03:57Z","snapshot_observed_at":"2026-08-10T19:27:02.950721Z","submitted_at":"2021-01-24T17:03:57Z","title":"RomeBERT: Robust Training of Multi-Exit BERT","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2101.09755","snapshot_observed_at":"2026-08-10T20:40:46.209792Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.07670","last_updated":"2025-01-13T20:08:52Z","snapshot_observed_at":"2026-08-10T20:35:19.202169Z","submitted_at":"2025-01-13T20:08:52Z","title":"A Survey of Early Exit Deep Neural Networks in NLP","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-10T20:40:46.209792Z"},"links":{"cited_paper":"/paper/2101.09755","citing_paper":"/paper/2501.07670"},"observation_digest":"sha256:0df457f00a5f34385114b2bf6db1b612b15ee4dff3c97300806721c1fa1ceee7","observation_id":"abd980ef-c9c6-48d5-891b-986e5410b4d0","resolution":{"observed_at":"2026-08-10T20:40:46.209792Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:40:47.053931Z","title":null,"venue":null,"work_id":"a14681e4-58bf-4425-af45-5ef683913c64","year":2021},"citing_paper":{"arxiv_id":"2501.07670","last_updated":"2025-01-13T20:08:52Z","snapshot_observed_at":"2026-08-10T20:35:19.202169Z","submitted_at":"2025-01-13T20:08:52Z","title":"A Survey of Early Exit Deep Neural Networks in NLP","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-10T20:40:46.214046Z"},"links":{"citing_paper":"/paper/2501.07670"},"observation_digest":"sha256:a3dbf87c2e1d0cb6d524f8c098328748e5d9efcf9120f3bff142e9f366687307","observation_id":"1b9b8903-5b56-48e9-8a49-fba4708cc5b2","resolution":{"observed_at":"2026-08-10T20:40:47.057757Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2209.09480","last_updated":"2022-09-20T05:35:54Z","snapshot_observed_at":"2026-07-06T13:54:07.385093Z","submitted_at":"2022-09-20T05:35:54Z","title":"Unsupervised Early Exit in DNNs with Multiple Exits","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.09480","snapshot_observed_at":"2026-08-10T20:40:46.218730Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.07670","last_updated":"2025-01-13T20:08:52Z","snapshot_observed_at":"2026-08-10T20:35:19.202169Z","submitted_at":"2025-01-13T20:08:52Z","title":"A Survey of Early Exit Deep Neural Networks in NLP","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-10T20:40:46.218730Z"},"links":{"cited_paper":"/paper/2209.09480","citing_paper":"/paper/2501.07670"},"observation_digest":"sha256:532b71c1bc76736813b0a1be9c4c8a79051fd1330939dcc1f4b85f17b64e63e1","observation_id":"564c18b2-fb33-491c-b061-76eafee29198","resolution":{"observed_at":"2026-08-10T20:40:46.218730Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.13236","last_updated":"2024-12-17T16:24:55Z","snapshot_observed_at":"2026-07-06T20:08:48.064792Z","submitted_at":"2024-12-17T16:24:55Z","title":"COSEE: Consistency-Oriented Signal-Based Early Exiting via Calibrated Sample Weighting Mechanism","version":1},"cited_work":{"arxiv_id":"2412.13236","doi":null,"metadata_source":"pith","pith_arxiv_id":"2412.13236","snapshot_observed_at":"2026-08-10T20:40:46.625770Z","title":"COSEE: Consistency-Oriented Signal-Based Early Exiting via Calibrated Sample Weighting Mechanism","venue":"cs.LG","work_id":"baabe814-3aa9-4533-b81d-0034fb27d002","year":2024},"citing_paper":{"arxiv_id":"2501.07670","last_updated":"2025-01-13T20:08:52Z","snapshot_observed_at":"2026-08-10T20:35:19.202169Z","submitted_at":"2025-01-13T20:08:52Z","title":"A Survey of Early Exit Deep Neural Networks in NLP","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-10T20:40:46.222800Z"},"links":{"cited_paper":"/paper/2412.13236","citing_paper":"/paper/2501.07670"},"observation_digest":"sha256:68c0f50f1513496a7469033c416d20525f16046b32312dcdfc00bd73dfdd91f0","observation_id":"33e980e8-434d-4c81-99e4-7dadab265923","resolution":{"observed_at":"2026-08-10T20:40:46.630132Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1703.09844","last_updated":"2018-06-07T14:39:29Z","snapshot_observed_at":"2026-08-05T05:49:08.436066Z","submitted_at":"2017-03-29T00:19:20Z","title":"Multi-Scale Dense Networks for Resource Efficient Image Classification","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1703.09844","snapshot_observed_at":"2026-08-10T20:40:46.226898Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2501.07670","last_updated":"2025-01-13T20:08:52Z","snapshot_observed_at":"2026-08-10T20:35:19.202169Z","submitted_at":"2025-01-13T20:08:52Z","title":"A Survey of Early Exit Deep Neural Networks in NLP","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-10T20:40:46.226898Z"},"links":{"cited_paper":"/paper/1703.09844","citing_paper":"/paper/2501.07670"},"observation_digest":"sha256:7bacc567ee83b29833b39c472da3811107baefc1f4b2f97004f2cef6ec195ac7","observation_id":"8d0b1f1e-71f4-4d21-999d-87cfffd4ad1e","resolution":{"observed_at":"2026-08-10T20:40:46.226898Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.20915","last_updated":"2024-11-04T15:48:10Z","snapshot_observed_at":"2026-07-06T18:23:19.450809Z","submitted_at":"2024-05-31T15:21:44Z","title":"Fast yet Safe: Early-Exiting with Risk Control","version":2},"cited_work":{"arxiv_id":"2405.20915","doi":null,"metadata_source":"pith","pith_arxiv_id":"2405.20915","snapshot_observed_at":"2026-08-10T20:40:46.600369Z","title":"Fast yet Safe: Early-Exiting with Risk Control","venue":"cs.LG","work_id":"6f0a0822-6678-455d-921a-3808140c3867","year":2024},"citing_paper":{"arxiv_id":"2501.07670","last_updated":"2025-01-13T20:08:52Z","snapshot_observed_at":"2026-08-10T20:35:19.202169Z","submitted_at":"2025-01-13T20:08:52Z","title":"A Survey of Early Exit Deep Neural Networks in NLP","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-10T20:40:46.230946Z"},"links":{"cited_paper":"/paper/2405.20915","citing_paper":"/paper/2501.07670"},"observation_digest":"sha256:ad1e244e34a2348d7048c113b2e89f560544fff3a0c1710728965feebd65a595","observation_id":"b13802df-a867-464b-8974-46043e2fad2d","resolution":{"observed_at":"2026-08-10T20:40:46.604193Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:40:46.235107Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.07670","last_updated":"2025-01-13T20:08:52Z","snapshot_observed_at":"2026-08-10T20:35:19.202169Z","submitted_at":"2025-01-13T20:08:52Z","title":"A Survey of Early Exit Deep Neural Networks in NLP","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-10T20:40:46.235107Z"},"links":{"citing_paper":"/paper/2501.07670"},"observation_digest":"sha256:b175a85759e995305d661564c4cdb978222a6af55a747575dc63a5d7aacd7865","observation_id":"9746897c-c63f-4ffd-8254-5f3432c40354","resolution":{"observed_at":"2026-08-10T20:40:46.235107Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1909.10351","last_updated":"2020-10-16T02:12:46Z","snapshot_observed_at":"2026-08-10T14:27:02.964369Z","submitted_at":"2019-09-23T13:05:35Z","title":"TinyBERT: Distilling BERT for Natural Language Understanding","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1909.10351","snapshot_observed_at":"2026-08-10T20:40:46.238539Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2501.07670","last_updated":"2025-01-13T20:08:52Z","snapshot_observed_at":"2026-08-10T20:35:19.202169Z","submitted_at":"2025-01-13T20:08:52Z","title":"A Survey of Early Exit Deep Neural Networks in NLP","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-10T20:40:46.238539Z"},"links":{"cited_paper":"/paper/1909.10351","citing_paper":"/paper/2501.07670"},"observation_digest":"sha256:8ef5b71207e94281c7e77a027bbf17e9babe50ee03346a76283aed8321b3962c","observation_id":"87036177-c3fc-40d2-a3a5-1c907edcaf3e","resolution":{"observed_at":"2026-08-10T20:40:46.238539Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:40:47.036809Z","title":null,"venue":null,"work_id":"ff6becb4-0fbf-423b-bbd0-e9fa5be1bd70","year":2021},"citing_paper":{"arxiv_id":"2501.07670","last_updated":"2025-01-13T20:08:52Z","snapshot_observed_at":"2026-08-10T20:35:19.202169Z","submitted_at":"2025-01-13T20:08:52Z","title":"A Survey of Early Exit Deep Neural Networks in NLP","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-10T20:40:46.242401Z"},"links":{"citing_paper":"/paper/2501.07670"},"observation_digest":"sha256:a3530e8d4a14dbc4b7528e60901d90aad2d83d3a66e3fcc8eff620d2910292c3","observation_id":"7d0b86f3-93f2-435c-b17d-ce4575ab8fe5","resolution":{"observed_at":"2026-08-10T20:40:47.040365Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:40:46.245885Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2501.07670","last_updated":"2025-01-13T20:08:52Z","snapshot_observed_at":"2026-08-10T20:35:19.202169Z","submitted_at":"2025-01-13T20:08:52Z","title":"A Survey of Early Exit Deep Neural Networks in NLP","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-10T20:40:46.245885Z"},"links":{"citing_paper":"/paper/2501.07670"},"observation_digest":"sha256:aa77fb5b42d47f836c156804a14c13ce18db187876d448b423f573fc87e3e468","observation_id":"fcaa64b6-499a-495d-a62e-d986de94dbcf","resolution":{"observed_at":"2026-08-10T20:40:46.245885Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:40:47.017126Z","title":"Selfxit: An unsupervised early exit mechanism for deep neural networks","venue":null,"work_id":"2f1c7c2f-ceea-47ed-8022-5ea7ca7efd26","year":null},"citing_paper":{"arxiv_id":"2501.07670","last_updated":"2025-01-13T20:08:52Z","snapshot_observed_at":"2026-08-10T20:35:19.202169Z","submitted_at":"2025-01-13T20:08:52Z","title":"A Survey of Early Exit Deep Neural Networks in NLP","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-10T20:40:46.249482Z"},"links":{"citing_paper":"/paper/2501.07670"},"observation_digest":"sha256:ef68ccdddeba9d1d6f1fc452c96485674c86c04a0ffda5188500f57dff0da512","observation_id":"ec7c5135-de78-43c2-83e9-edef188020b6","resolution":{"observed_at":"2026-08-10T20:40:47.020915Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:40:47.006516Z","title":null,"venue":null,"work_id":"c94ab768-2ee7-4343-9f11-08320db41184","year":2021},"citing_paper":{"arxiv_id":"2501.07670","last_updated":"2025-01-13T20:08:52Z","snapshot_observed_at":"2026-08-10T20:35:19.202169Z","submitted_at":"2025-01-13T20:08:52Z","title":"A Survey of Early Exit Deep Neural Networks in NLP","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-10T20:40:46.253158Z"},"links":{"citing_paper":"/paper/2501.07670"},"observation_digest":"sha256:093f9ff5949c1cc6b93909b486ab49a01ddda7adb89bcda9a7ed7a5d78b27d30","observation_id":"21565f64-42ae-489f-988d-b0dc35adfd1a","resolution":{"observed_at":"2026-08-10T20:40:47.010027Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1909.11942","last_updated":"2020-02-09T03:00:18Z","snapshot_observed_at":"2026-07-06T08:24:44.631342Z","submitted_at":"2019-09-26T07:06:13Z","title":"ALBERT: A Lite BERT for Self-supervised Learning of Language Representations","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1909.11942","snapshot_observed_at":"2026-08-10T20:40:46.256449Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2501.07670","last_updated":"2025-01-13T20:08:52Z","snapshot_observed_at":"2026-08-10T20:35:19.202169Z","submitted_at":"2025-01-13T20:08:52Z","title":"A Survey of Early Exit Deep Neural Networks in NLP","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-10T20:40:46.256449Z"},"links":{"cited_paper":"/paper/1909.11942","citing_paper":"/paper/2501.07670"},"observation_digest":"sha256:236b1c77c6bde2a88a991b30661326ffb2588b9d3a1bf9132aff801d1c2b91b0","observation_id":"70bc3a97-6e18-493e-b1ba-199a92ce1054","resolution":{"observed_at":"2026-08-10T20:40:46.256449Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:40:46.996000Z","title":null,"venue":null,"work_id":"42fb34b2-df12-42ec-aa02-3d7b0a51f6b3","year":2020},"citing_paper":{"arxiv_id":"2501.07670","last_updated":"2025-01-13T20:08:52Z","snapshot_observed_at":"2026-08-10T20:35:19.202169Z","submitted_at":"2025-01-13T20:08:52Z","title":"A Survey of Early Exit Deep Neural Networks in NLP","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-10T20:40:46.260038Z"},"links":{"citing_paper":"/paper/2501.07670"},"observation_digest":"sha256:8667f83cabba3b42be52bf5e02088bf792534b295ef59a80eb63355c0d86e4b7","observation_id":"c4384193-fb88-4d49-9fd7-08651a076bdb","resolution":{"observed_at":"2026-08-10T20:40:46.999485Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:40:46.985679Z","title":null,"venue":null,"work_id":"0569e78e-5947-4eb3-8909-5e88c7a8dced","year":2019},"citing_paper":{"arxiv_id":"2501.07670","last_updated":"2025-01-13T20:08:52Z","snapshot_observed_at":"2026-08-10T20:35:19.202169Z","submitted_at":"2025-01-13T20:08:52Z","title":"A Survey of Early Exit Deep Neural Networks in NLP","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-10T20:40:46.263754Z"},"links":{"citing_paper":"/paper/2501.07670"},"observation_digest":"sha256:6ab1750f581f3e7e317a989b6f716c43bad82e549fd7d187b14398401cec0b58","observation_id":"64cc8364-d5c8-459f-aee7-9230d5625bc9","resolution":{"observed_at":"2026-08-10T20:40:46.989296Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:40:46.974412Z","title":null,"venue":null,"work_id":"d599e034-dbd2-4cb9-8193-e6bf16bede80","year":2019},"citing_paper":{"arxiv_id":"2501.07670","last_updated":"2025-01-13T20:08:52Z","snapshot_observed_at":"2026-08-10T20:35:19.202169Z","submitted_at":"2025-01-13T20:08:52Z","title":"A Survey of Early Exit Deep Neural Networks in NLP","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-10T20:40:46.267366Z"},"links":{"citing_paper":"/paper/2501.07670"},"observation_digest":"sha256:0aa90979a9445e52b08786a18bf00159b81103e285ec08aa6aeba60fbeef4af8","observation_id":"c0c94623-e405-4bae-8732-50cbf7de794d","resolution":{"observed_at":"2026-08-10T20:40:46.978238Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:40:46.270834Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.07670","last_updated":"2025-01-13T20:08:52Z","snapshot_observed_at":"2026-08-10T20:35:19.202169Z","submitted_at":"2025-01-13T20:08:52Z","title":"A Survey of Early Exit Deep Neural Networks in NLP","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-10T20:40:46.270834Z"},"links":{"citing_paper":"/paper/2501.07670"},"observation_digest":"sha256:f2f4f5b517faf6446a0f40e17c49916a9a8a0c16049709906b526e41a97b65dc","observation_id":"44aa44e9-3aa9-4944-930f-43b1d8afea20","resolution":{"observed_at":"2026-08-10T20:40:46.270834Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:40:46.956913Z","title":null,"venue":null,"work_id":"ea3cbffc-cf4f-4790-acf5-8115529e93db","year":2021},"citing_paper":{"arxiv_id":"2501.07670","last_updated":"2025-01-13T20:08:52Z","snapshot_observed_at":"2026-08-10T20:35:19.202169Z","submitted_at":"2025-01-13T20:08:52Z","title":"A Survey of Early Exit Deep Neural Networks in NLP","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-10T20:40:46.274571Z"},"links":{"citing_paper":"/paper/2501.07670"},"observation_digest":"sha256:1b94193d9c841fa9da65b519e2c2dc38686b7bdc2509c74e5c99ded858b9c7c0","observation_id":"377a369e-9f64-441a-8f34-01bbf078469e","resolution":{"observed_at":"2026-08-10T20:40:46.960474Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2004.02178","last_updated":"2020-04-29T15:46:34Z","snapshot_observed_at":"2026-08-07T23:53:14.045662Z","submitted_at":"2020-04-05T12:29:20Z","title":"FastBERT: a Self-distilling BERT with Adaptive Inference Time","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2004.02178","snapshot_observed_at":"2026-08-10T20:40:46.278139Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2501.07670","last_updated":"2025-01-13T20:08:52Z","snapshot_observed_at":"2026-08-10T20:35:19.202169Z","submitted_at":"2025-01-13T20:08:52Z","title":"A Survey of Early Exit Deep Neural Networks in NLP","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-10T20:40:46.278139Z"},"links":{"cited_paper":"/paper/2004.02178","citing_paper":"/paper/2501.07670"},"observation_digest":"sha256:25a1cc7fec84f8633b6129d08802adb19c1e5908c4da8b868e4baaa5586b3a01","observation_id":"aa8c39f4-4821-4b31-a5e8-fa7a1e200b88","resolution":{"observed_at":"2026-08-10T20:40:46.278139Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.07038","last_updated":"2022-04-10T06:58:14Z","snapshot_observed_at":"2026-07-06T11:57:39.282469Z","submitted_at":"2021-10-13T21:17:15Z","title":"Towards Efficient NLP: A Standard Evaluation and A Strong Baseline","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.07038","snapshot_observed_at":"2026-08-10T20:40:46.282150Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.07670","last_updated":"2025-01-13T20:08:52Z","snapshot_observed_at":"2026-08-10T20:35:19.202169Z","submitted_at":"2025-01-13T20:08:52Z","title":"A Survey of Early Exit Deep Neural Networks in NLP","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-10T20:40:46.282150Z"},"links":{"cited_paper":"/paper/2110.07038","citing_paper":"/paper/2501.07670"},"observation_digest":"sha256:fd7cab73e84a07535bfe69393398d0460bc97cc1665792de8e096681750d9a95","observation_id":"4ad9aa09-2a99-42cb-9080-e43f0b76fae1","resolution":{"observed_at":"2026-08-10T20:40:46.282150Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:40:46.945515Z","title":null,"venue":null,"work_id":"75c6c468-c84b-42ac-97b7-8355eb50f599","year":2022},"citing_paper":{"arxiv_id":"2501.07670","last_updated":"2025-01-13T20:08:52Z","snapshot_observed_at":"2026-08-10T20:35:19.202169Z","submitted_at":"2025-01-13T20:08:52Z","title":"A Survey of Early Exit Deep Neural Networks in NLP","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-10T20:40:46.286009Z"},"links":{"citing_paper":"/paper/2501.07670"},"observation_digest":"sha256:75cc6a1f6f1b0f155f4824c9bdeccc15d18cb861210571f474adb6df264b9491","observation_id":"962afc2d-6f80-487c-9cd8-3bddfecd7dce","resolution":{"observed_at":"2026-08-10T20:40:46.949379Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.20272","last_updated":"2024-07-25T07:50:17Z","snapshot_observed_at":"2026-08-10T01:14:02.295527Z","submitted_at":"2024-07-25T07:50:17Z","title":"An Efficient Inference Framework for Early-exit Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.20272","snapshot_observed_at":"2026-08-10T20:40:46.289589Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.07670","last_updated":"2025-01-13T20:08:52Z","snapshot_observed_at":"2026-08-10T20:35:19.202169Z","submitted_at":"2025-01-13T20:08:52Z","title":"A Survey of Early Exit Deep Neural Networks in NLP","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-10T20:40:46.289589Z"},"links":{"cited_paper":"/paper/2407.20272","citing_paper":"/paper/2501.07670"},"observation_digest":"sha256:a75c3e512b86a76740a899a083fd1a7fd5e1ed66adf32ebc069124b35b9c1dea","observation_id":"643ba43f-04df-48d0-b5e1-3103ce0d0e3e","resolution":{"observed_at":"2026-08-10T20:40:46.289589Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:40:46.294355Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2501.07670","last_updated":"2025-01-13T20:08:52Z","snapshot_observed_at":"2026-08-10T20:35:19.202169Z","submitted_at":"2025-01-13T20:08:52Z","title":"A Survey of Early Exit Deep Neural Networks in NLP","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-10T20:40:46.294355Z"},"links":{"citing_paper":"/paper/2501.07670"},"observation_digest":"sha256:6768827929f6f7eaf70c0eba5baa1c8f1b7c7d62ae609c9314ebc49770e49298","observation_id":"b0438dd4-2ddf-48a9-b670-586016a5d784","resolution":{"observed_at":"2026-08-10T20:40:46.294355Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:40:46.927749Z","title":null,"venue":null,"work_id":"bc72ac7d-71f5-47aa-8e46-c0c7480c61ac","year":2024},"citing_paper":{"arxiv_id":"2501.07670","last_updated":"2025-01-13T20:08:52Z","snapshot_observed_at":"2026-08-10T20:35:19.202169Z","submitted_at":"2025-01-13T20:08:52Z","title":"A Survey of Early Exit Deep Neural Networks in NLP","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-10T20:40:46.298050Z"},"links":{"citing_paper":"/paper/2501.07670"},"observation_digest":"sha256:a366e0a5029089a14947a4bb53203a7e2a496eb8bfa9368137ed5e6e83f28b29","observation_id":"b4dd3de2-b4bc-487f-9950-ed088de5266f","resolution":{"observed_at":"2026-08-10T20:40:46.931535Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:40:46.301809Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2501.07670","last_updated":"2025-01-13T20:08:52Z","snapshot_observed_at":"2026-08-10T20:35:19.202169Z","submitted_at":"2025-01-13T20:08:52Z","title":"A Survey of Early Exit Deep Neural Networks in NLP","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-10T20:40:46.301809Z"},"links":{"citing_paper":"/paper/2501.07670"},"observation_digest":"sha256:7f65652ffebe8edec21e0d544010e6214f46ab5ec4b2816fc6fbdf80790d68f2","observation_id":"a3e76d8a-ec62-45ae-93e6-459f8e927fff","resolution":{"observed_at":"2026-08-10T20:40:46.301809Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:40:46.305710Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2501.07670","last_updated":"2025-01-13T20:08:52Z","snapshot_observed_at":"2026-08-10T20:35:19.202169Z","submitted_at":"2025-01-13T20:08:52Z","title":"A Survey of Early Exit Deep Neural Networks in NLP","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-10T20:40:46.305710Z"},"links":{"citing_paper":"/paper/2501.07670"},"observation_digest":"sha256:6e84bbeff0ff6426675d217d8f532976ecc7a07353dd7721b62691ceea95dc89","observation_id":"4e646685-6ce2-434c-88dc-0d3dbc30f1fd","resolution":{"observed_at":"2026-08-10T20:40:46.305710Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:40:46.901508Z","title":null,"venue":null,"work_id":"92744247-1cc9-4e82-b122-615b6fcd8e1a","year":2024},"citing_paper":{"arxiv_id":"2501.07670","last_updated":"2025-01-13T20:08:52Z","snapshot_observed_at":"2026-08-10T20:35:19.202169Z","submitted_at":"2025-01-13T20:08:52Z","title":"A Survey of Early Exit Deep Neural Networks in NLP","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-10T20:40:46.309380Z"},"links":{"citing_paper":"/paper/2501.07670"},"observation_digest":"sha256:98a69ebf9c7e7d7f41f42160e9aa61f3baf4a2a3ecb9679d70bc47283bdf750d","observation_id":"434abdf9-2ca1-4feb-91a6-21eaf17041c3","resolution":{"observed_at":"2026-08-10T20:40:46.906119Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1910.01108","last_updated":"2020-03-01T02:57:50Z","snapshot_observed_at":"2026-08-07T19:07:36.327251Z","submitted_at":"2019-10-02T17:56:28Z","title":"DistilBERT, a distilled version of BERT: smaller, faster, cheaper and lighter","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1910.01108","snapshot_observed_at":"2026-08-10T20:40:46.313146Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2501.07670","last_updated":"2025-01-13T20:08:52Z","snapshot_observed_at":"2026-08-10T20:35:19.202169Z","submitted_at":"2025-01-13T20:08:52Z","title":"A Survey of Early Exit Deep Neural Networks in NLP","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-10T20:40:46.313146Z"},"links":{"cited_paper":"/paper/1910.01108","citing_paper":"/paper/2501.07670"},"observation_digest":"sha256:8f8e84c5a2f3bd7f9d6543b9121f3cfb781dc7feb923005e18744d57d864fb0d","observation_id":"3538a7aa-b07e-4cba-b8ed-0c1d6ae58492","resolution":{"observed_at":"2026-08-10T20:40:46.313146Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.01670","last_updated":"2022-03-03T12:02:05Z","snapshot_observed_at":"2026-08-10T22:56:26.426857Z","submitted_at":"2022-03-03T12:02:05Z","title":"A Simple Hash-Based Early Exiting Approach For Language Understanding and Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.01670","snapshot_observed_at":"2026-08-10T20:40:46.317957Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.07670","last_updated":"2025-01-13T20:08:52Z","snapshot_observed_at":"2026-08-10T20:35:19.202169Z","submitted_at":"2025-01-13T20:08:52Z","title":"A Survey of Early Exit Deep Neural Networks in NLP","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-10T20:40:46.317957Z"},"links":{"cited_paper":"/paper/2203.01670","citing_paper":"/paper/2501.07670"},"observation_digest":"sha256:f180d1eed5faa502ec5af1364fec145f49d00d083e4c23aaf3df436cec83b24e","observation_id":"095a79ce-6908-4a9e-9bc6-c0255703a486","resolution":{"observed_at":"2026-08-10T20:40:46.317957Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2105.13792","last_updated":"2021-05-28T12:54:11Z","snapshot_observed_at":"2026-07-06T11:13:41.697221Z","submitted_at":"2021-05-28T12:54:11Z","title":"Early Exiting with Ensemble Internal Classifiers","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2105.13792","snapshot_observed_at":"2026-08-10T20:40:46.322221Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.07670","last_updated":"2025-01-13T20:08:52Z","snapshot_observed_at":"2026-08-10T20:35:19.202169Z","submitted_at":"2025-01-13T20:08:52Z","title":"A Survey of Early Exit Deep Neural Networks in NLP","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-10T20:40:46.322221Z"},"links":{"cited_paper":"/paper/2105.13792","citing_paper":"/paper/2501.07670"},"observation_digest":"sha256:5eeab2557763b1895d85f657585ae5e8231a5dc8c1cabd8ff429b794b605dd99","observation_id":"c81c32a7-f604-4e4f-a824-d32db81c693b","resolution":{"observed_at":"2026-08-10T20:40:46.322221Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.08623","last_updated":"2023-11-15T01:01:02Z","snapshot_observed_at":"2026-08-11T07:25:01.130191Z","submitted_at":"2023-11-15T01:01:02Z","title":"DEED: Dynamic Early Exit on Decoder for Accelerating Encoder-Decoder Transformer Models","version":1},"cited_work":{"arxiv_id":"2311.08623","doi":null,"metadata_source":"pith","pith_arxiv_id":"2311.08623","snapshot_observed_at":"2026-08-10T20:40:46.513244Z","title":"DEED: Dynamic Early Exit on Decoder for Accelerating Encoder-Decoder Transformer Models","venue":"cs.CV","work_id":"d5f0b0d8-6a1a-4e96-bdca-171986348f5e","year":2023},"citing_paper":{"arxiv_id":"2501.07670","last_updated":"2025-01-13T20:08:52Z","snapshot_observed_at":"2026-08-10T20:35:19.202169Z","submitted_at":"2025-01-13T20:08:52Z","title":"A Survey of Early Exit Deep Neural Networks in NLP","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-10T20:40:46.326382Z"},"links":{"cited_paper":"/paper/2311.08623","citing_paper":"/paper/2501.07670"},"observation_digest":"sha256:c9e3fd8d6723f37db71acd0a06597067613ad2ef26e3af4292fb74f54f22f998","observation_id":"f8e46232-3a4f-4353-accd-d00dbc6e6fb8","resolution":{"observed_at":"2026-08-10T20:40:46.517277Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.17074","last_updated":"2024-08-16T04:46:19Z","snapshot_observed_at":"2026-07-06T16:25:21.571679Z","submitted_at":"2023-09-29T09:10:04Z","title":"AdaDiff: Accelerating Diffusion Models through Step-Wise Adaptive Computation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.17074","snapshot_observed_at":"2026-08-10T20:40:46.330261Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.07670","last_updated":"2025-01-13T20:08:52Z","snapshot_observed_at":"2026-08-10T20:35:19.202169Z","submitted_at":"2025-01-13T20:08:52Z","title":"A Survey of Early Exit Deep Neural Networks in NLP","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-10T20:40:46.330261Z"},"links":{"cited_paper":"/paper/2309.17074","citing_paper":"/paper/2501.07670"},"observation_digest":"sha256:c41de30a803dc611ee8e5a54b0b5badba4a4e084e6f80c7654fec5804c279f42","observation_id":"d85a88c3-36e5-4230-983b-a737b4099f4c","resolution":{"observed_at":"2026-08-10T20:40:46.330261Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:40:46.890301Z","title":null,"venue":null,"work_id":"269af405-4650-48b5-abba-0fd5f5f3e0b6","year":2023},"citing_paper":{"arxiv_id":"2501.07670","last_updated":"2025-01-13T20:08:52Z","snapshot_observed_at":"2026-08-10T20:35:19.202169Z","submitted_at":"2025-01-13T20:08:52Z","title":"A Survey of Early Exit Deep Neural Networks in NLP","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-10T20:40:46.334401Z"},"links":{"citing_paper":"/paper/2501.07670"},"observation_digest":"sha256:144157063d02136762c3c12b1dc6a64d4cf44e6b5f1193bc7e1f505de98e6939","observation_id":"0f8dff5c-be70-4200-9b00-7609adcb2f48","resolution":{"observed_at":"2026-08-10T20:40:46.893958Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:40:46.338221Z","title":null,"venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2501.07670","last_updated":"2025-01-13T20:08:52Z","snapshot_observed_at":"2026-08-10T20:35:19.202169Z","submitted_at":"2025-01-13T20:08:52Z","title":"A Survey of Early Exit Deep Neural Networks in NLP","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-10T20:40:46.338221Z"},"links":{"citing_paper":"/paper/2501.07670"},"observation_digest":"sha256:dd06586c600779af6df7f6365fe1a3b67dec75c11f757a7f4d0d9322cea97f18","observation_id":"57db61d5-6ea3-4359-8d12-d77795f209c6","resolution":{"observed_at":"2026-08-10T20:40:46.338221Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:40:46.872576Z","title":null,"venue":null,"work_id":"25a9e083-4f1b-40e8-8a59-2a1fc697a072","year":2017},"citing_paper":{"arxiv_id":"2501.07670","last_updated":"2025-01-13T20:08:52Z","snapshot_observed_at":"2026-08-10T20:35:19.202169Z","submitted_at":"2025-01-13T20:08:52Z","title":"A Survey of Early Exit Deep Neural Networks in NLP","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-10T20:40:46.341740Z"},"links":{"citing_paper":"/paper/2501.07670"},"observation_digest":"sha256:090b2675214ccea2ba2760101c9b31b95a034c47cb7d17c3d78145489a7ad460","observation_id":"bc461c5f-8af1-4176-8feb-07d048b558f0","resolution":{"observed_at":"2026-08-10T20:40:46.876386Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13971","last_updated":"2023-02-27T17:11:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-27T17:11:15Z","title":"LLaMA: Open and Efficient Foundation Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.13971","snapshot_observed_at":"2026-08-10T20:40:46.345479Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.07670","last_updated":"2025-01-13T20:08:52Z","snapshot_observed_at":"2026-08-10T20:35:19.202169Z","submitted_at":"2025-01-13T20:08:52Z","title":"A Survey of Early Exit Deep Neural Networks in NLP","version":1},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-10T20:40:46.345479Z"},"links":{"cited_paper":"/paper/2302.13971","citing_paper":"/paper/2501.07670"},"observation_digest":"sha256:2b5c80dbced6922df2e1e72a1c87f868faeba42c1d5a8b2f01ee63e8e8b7403b","observation_id":"c8d2adb5-ae52-46b5-8f8d-97f8fc3efffb","resolution":{"observed_at":"2026-08-10T20:40:46.345479Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:40:46.860846Z","title":null,"venue":null,"work_id":"27dc5283-e7c2-4af5-b264-5eb70b18bd1f","year":2022},"citing_paper":{"arxiv_id":"2501.07670","last_updated":"2025-01-13T20:08:52Z","snapshot_observed_at":"2026-08-10T20:35:19.202169Z","submitted_at":"2025-01-13T20:08:52Z","title":"A Survey of Early Exit Deep Neural Networks in NLP","version":1},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-10T20:40:46.348827Z"},"links":{"citing_paper":"/paper/2501.07670"},"observation_digest":"sha256:ff32d383ff4998309cda81d27edcf2c6041f71bd46d868f68ef54f5d76eee84a","observation_id":"b603b61c-07c2-4cbd-8a3c-78be3724bb0f","resolution":{"observed_at":"2026-08-10T20:40:46.864755Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:40:46.352313Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2501.07670","last_updated":"2025-01-13T20:08:52Z","snapshot_observed_at":"2026-08-10T20:35:19.202169Z","submitted_at":"2025-01-13T20:08:52Z","title":"A Survey of Early Exit Deep Neural Networks in NLP","version":1},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-08-10T20:40:46.352313Z"},"links":{"citing_paper":"/paper/2501.07670"},"observation_digest":"sha256:ee1d419fc88c1be118b10d096a1fbedd101ffad3f8cee35035c36f1ba3955eaf","observation_id":"d04b6133-e3ea-4dd4-8c50-dda2adf48ae4","resolution":{"observed_at":"2026-08-10T20:40:46.352313Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:40:46.843847Z","title":null,"venue":null,"work_id":"284a9e45-d10b-4eb6-a85a-86ec3e7c0f12","year":2023},"citing_paper":{"arxiv_id":"2501.07670","last_updated":"2025-01-13T20:08:52Z","snapshot_observed_at":"2026-08-10T20:35:19.202169Z","submitted_at":"2025-01-13T20:08:52Z","title":"A Survey of Early Exit Deep Neural Networks in NLP","version":1},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-08-10T20:40:46.355962Z"},"links":{"citing_paper":"/paper/2501.07670"},"observation_digest":"sha256:214cf349c6305e1a17c0270b5dede9200e80393f005bef9a5f755b5562e11fb8","observation_id":"e5d64cce-d1f3-481e-a1df-ec48e2ef269d","resolution":{"observed_at":"2026-08-10T20:40:46.847407Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:40:46.359167Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2501.07670","last_updated":"2025-01-13T20:08:52Z","snapshot_observed_at":"2026-08-10T20:35:19.202169Z","submitted_at":"2025-01-13T20:08:52Z","title":"A Survey of Early Exit Deep Neural Networks in NLP","version":1},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-08-10T20:40:46.359167Z"},"links":{"citing_paper":"/paper/2501.07670"},"observation_digest":"sha256:b69c2b6c3442db2199866deaf15a0ceb72a92a08facb8cc87ab8bf5473edfec6","observation_id":"22773d6d-191c-4185-810d-1598b61bebee","resolution":{"observed_at":"2026-08-10T20:40:46.359167Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:40:46.826631Z","title":null,"venue":null,"work_id":"6bb4a588-f71f-45b0-9be4-d9f56d6510af","year":2021},"citing_paper":{"arxiv_id":"2501.07670","last_updated":"2025-01-13T20:08:52Z","snapshot_observed_at":"2026-08-10T20:35:19.202169Z","submitted_at":"2025-01-13T20:08:52Z","title":"A Survey of Early Exit Deep Neural Networks in NLP","version":1},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-08-10T20:40:46.362794Z"},"links":{"citing_paper":"/paper/2501.07670"},"observation_digest":"sha256:c80c52583ee47c4d3683fd56421118782d1d2683812f399af683d6e0f25eb528","observation_id":"53f9176e-7ae3-47b5-9708-333cd23659ef","resolution":{"observed_at":"2026-08-10T20:40:46.830660Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2004.12993","last_updated":"2020-04-27T17:58:05Z","snapshot_observed_at":"2026-08-06T01:22:26.725556Z","submitted_at":"2020-04-27T17:58:05Z","title":"DeeBERT: Dynamic Early Exiting for Accelerating BERT Inference","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2004.12993","snapshot_observed_at":"2026-08-10T20:40:46.366418Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2501.07670","last_updated":"2025-01-13T20:08:52Z","snapshot_observed_at":"2026-08-10T20:35:19.202169Z","submitted_at":"2025-01-13T20:08:52Z","title":"A Survey of Early Exit Deep Neural Networks in NLP","version":1},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-08-10T20:40:46.366418Z"},"links":{"cited_paper":"/paper/2004.12993","citing_paper":"/paper/2501.07670"},"observation_digest":"sha256:b4bf2085732a5f06707bd7cea94e8108a7d06d53043afe468221a60704abfe86","observation_id":"1ee2e5e1-98ca-4a0f-a160-a79b445decd4","resolution":{"observed_at":"2026-08-10T20:40:46.366418Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:40:46.813147Z","title":null,"venue":null,"work_id":"055ac4b1-6391-4333-b26c-ad3a9e7d27a5","year":2021},"citing_paper":{"arxiv_id":"2501.07670","last_updated":"2025-01-13T20:08:52Z","snapshot_observed_at":"2026-08-10T20:35:19.202169Z","submitted_at":"2025-01-13T20:08:52Z","title":"A Survey of Early Exit Deep Neural Networks in NLP","version":1},"reference_index":63,"source":"arxiv_source","source_observed_at":"2026-08-10T20:40:46.370071Z"},"links":{"citing_paper":"/paper/2501.07670"},"observation_digest":"sha256:af7b3e1f20bf7d6998e5453ab17079fbacbcb2d9cf1d927423c2618086d52f9f","observation_id":"b670a625-9914-4934-81d7-8aadec583db5","resolution":{"observed_at":"2026-08-10T20:40:46.817932Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2202.07101","last_updated":"2023-02-24T06:18:20Z","snapshot_observed_at":"2026-07-06T12:37:46.989132Z","submitted_at":"2022-02-15T00:13:05Z","title":"A Survey on Dynamic Neural Networks for Natural Language Processing","version":2},"cited_work":{"arxiv_id":"2202.07101","doi":null,"metadata_source":"pith","pith_arxiv_id":"2202.07101","snapshot_observed_at":"2026-08-10T20:40:46.460835Z","title":"A Survey on Dynamic Neural Networks for Natural Language Processing","venue":"cs.CL","work_id":"00565e87-4e58-41f0-b2d1-2e5416c93efe","year":2022},"citing_paper":{"arxiv_id":"2501.07670","last_updated":"2025-01-13T20:08:52Z","snapshot_observed_at":"2026-08-10T20:35:19.202169Z","submitted_at":"2025-01-13T20:08:52Z","title":"A Survey of Early Exit Deep Neural Networks in NLP","version":1},"reference_index":64,"source":"arxiv_source","source_observed_at":"2026-08-10T20:40:46.373492Z"},"links":{"cited_paper":"/paper/2202.07101","citing_paper":"/paper/2501.07670"},"observation_digest":"sha256:8a248aa9ef7857db8fe5efd0f56f44d2d6c20a2bbe468245432a38ec262d0aad","observation_id":"6d05c488-4e55-4e13-ae67-c826bc121554","resolution":{"observed_at":"2026-08-10T20:40:46.466945Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:40:46.377205Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2501.07670","last_updated":"2025-01-13T20:08:52Z","snapshot_observed_at":"2026-08-10T20:35:19.202169Z","submitted_at":"2025-01-13T20:08:52Z","title":"A Survey of Early Exit Deep Neural Networks in NLP","version":1},"reference_index":65,"source":"arxiv_source","source_observed_at":"2026-08-10T20:40:46.377205Z"},"links":{"citing_paper":"/paper/2501.07670"},"observation_digest":"sha256:cc3467fd06db19fcb5f30178221b3a9bd8110575e3273483f1d65e7a415d5107","observation_id":"420820c9-2f43-4357-8064-0807d6987c15","resolution":{"observed_at":"2026-08-10T20:40:46.377205Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.08168","last_updated":"2024-05-20T02:37:20Z","snapshot_observed_at":"2026-07-06T16:18:49.258642Z","submitted_at":"2023-09-15T05:34:32Z","title":"Draft & Verify: Lossless Large Language Model Acceleration via Self-Speculative Decoding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.08168","snapshot_observed_at":"2026-08-10T20:40:46.380797Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.07670","last_updated":"2025-01-13T20:08:52Z","snapshot_observed_at":"2026-08-10T20:35:19.202169Z","submitted_at":"2025-01-13T20:08:52Z","title":"A Survey of Early Exit Deep Neural Networks in NLP","version":1},"reference_index":66,"source":"arxiv_source","source_observed_at":"2026-08-10T20:40:46.380797Z"},"links":{"cited_paper":"/paper/2309.08168","citing_paper":"/paper/2501.07670"},"observation_digest":"sha256:8ea98df6b87a938f8a166848393633d9b4e2c468f8d0817ffb541bfc853ea475","observation_id":"391f8be7-67b5-437c-9e97-5b1bb0363d1f","resolution":{"observed_at":"2026-08-10T20:40:46.380797Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2009.12812","last_updated":"2020-10-10T07:24:54Z","snapshot_observed_at":"2026-08-09T20:46:06.940947Z","submitted_at":"2020-09-27T10:17:28Z","title":"TernaryBERT: Distillation-aware Ultra-low Bit BERT","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.12812","snapshot_observed_at":"2026-08-10T20:40:46.384659Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2501.07670","last_updated":"2025-01-13T20:08:52Z","snapshot_observed_at":"2026-08-10T20:35:19.202169Z","submitted_at":"2025-01-13T20:08:52Z","title":"A Survey of Early Exit Deep Neural Networks in NLP","version":1},"reference_index":67,"source":"arxiv_source","source_observed_at":"2026-08-10T20:40:46.384659Z"},"links":{"cited_paper":"/paper/2009.12812","citing_paper":"/paper/2501.07670"},"observation_digest":"sha256:61cddd61f372139c7b89a0bc99564a01d32728cac17932c6d8bcec8daca8ce6a","observation_id":"8f1e27d3-cec5-4bed-95c9-6cb8f65752c2","resolution":{"observed_at":"2026-08-10T20:40:46.384659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:40:46.794659Z","title":null,"venue":null,"work_id":"c8f765f8-2463-4b20-99e0-5b1b7c33a161","year":2022},"citing_paper":{"arxiv_id":"2501.07670","last_updated":"2025-01-13T20:08:52Z","snapshot_observed_at":"2026-08-10T20:35:19.202169Z","submitted_at":"2025-01-13T20:08:52Z","title":"A Survey of Early Exit Deep Neural Networks in NLP","version":1},"reference_index":68,"source":"arxiv_source","source_observed_at":"2026-08-10T20:40:46.390402Z"},"links":{"citing_paper":"/paper/2501.07670"},"observation_digest":"sha256:de374cd147d600f904faf8fb6d21c27070dc4071bd10b97c1506697dd68eb808","observation_id":"008776e3-1d70-4ea0-919f-9f10bf503d33","resolution":{"observed_at":"2026-08-10T20:40:46.797932Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:40:46.394040Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2501.07670","last_updated":"2025-01-13T20:08:52Z","snapshot_observed_at":"2026-08-10T20:35:19.202169Z","submitted_at":"2025-01-13T20:08:52Z","title":"A Survey of Early Exit Deep Neural Networks in NLP","version":1},"reference_index":69,"source":"arxiv_source","source_observed_at":"2026-08-10T20:40:46.394040Z"},"links":{"citing_paper":"/paper/2501.07670"},"observation_digest":"sha256:ba5f5e7ef7209b79502fde0df61b314110aac11f15f5848ca26d6d64a0b485cf","observation_id":"f92cb5a0-b4a9-440e-9410-95b52627f32a","resolution":{"observed_at":"2026-08-10T20:40:46.394040Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:40:46.778485Z","title":null,"venue":null,"work_id":"172167e2-1ca4-483b-9ab1-8f5eb10eed71","year":2023},"citing_paper":{"arxiv_id":"2501.07670","last_updated":"2025-01-13T20:08:52Z","snapshot_observed_at":"2026-08-10T20:35:19.202169Z","submitted_at":"2025-01-13T20:08:52Z","title":"A Survey of Early Exit Deep Neural Networks in NLP","version":1},"reference_index":70,"source":"arxiv_source","source_observed_at":"2026-08-10T20:40:46.397438Z"},"links":{"citing_paper":"/paper/2501.07670"},"observation_digest":"sha256:8e637c841bb24ab2b649fa1ef71769f5ab71098b16341b98d975681bc793f6d4","observation_id":"15717e65-310e-4567-a10f-d16e0ab97fc3","resolution":{"observed_at":"2026-08-10T20:40:46.782285Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:40:46.401242Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.07670","last_updated":"2025-01-13T20:08:52Z","snapshot_observed_at":"2026-08-10T20:35:19.202169Z","submitted_at":"2025-01-13T20:08:52Z","title":"A Survey of Early Exit Deep Neural Networks in NLP","version":1},"reference_index":71,"source":"arxiv_source","source_observed_at":"2026-08-10T20:40:46.401242Z"},"links":{"citing_paper":"/paper/2501.07670"},"observation_digest":"sha256:781f141c92834309e11aacecee69d28c64b0e89958b7bdeed6bf576f16bd3de8","observation_id":"1b85821a-3649-4d3d-a27a-4c9cf0ced32b","resolution":{"observed_at":"2026-08-10T20:40:46.401242Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2501.07670","last_updated":"2025-01-13T20:08:52Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-10T20:35:19.202169Z","submitted_at":"2025-01-13T20:08:52Z","title":"A Survey of Early Exit Deep Neural Networks in NLP"},"reference_resolution":{"displayed":71,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":64,"verified_exact":6,"verified_fuzzy":1},"total_outbound_references":71},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"thesis":"As of 11 August 2026, this Paper Citation Record lists 71 of 71 outbound references and 1 inbound Pith citation observation for arXiv:2501.07670."}