{"as_of":"2026-08-10T14:54:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:452515c74390c4f15cb653e9792447e6f07847e9bcb00f65aefdd02cc00ee294","coverage":[{"denominator":33,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":33,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-09T17:57:25.860723Z","state":"measured"},{"denominator":33,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":33,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2502.00745/citation-record","integrity":"/paper/2502.00745/integrity","json":"/paper/2502.00745/citation-record.json","paper":"/paper/2502.00745"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2012.15701","last_updated":"2021-07-22T13:13:45Z","snapshot_observed_at":"2026-08-09T15:34:02.499941Z","submitted_at":"2020-12-31T16:34:54Z","title":"BinaryBERT: Pushing the Limit of BERT Quantization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2012.15701","snapshot_observed_at":"2026-08-09T17:57:25.705245Z","title":"Binarybert: Pushing the limit of bert quantization","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2502.00745","last_updated":"2025-02-02T10:35:19Z","snapshot_observed_at":"2026-08-10T07:30:31.821573Z","submitted_at":"2025-02-02T10:35:19Z","title":"BEEM: Boosting Performance of Early Exit DNNs using Multi-Exit Classifiers as Experts","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-09T17:57:25.705245Z"},"links":{"cited_paper":"/paper/2012.15701","citing_paper":"/paper/2502.00745"},"observation_digest":"sha256:93e899a74ecb6fd535866e7e3ac704c254c3002611f4c52019695b570255c023","observation_id":"c19945f3-c170-4a08-bd3e-bf37d7014e74","resolution":{"observed_at":"2026-08-09T17:57:25.705245Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1810.04805","last_updated":"2019-05-24T20:37:26Z","snapshot_observed_at":"2026-07-30T09:12:38.100527Z","submitted_at":"2018-10-11T00:50:01Z","title":"BERT: Pre-training of Deep Bidirectional Transformers for Language Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1810.04805","snapshot_observed_at":"2026-08-09T17:57:25.730545Z","title":"Bert: Pre-training of deep bidirectional transformers for language understanding","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.00745","last_updated":"2025-02-02T10:35:19Z","snapshot_observed_at":"2026-08-10T07:30:31.821573Z","submitted_at":"2025-02-02T10:35:19Z","title":"BEEM: Boosting Performance of Early Exit DNNs using Multi-Exit Classifiers as Experts","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-09T17:57:25.730545Z"},"links":{"cited_paper":"/paper/1810.04805","citing_paper":"/paper/2502.00745"},"observation_digest":"sha256:693d91f507352ed0c14cfba61961f9a8b30a18b4c518024845daef84f2dd9189","observation_id":"815d24bb-bab9-4ff3-8f72-5d99b1b43c58","resolution":{"observed_at":"2026-08-09T17:57:25.730545Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1909.11556","last_updated":"2019-09-25T15:35:03Z","snapshot_observed_at":"2026-08-08T18:02:18.011077Z","submitted_at":"2019-09-25T15:35:03Z","title":"Reducing Transformer Depth on Demand with Structured Dropout","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1909.11556","snapshot_observed_at":"2026-08-09T17:57:25.735528Z","title":"Reducing transformer depth on demand with structured dropout","venue":null,"work_id":null,"year":1909},"citing_paper":{"arxiv_id":"2502.00745","last_updated":"2025-02-02T10:35:19Z","snapshot_observed_at":"2026-08-10T07:30:31.821573Z","submitted_at":"2025-02-02T10:35:19Z","title":"BEEM: Boosting Performance of Early Exit DNNs using Multi-Exit Classifiers as Experts","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-09T17:57:25.735528Z"},"links":{"cited_paper":"/paper/1909.11556","citing_paper":"/paper/2502.00745"},"observation_digest":"sha256:137a88a9d485818b1bf9b4c3de42aa28cff18b6b465df1e8c91fc92208e923c9","observation_id":"e9b19f68-5d25-49f6-a169-3cd83a1c6d67","resolution":{"observed_at":"2026-08-09T17:57:25.735528Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2101.09755","last_updated":"2021-01-24T17:03:57Z","snapshot_observed_at":"2026-08-10T11:18:45.246427Z","submitted_at":"2021-01-24T17:03:57Z","title":"RomeBERT: Robust Training of Multi-Exit BERT","version":1},"cited_work":{"arxiv_id":"2101.09755","doi":null,"metadata_source":"pith","pith_arxiv_id":"2101.09755","snapshot_observed_at":"2026-08-09T17:57:26.135225Z","title":"RomeBERT: Robust Training of Multi-Exit BERT","venue":"cs.CL","work_id":"5bc4fd31-e4ce-48e9-a716-88b6028828fb","year":2021},"citing_paper":{"arxiv_id":"2502.00745","last_updated":"2025-02-02T10:35:19Z","snapshot_observed_at":"2026-08-10T07:30:31.821573Z","submitted_at":"2025-02-02T10:35:19Z","title":"BEEM: Boosting Performance of Early Exit DNNs using Multi-Exit Classifiers as Experts","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-09T17:57:25.745258Z"},"links":{"cited_paper":"/paper/2101.09755","citing_paper":"/paper/2502.00745"},"observation_digest":"sha256:e360c5d51e167e430c06a4b6243895aec220acd0cb494967dc4f98af1d9eebf8","observation_id":"81f8680b-dd7c-41c0-b7ec-7f9e4817c9d6","resolution":{"observed_at":"2026-08-09T17:57:26.140681Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1909.10351","last_updated":"2020-10-16T02:12:46Z","snapshot_observed_at":"2026-08-10T14:27:02.964369Z","submitted_at":"2019-09-23T13:05:35Z","title":"TinyBERT: Distilling BERT for Natural Language Understanding","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1909.10351","snapshot_observed_at":"2026-08-09T17:57:25.760709Z","title":"Tinybert: Distilling bert for natural language understanding","venue":null,"work_id":null,"year":1909},"citing_paper":{"arxiv_id":"2502.00745","last_updated":"2025-02-02T10:35:19Z","snapshot_observed_at":"2026-08-10T07:30:31.821573Z","submitted_at":"2025-02-02T10:35:19Z","title":"BEEM: Boosting Performance of Early Exit DNNs using Multi-Exit Classifiers as Experts","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-09T17:57:25.760709Z"},"links":{"cited_paper":"/paper/1909.10351","citing_paper":"/paper/2502.00745"},"observation_digest":"sha256:8525c3f3e65bcc8a768226c4329c7040c33a71910a70463bb3d2aa1ea0ce5ad9","observation_id":"36675b5f-c8a7-4161-957f-7b814341f069","resolution":{"observed_at":"2026-08-09T17:57:25.760709Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:57:26.382689Z","title":"Low cost early exit decision unit design for cnn accelerator","venue":null,"work_id":"e2bd7704-b9a4-4250-8ef0-14fc015473e5","year":2020},"citing_paper":{"arxiv_id":"2502.00745","last_updated":"2025-02-02T10:35:19Z","snapshot_observed_at":"2026-08-10T07:30:31.821573Z","submitted_at":"2025-02-02T10:35:19Z","title":"BEEM: Boosting Performance of Early Exit DNNs using Multi-Exit Classifiers as Experts","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-09T17:57:25.766047Z"},"links":{"citing_paper":"/paper/2502.00745"},"observation_digest":"sha256:fe828899039a7df2fc421ad83a3e8c1ad3efbc893e5ab8b32c8590453f64aff8","observation_id":"34fa7dc1-6eba-4684-9b81-1f88003c90e7","resolution":{"observed_at":"2026-08-09T17:57:26.387768Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1412.6980","last_updated":"2017-01-30T01:27:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2014-12-22T13:54:29Z","title":"Adam: A Method for Stochastic Optimization","version":9},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1412.6980","snapshot_observed_at":"2026-08-09T17:57:25.770642Z","title":"Adam: A method for stochastic optimization","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.00745","last_updated":"2025-02-02T10:35:19Z","snapshot_observed_at":"2026-08-10T07:30:31.821573Z","submitted_at":"2025-02-02T10:35:19Z","title":"BEEM: Boosting Performance of Early Exit DNNs using Multi-Exit Classifiers as Experts","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-09T17:57:25.770642Z"},"links":{"cited_paper":"/paper/1412.6980","citing_paper":"/paper/2502.00745"},"observation_digest":"sha256:6fbfd0eb9a285c631c10ee47f6d20d950e4ecde9438a1e75ac5e4c40e79b6059","observation_id":"d07ecede-5fb8-4aff-bd74-3bd4dbbe1bb5","resolution":{"observed_at":"2026-08-09T17:57:25.770642Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:57:26.367417Z","title":"Blip: Bootstrapping language-image pre- training for unified vision-language understanding and generation","venue":null,"work_id":"e23943a4-2188-4d22-b4be-dc72689a28e1","year":2025},"citing_paper":{"arxiv_id":"2502.00745","last_updated":"2025-02-02T10:35:19Z","snapshot_observed_at":"2026-08-10T07:30:31.821573Z","submitted_at":"2025-02-02T10:35:19Z","title":"BEEM: Boosting Performance of Early Exit DNNs using Multi-Exit Classifiers as Experts","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-09T17:57:25.775400Z"},"links":{"citing_paper":"/paper/2502.00745"},"observation_digest":"sha256:ef1798815008985ec2105f81465afa690f3452188e55a069ddf149c55c3e3fd6","observation_id":"39b9da16-f0fa-4ccd-89a5-f09c3295d7f9","resolution":{"observed_at":"2026-08-09T17:57:26.372276Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:57:25.780229Z","title":"Microsoft coco: Common objects in context","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2502.00745","last_updated":"2025-02-02T10:35:19Z","snapshot_observed_at":"2026-08-10T07:30:31.821573Z","submitted_at":"2025-02-02T10:35:19Z","title":"BEEM: Boosting Performance of Early Exit DNNs using Multi-Exit Classifiers as Experts","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-09T17:57:25.780229Z"},"links":{"citing_paper":"/paper/2502.00745"},"observation_digest":"sha256:559461aa68b20b20b30fee93145c2cf1781fc857d928e92363a25b79f325c2e4","observation_id":"eb36cacd-d4d4-417e-a597-46904bd7ecc2","resolution":{"observed_at":"2026-08-09T17:57:25.780229Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.07038","last_updated":"2022-04-10T06:58:14Z","snapshot_observed_at":"2026-07-06T11:57:39.282469Z","submitted_at":"2021-10-13T21:17:15Z","title":"Towards Efficient NLP: A Standard Evaluation and A Strong Baseline","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.07038","snapshot_observed_at":"2026-08-09T17:57:25.789873Z","title":"Towards efficient NLP: A standard evaluation and A strong baseline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.00745","last_updated":"2025-02-02T10:35:19Z","snapshot_observed_at":"2026-08-10T07:30:31.821573Z","submitted_at":"2025-02-02T10:35:19Z","title":"BEEM: Boosting Performance of Early Exit DNNs using Multi-Exit Classifiers as Experts","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-09T17:57:25.789873Z"},"links":{"cited_paper":"/paper/2110.07038","citing_paper":"/paper/2502.00745"},"observation_digest":"sha256:b23118f6e51d4832cdac44d7277f29dd86e2ba958826fae0eae031151c881f84","observation_id":"69e111f4-b6da-476b-9f03-8dadc841542b","resolution":{"observed_at":"2026-08-09T17:57:25.789873Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:57:26.340549Z","title":"Calibration-aided edge inference offloading via adaptive model partitioning of deep neural networks","venue":null,"work_id":"4d0d49c4-d171-494b-9fe8-80b5b0971840","year":2021},"citing_paper":{"arxiv_id":"2502.00745","last_updated":"2025-02-02T10:35:19Z","snapshot_observed_at":"2026-08-10T07:30:31.821573Z","submitted_at":"2025-02-02T10:35:19Z","title":"BEEM: Boosting Performance of Early Exit DNNs using Multi-Exit Classifiers as Experts","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-09T17:57:25.794751Z"},"links":{"citing_paper":"/paper/2502.00745"},"observation_digest":"sha256:8e56e16f7e806b6ddc9412df87332a32c30287e76829077f3c2eb62f107c963e","observation_id":"7ee251dd-54c5-4ab2-9789-79882dbea912","resolution":{"observed_at":"2026-08-09T17:57:26.345958Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.09163","last_updated":"2024-05-10T08:43:52Z","snapshot_observed_at":"2026-08-09T05:08:03.919292Z","submitted_at":"2023-10-13T14:56:38Z","title":"Jointly-Learned Exit and Inference for a Dynamic Neural Network : JEI-DNN","version":2},"cited_work":{"arxiv_id":"2310.09163","doi":null,"metadata_source":"pith","pith_arxiv_id":"2310.09163","snapshot_observed_at":"2026-08-09T17:57:26.034508Z","title":"Jointly-Learned Exit and Inference for a Dynamic Neural Network : JEI-DNN","venue":"cs.LG","work_id":"9ff9963c-8ce7-416f-8747-a7d9ebad3656","year":2023},"citing_paper":{"arxiv_id":"2502.00745","last_updated":"2025-02-02T10:35:19Z","snapshot_observed_at":"2026-08-10T07:30:31.821573Z","submitted_at":"2025-02-02T10:35:19Z","title":"BEEM: Boosting Performance of Early Exit DNNs using Multi-Exit Classifiers as Experts","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-09T17:57:25.799791Z"},"links":{"cited_paper":"/paper/2310.09163","citing_paper":"/paper/2502.00745"},"observation_digest":"sha256:7ec6ee441f91d9768a41c73b94ada41797a0cc5ac9e9b254ff56937d0d83d9c9","observation_id":"dfaa2317-d54b-4a51-bb8c-0057ef44c292","resolution":{"observed_at":"2026-08-09T17:57:26.039697Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1910.01108","last_updated":"2020-03-01T02:57:50Z","snapshot_observed_at":"2026-08-07T19:07:36.327251Z","submitted_at":"2019-10-02T17:56:28Z","title":"DistilBERT, a distilled version of BERT: smaller, faster, cheaper and lighter","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1910.01108","snapshot_observed_at":"2026-08-09T17:57:25.804656Z","title":"Distilbert, a distilled version of bert: smaller, faster, cheaper and lighter","venue":null,"work_id":null,"year":1910},"citing_paper":{"arxiv_id":"2502.00745","last_updated":"2025-02-02T10:35:19Z","snapshot_observed_at":"2026-08-10T07:30:31.821573Z","submitted_at":"2025-02-02T10:35:19Z","title":"BEEM: Boosting Performance of Early Exit DNNs using Multi-Exit Classifiers as Experts","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-09T17:57:25.804656Z"},"links":{"cited_paper":"/paper/1910.01108","citing_paper":"/paper/2502.00745"},"observation_digest":"sha256:8a7e2d6c2d6b6d22ab314b35592fcc7ccd578a8cf383cf42f6d551eb52da6dfc","observation_id":"a112d15c-db21-4062-9329-1ce313c48b77","resolution":{"observed_at":"2026-08-09T17:57:25.804656Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2004.07453","last_updated":"2020-05-09T03:45:10Z","snapshot_observed_at":"2026-08-10T09:32:28.488271Z","submitted_at":"2020-04-16T04:28:08Z","title":"The Right Tool for the Job: Matching Model and Instance Complexities","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2004.07453","snapshot_observed_at":"2026-08-09T17:57:25.809524Z","title":"The right tool for the job: Matching model and instance complexities","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2502.00745","last_updated":"2025-02-02T10:35:19Z","snapshot_observed_at":"2026-08-10T07:30:31.821573Z","submitted_at":"2025-02-02T10:35:19Z","title":"BEEM: Boosting Performance of Early Exit DNNs using Multi-Exit Classifiers as Experts","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-09T17:57:25.809524Z"},"links":{"cited_paper":"/paper/2004.07453","citing_paper":"/paper/2502.00745"},"observation_digest":"sha256:351749e62f79c7e08fc9d0286860ba1563e4f0e0a396fda72e6fb71257c53d7c","observation_id":"85984723-a515-477d-91a4-c8b9c15459b6","resolution":{"observed_at":"2026-08-09T17:57:25.809524Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1908.09355","last_updated":"2019-08-25T16:13:24Z","snapshot_observed_at":"2026-08-07T14:15:56.428313Z","submitted_at":"2019-08-25T16:13:24Z","title":"Patient Knowledge Distillation for BERT Model Compression","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1908.09355","snapshot_observed_at":"2026-08-09T17:57:25.814259Z","title":"Patient knowledge distillation for bert model compression","venue":null,"work_id":null,"year":1908},"citing_paper":{"arxiv_id":"2502.00745","last_updated":"2025-02-02T10:35:19Z","snapshot_observed_at":"2026-08-10T07:30:31.821573Z","submitted_at":"2025-02-02T10:35:19Z","title":"BEEM: Boosting Performance of Early Exit DNNs using Multi-Exit Classifiers as Experts","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-09T17:57:25.814259Z"},"links":{"cited_paper":"/paper/1908.09355","citing_paper":"/paper/2502.00745"},"observation_digest":"sha256:9e0cc836829d63af889887fc64a176e2563105bad56398dc323e4c739d86af5a","observation_id":"53667ac5-4a18-447c-846b-fd3c0643f1c1","resolution":{"observed_at":"2026-08-09T17:57:25.814259Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2105.13792","last_updated":"2021-05-28T12:54:11Z","snapshot_observed_at":"2026-07-06T11:13:41.697221Z","submitted_at":"2021-05-28T12:54:11Z","title":"Early Exiting with Ensemble Internal Classifiers","version":1},"cited_work":{"arxiv_id":"2105.13792","doi":null,"metadata_source":"pith","pith_arxiv_id":"2105.13792","snapshot_observed_at":"2026-08-09T17:57:25.961652Z","title":"Early Exiting with Ensemble Internal Classifiers","venue":"cs.CL","work_id":"c7a7998f-f814-414b-83fd-1ce1ac7d7890","year":2021},"citing_paper":{"arxiv_id":"2502.00745","last_updated":"2025-02-02T10:35:19Z","snapshot_observed_at":"2026-08-10T07:30:31.821573Z","submitted_at":"2025-02-02T10:35:19Z","title":"BEEM: Boosting Performance of Early Exit DNNs using Multi-Exit Classifiers as Experts","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-09T17:57:25.819254Z"},"links":{"cited_paper":"/paper/2105.13792","citing_paper":"/paper/2502.00745"},"observation_digest":"sha256:cb0d41fe439bab06a6daad4d5cba2e683e062b028558b5301cec62246242bbed","observation_id":"b0fe9732-1402-479d-8c1e-6c8534d59e27","resolution":{"observed_at":"2026-08-09T17:57:25.968860Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2203.01670","last_updated":"2022-03-03T12:02:05Z","snapshot_observed_at":"2026-08-06T04:08:37.195133Z","submitted_at":"2022-03-03T12:02:05Z","title":"A Simple Hash-Based Early Exiting Approach For Language Understanding and Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.01670","snapshot_observed_at":"2026-08-09T17:57:25.823896Z","title":"A simple hash-based early exiting approach for language understanding and generation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.00745","last_updated":"2025-02-02T10:35:19Z","snapshot_observed_at":"2026-08-10T07:30:31.821573Z","submitted_at":"2025-02-02T10:35:19Z","title":"BEEM: Boosting Performance of Early Exit DNNs using Multi-Exit Classifiers as Experts","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-09T17:57:25.823896Z"},"links":{"cited_paper":"/paper/2203.01670","citing_paper":"/paper/2502.00745"},"observation_digest":"sha256:30dd29583bef572b4483750b884a20e63dfc3b3c2ee90e24588c485aa49d87e6","observation_id":"83f5f883-648d-4782-8b5c-5f82a18b3b3f","resolution":{"observed_at":"2026-08-09T17:57:25.823896Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:57:26.323910Z","title":"You need multiple exiting: Dynamic early exiting for accelerating unified vision language model","venue":null,"work_id":"cd0eeffd-8a77-4c24-a495-a1f33212af8e","year":2025},"citing_paper":{"arxiv_id":"2502.00745","last_updated":"2025-02-02T10:35:19Z","snapshot_observed_at":"2026-08-10T07:30:31.821573Z","submitted_at":"2025-02-02T10:35:19Z","title":"BEEM: Boosting Performance of Early Exit DNNs using Multi-Exit Classifiers as Experts","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-09T17:57:25.828656Z"},"links":{"citing_paper":"/paper/2502.00745"},"observation_digest":"sha256:abc27c30cf194dd7afa846d37617c1f58787661227099e9282423b178ef0d3dc","observation_id":"7c25490e-2b00-46d6-a35d-f61b70679dca","resolution":{"observed_at":"2026-08-09T17:57:26.328745Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:57:26.308145Z","title":"Branchynet: Fast inference via early exiting from deep neural networks","venue":null,"work_id":"04fd695c-5119-4073-9c08-64487c685235","year":2016},"citing_paper":{"arxiv_id":"2502.00745","last_updated":"2025-02-02T10:35:19Z","snapshot_observed_at":"2026-08-10T07:30:31.821573Z","submitted_at":"2025-02-02T10:35:19Z","title":"BEEM: Boosting Performance of Early Exit DNNs using Multi-Exit Classifiers as Experts","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-09T17:57:25.832995Z"},"links":{"citing_paper":"/paper/2502.00745"},"observation_digest":"sha256:b0ef8cd242ce50b42a9aa799ae04b9241d60d03964f917db407bf1278be99486","observation_id":"de5fc520-c4ef-431e-a2ab-50397a31056d","resolution":{"observed_at":"2026-08-09T17:57:26.313173Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2004.12993","last_updated":"2020-04-27T17:58:05Z","snapshot_observed_at":"2026-08-06T01:22:26.725556Z","submitted_at":"2020-04-27T17:58:05Z","title":"DeeBERT: Dynamic Early Exiting for Accelerating BERT Inference","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2004.12993","snapshot_observed_at":"2026-08-09T17:57:25.837531Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2502.00745","last_updated":"2025-02-02T10:35:19Z","snapshot_observed_at":"2026-08-10T07:30:31.821573Z","submitted_at":"2025-02-02T10:35:19Z","title":"BEEM: Boosting Performance of Early Exit DNNs using Multi-Exit Classifiers as Experts","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-09T17:57:25.837531Z"},"links":{"cited_paper":"/paper/2004.12993","citing_paper":"/paper/2502.00745"},"observation_digest":"sha256:e652fe77d03205240b2f6d649106ba11f6f64bb77e8906ba9ede6be2ab1234b1","observation_id":"10c0ec90-5f5e-44bc-a123-54a6a7c29592","resolution":{"observed_at":"2026-08-09T17:57:25.837531Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2009.12812","last_updated":"2020-10-10T07:24:54Z","snapshot_observed_at":"2026-08-09T20:46:06.940947Z","submitted_at":"2020-09-27T10:17:28Z","title":"TernaryBERT: Distillation-aware Ultra-low Bit BERT","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.12812","snapshot_observed_at":"2026-08-09T17:57:25.842227Z","title":"Ternarybert: Distillation-aware ultra-low bit bert","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2502.00745","last_updated":"2025-02-02T10:35:19Z","snapshot_observed_at":"2026-08-10T07:30:31.821573Z","submitted_at":"2025-02-02T10:35:19Z","title":"BEEM: Boosting Performance of Early Exit DNNs using Multi-Exit Classifiers as Experts","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-09T17:57:25.842227Z"},"links":{"cited_paper":"/paper/2009.12812","citing_paper":"/paper/2502.00745"},"observation_digest":"sha256:a265ddefbd94fabafbeea163ecbfd5d15e02db382ba562279300c29b7aa107a9","observation_id":"848d4f10-71e4-43ad-9356-8e9a8a5e6935","resolution":{"observed_at":"2026-08-09T17:57:25.842227Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:57:26.292209Z","title":"Pcee-bert: Accel- erating bert inference via patient and confident early exiting","venue":null,"work_id":"3c1b3b57-0893-4642-8e8e-900a08fa8da6","year":2022},"citing_paper":{"arxiv_id":"2502.00745","last_updated":"2025-02-02T10:35:19Z","snapshot_observed_at":"2026-08-10T07:30:31.821573Z","submitted_at":"2025-02-02T10:35:19Z","title":"BEEM: Boosting Performance of Early Exit DNNs using Multi-Exit Classifiers as Experts","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-09T17:57:25.846890Z"},"links":{"citing_paper":"/paper/2502.00745"},"observation_digest":"sha256:fe37256fbf11494ccdf154cc7308f5b1dfb78fd2e5ad4ef66cbd210db18b2dea","observation_id":"0d3d402a-fac2-4289-95ff-82da93155662","resolution":{"observed_at":"2026-08-09T17:57:26.297816Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1710.01878","last_updated":"2017-11-13T18:40:16Z","snapshot_observed_at":"2026-08-05T00:54:50.482913Z","submitted_at":"2017-10-05T04:26:49Z","title":"To prune, or not to prune: exploring the efficacy of pruning for model compression","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1710.01878","snapshot_observed_at":"2026-08-09T17:57:25.851352Z","title":"To prune, or not to prune: exploring the efficacy of pruning for model compression","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.00745","last_updated":"2025-02-02T10:35:19Z","snapshot_observed_at":"2026-08-10T07:30:31.821573Z","submitted_at":"2025-02-02T10:35:19Z","title":"BEEM: Boosting Performance of Early Exit DNNs using Multi-Exit Classifiers as Experts","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-09T17:57:25.851352Z"},"links":{"cited_paper":"/paper/1710.01878","citing_paper":"/paper/2502.00745"},"observation_digest":"sha256:3542b8e83aa11f19f863a3978be6b584202d22aecf00a275634cb11bc5fe71e2","observation_id":"b0e96430-915b-4144-8e19-fff037dca3a5","resolution":{"observed_at":"2026-08-09T17:57:25.851352Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:57:26.277450Z","title":"For simplicity, we prove it for the binary classification case","venue":null,"work_id":"9fe91be0-0c20-4957-9d64-b50ee6419d4a","year":2025},"citing_paper":{"arxiv_id":"2502.00745","last_updated":"2025-02-02T10:35:19Z","snapshot_observed_at":"2026-08-10T07:30:31.821573Z","submitted_at":"2025-02-02T10:35:19Z","title":"BEEM: Boosting Performance of Early Exit DNNs using Multi-Exit Classifiers as Experts","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-09T17:57:25.856225Z"},"links":{"citing_paper":"/paper/2502.00745"},"observation_digest":"sha256:b41245420e19f6f704d272060c48c32a48ce17827a632849d5f1a5c2ee1fcb16","observation_id":"43bbf726-7631-4c8c-b22c-1ac1840f63f1","resolution":{"observed_at":"2026-08-09T17:57:26.282176Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:57:26.261768Z","title":null,"venue":null,"work_id":"367791ef-33dc-453f-a820-eca46cc2d94d","year":2025},"citing_paper":{"arxiv_id":"2502.00745","last_updated":"2025-02-02T10:35:19Z","snapshot_observed_at":"2026-08-10T07:30:31.821573Z","submitted_at":"2025-02-02T10:35:19Z","title":"BEEM: Boosting Performance of Early Exit DNNs using Multi-Exit Classifiers as Experts","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-09T17:57:25.860723Z"},"links":{"citing_paper":"/paper/2502.00745"},"observation_digest":"sha256:7621b494bf843034821d1ccf7859afedb2940adcd723791ca65558d56e043f17","observation_id":"c5daa3b5-7323-4ff2-a542-c73c60eae22c","resolution":{"observed_at":"2026-08-09T17:57:26.266459Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2004.02178","last_updated":"2020-04-29T15:46:34Z","snapshot_observed_at":"2026-08-07T23:53:14.045662Z","submitted_at":"2020-04-05T12:29:20Z","title":"FastBERT: a Self-distilling BERT with Adaptive Inference Time","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2004.02178","snapshot_observed_at":"2026-08-09T17:57:25.784962Z","title":"Fastbert: a self-distilling bert with adaptive inference time","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2502.00745","last_updated":"2025-02-02T10:35:19Z","snapshot_observed_at":"2026-08-10T07:30:31.821573Z","submitted_at":"2025-02-02T10:35:19Z","title":"BEEM: Boosting Performance of Early Exit DNNs using Multi-Exit Classifiers as Experts","version":1},"reference_index":2014,"source":"pdf_text","source_observed_at":"2026-08-09T17:57:25.784962Z"},"links":{"cited_paper":"/paper/2004.02178","citing_paper":"/paper/2502.00745"},"observation_digest":"sha256:51735ffbda2749426a3f89a5ea70ac1dbbcfa9c1cd28dc1740eaabac9fcb5513","observation_id":"5c1225dc-7cd3-474b-a999-2154ac31a53f","resolution":{"observed_at":"2026-08-09T17:57:25.784962Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:57:26.398403Z","title":"Early exit with disentangled representation and equiangular tight frame","venue":null,"work_id":"6fe9a013-d826-43e7-85fd-03b84c693555","year":2023},"citing_paper":{"arxiv_id":"2502.00745","last_updated":"2025-02-02T10:35:19Z","snapshot_observed_at":"2026-08-10T07:30:31.821573Z","submitted_at":"2025-02-02T10:35:19Z","title":"BEEM: Boosting Performance of Early Exit DNNs using Multi-Exit Classifiers as Experts","version":1},"reference_index":2017,"source":"pdf_text","source_observed_at":"2026-08-09T17:57:25.755638Z"},"links":{"citing_paper":"/paper/2502.00745"},"observation_digest":"sha256:36a900ec1907464c768726b1f5464e1cc25d440c9b6fb4784e8e239745d1d10e","observation_id":"e8d990ab-617e-4b47-8750-8ccad488748b","resolution":{"observed_at":"2026-08-09T17:57:26.403224Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:57:26.413484Z","title":"Flexdnn: Input-adaptive on-device deep learning for efficient mobile vision","venue":null,"work_id":"a9652109-2e62-4a77-8df9-4f640455643b","year":2020},"citing_paper":{"arxiv_id":"2502.00745","last_updated":"2025-02-02T10:35:19Z","snapshot_observed_at":"2026-08-10T07:30:31.821573Z","submitted_at":"2025-02-02T10:35:19Z","title":"BEEM: Boosting Performance of Early Exit DNNs using Multi-Exit Classifiers as Experts","version":1},"reference_index":2019,"source":"pdf_text","source_observed_at":"2026-08-09T17:57:25.740507Z"},"links":{"citing_paper":"/paper/2502.00745"},"observation_digest":"sha256:e8de3acf747580b0a29a5c9b6326c85acb456b0b7bf5be85f08f393bf5dcc853","observation_id":"2f86425d-5086-4271-b553-e8e6a986a774","resolution":{"observed_at":"2026-08-09T17:57:26.418374Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.09195","last_updated":"2023-09-17T07:48:22Z","snapshot_observed_at":"2026-08-08T19:10:40.435839Z","submitted_at":"2023-09-17T07:48:22Z","title":"SplitEE: Early Exit in Deep Neural Networks with Split Computing","version":1},"cited_work":{"arxiv_id":"2309.09195","doi":null,"metadata_source":"pith","pith_arxiv_id":"2309.09195","snapshot_observed_at":"2026-08-09T17:57:26.228591Z","title":"SplitEE: Early Exit in Deep Neural Networks with Split Computing","venue":"cs.LG","work_id":"50fb13ab-de0d-4a26-b288-89bd430095a9","year":2023},"citing_paper":{"arxiv_id":"2502.00745","last_updated":"2025-02-02T10:35:19Z","snapshot_observed_at":"2026-08-10T07:30:31.821573Z","submitted_at":"2025-02-02T10:35:19Z","title":"BEEM: Boosting Performance of Early Exit DNNs using Multi-Exit Classifiers as Experts","version":1},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-09T17:57:25.710817Z"},"links":{"cited_paper":"/paper/2309.09195","citing_paper":"/paper/2502.00745"},"observation_digest":"sha256:c808d369dd12411ed1b563bf4e6aa240abae6411fced87c5b247462a3012f70b","observation_id":"747fad03-0b3f-4f75-b4e4-4c062c9f452b","resolution":{"observed_at":"2026-08-09T17:57:26.234347Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1703.09844","last_updated":"2018-06-07T14:39:29Z","snapshot_observed_at":"2026-08-05T05:49:08.436066Z","submitted_at":"2017-03-29T00:19:20Z","title":"Multi-Scale Dense Networks for Resource Efficient Image Classification","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1703.09844","snapshot_observed_at":"2026-08-09T17:57:25.750139Z","title":"Multi-scale dense networks for resource efficient image classification","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.00745","last_updated":"2025-02-02T10:35:19Z","snapshot_observed_at":"2026-08-10T07:30:31.821573Z","submitted_at":"2025-02-02T10:35:19Z","title":"BEEM: Boosting Performance of Early Exit DNNs using Multi-Exit Classifiers as Experts","version":1},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-09T17:57:25.750139Z"},"links":{"cited_paper":"/paper/1703.09844","citing_paper":"/paper/2502.00745"},"observation_digest":"sha256:66200d1c8dcc42ed97428d0159e49d40ebd5b295080874f7730486f369493644","observation_id":"f4eb3635-d368-4c20-b227-bfd362c870b2","resolution":{"observed_at":"2026-08-09T17:57:25.750139Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2107.05407","last_updated":"2021-09-02T08:48:41Z","snapshot_observed_at":"2026-08-10T06:51:08.792800Z","submitted_at":"2021-07-12T13:24:03Z","title":"PonderNet: Learning to Ponder","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2107.05407","snapshot_observed_at":"2026-08-09T17:57:25.725709Z","title":"Pondernet: Learning to ponder","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.00745","last_updated":"2025-02-02T10:35:19Z","snapshot_observed_at":"2026-08-10T07:30:31.821573Z","submitted_at":"2025-02-02T10:35:19Z","title":"BEEM: Boosting Performance of Early Exit DNNs using Multi-Exit Classifiers as Experts","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-09T17:57:25.725709Z"},"links":{"cited_paper":"/paper/2107.05407","citing_paper":"/paper/2502.00745"},"observation_digest":"sha256:bf2e852588dab23c3cc57ee7e7400222fa79190f5905c7bee5a831224dddc385","observation_id":"f68f6f9c-a06c-4c7a-a04d-23a20c29d99d","resolution":{"observed_at":"2026-08-09T17:57:25.725709Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.04433","last_updated":"2024-10-06T10:05:01Z","snapshot_observed_at":"2026-08-10T11:18:47.445977Z","submitted_at":"2024-10-06T10:05:01Z","title":"CAPEEN: Image Captioning with Early Exits and Knowledge Distillation","version":1},"cited_work":{"arxiv_id":"2410.04433","doi":null,"metadata_source":"pith","pith_arxiv_id":"2410.04433","snapshot_observed_at":"2026-08-09T17:57:26.205882Z","title":"CAPEEN: Image Captioning with Early Exits and Knowledge Distillation","venue":"cs.CV","work_id":"572029e6-d212-4112-84f8-aca8c74a0ab5","year":2024},"citing_paper":{"arxiv_id":"2502.00745","last_updated":"2025-02-02T10:35:19Z","snapshot_observed_at":"2026-08-10T07:30:31.821573Z","submitted_at":"2025-02-02T10:35:19Z","title":"BEEM: Boosting Performance of Early Exit DNNs using Multi-Exit Classifiers as Experts","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-09T17:57:25.715942Z"},"links":{"cited_paper":"/paper/2410.04433","citing_paper":"/paper/2502.00745"},"observation_digest":"sha256:1ebe4f6350dcdef4db15c02426614426dd1f335a216b6a2e40d1a8011b324cc4","observation_id":"1bd5dc8a-5c06-4935-9eac-35e58bd6a124","resolution":{"observed_at":"2026-08-09T17:57:26.211736Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T17:57:26.428734Z","title":"Palbert: Teaching albert to ponder","venue":null,"work_id":"1b3a65dd-1377-48a3-9cb1-ea45f677cbff","year":2025},"citing_paper":{"arxiv_id":"2502.00745","last_updated":"2025-02-02T10:35:19Z","snapshot_observed_at":"2026-08-10T07:30:31.821573Z","submitted_at":"2025-02-02T10:35:19Z","title":"BEEM: Boosting Performance of Early Exit DNNs using Multi-Exit Classifiers as Experts","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-09T17:57:25.720931Z"},"links":{"citing_paper":"/paper/2502.00745"},"observation_digest":"sha256:0462f53df39ce6833a08be9886f99f9d263f3d134d3d37956d84870d258af0c6","observation_id":"6ed14b9b-1c21-41dc-b6a6-deed74cf1a9b","resolution":{"observed_at":"2026-08-09T17:57:26.434133Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2502.00745","last_updated":"2025-02-02T10:35:19Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-10T07:30:31.821573Z","submitted_at":"2025-02-02T10:35:19Z","title":"BEEM: Boosting Performance of Early Exit DNNs using Multi-Exit Classifiers as Experts"},"reference_resolution":{"displayed":33,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":18,"verified_exact":5,"verified_fuzzy":10},"total_outbound_references":33},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 33 of 33 outbound references and 0 inbound Pith citation observations for arXiv:2502.00745."}