{"as_of":"2026-08-11T19:28:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:9b13a5cc54e68340bcce5455d455c4c784742a69dbafc92214fe91a42699e448","coverage":[{"denominator":50,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":50,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T00:46:17.847060Z","state":"measured"},{"denominator":50,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":50,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-11T06:34:44.6726+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2412.19325/citation-record","integrity":"/paper/2412.19325/integrity","json":"/paper/2412.19325/citation-record.json","paper":"/paper/2412.19325"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:46:17.674748Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.19325","last_updated":"2024-12-26T18:54:32Z","snapshot_observed_at":"2026-08-11T00:40:00.537400Z","submitted_at":"2024-12-26T18:54:32Z","title":"Performance Control in Early Exiting to Deploy Large Models at the Same Cost of Smaller Ones","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-11T00:46:17.674748Z"},"links":{"citing_paper":"/paper/2412.19325"},"observation_digest":"sha256:fd0790dba4a2d4b08d3d0c4bb36106823788891077ea78de1379e17118492674","observation_id":"6b047f6d-c614-4c50-8644-3920bd00f4d0","resolution":{"observed_at":"2026-08-11T00:46:17.674748Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:46:18.465150Z","title":"M., Mallinar, N., Lucas, J., and Nakkiran, P","venue":null,"work_id":"4306a54e-fc87-4d3d-a6dc-261757a560bd","year":2022},"citing_paper":{"arxiv_id":"2412.19325","last_updated":"2024-12-26T18:54:32Z","snapshot_observed_at":"2026-08-11T00:40:00.537400Z","submitted_at":"2024-12-26T18:54:32Z","title":"Performance Control in Early Exiting to Deploy Large Models at the Same Cost of Smaller Ones","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-11T00:46:17.679154Z"},"links":{"citing_paper":"/paper/2412.19325"},"observation_digest":"sha256:265a4433d05657b431ea555874b130b78d4693f6def7b63e391370d83a41ae43","observation_id":"96f9fb34-5070-4468-9e6c-e68f137b8c57","resolution":{"observed_at":"2026-08-11T00:46:18.469270Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.01318","last_updated":"2023-02-02T18:44:11Z","snapshot_observed_at":"2026-08-10T21:52:49.568983Z","submitted_at":"2023-02-02T18:44:11Z","title":"Accelerating Large Language Model Decoding with Speculative Sampling","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.01318","snapshot_observed_at":"2026-08-11T00:46:17.682571Z","title":"Accelerating large language model decoding with speculative sampling","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.19325","last_updated":"2024-12-26T18:54:32Z","snapshot_observed_at":"2026-08-11T00:40:00.537400Z","submitted_at":"2024-12-26T18:54:32Z","title":"Performance Control in Early Exiting to Deploy Large Models at the Same Cost of Smaller Ones","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-11T00:46:17.682571Z"},"links":{"cited_paper":"/paper/2302.01318","citing_paper":"/paper/2412.19325"},"observation_digest":"sha256:4ea188ea4e88701d856e5b95b7ed20b0ff3f06d6a74f9d9798a6d78304b6cf6e","observation_id":"322b18c9-c923-4dc8-bf44-04df3d88a268","resolution":{"observed_at":"2026-08-11T00:46:17.682571Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:46:18.454314Z","title":"and Ge, R","venue":null,"work_id":"847b07af-1cf5-470c-98e2-0202278afa6c","year":2024},"citing_paper":{"arxiv_id":"2412.19325","last_updated":"2024-12-26T18:54:32Z","snapshot_observed_at":"2026-08-11T00:40:00.537400Z","submitted_at":"2024-12-26T18:54:32Z","title":"Performance Control in Early Exiting to Deploy Large Models at the Same Cost of Smaller Ones","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-11T00:46:17.687034Z"},"links":{"citing_paper":"/paper/2412.19325"},"observation_digest":"sha256:dfffbfb8d9044427f37ca364161eb6076e8115aa521c6f4f7d1cf97177860172","observation_id":"15721e5e-9611-4ae0-bdc5-bc8941b55cb1","resolution":{"observed_at":"2026-08-11T00:46:18.457855Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:46:17.691055Z","title":"Imagenet: A large-scale hierarchical image database","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2412.19325","last_updated":"2024-12-26T18:54:32Z","snapshot_observed_at":"2026-08-11T00:40:00.537400Z","submitted_at":"2024-12-26T18:54:32Z","title":"Performance Control in Early Exiting to Deploy Large Models at the Same Cost of Smaller Ones","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-11T00:46:17.691055Z"},"links":{"citing_paper":"/paper/2412.19325"},"observation_digest":"sha256:15e4101db45bc8716393f8354c0789f26bcfa2901786721fc58a1290a07f6ea0","observation_id":"85cd3f88-e0ba-406c-94fb-a8302d1f35c2","resolution":{"observed_at":"2026-08-11T00:46:17.691055Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:46:17.694677Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.19325","last_updated":"2024-12-26T18:54:32Z","snapshot_observed_at":"2026-08-11T00:40:00.537400Z","submitted_at":"2024-12-26T18:54:32Z","title":"Performance Control in Early Exiting to Deploy Large Models at the Same Cost of Smaller Ones","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-11T00:46:17.694677Z"},"links":{"citing_paper":"/paper/2412.19325"},"observation_digest":"sha256:06d24034a1bdf31e83f5f11e5b49f81991abee38650672030862ba291a91aa35","observation_id":"fd2f7f04-dbce-4010-a5dc-378c5856032d","resolution":{"observed_at":"2026-08-11T00:46:17.694677Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:46:17.698823Z","title":"Qlora: Efficient finetuning of quantized llms","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.19325","last_updated":"2024-12-26T18:54:32Z","snapshot_observed_at":"2026-08-11T00:40:00.537400Z","submitted_at":"2024-12-26T18:54:32Z","title":"Performance Control in Early Exiting to Deploy Large Models at the Same Cost of Smaller Ones","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-11T00:46:17.698823Z"},"links":{"citing_paper":"/paper/2412.19325"},"observation_digest":"sha256:8aedbbf87ee0199d0d755699228b77ca1f8105878ffa2d1349a310d90625e4e3","observation_id":"8acee224-e61f-45b3-ab37-6afcaabda785","resolution":{"observed_at":"2026-08-11T00:46:17.698823Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:46:18.424646Z","title":"An image is worth 16x16 words: Transformers for image recognition at scale","venue":null,"work_id":"d555ef37-e72f-4f84-8f42-9d65b84da053","year":2020},"citing_paper":{"arxiv_id":"2412.19325","last_updated":"2024-12-26T18:54:32Z","snapshot_observed_at":"2026-08-11T00:40:00.537400Z","submitted_at":"2024-12-26T18:54:32Z","title":"Performance Control in Early Exiting to Deploy Large Models at the Same Cost of Smaller Ones","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-11T00:46:17.702162Z"},"links":{"citing_paper":"/paper/2412.19325"},"observation_digest":"sha256:e6e1261795581e06b3704596b64a5f0c6244e4c1883947ad46cb2346fba68260","observation_id":"90982f90-e08c-42ff-ace3-356ac7217f20","resolution":{"observed_at":"2026-08-11T00:46:18.428526Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1910.10073","last_updated":"2020-02-14T20:49:40Z","snapshot_observed_at":"2026-07-06T08:31:23.192830Z","submitted_at":"2019-10-22T16:15:58Z","title":"Depth-Adaptive Transformer","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1910.10073","snapshot_observed_at":"2026-08-11T00:46:17.705612Z","title":"Depth-adaptive transformer","venue":null,"work_id":null,"year":1910},"citing_paper":{"arxiv_id":"2412.19325","last_updated":"2024-12-26T18:54:32Z","snapshot_observed_at":"2026-08-11T00:40:00.537400Z","submitted_at":"2024-12-26T18:54:32Z","title":"Performance Control in Early Exiting to Deploy Large Models at the Same Cost of Smaller Ones","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-11T00:46:17.705612Z"},"links":{"cited_paper":"/paper/1910.10073","citing_paper":"/paper/2412.19325"},"observation_digest":"sha256:c856ab0142e452f067d78ec2ce0d473a400443a2749851733d6694ddc65a51e7","observation_id":"7a1f2f3d-82ee-4962-8c77-b681aacae00f","resolution":{"observed_at":"2026-08-11T00:46:17.705612Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:46:18.414112Z","title":"Depth-adaptive transformer","venue":null,"work_id":"a7101296-83d3-45ce-b96f-3c1908f69d50","year":2019},"citing_paper":{"arxiv_id":"2412.19325","last_updated":"2024-12-26T18:54:32Z","snapshot_observed_at":"2026-08-11T00:40:00.537400Z","submitted_at":"2024-12-26T18:54:32Z","title":"Performance Control in Early Exiting to Deploy Large Models at the Same Cost of Smaller Ones","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-11T00:46:17.709342Z"},"links":{"citing_paper":"/paper/2412.19325"},"observation_digest":"sha256:6f7b895d17cf3be6c100b8c473c57287e761f82208dfbf4d32a3323523b66bea","observation_id":"01883388-384a-4c99-a750-7d3ded7ddc1c","resolution":{"observed_at":"2026-08-11T00:46:18.417577Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2206.09034","last_updated":"2023-03-01T20:36:43Z","snapshot_observed_at":"2026-07-06T13:22:13.167692Z","submitted_at":"2022-06-17T22:23:11Z","title":"Towards Better Selective Classification","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2206.09034","snapshot_observed_at":"2026-08-11T00:46:17.712383Z","title":"O., Hajimirsadeghi, H., and Abdi, A","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.19325","last_updated":"2024-12-26T18:54:32Z","snapshot_observed_at":"2026-08-11T00:40:00.537400Z","submitted_at":"2024-12-26T18:54:32Z","title":"Performance Control in Early Exiting to Deploy Large Models at the Same Cost of Smaller Ones","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-11T00:46:17.712383Z"},"links":{"cited_paper":"/paper/2206.09034","citing_paper":"/paper/2412.19325"},"observation_digest":"sha256:ce7ffe91cc07df36656ffd442731a48d53da6f4c640cdf1787ef696bff1c79cf","observation_id":"01f1c6d6-378d-4c00-b8b7-5689ee95ff32","resolution":{"observed_at":"2026-08-11T00:46:17.712383Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2020.repl4nlp-1.18","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:46:17.894052Z","title":"Compressing BERT : Studying the effects of weight pruning on transfer learning","venue":null,"work_id":"e8c556a4-e48f-4cb1-ae03-3d5857c85612","year":2020},"citing_paper":{"arxiv_id":"2412.19325","last_updated":"2024-12-26T18:54:32Z","snapshot_observed_at":"2026-08-11T00:40:00.537400Z","submitted_at":"2024-12-26T18:54:32Z","title":"Performance Control in Early Exiting to Deploy Large Models at the Same Cost of Smaller Ones","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-11T00:46:17.716115Z"},"links":{"citing_paper":"/paper/2412.19325"},"observation_digest":"sha256:dc631072be6a74f6bdd5c61201fe371afd02cee7bf33f257f620aa05e9ae9609","observation_id":"f29ba132-eca4-4f0b-9ebe-a2a562def69d","resolution":{"observed_at":"2026-08-11T00:46:17.897772Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:46:18.404140Z","title":"and Bagnell, D","venue":null,"work_id":"ab8ee9fe-01bd-4f04-b72c-60599b05615c","year":2012},"citing_paper":{"arxiv_id":"2412.19325","last_updated":"2024-12-26T18:54:32Z","snapshot_observed_at":"2026-08-11T00:40:00.537400Z","submitted_at":"2024-12-26T18:54:32Z","title":"Performance Control in Early Exiting to Deploy Large Models at the Same Cost of Smaller Ones","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-11T00:46:17.719689Z"},"links":{"citing_paper":"/paper/2412.19325"},"observation_digest":"sha256:807188740914f1bfcde1dbe5772206cdf8615caa735c4a0a6b894c4cb9445de6","observation_id":"1676788f-3b71-4bd0-afa4-9a2d4e2d8f40","resolution":{"observed_at":"2026-08-11T00:46:18.407527Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:46:18.392403Z","title":"Minillm: Knowledge distillation of large language models","venue":null,"work_id":"a603c5a2-8b3c-4efc-9674-86e213db0591","year":2023},"citing_paper":{"arxiv_id":"2412.19325","last_updated":"2024-12-26T18:54:32Z","snapshot_observed_at":"2026-08-11T00:40:00.537400Z","submitted_at":"2024-12-26T18:54:32Z","title":"Performance Control in Early Exiting to Deploy Large Models at the Same Cost of Smaller Ones","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-11T00:46:17.722671Z"},"links":{"citing_paper":"/paper/2412.19325"},"observation_digest":"sha256:59053238a019892bfc55617e0812a5bb0c5f3832ff0426c3fcad8a5d0c0b0a27","observation_id":"df44c1a0-87cd-48ed-bddb-8de075b5a977","resolution":{"observed_at":"2026-08-11T00:46:18.396723Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:46:17.726320Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2412.19325","last_updated":"2024-12-26T18:54:32Z","snapshot_observed_at":"2026-08-11T00:40:00.537400Z","submitted_at":"2024-12-26T18:54:32Z","title":"Performance Control in Early Exiting to Deploy Large Models at the Same Cost of Smaller Ones","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-11T00:46:17.726320Z"},"links":{"citing_paper":"/paper/2412.19325"},"observation_digest":"sha256:c1bd06f29cb231466c95d35429dea795f1da0505a3b770c3ead9c640062bd8eb","observation_id":"1324b66b-8c72-49b3-82fe-39bfe592a3cc","resolution":{"observed_at":"2026-08-11T00:46:17.726320Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2103.01148","last_updated":"2022-07-11T17:42:45Z","snapshot_observed_at":"2026-07-06T10:45:42.094119Z","submitted_at":"2021-03-01T17:31:55Z","title":"E$^2$CM: Early Exit via Class Means for Efficient Supervised and Unsupervised Learning","version":3},"cited_work":{"arxiv_id":"2103.01148","doi":null,"metadata_source":"pith","pith_arxiv_id":"2103.01148","snapshot_observed_at":"2026-08-11T00:46:18.151836Z","title":"E$^2$CM: Early Exit via Class Means for Efficient Supervised and Unsupervised Learning","venue":"cs.LG","work_id":"7ad17812-949d-4a69-8b9f-9c8584da5db6","year":2021},"citing_paper":{"arxiv_id":"2412.19325","last_updated":"2024-12-26T18:54:32Z","snapshot_observed_at":"2026-08-11T00:40:00.537400Z","submitted_at":"2024-12-26T18:54:32Z","title":"Performance Control in Early Exiting to Deploy Large Models at the Same Cost of Smaller Ones","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-11T00:46:17.730008Z"},"links":{"cited_paper":"/paper/2103.01148","citing_paper":"/paper/2412.19325"},"observation_digest":"sha256:7e1a57b4409900745720f2d2df1369ed99ae04b65555f799b814bbbc154c8795","observation_id":"9fee3923-b0ff-48b6-aae1-4d7347a0e554","resolution":{"observed_at":"2026-08-11T00:46:18.155873Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1007/978-3-031-20083-0_22","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:46:17.881070Z","title":"Learning to Weight Samples for Dynamic Early-Exiting Networks, pp.\\ 362--378","venue":null,"work_id":"68b4b8b9-efe5-4726-a309-b48c381a4e4d","year":2022},"citing_paper":{"arxiv_id":"2412.19325","last_updated":"2024-12-26T18:54:32Z","snapshot_observed_at":"2026-08-11T00:40:00.537400Z","submitted_at":"2024-12-26T18:54:32Z","title":"Performance Control in Early Exiting to Deploy Large Models at the Same Cost of Smaller Ones","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-11T00:46:17.733387Z"},"links":{"citing_paper":"/paper/2412.19325"},"observation_digest":"sha256:ffddfc977984b6332ea36f79f89a242a0dcd4d85a1d3e602690462ea1047d532","observation_id":"478d80c1-bf64-4c51-89be-1974b228c2a7","resolution":{"observed_at":"2026-08-11T00:46:17.886483Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:46:18.376061Z","title":"A stitch in time saves nine: A train-time regularizing loss for improved neural network calibration","venue":null,"work_id":"800c039f-557c-4ae2-a294-6aff2038c401","year":2022},"citing_paper":{"arxiv_id":"2412.19325","last_updated":"2024-12-26T18:54:32Z","snapshot_observed_at":"2026-08-11T00:40:00.537400Z","submitted_at":"2024-12-26T18:54:32Z","title":"Performance Control in Early Exiting to Deploy Large Models at the Same Cost of Smaller Ones","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-11T00:46:17.736711Z"},"links":{"citing_paper":"/paper/2412.19325"},"observation_digest":"sha256:cf5fca36e4b449fe07213b8cb4304231bdef374fddbb12cf32382c39b736567f","observation_id":"15d7e391-ff2b-4e5a-a3e3-8b403b4187ed","resolution":{"observed_at":"2026-08-11T00:46:18.379899Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:46:17.739881Z","title":"Why relu networks yield high-confidence predictions far away from the training data and how to mitigate the problem","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2412.19325","last_updated":"2024-12-26T18:54:32Z","snapshot_observed_at":"2026-08-11T00:40:00.537400Z","submitted_at":"2024-12-26T18:54:32Z","title":"Performance Control in Early Exiting to Deploy Large Models at the Same Cost of Smaller Ones","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-11T00:46:17.739881Z"},"links":{"citing_paper":"/paper/2412.19325"},"observation_digest":"sha256:e31d18f2c1db08cc5d646da400739fd4cdb1e83c940bb382a67d3f22d195328d","observation_id":"f246554e-ae1f-419f-ae06-701d33132fe9","resolution":{"observed_at":"2026-08-11T00:46:17.739881Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1503.02531","last_updated":"2015-03-09T15:44:49Z","snapshot_observed_at":"2026-07-06T04:11:24.157003Z","submitted_at":"2015-03-09T15:44:49Z","title":"Distilling the Knowledge in a Neural Network","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1503.02531","snapshot_observed_at":"2026-08-11T00:46:17.742904Z","title":"Distilling the knowledge in a neural network","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2412.19325","last_updated":"2024-12-26T18:54:32Z","snapshot_observed_at":"2026-08-11T00:40:00.537400Z","submitted_at":"2024-12-26T18:54:32Z","title":"Performance Control in Early Exiting to Deploy Large Models at the Same Cost of Smaller Ones","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-11T00:46:17.742904Z"},"links":{"cited_paper":"/paper/1503.02531","citing_paper":"/paper/2412.19325"},"observation_digest":"sha256:754b7fce05f70969d65cfe534f1106340fed98ea2216b1931d61e6dc4f5334b6","observation_id":"350ab2d4-c82c-48f0-b7a3-81bee7c71971","resolution":{"observed_at":"2026-08-11T00:46:17.742904Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.15556","last_updated":"2022-03-29T13:38:03Z","snapshot_observed_at":"2026-08-09T19:52:33.533277Z","submitted_at":"2022-03-29T13:38:03Z","title":"Training Compute-Optimal Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.15556","snapshot_observed_at":"2026-08-11T00:46:17.746627Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.19325","last_updated":"2024-12-26T18:54:32Z","snapshot_observed_at":"2026-08-11T00:40:00.537400Z","submitted_at":"2024-12-26T18:54:32Z","title":"Performance Control in Early Exiting to Deploy Large Models at the Same Cost of Smaller Ones","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-11T00:46:17.746627Z"},"links":{"cited_paper":"/paper/2203.15556","citing_paper":"/paper/2412.19325"},"observation_digest":"sha256:d58a72a92f2e31f2499031abebf001e30cc78e90ac296d513d9cdfdc67a349b9","observation_id":"7dc95869-bc47-4ca2-a613-1183204816eb","resolution":{"observed_at":"2026-08-11T00:46:17.746627Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.02301","last_updated":"2023-07-05T16:59:31Z","snapshot_observed_at":"2026-07-06T15:22:55.122322Z","submitted_at":"2023-05-03T17:50:56Z","title":"Distilling Step-by-Step! Outperforming Larger Language Models with Less Training Data and Smaller Model Sizes","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.02301","snapshot_observed_at":"2026-08-11T00:46:17.750351Z","title":"Distilling step-by-step! outperforming larger language models with less training data and smaller model sizes","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.19325","last_updated":"2024-12-26T18:54:32Z","snapshot_observed_at":"2026-08-11T00:40:00.537400Z","submitted_at":"2024-12-26T18:54:32Z","title":"Performance Control in Early Exiting to Deploy Large Models at the Same Cost of Smaller Ones","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-11T00:46:17.750351Z"},"links":{"cited_paper":"/paper/2305.02301","citing_paper":"/paper/2412.19325"},"observation_digest":"sha256:26231ee20f33ee2441d73e5934cd5a671dd6a1c39e1a440f51f69c65a9ad337c","observation_id":"f1c541ca-c9c5-426c-82e6-834f01cb508a","resolution":{"observed_at":"2026-08-11T00:46:17.750351Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:46:18.364549Z","title":null,"venue":null,"work_id":"02be6067-27a2-4834-a619-256ade3b1fa7","year":2017},"citing_paper":{"arxiv_id":"2412.19325","last_updated":"2024-12-26T18:54:32Z","snapshot_observed_at":"2026-08-11T00:40:00.537400Z","submitted_at":"2024-12-26T18:54:32Z","title":"Performance Control in Early Exiting to Deploy Large Models at the Same Cost of Smaller Ones","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-11T00:46:17.756173Z"},"links":{"citing_paper":"/paper/2412.19325"},"observation_digest":"sha256:3744b9fd812d2cd7f0fdb009e887b49682202bf417b128140b7a607000ed2eaa","observation_id":"225c4804-4a31-4c58-b1cc-c248812d257b","resolution":{"observed_at":"2026-08-11T00:46:18.368352Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:46:18.353275Z","title":"Adaptive deep neural network inference optimization with eenet","venue":null,"work_id":"6a48fe34-049d-48e1-9df2-287acf812054","year":2024},"citing_paper":{"arxiv_id":"2412.19325","last_updated":"2024-12-26T18:54:32Z","snapshot_observed_at":"2026-08-11T00:40:00.537400Z","submitted_at":"2024-12-26T18:54:32Z","title":"Performance Control in Early Exiting to Deploy Large Models at the Same Cost of Smaller Ones","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-11T00:46:17.759713Z"},"links":{"citing_paper":"/paper/2412.19325"},"observation_digest":"sha256:f4b8de0464ac92b01346e9553685cf5f9c4a3c3afe6f7e335eea618414adec25","observation_id":"006b4c1e-1667-4823-b9cc-9498cb956320","resolution":{"observed_at":"2026-08-11T00:46:18.356918Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:46:18.341724Z","title":"U., Zhang, D., and Nalisnick, E","venue":null,"work_id":"871c4c4c-8f1f-47e9-b915-74342dadfc86","year":2023},"citing_paper":{"arxiv_id":"2412.19325","last_updated":"2024-12-26T18:54:32Z","snapshot_observed_at":"2026-08-11T00:40:00.537400Z","submitted_at":"2024-12-26T18:54:32Z","title":"Performance Control in Early Exiting to Deploy Large Models at the Same Cost of Smaller Ones","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-11T00:46:17.762670Z"},"links":{"citing_paper":"/paper/2412.19325"},"observation_digest":"sha256:23282b6b7c3df9dcd3b682e9fe769756a6654339d4f16f12d1d9de6010e53fd1","observation_id":"0b9d57b8-1da5-4cb6-8036-d72befded7fc","resolution":{"observed_at":"2026-08-11T00:46:18.345373Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:46:18.330739Z","title":"To trust or not to trust a classifier","venue":null,"work_id":"ce6d37cb-4ebc-4c64-8f0d-ce6702e5baa1","year":2018},"citing_paper":{"arxiv_id":"2412.19325","last_updated":"2024-12-26T18:54:32Z","snapshot_observed_at":"2026-08-11T00:40:00.537400Z","submitted_at":"2024-12-26T18:54:32Z","title":"Performance Control in Early Exiting to Deploy Large Models at the Same Cost of Smaller Ones","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-11T00:46:17.765743Z"},"links":{"citing_paper":"/paper/2412.19325"},"observation_digest":"sha256:d9375765da955ab1b593a3912e9a1786990cffb758f6e7fa1771f719637f77a3","observation_id":"cf48251e-45f3-4ce9-993e-69389c3d6e8f","resolution":{"observed_at":"2026-08-11T00:46:18.334436Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2001.08361","last_updated":"2020-01-23T03:59:20Z","snapshot_observed_at":"2026-07-06T08:52:12.656082Z","submitted_at":"2020-01-23T03:59:20Z","title":"Scaling Laws for Neural Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2001.08361","snapshot_observed_at":"2026-08-11T00:46:17.769378Z","title":"B., Chess, B., Child, R., Gray, S., Radford, A., Wu, J., and Amodei, D","venue":null,"work_id":null,"year":2001},"citing_paper":{"arxiv_id":"2412.19325","last_updated":"2024-12-26T18:54:32Z","snapshot_observed_at":"2026-08-11T00:40:00.537400Z","submitted_at":"2024-12-26T18:54:32Z","title":"Performance Control in Early Exiting to Deploy Large Models at the Same Cost of Smaller Ones","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-11T00:46:17.769378Z"},"links":{"cited_paper":"/paper/2001.08361","citing_paper":"/paper/2412.19325"},"observation_digest":"sha256:149818aa372aab6092cfdd54563d6838c9395fc183f5f251f1688c3d405e7327","observation_id":"003b5b20-5a2b-4065-b0d0-dcb77daad5d7","resolution":{"observed_at":"2026-08-11T00:46:17.769378Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:46:18.319794Z","title":"Shallow-deep networks: Understanding and mitigating network overthinking","venue":null,"work_id":"856ef98c-8364-4212-b397-56e1628f5895","year":2018},"citing_paper":{"arxiv_id":"2412.19325","last_updated":"2024-12-26T18:54:32Z","snapshot_observed_at":"2026-08-11T00:40:00.537400Z","submitted_at":"2024-12-26T18:54:32Z","title":"Performance Control in Early Exiting to Deploy Large Models at the Same Cost of Smaller Ones","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-11T00:46:17.773100Z"},"links":{"citing_paper":"/paper/2412.19325"},"observation_digest":"sha256:918540682726be25efb947c296ed523ec7fe9cd9778f34268aeb8e6e4ba75958","observation_id":"7cef64ea-02b0-4d42-a0b4-8e2f6dde263c","resolution":{"observed_at":"2026-08-11T00:46:18.323629Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:46:17.776544Z","title":"Crafting papers on machine learning","venue":null,"work_id":null,"year":2000},"citing_paper":{"arxiv_id":"2412.19325","last_updated":"2024-12-26T18:54:32Z","snapshot_observed_at":"2026-08-11T00:40:00.537400Z","submitted_at":"2024-12-26T18:54:32Z","title":"Performance Control in Early Exiting to Deploy Large Models at the Same Cost of Smaller Ones","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-11T00:46:17.776544Z"},"links":{"citing_paper":"/paper/2412.19325"},"observation_digest":"sha256:542e1ac163803f39007b0aef721f082be9b4f9111f43429e28e288f06960830a","observation_id":"61028688-bb4a-4f65-90cb-de91095e7c51","resolution":{"observed_at":"2026-08-11T00:46:17.776544Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:46:18.302647Z","title":null,"venue":null,"work_id":"4abd039c-8deb-4c27-bd18-1acd9dbfa80b","year":2021},"citing_paper":{"arxiv_id":"2412.19325","last_updated":"2024-12-26T18:54:32Z","snapshot_observed_at":"2026-08-11T00:40:00.537400Z","submitted_at":"2024-12-26T18:54:32Z","title":"Performance Control in Early Exiting to Deploy Large Models at the Same Cost of Smaller Ones","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-11T00:46:17.779898Z"},"links":{"citing_paper":"/paper/2412.19325"},"observation_digest":"sha256:7756ad0630800fcc3701ec7551349afdfb9c63f9673e8b75130775994204faeb","observation_id":"1a4b9d83-166f-4033-a52d-428c4eb4a790","resolution":{"observed_at":"2026-08-11T00:46:18.306165Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:46:17.783342Z","title":"Fast inference from transformers via speculative decoding","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.19325","last_updated":"2024-12-26T18:54:32Z","snapshot_observed_at":"2026-08-11T00:40:00.537400Z","submitted_at":"2024-12-26T18:54:32Z","title":"Performance Control in Early Exiting to Deploy Large Models at the Same Cost of Smaller Ones","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-11T00:46:17.783342Z"},"links":{"citing_paper":"/paper/2412.19325"},"observation_digest":"sha256:abdac3aa318d9bd571751dd28f99df58e27ab82a604f0d978ec948adafb86e0d","observation_id":"0d783e10-8e7a-4830-8a16-96bba326f3d2","resolution":{"observed_at":"2026-08-11T00:46:17.783342Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:46:17.786656Z","title":"P., Salakhutdinov, R","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2412.19325","last_updated":"2024-12-26T18:54:32Z","snapshot_observed_at":"2026-08-11T00:40:00.537400Z","submitted_at":"2024-12-26T18:54:32Z","title":"Performance Control in Early Exiting to Deploy Large Models at the Same Cost of Smaller Ones","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-11T00:46:17.786656Z"},"links":{"citing_paper":"/paper/2412.19325"},"observation_digest":"sha256:60877c5c158c4e8b17443822aeb63642f0854a0288c8f3a30e34dc9331e0911d","observation_id":"7a88efa8-2955-4038-b02d-b04f6546180b","resolution":{"observed_at":"2026-08-11T00:46:17.786656Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1711.05101","last_updated":"2019-01-04T21:01:49Z","snapshot_observed_at":"2026-08-09T20:34:52.923500Z","submitted_at":"2017-11-14T14:24:06Z","title":"Decoupled Weight Decay Regularization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1711.05101","snapshot_observed_at":"2026-08-11T00:46:17.790117Z","title":"and Hutter, F","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2412.19325","last_updated":"2024-12-26T18:54:32Z","snapshot_observed_at":"2026-08-11T00:40:00.537400Z","submitted_at":"2024-12-26T18:54:32Z","title":"Performance Control in Early Exiting to Deploy Large Models at the Same Cost of Smaller Ones","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-11T00:46:17.790117Z"},"links":{"cited_paper":"/paper/1711.05101","citing_paper":"/paper/2412.19325"},"observation_digest":"sha256:209553ad4083e596982ff3bee47c9d7521070e99b5170946a080a9d9bf26aaeb","observation_id":"f428284a-c002-439f-bc90-01f885e658c6","resolution":{"observed_at":"2026-08-11T00:46:17.790117Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.17764","last_updated":"2024-02-27T18:56:19Z","snapshot_observed_at":"2026-08-03T00:59:01.026576Z","submitted_at":"2024-02-27T18:56:19Z","title":"The Era of 1-bit LLMs: All Large Language Models are in 1.58 Bits","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.17764","snapshot_observed_at":"2026-08-11T00:46:17.793499Z","title":"The era of 1-bit llms: All large language models are in 1.58 bits","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.19325","last_updated":"2024-12-26T18:54:32Z","snapshot_observed_at":"2026-08-11T00:40:00.537400Z","submitted_at":"2024-12-26T18:54:32Z","title":"Performance Control in Early Exiting to Deploy Large Models at the Same Cost of Smaller Ones","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-11T00:46:17.793499Z"},"links":{"cited_paper":"/paper/2402.17764","citing_paper":"/paper/2412.19325"},"observation_digest":"sha256:6e39a66edaf0b8fa4f63444c36865c8a4f0869f7de9a7539b0e0eb0c330e6386","observation_id":"04dc7294-ab78-4fd3-9355-d82b13b6312d","resolution":{"observed_at":"2026-08-11T00:46:17.793499Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:46:18.278918Z","title":"Fixing overconfidence in dynamic neural networks","venue":null,"work_id":"56f94e23-b428-421c-8ee2-c731cef75ed1","year":2024},"citing_paper":{"arxiv_id":"2412.19325","last_updated":"2024-12-26T18:54:32Z","snapshot_observed_at":"2026-08-11T00:40:00.537400Z","submitted_at":"2024-12-26T18:54:32Z","title":"Performance Control in Early Exiting to Deploy Large Models at the Same Cost of Smaller Ones","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-11T00:46:17.797035Z"},"links":{"citing_paper":"/paper/2412.19325"},"observation_digest":"sha256:0317537837efe770f564cd776254f921e09a7f2ed2400e809b1371ce52a5086b","observation_id":"e424f07b-086b-470a-b623-736677643bdc","resolution":{"observed_at":"2026-08-11T00:46:18.282455Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:46:18.267479Z","title":"P., Cooper, G","venue":null,"work_id":"b36cac5a-7005-4c8b-a8f6-07203d81c3bf","year":2015},"citing_paper":{"arxiv_id":"2412.19325","last_updated":"2024-12-26T18:54:32Z","snapshot_observed_at":"2026-08-11T00:40:00.537400Z","submitted_at":"2024-12-26T18:54:32Z","title":"Performance Control in Early Exiting to Deploy Large Models at the Same Cost of Smaller Ones","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-11T00:46:17.800150Z"},"links":{"citing_paper":"/paper/2412.19325"},"observation_digest":"sha256:c64090a880003224d993214aa21050bb6c51a33f7f3d37a7accd9a5c59e8d70e","observation_id":"1594f0c1-d798-40fb-87bf-a1687e38929f","resolution":{"observed_at":"2026-08-11T00:46:18.271126Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:46:18.256060Z","title":"On-the-fly operation batching in dynamic computation graphs","venue":null,"work_id":"d2e6b999-71ff-4161-89d2-ba0f0d0e82c0","year":2017},"citing_paper":{"arxiv_id":"2412.19325","last_updated":"2024-12-26T18:54:32Z","snapshot_observed_at":"2026-08-11T00:40:00.537400Z","submitted_at":"2024-12-26T18:54:32Z","title":"Performance Control in Early Exiting to Deploy Large Models at the Same Cost of Smaller Ones","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-11T00:46:17.803367Z"},"links":{"citing_paper":"/paper/2412.19325"},"observation_digest":"sha256:56cfb15c1ea59451b9c16101710b829ee6ec95be4ea05c99d341217d0a4a5488","observation_id":"2522d9bb-0547-44f1-b87d-246eb35c51ac","resolution":{"observed_at":"2026-08-11T00:46:18.259805Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:46:18.244459Z","title":"W., Zhang, L., Jerfel, G., and Tran, D","venue":null,"work_id":"5a87f68c-6a9f-47fd-9c86-9f358a89ff58","year":2019},"citing_paper":{"arxiv_id":"2412.19325","last_updated":"2024-12-26T18:54:32Z","snapshot_observed_at":"2026-08-11T00:40:00.537400Z","submitted_at":"2024-12-26T18:54:32Z","title":"Performance Control in Early Exiting to Deploy Large Models at the Same Cost of Smaller Ones","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-11T00:46:17.806654Z"},"links":{"citing_paper":"/paper/2412.19325"},"observation_digest":"sha256:caa7c5fd3b5a77cda8572ebfc98c2a6ad5ebc7a39a5fa84a6bf0e952bd1cfd72","observation_id":"b92c40c8-d9aa-432d-8ed8-f11188968ae6","resolution":{"observed_at":"2026-08-11T00:46:18.248113Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:46:17.810196Z","title":"Can you trust your model's uncertainty? evaluating predictive uncertainty under dataset shift","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2412.19325","last_updated":"2024-12-26T18:54:32Z","snapshot_observed_at":"2026-08-11T00:40:00.537400Z","submitted_at":"2024-12-26T18:54:32Z","title":"Performance Control in Early Exiting to Deploy Large Models at the Same Cost of Smaller Ones","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-11T00:46:17.810196Z"},"links":{"citing_paper":"/paper/2412.19325"},"observation_digest":"sha256:64e55f28d476b6a3f2b91ffba1ee71bcee429fdeec270ddb10aee5b66717376a","observation_id":"42bbcd89-deb3-4f56-a373-22772c741cde","resolution":{"observed_at":"2026-08-11T00:46:17.810196Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1803.04765","last_updated":"2018-03-13T13:02:13Z","snapshot_observed_at":"2026-07-06T06:28:00.254252Z","submitted_at":"2018-03-13T13:02:13Z","title":"Deep k-Nearest Neighbors: Towards Confident, Interpretable and Robust Deep Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1803.04765","snapshot_observed_at":"2026-08-11T00:46:17.813332Z","title":"and McDaniel, P","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2412.19325","last_updated":"2024-12-26T18:54:32Z","snapshot_observed_at":"2026-08-11T00:40:00.537400Z","submitted_at":"2024-12-26T18:54:32Z","title":"Performance Control in Early Exiting to Deploy Large Models at the Same Cost of Smaller Ones","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-11T00:46:17.813332Z"},"links":{"cited_paper":"/paper/1803.04765","citing_paper":"/paper/2412.19325"},"observation_digest":"sha256:ac11019fc310b969268fd1b39423804c6185eb562325a405f3aae3be083647db","observation_id":"8edd0389-6668-4b5a-aea0-6ac515b4335c","resolution":{"observed_at":"2026-08-11T00:46:17.813332Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2104.08803","last_updated":"2021-09-09T17:57:04Z","snapshot_observed_at":"2026-08-10T18:21:46.340554Z","submitted_at":"2021-04-18T10:22:28Z","title":"Consistent Accelerated Inference via Confident Adaptive Transformers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.08803","snapshot_observed_at":"2026-08-11T00:46:17.816920Z","title":"Consistent accelerated inference via confident adaptive transformers","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.19325","last_updated":"2024-12-26T18:54:32Z","snapshot_observed_at":"2026-08-11T00:40:00.537400Z","submitted_at":"2024-12-26T18:54:32Z","title":"Performance Control in Early Exiting to Deploy Large Models at the Same Cost of Smaller Ones","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-11T00:46:17.816920Z"},"links":{"cited_paper":"/paper/2104.08803","citing_paper":"/paper/2412.19325"},"observation_digest":"sha256:18dc025692a60f97e20e505e2c20de5b63a5200937bbdaf80f7ff158291d6bcc","observation_id":"41723cf0-a234-4908-9e1e-2796de5b3e46","resolution":{"observed_at":"2026-08-11T00:46:17.816920Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:46:17.820743Z","title":"Confident adaptive language modeling","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.19325","last_updated":"2024-12-26T18:54:32Z","snapshot_observed_at":"2026-08-11T00:40:00.537400Z","submitted_at":"2024-12-26T18:54:32Z","title":"Performance Control in Early Exiting to Deploy Large Models at the Same Cost of Smaller Ones","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-11T00:46:17.820743Z"},"links":{"citing_paper":"/paper/2412.19325"},"observation_digest":"sha256:f0e0082ac0040f02fa4060804c724aa077c3e6918036e6847adae28ede49b732","observation_id":"7889afeb-f476-4712-860c-e0e901dd79c1","resolution":{"observed_at":"2026-08-11T00:46:17.820743Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.11695","last_updated":"2024-05-06T17:47:01Z","snapshot_observed_at":"2026-07-06T15:44:42.776459Z","submitted_at":"2023-06-20T17:18:20Z","title":"A Simple and Effective Pruning Approach for Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.11695","snapshot_observed_at":"2026-08-11T00:46:17.823761Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.19325","last_updated":"2024-12-26T18:54:32Z","snapshot_observed_at":"2026-08-11T00:40:00.537400Z","submitted_at":"2024-12-26T18:54:32Z","title":"Performance Control in Early Exiting to Deploy Large Models at the Same Cost of Smaller Ones","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-11T00:46:17.823761Z"},"links":{"cited_paper":"/paper/2306.11695","citing_paper":"/paper/2412.19325"},"observation_digest":"sha256:b5fb7e4a2a31ba6f6661bc53a31b2e7920cafea996fe30edd80168975e8dbd00","observation_id":"8d524fcb-9f4c-4b42-a162-1ea91cbabb0d","resolution":{"observed_at":"2026-08-11T00:46:17.823761Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:46:17.827082Z","title":"and Naganuma, H","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.19325","last_updated":"2024-12-26T18:54:32Z","snapshot_observed_at":"2026-08-11T00:40:00.537400Z","submitted_at":"2024-12-26T18:54:32Z","title":"Performance Control in Early Exiting to Deploy Large Models at the Same Cost of Smaller Ones","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-11T00:46:17.827082Z"},"links":{"citing_paper":"/paper/2412.19325"},"observation_digest":"sha256:46558a5c8dcc5a52bd202926e4b7ce9bed9d4b49474f4ee6130ece629b9edda6","observation_id":"cdc59e29-9908-4fb1-9b2a-68050dc67d0b","resolution":{"observed_at":"2026-08-11T00:46:17.827082Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:46:17.830171Z","title":"Branchynet: Fast inference via early exiting from deep neural networks","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2412.19325","last_updated":"2024-12-26T18:54:32Z","snapshot_observed_at":"2026-08-11T00:40:00.537400Z","submitted_at":"2024-12-26T18:54:32Z","title":"Performance Control in Early Exiting to Deploy Large Models at the Same Cost of Smaller Ones","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-11T00:46:17.830171Z"},"links":{"citing_paper":"/paper/2412.19325"},"observation_digest":"sha256:e5c90ef7f39032acc071bf92d388e60bce40bccc5e9d596c899efcbed96ab473","observation_id":"b00f86cc-a165-4c26-aa23-60b93e71860f","resolution":{"observed_at":"2026-08-11T00:46:17.830171Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:46:18.214141Z","title":"Open-set recognition: A good closed-set classifier is all you need? 2021","venue":null,"work_id":"b46b1d92-d8ac-4914-aca9-f69029bb641e","year":2021},"citing_paper":{"arxiv_id":"2412.19325","last_updated":"2024-12-26T18:54:32Z","snapshot_observed_at":"2026-08-11T00:40:00.537400Z","submitted_at":"2024-12-26T18:54:32Z","title":"Performance Control in Early Exiting to Deploy Large Models at the Same Cost of Smaller Ones","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-11T00:46:17.833039Z"},"links":{"citing_paper":"/paper/2412.19325"},"observation_digest":"sha256:0d7e936bfe3c6a1ada27e857ab743a8e9c162886890c48ba78e276d079915967","observation_id":"f2b11145-d33f-4198-9acc-a5a22a317f94","resolution":{"observed_at":"2026-08-11T00:46:18.218173Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.01222","last_updated":"2025-09-14T12:53:07Z","snapshot_observed_at":"2026-07-06T16:01:41.830509Z","submitted_at":"2023-08-02T15:28:10Z","title":"Calibration in Deep Learning: A Survey of the State-of-the-Art","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.01222","snapshot_observed_at":"2026-08-11T00:46:17.836629Z","title":"Calibration in deep learning: A survey of the state-of-the-art","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.19325","last_updated":"2024-12-26T18:54:32Z","snapshot_observed_at":"2026-08-11T00:40:00.537400Z","submitted_at":"2024-12-26T18:54:32Z","title":"Performance Control in Early Exiting to Deploy Large Models at the Same Cost of Smaller Ones","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-11T00:46:17.836629Z"},"links":{"cited_paper":"/paper/2308.01222","citing_paper":"/paper/2412.19325"},"observation_digest":"sha256:8fd64cfa9c5b02a1015116c953ff3ff7199923d027255d7a1fb094a0ae475ee5","observation_id":"014d507a-7c2b-485a-b489-423324ccc811","resolution":{"observed_at":"2026-08-11T00:46:17.836629Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:46:18.202212Z","title":"Rethinking calibration of deep neural networks: Do not be afraid of overconfidence","venue":null,"work_id":"62d781bf-69d9-4274-9e95-5f48e4fcbc23","year":2021},"citing_paper":{"arxiv_id":"2412.19325","last_updated":"2024-12-26T18:54:32Z","snapshot_observed_at":"2026-08-11T00:40:00.537400Z","submitted_at":"2024-12-26T18:54:32Z","title":"Performance Control in Early Exiting to Deploy Large Models at the Same Cost of Smaller Ones","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-11T00:46:17.840081Z"},"links":{"citing_paper":"/paper/2412.19325"},"observation_digest":"sha256:1d868bd27648a521af96d958200e505b6ebca48ce39fb63125ce0b1ff431b24b","observation_id":"4afa6e13-0f3a-411a-9fdf-418dd922f402","resolution":{"observed_at":"2026-08-11T00:46:18.205918Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2206.07682","last_updated":"2022-10-26T05:06:24Z","snapshot_observed_at":"2026-08-02T15:56:35.249569Z","submitted_at":"2022-06-15T17:32:01Z","title":"Emergent Abilities of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2206.07682","snapshot_observed_at":"2026-08-11T00:46:17.843536Z","title":"Emergent abilities of large language models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.19325","last_updated":"2024-12-26T18:54:32Z","snapshot_observed_at":"2026-08-11T00:40:00.537400Z","submitted_at":"2024-12-26T18:54:32Z","title":"Performance Control in Early Exiting to Deploy Large Models at the Same Cost of Smaller Ones","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-11T00:46:17.843536Z"},"links":{"cited_paper":"/paper/2206.07682","citing_paper":"/paper/2412.19325"},"observation_digest":"sha256:570a80781777f011b4c586a614966764131e440de7ad32eee894780a324a4abb","observation_id":"ebf1b9b5-f4bb-4ddd-8288-9940641da336","resolution":{"observed_at":"2026-08-11T00:46:17.843536Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:46:17.847060Z","title":"Pytorch image models","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2412.19325","last_updated":"2024-12-26T18:54:32Z","snapshot_observed_at":"2026-08-11T00:40:00.537400Z","submitted_at":"2024-12-26T18:54:32Z","title":"Performance Control in Early Exiting to Deploy Large Models at the Same Cost of Smaller Ones","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-11T00:46:17.847060Z"},"links":{"citing_paper":"/paper/2412.19325"},"observation_digest":"sha256:fd6392cf2f6e1d27d939f807b32d4ff03b47967c008bd23ecad171de4ce7f706","observation_id":"d0555f4e-ad26-41fb-ba95-a6a7c57b28a6","resolution":{"observed_at":"2026-08-11T00:46:17.847060Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2412.19325","last_updated":"2024-12-26T18:54:32Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-11T00:40:00.537400Z","submitted_at":"2024-12-26T18:54:32Z","title":"Performance Control in Early Exiting to Deploy Large Models at the Same Cost of Smaller Ones"},"reference_resolution":{"displayed":50,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":30,"verified_exact":3,"verified_fuzzy":17},"total_outbound_references":50},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"thesis":"As of 11 August 2026, this Paper Citation Record lists 50 of 50 outbound references and 0 inbound Pith citation observations for arXiv:2412.19325."}