{"as_of":"2026-08-09T21:51:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:e34d2a429aab4185fb5098b2995bed99117f0ec4520266936e955768688386f1","coverage":[{"denominator":38,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":38,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-28T10:19:02.938980Z","state":"measured"},{"denominator":39,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":39,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-28T10:19:02.938980Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-07-02T03:06:30.308770Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2606.03113","last_updated":"2026-06-02T03:59:14Z","snapshot_observed_at":"2026-08-07T11:13:28.041469Z","submitted_at":"2026-06-02T03:59:14Z","title":"Experience-Driven Dynamic Exits for LLMs with Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2606.03113","doi":null,"metadata_source":"pith","pith_arxiv_id":"2606.03113","snapshot_observed_at":"2026-07-02T03:06:30.308770Z","title":"Experience-Driven Dynamic Exits for LLMs with Reinforcement Learning","venue":"cs.CL","work_id":"d5e43147-56e4-49ab-b726-82aabe402a01","year":2026},"citing_paper":{"arxiv_id":"2606.03113","last_updated":"2026-06-02T03:59:14Z","snapshot_observed_at":"2026-08-07T11:13:28.041469Z","submitted_at":"2026-06-02T03:59:14Z","title":"Experience-Driven Dynamic Exits for LLMs with Reinforcement Learning","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-06-28T10:19:02.938980Z"},"links":{"cited_paper":"/paper/2606.03113","citing_paper":"/paper/2606.03113"},"observation_digest":"sha256:a7b95be9a8a370d1eb0262f286b467dc7f740d263277cfbec758495adca19a48","observation_id":"aa8e528c-d1be-4831-9b7c-ef6ea4de4dcd","resolution":{"observed_at":"2026-07-02T03:06:30.310571Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2606.03113/citation-record","integrity":"/paper/2606.03113/integrity","json":"/paper/2606.03113/citation-record.json","paper":"/paper/2606.03113"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:19:02.938980Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.03113","last_updated":"2026-06-02T03:59:14Z","snapshot_observed_at":"2026-08-07T11:13:28.041469Z","submitted_at":"2026-06-02T03:59:14Z","title":"Experience-Driven Dynamic Exits for LLMs with Reinforcement Learning","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-06-28T10:19:02.938980Z"},"links":{"citing_paper":"/paper/2606.03113"},"observation_digest":"sha256:ba70728d2ff105043cff8586b7d7d3a8c5fe6c643fbe0311af384bb511a0c7cd","observation_id":"3158e3aa-a440-49b4-a421-6aa0bf44699e","resolution":{"observed_at":"2026-06-28T10:19:02.938980Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2606.03113","last_updated":"2026-06-02T03:59:14Z","snapshot_observed_at":"2026-08-07T11:13:28.041469Z","submitted_at":"2026-06-02T03:59:14Z","title":"Experience-Driven Dynamic Exits for LLMs with Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2606.03113","doi":null,"metadata_source":"pith","pith_arxiv_id":"2606.03113","snapshot_observed_at":"2026-07-02T03:06:30.308770Z","title":"Experience-Driven Dynamic Exits for LLMs with Reinforcement Learning","venue":"cs.CL","work_id":"d5e43147-56e4-49ab-b726-82aabe402a01","year":2026},"citing_paper":{"arxiv_id":"2606.03113","last_updated":"2026-06-02T03:59:14Z","snapshot_observed_at":"2026-08-07T11:13:28.041469Z","submitted_at":"2026-06-02T03:59:14Z","title":"Experience-Driven Dynamic Exits for LLMs with Reinforcement Learning","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-06-28T10:19:02.938980Z"},"links":{"cited_paper":"/paper/2606.03113","citing_paper":"/paper/2606.03113"},"observation_digest":"sha256:a7b95be9a8a370d1eb0262f286b467dc7f740d263277cfbec758495adca19a48","observation_id":"aa8e528c-d1be-4831-9b7c-ef6ea4de4dcd","resolution":{"observed_at":"2026-07-02T03:06:30.310571Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:19:02.938980Z","title":"exit” action signals high confidence and continues the drafting process, while a “continue","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.03113","last_updated":"2026-06-02T03:59:14Z","snapshot_observed_at":"2026-08-07T11:13:28.041469Z","submitted_at":"2026-06-02T03:59:14Z","title":"Experience-Driven Dynamic Exits for LLMs with Reinforcement Learning","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-06-28T10:19:02.938980Z"},"links":{"citing_paper":"/paper/2606.03113"},"observation_digest":"sha256:de87a6f7a603e95ff1d306dabf268816e8584769d66402b96632229bc9760221","observation_id":"c8ec0be9-5660-40da-9c02-cd0a09ae7911","resolution":{"observed_at":"2026-06-28T10:19:02.938980Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:19:02.938980Z","title":"Implementaion Details Training Hyperparameters.The model is trained using the Adam optimizer [26] with a learning rate of α= 6.25×10 −5","venue":null,"work_id":null,"year":1937},"citing_paper":{"arxiv_id":"2606.03113","last_updated":"2026-06-02T03:59:14Z","snapshot_observed_at":"2026-08-07T11:13:28.041469Z","submitted_at":"2026-06-02T03:59:14Z","title":"Experience-Driven Dynamic Exits for LLMs with Reinforcement Learning","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-06-28T10:19:02.938980Z"},"links":{"citing_paper":"/paper/2606.03113"},"observation_digest":"sha256:2e19057742b60285efc2fa875c17fe69cc1f9834f3e4b1afc227fa3be2ae93f9","observation_id":"651a292e-1a53-4fc9-830d-0fe7ba6cde8b","resolution":{"observed_at":"2026-06-28T10:19:02.938980Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:19:02.938980Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.03113","last_updated":"2026-06-02T03:59:14Z","snapshot_observed_at":"2026-08-07T11:13:28.041469Z","submitted_at":"2026-06-02T03:59:14Z","title":"Experience-Driven Dynamic Exits for LLMs with Reinforcement Learning","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-06-28T10:19:02.938980Z"},"links":{"citing_paper":"/paper/2606.03113"},"observation_digest":"sha256:6e11afa00cca70a34c94c5ecbc7b13672fcb4a761648d4cfd719914b5f45c0ea","observation_id":"8a03ef81-3d7a-4cfa-b01c-ca38d27b5029","resolution":{"observed_at":"2026-06-28T10:19:02.938980Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:19:02.938980Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.03113","last_updated":"2026-06-02T03:59:14Z","snapshot_observed_at":"2026-08-07T11:13:28.041469Z","submitted_at":"2026-06-02T03:59:14Z","title":"Experience-Driven Dynamic Exits for LLMs with Reinforcement Learning","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-06-28T10:19:02.938980Z"},"links":{"citing_paper":"/paper/2606.03113"},"observation_digest":"sha256:4e93ff8658670b9e4e9b8ee92a784ec441df75f2d42ecfbbe0ae8408246a64e5","observation_id":"e598926d-5981-4929-aa2b-1ff3845d9021","resolution":{"observed_at":"2026-06-28T10:19:02.938980Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:19:02.938980Z","title":"Llama 2: Open foundation and fine-tuned chat models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.03113","last_updated":"2026-06-02T03:59:14Z","snapshot_observed_at":"2026-08-07T11:13:28.041469Z","submitted_at":"2026-06-02T03:59:14Z","title":"Experience-Driven Dynamic Exits for LLMs with Reinforcement Learning","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-06-28T10:19:02.938980Z"},"links":{"citing_paper":"/paper/2606.03113"},"observation_digest":"sha256:eea02e500feb3b406531b68deaf2b74629e7a18cc1aa8d8171ca5d36f8bda075","observation_id":"d167527d-3fe4-4996-87e3-b9ebd4351f23","resolution":{"observed_at":"2026-06-28T10:19:02.938980Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:19:02.938980Z","title":"Gpt-4 technical report,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.03113","last_updated":"2026-06-02T03:59:14Z","snapshot_observed_at":"2026-08-07T11:13:28.041469Z","submitted_at":"2026-06-02T03:59:14Z","title":"Experience-Driven Dynamic Exits for LLMs with Reinforcement Learning","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-06-28T10:19:02.938980Z"},"links":{"citing_paper":"/paper/2606.03113"},"observation_digest":"sha256:b1e84bd988f0c0072e99a7c4abab0e19c515fadce3f0e1e44032467d0590c668","observation_id":"4ac8290a-51ca-4c85-a2da-bf2d7d8233ce","resolution":{"observed_at":"2026-06-28T10:19:02.938980Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:19:02.938980Z","title":"Gemini: A family of highly capable multimodal models,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.03113","last_updated":"2026-06-02T03:59:14Z","snapshot_observed_at":"2026-08-07T11:13:28.041469Z","submitted_at":"2026-06-02T03:59:14Z","title":"Experience-Driven Dynamic Exits for LLMs with Reinforcement Learning","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-06-28T10:19:02.938980Z"},"links":{"citing_paper":"/paper/2606.03113"},"observation_digest":"sha256:830fef67f7b715c920be42e104f02ae3b1bfa98e6168e24a8cf27d9ff6479fb5","observation_id":"4f567f58-aedf-4e1b-8ed1-a47a3ab53bff","resolution":{"observed_at":"2026-06-28T10:19:02.938980Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:19:02.938980Z","title":"Draft & verify: Lossless large lan- guage model acceleration via self-speculative decoding,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.03113","last_updated":"2026-06-02T03:59:14Z","snapshot_observed_at":"2026-08-07T11:13:28.041469Z","submitted_at":"2026-06-02T03:59:14Z","title":"Experience-Driven Dynamic Exits for LLMs with Reinforcement Learning","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-06-28T10:19:02.938980Z"},"links":{"citing_paper":"/paper/2606.03113"},"observation_digest":"sha256:60db4e2e3b2f27fffda36183fc11fc0253706aac02be53e28d9fe19e66088acc","observation_id":"5a97271c-5bca-4044-8884-66ea5a0b86f1","resolution":{"observed_at":"2026-06-28T10:19:02.938980Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:19:02.938980Z","title":"LayerSkip: Enabling early exit inference and self-speculative decoding,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.03113","last_updated":"2026-06-02T03:59:14Z","snapshot_observed_at":"2026-08-07T11:13:28.041469Z","submitted_at":"2026-06-02T03:59:14Z","title":"Experience-Driven Dynamic Exits for LLMs with Reinforcement Learning","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-06-28T10:19:02.938980Z"},"links":{"citing_paper":"/paper/2606.03113"},"observation_digest":"sha256:c92037ac8991a9d223e4ecc2a70fe07b7b0e3d3e0dad81b7055c2585a04154a0","observation_id":"4bb7faa6-cb76-49d2-b4e1-29ee1ce7b9da","resolution":{"observed_at":"2026-06-28T10:19:02.938980Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:19:02.938980Z","title":"Not all layers of llms are necessary during inference,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.03113","last_updated":"2026-06-02T03:59:14Z","snapshot_observed_at":"2026-08-07T11:13:28.041469Z","submitted_at":"2026-06-02T03:59:14Z","title":"Experience-Driven Dynamic Exits for LLMs with Reinforcement Learning","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-06-28T10:19:02.938980Z"},"links":{"citing_paper":"/paper/2606.03113"},"observation_digest":"sha256:c9b3b523b7e10d8ae43f2af68e7871790a5acb0d7f202c7924f3e731b3d32caf","observation_id":"0135c962-0de2-4217-9c40-8037d2f19fda","resolution":{"observed_at":"2026-06-28T10:19:02.938980Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:19:02.938980Z","title":"Confident adaptive language modeling,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2606.03113","last_updated":"2026-06-02T03:59:14Z","snapshot_observed_at":"2026-08-07T11:13:28.041469Z","submitted_at":"2026-06-02T03:59:14Z","title":"Experience-Driven Dynamic Exits for LLMs with Reinforcement Learning","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-06-28T10:19:02.938980Z"},"links":{"citing_paper":"/paper/2606.03113"},"observation_digest":"sha256:071f47fa5afe29cc9f7b78dd43ccc5701e585929dbfa4de5dbea878c0658c330","observation_id":"b81416dd-fac9-4bc3-b858-3c21b7fe4100","resolution":{"observed_at":"2026-06-28T10:19:02.938980Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:19:02.938980Z","title":"Dola: Decoding by contrasting layers improves factuality in large language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.03113","last_updated":"2026-06-02T03:59:14Z","snapshot_observed_at":"2026-08-07T11:13:28.041469Z","submitted_at":"2026-06-02T03:59:14Z","title":"Experience-Driven Dynamic Exits for LLMs with Reinforcement Learning","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-06-28T10:19:02.938980Z"},"links":{"citing_paper":"/paper/2606.03113"},"observation_digest":"sha256:6a8194f751ea720e0f5876e89e120a0f86db5752414167e727f6ae881ac1ba65","observation_id":"5f12a786-9baa-4780-81b6-e54b43f425f9","resolution":{"observed_at":"2026-06-28T10:19:02.938980Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:19:02.938980Z","title":"Deja vu: contextual sparsity for efficient llms at inference time,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.03113","last_updated":"2026-06-02T03:59:14Z","snapshot_observed_at":"2026-08-07T11:13:28.041469Z","submitted_at":"2026-06-02T03:59:14Z","title":"Experience-Driven Dynamic Exits for LLMs with Reinforcement Learning","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-06-28T10:19:02.938980Z"},"links":{"citing_paper":"/paper/2606.03113"},"observation_digest":"sha256:8d26c617f923ae61553f8e82bf5bfca5cb9d8654572e92ada74e344ed6487dcc","observation_id":"8a7c4cc6-7ac5-49e5-bc08-2c9ae8a4f096","resolution":{"observed_at":"2026-06-28T10:19:02.938980Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:19:02.938980Z","title":"Draft on the fly: Adaptive self- speculative decoding using cosine similarity,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.03113","last_updated":"2026-06-02T03:59:14Z","snapshot_observed_at":"2026-08-07T11:13:28.041469Z","submitted_at":"2026-06-02T03:59:14Z","title":"Experience-Driven Dynamic Exits for LLMs with Reinforcement Learning","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-06-28T10:19:02.938980Z"},"links":{"citing_paper":"/paper/2606.03113"},"observation_digest":"sha256:ded94dc118e963a97deaa6745d3cf344f840dc421c6d25590b004760f17b5c9c","observation_id":"bc1c67e1-ff32-491b-a951-6b161d6b06ed","resolution":{"observed_at":"2026-06-28T10:19:02.938980Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:19:02.938980Z","title":"Investigating acceleration of LLaMA inference by enabling intermediate layer decoding via instruction tuning with ‘LITE’,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.03113","last_updated":"2026-06-02T03:59:14Z","snapshot_observed_at":"2026-08-07T11:13:28.041469Z","submitted_at":"2026-06-02T03:59:14Z","title":"Experience-Driven Dynamic Exits for LLMs with Reinforcement Learning","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-06-28T10:19:02.938980Z"},"links":{"citing_paper":"/paper/2606.03113"},"observation_digest":"sha256:0f633dbf6a29807883f20c7592cef60777e5f08fde98eee4c5cdb6878fea37f0","observation_id":"f1f5d853-7893-4c0b-bdbb-edf2846224d5","resolution":{"observed_at":"2026-06-28T10:19:02.938980Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:19:02.938980Z","title":"Kangaroo: lossless self-speculative decoding for accelerating llms via double early exiting,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.03113","last_updated":"2026-06-02T03:59:14Z","snapshot_observed_at":"2026-08-07T11:13:28.041469Z","submitted_at":"2026-06-02T03:59:14Z","title":"Experience-Driven Dynamic Exits for LLMs with Reinforcement Learning","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-06-28T10:19:02.938980Z"},"links":{"citing_paper":"/paper/2606.03113"},"observation_digest":"sha256:41902bd260977bd06aa23cadbed55868071ebb73b2cd80651b92abb78d03180f","observation_id":"96eb19fd-7bb5-40d6-80b3-2471b441db77","resolution":{"observed_at":"2026-06-28T10:19:02.938980Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:19:02.938980Z","title":"Statistical inference for prob- abilistic functions of finite state markov chains,","venue":null,"work_id":null,"year":1966},"citing_paper":{"arxiv_id":"2606.03113","last_updated":"2026-06-02T03:59:14Z","snapshot_observed_at":"2026-08-07T11:13:28.041469Z","submitted_at":"2026-06-02T03:59:14Z","title":"Experience-Driven Dynamic Exits for LLMs with Reinforcement Learning","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-06-28T10:19:02.938980Z"},"links":{"citing_paper":"/paper/2606.03113"},"observation_digest":"sha256:e182c7fb5083f375a25838865840c3d09e5a435c112f5de6176e24052c439c7d","observation_id":"b6b45fec-30ec-424b-bb7e-b39f27baeb40","resolution":{"observed_at":"2026-06-28T10:19:02.938980Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:19:02.938980Z","title":"Sutton and Andrew G","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2606.03113","last_updated":"2026-06-02T03:59:14Z","snapshot_observed_at":"2026-08-07T11:13:28.041469Z","submitted_at":"2026-06-02T03:59:14Z","title":"Experience-Driven Dynamic Exits for LLMs with Reinforcement Learning","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-06-28T10:19:02.938980Z"},"links":{"citing_paper":"/paper/2606.03113"},"observation_digest":"sha256:fd991adcb085b0d0001ed5115ecf84c2fe1b3623e404f836d7ff452d3defdc0d","observation_id":"e9e71b5c-5400-424e-b366-b3074327d22e","resolution":{"observed_at":"2026-06-28T10:19:02.938980Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:19:02.938980Z","title":"Mixture-of-depths: Dynamically al- locating compute in transformer-based language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.03113","last_updated":"2026-06-02T03:59:14Z","snapshot_observed_at":"2026-08-07T11:13:28.041469Z","submitted_at":"2026-06-02T03:59:14Z","title":"Experience-Driven Dynamic Exits for LLMs with Reinforcement Learning","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-06-28T10:19:02.938980Z"},"links":{"citing_paper":"/paper/2606.03113"},"observation_digest":"sha256:4ecc1953964b320c758ec771db95078f70580c7a57b7cee1b04875d9c543be34","observation_id":"4011fd8e-48e1-4f4d-9506-964e99e40ba5","resolution":{"observed_at":"2026-06-28T10:19:02.938980Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.06954","last_updated":"2024-04-10T12:12:07Z","snapshot_observed_at":"2026-07-06T17:58:12.766206Z","submitted_at":"2024-04-10T12:12:07Z","title":"Accelerating Inference in Large Language Models with a Unified Layer Skipping Strategy","version":1},"cited_work":{"arxiv_id":"2404.06954","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2404.06954","snapshot_observed_at":"2026-07-02T03:06:30.314947Z","title":"Accelerating inference in large language models with a unified layer skipping strategy,","venue":null,"work_id":"c9793352-5b4e-40e2-8d87-ce61e1db639f","year":2024},"citing_paper":{"arxiv_id":"2606.03113","last_updated":"2026-06-02T03:59:14Z","snapshot_observed_at":"2026-08-07T11:13:28.041469Z","submitted_at":"2026-06-02T03:59:14Z","title":"Experience-Driven Dynamic Exits for LLMs with Reinforcement Learning","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-06-28T10:19:02.938980Z"},"links":{"cited_paper":"/paper/2404.06954","citing_paper":"/paper/2606.03113"},"observation_digest":"sha256:26a2d39a70a213b79ea7914000432cf328eaffe1cc60b1316d3c7206546a94e0","observation_id":"fa3d898d-3dde-4b42-91bb-e09e8818345f","resolution":{"observed_at":"2026-07-02T03:06:30.317060Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:19:02.938980Z","title":"Admtree: Compressing lengthy context with adaptive semantic trees,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.03113","last_updated":"2026-06-02T03:59:14Z","snapshot_observed_at":"2026-08-07T11:13:28.041469Z","submitted_at":"2026-06-02T03:59:14Z","title":"Experience-Driven Dynamic Exits for LLMs with Reinforcement Learning","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-06-28T10:19:02.938980Z"},"links":{"citing_paper":"/paper/2606.03113"},"observation_digest":"sha256:ca1823872c712e2a9969a8e6b64620b726c92b480eb6c314d4d38c01c4309914","observation_id":"f5e452b8-ac74-46a0-9c51-baf7f07b7cef","resolution":{"observed_at":"2026-06-28T10:19:02.938980Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:19:02.938980Z","title":"DAST: Context-aware compression in LLMs via dynamic allocation of soft tokens,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.03113","last_updated":"2026-06-02T03:59:14Z","snapshot_observed_at":"2026-08-07T11:13:28.041469Z","submitted_at":"2026-06-02T03:59:14Z","title":"Experience-Driven Dynamic Exits for LLMs with Reinforcement Learning","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-06-28T10:19:02.938980Z"},"links":{"citing_paper":"/paper/2606.03113"},"observation_digest":"sha256:c7b64b80e3fe7ff28597e99a8520cbc599acaf326f13c47eb70fb31a33b61ddd","observation_id":"5af369a2-4aa7-488b-84f6-4ef18908b3ce","resolution":{"observed_at":"2026-06-28T10:19:02.938980Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:19:02.938980Z","title":"Knn-ssd: Enabling dynamic self-speculative decoding via nearest neighbor layer set optimization,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.03113","last_updated":"2026-06-02T03:59:14Z","snapshot_observed_at":"2026-08-07T11:13:28.041469Z","submitted_at":"2026-06-02T03:59:14Z","title":"Experience-Driven Dynamic Exits for LLMs with Reinforcement Learning","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-06-28T10:19:02.938980Z"},"links":{"citing_paper":"/paper/2606.03113"},"observation_digest":"sha256:101b072344791249600b868bc84eff1610cfda2f938217fcb9d8ef2fc05ef56c","observation_id":"2e009c82-9735-4910-b199-f1af281b0d50","resolution":{"observed_at":"2026-06-28T10:19:02.938980Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:19:02.938980Z","title":"Speculative decoding: Exploiting speculative execution for accelerating seq2seq generation,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.03113","last_updated":"2026-06-02T03:59:14Z","snapshot_observed_at":"2026-08-07T11:13:28.041469Z","submitted_at":"2026-06-02T03:59:14Z","title":"Experience-Driven Dynamic Exits for LLMs with Reinforcement Learning","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-06-28T10:19:02.938980Z"},"links":{"citing_paper":"/paper/2606.03113"},"observation_digest":"sha256:156a90ebcd691e321461a5242d1abf754a79d90a17d94d4af9067564fb0eaee7","observation_id":"31920af8-e213-46f2-8d9a-c850949c02ac","resolution":{"observed_at":"2026-06-28T10:19:02.938980Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:19:02.938980Z","title":"Specinfer: Accelerating large lan- guage model serving with tree-based speculative inference and verification,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.03113","last_updated":"2026-06-02T03:59:14Z","snapshot_observed_at":"2026-08-07T11:13:28.041469Z","submitted_at":"2026-06-02T03:59:14Z","title":"Experience-Driven Dynamic Exits for LLMs with Reinforcement Learning","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-06-28T10:19:02.938980Z"},"links":{"citing_paper":"/paper/2606.03113"},"observation_digest":"sha256:71aeb83e0e692c77a6e5f994f27c538cee647136fea774babb11ef1500273c2f","observation_id":"0353a7ea-5673-40ed-89b8-62727d10a514","resolution":{"observed_at":"2026-06-28T10:19:02.938980Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:19:02.938980Z","title":"Eagle: speculative sampling requires rethinking feature uncertainty,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.03113","last_updated":"2026-06-02T03:59:14Z","snapshot_observed_at":"2026-08-07T11:13:28.041469Z","submitted_at":"2026-06-02T03:59:14Z","title":"Experience-Driven Dynamic Exits for LLMs with Reinforcement Learning","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-06-28T10:19:02.938980Z"},"links":{"citing_paper":"/paper/2606.03113"},"observation_digest":"sha256:f118973884dfe590d0029a7aad041ae8063074b4e95e0e5dd134be0cb6905967","observation_id":"ae13476b-952d-4630-b1cd-a2d31584f2cc","resolution":{"observed_at":"2026-06-28T10:19:02.938980Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:19:02.938980Z","title":"Unlocking efficiency in large lan- guage model inference: A comprehensive survey of speculative decoding,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.03113","last_updated":"2026-06-02T03:59:14Z","snapshot_observed_at":"2026-08-07T11:13:28.041469Z","submitted_at":"2026-06-02T03:59:14Z","title":"Experience-Driven Dynamic Exits for LLMs with Reinforcement Learning","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-06-28T10:19:02.938980Z"},"links":{"citing_paper":"/paper/2606.03113"},"observation_digest":"sha256:8cf781cd76899114ccbb3b1e0557680734c1fe5afcfa357f9608faef4524a4fc","observation_id":"f86f2519-931c-4d77-8737-411008c77762","resolution":{"observed_at":"2026-06-28T10:19:02.938980Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:19:02.938980Z","title":"Human-level control through deep reinforcement learning,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2606.03113","last_updated":"2026-06-02T03:59:14Z","snapshot_observed_at":"2026-08-07T11:13:28.041469Z","submitted_at":"2026-06-02T03:59:14Z","title":"Experience-Driven Dynamic Exits for LLMs with Reinforcement Learning","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-06-28T10:19:02.938980Z"},"links":{"citing_paper":"/paper/2606.03113"},"observation_digest":"sha256:1a6f1d1dc5fadeb3dd31d3da2184516678d35afb396fb23c8684822d5e4b8c5f","observation_id":"46a9b7d7-47e7-4051-b341-1edce0215829","resolution":{"observed_at":"2026-06-28T10:19:02.938980Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:19:02.938980Z","title":"Learning to predict by the methods of temporal differences,","venue":null,"work_id":null,"year":1988},"citing_paper":{"arxiv_id":"2606.03113","last_updated":"2026-06-02T03:59:14Z","snapshot_observed_at":"2026-08-07T11:13:28.041469Z","submitted_at":"2026-06-02T03:59:14Z","title":"Experience-Driven Dynamic Exits for LLMs with Reinforcement Learning","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-06-28T10:19:02.938980Z"},"links":{"citing_paper":"/paper/2606.03113"},"observation_digest":"sha256:8fcc0f49706e611ca006eb946b45ecb3601dcc71aa9893d42548577a1b9e8240","observation_id":"e1168155-3b74-4aba-b135-e09988f52b36","resolution":{"observed_at":"2026-06-28T10:19:02.938980Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1412.6980","last_updated":"2017-01-30T01:27:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2014-12-22T13:54:29Z","title":"Adam: A Method for Stochastic Optimization","version":9},"cited_work":{"arxiv_id":"1412.6980","doi":"10.1002/mrm.28086","metadata_source":"pith","pith_arxiv_id":"1412.6980","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Adam: A Method for Stochastic Optimization","venue":"cs.LG","work_id":"1910796d-9b52-4683-bf5c-de9632c1028b","year":2014},"citing_paper":{"arxiv_id":"2606.03113","last_updated":"2026-06-02T03:59:14Z","snapshot_observed_at":"2026-08-07T11:13:28.041469Z","submitted_at":"2026-06-02T03:59:14Z","title":"Experience-Driven Dynamic Exits for LLMs with Reinforcement Learning","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-06-28T10:19:02.938980Z"},"links":{"cited_paper":"/paper/1412.6980","citing_paper":"/paper/2606.03113"},"observation_digest":"sha256:e1cd848a2a77573ef297ef2d105f81552b369ed0eea2edd32f2444605dd5b650","observation_id":"bcaa16f5-85e6-45e0-b219-207396d6d432","resolution":{"observed_at":"2026-07-02T03:06:30.313498Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1706.10295","last_updated":"2019-07-09T09:57:23Z","snapshot_observed_at":"2026-07-06T05:49:17.299252Z","submitted_at":"2017-06-30T17:56:19Z","title":"Noisy Networks for Exploration","version":3},"cited_work":{"arxiv_id":"1706.10295","doi":"10.48550/arxiv.1706.10295","metadata_source":"arxiv_reference","pith_arxiv_id":"1706.10295","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Noisy networks for exploration","venue":"arXiv (Cornell University)","work_id":"1ef8f051-a1aa-4e02-9530-1db30ad6e0b4","year":2017},"citing_paper":{"arxiv_id":"2606.03113","last_updated":"2026-06-02T03:59:14Z","snapshot_observed_at":"2026-08-07T11:13:28.041469Z","submitted_at":"2026-06-02T03:59:14Z","title":"Experience-Driven Dynamic Exits for LLMs with Reinforcement Learning","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-06-28T10:19:02.938980Z"},"links":{"cited_paper":"/paper/1706.10295","citing_paper":"/paper/2606.03113"},"observation_digest":"sha256:db52645bf5def433d670117dd8a1655e7615a224f501a8e5921a798b63bd5193","observation_id":"64801931-7d82-44b1-bd69-435cedcb3e3f","resolution":{"observed_at":"2026-07-02T03:06:30.320474Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:19:02.938980Z","title":"Alpaca: A strong, replicable instruction- following model,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.03113","last_updated":"2026-06-02T03:59:14Z","snapshot_observed_at":"2026-08-07T11:13:28.041469Z","submitted_at":"2026-06-02T03:59:14Z","title":"Experience-Driven Dynamic Exits for LLMs with Reinforcement Learning","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-06-28T10:19:02.938980Z"},"links":{"citing_paper":"/paper/2606.03113"},"observation_digest":"sha256:bd451b9a21e141a0064bb391e0a8c23b5092cdf5b9157f62bdcede74348c6185","observation_id":"b8fc34f9-e8f3-419e-bb6f-13c47c269247","resolution":{"observed_at":"2026-06-28T10:19:02.938980Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:19:02.938980Z","title":"Low-resource domain adaptation for compositional task-oriented semantic parsing,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2606.03113","last_updated":"2026-06-02T03:59:14Z","snapshot_observed_at":"2026-08-07T11:13:28.041469Z","submitted_at":"2026-06-02T03:59:14Z","title":"Experience-Driven Dynamic Exits for LLMs with Reinforcement Learning","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-06-28T10:19:02.938980Z"},"links":{"citing_paper":"/paper/2606.03113"},"observation_digest":"sha256:95b5f7bdce318d526facad0f727cc309f482f9605e54170de5d77d5108d2fa50","observation_id":"bbe4cda3-565b-46d7-a2e1-e1a7a06d3408","resolution":{"observed_at":"2026-06-28T10:19:02.938980Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:19:02.938980Z","title":"Abstractive text summarization using sequence-to-sequence rnns and beyond,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2606.03113","last_updated":"2026-06-02T03:59:14Z","snapshot_observed_at":"2026-08-07T11:13:28.041469Z","submitted_at":"2026-06-02T03:59:14Z","title":"Experience-Driven Dynamic Exits for LLMs with Reinforcement Learning","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-06-28T10:19:02.938980Z"},"links":{"citing_paper":"/paper/2606.03113"},"observation_digest":"sha256:297c7ccebac574c59e18d7f3c011982c5da268dfd73cbd6d2a6223aef720d7de","observation_id":"7c7aade8-3c7a-4ef7-b95e-55549ad3d1cd","resolution":{"observed_at":"2026-06-28T10:19:02.938980Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2107.03374","last_updated":"2021-07-14T17:16:02Z","snapshot_observed_at":"2026-08-08T11:58:24.516369Z","submitted_at":"2021-07-07T17:41:24Z","title":"Evaluating Large Language Models Trained on Code","version":2},"cited_work":{"arxiv_id":"2107.03374","doi":"10.48550/arxiv.2107.03374","metadata_source":"pith","pith_arxiv_id":"2107.03374","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Evaluating Large Language Models Trained on Code","venue":"cs.LG","work_id":"042493e9-b26f-4b4e-bbde-382072ca9b08","year":2021},"citing_paper":{"arxiv_id":"2606.03113","last_updated":"2026-06-02T03:59:14Z","snapshot_observed_at":"2026-08-07T11:13:28.041469Z","submitted_at":"2026-06-02T03:59:14Z","title":"Experience-Driven Dynamic Exits for LLMs with Reinforcement Learning","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-06-28T10:19:02.938980Z"},"links":{"cited_paper":"/paper/2107.03374","citing_paper":"/paper/2606.03113"},"observation_digest":"sha256:16eccd7de83d17a98ad3e3fadfa54a7391af3ca25e503bf9f6086c1f2f8a3796","observation_id":"bbc0ad88-9ceb-4d02-ab02-fd3e6f049526","resolution":{"observed_at":"2026-07-02T03:06:30.323809Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-01T08:08:23.404839+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-01T08:08:23.404839+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:19:02.938980Z","title":"Fast inference from transformers via speculative decoding,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.03113","last_updated":"2026-06-02T03:59:14Z","snapshot_observed_at":"2026-08-07T11:13:28.041469Z","submitted_at":"2026-06-02T03:59:14Z","title":"Experience-Driven Dynamic Exits for LLMs with Reinforcement Learning","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-06-28T10:19:02.938980Z"},"links":{"citing_paper":"/paper/2606.03113"},"observation_digest":"sha256:ce3e66ccbeeafd611647b842c31e41bd7e414a4999a522d77ebd1c0991c6c055","observation_id":"45c7da89-618e-4c3a-b395-254824101c17","resolution":{"observed_at":"2026-06-28T10:19:02.938980Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2606.03113","last_updated":"2026-06-02T03:59:14Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-07T11:13:28.041469Z","submitted_at":"2026-06-02T03:59:14Z","title":"Experience-Driven Dynamic Exits for LLMs with Reinforcement Learning"},"reference_resolution":{"displayed":38,"state_counts":{"malformed_identifier":1,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":32,"verified_exact":4,"verified_fuzzy":0},"total_outbound_references":38},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 38 of 38 outbound references and 1 inbound Pith citation observation for arXiv:2606.03113."}