{"as_of":"2026-08-08T23:52:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:434bcb9448964b250021034d636ecdd66f694e8ee8d3c8f8478d02ef51eb4357","coverage":[{"denominator":18,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":18,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-04T14:43:55.953976Z","state":"measured"},{"denominator":18,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":18,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2509.24050/citation-record","integrity":"/paper/2509.24050/integrity","json":"/paper/2509.24050/citation-record.json","paper":"/paper/2509.24050"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-04T14:43:53.762733Z","title":"Gpt-4 technical report.arXiv preprint arXiv:2303.08774,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.24050","last_updated":"2026-05-23T21:20:59Z","snapshot_observed_at":"2026-08-08T12:58:06.243039Z","submitted_at":"2025-09-28T19:48:56Z","title":"Bridging On-Device and Cloud LLMs for Collaborative Reasoning: A Unified Methodology for Local Routing and Post-Training","version":4},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-04T14:43:53.762733Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2509.24050"},"observation_digest":"sha256:2a7673bfee17eb16f043eb9f1fe9adf7c11395c1a3852adc38d949efe6f64bac","observation_id":"6294805d-9f52-465e-a7b5-ffb76721b9ff","resolution":{"observed_at":"2026-08-04T14:43:53.762733Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.02829","last_updated":"2025-06-08T00:57:21Z","snapshot_observed_at":"2026-07-06T19:45:21.541944Z","submitted_at":"2024-11-05T06:00:27Z","title":"CE-CoLLM: Efficient and Adaptive Large Language Models Through Cloud-Edge Collaboration","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.02829","snapshot_observed_at":"2026-08-04T14:43:54.496833Z","title":"CE-collm: Efficient and adaptive large language models through cloud-edge collaboration.arXiv preprint arXiv:2411.02829,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.24050","last_updated":"2026-05-23T21:20:59Z","snapshot_observed_at":"2026-08-08T12:58:06.243039Z","submitted_at":"2025-09-28T19:48:56Z","title":"Bridging On-Device and Cloud LLMs for Collaborative Reasoning: A Unified Methodology for Local Routing and Post-Training","version":4},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-04T14:43:54.496833Z"},"links":{"cited_paper":"/paper/2411.02829","citing_paper":"/paper/2509.24050"},"observation_digest":"sha256:7f6a764580a0f9c9b099891f6d0d2598a402596dc75e2c124f7957f3700349f6","observation_id":"362a7aa6-3502-458b-9d6f-cd33b3dc6442","resolution":{"observed_at":"2026-08-04T14:43:54.496833Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T14:43:54.834871Z","title":"Routing to the expert: Efficient reward-guided ensemble of large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.24050","last_updated":"2026-05-23T21:20:59Z","snapshot_observed_at":"2026-08-08T12:58:06.243039Z","submitted_at":"2025-09-28T19:48:56Z","title":"Bridging On-Device and Cloud LLMs for Collaborative Reasoning: A Unified Methodology for Local Routing and Post-Training","version":4},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-04T14:43:54.834871Z"},"links":{"citing_paper":"/paper/2509.24050"},"observation_digest":"sha256:ea619cfd3cb8085cc2c63f0d009be0515a2f8f7de95d6e03b07bb073845431a7","observation_id":"e79cee0f-e56e-4a7d-8ace-642e78c8d546","resolution":{"observed_at":"2026-08-04T14:43:54.834871Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T14:43:54.986258Z","title":"Alec Radford, Jeffrey Wu, Rewon Child, David Luan, Dario Amodei, Ilya Sutskever, et al","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.24050","last_updated":"2026-05-23T21:20:59Z","snapshot_observed_at":"2026-08-08T12:58:06.243039Z","submitted_at":"2025-09-28T19:48:56Z","title":"Bridging On-Device and Cloud LLMs for Collaborative Reasoning: A Unified Methodology for Local Routing and Post-Training","version":4},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-04T14:43:54.986258Z"},"links":{"citing_paper":"/paper/2509.24050"},"observation_digest":"sha256:a813332428ac61b8c4f9ac35f6564c99feeedb831ccc3a62a57422fc313ea26c","observation_id":"9b3cfade-80e9-4e5d-b256-1d9af198ecac","resolution":{"observed_at":"2026-08-04T14:43:54.986258Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03300","last_updated":"2024-04-27T15:25:53Z","snapshot_observed_at":"2026-08-06T14:58:42.911363Z","submitted_at":"2024-02-05T18:55:32Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.03300","snapshot_observed_at":"2026-08-04T14:43:55.162713Z","title":"Deepseekmath: Pushing the limits of mathemati- cal reasoning in open language models.arXiv preprint arXiv:2402.03300,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.24050","last_updated":"2026-05-23T21:20:59Z","snapshot_observed_at":"2026-08-08T12:58:06.243039Z","submitted_at":"2025-09-28T19:48:56Z","title":"Bridging On-Device and Cloud LLMs for Collaborative Reasoning: A Unified Methodology for Local Routing and Post-Training","version":4},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-04T14:43:55.162713Z"},"links":{"cited_paper":"/paper/2402.03300","citing_paper":"/paper/2509.24050"},"observation_digest":"sha256:5ffe4085e8cd7ad1141acd113f99ab89252eef24fa72bd5f882977e51ca8c17c","observation_id":"63d3f026-4875-4e12-b017-8b2e9b499ec6","resolution":{"observed_at":"2026-08-04T14:43:55.162713Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.06925","last_updated":"2024-10-08T07:46:47Z","snapshot_observed_at":"2026-08-06T03:29:16.075425Z","submitted_at":"2024-02-10T11:14:53Z","title":"A Thorough Examination of Decoding Methods in the Era of LLMs","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.06925","snapshot_observed_at":"2026-08-04T14:43:55.322520Z","title":"A thorough examination of decoding methods in the era of llms.arXiv preprint arXiv:2402.06925,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.24050","last_updated":"2026-05-23T21:20:59Z","snapshot_observed_at":"2026-08-08T12:58:06.243039Z","submitted_at":"2025-09-28T19:48:56Z","title":"Bridging On-Device and Cloud LLMs for Collaborative Reasoning: A Unified Methodology for Local Routing and Post-Training","version":4},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-04T14:43:55.322520Z"},"links":{"cited_paper":"/paper/2402.06925","citing_paper":"/paper/2509.24050"},"observation_digest":"sha256:6a2889947230b060688c8ebacce4ad906b805728108adcff6944f44d52cc5338","observation_id":"56eaaeb7-ba01-40e4-bdd9-7fbe2694f17f","resolution":{"observed_at":"2026-08-04T14:43:55.322520Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13971","last_updated":"2023-02-27T17:11:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-27T17:11:15Z","title":"LLaMA: Open and Efficient Foundation Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.13971","snapshot_observed_at":"2026-08-04T14:43:55.450205Z","title":"Llama: Open and efficient foundation language models.arXiv preprint arXiv:2302.13971,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.24050","last_updated":"2026-05-23T21:20:59Z","snapshot_observed_at":"2026-08-08T12:58:06.243039Z","submitted_at":"2025-09-28T19:48:56Z","title":"Bridging On-Device and Cloud LLMs for Collaborative Reasoning: A Unified Methodology for Local Routing and Post-Training","version":4},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-04T14:43:55.450205Z"},"links":{"cited_paper":"/paper/2302.13971","citing_paper":"/paper/2509.24050"},"observation_digest":"sha256:c670a48d5a13614ae378b832f9051f54539b97e337fc36ba9ae0379147578d4e","observation_id":"e601e73e-0d00-4f07-b679-a059b0e6583d","resolution":{"observed_at":"2026-08-04T14:43:55.450205Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2109.01652","last_updated":"2022-02-08T20:26:45Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-09-03T17:55:52Z","title":"Finetuned Language Models Are Zero-Shot Learners","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2109.01652","snapshot_observed_at":"2026-08-04T14:43:55.538761Z","title":"Finetuned language models are zero-shot learners.arXiv preprint arXiv:2109.01652,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.24050","last_updated":"2026-05-23T21:20:59Z","snapshot_observed_at":"2026-08-08T12:58:06.243039Z","submitted_at":"2025-09-28T19:48:56Z","title":"Bridging On-Device and Cloud LLMs for Collaborative Reasoning: A Unified Methodology for Local Routing and Post-Training","version":4},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-04T14:43:55.538761Z"},"links":{"cited_paper":"/paper/2109.01652","citing_paper":"/paper/2509.24050"},"observation_digest":"sha256:b14cb740a332d7ad95dfd1eb37a9735fa22b128b15372bd497a0c34e0f315e57","observation_id":"2ea04f92-1cbd-4b9d-a662-418fd2dad359","resolution":{"observed_at":"2026-08-04T14:43:55.538761Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.11007","last_updated":"2026-07-10T21:32:42Z","snapshot_observed_at":"2026-08-07T18:15:10.232504Z","submitted_at":"2025-02-16T06:18:28Z","title":"Device-Cloud Collaborative LLM Inference with Multi-Modal, Multi-Task, Multi-Turn Conversations","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.11007","snapshot_observed_at":"2026-08-04T14:43:55.719733Z","title":"Local-cloud infer- ence offloading for LLMs in multi-modal, multi-task, multi-dialogue settings.arXiv preprint arXiv:2502.11007,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.24050","last_updated":"2026-05-23T21:20:59Z","snapshot_observed_at":"2026-08-08T12:58:06.243039Z","submitted_at":"2025-09-28T19:48:56Z","title":"Bridging On-Device and Cloud LLMs for Collaborative Reasoning: A Unified Methodology for Local Routing and Post-Training","version":4},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-04T14:43:55.719733Z"},"links":{"cited_paper":"/paper/2502.11007","citing_paper":"/paper/2509.24050"},"observation_digest":"sha256:ff4e43d2ad0403620ab89e86557aad5fa100e72c52ab5ef9069a4fb4da90b761","observation_id":"0c7773f0-9bd1-42a8-b13b-87268b176017","resolution":{"observed_at":"2026-08-04T14:43:55.719733Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1909.08593","last_updated":"2020-01-08T23:02:36Z","snapshot_observed_at":"2026-08-08T07:44:49.921146Z","submitted_at":"2019-09-18T17:33:39Z","title":"Fine-Tuning Language Models from Human Preferences","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1909.08593","snapshot_observed_at":"2026-08-04T14:43:55.821657Z","title":"Fine-tuning language models from human preferences.arXiv preprint arXiv:1909.08593,","venue":null,"work_id":null,"year":1909},"citing_paper":{"arxiv_id":"2509.24050","last_updated":"2026-05-23T21:20:59Z","snapshot_observed_at":"2026-08-08T12:58:06.243039Z","submitted_at":"2025-09-28T19:48:56Z","title":"Bridging On-Device and Cloud LLMs for Collaborative Reasoning: A Unified Methodology for Local Routing and Post-Training","version":4},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-04T14:43:55.821657Z"},"links":{"cited_paper":"/paper/1909.08593","citing_paper":"/paper/2509.24050"},"observation_digest":"sha256:ea50ea14e5ca8bf0b677f0bdd0f29569fd3596a0cf1439b5bad94e83710a3f2e","observation_id":"d3a2ff3b-2304-4c1e-9fbd-aa985898ff4e","resolution":{"observed_at":"2026-08-04T14:43:55.821657Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T14:43:55.953976Z","title":"The Countdown task is an arith- metic puzzle where the model must combine a given set of numbers using basic arithmetic operations (+,−,×,÷) to reach a specified target number","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2509.24050","last_updated":"2026-05-23T21:20:59Z","snapshot_observed_at":"2026-08-08T12:58:06.243039Z","submitted_at":"2025-09-28T19:48:56Z","title":"Bridging On-Device and Cloud LLMs for Collaborative Reasoning: A Unified Methodology for Local Routing and Post-Training","version":4},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-04T14:43:55.953976Z"},"links":{"citing_paper":"/paper/2509.24050"},"observation_digest":"sha256:f4b89b98820aaf2e6790815fa6093e6ddbd1f22b3048af11a82b3144b0c38326","observation_id":"7cd9ffc5-2071-4047-82ef-8c7574928987","resolution":{"observed_at":"2026-08-04T14:43:55.953976Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.00088","last_updated":"2024-09-14T04:01:09Z","snapshot_observed_at":"2026-07-06T19:08:26.637143Z","submitted_at":"2024-08-26T03:33:36Z","title":"On-Device Language Models: A Comprehensive Review","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.00088","snapshot_observed_at":"2026-08-04T14:43:55.645299Z","title":"On-device language models: A comprehensive review.arXiv preprint arXiv:2409.00088,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.24050","last_updated":"2026-05-23T21:20:59Z","snapshot_observed_at":"2026-08-08T12:58:06.243039Z","submitted_at":"2025-09-28T19:48:56Z","title":"Bridging On-Device and Cloud LLMs for Collaborative Reasoning: A Unified Methodology for Local Routing and Post-Training","version":4},"reference_index":1992,"source":"pdf_text","source_observed_at":"2026-08-04T14:43:55.645299Z"},"links":{"cited_paper":"/paper/2409.00088","citing_paper":"/paper/2509.24050"},"observation_digest":"sha256:3dbec362a06dd7a575aeb7724023d5cac52ac726728741830c73b58ac8bf6424","observation_id":"26c784c6-9798-4e4f-ad24-e1fb01660bab","resolution":{"observed_at":"2026-08-04T14:43:55.645299Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.05176","last_updated":"2023-05-09T05:11:02Z","snapshot_observed_at":"2026-07-31T18:33:34.529799Z","submitted_at":"2023-05-09T05:11:02Z","title":"FrugalGPT: How to Use Large Language Models While Reducing Cost and Improving Performance","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.05176","snapshot_observed_at":"2026-08-04T14:43:54.119424Z","title":"Frugalgpt: How to use large language models while reducing cost and improving performance.arXiv preprint arXiv:2305.05176,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.24050","last_updated":"2026-05-23T21:20:59Z","snapshot_observed_at":"2026-08-08T12:58:06.243039Z","submitted_at":"2025-09-28T19:48:56Z","title":"Bridging On-Device and Cloud LLMs for Collaborative Reasoning: A Unified Methodology for Local Routing and Post-Training","version":4},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-04T14:43:54.119424Z"},"links":{"cited_paper":"/paper/2305.05176","citing_paper":"/paper/2509.24050"},"observation_digest":"sha256:fb9243c808ebc66e984995eb2851143da5eb018615145a12251693fa8a97aec4","observation_id":"972cc23e-17cd-4882-8b96-d058ae7f201d","resolution":{"observed_at":"2026-08-04T14:43:54.119424Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T14:43:54.008788Z","title":"Language models are few-shot learners.Advances in neural information processing systems, 33:1877–1901,","venue":null,"work_id":null,"year":1901},"citing_paper":{"arxiv_id":"2509.24050","last_updated":"2026-05-23T21:20:59Z","snapshot_observed_at":"2026-08-08T12:58:06.243039Z","submitted_at":"2025-09-28T19:48:56Z","title":"Bridging On-Device and Cloud LLMs for Collaborative Reasoning: A Unified Methodology for Local Routing and Post-Training","version":4},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-04T14:43:54.008788Z"},"links":{"citing_paper":"/paper/2509.24050"},"observation_digest":"sha256:cf75b437114efd53c44b15c349482df69bf43735e9e9ae4516740cc1d7261e0c","observation_id":"dd503892-46af-4e2e-b307-b2c81be56dd0","resolution":{"observed_at":"2026-08-04T14:43:54.008788Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.16731","last_updated":"2025-07-22T16:13:43Z","snapshot_observed_at":"2026-08-07T22:15:08.576638Z","submitted_at":"2025-07-22T16:13:43Z","title":"Collaborative Inference and Learning between Edge SLMs and Cloud LLMs: A Survey of Algorithms, Execution, and Open Challenges","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.16731","snapshot_observed_at":"2026-08-04T14:43:54.655669Z","title":"Numinamath: The largest public dataset in ai4maths with 860k pairs of competition math problems and solutions.Hugging Face repository, 13(9):9, 2024a","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.24050","last_updated":"2026-05-23T21:20:59Z","snapshot_observed_at":"2026-08-08T12:58:06.243039Z","submitted_at":"2025-09-28T19:48:56Z","title":"Bridging On-Device and Cloud LLMs for Collaborative Reasoning: A Unified Methodology for Local Routing and Post-Training","version":4},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-04T14:43:54.655669Z"},"links":{"cited_paper":"/paper/2507.16731","citing_paper":"/paper/2509.24050"},"observation_digest":"sha256:531794e34aedab14342c090891114b56c64f64a67ae11c6a81f119d808af4f22","observation_id":"ccbc9f12-93f1-4be4-84a2-4a2f3e852ef0","resolution":{"observed_at":"2026-08-04T14:43:54.655669Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.14740","last_updated":"2024-02-26T18:26:25Z","snapshot_observed_at":"2026-07-06T17:34:07.737296Z","submitted_at":"2024-02-22T17:52:34Z","title":"Back to Basics: Revisiting REINFORCE Style Optimization for Learning from Human Feedback in LLMs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.14740","snapshot_observed_at":"2026-08-04T14:43:53.869680Z","title":"Back to basics: Revisiting reinforce style optimization for learn- ing from human feedback in LLMs.arXiv preprint arXiv:2402.14740,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.24050","last_updated":"2026-05-23T21:20:59Z","snapshot_observed_at":"2026-08-08T12:58:06.243039Z","submitted_at":"2025-09-28T19:48:56Z","title":"Bridging On-Device and Cloud LLMs for Collaborative Reasoning: A Unified Methodology for Local Routing and Post-Training","version":4},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-04T14:43:53.869680Z"},"links":{"cited_paper":"/paper/2402.14740","citing_paper":"/paper/2509.24050"},"observation_digest":"sha256:0ca78f53b71314a62e8889e43e4f6a6eb753632f5dd32225b2b86a30769cc738","observation_id":"3e02e11a-adc3-4dd3-b7f1-1c1fa58b574f","resolution":{"observed_at":"2026-08-04T14:43:53.869680Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.19389","last_updated":"2026-05-23T21:24:55Z","snapshot_observed_at":"2026-07-06T20:29:11.710285Z","submitted_at":"2025-01-31T18:44:35Z","title":"Federated Sketching LoRA: A Flexible Framework for Heterogeneous Collaborative Fine-Tuning of LLMs","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.19389","snapshot_observed_at":"2026-08-04T14:43:54.224975Z","title":"Federated sketching LoRA: On-device collaborative fine-tuning of large language models.arXiv preprint arXiv:2501.19389,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.24050","last_updated":"2026-05-23T21:20:59Z","snapshot_observed_at":"2026-08-08T12:58:06.243039Z","submitted_at":"2025-09-28T19:48:56Z","title":"Bridging On-Device and Cloud LLMs for Collaborative Reasoning: A Unified Methodology for Local Routing and Post-Training","version":4},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-04T14:43:54.224975Z"},"links":{"cited_paper":"/paper/2501.19389","citing_paper":"/paper/2509.24050"},"observation_digest":"sha256:ad069d586b355a2a485458687c22f4f0991b8d915896428ef8a8a1efe3798ddc","observation_id":"34404daf-c9dd-4db4-94bb-db3556637f08","resolution":{"observed_at":"2026-08-04T14:43:54.224975Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2006.03654","last_updated":"2021-10-06T21:02:00Z","snapshot_observed_at":"2026-07-06T09:26:29.068023Z","submitted_at":"2020-06-05T19:54:34Z","title":"DeBERTa: Decoding-enhanced BERT with Disentangled Attention","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2006.03654","snapshot_observed_at":"2026-08-04T14:43:54.378053Z","title":"Deberta: Decoding-enhanced bert with disentangled attention.arXiv preprint arXiv:2006.03654,","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2509.24050","last_updated":"2026-05-23T21:20:59Z","snapshot_observed_at":"2026-08-08T12:58:06.243039Z","submitted_at":"2025-09-28T19:48:56Z","title":"Bridging On-Device and Cloud LLMs for Collaborative Reasoning: A Unified Methodology for Local Routing and Post-Training","version":4},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-04T14:43:54.378053Z"},"links":{"cited_paper":"/paper/2006.03654","citing_paper":"/paper/2509.24050"},"observation_digest":"sha256:721bb701cf008e00a95ec0a6140fc004b41a30b8613776181348c6cef138a790","observation_id":"a0fefbed-76c6-4d8e-8c6d-f2fc7168b50a","resolution":{"observed_at":"2026-08-04T14:43:54.378053Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2509.24050","last_updated":"2026-05-23T21:20:59Z","latest_version":4,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-08T12:58:06.243039Z","submitted_at":"2025-09-28T19:48:56Z","title":"Bridging On-Device and Cloud LLMs for Collaborative Reasoning: A Unified Methodology for Local Routing and Post-Training"},"reference_resolution":{"displayed":18,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":18,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":18},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 18 of 18 outbound references and 0 inbound Pith citation observations for arXiv:2509.24050."}