{"as_of":"2026-08-08T13:10:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:05524158bf7a6384eca5c3f146f0c4268d0061c0f3d7a26f2b772bb829f76c13","coverage":[{"denominator":73,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":73,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T15:03:52.273544Z","state":"measured"},{"denominator":73,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":73,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2505.16502/citation-record","integrity":"/paper/2505.16502/integrity","json":"/paper/2505.16502/citation-record.json","paper":"/paper/2505.16502"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:59.242723Z","title":"A survey on end- edge-cloud orchestrated network computing paradigms: Transparent computing, mobile edge computing, fog computing, and cloudlet,","venue":null,"work_id":"7954b50c-7288-47a1-ae97-24336e0ac175","year":2019},"citing_paper":{"arxiv_id":"2505.16502","last_updated":"2025-05-24T04:40:44Z","snapshot_observed_at":"2026-08-07T14:57:30.728147Z","submitted_at":"2025-05-22T10:36:05Z","title":"Recursive Offloading for LLM Serving in Multi-tier Networks","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:45.076398Z"},"links":{"citing_paper":"/paper/2505.16502"},"observation_digest":"sha256:0952add27b1373450f4bc693d540d791963db84dcf85ed1b2eeb00f3ca5aa04e","observation_id":"aa7fe6c9-320f-4388-9a05-fe9051103818","resolution":{"observed_at":"2026-08-07T15:03:59.295812Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:45.142503Z","title":"Dis- tributed artificial intelligence empowered by end-edge-cloud computing: A survey,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.16502","last_updated":"2025-05-24T04:40:44Z","snapshot_observed_at":"2026-08-07T14:57:30.728147Z","submitted_at":"2025-05-22T10:36:05Z","title":"Recursive Offloading for LLM Serving in Multi-tier Networks","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:45.142503Z"},"links":{"citing_paper":"/paper/2505.16502"},"observation_digest":"sha256:8e187607c6ecc6a57e7dd332d3c325c68e248f40997de3405b98ae51cc3d4042","observation_id":"f77921d4-2656-419c-ae18-8088998682bc","resolution":{"observed_at":"2026-08-07T15:03:45.142503Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:59.128868Z","title":"End-edge-cloud collaborative computing for deep learning: A comprehensive survey,","venue":null,"work_id":"5676de8c-1eeb-42f7-a8f3-70ef89a88d8a","year":2024},"citing_paper":{"arxiv_id":"2505.16502","last_updated":"2025-05-24T04:40:44Z","snapshot_observed_at":"2026-08-07T14:57:30.728147Z","submitted_at":"2025-05-22T10:36:05Z","title":"Recursive Offloading for LLM Serving in Multi-tier Networks","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:45.264096Z"},"links":{"citing_paper":"/paper/2505.16502"},"observation_digest":"sha256:df0e61cd9ce0a5cc2f3f2254e8224f30299606d3e62e3a6970c58ba825a5ec7e","observation_id":"3f215ae8-c10f-47f0-923d-c294348d0682","resolution":{"observed_at":"2026-08-07T15:03:59.163826Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:45.329579Z","title":"Language models are unsupervised multitask learners,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.16502","last_updated":"2025-05-24T04:40:44Z","snapshot_observed_at":"2026-08-07T14:57:30.728147Z","submitted_at":"2025-05-22T10:36:05Z","title":"Recursive Offloading for LLM Serving in Multi-tier Networks","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:45.329579Z"},"links":{"citing_paper":"/paper/2505.16502"},"observation_digest":"sha256:a830a466210c606bfea75137153d15b9ef5d8e0283a68e0b667e76eed46a5126","observation_id":"eb72d876-72d2-4dc2-a707-d1dc6bf31405","resolution":{"observed_at":"2026-08-07T15:03:45.329579Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:45.404337Z","title":"Attention is all you need,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.16502","last_updated":"2025-05-24T04:40:44Z","snapshot_observed_at":"2026-08-07T14:57:30.728147Z","submitted_at":"2025-05-22T10:36:05Z","title":"Recursive Offloading for LLM Serving in Multi-tier Networks","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:45.404337Z"},"links":{"citing_paper":"/paper/2505.16502"},"observation_digest":"sha256:644abc4a6f07da493da30f7ec4c502375dbb831e531288d62a968348abb166e0","observation_id":"ab2a75da-8b60-4eeb-9ac5-b1a4cfe143c6","resolution":{"observed_at":"2026-08-07T15:03:45.404337Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.06435","last_updated":"2024-10-17T01:10:40Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-07-12T20:01:52Z","title":"A Comprehensive Overview of Large Language Models","version":10},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.06435","snapshot_observed_at":"2026-08-07T15:03:45.458221Z","title":"A comprehensive overview of large language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.16502","last_updated":"2025-05-24T04:40:44Z","snapshot_observed_at":"2026-08-07T14:57:30.728147Z","submitted_at":"2025-05-22T10:36:05Z","title":"Recursive Offloading for LLM Serving in Multi-tier Networks","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:45.458221Z"},"links":{"cited_paper":"/paper/2307.06435","citing_paper":"/paper/2505.16502"},"observation_digest":"sha256:265e85e8b950fbb85f237b934bd696cd6b9fc00c2f89d7a5fb8da2f96ca87bb2","observation_id":"bcfca86d-27ec-48fa-b918-ad18c20ff31c","resolution":{"observed_at":"2026-08-07T15:03:45.458221Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:58.934584Z","title":"Gpt-3.5 turbo: Legacy gpt model for cheaper chat and non-chat tasks,","venue":null,"work_id":"7a316b8b-ed30-44b6-8125-c7acf0982070","year":2022},"citing_paper":{"arxiv_id":"2505.16502","last_updated":"2025-05-24T04:40:44Z","snapshot_observed_at":"2026-08-07T14:57:30.728147Z","submitted_at":"2025-05-22T10:36:05Z","title":"Recursive Offloading for LLM Serving in Multi-tier Networks","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:45.544841Z"},"links":{"citing_paper":"/paper/2505.16502"},"observation_digest":"sha256:71b892b289bad4658840e59015ee8f3fc29168604149b586cd82f62c5c97213b","observation_id":"a01ef14f-811c-4325-8f3d-8e9ea054bc51","resolution":{"observed_at":"2026-08-07T15:03:59.006806Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:45.650559Z","title":"Language mod- els are few-shot learners,","venue":null,"work_id":null,"year":1901},"citing_paper":{"arxiv_id":"2505.16502","last_updated":"2025-05-24T04:40:44Z","snapshot_observed_at":"2026-08-07T14:57:30.728147Z","submitted_at":"2025-05-22T10:36:05Z","title":"Recursive Offloading for LLM Serving in Multi-tier Networks","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:45.650559Z"},"links":{"citing_paper":"/paper/2505.16502"},"observation_digest":"sha256:8d8101289b5338f9af731bb7392eb9c3159deb40a7c2d42796e9384fa1bf38a8","observation_id":"25230337-a15e-4a4e-acb9-bca39da67ce4","resolution":{"observed_at":"2026-08-07T15:03:45.650559Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-07T15:03:45.753416Z","title":"Deepseek-r1: Incentivizing reasoning capability in llms via reinforcement learning,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.16502","last_updated":"2025-05-24T04:40:44Z","snapshot_observed_at":"2026-08-07T14:57:30.728147Z","submitted_at":"2025-05-22T10:36:05Z","title":"Recursive Offloading for LLM Serving in Multi-tier Networks","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:45.753416Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2505.16502"},"observation_digest":"sha256:e4ef90d46fb7fe6aeffe63e0e5ba4db5d61583939cef45bb179095b8bc6a0608","observation_id":"f7a38dc9-0d01-4778-b9eb-0644d69bbbc3","resolution":{"observed_at":"2026-08-07T15:03:45.753416Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:45.843711Z","title":"Mobilellm: Optimizing sub- billion parameter language models for on-device use cases,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.16502","last_updated":"2025-05-24T04:40:44Z","snapshot_observed_at":"2026-08-07T14:57:30.728147Z","submitted_at":"2025-05-22T10:36:05Z","title":"Recursive Offloading for LLM Serving in Multi-tier Networks","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:45.843711Z"},"links":{"citing_paper":"/paper/2505.16502"},"observation_digest":"sha256:223a547f3d4c9cf94bcc04103a56b9136aaf3db2e9644fe88b8534df6b97cf26","observation_id":"2ed8bc71-5a54-4795-8ad1-fad87f664103","resolution":{"observed_at":"2026-08-07T15:03:45.843711Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.06395","last_updated":"2024-06-03T08:54:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-04-09T15:36:50Z","title":"MiniCPM: Unveiling the Potential of Small Language Models with Scalable Training Strategies","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.06395","snapshot_observed_at":"2026-08-07T15:03:45.923625Z","title":"Minicpm: Unveiling the potential of small language models with scalable training strategies,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.16502","last_updated":"2025-05-24T04:40:44Z","snapshot_observed_at":"2026-08-07T14:57:30.728147Z","submitted_at":"2025-05-22T10:36:05Z","title":"Recursive Offloading for LLM Serving in Multi-tier Networks","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:45.923625Z"},"links":{"cited_paper":"/paper/2404.06395","citing_paper":"/paper/2505.16502"},"observation_digest":"sha256:baf29c58f88b62d9cd91ce14a5536cd784841a34070fe477f27f6cd0d40963c4","observation_id":"b2317f5c-7ad2-4377-9116-c5637ac4b1b8","resolution":{"observed_at":"2026-08-07T15:03:45.923625Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:46.008149Z","title":"{ServerlessLLM}:{Low-Latency}serverless inference for large language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.16502","last_updated":"2025-05-24T04:40:44Z","snapshot_observed_at":"2026-08-07T14:57:30.728147Z","submitted_at":"2025-05-22T10:36:05Z","title":"Recursive Offloading for LLM Serving in Multi-tier Networks","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:46.008149Z"},"links":{"citing_paper":"/paper/2505.16502"},"observation_digest":"sha256:9784cea6887139d23ae6d1a1d207a3a405c81300bdfd00e21e2c140dafd52ee0","observation_id":"d6eb5a5f-1d98-488f-928c-956135fe1f98","resolution":{"observed_at":"2026-08-07T15:03:46.008149Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:46.100507Z","title":"{DistServe}: Disaggregating prefill and decoding for goodput-optimized large language model serving,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.16502","last_updated":"2025-05-24T04:40:44Z","snapshot_observed_at":"2026-08-07T14:57:30.728147Z","submitted_at":"2025-05-22T10:36:05Z","title":"Recursive Offloading for LLM Serving in Multi-tier Networks","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:46.100507Z"},"links":{"citing_paper":"/paper/2505.16502"},"observation_digest":"sha256:f422c87d6114234cead2a3a40439b6ccba47b987b5919225468f18aa02010b5b","observation_id":"1b5dddea-3ba0-4b48-badf-7f62bda68647","resolution":{"observed_at":"2026-08-07T15:03:46.100507Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.14636","last_updated":"2024-05-23T14:41:22Z","snapshot_observed_at":"2026-07-06T18:18:39.093732Z","submitted_at":"2024-05-23T14:41:22Z","title":"PerLLM: Personalized Inference Scheduling with Edge-Cloud Collaboration for Diverse LLM Services","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.14636","snapshot_observed_at":"2026-08-07T15:03:46.208795Z","title":"Perllm: Personalized inference scheduling with edge-cloud collaboration for diverse llm services,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.16502","last_updated":"2025-05-24T04:40:44Z","snapshot_observed_at":"2026-08-07T14:57:30.728147Z","submitted_at":"2025-05-22T10:36:05Z","title":"Recursive Offloading for LLM Serving in Multi-tier Networks","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:46.208795Z"},"links":{"cited_paper":"/paper/2405.14636","citing_paper":"/paper/2505.16502"},"observation_digest":"sha256:efff01dc86e194a706e210554904d20bd661813c371447442d4cd8bd201c3cdc","observation_id":"73a11d3a-22f3-458f-a75f-e2a7bb9bc1d9","resolution":{"observed_at":"2026-08-07T15:03:46.208795Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.16739","last_updated":"2025-06-04T07:22:47Z","snapshot_observed_at":"2026-08-03T22:38:00.596602Z","submitted_at":"2023-09-28T06:22:59Z","title":"Pushing Large Language Models to the 6G Edge: Vision, Challenges, and Opportunities","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.16739","snapshot_observed_at":"2026-08-07T15:03:46.283789Z","title":"Pushing large language models to the 6g edge: Vision, challenges, and opportunities,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.16502","last_updated":"2025-05-24T04:40:44Z","snapshot_observed_at":"2026-08-07T14:57:30.728147Z","submitted_at":"2025-05-22T10:36:05Z","title":"Recursive Offloading for LLM Serving in Multi-tier Networks","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:46.283789Z"},"links":{"cited_paper":"/paper/2309.16739","citing_paper":"/paper/2505.16502"},"observation_digest":"sha256:a97559cfc422fec83012eab9626dcfeda90ab924368bf28e416e95c1b8cc6140","observation_id":"da6cac04-25d0-47ac-a936-3ad56c881256","resolution":{"observed_at":"2026-08-07T15:03:46.283789Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:58.763219Z","title":"Efficient inference with model cascades,","venue":null,"work_id":"b4216973-5e7f-4fda-a108-3a035d4cc873","year":2023},"citing_paper":{"arxiv_id":"2505.16502","last_updated":"2025-05-24T04:40:44Z","snapshot_observed_at":"2026-08-07T14:57:30.728147Z","submitted_at":"2025-05-22T10:36:05Z","title":"Recursive Offloading for LLM Serving in Multi-tier Networks","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:46.377623Z"},"links":{"citing_paper":"/paper/2505.16502"},"observation_digest":"sha256:bddfbdaa2b7bc2f53c6127bb79bd06f349fbdc698a5030f8a1d171f41e555de7","observation_id":"6766779f-6476-4dfd-865d-f41dc0b30e16","resolution":{"observed_at":"2026-08-07T15:03:58.861224Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15115","last_updated":"2025-01-03T02:18:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-19T17:56:09Z","title":"Qwen2.5 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.15115","snapshot_observed_at":"2026-08-07T15:03:46.472500Z","title":"Qwen2. 5 technical report,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.16502","last_updated":"2025-05-24T04:40:44Z","snapshot_observed_at":"2026-08-07T14:57:30.728147Z","submitted_at":"2025-05-22T10:36:05Z","title":"Recursive Offloading for LLM Serving in Multi-tier Networks","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:46.472500Z"},"links":{"cited_paper":"/paper/2412.15115","citing_paper":"/paper/2505.16502"},"observation_digest":"sha256:ae6527bc7b8fbe22f25b2726c4dac67a7b65ea0a5f59f3407c8a7dfd621e0a72","observation_id":"fe9a6b1a-9ace-4529-9776-56d122b8a1f2","resolution":{"observed_at":"2026-08-07T15:03:46.472500Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:46.665289Z","title":"Bert: Pre-training of deep bidirectional transformers for language understanding,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.16502","last_updated":"2025-05-24T04:40:44Z","snapshot_observed_at":"2026-08-07T14:57:30.728147Z","submitted_at":"2025-05-22T10:36:05Z","title":"Recursive Offloading for LLM Serving in Multi-tier Networks","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:46.665289Z"},"links":{"citing_paper":"/paper/2505.16502"},"observation_digest":"sha256:916084466721e52900d6d16868f9743b044b33218da3161d3579700969f05a6f","observation_id":"fb86c9cc-4413-474c-a201-d1c08b9af139","resolution":{"observed_at":"2026-08-07T15:03:46.665289Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1907.11692","last_updated":"2019-07-26T17:48:29Z","snapshot_observed_at":"2026-07-31T22:31:37.910868Z","submitted_at":"2019-07-26T17:48:29Z","title":"RoBERTa: A Robustly Optimized BERT Pretraining Approach","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1907.11692","snapshot_observed_at":"2026-08-07T15:03:46.801880Z","title":"Roberta: A robustly optimized bert pretraining approach,","venue":null,"work_id":null,"year":1907},"citing_paper":{"arxiv_id":"2505.16502","last_updated":"2025-05-24T04:40:44Z","snapshot_observed_at":"2026-08-07T14:57:30.728147Z","submitted_at":"2025-05-22T10:36:05Z","title":"Recursive Offloading for LLM Serving in Multi-tier Networks","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:46.801880Z"},"links":{"cited_paper":"/paper/1907.11692","citing_paper":"/paper/2505.16502"},"observation_digest":"sha256:89c10a7e6b3d66b47aa2ddf1599ac71bcb6c1b4b50f3681eb78673d41867c563","observation_id":"c4cfdc39-7d1f-4288-9907-06ee40cbe904","resolution":{"observed_at":"2026-08-07T15:03:46.801880Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:46.912356Z","title":"Improving language understanding by generative pre-training,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2505.16502","last_updated":"2025-05-24T04:40:44Z","snapshot_observed_at":"2026-08-07T14:57:30.728147Z","submitted_at":"2025-05-22T10:36:05Z","title":"Recursive Offloading for LLM Serving in Multi-tier Networks","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:46.912356Z"},"links":{"citing_paper":"/paper/2505.16502"},"observation_digest":"sha256:196546b96f4f7ab1c5c0f1ed6605b7fbaa57f1fbc05a5352a9801dfe606f6d19","observation_id":"ea9eb830-3b46-439f-9401-9b178ed6583c","resolution":{"observed_at":"2026-08-07T15:03:46.912356Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:47.026514Z","title":"Lora: Low-rank adaptation of large language models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.16502","last_updated":"2025-05-24T04:40:44Z","snapshot_observed_at":"2026-08-07T14:57:30.728147Z","submitted_at":"2025-05-22T10:36:05Z","title":"Recursive Offloading for LLM Serving in Multi-tier Networks","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:47.026514Z"},"links":{"citing_paper":"/paper/2505.16502"},"observation_digest":"sha256:00a5f3871a68e66a36ecbe42d3a14d6ee8ae87bcdcc7a41c1fcf27c937052a3e","observation_id":"58c05c6f-8467-457d-8f09-7d207f627d5f","resolution":{"observed_at":"2026-08-07T15:03:47.026514Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:47.230760Z","title":"Parameter-efficient transfer learning for nlp,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.16502","last_updated":"2025-05-24T04:40:44Z","snapshot_observed_at":"2026-08-07T14:57:30.728147Z","submitted_at":"2025-05-22T10:36:05Z","title":"Recursive Offloading for LLM Serving in Multi-tier Networks","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:47.230760Z"},"links":{"citing_paper":"/paper/2505.16502"},"observation_digest":"sha256:3df62d5518ef191a0fc0944878266661f20dc1002ab4310f00bfb243dec5cf5c","observation_id":"e5626681-1294-465b-8b1a-5b59e0c4209d","resolution":{"observed_at":"2026-08-07T15:03:47.230760Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:47.377214Z","title":"Training language models to follow instructions with human feedback,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.16502","last_updated":"2025-05-24T04:40:44Z","snapshot_observed_at":"2026-08-07T14:57:30.728147Z","submitted_at":"2025-05-22T10:36:05Z","title":"Recursive Offloading for LLM Serving in Multi-tier Networks","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:47.377214Z"},"links":{"citing_paper":"/paper/2505.16502"},"observation_digest":"sha256:c4f8f9d8716fa0d75c49eec26d5f9483b782306c958840af471cfb4c0c8a384a","observation_id":"12341310-0a32-45ad-85de-817700fec943","resolution":{"observed_at":"2026-08-07T15:03:47.377214Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:47.505628Z","title":"Exploring the limits of transfer learning with a unified text-to-text transformer,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.16502","last_updated":"2025-05-24T04:40:44Z","snapshot_observed_at":"2026-08-07T14:57:30.728147Z","submitted_at":"2025-05-22T10:36:05Z","title":"Recursive Offloading for LLM Serving in Multi-tier Networks","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:47.505628Z"},"links":{"citing_paper":"/paper/2505.16502"},"observation_digest":"sha256:bb54d68ef8cc5fe5792b86c43225b5c29de8eaefa5302459deb8c0fe15bcf75b","observation_id":"1c220965-1093-49be-b32d-13a34c0f0198","resolution":{"observed_at":"2026-08-07T15:03:47.505628Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:58.601135Z","title":"Dis- tributed artificial intelligence empowered by end-edge-cloud computing: A survey,","venue":null,"work_id":"7bb39076-1073-4511-a001-3bd5cb598e21","year":2023},"citing_paper":{"arxiv_id":"2505.16502","last_updated":"2025-05-24T04:40:44Z","snapshot_observed_at":"2026-08-07T14:57:30.728147Z","submitted_at":"2025-05-22T10:36:05Z","title":"Recursive Offloading for LLM Serving in Multi-tier Networks","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:47.669111Z"},"links":{"citing_paper":"/paper/2505.16502"},"observation_digest":"sha256:cdd2f1445cfa25389e82223a7988fbaad328e7de34892def7374dbcf1a8315e4","observation_id":"5649af48-5e9d-4231-9b66-fd765b631585","resolution":{"observed_at":"2026-08-07T15:03:58.634111Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:58.499315Z","title":"Hierarchical federated learning with momentum acceleration in multi-tier networks,","venue":null,"work_id":"233482b2-2b41-45d6-a387-859dc315522a","year":2023},"citing_paper":{"arxiv_id":"2505.16502","last_updated":"2025-05-24T04:40:44Z","snapshot_observed_at":"2026-08-07T14:57:30.728147Z","submitted_at":"2025-05-22T10:36:05Z","title":"Recursive Offloading for LLM Serving in Multi-tier Networks","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:47.806170Z"},"links":{"citing_paper":"/paper/2505.16502"},"observation_digest":"sha256:a9dfb5ca2c23ba5a083f740dfea58e7ed27160a9c98dd3e300c5a5e940909d78","observation_id":"8b4bfa50-169f-45f8-b423-e042506f7d05","resolution":{"observed_at":"2026-08-07T15:03:58.548740Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.00693","last_updated":"2025-01-01T01:11:16Z","snapshot_observed_at":"2026-07-06T20:15:22.511263Z","submitted_at":"2025-01-01T01:11:16Z","title":"Beyond Model Scale Limits: End-Edge-Cloud Federated Learning with Self-Rectified Knowledge Agglomeration","version":1},"cited_work":{"arxiv_id":"2501.00693","doi":null,"metadata_source":"pith","pith_arxiv_id":"2501.00693","snapshot_observed_at":"2026-08-07T15:03:52.666012Z","title":"Beyond Model Scale Limits: End-Edge-Cloud Federated Learning with Self-Rectified Knowledge Agglomeration","venue":"cs.DC","work_id":"704f0f7f-d44b-4d2c-be48-0a824d356c87","year":2025},"citing_paper":{"arxiv_id":"2505.16502","last_updated":"2025-05-24T04:40:44Z","snapshot_observed_at":"2026-08-07T14:57:30.728147Z","submitted_at":"2025-05-22T10:36:05Z","title":"Recursive Offloading for LLM Serving in Multi-tier Networks","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:47.922256Z"},"links":{"cited_paper":"/paper/2501.00693","citing_paper":"/paper/2505.16502"},"observation_digest":"sha256:545a31c88512bfa539edb9e3f5612c25d87f00bbb2d60f7b85718a5392b98e78","observation_id":"24ca8780-8122-4a60-a889-70b24090a5d2","resolution":{"observed_at":"2026-08-07T15:03:52.743891Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:58.320399Z","title":"Edge computing: Vision and challenges,","venue":null,"work_id":"dfc99069-2442-4c4f-8cf2-d6cf57124fc3","year":2016},"citing_paper":{"arxiv_id":"2505.16502","last_updated":"2025-05-24T04:40:44Z","snapshot_observed_at":"2026-08-07T14:57:30.728147Z","submitted_at":"2025-05-22T10:36:05Z","title":"Recursive Offloading for LLM Serving in Multi-tier Networks","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:48.046639Z"},"links":{"citing_paper":"/paper/2505.16502"},"observation_digest":"sha256:4f7434f669e1e621667796c0e8d8dd9da13072ba0396384f866a09ebdaa710b1","observation_id":"7498f6e8-89f6-47e5-ab55-939469e442b5","resolution":{"observed_at":"2026-08-07T15:03:58.405051Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:58.149573Z","title":"Agglomerative federated learning: Empowering larger model training via end-edge-cloud collaboration,","venue":null,"work_id":"2cec9626-7b44-4fb5-9e24-d754d7fdf78c","year":2024},"citing_paper":{"arxiv_id":"2505.16502","last_updated":"2025-05-24T04:40:44Z","snapshot_observed_at":"2026-08-07T14:57:30.728147Z","submitted_at":"2025-05-22T10:36:05Z","title":"Recursive Offloading for LLM Serving in Multi-tier Networks","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:48.155815Z"},"links":{"citing_paper":"/paper/2505.16502"},"observation_digest":"sha256:4b1ef0a6ffc5001856cc882f3b9ac18443acaaaa17d8b06cf1fa65da59621434","observation_id":"d79cd0c6-d67b-4ac0-b065-fef664d5da20","resolution":{"observed_at":"2026-08-07T15:03:58.225478Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:58.015718Z","title":"A survey on task offloading in multi-access edge computing,","venue":null,"work_id":"4202cb75-93c9-44cb-821e-103f6c13ad05","year":2021},"citing_paper":{"arxiv_id":"2505.16502","last_updated":"2025-05-24T04:40:44Z","snapshot_observed_at":"2026-08-07T14:57:30.728147Z","submitted_at":"2025-05-22T10:36:05Z","title":"Recursive Offloading for LLM Serving in Multi-tier Networks","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:48.310107Z"},"links":{"citing_paper":"/paper/2505.16502"},"observation_digest":"sha256:c2a3af00155514d8156fe74f92ad6fd776f5cc030e95a2605410c94021830781","observation_id":"d5acd8c2-7037-4179-90c3-8c00e1c28528","resolution":{"observed_at":"2026-08-07T15:03:58.079500Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:57.902900Z","title":"Task offloading in edge and cloud computing: A survey on mathe- matical, artificial intelligence and control theory solutions,","venue":null,"work_id":"5675eb36-9404-4161-985b-82b96d2bf7c0","year":2021},"citing_paper":{"arxiv_id":"2505.16502","last_updated":"2025-05-24T04:40:44Z","snapshot_observed_at":"2026-08-07T14:57:30.728147Z","submitted_at":"2025-05-22T10:36:05Z","title":"Recursive Offloading for LLM Serving in Multi-tier Networks","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:48.484060Z"},"links":{"citing_paper":"/paper/2505.16502"},"observation_digest":"sha256:7e662297831b8b9d8694016ce39feed74dc03efe09ed773a13e47d7eca49b110","observation_id":"f3e0427c-0e76-44b0-a227-a11d7b708806","resolution":{"observed_at":"2026-08-07T15:03:57.957436Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:48.628574Z","title":"Task offloading strategies for mobile edge computing: A survey,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.16502","last_updated":"2025-05-24T04:40:44Z","snapshot_observed_at":"2026-08-07T14:57:30.728147Z","submitted_at":"2025-05-22T10:36:05Z","title":"Recursive Offloading for LLM Serving in Multi-tier Networks","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:48.628574Z"},"links":{"citing_paper":"/paper/2505.16502"},"observation_digest":"sha256:5cd05b8ab3afb747429bf710ae582baebeea86b76d2690f18d5893cca58654f7","observation_id":"7c44ead7-ea88-496d-9950-d349e5850307","resolution":{"observed_at":"2026-08-07T15:03:48.628574Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2106.04972","last_updated":"2021-06-09T10:37:29Z","snapshot_observed_at":"2026-07-06T11:17:31.238458Z","submitted_at":"2021-06-09T10:37:29Z","title":"Understanding Softmax Confidence and Uncertainty","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.04972","snapshot_observed_at":"2026-08-07T15:03:48.772333Z","title":"Understanding softmax confidence and uncertainty,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.16502","last_updated":"2025-05-24T04:40:44Z","snapshot_observed_at":"2026-08-07T14:57:30.728147Z","submitted_at":"2025-05-22T10:36:05Z","title":"Recursive Offloading for LLM Serving in Multi-tier Networks","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:48.772333Z"},"links":{"cited_paper":"/paper/2106.04972","citing_paper":"/paper/2505.16502"},"observation_digest":"sha256:c37e605f2a9527bd78461d37116161140c9edf921cdeb55168f19f25635fe5a8","observation_id":"e028b19b-8c6a-47f9-ab94-6996b5cbd4db","resolution":{"observed_at":"2026-08-07T15:03:48.772333Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:57.714851Z","title":"Learning word vectors for sentiment analysis,","venue":null,"work_id":"b9bfcd4a-826b-40f9-9efa-fbefdaa02c9a","year":2011},"citing_paper":{"arxiv_id":"2505.16502","last_updated":"2025-05-24T04:40:44Z","snapshot_observed_at":"2026-08-07T14:57:30.728147Z","submitted_at":"2025-05-22T10:36:05Z","title":"Recursive Offloading for LLM Serving in Multi-tier Networks","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:48.886489Z"},"links":{"citing_paper":"/paper/2505.16502"},"observation_digest":"sha256:723da4df110343ed13ebff75f2b5abf0d1bff2ad4050939bf6dfe634344f174d","observation_id":"50ff5842-17b7-4718-ad52-89b3239ddd89","resolution":{"observed_at":"2026-08-07T15:03:57.794122Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:49.045269Z","title":"Recursive deep models for semantic compositionality over a sentiment treebank,","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2505.16502","last_updated":"2025-05-24T04:40:44Z","snapshot_observed_at":"2026-08-07T14:57:30.728147Z","submitted_at":"2025-05-22T10:36:05Z","title":"Recursive Offloading for LLM Serving in Multi-tier Networks","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:49.045269Z"},"links":{"citing_paper":"/paper/2505.16502"},"observation_digest":"sha256:a49c165c9efc17a106096a3ee40620286101b3bba0532837f885301eebbaa991","observation_id":"a41db557-4579-4c35-b173-7ca3378f78da","resolution":{"observed_at":"2026-08-07T15:03:49.045269Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"cs/0506075","last_updated":"2005-06-17T20:10:43Z","snapshot_observed_at":"2026-08-05T01:41:21.910243Z","submitted_at":"2005-06-17T20:10:43Z","title":"Seeing stars: Exploiting class relationships for sentiment categorization with respect to rating scales","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"cs/0506075","snapshot_observed_at":"2026-08-07T15:03:49.182037Z","title":"Seeing stars: Exploiting class relationships for sentiment categorization with respect to rating scales,","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2505.16502","last_updated":"2025-05-24T04:40:44Z","snapshot_observed_at":"2026-08-07T14:57:30.728147Z","submitted_at":"2025-05-22T10:36:05Z","title":"Recursive Offloading for LLM Serving in Multi-tier Networks","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:49.182037Z"},"links":{"cited_paper":"/paper/cs/0506075","citing_paper":"/paper/2505.16502"},"observation_digest":"sha256:5634859e6baca5b8e89ae2374ebf0743c2fd3787255340b4e4574befbfc5730a","observation_id":"d086e3e3-30b7-409b-9f25-e592378d824b","resolution":{"observed_at":"2026-08-07T15:03:49.182037Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:49.300335Z","title":"Character-level convolutional net- works for text classification,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2505.16502","last_updated":"2025-05-24T04:40:44Z","snapshot_observed_at":"2026-08-07T14:57:30.728147Z","submitted_at":"2025-05-22T10:36:05Z","title":"Recursive Offloading for LLM Serving in Multi-tier Networks","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:49.300335Z"},"links":{"citing_paper":"/paper/2505.16502"},"observation_digest":"sha256:24225fe436437f98127799acb3d4daa56cd8c03b70319c323893c3e3f049b2b2","observation_id":"2d962a16-7adf-464c-8e15-e38b2f908de3","resolution":{"observed_at":"2026-08-07T15:03:49.300335Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:57.555013Z","title":"Findings of the 2016 conference on machine translation (wmt16),","venue":null,"work_id":"2321ce0a-4a5c-4d40-8be9-1b113a4f5804","year":2016},"citing_paper":{"arxiv_id":"2505.16502","last_updated":"2025-05-24T04:40:44Z","snapshot_observed_at":"2026-08-07T14:57:30.728147Z","submitted_at":"2025-05-22T10:36:05Z","title":"Recursive Offloading for LLM Serving in Multi-tier Networks","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:49.392173Z"},"links":{"citing_paper":"/paper/2505.16502"},"observation_digest":"sha256:43c018bc4ad44d71166eedfa3b1309542c28aa268f6645490facaae64cc61f11","observation_id":"644c1433-3904-42d3-80d2-597d9476ef17","resolution":{"observed_at":"2026-08-07T15:03:57.639659Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:57.370764Z","title":"Findings of the 2019 conference on machine translation (wmt19)","venue":null,"work_id":"f412b73e-230c-4445-8c33-d15b6d116b28","year":2019},"citing_paper":{"arxiv_id":"2505.16502","last_updated":"2025-05-24T04:40:44Z","snapshot_observed_at":"2026-08-07T14:57:30.728147Z","submitted_at":"2025-05-22T10:36:05Z","title":"Recursive Offloading for LLM Serving in Multi-tier Networks","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:49.470211Z"},"links":{"citing_paper":"/paper/2505.16502"},"observation_digest":"sha256:de186fb529a2a5c5cecfe8736d9a31a091bcd3492fdfcab93c4a58d93277f2d8","observation_id":"c810788b-214c-4344-a706-30a0963994ed","resolution":{"observed_at":"2026-08-07T15:03:57.457477Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:57.268292Z","title":"Parallel data, tools and interfaces in opus","venue":null,"work_id":"720d8ab5-010d-40bc-99b4-f7ffca79576e","year":null},"citing_paper":{"arxiv_id":"2505.16502","last_updated":"2025-05-24T04:40:44Z","snapshot_observed_at":"2026-08-07T14:57:30.728147Z","submitted_at":"2025-05-22T10:36:05Z","title":"Recursive Offloading for LLM Serving in Multi-tier Networks","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:49.550713Z"},"links":{"citing_paper":"/paper/2505.16502"},"observation_digest":"sha256:4b75fa72f2ab5d499221d5e00c873a2636ef2fcb72938c662eb2514a692f6617","observation_id":"76359dcb-60c3-476c-9878-d0486ec53186","resolution":{"observed_at":"2026-08-07T15:03:57.330586Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1910.01108","last_updated":"2020-03-01T02:57:50Z","snapshot_observed_at":"2026-08-07T19:07:36.327251Z","submitted_at":"2019-10-02T17:56:28Z","title":"DistilBERT, a distilled version of BERT: smaller, faster, cheaper and lighter","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1910.01108","snapshot_observed_at":"2026-08-07T15:03:49.730829Z","title":"Distilbert, a dis- tilled version of bert: smaller, faster, cheaper and lighter,","venue":null,"work_id":null,"year":1910},"citing_paper":{"arxiv_id":"2505.16502","last_updated":"2025-05-24T04:40:44Z","snapshot_observed_at":"2026-08-07T14:57:30.728147Z","submitted_at":"2025-05-22T10:36:05Z","title":"Recursive Offloading for LLM Serving in Multi-tier Networks","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:49.730829Z"},"links":{"cited_paper":"/paper/1910.01108","citing_paper":"/paper/2505.16502"},"observation_digest":"sha256:1da6cfee04aeadbd5411ccf9e5a19677d07d09fddd2b1b884d651b5a3ebbfeda","observation_id":"b17ff19c-a4e9-4a96-924d-b442082e52eb","resolution":{"observed_at":"2026-08-07T15:03:49.730829Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:56.841142Z","title":"azizbarank/distilroberta-base-sst2-distilled,","venue":null,"work_id":"3e2d482c-3947-4f05-956b-bb6322d9bd66","year":2022},"citing_paper":{"arxiv_id":"2505.16502","last_updated":"2025-05-24T04:40:44Z","snapshot_observed_at":"2026-08-07T14:57:30.728147Z","submitted_at":"2025-05-22T10:36:05Z","title":"Recursive Offloading for LLM Serving in Multi-tier Networks","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:49.812973Z"},"links":{"citing_paper":"/paper/2505.16502"},"observation_digest":"sha256:6053d04759b4e172420aa0ee824ec4200b796375cc2bb2c3bfb909ec3525ae07","observation_id":"abfb892a-ec6a-4c3c-a302-cd7c306b8f78","resolution":{"observed_at":"2026-08-07T15:03:57.009408Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:56.633610Z","title":"textattack/roberta-base-sst-2,","venue":null,"work_id":"eb545e99-4401-4e23-9f67-7ce3aa6b1754","year":2023},"citing_paper":{"arxiv_id":"2505.16502","last_updated":"2025-05-24T04:40:44Z","snapshot_observed_at":"2026-08-07T14:57:30.728147Z","submitted_at":"2025-05-22T10:36:05Z","title":"Recursive Offloading for LLM Serving in Multi-tier Networks","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:49.895699Z"},"links":{"citing_paper":"/paper/2505.16502"},"observation_digest":"sha256:d2cd60ce154d8a5823938cce22f9f48aea595002cc9c6b79b3be304564d4958e","observation_id":"faa6c4e7-a457-4519-9e99-ed4aa3f18813","resolution":{"observed_at":"2026-08-07T15:03:56.742490Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:56.414880Z","title":"howey/roberta-large-sst2,","venue":null,"work_id":"943d19fb-7962-4a84-b303-3d3c4dd718df","year":2021},"citing_paper":{"arxiv_id":"2505.16502","last_updated":"2025-05-24T04:40:44Z","snapshot_observed_at":"2026-08-07T14:57:30.728147Z","submitted_at":"2025-05-22T10:36:05Z","title":"Recursive Offloading for LLM Serving in Multi-tier Networks","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:49.977530Z"},"links":{"citing_paper":"/paper/2505.16502"},"observation_digest":"sha256:d448b28389b331831860cc5ab75c9e3afbe22780ad5490afd947eef7ee60ad4a","observation_id":"f83a1f93-6742-4685-86a2-ffb062d6c35f","resolution":{"observed_at":"2026-08-07T15:03:56.463202Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:56.216663Z","title":"Sebis/legal t5 small trans de en small finetuned,","venue":null,"work_id":"df21520b-4478-4428-814e-62b19c4790f2","year":2021},"citing_paper":{"arxiv_id":"2505.16502","last_updated":"2025-05-24T04:40:44Z","snapshot_observed_at":"2026-08-07T14:57:30.728147Z","submitted_at":"2025-05-22T10:36:05Z","title":"Recursive Offloading for LLM Serving in Multi-tier Networks","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:50.063646Z"},"links":{"citing_paper":"/paper/2505.16502"},"observation_digest":"sha256:3c00f2ef35d771f3c4cef6ba5901f9fe2b4644676369fcc4e70eb051adf42bfa","observation_id":"9c9cfada-9f57-42cf-98db-346ebbcd0df3","resolution":{"observed_at":"2026-08-07T15:03:56.366919Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:56.050839Z","title":"Opus-mt–building open translation services for the world,","venue":null,"work_id":"168a71d6-8543-4322-a345-401190c77266","year":2020},"citing_paper":{"arxiv_id":"2505.16502","last_updated":"2025-05-24T04:40:44Z","snapshot_observed_at":"2026-08-07T14:57:30.728147Z","submitted_at":"2025-05-22T10:36:05Z","title":"Recursive Offloading for LLM Serving in Multi-tier Networks","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:50.161308Z"},"links":{"citing_paper":"/paper/2505.16502"},"observation_digest":"sha256:33510be00b09601e549e352c23358a48e093e750b25dcbb3cf2c163d14bae3ea","observation_id":"b54a5b9f-2c17-40fc-99ef-6c359ad4ba0c","resolution":{"observed_at":"2026-08-07T15:03:56.108407Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:55.789126Z","title":"Pontifexmaximus/opus-mt-de-en-finetuned-de-to- en,","venue":null,"work_id":"4ed6ef09-3da6-4e4d-92b7-fde2fb46e112","year":2022},"citing_paper":{"arxiv_id":"2505.16502","last_updated":"2025-05-24T04:40:44Z","snapshot_observed_at":"2026-08-07T14:57:30.728147Z","submitted_at":"2025-05-22T10:36:05Z","title":"Recursive Offloading for LLM Serving in Multi-tier Networks","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:50.262501Z"},"links":{"citing_paper":"/paper/2505.16502"},"observation_digest":"sha256:28f5fecb09aa6df4bfda8a942d4ff3037c1b0ecd71e1be37f2f3ff83a3f3177c","observation_id":"9292c553-dba2-423e-98de-40d047a6e4f1","resolution":{"observed_at":"2026-08-07T15:03:55.888601Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2006.10369","last_updated":"2021-06-24T21:46:03Z","snapshot_observed_at":"2026-07-06T09:30:20.579973Z","submitted_at":"2020-06-18T09:06:49Z","title":"Deep Encoder, Shallow Decoder: Reevaluating Non-autoregressive Machine Translation","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2006.10369","snapshot_observed_at":"2026-08-07T15:03:50.344510Z","title":"Deep encoder, shallow decoder: Reevaluating non-autoregressive machine translation,","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2505.16502","last_updated":"2025-05-24T04:40:44Z","snapshot_observed_at":"2026-08-07T14:57:30.728147Z","submitted_at":"2025-05-22T10:36:05Z","title":"Recursive Offloading for LLM Serving in Multi-tier Networks","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:50.344510Z"},"links":{"cited_paper":"/paper/2006.10369","citing_paper":"/paper/2505.16502"},"observation_digest":"sha256:c57a61e2c526330f1742875c1296c8a2d646862393df9232e3135f295dfc7a58","observation_id":"e857de65-69ad-4263-bc05-f6268e0d4b55","resolution":{"observed_at":"2026-08-07T15:03:50.344510Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:55.635418Z","title":"allenai/wmt19-de-en-6-6-big,","venue":null,"work_id":"e1ad7592-e1f3-4f47-a2d7-5f572338e232","year":2023},"citing_paper":{"arxiv_id":"2505.16502","last_updated":"2025-05-24T04:40:44Z","snapshot_observed_at":"2026-08-07T14:57:30.728147Z","submitted_at":"2025-05-22T10:36:05Z","title":"Recursive Offloading for LLM Serving in Multi-tier Networks","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:50.420942Z"},"links":{"citing_paper":"/paper/2505.16502"},"observation_digest":"sha256:33ee588450edbb5584fc00dd251f3889ec63abc8ac9eba28cb7c48c02a3cd6e5","observation_id":"4765dce9-ccd9-41b7-aa69-89c984321c81","resolution":{"observed_at":"2026-08-07T15:03:55.739142Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:55.446522Z","title":"Gemel: Model merging for {Memory-Efficient},{Real-Time}video analytics at the edge,","venue":null,"work_id":"fed7625e-0d67-424d-9e11-75240e456744","year":2023},"citing_paper":{"arxiv_id":"2505.16502","last_updated":"2025-05-24T04:40:44Z","snapshot_observed_at":"2026-08-07T14:57:30.728147Z","submitted_at":"2025-05-22T10:36:05Z","title":"Recursive Offloading for LLM Serving in Multi-tier Networks","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:50.473051Z"},"links":{"citing_paper":"/paper/2505.16502"},"observation_digest":"sha256:7ae2ec7e182b32ed04794557b252524cee3a5407d76437029d05797894b09e97","observation_id":"b6183f22-00e6-4fe2-8953-06717bf382c4","resolution":{"observed_at":"2026-08-07T15:03:55.514483Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2006.03654","last_updated":"2021-10-06T21:02:00Z","snapshot_observed_at":"2026-07-06T09:26:29.068023Z","submitted_at":"2020-06-05T19:54:34Z","title":"DeBERTa: Decoding-enhanced BERT with Disentangled Attention","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2006.03654","snapshot_observed_at":"2026-08-07T15:03:50.529765Z","title":"Deberta: Decoding-enhanced bert with disentangled attention,","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2505.16502","last_updated":"2025-05-24T04:40:44Z","snapshot_observed_at":"2026-08-07T14:57:30.728147Z","submitted_at":"2025-05-22T10:36:05Z","title":"Recursive Offloading for LLM Serving in Multi-tier Networks","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:50.529765Z"},"links":{"cited_paper":"/paper/2006.03654","citing_paper":"/paper/2505.16502"},"observation_digest":"sha256:c2acb49f0a94c97afedc9e4c026efb7a3bf403e4230cc34947e4d4321998f523","observation_id":"d1c3d795-ab01-44e4-89d7-028df13f9543","resolution":{"observed_at":"2026-08-07T15:03:50.529765Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:55.337820Z","title":"Tomor0720/deberta-large-finetuned-sst2,","venue":null,"work_id":"1d49aa4b-1477-43cb-a807-a4da709239c9","year":2023},"citing_paper":{"arxiv_id":"2505.16502","last_updated":"2025-05-24T04:40:44Z","snapshot_observed_at":"2026-08-07T14:57:30.728147Z","submitted_at":"2025-05-22T10:36:05Z","title":"Recursive Offloading for LLM Serving in Multi-tier Networks","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:50.635440Z"},"links":{"citing_paper":"/paper/2505.16502"},"observation_digest":"sha256:096caf56179cfd6109999de3f3f0013ca7d9dfed70051de59b1b525c723ba4fd","observation_id":"05c6f0af-f7d8-4661-9b62-3ae1d5606e2f","resolution":{"observed_at":"2026-08-07T15:03:55.429155Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-07T15:03:50.721809Z","title":"Gpt-4 technical report,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.16502","last_updated":"2025-05-24T04:40:44Z","snapshot_observed_at":"2026-08-07T14:57:30.728147Z","submitted_at":"2025-05-22T10:36:05Z","title":"Recursive Offloading for LLM Serving in Multi-tier Networks","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:50.721809Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2505.16502"},"observation_digest":"sha256:61d6a0a006e898c8e2b1de0f5893481f6a01f4a1de8d5d8eb9df067a1523096a","observation_id":"e86dc02c-bc97-4a77-9ec9-436605c31069","resolution":{"observed_at":"2026-08-07T15:03:50.721809Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:50.796322Z","title":"Putting gpt-4o to the sword: A comprehensive evaluation of language, vision, speech, and multimodal proficiency,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.16502","last_updated":"2025-05-24T04:40:44Z","snapshot_observed_at":"2026-08-07T14:57:30.728147Z","submitted_at":"2025-05-22T10:36:05Z","title":"Recursive Offloading for LLM Serving in Multi-tier Networks","version":2},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:50.796322Z"},"links":{"citing_paper":"/paper/2505.16502"},"observation_digest":"sha256:7c27d85e17782d5bbf24ce39c41dbc1156648f52d4bc71804251bb5bbf9e98ae","observation_id":"d5d12da1-b643-48a1-9c95-66f896bba4b2","resolution":{"observed_at":"2026-08-07T15:03:50.796322Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:54.905920Z","title":"The Claude 3 Model Family: Opus, Sonnet, Haiku,","venue":null,"work_id":"98fb8694-0fa9-4092-aa8e-68180be2a876","year":2024},"citing_paper":{"arxiv_id":"2505.16502","last_updated":"2025-05-24T04:40:44Z","snapshot_observed_at":"2026-08-07T14:57:30.728147Z","submitted_at":"2025-05-22T10:36:05Z","title":"Recursive Offloading for LLM Serving in Multi-tier Networks","version":2},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:50.874277Z"},"links":{"citing_paper":"/paper/2505.16502"},"observation_digest":"sha256:f5fb0006357ca53cb3707f9ff7aec4600434914e0f1389e3720b763219ab783e","observation_id":"bbf8a3ca-0a4f-473d-880c-27067a4db531","resolution":{"observed_at":"2026-08-07T15:03:55.111327Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:54.577559Z","title":"Claude 3-5 sonnet,","venue":null,"work_id":"bd2acc32-fbb8-4bd6-8284-2e9ff0464117","year":2024},"citing_paper":{"arxiv_id":"2505.16502","last_updated":"2025-05-24T04:40:44Z","snapshot_observed_at":"2026-08-07T14:57:30.728147Z","submitted_at":"2025-05-22T10:36:05Z","title":"Recursive Offloading for LLM Serving in Multi-tier Networks","version":2},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:50.968172Z"},"links":{"citing_paper":"/paper/2505.16502"},"observation_digest":"sha256:4308fe43b11923871d26a3d033ce553858e63754f1772d86c0e65d62bcfd3479","observation_id":"5854e7ee-e521-4dff-95e9-96367edc2c60","resolution":{"observed_at":"2026-08-07T15:03:54.762321Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:54.355202Z","title":"Claude 3.7 sonnet and claude code,","venue":null,"work_id":"f001d005-7296-4f00-826a-69ba46b9db43","year":2025},"citing_paper":{"arxiv_id":"2505.16502","last_updated":"2025-05-24T04:40:44Z","snapshot_observed_at":"2026-08-07T14:57:30.728147Z","submitted_at":"2025-05-22T10:36:05Z","title":"Recursive Offloading for LLM Serving in Multi-tier Networks","version":2},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:51.039529Z"},"links":{"citing_paper":"/paper/2505.16502"},"observation_digest":"sha256:0be44ff41ae3fb2d9d7f5b92a51e433c144e169fe14d813065a775a43c4a75b9","observation_id":"cca37d4c-788b-44c7-a2e9-801bb86db430","resolution":{"observed_at":"2026-08-07T15:03:54.450330Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13971","last_updated":"2023-02-27T17:11:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-27T17:11:15Z","title":"LLaMA: Open and Efficient Foundation Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.13971","snapshot_observed_at":"2026-08-07T15:03:51.107687Z","title":"Llama: Open and efficient foundation language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.16502","last_updated":"2025-05-24T04:40:44Z","snapshot_observed_at":"2026-08-07T14:57:30.728147Z","submitted_at":"2025-05-22T10:36:05Z","title":"Recursive Offloading for LLM Serving in Multi-tier Networks","version":2},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:51.107687Z"},"links":{"cited_paper":"/paper/2302.13971","citing_paper":"/paper/2505.16502"},"observation_digest":"sha256:2bd689d9ed3340339f141b7bad57ea2a0222f0bc35d37ff88106934c8ad71d15","observation_id":"d8ba2b18-6304-48f0-bf8e-23f17f8cbaba","resolution":{"observed_at":"2026-08-07T15:03:51.107687Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09288","last_updated":"2023-07-19T17:08:59Z","snapshot_observed_at":"2026-08-07T12:56:43.323460Z","submitted_at":"2023-07-18T14:31:57Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.09288","snapshot_observed_at":"2026-08-07T15:03:51.183361Z","title":"Llama 2: Open foundation and fine-tuned chat models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.16502","last_updated":"2025-05-24T04:40:44Z","snapshot_observed_at":"2026-08-07T14:57:30.728147Z","submitted_at":"2025-05-22T10:36:05Z","title":"Recursive Offloading for LLM Serving in Multi-tier Networks","version":2},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:51.183361Z"},"links":{"cited_paper":"/paper/2307.09288","citing_paper":"/paper/2505.16502"},"observation_digest":"sha256:f2cdf88d30c0204ee01aca8a55fb3bdc65aec74403f3bb37732f54f3626fddf5","observation_id":"2b94d8ab-70a8-4f73-bd57-255881fb89c5","resolution":{"observed_at":"2026-08-07T15:03:51.183361Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-07T15:03:51.256940Z","title":"The llama 3 herd of models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.16502","last_updated":"2025-05-24T04:40:44Z","snapshot_observed_at":"2026-08-07T14:57:30.728147Z","submitted_at":"2025-05-22T10:36:05Z","title":"Recursive Offloading for LLM Serving in Multi-tier Networks","version":2},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:51.256940Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2505.16502"},"observation_digest":"sha256:e7e47cd33e16a419ad5b06454d5e458e43092d0009bdc1b513ee56a63cc939e4","observation_id":"e501c481-cb94-45b0-9066-3f23633dc684","resolution":{"observed_at":"2026-08-07T15:03:51.256940Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.16609","last_updated":"2023-09-28T17:07:49Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-09-28T17:07:49Z","title":"Qwen Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.16609","snapshot_observed_at":"2026-08-07T15:03:51.360812Z","title":"Qwen technical report,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.16502","last_updated":"2025-05-24T04:40:44Z","snapshot_observed_at":"2026-08-07T14:57:30.728147Z","submitted_at":"2025-05-22T10:36:05Z","title":"Recursive Offloading for LLM Serving in Multi-tier Networks","version":2},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:51.360812Z"},"links":{"cited_paper":"/paper/2309.16609","citing_paper":"/paper/2505.16502"},"observation_digest":"sha256:9462a2a6ff0109e340fbcd3e6d93e729056f259f380775ec9e2c574917258a47","observation_id":"9462e46a-9ba2-4910-b1f4-b9eb2df5a1ab","resolution":{"observed_at":"2026-08-07T15:03:51.360812Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12191","last_updated":"2024-10-03T15:54:49Z","snapshot_observed_at":"2026-08-06T05:35:29.109022Z","submitted_at":"2024-09-18T17:59:32Z","title":"Qwen2-VL: Enhancing Vision-Language Model's Perception of the World at Any Resolution","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.12191","snapshot_observed_at":"2026-08-07T15:03:51.435759Z","title":"Qwen2-vl: Enhancing vision-language model’s perception of the world at any resolution,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.16502","last_updated":"2025-05-24T04:40:44Z","snapshot_observed_at":"2026-08-07T14:57:30.728147Z","submitted_at":"2025-05-22T10:36:05Z","title":"Recursive Offloading for LLM Serving in Multi-tier Networks","version":2},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:51.435759Z"},"links":{"cited_paper":"/paper/2409.12191","citing_paper":"/paper/2505.16502"},"observation_digest":"sha256:ddc04baf01bcba02bfb32a35872c821676d7f350abf318168916fa87a25acdde","observation_id":"4ee98247-1b6a-4d6a-8084-0fd014632580","resolution":{"observed_at":"2026-08-07T15:03:51.435759Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.13923","last_updated":"2025-02-19T18:00:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-19T18:00:14Z","title":"Qwen2.5-VL Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.13923","snapshot_observed_at":"2026-08-07T15:03:51.520129Z","title":"Qwen2. 5-vl technical report,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.16502","last_updated":"2025-05-24T04:40:44Z","snapshot_observed_at":"2026-08-07T14:57:30.728147Z","submitted_at":"2025-05-22T10:36:05Z","title":"Recursive Offloading for LLM Serving in Multi-tier Networks","version":2},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:51.520129Z"},"links":{"cited_paper":"/paper/2502.13923","citing_paper":"/paper/2505.16502"},"observation_digest":"sha256:cb6bab5c630bba5501e9467d7eb999afd873eec3d6009fa7a868d39a8a009a75","observation_id":"dc962322-2ba3-459b-a789-cfcb3b29694f","resolution":{"observed_at":"2026-08-07T15:03:51.520129Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:51.604475Z","title":"Efficient memory management for large language model serving with pagedattention,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.16502","last_updated":"2025-05-24T04:40:44Z","snapshot_observed_at":"2026-08-07T14:57:30.728147Z","submitted_at":"2025-05-22T10:36:05Z","title":"Recursive Offloading for LLM Serving in Multi-tier Networks","version":2},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:51.604475Z"},"links":{"citing_paper":"/paper/2505.16502"},"observation_digest":"sha256:8a3a30c847d9d5b64624a83374de6482e6a0df2eae22a02eaa5498b6d5ea0508","observation_id":"adb9f63f-b204-4a52-b8ed-c4647ff9b2ba","resolution":{"observed_at":"2026-08-07T15:03:51.604475Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:54.012942Z","title":"Cachegen: Kv cache compression and streaming for fast large language model serving,","venue":null,"work_id":"cb19cee1-9bfd-41a1-ad6d-b04e16bd7be5","year":2024},"citing_paper":{"arxiv_id":"2505.16502","last_updated":"2025-05-24T04:40:44Z","snapshot_observed_at":"2026-08-07T14:57:30.728147Z","submitted_at":"2025-05-22T10:36:05Z","title":"Recursive Offloading for LLM Serving in Multi-tier Networks","version":2},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:51.710780Z"},"links":{"citing_paper":"/paper/2505.16502"},"observation_digest":"sha256:f026b67e8159c7e2bac17891f8ac85ca3720c748bba26016e56d2a0285d010c7","observation_id":"2e7b4652-3994-40c7-9abe-4ca620038cee","resolution":{"observed_at":"2026-08-07T15:03:54.209398Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:53.651698Z","title":"Adainf: Data drift adaptive scheduling for accurate and slo-guaranteed multiple-model inference serving at edge servers,","venue":null,"work_id":"2091771c-d682-492d-8f4c-bcb6155bce96","year":2023},"citing_paper":{"arxiv_id":"2505.16502","last_updated":"2025-05-24T04:40:44Z","snapshot_observed_at":"2026-08-07T14:57:30.728147Z","submitted_at":"2025-05-22T10:36:05Z","title":"Recursive Offloading for LLM Serving in Multi-tier Networks","version":2},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:51.810104Z"},"links":{"citing_paper":"/paper/2505.16502"},"observation_digest":"sha256:d886c30db608dfc23058312e1698f2bac4a5a212987639be95662e60f3450889","observation_id":"cd4f0e96-b6b5-4ba1-aa84-3a8179b0922f","resolution":{"observed_at":"2026-08-07T15:03:53.821441Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:51.901960Z","title":"Edgeshard: Efficient llm inference via collaborative edge computing,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.16502","last_updated":"2025-05-24T04:40:44Z","snapshot_observed_at":"2026-08-07T14:57:30.728147Z","submitted_at":"2025-05-22T10:36:05Z","title":"Recursive Offloading for LLM Serving in Multi-tier Networks","version":2},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:51.901960Z"},"links":{"citing_paper":"/paper/2505.16502"},"observation_digest":"sha256:1693cb0dc85d6f636a0613e601ba035f240aca11b8aab5f2dc536ef6ceaa75ee","observation_id":"4fe8b1ef-c62d-48d2-8650-553ec3a0855d","resolution":{"observed_at":"2026-08-07T15:03:51.901960Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:51.968328Z","title":"Split computing and early exiting for deep learning applications: Survey and research challenges,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.16502","last_updated":"2025-05-24T04:40:44Z","snapshot_observed_at":"2026-08-07T14:57:30.728147Z","submitted_at":"2025-05-22T10:36:05Z","title":"Recursive Offloading for LLM Serving in Multi-tier Networks","version":2},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:51.968328Z"},"links":{"citing_paper":"/paper/2505.16502"},"observation_digest":"sha256:f703306d86f9bcf25933d4cce32fdbca6872dd50a8ef0df523af0f862d6de880","observation_id":"9c7e2b42-09b1-4672-8340-663fd9cfb39d","resolution":{"observed_at":"2026-08-07T15:03:51.968328Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:53.308383Z","title":"Dis- tributed inference acceleration with adaptive dnn partitioning and of- floading,","venue":null,"work_id":"e4cd282f-437b-45c1-bc67-c97a6ea9f34c","year":2020},"citing_paper":{"arxiv_id":"2505.16502","last_updated":"2025-05-24T04:40:44Z","snapshot_observed_at":"2026-08-07T14:57:30.728147Z","submitted_at":"2025-05-22T10:36:05Z","title":"Recursive Offloading for LLM Serving in Multi-tier Networks","version":2},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:52.045842Z"},"links":{"citing_paper":"/paper/2505.16502"},"observation_digest":"sha256:6c3fa3fcb0dfd32b07777f97b5158d22a8c4c0b2b87f8a141584b52a066c3002","observation_id":"c50d12ed-c54a-421a-9e63-e26fc72b7154","resolution":{"observed_at":"2026-08-07T15:03:53.468802Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:52.125851Z","title":"Mandheling: Mixed-precision on-device dnn training with dsp offloading,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.16502","last_updated":"2025-05-24T04:40:44Z","snapshot_observed_at":"2026-08-07T14:57:30.728147Z","submitted_at":"2025-05-22T10:36:05Z","title":"Recursive Offloading for LLM Serving in Multi-tier Networks","version":2},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:52.125851Z"},"links":{"citing_paper":"/paper/2505.16502"},"observation_digest":"sha256:3e62a5566d8a6d8208ebf83159814713fa24c6c9f9852fea2f07624bdf07f2c4","observation_id":"e66fac22-0b0a-440f-a0d2-c7a7eeb044e9","resolution":{"observed_at":"2026-08-07T15:03:52.125851Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.04992","last_updated":"2024-09-08T06:06:44Z","snapshot_observed_at":"2026-08-03T16:41:00.102590Z","submitted_at":"2024-09-08T06:06:44Z","title":"InstInfer: In-Storage Attention Offloading for Cost-Effective Long-Context LLM Inference","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.04992","snapshot_observed_at":"2026-08-07T15:03:52.186188Z","title":"Instinfer: In-storage attention offloading for cost-effective long-context llm inference,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.16502","last_updated":"2025-05-24T04:40:44Z","snapshot_observed_at":"2026-08-07T14:57:30.728147Z","submitted_at":"2025-05-22T10:36:05Z","title":"Recursive Offloading for LLM Serving in Multi-tier Networks","version":2},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:52.186188Z"},"links":{"cited_paper":"/paper/2409.04992","citing_paper":"/paper/2505.16502"},"observation_digest":"sha256:66055da898f6f9c34676d106d3231dae868d7ae2d6d96102893565e6936404e7","observation_id":"3cc82a1b-c19a-45d0-89b6-ae7e0ea360c1","resolution":{"observed_at":"2026-08-07T15:03:52.186188Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:57.076151Z","title":"2214–2218","venue":null,"work_id":"7ce47c37-319d-434d-92c1-7444018db800","year":2012},"citing_paper":{"arxiv_id":"2505.16502","last_updated":"2025-05-24T04:40:44Z","snapshot_observed_at":"2026-08-07T14:57:30.728147Z","submitted_at":"2025-05-22T10:36:05Z","title":"Recursive Offloading for LLM Serving in Multi-tier Networks","version":2},"reference_index":2012,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:49.645404Z"},"links":{"citing_paper":"/paper/2505.16502"},"observation_digest":"sha256:daf1a2f02f0b8bf4169e98809c2155b473d1ca9be5db7c5e7cd67592e276239c","observation_id":"9e56c931-8188-465b-b194-e9f95a871d55","resolution":{"observed_at":"2026-08-07T15:03:57.110516Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:53.014712Z","title":"He was a Visiting Researcher with the School of Com- puting and Communications at Lancaster University, Lancaster, UK from 2018 to 2019","venue":null,"work_id":"47f78385-deac-49fc-b9f5-e665e5101b41","year":2014},"citing_paper":{"arxiv_id":"2505.16502","last_updated":"2025-05-24T04:40:44Z","snapshot_observed_at":"2026-08-07T14:57:30.728147Z","submitted_at":"2025-05-22T10:36:05Z","title":"Recursive Offloading for LLM Serving in Multi-tier Networks","version":2},"reference_index":2014,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:52.273544Z"},"links":{"citing_paper":"/paper/2505.16502"},"observation_digest":"sha256:00aae94fbf6ce9e0bc1af231d594f3dabf849fa4f39770cbdc63f784a41c9fed","observation_id":"0b2908a0-dcd3-44e7-8f4b-0bc1549d2200","resolution":{"observed_at":"2026-08-07T15:03:53.133444Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2505.16502","last_updated":"2025-05-24T04:40:44Z","latest_version":2,"primary_category":"cs.DC","snapshot_observed_at":"2026-08-07T14:57:30.728147Z","submitted_at":"2025-05-22T10:36:05Z","title":"Recursive Offloading for LLM Serving in Multi-tier Networks"},"reference_resolution":{"displayed":73,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":41,"verified_exact":1,"verified_fuzzy":31},"total_outbound_references":73},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 73 of 73 outbound references and 0 inbound Pith citation observations for arXiv:2505.16502."}