{"as_of":"2026-08-04T12:21:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:57c37f078aa601f7423095b9041fe94df719f0468ffb6a5c2ab3cfb38803387e","coverage":[{"denominator":214,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":100,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-08T09:45:57.201837Z","state":"measured"},{"denominator":101,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":101,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-04T06:34:03.388597+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-01T10:14:12.873655Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2604.22906","last_updated":"2026-04-24T16:56:53Z","snapshot_observed_at":"2026-07-06T23:09:14.698490Z","submitted_at":"2026-04-24T16:56:53Z","title":"Network Edge Inference for Large Language Models: Principles, Techniques, and Opportunities","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.22906","snapshot_observed_at":"2026-08-01T10:14:12.873655Z","title":"arXiv:2604.22906","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.20327","last_updated":"2026-07-22T16:14:26Z","snapshot_observed_at":"2026-08-03T18:12:07.254553Z","submitted_at":"2026-07-22T16:14:26Z","title":"PyroDash: Cost-Efficient Token-Level Small-Large Language Model Collaborative Inference","version":1},"reference_index":2026,"source":"pdf_text","source_observed_at":"2026-08-01T10:14:12.873655Z"},"links":{"cited_paper":"/paper/2604.22906","citing_paper":"/paper/2607.20327"},"observation_digest":"sha256:5be17ccd255a6137457a8fbbaa5c2ac1472e96fdc80f7c8183d24e4ef4e5112e","observation_id":"3a15f6de-1c3f-45dc-a32c-53193cb650e6","resolution":{"observed_at":"2026-08-01T10:14:12.873655Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2604.22906/citation-record","integrity":"/paper/2604.22906/integrity","json":"/paper/2604.22906/citation-record.json","paper":"/paper/2604.22906"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.03763","last_updated":"2025-04-21T00:21:08Z","snapshot_observed_at":"2026-08-04T06:10:04.409613Z","submitted_at":"2025-04-21T00:21:08Z","title":"Splitwiser: Efficient LM inference with constrained resources","version":1},"cited_work":{"arxiv_id":"2505.03763","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.03763","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"6e35bc60-d3d5-42b8-806b-f2e162fb0227","year":2025},"citing_paper":{"arxiv_id":"2604.22906","last_updated":"2026-04-24T16:56:53Z","snapshot_observed_at":"2026-07-06T23:09:14.698490Z","submitted_at":"2026-04-24T16:56:53Z","title":"Network Edge Inference for Large Language Models: Principles, Techniques, and Opportunities","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-08T09:45:57.201837Z"},"links":{"cited_paper":"/paper/2505.03763","citing_paper":"/paper/2604.22906"},"observation_digest":"sha256:30d43180a96d2967de20834eaef7d3f2a9b020f66edd56428e6b56426a040dae","observation_id":"e872bdb5-5124-45db-a663-0c4bec173868","resolution":{"observed_at":"2026-05-11T20:16:10.405665Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.08905","last_updated":"2024-12-12T03:37:41Z","snapshot_observed_at":"2026-08-02T08:41:10.128841Z","submitted_at":"2024-12-12T03:37:41Z","title":"Phi-4 Technical Report","version":1},"cited_work":{"arxiv_id":"2412.08905","doi":"10.48550/arxiv.2412.08905","metadata_source":"pith","pith_arxiv_id":"2412.08905","snapshot_observed_at":"2026-07-11T00:47:43.055842Z","title":"Phi-4 Technical Report","venue":"cs.CL","work_id":"b6274271-7af9-4ee8-993b-ba1ba4205ba8","year":2024},"citing_paper":{"arxiv_id":"2604.22906","last_updated":"2026-04-24T16:56:53Z","snapshot_observed_at":"2026-07-06T23:09:14.698490Z","submitted_at":"2026-04-24T16:56:53Z","title":"Network Edge Inference for Large Language Models: Principles, Techniques, and Opportunities","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-08T09:45:57.201837Z"},"links":{"cited_paper":"/paper/2412.08905","citing_paper":"/paper/2604.22906"},"observation_digest":"sha256:5b4bd57a3c4037d5ccff060b963c91b9239e096891f44d73a2c2f0d602777d17","observation_id":"8bd69898-d6fc-4bd3-88cb-2dbe1fbcac68","resolution":{"observed_at":"2026-05-11T20:16:10.429801Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-02T03:08:11.323957+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-02T03:08:11.323957+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"17dedc31-3870-4627-a979-b2ebe2a1e509","year":null},"citing_paper":{"arxiv_id":"2604.22906","last_updated":"2026-04-24T16:56:53Z","snapshot_observed_at":"2026-07-06T23:09:14.698490Z","submitted_at":"2026-04-24T16:56:53Z","title":"Network Edge Inference for Large Language Models: Principles, Techniques, and Opportunities","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-08T09:45:57.201837Z"},"links":{"citing_paper":"/paper/2604.22906"},"observation_digest":"sha256:88ac9bf38d6296966f15806652a61f24146a5e15c166c1118f446e8a98927707","observation_id":"3982b002-8817-4ca6-937a-b0ea580bab6a","resolution":{"observed_at":"2026-05-26T15:47:59.293512Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":"2303.08774","doi":"10.1002/tea.20265","metadata_source":"pith","pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"GPT-4 Technical Report","venue":"cs.CL","work_id":"b928e041-6991-4c08-8c81-0359e4097c7b","year":2023},"citing_paper":{"arxiv_id":"2604.22906","last_updated":"2026-04-24T16:56:53Z","snapshot_observed_at":"2026-07-06T23:09:14.698490Z","submitted_at":"2026-04-24T16:56:53Z","title":"Network Edge Inference for Large Language Models: Principles, Techniques, and Opportunities","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-08T09:45:57.201837Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2604.22906"},"observation_digest":"sha256:04b564d68cd95ecff14cc6ab737c9a4008e073f6f461d0a0bcc36ec503324a77","observation_id":"299fabb1-1513-4e6b-b956-d2ea431c236f","resolution":{"observed_at":"2026-05-11T20:16:10.544177Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"720af932-74c0-40d1-8a61-f854177ca574","year":2024},"citing_paper":{"arxiv_id":"2604.22906","last_updated":"2026-04-24T16:56:53Z","snapshot_observed_at":"2026-07-06T23:09:14.698490Z","submitted_at":"2026-04-24T16:56:53Z","title":"Network Edge Inference for Large Language Models: Principles, Techniques, and Opportunities","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-08T09:45:57.201837Z"},"links":{"citing_paper":"/paper/2604.22906"},"observation_digest":"sha256:6357384206ba24fac06161adfa7ec02c44843dc186f1b08773a4642a43d3383f","observation_id":"cbd4309c-ed1e-4bcc-9564-9327904dd0ce","resolution":{"observed_at":"2026-05-26T15:47:59.305549Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"4d18de57-4efe-4f35-a49a-14d12f5081b7","year":2019},"citing_paper":{"arxiv_id":"2604.22906","last_updated":"2026-04-24T16:56:53Z","snapshot_observed_at":"2026-07-06T23:09:14.698490Z","submitted_at":"2026-04-24T16:56:53Z","title":"Network Edge Inference for Large Language Models: Principles, Techniques, and Opportunities","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-08T09:45:57.201837Z"},"links":{"citing_paper":"/paper/2604.22906"},"observation_digest":"sha256:b176ffeb2b551c125958742728380c354ddf6cce85333628e27b531607c37cd8","observation_id":"421fc78d-c779-4dc2-9371-cc94f078d4d3","resolution":{"observed_at":"2026-05-26T15:47:59.516051Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"8d92cebd-d73e-47f2-984f-2a31862936cf","year":2017},"citing_paper":{"arxiv_id":"2604.22906","last_updated":"2026-04-24T16:56:53Z","snapshot_observed_at":"2026-07-06T23:09:14.698490Z","submitted_at":"2026-04-24T16:56:53Z","title":"Network Edge Inference for Large Language Models: Principles, Techniques, and Opportunities","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-08T09:45:57.201837Z"},"links":{"citing_paper":"/paper/2604.22906"},"observation_digest":"sha256:b9f69922f3a462c496cb723fd7cd46e1cd0a082b78d68e0a98171a971ed36497","observation_id":"f1f3d5c2-77c5-406c-8f3b-e134f9ce17d9","resolution":{"observed_at":"2026-05-26T15:47:59.447864Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"3c088bf0-55a5-4be4-988a-f9ad27655640","year":2024},"citing_paper":{"arxiv_id":"2604.22906","last_updated":"2026-04-24T16:56:53Z","snapshot_observed_at":"2026-07-06T23:09:14.698490Z","submitted_at":"2026-04-24T16:56:53Z","title":"Network Edge Inference for Large Language Models: Principles, Techniques, and Opportunities","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-08T09:45:57.201837Z"},"links":{"citing_paper":"/paper/2604.22906"},"observation_digest":"sha256:8ea8c7ae9c744e57342b6877dcbc227fe63b42d1f2597a143bf98b94f58411fa","observation_id":"44220b7a-354c-4db9-8386-792e2a0de652","resolution":{"observed_at":"2026-05-26T15:47:59.453744Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2108.07732","last_updated":"2021-08-16T03:57:30Z","snapshot_observed_at":"2026-08-02T19:23:53.535075Z","submitted_at":"2021-08-16T03:57:30Z","title":"Program Synthesis with Large Language Models","version":1},"cited_work":{"arxiv_id":"2108.07732","doi":"10.1007/s11390-025-5518-5","metadata_source":"pith","pith_arxiv_id":"2108.07732","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Program Synthesis with Large Language Models","venue":"cs.PL","work_id":"fd241a05-03b9-4de2-9588-9d77ce176125","year":2021},"citing_paper":{"arxiv_id":"2604.22906","last_updated":"2026-04-24T16:56:53Z","snapshot_observed_at":"2026-07-06T23:09:14.698490Z","submitted_at":"2026-04-24T16:56:53Z","title":"Network Edge Inference for Large Language Models: Principles, Techniques, and Opportunities","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-08T09:45:57.201837Z"},"links":{"cited_paper":"/paper/2108.07732","citing_paper":"/paper/2604.22906"},"observation_digest":"sha256:00b1587f07d5607322de212c14753410993ad06b7631c984a67cac625028830a","observation_id":"0e8bfe49-e1ce-4cdb-acb7-fc3c7fd67785","resolution":{"observed_at":"2026-05-11T20:16:10.249824Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.00625","last_updated":"2024-12-29T17:38:32Z","snapshot_observed_at":"2026-08-03T07:09:22.905094Z","submitted_at":"2024-01-01T01:12:42Z","title":"Beyond Efficiency: A Systematic Survey of Resource-Efficient Large Language Models","version":4},"cited_work":{"arxiv_id":"2401.00625","doi":"10.48550/arxiv.2401.00625","metadata_source":"arxiv_reference","pith_arxiv_id":"2401.00625","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Beyond efficiency: A systematic survey of resource-efficient large language models","venue":null,"work_id":"5aad8b00-adae-4d93-b605-916d638c9d99","year":2024},"citing_paper":{"arxiv_id":"2604.22906","last_updated":"2026-04-24T16:56:53Z","snapshot_observed_at":"2026-07-06T23:09:14.698490Z","submitted_at":"2026-04-24T16:56:53Z","title":"Network Edge Inference for Large Language Models: Principles, Techniques, and Opportunities","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-08T09:45:57.201837Z"},"links":{"cited_paper":"/paper/2401.00625","citing_paper":"/paper/2604.22906"},"observation_digest":"sha256:462e865e51b434b09426038ddb7e31b0ad8f883aad1e304d24598a0ad563425d","observation_id":"cf5a809b-9aa4-471f-9f38-38d911cc4597","resolution":{"observed_at":"2026-05-11T20:16:10.414840Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"cdf8283f-ce74-4d08-9c59-a45aeeb5e681","year":2021},"citing_paper":{"arxiv_id":"2604.22906","last_updated":"2026-04-24T16:56:53Z","snapshot_observed_at":"2026-07-06T23:09:14.698490Z","submitted_at":"2026-04-24T16:56:53Z","title":"Network Edge Inference for Large Language Models: Principles, Techniques, and Opportunities","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-08T09:45:57.201837Z"},"links":{"citing_paper":"/paper/2604.22906"},"observation_digest":"sha256:e925a96ee777b03218e953cab0e41f9fd49b3edca91faa43b274508cd6abab50","observation_id":"d7b45755-241d-4d24-a354-ad80e3fe41e4","resolution":{"observed_at":"2026-05-26T15:47:59.468752Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"79bf9372-4077-4966-8eb9-452647e6e49d","year":2024},"citing_paper":{"arxiv_id":"2604.22906","last_updated":"2026-04-24T16:56:53Z","snapshot_observed_at":"2026-07-06T23:09:14.698490Z","submitted_at":"2026-04-24T16:56:53Z","title":"Network Edge Inference for Large Language Models: Principles, Techniques, and Opportunities","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-08T09:45:57.201837Z"},"links":{"citing_paper":"/paper/2604.22906"},"observation_digest":"sha256:bfb4338c9b1cf77d010d4db6723fd1dfa799a2d80a29b19b8a40359fda528441","observation_id":"17818ca6-81d7-42ad-9e5f-59e89f728b9e","resolution":{"observed_at":"2026-05-26T15:47:59.385330Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"9a40f3f7-55bb-4235-b6b4-a2b61d954454","year":2025},"citing_paper":{"arxiv_id":"2604.22906","last_updated":"2026-04-24T16:56:53Z","snapshot_observed_at":"2026-07-06T23:09:14.698490Z","submitted_at":"2026-04-24T16:56:53Z","title":"Network Edge Inference for Large Language Models: Principles, Techniques, and Opportunities","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-08T09:45:57.201837Z"},"links":{"citing_paper":"/paper/2604.22906"},"observation_digest":"sha256:0a24a7a21ccb11f1bf46af8acbde9a28633dfd3eaa0a97ba084fe278d09abe62","observation_id":"ae743158-3a5f-468a-ac1d-d86307d448b1","resolution":{"observed_at":"2026-05-26T15:47:59.442214Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"078a1fb3-5eba-4486-9145-c45b27538a24","year":2025},"citing_paper":{"arxiv_id":"2604.22906","last_updated":"2026-04-24T16:56:53Z","snapshot_observed_at":"2026-07-06T23:09:14.698490Z","submitted_at":"2026-04-24T16:56:53Z","title":"Network Edge Inference for Large Language Models: Principles, Techniques, and Opportunities","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-08T09:45:57.201837Z"},"links":{"citing_paper":"/paper/2604.22906"},"observation_digest":"sha256:63bf9b2ae0383cccca451fcf845cdf893f7f6ebebb43a534fd36737ac95c97d7","observation_id":"28dcc92e-7abf-42db-a496-022aca63e351","resolution":{"observed_at":"2026-05-26T15:47:59.369979Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Reinhardt, Ali Saidi, Arkaprava Basu, Joel Hestness, Derek R","venue":null,"work_id":"e6bf4f60-eccd-45bc-96f3-029c85d86ddd","year":2011},"citing_paper":{"arxiv_id":"2604.22906","last_updated":"2026-04-24T16:56:53Z","snapshot_observed_at":"2026-07-06T23:09:14.698490Z","submitted_at":"2026-04-24T16:56:53Z","title":"Network Edge Inference for Large Language Models: Principles, Techniques, and Opportunities","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-08T09:45:57.201837Z"},"links":{"citing_paper":"/paper/2604.22906"},"observation_digest":"sha256:0bb896ab5908e1f68f4b92fa786093d7bbcbc4196afba4eb6ae79eecdde90cd8","observation_id":"7cd59530-85be-4836-8382-867c4914f29a","resolution":{"observed_at":"2026-05-26T15:47:59.324982Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"f428f7a7-0d4e-475c-961c-a95ff9960361","year":2023},"citing_paper":{"arxiv_id":"2604.22906","last_updated":"2026-04-24T16:56:53Z","snapshot_observed_at":"2026-07-06T23:09:14.698490Z","submitted_at":"2026-04-24T16:56:53Z","title":"Network Edge Inference for Large Language Models: Principles, Techniques, and Opportunities","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-08T09:45:57.201837Z"},"links":{"citing_paper":"/paper/2604.22906"},"observation_digest":"sha256:b37c1f606136a9d6214e59eddb12962f7cc78c7b2410621acf83eda415131ac2","observation_id":"26ff7743-adbc-4a17-96f7-be38ca4a7157","resolution":{"observed_at":"2026-05-26T15:47:59.456882Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"000ef78c-c58f-40e5-a2da-5641d4ca76c8","year":2020},"citing_paper":{"arxiv_id":"2604.22906","last_updated":"2026-04-24T16:56:53Z","snapshot_observed_at":"2026-07-06T23:09:14.698490Z","submitted_at":"2026-04-24T16:56:53Z","title":"Network Edge Inference for Large Language Models: Principles, Techniques, and Opportunities","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-08T09:45:57.201837Z"},"links":{"citing_paper":"/paper/2604.22906"},"observation_digest":"sha256:51789ac822afdf530973b2c7eb5b7b84c6b2fbd423f17c3f582cd9ad047ed8c0","observation_id":"2ac7d8d5-8580-4909-af47-674d461271f5","resolution":{"observed_at":"2026-05-26T15:47:59.219675Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"3388259d-cb1c-435e-9800-c50339dffdaa","year":2023},"citing_paper":{"arxiv_id":"2604.22906","last_updated":"2026-04-24T16:56:53Z","snapshot_observed_at":"2026-07-06T23:09:14.698490Z","submitted_at":"2026-04-24T16:56:53Z","title":"Network Edge Inference for Large Language Models: Principles, Techniques, and Opportunities","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-08T09:45:57.201837Z"},"links":{"citing_paper":"/paper/2604.22906"},"observation_digest":"sha256:0093bd7c46bb8b0555d8497d711d06d9a4882082a55645ad32d68017ec14fff5","observation_id":"9b81ca3e-25be-4fcf-907b-cf1cbeaaa8af","resolution":{"observed_at":"2026-05-26T15:47:59.172158Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.13211","last_updated":"2023-12-20T17:27:25Z","snapshot_observed_at":"2026-07-06T17:06:04.814172Z","submitted_at":"2023-12-20T17:27:25Z","title":"DSFormer: Effective Compression of Text-Transformers by Dense-Sparse Weight Factorization","version":1},"cited_work":{"arxiv_id":"2312.13211","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2312.13211","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Dsformer: Effective com- pression of text-transformers by dense-sparse weight factoriza- tion","venue":null,"work_id":"e4ef215f-277b-4fce-8df3-ab686488b363","year":2023},"citing_paper":{"arxiv_id":"2604.22906","last_updated":"2026-04-24T16:56:53Z","snapshot_observed_at":"2026-07-06T23:09:14.698490Z","submitted_at":"2026-04-24T16:56:53Z","title":"Network Edge Inference for Large Language Models: Principles, Techniques, and Opportunities","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-08T09:45:57.201837Z"},"links":{"cited_paper":"/paper/2312.13211","citing_paper":"/paper/2604.22906"},"observation_digest":"sha256:74ae190554777b3cb735a58f35cff1ee56dad0fa3caa9c844031506b8292be03","observation_id":"ed8f9b5e-6afa-4245-ba84-a9fd8501e4ed","resolution":{"observed_at":"2026-05-11T20:16:10.564952Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"200e5168-2f70-4102-88aa-b43b26eed19a","year":2025},"citing_paper":{"arxiv_id":"2604.22906","last_updated":"2026-04-24T16:56:53Z","snapshot_observed_at":"2026-07-06T23:09:14.698490Z","submitted_at":"2026-04-24T16:56:53Z","title":"Network Edge Inference for Large Language Models: Principles, Techniques, and Opportunities","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-08T09:45:57.201837Z"},"links":{"citing_paper":"/paper/2604.22906"},"observation_digest":"sha256:3bdaaa7b9ed9f703d654f4c072a4324a8028e6b3ccc6f362361c763afc02cb59","observation_id":"27e41ad5-9319-426c-a6ab-01ce0ac89fc3","resolution":{"observed_at":"2026-05-26T15:47:59.538174Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2107.03374","last_updated":"2021-07-14T17:16:02Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-07-07T17:41:24Z","title":"Evaluating Large Language Models Trained on Code","version":2},"cited_work":{"arxiv_id":"2107.03374","doi":"10.48550/arxiv.2107.03374","metadata_source":"pith","pith_arxiv_id":"2107.03374","snapshot_observed_at":"2026-07-11T03:27:46.202228Z","title":"Evaluating Large Language Models Trained on Code","venue":"cs.LG","work_id":"042493e9-b26f-4b4e-bbde-382072ca9b08","year":2021},"citing_paper":{"arxiv_id":"2604.22906","last_updated":"2026-04-24T16:56:53Z","snapshot_observed_at":"2026-07-06T23:09:14.698490Z","submitted_at":"2026-04-24T16:56:53Z","title":"Network Edge Inference for Large Language Models: Principles, Techniques, and Opportunities","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-08T09:45:57.201837Z"},"links":{"cited_paper":"/paper/2107.03374","citing_paper":"/paper/2604.22906"},"observation_digest":"sha256:ce622a9cce4066301d025eedf9d824ab8974b4639e212d52d5b777d7b1b01dff","observation_id":"5ceffb50-e36a-46d9-a0ae-e334e6e8b49f","resolution":{"observed_at":"2026-05-11T20:16:10.509167Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-01T08:08:23.404839+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-01T08:08:23.404839+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"f952b878-6366-4756-89fe-718db75bd0e3","year":2018},"citing_paper":{"arxiv_id":"2604.22906","last_updated":"2026-04-24T16:56:53Z","snapshot_observed_at":"2026-07-06T23:09:14.698490Z","submitted_at":"2026-04-24T16:56:53Z","title":"Network Edge Inference for Large Language Models: Principles, Techniques, and Opportunities","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-08T09:45:57.201837Z"},"links":{"citing_paper":"/paper/2604.22906"},"observation_digest":"sha256:8c26e8ba3be14b896f927630a28647c5f9e0e3fd27a592afd91aa3765d21d550","observation_id":"0269bec4-a862-4c40-a87b-26daf883d7b1","resolution":{"observed_at":"2026-05-26T15:47:59.106760Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.07061","last_updated":"2024-07-10T15:57:21Z","snapshot_observed_at":"2026-07-06T18:43:47.559289Z","submitted_at":"2024-07-09T17:33:24Z","title":"Internet of Agents: Weaving a Web of Heterogeneous Agents for Collaborative Intelligence","version":2},"cited_work":{"arxiv_id":"2407.07061","doi":null,"metadata_source":"pith","pith_arxiv_id":"2407.07061","snapshot_observed_at":"2026-07-08T15:05:03.502810Z","title":"Internet of agents: Weaving a web of heterogeneous agents for collaborative intelligence","venue":"cs.CL","work_id":"46b69af2-1a79-4461-a3fb-02d142952b24","year":2024},"citing_paper":{"arxiv_id":"2604.22906","last_updated":"2026-04-24T16:56:53Z","snapshot_observed_at":"2026-07-06T23:09:14.698490Z","submitted_at":"2026-04-24T16:56:53Z","title":"Network Edge Inference for Large Language Models: Principles, Techniques, and Opportunities","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-08T09:45:57.201837Z"},"links":{"cited_paper":"/paper/2407.07061","citing_paper":"/paper/2604.22906"},"observation_digest":"sha256:c1e0e62a2972d7457ab254ac7d3d3807d928ef59c9f50c634339d2db40c4cfd4","observation_id":"bf82dbdd-e2f9-4219-a521-8b71e6949b37","resolution":{"observed_at":"2026-05-11T20:16:10.338549Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"692184f3-c54f-42c3-a684-376622ec489b","year":2025},"citing_paper":{"arxiv_id":"2604.22906","last_updated":"2026-04-24T16:56:53Z","snapshot_observed_at":"2026-07-06T23:09:14.698490Z","submitted_at":"2026-04-24T16:56:53Z","title":"Network Edge Inference for Large Language Models: Principles, Techniques, and Opportunities","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-08T09:45:57.201837Z"},"links":{"citing_paper":"/paper/2604.22906"},"observation_digest":"sha256:f45cc0a2fa63f35dd321ea9dbee5abc804a7cc6729ad3de088f64ce91f5b5e12","observation_id":"c2d561bb-330f-4594-8a91-bfe5239e9fce","resolution":{"observed_at":"2026-05-26T15:47:59.103430Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"f1c9352d-0ec4-4dd0-8408-69eb5bc3a064","year":2023},"citing_paper":{"arxiv_id":"2604.22906","last_updated":"2026-04-24T16:56:53Z","snapshot_observed_at":"2026-07-06T23:09:14.698490Z","submitted_at":"2026-04-24T16:56:53Z","title":"Network Edge Inference for Large Language Models: Principles, Techniques, and Opportunities","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-08T09:45:57.201837Z"},"links":{"citing_paper":"/paper/2604.22906"},"observation_digest":"sha256:3be39bc7baf011a14dc680ce3c80a16c79874b85bde561fb36a16ea63af7e845","observation_id":"79488889-1952-48b1-9f05-57e78dbda482","resolution":{"observed_at":"2026-05-26T15:47:59.121224Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1805.06085","last_updated":"2018-07-17T07:33:19Z","snapshot_observed_at":"2026-07-06T06:39:21.688392Z","submitted_at":"2018-05-16T01:19:43Z","title":"PACT: Parameterized Clipping Activation for Quantized Neural Networks","version":2},"cited_work":{"arxiv_id":"1805.06085","doi":"10.48550/arxiv.1805.06085","metadata_source":"pith","pith_arxiv_id":"1805.06085","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"PACT: Parameterized Clipping Activation for Quantized Neural Networks","venue":"cs.CV","work_id":"ab8da7fe-9ff3-44e6-9132-11d17ceef8c2","year":2018},"citing_paper":{"arxiv_id":"2604.22906","last_updated":"2026-04-24T16:56:53Z","snapshot_observed_at":"2026-07-06T23:09:14.698490Z","submitted_at":"2026-04-24T16:56:53Z","title":"Network Edge Inference for Large Language Models: Principles, Techniques, and Opportunities","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-08T09:45:57.201837Z"},"links":{"cited_paper":"/paper/1805.06085","citing_paper":"/paper/2604.22906"},"observation_digest":"sha256:b2133978d276bc73a44f1daed8d827d71c56d4a1f25e985aff0b32e9414bb758","observation_id":"d8d02df9-0956-4c27-ab56-7beb67b090d3","resolution":{"observed_at":"2026-05-11T20:16:10.571411Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1803.05457","last_updated":"2018-03-14T18:04:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2018-03-14T18:04:21Z","title":"Think you have Solved Question Answering? Try ARC, the AI2 Reasoning Challenge","version":1},"cited_work":{"arxiv_id":"1803.05457","doi":"10.1162/tacl_a_00448.https://aclanthology.org/2022.tacl-1.5","metadata_source":"pith","pith_arxiv_id":"1803.05457","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Think you have Solved Question Answering? Try ARC, the AI2 Reasoning Challenge","venue":"cs.AI","work_id":"28ea1282-d657-4c61-a83c-f1249be6d6b1","year":2018},"citing_paper":{"arxiv_id":"2604.22906","last_updated":"2026-04-24T16:56:53Z","snapshot_observed_at":"2026-07-06T23:09:14.698490Z","submitted_at":"2026-04-24T16:56:53Z","title":"Network Edge Inference for Large Language Models: Principles, Techniques, and Opportunities","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-08T09:45:57.201837Z"},"links":{"cited_paper":"/paper/1803.05457","citing_paper":"/paper/2604.22906"},"observation_digest":"sha256:01a71f07306345d0b1b38f83c64b819c6a63a17c7ddaae201d67ee266a19d5e5","observation_id":"365e9951-f635-4511-a0ad-0721536d2a77","resolution":{"observed_at":"2026-05-11T20:16:10.374394Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2110.14168","last_updated":"2021-11-18T00:23:45Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-10-27T04:49:45Z","title":"Training Verifiers to Solve Math Word Problems","version":2},"cited_work":{"arxiv_id":"2110.14168","doi":"10.1002/j.1545-","metadata_source":"pith","pith_arxiv_id":"2110.14168","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Training Verifiers to Solve Math Word Problems","venue":"cs.LG","work_id":"acab1aa8-b4d6-40e0-a3ee-25341701dca2","year":2021},"citing_paper":{"arxiv_id":"2604.22906","last_updated":"2026-04-24T16:56:53Z","snapshot_observed_at":"2026-07-06T23:09:14.698490Z","submitted_at":"2026-04-24T16:56:53Z","title":"Network Edge Inference for Large Language Models: Principles, Techniques, and Opportunities","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-08T09:45:57.201837Z"},"links":{"cited_paper":"/paper/2110.14168","citing_paper":"/paper/2604.22906"},"observation_digest":"sha256:3c67e9bd135caf24d73ee0ca56db4b446cbce7f72d1d5dd89d1ddf5e1ff0c7ca","observation_id":"25f7156e-c329-4bb8-8bac-e0751c380682","resolution":{"observed_at":"2026-05-11T20:16:10.270209Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.02628","last_updated":"2023-07-05T19:59:09Z","snapshot_observed_at":"2026-07-06T15:50:49.116859Z","submitted_at":"2023-07-05T19:59:09Z","title":"SkipDecode: Autoregressive Skip Decoding with Batching and Caching for Efficient LLM Inference","version":1},"cited_work":{"arxiv_id":"2307.02628","doi":"10.48550/arxiv.2307.02628","metadata_source":"arxiv_reference","pith_arxiv_id":"2307.02628","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Skipdecode: Autoregressive skip decoding with batching and caching for efficient llm inference","venue":null,"work_id":"8ddc464a-e657-4c40-8188-95683c73c2d0","year":2023},"citing_paper":{"arxiv_id":"2604.22906","last_updated":"2026-04-24T16:56:53Z","snapshot_observed_at":"2026-07-06T23:09:14.698490Z","submitted_at":"2026-04-24T16:56:53Z","title":"Network Edge Inference for Large Language Models: Principles, Techniques, and Opportunities","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-05-08T09:45:57.201837Z"},"links":{"cited_paper":"/paper/2307.02628","citing_paper":"/paper/2604.22906"},"observation_digest":"sha256:b4a7b258af28496c24ce04289ff22eb0530c8a96e3bbf16707b5f6a2bc4d703d","observation_id":"de247a6c-11ba-4492-ac32-750217c5860b","resolution":{"observed_at":"2026-05-11T20:16:10.393173Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"25deb560-f322-4dc1-8229-882051f352e3","year":2022},"citing_paper":{"arxiv_id":"2604.22906","last_updated":"2026-04-24T16:56:53Z","snapshot_observed_at":"2026-07-06T23:09:14.698490Z","submitted_at":"2026-04-24T16:56:53Z","title":"Network Edge Inference for Large Language Models: Principles, Techniques, and Opportunities","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-08T09:45:57.201837Z"},"links":{"citing_paper":"/paper/2604.22906"},"observation_digest":"sha256:b7c7642e1b1e9cc72b707284bcae5d88aff371888ff2775f9586201979db78a3","observation_id":"02c09d60-1216-42e8-856f-0344ea9b59d9","resolution":{"observed_at":"2026-05-26T15:47:59.118057Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.03078","last_updated":"2023-06-05T17:53:28Z","snapshot_observed_at":"2026-07-06T15:38:46.970127Z","submitted_at":"2023-06-05T17:53:28Z","title":"SpQR: A Sparse-Quantized Representation for Near-Lossless LLM Weight Compression","version":1},"cited_work":{"arxiv_id":"2306.03078","doi":"10.48550/arxiv.2306.03078","metadata_source":"arxiv_reference","pith_arxiv_id":"2306.03078","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Spqr: A sparse-quantized representation for near-lossless llm weight compression.arXiv preprint arXiv:2306.03078","venue":null,"work_id":"9f122cd0-f5dd-4105-8cf5-cc97759850e8","year":2024},"citing_paper":{"arxiv_id":"2604.22906","last_updated":"2026-04-24T16:56:53Z","snapshot_observed_at":"2026-07-06T23:09:14.698490Z","submitted_at":"2026-04-24T16:56:53Z","title":"Network Edge Inference for Large Language Models: Principles, Techniques, and Opportunities","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-05-08T09:45:57.201837Z"},"links":{"cited_paper":"/paper/2306.03078","citing_paper":"/paper/2604.22906"},"observation_digest":"sha256:38ce06025b5860fa60c06f5bf4c2022f7a50e7a5ce94b1440a40e26915f29b9f","observation_id":"6c94e8d7-3868-43ef-a1ff-2d9524769418","resolution":{"observed_at":"2026-05-11T20:16:10.423526Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"18479454-6b3e-464c-9603-ea94a7e63291","year":2019},"citing_paper":{"arxiv_id":"2604.22906","last_updated":"2026-04-24T16:56:53Z","snapshot_observed_at":"2026-07-06T23:09:14.698490Z","submitted_at":"2026-04-24T16:56:53Z","title":"Network Edge Inference for Large Language Models: Principles, Techniques, and Opportunities","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-05-08T09:45:57.201837Z"},"links":{"citing_paper":"/paper/2604.22906"},"observation_digest":"sha256:ad9e52ec27dc2623d6e7dbf076d1c355556ddeecf351c5e2c88c88d7c33600ce","observation_id":"9c5c2fb7-ec3f-4c3f-8e1a-ca130b72b1f3","resolution":{"observed_at":"2026-05-26T15:47:59.114938Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"7d12b336-0229-4778-9e4f-e53b875f57b7","year":2024},"citing_paper":{"arxiv_id":"2604.22906","last_updated":"2026-04-24T16:56:53Z","snapshot_observed_at":"2026-07-06T23:09:14.698490Z","submitted_at":"2026-04-24T16:56:53Z","title":"Network Edge Inference for Large Language Models: Principles, Techniques, and Opportunities","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-05-08T09:45:57.201837Z"},"links":{"citing_paper":"/paper/2604.22906"},"observation_digest":"sha256:a1e841a542eb95a0c6556c5bd867bdf194756c21acffae17e46dc573b5c519b5","observation_id":"b34073c3-c452-49a2-a6f2-9c8c951e9fcd","resolution":{"observed_at":"2026-05-26T15:47:59.116252Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"f801639d-273b-4371-ac51-f0150fb91541","year":2025},"citing_paper":{"arxiv_id":"2604.22906","last_updated":"2026-04-24T16:56:53Z","snapshot_observed_at":"2026-07-06T23:09:14.698490Z","submitted_at":"2026-04-24T16:56:53Z","title":"Network Edge Inference for Large Language Models: Principles, Techniques, and Opportunities","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-05-08T09:45:57.201837Z"},"links":{"citing_paper":"/paper/2604.22906"},"observation_digest":"sha256:fd011c08e78ae40ec9b05a7b1c636be3343db8d49c56faaa4deaeb8629e42eb5","observation_id":"5a2fa771-7d20-4aaf-926f-6943d6e166e1","resolution":{"observed_at":"2026-05-26T15:47:59.185852Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"1545baaf-35db-459b-88a1-6a733658cfe4","year":2025},"citing_paper":{"arxiv_id":"2604.22906","last_updated":"2026-04-24T16:56:53Z","snapshot_observed_at":"2026-07-06T23:09:14.698490Z","submitted_at":"2026-04-24T16:56:53Z","title":"Network Edge Inference for Large Language Models: Principles, Techniques, and Opportunities","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-05-08T09:45:57.201837Z"},"links":{"citing_paper":"/paper/2604.22906"},"observation_digest":"sha256:5af5c55c62c29c3c33740cf31d1e36afd8d26ee1c49a1f530051710860700fef","observation_id":"b42c70c3-7d4c-44cc-be08-670d627cee57","resolution":{"observed_at":"2026-05-26T15:47:59.086909Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2301.00234","last_updated":"2024-10-05T11:47:02Z","snapshot_observed_at":"2026-07-06T14:36:25.690733Z","submitted_at":"2022-12-31T15:57:09Z","title":"A Survey on In-context Learning","version":6},"cited_work":{"arxiv_id":"2301.00234","doi":"10.48550/arxiv.2301.00234","metadata_source":"pith","pith_arxiv_id":"2301.00234","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"A Survey on In-context Learning","venue":"cs.CL","work_id":"864701ca-cb36-4a91-9be8-e2b9b20679aa","year":2022},"citing_paper":{"arxiv_id":"2604.22906","last_updated":"2026-04-24T16:56:53Z","snapshot_observed_at":"2026-07-06T23:09:14.698490Z","submitted_at":"2026-04-24T16:56:53Z","title":"Network Edge Inference for Large Language Models: Principles, Techniques, and Opportunities","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-05-08T09:45:57.201837Z"},"links":{"cited_paper":"/paper/2301.00234","citing_paper":"/paper/2604.22906"},"observation_digest":"sha256:5cf4bf87e5854be7ec73358e79c8966047ae798daa25ed417519e60a266aed93","observation_id":"37b80d11-acd7-40f4-a332-ff5edb320a0a","resolution":{"observed_at":"2026-05-12T12:58:27.573752Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"c02f91b0-a7d4-4188-9df3-fa1056e81e7b","year":2012},"citing_paper":{"arxiv_id":"2604.22906","last_updated":"2026-04-24T16:56:53Z","snapshot_observed_at":"2026-07-06T23:09:14.698490Z","submitted_at":"2026-04-24T16:56:53Z","title":"Network Edge Inference for Large Language Models: Principles, Techniques, and Opportunities","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-05-08T09:45:57.201837Z"},"links":{"citing_paper":"/paper/2604.22906"},"observation_digest":"sha256:af9faf3d3e31fc2ee7d56deeb5f585cdc4e4207d7c96d37ffdaec6be00b752a0","observation_id":"54da28e4-fb1a-4d7f-b9a5-b88de2dd5312","resolution":{"observed_at":"2026-05-26T15:47:59.134423Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"87db6c1d-6979-4bcb-86c1-8f1868909b0f","year":2024},"citing_paper":{"arxiv_id":"2604.22906","last_updated":"2026-04-24T16:56:53Z","snapshot_observed_at":"2026-07-06T23:09:14.698490Z","submitted_at":"2026-04-24T16:56:53Z","title":"Network Edge Inference for Large Language Models: Principles, Techniques, and Opportunities","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-05-08T09:45:57.201837Z"},"links":{"citing_paper":"/paper/2604.22906"},"observation_digest":"sha256:70b48122422114e658a7f93a68e2f6f6cc8ad338bb6ff9bb610c80615be4967c","observation_id":"cf57526b-5575-43d7-9dd5-36224728e801","resolution":{"observed_at":"2026-05-26T15:47:59.061431Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1902.08153","last_updated":"2020-05-07T03:30:49Z","snapshot_observed_at":"2026-08-03T02:07:15.161709Z","submitted_at":"2019-02-21T17:31:32Z","title":"Learned Step Size Quantization","version":3},"cited_work":{"arxiv_id":"1902.08153","doi":"10.48550/arxiv.1902.08153","metadata_source":"arxiv_reference","pith_arxiv_id":"1902.08153","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"K., McKinstry, J","venue":null,"work_id":"87dd0e40-bfbe-4de6-8d30-65c5a87d97dd","year":1902},"citing_paper":{"arxiv_id":"2604.22906","last_updated":"2026-04-24T16:56:53Z","snapshot_observed_at":"2026-07-06T23:09:14.698490Z","submitted_at":"2026-04-24T16:56:53Z","title":"Network Edge Inference for Large Language Models: Principles, Techniques, and Opportunities","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-05-08T09:45:57.201837Z"},"links":{"cited_paper":"/paper/1902.08153","citing_paper":"/paper/2604.22906"},"observation_digest":"sha256:518642729a74c0370c7db4f064648880b1c268223eb5dad38af4abe3e6c771bb","observation_id":"b6e4dcc6-8777-4049-a388-7ac1ff043371","resolution":{"observed_at":"2026-05-11T20:16:10.524889Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"8787b287-8126-4dbd-9552-10f2cc92fc1c","year":2017},"citing_paper":{"arxiv_id":"2604.22906","last_updated":"2026-04-24T16:56:53Z","snapshot_observed_at":"2026-07-06T23:09:14.698490Z","submitted_at":"2026-04-24T16:56:53Z","title":"Network Edge Inference for Large Language Models: Principles, Techniques, and Opportunities","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-05-08T09:45:57.201837Z"},"links":{"citing_paper":"/paper/2604.22906"},"observation_digest":"sha256:9beb9133294c4041a57f03593441e55b103e5fab3c641f48eabe472b8054588c","observation_id":"f6036f8f-eecb-4553-bdfc-1abe890a3473","resolution":{"observed_at":"2026-05-26T15:47:59.068841Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"81bbf17b-f688-4de6-9652-208b72d1f4fe","year":2021},"citing_paper":{"arxiv_id":"2604.22906","last_updated":"2026-04-24T16:56:53Z","snapshot_observed_at":"2026-07-06T23:09:14.698490Z","submitted_at":"2026-04-24T16:56:53Z","title":"Network Edge Inference for Large Language Models: Principles, Techniques, and Opportunities","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-05-08T09:45:57.201837Z"},"links":{"citing_paper":"/paper/2604.22906"},"observation_digest":"sha256:1967696d3eae0410c423066e78d1f5a6b9f5e31df936fb4a74c32cee6c5a4f1a","observation_id":"3bfb5ae7-e6b1-40e3-8d08-9e73539ec986","resolution":{"observed_at":"2026-05-26T15:47:59.077117Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"c503f240-b3a3-4847-b292-d051bdee656b","year":2025},"citing_paper":{"arxiv_id":"2604.22906","last_updated":"2026-04-24T16:56:53Z","snapshot_observed_at":"2026-07-06T23:09:14.698490Z","submitted_at":"2026-04-24T16:56:53Z","title":"Network Edge Inference for Large Language Models: Principles, Techniques, and Opportunities","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-05-08T09:45:57.201837Z"},"links":{"citing_paper":"/paper/2604.22906"},"observation_digest":"sha256:ff9efad5846d9bad20d05e29a8a9a51e90e1a4edf190f0316afcda7dfa48564a","observation_id":"6f3e3dec-a3d4-4028-bee5-a9f9344fd26e","resolution":{"observed_at":"2026-05-26T15:47:59.152230Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"5e8fc990-c6a1-4d86-a2f1-83db98ad679c","year":2025},"citing_paper":{"arxiv_id":"2604.22906","last_updated":"2026-04-24T16:56:53Z","snapshot_observed_at":"2026-07-06T23:09:14.698490Z","submitted_at":"2026-04-24T16:56:53Z","title":"Network Edge Inference for Large Language Models: Principles, Techniques, and Opportunities","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-05-08T09:45:57.201837Z"},"links":{"citing_paper":"/paper/2604.22906"},"observation_digest":"sha256:7c620a294364539cfd34fdb4c18d1080fe7ea1d21d0f5bced6af52dfb2cf8f97","observation_id":"17395f1f-b12b-4e32-99e7-097e1baa7970","resolution":{"observed_at":"2026-05-26T15:47:59.423495Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"0f6b82ea-42f6-4056-bc07-e7444acf6ead","year":2023},"citing_paper":{"arxiv_id":"2604.22906","last_updated":"2026-04-24T16:56:53Z","snapshot_observed_at":"2026-07-06T23:09:14.698490Z","submitted_at":"2026-04-24T16:56:53Z","title":"Network Edge Inference for Large Language Models: Principles, Techniques, and Opportunities","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-05-08T09:45:57.201837Z"},"links":{"citing_paper":"/paper/2604.22906"},"observation_digest":"sha256:1936cdffd634d2c2be2eb78c7044d12dca9edb787ec189b76d7677801adf62b8","observation_id":"de55e7de-e32c-49e1-9b6b-ecaf19661674","resolution":{"observed_at":"2026-05-26T15:47:59.420588Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2509.11431","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"2c4e5d4e-5751-4225-a35b-18c342b41b10","year":2025},"citing_paper":{"arxiv_id":"2604.22906","last_updated":"2026-04-24T16:56:53Z","snapshot_observed_at":"2026-07-06T23:09:14.698490Z","submitted_at":"2026-04-24T16:56:53Z","title":"Network Edge Inference for Large Language Models: Principles, Techniques, and Opportunities","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-05-08T09:45:57.201837Z"},"links":{"citing_paper":"/paper/2604.22906"},"observation_digest":"sha256:62f1dbb7f70b141100351f98457a92b1aebb8d75d7ccaf987d07032b241999cc","observation_id":"7baa109b-be18-4508-a77a-54aff40b38e9","resolution":{"observed_at":"2026-05-11T20:16:10.315550Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"2e8c3298-1466-44c8-b78e-3adbeab92e36","year":null},"citing_paper":{"arxiv_id":"2604.22906","last_updated":"2026-04-24T16:56:53Z","snapshot_observed_at":"2026-07-06T23:09:14.698490Z","submitted_at":"2026-04-24T16:56:53Z","title":"Network Edge Inference for Large Language Models: Principles, Techniques, and Opportunities","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-05-08T09:45:57.201837Z"},"links":{"citing_paper":"/paper/2604.22906"},"observation_digest":"sha256:c1daa5ced7ac18883cbcd7b005fdfc56af134f4960ea1eb051b0f8800612e75e","observation_id":"4452655e-e910-419a-907c-e01e4fb4bd50","resolution":{"observed_at":"2026-05-26T15:47:59.432898Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"3d04e6b8-01c3-4bf5-a74e-9e9e4631486f","year":2023},"citing_paper":{"arxiv_id":"2604.22906","last_updated":"2026-04-24T16:56:53Z","snapshot_observed_at":"2026-07-06T23:09:14.698490Z","submitted_at":"2026-04-24T16:56:53Z","title":"Network Edge Inference for Large Language Models: Principles, Techniques, and Opportunities","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-05-08T09:45:57.201837Z"},"links":{"citing_paper":"/paper/2604.22906"},"observation_digest":"sha256:4ffc5c72dd29c1ac5d2a8f15f6a81af459e4fffb3d77baf6363580aa27a09325","observation_id":"87ac2fc4-b0ac-440c-b153-e577deaee592","resolution":{"observed_at":"2026-05-26T15:47:59.429669Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2203.14680","last_updated":"2022-10-12T18:01:23Z","snapshot_observed_at":"2026-08-03T05:22:23.916601Z","submitted_at":"2022-03-28T12:26:00Z","title":"Transformer Feed-Forward Layers Build Predictions by Promoting Concepts in the Vocabulary Space","version":3},"cited_work":{"arxiv_id":"2203.14680","doi":"10.48550/arxiv.2203.14680","metadata_source":"pith","pith_arxiv_id":"2203.14680","snapshot_observed_at":"2026-07-10T11:57:03.259783Z","title":"org/abs/2203.14680","venue":"cs.CL","work_id":"4868c846-62bf-4572-bac5-adc004265c5d","year":2022},"citing_paper":{"arxiv_id":"2604.22906","last_updated":"2026-04-24T16:56:53Z","snapshot_observed_at":"2026-07-06T23:09:14.698490Z","submitted_at":"2026-04-24T16:56:53Z","title":"Network Edge Inference for Large Language Models: Principles, Techniques, and Opportunities","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-05-08T09:45:57.201837Z"},"links":{"cited_paper":"/paper/2203.14680","citing_paper":"/paper/2604.22906"},"observation_digest":"sha256:bdbfbc2d0a4255187e2b0917724e554dbf2a571a0a25a9024b2c25e856830ba9","observation_id":"ce5c8a57-b983-4c09-9428-39b512f06059","resolution":{"observed_at":"2026-05-11T20:16:10.254185Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1904.09324","last_updated":"2019-09-04T16:31:39Z","snapshot_observed_at":"2026-07-06T07:47:18.266108Z","submitted_at":"2019-04-19T19:53:01Z","title":"Mask-Predict: Parallel Decoding of Conditional Masked Language Models","version":2},"cited_work":{"arxiv_id":"1904.09324","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"1904.09324","snapshot_observed_at":"2026-07-02T12:06:55.551247Z","title":"Mask-predict: Parallel decoding of conditional masked language models.arXiv preprint arXiv:1904.09324","venue":null,"work_id":"fd35154e-15c9-45b7-b0af-ab0e7f352b42","year":1904},"citing_paper":{"arxiv_id":"2604.22906","last_updated":"2026-04-24T16:56:53Z","snapshot_observed_at":"2026-07-06T23:09:14.698490Z","submitted_at":"2026-04-24T16:56:53Z","title":"Network Edge Inference for Large Language Models: Principles, Techniques, and Opportunities","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-05-08T09:45:57.201837Z"},"links":{"cited_paper":"/paper/1904.09324","citing_paper":"/paper/2604.22906"},"observation_digest":"sha256:70a83dd05252e7ceadbe8126db575bddc30259a07921c3d1e4a639edcc770507","observation_id":"818e14f1-aae7-44fb-828c-684dec3aa460","resolution":{"observed_at":"2026-05-11T20:16:10.601226Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"24f620be-73d5-4d42-b2eb-f6f124555cf8","year":2005},"citing_paper":{"arxiv_id":"2604.22906","last_updated":"2026-04-24T16:56:53Z","snapshot_observed_at":"2026-07-06T23:09:14.698490Z","submitted_at":"2026-04-24T16:56:53Z","title":"Network Edge Inference for Large Language Models: Principles, Techniques, and Opportunities","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-05-08T09:45:57.201837Z"},"links":{"citing_paper":"/paper/2604.22906"},"observation_digest":"sha256:88dca506e7c2bc7188accbd5c3f3868d7bc053de9bbedb74089d138ad3fcb7e6","observation_id":"855a05e1-166a-43af-bcc6-a02c4936a87f","resolution":{"observed_at":"2026-05-26T15:47:59.305357Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.11329","last_updated":"2026-05-01T12:16:47Z","snapshot_observed_at":"2026-07-06T21:25:08.411184Z","submitted_at":"2025-05-16T14:53:50Z","title":"TokenWeave: Efficient Compute-Communication Overlap for Distributed LLM Inference","version":5},"cited_work":{"arxiv_id":"2505.11329","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.11329","snapshot_observed_at":"2026-07-04T09:39:46.820947Z","title":"TokenWeave: Efficient Compute-Communication Overlap for Distributed LLM Inference","venue":"cs.DC","work_id":"9e60dedb-4a49-4ba3-9fac-5cb97f0826d4","year":2025},"citing_paper":{"arxiv_id":"2604.22906","last_updated":"2026-04-24T16:56:53Z","snapshot_observed_at":"2026-07-06T23:09:14.698490Z","submitted_at":"2026-04-24T16:56:53Z","title":"Network Edge Inference for Large Language Models: Principles, Techniques, and Opportunities","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-05-08T09:45:57.201837Z"},"links":{"cited_paper":"/paper/2505.11329","citing_paper":"/paper/2604.22906"},"observation_digest":"sha256:369c649d94be4caf2a89a2510ab959e87537822f8106198bb92cca7ab255adeb","observation_id":"67baaf38-74cd-4ccc-baff-300bb6000970","resolution":{"observed_at":"2026-05-11T20:16:10.476352Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"b4e740fc-c581-4709-88f5-05050a246dc4","year":2024},"citing_paper":{"arxiv_id":"2604.22906","last_updated":"2026-04-24T16:56:53Z","snapshot_observed_at":"2026-07-06T23:09:14.698490Z","submitted_at":"2026-04-24T16:56:53Z","title":"Network Edge Inference for Large Language Models: Principles, Techniques, and Opportunities","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-05-08T09:45:57.201837Z"},"links":{"citing_paper":"/paper/2604.22906"},"observation_digest":"sha256:4cae92844a39cf223e69935a88f834425292dd7f60f1e7ae2179338ec08a2df9","observation_id":"1bfc83d5-b7fc-4eb3-b691-acbfae860bd3","resolution":{"observed_at":"2026-05-26T15:47:59.484811Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2012.15833","last_updated":"2020-12-31T18:52:59Z","snapshot_observed_at":"2026-08-02T16:14:10.835034Z","submitted_at":"2020-12-31T18:52:59Z","title":"Fully Non-autoregressive Neural Machine Translation: Tricks of the Trade","version":1},"cited_work":{"arxiv_id":"2012.15833","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2012.15833","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"d639f558-2de1-49bc-beea-5d0d3cc47c94","year":2020},"citing_paper":{"arxiv_id":"2604.22906","last_updated":"2026-04-24T16:56:53Z","snapshot_observed_at":"2026-07-06T23:09:14.698490Z","submitted_at":"2026-04-24T16:56:53Z","title":"Network Edge Inference for Large Language Models: Principles, Techniques, and Opportunities","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-05-08T09:45:57.201837Z"},"links":{"cited_paper":"/paper/2012.15833","citing_paper":"/paper/2604.22906"},"observation_digest":"sha256:f58483beb9fb76ad3e13a78670ec90685cfec010acae1d3adb3f2f5c7abf77d0","observation_id":"b034079b-1959-4eb3-a35a-e5cd1ea85ddb","resolution":{"observed_at":"2026-05-11T20:16:10.554055Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"83eee519-1bf4-4b95-a90f-213944f37319","year":2024},"citing_paper":{"arxiv_id":"2604.22906","last_updated":"2026-04-24T16:56:53Z","snapshot_observed_at":"2026-07-06T23:09:14.698490Z","submitted_at":"2026-04-24T16:56:53Z","title":"Network Edge Inference for Large Language Models: Principles, Techniques, and Opportunities","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-05-08T09:45:57.201837Z"},"links":{"citing_paper":"/paper/2604.22906"},"observation_digest":"sha256:255b0b19e47aac71fd89c709ecf39a926d07eace6acd36c97ef230cb305aa688","observation_id":"187f7736-0996-4e40-8a2c-1279959f92d5","resolution":{"observed_at":"2026-05-26T15:47:59.491704Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"3c47327b-607d-49f7-9c4f-c65a5e1ee1a5","year":2023},"citing_paper":{"arxiv_id":"2604.22906","last_updated":"2026-04-24T16:56:53Z","snapshot_observed_at":"2026-07-06T23:09:14.698490Z","submitted_at":"2026-04-24T16:56:53Z","title":"Network Edge Inference for Large Language Models: Principles, Techniques, and Opportunities","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-05-08T09:45:57.201837Z"},"links":{"citing_paper":"/paper/2604.22906"},"observation_digest":"sha256:5e82c87ebe733e8c71df1f764b7752d0f516f014c1d536fb9d5d3c7adabba35e","observation_id":"59360421-056e-442d-9107-250fbb41b43d","resolution":{"observed_at":"2026-05-26T15:47:59.529294Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.14196","last_updated":"2024-01-26T09:23:11Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-01-25T14:17:53Z","title":"DeepSeek-Coder: When the Large Language Model Meets Programming -- The Rise of Code Intelligence","version":2},"cited_work":{"arxiv_id":"2401.14196","doi":"10.48550/arxiv.2401.14196","metadata_source":"pith","pith_arxiv_id":"2401.14196","snapshot_observed_at":"2026-07-10T16:07:20.294742Z","title":"DeepSeek-Coder: When the Large Language Model Meets Programming -- The Rise of Code Intelligence","venue":"cs.SE","work_id":"f22dae5a-27e2-41d0-a061-c4286418dee3","year":2024},"citing_paper":{"arxiv_id":"2604.22906","last_updated":"2026-04-24T16:56:53Z","snapshot_observed_at":"2026-07-06T23:09:14.698490Z","submitted_at":"2026-04-24T16:56:53Z","title":"Network Edge Inference for Large Language Models: Principles, Techniques, and Opportunities","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-05-08T09:45:57.201837Z"},"links":{"cited_paper":"/paper/2401.14196","citing_paper":"/paper/2604.22906"},"observation_digest":"sha256:67d96704187439da894531bc8fb3aadc50fc3bf178a999617ab67d244bf6bdf1","observation_id":"94ab65aa-515b-40d7-9190-1b11512d84e6","resolution":{"observed_at":"2026-05-11T20:16:10.217361Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-07-11T06:20:38.664414+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T06:20:38.664414+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"d26f73ee-7c78-41f8-9616-aebf2e8e0b1f","year":2019},"citing_paper":{"arxiv_id":"2604.22906","last_updated":"2026-04-24T16:56:53Z","snapshot_observed_at":"2026-07-06T23:09:14.698490Z","submitted_at":"2026-04-24T16:56:53Z","title":"Network Edge Inference for Large Language Models: Principles, Techniques, and Opportunities","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-05-08T09:45:57.201837Z"},"links":{"citing_paper":"/paper/2604.22906"},"observation_digest":"sha256:674dcc8fbdec32b1d3a8ce5d84ee1e06f8212232f0c4d11acdc293abf6dc4ad1","observation_id":"5ef99ea2-2c9f-4fec-a8db-5088f1ecdd4f","resolution":{"observed_at":"2026-05-26T15:47:59.360876Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"782a0447-d3f1-4069-8673-8621a8abca06","year":2024},"citing_paper":{"arxiv_id":"2604.22906","last_updated":"2026-04-24T16:56:53Z","snapshot_observed_at":"2026-07-06T23:09:14.698490Z","submitted_at":"2026-04-24T16:56:53Z","title":"Network Edge Inference for Large Language Models: Principles, Techniques, and Opportunities","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-05-08T09:45:57.201837Z"},"links":{"citing_paper":"/paper/2604.22906"},"observation_digest":"sha256:41b1673d56ca8179a3ff9e005cd4a08378cb84a5467c002cb21ae11ad28eb81a","observation_id":"7b382ea9-2c91-419c-ad6d-a96f9da1d219","resolution":{"observed_at":"2026-05-26T15:47:59.507718Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"d83f7ded-6b20-4eee-87d2-a35eeccd2678","year":2024},"citing_paper":{"arxiv_id":"2604.22906","last_updated":"2026-04-24T16:56:53Z","snapshot_observed_at":"2026-07-06T23:09:14.698490Z","submitted_at":"2026-04-24T16:56:53Z","title":"Network Edge Inference for Large Language Models: Principles, Techniques, and Opportunities","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-05-08T09:45:57.201837Z"},"links":{"citing_paper":"/paper/2604.22906"},"observation_digest":"sha256:8e2ebb65b01c291ddc55c5263a33d53eb7590f37dee5d10c2141c25c8a685e50","observation_id":"a3253717-4ff2-49a4-8345-1af39188c8db","resolution":{"observed_at":"2026-05-26T15:47:59.137417Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"3bc11a97-82f2-4320-9807-c00484860fad","year":2008},"citing_paper":{"arxiv_id":"2604.22906","last_updated":"2026-04-24T16:56:53Z","snapshot_observed_at":"2026-07-06T23:09:14.698490Z","submitted_at":"2026-04-24T16:56:53Z","title":"Network Edge Inference for Large Language Models: Principles, Techniques, and Opportunities","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-05-08T09:45:57.201837Z"},"links":{"citing_paper":"/paper/2604.22906"},"observation_digest":"sha256:f5b3c06316a0e401c8e62d9233164e66c9ab8e2a1a7c5272e97742dc962529aa","observation_id":"c15515e7-8350-4c04-8488-0e3bbe790797","resolution":{"observed_at":"2026-05-26T15:47:59.143516Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"5985aaea-fa31-4d9b-8ef6-5cde46334f63","year":2021},"citing_paper":{"arxiv_id":"2604.22906","last_updated":"2026-04-24T16:56:53Z","snapshot_observed_at":"2026-07-06T23:09:14.698490Z","submitted_at":"2026-04-24T16:56:53Z","title":"Network Edge Inference for Large Language Models: Principles, Techniques, and Opportunities","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-05-08T09:45:57.201837Z"},"links":{"citing_paper":"/paper/2604.22906"},"observation_digest":"sha256:0583d9e411dbc69a15af49bd563c09b51f3f44662749f59b306b24318cb16ebc","observation_id":"ea5f8022-845c-4304-82d9-cf43e2ea1d04","resolution":{"observed_at":"2026-05-26T15:47:59.165781Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"63981c8a-dd5b-4be7-a142-5a18220e894d","year":2015},"citing_paper":{"arxiv_id":"2604.22906","last_updated":"2026-04-24T16:56:53Z","snapshot_observed_at":"2026-07-06T23:09:14.698490Z","submitted_at":"2026-04-24T16:56:53Z","title":"Network Edge Inference for Large Language Models: Principles, Techniques, and Opportunities","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-05-08T09:45:57.201837Z"},"links":{"citing_paper":"/paper/2604.22906"},"observation_digest":"sha256:b8f90b36b41e607811d34a61c9b7680efa5d5257efd91a0faf4dc866337dce4c","observation_id":"7ff8f9ae-20f2-4271-a8a6-6609c845d7f8","resolution":{"observed_at":"2026-05-26T15:47:59.086654Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"fb511b82-7136-4ac9-bffe-0f3a7ab5be4b","year":2023},"citing_paper":{"arxiv_id":"2604.22906","last_updated":"2026-04-24T16:56:53Z","snapshot_observed_at":"2026-07-06T23:09:14.698490Z","submitted_at":"2026-04-24T16:56:53Z","title":"Network Edge Inference for Large Language Models: Principles, Techniques, and Opportunities","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-05-08T09:45:57.201837Z"},"links":{"citing_paper":"/paper/2604.22906"},"observation_digest":"sha256:fcc3b28d883ea7e1a1ee804c2239147404427988881152dea1391b4a950e814d","observation_id":"4ef7c4a7-c1c9-47d1-9264-6d6edde21ef8","resolution":{"observed_at":"2026-05-26T15:47:59.253224Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.08671","last_updated":"2024-01-09T06:49:40Z","snapshot_observed_at":"2026-07-06T17:16:25.682072Z","submitted_at":"2024-01-09T06:49:40Z","title":"DeepSpeed-FastGen: High-throughput Text Generation for LLMs via MII and DeepSpeed-Inference","version":1},"cited_work":{"arxiv_id":"2401.08671","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2401.08671","snapshot_observed_at":"2026-07-04T11:59:50.582581Z","title":"Deepspeed-fastgen: High-throughput text generation for llms via MII and deepspeed-inference","venue":null,"work_id":"d970e106-3cea-4d01-88f2-f4ffc759b0da","year":2024},"citing_paper":{"arxiv_id":"2604.22906","last_updated":"2026-04-24T16:56:53Z","snapshot_observed_at":"2026-07-06T23:09:14.698490Z","submitted_at":"2026-04-24T16:56:53Z","title":"Network Edge Inference for Large Language Models: Principles, Techniques, and Opportunities","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-05-08T09:45:57.201837Z"},"links":{"cited_paper":"/paper/2401.08671","citing_paper":"/paper/2604.22906"},"observation_digest":"sha256:fb3dd96760978f4d6255b1feed0d3574f1b1f663fe1628ee7e6f0bc291672ab2","observation_id":"61b831f4-fcd0-47ff-adc3-18b849d53a70","resolution":{"observed_at":"2026-05-11T20:16:10.210742Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.19867","last_updated":"2025-04-28T15:00:03Z","snapshot_observed_at":"2026-07-06T21:15:49.962258Z","submitted_at":"2025-04-28T15:00:03Z","title":"semi-PD: Towards Efficient LLM Serving via Phase-Wise Disaggregated Computation and Unified Storage","version":1},"cited_work":{"arxiv_id":"2504.19867","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2504.19867","snapshot_observed_at":"2026-07-03T04:57:38.712067Z","title":"arXiv preprint arXiv:2504.19867 , year=","venue":null,"work_id":"999fee6f-fb6b-4ae7-ba31-c5b1626b410a","year":2025},"citing_paper":{"arxiv_id":"2604.22906","last_updated":"2026-04-24T16:56:53Z","snapshot_observed_at":"2026-07-06T23:09:14.698490Z","submitted_at":"2026-04-24T16:56:53Z","title":"Network Edge Inference for Large Language Models: Principles, Techniques, and Opportunities","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-05-08T09:45:57.201837Z"},"links":{"cited_paper":"/paper/2504.19867","citing_paper":"/paper/2604.22906"},"observation_digest":"sha256:fa56951fa74a47612522256ecb5b667c1e4cfbada6fb41044f122a1461afb6cb","observation_id":"e2ba28d7-9b2c-4bf3-9bb3-e753026a5fc8","resolution":{"observed_at":"2026-05-11T20:16:10.262035Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"e7da3c4c-c439-45a9-92d5-64a271c9754c","year":2024},"citing_paper":{"arxiv_id":"2604.22906","last_updated":"2026-04-24T16:56:53Z","snapshot_observed_at":"2026-07-06T23:09:14.698490Z","submitted_at":"2026-04-24T16:56:53Z","title":"Network Edge Inference for Large Language Models: Principles, Techniques, and Opportunities","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-05-08T09:45:57.201837Z"},"links":{"citing_paper":"/paper/2604.22906"},"observation_digest":"sha256:2ba5206c085afafbbdcefe6aceb1b0eb6c0fb2d94059d9308cee5fbfe6f3c5ab","observation_id":"6bfbd1b0-46fe-4eb7-8e25-d394ae49869f","resolution":{"observed_at":"2026-05-26T15:47:59.504771Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"2c71388f-d637-4010-8e4b-058c7df3d7ce","year":2024},"citing_paper":{"arxiv_id":"2604.22906","last_updated":"2026-04-24T16:56:53Z","snapshot_observed_at":"2026-07-06T23:09:14.698490Z","submitted_at":"2026-04-24T16:56:53Z","title":"Network Edge Inference for Large Language Models: Principles, Techniques, and Opportunities","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-05-08T09:45:57.201837Z"},"links":{"citing_paper":"/paper/2604.22906"},"observation_digest":"sha256:437e5ebe840c97f70fc1a2d3434b3aa0ca4e9a1ba001c6a3129628c3f32d7e26","observation_id":"e7cd867a-47f6-448a-bb11-85941de7199f","resolution":{"observed_at":"2026-05-26T15:47:59.414523Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Beerel, et al","venue":null,"work_id":"84076ace-d96b-43f0-91e7-88d83125e965","year":2022},"citing_paper":{"arxiv_id":"2604.22906","last_updated":"2026-04-24T16:56:53Z","snapshot_observed_at":"2026-07-06T23:09:14.698490Z","submitted_at":"2026-04-24T16:56:53Z","title":"Network Edge Inference for Large Language Models: Principles, Techniques, and Opportunities","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-05-08T09:45:57.201837Z"},"links":{"citing_paper":"/paper/2604.22906"},"observation_digest":"sha256:6e75b403eab21d9f49aca4b1f23f51d520640ba0bbd0b8f35a883ecbc7962e20","observation_id":"b10e7059-25db-469d-af91-2429b76e253d","resolution":{"observed_at":"2026-05-26T15:47:59.540999Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2110.14895","last_updated":"2021-10-28T05:20:51Z","snapshot_observed_at":"2026-07-06T12:02:52.936070Z","submitted_at":"2021-10-28T05:20:51Z","title":"Pipeline Parallelism for Inference on Heterogeneous Edge Computing","version":1},"cited_work":{"arxiv_id":"2110.14895","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2110.14895","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"6d79b03a-9533-4e92-b280-6dc7f97f2215","year":2021},"citing_paper":{"arxiv_id":"2604.22906","last_updated":"2026-04-24T16:56:53Z","snapshot_observed_at":"2026-07-06T23:09:14.698490Z","submitted_at":"2026-04-24T16:56:53Z","title":"Network Edge Inference for Large Language Models: Principles, Techniques, and Opportunities","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-05-08T09:45:57.201837Z"},"links":{"cited_paper":"/paper/2110.14895","citing_paper":"/paper/2604.22906"},"observation_digest":"sha256:7079c183cd9434d155beb2c886d7f651c3f263282923645e2469cde32c43dcc0","observation_id":"7bacd580-cb66-4e4e-8e5f-19faea510a60","resolution":{"observed_at":"2026-05-11T20:16:10.418868Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"e826ebfb-8c5e-4431-9a60-109e8933ec88","year":2025},"citing_paper":{"arxiv_id":"2604.22906","last_updated":"2026-04-24T16:56:53Z","snapshot_observed_at":"2026-07-06T23:09:14.698490Z","submitted_at":"2026-04-24T16:56:53Z","title":"Network Edge Inference for Large Language Models: Principles, Techniques, and Opportunities","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-05-08T09:45:57.201837Z"},"links":{"citing_paper":"/paper/2604.22906"},"observation_digest":"sha256:30b5ab35e3fbf1a388faf90b1feeaa1dfb923818a4333610b3ab1564d7467008","observation_id":"51f2121a-7c45-4c66-b7d1-0f6ed96a43f2","resolution":{"observed_at":"2026-05-26T15:47:59.551866Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"31b8bbb9-1a75-453a-b462-d49b1540e7a1","year":2021},"citing_paper":{"arxiv_id":"2604.22906","last_updated":"2026-04-24T16:56:53Z","snapshot_observed_at":"2026-07-06T23:09:14.698490Z","submitted_at":"2026-04-24T16:56:53Z","title":"Network Edge Inference for Large Language Models: Principles, Techniques, and Opportunities","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-05-08T09:45:57.201837Z"},"links":{"citing_paper":"/paper/2604.22906"},"observation_digest":"sha256:1166cbaecde22c397a3f8788dc639f70ac7c1c62e2d1df2ceb00c1ef02c00947","observation_id":"8f829e8d-7d4a-488d-a5ae-556d7907eb13","resolution":{"observed_at":"2026-05-26T15:47:59.544526Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"6d42b20b-f7dd-4764-904d-284773ecfccc","year":2019},"citing_paper":{"arxiv_id":"2604.22906","last_updated":"2026-04-24T16:56:53Z","snapshot_observed_at":"2026-07-06T23:09:14.698490Z","submitted_at":"2026-04-24T16:56:53Z","title":"Network Edge Inference for Large Language Models: Principles, Techniques, and Opportunities","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-05-08T09:45:57.201837Z"},"links":{"citing_paper":"/paper/2604.22906"},"observation_digest":"sha256:54bb6dc2de717084c1fb7cad4f709863d69cff6fdb8280a0d3a8ec73b39c9d48","observation_id":"bb2cdca7-87c3-4d82-b709-2ba892fd838f","resolution":{"observed_at":"2026-05-26T15:47:59.567582Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"339935b0-e686-4dce-b022-0584bb2e1810","year":2021},"citing_paper":{"arxiv_id":"2604.22906","last_updated":"2026-04-24T16:56:53Z","snapshot_observed_at":"2026-07-06T23:09:14.698490Z","submitted_at":"2026-04-24T16:56:53Z","title":"Network Edge Inference for Large Language Models: Principles, Techniques, and Opportunities","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-05-08T09:45:57.201837Z"},"links":{"citing_paper":"/paper/2604.22906"},"observation_digest":"sha256:c62110e6a1b9e4fd743b09d08c191b3675607a218713fb9b0c4a95780fcc0398","observation_id":"21ac28e4-317c-468d-af14-98fe0f236e7e","resolution":{"observed_at":"2026-05-26T15:47:59.532125Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12186","last_updated":"2024-11-12T13:24:25Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-09-18T17:57:57Z","title":"Qwen2.5-Coder Technical Report","version":3},"cited_work":{"arxiv_id":"2409.12186","doi":"10.48550/arxiv.2409.12186","metadata_source":"pith","pith_arxiv_id":"2409.12186","snapshot_observed_at":"2026-07-10T16:07:20.290468Z","title":"Qwen2.5-Coder Technical Report","venue":"cs.CL","work_id":"09ba463d-6377-4017-9801-444ffb94b056","year":2024},"citing_paper":{"arxiv_id":"2604.22906","last_updated":"2026-04-24T16:56:53Z","snapshot_observed_at":"2026-07-06T23:09:14.698490Z","submitted_at":"2026-04-24T16:56:53Z","title":"Network Edge Inference for Large Language Models: Principles, Techniques, and Opportunities","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-05-08T09:45:57.201837Z"},"links":{"cited_paper":"/paper/2409.12186","citing_paper":"/paper/2604.22906"},"observation_digest":"sha256:c18778a4d515d88f6414204b9bbb3602a63fc3d2a53f1c5d2e483825538cd2e0","observation_id":"64ee13b0-8589-407d-92a7-05ea07c5c323","resolution":{"observed_at":"2026-05-11T20:16:10.452943Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-07-11T05:18:55.772185+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T05:18:55.772185+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"41b82773-7b01-497e-9857-57f03b56b1d9","year":2018},"citing_paper":{"arxiv_id":"2604.22906","last_updated":"2026-04-24T16:56:53Z","snapshot_observed_at":"2026-07-06T23:09:14.698490Z","submitted_at":"2026-04-24T16:56:53Z","title":"Network Edge Inference for Large Language Models: Principles, Techniques, and Opportunities","version":1},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-05-08T09:45:57.201837Z"},"links":{"citing_paper":"/paper/2604.22906"},"observation_digest":"sha256:44007dc00bd7e8dd3ef07a1d7f282d301ecaec5af8627e09189d818c7c35fdcc","observation_id":"2bb97dd9-038b-45a2-b9c8-7a58087c20d5","resolution":{"observed_at":"2026-05-26T15:47:59.534956Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06825","last_updated":"2023-10-10T17:54:58Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-10-10T17:54:58Z","title":"Mistral 7B","version":1},"cited_work":{"arxiv_id":"2310.06825","doi":"10.48550/arxiv.2310.06825","metadata_source":"pith","pith_arxiv_id":"2310.06825","snapshot_observed_at":"2026-07-10T14:47:14.537301Z","title":"Mistral 7B","venue":"cs.CL","work_id":"eb5e1305-ad11-4875-ad8d-ad8b8f697599","year":2023},"citing_paper":{"arxiv_id":"2604.22906","last_updated":"2026-04-24T16:56:53Z","snapshot_observed_at":"2026-07-06T23:09:14.698490Z","submitted_at":"2026-04-24T16:56:53Z","title":"Network Edge Inference for Large Language Models: Principles, Techniques, and Opportunities","version":1},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-05-08T09:45:57.201837Z"},"links":{"cited_paper":"/paper/2310.06825","citing_paper":"/paper/2604.22906"},"observation_digest":"sha256:dd769f5a5dfe875ac0d3b2fac9efe21642e99383e5101af019b2a2f5ce937cc5","observation_id":"b5c2b0ef-d645-4ccd-a48b-d686b7ed56cd","resolution":{"observed_at":"2026-05-11T20:16:10.540313Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-02T03:08:12.282824+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-02T03:08:12.282824+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.04088","last_updated":"2024-01-08T18:47:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-01-08T18:47:34Z","title":"Mixtral of Experts","version":1},"cited_work":{"arxiv_id":"2401.04088","doi":"10.48550/arxiv.2401.04088","metadata_source":"pith","pith_arxiv_id":"2401.04088","snapshot_observed_at":"2026-07-11T03:27:47.028679Z","title":"Mixtral of Experts","venue":"cs.LG","work_id":"0de8c352-9daa-4e1e-8c7b-3d0dec69f369","year":2024},"citing_paper":{"arxiv_id":"2604.22906","last_updated":"2026-04-24T16:56:53Z","snapshot_observed_at":"2026-07-06T23:09:14.698490Z","submitted_at":"2026-04-24T16:56:53Z","title":"Network Edge Inference for Large Language Models: Principles, Techniques, and Opportunities","version":1},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-05-08T09:45:57.201837Z"},"links":{"cited_paper":"/paper/2401.04088","citing_paper":"/paper/2604.22906"},"observation_digest":"sha256:e10e551fb704c5699b2ad22bdaab784db801b948af116767a167e269ca2a0f2c","observation_id":"e1cd307b-041c-40d6-992b-5b7ba6a162d7","resolution":{"observed_at":"2026-05-11T20:16:10.411353Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-07-09T08:48:39.110013+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-09T08:48:39.110013+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.01142","last_updated":"2024-11-02T05:15:44Z","snapshot_observed_at":"2026-07-06T19:43:59.326124Z","submitted_at":"2024-11-02T05:15:44Z","title":"NEO: Saving GPU Memory Crisis with CPU Offloading for Online LLM Inference","version":1},"cited_work":{"arxiv_id":"2411.01142","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2411.01142","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Neo: Saving gpu memory crisis with cpu offloading for online llm inference.arXiv preprint arXiv:2411.01142, 2024b","venue":null,"work_id":"236d1d0d-ddba-4520-8c9e-701671ea8ec9","year":2024},"citing_paper":{"arxiv_id":"2604.22906","last_updated":"2026-04-24T16:56:53Z","snapshot_observed_at":"2026-07-06T23:09:14.698490Z","submitted_at":"2026-04-24T16:56:53Z","title":"Network Edge Inference for Large Language Models: Principles, Techniques, and Opportunities","version":1},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-05-08T09:45:57.201837Z"},"links":{"cited_paper":"/paper/2411.01142","citing_paper":"/paper/2604.22906"},"observation_digest":"sha256:9b62b93d6a772c2d32b382bd7bb4ed3d515bb9e1b3d3a65b4082a5df93d607a2","observation_id":"014ae315-e287-4f6d-8774-a13586751f2d","resolution":{"observed_at":"2026-05-11T20:16:10.221722Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"9f07d6b9-db07-414f-b6f3-2c5bff3734d1","year":2023},"citing_paper":{"arxiv_id":"2604.22906","last_updated":"2026-04-24T16:56:53Z","snapshot_observed_at":"2026-07-06T23:09:14.698490Z","submitted_at":"2026-04-24T16:56:53Z","title":"Network Edge Inference for Large Language Models: Principles, Techniques, and Opportunities","version":1},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-05-08T09:45:57.201837Z"},"links":{"citing_paper":"/paper/2604.22906"},"observation_digest":"sha256:102fc17f06004be656b53ea54096fcf9579989811571902101920910b4a38c4e","observation_id":"3ca446b1-0817-4e67-91a7-bd882fbde0a3","resolution":{"observed_at":"2026-05-26T15:47:59.555186Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"983cc72f-ba43-4aa5-968d-7a6c6f217e30","year":2024},"citing_paper":{"arxiv_id":"2604.22906","last_updated":"2026-04-24T16:56:53Z","snapshot_observed_at":"2026-07-06T23:09:14.698490Z","submitted_at":"2026-04-24T16:56:53Z","title":"Network Edge Inference for Large Language Models: Principles, Techniques, and Opportunities","version":1},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-05-08T09:45:57.201837Z"},"links":{"citing_paper":"/paper/2604.22906"},"observation_digest":"sha256:2a745ddd4ceb96e7c563607d41433cda91a00a4af14d3dda160a729619353a0d","observation_id":"88c497ea-01ba-4c29-a58a-09c700ca049c","resolution":{"observed_at":"2026-05-26T15:47:59.525733Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.02533","last_updated":"2025-05-05T10:16:16Z","snapshot_observed_at":"2026-07-06T21:19:00.235271Z","submitted_at":"2025-05-05T10:16:16Z","title":"Large Language Model Partitioning for Low-Latency Inference at the Edge","version":1},"cited_work":{"arxiv_id":"2505.02533","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.02533","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"3c54de77-56a8-478a-b803-33ea87d5963d","year":2025},"citing_paper":{"arxiv_id":"2604.22906","last_updated":"2026-04-24T16:56:53Z","snapshot_observed_at":"2026-07-06T23:09:14.698490Z","submitted_at":"2026-04-24T16:56:53Z","title":"Network Edge Inference for Large Language Models: Principles, Techniques, and Opportunities","version":1},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-05-08T09:45:57.201837Z"},"links":{"cited_paper":"/paper/2505.02533","citing_paper":"/paper/2604.22906"},"observation_digest":"sha256:012555117b91c75c3c782fcee83ae948594bbca0dd691d5f3be0fd53be1e063a","observation_id":"16d738a7-7593-408d-b3bb-463e39467121","resolution":{"observed_at":"2026-05-11T20:16:10.529259Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2001.08361","last_updated":"2020-01-23T03:59:20Z","snapshot_observed_at":"2026-07-06T08:52:12.656082Z","submitted_at":"2020-01-23T03:59:20Z","title":"Scaling Laws for Neural Language Models","version":1},"cited_work":{"arxiv_id":"2001.08361","doi":"10.1145/3616855.3635845","metadata_source":"pith","pith_arxiv_id":"2001.08361","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Scaling Laws for Neural Language Models","venue":"cs.LG","work_id":"b7dd8749-9c45-4977-ab9b-64478dce1ae8","year":2020},"citing_paper":{"arxiv_id":"2604.22906","last_updated":"2026-04-24T16:56:53Z","snapshot_observed_at":"2026-07-06T23:09:14.698490Z","submitted_at":"2026-04-24T16:56:53Z","title":"Network Edge Inference for Large Language Models: Principles, Techniques, and Opportunities","version":1},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-05-08T09:45:57.201837Z"},"links":{"cited_paper":"/paper/2001.08361","citing_paper":"/paper/2604.22906"},"observation_digest":"sha256:c46aef79dc1d4e57ff56f64666ce85d5a00d1d905c9a3b44796d7d39d8eb95b7","observation_id":"6a3586dd-7a0c-4259-90d9-413ffcda75ad","resolution":{"observed_at":"2026-05-11T20:16:10.396954Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.13019","last_updated":"2024-05-24T07:40:27Z","snapshot_observed_at":"2026-07-06T18:17:29.822273Z","submitted_at":"2024-05-15T07:36:56Z","title":"A Comprehensive Survey of Accelerated Generation Techniques in Large Language Models","version":2},"cited_work":{"arxiv_id":"2405.13019","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2405.13019","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"A comprehensive survey of accelerated gener- ation techniques in large language models.arXiv preprint arXiv:2405.13019","venue":null,"work_id":"ef1aaedf-90e5-4916-8001-f3d70e5a6fcb","year":2024},"citing_paper":{"arxiv_id":"2604.22906","last_updated":"2026-04-24T16:56:53Z","snapshot_observed_at":"2026-07-06T23:09:14.698490Z","submitted_at":"2026-04-24T16:56:53Z","title":"Network Edge Inference for Large Language Models: Principles, Techniques, and Opportunities","version":1},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-05-08T09:45:57.201837Z"},"links":{"cited_paper":"/paper/2405.13019","citing_paper":"/paper/2604.22906"},"observation_digest":"sha256:34b4f74e6ca2116cfa63cfaa585bc8abefe5fc4fe467a1d8eb7f3d4498a202fc","observation_id":"ae3063bf-425c-40c1-8a58-d912d123478d","resolution":{"observed_at":"2026-05-11T20:16:10.494626Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1806.08342","last_updated":"2018-06-21T17:32:46Z","snapshot_observed_at":"2026-07-06T06:46:08.396066Z","submitted_at":"2018-06-21T17:32:46Z","title":"Quantizing deep convolutional networks for efficient inference: A whitepaper","version":1},"cited_work":{"arxiv_id":"1806.08342","doi":"10.48550/arxiv.1806.08342","metadata_source":"pith","pith_arxiv_id":"1806.08342","snapshot_observed_at":"2026-07-10T13:57:06.933735Z","title":"Quantizing deep convolutional networks for efficient inference: A whitepaper","venue":"cs.LG","work_id":"c5b5b22a-9bfc-4500-9a92-2813e7603693","year":2018},"citing_paper":{"arxiv_id":"2604.22906","last_updated":"2026-04-24T16:56:53Z","snapshot_observed_at":"2026-07-06T23:09:14.698490Z","submitted_at":"2026-04-24T16:56:53Z","title":"Network Edge Inference for Large Language Models: Principles, Techniques, and Opportunities","version":1},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-05-08T09:45:57.201837Z"},"links":{"cited_paper":"/paper/1806.08342","citing_paper":"/paper/2604.22906"},"observation_digest":"sha256:4d6188ff9e15a1866a52c12294cf69b82ebc844f55654e257455386048d37a84","observation_id":"3b934fc4-e386-4114-86d8-39091814c3ef","resolution":{"observed_at":"2026-05-11T20:16:10.326755Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"9d13ef9a-5c06-4fe3-b895-f80b642cc5e3","year":2023},"citing_paper":{"arxiv_id":"2604.22906","last_updated":"2026-04-24T16:56:53Z","snapshot_observed_at":"2026-07-06T23:09:14.698490Z","submitted_at":"2026-04-24T16:56:53Z","title":"Network Edge Inference for Large Language Models: Principles, Techniques, and Opportunities","version":1},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-05-08T09:45:57.201837Z"},"links":{"citing_paper":"/paper/2604.22906"},"observation_digest":"sha256:08474f014bc0c92356ba66d8b50167b9d3c01c4750c751859bf4c218afb15ced","observation_id":"468b79bb-6791-4473-857b-8d22e7b250b5","resolution":{"observed_at":"2026-05-26T15:47:59.501361Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"e6b909c7-913b-4463-84a5-ce3cd3cdaa04","year":2023},"citing_paper":{"arxiv_id":"2604.22906","last_updated":"2026-04-24T16:56:53Z","snapshot_observed_at":"2026-07-06T23:09:14.698490Z","submitted_at":"2026-04-24T16:56:53Z","title":"Network Edge Inference for Large Language Models: Principles, Techniques, and Opportunities","version":1},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-05-08T09:45:57.201837Z"},"links":{"citing_paper":"/paper/2604.22906"},"observation_digest":"sha256:27cb9bfbb1a55db3bb0d9d4955582848aaed82b0f3fcc25f88f4658a628e0741","observation_id":"0d04f59e-c139-4530-b991-732dc4f8fb03","resolution":{"observed_at":"2026-05-26T15:47:59.528754Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1909.11942","last_updated":"2020-02-09T03:00:18Z","snapshot_observed_at":"2026-07-06T08:24:44.631342Z","submitted_at":"2019-09-26T07:06:13Z","title":"ALBERT: A Lite BERT for Self-supervised Learning of Language Representations","version":6},"cited_work":{"arxiv_id":"1909.11942","doi":"10.48550/arxiv.1909.11942","metadata_source":"pith","pith_arxiv_id":"1909.11942","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"ALBERT: A Lite BERT for Self-supervised Learning of Language Representations","venue":"cs.CL","work_id":"aedf7950-7c35-4e28-a32d-bec290f51669","year":2019},"citing_paper":{"arxiv_id":"2604.22906","last_updated":"2026-04-24T16:56:53Z","snapshot_observed_at":"2026-07-06T23:09:14.698490Z","submitted_at":"2026-04-24T16:56:53Z","title":"Network Edge Inference for Large Language Models: Principles, Techniques, and Opportunities","version":1},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-05-08T09:45:57.201837Z"},"links":{"cited_paper":"/paper/1909.11942","citing_paper":"/paper/2604.22906"},"observation_digest":"sha256:f6ae5d8ca5c5aacf7f8ae40f251c449c98b628c8179d374882d83d35e96c71a0","observation_id":"d53288ac-5709-4b1d-ac6c-a2b6dd50dd96","resolution":{"observed_at":"2026-05-13T12:26:58.164513Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"66c6392c-3819-40a9-9ef7-03ce353696cc","year":2010},"citing_paper":{"arxiv_id":"2604.22906","last_updated":"2026-04-24T16:56:53Z","snapshot_observed_at":"2026-07-06T23:09:14.698490Z","submitted_at":"2026-04-24T16:56:53Z","title":"Network Edge Inference for Large Language Models: Principles, Techniques, and Opportunities","version":1},"reference_index":88,"source":"pdf_text","source_observed_at":"2026-05-08T09:45:57.201837Z"},"links":{"citing_paper":"/paper/2604.22906"},"observation_digest":"sha256:9712209ff48a54c580cb15bd3a47c54bef1907ff77ac887abc3b0bdbb80d6412","observation_id":"c4ac1b1f-aeb1-46ff-bb6f-7468353d8042","resolution":{"observed_at":"2026-05-26T15:47:59.498232Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Larsson, Ove Edfors, Fredrik Tufvesson, and Tho mas L","venue":null,"work_id":"784c16c0-c703-4faa-ae8c-fe0aaaac82a3","year":2014},"citing_paper":{"arxiv_id":"2604.22906","last_updated":"2026-04-24T16:56:53Z","snapshot_observed_at":"2026-07-06T23:09:14.698490Z","submitted_at":"2026-04-24T16:56:53Z","title":"Network Edge Inference for Large Language Models: Principles, Techniques, and Opportunities","version":1},"reference_index":89,"source":"pdf_text","source_observed_at":"2026-05-08T09:45:57.201837Z"},"links":{"citing_paper":"/paper/2604.22906"},"observation_digest":"sha256:c743136d0b9f8827053c0c64e049fc269590e231b7e1019fc9d7be99def82c07","observation_id":"45cad72a-bbfe-4859-89a3-e799aa2b82ad","resolution":{"observed_at":"2026-05-26T15:47:59.491435Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1802.06901","last_updated":"2018-08-27T18:00:08Z","snapshot_observed_at":"2026-07-06T06:24:15.593553Z","submitted_at":"2018-02-19T22:57:54Z","title":"Deterministic Non-Autoregressive Neural Sequence Modeling by Iterative Refinement","version":3},"cited_work":{"arxiv_id":"1802.06901","doi":null,"metadata_source":"pith","pith_arxiv_id":"1802.06901","snapshot_observed_at":"2026-07-03T17:38:43.588655Z","title":"Deterministic Non-Autoregressive Neural Sequence Modeling by Iterative Refinement","venue":"cs.LG","work_id":"4ad4252d-dd49-416b-a94d-9dfec482f0f0","year":2018},"citing_paper":{"arxiv_id":"2604.22906","last_updated":"2026-04-24T16:56:53Z","snapshot_observed_at":"2026-07-06T23:09:14.698490Z","submitted_at":"2026-04-24T16:56:53Z","title":"Network Edge Inference for Large Language Models: Principles, Techniques, and Opportunities","version":1},"reference_index":90,"source":"pdf_text","source_observed_at":"2026-05-08T09:45:57.201837Z"},"links":{"cited_paper":"/paper/1802.06901","citing_paper":"/paper/2604.22906"},"observation_digest":"sha256:74e31604024b061351086a07b48dc10d2aba21e7e77a8ea84b8c5973b0cfb4ce","observation_id":"e0965329-eca0-4a82-b1bc-4ea478d0a999","resolution":{"observed_at":"2026-05-11T20:16:10.449209Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"942513b6-d85f-49f8-b2c5-d5f74868b1a2","year":2024},"citing_paper":{"arxiv_id":"2604.22906","last_updated":"2026-04-24T16:56:53Z","snapshot_observed_at":"2026-07-06T23:09:14.698490Z","submitted_at":"2026-04-24T16:56:53Z","title":"Network Edge Inference for Large Language Models: Principles, Techniques, and Opportunities","version":1},"reference_index":91,"source":"pdf_text","source_observed_at":"2026-05-08T09:45:57.201837Z"},"links":{"citing_paper":"/paper/2604.22906"},"observation_digest":"sha256:f2af24a045438094440a40eb516e90aa9a667a3c4d631aef69fef377a53cf6e1","observation_id":"0f639cd5-cec4-4f9c-bd3f-20fcd49c478f","resolution":{"observed_at":"2026-05-26T15:47:59.508055Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"ae7e6f1c-fced-41d9-b3e3-4a9c620203c6","year":2024},"citing_paper":{"arxiv_id":"2604.22906","last_updated":"2026-04-24T16:56:53Z","snapshot_observed_at":"2026-07-06T23:09:14.698490Z","submitted_at":"2026-04-24T16:56:53Z","title":"Network Edge Inference for Large Language Models: Principles, Techniques, and Opportunities","version":1},"reference_index":92,"source":"pdf_text","source_observed_at":"2026-05-08T09:45:57.201837Z"},"links":{"citing_paper":"/paper/2604.22906"},"observation_digest":"sha256:2205b670030d7345b02d6eaa0ad16ffb75a88ff76951263f4824ff43a793bc1b","observation_id":"52b05ca3-b4b5-4424-9836-d60d8ec8319e","resolution":{"observed_at":"2026-05-26T15:47:59.454377Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.19442","last_updated":"2025-07-30T05:24:46Z","snapshot_observed_at":"2026-07-06T20:13:31.499259Z","submitted_at":"2024-12-27T04:17:57Z","title":"A Survey on Large Language Model Acceleration based on KV Cache Management","version":3},"cited_work":{"arxiv_id":"2412.19442","doi":"10.48550/arxiv.2412.19442","metadata_source":"pith","pith_arxiv_id":"2412.19442","snapshot_observed_at":"2026-07-11T00:17:46.310687Z","title":"A survey on large lan- guage model acceleration based on kv cache management","venue":"cs.AI","work_id":"5ad86189-256c-4911-bb00-fbfc90ae9a4e","year":2024},"citing_paper":{"arxiv_id":"2604.22906","last_updated":"2026-04-24T16:56:53Z","snapshot_observed_at":"2026-07-06T23:09:14.698490Z","submitted_at":"2026-04-24T16:56:53Z","title":"Network Edge Inference for Large Language Models: Principles, Techniques, and Opportunities","version":1},"reference_index":93,"source":"pdf_text","source_observed_at":"2026-05-08T09:45:57.201837Z"},"links":{"cited_paper":"/paper/2412.19442","citing_paper":"/paper/2604.22906"},"observation_digest":"sha256:f0169eb61b59c90aac5265bfeff29e0cc820699824e7f7ae4ae69fad88410731","observation_id":"5e77c088-5647-4f8f-b62a-fad5b1f30a78","resolution":{"observed_at":"2026-05-11T20:16:10.280024Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-07-10T18:20:05.433835+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-10T18:20:05.433835+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2012.14682","last_updated":"2021-09-03T13:51:39Z","snapshot_observed_at":"2026-08-04T01:29:28.852485Z","submitted_at":"2020-12-29T09:43:50Z","title":"CascadeBERT: Accelerating Inference of Pre-trained Language Models via Calibrated Complete Models Cascade","version":2},"cited_work":{"arxiv_id":"2012.14682","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2012.14682","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"25099def-3a64-4d74-8603-eaac4d0ff5c8","year":2020},"citing_paper":{"arxiv_id":"2604.22906","last_updated":"2026-04-24T16:56:53Z","snapshot_observed_at":"2026-07-06T23:09:14.698490Z","submitted_at":"2026-04-24T16:56:53Z","title":"Network Edge Inference for Large Language Models: Principles, Techniques, and Opportunities","version":1},"reference_index":94,"source":"pdf_text","source_observed_at":"2026-05-08T09:45:57.201837Z"},"links":{"cited_paper":"/paper/2012.14682","citing_paper":"/paper/2604.22906"},"observation_digest":"sha256:0da739faaa9e7f5896666ece2a6420106861193bf676a72ef3439642a710c682","observation_id":"75c719aa-47bc-47ac-be6b-1cf8627ff0ab","resolution":{"observed_at":"2026-05-11T20:16:10.229507Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"4247752d-e19c-4ccf-a2bb-6526ff607744","year":2023},"citing_paper":{"arxiv_id":"2604.22906","last_updated":"2026-04-24T16:56:53Z","snapshot_observed_at":"2026-07-06T23:09:14.698490Z","submitted_at":"2026-04-24T16:56:53Z","title":"Network Edge Inference for Large Language Models: Principles, Techniques, and Opportunities","version":1},"reference_index":95,"source":"pdf_text","source_observed_at":"2026-05-08T09:45:57.201837Z"},"links":{"citing_paper":"/paper/2604.22906"},"observation_digest":"sha256:3fc57b873a629f49baec967e729957b6b748a13810773a0026b0cd7a70b9c22e","observation_id":"7455507a-1109-4751-9cc9-6177fe8660d9","resolution":{"observed_at":"2026-05-26T15:47:59.460396Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"1fc5677b-741f-4cab-8f91-4f77aa99e926","year":2024},"citing_paper":{"arxiv_id":"2604.22906","last_updated":"2026-04-24T16:56:53Z","snapshot_observed_at":"2026-07-06T23:09:14.698490Z","submitted_at":"2026-04-24T16:56:53Z","title":"Network Edge Inference for Large Language Models: Principles, Techniques, and Opportunities","version":1},"reference_index":96,"source":"pdf_text","source_observed_at":"2026-05-08T09:45:57.201837Z"},"links":{"citing_paper":"/paper/2604.22906"},"observation_digest":"sha256:543796fa3133225cde3f46ae7eeb5ea1d98d6d1c39bede3c86c9ba718d3915a6","observation_id":"a810e497-b01d-45fa-9b42-a86b8c879930","resolution":{"observed_at":"2026-05-26T15:47:59.442867Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"38f4a660-7586-4372-9356-c169d6b2be20","year":2022},"citing_paper":{"arxiv_id":"2604.22906","last_updated":"2026-04-24T16:56:53Z","snapshot_observed_at":"2026-07-06T23:09:14.698490Z","submitted_at":"2026-04-24T16:56:53Z","title":"Network Edge Inference for Large Language Models: Principles, Techniques, and Opportunities","version":1},"reference_index":97,"source":"pdf_text","source_observed_at":"2026-05-08T09:45:57.201837Z"},"links":{"citing_paper":"/paper/2604.22906"},"observation_digest":"sha256:ae7bd8ee80bd84013f288b69518326ea2564f6be4253310e338cc7db2ba3a4b6","observation_id":"092006a3-8121-4200-89b3-a474a5bf846d","resolution":{"observed_at":"2026-05-26T15:47:59.513407Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"e49c8380-d7e3-4de0-beb9-eb17c4bc0572","year":null},"citing_paper":{"arxiv_id":"2604.22906","last_updated":"2026-04-24T16:56:53Z","snapshot_observed_at":"2026-07-06T23:09:14.698490Z","submitted_at":"2026-04-24T16:56:53Z","title":"Network Edge Inference for Large Language Models: Principles, Techniques, and Opportunities","version":1},"reference_index":98,"source":"pdf_text","source_observed_at":"2026-05-08T09:45:57.201837Z"},"links":{"citing_paper":"/paper/2604.22906"},"observation_digest":"sha256:b2eb3287a8b414a26302cc4bd98fb81d07ff5635497a37fc80be8dab9ec521af","observation_id":"99ee0257-767e-4135-a67c-b62e6ef3d08e","resolution":{"observed_at":"2026-05-26T15:47:59.445564Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.19437","last_updated":"2025-02-18T17:26:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-27T04:03:16Z","title":"DeepSeek-V3 Technical Report","version":2},"cited_work":{"arxiv_id":"2412.19437","doi":"10.1016/j.neucom.2023.127063.url:https://www.sciencedirect","metadata_source":"pith","pith_arxiv_id":"2412.19437","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"DeepSeek-V3 Technical Report","venue":"cs.CL","work_id":"57d2791d-2219-4c31-a077-afc04b12a75c","year":2024},"citing_paper":{"arxiv_id":"2604.22906","last_updated":"2026-04-24T16:56:53Z","snapshot_observed_at":"2026-07-06T23:09:14.698490Z","submitted_at":"2026-04-24T16:56:53Z","title":"Network Edge Inference for Large Language Models: Principles, Techniques, and Opportunities","version":1},"reference_index":99,"source":"pdf_text","source_observed_at":"2026-05-08T09:45:57.201837Z"},"links":{"cited_paper":"/paper/2412.19437","citing_paper":"/paper/2604.22906"},"observation_digest":"sha256:019fdb8c977025ba9d8c31276d4706e61cffcedd0b2f7507fb026466c577358b","observation_id":"233769eb-2a8d-4bf0-921e-77db5376cdbe","resolution":{"observed_at":"2026-05-11T20:16:10.204099Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"fc0a70db-0e08-4897-9b65-d8a64dba7521","year":null},"citing_paper":{"arxiv_id":"2604.22906","last_updated":"2026-04-24T16:56:53Z","snapshot_observed_at":"2026-07-06T23:09:14.698490Z","submitted_at":"2026-04-24T16:56:53Z","title":"Network Edge Inference for Large Language Models: Principles, Techniques, and Opportunities","version":1},"reference_index":100,"source":"pdf_text","source_observed_at":"2026-05-08T09:45:57.201837Z"},"links":{"citing_paper":"/paper/2604.22906"},"observation_digest":"sha256:6dbc24194382f11a61686adb1e2f2ae52ce1e2448e0910560721cf4d1663a816","observation_id":"98f971d8-e1bf-40c5-a8e4-ecf7b0486f7b","resolution":{"observed_at":"2026-05-26T15:47:59.432621Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2604.22906","last_updated":"2026-04-24T16:56:53Z","latest_version":1,"primary_category":"cs.DC","snapshot_observed_at":"2026-07-06T23:09:14.698490Z","submitted_at":"2026-04-24T16:56:53Z","title":"Network Edge Inference for Large Language Models: Principles, Techniques, and Opportunities"},"reference_resolution":{"displayed":100,"state_counts":{"malformed_identifier":0,"metadata_mismatch":3,"parse_uncertain":0,"unresolved":60,"verified_exact":34,"verified_fuzzy":3},"total_outbound_references":214},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"thesis":"As of 4 August 2026, this Paper Citation Record lists 100 of 214 outbound references and 1 inbound Pith citation observation for arXiv:2604.22906."}