{"as_of":"2026-08-07T17:57:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:76c260b5b42af2a8e1f29d053bdd2a0e136729114459f8ca4e6b24c6bd9686aa","coverage":[{"denominator":59,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":59,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T21:39:19.825203Z","state":"measured"},{"denominator":59,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":59,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2506.23934/citation-record","integrity":"/paper/2506.23934/integrity","json":"/paper/2506.23934/citation-record.json","paper":"/paper/2506.23934"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:39:19.495590Z","title":"Imagenet classification with deep convolutional neural networks,","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2506.23934","last_updated":"2025-06-30T15:03:35Z","snapshot_observed_at":"2026-08-06T21:25:16.148067Z","submitted_at":"2025-06-30T15:03:35Z","title":"QPART: Adaptive Model Quantization and Dynamic Workload Balancing for Accuracy-aware Edge Inference","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T21:39:19.495590Z"},"links":{"citing_paper":"/paper/2506.23934"},"observation_digest":"sha256:a0538401cc536c4597fbaf325511af71d67f47c8078447d8cb49f928db7cf325","observation_id":"d351ed06-ad86-4f2d-9954-40e1bcf195f1","resolution":{"observed_at":"2026-08-06T21:39:19.495590Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1409.1556","last_updated":"2015-04-10T16:25:04Z","snapshot_observed_at":"2026-07-06T03:53:32.549552Z","submitted_at":"2014-09-04T19:48:04Z","title":"Very Deep Convolutional Networks for Large-Scale Image Recognition","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1409.1556","snapshot_observed_at":"2026-08-06T21:39:19.502347Z","title":"Very deep convolutional networks for large-scale image recognition,","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2506.23934","last_updated":"2025-06-30T15:03:35Z","snapshot_observed_at":"2026-08-06T21:25:16.148067Z","submitted_at":"2025-06-30T15:03:35Z","title":"QPART: Adaptive Model Quantization and Dynamic Workload Balancing for Accuracy-aware Edge Inference","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T21:39:19.502347Z"},"links":{"cited_paper":"/paper/1409.1556","citing_paper":"/paper/2506.23934"},"observation_digest":"sha256:c3c6578642216c84d9671e034471ef36bb961f66d7abf1c6f2b517b4d3c34a3d","observation_id":"ae6008e2-28fd-4b0f-8019-5d1940adfac7","resolution":{"observed_at":"2026-08-06T21:39:19.502347Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:39:20.804251Z","title":"Distributed representations of words and phrases and their composi- tionality,","venue":null,"work_id":"7f1d178f-7308-4d38-9270-92efe9c494c4","year":2013},"citing_paper":{"arxiv_id":"2506.23934","last_updated":"2025-06-30T15:03:35Z","snapshot_observed_at":"2026-08-06T21:25:16.148067Z","submitted_at":"2025-06-30T15:03:35Z","title":"QPART: Adaptive Model Quantization and Dynamic Workload Balancing for Accuracy-aware Edge Inference","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T21:39:19.507854Z"},"links":{"citing_paper":"/paper/2506.23934"},"observation_digest":"sha256:f3af6591071362b5b0815910b761f35e738c113ea2d8076192579442a05c2d9f","observation_id":"4c5380be-0aa3-40bc-8e7b-629fe2888ee4","resolution":{"observed_at":"2026-08-06T21:39:20.810872Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:39:19.513617Z","title":"Attention is all you need,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.23934","last_updated":"2025-06-30T15:03:35Z","snapshot_observed_at":"2026-08-06T21:25:16.148067Z","submitted_at":"2025-06-30T15:03:35Z","title":"QPART: Adaptive Model Quantization and Dynamic Workload Balancing for Accuracy-aware Edge Inference","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T21:39:19.513617Z"},"links":{"citing_paper":"/paper/2506.23934"},"observation_digest":"sha256:d7a68828f92aa26edd2b1cf294f3e3464c8e6796e1f0ab867b83cd22dfa05da2","observation_id":"046ae3fa-8364-49a4-8224-61a8211c71cc","resolution":{"observed_at":"2026-08-06T21:39:19.513617Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1604.07316","last_updated":"2016-04-25T16:03:56Z","snapshot_observed_at":"2026-07-06T04:53:59.754200Z","submitted_at":"2016-04-25T16:03:56Z","title":"End to End Learning for Self-Driving Cars","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1604.07316","snapshot_observed_at":"2026-08-06T21:39:19.520129Z","title":"End to end learning for self-driving cars,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2506.23934","last_updated":"2025-06-30T15:03:35Z","snapshot_observed_at":"2026-08-06T21:25:16.148067Z","submitted_at":"2025-06-30T15:03:35Z","title":"QPART: Adaptive Model Quantization and Dynamic Workload Balancing for Accuracy-aware Edge Inference","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T21:39:19.520129Z"},"links":{"cited_paper":"/paper/1604.07316","citing_paper":"/paper/2506.23934"},"observation_digest":"sha256:35744d363c323c6f3bdb440412be012d5f3e4681494af8061b7d27281ad0dbc8","observation_id":"bef7ba7d-5ae9-4126-9947-f7e857e90871","resolution":{"observed_at":"2026-08-06T21:39:19.520129Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:39:19.527124Z","title":"Efficient processing of deep neural networks: A tutorial and survey,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.23934","last_updated":"2025-06-30T15:03:35Z","snapshot_observed_at":"2026-08-06T21:25:16.148067Z","submitted_at":"2025-06-30T15:03:35Z","title":"QPART: Adaptive Model Quantization and Dynamic Workload Balancing for Accuracy-aware Edge Inference","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T21:39:19.527124Z"},"links":{"citing_paper":"/paper/2506.23934"},"observation_digest":"sha256:5718e4c46b24d2528f0f207aa288c509b576a2eec33df3a391c30e50c9f9ce6f","observation_id":"fa98c722-c405-451d-b094-60ef32b11ac9","resolution":{"observed_at":"2026-08-06T21:39:19.527124Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:39:19.534169Z","title":"Edge intelligence: Paving the last mile of artificial intelligence with edge computing,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.23934","last_updated":"2025-06-30T15:03:35Z","snapshot_observed_at":"2026-08-06T21:25:16.148067Z","submitted_at":"2025-06-30T15:03:35Z","title":"QPART: Adaptive Model Quantization and Dynamic Workload Balancing for Accuracy-aware Edge Inference","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T21:39:19.534169Z"},"links":{"citing_paper":"/paper/2506.23934"},"observation_digest":"sha256:42e18dc0efd9ca488eba8c1c2e1c70e3bb84991e8641395e4d7f6c5197f228af","observation_id":"43340d1a-8306-430f-b9b4-36833528ced3","resolution":{"observed_at":"2026-08-06T21:39:19.534169Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:39:20.754486Z","title":"Edge computing: Vision and challenges,","venue":null,"work_id":"f4ebf8a5-0e51-4ad8-8eb7-cae5ff3d862b","year":2016},"citing_paper":{"arxiv_id":"2506.23934","last_updated":"2025-06-30T15:03:35Z","snapshot_observed_at":"2026-08-06T21:25:16.148067Z","submitted_at":"2025-06-30T15:03:35Z","title":"QPART: Adaptive Model Quantization and Dynamic Workload Balancing for Accuracy-aware Edge Inference","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T21:39:19.539949Z"},"links":{"citing_paper":"/paper/2506.23934"},"observation_digest":"sha256:a9bf4f59992cedd0eb3a6b0d676233a44593a7959c71b759e09822b3bffcf3c4","observation_id":"17a8f6da-6a10-4c97-8433-54ae59a96aa0","resolution":{"observed_at":"2026-08-06T21:39:20.759619Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:39:20.738816Z","title":"Exploring edge tpu for network intrusion detection in iot,","venue":null,"work_id":"161a837e-6f9f-4467-9da0-6d09e63d7b4f","year":2023},"citing_paper":{"arxiv_id":"2506.23934","last_updated":"2025-06-30T15:03:35Z","snapshot_observed_at":"2026-08-06T21:25:16.148067Z","submitted_at":"2025-06-30T15:03:35Z","title":"QPART: Adaptive Model Quantization and Dynamic Workload Balancing for Accuracy-aware Edge Inference","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T21:39:19.546388Z"},"links":{"citing_paper":"/paper/2506.23934"},"observation_digest":"sha256:605a45dbe3769385fc732a117c7b88de41c5a50e6619c2c7b8198d1961dd453c","observation_id":"4c9cbc6d-7b46-4029-bcbd-32cf14ea9786","resolution":{"observed_at":"2026-08-06T21:39:20.743766Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:39:20.722161Z","title":"A survey on optimized implementation of deep learning models on the nvidia jetson platform,","venue":null,"work_id":"84a1f2e2-1bbd-4238-a71b-aea275a52d5e","year":2019},"citing_paper":{"arxiv_id":"2506.23934","last_updated":"2025-06-30T15:03:35Z","snapshot_observed_at":"2026-08-06T21:25:16.148067Z","submitted_at":"2025-06-30T15:03:35Z","title":"QPART: Adaptive Model Quantization and Dynamic Workload Balancing for Accuracy-aware Edge Inference","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T21:39:19.552473Z"},"links":{"citing_paper":"/paper/2506.23934"},"observation_digest":"sha256:560d8d4fb23a45c82a512fe1fe916710c55c35f48d1e9e39807f13ba4316c190","observation_id":"fdfdd3d1-717d-43ac-b0f5-9152863e3552","resolution":{"observed_at":"2026-08-06T21:39:20.727294Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:39:19.557828Z","title":"Mobilenetv2: Inverted residuals and linear bottlenecks,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.23934","last_updated":"2025-06-30T15:03:35Z","snapshot_observed_at":"2026-08-06T21:25:16.148067Z","submitted_at":"2025-06-30T15:03:35Z","title":"QPART: Adaptive Model Quantization and Dynamic Workload Balancing for Accuracy-aware Edge Inference","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T21:39:19.557828Z"},"links":{"citing_paper":"/paper/2506.23934"},"observation_digest":"sha256:a29afc88b36a3b295203ef25315b177151584104982eaa22b7098f3623c83291","observation_id":"f00af3bb-9485-49a2-9bfb-956dc5820ba8","resolution":{"observed_at":"2026-08-06T21:39:19.557828Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1905.11946","last_updated":"2020-09-11T05:08:01Z","snapshot_observed_at":"2026-08-06T22:36:56.473526Z","submitted_at":"2019-05-28T17:05:32Z","title":"EfficientNet: Rethinking Model Scaling for Convolutional Neural Networks","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1905.11946","snapshot_observed_at":"2026-08-06T21:39:19.564609Z","title":"Efficientnet: Rethinking model scaling for convolutional neural networks,","venue":null,"work_id":null,"year":1905},"citing_paper":{"arxiv_id":"2506.23934","last_updated":"2025-06-30T15:03:35Z","snapshot_observed_at":"2026-08-06T21:25:16.148067Z","submitted_at":"2025-06-30T15:03:35Z","title":"QPART: Adaptive Model Quantization and Dynamic Workload Balancing for Accuracy-aware Edge Inference","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T21:39:19.564609Z"},"links":{"cited_paper":"/paper/1905.11946","citing_paper":"/paper/2506.23934"},"observation_digest":"sha256:ea8ac078d1aba6ee0f9cf7c2c90e9efe045cbca714b0e99901f9013fe4a73d4b","observation_id":"7bd9a537-9464-4531-a645-b99880859ad7","resolution":{"observed_at":"2026-08-06T21:39:19.564609Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:39:20.692514Z","title":"Early stopping-but when?","venue":null,"work_id":"c38702f9-9d3c-4497-af66-0aa422416af8","year":2002},"citing_paper":{"arxiv_id":"2506.23934","last_updated":"2025-06-30T15:03:35Z","snapshot_observed_at":"2026-08-06T21:25:16.148067Z","submitted_at":"2025-06-30T15:03:35Z","title":"QPART: Adaptive Model Quantization and Dynamic Workload Balancing for Accuracy-aware Edge Inference","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T21:39:19.571668Z"},"links":{"citing_paper":"/paper/2506.23934"},"observation_digest":"sha256:6ce3f1eee8ad94e870dc777d3d5a8509b3033a1e248d241fdbda5a03051e5701","observation_id":"fe2b05fb-4b59-40b0-a433-e3a2fc7330fd","resolution":{"observed_at":"2026-08-06T21:39:20.698231Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:39:20.674213Z","title":"Single-layer vision trans- formers for more accurate early exits with less overhead,","venue":null,"work_id":"57485dce-c943-4604-bbee-b2f7df0bb746","year":2022},"citing_paper":{"arxiv_id":"2506.23934","last_updated":"2025-06-30T15:03:35Z","snapshot_observed_at":"2026-08-06T21:25:16.148067Z","submitted_at":"2025-06-30T15:03:35Z","title":"QPART: Adaptive Model Quantization and Dynamic Workload Balancing for Accuracy-aware Edge Inference","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T21:39:19.576616Z"},"links":{"citing_paper":"/paper/2506.23934"},"observation_digest":"sha256:f1a6695fbdf2c0a9359158d4252f12ee814ab1d98009e5e4f7d7075bfdeb90f4","observation_id":"b8f5c182-edd1-4173-a86f-f2b6df28fa84","resolution":{"observed_at":"2026-08-06T21:39:20.680691Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:39:20.658358Z","title":"1xn pattern for pruning convolutional neural networks,","venue":null,"work_id":"cfcbe349-2179-424b-8f6a-6fae6fffb2c6","year":2022},"citing_paper":{"arxiv_id":"2506.23934","last_updated":"2025-06-30T15:03:35Z","snapshot_observed_at":"2026-08-06T21:25:16.148067Z","submitted_at":"2025-06-30T15:03:35Z","title":"QPART: Adaptive Model Quantization and Dynamic Workload Balancing for Accuracy-aware Edge Inference","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T21:39:19.583049Z"},"links":{"citing_paper":"/paper/2506.23934"},"observation_digest":"sha256:8922fe2720819cd962800881c6f57fa6a1ef4c66d7fdfc59a89505db6030b39b","observation_id":"24d6a9ed-a5ef-41db-93e0-cbf872b27bb0","resolution":{"observed_at":"2026-08-06T21:39:20.663361Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1810.05270","last_updated":"2019-03-05T05:58:11Z","snapshot_observed_at":"2026-07-06T07:07:34.689643Z","submitted_at":"2018-10-11T22:15:28Z","title":"Rethinking the Value of Network Pruning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1810.05270","snapshot_observed_at":"2026-08-06T21:39:19.589415Z","title":"Rethinking the value of network pruning,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.23934","last_updated":"2025-06-30T15:03:35Z","snapshot_observed_at":"2026-08-06T21:25:16.148067Z","submitted_at":"2025-06-30T15:03:35Z","title":"QPART: Adaptive Model Quantization and Dynamic Workload Balancing for Accuracy-aware Edge Inference","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T21:39:19.589415Z"},"links":{"cited_paper":"/paper/1810.05270","citing_paper":"/paper/2506.23934"},"observation_digest":"sha256:d25c9e4902e3bc9713635902b9c7cf1a8e308e9d2a6c29c14139d449142165b0","observation_id":"d4f8d7aa-1a07-45f7-8964-bc509c304082","resolution":{"observed_at":"2026-08-06T21:39:19.589415Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:39:20.642199Z","title":"Fast and accurate streaming cnn infer- ence via communication compression on the edge,","venue":null,"work_id":"b0ade9fa-3fe1-4997-8b39-7a05d0f05cdb","year":2020},"citing_paper":{"arxiv_id":"2506.23934","last_updated":"2025-06-30T15:03:35Z","snapshot_observed_at":"2026-08-06T21:25:16.148067Z","submitted_at":"2025-06-30T15:03:35Z","title":"QPART: Adaptive Model Quantization and Dynamic Workload Balancing for Accuracy-aware Edge Inference","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T21:39:19.595467Z"},"links":{"citing_paper":"/paper/2506.23934"},"observation_digest":"sha256:6d57ef78027dce04b67b6cc55acce20da9a07bbfeed2d7c793df0be0c686fee3","observation_id":"00a20c81-f5c6-4dbd-b08b-5eb75fc3d467","resolution":{"observed_at":"2026-08-06T21:39:20.647187Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2004.04366","last_updated":"2020-04-09T04:58:46Z","snapshot_observed_at":"2026-08-07T16:46:47.062064Z","submitted_at":"2020-04-09T04:58:46Z","title":"Knowledge Distillation for Mobile Edge Computation Offloading","version":1},"cited_work":{"arxiv_id":"2004.04366","doi":null,"metadata_source":"pith","pith_arxiv_id":"2004.04366","snapshot_observed_at":"2026-08-06T21:39:19.946530Z","title":"Knowledge Distillation for Mobile Edge Computation Offloading","venue":"cs.NI","work_id":"b8347411-476e-4dbb-8bb5-c8937e88cedc","year":2020},"citing_paper":{"arxiv_id":"2506.23934","last_updated":"2025-06-30T15:03:35Z","snapshot_observed_at":"2026-08-06T21:25:16.148067Z","submitted_at":"2025-06-30T15:03:35Z","title":"QPART: Adaptive Model Quantization and Dynamic Workload Balancing for Accuracy-aware Edge Inference","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T21:39:19.601817Z"},"links":{"cited_paper":"/paper/2004.04366","citing_paper":"/paper/2506.23934"},"observation_digest":"sha256:01a57dad2ab33f15764e334115398366bea4f80a91e3d7b8d899501504ea314a","observation_id":"efceefb2-06ab-49d2-8fca-7cbf25626e0e","resolution":{"observed_at":"2026-08-06T21:39:19.952169Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:39:19.607271Z","title":"Neurosurgeon: Collaborative intelligence between the cloud and mobile edge,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.23934","last_updated":"2025-06-30T15:03:35Z","snapshot_observed_at":"2026-08-06T21:25:16.148067Z","submitted_at":"2025-06-30T15:03:35Z","title":"QPART: Adaptive Model Quantization and Dynamic Workload Balancing for Accuracy-aware Edge Inference","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T21:39:19.607271Z"},"links":{"citing_paper":"/paper/2506.23934"},"observation_digest":"sha256:6ede0fe556b7029fa22575a5e93930d57f212dce33908435d32f7d59a5b08688","observation_id":"46790171-a443-4ebc-b72f-2f36f7ab08c7","resolution":{"observed_at":"2026-08-06T21:39:19.607271Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:39:20.614139Z","title":"Edge assisted real-time object detec- JOURNAL OF LATEX CLASS FILES, VOL. 14, NO. 8, AUGUST 2021 12 tion for mobile augmented reality,","venue":null,"work_id":"c1945aab-5b04-40d5-9e43-9e1df25544b7","year":2021},"citing_paper":{"arxiv_id":"2506.23934","last_updated":"2025-06-30T15:03:35Z","snapshot_observed_at":"2026-08-06T21:25:16.148067Z","submitted_at":"2025-06-30T15:03:35Z","title":"QPART: Adaptive Model Quantization and Dynamic Workload Balancing for Accuracy-aware Edge Inference","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T21:39:19.612670Z"},"links":{"citing_paper":"/paper/2506.23934"},"observation_digest":"sha256:213e7fe071341a44ac08ce85f295ffbb3c3040bf906da10c83c924148cbbc798","observation_id":"f2f4b6de-ee94-4bc8-97d1-accbbc351181","resolution":{"observed_at":"2026-08-06T21:39:20.619879Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:39:20.597443Z","title":"Machine learning at face- book: Understanding inference at the edge,","venue":null,"work_id":"f129224c-308d-4b90-bf9e-0ed3063fdbec","year":2019},"citing_paper":{"arxiv_id":"2506.23934","last_updated":"2025-06-30T15:03:35Z","snapshot_observed_at":"2026-08-06T21:25:16.148067Z","submitted_at":"2025-06-30T15:03:35Z","title":"QPART: Adaptive Model Quantization and Dynamic Workload Balancing for Accuracy-aware Edge Inference","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T21:39:19.618033Z"},"links":{"citing_paper":"/paper/2506.23934"},"observation_digest":"sha256:5948eb4204081946b88774208656bc30635b0efb125b5a9eb86d72f70c4a134b","observation_id":"0eb223a7-1a00-4644-8c14-e56cf2414fde","resolution":{"observed_at":"2026-08-06T21:39:20.602496Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:39:20.580446Z","title":"From smart to deep: Robust activ- ity recognition on smartwatches using deep learning,","venue":null,"work_id":"03a73095-59d5-4d0c-bddd-f173991803fe","year":2016},"citing_paper":{"arxiv_id":"2506.23934","last_updated":"2025-06-30T15:03:35Z","snapshot_observed_at":"2026-08-06T21:25:16.148067Z","submitted_at":"2025-06-30T15:03:35Z","title":"QPART: Adaptive Model Quantization and Dynamic Workload Balancing for Accuracy-aware Edge Inference","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T21:39:19.623595Z"},"links":{"citing_paper":"/paper/2506.23934"},"observation_digest":"sha256:d70307fbd213e070ae59280a5ea0bdaed7a9d6a170667953bf30e2d3efe0a174","observation_id":"541dfd9a-7240-4ae4-b175-7bbf14c2d0b3","resolution":{"observed_at":"2026-08-06T21:39:20.586444Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:39:20.563758Z","title":"On- device learning systems for edge intelligence: A software and hardware synergy perspective,","venue":null,"work_id":"eab64fda-b6bb-4793-a62b-d215125147d0","year":2021},"citing_paper":{"arxiv_id":"2506.23934","last_updated":"2025-06-30T15:03:35Z","snapshot_observed_at":"2026-08-06T21:25:16.148067Z","submitted_at":"2025-06-30T15:03:35Z","title":"QPART: Adaptive Model Quantization and Dynamic Workload Balancing for Accuracy-aware Edge Inference","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T21:39:19.628390Z"},"links":{"citing_paper":"/paper/2506.23934"},"observation_digest":"sha256:7df22822888e7571685d20ab9d960cea56b4a179b71ac9d9ee5236e2b99a2c50","observation_id":"dcdbb5d8-54da-44b7-84bc-b03a8bf1fb82","resolution":{"observed_at":"2026-08-06T21:39:20.569781Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:39:20.547894Z","title":"Federated learning over wireless fading channels,","venue":null,"work_id":"8aaa0c6f-1b18-49cb-aea4-a0e17ca36e20","year":2020},"citing_paper":{"arxiv_id":"2506.23934","last_updated":"2025-06-30T15:03:35Z","snapshot_observed_at":"2026-08-06T21:25:16.148067Z","submitted_at":"2025-06-30T15:03:35Z","title":"QPART: Adaptive Model Quantization and Dynamic Workload Balancing for Accuracy-aware Edge Inference","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T21:39:19.633160Z"},"links":{"citing_paper":"/paper/2506.23934"},"observation_digest":"sha256:58dc678565fd2d5fab9826923d906df255a6972b135115ecc91737d1286cc1b5","observation_id":"c5e1af97-efc4-4961-8c66-0f1ddba2d797","resolution":{"observed_at":"2026-08-06T21:39:20.553160Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:39:19.638378Z","title":"A mathematical theory of communication,","venue":null,"work_id":null,"year":1948},"citing_paper":{"arxiv_id":"2506.23934","last_updated":"2025-06-30T15:03:35Z","snapshot_observed_at":"2026-08-06T21:25:16.148067Z","submitted_at":"2025-06-30T15:03:35Z","title":"QPART: Adaptive Model Quantization and Dynamic Workload Balancing for Accuracy-aware Edge Inference","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T21:39:19.638378Z"},"links":{"citing_paper":"/paper/2506.23934"},"observation_digest":"sha256:8d87fb10a02ee1c99405f80db3af6380931037ba516eccf57c647df337a80889","observation_id":"b126a1ef-b594-4b6a-b68e-3bee7279ee2c","resolution":{"observed_at":"2026-08-06T21:39:19.638378Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:39:20.520826Z","title":"Deep learning for healthcare: review, opportunities and challenges,","venue":null,"work_id":"f1047108-9fbe-418f-8b45-5e0182cc7581","year":2018},"citing_paper":{"arxiv_id":"2506.23934","last_updated":"2025-06-30T15:03:35Z","snapshot_observed_at":"2026-08-06T21:25:16.148067Z","submitted_at":"2025-06-30T15:03:35Z","title":"QPART: Adaptive Model Quantization and Dynamic Workload Balancing for Accuracy-aware Edge Inference","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T21:39:19.643678Z"},"links":{"citing_paper":"/paper/2506.23934"},"observation_digest":"sha256:1186e70c5a1f948d886604b68ef5e9dfa64757096e585862abac7e3a14a0a295","observation_id":"2e248a8c-3bf2-470b-a78b-72ea595fe839","resolution":{"observed_at":"2026-08-06T21:39:20.526198Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:39:20.505238Z","title":"Application of deep learning on iot-enabled smart grid monitoring,","venue":null,"work_id":"0c83d0b8-0cdb-485b-b439-4e003888f65d","year":2021},"citing_paper":{"arxiv_id":"2506.23934","last_updated":"2025-06-30T15:03:35Z","snapshot_observed_at":"2026-08-06T21:25:16.148067Z","submitted_at":"2025-06-30T15:03:35Z","title":"QPART: Adaptive Model Quantization and Dynamic Workload Balancing for Accuracy-aware Edge Inference","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T21:39:19.649059Z"},"links":{"citing_paper":"/paper/2506.23934"},"observation_digest":"sha256:bccec81abab000956dcf7c149d973a1a76d758518a51c4aca2bfdcbdb41ee5f9","observation_id":"ac9c8a65-4857-42e6-aab2-d41a28535b99","resolution":{"observed_at":"2026-08-06T21:39:20.510127Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:39:20.489819Z","title":"Recommended for you: The netflix prize and the production of algorithmic culture,","venue":null,"work_id":"29187f74-05f1-4b46-bff2-1fdcbab02739","year":2016},"citing_paper":{"arxiv_id":"2506.23934","last_updated":"2025-06-30T15:03:35Z","snapshot_observed_at":"2026-08-06T21:25:16.148067Z","submitted_at":"2025-06-30T15:03:35Z","title":"QPART: Adaptive Model Quantization and Dynamic Workload Balancing for Accuracy-aware Edge Inference","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T21:39:19.654380Z"},"links":{"citing_paper":"/paper/2506.23934"},"observation_digest":"sha256:134301e4e7472f9c238e5e32b85a092dcd7be4bc1a75e407c0dc23c7111f4060","observation_id":"8d0092bc-e24d-476b-843d-51bc03050ae9","resolution":{"observed_at":"2026-08-06T21:39:20.494744Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:39:20.474255Z","title":"Sentiment analysis with machine learning methods on social media,","venue":null,"work_id":"9367ea26-f7e7-456a-abca-d703867c739b","year":2020},"citing_paper":{"arxiv_id":"2506.23934","last_updated":"2025-06-30T15:03:35Z","snapshot_observed_at":"2026-08-06T21:25:16.148067Z","submitted_at":"2025-06-30T15:03:35Z","title":"QPART: Adaptive Model Quantization and Dynamic Workload Balancing for Accuracy-aware Edge Inference","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T21:39:19.659662Z"},"links":{"citing_paper":"/paper/2506.23934"},"observation_digest":"sha256:4d00b4bffcc01a1cea25d3f84a6400a8a53f7ba6b25a09d8ff24c26c5c3e9f06","observation_id":"b0c19d02-857b-45a7-b367-18a977f9bdbe","resolution":{"observed_at":"2026-08-06T21:39:20.479238Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1510.00149","last_updated":"2016-02-15T06:25:40Z","snapshot_observed_at":"2026-08-04T16:59:47.843960Z","submitted_at":"2015-10-01T09:03:44Z","title":"Deep Compression: Compressing Deep Neural Networks with Pruning, Trained Quantization and Huffman Coding","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1510.00149","snapshot_observed_at":"2026-08-06T21:39:19.665057Z","title":"Deep compression: Compressing deep neural networks with pruning, trained quantization and huffman coding,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2506.23934","last_updated":"2025-06-30T15:03:35Z","snapshot_observed_at":"2026-08-06T21:25:16.148067Z","submitted_at":"2025-06-30T15:03:35Z","title":"QPART: Adaptive Model Quantization and Dynamic Workload Balancing for Accuracy-aware Edge Inference","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T21:39:19.665057Z"},"links":{"cited_paper":"/paper/1510.00149","citing_paper":"/paper/2506.23934"},"observation_digest":"sha256:2cce4e942e612a79bd010882280c344f6357501f43adf8153b4cce17ec15fc6a","observation_id":"ff72a904-1c67-4ca9-9f68-43ad355853ba","resolution":{"observed_at":"2026-08-06T21:39:19.665057Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:39:20.458750Z","title":"Energy-efficient neural networks using approximate computation reuse,","venue":null,"work_id":"500d9cc4-08a6-4ba2-aa17-3c63d827e81c","year":2018},"citing_paper":{"arxiv_id":"2506.23934","last_updated":"2025-06-30T15:03:35Z","snapshot_observed_at":"2026-08-06T21:25:16.148067Z","submitted_at":"2025-06-30T15:03:35Z","title":"QPART: Adaptive Model Quantization and Dynamic Workload Balancing for Accuracy-aware Edge Inference","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T21:39:19.670511Z"},"links":{"citing_paper":"/paper/2506.23934"},"observation_digest":"sha256:0c27c38ccf83f26f7bf3b8c2730cfa4e88843790596d31332a26b01fac5526a8","observation_id":"57ff7678-8f97-4b5b-bd76-1b82b32f9ca1","resolution":{"observed_at":"2026-08-06T21:39:20.463535Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:39:20.443747Z","title":"Edge ai: On-demand accelerating deep neural network inference via edge computing,","venue":null,"work_id":"c336a3a2-cf3a-4df8-81be-c7826c09cb16","year":2019},"citing_paper":{"arxiv_id":"2506.23934","last_updated":"2025-06-30T15:03:35Z","snapshot_observed_at":"2026-08-06T21:25:16.148067Z","submitted_at":"2025-06-30T15:03:35Z","title":"QPART: Adaptive Model Quantization and Dynamic Workload Balancing for Accuracy-aware Edge Inference","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T21:39:19.675242Z"},"links":{"citing_paper":"/paper/2506.23934"},"observation_digest":"sha256:4aec508cf92ae73a94afee47dd204b19c53188259e3168d45d6f72d752c518db","observation_id":"85a2a24c-1fa1-4d58-b19b-7f91c1424450","resolution":{"observed_at":"2026-08-06T21:39:20.448842Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:39:20.427708Z","title":"Adaptive quantization for deep neural network,","venue":null,"work_id":"2e4a2497-48f7-42dd-8987-d81d97f7ffe4","year":2018},"citing_paper":{"arxiv_id":"2506.23934","last_updated":"2025-06-30T15:03:35Z","snapshot_observed_at":"2026-08-06T21:25:16.148067Z","submitted_at":"2025-06-30T15:03:35Z","title":"QPART: Adaptive Model Quantization and Dynamic Workload Balancing for Accuracy-aware Edge Inference","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T21:39:19.680175Z"},"links":{"citing_paper":"/paper/2506.23934"},"observation_digest":"sha256:3acec5e9c932366f5127844221d97526b0c1fce50dbaa008bf6e0291d7ab2ebc","observation_id":"6a892d18-6632-42ae-a36c-be28755c8ffc","resolution":{"observed_at":"2026-08-06T21:39:20.433539Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:39:20.411663Z","title":"Energy-aware inference offloading for dnn-driven applications in mobile edge clouds,","venue":null,"work_id":"75e460ad-061b-4157-860f-656be3257525","year":2020},"citing_paper":{"arxiv_id":"2506.23934","last_updated":"2025-06-30T15:03:35Z","snapshot_observed_at":"2026-08-06T21:25:16.148067Z","submitted_at":"2025-06-30T15:03:35Z","title":"QPART: Adaptive Model Quantization and Dynamic Workload Balancing for Accuracy-aware Edge Inference","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T21:39:19.685311Z"},"links":{"citing_paper":"/paper/2506.23934"},"observation_digest":"sha256:2b37208a39fb32848fbe8f9e0d0fd9a7c5c0a24d48749d4c407aad42a3e139e2","observation_id":"509eac9d-a92d-4cc4-8c11-01b4e8a7ddbf","resolution":{"observed_at":"2026-08-06T21:39:20.417382Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:39:20.393825Z","title":"Deep compressive offloading: Speeding up neural network inference by trading edge computation for network latency,","venue":null,"work_id":"a7321371-9885-47f2-81ba-9f6f17b652eb","year":2020},"citing_paper":{"arxiv_id":"2506.23934","last_updated":"2025-06-30T15:03:35Z","snapshot_observed_at":"2026-08-06T21:25:16.148067Z","submitted_at":"2025-06-30T15:03:35Z","title":"QPART: Adaptive Model Quantization and Dynamic Workload Balancing for Accuracy-aware Edge Inference","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T21:39:19.690274Z"},"links":{"citing_paper":"/paper/2506.23934"},"observation_digest":"sha256:d82a44266f66c2d1be98294100b84f7e895cd7b55f70e48be86f4de92edde945","observation_id":"3ba7a7c2-e4b7-4516-af70-edc2d22bbf44","resolution":{"observed_at":"2026-08-06T21:39:20.399681Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:39:20.377548Z","title":"Dis- tributed inference acceleration with adaptive dnn partitioning and of- floading,","venue":null,"work_id":"4daa4f74-b76e-4261-8d89-23ed121ff89a","year":2020},"citing_paper":{"arxiv_id":"2506.23934","last_updated":"2025-06-30T15:03:35Z","snapshot_observed_at":"2026-08-06T21:25:16.148067Z","submitted_at":"2025-06-30T15:03:35Z","title":"QPART: Adaptive Model Quantization and Dynamic Workload Balancing for Accuracy-aware Edge Inference","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T21:39:19.696624Z"},"links":{"citing_paper":"/paper/2506.23934"},"observation_digest":"sha256:b8b0fec9c7a07934fbcf4fa4cff3710898313d11bfa53477b0d41f09d18d48b1","observation_id":"2e76dccd-abf5-4351-9051-2decd94387e9","resolution":{"observed_at":"2026-08-06T21:39:20.382741Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:39:20.360343Z","title":"Computation offloading for fast cnn inference in edge computing,","venue":null,"work_id":"22ea801d-fda0-478e-b0e2-df00dac5c07e","year":2019},"citing_paper":{"arxiv_id":"2506.23934","last_updated":"2025-06-30T15:03:35Z","snapshot_observed_at":"2026-08-06T21:25:16.148067Z","submitted_at":"2025-06-30T15:03:35Z","title":"QPART: Adaptive Model Quantization and Dynamic Workload Balancing for Accuracy-aware Edge Inference","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T21:39:19.702467Z"},"links":{"citing_paper":"/paper/2506.23934"},"observation_digest":"sha256:92a44478bd0d0e96c98da6a7155ab4a8f9951688269bb9ba0d6b33d534c5cf81","observation_id":"cc004271-fbe7-4064-bdcd-a430a27099a6","resolution":{"observed_at":"2026-08-06T21:39:20.366033Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:39:20.338678Z","title":"Optimiza- tion of offloading policies for accuracy-delay tradeoffs in hierarchical inference,","venue":null,"work_id":"7afefd7f-f813-4e9a-9eef-f8852274acd8","year":2024},"citing_paper":{"arxiv_id":"2506.23934","last_updated":"2025-06-30T15:03:35Z","snapshot_observed_at":"2026-08-06T21:25:16.148067Z","submitted_at":"2025-06-30T15:03:35Z","title":"QPART: Adaptive Model Quantization and Dynamic Workload Balancing for Accuracy-aware Edge Inference","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-06T21:39:19.708615Z"},"links":{"citing_paper":"/paper/2506.23934"},"observation_digest":"sha256:43eb232dd951cfacc83d735d8f99597162b400fcfbd0f3059e28cff4dfff5fc2","observation_id":"ec961cc9-bebb-4d3d-b397-d5e838463c3e","resolution":{"observed_at":"2026-08-06T21:39:20.344318Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:39:20.321832Z","title":"Multi-agent deep reinforcement learning-based inference task schedul- ing and offloading for maximum inference accuracy under time and energy constraints,","venue":null,"work_id":"a76bb44a-8ed9-41c5-91b4-97d5037df4fb","year":2024},"citing_paper":{"arxiv_id":"2506.23934","last_updated":"2025-06-30T15:03:35Z","snapshot_observed_at":"2026-08-06T21:25:16.148067Z","submitted_at":"2025-06-30T15:03:35Z","title":"QPART: Adaptive Model Quantization and Dynamic Workload Balancing for Accuracy-aware Edge Inference","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T21:39:19.714648Z"},"links":{"citing_paper":"/paper/2506.23934"},"observation_digest":"sha256:2958e7f90e0ea3b20f9e63f2848fbdb5ae59ce8d6f2651c495420fb275f07ba6","observation_id":"9de7014b-d5e1-4c87-a094-276bba4cf9fd","resolution":{"observed_at":"2026-08-06T21:39:20.327769Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:39:20.304648Z","title":"{INFaaS}: Automated model-less inference serving,","venue":null,"work_id":"69b48627-9e21-48e7-959d-a9dd7ad1eefb","year":2021},"citing_paper":{"arxiv_id":"2506.23934","last_updated":"2025-06-30T15:03:35Z","snapshot_observed_at":"2026-08-06T21:25:16.148067Z","submitted_at":"2025-06-30T15:03:35Z","title":"QPART: Adaptive Model Quantization and Dynamic Workload Balancing for Accuracy-aware Edge Inference","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-06T21:39:19.720267Z"},"links":{"citing_paper":"/paper/2506.23934"},"observation_digest":"sha256:d5bdd864fe8387ac4fc79e11bd56f0acd36139008c232e1d3adf373b3913e16c","observation_id":"9d58aa05-0ea3-49c5-97a4-176edc518de6","resolution":{"observed_at":"2026-08-06T21:39:20.310804Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:39:20.287387Z","title":"Fann-on-mcu: An open-source toolkit for energy-efficient neural network inference at the edge of the internet of things,","venue":null,"work_id":"2d189a1e-7630-4138-b173-86bc4e1a4492","year":2020},"citing_paper":{"arxiv_id":"2506.23934","last_updated":"2025-06-30T15:03:35Z","snapshot_observed_at":"2026-08-06T21:25:16.148067Z","submitted_at":"2025-06-30T15:03:35Z","title":"QPART: Adaptive Model Quantization and Dynamic Workload Balancing for Accuracy-aware Edge Inference","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-06T21:39:19.726209Z"},"links":{"citing_paper":"/paper/2506.23934"},"observation_digest":"sha256:d618fd1b72d3c72bbb149aaf0249a4efc01d621aafe500398eb286b297c456d5","observation_id":"acbfd875-c711-4b6e-9d4b-186535ed52f8","resolution":{"observed_at":"2026-08-06T21:39:20.292639Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:39:20.270238Z","title":"Construct- ing energy-efficient mixed-precision neural networks through principal component analysis for edge intelligence,","venue":null,"work_id":"919281ab-9346-45b9-81f7-aaa1025efb07","year":2020},"citing_paper":{"arxiv_id":"2506.23934","last_updated":"2025-06-30T15:03:35Z","snapshot_observed_at":"2026-08-06T21:25:16.148067Z","submitted_at":"2025-06-30T15:03:35Z","title":"QPART: Adaptive Model Quantization and Dynamic Workload Balancing for Accuracy-aware Edge Inference","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-06T21:39:19.732699Z"},"links":{"citing_paper":"/paper/2506.23934"},"observation_digest":"sha256:5926fc936faf975afad2f2f1113a98b30294ec68698db2a3d21b1f82b93571d9","observation_id":"ee8af57e-d9d2-4e2d-baa9-366f5a3294e9","resolution":{"observed_at":"2026-08-06T21:39:20.275624Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:39:20.252684Z","title":"Decision early-exit: An efficient approach to hasten offloading in branchynets,","venue":null,"work_id":"51d387e6-33d0-4804-8f78-ad908fb9437f","year":2022},"citing_paper":{"arxiv_id":"2506.23934","last_updated":"2025-06-30T15:03:35Z","snapshot_observed_at":"2026-08-06T21:25:16.148067Z","submitted_at":"2025-06-30T15:03:35Z","title":"QPART: Adaptive Model Quantization and Dynamic Workload Balancing for Accuracy-aware Edge Inference","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-06T21:39:19.738276Z"},"links":{"citing_paper":"/paper/2506.23934"},"observation_digest":"sha256:20fc002826517553e4f0177cd5dc9dca19c62e4e5a47016525434466c13b81bf","observation_id":"1bf61d5f-d719-4fca-8d47-9765fe6e78c6","resolution":{"observed_at":"2026-08-06T21:39:20.258838Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:39:20.236990Z","title":"A deep reinforcement learning based research for optimal offloading decision,","venue":null,"work_id":"f69369b3-adde-4925-aa1c-9ed2dd43b193","year":2023},"citing_paper":{"arxiv_id":"2506.23934","last_updated":"2025-06-30T15:03:35Z","snapshot_observed_at":"2026-08-06T21:25:16.148067Z","submitted_at":"2025-06-30T15:03:35Z","title":"QPART: Adaptive Model Quantization and Dynamic Workload Balancing for Accuracy-aware Edge Inference","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-06T21:39:19.743806Z"},"links":{"citing_paper":"/paper/2506.23934"},"observation_digest":"sha256:e52b792bf47c7018c6f2e0c72ce4cd7635fdd97940c23334d63d6724ceba29b7","observation_id":"89d76a53-4fdb-4ca4-b5cf-c678adecbbb5","resolution":{"observed_at":"2026-08-06T21:39:20.242101Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:39:20.220893Z","title":"Improving device-edge cooperative inference of deep learning via 2-step pruning,","venue":null,"work_id":"fbb9ec13-31fd-466a-b70c-0245b47c4fc3","year":2019},"citing_paper":{"arxiv_id":"2506.23934","last_updated":"2025-06-30T15:03:35Z","snapshot_observed_at":"2026-08-06T21:25:16.148067Z","submitted_at":"2025-06-30T15:03:35Z","title":"QPART: Adaptive Model Quantization and Dynamic Workload Balancing for Accuracy-aware Edge Inference","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-06T21:39:19.749834Z"},"links":{"citing_paper":"/paper/2506.23934"},"observation_digest":"sha256:028858f0ec16312098e2793516886db3ebdfa50bf5b746a67a2b982f32a83736","observation_id":"a64a0083-8c77-4bd7-807a-ca78be6fda7d","resolution":{"observed_at":"2026-08-06T21:39:20.226137Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:39:20.202695Z","title":"Graph reinforcement learning-based cnn inference offloading in dynamic edge computing,","venue":null,"work_id":"ae9d1cff-809e-4b4d-bf0c-60b2f4efd75b","year":2022},"citing_paper":{"arxiv_id":"2506.23934","last_updated":"2025-06-30T15:03:35Z","snapshot_observed_at":"2026-08-06T21:25:16.148067Z","submitted_at":"2025-06-30T15:03:35Z","title":"QPART: Adaptive Model Quantization and Dynamic Workload Balancing for Accuracy-aware Edge Inference","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-06T21:39:19.757163Z"},"links":{"citing_paper":"/paper/2506.23934"},"observation_digest":"sha256:878d51b4a6a6567b1dcaa5cd8c14540977b451afd9d8722ac85200c12cdf2e13","observation_id":"361532fe-98d9-4a90-adcd-951a51ce857f","resolution":{"observed_at":"2026-08-06T21:39:20.208176Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:39:20.185420Z","title":"Adaee: Adaptive early-exit dnn inference through multi-armed bandits,","venue":null,"work_id":"6dd88307-dda1-49f6-9571-80f8f29d30eb","year":2023},"citing_paper":{"arxiv_id":"2506.23934","last_updated":"2025-06-30T15:03:35Z","snapshot_observed_at":"2026-08-06T21:25:16.148067Z","submitted_at":"2025-06-30T15:03:35Z","title":"QPART: Adaptive Model Quantization and Dynamic Workload Balancing for Accuracy-aware Edge Inference","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-06T21:39:19.762877Z"},"links":{"citing_paper":"/paper/2506.23934"},"observation_digest":"sha256:4977894ab8016e9366883bf2fb14d8e435e5dbed019cb4e899edfbae1361b8d5","observation_id":"79384222-4789-44c1-b7f0-b994714cd591","resolution":{"observed_at":"2026-08-06T21:39:20.190427Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:39:20.168799Z","title":"Optimizing job offloading schedule for collabora- tive dnn inference,","venue":null,"work_id":"1819ce1f-6309-4f42-ae83-0209a1cf8487","year":2023},"citing_paper":{"arxiv_id":"2506.23934","last_updated":"2025-06-30T15:03:35Z","snapshot_observed_at":"2026-08-06T21:25:16.148067Z","submitted_at":"2025-06-30T15:03:35Z","title":"QPART: Adaptive Model Quantization and Dynamic Workload Balancing for Accuracy-aware Edge Inference","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-06T21:39:19.768104Z"},"links":{"citing_paper":"/paper/2506.23934"},"observation_digest":"sha256:49a9d4cb5b03b1116c072d3a80325f4df07776161e166f831fdf0307250105e9","observation_id":"fccb6195-fadf-4428-8ab1-e60967e7d86d","resolution":{"observed_at":"2026-08-06T21:39:20.174523Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:39:20.152145Z","title":"Improving the accuracy-latency trade-off of edge-cloud com- putation offloading for deep learning services,","venue":null,"work_id":"ac78ffb5-1ce1-430b-a7ee-172dd11eaa03","year":2020},"citing_paper":{"arxiv_id":"2506.23934","last_updated":"2025-06-30T15:03:35Z","snapshot_observed_at":"2026-08-06T21:25:16.148067Z","submitted_at":"2025-06-30T15:03:35Z","title":"QPART: Adaptive Model Quantization and Dynamic Workload Balancing for Accuracy-aware Edge Inference","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-06T21:39:19.773054Z"},"links":{"citing_paper":"/paper/2506.23934"},"observation_digest":"sha256:bbd201056c77b2a3f3a697793be2814162a5c52969625598d03ff7c508cc8c5a","observation_id":"dd605dc4-366f-497e-8863-08e8d0494527","resolution":{"observed_at":"2026-08-06T21:39:20.157257Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.16904","last_updated":"2024-02-24T18:46:06Z","snapshot_observed_at":"2026-08-04T03:03:59.932778Z","submitted_at":"2024-02-24T18:46:06Z","title":"Selective Task offloading for Maximum Inference Accuracy and Energy efficient Real-Time IoT Sensing Systems","version":1},"cited_work":{"arxiv_id":"2402.16904","doi":null,"metadata_source":"pith","pith_arxiv_id":"2402.16904","snapshot_observed_at":"2026-08-06T21:39:19.901576Z","title":"Selective Task offloading for Maximum Inference Accuracy and Energy efficient Real-Time IoT Sensing Systems","venue":"cs.LG","work_id":"fdd7c0bf-1383-4c79-9337-a78e38e7f64e","year":2024},"citing_paper":{"arxiv_id":"2506.23934","last_updated":"2025-06-30T15:03:35Z","snapshot_observed_at":"2026-08-06T21:25:16.148067Z","submitted_at":"2025-06-30T15:03:35Z","title":"QPART: Adaptive Model Quantization and Dynamic Workload Balancing for Accuracy-aware Edge Inference","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-06T21:39:19.778476Z"},"links":{"cited_paper":"/paper/2402.16904","citing_paper":"/paper/2506.23934"},"observation_digest":"sha256:775e96f146fce53fca50a0e346ddc7736cbc9ab31240bc81a83a04645b68f360","observation_id":"d20b042d-fae4-45ab-9320-76ebc8e5c031","resolution":{"observed_at":"2026-08-06T21:39:19.910331Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:39:20.134396Z","title":"Energy consump- tion of neural networks on nvidia edge boards: an empirical model,","venue":null,"work_id":"200b53c8-f7b8-4198-b3ab-61294331ac29","year":2022},"citing_paper":{"arxiv_id":"2506.23934","last_updated":"2025-06-30T15:03:35Z","snapshot_observed_at":"2026-08-06T21:25:16.148067Z","submitted_at":"2025-06-30T15:03:35Z","title":"QPART: Adaptive Model Quantization and Dynamic Workload Balancing for Accuracy-aware Edge Inference","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-06T21:39:19.783616Z"},"links":{"citing_paper":"/paper/2506.23934"},"observation_digest":"sha256:aead6ab52fb32f48f7072c0494905f7d9035a146e3511c191d9971a6562218f4","observation_id":"3e827e32-08eb-48cc-96a8-fe6b12e9c096","resolution":{"observed_at":"2026-08-06T21:39:20.140060Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:39:20.115787Z","title":"The en- ergy/frequency convexity rule: Modeling and experimental validation on mobile devices,","venue":null,"work_id":"9efbd7dc-4b55-44b4-9a79-5f3217d4dd12","year":2013},"citing_paper":{"arxiv_id":"2506.23934","last_updated":"2025-06-30T15:03:35Z","snapshot_observed_at":"2026-08-06T21:25:16.148067Z","submitted_at":"2025-06-30T15:03:35Z","title":"QPART: Adaptive Model Quantization and Dynamic Workload Balancing for Accuracy-aware Edge Inference","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-06T21:39:19.788724Z"},"links":{"citing_paper":"/paper/2506.23934"},"observation_digest":"sha256:bd73ccff46bf663c675b2440f3167f6d7d06609058b47a63c8b6b3a6ce5e5f7b","observation_id":"be759bcf-17ea-40a5-a32e-fc0452ef1a2d","resolution":{"observed_at":"2026-08-06T21:39:20.121544Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:39:20.098288Z","title":"Processor design for portable systems,","venue":null,"work_id":"280e1fa2-5773-4adf-99f0-98b0451827fc","year":1996},"citing_paper":{"arxiv_id":"2506.23934","last_updated":"2025-06-30T15:03:35Z","snapshot_observed_at":"2026-08-06T21:25:16.148067Z","submitted_at":"2025-06-30T15:03:35Z","title":"QPART: Adaptive Model Quantization and Dynamic Workload Balancing for Accuracy-aware Edge Inference","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-06T21:39:19.794240Z"},"links":{"citing_paper":"/paper/2506.23934"},"observation_digest":"sha256:38f2fb241ca7ee9db44112f07df906cbd499d691df1decafc730a1661052e789","observation_id":"602a5c22-31e9-4315-b642-33822958b0e4","resolution":{"observed_at":"2026-08-06T21:39:20.103522Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:39:20.080716Z","title":"Going deeper with embedded fpga platform for convolutional neural network,","venue":null,"work_id":"fdca6799-59e9-4617-8c64-5d86646876c3","year":2016},"citing_paper":{"arxiv_id":"2506.23934","last_updated":"2025-06-30T15:03:35Z","snapshot_observed_at":"2026-08-06T21:25:16.148067Z","submitted_at":"2025-06-30T15:03:35Z","title":"QPART: Adaptive Model Quantization and Dynamic Workload Balancing for Accuracy-aware Edge Inference","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-06T21:39:19.799272Z"},"links":{"citing_paper":"/paper/2506.23934"},"observation_digest":"sha256:33642332556924f57f0c84adbcceb3c5503ae65780cb10073867804a2e2b851a","observation_id":"18d7de7d-822c-4514-a464-fb46f6037916","resolution":{"observed_at":"2026-08-06T21:39:20.086632Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2103.13630","last_updated":"2021-06-21T21:01:12Z","snapshot_observed_at":"2026-07-06T10:53:11.986981Z","submitted_at":"2021-03-25T06:57:11Z","title":"A Survey of Quantization Methods for Efficient Neural Network Inference","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2103.13630","snapshot_observed_at":"2026-08-06T21:39:19.804559Z","title":"A survey of quantization methods for efficient neural network infer- ence,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.23934","last_updated":"2025-06-30T15:03:35Z","snapshot_observed_at":"2026-08-06T21:25:16.148067Z","submitted_at":"2025-06-30T15:03:35Z","title":"QPART: Adaptive Model Quantization and Dynamic Workload Balancing for Accuracy-aware Edge Inference","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-06T21:39:19.804559Z"},"links":{"cited_paper":"/paper/2103.13630","citing_paper":"/paper/2506.23934"},"observation_digest":"sha256:3534feb31b624b204a86f0e51191dc282bcfcadb56dbf61b8e8832e4ce8ec155","observation_id":"b9177401-69f6-48b0-bebe-ad54a5599369","resolution":{"observed_at":"2026-08-06T21:39:19.804559Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:39:20.062472Z","title":"Quantized neural networks: Training neural networks with low pre- cision weights and activations,","venue":null,"work_id":"d7fe9e9b-2d55-4ddd-bc45-c2560b1d1359","year":2017},"citing_paper":{"arxiv_id":"2506.23934","last_updated":"2025-06-30T15:03:35Z","snapshot_observed_at":"2026-08-06T21:25:16.148067Z","submitted_at":"2025-06-30T15:03:35Z","title":"QPART: Adaptive Model Quantization and Dynamic Workload Balancing for Accuracy-aware Edge Inference","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-06T21:39:19.809530Z"},"links":{"citing_paper":"/paper/2506.23934"},"observation_digest":"sha256:0c8293168198ad90c190440368311ec84934d6c16e2fc8954a3182e9343242f8","observation_id":"f2c5f1d5-ed07-42f3-b7ba-ce7d964d1a4c","resolution":{"observed_at":"2026-08-06T21:39:20.068479Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1606.06160","last_updated":"2018-02-02T01:43:54Z","snapshot_observed_at":"2026-07-06T05:00:35.763958Z","submitted_at":"2016-06-20T15:02:31Z","title":"DoReFa-Net: Training Low Bitwidth Convolutional Neural Networks with Low Bitwidth Gradients","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1606.06160","snapshot_observed_at":"2026-08-06T21:39:19.814571Z","title":"Dorefa-net: Training low bitwidth convolutional neural networks with low bitwidth gradients,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2506.23934","last_updated":"2025-06-30T15:03:35Z","snapshot_observed_at":"2026-08-06T21:25:16.148067Z","submitted_at":"2025-06-30T15:03:35Z","title":"QPART: Adaptive Model Quantization and Dynamic Workload Balancing for Accuracy-aware Edge Inference","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-06T21:39:19.814571Z"},"links":{"cited_paper":"/paper/1606.06160","citing_paper":"/paper/2506.23934"},"observation_digest":"sha256:834773a09b3db86a31f3ddea58babbd523c8b8a76b9cdf8e18214c499468bbb1","observation_id":"730343f9-6174-44f4-aab3-63d12d7caa26","resolution":{"observed_at":"2026-08-06T21:39:19.814571Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:39:20.045984Z","title":"Deep reinforcement learning-based anti-jamming algorithm using dual action network,","venue":null,"work_id":"509cf167-c88a-4a0e-aaed-3833e733e46a","year":2022},"citing_paper":{"arxiv_id":"2506.23934","last_updated":"2025-06-30T15:03:35Z","snapshot_observed_at":"2026-08-06T21:25:16.148067Z","submitted_at":"2025-06-30T15:03:35Z","title":"QPART: Adaptive Model Quantization and Dynamic Workload Balancing for Accuracy-aware Edge Inference","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-06T21:39:19.820402Z"},"links":{"citing_paper":"/paper/2506.23934"},"observation_digest":"sha256:05f4bb31b12e1a9fe76f7e1b28eb6aad993ab04527e2450359eadcfa05626fee","observation_id":"070e2c20-c447-4745-9363-20e1a8913c5d","resolution":{"observed_at":"2026-08-06T21:39:20.051592Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:39:19.825203Z","title":"Gradient-based learning applied to document recognition,","venue":null,"work_id":null,"year":1998},"citing_paper":{"arxiv_id":"2506.23934","last_updated":"2025-06-30T15:03:35Z","snapshot_observed_at":"2026-08-06T21:25:16.148067Z","submitted_at":"2025-06-30T15:03:35Z","title":"QPART: Adaptive Model Quantization and Dynamic Workload Balancing for Accuracy-aware Edge Inference","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-06T21:39:19.825203Z"},"links":{"citing_paper":"/paper/2506.23934"},"observation_digest":"sha256:abbe259a2f9900cf5a075ef0fd51f4339037e9c144d13375c3294b3ddd3903f2","observation_id":"8fef64d1-49ce-48ed-b343-71fc7081fe76","resolution":{"observed_at":"2026-08-06T21:39:19.825203Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.23934","last_updated":"2025-06-30T15:03:35Z","latest_version":1,"primary_category":"cs.DC","snapshot_observed_at":"2026-08-06T21:25:16.148067Z","submitted_at":"2025-06-30T15:03:35Z","title":"QPART: Adaptive Model Quantization and Dynamic Workload Balancing for Accuracy-aware Edge Inference"},"reference_resolution":{"displayed":59,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":15,"verified_exact":2,"verified_fuzzy":42},"total_outbound_references":59},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 59 of 59 outbound references and 0 inbound Pith citation observations for arXiv:2506.23934."}