{"as_of":"2026-08-20T20:56:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:464d655ffebaca69bf2a68811c8202888e0c65d9695c8c177e218855aae18ef7","coverage":[{"denominator":94,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":94,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-12T10:34:38.587351Z","state":"measured"},{"denominator":94,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":94,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-20T06:33:59.587034+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2411.19114/citation-record","integrity":"/paper/2411.19114/integrity","json":"/paper/2411.19114/citation-record.json","paper":"/paper/2411.19114"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:34:38.156623Z","title":"https://www.graphcore.ai/products/c600","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.19114","last_updated":"2024-11-28T13:02:41Z","snapshot_observed_at":"2026-08-17T11:56:24.937933Z","submitted_at":"2024-11-28T13:02:41Z","title":"PREBA: A Hardware/Software Co-Design for Multi-Instance GPU based AI Inference Servers","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-12T10:34:38.156623Z"},"links":{"citing_paper":"/paper/2411.19114"},"observation_digest":"sha256:faf0685eb2a4099947d56d4f4c47d88f90ca3eeb717fbfbdcd2c18856856b957","observation_id":"b90477ed-2a68-4d0c-ba1e-76ca3ac8a861","resolution":{"observed_at":"2026-08-12T10:34:38.156623Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:34:38.162526Z","title":"https://github.com/ewan-xu/LibrosaCpp","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.19114","last_updated":"2024-11-28T13:02:41Z","snapshot_observed_at":"2026-08-17T11:56:24.937933Z","submitted_at":"2024-11-28T13:02:41Z","title":"PREBA: A Hardware/Software Co-Design for Multi-Instance GPU based AI Inference Servers","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-12T10:34:38.162526Z"},"links":{"citing_paper":"/paper/2411.19114"},"observation_digest":"sha256:dfb8b9b8c1665e69c578f1ca3abf05ac2db1d3bed8f65b581aa6784a9fa6a527","observation_id":"d82c1106-c23d-41e4-8c71-587b09a8c28c","resolution":{"observed_at":"2026-08-12T10:34:38.162526Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:34:38.166700Z","title":"https://opencv.org/","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.19114","last_updated":"2024-11-28T13:02:41Z","snapshot_observed_at":"2026-08-17T11:56:24.937933Z","submitted_at":"2024-11-28T13:02:41Z","title":"PREBA: A Hardware/Software Co-Design for Multi-Instance GPU based AI Inference Servers","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-12T10:34:38.166700Z"},"links":{"citing_paper":"/paper/2411.19114"},"observation_digest":"sha256:cca7cbaf13991d68aa15a0f4ea220fb258f5d57504dbf0d3c7a2b8149d799074","observation_id":"f1b5dc41-4a46-426c-8537-7c391bd269c8","resolution":{"observed_at":"2026-08-12T10:34:38.166700Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:34:38.171776Z","title":"https://rebellions.ai/rebellions-product/atom-2/","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.19114","last_updated":"2024-11-28T13:02:41Z","snapshot_observed_at":"2026-08-17T11:56:24.937933Z","submitted_at":"2024-11-28T13:02:41Z","title":"PREBA: A Hardware/Software Co-Design for Multi-Instance GPU based AI Inference Servers","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-12T10:34:38.171776Z"},"links":{"citing_paper":"/paper/2411.19114"},"observation_digest":"sha256:c7c4d73ca1c1a0bfd3dae91b5ea2c615f3a5bd23fd33c8a4129636430b8c36be","observation_id":"947f3b1a-09f7-4dc4-9a1c-5cf1c2adf6b7","resolution":{"observed_at":"2026-08-12T10:34:38.171776Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:34:38.178223Z","title":null,"venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2411.19114","last_updated":"2024-11-28T13:02:41Z","snapshot_observed_at":"2026-08-17T11:56:24.937933Z","submitted_at":"2024-11-28T13:02:41Z","title":"PREBA: A Hardware/Software Co-Design for Multi-Instance GPU based AI Inference Servers","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-12T10:34:38.178223Z"},"links":{"citing_paper":"/paper/2411.19114"},"observation_digest":"sha256:d913ef32ab7ed59a91ba3c92a3e3a8602eab08c5e9a396b9936a19d28163980a","observation_id":"df85ff40-481d-4136-a44a-070a8911e0fa","resolution":{"observed_at":"2026-08-12T10:34:38.178223Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:34:38.182916Z","title":"Albericio, P","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2411.19114","last_updated":"2024-11-28T13:02:41Z","snapshot_observed_at":"2026-08-17T11:56:24.937933Z","submitted_at":"2024-11-28T13:02:41Z","title":"PREBA: A Hardware/Software Co-Design for Multi-Instance GPU based AI Inference Servers","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-12T10:34:38.182916Z"},"links":{"citing_paper":"/paper/2411.19114"},"observation_digest":"sha256:2cba4eb6feaa3d725b8ebf892ba226ef6ff50bca4b27ebabdc9ecccec7b03fa7","observation_id":"368538f5-89a4-4288-a673-ef73c6774dd1","resolution":{"observed_at":"2026-08-12T10:34:38.182916Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:34:38.188961Z","title":"https://www.amazon.com/NVIDIA-Tesla-A100-Ampere- Graphics/dp/B0BGZJ27SL, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.19114","last_updated":"2024-11-28T13:02:41Z","snapshot_observed_at":"2026-08-17T11:56:24.937933Z","submitted_at":"2024-11-28T13:02:41Z","title":"PREBA: A Hardware/Software Co-Design for Multi-Instance GPU based AI Inference Servers","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-12T10:34:38.188961Z"},"links":{"citing_paper":"/paper/2411.19114"},"observation_digest":"sha256:dec475857f448fba483c0f2bfe5c5781d2cb67607723ab6369ca2813fc805995","observation_id":"2e256a65-6284-4045-8f32-6fe6c9e75f9e","resolution":{"observed_at":"2026-08-12T10:34:38.188961Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:34:38.193129Z","title":"Alveo U55C High Performance Compute Card","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.19114","last_updated":"2024-11-28T13:02:41Z","snapshot_observed_at":"2026-08-17T11:56:24.937933Z","submitted_at":"2024-11-28T13:02:41Z","title":"PREBA: A Hardware/Software Co-Design for Multi-Instance GPU based AI Inference Servers","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-12T10:34:38.193129Z"},"links":{"citing_paper":"/paper/2411.19114"},"observation_digest":"sha256:715a39e32019eb03fe0858a87ecc9f7aea2f353a6a5cd334cb0ae4e5b53be2b2","observation_id":"a11e36d1-7753-4423-8ddc-b32f01f93f6c","resolution":{"observed_at":"2026-08-12T10:34:38.193129Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:34:38.198697Z","title":"AMD Vitis","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.19114","last_updated":"2024-11-28T13:02:41Z","snapshot_observed_at":"2026-08-17T11:56:24.937933Z","submitted_at":"2024-11-28T13:02:41Z","title":"PREBA: A Hardware/Software Co-Design for Multi-Instance GPU based AI Inference Servers","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-12T10:34:38.198697Z"},"links":{"citing_paper":"/paper/2411.19114"},"observation_digest":"sha256:fa8b40f85b4f292d82c33660f2e5e982fa171248c72120c802a5ffabfcf842ad","observation_id":"672c4573-2a89-4d08-a37a-d27400ca1ad8","resolution":{"observed_at":"2026-08-12T10:34:38.198697Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:34:38.203154Z","title":"Vitis Libraries","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.19114","last_updated":"2024-11-28T13:02:41Z","snapshot_observed_at":"2026-08-17T11:56:24.937933Z","submitted_at":"2024-11-28T13:02:41Z","title":"PREBA: A Hardware/Software Co-Design for Multi-Instance GPU based AI Inference Servers","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-12T10:34:38.203154Z"},"links":{"citing_paper":"/paper/2411.19114"},"observation_digest":"sha256:33134f216c90e4bcfef9b349fe160621c92d3dbc882dd06fee55ac70d9a66f32","observation_id":"a71ebe07-1802-401e-9df3-3cbf360f7dc4","resolution":{"observed_at":"2026-08-12T10:34:38.203154Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:34:38.209239Z","title":"Stanley Williams, Paolo Faraboschi, Wen mei Hwu, John Paul Strachan, Kaushik Roy, and Dejan S Milojicic","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2411.19114","last_updated":"2024-11-28T13:02:41Z","snapshot_observed_at":"2026-08-17T11:56:24.937933Z","submitted_at":"2024-11-28T13:02:41Z","title":"PREBA: A Hardware/Software Co-Design for Multi-Instance GPU based AI Inference Servers","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-12T10:34:38.209239Z"},"links":{"citing_paper":"/paper/2411.19114"},"observation_digest":"sha256:91d68152916eb04dac546d814d20cf042ebf7b2561e28d3ae5f9f5bd5cb8a4a4","observation_id":"2a3346c8-53f2-4514-a7e7-58a0d1211315","resolution":{"observed_at":"2026-08-12T10:34:38.209239Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:34:38.214168Z","title":"Enabling Programmable Transport Protocols in High-Speed NICs","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2411.19114","last_updated":"2024-11-28T13:02:41Z","snapshot_observed_at":"2026-08-17T11:56:24.937933Z","submitted_at":"2024-11-28T13:02:41Z","title":"PREBA: A Hardware/Software Co-Design for Multi-Instance GPU based AI Inference Servers","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-12T10:34:38.214168Z"},"links":{"citing_paper":"/paper/2411.19114"},"observation_digest":"sha256:58ebb919da499fa2eab367b7955d4825f565d98f34ba6bf0bda4c497f91e0d66","observation_id":"a79bdf04-dd1d-4455-87a2-2eb6c4074f15","resolution":{"observed_at":"2026-08-12T10:34:38.214168Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:34:38.224207Z","title":"AWS Nitro System","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.19114","last_updated":"2024-11-28T13:02:41Z","snapshot_observed_at":"2026-08-17T11:56:24.937933Z","submitted_at":"2024-11-28T13:02:41Z","title":"PREBA: A Hardware/Software Co-Design for Multi-Instance GPU based AI Inference Servers","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-12T10:34:38.224207Z"},"links":{"citing_paper":"/paper/2411.19114"},"observation_digest":"sha256:4b7c8311f9ec723634829ea0c3ca09d0b610449e3f1671a8548797071e86bd94","observation_id":"b6cce3a4-0d9a-4293-a4c0-460a68386a45","resolution":{"observed_at":"2026-08-12T10:34:38.224207Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:34:38.229356Z","title":"AWS inferentia","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.19114","last_updated":"2024-11-28T13:02:41Z","snapshot_observed_at":"2026-08-17T11:56:24.937933Z","submitted_at":"2024-11-28T13:02:41Z","title":"PREBA: A Hardware/Software Co-Design for Multi-Instance GPU based AI Inference Servers","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-12T10:34:38.229356Z"},"links":{"citing_paper":"/paper/2411.19114"},"observation_digest":"sha256:c8fb68e2a10a92ce5ffc50111b6ec6e7ded222b49b8be6a320ef1aca23d3bfab","observation_id":"d115f016-9194-40aa-812f-a78116f6e820","resolution":{"observed_at":"2026-08-12T10:34:38.229356Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:34:39.548949Z","title":"Microsoft Announces Acquisition of Fungible to Ac- celerate Datacenter Innovation","venue":null,"work_id":"7a7d8fd1-46ef-4836-94e4-d355352d5837","year":2023},"citing_paper":{"arxiv_id":"2411.19114","last_updated":"2024-11-28T13:02:41Z","snapshot_observed_at":"2026-08-17T11:56:24.937933Z","submitted_at":"2024-11-28T13:02:41Z","title":"PREBA: A Hardware/Software Co-Design for Multi-Instance GPU based AI Inference Servers","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-12T10:34:38.233414Z"},"links":{"citing_paper":"/paper/2411.19114"},"observation_digest":"sha256:14b05f041382b8a8025b72e7a19c7ba9d5cb2b7d4183748584d9b11b07ca5c4e","observation_id":"ef61dfba-6131-4c19-ac9a-2c29d7576aaa","resolution":{"observed_at":"2026-08-12T10:34:39.553211Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:34:39.537278Z","title":"F4T: A Fast and Flexible FPGA-based Full- stack TCP Acceleration Framework","venue":null,"work_id":"52bad0bc-30da-4d35-b572-ac984b704783","year":2023},"citing_paper":{"arxiv_id":"2411.19114","last_updated":"2024-11-28T13:02:41Z","snapshot_observed_at":"2026-08-17T11:56:24.937933Z","submitted_at":"2024-11-28T13:02:41Z","title":"PREBA: A Hardware/Software Co-Design for Multi-Instance GPU based AI Inference Servers","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-12T10:34:38.237357Z"},"links":{"citing_paper":"/paper/2411.19114"},"observation_digest":"sha256:b7ec418f5505a43f4e27e306431edb6a455894785e67a0101f87afbd8f181a6a","observation_id":"8584f545-c02c-48e1-829c-9c3ab4fe9d59","resolution":{"observed_at":"2026-08-12T10:34:39.541473Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:34:39.526104Z","title":"Sheaffer, Sang-Ha Lee, and Kevin Skadron","venue":null,"work_id":"523f2383-7803-46ef-b8b9-3c5abcfcc32e","year":2009},"citing_paper":{"arxiv_id":"2411.19114","last_updated":"2024-11-28T13:02:41Z","snapshot_observed_at":"2026-08-17T11:56:24.937933Z","submitted_at":"2024-11-28T13:02:41Z","title":"PREBA: A Hardware/Software Co-Design for Multi-Instance GPU based AI Inference Servers","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-12T10:34:38.242569Z"},"links":{"citing_paper":"/paper/2411.19114"},"observation_digest":"sha256:30bb5b2ba975836db6b14fa6aa3151ef28289e386f7fbc7e76b7beaa78a9f673","observation_id":"1702821a-82dc-4938-bbd9-35e550b33cd8","resolution":{"observed_at":"2026-08-12T10:34:39.530014Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:34:39.513943Z","title":"Prophet: Precise QoS Prediction on Non- Preemptive Accelerators to Improve Utilization in Warehouse-Scale Computers","venue":null,"work_id":"126926fb-6c12-44ff-be17-19a2943734e2","year":2017},"citing_paper":{"arxiv_id":"2411.19114","last_updated":"2024-11-28T13:02:41Z","snapshot_observed_at":"2026-08-17T11:56:24.937933Z","submitted_at":"2024-11-28T13:02:41Z","title":"PREBA: A Hardware/Software Co-Design for Multi-Instance GPU based AI Inference Servers","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-12T10:34:38.246224Z"},"links":{"citing_paper":"/paper/2411.19114"},"observation_digest":"sha256:fea2ff3a4414a863a00206e51d56d8f09095110baec3896d8a12e7ac61def90d","observation_id":"32591356-8788-4c7c-8d0d-37c218949242","resolution":{"observed_at":"2026-08-12T10:34:39.518192Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:34:39.500462Z","title":"Baymax: QoS Awareness and Increased Utilization for Non-Preemptive Accelerators in Warehouse Scale Computers","venue":null,"work_id":"8f19f648-4e24-4a21-a839-6a52f91179ec","year":2016},"citing_paper":{"arxiv_id":"2411.19114","last_updated":"2024-11-28T13:02:41Z","snapshot_observed_at":"2026-08-17T11:56:24.937933Z","submitted_at":"2024-11-28T13:02:41Z","title":"PREBA: A Hardware/Software Co-Design for Multi-Instance GPU based AI Inference Servers","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-12T10:34:38.250095Z"},"links":{"citing_paper":"/paper/2411.19114"},"observation_digest":"sha256:b7924616dfa75d4c65fbe493e5c484298409da2e1cb4cef2d0c995120ad7c30c","observation_id":"77357582-4c79-43e5-ac8d-2ed79fc1a30f","resolution":{"observed_at":"2026-08-12T10:34:39.504878Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:34:39.489805Z","title":null,"venue":null,"work_id":"beb33e9d-8bd6-4beb-83b6-71e3aedb649f","year":2016},"citing_paper":{"arxiv_id":"2411.19114","last_updated":"2024-11-28T13:02:41Z","snapshot_observed_at":"2026-08-17T11:56:24.937933Z","submitted_at":"2024-11-28T13:02:41Z","title":"PREBA: A Hardware/Software Co-Design for Multi-Instance GPU based AI Inference Servers","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-12T10:34:38.254322Z"},"links":{"citing_paper":"/paper/2411.19114"},"observation_digest":"sha256:101d95aedef56762778751c2e6f677d11fa6fda384aa435f11ab4d81fbeeaf61","observation_id":"1a75a5d2-23b6-4a05-a9fc-65f9eeb32449","resolution":{"observed_at":"2026-08-12T10:34:39.493309Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:34:39.478107Z","title":"BM-Store: A Transparent and High-performance Lo- cal Storage Architecture for Bare-metal Clouds Enabling Large-scale Deployment","venue":null,"work_id":"a58a1c8a-e342-44c6-b32b-5f1aecef100f","year":2023},"citing_paper":{"arxiv_id":"2411.19114","last_updated":"2024-11-28T13:02:41Z","snapshot_observed_at":"2026-08-17T11:56:24.937933Z","submitted_at":"2024-11-28T13:02:41Z","title":"PREBA: A Hardware/Software Co-Design for Multi-Instance GPU based AI Inference Servers","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-12T10:34:38.258424Z"},"links":{"citing_paper":"/paper/2411.19114"},"observation_digest":"sha256:fb55674cd813e1b1753b16782718ace93d2cc64ca5e3ca784648ce80704154ed","observation_id":"2ac47d41-23e2-4979-a764-805146d33231","resolution":{"observed_at":"2026-08-12T10:34:39.482848Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:34:39.466186Z","title":"Dlbooster: Boosting End-to- End Deep Learning Workflows with Offloading Data Preprocessing Pipelines","venue":null,"work_id":"a4299db1-c4a1-45ca-9220-4fec797e833c","year":2019},"citing_paper":{"arxiv_id":"2411.19114","last_updated":"2024-11-28T13:02:41Z","snapshot_observed_at":"2026-08-17T11:56:24.937933Z","submitted_at":"2024-11-28T13:02:41Z","title":"PREBA: A Hardware/Software Co-Design for Multi-Instance GPU based AI Inference Servers","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-12T10:34:38.261755Z"},"links":{"citing_paper":"/paper/2411.19114"},"observation_digest":"sha256:b2a1937c74754926701849056e0ea110e21c0c7da3021dc69e2bf022101bf778","observation_id":"f8fb8185-6de1-4df3-9498-b41c46f0623e","resolution":{"observed_at":"2026-08-12T10:34:39.470014Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:34:39.455945Z","title":"Lazy Batching: An SLA-aware Batching System for Cloud Machine Learning Inference","venue":null,"work_id":"434152b6-a093-49c9-ac93-d6858d1eff7a","year":2021},"citing_paper":{"arxiv_id":"2411.19114","last_updated":"2024-11-28T13:02:41Z","snapshot_observed_at":"2026-08-17T11:56:24.937933Z","submitted_at":"2024-11-28T13:02:41Z","title":"PREBA: A Hardware/Software Co-Design for Multi-Instance GPU based AI Inference Servers","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-12T10:34:38.266916Z"},"links":{"citing_paper":"/paper/2411.19114"},"observation_digest":"sha256:a7b33961b8d2b6e9efb13adf8a1df35cfcd753bab32309910866638d8793009c","observation_id":"739c17d8-08da-4a00-a393-bbfa0b18c26e","resolution":{"observed_at":"2026-08-12T10:34:39.459740Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:34:39.444989Z","title":"PREMA: A Predictive Multi-task Scheduling Algorithm For Preemptible Neural Processing Units","venue":null,"work_id":"be626300-cd54-44ed-98c8-ba7ec84182ee","year":2020},"citing_paper":{"arxiv_id":"2411.19114","last_updated":"2024-11-28T13:02:41Z","snapshot_observed_at":"2026-08-17T11:56:24.937933Z","submitted_at":"2024-11-28T13:02:41Z","title":"PREBA: A Hardware/Software Co-Design for Multi-Instance GPU based AI Inference Servers","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-12T10:34:38.270814Z"},"links":{"citing_paper":"/paper/2411.19114"},"observation_digest":"sha256:70c47939dd8a2fb667b134dbfbb275b95089b19fdfa9065f842337edeaf96c71","observation_id":"1a82ed02-7bd8-469f-8cc6-5b5f05f7b2a6","resolution":{"observed_at":"2026-08-12T10:34:39.448897Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:34:39.434860Z","title":"Clipper: A Low-Latency Online Prediction Serving System","venue":null,"work_id":"cb923be5-b1ca-4c8f-87ab-1509a6b2c6e7","year":2017},"citing_paper":{"arxiv_id":"2411.19114","last_updated":"2024-11-28T13:02:41Z","snapshot_observed_at":"2026-08-17T11:56:24.937933Z","submitted_at":"2024-11-28T13:02:41Z","title":"PREBA: A Hardware/Software Co-Design for Multi-Instance GPU based AI Inference Servers","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-12T10:34:38.276188Z"},"links":{"citing_paper":"/paper/2411.19114"},"observation_digest":"sha256:569f51672e6e33ebd25173e07188e5cdab0759fa9ed389e788d3e4f0ed53889f","observation_id":"3826b349-b9a3-423a-901d-23e845b2f3b9","resolution":{"observed_at":"2026-08-12T10:34:39.438798Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:34:39.424091Z","title":"Everything you need to know about data center power","venue":null,"work_id":"8bf776f7-589d-44ab-9a63-ddcc8b51e66b","year":2020},"citing_paper":{"arxiv_id":"2411.19114","last_updated":"2024-11-28T13:02:41Z","snapshot_observed_at":"2026-08-17T11:56:24.937933Z","submitted_at":"2024-11-28T13:02:41Z","title":"PREBA: A Hardware/Software Co-Design for Multi-Instance GPU based AI Inference Servers","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-12T10:34:38.280930Z"},"links":{"citing_paper":"/paper/2411.19114"},"observation_digest":"sha256:a25d0c80f771f18962ff94f8204c81bc30e6689c951de0d29aac2712772121ae","observation_id":"731d2606-35a2-4c91-9634-e4538e7244aa","resolution":{"observed_at":"2026-08-12T10:34:39.427848Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:34:39.411479Z","title":"Neural Cache: Bit-serial In-cache Acceleration of Deep Neural Networks","venue":null,"work_id":"dd83fde6-5bb2-41c2-9596-8acc646ba63c","year":2018},"citing_paper":{"arxiv_id":"2411.19114","last_updated":"2024-11-28T13:02:41Z","snapshot_observed_at":"2026-08-17T11:56:24.937933Z","submitted_at":"2024-11-28T13:02:41Z","title":"PREBA: A Hardware/Software Co-Design for Multi-Instance GPU based AI Inference Servers","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-12T10:34:38.285003Z"},"links":{"citing_paper":"/paper/2411.19114"},"observation_digest":"sha256:0905a9534c34af3f05bdd17da2489a4f40039e7f77bc735928d4a2f3f301069a","observation_id":"b0d37572-b773-4901-946a-69bd9d71e41d","resolution":{"observed_at":"2026-08-12T10:34:39.415994Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:34:39.399552Z","title":"MAICC : A Lightweight Many-core Architecture with In-Cache Computing for Multi-DNN Parallel Infer- ence","venue":null,"work_id":"c01fc986-f4f9-4b51-838c-a97b19cac04e","year":2023},"citing_paper":{"arxiv_id":"2411.19114","last_updated":"2024-11-28T13:02:41Z","snapshot_observed_at":"2026-08-17T11:56:24.937933Z","submitted_at":"2024-11-28T13:02:41Z","title":"PREBA: A Hardware/Software Co-Design for Multi-Instance GPU based AI Inference Servers","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-12T10:34:38.289893Z"},"links":{"citing_paper":"/paper/2411.19114"},"observation_digest":"sha256:3fb6520f9b7633f7c84ef8fafcd938a365cd68256795e57cb2d044b7a85a0f12","observation_id":"b65bc892-5b1e-421b-a70c-ff4b6ad7efa4","resolution":{"observed_at":"2026-08-12T10:34:39.403712Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:34:39.387884Z","title":"Low Latency RNN Inference with Cellular Batching","venue":null,"work_id":"6fb5a6b9-8d84-4e7c-944c-0eaf57fa03fa","year":2018},"citing_paper":{"arxiv_id":"2411.19114","last_updated":"2024-11-28T13:02:41Z","snapshot_observed_at":"2026-08-17T11:56:24.937933Z","submitted_at":"2024-11-28T13:02:41Z","title":"PREBA: A Hardware/Software Co-Design for Multi-Instance GPU based AI Inference Servers","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-12T10:34:38.293498Z"},"links":{"citing_paper":"/paper/2411.19114"},"observation_digest":"sha256:92d1681dd38461bd0cafe6c37fa3ba9d7a13c440f372dcb0f7a5fd0cfc377fcf","observation_id":"e1c2c093-de63-4593-a9f1-1c718fe0e60c","resolution":{"observed_at":"2026-08-12T10:34:39.392036Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:34:39.372616Z","title":"Low Latency RNN Inference with Cellular Batching","venue":null,"work_id":"88f5bd73-06d5-418a-b91d-0f26fd63bf85","year":2018},"citing_paper":{"arxiv_id":"2411.19114","last_updated":"2024-11-28T13:02:41Z","snapshot_observed_at":"2026-08-17T11:56:24.937933Z","submitted_at":"2024-11-28T13:02:41Z","title":"PREBA: A Hardware/Software Co-Design for Multi-Instance GPU based AI Inference Servers","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-12T10:34:38.298126Z"},"links":{"citing_paper":"/paper/2411.19114"},"observation_digest":"sha256:ff3d362a8be32c9dff536cfd031b943dc5ff21dffb751d4bda4e590fd55acd93","observation_id":"a31f8d57-7070-4226-916e-b764f620c53c","resolution":{"observed_at":"2026-08-12T10:34:39.377428Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:34:39.359966Z","title":"Cachew: Machine Learning Input Data Processing as a Service","venue":null,"work_id":"f8c036b8-84a4-4d92-9ba4-4695cc120c02","year":2022},"citing_paper":{"arxiv_id":"2411.19114","last_updated":"2024-11-28T13:02:41Z","snapshot_observed_at":"2026-08-17T11:56:24.937933Z","submitted_at":"2024-11-28T13:02:41Z","title":"PREBA: A Hardware/Software Co-Design for Multi-Instance GPU based AI Inference Servers","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-12T10:34:38.302454Z"},"links":{"citing_paper":"/paper/2411.19114"},"observation_digest":"sha256:d090e84bd21ef0dd76d309f73948187b04130f51fa3c2f822cdb3199da71b902","observation_id":"8cdfcfe1-a5fe-4430-83b5-007e4564e503","resolution":{"observed_at":"2026-08-12T10:34:39.364194Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:34:39.347669Z","title":"Conformer: Convolution-augmented Transformer for Speech Recognition","venue":null,"work_id":"fc737557-3b51-44ee-8c19-ea84dc648e62","year":2020},"citing_paper":{"arxiv_id":"2411.19114","last_updated":"2024-11-28T13:02:41Z","snapshot_observed_at":"2026-08-17T11:56:24.937933Z","submitted_at":"2024-11-28T13:02:41Z","title":"PREBA: A Hardware/Software Co-Design for Multi-Instance GPU based AI Inference Servers","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-12T10:34:38.305978Z"},"links":{"citing_paper":"/paper/2411.19114"},"observation_digest":"sha256:f4ed15434931a379eacd12e6c491e0003ab7fe926ed7ba94b99e957455089a5d","observation_id":"a4ec59ba-36eb-4c60-a29c-6d4a13c3368f","resolution":{"observed_at":"2026-08-12T10:34:39.351901Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:34:39.335896Z","title":null,"venue":null,"work_id":"acd2b4ad-75e3-47c2-947f-b97d33cb3de5","year":2016},"citing_paper":{"arxiv_id":"2411.19114","last_updated":"2024-11-28T13:02:41Z","snapshot_observed_at":"2026-08-17T11:56:24.937933Z","submitted_at":"2024-11-28T13:02:41Z","title":"PREBA: A Hardware/Software Co-Design for Multi-Instance GPU based AI Inference Servers","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-12T10:34:38.310004Z"},"links":{"citing_paper":"/paper/2411.19114"},"observation_digest":"sha256:e342acb5e408bdb088cdcbe328a1fa87fb75a2fbfc1992f19f93686882aef542","observation_id":"ce46d545-77ae-4572-8c68-c251c500d38b","resolution":{"observed_at":"2026-08-12T10:34:39.339793Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:34:39.324559Z","title":"Hauswald, Y","venue":null,"work_id":"c4238a83-d61f-4b5f-a3ab-8d94a5ce9816","year":2015},"citing_paper":{"arxiv_id":"2411.19114","last_updated":"2024-11-28T13:02:41Z","snapshot_observed_at":"2026-08-17T11:56:24.937933Z","submitted_at":"2024-11-28T13:02:41Z","title":"PREBA: A Hardware/Software Co-Design for Multi-Instance GPU based AI Inference Servers","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-12T10:34:38.313987Z"},"links":{"citing_paper":"/paper/2411.19114"},"observation_digest":"sha256:3975750d8030d198eb150c0cc8e58f5f6b68b99bae5cb610dd4b2c62677bbb75","observation_id":"ed29906f-fd38-441a-a083-5a8d1eb4845b","resolution":{"observed_at":"2026-08-12T10:34:39.328390Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1905.02244","last_updated":"2019-11-20T17:26:40Z","snapshot_observed_at":"2026-08-17T11:57:08.807566Z","submitted_at":"2019-05-06T19:38:31Z","title":"Searching for MobileNetV3","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1905.02244","snapshot_observed_at":"2026-08-12T10:34:38.318218Z","title":"Le, and Hartwig Adam","venue":null,"work_id":null,"year":1905},"citing_paper":{"arxiv_id":"2411.19114","last_updated":"2024-11-28T13:02:41Z","snapshot_observed_at":"2026-08-17T11:56:24.937933Z","submitted_at":"2024-11-28T13:02:41Z","title":"PREBA: A Hardware/Software Co-Design for Multi-Instance GPU based AI Inference Servers","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-12T10:34:38.318218Z"},"links":{"cited_paper":"/paper/1905.02244","citing_paper":"/paper/2411.19114"},"observation_digest":"sha256:be3fc33f68446ecda5f7c85dc695ffd526da1957ebff63d183bc0a6899afa90e","observation_id":"cf5c742e-d1f2-4ad5-bf44-4c93cb03ceb8","resolution":{"observed_at":"2026-08-12T10:34:38.318218Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:34:39.312453Z","title":"SK hynix Develops World’s Best Performing HBM3E, Provides Samples to Customer for Performance Evaluation","venue":null,"work_id":"1c74f02c-41c9-4b29-9c22-71a1d84ba750","year":2023},"citing_paper":{"arxiv_id":"2411.19114","last_updated":"2024-11-28T13:02:41Z","snapshot_observed_at":"2026-08-17T11:56:24.937933Z","submitted_at":"2024-11-28T13:02:41Z","title":"PREBA: A Hardware/Software Co-Design for Multi-Instance GPU based AI Inference Servers","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-12T10:34:38.322964Z"},"links":{"citing_paper":"/paper/2411.19114"},"observation_digest":"sha256:a849d200a9a03f32bb257fd4e7f2e36362c24acd2e0e1f683109b99212343ab4","observation_id":"dbeefc74-709a-40cf-9b7a-2bf0c72d087b","resolution":{"observed_at":"2026-08-12T10:34:39.316783Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1602.07360","last_updated":"2016-11-04T21:26:08Z","snapshot_observed_at":"2026-08-14T22:09:04.541956Z","submitted_at":"2016-02-24T00:09:45Z","title":"SqueezeNet: AlexNet-level accuracy with 50x fewer parameters and <0.5MB model size","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1602.07360","snapshot_observed_at":"2026-08-12T10:34:38.326898Z","title":"SqueezeNet: AlexNet-level Accuracy with 50x Fewer Parameters and <0.5MB Model Size","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2411.19114","last_updated":"2024-11-28T13:02:41Z","snapshot_observed_at":"2026-08-17T11:56:24.937933Z","submitted_at":"2024-11-28T13:02:41Z","title":"PREBA: A Hardware/Software Co-Design for Multi-Instance GPU based AI Inference Servers","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-12T10:34:38.326898Z"},"links":{"cited_paper":"/paper/1602.07360","citing_paper":"/paper/2411.19114"},"observation_digest":"sha256:1439060380b8c6cd74ef5ee4839642dc0c65ae63deabc46ba90b589dfbbf1ced","observation_id":"e9d90883-9ca7-4cc6-b82f-7d76822d8ad4","resolution":{"observed_at":"2026-08-12T10:34:38.326898Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:34:39.301551Z","title":"ImageNet Large Scale Visual Recognition Challenge 2012 (ILSVRC2012)","venue":null,"work_id":"309cf37b-09c2-4fc1-bda0-88194099d1a6","year":2012},"citing_paper":{"arxiv_id":"2411.19114","last_updated":"2024-11-28T13:02:41Z","snapshot_observed_at":"2026-08-17T11:56:24.937933Z","submitted_at":"2024-11-28T13:02:41Z","title":"PREBA: A Hardware/Software Co-Design for Multi-Instance GPU based AI Inference Servers","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-12T10:34:38.331033Z"},"links":{"citing_paper":"/paper/2411.19114"},"observation_digest":"sha256:0a127b71d1117e028f223afad9d3d004e6aef649614259776acdfb41495a4288","observation_id":"e8c3500f-08b9-4cdb-9ae1-d42dc4bef9b8","resolution":{"observed_at":"2026-08-12T10:34:39.305630Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:34:39.290399Z","title":"Intel Infrastructure Processing Unit (Intel IPU).https://www.intel","venue":null,"work_id":"c7fa8067-5010-47b5-a953-e05148d03134","year":2023},"citing_paper":{"arxiv_id":"2411.19114","last_updated":"2024-11-28T13:02:41Z","snapshot_observed_at":"2026-08-17T11:56:24.937933Z","submitted_at":"2024-11-28T13:02:41Z","title":"PREBA: A Hardware/Software Co-Design for Multi-Instance GPU based AI Inference Servers","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-12T10:34:38.334882Z"},"links":{"citing_paper":"/paper/2411.19114"},"observation_digest":"sha256:7cfb64741e9fb1c9568cb144a9c0774aa01c72c85dcc2d7f54c5a09986bd642a","observation_id":"fc0708e8-02b4-4e29-97ae-ff3206b4bda7","resolution":{"observed_at":"2026-08-12T10:34:39.294154Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:34:39.278446Z","title":null,"venue":null,"work_id":"dafeac57-8e33-427c-bc07-c2ea5079f5a9","year":2017},"citing_paper":{"arxiv_id":"2411.19114","last_updated":"2024-11-28T13:02:41Z","snapshot_observed_at":"2026-08-17T11:56:24.937933Z","submitted_at":"2024-11-28T13:02:41Z","title":"PREBA: A Hardware/Software Co-Design for Multi-Instance GPU based AI Inference Servers","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-12T10:34:38.338675Z"},"links":{"citing_paper":"/paper/2411.19114"},"observation_digest":"sha256:e101b904830e885dff24a881c8e39841c79751d231fcaca21f15c54046ef500c","observation_id":"2ede64d5-d24c-46ab-b501-9dcd15ecb325","resolution":{"observed_at":"2026-08-12T10:34:39.283057Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:34:39.268481Z","title":null,"venue":null,"work_id":"9ef91cf6-b177-44de-b63d-16834a283b5d","year":2023},"citing_paper":{"arxiv_id":"2411.19114","last_updated":"2024-11-28T13:02:41Z","snapshot_observed_at":"2026-08-17T11:56:24.937933Z","submitted_at":"2024-11-28T13:02:41Z","title":"PREBA: A Hardware/Software Co-Design for Multi-Instance GPU based AI Inference Servers","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-12T10:34:38.342379Z"},"links":{"citing_paper":"/paper/2411.19114"},"observation_digest":"sha256:452f36c3971afb7421ddf6263885791842479123d538b32a2295d2777f405e06","observation_id":"cbbbfd37-6d6f-4b72-81f9-dd317f3b7048","resolution":{"observed_at":"2026-08-12T10:34:39.272049Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:34:39.258133Z","title":"Rearchitecting the TCP Stack for I/O- Offloaded Content Delivery","venue":null,"work_id":"428be1e4-f02a-4e3b-b76a-adaa57f9fde4","year":2023},"citing_paper":{"arxiv_id":"2411.19114","last_updated":"2024-11-28T13:02:41Z","snapshot_observed_at":"2026-08-17T11:56:24.937933Z","submitted_at":"2024-11-28T13:02:41Z","title":"PREBA: A Hardware/Software Co-Design for Multi-Instance GPU based AI Inference Servers","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-12T10:34:38.346313Z"},"links":{"citing_paper":"/paper/2411.19114"},"observation_digest":"sha256:da06a78ea44e194221be348020b06cfe7e3adc91ca3c58c46a150a6fa3b46e7a","observation_id":"075bd5e1-b316-44a3-ba01-4ea37ae45368","resolution":{"observed_at":"2026-08-12T10:34:39.261934Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:34:39.246759Z","title":"PARIS and ELSA: An Elastic Scheduling Algorithm for Reconfigurable Multi-GPU Inference Servers","venue":null,"work_id":"aa22e3e1-49d0-49cb-b657-223e7856c547","year":2022},"citing_paper":{"arxiv_id":"2411.19114","last_updated":"2024-11-28T13:02:41Z","snapshot_observed_at":"2026-08-17T11:56:24.937933Z","submitted_at":"2024-11-28T13:02:41Z","title":"PREBA: A Hardware/Software Co-Design for Multi-Instance GPU based AI Inference Servers","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-12T10:34:38.349973Z"},"links":{"citing_paper":"/paper/2411.19114"},"observation_digest":"sha256:f52e8ef56759a074e0016c4901e8ecdb8d1f7040d803d54ba82950a15320f559","observation_id":"0605111c-8713-4332-bf95-dc44a1f96046","resolution":{"observed_at":"2026-08-12T10:34:39.250758Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:34:39.235432Z","title":"Dcs-ctrl: A Fast and Flexible Device-Control Mechanism for Device-Centric Server Architecture","venue":null,"work_id":"4cec1d2d-4330-468d-8612-3527f75cd52e","year":2018},"citing_paper":{"arxiv_id":"2411.19114","last_updated":"2024-11-28T13:02:41Z","snapshot_observed_at":"2026-08-17T11:56:24.937933Z","submitted_at":"2024-11-28T13:02:41Z","title":"PREBA: A Hardware/Software Co-Design for Multi-Instance GPU based AI Inference Servers","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-12T10:34:38.354723Z"},"links":{"citing_paper":"/paper/2411.19114"},"observation_digest":"sha256:487bb6015962a1d27b5d9f574f0b80f80091a897e674439f1c152bf3445d3ef8","observation_id":"6c10f836-d885-4e91-8053-8466cbde2607","resolution":{"observed_at":"2026-08-12T10:34:39.239418Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:34:39.223815Z","title":"FVM: FPGA-assisted Virtual Device Emulation for Fast, Scalable, and Flexible Storage Virtualization","venue":null,"work_id":"56432ebc-2b6e-4258-b967-156192f8dfdc","year":2020},"citing_paper":{"arxiv_id":"2411.19114","last_updated":"2024-11-28T13:02:41Z","snapshot_observed_at":"2026-08-17T11:56:24.937933Z","submitted_at":"2024-11-28T13:02:41Z","title":"PREBA: A Hardware/Software Co-Design for Multi-Instance GPU based AI Inference Servers","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-12T10:34:38.359899Z"},"links":{"citing_paper":"/paper/2411.19114"},"observation_digest":"sha256:ee0eb2daf8c3d2e35e38e1f16872c979804134ffbfbd1937ba0c8d5408c95daf","observation_id":"47a67db7-a1b3-4d76-8f9e-5268677d297b","resolution":{"observed_at":"2026-08-12T10:34:39.227699Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:34:39.212387Z","title":"A Fast and Flexible Hardware-based Virtualization Mechanism for Computational Storage Devices","venue":null,"work_id":"c62e4605-1d17-4771-b6cd-b6dd4c3858d3","year":2021},"citing_paper":{"arxiv_id":"2411.19114","last_updated":"2024-11-28T13:02:41Z","snapshot_observed_at":"2026-08-17T11:56:24.937933Z","submitted_at":"2024-11-28T13:02:41Z","title":"PREBA: A Hardware/Software Co-Design for Multi-Instance GPU based AI Inference Servers","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-12T10:34:38.367138Z"},"links":{"citing_paper":"/paper/2411.19114"},"observation_digest":"sha256:0a078c79865145102a458cd92b2288d3727888a5ad614176cb29bda2104d07b8","observation_id":"60cadf31-2d4b-4e3b-af78-4274dfba9cad","resolution":{"observed_at":"2026-08-12T10:34:39.216484Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:34:39.200343Z","title":"Char- acterizing Multi-Instance GPU for Machine Learning Workloads","venue":null,"work_id":"ba46ed75-a14f-4c38-9f65-1e0e8f6b016b","year":2022},"citing_paper":{"arxiv_id":"2411.19114","last_updated":"2024-11-28T13:02:41Z","snapshot_observed_at":"2026-08-17T11:56:24.937933Z","submitted_at":"2024-11-28T13:02:41Z","title":"PREBA: A Hardware/Software Co-Design for Multi-Instance GPU based AI Inference Servers","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-12T10:34:38.371821Z"},"links":{"citing_paper":"/paper/2411.19114"},"observation_digest":"sha256:d639547f0bcc502e629e7a5fc470fd3b6549da1979617fc24504590960f96eab","observation_id":"69512591-776c-45c6-bce7-f8b536df6196","resolution":{"observed_at":"2026-08-12T10:34:39.204947Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:34:39.182943Z","title":"MISO: Exploiting Multi-Instance GPU Capability on Multi-Tenant GPU Clusters","venue":null,"work_id":"6907ff38-7047-41ef-acb0-f1c1b20690fe","year":2022},"citing_paper":{"arxiv_id":"2411.19114","last_updated":"2024-11-28T13:02:41Z","snapshot_observed_at":"2026-08-17T11:56:24.937933Z","submitted_at":"2024-11-28T13:02:41Z","title":"PREBA: A Hardware/Software Co-Design for Multi-Instance GPU based AI Inference Servers","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-12T10:34:38.377687Z"},"links":{"citing_paper":"/paper/2411.19114"},"observation_digest":"sha256:05629810e893fba868c28954fa7219ec0fc2e3e4f789e8af7482d758a82b54e0","observation_id":"cfc802c0-d64e-469f-8393-c0273ae64d33","resolution":{"observed_at":"2026-08-12T10:34:39.187682Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:34:39.171397Z","title":"Leapio: Efficient and Portable Virtual NVMe Storage on ARM SOCs","venue":null,"work_id":"0d6f6189-5eba-470a-b0c1-755ce1f3a9fc","year":2020},"citing_paper":{"arxiv_id":"2411.19114","last_updated":"2024-11-28T13:02:41Z","snapshot_observed_at":"2026-08-17T11:56:24.937933Z","submitted_at":"2024-11-28T13:02:41Z","title":"PREBA: A Hardware/Software Co-Design for Multi-Instance GPU based AI Inference Servers","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-12T10:34:38.381917Z"},"links":{"citing_paper":"/paper/2411.19114"},"observation_digest":"sha256:66310d5973647dd1f459f1925bbde4ad8950ccfc0e9bcae21ae9b6facb9736f6","observation_id":"81a7f121-8198-43ea-8cc9-1a850918d67d","resolution":{"observed_at":"2026-08-12T10:34:39.175643Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:34:39.159834Z","title":"E3: Energy-efficient Microservices on SmartNIC- accelerated Servers","venue":null,"work_id":"7491103b-8f3f-4496-a878-ef5eff44e680","year":2019},"citing_paper":{"arxiv_id":"2411.19114","last_updated":"2024-11-28T13:02:41Z","snapshot_observed_at":"2026-08-17T11:56:24.937933Z","submitted_at":"2024-11-28T13:02:41Z","title":"PREBA: A Hardware/Software Co-Design for Multi-Instance GPU based AI Inference Servers","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-12T10:34:38.386619Z"},"links":{"citing_paper":"/paper/2411.19114"},"observation_digest":"sha256:80fa1b3f872cee79d32e86d55e7b66f515f60efab4e5ec52495fc811f80d7242","observation_id":"f9f050a1-6ff1-4003-9d8a-7f1af6583a86","resolution":{"observed_at":"2026-08-12T10:34:39.163812Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:34:39.149019Z","title":"Swin Transformer: Hierarchical Vision Transformer Using Shifted Windows","venue":null,"work_id":"4def75ea-f92a-4aef-86a7-ce6368df6688","year":2021},"citing_paper":{"arxiv_id":"2411.19114","last_updated":"2024-11-28T13:02:41Z","snapshot_observed_at":"2026-08-17T11:56:24.937933Z","submitted_at":"2024-11-28T13:02:41Z","title":"PREBA: A Hardware/Software Co-Design for Multi-Instance GPU based AI Inference Servers","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-12T10:34:38.390620Z"},"links":{"citing_paper":"/paper/2411.19114"},"observation_digest":"sha256:6e95dffd03a7c1e76ba5fe26c98a2074eb2c4de7ccda1e557a4b075fa1d5f560","observation_id":"b4b12dc2-2edd-4f76-a2a0-08e2baf21b19","resolution":{"observed_at":"2026-08-12T10:34:39.153006Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:34:39.137784Z","title":"Citrinet: Closing the Gap between Non-Autoregressive and Autoregressive End-to-End Models for Automatic Speech Recognition, 2021","venue":null,"work_id":"c6d75f36-d96e-449c-a65a-bf1f5d368430","year":2021},"citing_paper":{"arxiv_id":"2411.19114","last_updated":"2024-11-28T13:02:41Z","snapshot_observed_at":"2026-08-17T11:56:24.937933Z","submitted_at":"2024-11-28T13:02:41Z","title":"PREBA: A Hardware/Software Co-Design for Multi-Instance GPU based AI Inference Servers","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-12T10:34:38.395944Z"},"links":{"citing_paper":"/paper/2411.19114"},"observation_digest":"sha256:b4427ae60aacbb98bbd25c1fb72fd94885da1d5b409cae288457e716c3e387c8","observation_id":"bfdd653b-1b8b-4674-87a5-f2a67a447350","resolution":{"observed_at":"2026-08-12T10:34:39.141964Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:34:39.126251Z","title":"Boost Your Datacenter! https://mangoboost.io/, 2023","venue":null,"work_id":"d3883694-8063-4766-838d-b392865ba72c","year":2023},"citing_paper":{"arxiv_id":"2411.19114","last_updated":"2024-11-28T13:02:41Z","snapshot_observed_at":"2026-08-17T11:56:24.937933Z","submitted_at":"2024-11-28T13:02:41Z","title":"PREBA: A Hardware/Software Co-Design for Multi-Instance GPU based AI Inference Servers","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-12T10:34:38.400054Z"},"links":{"citing_paper":"/paper/2411.19114"},"observation_digest":"sha256:c8d7c933083c497bfc0f2bd6093cef8973a535910346443e565334758d922192","observation_id":"ac563915-2e40-4391-a992-f0a22f0db368","resolution":{"observed_at":"2026-08-12T10:34:39.130088Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:34:39.112997Z","title":"Meta MITA v1","venue":null,"work_id":"9ca38e9e-a743-45f6-b748-f863d96a2061","year":2023},"citing_paper":{"arxiv_id":"2411.19114","last_updated":"2024-11-28T13:02:41Z","snapshot_observed_at":"2026-08-17T11:56:24.937933Z","submitted_at":"2024-11-28T13:02:41Z","title":"PREBA: A Hardware/Software Co-Design for Multi-Instance GPU based AI Inference Servers","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-12T10:34:38.404569Z"},"links":{"citing_paper":"/paper/2411.19114"},"observation_digest":"sha256:05b3f8cce1a551f056993b647458538376e67bd510a7cc967034d66453e51e9f","observation_id":"0ad7be90-137d-47f9-a095-680cdf808718","resolution":{"observed_at":"2026-08-12T10:34:39.118630Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:34:39.100631Z","title":"Gimbal: Enabling Multi- Tenant Storage Disaggregation on SmartNIC JBOFs","venue":null,"work_id":"a5b013d9-fd63-4191-a058-a97088eda9a1","year":2021},"citing_paper":{"arxiv_id":"2411.19114","last_updated":"2024-11-28T13:02:41Z","snapshot_observed_at":"2026-08-17T11:56:24.937933Z","submitted_at":"2024-11-28T13:02:41Z","title":"PREBA: A Hardware/Software Co-Design for Multi-Instance GPU based AI Inference Servers","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-12T10:34:38.408865Z"},"links":{"citing_paper":"/paper/2411.19114"},"observation_digest":"sha256:d39b3dc98eed005b083a131e9c7278be901ddc37c2446ef7b27e42b1ab714e37","observation_id":"8ef49a8a-aba6-470f-b0ff-1f615ae0ecfc","resolution":{"observed_at":"2026-08-12T10:34:39.105119Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:34:39.089203Z","title":"Analyzing and Mitigating Data Stalls in DNN Training","venue":null,"work_id":"7461ec1a-568a-4f66-919d-5dba50c065b5","year":2021},"citing_paper":{"arxiv_id":"2411.19114","last_updated":"2024-11-28T13:02:41Z","snapshot_observed_at":"2026-08-17T11:56:24.937933Z","submitted_at":"2024-11-28T13:02:41Z","title":"PREBA: A Hardware/Software Co-Design for Multi-Instance GPU based AI Inference Servers","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-12T10:34:38.413226Z"},"links":{"citing_paper":"/paper/2411.19114"},"observation_digest":"sha256:81cdcc02338f031b18aca329856c20224a0bb182c10c3de127accf9f61af1f86","observation_id":"8d9e749c-6d3b-4056-9abe-ebc78ae46cf7","resolution":{"observed_at":"2026-08-12T10:34:39.093021Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:34:39.079236Z","title":"AccelTCP: Accelerating Network Applications with Stateful TCP Offloading","venue":null,"work_id":"def4d15c-fb00-4128-9a84-19e82492e2af","year":2020},"citing_paper":{"arxiv_id":"2411.19114","last_updated":"2024-11-28T13:02:41Z","snapshot_observed_at":"2026-08-17T11:56:24.937933Z","submitted_at":"2024-11-28T13:02:41Z","title":"PREBA: A Hardware/Software Co-Design for Multi-Instance GPU based AI Inference Servers","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-12T10:34:38.417003Z"},"links":{"citing_paper":"/paper/2411.19114"},"observation_digest":"sha256:76588558360e98fc75c93c882d605c82640e3e59a2fbde1c4e3ee27665ac8e09","observation_id":"29094446-2f0e-4067-8e6e-a5bae921bc45","resolution":{"observed_at":"2026-08-12T10:34:39.082755Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:34:39.068735Z","title":"NVIDIA Triton Inference Server","venue":null,"work_id":"3f438790-cc57-4cd1-9f63-00dc72ad6b84","year":null},"citing_paper":{"arxiv_id":"2411.19114","last_updated":"2024-11-28T13:02:41Z","snapshot_observed_at":"2026-08-17T11:56:24.937933Z","submitted_at":"2024-11-28T13:02:41Z","title":"PREBA: A Hardware/Software Co-Design for Multi-Instance GPU based AI Inference Servers","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-12T10:34:38.420330Z"},"links":{"citing_paper":"/paper/2411.19114"},"observation_digest":"sha256:b8bbfed70963a30120e527a09b68c04d7116356451656cb6151e15aced0e653e","observation_id":"230cc775-27d7-4dc9-be20-4adc83a21a47","resolution":{"observed_at":"2026-08-12T10:34:39.072262Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:34:39.058511Z","title":"NVIDIA TensorRT: Programmable Inference Accelerator","venue":null,"work_id":"146aed4c-49fe-4d55-8d27-e304cd90cc72","year":2018},"citing_paper":{"arxiv_id":"2411.19114","last_updated":"2024-11-28T13:02:41Z","snapshot_observed_at":"2026-08-17T11:56:24.937933Z","submitted_at":"2024-11-28T13:02:41Z","title":"PREBA: A Hardware/Software Co-Design for Multi-Instance GPU based AI Inference Servers","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-12T10:34:38.424883Z"},"links":{"citing_paper":"/paper/2411.19114"},"observation_digest":"sha256:a75c48805cf630217b7d25c766561df0aa6b318aa24365a0fdb1313813280fa4","observation_id":"ebf9d4b2-a68d-4f4a-9949-9e2082919bc9","resolution":{"observed_at":"2026-08-12T10:34:39.062054Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:34:39.048576Z","title":"NVIDIA T4","venue":null,"work_id":"9496a6e3-b9e5-4ca0-a649-190ecaaa9774","year":2019},"citing_paper":{"arxiv_id":"2411.19114","last_updated":"2024-11-28T13:02:41Z","snapshot_observed_at":"2026-08-17T11:56:24.937933Z","submitted_at":"2024-11-28T13:02:41Z","title":"PREBA: A Hardware/Software Co-Design for Multi-Instance GPU based AI Inference Servers","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-12T10:34:38.429195Z"},"links":{"citing_paper":"/paper/2411.19114"},"observation_digest":"sha256:a57b16e5916e527c75ddd9328c4e5bb317f248fdb06d7f4b9cba220f3cc01acb","observation_id":"37694898-1f21-4fa7-a7da-2e310958c5ca","resolution":{"observed_at":"2026-08-12T10:34:39.052078Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:34:39.038389Z","title":"NVIDIA A100","venue":null,"work_id":"9e3999f8-ac9a-48da-9ba4-7666554b91ee","year":2020},"citing_paper":{"arxiv_id":"2411.19114","last_updated":"2024-11-28T13:02:41Z","snapshot_observed_at":"2026-08-17T11:56:24.937933Z","submitted_at":"2024-11-28T13:02:41Z","title":"PREBA: A Hardware/Software Co-Design for Multi-Instance GPU based AI Inference Servers","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-12T10:34:38.433167Z"},"links":{"citing_paper":"/paper/2411.19114"},"observation_digest":"sha256:51f9f17d48fd869fc0dce7dbea0cb9952d6e8c49a40ed387d420d0a8e09b1281","observation_id":"1a0b0e7b-3a66-4831-9904-08523e79708b","resolution":{"observed_at":"2026-08-12T10:34:39.041979Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:34:39.028131Z","title":"NVIDIA CUDA Programming Guide, 2021","venue":null,"work_id":"c7021c57-c370-44a2-8c14-955c016bcdaa","year":2021},"citing_paper":{"arxiv_id":"2411.19114","last_updated":"2024-11-28T13:02:41Z","snapshot_observed_at":"2026-08-17T11:56:24.937933Z","submitted_at":"2024-11-28T13:02:41Z","title":"PREBA: A Hardware/Software Co-Design for Multi-Instance GPU based AI Inference Servers","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-12T10:34:38.437933Z"},"links":{"citing_paper":"/paper/2411.19114"},"observation_digest":"sha256:36fb4ea7f53d933222e513d54c7244e3054bb7979229c82e19466dd53accb334","observation_id":"4ea35def-934d-4174-98f4-c5465aa0f2fb","resolution":{"observed_at":"2026-08-12T10:34:39.031803Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:34:39.017116Z","title":"Multi-Instance GPU","venue":null,"work_id":"b099edde-cf24-45f4-a8f6-9daff9c6d0d5","year":2023},"citing_paper":{"arxiv_id":"2411.19114","last_updated":"2024-11-28T13:02:41Z","snapshot_observed_at":"2026-08-17T11:56:24.937933Z","submitted_at":"2024-11-28T13:02:41Z","title":"PREBA: A Hardware/Software Co-Design for Multi-Instance GPU based AI Inference Servers","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-12T10:34:38.442680Z"},"links":{"citing_paper":"/paper/2411.19114"},"observation_digest":"sha256:808b1c78c11362f9a1d983ce88aa3296641cb014f9232ce4dd7e265f1badb04c","observation_id":"32aa194b-d158-45f1-92c4-3d6d87128106","resolution":{"observed_at":"2026-08-12T10:34:39.021093Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:34:39.006065Z","title":"NVIDIA BlueField Data Processing Units","venue":null,"work_id":"f87a614f-90e0-4452-b2cb-41d0f594e2ec","year":2023},"citing_paper":{"arxiv_id":"2411.19114","last_updated":"2024-11-28T13:02:41Z","snapshot_observed_at":"2026-08-17T11:56:24.937933Z","submitted_at":"2024-11-28T13:02:41Z","title":"PREBA: A Hardware/Software Co-Design for Multi-Instance GPU based AI Inference Servers","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-12T10:34:38.446521Z"},"links":{"citing_paper":"/paper/2411.19114"},"observation_digest":"sha256:27bd477fac892d4329a1bd335203b858ac718d71bf9f1d152c9fcc3dab3cdbbb","observation_id":"ba7a5b2b-2ed3-4b9b-895a-26814cdba131","resolution":{"observed_at":"2026-08-12T10:34:39.010003Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:34:38.994849Z","title":"NVIDIA NeMo","venue":null,"work_id":"1b248f07-2ced-4347-a854-2e347f39a016","year":2023},"citing_paper":{"arxiv_id":"2411.19114","last_updated":"2024-11-28T13:02:41Z","snapshot_observed_at":"2026-08-17T11:56:24.937933Z","submitted_at":"2024-11-28T13:02:41Z","title":"PREBA: A Hardware/Software Co-Design for Multi-Instance GPU based AI Inference Servers","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-12T10:34:38.450518Z"},"links":{"citing_paper":"/paper/2411.19114"},"observation_digest":"sha256:24d557477682b2a3c64096f4e9be1ba2511a7f7e9a1cbf67e38f1bc180da3f4c","observation_id":"86b1c471-cdab-43e4-a126-ac9b752cc47c","resolution":{"observed_at":"2026-08-12T10:34:38.998637Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1712.06139","last_updated":"2017-12-27T20:43:02Z","snapshot_observed_at":"2026-08-14T20:02:52.239357Z","submitted_at":"2017-12-17T16:36:26Z","title":"TensorFlow-Serving: Flexible, High-Performance ML Serving","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1712.06139","snapshot_observed_at":"2026-08-12T10:34:38.455548Z","title":"TensorFlow-Serving: Flexible, High-Performance ML Serving","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2411.19114","last_updated":"2024-11-28T13:02:41Z","snapshot_observed_at":"2026-08-17T11:56:24.937933Z","submitted_at":"2024-11-28T13:02:41Z","title":"PREBA: A Hardware/Software Co-Design for Multi-Instance GPU based AI Inference Servers","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-12T10:34:38.455548Z"},"links":{"cited_paper":"/paper/1712.06139","citing_paper":"/paper/2411.19114"},"observation_digest":"sha256:feea5dd44eddf2be1964d82414944b08028b2e53f41114a2f800a5aaddfb7e30","observation_id":"fa6b2e4d-492f-4755-a2fd-e2fca17916df","resolution":{"observed_at":"2026-08-12T10:34:38.455548Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:34:38.981689Z","title":"LibriSpeech ASR corpus","venue":null,"work_id":"73cec579-2cf8-40f5-a18e-f05c6348b778","year":null},"citing_paper":{"arxiv_id":"2411.19114","last_updated":"2024-11-28T13:02:41Z","snapshot_observed_at":"2026-08-17T11:56:24.937933Z","submitted_at":"2024-11-28T13:02:41Z","title":"PREBA: A Hardware/Software Co-Design for Multi-Instance GPU based AI Inference Servers","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-12T10:34:38.460059Z"},"links":{"citing_paper":"/paper/2411.19114"},"observation_digest":"sha256:26d0144773c6c51d7dfc726294e5f78b58ce6ef6e3bf60c69e13056410aeac08","observation_id":"9d3b4759-087a-46ae-9115-77de0426859f","resolution":{"observed_at":"2026-08-12T10:34:38.986121Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:34:38.968890Z","title":"Parashar, M","venue":null,"work_id":"4191391f-aa93-4f67-acf7-0ebafc10c09f","year":2017},"citing_paper":{"arxiv_id":"2411.19114","last_updated":"2024-11-28T13:02:41Z","snapshot_observed_at":"2026-08-17T11:56:24.937933Z","submitted_at":"2024-11-28T13:02:41Z","title":"PREBA: A Hardware/Software Co-Design for Multi-Instance GPU based AI Inference Servers","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-12T10:34:38.464443Z"},"links":{"citing_paper":"/paper/2411.19114"},"observation_digest":"sha256:a87da271a9071180f7cdc2dfec1d0d90b30bb4a0e8c17020d4eca6b33332fb42","observation_id":"6d081e51-fdf0-403a-a9f3-1641b6aeed44","resolution":{"observed_at":"2026-08-12T10:34:38.973480Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:34:38.956002Z","title":"TrainBox: An Extreme-Scale Neural Network Training Server Architecture by Sys- tematically Balancing Operations","venue":null,"work_id":"673984ae-9680-41d9-91f2-190c595208b0","year":2020},"citing_paper":{"arxiv_id":"2411.19114","last_updated":"2024-11-28T13:02:41Z","snapshot_observed_at":"2026-08-17T11:56:24.937933Z","submitted_at":"2024-11-28T13:02:41Z","title":"PREBA: A Hardware/Software Co-Design for Multi-Instance GPU based AI Inference Servers","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-12T10:34:38.470075Z"},"links":{"citing_paper":"/paper/2411.19114"},"observation_digest":"sha256:4b183afa9aeca35e2d08c1bf365b057cd6481faf721e705f6bfd2d5d3c2df7c8","observation_id":"50003c18-731b-4de5-9459-d40cb480b3a9","resolution":{"observed_at":"2026-08-12T10:34:38.960473Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:34:38.944162Z","title":"Single-Root Input/Output Virtualization","venue":null,"work_id":"c2d0265f-1b06-4a8a-8be4-d1276ce8d035","year":null},"citing_paper":{"arxiv_id":"2411.19114","last_updated":"2024-11-28T13:02:41Z","snapshot_observed_at":"2026-08-17T11:56:24.937933Z","submitted_at":"2024-11-28T13:02:41Z","title":"PREBA: A Hardware/Software Co-Design for Multi-Instance GPU based AI Inference Servers","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-12T10:34:38.475804Z"},"links":{"citing_paper":"/paper/2411.19114"},"observation_digest":"sha256:6e60c8cae34929a92b1a0e1fe532897e4f2fabf9f6a1c2e8a5575d2ff53fe609","observation_id":"88c4e2be-6983-41d9-a772-a8745c792b6f","resolution":{"observed_at":"2026-08-12T10:34:38.948323Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:34:38.933226Z","title":"Torchaudio Transforms","venue":null,"work_id":"e11d899e-b439-4ccd-bff3-b56c862915a6","year":null},"citing_paper":{"arxiv_id":"2411.19114","last_updated":"2024-11-28T13:02:41Z","snapshot_observed_at":"2026-08-17T11:56:24.937933Z","submitted_at":"2024-11-28T13:02:41Z","title":"PREBA: A Hardware/Software Co-Design for Multi-Instance GPU based AI Inference Servers","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-12T10:34:38.480250Z"},"links":{"citing_paper":"/paper/2411.19114"},"observation_digest":"sha256:279f914b5bb24c43ede346064dce759baa8130f4c7a60337ee7e859ee93e219f","observation_id":"a0d28059-fd07-4130-9587-4f0a99fb847f","resolution":{"observed_at":"2026-08-12T10:34:38.937202Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:34:38.921637Z","title":"Transforming and Augmenting Images","venue":null,"work_id":"0c516522-2fd7-48b6-8a11-93f148dbf778","year":null},"citing_paper":{"arxiv_id":"2411.19114","last_updated":"2024-11-28T13:02:41Z","snapshot_observed_at":"2026-08-17T11:56:24.937933Z","submitted_at":"2024-11-28T13:02:41Z","title":"PREBA: A Hardware/Software Co-Design for Multi-Instance GPU based AI Inference Servers","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-12T10:34:38.485978Z"},"links":{"citing_paper":"/paper/2411.19114"},"observation_digest":"sha256:cea6df96c4aa34ae6d973e96a0a4935b8dd5e4223599b6abd681a3dd44998a5b","observation_id":"b98e3363-1adf-4287-bc8d-fddb5cf5900c","resolution":{"observed_at":"2026-08-12T10:34:38.926170Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:34:38.910697Z","title":"PyTorch Hub","venue":null,"work_id":"c2732b9b-54d3-4dde-a91a-4db620764573","year":2023},"citing_paper":{"arxiv_id":"2411.19114","last_updated":"2024-11-28T13:02:41Z","snapshot_observed_at":"2026-08-17T11:56:24.937933Z","submitted_at":"2024-11-28T13:02:41Z","title":"PREBA: A Hardware/Software Co-Design for Multi-Instance GPU based AI Inference Servers","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-12T10:34:38.490272Z"},"links":{"citing_paper":"/paper/2411.19114"},"observation_digest":"sha256:a3eb8af033490c877d4313fa1364d93ae3aef8a4fe1adb0a8bac2d6b4c57864c","observation_id":"1aa15da8-656c-4ba4-a670-acf6c222edc5","resolution":{"observed_at":"2026-08-12T10:34:38.914300Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:34:38.900196Z","title":"Scott Gardner, Itay Hubara, Sachin Idgunji, Thomas B","venue":null,"work_id":"046ab637-7687-412f-9ed3-eecf8bc11f11","year":2020},"citing_paper":{"arxiv_id":"2411.19114","last_updated":"2024-11-28T13:02:41Z","snapshot_observed_at":"2026-08-17T11:56:24.937933Z","submitted_at":"2024-11-28T13:02:41Z","title":"PREBA: A Hardware/Software Co-Design for Multi-Instance GPU based AI Inference Servers","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-12T10:34:38.494647Z"},"links":{"citing_paper":"/paper/2411.19114"},"observation_digest":"sha256:f7ee87cd73337fbb749211ee14f2e198fd7945ca7870d35cd466ae9c90722320","observation_id":"fac3e955-133f-4561-8b55-a997476d8ac5","resolution":{"observed_at":"2026-08-12T10:34:38.903823Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2209.06018","last_updated":"2023-04-24T08:46:16Z","snapshot_observed_at":"2026-08-16T16:32:51.206413Z","submitted_at":"2022-09-13T14:13:06Z","title":"An Analysis of Collocation on GPUs for Deep Learning Training","version":3},"cited_work":{"arxiv_id":"2209.06018","doi":null,"metadata_source":"pith","pith_arxiv_id":"2209.06018","snapshot_observed_at":"2026-08-12T10:34:38.625133Z","title":"An Analysis of Collocation on GPUs for Deep Learning Training","venue":"cs.LG","work_id":"5fe3ae27-fe41-468b-a31f-cb62ee95b055","year":2022},"citing_paper":{"arxiv_id":"2411.19114","last_updated":"2024-11-28T13:02:41Z","snapshot_observed_at":"2026-08-17T11:56:24.937933Z","submitted_at":"2024-11-28T13:02:41Z","title":"PREBA: A Hardware/Software Co-Design for Multi-Instance GPU based AI Inference Servers","version":1},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-12T10:34:38.498606Z"},"links":{"cited_paper":"/paper/2209.06018","citing_paper":"/paper/2411.19114"},"observation_digest":"sha256:c8459b9c24eb9f9538c7169bf942c7033a859f8fee367aa5cb4bb8b0cdd56171","observation_id":"307c311e-298d-49b3-b08c-e858e69cec4a","resolution":{"observed_at":"2026-08-12T10:34:38.631590Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:34:38.888871Z","title":"Samsung Develops Industry’s First GDDR7 DRAM To Un- lock the Next Generation of Graphics Performance","venue":null,"work_id":"99c43b55-0cdd-4130-ab58-0eb7d7ccf316","year":2023},"citing_paper":{"arxiv_id":"2411.19114","last_updated":"2024-11-28T13:02:41Z","snapshot_observed_at":"2026-08-17T11:56:24.937933Z","submitted_at":"2024-11-28T13:02:41Z","title":"PREBA: A Hardware/Software Co-Design for Multi-Instance GPU based AI Inference Servers","version":1},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-12T10:34:38.507544Z"},"links":{"citing_paper":"/paper/2411.19114"},"observation_digest":"sha256:2516ea863875c3f08a4d424df613c182743c0b65234e2d60227288b611179f56","observation_id":"51d51f1a-b225-4511-8290-5b529f91c2e0","resolution":{"observed_at":"2026-08-12T10:34:38.893368Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:34:38.876835Z","title":"Tell, Yanqing Zhang, William J","venue":null,"work_id":"0b09728f-c0a6-4af4-9358-07f68b89ad02","year":2019},"citing_paper":{"arxiv_id":"2411.19114","last_updated":"2024-11-28T13:02:41Z","snapshot_observed_at":"2026-08-17T11:56:24.937933Z","submitted_at":"2024-11-28T13:02:41Z","title":"PREBA: A Hardware/Software Co-Design for Multi-Instance GPU based AI Inference Servers","version":1},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-12T10:34:38.513530Z"},"links":{"citing_paper":"/paper/2411.19114"},"observation_digest":"sha256:dc2f55d5f544f9603ea2bedcc5fdfe1e5a338e35dcf547426dac08242074229f","observation_id":"f94ae1fa-158f-454b-89f0-147983990e66","resolution":{"observed_at":"2026-08-12T10:34:38.880489Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:34:38.865731Z","title":"Laconic Deep Learning Inference Acceleration","venue":null,"work_id":"01599730-4fe4-4981-9b81-86af41474c1b","year":2019},"citing_paper":{"arxiv_id":"2411.19114","last_updated":"2024-11-28T13:02:41Z","snapshot_observed_at":"2026-08-17T11:56:24.937933Z","submitted_at":"2024-11-28T13:02:41Z","title":"PREBA: A Hardware/Software Co-Design for Multi-Instance GPU based AI Inference Servers","version":1},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-12T10:34:38.518104Z"},"links":{"citing_paper":"/paper/2411.19114"},"observation_digest":"sha256:169f51a3a0df2580b6fc91a87a14683385c4af1568c96003bf7cbb164346d053","observation_id":"72a17066-2bb1-434e-90ea-b2b6941735a9","resolution":{"observed_at":"2026-08-12T10:34:38.869518Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:34:38.853115Z","title":"Bit Fu- sion: Bit-Level Dynamically Composable Architecture for Accelerating Deep Neural Network","venue":null,"work_id":"c1846344-9607-4c0c-b656-66554d9244f1","year":2018},"citing_paper":{"arxiv_id":"2411.19114","last_updated":"2024-11-28T13:02:41Z","snapshot_observed_at":"2026-08-17T11:56:24.937933Z","submitted_at":"2024-11-28T13:02:41Z","title":"PREBA: A Hardware/Software Co-Design for Multi-Instance GPU based AI Inference Servers","version":1},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-08-12T10:34:38.522338Z"},"links":{"citing_paper":"/paper/2411.19114"},"observation_digest":"sha256:c28a3b1ef5a37413b2c2d148c4e826319e4ae53a5b6ad6b7f0e86acaf9045466","observation_id":"8a812d19-29e9-4d44-8b0a-07dfb5aab145","resolution":{"observed_at":"2026-08-12T10:34:38.857136Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:34:38.841791Z","title":"FlexTOE: Flexible TCP Offload with Fine-Grained Parallelism","venue":null,"work_id":"87ed193c-3c5e-470d-9a87-2ed5286bec46","year":2022},"citing_paper":{"arxiv_id":"2411.19114","last_updated":"2024-11-28T13:02:41Z","snapshot_observed_at":"2026-08-17T11:56:24.937933Z","submitted_at":"2024-11-28T13:02:41Z","title":"PREBA: A Hardware/Software Co-Design for Multi-Instance GPU based AI Inference Servers","version":1},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-08-12T10:34:38.527085Z"},"links":{"citing_paper":"/paper/2411.19114"},"observation_digest":"sha256:0eac9d5ca43a207a0410b29d7425f862f446d422f59f3abfd9ffb1490e4e7328","observation_id":"cc97a1a7-0cf6-43d6-b238-24d2dfcf411c","resolution":{"observed_at":"2026-08-12T10:34:38.845985Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:34:38.830071Z","title":"Microsoft Maia v1","venue":null,"work_id":"488b1bfd-8e86-4c18-ad39-a9615506d5e2","year":2023},"citing_paper":{"arxiv_id":"2411.19114","last_updated":"2024-11-28T13:02:41Z","snapshot_observed_at":"2026-08-17T11:56:24.937933Z","submitted_at":"2024-11-28T13:02:41Z","title":"PREBA: A Hardware/Software Co-Design for Multi-Instance GPU based AI Inference Servers","version":1},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-08-12T10:34:38.531687Z"},"links":{"citing_paper":"/paper/2411.19114"},"observation_digest":"sha256:7a1775d9dd2b6a3fdb81547a481cfd84bd62d7302ab8fc702c1d53b8af671ae9","observation_id":"3bf04da7-a059-4668-83d4-e3b9dc783821","resolution":{"observed_at":"2026-08-12T10:34:38.834515Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:34:38.818872Z","title":"https://store.supermicro.com/us_en/mainstream-amd- 2u-as-2024s-tr.html , 2024","venue":null,"work_id":"c722b7b7-139e-40d1-abd8-f01a1f057c46","year":2024},"citing_paper":{"arxiv_id":"2411.19114","last_updated":"2024-11-28T13:02:41Z","snapshot_observed_at":"2026-08-17T11:56:24.937933Z","submitted_at":"2024-11-28T13:02:41Z","title":"PREBA: A Hardware/Software Co-Design for Multi-Instance GPU based AI Inference Servers","version":1},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-08-12T10:34:38.537507Z"},"links":{"citing_paper":"/paper/2411.19114"},"observation_digest":"sha256:3ce4e878a0f180e457888884aa087841750df8aeb1215155e43021e27685a0bd","observation_id":"8e2b71e1-ff23-4c46-a190-abf344b7dd05","resolution":{"observed_at":"2026-08-12T10:34:38.822832Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:34:38.808545Z","title":"Lynx: A SmartNIC- Driven Accelerator-Centric Architecture for Network Servers","venue":null,"work_id":"cb344ad7-c5a7-41d0-8b3f-596b2ecb2120","year":2020},"citing_paper":{"arxiv_id":"2411.19114","last_updated":"2024-11-28T13:02:41Z","snapshot_observed_at":"2026-08-17T11:56:24.937933Z","submitted_at":"2024-11-28T13:02:41Z","title":"PREBA: A Hardware/Software Co-Design for Multi-Instance GPU based AI Inference Servers","version":1},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-08-12T10:34:38.541987Z"},"links":{"citing_paper":"/paper/2411.19114"},"observation_digest":"sha256:0de3f61a9b301e5f2d807a310afa8f3158b3cafd39eafb4ed9a7ceac1918fcfa","observation_id":"4258ab49-cc20-4166-b261-9185d28a3387","resolution":{"observed_at":"2026-08-12T10:34:38.812152Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:34:38.796849Z","title":"FastFlow: Accelerating Deep Learn- ing Model Training with Smart Offloading of Input Data Pipeline","venue":null,"work_id":"89adc0a7-72ee-4e48-b6f1-046f56d861b2","year":2023},"citing_paper":{"arxiv_id":"2411.19114","last_updated":"2024-11-28T13:02:41Z","snapshot_observed_at":"2026-08-17T11:56:24.937933Z","submitted_at":"2024-11-28T13:02:41Z","title":"PREBA: A Hardware/Software Co-Design for Multi-Instance GPU based AI Inference Servers","version":1},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-08-12T10:34:38.547356Z"},"links":{"citing_paper":"/paper/2411.19114"},"observation_digest":"sha256:cd0b691222a6006c68142494852d4e6e00c4269e23a7e85eeddbbb63fbcdcd5b","observation_id":"92292c9b-1935-4906-a1a8-17ec111a052c","resolution":{"observed_at":"2026-08-12T10:34:38.801010Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:34:38.785891Z","title":"Real-time Meets Approximate Computing: An Elastic CNN Inference Accelerator with Adaptive Trade-off Between QoS and QoR","venue":null,"work_id":"bc1f1a89-e609-400a-a4c8-34b360555a27","year":2017},"citing_paper":{"arxiv_id":"2411.19114","last_updated":"2024-11-28T13:02:41Z","snapshot_observed_at":"2026-08-17T11:56:24.937933Z","submitted_at":"2024-11-28T13:02:41Z","title":"PREBA: A Hardware/Software Co-Design for Multi-Instance GPU based AI Inference Servers","version":1},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-08-12T10:34:38.551240Z"},"links":{"citing_paper":"/paper/2411.19114"},"observation_digest":"sha256:d278ed99e0db879ad94c3d01ea4119a05701358f004b4e4c537c10671aca01bb","observation_id":"6452af10-447a-42f2-8132-05dff8e11a02","resolution":{"observed_at":"2026-08-12T10:34:38.789779Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:34:38.775104Z","title":"A None- Sparse Inference Accelerator that Distills and Reuses the Computation Redundancy in CNNs","venue":null,"work_id":"2c8af15a-604c-4db9-8989-0afd160dd665","year":2019},"citing_paper":{"arxiv_id":"2411.19114","last_updated":"2024-11-28T13:02:41Z","snapshot_observed_at":"2026-08-17T11:56:24.937933Z","submitted_at":"2024-11-28T13:02:41Z","title":"PREBA: A Hardware/Software Co-Design for Multi-Instance GPU based AI Inference Servers","version":1},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-08-12T10:34:38.555406Z"},"links":{"citing_paper":"/paper/2411.19114"},"observation_digest":"sha256:1cc179786e7f53803d0689d127326d687784820c2cfcee159836c90da99bcfb2","observation_id":"616a5dd7-cffc-42c8-898f-10819e1288ec","resolution":{"observed_at":"2026-08-12T10:34:38.778962Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:34:38.763495Z","title":"FpgaNIC: An FPGA-based Versatile 100Gb SmartNIC for GPUs","venue":null,"work_id":"db07b81d-99af-41fa-a90d-59243510d692","year":2022},"citing_paper":{"arxiv_id":"2411.19114","last_updated":"2024-11-28T13:02:41Z","snapshot_observed_at":"2026-08-17T11:56:24.937933Z","submitted_at":"2024-11-28T13:02:41Z","title":"PREBA: A Hardware/Software Co-Design for Multi-Instance GPU based AI Inference Servers","version":1},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-08-12T10:34:38.559296Z"},"links":{"citing_paper":"/paper/2411.19114"},"observation_digest":"sha256:1f792b459565aaddaf93aefad874e8f69d281b6793bc5e09f28b0bc2f215ca27","observation_id":"4aba7ce0-7905-4094-bb76-180883163ca9","resolution":{"observed_at":"2026-08-12T10:34:38.768076Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:34:38.752154Z","title":"Xilinx OpenCL Extension","venue":null,"work_id":"b5833486-8bb9-45ed-ac55-035c59940502","year":2022},"citing_paper":{"arxiv_id":"2411.19114","last_updated":"2024-11-28T13:02:41Z","snapshot_observed_at":"2026-08-17T11:56:24.937933Z","submitted_at":"2024-11-28T13:02:41Z","title":"PREBA: A Hardware/Software Co-Design for Multi-Instance GPU based AI Inference Servers","version":1},"reference_index":88,"source":"pdf_text","source_observed_at":"2026-08-12T10:34:38.562983Z"},"links":{"citing_paper":"/paper/2411.19114"},"observation_digest":"sha256:4f7bb44f6380f0a284526de32286f0321e46d7655c0bb889ffac349ee6624c94","observation_id":"7be053fa-4b55-48a0-a761-e4abf03e2e85","resolution":{"observed_at":"2026-08-12T10:34:38.756232Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:34:38.739969Z","title":"Vitis High-level Synthesis User Guide","venue":null,"work_id":"2eaebaed-74f8-4e9b-ae6d-9c54c7e83d56","year":2023},"citing_paper":{"arxiv_id":"2411.19114","last_updated":"2024-11-28T13:02:41Z","snapshot_observed_at":"2026-08-17T11:56:24.937933Z","submitted_at":"2024-11-28T13:02:41Z","title":"PREBA: A Hardware/Software Co-Design for Multi-Instance GPU based AI Inference Servers","version":1},"reference_index":89,"source":"pdf_text","source_observed_at":"2026-08-12T10:34:38.567086Z"},"links":{"citing_paper":"/paper/2411.19114"},"observation_digest":"sha256:89dd86dd01328508d253e5aac3b4ba517e69d61b725716de0175240ce63d4778","observation_id":"343db716-947b-429c-a570-db8f2b3895ef","resolution":{"observed_at":"2026-08-12T10:34:38.744636Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:34:38.726323Z","title":"https://www.xilinx.com/products/boards-and-kits/alveo/u55c","venue":null,"work_id":"d1578aa2-6aa2-4894-a8d5-f1705b269a81","year":2024},"citing_paper":{"arxiv_id":"2411.19114","last_updated":"2024-11-28T13:02:41Z","snapshot_observed_at":"2026-08-17T11:56:24.937933Z","submitted_at":"2024-11-28T13:02:41Z","title":"PREBA: A Hardware/Software Co-Design for Multi-Instance GPU based AI Inference Servers","version":1},"reference_index":90,"source":"pdf_text","source_observed_at":"2026-08-12T10:34:38.571345Z"},"links":{"citing_paper":"/paper/2411.19114"},"observation_digest":"sha256:a1705e1de180d9c630a7d6c606f8cda1ff842418a938aecc5200051daf185bb0","observation_id":"b52a22d2-5abb-4f34-9cde-e356361ec547","resolution":{"observed_at":"2026-08-12T10:34:38.730853Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:34:38.712524Z","title":"Sinclair, Bradford M","venue":null,"work_id":"13dfd166-09b6-4f15-875b-4aa6b2bdb4bf","year":2021},"citing_paper":{"arxiv_id":"2411.19114","last_updated":"2024-11-28T13:02:41Z","snapshot_observed_at":"2026-08-17T11:56:24.937933Z","submitted_at":"2024-11-28T13:02:41Z","title":"PREBA: A Hardware/Software Co-Design for Multi-Instance GPU based AI Inference Servers","version":1},"reference_index":91,"source":"pdf_text","source_observed_at":"2026-08-12T10:34:38.575360Z"},"links":{"citing_paper":"/paper/2411.19114"},"observation_digest":"sha256:021b5c8850829d7cc42294dfbfc68eb0dd31b57ccd78931bca3095ae6d40c845","observation_id":"7bc2c7ec-8ae4-43e7-a186-b3e5de010601","resolution":{"observed_at":"2026-08-12T10:34:38.717003Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:34:38.699925Z","title":"Orca: A Distributed Serving System for Transformer-Based Generative Models","venue":null,"work_id":"4a17d823-ea5d-47ea-a9e3-d4f1cd4c1922","year":2022},"citing_paper":{"arxiv_id":"2411.19114","last_updated":"2024-11-28T13:02:41Z","snapshot_observed_at":"2026-08-17T11:56:24.937933Z","submitted_at":"2024-11-28T13:02:41Z","title":"PREBA: A Hardware/Software Co-Design for Multi-Instance GPU based AI Inference Servers","version":1},"reference_index":92,"source":"pdf_text","source_observed_at":"2026-08-12T10:34:38.579709Z"},"links":{"citing_paper":"/paper/2411.19114"},"observation_digest":"sha256:dfb358623d129ab5528fccdb26797349b64dfc6372b0e9d5da8e7c0a3e299c83","observation_id":"59896571-7772-473c-aada-a84e5b34bf33","resolution":{"observed_at":"2026-08-12T10:34:38.703916Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:34:38.687699Z","title":"MArk: Ex- ploiting Cloud Services for Cost-Effective,SLO-Aware Machine Learn- ing Inference Serving","venue":null,"work_id":"1a0a645d-1abd-4242-8111-2888551342e2","year":2019},"citing_paper":{"arxiv_id":"2411.19114","last_updated":"2024-11-28T13:02:41Z","snapshot_observed_at":"2026-08-17T11:56:24.937933Z","submitted_at":"2024-11-28T13:02:41Z","title":"PREBA: A Hardware/Software Co-Design for Multi-Instance GPU based AI Inference Servers","version":1},"reference_index":93,"source":"pdf_text","source_observed_at":"2026-08-12T10:34:38.583231Z"},"links":{"citing_paper":"/paper/2411.19114"},"observation_digest":"sha256:5814003c1b412e6697bf875ceff1fdf9261ef81abb2dfdc31bb996e18df0ca12","observation_id":"a0149199-d212-4d45-b3ae-9edf222e5098","resolution":{"observed_at":"2026-08-12T10:34:38.691935Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:34:38.676055Z","title":"Understand- ing Data Storage and Ingestion for Large-Scale Deep Recommendation Model Training: Industrial Product","venue":null,"work_id":"0c15fcf1-075c-45f6-9d10-2f3d8b6654a4","year":2022},"citing_paper":{"arxiv_id":"2411.19114","last_updated":"2024-11-28T13:02:41Z","snapshot_observed_at":"2026-08-17T11:56:24.937933Z","submitted_at":"2024-11-28T13:02:41Z","title":"PREBA: A Hardware/Software Co-Design for Multi-Instance GPU based AI Inference Servers","version":1},"reference_index":94,"source":"pdf_text","source_observed_at":"2026-08-12T10:34:38.587351Z"},"links":{"citing_paper":"/paper/2411.19114"},"observation_digest":"sha256:1c8e6e67295da41b8bbb1cfee5ca700ff9108508770334d35fc9b5b7d22cae53","observation_id":"7c445e07-0e05-4986-a570-9095071f01e6","resolution":{"observed_at":"2026-08-12T10:34:38.679897Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2411.19114","last_updated":"2024-11-28T13:02:41Z","latest_version":1,"primary_category":"cs.DC","snapshot_observed_at":"2026-08-17T11:56:24.937933Z","submitted_at":"2024-11-28T13:02:41Z","title":"PREBA: A Hardware/Software Co-Design for Multi-Instance GPU based AI Inference Servers"},"reference_resolution":{"displayed":94,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":21,"verified_exact":1,"verified_fuzzy":72},"total_outbound_references":94},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"thesis":"As of 20 August 2026, this Paper Citation Record lists 94 of 94 outbound references and 0 inbound Pith citation observations for arXiv:2411.19114."}