{"as_of":"2026-08-04T07:37:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:f3cdbf5cd1fe96599650e4fb12adf001ec6c2a0a4f67bfd541cd59e740a53870","coverage":[{"denominator":34,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":34,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-01T06:27:38.667047Z","state":"measured"},{"denominator":34,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":34,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-04T06:34:03.388597+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2606.29629/citation-record","integrity":"/paper/2606.29629/integrity","json":"/paper/2606.29629/citation-record.json","paper":"/paper/2606.29629"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-06T18:12:47.418550Z","title":"Claude code: Agentic coding in the terminal,","venue":null,"work_id":"1a8fcd11-c1d5-4a38-9f81-017296a1ea92","year":2025},"citing_paper":{"arxiv_id":"2606.29629","last_updated":"2026-06-30T16:14:13Z","snapshot_observed_at":"2026-08-02T18:30:05.891924Z","submitted_at":"2026-06-28T22:22:43Z","title":"Energy-Efficient Multimodal Inference Serving with Tri-serve","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-07-01T06:27:38.667047Z"},"links":{"citing_paper":"/paper/2606.29629"},"observation_digest":"sha256:f2ced0e6a8a14bdd56f32046cddbf90bffb987b7f029d1af89fb9e1be4dd2321","observation_id":"d5c286a1-0c6a-4613-b99a-59545af3f91f","resolution":{"observed_at":"2026-07-06T18:12:47.420082Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-06T18:12:47.406346Z","title":"Cursor: The AI code editor,","venue":null,"work_id":"c38856ee-7336-48ed-b58f-b21f164a69d1","year":2024},"citing_paper":{"arxiv_id":"2606.29629","last_updated":"2026-06-30T16:14:13Z","snapshot_observed_at":"2026-08-02T18:30:05.891924Z","submitted_at":"2026-06-28T22:22:43Z","title":"Energy-Efficient Multimodal Inference Serving with Tri-serve","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-07-01T06:27:38.667047Z"},"links":{"citing_paper":"/paper/2606.29629"},"observation_digest":"sha256:1e1dde230d74d0336c6f680dc513af228dbd84f41b9ec1e78c2cef318da86761","observation_id":"a3ba370b-ef3b-42d2-92cf-5cb9616053b5","resolution":{"observed_at":"2026-07-06T18:12:47.407970Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-06T18:12:47.402358Z","title":"Openai codex: A cloud-based software engineering agent,","venue":null,"work_id":"ecbd0b27-3959-42a6-9068-8eb84f0ccec4","year":2025},"citing_paper":{"arxiv_id":"2606.29629","last_updated":"2026-06-30T16:14:13Z","snapshot_observed_at":"2026-08-02T18:30:05.891924Z","submitted_at":"2026-06-28T22:22:43Z","title":"Energy-Efficient Multimodal Inference Serving with Tri-serve","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-07-01T06:27:38.667047Z"},"links":{"citing_paper":"/paper/2606.29629"},"observation_digest":"sha256:09c4e713df5621486ccb44f245a70158f57e57d872c13ab9b3a3962ba4fa0a3b","observation_id":"19d0e6fd-5a8a-43c5-917b-a8a637a46f0e","resolution":{"observed_at":"2026-07-06T18:12:47.404548Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-06T18:12:47.414048Z","title":"OpenClaw: An open-source conversational AI assistant,","venue":null,"work_id":"269d48fd-4edb-4d1b-b573-3625ce957a37","year":2024},"citing_paper":{"arxiv_id":"2606.29629","last_updated":"2026-06-30T16:14:13Z","snapshot_observed_at":"2026-08-02T18:30:05.891924Z","submitted_at":"2026-06-28T22:22:43Z","title":"Energy-Efficient Multimodal Inference Serving with Tri-serve","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-07-01T06:27:38.667047Z"},"links":{"citing_paper":"/paper/2606.29629"},"observation_digest":"sha256:40f78861c06db3870a2a7f8807dad897e3c9ed55a6c3e10fd31d7ddcd829814a","observation_id":"b6fd3380-0281-41af-9a8c-93299d758395","resolution":{"observed_at":"2026-07-06T18:12:47.415541Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-06T18:12:47.416307Z","title":"Introducing ChatGPT,","venue":null,"work_id":"3295f471-5879-4c14-80f3-901053fcb284","year":2022},"citing_paper":{"arxiv_id":"2606.29629","last_updated":"2026-06-30T16:14:13Z","snapshot_observed_at":"2026-08-02T18:30:05.891924Z","submitted_at":"2026-06-28T22:22:43Z","title":"Energy-Efficient Multimodal Inference Serving with Tri-serve","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-07-01T06:27:38.667047Z"},"links":{"citing_paper":"/paper/2606.29629"},"observation_digest":"sha256:37c83aa196f3975645ad5d25a3ed4ff79f7b581b015c9919665a9576fb6dea4f","observation_id":"e528c900-77a9-4a39-baaf-2579548c32d1","resolution":{"observed_at":"2026-07-06T18:12:47.417857Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-06T18:12:47.419629Z","title":"Gemini: A family of highly capable multimodal models,","venue":null,"work_id":"fc04ee06-9416-462b-8a16-6fa7b121110d","year":2023},"citing_paper":{"arxiv_id":"2606.29629","last_updated":"2026-06-30T16:14:13Z","snapshot_observed_at":"2026-08-02T18:30:05.891924Z","submitted_at":"2026-06-28T22:22:43Z","title":"Energy-Efficient Multimodal Inference Serving with Tri-serve","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-07-01T06:27:38.667047Z"},"links":{"citing_paper":"/paper/2606.29629"},"observation_digest":"sha256:51e3d6dd196a4f509e81d204fead1d825f9d4079abb7e9974dd1aa7a49db9e8e","observation_id":"d7155c01-e741-4b23-bd2d-8b6d1b9c0879","resolution":{"observed_at":"2026-07-06T18:12:47.421089Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2602.02204","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-04T19:40:07.015791Z","title":"vllm-omni: Fully disaggregated serving for any-to-any multimodal models","venue":null,"work_id":"11eb1840-40c6-4f3c-8f6a-53422545f9d8","year":2026},"citing_paper":{"arxiv_id":"2606.29629","last_updated":"2026-06-30T16:14:13Z","snapshot_observed_at":"2026-08-02T18:30:05.891924Z","submitted_at":"2026-06-28T22:22:43Z","title":"Energy-Efficient Multimodal Inference Serving with Tri-serve","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-07-01T06:27:38.667047Z"},"links":{"citing_paper":"/paper/2606.29629"},"observation_digest":"sha256:9523eeda8d3bdac71010ef38cb0df5a92e767881ddb8d84e9cb18730a0746a83","observation_id":"a9f89783-0c96-4968-96b5-22184cd7aac2","resolution":{"observed_at":"2026-07-01T09:35:40.148389Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-06T18:12:47.423694Z","title":"Char- acterizing power management opportunities for llms in the cloud,","venue":null,"work_id":"edc9cdca-80e6-42ed-80a3-7f0a8885d9e7","year":2024},"citing_paper":{"arxiv_id":"2606.29629","last_updated":"2026-06-30T16:14:13Z","snapshot_observed_at":"2026-08-02T18:30:05.891924Z","submitted_at":"2026-06-28T22:22:43Z","title":"Energy-Efficient Multimodal Inference Serving with Tri-serve","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-07-01T06:27:38.667047Z"},"links":{"citing_paper":"/paper/2606.29629"},"observation_digest":"sha256:1f79ba9847657d13741e0c84c56ad83ef07a1f752f1ca1ed49056fc50bc4dfb0","observation_id":"e2e64eb2-4955-4928-8523-e39dddaf2ce4","resolution":{"observed_at":"2026-07-06T18:12:47.425456Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-06T18:12:47.411791Z","title":"Slo-aware gpu dvfs for energy-efficient llm inference serving,","venue":null,"work_id":"8827042a-3e58-4d48-a4f9-6cabf3dba6ec","year":2024},"citing_paper":{"arxiv_id":"2606.29629","last_updated":"2026-06-30T16:14:13Z","snapshot_observed_at":"2026-08-02T18:30:05.891924Z","submitted_at":"2026-06-28T22:22:43Z","title":"Energy-Efficient Multimodal Inference Serving with Tri-serve","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-07-01T06:27:38.667047Z"},"links":{"citing_paper":"/paper/2606.29629"},"observation_digest":"sha256:5f061d1cd1f579ff97682d596a2456fb96f4f84527e839e8b29f2aeaeb725f15","observation_id":"a7f6313d-d51c-4c7b-abd5-ef3634ccf550","resolution":{"observed_at":"2026-07-06T18:12:47.413395Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-06T18:12:47.397671Z","title":"Power-aware deep learning model serving withµ-Serve,","venue":null,"work_id":"e5e2014a-b328-498d-964d-7a4e71072f1e","year":2024},"citing_paper":{"arxiv_id":"2606.29629","last_updated":"2026-06-30T16:14:13Z","snapshot_observed_at":"2026-08-02T18:30:05.891924Z","submitted_at":"2026-06-28T22:22:43Z","title":"Energy-Efficient Multimodal Inference Serving with Tri-serve","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-07-01T06:27:38.667047Z"},"links":{"citing_paper":"/paper/2606.29629"},"observation_digest":"sha256:8afaa858220ee0072fd84c0a69189768745a80052eeda8036fe82fabcfd4d1c2","observation_id":"527ba693-683e-428c-8719-5b88f56fe85e","resolution":{"observed_at":"2026-07-06T18:12:47.399117Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-06T18:12:47.430289Z","title":"throttll’em: Predictive gpu throttling for energy efficient llm inference serving,","venue":null,"work_id":"1bbd6fa2-a4b3-41f3-8cc3-c5aa1eead7eb","year":2025},"citing_paper":{"arxiv_id":"2606.29629","last_updated":"2026-06-30T16:14:13Z","snapshot_observed_at":"2026-08-02T18:30:05.891924Z","submitted_at":"2026-06-28T22:22:43Z","title":"Energy-Efficient Multimodal Inference Serving with Tri-serve","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-07-01T06:27:38.667047Z"},"links":{"citing_paper":"/paper/2606.29629"},"observation_digest":"sha256:1c1e47d96a93347db1304d0ee88abce44ec5a3fbf5c9087d4ec78a0e5cb171ba","observation_id":"d69606d9-18b5-46d3-a0e6-fee700a0794e","resolution":{"observed_at":"2026-07-06T18:12:47.431811Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12186","last_updated":"2024-11-12T13:24:25Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-09-18T17:57:57Z","title":"Qwen2.5-Coder Technical Report","version":3},"cited_work":{"arxiv_id":"2409.12186","doi":"10.48550/arxiv.2409.12186","metadata_source":"pith","pith_arxiv_id":"2409.12186","snapshot_observed_at":"2026-07-10T16:07:20.290468Z","title":"Qwen2.5-Coder Technical Report","venue":"cs.CL","work_id":"09ba463d-6377-4017-9801-444ffb94b056","year":2024},"citing_paper":{"arxiv_id":"2606.29629","last_updated":"2026-06-30T16:14:13Z","snapshot_observed_at":"2026-08-02T18:30:05.891924Z","submitted_at":"2026-06-28T22:22:43Z","title":"Energy-Efficient Multimodal Inference Serving with Tri-serve","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-07-01T06:27:38.667047Z"},"links":{"cited_paper":"/paper/2409.12186","citing_paper":"/paper/2606.29629"},"observation_digest":"sha256:66ff5f3ee3cd2caa2d87005fad196810378d84ed40cce92bd9ebcc34f52606a9","observation_id":"17e0293e-dc60-47ec-a524-c2ce7c6d554f","resolution":{"observed_at":"2026-07-01T09:35:40.135922Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-07-11T05:18:55.772185+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T05:18:55.772185+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09388","last_updated":"2025-05-14T13:41:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-14T13:41:34Z","title":"Qwen3 Technical Report","version":1},"cited_work":{"arxiv_id":"2505.09388","doi":"10.1016/j.aiopen.2022.12","metadata_source":"pith","pith_arxiv_id":"2505.09388","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Qwen3 Technical Report","venue":"cs.CL","work_id":"25a4e30c-1232-48e7-9925-02fa12ba7c9e","year":2025},"citing_paper":{"arxiv_id":"2606.29629","last_updated":"2026-06-30T16:14:13Z","snapshot_observed_at":"2026-08-02T18:30:05.891924Z","submitted_at":"2026-06-28T22:22:43Z","title":"Energy-Efficient Multimodal Inference Serving with Tri-serve","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-07-01T06:27:38.667047Z"},"links":{"cited_paper":"/paper/2505.09388","citing_paper":"/paper/2606.29629"},"observation_digest":"sha256:a445ade33d2dfedb6ed58e451b33953ed58687c78d5421521e78d9f0f800e05b","observation_id":"132dc57d-3755-4936-b325-06152beab585","resolution":{"observed_at":"2026-07-01T09:35:40.138454Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.17765","last_updated":"2025-09-22T13:26:24Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-22T13:26:24Z","title":"Qwen3-Omni Technical Report","version":1},"cited_work":{"arxiv_id":"2509.17765","doi":"10.48550/arxiv.2509.17765","metadata_source":"pith","pith_arxiv_id":"2509.17765","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"Qwen3-Omni Technical Report","venue":"cs.CL","work_id":"ae43e594-8bab-4471-b6af-92a300f6a048","year":2025},"citing_paper":{"arxiv_id":"2606.29629","last_updated":"2026-06-30T16:14:13Z","snapshot_observed_at":"2026-08-02T18:30:05.891924Z","submitted_at":"2026-06-28T22:22:43Z","title":"Energy-Efficient Multimodal Inference Serving with Tri-serve","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-07-01T06:27:38.667047Z"},"links":{"cited_paper":"/paper/2509.17765","citing_paper":"/paper/2606.29629"},"observation_digest":"sha256:0eb09f470158ccd27e7183be65ffc75a9795646e1dbba5a3a704dba49a649876","observation_id":"282c593d-5717-4e79-9e3c-753abfc38793","resolution":{"observed_at":"2026-07-01T09:35:40.143346Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-06T18:12:47.428271Z","title":"An integrated gpu power and performance model,","venue":null,"work_id":"644fabd9-33c9-43c7-96fd-475f2b19fde2","year":2010},"citing_paper":{"arxiv_id":"2606.29629","last_updated":"2026-06-30T16:14:13Z","snapshot_observed_at":"2026-08-02T18:30:05.891924Z","submitted_at":"2026-06-28T22:22:43Z","title":"Energy-Efficient Multimodal Inference Serving with Tri-serve","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-07-01T06:27:38.667047Z"},"links":{"citing_paper":"/paper/2606.29629"},"observation_digest":"sha256:c1ba493e7a07fda7f39c377f50b15ffda6ff180339a5afdd6ebfe99ed8db6c94","observation_id":"10f572e2-c417-4e51-8928-28db42f9be6f","resolution":{"observed_at":"2026-07-06T18:12:47.430432Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-06T18:12:47.392034Z","title":"Gpgpu power modeling for multi-domain voltage-frequency scaling","venue":null,"work_id":"02230ff6-a4d8-4ae4-b771-1d0e1cf9a0fc","year":2018},"citing_paper":{"arxiv_id":"2606.29629","last_updated":"2026-06-30T16:14:13Z","snapshot_observed_at":"2026-08-02T18:30:05.891924Z","submitted_at":"2026-06-28T22:22:43Z","title":"Energy-Efficient Multimodal Inference Serving with Tri-serve","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-07-01T06:27:38.667047Z"},"links":{"citing_paper":"/paper/2606.29629"},"observation_digest":"sha256:d36dd13ff3c10dd73134e35d9312e3c515954e82e1ce4fffbee96fb32b3d36fa","observation_id":"fed2222c-2ed4-4ce3-98c6-69cdcc62adb7","resolution":{"observed_at":"2026-07-06T18:12:47.393480Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-06T18:12:47.393179Z","title":"Leakage temperature dependency mod- eling in system level analysis,","venue":null,"work_id":"2fae204a-c85f-439e-a0ab-f0688f8fb760","year":2010},"citing_paper":{"arxiv_id":"2606.29629","last_updated":"2026-06-30T16:14:13Z","snapshot_observed_at":"2026-08-02T18:30:05.891924Z","submitted_at":"2026-06-28T22:22:43Z","title":"Energy-Efficient Multimodal Inference Serving with Tri-serve","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-07-01T06:27:38.667047Z"},"links":{"citing_paper":"/paper/2606.29629"},"observation_digest":"sha256:3fea51d0597abc5b9aa4abfa3380dd5953feeae36c255b98363f11c2c8eefcf5","observation_id":"ddd73b4d-9be0-4624-a79d-295116d08990","resolution":{"observed_at":"2026-07-06T18:12:47.394576Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2604.15804","last_updated":"2026-04-21T03:35:14Z","snapshot_observed_at":"2026-08-01T22:56:50.755050Z","submitted_at":"2026-04-17T08:05:46Z","title":"Qwen3.5-Omni Technical Report","version":2},"cited_work":{"arxiv_id":"2604.15804","doi":"10.48550/arxiv.2604.15804","metadata_source":"pith","pith_arxiv_id":"2604.15804","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"Qwen3.5-Omni Technical Report","venue":"cs.CL","work_id":"9d0aeac4-3b94-4a09-af62-5e32286fdf5f","year":2026},"citing_paper":{"arxiv_id":"2606.29629","last_updated":"2026-06-30T16:14:13Z","snapshot_observed_at":"2026-08-02T18:30:05.891924Z","submitted_at":"2026-06-28T22:22:43Z","title":"Energy-Efficient Multimodal Inference Serving with Tri-serve","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-07-01T06:27:38.667047Z"},"links":{"cited_paper":"/paper/2604.15804","citing_paper":"/paper/2606.29629"},"observation_digest":"sha256:57b4a60243a6756428586dd3df8da6d9059e1ecdea87716ec9352f9813d4a2c6","observation_id":"942cc37e-82bd-438c-9346-c776b4bd9cff","resolution":{"observed_at":"2026-07-01T09:35:40.145125Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.03641","last_updated":"2025-04-07T16:12:54Z","snapshot_observed_at":"2026-07-06T21:04:28.540046Z","submitted_at":"2025-04-04T17:59:55Z","title":"MME-Unify: A Comprehensive Benchmark for Unified Multimodal Understanding and Generation Models","version":2},"cited_work":{"arxiv_id":"2504.03641","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2504.03641","snapshot_observed_at":"2026-07-01T09:35:40.137591Z","title":"Mme-unify: A comprehensive benchmark for unified multimodal understanding and generation models","venue":null,"work_id":"6d873fc3-a930-439f-9997-c2d3984817e5","year":2025},"citing_paper":{"arxiv_id":"2606.29629","last_updated":"2026-06-30T16:14:13Z","snapshot_observed_at":"2026-08-02T18:30:05.891924Z","submitted_at":"2026-06-28T22:22:43Z","title":"Energy-Efficient Multimodal Inference Serving with Tri-serve","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-07-01T06:27:38.667047Z"},"links":{"cited_paper":"/paper/2504.03641","citing_paper":"/paper/2606.29629"},"observation_digest":"sha256:9f4e2cb3a460dfad5fc93a67734be836dc881646bdc3ecb183f048bcad3f73cb","observation_id":"72605d58-30e0-4176-971a-32a348509dde","resolution":{"observed_at":"2026-07-01T09:35:40.139825Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-06T18:12:47.395355Z","title":"Efficient memory management for large language model serving with pagedattention,","venue":null,"work_id":"adf29a39-561e-4bc5-b626-442122ba1b79","year":2023},"citing_paper":{"arxiv_id":"2606.29629","last_updated":"2026-06-30T16:14:13Z","snapshot_observed_at":"2026-08-02T18:30:05.891924Z","submitted_at":"2026-06-28T22:22:43Z","title":"Energy-Efficient Multimodal Inference Serving with Tri-serve","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-07-01T06:27:38.667047Z"},"links":{"citing_paper":"/paper/2606.29629"},"observation_digest":"sha256:800fb6832552c8874ff2e24c77fabc093c510bd1efe0993ac1c587e02a85181f","observation_id":"823a54b9-05d4-4431-b8b3-71d218f2c44a","resolution":{"observed_at":"2026-07-06T18:12:47.396965Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2604.04745","last_updated":"2026-04-06T15:10:43Z","snapshot_observed_at":"2026-07-06T22:53:37.357996Z","submitted_at":"2026-04-06T15:10:43Z","title":"The Energy Cost of Execution-Idle in GPU Clusters","version":1},"cited_work":{"arxiv_id":"2604.04745","doi":null,"metadata_source":"pith","pith_arxiv_id":"2604.04745","snapshot_observed_at":"2026-07-03T05:47:40.830297Z","title":"The Energy Cost of Execution-Idle in GPU Clusters","venue":"cs.DC","work_id":"1fb3cd08-25df-4429-ba7b-7ec5e5182f84","year":2026},"citing_paper":{"arxiv_id":"2606.29629","last_updated":"2026-06-30T16:14:13Z","snapshot_observed_at":"2026-08-02T18:30:05.891924Z","submitted_at":"2026-06-28T22:22:43Z","title":"Energy-Efficient Multimodal Inference Serving with Tri-serve","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-07-01T06:27:38.667047Z"},"links":{"cited_paper":"/paper/2604.04745","citing_paper":"/paper/2606.29629"},"observation_digest":"sha256:3d464f7e41493c1c369a46c7928b4093a36523953d8405bc54dd56da244bc716","observation_id":"c131f6e1-6442-453a-abf6-b26ab7b42d6a","resolution":{"observed_at":"2026-07-01T09:35:40.146701Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-06T18:12:47.399370Z","title":"Pccl: Energy-efficient llm training with power-aware collective communication,","venue":null,"work_id":"97a51931-f8fc-4635-9d10-c1e0b0893b82","year":2024},"citing_paper":{"arxiv_id":"2606.29629","last_updated":"2026-06-30T16:14:13Z","snapshot_observed_at":"2026-08-02T18:30:05.891924Z","submitted_at":"2026-06-28T22:22:43Z","title":"Energy-Efficient Multimodal Inference Serving with Tri-serve","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-07-01T06:27:38.667047Z"},"links":{"citing_paper":"/paper/2606.29629"},"observation_digest":"sha256:d3b47c4ccd81820ed55f7272f06add28d79b9f770e0a8c8f4859e7483c215740","observation_id":"c1187d13-b936-479d-9578-f5c89bb263b7","resolution":{"observed_at":"2026-07-06T18:12:47.401531Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-06T18:12:47.425748Z","title":"Towards improved power management in cloud gpus,","venue":null,"work_id":"d21ad6b1-0201-4279-8e1a-ce23f9c4f8c3","year":2023},"citing_paper":{"arxiv_id":"2606.29629","last_updated":"2026-06-30T16:14:13Z","snapshot_observed_at":"2026-08-02T18:30:05.891924Z","submitted_at":"2026-06-28T22:22:43Z","title":"Energy-Efficient Multimodal Inference Serving with Tri-serve","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-07-01T06:27:38.667047Z"},"links":{"citing_paper":"/paper/2606.29629"},"observation_digest":"sha256:fb3ea7124f45f5ca32bd69c325f16b3ebaac91ce6b54a5aeb124677776037f62","observation_id":"f3c85e6a-ef0c-4d3c-8673-8a1e0fdb41e0","resolution":{"observed_at":"2026-07-06T18:12:47.427369Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-06T18:12:47.408701Z","title":"Roofline: an insightful visual performance model for multicore architectures,","venue":null,"work_id":"db0e746f-ccbd-4403-bcce-9cc8ef2bbb90","year":2009},"citing_paper":{"arxiv_id":"2606.29629","last_updated":"2026-06-30T16:14:13Z","snapshot_observed_at":"2026-08-02T18:30:05.891924Z","submitted_at":"2026-06-28T22:22:43Z","title":"Energy-Efficient Multimodal Inference Serving with Tri-serve","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-07-01T06:27:38.667047Z"},"links":{"citing_paper":"/paper/2606.29629"},"observation_digest":"sha256:8dfb13fa90294e6dcbf2405154e4aecaa88020bf6e88c00126edbb99e53ac0f0","observation_id":"bef77a55-4e9f-46aa-90ad-f0e3d525e7da","resolution":{"observed_at":"2026-07-06T18:12:47.411093Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-06T18:12:47.389998Z","title":"Nvidia nsight compute: Gpu profiler,","venue":null,"work_id":"35db5f1e-aa08-4bfd-a52e-523470cbdfe6","year":2024},"citing_paper":{"arxiv_id":"2606.29629","last_updated":"2026-06-30T16:14:13Z","snapshot_observed_at":"2026-08-02T18:30:05.891924Z","submitted_at":"2026-06-28T22:22:43Z","title":"Energy-Efficient Multimodal Inference Serving with Tri-serve","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-07-01T06:27:38.667047Z"},"links":{"citing_paper":"/paper/2606.29629"},"observation_digest":"sha256:63c1050d8a3a505ccc1fb262882752614d65772e4e4d9600b085ce62b8d0a4a0","observation_id":"4bbafe44-fd88-45c0-ab82-51c69ead4719","resolution":{"observed_at":"2026-07-06T18:12:47.391400Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.02430","last_updated":"2024-06-04T15:48:29Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-06-04T15:48:29Z","title":"Seed-TTS: A Family of High-Quality Versatile Speech Generation Models","version":1},"cited_work":{"arxiv_id":"2406.02430","doi":"10.48550/arxiv.2406.02430","metadata_source":"pith","pith_arxiv_id":"2406.02430","snapshot_observed_at":"2026-07-10T10:37:01.591529Z","title":"Seed-TTS: A Family of High-Quality Versatile Speech Generation Models","venue":"eess.AS","work_id":"6e88ee95-1133-4302-a142-cdf8f9456a8d","year":2024},"citing_paper":{"arxiv_id":"2606.29629","last_updated":"2026-06-30T16:14:13Z","snapshot_observed_at":"2026-08-02T18:30:05.891924Z","submitted_at":"2026-06-28T22:22:43Z","title":"Energy-Efficient Multimodal Inference Serving with Tri-serve","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-07-01T06:27:38.667047Z"},"links":{"cited_paper":"/paper/2406.02430","citing_paper":"/paper/2606.29629"},"observation_digest":"sha256:66ca669edbfc287fc158481f3c7bffcaa7da3d5438e1fb2cd700d4b2696251f4","observation_id":"b0f7c85a-8e85-4a76-a55f-9b5360a27182","resolution":{"observed_at":"2026-07-01T09:35:40.128634Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-06T18:12:47.382123Z","title":"Orca: A distributed serving system for Transformer-Based generative models,","venue":null,"work_id":"7fc2cbaa-396b-41be-af0d-9e7173496745","year":2022},"citing_paper":{"arxiv_id":"2606.29629","last_updated":"2026-06-30T16:14:13Z","snapshot_observed_at":"2026-08-02T18:30:05.891924Z","submitted_at":"2026-06-28T22:22:43Z","title":"Energy-Efficient Multimodal Inference Serving with Tri-serve","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-07-01T06:27:38.667047Z"},"links":{"citing_paper":"/paper/2606.29629"},"observation_digest":"sha256:a484947478d28a918041e8c08ffa9fb4bbd4c1bc11ab7b30fdf12d1076fff3e9","observation_id":"e7d62c1b-dc25-44b6-8159-ec8743c30e92","resolution":{"observed_at":"2026-07-06T18:12:47.383383Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-06T18:12:47.384178Z","title":"Taming Throughput-Latency tradeoff in LLM inference with Sarathi-Serve,","venue":null,"work_id":"170a8b42-b7af-4dfa-82e7-b86ad5a84c73","year":2024},"citing_paper":{"arxiv_id":"2606.29629","last_updated":"2026-06-30T16:14:13Z","snapshot_observed_at":"2026-08-02T18:30:05.891924Z","submitted_at":"2026-06-28T22:22:43Z","title":"Energy-Efficient Multimodal Inference Serving with Tri-serve","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-07-01T06:27:38.667047Z"},"links":{"citing_paper":"/paper/2606.29629"},"observation_digest":"sha256:ef7355d1713a2775387483e3c6815d1ac469d132c7593d30ddecc3ebd885c581","observation_id":"0d5c8e11-07a3-4d0f-a58b-a29159ba9b4f","resolution":{"observed_at":"2026-07-06T18:12:47.385634Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-06T18:12:47.421849Z","title":"AlpaServe: Statistical multiplexing with model parallelism for deep learning serving,","venue":null,"work_id":"49a969e6-de8c-4b46-99be-2e04f448688c","year":2023},"citing_paper":{"arxiv_id":"2606.29629","last_updated":"2026-06-30T16:14:13Z","snapshot_observed_at":"2026-08-02T18:30:05.891924Z","submitted_at":"2026-06-28T22:22:43Z","title":"Energy-Efficient Multimodal Inference Serving with Tri-serve","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-07-01T06:27:38.667047Z"},"links":{"citing_paper":"/paper/2606.29629"},"observation_digest":"sha256:c083b070070c3939f6dd2207e5eb23d5146b308f1db33ebce62b2adab04ca337","observation_id":"7ac8c1a4-c5a7-422f-bd9d-3398fb178e3a","resolution":{"observed_at":"2026-07-06T18:12:47.423405Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-06T18:12:47.380206Z","title":"DistServe: Disaggre- gating prefill and decoding for goodput-optimized large language model serving,","venue":null,"work_id":"fc03691b-ba80-4a66-96a8-c81c9e719adb","year":2024},"citing_paper":{"arxiv_id":"2606.29629","last_updated":"2026-06-30T16:14:13Z","snapshot_observed_at":"2026-08-02T18:30:05.891924Z","submitted_at":"2026-06-28T22:22:43Z","title":"Energy-Efficient Multimodal Inference Serving with Tri-serve","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-07-01T06:27:38.667047Z"},"links":{"citing_paper":"/paper/2606.29629"},"observation_digest":"sha256:66fcd2d5488c677ce0d47a4b95a2f62dd9a9b4258127cb92f3454f80e3127439","observation_id":"a64ee6e5-fe42-4c60-8525-814e1efa8043","resolution":{"observed_at":"2026-07-06T18:12:47.381563Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-06T18:12:47.386308Z","title":"Powerinfer: Fast large language model serving with a consumer-grade gpu,","venue":null,"work_id":"00661b2b-f018-4964-a399-89954e30c375","year":2024},"citing_paper":{"arxiv_id":"2606.29629","last_updated":"2026-06-30T16:14:13Z","snapshot_observed_at":"2026-08-02T18:30:05.891924Z","submitted_at":"2026-06-28T22:22:43Z","title":"Energy-Efficient Multimodal Inference Serving with Tri-serve","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-07-01T06:27:38.667047Z"},"links":{"citing_paper":"/paper/2606.29629"},"observation_digest":"sha256:f677a51d7cb89e39e05fe38a0c09feb3fad9916d3a5e23ab55613a87939557b4","observation_id":"282c43f5-3846-4846-8bdd-722fbc28c939","resolution":{"observed_at":"2026-07-06T18:12:47.387687Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-06T18:12:47.388234Z","title":"Towards sustainable ai: a comprehensive framework for green ai,","venue":null,"work_id":"e2e26bd5-5838-4ff5-bd2a-a9a4fb1c98e5","year":2024},"citing_paper":{"arxiv_id":"2606.29629","last_updated":"2026-06-30T16:14:13Z","snapshot_observed_at":"2026-08-02T18:30:05.891924Z","submitted_at":"2026-06-28T22:22:43Z","title":"Energy-Efficient Multimodal Inference Serving with Tri-serve","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-07-01T06:27:38.667047Z"},"links":{"citing_paper":"/paper/2606.29629"},"observation_digest":"sha256:0cf8af2f6af11e0ae792bf858605aba34750b86925453ddd0aebc1d4e6886356","observation_id":"5d03c734-4df6-40ee-9c48-fac1379964d8","resolution":{"observed_at":"2026-07-06T18:12:47.389413Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-06T18:12:47.378066Z","title":"Hotspot: a compact thermal modeling methodology for early- stage vlsi design,","venue":null,"work_id":"c3fbb7fb-a3ae-4ac8-839f-e4266e1c4d74","year":2006},"citing_paper":{"arxiv_id":"2606.29629","last_updated":"2026-06-30T16:14:13Z","snapshot_observed_at":"2026-08-02T18:30:05.891924Z","submitted_at":"2026-06-28T22:22:43Z","title":"Energy-Efficient Multimodal Inference Serving with Tri-serve","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-07-01T06:27:38.667047Z"},"links":{"citing_paper":"/paper/2606.29629"},"observation_digest":"sha256:963d3ae22f1609e1e5eefe2e960f78b260cef4bfac798ce9deb733bfd701e212","observation_id":"3e208255-8281-455d-8778-b9bb3afd5a23","resolution":{"observed_at":"2026-07-06T18:12:47.379533Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-06T18:12:47.376159Z","title":"Roofline-aware dvfs for gpus,","venue":null,"work_id":"80803c65-5313-49c1-803b-e53fe1abdc8b","year":2014},"citing_paper":{"arxiv_id":"2606.29629","last_updated":"2026-06-30T16:14:13Z","snapshot_observed_at":"2026-08-02T18:30:05.891924Z","submitted_at":"2026-06-28T22:22:43Z","title":"Energy-Efficient Multimodal Inference Serving with Tri-serve","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-07-01T06:27:38.667047Z"},"links":{"citing_paper":"/paper/2606.29629"},"observation_digest":"sha256:0391856e4bd4ebf2ca9729df47d4aca4f1d216883c260230d7e27a54c9f9d5a4","observation_id":"61826b4f-3050-433b-bd5f-3ffa1ad5ee90","resolution":{"observed_at":"2026-07-06T18:12:47.377432Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2606.29629","last_updated":"2026-06-30T16:14:13Z","latest_version":2,"primary_category":"cs.DC","snapshot_observed_at":"2026-08-02T18:30:05.891924Z","submitted_at":"2026-06-28T22:22:43Z","title":"Energy-Efficient Multimodal Inference Serving with Tri-serve"},"reference_resolution":{"displayed":34,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":8,"verified_fuzzy":26},"total_outbound_references":34},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"thesis":"As of 4 August 2026, this Paper Citation Record lists 34 of 34 outbound references and 0 inbound Pith citation observations for arXiv:2606.29629."}