{"as_of":"2026-08-08T05:57:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:71cf0d8be4c4106ff99ca67f71b8165a49bb696bbfdd3b6907df9a2e7d69ca30","coverage":[{"denominator":39,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":39,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T06:00:33.427109Z","state":"measured"},{"denominator":39,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":39,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2506.06472/citation-record","integrity":"/paper/2506.06472/integrity","json":"/paper/2506.06472/citation-record.json","paper":"/paper/2506.06472"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:00:38.152137Z","title":"In19th USENIX Conference on File and Storage Technologies (FAST 21), pages 387–401, 2021","venue":null,"work_id":"dfcce3fe-3bf1-4401-a893-9761b31ad704","year":2021},"citing_paper":{"arxiv_id":"2506.06472","last_updated":"2025-06-06T18:57:20Z","snapshot_observed_at":"2026-08-07T05:53:41.891682Z","submitted_at":"2025-06-06T18:57:20Z","title":"Cost-Efficient LLM Training with Lifetime-Aware Tensor Offloading via GPUDirect Storage","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T06:00:32.204819Z"},"links":{"citing_paper":"/paper/2506.06472"},"observation_digest":"sha256:e982f141f82406cea306ed85f705efba457745d3009e12518d348a2542da5f7b","observation_id":"f2e46f6e-6bdf-45b9-938b-f02312d76d6c","resolution":{"observed_at":"2026-08-07T06:00:38.224953Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:00:37.984425Z","title":"Efficient combination of rematerialization and offloading for training dnns.Advances in Neural Information Processing Systems, 34:23844–23857, 2021","venue":null,"work_id":"cf291712-1fc4-4634-b620-beea58d6e800","year":2021},"citing_paper":{"arxiv_id":"2506.06472","last_updated":"2025-06-06T18:57:20Z","snapshot_observed_at":"2026-08-07T05:53:41.891682Z","submitted_at":"2025-06-06T18:57:20Z","title":"Cost-Efficient LLM Training with Lifetime-Aware Tensor Offloading via GPUDirect Storage","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T06:00:32.210913Z"},"links":{"citing_paper":"/paper/2506.06472"},"observation_digest":"sha256:ad226121971b38be16bc560029b068b33204fd3b4d684153aa909ff5b242a23c","observation_id":"8b9ac2a1-8192-4455-a34a-31ae374be6b4","resolution":{"observed_at":"2026-08-07T06:00:38.076966Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1810.04805","last_updated":"2019-05-24T20:37:26Z","snapshot_observed_at":"2026-07-30T09:12:38.100527Z","submitted_at":"2018-10-11T00:50:01Z","title":"BERT: Pre-training of Deep Bidirectional Transformers for Language Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1810.04805","snapshot_observed_at":"2026-08-07T06:00:32.219076Z","title":"Bert: Pre-trainingofdeep bidirectional transformers for language understanding.arXiv preprint arXiv:1810.04805, 2018","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.06472","last_updated":"2025-06-06T18:57:20Z","snapshot_observed_at":"2026-08-07T05:53:41.891682Z","submitted_at":"2025-06-06T18:57:20Z","title":"Cost-Efficient LLM Training with Lifetime-Aware Tensor Offloading via GPUDirect Storage","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T06:00:32.219076Z"},"links":{"cited_paper":"/paper/1810.04805","citing_paper":"/paper/2506.06472"},"observation_digest":"sha256:de5ea0da887f1b4bd25af359f70b8343f534021dab850ef71a0976664d904830","observation_id":"75a2931f-a17e-40b1-a1bb-47b4253cdbf5","resolution":{"observed_at":"2026-08-07T06:00:32.219076Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-07T06:00:32.223943Z","title":"The llama 3 herd of models.arXiv preprint arXiv:2407.21783, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.06472","last_updated":"2025-06-06T18:57:20Z","snapshot_observed_at":"2026-08-07T05:53:41.891682Z","submitted_at":"2025-06-06T18:57:20Z","title":"Cost-Efficient LLM Training with Lifetime-Aware Tensor Offloading via GPUDirect Storage","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T06:00:32.223943Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2506.06472"},"observation_digest":"sha256:01292c4a9811811f10f8ceade8bbc4bc112cd87c420a0f5b7644cc50205b8988","observation_id":"4010036c-c454-4239-ae2b-b2339ce45d89","resolution":{"observed_at":"2026-08-07T06:00:32.223943Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:00:37.766245Z","title":"Exxact.https://www.exxactcorp.com/, 2025","venue":null,"work_id":"0d3cc1ee-c962-4e0a-a97b-d0fa0098236b","year":2025},"citing_paper":{"arxiv_id":"2506.06472","last_updated":"2025-06-06T18:57:20Z","snapshot_observed_at":"2026-08-07T05:53:41.891682Z","submitted_at":"2025-06-06T18:57:20Z","title":"Cost-Efficient LLM Training with Lifetime-Aware Tensor Offloading via GPUDirect Storage","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T06:00:32.229730Z"},"links":{"citing_paper":"/paper/2506.06472"},"observation_digest":"sha256:5f7161d91ebf56cabca11aefdcd5ae3a076f1dc1e436904345e84853a4388daf","observation_id":"157e3f5e-29db-458b-8529-bd6344290d2c","resolution":{"observed_at":"2026-08-07T06:00:37.885091Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:00:37.585510Z","title":"T5 11b.https://huggingface.co/google-t5/t5-11b, 2025","venue":null,"work_id":"fde442bd-6394-4beb-b6c3-79a4f836251e","year":2025},"citing_paper":{"arxiv_id":"2506.06472","last_updated":"2025-06-06T18:57:20Z","snapshot_observed_at":"2026-08-07T05:53:41.891682Z","submitted_at":"2025-06-06T18:57:20Z","title":"Cost-Efficient LLM Training with Lifetime-Aware Tensor Offloading via GPUDirect Storage","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T06:00:32.234022Z"},"links":{"citing_paper":"/paper/2506.06472"},"observation_digest":"sha256:dce513db8cee305c26e438cb1c0713c4a101e870b38da77c958bef3181d21bbe","observation_id":"79269ad2-b570-4a8c-a116-40c88095f66c","resolution":{"observed_at":"2026-08-07T06:00:37.668737Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:00:37.409523Z","title":"nvidia.com/blog/gpudirect-storage/","venue":null,"work_id":"d3a925ce-b512-4146-b5ab-c18e2912e308","year":null},"citing_paper":{"arxiv_id":"2506.06472","last_updated":"2025-06-06T18:57:20Z","snapshot_observed_at":"2026-08-07T05:53:41.891682Z","submitted_at":"2025-06-06T18:57:20Z","title":"Cost-Efficient LLM Training with Lifetime-Aware Tensor Offloading via GPUDirect Storage","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T06:00:32.244791Z"},"links":{"citing_paper":"/paper/2506.06472"},"observation_digest":"sha256:5af89811eaee525bbc3b693b85133d72ff4dfbd2577c50ef4157513907b88ac1","observation_id":"0220b629-eb06-4ca6-af42-eb96375c0285","resolution":{"observed_at":"2026-08-07T06:00:37.498608Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:00:37.270089Z","title":"Swapadvisor: Pushingdeeplearningbeyondthegpu memory limit via smart swapping","venue":null,"work_id":"d1b6f04c-1aeb-4311-8504-a7236600e805","year":2020},"citing_paper":{"arxiv_id":"2506.06472","last_updated":"2025-06-06T18:57:20Z","snapshot_observed_at":"2026-08-07T05:53:41.891682Z","submitted_at":"2025-06-06T18:57:20Z","title":"Cost-Efficient LLM Training with Lifetime-Aware Tensor Offloading via GPUDirect Storage","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T06:00:32.249225Z"},"links":{"citing_paper":"/paper/2506.06472"},"observation_digest":"sha256:60f7957ce6aba6896004757f9fbeefb28f013e4d5f989193a7a74dbd41bc7691","observation_id":"fa229a1c-7736-48aa-901c-63497343213c","resolution":{"observed_at":"2026-08-07T06:00:37.315978Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:00:32.255025Z","title":"Gpipe: Efficient training of giant neural networks using pipeline parallelism.Advances in neural information processing systems, 32, 2019","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.06472","last_updated":"2025-06-06T18:57:20Z","snapshot_observed_at":"2026-08-07T05:53:41.891682Z","submitted_at":"2025-06-06T18:57:20Z","title":"Cost-Efficient LLM Training with Lifetime-Aware Tensor Offloading via GPUDirect Storage","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T06:00:32.255025Z"},"links":{"citing_paper":"/paper/2506.06472"},"observation_digest":"sha256:58a4f0dfc426934ca2f5767cd71d5fe90263347fcf5626c347dc2347caba21fa","observation_id":"565f4070-ef28-41fb-a56a-b5144f07d578","resolution":{"observed_at":"2026-08-07T06:00:32.255025Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:00:37.041117Z","title":"Ibm granite.https://huggingface.co/ibm-granite, 2025","venue":null,"work_id":"782ca5a3-29a1-42ac-adef-4272183802d6","year":2025},"citing_paper":{"arxiv_id":"2506.06472","last_updated":"2025-06-06T18:57:20Z","snapshot_observed_at":"2026-08-07T05:53:41.891682Z","submitted_at":"2025-06-06T18:57:20Z","title":"Cost-Efficient LLM Training with Lifetime-Aware Tensor Offloading via GPUDirect Storage","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T06:00:32.262423Z"},"links":{"citing_paper":"/paper/2506.06472"},"observation_digest":"sha256:5360122e7d52bd27a53608cef2a4232915b9206454720ae56c8ecea5f5116dfb","observation_id":"90eeb0ea-75ae-43c7-9042-18b66e18393f","resolution":{"observed_at":"2026-08-07T06:00:37.132856Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:00:36.870654Z","title":"Checkmate: Breaking the memory wall with optimal tensor rematerialization.Proceedings of Machine Learning and Systems, 2:497–511, 2020","venue":null,"work_id":"ebf2f796-f3a7-411d-9f17-cbf2b2c850be","year":2020},"citing_paper":{"arxiv_id":"2506.06472","last_updated":"2025-06-06T18:57:20Z","snapshot_observed_at":"2026-08-07T05:53:41.891682Z","submitted_at":"2025-06-06T18:57:20Z","title":"Cost-Efficient LLM Training with Lifetime-Aware Tensor Offloading via GPUDirect Storage","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T06:00:32.271033Z"},"links":{"citing_paper":"/paper/2506.06472"},"observation_digest":"sha256:6c60b547da68e5c080974a7bdfa100abc3816c857ca752f44f75827edd62fa38","observation_id":"05d469d2-ce6e-4e5c-8cd2-08bfb9f65c09","resolution":{"observed_at":"2026-08-07T06:00:36.954625Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:00:36.668079Z","title":"Smart-infinity: Fastlargelanguagemodeltrainingusingnear-storageprocessingonarealsystem","venue":null,"work_id":"457ff048-888d-46a7-a795-572e9a83ef14","year":2024},"citing_paper":{"arxiv_id":"2506.06472","last_updated":"2025-06-06T18:57:20Z","snapshot_observed_at":"2026-08-07T05:53:41.891682Z","submitted_at":"2025-06-06T18:57:20Z","title":"Cost-Efficient LLM Training with Lifetime-Aware Tensor Offloading via GPUDirect Storage","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T06:00:32.281042Z"},"links":{"citing_paper":"/paper/2506.06472"},"observation_digest":"sha256:9236262b2a3616d814cf0fb3bc82e400bfd5abf3f6bd23fdc7821e97e9b74e0a","observation_id":"66b4a927-a40b-4dd6-84cc-2fc2347ddce8","resolution":{"observed_at":"2026-08-07T06:00:36.734315Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:00:36.414542Z","title":"Deepum: Tensormigrationandprefetchinginunified memory","venue":null,"work_id":"8f09c93d-deba-4d75-b6c3-7a0bc568ef01","year":2023},"citing_paper":{"arxiv_id":"2506.06472","last_updated":"2025-06-06T18:57:20Z","snapshot_observed_at":"2026-08-07T05:53:41.891682Z","submitted_at":"2025-06-06T18:57:20Z","title":"Cost-Efficient LLM Training with Lifetime-Aware Tensor Offloading via GPUDirect Storage","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T06:00:32.291031Z"},"links":{"citing_paper":"/paper/2506.06472"},"observation_digest":"sha256:74c8e8c3b162deeeded6b50ab47504c82d68be63117bfcc8fe85e21c457dc7e4","observation_id":"62e93b52-97ee-480b-9a82-f474a889d2ba","resolution":{"observed_at":"2026-08-07T06:00:36.517578Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2001.08361","last_updated":"2020-01-23T03:59:20Z","snapshot_observed_at":"2026-07-06T08:52:12.656082Z","submitted_at":"2020-01-23T03:59:20Z","title":"Scaling Laws for Neural Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2001.08361","snapshot_observed_at":"2026-08-07T06:00:32.301738Z","title":"Scaling laws for neural language models.arXiv preprint arXiv:2001.08361, 2020","venue":null,"work_id":null,"year":2001},"citing_paper":{"arxiv_id":"2506.06472","last_updated":"2025-06-06T18:57:20Z","snapshot_observed_at":"2026-08-07T05:53:41.891682Z","submitted_at":"2025-06-06T18:57:20Z","title":"Cost-Efficient LLM Training with Lifetime-Aware Tensor Offloading via GPUDirect Storage","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T06:00:32.301738Z"},"links":{"cited_paper":"/paper/2001.08361","citing_paper":"/paper/2506.06472"},"observation_digest":"sha256:4802068eaf2b6b1b97c7d098001b6a6fb025c052b2f853d0773d191bdec871d4","observation_id":"9e4d01fd-f963-4c16-aac4-afdd38782399","resolution":{"observed_at":"2026-08-07T06:00:32.301738Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:00:36.211243Z","title":"Beyond the memory wall: A case for memory-centric hpc system for deep learning","venue":null,"work_id":"39bb41ed-d3af-40d6-9410-8fd9d29f57c8","year":2018},"citing_paper":{"arxiv_id":"2506.06472","last_updated":"2025-06-06T18:57:20Z","snapshot_observed_at":"2026-08-07T05:53:41.891682Z","submitted_at":"2025-06-06T18:57:20Z","title":"Cost-Efficient LLM Training with Lifetime-Aware Tensor Offloading via GPUDirect Storage","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T06:00:32.312924Z"},"links":{"citing_paper":"/paper/2506.06472"},"observation_digest":"sha256:76b622f85b0dc6f77f76d9a606cff5c5215c28fb1a489b9ae18196d2e1413f5f","observation_id":"1ee83164-88a9-44c8-8c30-d5f8387bc992","resolution":{"observed_at":"2026-08-07T06:00:36.317589Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1807.02037","last_updated":"2019-10-02T06:54:46Z","snapshot_observed_at":"2026-08-05T09:05:28.183733Z","submitted_at":"2018-07-05T14:56:39Z","title":"TFLMS: Large Model Support in TensorFlow by Graph Rewriting","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1807.02037","snapshot_observed_at":"2026-08-07T06:00:32.323175Z","title":"Tflms: Large model support in tensorflow by graph rewriting.arXiv preprint arXiv:1807.02037, 2018","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.06472","last_updated":"2025-06-06T18:57:20Z","snapshot_observed_at":"2026-08-07T05:53:41.891682Z","submitted_at":"2025-06-06T18:57:20Z","title":"Cost-Efficient LLM Training with Lifetime-Aware Tensor Offloading via GPUDirect Storage","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T06:00:32.323175Z"},"links":{"cited_paper":"/paper/1807.02037","citing_paper":"/paper/2506.06472"},"observation_digest":"sha256:797e3d6957a90fbf8fb9f7279890f7ab60ec90987828c1b475d8eaa46163ff64","observation_id":"25d743ac-8fb4-4732-845d-9763d4d96a9a","resolution":{"observed_at":"2026-08-07T06:00:32.323175Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.06511","last_updated":"2025-06-07T19:16:22Z","snapshot_observed_at":"2026-08-07T00:12:09.462694Z","submitted_at":"2024-10-09T03:26:11Z","title":"TorchTitan: One-stop PyTorch native solution for production ready LLM pre-training","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.06511","snapshot_observed_at":"2026-08-07T06:00:32.332267Z","title":"Torchtitan: One-stop pytorch native solution for production ready llm pre-training.arXiv preprint arXiv:2410.06511, 2024","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.06472","last_updated":"2025-06-06T18:57:20Z","snapshot_observed_at":"2026-08-07T05:53:41.891682Z","submitted_at":"2025-06-06T18:57:20Z","title":"Cost-Efficient LLM Training with Lifetime-Aware Tensor Offloading via GPUDirect Storage","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T06:00:32.332267Z"},"links":{"cited_paper":"/paper/2410.06511","citing_paper":"/paper/2506.06472"},"observation_digest":"sha256:63b0458a3ed88111744bd2998c30df5dd40f0d86b26ec82ca898f0c804e30378","observation_id":"6c2374d8-4fe3-4c22-b633-27febef3d874","resolution":{"observed_at":"2026-08-07T06:00:32.332267Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.06504","last_updated":"2024-12-24T13:41:08Z","snapshot_observed_at":"2026-07-06T17:42:29.208344Z","submitted_at":"2024-03-11T08:25:53Z","title":"LoHan: Low-Cost High-Performance Framework to Fine-Tune 100B Model on a Consumer GPU","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.06504","snapshot_observed_at":"2026-08-07T06:00:32.342788Z","title":"Adding nvme ssds to enable and accelerate 100b model fine-tuning on a single gpu.arXiv preprint arXiv:2403.06504, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.06472","last_updated":"2025-06-06T18:57:20Z","snapshot_observed_at":"2026-08-07T05:53:41.891682Z","submitted_at":"2025-06-06T18:57:20Z","title":"Cost-Efficient LLM Training with Lifetime-Aware Tensor Offloading via GPUDirect Storage","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T06:00:32.342788Z"},"links":{"cited_paper":"/paper/2403.06504","citing_paper":"/paper/2506.06472"},"observation_digest":"sha256:095eb050d0e224793c2125291aa37e00b9fbe2f81ae5305d1e21391b8bf5045e","observation_id":"9347a12c-dc38-4126-87ec-492546f5dec0","resolution":{"observed_at":"2026-08-07T06:00:32.342788Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1812.06162","last_updated":"2018-12-14T20:49:09Z","snapshot_observed_at":"2026-07-06T07:21:19.842962Z","submitted_at":"2018-12-14T20:49:09Z","title":"An Empirical Model of Large-Batch Training","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1812.06162","snapshot_observed_at":"2026-08-07T06:00:32.354308Z","title":"An empirical model of large-batch training.arXiv preprint arXiv:1812.06162, 2018","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.06472","last_updated":"2025-06-06T18:57:20Z","snapshot_observed_at":"2026-08-07T05:53:41.891682Z","submitted_at":"2025-06-06T18:57:20Z","title":"Cost-Efficient LLM Training with Lifetime-Aware Tensor Offloading via GPUDirect Storage","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T06:00:32.354308Z"},"links":{"cited_paper":"/paper/1812.06162","citing_paper":"/paper/2506.06472"},"observation_digest":"sha256:f6da1bed43d541245f9de1ae3ddcc462d37457b9e7736ce93086e02353574fa4","observation_id":"93c3f85c-3e80-4487-aace-506d2cf81670","resolution":{"observed_at":"2026-08-07T06:00:32.354308Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1710.03740","last_updated":"2018-02-15T20:04:02Z","snapshot_observed_at":"2026-07-06T06:03:37.247241Z","submitted_at":"2017-10-10T17:42:04Z","title":"Mixed Precision Training","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1710.03740","snapshot_observed_at":"2026-08-07T06:00:32.365297Z","title":"Mixed precision training.arXiv preprint arXiv:1710.03740, 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.06472","last_updated":"2025-06-06T18:57:20Z","snapshot_observed_at":"2026-08-07T05:53:41.891682Z","submitted_at":"2025-06-06T18:57:20Z","title":"Cost-Efficient LLM Training with Lifetime-Aware Tensor Offloading via GPUDirect Storage","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T06:00:32.365297Z"},"links":{"cited_paper":"/paper/1710.03740","citing_paper":"/paper/2506.06472"},"observation_digest":"sha256:cd3bb713ece586f9f8b947a7cf205852330a807f26e6d748eb4ddea521cc7879","observation_id":"6b5ea083-c2da-4c5a-a012-ecf0710c1997","resolution":{"observed_at":"2026-08-07T06:00:32.365297Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:00:32.377846Z","title":"Pipedream: Generalized pipeline parallelism for dnn training","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.06472","last_updated":"2025-06-06T18:57:20Z","snapshot_observed_at":"2026-08-07T05:53:41.891682Z","submitted_at":"2025-06-06T18:57:20Z","title":"Cost-Efficient LLM Training with Lifetime-Aware Tensor Offloading via GPUDirect Storage","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T06:00:32.377846Z"},"links":{"citing_paper":"/paper/2506.06472"},"observation_digest":"sha256:91132078d280f385756a342440362138586f7efbddb2a2682409bed17576dd65","observation_id":"c7725067-0716-481a-ba8e-9b15d1ccdbdd","resolution":{"observed_at":"2026-08-07T06:00:32.377846Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.02868","last_updated":"2023-03-06T03:36:26Z","snapshot_observed_at":"2026-07-31T13:29:57.932652Z","submitted_at":"2023-03-06T03:36:26Z","title":"Angel-PTM: A Scalable and Economical Large-scale Pre-training System in Tencent","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.02868","snapshot_observed_at":"2026-08-07T06:00:32.388782Z","title":"Angel-ptm: A scalable and economical large-scale pre-training system in tencent.arXiv preprint arXiv:2303.02868, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.06472","last_updated":"2025-06-06T18:57:20Z","snapshot_observed_at":"2026-08-07T05:53:41.891682Z","submitted_at":"2025-06-06T18:57:20Z","title":"Cost-Efficient LLM Training with Lifetime-Aware Tensor Offloading via GPUDirect Storage","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T06:00:32.388782Z"},"links":{"cited_paper":"/paper/2303.02868","citing_paper":"/paper/2506.06472"},"observation_digest":"sha256:326b8766953b71d99b22a8694e56589f4f7ee301bee42b8fce107edf27d5cc87","observation_id":"4244f784-58d3-4f9b-b7ce-5b136bfbc231","resolution":{"observed_at":"2026-08-07T06:00:32.388782Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:00:32.401389Z","title":"Automatic differentiation in pytorch","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.06472","last_updated":"2025-06-06T18:57:20Z","snapshot_observed_at":"2026-08-07T05:53:41.891682Z","submitted_at":"2025-06-06T18:57:20Z","title":"Cost-Efficient LLM Training with Lifetime-Aware Tensor Offloading via GPUDirect Storage","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T06:00:32.401389Z"},"links":{"citing_paper":"/paper/2506.06472"},"observation_digest":"sha256:809e14fdc7ff01e036743f8566e91be48e07306051cc8505ed735a0257ed0a57","observation_id":"e21e5ca9-0316-495e-81fd-55617bd9174e","resolution":{"observed_at":"2026-08-07T06:00:32.401389Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:00:32.412497Z","title":"Scalable diffusion models with transformers","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.06472","last_updated":"2025-06-06T18:57:20Z","snapshot_observed_at":"2026-08-07T05:53:41.891682Z","submitted_at":"2025-06-06T18:57:20Z","title":"Cost-Efficient LLM Training with Lifetime-Aware Tensor Offloading via GPUDirect Storage","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T06:00:32.412497Z"},"links":{"citing_paper":"/paper/2506.06472"},"observation_digest":"sha256:209044bbca18a7a1b0d4b5e6989800d97a9895f2128a36aa780d7df97a27c713","observation_id":"0f628802-5c38-4ba1-8595-23609fd97d9c","resolution":{"observed_at":"2026-08-07T06:00:32.412497Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2002.05645","last_updated":"2020-06-05T03:00:26Z","snapshot_observed_at":"2026-07-06T08:57:05.093819Z","submitted_at":"2020-02-13T17:29:47Z","title":"Training Large Neural Networks with Constant Memory using a New Execution Algorithm","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2002.05645","snapshot_observed_at":"2026-08-07T06:00:32.422749Z","title":"Training large neural networks with constant memory using a new execution algorithm.arXiv preprint arXiv:2002.05645, 2020","venue":null,"work_id":null,"year":2002},"citing_paper":{"arxiv_id":"2506.06472","last_updated":"2025-06-06T18:57:20Z","snapshot_observed_at":"2026-08-07T05:53:41.891682Z","submitted_at":"2025-06-06T18:57:20Z","title":"Cost-Efficient LLM Training with Lifetime-Aware Tensor Offloading via GPUDirect Storage","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T06:00:32.422749Z"},"links":{"cited_paper":"/paper/2002.05645","citing_paper":"/paper/2506.06472"},"observation_digest":"sha256:cd09eea54bf1ff58292337a44a9734a22b07199b30a4669f3feb5a7f21272a01","observation_id":"14a0829f-bdb2-48d5-916a-ca38b86e1ebd","resolution":{"observed_at":"2026-08-07T06:00:32.422749Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:00:35.945519Z","title":"Gpu-initiated on-demand high-throughput storage access in the bam system architecture","venue":null,"work_id":"a92e17a3-22c9-4f14-9bf9-e9a47085a177","year":2023},"citing_paper":{"arxiv_id":"2506.06472","last_updated":"2025-06-06T18:57:20Z","snapshot_observed_at":"2026-08-07T05:53:41.891682Z","submitted_at":"2025-06-06T18:57:20Z","title":"Cost-Efficient LLM Training with Lifetime-Aware Tensor Offloading via GPUDirect Storage","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T06:00:32.431974Z"},"links":{"citing_paper":"/paper/2506.06472"},"observation_digest":"sha256:ef1bfc9e2632ccd34bcc8310255fd98ece1a382cbca467d4627d6fbd577f1228","observation_id":"5047daf3-6af8-4ed3-8baa-742822822aaf","resolution":{"observed_at":"2026-08-07T06:00:36.064077Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:00:32.441563Z","title":"Language models are unsupervised multitask learners.OpenAI blog, 1(8):9, 2019","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.06472","last_updated":"2025-06-06T18:57:20Z","snapshot_observed_at":"2026-08-07T05:53:41.891682Z","submitted_at":"2025-06-06T18:57:20Z","title":"Cost-Efficient LLM Training with Lifetime-Aware Tensor Offloading via GPUDirect Storage","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T06:00:32.441563Z"},"links":{"citing_paper":"/paper/2506.06472"},"observation_digest":"sha256:9a1e1c70759e79baa7c6943704d53b24e37dadeeefa1923f4c09d8a71a2fd694","observation_id":"635b8491-36e0-499a-ae3f-3c6646cb1c40","resolution":{"observed_at":"2026-08-07T06:00:32.441563Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:00:32.485821Z","title":"Exploring the limits of transfer learning with a unified text-to-text transformer.Journal of machine learning research, 21(140):1–67, 2020","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.06472","last_updated":"2025-06-06T18:57:20Z","snapshot_observed_at":"2026-08-07T05:53:41.891682Z","submitted_at":"2025-06-06T18:57:20Z","title":"Cost-Efficient LLM Training with Lifetime-Aware Tensor Offloading via GPUDirect Storage","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T06:00:32.485821Z"},"links":{"citing_paper":"/paper/2506.06472"},"observation_digest":"sha256:405e4b6c7f4d6dd914141c14463a0c742da8d23b656af6891865e265db6e3231","observation_id":"01ad0130-5142-4528-bb29-3d84f7a75259","resolution":{"observed_at":"2026-08-07T06:00:32.485821Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:00:35.671566Z","title":"Zero- infinity: Breaking the gpu memory wall for extreme scale deep learning","venue":null,"work_id":"59f90e35-0f95-46f3-b2f6-f0e58011c757","year":2021},"citing_paper":{"arxiv_id":"2506.06472","last_updated":"2025-06-06T18:57:20Z","snapshot_observed_at":"2026-08-07T05:53:41.891682Z","submitted_at":"2025-06-06T18:57:20Z","title":"Cost-Efficient LLM Training with Lifetime-Aware Tensor Offloading via GPUDirect Storage","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T06:00:32.546527Z"},"links":{"citing_paper":"/paper/2506.06472"},"observation_digest":"sha256:9294fc6883a8cfa203bacaf82408a2f9169ba8e7c4b57e6361ebf32f76378c3b","observation_id":"ea7d54cc-26f5-4bec-8c70-07fc2c4a603c","resolution":{"observed_at":"2026-08-07T06:00:35.776160Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:00:35.474410Z","title":"{Zero-offload}: Democratizing{billion-scale}model training","venue":null,"work_id":"9e1ddcb8-376e-48e6-85f2-81bae9c9e610","year":2021},"citing_paper":{"arxiv_id":"2506.06472","last_updated":"2025-06-06T18:57:20Z","snapshot_observed_at":"2026-08-07T05:53:41.891682Z","submitted_at":"2025-06-06T18:57:20Z","title":"Cost-Efficient LLM Training with Lifetime-Aware Tensor Offloading via GPUDirect Storage","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T06:00:32.628054Z"},"links":{"citing_paper":"/paper/2506.06472"},"observation_digest":"sha256:c86c8eb787582d662e4839eebe7e7fee35797b0656a60114d1559e43167876c8","observation_id":"60312ea8-13a6-49bd-acc7-eda91f132159","resolution":{"observed_at":"2026-08-07T06:00:35.580069Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:00:35.243006Z","title":"vdnn: Virtualizeddeepneuralnetworksforscalable,memory-efficientneuralnetworkdesign","venue":null,"work_id":"8790344b-a38e-4218-be73-25306fa89605","year":2016},"citing_paper":{"arxiv_id":"2506.06472","last_updated":"2025-06-06T18:57:20Z","snapshot_observed_at":"2026-08-07T05:53:41.891682Z","submitted_at":"2025-06-06T18:57:20Z","title":"Cost-Efficient LLM Training with Lifetime-Aware Tensor Offloading via GPUDirect Storage","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T06:00:32.723638Z"},"links":{"citing_paper":"/paper/2506.06472"},"observation_digest":"sha256:89a2b85c6364ec0fce222626790dbe818854c725011f03f867f9e591ca1709e3","observation_id":"612eff07-8439-4277-b73d-1afec967f1e8","resolution":{"observed_at":"2026-08-07T06:00:35.359528Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:00:34.986450Z","title":"Building ai agents for autonomous clouds: Challenges and design principles","venue":null,"work_id":"a16adebc-39a0-4eb6-a394-b8c4017fa499","year":2024},"citing_paper":{"arxiv_id":"2506.06472","last_updated":"2025-06-06T18:57:20Z","snapshot_observed_at":"2026-08-07T05:53:41.891682Z","submitted_at":"2025-06-06T18:57:20Z","title":"Cost-Efficient LLM Training with Lifetime-Aware Tensor Offloading via GPUDirect Storage","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T06:00:32.812774Z"},"links":{"citing_paper":"/paper/2506.06472"},"observation_digest":"sha256:880d13916976c53627c78fb8096225bce18119b6b6589e37bf6065bf99e6fdb8","observation_id":"fe8d81db-435b-4143-9666-f0460fa68928","resolution":{"observed_at":"2026-08-07T06:00:35.090008Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:00:34.771023Z","title":"Stronghold: fast and affordable billion-scale deep learning model training","venue":null,"work_id":"46716bbd-be1d-4920-9af0-d0cdc88f89ae","year":2022},"citing_paper":{"arxiv_id":"2506.06472","last_updated":"2025-06-06T18:57:20Z","snapshot_observed_at":"2026-08-07T05:53:41.891682Z","submitted_at":"2025-06-06T18:57:20Z","title":"Cost-Efficient LLM Training with Lifetime-Aware Tensor Offloading via GPUDirect Storage","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T06:00:32.885983Z"},"links":{"citing_paper":"/paper/2506.06472"},"observation_digest":"sha256:01fd224d449fb5909f8d693c82fd9a40ad806bf07a71758cdf89d8f09beab986","observation_id":"4899a902-1259-4f04-a872-4a13a2e6d2b3","resolution":{"observed_at":"2026-08-07T06:00:34.872110Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:00:34.552023Z","title":"Superneurons: Dynamic gpu memory management for training deep neural networks","venue":null,"work_id":"9033cc5a-2321-4d13-9b51-7b3820e05cc8","year":2018},"citing_paper":{"arxiv_id":"2506.06472","last_updated":"2025-06-06T18:57:20Z","snapshot_observed_at":"2026-08-07T05:53:41.891682Z","submitted_at":"2025-06-06T18:57:20Z","title":"Cost-Efficient LLM Training with Lifetime-Aware Tensor Offloading via GPUDirect Storage","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T06:00:32.986663Z"},"links":{"citing_paper":"/paper/2506.06472"},"observation_digest":"sha256:7e4b32a2a6892916fa1043ed68d5520f79ae377b178db6e21a09c0a3b6fce03c","observation_id":"87b62046-85c8-4127-ae0d-7ee6f187fbb5","resolution":{"observed_at":"2026-08-07T06:00:34.654946Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:00:34.296452Z","title":"Netllm: Adapting large language models for networking","venue":null,"work_id":"44c4b2d0-6a76-447b-9cbc-e2c941c81ae6","year":2024},"citing_paper":{"arxiv_id":"2506.06472","last_updated":"2025-06-06T18:57:20Z","snapshot_observed_at":"2026-08-07T05:53:41.891682Z","submitted_at":"2025-06-06T18:57:20Z","title":"Cost-Efficient LLM Training with Lifetime-Aware Tensor Offloading via GPUDirect Storage","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T06:00:33.078030Z"},"links":{"citing_paper":"/paper/2506.06472"},"observation_digest":"sha256:513a120ba8cf5d3bbcfb52e870549b1cd70527195c16e7021ab9c86a68c66ac8","observation_id":"60397c44-59f8-443c-abe6-5f9a2c279258","resolution":{"observed_at":"2026-08-07T06:00:34.439392Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.10013","last_updated":"2025-02-15T22:39:05Z","snapshot_observed_at":"2026-07-06T19:02:51.711095Z","submitted_at":"2024-08-19T14:09:48Z","title":"SSDTrain: An Activation Offloading Framework to SSDs for Faster Large Language Model Training","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.10013","snapshot_observed_at":"2026-08-07T06:00:33.164055Z","title":"Tba: Faster large language model training using ssd-based activation offloading.arXiv preprint arXiv:2408.10013, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.06472","last_updated":"2025-06-06T18:57:20Z","snapshot_observed_at":"2026-08-07T05:53:41.891682Z","submitted_at":"2025-06-06T18:57:20Z","title":"Cost-Efficient LLM Training with Lifetime-Aware Tensor Offloading via GPUDirect Storage","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T06:00:33.164055Z"},"links":{"cited_paper":"/paper/2408.10013","citing_paper":"/paper/2506.06472"},"observation_digest":"sha256:a535a660fd48755480212534757c243f45d43cb9540695850199c3491324f8ca","observation_id":"108aa304-7f91-4023-931c-365f0d00c4d5","resolution":{"observed_at":"2026-08-07T06:00:33.164055Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:00:34.116754Z","title":"Acceleratingthetrainingoflargelanguagemodelsusingefficientactivation rematerializationandoptimalhybridparallelism","venue":null,"work_id":"6308b6ec-9f03-4a3a-b0ba-e3f42ac2760e","year":2024},"citing_paper":{"arxiv_id":"2506.06472","last_updated":"2025-06-06T18:57:20Z","snapshot_observed_at":"2026-08-07T05:53:41.891682Z","submitted_at":"2025-06-06T18:57:20Z","title":"Cost-Efficient LLM Training with Lifetime-Aware Tensor Offloading via GPUDirect Storage","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T06:00:33.266662Z"},"links":{"citing_paper":"/paper/2506.06472"},"observation_digest":"sha256:cfd797f3878ba0990a5a8ad4ce6d20a151a42d8cd5826bcd2cd195022e188b44","observation_id":"57779a89-1c9f-4080-9835-0f54f9743c4d","resolution":{"observed_at":"2026-08-07T06:00:34.182335Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:00:33.926398Z","title":"Zng: Architecting gpu multi-processors with new flash for scalable data analysis","venue":null,"work_id":"d3429b88-1450-4a13-979a-60d0f1a33d8a","year":2020},"citing_paper":{"arxiv_id":"2506.06472","last_updated":"2025-06-06T18:57:20Z","snapshot_observed_at":"2026-08-07T05:53:41.891682Z","submitted_at":"2025-06-06T18:57:20Z","title":"Cost-Efficient LLM Training with Lifetime-Aware Tensor Offloading via GPUDirect Storage","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T06:00:33.346043Z"},"links":{"citing_paper":"/paper/2506.06472"},"observation_digest":"sha256:978cee0e99787872786001d18351d07ba426d4ac1ee637eec0adf4a469c44f8d","observation_id":"ca18bf44-aead-4cb4-bb78-9fb324554960","resolution":{"observed_at":"2026-08-07T06:00:34.008635Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T06:00:33.724425Z","title":"Flashgpu: Placing new flash next to gpu cores","venue":null,"work_id":"02f76510-4e3b-44dd-ae49-1b61de32f4f5","year":2019},"citing_paper":{"arxiv_id":"2506.06472","last_updated":"2025-06-06T18:57:20Z","snapshot_observed_at":"2026-08-07T05:53:41.891682Z","submitted_at":"2025-06-06T18:57:20Z","title":"Cost-Efficient LLM Training with Lifetime-Aware Tensor Offloading via GPUDirect Storage","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T06:00:33.427109Z"},"links":{"citing_paper":"/paper/2506.06472"},"observation_digest":"sha256:8cc3815a79616a245777025fbb392eaec46d13e6bc0a53ce4399753f956d84e7","observation_id":"f5f669cb-a2c0-4bdd-b073-8e9a4d7e7030","resolution":{"observed_at":"2026-08-07T06:00:33.797888Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2506.06472","last_updated":"2025-06-06T18:57:20Z","latest_version":1,"primary_category":"cs.DC","snapshot_observed_at":"2026-08-07T05:53:41.891682Z","submitted_at":"2025-06-06T18:57:20Z","title":"Cost-Efficient LLM Training with Lifetime-Aware Tensor Offloading via GPUDirect Storage"},"reference_resolution":{"displayed":39,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":17,"verified_exact":0,"verified_fuzzy":22},"total_outbound_references":39},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 39 of 39 outbound references and 0 inbound Pith citation observations for arXiv:2506.06472."}