{"as_of":"2026-08-08T21:29:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:2cfb6a8060f758b7999adc4f740b1b99d247a4c83bd798bf6fcd7e564fbb1d9d","coverage":[{"denominator":37,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":37,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T13:00:40.815419Z","state":"measured"},{"denominator":37,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":37,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2505.22905/citation-record","integrity":"/paper/2505.22905/integrity","json":"/paper/2505.22905/citation-record.json","paper":"/paper/2505.22905"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:00:47.007685Z","title":"https://mitsloan.mit.edu/ideas- made-to-matter/ai-has-high-data-center-energy-costs-there-are-solutions","venue":null,"work_id":"92e3333c-e66d-4332-9673-6bd067521530","year":2025},"citing_paper":{"arxiv_id":"2505.22905","last_updated":"2025-05-28T22:11:05Z","snapshot_observed_at":"2026-08-07T12:55:31.298007Z","submitted_at":"2025-05-28T22:11:05Z","title":"Profiling and optimization of multi-card GPU machine learning jobs","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T13:00:37.417515Z"},"links":{"citing_paper":"/paper/2505.22905"},"observation_digest":"sha256:8e562b5255404e6f6b715b282dd195ccd4fb34f64371f73da6bc070bb46efbf7","observation_id":"79abec30-b5d6-4146-895c-5549be18ffd2","resolution":{"observed_at":"2026-08-07T13:00:47.105300Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:00:46.807379Z","title":"Beyond T raditional Learning: The LLM Revolution in BPM Education at Univer- sity","venue":null,"work_id":"f1d7a3e3-926d-4823-bdcb-513ab059f9e0","year":2024},"citing_paper":{"arxiv_id":"2505.22905","last_updated":"2025-05-28T22:11:05Z","snapshot_observed_at":"2026-08-07T12:55:31.298007Z","submitted_at":"2025-05-28T22:11:05Z","title":"Profiling and optimization of multi-card GPU machine learning jobs","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T13:00:37.510419Z"},"links":{"citing_paper":"/paper/2505.22905"},"observation_digest":"sha256:47ca5faf8e2a332eb80e58968f20668ff553860ad6d88a1f1535fc5b1f76b32c","observation_id":"a63c442b-aa95-497c-8780-40f469cbd791","resolution":{"observed_at":"2026-08-07T13:00:46.914520Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:00:46.572707Z","title":"The Language Model Revolution: LLM and SLM Analysis","venue":null,"work_id":"1f12ac87-727b-4d6a-8e51-8be107f9b69e","year":2024},"citing_paper":{"arxiv_id":"2505.22905","last_updated":"2025-05-28T22:11:05Z","snapshot_observed_at":"2026-08-07T12:55:31.298007Z","submitted_at":"2025-05-28T22:11:05Z","title":"Profiling and optimization of multi-card GPU machine learning jobs","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T13:00:37.597807Z"},"links":{"citing_paper":"/paper/2505.22905"},"observation_digest":"sha256:77317a15d9ecdbb45575de34d20aa97dd871552bbb4d6f8f46ef8f1834829768","observation_id":"7a823e98-3226-4418-8b00-d7b2a3c41534","resolution":{"observed_at":"2026-08-07T13:00:46.696355Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:00:46.250420Z","title":"A New Golden Age in Computer Architecture: Empowering the Machine-Learning Revo- lution","venue":null,"work_id":"3e0961a4-915e-43d1-9e69-9d85f743d797","year":2018},"citing_paper":{"arxiv_id":"2505.22905","last_updated":"2025-05-28T22:11:05Z","snapshot_observed_at":"2026-08-07T12:55:31.298007Z","submitted_at":"2025-05-28T22:11:05Z","title":"Profiling and optimization of multi-card GPU machine learning jobs","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T13:00:37.666356Z"},"links":{"citing_paper":"/paper/2505.22905"},"observation_digest":"sha256:c2fc5685e3691b732910f4c0a857edcbaef0dbcf038c0fdd46e9b32970e006cd","observation_id":"dd29ea58-6b2f-48d9-819e-1bbe8fb0de7e","resolution":{"observed_at":"2026-08-07T13:00:46.377926Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.12674","last_updated":"2024-11-26T06:35:31Z","snapshot_observed_at":"2026-07-06T18:02:32.493045Z","submitted_at":"2024-04-19T07:20:33Z","title":"Towards Universal Performance Modeling for Machine Learning Training on Multi-GPU Platforms","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.12674","snapshot_observed_at":"2026-08-07T13:00:37.753471Z","title":"https://arxiv.org/abs/2404.12674","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.22905","last_updated":"2025-05-28T22:11:05Z","snapshot_observed_at":"2026-08-07T12:55:31.298007Z","submitted_at":"2025-05-28T22:11:05Z","title":"Profiling and optimization of multi-card GPU machine learning jobs","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T13:00:37.753471Z"},"links":{"cited_paper":"/paper/2404.12674","citing_paper":"/paper/2505.22905"},"observation_digest":"sha256:23d2b3c04b2a2d27e9460764a7d1ab9609cf90a14130f54d19017d6fab677934","observation_id":"a8ec2b11-debc-489b-9bfb-bfb88e0263e9","resolution":{"observed_at":"2026-08-07T13:00:37.753471Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:00:37.816124Z","title":"TwinPilots: A New Computing Paradigm for GPU-CPU Parallel LLM Inference","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.22905","last_updated":"2025-05-28T22:11:05Z","snapshot_observed_at":"2026-08-07T12:55:31.298007Z","submitted_at":"2025-05-28T22:11:05Z","title":"Profiling and optimization of multi-card GPU machine learning jobs","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T13:00:37.816124Z"},"links":{"citing_paper":"/paper/2505.22905"},"observation_digest":"sha256:e95da49d8842e1f7471f501002129109dbfda5198aab8b4ea3e7aa28d3be33b3","observation_id":"43ad643f-6410-41ec-8c5d-ae5d0007e147","resolution":{"observed_at":"2026-08-07T13:00:37.816124Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"8129.10581","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:00:41.807686Z","title":"Understanding the eﬃciency of GPU algorithms for matrix-matrix multiplication","venue":null,"work_id":"6f7ba616-c214-4f94-a83b-0ff0e2dbd144","year":2004},"citing_paper":{"arxiv_id":"2505.22905","last_updated":"2025-05-28T22:11:05Z","snapshot_observed_at":"2026-08-07T12:55:31.298007Z","submitted_at":"2025-05-28T22:11:05Z","title":"Profiling and optimization of multi-card GPU machine learning jobs","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T13:00:37.866037Z"},"links":{"citing_paper":"/paper/2505.22905"},"observation_digest":"sha256:7f5909d5e7a514b6c3ee158b0eb60219c8d9c921d5f13f021464e0a8f32f5fe1","observation_id":"1f101d7c-d933-4d80-b814-a508ab91a60f","resolution":{"observed_at":"2026-08-07T13:00:41.871939Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:00:45.924675Z","title":"Optimization and architecture eﬀects on GPU computing workload performance","venue":null,"work_id":"a8e675ac-e43a-440e-925f-308b79843ca8","year":2012},"citing_paper":{"arxiv_id":"2505.22905","last_updated":"2025-05-28T22:11:05Z","snapshot_observed_at":"2026-08-07T12:55:31.298007Z","submitted_at":"2025-05-28T22:11:05Z","title":"Profiling and optimization of multi-card GPU machine learning jobs","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T13:00:37.964335Z"},"links":{"citing_paper":"/paper/2505.22905"},"observation_digest":"sha256:6ff5f16429ff4b0d4cc35b2dbaf63dd359e2dc8e2b05bc0f9b5becd483742256","observation_id":"14f184db-b71e-4717-a172-cf8c6ba0087d","resolution":{"observed_at":"2026-08-07T13:00:46.104003Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:00:45.590439Z","title":"Coordinating the use of GPU and CPU for im- proving performance of compute intensive applications","venue":null,"work_id":"a2b44951-506d-4037-8eff-b51dda4885f4","year":2009},"citing_paper":{"arxiv_id":"2505.22905","last_updated":"2025-05-28T22:11:05Z","snapshot_observed_at":"2026-08-07T12:55:31.298007Z","submitted_at":"2025-05-28T22:11:05Z","title":"Profiling and optimization of multi-card GPU machine learning jobs","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T13:00:38.046723Z"},"links":{"citing_paper":"/paper/2505.22905"},"observation_digest":"sha256:c7da05469fc3ce1bbfa24e3c8c9039052b23392b37051e1352556ac9e78f166f","observation_id":"383c89ae-1ee0-4e22-98a3-361d7a876527","resolution":{"observed_at":"2026-08-07T13:00:45.787213Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:00:45.226418Z","title":"Comparing Energy Eﬃciency of CPU, GPU and FPGA Im- plementations for Vision Kernels","venue":null,"work_id":"39248268-1349-4c61-8275-703e034bf197","year":2019},"citing_paper":{"arxiv_id":"2505.22905","last_updated":"2025-05-28T22:11:05Z","snapshot_observed_at":"2026-08-07T12:55:31.298007Z","submitted_at":"2025-05-28T22:11:05Z","title":"Profiling and optimization of multi-card GPU machine learning jobs","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T13:00:38.145486Z"},"links":{"citing_paper":"/paper/2505.22905"},"observation_digest":"sha256:2b73e8e6a2995670252b7fb0758c834e33b05d793b20dc5ab2fd6a359a9d202c","observation_id":"312bd2de-3c62-42e4-bd67-185f4411e3ef","resolution":{"observed_at":"2026-08-07T13:00:45.371480Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1007/s11227-011-0631-3","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:00:40.889686Z","title":"A comparative study of GPU programming models and architectures using neural networks","venue":null,"work_id":"79876659-77dd-4495-824b-4a25fefc1be3","year":2012},"citing_paper":{"arxiv_id":"2505.22905","last_updated":"2025-05-28T22:11:05Z","snapshot_observed_at":"2026-08-07T12:55:31.298007Z","submitted_at":"2025-05-28T22:11:05Z","title":"Profiling and optimization of multi-card GPU machine learning jobs","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T13:00:38.276414Z"},"links":{"citing_paper":"/paper/2505.22905"},"observation_digest":"sha256:1a50039540d8b7960143778daa352d0e73737e18c4b02deb428ffaf45dffc056","observation_id":"c8d9a13b-4a56-4750-80d9-0ccee4dc866c","resolution":{"observed_at":"2026-08-07T13:00:40.955418Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1604.01946","last_updated":"2016-04-07T10:31:01Z","snapshot_observed_at":"2026-07-31T15:34:45.791313Z","submitted_at":"2016-04-07T10:31:01Z","title":"Optimizing Performance of Recurrent Neural Networks on GPUs","version":1},"cited_work":{"arxiv_id":"1604.01946","doi":null,"metadata_source":"pith","pith_arxiv_id":"1604.01946","snapshot_observed_at":"2026-08-07T13:00:41.545497Z","title":"Optimizing Performance of Recurrent Neural Networks on GPUs","venue":"cs.LG","work_id":"c0e6ddc4-e75a-413d-b5e1-314fe031077c","year":2016},"citing_paper":{"arxiv_id":"2505.22905","last_updated":"2025-05-28T22:11:05Z","snapshot_observed_at":"2026-08-07T12:55:31.298007Z","submitted_at":"2025-05-28T22:11:05Z","title":"Profiling and optimization of multi-card GPU machine learning jobs","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T13:00:38.400314Z"},"links":{"cited_paper":"/paper/1604.01946","citing_paper":"/paper/2505.22905"},"observation_digest":"sha256:1cc6b740ad2ec4c6710fa7c8b4999105638394115f4324d6dc10c85b6ec60dc2","observation_id":"56b53104-31e2-4fd0-8a08-225d23c00b57","resolution":{"observed_at":"2026-08-07T13:00:41.605481Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:00:38.492760Z","title":"PyT orch distributed: experiences on accelerating data parallel training","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.22905","last_updated":"2025-05-28T22:11:05Z","snapshot_observed_at":"2026-08-07T12:55:31.298007Z","submitted_at":"2025-05-28T22:11:05Z","title":"Profiling and optimization of multi-card GPU machine learning jobs","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T13:00:38.492760Z"},"links":{"citing_paper":"/paper/2505.22905"},"observation_digest":"sha256:f13f0e941b9ed6e65ce90d8eb10db101bacd96d96741aa33933eef2a42b755d2","observation_id":"9017212e-523b-4e7c-9372-402532a4af64","resolution":{"observed_at":"2026-08-07T13:00:38.492760Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:00:44.908104Z","title":"https://top500.org/system/180290/","venue":null,"work_id":"c39d8ef6-7034-4e7c-80e1-b89ea0a94f2e","year":2025},"citing_paper":{"arxiv_id":"2505.22905","last_updated":"2025-05-28T22:11:05Z","snapshot_observed_at":"2026-08-07T12:55:31.298007Z","submitted_at":"2025-05-28T22:11:05Z","title":"Profiling and optimization of multi-card GPU machine learning jobs","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T13:00:38.628262Z"},"links":{"citing_paper":"/paper/2505.22905"},"observation_digest":"sha256:b96a8284c7c60ca0acf1b094d8a074876bb63c574e6f3e389b8b11b6672b9123","observation_id":"c8f3c744-d27d-4a5c-b8e5-db344a7f89a2","resolution":{"observed_at":"2026-08-07T13:00:45.078779Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:00:44.749235Z","title":"https://docs.nvidia.com/datacenter/nvtags/1.1/nvtags- user-guide/index.html","venue":null,"work_id":"3c5e0011-aea0-4d17-b14c-d8824e9a276c","year":2025},"citing_paper":{"arxiv_id":"2505.22905","last_updated":"2025-05-28T22:11:05Z","snapshot_observed_at":"2026-08-07T12:55:31.298007Z","submitted_at":"2025-05-28T22:11:05Z","title":"Profiling and optimization of multi-card GPU machine learning jobs","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T13:00:38.708813Z"},"links":{"citing_paper":"/paper/2505.22905"},"observation_digest":"sha256:d20dee25efd42328c07a97cf05b8874f98c32d0022724bb0954ced0142900344","observation_id":"de3f46b1-9c8a-4758-8d29-d451467a3e6c","resolution":{"observed_at":"2026-08-07T13:00:44.820343Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:00:44.483741Z","title":"https://pytorch.org/tutorials/intermediate/ddp_tutorial","venue":null,"work_id":"8ddf5abe-29d0-4892-81a8-ddecc68d3471","year":2025},"citing_paper":{"arxiv_id":"2505.22905","last_updated":"2025-05-28T22:11:05Z","snapshot_observed_at":"2026-08-07T12:55:31.298007Z","submitted_at":"2025-05-28T22:11:05Z","title":"Profiling and optimization of multi-card GPU machine learning jobs","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T13:00:38.809447Z"},"links":{"citing_paper":"/paper/2505.22905"},"observation_digest":"sha256:62e60334087bbd793a30ad10e61f49fbead36e42375f8119c2e6487cfac0b086","observation_id":"e1d9bd2a-f9d6-44a6-aa9a-ee18911a44eb","resolution":{"observed_at":"2026-08-07T13:00:44.573618Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:00:44.193718Z","title":"https://pytorch.org/torchtune/stable/deep_dives/configs","venue":null,"work_id":"d743008d-4a06-4421-9614-0e5f17f85a95","year":2024},"citing_paper":{"arxiv_id":"2505.22905","last_updated":"2025-05-28T22:11:05Z","snapshot_observed_at":"2026-08-07T12:55:31.298007Z","submitted_at":"2025-05-28T22:11:05Z","title":"Profiling and optimization of multi-card GPU machine learning jobs","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T13:00:38.906357Z"},"links":{"citing_paper":"/paper/2505.22905"},"observation_digest":"sha256:aa2dcb001af5582bdca43da5dca0212efcb14ea8652b94f0cfe778c2e5a029f9","observation_id":"90d9a0c9-d759-45bc-88ad-714653297708","resolution":{"observed_at":"2026-08-07T13:00:44.327476Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:00:43.905899Z","title":"https://developer.nvidia.com/nsight-systems","venue":null,"work_id":"e40304b1-5751-44ce-bd42-82f0d499e178","year":2025},"citing_paper":{"arxiv_id":"2505.22905","last_updated":"2025-05-28T22:11:05Z","snapshot_observed_at":"2026-08-07T12:55:31.298007Z","submitted_at":"2025-05-28T22:11:05Z","title":"Profiling and optimization of multi-card GPU machine learning jobs","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T13:00:39.002760Z"},"links":{"citing_paper":"/paper/2505.22905"},"observation_digest":"sha256:35f4a5a9cf8a235342ba2ef7884db1963824ac1efa57f5c2500eea616bcbfa73","observation_id":"8b54a6d0-a690-4a0a-97c0-1951ff949acc","resolution":{"observed_at":"2026-08-07T13:00:44.039488Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:00:43.678439Z","title":"High-Performance Data Loader for Large-Scale Data Processing","venue":null,"work_id":"c04fb992-7817-419a-abd1-2ca3d5261dfd","year":2024},"citing_paper":{"arxiv_id":"2505.22905","last_updated":"2025-05-28T22:11:05Z","snapshot_observed_at":"2026-08-07T12:55:31.298007Z","submitted_at":"2025-05-28T22:11:05Z","title":"Profiling and optimization of multi-card GPU machine learning jobs","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T13:00:39.104787Z"},"links":{"citing_paper":"/paper/2505.22905"},"observation_digest":"sha256:bef2b4c02d4b8222f368196af2739f07d59e64ef2d30b421d3821f5ece93388e","observation_id":"ba51cef9-4d14-4416-849c-3eb5413a027c","resolution":{"observed_at":"2026-08-07T13:00:43.784288Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1409.1556","last_updated":"2015-04-10T16:25:04Z","snapshot_observed_at":"2026-07-06T03:53:32.549552Z","submitted_at":"2014-09-04T19:48:04Z","title":"Very Deep Convolutional Networks for Large-Scale Image Recognition","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1409.1556","snapshot_observed_at":"2026-08-07T13:00:39.220161Z","title":"Very Deep Convolutional Networks for Large-Scale Image Recognition","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2505.22905","last_updated":"2025-05-28T22:11:05Z","snapshot_observed_at":"2026-08-07T12:55:31.298007Z","submitted_at":"2025-05-28T22:11:05Z","title":"Profiling and optimization of multi-card GPU machine learning jobs","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T13:00:39.220161Z"},"links":{"cited_paper":"/paper/1409.1556","citing_paper":"/paper/2505.22905"},"observation_digest":"sha256:8d92634559f0de41a61310b4e8ec6257a5ea3f2e787b37bb7abc85f71080dd37","observation_id":"fe0e72c9-2db0-4e0e-8021-0dbfa4b211ce","resolution":{"observed_at":"2026-08-07T13:00:39.220161Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:00:43.398251Z","title":"https://www.kaggle.com/datasets/hojjatk/mnist-dataset","venue":null,"work_id":"ce025869-7c8c-411d-8024-b7029f313731","year":2025},"citing_paper":{"arxiv_id":"2505.22905","last_updated":"2025-05-28T22:11:05Z","snapshot_observed_at":"2026-08-07T12:55:31.298007Z","submitted_at":"2025-05-28T22:11:05Z","title":"Profiling and optimization of multi-card GPU machine learning jobs","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T13:00:39.316553Z"},"links":{"citing_paper":"/paper/2505.22905"},"observation_digest":"sha256:a01d94f16d275cf12e15f811c3c6920f7afdba7284ae27ebae8f02b9394ebb13","observation_id":"08db4c51-ebef-4c73-b095-5090f32e3a75","resolution":{"observed_at":"2026-08-07T13:00:43.521920Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:00:43.122269Z","title":"https://keras.io/api/applications/mobilenet/","venue":null,"work_id":"18465ca1-4970-48fa-846f-bc36e8b8af14","year":2025},"citing_paper":{"arxiv_id":"2505.22905","last_updated":"2025-05-28T22:11:05Z","snapshot_observed_at":"2026-08-07T12:55:31.298007Z","submitted_at":"2025-05-28T22:11:05Z","title":"Profiling and optimization of multi-card GPU machine learning jobs","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T13:00:39.440829Z"},"links":{"citing_paper":"/paper/2505.22905"},"observation_digest":"sha256:9d39eea7f586340c2b9d160d075280557d5368e6400982473e6aa90c539023ff","observation_id":"f8ed8111-713b-4f6c-bdab-8728d4fb9a03","resolution":{"observed_at":"2026-08-07T13:00:43.254475Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1505.04597","last_updated":"2015-05-18T11:28:37Z","snapshot_observed_at":"2026-08-06T11:05:16.105361Z","submitted_at":"2015-05-18T11:28:37Z","title":"U-Net: Convolutional Networks for Biomedical Image Segmentation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1505.04597","snapshot_observed_at":"2026-08-07T13:00:39.535410Z","title":"https: //arxiv.org/abs/1505.04597","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2505.22905","last_updated":"2025-05-28T22:11:05Z","snapshot_observed_at":"2026-08-07T12:55:31.298007Z","submitted_at":"2025-05-28T22:11:05Z","title":"Profiling and optimization of multi-card GPU machine learning jobs","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T13:00:39.535410Z"},"links":{"cited_paper":"/paper/1505.04597","citing_paper":"/paper/2505.22905"},"observation_digest":"sha256:2cdd70483d96c5e5f2f46d26d2865abdb11e6fd3adb7881d8cb9bf11398bbb46","observation_id":"c6475942-5a1a-4aa5-87e2-8bc7442a2e3e","resolution":{"observed_at":"2026-08-07T13:00:39.535410Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2012.09904","last_updated":"2020-12-17T19:58:10Z","snapshot_observed_at":"2026-08-08T20:24:46.215886Z","submitted_at":"2020-12-17T19:58:10Z","title":"Attention-based Image Upsampling","version":1},"cited_work":{"arxiv_id":"2012.09904","doi":null,"metadata_source":"pith","pith_arxiv_id":"2012.09904","snapshot_observed_at":"2026-08-07T13:00:41.273814Z","title":"Attention-based Image Upsampling","venue":"cs.CV","work_id":"83ae1d6f-e9b8-4edb-ba4b-d17bdce6e884","year":2020},"citing_paper":{"arxiv_id":"2505.22905","last_updated":"2025-05-28T22:11:05Z","snapshot_observed_at":"2026-08-07T12:55:31.298007Z","submitted_at":"2025-05-28T22:11:05Z","title":"Profiling and optimization of multi-card GPU machine learning jobs","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T13:00:39.630114Z"},"links":{"cited_paper":"/paper/2012.09904","citing_paper":"/paper/2505.22905"},"observation_digest":"sha256:eac364930ceaf1271b623014434f6b929f7247e7085dcf56d4d937e8ecfa6dc1","observation_id":"653bbf00-9f6b-4d2e-abde-450295d12f56","resolution":{"observed_at":"2026-08-07T13:00:41.330716Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:00:42.773122Z","title":null,"venue":null,"work_id":"198b32b4-c1f5-4236-ba1b-3807621d853c","year":null},"citing_paper":{"arxiv_id":"2505.22905","last_updated":"2025-05-28T22:11:05Z","snapshot_observed_at":"2026-08-07T12:55:31.298007Z","submitted_at":"2025-05-28T22:11:05Z","title":"Profiling and optimization of multi-card GPU machine learning jobs","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T13:00:39.805305Z"},"links":{"citing_paper":"/paper/2505.22905"},"observation_digest":"sha256:ac30cc565e43f802cd0eea898dadf0968e4dee3b50eceea668e633241e373f0c","observation_id":"7ecc26db-c763-4545-8b15-5e2a707fcfd8","resolution":{"observed_at":"2026-08-07T13:00:42.915022Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:00:42.553550Z","title":"An Emotion T ext Classiﬁcation Model Based on Llama3-8b Using Lora T echnique","venue":null,"work_id":"50415031-d30a-49ca-b45c-796b90b561f5","year":2024},"citing_paper":{"arxiv_id":"2505.22905","last_updated":"2025-05-28T22:11:05Z","snapshot_observed_at":"2026-08-07T12:55:31.298007Z","submitted_at":"2025-05-28T22:11:05Z","title":"Profiling and optimization of multi-card GPU machine learning jobs","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T13:00:40.046952Z"},"links":{"citing_paper":"/paper/2505.22905"},"observation_digest":"sha256:b538a73996c609bbc0b8266a141680a8fe975eaa788d155e053c265ff20cba40","observation_id":"31e1d91c-31d2-4671-a5c1-df979b246feb","resolution":{"observed_at":"2026-08-07T13:00:42.626408Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.06196","last_updated":"2025-03-23T14:51:01Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-02-09T05:37:09Z","title":"Large Language Models: A Survey","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.06196","snapshot_observed_at":"2026-08-07T13:00:40.138924Z","title":"https://arxiv.org/abs/2402.06196","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.22905","last_updated":"2025-05-28T22:11:05Z","snapshot_observed_at":"2026-08-07T12:55:31.298007Z","submitted_at":"2025-05-28T22:11:05Z","title":"Profiling and optimization of multi-card GPU machine learning jobs","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T13:00:40.138924Z"},"links":{"cited_paper":"/paper/2402.06196","citing_paper":"/paper/2505.22905"},"observation_digest":"sha256:5e47e934385bd06ab21c7dc0d2b96ce5072d35f55a0600105205141771edb33e","observation_id":"217690b4-34c2-477f-8770-bf0ace27beca","resolution":{"observed_at":"2026-08-07T13:00:40.138924Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.13245","last_updated":"2023-12-23T17:55:11Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-05-22T17:16:38Z","title":"GQA: Training Generalized Multi-Query Transformer Models from Multi-Head Checkpoints","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.13245","snapshot_observed_at":"2026-08-07T13:00:40.285407Z","title":"https://arxiv.org/abs/2305.13245","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.22905","last_updated":"2025-05-28T22:11:05Z","snapshot_observed_at":"2026-08-07T12:55:31.298007Z","submitted_at":"2025-05-28T22:11:05Z","title":"Profiling and optimization of multi-card GPU machine learning jobs","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T13:00:40.285407Z"},"links":{"cited_paper":"/paper/2305.13245","citing_paper":"/paper/2505.22905"},"observation_digest":"sha256:e83f106db6b71c9eea0e39dc0d4f49069ce16ad25cd4f458169225ba9ffdf663","observation_id":"abfae9a3-7c2a-45d0-91ed-820e27503796","resolution":{"observed_at":"2026-08-07T13:00:40.285407Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-07T13:00:40.425188Z","title":"https://arxiv.org/abs/2407.21783","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.22905","last_updated":"2025-05-28T22:11:05Z","snapshot_observed_at":"2026-08-07T12:55:31.298007Z","submitted_at":"2025-05-28T22:11:05Z","title":"Profiling and optimization of multi-card GPU machine learning jobs","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T13:00:40.425188Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2505.22905"},"observation_digest":"sha256:01aed6ff70f0c2cca9beba8f0e28283b90985b5d066cf6e4e5dca53e7770ffa4","observation_id":"c84936c2-3d3e-4a43-927f-e8f1cc75a478","resolution":{"observed_at":"2026-08-07T13:00:40.425188Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2106.09685","last_updated":"2021-10-16T18:40:34Z","snapshot_observed_at":"2026-08-07T07:43:16.294957Z","submitted_at":"2021-06-17T17:37:18Z","title":"LoRA: Low-Rank Adaptation of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.09685","snapshot_observed_at":"2026-08-07T13:00:40.479204Z","title":"https://arxiv.org/abs/2106.09685","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.22905","last_updated":"2025-05-28T22:11:05Z","snapshot_observed_at":"2026-08-07T12:55:31.298007Z","submitted_at":"2025-05-28T22:11:05Z","title":"Profiling and optimization of multi-card GPU machine learning jobs","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T13:00:40.479204Z"},"links":{"cited_paper":"/paper/2106.09685","citing_paper":"/paper/2505.22905"},"observation_digest":"sha256:4f9f22de02e82381a5d85593768ad9cf77759efc0f3cfe24d5a134ec2e2cf771","observation_id":"6dc3317d-4f4f-4028-8fde-850019b2126c","resolution":{"observed_at":"2026-08-07T13:00:40.479204Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.18290","last_updated":"2024-07-29T22:26:36Z","snapshot_observed_at":"2026-08-01T16:34:38.795326Z","submitted_at":"2023-05-29T17:57:46Z","title":"Direct Preference Optimization: Your Language Model is Secretly a Reward Model","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.18290","snapshot_observed_at":"2026-08-07T13:00:40.534879Z","title":"Direct Preference Optimization: Y our Language Model is Secretly a Reward Model","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.22905","last_updated":"2025-05-28T22:11:05Z","snapshot_observed_at":"2026-08-07T12:55:31.298007Z","submitted_at":"2025-05-28T22:11:05Z","title":"Profiling and optimization of multi-card GPU machine learning jobs","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T13:00:40.534879Z"},"links":{"cited_paper":"/paper/2305.18290","citing_paper":"/paper/2505.22905"},"observation_digest":"sha256:39c9ab4722ffd183850e780de85295d5421c8249e5a46564b732fec1022fd5b4","observation_id":"1b3aa207-2f4b-45dd-a3b2-0379a19031e9","resolution":{"observed_at":"2026-08-07T13:00:40.534879Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.14314","last_updated":"2023-05-23T17:50:33Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-05-23T17:50:33Z","title":"QLoRA: Efficient Finetuning of Quantized LLMs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.14314","snapshot_observed_at":"2026-08-07T13:00:40.580218Z","title":"https: //arxiv.org/abs/2305.14314","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.22905","last_updated":"2025-05-28T22:11:05Z","snapshot_observed_at":"2026-08-07T12:55:31.298007Z","submitted_at":"2025-05-28T22:11:05Z","title":"Profiling and optimization of multi-card GPU machine learning jobs","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T13:00:40.580218Z"},"links":{"cited_paper":"/paper/2305.14314","citing_paper":"/paper/2505.22905"},"observation_digest":"sha256:43bf9992cac14e1a317b94a6a4edca596cf092817498ca70bfd61ab654fe45b6","observation_id":"226f01c1-b68d-4ee7-9b5e-f6cdf74bda42","resolution":{"observed_at":"2026-08-07T13:00:40.580218Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:00:42.507360Z","title":null,"venue":null,"work_id":"b38f54a5-2ed5-49c8-b54e-898820d73544","year":null},"citing_paper":{"arxiv_id":"2505.22905","last_updated":"2025-05-28T22:11:05Z","snapshot_observed_at":"2026-08-07T12:55:31.298007Z","submitted_at":"2025-05-28T22:11:05Z","title":"Profiling and optimization of multi-card GPU machine learning jobs","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T13:00:40.640777Z"},"links":{"citing_paper":"/paper/2505.22905"},"observation_digest":"sha256:9925e4b2415374ac7c28ddd2f0e488293e73b714e48ecc09378a1efc25d81abf","observation_id":"5cdcc24c-5f07-43b3-a41f-0ac3300763b3","resolution":{"observed_at":"2026-08-07T13:00:42.537667Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:00:42.361207Z","title":"Synthetic Data Generation for Grammatical Error Correction with T agged Corruption Models","venue":null,"work_id":"9fed0d55-4f47-43e4-98ef-32d358ae180d","year":2021},"citing_paper":{"arxiv_id":"2505.22905","last_updated":"2025-05-28T22:11:05Z","snapshot_observed_at":"2026-08-07T12:55:31.298007Z","submitted_at":"2025-05-28T22:11:05Z","title":"Profiling and optimization of multi-card GPU machine learning jobs","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T13:00:40.755997Z"},"links":{"citing_paper":"/paper/2505.22905"},"observation_digest":"sha256:4c938ded22a0a1d12a8d5a5cd5b2f6d110608bc5b7de3326549100556cac2c7b","observation_id":"1c5bac2f-87cf-4c6b-8c96-6b44f98116bf","resolution":{"observed_at":"2026-08-07T13:00:42.419253Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:00:42.142816Z","title":"SAMSum Corpus: A Human-annotated Dialogue Dataset for Abstractive Sum- marization","venue":null,"work_id":"ada2a8e0-0858-42f2-91dd-aaf25320a0ab","year":2019},"citing_paper":{"arxiv_id":"2505.22905","last_updated":"2025-05-28T22:11:05Z","snapshot_observed_at":"2026-08-07T12:55:31.298007Z","submitted_at":"2025-05-28T22:11:05Z","title":"Profiling and optimization of multi-card GPU machine learning jobs","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T13:00:40.815419Z"},"links":{"citing_paper":"/paper/2505.22905"},"observation_digest":"sha256:82f84135c4fd966320e11a0e36a4ada0d65c4316a7b70c73a8b6df6faffbfe0e","observation_id":"cfab5550-6411-4570-88c3-85796c8b7ba7","resolution":{"observed_at":"2026-08-07T13:00:42.243206Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.06965","last_updated":"2022-10-20T12:44:50Z","snapshot_observed_at":"2026-07-06T14:04:44.193264Z","submitted_at":"2022-10-13T12:45:51Z","title":"CUF: Continuous Upsampling Filters","version":2},"cited_work":{"arxiv_id":"2210.06965","doi":null,"metadata_source":"pith","pith_arxiv_id":"2210.06965","snapshot_observed_at":"2026-08-07T13:00:41.091445Z","title":"CUF: Continuous Upsampling Filters","venue":"cs.LG","work_id":"b8761d72-a07c-404a-a61d-44a2afb45d98","year":2022},"citing_paper":{"arxiv_id":"2505.22905","last_updated":"2025-05-28T22:11:05Z","snapshot_observed_at":"2026-08-07T12:55:31.298007Z","submitted_at":"2025-05-28T22:11:05Z","title":"Profiling and optimization of multi-card GPU machine learning jobs","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-07T13:00:39.912594Z"},"links":{"cited_paper":"/paper/2210.06965","citing_paper":"/paper/2505.22905"},"observation_digest":"sha256:991e00fef77ff4455b25213b924376d9cc4f96a3160e1e5c7cea7751bed03036","observation_id":"d92b94a0-902d-491a-9748-97d44710e280","resolution":{"observed_at":"2026-08-07T13:00:41.185749Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.06084","last_updated":"2024-11-09T06:30:13Z","snapshot_observed_at":"2026-07-06T19:47:47.232714Z","submitted_at":"2024-11-09T06:30:13Z","title":"Optimizing Large Language Models through Quantization: A Comparative Analysis of PTQ and QAT Techniques","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.06084","snapshot_observed_at":"2026-08-07T13:00:40.700244Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.22905","last_updated":"2025-05-28T22:11:05Z","snapshot_observed_at":"2026-08-07T12:55:31.298007Z","submitted_at":"2025-05-28T22:11:05Z","title":"Profiling and optimization of multi-card GPU machine learning jobs","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-07T13:00:40.700244Z"},"links":{"cited_paper":"/paper/2411.06084","citing_paper":"/paper/2505.22905"},"observation_digest":"sha256:0aceb32af624ef1f7f803916dd4257a0d97fc51cf7ff8b67c3a1eb718ef5a6f2","observation_id":"0071c3d8-ba13-4378-ae35-16f1f2949067","resolution":{"observed_at":"2026-08-07T13:00:40.700244Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2505.22905","last_updated":"2025-05-28T22:11:05Z","latest_version":1,"primary_category":"cs.DC","snapshot_observed_at":"2026-08-07T12:55:31.298007Z","submitted_at":"2025-05-28T22:11:05Z","title":"Profiling and optimization of multi-card GPU machine learning jobs"},"reference_resolution":{"displayed":37,"state_counts":{"malformed_identifier":0,"metadata_mismatch":3,"parse_uncertain":0,"unresolved":14,"verified_exact":2,"verified_fuzzy":18},"total_outbound_references":37},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 37 of 37 outbound references and 0 inbound Pith citation observations for arXiv:2505.22905."}