{"as_of":"2026-08-11T17:37:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:5bf23522d33a750762c910e4afee9c63e504c5b6bdd288cd2899919ba7494644","coverage":[{"denominator":36,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":36,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-10T17:58:50.578176Z","state":"measured"},{"denominator":36,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":36,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-11T06:34:44.6726+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2501.11771/citation-record","integrity":"/paper/2501.11771/integrity","json":"/paper/2501.11771/citation-record.json","paper":"/paper/2501.11771"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:58:51.212544Z","title":null,"venue":null,"work_id":"e3e5f8b9-9f6e-4ec9-953b-a1bd655604bd","year":2020},"citing_paper":{"arxiv_id":"2501.11771","last_updated":"2025-08-13T19:33:58Z","snapshot_observed_at":"2026-08-11T12:41:37.728679Z","submitted_at":"2025-01-20T22:23:50Z","title":"Characterization of GPU TEE Overheads in Distributed Data Parallel ML Training","version":3},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-10T17:58:50.408949Z"},"links":{"citing_paper":"/paper/2501.11771"},"observation_digest":"sha256:8ae70996b147dc121927a352dd4b645be95de6679d68faead51699e699e2f4ad","observation_id":"4b63f28e-f7db-4bb1-bb1d-b786580948f1","resolution":{"observed_at":"2026-08-10T17:58:51.217122Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:58:51.193478Z","title":"openssl: The open source toolkit for ssl/tls","venue":null,"work_id":"56a5d92f-8dad-4fe1-90ce-7b0d90933a94","year":2024},"citing_paper":{"arxiv_id":"2501.11771","last_updated":"2025-08-13T19:33:58Z","snapshot_observed_at":"2026-08-11T12:41:37.728679Z","submitted_at":"2025-01-20T22:23:50Z","title":"Characterization of GPU TEE Overheads in Distributed Data Parallel ML Training","version":3},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-10T17:58:50.414208Z"},"links":{"citing_paper":"/paper/2501.11771"},"observation_digest":"sha256:e3817eb90440b9b5649846b7908b734314b54d31b0fe9226bfa3724ba0e3e186","observation_id":"36229877-9b51-496f-8607-25bb1c44cdb3","resolution":{"observed_at":"2026-08-10T17:58:51.200960Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:58:51.171294Z","title":"Arm security technology building a secure system using trustzone technology,","venue":null,"work_id":"7e5ebe74-70ac-49d2-8a9b-d2d8eef5fb03","year":2016},"citing_paper":{"arxiv_id":"2501.11771","last_updated":"2025-08-13T19:33:58Z","snapshot_observed_at":"2026-08-11T12:41:37.728679Z","submitted_at":"2025-01-20T22:23:50Z","title":"Characterization of GPU TEE Overheads in Distributed Data Parallel ML Training","version":3},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-10T17:58:50.418382Z"},"links":{"citing_paper":"/paper/2501.11771"},"observation_digest":"sha256:0ffe7bdcb429332bc3f6fd9714255349d18b96419f3b4e3b97978f5362b63aec","observation_id":"ec662ec0-3241-4b14-97c4-676d5577cf23","resolution":{"observed_at":"2026-08-10T17:58:51.178233Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:58:51.152400Z","title":"[Online]","venue":null,"work_id":"f6fd98d6-38d2-4695-b351-560b10bb4504","year":2019},"citing_paper":{"arxiv_id":"2501.11771","last_updated":"2025-08-13T19:33:58Z","snapshot_observed_at":"2026-08-11T12:41:37.728679Z","submitted_at":"2025-01-20T22:23:50Z","title":"Characterization of GPU TEE Overheads in Distributed Data Parallel ML Training","version":3},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-10T17:58:50.422938Z"},"links":{"citing_paper":"/paper/2501.11771"},"observation_digest":"sha256:8a774d44a41a6c6542e717e1f0a2a08d451df25bc4f6a92f439417293649ac6d","observation_id":"c671f151-723e-49dd-914d-d373952ce3bd","resolution":{"observed_at":"2026-08-10T17:58:51.159413Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:58:51.133833Z","title":"Amd secure encrypted virtualization (sev),","venue":null,"work_id":"b4e51dd1-977c-490b-a6f8-75a1dfa883db","year":2024},"citing_paper":{"arxiv_id":"2501.11771","last_updated":"2025-08-13T19:33:58Z","snapshot_observed_at":"2026-08-11T12:41:37.728679Z","submitted_at":"2025-01-20T22:23:50Z","title":"Characterization of GPU TEE Overheads in Distributed Data Parallel ML Training","version":3},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-10T17:58:50.427901Z"},"links":{"citing_paper":"/paper/2501.11771"},"observation_digest":"sha256:f524ce31275f9bfedcc46a8f7945156e34b1e696f4c7ec3e74dd78ffe863ba9d","observation_id":"096bbb95-0005-487f-992c-0acdeb09d169","resolution":{"observed_at":"2026-08-10T17:58:51.140573Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:58:51.102287Z","title":"AMD SEV-TIO: Trusted I/O for Secure Encrypted Virtualiza- tion,","venue":null,"work_id":"dea088d4-315a-43ca-9f3b-9bb947318c52","year":2023},"citing_paper":{"arxiv_id":"2501.11771","last_updated":"2025-08-13T19:33:58Z","snapshot_observed_at":"2026-08-11T12:41:37.728679Z","submitted_at":"2025-01-20T22:23:50Z","title":"Characterization of GPU TEE Overheads in Distributed Data Parallel ML Training","version":3},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-10T17:58:50.432627Z"},"links":{"citing_paper":"/paper/2501.11771"},"observation_digest":"sha256:aa003c5f1f02b7dd3f6d8d16c2785dd182706e1c3841df4df985c3c055cc6816","observation_id":"e2f5f6f5-f676-48b1-a865-e4c0e778bc1b","resolution":{"observed_at":"2026-08-10T17:58:51.109297Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:58:51.077147Z","title":"Biased user history synthesis for personalized long- tail item recommendation,","venue":null,"work_id":"ebbeefa8-6477-4f3e-beff-ea2393929fbf","year":2024},"citing_paper":{"arxiv_id":"2501.11771","last_updated":"2025-08-13T19:33:58Z","snapshot_observed_at":"2026-08-11T12:41:37.728679Z","submitted_at":"2025-01-20T22:23:50Z","title":"Characterization of GPU TEE Overheads in Distributed Data Parallel ML Training","version":3},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-10T17:58:50.437381Z"},"links":{"citing_paper":"/paper/2501.11771"},"observation_digest":"sha256:e77d05baeeab00530f3ec3690b423289f0d8b7255c0e90f873266472e4d1d171","observation_id":"1d50c73b-0a7e-4c21-9fe6-62323622db5c","resolution":{"observed_at":"2026-08-10T17:58:51.085240Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:58:51.058382Z","title":"Logical/physical topology-aware col- lective communication in deep learning training,","venue":null,"work_id":"cb62b934-d1d2-4c4d-a1b6-cf32ca69bc01","year":2023},"citing_paper":{"arxiv_id":"2501.11771","last_updated":"2025-08-13T19:33:58Z","snapshot_observed_at":"2026-08-11T12:41:37.728679Z","submitted_at":"2025-01-20T22:23:50Z","title":"Characterization of GPU TEE Overheads in Distributed Data Parallel ML Training","version":3},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-10T17:58:50.441238Z"},"links":{"citing_paper":"/paper/2501.11771"},"observation_digest":"sha256:4d4203ad0dbe4fbf736f4215822636efeb5a0c05407801be76890fd47940484f","observation_id":"9b6826dd-6341-4e13-9271-59d17b63e3fd","resolution":{"observed_at":"2026-08-10T17:58:51.066251Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:58:51.040477Z","title":"Imagenet: A large-scale hierarchical image database,","venue":null,"work_id":"3db9b65b-cb5f-4708-9c67-ba7acfe1183c","year":2009},"citing_paper":{"arxiv_id":"2501.11771","last_updated":"2025-08-13T19:33:58Z","snapshot_observed_at":"2026-08-11T12:41:37.728679Z","submitted_at":"2025-01-20T22:23:50Z","title":"Characterization of GPU TEE Overheads in Distributed Data Parallel ML Training","version":3},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-10T17:58:50.445466Z"},"links":{"citing_paper":"/paper/2501.11771"},"observation_digest":"sha256:98f00afb905f3668735b5e9b8567b63dd71aa3f8a21f7683f8073e9da10a27d6","observation_id":"b9772523-3b83-4f2e-a8cb-5b837c29eda6","resolution":{"observed_at":"2026-08-10T17:58:51.047902Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1810.04805","last_updated":"2019-05-24T20:37:26Z","snapshot_observed_at":"2026-07-30T09:12:38.100527Z","submitted_at":"2018-10-11T00:50:01Z","title":"BERT: Pre-training of Deep Bidirectional Transformers for Language Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1810.04805","snapshot_observed_at":"2026-08-10T17:58:50.449972Z","title":"Bert: Pre-training of deep bidirectional transformers for language understanding,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2501.11771","last_updated":"2025-08-13T19:33:58Z","snapshot_observed_at":"2026-08-11T12:41:37.728679Z","submitted_at":"2025-01-20T22:23:50Z","title":"Characterization of GPU TEE Overheads in Distributed Data Parallel ML Training","version":3},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-10T17:58:50.449972Z"},"links":{"cited_paper":"/paper/1810.04805","citing_paper":"/paper/2501.11771"},"observation_digest":"sha256:7af9f720dfb0829ede5499c843e2697fec612ecb35088e71b4669edc6ab57204","observation_id":"33b975a1-2906-4ef6-8455-87330486329b","resolution":{"observed_at":"2026-08-10T17:58:50.449972Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:58:51.026436Z","title":"Accelerate: Training and inference at scale made simple, efficient and adaptable","venue":null,"work_id":"72f4d9dd-ee92-45c6-90b3-cf1a998d0313","year":2022},"citing_paper":{"arxiv_id":"2501.11771","last_updated":"2025-08-13T19:33:58Z","snapshot_observed_at":"2026-08-11T12:41:37.728679Z","submitted_at":"2025-01-20T22:23:50Z","title":"Characterization of GPU TEE Overheads in Distributed Data Parallel ML Training","version":3},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-10T17:58:50.454019Z"},"links":{"citing_paper":"/paper/2501.11771"},"observation_digest":"sha256:7623fb4de9cbd23e5c447ff62e9aac011acc5a268aa14f874c9dbef647f60826","observation_id":"efaa7661-eddf-4af8-aee7-41648b6e0a8f","resolution":{"observed_at":"2026-08-10T17:58:51.031063Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:58:51.013807Z","title":"Deep residual learning for image recognition,","venue":null,"work_id":"58fa9a64-d001-4194-9f31-9dff2ca7d4a8","year":2016},"citing_paper":{"arxiv_id":"2501.11771","last_updated":"2025-08-13T19:33:58Z","snapshot_observed_at":"2026-08-11T12:41:37.728679Z","submitted_at":"2025-01-20T22:23:50Z","title":"Characterization of GPU TEE Overheads in Distributed Data Parallel ML Training","version":3},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-10T17:58:50.458348Z"},"links":{"citing_paper":"/paper/2501.11771"},"observation_digest":"sha256:eb83ab059b5f6e8435f108bc96d8c68f0286f2572e0d36015cb19d03389c848d","observation_id":"8f422dd7-5857-401a-9cf1-775b023b2004","resolution":{"observed_at":"2026-08-10T17:58:51.018350Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:58:50.998430Z","title":"Gpipe: Efficient training of giant neural networks using pipeline parallelism,","venue":null,"work_id":"0e7dee31-6638-4217-a2eb-c67750565818","year":2019},"citing_paper":{"arxiv_id":"2501.11771","last_updated":"2025-08-13T19:33:58Z","snapshot_observed_at":"2026-08-11T12:41:37.728679Z","submitted_at":"2025-01-20T22:23:50Z","title":"Characterization of GPU TEE Overheads in Distributed Data Parallel ML Training","version":3},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-10T17:58:50.469603Z"},"links":{"citing_paper":"/paper/2501.11771"},"observation_digest":"sha256:fe611492ce26f28c361659d3645384bc7256a43eff62dddcaa180ebcb55a8249","observation_id":"1cffe10f-7d69-4e41-908a-b4efac65981c","resolution":{"observed_at":"2026-08-10T17:58:51.004564Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:58:50.982388Z","title":"Intel trust domain extensions,","venue":null,"work_id":"baacecfb-4847-4763-a24d-7ccbb16db54c","year":2024},"citing_paper":{"arxiv_id":"2501.11771","last_updated":"2025-08-13T19:33:58Z","snapshot_observed_at":"2026-08-11T12:41:37.728679Z","submitted_at":"2025-01-20T22:23:50Z","title":"Characterization of GPU TEE Overheads in Distributed Data Parallel ML Training","version":3},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-10T17:58:50.474050Z"},"links":{"citing_paper":"/paper/2501.11771"},"observation_digest":"sha256:9f573b0ab20c673e8860d51f3edb83b6901f14f65b961fd1194f5ef9d1970882","observation_id":"fc442cf9-79cf-4c07-ac64-879198b1d978","resolution":{"observed_at":"2026-08-10T17:58:50.987267Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:58:50.965332Z","title":"Intel TDX Connect TEE-IO Device Guide,","venue":null,"work_id":"c75e554e-3598-42d5-9199-0aa5758c13d6","year":2023},"citing_paper":{"arxiv_id":"2501.11771","last_updated":"2025-08-13T19:33:58Z","snapshot_observed_at":"2026-08-11T12:41:37.728679Z","submitted_at":"2025-01-20T22:23:50Z","title":"Characterization of GPU TEE Overheads in Distributed Data Parallel ML Training","version":3},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-10T17:58:50.479316Z"},"links":{"citing_paper":"/paper/2501.11771"},"observation_digest":"sha256:8fa6087b486025132527fd257be6a553944649a6b6efbb0ab2e8a703e44f444c","observation_id":"a1b6bf93-6481-43e9-9102-fcb785c4b8ce","resolution":{"observed_at":"2026-08-10T17:58:50.970687Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:58:50.951924Z","title":"Hugging face,","venue":null,"work_id":"d06ad198-e54c-432a-af72-86a54d5e7a1f","year":2022},"citing_paper":{"arxiv_id":"2501.11771","last_updated":"2025-08-13T19:33:58Z","snapshot_observed_at":"2026-08-11T12:41:37.728679Z","submitted_at":"2025-01-20T22:23:50Z","title":"Characterization of GPU TEE Overheads in Distributed Data Parallel ML Training","version":3},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-10T17:58:50.485358Z"},"links":{"citing_paper":"/paper/2501.11771"},"observation_digest":"sha256:01d30e9e9699e863c057aacbae5e0d5333a3b49feb2c1d6b55836fabe9fcc5e6","observation_id":"44e0ca87-2bc2-483d-bfa5-b1daeeaff884","resolution":{"observed_at":"2026-08-10T17:58:50.956281Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:58:50.936988Z","title":"Intel software guard extensions: Epid provisioning and attestation services,","venue":null,"work_id":"1a360774-3cf9-4dde-82be-a644929e1913","year":2016},"citing_paper":{"arxiv_id":"2501.11771","last_updated":"2025-08-13T19:33:58Z","snapshot_observed_at":"2026-08-11T12:41:37.728679Z","submitted_at":"2025-01-20T22:23:50Z","title":"Characterization of GPU TEE Overheads in Distributed Data Parallel ML Training","version":3},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-10T17:58:50.493168Z"},"links":{"citing_paper":"/paper/2501.11771"},"observation_digest":"sha256:4cc76a49351ed0c9989a0b10892364dd44d4413f41f6a0d01af07bb74f8fc6f8","observation_id":"830d18c9-a941-4100-b3a7-c1b15f24fbca","resolution":{"observed_at":"2026-08-10T17:58:50.941968Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2006.15704","last_updated":"2020-06-28T20:39:45Z","snapshot_observed_at":"2026-07-06T09:33:26.082100Z","submitted_at":"2020-06-28T20:39:45Z","title":"PyTorch Distributed: Experiences on Accelerating Data Parallel Training","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2006.15704","snapshot_observed_at":"2026-08-10T17:58:50.498388Z","title":"Pytorch distributed: Experiences on accelerating data parallel training,","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2501.11771","last_updated":"2025-08-13T19:33:58Z","snapshot_observed_at":"2026-08-11T12:41:37.728679Z","submitted_at":"2025-01-20T22:23:50Z","title":"Characterization of GPU TEE Overheads in Distributed Data Parallel ML Training","version":3},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-10T17:58:50.498388Z"},"links":{"cited_paper":"/paper/2006.15704","citing_paper":"/paper/2501.11771"},"observation_digest":"sha256:955a6ce1495d10765430de1ef855191302e3bd6be6704aa5e0b15161930dbc7a","observation_id":"671793b5-95dc-4b4d-8ec5-b20137417b09","resolution":{"observed_at":"2026-08-10T17:58:50.498388Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:58:50.921381Z","title":"Azure confidential vms with nvidia h100 tensor core gpus,","venue":null,"work_id":"31a0f840-e5b0-4185-beb0-51ccd09bb971","year":2024},"citing_paper":{"arxiv_id":"2501.11771","last_updated":"2025-08-13T19:33:58Z","snapshot_observed_at":"2026-08-11T12:41:37.728679Z","submitted_at":"2025-01-20T22:23:50Z","title":"Characterization of GPU TEE Overheads in Distributed Data Parallel ML Training","version":3},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-10T17:58:50.502632Z"},"links":{"citing_paper":"/paper/2501.11771"},"observation_digest":"sha256:4a09690d416d712c918f8af55926eecf9880f231dda00083a471883eadaa8104","observation_id":"478fc7d2-eb57-4de7-86e1-78fc404d48db","resolution":{"observed_at":"2026-08-10T17:58:50.927154Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:58:50.901439Z","title":"Securing ai inference in the cloud: Is cpu-gpu confidential computing ready?","venue":null,"work_id":"dc693e1a-7a3d-4d75-b0c1-5e05ca55fb0a","year":2024},"citing_paper":{"arxiv_id":"2501.11771","last_updated":"2025-08-13T19:33:58Z","snapshot_observed_at":"2026-08-11T12:41:37.728679Z","submitted_at":"2025-01-20T22:23:50Z","title":"Characterization of GPU TEE Overheads in Distributed Data Parallel ML Training","version":3},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-10T17:58:50.507340Z"},"links":{"citing_paper":"/paper/2501.11771"},"observation_digest":"sha256:ad6c6c31d814bfacafde4b9ae8f45f0512d71d71e6196b4fefc36afa96bdb0f1","observation_id":"f6515a91-9724-467e-bd19-324f8579124d","resolution":{"observed_at":"2026-08-10T17:58:50.906803Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:58:50.883832Z","title":"Supporting secure multi-gpu computing with dynamic and batched metadata management,","venue":null,"work_id":"dc8da6fd-6202-4f55-93bf-7e54ef7493cd","year":2024},"citing_paper":{"arxiv_id":"2501.11771","last_updated":"2025-08-13T19:33:58Z","snapshot_observed_at":"2026-08-11T12:41:37.728679Z","submitted_at":"2025-01-20T22:23:50Z","title":"Characterization of GPU TEE Overheads in Distributed Data Parallel ML Training","version":3},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-10T17:58:50.511354Z"},"links":{"citing_paper":"/paper/2501.11771"},"observation_digest":"sha256:9b445c05bc087994d4ad98e54d2009f3aab458f2226779ee4b06215abefbb856","observation_id":"aa3c3e6b-b8ae-4a1d-9a70-afdd73b69b09","resolution":{"observed_at":"2026-08-10T17:58:50.889843Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2010.00133","last_updated":"2020-09-30T22:38:40Z","snapshot_observed_at":"2026-08-01T09:26:19.649537Z","submitted_at":"2020-09-30T22:38:40Z","title":"CrowS-Pairs: A Challenge Dataset for Measuring Social Biases in Masked Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.00133","snapshot_observed_at":"2026-08-10T17:58:50.514894Z","title":"Crows-pairs: A challenge dataset for measuring social biases in masked language models,","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2501.11771","last_updated":"2025-08-13T19:33:58Z","snapshot_observed_at":"2026-08-11T12:41:37.728679Z","submitted_at":"2025-01-20T22:23:50Z","title":"Characterization of GPU TEE Overheads in Distributed Data Parallel ML Training","version":3},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-10T17:58:50.514894Z"},"links":{"cited_paper":"/paper/2010.00133","citing_paper":"/paper/2501.11771"},"observation_digest":"sha256:2d0e62432c114648e2f8a73f1c441579d7a7817715759c92e189838be97459fd","observation_id":"33cef1dc-3ac0-4f89-9cb2-24d67e81fea5","resolution":{"observed_at":"2026-08-10T17:58:50.514894Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:58:50.869372Z","title":"Nvidia blackwell architecture technical brief,","venue":null,"work_id":"7df2db79-8bff-4579-92fd-614a42614c54","year":2024},"citing_paper":{"arxiv_id":"2501.11771","last_updated":"2025-08-13T19:33:58Z","snapshot_observed_at":"2026-08-11T12:41:37.728679Z","submitted_at":"2025-01-20T22:23:50Z","title":"Characterization of GPU TEE Overheads in Distributed Data Parallel ML Training","version":3},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-10T17:58:50.518645Z"},"links":{"citing_paper":"/paper/2501.11771"},"observation_digest":"sha256:7283035493f04254be0d5e4c17e46c2d442cae98a92a66ad92b0bd9938efa1b5","observation_id":"0f00c088-8411-4729-a05c-a8d0836988de","resolution":{"observed_at":"2026-08-10T17:58:50.873572Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:58:50.854525Z","title":"Nvidia confidential computing,","venue":null,"work_id":"4915a55b-65e8-44b5-802e-13aea57e2e10","year":2024},"citing_paper":{"arxiv_id":"2501.11771","last_updated":"2025-08-13T19:33:58Z","snapshot_observed_at":"2026-08-11T12:41:37.728679Z","submitted_at":"2025-01-20T22:23:50Z","title":"Characterization of GPU TEE Overheads in Distributed Data Parallel ML Training","version":3},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-10T17:58:50.522672Z"},"links":{"citing_paper":"/paper/2501.11771"},"observation_digest":"sha256:901b20815a3ae6d7822208901a79c8fa9d046b2de8ccf08f5d7067ef5ff51d40","observation_id":"7d8d8969-10ee-4d52-a3e4-81ee0daccda2","resolution":{"observed_at":"2026-08-10T17:58:50.858581Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:58:50.839917Z","title":"Nvidia confidential computing protected pcie,","venue":null,"work_id":"1f070ff3-bd94-4acc-9ebb-994a3c77a665","year":2025},"citing_paper":{"arxiv_id":"2501.11771","last_updated":"2025-08-13T19:33:58Z","snapshot_observed_at":"2026-08-11T12:41:37.728679Z","submitted_at":"2025-01-20T22:23:50Z","title":"Characterization of GPU TEE Overheads in Distributed Data Parallel ML Training","version":3},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-10T17:58:50.526324Z"},"links":{"citing_paper":"/paper/2501.11771"},"observation_digest":"sha256:3c96ef45e2c04e5a32da9200894cc7983bcefd8beb8638914450bf47a3f87665","observation_id":"fcc673bf-eb7f-41e3-a96d-19c8ccf5d87c","resolution":{"observed_at":"2026-08-10T17:58:50.845068Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:58:50.817236Z","title":"Nvidia h100 tensor core gpu architecture overview,","venue":null,"work_id":"92860668-e06d-424d-bb92-ee82277d254b","year":2022},"citing_paper":{"arxiv_id":"2501.11771","last_updated":"2025-08-13T19:33:58Z","snapshot_observed_at":"2026-08-11T12:41:37.728679Z","submitted_at":"2025-01-20T22:23:50Z","title":"Characterization of GPU TEE Overheads in Distributed Data Parallel ML Training","version":3},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-10T17:58:50.531128Z"},"links":{"citing_paper":"/paper/2501.11771"},"observation_digest":"sha256:b82ac9035c14b4d900e069cf7cc471421661b6926f89ca9e704566c4c8806967","observation_id":"2e54352e-6bb9-4634-9a4b-f6f133825eed","resolution":{"observed_at":"2026-08-10T17:58:50.826207Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:58:50.802579Z","title":"Nvidia rtx pro blackwell architecture,","venue":null,"work_id":"cabe85ed-d720-44fb-9c87-b82be6acc81e","year":2025},"citing_paper":{"arxiv_id":"2501.11771","last_updated":"2025-08-13T19:33:58Z","snapshot_observed_at":"2026-08-11T12:41:37.728679Z","submitted_at":"2025-01-20T22:23:50Z","title":"Characterization of GPU TEE Overheads in Distributed Data Parallel ML Training","version":3},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-10T17:58:50.535379Z"},"links":{"citing_paper":"/paper/2501.11771"},"observation_digest":"sha256:b125f0198d7b763ae14769f454ba690a60555a62d6edc0e193cdb411314fdfa1","observation_id":"b55d250f-a279-4f7a-8663-d68d371c84b8","resolution":{"observed_at":"2026-08-10T17:58:50.806800Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:58:50.785155Z","title":"Language models are unsupervised multitask learners,","venue":null,"work_id":"58f2fd8f-ebc7-42ed-be94-0e0da9e31311","year":2019},"citing_paper":{"arxiv_id":"2501.11771","last_updated":"2025-08-13T19:33:58Z","snapshot_observed_at":"2026-08-11T12:41:37.728679Z","submitted_at":"2025-01-20T22:23:50Z","title":"Characterization of GPU TEE Overheads in Distributed Data Parallel ML Training","version":3},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-10T17:58:50.539403Z"},"links":{"citing_paper":"/paper/2501.11771"},"observation_digest":"sha256:1d2d34412d30c3aaa371ab0ba867f3915f5dad09707bca471ea932b26c756d08","observation_id":"527aa1eb-e8f3-4695-bd4a-9a2795d25de3","resolution":{"observed_at":"2026-08-10T17:58:50.790074Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:58:50.771528Z","title":"Deepspeed: System optimizations enable training deep learning models with over 100 billion parameters,","venue":null,"work_id":"25b1760d-d258-431e-9da9-3779dd4beb70","year":2020},"citing_paper":{"arxiv_id":"2501.11771","last_updated":"2025-08-13T19:33:58Z","snapshot_observed_at":"2026-08-11T12:41:37.728679Z","submitted_at":"2025-01-20T22:23:50Z","title":"Characterization of GPU TEE Overheads in Distributed Data Parallel ML Training","version":3},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-10T17:58:50.544017Z"},"links":{"citing_paper":"/paper/2501.11771"},"observation_digest":"sha256:822edc451de200cfc9cff87cab90a232b254c96f17abc460141ce04784e8e26b","observation_id":"d4e52ba8-6504-4830-bf5d-ce5b9599149d","resolution":{"observed_at":"2026-08-10T17:58:50.775876Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:58:50.756385Z","title":"Performance analysis and optimization of nvidia h100 confidential computing for ai workloads,","venue":null,"work_id":"7d834c19-bdc1-454d-bd3b-7b592766b7e6","year":2024},"citing_paper":{"arxiv_id":"2501.11771","last_updated":"2025-08-13T19:33:58Z","snapshot_observed_at":"2026-08-11T12:41:37.728679Z","submitted_at":"2025-01-20T22:23:50Z","title":"Characterization of GPU TEE Overheads in Distributed Data Parallel ML Training","version":3},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-10T17:58:50.548949Z"},"links":{"citing_paper":"/paper/2501.11771"},"observation_digest":"sha256:655575da6f99e6da2e0a06f007ff5072229ec1d03b0c5628e418aa07289fe611","observation_id":"0a608a50-90fc-495f-8236-5906c5196a4b","resolution":{"observed_at":"2026-08-10T17:58:50.761158Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:58:50.741594Z","title":"Pipellm: Fast and confidential large language model services with speculative pipelined encryption,","venue":null,"work_id":"6c370ae3-b999-4b5f-803f-84482eafc8cb","year":2025},"citing_paper":{"arxiv_id":"2501.11771","last_updated":"2025-08-13T19:33:58Z","snapshot_observed_at":"2026-08-11T12:41:37.728679Z","submitted_at":"2025-01-20T22:23:50Z","title":"Characterization of GPU TEE Overheads in Distributed Data Parallel ML Training","version":3},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-10T17:58:50.553523Z"},"links":{"citing_paper":"/paper/2501.11771"},"observation_digest":"sha256:963be4186db164826d6a35b0a8942a64b600f72119ae2ac6c63a4d3c9f252cec","observation_id":"817fff2e-ffe0-4021-9d50-3c7cdcfc4f00","resolution":{"observed_at":"2026-08-10T17:58:50.746556Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1804.07461","last_updated":"2019-02-22T23:53:34Z","snapshot_observed_at":"2026-07-06T06:34:26.609892Z","submitted_at":"2018-04-20T06:35:04Z","title":"GLUE: A Multi-Task Benchmark and Analysis Platform for Natural Language Understanding","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1804.07461","snapshot_observed_at":"2026-08-10T17:58:50.558126Z","title":"Glue: A multi-task benchmark and analysis platform for natural language understanding,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2501.11771","last_updated":"2025-08-13T19:33:58Z","snapshot_observed_at":"2026-08-11T12:41:37.728679Z","submitted_at":"2025-01-20T22:23:50Z","title":"Characterization of GPU TEE Overheads in Distributed Data Parallel ML Training","version":3},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-10T17:58:50.558126Z"},"links":{"cited_paper":"/paper/1804.07461","citing_paper":"/paper/2501.11771"},"observation_digest":"sha256:10e547669978e0b1eb74f55ba8caf04f007b6978a7ae9c1b27510ab8d4286ebb","observation_id":"d6d40d0d-adc5-4011-8745-606f73d9f83b","resolution":{"observed_at":"2026-08-10T17:58:50.558126Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.15240","last_updated":"2024-10-20T01:00:33Z","snapshot_observed_at":"2026-07-06T19:36:32.581033Z","submitted_at":"2024-10-20T01:00:33Z","title":"Fastrack: Fast IO for Secure ML using GPU TEEs","version":1},"cited_work":{"arxiv_id":"2410.15240","doi":null,"metadata_source":"pith","pith_arxiv_id":"2410.15240","snapshot_observed_at":"2026-08-10T17:58:50.652214Z","title":"Fastrack: Fast IO for Secure ML using GPU TEEs","venue":"cs.CR","work_id":"2ce809ab-b766-4be4-836d-41243edf6cda","year":2024},"citing_paper":{"arxiv_id":"2501.11771","last_updated":"2025-08-13T19:33:58Z","snapshot_observed_at":"2026-08-11T12:41:37.728679Z","submitted_at":"2025-01-20T22:23:50Z","title":"Characterization of GPU TEE Overheads in Distributed Data Parallel ML Training","version":3},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-10T17:58:50.562811Z"},"links":{"cited_paper":"/paper/2410.15240","citing_paper":"/paper/2501.11771"},"observation_digest":"sha256:062e00cbfce140fa13fd772f75ea810bca5cdc6c21dacea93008dc6acb907733","observation_id":"cf779ad6-b6a7-4cb5-bde5-17d7eb3ac66f","resolution":{"observed_at":"2026-08-10T17:58:50.659311Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:58:50.727981Z","title":"Sampling-bias-corrected neural modeling for large corpus item recommendations,","venue":null,"work_id":"aae0f0e3-e167-4822-9c7e-e3edf18ed34c","year":2019},"citing_paper":{"arxiv_id":"2501.11771","last_updated":"2025-08-13T19:33:58Z","snapshot_observed_at":"2026-08-11T12:41:37.728679Z","submitted_at":"2025-01-20T22:23:50Z","title":"Characterization of GPU TEE Overheads in Distributed Data Parallel ML Training","version":3},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-10T17:58:50.568412Z"},"links":{"citing_paper":"/paper/2501.11771"},"observation_digest":"sha256:8cbe032524ce5e8ff8815bbd1255ae002ce8cc894505d8dbaf476fa7a7796bee","observation_id":"02d4eb29-fc60-48df-ada0-245ea006972a","resolution":{"observed_at":"2026-08-10T17:58:50.732582Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.11277","last_updated":"2023-09-12T16:28:00Z","snapshot_observed_at":"2026-08-01T19:01:47.393546Z","submitted_at":"2023-04-21T23:52:27Z","title":"PyTorch FSDP: Experiences on Scaling Fully Sharded Data Parallel","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.11277","snapshot_observed_at":"2026-08-10T17:58:50.573400Z","title":"Pytorch fsdp: experiences on scaling fully sharded data parallel,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.11771","last_updated":"2025-08-13T19:33:58Z","snapshot_observed_at":"2026-08-11T12:41:37.728679Z","submitted_at":"2025-01-20T22:23:50Z","title":"Characterization of GPU TEE Overheads in Distributed Data Parallel ML Training","version":3},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-10T17:58:50.573400Z"},"links":{"cited_paper":"/paper/2304.11277","citing_paper":"/paper/2501.11771"},"observation_digest":"sha256:260c222079dd8bcc692bccd623d7141273de24a52873ba6ffbbeae8d6ed3b3d9","observation_id":"d47e6977-df76-49ce-a46d-39e24005b275","resolution":{"observed_at":"2026-08-10T17:58:50.573400Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.03992","last_updated":"2024-11-05T16:57:26Z","snapshot_observed_at":"2026-08-10T03:45:48.476846Z","submitted_at":"2024-09-06T02:44:27Z","title":"Confidential Computing on NVIDIA Hopper GPUs: A Performance Benchmark Study","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.03992","snapshot_observed_at":"2026-08-10T17:58:50.578176Z","title":"Confidential computing on nvidia hopper gpus: A performance benchmark study,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.11771","last_updated":"2025-08-13T19:33:58Z","snapshot_observed_at":"2026-08-11T12:41:37.728679Z","submitted_at":"2025-01-20T22:23:50Z","title":"Characterization of GPU TEE Overheads in Distributed Data Parallel ML Training","version":3},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-10T17:58:50.578176Z"},"links":{"cited_paper":"/paper/2409.03992","citing_paper":"/paper/2501.11771"},"observation_digest":"sha256:5f1105243146d117d4adecb75c6ad07d89ff2223527ea22a17af9c4cb6f8762c","observation_id":"7180e3ba-c0a2-4e2f-9f3d-c9a428151ada","resolution":{"observed_at":"2026-08-10T17:58:50.578176Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2501.11771","last_updated":"2025-08-13T19:33:58Z","latest_version":3,"primary_category":"cs.CR","snapshot_observed_at":"2026-08-11T12:41:37.728679Z","submitted_at":"2025-01-20T22:23:50Z","title":"Characterization of GPU TEE Overheads in Distributed Data Parallel ML Training"},"reference_resolution":{"displayed":36,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":7,"verified_exact":1,"verified_fuzzy":28},"total_outbound_references":36},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"thesis":"As of 11 August 2026, this Paper Citation Record lists 36 of 36 outbound references and 0 inbound Pith citation observations for arXiv:2501.11771."}