{"as_of":"2026-08-08T10:40:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:f3a8b08af90f3953f44976a2dfd6d465208c1c2435de60115be7c60abb4215ba","coverage":[{"denominator":54,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":54,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T13:30:25.024913Z","state":"measured"},{"denominator":55,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":55,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-01T04:49:45.955512Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.21661","last_updated":"2025-05-27T18:38:15Z","snapshot_observed_at":"2026-08-07T13:23:13.202211Z","submitted_at":"2025-05-27T18:38:15Z","title":"KPerfIR: Towards an Open and Compiler-centric Ecosystem for GPU Kernel Performance Tooling on Modern AI Workloads","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.21661","snapshot_observed_at":"2026-08-01T04:49:45.955512Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.22432","last_updated":"2026-07-24T15:50:23Z","snapshot_observed_at":"2026-08-06T21:57:48.528474Z","submitted_at":"2026-07-24T15:50:23Z","title":"TileSight: A First-Principles Tile-Centric Analytical GPU Performance Model from Cores to Clusters","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-01T04:49:45.955512Z"},"links":{"cited_paper":"/paper/2505.21661","citing_paper":"/paper/2607.22432"},"observation_digest":"sha256:c03386ce5294acd425b75fa852c5a27492570f444eca9aa6cca3fb74a0e87b76","observation_id":"d12f834c-5d30-49cb-94e8-e4e59f0174e5","resolution":{"observed_at":"2026-08-01T04:49:45.955512Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2505.21661/citation-record","integrity":"/paper/2505.21661/integrity","json":"/paper/2505.21661/citation-record.json","paper":"/paper/2505.21661"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:30:34.410136Z","title":"AMD CDNA 3 Architec- ture, 2024","venue":null,"work_id":"2ad45838-eb8e-4394-8e79-2450d632e193","year":2024},"citing_paper":{"arxiv_id":"2505.21661","last_updated":"2025-05-27T18:38:15Z","snapshot_observed_at":"2026-08-07T13:23:13.202211Z","submitted_at":"2025-05-27T18:38:15Z","title":"KPerfIR: Towards an Open and Compiler-centric Ecosystem for GPU Kernel Performance Tooling on Modern AI Workloads","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T13:30:19.545522Z"},"links":{"citing_paper":"/paper/2505.21661"},"observation_digest":"sha256:764ecf78c2067c7f02bedc90975163cf3ec6fef30d79a66dc50679b607d4a9b6","observation_id":"2e344e02-b01f-4ccc-ba02-e4205fe72d85","resolution":{"observed_at":"2026-08-07T13:30:34.500256Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:30:34.224623Z","title":"AMD Instinct MI300","venue":null,"work_id":"89763909-a17f-4f8f-83d9-e86c8570ac43","year":2024},"citing_paper":{"arxiv_id":"2505.21661","last_updated":"2025-05-27T18:38:15Z","snapshot_observed_at":"2026-08-07T13:23:13.202211Z","submitted_at":"2025-05-27T18:38:15Z","title":"KPerfIR: Towards an Open and Compiler-centric Ecosystem for GPU Kernel Performance Tooling on Modern AI Workloads","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T13:30:19.671071Z"},"links":{"citing_paper":"/paper/2505.21661"},"observation_digest":"sha256:8b5e954ab7843d00e140de2254394b307dc842b378c4bb79b722143ef1187725","observation_id":"2eb6d586-4189-48eb-b105-842caf372f90","resolution":{"observed_at":"2026-08-07T13:30:34.344389Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:30:33.996340Z","title":"Composable kernel (CK) library, 2024","venue":null,"work_id":"a020a6fb-8562-4988-abe7-7bd8d97d7fce","year":2024},"citing_paper":{"arxiv_id":"2505.21661","last_updated":"2025-05-27T18:38:15Z","snapshot_observed_at":"2026-08-07T13:23:13.202211Z","submitted_at":"2025-05-27T18:38:15Z","title":"KPerfIR: Towards an Open and Compiler-centric Ecosystem for GPU Kernel Performance Tooling on Modern AI Workloads","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T13:30:19.807153Z"},"links":{"citing_paper":"/paper/2505.21661"},"observation_digest":"sha256:e1a3471408a9704dd07a5e6d48ccd92e6fd373407d83d08b2bfe55e04ea78c99","observation_id":"73eeba50-5079-4895-9db1-e035931c4531","resolution":{"observed_at":"2026-08-07T13:30:34.049128Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:30:33.819189Z","title":"ROCm ROCProfiler, 2024","venue":null,"work_id":"1f5cc481-4cb3-4b4a-b44a-51b17bb7ba95","year":2024},"citing_paper":{"arxiv_id":"2505.21661","last_updated":"2025-05-27T18:38:15Z","snapshot_observed_at":"2026-08-07T13:23:13.202211Z","submitted_at":"2025-05-27T18:38:15Z","title":"KPerfIR: Towards an Open and Compiler-centric Ecosystem for GPU Kernel Performance Tooling on Modern AI Workloads","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T13:30:19.964826Z"},"links":{"citing_paper":"/paper/2505.21661"},"observation_digest":"sha256:7a4a74409ad9907bc34e2f1e20b7d8d416b822082d7ef4db7f509f1cac06381f","observation_id":"e39d64f4-f18f-440c-9dfa-b1e9d0d2d5b1","resolution":{"observed_at":"2026-08-07T13:30:33.896032Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:30:33.661404Z","title":"Version 6.2.4","venue":null,"work_id":"3a874919-578f-4706-9893-c696d6f9d69e","year":2024},"citing_paper":{"arxiv_id":"2505.21661","last_updated":"2025-05-27T18:38:15Z","snapshot_observed_at":"2026-08-07T13:23:13.202211Z","submitted_at":"2025-05-27T18:38:15Z","title":"KPerfIR: Towards an Open and Compiler-centric Ecosystem for GPU Kernel Performance Tooling on Modern AI Workloads","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T13:30:20.062588Z"},"links":{"citing_paper":"/paper/2505.21661"},"observation_digest":"sha256:7e178d1e3ccc358aa04c77b086ecbd10d12f12b845c78d9a11a9f4bb0c92f84b","observation_id":"27487e3b-0f90-4d32-8a29-b566a845e40f","resolution":{"observed_at":"2026-08-07T13:30:33.736971Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:30:33.463483Z","title":"rocBLAS Library, 2023","venue":null,"work_id":"a9f31f10-fc7c-4eb4-bde9-8bb57ff16bf3","year":2023},"citing_paper":{"arxiv_id":"2505.21661","last_updated":"2025-05-27T18:38:15Z","snapshot_observed_at":"2026-08-07T13:23:13.202211Z","submitted_at":"2025-05-27T18:38:15Z","title":"KPerfIR: Towards an Open and Compiler-centric Ecosystem for GPU Kernel Performance Tooling on Modern AI Workloads","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T13:30:20.161638Z"},"links":{"citing_paper":"/paper/2505.21661"},"observation_digest":"sha256:085b2526ee90e488f441c2c2336ba776fe9257934849c770b45b821d9690ba16","observation_id":"290f3855-9c35-42cf-9d0e-12e558601a81","resolution":{"observed_at":"2026-08-07T13:30:33.571161Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:30:33.246233Z","title":"Pytorch 2: Faster machine learning through dynamic python bytecode transformation and graph compilation","venue":null,"work_id":"89582db2-6ef4-4b9b-9cc1-26fc328768ab","year":2024},"citing_paper":{"arxiv_id":"2505.21661","last_updated":"2025-05-27T18:38:15Z","snapshot_observed_at":"2026-08-07T13:23:13.202211Z","submitted_at":"2025-05-27T18:38:15Z","title":"KPerfIR: Towards an Open and Compiler-centric Ecosystem for GPU Kernel Performance Tooling on Modern AI Workloads","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T13:30:20.365005Z"},"links":{"citing_paper":"/paper/2505.21661"},"observation_digest":"sha256:fe77bbf30dfb8172eeaee416946c634dce3bb6a43bbcc402f18a786925768526","observation_id":"57e3bd36-2b97-4be7-a9c8-1f223975e3b9","resolution":{"observed_at":"2026-08-07T13:30:33.368927Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:30:33.034753Z","title":"Cu- daDMA: optimizing GPU memory bandwidth via warp specialization","venue":null,"work_id":"d9fce6c8-3d18-4733-b695-dddbf17d8d35","year":2011},"citing_paper":{"arxiv_id":"2505.21661","last_updated":"2025-05-27T18:38:15Z","snapshot_observed_at":"2026-08-07T13:23:13.202211Z","submitted_at":"2025-05-27T18:38:15Z","title":"KPerfIR: Towards an Open and Compiler-centric Ecosystem for GPU Kernel Performance Tooling on Modern AI Workloads","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T13:30:20.495238Z"},"links":{"citing_paper":"/paper/2505.21661"},"observation_digest":"sha256:e2fb9473035ca43a87ac90f59c20f4bc8290075d3acba6e70dbdb7ce2a86d579","observation_id":"7bfcd8d2-17c6-40eb-8dd6-42d58241f38d","resolution":{"observed_at":"2026-08-07T13:30:33.159266Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:30:32.856671Z","title":"Hatchet: Pruning the overgrowth in parallel profiles","venue":null,"work_id":"a23387e6-29cf-4a5f-a580-ef5eda3666ec","year":2019},"citing_paper":{"arxiv_id":"2505.21661","last_updated":"2025-05-27T18:38:15Z","snapshot_observed_at":"2026-08-07T13:23:13.202211Z","submitted_at":"2025-05-27T18:38:15Z","title":"KPerfIR: Towards an Open and Compiler-centric Ecosystem for GPU Kernel Performance Tooling on Modern AI Workloads","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T13:30:20.624754Z"},"links":{"citing_paper":"/paper/2505.21661"},"observation_digest":"sha256:74de55dcc340778751da5fc9b4036c7cb4b4e45fb6c5e3c89bda369746a109fb","observation_id":"9d5e68d6-583b-4ea5-ac8b-3fed454b7474","resolution":{"observed_at":"2026-08-07T13:30:32.924612Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:30:20.844831Z","title":"JAX: com- posable transformations of Python+NumPy programs, 2018","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2505.21661","last_updated":"2025-05-27T18:38:15Z","snapshot_observed_at":"2026-08-07T13:23:13.202211Z","submitted_at":"2025-05-27T18:38:15Z","title":"KPerfIR: Towards an Open and Compiler-centric Ecosystem for GPU Kernel Performance Tooling on Modern AI Workloads","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T13:30:20.844831Z"},"links":{"citing_paper":"/paper/2505.21661"},"observation_digest":"sha256:420e9c6e23009114c3a04bd2cacba2d51ebf979b476505b0c386d88a399e453a","observation_id":"56db27a6-5958-4258-9476-5d40c9cf77d1","resolution":{"observed_at":"2026-08-07T13:30:20.844831Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2005.14165","last_updated":"2020-07-22T19:47:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-05-28T17:29:03Z","title":"Language Models are Few-Shot Learners","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2005.14165","snapshot_observed_at":"2026-08-07T13:30:20.955014Z","title":"Language models are few-shot learners","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2505.21661","last_updated":"2025-05-27T18:38:15Z","snapshot_observed_at":"2026-08-07T13:23:13.202211Z","submitted_at":"2025-05-27T18:38:15Z","title":"KPerfIR: Towards an Open and Compiler-centric Ecosystem for GPU Kernel Performance Tooling on Modern AI Workloads","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T13:30:20.955014Z"},"links":{"cited_paper":"/paper/2005.14165","citing_paper":"/paper/2505.21661"},"observation_digest":"sha256:41c687435bf7fea979b9db273833be5f273464e7a4e40da30057974c307ca912","observation_id":"af6e44c1-3fa5-454f-84a2-9114f38f6aa6","resolution":{"observed_at":"2026-08-07T13:30:20.955014Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.06858","last_updated":"2024-10-23T18:45:33Z","snapshot_observed_at":"2026-08-07T05:35:13.505081Z","submitted_at":"2024-06-11T00:17:39Z","title":"FLUX: Fast Software-based Communication Overlap On GPUs Through Kernel Fusion","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.06858","snapshot_observed_at":"2026-08-07T13:30:21.095644Z","title":"Flux: fast software-based communication overlap on gpus through kernel fusion","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.21661","last_updated":"2025-05-27T18:38:15Z","snapshot_observed_at":"2026-08-07T13:23:13.202211Z","submitted_at":"2025-05-27T18:38:15Z","title":"KPerfIR: Towards an Open and Compiler-centric Ecosystem for GPU Kernel Performance Tooling on Modern AI Workloads","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T13:30:21.095644Z"},"links":{"cited_paper":"/paper/2406.06858","citing_paper":"/paper/2505.21661"},"observation_digest":"sha256:b01c96a2a35b0e687a67353d382004eb77f5637c0586a47a12d7416283bfd6b6","observation_id":"12e87fc3-18af-4c55-805c-fde39d1251fd","resolution":{"observed_at":"2026-08-07T13:30:21.095644Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:30:21.169914Z","title":"{TVM}: An automated {End-to-End} optimizing compiler for deep learning","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2505.21661","last_updated":"2025-05-27T18:38:15Z","snapshot_observed_at":"2026-08-07T13:23:13.202211Z","submitted_at":"2025-05-27T18:38:15Z","title":"KPerfIR: Towards an Open and Compiler-centric Ecosystem for GPU Kernel Performance Tooling on Modern AI Workloads","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T13:30:21.169914Z"},"links":{"citing_paper":"/paper/2505.21661"},"observation_digest":"sha256:ab23e999d3dd048bac94732ceeacc431e209a26995b517c6f8f1e96a18594b6a","observation_id":"e8ee2ef3-9316-4ea0-9c1e-03a139372fb6","resolution":{"observed_at":"2026-08-07T13:30:21.169914Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:30:32.594537Z","title":"Learning to optimize tensor programs","venue":null,"work_id":"3db42b82-ad66-45ce-8694-287c2abf1459","year":2018},"citing_paper":{"arxiv_id":"2505.21661","last_updated":"2025-05-27T18:38:15Z","snapshot_observed_at":"2026-08-07T13:23:13.202211Z","submitted_at":"2025-05-27T18:38:15Z","title":"KPerfIR: Towards an Open and Compiler-centric Ecosystem for GPU Kernel Performance Tooling on Modern AI Workloads","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T13:30:21.285927Z"},"links":{"citing_paper":"/paper/2505.21661"},"observation_digest":"sha256:f65037ae7c3f31463d1d81157c7fff0b8c24029f352e20cf9d6ac575a86e6618","observation_id":"da1d23e9-33a1-403a-a7c4-9197248d0658","resolution":{"observed_at":"2026-08-07T13:30:32.674148Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:30:32.343570Z","title":"Nvidia hopper h100 gpu: Scaling per- formance","venue":null,"work_id":"9d0d7964-e36e-4f7f-9d34-76e1918d2d3e","year":2023},"citing_paper":{"arxiv_id":"2505.21661","last_updated":"2025-05-27T18:38:15Z","snapshot_observed_at":"2026-08-07T13:23:13.202211Z","submitted_at":"2025-05-27T18:38:15Z","title":"KPerfIR: Towards an Open and Compiler-centric Ecosystem for GPU Kernel Performance Tooling on Modern AI Workloads","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T13:30:21.383216Z"},"links":{"citing_paper":"/paper/2505.21661"},"observation_digest":"sha256:d527079c572d0ea2408abba32098ca98f62ad73207c0fa5d28c360a63e8df59e","observation_id":"70948b4b-64fa-4f76-b913-09282b3312ca","resolution":{"observed_at":"2026-08-07T13:30:32.471184Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:30:32.174121Z","title":"V olta: Performance and programmability","venue":null,"work_id":"24291681-8017-43a3-bd90-d5ed4f494a90","year":2018},"citing_paper":{"arxiv_id":"2505.21661","last_updated":"2025-05-27T18:38:15Z","snapshot_observed_at":"2026-08-07T13:23:13.202211Z","submitted_at":"2025-05-27T18:38:15Z","title":"KPerfIR: Towards an Open and Compiler-centric Ecosystem for GPU Kernel Performance Tooling on Modern AI Workloads","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T13:30:21.491020Z"},"links":{"citing_paper":"/paper/2505.21661"},"observation_digest":"sha256:dc1d583309589e7664d97d1cf6d21617369fbeb9d15d28b476ccd56a9571a1a9","observation_id":"e515ed3f-c5ed-4351-bed5-824f17cb5415","resolution":{"observed_at":"2026-08-07T13:30:32.276667Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:30:31.979027Z","title":"Crago, Sana Damani, Karthikeyan Sankar- alingam, and Stephen W","venue":null,"work_id":"02d28efd-e4c0-4a58-a2af-bc4d6c862606","year":2024},"citing_paper":{"arxiv_id":"2505.21661","last_updated":"2025-05-27T18:38:15Z","snapshot_observed_at":"2026-08-07T13:23:13.202211Z","submitted_at":"2025-05-27T18:38:15Z","title":"KPerfIR: Towards an Open and Compiler-centric Ecosystem for GPU Kernel Performance Tooling on Modern AI Workloads","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T13:30:21.603517Z"},"links":{"citing_paper":"/paper/2505.21661"},"observation_digest":"sha256:c6a456e363824addea3de0f2685a2c5120031539d34224c5b085475951e3fe55","observation_id":"cd36a80a-8a84-469d-86a2-a8d1bd62fd9a","resolution":{"observed_at":"2026-08-07T13:30:32.056556Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:30:31.715926Z","title":"Davidson and Christopher W","venue":null,"work_id":"23b0740b-8414-40cc-9d04-7c961dae600f","year":1982},"citing_paper":{"arxiv_id":"2505.21661","last_updated":"2025-05-27T18:38:15Z","snapshot_observed_at":"2026-08-07T13:23:13.202211Z","submitted_at":"2025-05-27T18:38:15Z","title":"KPerfIR: Towards an Open and Compiler-centric Ecosystem for GPU Kernel Performance Tooling on Modern AI Workloads","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T13:30:21.691141Z"},"links":{"citing_paper":"/paper/2505.21661"},"observation_digest":"sha256:e8ef22d56c0e2884932d97a62fb3a50052ffb996935dab31b633565f0f9eca80","observation_id":"2d5df09b-e791-4c35-9034-b1f53d7aa60e","resolution":{"observed_at":"2026-08-07T13:30:31.869324Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:30:31.469653Z","title":"Chrome trace format, 2023","venue":null,"work_id":"e89ecd5a-02c8-467e-a005-4eed5de8b4ab","year":2023},"citing_paper":{"arxiv_id":"2505.21661","last_updated":"2025-05-27T18:38:15Z","snapshot_observed_at":"2026-08-07T13:23:13.202211Z","submitted_at":"2025-05-27T18:38:15Z","title":"KPerfIR: Towards an Open and Compiler-centric Ecosystem for GPU Kernel Performance Tooling on Modern AI Workloads","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T13:30:21.790575Z"},"links":{"citing_paper":"/paper/2505.21661"},"observation_digest":"sha256:f2686c6f991cd19564b66f703d73bbff9221880643ed6ad24c661d54317617c1","observation_id":"8d485b2e-9f76-4a37-907d-48a7880ec5fd","resolution":{"observed_at":"2026-08-07T13:30:31.586912Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:30:31.244180Z","title":"Amanda: Unified instrumentation 14 framework for deep neural networks","venue":null,"work_id":"d90dc5ed-88c8-4b31-a854-cd69d9436772","year":2024},"citing_paper":{"arxiv_id":"2505.21661","last_updated":"2025-05-27T18:38:15Z","snapshot_observed_at":"2026-08-07T13:23:13.202211Z","submitted_at":"2025-05-27T18:38:15Z","title":"KPerfIR: Towards an Open and Compiler-centric Ecosystem for GPU Kernel Performance Tooling on Modern AI Workloads","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T13:30:21.937992Z"},"links":{"citing_paper":"/paper/2505.21661"},"observation_digest":"sha256:3e8abb6a2965873f3fa108b5b1452de324aba2b81b06522a229028eba6719f8e","observation_id":"e8743293-0cba-417c-822f-db090b7c51ba","resolution":{"observed_at":"2026-08-07T13:30:31.347179Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:30:31.072089Z","title":"Profile inference revisited","venue":null,"work_id":"074241fe-cc7e-4412-8e76-728f6995d9a9","year":2022},"citing_paper":{"arxiv_id":"2505.21661","last_updated":"2025-05-27T18:38:15Z","snapshot_observed_at":"2026-08-07T13:23:13.202211Z","submitted_at":"2025-05-27T18:38:15Z","title":"KPerfIR: Towards an Open and Compiler-centric Ecosystem for GPU Kernel Performance Tooling on Modern AI Workloads","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T13:30:22.055097Z"},"links":{"citing_paper":"/paper/2505.21661"},"observation_digest":"sha256:1074bb02cf7f2b0e6dfc8a885dd91bd9ea99fab82a9eee0daebb664a45b78858","observation_id":"053317d4-7d5c-477a-9b90-252097da8bc3","resolution":{"observed_at":"2026-08-07T13:30:31.171306Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.16691","last_updated":"2023-05-06T02:26:41Z","snapshot_observed_at":"2026-08-04T01:55:57.093476Z","submitted_at":"2022-10-29T20:47:27Z","title":"ALCOP: Automatic Load-Compute Pipelining in Deep Learning Compiler for AI-GPUs","version":2},"cited_work":{"arxiv_id":"2210.16691","doi":null,"metadata_source":"pith","pith_arxiv_id":"2210.16691","snapshot_observed_at":"2026-08-07T13:30:26.132247Z","title":"ALCOP: Automatic Load-Compute Pipelining in Deep Learning Compiler for AI-GPUs","venue":"cs.DC","work_id":"17dc330d-58ff-4ce7-92fc-0dc81cc4733f","year":2022},"citing_paper":{"arxiv_id":"2505.21661","last_updated":"2025-05-27T18:38:15Z","snapshot_observed_at":"2026-08-07T13:23:13.202211Z","submitted_at":"2025-05-27T18:38:15Z","title":"KPerfIR: Towards an Open and Compiler-centric Ecosystem for GPU Kernel Performance Tooling on Modern AI Workloads","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T13:30:22.165005Z"},"links":{"cited_paper":"/paper/2210.16691","citing_paper":"/paper/2505.21661"},"observation_digest":"sha256:db1c3f5f94d4ca92c52013dc39eca7ac227283cc76717bd5349fcdbe18e554d9","observation_id":"29bd1027-93f8-4c83-bb31-db15c772544e","resolution":{"observed_at":"2026-08-07T13:30:26.245325Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:30:30.921895Z","title":"Alcop: Automatic load- compute pipelining in deep learning compiler for ai- gpus","venue":null,"work_id":"99a5452e-a687-42a2-998d-9e59678d04dc","year":2023},"citing_paper":{"arxiv_id":"2505.21661","last_updated":"2025-05-27T18:38:15Z","snapshot_observed_at":"2026-08-07T13:23:13.202211Z","submitted_at":"2025-05-27T18:38:15Z","title":"KPerfIR: Towards an Open and Compiler-centric Ecosystem for GPU Kernel Performance Tooling on Modern AI Workloads","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T13:30:22.247836Z"},"links":{"citing_paper":"/paper/2505.21661"},"observation_digest":"sha256:224324be03033662ade095002887955dc253124f3aebc9ba75839c5e4ab6395f","observation_id":"b05945cf-638c-494d-8c03-0b328d61116f","resolution":{"observed_at":"2026-08-07T13:30:30.958905Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:30:30.726265Z","title":"Multi- physics simulations: Challenges and opportunities","venue":null,"work_id":"b3da74c8-6251-422f-b8ad-5ee22f4d3384","year":2013},"citing_paper":{"arxiv_id":"2505.21661","last_updated":"2025-05-27T18:38:15Z","snapshot_observed_at":"2026-08-07T13:23:13.202211Z","submitted_at":"2025-05-27T18:38:15Z","title":"KPerfIR: Towards an Open and Compiler-centric Ecosystem for GPU Kernel Performance Tooling on Modern AI Workloads","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T13:30:22.335538Z"},"links":{"citing_paper":"/paper/2505.21661"},"observation_digest":"sha256:05baf06c7b96ecf5176b7f7986be8ba9978ece7b4cacd98d49294b070207cc30","observation_id":"6b3fb28a-fef5-4fcb-b20c-20866a858629","resolution":{"observed_at":"2026-08-07T13:30:30.809330Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:30:30.574304Z","title":"Llvm: A compilation framework for lifelong program analysis & transforma- tion","venue":null,"work_id":"dbde62dd-3298-4e6f-aa62-f246b3ac34c5","year":2004},"citing_paper":{"arxiv_id":"2505.21661","last_updated":"2025-05-27T18:38:15Z","snapshot_observed_at":"2026-08-07T13:23:13.202211Z","submitted_at":"2025-05-27T18:38:15Z","title":"KPerfIR: Towards an Open and Compiler-centric Ecosystem for GPU Kernel Performance Tooling on Modern AI Workloads","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T13:30:22.389283Z"},"links":{"citing_paper":"/paper/2505.21661"},"observation_digest":"sha256:2be0b6a3329b5f2e3e4fe79f62656a3ce88c46355e14f52cf2010c0c05dfd699","observation_id":"a73110ad-2825-4370-bfb5-f1d1099a928e","resolution":{"observed_at":"2026-08-07T13:30:30.653926Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:30:22.515748Z","title":"Mlir: Scaling compiler infrastructure for do- main specific computation","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.21661","last_updated":"2025-05-27T18:38:15Z","snapshot_observed_at":"2026-08-07T13:23:13.202211Z","submitted_at":"2025-05-27T18:38:15Z","title":"KPerfIR: Towards an Open and Compiler-centric Ecosystem for GPU Kernel Performance Tooling on Modern AI Workloads","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T13:30:22.515748Z"},"links":{"citing_paper":"/paper/2505.21661"},"observation_digest":"sha256:a77248867371406161bb977e35d1cded0b51038939d76657950d3d71ca6abd0a","observation_id":"54c58660-8eea-4202-b3ad-11c340ed26d5","resolution":{"observed_at":"2026-08-07T13:30:22.515748Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:30:22.645303Z","title":"Deep learning","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2505.21661","last_updated":"2025-05-27T18:38:15Z","snapshot_observed_at":"2026-08-07T13:23:13.202211Z","submitted_at":"2025-05-27T18:38:15Z","title":"KPerfIR: Towards an Open and Compiler-centric Ecosystem for GPU Kernel Performance Tooling on Modern AI Workloads","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T13:30:22.645303Z"},"links":{"citing_paper":"/paper/2505.21661"},"observation_digest":"sha256:08efae69298dec35854d837a8b602f7c7adea77681ea21d7a5c9e2625dae874f","observation_id":"8c6437fb-9148-44fb-94f3-3bdf8c6f3095","resolution":{"observed_at":"2026-08-07T13:30:22.645303Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:30:30.395336Z","title":null,"venue":null,"work_id":"30bf1ae6-8673-44fc-bf9e-b338b87952ca","year":1997},"citing_paper":{"arxiv_id":"2505.21661","last_updated":"2025-05-27T18:38:15Z","snapshot_observed_at":"2026-08-07T13:23:13.202211Z","submitted_at":"2025-05-27T18:38:15Z","title":"KPerfIR: Towards an Open and Compiler-centric Ecosystem for GPU Kernel Performance Tooling on Modern AI Workloads","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T13:30:22.701028Z"},"links":{"citing_paper":"/paper/2505.21661"},"observation_digest":"sha256:ddc04acac46f067a562c162a863c8a6f5b26588e060698e7b65198ae264f050f","observation_id":"13dd4433-06a5-4ef0-abd3-021156b40d2d","resolution":{"observed_at":"2026-08-07T13:30:30.468605Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:30:30.258991Z","title":"Experimental FlashAttention3 using Triton, 2024","venue":null,"work_id":"2da87b63-94a3-4314-a77c-abc6055da02c","year":2024},"citing_paper":{"arxiv_id":"2505.21661","last_updated":"2025-05-27T18:38:15Z","snapshot_observed_at":"2026-08-07T13:23:13.202211Z","submitted_at":"2025-05-27T18:38:15Z","title":"KPerfIR: Towards an Open and Compiler-centric Ecosystem for GPU Kernel Performance Tooling on Modern AI Workloads","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T13:30:22.794752Z"},"links":{"citing_paper":"/paper/2505.21661"},"observation_digest":"sha256:74019e7721968a591784aa07973ae071e52018c097e9d407fe5d32bf21e2480c","observation_id":"e4235d67-0ff5-497d-82b3-0a5addda178c","resolution":{"observed_at":"2026-08-07T13:30:30.297140Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:30:30.054236Z","title":"NVIDIA Turing GPU Architec- ture Whitepaper, 2018","venue":null,"work_id":"cfcc6ed1-739d-41cb-a372-9d831df499f7","year":2018},"citing_paper":{"arxiv_id":"2505.21661","last_updated":"2025-05-27T18:38:15Z","snapshot_observed_at":"2026-08-07T13:23:13.202211Z","submitted_at":"2025-05-27T18:38:15Z","title":"KPerfIR: Towards an Open and Compiler-centric Ecosystem for GPU Kernel Performance Tooling on Modern AI Workloads","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T13:30:22.857610Z"},"links":{"citing_paper":"/paper/2505.21661"},"observation_digest":"sha256:c7b36e01c3efcaff501f474c37e8964e3399682fc456bdb45c3174a524d7aa3b","observation_id":"6028930b-df31-4f74-bde3-fe4661c93150","resolution":{"observed_at":"2026-08-07T13:30:30.176968Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:30:29.879908Z","title":"cuBLAS Library, 2023","venue":null,"work_id":"86f0e777-8c52-4f16-bcaf-47871654860f","year":2023},"citing_paper":{"arxiv_id":"2505.21661","last_updated":"2025-05-27T18:38:15Z","snapshot_observed_at":"2026-08-07T13:23:13.202211Z","submitted_at":"2025-05-27T18:38:15Z","title":"KPerfIR: Towards an Open and Compiler-centric Ecosystem for GPU Kernel Performance Tooling on Modern AI Workloads","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T13:30:22.984913Z"},"links":{"citing_paper":"/paper/2505.21661"},"observation_digest":"sha256:0072d0530bcffb7d923e6ab8fa78fadcb68f3cca4a635abe3762344a76e4afde","observation_id":"1d72d265-bef9-4ede-a978-766f10be2cac","resolution":{"observed_at":"2026-08-07T13:30:29.941830Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:30:29.717131Z","title":"CUPTI: CUDA Profiling Tools Interface, 2023","venue":null,"work_id":"fe580c21-ae0a-436a-aaf4-547793a227b0","year":2023},"citing_paper":{"arxiv_id":"2505.21661","last_updated":"2025-05-27T18:38:15Z","snapshot_observed_at":"2026-08-07T13:23:13.202211Z","submitted_at":"2025-05-27T18:38:15Z","title":"KPerfIR: Towards an Open and Compiler-centric Ecosystem for GPU Kernel Performance Tooling on Modern AI Workloads","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T13:30:23.068207Z"},"links":{"citing_paper":"/paper/2505.21661"},"observation_digest":"sha256:83cacaa91cf29f178739d070e6b74391cd13ac68f20477685f63bf3c14fabba6","observation_id":"7fa48589-8726-4e2d-b4ac-468851ed5b65","resolution":{"observed_at":"2026-08-07T13:30:29.782672Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:30:29.579053Z","title":"NVIDIA Nsight Compute, 2024","venue":null,"work_id":"9c67106e-65d8-424c-bf11-69943af5d88d","year":2024},"citing_paper":{"arxiv_id":"2505.21661","last_updated":"2025-05-27T18:38:15Z","snapshot_observed_at":"2026-08-07T13:23:13.202211Z","submitted_at":"2025-05-27T18:38:15Z","title":"KPerfIR: Towards an Open and Compiler-centric Ecosystem for GPU Kernel Performance Tooling on Modern AI Workloads","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T13:30:23.187664Z"},"links":{"citing_paper":"/paper/2505.21661"},"observation_digest":"sha256:3d198430a8a34034f310ac4489b8bf5c2ad32e428b5dc067c9648a7633bba93b","observation_id":"416fd099-5bf4-47c1-9099-65b41182c32b","resolution":{"observed_at":"2026-08-07T13:30:29.630513Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:30:29.360275Z","title":"NVIDIA Nsight Systems, 2024","venue":null,"work_id":"b895b115-0ba8-4205-b2d1-04966459a5bc","year":2024},"citing_paper":{"arxiv_id":"2505.21661","last_updated":"2025-05-27T18:38:15Z","snapshot_observed_at":"2026-08-07T13:23:13.202211Z","submitted_at":"2025-05-27T18:38:15Z","title":"KPerfIR: Towards an Open and Compiler-centric Ecosystem for GPU Kernel Performance Tooling on Modern AI Workloads","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T13:30:23.281676Z"},"links":{"citing_paper":"/paper/2505.21661"},"observation_digest":"sha256:d21074632ab1a5558066e16882dae4b7ac476345751a543ca0b6439a73b88335","observation_id":"c2cfa9d0-71d2-477a-a996-c9d8ae0684f6","resolution":{"observed_at":"2026-08-07T13:30:29.448684Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:30:29.180992Z","title":"NVIDIA PTX, 2024","venue":null,"work_id":"45218330-0337-4ac8-a3e7-c61008aad2c3","year":2024},"citing_paper":{"arxiv_id":"2505.21661","last_updated":"2025-05-27T18:38:15Z","snapshot_observed_at":"2026-08-07T13:23:13.202211Z","submitted_at":"2025-05-27T18:38:15Z","title":"KPerfIR: Towards an Open and Compiler-centric Ecosystem for GPU Kernel Performance Tooling on Modern AI Workloads","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T13:30:23.329699Z"},"links":{"citing_paper":"/paper/2505.21661"},"observation_digest":"sha256:fefcde89d4e1ca14d5191f7a6df61c7142549026cc7aca69ed2e52d2beb60639","observation_id":"7cbfb932-243c-45f5-9250-329661b90689","resolution":{"observed_at":"2026-08-07T13:30:29.275704Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:30:28.945299Z","title":"Group GEMM in Triton, 2024","venue":null,"work_id":"059944f4-e03f-45f7-b7f5-29c5a5efb27f","year":2024},"citing_paper":{"arxiv_id":"2505.21661","last_updated":"2025-05-27T18:38:15Z","snapshot_observed_at":"2026-08-07T13:23:13.202211Z","submitted_at":"2025-05-27T18:38:15Z","title":"KPerfIR: Towards an Open and Compiler-centric Ecosystem for GPU Kernel Performance Tooling on Modern AI Workloads","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T13:30:23.419679Z"},"links":{"citing_paper":"/paper/2505.21661"},"observation_digest":"sha256:697dc231fe3c299d54de3f6d30cd1659499b1ebb6f4e3d4eadc91572fcb29f3e","observation_id":"58fa46a6-32fb-41a2-85af-35dc37be549e","resolution":{"observed_at":"2026-08-07T13:30:29.065653Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:30:28.862422Z","title":"Optimizing distributed ml communi- cation with fused computation-collective operations","venue":null,"work_id":"165d31bf-4874-447d-bac8-e3dceefb28b2","year":2024},"citing_paper":{"arxiv_id":"2505.21661","last_updated":"2025-05-27T18:38:15Z","snapshot_observed_at":"2026-08-07T13:23:13.202211Z","submitted_at":"2025-05-27T18:38:15Z","title":"KPerfIR: Towards an Open and Compiler-centric Ecosystem for GPU Kernel Performance Tooling on Modern AI Workloads","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T13:30:23.515110Z"},"links":{"citing_paper":"/paper/2505.21661"},"observation_digest":"sha256:4ba4023fb6f354489797255318dee7f6fa2f6999019119de651075e06a8a7417","observation_id":"e41f3c2e-4d9e-486e-8919-ac13e92c36c3","resolution":{"observed_at":"2026-08-07T13:30:28.909368Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:30:28.756617Z","title":"PyTorch Profiler","venue":null,"work_id":"4fce47dd-19b3-4dc7-9654-41820b196ded","year":2021},"citing_paper":{"arxiv_id":"2505.21661","last_updated":"2025-05-27T18:38:15Z","snapshot_observed_at":"2026-08-07T13:23:13.202211Z","submitted_at":"2025-05-27T18:38:15Z","title":"KPerfIR: Towards an Open and Compiler-centric Ecosystem for GPU Kernel Performance Tooling on Modern AI Workloads","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T13:30:23.639842Z"},"links":{"citing_paper":"/paper/2505.21661"},"observation_digest":"sha256:50ca8b6826aa312189abf14500ad830e0b8450db506aecfc566d568c0c6a28b0","observation_id":"8410f4dd-7f2c-4774-88fb-74a2d3637376","resolution":{"observed_at":"2026-08-07T13:30:28.804814Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2203.02544","last_updated":"2022-03-04T19:45:43Z","snapshot_observed_at":"2026-07-06T12:44:29.320216Z","submitted_at":"2022-03-04T19:45:43Z","title":"Reinventing High Performance Computing: Challenges and Opportunities","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.02544","snapshot_observed_at":"2026-08-07T13:30:23.717161Z","title":"Rein- venting high performance computing: challenges and opportunities","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.21661","last_updated":"2025-05-27T18:38:15Z","snapshot_observed_at":"2026-08-07T13:23:13.202211Z","submitted_at":"2025-05-27T18:38:15Z","title":"KPerfIR: Towards an Open and Compiler-centric Ecosystem for GPU Kernel Performance Tooling on Modern AI Workloads","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T13:30:23.717161Z"},"links":{"cited_paper":"/paper/2203.02544","citing_paper":"/paper/2505.21661"},"observation_digest":"sha256:f8446cd1327e1fe8b217c3a80926a6fc0292dec7486d3c4700d7ab3140c963dc","observation_id":"9e33af1c-37ca-4ab3-a77f-a84c89132027","resolution":{"observed_at":"2026-08-07T13:30:23.717161Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:30:23.775785Z","title":"Learning representations by back-propagating errors","venue":null,"work_id":null,"year":1986},"citing_paper":{"arxiv_id":"2505.21661","last_updated":"2025-05-27T18:38:15Z","snapshot_observed_at":"2026-08-07T13:23:13.202211Z","submitted_at":"2025-05-27T18:38:15Z","title":"KPerfIR: Towards an Open and Compiler-centric Ecosystem for GPU Kernel Performance Tooling on Modern AI Workloads","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T13:30:23.775785Z"},"links":{"citing_paper":"/paper/2505.21661"},"observation_digest":"sha256:31b6167cb0af4e51103f536be5bbee066a610d6a2f7438c2ed0fbf7e64097e9c","observation_id":"01376597-3a37-4828-babc-6bb0cb7c485f","resolution":{"observed_at":"2026-08-07T13:30:23.775785Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:30:28.585732Z","title":"Flashattention- 3: Fast and accurate attention with asynchrony and low- precision","venue":null,"work_id":"830311ad-25ac-494c-8802-5a577a70f7c4","year":null},"citing_paper":{"arxiv_id":"2505.21661","last_updated":"2025-05-27T18:38:15Z","snapshot_observed_at":"2026-08-07T13:23:13.202211Z","submitted_at":"2025-05-27T18:38:15Z","title":"KPerfIR: Towards an Open and Compiler-centric Ecosystem for GPU Kernel Performance Tooling on Modern AI Workloads","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T13:30:23.832865Z"},"links":{"citing_paper":"/paper/2505.21661"},"observation_digest":"sha256:b8c03bcd8dfab5fcc0fb8267b708d128c469be8fc7e22437cec67ba5fbd22c38","observation_id":"4fe7920d-610c-4afb-bda8-6fad7fb2be62","resolution":{"observed_at":"2026-08-07T13:30:28.685775Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.08608","last_updated":"2024-07-12T22:15:02Z","snapshot_observed_at":"2026-07-06T18:44:53.587276Z","submitted_at":"2024-07-11T15:44:48Z","title":"FlashAttention-3: Fast and Accurate Attention with Asynchrony and Low-precision","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.08608","snapshot_observed_at":"2026-08-07T13:30:23.937127Z","title":"Flashattention- 3: Fast and accurate attention with asynchrony and low- precision","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.21661","last_updated":"2025-05-27T18:38:15Z","snapshot_observed_at":"2026-08-07T13:23:13.202211Z","submitted_at":"2025-05-27T18:38:15Z","title":"KPerfIR: Towards an Open and Compiler-centric Ecosystem for GPU Kernel Performance Tooling on Modern AI Workloads","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T13:30:23.937127Z"},"links":{"cited_paper":"/paper/2407.08608","citing_paper":"/paper/2505.21661"},"observation_digest":"sha256:ac5cbff6dcdef1466719932c52546cbbeaf49418636ca4b2be842d24669296d9","observation_id":"c01853a3-027a-4e52-85d3-a2a427ea60cd","resolution":{"observed_at":"2026-08-07T13:30:23.937127Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:30:23.995310Z","title":"Tensor program opti- mization with probabilistic programs","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.21661","last_updated":"2025-05-27T18:38:15Z","snapshot_observed_at":"2026-08-07T13:23:13.202211Z","submitted_at":"2025-05-27T18:38:15Z","title":"KPerfIR: Towards an Open and Compiler-centric Ecosystem for GPU Kernel Performance Tooling on Modern AI Workloads","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T13:30:23.995310Z"},"links":{"citing_paper":"/paper/2505.21661"},"observation_digest":"sha256:e4e918087c7e262f92b1fa948546ae5c97fceec9f4341f4a3d12bc5795c14110","observation_id":"759b5c7d-5f43-4bac-8b38-274054b48cc6","resolution":{"observed_at":"2026-08-07T13:30:23.995310Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.20399","last_updated":"2024-10-27T10:07:16Z","snapshot_observed_at":"2026-07-06T19:40:21.797132Z","submitted_at":"2024-10-27T10:07:16Z","title":"ThunderKittens: Simple, Fast, and Adorable AI Kernels","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.20399","snapshot_observed_at":"2026-08-07T13:30:24.085300Z","title":"Thunderkittens: Simple, fast, and adorable ai kernels","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.21661","last_updated":"2025-05-27T18:38:15Z","snapshot_observed_at":"2026-08-07T13:23:13.202211Z","submitted_at":"2025-05-27T18:38:15Z","title":"KPerfIR: Towards an Open and Compiler-centric Ecosystem for GPU Kernel Performance Tooling on Modern AI Workloads","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T13:30:24.085300Z"},"links":{"cited_paper":"/paper/2410.20399","citing_paper":"/paper/2505.21661"},"observation_digest":"sha256:8e621abc13206f4a12e7487f7522e4c831281d74ab8cc21076bb283a08411940","observation_id":"feb87269-0c5b-4cd8-ae0f-061a40d6246d","resolution":{"observed_at":"2026-08-07T13:30:24.085300Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:30:28.207239Z","title":"CUTLASS, January 2023","venue":null,"work_id":"f7bab0fc-bf5d-49fb-8979-13ebd86671b5","year":2023},"citing_paper":{"arxiv_id":"2505.21661","last_updated":"2025-05-27T18:38:15Z","snapshot_observed_at":"2026-08-07T13:23:13.202211Z","submitted_at":"2025-05-27T18:38:15Z","title":"KPerfIR: Towards an Open and Compiler-centric Ecosystem for GPU Kernel Performance Tooling on Modern AI Workloads","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T13:30:24.159738Z"},"links":{"citing_paper":"/paper/2505.21661"},"observation_digest":"sha256:79d0d7cc2b5ee4bb3918be29abdb7d643a2912a55d1f73203adfb53888e53fcb","observation_id":"274c38bf-249b-455c-8760-e2c0a40f8074","resolution":{"observed_at":"2026-08-07T13:30:28.475954Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:30:24.215990Z","title":"Large language models in medicine","venue":null,"work_id":null,"year":1930},"citing_paper":{"arxiv_id":"2505.21661","last_updated":"2025-05-27T18:38:15Z","snapshot_observed_at":"2026-08-07T13:23:13.202211Z","submitted_at":"2025-05-27T18:38:15Z","title":"KPerfIR: Towards an Open and Compiler-centric Ecosystem for GPU Kernel Performance Tooling on Modern AI Workloads","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T13:30:24.215990Z"},"links":{"citing_paper":"/paper/2505.21661"},"observation_digest":"sha256:0688a1bf53d50216ec4aa2e926b5991af8750032380722ba253d9804c99c9c13","observation_id":"ec4c7c0b-4745-4260-b614-767e1e5ad6b5","resolution":{"observed_at":"2026-08-07T13:30:24.215990Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:30:24.270842Z","title":"Triton: an intermediate language and compiler for tiled neural network computations","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.21661","last_updated":"2025-05-27T18:38:15Z","snapshot_observed_at":"2026-08-07T13:23:13.202211Z","submitted_at":"2025-05-27T18:38:15Z","title":"KPerfIR: Towards an Open and Compiler-centric Ecosystem for GPU Kernel Performance Tooling on Modern AI Workloads","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T13:30:24.270842Z"},"links":{"citing_paper":"/paper/2505.21661"},"observation_digest":"sha256:389e8bd992067f0cd5433c1ea4cc81572d199934ba0415c46bdbe02325d23bd4","observation_id":"031bdfdc-2d9f-4c1e-b1d5-3976e281fe8a","resolution":{"observed_at":"2026-08-07T13:30:24.270842Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:30:27.847660Z","title":"Nvbit: A dynamic binary instru- mentation framework for nvidia gpus","venue":null,"work_id":"cdeb3e7d-9e34-40cc-b061-f04453f25103","year":2019},"citing_paper":{"arxiv_id":"2505.21661","last_updated":"2025-05-27T18:38:15Z","snapshot_observed_at":"2026-08-07T13:23:13.202211Z","submitted_at":"2025-05-27T18:38:15Z","title":"KPerfIR: Towards an Open and Compiler-centric Ecosystem for GPU Kernel Performance Tooling on Modern AI Workloads","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-07T13:30:24.342065Z"},"links":{"citing_paper":"/paper/2505.21661"},"observation_digest":"sha256:baa70077c06526b0b9a27621f7bddf1688d4bf72fb750fecdafcf0bfae05ce6b","observation_id":"eee372a2-8b78-4873-bf88-f62c4503f10b","resolution":{"observed_at":"2026-08-07T13:30:27.955031Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.17924","last_updated":"2025-03-23T03:40:45Z","snapshot_observed_at":"2026-08-07T16:43:42.874417Z","submitted_at":"2025-03-23T03:40:45Z","title":"WLB-LLM: Workload-Balanced 4D Parallelism for Large Language Model Training","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.17924","snapshot_observed_at":"2026-08-07T13:30:24.514841Z","title":"Wlb-llm: Workload-balanced 4d paral- lelism for large language model training","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.21661","last_updated":"2025-05-27T18:38:15Z","snapshot_observed_at":"2026-08-07T13:23:13.202211Z","submitted_at":"2025-05-27T18:38:15Z","title":"KPerfIR: Towards an Open and Compiler-centric Ecosystem for GPU Kernel Performance Tooling on Modern AI Workloads","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-07T13:30:24.514841Z"},"links":{"cited_paper":"/paper/2503.17924","citing_paper":"/paper/2505.21661"},"observation_digest":"sha256:75a0890da6f76ed8592819a8709c47336ea090666cd22e0c2bd0523f6bdaacfb","observation_id":"54438187-5bdc-4664-a4c7-a00147aabc7c","resolution":{"observed_at":"2026-08-07T13:30:24.514841Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:30:27.621961Z","title":"Rap: Resource-aware automated gpu sharing for multi-gpu recommendation model training and input preprocessing","venue":null,"work_id":"6243d9b0-f062-4765-8092-edb1e4a46908","year":2024},"citing_paper":{"arxiv_id":"2505.21661","last_updated":"2025-05-27T18:38:15Z","snapshot_observed_at":"2026-08-07T13:23:13.202211Z","submitted_at":"2025-05-27T18:38:15Z","title":"KPerfIR: Towards an Open and Compiler-centric Ecosystem for GPU Kernel Performance Tooling on Modern AI Workloads","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-07T13:30:24.634751Z"},"links":{"citing_paper":"/paper/2505.21661"},"observation_digest":"sha256:c309981991b1d7a97a05324fbeb73c4a6e798cf8210f7f942176bc983efc581d","observation_id":"f47efffa-1cd2-476b-bfb4-9dd2fcabe9bb","resolution":{"observed_at":"2026-08-07T13:30:27.714838Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.17564","last_updated":"2023-12-21T06:21:11Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-03-30T17:30:36Z","title":"BloombergGPT: A Large Language Model for Finance","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.17564","snapshot_observed_at":"2026-08-07T13:30:24.734854Z","title":"Bloomberggpt: A large language model for finance","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.21661","last_updated":"2025-05-27T18:38:15Z","snapshot_observed_at":"2026-08-07T13:23:13.202211Z","submitted_at":"2025-05-27T18:38:15Z","title":"KPerfIR: Towards an Open and Compiler-centric Ecosystem for GPU Kernel Performance Tooling on Modern AI Workloads","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-07T13:30:24.734854Z"},"links":{"cited_paper":"/paper/2303.17564","citing_paper":"/paper/2505.21661"},"observation_digest":"sha256:95b2055b330d6941e60daf502cc5d850c51112b7d442b0fe9f1d1a9fc452ae2f","observation_id":"fcee688e-b778-446a-aaef-556320014db0","resolution":{"observed_at":"2026-08-07T13:30:24.734854Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:30:24.804890Z","title":"Ansor: Generating {High-Performance} tensor programs for deep learn- ing","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.21661","last_updated":"2025-05-27T18:38:15Z","snapshot_observed_at":"2026-08-07T13:23:13.202211Z","submitted_at":"2025-05-27T18:38:15Z","title":"KPerfIR: Towards an Open and Compiler-centric Ecosystem for GPU Kernel Performance Tooling on Modern AI Workloads","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-07T13:30:24.804890Z"},"links":{"citing_paper":"/paper/2505.21661"},"observation_digest":"sha256:cb576dacde2e221f03437c0119a805a735c4f865486c2678b5a3543a07566c3b","observation_id":"57ec749e-fe5d-4864-8b84-af6860c41538","resolution":{"observed_at":"2026-08-07T13:30:24.804890Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:30:27.198930Z","title":"Gvprof: A value profiler for gpu-based clusters","venue":null,"work_id":"6d543c08-d644-4774-a789-f89709771b9f","year":2020},"citing_paper":{"arxiv_id":"2505.21661","last_updated":"2025-05-27T18:38:15Z","snapshot_observed_at":"2026-08-07T13:23:13.202211Z","submitted_at":"2025-05-27T18:38:15Z","title":"KPerfIR: Towards an Open and Compiler-centric Ecosystem for GPU Kernel Performance Tooling on Modern AI Workloads","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-07T13:30:24.934964Z"},"links":{"citing_paper":"/paper/2505.21661"},"observation_digest":"sha256:7fceff88e5b54f1a8f569c783d5eb2f724c01c0e358379452a64fc716c2b1f43","observation_id":"9ab0e73d-bc02-4e5a-9de7-75afe7c1d6f3","resolution":{"observed_at":"2026-08-07T13:30:27.405478Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:30:26.824859Z","title":"Valueexpert: Exploring value patterns in gpu-accelerated applications","venue":null,"work_id":"1f67eeaa-4339-4f86-bc60-5df3bd4dbf50","year":2022},"citing_paper":{"arxiv_id":"2505.21661","last_updated":"2025-05-27T18:38:15Z","snapshot_observed_at":"2026-08-07T13:23:13.202211Z","submitted_at":"2025-05-27T18:38:15Z","title":"KPerfIR: Towards an Open and Compiler-centric Ecosystem for GPU Kernel Performance Tooling on Modern AI Workloads","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-07T13:30:25.024913Z"},"links":{"citing_paper":"/paper/2505.21661"},"observation_digest":"sha256:62e5688d1db6f431b1421bff672422cc1c1ca91ed22334367b34564003c5243b","observation_id":"70b31a9c-f283-484e-baa0-b258163575ea","resolution":{"observed_at":"2026-08-07T13:30:26.974974Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2505.21661","last_updated":"2025-05-27T18:38:15Z","latest_version":1,"primary_category":"cs.DC","snapshot_observed_at":"2026-08-07T13:23:13.202211Z","submitted_at":"2025-05-27T18:38:15Z","title":"KPerfIR: Towards an Open and Compiler-centric Ecosystem for GPU Kernel Performance Tooling on Modern AI Workloads"},"reference_resolution":{"displayed":54,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":17,"verified_exact":1,"verified_fuzzy":36},"total_outbound_references":54},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 54 of 54 outbound references and 1 inbound Pith citation observation for arXiv:2505.21661."}