{"as_of":"2026-08-09T01:04:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:daa4d5725955a55c0d75737c177fd688a0e53c0f242de5aa8225e58e1a19d887","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":32,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":32,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":32,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":32,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T22:52:54.324340Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"arxiv_reference","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":6,"observed_at":"2026-08-05T02:28:24.338817Z","source":"arxiv_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2410.10989","last_updated":"2025-01-24T00:14:55Z","snapshot_observed_at":"2026-07-06T19:33:26.078722Z","submitted_at":"2024-10-14T18:17:01Z","title":"Liger Kernel: Efficient Triton Kernels for LLM Training","version":3},"cited_work":{"arxiv_id":"2410.10989","doi":"10.48550/arxiv.2410.10989","metadata_source":"arxiv_reference","pith_arxiv_id":"2410.10989","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Liger Kernel: Efficient Triton Kernels for","venue":"arXiv (Cornell University)","work_id":"ce624c61-a8db-44ff-9646-e09326d1328e","year":2024},"citing_paper":{"arxiv_id":"2412.04468","last_updated":"2026-04-25T07:16:42Z","snapshot_observed_at":"2026-08-03T08:48:57.969106Z","submitted_at":"2024-12-05T18:59:55Z","title":"NVILA: Efficient Frontier Visual Language Models","version":3},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-05-23T07:42:22.478647Z"},"links":{"cited_paper":"/paper/2410.10989","citing_paper":"/paper/2412.04468"},"observation_digest":"sha256:1a6917e3331defc8cc83c95d9c18b550f8663fe77bf2cd3812ce691691fae49e","observation_id":"3a9ec0b3-8fb2-4a21-9f76-98ed7625c5df","resolution":{"observed_at":"2026-05-23T07:42:43.002506Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-05-24T05:54:39.54334+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-24T05:54:39.54334+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.10989","last_updated":"2025-01-24T00:14:55Z","snapshot_observed_at":"2026-07-06T19:33:26.078722Z","submitted_at":"2024-10-14T18:17:01Z","title":"Liger Kernel: Efficient Triton Kernels for LLM Training","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.10989","snapshot_observed_at":"2026-08-07T22:52:54.324340Z","title":"Liger Kernel: Efficient Triton Kernels for LLM Training , 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2502.09042","last_updated":"2025-03-27T06:45:15Z","snapshot_observed_at":"2026-08-08T14:47:06.722144Z","submitted_at":"2025-02-13T07:55:54Z","title":"Typhoon T1: An Open Thai Reasoning Model","version":2},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-07T22:52:54.324340Z"},"links":{"cited_paper":"/paper/2410.10989","citing_paper":"/paper/2502.09042"},"observation_digest":"sha256:b01e9d911f45ef5b8bae0e2d920f06c789254dd4076c5cfc95781c35ed9b3432","observation_id":"8e1e8564-de04-405d-8b38-9bc4a1f692ca","resolution":{"observed_at":"2026-08-07T22:52:54.324340Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.10989","last_updated":"2025-01-24T00:14:55Z","snapshot_observed_at":"2026-07-06T19:33:26.078722Z","submitted_at":"2024-10-14T18:17:01Z","title":"Liger Kernel: Efficient Triton Kernels for LLM Training","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.10989","snapshot_observed_at":"2026-08-07T22:52:27.458348Z","title":"Liger Kernel: Efficient Triton Kernels for LLM Training","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.09056","last_updated":"2025-03-27T06:45:16Z","snapshot_observed_at":"2026-08-07T22:44:06.920159Z","submitted_at":"2025-02-13T08:10:45Z","title":"Adapting Language-Specific LLMs to a Reasoning Model in One Day via Model Merging -- An Open Recipe","version":3},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-07T22:52:27.458348Z"},"links":{"cited_paper":"/paper/2410.10989","citing_paper":"/paper/2502.09056"},"observation_digest":"sha256:8300e0d27bc5af33347cbc35e87d378e2e79bb1d51dc66e30bef38fb9319574b","observation_id":"365d5487-b3e7-4031-995b-d7b74351da22","resolution":{"observed_at":"2026-08-07T22:52:27.458348Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.10989","last_updated":"2025-01-24T00:14:55Z","snapshot_observed_at":"2026-07-06T19:33:26.078722Z","submitted_at":"2024-10-14T18:17:01Z","title":"Liger Kernel: Efficient Triton Kernels for LLM Training","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.10989","snapshot_observed_at":"2026-08-07T20:57:07.612142Z","title":"Liger kernel: Efficient triton kernels for llm training","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.09604","last_updated":"2025-06-15T05:10:22Z","snapshot_observed_at":"2026-08-07T20:49:49.396518Z","submitted_at":"2025-02-13T18:55:13Z","title":"SelfCite: Self-Supervised Alignment for Context Attribution in Large Language Models","version":3},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-07T20:57:07.612142Z"},"links":{"cited_paper":"/paper/2410.10989","citing_paper":"/paper/2502.09604"},"observation_digest":"sha256:eae66b09ab74b0b8bf1595b8fdc044dce41827c364cbd53337994693f7bac830","observation_id":"ca53c770-c559-4c99-8481-ed69fb2de7c7","resolution":{"observed_at":"2026-08-07T20:57:07.612142Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.10989","last_updated":"2025-01-24T00:14:55Z","snapshot_observed_at":"2026-07-06T19:33:26.078722Z","submitted_at":"2024-10-14T18:17:01Z","title":"Liger Kernel: Efficient Triton Kernels for LLM Training","version":3},"cited_work":{"arxiv_id":"2410.10989","doi":"10.48550/arxiv.2410.10989","metadata_source":"arxiv_reference","pith_arxiv_id":"2410.10989","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Liger Kernel: Efficient Triton Kernels for","venue":"arXiv (Cornell University)","work_id":"ce624c61-a8db-44ff-9646-e09326d1328e","year":2024},"citing_paper":{"arxiv_id":"2502.17421","last_updated":"2026-04-08T06:06:59Z","snapshot_observed_at":"2026-08-03T00:39:33.876137Z","submitted_at":"2025-02-24T18:53:31Z","title":"LongSpec: Long-Context Lossless Speculative Decoding with Efficient Drafting and Verification","version":4},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-23T01:57:19.398245Z"},"links":{"cited_paper":"/paper/2410.10989","citing_paper":"/paper/2502.17421"},"observation_digest":"sha256:3358db1496ebf0c4babc0333d0d32d3c38bf734654d76b73d8fd131303e59f2a","observation_id":"8e59f483-2afe-4285-b864-9f2282b6ba39","resolution":{"observed_at":"2026-05-23T01:57:22.765763Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-05-24T05:54:39.54334+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-24T05:54:39.54334+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.10989","last_updated":"2025-01-24T00:14:55Z","snapshot_observed_at":"2026-07-06T19:33:26.078722Z","submitted_at":"2024-10-14T18:17:01Z","title":"Liger Kernel: Efficient Triton Kernels for LLM Training","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.10989","snapshot_observed_at":"2026-08-07T14:52:55.565011Z","title":"Liger kernel: Efficient triton kernels for llm training.arXiv preprint arXiv:2410.10989, 2024","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.17315","last_updated":"2026-06-02T22:13:24Z","snapshot_observed_at":"2026-08-07T22:00:02.564609Z","submitted_at":"2025-05-22T22:09:47Z","title":"Longer Context, Deeper Thinking: Uncovering the Role of Long-Context Ability in Reasoning","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T14:52:55.565011Z"},"links":{"cited_paper":"/paper/2410.10989","citing_paper":"/paper/2505.17315"},"observation_digest":"sha256:3c8da0e7865f401c0c5f0798122d50f66df790a47596d5d75abe7680016748a1","observation_id":"67720c70-3cfd-43a9-b124-4bb834bca452","resolution":{"observed_at":"2026-08-07T14:52:55.565011Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.10989","last_updated":"2025-01-24T00:14:55Z","snapshot_observed_at":"2026-07-06T19:33:26.078722Z","submitted_at":"2024-10-14T18:17:01Z","title":"Liger Kernel: Efficient Triton Kernels for LLM Training","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.10989","snapshot_observed_at":"2026-08-07T14:20:25.008242Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19293","last_updated":"2026-06-02T22:08:40Z","snapshot_observed_at":"2026-08-07T14:15:05.692688Z","submitted_at":"2025-05-25T19:58:31Z","title":"100-LongBench: Are de facto Long-Context Benchmarks Literally Evaluating Long-Context Ability?","version":2},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-07T14:20:25.008242Z"},"links":{"cited_paper":"/paper/2410.10989","citing_paper":"/paper/2505.19293"},"observation_digest":"sha256:8b2262068f195bb43b237eaecf199262cf06025a1bb12d71b9e3920ce6318633","observation_id":"5f8e0671-926e-4089-9ee3-c86c824530ca","resolution":{"observed_at":"2026-08-07T14:20:25.008242Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.10989","last_updated":"2025-01-24T00:14:55Z","snapshot_observed_at":"2026-07-06T19:33:26.078722Z","submitted_at":"2024-10-14T18:17:01Z","title":"Liger Kernel: Efficient Triton Kernels for LLM Training","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.10989","snapshot_observed_at":"2026-08-07T13:22:31.743576Z","title":"In EMNLP","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.21925","last_updated":"2025-05-28T03:20:46Z","snapshot_observed_at":"2026-08-07T13:16:55.523752Z","submitted_at":"2025-05-28T03:20:46Z","title":"RenderFormer: Transformer-based Neural Rendering of Triangle Meshes with Global Illumination","version":1},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-07T13:22:31.743576Z"},"links":{"cited_paper":"/paper/2410.10989","citing_paper":"/paper/2505.21925"},"observation_digest":"sha256:8273af3101588d4f76e0ac09b302c4adec65d145139880fe69cc2e457624b89a","observation_id":"4f6eccac-e6a0-4858-96ed-46a2d3f7d55d","resolution":{"observed_at":"2026-08-07T13:22:31.743576Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.10989","last_updated":"2025-01-24T00:14:55Z","snapshot_observed_at":"2026-07-06T19:33:26.078722Z","submitted_at":"2024-10-14T18:17:01Z","title":"Liger Kernel: Efficient Triton Kernels for LLM Training","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.10989","snapshot_observed_at":"2026-08-07T12:08:11.651962Z","title":"Liger kernel: Efficient triton kernels for llm training.arXiv preprint arXiv:2410.10989, 2024","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.00482","last_updated":"2025-05-31T09:24:32Z","snapshot_observed_at":"2026-08-07T12:01:57.559855Z","submitted_at":"2025-05-31T09:24:32Z","title":"BenchHub: A Unified Benchmark Suite for Holistic and Customizable LLM Evaluation","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T12:08:11.651962Z"},"links":{"cited_paper":"/paper/2410.10989","citing_paper":"/paper/2506.00482"},"observation_digest":"sha256:34050f36778045d40a394762e8277267dca96b73d43affea1e376571f60d3bad","observation_id":"91da4474-d693-434e-be15-8ab7ed1a45b5","resolution":{"observed_at":"2026-08-07T12:08:11.651962Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.10989","last_updated":"2025-01-24T00:14:55Z","snapshot_observed_at":"2026-07-06T19:33:26.078722Z","submitted_at":"2024-10-14T18:17:01Z","title":"Liger Kernel: Efficient Triton Kernels for LLM Training","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.10989","snapshot_observed_at":"2026-08-07T11:32:20.893925Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.02267","last_updated":"2025-06-02T21:15:20Z","snapshot_observed_at":"2026-08-09T00:08:36.329787Z","submitted_at":"2025-06-02T21:15:20Z","title":"TransAct V2: Lifelong User Action Sequence Modeling on Pinterest Recommendation","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T11:32:20.893925Z"},"links":{"cited_paper":"/paper/2410.10989","citing_paper":"/paper/2506.02267"},"observation_digest":"sha256:46bfcae5f23b63e1825ecdb891b15a393fdd945ed7a248a6d350408bc52d3fa4","observation_id":"63b52a2a-f552-4477-aa21-89f1646fa637","resolution":{"observed_at":"2026-08-07T11:32:20.893925Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.10989","last_updated":"2025-01-24T00:14:55Z","snapshot_observed_at":"2026-07-06T19:33:26.078722Z","submitted_at":"2024-10-14T18:17:01Z","title":"Liger Kernel: Efficient Triton Kernels for LLM Training","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.10989","snapshot_observed_at":"2026-08-07T00:30:57.663570Z","title":"Liger kernel: Efficient triton kernels for llm training,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.13996","last_updated":"2025-06-16T20:52:28Z","snapshot_observed_at":"2026-08-08T23:36:42.812242Z","submitted_at":"2025-06-16T20:52:28Z","title":"Arctic Long Sequence Training: Scalable And Efficient Training For Multi-Million Token Sequences","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T00:30:57.663570Z"},"links":{"cited_paper":"/paper/2410.10989","citing_paper":"/paper/2506.13996"},"observation_digest":"sha256:e61d164a0aa6f822eda1bbc44cd570e4b014c57f00e72df157930836c7ed9900","observation_id":"6ba52778-8e90-491f-a35d-e8bedcd57bde","resolution":{"observed_at":"2026-08-07T00:30:57.663570Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.10989","last_updated":"2025-01-24T00:14:55Z","snapshot_observed_at":"2026-07-06T19:33:26.078722Z","submitted_at":"2024-10-14T18:17:01Z","title":"Liger Kernel: Efficient Triton Kernels for LLM Training","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.10989","snapshot_observed_at":"2026-08-06T20:20:43.285732Z","title":"Liger kernel: Efficient triton kernels for llm training","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.03300","last_updated":"2025-07-04T05:10:20Z","snapshot_observed_at":"2026-08-08T21:21:24.114593Z","submitted_at":"2025-07-04T05:10:20Z","title":"LRM-1B: Towards Large Routing Model","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T20:20:43.285732Z"},"links":{"cited_paper":"/paper/2410.10989","citing_paper":"/paper/2507.03300"},"observation_digest":"sha256:60e7ca792a1ade8bfffbe9274ceed126c64035ae45a8342050d453d79f3761a8","observation_id":"2b0c78f3-aa11-4ebd-a459-c7f7bb0faca0","resolution":{"observed_at":"2026-08-06T20:20:43.285732Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.10989","last_updated":"2025-01-24T00:14:55Z","snapshot_observed_at":"2026-07-06T19:33:26.078722Z","submitted_at":"2024-10-14T18:17:01Z","title":"Liger Kernel: Efficient Triton Kernels for LLM Training","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.10989","snapshot_observed_at":"2026-08-06T15:56:59.556010Z","title":"Liger kernel: Efficient triton kernels for llm training","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.14675","last_updated":"2025-07-19T16:03:34Z","snapshot_observed_at":"2026-08-09T00:51:52.133273Z","submitted_at":"2025-07-19T16:03:34Z","title":"Docopilot: Improving Multimodal Models for Document-Level Understanding","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T15:56:59.556010Z"},"links":{"cited_paper":"/paper/2410.10989","citing_paper":"/paper/2507.14675"},"observation_digest":"sha256:70504860587b2e36e1525a6602ca4bcccf10463777b07fae3b302ef4eac59f44","observation_id":"fd80956e-7de5-43ab-81d3-264a9cdcb3a3","resolution":{"observed_at":"2026-08-06T15:56:59.556010Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.10989","last_updated":"2025-01-24T00:14:55Z","snapshot_observed_at":"2026-07-06T19:33:26.078722Z","submitted_at":"2024-10-14T18:17:01Z","title":"Liger Kernel: Efficient Triton Kernels for LLM Training","version":3},"cited_work":{"arxiv_id":"2410.10989","doi":"10.48550/arxiv.2410.10989","metadata_source":"arxiv_reference","pith_arxiv_id":"2410.10989","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Liger Kernel: Efficient Triton Kernels for","venue":"arXiv (Cornell University)","work_id":"ce624c61-a8db-44ff-9646-e09326d1328e","year":2024},"citing_paper":{"arxiv_id":"2509.09682","last_updated":"2026-05-20T09:23:36Z","snapshot_observed_at":"2026-08-02T10:23:41.548004Z","submitted_at":"2025-08-13T15:03:38Z","title":"Faster and Memory-Efficient Training of Sequential Recommendation Models for Large Catalogs","version":6},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-21T23:23:26.304190Z"},"links":{"cited_paper":"/paper/2410.10989","citing_paper":"/paper/2509.09682"},"observation_digest":"sha256:a5f27f48efea61035845f14edc2fc33df6014e7a7a05d62be6dbda24c03b3ca4","observation_id":"1f8d291a-99be-4ee4-a35c-e3369cdfd722","resolution":{"observed_at":"2026-05-21T23:24:26.165842Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-05-24T05:54:39.54334+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-24T05:54:39.54334+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.10989","last_updated":"2025-01-24T00:14:55Z","snapshot_observed_at":"2026-07-06T19:33:26.078722Z","submitted_at":"2024-10-14T18:17:01Z","title":"Liger Kernel: Efficient Triton Kernels for LLM Training","version":3},"cited_work":{"arxiv_id":"2410.10989","doi":"10.48550/arxiv.2410.10989","metadata_source":"arxiv_reference","pith_arxiv_id":"2410.10989","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Liger Kernel: Efficient Triton Kernels for","venue":"arXiv (Cornell University)","work_id":"ce624c61-a8db-44ff-9646-e09326d1328e","year":2024},"citing_paper":{"arxiv_id":"2509.12266","last_updated":"2026-05-14T18:59:32Z","snapshot_observed_at":"2026-08-02T17:48:25.757044Z","submitted_at":"2025-09-13T03:31:55Z","title":"Genome-Factory: A Library for Tuning, Deploying, and Interpreting Genomic Foundation Models","version":2},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-05-21T22:53:17.022646Z"},"links":{"cited_paper":"/paper/2410.10989","citing_paper":"/paper/2509.12266"},"observation_digest":"sha256:1f4f49690ec247efcd2417beac0aa9da3e275c648ed656e8da8d161fa2aa8b74","observation_id":"e5014fc1-3918-49e3-b33f-77acdc2d8a8b","resolution":{"observed_at":"2026-05-21T22:54:24.636512Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-05-24T05:54:39.54334+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-24T05:54:39.54334+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.10989","last_updated":"2025-01-24T00:14:55Z","snapshot_observed_at":"2026-07-06T19:33:26.078722Z","submitted_at":"2024-10-14T18:17:01Z","title":"Liger Kernel: Efficient Triton Kernels for LLM Training","version":3},"cited_work":{"arxiv_id":"2410.10989","doi":"10.48550/arxiv.2410.10989","metadata_source":"arxiv_reference","pith_arxiv_id":"2410.10989","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Liger Kernel: Efficient Triton Kernels for","venue":"arXiv (Cornell University)","work_id":"ce624c61-a8db-44ff-9646-e09326d1328e","year":2024},"citing_paper":{"arxiv_id":"2602.08819","last_updated":"2026-05-20T05:40:17Z","snapshot_observed_at":"2026-08-08T18:38:10.120376Z","submitted_at":"2026-02-09T15:55:56Z","title":"Bayesian Preference Learning for Test-Time Steerable Reward Models","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-21T13:19:34.587796Z"},"links":{"cited_paper":"/paper/2410.10989","citing_paper":"/paper/2602.08819"},"observation_digest":"sha256:91a3e968a48f21f0519c83c2de7e4a44546ee38a7ca7c1ad37786c9a38275f77","observation_id":"d137bd56-bd26-472a-8f18-842b401a1761","resolution":{"observed_at":"2026-05-21T13:20:10.986146Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-05-24T05:54:39.54334+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-24T05:54:39.54334+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.10989","last_updated":"2025-01-24T00:14:55Z","snapshot_observed_at":"2026-07-06T19:33:26.078722Z","submitted_at":"2024-10-14T18:17:01Z","title":"Liger Kernel: Efficient Triton Kernels for LLM Training","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.10989","snapshot_observed_at":"2026-08-02T23:56:45.815145Z","title":"Hsu, P.-L., Dai, Y ., Kothapalli, V ., Song, Q., Tang, S., Zhu, S., Shimizu, S., Sahni, S., Ning, H., and Chen, Y","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2602.12323","last_updated":"2026-07-08T02:28:44Z","snapshot_observed_at":"2026-08-07T11:55:49.583707Z","submitted_at":"2026-02-12T18:59:20Z","title":"The Appeal and Reality of Recycling LoRAs with Adaptive Merging","version":2},"reference_index":2799,"source":"pdf_text","source_observed_at":"2026-08-02T23:56:45.815145Z"},"links":{"cited_paper":"/paper/2410.10989","citing_paper":"/paper/2602.12323"},"observation_digest":"sha256:f12622e9f3c0f23e4d883eb3937178edf484b3aa7b547557e919afce9d7f44fb","observation_id":"a30ce0bc-e422-4006-962c-38d6032f7598","resolution":{"observed_at":"2026-08-02T23:56:45.815145Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.10989","last_updated":"2025-01-24T00:14:55Z","snapshot_observed_at":"2026-07-06T19:33:26.078722Z","submitted_at":"2024-10-14T18:17:01Z","title":"Liger Kernel: Efficient Triton Kernels for LLM Training","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.10989","snapshot_observed_at":"2026-07-13T23:47:39.219131Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2603.16428","last_updated":"2026-06-30T09:50:18Z","snapshot_observed_at":"2026-08-07T14:11:46.615706Z","submitted_at":"2026-03-17T12:05:17Z","title":"An Efficient Heterogeneous Co-Design for Fine-Tuning on a Single GPU","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-07-13T23:47:39.219131Z"},"links":{"cited_paper":"/paper/2410.10989","citing_paper":"/paper/2603.16428"},"observation_digest":"sha256:14a6158a9551e84006b338c12b1343a936fb270fc2056acce500a612685b18ba","observation_id":"fab3fe86-e1ac-483d-84e4-e8d895241fa7","resolution":{"observed_at":"2026-07-13T23:47:39.219131Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.10989","last_updated":"2025-01-24T00:14:55Z","snapshot_observed_at":"2026-07-06T19:33:26.078722Z","submitted_at":"2024-10-14T18:17:01Z","title":"Liger Kernel: Efficient Triton Kernels for LLM Training","version":3},"cited_work":{"arxiv_id":"2410.10989","doi":"10.48550/arxiv.2410.10989","metadata_source":"arxiv_reference","pith_arxiv_id":"2410.10989","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Liger Kernel: Efficient Triton Kernels for","venue":"arXiv (Cornell University)","work_id":"ce624c61-a8db-44ff-9646-e09326d1328e","year":2024},"citing_paper":{"arxiv_id":"2604.05942","last_updated":"2026-04-07T14:38:05Z","snapshot_observed_at":"2026-07-06T22:54:30.567988Z","submitted_at":"2026-04-07T14:38:05Z","title":"BOSCH: Black-Box Binary Optimization for Short-Context Attention-Head Selection in LLMs","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-10T19:37:20.615497Z"},"links":{"cited_paper":"/paper/2410.10989","citing_paper":"/paper/2604.05942"},"observation_digest":"sha256:8c419bd4da1c198a4f2557deb7a1aefdfffb6cbaa08b85d41e1faeef8086dc26","observation_id":"e33796ca-c4e0-4561-a13f-bbb040afb336","resolution":{"observed_at":"2026-05-10T22:45:47.966378Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-05-24T05:54:39.54334+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-24T05:54:39.54334+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.10989","last_updated":"2025-01-24T00:14:55Z","snapshot_observed_at":"2026-07-06T19:33:26.078722Z","submitted_at":"2024-10-14T18:17:01Z","title":"Liger Kernel: Efficient Triton Kernels for LLM Training","version":3},"cited_work":{"arxiv_id":"2410.10989","doi":"10.48550/arxiv.2410.10989","metadata_source":"arxiv_reference","pith_arxiv_id":"2410.10989","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Liger Kernel: Efficient Triton Kernels for","venue":"arXiv (Cornell University)","work_id":"ce624c61-a8db-44ff-9646-e09326d1328e","year":2024},"citing_paper":{"arxiv_id":"2605.14790","last_updated":"2026-05-14T12:57:56Z","snapshot_observed_at":"2026-07-06T23:26:09.066863Z","submitted_at":"2026-05-14T12:57:56Z","title":"Graphs of Research: Citation Evolution Graphs as Supervision for Research Idea Generation","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-06-30T20:52:32.567107Z"},"links":{"cited_paper":"/paper/2410.10989","citing_paper":"/paper/2605.14790"},"observation_digest":"sha256:8243ee64e000a12cd0ca5d42124fa4bd4458020fd2361f08793f4ae20b7d3fbd","observation_id":"ed8a61af-dd26-4b42-a899-5eb1772e3c90","resolution":{"observed_at":"2026-06-30T20:55:04.076374Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-05-24T05:54:39.54334+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-24T05:54:39.54334+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.10989","last_updated":"2025-01-24T00:14:55Z","snapshot_observed_at":"2026-07-06T19:33:26.078722Z","submitted_at":"2024-10-14T18:17:01Z","title":"Liger Kernel: Efficient Triton Kernels for LLM Training","version":3},"cited_work":{"arxiv_id":"2410.10989","doi":"10.48550/arxiv.2410.10989","metadata_source":"arxiv_reference","pith_arxiv_id":"2410.10989","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Liger Kernel: Efficient Triton Kernels for","venue":"arXiv (Cornell University)","work_id":"ce624c61-a8db-44ff-9646-e09326d1328e","year":2024},"citing_paper":{"arxiv_id":"2605.15913","last_updated":"2026-06-04T09:11:17Z","snapshot_observed_at":"2026-08-03T02:04:40.960353Z","submitted_at":"2026-05-15T12:51:32Z","title":"Towards Generalization of Block Attention via Automatic Segmentation and Block Distillation","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-05-20T18:22:28.087201Z"},"links":{"cited_paper":"/paper/2410.10989","citing_paper":"/paper/2605.15913"},"observation_digest":"sha256:674a8812b33e9534b6db9f62adf879c7c5becbad177dd97213c18dbf3cc94434","observation_id":"59bdf366-9096-480c-96e9-d7851f5bfce2","resolution":{"observed_at":"2026-05-20T18:23:37.425143Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-05-24T05:54:39.54334+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-24T05:54:39.54334+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.10989","last_updated":"2025-01-24T00:14:55Z","snapshot_observed_at":"2026-07-06T19:33:26.078722Z","submitted_at":"2024-10-14T18:17:01Z","title":"Liger Kernel: Efficient Triton Kernels for LLM Training","version":3},"cited_work":{"arxiv_id":"2410.10989","doi":"10.48550/arxiv.2410.10989","metadata_source":"arxiv_reference","pith_arxiv_id":"2410.10989","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Liger Kernel: Efficient Triton Kernels for","venue":"arXiv (Cornell University)","work_id":"ce624c61-a8db-44ff-9646-e09326d1328e","year":2024},"citing_paper":{"arxiv_id":"2605.15913","last_updated":"2026-06-04T09:11:17Z","snapshot_observed_at":"2026-08-03T02:04:40.960353Z","submitted_at":"2026-05-15T12:51:32Z","title":"Towards Generalization of Block Attention via Automatic Segmentation and Block Distillation","version":2},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-05-22T09:24:51.385628Z"},"links":{"cited_paper":"/paper/2410.10989","citing_paper":"/paper/2605.15913"},"observation_digest":"sha256:b1f7e2585389e1b530fbd4a09c9a08e35e4f06e17df050564b8bad536dcf6879","observation_id":"a576adee-ad0a-4876-b8cb-a07c0a2f95d1","resolution":{"observed_at":"2026-05-22T09:26:20.522718Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-05-24T05:54:39.54334+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-24T05:54:39.54334+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.10989","last_updated":"2025-01-24T00:14:55Z","snapshot_observed_at":"2026-07-06T19:33:26.078722Z","submitted_at":"2024-10-14T18:17:01Z","title":"Liger Kernel: Efficient Triton Kernels for LLM Training","version":3},"cited_work":{"arxiv_id":"2410.10989","doi":"10.48550/arxiv.2410.10989","metadata_source":"arxiv_reference","pith_arxiv_id":"2410.10989","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Liger Kernel: Efficient Triton Kernels for","venue":"arXiv (Cornell University)","work_id":"ce624c61-a8db-44ff-9646-e09326d1328e","year":2024},"citing_paper":{"arxiv_id":"2605.15913","last_updated":"2026-06-04T09:11:17Z","snapshot_observed_at":"2026-08-03T02:04:40.960353Z","submitted_at":"2026-05-15T12:51:32Z","title":"Towards Generalization of Block Attention via Automatic Segmentation and Block Distillation","version":3},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-05-25T06:34:00.590523Z"},"links":{"cited_paper":"/paper/2410.10989","citing_paper":"/paper/2605.15913"},"observation_digest":"sha256:7fd1f9a4fdebeec9dadd26adfc9dc05e881564c8ed558c07e9877d4e9f7eedc0","observation_id":"fee46804-1e3d-47d3-a7e2-fc5487d2ef41","resolution":{"observed_at":"2026-05-25T06:35:24.257256Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-05-24T05:54:39.54334+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-24T05:54:39.54334+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.10989","last_updated":"2025-01-24T00:14:55Z","snapshot_observed_at":"2026-07-06T19:33:26.078722Z","submitted_at":"2024-10-14T18:17:01Z","title":"Liger Kernel: Efficient Triton Kernels for LLM Training","version":3},"cited_work":{"arxiv_id":"2410.10989","doi":"10.48550/arxiv.2410.10989","metadata_source":"arxiv_reference","pith_arxiv_id":"2410.10989","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Liger Kernel: Efficient Triton Kernels for","venue":"arXiv (Cornell University)","work_id":"ce624c61-a8db-44ff-9646-e09326d1328e","year":2024},"citing_paper":{"arxiv_id":"2605.16826","last_updated":"2026-05-16T06:05:27Z","snapshot_observed_at":"2026-08-01T18:34:23.456008Z","submitted_at":"2026-05-16T06:05:27Z","title":"Decoupling KL and Trajectories: A Unified Perspective for SFT, DAgger, Offline RL, and OPD in LLM Distillation","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-19T20:49:15.724896Z"},"links":{"cited_paper":"/paper/2410.10989","citing_paper":"/paper/2605.16826"},"observation_digest":"sha256:1e0c9233564f7011789973d659d05b0c39c61e6f2ec3d589a237952f803a7fe9","observation_id":"e3c231f3-6fe2-403d-affa-777ebd102d36","resolution":{"observed_at":"2026-05-19T20:52:46.221978Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-05-24T05:54:39.54334+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-24T05:54:39.54334+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.10989","last_updated":"2025-01-24T00:14:55Z","snapshot_observed_at":"2026-07-06T19:33:26.078722Z","submitted_at":"2024-10-14T18:17:01Z","title":"Liger Kernel: Efficient Triton Kernels for LLM Training","version":3},"cited_work":{"arxiv_id":"2410.10989","doi":"10.48550/arxiv.2410.10989","metadata_source":"arxiv_reference","pith_arxiv_id":"2410.10989","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Liger Kernel: Efficient Triton Kernels for","venue":"arXiv (Cornell University)","work_id":"ce624c61-a8db-44ff-9646-e09326d1328e","year":2024},"citing_paper":{"arxiv_id":"2605.19269","last_updated":"2026-05-20T17:38:24Z","snapshot_observed_at":"2026-07-06T23:30:02.207108Z","submitted_at":"2026-05-19T02:30:43Z","title":"CODA: Rewriting Transformer Blocks as GEMM-Epilogue Programs","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-20T07:19:22.751655Z"},"links":{"cited_paper":"/paper/2410.10989","citing_paper":"/paper/2605.19269"},"observation_digest":"sha256:04c60d8a76348dbf91f3f694082f0025baf24f18a91eb6b3feb1ce8409c20c22","observation_id":"cc985b1d-34a0-464b-9808-d2b9d17b121a","resolution":{"observed_at":"2026-05-20T07:23:07.117366Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-05-24T05:54:39.54334+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-24T05:54:39.54334+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.10989","last_updated":"2025-01-24T00:14:55Z","snapshot_observed_at":"2026-07-06T19:33:26.078722Z","submitted_at":"2024-10-14T18:17:01Z","title":"Liger Kernel: Efficient Triton Kernels for LLM Training","version":3},"cited_work":{"arxiv_id":"2410.10989","doi":"10.48550/arxiv.2410.10989","metadata_source":"arxiv_reference","pith_arxiv_id":"2410.10989","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Liger Kernel: Efficient Triton Kernels for","venue":"arXiv (Cornell University)","work_id":"ce624c61-a8db-44ff-9646-e09326d1328e","year":2024},"citing_paper":{"arxiv_id":"2605.19269","last_updated":"2026-05-20T17:38:24Z","snapshot_observed_at":"2026-07-06T23:30:02.207108Z","submitted_at":"2026-05-19T02:30:43Z","title":"CODA: Rewriting Transformer Blocks as GEMM-Epilogue Programs","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-21T07:20:56.839167Z"},"links":{"cited_paper":"/paper/2410.10989","citing_paper":"/paper/2605.19269"},"observation_digest":"sha256:e66e0d5e74778e7f56ae55f62b402f6a887ea788756f3450d2d266527b722eee","observation_id":"5b7cf11d-6126-474c-9135-42e5a85a5904","resolution":{"observed_at":"2026-05-21T07:24:02.555799Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-05-24T05:54:39.54334+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-24T05:54:39.54334+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.10989","last_updated":"2025-01-24T00:14:55Z","snapshot_observed_at":"2026-07-06T19:33:26.078722Z","submitted_at":"2024-10-14T18:17:01Z","title":"Liger Kernel: Efficient Triton Kernels for LLM Training","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.10989","snapshot_observed_at":"2026-07-12T23:41:46.854165Z","title":"Liger Kernel: Efficient Triton kernels for LLM training.arXiv preprint arXiv:2410.10989,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2605.28827","last_updated":"2026-04-10T00:56:50Z","snapshot_observed_at":"2026-08-07T22:59:38.423679Z","submitted_at":"2026-04-10T00:56:50Z","title":"RightNow-Arabic-0.5B-Turbo: An Open Sub-1B Arabic Language Model via Vocabulary Injection and Edge-First Deployment","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-07-12T23:41:46.854165Z"},"links":{"cited_paper":"/paper/2410.10989","citing_paper":"/paper/2605.28827"},"observation_digest":"sha256:49fafe37559e61832442626fde6437d35ab7b1075bf1079ff257873146dfc236","observation_id":"d0439929-9909-4fe5-9b59-49535bf4d96a","resolution":{"observed_at":"2026-07-12T23:41:46.854165Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.10989","last_updated":"2025-01-24T00:14:55Z","snapshot_observed_at":"2026-07-06T19:33:26.078722Z","submitted_at":"2024-10-14T18:17:01Z","title":"Liger Kernel: Efficient Triton Kernels for LLM Training","version":3},"cited_work":{"arxiv_id":"2410.10989","doi":"10.48550/arxiv.2410.10989","metadata_source":"arxiv_reference","pith_arxiv_id":"2410.10989","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Liger Kernel: Efficient Triton Kernels for","venue":"arXiv (Cornell University)","work_id":"ce624c61-a8db-44ff-9646-e09326d1328e","year":2024},"citing_paper":{"arxiv_id":"2606.13578","last_updated":"2026-06-11T17:03:53Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-06-11T17:03:53Z","title":"LabVLA: Grounding Vision-Language-Action Models in Scientific Laboratories","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-06-27T06:53:49.349808Z"},"links":{"cited_paper":"/paper/2410.10989","citing_paper":"/paper/2606.13578"},"observation_digest":"sha256:ae939fffeb092be9b5ca2c6b06e1271ab2c389c9586c5865ded37e5251bc508f","observation_id":"f9f7eab8-c32d-4920-868f-18535a3d8d19","resolution":{"observed_at":"2026-07-03T14:48:33.487777Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-05-24T05:54:39.54334+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-24T05:54:39.54334+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.10989","last_updated":"2025-01-24T00:14:55Z","snapshot_observed_at":"2026-07-06T19:33:26.078722Z","submitted_at":"2024-10-14T18:17:01Z","title":"Liger Kernel: Efficient Triton Kernels for LLM Training","version":3},"cited_work":{"arxiv_id":"2410.10989","doi":"10.48550/arxiv.2410.10989","metadata_source":"arxiv_reference","pith_arxiv_id":"2410.10989","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Liger Kernel: Efficient Triton Kernels for","venue":"arXiv (Cornell University)","work_id":"ce624c61-a8db-44ff-9646-e09326d1328e","year":2024},"citing_paper":{"arxiv_id":"2606.24937","last_updated":"2026-07-27T15:17:17Z","snapshot_observed_at":"2026-08-02T23:19:25.465662Z","submitted_at":"2026-06-22T17:48:54Z","title":"The Hitchhiker's Guide to Agentic AI: From Foundations to Systems","version":1},"reference_index":98,"source":"pdf_text","source_observed_at":"2026-06-26T08:09:57.542558Z"},"links":{"cited_paper":"/paper/2410.10989","citing_paper":"/paper/2606.24937"},"observation_digest":"sha256:0df611e457cf065095d380b2d7d184f7daf14a6fa29c4ab9a359ff95920dce85","observation_id":"cb7a781b-31a5-4445-8fde-45448adadfb8","resolution":{"observed_at":"2026-07-04T11:09:46.478143Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-05-24T05:54:39.54334+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-24T05:54:39.54334+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.10989","last_updated":"2025-01-24T00:14:55Z","snapshot_observed_at":"2026-07-06T19:33:26.078722Z","submitted_at":"2024-10-14T18:17:01Z","title":"Liger Kernel: Efficient Triton Kernels for LLM Training","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.10989","snapshot_observed_at":"2026-08-02T10:27:17.240833Z","title":"Liger-Kernel: Efficient Triton Kernels for LLM Training.arXiv Preprint arXiv:2410.10989, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.24937","last_updated":"2026-07-27T15:17:17Z","snapshot_observed_at":"2026-08-02T23:19:25.465662Z","submitted_at":"2026-06-22T17:48:54Z","title":"The Hitchhiker's Guide to Agentic AI: From Foundations to Systems","version":2},"reference_index":98,"source":"pdf_text","source_observed_at":"2026-08-02T10:27:17.240833Z"},"links":{"cited_paper":"/paper/2410.10989","citing_paper":"/paper/2606.24937"},"observation_digest":"sha256:7aa7f155f939a557d834253b4ca239827ca1a76a69e532c4fb3a4ca36f3ca1fd","observation_id":"4ecb26e8-b104-4caa-989d-4864b88023f2","resolution":{"observed_at":"2026-08-02T10:27:17.240833Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.10989","last_updated":"2025-01-24T00:14:55Z","snapshot_observed_at":"2026-07-06T19:33:26.078722Z","submitted_at":"2024-10-14T18:17:01Z","title":"Liger Kernel: Efficient Triton Kernels for LLM Training","version":3},"cited_work":{"arxiv_id":"2410.10989","doi":"10.48550/arxiv.2410.10989","metadata_source":"arxiv_reference","pith_arxiv_id":"2410.10989","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Liger Kernel: Efficient Triton Kernels for","venue":"arXiv (Cornell University)","work_id":"ce624c61-a8db-44ff-9646-e09326d1328e","year":2024},"citing_paper":{"arxiv_id":"2606.28593","last_updated":"2026-06-26T20:38:04Z","snapshot_observed_at":"2026-07-07T00:02:38.226622Z","submitted_at":"2026-06-26T20:38:04Z","title":"Animation2Code: Evaluating Temporal Visual Reasoning in Video-to-Code Generation","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-06-30T00:53:52.724902Z"},"links":{"cited_paper":"/paper/2410.10989","citing_paper":"/paper/2606.28593"},"observation_digest":"sha256:8fe4cf491043248619460bd1256ee21c25b79c06c3101f6d42b49b2a8bb5c4c6","observation_id":"dbf2d393-17e5-47d8-bbef-e1099b506db6","resolution":{"observed_at":"2026-07-01T16:05:49.753887Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-05-24T05:54:39.54334+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-24T05:54:39.54334+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.10989","last_updated":"2025-01-24T00:14:55Z","snapshot_observed_at":"2026-07-06T19:33:26.078722Z","submitted_at":"2024-10-14T18:17:01Z","title":"Liger Kernel: Efficient Triton Kernels for LLM Training","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.10989","snapshot_observed_at":"2026-08-01T10:42:39.291065Z","title":"CoRR , volume =","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.20145","last_updated":"2026-07-30T09:30:44Z","snapshot_observed_at":"2026-08-03T18:47:24.558536Z","submitted_at":"2026-07-22T13:49:17Z","title":"SLAI T-Rex: Full-Parameter Post-training of the DeepSeek-V4 Family on Ascend SuperPOD","version":2},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-01T10:42:39.291065Z"},"links":{"cited_paper":"/paper/2410.10989","citing_paper":"/paper/2607.20145"},"observation_digest":"sha256:ac39c061d1b7f7f32279e7a418d48b814526c0eddaca1ae9f9de344296be701e","observation_id":"ac74de85-89ad-49d8-82c2-2622d1e69176","resolution":{"observed_at":"2026-08-01T10:42:39.291065Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2410.10989/citation-record","integrity":"/paper/2410.10989/integrity","json":"/paper/2410.10989/citation-record.json","paper":"/paper/2410.10989"},"outbound":[],"paper":{"arxiv_id":"2410.10989","last_updated":"2025-01-24T00:14:55Z","latest_version":3,"primary_category":"cs.LG","snapshot_observed_at":"2026-07-06T19:33:26.078722Z","submitted_at":"2024-10-14T18:17:01Z","title":"Liger Kernel: Efficient Triton Kernels for LLM Training"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 32 inbound Pith citation observations for arXiv:2410.10989."}