Pith. sign in

Paper Citation Record · LEDGER

Frenzy: A Memory-Aware Serverless LLM Training System for Heterogeneous GPU Clusters

As of 23 August 2026, this Paper Citation Record lists 25 of 25 outbound references and 0 inbound Pith citation observations for arXiv:2412.14479.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2412.14479 v1

Coverage vector

measured 25 of 25 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links, observed 2026-08-11T12:14:55.360844Z

measured 25 of 25 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-23T06:30:58.430688+00:00

measured 0 of 0 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: cited_works

Reference resolution

25 of 25 outbound references displayed

  • verified exact0
  • verified fuzzy19
  • unresolved6
  • parse uncertain0
  • malformed identifier0
  • metadata mismatch0

External citation measurements

No source-named external measurement is stored.

Outbound references

Observation ae8fec54-416c-472a-9296-3ef9ed2cddd7 · outbound

This paper cites Alpa: Automating inter-and Intra-Operator par- allelism for distributed deep learning.

Frenzy: A Memory-Aware Serverless LLM Training System for Heterogeneous GPU Clusters Alpa: Automating inter-and Intra-Operator par- allelism for distributed deep learning

Reference 1

Resolution
verified fuzzy
raw_fallback, observed 2026-08-11T12:14:55.675392Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.

source=pdf_text observed=2026-08-11T12:14:55.261499Z digest=sha256:08dcc932faecca40a1bf7e1eb7d49ce551ce53fe5437607a786d5384aea8fb13

Observation c403b99b-39ab-4437-8ef8-06ddaa2e0cc6 · outbound

This paper cites Pollux: Co-adaptive cluster scheduling for goodput- optimized deep learning.

Frenzy: A Memory-Aware Serverless LLM Training System for Heterogeneous GPU Clusters Pollux: Co-adaptive cluster scheduling for goodput- optimized deep learning

Reference 2

Resolution
verified fuzzy
raw_fallback, observed 2026-08-11T12:14:55.663170Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.

source=pdf_text observed=2026-08-11T12:14:55.267054Z digest=sha256:f48bd4189a9339e8c898c5d259576d80d52d0ba06a624c92c9586dff37b2f432

Observation 8035032e-9600-4800-a0ef-3f0b1eea707f · outbound

This paper cites Gandiva: Introspective cluster scheduling for deep learning.

Frenzy: A Memory-Aware Serverless LLM Training System for Heterogeneous GPU Clusters Gandiva: Introspective cluster scheduling for deep learning

Reference 3

Resolution
verified fuzzy
raw_fallback, observed 2026-08-11T12:14:55.651979Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.

source=pdf_text observed=2026-08-11T12:14:55.271220Z digest=sha256:f4b4ae510a8b3e72efa8a3610386ad38b451102318224696fe0b757feedb3db8

Observation a80d7ffb-9629-4a90-a674-366278c2eb46 · outbound

This paper cites MLaaS in the wild: Workload analysis and scheduling in Large-Scale heterogeneous GPU clusters.

Frenzy: A Memory-Aware Serverless LLM Training System for Heterogeneous GPU Clusters MLaaS in the wild: Workload analysis and scheduling in Large-Scale heterogeneous GPU clusters

Reference 4

Resolution
verified fuzzy
raw_fallback, observed 2026-08-11T12:14:55.641505Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.

source=pdf_text observed=2026-08-11T12:14:55.275424Z digest=sha256:0f5b3660d7678f0aaab76cbb0b6a98edff91129dbda491d77efbbc8b57c5885d

Observation 2da4bed1-e040-4f41-890d-10a98183a836 · outbound

This paper cites Analysis of Large-ScaleMulti-TenantGPU clus- ters for DNN training workloads.

Frenzy: A Memory-Aware Serverless LLM Training System for Heterogeneous GPU Clusters Analysis of Large-ScaleMulti-TenantGPU clus- ters for DNN training workloads

Reference 5

Resolution
verified fuzzy
raw_fallback, observed 2026-08-11T12:14:55.630128Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.

source=pdf_text observed=2026-08-11T12:14:55.279526Z digest=sha256:67ef71f4c172fb351535ba7a6886d97154320698e7f85753d0a5727f693a87c7

Observation 0d2d79c3-42cb-4aee-b1c3-1684cb3880b2 · outbound

This paper cites Heterogeneity-Aware cluster scheduling policies for deep learning workloads.

Frenzy: A Memory-Aware Serverless LLM Training System for Heterogeneous GPU Clusters Heterogeneity-Aware cluster scheduling policies for deep learning workloads

Reference 6

Resolution
verified fuzzy
raw_fallback, observed 2026-08-11T12:14:55.619249Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.

source=pdf_text observed=2026-08-11T12:14:55.283956Z digest=sha256:c8120bc7f517b2b061ff1d5c0533b64a46fef6125df48dad0dd9a85aae9a69e1

Observation e5a7d26c-d720-453c-ae0a-6c385f570e53 · outbound

This paper cites Metis: Fast Automatic Distributed Training on Heterogeneous GPUs.

Frenzy: A Memory-Aware Serverless LLM Training System for Heterogeneous GPU Clusters Metis: Fast Automatic Distributed Training on Heterogeneous GPUs

Reference 7

Resolution
verified fuzzy
raw_fallback, observed 2026-08-11T12:14:55.607942Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.

source=pdf_text observed=2026-08-11T12:14:55.288208Z digest=sha256:92ac2856cc95548b834aab1a88cecddbe6c36a78a6182dd04b44b171915a17c6

Observation c02e8192-5b43-4cbc-a9db-4cab68159044 · outbound

This paper cites Sia: Heterogeneity-aware, goodput- optimized ML-cluster scheduling.

Frenzy: A Memory-Aware Serverless LLM Training System for Heterogeneous GPU Clusters Sia: Heterogeneity-aware, goodput- optimized ML-cluster scheduling

Reference 8

Resolution
verified fuzzy
raw_fallback, observed 2026-08-11T12:14:55.596700Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.

source=pdf_text observed=2026-08-11T12:14:55.292016Z digest=sha256:74106c44bb1b77d42265e85d1357e6c10552b48d05092ecc3565dc6f23cfe87f

Observation 65b0f783-c6a5-4224-8aa2-0c9c3620c7c3 · outbound

This paper cites ElasticFlow: An elastic serverless training platform for distributed deep learning.

Frenzy: A Memory-Aware Serverless LLM Training System for Heterogeneous GPU Clusters ElasticFlow: An elastic serverless training platform for distributed deep learning

Reference 9

Resolution
verified fuzzy
raw_fallback, observed 2026-08-11T12:14:55.585497Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.

source=pdf_text observed=2026-08-11T12:14:55.295584Z digest=sha256:56f00900ab53f9b6f87099f85aa4c5a366622d88f26495350f18b7ce749ebf60

Observation 428f75cc-f0ca-4e76-8ddb-6a0a2f893fe4 · outbound

This paper cites GPT-4 Technical Report.

Frenzy: A Memory-Aware Serverless LLM Training System for Heterogeneous GPU Clusters GPT-4 Technical Report

Reference 10

Resolution
unresolved
no resolver link, observed 2026-08-11T12:14:55.299418Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-11T12:14:55.299418Z digest=sha256:5665c87fe782e627b664954126fb0bd28d12b2f27f0cb1974819f0a0c132fe05

Observation 4b4829ac-187e-4b1e-bc5d-3b39945cd146 · outbound

This paper cites SeamlessM4T: Massively Multilingual & Multimodal Machine Translation.

Frenzy: A Memory-Aware Serverless LLM Training System for Heterogeneous GPU Clusters SeamlessM4T: Massively Multilingual & Multimodal Machine Translation

Reference 11

Resolution
unresolved
no resolver link, observed 2026-08-11T12:14:55.303352Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-11T12:14:55.303352Z digest=sha256:dbbd06f5896a8de28b5ea3616dbba86fcba42e1df15b4e9e3bb72414f9d7d651

Observation f2b4cfa1-5d4a-487f-8e8f-80ed16d823fb · outbound

This paper cites NVIDIA A100 Tensor Core GPU.

Frenzy: A Memory-Aware Serverless LLM Training System for Heterogeneous GPU Clusters NVIDIA A100 Tensor Core GPU

Reference 12

Resolution
verified fuzzy
raw_fallback, observed 2026-08-11T12:14:55.573911Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.

source=pdf_text observed=2026-08-11T12:14:55.307666Z digest=sha256:b0ec50533bde4e42ceb5d32d961bd858842ea50cb3d66766056b46a24e1893b3

Observation 63669b9e-9d4e-40e5-b3be-020cf39746ae · outbound

This paper cites NVIDIA GeForce RTX 3090.

Frenzy: A Memory-Aware Serverless LLM Training System for Heterogeneous GPU Clusters NVIDIA GeForce RTX 3090

Reference 13

Resolution
verified fuzzy
raw_fallback, observed 2026-08-11T12:14:55.561048Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.

source=pdf_text observed=2026-08-11T12:14:55.311624Z digest=sha256:a885aab57bcb07de9ad580cb33f441786016d469baeaf77650a20e70ed45e06f

Observation 043e9fc0-7ce2-491d-92c7-2f32d50692b5 · outbound

This paper cites Zero: Memory optimizations toward training trillion parameter models.

Frenzy: A Memory-Aware Serverless LLM Training System for Heterogeneous GPU Clusters Zero: Memory optimizations toward training trillion parameter models

Reference 14

Resolution
verified fuzzy
raw_fallback, observed 2026-08-11T12:14:55.549763Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.

source=pdf_text observed=2026-08-11T12:14:55.317194Z digest=sha256:9822e2961996c893df2795c178fc192352bd15ff9cbfd7eaea88226d20b82537

Observation 84b7da39-eb1c-485d-a337-cd5d4fa2b496 · outbound

This paper cites Megatron-LM: Training Multi-Billion Parameter Language Models Using Model Parallelism.

Frenzy: A Memory-Aware Serverless LLM Training System for Heterogeneous GPU Clusters Megatron-LM: Training Multi-Billion Parameter Language Models Using Model Parallelism

Reference 15

Resolution
unresolved
no resolver link, observed 2026-08-11T12:14:55.321022Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-11T12:14:55.321022Z digest=sha256:bedd08b117a755e3c50b8cb5ef6fcf0c104a3ce3b71e549fb381afd389c1a4bf

Observation 3302a074-504f-4a7c-8cba-3081449a6095 · outbound

This paper cites Mixed Precision Training.

Frenzy: A Memory-Aware Serverless LLM Training System for Heterogeneous GPU Clusters Mixed Precision Training

Reference 16

Resolution
unresolved
no resolver link, observed 2026-08-11T12:14:55.325560Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-11T12:14:55.325560Z digest=sha256:80a419d1e2eb8f872692ca603cb3c6d315c502507855751fdc43d9846955a6d0

Observation 94f5bc3a-f873-46d3-9abb-8430b8ab502d · outbound

This paper cites Adam: A Method for Stochastic Optimization.

Frenzy: A Memory-Aware Serverless LLM Training System for Heterogeneous GPU Clusters Adam: A Method for Stochastic Optimization

Reference 17

Resolution
unresolved
no resolver link, observed 2026-08-11T12:14:55.329757Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-11T12:14:55.329757Z digest=sha256:2312dda80996ca2b38351f1ff938d4492f6cda1db96838c7dde6eb218f05d306

Observation c92feb96-0c8d-4aba-b4a8-e3a9372cd2ba · outbound

This paper cites Large-scale machine learning with stochastic gradient de- scent.

Frenzy: A Memory-Aware Serverless LLM Training System for Heterogeneous GPU Clusters Large-scale machine learning with stochastic gradient de- scent

Reference 18

Resolution
verified fuzzy
raw_fallback, observed 2026-08-11T12:14:55.539192Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.

source=pdf_text observed=2026-08-11T12:14:55.334020Z digest=sha256:8ff5c14c53f61fdef358fdb424d4bf77420e69038988ec4515f0c8eb42d18c9b

Observation e82ce945-7301-479d-981d-7e4d0c65ac9c · outbound

This paper cites Reducing activation recomputation in large transformer models.

Frenzy: A Memory-Aware Serverless LLM Training System for Heterogeneous GPU Clusters Reducing activation recomputation in large transformer models

Reference 19

Resolution
verified fuzzy
raw_fallback, observed 2026-08-11T12:14:55.526701Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.

source=pdf_text observed=2026-08-11T12:14:55.337565Z digest=sha256:af0e45f60ecfd1747ea52dc94655395a054c0fd2f8afff5681abc72f11fd5d7c

Observation 302bf02f-c96d-4e00-8a0f-16147af2ee00 · outbound

This paper cites Characterization and prediction of deep learning workloads in large-scale gpu datacenters.

Frenzy: A Memory-Aware Serverless LLM Training System for Heterogeneous GPU Clusters Characterization and prediction of deep learning workloads in large-scale gpu datacenters

Reference 20

Resolution
verified fuzzy
raw_fallback, observed 2026-08-11T12:14:55.513779Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.

source=pdf_text observed=2026-08-11T12:14:55.341741Z digest=sha256:2bb41c7423988b643fc50369626d133c521852a81c229b2deb47303732fec475

Observation 329a1a4f-77aa-4c03-8930-23642ec62a6f · outbound

This paper cites Language models are unsupervised multitask learners.

Frenzy: A Memory-Aware Serverless LLM Training System for Heterogeneous GPU Clusters Language models are unsupervised multitask learners

Reference 21

Resolution
verified fuzzy
raw_fallback, observed 2026-08-11T12:14:55.501211Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.

source=pdf_text observed=2026-08-11T12:14:55.345168Z digest=sha256:f1e858ccde2d9d0587c48c94339966ac0f3799e561c3bf18c771612def603280

Observation ef51dec7-b53e-4bc1-a763-65a4b95f699c · outbound

This paper cites Bert: Pre-training of deep bidirectional transformers for language understanding.

Frenzy: A Memory-Aware Serverless LLM Training System for Heterogeneous GPU Clusters Bert: Pre-training of deep bidirectional transformers for language understanding

Reference 22

Resolution
verified fuzzy
raw_fallback, observed 2026-08-11T12:14:55.490012Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.

source=pdf_text observed=2026-08-11T12:14:55.348818Z digest=sha256:d13e83b8c4bc64476faca1ea0616673088cd08cf475f439d7f57b97432dafee6

Observation 2710d09d-b12b-4235-b658-9a1755ba129f · outbound

This paper cites Lyra: Elastic scheduling for deep learning clusters[C]//Proceedings of the Eighteenth European Conference on Computer Systems.

Frenzy: A Memory-Aware Serverless LLM Training System for Heterogeneous GPU Clusters Lyra: Elastic scheduling for deep learning clusters[C]//Proceedings of the Eighteenth European Conference on Computer Systems

Reference 23

Resolution
verified fuzzy
raw_fallback, observed 2026-08-11T12:14:55.477812Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.

source=pdf_text observed=2026-08-11T12:14:55.353221Z digest=sha256:42230f70c5d2a6bf39fe1cb4ebe8894baa1f7f649450448a92175b7015366494

Observation bbb16645-0ea6-42b1-a28f-1be799a4d9db · outbound

This paper cites Using DeepSpeed and Megatron to Train Megatron-Turing NLG 530B, A Large-Scale Generative Language Model.

Frenzy: A Memory-Aware Serverless LLM Training System for Heterogeneous GPU Clusters Using DeepSpeed and Megatron to Train Megatron-Turing NLG 530B, A Large-Scale Generative Language Model

Reference 24

Resolution
unresolved
no resolver link, observed 2026-08-11T12:14:55.357050Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-11T12:14:55.357050Z digest=sha256:8cfd44ccaec20fb24ae9af829a989abe2746cc510345e72e0ca095030c083dea

Observation aff5d7bb-bb1e-4d0f-9267-d9b8751965dc · outbound

This paper cites Alibaba clusterdata.

Frenzy: A Memory-Aware Serverless LLM Training System for Heterogeneous GPU Clusters Alibaba clusterdata

Reference 25

Resolution
verified fuzzy
raw_fallback, observed 2026-08-11T12:14:55.464749Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.

source=pdf_text observed=2026-08-11T12:14:55.360844Z digest=sha256:e2b86cb8e832d9abc736d2ddf0a215f24af4538d475d917c149a426624889169

Pith citing papers

No inbound Pith citation observations are available.