Pith. sign in

Paper Citation Record · LEDGER

MOCAP: Wafer-Scale-Chip-Oriented Memory-Orchestrated Chunked Pipelining Framework for Prefill-Only LLM Inference

As of 22 August 2026, this Paper Citation Record lists 41 of 41 outbound references and 1 inbound Pith citation observation for arXiv:2606.22968.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2606.22968 v1

Coverage vector

measured 41 of 41 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links, observed 2026-06-26T06:26:59.984686Z

measured 42 of 42 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-22T06:32:14.747728+00:00

measured 1 of 1 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links, observed 2026-08-05T21:50:52.423769Z

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: pith, observed 2026-08-05T21:50:53.152351Z

Reference resolution

41 of 41 outbound references displayed

  • verified exact3
  • verified fuzzy0
  • unresolved37
  • parse uncertain0
  • malformed identifier0
  • metadata mismatch1

External citation measurements

No source-named external measurement is stored.

Outbound references

Observation f5c072c1-75e7-4512-bfbd-b2215cd3feb2 · outbound

This paper cites In: Proceedings of the ACM SIGOPS 31st Symposium on Operating Systems Princi- ples.

MOCAP: Wafer-Scale-Chip-Oriented Memory-Orchestrated Chunked Pipelining Framework for Prefill-Only LLM Inference In: Proceedings of the ACM SIGOPS 31st Symposium on Operating Systems Princi- ples

Reference 1

Resolution
unresolved
no resolver link, observed 2026-06-26T06:26:59.984686Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-06-26T06:26:59.984686Z digest=sha256:1b65a28f6f880ae9d3f30daba0a422d886f41663c4d6399c857af5b39684f418

Observation 3c903882-7d1c-40c9-a29e-71ccea2f3404 · outbound

This paper cites PALM: A Efficient Performance Simulator for Tiled Accelerators with Large-scale Model Training.

MOCAP: Wafer-Scale-Chip-Oriented Memory-Orchestrated Chunked Pipelining Framework for Prefill-Only LLM Inference PALM: A Efficient Performance Simulator for Tiled Accelerators with Large-scale Model Training

Reference 2

Resolution
verified exact
arxiv_id, observed 2026-07-04T12:39:49.229562Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.

source=pdf_text observed=2026-06-26T06:26:59.984686Z digest=sha256:cf8f811d98454b4713336d301c2de52a746e49985ace2a88470444216f6eab52

Observation 602676aa-5bc4-4c26-8bcc-5f0d44667e6a · outbound

This paper cites WaferLLM: Large Language Model Inference at Wafer Scale.

MOCAP: Wafer-Scale-Chip-Oriented Memory-Orchestrated Chunked Pipelining Framework for Prefill-Only LLM Inference WaferLLM: Large Language Model Inference at Wafer Scale

Reference 3

Resolution
verified exact
arxiv_id, observed 2026-07-04T12:39:49.221490Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.

source=pdf_text observed=2026-06-26T06:26:59.984686Z digest=sha256:cb26c15b447f7e995ee72dd187d638522a8c822dfaa40d6cc81439902173d0e1

Observation b3d1d655-9327-42bd-80dc-dfed180bc5e1 · outbound

This paper cites IEEE Circuits and Systems Magazine24(1), 52–81 (2024).

MOCAP: Wafer-Scale-Chip-Oriented Memory-Orchestrated Chunked Pipelining Framework for Prefill-Only LLM Inference IEEE Circuits and Systems Magazine24(1), 52–81 (2024)

Reference 4

Resolution
unresolved
no resolver link, observed 2026-06-26T06:26:59.984686Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-06-26T06:26:59.984686Z digest=sha256:2dd3431361568c7de72aecf753e8aa7c84fbf7a6fe18f675594d9633556117d2

Observation d6613e2b-d9cd-49a9-b647-bb700e1331a1 · outbound

This paper cites Advances in neural information processing systems32(2019).

MOCAP: Wafer-Scale-Chip-Oriented Memory-Orchestrated Chunked Pipelining Framework for Prefill-Only LLM Inference Advances in neural information processing systems32(2019)

Reference 5

Resolution
unresolved
no resolver link, observed 2026-06-26T06:26:59.984686Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-06-26T06:26:59.984686Z digest=sha256:bd88221264233fa73188de9b7847e17a1ad739a520031dc93663fa77285758c7

Observation 0f2b4e95-6100-406f-8ccc-1b177cafbf21 · outbound

This paper cites In: International Conference on Machine Learning.

MOCAP: Wafer-Scale-Chip-Oriented Memory-Orchestrated Chunked Pipelining Framework for Prefill-Only LLM Inference In: International Conference on Machine Learning

Reference 6

Resolution
unresolved
no resolver link, observed 2026-06-26T06:26:59.984686Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-06-26T06:26:59.984686Z digest=sha256:59d5d9423fa8e922e6f8bf53168a5b8ece9bb263c9ab41382b5c48c8de52b06b

Observation 5caec8c2-7734-47b9-8182-331c074a4dd4 · outbound

This paper cites IEEE Transactions on Circuits and Systems I: Regular Papers (2025).

MOCAP: Wafer-Scale-Chip-Oriented Memory-Orchestrated Chunked Pipelining Framework for Prefill-Only LLM Inference IEEE Transactions on Circuits and Systems I: Regular Papers (2025)

Reference 7

Resolution
unresolved
no resolver link, observed 2026-06-26T06:26:59.984686Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-06-26T06:26:59.984686Z digest=sha256:402c7492e149705fd42cbf51b44454f3283b2e906182e71dc59b0ec8136888ee

Observation 7fa9a676-78f2-480b-9f1c-49e941086941 · outbound

This paper cites In: 2026 IEEE International Symposium on High Performance Computer Architecture (HPCA).

MOCAP: Wafer-Scale-Chip-Oriented Memory-Orchestrated Chunked Pipelining Framework for Prefill-Only LLM Inference In: 2026 IEEE International Symposium on High Performance Computer Architecture (HPCA)

Reference 8

Resolution
unresolved
no resolver link, observed 2026-06-26T06:26:59.984686Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-06-26T06:26:59.984686Z digest=sha256:544267a0ea51ee3c346b420def994cdbd3cc481386d4f9352acbe75118b9752f

Observation 3d7f6b93-684b-4256-bb98-452874fd9810 · outbound

This paper cites In: International Conference on Machine Learning.

MOCAP: Wafer-Scale-Chip-Oriented Memory-Orchestrated Chunked Pipelining Framework for Prefill-Only LLM Inference In: International Conference on Machine Learning

Reference 9

Resolution
unresolved
no resolver link, observed 2026-06-26T06:26:59.984686Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-06-26T06:26:59.984686Z digest=sha256:17434d1054fad298e21eb0ce09bb3af6280c850651828e5107bf09aa5faa04c8

Observation eafb6db0-1498-427f-87fb-f7cded1c0970 · outbound

This paper cites In: 2022 IEEE Hot Chips 34 Symposium (HCS).

MOCAP: Wafer-Scale-Chip-Oriented Memory-Orchestrated Chunked Pipelining Framework for Prefill-Only LLM Inference In: 2022 IEEE Hot Chips 34 Symposium (HCS)

Reference 10

Resolution
unresolved
no resolver link, observed 2026-06-26T06:26:59.984686Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-06-26T06:26:59.984686Z digest=sha256:195a429bdf3a357d8d7feefdce76995c9abaacca38d7ffb916a630e19c82d62e

Observation dff5c0af-e544-4e65-942f-3a8b60470d05 · outbound

This paper cites In: Proceedings of the 31st ACM International Conference on Architectural Support for Programming Languages and Operating Systems, Volume 2.

MOCAP: Wafer-Scale-Chip-Oriented Memory-Orchestrated Chunked Pipelining Framework for Prefill-Only LLM Inference In: Proceedings of the 31st ACM International Conference on Architectural Support for Programming Languages and Operating Systems, Volume 2

Reference 11

Resolution
unresolved
no resolver link, observed 2026-06-26T06:26:59.984686Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-06-26T06:26:59.984686Z digest=sha256:1a1dbee9b5409dcfed863c974c3190ac43092da83b63cb71ec33b0671fd01564

Observation 596d0626-2518-4580-89a5-88a6927d6dea · outbound

This paper cites In: MICRO- 54: 54th Annual IEEE/ACM International Symposium on Microarchitecture.

MOCAP: Wafer-Scale-Chip-Oriented Memory-Orchestrated Chunked Pipelining Framework for Prefill-Only LLM Inference In: MICRO- 54: 54th Annual IEEE/ACM International Symposium on Microarchitecture

Reference 12

Resolution
unresolved
no resolver link, observed 2026-06-26T06:26:59.984686Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-06-26T06:26:59.984686Z digest=sha256:3e5061742d2b061d47e3a9aade2a001d668df9284d699db7bb555b4dfdf3fa68

Observation 29156ffe-abd8-4ed3-baac-635d78816ba5 · outbound

This paper cites Available:https://huggingface.co/ meta-llama/Meta-Llama-3-70B.

MOCAP: Wafer-Scale-Chip-Oriented Memory-Orchestrated Chunked Pipelining Framework for Prefill-Only LLM Inference Available:https://huggingface.co/ meta-llama/Meta-Llama-3-70B

Reference 13

Resolution
unresolved
no resolver link, observed 2026-06-26T06:26:59.984686Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-06-26T06:26:59.984686Z digest=sha256:0f3bbc7422b80f99a989617f16cdb1a01d3984b83df0c242ad605a28a561a097

Observation 14bd7cb1-7db7-4994-b834-9d26d93a1def · outbound

This paper cites Available:https://huggingface.co/ meta-llama/Llama-3.1-405B.

MOCAP: Wafer-Scale-Chip-Oriented Memory-Orchestrated Chunked Pipelining Framework for Prefill-Only LLM Inference Available:https://huggingface.co/ meta-llama/Llama-3.1-405B

Reference 14

Resolution
unresolved
no resolver link, observed 2026-06-26T06:26:59.984686Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-06-26T06:26:59.984686Z digest=sha256:7669785088d07ab2d248cbd33f3e8e42c79a669986407ed12dcf6d77499667ac

Observation fed372b1-01c3-46c5-8485-d5c14ac56b01 · outbound

This paper cites Available:https:// huggingface.co/mistralai/Mistral-Large-Instruct-2407.

MOCAP: Wafer-Scale-Chip-Oriented Memory-Orchestrated Chunked Pipelining Framework for Prefill-Only LLM Inference Available:https:// huggingface.co/mistralai/Mistral-Large-Instruct-2407

Reference 15

Resolution
unresolved
no resolver link, observed 2026-06-26T06:26:59.984686Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-06-26T06:26:59.984686Z digest=sha256:eb64e96e3bb615f28c7cf1f4b6ed38864385cad51bf9f742171962434b9a6923

Observation 93d7c482-393c-4c02-a56f-dc743b43ac55 · outbound

This paper cites In: 2025 IEEE International Solid-State Circuits Conference (ISSCC).

MOCAP: Wafer-Scale-Chip-Oriented Memory-Orchestrated Chunked Pipelining Framework for Prefill-Only LLM Inference In: 2025 IEEE International Solid-State Circuits Conference (ISSCC)

Reference 16

Resolution
unresolved
no resolver link, observed 2026-06-26T06:26:59.984686Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-06-26T06:26:59.984686Z digest=sha256:db1e8145b45f09f029232173cb7a8394cb2a1f1f9f443a18e7d3543071808698

Observation beba5489-f8ef-4b14-a692-d0bcb33bc3d3 · outbound

This paper cites Available:https: //www.nvidia.com/en-us/data-center/dgx-vera-rubin-nvl72/.

MOCAP: Wafer-Scale-Chip-Oriented Memory-Orchestrated Chunked Pipelining Framework for Prefill-Only LLM Inference Available:https: //www.nvidia.com/en-us/data-center/dgx-vera-rubin-nvl72/

Reference 17

Resolution
unresolved
no resolver link, observed 2026-06-26T06:26:59.984686Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-06-26T06:26:59.984686Z digest=sha256:15b6629eaf83172e18cb8730eeb4febb686db314c334035ed584dbe61d3a5e27

Observation 0631fbe1-3e0d-4ebe-b4f9-63aaa3889ac9 · outbound

This paper cites In: 2021 58th ACM/IEEE Design Au- tomation Conference (DAC).

MOCAP: Wafer-Scale-Chip-Oriented Memory-Orchestrated Chunked Pipelining Framework for Prefill-Only LLM Inference In: 2021 58th ACM/IEEE Design Au- tomation Conference (DAC)

Reference 18

Resolution
unresolved
no resolver link, observed 2026-06-26T06:26:59.984686Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-06-26T06:26:59.984686Z digest=sha256:49ed3f1c170064d18554df1a280eb29692268ea7ebed218c935bd40a4254867f

Observation 401496bc-e95e-4904-aa2b-663a4cd8f246 · outbound

This paper cites Available:https://huggingface.co/ Qwen/Qwen3-235B-A22B.

MOCAP: Wafer-Scale-Chip-Oriented Memory-Orchestrated Chunked Pipelining Framework for Prefill-Only LLM Inference Available:https://huggingface.co/ Qwen/Qwen3-235B-A22B

Reference 19

Resolution
unresolved
no resolver link, observed 2026-06-26T06:26:59.984686Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-06-26T06:26:59.984686Z digest=sha256:c5da8c1e891d850dae26b625d7ce270ea33a235e0792257173211a9e47f8fc26

Observation 33695bc3-cce5-458c-92b8-dd4c5f9b254b · outbound

This paper cites FRED: Flexible REduction-Distribution Interconnect and Communication Implementation for Wafer-Scale Distributed Training of DNN Models.

MOCAP: Wafer-Scale-Chip-Oriented Memory-Orchestrated Chunked Pipelining Framework for Prefill-Only LLM Inference FRED: Flexible REduction-Distribution Interconnect and Communication Implementation for Wafer-Scale Distributed Training of DNN Models

Reference 20

Resolution
verified exact
arxiv_id, observed 2026-07-04T12:39:49.224227Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.

source=pdf_text observed=2026-06-26T06:26:59.984686Z digest=sha256:d337903b2c39250401c7cc320139cfe8ae9739bee2eceba955db7b9415e6f37f

Observation dc50a940-a137-42c5-b63e-a4fa810d8c0c · outbound

This paper cites In: 2025 IEEE 75th Electronic Components and Technology Conference (ECTC).

MOCAP: Wafer-Scale-Chip-Oriented Memory-Orchestrated Chunked Pipelining Framework for Prefill-Only LLM Inference In: 2025 IEEE 75th Electronic Components and Technology Conference (ECTC)

Reference 21

Resolution
unresolved
no resolver link, observed 2026-06-26T06:26:59.984686Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-06-26T06:26:59.984686Z digest=sha256:99324cc4d4549cb02a4271982fc2e430600e585034695c56fc15f53ff01b0b8c

Observation f620b95b-fd81-483b-ad44-51c53e4b910b · outbound

This paper cites In: 2022 IEEE Hot Chips 34 Symposium (HCS).

MOCAP: Wafer-Scale-Chip-Oriented Memory-Orchestrated Chunked Pipelining Framework for Prefill-Only LLM Inference In: 2022 IEEE Hot Chips 34 Symposium (HCS)

Reference 22

Resolution
unresolved
no resolver link, observed 2026-06-26T06:26:59.984686Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-06-26T06:26:59.984686Z digest=sha256:c44ac6b2077030bfd624ca44bb534fb1e382c92baa0331684e50f4890ed8a428

Observation 772081c9-eda1-4864-aef6-a541546c88ce · outbound

This paper cites In: 2026 IEEE International Symposium on High Performance Computer Architecture (HPCA).

MOCAP: Wafer-Scale-Chip-Oriented Memory-Orchestrated Chunked Pipelining Framework for Prefill-Only LLM Inference In: 2026 IEEE International Symposium on High Performance Computer Architecture (HPCA)

Reference 23

Resolution
unresolved
no resolver link, observed 2026-06-26T06:26:59.984686Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-06-26T06:26:59.984686Z digest=sha256:4c7f6524c15bf5817f981cbca0723f138f16daada1609d626354be615deb1a4f

Observation e648af3f-22d2-44a6-9ae5-02770a8f47c7 · outbound

This paper cites In: 2024 57th IEEE/ACM International Symposium on Microarchitecture (MICRO).

MOCAP: Wafer-Scale-Chip-Oriented Memory-Orchestrated Chunked Pipelining Framework for Prefill-Only LLM Inference In: 2024 57th IEEE/ACM International Symposium on Microarchitecture (MICRO)

Reference 24

Resolution
unresolved
no resolver link, observed 2026-06-26T06:26:59.984686Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-06-26T06:26:59.984686Z digest=sha256:ef7d822d0e548bef48323b0857bed0ef5cee286cff4db80d4be5a8655bc2e495

Observation 5d3f9e29-bcf8-4592-8f29-effd411b7a41 · outbound

This paper cites In: 2026 IEEE International Symposium on High Performance Computer Archi- tecture (HPCA).

MOCAP: Wafer-Scale-Chip-Oriented Memory-Orchestrated Chunked Pipelining Framework for Prefill-Only LLM Inference In: 2026 IEEE International Symposium on High Performance Computer Archi- tecture (HPCA)

Reference 25

Resolution
unresolved
no resolver link, observed 2026-06-26T06:26:59.984686Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-06-26T06:26:59.984686Z digest=sha256:da53c79c7e10747d80ce44f70862e4c42a87d564740cc8198d59d13904517d98

Observation 73ec4013-42fc-4d03-8370-d3288ca9598e · outbound

This paper cites In: 2026 31st Asia and South Pacific Design Automation Conference (ASP-DAC).

MOCAP: Wafer-Scale-Chip-Oriented Memory-Orchestrated Chunked Pipelining Framework for Prefill-Only LLM Inference In: 2026 31st Asia and South Pacific Design Automation Conference (ASP-DAC)

Reference 26

Resolution
unresolved
no resolver link, observed 2026-06-26T06:26:59.984686Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-06-26T06:26:59.984686Z digest=sha256:26c75e86634d88b633ef40cbec933066c03a06f9dc3526b01eccc3ae9057fc82

Observation 16a0cd12-b6e8-4f1a-a423-5a1ff96e7e2c · outbound

This paper cites In: 2026 31st Asia and South Pacific Design Automation Conference (ASP-DAC).

MOCAP: Wafer-Scale-Chip-Oriented Memory-Orchestrated Chunked Pipelining Framework for Prefill-Only LLM Inference In: 2026 31st Asia and South Pacific Design Automation Conference (ASP-DAC)

Reference 27

Resolution
unresolved
no resolver link, observed 2026-06-26T06:26:59.984686Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-06-26T06:26:59.984686Z digest=sha256:55df3cbe758f29943e5030830996bc8a1c44eaf2bfd95a9136416ccb20b20b03

Observation 4b73cca2-eda6-4b8b-812d-6f790403cf6a · outbound

This paper cites IEEE Transactions on Circuits and Systems II: Express Briefs (2025).

MOCAP: Wafer-Scale-Chip-Oriented Memory-Orchestrated Chunked Pipelining Framework for Prefill-Only LLM Inference IEEE Transactions on Circuits and Systems II: Express Briefs (2025)

Reference 28

Resolution
unresolved
no resolver link, observed 2026-06-26T06:26:59.984686Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-06-26T06:26:59.984686Z digest=sha256:36f456ef2b2733a2eba8c992578fbe3343634791dd05019b2277d997cf7dfa10

Observation 3957f69e-8ab1-479c-8c89-fbc4191dad97 · outbound

This paper cites In: 2026 IEEE International Symposium on High Performance Computer Architec- ture (HPCA).

MOCAP: Wafer-Scale-Chip-Oriented Memory-Orchestrated Chunked Pipelining Framework for Prefill-Only LLM Inference In: 2026 IEEE International Symposium on High Performance Computer Architec- ture (HPCA)

Reference 29

Resolution
unresolved
no resolver link, observed 2026-06-26T06:26:59.984686Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-06-26T06:26:59.984686Z digest=sha256:b9e21d1e2985ce1f5976749031eb2586984de5387f29517540ccda4433d12b51

Observation 319349cc-9f56-496a-a0e0-3080260f8e01 · outbound

This paper cites In: Proceedings of the 58th IEEE/ACM International Sympo- sium on Microarchitecture®.

MOCAP: Wafer-Scale-Chip-Oriented Memory-Orchestrated Chunked Pipelining Framework for Prefill-Only LLM Inference In: Proceedings of the 58th IEEE/ACM International Sympo- sium on Microarchitecture®

Reference 30

Resolution
unresolved
no resolver link, observed 2026-06-26T06:26:59.984686Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-06-26T06:26:59.984686Z digest=sha256:629d888b99690ada1bb959449afef1265a08d990cc3fd4d0b95031e2a4b1608d

Observation 10889604-f3bc-4691-9620-bc8bce6011b8 · outbound

This paper cites IEEE Transactions on Computers (2025).

MOCAP: Wafer-Scale-Chip-Oriented Memory-Orchestrated Chunked Pipelining Framework for Prefill-Only LLM Inference IEEE Transactions on Computers (2025)

Reference 31

Resolution
unresolved
no resolver link, observed 2026-06-26T06:26:59.984686Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-06-26T06:26:59.984686Z digest=sha256:60eca78099ec871681b278b6a386826f48869b773ec133c656a956514f3db527

Observation 7bb9adf0-b040-4b11-9a78-7a4907146791 · outbound

This paper cites In: 2026 IEEE International Symposium on High Performance Computer Archi- tecture (HPCA).

MOCAP: Wafer-Scale-Chip-Oriented Memory-Orchestrated Chunked Pipelining Framework for Prefill-Only LLM Inference In: 2026 IEEE International Symposium on High Performance Computer Archi- tecture (HPCA)

Reference 32

Resolution
unresolved
no resolver link, observed 2026-06-26T06:26:59.984686Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-06-26T06:26:59.984686Z digest=sha256:f1a3314b2dcbe0b3da4210d64bb656370dd3ca9e2c3aa1dda8973b1ce0bbfd58

Observation ee4ada80-d1c6-4bd5-8520-86dda3b0e0eb · outbound

This paper cites Integrated Circuits and Systems (2024).

MOCAP: Wafer-Scale-Chip-Oriented Memory-Orchestrated Chunked Pipelining Framework for Prefill-Only LLM Inference Integrated Circuits and Systems (2024)

Reference 33

Resolution
unresolved
no resolver link, observed 2026-06-26T06:26:59.984686Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-06-26T06:26:59.984686Z digest=sha256:c23fefdd027150403338a404eb17f24137749460dde265237d37cb7bd68699dd

Observation 76e6d9c9-f885-4dfc-93d7-ba34183d1bcb · outbound

This paper cites In: International Symposium on Advanced Parallel Processing Technologies.

MOCAP: Wafer-Scale-Chip-Oriented Memory-Orchestrated Chunked Pipelining Framework for Prefill-Only LLM Inference In: International Symposium on Advanced Parallel Processing Technologies

Reference 34

Resolution
unresolved
no resolver link, observed 2026-06-26T06:26:59.984686Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-06-26T06:26:59.984686Z digest=sha256:58cd682a41e208d292b5ed6c7ed2fd3f5f62807d6011be3f5f22bf761502acdf

Observation 33767e4d-b606-4112-850a-b75b61cfe5c3 · outbound

This paper cites 0: Modeling hierarchical networks and disaggregated systems for large-model training at scale.

MOCAP: Wafer-Scale-Chip-Oriented Memory-Orchestrated Chunked Pipelining Framework for Prefill-Only LLM Inference 0: Modeling hierarchical networks and disaggregated systems for large-model training at scale

Reference 35

Resolution
unresolved
no resolver link, observed 2026-06-26T06:26:59.984686Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-06-26T06:26:59.984686Z digest=sha256:f0fa614bdf011902f51c1f5ed1f21feca5e5dedee65697a0a78db4d4c3a3f852

Observation 7f0888e5-64e8-47f4-8fb9-37572d4da2ae · outbound

This paper cites In: 2026 IEEE International Symposium on High Performance Computer Architecture (HPCA).

MOCAP: Wafer-Scale-Chip-Oriented Memory-Orchestrated Chunked Pipelining Framework for Prefill-Only LLM Inference In: 2026 IEEE International Symposium on High Performance Computer Architecture (HPCA)

Reference 36

Resolution
unresolved
no resolver link, observed 2026-06-26T06:26:59.984686Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-06-26T06:26:59.984686Z digest=sha256:509b45f97d240072d9f4dad93ed6d16d3ee1fbd823d4c6be7c953bca83f8f2ec

Observation 914ddad4-90e7-4f50-9be4-922d31ddf8c5 · outbound

This paper cites In: Proceedings of the 52nd Annual International Symposium on Computer Architecture.

MOCAP: Wafer-Scale-Chip-Oriented Memory-Orchestrated Chunked Pipelining Framework for Prefill-Only LLM Inference In: Proceedings of the 52nd Annual International Symposium on Computer Architecture

Reference 37

Resolution
unresolved
no resolver link, observed 2026-06-26T06:26:59.984686Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-06-26T06:26:59.984686Z digest=sha256:34638f75ded4a6d4e4f384d8a3a7a5edfb410155828ac19b157813b73a26fc73

Observation 1dbbde5a-4c66-40ae-b34d-002223acfc42 · outbound

This paper cites In: Proceedings of the 52nd Annual International Symposium on Computer Architecture.

MOCAP: Wafer-Scale-Chip-Oriented Memory-Orchestrated Chunked Pipelining Framework for Prefill-Only LLM Inference In: Proceedings of the 52nd Annual International Symposium on Computer Architecture

Reference 38

Resolution
unresolved
no resolver link, observed 2026-06-26T06:26:59.984686Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-06-26T06:26:59.984686Z digest=sha256:b3ddd485e1039b71d90678f79934ac53f269636a25e15d940b43e65890756b4f

Observation 90eb2d0a-6f13-4e59-b25b-7b6fef49c927 · outbound

This paper cites In: 2024ACM/IEEE51stAnnualInternationalSymposiumonComputerArchitecture (ISCA).

MOCAP: Wafer-Scale-Chip-Oriented Memory-Orchestrated Chunked Pipelining Framework for Prefill-Only LLM Inference In: 2024ACM/IEEE51stAnnualInternationalSymposiumonComputerArchitecture (ISCA)

Reference 39

Resolution
unresolved
no resolver link, observed 2026-06-26T06:26:59.984686Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-06-26T06:26:59.984686Z digest=sha256:c568405c6d2cc40a76ce26d392193a8b924af0d21d1510dff12ea12308409fb4

Observation d90c3a09-fe21-4c5e-ae92-52682c9368e7 · outbound

This paper cites Actions Speak Louder than Words: Trillion-Parameter Sequential Transducers for Generative Recommendations.

MOCAP: Wafer-Scale-Chip-Oriented Memory-Orchestrated Chunked Pipelining Framework for Prefill-Only LLM Inference Actions Speak Louder than Words: Trillion-Parameter Sequential Transducers for Generative Recommendations

Reference 40

Resolution
metadata mismatch
local_arxiv, observed 2026-07-04T12:39:49.226631Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.

source=pdf_text observed=2026-06-26T06:26:59.984686Z digest=sha256:de1a5b71c51e24fb9446f8d7d07a4fcd66bf94c955223d74118dd5bb4b4b84fe

Observation 01d4d931-9d62-48fd-bdf1-357c2976cd3f · outbound

This paper cites IEEE Journal on Emerging and Selected Topics in Circuits and Systems (2025).

MOCAP: Wafer-Scale-Chip-Oriented Memory-Orchestrated Chunked Pipelining Framework for Prefill-Only LLM Inference IEEE Journal on Emerging and Selected Topics in Circuits and Systems (2025)

Reference 41

Resolution
unresolved
no resolver link, observed 2026-06-26T06:26:59.984686Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-06-26T06:26:59.984686Z digest=sha256:2eb7256a87c9408c246453b9d6b51a770fdd5b3a18a67ae40258c977c836880b

Pith citing papers

Observation bf743749-c279-458f-b368-5f66ec08a8f6 · inbound

Fovea: Physical-Implication-Aware Wafer-Scale DSE with Decision-Domain-Guided Cross-Fidelity Refinement cites this paper.

Fovea: Physical-Implication-Aware Wafer-Scale DSE with Decision-Domain-Guided Cross-Fidelity Refinement MOCAP: Wafer-Scale-Chip-Oriented Memory-Orchestrated Chunked Pipelining Framework for Prefill-Only LLM Inference

Reference 45

Resolution
verified exact
local_arxiv, observed 2026-08-05T21:50:53.247085Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.

source=pdf_text observed=2026-08-05T21:50:52.423769Z digest=sha256:ab4b51e1d566d3091fbc30b3602d591b5d41c958a8784c8c936a3fbcbef2f5dd