{"as_of":"2026-08-06T08:28:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:97055345aea6a7fcb146c4fb072b8cb968329be328c5941c28e32c41c316c75f","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":10,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":10,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-06T06:34:29.942622+00:00","state":"measured"},{"denominator":10,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":10,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-24T13:36:55.210708Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-24T13:39:31.694945Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2104.12369","last_updated":"2021-04-26T06:59:36Z","snapshot_observed_at":"2026-07-06T11:03:32.600911Z","submitted_at":"2021-04-26T06:59:36Z","title":"PanGu-$\\alpha$: Large-scale Autoregressive Pretrained Chinese Language Models with Auto-parallel Computation","version":1},"cited_work":{"arxiv_id":"2104.12369","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2104.12369","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"subcases","venue":null,"work_id":"8a8a1d50-cc53-4267-9ab2-956f12166b43","year":2021},"citing_paper":{"arxiv_id":"2107.06499","last_updated":"2022-03-24T19:29:45Z","snapshot_observed_at":"2026-08-05T18:30:13.997811Z","submitted_at":"2021-07-14T06:06:52Z","title":"Deduplicating Training Data Makes Language Models Better","version":2},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-05-24T13:36:55.210708Z"},"links":{"cited_paper":"/paper/2104.12369","citing_paper":"/paper/2107.06499"},"observation_digest":"sha256:ed30cce9782de5118fc6bc7c7ec050aa8f0f8de04127914e50723d5838de248b","observation_id":"3948bc8f-8d41-419a-a22c-3a773bde82fe","resolution":{"observed_at":"2026-05-24T13:39:31.698342Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2104.12369","last_updated":"2021-04-26T06:59:36Z","snapshot_observed_at":"2026-07-06T11:03:32.600911Z","submitted_at":"2021-04-26T06:59:36Z","title":"PanGu-$\\alpha$: Large-scale Autoregressive Pretrained Chinese Language Models with Auto-parallel Computation","version":1},"cited_work":{"arxiv_id":"2104.12369","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2104.12369","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"subcases","venue":null,"work_id":"8a8a1d50-cc53-4267-9ab2-956f12166b43","year":2021},"citing_paper":{"arxiv_id":"2201.11990","last_updated":"2022-02-04T18:02:23Z","snapshot_observed_at":"2026-07-06T12:32:10.267841Z","submitted_at":"2022-01-28T08:59:57Z","title":"Using DeepSpeed and Megatron to Train Megatron-Turing NLG 530B, A Large-Scale Generative Language Model","version":3},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-05-24T12:10:49.690618Z"},"links":{"cited_paper":"/paper/2104.12369","citing_paper":"/paper/2201.11990"},"observation_digest":"sha256:79ec385abde6bef5a328abe67cd30ca507c8bfbbf7f62b24140343933a18911c","observation_id":"a29f3d72-3466-4234-b011-c3164ddc53b9","resolution":{"observed_at":"2026-05-24T12:14:26.701333Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2104.12369","last_updated":"2021-04-26T06:59:36Z","snapshot_observed_at":"2026-07-06T11:03:32.600911Z","submitted_at":"2021-04-26T06:59:36Z","title":"PanGu-$\\alpha$: Large-scale Autoregressive Pretrained Chinese Language Models with Auto-parallel Computation","version":1},"cited_work":{"arxiv_id":"2104.12369","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2104.12369","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"subcases","venue":null,"work_id":"8a8a1d50-cc53-4267-9ab2-956f12166b43","year":2021},"citing_paper":{"arxiv_id":"2204.02311","last_updated":"2022-10-05T06:02:24Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-04-05T16:11:45Z","title":"PaLM: Scaling Language Modeling with Pathways","version":5},"reference_index":174,"source":"arxiv_source","source_observed_at":"2026-05-10T23:45:06.755839Z"},"links":{"cited_paper":"/paper/2104.12369","citing_paper":"/paper/2204.02311"},"observation_digest":"sha256:1e26d2f163b0f44fa6ced696b8128f4f609301402bff746a056f58da3954c274","observation_id":"c79f795c-c85d-4ac1-8e6d-def2b55d9a2a","resolution":{"observed_at":"2026-05-10T23:45:07.480568Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2104.12369","last_updated":"2021-04-26T06:59:36Z","snapshot_observed_at":"2026-07-06T11:03:32.600911Z","submitted_at":"2021-04-26T06:59:36Z","title":"PanGu-$\\alpha$: Large-scale Autoregressive Pretrained Chinese Language Models with Auto-parallel Computation","version":1},"cited_work":{"arxiv_id":"2104.12369","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2104.12369","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"subcases","venue":null,"work_id":"8a8a1d50-cc53-4267-9ab2-956f12166b43","year":2021},"citing_paper":{"arxiv_id":"2204.06745","last_updated":"2022-04-14T04:00:27Z","snapshot_observed_at":"2026-07-06T13:00:12.148951Z","submitted_at":"2022-04-14T04:00:27Z","title":"GPT-NeoX-20B: An Open-Source Autoregressive Language Model","version":1},"reference_index":107,"source":"arxiv_source","source_observed_at":"2026-05-24T12:33:37.701655Z"},"links":{"cited_paper":"/paper/2104.12369","citing_paper":"/paper/2204.06745"},"observation_digest":"sha256:4fb23e15f00728623814f575f7bbb9181e48707ffc6c1dd26f35cddae742dc81","observation_id":"3c96979c-8653-459f-b5a4-4d261968a1a1","resolution":{"observed_at":"2026-05-24T12:34:28.278379Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2104.12369","last_updated":"2021-04-26T06:59:36Z","snapshot_observed_at":"2026-07-06T11:03:32.600911Z","submitted_at":"2021-04-26T06:59:36Z","title":"PanGu-$\\alpha$: Large-scale Autoregressive Pretrained Chinese Language Models with Auto-parallel Computation","version":1},"cited_work":{"arxiv_id":"2104.12369","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2104.12369","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"subcases","venue":null,"work_id":"8a8a1d50-cc53-4267-9ab2-956f12166b43","year":2021},"citing_paper":{"arxiv_id":"2205.01068","last_updated":"2022-06-21T17:04:40Z","snapshot_observed_at":"2026-08-06T03:13:37.403059Z","submitted_at":"2022-05-02T17:49:50Z","title":"OPT: Open Pre-trained Transformer Language Models","version":4},"reference_index":212,"source":"arxiv_source","source_observed_at":"2026-05-10T20:53:16.720145Z"},"links":{"cited_paper":"/paper/2104.12369","citing_paper":"/paper/2205.01068"},"observation_digest":"sha256:e46480c06abe4200ef5c73cf4f2fe8a310a925fbab21d91e71892c9de239d778","observation_id":"23f2383e-42b8-4b43-893d-ee953bc9b09b","resolution":{"observed_at":"2026-05-10T20:53:17.723733Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2104.12369","last_updated":"2021-04-26T06:59:36Z","snapshot_observed_at":"2026-07-06T11:03:32.600911Z","submitted_at":"2021-04-26T06:59:36Z","title":"PanGu-$\\alpha$: Large-scale Autoregressive Pretrained Chinese Language Models with Auto-parallel Computation","version":1},"cited_work":{"arxiv_id":"2104.12369","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2104.12369","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"subcases","venue":null,"work_id":"8a8a1d50-cc53-4267-9ab2-956f12166b43","year":2021},"citing_paper":{"arxiv_id":"2303.18223","last_updated":"2026-03-18T05:34:39Z","snapshot_observed_at":"2026-08-06T08:19:37.065474Z","submitted_at":"2023-03-31T17:28:46Z","title":"A Survey of Large Language Models","version":19},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-05-10T22:46:39.268353Z"},"links":{"cited_paper":"/paper/2104.12369","citing_paper":"/paper/2303.18223"},"observation_digest":"sha256:dd6708cbeaf6c70ba151f97c9b7f815d87e3ba72b8a9ba1ef960e8fb4baac3c7","observation_id":"017d2d79-bbb9-4e47-84a0-761718f17aab","resolution":{"observed_at":"2026-05-10T22:46:39.656602Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2104.12369","last_updated":"2021-04-26T06:59:36Z","snapshot_observed_at":"2026-07-06T11:03:32.600911Z","submitted_at":"2021-04-26T06:59:36Z","title":"PanGu-$\\alpha$: Large-scale Autoregressive Pretrained Chinese Language Models with Auto-parallel Computation","version":1},"cited_work":{"arxiv_id":"2104.12369","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2104.12369","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"subcases","venue":null,"work_id":"8a8a1d50-cc53-4267-9ab2-956f12166b43","year":2021},"citing_paper":{"arxiv_id":"2305.16264","last_updated":"2025-06-28T00:00:06Z","snapshot_observed_at":"2026-07-06T15:33:27.761070Z","submitted_at":"2023-05-25T17:18:55Z","title":"Scaling Data-Constrained Language Models","version":5},"reference_index":139,"source":"pdf_text","source_observed_at":"2026-05-18T01:35:21.150772Z"},"links":{"cited_paper":"/paper/2104.12369","citing_paper":"/paper/2305.16264"},"observation_digest":"sha256:e6aa3316578d211aa54473ff90c8459b8bed59de65c03929b69a7931b2b3dd35","observation_id":"f2209cc2-3b08-4f52-8ac9-4e67ec784709","resolution":{"observed_at":"2026-05-18T01:35:21.518252Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2104.12369","last_updated":"2021-04-26T06:59:36Z","snapshot_observed_at":"2026-07-06T11:03:32.600911Z","submitted_at":"2021-04-26T06:59:36Z","title":"PanGu-$\\alpha$: Large-scale Autoregressive Pretrained Chinese Language Models with Auto-parallel Computation","version":1},"cited_work":{"arxiv_id":"2104.12369","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2104.12369","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"subcases","venue":null,"work_id":"8a8a1d50-cc53-4267-9ab2-956f12166b43","year":2021},"citing_paper":{"arxiv_id":"2306.01116","last_updated":"2023-06-01T20:03:56Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-06-01T20:03:56Z","title":"The RefinedWeb Dataset for Falcon LLM: Outperforming Curated Corpora with Web Data, and Web Data Only","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-05-13T20:43:45.770157Z"},"links":{"cited_paper":"/paper/2104.12369","citing_paper":"/paper/2306.01116"},"observation_digest":"sha256:524de942aecc7a7229bcc2844a38717877207834fea8a5b572ac15edd380dd0b","observation_id":"e1e2dd58-f14e-420c-9abd-2db09e56e428","resolution":{"observed_at":"2026-05-13T20:43:45.890773Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2104.12369","last_updated":"2021-04-26T06:59:36Z","snapshot_observed_at":"2026-07-06T11:03:32.600911Z","submitted_at":"2021-04-26T06:59:36Z","title":"PanGu-$\\alpha$: Large-scale Autoregressive Pretrained Chinese Language Models with Auto-parallel Computation","version":1},"cited_work":{"arxiv_id":"2104.12369","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2104.12369","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"subcases","venue":null,"work_id":"8a8a1d50-cc53-4267-9ab2-956f12166b43","year":2021},"citing_paper":{"arxiv_id":"2307.06435","last_updated":"2024-10-17T01:10:40Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-07-12T20:01:52Z","title":"A Comprehensive Overview of Large Language Models","version":10},"reference_index":108,"source":"pdf_text","source_observed_at":"2026-05-19T20:28:38.900026Z"},"links":{"cited_paper":"/paper/2104.12369","citing_paper":"/paper/2307.06435"},"observation_digest":"sha256:740b0b065bfc192412967523fec0046c5f8da152ed2f67ac4107ae8179488216","observation_id":"d4940b65-64ec-42ba-ba6c-8de817f6569e","resolution":{"observed_at":"2026-05-19T20:28:39.371703Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2104.12369","last_updated":"2021-04-26T06:59:36Z","snapshot_observed_at":"2026-07-06T11:03:32.600911Z","submitted_at":"2021-04-26T06:59:36Z","title":"PanGu-$\\alpha$: Large-scale Autoregressive Pretrained Chinese Language Models with Auto-parallel Computation","version":1},"cited_work":{"arxiv_id":"2104.12369","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2104.12369","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"subcases","venue":null,"work_id":"8a8a1d50-cc53-4267-9ab2-956f12166b43","year":2021},"citing_paper":{"arxiv_id":"2311.16867","last_updated":"2023-11-29T19:45:10Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-11-28T15:12:47Z","title":"The Falcon Series of Open Language Models","version":2},"reference_index":82,"source":"arxiv_source","source_observed_at":"2026-05-16T09:46:09.701440Z"},"links":{"cited_paper":"/paper/2104.12369","citing_paper":"/paper/2311.16867"},"observation_digest":"sha256:7cd1b2875558755cb0781310fa5e4971131feaf8a0f14f4245492843c60c8905","observation_id":"42886ca4-78e6-47dc-9cee-691e7c3a9df0","resolution":{"observed_at":"2026-05-16T09:46:10.086221Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2104.12369/citation-record","integrity":"/paper/2104.12369/integrity","json":"/paper/2104.12369/citation-record.json","paper":"/paper/2104.12369"},"outbound":[],"paper":{"arxiv_id":"2104.12369","last_updated":"2021-04-26T06:59:36Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-07-06T11:03:32.600911Z","submitted_at":"2021-04-26T06:59:36Z","title":"PanGu-$\\alpha$: Large-scale Autoregressive Pretrained Chinese Language Models with Auto-parallel Computation"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"thesis":"As of 6 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 10 inbound Pith citation observations for arXiv:2104.12369."}