{"as_of":"2026-08-09T09:42:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:1c43f9e1536328b7773df3a5947db3c5c52fc7533175325591c335241eb76829","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":11,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":11,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":11,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":11,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-08T17:27:59.642737Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"arxiv_reference","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":22,"observed_at":"2026-08-05T02:28:24.338817Z","source":"arxiv_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2204.08582","last_updated":"2022-06-17T17:19:15Z","snapshot_observed_at":"2026-07-06T13:01:26.958634Z","submitted_at":"2022-04-18T22:40:52Z","title":"MASSIVE: A 1M-Example Multilingual Natural Language Understanding Dataset with 51 Typologically-Diverse Languages","version":2},"cited_work":{"arxiv_id":"2204.08582","doi":"10.48550/arxiv.2204.08582","metadata_source":"arxiv_reference","pith_arxiv_id":"2204.08582","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"arXiv , author =:2204.08582 , primaryclass =","venue":"arXiv (Cornell University)","work_id":"bfccaebd-9433-4bc2-a4a5-1bebe68f5cd5","year":2022},"citing_paper":{"arxiv_id":"2211.05100","last_updated":"2023-06-27T09:57:58Z","snapshot_observed_at":"2026-08-04T18:56:03.233715Z","submitted_at":"2022-11-09T18:48:09Z","title":"BLOOM: A 176B-Parameter Open-Access Multilingual Language Model","version":4},"reference_index":156,"source":"arxiv_source","source_observed_at":"2026-05-12T00:51:10.919818Z"},"links":{"cited_paper":"/paper/2204.08582","citing_paper":"/paper/2211.05100"},"observation_digest":"sha256:f08ebfa85a5345f7cb17662ea975cba24ffe32bcb87baf1f856e34bca9857198","observation_id":"47ccb78d-96ef-4450-adc3-19ab7e6cf041","resolution":{"observed_at":"2026-05-12T00:51:11.333078Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2204.08582","last_updated":"2022-06-17T17:19:15Z","snapshot_observed_at":"2026-07-06T13:01:26.958634Z","submitted_at":"2022-04-18T22:40:52Z","title":"MASSIVE: A 1M-Example Multilingual Natural Language Understanding Dataset with 51 Typologically-Diverse Languages","version":2},"cited_work":{"arxiv_id":"2204.08582","doi":"10.48550/arxiv.2204.08582","metadata_source":"arxiv_reference","pith_arxiv_id":"2204.08582","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"arXiv , author =:2204.08582 , primaryclass =","venue":"arXiv (Cornell University)","work_id":"bfccaebd-9433-4bc2-a4a5-1bebe68f5cd5","year":2022},"citing_paper":{"arxiv_id":"2211.05100","last_updated":"2023-06-27T09:57:58Z","snapshot_observed_at":"2026-08-04T18:56:03.233715Z","submitted_at":"2022-11-09T18:48:09Z","title":"BLOOM: A 176B-Parameter Open-Access Multilingual Language Model","version":4},"reference_index":231,"source":"arxiv_source","source_observed_at":"2026-05-12T00:51:10.919818Z"},"links":{"cited_paper":"/paper/2204.08582","citing_paper":"/paper/2211.05100"},"observation_digest":"sha256:ad21147d74d24f016f8cd3c1a465f3e06c819e6d592b3d596d267f16b56dea44","observation_id":"20727a5d-14d2-4df3-8cc3-6f1e8531f64b","resolution":{"observed_at":"2026-05-12T00:51:11.553728Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2204.08582","last_updated":"2022-06-17T17:19:15Z","snapshot_observed_at":"2026-07-06T13:01:26.958634Z","submitted_at":"2022-04-18T22:40:52Z","title":"MASSIVE: A 1M-Example Multilingual Natural Language Understanding Dataset with 51 Typologically-Diverse Languages","version":2},"cited_work":{"arxiv_id":"2204.08582","doi":"10.48550/arxiv.2204.08582","metadata_source":"arxiv_reference","pith_arxiv_id":"2204.08582","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"arXiv , author =:2204.08582 , primaryclass =","venue":"arXiv (Cornell University)","work_id":"bfccaebd-9433-4bc2-a4a5-1bebe68f5cd5","year":2022},"citing_paper":{"arxiv_id":"2305.14299","last_updated":"2026-04-12T00:03:25Z","snapshot_observed_at":"2026-07-06T15:31:41.985646Z","submitted_at":"2023-05-23T17:40:41Z","title":"Template-assisted Contrastive Learning of Task-oriented Dialogue Sentence Embeddings","version":3},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-05-24T09:11:37.220487Z"},"links":{"cited_paper":"/paper/2204.08582","citing_paper":"/paper/2305.14299"},"observation_digest":"sha256:7c8a6546dbb11aea4c46db808e073d119f7ca7383c6dc707ec3759cb723c01e5","observation_id":"9798b72b-7f95-4db8-96bf-ae1066c9892c","resolution":{"observed_at":"2026-05-24T09:14:16.595157Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2204.08582","last_updated":"2022-06-17T17:19:15Z","snapshot_observed_at":"2026-07-06T13:01:26.958634Z","submitted_at":"2022-04-18T22:40:52Z","title":"MASSIVE: A 1M-Example Multilingual Natural Language Understanding Dataset with 51 Typologically-Diverse Languages","version":2},"cited_work":{"arxiv_id":"2204.08582","doi":"10.48550/arxiv.2204.08582","metadata_source":"arxiv_reference","pith_arxiv_id":"2204.08582","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"arXiv , author =:2204.08582 , primaryclass =","venue":"arXiv (Cornell University)","work_id":"bfccaebd-9433-4bc2-a4a5-1bebe68f5cd5","year":2022},"citing_paper":{"arxiv_id":"2405.17428","last_updated":"2025-02-25T00:35:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-05-27T17:59:45Z","title":"NV-Embed: Improved Techniques for Training LLMs as Generalist Embedding Models","version":3},"reference_index":158,"source":"arxiv_source","source_observed_at":"2026-05-14T21:15:16.112918Z"},"links":{"cited_paper":"/paper/2204.08582","citing_paper":"/paper/2405.17428"},"observation_digest":"sha256:a5b4bfadfa6306cae9e33e59f699c989e5b059d8974a73cb38b8348efec9d7c4","observation_id":"4b91aacd-75a5-49de-abe8-58c9751b9ca4","resolution":{"observed_at":"2026-05-14T21:15:16.351510Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2204.08582","last_updated":"2022-06-17T17:19:15Z","snapshot_observed_at":"2026-07-06T13:01:26.958634Z","submitted_at":"2022-04-18T22:40:52Z","title":"MASSIVE: A 1M-Example Multilingual Natural Language Understanding Dataset with 51 Typologically-Diverse Languages","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.08582","snapshot_observed_at":"2026-08-08T17:27:59.642737Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.05923","last_updated":"2025-02-09T14:39:01Z","snapshot_observed_at":"2026-08-08T17:20:12.269978Z","submitted_at":"2025-02-09T14:39:01Z","title":"ARISE: Iterative Rule Induction and Synthetic Data Generation for Text Classification","version":1},"reference_index":1955,"source":"pdf_text","source_observed_at":"2026-08-08T17:27:59.642737Z"},"links":{"cited_paper":"/paper/2204.08582","citing_paper":"/paper/2502.05923"},"observation_digest":"sha256:ce51a062622f47579ea86aa3163f0665b448d02577e7e06e15a0cdb146a56a32","observation_id":"01a2f8e3-12b6-4798-9e04-0a2ddf49ac5a","resolution":{"observed_at":"2026-08-08T17:27:59.642737Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2204.08582","last_updated":"2022-06-17T17:19:15Z","snapshot_observed_at":"2026-07-06T13:01:26.958634Z","submitted_at":"2022-04-18T22:40:52Z","title":"MASSIVE: A 1M-Example Multilingual Natural Language Understanding Dataset with 51 Typologically-Diverse Languages","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.08582","snapshot_observed_at":"2026-08-07T14:40:08.066823Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.18241","last_updated":"2025-05-23T15:11:12Z","snapshot_observed_at":"2026-08-08T00:17:53.214749Z","submitted_at":"2025-05-23T15:11:12Z","title":"Intent Classification on Low-Resource Languages with Query Similarity Search","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T14:40:08.066823Z"},"links":{"cited_paper":"/paper/2204.08582","citing_paper":"/paper/2505.18241"},"observation_digest":"sha256:22b94a48ac488cc51486af78b78e24f718846b4a24ee0506a2f5e4bd7936ce0d","observation_id":"0a611fcd-294e-4569-b711-e8989aa50400","resolution":{"observed_at":"2026-08-07T14:40:08.066823Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2204.08582","last_updated":"2022-06-17T17:19:15Z","snapshot_observed_at":"2026-07-06T13:01:26.958634Z","submitted_at":"2022-04-18T22:40:52Z","title":"MASSIVE: A 1M-Example Multilingual Natural Language Understanding Dataset with 51 Typologically-Diverse Languages","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.08582","snapshot_observed_at":"2026-08-06T18:48:32.084674Z","title":"Massive: A 1m-example multilingual natural language understanding dataset with 51 typologically-diverse languages,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.07274","last_updated":"2025-07-09T20:45:04Z","snapshot_observed_at":"2026-08-06T18:42:39.137985Z","submitted_at":"2025-07-09T20:45:04Z","title":"LinguaMark: Do Multimodal Models Speak Fairly? A Benchmark-Based Evaluation","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T18:48:32.084674Z"},"links":{"cited_paper":"/paper/2204.08582","citing_paper":"/paper/2507.07274"},"observation_digest":"sha256:61a2da6856321ad09f0ba03d2327165dde370dd1db73df3993199adf4d6c73b7","observation_id":"c44afdc6-6ba8-410d-b38b-c7bc0dac977e","resolution":{"observed_at":"2026-08-06T18:48:32.084674Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2204.08582","last_updated":"2022-06-17T17:19:15Z","snapshot_observed_at":"2026-07-06T13:01:26.958634Z","submitted_at":"2022-04-18T22:40:52Z","title":"MASSIVE: A 1M-Example Multilingual Natural Language Understanding Dataset with 51 Typologically-Diverse Languages","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.08582","snapshot_observed_at":"2026-08-06T14:35:54.168354Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.18546","last_updated":"2025-07-24T16:11:14Z","snapshot_observed_at":"2026-08-08T00:43:56.462878Z","submitted_at":"2025-07-24T16:11:14Z","title":"GLiNER2: An Efficient Multi-Task Information Extraction System with Schema-Driven Interface","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-06T14:35:54.168354Z"},"links":{"cited_paper":"/paper/2204.08582","citing_paper":"/paper/2507.18546"},"observation_digest":"sha256:1d273cdaa74a96bd299d20e0d5e230edc6372ee59ac1b0f769f877ce60c9014c","observation_id":"483159a3-476e-4f3d-81bb-ea033f65b641","resolution":{"observed_at":"2026-08-06T14:35:54.168354Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2204.08582","last_updated":"2022-06-17T17:19:15Z","snapshot_observed_at":"2026-07-06T13:01:26.958634Z","submitted_at":"2022-04-18T22:40:52Z","title":"MASSIVE: A 1M-Example Multilingual Natural Language Understanding Dataset with 51 Typologically-Diverse Languages","version":2},"cited_work":{"arxiv_id":"2204.08582","doi":"10.48550/arxiv.2204.08582","metadata_source":"arxiv_reference","pith_arxiv_id":"2204.08582","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"arXiv , author =:2204.08582 , primaryclass =","venue":"arXiv (Cornell University)","work_id":"bfccaebd-9433-4bc2-a4a5-1bebe68f5cd5","year":2022},"citing_paper":{"arxiv_id":"2602.12687","last_updated":"2026-05-18T08:58:15Z","snapshot_observed_at":"2026-08-01T15:43:55.803719Z","submitted_at":"2026-02-13T07:43:19Z","title":"Trust the uncertain teacher: distilling dark knowledge via calibrated uncertainty","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-21T13:00:07.732291Z"},"links":{"cited_paper":"/paper/2204.08582","citing_paper":"/paper/2602.12687"},"observation_digest":"sha256:dcc36de88e4f924b9d56106c2652253c12c4a391e20230c1ab28b8b1a8f0c128","observation_id":"7fa525ac-2fc8-42a4-9445-f3721c7d5541","resolution":{"observed_at":"2026-05-21T13:00:09.681882Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2204.08582","last_updated":"2022-06-17T17:19:15Z","snapshot_observed_at":"2026-07-06T13:01:26.958634Z","submitted_at":"2022-04-18T22:40:52Z","title":"MASSIVE: A 1M-Example Multilingual Natural Language Understanding Dataset with 51 Typologically-Diverse Languages","version":2},"cited_work":{"arxiv_id":"2204.08582","doi":"10.48550/arxiv.2204.08582","metadata_source":"arxiv_reference","pith_arxiv_id":"2204.08582","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"arXiv , author =:2204.08582 , primaryclass =","venue":"arXiv (Cornell University)","work_id":"bfccaebd-9433-4bc2-a4a5-1bebe68f5cd5","year":2022},"citing_paper":{"arxiv_id":"2605.23033","last_updated":"2026-05-21T20:58:42Z","snapshot_observed_at":"2026-07-06T23:33:19.375527Z","submitted_at":"2026-05-21T20:58:42Z","title":"Uncovering the Latent Potential of Deep Intermediate Representations","version":1},"reference_index":72,"source":"arxiv_source","source_observed_at":"2026-05-25T05:36:24.743558Z"},"links":{"cited_paper":"/paper/2204.08582","citing_paper":"/paper/2605.23033"},"observation_digest":"sha256:12b4ad5d3dfdb90f1055e8ad90556607ee8a2aac4880edb693d48bd375172989","observation_id":"b2cb6743-6a96-4f4a-ab19-02d76309edc9","resolution":{"observed_at":"2026-05-25T05:36:39.299164Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2204.08582","last_updated":"2022-06-17T17:19:15Z","snapshot_observed_at":"2026-07-06T13:01:26.958634Z","submitted_at":"2022-04-18T22:40:52Z","title":"MASSIVE: A 1M-Example Multilingual Natural Language Understanding Dataset with 51 Typologically-Diverse Languages","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.08582","snapshot_observed_at":"2026-07-31T01:27:13.123451Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.27421","last_updated":"2026-07-29T19:42:33Z","snapshot_observed_at":"2026-08-04T10:12:07.390131Z","submitted_at":"2026-07-29T19:42:33Z","title":"Selecting Open-Weight Language Models for Zero-Shot Intent Classification: A Systematic Evaluation of 41 Models","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-07-31T01:27:13.123451Z"},"links":{"cited_paper":"/paper/2204.08582","citing_paper":"/paper/2607.27421"},"observation_digest":"sha256:283e1ae5e46c3ce2b6b7c28e540ca63e0c534d50a1247db8c880e4d777aa7a57","observation_id":"6066659e-09f6-433a-ab74-53ebec17c718","resolution":{"observed_at":"2026-07-31T01:27:13.123451Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2204.08582/citation-record","integrity":"/paper/2204.08582/integrity","json":"/paper/2204.08582/citation-record.json","paper":"/paper/2204.08582"},"outbound":[],"paper":{"arxiv_id":"2204.08582","last_updated":"2022-06-17T17:19:15Z","latest_version":2,"primary_category":"cs.CL","snapshot_observed_at":"2026-07-06T13:01:26.958634Z","submitted_at":"2022-04-18T22:40:52Z","title":"MASSIVE: A 1M-Example Multilingual Natural Language Understanding Dataset with 51 Typologically-Diverse Languages"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 11 inbound Pith citation observations for arXiv:2204.08582."}