{"as_of":"2026-08-14T16:10:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:46902c0c226d6086fa43ba0d2d9186373c395facc44644c7906acbd5d2b59517","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":9,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":9,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-14T06:32:32.682623+00:00","state":"measured"},{"denominator":9,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":9,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T12:18:37.801569Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-01T12:05:44.073184Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2005.00085","last_updated":"2020-04-30T20:21:02Z","snapshot_observed_at":"2026-08-10T20:03:37.764346Z","submitted_at":"2020-04-30T20:21:02Z","title":"AI4Bharat-IndicNLP Corpus: Monolingual Corpora and Word Embeddings for Indic Languages","version":1},"cited_work":{"arxiv_id":"2005.00085","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2005.00085","snapshot_observed_at":"2026-07-01T12:05:44.073184Z","title":"C., Avik Bhattacharyya, Mitesh M","venue":null,"work_id":"23f6642d-42e3-43f7-8dc6-0eacc7542b00","year":2020},"citing_paper":{"arxiv_id":"2211.05100","last_updated":"2023-06-27T09:57:58Z","snapshot_observed_at":"2026-08-04T18:56:03.233715Z","submitted_at":"2022-11-09T18:48:09Z","title":"BLOOM: A 176B-Parameter Open-Access Multilingual Language Model","version":4},"reference_index":258,"source":"arxiv_source","source_observed_at":"2026-05-12T00:51:10.919818Z"},"links":{"cited_paper":"/paper/2005.00085","citing_paper":"/paper/2211.05100"},"observation_digest":"sha256:8031c2dd1368bbbf2d81dd906df83950ff2b8cb925a64eae3eb5136f86d91b38","observation_id":"e4a9abe2-68e7-470a-b8d7-748d2f1b69c8","resolution":{"observed_at":"2026-05-12T00:51:11.608055Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2005.00085","last_updated":"2020-04-30T20:21:02Z","snapshot_observed_at":"2026-08-10T20:03:37.764346Z","submitted_at":"2020-04-30T20:21:02Z","title":"AI4Bharat-IndicNLP Corpus: Monolingual Corpora and Word Embeddings for Indic Languages","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2005.00085","snapshot_observed_at":"2026-08-11T12:18:37.801569Z","title":"Ai4bharat-indicnlp corpus: Monolingual corpora and word embeddings for indic languages,","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2412.17847","last_updated":"2025-02-19T03:05:56Z","snapshot_observed_at":"2026-08-11T15:06:50.062800Z","submitted_at":"2024-12-19T01:30:19Z","title":"Bridging the Data Provenance Gap Across Text, Speech and Video","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-11T12:18:37.801569Z"},"links":{"cited_paper":"/paper/2005.00085","citing_paper":"/paper/2412.17847"},"observation_digest":"sha256:7d1d77e088d4cd8b7e2261b7303e0073dfd231e24002f4647ea0bdf390d30e19","observation_id":"5d6e7218-edcc-455c-891e-f25bd84cb20a","resolution":{"observed_at":"2026-08-11T12:18:37.801569Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2005.00085","last_updated":"2020-04-30T20:21:02Z","snapshot_observed_at":"2026-08-10T20:03:37.764346Z","submitted_at":"2020-04-30T20:21:02Z","title":"AI4Bharat-IndicNLP Corpus: Monolingual Corpora and Word Embeddings for Indic Languages","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2005.00085","snapshot_observed_at":"2026-08-07T12:44:29.194650Z","title":"Khapra, and Pratyush Kumar","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.23714","last_updated":"2025-07-22T17:15:48Z","snapshot_observed_at":"2026-08-13T22:48:09.104827Z","submitted_at":"2025-05-29T17:48:08Z","title":"SenWiCh: Sense-Annotation of Low-Resource Languages for WiC using Hybrid Methods","version":2},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-07T12:44:29.194650Z"},"links":{"cited_paper":"/paper/2005.00085","citing_paper":"/paper/2505.23714"},"observation_digest":"sha256:26bdbcd3803bab72e69cd64f8905faf22df142320dc7750bc611e6e57389a8ed","observation_id":"66b12515-381e-468c-8db9-8d11f45f12f5","resolution":{"observed_at":"2026-08-07T12:44:29.194650Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2005.00085","last_updated":"2020-04-30T20:21:02Z","snapshot_observed_at":"2026-08-10T20:03:37.764346Z","submitted_at":"2020-04-30T20:21:02Z","title":"AI4Bharat-IndicNLP Corpus: Monolingual Corpora and Word Embeddings for Indic Languages","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2005.00085","snapshot_observed_at":"2026-08-05T16:56:39.694752Z","title":"C., Avik Bhattacharyya, Mitesh M","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2508.17444","last_updated":"2025-08-24T16:48:58Z","snapshot_observed_at":"2026-08-14T08:43:16.418233Z","submitted_at":"2025-08-24T16:48:58Z","title":"MahaParaphrase: A Marathi Paraphrase Detection Corpus and BERT-based Models","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-05T16:56:39.694752Z"},"links":{"cited_paper":"/paper/2005.00085","citing_paper":"/paper/2508.17444"},"observation_digest":"sha256:b6ada41748a7b00f13b558128adda813e2af623639e16d6a82a5e9acfacc1160","observation_id":"5be128a0-5074-441c-ae2e-3a6a5d664118","resolution":{"observed_at":"2026-08-05T16:56:39.694752Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2005.00085","last_updated":"2020-04-30T20:21:02Z","snapshot_observed_at":"2026-08-10T20:03:37.764346Z","submitted_at":"2020-04-30T20:21:02Z","title":"AI4Bharat-IndicNLP Corpus: Monolingual Corpora and Word Embeddings for Indic Languages","version":1},"cited_work":{"arxiv_id":"2005.00085","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2005.00085","snapshot_observed_at":"2026-07-01T12:05:44.073184Z","title":"C., Avik Bhattacharyya, Mitesh M","venue":null,"work_id":"23f6642d-42e3-43f7-8dc6-0eacc7542b00","year":2020},"citing_paper":{"arxiv_id":"2604.02406","last_updated":"2026-05-16T00:42:12Z","snapshot_observed_at":"2026-08-12T09:32:39.556916Z","submitted_at":"2026-04-02T17:17:12Z","title":"Evaluating AI-Generated Images of Cultural Artifacts with Community-Informed Rubrics","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-05-13T20:59:52.448832Z"},"links":{"cited_paper":"/paper/2005.00085","citing_paper":"/paper/2604.02406"},"observation_digest":"sha256:468cf19442eb007180368bd4defc376eaa9168ec58582f6a0dcd8b994fb32c02","observation_id":"23d5447b-0219-4fb8-99cd-0bee33bae505","resolution":{"observed_at":"2026-05-13T21:03:20.118838Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2005.00085","last_updated":"2020-04-30T20:21:02Z","snapshot_observed_at":"2026-08-10T20:03:37.764346Z","submitted_at":"2020-04-30T20:21:02Z","title":"AI4Bharat-IndicNLP Corpus: Monolingual Corpora and Word Embeddings for Indic Languages","version":1},"cited_work":{"arxiv_id":"2005.00085","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2005.00085","snapshot_observed_at":"2026-07-01T12:05:44.073184Z","title":"C., Avik Bhattacharyya, Mitesh M","venue":null,"work_id":"23f6642d-42e3-43f7-8dc6-0eacc7542b00","year":2020},"citing_paper":{"arxiv_id":"2604.02406","last_updated":"2026-05-16T00:42:12Z","snapshot_observed_at":"2026-08-12T09:32:39.556916Z","submitted_at":"2026-04-02T17:17:12Z","title":"Evaluating AI-Generated Images of Cultural Artifacts with Community-Informed Rubrics","version":2},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-05-21T10:35:39.269869Z"},"links":{"cited_paper":"/paper/2005.00085","citing_paper":"/paper/2604.02406"},"observation_digest":"sha256:4cbe13391a61b076b975edb9bdc248d6aee480b21ed08031d22b1ad9d1445b30","observation_id":"0e806662-06d6-4b49-9a91-cd080517af92","resolution":{"observed_at":"2026-05-21T10:40:00.717907Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2005.00085","last_updated":"2020-04-30T20:21:02Z","snapshot_observed_at":"2026-08-10T20:03:37.764346Z","submitted_at":"2020-04-30T20:21:02Z","title":"AI4Bharat-IndicNLP Corpus: Monolingual Corpora and Word Embeddings for Indic Languages","version":1},"cited_work":{"arxiv_id":"2005.00085","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2005.00085","snapshot_observed_at":"2026-07-01T12:05:44.073184Z","title":"C., Avik Bhattacharyya, Mitesh M","venue":null,"work_id":"23f6642d-42e3-43f7-8dc6-0eacc7542b00","year":2020},"citing_paper":{"arxiv_id":"2606.30790","last_updated":"2026-06-29T18:19:24Z","snapshot_observed_at":"2026-08-12T14:41:24.242538Z","submitted_at":"2026-06-29T18:19:24Z","title":"Indi-RomCoM: Code-Mixed Benchmark for Evaluating LLMs on Romanized Indic-English Instructions","version":1},"reference_index":88,"source":"arxiv_source","source_observed_at":"2026-07-01T02:26:58.064933Z"},"links":{"cited_paper":"/paper/2005.00085","citing_paper":"/paper/2606.30790"},"observation_digest":"sha256:66a7583dad516696cecf0a42740ec6b4cfd3dd07762d91429b967b25b79ff792","observation_id":"d9bdae41-922d-4ac3-9c25-c0d6409c9772","resolution":{"observed_at":"2026-07-01T12:05:44.074966Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2005.00085","last_updated":"2020-04-30T20:21:02Z","snapshot_observed_at":"2026-08-10T20:03:37.764346Z","submitted_at":"2020-04-30T20:21:02Z","title":"AI4Bharat-IndicNLP Corpus: Monolingual Corpora and Word Embeddings for Indic Languages","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2005.00085","snapshot_observed_at":"2026-08-01T02:40:45.116319Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.25375","last_updated":"2026-07-28T07:30:12Z","snapshot_observed_at":"2026-08-13T18:20:28.674764Z","submitted_at":"2026-07-28T07:30:12Z","title":"Inspect India Evals: An Open Benchmarking Framework for Evaluating Large Language Models in the Indian Linguistic and Cultural Context","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-01T02:40:45.116319Z"},"links":{"cited_paper":"/paper/2005.00085","citing_paper":"/paper/2607.25375"},"observation_digest":"sha256:400b080caba07015a25949fa9da89ba8a6bb40f376db9b5ede82784b9bdedef5","observation_id":"f402f544-57e8-4377-a304-2203374eb987","resolution":{"observed_at":"2026-08-01T02:40:45.116319Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2005.00085","last_updated":"2020-04-30T20:21:02Z","snapshot_observed_at":"2026-08-10T20:03:37.764346Z","submitted_at":"2020-04-30T20:21:02Z","title":"AI4Bharat-IndicNLP Corpus: Monolingual Corpora and Word Embeddings for Indic Languages","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2005.00085","snapshot_observed_at":"2026-08-06T05:20:02.052319Z","title":"Khapra, and Pratyush Kumar","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2608.05104","last_updated":"2026-08-05T17:42:33Z","snapshot_observed_at":"2026-08-08T23:14:00.976836Z","submitted_at":"2026-08-05T17:42:33Z","title":"BnBERT-iPET: Sparse Few-Shot Language Modeling for Bengali via Lottery Ticket Pruning","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-06T05:20:02.052319Z"},"links":{"cited_paper":"/paper/2005.00085","citing_paper":"/paper/2608.05104"},"observation_digest":"sha256:b1abe4ae5afc172a715a7c494454b40bb59e3f942ef0638d9cd29188c9d355c9","observation_id":"44510221-12dc-4a70-800b-bbafff14f425","resolution":{"observed_at":"2026-08-06T05:20:02.052319Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2005.00085/citation-record","integrity":"/paper/2005.00085/integrity","json":"/paper/2005.00085/citation-record.json","paper":"/paper/2005.00085"},"outbound":[],"paper":{"arxiv_id":"2005.00085","last_updated":"2020-04-30T20:21:02Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-10T20:03:37.764346Z","submitted_at":"2020-04-30T20:21:02Z","title":"AI4Bharat-IndicNLP Corpus: Monolingual Corpora and Word Embeddings for Indic Languages"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"thesis":"As of 14 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 9 inbound Pith citation observations for arXiv:2005.00085."}