{"as_of":"2026-08-08T04:27:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:a808a21757bc8baaf029e996284c4af59e235a2c29857234903f11dd7aba3ea8","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":10,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":10,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":10,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":10,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T00:42:04.244106Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"arxiv_reference","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":115,"observed_at":"2026-08-05T02:28:24.338817Z","source":"arxiv_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2004.08900","last_updated":"2020-04-19T16:28:35Z","snapshot_observed_at":"2026-07-06T09:13:29.404788Z","submitted_at":"2020-04-19T16:28:35Z","title":"The Cost of Training NLP Models: A Concise Overview","version":1},"cited_work":{"arxiv_id":"2004.08900","doi":"10.48550/arxiv.2004.08900","metadata_source":"arxiv_reference","pith_arxiv_id":"2004.08900","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Sharir, B","venue":"arXiv (Cornell University)","work_id":"49a44ad2-3337-48ea-ac20-5ee1f30ac458","year":2020},"citing_paper":{"arxiv_id":"2205.00445","last_updated":"2022-05-01T11:01:28Z","snapshot_observed_at":"2026-08-07T07:47:07.886786Z","submitted_at":"2022-05-01T11:01:28Z","title":"MRKL Systems: A modular, neuro-symbolic architecture that combines large language models, external knowledge sources and discrete reasoning","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-15T07:31:08.266737Z"},"links":{"cited_paper":"/paper/2004.08900","citing_paper":"/paper/2205.00445"},"observation_digest":"sha256:dc6078c3ed09eb5e37a9384763f8b0dc85a12bd918d3f9512a5bfe1b63d02554","observation_id":"51cc121f-5b44-4011-a82a-24d065a5cb77","resolution":{"observed_at":"2026-05-15T07:31:08.333752Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2004.08900","last_updated":"2020-04-19T16:28:35Z","snapshot_observed_at":"2026-07-06T09:13:29.404788Z","submitted_at":"2020-04-19T16:28:35Z","title":"The Cost of Training NLP Models: A Concise Overview","version":1},"cited_work":{"arxiv_id":"2004.08900","doi":"10.48550/arxiv.2004.08900","metadata_source":"arxiv_reference","pith_arxiv_id":"2004.08900","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Sharir, B","venue":"arXiv (Cornell University)","work_id":"49a44ad2-3337-48ea-ac20-5ee1f30ac458","year":2020},"citing_paper":{"arxiv_id":"2501.10258","last_updated":"2026-04-20T18:47:20Z","snapshot_observed_at":"2026-08-06T10:51:09.586571Z","submitted_at":"2025-01-17T15:40:03Z","title":"DADA: Dual Averaging with Distance Adaptation","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-23T04:54:12.210472Z"},"links":{"cited_paper":"/paper/2004.08900","citing_paper":"/paper/2501.10258"},"observation_digest":"sha256:23f45d48bcb8e6d1b67b5b329871512c860399ffcd36c60d4b50e006d211a66c","observation_id":"868fafc5-e5be-437d-94f1-39a31ae693a8","resolution":{"observed_at":"2026-05-23T04:55:24.886760Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2004.08900","last_updated":"2020-04-19T16:28:35Z","snapshot_observed_at":"2026-07-06T09:13:29.404788Z","submitted_at":"2020-04-19T16:28:35Z","title":"The Cost of Training NLP Models: A Concise Overview","version":1},"cited_work":{"arxiv_id":"2004.08900","doi":"10.48550/arxiv.2004.08900","metadata_source":"arxiv_reference","pith_arxiv_id":"2004.08900","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Sharir, B","venue":"arXiv (Cornell University)","work_id":"49a44ad2-3337-48ea-ac20-5ee1f30ac458","year":2020},"citing_paper":{"arxiv_id":"2503.08223","last_updated":"2026-04-09T15:28:27Z","snapshot_observed_at":"2026-07-06T20:50:33.513259Z","submitted_at":"2025-03-11T09:41:29Z","title":"Will LLMs Scaling Hit the Wall? Breaking Barriers via Distributed Resources on Massive Edge Devices","version":3},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-23T01:03:26.037233Z"},"links":{"cited_paper":"/paper/2004.08900","citing_paper":"/paper/2503.08223"},"observation_digest":"sha256:4a55b0150c22713c373381e179dd1130374189181510cd988e791d8c16917cdf","observation_id":"32becdb3-cf51-4728-8ae6-718acd5704bc","resolution":{"observed_at":"2026-05-23T01:05:16.516916Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2004.08900","last_updated":"2020-04-19T16:28:35Z","snapshot_observed_at":"2026-07-06T09:13:29.404788Z","submitted_at":"2020-04-19T16:28:35Z","title":"The Cost of Training NLP Models: A Concise Overview","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2004.08900","snapshot_observed_at":"2026-08-07T00:42:04.244106Z","title":"The cost of training nlp models: A concise overview,","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2506.13186","last_updated":"2025-06-16T07:52:15Z","snapshot_observed_at":"2026-08-07T15:42:13.842021Z","submitted_at":"2025-06-16T07:52:15Z","title":"Empirical Evaluation of Large Language Models in Automated Program Repair","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-07T00:42:04.244106Z"},"links":{"cited_paper":"/paper/2004.08900","citing_paper":"/paper/2506.13186"},"observation_digest":"sha256:e79999a56154849beee5cec6041bc83a3d2a1aa1fc5c89881e2020d6a9c69dd5","observation_id":"f8eff1b3-e612-4aba-8e72-316a59496d27","resolution":{"observed_at":"2026-08-07T00:42:04.244106Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2004.08900","last_updated":"2020-04-19T16:28:35Z","snapshot_observed_at":"2026-07-06T09:13:29.404788Z","submitted_at":"2020-04-19T16:28:35Z","title":"The Cost of Training NLP Models: A Concise Overview","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2004.08900","snapshot_observed_at":"2026-08-06T18:50:08.475355Z","title":"The cost of training nlp models: A concise overview.arXiv preprint arXiv:2004.08900,","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2507.07414","last_updated":"2025-07-10T04:13:53Z","snapshot_observed_at":"2026-08-06T18:39:26.875399Z","submitted_at":"2025-07-10T04:13:53Z","title":"GNN-CNN: An Efficient Hybrid Model of Convolutional and Graph Neural Networks for Text Representation","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:08.475355Z"},"links":{"cited_paper":"/paper/2004.08900","citing_paper":"/paper/2507.07414"},"observation_digest":"sha256:004f4686295c02d3294cf39273f3b0e38b61fd1a9d0d9ecbbe4b59805699734e","observation_id":"058e6369-1db3-4c0c-8ae7-0fa3aaaac638","resolution":{"observed_at":"2026-08-06T18:50:08.475355Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2004.08900","last_updated":"2020-04-19T16:28:35Z","snapshot_observed_at":"2026-07-06T09:13:29.404788Z","submitted_at":"2020-04-19T16:28:35Z","title":"The Cost of Training NLP Models: A Concise Overview","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2004.08900","snapshot_observed_at":"2026-08-05T17:57:18.554935Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2508.15478","last_updated":"2025-09-04T11:23:22Z","snapshot_observed_at":"2026-08-05T17:57:12.128089Z","submitted_at":"2025-08-21T11:56:05Z","title":"SLM-Bench: A Comprehensive Benchmark of Small Language Models on Environmental Impacts--Extended Version","version":2},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-05T17:57:18.554935Z"},"links":{"cited_paper":"/paper/2004.08900","citing_paper":"/paper/2508.15478"},"observation_digest":"sha256:41dd498769520fee5320b15cce1c34c8ee78a7f801fee1ed40926894f923b09b","observation_id":"c0bb041c-8990-4428-baf7-3788aebaa84d","resolution":{"observed_at":"2026-08-05T17:57:18.554935Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2004.08900","last_updated":"2020-04-19T16:28:35Z","snapshot_observed_at":"2026-07-06T09:13:29.404788Z","submitted_at":"2020-04-19T16:28:35Z","title":"The Cost of Training NLP Models: A Concise Overview","version":1},"cited_work":{"arxiv_id":"2004.08900","doi":"10.48550/arxiv.2004.08900","metadata_source":"arxiv_reference","pith_arxiv_id":"2004.08900","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Sharir, B","venue":"arXiv (Cornell University)","work_id":"49a44ad2-3337-48ea-ac20-5ee1f30ac458","year":2020},"citing_paper":{"arxiv_id":"2605.02300","last_updated":"2026-05-04T07:48:02Z","snapshot_observed_at":"2026-07-06T23:15:23.301944Z","submitted_at":"2026-05-04T07:48:02Z","title":"A Meta Reinforcement Learning Approach to Goals-Based Wealth Management","version":1},"reference_index":278,"source":"arxiv_source","source_observed_at":"2026-05-08T18:42:50.962120Z"},"links":{"cited_paper":"/paper/2004.08900","citing_paper":"/paper/2605.02300"},"observation_digest":"sha256:2cbaeaa942e48002239dcab339f4d33b8d67cafc38e981add16252fbd47d6962","observation_id":"dd41b570-6c05-4f0d-9c3c-eba2179dc77c","resolution":{"observed_at":"2026-05-08T18:44:01.362620Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2004.08900","last_updated":"2020-04-19T16:28:35Z","snapshot_observed_at":"2026-07-06T09:13:29.404788Z","submitted_at":"2020-04-19T16:28:35Z","title":"The Cost of Training NLP Models: A Concise Overview","version":1},"cited_work":{"arxiv_id":"2004.08900","doi":"10.48550/arxiv.2004.08900","metadata_source":"arxiv_reference","pith_arxiv_id":"2004.08900","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Sharir, B","venue":"arXiv (Cornell University)","work_id":"49a44ad2-3337-48ea-ac20-5ee1f30ac458","year":2020},"citing_paper":{"arxiv_id":"2605.29755","last_updated":"2026-05-29T07:46:21Z","snapshot_observed_at":"2026-07-06T23:39:10.583797Z","submitted_at":"2026-05-28T10:59:07Z","title":"Rec-Distill: An Industrial Distillation Pipeline for Large-Scale Recommendation Models","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-06-29T05:27:15.111684Z"},"links":{"cited_paper":"/paper/2004.08900","citing_paper":"/paper/2605.29755"},"observation_digest":"sha256:45651798a943885b6f2a8fb8de23be48624386bcbc5ba5bbd58835a99fd512ee","observation_id":"a7282dea-01d8-43be-b4da-75b44a3a8ca7","resolution":{"observed_at":"2026-06-29T15:13:32.263241Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2004.08900","last_updated":"2020-04-19T16:28:35Z","snapshot_observed_at":"2026-07-06T09:13:29.404788Z","submitted_at":"2020-04-19T16:28:35Z","title":"The Cost of Training NLP Models: A Concise Overview","version":1},"cited_work":{"arxiv_id":"2004.08900","doi":"10.48550/arxiv.2004.08900","metadata_source":"arxiv_reference","pith_arxiv_id":"2004.08900","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Sharir, B","venue":"arXiv (Cornell University)","work_id":"49a44ad2-3337-48ea-ac20-5ee1f30ac458","year":2020},"citing_paper":{"arxiv_id":"2606.09401","last_updated":"2026-06-08T12:21:02Z","snapshot_observed_at":"2026-07-06T23:48:44.159537Z","submitted_at":"2026-06-08T12:21:02Z","title":"Benchmarking Empirical Privacy Protection for Adaptations of Large Language Models","version":1},"reference_index":142,"source":"arxiv_source","source_observed_at":"2026-06-27T17:13:46.335347Z"},"links":{"cited_paper":"/paper/2004.08900","citing_paper":"/paper/2606.09401"},"observation_digest":"sha256:3b86b4ce82eaa1ce9332ca9c87b7c75258400705631828472dac824dac4a17c5","observation_id":"10257109-a9df-4153-b93e-5099e51628d9","resolution":{"observed_at":"2026-07-03T00:27:29.573111Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2004.08900","last_updated":"2020-04-19T16:28:35Z","snapshot_observed_at":"2026-07-06T09:13:29.404788Z","submitted_at":"2020-04-19T16:28:35Z","title":"The Cost of Training NLP Models: A Concise Overview","version":1},"cited_work":{"arxiv_id":"2004.08900","doi":"10.48550/arxiv.2004.08900","metadata_source":"arxiv_reference","pith_arxiv_id":"2004.08900","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Sharir, B","venue":"arXiv (Cornell University)","work_id":"49a44ad2-3337-48ea-ac20-5ee1f30ac458","year":2020},"citing_paper":{"arxiv_id":"2606.28386","last_updated":"2026-06-22T17:06:05Z","snapshot_observed_at":"2026-08-02T11:08:25.094268Z","submitted_at":"2026-06-22T17:06:05Z","title":"Data Provenance for Image Auto-Regressive Generation","version":1},"reference_index":121,"source":"arxiv_source","source_observed_at":"2026-06-30T10:28:59.577056Z"},"links":{"cited_paper":"/paper/2004.08900","citing_paper":"/paper/2606.28386"},"observation_digest":"sha256:60a8497ba15c15f1da4a97212c9fd42f7116e57cdeb42462235bd840e25b04f8","observation_id":"d304d835-8439-4c07-a847-ed9c62b28e30","resolution":{"observed_at":"2026-06-30T10:44:37.328290Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2004.08900/citation-record","integrity":"/paper/2004.08900/integrity","json":"/paper/2004.08900/citation-record.json","paper":"/paper/2004.08900"},"outbound":[],"paper":{"arxiv_id":"2004.08900","last_updated":"2020-04-19T16:28:35Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-07-06T09:13:29.404788Z","submitted_at":"2020-04-19T16:28:35Z","title":"The Cost of Training NLP Models: A Concise Overview"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 10 inbound Pith citation observations for arXiv:2004.08900."}