{"as_of":"2026-08-12T17:52:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:5a718664eefe64a59df6bbc9536adb133f43e850c2df2cb805822909079f075e","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":19,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":19,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-12T06:34:41.77262+00:00","state":"measured"},{"denominator":19,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":19,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-12T15:15:56.290610Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-07-04T12:49:51.909964Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"1901.11504","last_updated":"2019-05-30T00:01:20Z","snapshot_observed_at":"2026-07-06T07:30:20.997518Z","submitted_at":"2019-01-31T18:07:25Z","title":"Multi-Task Deep Neural Networks for Natural Language Understanding","version":2},"cited_work":{"arxiv_id":"1901.11504","doi":null,"metadata_source":"pith","pith_arxiv_id":"1901.11504","snapshot_observed_at":"2026-07-04T12:49:51.909964Z","title":"Multi-Task Deep Neural Networks for Natural Language Understanding","venue":"cs.CL","work_id":"f57b1561-a825-41b7-8759-04a1f8e9aa38","year":2019},"citing_paper":{"arxiv_id":"1905.00537","last_updated":"2020-02-13T00:28:00Z","snapshot_observed_at":"2026-08-12T12:17:26.135577Z","submitted_at":"2019-05-02T00:41:50Z","title":"SuperGLUE: A Stickier Benchmark for General-Purpose Language Understanding Systems","version":3},"reference_index":120,"source":"arxiv_source","source_observed_at":"2026-05-15T01:34:10.604864Z"},"links":{"cited_paper":"/paper/1901.11504","citing_paper":"/paper/1905.00537"},"observation_digest":"sha256:5310b5aa0c894c4e62f9663432a3f2da07924f720b7a4c4f35a2ead66c44ba64","observation_id":"ee180364-d549-4a63-ad7e-10dc78b1743c","resolution":{"observed_at":"2026-05-15T01:34:10.757651Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1901.11504","last_updated":"2019-05-30T00:01:20Z","snapshot_observed_at":"2026-07-06T07:30:20.997518Z","submitted_at":"2019-01-31T18:07:25Z","title":"Multi-Task Deep Neural Networks for Natural Language Understanding","version":2},"cited_work":{"arxiv_id":"1901.11504","doi":null,"metadata_source":"pith","pith_arxiv_id":"1901.11504","snapshot_observed_at":"2026-07-04T12:49:51.909964Z","title":"Multi-Task Deep Neural Networks for Natural Language Understanding","venue":"cs.CL","work_id":"f57b1561-a825-41b7-8759-04a1f8e9aa38","year":2019},"citing_paper":{"arxiv_id":"1906.08237","last_updated":"2020-01-02T12:48:08Z","snapshot_observed_at":"2026-07-31T22:49:43.034741Z","submitted_at":"2019-06-19T17:35:48Z","title":"XLNet: Generalized Autoregressive Pretraining for Language Understanding","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-18T01:29:27.427361Z"},"links":{"cited_paper":"/paper/1901.11504","citing_paper":"/paper/1906.08237"},"observation_digest":"sha256:5188a3dcef14ac15201f2ee5e11dc385e285e32dd3c53d25d8caaa6fcb40aeb9","observation_id":"6b5cdbdd-0d9d-4ea8-8a33-2ce8808b8fdc","resolution":{"observed_at":"2026-05-18T01:29:27.509639Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1901.11504","last_updated":"2019-05-30T00:01:20Z","snapshot_observed_at":"2026-07-06T07:30:20.997518Z","submitted_at":"2019-01-31T18:07:25Z","title":"Multi-Task Deep Neural Networks for Natural Language Understanding","version":2},"cited_work":{"arxiv_id":"1901.11504","doi":null,"metadata_source":"pith","pith_arxiv_id":"1901.11504","snapshot_observed_at":"2026-07-04T12:49:51.909964Z","title":"Multi-Task Deep Neural Networks for Natural Language Understanding","venue":"cs.CL","work_id":"f57b1561-a825-41b7-8759-04a1f8e9aa38","year":2019},"citing_paper":{"arxiv_id":"1907.05338","last_updated":"2019-07-09T04:46:31Z","snapshot_observed_at":"2026-08-08T15:18:03.476831Z","submitted_at":"2019-07-09T04:46:31Z","title":"To Tune or Not To Tune? How About the Best of Both Worlds?","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-25T00:45:10.865484Z"},"links":{"cited_paper":"/paper/1901.11504","citing_paper":"/paper/1907.05338"},"observation_digest":"sha256:6ddf266d7b7b194233673829ce122ec5b9fc4aab9e9152844033aa661451b9c8","observation_id":"95bca717-14c1-4527-823f-4bb7e395acbe","resolution":{"observed_at":"2026-05-25T00:46:30.622943Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1901.11504","last_updated":"2019-05-30T00:01:20Z","snapshot_observed_at":"2026-07-06T07:30:20.997518Z","submitted_at":"2019-01-31T18:07:25Z","title":"Multi-Task Deep Neural Networks for Natural Language Understanding","version":2},"cited_work":{"arxiv_id":"1901.11504","doi":null,"metadata_source":"pith","pith_arxiv_id":"1901.11504","snapshot_observed_at":"2026-07-04T12:49:51.909964Z","title":"Multi-Task Deep Neural Networks for Natural Language Understanding","venue":"cs.CL","work_id":"f57b1561-a825-41b7-8759-04a1f8e9aa38","year":2019},"citing_paper":{"arxiv_id":"1907.11692","last_updated":"2019-07-26T17:48:29Z","snapshot_observed_at":"2026-07-31T22:31:37.910868Z","submitted_at":"2019-07-26T17:48:29Z","title":"RoBERTa: A Robustly Optimized BERT Pretraining Approach","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-05-09T04:47:43.784327Z"},"links":{"cited_paper":"/paper/1901.11504","citing_paper":"/paper/1907.11692"},"observation_digest":"sha256:2eb0266bb0abdac9193dc1289b3269ba9b32b18f89d200a965f325a56cba3906","observation_id":"a30af3ea-b967-4c99-b6a9-64bc633b8514","resolution":{"observed_at":"2026-05-09T04:47:44.425009Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1901.11504","last_updated":"2019-05-30T00:01:20Z","snapshot_observed_at":"2026-07-06T07:30:20.997518Z","submitted_at":"2019-01-31T18:07:25Z","title":"Multi-Task Deep Neural Networks for Natural Language Understanding","version":2},"cited_work":{"arxiv_id":"1901.11504","doi":null,"metadata_source":"pith","pith_arxiv_id":"1901.11504","snapshot_observed_at":"2026-07-04T12:49:51.909964Z","title":"Multi-Task Deep Neural Networks for Natural Language Understanding","venue":"cs.CL","work_id":"f57b1561-a825-41b7-8759-04a1f8e9aa38","year":2019},"citing_paper":{"arxiv_id":"1909.08053","last_updated":"2020-03-13T23:45:18Z","snapshot_observed_at":"2026-08-12T10:50:46.357243Z","submitted_at":"2019-09-17T19:42:54Z","title":"Megatron-LM: Training Multi-Billion Parameter Language Models Using Model Parallelism","version":4},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-10T18:34:44.807534Z"},"links":{"cited_paper":"/paper/1901.11504","citing_paper":"/paper/1909.08053"},"observation_digest":"sha256:7602c255be001276dafdd9681779abd295fd4bf662eeba526adc77045875032c","observation_id":"1755b56c-2157-4548-a092-a5ac8c2c3a2b","resolution":{"observed_at":"2026-05-10T18:34:44.858886Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1901.11504","last_updated":"2019-05-30T00:01:20Z","snapshot_observed_at":"2026-07-06T07:30:20.997518Z","submitted_at":"2019-01-31T18:07:25Z","title":"Multi-Task Deep Neural Networks for Natural Language Understanding","version":2},"cited_work":{"arxiv_id":"1901.11504","doi":null,"metadata_source":"pith","pith_arxiv_id":"1901.11504","snapshot_observed_at":"2026-07-04T12:49:51.909964Z","title":"Multi-Task Deep Neural Networks for Natural Language Understanding","venue":"cs.CL","work_id":"f57b1561-a825-41b7-8759-04a1f8e9aa38","year":2019},"citing_paper":{"arxiv_id":"1910.10683","last_updated":"2023-09-19T15:14:48Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2019-10-23T17:37:36Z","title":"Exploring the Limits of Transfer Learning with a Unified Text-to-Text Transformer","version":4},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-05-12T05:37:55.083206Z"},"links":{"cited_paper":"/paper/1901.11504","citing_paper":"/paper/1910.10683"},"observation_digest":"sha256:455a494b1642b982f1aacc2196d070e242536adb0f2dd44f0bcb959975d174af","observation_id":"47ddca43-2e1d-4944-9785-3779654ae4d3","resolution":{"observed_at":"2026-05-12T05:37:55.800230Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1901.11504","last_updated":"2019-05-30T00:01:20Z","snapshot_observed_at":"2026-07-06T07:30:20.997518Z","submitted_at":"2019-01-31T18:07:25Z","title":"Multi-Task Deep Neural Networks for Natural Language Understanding","version":2},"cited_work":{"arxiv_id":"1901.11504","doi":null,"metadata_source":"pith","pith_arxiv_id":"1901.11504","snapshot_observed_at":"2026-07-04T12:49:51.909964Z","title":"Multi-Task Deep Neural Networks for Natural Language Understanding","venue":"cs.CL","work_id":"f57b1561-a825-41b7-8759-04a1f8e9aa38","year":2019},"citing_paper":{"arxiv_id":"2005.14165","last_updated":"2020-07-22T19:47:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-05-28T17:29:03Z","title":"Language Models are Few-Shot Learners","version":4},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-05-10T12:05:38.045330Z"},"links":{"cited_paper":"/paper/1901.11504","citing_paper":"/paper/2005.14165"},"observation_digest":"sha256:b94958e5880944cf417bc8bff3630855b6a556bedb61759c844e6c960816e75a","observation_id":"32194952-edc2-40fb-b1ef-1b69cc58c07f","resolution":{"observed_at":"2026-05-10T12:05:38.291430Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1901.11504","last_updated":"2019-05-30T00:01:20Z","snapshot_observed_at":"2026-07-06T07:30:20.997518Z","submitted_at":"2019-01-31T18:07:25Z","title":"Multi-Task Deep Neural Networks for Natural Language Understanding","version":2},"cited_work":{"arxiv_id":"1901.11504","doi":null,"metadata_source":"pith","pith_arxiv_id":"1901.11504","snapshot_observed_at":"2026-07-04T12:49:51.909964Z","title":"Multi-Task Deep Neural Networks for Natural Language Understanding","venue":"cs.CL","work_id":"f57b1561-a825-41b7-8759-04a1f8e9aa38","year":2019},"citing_paper":{"arxiv_id":"2205.01068","last_updated":"2022-06-21T17:04:40Z","snapshot_observed_at":"2026-08-06T03:13:37.403059Z","submitted_at":"2022-05-02T17:49:50Z","title":"OPT: Open Pre-trained Transformer Language Models","version":4},"reference_index":81,"source":"arxiv_source","source_observed_at":"2026-05-10T20:53:16.720145Z"},"links":{"cited_paper":"/paper/1901.11504","citing_paper":"/paper/2205.01068"},"observation_digest":"sha256:9c17aca727c7f9101932a07aece8680187c46793cb5eadd705821ee75643d380","observation_id":"bc14eb0b-5cdc-44a2-92a6-3bdaf5057ae6","resolution":{"observed_at":"2026-05-10T20:53:17.390694Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1901.11504","last_updated":"2019-05-30T00:01:20Z","snapshot_observed_at":"2026-07-06T07:30:20.997518Z","submitted_at":"2019-01-31T18:07:25Z","title":"Multi-Task Deep Neural Networks for Natural Language Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1901.11504","snapshot_observed_at":"2026-08-12T15:15:56.290610Z","title":"Multi-task deep neural networks for natural language understanding","venue":null,"work_id":null,"year":1901},"citing_paper":{"arxiv_id":"2411.15231","last_updated":"2025-04-15T01:42:54Z","snapshot_observed_at":"2026-08-12T15:07:47.606100Z","submitted_at":"2024-11-21T19:04:02Z","title":"IterIS: Iterative Inference-Solving Alignment for LoRA Merging","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-12T15:15:56.290610Z"},"links":{"cited_paper":"/paper/1901.11504","citing_paper":"/paper/2411.15231"},"observation_digest":"sha256:e9996dbadb8e9db378f28a94cb4121743de97065c0b4f89e524ac4e6b44473ec","observation_id":"acbf9965-271a-4de6-adf2-7467dd86134a","resolution":{"observed_at":"2026-08-12T15:15:56.290610Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1901.11504","last_updated":"2019-05-30T00:01:20Z","snapshot_observed_at":"2026-07-06T07:30:20.997518Z","submitted_at":"2019-01-31T18:07:25Z","title":"Multi-Task Deep Neural Networks for Natural Language Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1901.11504","snapshot_observed_at":"2026-08-12T12:45:20.012458Z","title":"Multi-task deep neural networks for natural language understanding","venue":null,"work_id":null,"year":1901},"citing_paper":{"arxiv_id":"2411.16991","last_updated":"2024-11-25T23:37:48Z","snapshot_observed_at":"2026-08-12T17:05:19.170799Z","submitted_at":"2024-11-25T23:37:48Z","title":"Dynamic Self-Distillation via Previous Mini-batches for Fine-tuning Small Language Models","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-12T12:45:20.012458Z"},"links":{"cited_paper":"/paper/1901.11504","citing_paper":"/paper/2411.16991"},"observation_digest":"sha256:f3815c97e7536ecff6d0ceeb8d81c0dcc0443ca0a3b3d177a876526a62202e52","observation_id":"5bbc6500-41bd-440b-87ee-34559a81b19b","resolution":{"observed_at":"2026-08-12T12:45:20.012458Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1901.11504","last_updated":"2019-05-30T00:01:20Z","snapshot_observed_at":"2026-07-06T07:30:20.997518Z","submitted_at":"2019-01-31T18:07:25Z","title":"Multi-Task Deep Neural Networks for Natural Language Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1901.11504","snapshot_observed_at":"2026-08-11T13:59:01.757855Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2412.12591","last_updated":"2025-07-25T09:22:04Z","snapshot_observed_at":"2026-08-12T09:54:38.940490Z","submitted_at":"2024-12-17T06:48:24Z","title":"LLMs are Also Effective Embedding Models: An In-depth Overview","version":2},"reference_index":91,"source":"pdf_text","source_observed_at":"2026-08-11T13:59:01.757855Z"},"links":{"cited_paper":"/paper/1901.11504","citing_paper":"/paper/2412.12591"},"observation_digest":"sha256:15de825cb024b4f633dd8d9a65d23295c1d9cf7f6dd5bcdd1038b7731a9f99d8","observation_id":"13f1340b-b94e-4887-bf6f-b5f68ba93cc5","resolution":{"observed_at":"2026-08-11T13:59:01.757855Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1901.11504","last_updated":"2019-05-30T00:01:20Z","snapshot_observed_at":"2026-07-06T07:30:20.997518Z","submitted_at":"2019-01-31T18:07:25Z","title":"Multi-Task Deep Neural Networks for Natural Language Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1901.11504","snapshot_observed_at":"2026-08-10T22:12:49.983571Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2501.02654","last_updated":"2025-01-08T14:53:41Z","snapshot_observed_at":"2026-08-11T19:00:58.907199Z","submitted_at":"2025-01-05T20:39:52Z","title":"Tougher Text, Smarter Models: Raising the Bar for Adversarial Defence Benchmarks","version":2},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-10T22:12:49.983571Z"},"links":{"cited_paper":"/paper/1901.11504","citing_paper":"/paper/2501.02654"},"observation_digest":"sha256:16d7c54be71abf3777665bba2fbbc5d3f6942fe508a14d6d6b782f2f6efe8885","observation_id":"5925b884-372b-48bf-ab6a-62aecb4a40a5","resolution":{"observed_at":"2026-08-10T22:12:49.983571Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1901.11504","last_updated":"2019-05-30T00:01:20Z","snapshot_observed_at":"2026-07-06T07:30:20.997518Z","submitted_at":"2019-01-31T18:07:25Z","title":"Multi-Task Deep Neural Networks for Natural Language Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1901.11504","snapshot_observed_at":"2026-08-10T22:17:55.648966Z","title":"Multi-task deep neural networks for natural language understand- ing","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2501.04040","last_updated":"2025-02-09T08:00:36Z","snapshot_observed_at":"2026-08-10T22:47:31.199700Z","submitted_at":"2025-01-03T21:04:49Z","title":"A Survey on Large Language Models with some Insights on their Capabilities and Limitations","version":2},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-10T22:17:55.648966Z"},"links":{"cited_paper":"/paper/1901.11504","citing_paper":"/paper/2501.04040"},"observation_digest":"sha256:930d191a2f05f1c26f6cef1a111042a214e21a32fa29e0a60764721243d09e8e","observation_id":"b376b492-8d80-4f8d-ab6f-0c4c9a0675b9","resolution":{"observed_at":"2026-08-10T22:17:55.648966Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1901.11504","last_updated":"2019-05-30T00:01:20Z","snapshot_observed_at":"2026-07-06T07:30:20.997518Z","submitted_at":"2019-01-31T18:07:25Z","title":"Multi-Task Deep Neural Networks for Natural Language Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1901.11504","snapshot_observed_at":"2026-08-09T15:04:40.108448Z","title":"Multi-task deep neural networks for natural language understanding","venue":null,"work_id":null,"year":1901},"citing_paper":{"arxiv_id":"2502.01524","last_updated":"2025-02-03T17:01:59Z","snapshot_observed_at":"2026-08-11T11:46:05.304510Z","submitted_at":"2025-02-03T17:01:59Z","title":"Efficiently Integrate Large Language Models with Visual Perception: A Survey from the Training Paradigm Perspective","version":1},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-08-09T15:04:40.108448Z"},"links":{"cited_paper":"/paper/1901.11504","citing_paper":"/paper/2502.01524"},"observation_digest":"sha256:68f87c1c7820348123dffe236552ede6bee9fecb31693167bbd0c93145e3b04b","observation_id":"61074ac1-edc3-4e83-9567-321dfa50f885","resolution":{"observed_at":"2026-08-09T15:04:40.108448Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1901.11504","last_updated":"2019-05-30T00:01:20Z","snapshot_observed_at":"2026-07-06T07:30:20.997518Z","submitted_at":"2019-01-31T18:07:25Z","title":"Multi-Task Deep Neural Networks for Natural Language Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1901.11504","snapshot_observed_at":"2026-08-08T16:20:38.287083Z","title":null,"venue":null,"work_id":null,"year":1901},"citing_paper":{"arxiv_id":"2502.06244","last_updated":"2025-06-04T02:16:01Z","snapshot_observed_at":"2026-08-09T15:20:25.734420Z","submitted_at":"2025-02-10T08:23:05Z","title":"PiKE: Adaptive Data Mixing for Large-Scale Multi-Task Learning Under Low Gradient Conflicts","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-08T16:20:38.287083Z"},"links":{"cited_paper":"/paper/1901.11504","citing_paper":"/paper/2502.06244"},"observation_digest":"sha256:9d450eaa17346f3bde4519ddefd64cbd93bc18909aafca96b1e00b26c5484d85","observation_id":"0f5ff7bc-e362-4451-ad1d-a7f9cf62e3c7","resolution":{"observed_at":"2026-08-08T16:20:38.287083Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1901.11504","last_updated":"2019-05-30T00:01:20Z","snapshot_observed_at":"2026-07-06T07:30:20.997518Z","submitted_at":"2019-01-31T18:07:25Z","title":"Multi-Task Deep Neural Networks for Natural Language Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1901.11504","snapshot_observed_at":"2026-08-07T12:47:01.912278Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.23538","last_updated":"2025-05-29T15:19:00Z","snapshot_observed_at":"2026-08-10T19:26:34.214014Z","submitted_at":"2025-05-29T15:19:00Z","title":"CLaC at SemEval-2025 Task 6: A Multi-Architecture Approach for Corporate Environmental Promise Verification","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-07T12:47:01.912278Z"},"links":{"cited_paper":"/paper/1901.11504","citing_paper":"/paper/2505.23538"},"observation_digest":"sha256:3d16acf1b837f596d16d76a5c5e1480e924deba6cce07c7a9146331aac822c5d","observation_id":"372a565e-e29c-4466-a46d-58c3345b0360","resolution":{"observed_at":"2026-08-07T12:47:01.912278Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1901.11504","last_updated":"2019-05-30T00:01:20Z","snapshot_observed_at":"2026-07-06T07:30:20.997518Z","submitted_at":"2019-01-31T18:07:25Z","title":"Multi-Task Deep Neural Networks for Natural Language Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1901.11504","snapshot_observed_at":"2026-08-06T15:46:44.815620Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2507.15067","last_updated":"2025-07-20T18:03:44Z","snapshot_observed_at":"2026-08-09T09:52:59.156741Z","submitted_at":"2025-07-20T18:03:44Z","title":"ROBAD: Robust Adversary-aware Local-Global Attended Bad Actor Detection Sequential Model","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T15:46:44.815620Z"},"links":{"cited_paper":"/paper/1901.11504","citing_paper":"/paper/2507.15067"},"observation_digest":"sha256:f6ee01f6c42b337e2acf12f1b2dbbe913010692b807e9c0314bfa3d62f816aaa","observation_id":"6f08d134-1994-4838-a5ac-68bccb243035","resolution":{"observed_at":"2026-08-06T15:46:44.815620Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1901.11504","last_updated":"2019-05-30T00:01:20Z","snapshot_observed_at":"2026-07-06T07:30:20.997518Z","submitted_at":"2019-01-31T18:07:25Z","title":"Multi-Task Deep Neural Networks for Natural Language Understanding","version":2},"cited_work":{"arxiv_id":"1901.11504","doi":null,"metadata_source":"pith","pith_arxiv_id":"1901.11504","snapshot_observed_at":"2026-07-04T12:49:51.909964Z","title":"Multi-Task Deep Neural Networks for Natural Language Understanding","venue":"cs.CL","work_id":"f57b1561-a825-41b7-8759-04a1f8e9aa38","year":2019},"citing_paper":{"arxiv_id":"2604.14833","last_updated":"2026-04-16T10:10:16Z","snapshot_observed_at":"2026-08-10T08:40:28.788338Z","submitted_at":"2026-04-16T10:10:16Z","title":"Federated User Behavior Modeling for Privacy-Preserving LLM Recommendation","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-10T10:08:51.386465Z"},"links":{"cited_paper":"/paper/1901.11504","citing_paper":"/paper/2604.14833"},"observation_digest":"sha256:af831c8fe94a64edb115b21db18047a1d3031d69affc41377f1904cea9c2f638","observation_id":"d21e5e55-b7cb-4f46-b666-6e605b1fc57a","resolution":{"observed_at":"2026-05-10T10:09:06.474792Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1901.11504","last_updated":"2019-05-30T00:01:20Z","snapshot_observed_at":"2026-07-06T07:30:20.997518Z","submitted_at":"2019-01-31T18:07:25Z","title":"Multi-Task Deep Neural Networks for Natural Language Understanding","version":2},"cited_work":{"arxiv_id":"1901.11504","doi":null,"metadata_source":"pith","pith_arxiv_id":"1901.11504","snapshot_observed_at":"2026-07-04T12:49:51.909964Z","title":"Multi-Task Deep Neural Networks for Natural Language Understanding","venue":"cs.CL","work_id":"f57b1561-a825-41b7-8759-04a1f8e9aa38","year":2019},"citing_paper":{"arxiv_id":"2606.23919","last_updated":"2026-06-22T20:32:47Z","snapshot_observed_at":"2026-08-08T18:36:41.952502Z","submitted_at":"2026-06-22T20:32:47Z","title":"Unified Multi-Task Relevance Modeling for E-Commerce: Comparing Task Routing Architectures Across LLMs and Cross-Encoders","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-06-26T06:08:27.696658Z"},"links":{"cited_paper":"/paper/1901.11504","citing_paper":"/paper/2606.23919"},"observation_digest":"sha256:f325fb3c6cd417103c32670fe764a6aebcd1a8cc768f784a6b7efa5bc2597c00","observation_id":"a5be81ac-1507-4435-b93f-2dc5fc785298","resolution":{"observed_at":"2026-07-04T12:49:51.911159Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/1901.11504/citation-record","integrity":"/paper/1901.11504/integrity","json":"/paper/1901.11504/citation-record.json","paper":"/paper/1901.11504"},"outbound":[],"paper":{"arxiv_id":"1901.11504","last_updated":"2019-05-30T00:01:20Z","latest_version":2,"primary_category":"cs.CL","snapshot_observed_at":"2026-07-06T07:30:20.997518Z","submitted_at":"2019-01-31T18:07:25Z","title":"Multi-Task Deep Neural Networks for Natural Language Understanding"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"thesis":"As of 12 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 19 inbound Pith citation observations for arXiv:1901.11504."}