{"as_of":"2026-08-22T12:18:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:17805896acbdaf9c36711a3724fb8817b8c1652f8fced99e6c647344304645fd","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":100,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":100,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-22T06:32:14.747728+00:00","state":"measured"},{"denominator":117,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":100,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-16T12:28:25.217864Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-07-04T07:39:38.353471Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"1801.06146","last_updated":"2018-05-23T09:23:47Z","snapshot_observed_at":"2026-08-14T19:54:00.470999Z","submitted_at":"2018-01-18T17:54:52Z","title":"Universal Language Model Fine-tuning for Text Classification","version":5},"cited_work":{"arxiv_id":"1801.06146","doi":null,"metadata_source":"pith","pith_arxiv_id":"1801.06146","snapshot_observed_at":"2026-07-04T07:39:38.353471Z","title":"Universal Language Model Fine-tuning for Text Classification","venue":"cs.CL","work_id":"9990d84d-84b4-4fd4-acb5-da451524d2f4","year":2018},"citing_paper":{"arxiv_id":"1906.08237","last_updated":"2020-01-02T12:48:08Z","snapshot_observed_at":"2026-07-31T22:49:43.034741Z","submitted_at":"2019-06-19T17:35:48Z","title":"XLNet: Generalized Autoregressive Pretraining for Language Understanding","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-18T01:29:27.427361Z"},"links":{"cited_paper":"/paper/1801.06146","citing_paper":"/paper/1906.08237"},"observation_digest":"sha256:eb1fdcfff6d6eed2194c75335b56333876c202e717acddf7604fde98630da23d","observation_id":"01102934-d9d6-455d-9788-9ea03f5c72a7","resolution":{"observed_at":"2026-05-18T01:29:27.485025Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1801.06146","last_updated":"2018-05-23T09:23:47Z","snapshot_observed_at":"2026-08-14T19:54:00.470999Z","submitted_at":"2018-01-18T17:54:52Z","title":"Universal Language Model Fine-tuning for Text Classification","version":5},"cited_work":{"arxiv_id":"1801.06146","doi":null,"metadata_source":"pith","pith_arxiv_id":"1801.06146","snapshot_observed_at":"2026-07-04T07:39:38.353471Z","title":"Universal Language Model Fine-tuning for Text Classification","venue":"cs.CL","work_id":"9990d84d-84b4-4fd4-acb5-da451524d2f4","year":2018},"citing_paper":{"arxiv_id":"1906.10256","last_updated":"2019-07-13T05:38:28Z","snapshot_observed_at":"2026-08-19T11:04:53.964105Z","submitted_at":"2019-06-24T22:31:33Z","title":"Good Secretaries, Bad Truck Drivers? Occupational Gender Stereotypes in Sentiment Analysis","version":2},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-05-25T17:11:44.144090Z"},"links":{"cited_paper":"/paper/1801.06146","citing_paper":"/paper/1906.10256"},"observation_digest":"sha256:d09311cac51d3465e956034bd8ecf7b289331733a2dcc9fa92ea73e60e1828c8","observation_id":"498b7e4d-b6ce-43cb-98e7-681e82eaeac9","resolution":{"observed_at":"2026-05-25T17:16:04.646883Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1801.06146","last_updated":"2018-05-23T09:23:47Z","snapshot_observed_at":"2026-08-14T19:54:00.470999Z","submitted_at":"2018-01-18T17:54:52Z","title":"Universal Language Model Fine-tuning for Text Classification","version":5},"cited_work":{"arxiv_id":"1801.06146","doi":null,"metadata_source":"pith","pith_arxiv_id":"1801.06146","snapshot_observed_at":"2026-07-04T07:39:38.353471Z","title":"Universal Language Model Fine-tuning for Text Classification","venue":"cs.CL","work_id":"9990d84d-84b4-4fd4-acb5-da451524d2f4","year":2018},"citing_paper":{"arxiv_id":"1906.11085","last_updated":"2019-06-26T13:27:39Z","snapshot_observed_at":"2026-08-19T02:14:45.679299Z","submitted_at":"2019-06-26T13:27:39Z","title":"Enhancing PIO Element Detection in Medical Text Using Contextualized Embedding","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-05-25T15:46:41.284029Z"},"links":{"cited_paper":"/paper/1801.06146","citing_paper":"/paper/1906.11085"},"observation_digest":"sha256:805ec1cd80cd6e7eacbc300cda0fd8c08960e6530b684889caad0753324c8b8c","observation_id":"cc579eff-9ab2-47cc-9bfa-9c458037c08d","resolution":{"observed_at":"2026-05-25T15:47:02.745510Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1801.06146","last_updated":"2018-05-23T09:23:47Z","snapshot_observed_at":"2026-08-14T19:54:00.470999Z","submitted_at":"2018-01-18T17:54:52Z","title":"Universal Language Model Fine-tuning for Text Classification","version":5},"cited_work":{"arxiv_id":"1801.06146","doi":null,"metadata_source":"pith","pith_arxiv_id":"1801.06146","snapshot_observed_at":"2026-07-04T07:39:38.353471Z","title":"Universal Language Model Fine-tuning for Text Classification","venue":"cs.CL","work_id":"9990d84d-84b4-4fd4-acb5-da451524d2f4","year":2018},"citing_paper":{"arxiv_id":"1907.02581","last_updated":"2019-07-10T21:09:43Z","snapshot_observed_at":"2026-08-19T12:46:25.848029Z","submitted_at":"2019-07-04T20:37:44Z","title":"Transfer Learning for Risk Classification of Social Media Posts: Model Evaluation Study","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-25T09:01:03.286718Z"},"links":{"cited_paper":"/paper/1801.06146","citing_paper":"/paper/1907.02581"},"observation_digest":"sha256:1479ccb764b1a49f9ab84e7e4efcfe97e7691a5e236127e960a11b76dfed2b8c","observation_id":"9db1149b-76f7-4825-92a8-e698e53dd574","resolution":{"observed_at":"2026-05-25T09:05:36.064174Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1801.06146","last_updated":"2018-05-23T09:23:47Z","snapshot_observed_at":"2026-08-14T19:54:00.470999Z","submitted_at":"2018-01-18T17:54:52Z","title":"Universal Language Model Fine-tuning for Text Classification","version":5},"cited_work":{"arxiv_id":"1801.06146","doi":null,"metadata_source":"pith","pith_arxiv_id":"1801.06146","snapshot_observed_at":"2026-07-04T07:39:38.353471Z","title":"Universal Language Model Fine-tuning for Text Classification","venue":"cs.CL","work_id":"9990d84d-84b4-4fd4-acb5-da451524d2f4","year":2018},"citing_paper":{"arxiv_id":"1907.03187","last_updated":"2019-07-06T21:05:54Z","snapshot_observed_at":"2026-08-12T22:43:19.258455Z","submitted_at":"2019-07-06T21:05:54Z","title":"Applying a Pre-trained Language Model to Spanish Twitter Humor Prediction","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-25T01:28:10.159672Z"},"links":{"cited_paper":"/paper/1801.06146","citing_paper":"/paper/1907.03187"},"observation_digest":"sha256:ab3429a743125beb742cbffba77933ce7e0b540123a23d69071ce51f2efa6796","observation_id":"5ee27dc3-cc07-4e51-bb43-b922751f29c8","resolution":{"observed_at":"2026-05-25T01:30:10.769867Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1801.06146","last_updated":"2018-05-23T09:23:47Z","snapshot_observed_at":"2026-08-14T19:54:00.470999Z","submitted_at":"2018-01-18T17:54:52Z","title":"Universal Language Model Fine-tuning for Text Classification","version":5},"cited_work":{"arxiv_id":"1801.06146","doi":null,"metadata_source":"pith","pith_arxiv_id":"1801.06146","snapshot_observed_at":"2026-07-04T07:39:38.353471Z","title":"Universal Language Model Fine-tuning for Text Classification","venue":"cs.CL","work_id":"9990d84d-84b4-4fd4-acb5-da451524d2f4","year":2018},"citing_paper":{"arxiv_id":"1907.06690","last_updated":"2019-07-15T18:44:20Z","snapshot_observed_at":"2026-08-19T00:30:59.543335Z","submitted_at":"2019-07-15T18:44:20Z","title":"A Scalable Framework for Multilevel Streaming Data Analytics using Deep Learning","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-24T21:20:27.642301Z"},"links":{"cited_paper":"/paper/1801.06146","citing_paper":"/paper/1907.06690"},"observation_digest":"sha256:4c73ae605e2fcccd90c8a9d4e4d99b04330c1a8d743c2949b01aaefc54e59dca","observation_id":"d502deca-b51b-48a2-9437-0e01c6cb9044","resolution":{"observed_at":"2026-05-24T21:24:58.095489Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1801.06146","last_updated":"2018-05-23T09:23:47Z","snapshot_observed_at":"2026-08-14T19:54:00.470999Z","submitted_at":"2018-01-18T17:54:52Z","title":"Universal Language Model Fine-tuning for Text Classification","version":5},"cited_work":{"arxiv_id":"1801.06146","doi":null,"metadata_source":"pith","pith_arxiv_id":"1801.06146","snapshot_observed_at":"2026-07-04T07:39:38.353471Z","title":"Universal Language Model Fine-tuning for Text Classification","venue":"cs.CL","work_id":"9990d84d-84b4-4fd4-acb5-da451524d2f4","year":2018},"citing_paper":{"arxiv_id":"1907.11692","last_updated":"2019-07-26T17:48:29Z","snapshot_observed_at":"2026-08-16T14:33:50.657682Z","submitted_at":"2019-07-26T17:48:29Z","title":"RoBERTa: A Robustly Optimized BERT Pretraining Approach","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-05-09T04:47:43.784327Z"},"links":{"cited_paper":"/paper/1801.06146","citing_paper":"/paper/1907.11692"},"observation_digest":"sha256:c6f1bbeb927799d0f611393cc4c46cac217fd9ea6ffb70234666b3c390fdda49","observation_id":"caf21d04-95a5-43a9-a2c7-354bc3a6b94a","resolution":{"observed_at":"2026-05-09T04:47:44.438569Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1801.06146","last_updated":"2018-05-23T09:23:47Z","snapshot_observed_at":"2026-08-14T19:54:00.470999Z","submitted_at":"2018-01-18T17:54:52Z","title":"Universal Language Model Fine-tuning for Text Classification","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1801.06146","snapshot_observed_at":"2026-08-14T13:26:52.720193Z","title":"In EMNLP, 670–680","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"1908.05161","last_updated":"2019-11-21T06:38:18Z","snapshot_observed_at":"2026-08-16T18:50:43.360701Z","submitted_at":"2019-08-14T15:06:48Z","title":"Scalable Attentive Sentence-Pair Modeling via Distilled Sentence Embedding","version":3},"reference_index":2017,"source":"pdf_text","source_observed_at":"2026-08-14T13:26:52.720193Z"},"links":{"cited_paper":"/paper/1801.06146","citing_paper":"/paper/1908.05161"},"observation_digest":"sha256:47f19ccb15e0d40beab2dd0efdb5502a7eabd2766d2f94403a35af148712ddc3","observation_id":"475cf64d-1b7e-4e30-a835-0f91a9a36860","resolution":{"observed_at":"2026-08-14T13:26:52.720193Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1801.06146","last_updated":"2018-05-23T09:23:47Z","snapshot_observed_at":"2026-08-14T19:54:00.470999Z","submitted_at":"2018-01-18T17:54:52Z","title":"Universal Language Model Fine-tuning for Text Classification","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1801.06146","snapshot_observed_at":"2026-08-14T13:11:03.327862Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"1908.05620","last_updated":"2019-08-15T16:11:45Z","snapshot_observed_at":"2026-08-15T20:47:19.986034Z","submitted_at":"2019-08-15T16:11:45Z","title":"Visualizing and Understanding the Effectiveness of BERT","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-14T13:11:03.327862Z"},"links":{"cited_paper":"/paper/1801.06146","citing_paper":"/paper/1908.05620"},"observation_digest":"sha256:b7130cff6c4f4bfc033570eb60dd935475dd74a10f1951124c174adf6cc67564","observation_id":"0bab19b8-dd0f-4461-8d64-c33eebf6333e","resolution":{"observed_at":"2026-08-14T13:11:03.327862Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1801.06146","last_updated":"2018-05-23T09:23:47Z","snapshot_observed_at":"2026-08-14T19:54:00.470999Z","submitted_at":"2018-01-18T17:54:52Z","title":"Universal Language Model Fine-tuning for Text Classification","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1801.06146","snapshot_observed_at":"2026-08-14T13:02:45.068830Z","title":"Universal language model ﬁne-tuning for text classiﬁcation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"1908.06039","last_updated":"2020-02-18T17:47:46Z","snapshot_observed_at":"2026-08-18T03:33:22.312848Z","submitted_at":"2019-08-16T15:46:14Z","title":"Few-shot Text Classification with Distributional Signatures","version":3},"reference_index":1997,"source":"pdf_text","source_observed_at":"2026-08-14T13:02:45.068830Z"},"links":{"cited_paper":"/paper/1801.06146","citing_paper":"/paper/1908.06039"},"observation_digest":"sha256:293f946b6249abb15c1f8870292d42b7a04f96eba53f1ca4cddfd22004a7d4c6","observation_id":"d530542f-a9de-4c99-88f9-195c27e376a1","resolution":{"observed_at":"2026-08-14T13:02:45.068830Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1801.06146","last_updated":"2018-05-23T09:23:47Z","snapshot_observed_at":"2026-08-14T19:54:00.470999Z","submitted_at":"2018-01-18T17:54:52Z","title":"Universal Language Model Fine-tuning for Text Classification","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1801.06146","snapshot_observed_at":"2026-08-14T12:58:19.048540Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"1908.06121","last_updated":"2020-06-19T20:24:05Z","snapshot_observed_at":"2026-08-17T16:36:13.486028Z","submitted_at":"2019-08-16T18:19:59Z","title":"CFO: A Framework for Building Production NLP Systems","version":3},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-14T12:58:19.048540Z"},"links":{"cited_paper":"/paper/1801.06146","citing_paper":"/paper/1908.06121"},"observation_digest":"sha256:9bf44875849a4c2b4490db4330925426fee9ee88049fe006454ff7f9cb505b19","observation_id":"2c7964fe-64b8-478e-9be1-2f7d2d9b615c","resolution":{"observed_at":"2026-08-14T12:58:19.048540Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1801.06146","last_updated":"2018-05-23T09:23:47Z","snapshot_observed_at":"2026-08-14T19:54:00.470999Z","submitted_at":"2018-01-18T17:54:52Z","title":"Universal Language Model Fine-tuning for Text Classification","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1801.06146","snapshot_observed_at":"2026-08-14T13:09:55.309272Z","title":"Universal language model fine-tuning for text classification","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"1908.06760","last_updated":"2019-08-15T21:39:15Z","snapshot_observed_at":"2026-08-15T08:57:57.025907Z","submitted_at":"2019-08-15T21:39:15Z","title":"Self-Attention Based Molecule Representation for Predicting Drug-Target Interaction","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-14T13:09:55.309272Z"},"links":{"cited_paper":"/paper/1801.06146","citing_paper":"/paper/1908.06760"},"observation_digest":"sha256:9b5d7ba2cec1fafeb5741dfa9acd070068d98e7bccbce51bcccc712a784ddca6","observation_id":"555ff75a-17c9-41a8-9d14-7c611bc68bf4","resolution":{"observed_at":"2026-08-14T13:09:55.309272Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1801.06146","last_updated":"2018-05-23T09:23:47Z","snapshot_observed_at":"2026-08-14T19:54:00.470999Z","submitted_at":"2018-01-18T17:54:52Z","title":"Universal Language Model Fine-tuning for Text Classification","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1801.06146","snapshot_observed_at":"2026-08-14T12:34:41.260914Z","title":"Universal Language Model Fine-tuning for Text Classification","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"1908.06938","last_updated":"2019-09-11T02:45:34Z","snapshot_observed_at":"2026-08-21T08:05:07.531156Z","submitted_at":"2019-08-19T17:22:58Z","title":"Encoder-Agnostic Adaptation for Conditional Language Generation","version":2},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-14T12:34:41.260914Z"},"links":{"cited_paper":"/paper/1801.06146","citing_paper":"/paper/1908.06938"},"observation_digest":"sha256:d1adbcf038087b7527a920f35df979939d2a8a35e882bde65d4647cf3de3ad14","observation_id":"54c7fda0-1576-426e-8bad-23c575e21dc6","resolution":{"observed_at":"2026-08-14T12:34:41.260914Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1801.06146","last_updated":"2018-05-23T09:23:47Z","snapshot_observed_at":"2026-08-14T19:54:00.470999Z","submitted_at":"2018-01-18T17:54:52Z","title":"Universal Language Model Fine-tuning for Text Classification","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1801.06146","snapshot_observed_at":"2026-08-14T12:45:14.301936Z","title":"Universal lan- guage model ﬁne-tuning for text classiﬁcation","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"1908.06972","last_updated":"2019-11-18T10:12:16Z","snapshot_observed_at":"2026-08-19T19:17:34.794342Z","submitted_at":"2019-08-19T03:44:57Z","title":"PrivFT: Private and Fast Text Classification with Homomorphic Encryption","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-14T12:45:14.301936Z"},"links":{"cited_paper":"/paper/1801.06146","citing_paper":"/paper/1908.06972"},"observation_digest":"sha256:56f2b2c33716a12cdcd51f7ad721c397af3d061eba3cc10e1af54076cd1e01bd","observation_id":"ca92e7af-3dd6-424e-8e90-bd4122f95a74","resolution":{"observed_at":"2026-08-14T12:45:14.301936Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1801.06146","last_updated":"2018-05-23T09:23:47Z","snapshot_observed_at":"2026-08-14T19:54:00.470999Z","submitted_at":"2018-01-18T17:54:52Z","title":"Universal Language Model Fine-tuning for Text Classification","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1801.06146","snapshot_observed_at":"2026-08-14T11:21:52.841529Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"1908.09156","last_updated":"2019-08-24T15:52:57Z","snapshot_observed_at":"2026-08-16T07:06:22.124263Z","submitted_at":"2019-08-24T15:52:57Z","title":"A framework for anomaly detection using language modeling, and its applications to finance","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-14T11:21:52.841529Z"},"links":{"cited_paper":"/paper/1801.06146","citing_paper":"/paper/1908.09156"},"observation_digest":"sha256:44b96241f9ee9cd391301b49bfd7d65b9c0c6bfea9fc80d7c50de56e72429e56","observation_id":"edb0ce85-86a0-4424-8951-bb92d1df743d","resolution":{"observed_at":"2026-08-14T11:21:52.841529Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1801.06146","last_updated":"2018-05-23T09:23:47Z","snapshot_observed_at":"2026-08-14T19:54:00.470999Z","submitted_at":"2018-01-18T17:54:52Z","title":"Universal Language Model Fine-tuning for Text Classification","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1801.06146","snapshot_observed_at":"2026-08-14T11:18:22.614880Z","title":"Fine-tuned language models for text classification","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"1908.09451","last_updated":"2020-02-28T04:55:09Z","snapshot_observed_at":"2026-08-19T08:44:44.159475Z","submitted_at":"2019-08-26T03:29:21Z","title":"Improving Neural Story Generation by Targeted Common Sense Grounding","version":2},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-14T11:18:22.614880Z"},"links":{"cited_paper":"/paper/1801.06146","citing_paper":"/paper/1908.09451"},"observation_digest":"sha256:1bfba91c578d2dd2dcb3c416d9efe1016566fb6266c1c517dc1a4b7562d53e4b","observation_id":"8f12b057-7a0a-483b-8578-b2a56cf7122f","resolution":{"observed_at":"2026-08-14T11:18:22.614880Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1801.06146","last_updated":"2018-05-23T09:23:47Z","snapshot_observed_at":"2026-08-14T19:54:00.470999Z","submitted_at":"2018-01-18T17:54:52Z","title":"Universal Language Model Fine-tuning for Text Classification","version":5},"cited_work":{"arxiv_id":"1801.06146","doi":null,"metadata_source":"pith","pith_arxiv_id":"1801.06146","snapshot_observed_at":"2026-07-04T07:39:38.353471Z","title":"Universal Language Model Fine-tuning for Text Classification","venue":"cs.CL","work_id":"9990d84d-84b4-4fd4-acb5-da451524d2f4","year":2018},"citing_paper":{"arxiv_id":"1908.10063","last_updated":"2019-08-27T07:40:48Z","snapshot_observed_at":"2026-07-30T05:49:50.660286Z","submitted_at":"2019-08-27T07:40:48Z","title":"FinBERT: Financial Sentiment Analysis with Pre-trained Language Models","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-15T20:26:04.766701Z"},"links":{"cited_paper":"/paper/1801.06146","citing_paper":"/paper/1908.10063"},"observation_digest":"sha256:4982ba619d01d46177fde1f2cb26ee20ed0b3ed85d80f2866d5168b2beb16c40","observation_id":"5087c704-575e-4a77-9bb9-94b896834e33","resolution":{"observed_at":"2026-05-15T20:26:05.097813Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1801.06146","last_updated":"2018-05-23T09:23:47Z","snapshot_observed_at":"2026-08-14T19:54:00.470999Z","submitted_at":"2018-01-18T17:54:52Z","title":"Universal Language Model Fine-tuning for Text Classification","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1801.06146","snapshot_observed_at":"2026-08-14T10:50:44.460705Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"1908.10322","last_updated":"2019-08-27T16:53:59Z","snapshot_observed_at":"2026-08-18T17:24:52.266922Z","submitted_at":"2019-08-27T16:53:59Z","title":"Bridging the Gap for Tokenizer-Free Language Models","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-14T10:50:44.460705Z"},"links":{"cited_paper":"/paper/1801.06146","citing_paper":"/paper/1908.10322"},"observation_digest":"sha256:24eb241892ca625e3763ebb882c670ef41d22121f8d97f0a8fc67846376289e4","observation_id":"4068cf61-4dc4-43cd-b534-f00c63eaf062","resolution":{"observed_at":"2026-08-14T10:50:44.460705Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1801.06146","last_updated":"2018-05-23T09:23:47Z","snapshot_observed_at":"2026-08-14T19:54:00.470999Z","submitted_at":"2018-01-18T17:54:52Z","title":"Universal Language Model Fine-tuning for Text Classification","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1801.06146","snapshot_observed_at":"2026-08-14T10:20:15.468292Z","title":"Universal language model ﬁne-tuning for text classiﬁcation","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"1908.11399","last_updated":"2019-08-29T18:03:07Z","snapshot_observed_at":"2026-08-15T07:07:34.109826Z","submitted_at":"2019-08-29T18:03:07Z","title":"Deep Learning for Estimating Synaptic Health of Primary Neuronal Cell Culture","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-14T10:20:15.468292Z"},"links":{"cited_paper":"/paper/1801.06146","citing_paper":"/paper/1908.11399"},"observation_digest":"sha256:0c9730c6325679d5ae40a9a0e1cf62db739956b4af3d4ddbdddd68c23e1e6505","observation_id":"95d2d4f1-cef2-44f8-a0af-12068a609d5f","resolution":{"observed_at":"2026-08-14T10:20:15.468292Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1801.06146","last_updated":"2018-05-23T09:23:47Z","snapshot_observed_at":"2026-08-14T19:54:00.470999Z","submitted_at":"2018-01-18T17:54:52Z","title":"Universal Language Model Fine-tuning for Text Classification","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1801.06146","snapshot_observed_at":"2026-08-14T06:05:51.360704Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"1909.00102","last_updated":"2019-08-31T01:04:58Z","snapshot_observed_at":"2026-08-17T01:52:10.298293Z","submitted_at":"2019-08-31T01:04:58Z","title":"Knowledge Enhanced Attention for Robust Natural Language Inference","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-14T06:05:51.360704Z"},"links":{"cited_paper":"/paper/1801.06146","citing_paper":"/paper/1909.00102"},"observation_digest":"sha256:9e7e389d7348c47ec374bf6aff8c1fa58c56b9fb7a19ac82c1994890afa01cb2","observation_id":"12239127-fb77-43d4-a4af-9cb3863078c6","resolution":{"observed_at":"2026-08-14T06:05:51.360704Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1801.06146","last_updated":"2018-05-23T09:23:47Z","snapshot_observed_at":"2026-08-14T19:54:00.470999Z","submitted_at":"2018-01-18T17:54:52Z","title":"Universal Language Model Fine-tuning for Text Classification","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1801.06146","snapshot_observed_at":"2026-08-14T05:12:57.418570Z","title":"Universal language model fine-tuning for text classification","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"1909.01792","last_updated":"2020-01-29T14:12:52Z","snapshot_observed_at":"2026-08-17T17:22:34.216523Z","submitted_at":"2019-09-04T13:32:23Z","title":"Mogrifier LSTM","version":2},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-14T05:12:57.418570Z"},"links":{"cited_paper":"/paper/1801.06146","citing_paper":"/paper/1909.01792"},"observation_digest":"sha256:51939a0686eafbe4423de231a5ed37f41cfc07416fb9977c07bae3807c4af2a0","observation_id":"1e4bf159-684a-4dd5-966d-172ba0f837e7","resolution":{"observed_at":"2026-08-14T05:12:57.418570Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1801.06146","last_updated":"2018-05-23T09:23:47Z","snapshot_observed_at":"2026-08-14T19:54:00.470999Z","submitted_at":"2018-01-18T17:54:52Z","title":"Universal Language Model Fine-tuning for Text Classification","version":5},"cited_work":{"arxiv_id":"1801.06146","doi":null,"metadata_source":"pith","pith_arxiv_id":"1801.06146","snapshot_observed_at":"2026-07-04T07:39:38.353471Z","title":"Universal Language Model Fine-tuning for Text Classification","venue":"cs.CL","work_id":"9990d84d-84b4-4fd4-acb5-da451524d2f4","year":2018},"citing_paper":{"arxiv_id":"1909.05858","last_updated":"2019-09-20T20:08:56Z","snapshot_observed_at":"2026-08-19T21:50:02.108697Z","submitted_at":"2019-09-11T17:57:18Z","title":"CTRL: A Conditional Transformer Language Model for Controllable Generation","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-17T06:14:02.423030Z"},"links":{"cited_paper":"/paper/1801.06146","citing_paper":"/paper/1909.05858"},"observation_digest":"sha256:9bd3956d4243125b897f262e4f4817ce062034c362b6d646637f11a1929cd907","observation_id":"61e67028-7204-430c-b3bb-e760c11b9775","resolution":{"observed_at":"2026-05-17T06:14:02.539975Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1801.06146","last_updated":"2018-05-23T09:23:47Z","snapshot_observed_at":"2026-08-14T19:54:00.470999Z","submitted_at":"2018-01-18T17:54:52Z","title":"Universal Language Model Fine-tuning for Text Classification","version":5},"cited_work":{"arxiv_id":"1801.06146","doi":null,"metadata_source":"pith","pith_arxiv_id":"1801.06146","snapshot_observed_at":"2026-07-04T07:39:38.353471Z","title":"Universal Language Model Fine-tuning for Text Classification","venue":"cs.CL","work_id":"9990d84d-84b4-4fd4-acb5-da451524d2f4","year":2018},"citing_paper":{"arxiv_id":"1909.08593","last_updated":"2020-01-08T23:02:36Z","snapshot_observed_at":"2026-08-21T16:54:14.450108Z","submitted_at":"2019-09-18T17:33:39Z","title":"Fine-Tuning Language Models from Human Preferences","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-10T20:59:58.294355Z"},"links":{"cited_paper":"/paper/1801.06146","citing_paper":"/paper/1909.08593"},"observation_digest":"sha256:98e0b52fbf61397bdc613477b62f069eeb0e972752662504b09e286d8b71bd71","observation_id":"7eb1a648-4f00-4af5-8f0c-7879010e01a5","resolution":{"observed_at":"2026-05-10T20:59:58.612671Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1801.06146","last_updated":"2018-05-23T09:23:47Z","snapshot_observed_at":"2026-08-14T19:54:00.470999Z","submitted_at":"2018-01-18T17:54:52Z","title":"Universal Language Model Fine-tuning for Text Classification","version":5},"cited_work":{"arxiv_id":"1801.06146","doi":null,"metadata_source":"pith","pith_arxiv_id":"1801.06146","snapshot_observed_at":"2026-07-04T07:39:38.353471Z","title":"Universal Language Model Fine-tuning for Text Classification","venue":"cs.CL","work_id":"9990d84d-84b4-4fd4-acb5-da451524d2f4","year":2018},"citing_paper":{"arxiv_id":"1909.11942","last_updated":"2020-02-09T03:00:18Z","snapshot_observed_at":"2026-08-18T01:27:11.590348Z","submitted_at":"2019-09-26T07:06:13Z","title":"ALBERT: A Lite BERT for Self-supervised Learning of Language Representations","version":6},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-13T12:26:58.015594Z"},"links":{"cited_paper":"/paper/1801.06146","citing_paper":"/paper/1909.11942"},"observation_digest":"sha256:75b5c6efc77093e51f237ea9c326b929637c6c70f22d081e166399d7ab914cb4","observation_id":"d25bf620-c39b-4c59-a704-e0ddf37ed746","resolution":{"observed_at":"2026-05-13T12:26:58.100035Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1801.06146","last_updated":"2018-05-23T09:23:47Z","snapshot_observed_at":"2026-08-14T19:54:00.470999Z","submitted_at":"2018-01-18T17:54:52Z","title":"Universal Language Model Fine-tuning for Text Classification","version":5},"cited_work":{"arxiv_id":"1801.06146","doi":null,"metadata_source":"pith","pith_arxiv_id":"1801.06146","snapshot_observed_at":"2026-07-04T07:39:38.353471Z","title":"Universal Language Model Fine-tuning for Text Classification","venue":"cs.CL","work_id":"9990d84d-84b4-4fd4-acb5-da451524d2f4","year":2018},"citing_paper":{"arxiv_id":"1910.09700","last_updated":"2019-11-04T20:37:33Z","snapshot_observed_at":"2026-08-21T21:33:36.848946Z","submitted_at":"2019-10-21T23:57:32Z","title":"Quantifying the Carbon Emissions of Machine Learning","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-15T05:52:44.416475Z"},"links":{"cited_paper":"/paper/1801.06146","citing_paper":"/paper/1910.09700"},"observation_digest":"sha256:69c6ae81dfb75348b224cf6d352393a75fb8a1204e27d82a6c1a86e0e2758def","observation_id":"b7ef7297-91d0-423e-bfe9-63af568af6cb","resolution":{"observed_at":"2026-05-15T05:52:44.447223Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1801.06146","last_updated":"2018-05-23T09:23:47Z","snapshot_observed_at":"2026-08-14T19:54:00.470999Z","submitted_at":"2018-01-18T17:54:52Z","title":"Universal Language Model Fine-tuning for Text Classification","version":5},"cited_work":{"arxiv_id":"1801.06146","doi":null,"metadata_source":"pith","pith_arxiv_id":"1801.06146","snapshot_observed_at":"2026-07-04T07:39:38.353471Z","title":"Universal Language Model Fine-tuning for Text Classification","venue":"cs.CL","work_id":"9990d84d-84b4-4fd4-acb5-da451524d2f4","year":2018},"citing_paper":{"arxiv_id":"1910.10683","last_updated":"2023-09-19T15:14:48Z","snapshot_observed_at":"2026-08-14T16:16:21.567225Z","submitted_at":"2019-10-23T17:37:36Z","title":"Exploring the Limits of Transfer Learning with a Unified Text-to-Text Transformer","version":4},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-12T05:37:55.083206Z"},"links":{"cited_paper":"/paper/1801.06146","citing_paper":"/paper/1910.10683"},"observation_digest":"sha256:d0154c612eff1ecca6584cd77bae13a45c718c287e306aa5be9ed0c5306a202e","observation_id":"9fefd8d5-35af-4ecf-a0a6-22c1adb92da3","resolution":{"observed_at":"2026-05-12T05:37:55.634457Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1801.06146","last_updated":"2018-05-23T09:23:47Z","snapshot_observed_at":"2026-08-14T19:54:00.470999Z","submitted_at":"2018-01-18T17:54:52Z","title":"Universal Language Model Fine-tuning for Text Classification","version":5},"cited_work":{"arxiv_id":"1801.06146","doi":null,"metadata_source":"pith","pith_arxiv_id":"1801.06146","snapshot_observed_at":"2026-07-04T07:39:38.353471Z","title":"Universal Language Model Fine-tuning for Text Classification","venue":"cs.CL","work_id":"9990d84d-84b4-4fd4-acb5-da451524d2f4","year":2018},"citing_paper":{"arxiv_id":"2002.08910","last_updated":"2020-10-05T21:26:45Z","snapshot_observed_at":"2026-08-15T17:58:46.639035Z","submitted_at":"2020-02-10T18:55:58Z","title":"How Much Knowledge Can You Pack Into the Parameters of a Language Model?","version":4},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-05-15T02:00:28.055865Z"},"links":{"cited_paper":"/paper/1801.06146","citing_paper":"/paper/2002.08910"},"observation_digest":"sha256:662fcf09a1879e0a6d49d638bedc10cb60aef09ee0c489976b4ce50ec695703c","observation_id":"6510eece-7b83-4234-8e7e-809cd52e2c97","resolution":{"observed_at":"2026-05-15T02:00:28.112776Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1801.06146","last_updated":"2018-05-23T09:23:47Z","snapshot_observed_at":"2026-08-14T19:54:00.470999Z","submitted_at":"2018-01-18T17:54:52Z","title":"Universal Language Model Fine-tuning for Text Classification","version":5},"cited_work":{"arxiv_id":"1801.06146","doi":null,"metadata_source":"pith","pith_arxiv_id":"1801.06146","snapshot_observed_at":"2026-07-04T07:39:38.353471Z","title":"Universal Language Model Fine-tuning for Text Classification","venue":"cs.CL","work_id":"9990d84d-84b4-4fd4-acb5-da451524d2f4","year":2018},"citing_paper":{"arxiv_id":"2005.14165","last_updated":"2020-07-22T19:47:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-05-28T17:29:03Z","title":"Language Models are Few-Shot Learners","version":4},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-10T12:05:38.045330Z"},"links":{"cited_paper":"/paper/1801.06146","citing_paper":"/paper/2005.14165"},"observation_digest":"sha256:8c9b810abb430585965ef48b1ce950bcc4512b943c64a0e1f5a647447a2d211b","observation_id":"226e590f-78d7-4789-824d-571e7e6753e1","resolution":{"observed_at":"2026-05-10T12:05:38.215741Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1801.06146","last_updated":"2018-05-23T09:23:47Z","snapshot_observed_at":"2026-08-14T19:54:00.470999Z","submitted_at":"2018-01-18T17:54:52Z","title":"Universal Language Model Fine-tuning for Text Classification","version":5},"cited_work":{"arxiv_id":"1801.06146","doi":null,"metadata_source":"pith","pith_arxiv_id":"1801.06146","snapshot_observed_at":"2026-07-04T07:39:38.353471Z","title":"Universal Language Model Fine-tuning for Text Classification","venue":"cs.CL","work_id":"9990d84d-84b4-4fd4-acb5-da451524d2f4","year":2018},"citing_paper":{"arxiv_id":"2012.06678","last_updated":"2020-12-11T23:31:23Z","snapshot_observed_at":"2026-08-14T12:45:55.154777Z","submitted_at":"2020-12-11T23:31:23Z","title":"TabTransformer: Tabular Data Modeling Using Contextual Embeddings","version":1},"reference_index":79,"source":"arxiv_source","source_observed_at":"2026-05-16T21:32:31.241434Z"},"links":{"cited_paper":"/paper/1801.06146","citing_paper":"/paper/2012.06678"},"observation_digest":"sha256:8c78e9d413855f159f114459b540aa0c044c76b230c3b03907d30b2fd5211bda","observation_id":"22263a2a-aa3e-4109-9b83-41d93bcee71c","resolution":{"observed_at":"2026-05-16T21:32:31.289493Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1801.06146","last_updated":"2018-05-23T09:23:47Z","snapshot_observed_at":"2026-08-14T19:54:00.470999Z","submitted_at":"2018-01-18T17:54:52Z","title":"Universal Language Model Fine-tuning for Text Classification","version":5},"cited_work":{"arxiv_id":"1801.06146","doi":null,"metadata_source":"pith","pith_arxiv_id":"1801.06146","snapshot_observed_at":"2026-07-04T07:39:38.353471Z","title":"Universal Language Model Fine-tuning for Text Classification","venue":"cs.CL","work_id":"9990d84d-84b4-4fd4-acb5-da451524d2f4","year":2018},"citing_paper":{"arxiv_id":"2102.01293","last_updated":"2021-02-02T04:07:38Z","snapshot_observed_at":"2026-08-01T22:46:19.170916Z","submitted_at":"2021-02-02T04:07:38Z","title":"Scaling Laws for Transfer","version":1},"reference_index":176,"source":"arxiv_source","source_observed_at":"2026-05-18T00:58:13.116663Z"},"links":{"cited_paper":"/paper/1801.06146","citing_paper":"/paper/2102.01293"},"observation_digest":"sha256:32f5b8401dc27fecc46db6d54e3a554d5456654338078061bb783022f2f99515","observation_id":"2480d519-d65c-4d9a-8442-2fb6c8b5b70a","resolution":{"observed_at":"2026-05-18T00:58:13.570038Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1801.06146","last_updated":"2018-05-23T09:23:47Z","snapshot_observed_at":"2026-08-14T19:54:00.470999Z","submitted_at":"2018-01-18T17:54:52Z","title":"Universal Language Model Fine-tuning for Text Classification","version":5},"cited_work":{"arxiv_id":"1801.06146","doi":null,"metadata_source":"pith","pith_arxiv_id":"1801.06146","snapshot_observed_at":"2026-07-04T07:39:38.353471Z","title":"Universal Language Model Fine-tuning for Text Classification","venue":"cs.CL","work_id":"9990d84d-84b4-4fd4-acb5-da451524d2f4","year":2018},"citing_paper":{"arxiv_id":"2112.00861","last_updated":"2021-12-09T21:40:22Z","snapshot_observed_at":"2026-08-10T12:03:10.373653Z","submitted_at":"2021-12-01T22:24:34Z","title":"A General Language Assistant as a Laboratory for Alignment","version":3},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-05-11T14:22:57.925354Z"},"links":{"cited_paper":"/paper/1801.06146","citing_paper":"/paper/2112.00861"},"observation_digest":"sha256:50e6162b72d33c4dba1841c171e051fce812547952b68f59ab871738c5c1d6f1","observation_id":"bef46da0-1328-4a80-89fb-5768b5dfd190","resolution":{"observed_at":"2026-05-11T14:22:59.568722Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1801.06146","last_updated":"2018-05-23T09:23:47Z","snapshot_observed_at":"2026-08-14T19:54:00.470999Z","submitted_at":"2018-01-18T17:54:52Z","title":"Universal Language Model Fine-tuning for Text Classification","version":5},"cited_work":{"arxiv_id":"1801.06146","doi":null,"metadata_source":"pith","pith_arxiv_id":"1801.06146","snapshot_observed_at":"2026-07-04T07:39:38.353471Z","title":"Universal Language Model Fine-tuning for Text Classification","venue":"cs.CL","work_id":"9990d84d-84b4-4fd4-acb5-da451524d2f4","year":2018},"citing_paper":{"arxiv_id":"2112.04359","last_updated":"2021-12-08T16:09:48Z","snapshot_observed_at":"2026-08-09T15:17:43.394064Z","submitted_at":"2021-12-08T16:09:48Z","title":"Ethical and social risks of harm from Language Models","version":1},"reference_index":118,"source":"arxiv_source","source_observed_at":"2026-05-11T18:24:28.835688Z"},"links":{"cited_paper":"/paper/1801.06146","citing_paper":"/paper/2112.04359"},"observation_digest":"sha256:78a916fb19945b89a2b6fa094f91dd254191197cd51e4ee33146172fc5acd7d6","observation_id":"f58752fa-a8f9-472a-9382-4ad2c29955fe","resolution":{"observed_at":"2026-05-11T18:24:29.882994Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1801.06146","last_updated":"2018-05-23T09:23:47Z","snapshot_observed_at":"2026-08-14T19:54:00.470999Z","submitted_at":"2018-01-18T17:54:52Z","title":"Universal Language Model Fine-tuning for Text Classification","version":5},"cited_work":{"arxiv_id":"1801.06146","doi":null,"metadata_source":"pith","pith_arxiv_id":"1801.06146","snapshot_observed_at":"2026-07-04T07:39:38.353471Z","title":"Universal Language Model Fine-tuning for Text Classification","venue":"cs.CL","work_id":"9990d84d-84b4-4fd4-acb5-da451524d2f4","year":2018},"citing_paper":{"arxiv_id":"2204.14198","last_updated":"2022-11-15T23:07:37Z","snapshot_observed_at":"2026-08-17T03:00:38.806206Z","submitted_at":"2022-04-29T16:29:01Z","title":"Flamingo: a Visual Language Model for Few-Shot Learning","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-05-12T04:22:30.008355Z"},"links":{"cited_paper":"/paper/1801.06146","citing_paper":"/paper/2204.14198"},"observation_digest":"sha256:9b9e616b74d5d85ba65c25d1e72ab98b52b445d11b0389d746096babc47523eb","observation_id":"10cc3d1a-9ec3-4ba2-a696-5f5925b2e09d","resolution":{"observed_at":"2026-05-12T04:22:30.420070Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1801.06146","last_updated":"2018-05-23T09:23:47Z","snapshot_observed_at":"2026-08-14T19:54:00.470999Z","submitted_at":"2018-01-18T17:54:52Z","title":"Universal Language Model Fine-tuning for Text Classification","version":5},"cited_work":{"arxiv_id":"1801.06146","doi":null,"metadata_source":"pith","pith_arxiv_id":"1801.06146","snapshot_observed_at":"2026-07-04T07:39:38.353471Z","title":"Universal Language Model Fine-tuning for Text Classification","venue":"cs.CL","work_id":"9990d84d-84b4-4fd4-acb5-da451524d2f4","year":2018},"citing_paper":{"arxiv_id":"2205.01068","last_updated":"2022-06-21T17:04:40Z","snapshot_observed_at":"2026-08-06T03:13:37.403059Z","submitted_at":"2022-05-02T17:49:50Z","title":"OPT: Open Pre-trained Transformer Language Models","version":4},"reference_index":124,"source":"arxiv_source","source_observed_at":"2026-05-10T20:53:16.720145Z"},"links":{"cited_paper":"/paper/1801.06146","citing_paper":"/paper/2205.01068"},"observation_digest":"sha256:0b501cb0c4aed88d605a4a665c0e3924889b8e80a2c26b290e89d2896fdf3bd3","observation_id":"07078dd1-932a-483d-8b1f-b825e1eb7c24","resolution":{"observed_at":"2026-05-10T20:53:17.485146Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1801.06146","last_updated":"2018-05-23T09:23:47Z","snapshot_observed_at":"2026-08-14T19:54:00.470999Z","submitted_at":"2018-01-18T17:54:52Z","title":"Universal Language Model Fine-tuning for Text Classification","version":5},"cited_work":{"arxiv_id":"1801.06146","doi":null,"metadata_source":"pith","pith_arxiv_id":"1801.06146","snapshot_observed_at":"2026-07-04T07:39:38.353471Z","title":"Universal Language Model Fine-tuning for Text Classification","venue":"cs.CL","work_id":"9990d84d-84b4-4fd4-acb5-da451524d2f4","year":2018},"citing_paper":{"arxiv_id":"2207.05221","last_updated":"2022-11-21T16:38:35Z","snapshot_observed_at":"2026-08-14T05:42:29.067319Z","submitted_at":"2022-07-11T22:59:39Z","title":"Language Models (Mostly) Know What They Know","version":4},"reference_index":98,"source":"arxiv_source","source_observed_at":"2026-05-10T15:42:47.274448Z"},"links":{"cited_paper":"/paper/1801.06146","citing_paper":"/paper/2207.05221"},"observation_digest":"sha256:1ea543596cc7bb351786439d0d33d3ad8c841319ea85e48b6fdc8848bd436c8a","observation_id":"c8938beb-d915-4b5c-a5ce-6aa3b8f7f62a","resolution":{"observed_at":"2026-05-10T15:42:47.670948Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1801.06146","last_updated":"2018-05-23T09:23:47Z","snapshot_observed_at":"2026-08-14T19:54:00.470999Z","submitted_at":"2018-01-18T17:54:52Z","title":"Universal Language Model Fine-tuning for Text Classification","version":5},"cited_work":{"arxiv_id":"1801.06146","doi":null,"metadata_source":"pith","pith_arxiv_id":"1801.06146","snapshot_observed_at":"2026-07-04T07:39:38.353471Z","title":"Universal Language Model Fine-tuning for Text Classification","venue":"cs.CL","work_id":"9990d84d-84b4-4fd4-acb5-da451524d2f4","year":2018},"citing_paper":{"arxiv_id":"2308.05374","last_updated":"2024-03-21T00:21:14Z","snapshot_observed_at":"2026-08-02T17:09:20.540788Z","submitted_at":"2023-08-10T06:43:44Z","title":"Trustworthy LLMs: a Survey and Guideline for Evaluating Large Language Models' Alignment","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-05-17T22:30:44.520703Z"},"links":{"cited_paper":"/paper/1801.06146","citing_paper":"/paper/2308.05374"},"observation_digest":"sha256:9435dd880491b643df566069980bad325b4ac34952cb5544620d4f8dfae48a6e","observation_id":"cb940b30-38b4-4d3e-8b96-95adac8a6bf0","resolution":{"observed_at":"2026-05-17T22:30:44.708508Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1801.06146","last_updated":"2018-05-23T09:23:47Z","snapshot_observed_at":"2026-08-14T19:54:00.470999Z","submitted_at":"2018-01-18T17:54:52Z","title":"Universal Language Model Fine-tuning for Text Classification","version":5},"cited_work":{"arxiv_id":"1801.06146","doi":null,"metadata_source":"pith","pith_arxiv_id":"1801.06146","snapshot_observed_at":"2026-07-04T07:39:38.353471Z","title":"Universal Language Model Fine-tuning for Text Classification","venue":"cs.CL","work_id":"9990d84d-84b4-4fd4-acb5-da451524d2f4","year":2018},"citing_paper":{"arxiv_id":"2402.17762","last_updated":"2024-08-14T16:00:49Z","snapshot_observed_at":"2026-08-16T07:45:21.406264Z","submitted_at":"2024-02-27T18:55:17Z","title":"Massive Activations in Large Language Models","version":2},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-05-16T07:02:53.740597Z"},"links":{"cited_paper":"/paper/1801.06146","citing_paper":"/paper/2402.17762"},"observation_digest":"sha256:c6bb9e2f764e12aa0cb1f05fcd2290f40eae78ac6d5230d4780daa69f31bf151","observation_id":"96fb3a48-c9fa-48c0-8c27-01efe73efd82","resolution":{"observed_at":"2026-05-16T07:02:53.865528Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1801.06146","last_updated":"2018-05-23T09:23:47Z","snapshot_observed_at":"2026-08-14T19:54:00.470999Z","submitted_at":"2018-01-18T17:54:52Z","title":"Universal Language Model Fine-tuning for Text Classification","version":5},"cited_work":{"arxiv_id":"1801.06146","doi":null,"metadata_source":"pith","pith_arxiv_id":"1801.06146","snapshot_observed_at":"2026-07-04T07:39:38.353471Z","title":"Universal Language Model Fine-tuning for Text Classification","venue":"cs.CL","work_id":"9990d84d-84b4-4fd4-acb5-da451524d2f4","year":2018},"citing_paper":{"arxiv_id":"2404.06395","last_updated":"2024-06-03T08:54:38Z","snapshot_observed_at":"2026-08-12T13:10:06.472493Z","submitted_at":"2024-04-09T15:36:50Z","title":"MiniCPM: Unveiling the Potential of Small Language Models with Scalable Training Strategies","version":3},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-13T18:00:53.389420Z"},"links":{"cited_paper":"/paper/1801.06146","citing_paper":"/paper/2404.06395"},"observation_digest":"sha256:b9fcb8a61dff320681556717783db1bb5ca71b0644342e75418dc1653e642a53","observation_id":"ac7bdd4f-e89a-4a83-80b4-35ce61fd665f","resolution":{"observed_at":"2026-05-13T18:00:53.515407Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1801.06146","last_updated":"2018-05-23T09:23:47Z","snapshot_observed_at":"2026-08-14T19:54:00.470999Z","submitted_at":"2018-01-18T17:54:52Z","title":"Universal Language Model Fine-tuning for Text Classification","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1801.06146","snapshot_observed_at":"2026-08-12T21:35:15.520916Z","title":"Brian Lester, Rami Al-Rfou, and Noah Constant","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.08563","last_updated":"2024-11-13T12:21:13Z","snapshot_observed_at":"2026-08-15T18:08:10.460963Z","submitted_at":"2024-11-13T12:21:13Z","title":"Leveraging LLMs for Predictive Insights in Food Policy and Behavioral Interventions","version":1},"reference_index":2018,"source":"pdf_text","source_observed_at":"2026-08-12T21:35:15.520916Z"},"links":{"cited_paper":"/paper/1801.06146","citing_paper":"/paper/2411.08563"},"observation_digest":"sha256:15a97bfa10410a0c9d896d8ad61b72cfa1b0f5b0eadc2719d564572d7776123b","observation_id":"784f929f-030b-4f6a-a6d2-65dee1d4051c","resolution":{"observed_at":"2026-08-12T21:35:15.520916Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1801.06146","last_updated":"2018-05-23T09:23:47Z","snapshot_observed_at":"2026-08-14T19:54:00.470999Z","submitted_at":"2018-01-18T17:54:52Z","title":"Universal Language Model Fine-tuning for Text Classification","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1801.06146","snapshot_observed_at":"2026-08-12T20:27:06.783156Z","title":"Howard and S","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2411.09702","last_updated":"2024-11-14T18:59:40Z","snapshot_observed_at":"2026-08-17T03:23:52.742408Z","submitted_at":"2024-11-14T18:59:40Z","title":"On the Surprising Effectiveness of Attention Transfer for Vision Transformers","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-12T20:27:06.783156Z"},"links":{"cited_paper":"/paper/1801.06146","citing_paper":"/paper/2411.09702"},"observation_digest":"sha256:a65077588efdee184ed931da6975b964e9b4a5c72fb8b5fae5bae2a7aed18610","observation_id":"dc8bdbb1-75ef-442d-9cf1-f1308886daa3","resolution":{"observed_at":"2026-08-12T20:27:06.783156Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1801.06146","last_updated":"2018-05-23T09:23:47Z","snapshot_observed_at":"2026-08-14T19:54:00.470999Z","submitted_at":"2018-01-18T17:54:52Z","title":"Universal Language Model Fine-tuning for Text Classification","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1801.06146","snapshot_observed_at":"2026-08-12T15:02:32.386289Z","title":"Universal language model fine- tuning for text classification,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2411.14718","last_updated":"2024-11-22T04:10:49Z","snapshot_observed_at":"2026-08-15T07:26:20.397925Z","submitted_at":"2024-11-22T04:10:49Z","title":"GraphTheft: Quantifying Privacy Risks in Graph Prompt Learning","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-12T15:02:32.386289Z"},"links":{"cited_paper":"/paper/1801.06146","citing_paper":"/paper/2411.14718"},"observation_digest":"sha256:6d11e61ea26804776517eed89b81afcd90923462c4537344c2519fe2f8b557f8","observation_id":"3e3af275-13d1-451b-9cb3-51230962e1f9","resolution":{"observed_at":"2026-08-12T15:02:32.386289Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1801.06146","last_updated":"2018-05-23T09:23:47Z","snapshot_observed_at":"2026-08-14T19:54:00.470999Z","submitted_at":"2018-01-18T17:54:52Z","title":"Universal Language Model Fine-tuning for Text Classification","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1801.06146","snapshot_observed_at":"2026-08-12T14:15:15.793107Z","title":"Universal languag e model ﬁne- tuning for text classiﬁcation","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2411.15530","last_updated":"2024-11-23T11:47:03Z","snapshot_observed_at":"2026-08-17T01:11:07.000163Z","submitted_at":"2024-11-23T11:47:03Z","title":"QEQR: An Exploration of Query Expansion Methods for Question Retrieval in CQA Services","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-12T14:15:15.793107Z"},"links":{"cited_paper":"/paper/1801.06146","citing_paper":"/paper/2411.15530"},"observation_digest":"sha256:9db91922aacf8b13c2506eda5c88a54101b527e3930905652698b5c44ab4a7c9","observation_id":"2ea621ea-d147-4bbe-9f5d-2cab4fe0df0a","resolution":{"observed_at":"2026-08-12T14:15:15.793107Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1801.06146","last_updated":"2018-05-23T09:23:47Z","snapshot_observed_at":"2026-08-14T19:54:00.470999Z","submitted_at":"2018-01-18T17:54:52Z","title":"Universal Language Model Fine-tuning for Text Classification","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1801.06146","snapshot_observed_at":"2026-08-12T14:11:24.485112Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2411.15592","last_updated":"2024-11-26T04:09:46Z","snapshot_observed_at":"2026-08-18T03:18:23.554941Z","submitted_at":"2024-11-23T15:51:15Z","title":"Classifier Enhanced Deep Learning Model for Erythroblast Differentiation with Limited Data","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-12T14:11:24.485112Z"},"links":{"cited_paper":"/paper/1801.06146","citing_paper":"/paper/2411.15592"},"observation_digest":"sha256:2442758883c4421744db1d9c359304bb810a8972f4b3ac0ebba1ce2768395143","observation_id":"6ed3cde5-3ac7-4e01-8b92-34d684829867","resolution":{"observed_at":"2026-08-12T14:11:24.485112Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1801.06146","last_updated":"2018-05-23T09:23:47Z","snapshot_observed_at":"2026-08-14T19:54:00.470999Z","submitted_at":"2018-01-18T17:54:52Z","title":"Universal Language Model Fine-tuning for Text Classification","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1801.06146","snapshot_observed_at":"2026-08-12T11:54:01.662424Z","title":"Howard and S","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2411.17898","last_updated":"2024-11-26T21:27:14Z","snapshot_observed_at":"2026-08-13T20:46:00.954749Z","submitted_at":"2024-11-26T21:27:14Z","title":"On the ERM Principle in Meta-Learning","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-12T11:54:01.662424Z"},"links":{"cited_paper":"/paper/1801.06146","citing_paper":"/paper/2411.17898"},"observation_digest":"sha256:b1c420ef9abfa01ac41491d0a5be72140d05bf36a3aa3f186fd177d4eb92927c","observation_id":"5dbf1c84-73ed-4d62-bf68-909b4a45a79d","resolution":{"observed_at":"2026-08-12T11:54:01.662424Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1801.06146","last_updated":"2018-05-23T09:23:47Z","snapshot_observed_at":"2026-08-14T19:54:00.470999Z","submitted_at":"2018-01-18T17:54:52Z","title":"Universal Language Model Fine-tuning for Text Classification","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1801.06146","snapshot_observed_at":"2026-08-12T11:07:17.152917Z","title":"Universal language model fine-tuning for text classification,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2411.18700","last_updated":"2024-11-27T19:11:49Z","snapshot_observed_at":"2026-08-21T23:55:54.822480Z","submitted_at":"2024-11-27T19:11:49Z","title":"On the Effectiveness of Incremental Training of Large Language Models","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-12T11:07:17.152917Z"},"links":{"cited_paper":"/paper/1801.06146","citing_paper":"/paper/2411.18700"},"observation_digest":"sha256:96c2f3740d7565c9cd58f6b6afbdb37cb8363b863ca1c3e24dba1bdc79a32b59","observation_id":"04acfd1d-844b-4814-b545-67c71f54d203","resolution":{"observed_at":"2026-08-12T11:07:17.152917Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1801.06146","last_updated":"2018-05-23T09:23:47Z","snapshot_observed_at":"2026-08-14T19:54:00.470999Z","submitted_at":"2018-01-18T17:54:52Z","title":"Universal Language Model Fine-tuning for Text Classification","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1801.06146","snapshot_observed_at":"2026-08-12T10:08:55.742185Z","title":"Universal lan- guage model fine-tuning for text classification","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2411.19530","last_updated":"2024-11-29T08:05:50Z","snapshot_observed_at":"2026-08-12T22:44:05.464138Z","submitted_at":"2024-11-29T08:05:50Z","title":"Quantized Delta Weight Is Safety Keeper","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-12T10:08:55.742185Z"},"links":{"cited_paper":"/paper/1801.06146","citing_paper":"/paper/2411.19530"},"observation_digest":"sha256:362e9a7d2a18bfc5f55a19186f96a1894b896d19c48508f41c7a7d26cebff1c2","observation_id":"308eaf96-4165-4034-b7d0-944e85a595cf","resolution":{"observed_at":"2026-08-12T10:08:55.742185Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1801.06146","last_updated":"2018-05-23T09:23:47Z","snapshot_observed_at":"2026-08-14T19:54:00.470999Z","submitted_at":"2018-01-18T17:54:52Z","title":"Universal Language Model Fine-tuning for Text Classification","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1801.06146","snapshot_observed_at":"2026-08-12T04:35:59.483177Z","title":"Fine-tuned language models for text classification","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2412.01233","last_updated":"2024-12-02T07:54:55Z","snapshot_observed_at":"2026-08-15T22:41:09.800294Z","submitted_at":"2024-12-02T07:54:55Z","title":"Best Practices for Large Language Models in Radiology","version":1},"reference_index":68,"source":"arxiv_source","source_observed_at":"2026-08-12T04:35:59.483177Z"},"links":{"cited_paper":"/paper/1801.06146","citing_paper":"/paper/2412.01233"},"observation_digest":"sha256:95589c1b41039a116aacd2362c6398a081f0614708d73e27ca24023c67c1b063","observation_id":"7e2394b2-66cd-402c-8f1c-1911164f4947","resolution":{"observed_at":"2026-08-12T04:35:59.483177Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1801.06146","last_updated":"2018-05-23T09:23:47Z","snapshot_observed_at":"2026-08-14T19:54:00.470999Z","submitted_at":"2018-01-18T17:54:52Z","title":"Universal Language Model Fine-tuning for Text Classification","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1801.06146","snapshot_observed_at":"2026-08-11T17:48:13.439125Z","title":"Universal language model ﬁne-tuning for text classiﬁcation","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2412.08587","last_updated":"2025-05-11T04:59:46Z","snapshot_observed_at":"2026-08-16T05:43:34.833045Z","submitted_at":"2024-12-11T18:06:44Z","title":"Advancing Single and Multi-task Text Classification through Large Language Model Fine-tuning","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-11T17:48:13.439125Z"},"links":{"cited_paper":"/paper/1801.06146","citing_paper":"/paper/2412.08587"},"observation_digest":"sha256:8e2e551d6d09b8b5ea58fd4b1363c2f70b0d3a98146d2758f5077fee953ed809","observation_id":"44500de3-2abb-4f18-ac0b-84f0f2438417","resolution":{"observed_at":"2026-08-11T17:48:13.439125Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1801.06146","last_updated":"2018-05-23T09:23:47Z","snapshot_observed_at":"2026-08-14T19:54:00.470999Z","submitted_at":"2018-01-18T17:54:52Z","title":"Universal Language Model Fine-tuning for Text Classification","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1801.06146","snapshot_observed_at":"2026-08-11T13:08:39.920641Z","title":"Fine-tuned language models for text classification","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2412.13478","last_updated":"2025-04-10T19:25:36Z","snapshot_observed_at":"2026-08-14T05:14:27.517735Z","submitted_at":"2024-12-18T03:42:20Z","title":"Efficient Fine-Tuning of Single-Cell Foundation Models Enables Zero-Shot Molecular Perturbation Prediction","version":2},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-11T13:08:39.920641Z"},"links":{"cited_paper":"/paper/1801.06146","citing_paper":"/paper/2412.13478"},"observation_digest":"sha256:44067873346cfe831f063366c23a9172991f056f3d6747b1ef85ed261ac09902","observation_id":"64139fd3-9ac1-40d3-9288-22124bc0939a","resolution":{"observed_at":"2026-08-11T13:08:39.920641Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1801.06146","last_updated":"2018-05-23T09:23:47Z","snapshot_observed_at":"2026-08-14T19:54:00.470999Z","submitted_at":"2018-01-18T17:54:52Z","title":"Universal Language Model Fine-tuning for Text Classification","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1801.06146","snapshot_observed_at":"2026-08-11T11:24:12.193937Z","title":"Universal language model fine-tuning for text classification,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2412.15553","last_updated":"2024-12-20T04:27:45Z","snapshot_observed_at":"2026-08-16T20:19:56.535504Z","submitted_at":"2024-12-20T04:27:45Z","title":"AutoRank: MCDA Based Rank Personalization for LoRA-Enabled Distributed Learning","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-11T11:24:12.193937Z"},"links":{"cited_paper":"/paper/1801.06146","citing_paper":"/paper/2412.15553"},"observation_digest":"sha256:09ea1d9fc767be1a406f2d5ab097dc1b8ee6fd5dcc640dafb525662b27f4c61e","observation_id":"8597819f-a0a8-423c-9e9b-811531b8789c","resolution":{"observed_at":"2026-08-11T11:24:12.193937Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1801.06146","last_updated":"2018-05-23T09:23:47Z","snapshot_observed_at":"2026-08-14T19:54:00.470999Z","submitted_at":"2018-01-18T17:54:52Z","title":"Universal Language Model Fine-tuning for Text Classification","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1801.06146","snapshot_observed_at":"2026-08-11T11:17:27.364964Z","title":"Universal language model fine-tuning for text classifi- cation","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2412.15660","last_updated":"2024-12-20T08:20:21Z","snapshot_observed_at":"2026-08-18T22:44:38.318504Z","submitted_at":"2024-12-20T08:20:21Z","title":"Adaptable and Precise: Enterprise-Scenario LLM Function-Calling Capability Training Pipeline","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-11T11:17:27.364964Z"},"links":{"cited_paper":"/paper/1801.06146","citing_paper":"/paper/2412.15660"},"observation_digest":"sha256:4d42fe1720bab6df7f1b236fe1b68e88e21ea051bae8d80c7dedc2dd65a18793","observation_id":"104d8fb5-d5c6-4d14-a6f9-5f1d10d0e9c6","resolution":{"observed_at":"2026-08-11T11:17:27.364964Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1801.06146","last_updated":"2018-05-23T09:23:47Z","snapshot_observed_at":"2026-08-14T19:54:00.470999Z","submitted_at":"2018-01-18T17:54:52Z","title":"Universal Language Model Fine-tuning for Text Classification","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1801.06146","snapshot_observed_at":"2026-08-11T19:45:23.658850Z","title":"Universal Language Model Fine-Tuning for Text Classification","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2412.17821","last_updated":"2024-12-09T11:59:32Z","snapshot_observed_at":"2026-08-21T15:07:34.816458Z","submitted_at":"2024-12-09T11:59:32Z","title":"The Rosetta Paradox: Domain-Specific Performance Inversions in Large Language Models","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-11T19:45:23.658850Z"},"links":{"cited_paper":"/paper/1801.06146","citing_paper":"/paper/2412.17821"},"observation_digest":"sha256:b13372a404c5ace12d4ad1c67c68ec07f14d955572ca8b018d1f1165b628e8c9","observation_id":"38515bf1-749a-4f50-ac3e-67267e89a5e7","resolution":{"observed_at":"2026-08-11T19:45:23.658850Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1801.06146","last_updated":"2018-05-23T09:23:47Z","snapshot_observed_at":"2026-08-14T19:54:00.470999Z","submitted_at":"2018-01-18T17:54:52Z","title":"Universal Language Model Fine-tuning for Text Classification","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1801.06146","snapshot_observed_at":"2026-08-11T01:02:47.433233Z","title":"Universal Language Model Fine- tuning for Text Classification,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2412.19070","last_updated":"2024-12-26T05:54:24Z","snapshot_observed_at":"2026-08-13T12:16:47.344039Z","submitted_at":"2024-12-26T05:54:24Z","title":"Cross-Demographic Portability of Deep NLP-Based Depression Models","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-11T01:02:47.433233Z"},"links":{"cited_paper":"/paper/1801.06146","citing_paper":"/paper/2412.19070"},"observation_digest":"sha256:a4f45472f48c0435aad9f8d6bdb6a4dfdfd5867efe6dc5a6b23d6b0a67a6f250","observation_id":"b29d6aca-7c56-4b08-9897-bacc401d5dcf","resolution":{"observed_at":"2026-08-11T01:02:47.433233Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1801.06146","last_updated":"2018-05-23T09:23:47Z","snapshot_observed_at":"2026-08-14T19:54:00.470999Z","submitted_at":"2018-01-18T17:54:52Z","title":"Universal Language Model Fine-tuning for Text Classification","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1801.06146","snapshot_observed_at":"2026-08-11T01:02:52.609687Z","title":"Universal Language Model Fine-tuning for Text Classification,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2412.19072","last_updated":"2024-12-26T06:05:52Z","snapshot_observed_at":"2026-08-17T09:23:26.710262Z","submitted_at":"2024-12-26T06:05:52Z","title":"Robust Speech and Natural Language Processing Models for Depression Screening","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-11T01:02:52.609687Z"},"links":{"cited_paper":"/paper/1801.06146","citing_paper":"/paper/2412.19072"},"observation_digest":"sha256:dede1a3d22adc460c2e8f5b0fcc83bab919d0e231ac40fea61291a32015cce80","observation_id":"20e3698d-b26a-4349-b132-ebb913df0802","resolution":{"observed_at":"2026-08-11T01:02:52.609687Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1801.06146","last_updated":"2018-05-23T09:23:47Z","snapshot_observed_at":"2026-08-14T19:54:00.470999Z","submitted_at":"2018-01-18T17:54:52Z","title":"Universal Language Model Fine-tuning for Text Classification","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1801.06146","snapshot_observed_at":"2026-08-10T22:54:52.035696Z","title":"Universal language model fine-tuning for text clas- sification","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2501.00457","last_updated":"2024-12-31T14:13:28Z","snapshot_observed_at":"2026-08-15T18:22:17.984449Z","submitted_at":"2024-12-31T14:13:28Z","title":"Differentiable Prompt Learning for Vision Language Models","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-10T22:54:52.035696Z"},"links":{"cited_paper":"/paper/1801.06146","citing_paper":"/paper/2501.00457"},"observation_digest":"sha256:fe0143fb6606dc1db7da03eab227b341eb9a2633c50373b4261f52e7be4656be","observation_id":"1288ee13-8f56-49e1-8446-b072a0d6ace2","resolution":{"observed_at":"2026-08-10T22:54:52.035696Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1801.06146","last_updated":"2018-05-23T09:23:47Z","snapshot_observed_at":"2026-08-14T19:54:00.470999Z","submitted_at":"2018-01-18T17:54:52Z","title":"Universal Language Model Fine-tuning for Text Classification","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1801.06146","snapshot_observed_at":"2026-08-10T22:50:56.113370Z","title":"Howard and S","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2501.00608","last_updated":"2024-12-31T19:12:15Z","snapshot_observed_at":"2026-08-18T04:13:15.265759Z","submitted_at":"2024-12-31T19:12:15Z","title":"Optimizing Speech-Input Length for Speaker-Independent Depression Classification","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-10T22:50:56.113370Z"},"links":{"cited_paper":"/paper/1801.06146","citing_paper":"/paper/2501.00608"},"observation_digest":"sha256:018116d8952a4dc4d62def1f34f038e758ac12011d25b2f977e48a3e9e3e4288","observation_id":"b164673e-a7c4-45b5-b76f-7f6b33ec0bc2","resolution":{"observed_at":"2026-08-10T22:50:56.113370Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1801.06146","last_updated":"2018-05-23T09:23:47Z","snapshot_observed_at":"2026-08-14T19:54:00.470999Z","submitted_at":"2018-01-18T17:54:52Z","title":"Universal Language Model Fine-tuning for Text Classification","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1801.06146","snapshot_observed_at":"2026-08-10T22:48:10.806872Z","title":"Improving language understanding by generative pre-training","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2501.00823","last_updated":"2025-01-06T14:26:41Z","snapshot_observed_at":"2026-08-21T07:53:20.144398Z","submitted_at":"2025-01-01T12:55:57Z","title":"Decoupling Knowledge and Reasoning in Transformers: A Modular Architecture with Generalized Cross-Attention","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-10T22:48:10.806872Z"},"links":{"cited_paper":"/paper/1801.06146","citing_paper":"/paper/2501.00823"},"observation_digest":"sha256:375792daa3ed3ec14c35b05ecc63190217d1e5a1bbbca1f6b0965a11fd03b8ae","observation_id":"1caf7237-ec8a-4cad-81d7-b3bd631f8da0","resolution":{"observed_at":"2026-08-10T22:48:10.806872Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1801.06146","last_updated":"2018-05-23T09:23:47Z","snapshot_observed_at":"2026-08-14T19:54:00.470999Z","submitted_at":"2018-01-18T17:54:52Z","title":"Universal Language Model Fine-tuning for Text Classification","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1801.06146","snapshot_observed_at":"2026-08-10T21:59:49.851843Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2501.03463","last_updated":"2025-01-07T01:45:18Z","snapshot_observed_at":"2026-08-16T21:31:15.003976Z","submitted_at":"2025-01-07T01:45:18Z","title":"Auxiliary Learning and its Statistical Understanding","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-10T21:59:49.851843Z"},"links":{"cited_paper":"/paper/1801.06146","citing_paper":"/paper/2501.03463"},"observation_digest":"sha256:dcd12e232e6adf67b46c0453cef571376d67a2d98f9fcefa67bb785867d103b5","observation_id":"b797c2f2-011c-49ee-8ac4-e61d9f49c172","resolution":{"observed_at":"2026-08-10T21:59:49.851843Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1801.06146","last_updated":"2018-05-23T09:23:47Z","snapshot_observed_at":"2026-08-14T19:54:00.470999Z","submitted_at":"2018-01-18T17:54:52Z","title":"Universal Language Model Fine-tuning for Text Classification","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1801.06146","snapshot_observed_at":"2026-08-10T22:17:55.533789Z","title":"Universal Language Model Fine-tuning for Text Classification","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2501.04040","last_updated":"2025-02-09T08:00:36Z","snapshot_observed_at":"2026-08-15T09:18:34.265227Z","submitted_at":"2025-01-03T21:04:49Z","title":"A Survey on Large Language Models with some Insights on their Capabilities and Limitations","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-10T22:17:55.533789Z"},"links":{"cited_paper":"/paper/1801.06146","citing_paper":"/paper/2501.04040"},"observation_digest":"sha256:ad82f89453625e30e38af42978daa00c807d28ad8c48d1f4902a0bfc2abe0fbb","observation_id":"85e37192-236a-4718-8189-07cda4556cde","resolution":{"observed_at":"2026-08-10T22:17:55.533789Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1801.06146","last_updated":"2018-05-23T09:23:47Z","snapshot_observed_at":"2026-08-14T19:54:00.470999Z","submitted_at":"2018-01-18T17:54:52Z","title":"Universal Language Model Fine-tuning for Text Classification","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1801.06146","snapshot_observed_at":"2026-08-10T20:54:05.093014Z","title":"Universal language model fine-tuning for text classification","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.06911","last_updated":"2025-01-12T19:48:21Z","snapshot_observed_at":"2026-08-16T06:47:56.403848Z","submitted_at":"2025-01-12T19:48:21Z","title":"Risk-Averse Finetuning of Large Language Models","version":1},"reference_index":2019,"source":"pdf_text","source_observed_at":"2026-08-10T20:54:05.093014Z"},"links":{"cited_paper":"/paper/1801.06146","citing_paper":"/paper/2501.06911"},"observation_digest":"sha256:1208ea2f37f3d28648afee4595a4b7000ca731d483bdfc4cd1956bcc1d926f52","observation_id":"5b19e35a-fec8-443e-acd2-7b43bfcb77db","resolution":{"observed_at":"2026-08-10T20:54:05.093014Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1801.06146","last_updated":"2018-05-23T09:23:47Z","snapshot_observed_at":"2026-08-14T19:54:00.470999Z","submitted_at":"2018-01-18T17:54:52Z","title":"Universal Language Model Fine-tuning for Text Classification","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1801.06146","snapshot_observed_at":"2026-08-10T19:04:02.604599Z","title":"Universal Language Model Fine -tuning for Text Classification,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2501.10685","last_updated":"2025-01-18T07:47:25Z","snapshot_observed_at":"2026-08-16T16:31:46.784320Z","submitted_at":"2025-01-18T07:47:25Z","title":"Harnessing the Potential of Large Language Models in Modern Marketing Management: Applications, Future Directions, and Strategic Recommendations","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-10T19:04:02.604599Z"},"links":{"cited_paper":"/paper/1801.06146","citing_paper":"/paper/2501.10685"},"observation_digest":"sha256:e8dd38322797638bbf847a927cd414c3a6584ee878b0066ed1a56d95adea2f92","observation_id":"562aff14-f44a-49b2-831a-3a0aec8bd3f8","resolution":{"observed_at":"2026-08-10T19:04:02.604599Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1801.06146","last_updated":"2018-05-23T09:23:47Z","snapshot_observed_at":"2026-08-14T19:54:00.470999Z","submitted_at":"2018-01-18T17:54:52Z","title":"Universal Language Model Fine-tuning for Text Classification","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1801.06146","snapshot_observed_at":"2026-08-10T18:09:28.942626Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2501.11581","last_updated":"2025-01-20T16:38:15Z","snapshot_observed_at":"2026-08-17T06:42:10.137540Z","submitted_at":"2025-01-20T16:38:15Z","title":"Open Sourcing GPTs: Economics of Open Sourcing Advanced AI Models","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-10T18:09:28.942626Z"},"links":{"cited_paper":"/paper/1801.06146","citing_paper":"/paper/2501.11581"},"observation_digest":"sha256:5e0371194d9907f5ec6de3a80b54f4b8cc620f9177119b76d39572e55f8d9f90","observation_id":"787b4bee-eae6-4a33-9ad9-75c24ed7dcf7","resolution":{"observed_at":"2026-08-10T18:09:28.942626Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1801.06146","last_updated":"2018-05-23T09:23:47Z","snapshot_observed_at":"2026-08-14T19:54:00.470999Z","submitted_at":"2018-01-18T17:54:52Z","title":"Universal Language Model Fine-tuning for Text Classification","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1801.06146","snapshot_observed_at":"2026-08-10T16:34:06.282932Z","title":"Universal Language Model Fine-tuning for Text Classification","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2501.13052","last_updated":"2025-01-22T18:01:24Z","snapshot_observed_at":"2026-08-10T19:27:49.507336Z","submitted_at":"2025-01-22T18:01:24Z","title":"One-Class Domain Adaptation via Meta-Learning","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-10T16:34:06.282932Z"},"links":{"cited_paper":"/paper/1801.06146","citing_paper":"/paper/2501.13052"},"observation_digest":"sha256:c668c5dbf60230d550a5dc1400c2757d1f63fd3bccea43dae5deac1325155377","observation_id":"2b7c2fec-b69c-4f0d-b0db-62c66bac7915","resolution":{"observed_at":"2026-08-10T16:34:06.282932Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1801.06146","last_updated":"2018-05-23T09:23:47Z","snapshot_observed_at":"2026-08-14T19:54:00.470999Z","submitted_at":"2018-01-18T17:54:52Z","title":"Universal Language Model Fine-tuning for Text Classification","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1801.06146","snapshot_observed_at":"2026-08-10T16:18:36.257966Z","title":"Universal language model fine-tuning for text classification,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2501.13318","last_updated":"2025-01-23T02:02:38Z","snapshot_observed_at":"2026-08-18T01:24:22.285728Z","submitted_at":"2025-01-23T02:02:38Z","title":"SplitLLM: Hierarchical Split Learning for Large Language Model over Wireless Network","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-10T16:18:36.257966Z"},"links":{"cited_paper":"/paper/1801.06146","citing_paper":"/paper/2501.13318"},"observation_digest":"sha256:f928b58df42946f01a5b900a579f867e9821984ad19b2bf1c06c5b013219dc5f","observation_id":"40c034a4-404d-4ba0-8fe4-a5b699f50efd","resolution":{"observed_at":"2026-08-10T16:18:36.257966Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1801.06146","last_updated":"2018-05-23T09:23:47Z","snapshot_observed_at":"2026-08-14T19:54:00.470999Z","submitted_at":"2018-01-18T17:54:52Z","title":"Universal Language Model Fine-tuning for Text Classification","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1801.06146","snapshot_observed_at":"2026-08-10T14:26:47.863695Z","title":"Universal language model fine-tuning for text classification,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2501.15361","last_updated":"2025-08-21T21:26:39Z","snapshot_observed_at":"2026-08-20T01:41:09.233129Z","submitted_at":"2025-01-26T01:56:25Z","title":"Decentralized Low-Rank Fine-Tuning of Large Language Models","version":5},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-10T14:26:47.863695Z"},"links":{"cited_paper":"/paper/1801.06146","citing_paper":"/paper/2501.15361"},"observation_digest":"sha256:1ce5dc59497a361640fceca4e5c481af11fdc7e123c474e4c895b165e90e6e0e","observation_id":"bac3bc96-d5e5-4304-8901-df7f974485db","resolution":{"observed_at":"2026-08-10T14:26:47.863695Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1801.06146","last_updated":"2018-05-23T09:23:47Z","snapshot_observed_at":"2026-08-14T19:54:00.470999Z","submitted_at":"2018-01-18T17:54:52Z","title":"Universal Language Model Fine-tuning for Text Classification","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1801.06146","snapshot_observed_at":"2026-08-10T14:15:23.885109Z","title":"Universal language model fine-tuning for text classification","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2501.15547","last_updated":"2025-01-26T14:39:01Z","snapshot_observed_at":"2026-08-19T23:39:38.668481Z","submitted_at":"2025-01-26T14:39:01Z","title":"Building Efficient Lightweight CNN Models","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-10T14:15:23.885109Z"},"links":{"cited_paper":"/paper/1801.06146","citing_paper":"/paper/2501.15547"},"observation_digest":"sha256:0e4f6d198eca1159895c1a09078a30bbd203cf6ab52997a3055dca3a2d8362d4","observation_id":"2361b84a-49d3-42ca-a89d-6ffad699f564","resolution":{"observed_at":"2026-08-10T14:15:23.885109Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1801.06146","last_updated":"2018-05-23T09:23:47Z","snapshot_observed_at":"2026-08-14T19:54:00.470999Z","submitted_at":"2018-01-18T17:54:52Z","title":"Universal Language Model Fine-tuning for Text Classification","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1801.06146","snapshot_observed_at":"2026-08-10T14:21:32.842468Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2501.17186","last_updated":"2025-01-30T04:02:48Z","snapshot_observed_at":"2026-08-17T01:11:52.725402Z","submitted_at":"2025-01-26T09:43:39Z","title":"Complete Chess Games Enable LLM Become A Chess Master","version":2},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-10T14:21:32.842468Z"},"links":{"cited_paper":"/paper/1801.06146","citing_paper":"/paper/2501.17186"},"observation_digest":"sha256:94e813e199d50c1d319fed6c009080eafabf7ca4b68ef4ed54493ab41f6082d5","observation_id":"65b9ab9e-398f-4c33-9e9a-c8a76a4cf596","resolution":{"observed_at":"2026-08-10T14:21:32.842468Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1801.06146","last_updated":"2018-05-23T09:23:47Z","snapshot_observed_at":"2026-08-14T19:54:00.470999Z","submitted_at":"2018-01-18T17:54:52Z","title":"Universal Language Model Fine-tuning for Text Classification","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1801.06146","snapshot_observed_at":"2026-08-09T11:32:47.870940Z","title":"and Ruder, S","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.04357","last_updated":"2025-02-04T19:37:35Z","snapshot_observed_at":"2026-08-13T21:01:10.025945Z","submitted_at":"2025-02-04T19:37:35Z","title":"Reusing Embeddings: Reproducible Reward Model Research in Large Language Model Alignment without GPUs","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-09T11:32:47.870940Z"},"links":{"cited_paper":"/paper/1801.06146","citing_paper":"/paper/2502.04357"},"observation_digest":"sha256:5dfad87f998fce33850811d36195897f6e1b9e4d5b4113e73b4b117be709de62","observation_id":"63b25d2b-3b20-4b58-be64-a4dc1fdbd324","resolution":{"observed_at":"2026-08-09T11:32:47.870940Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1801.06146","last_updated":"2018-05-23T09:23:47Z","snapshot_observed_at":"2026-08-14T19:54:00.470999Z","submitted_at":"2018-01-18T17:54:52Z","title":"Universal Language Model Fine-tuning for Text Classification","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1801.06146","snapshot_observed_at":"2026-08-16T12:28:25.217864Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2504.12920","last_updated":"2025-04-17T13:10:56Z","snapshot_observed_at":"2026-08-18T10:57:44.688786Z","submitted_at":"2025-04-17T13:10:56Z","title":"CSMF: Cascaded Selective Mask Fine-Tuning for Multi-Objective Embedding-Based Retrieval","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-16T12:28:25.217864Z"},"links":{"cited_paper":"/paper/1801.06146","citing_paper":"/paper/2504.12920"},"observation_digest":"sha256:edd5668ac39421aacb8553fb85603e6686f83db57bed553128591ff601922be2","observation_id":"514e085d-ba24-47e0-b2f8-ad6c6d12f0e1","resolution":{"observed_at":"2026-08-16T12:28:25.217864Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1801.06146","last_updated":"2018-05-23T09:23:47Z","snapshot_observed_at":"2026-08-14T19:54:00.470999Z","submitted_at":"2018-01-18T17:54:52Z","title":"Universal Language Model Fine-tuning for Text Classification","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1801.06146","snapshot_observed_at":"2026-08-16T11:41:25.644511Z","title":"Universal language model fine-tuning for text classifica- tion","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2504.14904","last_updated":"2025-04-21T07:20:19Z","snapshot_observed_at":"2026-08-19T20:04:14.178921Z","submitted_at":"2025-04-21T07:20:19Z","title":"VLM as Policy: Common-Law Content Moderation Framework for Short Video Platform","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-16T11:41:25.644511Z"},"links":{"cited_paper":"/paper/1801.06146","citing_paper":"/paper/2504.14904"},"observation_digest":"sha256:fa4a147f070e317e9d067ee9c91df8be31b9a33f0cd6de955b0f7de8406c5792","observation_id":"a2345192-ae15-4166-9c32-6faeb9a20750","resolution":{"observed_at":"2026-08-16T11:41:25.644511Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1801.06146","last_updated":"2018-05-23T09:23:47Z","snapshot_observed_at":"2026-08-14T19:54:00.470999Z","submitted_at":"2018-01-18T17:54:52Z","title":"Universal Language Model Fine-tuning for Text Classification","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1801.06146","snapshot_observed_at":"2026-08-16T10:41:17.717257Z","title":"2018, arXiv e-prints, arXiv:1801.06146, 10.48550/arXiv.1801.06146","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2504.17688","last_updated":"2025-04-24T15:58:00Z","snapshot_observed_at":"2026-08-21T14:09:59.922847Z","submitted_at":"2025-04-24T15:58:00Z","title":"The Hubble Image Similarity Project","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-16T10:41:17.717257Z"},"links":{"cited_paper":"/paper/1801.06146","citing_paper":"/paper/2504.17688"},"observation_digest":"sha256:ce4f7f683641a139c435d02e876e2a4c14c0064928b1adeb07fb5918b4b4b78b","observation_id":"69aa8d78-8d71-4ffb-9004-5206fc2f268c","resolution":{"observed_at":"2026-08-16T10:41:17.717257Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1801.06146","last_updated":"2018-05-23T09:23:47Z","snapshot_observed_at":"2026-08-14T19:54:00.470999Z","submitted_at":"2018-01-18T17:54:52Z","title":"Universal Language Model Fine-tuning for Text Classification","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1801.06146","snapshot_observed_at":"2026-08-16T04:12:39.296747Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2505.01851","last_updated":"2025-05-03T16:09:52Z","snapshot_observed_at":"2026-08-18T14:17:32.925051Z","submitted_at":"2025-05-03T16:09:52Z","title":"Mitigating Group-Level Fairness Disparities in Federated Visual Language Models","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-16T04:12:39.296747Z"},"links":{"cited_paper":"/paper/1801.06146","citing_paper":"/paper/2505.01851"},"observation_digest":"sha256:4b88b2f571458ddfdbf3d417238c302067f3877fe59f911960b723ee4bc49124","observation_id":"293b11c0-ddda-44ee-bc80-57941e65905c","resolution":{"observed_at":"2026-08-16T04:12:39.296747Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1801.06146","last_updated":"2018-05-23T09:23:47Z","snapshot_observed_at":"2026-08-14T19:54:00.470999Z","submitted_at":"2018-01-18T17:54:52Z","title":"Universal Language Model Fine-tuning for Text Classification","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1801.06146","snapshot_observed_at":"2026-08-15T21:48:23.160029Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.08941","last_updated":"2025-05-13T20:10:00Z","snapshot_observed_at":"2026-08-20T22:07:14.982016Z","submitted_at":"2025-05-13T20:10:00Z","title":"ForeCite: Adapting Pre-Trained Language Models to Predict Future Citation Rates of Academic Papers","version":1},"reference_index":2018,"source":"pdf_text","source_observed_at":"2026-08-15T21:48:23.160029Z"},"links":{"cited_paper":"/paper/1801.06146","citing_paper":"/paper/2505.08941"},"observation_digest":"sha256:1e674e859459c00882a3339cabe1196847926fd7ace5b47e883cab6d0a02158a","observation_id":"88276e9f-79bd-437f-81cf-50f07cca7994","resolution":{"observed_at":"2026-08-15T21:48:23.160029Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1801.06146","last_updated":"2018-05-23T09:23:47Z","snapshot_observed_at":"2026-08-14T19:54:00.470999Z","submitted_at":"2018-01-18T17:54:52Z","title":"Universal Language Model Fine-tuning for Text Classification","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1801.06146","snapshot_observed_at":"2026-08-15T21:35:54.193492Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2505.09407","last_updated":"2025-05-14T14:04:44Z","snapshot_observed_at":"2026-08-19T13:03:02.977826Z","submitted_at":"2025-05-14T14:04:44Z","title":"Multilingual Machine Translation with Quantum Encoder Decoder Attention-based Convolutional Variational Circuits","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-15T21:35:54.193492Z"},"links":{"cited_paper":"/paper/1801.06146","citing_paper":"/paper/2505.09407"},"observation_digest":"sha256:35a9e39ce9a550d33439ae0d72bf024d8302058fc79202ee2a28f7f9aa3ba7ea","observation_id":"078bcf0a-1b9e-4890-9a46-159450dc0e48","resolution":{"observed_at":"2026-08-15T21:35:54.193492Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1801.06146","last_updated":"2018-05-23T09:23:47Z","snapshot_observed_at":"2026-08-14T19:54:00.470999Z","submitted_at":"2018-01-18T17:54:52Z","title":"Universal Language Model Fine-tuning for Text Classification","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1801.06146","snapshot_observed_at":"2026-08-15T21:06:23.035440Z","title":"and Ruder, S","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.10930","last_updated":"2025-05-31T03:05:23Z","snapshot_observed_at":"2026-08-18T08:44:40.012766Z","submitted_at":"2025-05-16T07:08:47Z","title":"Physics-informed Temporal Alignment for Auto-regressive PDE Foundation Models","version":2},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-15T21:06:23.035440Z"},"links":{"cited_paper":"/paper/1801.06146","citing_paper":"/paper/2505.10930"},"observation_digest":"sha256:838aa351ba4e25bb3a492ce60482fd3b11929f1532ce65f971068b384ee271a6","observation_id":"edd9db8d-912c-4326-9651-c8759008ad22","resolution":{"observed_at":"2026-08-15T21:06:23.035440Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1801.06146","last_updated":"2018-05-23T09:23:47Z","snapshot_observed_at":"2026-08-14T19:54:00.470999Z","submitted_at":"2018-01-18T17:54:52Z","title":"Universal Language Model Fine-tuning for Text Classification","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1801.06146","snapshot_observed_at":"2026-08-07T14:44:51.470387Z","title":"Fine-tuned Language Models for Text Classification // CoRR","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2505.17704","last_updated":"2025-05-23T10:15:22Z","snapshot_observed_at":"2026-08-20T13:16:55.567242Z","submitted_at":"2025-05-23T10:15:22Z","title":"SemSketches-2021: experimenting with the machine processing of the pilot semantic sketches corpus","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T14:44:51.470387Z"},"links":{"cited_paper":"/paper/1801.06146","citing_paper":"/paper/2505.17704"},"observation_digest":"sha256:4eedd7e642005ea52d172a381cd19282521ec6a6427f601a68fbbaf2f753a245","observation_id":"9b837a9a-69ce-4c9c-9f61-3cd6e6e3088e","resolution":{"observed_at":"2026-08-07T14:44:51.470387Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1801.06146","last_updated":"2018-05-23T09:23:47Z","snapshot_observed_at":"2026-08-14T19:54:00.470999Z","submitted_at":"2018-01-18T17:54:52Z","title":"Universal Language Model Fine-tuning for Text Classification","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1801.06146","snapshot_observed_at":"2026-08-07T13:20:24.563836Z","title":"Universal language model fine-tuning for text classification,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2505.22146","last_updated":"2025-08-21T04:52:25Z","snapshot_observed_at":"2026-08-07T13:12:01.562263Z","submitted_at":"2025-05-28T09:06:04Z","title":"Flexible Tool Selection through Low-dimensional Attribute Alignment of Vision and Language","version":4},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-07T13:20:24.563836Z"},"links":{"cited_paper":"/paper/1801.06146","citing_paper":"/paper/2505.22146"},"observation_digest":"sha256:6150fbb0d089533295f49ca8ddfebb53332abdca4c2a91e925c6c38e9910f363","observation_id":"0bb4da40-405b-4785-9f57-a46c69b8dbd0","resolution":{"observed_at":"2026-08-07T13:20:24.563836Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1801.06146","last_updated":"2018-05-23T09:23:47Z","snapshot_observed_at":"2026-08-14T19:54:00.470999Z","submitted_at":"2018-01-18T17:54:52Z","title":"Universal Language Model Fine-tuning for Text Classification","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1801.06146","snapshot_observed_at":"2026-08-07T05:52:38.718746Z","title":"Universal language model fine-tuning for text classification","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.06823","last_updated":"2025-06-07T14:56:32Z","snapshot_observed_at":"2026-08-13T03:45:13.811344Z","submitted_at":"2025-06-07T14:56:32Z","title":"Exploring Visual Prompting: Robustness Inheritance and Beyond","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-07T05:52:38.718746Z"},"links":{"cited_paper":"/paper/1801.06146","citing_paper":"/paper/2506.06823"},"observation_digest":"sha256:515b0c9bc084a7f6924b1848467798d1e148e34cf52eeaed95605f6fb2754c5e","observation_id":"ea86efcd-a130-49ab-b0c8-ad247ea2dcb2","resolution":{"observed_at":"2026-08-07T05:52:38.718746Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1801.06146","last_updated":"2018-05-23T09:23:47Z","snapshot_observed_at":"2026-08-14T19:54:00.470999Z","submitted_at":"2018-01-18T17:54:52Z","title":"Universal Language Model Fine-tuning for Text Classification","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1801.06146","snapshot_observed_at":"2026-08-07T04:10:33.704274Z","title":"Universal language model fine-tuning for text classifi- cation","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.11615","last_updated":"2025-06-13T09:37:11Z","snapshot_observed_at":"2026-08-21T20:32:33.595940Z","submitted_at":"2025-06-13T09:37:11Z","title":"Machine Unlearning for Robust DNNs: Attribution-Guided Partitioning and Neuron Pruning in Noisy Environments","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-07T04:10:33.704274Z"},"links":{"cited_paper":"/paper/1801.06146","citing_paper":"/paper/2506.11615"},"observation_digest":"sha256:887c2d9ae81b715438c573cd0fd6c1da3a7b629a4b527c06a4777be18d58a2c7","observation_id":"570a0be7-6836-405f-8514-a4eb1accc564","resolution":{"observed_at":"2026-08-07T04:10:33.704274Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1801.06146","last_updated":"2018-05-23T09:23:47Z","snapshot_observed_at":"2026-08-14T19:54:00.470999Z","submitted_at":"2018-01-18T17:54:52Z","title":"Universal Language Model Fine-tuning for Text Classification","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1801.06146","snapshot_observed_at":"2026-08-07T14:29:46.207164Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.13970","last_updated":"2025-05-24T20:32:31Z","snapshot_observed_at":"2026-08-13T18:47:37.183751Z","submitted_at":"2025-05-24T20:32:31Z","title":"Making deep neural networks work for medical audio: representation, compression and domain adaptation","version":1},"reference_index":93,"source":"pdf_text","source_observed_at":"2026-08-07T14:29:46.207164Z"},"links":{"cited_paper":"/paper/1801.06146","citing_paper":"/paper/2506.13970"},"observation_digest":"sha256:0e1b6d17d579bafe058195691b8794562f4ea2a8ec67c9fcd5d158bfea8dcb36","observation_id":"3607f915-9f5b-4b0e-8d70-453c50658c72","resolution":{"observed_at":"2026-08-07T14:29:46.207164Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1801.06146","last_updated":"2018-05-23T09:23:47Z","snapshot_observed_at":"2026-08-14T19:54:00.470999Z","submitted_at":"2018-01-18T17:54:52Z","title":"Universal Language Model Fine-tuning for Text Classification","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1801.06146","snapshot_observed_at":"2026-08-06T22:43:55.768195Z","title":"Universal language model fine-tuning for text classifica- tion,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.21119","last_updated":"2025-06-26T09:37:15Z","snapshot_observed_at":"2026-08-22T03:13:48.642763Z","submitted_at":"2025-06-26T09:37:15Z","title":"Progtuning: Progressive Fine-tuning Framework for Transformer-based Language Models","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T22:43:55.768195Z"},"links":{"cited_paper":"/paper/1801.06146","citing_paper":"/paper/2506.21119"},"observation_digest":"sha256:72259fe74d7720bcdbb7fd89329c4bfa7f87ce93110f57fdbb032a2bea1e3e2b","observation_id":"888ecb68-2034-4121-94ce-223274090a19","resolution":{"observed_at":"2026-08-06T22:43:55.768195Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1801.06146","last_updated":"2018-05-23T09:23:47Z","snapshot_observed_at":"2026-08-14T19:54:00.470999Z","submitted_at":"2018-01-18T17:54:52Z","title":"Universal Language Model Fine-tuning for Text Classification","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1801.06146","snapshot_observed_at":"2026-08-06T21:55:11.038071Z","title":"arXiv preprint arXiv:1801.06146 (2018)","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.23136","last_updated":"2025-06-29T08:22:03Z","snapshot_observed_at":"2026-08-17T18:18:24.330942Z","submitted_at":"2025-06-29T08:22:03Z","title":"LLM-Assisted Question-Answering on Technical Documents Using Structured Data-Aware Retrieval Augmented Generation","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T21:55:11.038071Z"},"links":{"cited_paper":"/paper/1801.06146","citing_paper":"/paper/2506.23136"},"observation_digest":"sha256:857ad3c22563269323f6f7c9099a3c0df3c9a931d31ffd3a03ef7ebf1f50951a","observation_id":"6e8484fc-c90b-4e20-9b44-e25504b5790c","resolution":{"observed_at":"2026-08-06T21:55:11.038071Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1801.06146","last_updated":"2018-05-23T09:23:47Z","snapshot_observed_at":"2026-08-14T19:54:00.470999Z","submitted_at":"2018-01-18T17:54:52Z","title":"Universal Language Model Fine-tuning for Text Classification","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1801.06146","snapshot_observed_at":"2026-08-06T20:22:25.276354Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2507.03175","last_updated":"2025-07-03T21:06:30Z","snapshot_observed_at":"2026-08-20T22:32:05.552969Z","submitted_at":"2025-07-03T21:06:30Z","title":"Understanding Knowledge Transferability for Transfer Learning: A Survey","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T20:22:25.276354Z"},"links":{"cited_paper":"/paper/1801.06146","citing_paper":"/paper/2507.03175"},"observation_digest":"sha256:beffc7d2dbc23537796b213e35b4388a0500e16f8ad73a048654bcca37ae98f8","observation_id":"a008ff17-ed3c-46d1-85b6-99d3c2361d39","resolution":{"observed_at":"2026-08-06T20:22:25.276354Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1801.06146","last_updated":"2018-05-23T09:23:47Z","snapshot_observed_at":"2026-08-14T19:54:00.470999Z","submitted_at":"2018-01-18T17:54:52Z","title":"Universal Language Model Fine-tuning for Text Classification","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1801.06146","snapshot_observed_at":"2026-08-06T17:48:07.131920Z","title":"and Ruder, S","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2507.09973","last_updated":"2025-07-14T06:43:00Z","snapshot_observed_at":"2026-08-08T02:31:23.778902Z","submitted_at":"2025-07-14T06:43:00Z","title":"Tiny Reward Models","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-06T17:48:07.131920Z"},"links":{"cited_paper":"/paper/1801.06146","citing_paper":"/paper/2507.09973"},"observation_digest":"sha256:d0e77c9d2ff3edd2fd2237b879970d27117f9d6fe111b06b5f92827ae356926e","observation_id":"841364ec-0573-4c03-a26a-f6ec90b140b8","resolution":{"observed_at":"2026-08-06T17:48:07.131920Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1801.06146","last_updated":"2018-05-23T09:23:47Z","snapshot_observed_at":"2026-08-14T19:54:00.470999Z","submitted_at":"2018-01-18T17:54:52Z","title":"Universal Language Model Fine-tuning for Text Classification","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1801.06146","snapshot_observed_at":"2026-08-06T19:32:54.211808Z","title":"Universal language model fine-tuning for text classifi- cation","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2507.10446","last_updated":"2025-07-15T02:06:07Z","snapshot_observed_at":"2026-08-21T22:05:45.641303Z","submitted_at":"2025-07-07T18:48:09Z","title":"Acquiring and Adapting Priors for Novel Tasks via Neural Meta-Architectures","version":2},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-06T19:32:54.211808Z"},"links":{"cited_paper":"/paper/1801.06146","citing_paper":"/paper/2507.10446"},"observation_digest":"sha256:b82e0a68aa43d79d7a19e555a76252ade8f5c071470fcd55037e2a90c7cd1299","observation_id":"9f29867c-a415-4e45-b3a7-1bc8e85ed404","resolution":{"observed_at":"2026-08-06T19:32:54.211808Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1801.06146","last_updated":"2018-05-23T09:23:47Z","snapshot_observed_at":"2026-08-14T19:54:00.470999Z","submitted_at":"2018-01-18T17:54:52Z","title":"Universal Language Model Fine-tuning for Text Classification","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1801.06146","snapshot_observed_at":"2026-08-06T16:35:13.394240Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2507.13115","last_updated":"2025-07-17T13:31:04Z","snapshot_observed_at":"2026-08-19T03:45:00.911397Z","submitted_at":"2025-07-17T13:31:04Z","title":"A Computational Framework to Identify Self-Aspects in Text","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-06T16:35:13.394240Z"},"links":{"cited_paper":"/paper/1801.06146","citing_paper":"/paper/2507.13115"},"observation_digest":"sha256:9d0c6d1452ed79b5e61eca64eea7d7476ca5b65ff4058cc638716440fc584b42","observation_id":"68c5e0af-2db7-47ce-a1d1-be5adbb29400","resolution":{"observed_at":"2026-08-06T16:35:13.394240Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1801.06146","last_updated":"2018-05-23T09:23:47Z","snapshot_observed_at":"2026-08-14T19:54:00.470999Z","submitted_at":"2018-01-18T17:54:52Z","title":"Universal Language Model Fine-tuning for Text Classification","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1801.06146","snapshot_observed_at":"2026-08-06T15:15:13.047871Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2507.16438","last_updated":"2025-07-22T10:32:50Z","snapshot_observed_at":"2026-08-06T18:00:53.095318Z","submitted_at":"2025-07-22T10:32:50Z","title":"The Sweet Danger of Sugar: Debunking Representation Learning for Encrypted Traffic Classification","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T15:15:13.047871Z"},"links":{"cited_paper":"/paper/1801.06146","citing_paper":"/paper/2507.16438"},"observation_digest":"sha256:74171d51cc93a97b898fa8d52cf1414affcad4cc2d3147fa505f7336c9cb806a","observation_id":"35680a5e-ad65-43cc-a583-40794f2961b5","resolution":{"observed_at":"2026-08-06T15:15:13.047871Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1801.06146","last_updated":"2018-05-23T09:23:47Z","snapshot_observed_at":"2026-08-14T19:54:00.470999Z","submitted_at":"2018-01-18T17:54:52Z","title":"Universal Language Model Fine-tuning for Text Classification","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1801.06146","snapshot_observed_at":"2026-08-06T05:57:29.261529Z","title":"Universal language model fine-tuning for text classification","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2508.01059","last_updated":"2025-08-01T20:25:57Z","snapshot_observed_at":"2026-08-20T20:05:54.725327Z","submitted_at":"2025-08-01T20:25:57Z","title":"Llama-3.1-FoundationAI-SecurityLLM-8B-Instruct Technical Report","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T05:57:29.261529Z"},"links":{"cited_paper":"/paper/1801.06146","citing_paper":"/paper/2508.01059"},"observation_digest":"sha256:57a52594203c9bbc82241cfd0d3ce0a3ed411ed8cf6e3b0f98120dbaecba9d99","observation_id":"37ce261a-2b6b-47b6-838d-3850cf67bf48","resolution":{"observed_at":"2026-08-06T05:57:29.261529Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1801.06146","last_updated":"2018-05-23T09:23:47Z","snapshot_observed_at":"2026-08-14T19:54:00.470999Z","submitted_at":"2018-01-18T17:54:52Z","title":"Universal Language Model Fine-tuning for Text Classification","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1801.06146","snapshot_observed_at":"2026-08-15T17:21:17.411387Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2508.12922","last_updated":"2025-08-18T13:40:37Z","snapshot_observed_at":"2026-08-15T17:14:49.161022Z","submitted_at":"2025-08-18T13:40:37Z","title":"RUM: Rule+LLM-Based Comprehensive Assessment on Testing Skills","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-15T17:21:17.411387Z"},"links":{"cited_paper":"/paper/1801.06146","citing_paper":"/paper/2508.12922"},"observation_digest":"sha256:30e5b3aee39d7a9228bc17b0cedc7b8e5861cbf7a5a0bda088b9a1a2c8eacc76","observation_id":"80de71df-910d-4b2a-a862-df9a4fc71ca0","resolution":{"observed_at":"2026-08-15T17:21:17.411387Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1801.06146","last_updated":"2018-05-23T09:23:47Z","snapshot_observed_at":"2026-08-14T19:54:00.470999Z","submitted_at":"2018-01-18T17:54:52Z","title":"Universal Language Model Fine-tuning for Text Classification","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1801.06146","snapshot_observed_at":"2026-08-05T18:07:23.943333Z","title":"Radford, K","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2508.15110","last_updated":"2025-08-20T22:57:00Z","snapshot_observed_at":"2026-08-14T22:51:06.336555Z","submitted_at":"2025-08-20T22:57:00Z","title":"LLMs and Agentic AI in Insurance Decision-Making: Opportunities and Challenges For Africa","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-05T18:07:23.943333Z"},"links":{"cited_paper":"/paper/1801.06146","citing_paper":"/paper/2508.15110"},"observation_digest":"sha256:ceab3fbfd4d3c39c2a313a8db074f2e6d41c86ea0441201598dee60b91c0edd2","observation_id":"9e3c1e1d-d519-445a-af08-25bb57b89f6f","resolution":{"observed_at":"2026-08-05T18:07:23.943333Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1801.06146","last_updated":"2018-05-23T09:23:47Z","snapshot_observed_at":"2026-08-14T19:54:00.470999Z","submitted_at":"2018-01-18T17:54:52Z","title":"Universal Language Model Fine-tuning for Text Classification","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1801.06146","snapshot_observed_at":"2026-08-15T17:08:57.854107Z","title":"https://www.dwt.com/insights/ 2024/05/ai-bias-audits-using-ai-for-hiring-employment","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.17586","last_updated":"2025-08-25T01:14:44Z","snapshot_observed_at":"2026-08-15T17:00:55.895364Z","submitted_at":"2025-08-25T01:14:44Z","title":"Exploring Efficient Learning of Small BERT Networks with LoRA and DoRA","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-15T17:08:57.854107Z"},"links":{"cited_paper":"/paper/1801.06146","citing_paper":"/paper/2508.17586"},"observation_digest":"sha256:ced2846dd0835610ef711c37ca699205a88653f8d7b46a2dfa9e53b02b74f88a","observation_id":"cbd6f546-85de-4187-9495-a59d3b13220c","resolution":{"observed_at":"2026-08-15T17:08:57.854107Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1801.06146","last_updated":"2018-05-23T09:23:47Z","snapshot_observed_at":"2026-08-14T19:54:00.470999Z","submitted_at":"2018-01-18T17:54:52Z","title":"Universal Language Model Fine-tuning for Text Classification","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1801.06146","snapshot_observed_at":"2026-08-05T17:14:37.669672Z","title":"Universal language model fine-tuning for text classification","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2508.18306","last_updated":"2025-08-23T02:50:55Z","snapshot_observed_at":"2026-08-14T20:23:35.152528Z","submitted_at":"2025-08-23T02:50:55Z","title":"SALMAN: Stability Analysis of Language Models Through the Maps Between Graph-based Manifolds","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-05T17:14:37.669672Z"},"links":{"cited_paper":"/paper/1801.06146","citing_paper":"/paper/2508.18306"},"observation_digest":"sha256:6d063986005c79ac59d47c13bb0ae9c6a3adec50f803271fa23dfe0e17e85d36","observation_id":"7433c865-cbc7-4b19-882b-48bc8b5227a1","resolution":{"observed_at":"2026-08-05T17:14:37.669672Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1801.06146","last_updated":"2018-05-23T09:23:47Z","snapshot_observed_at":"2026-08-14T19:54:00.470999Z","submitted_at":"2018-01-18T17:54:52Z","title":"Universal Language Model Fine-tuning for Text Classification","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1801.06146","snapshot_observed_at":"2026-08-05T15:19:14.820592Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2508.20032","last_updated":"2025-08-27T16:34:53Z","snapshot_observed_at":"2026-08-16T02:06:32.871327Z","submitted_at":"2025-08-27T16:34:53Z","title":"Pruning Strategies for Backdoor Defense in LLMs","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-05T15:19:14.820592Z"},"links":{"cited_paper":"/paper/1801.06146","citing_paper":"/paper/2508.20032"},"observation_digest":"sha256:b340cf54bdd59f1f1b94b2bca195e330fc7b781a81ba001d49157d6d2073ff58","observation_id":"761f09e2-6e02-4dbd-8065-482c0c401fcc","resolution":{"observed_at":"2026-08-05T15:19:14.820592Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1801.06146","last_updated":"2018-05-23T09:23:47Z","snapshot_observed_at":"2026-08-14T19:54:00.470999Z","submitted_at":"2018-01-18T17:54:52Z","title":"Universal Language Model Fine-tuning for Text Classification","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1801.06146","snapshot_observed_at":"2026-08-05T11:01:20.775942Z","title":"Howard, S","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2509.03407","last_updated":"2025-09-03T15:32:50Z","snapshot_observed_at":"2026-08-13T08:52:55.204446Z","submitted_at":"2025-09-03T15:32:50Z","title":"Learning Mechanism Underlying NLP Pre-Training and Fine-Tuning","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-05T11:01:20.775942Z"},"links":{"cited_paper":"/paper/1801.06146","citing_paper":"/paper/2509.03407"},"observation_digest":"sha256:fad38062b3fcccf04807013ae6dbbeaa0da39eb16b7a9ee60e6c94514f20bc8a","observation_id":"57488ebc-df3e-4b84-b68b-d210824b2946","resolution":{"observed_at":"2026-08-05T11:01:20.775942Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1801.06146","last_updated":"2018-05-23T09:23:47Z","snapshot_observed_at":"2026-08-14T19:54:00.470999Z","submitted_at":"2018-01-18T17:54:52Z","title":"Universal Language Model Fine-tuning for Text Classification","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1801.06146","snapshot_observed_at":"2026-08-05T18:42:48.141865Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2509.09690","last_updated":"2025-08-19T21:35:43Z","snapshot_observed_at":"2026-08-19T02:48:16.547418Z","submitted_at":"2025-08-19T21:35:43Z","title":"Powering Job Search at Scale: LLM-Enhanced Query Understanding in Job Matching Systems","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-05T18:42:48.141865Z"},"links":{"cited_paper":"/paper/1801.06146","citing_paper":"/paper/2509.09690"},"observation_digest":"sha256:d9d6342455d1330c2e58f24703c676c7d114cd50f2de49b0e6cdde713e9c856e","observation_id":"1f7e59cc-2861-42b7-ac47-3922bb4ba3c2","resolution":{"observed_at":"2026-08-05T18:42:48.141865Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1801.06146","last_updated":"2018-05-23T09:23:47Z","snapshot_observed_at":"2026-08-14T19:54:00.470999Z","submitted_at":"2018-01-18T17:54:52Z","title":"Universal Language Model Fine-tuning for Text Classification","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1801.06146","snapshot_observed_at":"2026-08-15T17:27:30.307966Z","title":"& Ruder, S","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2509.13323","last_updated":"2026-05-29T04:50:24Z","snapshot_observed_at":"2026-08-16T15:15:00.472411Z","submitted_at":"2025-08-17T11:24:31Z","title":"AI Behavioral Science","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-15T17:27:30.307966Z"},"links":{"cited_paper":"/paper/1801.06146","citing_paper":"/paper/2509.13323"},"observation_digest":"sha256:3df2f4108a073336becb6425a89307c659d0fb56f3dfa9b649afcbe7711259d9","observation_id":"7bf24d39-3fdc-4b89-86ce-44a7b6e4f64f","resolution":{"observed_at":"2026-08-15T17:27:30.307966Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1801.06146","last_updated":"2018-05-23T09:23:47Z","snapshot_observed_at":"2026-08-14T19:54:00.470999Z","submitted_at":"2018-01-18T17:54:52Z","title":"Universal Language Model Fine-tuning for Text Classification","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1801.06146","snapshot_observed_at":"2026-08-04T08:15:51.272515Z","title":"Universal language model fine-tuning for text classification","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2510.21978","last_updated":"2026-06-18T16:29:38Z","snapshot_observed_at":"2026-08-13T02:25:37.938690Z","submitted_at":"2025-10-24T19:08:48Z","title":"Beyond Reasoning Gains: Mitigating General-Capability Forgetting in Large Reasoning Models","version":2},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-04T08:15:51.272515Z"},"links":{"cited_paper":"/paper/1801.06146","citing_paper":"/paper/2510.21978"},"observation_digest":"sha256:7d75a90cdfe119c373d14839200484f90becaf2a7205916b62a181fee468ba72","observation_id":"054184d9-9396-40df-abcf-ac0c626f639d","resolution":{"observed_at":"2026-08-04T08:15:51.272515Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1801.06146","last_updated":"2018-05-23T09:23:47Z","snapshot_observed_at":"2026-08-14T19:54:00.470999Z","submitted_at":"2018-01-18T17:54:52Z","title":"Universal Language Model Fine-tuning for Text Classification","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1801.06146","snapshot_observed_at":"2026-08-03T20:04:40.550559Z","title":"Howard and S","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2511.21299","last_updated":"2026-06-22T13:58:44Z","snapshot_observed_at":"2026-08-17T04:55:29.652767Z","submitted_at":"2025-11-26T11:42:28Z","title":"Discovery and recovery of crystalline materials with property-conditioned transformers","version":3},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-08-03T20:04:40.550559Z"},"links":{"cited_paper":"/paper/1801.06146","citing_paper":"/paper/2511.21299"},"observation_digest":"sha256:1d2cff7d180bb5f2648c022b055c80fea5e27977aa7ebab7d6b78aa0c5537bd6","observation_id":"d6f0de25-52df-4723-ae27-ee90c7708e6b","resolution":{"observed_at":"2026-08-03T20:04:40.550559Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1801.06146","last_updated":"2018-05-23T09:23:47Z","snapshot_observed_at":"2026-08-14T19:54:00.470999Z","submitted_at":"2018-01-18T17:54:52Z","title":"Universal Language Model Fine-tuning for Text Classification","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1801.06146","snapshot_observed_at":"2026-08-03T00:17:26.388123Z","title":"& Ruder, S","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2602.11081","last_updated":"2026-02-11T17:46:01Z","snapshot_observed_at":"2026-08-15T08:49:28.336092Z","submitted_at":"2026-02-11T17:46:01Z","title":"SteuerLLM: Local specialized large language model for German tax law analysis","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-03T00:17:26.388123Z"},"links":{"cited_paper":"/paper/1801.06146","citing_paper":"/paper/2602.11081"},"observation_digest":"sha256:b550cc8bb5e2629321794bb8892de20d33d3343fc953d1c61e8e44d237bfdd87","observation_id":"3d808520-6762-4a89-aa03-aabe8f41b8e9","resolution":{"observed_at":"2026-08-03T00:17:26.388123Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1801.06146","last_updated":"2018-05-23T09:23:47Z","snapshot_observed_at":"2026-08-14T19:54:00.470999Z","submitted_at":"2018-01-18T17:54:52Z","title":"Universal Language Model Fine-tuning for Text Classification","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1801.06146","snapshot_observed_at":"2026-08-03T02:34:18.912953Z","title":"Large-scale dataset pruning with dynamic uncertainty","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2603.17205","last_updated":"2026-07-30T22:57:15Z","snapshot_observed_at":"2026-08-13T15:58:10.431583Z","submitted_at":"2026-03-17T23:11:45Z","title":"OPERA: Online Data Pruning for Efficient Retrieval Model Adaptation","version":3},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-03T02:34:18.912953Z"},"links":{"cited_paper":"/paper/1801.06146","citing_paper":"/paper/2603.17205"},"observation_digest":"sha256:56adebd15a92b370f5ee65e23350c6511116b199cbf550f23ab43285ef1590d5","observation_id":"5ff49fe2-80b8-4097-9259-41c965a017e3","resolution":{"observed_at":"2026-08-03T02:34:18.912953Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/1801.06146/citation-record","integrity":"/paper/1801.06146/integrity","json":"/paper/1801.06146/citation-record.json","paper":"/paper/1801.06146"},"outbound":[],"paper":{"arxiv_id":"1801.06146","last_updated":"2018-05-23T09:23:47Z","latest_version":5,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-14T19:54:00.470999Z","submitted_at":"2018-01-18T17:54:52Z","title":"Universal Language Model Fine-tuning for Text Classification"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"thesis":"As of 22 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 100 inbound Pith citation observations for arXiv:1801.06146."}