{"as_of":"2026-08-07T20:59:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:0eddb70967680b2991d843bff985f90764e9e341b10ad5a0bb1adc6e148e27d5","coverage":[{"denominator":154,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":100,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T17:03:41.807106Z","state":"measured"},{"denominator":100,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":100,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2507.12004/citation-record","integrity":"/paper/2507.12004/integrity","json":"/paper/2507.12004/citation-record.json","paper":"/paper/2507.12004"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:03:33.673054Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.12004","last_updated":"2025-07-16T07:58:20Z","snapshot_observed_at":"2026-08-07T12:43:44.020373Z","submitted_at":"2025-07-16T07:58:20Z","title":"Improving Data and Parameter Efficiency of Neural Language Models Using Representation Analysis","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-06T17:03:33.673054Z"},"links":{"citing_paper":"/paper/2507.12004"},"observation_digest":"sha256:2352ef56ad3c425a6503c66bbae10d014c0defaa3c18a59285f4b192f8935784","observation_id":"289356ac-2421-4732-8254-d3823e43ba82","resolution":{"observed_at":"2026-08-06T17:03:33.673054Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:03:33.789251Z","title":"S., ``Distributional structure'', Word, Vol","venue":null,"work_id":null,"year":1954},"citing_paper":{"arxiv_id":"2507.12004","last_updated":"2025-07-16T07:58:20Z","snapshot_observed_at":"2026-08-07T12:43:44.020373Z","submitted_at":"2025-07-16T07:58:20Z","title":"Improving Data and Parameter Efficiency of Neural Language Models Using Representation Analysis","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-06T17:03:33.789251Z"},"links":{"citing_paper":"/paper/2507.12004"},"observation_digest":"sha256:20228e637c487862634dc556241e90831b4ced769e3e4e9d7a19727e1415413f","observation_id":"ca331fb5-f7bd-4b18-b72b-57991971cfd8","resolution":{"observed_at":"2026-08-06T17:03:33.789251Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:03:33.844883Z","title":"R., ``A synopsis of linguistic theory, 1930-1955'', Studies in linguistic analysis, 1957","venue":null,"work_id":null,"year":1930},"citing_paper":{"arxiv_id":"2507.12004","last_updated":"2025-07-16T07:58:20Z","snapshot_observed_at":"2026-08-07T12:43:44.020373Z","submitted_at":"2025-07-16T07:58:20Z","title":"Improving Data and Parameter Efficiency of Neural Language Models Using Representation Analysis","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-06T17:03:33.844883Z"},"links":{"citing_paper":"/paper/2507.12004"},"observation_digest":"sha256:9cf4fcfbfccb940bac656b6dd5ffbd63ca8e8a1204539929e6a7c23d37b00bd3","observation_id":"59785707-6de3-483e-8a0a-fe41daad9228","resolution":{"observed_at":"2026-08-06T17:03:33.844883Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:03:33.888182Z","title":"D., Pantel, P., ``From frequency to meaning: Vector space models of semantics'', Journal of artificial intelligence research, Vol","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2507.12004","last_updated":"2025-07-16T07:58:20Z","snapshot_observed_at":"2026-08-07T12:43:44.020373Z","submitted_at":"2025-07-16T07:58:20Z","title":"Improving Data and Parameter Efficiency of Neural Language Models Using Representation Analysis","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-06T17:03:33.888182Z"},"links":{"citing_paper":"/paper/2507.12004"},"observation_digest":"sha256:72e5d8649926b775229ec261bba2198a610af84f314a4bc1211a0341a8ab257c","observation_id":"4bdf2ae8-f5db-4bf2-a393-bfeacf693266","resolution":{"observed_at":"2026-08-06T17:03:33.888182Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:03:33.943267Z","title":"160--167","venue":null,"work_id":null,"year":2008},"citing_paper":{"arxiv_id":"2507.12004","last_updated":"2025-07-16T07:58:20Z","snapshot_observed_at":"2026-08-07T12:43:44.020373Z","submitted_at":"2025-07-16T07:58:20Z","title":"Improving Data and Parameter Efficiency of Neural Language Models Using Representation Analysis","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-06T17:03:33.943267Z"},"links":{"citing_paper":"/paper/2507.12004"},"observation_digest":"sha256:268e9965cc9290837d288d2471c3b9376889ab05c273060c0ec23ea1e5530146","observation_id":"3b67ecac-5c23-4fec-9305-d606e2ec9ca8","resolution":{"observed_at":"2026-08-06T17:03:33.943267Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:03:33.973118Z","title":null,"venue":null,"work_id":null,"year":1956},"citing_paper":{"arxiv_id":"2507.12004","last_updated":"2025-07-16T07:58:20Z","snapshot_observed_at":"2026-08-07T12:43:44.020373Z","submitted_at":"2025-07-16T07:58:20Z","title":"Improving Data and Parameter Efficiency of Neural Language Models Using Representation Analysis","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-06T17:03:33.973118Z"},"links":{"citing_paper":"/paper/2507.12004"},"observation_digest":"sha256:dfd04ef73318afae66e9d97037a59d2da56e254326f96718ce247d6b1e423afb","observation_id":"3990ca1c-934c-442b-a735-2fd1e1cbd8f0","resolution":{"observed_at":"2026-08-06T17:03:33.973118Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:03:34.032523Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.12004","last_updated":"2025-07-16T07:58:20Z","snapshot_observed_at":"2026-08-07T12:43:44.020373Z","submitted_at":"2025-07-16T07:58:20Z","title":"Improving Data and Parameter Efficiency of Neural Language Models Using Representation Analysis","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-06T17:03:34.032523Z"},"links":{"citing_paper":"/paper/2507.12004"},"observation_digest":"sha256:88c0641e7246a355581f2673d6671a290f8362ce954873b7682dba7506f50960","observation_id":"e91724f0-dc6c-4d41-8c70-53ede2817812","resolution":{"observed_at":"2026-08-06T17:03:34.032523Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2001.08361","last_updated":"2020-01-23T03:59:20Z","snapshot_observed_at":"2026-07-06T08:52:12.656082Z","submitted_at":"2020-01-23T03:59:20Z","title":"Scaling Laws for Neural Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2001.08361","snapshot_observed_at":"2026-08-06T17:03:34.094408Z","title":"B., Chess, B., Child, R., Gray, S., Radford, A., Wu, J., Amodei, D., ``Scaling laws for neural language models'', arXiv preprint arXiv:2001.08361, 2020","venue":null,"work_id":null,"year":2001},"citing_paper":{"arxiv_id":"2507.12004","last_updated":"2025-07-16T07:58:20Z","snapshot_observed_at":"2026-08-07T12:43:44.020373Z","submitted_at":"2025-07-16T07:58:20Z","title":"Improving Data and Parameter Efficiency of Neural Language Models Using Representation Analysis","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-06T17:03:34.094408Z"},"links":{"cited_paper":"/paper/2001.08361","citing_paper":"/paper/2507.12004"},"observation_digest":"sha256:c3735993f72f37fb3aab29b08e2410ed594d4fcf4aae6eba2a560297a954b1d6","observation_id":"38240ac7-5952-4ad1-bd90-0e45f90f4e8f","resolution":{"observed_at":"2026-08-06T17:03:34.094408Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:03:34.164671Z","title":"A., Welbl, J., Clark, A., Hennigan, T., Noland, E., Millican, K., van den Driessche, G., Damoc, B., Guy, A., Osindero, S., Simonyan, K., Elsen, E., Vinyals, O., Rae, J","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.12004","last_updated":"2025-07-16T07:58:20Z","snapshot_observed_at":"2026-08-07T12:43:44.020373Z","submitted_at":"2025-07-16T07:58:20Z","title":"Improving Data and Parameter Efficiency of Neural Language Models Using Representation Analysis","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-06T17:03:34.164671Z"},"links":{"citing_paper":"/paper/2507.12004"},"observation_digest":"sha256:330f91f4c3335bbc293ffa51c604cc64937247e1a493bb9e938becb7b189bf71","observation_id":"a2053e13-0afd-494c-9355-244fdce93562","resolution":{"observed_at":"2026-08-06T17:03:34.164671Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:03:34.228472Z","title":null,"venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2507.12004","last_updated":"2025-07-16T07:58:20Z","snapshot_observed_at":"2026-08-07T12:43:44.020373Z","submitted_at":"2025-07-16T07:58:20Z","title":"Improving Data and Parameter Efficiency of Neural Language Models Using Representation Analysis","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-06T17:03:34.228472Z"},"links":{"citing_paper":"/paper/2507.12004"},"observation_digest":"sha256:f2e7bd55facdfab56302ded81b1ce6a4e6a177c61d0c360b2e212f469c9790dc","observation_id":"9f302873-a43f-4010-b2df-aa81340d9a6e","resolution":{"observed_at":"2026-08-06T17:03:34.228472Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2202.05433","last_updated":"2022-02-14T05:45:58Z","snapshot_observed_at":"2026-07-06T12:36:41.820948Z","submitted_at":"2022-02-11T04:05:38Z","title":"A Survey on Programmatic Weak Supervision","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2202.05433","snapshot_observed_at":"2026-08-06T17:03:34.278926Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.12004","last_updated":"2025-07-16T07:58:20Z","snapshot_observed_at":"2026-08-07T12:43:44.020373Z","submitted_at":"2025-07-16T07:58:20Z","title":"Improving Data and Parameter Efficiency of Neural Language Models Using Representation Analysis","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-06T17:03:34.278926Z"},"links":{"cited_paper":"/paper/2202.05433","citing_paper":"/paper/2507.12004"},"observation_digest":"sha256:b2f51c7e61503e3b737a85a2ceec87c88b9b3049dc799af6daaf3a83d8b4aefd","observation_id":"8895219a-0088-4aa9-bb5b-69cb83900c4d","resolution":{"observed_at":"2026-08-06T17:03:34.278926Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.06435","last_updated":"2024-10-17T01:10:40Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-07-12T20:01:52Z","title":"A Comprehensive Overview of Large Language Models","version":10},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.06435","snapshot_observed_at":"2026-08-06T17:03:34.344514Z","title":"U., Qiu, S., Saqib, M., Anwar, S., Usman, M., Akhtar, N., Barnes, N., Mian, A., ``A comprehensive overview of large language models'', arXiv preprint arXiv:2307.06435, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.12004","last_updated":"2025-07-16T07:58:20Z","snapshot_observed_at":"2026-08-07T12:43:44.020373Z","submitted_at":"2025-07-16T07:58:20Z","title":"Improving Data and Parameter Efficiency of Neural Language Models Using Representation Analysis","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-06T17:03:34.344514Z"},"links":{"cited_paper":"/paper/2307.06435","citing_paper":"/paper/2507.12004"},"observation_digest":"sha256:6d0c96e71112907556c475a56eb6f4b4834d96900b558ee448adf89343f72806","observation_id":"2160801b-1cb7-4e7c-a7d6-cde69f90c90f","resolution":{"observed_at":"2026-08-06T17:03:34.344514Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:03:34.391751Z","title":"A., Introduction to formal language theory","venue":null,"work_id":null,"year":1978},"citing_paper":{"arxiv_id":"2507.12004","last_updated":"2025-07-16T07:58:20Z","snapshot_observed_at":"2026-08-07T12:43:44.020373Z","submitted_at":"2025-07-16T07:58:20Z","title":"Improving Data and Parameter Efficiency of Neural Language Models Using Representation Analysis","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-06T17:03:34.391751Z"},"links":{"citing_paper":"/paper/2507.12004"},"observation_digest":"sha256:36556e603d3282df9d5a00ce25f71d9dfa65b9fbc19e63d653e19b2b74b51bb3","observation_id":"56187646-979e-4fb5-abec-e231d3bcc80c","resolution":{"observed_at":"2026-08-06T17:03:34.391751Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:03:34.450484Z","title":null,"venue":null,"work_id":null,"year":2007},"citing_paper":{"arxiv_id":"2507.12004","last_updated":"2025-07-16T07:58:20Z","snapshot_observed_at":"2026-08-07T12:43:44.020373Z","submitted_at":"2025-07-16T07:58:20Z","title":"Improving Data and Parameter Efficiency of Neural Language Models Using Representation Analysis","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-06T17:03:34.450484Z"},"links":{"citing_paper":"/paper/2507.12004"},"observation_digest":"sha256:747d1a88d49e37179b32c218364f7f1908f29c389658025ef4781decf05b5724","observation_id":"dbcb60c0-4de8-4a3d-baa4-2197551a4e53","resolution":{"observed_at":"2026-08-06T17:03:34.450484Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:03:34.525529Z","title":"T., Furnas, G","venue":null,"work_id":null,"year":1990},"citing_paper":{"arxiv_id":"2507.12004","last_updated":"2025-07-16T07:58:20Z","snapshot_observed_at":"2026-08-07T12:43:44.020373Z","submitted_at":"2025-07-16T07:58:20Z","title":"Improving Data and Parameter Efficiency of Neural Language Models Using Representation Analysis","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-06T17:03:34.525529Z"},"links":{"citing_paper":"/paper/2507.12004"},"observation_digest":"sha256:ea66e7c9c26a4945a3d43428aa045f19db5bd8661315d59bf73c9f2a1c6ca25d","observation_id":"de37e70b-ccb4-4930-878b-cdd4a679b8b3","resolution":{"observed_at":"2026-08-06T17:03:34.525529Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:03:34.586726Z","title":"K., Foltz, P","venue":null,"work_id":null,"year":1998},"citing_paper":{"arxiv_id":"2507.12004","last_updated":"2025-07-16T07:58:20Z","snapshot_observed_at":"2026-08-07T12:43:44.020373Z","submitted_at":"2025-07-16T07:58:20Z","title":"Improving Data and Parameter Efficiency of Neural Language Models Using Representation Analysis","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-06T17:03:34.586726Z"},"links":{"citing_paper":"/paper/2507.12004"},"observation_digest":"sha256:cbfb0e28927a3472edbf5dcb1d42faf485e97bf5f7449cb6279d5e05a36bee2c","observation_id":"4bee7813-795b-44a6-a478-6c1688659bd1","resolution":{"observed_at":"2026-08-06T17:03:34.586726Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:03:34.678987Z","title":"S., Dean, J., ``Distributed representations of words and phrases and their compositionality'', in Advances in neural information processing systems, 2013, str","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2507.12004","last_updated":"2025-07-16T07:58:20Z","snapshot_observed_at":"2026-08-07T12:43:44.020373Z","submitted_at":"2025-07-16T07:58:20Z","title":"Improving Data and Parameter Efficiency of Neural Language Models Using Representation Analysis","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-06T17:03:34.678987Z"},"links":{"citing_paper":"/paper/2507.12004"},"observation_digest":"sha256:93852616240576c5ad411ec18b17d0b5c80cc68738f9456115aa65e504f1f646","observation_id":"c2fe1d8b-c493-4f3c-a1d4-525966d6a07e","resolution":{"observed_at":"2026-08-06T17:03:34.678987Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:03:34.749945Z","title":"D., `` GloVe : Global vectors for word representation'', in Proceedings of the 2014 conference on empirical methods in natural language processing (EMNLP), 2014, str","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2507.12004","last_updated":"2025-07-16T07:58:20Z","snapshot_observed_at":"2026-08-07T12:43:44.020373Z","submitted_at":"2025-07-16T07:58:20Z","title":"Improving Data and Parameter Efficiency of Neural Language Models Using Representation Analysis","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-06T17:03:34.749945Z"},"links":{"citing_paper":"/paper/2507.12004"},"observation_digest":"sha256:d70307731745b6e423a5833c0157dd7aa197fb87994c1cba21bf4901def02271","observation_id":"056471fc-8672-4e9b-9904-e5466e1ea079","resolution":{"observed_at":"2026-08-06T17:03:34.749945Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1301.3781","last_updated":"2013-09-07T00:30:40Z","snapshot_observed_at":"2026-07-06T03:04:11.148340Z","submitted_at":"2013-01-16T18:24:43Z","title":"Efficient Estimation of Word Representations in Vector Space","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1301.3781","snapshot_observed_at":"2026-08-06T17:03:34.795941Z","title":null,"venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2507.12004","last_updated":"2025-07-16T07:58:20Z","snapshot_observed_at":"2026-08-07T12:43:44.020373Z","submitted_at":"2025-07-16T07:58:20Z","title":"Improving Data and Parameter Efficiency of Neural Language Models Using Representation Analysis","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-06T17:03:34.795941Z"},"links":{"cited_paper":"/paper/1301.3781","citing_paper":"/paper/2507.12004"},"observation_digest":"sha256:8b3ce7a9e980ce5b2b32f478206632a92138cf934d1cef00c4471c7ab81cd4ae","observation_id":"7b0a5c93-03be-4639-a19e-5c2b6ae0df71","resolution":{"observed_at":"2026-08-06T17:03:34.795941Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:03:34.899788Z","title":"F., Della Pietra, V","venue":null,"work_id":null,"year":1992},"citing_paper":{"arxiv_id":"2507.12004","last_updated":"2025-07-16T07:58:20Z","snapshot_observed_at":"2026-08-07T12:43:44.020373Z","submitted_at":"2025-07-16T07:58:20Z","title":"Improving Data and Parameter Efficiency of Neural Language Models Using Representation Analysis","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-06T17:03:34.899788Z"},"links":{"citing_paper":"/paper/2507.12004"},"observation_digest":"sha256:7e2233e6047eafc04beb9f4a18a645de68ac0d8d285574664024b77db1040e2f","observation_id":"7556ace1-9a45-4532-b201-ed82b864b209","resolution":{"observed_at":"2026-08-06T17:03:34.899788Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:03:34.942908Z","title":"E., Hinton, G","venue":null,"work_id":null,"year":1986},"citing_paper":{"arxiv_id":"2507.12004","last_updated":"2025-07-16T07:58:20Z","snapshot_observed_at":"2026-08-07T12:43:44.020373Z","submitted_at":"2025-07-16T07:58:20Z","title":"Improving Data and Parameter Efficiency of Neural Language Models Using Representation Analysis","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-06T17:03:34.942908Z"},"links":{"citing_paper":"/paper/2507.12004"},"observation_digest":"sha256:8d2cbcddd5e12e52e84ad95eb64924b9a3a25924fc52e5745eebcfe0f41c1c81","observation_id":"49b1a27d-e8e1-4254-80a0-677ab888ad8f","resolution":{"observed_at":"2026-08-06T17:03:34.942908Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:03:34.993671Z","title":"technical report, june 1985-march 1986'', California Univ., San Diego, La Jolla (USA)","venue":null,"work_id":null,"year":1985},"citing_paper":{"arxiv_id":"2507.12004","last_updated":"2025-07-16T07:58:20Z","snapshot_observed_at":"2026-08-07T12:43:44.020373Z","submitted_at":"2025-07-16T07:58:20Z","title":"Improving Data and Parameter Efficiency of Neural Language Models Using Representation Analysis","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-06T17:03:34.993671Z"},"links":{"citing_paper":"/paper/2507.12004"},"observation_digest":"sha256:a33037465375d109081d6679b3aa7f1b1c9b49db31f9f99762e467fffede4fa7","observation_id":"a2cae26c-e3d5-40bc-aecf-c596c7d382b6","resolution":{"observed_at":"2026-08-06T17:03:34.993671Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:03:35.056414Z","title":null,"venue":null,"work_id":null,"year":1997},"citing_paper":{"arxiv_id":"2507.12004","last_updated":"2025-07-16T07:58:20Z","snapshot_observed_at":"2026-08-07T12:43:44.020373Z","submitted_at":"2025-07-16T07:58:20Z","title":"Improving Data and Parameter Efficiency of Neural Language Models Using Representation Analysis","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-06T17:03:35.056414Z"},"links":{"citing_paper":"/paper/2507.12004"},"observation_digest":"sha256:9f27ce046ea6a02042af2623357d982fa7e791935c4e5221e001ea1aa93acb11","observation_id":"63190537-0124-4977-a0d1-a98fdeb50b3e","resolution":{"observed_at":"2026-08-06T17:03:35.056414Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1406.1078","last_updated":"2014-09-03T00:25:02Z","snapshot_observed_at":"2026-07-06T03:45:28.546418Z","submitted_at":"2014-06-03T17:47:08Z","title":"Learning Phrase Representations using RNN Encoder-Decoder for Statistical Machine Translation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1406.1078","snapshot_observed_at":"2026-08-06T17:03:35.105877Z","title":null,"venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2507.12004","last_updated":"2025-07-16T07:58:20Z","snapshot_observed_at":"2026-08-07T12:43:44.020373Z","submitted_at":"2025-07-16T07:58:20Z","title":"Improving Data and Parameter Efficiency of Neural Language Models Using Representation Analysis","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-06T17:03:35.105877Z"},"links":{"cited_paper":"/paper/1406.1078","citing_paper":"/paper/2507.12004"},"observation_digest":"sha256:b21ab298670386bf039c5d7d297444e662282da2748ceef29d6f5d2f6156abcb","observation_id":"62b488c1-7f5b-4a35-8f15-7693599455eb","resolution":{"observed_at":"2026-08-06T17:03:35.105877Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:03:35.162776Z","title":"N., Kaiser, ., Polosukhin, I., ``Attention is all you need'', Advances in neural information processing systems, Vol","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2507.12004","last_updated":"2025-07-16T07:58:20Z","snapshot_observed_at":"2026-08-07T12:43:44.020373Z","submitted_at":"2025-07-16T07:58:20Z","title":"Improving Data and Parameter Efficiency of Neural Language Models Using Representation Analysis","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-06T17:03:35.162776Z"},"links":{"citing_paper":"/paper/2507.12004"},"observation_digest":"sha256:74d7f8bd1826d9444721704328dbbf7447d067e412bd6ae03311831ec8590e5f","observation_id":"e2b36ef6-6832-42de-8dbe-fa435b363f7f","resolution":{"observed_at":"2026-08-06T17:03:35.162776Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1409.0473","last_updated":"2016-05-19T21:53:22Z","snapshot_observed_at":"2026-07-06T03:53:10.336430Z","submitted_at":"2014-09-01T16:33:02Z","title":"Neural Machine Translation by Jointly Learning to Align and Translate","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1409.0473","snapshot_observed_at":"2026-08-06T17:03:35.226657Z","title":null,"venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2507.12004","last_updated":"2025-07-16T07:58:20Z","snapshot_observed_at":"2026-08-07T12:43:44.020373Z","submitted_at":"2025-07-16T07:58:20Z","title":"Improving Data and Parameter Efficiency of Neural Language Models Using Representation Analysis","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-06T17:03:35.226657Z"},"links":{"cited_paper":"/paper/1409.0473","citing_paper":"/paper/2507.12004"},"observation_digest":"sha256:173151eaed075f619470a5d22861e2a2099567620bb1bf4884e96089ce93f4b4","observation_id":"aef36a43-430e-43ed-8a8e-2d5f498a5a40","resolution":{"observed_at":"2026-08-06T17:03:35.226657Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:03:35.244512Z","title":"D., ``Effective approaches to attention-based neural machine translation'', in Proceedings of the 2015 Conference on Empirical Methods in Natural Language Processing","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2507.12004","last_updated":"2025-07-16T07:58:20Z","snapshot_observed_at":"2026-08-07T12:43:44.020373Z","submitted_at":"2025-07-16T07:58:20Z","title":"Improving Data and Parameter Efficiency of Neural Language Models Using Representation Analysis","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-06T17:03:35.244512Z"},"links":{"citing_paper":"/paper/2507.12004"},"observation_digest":"sha256:8869877cdde031a7b563736f557127cb5f2126717cfde6f811107676062f471c","observation_id":"97d18237-39af-414d-a88e-9b0524b9807a","resolution":{"observed_at":"2026-08-06T17:03:35.244512Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:03:35.250112Z","title":null,"venue":null,"work_id":null,"year":1951},"citing_paper":{"arxiv_id":"2507.12004","last_updated":"2025-07-16T07:58:20Z","snapshot_observed_at":"2026-08-07T12:43:44.020373Z","submitted_at":"2025-07-16T07:58:20Z","title":"Improving Data and Parameter Efficiency of Neural Language Models Using Representation Analysis","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-06T17:03:35.250112Z"},"links":{"citing_paper":"/paper/2507.12004"},"observation_digest":"sha256:d3a365558715a5226681f6370f35c7770b574b93b2604bbce8623ec2a008c862","observation_id":"be9804f6-8364-4c85-8b5c-1947105fccb2","resolution":{"observed_at":"2026-08-06T17:03:35.250112Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1412.6980","last_updated":"2017-01-30T01:27:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2014-12-22T13:54:29Z","title":"Adam: A Method for Stochastic Optimization","version":9},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1412.6980","snapshot_observed_at":"2026-08-06T17:03:35.300595Z","title":null,"venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2507.12004","last_updated":"2025-07-16T07:58:20Z","snapshot_observed_at":"2026-08-07T12:43:44.020373Z","submitted_at":"2025-07-16T07:58:20Z","title":"Improving Data and Parameter Efficiency of Neural Language Models Using Representation Analysis","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-06T17:03:35.300595Z"},"links":{"cited_paper":"/paper/1412.6980","citing_paper":"/paper/2507.12004"},"observation_digest":"sha256:86fd4628fb7e1417376bde6106ce3e63f68d889918d54f6a9336776c65b4430d","observation_id":"a7a0570b-63fa-47e6-9f09-6a3dbf49010f","resolution":{"observed_at":"2026-08-06T17:03:35.300595Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:03:35.379446Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2507.12004","last_updated":"2025-07-16T07:58:20Z","snapshot_observed_at":"2026-08-07T12:43:44.020373Z","submitted_at":"2025-07-16T07:58:20Z","title":"Improving Data and Parameter Efficiency of Neural Language Models Using Representation Analysis","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-06T17:03:35.379446Z"},"links":{"citing_paper":"/paper/2507.12004"},"observation_digest":"sha256:48dcd29d7b5ab74000db2e1eee382010c82a35052ee7c41347538849c243eddc","observation_id":"5044f1e5-d062-4960-89cd-7f73ba35937f","resolution":{"observed_at":"2026-08-06T17:03:35.379446Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:03:35.497074Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.12004","last_updated":"2025-07-16T07:58:20Z","snapshot_observed_at":"2026-08-07T12:43:44.020373Z","submitted_at":"2025-07-16T07:58:20Z","title":"Improving Data and Parameter Efficiency of Neural Language Models Using Representation Analysis","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-06T17:03:35.497074Z"},"links":{"citing_paper":"/paper/2507.12004"},"observation_digest":"sha256:beb3611229aa65a87c1ffe71caa68b93ab4a17f111ea70320b25c49ebd4e248b","observation_id":"ee833f53-c64c-41ea-8e9a-231da68827e4","resolution":{"observed_at":"2026-08-06T17:03:35.497074Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:03:35.576343Z","title":"A., ``Don ' t stop pretraining: Adapt language models to domains and tasks'', in Proceedings of the 58th Annual Meeting of the Association for Computational Linguistics","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.12004","last_updated":"2025-07-16T07:58:20Z","snapshot_observed_at":"2026-08-07T12:43:44.020373Z","submitted_at":"2025-07-16T07:58:20Z","title":"Improving Data and Parameter Efficiency of Neural Language Models Using Representation Analysis","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-06T17:03:35.576343Z"},"links":{"citing_paper":"/paper/2507.12004"},"observation_digest":"sha256:e2845862b6f543d02e20a9d9fd2327cbfe61a286f63afaf8bf67b511c8aa5b9f","observation_id":"aecd9ae7-00b5-4f71-876d-97889c07a35f","resolution":{"observed_at":"2026-08-06T17:03:35.576343Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:03:35.694077Z","title":"Minneapolis, Minnesota: Association for Computational Linguistics, Jun","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2507.12004","last_updated":"2025-07-16T07:58:20Z","snapshot_observed_at":"2026-08-07T12:43:44.020373Z","submitted_at":"2025-07-16T07:58:20Z","title":"Improving Data and Parameter Efficiency of Neural Language Models Using Representation Analysis","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-06T17:03:35.694077Z"},"links":{"citing_paper":"/paper/2507.12004"},"observation_digest":"sha256:e55c3e26b47e6657a3aa2e1f22ec20d38a9bfb91dbaa5b7531685146768f481f","observation_id":"78b50b41-ae2d-4b69-a100-1f5e46dd080b","resolution":{"observed_at":"2026-08-06T17:03:35.694077Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:03:35.744918Z","title":"V., Manning, C","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.12004","last_updated":"2025-07-16T07:58:20Z","snapshot_observed_at":"2026-08-07T12:43:44.020373Z","submitted_at":"2025-07-16T07:58:20Z","title":"Improving Data and Parameter Efficiency of Neural Language Models Using Representation Analysis","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-06T17:03:35.744918Z"},"links":{"citing_paper":"/paper/2507.12004"},"observation_digest":"sha256:a9e633134e8fcd30c610e629c485a6911d0b23b71dc45170ca7bb5e0356b70b9","observation_id":"acdf7ee0-799b-4aad-a784-c4f708178b08","resolution":{"observed_at":"2026-08-06T17:03:35.744918Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:03:35.870971Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2507.12004","last_updated":"2025-07-16T07:58:20Z","snapshot_observed_at":"2026-08-07T12:43:44.020373Z","submitted_at":"2025-07-16T07:58:20Z","title":"Improving Data and Parameter Efficiency of Neural Language Models Using Representation Analysis","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-06T17:03:35.870971Z"},"links":{"citing_paper":"/paper/2507.12004"},"observation_digest":"sha256:6475d978c03e621a0dbb1783ad733d074e6289a33e195819c4a73dc8e6dc106b","observation_id":"c89b2ffd-a291-443e-b25e-bc65d6c660a5","resolution":{"observed_at":"2026-08-06T17:03:35.870971Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:03:35.969695Z","title":"J., ``Exploring the limits of transfer learning with a unified text-to-text transformer'', Journal of machine learning research, Vol","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.12004","last_updated":"2025-07-16T07:58:20Z","snapshot_observed_at":"2026-08-07T12:43:44.020373Z","submitted_at":"2025-07-16T07:58:20Z","title":"Improving Data and Parameter Efficiency of Neural Language Models Using Representation Analysis","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-06T17:03:35.969695Z"},"links":{"citing_paper":"/paper/2507.12004"},"observation_digest":"sha256:04e88a70e2c9c3f85c508d4963b1b00cdcad5fd7e2912576fba8fe6e013fc29e","observation_id":"9f2ad892-87bb-4714-90b4-f0436ed71e07","resolution":{"observed_at":"2026-08-06T17:03:35.969695Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:03:36.107154Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.12004","last_updated":"2025-07-16T07:58:20Z","snapshot_observed_at":"2026-08-07T12:43:44.020373Z","submitted_at":"2025-07-16T07:58:20Z","title":"Improving Data and Parameter Efficiency of Neural Language Models Using Representation Analysis","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-06T17:03:36.107154Z"},"links":{"citing_paper":"/paper/2507.12004"},"observation_digest":"sha256:4e41bdccbcddefbecca1d409ccde4d11aecfcc4dd4d52c50222e84fa0daef4d2","observation_id":"33089467-9a50-4984-a767-4c01ab186841","resolution":{"observed_at":"2026-08-06T17:03:36.107154Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2205.01068","last_updated":"2022-06-21T17:04:40Z","snapshot_observed_at":"2026-08-06T03:13:37.403059Z","submitted_at":"2022-05-02T17:49:50Z","title":"OPT: Open Pre-trained Transformer Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.01068","snapshot_observed_at":"2026-08-06T17:03:36.169483Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.12004","last_updated":"2025-07-16T07:58:20Z","snapshot_observed_at":"2026-08-07T12:43:44.020373Z","submitted_at":"2025-07-16T07:58:20Z","title":"Improving Data and Parameter Efficiency of Neural Language Models Using Representation Analysis","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-06T17:03:36.169483Z"},"links":{"cited_paper":"/paper/2205.01068","citing_paper":"/paper/2507.12004"},"observation_digest":"sha256:dbf442f4c9fa443ea8baaeef4bcd5b212f921f9042997213c2ca4ec79a2ddcad","observation_id":"2e02956f-3db9-4e8d-a99f-edfeed46a7a1","resolution":{"observed_at":"2026-08-06T17:03:36.169483Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-06T17:03:36.352751Z","title":"F., ``The L lama 3 herd of models'', https://arxiv.org/abs/2407.21783 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.12004","last_updated":"2025-07-16T07:58:20Z","snapshot_observed_at":"2026-08-07T12:43:44.020373Z","submitted_at":"2025-07-16T07:58:20Z","title":"Improving Data and Parameter Efficiency of Neural Language Models Using Representation Analysis","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-06T17:03:36.352751Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2507.12004"},"observation_digest":"sha256:b37c8ebd4cbde7c320e8964c52a9d6777842af03b51b4179e5818f888563f648","observation_id":"78635bb7-ebc3-4549-aebc-817fd5df934c","resolution":{"observed_at":"2026-08-06T17:03:36.352751Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.14219","last_updated":"2024-08-30T21:17:17Z","snapshot_observed_at":"2026-07-06T18:03:47.096406Z","submitted_at":"2024-04-22T14:32:33Z","title":"Phi-3 Technical Report: A Highly Capable Language Model Locally on Your Phone","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.14219","snapshot_observed_at":"2026-08-06T17:03:36.401418Z","title":"A., Bach, N., Bahree, A., Bakhtiari, A., Bao, J., et al., H","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.12004","last_updated":"2025-07-16T07:58:20Z","snapshot_observed_at":"2026-08-07T12:43:44.020373Z","submitted_at":"2025-07-16T07:58:20Z","title":"Improving Data and Parameter Efficiency of Neural Language Models Using Representation Analysis","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-06T17:03:36.401418Z"},"links":{"cited_paper":"/paper/2404.14219","citing_paper":"/paper/2507.12004"},"observation_digest":"sha256:413c1a278fbf5c36529edf15f9c95dcb47054585c5017cfbe1730fe93b2a4341","observation_id":"c75a296b-b8a6-403a-93e6-ab98304ef1a6","resolution":{"observed_at":"2026-08-06T17:03:36.401418Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:03:36.588655Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2507.12004","last_updated":"2025-07-16T07:58:20Z","snapshot_observed_at":"2026-08-07T12:43:44.020373Z","submitted_at":"2025-07-16T07:58:20Z","title":"Improving Data and Parameter Efficiency of Neural Language Models Using Representation Analysis","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-06T17:03:36.588655Z"},"links":{"citing_paper":"/paper/2507.12004"},"observation_digest":"sha256:bbba8fe8f76de141ed7b4a22f8713b6363a1a6c5106c37bd67a8415951581ca3","observation_id":"4e891f2e-c1a1-44c4-af3b-9ea31eea95f0","resolution":{"observed_at":"2026-08-06T17:03:36.588655Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:03:36.652821Z","title":"Florence, Italy: Association for Computational Linguistics, Jul","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2507.12004","last_updated":"2025-07-16T07:58:20Z","snapshot_observed_at":"2026-08-07T12:43:44.020373Z","submitted_at":"2025-07-16T07:58:20Z","title":"Improving Data and Parameter Efficiency of Neural Language Models Using Representation Analysis","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-06T17:03:36.652821Z"},"links":{"citing_paper":"/paper/2507.12004"},"observation_digest":"sha256:8bc13676db5ae3a0f3a31b281212cc8475cfa3cb67841b31454e69824fe6b550","observation_id":"f3925865-4e29-4254-9a27-8bc40bbe30f0","resolution":{"observed_at":"2026-08-06T17:03:36.652821Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:03:36.726700Z","title":"Singapore: Association for Computational Linguistics, Dec","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.12004","last_updated":"2025-07-16T07:58:20Z","snapshot_observed_at":"2026-08-07T12:43:44.020373Z","submitted_at":"2025-07-16T07:58:20Z","title":"Improving Data and Parameter Efficiency of Neural Language Models Using Representation Analysis","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-06T17:03:36.726700Z"},"links":{"citing_paper":"/paper/2507.12004"},"observation_digest":"sha256:48035ca89c7477a9a1f30ba49a44ebc0cc537534dc52bf036212f787951443a9","observation_id":"b45528fa-28d0-4b01-aa7f-3be63d48a0cb","resolution":{"observed_at":"2026-08-06T17:03:36.726700Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:03:36.818482Z","title":null,"venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2507.12004","last_updated":"2025-07-16T07:58:20Z","snapshot_observed_at":"2026-08-07T12:43:44.020373Z","submitted_at":"2025-07-16T07:58:20Z","title":"Improving Data and Parameter Efficiency of Neural Language Models Using Representation Analysis","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-06T17:03:36.818482Z"},"links":{"citing_paper":"/paper/2507.12004"},"observation_digest":"sha256:83741deb73a33b5c76bb56cd9ad01a6549b28f85e6a1e5ff0d8e561f855dd45f","observation_id":"bf5666e0-cc36-4d43-98ae-e38c0e52e804","resolution":{"observed_at":"2026-08-06T17:03:36.818482Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:03:36.877271Z","title":"Online: Association for Computational Linguistics, Jun","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.12004","last_updated":"2025-07-16T07:58:20Z","snapshot_observed_at":"2026-08-07T12:43:44.020373Z","submitted_at":"2025-07-16T07:58:20Z","title":"Improving Data and Parameter Efficiency of Neural Language Models Using Representation Analysis","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-06T17:03:36.877271Z"},"links":{"citing_paper":"/paper/2507.12004"},"observation_digest":"sha256:4207c7d650bfe6ef640dc1b7484d4d04a079d81ea5be3cf44ae774e9c5911578","observation_id":"ad4e5843-0ba6-4fb4-a741-7b3c8e57c4ef","resolution":{"observed_at":"2026-08-06T17:03:36.877271Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:03:37.000391Z","title":"Dublin, Ireland: Association for Computational Linguistics, May 2022, str","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.12004","last_updated":"2025-07-16T07:58:20Z","snapshot_observed_at":"2026-08-07T12:43:44.020373Z","submitted_at":"2025-07-16T07:58:20Z","title":"Improving Data and Parameter Efficiency of Neural Language Models Using Representation Analysis","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-06T17:03:37.000391Z"},"links":{"citing_paper":"/paper/2507.12004"},"observation_digest":"sha256:5efd5797a9c7cbf355773d1c9fb8c1efdee6a6938008c30564e6c9e9038885e0","observation_id":"37d4771b-f0f1-4907-9dae-0b86283a50ab","resolution":{"observed_at":"2026-08-06T17:03:37.000391Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2108.06332","last_updated":"2022-03-15T08:46:51Z","snapshot_observed_at":"2026-08-04T02:36:19.902290Z","submitted_at":"2021-08-13T17:51:31Z","title":"FlipDA: Effective and Robust Data Augmentation for Few-Shot Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2108.06332","snapshot_observed_at":"2026-08-06T17:03:37.099718Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.12004","last_updated":"2025-07-16T07:58:20Z","snapshot_observed_at":"2026-08-07T12:43:44.020373Z","submitted_at":"2025-07-16T07:58:20Z","title":"Improving Data and Parameter Efficiency of Neural Language Models Using Representation Analysis","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-06T17:03:37.099718Z"},"links":{"cited_paper":"/paper/2108.06332","citing_paper":"/paper/2507.12004"},"observation_digest":"sha256:86aa59fe1ee4d4b52ee108ac34f92ad587d4088ae0af7df77aa277b7f12738d5","observation_id":"339c28ef-0538-489f-9bad-ac93527818b8","resolution":{"observed_at":"2026-08-06T17:03:37.099718Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1908.02729","last_updated":"2019-08-07T17:04:26Z","snapshot_observed_at":"2026-08-02T17:37:17.740273Z","submitted_at":"2019-08-07T17:04:26Z","title":"Robust Learning with Jacobian Regularization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1908.02729","snapshot_observed_at":"2026-08-06T17:03:37.184201Z","title":"A., Yaida, S., ``Robust learning with J acobian regularization'', arXiv preprint arXiv:1908.02729, 2019","venue":null,"work_id":null,"year":1908},"citing_paper":{"arxiv_id":"2507.12004","last_updated":"2025-07-16T07:58:20Z","snapshot_observed_at":"2026-08-07T12:43:44.020373Z","submitted_at":"2025-07-16T07:58:20Z","title":"Improving Data and Parameter Efficiency of Neural Language Models Using Representation Analysis","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-06T17:03:37.184201Z"},"links":{"cited_paper":"/paper/1908.02729","citing_paper":"/paper/2507.12004"},"observation_digest":"sha256:1e16b122de3ee81327c45eadaca899809c95066792087742ad5f57545fe27114","observation_id":"7e954676-7388-4dac-bca8-23af43a6bf7b","resolution":{"observed_at":"2026-08-06T17:03:37.184201Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2009.06571","last_updated":"2020-09-14T16:58:16Z","snapshot_observed_at":"2026-08-06T01:55:59.768765Z","submitted_at":"2020-09-14T16:58:16Z","title":"Input Hessian Regularization of Neural Networks","version":1},"cited_work":{"arxiv_id":"2009.06571","doi":null,"metadata_source":"pith","pith_arxiv_id":"2009.06571","snapshot_observed_at":"2026-08-06T17:03:48.216517Z","title":"Input Hessian Regularization of Neural Networks","venue":"cs.LG","work_id":"13c0cc43-436a-4b89-b628-48c5fcf0081b","year":2020},"citing_paper":{"arxiv_id":"2507.12004","last_updated":"2025-07-16T07:58:20Z","snapshot_observed_at":"2026-08-07T12:43:44.020373Z","submitted_at":"2025-07-16T07:58:20Z","title":"Improving Data and Parameter Efficiency of Neural Language Models Using Representation Analysis","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-06T17:03:37.273271Z"},"links":{"cited_paper":"/paper/2009.06571","citing_paper":"/paper/2507.12004"},"observation_digest":"sha256:bcf69fad280d506fcda31710ba5972dde157da7646848f6d35a3497a37f1deb4","observation_id":"4889fd51-7108-403a-8903-1e49bae6c28b","resolution":{"observed_at":"2026-08-06T17:03:48.293671Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:03:37.362258Z","title":"M., Osindero, S., Jaderberg, M., Swirszcz, G., Pascanu, R., ``Sobolev training for neural networks'', Advances in neural information processing systems, Vol","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2507.12004","last_updated":"2025-07-16T07:58:20Z","snapshot_observed_at":"2026-08-07T12:43:44.020373Z","submitted_at":"2025-07-16T07:58:20Z","title":"Improving Data and Parameter Efficiency of Neural Language Models Using Representation Analysis","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-06T17:03:37.362258Z"},"links":{"citing_paper":"/paper/2507.12004"},"observation_digest":"sha256:b208babf97b5c720b01018484d030a095b8f93e1780671eacc94083b7c067a5a","observation_id":"21cce319-d17c-42fe-a81e-d86d7aa81da2","resolution":{"observed_at":"2026-08-06T17:03:37.362258Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:03:37.460425Z","title":"R., ``Robust large margin deep neural networks'', IEEE Transactions on Signal Processing, Vol","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2507.12004","last_updated":"2025-07-16T07:58:20Z","snapshot_observed_at":"2026-08-07T12:43:44.020373Z","submitted_at":"2025-07-16T07:58:20Z","title":"Improving Data and Parameter Efficiency of Neural Language Models Using Representation Analysis","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-06T17:03:37.460425Z"},"links":{"citing_paper":"/paper/2507.12004"},"observation_digest":"sha256:3217b67e42a9b6a77852364f0c9371e362837d2d78807fbf76fdc74e07666f42","observation_id":"42bb59e7-cf9c-4a92-b218-2a79031991a1","resolution":{"observed_at":"2026-08-06T17:03:37.460425Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:03:37.537092Z","title":null,"venue":null,"work_id":null,"year":1992},"citing_paper":{"arxiv_id":"2507.12004","last_updated":"2025-07-16T07:58:20Z","snapshot_observed_at":"2026-08-07T12:43:44.020373Z","submitted_at":"2025-07-16T07:58:20Z","title":"Improving Data and Parameter Efficiency of Neural Language Models Using Representation Analysis","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-06T17:03:37.537092Z"},"links":{"citing_paper":"/paper/2507.12004"},"observation_digest":"sha256:c6867dd5dbb7c512f8551621c0ee8a5fa706215aa23e9bf6fc23f87b5b54a0ac","observation_id":"2c0033fc-e39d-4fdc-9b88-1b57fd7a0d61","resolution":{"observed_at":"2026-08-06T17:03:37.537092Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:03:37.704254Z","title":"L., Foster, D","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2507.12004","last_updated":"2025-07-16T07:58:20Z","snapshot_observed_at":"2026-08-07T12:43:44.020373Z","submitted_at":"2025-07-16T07:58:20Z","title":"Improving Data and Parameter Efficiency of Neural Language Models Using Representation Analysis","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-06T17:03:37.704254Z"},"links":{"citing_paper":"/paper/2507.12004"},"observation_digest":"sha256:827a8aea2e47e7aaf9e8b57b3760e22498cb2522266a0ef8cb5a807d66afccf6","observation_id":"fe9cf606-22df-4612-97b3-36ce8f811d26","resolution":{"observed_at":"2026-08-06T17:03:37.704254Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:03:37.787561Z","title":"Q., ``On calibration of modern neural networks'', in International conference on machine learning","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2507.12004","last_updated":"2025-07-16T07:58:20Z","snapshot_observed_at":"2026-08-07T12:43:44.020373Z","submitted_at":"2025-07-16T07:58:20Z","title":"Improving Data and Parameter Efficiency of Neural Language Models Using Representation Analysis","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-06T17:03:37.787561Z"},"links":{"citing_paper":"/paper/2507.12004"},"observation_digest":"sha256:8b62d527c40bbe806e712f34ec0695564bb1e1ba5d12bd1e7b2bc15896f3196b","observation_id":"3ac846cd-9c91-4ac7-8928-39a984652bb1","resolution":{"observed_at":"2026-08-06T17:03:37.787561Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:03:37.846080Z","title":"W., ``Verification of forecasts expressed in terms of probability'', Monthly weather review, Vol","venue":null,"work_id":null,"year":1950},"citing_paper":{"arxiv_id":"2507.12004","last_updated":"2025-07-16T07:58:20Z","snapshot_observed_at":"2026-08-07T12:43:44.020373Z","submitted_at":"2025-07-16T07:58:20Z","title":"Improving Data and Parameter Efficiency of Neural Language Models Using Representation Analysis","version":1},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-06T17:03:37.846080Z"},"links":{"citing_paper":"/paper/2507.12004"},"observation_digest":"sha256:90b1718f047accc565419f53a8e851921cb66f3d17c701952de169f3967bcb7e","observation_id":"c95add4c-d853-412b-8653-ced0f1c36f15","resolution":{"observed_at":"2026-08-06T17:03:37.846080Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:03:37.990197Z","title":"H., Fienberg, S","venue":null,"work_id":null,"year":1983},"citing_paper":{"arxiv_id":"2507.12004","last_updated":"2025-07-16T07:58:20Z","snapshot_observed_at":"2026-08-07T12:43:44.020373Z","submitted_at":"2025-07-16T07:58:20Z","title":"Improving Data and Parameter Efficiency of Neural Language Models Using Representation Analysis","version":1},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-06T17:03:37.990197Z"},"links":{"citing_paper":"/paper/2507.12004"},"observation_digest":"sha256:d1677e76dd93cf542422dd8468977f6e228fa1101591b63ffeac0ac340cb7981","observation_id":"00054101-eda1-4cb6-bf82-3ebab28d8542","resolution":{"observed_at":"2026-08-06T17:03:37.990197Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:03:38.094313Z","title":"P., Cooper, G., Hauskrecht, M., ``Obtaining well calibrated probabilities using bayesian binning'', in Proceedings of the AAAI conference on artificial intelligence, Vol","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2507.12004","last_updated":"2025-07-16T07:58:20Z","snapshot_observed_at":"2026-08-07T12:43:44.020373Z","submitted_at":"2025-07-16T07:58:20Z","title":"Improving Data and Parameter Efficiency of Neural Language Models Using Representation Analysis","version":1},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-08-06T17:03:38.094313Z"},"links":{"citing_paper":"/paper/2507.12004"},"observation_digest":"sha256:ebec4a28bbd2f94ff3a70989663cdcdc0fcb566122c5d2c0aae63db6aa52526c","observation_id":"494f388f-0157-49f1-bd3c-4eb45da74426","resolution":{"observed_at":"2026-08-06T17:03:38.094313Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:03:38.203010Z","title":"et al., Principles of mathematical analysis","venue":null,"work_id":null,"year":1964},"citing_paper":{"arxiv_id":"2507.12004","last_updated":"2025-07-16T07:58:20Z","snapshot_observed_at":"2026-08-07T12:43:44.020373Z","submitted_at":"2025-07-16T07:58:20Z","title":"Improving Data and Parameter Efficiency of Neural Language Models Using Representation Analysis","version":1},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-08-06T17:03:38.203010Z"},"links":{"citing_paper":"/paper/2507.12004"},"observation_digest":"sha256:09e695bd087318b7ca1b76780290812d18ee534342504b353b0e93312d93b936","observation_id":"77089e80-1c2d-401e-bf13-5a0ded30b81e","resolution":{"observed_at":"2026-08-06T17:03:38.203010Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:03:38.362178Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.12004","last_updated":"2025-07-16T07:58:20Z","snapshot_observed_at":"2026-08-07T12:43:44.020373Z","submitted_at":"2025-07-16T07:58:20Z","title":"Improving Data and Parameter Efficiency of Neural Language Models Using Representation Analysis","version":1},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-08-06T17:03:38.362178Z"},"links":{"citing_paper":"/paper/2507.12004"},"observation_digest":"sha256:fd5beb51025106ec1bf3c64328e67a4acb8762ef874b26ad8ad107c12da4da02","observation_id":"f40c09f8-1433-4f94-bfa6-5bb93d6541b9","resolution":{"observed_at":"2026-08-06T17:03:38.362178Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:03:38.414443Z","title":"Springer Publishing Company, Incorporated, 2014","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2507.12004","last_updated":"2025-07-16T07:58:20Z","snapshot_observed_at":"2026-08-07T12:43:44.020373Z","submitted_at":"2025-07-16T07:58:20Z","title":"Improving Data and Parameter Efficiency of Neural Language Models Using Representation Analysis","version":1},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-08-06T17:03:38.414443Z"},"links":{"citing_paper":"/paper/2507.12004"},"observation_digest":"sha256:1ad3c6e60d7ef71be7c271f27096e1b417f67f96dcc75b1abb7f11a6ff56545b","observation_id":"a9eba6ee-d4bc-40df-a23e-ba97e7902f8f","resolution":{"observed_at":"2026-08-06T17:03:38.414443Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:03:38.514844Z","title":"35, 2022, str","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.12004","last_updated":"2025-07-16T07:58:20Z","snapshot_observed_at":"2026-08-07T12:43:44.020373Z","submitted_at":"2025-07-16T07:58:20Z","title":"Improving Data and Parameter Efficiency of Neural Language Models Using Representation Analysis","version":1},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-08-06T17:03:38.514844Z"},"links":{"citing_paper":"/paper/2507.12004"},"observation_digest":"sha256:4417abdda60ed09c8919f25b132a3211e93062b2fc2aed6b0bb723cb75683df5","observation_id":"4e131cb6-e7e2-4837-9ac2-ee37e183ee6e","resolution":{"observed_at":"2026-08-06T17:03:38.514844Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:03:38.640026Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.12004","last_updated":"2025-07-16T07:58:20Z","snapshot_observed_at":"2026-08-07T12:43:44.020373Z","submitted_at":"2025-07-16T07:58:20Z","title":"Improving Data and Parameter Efficiency of Neural Language Models Using Representation Analysis","version":1},"reference_index":63,"source":"arxiv_source","source_observed_at":"2026-08-06T17:03:38.640026Z"},"links":{"citing_paper":"/paper/2507.12004"},"observation_digest":"sha256:32400ca84f2a8dbfaa88cea887f59d4850e5650498e8b7d72d7078ef8f174c4e","observation_id":"5265ebf5-e30a-4d3f-adeb-ecf43a483368","resolution":{"observed_at":"2026-08-06T17:03:38.640026Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:03:38.759675Z","title":"F., ``A stochastic estimator of the trace of the influence matrix for L aplacian smoothing splines'', Communications in Statistics-Simulation and Computation, Vol","venue":null,"work_id":null,"year":1989},"citing_paper":{"arxiv_id":"2507.12004","last_updated":"2025-07-16T07:58:20Z","snapshot_observed_at":"2026-08-07T12:43:44.020373Z","submitted_at":"2025-07-16T07:58:20Z","title":"Improving Data and Parameter Efficiency of Neural Language Models Using Representation Analysis","version":1},"reference_index":64,"source":"arxiv_source","source_observed_at":"2026-08-06T17:03:38.759675Z"},"links":{"citing_paper":"/paper/2507.12004"},"observation_digest":"sha256:24f06c913bce559bfb9f12fecb53b1804920750befe575c1bb8ef12d0bf8133a","observation_id":"6756e07c-5172-4800-a057-0f9a3e46f0bf","resolution":{"observed_at":"2026-08-06T17:03:38.759675Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:03:38.886475Z","title":"27, 2018, str","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2507.12004","last_updated":"2025-07-16T07:58:20Z","snapshot_observed_at":"2026-08-07T12:43:44.020373Z","submitted_at":"2025-07-16T07:58:20Z","title":"Improving Data and Parameter Efficiency of Neural Language Models Using Representation Analysis","version":1},"reference_index":65,"source":"arxiv_source","source_observed_at":"2026-08-06T17:03:38.886475Z"},"links":{"citing_paper":"/paper/2507.12004"},"observation_digest":"sha256:94cfd6a4bbf8c941c380de913cef1575c0df04e78c596e9e6fda94ac61660947","observation_id":"b1c2de5a-74f7-43a4-a707-2c35028afaca","resolution":{"observed_at":"2026-08-06T17:03:38.886475Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:03:39.001310Z","title":"Monographs in Mathematics","venue":null,"work_id":null,"year":1983},"citing_paper":{"arxiv_id":"2507.12004","last_updated":"2025-07-16T07:58:20Z","snapshot_observed_at":"2026-08-07T12:43:44.020373Z","submitted_at":"2025-07-16T07:58:20Z","title":"Improving Data and Parameter Efficiency of Neural Language Models Using Representation Analysis","version":1},"reference_index":66,"source":"arxiv_source","source_observed_at":"2026-08-06T17:03:39.001310Z"},"links":{"citing_paper":"/paper/2507.12004"},"observation_digest":"sha256:34aad85aad23d18c611fc0d59dc713031d1c7dfdead9c95e47c187cd94019231","observation_id":"6c96f862-e9f1-4ea6-83d3-cc6c5042b965","resolution":{"observed_at":"2026-08-06T17:03:39.001310Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:03:39.117880Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2507.12004","last_updated":"2025-07-16T07:58:20Z","snapshot_observed_at":"2026-08-07T12:43:44.020373Z","submitted_at":"2025-07-16T07:58:20Z","title":"Improving Data and Parameter Efficiency of Neural Language Models Using Representation Analysis","version":1},"reference_index":67,"source":"arxiv_source","source_observed_at":"2026-08-06T17:03:39.117880Z"},"links":{"citing_paper":"/paper/2507.12004"},"observation_digest":"sha256:dde9c3fd06260ab14c4ad62bd3c12305f22e5f9de1267ed354671d7af5e6e6e1","observation_id":"d2fed286-f891-4421-aaf3-8b1e413283e3","resolution":{"observed_at":"2026-08-06T17:03:39.117880Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:03:39.161470Z","title":"W., (ur.), Vol","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.12004","last_updated":"2025-07-16T07:58:20Z","snapshot_observed_at":"2026-08-07T12:43:44.020373Z","submitted_at":"2025-07-16T07:58:20Z","title":"Improving Data and Parameter Efficiency of Neural Language Models Using Representation Analysis","version":1},"reference_index":68,"source":"arxiv_source","source_observed_at":"2026-08-06T17:03:39.161470Z"},"links":{"citing_paper":"/paper/2507.12004"},"observation_digest":"sha256:afa3f7c883c6a17201fa74006c1be668b6b164794c637feb96d77ac656c225e6","observation_id":"da024c21-af65-46ec-9bbd-3febd99d186b","resolution":{"observed_at":"2026-08-06T17:03:39.161470Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1710.03263","last_updated":"2017-10-09T18:52:42Z","snapshot_observed_at":"2026-07-06T06:03:23.072526Z","submitted_at":"2017-10-09T18:52:42Z","title":"Function space analysis of deep learning representation layers","version":1},"cited_work":{"arxiv_id":"1710.03263","doi":null,"metadata_source":"pith","pith_arxiv_id":"1710.03263","snapshot_observed_at":"2026-08-06T17:03:47.995173Z","title":"Function space analysis of deep learning representation layers","venue":"cs.AI","work_id":"99149481-7576-41a5-a8b1-a9959d425081","year":2017},"citing_paper":{"arxiv_id":"2507.12004","last_updated":"2025-07-16T07:58:20Z","snapshot_observed_at":"2026-08-07T12:43:44.020373Z","submitted_at":"2025-07-16T07:58:20Z","title":"Improving Data and Parameter Efficiency of Neural Language Models Using Representation Analysis","version":1},"reference_index":69,"source":"arxiv_source","source_observed_at":"2026-08-06T17:03:39.263645Z"},"links":{"cited_paper":"/paper/1710.03263","citing_paper":"/paper/2507.12004"},"observation_digest":"sha256:0f6910ba708610cdb8a0bac1a80eebc21777118bc44b693c64e661996061f24f","observation_id":"6d466943-be80-4846-81cc-33847d5ff753","resolution":{"observed_at":"2026-08-06T17:03:48.123947Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:03:39.361539Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.12004","last_updated":"2025-07-16T07:58:20Z","snapshot_observed_at":"2026-08-07T12:43:44.020373Z","submitted_at":"2025-07-16T07:58:20Z","title":"Improving Data and Parameter Efficiency of Neural Language Models Using Representation Analysis","version":1},"reference_index":70,"source":"arxiv_source","source_observed_at":"2026-08-06T17:03:39.361539Z"},"links":{"citing_paper":"/paper/2507.12004"},"observation_digest":"sha256:6c3785719070cfb81055ee05fb5f78ecdd171e279746a4a1dbd921c2b92caa12","observation_id":"b899d086-a8a3-44b9-90ab-674a79bd185e","resolution":{"observed_at":"2026-08-06T17:03:39.361539Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:03:39.423680Z","title":"W., (ur.), Vol","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.12004","last_updated":"2025-07-16T07:58:20Z","snapshot_observed_at":"2026-08-07T12:43:44.020373Z","submitted_at":"2025-07-16T07:58:20Z","title":"Improving Data and Parameter Efficiency of Neural Language Models Using Representation Analysis","version":1},"reference_index":71,"source":"arxiv_source","source_observed_at":"2026-08-06T17:03:39.423680Z"},"links":{"citing_paper":"/paper/2507.12004"},"observation_digest":"sha256:b95caa6575d11c5f81da756f1eb9438004caf9b2a1966f90c45e7a790e0ac081","observation_id":"d9527262-dd7f-4c17-845f-c35b94859104","resolution":{"observed_at":"2026-08-06T17:03:39.423680Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:03:39.539111Z","title":"13, 2025, str","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.12004","last_updated":"2025-07-16T07:58:20Z","snapshot_observed_at":"2026-08-07T12:43:44.020373Z","submitted_at":"2025-07-16T07:58:20Z","title":"Improving Data and Parameter Efficiency of Neural Language Models Using Representation Analysis","version":1},"reference_index":72,"source":"arxiv_source","source_observed_at":"2026-08-06T17:03:39.539111Z"},"links":{"citing_paper":"/paper/2507.12004"},"observation_digest":"sha256:7247b7e2fc8d80fc4057fa12aae721ea3059d1ecb47ed27c0d26e9ecadee038e","observation_id":"85693401-fd43-4185-9376-afb297f65d18","resolution":{"observed_at":"2026-08-06T17:03:39.539111Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:03:39.644233Z","title":"et al., ``Pytorch: An imperative style, high-performance deep learning library'', Advances in neural information processing systems, Vol","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2507.12004","last_updated":"2025-07-16T07:58:20Z","snapshot_observed_at":"2026-08-07T12:43:44.020373Z","submitted_at":"2025-07-16T07:58:20Z","title":"Improving Data and Parameter Efficiency of Neural Language Models Using Representation Analysis","version":1},"reference_index":73,"source":"arxiv_source","source_observed_at":"2026-08-06T17:03:39.644233Z"},"links":{"citing_paper":"/paper/2507.12004"},"observation_digest":"sha256:87d882c732bd1f1ba9cd2ad6d4cb37ce3562bf4249395ebbca685f041f464e17","observation_id":"a6420109-dd37-4712-a2ef-848271d9a81e","resolution":{"observed_at":"2026-08-06T17:03:39.644233Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:03:39.702956Z","title":"Online: Association for Computational Linguistics, Oct","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.12004","last_updated":"2025-07-16T07:58:20Z","snapshot_observed_at":"2026-08-07T12:43:44.020373Z","submitted_at":"2025-07-16T07:58:20Z","title":"Improving Data and Parameter Efficiency of Neural Language Models Using Representation Analysis","version":1},"reference_index":74,"source":"arxiv_source","source_observed_at":"2026-08-06T17:03:39.702956Z"},"links":{"citing_paper":"/paper/2507.12004"},"observation_digest":"sha256:e9a1b7844ba82a46e4fd12ebf4ab6dc5ed2a3f703866f34f00f5f0d889eef4de","observation_id":"1227609b-3cee-4ea6-b68a-c8963eaf81d9","resolution":{"observed_at":"2026-08-06T17:03:39.702956Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:03:39.803179Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.12004","last_updated":"2025-07-16T07:58:20Z","snapshot_observed_at":"2026-08-07T12:43:44.020373Z","submitted_at":"2025-07-16T07:58:20Z","title":"Improving Data and Parameter Efficiency of Neural Language Models Using Representation Analysis","version":1},"reference_index":75,"source":"arxiv_source","source_observed_at":"2026-08-06T17:03:39.803179Z"},"links":{"citing_paper":"/paper/2507.12004"},"observation_digest":"sha256:ee0d76c0d5b35260237d41e859c8a194d91b3b08cf184c265b20a285c9b2f89d","observation_id":"80b155a5-bd77-46d0-ba8e-5ca005ee4d88","resolution":{"observed_at":"2026-08-06T17:03:39.803179Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:03:39.844736Z","title":"Brussels, Belgium: Association for Computational Linguistics, Nov","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2507.12004","last_updated":"2025-07-16T07:58:20Z","snapshot_observed_at":"2026-08-07T12:43:44.020373Z","submitted_at":"2025-07-16T07:58:20Z","title":"Improving Data and Parameter Efficiency of Neural Language Models Using Representation Analysis","version":1},"reference_index":76,"source":"arxiv_source","source_observed_at":"2026-08-06T17:03:39.844736Z"},"links":{"citing_paper":"/paper/2507.12004"},"observation_digest":"sha256:e642edea9a6b4843e7ea2e6213fd65a1a8c9c508538a988f58245c1ee3357567","observation_id":"29dda6aa-44d6-46f7-b786-920eeec76f62","resolution":{"observed_at":"2026-08-06T17:03:39.844736Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:03:39.932942Z","title":"PMLR, 2019, str","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2507.12004","last_updated":"2025-07-16T07:58:20Z","snapshot_observed_at":"2026-08-07T12:43:44.020373Z","submitted_at":"2025-07-16T07:58:20Z","title":"Improving Data and Parameter Efficiency of Neural Language Models Using Representation Analysis","version":1},"reference_index":77,"source":"arxiv_source","source_observed_at":"2026-08-06T17:03:39.932942Z"},"links":{"citing_paper":"/paper/2507.12004"},"observation_digest":"sha256:97228bdbbe534a3e0ef246d2a6b955d5efd0c78ccdb594dc4ec841ac17581605","observation_id":"e5738d7e-8ab5-48fb-9184-1b223b400241","resolution":{"observed_at":"2026-08-06T17:03:39.932942Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:03:39.999566Z","title":"L., Daly, R","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2507.12004","last_updated":"2025-07-16T07:58:20Z","snapshot_observed_at":"2026-08-07T12:43:44.020373Z","submitted_at":"2025-07-16T07:58:20Z","title":"Improving Data and Parameter Efficiency of Neural Language Models Using Representation Analysis","version":1},"reference_index":78,"source":"arxiv_source","source_observed_at":"2026-08-06T17:03:39.999566Z"},"links":{"citing_paper":"/paper/2507.12004"},"observation_digest":"sha256:fb620f52b47db3da995a8e38fd6c4914bd03cf45f3ddce8e7b66ec3f8e1fd7be","observation_id":"056000d2-e4dc-46d7-b78e-310742977901","resolution":{"observed_at":"2026-08-06T17:03:39.999566Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:03:40.074872Z","title":"30, 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2507.12004","last_updated":"2025-07-16T07:58:20Z","snapshot_observed_at":"2026-08-07T12:43:44.020373Z","submitted_at":"2025-07-16T07:58:20Z","title":"Improving Data and Parameter Efficiency of Neural Language Models Using Representation Analysis","version":1},"reference_index":79,"source":"arxiv_source","source_observed_at":"2026-08-06T17:03:40.074872Z"},"links":{"citing_paper":"/paper/2507.12004"},"observation_digest":"sha256:049ce57cca12d00fc077a038c364c2fd80eae8feca856a620dd563700ef13460","observation_id":"0091b99c-3f40-4e08-8e32-4cbae3b99a01","resolution":{"observed_at":"2026-08-06T17:03:40.074872Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:03:40.139875Z","title":"W., Gal, Y., ``Uncertainty estimation using a single deep deterministic neural network'', in International conference on machine learning","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.12004","last_updated":"2025-07-16T07:58:20Z","snapshot_observed_at":"2026-08-07T12:43:44.020373Z","submitted_at":"2025-07-16T07:58:20Z","title":"Improving Data and Parameter Efficiency of Neural Language Models Using Representation Analysis","version":1},"reference_index":80,"source":"arxiv_source","source_observed_at":"2026-08-06T17:03:40.139875Z"},"links":{"citing_paper":"/paper/2507.12004"},"observation_digest":"sha256:908cdaef181f31ce2fda1be863d32e59f01e336e5010bf4b3017e0b68f7ddd8d","observation_id":"6feb18e4-55dc-4104-9497-7db424993bd0","resolution":{"observed_at":"2026-08-06T17:03:40.139875Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:03:40.246165Z","title":null,"venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2507.12004","last_updated":"2025-07-16T07:58:20Z","snapshot_observed_at":"2026-08-07T12:43:44.020373Z","submitted_at":"2025-07-16T07:58:20Z","title":"Improving Data and Parameter Efficiency of Neural Language Models Using Representation Analysis","version":1},"reference_index":81,"source":"arxiv_source","source_observed_at":"2026-08-06T17:03:40.246165Z"},"links":{"citing_paper":"/paper/2507.12004"},"observation_digest":"sha256:187c903eb484bb71f489ead03e77fe2b3c2e42c05b2a281559bb9475648208d2","observation_id":"98b04b44-b24e-42d4-8e30-11097c66c4ce","resolution":{"observed_at":"2026-08-06T17:03:40.246165Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:03:40.324500Z","title":"M., ``Generalization as search'', Artificial intelligence, Vol","venue":null,"work_id":null,"year":1982},"citing_paper":{"arxiv_id":"2507.12004","last_updated":"2025-07-16T07:58:20Z","snapshot_observed_at":"2026-08-07T12:43:44.020373Z","submitted_at":"2025-07-16T07:58:20Z","title":"Improving Data and Parameter Efficiency of Neural Language Models Using Representation Analysis","version":1},"reference_index":82,"source":"arxiv_source","source_observed_at":"2026-08-06T17:03:40.324500Z"},"links":{"citing_paper":"/paper/2507.12004"},"observation_digest":"sha256:a0583901d231ce7e006730ac786e1aa392e870cd50139525a9281a12bbaecd94","observation_id":"63b2523a-a4f9-4e41-980c-443e3c63dc99","resolution":{"observed_at":"2026-08-06T17:03:40.324500Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:03:40.363657Z","title":"S., Shamir, E., Tishby, N., ``Selective sampling using the query by committee algorithm'', Machine learning, Vol","venue":null,"work_id":null,"year":1997},"citing_paper":{"arxiv_id":"2507.12004","last_updated":"2025-07-16T07:58:20Z","snapshot_observed_at":"2026-08-07T12:43:44.020373Z","submitted_at":"2025-07-16T07:58:20Z","title":"Improving Data and Parameter Efficiency of Neural Language Models Using Representation Analysis","version":1},"reference_index":83,"source":"arxiv_source","source_observed_at":"2026-08-06T17:03:40.363657Z"},"links":{"citing_paper":"/paper/2507.12004"},"observation_digest":"sha256:7192b0fce8acc521cffaa5594ece0561ea987f33727ba13a3dd5daa679d44eee","observation_id":"fb803893-0220-4260-83e8-70466cc64031","resolution":{"observed_at":"2026-08-06T17:03:40.363657Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:03:40.426567Z","title":"353--360","venue":null,"work_id":null,"year":2007},"citing_paper":{"arxiv_id":"2507.12004","last_updated":"2025-07-16T07:58:20Z","snapshot_observed_at":"2026-08-07T12:43:44.020373Z","submitted_at":"2025-07-16T07:58:20Z","title":"Improving Data and Parameter Efficiency of Neural Language Models Using Representation Analysis","version":1},"reference_index":84,"source":"arxiv_source","source_observed_at":"2026-08-06T17:03:40.426567Z"},"links":{"citing_paper":"/paper/2507.12004"},"observation_digest":"sha256:c512d15b077ceef52e99f6e697c6c54a7e9bb3d1367487fc365203b7c8199a2b","observation_id":"a9985cb0-5f1c-41cb-8bff-6f45e548dc10","resolution":{"observed_at":"2026-08-06T17:03:40.426567Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:03:40.472250Z","title":"B., ``Optimal aggregation of classifiers in statistical learning'', The Annals of Statistics, Vol","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2507.12004","last_updated":"2025-07-16T07:58:20Z","snapshot_observed_at":"2026-08-07T12:43:44.020373Z","submitted_at":"2025-07-16T07:58:20Z","title":"Improving Data and Parameter Efficiency of Neural Language Models Using Representation Analysis","version":1},"reference_index":85,"source":"arxiv_source","source_observed_at":"2026-08-06T17:03:40.472250Z"},"links":{"citing_paper":"/paper/2507.12004"},"observation_digest":"sha256:8198f2c19f3156c5d994a5a7424542124d56e6c4585e60c9551236ead87c19a6","observation_id":"34e921a2-a0af-4cf6-8ed2-41e541acdb37","resolution":{"observed_at":"2026-08-06T17:03:40.472250Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:03:40.537130Z","title":null,"venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2507.12004","last_updated":"2025-07-16T07:58:20Z","snapshot_observed_at":"2026-08-07T12:43:44.020373Z","submitted_at":"2025-07-16T07:58:20Z","title":"Improving Data and Parameter Efficiency of Neural Language Models Using Representation Analysis","version":1},"reference_index":86,"source":"arxiv_source","source_observed_at":"2026-08-06T17:03:40.537130Z"},"links":{"citing_paper":"/paper/2507.12004"},"observation_digest":"sha256:7842770a04092f1e8ccd8be48e704333bd58a8154a29a8a5bd489561a918e482","observation_id":"fd71b780-1992-4c06-bcd7-a2b0e570e0be","resolution":{"observed_at":"2026-08-06T17:03:40.537130Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:03:40.602074Z","title":"147, 2015, str","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2507.12004","last_updated":"2025-07-16T07:58:20Z","snapshot_observed_at":"2026-08-07T12:43:44.020373Z","submitted_at":"2025-07-16T07:58:20Z","title":"Improving Data and Parameter Efficiency of Neural Language Models Using Representation Analysis","version":1},"reference_index":87,"source":"arxiv_source","source_observed_at":"2026-08-06T17:03:40.602074Z"},"links":{"citing_paper":"/paper/2507.12004"},"observation_digest":"sha256:1ef2faa93c2c1374d0107450aeda92992b7a5c426f11345168de9db68515a77e","observation_id":"fb27ef53-a9a2-4adf-9e0a-8ed007205102","resolution":{"observed_at":"2026-08-06T17:03:40.602074Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:03:40.662236Z","title":null,"venue":null,"work_id":null,"year":2001},"citing_paper":{"arxiv_id":"2507.12004","last_updated":"2025-07-16T07:58:20Z","snapshot_observed_at":"2026-08-07T12:43:44.020373Z","submitted_at":"2025-07-16T07:58:20Z","title":"Improving Data and Parameter Efficiency of Neural Language Models Using Representation Analysis","version":1},"reference_index":88,"source":"arxiv_source","source_observed_at":"2026-08-06T17:03:40.662236Z"},"links":{"citing_paper":"/paper/2507.12004"},"observation_digest":"sha256:06a0b2068db72777a95e122cc5be286e192854ba616567b475eada2494d0132c","observation_id":"3f6b64b5-d16f-4b44-91cf-9a5f0f1cf7e8","resolution":{"observed_at":"2026-08-06T17:03:40.662236Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:03:40.767383Z","title":"Proceedings of Machine Learning Research, Balcan, M","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2507.12004","last_updated":"2025-07-16T07:58:20Z","snapshot_observed_at":"2026-08-07T12:43:44.020373Z","submitted_at":"2025-07-16T07:58:20Z","title":"Improving Data and Parameter Efficiency of Neural Language Models Using Representation Analysis","version":1},"reference_index":89,"source":"arxiv_source","source_observed_at":"2026-08-06T17:03:40.767383Z"},"links":{"citing_paper":"/paper/2507.12004"},"observation_digest":"sha256:3c7f7ae63688c7309bc56c820f02b24cfc76388975602f76bd2b0d19a36a78a1","observation_id":"8a7acaa3-2468-4c76-9af4-482abac8b8ff","resolution":{"observed_at":"2026-08-06T17:03:40.767383Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1907.06347","last_updated":"2019-07-15T06:47:58Z","snapshot_observed_at":"2026-08-02T08:09:41.894753Z","submitted_at":"2019-07-15T06:47:58Z","title":"Discriminative Active Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1907.06347","snapshot_observed_at":"2026-08-06T17:03:40.898456Z","title":null,"venue":null,"work_id":null,"year":1907},"citing_paper":{"arxiv_id":"2507.12004","last_updated":"2025-07-16T07:58:20Z","snapshot_observed_at":"2026-08-07T12:43:44.020373Z","submitted_at":"2025-07-16T07:58:20Z","title":"Improving Data and Parameter Efficiency of Neural Language Models Using Representation Analysis","version":1},"reference_index":90,"source":"arxiv_source","source_observed_at":"2026-08-06T17:03:40.898456Z"},"links":{"cited_paper":"/paper/1907.06347","citing_paper":"/paper/2507.12004"},"observation_digest":"sha256:186bc9465ad474708aa2d2cc66cee9479c2a2a98e15d836b2c1b221b31beb7b9","observation_id":"0e105da9-830b-42e6-bc11-56f9a09106a9","resolution":{"observed_at":"2026-08-06T17:03:40.898456Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:03:40.995609Z","title":null,"venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2507.12004","last_updated":"2025-07-16T07:58:20Z","snapshot_observed_at":"2026-08-07T12:43:44.020373Z","submitted_at":"2025-07-16T07:58:20Z","title":"Improving Data and Parameter Efficiency of Neural Language Models Using Representation Analysis","version":1},"reference_index":91,"source":"arxiv_source","source_observed_at":"2026-08-06T17:03:40.995609Z"},"links":{"citing_paper":"/paper/2507.12004"},"observation_digest":"sha256:1e2ac836e6d7bcdfd0e5b900dbee5950179bdbced968da8d8db7049bcdafd159","observation_id":"d7c206a0-6f6e-485f-9ce0-092a7d01b31b","resolution":{"observed_at":"2026-08-06T17:03:40.995609Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:03:56.311576Z","title":"C., Wallace, B","venue":null,"work_id":"0b7e266f-e159-4f47-8ff1-b34c5bc99af6","year":2019},"citing_paper":{"arxiv_id":"2507.12004","last_updated":"2025-07-16T07:58:20Z","snapshot_observed_at":"2026-08-07T12:43:44.020373Z","submitted_at":"2025-07-16T07:58:20Z","title":"Improving Data and Parameter Efficiency of Neural Language Models Using Representation Analysis","version":1},"reference_index":92,"source":"arxiv_source","source_observed_at":"2026-08-06T17:03:41.095118Z"},"links":{"citing_paper":"/paper/2507.12004"},"observation_digest":"sha256:b5f9c2fbf06bef74877f4ba44d54797b4951c232b1b8a70d967e91e59f289114","observation_id":"29898bfc-6cda-4892-95ed-4864e00974f9","resolution":{"observed_at":"2026-08-06T17:03:56.401357Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:03:56.093222Z","title":null,"venue":null,"work_id":"02c42d3f-a566-4957-92ca-ce1f7ab67600","year":2008},"citing_paper":{"arxiv_id":"2507.12004","last_updated":"2025-07-16T07:58:20Z","snapshot_observed_at":"2026-08-07T12:43:44.020373Z","submitted_at":"2025-07-16T07:58:20Z","title":"Improving Data and Parameter Efficiency of Neural Language Models Using Representation Analysis","version":1},"reference_index":93,"source":"arxiv_source","source_observed_at":"2026-08-06T17:03:41.131876Z"},"links":{"citing_paper":"/paper/2507.12004"},"observation_digest":"sha256:1749eef14ffa54a14619e0654b035a19d21b5cdb03b992a5f16c237528dc8b6b","observation_id":"a3d4f779-8304-46c2-bbc5-4e1b23643083","resolution":{"observed_at":"2026-08-06T17:03:56.231278Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:03:55.915282Z","title":"Boulder, Colorado: Association for Computational Linguistics, Jun","venue":null,"work_id":"b8657629-11b6-412a-bff5-102fed2b4e06","year":2009},"citing_paper":{"arxiv_id":"2507.12004","last_updated":"2025-07-16T07:58:20Z","snapshot_observed_at":"2026-08-07T12:43:44.020373Z","submitted_at":"2025-07-16T07:58:20Z","title":"Improving Data and Parameter Efficiency of Neural Language Models Using Representation Analysis","version":1},"reference_index":94,"source":"arxiv_source","source_observed_at":"2026-08-06T17:03:41.220633Z"},"links":{"citing_paper":"/paper/2507.12004"},"observation_digest":"sha256:403b03a0eb547454f49fe7f2855b8377ae122f103aba757a2db939f6f7368a0e","observation_id":"2780454d-a68c-4516-8882-1f27a01c966b","resolution":{"observed_at":"2026-08-06T17:03:56.012077Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:03:55.749008Z","title":null,"venue":null,"work_id":"0bb7090b-103c-4f02-b6df-45890183d1b8","year":2021},"citing_paper":{"arxiv_id":"2507.12004","last_updated":"2025-07-16T07:58:20Z","snapshot_observed_at":"2026-08-07T12:43:44.020373Z","submitted_at":"2025-07-16T07:58:20Z","title":"Improving Data and Parameter Efficiency of Neural Language Models Using Representation Analysis","version":1},"reference_index":95,"source":"arxiv_source","source_observed_at":"2026-08-06T17:03:41.276525Z"},"links":{"citing_paper":"/paper/2507.12004"},"observation_digest":"sha256:1d8f5e404f1ef6a1d5d42f40bfe38c9b39f73836e8d0bbb0b2b5786c7afe1656","observation_id":"caba273d-25b7-4a16-b0ce-d0fe48a95e6a","resolution":{"observed_at":"2026-08-06T17:03:55.827623Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2002.06305","last_updated":"2020-02-15T02:40:10Z","snapshot_observed_at":"2026-08-07T15:45:43.952318Z","submitted_at":"2020-02-15T02:40:10Z","title":"Fine-Tuning Pretrained Language Models: Weight Initializations, Data Orders, and Early Stopping","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2002.06305","snapshot_observed_at":"2026-08-06T17:03:41.362392Z","title":null,"venue":null,"work_id":null,"year":2002},"citing_paper":{"arxiv_id":"2507.12004","last_updated":"2025-07-16T07:58:20Z","snapshot_observed_at":"2026-08-07T12:43:44.020373Z","submitted_at":"2025-07-16T07:58:20Z","title":"Improving Data and Parameter Efficiency of Neural Language Models Using Representation Analysis","version":1},"reference_index":96,"source":"arxiv_source","source_observed_at":"2026-08-06T17:03:41.362392Z"},"links":{"cited_paper":"/paper/2002.06305","citing_paper":"/paper/2507.12004"},"observation_digest":"sha256:a240f615c6fcb5bc4d2c3610c0c3ccc031629df2d15c7219f2a2cfb75a305353","observation_id":"c0dbd269-8080-4cb3-937d-35fa7a6e832a","resolution":{"observed_at":"2026-08-06T17:03:41.362392Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:03:55.592455Z","title":"Florence, Italy: Association for Computational Linguistics, Jul","venue":null,"work_id":"e1f7750a-f024-494c-8368-78cf4561508d","year":2019},"citing_paper":{"arxiv_id":"2507.12004","last_updated":"2025-07-16T07:58:20Z","snapshot_observed_at":"2026-08-07T12:43:44.020373Z","submitted_at":"2025-07-16T07:58:20Z","title":"Improving Data and Parameter Efficiency of Neural Language Models Using Representation Analysis","version":1},"reference_index":97,"source":"arxiv_source","source_observed_at":"2026-08-06T17:03:41.432311Z"},"links":{"citing_paper":"/paper/2507.12004"},"observation_digest":"sha256:483d645297bac025450c3cfd06e802958fa67be7a48dac6f47310836323344a0","observation_id":"1d38c21d-e6f5-4158-8fd4-58ba1147956a","resolution":{"observed_at":"2026-08-06T17:03:55.650577Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:03:55.436480Z","title":"Hong Kong, China: Association for Computational Linguistics, Nov","venue":null,"work_id":"0d5b5428-ccc0-48c2-8b4b-26047f86684d","year":2019},"citing_paper":{"arxiv_id":"2507.12004","last_updated":"2025-07-16T07:58:20Z","snapshot_observed_at":"2026-08-07T12:43:44.020373Z","submitted_at":"2025-07-16T07:58:20Z","title":"Improving Data and Parameter Efficiency of Neural Language Models Using Representation Analysis","version":1},"reference_index":98,"source":"arxiv_source","source_observed_at":"2026-08-06T17:03:41.561659Z"},"links":{"citing_paper":"/paper/2507.12004"},"observation_digest":"sha256:29c2c104b2b96fffacc798b87111a22267355a357e049263ee008b30b5aaa67a","observation_id":"141c7d80-65ea-43fe-b0f7-45e09e10a5b6","resolution":{"observed_at":"2026-08-06T17:03:55.502870Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:03:55.269085Z","title":"Online: Association for Computational Linguistics, Nov","venue":null,"work_id":"fd528321-52b3-44bd-acee-e605e9125d4c","year":2020},"citing_paper":{"arxiv_id":"2507.12004","last_updated":"2025-07-16T07:58:20Z","snapshot_observed_at":"2026-08-07T12:43:44.020373Z","submitted_at":"2025-07-16T07:58:20Z","title":"Improving Data and Parameter Efficiency of Neural Language Models Using Representation Analysis","version":1},"reference_index":99,"source":"arxiv_source","source_observed_at":"2026-08-06T17:03:41.641903Z"},"links":{"citing_paper":"/paper/2507.12004"},"observation_digest":"sha256:e53a4c6296be54e35ba4f7f7828a649c80c5be183fe49669bbdd96b00d3165fd","observation_id":"ea6c3503-2316-4902-9b71-32d030e96bf2","resolution":{"observed_at":"2026-08-06T17:03:55.342633Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:03:55.113366Z","title":"Dublin, Ireland: Association for Computational Linguistics, May 2022, str","venue":null,"work_id":"7b25114c-78d2-4c41-b9d5-f7fd057b05bc","year":2022},"citing_paper":{"arxiv_id":"2507.12004","last_updated":"2025-07-16T07:58:20Z","snapshot_observed_at":"2026-08-07T12:43:44.020373Z","submitted_at":"2025-07-16T07:58:20Z","title":"Improving Data and Parameter Efficiency of Neural Language Models Using Representation Analysis","version":1},"reference_index":100,"source":"arxiv_source","source_observed_at":"2026-08-06T17:03:41.730776Z"},"links":{"citing_paper":"/paper/2507.12004"},"observation_digest":"sha256:f333daea53cbbc2451c1e09a0296c1add8e6fad60691cac43aa29e63e8b61b7b","observation_id":"5f6f1bfe-1b09-474a-8489-94c0e004c96f","resolution":{"observed_at":"2026-08-06T17:03:55.194059Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:03:54.987185Z","title":"Online: Association for Computational Linguistics, Nov","venue":null,"work_id":"290a2ee7-ed43-4f38-899e-65ab8e9ce4a7","year":2020},"citing_paper":{"arxiv_id":"2507.12004","last_updated":"2025-07-16T07:58:20Z","snapshot_observed_at":"2026-08-07T12:43:44.020373Z","submitted_at":"2025-07-16T07:58:20Z","title":"Improving Data and Parameter Efficiency of Neural Language Models Using Representation Analysis","version":1},"reference_index":101,"source":"arxiv_source","source_observed_at":"2026-08-06T17:03:41.807106Z"},"links":{"citing_paper":"/paper/2507.12004"},"observation_digest":"sha256:6cf48b6fbacf54b24c3dbf3b1ec2f7b89a701ad1b5dcd9ad244c94e3b78031b9","observation_id":"13581224-2f19-43b6-a322-8117a8f9c2a9","resolution":{"observed_at":"2026-08-06T17:03:55.049422Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2507.12004","last_updated":"2025-07-16T07:58:20Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-07T12:43:44.020373Z","submitted_at":"2025-07-16T07:58:20Z","title":"Improving Data and Parameter Efficiency of Neural Language Models Using Representation Analysis"},"reference_resolution":{"displayed":100,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":91,"verified_exact":2,"verified_fuzzy":7},"total_outbound_references":154},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 100 of 154 outbound references and 0 inbound Pith citation observations for arXiv:2507.12004."}