{"as_of":"2026-08-19T11:49:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:a5856e9ad3a980383faf1ae62f9c6e9d655cb2c0cdff053f96f0dc2c6c006cb8","coverage":[{"denominator":67,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":67,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-16T05:38:37.529590Z","state":"measured"},{"denominator":67,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":67,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-19T06:32:44.657259+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2504.21047/citation-record","integrity":"/paper/2504.21047/integrity","json":"/paper/2504.21047/citation-record.json","paper":"/paper/2504.21047"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:38:40.243810Z","title":"Love, Christopher J","venue":null,"work_id":"4555d8b0-d846-47a0-9ad6-bd4a5c14b015","year":2024},"citing_paper":{"arxiv_id":"2504.21047","last_updated":"2025-04-29T00:17:53Z","snapshot_observed_at":"2026-08-19T02:05:08.187474Z","submitted_at":"2025-04-29T00:17:53Z","title":"Model Connectomes: A Generational Approach to Data-Efficient Language Models","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-16T05:38:36.420243Z"},"links":{"citing_paper":"/paper/2504.21047"},"observation_digest":"sha256:80ba7c8b24e9662b70c6a18576bac6c0ccea8b0e4122c2d753c17812d08a2ca3","observation_id":"4d110ecf-2242-4105-9e6b-b208315bbc22","resolution":{"observed_at":"2026-08-16T05:38:40.247779Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:38:40.230180Z","title":"Language in brains, minds, and machines","venue":null,"work_id":"dd453f6d-8439-4593-9181-7a168bfcfacc","year":2024},"citing_paper":{"arxiv_id":"2504.21047","last_updated":"2025-04-29T00:17:53Z","snapshot_observed_at":"2026-08-19T02:05:08.187474Z","submitted_at":"2025-04-29T00:17:53Z","title":"Model Connectomes: A Generational Approach to Data-Efficient Language Models","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-16T05:38:36.540128Z"},"links":{"citing_paper":"/paper/2504.21047"},"observation_digest":"sha256:642e8108cc34cb8f61ad5542e6e66d057c3915e9ca0eb677d1402aacfe502df0","observation_id":"9d9e3e3b-4847-4fb9-bf21-ddf2ef912d38","resolution":{"observed_at":"2026-08-16T05:38:40.235303Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:38:40.180376Z","title":"Catalyzing next-generation artificial intelligence through neuroai","venue":null,"work_id":"b1b3208c-e05e-4e9e-a1ba-c8db57e4437b","year":2023},"citing_paper":{"arxiv_id":"2504.21047","last_updated":"2025-04-29T00:17:53Z","snapshot_observed_at":"2026-08-19T02:05:08.187474Z","submitted_at":"2025-04-29T00:17:53Z","title":"Model Connectomes: A Generational Approach to Data-Efficient Language Models","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-16T05:38:36.545447Z"},"links":{"citing_paper":"/paper/2504.21047"},"observation_digest":"sha256:947ebb2c64e176642b590b2b923f3997b4c5f0a6dda5c99bbc6c4fe80b11ea2e","observation_id":"f3c0130b-74fc-43f3-a6d2-25488aa5f18c","resolution":{"observed_at":"2026-08-16T05:38:40.221108Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:38:40.062685Z","title":"A deep learning framework for neuroscience","venue":null,"work_id":"0410be9e-c657-44ed-96fa-b9c6723b64cd","year":2019},"citing_paper":{"arxiv_id":"2504.21047","last_updated":"2025-04-29T00:17:53Z","snapshot_observed_at":"2026-08-19T02:05:08.187474Z","submitted_at":"2025-04-29T00:17:53Z","title":"Model Connectomes: A Generational Approach to Data-Efficient Language Models","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-16T05:38:36.552767Z"},"links":{"citing_paper":"/paper/2504.21047"},"observation_digest":"sha256:35c87f31818139220d1ee8ae118d72622d9803b365f4b917471196fafd8a6dc4","observation_id":"753ef396-f075-482e-ab59-4b48b438a06f","resolution":{"observed_at":"2026-08-16T05:38:40.105481Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:38:40.046490Z","title":"How learning can guide evolution.Complex Systems, 1(3):495–502, 1987","venue":null,"work_id":"82c91433-9c0d-402d-a7f0-291d8821013c","year":1987},"citing_paper":{"arxiv_id":"2504.21047","last_updated":"2025-04-29T00:17:53Z","snapshot_observed_at":"2026-08-19T02:05:08.187474Z","submitted_at":"2025-04-29T00:17:53Z","title":"Model Connectomes: A Generational Approach to Data-Efficient Language Models","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-16T05:38:36.558090Z"},"links":{"citing_paper":"/paper/2504.21047"},"observation_digest":"sha256:ea5e4ea5a9c10d3c25e89d07cf0926ff24b396850d169cf02ae5c6a228d5c0fc","observation_id":"2f68d6b6-ab98-4dba-b41c-bce855bbbe8a","resolution":{"observed_at":"2026-08-16T05:38:40.051332Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:38:36.563530Z","title":"A critique of pure learning and what artificial neural networks can learn from animal brains","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2504.21047","last_updated":"2025-04-29T00:17:53Z","snapshot_observed_at":"2026-08-19T02:05:08.187474Z","submitted_at":"2025-04-29T00:17:53Z","title":"Model Connectomes: A Generational Approach to Data-Efficient Language Models","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-16T05:38:36.563530Z"},"links":{"citing_paper":"/paper/2504.21047"},"observation_digest":"sha256:53db8318a8efecfa9bd72bb6c5e266659b8fbc88e89fe1b79871046b77538165","observation_id":"bc4cc8da-6aeb-4394-98af-a7acd95ef290","resolution":{"observed_at":"2026-08-16T05:38:36.563530Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:38:39.970925Z","title":"Direct fit to nature: an evolutionary perspective on biological and artificial neural networks","venue":null,"work_id":"f6885b2a-f15d-4d50-b957-cc6b58a5f257","year":2020},"citing_paper":{"arxiv_id":"2504.21047","last_updated":"2025-04-29T00:17:53Z","snapshot_observed_at":"2026-08-19T02:05:08.187474Z","submitted_at":"2025-04-29T00:17:53Z","title":"Model Connectomes: A Generational Approach to Data-Efficient Language Models","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-16T05:38:36.570269Z"},"links":{"citing_paper":"/paper/2504.21047"},"observation_digest":"sha256:9965cbd6ec969e02d8a5b7923ee22af2f861ed58ff5c10e758e6f3e287a31215","observation_id":"da27f7a5-dd02-463a-8263-9d1fc5cb8ac0","resolution":{"observed_at":"2026-08-16T05:38:40.019141Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:38:39.831846Z","title":"Gomez, Lukasz Kaiser, and Illia Polosukhin","venue":null,"work_id":"7172845d-efa1-482e-b12c-87860a47ed20","year":2017},"citing_paper":{"arxiv_id":"2504.21047","last_updated":"2025-04-29T00:17:53Z","snapshot_observed_at":"2026-08-19T02:05:08.187474Z","submitted_at":"2025-04-29T00:17:53Z","title":"Model Connectomes: A Generational Approach to Data-Efficient Language Models","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-16T05:38:36.576243Z"},"links":{"citing_paper":"/paper/2504.21047"},"observation_digest":"sha256:6ebf712248ed7ee1644c2d483ef631d72afd3254a695655fba0817a1b7e11994","observation_id":"88aea36e-2f99-4dac-a493-1c66489ba031","resolution":{"observed_at":"2026-08-16T05:38:39.921884Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:38:39.818955Z","title":"What artificial neural networks can tell us about human language acquisition","venue":null,"work_id":"f3ac1a29-30fc-46fe-a8f6-5ef186bcd488","year":2022},"citing_paper":{"arxiv_id":"2504.21047","last_updated":"2025-04-29T00:17:53Z","snapshot_observed_at":"2026-08-19T02:05:08.187474Z","submitted_at":"2025-04-29T00:17:53Z","title":"Model Connectomes: A Generational Approach to Data-Efficient Language Models","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-16T05:38:36.580285Z"},"links":{"citing_paper":"/paper/2504.21047"},"observation_digest":"sha256:51a2daa3c1ec5b9f28260f5bfee4dc69d6810ed88dd665718dad82bacbbdf2ec","observation_id":"d9908253-d2c3-40de-829a-e9363bfe50ca","resolution":{"observed_at":"2026-08-16T05:38:39.823314Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2301.11796","last_updated":"2023-01-27T15:52:50Z","snapshot_observed_at":"2026-08-16T15:59:41.015785Z","submitted_at":"2023-01-27T15:52:50Z","title":"Call for Papers -- The BabyLM Challenge: Sample-efficient pretraining on a developmentally plausible corpus","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.11796","snapshot_observed_at":"2026-08-16T05:38:36.585620Z","title":"Call for papers–the babylm challenge: Sample-efficient pretraining on a developmen- tally plausible corpus","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.21047","last_updated":"2025-04-29T00:17:53Z","snapshot_observed_at":"2026-08-19T02:05:08.187474Z","submitted_at":"2025-04-29T00:17:53Z","title":"Model Connectomes: A Generational Approach to Data-Efficient Language Models","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-16T05:38:36.585620Z"},"links":{"cited_paper":"/paper/2301.11796","citing_paper":"/paper/2504.21047"},"observation_digest":"sha256:502a1da7b7aba1c7db5c964fc9ae8941d041b513fdafbef8f8c5d23662b6b634","observation_id":"08308dcd-dfbd-46f0-9853-da31175175f5","resolution":{"observed_at":"2026-08-16T05:38:36.585620Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:38:36.591064Z","title":"Improving language understanding by generative pre-training","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2504.21047","last_updated":"2025-04-29T00:17:53Z","snapshot_observed_at":"2026-08-19T02:05:08.187474Z","submitted_at":"2025-04-29T00:17:53Z","title":"Model Connectomes: A Generational Approach to Data-Efficient Language Models","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-16T05:38:36.591064Z"},"links":{"citing_paper":"/paper/2504.21047"},"observation_digest":"sha256:a59524a603743d3833a209526c9f928599f0f37ccd4e072df3b8598c58a665fe","observation_id":"c72c09ff-d846-4c8d-a138-2ab5634dd399","resolution":{"observed_at":"2026-08-16T05:38:36.591064Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:38:39.799900Z","title":"Llama v3: Next-generation foundation language model, 2023","venue":null,"work_id":"921b1a3f-8975-4c59-b56e-fbc466cc508f","year":2023},"citing_paper":{"arxiv_id":"2504.21047","last_updated":"2025-04-29T00:17:53Z","snapshot_observed_at":"2026-08-19T02:05:08.187474Z","submitted_at":"2025-04-29T00:17:53Z","title":"Model Connectomes: A Generational Approach to Data-Efficient Language Models","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-16T05:38:36.596106Z"},"links":{"citing_paper":"/paper/2504.21047"},"observation_digest":"sha256:fb97d6e7b685cec82199f2715340babf0df30650b8f22f8f7aefc8e9ed5728a6","observation_id":"3d9cf620-6544-48d9-94a9-d4912dce77a1","resolution":{"observed_at":"2026-08-16T05:38:39.804369Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:38:39.665941Z","title":"Deepseek llm: Advancing deep information retrieval with large language models, 2023","venue":null,"work_id":"d5c9807f-853b-42b4-aa2c-0a353a381d55","year":2023},"citing_paper":{"arxiv_id":"2504.21047","last_updated":"2025-04-29T00:17:53Z","snapshot_observed_at":"2026-08-19T02:05:08.187474Z","submitted_at":"2025-04-29T00:17:53Z","title":"Model Connectomes: A Generational Approach to Data-Efficient Language Models","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-16T05:38:36.600328Z"},"links":{"citing_paper":"/paper/2504.21047"},"observation_digest":"sha256:843049d244e75885f7e5a78c2d477766210d5c5af161f43fe6dd2797fc1eee40","observation_id":"55e3afe8-31e4-44d0-9d45-f3ea5bb30ce2","resolution":{"observed_at":"2026-08-16T05:38:39.791343Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:38:39.573444Z","title":"Scaling laws for neural language mod- els, 2020","venue":null,"work_id":"cf38f359-1b15-48f2-a2d2-d085885759c5","year":2020},"citing_paper":{"arxiv_id":"2504.21047","last_updated":"2025-04-29T00:17:53Z","snapshot_observed_at":"2026-08-19T02:05:08.187474Z","submitted_at":"2025-04-29T00:17:53Z","title":"Model Connectomes: A Generational Approach to Data-Efficient Language Models","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-16T05:38:36.604836Z"},"links":{"citing_paper":"/paper/2504.21047"},"observation_digest":"sha256:47bb2578eef992b2d9f36841487ddcb1a5552e74a0a50c78ff73d4459894b3f1","observation_id":"d2090d3c-a12d-468d-8fb1-815e8621c80b","resolution":{"observed_at":"2026-08-16T05:38:39.622434Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:38:36.609632Z","title":"Incorporating context into language encoding models for fmri","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2504.21047","last_updated":"2025-04-29T00:17:53Z","snapshot_observed_at":"2026-08-19T02:05:08.187474Z","submitted_at":"2025-04-29T00:17:53Z","title":"Model Connectomes: A Generational Approach to Data-Efficient Language Models","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-16T05:38:36.609632Z"},"links":{"citing_paper":"/paper/2504.21047"},"observation_digest":"sha256:5271a478c0717416f71a006a89361692e8ab464fa1f9483bd7ee2da7cf890c69","observation_id":"c5264a8f-23a5-4f38-a242-0b978cead91c","resolution":{"observed_at":"2026-08-16T05:38:36.609632Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:38:36.613989Z","title":"Interpreting and improving natural-language processing (in machines) with natural language-processing (in the brain)","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2504.21047","last_updated":"2025-04-29T00:17:53Z","snapshot_observed_at":"2026-08-19T02:05:08.187474Z","submitted_at":"2025-04-29T00:17:53Z","title":"Model Connectomes: A Generational Approach to Data-Efficient Language Models","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-16T05:38:36.613989Z"},"links":{"citing_paper":"/paper/2504.21047"},"observation_digest":"sha256:19959a638b9bbd27ea98e313af45f456d3bf5891bd181e700a54e6cd26f2ae01","observation_id":"2b132da2-3b35-46b6-a6d8-7c687630ddaf","resolution":{"observed_at":"2026-08-16T05:38:36.613989Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:38:39.545950Z","title":null,"venue":null,"work_id":"88b89cc3-0e98-4091-abf7-9a93714c7a20","year":2020},"citing_paper":{"arxiv_id":"2504.21047","last_updated":"2025-04-29T00:17:53Z","snapshot_observed_at":"2026-08-19T02:05:08.187474Z","submitted_at":"2025-04-29T00:17:53Z","title":"Model Connectomes: A Generational Approach to Data-Efficient Language Models","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-16T05:38:36.617907Z"},"links":{"citing_paper":"/paper/2504.21047"},"observation_digest":"sha256:4486af60d81a71fa8add7d3b90f865352478d489ac577931035dabecd5f846a2","observation_id":"82448664-fc0b-415b-bcdb-15e898c57658","resolution":{"observed_at":"2026-08-16T05:38:39.550873Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:38:39.534148Z","title":"Brains and algorithms partially converge in natural language processing","venue":null,"work_id":"b5350833-8d72-4db9-a96c-93add578a513","year":2022},"citing_paper":{"arxiv_id":"2504.21047","last_updated":"2025-04-29T00:17:53Z","snapshot_observed_at":"2026-08-19T02:05:08.187474Z","submitted_at":"2025-04-29T00:17:53Z","title":"Model Connectomes: A Generational Approach to Data-Efficient Language Models","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-16T05:38:36.622563Z"},"links":{"citing_paper":"/paper/2504.21047"},"observation_digest":"sha256:1461ed0ee7f8348679c6c073ec258069ce19afa35ef19e6b6ae6c8474c877e04","observation_id":"abcc7647-97a8-4e40-b0c9-acce367a1d11","resolution":{"observed_at":"2026-08-16T05:38:39.538166Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:38:39.521438Z","title":"Shared computational principles for language processing in humans and deep language models.Nature neuroscience, 25(3):369–380, 2022","venue":null,"work_id":"de40af2b-75e2-44c7-b2e7-cdc269311d05","year":2022},"citing_paper":{"arxiv_id":"2504.21047","last_updated":"2025-04-29T00:17:53Z","snapshot_observed_at":"2026-08-19T02:05:08.187474Z","submitted_at":"2025-04-29T00:17:53Z","title":"Model Connectomes: A Generational Approach to Data-Efficient Language Models","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-16T05:38:36.627319Z"},"links":{"citing_paper":"/paper/2504.21047"},"observation_digest":"sha256:2764b8dbb4f0acc9a2f9fe8bf93c7680be14791a712b99b80490b19f52022343","observation_id":"2c8b4712-e539-44f2-a3d5-96b69d627e31","resolution":{"observed_at":"2026-08-16T05:38:39.526094Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:38:39.464577Z","title":"Gptq: Accu- rate post-training quantization for generative pre-trained transformers, 2022","venue":null,"work_id":"737b3426-01ce-4939-9069-5ab4fc1fa516","year":2022},"citing_paper":{"arxiv_id":"2504.21047","last_updated":"2025-04-29T00:17:53Z","snapshot_observed_at":"2026-08-19T02:05:08.187474Z","submitted_at":"2025-04-29T00:17:53Z","title":"Model Connectomes: A Generational Approach to Data-Efficient Language Models","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-16T05:38:36.632326Z"},"links":{"citing_paper":"/paper/2504.21047"},"observation_digest":"sha256:4ba8df9fa8dc55e18c06ce9430f8053f4fc8d73b9be2b855a8b389e1a749b541","observation_id":"28edc966-e31f-491a-a822-086dcf49fb6e","resolution":{"observed_at":"2026-08-16T05:38:39.512898Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:38:39.262689Z","title":"Movement pruning: Adaptive sparsity by fine-tuning","venue":null,"work_id":"da299991-f104-45d7-bba9-1dc3682517f6","year":2020},"citing_paper":{"arxiv_id":"2504.21047","last_updated":"2025-04-29T00:17:53Z","snapshot_observed_at":"2026-08-19T02:05:08.187474Z","submitted_at":"2025-04-29T00:17:53Z","title":"Model Connectomes: A Generational Approach to Data-Efficient Language Models","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-16T05:38:36.637305Z"},"links":{"citing_paper":"/paper/2504.21047"},"observation_digest":"sha256:ed0c3767344f502d2688cc7474f4c9ef8bcfbdee826d4fa9375b9c1d24fbcba1","observation_id":"b642b35f-a803-4871-a8d7-aed2b4319e68","resolution":{"observed_at":"2026-08-16T05:38:39.361650Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:38:39.245046Z","title":"Le, Geoffrey Hinton, and Jeff Dean","venue":null,"work_id":"a27db04a-cbeb-4bd5-9205-53548469f61b","year":2017},"citing_paper":{"arxiv_id":"2504.21047","last_updated":"2025-04-29T00:17:53Z","snapshot_observed_at":"2026-08-19T02:05:08.187474Z","submitted_at":"2025-04-29T00:17:53Z","title":"Model Connectomes: A Generational Approach to Data-Efficient Language Models","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-16T05:38:36.642097Z"},"links":{"citing_paper":"/paper/2504.21047"},"observation_digest":"sha256:c6d964938cac135e02d84d430979e12bb5bd8c373ed1af0cc4995d5233bd29d3","observation_id":"a4b9809c-6559-487e-8b0d-bc197a322a83","resolution":{"observed_at":"2026-08-16T05:38:39.249143Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:38:39.232782Z","title":"The lottery ticket hypothesis: Finding sparse, trainable neural networks","venue":null,"work_id":"4504c333-75b0-4b6b-80b4-787c941d74f6","year":2019},"citing_paper":{"arxiv_id":"2504.21047","last_updated":"2025-04-29T00:17:53Z","snapshot_observed_at":"2026-08-19T02:05:08.187474Z","submitted_at":"2025-04-29T00:17:53Z","title":"Model Connectomes: A Generational Approach to Data-Efficient Language Models","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-16T05:38:36.677212Z"},"links":{"citing_paper":"/paper/2504.21047"},"observation_digest":"sha256:9d98301831abbe14a2167043219cef2944b3f88674d6ad7c35d94aa9223cf7c1","observation_id":"3e952e49-9bba-460d-8688-654f9f702a41","resolution":{"observed_at":"2026-08-16T05:38:39.236828Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:38:39.220341Z","title":"Unmasking the lottery ticket hypothesis: What’s encoded in a winning ticket’s mask? In Proceedings of the International Conference on Learning Representations (ICLR), 2023","venue":null,"work_id":"477dc8d1-b411-4f6a-9bab-03fc4e5e8ded","year":2023},"citing_paper":{"arxiv_id":"2504.21047","last_updated":"2025-04-29T00:17:53Z","snapshot_observed_at":"2026-08-19T02:05:08.187474Z","submitted_at":"2025-04-29T00:17:53Z","title":"Model Connectomes: A Generational Approach to Data-Efficient Language Models","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-16T05:38:36.712872Z"},"links":{"citing_paper":"/paper/2504.21047"},"observation_digest":"sha256:3dd20183cdeb93c88de4e1f6c1625b8c3fd8fa4565695a15436b0dfcf11695c9","observation_id":"6bfdd6fb-c911-4407-9c98-66f8344f728a","resolution":{"observed_at":"2026-08-16T05:38:39.224674Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:38:39.117119Z","title":"Lottery ticket adaptation: Mitigating destructive interference in llms,","venue":null,"work_id":"72a14dfe-bc60-46e3-a9be-9bacac41aca3","year":null},"citing_paper":{"arxiv_id":"2504.21047","last_updated":"2025-04-29T00:17:53Z","snapshot_observed_at":"2026-08-19T02:05:08.187474Z","submitted_at":"2025-04-29T00:17:53Z","title":"Model Connectomes: A Generational Approach to Data-Efficient Language Models","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-16T05:38:36.770876Z"},"links":{"citing_paper":"/paper/2504.21047"},"observation_digest":"sha256:c0f8611e7dfa348b510f149b08779cf7e195bb53677739a56e796e8b69e13b5a","observation_id":"752bce38-be6d-43b6-975a-312552e59892","resolution":{"observed_at":"2026-08-16T05:38:39.211602Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:38:39.016510Z","title":"Lottery tickets in llms: Robustness to adversarial examples via binary masking","venue":null,"work_id":"8ebd8d6a-950d-43fa-afa8-dd20ff6edcdd","year":2022},"citing_paper":{"arxiv_id":"2504.21047","last_updated":"2025-04-29T00:17:53Z","snapshot_observed_at":"2026-08-19T02:05:08.187474Z","submitted_at":"2025-04-29T00:17:53Z","title":"Model Connectomes: A Generational Approach to Data-Efficient Language Models","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-16T05:38:36.781083Z"},"links":{"citing_paper":"/paper/2504.21047"},"observation_digest":"sha256:d5f25a55eab72002b7e281d5496eb863124f35da5434818a649aa1cb8fa85f2e","observation_id":"8671004e-9552-460d-947a-5075dfc47a99","resolution":{"observed_at":"2026-08-16T05:38:39.021129Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:38:39.002114Z","title":"Sparse winning tickets are data-efficient image recognizers","venue":null,"work_id":"7929c8e0-d560-4f9c-8a6c-734c6f7fbe91","year":2022},"citing_paper":{"arxiv_id":"2504.21047","last_updated":"2025-04-29T00:17:53Z","snapshot_observed_at":"2026-08-19T02:05:08.187474Z","submitted_at":"2025-04-29T00:17:53Z","title":"Model Connectomes: A Generational Approach to Data-Efficient Language Models","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-16T05:38:36.786648Z"},"links":{"citing_paper":"/paper/2504.21047"},"observation_digest":"sha256:cc9c32b9e122d77c573655e00fe2c0035b550dd1a17c52d4c1808e40a7bb9d8d","observation_id":"2e2c4ac0-bf54-40b8-8214-6af3c756bd95","resolution":{"observed_at":"2026-08-16T05:38:39.007385Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:38:36.793208Z","title":"Pruning neural networks without any data by iteratively conserving synaptic flow","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2504.21047","last_updated":"2025-04-29T00:17:53Z","snapshot_observed_at":"2026-08-19T02:05:08.187474Z","submitted_at":"2025-04-29T00:17:53Z","title":"Model Connectomes: A Generational Approach to Data-Efficient Language Models","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-16T05:38:36.793208Z"},"links":{"citing_paper":"/paper/2504.21047"},"observation_digest":"sha256:e26f48e534168abc08c665fa08994496c8b3558073fc742ba125b5dacd08ee5a","observation_id":"742e369a-c452-478c-bf6e-695260a217b9","resolution":{"observed_at":"2026-08-16T05:38:36.793208Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:38:38.974927Z","title":"Deconstructing lottery tickets: Zeros, signs, and the supermask","venue":null,"work_id":"b7940179-78f6-4635-82a5-29bc03c20963","year":2019},"citing_paper":{"arxiv_id":"2504.21047","last_updated":"2025-04-29T00:17:53Z","snapshot_observed_at":"2026-08-19T02:05:08.187474Z","submitted_at":"2025-04-29T00:17:53Z","title":"Model Connectomes: A Generational Approach to Data-Efficient Language Models","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-16T05:38:36.800131Z"},"links":{"citing_paper":"/paper/2504.21047"},"observation_digest":"sha256:8ede95dd8bb0a53d6a8690013b8ea16f45f84d14568768fc63a8fff7d93961e5","observation_id":"e68d300f-80e5-4d0f-a432-d30459a21f65","resolution":{"observed_at":"2026-08-16T05:38:38.981519Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:38:38.957771Z","title":"Complex com- putation from developmental priors","venue":null,"work_id":"9d3e90f5-07e3-461f-8541-fa168461ff6a","year":2023},"citing_paper":{"arxiv_id":"2504.21047","last_updated":"2025-04-29T00:17:53Z","snapshot_observed_at":"2026-08-19T02:05:08.187474Z","submitted_at":"2025-04-29T00:17:53Z","title":"Model Connectomes: A Generational Approach to Data-Efficient Language Models","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-16T05:38:36.809794Z"},"links":{"citing_paper":"/paper/2504.21047"},"observation_digest":"sha256:5bf9154c0a07100bac9988d958adb69072b2baaa0d92906e5fd5b7998ec3be0f","observation_id":"837cedff-ab58-4cdc-96ef-101ee91b6335","resolution":{"observed_at":"2026-08-16T05:38:38.964389Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:38:36.854759Z","title":"Encoding innate ability through a genomic bottleneck","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.21047","last_updated":"2025-04-29T00:17:53Z","snapshot_observed_at":"2026-08-19T02:05:08.187474Z","submitted_at":"2025-04-29T00:17:53Z","title":"Model Connectomes: A Generational Approach to Data-Efficient Language Models","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-16T05:38:36.854759Z"},"links":{"citing_paper":"/paper/2504.21047"},"observation_digest":"sha256:a27c7bc3bb35982fc2b88c382e09634efcd4fe50082f8be8671defaa4d2d2766","observation_id":"767c8859-9eac-4353-b896-ae8f3f747d0e","resolution":{"observed_at":"2026-08-16T05:38:36.854759Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.10262","last_updated":"2023-10-16T10:38:49Z","snapshot_observed_at":"2026-08-19T08:50:29.858055Z","submitted_at":"2023-10-16T10:38:49Z","title":"Enhancing Interpretability using Human Similarity Judgements to Prune Word Embeddings","version":1},"cited_work":{"arxiv_id":"2310.10262","doi":null,"metadata_source":"pith","pith_arxiv_id":"2310.10262","snapshot_observed_at":"2026-08-16T05:38:37.854777Z","title":"Enhancing Interpretability using Human Similarity Judgements to Prune Word Embeddings","venue":"cs.CL","work_id":"0e21161b-9e97-4436-8e47-6660d69200bb","year":2023},"citing_paper":{"arxiv_id":"2504.21047","last_updated":"2025-04-29T00:17:53Z","snapshot_observed_at":"2026-08-19T02:05:08.187474Z","submitted_at":"2025-04-29T00:17:53Z","title":"Model Connectomes: A Generational Approach to Data-Efficient Language Models","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-16T05:38:36.955859Z"},"links":{"cited_paper":"/paper/2310.10262","citing_paper":"/paper/2504.21047"},"observation_digest":"sha256:3b23d2bbff44ddff72bf69001edfc6f16a28116968c3990eab05b84633e25e53","observation_id":"6a0d292c-1290-40b0-8d0f-2d059dd7fb94","resolution":{"observed_at":"2026-08-16T05:38:37.882693Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:38:38.877652Z","title":"Pruning sparse features for cognitive modeling","venue":null,"work_id":"852839ff-a871-4833-b58d-8ee8691b2991","year":2024},"citing_paper":{"arxiv_id":"2504.21047","last_updated":"2025-04-29T00:17:53Z","snapshot_observed_at":"2026-08-19T02:05:08.187474Z","submitted_at":"2025-04-29T00:17:53Z","title":"Model Connectomes: A Generational Approach to Data-Efficient Language Models","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-16T05:38:37.040238Z"},"links":{"citing_paper":"/paper/2504.21047"},"observation_digest":"sha256:a8ebe2e894f786135e9974c2132872376c1c35259eaa9610fe304f31511a748a","observation_id":"81a7c370-8c94-416e-b6f1-4b2f2e023429","resolution":{"observed_at":"2026-08-16T05:38:38.936037Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:38:38.818136Z","title":"American parenting of language-learning children: Persisting differences in family-child interactions observed in natural home environments","venue":null,"work_id":"ef05134c-2bec-4099-8e1a-719e328686bc","year":1992},"citing_paper":{"arxiv_id":"2504.21047","last_updated":"2025-04-29T00:17:53Z","snapshot_observed_at":"2026-08-19T02:05:08.187474Z","submitted_at":"2025-04-29T00:17:53Z","title":"Model Connectomes: A Generational Approach to Data-Efficient Language Models","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-16T05:38:37.053054Z"},"links":{"citing_paper":"/paper/2504.21047"},"observation_digest":"sha256:31c22632bc85fdb9746a562ceeb1a3a393f11bf8c9896cc7198717a91011e7ef","observation_id":"8b7f8df6-4d05-4ea5-82be-ef36ae693424","resolution":{"observed_at":"2026-08-16T05:38:38.846134Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:38:38.801173Z","title":"The fineweb datasets: Decanting the web for the finest text data at scale","venue":null,"work_id":"40fc6af3-3825-4d7d-81a3-45cd9cdfedd7","year":2024},"citing_paper":{"arxiv_id":"2504.21047","last_updated":"2025-04-29T00:17:53Z","snapshot_observed_at":"2026-08-19T02:05:08.187474Z","submitted_at":"2025-04-29T00:17:53Z","title":"Model Connectomes: A Generational Approach to Data-Efficient Language Models","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-16T05:38:37.059027Z"},"links":{"citing_paper":"/paper/2504.21047"},"observation_digest":"sha256:e3b72cf6c2b224eb9d97b6c1c65c9a9d5b6ec0e0791ef7dcf4a103cbf809998e","observation_id":"ad1ad28f-c94c-4d7f-b403-02b818144886","resolution":{"observed_at":"2026-08-16T05:38:38.807054Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:38:37.063219Z","title":"modded-nanogpt: Speedrunning the nanogpt baseline, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.21047","last_updated":"2025-04-29T00:17:53Z","snapshot_observed_at":"2026-08-19T02:05:08.187474Z","submitted_at":"2025-04-29T00:17:53Z","title":"Model Connectomes: A Generational Approach to Data-Efficient Language Models","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-16T05:38:37.063219Z"},"links":{"citing_paper":"/paper/2504.21047"},"observation_digest":"sha256:a8a71419cabf143cac4e8cf8eeaf915451ee2e2f27eceb36c8f24c3618f02c82","observation_id":"0baff369-1489-43e2-a941-bd67b0aeddc8","resolution":{"observed_at":"2026-08-16T05:38:37.063219Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:38:38.769559Z","title":"Hellaswag: Can a machine really finish your sentence? In Proceedings of the AAAI Conference on Artificial Intelligence, pages 11867–11878","venue":null,"work_id":"c5053a2d-617d-4691-bcd1-1d7638a641d1","year":2019},"citing_paper":{"arxiv_id":"2504.21047","last_updated":"2025-04-29T00:17:53Z","snapshot_observed_at":"2026-08-19T02:05:08.187474Z","submitted_at":"2025-04-29T00:17:53Z","title":"Model Connectomes: A Generational Approach to Data-Efficient Language Models","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-16T05:38:37.068439Z"},"links":{"citing_paper":"/paper/2504.21047"},"observation_digest":"sha256:1624faae0ccd808cacd535d1651bfaf5c13df1b19043898597832ed212234d38","observation_id":"aed2d034-f9c5-4ff1-b6f5-37b5ceae8c62","resolution":{"observed_at":"2026-08-16T05:38:38.775155Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:38:38.670792Z","title":"Measuring massive multitask language understanding, 2021","venue":null,"work_id":"24f3ea82-9d19-45fc-88a8-915a355e9fcf","year":2021},"citing_paper":{"arxiv_id":"2504.21047","last_updated":"2025-04-29T00:17:53Z","snapshot_observed_at":"2026-08-19T02:05:08.187474Z","submitted_at":"2025-04-29T00:17:53Z","title":"Model Connectomes: A Generational Approach to Data-Efficient Language Models","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-16T05:38:37.072697Z"},"links":{"citing_paper":"/paper/2504.21047"},"observation_digest":"sha256:78619bb607165f180c85bfd584b4d942b20f36d8e48bed6ba525293d35f607f4","observation_id":"c07068fe-7f11-4a98-9164-6fb764ed2d39","resolution":{"observed_at":"2026-08-16T05:38:38.719658Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2006.01912","last_updated":"2020-06-02T19:47:01Z","snapshot_observed_at":"2026-08-13T13:09:05.402880Z","submitted_at":"2020-06-02T19:47:01Z","title":"On the Predictive Power of Neural Language Models for Human Real-Time Comprehension Behavior","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2006.01912","snapshot_observed_at":"2026-08-16T05:38:37.077764Z","title":"On the predictive power of neural language models for human real-time comprehension behavior","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2504.21047","last_updated":"2025-04-29T00:17:53Z","snapshot_observed_at":"2026-08-19T02:05:08.187474Z","submitted_at":"2025-04-29T00:17:53Z","title":"Model Connectomes: A Generational Approach to Data-Efficient Language Models","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-16T05:38:37.077764Z"},"links":{"cited_paper":"/paper/2006.01912","citing_paper":"/paper/2504.21047"},"observation_digest":"sha256:86835a891633642adeeae81b9b5181a20daf805df459308accd47f909d50b707","observation_id":"3893c908-c4f7-4e8d-b696-046adee30bf2","resolution":{"observed_at":"2026-08-16T05:38:37.077764Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:38:38.500618Z","title":null,"venue":null,"work_id":"9d650ee0-e63e-4344-bd7c-44a01e3bc154","year":2023},"citing_paper":{"arxiv_id":"2504.21047","last_updated":"2025-04-29T00:17:53Z","snapshot_observed_at":"2026-08-19T02:05:08.187474Z","submitted_at":"2025-04-29T00:17:53Z","title":"Model Connectomes: A Generational Approach to Data-Efficient Language Models","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-16T05:38:37.082646Z"},"links":{"citing_paper":"/paper/2504.21047"},"observation_digest":"sha256:46f9d23ff5e6fa17d7fb5a6cd334f6e1601eda32c718aa1ba7da9393532d4197","observation_id":"e1643366-2c6a-4774-ab3f-fac6818b2efe","resolution":{"observed_at":"2026-08-16T05:38:38.583094Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:38:37.087051Z","title":"Word frequency and predictability dissociate in naturalistic reading","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.21047","last_updated":"2025-04-29T00:17:53Z","snapshot_observed_at":"2026-08-19T02:05:08.187474Z","submitted_at":"2025-04-29T00:17:53Z","title":"Model Connectomes: A Generational Approach to Data-Efficient Language Models","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-16T05:38:37.087051Z"},"links":{"citing_paper":"/paper/2504.21047"},"observation_digest":"sha256:b334f1611d7edc7e1ad17200f97c88966eca03311865b8aa3c21c16861e3a486","observation_id":"3d433734-0b38-4c10-81cb-f6f6fd608e95","resolution":{"observed_at":"2026-08-16T05:38:37.087051Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:38:38.466430Z","title":"A probabilistic earley parser as a psycholinguistic model","venue":null,"work_id":"97fbfeae-92f5-4de8-8df7-0ee52d745773","year":2001},"citing_paper":{"arxiv_id":"2504.21047","last_updated":"2025-04-29T00:17:53Z","snapshot_observed_at":"2026-08-19T02:05:08.187474Z","submitted_at":"2025-04-29T00:17:53Z","title":"Model Connectomes: A Generational Approach to Data-Efficient Language Models","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-16T05:38:37.091450Z"},"links":{"citing_paper":"/paper/2504.21047"},"observation_digest":"sha256:f47f9b528c72c9b2c9d04592a8c9603ddc382ae2a9e0ce951029037882f00d83","observation_id":"1b9d2d8a-c70c-47c7-a85e-51d704e6aa22","resolution":{"observed_at":"2026-08-16T05:38:38.472801Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:38:38.450664Z","title":"The effect of word predictability on reading time is loga- rithmic","venue":null,"work_id":"8bb378ef-38c5-4ca1-b2cd-621cc2d356e9","year":2013},"citing_paper":{"arxiv_id":"2504.21047","last_updated":"2025-04-29T00:17:53Z","snapshot_observed_at":"2026-08-19T02:05:08.187474Z","submitted_at":"2025-04-29T00:17:53Z","title":"Model Connectomes: A Generational Approach to Data-Efficient Language Models","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-16T05:38:37.097083Z"},"links":{"citing_paper":"/paper/2504.21047"},"observation_digest":"sha256:56ba58025107e7820a42f8f0323e0600e2b1123a25d9568cb6fff353a74584eb","observation_id":"650d84ce-6ebf-4182-b207-73e219070ff1","resolution":{"observed_at":"2026-08-16T05:38:38.455863Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:38:38.434312Z","title":"The natural stories corpus: a reading-time corpus of english texts containing rare syntactic constructions","venue":null,"work_id":"b3383a00-f70f-418a-b576-92a37f52c7d4","year":2021},"citing_paper":{"arxiv_id":"2504.21047","last_updated":"2025-04-29T00:17:53Z","snapshot_observed_at":"2026-08-19T02:05:08.187474Z","submitted_at":"2025-04-29T00:17:53Z","title":"Model Connectomes: A Generational Approach to Data-Efficient Language Models","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-16T05:38:37.101855Z"},"links":{"citing_paper":"/paper/2504.21047"},"observation_digest":"sha256:70753d22ebd864c630ebb88ffae335878a1bd35f62eb0a59bf3cec29940a7374","observation_id":"be048b5d-8b92-4f8b-92ca-6ce5087cada6","resolution":{"observed_at":"2026-08-16T05:38:38.440629Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.00575","last_updated":"2024-08-09T04:33:58Z","snapshot_observed_at":"2026-08-16T14:38:28.284056Z","submitted_at":"2023-12-01T13:31:02Z","title":"Instruction-tuning Aligns LLMs to the Human Brain","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.00575","snapshot_observed_at":"2026-08-16T05:38:37.106333Z","title":"Instruction-tuning aligns llms to the human brain","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.21047","last_updated":"2025-04-29T00:17:53Z","snapshot_observed_at":"2026-08-19T02:05:08.187474Z","submitted_at":"2025-04-29T00:17:53Z","title":"Model Connectomes: A Generational Approach to Data-Efficient Language Models","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-16T05:38:37.106333Z"},"links":{"cited_paper":"/paper/2312.00575","citing_paper":"/paper/2504.21047"},"observation_digest":"sha256:ab07e191b9c8ef37895f3364913bb8ac3a21edf5ba67ed1a6559d8a5204ad5ca","observation_id":"7aaf19c9-8c2b-496b-aba6-69af289bd8f9","resolution":{"observed_at":"2026-08-16T05:38:37.106333Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.15109","last_updated":"2024-06-21T12:54:03Z","snapshot_observed_at":"2026-08-16T13:40:45.547051Z","submitted_at":"2024-06-21T12:54:03Z","title":"Brain-Like Language Processing via a Shallow Untrained Multihead Attention Network","version":1},"cited_work":{"arxiv_id":"2406.15109","doi":null,"metadata_source":"pith","pith_arxiv_id":"2406.15109","snapshot_observed_at":"2026-08-16T05:38:37.790553Z","title":"Brain-Like Language Processing via a Shallow Untrained Multihead Attention Network","venue":"cs.CL","work_id":"e6b71dac-7964-4d83-998d-d02ce0d2fbd1","year":2024},"citing_paper":{"arxiv_id":"2504.21047","last_updated":"2025-04-29T00:17:53Z","snapshot_observed_at":"2026-08-19T02:05:08.187474Z","submitted_at":"2025-04-29T00:17:53Z","title":"Model Connectomes: A Generational Approach to Data-Efficient Language Models","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-16T05:38:37.112078Z"},"links":{"cited_paper":"/paper/2406.15109","citing_paper":"/paper/2504.21047"},"observation_digest":"sha256:64bc892c19385f2f80357902ff0d0fc909de81d71e9f498fb7b77c70233ca004","observation_id":"bf37a86a-c9a9-4d48-a1b6-9d1c67a3cbb6","resolution":{"observed_at":"2026-08-16T05:38:37.794971Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.11389","last_updated":"2023-10-22T20:03:54Z","snapshot_observed_at":"2026-08-16T15:38:31.656666Z","submitted_at":"2023-04-22T12:50:49Z","title":"Transformer-Based Language Model Surprisal Predicts Human Reading Times Best with About Two Billion Training Tokens","version":2},"cited_work":{"arxiv_id":"2304.11389","doi":null,"metadata_source":"pith","pith_arxiv_id":"2304.11389","snapshot_observed_at":"2026-08-16T05:38:37.738906Z","title":"Transformer-Based Language Model Surprisal Predicts Human Reading Times Best with About Two Billion Training Tokens","venue":"cs.CL","work_id":"61b8c7a3-8c02-4bab-b645-268575dd4a19","year":2023},"citing_paper":{"arxiv_id":"2504.21047","last_updated":"2025-04-29T00:17:53Z","snapshot_observed_at":"2026-08-19T02:05:08.187474Z","submitted_at":"2025-04-29T00:17:53Z","title":"Model Connectomes: A Generational Approach to Data-Efficient Language Models","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-16T05:38:37.175734Z"},"links":{"cited_paper":"/paper/2304.11389","citing_paper":"/paper/2504.21047"},"observation_digest":"sha256:18a953c675057c64c2c387aa68f2103177755e037c8b257c8cb8fc97e9f545ea","observation_id":"553d5476-c038-4380-bef2-dcb384fba41d","resolution":{"observed_at":"2026-08-16T05:38:37.773705Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.04547","last_updated":"2023-11-08T09:26:27Z","snapshot_observed_at":"2026-08-16T14:45:02.651603Z","submitted_at":"2023-11-08T09:26:27Z","title":"Large GPT-like Models are Bad Babies: A Closer Look at the Relationship between Linguistic Competence and Psycholinguistic Measures","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.04547","snapshot_observed_at":"2026-08-16T05:38:37.244659Z","title":"Large gpt-like models are bad babies: A closer look at the relationship between linguistic competence and psycholinguistic measures","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.21047","last_updated":"2025-04-29T00:17:53Z","snapshot_observed_at":"2026-08-19T02:05:08.187474Z","submitted_at":"2025-04-29T00:17:53Z","title":"Model Connectomes: A Generational Approach to Data-Efficient Language Models","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-16T05:38:37.244659Z"},"links":{"cited_paper":"/paper/2311.04547","citing_paper":"/paper/2504.21047"},"observation_digest":"sha256:7546d4404b445198f5f33d945f9a9fa0ef6be70f082266291779039f7d469cb6","observation_id":"1c02f142-52d3-4add-8f10-4658bd39ad2b","resolution":{"observed_at":"2026-08-16T05:38:37.244659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.02255","last_updated":"2024-02-03T20:22:54Z","snapshot_observed_at":"2026-08-16T14:21:49.528808Z","submitted_at":"2024-02-03T20:22:54Z","title":"Frequency Explains the Inverse Correlation of Large Language Models' Size, Training Data Amount, and Surprisal's Fit to Reading Times","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.02255","snapshot_observed_at":"2026-08-16T05:38:37.248750Z","title":"Frequency explains the inverse correlation of large language models’ size, training data amount, and surprisal’s fit to reading times.arXiv preprint arXiv:2402.02255, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.21047","last_updated":"2025-04-29T00:17:53Z","snapshot_observed_at":"2026-08-19T02:05:08.187474Z","submitted_at":"2025-04-29T00:17:53Z","title":"Model Connectomes: A Generational Approach to Data-Efficient Language Models","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-16T05:38:37.248750Z"},"links":{"cited_paper":"/paper/2402.02255","citing_paper":"/paper/2504.21047"},"observation_digest":"sha256:4a6afa42bb5557c1ea5c2e461c8c002f9241743e8587b4fab69f50617c685770","observation_id":"2387bb5e-23d0-46cc-be17-ba414cad24d3","resolution":{"observed_at":"2026-08-16T05:38:37.248750Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:38:38.377393Z","title":"Scaling in cognitive modelling: A multilingual approach to human reading times","venue":null,"work_id":"6fae1f75-f284-496b-8c76-b4a4e3a16279","year":2023},"citing_paper":{"arxiv_id":"2504.21047","last_updated":"2025-04-29T00:17:53Z","snapshot_observed_at":"2026-08-19T02:05:08.187474Z","submitted_at":"2025-04-29T00:17:53Z","title":"Model Connectomes: A Generational Approach to Data-Efficient Language Models","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-16T05:38:37.253457Z"},"links":{"citing_paper":"/paper/2504.21047"},"observation_digest":"sha256:79ce38b3b70f1d028890a167811e28135f767bb0f1dce51d9faf1bb2bb57c8ee","observation_id":"9493fcf3-225d-406b-9ab9-903ef787e29c","resolution":{"observed_at":"2026-08-16T05:38:38.417594Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:38:38.297736Z","title":"New method for fmri investigations of language: defining rois functionally in individual subjects","venue":null,"work_id":"de0eaf63-9389-47a1-bb23-de1b3885ed1f","year":2010},"citing_paper":{"arxiv_id":"2504.21047","last_updated":"2025-04-29T00:17:53Z","snapshot_observed_at":"2026-08-19T02:05:08.187474Z","submitted_at":"2025-04-29T00:17:53Z","title":"Model Connectomes: A Generational Approach to Data-Efficient Language Models","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-16T05:38:37.258055Z"},"links":{"citing_paper":"/paper/2504.21047"},"observation_digest":"sha256:d582661ef70064995429a075e04d973c56ffc849f38665ea2029cb07c8b24278","observation_id":"41a9b749-1c28-482c-83b7-dbc864e9572f","resolution":{"observed_at":"2026-08-16T05:38:38.341021Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:38:38.233868Z","title":"Driving and suppressing the human lan- guage network using large language models","venue":null,"work_id":"819ba94a-dce2-488f-8c7d-7d8d394d4909","year":2024},"citing_paper":{"arxiv_id":"2504.21047","last_updated":"2025-04-29T00:17:53Z","snapshot_observed_at":"2026-08-19T02:05:08.187474Z","submitted_at":"2025-04-29T00:17:53Z","title":"Model Connectomes: A Generational Approach to Data-Efficient Language Models","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-16T05:38:37.261904Z"},"links":{"citing_paper":"/paper/2504.21047"},"observation_digest":"sha256:7e71b9d63795b637324f2410603fe4236aa8755e15c51f553c184da234c387e4","observation_id":"7ae4d640-0dc5-4ba1-9b2f-a529a00305a8","resolution":{"observed_at":"2026-08-16T05:38:38.240553Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.02280","last_updated":"2025-02-13T15:21:43Z","snapshot_observed_at":"2026-08-18T21:56:07.890858Z","submitted_at":"2024-11-04T17:09:10Z","title":"The LLM Language Network: A Neuroscientific Approach for Identifying Causally Task-Relevant Units","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.02280","snapshot_observed_at":"2026-08-16T05:38:37.265820Z","title":"The llm language network: A neuroscientific approach for identifying causally task-relevant units.arXiv preprint arXiv:2411.02280, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.21047","last_updated":"2025-04-29T00:17:53Z","snapshot_observed_at":"2026-08-19T02:05:08.187474Z","submitted_at":"2025-04-29T00:17:53Z","title":"Model Connectomes: A Generational Approach to Data-Efficient Language Models","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-16T05:38:37.265820Z"},"links":{"cited_paper":"/paper/2411.02280","citing_paper":"/paper/2504.21047"},"observation_digest":"sha256:3c37cdee79a3d9bd80927ffa05e11a14f6d694acd44aa0e08a1398248630809c","observation_id":"24434a2b-9c2e-4632-84d6-1302fafc7148","resolution":{"observed_at":"2026-08-16T05:38:37.265820Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1503.02531","last_updated":"2015-03-09T15:44:49Z","snapshot_observed_at":"2026-08-16T18:00:58.008096Z","submitted_at":"2015-03-09T15:44:49Z","title":"Distilling the Knowledge in a Neural Network","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1503.02531","snapshot_observed_at":"2026-08-16T05:38:37.270182Z","title":"Distilling the knowledge in a neural network","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2504.21047","last_updated":"2025-04-29T00:17:53Z","snapshot_observed_at":"2026-08-19T02:05:08.187474Z","submitted_at":"2025-04-29T00:17:53Z","title":"Model Connectomes: A Generational Approach to Data-Efficient Language Models","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-16T05:38:37.270182Z"},"links":{"cited_paper":"/paper/1503.02531","citing_paper":"/paper/2504.21047"},"observation_digest":"sha256:7a9aeab19b7ebce62c7855f632775037d00252c365fead72112f8a8f7d9e9c5f","observation_id":"486719cd-ea37-4c03-82ce-bd1aa03f9ef4","resolution":{"observed_at":"2026-08-16T05:38:37.270182Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:38:38.217904Z","title":"Big self-supervised models are strong semi-supervised learners","venue":null,"work_id":"18a84c43-7cad-429c-b677-d1951c8ea049","year":2020},"citing_paper":{"arxiv_id":"2504.21047","last_updated":"2025-04-29T00:17:53Z","snapshot_observed_at":"2026-08-19T02:05:08.187474Z","submitted_at":"2025-04-29T00:17:53Z","title":"Model Connectomes: A Generational Approach to Data-Efficient Language Models","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-16T05:38:37.273840Z"},"links":{"citing_paper":"/paper/2504.21047"},"observation_digest":"sha256:e03aa590d40c3df3b71ed36ff2edcc46801c2323e8fa3f8ffaac943a070b0276","observation_id":"03ec4639-98df-49e4-b019-4624cb7722ff","resolution":{"observed_at":"2026-08-16T05:38:38.223962Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1701.08734","last_updated":"2017-01-30T18:06:07Z","snapshot_observed_at":"2026-08-14T21:18:51.601049Z","submitted_at":"2017-01-30T18:06:07Z","title":"PathNet: Evolution Channels Gradient Descent in Super Neural Networks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1701.08734","snapshot_observed_at":"2026-08-16T05:38:37.277239Z","title":"Pathnet: Evolution channels gradient de- scent in super neural networks","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2504.21047","last_updated":"2025-04-29T00:17:53Z","snapshot_observed_at":"2026-08-19T02:05:08.187474Z","submitted_at":"2025-04-29T00:17:53Z","title":"Model Connectomes: A Generational Approach to Data-Efficient Language Models","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-16T05:38:37.277239Z"},"links":{"cited_paper":"/paper/1701.08734","citing_paper":"/paper/2504.21047"},"observation_digest":"sha256:2897569e913b771473c7aa85411302c0b6814bb49e4a95e6bed584d84eb56be0","observation_id":"1a0ec43a-297c-4ad1-90a0-8643f18e0011","resolution":{"observed_at":"2026-08-16T05:38:37.277239Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:38:38.202128Z","title":"Learning both weights and connections for efficient neural networks","venue":null,"work_id":"5a728f31-3809-4267-b255-41d9ec8aa58a","year":2015},"citing_paper":{"arxiv_id":"2504.21047","last_updated":"2025-04-29T00:17:53Z","snapshot_observed_at":"2026-08-19T02:05:08.187474Z","submitted_at":"2025-04-29T00:17:53Z","title":"Model Connectomes: A Generational Approach to Data-Efficient Language Models","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-16T05:38:37.281648Z"},"links":{"citing_paper":"/paper/2504.21047"},"observation_digest":"sha256:7455b95256366e8b832a1584f06c2b5b1db4e738ab6c72fbfc2400101e4b67a5","observation_id":"498fad79-88e2-48e2-9db9-13097181a067","resolution":{"observed_at":"2026-08-16T05:38:38.206720Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:38:38.185653Z","title":"Synaptic density in human frontal cortex-developmental changes and effects of aging","venue":null,"work_id":"1e89ab7c-77c0-4d18-9768-ae7d84ebfa54","year":1979},"citing_paper":{"arxiv_id":"2504.21047","last_updated":"2025-04-29T00:17:53Z","snapshot_observed_at":"2026-08-19T02:05:08.187474Z","submitted_at":"2025-04-29T00:17:53Z","title":"Model Connectomes: A Generational Approach to Data-Efficient Language Models","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-16T05:38:37.285652Z"},"links":{"citing_paper":"/paper/2504.21047"},"observation_digest":"sha256:a0bd5a9d2f470a0be49bd2b3fdb48c89fb8d7c93d75c1efd87e36576f934cad2","observation_id":"b2d65e16-965c-4e69-8242-ef900970e782","resolution":{"observed_at":"2026-08-16T05:38:38.191754Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:38:38.095465Z","title":"Natural evolution strategies","venue":null,"work_id":"59e37962-1883-4d97-a64e-8f45c0ff2971","year":2014},"citing_paper":{"arxiv_id":"2504.21047","last_updated":"2025-04-29T00:17:53Z","snapshot_observed_at":"2026-08-19T02:05:08.187474Z","submitted_at":"2025-04-29T00:17:53Z","title":"Model Connectomes: A Generational Approach to Data-Efficient Language Models","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-16T05:38:37.290090Z"},"links":{"citing_paper":"/paper/2504.21047"},"observation_digest":"sha256:db480014ac932f65fcbf65a90473620ee59336b1fd478a800a47c7f1bd3561fd","observation_id":"d231055b-5c97-48a2-ae0b-bf09647f582e","resolution":{"observed_at":"2026-08-16T05:38:38.151551Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:38:38.018575Z","title":"Designing neural net- works through neuroevolution","venue":null,"work_id":"eb0748e8-b5a4-476e-b034-c3f9fd3962ea","year":2019},"citing_paper":{"arxiv_id":"2504.21047","last_updated":"2025-04-29T00:17:53Z","snapshot_observed_at":"2026-08-19T02:05:08.187474Z","submitted_at":"2025-04-29T00:17:53Z","title":"Model Connectomes: A Generational Approach to Data-Efficient Language Models","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-16T05:38:37.295162Z"},"links":{"citing_paper":"/paper/2504.21047"},"observation_digest":"sha256:c1580946751c0c8631c684e7e50ffbada2d78e695dd51f0319191f7dc35e31aa","observation_id":"03864042-9046-44fe-95e7-fb2588e7a8bf","resolution":{"observed_at":"2026-08-16T05:38:38.058859Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.00593","last_updated":"2022-11-01T17:08:44Z","snapshot_observed_at":"2026-08-05T06:04:21.031867Z","submitted_at":"2022-11-01T17:08:44Z","title":"Interpretability in the Wild: a Circuit for Indirect Object Identification in GPT-2 small","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.00593","snapshot_observed_at":"2026-08-16T05:38:37.300110Z","title":"Interpretability in the wild: a circuit for indirect object identification in gpt-2 small","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2504.21047","last_updated":"2025-04-29T00:17:53Z","snapshot_observed_at":"2026-08-19T02:05:08.187474Z","submitted_at":"2025-04-29T00:17:53Z","title":"Model Connectomes: A Generational Approach to Data-Efficient Language Models","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-16T05:38:37.300110Z"},"links":{"cited_paper":"/paper/2211.00593","citing_paper":"/paper/2504.21047"},"observation_digest":"sha256:4124b6334a2032716dd1437acaae619685ebbb0db89f172c6d64492e6e19f8a6","observation_id":"bc15e902-9dbb-420c-9e39-77a312046b0b","resolution":{"observed_at":"2026-08-16T05:38:37.300110Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.19647","last_updated":"2025-03-27T05:44:45Z","snapshot_observed_at":"2026-08-14T07:35:01.333549Z","submitted_at":"2024-03-28T17:56:07Z","title":"Sparse Feature Circuits: Discovering and Editing Interpretable Causal Graphs in Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.19647","snapshot_observed_at":"2026-08-16T05:38:37.354373Z","title":"Sparse feature circuits: Discovering and editing interpretable causal graphs in language mod- els","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.21047","last_updated":"2025-04-29T00:17:53Z","snapshot_observed_at":"2026-08-19T02:05:08.187474Z","submitted_at":"2025-04-29T00:17:53Z","title":"Model Connectomes: A Generational Approach to Data-Efficient Language Models","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-16T05:38:37.354373Z"},"links":{"cited_paper":"/paper/2403.19647","citing_paper":"/paper/2504.21047"},"observation_digest":"sha256:3e0ff77507cbe23465d03ca500f7fe8b61263c8026a974854bb684920ad80a37","observation_id":"4ebb35a6-a31e-44d0-9d47-822635009f21","resolution":{"observed_at":"2026-08-16T05:38:37.354373Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:38:38.006517Z","title":"Root mean square layer normalization, 2019","venue":null,"work_id":"59ac8233-8d10-492a-b918-e5e283069f86","year":2019},"citing_paper":{"arxiv_id":"2504.21047","last_updated":"2025-04-29T00:17:53Z","snapshot_observed_at":"2026-08-19T02:05:08.187474Z","submitted_at":"2025-04-29T00:17:53Z","title":"Model Connectomes: A Generational Approach to Data-Efficient Language Models","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-16T05:38:37.426514Z"},"links":{"citing_paper":"/paper/2504.21047"},"observation_digest":"sha256:0c3f42f0737c2cdbf8be792370d5bd5d796897098efd908d172add635e3ac6c6","observation_id":"6006c113-686c-4909-a93f-494deca07ce9","resolution":{"observed_at":"2026-08-16T05:38:38.011109Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:38:37.994300Z","title":"Roformer: Enhanced transformer with rotary position embedding","venue":null,"work_id":"f1853d56-dac5-4e56-84b1-9167e2df83dc","year":2021},"citing_paper":{"arxiv_id":"2504.21047","last_updated":"2025-04-29T00:17:53Z","snapshot_observed_at":"2026-08-19T02:05:08.187474Z","submitted_at":"2025-04-29T00:17:53Z","title":"Model Connectomes: A Generational Approach to Data-Efficient Language Models","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-16T05:38:37.483685Z"},"links":{"citing_paper":"/paper/2504.21047"},"observation_digest":"sha256:a0b926533e52bde71265d65bd01b829ad96ec6c0689a80e228ebae07a4f7d169","observation_id":"3b4fc5c3-6706-4a63-8a32-8f1bf7b9ab4a","resolution":{"observed_at":"2026-08-16T05:38:37.998646Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:38:37.525087Z","title":"Brain-score: Which artificial neural network for object recognition is most brain-like? BioRxiv, page 407007, 2018","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2504.21047","last_updated":"2025-04-29T00:17:53Z","snapshot_observed_at":"2026-08-19T02:05:08.187474Z","submitted_at":"2025-04-29T00:17:53Z","title":"Model Connectomes: A Generational Approach to Data-Efficient Language Models","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-16T05:38:37.525087Z"},"links":{"citing_paper":"/paper/2504.21047"},"observation_digest":"sha256:a4ad5f90fd3f326fc3778334435bb2b8605784594af713fd6b18668b33d4e322","observation_id":"5dac39b9-b80c-4afe-b805-c03c6a7d62cc","resolution":{"observed_at":"2026-08-16T05:38:37.525087Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:38:37.970169Z","title":"Hosseini, Nancy Kanwisher, Joshua B","venue":null,"work_id":"99553218-0969-4b8e-a01e-7f74057b9c87","year":2021},"citing_paper":{"arxiv_id":"2504.21047","last_updated":"2025-04-29T00:17:53Z","snapshot_observed_at":"2026-08-19T02:05:08.187474Z","submitted_at":"2025-04-29T00:17:53Z","title":"Model Connectomes: A Generational Approach to Data-Efficient Language Models","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-16T05:38:37.529590Z"},"links":{"citing_paper":"/paper/2504.21047"},"observation_digest":"sha256:16e1908b397c60e8f7e0483ead5dc764e8cf7979b2122df3e4d667cc2e8d88b7","observation_id":"c9f64ae1-0113-4155-9db2-5230a2147c63","resolution":{"observed_at":"2026-08-16T05:38:37.975310Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.16797","last_updated":"2024-06-25T13:46:41Z","snapshot_observed_at":"2026-08-16T13:40:03.379188Z","submitted_at":"2024-06-24T16:58:23Z","title":"Lottery Ticket Adaptation: Mitigating Destructive Interference in LLMs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.16797","snapshot_observed_at":"2026-08-16T05:38:36.776118Z","title":"7 To appear at the ICLR 2025 Workshop on Representational Alignment (Re-Align)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2504.21047","last_updated":"2025-04-29T00:17:53Z","snapshot_observed_at":"2026-08-19T02:05:08.187474Z","submitted_at":"2025-04-29T00:17:53Z","title":"Model Connectomes: A Generational Approach to Data-Efficient Language Models","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-16T05:38:36.776118Z"},"links":{"cited_paper":"/paper/2406.16797","citing_paper":"/paper/2504.21047"},"observation_digest":"sha256:1fa12181c4730476a7d43d3ab237b556a1cb737afb04efcc639883ec32938a3e","observation_id":"84dcf064-9ca6-4074-9e11-4dc7cc52825a","resolution":{"observed_at":"2026-08-16T05:38:36.776118Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2504.21047","last_updated":"2025-04-29T00:17:53Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-19T02:05:08.187474Z","submitted_at":"2025-04-29T00:17:53Z","title":"Model Connectomes: A Generational Approach to Data-Efficient Language Models"},"reference_resolution":{"displayed":67,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":22,"verified_exact":3,"verified_fuzzy":42},"total_outbound_references":67},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"thesis":"As of 19 August 2026, this Paper Citation Record lists 67 of 67 outbound references and 0 inbound Pith citation observations for arXiv:2504.21047."}