{"as_of":"2026-08-16T20:45:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:8c1eaba311437356ed1e891d969a299f5d6015f437baad28e3600562d0cbb4b7","coverage":[{"denominator":171,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":100,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-16T05:51:59.825845Z","state":"measured"},{"denominator":100,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":100,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-16T06:30:59.297886+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2504.19792/citation-record","integrity":"/paper/2504.19792/integrity","json":"/paper/2504.19792/citation-record.json","paper":"/paper/2504.19792"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:51:59.405381Z","title":"Gpt- 4 technical report","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.19792","last_updated":"2025-04-28T13:36:28Z","snapshot_observed_at":"2026-08-16T16:29:22.086575Z","submitted_at":"2025-04-28T13:36:28Z","title":"Contextures: The Mechanism of Representation Learning","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-16T05:51:59.405381Z"},"links":{"citing_paper":"/paper/2504.19792"},"observation_digest":"sha256:762e154232ab0b02c456ffd69a036c38d9867d464262e01e217d964b2db77b81","observation_id":"fdef1bc4-0271-42b1-a2f1-2118a8ac0070","resolution":{"observed_at":"2026-08-16T05:51:59.405381Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:51:59.410182Z","title":"Emergence of inv ariance and disentangle- ment in deep representations","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2504.19792","last_updated":"2025-04-28T13:36:28Z","snapshot_observed_at":"2026-08-16T16:29:22.086575Z","submitted_at":"2025-04-28T13:36:28Z","title":"Contextures: The Mechanism of Representation Learning","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-16T05:51:59.410182Z"},"links":{"citing_paper":"/paper/2504.19792"},"observation_digest":"sha256:f21c98130c7823b361dcbada3a13f75770da58da27f03fe830419de302886177","observation_id":"0a4e69db-15be-4a5b-8508-a5d4af5313ee","resolution":{"observed_at":"2026-08-16T05:51:59.410182Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:51:59.413964Z","title":"\\alpha-req : Assessing representation quality in self-sup ervised learning by mea- suring eigenspectrum decay","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2504.19792","last_updated":"2025-04-28T13:36:28Z","snapshot_observed_at":"2026-08-16T16:29:22.086575Z","submitted_at":"2025-04-28T13:36:28Z","title":"Contextures: The Mechanism of Representation Learning","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-16T05:51:59.413964Z"},"links":{"citing_paper":"/paper/2504.19792"},"observation_digest":"sha256:7a3360e9f0538df97e67a88f0362eb5a932c7e68e79f861384869f6ba07cbf0e","observation_id":"a661ad87-e47b-458f-85e6-7ffb9481f630","resolution":{"observed_at":"2026-08-16T05:51:59.413964Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:51:59.417829Z","title":"S carf: Self-supervised contrastive learning using random feature corruption","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2504.19792","last_updated":"2025-04-28T13:36:28Z","snapshot_observed_at":"2026-08-16T16:29:22.086575Z","submitted_at":"2025-04-28T13:36:28Z","title":"Contextures: The Mechanism of Representation Learning","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-16T05:51:59.417829Z"},"links":{"citing_paper":"/paper/2504.19792"},"observation_digest":"sha256:cc0cea55e148f32671a409169c139a41f8d31c143fb61e356836eb9aeab3f62a","observation_id":"aec29133-436c-4f40-800b-2089b0cfa80b","resolution":{"observed_at":"2026-08-16T05:51:59.417829Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:51:59.421883Z","title":"Contrastive and non -contrastive self- supervised learning recover global and local spectral embe dding methods","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2504.19792","last_updated":"2025-04-28T13:36:28Z","snapshot_observed_at":"2026-08-16T16:29:22.086575Z","submitted_at":"2025-04-28T13:36:28Z","title":"Contextures: The Mechanism of Representation Learning","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-16T05:51:59.421883Z"},"links":{"citing_paper":"/paper/2504.19792"},"observation_digest":"sha256:04cd90b488a65a615899ca8bef6f5ca830f2db7b800719daaa68e539c4829e32","observation_id":"1650030c-1efe-4e73-81a2-6c05b3779a83","resolution":{"observed_at":"2026-08-16T05:51:59.421883Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:51:59.426349Z","title":"VICReg: Varia nce-invariance- covariance regularization for self-supervised learning","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2504.19792","last_updated":"2025-04-28T13:36:28Z","snapshot_observed_at":"2026-08-16T16:29:22.086575Z","submitted_at":"2025-04-28T13:36:28Z","title":"Contextures: The Mechanism of Representation Learning","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-16T05:51:59.426349Z"},"links":{"citing_paper":"/paper/2504.19792"},"observation_digest":"sha256:1da6f2560e366cba3eb4e463aab48436846d6c0ed5677cbe8afe5e9e81f191f5","observation_id":"c1443fd1-ba28-4e3f-a4e9-c2c0b5187986","resolution":{"observed_at":"2026-08-16T05:51:59.426349Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:51:59.430712Z","title":"Generalized discrimin ant analysis using a ker- nel approach","venue":null,"work_id":null,"year":2000},"citing_paper":{"arxiv_id":"2504.19792","last_updated":"2025-04-28T13:36:28Z","snapshot_observed_at":"2026-08-16T16:29:22.086575Z","submitted_at":"2025-04-28T13:36:28Z","title":"Contextures: The Mechanism of Representation Learning","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-16T05:51:59.430712Z"},"links":{"citing_paper":"/paper/2504.19792"},"observation_digest":"sha256:366f06026dc9ca82b4b95f737fde7844788ba28977d4b543c4d629bf1eea0b42","observation_id":"e82ee126-aa27-494e-a356-3d2fc7e8b2a9","resolution":{"observed_at":"2026-08-16T05:51:59.430712Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:51:59.435324Z","title":"Laplacian eigenmaps f or dimensionality re- duction and data representation","venue":null,"work_id":null,"year":2003},"citing_paper":{"arxiv_id":"2504.19792","last_updated":"2025-04-28T13:36:28Z","snapshot_observed_at":"2026-08-16T16:29:22.086575Z","submitted_at":"2025-04-28T13:36:28Z","title":"Contextures: The Mechanism of Representation Learning","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-16T05:51:59.435324Z"},"links":{"citing_paper":"/paper/2504.19792"},"observation_digest":"sha256:8a104afc7c97813698203e92c23a71b2aff53bef0b36f3c3abddaa6ee4dfa570","observation_id":"d0ae8214-9133-4628-8e68-694ff1a1bfac","resolution":{"observed_at":"2026-08-16T05:51:59.435324Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:51:59.439606Z","title":"Rep resentation learning: A review and new perspectives","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2504.19792","last_updated":"2025-04-28T13:36:28Z","snapshot_observed_at":"2026-08-16T16:29:22.086575Z","submitted_at":"2025-04-28T13:36:28Z","title":"Contextures: The Mechanism of Representation Learning","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-16T05:51:59.439606Z"},"links":{"citing_paper":"/paper/2504.19792"},"observation_digest":"sha256:7236c52c1d2c97d31652d59f3fb362e8292152b6dd1c30f01e4ababe801a9359","observation_id":"b5894d32-08e7-4377-a5cf-58fc47d00645","resolution":{"observed_at":"2026-08-16T05:51:59.439606Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:51:59.446101Z","title":"Learning eigenfunctions links spectral embedding and kernel pca","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2504.19792","last_updated":"2025-04-28T13:36:28Z","snapshot_observed_at":"2026-08-16T16:29:22.086575Z","submitted_at":"2025-04-28T13:36:28Z","title":"Contextures: The Mechanism of Representation Learning","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-16T05:51:59.446101Z"},"links":{"citing_paper":"/paper/2504.19792"},"observation_digest":"sha256:c11afa289b00cab5add696e750ec16d47d1317c4ad7a0c43185f2c50087f5f81","observation_id":"d3871cd1-0de4-40ce-a409-f94ed0f29b35","resolution":{"observed_at":"2026-08-16T05:51:59.446101Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:51:59.450058Z","title":"Mixmatch: A holistic approach to s emi-supervised learning","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2504.19792","last_updated":"2025-04-28T13:36:28Z","snapshot_observed_at":"2026-08-16T16:29:22.086575Z","submitted_at":"2025-04-28T13:36:28Z","title":"Contextures: The Mechanism of Representation Learning","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-16T05:51:59.450058Z"},"links":{"citing_paper":"/paper/2504.19792"},"observation_digest":"sha256:8ea7756e8be7eb85082cb953e3710b5c110500217b8710e6fe93c799087b5db2","observation_id":"62dde57d-7381-47e0-8972-aa6aec025d2f","resolution":{"observed_at":"2026-08-16T05:51:59.450058Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:51:59.453793Z","title":"D iscriminative learning for diﬀering training and test distributions","venue":null,"work_id":null,"year":2007},"citing_paper":{"arxiv_id":"2504.19792","last_updated":"2025-04-28T13:36:28Z","snapshot_observed_at":"2026-08-16T16:29:22.086575Z","submitted_at":"2025-04-28T13:36:28Z","title":"Contextures: The Mechanism of Representation Learning","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-16T05:51:59.453793Z"},"links":{"citing_paper":"/paper/2504.19792"},"observation_digest":"sha256:cfc698f83d6ad4b38f0e2e842d52cf595ef2b5f8ebfbcd4fef2a8b6622e5d114","observation_id":"ebc1c565-6f05-4d51-921e-2f7f573181d5","resolution":{"observed_at":"2026-08-16T05:51:59.453793Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:51:59.458295Z","title":"Statistical properties of kernel principal component analysis","venue":null,"work_id":null,"year":2007},"citing_paper":{"arxiv_id":"2504.19792","last_updated":"2025-04-28T13:36:28Z","snapshot_observed_at":"2026-08-16T16:29:22.086575Z","submitted_at":"2025-04-28T13:36:28Z","title":"Contextures: The Mechanism of Representation Learning","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-16T05:51:59.458295Z"},"links":{"citing_paper":"/paper/2504.19792"},"observation_digest":"sha256:cc6379945ea0eea5ec9c1f72894d9f7521e5b21cf4295a27393c43a2da43f32b","observation_id":"8900ab7d-5d98-4c05-9eb5-dcc19c8730b0","resolution":{"observed_at":"2026-08-16T05:51:59.458295Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:51:59.462329Z","title":"Demo graphic dialectal vari- ation in social media: A case study of African-American Engl ish","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2504.19792","last_updated":"2025-04-28T13:36:28Z","snapshot_observed_at":"2026-08-16T16:29:22.086575Z","submitted_at":"2025-04-28T13:36:28Z","title":"Contextures: The Mechanism of Representation Learning","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-16T05:51:59.462329Z"},"links":{"citing_paper":"/paper/2504.19792"},"observation_digest":"sha256:a7afa28b160293a553734d47ad8d5001e9872d65cd1e7448ad7e4ce07f1de44f","observation_id":"59f45984-5290-4392-b825-c4805bf2c015","resolution":{"observed_at":"2026-08-16T05:51:59.462329Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2108.07258","last_updated":"2022-07-12T23:45:14Z","snapshot_observed_at":"2026-08-02T09:20:40.804790Z","submitted_at":"2021-08-16T17:50:08Z","title":"On the Opportunities and Risks of Foundation Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2108.07258","snapshot_observed_at":"2026-08-16T05:51:59.466515Z","title":"On the opportunities and risks of foundati on models","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2504.19792","last_updated":"2025-04-28T13:36:28Z","snapshot_observed_at":"2026-08-16T16:29:22.086575Z","submitted_at":"2025-04-28T13:36:28Z","title":"Contextures: The Mechanism of Representation Learning","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-16T05:51:59.466515Z"},"links":{"cited_paper":"/paper/2108.07258","citing_paper":"/paper/2504.19792"},"observation_digest":"sha256:13859b8bcbcef32b567f2b128f5a40745cd484bd1528fb1299116a3d03274656","observation_id":"375e5b34-dcd6-40cf-a253-a0ce1ff43602","resolution":{"observed_at":"2026-08-16T05:51:59.466515Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:51:59.470725Z","title":"Nuanced metrics for measuring unintended bias with rea l data for text clas- siﬁcation","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2504.19792","last_updated":"2025-04-28T13:36:28Z","snapshot_observed_at":"2026-08-16T16:29:22.086575Z","submitted_at":"2025-04-28T13:36:28Z","title":"Contextures: The Mechanism of Representation Learning","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-16T05:51:59.470725Z"},"links":{"citing_paper":"/paper/2504.19792"},"observation_digest":"sha256:732572e27283bc191e5c9b54e7bbb630cb0b13a44f45dbbda2804167a99efef3","observation_id":"413a4cd8-a2ab-43ed-b032-b01858ec6452","resolution":{"observed_at":"2026-08-16T05:51:59.470725Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:51:59.474317Z","title":null,"venue":null,"work_id":null,"year":1971},"citing_paper":{"arxiv_id":"2504.19792","last_updated":"2025-04-28T13:36:28Z","snapshot_observed_at":"2026-08-16T16:29:22.086575Z","submitted_at":"2025-04-28T13:36:28Z","title":"Contextures: The Mechanism of Representation Learning","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-16T05:51:59.474317Z"},"links":{"citing_paper":"/paper/2504.19792"},"observation_digest":"sha256:367ceffb2449c2900bff729a8be69d6b5e80817d7f2db2dcc05c798e971e9cda","observation_id":"c6cf725d-7fac-486f-85bb-cb8a6c464070","resolution":{"observed_at":"2026-08-16T05:51:59.474317Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:51:59.478005Z","title":"Functional analysis, Sobolev spaces and partial diﬀerenti al equations","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2504.19792","last_updated":"2025-04-28T13:36:28Z","snapshot_observed_at":"2026-08-16T16:29:22.086575Z","submitted_at":"2025-04-28T13:36:28Z","title":"Contextures: The Mechanism of Representation Learning","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-16T05:51:59.478005Z"},"links":{"citing_paper":"/paper/2504.19792"},"observation_digest":"sha256:fa6b6633ae82fbde96f057cdf2ffa1348c606a293dcd931747c58cd073f44346","observation_id":"d074c82a-7eff-47ae-9a67-fe2f48c853b9","resolution":{"observed_at":"2026-08-16T05:51:59.478005Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:51:59.481798Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2504.19792","last_updated":"2025-04-28T13:36:28Z","snapshot_observed_at":"2026-08-16T16:29:22.086575Z","submitted_at":"2025-04-28T13:36:28Z","title":"Contextures: The Mechanism of Representation Learning","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-16T05:51:59.481798Z"},"links":{"citing_paper":"/paper/2504.19792"},"observation_digest":"sha256:14e31f3c31f90a3aeabf40e9690769b604117c6b276e70b0620a44e5ed9f04d6","observation_id":"b0bdf3af-32aa-4d8a-9efa-438df231d4e6","resolution":{"observed_at":"2026-08-16T05:51:59.481798Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:51:59.485730Z","title":"The SSL interplay: Augmentations, inductive bias, an d generalization","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.19792","last_updated":"2025-04-28T13:36:28Z","snapshot_observed_at":"2026-08-16T16:29:22.086575Z","submitted_at":"2025-04-28T13:36:28Z","title":"Contextures: The Mechanism of Representation Learning","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-16T05:51:59.485730Z"},"links":{"citing_paper":"/paper/2504.19792"},"observation_digest":"sha256:4960944f4a952fad1b0d67ef2df7c5efa906044fad3426a687efb6780fac5ecf","observation_id":"66ec7fb6-685c-4b76-8984-8fa7e2c5fecc","resolution":{"observed_at":"2026-08-16T05:51:59.485730Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.10774","last_updated":"2024-06-14T23:32:32Z","snapshot_observed_at":"2026-07-06T17:17:56.276857Z","submitted_at":"2024-01-19T15:48:40Z","title":"Medusa: Simple LLM Inference Acceleration Framework with Multiple Decoding Heads","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.10774","snapshot_observed_at":"2026-08-16T05:51:59.489415Z","title":"Lee, Deming Chen, and Tri Dao","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.19792","last_updated":"2025-04-28T13:36:28Z","snapshot_observed_at":"2026-08-16T16:29:22.086575Z","submitted_at":"2025-04-28T13:36:28Z","title":"Contextures: The Mechanism of Representation Learning","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-16T05:51:59.489415Z"},"links":{"cited_paper":"/paper/2401.10774","citing_paper":"/paper/2504.19792"},"observation_digest":"sha256:3f6e1fe46be6552e72df3cc9b1540df1c24fc2aac883031c7cb05d195ed95629","observation_id":"88fd8afb-38e6-42ef-a982-c5b1c42da933","resolution":{"observed_at":"2026-08-16T05:51:59.489415Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:51:59.493604Z","title":"Xgboost: A scalable tr ee boosting system","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2504.19792","last_updated":"2025-04-28T13:36:28Z","snapshot_observed_at":"2026-08-16T16:29:22.086575Z","submitted_at":"2025-04-28T13:36:28Z","title":"Contextures: The Mechanism of Representation Learning","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-16T05:51:59.493604Z"},"links":{"citing_paper":"/paper/2504.19792"},"observation_digest":"sha256:08c038112ee8b88a2fdc613c98653dbfbf25d0908731a4592a5d5dca6903ad38","observation_id":"f0fc85f3-064e-4a25-b958-ad990c5136e2","resolution":{"observed_at":"2026-08-16T05:51:59.493604Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:51:59.497461Z","title":"A sim- ple framework for contrastive learning of visual represent ations","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2504.19792","last_updated":"2025-04-28T13:36:28Z","snapshot_observed_at":"2026-08-16T16:29:22.086575Z","submitted_at":"2025-04-28T13:36:28Z","title":"Contextures: The Mechanism of Representation Learning","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-16T05:51:59.497461Z"},"links":{"citing_paper":"/paper/2504.19792"},"observation_digest":"sha256:836ae52cc096a04f052b9827bdcc81aab14b2824dbbc6fd37689e903e0ce3719","observation_id":"57797f5c-a713-4d9a-92e1-30322e532483","resolution":{"observed_at":"2026-08-16T05:51:59.497461Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:51:59.501087Z","title":"Exploring simple siamese re presentation learning","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2504.19792","last_updated":"2025-04-28T13:36:28Z","snapshot_observed_at":"2026-08-16T16:29:22.086575Z","submitted_at":"2025-04-28T13:36:28Z","title":"Contextures: The Mechanism of Representation Learning","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-16T05:51:59.501087Z"},"links":{"citing_paper":"/paper/2504.19792"},"observation_digest":"sha256:85619e1f0390aa2b197b2d89e503f435b7b45a57958fec714ed6abcbe45aacc7","observation_id":"c8031022-6c33-49a0-90cd-8907d6a3e57c","resolution":{"observed_at":"2026-08-16T05:51:59.501087Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:51:59.505231Z","title":"De constructing denois- ing diﬀusion models for self-supervised learning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2504.19792","last_updated":"2025-04-28T13:36:28Z","snapshot_observed_at":"2026-08-16T16:29:22.086575Z","submitted_at":"2025-04-28T13:36:28Z","title":"Contextures: The Mechanism of Representation Learning","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-16T05:51:59.505231Z"},"links":{"citing_paper":"/paper/2504.19792"},"observation_digest":"sha256:6864957a693f692d921c21ceaa5d671f328cfba2e1d830e8d02bb5bf9a5f0481","observation_id":"3e57ab05-08c5-4417-a305-d0e34b96cb49","resolution":{"observed_at":"2026-08-16T05:51:59.505231Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:51:59.508899Z","title":"Spectral graph theory , volume 92","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2504.19792","last_updated":"2025-04-28T13:36:28Z","snapshot_observed_at":"2026-08-16T16:29:22.086575Z","submitted_at":"2025-04-28T13:36:28Z","title":"Contextures: The Mechanism of Representation Learning","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-16T05:51:59.508899Z"},"links":{"citing_paper":"/paper/2504.19792"},"observation_digest":"sha256:38116951b3c5a2e91647b0ccd77191404232a9b6ee9e03e669b4fceea697dec2","observation_id":"08e7f7a6-42dd-4ed6-940c-96b8c529e15e","resolution":{"observed_at":"2026-08-16T05:51:59.508899Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:51:59.512411Z","title":"Le, and Christopher D","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2504.19792","last_updated":"2025-04-28T13:36:28Z","snapshot_observed_at":"2026-08-16T16:29:22.086575Z","submitted_at":"2025-04-28T13:36:28Z","title":"Contextures: The Mechanism of Representation Learning","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-16T05:51:59.512411Z"},"links":{"citing_paper":"/paper/2504.19792"},"observation_digest":"sha256:6261795fb5620d7ee04431adffdcad9946d1dc282a62b235bb56ee72d920845a","observation_id":"5d051c21-1e5a-4e8b-8026-c1c55bfc5bd0","resolution":{"observed_at":"2026-08-16T05:51:59.512411Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:51:59.516048Z","title":"Gra- dient descent on neural networks typically occurs at the edg e of stability","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2504.19792","last_updated":"2025-04-28T13:36:28Z","snapshot_observed_at":"2026-08-16T16:29:22.086575Z","submitted_at":"2025-04-28T13:36:28Z","title":"Contextures: The Mechanism of Representation Learning","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-16T05:51:59.516048Z"},"links":{"citing_paper":"/paper/2504.19792"},"observation_digest":"sha256:664ac1d871d5d4425fa79f9e6484aea7a652d45a9f5cd9eefc994b38fda9f410","observation_id":"d4cf60df-3e57-4941-9549-4cf582eefbf7","resolution":{"observed_at":"2026-08-16T05:51:59.516048Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:51:59.519725Z","title":"Diﬀusion maps","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2504.19792","last_updated":"2025-04-28T13:36:28Z","snapshot_observed_at":"2026-08-16T16:29:22.086575Z","submitted_at":"2025-04-28T13:36:28Z","title":"Contextures: The Mechanism of Representation Learning","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-16T05:51:59.519725Z"},"links":{"citing_paper":"/paper/2504.19792"},"observation_digest":"sha256:703a37f587c66863c4f693a684a6301fe68fdee0f2101e50151b46369ff81379","observation_id":"fe669262-0f1b-4c02-8443-a9b00b6d0851","resolution":{"observed_at":"2026-08-16T05:51:59.519725Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:51:59.524073Z","title":"Multinomial goodness -of-ﬁt tests","venue":null,"work_id":null,"year":1984},"citing_paper":{"arxiv_id":"2504.19792","last_updated":"2025-04-28T13:36:28Z","snapshot_observed_at":"2026-08-16T16:29:22.086575Z","submitted_at":"2025-04-28T13:36:28Z","title":"Contextures: The Mechanism of Representation Learning","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-16T05:51:59.524073Z"},"links":{"citing_paper":"/paper/2504.19792"},"observation_digest":"sha256:2d831466d0d376f4e94232cb68e90a0f1aafd5faabd1d0f067f65b59ced3519a","observation_id":"ce7e833e-1527-46a0-9302-4c974bc1dcab","resolution":{"observed_at":"2026-08-16T05:51:59.524073Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:51:59.528804Z","title":"A kernel theory of modern data augmentation","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2504.19792","last_updated":"2025-04-28T13:36:28Z","snapshot_observed_at":"2026-08-16T16:29:22.086575Z","submitted_at":"2025-04-28T13:36:28Z","title":"Contextures: The Mechanism of Representation Learning","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-16T05:51:59.528804Z"},"links":{"citing_paper":"/paper/2504.19792"},"observation_digest":"sha256:3145c7fd5e4cf61d0084a5806def17175015c3aa3ec3f3da8f20ec34bf702dc8","observation_id":"daeefab0-298b-482b-9be6-a5c3f8ac1c42","resolution":{"observed_at":"2026-08-16T05:51:59.528804Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:51:59.533197Z","title":"Fast line ar algebra is stable","venue":null,"work_id":null,"year":2007},"citing_paper":{"arxiv_id":"2504.19792","last_updated":"2025-04-28T13:36:28Z","snapshot_observed_at":"2026-08-16T16:29:22.086575Z","submitted_at":"2025-04-28T13:36:28Z","title":"Contextures: The Mechanism of Representation Learning","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-16T05:51:59.533197Z"},"links":{"citing_paper":"/paper/2504.19792"},"observation_digest":"sha256:dbc15dc9071cb117917a03c681a466ef9c3ecb12614045df92719cf236d703d2","observation_id":"9cedffe6-228d-4f9f-8057-88d46ec3885e","resolution":{"observed_at":"2026-08-16T05:51:59.533197Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:51:59.543435Z","title":"Neuralef: Deconst ructing kernels by deep neural networks","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2504.19792","last_updated":"2025-04-28T13:36:28Z","snapshot_observed_at":"2026-08-16T16:29:22.086575Z","submitted_at":"2025-04-28T13:36:28Z","title":"Contextures: The Mechanism of Representation Learning","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-16T05:51:59.543435Z"},"links":{"citing_paper":"/paper/2504.19792"},"observation_digest":"sha256:1951fbffb470ffe61a616bf403b6d9c5db5ea31e6d1690d94e88170942f46db0","observation_id":"c2d54a50-2d19-464f-acc6-ef2c8f2e82d2","resolution":{"observed_at":"2026-08-16T05:51:59.543435Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:51:59.552859Z","title":"BERT: Pre- training of deep bidirectional transformers for language u nderstanding","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2504.19792","last_updated":"2025-04-28T13:36:28Z","snapshot_observed_at":"2026-08-16T16:29:22.086575Z","submitted_at":"2025-04-28T13:36:28Z","title":"Contextures: The Mechanism of Representation Learning","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-16T05:51:59.552859Z"},"links":{"citing_paper":"/paper/2504.19792"},"observation_digest":"sha256:82a81c57733e6bccd260e9ac96958933c3bea5c9e6f294c8bc034daeade8f91a","observation_id":"bcbacd1f-4dd6-4f3c-bb29-ec80edad405f","resolution":{"observed_at":"2026-08-16T05:51:59.552859Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1708.04552","last_updated":"2017-11-29T14:51:40Z","snapshot_observed_at":"2026-08-13T11:54:46.030796Z","submitted_at":"2017-08-15T15:21:53Z","title":"Improved Regularization of Convolutional Neural Networks with Cutout","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1708.04552","snapshot_observed_at":"2026-08-16T05:51:59.557905Z","title":"Improved regularization of convolutional neural networks with cutout","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2504.19792","last_updated":"2025-04-28T13:36:28Z","snapshot_observed_at":"2026-08-16T16:29:22.086575Z","submitted_at":"2025-04-28T13:36:28Z","title":"Contextures: The Mechanism of Representation Learning","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-16T05:51:59.557905Z"},"links":{"cited_paper":"/paper/1708.04552","citing_paper":"/paper/2504.19792"},"observation_digest":"sha256:19a50a83b40b4f1c73837f5765f9a7dd7e937ef22e4b8701de005aec77f5eb48","observation_id":"727b093c-68ac-457c-88c7-5c72768af5ca","resolution":{"observed_at":"2026-08-16T05:51:59.557905Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:51:59.563084Z","title":"An image is worth 16x16 words: Transformers for image recognition at scale","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2504.19792","last_updated":"2025-04-28T13:36:28Z","snapshot_observed_at":"2026-08-16T16:29:22.086575Z","submitted_at":"2025-04-28T13:36:28Z","title":"Contextures: The Mechanism of Representation Learning","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-16T05:51:59.563084Z"},"links":{"citing_paper":"/paper/2504.19792"},"observation_digest":"sha256:e8e933bb53a2bb269d2465f3ff4334e3edf8826090cde40f74016aa2a3b8249b","observation_id":"5fd7b24a-30f2-4787-897f-d29a20efc7b1","resolution":{"observed_at":"2026-08-16T05:51:59.563084Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-08-13T17:20:44.002518Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-16T05:51:59.566757Z","title":"The llama 3 herd of models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.19792","last_updated":"2025-04-28T13:36:28Z","snapshot_observed_at":"2026-08-16T16:29:22.086575Z","submitted_at":"2025-04-28T13:36:28Z","title":"Contextures: The Mechanism of Representation Learning","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-16T05:51:59.566757Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2504.19792"},"observation_digest":"sha256:84b1bc75e57fb51a39435eb6883d44cfa04a3d8c887d458d4b6f6c49d116916d","observation_id":"5d7f5f9f-de98-4f60-b795-fd13235fe6a1","resolution":{"observed_at":"2026-08-16T05:51:59.566757Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1810.08750","last_updated":"2020-07-18T01:20:20Z","snapshot_observed_at":"2026-08-14T18:11:52.942637Z","submitted_at":"2018-10-20T03:50:29Z","title":"Learning Models with Uniform Performance via Distributionally Robust Optimization","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1810.08750","snapshot_observed_at":"2026-08-16T05:51:59.570488Z","title":"Learning models with uniform perfor- mance via distributionally robust optimization","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2504.19792","last_updated":"2025-04-28T13:36:28Z","snapshot_observed_at":"2026-08-16T16:29:22.086575Z","submitted_at":"2025-04-28T13:36:28Z","title":"Contextures: The Mechanism of Representation Learning","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-16T05:51:59.570488Z"},"links":{"cited_paper":"/paper/1810.08750","citing_paper":"/paper/2504.19792"},"observation_digest":"sha256:66707c5226256467513612231fe0f51fa9484cfaa07bf899dc43648bffe86f26","observation_id":"8e8a93b5-2f38-48b0-b4fa-e96813b552af","resolution":{"observed_at":"2026-08-16T05:51:59.570488Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:51:59.574780Z","title":"T owards revealing the mystery behind chain of thought: A theoretical perspective","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.19792","last_updated":"2025-04-28T13:36:28Z","snapshot_observed_at":"2026-08-16T16:29:22.086575Z","submitted_at":"2025-04-28T13:36:28Z","title":"Contextures: The Mechanism of Representation Learning","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-16T05:51:59.574780Z"},"links":{"citing_paper":"/paper/2504.19792"},"observation_digest":"sha256:8eaa04535a1b7731003b0494ae0f3f5781b0a9b1985ed67ce1847cfedb2cdca3","observation_id":"8c2e6fe5-cd58-4b7c-9eb6-481115faa314","resolution":{"observed_at":"2026-08-16T05:51:59.574780Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:51:59.578477Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2504.19792","last_updated":"2025-04-28T13:36:28Z","snapshot_observed_at":"2026-08-16T16:29:22.086575Z","submitted_at":"2025-04-28T13:36:28Z","title":"Contextures: The Mechanism of Representation Learning","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-16T05:51:59.578477Z"},"links":{"citing_paper":"/paper/2504.19792"},"observation_digest":"sha256:434daeecf553ec56d6814c46cb80dabd5b3231c7e991113ba822e3ccc837fda4","observation_id":"10eddf72-ae96-4d3e-a965-444d73e757f8","resolution":{"observed_at":"2026-08-16T05:51:59.578477Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:51:59.582236Z","title":"Sobolev norm learnin g rates for regularized least-squares algorithms","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2504.19792","last_updated":"2025-04-28T13:36:28Z","snapshot_observed_at":"2026-08-16T16:29:22.086575Z","submitted_at":"2025-04-28T13:36:28Z","title":"Contextures: The Mechanism of Representation Learning","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-16T05:51:59.582236Z"},"links":{"citing_paper":"/paper/2504.19792"},"observation_digest":"sha256:463add2231d44d7760b8191e19a18b81f318e399755c884e36b331faccbd5f8f","observation_id":"ec5abf62-4417-4480-ab80-7462a3413367","resolution":{"observed_at":"2026-08-16T05:51:59.582236Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:51:59.586084Z","title":"A decision-theoreti c generalization of on-line learning and an application to boosting","venue":null,"work_id":null,"year":1997},"citing_paper":{"arxiv_id":"2504.19792","last_updated":"2025-04-28T13:36:28Z","snapshot_observed_at":"2026-08-16T16:29:22.086575Z","submitted_at":"2025-04-28T13:36:28Z","title":"Contextures: The Mechanism of Representation Learning","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-16T05:51:59.586084Z"},"links":{"citing_paper":"/paper/2504.19792"},"observation_digest":"sha256:d7149a571a852bfe7a1777be33a111ec4da87ea1824a04487389320bd7a8ea05","observation_id":"0ac3d00a-d005-4c04-bd44-408c3dcdb97e","resolution":{"observed_at":"2026-08-16T05:51:59.586084Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:51:59.589710Z","title":"Latent functional maps: a spectral framew ork for represen- tation alignment","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2504.19792","last_updated":"2025-04-28T13:36:28Z","snapshot_observed_at":"2026-08-16T16:29:22.086575Z","submitted_at":"2025-04-28T13:36:28Z","title":"Contextures: The Mechanism of Representation Learning","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-16T05:51:59.589710Z"},"links":{"citing_paper":"/paper/2504.19792"},"observation_digest":"sha256:6a0c492c92655ba57fdbec171220f13c09b292a5183cf1fc62c827e0cbd88e1b","observation_id":"533c15bf-e9d7-46d7-93c4-4d31f6713e2b","resolution":{"observed_at":"2026-08-16T05:51:59.589710Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:51:59.593655Z","title":"Scaling laws for reward model overop- timization","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.19792","last_updated":"2025-04-28T13:36:28Z","snapshot_observed_at":"2026-08-16T16:29:22.086575Z","submitted_at":"2025-04-28T13:36:28Z","title":"Contextures: The Mechanism of Representation Learning","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-16T05:51:59.593655Z"},"links":{"citing_paper":"/paper/2504.19792"},"observation_digest":"sha256:af582004aa7f95c83158b03d77aa046d6e9ddc791f13c7c9d78764c9ed306ba8","observation_id":"80da0e83-d7ad-4c39-b5be-fe4d9c0494e8","resolution":{"observed_at":"2026-08-16T05:51:59.593655Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.11805","last_updated":"2025-05-09T21:04:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-12-19T02:39:27Z","title":"Gemini: A Family of Highly Capable Multimodal Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.11805","snapshot_observed_at":"2026-08-16T05:51:59.597815Z","title":"Gemini: A Family of Highly Capable Multimo dal Models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.19792","last_updated":"2025-04-28T13:36:28Z","snapshot_observed_at":"2026-08-16T16:29:22.086575Z","submitted_at":"2025-04-28T13:36:28Z","title":"Contextures: The Mechanism of Representation Learning","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-16T05:51:59.597815Z"},"links":{"cited_paper":"/paper/2312.11805","citing_paper":"/paper/2504.19792"},"observation_digest":"sha256:2643c64da4befeff9ec6282cef8656fb6136aa530b76707688dbd8ed039cda2a","observation_id":"ee4f14c1-8272-4247-95ae-38ae31af6e85","resolution":{"observed_at":"2026-08-16T05:51:59.597815Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:51:59.602145Z","title":"Un supervised representa- tion learning by predicting image rotations","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2504.19792","last_updated":"2025-04-28T13:36:28Z","snapshot_observed_at":"2026-08-16T16:29:22.086575Z","submitted_at":"2025-04-28T13:36:28Z","title":"Contextures: The Mechanism of Representation Learning","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-16T05:51:59.602145Z"},"links":{"citing_paper":"/paper/2504.19792"},"observation_digest":"sha256:a204665fb7e9a004df149356f644d5f6b57875bcec3e7906d3bbac970fafb82f","observation_id":"7eb8ac5a-9f9d-4ae1-bc4d-c07fdab69b16","resolution":{"observed_at":"2026-08-16T05:51:59.602145Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:51:59.606947Z","title":"Multiple kernel learn ing algorithms","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2504.19792","last_updated":"2025-04-28T13:36:28Z","snapshot_observed_at":"2026-08-16T16:29:22.086575Z","submitted_at":"2025-04-28T13:36:28Z","title":"Contextures: The Mechanism of Representation Learning","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-16T05:51:59.606947Z"},"links":{"citing_paper":"/paper/2504.19792"},"observation_digest":"sha256:6f7d3e863fec36bc29cbdbd38e2388bcfe80537e81dfe0bc9c59fded37777add","observation_id":"4f076e21-48c3-4b23-8be1-517a790aeaa2","resolution":{"observed_at":"2026-08-16T05:51:59.606947Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:51:59.611258Z","title":"Generat ive adversarial nets","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2504.19792","last_updated":"2025-04-28T13:36:28Z","snapshot_observed_at":"2026-08-16T16:29:22.086575Z","submitted_at":"2025-04-28T13:36:28Z","title":"Contextures: The Mechanism of Representation Learning","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-16T05:51:59.611258Z"},"links":{"citing_paper":"/paper/2504.19792"},"observation_digest":"sha256:e9052ba1b3b9e695f263b4969ede6d7251ba3221dfa9fd46e471a904bf0136f3","observation_id":"7327815e-8dcd-4942-9680-c7f102e22bc4","resolution":{"observed_at":"2026-08-16T05:51:59.611258Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:51:59.615506Z","title":"Revisit- ing deep learning models for tabular data","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2504.19792","last_updated":"2025-04-28T13:36:28Z","snapshot_observed_at":"2026-08-16T16:29:22.086575Z","submitted_at":"2025-04-28T13:36:28Z","title":"Contextures: The Mechanism of Representation Learning","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-16T05:51:59.615506Z"},"links":{"citing_paper":"/paper/2504.19792"},"observation_digest":"sha256:d786c58567261eb27739f25e2924bc27d7044823397205dedb1714cb2fcc0ae1","observation_id":"c48180e3-3c5e-4b23-bbf6-90853450a595","resolution":{"observed_at":"2026-08-16T05:51:59.615506Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:51:59.619396Z","title":"Bootstrap your own latent - a new approach t o self-supervised learning","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2504.19792","last_updated":"2025-04-28T13:36:28Z","snapshot_observed_at":"2026-08-16T16:29:22.086575Z","submitted_at":"2025-04-28T13:36:28Z","title":"Contextures: The Mechanism of Representation Learning","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-16T05:51:59.619396Z"},"links":{"citing_paper":"/paper/2504.19792"},"observation_digest":"sha256:4c6a459b7b55b7fd826bd456bb74c51002d6cb9e2234d7c9891a359588af74b1","observation_id":"2dd5d3b9-4867-4d9e-91e9-eee9c61f9972","resolution":{"observed_at":"2026-08-16T05:51:59.619396Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:51:59.623468Z","title":"In search of lost domain generalization","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2504.19792","last_updated":"2025-04-28T13:36:28Z","snapshot_observed_at":"2026-08-16T16:29:22.086575Z","submitted_at":"2025-04-28T13:36:28Z","title":"Contextures: The Mechanism of Representation Learning","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-16T05:51:59.623468Z"},"links":{"citing_paper":"/paper/2504.19792"},"observation_digest":"sha256:153e3b9fb47346742c4ebb8ec2ce38b5501beb0852c164001f7cbf296909d3a5","observation_id":"c9b83419-8f74-4f4a-aa51-17027763daa3","resolution":{"observed_at":"2026-08-16T05:51:59.623468Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:51:59.627701Z","title":"Characteriz- ing implicit bias in terms of optimization geometry","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2504.19792","last_updated":"2025-04-28T13:36:28Z","snapshot_observed_at":"2026-08-16T16:29:22.086575Z","submitted_at":"2025-04-28T13:36:28Z","title":"Contextures: The Mechanism of Representation Learning","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-16T05:51:59.627701Z"},"links":{"citing_paper":"/paper/2504.19792"},"observation_digest":"sha256:76aa4ed0503f606f64b6f8b5310f8befe7e1039a8b81288b36b7f315630f8a50","observation_id":"f4813ebe-ee89-4306-8ee2-6abad40e1482","resolution":{"observed_at":"2026-08-16T05:51:59.627701Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-08-15T12:33:55.451951Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-16T05:51:59.633365Z","title":"Deepsee k-r1: Incen- 143 tivizing reasoning capability in llms via reinforcement le arning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2504.19792","last_updated":"2025-04-28T13:36:28Z","snapshot_observed_at":"2026-08-16T16:29:22.086575Z","submitted_at":"2025-04-28T13:36:28Z","title":"Contextures: The Mechanism of Representation Learning","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-16T05:51:59.633365Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2504.19792"},"observation_digest":"sha256:9ea926b10f0493bc44ce3dae711134b893ac8ae4904994297697157469cad185","observation_id":"742f87a5-4a8b-43a6-b3a9-4485707e371e","resolution":{"observed_at":"2026-08-16T05:51:59.633365Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:51:59.637988Z","title":"Statistical intervals: a guide for practitioners , volume 92","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2504.19792","last_updated":"2025-04-28T13:36:28Z","snapshot_observed_at":"2026-08-16T16:29:22.086575Z","submitted_at":"2025-04-28T13:36:28Z","title":"Contextures: The Mechanism of Representation Learning","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-16T05:51:59.637988Z"},"links":{"citing_paper":"/paper/2504.19792"},"observation_digest":"sha256:4288f80eef76c303aa60aff9e2c67abe256dd5d647d0f2e24b36479a8b533e54","observation_id":"c458cc9f-599f-437d-a368-583e748d1471","resolution":{"observed_at":"2026-08-16T05:51:59.637988Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:51:59.642366Z","title":"Graph representation learning","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2504.19792","last_updated":"2025-04-28T13:36:28Z","snapshot_observed_at":"2026-08-16T16:29:22.086575Z","submitted_at":"2025-04-28T13:36:28Z","title":"Contextures: The Mechanism of Representation Learning","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-16T05:51:59.642366Z"},"links":{"citing_paper":"/paper/2504.19792"},"observation_digest":"sha256:883c6252a83d397ed9d61441deee8e782e49f46bf6db7642b4d788fa0bd27ad0","observation_id":"8a60ce10-0a04-4f75-b6b5-b92238230270","resolution":{"observed_at":"2026-08-16T05:51:59.642366Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.14699","last_updated":"2023-04-08T05:10:00Z","snapshot_observed_at":"2026-08-16T16:13:05.849306Z","submitted_at":"2022-11-27T01:53:29Z","title":"A Theoretical Study of Inductive Biases in Contrastive Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.14699","snapshot_observed_at":"2026-08-16T05:51:59.649584Z","title":"A theoretical study of induc tive biases in con- trastive learning","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2504.19792","last_updated":"2025-04-28T13:36:28Z","snapshot_observed_at":"2026-08-16T16:29:22.086575Z","submitted_at":"2025-04-28T13:36:28Z","title":"Contextures: The Mechanism of Representation Learning","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-16T05:51:59.649584Z"},"links":{"cited_paper":"/paper/2211.14699","citing_paper":"/paper/2504.19792"},"observation_digest":"sha256:bbb9f22ce7b3ee97a2203d120ed663ead9a837aafd6d04a63b5132a40473be6f","observation_id":"f016e92d-27d1-43db-be97-d7a5b7283ae8","resolution":{"observed_at":"2026-08-16T05:51:59.649584Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:51:59.656043Z","title":"P rovable guarantees for self-supervised deep learning with spectral contrastive loss","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2504.19792","last_updated":"2025-04-28T13:36:28Z","snapshot_observed_at":"2026-08-16T16:29:22.086575Z","submitted_at":"2025-04-28T13:36:28Z","title":"Contextures: The Mechanism of Representation Learning","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-16T05:51:59.656043Z"},"links":{"citing_paper":"/paper/2504.19792"},"observation_digest":"sha256:865afe6539286307345387848eecacbd23b47eb2b3ec081d7a1f01db903409cd","observation_id":"a5510de7-6673-42c4-ad44-2a0a8a962e70","resolution":{"observed_at":"2026-08-16T05:51:59.656043Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:51:59.661248Z","title":"HaoChen, Colin Wei, Ananya Kumar, and Tengyu Ma","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2504.19792","last_updated":"2025-04-28T13:36:28Z","snapshot_observed_at":"2026-08-16T16:29:22.086575Z","submitted_at":"2025-04-28T13:36:28Z","title":"Contextures: The Mechanism of Representation Learning","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-16T05:51:59.661248Z"},"links":{"citing_paper":"/paper/2504.19792"},"observation_digest":"sha256:e9e4d2446a829adae49894956fbbc257ea043a486b075b6e7806b54a0964b48e","observation_id":"df7244b1-0d64-4e5a-9e36-b11833318a99","resolution":{"observed_at":"2026-08-16T05:51:59.661248Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:51:59.665836Z","title":"Fairness without demographics in repeated loss minimization","venue":null,"work_id":null,"year":1929},"citing_paper":{"arxiv_id":"2504.19792","last_updated":"2025-04-28T13:36:28Z","snapshot_observed_at":"2026-08-16T16:29:22.086575Z","submitted_at":"2025-04-28T13:36:28Z","title":"Contextures: The Mechanism of Representation Learning","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-16T05:51:59.665836Z"},"links":{"citing_paper":"/paper/2504.19792"},"observation_digest":"sha256:c2d5c44d07f87e1aeb5cd84e3dab667658972a44bdd4e95688a85e958a6f2bf5","observation_id":"ed05ceb7-fedf-45fc-8739-7745e921b9ff","resolution":{"observed_at":"2026-08-16T05:51:59.665836Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:51:59.669324Z","title":"Masked autoencoders are scalable vision learners","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2504.19792","last_updated":"2025-04-28T13:36:28Z","snapshot_observed_at":"2026-08-16T16:29:22.086575Z","submitted_at":"2025-04-28T13:36:28Z","title":"Contextures: The Mechanism of Representation Learning","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-16T05:51:59.669324Z"},"links":{"citing_paper":"/paper/2504.19792"},"observation_digest":"sha256:6d26b5f28639ffd87111ac2e09b82f978d146ea6900130d85184c7163f17e10c","observation_id":"9d26de3f-497c-46f9-91a5-a1230b45cd05","resolution":{"observed_at":"2026-08-16T05:51:59.669324Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:51:59.673320Z","title":"D eep residual learning for image recognition","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2504.19792","last_updated":"2025-04-28T13:36:28Z","snapshot_observed_at":"2026-08-16T16:29:22.086575Z","submitted_at":"2025-04-28T13:36:28Z","title":"Contextures: The Mechanism of Representation Learning","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-16T05:51:59.673320Z"},"links":{"citing_paper":"/paper/2504.19792"},"observation_digest":"sha256:b2ecde978bd71c32242c2846ec0d2e8b9cc965ccf416bd9b198c4e08a1c18ad1","observation_id":"141e888b-5b18-426c-8926-f43653c7c23e","resolution":{"observed_at":"2026-08-16T05:51:59.673320Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:51:59.676776Z","title":"Hearst, S.T","venue":null,"work_id":null,"year":1998},"citing_paper":{"arxiv_id":"2504.19792","last_updated":"2025-04-28T13:36:28Z","snapshot_observed_at":"2026-08-16T16:29:22.086575Z","submitted_at":"2025-04-28T13:36:28Z","title":"Contextures: The Mechanism of Representation Learning","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-16T05:51:59.676776Z"},"links":{"citing_paper":"/paper/2504.19792"},"observation_digest":"sha256:429cc5f52f99becfdee6e44a5615ac7f6110cb529d99fd49c5fe5a1e8afab4a3","observation_id":"db95eb65-9879-4a7a-bb4b-7a1d94f6128d","resolution":{"observed_at":"2026-08-16T05:51:59.676776Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1503.02531","last_updated":"2015-03-09T15:44:49Z","snapshot_observed_at":"2026-08-16T18:00:58.008096Z","submitted_at":"2015-03-09T15:44:49Z","title":"Distilling the Knowledge in a Neural Network","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1503.02531","snapshot_observed_at":"2026-08-16T05:51:59.680297Z","title":"Hinton, Oriol Vinyals, and Jeﬀrey Dean","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2504.19792","last_updated":"2025-04-28T13:36:28Z","snapshot_observed_at":"2026-08-16T16:29:22.086575Z","submitted_at":"2025-04-28T13:36:28Z","title":"Contextures: The Mechanism of Representation Learning","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-16T05:51:59.680297Z"},"links":{"cited_paper":"/paper/1503.02531","citing_paper":"/paper/2504.19792"},"observation_digest":"sha256:5e8457c726c315caf1aef5d5f583cf00d0d1991fed17f0fc6a9ee3184e060f72","observation_id":"704a1269-489d-4772-bfd2-51ee2db99710","resolution":{"observed_at":"2026-08-16T05:51:59.680297Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:51:59.684627Z","title":"Denoising di ﬀusion probabilistic mod- els","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2504.19792","last_updated":"2025-04-28T13:36:28Z","snapshot_observed_at":"2026-08-16T16:29:22.086575Z","submitted_at":"2025-04-28T13:36:28Z","title":"Contextures: The Mechanism of Representation Learning","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-16T05:51:59.684627Z"},"links":{"citing_paper":"/paper/2504.19792"},"observation_digest":"sha256:2f3ba29e0ccc58cea22dd31842bd4445c35c6186dc872d6c6141bd328f5bed6d","observation_id":"d6a6402d-143c-4f55-aee3-91615656bc22","resolution":{"observed_at":"2026-08-16T05:51:59.684627Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:51:59.688204Z","title":"TabPFN: A transformer that solves small tabular classiﬁcat ion problems in a sec- ond","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.19792","last_updated":"2025-04-28T13:36:28Z","snapshot_observed_at":"2026-08-16T16:29:22.086575Z","submitted_at":"2025-04-28T13:36:28Z","title":"Contextures: The Mechanism of Representation Learning","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-16T05:51:59.688204Z"},"links":{"citing_paper":"/paper/2504.19792"},"observation_digest":"sha256:7ae4c3e63ba28fe196907edc4d79e501fcfb06f980a671e6f79019daa6dde7b5","observation_id":"84f15c13-64e5-45d7-97f6-f0a6f71b97f7","resolution":{"observed_at":"2026-08-16T05:51:59.688204Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:51:59.692084Z","title":"Accurate pre- dictions on small data with a tabular foundation model","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2504.19792","last_updated":"2025-04-28T13:36:28Z","snapshot_observed_at":"2026-08-16T16:29:22.086575Z","submitted_at":"2025-04-28T13:36:28Z","title":"Contextures: The Mechanism of Representation Learning","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-16T05:51:59.692084Z"},"links":{"citing_paper":"/paper/2504.19792"},"observation_digest":"sha256:1ae6ff15df12a75509edbaea00e308a9b2beb4a09ba119752bcaeb17512ccd9f","observation_id":"18f1d191-16b6-4ffe-82f9-54aa1a8b7381","resolution":{"observed_at":"2026-08-16T05:51:59.692084Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:51:59.695834Z","title":"Tagging performance corr elates with author age","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2504.19792","last_updated":"2025-04-28T13:36:28Z","snapshot_observed_at":"2026-08-16T16:29:22.086575Z","submitted_at":"2025-04-28T13:36:28Z","title":"Contextures: The Mechanism of Representation Learning","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-16T05:51:59.695834Z"},"links":{"citing_paper":"/paper/2504.19792"},"observation_digest":"sha256:8789e801248ceef7f2e6bfb14ee092696886c125fcf0110e9e4ca7f2094deb1e","observation_id":"d6d638d6-5749-472e-a799-200ccc12a7d9","resolution":{"observed_at":"2026-08-16T05:51:59.695834Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:51:59.700349Z","title":"Correcting sample selection bias by unlabeled d ata","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2504.19792","last_updated":"2025-04-28T13:36:28Z","snapshot_observed_at":"2026-08-16T16:29:22.086575Z","submitted_at":"2025-04-28T13:36:28Z","title":"Contextures: The Mechanism of Representation Learning","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-16T05:51:59.700349Z"},"links":{"citing_paper":"/paper/2504.19792"},"observation_digest":"sha256:84c7098ffc0df7b8d6d428e1d71904e57c114db0ba9a0e8d0f07b19e9c98473b","observation_id":"49ff9b32-bf0a-4e47-8acb-33699532bc66","resolution":{"observed_at":"2026-08-16T05:51:59.700349Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:51:59.704607Z","title":"A survey on hallucination in large language models: Principles, tax onomy , challenges, and open questions","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2504.19792","last_updated":"2025-04-28T13:36:28Z","snapshot_observed_at":"2026-08-16T16:29:22.086575Z","submitted_at":"2025-04-28T13:36:28Z","title":"Contextures: The Mechanism of Representation Learning","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-16T05:51:59.704607Z"},"links":{"citing_paper":"/paper/2504.19792"},"observation_digest":"sha256:e3690fd71d8040de2c2337434ae15ef504f50452f6f3c09da09af5f8d9c45a01","observation_id":"73ff7fab-0a24-43a7-a666-b86606f81219","resolution":{"observed_at":"2026-08-16T05:51:59.704607Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:51:59.709334Z","title":"Improving trans- former optimization through better initialization","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2504.19792","last_updated":"2025-04-28T13:36:28Z","snapshot_observed_at":"2026-08-16T16:29:22.086575Z","submitted_at":"2025-04-28T13:36:28Z","title":"Contextures: The Mechanism of Representation Learning","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-16T05:51:59.709334Z"},"links":{"citing_paper":"/paper/2504.19792"},"observation_digest":"sha256:1c9f53a301529a9b222a82e3dafc89275540d631060bf630a9f5fc86c2564b8d","observation_id":"9092bd70-c812-43f5-9ff1-d3f1ad7dbe77","resolution":{"observed_at":"2026-08-16T05:51:59.709334Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:51:59.712812Z","title":"Robust estimation of a location paramete r","venue":null,"work_id":null,"year":1992},"citing_paper":{"arxiv_id":"2504.19792","last_updated":"2025-04-28T13:36:28Z","snapshot_observed_at":"2026-08-16T16:29:22.086575Z","submitted_at":"2025-04-28T13:36:28Z","title":"Contextures: The Mechanism of Representation Learning","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-16T05:51:59.712812Z"},"links":{"citing_paper":"/paper/2504.19792"},"observation_digest":"sha256:53be39775cb877d331f23e7ae28d7c4088ad1cc475fa6c0d799f0931ebd6108e","observation_id":"5cd1e345-a7f8-448d-b9cc-db421b08578d","resolution":{"observed_at":"2026-08-16T05:51:59.712812Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1608.08614","last_updated":"2016-12-10T13:37:06Z","snapshot_observed_at":"2026-08-14T21:42:06.055643Z","submitted_at":"2016-08-30T19:45:09Z","title":"What makes ImageNet good for transfer learning?","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1608.08614","snapshot_observed_at":"2026-08-16T05:51:59.716820Z","title":"What m akes imagenet good for transfer learning? arXiv:1608.08614, 2016","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2504.19792","last_updated":"2025-04-28T13:36:28Z","snapshot_observed_at":"2026-08-16T16:29:22.086575Z","submitted_at":"2025-04-28T13:36:28Z","title":"Contextures: The Mechanism of Representation Learning","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-16T05:51:59.716820Z"},"links":{"cited_paper":"/paper/1608.08614","citing_paper":"/paper/2504.19792"},"observation_digest":"sha256:8b588b42f875b42df90910f4abfc97a9378e1a416cf94d519b51f56238f112cb","observation_id":"d65f80c5-0ab7-4d0a-b052-eb2c3a5bcd19","resolution":{"observed_at":"2026-08-16T05:51:59.716820Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:51:59.721769Z","title":"Position: The platonic representation hypothesis","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.19792","last_updated":"2025-04-28T13:36:28Z","snapshot_observed_at":"2026-08-16T16:29:22.086575Z","submitted_at":"2025-04-28T13:36:28Z","title":"Contextures: The Mechanism of Representation Learning","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-16T05:51:59.721769Z"},"links":{"citing_paper":"/paper/2504.19792"},"observation_digest":"sha256:081ac9d5ef8cd63f0a17071f9021df22c27279ae96ed42b1f163c67541e3e516","observation_id":"bea3be3b-aedc-428b-8100-1c8e16d1fcaa","resolution":{"observed_at":"2026-08-16T05:51:59.721769Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:51:59.725979Z","title":"Estimation of non-normalized statist ical models by score match- ing","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2504.19792","last_updated":"2025-04-28T13:36:28Z","snapshot_observed_at":"2026-08-16T16:29:22.086575Z","submitted_at":"2025-04-28T13:36:28Z","title":"Contextures: The Mechanism of Representation Learning","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-16T05:51:59.725979Z"},"links":{"citing_paper":"/paper/2504.19792"},"observation_digest":"sha256:085c7b9d1998d0d1f7bfd4769bb43c5608eaecbfa200c0066b022f7860e40aa0","observation_id":"8a38035b-ad89-4747-b07e-38ce950d5046","resolution":{"observed_at":"2026-08-16T05:51:59.725979Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:51:59.730395Z","title":"T o wards a learning theory of representation alignment","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2504.19792","last_updated":"2025-04-28T13:36:28Z","snapshot_observed_at":"2026-08-16T16:29:22.086575Z","submitted_at":"2025-04-28T13:36:28Z","title":"Contextures: The Mechanism of Representation Learning","version":1},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-16T05:51:59.730395Z"},"links":{"citing_paper":"/paper/2504.19792"},"observation_digest":"sha256:49c10c598160163036f4ce61a5ab040e2681fbaead4570e37985a6189b011c0d","observation_id":"bc86c677-a40b-44ae-9387-d7b035edd728","resolution":{"observed_at":"2026-08-16T05:51:59.730395Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:51:59.734310Z","title":"Adap- tive mixtures of local experts","venue":null,"work_id":null,"year":1991},"citing_paper":{"arxiv_id":"2504.19792","last_updated":"2025-04-28T13:36:28Z","snapshot_observed_at":"2026-08-16T16:29:22.086575Z","submitted_at":"2025-04-28T13:36:28Z","title":"Contextures: The Mechanism of Representation Learning","version":1},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-16T05:51:59.734310Z"},"links":{"citing_paper":"/paper/2504.19792"},"observation_digest":"sha256:3675f6a581212f6a0e0cbf9153ebb20a54ed62ee2d13539f466753c049608218","observation_id":"d8f6bed6-1ff2-4df6-b3e5-ed3b4919c72c","resolution":{"observed_at":"2026-08-16T05:51:59.734310Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:51:59.738471Z","title":"Neu ral tangent kernel: Convergence and generalization in neural networks","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2504.19792","last_updated":"2025-04-28T13:36:28Z","snapshot_observed_at":"2026-08-16T16:29:22.086575Z","submitted_at":"2025-04-28T13:36:28Z","title":"Contextures: The Mechanism of Representation Learning","version":1},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-16T05:51:59.738471Z"},"links":{"citing_paper":"/paper/2504.19792"},"observation_digest":"sha256:71e2a6a089e1cf81454d40d8b6a810e9e56909cae61db7624a6a29b7ee0bdfb3","observation_id":"b1501e9f-21a7-4243-8e92-527d45e0e12f","resolution":{"observed_at":"2026-08-16T05:51:59.738471Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.16720","last_updated":"2026-04-30T02:46:40Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-21T18:04:31Z","title":"OpenAI o1 System Card","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.16720","snapshot_observed_at":"2026-08-16T05:51:59.742570Z","title":"Ope- nai o1 system card","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.19792","last_updated":"2025-04-28T13:36:28Z","snapshot_observed_at":"2026-08-16T16:29:22.086575Z","submitted_at":"2025-04-28T13:36:28Z","title":"Contextures: The Mechanism of Representation Learning","version":1},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-16T05:51:59.742570Z"},"links":{"cited_paper":"/paper/2412.16720","citing_paper":"/paper/2504.19792"},"observation_digest":"sha256:0d3f562e86f524acf90c3817fd1ff501e83939f1129f009f1c081560c02ea449","observation_id":"33d0dbaf-3505-4101-846c-e8ebe257396e","resolution":{"observed_at":"2026-08-16T05:51:59.742570Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:51:59.746617Z","title":"Schapire, and Matus Telgarsky","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2504.19792","last_updated":"2025-04-28T13:36:28Z","snapshot_observed_at":"2026-08-16T16:29:22.086575Z","submitted_at":"2025-04-28T13:36:28Z","title":"Contextures: The Mechanism of Representation Learning","version":1},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-08-16T05:51:59.746617Z"},"links":{"citing_paper":"/paper/2504.19792"},"observation_digest":"sha256:3965e8999b7e0b6284044baa1c05ef6a3cd85620cd8781e912744bcb119d4bf6","observation_id":"63b0724a-fa9d-447a-b7a8-ecbe0bbd7b1c","resolution":{"observed_at":"2026-08-16T05:51:59.746617Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:51:59.751055Z","title":"Understanding dimen- sional collapse in contrastive self-supervised learning","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2504.19792","last_updated":"2025-04-28T13:36:28Z","snapshot_observed_at":"2026-08-16T16:29:22.086575Z","submitted_at":"2025-04-28T13:36:28Z","title":"Contextures: The Mechanism of Representation Learning","version":1},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-08-16T05:51:59.751055Z"},"links":{"citing_paper":"/paper/2504.19792"},"observation_digest":"sha256:87cc9d3d571d3ae8c4b896a61b619fe56690b81ff60301d0f387adfcab109c80","observation_id":"1c98fe10-79fc-4fe3-aed0-18e772609524","resolution":{"observed_at":"2026-08-16T05:51:59.751055Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:51:59.754898Z","title":"Johnson, Ayoub El Hanchi, and Chris J","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.19792","last_updated":"2025-04-28T13:36:28Z","snapshot_observed_at":"2026-08-16T16:29:22.086575Z","submitted_at":"2025-04-28T13:36:28Z","title":"Contextures: The Mechanism of Representation Learning","version":1},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-08-16T05:51:59.754898Z"},"links":{"citing_paper":"/paper/2504.19792"},"observation_digest":"sha256:d4b84616da28f532b3144ca63266d57c557610a17ae26c200f7a38fd6368673d","observation_id":"309f4594-1412-48e9-b602-e441f8397492","resolution":{"observed_at":"2026-08-16T05:51:59.754898Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:51:59.759249Z","title":"Highly accurate protein structure predic tion with alphafold","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2504.19792","last_updated":"2025-04-28T13:36:28Z","snapshot_observed_at":"2026-08-16T16:29:22.086575Z","submitted_at":"2025-04-28T13:36:28Z","title":"Contextures: The Mechanism of Representation Learning","version":1},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-08-16T05:51:59.759249Z"},"links":{"citing_paper":"/paper/2504.19792"},"observation_digest":"sha256:0e666301407ebc0019405ce42687cc3f0c23b9ec322f279c47750b79f400c16b","observation_id":"4ef02d25-2c1c-4de4-84aa-ddf8df94bb9c","resolution":{"observed_at":"2026-08-16T05:51:59.759249Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:51:59.763680Z","title":"Thinking, fast and slow","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2504.19792","last_updated":"2025-04-28T13:36:28Z","snapshot_observed_at":"2026-08-16T16:29:22.086575Z","submitted_at":"2025-04-28T13:36:28Z","title":"Contextures: The Mechanism of Representation Learning","version":1},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-08-16T05:51:59.763680Z"},"links":{"citing_paper":"/paper/2504.19792"},"observation_digest":"sha256:c39265a6b5cc509863881d9986cf3c91d321c0e258b3bdb5f8c0a5f602f42d0e","observation_id":"17a0227c-9963-4bb7-ac38-6be0c8229a62","resolution":{"observed_at":"2026-08-16T05:51:59.763680Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2001.08361","last_updated":"2020-01-23T03:59:20Z","snapshot_observed_at":"2026-08-13T17:41:53.092611Z","submitted_at":"2020-01-23T03:59:20Z","title":"Scaling Laws for Neural Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2001.08361","snapshot_observed_at":"2026-08-16T05:51:59.767093Z","title":"Scaling laws for neural language models","venue":null,"work_id":null,"year":2001},"citing_paper":{"arxiv_id":"2504.19792","last_updated":"2025-04-28T13:36:28Z","snapshot_observed_at":"2026-08-16T16:29:22.086575Z","submitted_at":"2025-04-28T13:36:28Z","title":"Contextures: The Mechanism of Representation Learning","version":1},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-08-16T05:51:59.767093Z"},"links":{"cited_paper":"/paper/2001.08361","citing_paper":"/paper/2504.19792"},"observation_digest":"sha256:466bda858b477ae2cc2eba6ff5867e837decc83dbb4667c986054de7135acb21","observation_id":"d76cfd67-614b-4619-8ad0-ccc247104288","resolution":{"observed_at":"2026-08-16T05:51:59.767093Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:51:59.771078Z","title":"Supervised contrastive learn- ing","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2504.19792","last_updated":"2025-04-28T13:36:28Z","snapshot_observed_at":"2026-08-16T16:29:22.086575Z","submitted_at":"2025-04-28T13:36:28Z","title":"Contextures: The Mechanism of Representation Learning","version":1},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-08-16T05:51:59.771078Z"},"links":{"citing_paper":"/paper/2504.19792"},"observation_digest":"sha256:1cc658f85d3c16be608367f82f237594b73ac333b5717869c819281425463d54","observation_id":"43f2640a-7961-49cd-b6df-a931cc468fc2","resolution":{"observed_at":"2026-08-16T05:51:59.771078Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:51:59.774449Z","title":"Kingma and Jimmy Ba","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2504.19792","last_updated":"2025-04-28T13:36:28Z","snapshot_observed_at":"2026-08-16T16:29:22.086575Z","submitted_at":"2025-04-28T13:36:28Z","title":"Contextures: The Mechanism of Representation Learning","version":1},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-08-16T05:51:59.774449Z"},"links":{"citing_paper":"/paper/2504.19792"},"observation_digest":"sha256:b90dc95725cdf859aea16fea49804d793ef83027050e94e07a582d7f675b4c1c","observation_id":"515a613a-f16b-4f6a-ba30-4576cb0802f9","resolution":{"observed_at":"2026-08-16T05:51:59.774449Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:51:59.778677Z","title":"Kingma and Max Welling","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2504.19792","last_updated":"2025-04-28T13:36:28Z","snapshot_observed_at":"2026-08-16T16:29:22.086575Z","submitted_at":"2025-04-28T13:36:28Z","title":"Contextures: The Mechanism of Representation Learning","version":1},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-08-16T05:51:59.778677Z"},"links":{"citing_paper":"/paper/2504.19792"},"observation_digest":"sha256:e2d58a06bcbae5e5e961f036027bb3ae5342ce555a7a9e8407dcac7cc4cf9381","observation_id":"98e0f7be-826f-46e8-80e6-21276a60eac3","resolution":{"observed_at":"2026-08-16T05:51:59.778677Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:51:59.782146Z","title":"Wilds: A benchmark of in-the-wild distribution shifts","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2504.19792","last_updated":"2025-04-28T13:36:28Z","snapshot_observed_at":"2026-08-16T16:29:22.086575Z","submitted_at":"2025-04-28T13:36:28Z","title":"Contextures: The Mechanism of Representation Learning","version":1},"reference_index":88,"source":"pdf_text","source_observed_at":"2026-08-16T05:51:59.782146Z"},"links":{"citing_paper":"/paper/2504.19792"},"observation_digest":"sha256:880be5d3829b65716e2bd618f393ce16390f4d836388710596f8dbe9a9587641","observation_id":"3bacc212-9f02-4d34-87c6-293a7a202983","resolution":{"observed_at":"2026-08-16T05:51:59.782146Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:51:59.785730Z","title":"Sim- ilarity of neural network representations revisited","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2504.19792","last_updated":"2025-04-28T13:36:28Z","snapshot_observed_at":"2026-08-16T16:29:22.086575Z","submitted_at":"2025-04-28T13:36:28Z","title":"Contextures: The Mechanism of Representation Learning","version":1},"reference_index":89,"source":"pdf_text","source_observed_at":"2026-08-16T05:51:59.785730Z"},"links":{"citing_paper":"/paper/2504.19792"},"observation_digest":"sha256:ed45d71edc21b882df9702e997f40d2a25efa21221def2068b60967b3344b48f","observation_id":"0bf59d66-35a2-4c2d-aeff-b4ad7fd163c4","resolution":{"observed_at":"2026-08-16T05:51:59.785730Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:51:59.789500Z","title":"Representational similarity analysis-connecting the branches of systems ne uroscience","venue":null,"work_id":null,"year":2008},"citing_paper":{"arxiv_id":"2504.19792","last_updated":"2025-04-28T13:36:28Z","snapshot_observed_at":"2026-08-16T16:29:22.086575Z","submitted_at":"2025-04-28T13:36:28Z","title":"Contextures: The Mechanism of Representation Learning","version":1},"reference_index":90,"source":"pdf_text","source_observed_at":"2026-08-16T05:51:59.789500Z"},"links":{"citing_paper":"/paper/2504.19792"},"observation_digest":"sha256:f5559c3f89729268212c2efece19b2c9db084c77cdd1ac5b2bcbc44c2c811d21","observation_id":"49cb6b2e-d943-412d-ae91-1dc0991c4f57","resolution":{"observed_at":"2026-08-16T05:51:59.789500Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:51:59.793267Z","title":"Learning multi ple layers of features from tiny images, 2009","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2504.19792","last_updated":"2025-04-28T13:36:28Z","snapshot_observed_at":"2026-08-16T16:29:22.086575Z","submitted_at":"2025-04-28T13:36:28Z","title":"Contextures: The Mechanism of Representation Learning","version":1},"reference_index":91,"source":"pdf_text","source_observed_at":"2026-08-16T05:51:59.793267Z"},"links":{"citing_paper":"/paper/2504.19792"},"observation_digest":"sha256:b52888b9707f914adebac656f2a45fa6ea12e7d3a73d02fa83930ae4c9313ce1","observation_id":"176a7b54-b559-40aa-a932-a3621afb9f84","resolution":{"observed_at":"2026-08-16T05:51:59.793267Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:51:59.796881Z","title":"Imagenet classiﬁcation with deep convolutional neural networks","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2504.19792","last_updated":"2025-04-28T13:36:28Z","snapshot_observed_at":"2026-08-16T16:29:22.086575Z","submitted_at":"2025-04-28T13:36:28Z","title":"Contextures: The Mechanism of Representation Learning","version":1},"reference_index":92,"source":"pdf_text","source_observed_at":"2026-08-16T05:51:59.796881Z"},"links":{"citing_paper":"/paper/2504.19792"},"observation_digest":"sha256:b85bddc7f5a431af3c91ce8844fc4072a65af78104a55a7e03511d9463867464","observation_id":"ff7ab0d0-4617-4fcb-ac83-0944e07b5ee5","resolution":{"observed_at":"2026-08-16T05:51:59.796881Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:51:59.800303Z","title":"Temporal ensembling for sem i-supervised learning","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2504.19792","last_updated":"2025-04-28T13:36:28Z","snapshot_observed_at":"2026-08-16T16:29:22.086575Z","submitted_at":"2025-04-28T13:36:28Z","title":"Contextures: The Mechanism of Representation Learning","version":1},"reference_index":93,"source":"pdf_text","source_observed_at":"2026-08-16T05:51:59.800303Z"},"links":{"citing_paper":"/paper/2504.19792"},"observation_digest":"sha256:34583ee4fb211870fba5acd6394ecbc8b4e24953362a4cc0193ee4498c125027","observation_id":"7891c4ab-14ba-4572-a7eb-a43bb27c940a","resolution":{"observed_at":"2026-08-16T05:51:59.800303Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:51:59.804112Z","title":"How we analyzed the compas recidivism algorithm","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2504.19792","last_updated":"2025-04-28T13:36:28Z","snapshot_observed_at":"2026-08-16T16:29:22.086575Z","submitted_at":"2025-04-28T13:36:28Z","title":"Contextures: The Mechanism of Representation Learning","version":1},"reference_index":94,"source":"pdf_text","source_observed_at":"2026-08-16T05:51:59.804112Z"},"links":{"citing_paper":"/paper/2504.19792"},"observation_digest":"sha256:151b28aca39370591bc7a2e4dedc8a3f8be123d80ebfc9889084be99c4a8695b","observation_id":"09aca944-0df7-4e03-8274-24194f66d32a","resolution":{"observed_at":"2026-08-16T05:51:59.804112Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:51:59.807672Z","title":"Gradient-based learning applied to document recognition","venue":null,"work_id":null,"year":1998},"citing_paper":{"arxiv_id":"2504.19792","last_updated":"2025-04-28T13:36:28Z","snapshot_observed_at":"2026-08-16T16:29:22.086575Z","submitted_at":"2025-04-28T13:36:28Z","title":"Contextures: The Mechanism of Representation Learning","version":1},"reference_index":95,"source":"pdf_text","source_observed_at":"2026-08-16T05:51:59.807672Z"},"links":{"citing_paper":"/paper/2504.19792"},"observation_digest":"sha256:20909a6d5ab360d4e6e464af489f498a725333de20f85b9e783603d452c6101b","observation_id":"0f882aa1-90a8-4e5f-9d17-eaa9d4a340fc","resolution":{"observed_at":"2026-08-16T05:51:59.807672Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:51:59.811111Z","title":"P redicting what you already know helps: Provable self-supervised learning","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2504.19792","last_updated":"2025-04-28T13:36:28Z","snapshot_observed_at":"2026-08-16T16:29:22.086575Z","submitted_at":"2025-04-28T13:36:28Z","title":"Contextures: The Mechanism of Representation Learning","version":1},"reference_index":96,"source":"pdf_text","source_observed_at":"2026-08-16T05:51:59.811111Z"},"links":{"citing_paper":"/paper/2504.19792"},"observation_digest":"sha256:b1001eabbd4dd0e2eacd765a3a2ebfd8b8ed94269f5013ca74ae770db626d6b3","observation_id":"a6cdd1b8-4ddd-4822-9ad7-f300c1453136","resolution":{"observed_at":"2026-08-16T05:51:59.811111Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:51:59.814532Z","title":"Chain of thought empow- 146 ers transformers to solve inherently serial problems","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.19792","last_updated":"2025-04-28T13:36:28Z","snapshot_observed_at":"2026-08-16T16:29:22.086575Z","submitted_at":"2025-04-28T13:36:28Z","title":"Contextures: The Mechanism of Representation Learning","version":1},"reference_index":97,"source":"pdf_text","source_observed_at":"2026-08-16T05:51:59.814532Z"},"links":{"citing_paper":"/paper/2504.19792"},"observation_digest":"sha256:fd246cf861a745f0d18fa82ae7d557511320af79a6c93ff6beecb00847a1046d","observation_id":"64dba457-bae9-420d-af64-3b429f90bbe9","resolution":{"observed_at":"2026-08-16T05:51:59.814532Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.18976","last_updated":"2024-04-29T14:45:28Z","snapshot_observed_at":"2026-08-16T13:56:57.038398Z","submitted_at":"2024-04-29T14:45:28Z","title":"Foundations of Multisensory Artificial Intelligence","version":1},"cited_work":{"arxiv_id":"2404.18976","doi":null,"metadata_source":"pith","pith_arxiv_id":"2404.18976","snapshot_observed_at":"2026-08-16T05:52:00.476244Z","title":"Foundations of Multisensory Artificial Intelligence","venue":"cs.LG","work_id":"ffb84fc6-a4e0-43c7-9e2b-a81f0d73bfaf","year":2024},"citing_paper":{"arxiv_id":"2504.19792","last_updated":"2025-04-28T13:36:28Z","snapshot_observed_at":"2026-08-16T16:29:22.086575Z","submitted_at":"2025-04-28T13:36:28Z","title":"Contextures: The Mechanism of Representation Learning","version":1},"reference_index":98,"source":"pdf_text","source_observed_at":"2026-08-16T05:51:59.818173Z"},"links":{"cited_paper":"/paper/2404.18976","citing_paper":"/paper/2504.19792"},"observation_digest":"sha256:14afd75bafe522ffa6a3e137dfafcae8a919c777f416b47c35dbe2f27d6bbcce","observation_id":"1c7be8b3-3589-4f1a-8be7-281b8a93b123","resolution":{"observed_at":"2026-08-16T05:52:00.483091Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:51:59.822223Z","title":"Masked pre- diction tasks: a parameter identiﬁability view","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2504.19792","last_updated":"2025-04-28T13:36:28Z","snapshot_observed_at":"2026-08-16T16:29:22.086575Z","submitted_at":"2025-04-28T13:36:28Z","title":"Contextures: The Mechanism of Representation Learning","version":1},"reference_index":99,"source":"pdf_text","source_observed_at":"2026-08-16T05:51:59.822223Z"},"links":{"citing_paper":"/paper/2504.19792"},"observation_digest":"sha256:54e5f6a02a549bfa3289cbeb39a70edc4dad3487d11c735b5e3f3aac7895614e","observation_id":"1d4c3103-25c3-4167-a1bd-955142a2cb7f","resolution":{"observed_at":"2026-08-16T05:51:59.822223Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:51:59.825845Z","title":"HaoChen, Adrien Gaidon, and Tengyu Ma","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2504.19792","last_updated":"2025-04-28T13:36:28Z","snapshot_observed_at":"2026-08-16T16:29:22.086575Z","submitted_at":"2025-04-28T13:36:28Z","title":"Contextures: The Mechanism of Representation Learning","version":1},"reference_index":100,"source":"pdf_text","source_observed_at":"2026-08-16T05:51:59.825845Z"},"links":{"citing_paper":"/paper/2504.19792"},"observation_digest":"sha256:e7039b113001de39f1407030f5954afe8826b78d634000900d512789d1e5211e","observation_id":"5ec5248c-69c2-4053-bb69-69ce8c06e9c8","resolution":{"observed_at":"2026-08-16T05:51:59.825845Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2504.19792","last_updated":"2025-04-28T13:36:28Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-16T16:29:22.086575Z","submitted_at":"2025-04-28T13:36:28Z","title":"Contextures: The Mechanism of Representation Learning"},"reference_resolution":{"displayed":100,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":99,"verified_exact":1,"verified_fuzzy":0},"total_outbound_references":171},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"thesis":"As of 16 August 2026, this Paper Citation Record lists 100 of 171 outbound references and 0 inbound Pith citation observations for arXiv:2504.19792."}