{"as_of":"2026-08-12T19:28:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:737746eea2399bc3d3dffeca89d37ca848620315c5355636e1853038f04771d9","coverage":[{"denominator":57,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":57,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-04T10:05:18.093533Z","state":"measured"},{"denominator":60,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":60,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-12T06:34:41.77262+00:00","state":"measured"},{"denominator":3,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":3,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-03T06:49:54.421270Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-07-02T11:36:55.218721Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2510.12071","last_updated":"2026-06-09T09:56:26Z","snapshot_observed_at":"2026-08-07T13:20:46.043762Z","submitted_at":"2025-10-14T02:21:23Z","title":"Influence Dynamics and Stagewise Data Attribution","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2510.12071","snapshot_observed_at":"2026-08-03T06:49:54.421270Z","title":"Kawata, R., Song, Y ., Bietti, A., Nishikawa, N., Suzuki, T., Vaiter, S., and Wu, D","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2601.21996","last_updated":"2026-06-07T14:12:14Z","snapshot_observed_at":"2026-08-10T03:02:57.560255Z","submitted_at":"2026-01-29T17:06:54Z","title":"Mechanistic Data Attribution: Tracing the Training Origins of Interpretable LLM Units","version":2},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-03T06:49:54.421270Z"},"links":{"cited_paper":"/paper/2510.12071","citing_paper":"/paper/2601.21996"},"observation_digest":"sha256:ac90aebef375b8f6e3b6152851fb51b2beb2942e3735f4b06717897859937624","observation_id":"2a310f25-cd59-4c19-91cf-51a840eab3cf","resolution":{"observed_at":"2026-08-03T06:49:54.421270Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2510.12071","last_updated":"2026-06-09T09:56:26Z","snapshot_observed_at":"2026-08-07T13:20:46.043762Z","submitted_at":"2025-10-14T02:21:23Z","title":"Influence Dynamics and Stagewise Data Attribution","version":2},"cited_work":{"arxiv_id":"2510.12071","doi":null,"metadata_source":"pith","pith_arxiv_id":"2510.12071","snapshot_observed_at":"2026-07-02T11:36:55.218721Z","title":"Influence Dynamics and Stagewise Data Attribution","venue":"cs.LG","work_id":"16410004-801d-4c73-9e53-0c33ad2ee634","year":2025},"citing_paper":{"arxiv_id":"2604.28154","last_updated":"2026-04-30T17:42:12Z","snapshot_observed_at":"2026-08-11T14:36:43.524987Z","submitted_at":"2026-04-30T17:42:12Z","title":"Mapping data sensitivities in global QCD analysis with linear response and influence functions","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-05-07T07:11:36.939657Z"},"links":{"cited_paper":"/paper/2510.12071","citing_paper":"/paper/2604.28154"},"observation_digest":"sha256:8e615653c0d113ba9fe291a26de1e06dfccc525d6124b5338aea4e878d28d5c8","observation_id":"0f4c0163-db8c-4f13-b87b-0e5b2e1494ad","resolution":{"observed_at":"2026-06-10T02:11:41.946543Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2510.12071","last_updated":"2026-06-09T09:56:26Z","snapshot_observed_at":"2026-08-07T13:20:46.043762Z","submitted_at":"2025-10-14T02:21:23Z","title":"Influence Dynamics and Stagewise Data Attribution","version":2},"cited_work":{"arxiv_id":"2510.12071","doi":null,"metadata_source":"pith","pith_arxiv_id":"2510.12071","snapshot_observed_at":"2026-07-02T11:36:55.218721Z","title":"Influence Dynamics and Stagewise Data Attribution","venue":"cs.LG","work_id":"16410004-801d-4c73-9e53-0c33ad2ee634","year":2025},"citing_paper":{"arxiv_id":"2606.05957","last_updated":"2026-06-04T09:54:08Z","snapshot_observed_at":"2026-08-08T05:42:33.934596Z","submitted_at":"2026-06-04T09:54:08Z","title":"Dead Directions: Geometric Singular Learning","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-06-28T03:20:09.365073Z"},"links":{"cited_paper":"/paper/2510.12071","citing_paper":"/paper/2606.05957"},"observation_digest":"sha256:020502a522164a708f320b61e886e9d3728f3ffeebf89e21913a86d5a97ba372","observation_id":"08233de0-5b51-404c-8063-d87cb9df8e74","resolution":{"observed_at":"2026-07-02T11:36:55.219923Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2510.12071/citation-record","integrity":"/paper/2510.12071/integrity","json":"/paper/2510.12071/citation-record.json","paper":"/paper/2510.12071"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:05:11.757855Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2510.12071","last_updated":"2026-06-09T09:56:26Z","snapshot_observed_at":"2026-08-07T13:20:46.043762Z","submitted_at":"2025-10-14T02:21:23Z","title":"Influence Dynamics and Stagewise Data Attribution","version":2},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-04T10:05:11.757855Z"},"links":{"citing_paper":"/paper/2510.12071"},"observation_digest":"sha256:0cd5729ed4c019353e818b5416d86ab6e617a1b69596917cb8933f235251aaf9","observation_id":"43782384-81b4-44ec-9c4d-d284179bcd6c","resolution":{"observed_at":"2026-08-04T10:05:11.757855Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:05:11.849763Z","title":"The loss kernel: A geometric probe for deep learning interpretability, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2510.12071","last_updated":"2026-06-09T09:56:26Z","snapshot_observed_at":"2026-08-07T13:20:46.043762Z","submitted_at":"2025-10-14T02:21:23Z","title":"Influence Dynamics and Stagewise Data Attribution","version":2},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-04T10:05:11.849763Z"},"links":{"citing_paper":"/paper/2510.12071"},"observation_digest":"sha256:02205692c44d7eda5ee7c3510cb86626f140cdff8aeef539734b6485c73a35c3","observation_id":"8d35d0e6-cd45-4245-b668-47f2afbee953","resolution":{"observed_at":"2026-08-04T10:05:11.849763Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:05:11.946815Z","title":"Consideration on the learning efficiency of multiple-layered neural networks with linear units","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.12071","last_updated":"2026-06-09T09:56:26Z","snapshot_observed_at":"2026-08-07T13:20:46.043762Z","submitted_at":"2025-10-14T02:21:23Z","title":"Influence Dynamics and Stagewise Data Attribution","version":2},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-04T10:05:11.946815Z"},"links":{"citing_paper":"/paper/2510.12071"},"observation_digest":"sha256:c9b81c13284dd870a7966e342a2d7a0a8147c3d19a060d2d5c3451cd8bacc246","observation_id":"0804cecb-7f4d-4bb1-93da-48aa02852b29","resolution":{"observed_at":"2026-08-04T10:05:11.946815Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:05:12.056276Z","title":"If Influence Functions are the Answer , Then What is the Question ? 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2510.12071","last_updated":"2026-06-09T09:56:26Z","snapshot_observed_at":"2026-08-07T13:20:46.043762Z","submitted_at":"2025-10-14T02:21:23Z","title":"Influence Dynamics and Stagewise Data Attribution","version":2},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-04T10:05:12.056276Z"},"links":{"citing_paper":"/paper/2510.12071"},"observation_digest":"sha256:d0faf23677db6cd9d23d9e294cd72d2b6677590100e26dc995c7532d81f9b09a","observation_id":"88dc41ac-8611-46cd-8444-7f6bba9c278a","resolution":{"observed_at":"2026-08-04T10:05:12.056276Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:05:12.162453Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.12071","last_updated":"2026-06-09T09:56:26Z","snapshot_observed_at":"2026-08-07T13:20:46.043762Z","submitted_at":"2025-10-14T02:21:23Z","title":"Influence Dynamics and Stagewise Data Attribution","version":2},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-04T10:05:12.162453Z"},"links":{"citing_paper":"/paper/2510.12071"},"observation_digest":"sha256:3168defcdfa4a463ea30328e55f60b19a5bec90e138ffab3490d4fda9a8f785a","observation_id":"44630bc0-58bb-4be5-9882-9d7fb81d1f34","resolution":{"observed_at":"2026-08-04T10:05:12.162453Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:05:12.258042Z","title":"Structural Inference : Studying Small Language Models with Susceptibilities , April 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2510.12071","last_updated":"2026-06-09T09:56:26Z","snapshot_observed_at":"2026-08-07T13:20:46.043762Z","submitted_at":"2025-10-14T02:21:23Z","title":"Influence Dynamics and Stagewise Data Attribution","version":2},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-04T10:05:12.258042Z"},"links":{"citing_paper":"/paper/2510.12071"},"observation_digest":"sha256:c50aa611aa975d72f0607ed0a862d28f772f14be23bc8ec2b81ed3607aced502","observation_id":"e08f7173-d61f-4c3a-b2fc-110890c4dc95","resolution":{"observed_at":"2026-08-04T10:05:12.258042Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:05:12.354827Z","title":"Curriculum learning","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2510.12071","last_updated":"2026-06-09T09:56:26Z","snapshot_observed_at":"2026-08-07T13:20:46.043762Z","submitted_at":"2025-10-14T02:21:23Z","title":"Influence Dynamics and Stagewise Data Attribution","version":2},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-04T10:05:12.354827Z"},"links":{"citing_paper":"/paper/2510.12071"},"observation_digest":"sha256:c9052407a12920fb15c04f209ff093ecade5b123d2c4a442123c24cc34a39abc","observation_id":"6e8ea588-968d-4976-b40f-f73a1b1a575d","resolution":{"observed_at":"2026-08-04T10:05:12.354827Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:05:12.457140Z","title":"Pythia: a suite for analyzing large language models across training and scaling","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2510.12071","last_updated":"2026-06-09T09:56:26Z","snapshot_observed_at":"2026-08-07T13:20:46.043762Z","submitted_at":"2025-10-14T02:21:23Z","title":"Influence Dynamics and Stagewise Data Attribution","version":2},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-04T10:05:12.457140Z"},"links":{"citing_paper":"/paper/2510.12071"},"observation_digest":"sha256:ac8fbba31d7f0eda866f4381724c954144290de39d88f5cf7dee1661ef229cc7","observation_id":"a48c391f-4a2c-49b4-8747-be004763e0fc","resolution":{"observed_at":"2026-08-04T10:05:12.457140Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.17745","last_updated":"2025-01-31T12:45:13Z","snapshot_observed_at":"2026-08-10T16:56:13.667321Z","submitted_at":"2025-01-29T16:32:14Z","title":"Dynamics of Transient Structure in In-Context Linear Regression Transformers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.17745","snapshot_observed_at":"2026-08-04T10:05:12.559078Z","title":"Dynamics of Transient Structure in In - Context Linear Regression Transformers , January 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2510.12071","last_updated":"2026-06-09T09:56:26Z","snapshot_observed_at":"2026-08-07T13:20:46.043762Z","submitted_at":"2025-10-14T02:21:23Z","title":"Influence Dynamics and Stagewise Data Attribution","version":2},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-04T10:05:12.559078Z"},"links":{"cited_paper":"/paper/2501.17745","citing_paper":"/paper/2510.12071"},"observation_digest":"sha256:4cd3e6605d1a0565b8e67c77895d139d47d35fc09a881daf297a4777173857a3","observation_id":"5dbc91a5-def6-44ef-acbe-e380b2a4c86a","resolution":{"observed_at":"2026-08-04T10:05:12.559078Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1609/aaai.v35i8.16871","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"HyDRA : Hypergradient Data Relevance Analysis for Interpreting Deep Neural Networks","venue":"Proceedings of the AAAI Conference on Artificial Intelligence","work_id":"21057616-8663-42b2-8874-335c228fa938","year":2021},"citing_paper":{"arxiv_id":"2510.12071","last_updated":"2026-06-09T09:56:26Z","snapshot_observed_at":"2026-08-07T13:20:46.043762Z","submitted_at":"2025-10-14T02:21:23Z","title":"Influence Dynamics and Stagewise Data Attribution","version":2},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-04T10:05:12.665089Z"},"links":{"citing_paper":"/paper/2510.12071"},"observation_digest":"sha256:6b2af3bf0ba8489ede3400eeda92730f1880f13f4ea09befab9f41ba8bd7752b","observation_id":"810bcffc-ea8a-4668-9f6b-08c6d59443e3","resolution":{"observed_at":"2026-08-04T10:08:36.712819Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06301","last_updated":"2023-10-10T04:26:04Z","snapshot_observed_at":"2026-08-09T06:15:57.100129Z","submitted_at":"2023-10-10T04:26:04Z","title":"Dynamical versus Bayesian Phase Transitions in a Toy Model of Superposition","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.06301","snapshot_observed_at":"2026-08-04T10:05:12.769326Z","title":"Dynamical versus bayesian phase transitions in a toy model of superposition","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2510.12071","last_updated":"2026-06-09T09:56:26Z","snapshot_observed_at":"2026-08-07T13:20:46.043762Z","submitted_at":"2025-10-14T02:21:23Z","title":"Influence Dynamics and Stagewise Data Attribution","version":2},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-04T10:05:12.769326Z"},"links":{"cited_paper":"/paper/2310.06301","citing_paper":"/paper/2510.12071"},"observation_digest":"sha256:cac2ab4b1dadf9578b258eac3d30d0cf5aa845ae9926e0200b63eb0dd570f010","observation_id":"baffe498-a4df-475a-94e3-9658ca4ba200","resolution":{"observed_at":"2026-08-04T10:05:12.769326Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12642","last_updated":"2025-01-22T05:03:51Z","snapshot_observed_at":"2026-08-10T22:26:05.241243Z","submitted_at":"2025-01-22T05:03:51Z","title":"Training Data Attribution (TDA): Examining Its Adoption & Use Cases","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12642","snapshot_observed_at":"2026-08-04T10:05:12.875309Z","title":"Training Data Attribution ( TDA ): Examining Its Adoption & Use Cases , January 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2510.12071","last_updated":"2026-06-09T09:56:26Z","snapshot_observed_at":"2026-08-07T13:20:46.043762Z","submitted_at":"2025-10-14T02:21:23Z","title":"Influence Dynamics and Stagewise Data Attribution","version":2},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-04T10:05:12.875309Z"},"links":{"cited_paper":"/paper/2501.12642","citing_paper":"/paper/2510.12071"},"observation_digest":"sha256:f9801b6548df65fb9bf7db4cb3329c3f4f6ff2a61543129cedf744626f5124d4","observation_id":"a69a3794-98da-4fae-9e8d-0ae0759894c7","resolution":{"observed_at":"2026-08-04T10:05:12.875309Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:05:12.980352Z","title":"Dennis Cook","venue":null,"work_id":null,"year":1977},"citing_paper":{"arxiv_id":"2510.12071","last_updated":"2026-06-09T09:56:26Z","snapshot_observed_at":"2026-08-07T13:20:46.043762Z","submitted_at":"2025-10-14T02:21:23Z","title":"Influence Dynamics and Stagewise Data Attribution","version":2},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-04T10:05:12.980352Z"},"links":{"citing_paper":"/paper/2510.12071"},"observation_digest":"sha256:5bd07694c25e3023e33a671e24785516d8523b76de5210bb4c79307491fd0f50","observation_id":"e2c564ed-4b05-43ff-9c7a-b9ef8e52a1bc","resolution":{"observed_at":"2026-08-04T10:05:12.980352Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:05:13.086159Z","title":"Characterizations of an empirical influence function for detecting influential cases in regression","venue":null,"work_id":null,"year":1980},"citing_paper":{"arxiv_id":"2510.12071","last_updated":"2026-06-09T09:56:26Z","snapshot_observed_at":"2026-08-07T13:20:46.043762Z","submitted_at":"2025-10-14T02:21:23Z","title":"Influence Dynamics and Stagewise Data Attribution","version":2},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-04T10:05:13.086159Z"},"links":{"citing_paper":"/paper/2510.12071"},"observation_digest":"sha256:b805c895246cdb910c7ddf25d85b6ff0169833cca36df105ebdcabc488b15477","observation_id":"a08005c1-1cb7-4b7f-be42-f9fb10bf8a45","resolution":{"observed_at":"2026-08-04T10:05:13.086159Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:05:13.188071Z","title":"Dennis Cook and Sanford Weisberg","venue":null,"work_id":null,"year":1982},"citing_paper":{"arxiv_id":"2510.12071","last_updated":"2026-06-09T09:56:26Z","snapshot_observed_at":"2026-08-07T13:20:46.043762Z","submitted_at":"2025-10-14T02:21:23Z","title":"Influence Dynamics and Stagewise Data Attribution","version":2},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-04T10:05:13.188071Z"},"links":{"citing_paper":"/paper/2510.12071"},"observation_digest":"sha256:3dc546e3b8c25b87343f779d27c009e3644090b205669b5a014f7d3b4122cf9f","observation_id":"af4f4661-66b1-4240-9aa3-c65a747a8aed","resolution":{"observed_at":"2026-08-04T10:05:13.188071Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:05:13.292998Z","title":"Multidimensional scaling","venue":null,"work_id":null,"year":2008},"citing_paper":{"arxiv_id":"2510.12071","last_updated":"2026-06-09T09:56:26Z","snapshot_observed_at":"2026-08-07T13:20:46.043762Z","submitted_at":"2025-10-14T02:21:23Z","title":"Influence Dynamics and Stagewise Data Attribution","version":2},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-04T10:05:13.292998Z"},"links":{"citing_paper":"/paper/2510.12071"},"observation_digest":"sha256:38e02d4d0748ebd85c7bdf618345b66867f53bc7e6c1b55cd95dfd1f438728ae","observation_id":"86b539b1-8519-44b5-b4e5-405ce1c1fe4e","resolution":{"observed_at":"2026-08-04T10:05:13.292998Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2101.00027","last_updated":"2020-12-31T19:00:10Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-12-31T19:00:10Z","title":"The Pile: An 800GB Dataset of Diverse Text for Language Modeling","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2101.00027","snapshot_observed_at":"2026-08-04T10:05:13.399136Z","title":"The P ile: An 800gb dataset of diverse text for language modeling","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2510.12071","last_updated":"2026-06-09T09:56:26Z","snapshot_observed_at":"2026-08-07T13:20:46.043762Z","submitted_at":"2025-10-14T02:21:23Z","title":"Influence Dynamics and Stagewise Data Attribution","version":2},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-04T10:05:13.399136Z"},"links":{"cited_paper":"/paper/2101.00027","citing_paper":"/paper/2510.12071"},"observation_digest":"sha256:4edd29134d14937b98acda87e7b972b9c54f7f4ee6558fa1b31cc18d46f18d53","observation_id":"9518d7c1-f1f5-4067-ba95-8f009822df84","resolution":{"observed_at":"2026-08-04T10:05:13.399136Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:05:13.503559Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2510.12071","last_updated":"2026-06-09T09:56:26Z","snapshot_observed_at":"2026-08-07T13:20:46.043762Z","submitted_at":"2025-10-14T02:21:23Z","title":"Influence Dynamics and Stagewise Data Attribution","version":2},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-04T10:05:13.503559Z"},"links":{"citing_paper":"/paper/2510.12071"},"observation_digest":"sha256:379db4ca7245e617d152557cec288651afcb514f2c3ad5307dc8cdb8c573d386","observation_id":"09763e35-0550-4777-bee2-31e809b1e494","resolution":{"observed_at":"2026-08-04T10:05:13.503559Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:05:13.614088Z","title":"Automated curriculum learning for neural networks","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2510.12071","last_updated":"2026-06-09T09:56:26Z","snapshot_observed_at":"2026-08-07T13:20:46.043762Z","submitted_at":"2025-10-14T02:21:23Z","title":"Influence Dynamics and Stagewise Data Attribution","version":2},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-04T10:05:13.614088Z"},"links":{"citing_paper":"/paper/2510.12071"},"observation_digest":"sha256:5feb43e82f1f52f5377f05142ff7329412c2ee97de66df04206b5eddfd972ff8","observation_id":"2bf84c9e-13ee-4abd-b312-9288dc40d30e","resolution":{"observed_at":"2026-08-04T10:05:13.614088Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.03296","last_updated":"2023-08-07T04:47:42Z","snapshot_observed_at":"2026-08-09T11:08:40.708986Z","submitted_at":"2023-08-07T04:47:42Z","title":"Studying Large Language Model Generalization with Influence Functions","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.03296","snapshot_observed_at":"2026-08-04T10:05:13.724700Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2510.12071","last_updated":"2026-06-09T09:56:26Z","snapshot_observed_at":"2026-08-07T13:20:46.043762Z","submitted_at":"2025-10-14T02:21:23Z","title":"Influence Dynamics and Stagewise Data Attribution","version":2},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-04T10:05:13.724700Z"},"links":{"cited_paper":"/paper/2308.03296","citing_paper":"/paper/2510.12071"},"observation_digest":"sha256:839c9aa99f95522e6939ed5dfa89fc5e16bcb9f77d00d9a20841f08f62d73d5b","observation_id":"b40012a6-ecab-4d0f-8678-66895a333cfe","resolution":{"observed_at":"2026-08-04T10:05:13.724700Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:05:13.851107Z","title":"Learning distributed representations of concepts","venue":null,"work_id":null,"year":1986},"citing_paper":{"arxiv_id":"2510.12071","last_updated":"2026-06-09T09:56:26Z","snapshot_observed_at":"2026-08-07T13:20:46.043762Z","submitted_at":"2025-10-14T02:21:23Z","title":"Influence Dynamics and Stagewise Data Attribution","version":2},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-04T10:05:13.851107Z"},"links":{"citing_paper":"/paper/2510.12071"},"observation_digest":"sha256:d8dbc81626cbd5efa997ad5415e4ddba022f1b1abc3f2f9c4dc4bee60b7316fb","observation_id":"1fc30f9f-1fb6-49cd-be3c-0fa47ab12d68","resolution":{"observed_at":"2026-08-04T10:05:13.851107Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.11830","last_updated":"2025-04-16T07:38:51Z","snapshot_observed_at":"2026-08-07T16:01:54.899612Z","submitted_at":"2025-04-16T07:38:51Z","title":"Emergence of Computational Structure in a Neural Network Physics Simulator","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.11830","snapshot_observed_at":"2026-08-04T10:05:13.968883Z","title":"Emergence of computational structure in a neural network physics simulator","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2510.12071","last_updated":"2026-06-09T09:56:26Z","snapshot_observed_at":"2026-08-07T13:20:46.043762Z","submitted_at":"2025-10-14T02:21:23Z","title":"Influence Dynamics and Stagewise Data Attribution","version":2},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-04T10:05:13.968883Z"},"links":{"cited_paper":"/paper/2504.11830","citing_paper":"/paper/2510.12071"},"observation_digest":"sha256:6efa6d9d8b5d96cb03bce21c1f8ce8c1a90291e3d1cc15f9734ee90a10614629","observation_id":"28901f34-1c93-4b70-a910-31d8dd7af26e","resolution":{"observed_at":"2026-08-04T10:05:13.968883Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.02364","last_updated":"2025-08-01T09:20:40Z","snapshot_observed_at":"2026-08-10T06:47:42.759048Z","submitted_at":"2024-02-04T06:23:05Z","title":"Loss Landscape Degeneracy and Stagewise Development in Transformers","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.02364","snapshot_observed_at":"2026-08-04T10:05:14.055998Z","title":"The developmental landscape of in-context learning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.12071","last_updated":"2026-06-09T09:56:26Z","snapshot_observed_at":"2026-08-07T13:20:46.043762Z","submitted_at":"2025-10-14T02:21:23Z","title":"Influence Dynamics and Stagewise Data Attribution","version":2},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-04T10:05:14.055998Z"},"links":{"cited_paper":"/paper/2402.02364","citing_paper":"/paper/2510.12071"},"observation_digest":"sha256:af9073c3767b6615924b1352c992727464f617ce3e688b88594bac6f863132e5","observation_id":"fc4ca220-8ecc-4f70-96b9-d18021a425e3","resolution":{"observed_at":"2026-08-04T10:05:14.055998Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:05:14.141292Z","title":"Loss landscape degeneracy and stagewise development in transformers","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2510.12071","last_updated":"2026-06-09T09:56:26Z","snapshot_observed_at":"2026-08-07T13:20:46.043762Z","submitted_at":"2025-10-14T02:21:23Z","title":"Influence Dynamics and Stagewise Data Attribution","version":2},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-04T10:05:14.141292Z"},"links":{"citing_paper":"/paper/2510.12071"},"observation_digest":"sha256:2323932c9c19463fceebf16ad0ec6ef9535efa9120b33c1b76809a4ca73c3f7d","observation_id":"094c1e3d-92e6-4a5f-b7da-b40b5dbccf34","resolution":{"observed_at":"2026-08-04T10:05:14.141292Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:05:14.242048Z","title":"The growth of logical thinking from childhood to adolescence: An essay on the construction of formal operational structures","venue":null,"work_id":null,"year":1958},"citing_paper":{"arxiv_id":"2510.12071","last_updated":"2026-06-09T09:56:26Z","snapshot_observed_at":"2026-08-07T13:20:46.043762Z","submitted_at":"2025-10-14T02:21:23Z","title":"Influence Dynamics and Stagewise Data Attribution","version":2},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-04T10:05:14.242048Z"},"links":{"citing_paper":"/paper/2510.12071"},"observation_digest":"sha256:d6da27cc499bf9597340b40a6a123692f75c02e59a3a0b38ed28f15af9702e44","observation_id":"c05f3b02-781a-4c8d-b937-b7883e79b4ac","resolution":{"observed_at":"2026-08-04T10:05:14.242048Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:05:14.336663Z","title":"Semantic and conceptual development: An ontological perspective","venue":null,"work_id":null,"year":1979},"citing_paper":{"arxiv_id":"2510.12071","last_updated":"2026-06-09T09:56:26Z","snapshot_observed_at":"2026-08-07T13:20:46.043762Z","submitted_at":"2025-10-14T02:21:23Z","title":"Influence Dynamics and Stagewise Data Attribution","version":2},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-04T10:05:14.336663Z"},"links":{"citing_paper":"/paper/2510.12071"},"observation_digest":"sha256:302723849360949e22097454883159788f34eecf7835b94a81d0d24e22e475d4","observation_id":"84059201-ed5f-410b-b46b-efb0ffbef8a0","resolution":{"observed_at":"2026-08-04T10:05:14.336663Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1703.04730","last_updated":"2020-12-29T22:40:43Z","snapshot_observed_at":"2026-08-10T05:11:31.110353Z","submitted_at":"2017-03-14T21:07:01Z","title":"Understanding Black-box Predictions via Influence Functions","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1703.04730","snapshot_observed_at":"2026-08-04T10:05:14.440621Z","title":"Understanding black-box predictions via influence functions, December 2020","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2510.12071","last_updated":"2026-06-09T09:56:26Z","snapshot_observed_at":"2026-08-07T13:20:46.043762Z","submitted_at":"2025-10-14T02:21:23Z","title":"Influence Dynamics and Stagewise Data Attribution","version":2},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-04T10:05:14.440621Z"},"links":{"cited_paper":"/paper/1703.04730","citing_paper":"/paper/2510.12071"},"observation_digest":"sha256:201242b672ed68ccd53e244721945cfa9a952b0e1f58fbdbe852249614099491","observation_id":"683381e6-0376-4a69-ad10-3e586deb8ae9","resolution":{"observed_at":"2026-08-04T10:05:14.440621Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:05:14.594555Z","title":"Bayesian influence functions for hessian-free data attribution, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2510.12071","last_updated":"2026-06-09T09:56:26Z","snapshot_observed_at":"2026-08-07T13:20:46.043762Z","submitted_at":"2025-10-14T02:21:23Z","title":"Influence Dynamics and Stagewise Data Attribution","version":2},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-04T10:05:14.594555Z"},"links":{"citing_paper":"/paper/2510.12071"},"observation_digest":"sha256:a3bf0a4639fdad0565588af12d5c2fab66495ce695986eacde636482050ab5e9","observation_id":"fe5cea41-0803-4efd-93f7-1c735585c42d","resolution":{"observed_at":"2026-08-04T10:05:14.594555Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:05:14.698140Z","title":"The local learning coefficient: a singularity-aware complexity measure","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2510.12071","last_updated":"2026-06-09T09:56:26Z","snapshot_observed_at":"2026-08-07T13:20:46.043762Z","submitted_at":"2025-10-14T02:21:23Z","title":"Influence Dynamics and Stagewise Data Attribution","version":2},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-04T10:05:14.698140Z"},"links":{"citing_paper":"/paper/2510.12071"},"observation_digest":"sha256:6377890f33d14287f4098bd84ae08cf360d53837a717aef38d0b9a8f7739d200","observation_id":"7332133d-e8f9-478a-b3ed-2f01df1686d2","resolution":{"observed_at":"2026-08-04T10:05:14.698140Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.18361","last_updated":"2024-06-12T14:08:47Z","snapshot_observed_at":"2026-08-11T18:34:48.384034Z","submitted_at":"2024-02-28T14:33:09Z","title":"Why Do Animals Need Shaping? A Theory of Task Composition and Curriculum Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.18361","snapshot_observed_at":"2026-08-04T10:05:14.767977Z","title":"Why do animals need shaping? a theory of task composition and curriculum learning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.12071","last_updated":"2026-06-09T09:56:26Z","snapshot_observed_at":"2026-08-07T13:20:46.043762Z","submitted_at":"2025-10-14T02:21:23Z","title":"Influence Dynamics and Stagewise Data Attribution","version":2},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-04T10:05:14.767977Z"},"links":{"cited_paper":"/paper/2402.18361","citing_paper":"/paper/2510.12071"},"observation_digest":"sha256:26803e9ff392a311d3d1fa13bc60cb70748d93125da78f0de8e125e3051cc36b","observation_id":"a96eef11-fcd5-4a5f-ad5b-8cca6ade7e8c","resolution":{"observed_at":"2026-08-04T10:05:14.767977Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.05475","last_updated":"2025-02-08T07:24:04Z","snapshot_observed_at":"2026-08-09T02:15:12.668653Z","submitted_at":"2025-02-08T07:24:04Z","title":"You Are What You Eat -- AI Alignment Requires Understanding How Data Shapes Structure and Generalisation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.05475","snapshot_observed_at":"2026-08-04T10:05:14.932062Z","title":"You Are What You Eat -- AI Alignment Requires Understanding How Data Shapes Structure and Generalisation , February 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2510.12071","last_updated":"2026-06-09T09:56:26Z","snapshot_observed_at":"2026-08-07T13:20:46.043762Z","submitted_at":"2025-10-14T02:21:23Z","title":"Influence Dynamics and Stagewise Data Attribution","version":2},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-04T10:05:14.932062Z"},"links":{"cited_paper":"/paper/2502.05475","citing_paper":"/paper/2510.12071"},"observation_digest":"sha256:ec8071d3eb842dbc1c9d74b0316656d5de17212e0179e0e614b62b910c660ef5","observation_id":"cb7c1ddb-d735-4333-8255-409382850673","resolution":{"observed_at":"2026-08-04T10:05:14.932062Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:05:15.094475Z","title":"Preconditioned stochastic gradient langevin dynamics for deep neural networks","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2510.12071","last_updated":"2026-06-09T09:56:26Z","snapshot_observed_at":"2026-08-07T13:20:46.043762Z","submitted_at":"2025-10-14T02:21:23Z","title":"Influence Dynamics and Stagewise Data Attribution","version":2},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-04T10:05:15.094475Z"},"links":{"citing_paper":"/paper/2510.12071"},"observation_digest":"sha256:776ebd7920e58a52e342e8a3c46aef7b08500f3dbfc3766f2055a8ef2a9b37a4","observation_id":"b6dd0975-11c0-46b7-b1da-212750ae27c5","resolution":{"observed_at":"2026-08-04T10:05:15.094475Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:05:15.238700Z","title":"Tilting the odds at the lottery: the interplay of overparameterisation and curricula in neural networks","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.12071","last_updated":"2026-06-09T09:56:26Z","snapshot_observed_at":"2026-08-07T13:20:46.043762Z","submitted_at":"2025-10-14T02:21:23Z","title":"Influence Dynamics and Stagewise Data Attribution","version":2},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-04T10:05:15.238700Z"},"links":{"citing_paper":"/paper/2510.12071"},"observation_digest":"sha256:def390703efecfb4f5a0516f4153d37418420ec51922e8bd7786aa03f5598e6e","observation_id":"9b9ccb4f-c2fa-4159-a122-b4700dc1c1cd","resolution":{"observed_at":"2026-08-04T10:05:15.238700Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:05:15.384196Z","title":"Optimizing neural networks with Kronecker -factored approximate curvature","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2510.12071","last_updated":"2026-06-09T09:56:26Z","snapshot_observed_at":"2026-08-07T13:20:46.043762Z","submitted_at":"2025-10-14T02:21:23Z","title":"Influence Dynamics and Stagewise Data Attribution","version":2},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-04T10:05:15.384196Z"},"links":{"citing_paper":"/paper/2510.12071"},"observation_digest":"sha256:edf506cd300abc50983aea9ecd79545dbc68ecb24a60145c52dbb4ca69e6cbb9","observation_id":"6adda16b-3ed1-44d8-8543-46aa47f36b80","resolution":{"observed_at":"2026-08-04T10:05:15.384196Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:05:15.603314Z","title":"A connectionist perspective on knowledge and development","venue":null,"work_id":null,"year":1995},"citing_paper":{"arxiv_id":"2510.12071","last_updated":"2026-06-09T09:56:26Z","snapshot_observed_at":"2026-08-07T13:20:46.043762Z","submitted_at":"2025-10-14T02:21:23Z","title":"Influence Dynamics and Stagewise Data Attribution","version":2},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-04T10:05:15.603314Z"},"links":{"citing_paper":"/paper/2510.12071"},"observation_digest":"sha256:caa32dc7c3eb7a7ad200c7e8d6e1836fb260d878ce5a6f0741c1ef3294b095f5","observation_id":"3b183cd7-e6c1-404d-88d2-3a646ba76ec3","resolution":{"observed_at":"2026-08-04T10:05:15.603314Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:05:15.770047Z","title":"In-context learning and induction heads","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2510.12071","last_updated":"2026-06-09T09:56:26Z","snapshot_observed_at":"2026-08-07T13:20:46.043762Z","submitted_at":"2025-10-14T02:21:23Z","title":"Influence Dynamics and Stagewise Data Attribution","version":2},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-04T10:05:15.770047Z"},"links":{"citing_paper":"/paper/2510.12071"},"observation_digest":"sha256:6404881a4f83fe3a55cfdb2636ac45db28c4ef39e90e84a516861cbe3b5e94f4","observation_id":"04ad5327-2335-4082-88fd-6c4c6ac44d25","resolution":{"observed_at":"2026-08-04T10:05:15.770047Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:05:15.880605Z","title":"Estimating Training Data Influence by Tracing Gradient Descent","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2510.12071","last_updated":"2026-06-09T09:56:26Z","snapshot_observed_at":"2026-08-07T13:20:46.043762Z","submitted_at":"2025-10-14T02:21:23Z","title":"Influence Dynamics and Stagewise Data Attribution","version":2},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-04T10:05:15.880605Z"},"links":{"citing_paper":"/paper/2510.12071"},"observation_digest":"sha256:cdf91db3453df22989aa1105913447d2aa06b0abf816444e45b19cfca579c5ec","observation_id":"3bcff91c-3621-44e4-994b-09a185a01a0c","resolution":{"observed_at":"2026-08-04T10:05:15.880605Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:05:15.966609Z","title":"On the spectral bias of neural networks","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2510.12071","last_updated":"2026-06-09T09:56:26Z","snapshot_observed_at":"2026-08-07T13:20:46.043762Z","submitted_at":"2025-10-14T02:21:23Z","title":"Influence Dynamics and Stagewise Data Attribution","version":2},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-04T10:05:15.966609Z"},"links":{"citing_paper":"/paper/2510.12071"},"observation_digest":"sha256:b0769ee11ac1d1ff891d5f6b2bbccdec82921a3524675427e32e91690ec77310","observation_id":"5272c602-6651-40cc-bf64-aa16b660878e","resolution":{"observed_at":"2026-08-04T10:05:15.966609Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:05:16.063273Z","title":"Semantic cognition: A parallel distributed processing approach","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2510.12071","last_updated":"2026-06-09T09:56:26Z","snapshot_observed_at":"2026-08-07T13:20:46.043762Z","submitted_at":"2025-10-14T02:21:23Z","title":"Influence Dynamics and Stagewise Data Attribution","version":2},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-04T10:05:16.063273Z"},"links":{"citing_paper":"/paper/2510.12071"},"observation_digest":"sha256:149c8f09deec1de609f3efefd126ad0d71d2e9a97fca615091c8871bef617e5c","observation_id":"426ee3b4-9ef4-4485-8c33-1e9603ba77f6","resolution":{"observed_at":"2026-08-04T10:05:16.063273Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:05:16.169956Z","title":"1 learning and connectionist","venue":null,"work_id":null,"year":1993},"citing_paper":{"arxiv_id":"2510.12071","last_updated":"2026-06-09T09:56:26Z","snapshot_observed_at":"2026-08-07T13:20:46.043762Z","submitted_at":"2025-10-14T02:21:23Z","title":"Influence Dynamics and Stagewise Data Attribution","version":2},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-04T10:05:16.169956Z"},"links":{"citing_paper":"/paper/2510.12071"},"observation_digest":"sha256:fff3dbd70fbdd0211fb044fd6e1ec159a8c624e539b69453a7c1532a967e2a9a","observation_id":"23246495-df41-4244-b5ea-834074ddb9a0","resolution":{"observed_at":"2026-08-04T10:05:16.169956Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1312.6120","last_updated":"2014-02-19T17:26:57Z","snapshot_observed_at":"2026-08-12T14:31:51.567205Z","submitted_at":"2013-12-20T20:24:00Z","title":"Exact solutions to the nonlinear dynamics of learning in deep linear neural networks","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1312.6120","snapshot_observed_at":"2026-08-04T10:05:16.273557Z","title":"Exact solutions to the nonlinear dynamics of learning in deep linear neural networks","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2510.12071","last_updated":"2026-06-09T09:56:26Z","snapshot_observed_at":"2026-08-07T13:20:46.043762Z","submitted_at":"2025-10-14T02:21:23Z","title":"Influence Dynamics and Stagewise Data Attribution","version":2},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-04T10:05:16.273557Z"},"links":{"cited_paper":"/paper/1312.6120","citing_paper":"/paper/2510.12071"},"observation_digest":"sha256:1679689629e8a1a07e6b7169d3a3a18772786245f9c34e24eabb4d45dbb1b654","observation_id":"a3c1ffa7-47b0-47e2-bc51-6ead0418b24d","resolution":{"observed_at":"2026-08-04T10:05:16.273557Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:05:16.515512Z","title":"Saxe, James L","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2510.12071","last_updated":"2026-06-09T09:56:26Z","snapshot_observed_at":"2026-08-07T13:20:46.043762Z","submitted_at":"2025-10-14T02:21:23Z","title":"Influence Dynamics and Stagewise Data Attribution","version":2},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-04T10:05:16.515512Z"},"links":{"citing_paper":"/paper/2510.12071"},"observation_digest":"sha256:a9e1ec17e62154e5370b01061812872e4daced4ba7d9fd1aa2e958daa55debf7","observation_id":"d04fd8a8-7332-41e0-9c28-c29a15dd96da","resolution":{"observed_at":"2026-08-04T10:05:16.515512Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:05:16.578720Z","title":"LLM Circuit Analyses Are Consistent Across Training and Scale","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.12071","last_updated":"2026-06-09T09:56:26Z","snapshot_observed_at":"2026-08-07T13:20:46.043762Z","submitted_at":"2025-10-14T02:21:23Z","title":"Influence Dynamics and Stagewise Data Attribution","version":2},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-04T10:05:16.578720Z"},"links":{"citing_paper":"/paper/2510.12071"},"observation_digest":"sha256:21f8d53e704a37461b446a99878286f9482aaec6d713d28e87def6a9f16c294c","observation_id":"254b045d-8f17-4a25-a482-4e9e182b572a","resolution":{"observed_at":"2026-08-04T10:05:16.578720Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:05:16.655069Z","title":"Multidimensional scaling: I","venue":null,"work_id":null,"year":1952},"citing_paper":{"arxiv_id":"2510.12071","last_updated":"2026-06-09T09:56:26Z","snapshot_observed_at":"2026-08-07T13:20:46.043762Z","submitted_at":"2025-10-14T02:21:23Z","title":"Influence Dynamics and Stagewise Data Attribution","version":2},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-04T10:05:16.655069Z"},"links":{"citing_paper":"/paper/2510.12071"},"observation_digest":"sha256:302c84ebe4c3f119f844e430b6f1c7f40c84a936e45f341da603a31eb19e609a","observation_id":"66d35cff-bff9-42fe-8f74-2ca7210bdca8","resolution":{"observed_at":"2026-08-04T10:05:16.655069Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.18666","last_updated":"2025-01-30T15:56:25Z","snapshot_observed_at":"2026-08-10T22:25:34.743761Z","submitted_at":"2025-01-30T15:56:25Z","title":"Structure Development in List-Sorting Transformers","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.18666","snapshot_observed_at":"2026-08-04T10:05:16.708158Z","title":"Structure development in list-sorting transformers","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2510.12071","last_updated":"2026-06-09T09:56:26Z","snapshot_observed_at":"2026-08-07T13:20:46.043762Z","submitted_at":"2025-10-14T02:21:23Z","title":"Influence Dynamics and Stagewise Data Attribution","version":2},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-04T10:05:16.708158Z"},"links":{"cited_paper":"/paper/2501.18666","citing_paper":"/paper/2510.12071"},"observation_digest":"sha256:55ba70697b7ec7b5f5bf76c58bcfe929e49793ea1ba846699689e7f8135dd32c","observation_id":"292b8195-3500-4fa9-a850-dfd97c33ab70","resolution":{"observed_at":"2026-08-04T10:05:16.708158Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1805.08522","last_updated":"2019-04-21T10:16:54Z","snapshot_observed_at":"2026-08-10T08:35:15.296599Z","submitted_at":"2018-05-22T11:51:36Z","title":"Deep learning generalizes because the parameter-function map is biased towards simple functions","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1805.08522","snapshot_observed_at":"2026-08-04T10:05:16.807661Z","title":"Deep learning generalizes because the parameter-function map is biased towards simple functions","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2510.12071","last_updated":"2026-06-09T09:56:26Z","snapshot_observed_at":"2026-08-07T13:20:46.043762Z","submitted_at":"2025-10-14T02:21:23Z","title":"Influence Dynamics and Stagewise Data Attribution","version":2},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-04T10:05:16.807661Z"},"links":{"cited_paper":"/paper/1805.08522","citing_paper":"/paper/2510.12071"},"observation_digest":"sha256:026dc70cdd08817e27fac9cdd38f8f451e1ed9afff619791a91e5dcd23c9f8ea","observation_id":"0ad3df73-a5c0-4fda-aacf-286b2f6edd3e","resolution":{"observed_at":"2026-08-04T10:05:16.807661Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:05:16.903105Z","title":"Asymptotic statistics, volume 3","venue":null,"work_id":null,"year":2000},"citing_paper":{"arxiv_id":"2510.12071","last_updated":"2026-06-09T09:56:26Z","snapshot_observed_at":"2026-08-07T13:20:46.043762Z","submitted_at":"2025-10-14T02:21:23Z","title":"Influence Dynamics and Stagewise Data Attribution","version":2},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-04T10:05:16.903105Z"},"links":{"citing_paper":"/paper/2510.12071"},"observation_digest":"sha256:f96d58b29a0ecb3415cc491c779c60c036a4320d4bfa312df01c14df2be00352","observation_id":"43c9fdb7-8275-4232-9c4e-aac368bc32a5","resolution":{"observed_at":"2026-08-04T10:05:16.903105Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.00331","last_updated":"2025-08-01T05:39:41Z","snapshot_observed_at":"2026-08-09T02:15:13.618264Z","submitted_at":"2025-08-01T05:39:41Z","title":"Embryology of a Language Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.00331","snapshot_observed_at":"2026-08-04T10:05:16.996521Z","title":"Embryology of a Language Model , August 2025 a","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2510.12071","last_updated":"2026-06-09T09:56:26Z","snapshot_observed_at":"2026-08-07T13:20:46.043762Z","submitted_at":"2025-10-14T02:21:23Z","title":"Influence Dynamics and Stagewise Data Attribution","version":2},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-04T10:05:16.996521Z"},"links":{"cited_paper":"/paper/2508.00331","citing_paper":"/paper/2510.12071"},"observation_digest":"sha256:8d010f7cac1462d2e1eab7b4770e363c2f33a0b4a144d71d566aa109344db4a7","observation_id":"e56d6dac-e5d5-4a23-9679-a3f7ec5dfa0d","resolution":{"observed_at":"2026-08-04T10:05:16.996521Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:05:17.142183Z","title":"Differentiation and Specialization of Attention Heads via the Refined Local Learning Coefficient","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2510.12071","last_updated":"2026-06-09T09:56:26Z","snapshot_observed_at":"2026-08-07T13:20:46.043762Z","submitted_at":"2025-10-14T02:21:23Z","title":"Influence Dynamics and Stagewise Data Attribution","version":2},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-04T10:05:17.142183Z"},"links":{"citing_paper":"/paper/2510.12071"},"observation_digest":"sha256:9369c240bd43fee51fb5aba77ff43a276fa7a893b29da2d8274e2538e5ce7a2d","observation_id":"842ed135-5c1d-41c5-a1a4-c060a31ca7b1","resolution":{"observed_at":"2026-08-04T10:05:17.142183Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:05:17.336564Z","title":"A survey on curriculum learning","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2510.12071","last_updated":"2026-06-09T09:56:26Z","snapshot_observed_at":"2026-08-07T13:20:46.043762Z","submitted_at":"2025-10-14T02:21:23Z","title":"Influence Dynamics and Stagewise Data Attribution","version":2},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-04T10:05:17.336564Z"},"links":{"citing_paper":"/paper/2510.12071"},"observation_digest":"sha256:10685288512b5bdf34cbea2dd5118f59913679262389893c0103cef40d9a80c2","observation_id":"1564ede7-297a-4353-9e0b-7d7b9b81c344","resolution":{"observed_at":"2026-08-04T10:05:17.336564Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:05:17.452965Z","title":"Algebraic Geometry and Statistical Learning Theory","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2510.12071","last_updated":"2026-06-09T09:56:26Z","snapshot_observed_at":"2026-08-07T13:20:46.043762Z","submitted_at":"2025-10-14T02:21:23Z","title":"Influence Dynamics and Stagewise Data Attribution","version":2},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-04T10:05:17.452965Z"},"links":{"citing_paper":"/paper/2510.12071"},"observation_digest":"sha256:3082e02cb88c454b2f13e4ea02216fb5b4564ef06fc0f7e755193d56270556c7","observation_id":"2ca00e40-f409-4d8c-a8c6-4d487524c6ad","resolution":{"observed_at":"2026-08-04T10:05:17.452965Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:05:17.608547Z","title":"Mathematical theory of Bayesian statistics","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2510.12071","last_updated":"2026-06-09T09:56:26Z","snapshot_observed_at":"2026-08-07T13:20:46.043762Z","submitted_at":"2025-10-14T02:21:23Z","title":"Influence Dynamics and Stagewise Data Attribution","version":2},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-04T10:05:17.608547Z"},"links":{"citing_paper":"/paper/2510.12071"},"observation_digest":"sha256:12194ade36b77c4b4d365f2b5d1dc0fc6afee0eb36f6157ebc69029b83db6993","observation_id":"9f320c01-dc34-46b8-8ff2-2269e2c1a7d3","resolution":{"observed_at":"2026-08-04T10:05:17.608547Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:05:17.710387Z","title":"Bayesian learning via stochastic gradient Langevin dynamics","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2510.12071","last_updated":"2026-06-09T09:56:26Z","snapshot_observed_at":"2026-08-07T13:20:46.043762Z","submitted_at":"2025-10-14T02:21:23Z","title":"Influence Dynamics and Stagewise Data Attribution","version":2},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-04T10:05:17.710387Z"},"links":{"citing_paper":"/paper/2510.12071"},"observation_digest":"sha256:390bac6374cd9438df7f631e7ab274936a29912f46de093aec6fa08ee24d0189","observation_id":"70ff1903-ecf6-4ae6-899d-eaaa8043afa9","resolution":{"observed_at":"2026-08-04T10:05:17.710387Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2012.03107","last_updated":"2021-02-09T17:38:58Z","snapshot_observed_at":"2026-08-08T21:48:44.945116Z","submitted_at":"2020-12-05T19:41:30Z","title":"When Do Curricula Work?","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2012.03107","snapshot_observed_at":"2026-08-04T10:05:17.762204Z","title":"When do curricula work? arXiv preprint arXiv:2012.03107, 2020","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2510.12071","last_updated":"2026-06-09T09:56:26Z","snapshot_observed_at":"2026-08-07T13:20:46.043762Z","submitted_at":"2025-10-14T02:21:23Z","title":"Influence Dynamics and Stagewise Data Attribution","version":2},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-04T10:05:17.762204Z"},"links":{"cited_paper":"/paper/2012.03107","citing_paper":"/paper/2510.12071"},"observation_digest":"sha256:bea9c78c8d676f8515ccd4bea446919152d61037be5eac02a4d8298e6cda008c","observation_id":"d43b2339-172f-481c-ab96-f5937a30eef9","resolution":{"observed_at":"2026-08-04T10:05:17.762204Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:05:17.889397Z","title":"@esa (Ref","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2510.12071","last_updated":"2026-06-09T09:56:26Z","snapshot_observed_at":"2026-08-07T13:20:46.043762Z","submitted_at":"2025-10-14T02:21:23Z","title":"Influence Dynamics and Stagewise Data Attribution","version":2},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-04T10:05:17.889397Z"},"links":{"citing_paper":"/paper/2510.12071"},"observation_digest":"sha256:75f595c5f83d9819c553efcc46863df134f203ec8d38458da63ddfc06313a935","observation_id":"4364f366-8517-4d01-9553-bb2ee5533b39","resolution":{"observed_at":"2026-08-04T10:05:17.889397Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:05:17.973158Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2510.12071","last_updated":"2026-06-09T09:56:26Z","snapshot_observed_at":"2026-08-07T13:20:46.043762Z","submitted_at":"2025-10-14T02:21:23Z","title":"Influence Dynamics and Stagewise Data Attribution","version":2},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-04T10:05:17.973158Z"},"links":{"citing_paper":"/paper/2510.12071"},"observation_digest":"sha256:133669e4f57d91245f6f23054e287223d3ed5c70e22178f7cd249c0626846c56","observation_id":"205ab987-7bb3-4d52-8844-51f900b0299c","resolution":{"observed_at":"2026-08-04T10:05:17.973158Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1806.10707","last_updated":"2018-06-27T22:47:37Z","snapshot_observed_at":"2026-08-09T11:40:17.211204Z","submitted_at":"2018-06-27T22:47:37Z","title":"Gradient Similarity: An Explainable Approach to Detect Adversarial Attacks against Deep Learning","version":1},"cited_work":{"arxiv_id":"1806.10707","doi":"10.48550/arxiv.1806.10707","metadata_source":"pith","pith_arxiv_id":"1806.10707","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"Gradient Similarity: An Explainable Approach to Detect Adversarial Attacks against Deep Learning","venue":"cs.CV","work_id":"85571231-2c0e-4d7f-ae82-2afde73b929d","year":2018},"citing_paper":{"arxiv_id":"2510.12071","last_updated":"2026-06-09T09:56:26Z","snapshot_observed_at":"2026-08-07T13:20:46.043762Z","submitted_at":"2025-10-14T02:21:23Z","title":"Influence Dynamics and Stagewise Data Attribution","version":2},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-08-04T10:05:18.093533Z"},"links":{"cited_paper":"/paper/1806.10707","citing_paper":"/paper/2510.12071"},"observation_digest":"sha256:44115e0e003417fc0ce412fd8c4eff6a00b07d720dbf2707acd0613d610884a8","observation_id":"72e9d8ff-b317-4a94-b89b-14b1e04e6513","resolution":{"observed_at":"2026-08-04T10:08:34.215791Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2510.12071","last_updated":"2026-06-09T09:56:26Z","latest_version":2,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-07T13:20:46.043762Z","submitted_at":"2025-10-14T02:21:23Z","title":"Influence Dynamics and Stagewise Data Attribution"},"reference_resolution":{"displayed":57,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":55,"verified_exact":2,"verified_fuzzy":0},"total_outbound_references":57},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"thesis":"As of 12 August 2026, this Paper Citation Record lists 57 of 57 outbound references and 3 inbound Pith citation observations for arXiv:2510.12071."}