{"as_of":"2026-08-07T18:53:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:ea90028c6b28adcb53a670dd89509eba2acc1e06da955bb30d7d890b54a4ea29","coverage":[{"denominator":79,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":79,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T04:39:09.218815Z","state":"measured"},{"denominator":82,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":82,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":3,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":3,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-02T22:58:13.488639Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-06-29T13:03:26.399621Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.10378","last_updated":"2025-06-12T06:07:42Z","snapshot_observed_at":"2026-08-07T04:25:35.262506Z","submitted_at":"2025-06-12T06:07:42Z","title":"Discovering Hierarchical Latent Capabilities of Language Models via Causal Representation Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.10378","snapshot_observed_at":"2026-08-02T22:58:13.488639Z","title":"Discovering hierarchical latent capabilities of language models via causal representation learning.arXiv preprint arXiv:2506.10378,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.15327","last_updated":"2026-06-06T22:17:18Z","snapshot_observed_at":"2026-08-07T10:44:34.401225Z","submitted_at":"2026-02-17T03:13:51Z","title":"Prescriptive Scaling Reveals the Evolution of Language Model Capabilities","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-02T22:58:13.488639Z"},"links":{"cited_paper":"/paper/2506.10378","citing_paper":"/paper/2602.15327"},"observation_digest":"sha256:e0bf04551f0f979e731df00d03d89b001d20a6903215afebc454f656a66ba1bc","observation_id":"b0f1d4cb-6768-449a-b1fc-34542ff1c298","resolution":{"observed_at":"2026-08-02T22:58:13.488639Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.10378","last_updated":"2025-06-12T06:07:42Z","snapshot_observed_at":"2026-08-07T04:25:35.262506Z","submitted_at":"2025-06-12T06:07:42Z","title":"Discovering Hierarchical Latent Capabilities of Language Models via Causal Representation Learning","version":1},"cited_work":{"arxiv_id":"2506.10378","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.10378","snapshot_observed_at":"2026-06-29T13:03:26.399621Z","title":"Berivan Isik, Natalia Ponomareva, Hussein Hazimeh, Dimitris Paparas, Sergei Vassilvitskii, and Sanmi Koyejo","venue":null,"work_id":"871408b5-ec0d-475e-9b75-5f6174cb48b6","year":2024},"citing_paper":{"arxiv_id":"2605.28179","last_updated":"2026-05-27T09:01:09Z","snapshot_observed_at":"2026-08-05T14:49:49.141441Z","submitted_at":"2026-05-27T09:01:09Z","title":"SuperValid: Capability-Aligned OOD Validation for Generalizable Downstream Scaling","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-06-29T12:57:31.313438Z"},"links":{"cited_paper":"/paper/2506.10378","citing_paper":"/paper/2605.28179"},"observation_digest":"sha256:82e0b16506b417f8eea45ff8935bcebd907381a0edab65846fd6f78ebffc3f73","observation_id":"65d6faf7-e7b7-4b4d-abb7-fedcd5281eae","resolution":{"observed_at":"2026-06-29T13:03:26.401147Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.10378","last_updated":"2025-06-12T06:07:42Z","snapshot_observed_at":"2026-08-07T04:25:35.262506Z","submitted_at":"2025-06-12T06:07:42Z","title":"Discovering Hierarchical Latent Capabilities of Language Models via Causal Representation Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.10378","snapshot_observed_at":"2026-07-14T07:24:27.255815Z","title":"Discovering hierarchical latent capabilities of language models via causal representation learning.arXiv preprint arXiv:2506.10378,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.11052","last_updated":"2026-07-13T03:31:03Z","snapshot_observed_at":"2026-08-06T19:42:23.076030Z","submitted_at":"2026-07-13T03:31:03Z","title":"Domain-Aware Scaling Laws Uncover Data Synergy","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-07-14T07:24:27.255815Z"},"links":{"cited_paper":"/paper/2506.10378","citing_paper":"/paper/2607.11052"},"observation_digest":"sha256:dc00052ac83c8f94e916497d8c73ba582a76220adb1605398d0bf2b4e6539105","observation_id":"b300a453-5410-4831-a99e-864932b4d533","resolution":{"observed_at":"2026-07-14T07:24:27.255815Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2506.10378/citation-record","integrity":"/paper/2506.10378/integrity","json":"/paper/2506.10378/citation-record.json","paper":"/paper/2506.10378"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-07T04:38:59.287822Z","title":"Gpt-4 technical report","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.10378","last_updated":"2025-06-12T06:07:42Z","snapshot_observed_at":"2026-08-07T04:25:35.262506Z","submitted_at":"2025-06-12T06:07:42Z","title":"Discovering Hierarchical Latent Capabilities of Language Models via Causal Representation Learning","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-07T04:38:59.287822Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2506.10378"},"observation_digest":"sha256:f6f8945c03ec67e0fc7292a6659d9035275eddef7e103b118a83a7f5c9f53594","observation_id":"5b5eb337-be98-45fc-8e67-20706459c945","resolution":{"observed_at":"2026-08-07T04:38:59.287822Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.14219","last_updated":"2024-08-30T21:17:17Z","snapshot_observed_at":"2026-07-06T18:03:47.096406Z","submitted_at":"2024-04-22T14:32:33Z","title":"Phi-3 Technical Report: A Highly Capable Language Model Locally on Your Phone","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.14219","snapshot_observed_at":"2026-08-07T04:38:59.369977Z","title":"Phi-3 technical report: A highly capable language model locally on your phone","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.10378","last_updated":"2025-06-12T06:07:42Z","snapshot_observed_at":"2026-08-07T04:25:35.262506Z","submitted_at":"2025-06-12T06:07:42Z","title":"Discovering Hierarchical Latent Capabilities of Language Models via Causal Representation Learning","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-07T04:38:59.369977Z"},"links":{"cited_paper":"/paper/2404.14219","citing_paper":"/paper/2506.10378"},"observation_digest":"sha256:a1ff3e777d3c4b731a245b45e9ed208e5be29a901aa0c81e79178255ae588ec6","observation_id":"2f156c47-68dc-435c-bd82-16a2dde1290e","resolution":{"observed_at":"2026-08-07T04:38:59.369977Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:39:21.715684Z","title":"An integrated theory of the mind","venue":null,"work_id":"d0ffac85-c169-4267-917a-b3129b393a53","year":2004},"citing_paper":{"arxiv_id":"2506.10378","last_updated":"2025-06-12T06:07:42Z","snapshot_observed_at":"2026-08-07T04:25:35.262506Z","submitted_at":"2025-06-12T06:07:42Z","title":"Discovering Hierarchical Latent Capabilities of Language Models via Causal Representation Learning","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-07T04:38:59.507531Z"},"links":{"citing_paper":"/paper/2506.10378"},"observation_digest":"sha256:54db2a00f6e3f8e9a18bcb2d7a9bd5ff7416754276d65e576952547ea5387b30","observation_id":"bc2b8b17-0cce-49d4-94c1-d35c8a2e4659","resolution":{"observed_at":"2026-08-07T04:39:21.826616Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1907.02893","last_updated":"2020-03-27T19:07:58Z","snapshot_observed_at":"2026-07-06T08:05:24.076802Z","submitted_at":"2019-07-05T15:26:26Z","title":"Invariant Risk Minimization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1907.02893","snapshot_observed_at":"2026-08-07T04:38:59.603495Z","title":"Invariant risk minimization","venue":null,"work_id":null,"year":1907},"citing_paper":{"arxiv_id":"2506.10378","last_updated":"2025-06-12T06:07:42Z","snapshot_observed_at":"2026-08-07T04:25:35.262506Z","submitted_at":"2025-06-12T06:07:42Z","title":"Discovering Hierarchical Latent Capabilities of Language Models via Causal Representation Learning","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-07T04:38:59.603495Z"},"links":{"cited_paper":"/paper/1907.02893","citing_paper":"/paper/2506.10378"},"observation_digest":"sha256:d6b17add70a0cb6eade3b8a47775d55064c6e35aafe5f64573ff698279738577","observation_id":"65b8ab84-64af-4b6d-8b25-5c2d766e2cc4","resolution":{"observed_at":"2026-08-07T04:38:59.603495Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.15936","last_updated":"2023-11-06T00:36:24Z","snapshot_observed_at":"2026-07-06T16:00:08.643627Z","submitted_at":"2023-07-29T09:22:54Z","title":"A Theory for Emergence of Complex Skills in Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.15936","snapshot_observed_at":"2026-08-07T04:38:59.692682Z","title":"A theory for emergence of complex skills in language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.10378","last_updated":"2025-06-12T06:07:42Z","snapshot_observed_at":"2026-08-07T04:25:35.262506Z","submitted_at":"2025-06-12T06:07:42Z","title":"Discovering Hierarchical Latent Capabilities of Language Models via Causal Representation Learning","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-07T04:38:59.692682Z"},"links":{"cited_paper":"/paper/2307.15936","citing_paper":"/paper/2506.10378"},"observation_digest":"sha256:edd4aeb20244282a856738f6c91f7b62e8bf26ebce1676dcde869bbbd5b854c2","observation_id":"323f5800-c654-42bf-bf47-a1cd174d365e","resolution":{"observed_at":"2026-08-07T04:38:59.692682Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:39:21.475422Z","title":"Act: A simple theory of complex cognition","venue":null,"work_id":"b7ca05df-4341-422d-b075-4c38f126cb8e","year":1996},"citing_paper":{"arxiv_id":"2506.10378","last_updated":"2025-06-12T06:07:42Z","snapshot_observed_at":"2026-08-07T04:25:35.262506Z","submitted_at":"2025-06-12T06:07:42Z","title":"Discovering Hierarchical Latent Capabilities of Language Models via Causal Representation Learning","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-07T04:38:59.865157Z"},"links":{"citing_paper":"/paper/2506.10378"},"observation_digest":"sha256:4759998cbdc8242bb3f3368a57182dd74c7c1bd81c27697153a77485573e96c2","observation_id":"dd022874-2223-4474-b16b-b755d05ea680","resolution":{"observed_at":"2026-08-07T04:39:21.603880Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:39:00.029614Z","title":"Claude 3.5 sonnet","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.10378","last_updated":"2025-06-12T06:07:42Z","snapshot_observed_at":"2026-08-07T04:25:35.262506Z","submitted_at":"2025-06-12T06:07:42Z","title":"Discovering Hierarchical Latent Capabilities of Language Models via Causal Representation Learning","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-07T04:39:00.029614Z"},"links":{"citing_paper":"/paper/2506.10378"},"observation_digest":"sha256:36f1ab47fc25c2c6e284705fd21e9e65be506506fb7d69cd99370b03b1ee9abf","observation_id":"ca7e7632-217f-4820-802b-4c8cee2d224f","resolution":{"observed_at":"2026-08-07T04:39:00.029614Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:39:21.226977Z","title":"Invariant risk minimization games","venue":null,"work_id":"cb25847e-5346-48da-960a-94d1079f33b3","year":2021},"citing_paper":{"arxiv_id":"2506.10378","last_updated":"2025-06-12T06:07:42Z","snapshot_observed_at":"2026-08-07T04:25:35.262506Z","submitted_at":"2025-06-12T06:07:42Z","title":"Discovering Hierarchical Latent Capabilities of Language Models via Causal Representation Learning","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-07T04:39:00.175600Z"},"links":{"citing_paper":"/paper/2506.10378"},"observation_digest":"sha256:7ed6b03361ddc6e2c83c2a8c7462a034e5f30f9a559ebab8a491c6002cc578dc","observation_id":"97128679-f3c6-4143-a62b-96ebb4500eac","resolution":{"observed_at":"2026-08-07T04:39:21.362767Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:39:20.938322Z","title":"Sample complexity of interventional causal representation learning","venue":null,"work_id":"31f88a11-3048-485c-b30e-7da68f049985","year":2024},"citing_paper":{"arxiv_id":"2506.10378","last_updated":"2025-06-12T06:07:42Z","snapshot_observed_at":"2026-08-07T04:25:35.262506Z","submitted_at":"2025-06-12T06:07:42Z","title":"Discovering Hierarchical Latent Capabilities of Language Models via Causal Representation Learning","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-07T04:39:00.301780Z"},"links":{"citing_paper":"/paper/2506.10378"},"observation_digest":"sha256:a0d35c5234fe0411d9e74f6d9f509533227c43982fe1cf428b720b7834f9c166","observation_id":"2fd55be9-42e3-4bcf-b189-a167d0608724","resolution":{"observed_at":"2026-08-07T04:39:21.076782Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.16947","last_updated":"2024-08-30T00:06:29Z","snapshot_observed_at":"2026-07-06T19:07:59.449781Z","submitted_at":"2024-08-30T00:06:29Z","title":"An Empirical Study of Scaling Laws for Transfer","version":1},"cited_work":{"arxiv_id":"2408.16947","doi":null,"metadata_source":"pith","pith_arxiv_id":"2408.16947","snapshot_observed_at":"2026-08-07T04:39:10.227640Z","title":"An Empirical Study of Scaling Laws for Transfer","venue":"cs.LG","work_id":"be4c2bfe-f52d-48ba-9f8c-0d3953f9b3a2","year":2024},"citing_paper":{"arxiv_id":"2506.10378","last_updated":"2025-06-12T06:07:42Z","snapshot_observed_at":"2026-08-07T04:25:35.262506Z","submitted_at":"2025-06-12T06:07:42Z","title":"Discovering Hierarchical Latent Capabilities of Language Models via Causal Representation Learning","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-07T04:39:00.420894Z"},"links":{"cited_paper":"/paper/2408.16947","citing_paper":"/paper/2506.10378"},"observation_digest":"sha256:332620922c0601b7f1dcca6ae428f55a1beecdef11a66da3baaebbaec71219c0","observation_id":"fd4b8802-aceb-47e8-92be-dcf3980c068b","resolution":{"observed_at":"2026-08-07T04:39:10.333127Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:39:20.677347Z","title":"Sparks of artificial general intelligence: Early experiments with gpt-4, 2023","venue":null,"work_id":"302ce115-c36e-4e2d-9084-228a934c22d1","year":2023},"citing_paper":{"arxiv_id":"2506.10378","last_updated":"2025-06-12T06:07:42Z","snapshot_observed_at":"2026-08-07T04:25:35.262506Z","submitted_at":"2025-06-12T06:07:42Z","title":"Discovering Hierarchical Latent Capabilities of Language Models via Causal Representation Learning","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-07T04:39:00.595168Z"},"links":{"citing_paper":"/paper/2506.10378"},"observation_digest":"sha256:9aab54692765ef4fa0c1522d26676566392444594b6d740d168a9c07e4402640","observation_id":"40d4409f-9bed-4740-8485-c6a929d68c88","resolution":{"observed_at":"2026-08-07T04:39:20.780177Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:39:20.436611Z","title":"Functional magnetic resonance imaging evidence for a hierarchical organization of the prefrontal cortex","venue":null,"work_id":"dcb65cd1-7957-4efc-8647-fbdba8298862","year":2007},"citing_paper":{"arxiv_id":"2506.10378","last_updated":"2025-06-12T06:07:42Z","snapshot_observed_at":"2026-08-07T04:25:35.262506Z","submitted_at":"2025-06-12T06:07:42Z","title":"Discovering Hierarchical Latent Capabilities of Language Models via Causal Representation Learning","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-07T04:39:00.740456Z"},"links":{"citing_paper":"/paper/2506.10378"},"observation_digest":"sha256:377cba0986ef3a98e208721e55510b9f0cd9d3afc7b7a29669bc069dfaeb129c","observation_id":"c3209fdd-7f3b-4df6-92c4-d79458060d6e","resolution":{"observed_at":"2026-08-07T04:39:20.563436Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:39:20.097925Z","title":null,"venue":null,"work_id":"efc6b3e4-bdca-412f-93c0-3b641b1be97e","year":2022},"citing_paper":{"arxiv_id":"2506.10378","last_updated":"2025-06-12T06:07:42Z","snapshot_observed_at":"2026-08-07T04:25:35.262506Z","submitted_at":"2025-06-12T06:07:42Z","title":"Discovering Hierarchical Latent Capabilities of Language Models via Causal Representation Learning","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-07T04:39:00.833696Z"},"links":{"citing_paper":"/paper/2506.10378"},"observation_digest":"sha256:ec0d7699722acd7304076b2c852c70c6847f94089f7a540a5a9c10527b6c4600","observation_id":"28e5998b-8552-4b06-98a8-47f9b8422bde","resolution":{"observed_at":"2026-08-07T04:39:20.264283Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2204.05862","last_updated":"2022-04-12T15:02:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-04-12T15:02:38Z","title":"Training a Helpful and Harmless Assistant with Reinforcement Learning from Human Feedback","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.05862","snapshot_observed_at":"2026-08-07T04:39:00.939328Z","title":"Training a helpful and harmless assistant with reinforcement learning from human feedback","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.10378","last_updated":"2025-06-12T06:07:42Z","snapshot_observed_at":"2026-08-07T04:25:35.262506Z","submitted_at":"2025-06-12T06:07:42Z","title":"Discovering Hierarchical Latent Capabilities of Language Models via Causal Representation Learning","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-07T04:39:00.939328Z"},"links":{"cited_paper":"/paper/2204.05862","citing_paper":"/paper/2506.10378"},"observation_digest":"sha256:6c29296f8d0ccb148c8379c8d450aab4b022c91dce226a874b644b073ce96e78","observation_id":"de90e3fb-28f1-4a21-98d1-5b775466815d","resolution":{"observed_at":"2026-08-07T04:39:00.939328Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:39:01.031708Z","title":"Language models are few-shot learners","venue":null,"work_id":null,"year":1901},"citing_paper":{"arxiv_id":"2506.10378","last_updated":"2025-06-12T06:07:42Z","snapshot_observed_at":"2026-08-07T04:25:35.262506Z","submitted_at":"2025-06-12T06:07:42Z","title":"Discovering Hierarchical Latent Capabilities of Language Models via Causal Representation Learning","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-07T04:39:01.031708Z"},"links":{"citing_paper":"/paper/2506.10378"},"observation_digest":"sha256:8ddc2e4129990628fdae9d3f16b893f89b2307bb6918a235488e11dced29734f","observation_id":"d1bc4a66-c46d-4d88-9e53-8b750f4aa34b","resolution":{"observed_at":"2026-08-07T04:39:01.031708Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:39:19.826871Z","title":"Doubly robust estimation in missing data and causal inference models","venue":null,"work_id":"aa1d9fac-8f7d-4d52-822f-cae7be88f628","year":2005},"citing_paper":{"arxiv_id":"2506.10378","last_updated":"2025-06-12T06:07:42Z","snapshot_observed_at":"2026-08-07T04:25:35.262506Z","submitted_at":"2025-06-12T06:07:42Z","title":"Discovering Hierarchical Latent Capabilities of Language Models via Causal Representation Learning","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-07T04:39:01.151962Z"},"links":{"citing_paper":"/paper/2506.10378"},"observation_digest":"sha256:8c11f25beabb0247af1b9b56e4f9a3fbd86f2752eae8f7af71ed44d57bb55f99","observation_id":"7649992c-1cff-4468-8717-a0b1067f98db","resolution":{"observed_at":"2026-08-07T04:39:19.971550Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:39:19.581922Z","title":"Learning linear causal representations from interventions under general nonlinear mixing","venue":null,"work_id":"e0faefc7-e531-404f-9311-7c55794813a6","year":2023},"citing_paper":{"arxiv_id":"2506.10378","last_updated":"2025-06-12T06:07:42Z","snapshot_observed_at":"2026-08-07T04:25:35.262506Z","submitted_at":"2025-06-12T06:07:42Z","title":"Discovering Hierarchical Latent Capabilities of Language Models via Causal Representation Learning","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-07T04:39:01.286884Z"},"links":{"citing_paper":"/paper/2506.10378"},"observation_digest":"sha256:d8f3479af7ca70cf7de228934e83c3c9d9d61e18837fb0c0a15a715a37bccfc9","observation_id":"857afd46-23ef-43f6-9372-24649b25d46b","resolution":{"observed_at":"2026-08-07T04:39:19.707898Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:39:19.281501Z","title":"Rethink reporting of evaluation results in ai","venue":null,"work_id":"44bd04cf-b458-4806-87df-3489c958f8cc","year":2023},"citing_paper":{"arxiv_id":"2506.10378","last_updated":"2025-06-12T06:07:42Z","snapshot_observed_at":"2026-08-07T04:25:35.262506Z","submitted_at":"2025-06-12T06:07:42Z","title":"Discovering Hierarchical Latent Capabilities of Language Models via Causal Representation Learning","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-07T04:39:01.423173Z"},"links":{"citing_paper":"/paper/2506.10378"},"observation_digest":"sha256:e3ff9798378e5041ebba06ca1aedff547038e346f1541e6cb29797d3eadda0cf","observation_id":"3bb65a48-2ff1-4618-8223-bc7b379979e2","resolution":{"observed_at":"2026-08-07T04:39:19.444566Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:39:19.089873Z","title":"Human cognitive abilities: A survey of factor-analytic studies","venue":null,"work_id":"24af8544-53cc-4207-94d9-8ed4528cd0a3","year":1993},"citing_paper":{"arxiv_id":"2506.10378","last_updated":"2025-06-12T06:07:42Z","snapshot_observed_at":"2026-08-07T04:25:35.262506Z","submitted_at":"2025-06-12T06:07:42Z","title":"Discovering Hierarchical Latent Capabilities of Language Models via Causal Representation Learning","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-07T04:39:01.519923Z"},"links":{"citing_paper":"/paper/2506.10378"},"observation_digest":"sha256:f156e2cfe57963339c68f83935aa19ebaf75fcb0d0348dbe8a0ce0c476de58b3","observation_id":"84b957a0-8a8e-41cb-bb57-2f13895a89bc","resolution":{"observed_at":"2026-08-07T04:39:19.178680Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:39:18.872636Z","title":"Structured matrix completion with applications to genomic data integration","venue":null,"work_id":"0fbb9410-5038-49b6-b1cc-580c7fbbd967","year":2016},"citing_paper":{"arxiv_id":"2506.10378","last_updated":"2025-06-12T06:07:42Z","snapshot_observed_at":"2026-08-07T04:25:35.262506Z","submitted_at":"2025-06-12T06:07:42Z","title":"Discovering Hierarchical Latent Capabilities of Language Models via Causal Representation Learning","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-07T04:39:01.666052Z"},"links":{"citing_paper":"/paper/2506.10378"},"observation_digest":"sha256:0ce5751985717ddde4555143d6d6fc3eeaf485b886a1869929f49c82cbe45984","observation_id":"bf2150c2-40a9-474f-b6d2-6d27f54b0205","resolution":{"observed_at":"2026-08-07T04:39:19.014912Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:39:18.684252Z","title":"Scaling instruction-finetuned language models","venue":null,"work_id":"e6d3d9ab-5b94-41ea-a246-e2b06c97fe27","year":2024},"citing_paper":{"arxiv_id":"2506.10378","last_updated":"2025-06-12T06:07:42Z","snapshot_observed_at":"2026-08-07T04:25:35.262506Z","submitted_at":"2025-06-12T06:07:42Z","title":"Discovering Hierarchical Latent Capabilities of Language Models via Causal Representation Learning","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-07T04:39:01.791402Z"},"links":{"citing_paper":"/paper/2506.10378"},"observation_digest":"sha256:a39301ce09ebdc799ca1a9df6fce47bf8d18fc8af683e3ad3623cedd74eeabc6","observation_id":"6620d5e0-d391-495b-981b-11bed8aa9c9d","resolution":{"observed_at":"2026-08-07T04:39:18.768882Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.00304","last_updated":"2024-07-16T20:09:47Z","snapshot_observed_at":"2026-07-06T16:01:03.635085Z","submitted_at":"2023-08-01T05:54:12Z","title":"Skills-in-Context Prompting: Unlocking Compositionality in Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.00304","snapshot_observed_at":"2026-08-07T04:39:01.927070Z","title":"Skills-in-context prompting: Unlocking compositionality in large language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.10378","last_updated":"2025-06-12T06:07:42Z","snapshot_observed_at":"2026-08-07T04:25:35.262506Z","submitted_at":"2025-06-12T06:07:42Z","title":"Discovering Hierarchical Latent Capabilities of Language Models via Causal Representation Learning","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-07T04:39:01.927070Z"},"links":{"cited_paper":"/paper/2308.00304","citing_paper":"/paper/2506.10378"},"observation_digest":"sha256:7fb86e0900fea09d5e1ae70d600ccee293cc21bcae166c1988645e7a47bb1ebc","observation_id":"d8a950a4-6679-4d8a-92ba-1c55ccafa577","resolution":{"observed_at":"2026-08-07T04:39:01.927070Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:39:02.067496Z","title":"The rising costs of training frontier ai models, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.10378","last_updated":"2025-06-12T06:07:42Z","snapshot_observed_at":"2026-08-07T04:25:35.262506Z","submitted_at":"2025-06-12T06:07:42Z","title":"Discovering Hierarchical Latent Capabilities of Language Models via Causal Representation Learning","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-07T04:39:02.067496Z"},"links":{"citing_paper":"/paper/2506.10378"},"observation_digest":"sha256:d02deffe0bc8decd5e33a96e6df9bf12ebc85b0880fb118996432894a2c43e93","observation_id":"1dfe70fd-f5c0-4fc1-aaf1-7425c99c5ad9","resolution":{"observed_at":"2026-08-07T04:39:02.067496Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.20807","last_updated":"2025-03-24T20:41:57Z","snapshot_observed_at":"2026-08-07T16:40:01.450194Z","submitted_at":"2025-03-24T20:41:57Z","title":"Fundamental Safety-Capability Trade-offs in Fine-tuning Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.20807","snapshot_observed_at":"2026-08-07T04:39:02.165360Z","title":"Fundamental safety-capability trade-offs in fine-tuning large language models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.10378","last_updated":"2025-06-12T06:07:42Z","snapshot_observed_at":"2026-08-07T04:25:35.262506Z","submitted_at":"2025-06-12T06:07:42Z","title":"Discovering Hierarchical Latent Capabilities of Language Models via Causal Representation Learning","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-07T04:39:02.165360Z"},"links":{"cited_paper":"/paper/2503.20807","citing_paper":"/paper/2506.10378"},"observation_digest":"sha256:7117ec051a5a1022e003fea46ddbfd849906d178278e62825a773c0279db1eeb","observation_id":"39da5403-40f6-4d78-85f8-53acdaf25241","resolution":{"observed_at":"2026-08-07T04:39:02.165360Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:39:18.429443Z","title":"Dorner, and Moritz Hardt","venue":null,"work_id":"d8c0bb4f-7a38-44cd-af79-07b932b2b060","year":2025},"citing_paper":{"arxiv_id":"2506.10378","last_updated":"2025-06-12T06:07:42Z","snapshot_observed_at":"2026-08-07T04:25:35.262506Z","submitted_at":"2025-06-12T06:07:42Z","title":"Discovering Hierarchical Latent Capabilities of Language Models via Causal Representation Learning","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-07T04:39:02.265998Z"},"links":{"citing_paper":"/paper/2506.10378"},"observation_digest":"sha256:6d6218dd64d67c1e5b86fd7ec6478428e2cffe0b25f7f17e2baaf7b55caf4065","observation_id":"7e9df1be-6852-46da-ad51-2f837412750e","resolution":{"observed_at":"2026-08-07T04:39:18.578874Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:39:18.196634Z","title":"Identifiability, separability, and uniqueness of linear ica models","venue":null,"work_id":"0b5ef25b-3e2f-4dc0-bed8-ffe39988d92e","year":2004},"citing_paper":{"arxiv_id":"2506.10378","last_updated":"2025-06-12T06:07:42Z","snapshot_observed_at":"2026-08-07T04:25:35.262506Z","submitted_at":"2025-06-12T06:07:42Z","title":"Discovering Hierarchical Latent Capabilities of Language Models via Causal Representation Learning","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-07T04:39:02.359901Z"},"links":{"citing_paper":"/paper/2506.10378"},"observation_digest":"sha256:25126101f5e62e97a53ad63716bc932d02f61db7b6a62a229df6c5bef26a4519","observation_id":"807a6921-792e-43e7-875f-c09fd906eb46","resolution":{"observed_at":"2026-08-07T04:39:18.327581Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:39:17.929556Z","title":"Principal stratification in causal inference","venue":null,"work_id":"e88cbbd4-38af-4f87-a861-bf861b2b27f6","year":2002},"citing_paper":{"arxiv_id":"2506.10378","last_updated":"2025-06-12T06:07:42Z","snapshot_observed_at":"2026-08-07T04:25:35.262506Z","submitted_at":"2025-06-12T06:07:42Z","title":"Discovering Hierarchical Latent Capabilities of Language Models via Causal Representation Learning","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-07T04:39:02.506121Z"},"links":{"citing_paper":"/paper/2506.10378"},"observation_digest":"sha256:c71506bdff6c2b4b67507882c0a0b130a72549f2a683d1591d6fa0f7577b37e0","observation_id":"2c12e803-a29a-4dde-af3c-70755a429496","resolution":{"observed_at":"2026-08-07T04:39:18.071636Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.01307","last_updated":"2025-08-15T15:21:46Z","snapshot_observed_at":"2026-07-06T20:45:32.493589Z","submitted_at":"2025-03-03T08:46:22Z","title":"Cognitive Behaviors that Enable Self-Improving Reasoners, or, Four Habits of Highly Effective STaRs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.01307","snapshot_observed_at":"2026-08-07T04:39:02.608864Z","title":"Cognitive behaviors that enable self-improving reasoners, or, four habits of highly effective stars","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.10378","last_updated":"2025-06-12T06:07:42Z","snapshot_observed_at":"2026-08-07T04:25:35.262506Z","submitted_at":"2025-06-12T06:07:42Z","title":"Discovering Hierarchical Latent Capabilities of Language Models via Causal Representation Learning","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-07T04:39:02.608864Z"},"links":{"cited_paper":"/paper/2503.01307","citing_paper":"/paper/2506.10378"},"observation_digest":"sha256:60596d68d8c5082c637e3876d766e8eb97ae56f28e35d09061a6cc8f7fb70b54","observation_id":"c20bbc66-5403-4642-90ff-540b56ac89df","resolution":{"observed_at":"2026-08-07T04:39:02.608864Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-07T04:39:02.765458Z","title":"The llama 3 herd of models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.10378","last_updated":"2025-06-12T06:07:42Z","snapshot_observed_at":"2026-08-07T04:25:35.262506Z","submitted_at":"2025-06-12T06:07:42Z","title":"Discovering Hierarchical Latent Capabilities of Language Models via Causal Representation Learning","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-07T04:39:02.765458Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2506.10378"},"observation_digest":"sha256:3edaa73360ab964ee9dc26c5876e7e6958d99e3b88b9dc4b3167e403b815bc6f","observation_id":"849a6744-74d9-45f2-998d-3f792d00d034","resolution":{"observed_at":"2026-08-07T04:39:02.765458Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.05119","last_updated":"2024-07-14T18:14:57Z","snapshot_observed_at":"2026-08-02T00:59:17.509022Z","submitted_at":"2024-02-03T04:45:25Z","title":"A Closer Look at the Limitations of Instruction Tuning","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.05119","snapshot_observed_at":"2026-08-07T04:39:02.897278Z","title":"A closer look at the limitations of instruction tuning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.10378","last_updated":"2025-06-12T06:07:42Z","snapshot_observed_at":"2026-08-07T04:25:35.262506Z","submitted_at":"2025-06-12T06:07:42Z","title":"Discovering Hierarchical Latent Capabilities of Language Models via Causal Representation Learning","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-07T04:39:02.897278Z"},"links":{"cited_paper":"/paper/2402.05119","citing_paper":"/paper/2506.10378"},"observation_digest":"sha256:1c928f6d101b604ec88e164d71e94b8de0a57183447e1a3b537c598dec1d69df","observation_id":"7d32ca32-d261-4266-856b-6b8ccba45fc0","resolution":{"observed_at":"2026-08-07T04:39:02.897278Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.08493","last_updated":"2024-02-21T22:02:26Z","snapshot_observed_at":"2026-08-06T07:48:14.479004Z","submitted_at":"2023-08-16T16:48:57Z","title":"Time Travel in LLMs: Tracing Data Contamination in Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.08493","snapshot_observed_at":"2026-08-07T04:39:03.018166Z","title":"Time travel in llms: Tracing data contamination in large language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.10378","last_updated":"2025-06-12T06:07:42Z","snapshot_observed_at":"2026-08-07T04:25:35.262506Z","submitted_at":"2025-06-12T06:07:42Z","title":"Discovering Hierarchical Latent Capabilities of Language Models via Causal Representation Learning","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-07T04:39:03.018166Z"},"links":{"cited_paper":"/paper/2308.08493","citing_paper":"/paper/2506.10378"},"observation_digest":"sha256:ff16ca0f101663feb16bafac601447cd9ecb67f37b753bb604fe610b1cc051cb","observation_id":"82985dc9-bd92-446b-8882-303e50b9e7c8","resolution":{"observed_at":"2026-08-07T04:39:03.018166Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.15717","last_updated":"2023-05-25T05:00:12Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-05-25T05:00:12Z","title":"The False Promise of Imitating Proprietary LLMs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.15717","snapshot_observed_at":"2026-08-07T04:39:03.121696Z","title":"The false promise of imitating proprietary llms","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.10378","last_updated":"2025-06-12T06:07:42Z","snapshot_observed_at":"2026-08-07T04:25:35.262506Z","submitted_at":"2025-06-12T06:07:42Z","title":"Discovering Hierarchical Latent Capabilities of Language Models via Causal Representation Learning","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-07T04:39:03.121696Z"},"links":{"cited_paper":"/paper/2305.15717","citing_paper":"/paper/2506.10378"},"observation_digest":"sha256:e59a5f8546e30e6131d013f955b87d6ae1fc1ee488658e9e066f308f5ed1441d","observation_id":"33ff0e5e-6777-48b0-b73c-b62777dc885f","resolution":{"observed_at":"2026-08-07T04:39:03.121696Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-07T04:39:03.260732Z","title":"Deepseek-r1: Incentivizing reasoning capability in llms via reinforcement learning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.10378","last_updated":"2025-06-12T06:07:42Z","snapshot_observed_at":"2026-08-07T04:25:35.262506Z","submitted_at":"2025-06-12T06:07:42Z","title":"Discovering Hierarchical Latent Capabilities of Language Models via Causal Representation Learning","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-07T04:39:03.260732Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2506.10378"},"observation_digest":"sha256:3edb24c9dfabc35efe0b26907b25de0571a648d767f8cd2616728fad9497178a","observation_id":"9e9bbc31-52ce-4479-b1f1-b5fc9942309e","resolution":{"observed_at":"2026-08-07T04:39:03.260732Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2009.03300","last_updated":"2021-01-12T18:57:11Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-09-07T17:59:25Z","title":"Measuring Massive Multitask Language Understanding","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.03300","snapshot_observed_at":"2026-08-07T04:39:03.396804Z","title":"Measuring massive multitask language understanding","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2506.10378","last_updated":"2025-06-12T06:07:42Z","snapshot_observed_at":"2026-08-07T04:25:35.262506Z","submitted_at":"2025-06-12T06:07:42Z","title":"Discovering Hierarchical Latent Capabilities of Language Models via Causal Representation Learning","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-07T04:39:03.396804Z"},"links":{"cited_paper":"/paper/2009.03300","citing_paper":"/paper/2506.10378"},"observation_digest":"sha256:f885071f89d2520eb4f904a9462669727a87c19f70f19c413c2a9777de4cf739","observation_id":"93854879-eefc-408e-8f1c-b23c9976534a","resolution":{"observed_at":"2026-08-07T04:39:03.396804Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.15556","last_updated":"2022-03-29T13:38:03Z","snapshot_observed_at":"2026-07-06T12:54:11.616335Z","submitted_at":"2022-03-29T13:38:03Z","title":"Training Compute-Optimal Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.15556","snapshot_observed_at":"2026-08-07T04:39:03.523942Z","title":"Training compute-optimal large language models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.10378","last_updated":"2025-06-12T06:07:42Z","snapshot_observed_at":"2026-08-07T04:25:35.262506Z","submitted_at":"2025-06-12T06:07:42Z","title":"Discovering Hierarchical Latent Capabilities of Language Models via Causal Representation Learning","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-07T04:39:03.523942Z"},"links":{"cited_paper":"/paper/2203.15556","citing_paper":"/paper/2506.10378"},"observation_digest":"sha256:1db8e85ab9711a63adb4d6d73501d29af851e03607f1e630f51263b4aada43fb","observation_id":"5a909a64-fc2e-4849-a803-da729610dba1","resolution":{"observed_at":"2026-08-07T04:39:03.523942Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:39:03.687198Z","title":"A sober look at progress in language model reasoning: Pitfalls and paths to reproducibility","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.10378","last_updated":"2025-06-12T06:07:42Z","snapshot_observed_at":"2026-08-07T04:25:35.262506Z","submitted_at":"2025-06-12T06:07:42Z","title":"Discovering Hierarchical Latent Capabilities of Language Models via Causal Representation Learning","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-07T04:39:03.687198Z"},"links":{"citing_paper":"/paper/2506.10378"},"observation_digest":"sha256:40fe23d3a66d202c15c51d073ede3502868a4646bc34097c8733e9aa71b14b9f","observation_id":"72fe85d4-2dc7-4e8a-ab90-6ec234298961","resolution":{"observed_at":"2026-08-07T04:39:03.687198Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.06000","last_updated":"2024-12-08T17:19:48Z","snapshot_observed_at":"2026-07-06T20:03:29.510169Z","submitted_at":"2024-12-08T17:19:48Z","title":"Does RLHF Scale? Exploring the Impacts From Data, Model, and Method","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.06000","snapshot_observed_at":"2026-08-07T04:39:03.757222Z","title":"Does rlhf scale? exploring the impacts from data, model, and method","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.10378","last_updated":"2025-06-12T06:07:42Z","snapshot_observed_at":"2026-08-07T04:25:35.262506Z","submitted_at":"2025-06-12T06:07:42Z","title":"Discovering Hierarchical Latent Capabilities of Language Models via Causal Representation Learning","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-07T04:39:03.757222Z"},"links":{"cited_paper":"/paper/2412.06000","citing_paper":"/paper/2506.10378"},"observation_digest":"sha256:b47e593bbc6e0c72b4d9dbc2e0a90e7c32bd7e4830da844a7f9536a3fc3b7cef","observation_id":"886fbafc-d79a-45da-80cf-f7b5384439e1","resolution":{"observed_at":"2026-08-07T04:39:03.757222Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:39:17.659823Z","title":"a rinen, Jarmo Hurri, Patrik O Hoyer, Aapo Hyv \\","venue":null,"work_id":"8c87613b-54b3-4223-9ab6-6952eda8d90a","year":2009},"citing_paper":{"arxiv_id":"2506.10378","last_updated":"2025-06-12T06:07:42Z","snapshot_observed_at":"2026-08-07T04:25:35.262506Z","submitted_at":"2025-06-12T06:07:42Z","title":"Discovering Hierarchical Latent Capabilities of Language Models via Causal Representation Learning","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-07T04:39:03.893871Z"},"links":{"citing_paper":"/paper/2506.10378"},"observation_digest":"sha256:2d0445a2042e4bf40cc32e78f2ade2dd1011134903b02a8cac0f9eaa31dbd677","observation_id":"cba8e590-0fb3-4069-bd68-0bbe6e8f6aa6","resolution":{"observed_at":"2026-08-07T04:39:17.772086Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:39:17.446635Z","title":"Causal discovery from heterogeneous/nonstationary data","venue":null,"work_id":"8c0aac6e-3a24-48b3-8ed8-974a310cc095","year":2020},"citing_paper":{"arxiv_id":"2506.10378","last_updated":"2025-06-12T06:07:42Z","snapshot_observed_at":"2026-08-07T04:25:35.262506Z","submitted_at":"2025-06-12T06:07:42Z","title":"Discovering Hierarchical Latent Capabilities of Language Models via Causal Representation Learning","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-07T04:39:03.984543Z"},"links":{"citing_paper":"/paper/2506.10378"},"observation_digest":"sha256:1b87e46bf05b5fe2153568345701b92be262931428b17e2675fa75edf3189a79","observation_id":"13fb752e-d767-4945-a0d1-4a2f5b3702ff","resolution":{"observed_at":"2026-08-07T04:39:17.523010Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:39:17.209935Z","title":"Learning linear causal representations from general environments: Identifiability and intrinsic ambiguity","venue":null,"work_id":"0c7c0a71-6821-48ea-bcf7-62fba0a33fa7","year":2024},"citing_paper":{"arxiv_id":"2506.10378","last_updated":"2025-06-12T06:07:42Z","snapshot_observed_at":"2026-08-07T04:25:35.262506Z","submitted_at":"2025-06-12T06:07:42Z","title":"Discovering Hierarchical Latent Capabilities of Language Models via Causal Representation Learning","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-07T04:39:04.095786Z"},"links":{"citing_paper":"/paper/2506.10378"},"observation_digest":"sha256:1950f0cf504395b0377e3a7ba80898d3840202d560d55bd3069a9cb427d4706f","observation_id":"ed05d5e7-26e2-4a10-a86b-55338cf6d2f2","resolution":{"observed_at":"2026-08-07T04:39:17.319643Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06825","last_updated":"2023-10-10T17:54:58Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-10-10T17:54:58Z","title":"Mistral 7B","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.06825","snapshot_observed_at":"2026-08-07T04:39:04.248793Z","title":"Mistral 7b","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.10378","last_updated":"2025-06-12T06:07:42Z","snapshot_observed_at":"2026-08-07T04:25:35.262506Z","submitted_at":"2025-06-12T06:07:42Z","title":"Discovering Hierarchical Latent Capabilities of Language Models via Causal Representation Learning","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-07T04:39:04.248793Z"},"links":{"cited_paper":"/paper/2310.06825","citing_paper":"/paper/2506.10378"},"observation_digest":"sha256:a6de83a32887629b3589f4b590e20ca1f49de5561b9d0234c93047016e855366","observation_id":"5e90efc9-8eca-49ef-b053-d41769d333a8","resolution":{"observed_at":"2026-08-07T04:39:04.248793Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:39:17.005161Z","title":"The construct of creativity: Structural model for self-reported creativity ratings","venue":null,"work_id":"565d16d7-d127-4d92-9e38-e39cc95c5a9d","year":2009},"citing_paper":{"arxiv_id":"2506.10378","last_updated":"2025-06-12T06:07:42Z","snapshot_observed_at":"2026-08-07T04:25:35.262506Z","submitted_at":"2025-06-12T06:07:42Z","title":"Discovering Hierarchical Latent Capabilities of Language Models via Causal Representation Learning","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-07T04:39:04.353312Z"},"links":{"citing_paper":"/paper/2506.10378"},"observation_digest":"sha256:a8e8a815ce17bd1d91776cdeaa4e1232d1570380a8ddc4435c6d6691ca207234","observation_id":"64ff5b48-23e3-49b0-aaef-91c840753910","resolution":{"observed_at":"2026-08-07T04:39:17.096415Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2001.08361","last_updated":"2020-01-23T03:59:20Z","snapshot_observed_at":"2026-07-06T08:52:12.656082Z","submitted_at":"2020-01-23T03:59:20Z","title":"Scaling Laws for Neural Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2001.08361","snapshot_observed_at":"2026-08-07T04:39:04.466095Z","title":"Scaling laws for neural language models","venue":null,"work_id":null,"year":2001},"citing_paper":{"arxiv_id":"2506.10378","last_updated":"2025-06-12T06:07:42Z","snapshot_observed_at":"2026-08-07T04:25:35.262506Z","submitted_at":"2025-06-12T06:07:42Z","title":"Discovering Hierarchical Latent Capabilities of Language Models via Causal Representation Learning","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-07T04:39:04.466095Z"},"links":{"cited_paper":"/paper/2001.08361","citing_paper":"/paper/2506.10378"},"observation_digest":"sha256:4208c6b27e293bc75d2a609489cd5c3f613d2a6a7db688213277ea63d4498658","observation_id":"9bc53b76-d732-483d-a549-ee7364b8092b","resolution":{"observed_at":"2026-08-07T04:39:04.466095Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:39:16.732683Z","title":"The architecture of cognitive control in the human prefrontal cortex","venue":null,"work_id":"28da908c-0f4e-4f5f-bbb5-27881a306193","year":2003},"citing_paper":{"arxiv_id":"2506.10378","last_updated":"2025-06-12T06:07:42Z","snapshot_observed_at":"2026-08-07T04:25:35.262506Z","submitted_at":"2025-06-12T06:07:42Z","title":"Discovering Hierarchical Latent Capabilities of Language Models via Causal Representation Learning","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-07T04:39:04.555256Z"},"links":{"citing_paper":"/paper/2506.10378"},"observation_digest":"sha256:3e8993d4719f29807400068dfc4ccc1e83cced63c936d40e58b33244e86c2e4f","observation_id":"1c4027f5-05b3-45e0-bd1b-e61aa5e720a8","resolution":{"observed_at":"2026-08-07T04:39:16.815111Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:39:16.515765Z","title":"Solving quantitative reasoning problems with language models","venue":null,"work_id":"206369b2-5c3d-4a9f-bcb6-ee5c0100526c","year":2022},"citing_paper":{"arxiv_id":"2506.10378","last_updated":"2025-06-12T06:07:42Z","snapshot_observed_at":"2026-08-07T04:25:35.262506Z","submitted_at":"2025-06-12T06:07:42Z","title":"Discovering Hierarchical Latent Capabilities of Language Models via Causal Representation Learning","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-07T04:39:04.647940Z"},"links":{"citing_paper":"/paper/2506.10378"},"observation_digest":"sha256:18f351371093b5d9fd288af7d24f1e77770da150c4d53d6b4d6cf40277115f8b","observation_id":"4312c244-0569-4849-9e3e-5e2b03dc4fc9","resolution":{"observed_at":"2026-08-07T04:39:16.615163Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:39:16.282205Z","title":"Holistic evaluation of language models","venue":null,"work_id":"8e27b5a1-ded2-414a-99dc-5ca4bc4977a0","year":2023},"citing_paper":{"arxiv_id":"2506.10378","last_updated":"2025-06-12T06:07:42Z","snapshot_observed_at":"2026-08-07T04:25:35.262506Z","submitted_at":"2025-06-12T06:07:42Z","title":"Discovering Hierarchical Latent Capabilities of Language Models via Causal Representation Learning","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-07T04:39:04.799167Z"},"links":{"citing_paper":"/paper/2506.10378"},"observation_digest":"sha256:ccf90f78ec3c775f110b32ffcd80a4f905a3b8ef49a3b1cb7e6292cb00245877","observation_id":"7c8ef998-8f49-4b69-8240-766ef8ac77ad","resolution":{"observed_at":"2026-08-07T04:39:16.405930Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2503.03862","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:39:09.795832Z","title":"Not-just-scaling laws: Towards a better understanding of the downstream impact of language model design decisions","venue":null,"work_id":"ebd1ffa1-b672-465f-98c9-83e64e69c00a","year":2025},"citing_paper":{"arxiv_id":"2506.10378","last_updated":"2025-06-12T06:07:42Z","snapshot_observed_at":"2026-08-07T04:25:35.262506Z","submitted_at":"2025-06-12T06:07:42Z","title":"Discovering Hierarchical Latent Capabilities of Language Models via Causal Representation Learning","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-07T04:39:04.907319Z"},"links":{"citing_paper":"/paper/2506.10378"},"observation_digest":"sha256:e1f5dab84646566b88bd588aa9d0f2bf63c6ca4a5588399ca8af079f041319f8","observation_id":"881357b0-9473-403a-a862-0ed62aa483e5","resolution":{"observed_at":"2026-08-07T04:39:09.929296Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:39:16.049108Z","title":"a tsch, Bernhard Sch \\","venue":null,"work_id":"2268fbfb-8008-46ac-9370-d923d495d776","year":2020},"citing_paper":{"arxiv_id":"2506.10378","last_updated":"2025-06-12T06:07:42Z","snapshot_observed_at":"2026-08-07T04:25:35.262506Z","submitted_at":"2025-06-12T06:07:42Z","title":"Discovering Hierarchical Latent Capabilities of Language Models via Causal Representation Learning","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-07T04:39:05.057279Z"},"links":{"citing_paper":"/paper/2506.10378"},"observation_digest":"sha256:caf44d8755a0c8669960b32d1f52697cbea04c8519c06845db85dcb2a42965aa","observation_id":"92014512-796e-41ce-8bbe-2f557bb3087a","resolution":{"observed_at":"2026-08-07T04:39:16.156807Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:39:15.841139Z","title":null,"venue":null,"work_id":"b789266b-4ab9-41cb-b900-5338cf11c18d","year":2022},"citing_paper":{"arxiv_id":"2506.10378","last_updated":"2025-06-12T06:07:42Z","snapshot_observed_at":"2026-08-07T04:25:35.262506Z","submitted_at":"2025-06-12T06:07:42Z","title":"Discovering Hierarchical Latent Capabilities of Language Models via Causal Representation Learning","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-07T04:39:05.192921Z"},"links":{"citing_paper":"/paper/2506.10378"},"observation_digest":"sha256:e42c81aacd8c810ee2d415eaf1f0a1f1bf4c765b0473992cd33d47a93e3c13c2","observation_id":"ea42288d-69a3-4cf0-9cd3-d8799c45b5c5","resolution":{"observed_at":"2026-08-07T04:39:15.966129Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:39:15.559735Z","title":null,"venue":null,"work_id":"0c2ac53d-250a-4c29-9f26-61321e906398","year":2023},"citing_paper":{"arxiv_id":"2506.10378","last_updated":"2025-06-12T06:07:42Z","snapshot_observed_at":"2026-08-07T04:25:35.262506Z","submitted_at":"2025-06-12T06:07:42Z","title":"Discovering Hierarchical Latent Capabilities of Language Models via Causal Representation Learning","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-07T04:39:05.265187Z"},"links":{"citing_paper":"/paper/2506.10378"},"observation_digest":"sha256:73bff850a7013469519320adf5d294339821590cfe6f9e630328d142c73517d7","observation_id":"97c7bca5-0022-4283-920a-2f2dfbe117bf","resolution":{"observed_at":"2026-08-07T04:39:15.646961Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:39:05.358578Z","title":"Training language models to follow instructions with human feedback","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.10378","last_updated":"2025-06-12T06:07:42Z","snapshot_observed_at":"2026-08-07T04:25:35.262506Z","submitted_at":"2025-06-12T06:07:42Z","title":"Discovering Hierarchical Latent Capabilities of Language Models via Causal Representation Learning","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-07T04:39:05.358578Z"},"links":{"citing_paper":"/paper/2506.10378"},"observation_digest":"sha256:638efbb1ce9809111e6734bed56f4cd96ad9d6cd5c2fb49e081b6fc2068b5285","observation_id":"01771925-1151-4807-8901-d210432db236","resolution":{"observed_at":"2026-08-07T04:39:05.358578Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:39:15.347802Z","title":"Causal diagrams for empirical research","venue":null,"work_id":"c849c7eb-92f0-47ef-9dcb-eca8017606ee","year":1995},"citing_paper":{"arxiv_id":"2506.10378","last_updated":"2025-06-12T06:07:42Z","snapshot_observed_at":"2026-08-07T04:25:35.262506Z","submitted_at":"2025-06-12T06:07:42Z","title":"Discovering Hierarchical Latent Capabilities of Language Models via Causal Representation Learning","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-07T04:39:05.492378Z"},"links":{"citing_paper":"/paper/2506.10378"},"observation_digest":"sha256:b3db6ff7a191875715a502835188f0a041c79a089a26e60ca5f5a5ed761ae652","observation_id":"f372a1cc-a702-4d7d-930a-873e20d78ab7","resolution":{"observed_at":"2026-08-07T04:39:15.450728Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:39:15.041158Z","title":"On the identifiability of bayesian factor analytic models","venue":null,"work_id":"390c95c8-0b20-4c3d-a5d0-49b98cb2538b","year":2022},"citing_paper":{"arxiv_id":"2506.10378","last_updated":"2025-06-12T06:07:42Z","snapshot_observed_at":"2026-08-07T04:25:35.262506Z","submitted_at":"2025-06-12T06:07:42Z","title":"Discovering Hierarchical Latent Capabilities of Language Models via Causal Representation Learning","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-07T04:39:05.639697Z"},"links":{"citing_paper":"/paper/2506.10378"},"observation_digest":"sha256:e528f170e9c376880a9c1687a430dab430dba6f6347aff17bba4344993e46567","observation_id":"a2777412-bf94-44ab-a025-aa78374b6908","resolution":{"observed_at":"2026-08-07T04:39:15.225195Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2412.06540","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:39:09.558687Z","title":"Sloth: scaling laws for llm skills to predict multi-benchmark performance across families","venue":null,"work_id":"5f6d48fc-fd85-44bc-bd0c-11ddd76f0129","year":2024},"citing_paper":{"arxiv_id":"2506.10378","last_updated":"2025-06-12T06:07:42Z","snapshot_observed_at":"2026-08-07T04:25:35.262506Z","submitted_at":"2025-06-12T06:07:42Z","title":"Discovering Hierarchical Latent Capabilities of Language Models via Causal Representation Learning","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-07T04:39:05.766473Z"},"links":{"citing_paper":"/paper/2506.10378"},"observation_digest":"sha256:e1f86160f77daa53d91b7d7f655d2fb81a268490141613807d35c48a6099c83c","observation_id":"083c9f47-7b1d-403f-86ab-81f1d9818fe8","resolution":{"observed_at":"2026-08-07T04:39:09.635730Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:39:14.800891Z","title":"Evolm: In search of lost language model training dynamics, 2025","venue":null,"work_id":"e3d660ed-eaf6-407f-9e7b-cae2e7a2de28","year":2025},"citing_paper":{"arxiv_id":"2506.10378","last_updated":"2025-06-12T06:07:42Z","snapshot_observed_at":"2026-08-07T04:25:35.262506Z","submitted_at":"2025-06-12T06:07:42Z","title":"Discovering Hierarchical Latent Capabilities of Language Models via Causal Representation Learning","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-07T04:39:05.895689Z"},"links":{"citing_paper":"/paper/2506.10378"},"observation_digest":"sha256:83e201a059421545905c0f598eeb5c2287ac6716059c409de00b157f4d802274","observation_id":"1db11138-c297-4adc-a336-ddc03eb2eccf","resolution":{"observed_at":"2026-08-07T04:39:14.927579Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:39:14.539304Z","title":"Safetywashing: Do ai safety benchmarks actually measure safety progress? Advances in Neural Information Processing Systems , 37:68559--68594, 2025","venue":null,"work_id":"bd1a1fb5-004d-4e2e-9ab0-2351d9f7e255","year":2025},"citing_paper":{"arxiv_id":"2506.10378","last_updated":"2025-06-12T06:07:42Z","snapshot_observed_at":"2026-08-07T04:25:35.262506Z","submitted_at":"2025-06-12T06:07:42Z","title":"Discovering Hierarchical Latent Capabilities of Language Models via Causal Representation Learning","version":1},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-07T04:39:06.006821Z"},"links":{"citing_paper":"/paper/2506.10378"},"observation_digest":"sha256:e9930720e7cfe9b8a924d2e0534233301f0b30f52a621342a4c0d674c92b6e79","observation_id":"ff26cae3-b612-4087-9aec-7b5096df579f","resolution":{"observed_at":"2026-08-07T04:39:14.638098Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:39:14.297039Z","title":"A simpler approach to matrix completion","venue":null,"work_id":"22eef505-82cb-45d3-b1bb-51e9f6711ba8","year":2011},"citing_paper":{"arxiv_id":"2506.10378","last_updated":"2025-06-12T06:07:42Z","snapshot_observed_at":"2026-08-07T04:25:35.262506Z","submitted_at":"2025-06-12T06:07:42Z","title":"Discovering Hierarchical Latent Capabilities of Language Models via Causal Representation Learning","version":1},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-07T04:39:06.141851Z"},"links":{"citing_paper":"/paper/2506.10378"},"observation_digest":"sha256:023a9cb00f8fe81142a145762caf983f14150de9d2b2282bdd46b42616959c54","observation_id":"a1ca435d-8a21-45ea-ab4b-468a3923f8da","resolution":{"observed_at":"2026-08-07T04:39:14.398228Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:39:13.981201Z","title":"Maddison, and Tatsunori Hashimoto","venue":null,"work_id":"eb7980d6-5fc9-4b26-921a-24f5d0d6f715","year":2024},"citing_paper":{"arxiv_id":"2506.10378","last_updated":"2025-06-12T06:07:42Z","snapshot_observed_at":"2026-08-07T04:25:35.262506Z","submitted_at":"2025-06-12T06:07:42Z","title":"Discovering Hierarchical Latent Capabilities of Language Models via Causal Representation Learning","version":1},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-08-07T04:39:06.258579Z"},"links":{"citing_paper":"/paper/2506.10378"},"observation_digest":"sha256:82ce9a9ad586bc8acff195c614c8ef40cd94c146620c5ccc1cd0f87de632c63c","observation_id":"020ec77d-927a-44b5-bd45-76219c69c749","resolution":{"observed_at":"2026-08-07T04:39:14.153380Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:39:13.701155Z","title":"The architecture of complexity","venue":null,"work_id":"527b4318-11b9-4533-abb3-792076e4bd9b","year":2012},"citing_paper":{"arxiv_id":"2506.10378","last_updated":"2025-06-12T06:07:42Z","snapshot_observed_at":"2026-08-07T04:25:35.262506Z","submitted_at":"2025-06-12T06:07:42Z","title":"Discovering Hierarchical Latent Capabilities of Language Models via Causal Representation Learning","version":1},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-08-07T04:39:06.427379Z"},"links":{"citing_paper":"/paper/2506.10378"},"observation_digest":"sha256:4dc1722cba89b67cf9df2d1d3fa853f0ecc5f603093c910c5777095be1844341","observation_id":"2ce67ae2-8170-467a-9f1a-493f5c3cf32a","resolution":{"observed_at":"2026-08-07T04:39:13.814004Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:39:13.451145Z","title":"Toward causal representation learning","venue":null,"work_id":"f94d64fb-652c-4f68-b287-28333373e2f1","year":2021},"citing_paper":{"arxiv_id":"2506.10378","last_updated":"2025-06-12T06:07:42Z","snapshot_observed_at":"2026-08-07T04:25:35.262506Z","submitted_at":"2025-06-12T06:07:42Z","title":"Discovering Hierarchical Latent Capabilities of Language Models via Causal Representation Learning","version":1},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-08-07T04:39:06.577987Z"},"links":{"citing_paper":"/paper/2506.10378"},"observation_digest":"sha256:7def941b09af5c32805795c7818844123cd33f8164c6ded8263fdf291ad627a5","observation_id":"cbcacfde-0564-4ca1-b2d9-e9efccb98d3f","resolution":{"observed_at":"2026-08-07T04:39:13.607870Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:39:13.153820Z","title":"Are emergent abilities of large language models a mirage? Advances in Neural Information Processing Systems , 36:55565--55581, 2023","venue":null,"work_id":"b217ae1d-4228-45e1-a376-1cbe4a4b3541","year":2023},"citing_paper":{"arxiv_id":"2506.10378","last_updated":"2025-06-12T06:07:42Z","snapshot_observed_at":"2026-08-07T04:25:35.262506Z","submitted_at":"2025-06-12T06:07:42Z","title":"Discovering Hierarchical Latent Capabilities of Language Models via Causal Representation Learning","version":1},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-08-07T04:39:06.764599Z"},"links":{"citing_paper":"/paper/2506.10378"},"observation_digest":"sha256:07497961041575edbf547eda93aefa60aa6976f492d9046d233be09e257cd6c2","observation_id":"d5ef6c67-2fbf-4fc2-b28c-4f51f55ad966","resolution":{"observed_at":"2026-08-07T04:39:13.298759Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:39:12.961628Z","title":"Linear causal disentanglement via interventions","venue":null,"work_id":"170aade3-3d2d-4b4d-a424-c44b4330fbce","year":2023},"citing_paper":{"arxiv_id":"2506.10378","last_updated":"2025-06-12T06:07:42Z","snapshot_observed_at":"2026-08-07T04:25:35.262506Z","submitted_at":"2025-06-12T06:07:42Z","title":"Discovering Hierarchical Latent Capabilities of Language Models via Causal Representation Learning","version":1},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-08-07T04:39:06.874199Z"},"links":{"citing_paper":"/paper/2506.10378"},"observation_digest":"sha256:dbad173231d03a451b2018820ddc7cd280c4e74b68f2654f2a90d5984eeea354","observation_id":"f1ba9a89-d3de-498a-bbe6-5fc7d8e95d76","resolution":{"observed_at":"2026-08-07T04:39:13.047722Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.09261","last_updated":"2022-10-17T17:08:26Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-10-17T17:08:26Z","title":"Challenging BIG-Bench Tasks and Whether Chain-of-Thought Can Solve Them","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.09261","snapshot_observed_at":"2026-08-07T04:39:07.048487Z","title":"Challenging big-bench tasks and whether chain-of-thought can solve them","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.10378","last_updated":"2025-06-12T06:07:42Z","snapshot_observed_at":"2026-08-07T04:25:35.262506Z","submitted_at":"2025-06-12T06:07:42Z","title":"Discovering Hierarchical Latent Capabilities of Language Models via Causal Representation Learning","version":1},"reference_index":63,"source":"arxiv_source","source_observed_at":"2026-08-07T04:39:07.048487Z"},"links":{"cited_paper":"/paper/2210.09261","citing_paper":"/paper/2506.10378"},"observation_digest":"sha256:3a991913d179826632ad47f739b50efa517963ad90ad5466b7bdd0be965dbed8","observation_id":"438ce11a-8062-4d6d-be7d-3c818cee1042","resolution":{"observed_at":"2026-08-07T04:39:07.048487Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:39:12.706227Z","title":"Matching methods for causal inference: A review and a look forward","venue":null,"work_id":"c3367ab3-9929-444b-9978-1f81e422886b","year":2010},"citing_paper":{"arxiv_id":"2506.10378","last_updated":"2025-06-12T06:07:42Z","snapshot_observed_at":"2026-08-07T04:25:35.262506Z","submitted_at":"2025-06-12T06:07:42Z","title":"Discovering Hierarchical Latent Capabilities of Language Models via Causal Representation Learning","version":1},"reference_index":64,"source":"arxiv_source","source_observed_at":"2026-08-07T04:39:07.185664Z"},"links":{"citing_paper":"/paper/2506.10378"},"observation_digest":"sha256:0ba864a6561780b44b8c38a2a92daf16f3c25a66d2079a5182911894a40941c8","observation_id":"4892c736-dcf1-442d-9bff-2c472a3fbf90","resolution":{"observed_at":"2026-08-07T04:39:12.811869Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:39:12.473473Z","title":"Multitask prompted training enables zero-shot task generalization","venue":null,"work_id":"7cc893d2-2ff8-4036-8a2f-4f121893c75e","year":2022},"citing_paper":{"arxiv_id":"2506.10378","last_updated":"2025-06-12T06:07:42Z","snapshot_observed_at":"2026-08-07T04:25:35.262506Z","submitted_at":"2025-06-12T06:07:42Z","title":"Discovering Hierarchical Latent Capabilities of Language Models via Causal Representation Learning","version":1},"reference_index":65,"source":"arxiv_source","source_observed_at":"2026-08-07T04:39:07.300084Z"},"links":{"citing_paper":"/paper/2506.10378"},"observation_digest":"sha256:1b85c2e4083d811cd60268e7a77e581af9f923c3203fb2f8af0e5d9eb06db8a2","observation_id":"a36f9775-fad5-4d4c-8e26-65fa47f22c1d","resolution":{"observed_at":"2026-08-07T04:39:12.582736Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:39:12.100386Z","title":"How to grow a mind: Statistics, structure, and abstraction","venue":null,"work_id":"798db6cb-111b-4e37-88c1-ae554c680a25","year":2011},"citing_paper":{"arxiv_id":"2506.10378","last_updated":"2025-06-12T06:07:42Z","snapshot_observed_at":"2026-08-07T04:25:35.262506Z","submitted_at":"2025-06-12T06:07:42Z","title":"Discovering Hierarchical Latent Capabilities of Language Models via Causal Representation Learning","version":1},"reference_index":66,"source":"arxiv_source","source_observed_at":"2026-08-07T04:39:07.438379Z"},"links":{"citing_paper":"/paper/2506.10378"},"observation_digest":"sha256:e28f9065ee851963d207dfb33b5e7752ac80eb5bb501df32d0ba1dc3f07697b8","observation_id":"15e875bb-d667-44a3-bec2-c9254e3f50d1","resolution":{"observed_at":"2026-08-07T04:39:12.236470Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-08-07T04:39:07.609846Z","title":"Gemma 2: Improving open language models at a practical size","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.10378","last_updated":"2025-06-12T06:07:42Z","snapshot_observed_at":"2026-08-07T04:25:35.262506Z","submitted_at":"2025-06-12T06:07:42Z","title":"Discovering Hierarchical Latent Capabilities of Language Models via Causal Representation Learning","version":1},"reference_index":67,"source":"arxiv_source","source_observed_at":"2026-08-07T04:39:07.609846Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2506.10378"},"observation_digest":"sha256:cd0473e0a6114257512b63811c4de8f1239ec081c5e6df4ece544823085cc073","observation_id":"66a6f830-b240-4aa7-9e91-150b1b1525c0","resolution":{"observed_at":"2026-08-07T04:39:07.609846Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.13335","last_updated":"2025-03-17T16:15:02Z","snapshot_observed_at":"2026-08-07T16:57:21.932530Z","submitted_at":"2025-03-17T16:15:02Z","title":"Reliable and Efficient Amortized Model-based Evaluation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.13335","snapshot_observed_at":"2026-08-07T04:39:07.776135Z","title":"Reliable and efficient amortized model-based evaluation","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.10378","last_updated":"2025-06-12T06:07:42Z","snapshot_observed_at":"2026-08-07T04:25:35.262506Z","submitted_at":"2025-06-12T06:07:42Z","title":"Discovering Hierarchical Latent Capabilities of Language Models via Causal Representation Learning","version":1},"reference_index":68,"source":"arxiv_source","source_observed_at":"2026-08-07T04:39:07.776135Z"},"links":{"cited_paper":"/paper/2503.13335","citing_paper":"/paper/2506.10378"},"observation_digest":"sha256:0bc15da6c955f58b2c308d05a9c527f1bda4ab97a051d058dfec0e33972cb01a","observation_id":"452ada49-09c1-4ce3-b06b-6cce064e17b0","resolution":{"observed_at":"2026-08-07T04:39:07.776135Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:39:11.868867Z","title":"u gelgen, Michel Besserve, Liang Wendong, Luigi Gresele, Armin Keki \\'c , Elias Bareinboim, David Blei, and Bernhard Sch \\","venue":null,"work_id":"9bc5a71c-0b35-4281-88ce-a5ce9e3b24cf","year":2023},"citing_paper":{"arxiv_id":"2506.10378","last_updated":"2025-06-12T06:07:42Z","snapshot_observed_at":"2026-08-07T04:25:35.262506Z","submitted_at":"2025-06-12T06:07:42Z","title":"Discovering Hierarchical Latent Capabilities of Language Models via Causal Representation Learning","version":1},"reference_index":69,"source":"arxiv_source","source_observed_at":"2026-08-07T04:39:07.990648Z"},"links":{"citing_paper":"/paper/2506.10378"},"observation_digest":"sha256:2037ffed5f2a6a1904cf2221f56aa73e4f6027fc6bd085389c295a42ab926f6f","observation_id":"41453dd2-3a78-490f-9438-c4781d8369bc","resolution":{"observed_at":"2026-08-07T04:39:11.977760Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:39:11.580935Z","title":null,"venue":null,"work_id":"e99323e2-cc33-4e1c-bd48-64e2bb72eba2","year":2022},"citing_paper":{"arxiv_id":"2506.10378","last_updated":"2025-06-12T06:07:42Z","snapshot_observed_at":"2026-08-07T04:25:35.262506Z","submitted_at":"2025-06-12T06:07:42Z","title":"Discovering Hierarchical Latent Capabilities of Language Models via Causal Representation Learning","version":1},"reference_index":70,"source":"arxiv_source","source_observed_at":"2026-08-07T04:39:08.126619Z"},"links":{"citing_paper":"/paper/2506.10378"},"observation_digest":"sha256:03d1c5bc6c2201942cb1780b301dce22631b9fcd781e52a76b55a94776e7766d","observation_id":"ba62fe5e-c8d8-42d4-a336-c7fd2d071bec","resolution":{"observed_at":"2026-08-07T04:39:11.736778Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2206.07682","last_updated":"2022-10-26T05:06:24Z","snapshot_observed_at":"2026-08-02T15:56:35.249569Z","submitted_at":"2022-06-15T17:32:01Z","title":"Emergent Abilities of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2206.07682","snapshot_observed_at":"2026-08-07T04:39:08.295838Z","title":"Emergent abilities of large language models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.10378","last_updated":"2025-06-12T06:07:42Z","snapshot_observed_at":"2026-08-07T04:25:35.262506Z","submitted_at":"2025-06-12T06:07:42Z","title":"Discovering Hierarchical Latent Capabilities of Language Models via Causal Representation Learning","version":1},"reference_index":71,"source":"arxiv_source","source_observed_at":"2026-08-07T04:39:08.295838Z"},"links":{"cited_paper":"/paper/2206.07682","citing_paper":"/paper/2506.10378"},"observation_digest":"sha256:0132c0b7af3f1a30716dad734664d38df7992db618f7d8068e12e986a92d8716","observation_id":"5f73c6e8-86c4-4284-861f-1fc363db16fd","resolution":{"observed_at":"2026-08-07T04:39:08.295838Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.17567","last_updated":"2023-10-26T16:55:05Z","snapshot_observed_at":"2026-08-06T20:11:27.128480Z","submitted_at":"2023-10-26T16:55:05Z","title":"Skill-Mix: a Flexible and Expandable Family of Evaluations for AI models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.17567","snapshot_observed_at":"2026-08-07T04:39:08.432069Z","title":"Skill-mix: A flexible and expandable family of evaluations for ai models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.10378","last_updated":"2025-06-12T06:07:42Z","snapshot_observed_at":"2026-08-07T04:25:35.262506Z","submitted_at":"2025-06-12T06:07:42Z","title":"Discovering Hierarchical Latent Capabilities of Language Models via Causal Representation Learning","version":1},"reference_index":72,"source":"arxiv_source","source_observed_at":"2026-08-07T04:39:08.432069Z"},"links":{"cited_paper":"/paper/2310.17567","citing_paper":"/paper/2506.10378"},"observation_digest":"sha256:b8dcdaf4eb6ee7c0907d5765df055861f80d24c6675092d302369747730f056e","observation_id":"2ca6bb1b-f90a-44ac-a0a6-4acc444e8649","resolution":{"observed_at":"2026-08-07T04:39:08.432069Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15115","last_updated":"2025-01-03T02:18:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-19T17:56:09Z","title":"Qwen2.5 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.15115","snapshot_observed_at":"2026-08-07T04:39:08.522540Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.10378","last_updated":"2025-06-12T06:07:42Z","snapshot_observed_at":"2026-08-07T04:25:35.262506Z","submitted_at":"2025-06-12T06:07:42Z","title":"Discovering Hierarchical Latent Capabilities of Language Models via Causal Representation Learning","version":1},"reference_index":73,"source":"arxiv_source","source_observed_at":"2026-08-07T04:39:08.522540Z"},"links":{"cited_paper":"/paper/2412.15115","citing_paper":"/paper/2506.10378"},"observation_digest":"sha256:4f3bc7648e752ae06faf55828d145d290693c00e7062ce3ab07af8b3b2304d1e","observation_id":"4f700dc1-78d5-40f7-88eb-c72c490540eb","resolution":{"observed_at":"2026-08-07T04:39:08.522540Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:39:11.305964Z","title":"Unveiling the impact of coding data instruction fine-tuning on large language models reasoning","venue":null,"work_id":"f71b2ec8-9926-40e0-a32c-7ed44485bbb2","year":2025},"citing_paper":{"arxiv_id":"2506.10378","last_updated":"2025-06-12T06:07:42Z","snapshot_observed_at":"2026-08-07T04:25:35.262506Z","submitted_at":"2025-06-12T06:07:42Z","title":"Discovering Hierarchical Latent Capabilities of Language Models via Causal Representation Learning","version":1},"reference_index":74,"source":"arxiv_source","source_observed_at":"2026-08-07T04:39:08.626556Z"},"links":{"citing_paper":"/paper/2506.10378"},"observation_digest":"sha256:5cb2dd464b6546cba55ecd4dc0bc4fbbddb9c2e86130f2f11bf7a8de39c061f2","observation_id":"3b99727a-a679-4969-a46c-9ba35f4e0e31","resolution":{"observed_at":"2026-08-07T04:39:11.451018Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:39:11.038441Z","title":"Identifiability guarantees for causal disentanglement from soft interventions","venue":null,"work_id":"59187866-0f0c-4169-b584-840932cdf94c","year":2023},"citing_paper":{"arxiv_id":"2506.10378","last_updated":"2025-06-12T06:07:42Z","snapshot_observed_at":"2026-08-07T04:25:35.262506Z","submitted_at":"2025-06-12T06:07:42Z","title":"Discovering Hierarchical Latent Capabilities of Language Models via Causal Representation Learning","version":1},"reference_index":75,"source":"arxiv_source","source_observed_at":"2026-08-07T04:39:08.739725Z"},"links":{"citing_paper":"/paper/2506.10378"},"observation_digest":"sha256:1bac73c4aa9e6000187d6a51d6f3598b5eae1778cc49540d21f80a1f59c5e9ee","observation_id":"a238c3eb-9b06-4095-973b-b8ec36056841","resolution":{"observed_at":"2026-08-07T04:39:11.181960Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:39:10.747788Z","title":"When scaling meets llm finetuning: The effect of data, model and finetuning method","venue":null,"work_id":"3f9f3555-4d58-4645-91e7-bd34002b113d","year":2024},"citing_paper":{"arxiv_id":"2506.10378","last_updated":"2025-06-12T06:07:42Z","snapshot_observed_at":"2026-08-07T04:25:35.262506Z","submitted_at":"2025-06-12T06:07:42Z","title":"Discovering Hierarchical Latent Capabilities of Language Models via Causal Representation Learning","version":1},"reference_index":76,"source":"arxiv_source","source_observed_at":"2026-08-07T04:39:08.867178Z"},"links":{"citing_paper":"/paper/2506.10378"},"observation_digest":"sha256:902cd21b63d0e6d7990a72aa9959f29b59b4df6cc8ca0ac1e5d9fb0f85bfaa04","observation_id":"d8d350f2-3699-4bd4-bfc3-42f09638ad17","resolution":{"observed_at":"2026-08-07T04:39:10.917752Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.07912","last_updated":"2025-08-07T23:50:47Z","snapshot_observed_at":"2026-08-07T16:06:46.405251Z","submitted_at":"2025-04-10T17:15:53Z","title":"Echo Chamber: RL Post-training Amplifies Behaviors Learned in Pretraining","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.07912","snapshot_observed_at":"2026-08-07T04:39:08.980643Z","title":"Echo chamber: Rl post-training amplifies behaviors learned in pretraining","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.10378","last_updated":"2025-06-12T06:07:42Z","snapshot_observed_at":"2026-08-07T04:25:35.262506Z","submitted_at":"2025-06-12T06:07:42Z","title":"Discovering Hierarchical Latent Capabilities of Language Models via Causal Representation Learning","version":1},"reference_index":77,"source":"arxiv_source","source_observed_at":"2026-08-07T04:39:08.980643Z"},"links":{"cited_paper":"/paper/2504.07912","citing_paper":"/paper/2506.10378"},"observation_digest":"sha256:5dadfecbd70faa1463c1af237f34ec1eee7b638c5f1c0bc0979e43740d7c7bcb","observation_id":"77f34f5e-32a2-486f-a497-2323514f9ea2","resolution":{"observed_at":"2026-08-07T04:39:08.980643Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.10313","last_updated":"2023-12-05T08:59:33Z","snapshot_observed_at":"2026-07-06T16:20:21.258653Z","submitted_at":"2023-09-19T04:51:13Z","title":"Investigating the Catastrophic Forgetting in Multimodal Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.10313","snapshot_observed_at":"2026-08-07T04:39:09.135335Z","title":"Investigating the catastrophic forgetting in multimodal large language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.10378","last_updated":"2025-06-12T06:07:42Z","snapshot_observed_at":"2026-08-07T04:25:35.262506Z","submitted_at":"2025-06-12T06:07:42Z","title":"Discovering Hierarchical Latent Capabilities of Language Models via Causal Representation Learning","version":1},"reference_index":78,"source":"arxiv_source","source_observed_at":"2026-08-07T04:39:09.135335Z"},"links":{"cited_paper":"/paper/2309.10313","citing_paper":"/paper/2506.10378"},"observation_digest":"sha256:17ef4385048d5a0e0a56132e0974bb0d36f3f5a2e317d70888ec98e7add30045","observation_id":"1eb0872c-5acd-485a-87f7-9bb5fa1505fd","resolution":{"observed_at":"2026-08-07T04:39:09.135335Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:39:10.514242Z","title":"Causal representation learning from multiple distributions: A general setting","venue":null,"work_id":"1744236f-39e9-494b-9cb0-e097ab1f59b0","year":2024},"citing_paper":{"arxiv_id":"2506.10378","last_updated":"2025-06-12T06:07:42Z","snapshot_observed_at":"2026-08-07T04:25:35.262506Z","submitted_at":"2025-06-12T06:07:42Z","title":"Discovering Hierarchical Latent Capabilities of Language Models via Causal Representation Learning","version":1},"reference_index":79,"source":"arxiv_source","source_observed_at":"2026-08-07T04:39:09.218815Z"},"links":{"citing_paper":"/paper/2506.10378"},"observation_digest":"sha256:2266386c49f2968c0a4e09b86fe396e5962fd85bc981fdf4a3c6f1a2606d09ea","observation_id":"d0606cbd-59fc-4474-a7f6-d801b108c258","resolution":{"observed_at":"2026-08-07T04:39:10.609813Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2506.10378","last_updated":"2025-06-12T06:07:42Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-07T04:25:35.262506Z","submitted_at":"2025-06-12T06:07:42Z","title":"Discovering Hierarchical Latent Capabilities of Language Models via Causal Representation Learning"},"reference_resolution":{"displayed":79,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":35,"verified_exact":3,"verified_fuzzy":41},"total_outbound_references":79},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 79 of 79 outbound references and 3 inbound Pith citation observations for arXiv:2506.10378."}