{"as_of":"2026-08-17T00:34:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:65dc8d6f3da53b436691b9712ec83c38f76cf862947b81efa7fd3c35d823cd89","coverage":[{"denominator":77,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":77,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-16T05:30:51.402782Z","state":"measured"},{"denominator":78,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":78,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-16T06:30:59.297886+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T20:32:05.970530Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-15T20:32:06.496955Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2504.20644","last_updated":"2025-04-29T11:13:18Z","snapshot_observed_at":"2026-08-16T05:21:46.500638Z","submitted_at":"2025-04-29T11:13:18Z","title":"Combatting Dimensional Collapse in LLM Pre-Training Data via Diversified File Selection","version":1},"cited_work":{"arxiv_id":"2504.20644","doi":null,"metadata_source":"pith","pith_arxiv_id":"2504.20644","snapshot_observed_at":"2026-08-15T20:32:06.496955Z","title":"Combatting Dimensional Collapse in LLM Pre-Training Data via Diversified File Selection","venue":"cs.LG","work_id":"f9d84246-36a7-45e1-9bdb-ea71584c2236","year":2025},"citing_paper":{"arxiv_id":"2505.12762","last_updated":"2025-05-19T06:42:44Z","snapshot_observed_at":"2026-08-16T18:14:18.678834Z","submitted_at":"2025-05-19T06:42:44Z","title":"IDEAL: Data Equilibrium Adaptation for Multi-Capability Language Model Alignment","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-15T20:32:05.970530Z"},"links":{"cited_paper":"/paper/2504.20644","citing_paper":"/paper/2505.12762"},"observation_digest":"sha256:d044069694f9fabd728a3d82b9640510c366ea2db36ed0c70ddaa30325a68b6e","observation_id":"b839afd9-f0c3-4f79-9ec9-714f2ee31a41","resolution":{"observed_at":"2026-08-15T20:32:06.502408Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2504.20644/citation-record","integrity":"/paper/2504.20644/integrity","json":"/paper/2504.20644/citation-record.json","paper":"/paper/2504.20644"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:30:51.058601Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2504.20644","last_updated":"2025-04-29T11:13:18Z","snapshot_observed_at":"2026-08-16T05:21:46.500638Z","submitted_at":"2025-04-29T11:13:18Z","title":"Combatting Dimensional Collapse in LLM Pre-Training Data via Diversified File Selection","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-16T05:30:51.058601Z"},"links":{"citing_paper":"/paper/2504.20644"},"observation_digest":"sha256:c4fdd4df1d953baaaa48ac5caa24101056783c8127137f6fb18cd4b65b475832","observation_id":"bb965701-cbdd-473a-bb0b-1eae3cb3b322","resolution":{"observed_at":"2026-08-16T05:30:51.058601Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:30:52.512237Z","title":"Semdedup: Data-efficient learning at web-scale through semantic deduplication","venue":null,"work_id":"961b0879-0403-44f6-9711-bce9d2fa8d1f","year":2023},"citing_paper":{"arxiv_id":"2504.20644","last_updated":"2025-04-29T11:13:18Z","snapshot_observed_at":"2026-08-16T05:21:46.500638Z","submitted_at":"2025-04-29T11:13:18Z","title":"Combatting Dimensional Collapse in LLM Pre-Training Data via Diversified File Selection","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-16T05:30:51.064681Z"},"links":{"citing_paper":"/paper/2504.20644"},"observation_digest":"sha256:ea8d35ac8785d2423c42fcda281d1d3df68deb36b0bc593b421c80ba728273bf","observation_id":"26dfcfec-d0c0-462f-8f7c-024593b93201","resolution":{"observed_at":"2026-08-16T05:30:52.517229Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:30:52.497555Z","title":"Diverse client selection for federated learning via submodular maximization","venue":null,"work_id":"89f13c4c-d8d6-418a-bb62-60974cb61a67","year":2022},"citing_paper":{"arxiv_id":"2504.20644","last_updated":"2025-04-29T11:13:18Z","snapshot_observed_at":"2026-08-16T05:21:46.500638Z","submitted_at":"2025-04-29T11:13:18Z","title":"Combatting Dimensional Collapse in LLM Pre-Training Data via Diversified File Selection","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-16T05:30:51.070017Z"},"links":{"citing_paper":"/paper/2504.20644"},"observation_digest":"sha256:b0bbe80b9c05f28b342fe7229f6de21879bfe4ba3f604111e9ab4f12863e8609","observation_id":"58a6effd-4a46-4f87-bc6b-5a16e323c1d4","resolution":{"observed_at":"2026-08-16T05:30:52.502815Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:30:52.478860Z","title":"Vicreg: Variance-invariance-covariance regularization for self-supervised learning","venue":null,"work_id":"b93188bc-b072-42a5-b7de-83f555c0472d","year":2022},"citing_paper":{"arxiv_id":"2504.20644","last_updated":"2025-04-29T11:13:18Z","snapshot_observed_at":"2026-08-16T05:21:46.500638Z","submitted_at":"2025-04-29T11:13:18Z","title":"Combatting Dimensional Collapse in LLM Pre-Training Data via Diversified File Selection","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-16T05:30:51.075071Z"},"links":{"citing_paper":"/paper/2504.20644"},"observation_digest":"sha256:b240a6288e903dfadbdec36717e0d38d145df6d04e1b8a9d927ceb811f068c57","observation_id":"2aea9b76-88a2-4c5e-8061-45f7b2e4e918","resolution":{"observed_at":"2026-08-16T05:30:52.483773Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:30:51.079595Z","title":"Pythia: A suite for analyzing large language models across training and scaling","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.20644","last_updated":"2025-04-29T11:13:18Z","snapshot_observed_at":"2026-08-16T05:21:46.500638Z","submitted_at":"2025-04-29T11:13:18Z","title":"Combatting Dimensional Collapse in LLM Pre-Training Data via Diversified File Selection","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-16T05:30:51.079595Z"},"links":{"citing_paper":"/paper/2504.20644"},"observation_digest":"sha256:de3ae6b334d0bdb1c242e3e26572ab3f1bc26d29a645e8af4d07bc693b2a91f4","observation_id":"f7cfcbbd-aa94-4dfc-a6cf-d7d0cad6a1cc","resolution":{"observed_at":"2026-08-16T05:30:51.079595Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:30:51.084920Z","title":"Piqa: Reasoning about physical commonsense in natural language","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2504.20644","last_updated":"2025-04-29T11:13:18Z","snapshot_observed_at":"2026-08-16T05:21:46.500638Z","submitted_at":"2025-04-29T11:13:18Z","title":"Combatting Dimensional Collapse in LLM Pre-Training Data via Diversified File Selection","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-16T05:30:51.084920Z"},"links":{"citing_paper":"/paper/2504.20644"},"observation_digest":"sha256:754039a20538034bddb79082ed676d62a15c51c87f712ecd08c25a5b832ad565","observation_id":"401eba90-a22b-49bc-8beb-75a504661805","resolution":{"observed_at":"2026-08-16T05:30:51.084920Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2005.14165","last_updated":"2020-07-22T19:47:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-05-28T17:29:03Z","title":"Language Models are Few-Shot Learners","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2005.14165","snapshot_observed_at":"2026-08-16T05:30:51.094864Z","title":"Language models are few-shot learners","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2504.20644","last_updated":"2025-04-29T11:13:18Z","snapshot_observed_at":"2026-08-16T05:21:46.500638Z","submitted_at":"2025-04-29T11:13:18Z","title":"Combatting Dimensional Collapse in LLM Pre-Training Data via Diversified File Selection","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-16T05:30:51.094864Z"},"links":{"cited_paper":"/paper/2005.14165","citing_paper":"/paper/2504.20644"},"observation_digest":"sha256:d9b2714128e733586ba12ede8bb8353127e770125041c052b93ee1363cb86377","observation_id":"0c09086e-f683-45b7-b7d3-824898019344","resolution":{"observed_at":"2026-08-16T05:30:51.094864Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:30:51.099354Z","title":"A simple framework for contrastive learning of visual representations","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2504.20644","last_updated":"2025-04-29T11:13:18Z","snapshot_observed_at":"2026-08-16T05:21:46.500638Z","submitted_at":"2025-04-29T11:13:18Z","title":"Combatting Dimensional Collapse in LLM Pre-Training Data via Diversified File Selection","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-16T05:30:51.099354Z"},"links":{"citing_paper":"/paper/2504.20644"},"observation_digest":"sha256:92d3600abba84196ffb5927be064e31f5cd2c152b28dd641f53e53a6c52d2196","observation_id":"3872391c-17c8-4f64-9182-24b0890c0ee1","resolution":{"observed_at":"2026-08-16T05:30:51.099354Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:30:52.436541Z","title":"Palm: Scaling language modeling with pathways","venue":null,"work_id":"923dc644-baf7-4db8-bb29-05032bf24f60","year":2023},"citing_paper":{"arxiv_id":"2504.20644","last_updated":"2025-04-29T11:13:18Z","snapshot_observed_at":"2026-08-16T05:21:46.500638Z","submitted_at":"2025-04-29T11:13:18Z","title":"Combatting Dimensional Collapse in LLM Pre-Training Data via Diversified File Selection","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-16T05:30:51.103384Z"},"links":{"citing_paper":"/paper/2504.20644"},"observation_digest":"sha256:f5652938d5176913a57823bd6016ef42ed36aab3d66048b654a114de474d25a6","observation_id":"acd8eab3-defc-4b34-9d6b-33b0e3df0fae","resolution":{"observed_at":"2026-08-16T05:30:52.441585Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:30:52.420000Z","title":"Palm: Scaling language modeling with pathways","venue":null,"work_id":"4130c954-9756-47ea-9d08-c220a614126a","year":2023},"citing_paper":{"arxiv_id":"2504.20644","last_updated":"2025-04-29T11:13:18Z","snapshot_observed_at":"2026-08-16T05:21:46.500638Z","submitted_at":"2025-04-29T11:13:18Z","title":"Combatting Dimensional Collapse in LLM Pre-Training Data via Diversified File Selection","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-16T05:30:51.107446Z"},"links":{"citing_paper":"/paper/2504.20644"},"observation_digest":"sha256:bc36cbb3f9ec65262795c2bd6942f219af4ae07de4783bcc4064083c101194e9","observation_id":"ce7f42c2-5b8f-4251-b767-e2d0f10d10e9","resolution":{"observed_at":"2026-08-16T05:30:52.426212Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1905.10044","last_updated":"2019-05-24T05:48:49Z","snapshot_observed_at":"2026-08-14T15:52:43.138964Z","submitted_at":"2019-05-24T05:48:49Z","title":"BoolQ: Exploring the Surprising Difficulty of Natural Yes/No Questions","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1905.10044","snapshot_observed_at":"2026-08-16T05:30:51.111782Z","title":"Boolq: Exploring the surprising difficulty of natural yes/no questions","venue":null,"work_id":null,"year":1905},"citing_paper":{"arxiv_id":"2504.20644","last_updated":"2025-04-29T11:13:18Z","snapshot_observed_at":"2026-08-16T05:21:46.500638Z","submitted_at":"2025-04-29T11:13:18Z","title":"Combatting Dimensional Collapse in LLM Pre-Training Data via Diversified File Selection","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-16T05:30:51.111782Z"},"links":{"cited_paper":"/paper/1905.10044","citing_paper":"/paper/2504.20644"},"observation_digest":"sha256:85dcbbf68477a25c2f9d76da61157bf336399125192c543624a31bc5cf0b42bc","observation_id":"6b24961f-3bd3-451c-a56a-5d80ebf19786","resolution":{"observed_at":"2026-08-16T05:30:51.111782Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1803.05457","last_updated":"2018-03-14T18:04:21Z","snapshot_observed_at":"2026-08-14T19:36:07.505691Z","submitted_at":"2018-03-14T18:04:21Z","title":"Think you have Solved Question Answering? Try ARC, the AI2 Reasoning Challenge","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1803.05457","snapshot_observed_at":"2026-08-16T05:30:51.116277Z","title":"Think you have solved question answering? try arc, the ai2 reasoning challenge","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2504.20644","last_updated":"2025-04-29T11:13:18Z","snapshot_observed_at":"2026-08-16T05:21:46.500638Z","submitted_at":"2025-04-29T11:13:18Z","title":"Combatting Dimensional Collapse in LLM Pre-Training Data via Diversified File Selection","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-16T05:30:51.116277Z"},"links":{"cited_paper":"/paper/1803.05457","citing_paper":"/paper/2504.20644"},"observation_digest":"sha256:631f3321931d1381a51e973cd61300b07a4c0c15d162e1d21fcc8b6f6b601953","observation_id":"e4cbf5c1-a9dc-4e7e-947b-3e3b228165a7","resolution":{"observed_at":"2026-08-16T05:30:51.116277Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:30:51.120449Z","title":"Redpajama: an open dataset for training large language models, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.20644","last_updated":"2025-04-29T11:13:18Z","snapshot_observed_at":"2026-08-16T05:21:46.500638Z","submitted_at":"2025-04-29T11:13:18Z","title":"Combatting Dimensional Collapse in LLM Pre-Training Data via Diversified File Selection","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-16T05:30:51.120449Z"},"links":{"citing_paper":"/paper/2504.20644"},"observation_digest":"sha256:3d1fcc10609c63f310d8fc8491c28059de898b51299fd5fad088f0d747214045","observation_id":"a5ff426c-84c9-4ec4-a34e-ce48bd9f6ec5","resolution":{"observed_at":"2026-08-16T05:30:51.120449Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:30:51.124327Z","title":"Flashattention: Fast and memory-efficient exact attention with io-awareness","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2504.20644","last_updated":"2025-04-29T11:13:18Z","snapshot_observed_at":"2026-08-16T05:21:46.500638Z","submitted_at":"2025-04-29T11:13:18Z","title":"Combatting Dimensional Collapse in LLM Pre-Training Data via Diversified File Selection","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-16T05:30:51.124327Z"},"links":{"citing_paper":"/paper/2504.20644"},"observation_digest":"sha256:372ff63d446370319ab10e42399c2180023877528fe046eb5efe44e4a94e20e8","observation_id":"1dd56460-7699-42e3-8c55-d167d764af5e","resolution":{"observed_at":"2026-08-16T05:30:51.124327Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:30:52.381358Z","title":"Submodular meets spectral: Greedy algorithms for subset selection, sparse approximation and dictionary selection","venue":null,"work_id":"01fee5fe-9287-4a08-9a5f-bf748d60c6d5","year":2011},"citing_paper":{"arxiv_id":"2504.20644","last_updated":"2025-04-29T11:13:18Z","snapshot_observed_at":"2026-08-16T05:21:46.500638Z","submitted_at":"2025-04-29T11:13:18Z","title":"Combatting Dimensional Collapse in LLM Pre-Training Data via Diversified File Selection","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-16T05:30:51.128088Z"},"links":{"citing_paper":"/paper/2504.20644"},"observation_digest":"sha256:64a9a931b5274127b2d1192a715eca54562f836051c983768c8dd9e368a928af","observation_id":"89546f5e-7a33-4057-baed-ff695da3c79e","resolution":{"observed_at":"2026-08-16T05:30:52.387345Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.18983","last_updated":"2024-06-03T11:16:55Z","snapshot_observed_at":"2026-08-16T13:48:14.942559Z","submitted_at":"2024-05-29T10:56:13Z","title":"Federated Learning under Partially Class-Disjoint Data via Manifold Reshaping","version":2},"cited_work":{"arxiv_id":"2405.18983","doi":null,"metadata_source":"pith","pith_arxiv_id":"2405.18983","snapshot_observed_at":"2026-08-16T05:30:51.836841Z","title":"Federated Learning under Partially Class-Disjoint Data via Manifold Reshaping","venue":"cs.LG","work_id":"d176788f-0ba9-484e-983a-ea29d05513b4","year":2024},"citing_paper":{"arxiv_id":"2504.20644","last_updated":"2025-04-29T11:13:18Z","snapshot_observed_at":"2026-08-16T05:21:46.500638Z","submitted_at":"2025-04-29T11:13:18Z","title":"Combatting Dimensional Collapse in LLM Pre-Training Data via Diversified File Selection","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-16T05:30:51.132025Z"},"links":{"cited_paper":"/paper/2405.18983","citing_paper":"/paper/2504.20644"},"observation_digest":"sha256:c50238ffa30477fc0c2eefe308e1463dc08cc99da5dcf68779bca1c481523f29","observation_id":"f8d688aa-4196-45ef-b788-afc4407e9a62","resolution":{"observed_at":"2026-08-16T05:30:51.844242Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:30:52.367323Z","title":"Submodular functions and optimization","venue":null,"work_id":"ca674f8d-1791-4558-a9b7-e5c2389be850","year":2005},"citing_paper":{"arxiv_id":"2504.20644","last_updated":"2025-04-29T11:13:18Z","snapshot_observed_at":"2026-08-16T05:21:46.500638Z","submitted_at":"2025-04-29T11:13:18Z","title":"Combatting Dimensional Collapse in LLM Pre-Training Data via Diversified File Selection","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-16T05:30:51.136741Z"},"links":{"citing_paper":"/paper/2504.20644"},"observation_digest":"sha256:c1b19e547a3f97d51645792b4d96b285b8dff1801988ac8e53189ec9dc771968","observation_id":"0bff20af-4aa8-4e87-92af-7a0604fee5b8","resolution":{"observed_at":"2026-08-16T05:30:52.371768Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:30:51.140846Z","title":"A framework for few-shot language model evaluation, 07 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.20644","last_updated":"2025-04-29T11:13:18Z","snapshot_observed_at":"2026-08-16T05:21:46.500638Z","submitted_at":"2025-04-29T11:13:18Z","title":"Combatting Dimensional Collapse in LLM Pre-Training Data via Diversified File Selection","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-16T05:30:51.140846Z"},"links":{"citing_paper":"/paper/2504.20644"},"observation_digest":"sha256:b2094bcfabf260bb84cb829101975eba5ff5d9418eb6111f883de0e822a06b08","observation_id":"781d21a1-4357-4a66-a2d3-d5aca864bda1","resolution":{"observed_at":"2026-08-16T05:30:51.140846Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:30:51.144687Z","title":"Openllama: An open reproduction of llama, May 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.20644","last_updated":"2025-04-29T11:13:18Z","snapshot_observed_at":"2026-08-16T05:21:46.500638Z","submitted_at":"2025-04-29T11:13:18Z","title":"Combatting Dimensional Collapse in LLM Pre-Training Data via Diversified File Selection","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-16T05:30:51.144687Z"},"links":{"citing_paper":"/paper/2504.20644"},"observation_digest":"sha256:c779c61569cb55626c9b4e82c88663680a2c2ed44aaa20f1f24aa17814f7dcab","observation_id":"190622e7-72e1-4d14-9342-b40a1ceea2c1","resolution":{"observed_at":"2026-08-16T05:30:51.144687Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:30:52.342230Z","title":"Online submodular set cover, ranking, and repeated active learning","venue":null,"work_id":"776ac065-2179-4155-9b79-f25e14ae0f02","year":2011},"citing_paper":{"arxiv_id":"2504.20644","last_updated":"2025-04-29T11:13:18Z","snapshot_observed_at":"2026-08-16T05:21:46.500638Z","submitted_at":"2025-04-29T11:13:18Z","title":"Combatting Dimensional Collapse in LLM Pre-Training Data via Diversified File Selection","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-16T05:30:51.148875Z"},"links":{"citing_paper":"/paper/2504.20644"},"observation_digest":"sha256:8a7e0bcc871c1d196d3b001b94535a920dac48032409cb45a018d723bfa5f7da","observation_id":"6de07415-eadb-446c-a28d-dfc864cab124","resolution":{"observed_at":"2026-08-16T05:30:52.347645Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:30:51.153127Z","title":"Measuring massive multitask language understanding","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2504.20644","last_updated":"2025-04-29T11:13:18Z","snapshot_observed_at":"2026-08-16T05:21:46.500638Z","submitted_at":"2025-04-29T11:13:18Z","title":"Combatting Dimensional Collapse in LLM Pre-Training Data via Diversified File Selection","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-16T05:30:51.153127Z"},"links":{"citing_paper":"/paper/2504.20644"},"observation_digest":"sha256:68297d49863b32f0cba548700e0c9c08670a38a7246d3cbc88ceac5e24e90952","observation_id":"3f378bde-5184-4557-bbc9-41ab0274d9ac","resolution":{"observed_at":"2026-08-16T05:30:51.153127Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.15556","last_updated":"2022-03-29T13:38:03Z","snapshot_observed_at":"2026-08-09T19:52:33.533277Z","submitted_at":"2022-03-29T13:38:03Z","title":"Training Compute-Optimal Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.15556","snapshot_observed_at":"2026-08-16T05:30:51.157063Z","title":"Training compute-optimal large language models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2504.20644","last_updated":"2025-04-29T11:13:18Z","snapshot_observed_at":"2026-08-16T05:21:46.500638Z","submitted_at":"2025-04-29T11:13:18Z","title":"Combatting Dimensional Collapse in LLM Pre-Training Data via Diversified File Selection","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-16T05:30:51.157063Z"},"links":{"cited_paper":"/paper/2203.15556","citing_paper":"/paper/2504.20644"},"observation_digest":"sha256:112123a363aa3adab19cd626710065cc17acc2045799bfbe289480bd323bff6a","observation_id":"544411a7-1947-44a6-9563-f7eb37236986","resolution":{"observed_at":"2026-08-16T05:30:51.157063Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:30:52.320361Z","title":"Diversified batch selection for training acceleration","venue":null,"work_id":"fd7e832b-9623-422d-b170-3fc0007f1413","year":2024},"citing_paper":{"arxiv_id":"2504.20644","last_updated":"2025-04-29T11:13:18Z","snapshot_observed_at":"2026-08-16T05:21:46.500638Z","submitted_at":"2025-04-29T11:13:18Z","title":"Combatting Dimensional Collapse in LLM Pre-Training Data via Diversified File Selection","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-16T05:30:51.161412Z"},"links":{"citing_paper":"/paper/2504.20644"},"observation_digest":"sha256:2ff6a79a5d7f50a3162f5894a8e446981f87fe5005498d06b29c599ce65496f7","observation_id":"90bd4694-d121-4e56-908c-16a5a54d97f8","resolution":{"observed_at":"2026-08-16T05:30:52.324646Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2112.09118","last_updated":"2022-08-29T12:17:32Z","snapshot_observed_at":"2026-08-14T13:19:21.742321Z","submitted_at":"2021-12-16T18:57:37Z","title":"Unsupervised Dense Information Retrieval with Contrastive Learning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2112.09118","snapshot_observed_at":"2026-08-16T05:30:51.165766Z","title":"Unsupervised dense information retrieval with contrastive learning, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2504.20644","last_updated":"2025-04-29T11:13:18Z","snapshot_observed_at":"2026-08-16T05:21:46.500638Z","submitted_at":"2025-04-29T11:13:18Z","title":"Combatting Dimensional Collapse in LLM Pre-Training Data via Diversified File Selection","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-16T05:30:51.165766Z"},"links":{"cited_paper":"/paper/2112.09118","citing_paper":"/paper/2504.20644"},"observation_digest":"sha256:9a55857e173108070fb247176efc39e3e4370dfe079e1ba0fa07901244727c46","observation_id":"2686885f-a28d-422c-bbfa-47f74bc955de","resolution":{"observed_at":"2026-08-16T05:30:51.165766Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:30:52.306690Z","title":"Efficient data subset selection to generalize training across models: transductive and inductive networks","venue":null,"work_id":"26fde580-9f27-42f7-ba0a-48398dc0b8c3","year":2024},"citing_paper":{"arxiv_id":"2504.20644","last_updated":"2025-04-29T11:13:18Z","snapshot_observed_at":"2026-08-16T05:21:46.500638Z","submitted_at":"2025-04-29T11:13:18Z","title":"Combatting Dimensional Collapse in LLM Pre-Training Data via Diversified File Selection","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-16T05:30:51.170684Z"},"links":{"citing_paper":"/paper/2504.20644"},"observation_digest":"sha256:e01886d204831b0523742af20186ef9076ad3363b42e6c0af687373fb517e3e2","observation_id":"71b621db-220e-47a2-9b5d-56185c3b8f40","resolution":{"observed_at":"2026-08-16T05:30:52.311709Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:30:52.292414Z","title":"Fine-tuning with reserved majority for noise reduction","venue":null,"work_id":"ac22efae-4450-46cd-9dae-4737203a0114","year":2025},"citing_paper":{"arxiv_id":"2504.20644","last_updated":"2025-04-29T11:13:18Z","snapshot_observed_at":"2026-08-16T05:21:46.500638Z","submitted_at":"2025-04-29T11:13:18Z","title":"Combatting Dimensional Collapse in LLM Pre-Training Data via Diversified File Selection","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-16T05:30:51.175182Z"},"links":{"citing_paper":"/paper/2504.20644"},"observation_digest":"sha256:ef67a39fb55b87928c3f0d3d7cf23e02c4fe2e7210918e281ed67cd0ddf7204b","observation_id":"80c78806-dd03-4a8f-a545-fb77f4502269","resolution":{"observed_at":"2026-08-16T05:30:52.297537Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:30:52.277679Z","title":"Understanding dimensional collapse in contrastive self-supervised learning","venue":null,"work_id":"18bca925-1c58-424d-8cb8-cfecd3116946","year":2022},"citing_paper":{"arxiv_id":"2504.20644","last_updated":"2025-04-29T11:13:18Z","snapshot_observed_at":"2026-08-16T05:21:46.500638Z","submitted_at":"2025-04-29T11:13:18Z","title":"Combatting Dimensional Collapse in LLM Pre-Training Data via Diversified File Selection","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-16T05:30:51.179603Z"},"links":{"citing_paper":"/paper/2504.20644"},"observation_digest":"sha256:635fef5d79d539c528e821be47950f1dfe3917c3a57637ca13dd13085bd6e058","observation_id":"2fa9edcc-d775-4b3e-b69a-07b323862b4b","resolution":{"observed_at":"2026-08-16T05:30:52.282169Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:30:52.264056Z","title":"Orient: Submodular mutual information measures for data subset selection under distribution shift","venue":null,"work_id":"4c3c8525-dc7b-44ef-b8b3-817644278048","year":2022},"citing_paper":{"arxiv_id":"2504.20644","last_updated":"2025-04-29T11:13:18Z","snapshot_observed_at":"2026-08-16T05:21:46.500638Z","submitted_at":"2025-04-29T11:13:18Z","title":"Combatting Dimensional Collapse in LLM Pre-Training Data via Diversified File Selection","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-16T05:30:51.183402Z"},"links":{"citing_paper":"/paper/2504.20644"},"observation_digest":"sha256:312d3a407af6ced55e4fef374ffc2f6a625633a0d2274dc409d3354d77c4f016","observation_id":"fe5c5e13-89fc-4b64-9d17-d2a4f238011f","resolution":{"observed_at":"2026-08-16T05:30:52.268513Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:30:52.249379Z","title":"Learning from less data: A unified data subset selection and active learning framework for computer vision","venue":null,"work_id":"f6900c27-e0f1-4df6-b6cd-1ccda9f34721","year":2019},"citing_paper":{"arxiv_id":"2504.20644","last_updated":"2025-04-29T11:13:18Z","snapshot_observed_at":"2026-08-16T05:21:46.500638Z","submitted_at":"2025-04-29T11:13:18Z","title":"Combatting Dimensional Collapse in LLM Pre-Training Data via Diversified File Selection","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-16T05:30:51.187512Z"},"links":{"citing_paper":"/paper/2504.20644"},"observation_digest":"sha256:8ea9f9964eee87f1d4d15186c7383763aec3580326d3d9a82c86b69609ce194e","observation_id":"c5b75316-52ff-4f56-ab8e-2c3044f8b87c","resolution":{"observed_at":"2026-08-16T05:30:52.254106Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:30:52.235930Z","title":"Prism: A rich class of parameterized submodular information measures for guided data subset selection","venue":null,"work_id":"e217e7ce-e979-4575-9965-dde6545392e1","year":2022},"citing_paper":{"arxiv_id":"2504.20644","last_updated":"2025-04-29T11:13:18Z","snapshot_observed_at":"2026-08-16T05:21:46.500638Z","submitted_at":"2025-04-29T11:13:18Z","title":"Combatting Dimensional Collapse in LLM Pre-Training Data via Diversified File Selection","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-16T05:30:51.191428Z"},"links":{"citing_paper":"/paper/2504.20644"},"observation_digest":"sha256:e0c554af57cdaf21a447a7bff098877e4175c2906ea835281c8c2684cf8518a8","observation_id":"19622320-2a4c-4b3f-98f5-b294cb90eab0","resolution":{"observed_at":"2026-08-16T05:30:52.240652Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:30:52.222977Z","title":"Submodular function maximization","venue":null,"work_id":"a03b4441-b752-45b5-a0e4-d2e7bf7051b6","year":2014},"citing_paper":{"arxiv_id":"2504.20644","last_updated":"2025-04-29T11:13:18Z","snapshot_observed_at":"2026-08-16T05:21:46.500638Z","submitted_at":"2025-04-29T11:13:18Z","title":"Combatting Dimensional Collapse in LLM Pre-Training Data via Diversified File Selection","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-16T05:30:51.195859Z"},"links":{"citing_paper":"/paper/2504.20644"},"observation_digest":"sha256:5a839f41b2d5677808f68f11410e67539757fbcbe5ccc0f92df1e595083f361b","observation_id":"422b22ed-05df-4446-b13e-7b262371d5e6","resolution":{"observed_at":"2026-08-16T05:30:52.227226Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:30:51.201044Z","title":"An end-to-end submodular framework for data-efficient in-context learning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.20644","last_updated":"2025-04-29T11:13:18Z","snapshot_observed_at":"2026-08-16T05:21:46.500638Z","submitted_at":"2025-04-29T11:13:18Z","title":"Combatting Dimensional Collapse in LLM Pre-Training Data via Diversified File Selection","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-16T05:30:51.201044Z"},"links":{"citing_paper":"/paper/2504.20644"},"observation_digest":"sha256:e106fd3fec7c02972eebef8bdf484332828af32ad4a5938e2f8dc45f802edeff","observation_id":"ecd9dd2c-12e5-4d93-92cf-529c77c43335","resolution":{"observed_at":"2026-08-16T05:30:51.201044Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:30:52.198209Z","title":"Disentangling hate in online memes","venue":null,"work_id":"7a16cad6-ec85-4512-aba9-71b40576cfa9","year":2021},"citing_paper":{"arxiv_id":"2504.20644","last_updated":"2025-04-29T11:13:18Z","snapshot_observed_at":"2026-08-16T05:21:46.500638Z","submitted_at":"2025-04-29T11:13:18Z","title":"Combatting Dimensional Collapse in LLM Pre-Training Data via Diversified File Selection","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-16T05:30:51.205339Z"},"links":{"citing_paper":"/paper/2504.20644"},"observation_digest":"sha256:53868209ac8ee68c4541ec6cf2b9a304c7b545b54318d99b16c7dbf7c282ba2b","observation_id":"83f75f37-5dd5-4588-a2cb-77014231d3cf","resolution":{"observed_at":"2026-08-16T05:30:52.202388Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.06161","last_updated":"2023-12-13T14:44:10Z","snapshot_observed_at":"2026-07-06T15:25:35.930688Z","submitted_at":"2023-05-09T08:16:42Z","title":"StarCoder: may the source be with you!","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.06161","snapshot_observed_at":"2026-08-16T05:30:51.209949Z","title":"Starcoder: may the source be with you! arXiv preprint arXiv:2305.06161, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.20644","last_updated":"2025-04-29T11:13:18Z","snapshot_observed_at":"2026-08-16T05:21:46.500638Z","submitted_at":"2025-04-29T11:13:18Z","title":"Combatting Dimensional Collapse in LLM Pre-Training Data via Diversified File Selection","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-16T05:30:51.209949Z"},"links":{"cited_paper":"/paper/2305.06161","citing_paper":"/paper/2504.20644"},"observation_digest":"sha256:0aaf3bd00fde42b58b793454d2791cb813e6a5f3d2e702358cd89093670ea6dc","observation_id":"a441dafb-3f4c-47fc-94b7-e955e7d802c8","resolution":{"observed_at":"2026-08-16T05:30:51.209949Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:30:52.184685Z","title":null,"venue":null,"work_id":"c1d64e2a-2739-41f8-b6f1-a11656a2f397","year":2023},"citing_paper":{"arxiv_id":"2504.20644","last_updated":"2025-04-29T11:13:18Z","snapshot_observed_at":"2026-08-16T05:21:46.500638Z","submitted_at":"2025-04-29T11:13:18Z","title":"Combatting Dimensional Collapse in LLM Pre-Training Data via Diversified File Selection","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-16T05:30:51.214803Z"},"links":{"citing_paper":"/paper/2504.20644"},"observation_digest":"sha256:ebf9eed679e3d67b9c9555817fff2f02a6df5d91c073d4f01c4882fe710f57a6","observation_id":"7ecc4656-14fe-4df0-88ef-3fcfe0521d50","resolution":{"observed_at":"2026-08-16T05:30:52.189724Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:30:52.171109Z","title":"Optimal selection of limited vocabulary speech corpora","venue":null,"work_id":"aac46237-d40d-4790-9bc8-0e48bbe90b8d","year":2011},"citing_paper":{"arxiv_id":"2504.20644","last_updated":"2025-04-29T11:13:18Z","snapshot_observed_at":"2026-08-16T05:21:46.500638Z","submitted_at":"2025-04-29T11:13:18Z","title":"Combatting Dimensional Collapse in LLM Pre-Training Data via Diversified File Selection","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-16T05:30:51.219274Z"},"links":{"citing_paper":"/paper/2504.20644"},"observation_digest":"sha256:331ce76dd68358c12819753f466b83818b239467b42ad08890eafc4952836a67","observation_id":"d3423183-41ab-4039-b9f6-c49cf701bd3c","resolution":{"observed_at":"2026-08-16T05:30:52.175478Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:30:51.223467Z","title":"Decoupled weight decay regularization","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2504.20644","last_updated":"2025-04-29T11:13:18Z","snapshot_observed_at":"2026-08-16T05:21:46.500638Z","submitted_at":"2025-04-29T11:13:18Z","title":"Combatting Dimensional Collapse in LLM Pre-Training Data via Diversified File Selection","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-16T05:30:51.223467Z"},"links":{"citing_paper":"/paper/2504.20644"},"observation_digest":"sha256:6ebdce9b1febaeea2f7a2f4d7431d1990891695a8d69931b72ef59f3f932628d","observation_id":"682185a4-771f-42b8-8821-fb30803e3569","resolution":{"observed_at":"2026-08-16T05:30:51.223467Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:30:51.227938Z","title":"Can a suit of armor conduct electricity? a new dataset for open book question answering","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2504.20644","last_updated":"2025-04-29T11:13:18Z","snapshot_observed_at":"2026-08-16T05:21:46.500638Z","submitted_at":"2025-04-29T11:13:18Z","title":"Combatting Dimensional Collapse in LLM Pre-Training Data via Diversified File Selection","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-16T05:30:51.227938Z"},"links":{"citing_paper":"/paper/2504.20644"},"observation_digest":"sha256:95694955761e51c49d87822a2ff6c215bdd55180b6561c8261305c9437a14afd","observation_id":"f3a420e8-c1bd-4ec2-a68f-5bffdd1366b4","resolution":{"observed_at":"2026-08-16T05:30:51.227938Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:30:51.232354Z","title":"An analysis of approximations for maximizing submodular set functions—i","venue":null,"work_id":null,"year":1978},"citing_paper":{"arxiv_id":"2504.20644","last_updated":"2025-04-29T11:13:18Z","snapshot_observed_at":"2026-08-16T05:21:46.500638Z","submitted_at":"2025-04-29T11:13:18Z","title":"Combatting Dimensional Collapse in LLM Pre-Training Data via Diversified File Selection","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-16T05:30:51.232354Z"},"links":{"citing_paper":"/paper/2504.20644"},"observation_digest":"sha256:52152df13f76786aa5119ec2f1bf3b3402b38bd08e1a82951051c0b6407e4fbc","observation_id":"526f3393-275b-4f40-9bc7-56aa09a48807","resolution":{"observed_at":"2026-08-16T05:30:51.232354Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.05699","last_updated":"2024-06-08T06:13:55Z","snapshot_observed_at":"2026-08-16T14:20:13.072749Z","submitted_at":"2024-02-08T14:21:03Z","title":"Self-Alignment of Large Language Models via Monopolylogue-based Social Scene Simulation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.05699","snapshot_observed_at":"2026-08-16T05:30:51.236689Z","title":"Self-alignment of large language models via monopolylogue-based social scene simulation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.20644","last_updated":"2025-04-29T11:13:18Z","snapshot_observed_at":"2026-08-16T05:21:46.500638Z","submitted_at":"2025-04-29T11:13:18Z","title":"Combatting Dimensional Collapse in LLM Pre-Training Data via Diversified File Selection","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-16T05:30:51.236689Z"},"links":{"cited_paper":"/paper/2402.05699","citing_paper":"/paper/2504.20644"},"observation_digest":"sha256:88488282cd9fa1769d34ba87745537b466aafa4e418f3d0b9fe33eee8f828371","observation_id":"7b6db232-7e28-48f4-aa34-e5428dd1fa60","resolution":{"observed_at":"2026-08-16T05:30:51.236689Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:30:51.241655Z","title":"Pytorch: An imperative style, high-performance deep learning library","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2504.20644","last_updated":"2025-04-29T11:13:18Z","snapshot_observed_at":"2026-08-16T05:21:46.500638Z","submitted_at":"2025-04-29T11:13:18Z","title":"Combatting Dimensional Collapse in LLM Pre-Training Data via Diversified File Selection","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-16T05:30:51.241655Z"},"links":{"citing_paper":"/paper/2504.20644"},"observation_digest":"sha256:9e256da4472f3771966608220b3cd6b65fc49bc820a0206c50d75c61ba63d2eb","observation_id":"09ac41d3-a36f-4b1f-88b2-72069a8b9ac4","resolution":{"observed_at":"2026-08-16T05:30:51.241655Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2104.10350","last_updated":"2021-04-23T14:26:29Z","snapshot_observed_at":"2026-08-16T05:11:57.545339Z","submitted_at":"2021-04-21T04:44:25Z","title":"Carbon Emissions and Large Neural Network Training","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.10350","snapshot_observed_at":"2026-08-16T05:30:51.245886Z","title":"Carbon emissions and large neural network training","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2504.20644","last_updated":"2025-04-29T11:13:18Z","snapshot_observed_at":"2026-08-16T05:21:46.500638Z","submitted_at":"2025-04-29T11:13:18Z","title":"Combatting Dimensional Collapse in LLM Pre-Training Data via Diversified File Selection","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-16T05:30:51.245886Z"},"links":{"cited_paper":"/paper/2104.10350","citing_paper":"/paper/2504.20644"},"observation_digest":"sha256:82f9e656fa97565ceb1e19d8bcfbf4b3d308aef5d8451f4d9521a9f4396ea20b","observation_id":"f98d9ac1-1b97-4ece-8339-4362c6abfe1a","resolution":{"observed_at":"2026-08-16T05:30:51.245886Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:30:51.250808Z","title":"Language models are unsupervised multitask learners","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2504.20644","last_updated":"2025-04-29T11:13:18Z","snapshot_observed_at":"2026-08-16T05:21:46.500638Z","submitted_at":"2025-04-29T11:13:18Z","title":"Combatting Dimensional Collapse in LLM Pre-Training Data via Diversified File Selection","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-16T05:30:51.250808Z"},"links":{"citing_paper":"/paper/2504.20644"},"observation_digest":"sha256:c063e81eef0a7f5b0028fe65041ccf32b8d4e3d4532384ed8066732db39e73d9","observation_id":"2792d232-6c6e-4e8c-b23d-b254d6076069","resolution":{"observed_at":"2026-08-16T05:30:51.250808Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:30:51.254747Z","title":"Learning transferable visual models from natural language supervision","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2504.20644","last_updated":"2025-04-29T11:13:18Z","snapshot_observed_at":"2026-08-16T05:21:46.500638Z","submitted_at":"2025-04-29T11:13:18Z","title":"Combatting Dimensional Collapse in LLM Pre-Training Data via Diversified File Selection","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-16T05:30:51.254747Z"},"links":{"citing_paper":"/paper/2504.20644"},"observation_digest":"sha256:316994b2c4e447229504d3c2978a1f4f427c23a7a4b953640803a01b5494777c","observation_id":"6108a255-42df-488f-9c88-cf7e30e234a2","resolution":{"observed_at":"2026-08-16T05:30:51.254747Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2112.11446","last_updated":"2022-01-21T18:39:38Z","snapshot_observed_at":"2026-08-09T14:52:01.161814Z","submitted_at":"2021-12-08T19:41:47Z","title":"Scaling Language Models: Methods, Analysis & Insights from Training Gopher","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2112.11446","snapshot_observed_at":"2026-08-16T05:30:51.258621Z","title":"Scaling language models: Methods, analysis & insights from training gopher","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2504.20644","last_updated":"2025-04-29T11:13:18Z","snapshot_observed_at":"2026-08-16T05:21:46.500638Z","submitted_at":"2025-04-29T11:13:18Z","title":"Combatting Dimensional Collapse in LLM Pre-Training Data via Diversified File Selection","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-16T05:30:51.258621Z"},"links":{"cited_paper":"/paper/2112.11446","citing_paper":"/paper/2504.20644"},"observation_digest":"sha256:1a69ce5c03df9d834d2928d0dedbb42482fea8e28ec8f211e520f87d15a0ae37","observation_id":"b8175b6e-710d-41ef-9067-9860ee854df5","resolution":{"observed_at":"2026-08-16T05:30:51.258621Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:30:52.101972Z","title":"Ingenious: Using informative data subsets for efficient pre-training of language models","venue":null,"work_id":"bf9bb526-bfef-42b9-b6c1-be322179baf3","year":2023},"citing_paper":{"arxiv_id":"2504.20644","last_updated":"2025-04-29T11:13:18Z","snapshot_observed_at":"2026-08-16T05:21:46.500638Z","submitted_at":"2025-04-29T11:13:18Z","title":"Combatting Dimensional Collapse in LLM Pre-Training Data via Diversified File Selection","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-16T05:30:51.262715Z"},"links":{"citing_paper":"/paper/2504.20644"},"observation_digest":"sha256:77011678e04a4d43d7ee3a237b5590e22b4fcb21042c0893bb727fee8cd423b0","observation_id":"6395a1e5-758b-4bf2-8c1a-0cc6b656e6cd","resolution":{"observed_at":"2026-08-16T05:30:52.107986Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:30:51.266701Z","title":"Winogrande: An adversarial winograd schema challenge at scale","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2504.20644","last_updated":"2025-04-29T11:13:18Z","snapshot_observed_at":"2026-08-16T05:21:46.500638Z","submitted_at":"2025-04-29T11:13:18Z","title":"Combatting Dimensional Collapse in LLM Pre-Training Data via Diversified File Selection","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-16T05:30:51.266701Z"},"links":{"citing_paper":"/paper/2504.20644"},"observation_digest":"sha256:34794c69c5eda175c7908713ef7e3470a3523e6fe73aaeced0985b320968e812","observation_id":"e9b234a9-7c0f-42f9-a2ef-4728ea4a946f","resolution":{"observed_at":"2026-08-16T05:30:51.266701Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:30:52.076697Z","title":"Discrete location theory","venue":null,"work_id":"647eb9fd-b7e9-441e-b7c6-d378605ef82c","year":1991},"citing_paper":{"arxiv_id":"2504.20644","last_updated":"2025-04-29T11:13:18Z","snapshot_observed_at":"2026-08-16T05:21:46.500638Z","submitted_at":"2025-04-29T11:13:18Z","title":"Combatting Dimensional Collapse in LLM Pre-Training Data via Diversified File Selection","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-16T05:30:51.270599Z"},"links":{"citing_paper":"/paper/2504.20644"},"observation_digest":"sha256:07a0fe990bc2427a64055bbef8b1b5d7a3b6c192c53114c4d8e7c60fac6850f5","observation_id":"f27909bc-2443-4448-94c1-3ac90672ba1c","resolution":{"observed_at":"2026-08-16T05:30:52.082972Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:30:52.062577Z","title":"Discrete location theory","venue":null,"work_id":"0e9fb1ea-967a-4231-9c12-954abdcac3f9","year":1991},"citing_paper":{"arxiv_id":"2504.20644","last_updated":"2025-04-29T11:13:18Z","snapshot_observed_at":"2026-08-16T05:21:46.500638Z","submitted_at":"2025-04-29T11:13:18Z","title":"Combatting Dimensional Collapse in LLM Pre-Training Data via Diversified File Selection","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-16T05:30:51.274538Z"},"links":{"citing_paper":"/paper/2504.20644"},"observation_digest":"sha256:2b0ea574a0c934f450c6fe2fd3fac13a0ac0d82097cade54acd64e59eecbaedd","observation_id":"cce8c2a7-9ead-47ce-8acc-67ecd573ac3f","resolution":{"observed_at":"2026-08-16T05:30:52.066896Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2004.14650","last_updated":"2020-09-23T16:34:17Z","snapshot_observed_at":"2026-07-06T09:16:29.097337Z","submitted_at":"2020-04-30T09:15:33Z","title":"Weakly Submodular Function Maximization Using Local Submodularity Ratio","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2004.14650","snapshot_observed_at":"2026-08-16T05:30:51.279509Z","title":"Weakly submodular function maximization using local submodularity ratio","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2504.20644","last_updated":"2025-04-29T11:13:18Z","snapshot_observed_at":"2026-08-16T05:21:46.500638Z","submitted_at":"2025-04-29T11:13:18Z","title":"Combatting Dimensional Collapse in LLM Pre-Training Data via Diversified File Selection","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-16T05:30:51.279509Z"},"links":{"cited_paper":"/paper/2004.14650","citing_paper":"/paper/2504.20644"},"observation_digest":"sha256:d7c300418fc37910579a838d2d93b37fae3bf4b9abb63bcb8c3a290f84d0e2d8","observation_id":"e4017f09-db3e-4c71-bad0-caa8a4d93aec","resolution":{"observed_at":"2026-08-16T05:30:51.279509Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:30:52.047959Z","title":"Mimicking the oracle: An initial phase decorrelation approach for class incremental learning","venue":null,"work_id":"e369e5a9-7b28-48d0-a86d-a243a6569363","year":2022},"citing_paper":{"arxiv_id":"2504.20644","last_updated":"2025-04-29T11:13:18Z","snapshot_observed_at":"2026-08-16T05:21:46.500638Z","submitted_at":"2025-04-29T11:13:18Z","title":"Combatting Dimensional Collapse in LLM Pre-Training Data via Diversified File Selection","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-16T05:30:51.283995Z"},"links":{"citing_paper":"/paper/2504.20644"},"observation_digest":"sha256:026d1292e1858d739064f4667bc9c2b6bc2774060328f67ce1d252f4edb0ff36","observation_id":"f61a7ad2-9d18-4972-9135-8efd4f4ebb4b","resolution":{"observed_at":"2026-08-16T05:30:52.052402Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:30:51.288319Z","title":"Beyond neural scaling laws: beating power law scaling via data pruning","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2504.20644","last_updated":"2025-04-29T11:13:18Z","snapshot_observed_at":"2026-08-16T05:21:46.500638Z","submitted_at":"2025-04-29T11:13:18Z","title":"Combatting Dimensional Collapse in LLM Pre-Training Data via Diversified File Selection","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-16T05:30:51.288319Z"},"links":{"citing_paper":"/paper/2504.20644"},"observation_digest":"sha256:22d25ac09e9c8c9bbb51203d3f6dac11c388361f8edc1a1e7d66d331cc268be6","observation_id":"72d40654-1088-4919-a101-c2635cc3a964","resolution":{"observed_at":"2026-08-16T05:30:51.288319Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2206.04615","last_updated":"2023-06-12T17:51:15Z","snapshot_observed_at":"2026-07-06T13:19:12.109592Z","submitted_at":"2022-06-09T17:05:34Z","title":"Beyond the Imitation Game: Quantifying and extrapolating the capabilities of language models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2206.04615","snapshot_observed_at":"2026-08-16T05:30:51.292149Z","title":"Beyond the imitation game: Quantifying and extrapolating the capabilities of language models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2504.20644","last_updated":"2025-04-29T11:13:18Z","snapshot_observed_at":"2026-08-16T05:21:46.500638Z","submitted_at":"2025-04-29T11:13:18Z","title":"Combatting Dimensional Collapse in LLM Pre-Training Data via Diversified File Selection","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-16T05:30:51.292149Z"},"links":{"cited_paper":"/paper/2206.04615","citing_paper":"/paper/2504.20644"},"observation_digest":"sha256:984ee513003314f0e6dafc143f638509d45a527f4862ba59e80d64eb75631609","observation_id":"0f1ef920-1cb9-4477-9453-ba0bb54abe7c","resolution":{"observed_at":"2026-08-16T05:30:51.292149Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.09261","last_updated":"2022-10-17T17:08:26Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-10-17T17:08:26Z","title":"Challenging BIG-Bench Tasks and Whether Chain-of-Thought Can Solve Them","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.09261","snapshot_observed_at":"2026-08-16T05:30:51.296395Z","title":"Challenging big-bench tasks and whether chain-of-thought can solve them","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2504.20644","last_updated":"2025-04-29T11:13:18Z","snapshot_observed_at":"2026-08-16T05:21:46.500638Z","submitted_at":"2025-04-29T11:13:18Z","title":"Combatting Dimensional Collapse in LLM Pre-Training Data via Diversified File Selection","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-16T05:30:51.296395Z"},"links":{"cited_paper":"/paper/2210.09261","citing_paper":"/paper/2504.20644"},"observation_digest":"sha256:78e649014752676f49a081d958302477bb9bfd58a1782574184bf3d458d3cf50","observation_id":"050e536f-97e7-4336-ac09-e6c678f15308","resolution":{"observed_at":"2026-08-16T05:30:51.296395Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.14251","last_updated":"2025-02-20T03:26:26Z","snapshot_observed_at":"2026-08-16T13:08:07.620792Z","submitted_at":"2024-10-18T08:01:39Z","title":"Synthesizing Post-Training Data for LLMs through Multi-Agent Simulation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.14251","snapshot_observed_at":"2026-08-16T05:30:51.301233Z","title":"Synthesizing post-training data for llms through multi-agent simulation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.20644","last_updated":"2025-04-29T11:13:18Z","snapshot_observed_at":"2026-08-16T05:21:46.500638Z","submitted_at":"2025-04-29T11:13:18Z","title":"Combatting Dimensional Collapse in LLM Pre-Training Data via Diversified File Selection","version":1},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-16T05:30:51.301233Z"},"links":{"cited_paper":"/paper/2410.14251","citing_paper":"/paper/2504.20644"},"observation_digest":"sha256:f74c244ccb3ab693f9db271d9b3bf71757bebd4b9d8bf543ab77b258fa264a02","observation_id":"1a0fd273-b80b-440c-b719-dc018bd5b62f","resolution":{"observed_at":"2026-08-16T05:30:51.301233Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2201.08239","last_updated":"2022-02-10T16:30:11Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-01-20T15:44:37Z","title":"LaMDA: Language Models for Dialog Applications","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2201.08239","snapshot_observed_at":"2026-08-16T05:30:51.305696Z","title":"Lamda: Language models for dialog applications","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2504.20644","last_updated":"2025-04-29T11:13:18Z","snapshot_observed_at":"2026-08-16T05:21:46.500638Z","submitted_at":"2025-04-29T11:13:18Z","title":"Combatting Dimensional Collapse in LLM Pre-Training Data via Diversified File Selection","version":1},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-16T05:30:51.305696Z"},"links":{"cited_paper":"/paper/2201.08239","citing_paper":"/paper/2504.20644"},"observation_digest":"sha256:f588bea0711020fe49f93af98b26ef47e277bb1b9d0ccdc4eb5d67dc31b2a1a7","observation_id":"0f8ebace-c031-4604-a82a-220e75175091","resolution":{"observed_at":"2026-08-16T05:30:51.305696Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:30:52.026988Z","title":"D4: Improving llm pretraining via document de-duplication and diversification","venue":null,"work_id":"65fe9ec6-a09d-4f3b-8d68-cc0fe3435556","year":2023},"citing_paper":{"arxiv_id":"2504.20644","last_updated":"2025-04-29T11:13:18Z","snapshot_observed_at":"2026-08-16T05:21:46.500638Z","submitted_at":"2025-04-29T11:13:18Z","title":"Combatting Dimensional Collapse in LLM Pre-Training Data via Diversified File Selection","version":1},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-08-16T05:30:51.311714Z"},"links":{"citing_paper":"/paper/2504.20644"},"observation_digest":"sha256:ca32ba4c8d7987b3450c9f0186d80d8121e6cd48d80af1aff2c6dae84af589be","observation_id":"07b2b220-c274-4538-941a-c97c5f622a1e","resolution":{"observed_at":"2026-08-16T05:30:52.031874Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13971","last_updated":"2023-02-27T17:11:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-27T17:11:15Z","title":"LLaMA: Open and Efficient Foundation Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.13971","snapshot_observed_at":"2026-08-16T05:30:51.320557Z","title":"Llama: Open and efficient foundation language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.20644","last_updated":"2025-04-29T11:13:18Z","snapshot_observed_at":"2026-08-16T05:21:46.500638Z","submitted_at":"2025-04-29T11:13:18Z","title":"Combatting Dimensional Collapse in LLM Pre-Training Data via Diversified File Selection","version":1},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-08-16T05:30:51.320557Z"},"links":{"cited_paper":"/paper/2302.13971","citing_paper":"/paper/2504.20644"},"observation_digest":"sha256:02d5326187b1a04923886842bbee51bd451b7227d229b6fd3944c0472dd193bd","observation_id":"51de70f6-2556-41b6-beb2-ab7a3a1a4df2","resolution":{"observed_at":"2026-08-16T05:30:51.320557Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:30:51.324489Z","title":"Visualizing data using t-sne","venue":null,"work_id":null,"year":2008},"citing_paper":{"arxiv_id":"2504.20644","last_updated":"2025-04-29T11:13:18Z","snapshot_observed_at":"2026-08-16T05:21:46.500638Z","submitted_at":"2025-04-29T11:13:18Z","title":"Combatting Dimensional Collapse in LLM Pre-Training Data via Diversified File Selection","version":1},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-08-16T05:30:51.324489Z"},"links":{"citing_paper":"/paper/2504.20644"},"observation_digest":"sha256:a60ffc398a526c5c9f57280332da4368edce02c9d2999cc437aedfd5bd5c7384","observation_id":"77fdcae3-5caa-4102-a9fb-16e2fb3ea9a6","resolution":{"observed_at":"2026-08-16T05:30:51.324489Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.13331","last_updated":"2024-07-18T09:30:44Z","snapshot_observed_at":"2026-08-16T17:17:23.792711Z","submitted_at":"2024-07-18T09:30:44Z","title":"Reconstruct the Pruned Model without Any Retraining","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.13331","snapshot_observed_at":"2026-08-16T05:30:51.329782Z","title":"Reconstruct the pruned model without any retraining","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.20644","last_updated":"2025-04-29T11:13:18Z","snapshot_observed_at":"2026-08-16T05:21:46.500638Z","submitted_at":"2025-04-29T11:13:18Z","title":"Combatting Dimensional Collapse in LLM Pre-Training Data via Diversified File Selection","version":1},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-08-16T05:30:51.329782Z"},"links":{"cited_paper":"/paper/2407.13331","citing_paper":"/paper/2504.20644"},"observation_digest":"sha256:cac4ba62220ac4d49fb52cc451a67d6ebbfea4a0d3fb8bbbc1b09ce73de75dfa","observation_id":"8d843006-c914-4abb-b37c-a060f7e8c7da","resolution":{"observed_at":"2026-08-16T05:30:51.329782Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:30:51.334886Z","title":"Submodularity in data subset selection and active learning","venue":null,"work_id":null,"year":1954},"citing_paper":{"arxiv_id":"2504.20644","last_updated":"2025-04-29T11:13:18Z","snapshot_observed_at":"2026-08-16T05:21:46.500638Z","submitted_at":"2025-04-29T11:13:18Z","title":"Combatting Dimensional Collapse in LLM Pre-Training Data via Diversified File Selection","version":1},"reference_index":63,"source":"arxiv_source","source_observed_at":"2026-08-16T05:30:51.334886Z"},"links":{"citing_paper":"/paper/2504.20644"},"observation_digest":"sha256:d0a4dab5a301d5869a2734ce0a025075f4afe91d92bc0f766107d67e6a49e5a4","observation_id":"62e83932-b89d-4402-9c58-cbb0797cd5ea","resolution":{"observed_at":"2026-08-16T05:30:51.334886Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:30:51.990272Z","title":"Qurating: Selecting high-quality data for training language models","venue":null,"work_id":"56a0ee55-800a-42f7-99ba-d3075ee98597","year":2024},"citing_paper":{"arxiv_id":"2504.20644","last_updated":"2025-04-29T11:13:18Z","snapshot_observed_at":"2026-08-16T05:21:46.500638Z","submitted_at":"2025-04-29T11:13:18Z","title":"Combatting Dimensional Collapse in LLM Pre-Training Data via Diversified File Selection","version":1},"reference_index":64,"source":"arxiv_source","source_observed_at":"2026-08-16T05:30:51.339507Z"},"links":{"citing_paper":"/paper/2504.20644"},"observation_digest":"sha256:f75cc242c8bcc6be322f7d5f827e8489b94155723fbfb8fb17ca9115b3aff530","observation_id":"fb08d199-cc1c-490c-8729-2b71df570cd4","resolution":{"observed_at":"2026-08-16T05:30:51.995606Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:30:51.976117Z","title":"Doremi: Optimizing data mixtures speeds up language model pretraining","venue":null,"work_id":"bf1d892e-fae9-4050-8139-86e5f188ee5d","year":2023},"citing_paper":{"arxiv_id":"2504.20644","last_updated":"2025-04-29T11:13:18Z","snapshot_observed_at":"2026-08-16T05:21:46.500638Z","submitted_at":"2025-04-29T11:13:18Z","title":"Combatting Dimensional Collapse in LLM Pre-Training Data via Diversified File Selection","version":1},"reference_index":65,"source":"arxiv_source","source_observed_at":"2026-08-16T05:30:51.343617Z"},"links":{"citing_paper":"/paper/2504.20644"},"observation_digest":"sha256:432b8e8d6cac8948744be3b71e7ac7aa72be0767f9269fe7a68c4afb49d662c6","observation_id":"de8916d2-dacb-460f-9b19-515c5ace7f79","resolution":{"observed_at":"2026-08-16T05:30:51.981289Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:30:51.961491Z","title":"Data selection for language models via importance resampling","venue":null,"work_id":"3748865a-5e4a-44f4-a53a-163860c556e9","year":2023},"citing_paper":{"arxiv_id":"2504.20644","last_updated":"2025-04-29T11:13:18Z","snapshot_observed_at":"2026-08-16T05:21:46.500638Z","submitted_at":"2025-04-29T11:13:18Z","title":"Combatting Dimensional Collapse in LLM Pre-Training Data via Diversified File Selection","version":1},"reference_index":66,"source":"arxiv_source","source_observed_at":"2026-08-16T05:30:51.348463Z"},"links":{"citing_paper":"/paper/2504.20644"},"observation_digest":"sha256:e6dade040aa32c0e6df0d34fc518230cfbef611d465283456579d4d545667a1c","observation_id":"867100c1-25ec-4628-a0bc-301cfe7fb20a","resolution":{"observed_at":"2026-08-16T05:30:51.966378Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.01708","last_updated":"2024-12-02T16:55:03Z","snapshot_observed_at":"2026-08-16T13:00:37.847564Z","submitted_at":"2024-12-02T16:55:03Z","title":"Are We There Yet? Revealing the Risks of Utilizing Large Language Models in Scholarly Peer Review","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.01708","snapshot_observed_at":"2026-08-16T05:30:51.353074Z","title":"Are we there yet? revealing the risks of utilizing large language models in scholarly peer review","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.20644","last_updated":"2025-04-29T11:13:18Z","snapshot_observed_at":"2026-08-16T05:21:46.500638Z","submitted_at":"2025-04-29T11:13:18Z","title":"Combatting Dimensional Collapse in LLM Pre-Training Data via Diversified File Selection","version":1},"reference_index":67,"source":"arxiv_source","source_observed_at":"2026-08-16T05:30:51.353074Z"},"links":{"cited_paper":"/paper/2412.01708","citing_paper":"/paper/2504.20644"},"observation_digest":"sha256:731e7dc279cc6740bbfb3d277ab19b4f5cd19705f5c833b14e8496fe75e7d2e9","observation_id":"b443e7e1-d218-4f5e-ad36-5a56e540586a","resolution":{"observed_at":"2026-08-16T05:30:51.353074Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:30:51.946516Z","title":"On the vulnerability of safety alignment in open-access llms","venue":null,"work_id":"3689ba51-b88a-43b6-9852-5330458c0eb6","year":2024},"citing_paper":{"arxiv_id":"2504.20644","last_updated":"2025-04-29T11:13:18Z","snapshot_observed_at":"2026-08-16T05:21:46.500638Z","submitted_at":"2025-04-29T11:13:18Z","title":"Combatting Dimensional Collapse in LLM Pre-Training Data via Diversified File Selection","version":1},"reference_index":68,"source":"arxiv_source","source_observed_at":"2026-08-16T05:30:51.357487Z"},"links":{"citing_paper":"/paper/2504.20644"},"observation_digest":"sha256:51364c868b2b12fc763fada474a1162b8dc5c8b76d593f1ef8661d9d8cede68e","observation_id":"3e8f43ad-592a-4273-b751-018fe011f892","resolution":{"observed_at":"2026-08-16T05:30:51.951600Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:30:51.361890Z","title":"Barlow twins: Self-supervised learning via redundancy reduction","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2504.20644","last_updated":"2025-04-29T11:13:18Z","snapshot_observed_at":"2026-08-16T05:21:46.500638Z","submitted_at":"2025-04-29T11:13:18Z","title":"Combatting Dimensional Collapse in LLM Pre-Training Data via Diversified File Selection","version":1},"reference_index":69,"source":"arxiv_source","source_observed_at":"2026-08-16T05:30:51.361890Z"},"links":{"citing_paper":"/paper/2504.20644"},"observation_digest":"sha256:2fb3986b7cd929acc5200f86445625ceb3380f1e31d5d016a2d81da5d4852749","observation_id":"f9a3d4da-84b6-4daa-8ee4-f7c59f0ba7a8","resolution":{"observed_at":"2026-08-16T05:30:51.361890Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1905.07830","last_updated":"2019-05-19T23:57:23Z","snapshot_observed_at":"2026-08-15T09:37:44.321271Z","submitted_at":"2019-05-19T23:57:23Z","title":"HellaSwag: Can a Machine Really Finish Your Sentence?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1905.07830","snapshot_observed_at":"2026-08-16T05:30:51.366006Z","title":"Hellaswag: Can a machine really finish your sentence? arXiv preprint arXiv:1905.07830, 2019","venue":null,"work_id":null,"year":1905},"citing_paper":{"arxiv_id":"2504.20644","last_updated":"2025-04-29T11:13:18Z","snapshot_observed_at":"2026-08-16T05:21:46.500638Z","submitted_at":"2025-04-29T11:13:18Z","title":"Combatting Dimensional Collapse in LLM Pre-Training Data via Diversified File Selection","version":1},"reference_index":70,"source":"arxiv_source","source_observed_at":"2026-08-16T05:30:51.366006Z"},"links":{"cited_paper":"/paper/1905.07830","citing_paper":"/paper/2504.20644"},"observation_digest":"sha256:7c7e4107e8b5ead3445ec396f5c366592d7adfe52af0c7ec024fc85a31f98ce5","observation_id":"ff3e6000-3e91-4622-aea1-39639e296262","resolution":{"observed_at":"2026-08-16T05:30:51.366006Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.02385","last_updated":"2024-06-04T02:05:30Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-01-04T17:54:59Z","title":"TinyLlama: An Open-Source Small Language Model","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.02385","snapshot_observed_at":"2026-08-16T05:30:51.370594Z","title":"Tinyllama: An open-source small language model","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.20644","last_updated":"2025-04-29T11:13:18Z","snapshot_observed_at":"2026-08-16T05:21:46.500638Z","submitted_at":"2025-04-29T11:13:18Z","title":"Combatting Dimensional Collapse in LLM Pre-Training Data via Diversified File Selection","version":1},"reference_index":71,"source":"arxiv_source","source_observed_at":"2026-08-16T05:30:51.370594Z"},"links":{"cited_paper":"/paper/2401.02385","citing_paper":"/paper/2504.20644"},"observation_digest":"sha256:3c5c7128a3a4ed791c766825dc33c34e1faa024bc16ec5f789f5953c17592eee","observation_id":"5f6a1513-5bc3-4778-9711-967de2ae3ed1","resolution":{"observed_at":"2026-08-16T05:30:51.370594Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:30:51.374563Z","title":"Communication-efficient decentralized online continuous dr-submodular maximization","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.20644","last_updated":"2025-04-29T11:13:18Z","snapshot_observed_at":"2026-08-16T05:21:46.500638Z","submitted_at":"2025-04-29T11:13:18Z","title":"Combatting Dimensional Collapse in LLM Pre-Training Data via Diversified File Selection","version":1},"reference_index":72,"source":"arxiv_source","source_observed_at":"2026-08-16T05:30:51.374563Z"},"links":{"citing_paper":"/paper/2504.20644"},"observation_digest":"sha256:6b267b5a15acca7b16c2eae2d752f2c996bdf2060dfd104d8e989bd31323cb3b","observation_id":"dfaaa099-2c56-4712-a2aa-1821c7f99f2b","resolution":{"observed_at":"2026-08-16T05:30:51.374563Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.08330","last_updated":"2024-07-24T08:13:26Z","snapshot_observed_at":"2026-08-16T14:27:09.023330Z","submitted_at":"2024-01-16T12:49:10Z","title":"Boosting Gradient Ascent for Continuous DR-submodular Maximization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.08330","snapshot_observed_at":"2026-08-16T05:30:51.378450Z","title":"Boosting gradient ascent for continuous dr-submodular maximization","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.20644","last_updated":"2025-04-29T11:13:18Z","snapshot_observed_at":"2026-08-16T05:21:46.500638Z","submitted_at":"2025-04-29T11:13:18Z","title":"Combatting Dimensional Collapse in LLM Pre-Training Data via Diversified File Selection","version":1},"reference_index":73,"source":"arxiv_source","source_observed_at":"2026-08-16T05:30:51.378450Z"},"links":{"cited_paper":"/paper/2401.08330","citing_paper":"/paper/2504.20644"},"observation_digest":"sha256:b416f2f6d94e7a9f32d7cca5fd774ca546d5e1285e319746d32a6d3cd19a8c66","observation_id":"ab86dc78-083a-46f9-a317-723b71cd125b","resolution":{"observed_at":"2026-08-16T05:30:51.378450Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.05028","last_updated":"2025-02-07T15:57:56Z","snapshot_observed_at":"2026-08-14T01:21:16.688709Z","submitted_at":"2025-02-07T15:57:56Z","title":"Near-Optimal Online Learning for Multi-Agent Submodular Coordination: Tight Approximation and Communication Efficiency","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.05028","snapshot_observed_at":"2026-08-16T05:30:51.382725Z","title":"Near-optimal online learning for multi-agent submodular coordination: Tight approximation and communication efficiency","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2504.20644","last_updated":"2025-04-29T11:13:18Z","snapshot_observed_at":"2026-08-16T05:21:46.500638Z","submitted_at":"2025-04-29T11:13:18Z","title":"Combatting Dimensional Collapse in LLM Pre-Training Data via Diversified File Selection","version":1},"reference_index":74,"source":"arxiv_source","source_observed_at":"2026-08-16T05:30:51.382725Z"},"links":{"cited_paper":"/paper/2502.05028","citing_paper":"/paper/2504.20644"},"observation_digest":"sha256:98bd3dd14e10a45c2afcc5c10cbbb21ce4c1707870e9de13cf0d5454f482915e","observation_id":"077c03ee-874a-4f83-8113-69974e5d1759","resolution":{"observed_at":"2026-08-16T05:30:51.382725Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2205.01068","last_updated":"2022-06-21T17:04:40Z","snapshot_observed_at":"2026-08-06T03:13:37.403059Z","submitted_at":"2022-05-02T17:49:50Z","title":"OPT: Open Pre-trained Transformer Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.01068","snapshot_observed_at":"2026-08-16T05:30:51.386564Z","title":"Opt: Open pre-trained transformer language models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2504.20644","last_updated":"2025-04-29T11:13:18Z","snapshot_observed_at":"2026-08-16T05:21:46.500638Z","submitted_at":"2025-04-29T11:13:18Z","title":"Combatting Dimensional Collapse in LLM Pre-Training Data via Diversified File Selection","version":1},"reference_index":75,"source":"arxiv_source","source_observed_at":"2026-08-16T05:30:51.386564Z"},"links":{"cited_paper":"/paper/2205.01068","citing_paper":"/paper/2504.20644"},"observation_digest":"sha256:5e91c1893b6a4cefbea4b6f5bd229ac66545116b7c0a68828abfa0c38b71dc38","observation_id":"762911d4-7080-4381-8361-3535b6e299cc","resolution":{"observed_at":"2026-08-16T05:30:51.386564Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:30:51.914061Z","title":"Minimax curriculum learning: Machine teaching with desirable difficulties and scheduled diversity","venue":null,"work_id":"e2a4722d-10a2-4665-b937-dbc1647d7f4b","year":2018},"citing_paper":{"arxiv_id":"2504.20644","last_updated":"2025-04-29T11:13:18Z","snapshot_observed_at":"2026-08-16T05:21:46.500638Z","submitted_at":"2025-04-29T11:13:18Z","title":"Combatting Dimensional Collapse in LLM Pre-Training Data via Diversified File Selection","version":1},"reference_index":76,"source":"arxiv_source","source_observed_at":"2026-08-16T05:30:51.390537Z"},"links":{"citing_paper":"/paper/2504.20644"},"observation_digest":"sha256:dc15b2cd30b3642abedf5b640d0db9dc9312e49b6d13f4bd450030a67d0f9d2f","observation_id":"63913431-bc4c-426f-be4c-c687bbe7e423","resolution":{"observed_at":"2026-08-16T05:30:51.918959Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:30:51.394329Z","title":"@esa (Ref","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2504.20644","last_updated":"2025-04-29T11:13:18Z","snapshot_observed_at":"2026-08-16T05:21:46.500638Z","submitted_at":"2025-04-29T11:13:18Z","title":"Combatting Dimensional Collapse in LLM Pre-Training Data via Diversified File Selection","version":1},"reference_index":77,"source":"arxiv_source","source_observed_at":"2026-08-16T05:30:51.394329Z"},"links":{"citing_paper":"/paper/2504.20644"},"observation_digest":"sha256:82a7911a4991052cacb44eabf2abd3edcce82a767c610aec5517f837eda0fbc2","observation_id":"e886ec2a-d771-4189-bb5f-cd62616ad808","resolution":{"observed_at":"2026-08-16T05:30:51.394329Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:30:51.398537Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2504.20644","last_updated":"2025-04-29T11:13:18Z","snapshot_observed_at":"2026-08-16T05:21:46.500638Z","submitted_at":"2025-04-29T11:13:18Z","title":"Combatting Dimensional Collapse in LLM Pre-Training Data via Diversified File Selection","version":1},"reference_index":78,"source":"arxiv_source","source_observed_at":"2026-08-16T05:30:51.398537Z"},"links":{"citing_paper":"/paper/2504.20644"},"observation_digest":"sha256:0b9d0bbd43279bade43b53bc33cc99acea8a4ae662c5dba7df8df8f8ed96cfc7","observation_id":"fe8ef6db-aafa-44ef-9856-e623b5e6ed9b","resolution":{"observed_at":"2026-08-16T05:30:51.398537Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T05:30:51.402782Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2504.20644","last_updated":"2025-04-29T11:13:18Z","snapshot_observed_at":"2026-08-16T05:21:46.500638Z","submitted_at":"2025-04-29T11:13:18Z","title":"Combatting Dimensional Collapse in LLM Pre-Training Data via Diversified File Selection","version":1},"reference_index":79,"source":"arxiv_source","source_observed_at":"2026-08-16T05:30:51.402782Z"},"links":{"citing_paper":"/paper/2504.20644"},"observation_digest":"sha256:55370cc681dc324d0847c9af6e6d58fff2e5f020c7650cf71460995b21ad06d3","observation_id":"3687f3cb-d573-4771-94cf-baa9bd2257b7","resolution":{"observed_at":"2026-08-16T05:30:51.402782Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2504.20644","last_updated":"2025-04-29T11:13:18Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-16T05:21:46.500638Z","submitted_at":"2025-04-29T11:13:18Z","title":"Combatting Dimensional Collapse in LLM Pre-Training Data via Diversified File Selection"},"reference_resolution":{"displayed":77,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":48,"verified_exact":1,"verified_fuzzy":28},"total_outbound_references":77},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"thesis":"As of 17 August 2026, this Paper Citation Record lists 77 of 77 outbound references and 1 inbound Pith citation observation for arXiv:2504.20644."}