{"as_of":"2026-08-21T13:12:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:f683a6d36d8cb613fcf07d1998451dfea44bc2909cd296fc3e3805a8045703bf","coverage":[{"denominator":70,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":70,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-12T18:51:32.098357Z","state":"measured"},{"denominator":71,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":71,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-21T06:32:19.484+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T14:00:31.489767Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-07T14:00:34.048977Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2411.11266","last_updated":"2025-05-19T14:51:44Z","snapshot_observed_at":"2026-08-20T03:09:21.820083Z","submitted_at":"2024-11-18T03:45:34Z","title":"VersaTune: An Efficient Data Composition Framework for Training Multi-Capability LLMs","version":5},"cited_work":{"arxiv_id":"2411.11266","doi":null,"metadata_source":"pith","pith_arxiv_id":"2411.11266","snapshot_observed_at":"2026-08-07T14:00:34.048977Z","title":"VersaTune: An Efficient Data Composition Framework for Training Multi-Capability LLMs","venue":"cs.CL","work_id":"bb296ddf-e814-4b00-bc87-8c69f59866c6","year":2024},"citing_paper":{"arxiv_id":"2505.20416","last_updated":"2025-05-26T18:06:50Z","snapshot_observed_at":"2026-08-18T08:07:15.603423Z","submitted_at":"2025-05-26T18:06:50Z","title":"GraphGen: Enhancing Supervised Fine-Tuning for LLMs with Knowledge-Driven Synthetic Data Generation","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-07T14:00:31.489767Z"},"links":{"cited_paper":"/paper/2411.11266","citing_paper":"/paper/2505.20416"},"observation_digest":"sha256:9b9a38bf49689054daca457269ad205b65b8d0687dcbc634a56e44fa697f7996","observation_id":"8057caba-38b6-4025-b1b0-9f71da005ca1","resolution":{"observed_at":"2026-08-07T14:00:34.140189Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2411.11266/citation-record","integrity":"/paper/2411.11266/integrity","json":"/paper/2411.11266/citation-record.json","paper":"/paper/2411.11266"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-17T09:58:46.058102Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-12T18:51:31.600984Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.11266","last_updated":"2025-05-19T14:51:44Z","snapshot_observed_at":"2026-08-20T03:09:21.820083Z","submitted_at":"2024-11-18T03:45:34Z","title":"VersaTune: An Efficient Data Composition Framework for Training Multi-Capability LLMs","version":5},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-12T18:51:31.600984Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2411.11266"},"observation_digest":"sha256:bce3f75ea2b3c3a461e4d2bbda57eef0e41980c267bbddbaf23f8ae08746ab9b","observation_id":"bd819cda-105b-4f6e-a467-f1226c41c40b","resolution":{"observed_at":"2026-08-12T18:51:31.600984Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.16827","last_updated":"2024-08-02T17:59:31Z","snapshot_observed_at":"2026-08-16T14:15:11.706978Z","submitted_at":"2024-02-26T18:54:35Z","title":"A Survey on Data Selection for Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.16827","snapshot_observed_at":"2026-08-12T18:51:31.608106Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.11266","last_updated":"2025-05-19T14:51:44Z","snapshot_observed_at":"2026-08-20T03:09:21.820083Z","submitted_at":"2024-11-18T03:45:34Z","title":"VersaTune: An Efficient Data Composition Framework for Training Multi-Capability LLMs","version":5},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-12T18:51:31.608106Z"},"links":{"cited_paper":"/paper/2402.16827","citing_paper":"/paper/2411.11266"},"observation_digest":"sha256:dca6419e7e46d6c179ab0b655f1fbbecdba4a37901395d45cde55b1576ebd4de","observation_id":"66e539f8-e050-4dfd-a346-93b238b12de6","resolution":{"observed_at":"2026-08-12T18:51:31.608106Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:51:33.750004Z","title":null,"venue":null,"work_id":"b1c0b680-abc7-4077-b9c7-d219b97d8b92","year":2024},"citing_paper":{"arxiv_id":"2411.11266","last_updated":"2025-05-19T14:51:44Z","snapshot_observed_at":"2026-08-20T03:09:21.820083Z","submitted_at":"2024-11-18T03:45:34Z","title":"VersaTune: An Efficient Data Composition Framework for Training Multi-Capability LLMs","version":5},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-12T18:51:31.616811Z"},"links":{"citing_paper":"/paper/2411.11266"},"observation_digest":"sha256:32cb5c6fa71d02d1f45e270b02570c5bb7f4c320adf5fa054ddbdf87104b2ccb","observation_id":"2adb10e4-df51-42b0-be2d-6c848ef79494","resolution":{"observed_at":"2026-08-12T18:51:33.759152Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.14985","last_updated":"2025-03-02T03:27:58Z","snapshot_observed_at":"2026-08-16T13:32:26.549245Z","submitted_at":"2024-07-20T21:24:40Z","title":"Generalization v.s. Memorization: Tracing Language Models' Capabilities Back to Pretraining Data","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.14985","snapshot_observed_at":"2026-08-12T18:51:31.625209Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.11266","last_updated":"2025-05-19T14:51:44Z","snapshot_observed_at":"2026-08-20T03:09:21.820083Z","submitted_at":"2024-11-18T03:45:34Z","title":"VersaTune: An Efficient Data Composition Framework for Training Multi-Capability LLMs","version":5},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-12T18:51:31.625209Z"},"links":{"cited_paper":"/paper/2407.14985","citing_paper":"/paper/2411.11266"},"observation_digest":"sha256:3ed75c76e8fc3393aeb99b7481d1caa1ec8829d34313629d9be159de6f324151","observation_id":"f4666535-99b4-407c-adfa-d15ec3f23a44","resolution":{"observed_at":"2026-08-12T18:51:31.625209Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2108.07732","last_updated":"2021-08-16T03:57:30Z","snapshot_observed_at":"2026-08-15T17:40:38.050939Z","submitted_at":"2021-08-16T03:57:30Z","title":"Program Synthesis with Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2108.07732","snapshot_observed_at":"2026-08-12T18:51:31.635858Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2411.11266","last_updated":"2025-05-19T14:51:44Z","snapshot_observed_at":"2026-08-20T03:09:21.820083Z","submitted_at":"2024-11-18T03:45:34Z","title":"VersaTune: An Efficient Data Composition Framework for Training Multi-Capability LLMs","version":5},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-12T18:51:31.635858Z"},"links":{"cited_paper":"/paper/2108.07732","citing_paper":"/paper/2411.11266"},"observation_digest":"sha256:8b3b492657fddd4fc83ab5f051193ed21ab0cf1b40a2fd05f00a532bc801816a","observation_id":"9f841abd-3143-4ba3-9f81-cc7f1de760fd","resolution":{"observed_at":"2026-08-12T18:51:31.635858Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.10631","last_updated":"2024-03-15T19:14:39Z","snapshot_observed_at":"2026-08-16T13:51:18.629241Z","submitted_at":"2023-10-16T17:54:07Z","title":"Llemma: An Open Language Model For Mathematics","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.10631","snapshot_observed_at":"2026-08-12T18:51:31.646373Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.11266","last_updated":"2025-05-19T14:51:44Z","snapshot_observed_at":"2026-08-20T03:09:21.820083Z","submitted_at":"2024-11-18T03:45:34Z","title":"VersaTune: An Efficient Data Composition Framework for Training Multi-Capability LLMs","version":5},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-12T18:51:31.646373Z"},"links":{"cited_paper":"/paper/2310.10631","citing_paper":"/paper/2411.11266"},"observation_digest":"sha256:bed76347db13f99868f25c747b2fc79db9050d3765b8307b6335fedba1f9315f","observation_id":"253463bb-d851-488d-ac8a-6c4997d6185d","resolution":{"observed_at":"2026-08-12T18:51:31.646373Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.16609","last_updated":"2023-09-28T17:07:49Z","snapshot_observed_at":"2026-08-20T15:31:01.041088Z","submitted_at":"2023-09-28T17:07:49Z","title":"Qwen Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.16609","snapshot_observed_at":"2026-08-12T18:51:31.656209Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.11266","last_updated":"2025-05-19T14:51:44Z","snapshot_observed_at":"2026-08-20T03:09:21.820083Z","submitted_at":"2024-11-18T03:45:34Z","title":"VersaTune: An Efficient Data Composition Framework for Training Multi-Capability LLMs","version":5},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-12T18:51:31.656209Z"},"links":{"cited_paper":"/paper/2309.16609","citing_paper":"/paper/2411.11266"},"observation_digest":"sha256:20e100bd6173b72b2386e69158187a5bf248240b0517ad60e2404cfd2e7968ba","observation_id":"088586a5-4b62-44ae-956a-ce06b3a6715e","resolution":{"observed_at":"2026-08-12T18:51:31.656209Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1903.10676","last_updated":"2019-09-10T18:10:35Z","snapshot_observed_at":"2026-08-20T05:17:47.499333Z","submitted_at":"2019-03-26T05:11:46Z","title":"SciBERT: A Pretrained Language Model for Scientific Text","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1903.10676","snapshot_observed_at":"2026-08-12T18:51:31.663773Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2411.11266","last_updated":"2025-05-19T14:51:44Z","snapshot_observed_at":"2026-08-20T03:09:21.820083Z","submitted_at":"2024-11-18T03:45:34Z","title":"VersaTune: An Efficient Data Composition Framework for Training Multi-Capability LLMs","version":5},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-12T18:51:31.663773Z"},"links":{"cited_paper":"/paper/1903.10676","citing_paper":"/paper/2411.11266"},"observation_digest":"sha256:d3bc7e7a07e96b24e889c777df87add2c053756cdcb2c0dd8dfbe27402447144","observation_id":"86a18418-fb82-412c-ac11-5c5dd432d218","resolution":{"observed_at":"2026-08-12T18:51:31.663773Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:51:31.671059Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2411.11266","last_updated":"2025-05-19T14:51:44Z","snapshot_observed_at":"2026-08-20T03:09:21.820083Z","submitted_at":"2024-11-18T03:45:34Z","title":"VersaTune: An Efficient Data Composition Framework for Training Multi-Capability LLMs","version":5},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-12T18:51:31.671059Z"},"links":{"citing_paper":"/paper/2411.11266"},"observation_digest":"sha256:d2cd5dd5580a23f575de47f9e7eadc227c5ce8174b3ba7e2391e8751d51c0bbd","observation_id":"14148b0f-0f4c-4a42-a09f-67984d8e255b","resolution":{"observed_at":"2026-08-12T18:51:31.671059Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:51:33.698678Z","title":null,"venue":null,"work_id":"94a4425f-9fde-4ae2-84f6-0043d8c61fdf","year":2024},"citing_paper":{"arxiv_id":"2411.11266","last_updated":"2025-05-19T14:51:44Z","snapshot_observed_at":"2026-08-20T03:09:21.820083Z","submitted_at":"2024-11-18T03:45:34Z","title":"VersaTune: An Efficient Data Composition Framework for Training Multi-Capability LLMs","version":5},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-12T18:51:31.677468Z"},"links":{"citing_paper":"/paper/2411.11266"},"observation_digest":"sha256:002be05a0124742a118298c5c91c89c5b4428dd4df7617a9e08b22a432a7bf8e","observation_id":"bfab9d93-f48b-41a1-ab8d-905716db9558","resolution":{"observed_at":"2026-08-12T18:51:33.712427Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2107.03374","last_updated":"2021-07-14T17:16:02Z","snapshot_observed_at":"2026-08-20T20:50:23.483838Z","submitted_at":"2021-07-07T17:41:24Z","title":"Evaluating Large Language Models Trained on Code","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2107.03374","snapshot_observed_at":"2026-08-12T18:51:31.684656Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2411.11266","last_updated":"2025-05-19T14:51:44Z","snapshot_observed_at":"2026-08-20T03:09:21.820083Z","submitted_at":"2024-11-18T03:45:34Z","title":"VersaTune: An Efficient Data Composition Framework for Training Multi-Capability LLMs","version":5},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-12T18:51:31.684656Z"},"links":{"cited_paper":"/paper/2107.03374","citing_paper":"/paper/2411.11266"},"observation_digest":"sha256:8dbaf5d285ea606c4387165f4fe9e6925e8a94f04d24a4f7f8f6d7f3cba255c4","observation_id":"086cb86e-d891-4695-9133-0741539e2e38","resolution":{"observed_at":"2026-08-12T18:51:31.684656Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.16092","last_updated":"2026-06-08T08:40:57Z","snapshot_observed_at":"2026-08-16T15:20:27.587232Z","submitted_at":"2023-06-28T10:48:34Z","title":"Chatlaw: A Multi-Agent Legal Assistant based on a Role-Aligned Mixture-of-Experts Architecture","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.16092","snapshot_observed_at":"2026-08-12T18:51:31.691714Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.11266","last_updated":"2025-05-19T14:51:44Z","snapshot_observed_at":"2026-08-20T03:09:21.820083Z","submitted_at":"2024-11-18T03:45:34Z","title":"VersaTune: An Efficient Data Composition Framework for Training Multi-Capability LLMs","version":5},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-12T18:51:31.691714Z"},"links":{"cited_paper":"/paper/2306.16092","citing_paper":"/paper/2411.11266"},"observation_digest":"sha256:4c017c90292df9ff8b26fb448a036e8bc3334c7ff9432a390302d6c41befbce3","observation_id":"97c24247-648e-4eab-a0d0-4242ced453fb","resolution":{"observed_at":"2026-08-12T18:51:31.691714Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:51:31.697495Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2411.11266","last_updated":"2025-05-19T14:51:44Z","snapshot_observed_at":"2026-08-20T03:09:21.820083Z","submitted_at":"2024-11-18T03:45:34Z","title":"VersaTune: An Efficient Data Composition Framework for Training Multi-Capability LLMs","version":5},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-12T18:51:31.697495Z"},"links":{"citing_paper":"/paper/2411.11266"},"observation_digest":"sha256:cb059756fb6d4eb7cc1a315c3771d6c1f1572a8fc58ba97b8b28777b060a13b7","observation_id":"a07b13f6-3424-4d33-8009-2dca0cd4c23c","resolution":{"observed_at":"2026-08-12T18:51:31.697495Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1810.04805","last_updated":"2019-05-24T20:37:26Z","snapshot_observed_at":"2026-08-14T18:16:28.847993Z","submitted_at":"2018-10-11T00:50:01Z","title":"BERT: Pre-training of Deep Bidirectional Transformers for Language Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1810.04805","snapshot_observed_at":"2026-08-12T18:51:31.703630Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2411.11266","last_updated":"2025-05-19T14:51:44Z","snapshot_observed_at":"2026-08-20T03:09:21.820083Z","submitted_at":"2024-11-18T03:45:34Z","title":"VersaTune: An Efficient Data Composition Framework for Training Multi-Capability LLMs","version":5},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-12T18:51:31.703630Z"},"links":{"cited_paper":"/paper/1810.04805","citing_paper":"/paper/2411.11266"},"observation_digest":"sha256:f84c9bdc7bad91b5b26bb8c5d7aa975cd3abef86d9142cbce1bce322a466c7d8","observation_id":"7f7d6132-d783-4f19-8d39-e7e1c8df4fc3","resolution":{"observed_at":"2026-08-12T18:51:31.703630Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:51:31.709808Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.11266","last_updated":"2025-05-19T14:51:44Z","snapshot_observed_at":"2026-08-20T03:09:21.820083Z","submitted_at":"2024-11-18T03:45:34Z","title":"VersaTune: An Efficient Data Composition Framework for Training Multi-Capability LLMs","version":5},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-12T18:51:31.709808Z"},"links":{"citing_paper":"/paper/2411.11266"},"observation_digest":"sha256:3d161de066a532b7f9ecf6baa9a7eba1a5d3332b6a9b71a57aa2196206294f5c","observation_id":"b9538de6-0a1b-414b-91b7-4cbf4b143c81","resolution":{"observed_at":"2026-08-12T18:51:31.709808Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05492","last_updated":"2024-06-07T15:51:08Z","snapshot_observed_at":"2026-08-20T20:08:04.817035Z","submitted_at":"2023-10-09T07:56:16Z","title":"How Abilities in Large Language Models are Affected by Supervised Fine-tuning Data Composition","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.05492","snapshot_observed_at":"2026-08-12T18:51:31.715808Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.11266","last_updated":"2025-05-19T14:51:44Z","snapshot_observed_at":"2026-08-20T03:09:21.820083Z","submitted_at":"2024-11-18T03:45:34Z","title":"VersaTune: An Efficient Data Composition Framework for Training Multi-Capability LLMs","version":5},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-12T18:51:31.715808Z"},"links":{"cited_paper":"/paper/2310.05492","citing_paper":"/paper/2411.11266"},"observation_digest":"sha256:bbc792fc29700aa4df8fbf1742def30d1666f81d0646609482208eb958183853","observation_id":"5c3f702f-8878-4895-9d94-ee37ac92c679","resolution":{"observed_at":"2026-08-12T18:51:31.715808Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-08-13T17:20:44.002518Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-12T18:51:31.721701Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.11266","last_updated":"2025-05-19T14:51:44Z","snapshot_observed_at":"2026-08-20T03:09:21.820083Z","submitted_at":"2024-11-18T03:45:34Z","title":"VersaTune: An Efficient Data Composition Framework for Training Multi-Capability LLMs","version":5},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-12T18:51:31.721701Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2411.11266"},"observation_digest":"sha256:0323f91893dd6dc1e978ae39fb1b371a7b1780a023d5fe997841df7c148341be","observation_id":"8f25e9d2-72b5-486f-8f7b-89c5f060048e","resolution":{"observed_at":"2026-08-12T18:51:31.721701Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:51:33.653282Z","title":null,"venue":null,"work_id":"f5f1f21d-27a9-44ed-bb47-a7dc3d1551ff","year":2021},"citing_paper":{"arxiv_id":"2411.11266","last_updated":"2025-05-19T14:51:44Z","snapshot_observed_at":"2026-08-20T03:09:21.820083Z","submitted_at":"2024-11-18T03:45:34Z","title":"VersaTune: An Efficient Data Composition Framework for Training Multi-Capability LLMs","version":5},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-12T18:51:31.727941Z"},"links":{"citing_paper":"/paper/2411.11266"},"observation_digest":"sha256:e11e12cc91b90039d187fbec5e48323ba4b246d95a51320ad6415fe3c880514c","observation_id":"dcc45ee9-9b5b-4d72-b15b-5613168cdd2a","resolution":{"observed_at":"2026-08-12T18:51:33.662577Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.15393","last_updated":"2024-02-05T16:33:05Z","snapshot_observed_at":"2026-08-18T19:03:41.103305Z","submitted_at":"2023-10-23T22:51:58Z","title":"DoGE: Domain Reweighting with Generalization Estimation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.15393","snapshot_observed_at":"2026-08-12T18:51:31.735699Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.11266","last_updated":"2025-05-19T14:51:44Z","snapshot_observed_at":"2026-08-20T03:09:21.820083Z","submitted_at":"2024-11-18T03:45:34Z","title":"VersaTune: An Efficient Data Composition Framework for Training Multi-Capability LLMs","version":5},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-12T18:51:31.735699Z"},"links":{"cited_paper":"/paper/2310.15393","citing_paper":"/paper/2411.11266"},"observation_digest":"sha256:f6685dbf2a858529a8cd5f8a749467a22057a995d2fa64f638b1f9d22864fcf8","observation_id":"33c63d39-ccb8-4aa1-b181-eb86a6eb7e20","resolution":{"observed_at":"2026-08-12T18:51:31.735699Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.16289","last_updated":"2023-09-28T09:35:59Z","snapshot_observed_at":"2026-08-19T05:46:16.989652Z","submitted_at":"2023-09-28T09:35:59Z","title":"LawBench: Benchmarking Legal Knowledge of Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.16289","snapshot_observed_at":"2026-08-12T18:51:31.741455Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.11266","last_updated":"2025-05-19T14:51:44Z","snapshot_observed_at":"2026-08-20T03:09:21.820083Z","submitted_at":"2024-11-18T03:45:34Z","title":"VersaTune: An Efficient Data Composition Framework for Training Multi-Capability LLMs","version":5},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-12T18:51:31.741455Z"},"links":{"cited_paper":"/paper/2309.16289","citing_paper":"/paper/2411.11266"},"observation_digest":"sha256:a9cfc82bc7acca3d0f90f755c97d99f22815c013f74b6df26e82a912012cd26d","observation_id":"d7441a82-5522-403c-bc12-85365300c0d6","resolution":{"observed_at":"2026-08-12T18:51:31.741455Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.05904","last_updated":"2024-10-01T12:08:23Z","snapshot_observed_at":"2026-08-16T13:53:58.560866Z","submitted_at":"2024-05-09T17:00:22Z","title":"Does Fine-Tuning LLMs on New Knowledge Encourage Hallucinations?","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.05904","snapshot_observed_at":"2026-08-12T18:51:31.746912Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.11266","last_updated":"2025-05-19T14:51:44Z","snapshot_observed_at":"2026-08-20T03:09:21.820083Z","submitted_at":"2024-11-18T03:45:34Z","title":"VersaTune: An Efficient Data Composition Framework for Training Multi-Capability LLMs","version":5},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-12T18:51:31.746912Z"},"links":{"cited_paper":"/paper/2405.05904","citing_paper":"/paper/2411.11266"},"observation_digest":"sha256:64bbc0d8b914b47844278fc4916c9639eca856188a459187d76a096ddeaf7b42","observation_id":"c00d3641-0e0e-4fbb-9cc9-07366f6a8ec5","resolution":{"observed_at":"2026-08-12T18:51:31.746912Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:51:31.752276Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.11266","last_updated":"2025-05-19T14:51:44Z","snapshot_observed_at":"2026-08-20T03:09:21.820083Z","submitted_at":"2024-11-18T03:45:34Z","title":"VersaTune: An Efficient Data Composition Framework for Training Multi-Capability LLMs","version":5},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-12T18:51:31.752276Z"},"links":{"citing_paper":"/paper/2411.11266"},"observation_digest":"sha256:089a65951825e391d90184a6c7e475e3febf7f8eed7d264173a048b25288e5f3","observation_id":"de8d1c57-4b74-4ba1-ba86-e69e8a8bf280","resolution":{"observed_at":"2026-08-12T18:51:31.752276Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.16607","last_updated":"2024-11-30T19:31:38Z","snapshot_observed_at":"2026-08-21T08:27:16.681774Z","submitted_at":"2024-07-23T16:13:22Z","title":"Data Mixture Inference: What do BPE Tokenizers Reveal about their Training Data?","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.16607","snapshot_observed_at":"2026-08-12T18:51:31.759038Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.11266","last_updated":"2025-05-19T14:51:44Z","snapshot_observed_at":"2026-08-20T03:09:21.820083Z","submitted_at":"2024-11-18T03:45:34Z","title":"VersaTune: An Efficient Data Composition Framework for Training Multi-Capability LLMs","version":5},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-12T18:51:31.759038Z"},"links":{"cited_paper":"/paper/2407.16607","citing_paper":"/paper/2411.11266"},"observation_digest":"sha256:edab5845af0a5bb4ddd625d70b9b7f11e07a0f6276a1b6df0f304bd080b18a43","observation_id":"fbace07d-c268-44ca-8942-4164bdf7ec8f","resolution":{"observed_at":"2026-08-12T18:51:31.759038Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2009.03300","last_updated":"2021-01-12T18:57:11Z","snapshot_observed_at":"2026-08-13T20:44:28.824685Z","submitted_at":"2020-09-07T17:59:25Z","title":"Measuring Massive Multitask Language Understanding","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.03300","snapshot_observed_at":"2026-08-12T18:51:31.766428Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2411.11266","last_updated":"2025-05-19T14:51:44Z","snapshot_observed_at":"2026-08-20T03:09:21.820083Z","submitted_at":"2024-11-18T03:45:34Z","title":"VersaTune: An Efficient Data Composition Framework for Training Multi-Capability LLMs","version":5},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-12T18:51:31.766428Z"},"links":{"cited_paper":"/paper/2009.03300","citing_paper":"/paper/2411.11266"},"observation_digest":"sha256:2ade979b24675a40f8d7ab1208038471d9e06c65318772c4ff97d2dc6100b082","observation_id":"636f10e2-c638-484d-b65a-022bbc0ed71f","resolution":{"observed_at":"2026-08-12T18:51:31.766428Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:51:31.778471Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.11266","last_updated":"2025-05-19T14:51:44Z","snapshot_observed_at":"2026-08-20T03:09:21.820083Z","submitted_at":"2024-11-18T03:45:34Z","title":"VersaTune: An Efficient Data Composition Framework for Training Multi-Capability LLMs","version":5},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-12T18:51:31.778471Z"},"links":{"citing_paper":"/paper/2411.11266"},"observation_digest":"sha256:fcdbd8c4eeadbc594008efa0512dee006beb07fc04628af8695eb4bee0aa2eb2","observation_id":"7c82a31c-5dca-46f1-a78a-a1638dc216d4","resolution":{"observed_at":"2026-08-12T18:51:31.778471Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.21276","last_updated":"2024-10-25T17:43:01Z","snapshot_observed_at":"2026-08-15T14:02:47.366139Z","submitted_at":"2024-10-25T17:43:01Z","title":"GPT-4o System Card","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.21276","snapshot_observed_at":"2026-08-12T18:51:31.785813Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.11266","last_updated":"2025-05-19T14:51:44Z","snapshot_observed_at":"2026-08-20T03:09:21.820083Z","submitted_at":"2024-11-18T03:45:34Z","title":"VersaTune: An Efficient Data Composition Framework for Training Multi-Capability LLMs","version":5},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-12T18:51:31.785813Z"},"links":{"cited_paper":"/paper/2410.21276","citing_paper":"/paper/2411.11266"},"observation_digest":"sha256:2a98630c6f1ce464a107eccc4c82ef472d7642aaa2a78e46fd2baca0f3836fdd","observation_id":"3652586c-44c9-4d4d-88f6-54f706de163e","resolution":{"observed_at":"2026-08-12T18:51:31.785813Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2009.13081","last_updated":"2020-09-28T05:07:51Z","snapshot_observed_at":"2026-08-19T11:12:45.951488Z","submitted_at":"2020-09-28T05:07:51Z","title":"What Disease does this Patient Have? A Large-scale Open Domain Question Answering Dataset from Medical Exams","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.13081","snapshot_observed_at":"2026-08-12T18:51:31.792011Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2411.11266","last_updated":"2025-05-19T14:51:44Z","snapshot_observed_at":"2026-08-20T03:09:21.820083Z","submitted_at":"2024-11-18T03:45:34Z","title":"VersaTune: An Efficient Data Composition Framework for Training Multi-Capability LLMs","version":5},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-12T18:51:31.792011Z"},"links":{"cited_paper":"/paper/2009.13081","citing_paper":"/paper/2411.11266"},"observation_digest":"sha256:a263a2fb01634963a8f42e94a71e54dbe56c12f49d314178e1c97330684fdb73","observation_id":"06855ddf-ec89-4283-b024-6d8b02d5f232","resolution":{"observed_at":"2026-08-12T18:51:31.792011Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2207.05221","last_updated":"2022-11-21T16:38:35Z","snapshot_observed_at":"2026-08-14T05:42:29.067319Z","submitted_at":"2022-07-11T22:59:39Z","title":"Language Models (Mostly) Know What They Know","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2207.05221","snapshot_observed_at":"2026-08-12T18:51:31.799741Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.11266","last_updated":"2025-05-19T14:51:44Z","snapshot_observed_at":"2026-08-20T03:09:21.820083Z","submitted_at":"2024-11-18T03:45:34Z","title":"VersaTune: An Efficient Data Composition Framework for Training Multi-Capability LLMs","version":5},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-12T18:51:31.799741Z"},"links":{"cited_paper":"/paper/2207.05221","citing_paper":"/paper/2411.11266"},"observation_digest":"sha256:d5de739cfea7292c92f63a231dc1657785b26103e654d7c3d7b97910882f3f83","observation_id":"ef2049a0-4d53-42d0-9fe8-c6a100ae44a3","resolution":{"observed_at":"2026-08-12T18:51:31.799741Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2102.11343","last_updated":"2021-02-22T20:34:00Z","snapshot_observed_at":"2026-08-16T18:43:47.383020Z","submitted_at":"2021-02-22T20:34:00Z","title":"Understanding Catastrophic Forgetting and Remembering in Continual Learning with Optimal Relevance Mapping","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2102.11343","snapshot_observed_at":"2026-08-12T18:51:31.806784Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2411.11266","last_updated":"2025-05-19T14:51:44Z","snapshot_observed_at":"2026-08-20T03:09:21.820083Z","submitted_at":"2024-11-18T03:45:34Z","title":"VersaTune: An Efficient Data Composition Framework for Training Multi-Capability LLMs","version":5},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-12T18:51:31.806784Z"},"links":{"cited_paper":"/paper/2102.11343","citing_paper":"/paper/2411.11266"},"observation_digest":"sha256:401eca13c1939afb784219e27c17b16ed2305667c5e8181c76256a78f956b2d2","observation_id":"dc182685-f217-49c0-923b-cac8bfe1bd4b","resolution":{"observed_at":"2026-08-12T18:51:31.806784Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.09664","last_updated":"2023-04-15T12:55:45Z","snapshot_observed_at":"2026-07-06T14:53:27.667483Z","submitted_at":"2023-02-19T20:10:07Z","title":"Semantic Uncertainty: Linguistic Invariances for Uncertainty Estimation in Natural Language Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.09664","snapshot_observed_at":"2026-08-12T18:51:31.815441Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.11266","last_updated":"2025-05-19T14:51:44Z","snapshot_observed_at":"2026-08-20T03:09:21.820083Z","submitted_at":"2024-11-18T03:45:34Z","title":"VersaTune: An Efficient Data Composition Framework for Training Multi-Capability LLMs","version":5},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-12T18:51:31.815441Z"},"links":{"cited_paper":"/paper/2302.09664","citing_paper":"/paper/2411.11266"},"observation_digest":"sha256:d7a9dcf8375901b2e3285f5b3c233016dce633632976e3d959aad86387638ca5","observation_id":"6f253472-b4f3-4aae-952a-edb82b1fa35d","resolution":{"observed_at":"2026-08-12T18:51:31.815441Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:51:31.822691Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.11266","last_updated":"2025-05-19T14:51:44Z","snapshot_observed_at":"2026-08-20T03:09:21.820083Z","submitted_at":"2024-11-18T03:45:34Z","title":"VersaTune: An Efficient Data Composition Framework for Training Multi-Capability LLMs","version":5},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-12T18:51:31.822691Z"},"links":{"citing_paper":"/paper/2411.11266"},"observation_digest":"sha256:e798b85dff155566cd3d7ecb97d11577a3658b1fefef8ce04631b99004c55516","observation_id":"bded5c70-439f-4371-b820-00fa88ed94ee","resolution":{"observed_at":"2026-08-12T18:51:31.822691Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:51:33.591554Z","title":null,"venue":null,"work_id":"c920bf42-1588-4c41-b5bd-5e3a16fb27f5","year":2023},"citing_paper":{"arxiv_id":"2411.11266","last_updated":"2025-05-19T14:51:44Z","snapshot_observed_at":"2026-08-20T03:09:21.820083Z","submitted_at":"2024-11-18T03:45:34Z","title":"VersaTune: An Efficient Data Composition Framework for Training Multi-Capability LLMs","version":5},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-12T18:51:31.827883Z"},"links":{"citing_paper":"/paper/2411.11266"},"observation_digest":"sha256:859b791a795ae4c1e561c208f86a6a5868660a0cb46e8bf85e246b2d8b526786","observation_id":"70d30b1f-f86c-45b8-a222-890b287ecd78","resolution":{"observed_at":"2026-08-12T18:51:33.598093Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:51:31.838194Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.11266","last_updated":"2025-05-19T14:51:44Z","snapshot_observed_at":"2026-08-20T03:09:21.820083Z","submitted_at":"2024-11-18T03:45:34Z","title":"VersaTune: An Efficient Data Composition Framework for Training Multi-Capability LLMs","version":5},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-12T18:51:31.838194Z"},"links":{"citing_paper":"/paper/2411.11266"},"observation_digest":"sha256:6fb837c942df27a60b0fd43aae108c23f10810596d90e7232f3ebce3bd0e305e","observation_id":"d6370541-6ffd-4732-bf63-181051e727d0","resolution":{"observed_at":"2026-08-12T18:51:31.838194Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.19437","last_updated":"2025-02-18T17:26:38Z","snapshot_observed_at":"2026-08-18T18:18:37.449517Z","submitted_at":"2024-12-27T04:03:16Z","title":"DeepSeek-V3 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.19437","snapshot_observed_at":"2026-08-12T18:51:31.843700Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.11266","last_updated":"2025-05-19T14:51:44Z","snapshot_observed_at":"2026-08-20T03:09:21.820083Z","submitted_at":"2024-11-18T03:45:34Z","title":"VersaTune: An Efficient Data Composition Framework for Training Multi-Capability LLMs","version":5},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-12T18:51:31.843700Z"},"links":{"cited_paper":"/paper/2412.19437","citing_paper":"/paper/2411.11266"},"observation_digest":"sha256:a8ca7da70f98adbeeeb17c419b323f8e61ffed0ec812454f1927abe18c9d1dc1","observation_id":"46282825-feb2-4081-8fd5-c4cddec069c2","resolution":{"observed_at":"2026-08-12T18:51:31.843700Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:51:31.848822Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.11266","last_updated":"2025-05-19T14:51:44Z","snapshot_observed_at":"2026-08-20T03:09:21.820083Z","submitted_at":"2024-11-18T03:45:34Z","title":"VersaTune: An Efficient Data Composition Framework for Training Multi-Capability LLMs","version":5},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-12T18:51:31.848822Z"},"links":{"citing_paper":"/paper/2411.11266"},"observation_digest":"sha256:b73d1c4ecf907e98ffe6ea5127d2f36753fc5542cd713ea0bd4e9dfbfecaba2a","observation_id":"d9ce1c14-a018-4843-87ce-495786a71edd","resolution":{"observed_at":"2026-08-12T18:51:31.848822Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08896","last_updated":"2023-10-11T17:43:28Z","snapshot_observed_at":"2026-07-06T15:03:55.982628Z","submitted_at":"2023-03-15T19:31:21Z","title":"SelfCheckGPT: Zero-Resource Black-Box Hallucination Detection for Generative Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08896","snapshot_observed_at":"2026-08-12T18:51:31.854028Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.11266","last_updated":"2025-05-19T14:51:44Z","snapshot_observed_at":"2026-08-20T03:09:21.820083Z","submitted_at":"2024-11-18T03:45:34Z","title":"VersaTune: An Efficient Data Composition Framework for Training Multi-Capability LLMs","version":5},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-12T18:51:31.854028Z"},"links":{"cited_paper":"/paper/2303.08896","citing_paper":"/paper/2411.11266"},"observation_digest":"sha256:0a7e38d0b832c4ce9bbf404c3cb98e9e3fd6cc9eafb51cc2c5e7d0289c16c7b8","observation_id":"b4be350c-8f36-4a3d-97e8-c41bd4197ff8","resolution":{"observed_at":"2026-08-12T18:51:31.854028Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:51:31.858893Z","title":null,"venue":null,"work_id":null,"year":1989},"citing_paper":{"arxiv_id":"2411.11266","last_updated":"2025-05-19T14:51:44Z","snapshot_observed_at":"2026-08-20T03:09:21.820083Z","submitted_at":"2024-11-18T03:45:34Z","title":"VersaTune: An Efficient Data Composition Framework for Training Multi-Capability LLMs","version":5},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-12T18:51:31.858893Z"},"links":{"citing_paper":"/paper/2411.11266"},"observation_digest":"sha256:7bb96af9fd87a07a37449d183cd4c0a32159dca6afc5437eff6647abce832adc","observation_id":"54013563-3b1a-442c-9066-e47e5b14754f","resolution":{"observed_at":"2026-08-12T18:51:31.858893Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:51:33.516909Z","title":null,"venue":null,"work_id":"215dd4fd-a696-4ed9-a8c5-57c5e466614f","year":2023},"citing_paper":{"arxiv_id":"2411.11266","last_updated":"2025-05-19T14:51:44Z","snapshot_observed_at":"2026-08-20T03:09:21.820083Z","submitted_at":"2024-11-18T03:45:34Z","title":"VersaTune: An Efficient Data Composition Framework for Training Multi-Capability LLMs","version":5},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-12T18:51:31.866121Z"},"links":{"citing_paper":"/paper/2411.11266"},"observation_digest":"sha256:104dcb0572656b2d056217e8a93ec8d036d9677c3eb2190cba4c0146e53ca62c","observation_id":"7cfbec12-0c56-420a-82b9-0a475dea090f","resolution":{"observed_at":"2026-08-12T18:51:33.522358Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:51:31.875092Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.11266","last_updated":"2025-05-19T14:51:44Z","snapshot_observed_at":"2026-08-20T03:09:21.820083Z","submitted_at":"2024-11-18T03:45:34Z","title":"VersaTune: An Efficient Data Composition Framework for Training Multi-Capability LLMs","version":5},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-12T18:51:31.875092Z"},"links":{"citing_paper":"/paper/2411.11266"},"observation_digest":"sha256:e216fd275f9e1ab8571c215b445fed9558c925222bcff21cb8da96111afccf66","observation_id":"649013ea-c70d-4906-a563-326cf5712d91","resolution":{"observed_at":"2026-08-12T18:51:31.875092Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:51:31.880205Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2411.11266","last_updated":"2025-05-19T14:51:44Z","snapshot_observed_at":"2026-08-20T03:09:21.820083Z","submitted_at":"2024-11-18T03:45:34Z","title":"VersaTune: An Efficient Data Composition Framework for Training Multi-Capability LLMs","version":5},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-12T18:51:31.880205Z"},"links":{"citing_paper":"/paper/2411.11266"},"observation_digest":"sha256:413662e0350293e23550efca924686c7321caa777c49bdb15b454546608b5147","observation_id":"6471e017-3a83-4f37-b7b9-48fbcab358cf","resolution":{"observed_at":"2026-08-12T18:51:31.880205Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.12950","last_updated":"2024-01-31T19:47:26Z","snapshot_observed_at":"2026-08-18T03:59:39.242039Z","submitted_at":"2023-08-24T17:39:13Z","title":"Code Llama: Open Foundation Models for Code","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.12950","snapshot_observed_at":"2026-08-12T18:51:31.885985Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.11266","last_updated":"2025-05-19T14:51:44Z","snapshot_observed_at":"2026-08-20T03:09:21.820083Z","submitted_at":"2024-11-18T03:45:34Z","title":"VersaTune: An Efficient Data Composition Framework for Training Multi-Capability LLMs","version":5},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-12T18:51:31.885985Z"},"links":{"cited_paper":"/paper/2308.12950","citing_paper":"/paper/2411.11266"},"observation_digest":"sha256:02a53b734d33347e594151421645a6b9522ad27c9840dbde8ae33e1436724d3c","observation_id":"f472b5d4-1999-451a-9040-d657bf852cc5","resolution":{"observed_at":"2026-08-12T18:51:31.885985Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.08207","last_updated":"2022-03-17T17:53:01Z","snapshot_observed_at":"2026-08-14T04:21:28.978034Z","submitted_at":"2021-10-15T17:08:57Z","title":"Multitask Prompted Training Enables Zero-Shot Task Generalization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.08207","snapshot_observed_at":"2026-08-12T18:51:31.892451Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2411.11266","last_updated":"2025-05-19T14:51:44Z","snapshot_observed_at":"2026-08-20T03:09:21.820083Z","submitted_at":"2024-11-18T03:45:34Z","title":"VersaTune: An Efficient Data Composition Framework for Training Multi-Capability LLMs","version":5},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-12T18:51:31.892451Z"},"links":{"cited_paper":"/paper/2110.08207","citing_paper":"/paper/2411.11266"},"observation_digest":"sha256:a38b1f641c3a238f60c8646c3dc1711285ae951a9119b0ecea464e7b2bb952e1","observation_id":"c8cd4085-8ce0-4ebe-84de-aa7d092e30d1","resolution":{"observed_at":"2026-08-12T18:51:31.892451Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:51:31.897805Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.11266","last_updated":"2025-05-19T14:51:44Z","snapshot_observed_at":"2026-08-20T03:09:21.820083Z","submitted_at":"2024-11-18T03:45:34Z","title":"VersaTune: An Efficient Data Composition Framework for Training Multi-Capability LLMs","version":5},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-12T18:51:31.897805Z"},"links":{"citing_paper":"/paper/2411.11266"},"observation_digest":"sha256:8b39292c1f67b5489286cd3c46c60b9086e603347ab6967a67f879e43afa0709","observation_id":"219bc52d-a49d-4343-8fcc-c02e5dc2ac96","resolution":{"observed_at":"2026-08-12T18:51:31.897805Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:51:33.451503Z","title":null,"venue":null,"work_id":"b935ed4c-9847-4a3d-9842-5bcb249382a4","year":2024},"citing_paper":{"arxiv_id":"2411.11266","last_updated":"2025-05-19T14:51:44Z","snapshot_observed_at":"2026-08-20T03:09:21.820083Z","submitted_at":"2024-11-18T03:45:34Z","title":"VersaTune: An Efficient Data Composition Framework for Training Multi-Capability LLMs","version":5},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-12T18:51:31.903118Z"},"links":{"citing_paper":"/paper/2411.11266"},"observation_digest":"sha256:c872880fb962b2f56849cdd7b2aa21ecb8dfeec6be478de17f0ad7386c01cf40","observation_id":"5257fc2b-95f2-4ff4-80ed-208fa23fcb28","resolution":{"observed_at":"2026-08-12T18:51:33.457751Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:51:31.908020Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.11266","last_updated":"2025-05-19T14:51:44Z","snapshot_observed_at":"2026-08-20T03:09:21.820083Z","submitted_at":"2024-11-18T03:45:34Z","title":"VersaTune: An Efficient Data Composition Framework for Training Multi-Capability LLMs","version":5},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-12T18:51:31.908020Z"},"links":{"citing_paper":"/paper/2411.11266"},"observation_digest":"sha256:a02ce4ed14c54ddf40f863a45fcdaf9e710e70c5b3c271a7ca3a17d4c95831cc","observation_id":"77dc1435-7aaf-4600-b4f2-bd70f16c3f60","resolution":{"observed_at":"2026-08-12T18:51:31.908020Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.09085","last_updated":"2022-11-16T18:06:33Z","snapshot_observed_at":"2026-08-17T08:35:32.078396Z","submitted_at":"2022-11-16T18:06:33Z","title":"Galactica: A Large Language Model for Science","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.09085","snapshot_observed_at":"2026-08-12T18:51:31.913792Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.11266","last_updated":"2025-05-19T14:51:44Z","snapshot_observed_at":"2026-08-20T03:09:21.820083Z","submitted_at":"2024-11-18T03:45:34Z","title":"VersaTune: An Efficient Data Composition Framework for Training Multi-Capability LLMs","version":5},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-12T18:51:31.913792Z"},"links":{"cited_paper":"/paper/2211.09085","citing_paper":"/paper/2411.11266"},"observation_digest":"sha256:81394f676e4757abfac2bf32de8ea0b5f814689f052ce400f66a807fb972c281","observation_id":"2b44a643-45e2-499f-b807-1f0c302293c2","resolution":{"observed_at":"2026-08-12T18:51:31.913792Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.11805","last_updated":"2025-05-09T21:04:06Z","snapshot_observed_at":"2026-08-20T18:27:04.837880Z","submitted_at":"2023-12-19T02:39:27Z","title":"Gemini: A Family of Highly Capable Multimodal Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.11805","snapshot_observed_at":"2026-08-12T18:51:31.919494Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.11266","last_updated":"2025-05-19T14:51:44Z","snapshot_observed_at":"2026-08-20T03:09:21.820083Z","submitted_at":"2024-11-18T03:45:34Z","title":"VersaTune: An Efficient Data Composition Framework for Training Multi-Capability LLMs","version":5},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-12T18:51:31.919494Z"},"links":{"cited_paper":"/paper/2312.11805","citing_paper":"/paper/2411.11266"},"observation_digest":"sha256:69d770242df3bcb7c67c6d6978c7d0b8ae77cb93d7665382ce8044f4fe5e0582","observation_id":"35d1db4d-46e5-41d3-8894-163a707afe1b","resolution":{"observed_at":"2026-08-12T18:51:31.919494Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:51:31.925274Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.11266","last_updated":"2025-05-19T14:51:44Z","snapshot_observed_at":"2026-08-20T03:09:21.820083Z","submitted_at":"2024-11-18T03:45:34Z","title":"VersaTune: An Efficient Data Composition Framework for Training Multi-Capability LLMs","version":5},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-12T18:51:31.925274Z"},"links":{"citing_paper":"/paper/2411.11266"},"observation_digest":"sha256:e166a9689fb5e848e72ad51ff09f724aadf9f1d4fc10b850c1a6108b63809bc6","observation_id":"511daa67-239d-4a84-9a98-8a7f43fafb5b","resolution":{"observed_at":"2026-08-12T18:51:31.925274Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13971","last_updated":"2023-02-27T17:11:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-27T17:11:15Z","title":"LLaMA: Open and Efficient Foundation Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.13971","snapshot_observed_at":"2026-08-12T18:51:31.931453Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.11266","last_updated":"2025-05-19T14:51:44Z","snapshot_observed_at":"2026-08-20T03:09:21.820083Z","submitted_at":"2024-11-18T03:45:34Z","title":"VersaTune: An Efficient Data Composition Framework for Training Multi-Capability LLMs","version":5},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-12T18:51:31.931453Z"},"links":{"cited_paper":"/paper/2302.13971","citing_paper":"/paper/2411.11266"},"observation_digest":"sha256:9c2e0ca035e5e6632d3ff0aa272a21c620a8728d706660ded88c0c2b04e70585","observation_id":"b29e1448-7e2c-492f-abd5-f29957788432","resolution":{"observed_at":"2026-08-12T18:51:31.931453Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09288","last_updated":"2023-07-19T17:08:59Z","snapshot_observed_at":"2026-08-07T12:56:43.323460Z","submitted_at":"2023-07-18T14:31:57Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.09288","snapshot_observed_at":"2026-08-12T18:51:31.939064Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.11266","last_updated":"2025-05-19T14:51:44Z","snapshot_observed_at":"2026-08-20T03:09:21.820083Z","submitted_at":"2024-11-18T03:45:34Z","title":"VersaTune: An Efficient Data Composition Framework for Training Multi-Capability LLMs","version":5},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-12T18:51:31.939064Z"},"links":{"cited_paper":"/paper/2307.09288","citing_paper":"/paper/2411.11266"},"observation_digest":"sha256:77bad734627c0f62e01594023ef34351a33667619f488595fe9dfeae6e6c5fa3","observation_id":"e0c356fe-de23-48bd-b2a9-550de82a0bfc","resolution":{"observed_at":"2026-08-12T18:51:31.939064Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:51:33.406751Z","title":"Smith, Daniel Khashabi, and Hannaneh Hajishirzi","venue":null,"work_id":"d463b644-eabf-46df-b52e-834df68433dc","year":2022},"citing_paper":{"arxiv_id":"2411.11266","last_updated":"2025-05-19T14:51:44Z","snapshot_observed_at":"2026-08-20T03:09:21.820083Z","submitted_at":"2024-11-18T03:45:34Z","title":"VersaTune: An Efficient Data Composition Framework for Training Multi-Capability LLMs","version":5},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-12T18:51:31.945266Z"},"links":{"citing_paper":"/paper/2411.11266"},"observation_digest":"sha256:37f085509945fb2d8fa95a8251b507b8b8ef01e8ed609e34235d8957433e5f75","observation_id":"416aedf5-fa2f-4434-82df-92c346517dbd","resolution":{"observed_at":"2026-08-12T18:51:33.412821Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.01700","last_updated":"2024-08-02T03:56:35Z","snapshot_observed_at":"2026-08-18T13:32:43.357876Z","submitted_at":"2023-12-04T07:42:16Z","title":"Data Management For Training Large Language Models: A Survey","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.01700","snapshot_observed_at":"2026-08-12T18:51:31.951230Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.11266","last_updated":"2025-05-19T14:51:44Z","snapshot_observed_at":"2026-08-20T03:09:21.820083Z","submitted_at":"2024-11-18T03:45:34Z","title":"VersaTune: An Efficient Data Composition Framework for Training Multi-Capability LLMs","version":5},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-12T18:51:31.951230Z"},"links":{"cited_paper":"/paper/2312.01700","citing_paper":"/paper/2411.11266"},"observation_digest":"sha256:781158a556d5ff2afe791faadd4e001b85599fcdc83b41a5cd3db7c1cb5f0b07","observation_id":"135f5adc-86ac-4866-8efd-2441402ee07f","resolution":{"observed_at":"2026-08-12T18:51:31.951230Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:51:33.390294Z","title":null,"venue":null,"work_id":"7948e3ad-0ef2-4fb9-9381-d0036b1196ec","year":2025},"citing_paper":{"arxiv_id":"2411.11266","last_updated":"2025-05-19T14:51:44Z","snapshot_observed_at":"2026-08-20T03:09:21.820083Z","submitted_at":"2024-11-18T03:45:34Z","title":"VersaTune: An Efficient Data Composition Framework for Training Multi-Capability LLMs","version":5},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-12T18:51:31.956357Z"},"links":{"citing_paper":"/paper/2411.11266"},"observation_digest":"sha256:ea5aa26ae51ea7cf957636f9f4bce994704e05abc16b52549204fea89280d836","observation_id":"9fb7865a-73ea-40e3-b8fe-1d4189a722b4","resolution":{"observed_at":"2026-08-12T18:51:33.394790Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.17564","last_updated":"2023-12-21T06:21:11Z","snapshot_observed_at":"2026-08-14T12:54:48.492396Z","submitted_at":"2023-03-30T17:30:36Z","title":"BloombergGPT: A Large Language Model for Finance","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.17564","snapshot_observed_at":"2026-08-12T18:51:31.960577Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.11266","last_updated":"2025-05-19T14:51:44Z","snapshot_observed_at":"2026-08-20T03:09:21.820083Z","submitted_at":"2024-11-18T03:45:34Z","title":"VersaTune: An Efficient Data Composition Framework for Training Multi-Capability LLMs","version":5},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-12T18:51:31.960577Z"},"links":{"cited_paper":"/paper/2303.17564","citing_paper":"/paper/2411.11266"},"observation_digest":"sha256:574b5632a09d137dcc4376c2c9a49e69a8e73aa203c34b8dc68f154660aa7db0","observation_id":"1f38d0bf-4bd2-4854-aedc-89838b7ef7f3","resolution":{"observed_at":"2026-08-12T18:51:31.960577Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06694","last_updated":"2024-04-11T01:18:06Z","snapshot_observed_at":"2026-08-16T14:53:24.619970Z","submitted_at":"2023-10-10T15:13:30Z","title":"Sheared LLaMA: Accelerating Language Model Pre-training via Structured Pruning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.06694","snapshot_observed_at":"2026-08-12T18:51:31.965814Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.11266","last_updated":"2025-05-19T14:51:44Z","snapshot_observed_at":"2026-08-20T03:09:21.820083Z","submitted_at":"2024-11-18T03:45:34Z","title":"VersaTune: An Efficient Data Composition Framework for Training Multi-Capability LLMs","version":5},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-12T18:51:31.965814Z"},"links":{"cited_paper":"/paper/2310.06694","citing_paper":"/paper/2411.11266"},"observation_digest":"sha256:8e8849526d6be5b6a81a6592c4453ab530944081d15836bafe6607ff74cb49ea","observation_id":"25bf0933-7ebc-465f-a7fb-dfe8cb9c3064","resolution":{"observed_at":"2026-08-12T18:51:31.965814Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.12659","last_updated":"2024-06-19T03:38:56Z","snapshot_observed_at":"2026-08-16T14:17:06.781974Z","submitted_at":"2024-02-20T02:16:16Z","title":"FinBen: A Holistic Financial Benchmark for Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.12659","snapshot_observed_at":"2026-08-12T18:51:31.971345Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.11266","last_updated":"2025-05-19T14:51:44Z","snapshot_observed_at":"2026-08-20T03:09:21.820083Z","submitted_at":"2024-11-18T03:45:34Z","title":"VersaTune: An Efficient Data Composition Framework for Training Multi-Capability LLMs","version":5},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-12T18:51:31.971345Z"},"links":{"cited_paper":"/paper/2402.12659","citing_paper":"/paper/2411.11266"},"observation_digest":"sha256:28dcd7bcdd3e779bc4a8c29809ab49f832fe8e7439bf0849bc6ad5f19dd676e4","observation_id":"7d27460d-a6fa-492c-b676-19855c405379","resolution":{"observed_at":"2026-08-12T18:51:31.971345Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:51:33.373549Z","title":null,"venue":null,"work_id":"d06f738c-cb87-4bdf-ae93-730945051ab3","year":2024},"citing_paper":{"arxiv_id":"2411.11266","last_updated":"2025-05-19T14:51:44Z","snapshot_observed_at":"2026-08-20T03:09:21.820083Z","submitted_at":"2024-11-18T03:45:34Z","title":"VersaTune: An Efficient Data Composition Framework for Training Multi-Capability LLMs","version":5},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-12T18:51:31.977294Z"},"links":{"citing_paper":"/paper/2411.11266"},"observation_digest":"sha256:fbbedc8a28146776dd403096aa912f3cda420e01de51126864c1cd7769dd57eb","observation_id":"a6a1984a-f998-4f6a-9a6e-9093f9324d7c","resolution":{"observed_at":"2026-08-12T18:51:33.378865Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:51:33.354297Z","title":null,"venue":null,"work_id":"652d6e80-5032-4cce-b48e-0344f17669d0","year":2024},"citing_paper":{"arxiv_id":"2411.11266","last_updated":"2025-05-19T14:51:44Z","snapshot_observed_at":"2026-08-20T03:09:21.820083Z","submitted_at":"2024-11-18T03:45:34Z","title":"VersaTune: An Efficient Data Composition Framework for Training Multi-Capability LLMs","version":5},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-08-12T18:51:31.983003Z"},"links":{"citing_paper":"/paper/2411.11266"},"observation_digest":"sha256:69fe6ef1d08267c42e01cfda5dd25e025d9c7e34462888382287e6d593739bf4","observation_id":"a0954c00-72ca-4b18-ab21-db6ea88ecfef","resolution":{"observed_at":"2026-08-12T18:51:33.359781Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.10671","last_updated":"2024-09-10T13:25:53Z","snapshot_observed_at":"2026-08-17T11:08:48.802438Z","submitted_at":"2024-07-15T12:35:42Z","title":"Qwen2 Technical Report","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.10671","snapshot_observed_at":"2026-08-12T18:51:31.988167Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.11266","last_updated":"2025-05-19T14:51:44Z","snapshot_observed_at":"2026-08-20T03:09:21.820083Z","submitted_at":"2024-11-18T03:45:34Z","title":"VersaTune: An Efficient Data Composition Framework for Training Multi-Capability LLMs","version":5},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-08-12T18:51:31.988167Z"},"links":{"cited_paper":"/paper/2407.10671","citing_paper":"/paper/2411.11266"},"observation_digest":"sha256:8ce9e11e87360183f2b40b6ffd8fe3294d213db2adee122a5bd85d14e4d7a854","observation_id":"adf89d80-f987-4b37-9250-7348b7b5d3ad","resolution":{"observed_at":"2026-08-12T18:51:31.988167Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:51:33.335788Z","title":null,"venue":null,"work_id":"a575ae53-595b-4a56-b59f-12d4602cba9d","year":2022},"citing_paper":{"arxiv_id":"2411.11266","last_updated":"2025-05-19T14:51:44Z","snapshot_observed_at":"2026-08-20T03:09:21.820083Z","submitted_at":"2024-11-18T03:45:34Z","title":"VersaTune: An Efficient Data Composition Framework for Training Multi-Capability LLMs","version":5},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-08-12T18:51:31.994220Z"},"links":{"citing_paper":"/paper/2411.11266"},"observation_digest":"sha256:6b5b582b479667989b112840d66313a9e4a1c0366d16323a028b933c4f527dfa","observation_id":"03a558a2-414a-4702-b09e-3a66c94093fe","resolution":{"observed_at":"2026-08-12T18:51:33.341148Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.08853","last_updated":"2023-05-11T07:10:32Z","snapshot_observed_at":"2026-08-16T16:07:58.137497Z","submitted_at":"2022-12-17T11:56:21Z","title":"HyPe: Better Pre-trained Language Model Fine-tuning with Hidden Representation Perturbation","version":2},"cited_work":{"arxiv_id":"2212.08853","doi":null,"metadata_source":"pith","pith_arxiv_id":"2212.08853","snapshot_observed_at":"2026-08-12T18:51:32.348881Z","title":"HyPe: Better Pre-trained Language Model Fine-tuning with Hidden Representation Perturbation","venue":"cs.CL","work_id":"4fbfe5f4-d060-4241-895c-029a57698419","year":2022},"citing_paper":{"arxiv_id":"2411.11266","last_updated":"2025-05-19T14:51:44Z","snapshot_observed_at":"2026-08-20T03:09:21.820083Z","submitted_at":"2024-11-18T03:45:34Z","title":"VersaTune: An Efficient Data Composition Framework for Training Multi-Capability LLMs","version":5},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-08-12T18:51:32.002376Z"},"links":{"cited_paper":"/paper/2212.08853","citing_paper":"/paper/2411.11266"},"observation_digest":"sha256:f2dcea527abc80da9911e1e3b031c896536382d31aa6c153213b261634b2fa1b","observation_id":"e64d8ed5-eba6-46f2-b676-cfb25cf79b0a","resolution":{"observed_at":"2026-08-12T18:51:32.359478Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1905.07830","last_updated":"2019-05-19T23:57:23Z","snapshot_observed_at":"2026-08-15T09:37:44.321271Z","submitted_at":"2019-05-19T23:57:23Z","title":"HellaSwag: Can a Machine Really Finish Your Sentence?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1905.07830","snapshot_observed_at":"2026-08-12T18:51:32.008504Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2411.11266","last_updated":"2025-05-19T14:51:44Z","snapshot_observed_at":"2026-08-20T03:09:21.820083Z","submitted_at":"2024-11-18T03:45:34Z","title":"VersaTune: An Efficient Data Composition Framework for Training Multi-Capability LLMs","version":5},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-08-12T18:51:32.008504Z"},"links":{"cited_paper":"/paper/1905.07830","citing_paper":"/paper/2411.11266"},"observation_digest":"sha256:0d5ad6c1027681f2b53c8e8794359c8e23deaec677a8199bf68d725aadf14648","observation_id":"db8947d3-7676-4658-bfac-944f5d5855c6","resolution":{"observed_at":"2026-08-12T18:51:32.008504Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.07950","last_updated":"2024-11-18T05:30:50Z","snapshot_observed_at":"2026-08-16T14:27:20.123142Z","submitted_at":"2024-01-15T20:22:21Z","title":"SciInstruct: a Self-Reflective Instruction Annotated Dataset for Training Scientific Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.07950","snapshot_observed_at":"2026-08-12T18:51:32.017260Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.11266","last_updated":"2025-05-19T14:51:44Z","snapshot_observed_at":"2026-08-20T03:09:21.820083Z","submitted_at":"2024-11-18T03:45:34Z","title":"VersaTune: An Efficient Data Composition Framework for Training Multi-Capability LLMs","version":5},"reference_index":63,"source":"arxiv_source","source_observed_at":"2026-08-12T18:51:32.017260Z"},"links":{"cited_paper":"/paper/2401.07950","citing_paper":"/paper/2411.11266"},"observation_digest":"sha256:867a53a63f5eaa99d4c1e8191f1d51149ef5da2378da47f6e45c9b213fd6dde0","observation_id":"343e5d56-76eb-4718-b144-589d398aebd5","resolution":{"observed_at":"2026-08-12T18:51:32.017260Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.09975","last_updated":"2024-12-08T06:34:31Z","snapshot_observed_at":"2026-08-18T20:12:46.554880Z","submitted_at":"2023-08-19T10:38:00Z","title":"FinEval: A Chinese Financial Domain Knowledge Evaluation Benchmark for Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.09975","snapshot_observed_at":"2026-08-12T18:51:32.027610Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.11266","last_updated":"2025-05-19T14:51:44Z","snapshot_observed_at":"2026-08-20T03:09:21.820083Z","submitted_at":"2024-11-18T03:45:34Z","title":"VersaTune: An Efficient Data Composition Framework for Training Multi-Capability LLMs","version":5},"reference_index":64,"source":"arxiv_source","source_observed_at":"2026-08-12T18:51:32.027610Z"},"links":{"cited_paper":"/paper/2308.09975","citing_paper":"/paper/2411.11266"},"observation_digest":"sha256:0842578443a046dcd702ab8cf3b4a570268e3cf923f123db4852f69e7af5c68c","observation_id":"87159dc8-6665-4f18-95bc-02f37debd5d9","resolution":{"observed_at":"2026-08-12T18:51:32.027610Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:51:33.314175Z","title":null,"venue":null,"work_id":"095fd4a0-7000-4660-a3aa-5ecc8ec3dd3c","year":2023},"citing_paper":{"arxiv_id":"2411.11266","last_updated":"2025-05-19T14:51:44Z","snapshot_observed_at":"2026-08-20T03:09:21.820083Z","submitted_at":"2024-11-18T03:45:34Z","title":"VersaTune: An Efficient Data Composition Framework for Training Multi-Capability LLMs","version":5},"reference_index":65,"source":"arxiv_source","source_observed_at":"2026-08-12T18:51:32.041944Z"},"links":{"citing_paper":"/paper/2411.11266"},"observation_digest":"sha256:c91fe2166ed39df0688f2176ea77a1dc141c9343fef285a13848faf45840e96a","observation_id":"4a18309e-b64f-4b0b-a454-7f6a08a15c28","resolution":{"observed_at":"2026-08-12T18:51:33.320048Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.18223","last_updated":"2026-03-18T05:34:39Z","snapshot_observed_at":"2026-08-14T10:40:26.323157Z","submitted_at":"2023-03-31T17:28:46Z","title":"A Survey of Large Language Models","version":19},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.18223","snapshot_observed_at":"2026-08-12T18:51:32.057748Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.11266","last_updated":"2025-05-19T14:51:44Z","snapshot_observed_at":"2026-08-20T03:09:21.820083Z","submitted_at":"2024-11-18T03:45:34Z","title":"VersaTune: An Efficient Data Composition Framework for Training Multi-Capability LLMs","version":5},"reference_index":66,"source":"arxiv_source","source_observed_at":"2026-08-12T18:51:32.057748Z"},"links":{"cited_paper":"/paper/2303.18223","citing_paper":"/paper/2411.11266"},"observation_digest":"sha256:fbb8cc7c93e8ec9a5a7e2f93480f7180dbd335f13bb7074c8877f1a0f6332247","observation_id":"3a1dc180-dea3-43d4-9ece-9ec03af1eaa3","resolution":{"observed_at":"2026-08-12T18:51:32.057748Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.17918","last_updated":"2024-03-21T10:57:23Z","snapshot_observed_at":"2026-08-16T14:48:23.217417Z","submitted_at":"2023-10-27T06:22:14Z","title":"Knowing What LLMs DO NOT Know: A Simple Yet Effective Self-Detection Method","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.17918","snapshot_observed_at":"2026-08-12T18:51:32.065837Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.11266","last_updated":"2025-05-19T14:51:44Z","snapshot_observed_at":"2026-08-20T03:09:21.820083Z","submitted_at":"2024-11-18T03:45:34Z","title":"VersaTune: An Efficient Data Composition Framework for Training Multi-Capability LLMs","version":5},"reference_index":67,"source":"arxiv_source","source_observed_at":"2026-08-12T18:51:32.065837Z"},"links":{"cited_paper":"/paper/2310.17918","citing_paper":"/paper/2411.11266"},"observation_digest":"sha256:f2e1187eeaaa1f92e100a64409129f333eca9be106b01364e0aa736c77dea34f","observation_id":"d9a6b5cd-770f-4267-9887-ec304e8f23cb","resolution":{"observed_at":"2026-08-12T18:51:32.065837Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.06364","last_updated":"2023-09-18T14:23:02Z","snapshot_observed_at":"2026-08-07T12:51:50.861720Z","submitted_at":"2023-04-13T09:39:30Z","title":"AGIEval: A Human-Centric Benchmark for Evaluating Foundation Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.06364","snapshot_observed_at":"2026-08-12T18:51:32.072557Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.11266","last_updated":"2025-05-19T14:51:44Z","snapshot_observed_at":"2026-08-20T03:09:21.820083Z","submitted_at":"2024-11-18T03:45:34Z","title":"VersaTune: An Efficient Data Composition Framework for Training Multi-Capability LLMs","version":5},"reference_index":68,"source":"arxiv_source","source_observed_at":"2026-08-12T18:51:32.072557Z"},"links":{"cited_paper":"/paper/2304.06364","citing_paper":"/paper/2411.11266"},"observation_digest":"sha256:f9b495947125d66189ff813b60b78e0f004f4418db95a0ed103cb4d42cb875c8","observation_id":"647feef1-e139-46ad-a26a-5c623538ab62","resolution":{"observed_at":"2026-08-12T18:51:32.072557Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:51:32.081037Z","title":"online\" 'onlinestring :=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.11266","last_updated":"2025-05-19T14:51:44Z","snapshot_observed_at":"2026-08-20T03:09:21.820083Z","submitted_at":"2024-11-18T03:45:34Z","title":"VersaTune: An Efficient Data Composition Framework for Training Multi-Capability LLMs","version":5},"reference_index":69,"source":"arxiv_source","source_observed_at":"2026-08-12T18:51:32.081037Z"},"links":{"citing_paper":"/paper/2411.11266"},"observation_digest":"sha256:332fb27627eec2cfee9f2221f1bba54b0ae8ea07a3c74f173b4220a97786dbd7","observation_id":"3fa1892e-a29f-4298-8d19-669ed792b295","resolution":{"observed_at":"2026-08-12T18:51:32.081037Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:51:32.098357Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.11266","last_updated":"2025-05-19T14:51:44Z","snapshot_observed_at":"2026-08-20T03:09:21.820083Z","submitted_at":"2024-11-18T03:45:34Z","title":"VersaTune: An Efficient Data Composition Framework for Training Multi-Capability LLMs","version":5},"reference_index":70,"source":"arxiv_source","source_observed_at":"2026-08-12T18:51:32.098357Z"},"links":{"citing_paper":"/paper/2411.11266"},"observation_digest":"sha256:6fec71bcecfb963e41c4f21210737670c0893b5dc08a3c43cac1f544e0d8d276","observation_id":"af8b5b03-435b-4a10-a539-ed85f990b9af","resolution":{"observed_at":"2026-08-12T18:51:32.098357Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2411.11266","last_updated":"2025-05-19T14:51:44Z","latest_version":5,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-20T03:09:21.820083Z","submitted_at":"2024-11-18T03:45:34Z","title":"VersaTune: An Efficient Data Composition Framework for Training Multi-Capability LLMs"},"reference_resolution":{"displayed":70,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":68,"verified_exact":1,"verified_fuzzy":1},"total_outbound_references":70},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"thesis":"As of 21 August 2026, this Paper Citation Record lists 70 of 70 outbound references and 1 inbound Pith citation observation for arXiv:2411.11266."}