{"as_of":"2026-08-07T15:43:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:fa9a91875c5c8e246d21b334758315adc7c54e40049c5598f04482ee0910d98a","coverage":[{"denominator":42,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":42,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T04:37:09.300569Z","state":"measured"},{"denominator":42,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":42,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2506.10288/citation-record","integrity":"/paper/2506.10288/integrity","json":"/paper/2506.10288/citation-record.json","paper":"/paper/2506.10288"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:37:11.673750Z","title":null,"venue":null,"work_id":"b4f0812c-c442-4590-a5de-08536971b884","year":2024},"citing_paper":{"arxiv_id":"2506.10288","last_updated":"2025-06-12T01:53:01Z","snapshot_observed_at":"2026-08-07T04:27:46.870736Z","submitted_at":"2025-06-12T01:53:01Z","title":"ClusterUCB: Efficient Gradient-Based Data Selection for Targeted Fine-Tuning of LLMs","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-07T04:37:06.114224Z"},"links":{"citing_paper":"/paper/2506.10288"},"observation_digest":"sha256:3b336ef755025b02576b7717959770af1c3075d03160d47426b257f9a17cc7c0","observation_id":"df4e11c0-f54a-49fb-aa27-f92666091e6a","resolution":{"observed_at":"2026-08-07T04:37:11.679134Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:37:11.651345Z","title":null,"venue":null,"work_id":"e7ed125a-6d82-4d76-8391-86fa68a41616","year":2002},"citing_paper":{"arxiv_id":"2506.10288","last_updated":"2025-06-12T01:53:01Z","snapshot_observed_at":"2026-08-07T04:27:46.870736Z","submitted_at":"2025-06-12T01:53:01Z","title":"ClusterUCB: Efficient Gradient-Based Data Selection for Targeted Fine-Tuning of LLMs","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-07T04:37:06.156102Z"},"links":{"citing_paper":"/paper/2506.10288"},"observation_digest":"sha256:2e8a91a3574512b7e78b8799fd60e715f3fde64b9cc0a1991241f942e14a8ae3","observation_id":"65479b54-8ceb-4a9c-903b-69f1a1711ae5","resolution":{"observed_at":"2026-08-07T04:37:11.658302Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.06290","last_updated":"2024-07-26T18:09:11Z","snapshot_observed_at":"2026-07-06T15:53:19.485466Z","submitted_at":"2023-07-12T16:37:31Z","title":"Instruction Mining: Instruction Data Selection for Tuning Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.06290","snapshot_observed_at":"2026-08-07T04:37:06.226403Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.10288","last_updated":"2025-06-12T01:53:01Z","snapshot_observed_at":"2026-08-07T04:27:46.870736Z","submitted_at":"2025-06-12T01:53:01Z","title":"ClusterUCB: Efficient Gradient-Based Data Selection for Targeted Fine-Tuning of LLMs","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-07T04:37:06.226403Z"},"links":{"cited_paper":"/paper/2307.06290","citing_paper":"/paper/2506.10288"},"observation_digest":"sha256:a1a75da34c16b99d5f1401a600bc4af029b07a766d610e0e972ec29c6c2bb73f","observation_id":"08b7ce6f-70e8-4e2e-a172-63c699e58f94","resolution":{"observed_at":"2026-08-07T04:37:06.226403Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:37:11.632802Z","title":null,"venue":null,"work_id":"196fbb12-72bd-4905-b73e-3888babb1f63","year":2019},"citing_paper":{"arxiv_id":"2506.10288","last_updated":"2025-06-12T01:53:01Z","snapshot_observed_at":"2026-08-07T04:27:46.870736Z","submitted_at":"2025-06-12T01:53:01Z","title":"ClusterUCB: Efficient Gradient-Based Data Selection for Targeted Fine-Tuning of LLMs","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-07T04:37:06.296774Z"},"links":{"citing_paper":"/paper/2506.10288"},"observation_digest":"sha256:8bc3660cf10596d37484acca1c3e3fe008d097449387710f5245abd91d5a498f","observation_id":"faf3c16c-b1e9-4612-8a9e-88f9cc486220","resolution":{"observed_at":"2026-08-07T04:37:11.638741Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:37:06.384844Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.10288","last_updated":"2025-06-12T01:53:01Z","snapshot_observed_at":"2026-08-07T04:27:46.870736Z","submitted_at":"2025-06-12T01:53:01Z","title":"ClusterUCB: Efficient Gradient-Based Data Selection for Targeted Fine-Tuning of LLMs","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-07T04:37:06.384844Z"},"links":{"citing_paper":"/paper/2506.10288"},"observation_digest":"sha256:9d9c7dded1b1b34b643b543c2b17eec11e17c92d4b49a894d4fd7c460e6087c8","observation_id":"961c0bfe-c3a1-4baa-a6d3-db5ee2918cc9","resolution":{"observed_at":"2026-08-07T04:37:06.384844Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2107.03374","last_updated":"2021-07-14T17:16:02Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-07-07T17:41:24Z","title":"Evaluating Large Language Models Trained on Code","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2107.03374","snapshot_observed_at":"2026-08-07T04:37:06.449634Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.10288","last_updated":"2025-06-12T01:53:01Z","snapshot_observed_at":"2026-08-07T04:27:46.870736Z","submitted_at":"2025-06-12T01:53:01Z","title":"ClusterUCB: Efficient Gradient-Based Data Selection for Targeted Fine-Tuning of LLMs","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-07T04:37:06.449634Z"},"links":{"cited_paper":"/paper/2107.03374","citing_paper":"/paper/2506.10288"},"observation_digest":"sha256:9ea8c04af5ab343cb71c19cf32b121546b566bc3e645e308a629e9c01325b997","observation_id":"a2e129c0-9dca-4513-a456-bf220e3b9162","resolution":{"observed_at":"2026-08-07T04:37:06.449634Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:37:11.602645Z","title":null,"venue":null,"work_id":"186bfe3a-2afe-43e5-a1e8-b61302ddb7be","year":2024},"citing_paper":{"arxiv_id":"2506.10288","last_updated":"2025-06-12T01:53:01Z","snapshot_observed_at":"2026-08-07T04:27:46.870736Z","submitted_at":"2025-06-12T01:53:01Z","title":"ClusterUCB: Efficient Gradient-Based Data Selection for Targeted Fine-Tuning of LLMs","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-07T04:37:06.496014Z"},"links":{"citing_paper":"/paper/2506.10288"},"observation_digest":"sha256:090a34e45d44bd955e84ac2d2f7beb316bb6e8e7ef19a965996f320dab328e08","observation_id":"b1a7c554-93ad-46dd-a667-a84d1fef4b9c","resolution":{"observed_at":"2026-08-07T04:37:11.607715Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:37:06.562807Z","title":"Gonzalez, Ion Stoica, and Eric P","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.10288","last_updated":"2025-06-12T01:53:01Z","snapshot_observed_at":"2026-08-07T04:27:46.870736Z","submitted_at":"2025-06-12T01:53:01Z","title":"ClusterUCB: Efficient Gradient-Based Data Selection for Targeted Fine-Tuning of LLMs","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-07T04:37:06.562807Z"},"links":{"citing_paper":"/paper/2506.10288"},"observation_digest":"sha256:fc5aa62dec8cc0d2439924d07a0c8041ea473fc342ad5c6174f08c12ef9a905d","observation_id":"a89fac9d-dc25-45ab-aef6-60aa283567a1","resolution":{"observed_at":"2026-08-07T04:37:06.562807Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:37:11.568458Z","title":null,"venue":null,"work_id":"bcdcde7b-bafa-45ca-98c6-d62939e8bac0","year":2020},"citing_paper":{"arxiv_id":"2506.10288","last_updated":"2025-06-12T01:53:01Z","snapshot_observed_at":"2026-08-07T04:27:46.870736Z","submitted_at":"2025-06-12T01:53:01Z","title":"ClusterUCB: Efficient Gradient-Based Data Selection for Targeted Fine-Tuning of LLMs","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-07T04:37:06.631406Z"},"links":{"citing_paper":"/paper/2506.10288"},"observation_digest":"sha256:485321133229be32da6e9d9ad60510abfb98f928e0bf9edc16428134fbe4a53e","observation_id":"9fc0fb34-09be-4bc4-980b-726a8abb8aa8","resolution":{"observed_at":"2026-08-07T04:37:11.573590Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2110.14168","last_updated":"2021-11-18T00:23:45Z","snapshot_observed_at":"2026-08-07T01:45:38.840969Z","submitted_at":"2021-10-27T04:49:45Z","title":"Training Verifiers to Solve Math Word Problems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.14168","snapshot_observed_at":"2026-08-07T04:37:06.690020Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.10288","last_updated":"2025-06-12T01:53:01Z","snapshot_observed_at":"2026-08-07T04:27:46.870736Z","submitted_at":"2025-06-12T01:53:01Z","title":"ClusterUCB: Efficient Gradient-Based Data Selection for Targeted Fine-Tuning of LLMs","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-07T04:37:06.690020Z"},"links":{"cited_paper":"/paper/2110.14168","citing_paper":"/paper/2506.10288"},"observation_digest":"sha256:4bcb54585c2250aba01c527efe75b6bf4ae2a4eb3c4f3b932f75d29e5d100395","observation_id":"6301be37-9f1d-4ec7-afb9-4658ad9faf78","resolution":{"observed_at":"2026-08-07T04:37:06.690020Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:37:11.550193Z","title":null,"venue":null,"work_id":"8fb24a20-7e75-4238-addb-51355babf14e","year":2023},"citing_paper":{"arxiv_id":"2506.10288","last_updated":"2025-06-12T01:53:01Z","snapshot_observed_at":"2026-08-07T04:27:46.870736Z","submitted_at":"2025-06-12T01:53:01Z","title":"ClusterUCB: Efficient Gradient-Based Data Selection for Targeted Fine-Tuning of LLMs","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-07T04:37:06.773060Z"},"links":{"citing_paper":"/paper/2506.10288"},"observation_digest":"sha256:40c12f58a0879daabf4b2cb6c1a3454dd7e4fadf892eeeff1bd08a230a57afbf","observation_id":"8145d598-946e-44d3-9202-e8dc8511f45a","resolution":{"observed_at":"2026-08-07T04:37:11.555948Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:37:11.530317Z","title":null,"venue":null,"work_id":"eabbe9d1-092a-4b63-ad8e-b45da08b6085","year":2023},"citing_paper":{"arxiv_id":"2506.10288","last_updated":"2025-06-12T01:53:01Z","snapshot_observed_at":"2026-08-07T04:27:46.870736Z","submitted_at":"2025-06-12T01:53:01Z","title":"ClusterUCB: Efficient Gradient-Based Data Selection for Targeted Fine-Tuning of LLMs","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-07T04:37:06.810078Z"},"links":{"citing_paper":"/paper/2506.10288"},"observation_digest":"sha256:b440085ad02af11b81a0a8ee682405eb8e0232ec392641b22bf34eb5e87d87b3","observation_id":"18b72c50-c6f0-4f17-bfb1-567e97f20db5","resolution":{"observed_at":"2026-08-07T04:37:11.535903Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:37:11.511559Z","title":null,"venue":null,"work_id":"651d17e0-0118-4194-ab82-85adf2c7ca23","year":2024},"citing_paper":{"arxiv_id":"2506.10288","last_updated":"2025-06-12T01:53:01Z","snapshot_observed_at":"2026-08-07T04:27:46.870736Z","submitted_at":"2025-06-12T01:53:01Z","title":"ClusterUCB: Efficient Gradient-Based Data Selection for Targeted Fine-Tuning of LLMs","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-07T04:37:06.868618Z"},"links":{"citing_paper":"/paper/2506.10288"},"observation_digest":"sha256:71763b8c7643dd1e6b0edf19d5d1963d5938996c1637ba6cd96c90a5a4a3eeff","observation_id":"dc6c4c28-6c3f-4f03-a758-639dbf999698","resolution":{"observed_at":"2026-08-07T04:37:11.516676Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:37:11.489551Z","title":null,"venue":null,"work_id":"6748e796-ba08-4e80-9d30-011b750021af","year":2024},"citing_paper":{"arxiv_id":"2506.10288","last_updated":"2025-06-12T01:53:01Z","snapshot_observed_at":"2026-08-07T04:27:46.870736Z","submitted_at":"2025-06-12T01:53:01Z","title":"ClusterUCB: Efficient Gradient-Based Data Selection for Targeted Fine-Tuning of LLMs","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-07T04:37:06.975047Z"},"links":{"citing_paper":"/paper/2506.10288"},"observation_digest":"sha256:e5dd4a01e90e3c95cf357312031b614aef88156499ea1a097670ae6198506650","observation_id":"61172610-e31a-4b7b-aab5-7a6241e65146","resolution":{"observed_at":"2026-08-07T04:37:11.498492Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08114","last_updated":"2023-03-14T17:47:25Z","snapshot_observed_at":"2026-07-06T15:03:16.833701Z","submitted_at":"2023-03-14T17:47:25Z","title":"Simfluence: Modeling the Influence of Individual Training Examples by Simulating Training Runs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08114","snapshot_observed_at":"2026-08-07T04:37:07.062387Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.10288","last_updated":"2025-06-12T01:53:01Z","snapshot_observed_at":"2026-08-07T04:27:46.870736Z","submitted_at":"2025-06-12T01:53:01Z","title":"ClusterUCB: Efficient Gradient-Based Data Selection for Targeted Fine-Tuning of LLMs","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-07T04:37:07.062387Z"},"links":{"cited_paper":"/paper/2303.08114","citing_paper":"/paper/2506.10288"},"observation_digest":"sha256:d070458cd4f5b01fa4c6a1ace814e9b1b1dadf922f067b852f8b11503c90150e","observation_id":"97adf9dc-8b66-410b-abf6-5114cd7a7516","resolution":{"observed_at":"2026-08-07T04:37:07.062387Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:37:11.459912Z","title":null,"venue":null,"work_id":"c00cc172-068e-41bc-8ded-d12137591c06","year":1974},"citing_paper":{"arxiv_id":"2506.10288","last_updated":"2025-06-12T01:53:01Z","snapshot_observed_at":"2026-08-07T04:27:46.870736Z","submitted_at":"2025-06-12T01:53:01Z","title":"ClusterUCB: Efficient Gradient-Based Data Selection for Targeted Fine-Tuning of LLMs","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-07T04:37:07.141095Z"},"links":{"citing_paper":"/paper/2506.10288"},"observation_digest":"sha256:d6b2f155a980d5c7b2120c098ecd3646c1514444cc4fd5ea980442c3f72c67e2","observation_id":"81fefc11-8a33-4f76-a77d-0b8ef9fb22de","resolution":{"observed_at":"2026-08-07T04:37:11.466211Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:37:11.394830Z","title":null,"venue":null,"work_id":"bf879bb4-ad6f-4c99-868e-dc2eab69cbd6","year":1979},"citing_paper":{"arxiv_id":"2506.10288","last_updated":"2025-06-12T01:53:01Z","snapshot_observed_at":"2026-08-07T04:27:46.870736Z","submitted_at":"2025-06-12T01:53:01Z","title":"ClusterUCB: Efficient Gradient-Based Data Selection for Targeted Fine-Tuning of LLMs","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-07T04:37:07.192199Z"},"links":{"citing_paper":"/paper/2506.10288"},"observation_digest":"sha256:377a9420fac79b3828a12ec78ff4cab68af1d65d25209a59e3eb89851b984278","observation_id":"9f3a3e30-0521-4b0a-bef9-5f7ae90b7618","resolution":{"observed_at":"2026-08-07T04:37:11.406443Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.15846","last_updated":"2024-06-18T13:16:36Z","snapshot_observed_at":"2026-08-03T19:57:23.894721Z","submitted_at":"2024-04-24T12:51:14Z","title":"From Complex to Simple: Enhancing Multi-Constraint Complex Instruction Following Ability of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.15846","snapshot_observed_at":"2026-08-07T04:37:07.323094Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.10288","last_updated":"2025-06-12T01:53:01Z","snapshot_observed_at":"2026-08-07T04:27:46.870736Z","submitted_at":"2025-06-12T01:53:01Z","title":"ClusterUCB: Efficient Gradient-Based Data Selection for Targeted Fine-Tuning of LLMs","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-07T04:37:07.323094Z"},"links":{"cited_paper":"/paper/2404.15846","citing_paper":"/paper/2506.10288"},"observation_digest":"sha256:adab56b1794d7c9cc26f300a6e99840345d5e3d748614e1f1ca87905648eb25e","observation_id":"32cdd0de-2abb-4cbb-a09d-f93446123463","resolution":{"observed_at":"2026-08-07T04:37:07.323094Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:37:07.376714Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.10288","last_updated":"2025-06-12T01:53:01Z","snapshot_observed_at":"2026-08-07T04:27:46.870736Z","submitted_at":"2025-06-12T01:53:01Z","title":"ClusterUCB: Efficient Gradient-Based Data Selection for Targeted Fine-Tuning of LLMs","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-07T04:37:07.376714Z"},"links":{"citing_paper":"/paper/2506.10288"},"observation_digest":"sha256:338c8026590529deb2e1181e1d6cb8e23c58c2e157ebc0e689edb3f61221c35d","observation_id":"bd565edd-119c-4ec2-88bd-53458e1dc298","resolution":{"observed_at":"2026-08-07T04:37:07.376714Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:37:11.339297Z","title":"Hu, Yelong Shen, Phillip Wallis, Zeyuan Allen - Zhu, Yuanzhi Li, Shean Wang, Lu Wang, and Weizhu Chen","venue":null,"work_id":"5a6531aa-1a4d-400d-a256-4377e431a10d","year":2022},"citing_paper":{"arxiv_id":"2506.10288","last_updated":"2025-06-12T01:53:01Z","snapshot_observed_at":"2026-08-07T04:27:46.870736Z","submitted_at":"2025-06-12T01:53:01Z","title":"ClusterUCB: Efficient Gradient-Based Data Selection for Targeted Fine-Tuning of LLMs","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-07T04:37:07.487073Z"},"links":{"citing_paper":"/paper/2506.10288"},"observation_digest":"sha256:2c2cd8a65823c1e90a24b95f30567e869f2a9c2dc51f24c3749cc802b0c52763","observation_id":"6b9ba8ba-a775-4d65-885c-631b47816d17","resolution":{"observed_at":"2026-08-07T04:37:11.349444Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2202.00622","last_updated":"2022-02-01T18:15:24Z","snapshot_observed_at":"2026-08-05T23:13:05.033311Z","submitted_at":"2022-02-01T18:15:24Z","title":"Datamodels: Predicting Predictions from Training Data","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2202.00622","snapshot_observed_at":"2026-08-07T04:37:07.529636Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.10288","last_updated":"2025-06-12T01:53:01Z","snapshot_observed_at":"2026-08-07T04:27:46.870736Z","submitted_at":"2025-06-12T01:53:01Z","title":"ClusterUCB: Efficient Gradient-Based Data Selection for Targeted Fine-Tuning of LLMs","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-07T04:37:07.529636Z"},"links":{"cited_paper":"/paper/2202.00622","citing_paper":"/paper/2506.10288"},"observation_digest":"sha256:d5eae062e045f43dd6a4ede0542e5d5074d48bdd0738cb43d9c137cbb0893f0c","observation_id":"6415c1dd-76b9-4ad8-bea5-b82eb2c27afd","resolution":{"observed_at":"2026-08-07T04:37:07.529636Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:37:11.304560Z","title":"o pf, Yannic Kilcher, Dimitri von R \\","venue":null,"work_id":"2a1c381a-ad0a-4212-ac7d-4a8f90c1af2d","year":2023},"citing_paper":{"arxiv_id":"2506.10288","last_updated":"2025-06-12T01:53:01Z","snapshot_observed_at":"2026-08-07T04:27:46.870736Z","submitted_at":"2025-06-12T01:53:01Z","title":"ClusterUCB: Efficient Gradient-Based Data Selection for Targeted Fine-Tuning of LLMs","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-07T04:37:07.599652Z"},"links":{"citing_paper":"/paper/2506.10288"},"observation_digest":"sha256:6a399d8bdb3a02936ab88f0903430065dd76659cc3d75c82446542c40b9d9460","observation_id":"e5906dc7-45d6-43fb-ab4b-2506d7ebabfc","resolution":{"observed_at":"2026-08-07T04:37:11.317634Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:37:11.281647Z","title":null,"venue":null,"work_id":"6d0fe9fc-8f6b-46b6-ba06-b2f8b5113a48","year":2023},"citing_paper":{"arxiv_id":"2506.10288","last_updated":"2025-06-12T01:53:01Z","snapshot_observed_at":"2026-08-07T04:27:46.870736Z","submitted_at":"2025-06-12T01:53:01Z","title":"ClusterUCB: Efficient Gradient-Based Data Selection for Targeted Fine-Tuning of LLMs","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-07T04:37:07.703498Z"},"links":{"citing_paper":"/paper/2506.10288"},"observation_digest":"sha256:22067e056b2c0840094f347982b72c7681525737d0c444a8863bafa332e3940a","observation_id":"7a1e9d28-07a2-4c1d-9544-5bba26a38e4d","resolution":{"observed_at":"2026-08-07T04:37:11.287636Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.07840","last_updated":"2024-10-03T17:56:12Z","snapshot_observed_at":"2026-07-06T17:58:56.081219Z","submitted_at":"2024-04-11T15:27:56Z","title":"On Training Data Influence of GPT Models","version":3},"cited_work":{"arxiv_id":"2404.07840","doi":null,"metadata_source":"pith","pith_arxiv_id":"2404.07840","snapshot_observed_at":"2026-08-07T04:37:09.595224Z","title":"On Training Data Influence of GPT Models","venue":"cs.CL","work_id":"e5b7be6c-0c67-4c4b-a7ce-ba6142013241","year":2024},"citing_paper":{"arxiv_id":"2506.10288","last_updated":"2025-06-12T01:53:01Z","snapshot_observed_at":"2026-08-07T04:27:46.870736Z","submitted_at":"2025-06-12T01:53:01Z","title":"ClusterUCB: Efficient Gradient-Based Data Selection for Targeted Fine-Tuning of LLMs","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-07T04:37:07.755069Z"},"links":{"cited_paper":"/paper/2404.07840","citing_paper":"/paper/2506.10288"},"observation_digest":"sha256:190b4dbf49f326771dc9df4230d7155380aa5a2b2569f3c274cbb6784cb369fc","observation_id":"c11286b3-e458-449a-8a2d-2bc6af9b4751","resolution":{"observed_at":"2026-08-07T04:37:09.688569Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:37:11.260780Z","title":"Le, Barret Zoph, Jason Wei, and Adam Roberts","venue":null,"work_id":"5e711bc2-d687-4746-bf9b-7c2840a05e71","year":2023},"citing_paper":{"arxiv_id":"2506.10288","last_updated":"2025-06-12T01:53:01Z","snapshot_observed_at":"2026-08-07T04:27:46.870736Z","submitted_at":"2025-06-12T01:53:01Z","title":"ClusterUCB: Efficient Gradient-Based Data Selection for Targeted Fine-Tuning of LLMs","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-07T04:37:07.855541Z"},"links":{"citing_paper":"/paper/2506.10288"},"observation_digest":"sha256:3ff978bfe4f2e582e6a3dbd657785101e5a2694b95cae036e51abf05589e5858","observation_id":"8dced5ae-3f04-4745-8079-98d3d6bcee12","resolution":{"observed_at":"2026-08-07T04:37:11.266370Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.00533","last_updated":"2024-02-01T06:10:00Z","snapshot_observed_at":"2026-08-05T14:58:48.852459Z","submitted_at":"2023-10-01T00:52:24Z","title":"SELF: Self-Evolution with Language Feedback","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.00533","snapshot_observed_at":"2026-08-07T04:37:07.906797Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.10288","last_updated":"2025-06-12T01:53:01Z","snapshot_observed_at":"2026-08-07T04:27:46.870736Z","submitted_at":"2025-06-12T01:53:01Z","title":"ClusterUCB: Efficient Gradient-Based Data Selection for Targeted Fine-Tuning of LLMs","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-07T04:37:07.906797Z"},"links":{"cited_paper":"/paper/2310.00533","citing_paper":"/paper/2506.10288"},"observation_digest":"sha256:ee6198d8beb043a92c0217ae2f9a945fc4c80ff321ea230969619a0829eacf9f","observation_id":"6395f6dc-145c-40b2-95f7-9a8944569be9","resolution":{"observed_at":"2026-08-07T04:37:07.906797Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.07074","last_updated":"2023-08-15T07:37:32Z","snapshot_observed_at":"2026-07-06T16:05:55.074136Z","submitted_at":"2023-08-14T11:16:28Z","title":"#InsTag: Instruction Tagging for Analyzing Supervised Fine-tuning of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.07074","snapshot_observed_at":"2026-08-07T04:37:08.020597Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.10288","last_updated":"2025-06-12T01:53:01Z","snapshot_observed_at":"2026-08-07T04:27:46.870736Z","submitted_at":"2025-06-12T01:53:01Z","title":"ClusterUCB: Efficient Gradient-Based Data Selection for Targeted Fine-Tuning of LLMs","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-07T04:37:08.020597Z"},"links":{"cited_paper":"/paper/2308.07074","citing_paper":"/paper/2506.10288"},"observation_digest":"sha256:86c5358034d38b00b849e9d9b39f41c5ea853ef1f1ffdd527bf3737c4e78352b","observation_id":"115596c1-3ea2-4d5d-96d6-837772734955","resolution":{"observed_at":"2026-08-07T04:37:08.020597Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:37:11.113174Z","title":null,"venue":null,"work_id":"8c323234-39de-4ae2-9673-609a62f4cf2a","year":2023},"citing_paper":{"arxiv_id":"2506.10288","last_updated":"2025-06-12T01:53:01Z","snapshot_observed_at":"2026-08-07T04:27:46.870736Z","submitted_at":"2025-06-12T01:53:01Z","title":"ClusterUCB: Efficient Gradient-Based Data Selection for Targeted Fine-Tuning of LLMs","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-07T04:37:08.078684Z"},"links":{"citing_paper":"/paper/2506.10288"},"observation_digest":"sha256:be5754ed67ba92187ade7adf12a0d91465d347a38f6b89c831d5b16517464027","observation_id":"b760bc22-39c7-4e5b-bad8-cf7955d9388f","resolution":{"observed_at":"2026-08-07T04:37:11.189192Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.03277","last_updated":"2023-04-06T17:58:09Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-04-06T17:58:09Z","title":"Instruction Tuning with GPT-4","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.03277","snapshot_observed_at":"2026-08-07T04:37:08.187154Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.10288","last_updated":"2025-06-12T01:53:01Z","snapshot_observed_at":"2026-08-07T04:27:46.870736Z","submitted_at":"2025-06-12T01:53:01Z","title":"ClusterUCB: Efficient Gradient-Based Data Selection for Targeted Fine-Tuning of LLMs","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-07T04:37:08.187154Z"},"links":{"cited_paper":"/paper/2304.03277","citing_paper":"/paper/2506.10288"},"observation_digest":"sha256:c33f134db138227162af645ba30144b1d7fefe24df9545c6a4a163c5da1cdde0","observation_id":"13d1dec7-047b-4c64-95a9-eabb9a96c322","resolution":{"observed_at":"2026-08-07T04:37:08.187154Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:37:10.922871Z","title":null,"venue":null,"work_id":"7eb88e28-be1c-40a8-96ae-dbc7735b2d8d","year":2020},"citing_paper":{"arxiv_id":"2506.10288","last_updated":"2025-06-12T01:53:01Z","snapshot_observed_at":"2026-08-07T04:27:46.870736Z","submitted_at":"2025-06-12T01:53:01Z","title":"ClusterUCB: Efficient Gradient-Based Data Selection for Targeted Fine-Tuning of LLMs","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-07T04:37:08.248011Z"},"links":{"citing_paper":"/paper/2506.10288"},"observation_digest":"sha256:c94f2b7e635015d075eb964d2cf983f79ce250ed9de21d7acc70634a03917fcf","observation_id":"4088cd49-ed96-4063-b688-d79961be1da6","resolution":{"observed_at":"2026-08-07T04:37:11.004836Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:37:08.337330Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.10288","last_updated":"2025-06-12T01:53:01Z","snapshot_observed_at":"2026-08-07T04:27:46.870736Z","submitted_at":"2025-06-12T01:53:01Z","title":"ClusterUCB: Efficient Gradient-Based Data Selection for Targeted Fine-Tuning of LLMs","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-07T04:37:08.337330Z"},"links":{"citing_paper":"/paper/2506.10288"},"observation_digest":"sha256:904c61228932d6037430f8ad9a73b64b9fde7562f75ce0e19cd776d8c28ec361","observation_id":"c32394f1-12aa-4ba0-9872-df76d5da4b11","resolution":{"observed_at":"2026-08-07T04:37:08.337330Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:37:08.412798Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.10288","last_updated":"2025-06-12T01:53:01Z","snapshot_observed_at":"2026-08-07T04:27:46.870736Z","submitted_at":"2025-06-12T01:53:01Z","title":"ClusterUCB: Efficient Gradient-Based Data Selection for Targeted Fine-Tuning of LLMs","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-07T04:37:08.412798Z"},"links":{"citing_paper":"/paper/2506.10288"},"observation_digest":"sha256:f30eedaee777a6d22775170297beff1c1fdeb87529527cccfadf0f27eda414ea","observation_id":"b6929635-699e-4b7c-af54-a8b38eabee1f","resolution":{"observed_at":"2026-08-07T04:37:08.412798Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09288","last_updated":"2023-07-19T17:08:59Z","snapshot_observed_at":"2026-08-07T12:56:43.323460Z","submitted_at":"2023-07-18T14:31:57Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.09288","snapshot_observed_at":"2026-08-07T04:37:08.515317Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.10288","last_updated":"2025-06-12T01:53:01Z","snapshot_observed_at":"2026-08-07T04:27:46.870736Z","submitted_at":"2025-06-12T01:53:01Z","title":"ClusterUCB: Efficient Gradient-Based Data Selection for Targeted Fine-Tuning of LLMs","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-07T04:37:08.515317Z"},"links":{"cited_paper":"/paper/2307.09288","citing_paper":"/paper/2506.10288"},"observation_digest":"sha256:e1cc2e94a6d952bba093bbf9e757de66878f349f46eb65731679f4a1321cc297","observation_id":"ba0461d1-4765-4569-a1f2-cad05ab07a62","resolution":{"observed_at":"2026-08-07T04:37:08.515317Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.09168","last_updated":"2023-10-24T06:55:17Z","snapshot_observed_at":"2026-07-06T16:32:33.852863Z","submitted_at":"2023-10-13T15:03:15Z","title":"Explore-Instruct: Enhancing Domain-Specific Instruction Coverage through Active Exploration","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.09168","snapshot_observed_at":"2026-08-07T04:37:08.594090Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.10288","last_updated":"2025-06-12T01:53:01Z","snapshot_observed_at":"2026-08-07T04:27:46.870736Z","submitted_at":"2025-06-12T01:53:01Z","title":"ClusterUCB: Efficient Gradient-Based Data Selection for Targeted Fine-Tuning of LLMs","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-07T04:37:08.594090Z"},"links":{"cited_paper":"/paper/2310.09168","citing_paper":"/paper/2506.10288"},"observation_digest":"sha256:1036259295930e1b0b7da957d1cbe8e001f8ef0a4971d90fdc7d92e0f772a665","observation_id":"65486530-44bb-4534-95d2-cd0e4126eb44","resolution":{"observed_at":"2026-08-07T04:37:08.594090Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:37:10.667408Z","title":null,"venue":null,"work_id":"9d9ea3e4-a8f7-4271-b3b0-eb993616fd2c","year":2023},"citing_paper":{"arxiv_id":"2506.10288","last_updated":"2025-06-12T01:53:01Z","snapshot_observed_at":"2026-08-07T04:27:46.870736Z","submitted_at":"2025-06-12T01:53:01Z","title":"ClusterUCB: Efficient Gradient-Based Data Selection for Targeted Fine-Tuning of LLMs","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-07T04:37:08.664828Z"},"links":{"citing_paper":"/paper/2506.10288"},"observation_digest":"sha256:7b3827f7f13c205825ed600e0030f07748166b4d524393a8eb7f63c7b9943e41","observation_id":"96f2f03d-25f6-40a3-9e9d-1ad87ac402ea","resolution":{"observed_at":"2026-08-07T04:37:10.753964Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.01700","last_updated":"2024-08-02T03:56:35Z","snapshot_observed_at":"2026-07-06T16:56:25.554848Z","submitted_at":"2023-12-04T07:42:16Z","title":"Data Management For Training Large Language Models: A Survey","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.01700","snapshot_observed_at":"2026-08-07T04:37:08.755456Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.10288","last_updated":"2025-06-12T01:53:01Z","snapshot_observed_at":"2026-08-07T04:27:46.870736Z","submitted_at":"2025-06-12T01:53:01Z","title":"ClusterUCB: Efficient Gradient-Based Data Selection for Targeted Fine-Tuning of LLMs","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-07T04:37:08.755456Z"},"links":{"cited_paper":"/paper/2312.01700","citing_paper":"/paper/2506.10288"},"observation_digest":"sha256:c3f1ac6a15b0c087543d4572336b5f926d39b719f8ea6b5dd5f7d7ebde07f795","observation_id":"6849e10f-3a3d-43ad-8d27-7245f7a51d00","resolution":{"observed_at":"2026-08-07T04:37:08.755456Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:37:10.410554Z","title":null,"venue":null,"work_id":"70441ee0-bcc4-4260-be1e-1006ba53b4ce","year":2025},"citing_paper":{"arxiv_id":"2506.10288","last_updated":"2025-06-12T01:53:01Z","snapshot_observed_at":"2026-08-07T04:27:46.870736Z","submitted_at":"2025-06-12T01:53:01Z","title":"ClusterUCB: Efficient Gradient-Based Data Selection for Targeted Fine-Tuning of LLMs","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-07T04:37:08.808699Z"},"links":{"citing_paper":"/paper/2506.10288"},"observation_digest":"sha256:01d5de3aee2451035f0b22fc14edbb4f928d56b84beed5c835591cb266ee3af2","observation_id":"098a270b-3ebc-4751-be17-280bfc283018","resolution":{"observed_at":"2026-08-07T04:37:10.547483Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:37:10.192571Z","title":null,"venue":null,"work_id":"4b0b08fb-cebc-4d03-84ef-5c9e53406320","year":2024},"citing_paper":{"arxiv_id":"2506.10288","last_updated":"2025-06-12T01:53:01Z","snapshot_observed_at":"2026-08-07T04:27:46.870736Z","submitted_at":"2025-06-12T01:53:01Z","title":"ClusterUCB: Efficient Gradient-Based Data Selection for Targeted Fine-Tuning of LLMs","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-07T04:37:08.900684Z"},"links":{"citing_paper":"/paper/2506.10288"},"observation_digest":"sha256:f84aea0fb579dff9daf944f2a7090dc0bf7fa49bff6b709bb691908deb2e0c40","observation_id":"9c8a63a5-3bee-41b9-9141-fd0f41d2f540","resolution":{"observed_at":"2026-08-07T04:37:10.298488Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.05696","last_updated":"2024-02-29T03:04:22Z","snapshot_observed_at":"2026-07-06T16:04:58.235073Z","submitted_at":"2023-08-10T16:58:51Z","title":"A Preliminary Study of the Intrinsic Relationship between Complexity and Alignment","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.05696","snapshot_observed_at":"2026-08-07T04:37:08.992402Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.10288","last_updated":"2025-06-12T01:53:01Z","snapshot_observed_at":"2026-08-07T04:27:46.870736Z","submitted_at":"2025-06-12T01:53:01Z","title":"ClusterUCB: Efficient Gradient-Based Data Selection for Targeted Fine-Tuning of LLMs","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-07T04:37:08.992402Z"},"links":{"cited_paper":"/paper/2308.05696","citing_paper":"/paper/2506.10288"},"observation_digest":"sha256:9336a87f4a4828f4c662579a57d53096bac154cd8d88f1fea4b7eb95d5960ab9","observation_id":"f1ad3954-a342-46fb-b99a-ceb6310123be","resolution":{"observed_at":"2026-08-07T04:37:08.992402Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:37:09.959439Z","title":null,"venue":null,"work_id":"4ff021c0-a0bf-4d6b-b48f-7e839d9d2d65","year":2023},"citing_paper":{"arxiv_id":"2506.10288","last_updated":"2025-06-12T01:53:01Z","snapshot_observed_at":"2026-08-07T04:27:46.870736Z","submitted_at":"2025-06-12T01:53:01Z","title":"ClusterUCB: Efficient Gradient-Based Data Selection for Targeted Fine-Tuning of LLMs","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-07T04:37:09.095070Z"},"links":{"citing_paper":"/paper/2506.10288"},"observation_digest":"sha256:66bd22bdd93757344edb025f44c23e1011c82e3cb854972c88de35ca685a67f3","observation_id":"539e672a-9b12-40a4-8325-f7cabb12433a","resolution":{"observed_at":"2026-08-07T04:37:10.053475Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:37:09.201199Z","title":"online\" 'onlinestring :=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.10288","last_updated":"2025-06-12T01:53:01Z","snapshot_observed_at":"2026-08-07T04:27:46.870736Z","submitted_at":"2025-06-12T01:53:01Z","title":"ClusterUCB: Efficient Gradient-Based Data Selection for Targeted Fine-Tuning of LLMs","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-07T04:37:09.201199Z"},"links":{"citing_paper":"/paper/2506.10288"},"observation_digest":"sha256:cfcc6e79897c0d32efee4aee2511311951d9006471eef3c1dda7ef307bbd9a50","observation_id":"b25c08a3-5188-4db1-b47b-fa9dd2a105ba","resolution":{"observed_at":"2026-08-07T04:37:09.201199Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:37:09.300569Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.10288","last_updated":"2025-06-12T01:53:01Z","snapshot_observed_at":"2026-08-07T04:27:46.870736Z","submitted_at":"2025-06-12T01:53:01Z","title":"ClusterUCB: Efficient Gradient-Based Data Selection for Targeted Fine-Tuning of LLMs","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-07T04:37:09.300569Z"},"links":{"citing_paper":"/paper/2506.10288"},"observation_digest":"sha256:3fe461d8b8e6ede6db9ff182e9fcfdb14ab99dd1912acff3ae4162e270448e9e","observation_id":"81d477b1-84c1-404e-be90-6596cf6c66e3","resolution":{"observed_at":"2026-08-07T04:37:09.300569Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.10288","last_updated":"2025-06-12T01:53:01Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-07T04:27:46.870736Z","submitted_at":"2025-06-12T01:53:01Z","title":"ClusterUCB: Efficient Gradient-Based Data Selection for Targeted Fine-Tuning of LLMs"},"reference_resolution":{"displayed":42,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":38,"verified_exact":1,"verified_fuzzy":3},"total_outbound_references":42},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 42 of 42 outbound references and 0 inbound Pith citation observations for arXiv:2506.10288."}