{"as_of":"2026-07-30T03:35:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:a52c751ae93b31f9f30b621b516a8d345c798e4d13f5248bd464f5f51b86aa92","coverage":[{"denominator":37,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":37,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-20T18:48:15.774746Z","state":"measured"},{"denominator":37,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":37,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-07-29T08:13:00.99439+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2605.16704/citation-record","integrity":"/paper/2605.16704/integrity","json":"/paper/2605.16704/citation-record.json","paper":"/paper/2605.16704"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1016/s0022-0000(03","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"doi: https://doi.org/10.1016/S0022-0000(03 )00025-4","venue":null,"work_id":"c9defe31-db1e-438f-be6a-b5bf19dc78f7","year":null},"citing_paper":{"arxiv_id":"2605.16704","last_updated":"2026-05-15T23:35:07Z","snapshot_observed_at":"2026-07-06T23:27:48.303599Z","submitted_at":"2026-05-15T23:35:07Z","title":"Convex Dataset Valuation for Post-Training","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-20T18:48:15.774746Z"},"links":{"citing_paper":"/paper/2605.16704"},"observation_digest":"sha256:2a23aa69ac63589c332c9dd96feaa3cfafc9d3f10cb8f1564fa835a41fdc9569","observation_id":"5486d487-4eb6-41eb-93c0-2796dcdb32a0","resolution":{"observed_at":"2026-05-20T18:48:52.732430Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-29T08:13:00.99439+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-29T08:13:00.99439+00:00","source":"crossref"},{"observed_at":"2026-05-23T22:22:49.009758+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-23T22:22:49.009758+00:00","source":"openalex_status_cache"},{"observed_at":"2026-07-29T08:12:51.666926+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"A marketplace for data: An algorithmic solution","venue":null,"work_id":"ea8dc1fc-0765-4ea1-b3f0-f344e40a78fd","year":2019},"citing_paper":{"arxiv_id":"2605.16704","last_updated":"2026-05-15T23:35:07Z","snapshot_observed_at":"2026-07-06T23:27:48.303599Z","submitted_at":"2026-05-15T23:35:07Z","title":"Convex Dataset Valuation for Post-Training","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-20T18:48:15.774746Z"},"links":{"citing_paper":"/paper/2605.16704"},"observation_digest":"sha256:252f46fbb00d3070126c77ed26c399f9943e8937d3dc9eb31c5382ba93299ea8","observation_id":"2a5e5b6b-f03d-42b2-9431-df75c75f8227","resolution":{"observed_at":"2026-05-20T18:48:53.571763Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-29T08:13:00.99439+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-29T08:13:00.99439+00:00","source":"crossref"},{"observed_at":"2026-07-29T08:12:51.666926+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.02737","last_updated":"2025-02-04T21:43:16Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-04T21:43:16Z","title":"SmolLM2: When Smol Goes Big -- Data-Centric Training of a Small Language Model","version":1},"cited_work":{"arxiv_id":"2502.02737","doi":"10.48550/arxiv.2502.02737","metadata_source":"pith","pith_arxiv_id":"2502.02737","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"SmolLM2: When Smol Goes Big -- Data-Centric Training of a Small Language Model","venue":"cs.CL","work_id":"8472f581-14d4-40f8-8189-62ed8b470c4e","year":2025},"citing_paper":{"arxiv_id":"2605.16704","last_updated":"2026-05-15T23:35:07Z","snapshot_observed_at":"2026-07-06T23:27:48.303599Z","submitted_at":"2026-05-15T23:35:07Z","title":"Convex Dataset Valuation for Post-Training","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-20T18:48:15.774746Z"},"links":{"cited_paper":"/paper/2502.02737","citing_paper":"/paper/2605.16704"},"observation_digest":"sha256:24cb56f3dc470c89d8d67c5a8caeed24d402c098d14714af28a974d246249acd","observation_id":"5ef17865-4e54-4a1a-b767-2b70f4f3b9ff","resolution":{"observed_at":"2026-05-20T18:48:53.245618Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-29T08:13:00.99439+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-29T08:13:00.99439+00:00","source":"crossref"},{"observed_at":"2026-07-14T07:19:40.857163+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-14T07:19:40.857163+00:00","source":"openalex_status_cache"},{"observed_at":"2026-07-29T08:12:51.666926+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1508.05326","last_updated":"2015-08-21T16:17:01Z","snapshot_observed_at":"2026-07-06T04:27:21.043001Z","submitted_at":"2015-08-21T16:17:01Z","title":"A large annotated corpus for learning natural language inference","version":1},"cited_work":{"arxiv_id":"1508.05326","doi":"10.48550/arxiv.1508.05326","metadata_source":"pith","pith_arxiv_id":"1508.05326","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"A large annotated corpus for learning natural language inference","venue":"cs.CL","work_id":"c7bde334-463e-4827-a444-d90b456da346","year":2015},"citing_paper":{"arxiv_id":"2605.16704","last_updated":"2026-05-15T23:35:07Z","snapshot_observed_at":"2026-07-06T23:27:48.303599Z","submitted_at":"2026-05-15T23:35:07Z","title":"Convex Dataset Valuation for Post-Training","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-20T18:48:15.774746Z"},"links":{"cited_paper":"/paper/1508.05326","citing_paper":"/paper/2605.16704"},"observation_digest":"sha256:ca86422bb5c4005a30da180a61e0562988322a735a3df5e822a2354e0abfdfa0","observation_id":"c30f583e-2239-4e81-b67e-d4244bbb7ac9","resolution":{"observed_at":"2026-05-20T18:48:53.202546Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-29T08:13:00.99439+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-29T08:13:00.99439+00:00","source":"crossref"},{"observed_at":"2026-07-29T08:12:51.666926+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2110.14168","last_updated":"2021-11-18T00:23:45Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-10-27T04:49:45Z","title":"Training Verifiers to Solve Math Word Problems","version":2},"cited_work":{"arxiv_id":"2110.14168","doi":"10.1002/j.1545-","metadata_source":"pith","pith_arxiv_id":"2110.14168","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Training Verifiers to Solve Math Word Problems","venue":"cs.LG","work_id":"acab1aa8-b4d6-40e0-a3ee-25341701dca2","year":2021},"citing_paper":{"arxiv_id":"2605.16704","last_updated":"2026-05-15T23:35:07Z","snapshot_observed_at":"2026-07-06T23:27:48.303599Z","submitted_at":"2026-05-15T23:35:07Z","title":"Convex Dataset Valuation for Post-Training","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-20T18:48:15.774746Z"},"links":{"cited_paper":"/paper/2110.14168","citing_paper":"/paper/2605.16704"},"observation_digest":"sha256:5e222459b2e79253a828b6a9aca9da36a71f409470a0fe42af68cfe39ba44bb0","observation_id":"1c4de37f-4a8e-4fb6-b592-6c513e39857b","resolution":{"observed_at":"2026-05-20T18:48:53.205927Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-29T08:13:00.99439+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-29T08:13:00.99439+00:00","source":"crossref"},{"observed_at":"2026-07-29T08:12:51.666926+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Dai, Q., Zhang, D., Ma, J","venue":null,"work_id":"e3e12462-b9fb-430d-9f50-1f95dabd17dc","year":2023},"citing_paper":{"arxiv_id":"2605.16704","last_updated":"2026-05-15T23:35:07Z","snapshot_observed_at":"2026-07-06T23:27:48.303599Z","submitted_at":"2026-05-15T23:35:07Z","title":"Convex Dataset Valuation for Post-Training","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-20T18:48:15.774746Z"},"links":{"citing_paper":"/paper/2605.16704"},"observation_digest":"sha256:e796a70720f7e418b4b96ffd2fec0a75c7dca8be35d4b4415c490e2356ca9b6a","observation_id":"3ae85a1c-19db-497e-9efb-97513e7f2344","resolution":{"observed_at":"2026-05-20T18:48:53.602322Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-29T08:13:00.99439+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-29T08:13:00.99439+00:00","source":"crossref"},{"observed_at":"2026-07-29T08:12:51.666926+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"records/1260860","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T14:47:14.558044Z","title":"He, B., Yin, L., Zhen, H.-L., Liu, S., Wu, H., Zhang, X., Yuan, M., and Ma, C","venue":null,"work_id":"e7e9d443-273d-4722-8ec7-59adb893de0e","year":2024},"citing_paper":{"arxiv_id":"2605.16704","last_updated":"2026-05-15T23:35:07Z","snapshot_observed_at":"2026-07-06T23:27:48.303599Z","submitted_at":"2026-05-15T23:35:07Z","title":"Convex Dataset Valuation for Post-Training","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-20T18:48:15.774746Z"},"links":{"citing_paper":"/paper/2605.16704"},"observation_digest":"sha256:344a6c34e2ccb11bf8948384a6ed43eeddef24a7a2cd712e8fa9088e4872eb17","observation_id":"c455ffb0-2a5f-4609-b6bc-7788d85bb56a","resolution":{"observed_at":"2026-05-20T18:48:53.240281Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-29T08:13:00.99439+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-29T08:13:00.99439+00:00","source":"crossref"},{"observed_at":"2026-07-29T08:12:51.666926+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Okapi: Instruction-tuned large language models in multiple languages with reinforce- ment learning from human feedback","venue":null,"work_id":"c84f86c0-88fa-4144-bace-ee99537eab29","year":2023},"citing_paper":{"arxiv_id":"2605.16704","last_updated":"2026-05-15T23:35:07Z","snapshot_observed_at":"2026-07-06T23:27:48.303599Z","submitted_at":"2026-05-15T23:35:07Z","title":"Convex Dataset Valuation for Post-Training","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-20T18:48:15.774746Z"},"links":{"citing_paper":"/paper/2605.16704"},"observation_digest":"sha256:14f1755ffb94434e225d0b01b6fba42a5e63ea93bde142ca90d2b291898380c7","observation_id":"f85ba263-3885-4353-b5e8-de4f107e7682","resolution":{"observed_at":"2026-05-20T18:48:53.598621Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-29T08:13:00.99439+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-29T08:13:00.99439+00:00","source":"crossref"},{"observed_at":"2026-07-29T08:12:51.666926+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.15124","last_updated":"2025-04-14T22:39:09Z","snapshot_observed_at":"2026-07-06T19:55:37.400185Z","submitted_at":"2024-11-22T18:44:04Z","title":"Tulu 3: Pushing Frontiers in Open Language Model Post-Training","version":5},"cited_work":{"arxiv_id":"2411.15124","doi":"10.48550/arxiv.2411.15124","metadata_source":"pith","pith_arxiv_id":"2411.15124","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Tulu 3: Pushing Frontiers in Open Language Model Post-Training","venue":"cs.CL","work_id":"28c9dbea-056a-48c2-8000-85f809827e45","year":2024},"citing_paper":{"arxiv_id":"2605.16704","last_updated":"2026-05-15T23:35:07Z","snapshot_observed_at":"2026-07-06T23:27:48.303599Z","submitted_at":"2026-05-15T23:35:07Z","title":"Convex Dataset Valuation for Post-Training","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-20T18:48:15.774746Z"},"links":{"cited_paper":"/paper/2411.15124","citing_paper":"/paper/2605.16704"},"observation_digest":"sha256:e4d4867f4608e367b5c16ca938f77c73b13f9fdb6a2e72b80a6d2dabeb6715ca","observation_id":"1f64225b-a868-46f8-86ac-eef8fb83d779","resolution":{"observed_at":"2026-05-20T18:48:53.231305Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-29T08:13:00.99439+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-29T08:13:00.99439+00:00","source":"crossref"},{"observed_at":"2026-05-23T21:53:00.522112+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-23T21:53:00.522112+00:00","source":"openalex_status_cache"},{"observed_at":"2026-07-29T08:12:51.666926+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"and Roth, D","venue":null,"work_id":"9df78194-293b-46fc-a51d-caf72ef04e70","year":2002},"citing_paper":{"arxiv_id":"2605.16704","last_updated":"2026-05-15T23:35:07Z","snapshot_observed_at":"2026-07-06T23:27:48.303599Z","submitted_at":"2026-05-15T23:35:07Z","title":"Convex Dataset Valuation for Post-Training","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-20T18:48:15.774746Z"},"links":{"citing_paper":"/paper/2605.16704"},"observation_digest":"sha256:d53dcd2f1cd4a0677bef4ac5b88ffc8a1be7a09e87b3fefc46493da42c3e9c19","observation_id":"c3ed8b78-557f-4e21-9735-0d3cf5883bbd","resolution":{"observed_at":"2026-05-20T18:48:53.600523Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-29T08:13:00.99439+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-29T08:13:00.99439+00:00","source":"crossref"},{"observed_at":"2026-07-29T08:12:51.666926+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"stable/2975974","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-04T02:59:26.025874Z","title":"URL http://www.jstor.org/stable/2975974","venue":null,"work_id":"d12e0fa9-009e-41d0-915f-84bc79c7afac","year":1952},"citing_paper":{"arxiv_id":"2605.16704","last_updated":"2026-05-15T23:35:07Z","snapshot_observed_at":"2026-07-06T23:27:48.303599Z","submitted_at":"2026-05-15T23:35:07Z","title":"Convex Dataset Valuation for Post-Training","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-20T18:48:15.774746Z"},"links":{"citing_paper":"/paper/2605.16704"},"observation_digest":"sha256:acad44002d44e40182a38b490570731b4571f8e3272bc397247d9549f82d0f57","observation_id":"9ab3895c-a50b-4df1-b261-75c368867329","resolution":{"observed_at":"2026-05-20T18:48:53.242990Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-29T08:13:00.99439+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-29T08:13:00.99439+00:00","source":"crossref"},{"observed_at":"2026-07-29T08:12:51.666926+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.04531","last_updated":"2025-07-08T14:57:13Z","snapshot_observed_at":"2026-07-06T21:20:26.707391Z","submitted_at":"2025-05-07T16:04:45Z","title":"Overcoming Data Scarcity in Generative Language Modelling for Low-Resource Languages: A Systematic Review","version":2},"cited_work":{"arxiv_id":"2505.04531","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.04531","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"and Nikolov, N","venue":null,"work_id":"f25ef44f-e38e-411e-aab7-e93afbdebd8a","year":null},"citing_paper":{"arxiv_id":"2605.16704","last_updated":"2026-05-15T23:35:07Z","snapshot_observed_at":"2026-07-06T23:27:48.303599Z","submitted_at":"2026-05-15T23:35:07Z","title":"Convex Dataset Valuation for Post-Training","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-20T18:48:15.774746Z"},"links":{"cited_paper":"/paper/2505.04531","citing_paper":"/paper/2605.16704"},"observation_digest":"sha256:2d36fb78411eff134cb77b5ed7ed3b97658b95b181aac94f8f04556744dbe425","observation_id":"8bd0ecb1-20ba-42e4-b17a-0c94d67949f1","resolution":{"observed_at":"2026-05-20T18:48:53.216847Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-29T08:13:00.99439+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-29T08:13:00.99439+00:00","source":"crossref"},{"observed_at":"2026-07-29T08:12:51.666926+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Multi-task trans- fer matters during instruction-tuning","venue":null,"work_id":"ec491923-20d1-4da7-983b-19584cf0d3c2","year":2024},"citing_paper":{"arxiv_id":"2605.16704","last_updated":"2026-05-15T23:35:07Z","snapshot_observed_at":"2026-07-06T23:27:48.303599Z","submitted_at":"2026-05-15T23:35:07Z","title":"Convex Dataset Valuation for Post-Training","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-20T18:48:15.774746Z"},"links":{"citing_paper":"/paper/2605.16704"},"observation_digest":"sha256:e2a8a9b776879c1854addcb0e9c09c5d696630c599f91499fde31128da1aaec0","observation_id":"c94b508e-ec66-4845-bacd-41e70eaf6dfa","resolution":{"observed_at":"2026-05-20T18:48:53.594706Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-29T08:13:00.99439+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-29T08:13:00.99439+00:00","source":"crossref"},{"observed_at":"2026-07-29T08:12:51.666926+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"B., and Liang, P","venue":null,"work_id":"94086669-3b69-4711-9088-4cb9e76e2274","year":2019},"citing_paper":{"arxiv_id":"2605.16704","last_updated":"2026-05-15T23:35:07Z","snapshot_observed_at":"2026-07-06T23:27:48.303599Z","submitted_at":"2026-05-15T23:35:07Z","title":"Convex Dataset Valuation for Post-Training","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-20T18:48:15.774746Z"},"links":{"citing_paper":"/paper/2605.16704"},"observation_digest":"sha256:a4f3547fc19e871c83696c886a88cf654a5f950889d9f7aab7286fd6caab7ca5","observation_id":"13c97524-9c42-4a54-94e2-a62a9a439fc7","resolution":{"observed_at":"2026-05-20T18:48:53.596665Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-29T08:13:00.99439+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-29T08:13:00.99439+00:00","source":"crossref"},{"observed_at":"2026-07-29T08:12:51.666926+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"cs/0409058","last_updated":"2004-09-29T20:34:04Z","snapshot_observed_at":"2026-07-07T03:06:00.568661Z","submitted_at":"2004-09-29T20:34:04Z","title":"A Sentimental Education: Sentiment Analysis Using Subjectivity Summarization Based on Minimum Cuts","version":1},"cited_work":{"arxiv_id":"cs/0409058","doi":null,"metadata_source":"pith","pith_arxiv_id":"cs/0409058","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"A Sentimental Education: Sentiment Analysis Using Subjectivity Summarization Based on Minimum Cuts","venue":"cs.CL","work_id":"080594cf-24d0-44e2-94ba-9180ea8181e8","year":2004},"citing_paper":{"arxiv_id":"2605.16704","last_updated":"2026-05-15T23:35:07Z","snapshot_observed_at":"2026-07-06T23:27:48.303599Z","submitted_at":"2026-05-15T23:35:07Z","title":"Convex Dataset Valuation for Post-Training","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-20T18:48:15.774746Z"},"links":{"cited_paper":"/paper/cs/0409058","citing_paper":"/paper/2605.16704"},"observation_digest":"sha256:bd5f9fa8f4797dbe70c8a0fe7ed9e50ea81dc02cf51f0648cb2176ccefb164e8","observation_id":"ca8775a2-88d4-4509-9c6d-ccffdc9b6c51","resolution":{"observed_at":"2026-05-20T18:48:53.199990Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-29T08:13:00.99439+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-29T08:13:00.99439+00:00","source":"crossref"},{"observed_at":"2026-07-29T08:12:51.666926+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15115","last_updated":"2025-01-03T02:18:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-19T17:56:09Z","title":"Qwen2.5 Technical Report","version":2},"cited_work":{"arxiv_id":"2412.15115","doi":"10.1145/3581783.3612503","metadata_source":"pith","pith_arxiv_id":"2412.15115","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Qwen2.5 Technical Report","venue":"cs.CL","work_id":"d8432992-4980-4a81-85c7-9fa2c2b87f85","year":2024},"citing_paper":{"arxiv_id":"2605.16704","last_updated":"2026-05-15T23:35:07Z","snapshot_observed_at":"2026-07-06T23:27:48.303599Z","submitted_at":"2026-05-15T23:35:07Z","title":"Convex Dataset Valuation for Post-Training","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-20T18:48:15.774746Z"},"links":{"cited_paper":"/paper/2412.15115","citing_paper":"/paper/2605.16704"},"observation_digest":"sha256:05762171420a09324ff165cc0aa1a5a7d22b8a76bfa7f67e9cd7182417d95190","observation_id":"914416a4-0e65-4966-9567-523b771f472e","resolution":{"observed_at":"2026-05-20T18:48:53.228215Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-29T08:13:00.99439+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-29T08:13:00.99439+00:00","source":"crossref"},{"observed_at":"2026-07-29T08:12:51.666926+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"and Gurevych, I","venue":null,"work_id":"63f6b786-ac95-4137-8ec8-05280716f671","year":2019},"citing_paper":{"arxiv_id":"2605.16704","last_updated":"2026-05-15T23:35:07Z","snapshot_observed_at":"2026-07-06T23:27:48.303599Z","submitted_at":"2026-05-15T23:35:07Z","title":"Convex Dataset Valuation for Post-Training","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-20T18:48:15.774746Z"},"links":{"citing_paper":"/paper/2605.16704"},"observation_digest":"sha256:3c5c87078152bd242551032d968746fdfd55ae1ffaa9885f897a7e6d741c9550","observation_id":"f95e4dad-c887-4447-8cfb-8e69b0f47a03","resolution":{"observed_at":"2026-05-20T18:48:53.592457Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-29T08:13:00.99439+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-29T08:13:00.99439+00:00","source":"crossref"},{"observed_at":"2026-07-29T08:12:51.666926+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03300","last_updated":"2024-04-27T15:25:53Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-02-05T18:55:32Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","version":3},"cited_work":{"arxiv_id":"2402.03300","doi":"10.1016/0004-3702(73)90011-8","metadata_source":"pith","pith_arxiv_id":"2402.03300","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","venue":"cs.CL","work_id":"c5006563-f3ec-438a-9e35-b7b484f34828","year":2024},"citing_paper":{"arxiv_id":"2605.16704","last_updated":"2026-05-15T23:35:07Z","snapshot_observed_at":"2026-07-06T23:27:48.303599Z","submitted_at":"2026-05-15T23:35:07Z","title":"Convex Dataset Valuation for Post-Training","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-20T18:48:15.774746Z"},"links":{"cited_paper":"/paper/2402.03300","citing_paper":"/paper/2605.16704"},"observation_digest":"sha256:e7ad47008c27184c1f44fd3e96e2926b1edd3bb99b85ada553e4423cba6bde46","observation_id":"1cc50248-64f6-4ccd-8a1b-0ac422722152","resolution":{"observed_at":"2026-05-20T18:48:53.208505Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-29T08:13:00.99439+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-29T08:13:00.99439+00:00","source":"crossref"},{"observed_at":"2026-07-29T08:12:51.666926+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1907.01041","last_updated":"2019-07-01T19:48:34Z","snapshot_observed_at":"2026-07-06T08:04:14.176171Z","submitted_at":"2019-07-01T19:48:34Z","title":"Natural Language Understanding with the Quora Question Pairs Dataset","version":1},"cited_work":{"arxiv_id":"1907.01041","doi":null,"metadata_source":"pith","pith_arxiv_id":"1907.01041","snapshot_observed_at":"2026-07-04T15:59:56.631835Z","title":"Natural Language Understanding with the Quora Question Pairs Dataset","venue":"cs.CL","work_id":"ad8b6d5c-eebf-43aa-be24-bea526cc96a9","year":2019},"citing_paper":{"arxiv_id":"2605.16704","last_updated":"2026-05-15T23:35:07Z","snapshot_observed_at":"2026-07-06T23:27:48.303599Z","submitted_at":"2026-05-15T23:35:07Z","title":"Convex Dataset Valuation for Post-Training","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-20T18:48:15.774746Z"},"links":{"cited_paper":"/paper/1907.01041","citing_paper":"/paper/2605.16704"},"observation_digest":"sha256:e32f6d1fb7a30f377ef3115e8ab5cc005a5d9ddba7cb0895cde390e5deb0d6a3","observation_id":"20f41529-c651-47a7-9cda-fd9dc8be2a50","resolution":{"observed_at":"2026-05-20T18:48:53.197075Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-29T08:13:00.99439+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-29T08:13:00.99439+00:00","source":"crossref"},{"observed_at":"2026-07-29T08:12:51.666926+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"D., Ng, A","venue":null,"work_id":"b667696e-a5a0-42dc-b785-7f4e013ace7a","year":2013},"citing_paper":{"arxiv_id":"2605.16704","last_updated":"2026-05-15T23:35:07Z","snapshot_observed_at":"2026-07-06T23:27:48.303599Z","submitted_at":"2026-05-15T23:35:07Z","title":"Convex Dataset Valuation for Post-Training","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-20T18:48:15.774746Z"},"links":{"citing_paper":"/paper/2605.16704"},"observation_digest":"sha256:3bbb2466a4ddb01fd85d6d43d0701d4e1b59860490eefdb8efe966a0f6526fcb","observation_id":"44bc7e76-0b49-4d19-a49d-90306d920d82","resolution":{"observed_at":"2026-05-20T18:48:53.586058Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-29T08:13:00.99439+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-29T08:13:00.99439+00:00","source":"crossref"},{"observed_at":"2026-07-29T08:12:51.666926+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1007/s12532-020-00179-2","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T08:41:48.841630Z","title":"author Banjac, G","venue":null,"work_id":"48ac5695-312b-4bd5-95d6-f41f038922b3","year":2020},"citing_paper":{"arxiv_id":"2605.16704","last_updated":"2026-05-15T23:35:07Z","snapshot_observed_at":"2026-07-06T23:27:48.303599Z","submitted_at":"2026-05-15T23:35:07Z","title":"Convex Dataset Valuation for Post-Training","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-20T18:48:15.774746Z"},"links":{"citing_paper":"/paper/2605.16704"},"observation_digest":"sha256:84365117d8f94194ca384d1ee2f6a62c4f639c00872f72ffc32294cec392581d","observation_id":"8d087620-dc1a-4462-88ed-f7fe469f5159","resolution":{"observed_at":"2026-05-20T18:48:52.725358Z","resolver_source":"doi","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-29T08:13:00.99439+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-29T08:13:00.99439+00:00","source":"crossref"},{"observed_at":"2026-05-23T16:54:06.528533+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-23T16:54:06.528533+00:00","source":"openalex_status_cache"},{"observed_at":"2026-07-29T08:12:51.666926+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.19786","last_updated":"2025-03-25T15:52:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-25T15:52:34Z","title":"Gemma 3 Technical Report","version":1},"cited_work":{"arxiv_id":"2503.19786","doi":"10.1007/978-3-540-48085-3_36","metadata_source":"pith","pith_arxiv_id":"2503.19786","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Gemma 3 Technical Report","venue":"cs.CL","work_id":"f93e08bf-9e96-409b-8ac6-b8385fd17fd7","year":2025},"citing_paper":{"arxiv_id":"2605.16704","last_updated":"2026-05-15T23:35:07Z","snapshot_observed_at":"2026-07-06T23:27:48.303599Z","submitted_at":"2026-05-15T23:35:07Z","title":"Convex Dataset Valuation for Post-Training","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-20T18:48:15.774746Z"},"links":{"cited_paper":"/paper/2503.19786","citing_paper":"/paper/2605.16704"},"observation_digest":"sha256:df61f214bc5745e9cc3ba035cac9ef375dc93a0686d8cde5c05ffe7f3012ea42","observation_id":"71a29ee8-a5a7-4437-9bab-db93c4955708","resolution":{"observed_at":"2026-05-20T18:48:53.237200Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-29T08:13:00.99439+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-29T08:13:00.99439+00:00","source":"crossref"},{"observed_at":"2026-07-29T08:12:51.666926+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1804.07461","last_updated":"2019-02-22T23:53:34Z","snapshot_observed_at":"2026-07-06T06:34:26.609892Z","submitted_at":"2018-04-20T06:35:04Z","title":"GLUE: A Multi-Task Benchmark and Analysis Platform for Natural Language Understanding","version":3},"cited_work":{"arxiv_id":"1804.07461","doi":null,"metadata_source":"pith","pith_arxiv_id":"1804.07461","snapshot_observed_at":"2026-07-04T09:19:44.134394Z","title":"GLUE: A Multi-Task Benchmark and Analysis Platform for Natural Language Understanding","venue":"cs.CL","work_id":"1bb6fb0c-482d-43cf-94a8-ed18f72a5563","year":2018},"citing_paper":{"arxiv_id":"2605.16704","last_updated":"2026-05-15T23:35:07Z","snapshot_observed_at":"2026-07-06T23:27:48.303599Z","submitted_at":"2026-05-15T23:35:07Z","title":"Convex Dataset Valuation for Post-Training","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-20T18:48:15.774746Z"},"links":{"cited_paper":"/paper/1804.07461","citing_paper":"/paper/2605.16704"},"observation_digest":"sha256:457e69fe48a0b10c1f431ca2e9d9f05bcc75300ecc3f6b382bb730d6ab266d58","observation_id":"0dcfbd67-79ba-4b11-bc3c-4dad9bcd7c7c","resolution":{"observed_at":"2026-05-20T18:48:53.249095Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-29T08:13:00.99439+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-29T08:13:00.99439+00:00","source":"crossref"},{"observed_at":"2026-07-29T08:12:51.666926+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1805.12471","last_updated":"2019-10-01T18:41:05Z","snapshot_observed_at":"2026-07-06T06:42:15.167440Z","submitted_at":"2018-05-31T13:52:06Z","title":"Neural Network Acceptability Judgments","version":3},"cited_work":{"arxiv_id":"1805.12471","doi":null,"metadata_source":"pith","pith_arxiv_id":"1805.12471","snapshot_observed_at":"2026-07-09T21:16:34.237758Z","title":"Neural Network Ac- ceptability Judgments","venue":"cs.CL","work_id":"ee6536e2-986a-4e85-877b-cd6cf6b9219e","year":2018},"citing_paper":{"arxiv_id":"2605.16704","last_updated":"2026-05-15T23:35:07Z","snapshot_observed_at":"2026-07-06T23:27:48.303599Z","submitted_at":"2026-05-15T23:35:07Z","title":"Convex Dataset Valuation for Post-Training","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-20T18:48:15.774746Z"},"links":{"cited_paper":"/paper/1805.12471","citing_paper":"/paper/2605.16704"},"observation_digest":"sha256:af997b7a8d3850538d4934b6a1bbfcf767e5a70f1eb1dad8a15c96ed94619f82","observation_id":"0a8f9126-3ffa-4e7f-ab2a-a67307063f6e","resolution":{"observed_at":"2026-05-20T18:48:53.219618Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-29T08:13:00.99439+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-29T08:13:00.99439+00:00","source":"crossref"},{"observed_at":"2026-07-29T08:12:51.666926+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1704.05426","last_updated":"2018-02-19T19:19:51Z","snapshot_observed_at":"2026-07-06T05:38:16.162925Z","submitted_at":"2017-04-18T17:10:13Z","title":"A Broad-Coverage Challenge Corpus for Sentence Understanding through Inference","version":4},"cited_work":{"arxiv_id":"1704.05426","doi":"10.18653/v1/n18-1101","metadata_source":"pith","pith_arxiv_id":"1704.05426","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"A Broad-Coverage Challenge Corpus for Sentence Understanding through Inference","venue":"cs.CL","work_id":"9737cdf0-fd48-4485-ab04-c8ec9386e782","year":2017},"citing_paper":{"arxiv_id":"2605.16704","last_updated":"2026-05-15T23:35:07Z","snapshot_observed_at":"2026-07-06T23:27:48.303599Z","submitted_at":"2026-05-15T23:35:07Z","title":"Convex Dataset Valuation for Post-Training","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-20T18:48:15.774746Z"},"links":{"cited_paper":"/paper/1704.05426","citing_paper":"/paper/2605.16704"},"observation_digest":"sha256:3d274e570acd9c571a71837d09e44ce74cc27cc1525d284213cf99f0c9dd4d84","observation_id":"9e60c4ff-c7bd-430e-8f98-45e957775454","resolution":{"observed_at":"2026-05-20T18:48:53.222382Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-29T08:13:00.99439+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-29T08:13:00.99439+00:00","source":"crossref"},{"observed_at":"2026-07-13T15:49:40.633782+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-13T15:49:40.633782+00:00","source":"openalex_status_cache"},{"observed_at":"2026-07-29T08:12:51.666926+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09388","last_updated":"2025-05-14T13:41:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-14T13:41:34Z","title":"Qwen3 Technical Report","version":1},"cited_work":{"arxiv_id":"2505.09388","doi":"10.1016/j.aiopen.2022.12","metadata_source":"pith","pith_arxiv_id":"2505.09388","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Qwen3 Technical Report","venue":"cs.CL","work_id":"25a4e30c-1232-48e7-9925-02fa12ba7c9e","year":2025},"citing_paper":{"arxiv_id":"2605.16704","last_updated":"2026-05-15T23:35:07Z","snapshot_observed_at":"2026-07-06T23:27:48.303599Z","submitted_at":"2026-05-15T23:35:07Z","title":"Convex Dataset Valuation for Post-Training","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-20T18:48:15.774746Z"},"links":{"cited_paper":"/paper/2505.09388","citing_paper":"/paper/2605.16704"},"observation_digest":"sha256:4ef6871da31c4d859bf69ee57a1b59ccfa4d302c258aa54d229a2c4731678098","observation_id":"30cbd602-0570-4e51-bf21-2b98b61b353d","resolution":{"observed_at":"2026-05-20T18:48:53.225464Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-29T08:13:00.99439+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-29T08:13:00.99439+00:00","source":"crossref"},{"observed_at":"2026-07-29T08:12:51.666926+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.07911","last_updated":"2023-11-14T05:13:55Z","snapshot_observed_at":"2026-07-06T16:47:08.877195Z","submitted_at":"2023-11-14T05:13:55Z","title":"Instruction-Following Evaluation for Large Language Models","version":1},"cited_work":{"arxiv_id":"2311.07911","doi":"10.48550/arxiv.2311.07911","metadata_source":"pith","pith_arxiv_id":"2311.07911","snapshot_observed_at":"2026-07-10T12:07:03.672931Z","title":"Instruction-Following Evaluation for Large Language Models","venue":"cs.CL","work_id":"3aa06177-125a-4f5a-8f4a-8070c5986c26","year":2023},"citing_paper":{"arxiv_id":"2605.16704","last_updated":"2026-05-15T23:35:07Z","snapshot_observed_at":"2026-07-06T23:27:48.303599Z","submitted_at":"2026-05-15T23:35:07Z","title":"Convex Dataset Valuation for Post-Training","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-20T18:48:15.774746Z"},"links":{"cited_paper":"/paper/2311.07911","citing_paper":"/paper/2605.16704"},"observation_digest":"sha256:e7a1501476707baaca09140ae54a908c89daf1dfa4f762955381516cdebdfb27","observation_id":"2e9e1ee7-ac20-47e2-8027-e49dac1b6a10","resolution":{"observed_at":"2026-05-20T18:48:53.233995Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-29T08:13:00.99439+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-29T08:13:00.99439+00:00","source":"crossref"},{"observed_at":"2026-07-29T08:12:51.666926+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"3888cabf-93ed-4e9f-9d03-67480bf63dc8","year":2019},"citing_paper":{"arxiv_id":"2605.16704","last_updated":"2026-05-15T23:35:07Z","snapshot_observed_at":"2026-07-06T23:27:48.303599Z","submitted_at":"2026-05-15T23:35:07Z","title":"Convex Dataset Valuation for Post-Training","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-20T18:48:15.774746Z"},"links":{"citing_paper":"/paper/2605.16704"},"observation_digest":"sha256:9cabcda190dcf7b760485cd638ccfa7565cad291edf23cb39292e4da3fd5f651","observation_id":"685a3276-c38a-47ed-b3b0-52a4255ef81d","resolution":{"observed_at":"2026-05-20T18:48:53.579949Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-29T08:13:00.99439+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-29T08:13:00.99439+00:00","source":"crossref"},{"observed_at":"2026-07-29T08:12:51.666926+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"2c81d4f4-ad2a-42dc-86c7-cf6a255b4318","year":2023},"citing_paper":{"arxiv_id":"2605.16704","last_updated":"2026-05-15T23:35:07Z","snapshot_observed_at":"2026-07-06T23:27:48.303599Z","submitted_at":"2026-05-15T23:35:07Z","title":"Convex Dataset Valuation for Post-Training","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-05-20T18:48:15.774746Z"},"links":{"citing_paper":"/paper/2605.16704"},"observation_digest":"sha256:98db684c68e7ea62076a2bd257291ab38e0265cebff2e846acc0c4000e3e57d9","observation_id":"40d04146-8de5-482f-ac66-b704897cca3e","resolution":{"observed_at":"2026-05-20T18:48:53.581883Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-29T08:13:00.99439+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-29T08:13:00.99439+00:00","source":"crossref"},{"observed_at":"2026-07-29T08:12:51.666926+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"We select the language set in Tab","venue":null,"work_id":"c71df20b-bd2b-4954-a7a1-b39fb2169e2d","year":2025},"citing_paper":{"arxiv_id":"2605.16704","last_updated":"2026-05-15T23:35:07Z","snapshot_observed_at":"2026-07-06T23:27:48.303599Z","submitted_at":"2026-05-15T23:35:07Z","title":"Convex Dataset Valuation for Post-Training","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-20T18:48:15.774746Z"},"links":{"citing_paper":"/paper/2605.16704"},"observation_digest":"sha256:4fbab8decf372bcace39bc650bdc9f90b74c492a7a077c4037782a6eea15d5f9","observation_id":"d227019f-b817-491f-a569-68d425884c5c","resolution":{"observed_at":"2026-05-20T18:48:53.583619Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-29T08:13:00.99439+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-29T08:13:00.99439+00:00","source":"crossref"},{"observed_at":"2026-07-29T08:12:51.666926+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"ea8ebf8e-db89-4c4e-ba61-1623c2f7e688","year":2025},"citing_paper":{"arxiv_id":"2605.16704","last_updated":"2026-05-15T23:35:07Z","snapshot_observed_at":"2026-07-06T23:27:48.303599Z","submitted_at":"2026-05-15T23:35:07Z","title":"Convex Dataset Valuation for Post-Training","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-05-20T18:48:15.774746Z"},"links":{"citing_paper":"/paper/2605.16704"},"observation_digest":"sha256:5a4e54583499a7d6de8ca355a47e2e59876da817fdc64273f1bfc36ff694ce95","observation_id":"5ee0f0e1-01cb-4ee8-ae2c-1690e6b8ba55","resolution":{"observed_at":"2026-05-20T18:48:53.587937Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-29T08:13:00.99439+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-29T08:13:00.99439+00:00","source":"crossref"},{"observed_at":"2026-07-29T08:12:51.666926+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Data Valuation Baselines G.1","venue":null,"work_id":"1366f9c4-b1f3-45d8-96d6-31ae0b36a476","year":2016},"citing_paper":{"arxiv_id":"2605.16704","last_updated":"2026-05-15T23:35:07Z","snapshot_observed_at":"2026-07-06T23:27:48.303599Z","submitted_at":"2026-05-15T23:35:07Z","title":"Convex Dataset Valuation for Post-Training","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-05-20T18:48:15.774746Z"},"links":{"citing_paper":"/paper/2605.16704"},"observation_digest":"sha256:efd821f4713a640b87a1a92d6e2c7b6f9ec28483f1ea416d285cde765f8c9333","observation_id":"34e3573d-6972-4378-a650-c1233cecda01","resolution":{"observed_at":"2026-05-20T18:48:53.578041Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-29T08:13:00.99439+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-29T08:13:00.99439+00:00","source":"crossref"},{"observed_at":"2026-07-29T08:12:51.666926+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"ac0d8289-feb8-4713-81ac-451484d666cd","year":2022},"citing_paper":{"arxiv_id":"2605.16704","last_updated":"2026-05-15T23:35:07Z","snapshot_observed_at":"2026-07-06T23:27:48.303599Z","submitted_at":"2026-05-15T23:35:07Z","title":"Convex Dataset Valuation for Post-Training","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-05-20T18:48:15.774746Z"},"links":{"citing_paper":"/paper/2605.16704"},"observation_digest":"sha256:c017ee1f86e1332af66ece5645f5231616133ea38fe181c58ad29d942a87b054","observation_id":"af6619e2-e807-4214-a31f-fa9d0ae82650","resolution":{"observed_at":"2026-05-20T18:48:53.576188Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-29T08:13:00.99439+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-29T08:13:00.99439+00:00","source":"crossref"},{"observed_at":"2026-07-29T08:12:51.666926+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Because Acs has signed entries, each row r is implemented via two auxiliary subsets whose difference realizes the signed measurement","venue":null,"work_id":"202d5e93-61e5-4c01-b303-9058e571d67e","year":2003},"citing_paper":{"arxiv_id":"2605.16704","last_updated":"2026-05-15T23:35:07Z","snapshot_observed_at":"2026-07-06T23:27:48.303599Z","submitted_at":"2026-05-15T23:35:07Z","title":"Convex Dataset Valuation for Post-Training","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-05-20T18:48:15.774746Z"},"links":{"citing_paper":"/paper/2605.16704"},"observation_digest":"sha256:296b7b166295587d2c6df072afe79f0ccac92dc8925500baaa08e00633f03611","observation_id":"9bd3e295-8f8b-4ee2-a124-8cfd2be54ec2","resolution":{"observed_at":"2026-05-20T18:48:53.573976Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-29T08:13:00.99439+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-29T08:13:00.99439+00:00","source":"crossref"},{"observed_at":"2026-07-29T08:12:51.666926+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"9646.1245","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"b562f7d2-a50f-4f78-bd65-9f4c0b30ada0","year":null},"citing_paper":{"arxiv_id":"2605.16704","last_updated":"2026-05-15T23:35:07Z","snapshot_observed_at":"2026-07-06T23:27:48.303599Z","submitted_at":"2026-05-15T23:35:07Z","title":"Convex Dataset Valuation for Post-Training","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-05-20T18:48:15.774746Z"},"links":{"citing_paper":"/paper/2605.16704"},"observation_digest":"sha256:fe301a4327a822981d66267d0c58799101f2a90774068f299e6892fa6e00de76","observation_id":"77eb7ff5-c3b1-497b-bae7-1026dad752da","resolution":{"observed_at":"2026-05-20T18:48:53.213805Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-29T08:13:00.99439+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-29T08:13:00.99439+00:00","source":"crossref"},{"observed_at":"2026-07-29T08:12:51.666926+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"6796.9095","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"3, non-uniform softmax weighting leads to lower absolute performance for all methods in this setting","venue":null,"work_id":"9deed4c7-9e0c-497b-bba5-f84396e856b6","year":2018},"citing_paper":{"arxiv_id":"2605.16704","last_updated":"2026-05-15T23:35:07Z","snapshot_observed_at":"2026-07-06T23:27:48.303599Z","submitted_at":"2026-05-15T23:35:07Z","title":"Convex Dataset Valuation for Post-Training","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-05-20T18:48:15.774746Z"},"links":{"citing_paper":"/paper/2605.16704"},"observation_digest":"sha256:5ef14aef6c4302af5e46a37ca8cf176ea289c96410893eeccd10d0177eb3d98e","observation_id":"6f867b37-d9d9-489c-94cb-8252eac71d3d","resolution":{"observed_at":"2026-05-20T18:48:53.211163Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-29T08:13:00.99439+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-29T08:13:00.99439+00:00","source":"crossref"},{"observed_at":"2026-07-29T08:12:51.666926+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"The same valuation scores are used across budgets, and larger budgets move training farther from the local Taylor approximation","venue":null,"work_id":"df1278d6-326f-4a05-92fc-cf17220eb657","year":2019},"citing_paper":{"arxiv_id":"2605.16704","last_updated":"2026-05-15T23:35:07Z","snapshot_observed_at":"2026-07-06T23:27:48.303599Z","submitted_at":"2026-05-15T23:35:07Z","title":"Convex Dataset Valuation for Post-Training","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-05-20T18:48:15.774746Z"},"links":{"citing_paper":"/paper/2605.16704"},"observation_digest":"sha256:483d481063fd862f9257fc8581638ae58ef4ffb37bea0277f348d23067029742","observation_id":"5906251f-5707-4066-8093-5e3a795498d3","resolution":{"observed_at":"2026-05-20T18:48:53.590470Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-29T08:13:00.99439+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-29T08:13:00.99439+00:00","source":"crossref"},{"observed_at":"2026-07-29T08:12:51.666926+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2605.16704","last_updated":"2026-05-15T23:35:07Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-07-06T23:27:48.303599Z","submitted_at":"2026-05-15T23:35:07Z","title":"Convex Dataset Valuation for Post-Training"},"reference_resolution":{"displayed":37,"state_counts":{"malformed_identifier":1,"metadata_mismatch":5,"parse_uncertain":0,"unresolved":3,"verified_exact":16,"verified_fuzzy":12},"total_outbound_references":37},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-07-29T08:13:00.99439+00:00","source":"crossref"},{"observed_at":"2026-07-29T08:12:51.666926+00:00","source":"retraction_watch"}],"thesis":"As of 30 July 2026, this Paper Citation Record lists 37 of 37 outbound references and 0 inbound Pith citation observations for arXiv:2605.16704."}