{"as_of":"2026-08-10T23:04:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:7597cf62ed0221c6b54edd8139a688427ca6c064413993000c2a03715f62044e","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":13,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":13,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":13,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":13,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-10T10:37:32.617303Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-05T00:15:22.234678Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2402.05123","last_updated":"2025-08-26T15:28:36Z","snapshot_observed_at":"2026-08-04T16:46:26.858502Z","submitted_at":"2024-02-04T13:32:01Z","title":"A Survey on Data Selection for LLM Instruction Tuning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.05123","snapshot_observed_at":"2026-08-10T10:37:32.617303Z","title":"A survey on data selection for LLM instruction tuning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.16815","last_updated":"2025-08-15T16:03:01Z","snapshot_observed_at":"2026-08-10T10:26:38.140346Z","submitted_at":"2025-01-28T09:44:27Z","title":"Best Subset Selection: Optimal Pursuit for Feature Selection and Elimination","version":3},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-10T10:37:32.617303Z"},"links":{"cited_paper":"/paper/2402.05123","citing_paper":"/paper/2501.16815"},"observation_digest":"sha256:bf2594f023df047f399c738dfb12d20daf210db011693840ebf3ca690b276aa1","observation_id":"e0273945-7a8e-44f9-9e4b-474c4a3e9f98","resolution":{"observed_at":"2026-08-10T10:37:32.617303Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.05123","last_updated":"2025-08-26T15:28:36Z","snapshot_observed_at":"2026-08-04T16:46:26.858502Z","submitted_at":"2024-02-04T13:32:01Z","title":"A Survey on Data Selection for LLM Instruction Tuning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.05123","snapshot_observed_at":"2026-08-09T19:51:53.642807Z","title":"arXiv preprint arXiv:2402.05123 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.00245","last_updated":"2025-02-01T00:54:25Z","snapshot_observed_at":"2026-08-09T23:06:19.225107Z","submitted_at":"2025-02-01T00:54:25Z","title":"Contrastive Private Data Synthesis via Weighted Multi-PLM Fusion","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-09T19:51:53.642807Z"},"links":{"cited_paper":"/paper/2402.05123","citing_paper":"/paper/2502.00245"},"observation_digest":"sha256:1cbf4ded5ebed57067561776bef11a896906dc838b24770add9ac6d182a78568","observation_id":"3c0f8f1e-e8aa-4d0d-b9f2-7e4ad1597f3e","resolution":{"observed_at":"2026-08-09T19:51:53.642807Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.05123","last_updated":"2025-08-26T15:28:36Z","snapshot_observed_at":"2026-08-04T16:46:26.858502Z","submitted_at":"2024-02-04T13:32:01Z","title":"A Survey on Data Selection for LLM Instruction Tuning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.05123","snapshot_observed_at":"2026-08-09T10:50:12.499614Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.04362","last_updated":"2025-02-05T04:52:57Z","snapshot_observed_at":"2026-08-09T10:43:55.438000Z","submitted_at":"2025-02-05T04:52:57Z","title":"LLMs can be easily Confused by Instructional Distractions","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-09T10:50:12.499614Z"},"links":{"cited_paper":"/paper/2402.05123","citing_paper":"/paper/2502.04362"},"observation_digest":"sha256:7be40979d6b21aaa24b6a03996fb197720475cc84d68cab7caf03cc89e8258e3","observation_id":"2ce9f9e8-910d-4211-83fe-b707cfe50a7c","resolution":{"observed_at":"2026-08-09T10:50:12.499614Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.05123","last_updated":"2025-08-26T15:28:36Z","snapshot_observed_at":"2026-08-04T16:46:26.858502Z","submitted_at":"2024-02-04T13:32:01Z","title":"A Survey on Data Selection for LLM Instruction Tuning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.05123","snapshot_observed_at":"2026-08-10T10:07:33.802787Z","title":"”A Survey on Data Selection for LLM Instruction Tuning.” arXiv preprint arXiv:2402.05123 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.15724","last_updated":"2025-01-28T11:34:22Z","snapshot_observed_at":"2026-08-10T10:37:59.022075Z","submitted_at":"2025-01-28T11:34:22Z","title":"Instruction-Based Fine-tuning of Open-Source LLMs for Predicting Customer Purchase Behaviors","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-10T10:07:33.802787Z"},"links":{"cited_paper":"/paper/2402.05123","citing_paper":"/paper/2502.15724"},"observation_digest":"sha256:ccf46362a67c4435adfe5430946c3c83cdef573332869d1d1dcf4d0bd7be1463","observation_id":"6c242670-20b1-45ee-bf32-b634cd91abe6","resolution":{"observed_at":"2026-08-10T10:07:33.802787Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.05123","last_updated":"2025-08-26T15:28:36Z","snapshot_observed_at":"2026-08-04T16:46:26.858502Z","submitted_at":"2024-02-04T13:32:01Z","title":"A Survey on Data Selection for LLM Instruction Tuning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.05123","snapshot_observed_at":"2026-08-07T13:43:23.198327Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.21191","last_updated":"2025-05-27T13:40:28Z","snapshot_observed_at":"2026-08-09T03:47:08.331722Z","submitted_at":"2025-05-27T13:40:28Z","title":"Unveiling Instruction-Specific Neurons & Experts: An Analytical Framework for LLM's Instruction-Following Capabilities","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-07T13:43:23.198327Z"},"links":{"cited_paper":"/paper/2402.05123","citing_paper":"/paper/2505.21191"},"observation_digest":"sha256:55e563c7fd9843000249d1c598eb79dce36115b840352086e8575a24711b643b","observation_id":"959eb4be-6b05-4779-8155-b25091b2c030","resolution":{"observed_at":"2026-08-07T13:43:23.198327Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.05123","last_updated":"2025-08-26T15:28:36Z","snapshot_observed_at":"2026-08-04T16:46:26.858502Z","submitted_at":"2024-02-04T13:32:01Z","title":"A Survey on Data Selection for LLM Instruction Tuning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.05123","snapshot_observed_at":"2026-08-07T13:20:29.527627Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.22076","last_updated":"2025-05-28T07:58:29Z","snapshot_observed_at":"2026-08-09T14:44:10.466694Z","submitted_at":"2025-05-28T07:58:29Z","title":"ArgInstruct: Specialized Instruction Fine-Tuning for Computational Argumentation","version":1},"reference_index":110,"source":"arxiv_source","source_observed_at":"2026-08-07T13:20:29.527627Z"},"links":{"cited_paper":"/paper/2402.05123","citing_paper":"/paper/2505.22076"},"observation_digest":"sha256:86eb74d134d6859e5b63834bd15657deceadd54bbe7f622944a5a09742d9721f","observation_id":"e2090164-fdb4-4e7a-b837-1543fb21ac2f","resolution":{"observed_at":"2026-08-07T13:20:29.527627Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.05123","last_updated":"2025-08-26T15:28:36Z","snapshot_observed_at":"2026-08-04T16:46:26.858502Z","submitted_at":"2024-02-04T13:32:01Z","title":"A Survey on Data Selection for LLM Instruction Tuning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.05123","snapshot_observed_at":"2026-08-07T10:56:21.880845Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.04015","last_updated":"2025-06-04T14:46:18Z","snapshot_observed_at":"2026-08-10T14:44:58.705284Z","submitted_at":"2025-06-04T14:46:18Z","title":"GORACS: Group-level Optimal Transport-guided Coreset Selection for LLM-based Recommender Systems","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-07T10:56:21.880845Z"},"links":{"cited_paper":"/paper/2402.05123","citing_paper":"/paper/2506.04015"},"observation_digest":"sha256:3f5ed5078eb63abf891175e76f3d8cd30f350818c505a937f4de5106ef812dcc","observation_id":"3fdc6f74-750c-4b53-9f05-cab4f4998de2","resolution":{"observed_at":"2026-08-07T10:56:21.880845Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.05123","last_updated":"2025-08-26T15:28:36Z","snapshot_observed_at":"2026-08-04T16:46:26.858502Z","submitted_at":"2024-02-04T13:32:01Z","title":"A Survey on Data Selection for LLM Instruction Tuning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.05123","snapshot_observed_at":"2026-08-07T04:55:43.048278Z","title":"A survey on data selection for llm instruction tuning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.09329","last_updated":"2025-06-11T02:08:52Z","snapshot_observed_at":"2026-08-10T21:16:34.357243Z","submitted_at":"2025-06-11T02:08:52Z","title":"Towards Efficient and Effective Alignment of Large Language Models","version":1},"reference_index":176,"source":"pdf_text","source_observed_at":"2026-08-07T04:55:43.048278Z"},"links":{"cited_paper":"/paper/2402.05123","citing_paper":"/paper/2506.09329"},"observation_digest":"sha256:e91733e164ec67d5b6bfbe45efe28c7d6503afb126ff865465a8067e8a85d94b","observation_id":"03076de3-2125-4495-950a-34cb7bf559dd","resolution":{"observed_at":"2026-08-07T04:55:43.048278Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.05123","last_updated":"2025-08-26T15:28:36Z","snapshot_observed_at":"2026-08-04T16:46:26.858502Z","submitted_at":"2024-02-04T13:32:01Z","title":"A Survey on Data Selection for LLM Instruction Tuning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.05123","snapshot_observed_at":"2026-08-07T04:31:14.490902Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.21564","last_updated":"2025-06-12T07:09:35Z","snapshot_observed_at":"2026-08-10T09:44:18.069576Z","submitted_at":"2025-06-12T07:09:35Z","title":"Team QUST at SemEval-2025 Task 10: Evaluating Large Language Models in Multiclass Multi-label Classification of News Entity Framing","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-07T04:31:14.490902Z"},"links":{"cited_paper":"/paper/2402.05123","citing_paper":"/paper/2506.21564"},"observation_digest":"sha256:8d401a8803d171a00fd6ba8585cd4f9f2628575628df3de4ef090bd18a066cab","observation_id":"cf73bab8-6827-4129-9f85-04c93f5784a6","resolution":{"observed_at":"2026-08-07T04:31:14.490902Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.05123","last_updated":"2025-08-26T15:28:36Z","snapshot_observed_at":"2026-08-04T16:46:26.858502Z","submitted_at":"2024-02-04T13:32:01Z","title":"A Survey on Data Selection for LLM Instruction Tuning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.05123","snapshot_observed_at":"2026-08-05T20:20:24.467176Z","title":"A survey on data selection for llm instruction tuning.arXiv preprint arXiv:2402.05123, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.10858","last_updated":"2025-08-14T17:30:37Z","snapshot_observed_at":"2026-08-07T07:22:47.570469Z","submitted_at":"2025-08-14T17:30:37Z","title":"Hierarchical Fine-grained Preference Optimization for Physically Plausible Video Generation","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-05T20:20:24.467176Z"},"links":{"cited_paper":"/paper/2402.05123","citing_paper":"/paper/2508.10858"},"observation_digest":"sha256:1aa051a13d804571889b850a498b942c8c8af9a23bfb33728410033fc3b7e00b","observation_id":"3afcc84e-8dac-4d38-8c70-2f79f03afed4","resolution":{"observed_at":"2026-08-05T20:20:24.467176Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.05123","last_updated":"2025-08-26T15:28:36Z","snapshot_observed_at":"2026-08-04T16:46:26.858502Z","submitted_at":"2024-02-04T13:32:01Z","title":"A Survey on Data Selection for LLM Instruction Tuning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.05123","snapshot_observed_at":"2026-08-05T20:17:50.495923Z","title":"A survey on data selection for llm instruction tuning.arXiv preprint arXiv:2402.05123, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.10860","last_updated":"2025-08-14T17:31:18Z","snapshot_observed_at":"2026-08-07T19:46:00.567985Z","submitted_at":"2025-08-14T17:31:18Z","title":"From Black Box to Transparency: Enhancing Automated Interpreting Assessment with Explainable AI in College Classrooms","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-05T20:17:50.495923Z"},"links":{"cited_paper":"/paper/2402.05123","citing_paper":"/paper/2508.10860"},"observation_digest":"sha256:ec3938117b0442252800a5a75658912bdb0d926d8505b88fd2e17e3dee03b484","observation_id":"2e1f0604-b540-4cfd-9f89-63e9f451c43c","resolution":{"observed_at":"2026-08-05T20:17:50.495923Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.05123","last_updated":"2025-08-26T15:28:36Z","snapshot_observed_at":"2026-08-04T16:46:26.858502Z","submitted_at":"2024-02-04T13:32:01Z","title":"A Survey on Data Selection for LLM Instruction Tuning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.05123","snapshot_observed_at":"2026-08-03T12:17:57.718792Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.29175","last_updated":"2026-07-31T08:52:26Z","snapshot_observed_at":"2026-08-08T15:28:27.209674Z","submitted_at":"2026-07-31T08:52:26Z","title":"Execution-First Synthetic Tool-Use Trace Generation for LLM Agents","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-03T12:17:57.718792Z"},"links":{"cited_paper":"/paper/2402.05123","citing_paper":"/paper/2607.29175"},"observation_digest":"sha256:67cca4f0f08758610a3492c157ca8e2720c3e10e81f39c36c6735d2e32dc2632","observation_id":"6c3ecc67-0956-4c43-8f94-9c5aad04ff93","resolution":{"observed_at":"2026-08-03T12:17:57.718792Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.05123","last_updated":"2025-08-26T15:28:36Z","snapshot_observed_at":"2026-08-04T16:46:26.858502Z","submitted_at":"2024-02-04T13:32:01Z","title":"A Survey on Data Selection for LLM Instruction Tuning","version":3},"cited_work":{"arxiv_id":"2402.05123","doi":null,"metadata_source":"pith","pith_arxiv_id":"2402.05123","snapshot_observed_at":"2026-08-05T00:15:22.234678Z","title":"A Survey on Data Selection for LLM Instruction Tuning","venue":"cs.CL","work_id":"c300ed06-3e70-45ae-aac0-b59c4f52b2b5","year":2024},"citing_paper":{"arxiv_id":"2608.00805","last_updated":"2026-08-01T18:17:47Z","snapshot_observed_at":"2026-08-09T19:02:01.863250Z","submitted_at":"2026-08-01T18:17:47Z","title":"AgentSLABench: Evaluating and Benchmarking Agentic Systems Under Resource Constraints","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-05T00:15:21.850234Z"},"links":{"cited_paper":"/paper/2402.05123","citing_paper":"/paper/2608.00805"},"observation_digest":"sha256:b036a1a5ffe5244cbce2f5ceaca7e6e72809a0592a2992d35ba2e57d93243ec4","observation_id":"d99641cc-9417-41bb-8ad6-85981f927d0f","resolution":{"observed_at":"2026-08-05T00:15:22.318352Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2402.05123/citation-record","integrity":"/paper/2402.05123/integrity","json":"/paper/2402.05123/citation-record.json","paper":"/paper/2402.05123"},"outbound":[],"paper":{"arxiv_id":"2402.05123","last_updated":"2025-08-26T15:28:36Z","latest_version":3,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-04T16:46:26.858502Z","submitted_at":"2024-02-04T13:32:01Z","title":"A Survey on Data Selection for LLM Instruction Tuning"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 13 inbound Pith citation observations for arXiv:2402.05123."}