{"as_of":"2026-08-10T08:02:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:0aa52d84ba0111826ec2def4522839c73d9f82142d2dae091f8513bbb1d5989b","coverage":[{"denominator":26,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":26,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T15:38:43.670203Z","state":"measured"},{"denominator":26,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":26,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.04828/citation-record","integrity":"/paper/2608.04828/integrity","json":"/paper/2608.04828/citation-record.json","paper":"/paper/2608.04828"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2503.21460","last_updated":"2025-03-27T12:50:17Z","snapshot_observed_at":"2026-07-06T20:59:35.694800Z","submitted_at":"2025-03-27T12:50:17Z","title":"Large Language Model Agent: A Survey on Methodology, Applications and Challenges","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.21460","snapshot_observed_at":"2026-08-06T15:38:41.370321Z","title":"Large language model agent: A survey on methodology, applications and challenges.arXiv preprint arXiv:2503.21460, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.04828","last_updated":"2026-08-05T13:29:16Z","snapshot_observed_at":"2026-08-09T13:53:07.556319Z","submitted_at":"2026-08-05T13:29:16Z","title":"Skill-Use: Can LLMs Actually Use Skills in Agentic Harnesses?","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T15:38:41.370321Z"},"links":{"cited_paper":"/paper/2503.21460","citing_paper":"/paper/2608.04828"},"observation_digest":"sha256:7671fe298da71c2b25a6cb0f69df92ec4da06cb4bd9564e79368d75afb934f34","observation_id":"a4266c2f-6900-4907-be5e-e97ba459722a","resolution":{"observed_at":"2026-08-06T15:38:41.370321Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:38:46.385400Z","title":"Theagentcompany: benchmarking llm agents on consequen- tial real world tasks.Advances in Neural Information Processing Systems, 38, 2026","venue":null,"work_id":"c9a41fe4-d4a0-4d24-acc6-a32f8f7f64d1","year":2026},"citing_paper":{"arxiv_id":"2608.04828","last_updated":"2026-08-05T13:29:16Z","snapshot_observed_at":"2026-08-09T13:53:07.556319Z","submitted_at":"2026-08-05T13:29:16Z","title":"Skill-Use: Can LLMs Actually Use Skills in Agentic Harnesses?","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T15:38:41.416490Z"},"links":{"citing_paper":"/paper/2608.04828"},"observation_digest":"sha256:f6bcd05a18fa479a8efcad84ab7ebdf691869d24ecb531767f2d486052562ae9","observation_id":"7589ae9d-d7f5-4bd1-90c8-da0b6ae5b8af","resolution":{"observed_at":"2026-08-06T15:38:46.467109Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2605.09359","last_updated":"2026-05-10T06:19:15Z","snapshot_observed_at":"2026-07-06T23:21:26.017420Z","submitted_at":"2026-05-10T06:19:15Z","title":"Skill-R1: Agent Skill Evolution via Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.09359","snapshot_observed_at":"2026-08-06T15:38:41.569596Z","title":"Skill-r1: Agent skill evolution via reinforcement learning","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.04828","last_updated":"2026-08-05T13:29:16Z","snapshot_observed_at":"2026-08-09T13:53:07.556319Z","submitted_at":"2026-08-05T13:29:16Z","title":"Skill-Use: Can LLMs Actually Use Skills in Agentic Harnesses?","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T15:38:41.569596Z"},"links":{"cited_paper":"/paper/2605.09359","citing_paper":"/paper/2608.04828"},"observation_digest":"sha256:236dd3960a93dec1d0b338e97fdfdd2c6665031901b7e06f7739258cd2f3e398","observation_id":"80bb1fca-ef73-4483-a08a-a46343d5056e","resolution":{"observed_at":"2026-08-06T15:38:41.569596Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:38:41.769513Z","title":"Agent skills: A data-driven analysis of claude skills for extending large language model functionality.arXiv preprint arXiv:2602.08004, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.04828","last_updated":"2026-08-05T13:29:16Z","snapshot_observed_at":"2026-08-09T13:53:07.556319Z","submitted_at":"2026-08-05T13:29:16Z","title":"Skill-Use: Can LLMs Actually Use Skills in Agentic Harnesses?","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T15:38:41.769513Z"},"links":{"citing_paper":"/paper/2608.04828"},"observation_digest":"sha256:2a041b5b483cd637ca05f70fd29b83e020b5755ead8d42e39ace03bf1e57046f","observation_id":"5f1ac2f4-bfda-4d8d-9d64-fb38090d1ccb","resolution":{"observed_at":"2026-08-06T15:38:41.769513Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2602.12670","last_updated":"2026-03-13T07:33:01Z","snapshot_observed_at":"2026-07-06T22:45:44.135338Z","submitted_at":"2026-02-13T07:06:06Z","title":"SkillsBench: Benchmarking How Well Agent Skills Work Across Diverse Tasks","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2602.12670","snapshot_observed_at":"2026-08-06T15:38:41.966146Z","title":"Skillsbench: Benchmarking how well agent skills work across diverse tasks.arXiv preprint arXiv:2602.12670, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.04828","last_updated":"2026-08-05T13:29:16Z","snapshot_observed_at":"2026-08-09T13:53:07.556319Z","submitted_at":"2026-08-05T13:29:16Z","title":"Skill-Use: Can LLMs Actually Use Skills in Agentic Harnesses?","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T15:38:41.966146Z"},"links":{"cited_paper":"/paper/2602.12670","citing_paper":"/paper/2608.04828"},"observation_digest":"sha256:156bcea6abe89efa01fbd6f8fbd0711931eff7cdf3916fc439f34bf944b823f2","observation_id":"8a87d7b9-7bd6-48a7-96b4-fb039b38cb34","resolution":{"observed_at":"2026-08-06T15:38:41.966146Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2604.20087","last_updated":"2026-04-22T01:07:37Z","snapshot_observed_at":"2026-07-06T23:06:35.507008Z","submitted_at":"2026-04-22T01:07:37Z","title":"SkillLearnBench: Benchmarking Continual Learning Methods for Agent Skill Generation on Real-World Tasks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.20087","snapshot_observed_at":"2026-08-06T15:38:42.040035Z","title":"Skilllearnbench: Benchmarking continual learning methods for agent skill generation on real-world tasks.arXiv preprint arXiv:2604.20087, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.04828","last_updated":"2026-08-05T13:29:16Z","snapshot_observed_at":"2026-08-09T13:53:07.556319Z","submitted_at":"2026-08-05T13:29:16Z","title":"Skill-Use: Can LLMs Actually Use Skills in Agentic Harnesses?","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T15:38:42.040035Z"},"links":{"cited_paper":"/paper/2604.20087","citing_paper":"/paper/2608.04828"},"observation_digest":"sha256:725e08da1cc52dd27f725553ff7896da9a2d74d6f7a346e297e13bb9ea8d03ef","observation_id":"8cf06d0b-ed6a-4d69-8d5c-d4b138ca2a04","resolution":{"observed_at":"2026-08-06T15:38:42.040035Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:38:42.079299Z","title":"Orga- nizing, orchestrating, and benchmarking agent skills at ecosystem scale.arXiv preprint arXiv:2603.02176, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.04828","last_updated":"2026-08-05T13:29:16Z","snapshot_observed_at":"2026-08-09T13:53:07.556319Z","submitted_at":"2026-08-05T13:29:16Z","title":"Skill-Use: Can LLMs Actually Use Skills in Agentic Harnesses?","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T15:38:42.079299Z"},"links":{"citing_paper":"/paper/2608.04828"},"observation_digest":"sha256:adea3dd7139f371c603339673eecae28d1c690f4a1be2ecccf11038f24c42b31","observation_id":"90ac718d-d84d-4824-acef-9aeb41f4943a","resolution":{"observed_at":"2026-08-06T15:38:42.079299Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:38:42.169353Z","title":"Skillnet: Create, evaluate, and connect ai skills.arXiv preprint arXiv:2603.04448, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.04828","last_updated":"2026-08-05T13:29:16Z","snapshot_observed_at":"2026-08-09T13:53:07.556319Z","submitted_at":"2026-08-05T13:29:16Z","title":"Skill-Use: Can LLMs Actually Use Skills in Agentic Harnesses?","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T15:38:42.169353Z"},"links":{"citing_paper":"/paper/2608.04828"},"observation_digest":"sha256:58662376e4a6a04262f21f305e3e4f51ba555d0af07d80807dc3186869bfd437","observation_id":"f0ee1b70-516b-47a8-9423-c4facdd1a8ff","resolution":{"observed_at":"2026-08-06T15:38:42.169353Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:38:42.251238Z","title":"Autoskill: Experience-driven lifelong learning via skill self-evolution.arXiv preprint arXiv:2603.01145, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.04828","last_updated":"2026-08-05T13:29:16Z","snapshot_observed_at":"2026-08-09T13:53:07.556319Z","submitted_at":"2026-08-05T13:29:16Z","title":"Skill-Use: Can LLMs Actually Use Skills in Agentic Harnesses?","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T15:38:42.251238Z"},"links":{"citing_paper":"/paper/2608.04828"},"observation_digest":"sha256:f9000c4fe885a29bd59fe8949b4efa91870a702a9d1ba35712e0db5350a0e5ef","observation_id":"a58fb1c1-d4fd-4fbf-9923-db935930c6b9","resolution":{"observed_at":"2026-08-06T15:38:42.251238Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:38:42.343681Z","title":"Memento-skills: Let agents design agents.arXiv preprint arXiv:2603.18743, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.04828","last_updated":"2026-08-05T13:29:16Z","snapshot_observed_at":"2026-08-09T13:53:07.556319Z","submitted_at":"2026-08-05T13:29:16Z","title":"Skill-Use: Can LLMs Actually Use Skills in Agentic Harnesses?","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T15:38:42.343681Z"},"links":{"citing_paper":"/paper/2608.04828"},"observation_digest":"sha256:f2e2849ccca8316e787599b86b20a954aa856eab0df361eff0c1e1494957b422","observation_id":"075b6390-617e-4a08-86a9-68a5ad758c82","resolution":{"observed_at":"2026-08-06T15:38:42.343681Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2607.09016","last_updated":"2026-07-10T00:48:30Z","snapshot_observed_at":"2026-08-02T02:18:12.494943Z","submitted_at":"2026-07-10T00:48:30Z","title":"SLBench: Evaluating How LLM Agents Follow Logical Relations in Skills","version":1},"cited_work":{"arxiv_id":"2607.09016","doi":null,"metadata_source":"pith","pith_arxiv_id":"2607.09016","snapshot_observed_at":"2026-08-06T15:38:43.906596Z","title":"SLBench: Evaluating How LLM Agents Follow Logical Relations in Skills","venue":"cs.CR","work_id":"d396110c-c864-4698-8218-c0bb8caea3ec","year":2026},"citing_paper":{"arxiv_id":"2608.04828","last_updated":"2026-08-05T13:29:16Z","snapshot_observed_at":"2026-08-09T13:53:07.556319Z","submitted_at":"2026-08-05T13:29:16Z","title":"Skill-Use: Can LLMs Actually Use Skills in Agentic Harnesses?","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T15:38:42.420308Z"},"links":{"cited_paper":"/paper/2607.09016","citing_paper":"/paper/2608.04828"},"observation_digest":"sha256:8dc7841df57ae09b74157f8548976990c2a0a2a02afc2d74d7e8fa12d68d0d89","observation_id":"8bc841d7-9ea7-4f04-a959-4cd49f36f544","resolution":{"observed_at":"2026-08-06T15:38:43.949998Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.07911","last_updated":"2023-11-14T05:13:55Z","snapshot_observed_at":"2026-07-06T16:47:08.877195Z","submitted_at":"2023-11-14T05:13:55Z","title":"Instruction-Following Evaluation for Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.07911","snapshot_observed_at":"2026-08-06T15:38:42.552670Z","title":"Instruction-following evaluation for large language models.arXiv preprint arXiv:2311.07911, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.04828","last_updated":"2026-08-05T13:29:16Z","snapshot_observed_at":"2026-08-09T13:53:07.556319Z","submitted_at":"2026-08-05T13:29:16Z","title":"Skill-Use: Can LLMs Actually Use Skills in Agentic Harnesses?","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T15:38:42.552670Z"},"links":{"cited_paper":"/paper/2311.07911","citing_paper":"/paper/2608.04828"},"observation_digest":"sha256:48a8c328a5b7ec1457b6261e2ec1bced8c4aa3828eb433b192716b8db8993700","observation_id":"36817ce0-c3c4-4a23-871f-a55c30c2e68d","resolution":{"observed_at":"2026-08-06T15:38:42.552670Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:38:46.141794Z","title":"Followbench: A multi-level fine-grained constraints following benchmark for large language models","venue":null,"work_id":"0ad7d476-eeef-4249-a1db-d0d24fe21abc","year":2024},"citing_paper":{"arxiv_id":"2608.04828","last_updated":"2026-08-05T13:29:16Z","snapshot_observed_at":"2026-08-09T13:53:07.556319Z","submitted_at":"2026-08-05T13:29:16Z","title":"Skill-Use: Can LLMs Actually Use Skills in Agentic Harnesses?","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T15:38:42.639788Z"},"links":{"citing_paper":"/paper/2608.04828"},"observation_digest":"sha256:7e59f3aff79efaeed4147cbf737bfc35b322c588c2e2347c0ce0171af3e4a0b5","observation_id":"606233ca-dde7-41df-8d6f-d25fc75a3a00","resolution":{"observed_at":"2026-08-06T15:38:46.246312Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:38:42.724332Z","title":"Infobench: Evaluating instruction following ability in large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.04828","last_updated":"2026-08-05T13:29:16Z","snapshot_observed_at":"2026-08-09T13:53:07.556319Z","submitted_at":"2026-08-05T13:29:16Z","title":"Skill-Use: Can LLMs Actually Use Skills in Agentic Harnesses?","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T15:38:42.724332Z"},"links":{"citing_paper":"/paper/2608.04828"},"observation_digest":"sha256:094abe4ca66b5b46d87840492d9292cc0da9cf2c012be09eb130c432834dc381","observation_id":"d2ce020d-3290-40f0-86f7-c18c856f7429","resolution":{"observed_at":"2026-08-06T15:38:42.724332Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:38:45.883508Z","title":"Benchmarking complex instruction-following with multiple constraints composition","venue":null,"work_id":"8630b49b-3ee1-4606-a010-d4bb4b9ae664","year":2024},"citing_paper":{"arxiv_id":"2608.04828","last_updated":"2026-08-05T13:29:16Z","snapshot_observed_at":"2026-08-09T13:53:07.556319Z","submitted_at":"2026-08-05T13:29:16Z","title":"Skill-Use: Can LLMs Actually Use Skills in Agentic Harnesses?","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T15:38:42.800877Z"},"links":{"citing_paper":"/paper/2608.04828"},"observation_digest":"sha256:1d157302ab35949193f2342609cf24e6677cdd5a0131425a185e7830637c9c72","observation_id":"cf969f85-d06d-4fc5-b477-7d19481f3089","resolution":{"observed_at":"2026-08-06T15:38:46.007953Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:38:45.671669Z","title":"Agentif: Benchmarking large language models instruction following ability in agentic scenarios.Advances in Neural Information Processing Systems, 38, 2026","venue":null,"work_id":"a52dc7e2-449f-48c6-8555-800157afe9dc","year":2026},"citing_paper":{"arxiv_id":"2608.04828","last_updated":"2026-08-05T13:29:16Z","snapshot_observed_at":"2026-08-09T13:53:07.556319Z","submitted_at":"2026-08-05T13:29:16Z","title":"Skill-Use: Can LLMs Actually Use Skills in Agentic Harnesses?","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T15:38:42.897685Z"},"links":{"citing_paper":"/paper/2608.04828"},"observation_digest":"sha256:c64add5cadde8ce0a1ee77e627380f92a8f1ca9ff81ed373e82bec67a64f03f7","observation_id":"07c56e30-fdd0-4fbd-bf28-edf6934c4a1c","resolution":{"observed_at":"2026-08-06T15:38:45.742772Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2605.23950","last_updated":"2026-05-07T15:24:59Z","snapshot_observed_at":"2026-08-03T13:44:55.519841Z","submitted_at":"2026-05-07T15:24:59Z","title":"Stop Comparing LLM Agents Without Disclosing the Harness","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.23950","snapshot_observed_at":"2026-08-06T15:38:42.965973Z","title":"Stop comparing llm agents without disclosing the harness.arXiv preprint arXiv:2605.23950, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.04828","last_updated":"2026-08-05T13:29:16Z","snapshot_observed_at":"2026-08-09T13:53:07.556319Z","submitted_at":"2026-08-05T13:29:16Z","title":"Skill-Use: Can LLMs Actually Use Skills in Agentic Harnesses?","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T15:38:42.965973Z"},"links":{"cited_paper":"/paper/2605.23950","citing_paper":"/paper/2608.04828"},"observation_digest":"sha256:ec2fb4b8ccbc9368ec8f2a803123b445ea7bc320824df0f93a1c843f8ef8f620","observation_id":"c2026e00-7ded-4a48-b435-ab6447975160","resolution":{"observed_at":"2026-08-06T15:38:42.965973Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.27922","last_updated":"2026-05-27T03:47:35Z","snapshot_observed_at":"2026-08-08T22:44:44.640854Z","submitted_at":"2026-05-27T03:47:35Z","title":"Harness-Bench: Measuring Harness Effects across Models in Realistic Agent Workflows","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.27922","snapshot_observed_at":"2026-08-06T15:38:43.056799Z","title":"Harness-bench: Measuring harness effects across models in realistic agent workflows.arXiv preprint arXiv:2605.27922, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.04828","last_updated":"2026-08-05T13:29:16Z","snapshot_observed_at":"2026-08-09T13:53:07.556319Z","submitted_at":"2026-08-05T13:29:16Z","title":"Skill-Use: Can LLMs Actually Use Skills in Agentic Harnesses?","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T15:38:43.056799Z"},"links":{"cited_paper":"/paper/2605.27922","citing_paper":"/paper/2608.04828"},"observation_digest":"sha256:60e69a341733d495175cce8f149c4d973b385d25948a41a24217c733d707eb6e","observation_id":"395af4c8-0ea7-40dd-9ffb-33525113c553","resolution":{"observed_at":"2026-08-06T15:38:43.056799Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:38:45.514716Z","title":"Sysbench: Can llms follow system message? InThe Thirteenth International Conference on Learning Representations, 2024","venue":null,"work_id":"9d81b1de-e5bf-425d-831d-dcbec985ba02","year":2024},"citing_paper":{"arxiv_id":"2608.04828","last_updated":"2026-08-05T13:29:16Z","snapshot_observed_at":"2026-08-09T13:53:07.556319Z","submitted_at":"2026-08-05T13:29:16Z","title":"Skill-Use: Can LLMs Actually Use Skills in Agentic Harnesses?","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T15:38:43.120628Z"},"links":{"citing_paper":"/paper/2608.04828"},"observation_digest":"sha256:13675acdb89b32999850211b6657c2492a9c97acad32ee333dffe4ff9db2224d","observation_id":"3470191b-dca1-4e18-8fc5-7d464a915668","resolution":{"observed_at":"2026-08-06T15:38:45.568923Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.15553","last_updated":"2024-11-13T04:26:13Z","snapshot_observed_at":"2026-07-06T19:36:45.701678Z","submitted_at":"2024-10-21T00:59:47Z","title":"Multi-IF: Benchmarking LLMs on Multi-Turn and Multilingual Instructions Following","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.15553","snapshot_observed_at":"2026-08-06T15:38:43.205719Z","title":"Multi-if: Benchmarking llms on multi-turn and multilingual instructions following","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04828","last_updated":"2026-08-05T13:29:16Z","snapshot_observed_at":"2026-08-09T13:53:07.556319Z","submitted_at":"2026-08-05T13:29:16Z","title":"Skill-Use: Can LLMs Actually Use Skills in Agentic Harnesses?","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T15:38:43.205719Z"},"links":{"cited_paper":"/paper/2410.15553","citing_paper":"/paper/2608.04828"},"observation_digest":"sha256:3237d41d582a05af8c7110c8fbf7ac527f7fca6e7e0e38805320bebce6d1840e","observation_id":"a5877146-a186-4571-8180-498013d79e94","resolution":{"observed_at":"2026-08-06T15:38:43.205719Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:38:43.274595Z","title":"Judging llm-as-a-judge with mt-bench and chatbot arena","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.04828","last_updated":"2026-08-05T13:29:16Z","snapshot_observed_at":"2026-08-09T13:53:07.556319Z","submitted_at":"2026-08-05T13:29:16Z","title":"Skill-Use: Can LLMs Actually Use Skills in Agentic Harnesses?","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T15:38:43.274595Z"},"links":{"citing_paper":"/paper/2608.04828"},"observation_digest":"sha256:7d50ba97616b38c33bfd4dc9c84914a266d15afc3c80db7b81c5c3a191b4d283","observation_id":"aa05d250-1d29-4d0f-89e4-cd52dd829559","resolution":{"observed_at":"2026-08-06T15:38:43.274595Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.08669","last_updated":"2025-06-17T17:50:44Z","snapshot_observed_at":"2026-08-07T17:12:14.445837Z","submitted_at":"2025-03-11T17:53:02Z","title":"SOPBench: Evaluating Language Agents at Following Standard Operating Procedures and Constraints","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.08669","snapshot_observed_at":"2026-08-06T15:38:43.353203Z","title":"Sopbench: Evaluating language agents at following standard operating procedures and constraints.arXiv preprint arXiv:2503.08669, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.04828","last_updated":"2026-08-05T13:29:16Z","snapshot_observed_at":"2026-08-09T13:53:07.556319Z","submitted_at":"2026-08-05T13:29:16Z","title":"Skill-Use: Can LLMs Actually Use Skills in Agentic Harnesses?","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T15:38:43.353203Z"},"links":{"cited_paper":"/paper/2503.08669","citing_paper":"/paper/2608.04828"},"observation_digest":"sha256:ee51b4b154010bc74f0204b49ccec170b54a4c60d691c1f24f682fb6b9c146e6","observation_id":"581b78c4-ada0-4025-b4bf-4daf605c7e84","resolution":{"observed_at":"2026-08-06T15:38:43.353203Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:38:45.254077Z","title":null,"venue":null,"work_id":"6fd5f5f7-f34b-486a-a30c-77923811d145","year":null},"citing_paper":{"arxiv_id":"2608.04828","last_updated":"2026-08-05T13:29:16Z","snapshot_observed_at":"2026-08-09T13:53:07.556319Z","submitted_at":"2026-08-05T13:29:16Z","title":"Skill-Use: Can LLMs Actually Use Skills in Agentic Harnesses?","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T15:38:43.436668Z"},"links":{"citing_paper":"/paper/2608.04828"},"observation_digest":"sha256:a1a897743bd3d1940b5d4adcb366fc9edabb0f23ae51d9a79dfb72111b526a4e","observation_id":"4200e5b6-42e8-4fd7-90d2-5fa0a37f6bd6","resolution":{"observed_at":"2026-08-06T15:38:45.416713Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:38:44.978904Z","title":null,"venue":null,"work_id":"a71bd71a-d760-445b-a9f4-8bc297a255de","year":null},"citing_paper":{"arxiv_id":"2608.04828","last_updated":"2026-08-05T13:29:16Z","snapshot_observed_at":"2026-08-09T13:53:07.556319Z","submitted_at":"2026-08-05T13:29:16Z","title":"Skill-Use: Can LLMs Actually Use Skills in Agentic Harnesses?","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T15:38:43.511861Z"},"links":{"citing_paper":"/paper/2608.04828"},"observation_digest":"sha256:ecb6fea65db0670ca882d4e310f6a2905e5ae085b794cb9569ede7846950cc13","observation_id":"486e0e27-5156-4bdc-a184-fe574b52ac5a","resolution":{"observed_at":"2026-08-06T15:38:45.104227Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:38:44.574486Z","title":null,"venue":null,"work_id":"4efe36b9-3f91-468d-b54f-0e1bd8fa7bf6","year":null},"citing_paper":{"arxiv_id":"2608.04828","last_updated":"2026-08-05T13:29:16Z","snapshot_observed_at":"2026-08-09T13:53:07.556319Z","submitted_at":"2026-08-05T13:29:16Z","title":"Skill-Use: Can LLMs Actually Use Skills in Agentic Harnesses?","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T15:38:43.586596Z"},"links":{"citing_paper":"/paper/2608.04828"},"observation_digest":"sha256:ce1503671e98b3f3808b2b4dbaf465dd9bea31c8965d002817000c7203699dde","observation_id":"b6bc6ce9-2d16-4f92-a12c-2763c6f3590f","resolution":{"observed_at":"2026-08-06T15:38:44.786035Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:38:44.461225Z","title":"pdftk-server","venue":null,"work_id":"0804a7e2-ccc3-4079-8d94-9fe2e0e2df24","year":null},"citing_paper":{"arxiv_id":"2608.04828","last_updated":"2026-08-05T13:29:16Z","snapshot_observed_at":"2026-08-09T13:53:07.556319Z","submitted_at":"2026-08-05T13:29:16Z","title":"Skill-Use: Can LLMs Actually Use Skills in Agentic Harnesses?","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T15:38:43.670203Z"},"links":{"citing_paper":"/paper/2608.04828"},"observation_digest":"sha256:f29f98c802fbc58292e9139f4ff5c3a56db7bbb27173df6073e3984da92eb7dd","observation_id":"115f6e3a-ae6c-4593-bd56-6b6c61ec52f1","resolution":{"observed_at":"2026-08-06T15:38:44.514436Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2608.04828","last_updated":"2026-08-05T13:29:16Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-09T13:53:07.556319Z","submitted_at":"2026-08-05T13:29:16Z","title":"Skill-Use: Can LLMs Actually Use Skills in Agentic Harnesses?"},"reference_resolution":{"displayed":26,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":19,"verified_exact":1,"verified_fuzzy":6},"total_outbound_references":26},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 26 of 26 outbound references and 0 inbound Pith citation observations for arXiv:2608.04828."}