{"as_of":"2026-08-20T14:09:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:e6fd8069e435cf4bb0922916ec521c29cbd6b8eed5e221da91cb6f00a060d977","coverage":[{"denominator":47,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":47,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-30T16:13:43.527362Z","state":"measured"},{"denominator":49,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":49,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-20T06:33:59.587034+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-16T00:35:53.030478Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-07-03T04:57:38.275398Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2605.23657","last_updated":"2026-05-28T04:39:19Z","snapshot_observed_at":"2026-08-12T21:40:44.548283Z","submitted_at":"2026-05-22T14:09:41Z","title":"OpenSkillEval: Automatically Auditing the Open Skill Ecosystem for LLM Agents","version":2},"cited_work":{"arxiv_id":"2605.23657","doi":null,"metadata_source":"pith","pith_arxiv_id":"2605.23657","snapshot_observed_at":"2026-07-03T04:57:38.275398Z","title":"OpenSkillEval: Automatically Auditing the Open Skill Ecosystem for LLM Agents","venue":"cs.CL","work_id":"0e060947-6580-4c7e-aff1-1add28e2be63","year":2026},"citing_paper":{"arxiv_id":"2606.20659","last_updated":"2026-07-04T18:33:30Z","snapshot_observed_at":"2026-08-13T00:00:29.088328Z","submitted_at":"2026-06-09T10:16:05Z","title":"Skill Coverage: A Test Adequacy Metric for Agent Skills","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-06-27T13:32:51.474878Z"},"links":{"cited_paper":"/paper/2605.23657","citing_paper":"/paper/2606.20659"},"observation_digest":"sha256:5c60cf56dd5040b79dc8be2f01fd8817d348331e5bfda1ad4d592de6b18d44bc","observation_id":"455fcb44-311a-421e-9bc2-2a45139a5146","resolution":{"observed_at":"2026-07-03T04:57:38.276563Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2605.23657","last_updated":"2026-05-28T04:39:19Z","snapshot_observed_at":"2026-08-12T21:40:44.548283Z","submitted_at":"2026-05-22T14:09:41Z","title":"OpenSkillEval: Automatically Auditing the Open Skill Ecosystem for LLM Agents","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.23657","snapshot_observed_at":"2026-08-16T00:35:53.030478Z","title":"OpenSkillEval: Automatically auditing the open skill ecosystem for LLM agents.arXiv preprint arXiv:2605.23657, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.11727","last_updated":"2026-08-12T07:07:57Z","snapshot_observed_at":"2026-08-18T17:47:46.661309Z","submitted_at":"2026-08-12T07:07:57Z","title":"Harness-IF: Evaluating Instruction Following Across Instruction Surfaces in Coding Agents","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-16T00:35:53.030478Z"},"links":{"cited_paper":"/paper/2605.23657","citing_paper":"/paper/2608.11727"},"observation_digest":"sha256:d083328bfdab5a671aa08d73d6d2bea5b40136cef4e096da57a8610b41090385","observation_id":"fca0b68c-e694-4d6d-a48d-84bda6132c8f","resolution":{"observed_at":"2026-08-16T00:35:53.030478Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2605.23657/citation-record","integrity":"/paper/2605.23657/integrity","json":"/paper/2605.23657/citation-record.json","paper":"/paper/2605.23657"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T14:14:59.493894Z","title":"GPT-5.4 thinking system card","venue":null,"work_id":"24682bad-8c75-4ecb-9ff7-d42487d709ad","year":2026},"citing_paper":{"arxiv_id":"2605.23657","last_updated":"2026-05-28T04:39:19Z","snapshot_observed_at":"2026-08-12T21:40:44.548283Z","submitted_at":"2026-05-22T14:09:41Z","title":"OpenSkillEval: Automatically Auditing the Open Skill Ecosystem for LLM Agents","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-06-30T16:13:43.527362Z"},"links":{"citing_paper":"/paper/2605.23657"},"observation_digest":"sha256:a8d946074bc9e92d2b030826fca2b9b2931c4964fa085f1a7a301b6f94c35bbb","observation_id":"b75c7611-4df1-4cb6-8a1f-87ba7f386b1a","resolution":{"observed_at":"2026-07-08T14:14:59.495126Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T14:14:59.540842Z","title":"System card: Claude Opus 4.6","venue":null,"work_id":"ce621ac0-175f-4b1f-a56e-ad9db9431930","year":2026},"citing_paper":{"arxiv_id":"2605.23657","last_updated":"2026-05-28T04:39:19Z","snapshot_observed_at":"2026-08-12T21:40:44.548283Z","submitted_at":"2026-05-22T14:09:41Z","title":"OpenSkillEval: Automatically Auditing the Open Skill Ecosystem for LLM Agents","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-06-30T16:13:43.527362Z"},"links":{"citing_paper":"/paper/2605.23657"},"observation_digest":"sha256:a74aa98771fc752fb0ee2cedfeaa4487b9076a19f10c264635669d4a0c790672","observation_id":"1a67702c-f8b8-41ef-ac56-2b263c546dec","resolution":{"observed_at":"2026-07-08T14:14:59.541895Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T14:14:59.547507Z","title":"Claude code by anthropic | ai coding agent, terminal, ide","venue":null,"work_id":"7f598d52-5e91-439f-8259-f680fe9e5454","year":2025},"citing_paper":{"arxiv_id":"2605.23657","last_updated":"2026-05-28T04:39:19Z","snapshot_observed_at":"2026-08-12T21:40:44.548283Z","submitted_at":"2026-05-22T14:09:41Z","title":"OpenSkillEval: Automatically Auditing the Open Skill Ecosystem for LLM Agents","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-06-30T16:13:43.527362Z"},"links":{"citing_paper":"/paper/2605.23657"},"observation_digest":"sha256:7fe05a1d85afc7deb235226148b8b850a7318ab4db85e4e9f97698e2077ef867","observation_id":"159a3b8f-3929-4fe5-a190-9498cf2e2d6b","resolution":{"observed_at":"2026-07-08T14:14:59.548908Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T14:14:59.495740Z","title":"Codex by openai | ai coding agent.https://openai.com/codex/","venue":null,"work_id":"54c92e7e-5584-4255-ba97-0aeb49bc1ca7","year":2025},"citing_paper":{"arxiv_id":"2605.23657","last_updated":"2026-05-28T04:39:19Z","snapshot_observed_at":"2026-08-12T21:40:44.548283Z","submitted_at":"2026-05-22T14:09:41Z","title":"OpenSkillEval: Automatically Auditing the Open Skill Ecosystem for LLM Agents","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-06-30T16:13:43.527362Z"},"links":{"citing_paper":"/paper/2605.23657"},"observation_digest":"sha256:2447acaa8ef63db722b56cdfcdb2981fc58e289797e5fb2ffa3c84df3e5ca93e","observation_id":"4f7bf070-115a-4f84-a142-23b5e1acff31","resolution":{"observed_at":"2026-07-08T14:14:59.496971Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T14:14:59.531445Z","title":"Equipping agents for the real world with agent skills","venue":null,"work_id":"b230b18e-957e-4733-95b0-ac4aa25eb5ae","year":2025},"citing_paper":{"arxiv_id":"2605.23657","last_updated":"2026-05-28T04:39:19Z","snapshot_observed_at":"2026-08-12T21:40:44.548283Z","submitted_at":"2026-05-22T14:09:41Z","title":"OpenSkillEval: Automatically Auditing the Open Skill Ecosystem for LLM Agents","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-06-30T16:13:43.527362Z"},"links":{"citing_paper":"/paper/2605.23657"},"observation_digest":"sha256:5a8d9d124f902cadce4d6dc60448835ca25e84cb76b1fce4c1eaec2f66e64c66","observation_id":"50003525-bc7b-41db-ad5f-bb9d5d109e01","resolution":{"observed_at":"2026-07-08T14:14:59.532642Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T14:14:59.533219Z","title":"Harbor: A framework for evaluating and optimizing agents and models in container environments, January 2026","venue":null,"work_id":"720909be-78be-4f78-8e56-0cf3d91d3945","year":2026},"citing_paper":{"arxiv_id":"2605.23657","last_updated":"2026-05-28T04:39:19Z","snapshot_observed_at":"2026-08-12T21:40:44.548283Z","submitted_at":"2026-05-22T14:09:41Z","title":"OpenSkillEval: Automatically Auditing the Open Skill Ecosystem for LLM Agents","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-06-30T16:13:43.527362Z"},"links":{"citing_paper":"/paper/2605.23657"},"observation_digest":"sha256:2ef62c4fcb7f514018bb8f8fa44b40f6a76e8403fc1610c117d606482b9fdea2","observation_id":"4977c240-d9a0-4f4b-9400-05254e0e78f9","resolution":{"observed_at":"2026-07-08T14:14:59.534514Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T14:14:59.542426Z","title":"Pptagent: Generating and evaluating presentations beyond text-to-slides","venue":null,"work_id":"78fc4b06-54aa-4e7f-8168-67f7155f5489","year":2025},"citing_paper":{"arxiv_id":"2605.23657","last_updated":"2026-05-28T04:39:19Z","snapshot_observed_at":"2026-08-12T21:40:44.548283Z","submitted_at":"2026-05-22T14:09:41Z","title":"OpenSkillEval: Automatically Auditing the Open Skill Ecosystem for LLM Agents","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-06-30T16:13:43.527362Z"},"links":{"citing_paper":"/paper/2605.23657"},"observation_digest":"sha256:fa2be199b3777b5d5423c622ec167962f0bccbfbbcac487e34fb8cc6473b712e","observation_id":"d43f0d5f-c501-45f7-9c2e-438fc31a1b12","resolution":{"observed_at":"2026-07-08T14:14:59.543607Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T14:14:59.484454Z","title":"Frabench and ufeval: Unified fine-grained evaluation with task and aspect generalization","venue":null,"work_id":"2a7bb266-df67-49d0-8894-2c9b3c0953db","year":null},"citing_paper":{"arxiv_id":"2605.23657","last_updated":"2026-05-28T04:39:19Z","snapshot_observed_at":"2026-08-12T21:40:44.548283Z","submitted_at":"2026-05-22T14:09:41Z","title":"OpenSkillEval: Automatically Auditing the Open Skill Ecosystem for LLM Agents","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-06-30T16:13:43.527362Z"},"links":{"citing_paper":"/paper/2605.23657"},"observation_digest":"sha256:a6aec1409c0276f833c50ac253f24a90dafa5988b7473ba75f061edac2a165c9","observation_id":"c4809828-f9c2-4c2c-ba1d-ecf176040395","resolution":{"observed_at":"2026-07-08T14:14:59.485827Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2505.12795","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T16:14:53.082891Z","title":"Frabench and ufeval: Unified fine-grained evaluation with task and aspect generalization","venue":null,"work_id":"9ae9fb92-e036-47db-8444-9317f51c8a3d","year":2025},"citing_paper":{"arxiv_id":"2605.23657","last_updated":"2026-05-28T04:39:19Z","snapshot_observed_at":"2026-08-12T21:40:44.548283Z","submitted_at":"2026-05-22T14:09:41Z","title":"OpenSkillEval: Automatically Auditing the Open Skill Ecosystem for LLM Agents","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-06-30T16:13:43.527362Z"},"links":{"citing_paper":"/paper/2605.23657"},"observation_digest":"sha256:bd4687d64f6934f0ed7ee118bfbb3957944c9df167779cce58185b1132e8233e","observation_id":"c9fcc1d4-ab15-49b5-a11b-89a5cc64649b","resolution":{"observed_at":"2026-06-30T16:14:53.084734Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T14:14:59.535100Z","title":"Webarena: A realistic web environment for build- ing autonomous agents","venue":null,"work_id":"fe087db9-09b3-4197-9097-6269c6569b00","year":2023},"citing_paper":{"arxiv_id":"2605.23657","last_updated":"2026-05-28T04:39:19Z","snapshot_observed_at":"2026-08-12T21:40:44.548283Z","submitted_at":"2026-05-22T14:09:41Z","title":"OpenSkillEval: Automatically Auditing the Open Skill Ecosystem for LLM Agents","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-06-30T16:13:43.527362Z"},"links":{"citing_paper":"/paper/2605.23657"},"observation_digest":"sha256:2cafdc7db6774662bbf33a84cdd470680c0e37d3184f519b9f6d96c707b7e5e3","observation_id":"ba44fca2-d872-4ffe-a7f1-78867099894e","resolution":{"observed_at":"2026-07-08T14:14:59.536400Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T14:14:59.488286Z","title":"GPT-5.3-Codex system card","venue":null,"work_id":"172a7417-0090-485a-bcff-77cd2a1eab03","year":2026},"citing_paper":{"arxiv_id":"2605.23657","last_updated":"2026-05-28T04:39:19Z","snapshot_observed_at":"2026-08-12T21:40:44.548283Z","submitted_at":"2026-05-22T14:09:41Z","title":"OpenSkillEval: Automatically Auditing the Open Skill Ecosystem for LLM Agents","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-06-30T16:13:43.527362Z"},"links":{"citing_paper":"/paper/2605.23657"},"observation_digest":"sha256:8e701c0118cf6e9e7d2319ed8b822204daedf71a007fc371626a40d1d68f7a90","observation_id":"87a7d8b4-8cea-4975-bf2a-e0908dabff8f","resolution":{"observed_at":"2026-07-08T14:14:59.489631Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T14:14:59.512062Z","title":"Gemini CLI","venue":null,"work_id":"5c25e5b6-f8a0-45f3-ac6c-5d0d27df48f6","year":2025},"citing_paper":{"arxiv_id":"2605.23657","last_updated":"2026-05-28T04:39:19Z","snapshot_observed_at":"2026-08-12T21:40:44.548283Z","submitted_at":"2026-05-22T14:09:41Z","title":"OpenSkillEval: Automatically Auditing the Open Skill Ecosystem for LLM Agents","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-06-30T16:13:43.527362Z"},"links":{"citing_paper":"/paper/2605.23657"},"observation_digest":"sha256:dd7f232c9435c2a39103bd5393d1e40df1fcaba2ca58b85c9fb140f83cd9e798","observation_id":"886612b5-d755-44c9-8f2b-14727bc8017f","resolution":{"observed_at":"2026-07-08T14:14:59.513425Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T14:14:59.521140Z","title":"Gemini 3.1 pro model card","venue":null,"work_id":"de7b3d65-2155-4e02-b578-24e9ddc85b68","year":2026},"citing_paper":{"arxiv_id":"2605.23657","last_updated":"2026-05-28T04:39:19Z","snapshot_observed_at":"2026-08-12T21:40:44.548283Z","submitted_at":"2026-05-22T14:09:41Z","title":"OpenSkillEval: Automatically Auditing the Open Skill Ecosystem for LLM Agents","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-06-30T16:13:43.527362Z"},"links":{"citing_paper":"/paper/2605.23657"},"observation_digest":"sha256:082f030ecccf3ca47e5682e95348b7d27694aad54a33bacf75b9c098d53abb02","observation_id":"b7e87c06-b283-4d8d-8515-1055fc8f7dd8","resolution":{"observed_at":"2026-07-08T14:14:59.522823Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T14:14:59.482628Z","title":"Kimi code CLI.https://github.com/MoonshotAI/kimi-cli","venue":null,"work_id":"2aa7f507-f6b6-4ae1-8a8a-372ca21f3af9","year":2025},"citing_paper":{"arxiv_id":"2605.23657","last_updated":"2026-05-28T04:39:19Z","snapshot_observed_at":"2026-08-12T21:40:44.548283Z","submitted_at":"2026-05-22T14:09:41Z","title":"OpenSkillEval: Automatically Auditing the Open Skill Ecosystem for LLM Agents","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-06-30T16:13:43.527362Z"},"links":{"citing_paper":"/paper/2605.23657"},"observation_digest":"sha256:4fc1d9164732ea2c4478509fd31c41d073da141a89ee723a786c4cb297640b86","observation_id":"d04d6cfc-d3b4-454f-bd4c-18bd4f4c9135","resolution":{"observed_at":"2026-07-08T14:14:59.483864Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.20534","last_updated":"2026-02-03T04:57:00Z","snapshot_observed_at":"2026-08-16T14:37:33.548231Z","submitted_at":"2025-07-28T05:35:43Z","title":"Kimi K2: Open Agentic Intelligence","version":2},"cited_work":{"arxiv_id":"2507.20534","doi":"10.1145/3448609","metadata_source":"pith","pith_arxiv_id":"2507.20534","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Kimi K2: Open Agentic Intelligence","venue":"cs.LG","work_id":"7f18284c-12d3-4137-bea1-1da97e8cf3c1","year":2025},"citing_paper":{"arxiv_id":"2605.23657","last_updated":"2026-05-28T04:39:19Z","snapshot_observed_at":"2026-08-12T21:40:44.548283Z","submitted_at":"2026-05-22T14:09:41Z","title":"OpenSkillEval: Automatically Auditing the Open Skill Ecosystem for LLM Agents","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-06-30T16:13:43.527362Z"},"links":{"cited_paper":"/paper/2507.20534","citing_paper":"/paper/2605.23657"},"observation_digest":"sha256:4c45ce4581903eddf15db49c8d9914f08f8d779a0161f1e65e563b50e1a29456","observation_id":"cff4c5a4-cd66-43b5-8ab1-2e3bafaca1d1","resolution":{"observed_at":"2026-06-30T16:14:53.081856Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-05-25T01:23:16.170083+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-25T01:23:16.170083+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T14:14:59.490219Z","title":"MiniMax M2.7: Early echoes of self-evolution","venue":null,"work_id":"066272f0-4535-4335-9983-60356e3da4db","year":2026},"citing_paper":{"arxiv_id":"2605.23657","last_updated":"2026-05-28T04:39:19Z","snapshot_observed_at":"2026-08-12T21:40:44.548283Z","submitted_at":"2026-05-22T14:09:41Z","title":"OpenSkillEval: Automatically Auditing the Open Skill Ecosystem for LLM Agents","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-06-30T16:13:43.527362Z"},"links":{"citing_paper":"/paper/2605.23657"},"observation_digest":"sha256:2cdb823090db3eb7b0507bd345a5a3c3fa36c0529033ca6cb19bdd7d34111d72","observation_id":"b7649d9c-82a9-4b50-80d0-8ffcd34b92e1","resolution":{"observed_at":"2026-07-08T14:14:59.491424Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T17:07:26.457128Z","title":"Deepseek-v4: Towards highly efficient million-token context intelligence","venue":null,"work_id":"b5a5843d-47c0-432e-88d5-c9eaac555a7f","year":2026},"citing_paper":{"arxiv_id":"2605.23657","last_updated":"2026-05-28T04:39:19Z","snapshot_observed_at":"2026-08-12T21:40:44.548283Z","submitted_at":"2026-05-22T14:09:41Z","title":"OpenSkillEval: Automatically Auditing the Open Skill Ecosystem for LLM Agents","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-06-30T16:13:43.527362Z"},"links":{"citing_paper":"/paper/2605.23657"},"observation_digest":"sha256:516db59a7609e9789c29dad3e9b1c59286050c218a87cf0fdbb03cf6df3d43ac","observation_id":"73968c50-681f-4204-90d1-f84edc767fb8","resolution":{"observed_at":"2026-07-08T14:14:59.551140Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2602.15763","last_updated":"2026-02-24T10:44:44Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-02-17T17:50:56Z","title":"GLM-5: from Vibe Coding to Agentic Engineering","version":2},"cited_work":{"arxiv_id":"2602.15763","doi":"10.48550/arxiv.2602.15763","metadata_source":"pith","pith_arxiv_id":"2602.15763","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"GLM-5: from Vibe Coding to Agentic Engineering","venue":"cs.LG","work_id":"ad29b1a2-bf77-46b3-9ead-fb62b1d2c6fe","year":2026},"citing_paper":{"arxiv_id":"2605.23657","last_updated":"2026-05-28T04:39:19Z","snapshot_observed_at":"2026-08-12T21:40:44.548283Z","submitted_at":"2026-05-22T14:09:41Z","title":"OpenSkillEval: Automatically Auditing the Open Skill Ecosystem for LLM Agents","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-06-30T16:13:43.527362Z"},"links":{"cited_paper":"/paper/2602.15763","citing_paper":"/paper/2605.23657"},"observation_digest":"sha256:ad1193b70b038a4777bebf982b94c165627e74412860bae1f39f1dd98a7d4907","observation_id":"5891fc9b-7c23-4bbd-8cec-3ae562cdf2b3","resolution":{"observed_at":"2026-06-30T16:14:53.078272Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T14:14:59.501411Z","title":"Intuitive or dependent? investigating LLMs’ behavior style to conflicting prompts","venue":null,"work_id":"14d78382-77fc-486e-854d-50cda90ebce9","year":2024},"citing_paper":{"arxiv_id":"2605.23657","last_updated":"2026-05-28T04:39:19Z","snapshot_observed_at":"2026-08-12T21:40:44.548283Z","submitted_at":"2026-05-22T14:09:41Z","title":"OpenSkillEval: Automatically Auditing the Open Skill Ecosystem for LLM Agents","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-06-30T16:13:43.527362Z"},"links":{"citing_paper":"/paper/2605.23657"},"observation_digest":"sha256:2713f1d6e530f448cae553dfc1c324e3c98bc8484fc858d60d527b32f28a0296","observation_id":"db150676-9cfe-4aa1-87fc-99e0b4311957","resolution":{"observed_at":"2026-07-08T14:14:59.502646Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T14:14:59.523713Z","title":"Why claude code skills don’t activate and how to fix it","venue":null,"work_id":"f3653298-9432-403a-a140-746b8baf884d","year":2026},"citing_paper":{"arxiv_id":"2605.23657","last_updated":"2026-05-28T04:39:19Z","snapshot_observed_at":"2026-08-12T21:40:44.548283Z","submitted_at":"2026-05-22T14:09:41Z","title":"OpenSkillEval: Automatically Auditing the Open Skill Ecosystem for LLM Agents","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-06-30T16:13:43.527362Z"},"links":{"citing_paper":"/paper/2605.23657"},"observation_digest":"sha256:8c1faf4335cb9763fb05f2ebdb07600faa02fd2499b4af13cc5064abdc25d2c7","observation_id":"4be3eeb2-de98-4f1b-9fe9-815ece0142e8","resolution":{"observed_at":"2026-07-08T14:14:59.525180Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.05722","last_updated":"2026-06-03T04:35:07Z","snapshot_observed_at":"2026-08-13T06:02:06.374996Z","submitted_at":"2025-11-07T21:29:41Z","title":"OckBench: Measuring the Efficiency of LLM Reasoning","version":3},"cited_work":{"arxiv_id":"2511.05722","doi":null,"metadata_source":"pith","pith_arxiv_id":"2511.05722","snapshot_observed_at":"2026-07-04T19:40:07.144621Z","title":"Ockbench: Measuring the efficiency of llm reasoning","venue":"cs.CL","work_id":"f4367694-a1b2-42b5-a4c6-3176572fd0bf","year":2025},"citing_paper":{"arxiv_id":"2605.23657","last_updated":"2026-05-28T04:39:19Z","snapshot_observed_at":"2026-08-12T21:40:44.548283Z","submitted_at":"2026-05-22T14:09:41Z","title":"OpenSkillEval: Automatically Auditing the Open Skill Ecosystem for LLM Agents","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-06-30T16:13:43.527362Z"},"links":{"cited_paper":"/paper/2511.05722","citing_paper":"/paper/2605.23657"},"observation_digest":"sha256:a7862adf5b8228d0de48bf9d58fef068a4f459aad83dbbd2603dbb483635eaa6","observation_id":"d23f6910-880d-4ba6-80b2-413723754f72","resolution":{"observed_at":"2026-06-30T16:14:53.076015Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.01292","last_updated":"2024-04-01T17:58:30Z","snapshot_observed_at":"2026-08-19T14:07:24.373964Z","submitted_at":"2024-04-01T17:58:30Z","title":"Measuring Style Similarity in Diffusion Models","version":1},"cited_work":{"arxiv_id":"2404.01292","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2404.01292","snapshot_observed_at":"2026-07-04T19:50:10.486935Z","title":"Measuring style similarity in diffusion models","venue":null,"work_id":"485d434f-db28-411e-9f19-160574d535ae","year":2024},"citing_paper":{"arxiv_id":"2605.23657","last_updated":"2026-05-28T04:39:19Z","snapshot_observed_at":"2026-08-12T21:40:44.548283Z","submitted_at":"2026-05-22T14:09:41Z","title":"OpenSkillEval: Automatically Auditing the Open Skill Ecosystem for LLM Agents","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-06-30T16:13:43.527362Z"},"links":{"cited_paper":"/paper/2404.01292","citing_paper":"/paper/2605.23657"},"observation_digest":"sha256:8a43839a9c87e8c31166ae58d90fabbbb34e980114e22e9c22b3a1219b07307f","observation_id":"e1d08491-2902-4bcf-bc0d-be9edbc51656","resolution":{"observed_at":"2026-06-30T16:14:53.070417Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2602.12430","last_updated":"2026-06-02T16:14:54Z","snapshot_observed_at":"2026-08-06T11:11:16.632352Z","submitted_at":"2026-02-12T21:33:25Z","title":"Agent Skills for Large Language Models: Architecture, Acquisition, Security, and the Path Forward","version":4},"cited_work":{"arxiv_id":"2602.12430","doi":"10.48550/arxiv.2602.12430","metadata_source":"pith","pith_arxiv_id":"2602.12430","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Agent Skills for Large Language Models: Architecture, Acquisition, Security, and the Path Forward","venue":"cs.MA","work_id":"a64d3985-6826-492c-8a2e-f0965d805bfd","year":2026},"citing_paper":{"arxiv_id":"2605.23657","last_updated":"2026-05-28T04:39:19Z","snapshot_observed_at":"2026-08-12T21:40:44.548283Z","submitted_at":"2026-05-22T14:09:41Z","title":"OpenSkillEval: Automatically Auditing the Open Skill Ecosystem for LLM Agents","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-06-30T16:13:43.527362Z"},"links":{"cited_paper":"/paper/2602.12430","citing_paper":"/paper/2605.23657"},"observation_digest":"sha256:11abd85c3fe817ba5d4d3a6431a61df1273ae0a4e5d51e01d5506d7f16b3743a","observation_id":"5585cee7-6fd2-42c5-b9dc-cd83449c9d7d","resolution":{"observed_at":"2026-06-30T16:14:53.068148Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2603.02766","last_updated":"2026-03-03T09:07:22Z","snapshot_observed_at":"2026-08-15T16:32:40.226808Z","submitted_at":"2026-03-03T09:07:22Z","title":"EvoSkill: Automated Skill Discovery for Multi-Agent Systems","version":1},"cited_work":{"arxiv_id":"2603.02766","doi":"10.48550/arxiv.2603.02766","metadata_source":"pith","pith_arxiv_id":"2603.02766","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"EvoSkill: Automated Skill Discovery for Multi-Agent Systems","venue":"cs.AI","work_id":"94c2c7b2-0c94-4b32-90cc-bc154d192850","year":2026},"citing_paper":{"arxiv_id":"2605.23657","last_updated":"2026-05-28T04:39:19Z","snapshot_observed_at":"2026-08-12T21:40:44.548283Z","submitted_at":"2026-05-22T14:09:41Z","title":"OpenSkillEval: Automatically Auditing the Open Skill Ecosystem for LLM Agents","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-06-30T16:13:43.527362Z"},"links":{"cited_paper":"/paper/2603.02766","citing_paper":"/paper/2605.23657"},"observation_digest":"sha256:a7327bd1fb55857e90d3cb982d8a6f3601d125388b2cda521c663ee32a7391c8","observation_id":"9978f370-df0a-403b-b6ab-3255dd4319f2","resolution":{"observed_at":"2026-06-30T16:14:53.070717Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2603.01145","doi":"10.48550/arxiv.2603.01145","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Autoskill: Experience-driven lifelong learning via skill self-evolution","venue":"Open MIND","work_id":"f5786621-deeb-44fb-9f12-c1d70df052ea","year":2026},"citing_paper":{"arxiv_id":"2605.23657","last_updated":"2026-05-28T04:39:19Z","snapshot_observed_at":"2026-08-12T21:40:44.548283Z","submitted_at":"2026-05-22T14:09:41Z","title":"OpenSkillEval: Automatically Auditing the Open Skill Ecosystem for LLM Agents","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-06-30T16:13:43.527362Z"},"links":{"citing_paper":"/paper/2605.23657"},"observation_digest":"sha256:33ea76500e091347b70bf770f1dc8b074f8dece1d32d1ded117287496a2e68e6","observation_id":"f4b2c33e-c5fc-4a9b-a7de-1a0dfb7a9f29","resolution":{"observed_at":"2026-06-30T16:14:53.089748Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.07079","last_updated":"2025-04-09T17:51:50Z","snapshot_observed_at":"2026-07-06T21:06:50.056353Z","submitted_at":"2025-04-09T17:51:50Z","title":"SkillWeaver: Web Agents can Self-Improve by Discovering and Honing Skills","version":1},"cited_work":{"arxiv_id":"2504.07079","doi":"10.48550/arxiv.2504.07079","metadata_source":"pith","pith_arxiv_id":"2504.07079","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"SkillWeaver: Web Agents can Self-Improve by Discovering and Honing Skills","venue":"cs.AI","work_id":"72b1aff0-91c3-4500-abc9-22129ca67748","year":2025},"citing_paper":{"arxiv_id":"2605.23657","last_updated":"2026-05-28T04:39:19Z","snapshot_observed_at":"2026-08-12T21:40:44.548283Z","submitted_at":"2026-05-22T14:09:41Z","title":"OpenSkillEval: Automatically Auditing the Open Skill Ecosystem for LLM Agents","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-06-30T16:13:43.527362Z"},"links":{"cited_paper":"/paper/2504.07079","citing_paper":"/paper/2605.23657"},"observation_digest":"sha256:4bbaf5f908c450b0f4fc8c6f0783da7e1d55dce7a3b33264e40bd45321d65f84","observation_id":"01a69210-82ef-43f5-895f-def70f343e13","resolution":{"observed_at":"2026-06-30T16:14:53.092208Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2602.12670","last_updated":"2026-03-13T07:33:01Z","snapshot_observed_at":"2026-08-12T09:12:28.700231Z","submitted_at":"2026-02-13T07:06:06Z","title":"SkillsBench: Benchmarking How Well Agent Skills Work Across Diverse Tasks","version":3},"cited_work":{"arxiv_id":"2602.12670","doi":"10.48550/arxiv.2602.12670","metadata_source":"pith","pith_arxiv_id":"2602.12670","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"SkillsBench: Benchmarking How Well Agent Skills Work Across Diverse Tasks","venue":"cs.AI","work_id":"b477d12a-2ca6-4894-9f90-3fb479635e98","year":2026},"citing_paper":{"arxiv_id":"2605.23657","last_updated":"2026-05-28T04:39:19Z","snapshot_observed_at":"2026-08-12T21:40:44.548283Z","submitted_at":"2026-05-22T14:09:41Z","title":"OpenSkillEval: Automatically Auditing the Open Skill Ecosystem for LLM Agents","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-06-30T16:13:43.527362Z"},"links":{"cited_paper":"/paper/2602.12670","citing_paper":"/paper/2605.23657"},"observation_digest":"sha256:887533f0c078ba77a71fca96dc957cf27158d3a7e88c37800b56ce97d5df08bd","observation_id":"c7f09166-40c4-4c25-be4d-e1700d3e3007","resolution":{"observed_at":"2026-06-30T16:14:53.084252Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T14:14:59.497574Z","title":"PinchBench: Real-world benchmarks for AI coding agents","venue":null,"work_id":"f32d29dc-0337-40e7-bd7b-d756b81b4368","year":2026},"citing_paper":{"arxiv_id":"2605.23657","last_updated":"2026-05-28T04:39:19Z","snapshot_observed_at":"2026-08-12T21:40:44.548283Z","submitted_at":"2026-05-22T14:09:41Z","title":"OpenSkillEval: Automatically Auditing the Open Skill Ecosystem for LLM Agents","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-06-30T16:13:43.527362Z"},"links":{"citing_paper":"/paper/2605.23657"},"observation_digest":"sha256:904b615d9baecb0b611b13e4fb188a5d7f81cd5f1b7d9bb46168801b8101fc61","observation_id":"466544ab-b010-4fa9-a672-1b2ff509cbaa","resolution":{"observed_at":"2026-07-08T14:14:59.498851Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T14:14:59.529635Z","title":"Wildclawbench","venue":null,"work_id":"e753af49-92a1-46ef-a253-c98ed4a94080","year":2026},"citing_paper":{"arxiv_id":"2605.23657","last_updated":"2026-05-28T04:39:19Z","snapshot_observed_at":"2026-08-12T21:40:44.548283Z","submitted_at":"2026-05-22T14:09:41Z","title":"OpenSkillEval: Automatically Auditing the Open Skill Ecosystem for LLM Agents","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-06-30T16:13:43.527362Z"},"links":{"citing_paper":"/paper/2605.23657"},"observation_digest":"sha256:1ba44ff5dd8280c96ef7c055e8242c6fe808649421a2b0000a0a617fc203be11","observation_id":"0be73169-c536-46d3-aa2b-e056835a5d1c","resolution":{"observed_at":"2026-07-08T14:14:59.530826Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T14:14:59.538832Z","title":"Swe-bench: Can language models resolve real-world github issues? 2023","venue":null,"work_id":"79ef91d6-c213-4507-9174-ab4ed24e52a4","year":2023},"citing_paper":{"arxiv_id":"2605.23657","last_updated":"2026-05-28T04:39:19Z","snapshot_observed_at":"2026-08-12T21:40:44.548283Z","submitted_at":"2026-05-22T14:09:41Z","title":"OpenSkillEval: Automatically Auditing the Open Skill Ecosystem for LLM Agents","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-06-30T16:13:43.527362Z"},"links":{"citing_paper":"/paper/2605.23657"},"observation_digest":"sha256:37a3678e6fcf484f1cb628d6f854c7717d59bac5813268615ea676d05022a58f","observation_id":"9b50b325-656f-4223-8701-724cb4692bda","resolution":{"observed_at":"2026-07-08T14:14:59.540226Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T14:14:59.491983Z","title":"Agentbench: Evaluating llms as agents","venue":null,"work_id":"199bc8bd-bc74-467e-96c2-fa2c632ea9d7","year":2023},"citing_paper":{"arxiv_id":"2605.23657","last_updated":"2026-05-28T04:39:19Z","snapshot_observed_at":"2026-08-12T21:40:44.548283Z","submitted_at":"2026-05-22T14:09:41Z","title":"OpenSkillEval: Automatically Auditing the Open Skill Ecosystem for LLM Agents","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-06-30T16:13:43.527362Z"},"links":{"citing_paper":"/paper/2605.23657"},"observation_digest":"sha256:934c215c580a4437735291231ebb45ed24c66aa9e559f5ab01b0972b1bcefca9","observation_id":"e3b918cc-6bf3-4356-8681-2dc7caca94ec","resolution":{"observed_at":"2026-07-08T14:14:59.493270Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.18838","last_updated":"2025-04-26T07:48:52Z","snapshot_observed_at":"2026-08-17T04:06:12.060099Z","submitted_at":"2025-04-26T07:48:52Z","title":"Toward Generalizable Evaluation in the LLM Era: A Survey Beyond Benchmarks","version":1},"cited_work":{"arxiv_id":"2504.18838","doi":"10.48550/arxiv.2504.18838","metadata_source":"arxiv_reference","pith_arxiv_id":"2504.18838","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Toward generalizable evaluation in the llm era: A survey beyond benchmarks","venue":"ArXiv.org","work_id":"2203b9f6-a499-4aea-a61a-10a829102e00","year":2025},"citing_paper":{"arxiv_id":"2605.23657","last_updated":"2026-05-28T04:39:19Z","snapshot_observed_at":"2026-08-12T21:40:44.548283Z","submitted_at":"2026-05-22T14:09:41Z","title":"OpenSkillEval: Automatically Auditing the Open Skill Ecosystem for LLM Agents","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-06-30T16:13:43.527362Z"},"links":{"cited_paper":"/paper/2504.18838","citing_paper":"/paper/2605.23657"},"observation_digest":"sha256:18a86443814aefc22d9f0ff4b49494c92c576bf85788578bb03d1fee0b8d700a","observation_id":"9b742e26-6c99-428d-a1ca-37d918b187c9","resolution":{"observed_at":"2026-06-30T16:14:53.086828Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T14:14:59.499466Z","title":"Automating dataset updates towards reliable and timely evaluation of large language models","venue":null,"work_id":"a11d030a-434a-4b39-8cf3-9ed4892d8c2b","year":null},"citing_paper":{"arxiv_id":"2605.23657","last_updated":"2026-05-28T04:39:19Z","snapshot_observed_at":"2026-08-12T21:40:44.548283Z","submitted_at":"2026-05-22T14:09:41Z","title":"OpenSkillEval: Automatically Auditing the Open Skill Ecosystem for LLM Agents","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-06-30T16:13:43.527362Z"},"links":{"citing_paper":"/paper/2605.23657"},"observation_digest":"sha256:843e359b5dd0b853083c482313e189ec19e19caefd4b8c82752ab06db514f5e6","observation_id":"cd20161a-c3ed-40fb-96c8-7169f93cb83a","resolution":{"observed_at":"2026-07-08T14:14:59.500837Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.52202/079017-0544","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"URL https://proceedings.neurips.cc/paper_ files/paper/2024/file/1e89c12621c0315373f20f0aeabe5dbe-Paper-Datasets_ and_Benchmarks_Track.pdf","venue":null,"work_id":"3c34695f-4eee-41f6-a880-dae9d3f742ac","year":2024},"citing_paper":{"arxiv_id":"2605.23657","last_updated":"2026-05-28T04:39:19Z","snapshot_observed_at":"2026-08-12T21:40:44.548283Z","submitted_at":"2026-05-22T14:09:41Z","title":"OpenSkillEval: Automatically Auditing the Open Skill Ecosystem for LLM Agents","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-06-30T16:13:43.527362Z"},"links":{"citing_paper":"/paper/2605.23657"},"observation_digest":"sha256:cae5efd782b59b15c262937bf8f5e9a88dcd65cb9808a61ebe3724f25e6d25e7","observation_id":"48aaae0c-4e2e-43ce-adf8-b10ce95860bc","resolution":{"observed_at":"2026-06-30T16:14:52.625105Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-05-25T06:23:19.857829+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-25T06:23:19.857829+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2025.acl-long.47","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"EvoWiki: Evaluating LLMs on evolving knowledge","venue":null,"work_id":"250262fd-efdd-4df3-944a-8c27fa252b21","year":2025},"citing_paper":{"arxiv_id":"2605.23657","last_updated":"2026-05-28T04:39:19Z","snapshot_observed_at":"2026-08-12T21:40:44.548283Z","submitted_at":"2026-05-22T14:09:41Z","title":"OpenSkillEval: Automatically Auditing the Open Skill Ecosystem for LLM Agents","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-06-30T16:13:43.527362Z"},"links":{"citing_paper":"/paper/2605.23657"},"observation_digest":"sha256:8a568629d82c6cdb44ac36de798b9020c0d12fced07da47fab4a2943f4fb201c","observation_id":"35bfca28-bdc0-41dc-82fb-7b610e01bf1a","resolution":{"observed_at":"2026-06-30T16:14:52.622408Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-05-25T06:23:20.19559+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-25T06:23:20.19559+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T14:14:59.525866Z","title":"Livebench: A challenging, contamination-free LLM benchmark","venue":null,"work_id":"3364893c-6b44-4ac0-ae6d-472c30cc6ade","year":2025},"citing_paper":{"arxiv_id":"2605.23657","last_updated":"2026-05-28T04:39:19Z","snapshot_observed_at":"2026-08-12T21:40:44.548283Z","submitted_at":"2026-05-22T14:09:41Z","title":"OpenSkillEval: Automatically Auditing the Open Skill Ecosystem for LLM Agents","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-06-30T16:13:43.527362Z"},"links":{"citing_paper":"/paper/2605.23657"},"observation_digest":"sha256:986f26701d3b996803fb1813da1154a38972187117fdebe01ce8e7192707e906","observation_id":"d158a6ca-d315-4274-a761-fd2453d3fdf8","resolution":{"observed_at":"2026-07-08T14:14:59.527131Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.07974","last_updated":"2024-06-06T17:41:21Z","snapshot_observed_at":"2026-08-16T07:05:57.323612Z","submitted_at":"2024-03-12T17:58:04Z","title":"LiveCodeBench: Holistic and Contamination Free Evaluation of Large Language Models for Code","version":2},"cited_work":{"arxiv_id":"2403.07974","doi":"10.1109/icsme52107.2021.00025","metadata_source":"pith","pith_arxiv_id":"2403.07974","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"LiveCodeBench: Holistic and Contamination Free Evaluation of Large Language Models for Code","venue":"cs.SE","work_id":"ea9e51ce-1e75-4182-92d8-4d25f70d2ee4","year":2024},"citing_paper":{"arxiv_id":"2605.23657","last_updated":"2026-05-28T04:39:19Z","snapshot_observed_at":"2026-08-12T21:40:44.548283Z","submitted_at":"2026-05-22T14:09:41Z","title":"OpenSkillEval: Automatically Auditing the Open Skill Ecosystem for LLM Agents","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-06-30T16:13:43.527362Z"},"links":{"cited_paper":"/paper/2403.07974","citing_paper":"/paper/2605.23657"},"observation_digest":"sha256:1c57d36218d13862a62d631728c4ff8ffa5fd4d3bb93f062f7fbd44d50ed38e3","observation_id":"b3f14967-defb-48a3-b0c5-eb550d7bdd8a","resolution":{"observed_at":"2026-06-30T16:14:53.094645Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T14:14:59.486456Z","title":"application","venue":null,"work_id":"5f062971-5031-4d9a-8c5c-6804cc524828","year":null},"citing_paper":{"arxiv_id":"2605.23657","last_updated":"2026-05-28T04:39:19Z","snapshot_observed_at":"2026-08-12T21:40:44.548283Z","submitted_at":"2026-05-22T14:09:41Z","title":"OpenSkillEval: Automatically Auditing the Open Skill Ecosystem for LLM Agents","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-06-30T16:13:43.527362Z"},"links":{"citing_paper":"/paper/2605.23657"},"observation_digest":"sha256:23a0268476669ac64498424cbd1f90c1aa76cf0ae8bf4c0e56387930180526f3","observation_id":"96af274b-df03-4a5d-9a72-25d26464b3cd","resolution":{"observed_at":"2026-07-08T14:14:59.487693Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T14:14:59.509273Z","title":"application","venue":null,"work_id":"1817609c-3646-45d8-a6ac-6ca296b4d517","year":2025},"citing_paper":{"arxiv_id":"2605.23657","last_updated":"2026-05-28T04:39:19Z","snapshot_observed_at":"2026-08-12T21:40:44.548283Z","submitted_at":"2026-05-22T14:09:41Z","title":"OpenSkillEval: Automatically Auditing the Open Skill Ecosystem for LLM Agents","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-06-30T16:13:43.527362Z"},"links":{"citing_paper":"/paper/2605.23657"},"observation_digest":"sha256:5dc44aa926d6c14762b00ff278c634679eab8391c29671bb5d23c72a6ee6ed6e","observation_id":"9d90ce09-2278-41f9-9864-87ab83bf4559","resolution":{"observed_at":"2026-07-08T14:14:59.511213Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T14:14:59.537167Z","title":"application","venue":null,"work_id":"3a3224f8-ddba-49bc-8f40-c68b6620b5df","year":null},"citing_paper":{"arxiv_id":"2605.23657","last_updated":"2026-05-28T04:39:19Z","snapshot_observed_at":"2026-08-12T21:40:44.548283Z","submitted_at":"2026-05-22T14:09:41Z","title":"OpenSkillEval: Automatically Auditing the Open Skill Ecosystem for LLM Agents","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-06-30T16:13:43.527362Z"},"links":{"citing_paper":"/paper/2605.23657"},"observation_digest":"sha256:69ad2583b7a47aaf66f84a1037c1225b9607fe5ea1d159076e57fabedc22b646","observation_id":"7025c0db-c37d-4754-8adf-40e01baea2ba","resolution":{"observed_at":"2026-07-08T14:14:59.538226Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T14:14:59.514132Z","title":"application","venue":null,"work_id":"6a799292-fb09-4808-94bd-17c77a56ce62","year":2024},"citing_paper":{"arxiv_id":"2605.23657","last_updated":"2026-05-28T04:39:19Z","snapshot_observed_at":"2026-08-12T21:40:44.548283Z","submitted_at":"2026-05-22T14:09:41Z","title":"OpenSkillEval: Automatically Auditing the Open Skill Ecosystem for LLM Agents","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-06-30T16:13:43.527362Z"},"links":{"citing_paper":"/paper/2605.23657"},"observation_digest":"sha256:63d5bcebedb7ce0f51efa6cc79a5f23f8b32142f4b00f09fc49b2447deb73420","observation_id":"8c65efdb-65ca-44b0-b727-de6659235c25","resolution":{"observed_at":"2026-07-08T14:14:59.515389Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T14:14:59.545886Z","title":"application","venue":null,"work_id":"6736a4af-5baf-4b28-9bb0-61e8e4748098","year":null},"citing_paper":{"arxiv_id":"2605.23657","last_updated":"2026-05-28T04:39:19Z","snapshot_observed_at":"2026-08-12T21:40:44.548283Z","submitted_at":"2026-05-22T14:09:41Z","title":"OpenSkillEval: Automatically Auditing the Open Skill Ecosystem for LLM Agents","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-06-30T16:13:43.527362Z"},"links":{"citing_paper":"/paper/2605.23657"},"observation_digest":"sha256:816a3e5b9ed7beed48c53497279d6126a406fd0def8605b30ee5b3df16b0b208","observation_id":"96e4e560-34d2-4efd-af91-ccbd414de3ef","resolution":{"observed_at":"2026-07-08T14:14:59.546965Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T14:14:59.505022Z","title":"expressed","venue":null,"work_id":"f93a8475-9e02-4de2-9803-9b0e9ca7f4a0","year":null},"citing_paper":{"arxiv_id":"2605.23657","last_updated":"2026-05-28T04:39:19Z","snapshot_observed_at":"2026-08-12T21:40:44.548283Z","submitted_at":"2026-05-22T14:09:41Z","title":"OpenSkillEval: Automatically Auditing the Open Skill Ecosystem for LLM Agents","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-06-30T16:13:43.527362Z"},"links":{"citing_paper":"/paper/2605.23657"},"observation_digest":"sha256:4a2b7026f9bc5d8cb04763f0b38fcfbe54ab5d673f47ceba28e1f5c034fb3d4d","observation_id":"ecc33d8e-8316-48dc-b538-fd916959119a","resolution":{"observed_at":"2026-07-08T14:14:59.506288Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T14:14:59.527908Z","title":"score\": <1-5>","venue":null,"work_id":"cf4f0c16-8a85-43ad-a2ca-4784b06ed58b","year":null},"citing_paper":{"arxiv_id":"2605.23657","last_updated":"2026-05-28T04:39:19Z","snapshot_observed_at":"2026-08-12T21:40:44.548283Z","submitted_at":"2026-05-22T14:09:41Z","title":"OpenSkillEval: Automatically Auditing the Open Skill Ecosystem for LLM Agents","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-06-30T16:13:43.527362Z"},"links":{"citing_paper":"/paper/2605.23657"},"observation_digest":"sha256:c72edf6e3675702347001341942dc9420a991dd929fd1693fc4132f222f63f12","observation_id":"a041606d-dc8a-43ca-9078-53150be84cae","resolution":{"observed_at":"2026-07-08T14:14:59.529023Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T14:14:59.480312Z","title":"score\": <1-5>","venue":null,"work_id":"0b47b578-180b-4a03-89b4-64cebe8e7f54","year":null},"citing_paper":{"arxiv_id":"2605.23657","last_updated":"2026-05-28T04:39:19Z","snapshot_observed_at":"2026-08-12T21:40:44.548283Z","submitted_at":"2026-05-22T14:09:41Z","title":"OpenSkillEval: Automatically Auditing the Open Skill Ecosystem for LLM Agents","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-06-30T16:13:43.527362Z"},"links":{"citing_paper":"/paper/2605.23657"},"observation_digest":"sha256:daac1c219567909b3793cdabaefd6eb77a5426166074afcc73d751e5f024669f","observation_id":"ea1bedc8-5afd-443d-987c-75d5723b61ba","resolution":{"observed_at":"2026-07-08T14:14:59.482009Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T14:14:59.503214Z","title":"score\": <1-5>","venue":null,"work_id":"8b1bcc22-9841-48ea-b953-c04c24712eab","year":null},"citing_paper":{"arxiv_id":"2605.23657","last_updated":"2026-05-28T04:39:19Z","snapshot_observed_at":"2026-08-12T21:40:44.548283Z","submitted_at":"2026-05-22T14:09:41Z","title":"OpenSkillEval: Automatically Auditing the Open Skill Ecosystem for LLM Agents","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-06-30T16:13:43.527362Z"},"links":{"citing_paper":"/paper/2605.23657"},"observation_digest":"sha256:6303b7c372a3678d9bd9384946eb809a8a66dc63605075f818d246545c4e05fc","observation_id":"3a54be36-86d9-41ba-9789-739b8c6d4f50","resolution":{"observed_at":"2026-07-08T14:14:59.504441Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T14:14:59.544168Z","title":"score\": <1-5>","venue":null,"work_id":"22ecc4de-ed71-4df6-92c6-986a5bcbb1e7","year":null},"citing_paper":{"arxiv_id":"2605.23657","last_updated":"2026-05-28T04:39:19Z","snapshot_observed_at":"2026-08-12T21:40:44.548283Z","submitted_at":"2026-05-22T14:09:41Z","title":"OpenSkillEval: Automatically Auditing the Open Skill Ecosystem for LLM Agents","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-06-30T16:13:43.527362Z"},"links":{"citing_paper":"/paper/2605.23657"},"observation_digest":"sha256:279dfa65ca1ab11b63f0f100d96b5d3e0d6336e2af0da2b7cada69d89c8a3cc8","observation_id":"c161e18f-d64d-4f5a-91e5-5d9e44dcc1e5","resolution":{"observed_at":"2026-07-08T14:14:59.545213Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2605.23657","last_updated":"2026-05-28T04:39:19Z","latest_version":2,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-12T21:40:44.548283Z","submitted_at":"2026-05-22T14:09:41Z","title":"OpenSkillEval: Automatically Auditing the Open Skill Ecosystem for LLM Agents"},"reference_resolution":{"displayed":47,"state_counts":{"malformed_identifier":1,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":0,"verified_exact":13,"verified_fuzzy":32},"total_outbound_references":47},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"thesis":"As of 20 August 2026, this Paper Citation Record lists 47 of 47 outbound references and 2 inbound Pith citation observations for arXiv:2605.23657."}