{"as_of":"2026-08-06T10:49:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:6d87b6fe53b03a919a21b25c0d0a821f911c39c357a56e262e2337c58fca29d1","coverage":[{"denominator":36,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":36,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-01T05:47:44.231622Z","state":"measured"},{"denominator":36,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":36,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-06T06:34:29.942622+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.27557/citation-record","integrity":"/paper/2607.27557/integrity","json":"/paper/2607.27557/citation-record.json","paper":"/paper/2607.27557"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2203.02155","last_updated":"2022-03-04T07:04:42Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-03-04T07:04:42Z","title":"Training language models to follow instructions with human feedback","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.02155","snapshot_observed_at":"2026-08-01T05:47:41.779971Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.27557","last_updated":"2026-07-30T01:03:59Z","snapshot_observed_at":"2026-08-03T07:55:49.914788Z","submitted_at":"2026-07-30T01:03:59Z","title":"Training Skills Like Parameters via Self-Supervised Semantic Diffusion","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-01T05:47:41.779971Z"},"links":{"cited_paper":"/paper/2203.02155","citing_paper":"/paper/2607.27557"},"observation_digest":"sha256:97e42e04393beb539073efd69f37d790a88c31424efadc2432cebec4c2c08be8","observation_id":"ea664b21-4288-4e5a-9039-d8411aab4077","resolution":{"observed_at":"2026-08-01T05:47:41.779971Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2005.14165","last_updated":"2020-07-22T19:47:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-05-28T17:29:03Z","title":"Language Models are Few-Shot Learners","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2005.14165","snapshot_observed_at":"2026-08-01T05:47:41.838480Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.27557","last_updated":"2026-07-30T01:03:59Z","snapshot_observed_at":"2026-08-03T07:55:49.914788Z","submitted_at":"2026-07-30T01:03:59Z","title":"Training Skills Like Parameters via Self-Supervised Semantic Diffusion","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-01T05:47:41.838480Z"},"links":{"cited_paper":"/paper/2005.14165","citing_paper":"/paper/2607.27557"},"observation_digest":"sha256:989b0f4ad7aa96fabcb6b44693cc2554e9028341111b1325fa08ef6fd5dcf311","observation_id":"11dd5baf-d30b-4f5f-89bf-4245dc02cea5","resolution":{"observed_at":"2026-08-01T05:47:41.838480Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T05:47:41.921243Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.27557","last_updated":"2026-07-30T01:03:59Z","snapshot_observed_at":"2026-08-03T07:55:49.914788Z","submitted_at":"2026-07-30T01:03:59Z","title":"Training Skills Like Parameters via Self-Supervised Semantic Diffusion","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-01T05:47:41.921243Z"},"links":{"citing_paper":"/paper/2607.27557"},"observation_digest":"sha256:4c1b7c9c085eb90a414dde6a9e425b7473759d9ca7fae64ccdc1ca1d25004f2e","observation_id":"77ac0ccf-9bd9-4662-a533-1540aa2293c5","resolution":{"observed_at":"2026-08-01T05:47:41.921243Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.22144","last_updated":"2026-05-21T08:15:46Z","snapshot_observed_at":"2026-08-02T20:48:08.100175Z","submitted_at":"2026-05-21T08:15:46Z","title":"One Sentence, One Drama: Personalized Short-Form Drama Generation via Multi-Agent Systems","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.22144","snapshot_observed_at":"2026-08-01T05:47:41.996191Z","title":"One sentence, one drama: Personalized short-form drama generation via multi-agent systems, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.27557","last_updated":"2026-07-30T01:03:59Z","snapshot_observed_at":"2026-08-03T07:55:49.914788Z","submitted_at":"2026-07-30T01:03:59Z","title":"Training Skills Like Parameters via Self-Supervised Semantic Diffusion","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-01T05:47:41.996191Z"},"links":{"cited_paper":"/paper/2605.22144","citing_paper":"/paper/2607.27557"},"observation_digest":"sha256:59dff7b2350742083dc16a75e0ddf06c246b0bf27e67e85a5d032878de9230e2","observation_id":"3bc9adc1-09c6-455b-bc87-7f23bf78e9c2","resolution":{"observed_at":"2026-08-01T05:47:41.996191Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T05:47:42.071698Z","title":"Lima: Less is more for alignment, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.27557","last_updated":"2026-07-30T01:03:59Z","snapshot_observed_at":"2026-08-03T07:55:49.914788Z","submitted_at":"2026-07-30T01:03:59Z","title":"Training Skills Like Parameters via Self-Supervised Semantic Diffusion","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-01T05:47:42.071698Z"},"links":{"citing_paper":"/paper/2607.27557"},"observation_digest":"sha256:546afa57164df5f94f8806ad8353a8ca9c8264f52e31035f4779ffb5ea50f0e5","observation_id":"7bbdc4df-50c7-4da4-b4a4-b372941af36c","resolution":{"observed_at":"2026-08-01T05:47:42.071698Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.01552","last_updated":"2023-12-04T00:46:11Z","snapshot_observed_at":"2026-07-06T16:56:21.561513Z","submitted_at":"2023-12-04T00:46:11Z","title":"The Unlocking Spell on Base LLMs: Rethinking Alignment via In-Context Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.01552","snapshot_observed_at":"2026-08-01T05:47:42.153415Z","title":"The unlocking spell on base llms: Rethinking alignment via in-context learning, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.27557","last_updated":"2026-07-30T01:03:59Z","snapshot_observed_at":"2026-08-03T07:55:49.914788Z","submitted_at":"2026-07-30T01:03:59Z","title":"Training Skills Like Parameters via Self-Supervised Semantic Diffusion","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-01T05:47:42.153415Z"},"links":{"cited_paper":"/paper/2312.01552","citing_paper":"/paper/2607.27557"},"observation_digest":"sha256:a8fe4ce54493c8cb8ad67b03da4ffd89b17849c811dd8adb61f80ad1c708b954","observation_id":"ce1219f5-b9c5-42ea-a92b-cc9b6c2a17d2","resolution":{"observed_at":"2026-08-01T05:47:42.153415Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T05:47:42.246979Z","title":"Scaling laws for reward model overoptimization,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.27557","last_updated":"2026-07-30T01:03:59Z","snapshot_observed_at":"2026-08-03T07:55:49.914788Z","submitted_at":"2026-07-30T01:03:59Z","title":"Training Skills Like Parameters via Self-Supervised Semantic Diffusion","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-01T05:47:42.246979Z"},"links":{"citing_paper":"/paper/2607.27557"},"observation_digest":"sha256:fab7f39288226200ce25d923915cfea22baeefaabd62382d9fc46683551764c5","observation_id":"ff1be997-9adf-493b-822b-3f9ab99d6891","resolution":{"observed_at":"2026-08-01T05:47:42.246979Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.11926","last_updated":"2025-03-14T23:50:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-14T23:50:34Z","title":"Monitoring Reasoning Models for Misbehavior and the Risks of Promoting Obfuscation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.11926","snapshot_observed_at":"2026-08-01T05:47:42.349945Z","title":"Guan, Aleksander Madry, Wojciech Zaremba, Jakub Pachocki, and David Farhi","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.27557","last_updated":"2026-07-30T01:03:59Z","snapshot_observed_at":"2026-08-03T07:55:49.914788Z","submitted_at":"2026-07-30T01:03:59Z","title":"Training Skills Like Parameters via Self-Supervised Semantic Diffusion","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-01T05:47:42.349945Z"},"links":{"cited_paper":"/paper/2503.11926","citing_paper":"/paper/2607.27557"},"observation_digest":"sha256:87ec1aee09d82ed3b026c2c49761a9ba1570b2dd94dc3833c74d803551c84f9b","observation_id":"5b2ad0b4-f0e7-4f65-b636-b7f0a4c696b3","resolution":{"observed_at":"2026-08-01T05:47:42.349945Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.16291","last_updated":"2023-10-19T16:27:03Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-05-25T17:46:38Z","title":"Voyager: An Open-Ended Embodied Agent with Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.16291","snapshot_observed_at":"2026-08-01T05:47:42.407526Z","title":"V oyager: An open-ended embodied agent with large language models, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.27557","last_updated":"2026-07-30T01:03:59Z","snapshot_observed_at":"2026-08-03T07:55:49.914788Z","submitted_at":"2026-07-30T01:03:59Z","title":"Training Skills Like Parameters via Self-Supervised Semantic Diffusion","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-01T05:47:42.407526Z"},"links":{"cited_paper":"/paper/2305.16291","citing_paper":"/paper/2607.27557"},"observation_digest":"sha256:a80c42e42a88ea09383ee9319d27c83ae0c11561c39202f3fb5bf92377218135","observation_id":"121370d5-ee6f-4b6c-b350-c8b7fda284b8","resolution":{"observed_at":"2026-08-01T05:47:42.407526Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.10144","last_updated":"2024-12-20T06:14:53Z","snapshot_observed_at":"2026-08-02T16:16:44.130627Z","submitted_at":"2023-08-20T03:03:34Z","title":"ExpeL: LLM Agents Are Experiential Learners","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.10144","snapshot_observed_at":"2026-08-01T05:47:42.489257Z","title":"Expel: Llm agents are experiential learners, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.27557","last_updated":"2026-07-30T01:03:59Z","snapshot_observed_at":"2026-08-03T07:55:49.914788Z","submitted_at":"2026-07-30T01:03:59Z","title":"Training Skills Like Parameters via Self-Supervised Semantic Diffusion","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-01T05:47:42.489257Z"},"links":{"cited_paper":"/paper/2308.10144","citing_paper":"/paper/2607.27557"},"observation_digest":"sha256:267b2fc6c34a7e160b56d01f0072dbd0d922be8105f5014283d6b02c7e5ad4a5","observation_id":"cf1c6627-5fb7-4218-b0f5-9a8db42105f2","resolution":{"observed_at":"2026-08-01T05:47:42.489257Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1503.03585","last_updated":"2015-11-18T21:50:51Z","snapshot_observed_at":"2026-07-06T04:11:47.439779Z","submitted_at":"2015-03-12T04:51:37Z","title":"Deep Unsupervised Learning using Nonequilibrium Thermodynamics","version":8},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1503.03585","snapshot_observed_at":"2026-08-01T05:47:42.584559Z","title":"Weiss, Niru Maheswaranathan, and Surya Ganguli","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2607.27557","last_updated":"2026-07-30T01:03:59Z","snapshot_observed_at":"2026-08-03T07:55:49.914788Z","submitted_at":"2026-07-30T01:03:59Z","title":"Training Skills Like Parameters via Self-Supervised Semantic Diffusion","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-01T05:47:42.584559Z"},"links":{"cited_paper":"/paper/1503.03585","citing_paper":"/paper/2607.27557"},"observation_digest":"sha256:eefa21fbf8dae236fb3236b8edb4fe1d1baabef61ecad0eb53a17db597483486","observation_id":"2122a6d0-66d9-4f85-9ff9-37e1aa0a3221","resolution":{"observed_at":"2026-08-01T05:47:42.584559Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2006.11239","last_updated":"2020-12-16T21:15:05Z","snapshot_observed_at":"2026-07-06T09:30:47.469703Z","submitted_at":"2020-06-19T17:24:44Z","title":"Denoising Diffusion Probabilistic Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2006.11239","snapshot_observed_at":"2026-08-01T05:47:42.660416Z","title":"Denoising diffusion probabilistic models, 2020","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.27557","last_updated":"2026-07-30T01:03:59Z","snapshot_observed_at":"2026-08-03T07:55:49.914788Z","submitted_at":"2026-07-30T01:03:59Z","title":"Training Skills Like Parameters via Self-Supervised Semantic Diffusion","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-01T05:47:42.660416Z"},"links":{"cited_paper":"/paper/2006.11239","citing_paper":"/paper/2607.27557"},"observation_digest":"sha256:179467837f14d12fd385f40af8f67575a201f421163743d74659a0abf1bda032","observation_id":"29c24eb0-5936-4bda-8308-186cc1a75995","resolution":{"observed_at":"2026-08-01T05:47:42.660416Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1910.13461","last_updated":"2019-10-29T18:01:00Z","snapshot_observed_at":"2026-07-06T08:33:12.534026Z","submitted_at":"2019-10-29T18:01:00Z","title":"BART: Denoising Sequence-to-Sequence Pre-training for Natural Language Generation, Translation, and Comprehension","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1910.13461","snapshot_observed_at":"2026-08-01T05:47:42.720407Z","title":"Bart: Denoising sequence-to-sequence pre-training for natural language generation, translation, and comprehension, 2019","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.27557","last_updated":"2026-07-30T01:03:59Z","snapshot_observed_at":"2026-08-03T07:55:49.914788Z","submitted_at":"2026-07-30T01:03:59Z","title":"Training Skills Like Parameters via Self-Supervised Semantic Diffusion","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-01T05:47:42.720407Z"},"links":{"cited_paper":"/paper/1910.13461","citing_paper":"/paper/2607.27557"},"observation_digest":"sha256:94f751443241863b6da2f51d7c3203c9a576a97ceb56cfb24c2e44beecd05f4a","observation_id":"baa50952-545b-4dd8-a773-65ce90dce9dc","resolution":{"observed_at":"2026-08-01T05:47:42.720407Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1807.03748","last_updated":"2019-01-22T18:47:12Z","snapshot_observed_at":"2026-07-06T06:49:24.960992Z","submitted_at":"2018-07-10T16:52:11Z","title":"Representation Learning with Contrastive Predictive Coding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1807.03748","snapshot_observed_at":"2026-08-01T05:47:42.797431Z","title":"Representation learning with contrastive predictive coding, 2019","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.27557","last_updated":"2026-07-30T01:03:59Z","snapshot_observed_at":"2026-08-03T07:55:49.914788Z","submitted_at":"2026-07-30T01:03:59Z","title":"Training Skills Like Parameters via Self-Supervised Semantic Diffusion","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-01T05:47:42.797431Z"},"links":{"cited_paper":"/paper/1807.03748","citing_paper":"/paper/2607.27557"},"observation_digest":"sha256:6e91d898b4c109fc039e431565b7f73577812f318a0c21fa64c882bc10bb028f","observation_id":"ce31f522-bf83-46c4-9ebf-656501f50774","resolution":{"observed_at":"2026-08-01T05:47:42.797431Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.07496","last_updated":"2024-06-11T17:32:21Z","snapshot_observed_at":"2026-07-06T18:29:04.294349Z","submitted_at":"2024-06-11T17:32:21Z","title":"TextGrad: Automatic \"Differentiation\" via Text","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.07496","snapshot_observed_at":"2026-08-01T05:47:42.858914Z","title":"differentiation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.27557","last_updated":"2026-07-30T01:03:59Z","snapshot_observed_at":"2026-08-03T07:55:49.914788Z","submitted_at":"2026-07-30T01:03:59Z","title":"Training Skills Like Parameters via Self-Supervised Semantic Diffusion","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-01T05:47:42.858914Z"},"links":{"cited_paper":"/paper/2406.07496","citing_paper":"/paper/2607.27557"},"observation_digest":"sha256:5bfcc121ee19049d5d006c8c53a6454450942de64ebb9a714f9498b19a17d6f3","observation_id":"3aae3ad7-4065-4615-b36b-670fea8408a9","resolution":{"observed_at":"2026-08-01T05:47:42.858914Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T05:47:42.944008Z","title":"gradient descent","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.27557","last_updated":"2026-07-30T01:03:59Z","snapshot_observed_at":"2026-08-03T07:55:49.914788Z","submitted_at":"2026-07-30T01:03:59Z","title":"Training Skills Like Parameters via Self-Supervised Semantic Diffusion","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-01T05:47:42.944008Z"},"links":{"citing_paper":"/paper/2607.27557"},"observation_digest":"sha256:a2f555c6214d288b9f2def36ad07384cd8d5634322263f873aae2cb82b79bb98","observation_id":"21d9b804-bd7c-4e92-9d42-13d6c1cb6bcc","resolution":{"observed_at":"2026-08-01T05:47:42.944008Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.05641","last_updated":"2026-05-30T02:07:53Z","snapshot_observed_at":"2026-08-04T09:35:30.849542Z","submitted_at":"2025-03-07T18:03:13Z","title":"Skill-Based Mixture-of-Experts: Adaptive Routing for Heterogeneous Reasoning via Inferred Skills","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.05641","snapshot_observed_at":"2026-08-01T05:47:42.992352Z","title":"Skill-based mixture-of-experts: Adaptive routing for heterogeneous reasoning via inferred skills, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.27557","last_updated":"2026-07-30T01:03:59Z","snapshot_observed_at":"2026-08-03T07:55:49.914788Z","submitted_at":"2026-07-30T01:03:59Z","title":"Training Skills Like Parameters via Self-Supervised Semantic Diffusion","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-01T05:47:42.992352Z"},"links":{"cited_paper":"/paper/2503.05641","citing_paper":"/paper/2607.27557"},"observation_digest":"sha256:2cc1d2873ade291dfd75ebc2fa9ef8327636b1b6de58e9658c440cc8e06f023c","observation_id":"19e2f30b-363c-486a-b15f-7a6fd6cb13d1","resolution":{"observed_at":"2026-08-01T05:47:42.992352Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2108.07258","last_updated":"2022-07-12T23:45:14Z","snapshot_observed_at":"2026-08-02T09:20:40.804790Z","submitted_at":"2021-08-16T17:50:08Z","title":"On the Opportunities and Risks of Foundation Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2108.07258","snapshot_observed_at":"2026-08-01T05:47:43.069442Z","title":"Hudson, Ehsan Adeli, Russ Altman, Simran Arora, Sydney von Arx, Michael S","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.27557","last_updated":"2026-07-30T01:03:59Z","snapshot_observed_at":"2026-08-03T07:55:49.914788Z","submitted_at":"2026-07-30T01:03:59Z","title":"Training Skills Like Parameters via Self-Supervised Semantic Diffusion","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-01T05:47:43.069442Z"},"links":{"cited_paper":"/paper/2108.07258","citing_paper":"/paper/2607.27557"},"observation_digest":"sha256:ba475807388a25493098df48ff92021c9f47309ec03a317fe5c8231cd6f29112","observation_id":"15a258ea-9975-4a1e-968f-dfcb09ef01f1","resolution":{"observed_at":"2026-08-01T05:47:43.069442Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2106.09685","last_updated":"2021-10-16T18:40:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-06-17T17:37:18Z","title":"LoRA: Low-Rank Adaptation of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.09685","snapshot_observed_at":"2026-08-01T05:47:43.149171Z","title":"Hu, Yelong Shen, Phillip Wallis, Zeyuan Allen-Zhu, Yuanzhi Li, Shean Wang, Lu Wang, and Weizhu Chen","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.27557","last_updated":"2026-07-30T01:03:59Z","snapshot_observed_at":"2026-08-03T07:55:49.914788Z","submitted_at":"2026-07-30T01:03:59Z","title":"Training Skills Like Parameters via Self-Supervised Semantic Diffusion","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-01T05:47:43.149171Z"},"links":{"cited_paper":"/paper/2106.09685","citing_paper":"/paper/2607.27557"},"observation_digest":"sha256:ffdab0e93931973f82a7dbf80947cfda7fccc92e078d7622335b4f78e5230f8c","observation_id":"9c813b27-5a55-4aa4-a8a7-5a9ba9bb3e1e","resolution":{"observed_at":"2026-08-01T05:47:43.149171Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.08747","last_updated":"2025-01-05T04:09:00Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-08-17T02:53:23Z","title":"An Empirical Study of Catastrophic Forgetting in Large Language Models During Continual Fine-tuning","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.08747","snapshot_observed_at":"2026-08-01T05:47:43.199248Z","title":"An empirical study of catastrophic forgetting in large language models during continual fine-tuning, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.27557","last_updated":"2026-07-30T01:03:59Z","snapshot_observed_at":"2026-08-03T07:55:49.914788Z","submitted_at":"2026-07-30T01:03:59Z","title":"Training Skills Like Parameters via Self-Supervised Semantic Diffusion","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-01T05:47:43.199248Z"},"links":{"cited_paper":"/paper/2308.08747","citing_paper":"/paper/2607.27557"},"observation_digest":"sha256:561d9a2b657e6b0a222d6236a4d0641cfaf559e5392c2e61b04aae804de5d4f8","observation_id":"37128997-4fe6-4e0f-9bd5-1e64b6bc329e","resolution":{"observed_at":"2026-08-01T05:47:43.199248Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.02427","last_updated":"2024-03-15T15:44:11Z","snapshot_observed_at":"2026-08-03T00:38:27.580701Z","submitted_at":"2023-09-05T17:56:20Z","title":"Cognitive Architectures for Language Agents","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.02427","snapshot_observed_at":"2026-08-01T05:47:43.256042Z","title":"Sumers, Shunyu Yao, Karthik Narasimhan, and Thomas L","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.27557","last_updated":"2026-07-30T01:03:59Z","snapshot_observed_at":"2026-08-03T07:55:49.914788Z","submitted_at":"2026-07-30T01:03:59Z","title":"Training Skills Like Parameters via Self-Supervised Semantic Diffusion","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-01T05:47:43.256042Z"},"links":{"cited_paper":"/paper/2309.02427","citing_paper":"/paper/2607.27557"},"observation_digest":"sha256:2b8b30ef34b1b0635cd4eedde59014619b8db342b26526c01efbbe2883f71062","observation_id":"b9fb4f74-9dee-4f81-8c22-ce56890a32af","resolution":{"observed_at":"2026-08-01T05:47:43.256042Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.16153","last_updated":"2025-08-25T13:32:12Z","snapshot_observed_at":"2026-08-05T17:29:43.755625Z","submitted_at":"2025-08-22T07:25:30Z","title":"Memento: Fine-tuning LLM Agents without Fine-tuning LLMs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.16153","snapshot_observed_at":"2026-08-01T05:47:43.309709Z","title":"Memento: Fine-tuning llm agents without fine-tuning llms, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.27557","last_updated":"2026-07-30T01:03:59Z","snapshot_observed_at":"2026-08-03T07:55:49.914788Z","submitted_at":"2026-07-30T01:03:59Z","title":"Training Skills Like Parameters via Self-Supervised Semantic Diffusion","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-01T05:47:43.309709Z"},"links":{"cited_paper":"/paper/2508.16153","citing_paper":"/paper/2607.27557"},"observation_digest":"sha256:1334514765e6460caa253c6f2525d746cd9b71b4196edfc3d2583d0e03373b36","observation_id":"c6482c7a-73cc-4eeb-9a3c-c0f6c7fe5637","resolution":{"observed_at":"2026-08-01T05:47:43.309709Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2509.25140","last_updated":"2026-03-16T20:49:28Z","snapshot_observed_at":"2026-08-02T12:08:17.149184Z","submitted_at":"2025-09-29T17:51:03Z","title":"ReasoningBank: Scaling Agent Self-Evolving with Reasoning Memory","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.25140","snapshot_observed_at":"2026-08-01T05:47:43.389997Z","title":"Le, Samira Daruki, Xiangru Tang, Vishy Tirumalashetty, George Lee, Mahsan Rofouei, Hangfei Lin, Jiawei Han, Chen-Yu Lee, and Tomas Pfister","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.27557","last_updated":"2026-07-30T01:03:59Z","snapshot_observed_at":"2026-08-03T07:55:49.914788Z","submitted_at":"2026-07-30T01:03:59Z","title":"Training Skills Like Parameters via Self-Supervised Semantic Diffusion","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-01T05:47:43.389997Z"},"links":{"cited_paper":"/paper/2509.25140","citing_paper":"/paper/2607.27557"},"observation_digest":"sha256:557f60d551ddd7bf710b626b566e9f632e327c84414583f14064f28bfc8158a0","observation_id":"7547ddaa-be82-428f-ad48-771be48ba583","resolution":{"observed_at":"2026-08-01T05:47:43.389997Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.01798","last_updated":"2024-03-14T04:27:52Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-10-03T04:56:12Z","title":"Large Language Models Cannot Self-Correct Reasoning Yet","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.01798","snapshot_observed_at":"2026-08-01T05:47:43.460289Z","title":"Large language models cannot self-correct reasoning yet, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.27557","last_updated":"2026-07-30T01:03:59Z","snapshot_observed_at":"2026-08-03T07:55:49.914788Z","submitted_at":"2026-07-30T01:03:59Z","title":"Training Skills Like Parameters via Self-Supervised Semantic Diffusion","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-01T05:47:43.460289Z"},"links":{"cited_paper":"/paper/2310.01798","citing_paper":"/paper/2607.27557"},"observation_digest":"sha256:ed2f83094c0c2464f094f634e119d73f8fd468c74debb79f608b126544aac1d9","observation_id":"ac332899-f10e-4518-9653-2f19062b968c","resolution":{"observed_at":"2026-08-01T05:47:43.460289Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.23904","last_updated":"2026-05-25T17:58:16Z","snapshot_observed_at":"2026-08-05T06:54:08.846880Z","submitted_at":"2026-05-22T17:59:50Z","title":"SkillOpt: Executive Strategy for Self-Evolving Agent Skills","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.23904","snapshot_observed_at":"2026-08-01T05:47:43.539599Z","title":"Skillopt: Executive strategy for self-evolving agent skills, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.27557","last_updated":"2026-07-30T01:03:59Z","snapshot_observed_at":"2026-08-03T07:55:49.914788Z","submitted_at":"2026-07-30T01:03:59Z","title":"Training Skills Like Parameters via Self-Supervised Semantic Diffusion","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-01T05:47:43.539599Z"},"links":{"cited_paper":"/paper/2605.23904","citing_paper":"/paper/2607.27557"},"observation_digest":"sha256:a7bc516dddc3a502dcb87ac461897aa9884f52fca84b92097ebd543f1eb9d956","observation_id":"d905212c-57ff-4383-a5df-3ca809bde45c","resolution":{"observed_at":"2026-08-01T05:47:43.539599Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2607.03451","last_updated":"2026-07-03T16:07:06Z","snapshot_observed_at":"2026-08-01T04:10:19.400296Z","submitted_at":"2026-07-03T16:07:06Z","title":"SkillOpt-Lite: Better and Faster Agent Self-evolution via One Line of Vibe","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2607.03451","snapshot_observed_at":"2026-08-01T05:47:43.612073Z","title":"Skillopt-lite: Better and faster agent self-evolution via one line of vibe, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.27557","last_updated":"2026-07-30T01:03:59Z","snapshot_observed_at":"2026-08-03T07:55:49.914788Z","submitted_at":"2026-07-30T01:03:59Z","title":"Training Skills Like Parameters via Self-Supervised Semantic Diffusion","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-01T05:47:43.612073Z"},"links":{"cited_paper":"/paper/2607.03451","citing_paper":"/paper/2607.27557"},"observation_digest":"sha256:2d32892b1b5c38052c29e29ed47fbda45f55fba5510e84511b55951f7df7f1fc","observation_id":"45c2a121-8273-49be-97ff-23e13fabe9ba","resolution":{"observed_at":"2026-08-01T05:47:43.612073Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2209.14958","last_updated":"2022-09-29T17:26:22Z","snapshot_observed_at":"2026-07-06T13:57:54.539656Z","submitted_at":"2022-09-29T17:26:22Z","title":"Co-Writing Screenplays and Theatre Scripts with Language Models: An Evaluation by Industry Professionals","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.14958","snapshot_observed_at":"2026-08-01T05:47:43.662594Z","title":"Mathewson, Jaylen Pittman, and Richard Evans","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.27557","last_updated":"2026-07-30T01:03:59Z","snapshot_observed_at":"2026-08-03T07:55:49.914788Z","submitted_at":"2026-07-30T01:03:59Z","title":"Training Skills Like Parameters via Self-Supervised Semantic Diffusion","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-01T05:47:43.662594Z"},"links":{"cited_paper":"/paper/2209.14958","citing_paper":"/paper/2607.27557"},"observation_digest":"sha256:f96e8c90cb0774c09f90341e595f7026f93840a4f85bfa03cc4a6b4985f7557b","observation_id":"799142c5-a795-4ce6-a83e-43f3d7f34067","resolution":{"observed_at":"2026-08-01T05:47:43.662594Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2510.05188","last_updated":"2026-04-21T02:06:45Z","snapshot_observed_at":"2026-08-06T06:26:51.081241Z","submitted_at":"2025-10-06T05:20:37Z","title":"Plug-and-Play Dramaturge: A Divide-and-Conquer Approach for Iterative Narrative Script Refinement via Collaborative LLM Agents","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2510.05188","snapshot_observed_at":"2026-08-01T05:47:43.757829Z","title":"Plug-and- play dramaturge: A divide-and-conquer approach for iterative narrative script refinement via collaborative llm agents, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.27557","last_updated":"2026-07-30T01:03:59Z","snapshot_observed_at":"2026-08-03T07:55:49.914788Z","submitted_at":"2026-07-30T01:03:59Z","title":"Training Skills Like Parameters via Self-Supervised Semantic Diffusion","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-01T05:47:43.757829Z"},"links":{"cited_paper":"/paper/2510.05188","citing_paper":"/paper/2607.27557"},"observation_digest":"sha256:2792acd5286a3e692da4bcc43023ffbd717f1b3bbd0f7596e50fd71715d5e56c","observation_id":"47deae94-8a89-4b14-97b2-8e7734a2e448","resolution":{"observed_at":"2026-08-01T05:47:43.757829Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.05685","last_updated":"2023-12-24T02:01:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-06-09T05:55:52Z","title":"Judging LLM-as-a-Judge with MT-Bench and Chatbot Arena","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.05685","snapshot_observed_at":"2026-08-01T05:47:43.830030Z","title":"Xing, Hao Zhang, Joseph E","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.27557","last_updated":"2026-07-30T01:03:59Z","snapshot_observed_at":"2026-08-03T07:55:49.914788Z","submitted_at":"2026-07-30T01:03:59Z","title":"Training Skills Like Parameters via Self-Supervised Semantic Diffusion","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-01T05:47:43.830030Z"},"links":{"cited_paper":"/paper/2306.05685","citing_paper":"/paper/2607.27557"},"observation_digest":"sha256:01688cee654764aad92b318ff9d40778488cd9fb2b7ff0cd24832bad5a1afa40","observation_id":"66113838-c8da-4370-b23a-7ff1cbe16485","resolution":{"observed_at":"2026-08-01T05:47:43.830030Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2105.08920","last_updated":"2021-05-19T04:45:07Z","snapshot_observed_at":"2026-08-01T15:30:43.014160Z","submitted_at":"2021-05-19T04:45:07Z","title":"OpenMEVA: A Benchmark for Evaluating Open-ended Story Generation Metrics","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2105.08920","snapshot_observed_at":"2026-08-01T05:47:43.909849Z","title":"Openmeva: A benchmark for evaluating open-ended story generation metrics, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.27557","last_updated":"2026-07-30T01:03:59Z","snapshot_observed_at":"2026-08-03T07:55:49.914788Z","submitted_at":"2026-07-30T01:03:59Z","title":"Training Skills Like Parameters via Self-Supervised Semantic Diffusion","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-01T05:47:43.909849Z"},"links":{"cited_paper":"/paper/2105.08920","citing_paper":"/paper/2607.27557"},"observation_digest":"sha256:616aea84a6432f543f10bf69bcb2c49375b8238ef986d023466d1b7228f62216","observation_id":"bbf4c88c-2da1-4346-a9cf-6d7ba1266e6d","resolution":{"observed_at":"2026-08-01T05:47:43.909849Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.03442","last_updated":"2023-08-06T00:21:19Z","snapshot_observed_at":"2026-07-06T15:13:13.695535Z","submitted_at":"2023-04-07T01:55:19Z","title":"Generative Agents: Interactive Simulacra of Human Behavior","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.03442","snapshot_observed_at":"2026-08-01T05:47:43.970224Z","title":"O’Brien, Carrie J","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.27557","last_updated":"2026-07-30T01:03:59Z","snapshot_observed_at":"2026-08-03T07:55:49.914788Z","submitted_at":"2026-07-30T01:03:59Z","title":"Training Skills Like Parameters via Self-Supervised Semantic Diffusion","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-01T05:47:43.970224Z"},"links":{"cited_paper":"/paper/2304.03442","citing_paper":"/paper/2607.27557"},"observation_digest":"sha256:612d991183d4bf1fb6d4db6e44f9325550bc31ce31fc64e363934df173e0544a","observation_id":"b3a26d0c-9ff1-49b7-95b8-403219fd2987","resolution":{"observed_at":"2026-08-01T05:47:43.970224Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.11366","last_updated":"2023-10-10T05:21:45Z","snapshot_observed_at":"2026-07-06T15:05:53.556198Z","submitted_at":"2023-03-20T18:08:50Z","title":"Reflexion: Language Agents with Verbal Reinforcement Learning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.11366","snapshot_observed_at":"2026-08-01T05:47:44.024341Z","title":"Reflexion: Language agents with verbal reinforcement learning, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.27557","last_updated":"2026-07-30T01:03:59Z","snapshot_observed_at":"2026-08-03T07:55:49.914788Z","submitted_at":"2026-07-30T01:03:59Z","title":"Training Skills Like Parameters via Self-Supervised Semantic Diffusion","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-01T05:47:44.024341Z"},"links":{"cited_paper":"/paper/2303.11366","citing_paper":"/paper/2607.27557"},"observation_digest":"sha256:de5a9540dc12bf77287b4e7b92b52ecb311c4e5a418dd17dec56136eaabddc4d","observation_id":"6ee7feaa-f4c6-4932-a1ab-c8443c3e7dfc","resolution":{"observed_at":"2026-08-01T05:47:44.024341Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.27760","last_updated":"2026-05-26T23:18:43Z","snapshot_observed_at":"2026-07-06T23:37:27.309837Z","submitted_at":"2026-05-26T23:18:43Z","title":"SkillGrad: Optimizing Agent Skills Like Gradient Descent","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.27760","snapshot_observed_at":"2026-08-01T05:47:44.077053Z","title":"Skillgrad: Optimizing agent skills like gradient descent, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.27557","last_updated":"2026-07-30T01:03:59Z","snapshot_observed_at":"2026-08-03T07:55:49.914788Z","submitted_at":"2026-07-30T01:03:59Z","title":"Training Skills Like Parameters via Self-Supervised Semantic Diffusion","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-01T05:47:44.077053Z"},"links":{"cited_paper":"/paper/2605.27760","citing_paper":"/paper/2607.27557"},"observation_digest":"sha256:3195531c71c144a729a004d14c53ae162f3b720ee59c0d85842fdbf179c1339a","observation_id":"3d2b5ec0-1170-4a24-9434-9d7b1d63945e","resolution":{"observed_at":"2026-08-01T05:47:44.077053Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T05:47:44.136918Z","title":"The Old Harlan Place — Greenhouse For Sale","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.27557","last_updated":"2026-07-30T01:03:59Z","snapshot_observed_at":"2026-08-03T07:55:49.914788Z","submitted_at":"2026-07-30T01:03:59Z","title":"Training Skills Like Parameters via Self-Supervised Semantic Diffusion","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-01T05:47:44.136918Z"},"links":{"citing_paper":"/paper/2607.27557"},"observation_digest":"sha256:f2824b66dad5566ac7e2a1e51e10dbc1f630c5ca32fa6ae2af3226d19dab681d","observation_id":"3e553b14-febb-4efc-ba75-251d421371e7","resolution":{"observed_at":"2026-08-01T05:47:44.136918Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T05:47:44.231622Z","title":"This is the only episode where that card was missed","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.27557","last_updated":"2026-07-30T01:03:59Z","snapshot_observed_at":"2026-08-03T07:55:49.914788Z","submitted_at":"2026-07-30T01:03:59Z","title":"Training Skills Like Parameters via Self-Supervised Semantic Diffusion","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-01T05:47:44.231622Z"},"links":{"citing_paper":"/paper/2607.27557"},"observation_digest":"sha256:78975bdfce0252dffba41cff80a8950fca940ec800b026151d78fe963ee187ae","observation_id":"4de5828c-cea6-45eb-89dd-87a1cf45b667","resolution":{"observed_at":"2026-08-01T05:47:44.231622Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.10760","last_updated":"2022-10-19T17:56:10Z","snapshot_observed_at":"2026-07-06T14:07:50.468967Z","submitted_at":"2022-10-19T17:56:10Z","title":"Scaling Laws for Reward Model Overoptimization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.10760","snapshot_observed_at":"2026-08-01T05:47:42.288383Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.27557","last_updated":"2026-07-30T01:03:59Z","snapshot_observed_at":"2026-08-03T07:55:49.914788Z","submitted_at":"2026-07-30T01:03:59Z","title":"Training Skills Like Parameters via Self-Supervised Semantic Diffusion","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-01T05:47:42.288383Z"},"links":{"cited_paper":"/paper/2210.10760","citing_paper":"/paper/2607.27557"},"observation_digest":"sha256:f15c6f12bcfd77a1a7d09a07472364455e1dc05d6b11a81b062f40f6cd3289d7","observation_id":"44d86dfc-7290-4dcd-906d-dd2fe50de3c2","resolution":{"observed_at":"2026-08-01T05:47:42.288383Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.27557","last_updated":"2026-07-30T01:03:59Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-03T07:55:49.914788Z","submitted_at":"2026-07-30T01:03:59Z","title":"Training Skills Like Parameters via Self-Supervised Semantic Diffusion"},"reference_resolution":{"displayed":36,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":36,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":36},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"thesis":"As of 6 August 2026, this Paper Citation Record lists 36 of 36 outbound references and 0 inbound Pith citation observations for arXiv:2607.27557."}