{"as_of":"2026-08-11T04:16:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:3527d93686d74cb1007a467a37ae7527e7fddfc33bb3773830710c30c3458823","coverage":[{"denominator":66,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":66,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-10T15:27:03.159262Z","state":"measured"},{"denominator":66,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":66,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.07068/citation-record","integrity":"/paper/2608.07068/integrity","json":"/paper/2608.07068/citation-record.json","paper":"/paper/2608.07068"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:27:02.546815Z","title":"2024 , journal =","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.07068","last_updated":"2026-08-07T10:18:31Z","snapshot_observed_at":"2026-08-11T04:11:34.017250Z","submitted_at":"2026-08-07T10:18:31Z","title":"MemOPD: On-Policy Distillation through Memory State Alignment for Long-Horizon Agents","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-10T15:27:02.546815Z"},"links":{"citing_paper":"/paper/2608.07068"},"observation_digest":"sha256:6bfd57d55a99b10930a3d1396a8a5ea2a6b1b51d9088664de17fa89c0de11984","observation_id":"455b6738-6ef9-474b-99e9-ea36e1c183e9","resolution":{"observed_at":"2026-08-10T15:27:02.546815Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:27:04.716124Z","title":"2023 , booktitle =","venue":null,"work_id":"44d13066-ec41-4ac1-abe5-7f5a7817ed09","year":2023},"citing_paper":{"arxiv_id":"2608.07068","last_updated":"2026-08-07T10:18:31Z","snapshot_observed_at":"2026-08-11T04:11:34.017250Z","submitted_at":"2026-08-07T10:18:31Z","title":"MemOPD: On-Policy Distillation through Memory State Alignment for Long-Horizon Agents","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-10T15:27:02.564209Z"},"links":{"citing_paper":"/paper/2608.07068"},"observation_digest":"sha256:39418f2fa5dd88e775cfc8dc3aa2a0409dd57f4563cbb19a9047c99b2b3b5a38","observation_id":"0abb4361-efe1-46cf-b5ad-0552bd94c96e","resolution":{"observed_at":"2026-08-10T15:27:04.721471Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:27:04.688168Z","title":"2023 , booktitle =","venue":null,"work_id":"5a02b4ee-2bd8-491c-bb7d-bdd54b51b265","year":2023},"citing_paper":{"arxiv_id":"2608.07068","last_updated":"2026-08-07T10:18:31Z","snapshot_observed_at":"2026-08-11T04:11:34.017250Z","submitted_at":"2026-08-07T10:18:31Z","title":"MemOPD: On-Policy Distillation through Memory State Alignment for Long-Horizon Agents","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-10T15:27:02.576330Z"},"links":{"citing_paper":"/paper/2608.07068"},"observation_digest":"sha256:fbb39cf87f02f5746091882292f2092484ee8e8f5b6d2523dfb94eef91dc22ae","observation_id":"f13d4a9b-23a3-4578-bde9-c09b85266190","resolution":{"observed_at":"2026-08-10T15:27:04.695715Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:27:04.668687Z","title":"2022 , booktitle =","venue":null,"work_id":"a396093d-e3a8-4d5e-8793-58001d6f8333","year":2022},"citing_paper":{"arxiv_id":"2608.07068","last_updated":"2026-08-07T10:18:31Z","snapshot_observed_at":"2026-08-11T04:11:34.017250Z","submitted_at":"2026-08-07T10:18:31Z","title":"MemOPD: On-Policy Distillation through Memory State Alignment for Long-Horizon Agents","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-10T15:27:02.582963Z"},"links":{"citing_paper":"/paper/2608.07068"},"observation_digest":"sha256:ad496e6bfd4ffe34695323c0a80295a2be8ad424a19d079a74af35b76e83c4a2","observation_id":"a4505395-1095-4e43-acbe-d2b012487241","resolution":{"observed_at":"2026-08-10T15:27:04.673866Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:27:04.651804Z","title":"2023 , booktitle =","venue":null,"work_id":"9a413d14-7325-41e0-b370-185f559e0d14","year":2023},"citing_paper":{"arxiv_id":"2608.07068","last_updated":"2026-08-07T10:18:31Z","snapshot_observed_at":"2026-08-11T04:11:34.017250Z","submitted_at":"2026-08-07T10:18:31Z","title":"MemOPD: On-Policy Distillation through Memory State Alignment for Long-Horizon Agents","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-10T15:27:02.590920Z"},"links":{"citing_paper":"/paper/2608.07068"},"observation_digest":"sha256:4ba3316ae0a56e4a2929d0bd84f31081994722c58a3c123d0c51ed210afb4414","observation_id":"70cff33b-14d8-4a04-a565-0c1248209580","resolution":{"observed_at":"2026-08-10T15:27:04.657063Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:27:04.633268Z","title":"2024 , booktitle =","venue":null,"work_id":"ae6a72b9-29f7-441b-9761-490b3e11383c","year":2024},"citing_paper":{"arxiv_id":"2608.07068","last_updated":"2026-08-07T10:18:31Z","snapshot_observed_at":"2026-08-11T04:11:34.017250Z","submitted_at":"2026-08-07T10:18:31Z","title":"MemOPD: On-Policy Distillation through Memory State Alignment for Long-Horizon Agents","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-10T15:27:02.597356Z"},"links":{"citing_paper":"/paper/2608.07068"},"observation_digest":"sha256:997013d3955bd54e00fe8ceaa022cb19502670ed1846b26aeba938c837831a43","observation_id":"1f5e1797-024c-4d65-806e-a966deb5e865","resolution":{"observed_at":"2026-08-10T15:27:04.639211Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:27:04.612298Z","title":"2024 , booktitle =","venue":null,"work_id":"e656d15d-c520-4afa-bebf-639c0b83a70f","year":2024},"citing_paper":{"arxiv_id":"2608.07068","last_updated":"2026-08-07T10:18:31Z","snapshot_observed_at":"2026-08-11T04:11:34.017250Z","submitted_at":"2026-08-07T10:18:31Z","title":"MemOPD: On-Policy Distillation through Memory State Alignment for Long-Horizon Agents","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-10T15:27:02.605196Z"},"links":{"citing_paper":"/paper/2608.07068"},"observation_digest":"sha256:fc58b8682809d9c82838c55dfa86d13c2372e0f346e32ef749397bb159f5e8e4","observation_id":"45ebc4e1-7248-4698-8403-d8287b7ed10b","resolution":{"observed_at":"2026-08-10T15:27:04.618077Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:27:04.588577Z","title":"2024 , booktitle =","venue":null,"work_id":"bd879591-0a9a-4702-9e22-749596d36419","year":2024},"citing_paper":{"arxiv_id":"2608.07068","last_updated":"2026-08-07T10:18:31Z","snapshot_observed_at":"2026-08-11T04:11:34.017250Z","submitted_at":"2026-08-07T10:18:31Z","title":"MemOPD: On-Policy Distillation through Memory State Alignment for Long-Horizon Agents","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-10T15:27:02.613927Z"},"links":{"citing_paper":"/paper/2608.07068"},"observation_digest":"sha256:f3f30feab94bbe9fc826a1077f305f195584249f91b806669185d10f5b0d2fcc","observation_id":"873391c3-a8f0-47ae-bb56-761351afe39a","resolution":{"observed_at":"2026-08-10T15:27:04.596596Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:27:04.560520Z","title":"2024 , booktitle =","venue":null,"work_id":"59a5eb32-62d1-468b-91a8-17d9d6b99713","year":2024},"citing_paper":{"arxiv_id":"2608.07068","last_updated":"2026-08-07T10:18:31Z","snapshot_observed_at":"2026-08-11T04:11:34.017250Z","submitted_at":"2026-08-07T10:18:31Z","title":"MemOPD: On-Policy Distillation through Memory State Alignment for Long-Horizon Agents","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-10T15:27:02.763900Z"},"links":{"citing_paper":"/paper/2608.07068"},"observation_digest":"sha256:ea2dd4662cf4440cc4a46bc8021696574d545d434341420a4685a0e8e5c1a661","observation_id":"96982bcc-1f0c-42cb-861f-303e7e8a7dbe","resolution":{"observed_at":"2026-08-10T15:27:04.566135Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:27:04.540852Z","title":"2022 , eprint =","venue":null,"work_id":"923c7612-f880-42ae-bf0e-10d493dda0ee","year":2022},"citing_paper":{"arxiv_id":"2608.07068","last_updated":"2026-08-07T10:18:31Z","snapshot_observed_at":"2026-08-11T04:11:34.017250Z","submitted_at":"2026-08-07T10:18:31Z","title":"MemOPD: On-Policy Distillation through Memory State Alignment for Long-Horizon Agents","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-10T15:27:02.769634Z"},"links":{"citing_paper":"/paper/2608.07068"},"observation_digest":"sha256:2da1bf7c199714ab090ac14e58242a510e6b0dc27eb691c3cb6067733ab8e8ba","observation_id":"2b7513d8-ba27-4f9b-ac18-db2de7bc204f","resolution":{"observed_at":"2026-08-10T15:27:04.546896Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:27:04.519295Z","title":"2025 , eprint =","venue":null,"work_id":"90210f98-d6f4-4a9d-92cb-74a793ba58bd","year":2025},"citing_paper":{"arxiv_id":"2608.07068","last_updated":"2026-08-07T10:18:31Z","snapshot_observed_at":"2026-08-11T04:11:34.017250Z","submitted_at":"2026-08-07T10:18:31Z","title":"MemOPD: On-Policy Distillation through Memory State Alignment for Long-Horizon Agents","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-10T15:27:02.775875Z"},"links":{"citing_paper":"/paper/2608.07068"},"observation_digest":"sha256:bff3b9939cbfe2cdaa7c098fe9f368d4b8b9d4ba1e5daa1e2c7c9251394d37b3","observation_id":"a928de82-b576-4505-97ef-8b8065eb9bb9","resolution":{"observed_at":"2026-08-10T15:27:04.525647Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:27:04.500867Z","title":"2025 , eprint =","venue":null,"work_id":"07ba402b-a798-428f-ba35-98822b372739","year":2025},"citing_paper":{"arxiv_id":"2608.07068","last_updated":"2026-08-07T10:18:31Z","snapshot_observed_at":"2026-08-11T04:11:34.017250Z","submitted_at":"2026-08-07T10:18:31Z","title":"MemOPD: On-Policy Distillation through Memory State Alignment for Long-Horizon Agents","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-10T15:27:02.782245Z"},"links":{"citing_paper":"/paper/2608.07068"},"observation_digest":"sha256:fd7fd3aaff06354c259f0cc0b564b166acd15b87db892c08531d3c8bb799f5da","observation_id":"0c9707db-d0e4-4d69-9465-a9dd4268dbbc","resolution":{"observed_at":"2026-08-10T15:27:04.506651Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.19470","last_updated":"2025-09-23T03:45:42Z","snapshot_observed_at":"2026-08-10T03:47:52.773511Z","submitted_at":"2025-03-25T09:00:58Z","title":"ReSearch: Learning to Reason with Search for LLMs via Reinforcement Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.19470","snapshot_observed_at":"2026-08-10T15:27:02.788263Z","title":"2025 , doi =","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.07068","last_updated":"2026-08-07T10:18:31Z","snapshot_observed_at":"2026-08-11T04:11:34.017250Z","submitted_at":"2026-08-07T10:18:31Z","title":"MemOPD: On-Policy Distillation through Memory State Alignment for Long-Horizon Agents","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-10T15:27:02.788263Z"},"links":{"cited_paper":"/paper/2503.19470","citing_paper":"/paper/2608.07068"},"observation_digest":"sha256:20aee079ff7b65621fda8c553ac8d1f9be6e7e3453f8023ff23f445cd7cbd1b5","observation_id":"480125f4-3b24-4135-a0cd-188be5e978fd","resolution":{"observed_at":"2026-08-10T15:27:02.788263Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:27:04.479236Z","title":"2017 , booktitle =","venue":null,"work_id":"7f0687da-57cf-4767-bee8-cf03787b2b73","year":2017},"citing_paper":{"arxiv_id":"2608.07068","last_updated":"2026-08-07T10:18:31Z","snapshot_observed_at":"2026-08-11T04:11:34.017250Z","submitted_at":"2026-08-07T10:18:31Z","title":"MemOPD: On-Policy Distillation through Memory State Alignment for Long-Horizon Agents","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-10T15:27:02.795561Z"},"links":{"citing_paper":"/paper/2608.07068"},"observation_digest":"sha256:ef757aa8da8b6658e29a2adabf4855857df05a1092d77c13006cad3406fb9927","observation_id":"b518b6be-4309-4428-84ee-2786a09ec79e","resolution":{"observed_at":"2026-08-10T15:27:04.484658Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:27:02.802209Z","title":"2020 , eprint =","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2608.07068","last_updated":"2026-08-07T10:18:31Z","snapshot_observed_at":"2026-08-11T04:11:34.017250Z","submitted_at":"2026-08-07T10:18:31Z","title":"MemOPD: On-Policy Distillation through Memory State Alignment for Long-Horizon Agents","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-10T15:27:02.802209Z"},"links":{"citing_paper":"/paper/2608.07068"},"observation_digest":"sha256:ce22bfcaa1062e789d2aece119dd5b80b546370fb6f20e4361590f0f7aef1e8b","observation_id":"857485bd-edc9-4c52-9aba-fd86e8bc2f1d","resolution":{"observed_at":"2026-08-10T15:27:02.802209Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:27:02.808845Z","title":"2024 , journal =","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.07068","last_updated":"2026-08-07T10:18:31Z","snapshot_observed_at":"2026-08-11T04:11:34.017250Z","submitted_at":"2026-08-07T10:18:31Z","title":"MemOPD: On-Policy Distillation through Memory State Alignment for Long-Horizon Agents","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-10T15:27:02.808845Z"},"links":{"citing_paper":"/paper/2608.07068"},"observation_digest":"sha256:e138c3355be795bb1766e9861b4e802fb4b5b13dd5422321b1bf824df0251edd","observation_id":"0b068964-4aaf-4c8a-974a-eaf0870c3a2b","resolution":{"observed_at":"2026-08-10T15:27:02.808845Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:27:04.446258Z","title":"2023 , booktitle =","venue":null,"work_id":"4f5a6728-58f2-4144-86a9-fa6307823d53","year":2023},"citing_paper":{"arxiv_id":"2608.07068","last_updated":"2026-08-07T10:18:31Z","snapshot_observed_at":"2026-08-11T04:11:34.017250Z","submitted_at":"2026-08-07T10:18:31Z","title":"MemOPD: On-Policy Distillation through Memory State Alignment for Long-Horizon Agents","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-10T15:27:02.817512Z"},"links":{"citing_paper":"/paper/2608.07068"},"observation_digest":"sha256:cc109e7b649d65377600037a37159083aac897a909b8526784ad37389fe48051","observation_id":"853eca14-689b-45c3-bd20-626cb0263686","resolution":{"observed_at":"2026-08-10T15:27:04.452615Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:27:04.429283Z","title":"2025 , booktitle =","venue":null,"work_id":"e7468ee3-db8a-4f2e-bd03-74f21b523c44","year":2025},"citing_paper":{"arxiv_id":"2608.07068","last_updated":"2026-08-07T10:18:31Z","snapshot_observed_at":"2026-08-11T04:11:34.017250Z","submitted_at":"2026-08-07T10:18:31Z","title":"MemOPD: On-Policy Distillation through Memory State Alignment for Long-Horizon Agents","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-10T15:27:02.823129Z"},"links":{"citing_paper":"/paper/2608.07068"},"observation_digest":"sha256:8b4f7470b94c650bedc527564fe318f4eaaa591e23a4ce7e630270291e187dec","observation_id":"cdeef7c9-36ce-4c34-895f-7505e8053fdc","resolution":{"observed_at":"2026-08-10T15:27:04.435032Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:27:04.410553Z","title":"2025 , booktitle =","venue":null,"work_id":"e63d4ce2-c844-48f1-ae04-f40e0fdef475","year":2025},"citing_paper":{"arxiv_id":"2608.07068","last_updated":"2026-08-07T10:18:31Z","snapshot_observed_at":"2026-08-11T04:11:34.017250Z","submitted_at":"2026-08-07T10:18:31Z","title":"MemOPD: On-Policy Distillation through Memory State Alignment for Long-Horizon Agents","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-10T15:27:02.829114Z"},"links":{"citing_paper":"/paper/2608.07068"},"observation_digest":"sha256:63fea76076472942157f060ad846714a9347e00dabcf59af3818332ed5b364cd","observation_id":"1d719ff2-dd7c-4048-a9e3-41e5444348c4","resolution":{"observed_at":"2026-08-10T15:27:04.415755Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:27:04.384566Z","title":"2025 , booktitle =","venue":null,"work_id":"705f3f01-1969-48bc-aa53-ad5d7c79e30e","year":2025},"citing_paper":{"arxiv_id":"2608.07068","last_updated":"2026-08-07T10:18:31Z","snapshot_observed_at":"2026-08-11T04:11:34.017250Z","submitted_at":"2026-08-07T10:18:31Z","title":"MemOPD: On-Policy Distillation through Memory State Alignment for Long-Horizon Agents","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-10T15:27:02.836339Z"},"links":{"citing_paper":"/paper/2608.07068"},"observation_digest":"sha256:41421ea2d89cbc052fed255a3105c92d753de7794e581b03e197d8b8cd8c6550","observation_id":"b38e8396-3387-4c4e-bebb-b7e31d1a51f6","resolution":{"observed_at":"2026-08-10T15:27:04.391589Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:27:04.355316Z","title":"2020 , booktitle =","venue":null,"work_id":"513cfd41-e55f-4a74-bf68-f95a831c1121","year":2020},"citing_paper":{"arxiv_id":"2608.07068","last_updated":"2026-08-07T10:18:31Z","snapshot_observed_at":"2026-08-11T04:11:34.017250Z","submitted_at":"2026-08-07T10:18:31Z","title":"MemOPD: On-Policy Distillation through Memory State Alignment for Long-Horizon Agents","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-10T15:27:02.843933Z"},"links":{"citing_paper":"/paper/2608.07068"},"observation_digest":"sha256:05be6e6a4670458ba872dcb2a7f8c4569fea216dc8b83b1b2d8f98b3eeeef1ff","observation_id":"0a67c8b8-6960-4da5-a3d9-9566a850a489","resolution":{"observed_at":"2026-08-10T15:27:04.365844Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:27:04.333273Z","title":"2020 , booktitle =","venue":null,"work_id":"de830d1a-1fce-4506-be4e-bf635032c9ff","year":2020},"citing_paper":{"arxiv_id":"2608.07068","last_updated":"2026-08-07T10:18:31Z","snapshot_observed_at":"2026-08-11T04:11:34.017250Z","submitted_at":"2026-08-07T10:18:31Z","title":"MemOPD: On-Policy Distillation through Memory State Alignment for Long-Horizon Agents","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-10T15:27:02.849621Z"},"links":{"citing_paper":"/paper/2608.07068"},"observation_digest":"sha256:c3102a2164ada10f139b39f71a44b86533688601bfc026b8d78caec44ad6a369","observation_id":"4d576344-e73a-428b-8311-0928715da227","resolution":{"observed_at":"2026-08-10T15:27:04.339213Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:27:04.314873Z","title":"2022 , booktitle =","venue":null,"work_id":"460c24f3-4fde-41fd-90f8-30fb141820a4","year":2022},"citing_paper":{"arxiv_id":"2608.07068","last_updated":"2026-08-07T10:18:31Z","snapshot_observed_at":"2026-08-11T04:11:34.017250Z","submitted_at":"2026-08-07T10:18:31Z","title":"MemOPD: On-Policy Distillation through Memory State Alignment for Long-Horizon Agents","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-10T15:27:02.855671Z"},"links":{"citing_paper":"/paper/2608.07068"},"observation_digest":"sha256:0cde5e30faba873a8130e4c55719bc5a7d6fbe608b902d62516f6f16a25650a0","observation_id":"c70c19bd-c958-4a3d-bb73-95db1a076111","resolution":{"observed_at":"2026-08-10T15:27:04.320789Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.10250","last_updated":"2023-05-21T06:20:28Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-05-17T14:40:29Z","title":"MemoryBank: Enhancing Large Language Models with Long-Term Memory","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.10250","snapshot_observed_at":"2026-08-10T15:27:02.862201Z","title":"2023 , doi =","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.07068","last_updated":"2026-08-07T10:18:31Z","snapshot_observed_at":"2026-08-11T04:11:34.017250Z","submitted_at":"2026-08-07T10:18:31Z","title":"MemOPD: On-Policy Distillation through Memory State Alignment for Long-Horizon Agents","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-10T15:27:02.862201Z"},"links":{"cited_paper":"/paper/2305.10250","citing_paper":"/paper/2608.07068"},"observation_digest":"sha256:fd4f52b049177c20165403dbc8870ceff2d954b54022c839d94166feb1d97a7e","observation_id":"e7c85042-abb7-4347-aad2-3bfbda51bae5","resolution":{"observed_at":"2026-08-10T15:27:02.862201Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08560","last_updated":"2024-02-12T18:59:46Z","snapshot_observed_at":"2026-08-09T03:13:16.831626Z","submitted_at":"2023-10-12T17:51:32Z","title":"MemGPT: Towards LLMs as Operating Systems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.08560","snapshot_observed_at":"2026-08-10T15:27:02.869014Z","title":"2024 , doi =","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.07068","last_updated":"2026-08-07T10:18:31Z","snapshot_observed_at":"2026-08-11T04:11:34.017250Z","submitted_at":"2026-08-07T10:18:31Z","title":"MemOPD: On-Policy Distillation through Memory State Alignment for Long-Horizon Agents","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-10T15:27:02.869014Z"},"links":{"cited_paper":"/paper/2310.08560","citing_paper":"/paper/2608.07068"},"observation_digest":"sha256:e3caebead6c1696c02914bf883eabf628551f0a64b6e23e75dcf32e7ee738d1c","observation_id":"1a887771-c3a8-4672-a380-dae2b0924863","resolution":{"observed_at":"2026-08-10T15:27:02.869014Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.19413","last_updated":"2025-04-28T01:46:35Z","snapshot_observed_at":"2026-08-02T07:32:11.339534Z","submitted_at":"2025-04-28T01:46:35Z","title":"Mem0: Building Production-Ready AI Agents with Scalable Long-Term Memory","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.19413","snapshot_observed_at":"2026-08-10T15:27:02.877464Z","title":"2025 , doi =","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.07068","last_updated":"2026-08-07T10:18:31Z","snapshot_observed_at":"2026-08-11T04:11:34.017250Z","submitted_at":"2026-08-07T10:18:31Z","title":"MemOPD: On-Policy Distillation through Memory State Alignment for Long-Horizon Agents","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-10T15:27:02.877464Z"},"links":{"cited_paper":"/paper/2504.19413","citing_paper":"/paper/2608.07068"},"observation_digest":"sha256:524c359d17ba0806e14025b5abcd9f1e3ad5924a83a624d4ed912a3b1bd60ee0","observation_id":"4c5247c1-f557-45b6-b6d1-54a814de5c68","resolution":{"observed_at":"2026-08-10T15:27:02.877464Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.12110","last_updated":"2025-10-08T01:46:37Z","snapshot_observed_at":"2026-08-03T02:27:06.991396Z","submitted_at":"2025-02-17T18:36:14Z","title":"A-MEM: Agentic Memory for LLM Agents","version":11},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.12110","snapshot_observed_at":"2026-08-10T15:27:02.890482Z","title":"2025 , booktitle =","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.07068","last_updated":"2026-08-07T10:18:31Z","snapshot_observed_at":"2026-08-11T04:11:34.017250Z","submitted_at":"2026-08-07T10:18:31Z","title":"MemOPD: On-Policy Distillation through Memory State Alignment for Long-Horizon Agents","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-10T15:27:02.890482Z"},"links":{"cited_paper":"/paper/2502.12110","citing_paper":"/paper/2608.07068"},"observation_digest":"sha256:226302c844a0e04a3b4e79e47e2df31a94b9009a5870c64bfdf3b82054950e11","observation_id":"2d6e29ba-9c35-4fd1-972b-8f954497babd","resolution":{"observed_at":"2026-08-10T15:27:02.890482Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:27:04.292686Z","title":"2024 , booktitle =","venue":null,"work_id":"a02fe830-9746-451c-aa50-c47c23eeca7b","year":2024},"citing_paper":{"arxiv_id":"2608.07068","last_updated":"2026-08-07T10:18:31Z","snapshot_observed_at":"2026-08-11T04:11:34.017250Z","submitted_at":"2026-08-07T10:18:31Z","title":"MemOPD: On-Policy Distillation through Memory State Alignment for Long-Horizon Agents","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-10T15:27:02.898573Z"},"links":{"citing_paper":"/paper/2608.07068"},"observation_digest":"sha256:313bcec69c3fb73426a31a54b343126213c234f503c9c780f3c26c9a2d4d8bfb","observation_id":"d14e6074-3da5-4849-9c36-11d616848838","resolution":{"observed_at":"2026-08-10T15:27:04.298895Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:27:04.265510Z","title":"2023 , booktitle =","venue":null,"work_id":"73e91a88-044a-4b1e-9f48-4ebf48e0797d","year":2023},"citing_paper":{"arxiv_id":"2608.07068","last_updated":"2026-08-07T10:18:31Z","snapshot_observed_at":"2026-08-11T04:11:34.017250Z","submitted_at":"2026-08-07T10:18:31Z","title":"MemOPD: On-Policy Distillation through Memory State Alignment for Long-Horizon Agents","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-10T15:27:02.909411Z"},"links":{"citing_paper":"/paper/2608.07068"},"observation_digest":"sha256:1b4ff4658ad4f5a9ff53647af90334905f389eddd4a39a52cb5f22ea4f2d8ad7","observation_id":"a46602d0-e1bf-4530-8a47-8b83e5c88dc8","resolution":{"observed_at":"2026-08-10T15:27:04.272600Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:27:02.914748Z","title":"2024 , booktitle =","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.07068","last_updated":"2026-08-07T10:18:31Z","snapshot_observed_at":"2026-08-11T04:11:34.017250Z","submitted_at":"2026-08-07T10:18:31Z","title":"MemOPD: On-Policy Distillation through Memory State Alignment for Long-Horizon Agents","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-10T15:27:02.914748Z"},"links":{"citing_paper":"/paper/2608.07068"},"observation_digest":"sha256:984aad2288739face16d74503de4d59d0765853b60bb8d0bbe9c2cdcceb8fafd","observation_id":"ea23424f-25b2-4855-a42d-17ab88a1917b","resolution":{"observed_at":"2026-08-10T15:27:02.914748Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.15841","last_updated":"2025-07-17T08:53:48Z","snapshot_observed_at":"2026-08-04T10:58:41.179508Z","submitted_at":"2025-06-18T19:44:46Z","title":"MEM1: Learning to Synergize Memory and Reasoning for Efficient Long-Horizon Agents","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.15841","snapshot_observed_at":"2026-08-10T15:27:02.922284Z","title":"2025 , doi =","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.07068","last_updated":"2026-08-07T10:18:31Z","snapshot_observed_at":"2026-08-11T04:11:34.017250Z","submitted_at":"2026-08-07T10:18:31Z","title":"MemOPD: On-Policy Distillation through Memory State Alignment for Long-Horizon Agents","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-10T15:27:02.922284Z"},"links":{"cited_paper":"/paper/2506.15841","citing_paper":"/paper/2608.07068"},"observation_digest":"sha256:5bd1d6bc6f12194193ce6d389f2908ec8bc1c3e54fb4d094401b9b85909af739","observation_id":"93e39aca-0f0e-4f35-ae72-7bcf3e0f8eee","resolution":{"observed_at":"2026-08-10T15:27:02.922284Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:27:02.929206Z","title":"2015 , eprint =","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2608.07068","last_updated":"2026-08-07T10:18:31Z","snapshot_observed_at":"2026-08-11T04:11:34.017250Z","submitted_at":"2026-08-07T10:18:31Z","title":"MemOPD: On-Policy Distillation through Memory State Alignment for Long-Horizon Agents","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-10T15:27:02.929206Z"},"links":{"citing_paper":"/paper/2608.07068"},"observation_digest":"sha256:5fe1fd19363e71be2c0193fe709f8f744ee8e7c50d80952273ad2154e32cb9ca","observation_id":"d39107a6-a2c9-4b40-869c-7c6d1040f5dc","resolution":{"observed_at":"2026-08-10T15:27:02.929206Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.13649","last_updated":"2024-01-17T03:23:23Z","snapshot_observed_at":"2026-08-06T11:19:43.438106Z","submitted_at":"2023-06-23T17:56:26Z","title":"On-Policy Distillation of Language Models: Learning from Self-Generated Mistakes","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.13649","snapshot_observed_at":"2026-08-10T15:27:02.936313Z","title":"2024 , booktitle =","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.07068","last_updated":"2026-08-07T10:18:31Z","snapshot_observed_at":"2026-08-11T04:11:34.017250Z","submitted_at":"2026-08-07T10:18:31Z","title":"MemOPD: On-Policy Distillation through Memory State Alignment for Long-Horizon Agents","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-10T15:27:02.936313Z"},"links":{"cited_paper":"/paper/2306.13649","citing_paper":"/paper/2608.07068"},"observation_digest":"sha256:edc7cb0bf6555c19f6a552545385685bdeebde0c72ff45415e9ab7a287636a47","observation_id":"7961b108-5526-4762-abf4-973144734f3b","resolution":{"observed_at":"2026-08-10T15:27:02.936313Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1506.02438","last_updated":"2018-10-20T18:55:07Z","snapshot_observed_at":"2026-08-09T23:04:15.431743Z","submitted_at":"2015-06-08T11:12:48Z","title":"High-Dimensional Continuous Control Using Generalized Advantage Estimation","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1506.02438","snapshot_observed_at":"2026-08-10T15:27:02.942832Z","title":"2016 , booktitle =","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2608.07068","last_updated":"2026-08-07T10:18:31Z","snapshot_observed_at":"2026-08-11T04:11:34.017250Z","submitted_at":"2026-08-07T10:18:31Z","title":"MemOPD: On-Policy Distillation through Memory State Alignment for Long-Horizon Agents","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-10T15:27:02.942832Z"},"links":{"cited_paper":"/paper/1506.02438","citing_paper":"/paper/2608.07068"},"observation_digest":"sha256:09fe8d103bb04d73b56575630ccb52659871c65b557ef8efb23e809cf6990317","observation_id":"0abb995a-a53b-4c31-a726-08241a72f75e","resolution":{"observed_at":"2026-08-10T15:27:02.942832Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:27:02.949037Z","title":"2017 , eprint =","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2608.07068","last_updated":"2026-08-07T10:18:31Z","snapshot_observed_at":"2026-08-11T04:11:34.017250Z","submitted_at":"2026-08-07T10:18:31Z","title":"MemOPD: On-Policy Distillation through Memory State Alignment for Long-Horizon Agents","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-10T15:27:02.949037Z"},"links":{"citing_paper":"/paper/2608.07068"},"observation_digest":"sha256:8c7572032ba7fb04d9f92ba1f5fb96fb821a56601605bb7f525760a5846dff26","observation_id":"f7fafce9-d68c-41bd-8011-a0f365dfb80b","resolution":{"observed_at":"2026-08-10T15:27:02.949037Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:27:04.224783Z","title":"2018 , booktitle =","venue":null,"work_id":"c2e0d126-60d4-4b9d-8784-00000e1ec5e8","year":2018},"citing_paper":{"arxiv_id":"2608.07068","last_updated":"2026-08-07T10:18:31Z","snapshot_observed_at":"2026-08-11T04:11:34.017250Z","submitted_at":"2026-08-07T10:18:31Z","title":"MemOPD: On-Policy Distillation through Memory State Alignment for Long-Horizon Agents","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-10T15:27:02.955004Z"},"links":{"citing_paper":"/paper/2608.07068"},"observation_digest":"sha256:ddf1a347d527fc32f7baf2b713a1d71351eb79dcf414bec8076220aa619c2c51","observation_id":"5a2f15c4-f24e-48d9-9c12-b43636033891","resolution":{"observed_at":"2026-08-10T15:27:04.229904Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:27:02.962552Z","title":"2019 , journal =","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2608.07068","last_updated":"2026-08-07T10:18:31Z","snapshot_observed_at":"2026-08-11T04:11:34.017250Z","submitted_at":"2026-08-07T10:18:31Z","title":"MemOPD: On-Policy Distillation through Memory State Alignment for Long-Horizon Agents","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-10T15:27:02.962552Z"},"links":{"citing_paper":"/paper/2608.07068"},"observation_digest":"sha256:9721f0f00ef5488070b812152bd4fbaf1835b26ff4a23d81d4e2f4792efc02ef","observation_id":"37694dd9-00ff-4e41-82ca-ca53058e2bd2","resolution":{"observed_at":"2026-08-10T15:27:02.962552Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:27:02.972443Z","title":"2025 , eprint =","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.07068","last_updated":"2026-08-07T10:18:31Z","snapshot_observed_at":"2026-08-11T04:11:34.017250Z","submitted_at":"2026-08-07T10:18:31Z","title":"MemOPD: On-Policy Distillation through Memory State Alignment for Long-Horizon Agents","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-10T15:27:02.972443Z"},"links":{"citing_paper":"/paper/2608.07068"},"observation_digest":"sha256:23ca32d6d80532fb930461caeccb2850f4b44a4b28979af392ee774594f64010","observation_id":"bb7f2561-e1ed-4b51-acc5-9b54b19f8ec3","resolution":{"observed_at":"2026-08-10T15:27:02.972443Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:27:04.195769Z","title":"2024 , booktitle =","venue":null,"work_id":"f0eff1fd-20c7-48a8-88f6-e065c4cc0f5b","year":2024},"citing_paper":{"arxiv_id":"2608.07068","last_updated":"2026-08-07T10:18:31Z","snapshot_observed_at":"2026-08-11T04:11:34.017250Z","submitted_at":"2026-08-07T10:18:31Z","title":"MemOPD: On-Policy Distillation through Memory State Alignment for Long-Horizon Agents","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-10T15:27:02.977888Z"},"links":{"citing_paper":"/paper/2608.07068"},"observation_digest":"sha256:a65a351faa6c182edf06312b7947b54cf124fc87cb9736624b4c70678398a480","observation_id":"852b807b-9e4f-42ac-bf7f-8c1b656fdc9c","resolution":{"observed_at":"2026-08-10T15:27:04.201409Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:27:04.176398Z","title":"2023 , booktitle =","venue":null,"work_id":"f903e286-a7bb-4516-85ee-4571ea744c89","year":2023},"citing_paper":{"arxiv_id":"2608.07068","last_updated":"2026-08-07T10:18:31Z","snapshot_observed_at":"2026-08-11T04:11:34.017250Z","submitted_at":"2026-08-07T10:18:31Z","title":"MemOPD: On-Policy Distillation through Memory State Alignment for Long-Horizon Agents","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-10T15:27:02.984336Z"},"links":{"citing_paper":"/paper/2608.07068"},"observation_digest":"sha256:26e3b3c1018095af3d6dee5f47607c0a50499bed62a227f1681a4317a49d5817","observation_id":"2024b10b-d0ce-4980-a4f8-0d6ff705e6fe","resolution":{"observed_at":"2026-08-10T15:27:04.182215Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:27:04.150596Z","title":"2024 , url =","venue":null,"work_id":"5d833f4f-8fc3-46ef-9552-6676c3389aa3","year":2024},"citing_paper":{"arxiv_id":"2608.07068","last_updated":"2026-08-07T10:18:31Z","snapshot_observed_at":"2026-08-11T04:11:34.017250Z","submitted_at":"2026-08-07T10:18:31Z","title":"MemOPD: On-Policy Distillation through Memory State Alignment for Long-Horizon Agents","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-10T15:27:02.991736Z"},"links":{"citing_paper":"/paper/2608.07068"},"observation_digest":"sha256:8b808e902c6d441adabc776bc4b0a388741d2000d65cbd686985affd3a3c4826","observation_id":"78e84e00-9b3f-4942-958b-6693ce9e91ff","resolution":{"observed_at":"2026-08-10T15:27:04.156793Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:27:02.997944Z","title":"2024 , booktitle =","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.07068","last_updated":"2026-08-07T10:18:31Z","snapshot_observed_at":"2026-08-11T04:11:34.017250Z","submitted_at":"2026-08-07T10:18:31Z","title":"MemOPD: On-Policy Distillation through Memory State Alignment for Long-Horizon Agents","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-10T15:27:02.997944Z"},"links":{"citing_paper":"/paper/2608.07068"},"observation_digest":"sha256:d73527254073dabd893987a83563095fd6ffd10a00f88ea0f6e933a24d2db7fe","observation_id":"30ec3b9d-8b77-41e0-a369-d6f6f9d200a6","resolution":{"observed_at":"2026-08-10T15:27:02.997944Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:27:04.133934Z","title":"2023 , eprint =","venue":null,"work_id":"3f53cf79-70d9-4d5c-8d92-9047e4a1c2b7","year":2023},"citing_paper":{"arxiv_id":"2608.07068","last_updated":"2026-08-07T10:18:31Z","snapshot_observed_at":"2026-08-11T04:11:34.017250Z","submitted_at":"2026-08-07T10:18:31Z","title":"MemOPD: On-Policy Distillation through Memory State Alignment for Long-Horizon Agents","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-10T15:27:03.003722Z"},"links":{"citing_paper":"/paper/2608.07068"},"observation_digest":"sha256:75275899159ea35d4d6e334dde7b7a04fb765a2d6a42482bf5df0ad85acf5f56","observation_id":"7a4e9157-d672-4fe1-97e4-c67db8f6b14d","resolution":{"observed_at":"2026-08-10T15:27:04.138951Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:27:04.117400Z","title":"2024 , booktitle =","venue":null,"work_id":"7022f382-2812-4642-85a5-aab979e3cf2f","year":2024},"citing_paper":{"arxiv_id":"2608.07068","last_updated":"2026-08-07T10:18:31Z","snapshot_observed_at":"2026-08-11T04:11:34.017250Z","submitted_at":"2026-08-07T10:18:31Z","title":"MemOPD: On-Policy Distillation through Memory State Alignment for Long-Horizon Agents","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-10T15:27:03.009418Z"},"links":{"citing_paper":"/paper/2608.07068"},"observation_digest":"sha256:60dbed94b2777c1415e03fd4b05412770d167cb3648791fd656356f2cc8b14da","observation_id":"6ba9ce27-d14c-4411-8882-1257b6b7f43e","resolution":{"observed_at":"2026-08-10T15:27:04.122059Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.07863","last_updated":"2024-01-19T06:59:26Z","snapshot_observed_at":"2026-08-11T00:49:57.137476Z","submitted_at":"2023-06-13T15:49:41Z","title":"Synapse: Trajectory-as-Exemplar Prompting with Memory for Computer Control","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.07863","snapshot_observed_at":"2026-08-10T15:27:03.015120Z","title":"2024 , doi =","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.07068","last_updated":"2026-08-07T10:18:31Z","snapshot_observed_at":"2026-08-11T04:11:34.017250Z","submitted_at":"2026-08-07T10:18:31Z","title":"MemOPD: On-Policy Distillation through Memory State Alignment for Long-Horizon Agents","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-10T15:27:03.015120Z"},"links":{"cited_paper":"/paper/2306.07863","citing_paper":"/paper/2608.07068"},"observation_digest":"sha256:e6c49f5c0ece6f00e54cd7d153a9543340d6e39cf07942d4272a3dd714cc5c7b","observation_id":"5fd7106e-ae55-4f4e-8712-3326ccfcdc2d","resolution":{"observed_at":"2026-08-10T15:27:03.015120Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:27:03.023759Z","title":"2025 , doi =","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.07068","last_updated":"2026-08-07T10:18:31Z","snapshot_observed_at":"2026-08-11T04:11:34.017250Z","submitted_at":"2026-08-07T10:18:31Z","title":"MemOPD: On-Policy Distillation through Memory State Alignment for Long-Horizon Agents","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-10T15:27:03.023759Z"},"links":{"citing_paper":"/paper/2608.07068"},"observation_digest":"sha256:420986b6e5e91f0f955005b4880552a795c9c11c58fb76dc43d8076813c12045","observation_id":"d05900b5-00ec-485b-81f5-76ca848bdda9","resolution":{"observed_at":"2026-08-10T15:27:03.023759Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.12983","last_updated":"2023-11-21T20:34:47Z","snapshot_observed_at":"2026-08-10T12:19:42.688166Z","submitted_at":"2023-11-21T20:34:47Z","title":"GAIA: a benchmark for General AI Assistants","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.12983","snapshot_observed_at":"2026-08-10T15:27:03.028808Z","title":"2023 , doi =","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.07068","last_updated":"2026-08-07T10:18:31Z","snapshot_observed_at":"2026-08-11T04:11:34.017250Z","submitted_at":"2026-08-07T10:18:31Z","title":"MemOPD: On-Policy Distillation through Memory State Alignment for Long-Horizon Agents","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-10T15:27:03.028808Z"},"links":{"cited_paper":"/paper/2311.12983","citing_paper":"/paper/2608.07068"},"observation_digest":"sha256:4bd44ed56776207483c1a696c5e9decd5e67282ce290dd2f164d6b3e2328777a","observation_id":"4423f137-4b36-44b7-b5de-72c7a235c443","resolution":{"observed_at":"2026-08-10T15:27:03.028808Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2108.00573","last_updated":"2022-05-05T05:50:50Z","snapshot_observed_at":"2026-08-05T14:23:49.315145Z","submitted_at":"2021-08-02T00:33:27Z","title":"MuSiQue: Multihop Questions via Single-hop Question Composition","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2108.00573","snapshot_observed_at":"2026-08-10T15:27:03.034622Z","title":"2022 , doi =","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.07068","last_updated":"2026-08-07T10:18:31Z","snapshot_observed_at":"2026-08-11T04:11:34.017250Z","submitted_at":"2026-08-07T10:18:31Z","title":"MemOPD: On-Policy Distillation through Memory State Alignment for Long-Horizon Agents","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-10T15:27:03.034622Z"},"links":{"cited_paper":"/paper/2108.00573","citing_paper":"/paper/2608.07068"},"observation_digest":"sha256:6d3db40364934ee130b6b16e3e3db486596e511c06795886d2637c12962dc844","observation_id":"900a15df-f44f-4d1a-8f55-4a490c4e7c91","resolution":{"observed_at":"2026-08-10T15:27:03.034622Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2011.01060","last_updated":"2020-11-12T07:47:48Z","snapshot_observed_at":"2026-07-06T10:10:56.466018Z","submitted_at":"2020-11-02T15:42:40Z","title":"Constructing A Multi-hop QA Dataset for Comprehensive Evaluation of Reasoning Steps","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2011.01060","snapshot_observed_at":"2026-08-10T15:27:03.040495Z","title":"2020 , doi =","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2608.07068","last_updated":"2026-08-07T10:18:31Z","snapshot_observed_at":"2026-08-11T04:11:34.017250Z","submitted_at":"2026-08-07T10:18:31Z","title":"MemOPD: On-Policy Distillation through Memory State Alignment for Long-Horizon Agents","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-10T15:27:03.040495Z"},"links":{"cited_paper":"/paper/2011.01060","citing_paper":"/paper/2608.07068"},"observation_digest":"sha256:1afd50c87e39622119015b8f8acf6adcf243fca27013766d1141ea55a332fc8b","observation_id":"0ab5ee6d-5006-4113-bf0c-2aafd94fb84c","resolution":{"observed_at":"2026-08-10T15:27:03.040495Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1705.03551","last_updated":"2017-05-13T21:12:37Z","snapshot_observed_at":"2026-08-02T11:13:42.401488Z","submitted_at":"2017-05-09T21:35:07Z","title":"TriviaQA: A Large Scale Distantly Supervised Challenge Dataset for Reading Comprehension","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1705.03551","snapshot_observed_at":"2026-08-10T15:27:03.048699Z","title":"2017 , doi =","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2608.07068","last_updated":"2026-08-07T10:18:31Z","snapshot_observed_at":"2026-08-11T04:11:34.017250Z","submitted_at":"2026-08-07T10:18:31Z","title":"MemOPD: On-Policy Distillation through Memory State Alignment for Long-Horizon Agents","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-10T15:27:03.048699Z"},"links":{"cited_paper":"/paper/1705.03551","citing_paper":"/paper/2608.07068"},"observation_digest":"sha256:7a611d5b3c24cfc26202b9a70d168520a83a68ac8a9d1e3b4229d52cd9f90a38","observation_id":"3e890958-464a-46cb-9b64-129dd7c46e51","resolution":{"observed_at":"2026-08-10T15:27:03.048699Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2603.00680","last_updated":"2026-04-09T06:51:56Z","snapshot_observed_at":"2026-07-06T22:47:24.369805Z","submitted_at":"2026-02-28T14:43:02Z","title":"MemPO: Self-Memory Policy Optimization for Long-Horizon Agents","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2603.00680","snapshot_observed_at":"2026-08-10T15:27:03.055159Z","title":"2603.00680 , archiveprefix =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07068","last_updated":"2026-08-07T10:18:31Z","snapshot_observed_at":"2026-08-11T04:11:34.017250Z","submitted_at":"2026-08-07T10:18:31Z","title":"MemOPD: On-Policy Distillation through Memory State Alignment for Long-Horizon Agents","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-10T15:27:03.055159Z"},"links":{"cited_paper":"/paper/2603.00680","citing_paper":"/paper/2608.07068"},"observation_digest":"sha256:88997d39388ea1591cbc58f55ca51d9479662d94935eb0f91bf170e513450db6","observation_id":"e145e79c-8be9-4d5f-a57d-21e8f70caf6f","resolution":{"observed_at":"2026-08-10T15:27:03.055159Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:27:03.062670Z","title":"Proceedings of the 2016 Conference on Empirical Methods in Natural Language Processing , pages =","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2608.07068","last_updated":"2026-08-07T10:18:31Z","snapshot_observed_at":"2026-08-11T04:11:34.017250Z","submitted_at":"2026-08-07T10:18:31Z","title":"MemOPD: On-Policy Distillation through Memory State Alignment for Long-Horizon Agents","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-10T15:27:03.062670Z"},"links":{"citing_paper":"/paper/2608.07068"},"observation_digest":"sha256:61f7c8c370e6c01ec2f7485fe3df0c36a591afc3003d35f0ff259ba9172c4bef","observation_id":"5ea944fa-e5cc-419e-8d30-92ccfce8dd37","resolution":{"observed_at":"2026-08-10T15:27:03.062670Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:27:04.087525Z","title":"2024 , eprint =","venue":null,"work_id":"8f52b2af-3762-41f7-b9fa-0eee482011b4","year":2024},"citing_paper":{"arxiv_id":"2608.07068","last_updated":"2026-08-07T10:18:31Z","snapshot_observed_at":"2026-08-11T04:11:34.017250Z","submitted_at":"2026-08-07T10:18:31Z","title":"MemOPD: On-Policy Distillation through Memory State Alignment for Long-Horizon Agents","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-10T15:27:03.071247Z"},"links":{"citing_paper":"/paper/2608.07068"},"observation_digest":"sha256:5d457431a409433478622b67445e3aa0bac503392da65091b11837d6415f642a","observation_id":"1eed30bd-e77a-4bbf-8542-4c0ff148063a","resolution":{"observed_at":"2026-08-10T15:27:04.092543Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:27:03.077783Z","title":"Proceedings of the Fourteenth International Conference on Artificial Intelligence and Statistics , series =","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2608.07068","last_updated":"2026-08-07T10:18:31Z","snapshot_observed_at":"2026-08-11T04:11:34.017250Z","submitted_at":"2026-08-07T10:18:31Z","title":"MemOPD: On-Policy Distillation through Memory State Alignment for Long-Horizon Agents","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-10T15:27:03.077783Z"},"links":{"citing_paper":"/paper/2608.07068"},"observation_digest":"sha256:8b95de4c71e70ab3ee6fb33edefa2b83857fd3138fe66e9171da31e70f52c3b5","observation_id":"63bf59ab-0664-4efc-8a5f-bbfae2fbc33c","resolution":{"observed_at":"2026-08-10T15:27:03.077783Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03898","last_updated":"2024-07-03T04:57:41Z","snapshot_observed_at":"2026-08-05T01:48:55.895470Z","submitted_at":"2024-02-06T11:10:35Z","title":"DistiLLM: Towards Streamlined Distillation for Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.03898","snapshot_observed_at":"2026-08-10T15:27:03.084232Z","title":"2024 , volume =","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.07068","last_updated":"2026-08-07T10:18:31Z","snapshot_observed_at":"2026-08-11T04:11:34.017250Z","submitted_at":"2026-08-07T10:18:31Z","title":"MemOPD: On-Policy Distillation through Memory State Alignment for Long-Horizon Agents","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-10T15:27:03.084232Z"},"links":{"cited_paper":"/paper/2402.03898","citing_paper":"/paper/2608.07068"},"observation_digest":"sha256:55980748c160381ace6f4476873e8217834725aec9c06074ddc629d8c5dbe9ed","observation_id":"f592d38c-cecd-4fe3-80e4-942c4e0b34d8","resolution":{"observed_at":"2026-08-10T15:27:03.084232Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2006.05525","last_updated":"2021-05-20T13:45:55Z","snapshot_observed_at":"2026-08-10T22:39:55.357269Z","submitted_at":"2020-06-09T21:47:17Z","title":"Knowledge Distillation: A Survey","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2006.05525","snapshot_observed_at":"2026-08-10T15:27:03.092957Z","title":"International Journal of Computer Vision , volume =","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.07068","last_updated":"2026-08-07T10:18:31Z","snapshot_observed_at":"2026-08-11T04:11:34.017250Z","submitted_at":"2026-08-07T10:18:31Z","title":"MemOPD: On-Policy Distillation through Memory State Alignment for Long-Horizon Agents","version":1},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-10T15:27:03.092957Z"},"links":{"cited_paper":"/paper/2006.05525","citing_paper":"/paper/2608.07068"},"observation_digest":"sha256:1e29f844f51afdfa3ad0301bf505afc8ae61f1bfede23deb0984c0b71e44275f","observation_id":"a18067dd-93e8-4003-8b89-213948e5fe54","resolution":{"observed_at":"2026-08-10T15:27:03.092957Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.02155","last_updated":"2022-03-04T07:04:42Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-03-04T07:04:42Z","title":"Training language models to follow instructions with human feedback","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.02155","snapshot_observed_at":"2026-08-10T15:27:03.100686Z","title":"Advances in Neural Information Processing Systems , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07068","last_updated":"2026-08-07T10:18:31Z","snapshot_observed_at":"2026-08-11T04:11:34.017250Z","submitted_at":"2026-08-07T10:18:31Z","title":"MemOPD: On-Policy Distillation through Memory State Alignment for Long-Horizon Agents","version":1},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-10T15:27:03.100686Z"},"links":{"cited_paper":"/paper/2203.02155","citing_paper":"/paper/2608.07068"},"observation_digest":"sha256:c166534ecf22b2cb4f24f8505e7b6806547c4c224df1154defb8a8814ec9428a","observation_id":"c1dc625f-2db1-4bd7-a19b-e1f63b1338c8","resolution":{"observed_at":"2026-08-10T15:27:03.100686Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:27:03.107712Z","title":"Proceedings of the 36th Annual ACM Symposium on User Interface Software and Technology , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07068","last_updated":"2026-08-07T10:18:31Z","snapshot_observed_at":"2026-08-11T04:11:34.017250Z","submitted_at":"2026-08-07T10:18:31Z","title":"MemOPD: On-Policy Distillation through Memory State Alignment for Long-Horizon Agents","version":1},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-08-10T15:27:03.107712Z"},"links":{"citing_paper":"/paper/2608.07068"},"observation_digest":"sha256:c0db534bbce300addcdee3cd3ab74327e068c5965aa0ee32f381da230c287db8","observation_id":"4f51b412-d0bf-4259-beb0-81892f28fada","resolution":{"observed_at":"2026-08-10T15:27:03.107712Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.09727","last_updated":"2024-07-22T05:33:51Z","snapshot_observed_at":"2026-08-10T16:56:20.851617Z","submitted_at":"2024-02-15T05:40:21Z","title":"A Human-Inspired Reading Agent with Gist Memory of Very Long Contexts","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.09727","snapshot_observed_at":"2026-08-10T15:27:03.113238Z","title":"The Twelfth International Conference on Learning Representations , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07068","last_updated":"2026-08-07T10:18:31Z","snapshot_observed_at":"2026-08-11T04:11:34.017250Z","submitted_at":"2026-08-07T10:18:31Z","title":"MemOPD: On-Policy Distillation through Memory State Alignment for Long-Horizon Agents","version":1},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-08-10T15:27:03.113238Z"},"links":{"cited_paper":"/paper/2402.09727","citing_paper":"/paper/2608.07068"},"observation_digest":"sha256:eb756d7c300e1eabb3f75fadd11b31beb5a3e56eb7ee7011dd80225edc9646fc","observation_id":"5d8922ee-6806-48eb-878d-89440a30131f","resolution":{"observed_at":"2026-08-10T15:27:03.113238Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05736","last_updated":"2023-12-06T17:02:25Z","snapshot_observed_at":"2026-08-06T08:38:21.368130Z","submitted_at":"2023-10-09T14:10:21Z","title":"LLMLingua: Compressing Prompts for Accelerated Inference of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.05736","snapshot_observed_at":"2026-08-10T15:27:03.120485Z","title":"2023 , doi =","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.07068","last_updated":"2026-08-07T10:18:31Z","snapshot_observed_at":"2026-08-11T04:11:34.017250Z","submitted_at":"2026-08-07T10:18:31Z","title":"MemOPD: On-Policy Distillation through Memory State Alignment for Long-Horizon Agents","version":1},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-08-10T15:27:03.120485Z"},"links":{"cited_paper":"/paper/2310.05736","citing_paper":"/paper/2608.07068"},"observation_digest":"sha256:4497432f0a13bb47ec1dac9ae927502206aada27fdb7e74bff750e9e4918e8ab","observation_id":"f2c13c4a-5ffe-4121-8948-f0309e808f58","resolution":{"observed_at":"2026-08-10T15:27:03.120485Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06839","last_updated":"2024-08-12T03:53:35Z","snapshot_observed_at":"2026-08-06T17:12:58.658176Z","submitted_at":"2023-10-10T17:59:58Z","title":"LongLLMLingua: Accelerating and Enhancing LLMs in Long Context Scenarios via Prompt Compression","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.06839","snapshot_observed_at":"2026-08-10T15:27:03.125713Z","title":"2024 , doi =","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.07068","last_updated":"2026-08-07T10:18:31Z","snapshot_observed_at":"2026-08-11T04:11:34.017250Z","submitted_at":"2026-08-07T10:18:31Z","title":"MemOPD: On-Policy Distillation through Memory State Alignment for Long-Horizon Agents","version":1},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-08-10T15:27:03.125713Z"},"links":{"cited_paper":"/paper/2310.06839","citing_paper":"/paper/2608.07068"},"observation_digest":"sha256:e8f0eeeb2932466c9836a8103c66b88d471d4035f14bca231dfeb1807ac96478","observation_id":"5d4a1d03-f9e2-47a7-8a75-925617dc56fb","resolution":{"observed_at":"2026-08-10T15:27:03.125713Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:27:04.052198Z","title":"2025 , eprint =","venue":null,"work_id":"213cf239-7c4a-4d07-b1b4-a415cc90d1b6","year":2025},"citing_paper":{"arxiv_id":"2608.07068","last_updated":"2026-08-07T10:18:31Z","snapshot_observed_at":"2026-08-11T04:11:34.017250Z","submitted_at":"2026-08-07T10:18:31Z","title":"MemOPD: On-Policy Distillation through Memory State Alignment for Long-Horizon Agents","version":1},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-08-10T15:27:03.130931Z"},"links":{"citing_paper":"/paper/2608.07068"},"observation_digest":"sha256:39e9be43c3ca5ac2ba4e43a6cd2718925b88b3b0dbbf5daa30b8910c8fde6ffe","observation_id":"246598c8-e0f9-4b28-ab4b-1fc376aba6b7","resolution":{"observed_at":"2026-08-10T15:27:04.058462Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:27:04.034583Z","title":"2026 , eprint =","venue":null,"work_id":"c4e4442e-c61f-413e-8169-059caadd7720","year":2026},"citing_paper":{"arxiv_id":"2608.07068","last_updated":"2026-08-07T10:18:31Z","snapshot_observed_at":"2026-08-11T04:11:34.017250Z","submitted_at":"2026-08-07T10:18:31Z","title":"MemOPD: On-Policy Distillation through Memory State Alignment for Long-Horizon Agents","version":1},"reference_index":63,"source":"arxiv_source","source_observed_at":"2026-08-10T15:27:03.135799Z"},"links":{"citing_paper":"/paper/2608.07068"},"observation_digest":"sha256:b6d377280bbd715581b32c892597758352ccc8bacdd2db80c8e082beb43368e5","observation_id":"aa13d68d-873f-4589-a4fc-43b2910deec4","resolution":{"observed_at":"2026-08-10T15:27:04.040052Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:27:04.015686Z","title":"2026 , eprint =","venue":null,"work_id":"b5d4b1d9-afa7-464d-ad12-1215dbd41163","year":2026},"citing_paper":{"arxiv_id":"2608.07068","last_updated":"2026-08-07T10:18:31Z","snapshot_observed_at":"2026-08-11T04:11:34.017250Z","submitted_at":"2026-08-07T10:18:31Z","title":"MemOPD: On-Policy Distillation through Memory State Alignment for Long-Horizon Agents","version":1},"reference_index":64,"source":"arxiv_source","source_observed_at":"2026-08-10T15:27:03.141522Z"},"links":{"citing_paper":"/paper/2608.07068"},"observation_digest":"sha256:6744a5e2ce05a5d81dd583f7319732dfd286da4eafe4f5ef7b478749f0604c9f","observation_id":"a3c21e61-b154-4505-a0d7-9f88c0316599","resolution":{"observed_at":"2026-08-10T15:27:04.021336Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:27:03.997333Z","title":"2026 , eprint =","venue":null,"work_id":"a79b5ee7-40b5-4963-ae17-62f0ba6cd3ab","year":2026},"citing_paper":{"arxiv_id":"2608.07068","last_updated":"2026-08-07T10:18:31Z","snapshot_observed_at":"2026-08-11T04:11:34.017250Z","submitted_at":"2026-08-07T10:18:31Z","title":"MemOPD: On-Policy Distillation through Memory State Alignment for Long-Horizon Agents","version":1},"reference_index":65,"source":"arxiv_source","source_observed_at":"2026-08-10T15:27:03.147576Z"},"links":{"citing_paper":"/paper/2608.07068"},"observation_digest":"sha256:117221dadec56badfde877aa366349acb2d1b69892cc24ef017353fe80fcce27","observation_id":"9ce9fc88-cc2d-4f85-bbb7-20e01e3547a3","resolution":{"observed_at":"2026-08-10T15:27:04.003901Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T15:27:03.159262Z","title":"2025 , eprint=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.07068","last_updated":"2026-08-07T10:18:31Z","snapshot_observed_at":"2026-08-11T04:11:34.017250Z","submitted_at":"2026-08-07T10:18:31Z","title":"MemOPD: On-Policy Distillation through Memory State Alignment for Long-Horizon Agents","version":1},"reference_index":66,"source":"arxiv_source","source_observed_at":"2026-08-10T15:27:03.159262Z"},"links":{"citing_paper":"/paper/2608.07068"},"observation_digest":"sha256:dbe43aeee15cdb91f32bd745778875bed5c516966b02896309b80521173c9518","observation_id":"916ce6ef-50c4-4289-8e1e-4cc2303c0ea9","resolution":{"observed_at":"2026-08-10T15:27:03.159262Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2608.07068","last_updated":"2026-08-07T10:18:31Z","latest_version":1,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-11T04:11:34.017250Z","submitted_at":"2026-08-07T10:18:31Z","title":"MemOPD: On-Policy Distillation through Memory State Alignment for Long-Horizon Agents"},"reference_resolution":{"displayed":66,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":34,"verified_exact":0,"verified_fuzzy":32},"total_outbound_references":66},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 11 August 2026, this Paper Citation Record lists 66 of 66 outbound references and 0 inbound Pith citation observations for arXiv:2608.07068."}