{"as_of":"2026-08-16T02:26:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:c0dfca9b2cdfa9e25645851fe12ad1fbcdd8c15bb3d8e8312c4afdf98e42e0a9","coverage":[{"denominator":108,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":100,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-28T14:25:08.052988Z","state":"measured"},{"denominator":102,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":102,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-15T06:32:42.880941+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-08T13:01:09.120785Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-08T13:01:09.639756Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2606.02373","last_updated":"2026-06-01T15:21:41Z","snapshot_observed_at":"2026-08-14T09:20:36.323233Z","submitted_at":"2026-06-01T15:21:41Z","title":"Harness-1: Reinforcement Learning for Search Agents with State-Externalizing Harnesses","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2606.02373","snapshot_observed_at":"2026-08-04T15:12:55.554565Z","title":"2026 , archivePrefix =","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.02097","last_updated":"2026-08-03T11:58:21Z","snapshot_observed_at":"2026-08-15T22:59:26.336051Z","submitted_at":"2026-08-03T11:58:21Z","title":"Fetch-then-Explore: Decoupling Selection from Extraction over a Persistent Workspace for Search Agents","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-04T15:12:55.554565Z"},"links":{"cited_paper":"/paper/2606.02373","citing_paper":"/paper/2608.02097"},"observation_digest":"sha256:5eb68abd2ec978140fef7a4b011551e3454425ec1db30b8362a54cee6cde19c6","observation_id":"a6ef2b82-acfa-47ce-804d-a6049effec00","resolution":{"observed_at":"2026-08-04T15:12:55.554565Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2606.02373","last_updated":"2026-06-01T15:21:41Z","snapshot_observed_at":"2026-08-14T09:20:36.323233Z","submitted_at":"2026-06-01T15:21:41Z","title":"Harness-1: Reinforcement Learning for Search Agents with State-Externalizing Harnesses","version":1},"cited_work":{"arxiv_id":"2606.02373","doi":null,"metadata_source":"pith","pith_arxiv_id":"2606.02373","snapshot_observed_at":"2026-08-08T13:01:09.639756Z","title":"Harness-1: Reinforcement Learning for Search Agents with State-Externalizing Harnesses","venue":"cs.AI","work_id":"7b96c955-60f0-40ce-bb28-68fe4762311e","year":2026},"citing_paper":{"arxiv_id":"2608.05446","last_updated":"2026-08-05T22:29:20Z","snapshot_observed_at":"2026-08-15T22:31:26.404130Z","submitted_at":"2026-08-05T22:29:20Z","title":"EvoHarness-RL: Learning Self-Evolving Runtime Harness for Long-Horizon LLM Agents","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-08T13:01:09.120785Z"},"links":{"cited_paper":"/paper/2606.02373","citing_paper":"/paper/2608.05446"},"observation_digest":"sha256:82f927ba883e792ce5dbfda035ea75891c7c7b95b0cc2a9429b3f777c91ab51d","observation_id":"431a4610-419f-4600-8b9e-a9e9f7df540a","resolution":{"observed_at":"2026-08-08T13:01:09.644786Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2606.02373/citation-record","integrity":"/paper/2606.02373/integrity","json":"/paper/2606.02373/citation-record.json","paper":"/paper/2606.02373"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:25:08.052988Z","title":"Retrieval-augmented generation for knowledge-intensive NLP tasks , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.02373","last_updated":"2026-06-01T15:21:41Z","snapshot_observed_at":"2026-08-14T09:20:36.323233Z","submitted_at":"2026-06-01T15:21:41Z","title":"Harness-1: Reinforcement Learning for Search Agents with State-Externalizing Harnesses","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-06-28T14:25:08.052988Z"},"links":{"citing_paper":"/paper/2606.02373"},"observation_digest":"sha256:de31a195efc10dce2cbb8ba0031d2e84ef74873432cbc187394d9a474fe0b703","observation_id":"faaf47b4-b9a7-456b-b0f9-5d2237fb7076","resolution":{"observed_at":"2026-06-28T14:25:08.052988Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:25:08.052988Z","title":"2026 , eprint=","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2606.02373","last_updated":"2026-06-01T15:21:41Z","snapshot_observed_at":"2026-08-14T09:20:36.323233Z","submitted_at":"2026-06-01T15:21:41Z","title":"Harness-1: Reinforcement Learning for Search Agents with State-Externalizing Harnesses","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-06-28T14:25:08.052988Z"},"links":{"citing_paper":"/paper/2606.02373"},"observation_digest":"sha256:c05184327548a393b2bf3118e78f63ec568ef4af4102e68b22c34d04f6a856eb","observation_id":"e6fef523-bb81-4122-b6e4-dacaa672b1ae","resolution":{"observed_at":"2026-06-28T14:25:08.052988Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:25:08.052988Z","title":"2023 , eprint=","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.02373","last_updated":"2026-06-01T15:21:41Z","snapshot_observed_at":"2026-08-14T09:20:36.323233Z","submitted_at":"2026-06-01T15:21:41Z","title":"Harness-1: Reinforcement Learning for Search Agents with State-Externalizing Harnesses","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-06-28T14:25:08.052988Z"},"links":{"citing_paper":"/paper/2606.02373"},"observation_digest":"sha256:76c7415e0ddf6a26d4eb5d33c12e5dfbfa80e7dfa33896c2b931472ca43a05ab","observation_id":"14b4ee63-034b-4aa6-bafb-8197b5d324a1","resolution":{"observed_at":"2026-06-28T14:25:08.052988Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:25:08.052988Z","title":", title =","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.02373","last_updated":"2026-06-01T15:21:41Z","snapshot_observed_at":"2026-08-14T09:20:36.323233Z","submitted_at":"2026-06-01T15:21:41Z","title":"Harness-1: Reinforcement Learning for Search Agents with State-Externalizing Harnesses","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-06-28T14:25:08.052988Z"},"links":{"citing_paper":"/paper/2606.02373"},"observation_digest":"sha256:84371ef2aab5f90054f2fb822326ab983e58b924b58679e19fffb33fb872a6cf","observation_id":"9aee9ca1-3c41-4882-98ac-80bf534ecd5a","resolution":{"observed_at":"2026-06-28T14:25:08.052988Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:25:08.052988Z","title":"2025 , eprint=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.02373","last_updated":"2026-06-01T15:21:41Z","snapshot_observed_at":"2026-08-14T09:20:36.323233Z","submitted_at":"2026-06-01T15:21:41Z","title":"Harness-1: Reinforcement Learning for Search Agents with State-Externalizing Harnesses","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-06-28T14:25:08.052988Z"},"links":{"citing_paper":"/paper/2606.02373"},"observation_digest":"sha256:8529ff89acdcffe0a2adc67a3e5da3fe8c9f1fef8ff7f94e050b2909e01bd06d","observation_id":"dd96cb76-b4b9-49d1-8de5-1f06bede42e4","resolution":{"observed_at":"2026-06-28T14:25:08.052988Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:25:08.052988Z","title":"2025 , eprint=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.02373","last_updated":"2026-06-01T15:21:41Z","snapshot_observed_at":"2026-08-14T09:20:36.323233Z","submitted_at":"2026-06-01T15:21:41Z","title":"Harness-1: Reinforcement Learning for Search Agents with State-Externalizing Harnesses","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-06-28T14:25:08.052988Z"},"links":{"citing_paper":"/paper/2606.02373"},"observation_digest":"sha256:e83da0e18b33a21656ae59d6fe1a625933f0c0ab2b7e1f7583b0e7a8503cecd3","observation_id":"c1b5044e-4eab-4864-82a2-ea1396a654ab","resolution":{"observed_at":"2026-06-28T14:25:08.052988Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:25:08.052988Z","title":"2025 , eprint=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.02373","last_updated":"2026-06-01T15:21:41Z","snapshot_observed_at":"2026-08-14T09:20:36.323233Z","submitted_at":"2026-06-01T15:21:41Z","title":"Harness-1: Reinforcement Learning for Search Agents with State-Externalizing Harnesses","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-06-28T14:25:08.052988Z"},"links":{"citing_paper":"/paper/2606.02373"},"observation_digest":"sha256:63dea549903a2b3d89172cac751e088fe024532e9088e09135eda50e3c656a43","observation_id":"fc67782a-c8ec-4908-be80-f32375ad1f84","resolution":{"observed_at":"2026-06-28T14:25:08.052988Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:25:08.052988Z","title":"2025 , eprint=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.02373","last_updated":"2026-06-01T15:21:41Z","snapshot_observed_at":"2026-08-14T09:20:36.323233Z","submitted_at":"2026-06-01T15:21:41Z","title":"Harness-1: Reinforcement Learning for Search Agents with State-Externalizing Harnesses","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-06-28T14:25:08.052988Z"},"links":{"citing_paper":"/paper/2606.02373"},"observation_digest":"sha256:6e703fac8eac4515119027cbf14361fc34658bcbc1cc2ebd215262eed479b6a7","observation_id":"974089d0-cc3a-4108-a6a4-a526bed7e476","resolution":{"observed_at":"2026-06-28T14:25:08.052988Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:25:08.052988Z","title":"Proceedings of the 2025 Conference on Empirical Methods in Natural Language Processing , pages=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.02373","last_updated":"2026-06-01T15:21:41Z","snapshot_observed_at":"2026-08-14T09:20:36.323233Z","submitted_at":"2026-06-01T15:21:41Z","title":"Harness-1: Reinforcement Learning for Search Agents with State-Externalizing Harnesses","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-06-28T14:25:08.052988Z"},"links":{"citing_paper":"/paper/2606.02373"},"observation_digest":"sha256:e29c906680c9b7050259825a3d687ee50593057b5b160cf52f14bb91089d13e3","observation_id":"f6a8aa56-5bdd-416d-af94-b7d50da49d64","resolution":{"observed_at":"2026-06-28T14:25:08.052988Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:25:08.052988Z","title":"2026 , eprint=","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2606.02373","last_updated":"2026-06-01T15:21:41Z","snapshot_observed_at":"2026-08-14T09:20:36.323233Z","submitted_at":"2026-06-01T15:21:41Z","title":"Harness-1: Reinforcement Learning for Search Agents with State-Externalizing Harnesses","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-06-28T14:25:08.052988Z"},"links":{"citing_paper":"/paper/2606.02373"},"observation_digest":"sha256:a36fa33ed6c2daa30e0340d7d6b38da4e711095e7d3ed6f8a09eaa4adb1049c8","observation_id":"07eb4697-9bee-4728-ae3a-b2ecbca802da","resolution":{"observed_at":"2026-06-28T14:25:08.052988Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:25:08.052988Z","title":"2025 , eprint=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.02373","last_updated":"2026-06-01T15:21:41Z","snapshot_observed_at":"2026-08-14T09:20:36.323233Z","submitted_at":"2026-06-01T15:21:41Z","title":"Harness-1: Reinforcement Learning for Search Agents with State-Externalizing Harnesses","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-06-28T14:25:08.052988Z"},"links":{"citing_paper":"/paper/2606.02373"},"observation_digest":"sha256:f4b638ed19ef12bfd0759f9dfc2a3d40dd25fecb7a7503b694c50041b6c29bee","observation_id":"ea5da7b7-c14f-4925-a054-637f2e2ef79f","resolution":{"observed_at":"2026-06-28T14:25:08.052988Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:25:08.052988Z","title":"2025 , eprint=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.02373","last_updated":"2026-06-01T15:21:41Z","snapshot_observed_at":"2026-08-14T09:20:36.323233Z","submitted_at":"2026-06-01T15:21:41Z","title":"Harness-1: Reinforcement Learning for Search Agents with State-Externalizing Harnesses","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-06-28T14:25:08.052988Z"},"links":{"citing_paper":"/paper/2606.02373"},"observation_digest":"sha256:f7aae77db9ec7ced1fc15f063a175b72b715c558a0a078b61d302427b1118bd3","observation_id":"ab5fc597-2609-48ad-b699-9ebbe832778a","resolution":{"observed_at":"2026-06-28T14:25:08.052988Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:25:08.052988Z","title":"2025 , eprint=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.02373","last_updated":"2026-06-01T15:21:41Z","snapshot_observed_at":"2026-08-14T09:20:36.323233Z","submitted_at":"2026-06-01T15:21:41Z","title":"Harness-1: Reinforcement Learning for Search Agents with State-Externalizing Harnesses","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-06-28T14:25:08.052988Z"},"links":{"citing_paper":"/paper/2606.02373"},"observation_digest":"sha256:b377b6f22362ebde36324634f552a6ea00b8e6a7219042cac7c76b93d30e9238","observation_id":"82170d76-4bd4-400a-8196-4d18aab4bf03","resolution":{"observed_at":"2026-06-28T14:25:08.052988Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:25:08.052988Z","title":"Proceedings of the ACM on Software Engineering , volume=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.02373","last_updated":"2026-06-01T15:21:41Z","snapshot_observed_at":"2026-08-14T09:20:36.323233Z","submitted_at":"2026-06-01T15:21:41Z","title":"Harness-1: Reinforcement Learning for Search Agents with State-Externalizing Harnesses","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-06-28T14:25:08.052988Z"},"links":{"citing_paper":"/paper/2606.02373"},"observation_digest":"sha256:e13d388d221b1deae509b8374d9dfa09961c5c6552180c9bad8283eb1f8b35bf","observation_id":"0fb828bd-bb3b-46f4-84b2-baa233ab37cf","resolution":{"observed_at":"2026-06-28T14:25:08.052988Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:25:08.052988Z","title":"2023 , eprint=","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.02373","last_updated":"2026-06-01T15:21:41Z","snapshot_observed_at":"2026-08-14T09:20:36.323233Z","submitted_at":"2026-06-01T15:21:41Z","title":"Harness-1: Reinforcement Learning for Search Agents with State-Externalizing Harnesses","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-06-28T14:25:08.052988Z"},"links":{"citing_paper":"/paper/2606.02373"},"observation_digest":"sha256:aeadc704ed647c7cd5f62f8ba5d31fb7d0ed20316383a7249fa104367e3433ca","observation_id":"a64c220c-6bfd-4a3c-ab2f-9fccc255d497","resolution":{"observed_at":"2026-06-28T14:25:08.052988Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:25:08.052988Z","title":"2025 , eprint=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.02373","last_updated":"2026-06-01T15:21:41Z","snapshot_observed_at":"2026-08-14T09:20:36.323233Z","submitted_at":"2026-06-01T15:21:41Z","title":"Harness-1: Reinforcement Learning for Search Agents with State-Externalizing Harnesses","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-06-28T14:25:08.052988Z"},"links":{"citing_paper":"/paper/2606.02373"},"observation_digest":"sha256:654613729bc9e3ef839c350275c20fc0af13a75d414423fa7e60f87eadfb43e7","observation_id":"73cdefd5-7bbe-4233-94f3-e02c544fd523","resolution":{"observed_at":"2026-06-28T14:25:08.052988Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2025.emnlp-main.22","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"DeepResearcher: Scaling deep research via reinforcement learning in real-world environments","venue":null,"work_id":"3ba30726-c698-49cb-a582-57410fa4d865","year":2025},"citing_paper":{"arxiv_id":"2606.02373","last_updated":"2026-06-01T15:21:41Z","snapshot_observed_at":"2026-08-14T09:20:36.323233Z","submitted_at":"2026-06-01T15:21:41Z","title":"Harness-1: Reinforcement Learning for Search Agents with State-Externalizing Harnesses","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-06-28T14:25:08.052988Z"},"links":{"citing_paper":"/paper/2606.02373"},"observation_digest":"sha256:148f0d3ce10381e7f3b4b55e995612f12d42990aeabc5ca419f0c8e596d47d34","observation_id":"90ef5f55-4865-4e10-8604-3c62ecaea3e0","resolution":{"observed_at":"2026-06-28T14:32:18.207549Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-07-14T19:49:49.791664+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-14T19:49:49.791664+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.13958","last_updated":"2025-04-16T21:45:32Z","snapshot_observed_at":"2026-08-15T04:58:53.543603Z","submitted_at":"2025-04-16T21:45:32Z","title":"ToolRL: Reward is All Tool Learning Needs","version":1},"cited_work":{"arxiv_id":"2504.13958","doi":"10.48550/arxiv.2504.13958","metadata_source":"pith","pith_arxiv_id":"2504.13958","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"ToolRL: Reward is All Tool Learning Needs","venue":"cs.LG","work_id":"82252022-0241-4006-9b28-fd1e69293343","year":2025},"citing_paper":{"arxiv_id":"2606.02373","last_updated":"2026-06-01T15:21:41Z","snapshot_observed_at":"2026-08-14T09:20:36.323233Z","submitted_at":"2026-06-01T15:21:41Z","title":"Harness-1: Reinforcement Learning for Search Agents with State-Externalizing Harnesses","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-06-28T14:25:08.052988Z"},"links":{"cited_paper":"/paper/2504.13958","citing_paper":"/paper/2606.02373"},"observation_digest":"sha256:55e86ea2c181e1c03b95f9d67a3bebcc3b793e42dd0a0887192c2ee709fbdd85","observation_id":"9d0d9951-7e2a-42e7-b7ef-ee02dd81484e","resolution":{"observed_at":"2026-07-01T23:26:22.064521Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1038/s41586-025-09422-z","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T03:06:43.562716Z","title":"doi: 10.1038/s41586-025-09422-z","venue":"Nature","work_id":"9835b482-5032-4135-93dd-82a066677569","year":2025},"citing_paper":{"arxiv_id":"2606.02373","last_updated":"2026-06-01T15:21:41Z","snapshot_observed_at":"2026-08-14T09:20:36.323233Z","submitted_at":"2026-06-01T15:21:41Z","title":"Harness-1: Reinforcement Learning for Search Agents with State-Externalizing Harnesses","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-06-28T14:25:08.052988Z"},"links":{"citing_paper":"/paper/2606.02373"},"observation_digest":"sha256:2233a2ceda8c7a23653293096a72ea25a0b29720c6e38bf0560faadfdbe5b873","observation_id":"44ca8b46-9ffa-474a-b182-31fccb01ca3b","resolution":{"observed_at":"2026-06-28T14:32:18.205492Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-13T19:38:05.434011+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-13T19:38:05.434011+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:25:08.052988Z","title":"and Finn, Chelsea , title =","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.02373","last_updated":"2026-06-01T15:21:41Z","snapshot_observed_at":"2026-08-14T09:20:36.323233Z","submitted_at":"2026-06-01T15:21:41Z","title":"Harness-1: Reinforcement Learning for Search Agents with State-Externalizing Harnesses","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-06-28T14:25:08.052988Z"},"links":{"citing_paper":"/paper/2606.02373"},"observation_digest":"sha256:b8a6da0f94e2991ef7bd4fada237495917228da8531c73562bd8939000e5c893","observation_id":"1672d9ce-d0d3-483b-a9f9-955dc422ce67","resolution":{"observed_at":"2026-06-28T14:25:08.052988Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:25:08.052988Z","title":"2017 , eprint=","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2606.02373","last_updated":"2026-06-01T15:21:41Z","snapshot_observed_at":"2026-08-14T09:20:36.323233Z","submitted_at":"2026-06-01T15:21:41Z","title":"Harness-1: Reinforcement Learning for Search Agents with State-Externalizing Harnesses","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-06-28T14:25:08.052988Z"},"links":{"citing_paper":"/paper/2606.02373"},"observation_digest":"sha256:96f39f208cb7f84f96f38b587167eb3a0c00be24e206897ae54d928b9dfd1bbc","observation_id":"820128cc-a57b-4dac-941f-4315aa191981","resolution":{"observed_at":"2026-06-28T14:25:08.052988Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:25:08.052988Z","title":"2025 , eprint=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.02373","last_updated":"2026-06-01T15:21:41Z","snapshot_observed_at":"2026-08-14T09:20:36.323233Z","submitted_at":"2026-06-01T15:21:41Z","title":"Harness-1: Reinforcement Learning for Search Agents with State-Externalizing Harnesses","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-06-28T14:25:08.052988Z"},"links":{"citing_paper":"/paper/2606.02373"},"observation_digest":"sha256:dae140bf4ec480a5fcdf0b9d5143c0c9e2268350cf6be8b819542015d0fdccd0","observation_id":"a03fd3c8-bc55-4ce4-a325-74dc08a96354","resolution":{"observed_at":"2026-06-28T14:25:08.052988Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:25:08.052988Z","title":"2025 , eprint=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.02373","last_updated":"2026-06-01T15:21:41Z","snapshot_observed_at":"2026-08-14T09:20:36.323233Z","submitted_at":"2026-06-01T15:21:41Z","title":"Harness-1: Reinforcement Learning for Search Agents with State-Externalizing Harnesses","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-06-28T14:25:08.052988Z"},"links":{"citing_paper":"/paper/2606.02373"},"observation_digest":"sha256:c827d907289f22e3207599a584ad01a89a98d254d45314ad225239b62dce7e0c","observation_id":"0ad7da53-1399-4c48-9a72-d5d2eba40d9e","resolution":{"observed_at":"2026-06-28T14:25:08.052988Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2025.emnlp-main.276","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Search-o1: Agentic search-enhanced large reasoning models","venue":null,"work_id":"ce43fcba-d6af-4bbd-875f-23f69db94928","year":2025},"citing_paper":{"arxiv_id":"2606.02373","last_updated":"2026-06-01T15:21:41Z","snapshot_observed_at":"2026-08-14T09:20:36.323233Z","submitted_at":"2026-06-01T15:21:41Z","title":"Harness-1: Reinforcement Learning for Search Agents with State-Externalizing Harnesses","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-06-28T14:25:08.052988Z"},"links":{"citing_paper":"/paper/2606.02373"},"observation_digest":"sha256:ee220def824a1bad7104829ad3109f6cb7f1198882f26605b9ec8c2f9560840d","observation_id":"680c1318-8bbf-47c9-bb60-5a00f6c1da6f","resolution":{"observed_at":"2026-06-28T14:32:18.200883Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-07-14T19:49:49.321553+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-14T19:49:49.321553+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:25:08.052988Z","title":"2026 , eprint=","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2606.02373","last_updated":"2026-06-01T15:21:41Z","snapshot_observed_at":"2026-08-14T09:20:36.323233Z","submitted_at":"2026-06-01T15:21:41Z","title":"Harness-1: Reinforcement Learning for Search Agents with State-Externalizing Harnesses","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-06-28T14:25:08.052988Z"},"links":{"citing_paper":"/paper/2606.02373"},"observation_digest":"sha256:9a2f856f5b0f158d569cea29187112ad5cf82859f0e79a3471eca464b487b0dd","observation_id":"0f0272b9-6774-4a6c-8fd8-a1dd59a00dc0","resolution":{"observed_at":"2026-06-28T14:25:08.052988Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:25:08.052988Z","title":"2025 , eprint=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.02373","last_updated":"2026-06-01T15:21:41Z","snapshot_observed_at":"2026-08-14T09:20:36.323233Z","submitted_at":"2026-06-01T15:21:41Z","title":"Harness-1: Reinforcement Learning for Search Agents with State-Externalizing Harnesses","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-06-28T14:25:08.052988Z"},"links":{"citing_paper":"/paper/2606.02373"},"observation_digest":"sha256:e7fc97e351a602c3bef26d4ad963d9c5114825e90a64c7e30398612d6dc0a65c","observation_id":"ba465f0e-8055-4ef4-95fa-ae9c92a2f338","resolution":{"observed_at":"2026-06-28T14:25:08.052988Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:25:08.052988Z","title":"2026 , publisher=","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2606.02373","last_updated":"2026-06-01T15:21:41Z","snapshot_observed_at":"2026-08-14T09:20:36.323233Z","submitted_at":"2026-06-01T15:21:41Z","title":"Harness-1: Reinforcement Learning for Search Agents with State-Externalizing Harnesses","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-06-28T14:25:08.052988Z"},"links":{"citing_paper":"/paper/2606.02373"},"observation_digest":"sha256:5c6b40c94bae830f58fb5ec237cf768b90fd0d48a60dd7e90bed35220ceaf326","observation_id":"e9c2c0d7-1231-4f3e-9b97-a748f8cea014","resolution":{"observed_at":"2026-06-28T14:25:08.052988Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:25:08.052988Z","title":"2026 , month = apr, howpublished =","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2606.02373","last_updated":"2026-06-01T15:21:41Z","snapshot_observed_at":"2026-08-14T09:20:36.323233Z","submitted_at":"2026-06-01T15:21:41Z","title":"Harness-1: Reinforcement Learning for Search Agents with State-Externalizing Harnesses","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-06-28T14:25:08.052988Z"},"links":{"citing_paper":"/paper/2606.02373"},"observation_digest":"sha256:5a9f49ad645b59c120c7e2ecf3d7958aa50d98ca60053d521a9d55f309778a0f","observation_id":"598e6057-9c12-4ca5-bd50-7728a2ccdd0f","resolution":{"observed_at":"2026-06-28T14:25:08.052988Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:25:08.052988Z","title":"OpenAI engineering note , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.02373","last_updated":"2026-06-01T15:21:41Z","snapshot_observed_at":"2026-08-14T09:20:36.323233Z","submitted_at":"2026-06-01T15:21:41Z","title":"Harness-1: Reinforcement Learning for Search Agents with State-Externalizing Harnesses","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-06-28T14:25:08.052988Z"},"links":{"citing_paper":"/paper/2606.02373"},"observation_digest":"sha256:d6e28d4c83707de436eaf418b2bae0d9d0965f7b6dcf9e8b8f330559fde02fcc","observation_id":"8ac9816d-70f7-4bcd-994c-8077152f2065","resolution":{"observed_at":"2026-06-28T14:25:08.052988Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2023.findings-emnlp.378","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T22:45:06.531703Z","title":"and Lewis, Mike , editor =","venue":"Findings of the Association for Computational Linguistics: EMNLP 2023","work_id":"d690fac4-0cde-42d6-958a-77a77c0e7bd0","year":2022},"citing_paper":{"arxiv_id":"2606.02373","last_updated":"2026-06-01T15:21:41Z","snapshot_observed_at":"2026-08-14T09:20:36.323233Z","submitted_at":"2026-06-01T15:21:41Z","title":"Harness-1: Reinforcement Learning for Search Agents with State-Externalizing Harnesses","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-06-28T14:25:08.052988Z"},"links":{"citing_paper":"/paper/2606.02373"},"observation_digest":"sha256:8a5c72a408af1c1964da8cca887829cf4c929903fb4f9cc5854c50990b0357b7","observation_id":"de7eb09f-15ed-4891-b4f9-7195aa71aeae","resolution":{"observed_at":"2026-06-28T14:32:18.198942Z","resolver_source":"doi","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-14T20:38:12.398591+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-14T20:38:12.398591+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:25:08.052988Z","title":"Proceedings of the 61st annual meeting of the association for computational linguistics (volume 1: long papers) , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.02373","last_updated":"2026-06-01T15:21:41Z","snapshot_observed_at":"2026-08-14T09:20:36.323233Z","submitted_at":"2026-06-01T15:21:41Z","title":"Harness-1: Reinforcement Learning for Search Agents with State-Externalizing Harnesses","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-06-28T14:25:08.052988Z"},"links":{"citing_paper":"/paper/2606.02373"},"observation_digest":"sha256:bf1bb33a068ecd900b4bb469e82ab80953e63e3b7aa0f5b9c805c38a85c0b70f","observation_id":"04a5b79e-9644-428b-9ddb-070c8c94db61","resolution":{"observed_at":"2026-06-28T14:25:08.052988Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:25:08.052988Z","title":"Proceedings of the 2023 conference on empirical methods in natural language processing , pages=","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.02373","last_updated":"2026-06-01T15:21:41Z","snapshot_observed_at":"2026-08-14T09:20:36.323233Z","submitted_at":"2026-06-01T15:21:41Z","title":"Harness-1: Reinforcement Learning for Search Agents with State-Externalizing Harnesses","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-06-28T14:25:08.052988Z"},"links":{"citing_paper":"/paper/2606.02373"},"observation_digest":"sha256:13b5500e72f82cc33be4c375fc8ea684889806b7bc8239a7b3bdc84abb106a62","observation_id":"50acf5a5-e59a-4ca3-9d38-41133a0e7dfb","resolution":{"observed_at":"2026-06-28T14:25:08.052988Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2025.emnlp-main.1095","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"s3: You Don ' t Need That Much Data to Train a Search Agent via RL","venue":null,"work_id":"a3b9ad2f-8f17-4e5a-a619-d12305209324","year":2025},"citing_paper":{"arxiv_id":"2606.02373","last_updated":"2026-06-01T15:21:41Z","snapshot_observed_at":"2026-08-14T09:20:36.323233Z","submitted_at":"2026-06-01T15:21:41Z","title":"Harness-1: Reinforcement Learning for Search Agents with State-Externalizing Harnesses","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-06-28T14:25:08.052988Z"},"links":{"citing_paper":"/paper/2606.02373"},"observation_digest":"sha256:1aedd321ba3393fcde8d5dfe694d216d44f97ad78d741a204c620fdbc6daec3e","observation_id":"202dd11b-51f0-4819-90df-49c442df819c","resolution":{"observed_at":"2026-06-28T14:32:18.202659Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:25:08.052988Z","title":"2025 , eprint=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.02373","last_updated":"2026-06-01T15:21:41Z","snapshot_observed_at":"2026-08-14T09:20:36.323233Z","submitted_at":"2026-06-01T15:21:41Z","title":"Harness-1: Reinforcement Learning for Search Agents with State-Externalizing Harnesses","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-06-28T14:25:08.052988Z"},"links":{"citing_paper":"/paper/2606.02373"},"observation_digest":"sha256:dcca0212c907b2142e1dccaadccd3f95e761cc2f90149fdbb3726959a5b1ae6c","observation_id":"18aadace-7964-4ecb-83f8-e8e932b99e46","resolution":{"observed_at":"2026-06-28T14:25:08.052988Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:25:08.052988Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.02373","last_updated":"2026-06-01T15:21:41Z","snapshot_observed_at":"2026-08-14T09:20:36.323233Z","submitted_at":"2026-06-01T15:21:41Z","title":"Harness-1: Reinforcement Learning for Search Agents with State-Externalizing Harnesses","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-06-28T14:25:08.052988Z"},"links":{"citing_paper":"/paper/2606.02373"},"observation_digest":"sha256:c16e57f872cf7ad332ab0218570cb8eb5e23ef983d18dcb68fbe797f5a8ba153","observation_id":"d1ec520d-3f9e-40cc-9758-a9029499aff1","resolution":{"observed_at":"2026-06-28T14:25:08.052988Z","resolver_source":null,"status":"parse_uncertain"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:25:08.052988Z","title":"2026 , month =","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2606.02373","last_updated":"2026-06-01T15:21:41Z","snapshot_observed_at":"2026-08-14T09:20:36.323233Z","submitted_at":"2026-06-01T15:21:41Z","title":"Harness-1: Reinforcement Learning for Search Agents with State-Externalizing Harnesses","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-06-28T14:25:08.052988Z"},"links":{"citing_paper":"/paper/2606.02373"},"observation_digest":"sha256:65a922485ecafdd58c9f57e538f5566b43102477114e1459212b58966ee7630d","observation_id":"376456ff-6727-4c61-8ec0-68d55ee6e2fa","resolution":{"observed_at":"2026-06-28T14:25:08.052988Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:25:08.052988Z","title":"2025 , eprint=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.02373","last_updated":"2026-06-01T15:21:41Z","snapshot_observed_at":"2026-08-14T09:20:36.323233Z","submitted_at":"2026-06-01T15:21:41Z","title":"Harness-1: Reinforcement Learning for Search Agents with State-Externalizing Harnesses","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-06-28T14:25:08.052988Z"},"links":{"citing_paper":"/paper/2606.02373"},"observation_digest":"sha256:4431ba14971c74e6725172a680a6401d2a373f1f11d7a30ca88f049a39a185cb","observation_id":"10afc3e3-81cd-47fd-b2b4-ae52cb6b0efa","resolution":{"observed_at":"2026-06-28T14:25:08.052988Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:25:08.052988Z","title":"2024 , eprint=","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.02373","last_updated":"2026-06-01T15:21:41Z","snapshot_observed_at":"2026-08-14T09:20:36.323233Z","submitted_at":"2026-06-01T15:21:41Z","title":"Harness-1: Reinforcement Learning for Search Agents with State-Externalizing Harnesses","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-06-28T14:25:08.052988Z"},"links":{"citing_paper":"/paper/2606.02373"},"observation_digest":"sha256:d4905e71ac41afcda8410efb5c5337a18fc7ade08a39049d4c4543887af94046","observation_id":"d9c50e40-787e-4598-bf95-40b8ab12aea8","resolution":{"observed_at":"2026-06-28T14:25:08.052988Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:25:08.052988Z","title":"2026 , eprint=","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2606.02373","last_updated":"2026-06-01T15:21:41Z","snapshot_observed_at":"2026-08-14T09:20:36.323233Z","submitted_at":"2026-06-01T15:21:41Z","title":"Harness-1: Reinforcement Learning for Search Agents with State-Externalizing Harnesses","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-06-28T14:25:08.052988Z"},"links":{"citing_paper":"/paper/2606.02373"},"observation_digest":"sha256:33cf6d0acbdb0ad77fa417e64db0d9e9c229ee9cb9e034c56dfd0b05dbd98527","observation_id":"393e8439-1d66-492c-b3bc-8afdbbf1944c","resolution":{"observed_at":"2026-06-28T14:25:08.052988Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2512.24601","last_updated":"2026-05-11T15:26:31Z","snapshot_observed_at":"2026-08-14T08:15:35.097689Z","submitted_at":"2025-12-31T03:43:41Z","title":"Recursive Language Models","version":3},"cited_work":{"arxiv_id":"2512.24601","doi":"10.48550/arxiv.2512.24601","metadata_source":"pith","pith_arxiv_id":"2512.24601","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Recursive Language Models","venue":"cs.AI","work_id":"695de9e6-4374-4788-916e-33e8c0667aae","year":2025},"citing_paper":{"arxiv_id":"2606.02373","last_updated":"2026-06-01T15:21:41Z","snapshot_observed_at":"2026-08-14T09:20:36.323233Z","submitted_at":"2026-06-01T15:21:41Z","title":"Harness-1: Reinforcement Learning for Search Agents with State-Externalizing Harnesses","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-06-28T14:25:08.052988Z"},"links":{"cited_paper":"/paper/2512.24601","citing_paper":"/paper/2606.02373"},"observation_digest":"sha256:dc9ba58cb18f179e18d36f48284d39bf6b484d166c92c766354df05ed07b711c","observation_id":"95cf4839-87eb-4455-a5ed-e5453ef37209","resolution":{"observed_at":"2026-07-01T23:26:22.110415Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-13T20:08:10.30028+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-13T20:08:10.30028+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:25:08.052988Z","title":"Transactions of the association for computational linguistics , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.02373","last_updated":"2026-06-01T15:21:41Z","snapshot_observed_at":"2026-08-14T09:20:36.323233Z","submitted_at":"2026-06-01T15:21:41Z","title":"Harness-1: Reinforcement Learning for Search Agents with State-Externalizing Harnesses","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-06-28T14:25:08.052988Z"},"links":{"citing_paper":"/paper/2606.02373"},"observation_digest":"sha256:64a814a6e28bdb6bf6d4005a741fc9b1d02ba4a757eca55bd027e2e75e96bfa7","observation_id":"3c57019a-e1ad-473e-b727-ae55b8191216","resolution":{"observed_at":"2026-06-28T14:25:08.052988Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:25:08.052988Z","title":"2025 , month =","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.02373","last_updated":"2026-06-01T15:21:41Z","snapshot_observed_at":"2026-08-14T09:20:36.323233Z","submitted_at":"2026-06-01T15:21:41Z","title":"Harness-1: Reinforcement Learning for Search Agents with State-Externalizing Harnesses","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-06-28T14:25:08.052988Z"},"links":{"citing_paper":"/paper/2606.02373"},"observation_digest":"sha256:df2dc3cf0616c0854941d6ef04246f65c353b7cf4ab533f32666451b260ebd56","observation_id":"044f3f83-a83f-49c5-af15-225530819512","resolution":{"observed_at":"2026-06-28T14:25:08.052988Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:25:08.052988Z","title":"Advances in neural information processing systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.02373","last_updated":"2026-06-01T15:21:41Z","snapshot_observed_at":"2026-08-14T09:20:36.323233Z","submitted_at":"2026-06-01T15:21:41Z","title":"Harness-1: Reinforcement Learning for Search Agents with State-Externalizing Harnesses","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-06-28T14:25:08.052988Z"},"links":{"citing_paper":"/paper/2606.02373"},"observation_digest":"sha256:d5c3596c18557634920d3f8f9c991db17cd10d344ba3860c77faf9152bf9a9dd","observation_id":"51fb6772-1f23-463a-ba0e-a6f09e28480a","resolution":{"observed_at":"2026-06-28T14:25:08.052988Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:25:08.052988Z","title":"2025 , eprint=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.02373","last_updated":"2026-06-01T15:21:41Z","snapshot_observed_at":"2026-08-14T09:20:36.323233Z","submitted_at":"2026-06-01T15:21:41Z","title":"Harness-1: Reinforcement Learning for Search Agents with State-Externalizing Harnesses","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-06-28T14:25:08.052988Z"},"links":{"citing_paper":"/paper/2606.02373"},"observation_digest":"sha256:0804936169a6910c41c9d89d89615fbcc570ee5f74546e84a70cdda513f41ffd","observation_id":"696e710a-a10b-4ac9-b5b6-3c8120ee0aae","resolution":{"observed_at":"2026-06-28T14:25:08.052988Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:25:08.052988Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.02373","last_updated":"2026-06-01T15:21:41Z","snapshot_observed_at":"2026-08-14T09:20:36.323233Z","submitted_at":"2026-06-01T15:21:41Z","title":"Harness-1: Reinforcement Learning for Search Agents with State-Externalizing Harnesses","version":1},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-06-28T14:25:08.052988Z"},"links":{"citing_paper":"/paper/2606.02373"},"observation_digest":"sha256:bddf42380b17c2714fb8d78db4edd7bc4372d74fa725901de4f0615dd17d917b","observation_id":"a7a2d72d-6cb4-4c78-be6c-c37f8e103e17","resolution":{"observed_at":"2026-06-28T14:25:08.052988Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.12516","last_updated":"2025-04-16T22:27:45Z","snapshot_observed_at":"2026-08-13T03:19:29.377723Z","submitted_at":"2025-04-16T22:27:45Z","title":"BrowseComp: A Simple Yet Challenging Benchmark for Browsing Agents","version":1},"cited_work":{"arxiv_id":"2504.12516","doi":"10.48550/arxiv.2504.12516","metadata_source":"pith","pith_arxiv_id":"2504.12516","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"BrowseComp: A Simple Yet Challenging Benchmark for Browsing Agents","venue":"cs.CL","work_id":"25adb508-d97c-49d6-ae43-7a70c2478a34","year":2025},"citing_paper":{"arxiv_id":"2606.02373","last_updated":"2026-06-01T15:21:41Z","snapshot_observed_at":"2026-08-14T09:20:36.323233Z","submitted_at":"2026-06-01T15:21:41Z","title":"Harness-1: Reinforcement Learning for Search Agents with State-Externalizing Harnesses","version":1},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-06-28T14:25:08.052988Z"},"links":{"cited_paper":"/paper/2504.12516","citing_paper":"/paper/2606.02373"},"observation_digest":"sha256:1d5d2996c6e86a5d782b7cb2cf724a00ecd0ec1a71ab6ee09bcf79135d585e1c","observation_id":"9c7a007d-afce-4250-aec2-1ff09fe83036","resolution":{"observed_at":"2026-07-01T23:26:22.084196Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:25:08.052988Z","title":"2025 , eprint=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.02373","last_updated":"2026-06-01T15:21:41Z","snapshot_observed_at":"2026-08-14T09:20:36.323233Z","submitted_at":"2026-06-01T15:21:41Z","title":"Harness-1: Reinforcement Learning for Search Agents with State-Externalizing Harnesses","version":1},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-06-28T14:25:08.052988Z"},"links":{"citing_paper":"/paper/2606.02373"},"observation_digest":"sha256:5ff94f04c7154f3140779d04d252ccbcbe68f6d8ec218a3800496898407cf6b3","observation_id":"ff8f9599-756d-443a-a876-228636be9ae4","resolution":{"observed_at":"2026-06-28T14:25:08.052988Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:25:08.052988Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.02373","last_updated":"2026-06-01T15:21:41Z","snapshot_observed_at":"2026-08-14T09:20:36.323233Z","submitted_at":"2026-06-01T15:21:41Z","title":"Harness-1: Reinforcement Learning for Search Agents with State-Externalizing Harnesses","version":1},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-06-28T14:25:08.052988Z"},"links":{"citing_paper":"/paper/2606.02373"},"observation_digest":"sha256:556229497fd51ba825253f81b3ac0c39ed63c38f3ccbdf7e0c641d78cbc673be","observation_id":"ea2e96af-9f8b-43c3-b39e-15f55e582cc6","resolution":{"observed_at":"2026-06-28T14:25:08.052988Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:25:08.052988Z","title":"Proceedings of the 2018 conference on empirical methods in natural language processing , pages=","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2606.02373","last_updated":"2026-06-01T15:21:41Z","snapshot_observed_at":"2026-08-14T09:20:36.323233Z","submitted_at":"2026-06-01T15:21:41Z","title":"Harness-1: Reinforcement Learning for Search Agents with State-Externalizing Harnesses","version":1},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-06-28T14:25:08.052988Z"},"links":{"citing_paper":"/paper/2606.02373"},"observation_digest":"sha256:c8b49c3ebda6389cbf8ddcfdd93aa38b35f21c5d00bdd3d75da28b14aff82977","observation_id":"95dda421-5533-4bc5-8db6-20a3444b6c9f","resolution":{"observed_at":"2026-06-28T14:25:08.052988Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.14249","last_updated":"2026-02-20T04:23:01Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-24T05:27:46Z","title":"Humanity's Last Exam","version":10},"cited_work":{"arxiv_id":"2501.14249","doi":"10.1038/s41586-025-09962-4","metadata_source":"pith","pith_arxiv_id":"2501.14249","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Humanity's Last Exam","venue":"cs.LG","work_id":"59ea00d4-16a8-45e1-aafc-290a6f91d9f4","year":2025},"citing_paper":{"arxiv_id":"2606.02373","last_updated":"2026-06-01T15:21:41Z","snapshot_observed_at":"2026-08-14T09:20:36.323233Z","submitted_at":"2026-06-01T15:21:41Z","title":"Harness-1: Reinforcement Learning for Search Agents with State-Externalizing Harnesses","version":1},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-06-28T14:25:08.052988Z"},"links":{"cited_paper":"/paper/2501.14249","citing_paper":"/paper/2606.02373"},"observation_digest":"sha256:7aa29c0631d83748c5ad15197c9fa16c7edce48357305325cb08dc1702c909b3","observation_id":"7824055c-6fb7-4d32-9f88-6e4283fff520","resolution":{"observed_at":"2026-07-01T23:26:22.059986Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-03T22:08:32.844211+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-03T22:08:32.844211+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:25:08.052988Z","title":"2026 , eprint=","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2606.02373","last_updated":"2026-06-01T15:21:41Z","snapshot_observed_at":"2026-08-14T09:20:36.323233Z","submitted_at":"2026-06-01T15:21:41Z","title":"Harness-1: Reinforcement Learning for Search Agents with State-Externalizing Harnesses","version":1},"reference_index":63,"source":"arxiv_source","source_observed_at":"2026-06-28T14:25:08.052988Z"},"links":{"citing_paper":"/paper/2606.02373"},"observation_digest":"sha256:8d2e4de12b88267b309c885909a2c4ce71f9c99919e958737dc3718c0654f11d","observation_id":"49ada973-5248-441c-8a8d-5fe0a1bb938a","resolution":{"observed_at":"2026-06-28T14:25:08.052988Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:25:08.052988Z","title":"Proceedings of the 2025 Conference on Empirical Methods in Natural Language Processing , pages=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.02373","last_updated":"2026-06-01T15:21:41Z","snapshot_observed_at":"2026-08-14T09:20:36.323233Z","submitted_at":"2026-06-01T15:21:41Z","title":"Harness-1: Reinforcement Learning for Search Agents with State-Externalizing Harnesses","version":1},"reference_index":65,"source":"arxiv_source","source_observed_at":"2026-06-28T14:25:08.052988Z"},"links":{"citing_paper":"/paper/2606.02373"},"observation_digest":"sha256:a6ec7197916d29de87396fdebb994245cf6df70b2584877294451f9c745b7352","observation_id":"261b2d3f-9db6-4989-8988-fd73daeca72a","resolution":{"observed_at":"2026-06-28T14:25:08.052988Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:25:08.052988Z","title":"Introducing swe-grep and swe-grep-mini: Rl for multi-turn, fast context retrieval","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.02373","last_updated":"2026-06-01T15:21:41Z","snapshot_observed_at":"2026-08-14T09:20:36.323233Z","submitted_at":"2026-06-01T15:21:41Z","title":"Harness-1: Reinforcement Learning for Search Agents with State-Externalizing Harnesses","version":1},"reference_index":66,"source":"arxiv_source","source_observed_at":"2026-06-28T14:25:08.052988Z"},"links":{"citing_paper":"/paper/2606.02373"},"observation_digest":"sha256:cacd74134cdafdeccf6dd8f69af6a11904902d84b82ba6549e764da0a454e496","observation_id":"53252afc-447f-46f4-9a74-b59d115fec7b","resolution":{"observed_at":"2026-06-28T14:25:08.052988Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:25:08.052988Z","title":"Chroma context-1: Training a self-editing search agent","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2606.02373","last_updated":"2026-06-01T15:21:41Z","snapshot_observed_at":"2026-08-14T09:20:36.323233Z","submitted_at":"2026-06-01T15:21:41Z","title":"Harness-1: Reinforcement Learning for Search Agents with State-Externalizing Harnesses","version":1},"reference_index":67,"source":"arxiv_source","source_observed_at":"2026-06-28T14:25:08.052988Z"},"links":{"citing_paper":"/paper/2606.02373"},"observation_digest":"sha256:bc0621afea811755cff4bc76e7e6902a40324abda5fa2a55f62cbbc1e996446c","observation_id":"e90eb068-5c46-497d-b2e3-bb3f8e597f8a","resolution":{"observed_at":"2026-06-28T14:25:08.052988Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.13585","last_updated":"2025-06-16T15:08:02Z","snapshot_observed_at":"2026-08-13T22:06:45.477681Z","submitted_at":"2025-06-16T15:08:02Z","title":"MiniMax-M1: Scaling Test-Time Compute Efficiently with Lightning Attention","version":1},"cited_work":{"arxiv_id":"2506.13585","doi":"10.1109/tkde.2022.3168611","metadata_source":"pith","pith_arxiv_id":"2506.13585","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"MiniMax-M1: Scaling Test-Time Compute Efficiently with Lightning Attention","venue":"cs.CL","work_id":"c59fbe20-f41e-4140-a81c-40a12e7e8364","year":2025},"citing_paper":{"arxiv_id":"2606.02373","last_updated":"2026-06-01T15:21:41Z","snapshot_observed_at":"2026-08-14T09:20:36.323233Z","submitted_at":"2026-06-01T15:21:41Z","title":"Harness-1: Reinforcement Learning for Search Agents with State-Externalizing Harnesses","version":1},"reference_index":68,"source":"arxiv_source","source_observed_at":"2026-06-28T14:25:08.052988Z"},"links":{"cited_paper":"/paper/2506.13585","citing_paper":"/paper/2606.02373"},"observation_digest":"sha256:81adecd764a7e051546e79baac308acdf633578182149d7f752d65aa66c3b5a2","observation_id":"2dbb7668-e0ee-4cf6-b1c9-42c231482f3b","resolution":{"observed_at":"2026-07-01T23:26:22.117948Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:25:08.052988Z","title":"Apex-searcher: Augmenting llms' search capabilities through agentic planning and execution, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2606.02373","last_updated":"2026-06-01T15:21:41Z","snapshot_observed_at":"2026-08-14T09:20:36.323233Z","submitted_at":"2026-06-01T15:21:41Z","title":"Harness-1: Reinforcement Learning for Search Agents with State-Externalizing Harnesses","version":1},"reference_index":69,"source":"arxiv_source","source_observed_at":"2026-06-28T14:25:08.052988Z"},"links":{"citing_paper":"/paper/2606.02373"},"observation_digest":"sha256:b48f90ae14575a61e06879fb409a9ab85f6942371e40bfc5bff9312d1ce565db","observation_id":"f5bdb31a-6718-4b47-96b0-31b22de33cf4","resolution":{"observed_at":"2026-06-28T14:25:08.052988Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:25:08.052988Z","title":"Pan, Wen Zhang, Huajun Chen, Fan Yang, Zenan Zhou, and Weipeng Chen","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.02373","last_updated":"2026-06-01T15:21:41Z","snapshot_observed_at":"2026-08-14T09:20:36.323233Z","submitted_at":"2026-06-01T15:21:41Z","title":"Harness-1: Reinforcement Learning for Search Agents with State-Externalizing Harnesses","version":1},"reference_index":70,"source":"arxiv_source","source_observed_at":"2026-06-28T14:25:08.052988Z"},"links":{"citing_paper":"/paper/2606.02373"},"observation_digest":"sha256:38008313ebc90ffca8e9a23a684b54c624c6c26cbd2005181326a03747976cd7","observation_id":"9e19d15c-320b-4d9f-b8b3-4b7fe1a27b37","resolution":{"observed_at":"2026-06-28T14:25:08.052988Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:25:08.052988Z","title":"Browsecomp-plus: A more fair and transparent evaluation benchmark of deep-research agent, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.02373","last_updated":"2026-06-01T15:21:41Z","snapshot_observed_at":"2026-08-14T09:20:36.323233Z","submitted_at":"2026-06-01T15:21:41Z","title":"Harness-1: Reinforcement Learning for Search Agents with State-Externalizing Harnesses","version":1},"reference_index":71,"source":"arxiv_source","source_observed_at":"2026-06-28T14:25:08.052988Z"},"links":{"citing_paper":"/paper/2606.02373"},"observation_digest":"sha256:cd54a8bed1e521e1a6a6031747acb9dad5ae5eb6b77088242b91e20861981d47","observation_id":"bb28519c-26e8-4992-b9c1-a6e4e1848bab","resolution":{"observed_at":"2026-06-28T14:25:08.052988Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:25:08.052988Z","title":"Atom-searcher: Enhancing agentic deep research via fine-grained atomic thought reward, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.02373","last_updated":"2026-06-01T15:21:41Z","snapshot_observed_at":"2026-08-14T09:20:36.323233Z","submitted_at":"2026-06-01T15:21:41Z","title":"Harness-1: Reinforcement Learning for Search Agents with State-Externalizing Harnesses","version":1},"reference_index":72,"source":"arxiv_source","source_observed_at":"2026-06-28T14:25:08.052988Z"},"links":{"citing_paper":"/paper/2606.02373"},"observation_digest":"sha256:f71c2baaf885fc6f2e7b709488b10e8d4b5d2b97c2306a1323b454aba67c04a6","observation_id":"8d91d287-ce9d-4c80-b54e-9265ada45de7","resolution":{"observed_at":"2026-06-28T14:25:08.052988Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:25:08.052988Z","title":"Beyond ten turns: Unlocking long-horizon agentic search with large-scale asynchronous rl, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.02373","last_updated":"2026-06-01T15:21:41Z","snapshot_observed_at":"2026-08-14T09:20:36.323233Z","submitted_at":"2026-06-01T15:21:41Z","title":"Harness-1: Reinforcement Learning for Search Agents with State-Externalizing Harnesses","version":1},"reference_index":73,"source":"arxiv_source","source_observed_at":"2026-06-28T14:25:08.052988Z"},"links":{"citing_paper":"/paper/2606.02373"},"observation_digest":"sha256:ab9ca5eb51f8c0b5a5cfcb2e080cce5b6747126ec00042a28e226e4cbf525511","observation_id":"ccb3a424-6fa6-46ec-8606-1c2dd4ea0192","resolution":{"observed_at":"2026-06-28T14:25:08.052988Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:25:08.052988Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.02373","last_updated":"2026-06-01T15:21:41Z","snapshot_observed_at":"2026-08-14T09:20:36.323233Z","submitted_at":"2026-06-01T15:21:41Z","title":"Harness-1: Reinforcement Learning for Search Agents with State-Externalizing Harnesses","version":1},"reference_index":74,"source":"arxiv_source","source_observed_at":"2026-06-28T14:25:08.052988Z"},"links":{"citing_paper":"/paper/2606.02373"},"observation_digest":"sha256:1085b2d3724f280d6e2aaa4e7e54df07d91201ca93b4aa423eb843206e269ee9","observation_id":"1ef8a40e-e995-4aa0-a92a-f22e92635786","resolution":{"observed_at":"2026-06-28T14:25:08.052988Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:25:08.052988Z","title":"Michael Alvarez","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.02373","last_updated":"2026-06-01T15:21:41Z","snapshot_observed_at":"2026-08-14T09:20:36.323233Z","submitted_at":"2026-06-01T15:21:41Z","title":"Harness-1: Reinforcement Learning for Search Agents with State-Externalizing Harnesses","version":1},"reference_index":75,"source":"arxiv_source","source_observed_at":"2026-06-28T14:25:08.052988Z"},"links":{"citing_paper":"/paper/2606.02373"},"observation_digest":"sha256:daca8498d60cbfc74ab2ec7e7ca5496edfeae96b59209f2896e47796a24c1656","observation_id":"90bb7c06-5fea-4142-8148-131658aab4d2","resolution":{"observed_at":"2026-06-28T14:25:08.052988Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:25:08.052988Z","title":"Steer2adapt: Dynamically composing steering vectors elicits efficient adaptation of llms, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2606.02373","last_updated":"2026-06-01T15:21:41Z","snapshot_observed_at":"2026-08-14T09:20:36.323233Z","submitted_at":"2026-06-01T15:21:41Z","title":"Harness-1: Reinforcement Learning for Search Agents with State-Externalizing Harnesses","version":1},"reference_index":76,"source":"arxiv_source","source_observed_at":"2026-06-28T14:25:08.052988Z"},"links":{"citing_paper":"/paper/2606.02373"},"observation_digest":"sha256:296554a9dc8acdbf1a4ec17613def5e441e255688728f25844f1ba18698a4c46","observation_id":"5088f26f-45b4-4378-b598-62e47ab24c1b","resolution":{"observed_at":"2026-06-28T14:25:08.052988Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:25:08.052988Z","title":"Context rot: How increasing input tokens impacts llm performance","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.02373","last_updated":"2026-06-01T15:21:41Z","snapshot_observed_at":"2026-08-14T09:20:36.323233Z","submitted_at":"2026-06-01T15:21:41Z","title":"Harness-1: Reinforcement Learning for Search Agents with State-Externalizing Harnesses","version":1},"reference_index":77,"source":"arxiv_source","source_observed_at":"2026-06-28T14:25:08.052988Z"},"links":{"citing_paper":"/paper/2606.02373"},"observation_digest":"sha256:a2e2ef55034f8cdc23a941c9257002519fdb7a57fe72ba1543ce495af3d345f9","observation_id":"606aea60-8241-4a48-8d45-c641cc76035d","resolution":{"observed_at":"2026-06-28T14:25:08.052988Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:25:08.052988Z","title":"Reinforce++: Stabilizing critic-free policy optimization with global advantage normalization, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.02373","last_updated":"2026-06-01T15:21:41Z","snapshot_observed_at":"2026-08-14T09:20:36.323233Z","submitted_at":"2026-06-01T15:21:41Z","title":"Harness-1: Reinforcement Learning for Search Agents with State-Externalizing Harnesses","version":1},"reference_index":78,"source":"arxiv_source","source_observed_at":"2026-06-28T14:25:08.052988Z"},"links":{"citing_paper":"/paper/2606.02373"},"observation_digest":"sha256:899419971dad1107f82b58214821818221abcddd780c32ad993cad34eced6dff","observation_id":"fca8cb7c-d90c-4a6b-b03a-6764e04680d5","resolution":{"observed_at":"2026-06-28T14:25:08.052988Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.00223","last_updated":"2025-04-12T03:17:26Z","snapshot_observed_at":"2026-08-13T19:45:21.517834Z","submitted_at":"2025-02-28T22:16:42Z","title":"DeepRetrieval: Hacking Real Search Engines and Retrievers with Large Language Models via Reinforcement Learning","version":3},"cited_work":{"arxiv_id":"2503.00223","doi":"10.48550/arxiv.2503.00223","metadata_source":"arxiv_reference","pith_arxiv_id":"2503.00223","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Deepretrieval: Hacking real search engines and retrievers with large language models via reinforcement learning","venue":"ArXiv.org","work_id":"9a13be45-57b7-49e8-8e18-06262212ada5","year":2025},"citing_paper":{"arxiv_id":"2606.02373","last_updated":"2026-06-01T15:21:41Z","snapshot_observed_at":"2026-08-14T09:20:36.323233Z","submitted_at":"2026-06-01T15:21:41Z","title":"Harness-1: Reinforcement Learning for Search Agents with State-Externalizing Harnesses","version":1},"reference_index":79,"source":"arxiv_source","source_observed_at":"2026-06-28T14:25:08.052988Z"},"links":{"cited_paper":"/paper/2503.00223","citing_paper":"/paper/2606.02373"},"observation_digest":"sha256:b50a22722eefdc1cfebcfdd997715be426ea9190b3dd4185c4022d4bde057443","observation_id":"7dc89a95-3121-49e1-9d73-4dd2d5ec0194","resolution":{"observed_at":"2026-07-01T23:26:22.121774Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:25:08.052988Z","title":"Adaptation of agentic ai: A survey of post-training, memory, and skills, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2606.02373","last_updated":"2026-06-01T15:21:41Z","snapshot_observed_at":"2026-08-14T09:20:36.323233Z","submitted_at":"2026-06-01T15:21:41Z","title":"Harness-1: Reinforcement Learning for Search Agents with State-Externalizing Harnesses","version":1},"reference_index":80,"source":"arxiv_source","source_observed_at":"2026-06-28T14:25:08.052988Z"},"links":{"citing_paper":"/paper/2606.02373"},"observation_digest":"sha256:5ce271788299fb9669b1087daf255dcdbc5e58abdea28610d2ebcfebddc0c89c","observation_id":"0ce5068c-c9d8-4d70-aecf-eb16f5a1b9ba","resolution":{"observed_at":"2026-06-28T14:25:08.052988Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:25:08.052988Z","title":"s3: You don ' t need that much data to train a search agent via RL","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.02373","last_updated":"2026-06-01T15:21:41Z","snapshot_observed_at":"2026-08-14T09:20:36.323233Z","submitted_at":"2026-06-01T15:21:41Z","title":"Harness-1: Reinforcement Learning for Search Agents with State-Externalizing Harnesses","version":1},"reference_index":81,"source":"arxiv_source","source_observed_at":"2026-06-28T14:25:08.052988Z"},"links":{"citing_paper":"/paper/2606.02373"},"observation_digest":"sha256:9e2f3f7cc245ae0396630ce501e8006da481ee7c6e099dfc5a1381a173cfb91b","observation_id":"65bba525-7322-40b2-98d9-b0ca6abdb92f","resolution":{"observed_at":"2026-06-28T14:25:08.052988Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:25:08.052988Z","title":"Active retrieval augmented generation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.02373","last_updated":"2026-06-01T15:21:41Z","snapshot_observed_at":"2026-08-14T09:20:36.323233Z","submitted_at":"2026-06-01T15:21:41Z","title":"Harness-1: Reinforcement Learning for Search Agents with State-Externalizing Harnesses","version":1},"reference_index":82,"source":"arxiv_source","source_observed_at":"2026-06-28T14:25:08.052988Z"},"links":{"citing_paper":"/paper/2606.02373"},"observation_digest":"sha256:fd5ab368c3f54e24a81ebd81e1872310b633ab71b742deef5cd2471b11a9c096","observation_id":"0117e6c8-9bdb-4257-aa37-27501e422d23","resolution":{"observed_at":"2026-06-28T14:25:08.052988Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.09516","last_updated":"2025-08-05T19:08:38Z","snapshot_observed_at":"2026-08-15T13:17:00.526689Z","submitted_at":"2025-03-12T16:26:39Z","title":"Search-R1: Training LLMs to Reason and Leverage Search Engines with Reinforcement Learning","version":5},"cited_work":{"arxiv_id":"2503.09516","doi":"10.48550/arxiv.2503.09516","metadata_source":"pith","pith_arxiv_id":"2503.09516","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Search-R1: Training LLMs to Reason and Leverage Search Engines with Reinforcement Learning","venue":"cs.CL","work_id":"0e0b7549-2bc4-4574-aa7f-588ffa16eaae","year":2025},"citing_paper":{"arxiv_id":"2606.02373","last_updated":"2026-06-01T15:21:41Z","snapshot_observed_at":"2026-08-14T09:20:36.323233Z","submitted_at":"2026-06-01T15:21:41Z","title":"Harness-1: Reinforcement Learning for Search Agents with State-Externalizing Harnesses","version":1},"reference_index":83,"source":"arxiv_source","source_observed_at":"2026-06-28T14:25:08.052988Z"},"links":{"cited_paper":"/paper/2503.09516","citing_paper":"/paper/2606.02373"},"observation_digest":"sha256:54e36a4db0693e537b8c421f3ef22b8d253fd1aeebb8e358585974fe0906daed","observation_id":"05f1bd12-fbc7-4f75-a5a9-78d3ff1bff30","resolution":{"observed_at":"2026-07-01T23:26:22.087863Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:25:08.052988Z","title":"Dhillon, David Brandfonbrener, and Rishabh Agarwal","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.02373","last_updated":"2026-06-01T15:21:41Z","snapshot_observed_at":"2026-08-14T09:20:36.323233Z","submitted_at":"2026-06-01T15:21:41Z","title":"Harness-1: Reinforcement Learning for Search Agents with State-Externalizing Harnesses","version":1},"reference_index":84,"source":"arxiv_source","source_observed_at":"2026-06-28T14:25:08.052988Z"},"links":{"citing_paper":"/paper/2606.02373"},"observation_digest":"sha256:1901aa2ee5b925a103e5df1b4238d4fa5c564048d1d5e707f2f4d63e9ba5c653","observation_id":"07dfba9e-7213-48a9-85fb-1f6ec103d405","resolution":{"observed_at":"2026-06-28T14:25:08.052988Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:25:08.052988Z","title":"Fact, fetch, and reason: A unified evaluation of retrieval-augmented generation","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.02373","last_updated":"2026-06-01T15:21:41Z","snapshot_observed_at":"2026-08-14T09:20:36.323233Z","submitted_at":"2026-06-01T15:21:41Z","title":"Harness-1: Reinforcement Learning for Search Agents with State-Externalizing Harnesses","version":1},"reference_index":85,"source":"arxiv_source","source_observed_at":"2026-06-28T14:25:08.052988Z"},"links":{"citing_paper":"/paper/2606.02373"},"observation_digest":"sha256:2696e57df90f0755a1c3fc4d84b8049fd9a24c174237cc0a447b157e94d81829","observation_id":"c451c1d2-92f8-44a3-89dc-540e6a51b254","resolution":{"observed_at":"2026-06-28T14:25:08.052988Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:25:08.052988Z","title":"Bowman, and Ethan Perez","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.02373","last_updated":"2026-06-01T15:21:41Z","snapshot_observed_at":"2026-08-14T09:20:36.323233Z","submitted_at":"2026-06-01T15:21:41Z","title":"Harness-1: Reinforcement Learning for Search Agents with State-Externalizing Harnesses","version":1},"reference_index":86,"source":"arxiv_source","source_observed_at":"2026-06-28T14:25:08.052988Z"},"links":{"citing_paper":"/paper/2606.02373"},"observation_digest":"sha256:2a0ad3c4c87c015649052d29c7d656a2c604d6fc131a4853949c3a8fa942fc9d","observation_id":"3e73a119-ce43-4baf-a078-2749bc1b9f06","resolution":{"observed_at":"2026-06-28T14:25:08.052988Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2603.28052","last_updated":"2026-03-30T05:33:50Z","snapshot_observed_at":"2026-08-11T05:18:08.192130Z","submitted_at":"2026-03-30T05:33:50Z","title":"Meta-Harness: End-to-End Optimization of Model Harnesses","version":1},"cited_work":{"arxiv_id":"2603.28052","doi":"10.48550/arxiv.2603.28052","metadata_source":"pith","pith_arxiv_id":"2603.28052","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Meta-Harness: End-to-End Optimization of Model Harnesses","venue":"cs.AI","work_id":"5be3c079-4ffa-458f-adcf-204b66f7af51","year":2026},"citing_paper":{"arxiv_id":"2606.02373","last_updated":"2026-06-01T15:21:41Z","snapshot_observed_at":"2026-08-14T09:20:36.323233Z","submitted_at":"2026-06-01T15:21:41Z","title":"Harness-1: Reinforcement Learning for Search Agents with State-Externalizing Harnesses","version":1},"reference_index":87,"source":"arxiv_source","source_observed_at":"2026-06-28T14:25:08.052988Z"},"links":{"cited_paper":"/paper/2603.28052","citing_paper":"/paper/2606.02373"},"observation_digest":"sha256:f68bb0345d46b6befdce713b767366e88bf18d50af2a53af1ee00b4a10f0384d","observation_id":"4a33fcb3-8902-4d72-a2d9-8da7cde33649","resolution":{"observed_at":"2026-07-01T23:26:22.091376Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:25:08.052988Z","title":"Websailor: Navigating super-human reasoning for web agent, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.02373","last_updated":"2026-06-01T15:21:41Z","snapshot_observed_at":"2026-08-14T09:20:36.323233Z","submitted_at":"2026-06-01T15:21:41Z","title":"Harness-1: Reinforcement Learning for Search Agents with State-Externalizing Harnesses","version":1},"reference_index":88,"source":"arxiv_source","source_observed_at":"2026-06-28T14:25:08.052988Z"},"links":{"citing_paper":"/paper/2606.02373"},"observation_digest":"sha256:32659ca62e146d06d523a59b6e26d6f6d9dedfacb3c9a9a52d35aab92c4b7099","observation_id":"75c7b63f-e457-4902-9550-33718825213e","resolution":{"observed_at":"2026-06-28T14:25:08.052988Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:25:08.052988Z","title":"Search-o1: Agentic search-enhanced large reasoning models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.02373","last_updated":"2026-06-01T15:21:41Z","snapshot_observed_at":"2026-08-14T09:20:36.323233Z","submitted_at":"2026-06-01T15:21:41Z","title":"Harness-1: Reinforcement Learning for Search Agents with State-Externalizing Harnesses","version":1},"reference_index":89,"source":"arxiv_source","source_observed_at":"2026-06-28T14:25:08.052988Z"},"links":{"citing_paper":"/paper/2606.02373"},"observation_digest":"sha256:a099e65b8660ae9a3cd2cd007cfc48ffbf6833dd796c486e5ec85db5dec79a18","observation_id":"1261f824-9203-4a7d-9928-7df4b56c3349","resolution":{"observed_at":"2026-06-28T14:25:08.052988Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:25:08.052988Z","title":"Webexplorer: Explore and evolve for training long-horizon web agents, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.02373","last_updated":"2026-06-01T15:21:41Z","snapshot_observed_at":"2026-08-14T09:20:36.323233Z","submitted_at":"2026-06-01T15:21:41Z","title":"Harness-1: Reinforcement Learning for Search Agents with State-Externalizing Harnesses","version":1},"reference_index":90,"source":"arxiv_source","source_observed_at":"2026-06-28T14:25:08.052988Z"},"links":{"citing_paper":"/paper/2606.02373"},"observation_digest":"sha256:ceb91b46ea012184a9b2a48e88bcefb3c66c3141e8a59d4468c8b01c2c177cc3","observation_id":"3812861e-4d54-4462-8061-d19b4477cc3a","resolution":{"observed_at":"2026-06-28T14:25:08.052988Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:25:08.052988Z","title":"Harness engineering: leveraging codex in an agent-first world, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2606.02373","last_updated":"2026-06-01T15:21:41Z","snapshot_observed_at":"2026-08-14T09:20:36.323233Z","submitted_at":"2026-06-01T15:21:41Z","title":"Harness-1: Reinforcement Learning for Search Agents with State-Externalizing Harnesses","version":1},"reference_index":91,"source":"arxiv_source","source_observed_at":"2026-06-28T14:25:08.052988Z"},"links":{"citing_paper":"/paper/2606.02373"},"observation_digest":"sha256:34a993f01b0cc7aee0b75ae123f5559227518fa3ef5a7785662955a86c5786ce","observation_id":"6c9dbb0f-e733-4fce-84e7-b519faf08016","resolution":{"observed_at":"2026-06-28T14:25:08.052988Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:25:08.052988Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2606.02373","last_updated":"2026-06-01T15:21:41Z","snapshot_observed_at":"2026-08-14T09:20:36.323233Z","submitted_at":"2026-06-01T15:21:41Z","title":"Harness-1: Reinforcement Learning for Search Agents with State-Externalizing Harnesses","version":1},"reference_index":92,"source":"arxiv_source","source_observed_at":"2026-06-28T14:25:08.052988Z"},"links":{"citing_paper":"/paper/2606.02373"},"observation_digest":"sha256:de2abdc36226dd0d9d9d25c66f83e58e1e553e838547fe4d975102ee24263ffb","observation_id":"146124d1-3134-4816-af85-01bcbf1184cf","resolution":{"observed_at":"2026-06-28T14:25:08.052988Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:25:08.052988Z","title":"Scaling managed agents: Decoupling the brain from the hands","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2606.02373","last_updated":"2026-06-01T15:21:41Z","snapshot_observed_at":"2026-08-14T09:20:36.323233Z","submitted_at":"2026-06-01T15:21:41Z","title":"Harness-1: Reinforcement Learning for Search Agents with State-Externalizing Harnesses","version":1},"reference_index":93,"source":"arxiv_source","source_observed_at":"2026-06-28T14:25:08.052988Z"},"links":{"citing_paper":"/paper/2606.02373"},"observation_digest":"sha256:31d1cd8223cc4a8bac67d3de0654c0492766c203c4e403ed9541dc231f766cae","observation_id":"614dafa1-23f0-4716-ad27-4b46d60cccc1","resolution":{"observed_at":"2026-06-28T14:25:08.052988Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:25:08.052988Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.02373","last_updated":"2026-06-01T15:21:41Z","snapshot_observed_at":"2026-08-14T09:20:36.323233Z","submitted_at":"2026-06-01T15:21:41Z","title":"Harness-1: Reinforcement Learning for Search Agents with State-Externalizing Harnesses","version":1},"reference_index":94,"source":"arxiv_source","source_observed_at":"2026-06-28T14:25:08.052988Z"},"links":{"citing_paper":"/paper/2606.02373"},"observation_digest":"sha256:bb3744f5f0570ef3db2cae5ed890ecd9846524338f3112f0ff585da2808df3f1","observation_id":"e7329441-923c-4052-91b1-38c968fcb6fc","resolution":{"observed_at":"2026-06-28T14:25:08.052988Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:25:08.052988Z","title":"Patil, Ion Stoica, and Joseph E","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.02373","last_updated":"2026-06-01T15:21:41Z","snapshot_observed_at":"2026-08-14T09:20:36.323233Z","submitted_at":"2026-06-01T15:21:41Z","title":"Harness-1: Reinforcement Learning for Search Agents with State-Externalizing Harnesses","version":1},"reference_index":95,"source":"arxiv_source","source_observed_at":"2026-06-28T14:25:08.052988Z"},"links":{"citing_paper":"/paper/2606.02373"},"observation_digest":"sha256:c6bb00f35871e1f6c68ac663614672b72bf73e7daa518e20381a3ccc5eaa9727","observation_id":"dec39293-a115-4666-a911-4ac85505732e","resolution":{"observed_at":"2026-06-28T14:25:08.052988Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.01062","last_updated":"2026-04-09T17:44:11Z","snapshot_observed_at":"2026-08-15T19:35:47.983999Z","submitted_at":"2025-06-01T16:04:34Z","title":"SealQA: Raising the Bar for Reasoning in Search-Augmented Language Models","version":4},"cited_work":{"arxiv_id":"2506.01062","doi":"10.48550/arxiv.2506.01062","metadata_source":"pith","pith_arxiv_id":"2506.01062","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"SealQA: Raising the Bar for Reasoning in Search-Augmented Language Models","venue":"cs.CL","work_id":"92de1187-b15f-439e-9005-9178cb024209","year":2025},"citing_paper":{"arxiv_id":"2606.02373","last_updated":"2026-06-01T15:21:41Z","snapshot_observed_at":"2026-08-14T09:20:36.323233Z","submitted_at":"2026-06-01T15:21:41Z","title":"Harness-1: Reinforcement Learning for Search Agents with State-Externalizing Harnesses","version":1},"reference_index":96,"source":"arxiv_source","source_observed_at":"2026-06-28T14:25:08.052988Z"},"links":{"cited_paper":"/paper/2506.01062","citing_paper":"/paper/2606.02373"},"observation_digest":"sha256:ac9ba664100eb60bbf178ab2a5032495a3c60bee1121cf0687c043e7b4521b9e","observation_id":"10b7a040-8f93-47e6-b853-2e4fe98f5f78","resolution":{"observed_at":"2026-07-01T23:26:22.103075Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:25:08.052988Z","title":"Measuring and narrowing the compositionality gap in language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.02373","last_updated":"2026-06-01T15:21:41Z","snapshot_observed_at":"2026-08-14T09:20:36.323233Z","submitted_at":"2026-06-01T15:21:41Z","title":"Harness-1: Reinforcement Learning for Search Agents with State-Externalizing Harnesses","version":1},"reference_index":97,"source":"arxiv_source","source_observed_at":"2026-06-28T14:25:08.052988Z"},"links":{"citing_paper":"/paper/2606.02373"},"observation_digest":"sha256:b67205fa1bca5f12a5d50853f9da4410116fbcc2882654d57084b58f47803237","observation_id":"62e1da60-e49f-4a7c-80c4-3faf73bcbd48","resolution":{"observed_at":"2026-06-28T14:25:08.052988Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:25:08.052988Z","title":"Toolllm: Facilitating large language models to master 16000+ real-world apis, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.02373","last_updated":"2026-06-01T15:21:41Z","snapshot_observed_at":"2026-08-14T09:20:36.323233Z","submitted_at":"2026-06-01T15:21:41Z","title":"Harness-1: Reinforcement Learning for Search Agents with State-Externalizing Harnesses","version":1},"reference_index":98,"source":"arxiv_source","source_observed_at":"2026-06-28T14:25:08.052988Z"},"links":{"citing_paper":"/paper/2606.02373"},"observation_digest":"sha256:c0419603caee1654365f01ec2ff5f4597460da3045f13ca64f684e19b6236c14","observation_id":"462c1a5d-011d-4306-a9cc-a73b8c306257","resolution":{"observed_at":"2026-06-28T14:25:08.052988Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:25:08.052988Z","title":"Proximal policy optimization algorithms, 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2606.02373","last_updated":"2026-06-01T15:21:41Z","snapshot_observed_at":"2026-08-14T09:20:36.323233Z","submitted_at":"2026-06-01T15:21:41Z","title":"Harness-1: Reinforcement Learning for Search Agents with State-Externalizing Harnesses","version":1},"reference_index":99,"source":"arxiv_source","source_observed_at":"2026-06-28T14:25:08.052988Z"},"links":{"citing_paper":"/paper/2606.02373"},"observation_digest":"sha256:fa9b2cc3e9e34cb77c8f7a85c85209f3286198de719118d448d871543640e02f","observation_id":"06f2951b-f1c4-412e-a596-aeec62a96566","resolution":{"observed_at":"2026-06-28T14:25:08.052988Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2604.20938","last_updated":"2026-04-22T13:45:12Z","snapshot_observed_at":"2026-07-06T23:07:36.996629Z","submitted_at":"2026-04-22T13:45:12Z","title":"HARBOR: Automated Harness Optimization","version":1},"cited_work":{"arxiv_id":"2604.20938","doi":null,"metadata_source":"pith","pith_arxiv_id":"2604.20938","snapshot_observed_at":"2026-07-01T23:26:22.093109Z","title":"HARBOR: Automated Harness Optimization","venue":"cs.LG","work_id":"9cf8c87e-838f-4464-be18-b0aa3bbe1892","year":2026},"citing_paper":{"arxiv_id":"2606.02373","last_updated":"2026-06-01T15:21:41Z","snapshot_observed_at":"2026-08-14T09:20:36.323233Z","submitted_at":"2026-06-01T15:21:41Z","title":"Harness-1: Reinforcement Learning for Search Agents with State-Externalizing Harnesses","version":1},"reference_index":100,"source":"arxiv_source","source_observed_at":"2026-06-28T14:25:08.052988Z"},"links":{"cited_paper":"/paper/2604.20938","citing_paper":"/paper/2606.02373"},"observation_digest":"sha256:9a9b550d984aeb516e38e0814ad6312e245063674b5fe7436e5347491f07ffaf","observation_id":"5d122814-3995-47d7-b56d-bc40d2235f33","resolution":{"observed_at":"2026-07-01T23:26:22.095043Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.05592","last_updated":"2025-03-18T08:32:24Z","snapshot_observed_at":"2026-08-15T04:19:26.319323Z","submitted_at":"2025-03-07T17:14:44Z","title":"R1-Searcher: Incentivizing the Search Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"2503.05592","doi":"10.48550/arxiv.2503.05592","metadata_source":"pith","pith_arxiv_id":"2503.05592","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"R1-Searcher: Incentivizing the Search Capability in LLMs via Reinforcement Learning","venue":"cs.AI","work_id":"f5ed73d2-f2ff-4cf6-853d-3586333e44ef","year":2025},"citing_paper":{"arxiv_id":"2606.02373","last_updated":"2026-06-01T15:21:41Z","snapshot_observed_at":"2026-08-14T09:20:36.323233Z","submitted_at":"2026-06-01T15:21:41Z","title":"Harness-1: Reinforcement Learning for Search Agents with State-Externalizing Harnesses","version":1},"reference_index":101,"source":"arxiv_source","source_observed_at":"2026-06-28T14:25:08.052988Z"},"links":{"cited_paper":"/paper/2503.05592","citing_paper":"/paper/2606.02373"},"observation_digest":"sha256:ff53004ee6061b65cb9c8eb68c422edd22a06b7fdd201614cc56da5c009f2f58","observation_id":"9d062346-98d9-4a07-8446-fe46801c7d1d","resolution":{"observed_at":"2026-07-01T23:26:22.072581Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:25:08.052988Z","title":"Toolorchestra: Elevating intelligence via efficient model and tool orchestration, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.02373","last_updated":"2026-06-01T15:21:41Z","snapshot_observed_at":"2026-08-14T09:20:36.323233Z","submitted_at":"2026-06-01T15:21:41Z","title":"Harness-1: Reinforcement Learning for Search Agents with State-Externalizing Harnesses","version":1},"reference_index":102,"source":"arxiv_source","source_observed_at":"2026-06-28T14:25:08.052988Z"},"links":{"citing_paper":"/paper/2606.02373"},"observation_digest":"sha256:bcbb3f1203efb80425f7ea4f4a72b5491ba7b10b574ca260f8c8d160c2965e0a","observation_id":"a140e10e-b646-4609-89d6-70343a74e450","resolution":{"observed_at":"2026-06-28T14:25:08.052988Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:25:08.052988Z","title":"Decouplesearch: Decouple planning and search via hierarchical reward modeling","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.02373","last_updated":"2026-06-01T15:21:41Z","snapshot_observed_at":"2026-08-14T09:20:36.323233Z","submitted_at":"2026-06-01T15:21:41Z","title":"Harness-1: Reinforcement Learning for Search Agents with State-Externalizing Harnesses","version":1},"reference_index":103,"source":"arxiv_source","source_observed_at":"2026-06-28T14:25:08.052988Z"},"links":{"citing_paper":"/paper/2606.02373"},"observation_digest":"sha256:c15e16864eb3f700f9ca54e5053d5e4121f72545e09d98b8fc8a99f2d0c38664","observation_id":"1877b91a-498e-476b-9c4f-73a458cbcb14","resolution":{"observed_at":"2026-06-28T14:25:08.052988Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2510.24701","last_updated":"2026-05-18T04:10:32Z","snapshot_observed_at":"2026-07-06T22:34:18.297603Z","submitted_at":"2025-10-28T17:53:02Z","title":"Tongyi DeepResearch Technical Report","version":3},"cited_work":{"arxiv_id":"2510.24701","doi":"10.48550/arxiv.2510.24701","metadata_source":"pith","pith_arxiv_id":"2510.24701","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Tongyi DeepResearch Technical Report","venue":"cs.CL","work_id":"1c8db01b-b50f-4711-b181-a04bcc3e9aa8","year":2025},"citing_paper":{"arxiv_id":"2606.02373","last_updated":"2026-06-01T15:21:41Z","snapshot_observed_at":"2026-08-14T09:20:36.323233Z","submitted_at":"2026-06-01T15:21:41Z","title":"Harness-1: Reinforcement Learning for Search Agents with State-Externalizing Harnesses","version":1},"reference_index":104,"source":"arxiv_source","source_observed_at":"2026-06-28T14:25:08.052988Z"},"links":{"cited_paper":"/paper/2510.24701","citing_paper":"/paper/2606.02373"},"observation_digest":"sha256:11dce1dd42c376446668672f23a26f2fe520b08831a00a1b7a3ebc3762eafe8c","observation_id":"51bf1f54-a9ce-474a-bb9f-1536d6341df6","resolution":{"observed_at":"2026-07-01T23:26:22.076290Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:25:08.052988Z","title":"Interleaving retrieval with chain-of-thought reasoning for knowledge-intensive multi-step questions","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.02373","last_updated":"2026-06-01T15:21:41Z","snapshot_observed_at":"2026-08-14T09:20:36.323233Z","submitted_at":"2026-06-01T15:21:41Z","title":"Harness-1: Reinforcement Learning for Search Agents with State-Externalizing Harnesses","version":1},"reference_index":105,"source":"arxiv_source","source_observed_at":"2026-06-28T14:25:08.052988Z"},"links":{"citing_paper":"/paper/2606.02373"},"observation_digest":"sha256:ee0a226aad42d0af47abab258db3d1e63c894312f5d0c6999106473c42672c82","observation_id":"a4672d20-21c6-4a52-b30c-45c481ac8d7a","resolution":{"observed_at":"2026-06-28T14:25:08.052988Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:25:08.052988Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.02373","last_updated":"2026-06-01T15:21:41Z","snapshot_observed_at":"2026-08-14T09:20:36.323233Z","submitted_at":"2026-06-01T15:21:41Z","title":"Harness-1: Reinforcement Learning for Search Agents with State-Externalizing Harnesses","version":1},"reference_index":106,"source":"arxiv_source","source_observed_at":"2026-06-28T14:25:08.052988Z"},"links":{"citing_paper":"/paper/2606.02373"},"observation_digest":"sha256:1cbab94da02010790f95774dd148861ed7f3b66dca253215839255990060a08d","observation_id":"3652ee58-b3fb-4925-bd75-fa1edcb1cf17","resolution":{"observed_at":"2026-06-28T14:25:08.052988Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:25:08.052988Z","title":"USPTO Open Data Portal","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2606.02373","last_updated":"2026-06-01T15:21:41Z","snapshot_observed_at":"2026-08-14T09:20:36.323233Z","submitted_at":"2026-06-01T15:21:41Z","title":"Harness-1: Reinforcement Learning for Search Agents with State-Externalizing Harnesses","version":1},"reference_index":107,"source":"arxiv_source","source_observed_at":"2026-06-28T14:25:08.052988Z"},"links":{"citing_paper":"/paper/2606.02373"},"observation_digest":"sha256:fe447e6c45887ebf93aab67c7549229c87a2f5c682658d387a08429b68d88c1f","observation_id":"45a5daac-0171-4fc5-bf89-01c6816d5d5d","resolution":{"observed_at":"2026-06-28T14:25:08.052988Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:25:08.052988Z","title":"Securities and Exchange Commission","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.02373","last_updated":"2026-06-01T15:21:41Z","snapshot_observed_at":"2026-08-14T09:20:36.323233Z","submitted_at":"2026-06-01T15:21:41Z","title":"Harness-1: Reinforcement Learning for Search Agents with State-Externalizing Harnesses","version":1},"reference_index":108,"source":"arxiv_source","source_observed_at":"2026-06-28T14:25:08.052988Z"},"links":{"citing_paper":"/paper/2606.02373"},"observation_digest":"sha256:e6434cdc2cb37483ad4aa7dae7719037c7ce29779b628cbe36aa621886fd73c1","observation_id":"73c2e6de-5fcd-4e89-99de-8efdfbd566e7","resolution":{"observed_at":"2026-06-28T14:25:08.052988Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.20732","last_updated":"2025-05-27T05:21:04Z","snapshot_observed_at":"2026-08-14T01:19:35.519123Z","submitted_at":"2025-05-27T05:21:04Z","title":"SPA-RL: Reinforcing LLM Agents via Stepwise Progress Attribution","version":1},"cited_work":{"arxiv_id":"2505.20732","doi":"10.48550/arxiv.2505.20732","metadata_source":"pith","pith_arxiv_id":"2505.20732","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Spa-rl: Reinforcing llm agents via stepwise progress attribution","venue":"cs.CL","work_id":"bdf6b0d6-89db-4ff6-8ea9-29971abfcd69","year":2025},"citing_paper":{"arxiv_id":"2606.02373","last_updated":"2026-06-01T15:21:41Z","snapshot_observed_at":"2026-08-14T09:20:36.323233Z","submitted_at":"2026-06-01T15:21:41Z","title":"Harness-1: Reinforcement Learning for Search Agents with State-Externalizing Harnesses","version":1},"reference_index":109,"source":"arxiv_source","source_observed_at":"2026-06-28T14:25:08.052988Z"},"links":{"cited_paper":"/paper/2505.20732","citing_paper":"/paper/2606.02373"},"observation_digest":"sha256:904aae02388f5a7853da56b67b13b7c2c9e3ec8b6be4ce822b27c8765c24871b","observation_id":"b9f02781-c1f8-4734-b987-c1863f1b9afa","resolution":{"observed_at":"2026-07-01T23:26:22.069256Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.15107","last_updated":"2025-05-26T04:44:21Z","snapshot_observed_at":"2026-08-13T16:35:29.551646Z","submitted_at":"2025-05-21T05:01:31Z","title":"StepSearch: Igniting LLMs Search Ability via Step-Wise Proximal Policy Optimization","version":2},"cited_work":{"arxiv_id":"2505.15107","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.15107","snapshot_observed_at":"2026-07-08T13:04:56.727934Z","title":"Stepsearch: Igniting llms search ability via step-wise proximal policy optimization.arXiv preprint arXiv:2505.15107","venue":"cs.CL","work_id":"0c9eadf8-223b-4c81-a25c-3a46d830ba8b","year":2025},"citing_paper":{"arxiv_id":"2606.02373","last_updated":"2026-06-01T15:21:41Z","snapshot_observed_at":"2026-08-14T09:20:36.323233Z","submitted_at":"2026-06-01T15:21:41Z","title":"Harness-1: Reinforcement Learning for Search Agents with State-Externalizing Harnesses","version":1},"reference_index":110,"source":"arxiv_source","source_observed_at":"2026-06-28T14:25:08.052988Z"},"links":{"cited_paper":"/paper/2505.15107","citing_paper":"/paper/2606.02373"},"observation_digest":"sha256:5ad1e12ef2732962fce183f7db7a11242b984e941ed0b9c7a7c3db8804edfe28","observation_id":"80832a9b-e435-4a00-afdf-f06b668aa714","resolution":{"observed_at":"2026-07-01T23:26:22.099072Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:25:08.052988Z","title":"Webdancer: Towards autonomous information seeking agency, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.02373","last_updated":"2026-06-01T15:21:41Z","snapshot_observed_at":"2026-08-14T09:20:36.323233Z","submitted_at":"2026-06-01T15:21:41Z","title":"Harness-1: Reinforcement Learning for Search Agents with State-Externalizing Harnesses","version":1},"reference_index":111,"source":"arxiv_source","source_observed_at":"2026-06-28T14:25:08.052988Z"},"links":{"citing_paper":"/paper/2606.02373"},"observation_digest":"sha256:0cb877874b0f8c1265c0234934e71228f82bc489aabb9aaefe5fafc06eb16e22","observation_id":"25ad6795-52da-49e7-9bb6-490bee8d30b3","resolution":{"observed_at":"2026-06-28T14:25:08.052988Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.01489","last_updated":"2024-10-29T17:29:27Z","snapshot_observed_at":"2026-08-15T15:29:54.860240Z","submitted_at":"2024-07-01T17:24:45Z","title":"Agentless: Demystifying LLM-based Software Engineering Agents","version":2},"cited_work":{"arxiv_id":"2407.01489","doi":"10.48550/arxiv.2407.01489","metadata_source":"pith","pith_arxiv_id":"2407.01489","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Agentless: Demystifying LLM-based Software Engineering Agents","venue":"cs.SE","work_id":"71c901c4-3c83-4e10-af54-3daef7fff397","year":2024},"citing_paper":{"arxiv_id":"2606.02373","last_updated":"2026-06-01T15:21:41Z","snapshot_observed_at":"2026-08-14T09:20:36.323233Z","submitted_at":"2026-06-01T15:21:41Z","title":"Harness-1: Reinforcement Learning for Search Agents with State-Externalizing Harnesses","version":1},"reference_index":112,"source":"arxiv_source","source_observed_at":"2026-06-28T14:25:08.052988Z"},"links":{"cited_paper":"/paper/2407.01489","citing_paper":"/paper/2606.02373"},"observation_digest":"sha256:2bc4268ff3d19aeeaf9f9132201d7d205fe58b6d45c834e5b1b18262d41b4f3a","observation_id":"64a7d282-92b5-4bde-bcfa-50f2ff44876d","resolution":{"observed_at":"2026-07-01T23:26:22.080201Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-08T07:38:29.091144+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-08T07:38:29.091144+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:25:08.052988Z","title":"Demystifying llm-based software engineering agents","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.02373","last_updated":"2026-06-01T15:21:41Z","snapshot_observed_at":"2026-08-14T09:20:36.323233Z","submitted_at":"2026-06-01T15:21:41Z","title":"Harness-1: Reinforcement Learning for Search Agents with State-Externalizing Harnesses","version":1},"reference_index":113,"source":"arxiv_source","source_observed_at":"2026-06-28T14:25:08.052988Z"},"links":{"citing_paper":"/paper/2606.02373"},"observation_digest":"sha256:cccc4acd44c70a6c0bae4a338226b83fff5176893c4adbf6d9fc66b0b55c4e64","observation_id":"4d548640-d3db-4ad3-87f0-14703cf2f595","resolution":{"observed_at":"2026-06-28T14:25:08.052988Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2606.02373","last_updated":"2026-06-01T15:21:41Z","latest_version":1,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-14T09:20:36.323233Z","submitted_at":"2026-06-01T15:21:41Z","title":"Harness-1: Reinforcement Learning for Search Agents with State-Externalizing Harnesses"},"reference_resolution":{"displayed":100,"state_counts":{"malformed_identifier":0,"metadata_mismatch":5,"parse_uncertain":1,"unresolved":79,"verified_exact":15,"verified_fuzzy":0},"total_outbound_references":108},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"thesis":"As of 16 August 2026, this Paper Citation Record lists 100 of 108 outbound references and 2 inbound Pith citation observations for arXiv:2606.02373."}