Pith. sign in

Paper Citation Record · LEDGER

Harness-1: Reinforcement Learning for Search Agents with State-Externalizing Harnesses

As of 15 August 2026, this Paper Citation Record lists 100 of 108 outbound references and 2 inbound Pith citation observations for arXiv:2606.02373.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2606.02373 v1

Coverage vector

measured 100 of 108 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links, observed 2026-06-28T14:25:08.052988Z

measured 102 of 102 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-15T06:32:42.880941+00:00

measured 2 of 2 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links, observed 2026-08-08T13:01:09.120785Z

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: pith, observed 2026-08-08T13:01:09.639756Z

Reference resolution

100 of 108 outbound references displayed

  • verified exact15
  • verified fuzzy0
  • unresolved79
  • parse uncertain1
  • malformed identifier0
  • metadata mismatch5

External citation measurements

No source-named external measurement is stored.

Outbound references

Observation faaf47b4-b9a7-456b-b0f9-5d2237fb7076 · outbound

This paper cites Retrieval-augmented generation for knowledge-intensive NLP tasks , year =.

Harness-1: Reinforcement Learning for Search Agents with State-Externalizing Harnesses Retrieval-augmented generation for knowledge-intensive NLP tasks , year =

Reference 1

Resolution
unresolved
no resolver link, observed 2026-06-28T14:25:08.052988Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-06-28T14:25:08.052988Z digest=sha256:de31a195efc10dce2cbb8ba0031d2e84ef74873432cbc187394d9a474fe0b703

Observation e6fef523-bb81-4122-b6e4-dacaa672b1ae · outbound

This paper cites 2026 , eprint=.

Harness-1: Reinforcement Learning for Search Agents with State-Externalizing Harnesses 2026 , eprint=

Reference 2

Resolution
unresolved
no resolver link, observed 2026-06-28T14:25:08.052988Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-06-28T14:25:08.052988Z digest=sha256:c05184327548a393b2bf3118e78f63ec568ef4af4102e68b22c34d04f6a856eb

Observation 14b4ee63-034b-4aa6-bafb-8197b5d324a1 · outbound

This paper cites 2023 , eprint=.

Harness-1: Reinforcement Learning for Search Agents with State-Externalizing Harnesses 2023 , eprint=

Reference 3

Resolution
unresolved
no resolver link, observed 2026-06-28T14:25:08.052988Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-06-28T14:25:08.052988Z digest=sha256:76c7415e0ddf6a26d4eb5d33c12e5dfbfa80e7dfa33896c2b931472ca43a05ab

Observation 9aee9ca1-3c41-4882-98ac-80bf534ecd5a · outbound

This paper cites , title =.

Harness-1: Reinforcement Learning for Search Agents with State-Externalizing Harnesses , title =

Reference 4

Resolution
unresolved
no resolver link, observed 2026-06-28T14:25:08.052988Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-06-28T14:25:08.052988Z digest=sha256:84371ef2aab5f90054f2fb822326ab983e58b924b58679e19fffb33fb872a6cf

Observation dd96cb76-b4b9-49d1-8de5-1f06bede42e4 · outbound

This paper cites 2025 , eprint=.

Harness-1: Reinforcement Learning for Search Agents with State-Externalizing Harnesses 2025 , eprint=

Reference 5

Resolution
unresolved
no resolver link, observed 2026-06-28T14:25:08.052988Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-06-28T14:25:08.052988Z digest=sha256:8529ff89acdcffe0a2adc67a3e5da3fe8c9f1fef8ff7f94e050b2909e01bd06d

Observation c1b5044e-4eab-4864-82a2-ea1396a654ab · outbound

This paper cites 2025 , eprint=.

Harness-1: Reinforcement Learning for Search Agents with State-Externalizing Harnesses 2025 , eprint=

Reference 7

Resolution
unresolved
no resolver link, observed 2026-06-28T14:25:08.052988Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-06-28T14:25:08.052988Z digest=sha256:e83da0e18b33a21656ae59d6fe1a625933f0c0ab2b7e1f7583b0e7a8503cecd3

Observation fc67782a-c8ec-4908-be80-f32375ad1f84 · outbound

This paper cites 2025 , eprint=.

Harness-1: Reinforcement Learning for Search Agents with State-Externalizing Harnesses 2025 , eprint=

Reference 8

Resolution
unresolved
no resolver link, observed 2026-06-28T14:25:08.052988Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-06-28T14:25:08.052988Z digest=sha256:63dea549903a2b3d89172cac751e088fe024532e9088e09135eda50e3c656a43

Observation 974089d0-cc3a-4108-a6a4-a526bed7e476 · outbound

This paper cites 2025 , eprint=.

Harness-1: Reinforcement Learning for Search Agents with State-Externalizing Harnesses 2025 , eprint=

Reference 9

Resolution
unresolved
no resolver link, observed 2026-06-28T14:25:08.052988Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-06-28T14:25:08.052988Z digest=sha256:6e703fac8eac4515119027cbf14361fc34658bcbc1cc2ebd215262eed479b6a7

Observation f6a8aa56-5bdd-416d-af94-b7d50da49d64 · outbound

This paper cites Proceedings of the 2025 Conference on Empirical Methods in Natural Language Processing , pages=.

Harness-1: Reinforcement Learning for Search Agents with State-Externalizing Harnesses Proceedings of the 2025 Conference on Empirical Methods in Natural Language Processing , pages=

Reference 10

Resolution
unresolved
no resolver link, observed 2026-06-28T14:25:08.052988Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-06-28T14:25:08.052988Z digest=sha256:e29c906680c9b7050259825a3d687ee50593057b5b160cf52f14bb91089d13e3

Observation 07eb4697-9bee-4728-ae3a-b2ecbca802da · outbound

This paper cites 2026 , eprint=.

Harness-1: Reinforcement Learning for Search Agents with State-Externalizing Harnesses 2026 , eprint=

Reference 11

Resolution
unresolved
no resolver link, observed 2026-06-28T14:25:08.052988Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-06-28T14:25:08.052988Z digest=sha256:a36fa33ed6c2daa30e0340d7d6b38da4e711095e7d3ed6f8a09eaa4adb1049c8

Observation ea5da7b7-c14f-4925-a054-637f2e2ef79f · outbound

This paper cites 2025 , eprint=.

Harness-1: Reinforcement Learning for Search Agents with State-Externalizing Harnesses 2025 , eprint=

Reference 12

Resolution
unresolved
no resolver link, observed 2026-06-28T14:25:08.052988Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-06-28T14:25:08.052988Z digest=sha256:f4b638ed19ef12bfd0759f9dfc2a3d40dd25fecb7a7503b694c50041b6c29bee

Observation ab5fc597-2609-48ad-b699-9ebbe832778a · outbound

This paper cites 2025 , eprint=.

Harness-1: Reinforcement Learning for Search Agents with State-Externalizing Harnesses 2025 , eprint=

Reference 13

Resolution
unresolved
no resolver link, observed 2026-06-28T14:25:08.052988Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-06-28T14:25:08.052988Z digest=sha256:f7aae77db9ec7ced1fc15f063a175b72b715c558a0a078b61d302427b1118bd3

Observation 82170d76-4bd4-400a-8196-4d18aab4bf03 · outbound

This paper cites 2025 , eprint=.

Harness-1: Reinforcement Learning for Search Agents with State-Externalizing Harnesses 2025 , eprint=

Reference 14

Resolution
unresolved
no resolver link, observed 2026-06-28T14:25:08.052988Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-06-28T14:25:08.052988Z digest=sha256:b377b6f22362ebde36324634f552a6ea00b8e6a7219042cac7c76b93d30e9238

Observation 0fb828bd-bb3b-46f4-84b2-baa233ab37cf · outbound

This paper cites Proceedings of the ACM on Software Engineering , volume=.

Harness-1: Reinforcement Learning for Search Agents with State-Externalizing Harnesses Proceedings of the ACM on Software Engineering , volume=

Reference 15

Resolution
unresolved
no resolver link, observed 2026-06-28T14:25:08.052988Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-06-28T14:25:08.052988Z digest=sha256:e13d388d221b1deae509b8374d9dfa09961c5c6552180c9bad8283eb1f8b35bf

Observation a64c220c-6bfd-4a3c-ab2f-9fccc255d497 · outbound

This paper cites 2023 , eprint=.

Harness-1: Reinforcement Learning for Search Agents with State-Externalizing Harnesses 2023 , eprint=

Reference 16

Resolution
unresolved
no resolver link, observed 2026-06-28T14:25:08.052988Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-06-28T14:25:08.052988Z digest=sha256:aeadc704ed647c7cd5f62f8ba5d31fb7d0ed20316383a7249fa104367e3433ca

Observation 73cdefd5-7bbe-4233-94f3-e02c544fd523 · outbound

This paper cites 2025 , eprint=.

Harness-1: Reinforcement Learning for Search Agents with State-Externalizing Harnesses 2025 , eprint=

Reference 17

Resolution
unresolved
no resolver link, observed 2026-06-28T14:25:08.052988Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-06-28T14:25:08.052988Z digest=sha256:654613729bc9e3ef839c350275c20fc0af13a75d414423fa7e60f87eadfb43e7

Observation 90ef5f55-4865-4e10-8604-3c62ecaea3e0 · outbound

This paper cites DeepResearcher: Scaling deep research via reinforcement learning in real-world environments.

Harness-1: Reinforcement Learning for Search Agents with State-Externalizing Harnesses DeepResearcher: Scaling deep research via reinforcement learning in real-world environments

Reference 18

Resolution
verified exact
doi, observed 2026-06-28T14:32:18.207549Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.

source=arxiv_source observed=2026-06-28T14:25:08.052988Z digest=sha256:148f0d3ce10381e7f3b4b55e995612f12d42990aeabc5ca419f0c8e596d47d34

Observation 9d0d9951-7e2a-42e7-b7ef-ee02dd81484e · outbound

This paper cites ToolRL: Reward is All Tool Learning Needs.

Harness-1: Reinforcement Learning for Search Agents with State-Externalizing Harnesses ToolRL: Reward is All Tool Learning Needs

Reference 19

Resolution
metadata mismatch
local_arxiv, observed 2026-07-01T23:26:22.064521Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.

source=arxiv_source observed=2026-06-28T14:25:08.052988Z digest=sha256:55e86ea2c181e1c03b95f9d67a3bebcc3b793e42dd0a0887192c2ee709fbdd85

Observation 44ca8b46-9ffa-474a-b182-31fccb01ca3b · outbound

This paper cites doi: 10.1038/s41586-025-09422-z.

Harness-1: Reinforcement Learning for Search Agents with State-Externalizing Harnesses doi: 10.1038/s41586-025-09422-z

Reference 20

Resolution
verified exact
doi, observed 2026-06-28T14:32:18.205492Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.

source=arxiv_source observed=2026-06-28T14:25:08.052988Z digest=sha256:2233a2ceda8c7a23653293096a72ea25a0b29720c6e38bf0560faadfdbe5b873

Observation 1672d9ce-d0d3-483b-a9f9-955dc422ce67 · outbound

This paper cites and Finn, Chelsea , title =.

Harness-1: Reinforcement Learning for Search Agents with State-Externalizing Harnesses and Finn, Chelsea , title =

Reference 21

Resolution
unresolved
no resolver link, observed 2026-06-28T14:25:08.052988Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-06-28T14:25:08.052988Z digest=sha256:b8a6da0f94e2991ef7bd4fada237495917228da8531c73562bd8939000e5c893

Observation 820128cc-a57b-4dac-941f-4315aa191981 · outbound

This paper cites 2017 , eprint=.

Harness-1: Reinforcement Learning for Search Agents with State-Externalizing Harnesses 2017 , eprint=

Reference 22

Resolution
unresolved
no resolver link, observed 2026-06-28T14:25:08.052988Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-06-28T14:25:08.052988Z digest=sha256:96f39f208cb7f84f96f38b587167eb3a0c00be24e206897ae54d928b9dfd1bbc

Observation a03fd3c8-bc55-4ce4-a325-74dc08a96354 · outbound

This paper cites 2025 , eprint=.

Harness-1: Reinforcement Learning for Search Agents with State-Externalizing Harnesses 2025 , eprint=

Reference 23

Resolution
unresolved
no resolver link, observed 2026-06-28T14:25:08.052988Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-06-28T14:25:08.052988Z digest=sha256:dae140bf4ec480a5fcdf0b9d5143c0c9e2268350cf6be8b819542015d0fdccd0

Observation 0ad7da53-1399-4c48-9a72-d5d2eba40d9e · outbound

This paper cites 2025 , eprint=.

Harness-1: Reinforcement Learning for Search Agents with State-Externalizing Harnesses 2025 , eprint=

Reference 26

Resolution
unresolved
no resolver link, observed 2026-06-28T14:25:08.052988Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-06-28T14:25:08.052988Z digest=sha256:c827d907289f22e3207599a584ad01a89a98d254d45314ad225239b62dce7e0c

Observation 680c1318-8bbf-47c9-bb60-5a00f6c1da6f · outbound

This paper cites Search-o1: Agentic search-enhanced large reasoning models.

Harness-1: Reinforcement Learning for Search Agents with State-Externalizing Harnesses Search-o1: Agentic search-enhanced large reasoning models

Reference 28

Resolution
verified exact
doi, observed 2026-06-28T14:32:18.200883Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.

source=arxiv_source observed=2026-06-28T14:25:08.052988Z digest=sha256:ee220def824a1bad7104829ad3109f6cb7f1198882f26605b9ec8c2f9560840d

Observation 0f0272b9-6774-4a6c-8fd8-a1dd59a00dc0 · outbound

This paper cites 2026 , eprint=.

Harness-1: Reinforcement Learning for Search Agents with State-Externalizing Harnesses 2026 , eprint=

Reference 29

Resolution
unresolved
no resolver link, observed 2026-06-28T14:25:08.052988Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-06-28T14:25:08.052988Z digest=sha256:9a2f856f5b0f158d569cea29187112ad5cf82859f0e79a3471eca464b487b0dd

Observation ba465f0e-8055-4ef4-95fa-ae9c92a2f338 · outbound

This paper cites 2025 , eprint=.

Harness-1: Reinforcement Learning for Search Agents with State-Externalizing Harnesses 2025 , eprint=

Reference 32

Resolution
unresolved
no resolver link, observed 2026-06-28T14:25:08.052988Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-06-28T14:25:08.052988Z digest=sha256:e7fc97e351a602c3bef26d4ad963d9c5114825e90a64c7e30398612d6dc0a65c

Observation e9c2c0d7-1231-4f3e-9b97-a748f8cea014 · outbound

This paper cites 2026 , publisher=.

Harness-1: Reinforcement Learning for Search Agents with State-Externalizing Harnesses 2026 , publisher=

Reference 33

Resolution
unresolved
no resolver link, observed 2026-06-28T14:25:08.052988Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-06-28T14:25:08.052988Z digest=sha256:5c6b40c94bae830f58fb5ec237cf768b90fd0d48a60dd7e90bed35220ceaf326

Observation 598e6057-9c12-4ca5-bd50-7728a2ccdd0f · outbound

This paper cites 2026 , month = apr, howpublished =.

Harness-1: Reinforcement Learning for Search Agents with State-Externalizing Harnesses 2026 , month = apr, howpublished =

Reference 35

Resolution
unresolved
no resolver link, observed 2026-06-28T14:25:08.052988Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-06-28T14:25:08.052988Z digest=sha256:5a9f49ad645b59c120c7e2ecf3d7958aa50d98ca60053d521a9d55f309778a0f

Observation 8ac9816d-70f7-4bcd-994c-8077152f2065 · outbound

This paper cites OpenAI engineering note , year=.

Harness-1: Reinforcement Learning for Search Agents with State-Externalizing Harnesses OpenAI engineering note , year=

Reference 36

Resolution
unresolved
no resolver link, observed 2026-06-28T14:25:08.052988Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-06-28T14:25:08.052988Z digest=sha256:d6e28d4c83707de436eaf418b2bae0d9d0965f7b6dcf9e8b8f330559fde02fcc

Observation de7eb09f-15ed-4891-b4f9-7195aa71aeae · outbound

This paper cites and Lewis, Mike , editor =.

Harness-1: Reinforcement Learning for Search Agents with State-Externalizing Harnesses and Lewis, Mike , editor =

Reference 38

Resolution
metadata mismatch
doi, observed 2026-06-28T14:32:18.198942Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.

source=arxiv_source observed=2026-06-28T14:25:08.052988Z digest=sha256:8a5c72a408af1c1964da8cca887829cf4c929903fb4f9cc5854c50990b0357b7

Observation 04a5b79e-9644-428b-9ddb-070c8c94db61 · outbound

This paper cites Proceedings of the 61st annual meeting of the association for computational linguistics (volume 1: long papers) , pages=.

Harness-1: Reinforcement Learning for Search Agents with State-Externalizing Harnesses Proceedings of the 61st annual meeting of the association for computational linguistics (volume 1: long papers) , pages=

Reference 39

Resolution
unresolved
no resolver link, observed 2026-06-28T14:25:08.052988Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-06-28T14:25:08.052988Z digest=sha256:bf1bb33a068ecd900b4bb469e82ab80953e63e3b7aa0f5b9c805c38a85c0b70f

Observation 50acf5a5-e59a-4ca3-9d38-41133a0e7dfb · outbound

This paper cites Proceedings of the 2023 conference on empirical methods in natural language processing , pages=.

Harness-1: Reinforcement Learning for Search Agents with State-Externalizing Harnesses Proceedings of the 2023 conference on empirical methods in natural language processing , pages=

Reference 40

Resolution
unresolved
no resolver link, observed 2026-06-28T14:25:08.052988Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-06-28T14:25:08.052988Z digest=sha256:13b5500e72f82cc33be4c375fc8ea684889806b7bc8239a7b3bdc84abb106a62

Observation 202dd11b-51f0-4819-90df-49c442df819c · outbound

This paper cites s3: You Don ' t Need That Much Data to Train a Search Agent via RL.

Harness-1: Reinforcement Learning for Search Agents with State-Externalizing Harnesses s3: You Don ' t Need That Much Data to Train a Search Agent via RL

Reference 42

Resolution
verified exact
doi, observed 2026-06-28T14:32:18.202659Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.

source=arxiv_source observed=2026-06-28T14:25:08.052988Z digest=sha256:1aedd321ba3393fcde8d5dfe694d216d44f97ad78d741a204c620fdbc6daec3e

Observation 18aadace-7964-4ecb-83f8-e8e932b99e46 · outbound

This paper cites 2025 , eprint=.

Harness-1: Reinforcement Learning for Search Agents with State-Externalizing Harnesses 2025 , eprint=

Reference 43

Resolution
unresolved
no resolver link, observed 2026-06-28T14:25:08.052988Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-06-28T14:25:08.052988Z digest=sha256:dcca0212c907b2142e1dccaadccd3f95e761cc2f90149fdbb3726959a5b1ae6c

Observation d1ec520d-3f9e-40cc-9758-a9029499aff1 · outbound

This paper cites an unresolved cited work.

Harness-1: Reinforcement Learning for Search Agents with State-Externalizing Harnesses Unresolved cited work

Reference 44

Resolution
parse uncertain
no resolver link, observed 2026-06-28T14:25:08.052988Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-06-28T14:25:08.052988Z digest=sha256:c16e57f872cf7ad332ab0218570cb8eb5e23ef983d18dcb68fbe797f5a8ba153

Observation 376456ff-6727-4c61-8ec0-68d55ee6e2fa · outbound

This paper cites 2026 , month =.

Harness-1: Reinforcement Learning for Search Agents with State-Externalizing Harnesses 2026 , month =

Reference 45

Resolution
unresolved
no resolver link, observed 2026-06-28T14:25:08.052988Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-06-28T14:25:08.052988Z digest=sha256:65a922485ecafdd58c9f57e538f5566b43102477114e1459212b58966ee7630d

Observation 10afc3e3-81cd-47fd-b2b4-ae52cb6b0efa · outbound

This paper cites 2025 , eprint=.

Harness-1: Reinforcement Learning for Search Agents with State-Externalizing Harnesses 2025 , eprint=

Reference 47

Resolution
unresolved
no resolver link, observed 2026-06-28T14:25:08.052988Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-06-28T14:25:08.052988Z digest=sha256:4431ba14971c74e6725172a680a6401d2a373f1f11d7a30ca88f049a39a185cb

Observation d9c50e40-787e-4598-bf95-40b8ab12aea8 · outbound

This paper cites 2024 , eprint=.

Harness-1: Reinforcement Learning for Search Agents with State-Externalizing Harnesses 2024 , eprint=

Reference 48

Resolution
unresolved
no resolver link, observed 2026-06-28T14:25:08.052988Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-06-28T14:25:08.052988Z digest=sha256:d4905e71ac41afcda8410efb5c5337a18fc7ade08a39049d4c4543887af94046

Observation 393e8439-1d66-492c-b3bc-8afdbbf1944c · outbound

This paper cites 2026 , eprint=.

Harness-1: Reinforcement Learning for Search Agents with State-Externalizing Harnesses 2026 , eprint=

Reference 49

Resolution
unresolved
no resolver link, observed 2026-06-28T14:25:08.052988Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-06-28T14:25:08.052988Z digest=sha256:33cf6d0acbdb0ad77fa417e64db0d9e9c229ee9cb9e034c56dfd0b05dbd98527

Observation 95cf4839-87eb-4455-a5ed-e5453ef37209 · outbound

This paper cites Recursive Language Models.

Harness-1: Reinforcement Learning for Search Agents with State-Externalizing Harnesses Recursive Language Models

Reference 50

Resolution
metadata mismatch
local_arxiv, observed 2026-07-01T23:26:22.110415Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.

source=arxiv_source observed=2026-06-28T14:25:08.052988Z digest=sha256:dc9ba58cb18f179e18d36f48284d39bf6b484d166c92c766354df05ed07b711c

Observation 3c57019a-e1ad-473e-b727-ae55b8191216 · outbound

This paper cites Transactions of the association for computational linguistics , volume=.

Harness-1: Reinforcement Learning for Search Agents with State-Externalizing Harnesses Transactions of the association for computational linguistics , volume=

Reference 51

Resolution
unresolved
no resolver link, observed 2026-06-28T14:25:08.052988Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-06-28T14:25:08.052988Z digest=sha256:64a814a6e28bdb6bf6d4005a741fc9b1d02ba4a757eca55bd027e2e75e96bfa7

Observation 044f3f83-a83f-49c5-af15-225530819512 · outbound

This paper cites 2025 , month =.

Harness-1: Reinforcement Learning for Search Agents with State-Externalizing Harnesses 2025 , month =

Reference 52

Resolution
unresolved
no resolver link, observed 2026-06-28T14:25:08.052988Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-06-28T14:25:08.052988Z digest=sha256:df2dc3cf0616c0854941d6ef04246f65c353b7cf4ab533f32666451b260ebd56

Observation 51fb6772-1f23-463a-ba0e-a6f09e28480a · outbound

This paper cites Advances in neural information processing systems , volume=.

Harness-1: Reinforcement Learning for Search Agents with State-Externalizing Harnesses Advances in neural information processing systems , volume=

Reference 53

Resolution
unresolved
no resolver link, observed 2026-06-28T14:25:08.052988Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-06-28T14:25:08.052988Z digest=sha256:d5c3596c18557634920d3f8f9c991db17cd10d344ba3860c77faf9152bf9a9dd

Observation 696e710a-a10b-4ac9-b5b6-3c8120ee0aae · outbound

This paper cites 2025 , eprint=.

Harness-1: Reinforcement Learning for Search Agents with State-Externalizing Harnesses 2025 , eprint=

Reference 55

Resolution
unresolved
no resolver link, observed 2026-06-28T14:25:08.052988Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-06-28T14:25:08.052988Z digest=sha256:0804936169a6910c41c9d89d89615fbcc570ee5f74546e84a70cdda513f41ffd

Observation a7a2d72d-6cb4-4c78-be6c-c37f8e103e17 · outbound

This paper cites Advances in Neural Information Processing Systems , volume=.

Harness-1: Reinforcement Learning for Search Agents with State-Externalizing Harnesses Advances in Neural Information Processing Systems , volume=

Reference 56

Resolution
unresolved
no resolver link, observed 2026-06-28T14:25:08.052988Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-06-28T14:25:08.052988Z digest=sha256:bddf42380b17c2714fb8d78db4edd7bc4372d74fa725901de4f0615dd17d917b

Observation 9c7a007d-afce-4250-aec2-1ff09fe83036 · outbound

This paper cites BrowseComp: A Simple Yet Challenging Benchmark for Browsing Agents.

Harness-1: Reinforcement Learning for Search Agents with State-Externalizing Harnesses BrowseComp: A Simple Yet Challenging Benchmark for Browsing Agents

Reference 57

Resolution
metadata mismatch
local_arxiv, observed 2026-07-01T23:26:22.084196Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.

source=arxiv_source observed=2026-06-28T14:25:08.052988Z digest=sha256:1d5d2996c6e86a5d782b7cb2cf724a00ecd0ec1a71ab6ee09bcf79135d585e1c

Observation ff8f9599-756d-443a-a876-228636be9ae4 · outbound

This paper cites 2025 , eprint=.

Harness-1: Reinforcement Learning for Search Agents with State-Externalizing Harnesses 2025 , eprint=

Reference 58

Resolution
unresolved
no resolver link, observed 2026-06-28T14:25:08.052988Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-06-28T14:25:08.052988Z digest=sha256:5ff94f04c7154f3140779d04d252ccbcbe68f6d8ec218a3800496898407cf6b3

Observation ea2e96af-9f8b-43c3-b39e-15f55e582cc6 · outbound

This paper cites an unresolved cited work.

Harness-1: Reinforcement Learning for Search Agents with State-Externalizing Harnesses Unresolved cited work

Reference 60

Resolution
unresolved
no resolver link, observed 2026-06-28T14:25:08.052988Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-06-28T14:25:08.052988Z digest=sha256:556229497fd51ba825253f81b3ac0c39ed63c38f3ccbdf7e0c641d78cbc673be

Observation 95dda421-5533-4bc5-8db6-20a3444b6c9f · outbound

This paper cites Proceedings of the 2018 conference on empirical methods in natural language processing , pages=.

Harness-1: Reinforcement Learning for Search Agents with State-Externalizing Harnesses Proceedings of the 2018 conference on empirical methods in natural language processing , pages=

Reference 61

Resolution
unresolved
no resolver link, observed 2026-06-28T14:25:08.052988Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-06-28T14:25:08.052988Z digest=sha256:c8b49c3ebda6389cbf8ddcfdd93aa38b35f21c5d00bdd3d75da28b14aff82977

Observation 7824055c-6fb7-4d32-9f88-6e4283fff520 · outbound

This paper cites Humanity's Last Exam.

Harness-1: Reinforcement Learning for Search Agents with State-Externalizing Harnesses Humanity's Last Exam

Reference 62

Resolution
metadata mismatch
local_arxiv, observed 2026-07-01T23:26:22.059986Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.

source=arxiv_source observed=2026-06-28T14:25:08.052988Z digest=sha256:7aa29c0631d83748c5ad15197c9fa16c7edce48357305325cb08dc1702c909b3

Observation 49ada973-5248-441c-8a8d-5fe0a1bb938a · outbound

This paper cites 2026 , eprint=.

Harness-1: Reinforcement Learning for Search Agents with State-Externalizing Harnesses 2026 , eprint=

Reference 63

Resolution
unresolved
no resolver link, observed 2026-06-28T14:25:08.052988Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-06-28T14:25:08.052988Z digest=sha256:8d2e4de12b88267b309c885909a2c4ce71f9c99919e958737dc3718c0654f11d

Observation 261b2d3f-9db6-4989-8988-fd73daeca72a · outbound

This paper cites Proceedings of the 2025 Conference on Empirical Methods in Natural Language Processing , pages=.

Harness-1: Reinforcement Learning for Search Agents with State-Externalizing Harnesses Proceedings of the 2025 Conference on Empirical Methods in Natural Language Processing , pages=

Reference 65

Resolution
unresolved
no resolver link, observed 2026-06-28T14:25:08.052988Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-06-28T14:25:08.052988Z digest=sha256:a6ec7197916d29de87396fdebb994245cf6df70b2584877294451f9c745b7352

Observation 53252afc-447f-46f4-9a74-b59d115fec7b · outbound

This paper cites Introducing swe-grep and swe-grep-mini: Rl for multi-turn, fast context retrieval.

Harness-1: Reinforcement Learning for Search Agents with State-Externalizing Harnesses Introducing swe-grep and swe-grep-mini: Rl for multi-turn, fast context retrieval

Reference 66

Resolution
unresolved
no resolver link, observed 2026-06-28T14:25:08.052988Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-06-28T14:25:08.052988Z digest=sha256:cacd74134cdafdeccf6dd8f69af6a11904902d84b82ba6549e764da0a454e496

Observation e90eb068-5c46-497d-b2e3-bb3f8e597f8a · outbound

This paper cites Chroma context-1: Training a self-editing search agent.

Harness-1: Reinforcement Learning for Search Agents with State-Externalizing Harnesses Chroma context-1: Training a self-editing search agent

Reference 67

Resolution
unresolved
no resolver link, observed 2026-06-28T14:25:08.052988Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-06-28T14:25:08.052988Z digest=sha256:bc0621afea811755cff4bc76e7e6902a40324abda5fa2a55f62cbbc1e996446c

Observation 2dbb7668-e0ee-4cf6-b1c9-42c231482f3b · outbound

This paper cites MiniMax-M1: Scaling Test-Time Compute Efficiently with Lightning Attention.

Harness-1: Reinforcement Learning for Search Agents with State-Externalizing Harnesses MiniMax-M1: Scaling Test-Time Compute Efficiently with Lightning Attention

Reference 68

Resolution
verified exact
local_arxiv, observed 2026-07-01T23:26:22.117948Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.

source=arxiv_source observed=2026-06-28T14:25:08.052988Z digest=sha256:81adecd764a7e051546e79baac308acdf633578182149d7f752d65aa66c3b5a2

Observation f5bdb31a-6718-4b47-96b0-31b22de33cf4 · outbound

This paper cites Apex-searcher: Augmenting llms' search capabilities through agentic planning and execution, 2026.

Harness-1: Reinforcement Learning for Search Agents with State-Externalizing Harnesses Apex-searcher: Augmenting llms' search capabilities through agentic planning and execution, 2026

Reference 69

Resolution
unresolved
no resolver link, observed 2026-06-28T14:25:08.052988Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-06-28T14:25:08.052988Z digest=sha256:b48f90ae14575a61e06879fb409a9ab85f6942371e40bfc5bff9312d1ce565db

Observation 9e19d15c-320b-4d9f-b8b3-4b7fe1a27b37 · outbound

This paper cites Pan, Wen Zhang, Huajun Chen, Fan Yang, Zenan Zhou, and Weipeng Chen.

Harness-1: Reinforcement Learning for Search Agents with State-Externalizing Harnesses Pan, Wen Zhang, Huajun Chen, Fan Yang, Zenan Zhou, and Weipeng Chen

Reference 70

Resolution
unresolved
no resolver link, observed 2026-06-28T14:25:08.052988Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-06-28T14:25:08.052988Z digest=sha256:38008313ebc90ffca8e9a23a684b54c624c6c26cbd2005181326a03747976cd7

Observation bb28519c-26e8-4992-b9c1-a6e4e1848bab · outbound

This paper cites Browsecomp-plus: A more fair and transparent evaluation benchmark of deep-research agent, 2025.

Harness-1: Reinforcement Learning for Search Agents with State-Externalizing Harnesses Browsecomp-plus: A more fair and transparent evaluation benchmark of deep-research agent, 2025

Reference 71

Resolution
unresolved
no resolver link, observed 2026-06-28T14:25:08.052988Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-06-28T14:25:08.052988Z digest=sha256:cd54a8bed1e521e1a6a6031747acb9dad5ae5eb6b77088242b91e20861981d47

Observation 8d91d287-ce9d-4c80-b54e-9265ada45de7 · outbound

This paper cites Atom-searcher: Enhancing agentic deep research via fine-grained atomic thought reward, 2025.

Harness-1: Reinforcement Learning for Search Agents with State-Externalizing Harnesses Atom-searcher: Enhancing agentic deep research via fine-grained atomic thought reward, 2025

Reference 72

Resolution
unresolved
no resolver link, observed 2026-06-28T14:25:08.052988Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-06-28T14:25:08.052988Z digest=sha256:f71c2baaf885fc6f2e7b709488b10e8d4b5d2b97c2306a1323b454aba67c04a6

Observation ccb3a424-6fa6-46ec-8606-1c2dd4ea0192 · outbound

This paper cites Beyond ten turns: Unlocking long-horizon agentic search with large-scale asynchronous rl, 2025.

Harness-1: Reinforcement Learning for Search Agents with State-Externalizing Harnesses Beyond ten turns: Unlocking long-horizon agentic search with large-scale asynchronous rl, 2025

Reference 73

Resolution
unresolved
no resolver link, observed 2026-06-28T14:25:08.052988Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-06-28T14:25:08.052988Z digest=sha256:ab9ca5eb51f8c0b5a5cfcb2e080cce5b6747126ec00042a28e226e4cbf525511

Observation 1ef8a40e-e995-4aa0-a92a-f22e92635786 · outbound

This paper cites an unresolved cited work.

Harness-1: Reinforcement Learning for Search Agents with State-Externalizing Harnesses Unresolved cited work

Reference 74

Resolution
unresolved
no resolver link, observed 2026-06-28T14:25:08.052988Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-06-28T14:25:08.052988Z digest=sha256:1085b2d3724f280d6e2aaa4e7e54df07d91201ca93b4aa423eb843206e269ee9

Observation 90bb7c06-5fea-4142-8148-131658aab4d2 · outbound

This paper cites Michael Alvarez.

Harness-1: Reinforcement Learning for Search Agents with State-Externalizing Harnesses Michael Alvarez

Reference 75

Resolution
unresolved
no resolver link, observed 2026-06-28T14:25:08.052988Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-06-28T14:25:08.052988Z digest=sha256:daca8498d60cbfc74ab2ec7e7ca5496edfeae96b59209f2896e47796a24c1656

Observation 5088f26f-45b4-4378-b598-62e47ab24c1b · outbound

This paper cites Steer2adapt: Dynamically composing steering vectors elicits efficient adaptation of llms, 2026.

Harness-1: Reinforcement Learning for Search Agents with State-Externalizing Harnesses Steer2adapt: Dynamically composing steering vectors elicits efficient adaptation of llms, 2026

Reference 76

Resolution
unresolved
no resolver link, observed 2026-06-28T14:25:08.052988Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-06-28T14:25:08.052988Z digest=sha256:296554a9dc8acdbf1a4ec17613def5e441e255688728f25844f1ba18698a4c46

Observation 606aea60-8241-4a48-8d45-c641cc76035d · outbound

This paper cites Context rot: How increasing input tokens impacts llm performance.

Harness-1: Reinforcement Learning for Search Agents with State-Externalizing Harnesses Context rot: How increasing input tokens impacts llm performance

Reference 77

Resolution
unresolved
no resolver link, observed 2026-06-28T14:25:08.052988Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-06-28T14:25:08.052988Z digest=sha256:a2e2ef55034f8cdc23a941c9257002519fdb7a57fe72ba1543ce495af3d345f9

Observation fca8cb7c-d90c-4a6b-b03a-6764e04680d5 · outbound

This paper cites Reinforce++: Stabilizing critic-free policy optimization with global advantage normalization, 2025.

Harness-1: Reinforcement Learning for Search Agents with State-Externalizing Harnesses Reinforce++: Stabilizing critic-free policy optimization with global advantage normalization, 2025

Reference 78

Resolution
unresolved
no resolver link, observed 2026-06-28T14:25:08.052988Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-06-28T14:25:08.052988Z digest=sha256:899419971dad1107f82b58214821818221abcddd780c32ad993cad34eced6dff

Observation 7dc89a95-3121-49e1-9d73-4dd2d5ec0194 · outbound

This paper cites DeepRetrieval: Hacking Real Search Engines and Retrievers with Large Language Models via Reinforcement Learning.

Harness-1: Reinforcement Learning for Search Agents with State-Externalizing Harnesses DeepRetrieval: Hacking Real Search Engines and Retrievers with Large Language Models via Reinforcement Learning

Reference 79

Resolution
verified exact
arxiv_id, observed 2026-07-01T23:26:22.121774Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.

source=arxiv_source observed=2026-06-28T14:25:08.052988Z digest=sha256:b50a22722eefdc1cfebcfdd997715be426ea9190b3dd4185c4022d4bde057443

Observation 0ce5068c-c9d8-4d70-aecf-eb16f5a1b9ba · outbound

This paper cites Adaptation of agentic ai: A survey of post-training, memory, and skills, 2026.

Harness-1: Reinforcement Learning for Search Agents with State-Externalizing Harnesses Adaptation of agentic ai: A survey of post-training, memory, and skills, 2026

Reference 80

Resolution
unresolved
no resolver link, observed 2026-06-28T14:25:08.052988Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-06-28T14:25:08.052988Z digest=sha256:5ce271788299fb9669b1087daf255dcdbc5e58abdea28610d2ebcfebddc0c89c

Observation 65bba525-7322-40b2-98d9-b0ca6abdb92f · outbound

This paper cites s3: You don ' t need that much data to train a search agent via RL.

Harness-1: Reinforcement Learning for Search Agents with State-Externalizing Harnesses s3: You don ' t need that much data to train a search agent via RL

Reference 81

Resolution
unresolved
no resolver link, observed 2026-06-28T14:25:08.052988Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-06-28T14:25:08.052988Z digest=sha256:9e2f3f7cc245ae0396630ce501e8006da481ee7c6e099dfc5a1381a173cfb91b

Observation 0117e6c8-9bdb-4257-aa37-27501e422d23 · outbound

This paper cites Active retrieval augmented generation.

Harness-1: Reinforcement Learning for Search Agents with State-Externalizing Harnesses Active retrieval augmented generation

Reference 82

Resolution
unresolved
no resolver link, observed 2026-06-28T14:25:08.052988Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-06-28T14:25:08.052988Z digest=sha256:fd5ab368c3f54e24a81ebd81e1872310b633ab71b742deef5cd2471b11a9c096

Observation 05f1bd12-fbc7-4f75-a5a9-78d3ff1bff30 · outbound

This paper cites Search-R1: Training LLMs to Reason and Leverage Search Engines with Reinforcement Learning.

Harness-1: Reinforcement Learning for Search Agents with State-Externalizing Harnesses Search-R1: Training LLMs to Reason and Leverage Search Engines with Reinforcement Learning

Reference 83

Resolution
verified exact
local_arxiv, observed 2026-07-01T23:26:22.087863Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.

source=arxiv_source observed=2026-06-28T14:25:08.052988Z digest=sha256:54e36a4db0693e537b8c421f3ef22b8d253fd1aeebb8e358585974fe0906daed

Observation 07dfba9e-7213-48a9-85fb-1f6ec103d405 · outbound

This paper cites Dhillon, David Brandfonbrener, and Rishabh Agarwal.

Harness-1: Reinforcement Learning for Search Agents with State-Externalizing Harnesses Dhillon, David Brandfonbrener, and Rishabh Agarwal

Reference 84

Resolution
unresolved
no resolver link, observed 2026-06-28T14:25:08.052988Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-06-28T14:25:08.052988Z digest=sha256:1901aa2ee5b925a103e5df1b4238d4fa5c564048d1d5e707f2f4d63e9ba5c653

Observation c451c1d2-92f8-44a3-89dc-540e6a51b254 · outbound

This paper cites Fact, fetch, and reason: A unified evaluation of retrieval-augmented generation.

Harness-1: Reinforcement Learning for Search Agents with State-Externalizing Harnesses Fact, fetch, and reason: A unified evaluation of retrieval-augmented generation

Reference 85

Resolution
unresolved
no resolver link, observed 2026-06-28T14:25:08.052988Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-06-28T14:25:08.052988Z digest=sha256:2696e57df90f0755a1c3fc4d84b8049fd9a24c174237cc0a447b157e94d81829

Observation 3e73a119-ce43-4baf-a078-2749bc1b9f06 · outbound

This paper cites Bowman, and Ethan Perez.

Harness-1: Reinforcement Learning for Search Agents with State-Externalizing Harnesses Bowman, and Ethan Perez

Reference 86

Resolution
unresolved
no resolver link, observed 2026-06-28T14:25:08.052988Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-06-28T14:25:08.052988Z digest=sha256:2a0ad3c4c87c015649052d29c7d656a2c604d6fc131a4853949c3a8fa942fc9d

Observation 4a33fcb3-8902-4d72-a2d9-8da7cde33649 · outbound

This paper cites Meta-Harness: End-to-End Optimization of Model Harnesses.

Harness-1: Reinforcement Learning for Search Agents with State-Externalizing Harnesses Meta-Harness: End-to-End Optimization of Model Harnesses

Reference 87

Resolution
verified exact
local_arxiv, observed 2026-07-01T23:26:22.091376Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.

source=arxiv_source observed=2026-06-28T14:25:08.052988Z digest=sha256:f68bb0345d46b6befdce713b767366e88bf18d50af2a53af1ee00b4a10f0384d

Observation 75c7b63f-e457-4902-9550-33718825213e · outbound

This paper cites Websailor: Navigating super-human reasoning for web agent, 2025.

Harness-1: Reinforcement Learning for Search Agents with State-Externalizing Harnesses Websailor: Navigating super-human reasoning for web agent, 2025

Reference 88

Resolution
unresolved
no resolver link, observed 2026-06-28T14:25:08.052988Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-06-28T14:25:08.052988Z digest=sha256:32659ca62e146d06d523a59b6e26d6f6d9dedfacb3c9a9a52d35aab92c4b7099

Observation 1261f824-9203-4a7d-9928-7df4b56c3349 · outbound

This paper cites Search-o1: Agentic search-enhanced large reasoning models.

Harness-1: Reinforcement Learning for Search Agents with State-Externalizing Harnesses Search-o1: Agentic search-enhanced large reasoning models

Reference 89

Resolution
unresolved
no resolver link, observed 2026-06-28T14:25:08.052988Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-06-28T14:25:08.052988Z digest=sha256:a099e65b8660ae9a3cd2cd007cfc48ffbf6833dd796c486e5ec85db5dec79a18

Observation 3812861e-4d54-4462-8061-d19b4477cc3a · outbound

This paper cites Webexplorer: Explore and evolve for training long-horizon web agents, 2025.

Harness-1: Reinforcement Learning for Search Agents with State-Externalizing Harnesses Webexplorer: Explore and evolve for training long-horizon web agents, 2025

Reference 90

Resolution
unresolved
no resolver link, observed 2026-06-28T14:25:08.052988Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-06-28T14:25:08.052988Z digest=sha256:ceb91b46ea012184a9b2a48e88bcefb3c66c3141e8a59d4468c8b01c2c177cc3

Observation 6c9dbb0f-e733-4fce-84e7-b519faf08016 · outbound

This paper cites Harness engineering: leveraging codex in an agent-first world, 2026.

Harness-1: Reinforcement Learning for Search Agents with State-Externalizing Harnesses Harness engineering: leveraging codex in an agent-first world, 2026

Reference 91

Resolution
unresolved
no resolver link, observed 2026-06-28T14:25:08.052988Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-06-28T14:25:08.052988Z digest=sha256:34a993f01b0cc7aee0b75ae123f5559227518fa3ef5a7785662955a86c5786ce

Observation 146124d1-3134-4816-af85-01bcbf1184cf · outbound

This paper cites an unresolved cited work.

Harness-1: Reinforcement Learning for Search Agents with State-Externalizing Harnesses Unresolved cited work

Reference 92

Resolution
unresolved
no resolver link, observed 2026-06-28T14:25:08.052988Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-06-28T14:25:08.052988Z digest=sha256:de2abdc36226dd0d9d9d25c66f83e58e1e553e838547fe4d975102ee24263ffb

Observation 614dafa1-23f0-4716-ad27-4b46d60cccc1 · outbound

This paper cites Scaling managed agents: Decoupling the brain from the hands.

Harness-1: Reinforcement Learning for Search Agents with State-Externalizing Harnesses Scaling managed agents: Decoupling the brain from the hands

Reference 93

Resolution
unresolved
no resolver link, observed 2026-06-28T14:25:08.052988Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-06-28T14:25:08.052988Z digest=sha256:31d1cd8223cc4a8bac67d3de0654c0492766c203c4e403ed9541dc231f766cae

Observation e7329441-923c-4052-91b1-38c968fcb6fc · outbound

This paper cites an unresolved cited work.

Harness-1: Reinforcement Learning for Search Agents with State-Externalizing Harnesses Unresolved cited work

Reference 94

Resolution
unresolved
no resolver link, observed 2026-06-28T14:25:08.052988Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-06-28T14:25:08.052988Z digest=sha256:bb3744f5f0570ef3db2cae5ed890ecd9846524338f3112f0ff585da2808df3f1

Observation dec39293-a115-4666-a911-4ac85505732e · outbound

This paper cites Patil, Ion Stoica, and Joseph E.

Harness-1: Reinforcement Learning for Search Agents with State-Externalizing Harnesses Patil, Ion Stoica, and Joseph E

Reference 95

Resolution
unresolved
no resolver link, observed 2026-06-28T14:25:08.052988Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-06-28T14:25:08.052988Z digest=sha256:c6bb00f35871e1f6c68ac663614672b72bf73e7daa518e20381a3ccc5eaa9727

Observation 10b7a040-8f93-47e6-b853-2e4fe98f5f78 · outbound

This paper cites SealQA: Raising the Bar for Reasoning in Search-Augmented Language Models.

Harness-1: Reinforcement Learning for Search Agents with State-Externalizing Harnesses SealQA: Raising the Bar for Reasoning in Search-Augmented Language Models

Reference 96

Resolution
verified exact
local_arxiv, observed 2026-07-01T23:26:22.103075Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.

source=arxiv_source observed=2026-06-28T14:25:08.052988Z digest=sha256:ac9ba664100eb60bbf178ab2a5032495a3c60bee1121cf0687c043e7b4521b9e

Observation 62e1da60-e49f-4a7c-80c4-3faf73bcbd48 · outbound

This paper cites Measuring and narrowing the compositionality gap in language models.

Harness-1: Reinforcement Learning for Search Agents with State-Externalizing Harnesses Measuring and narrowing the compositionality gap in language models

Reference 97

Resolution
unresolved
no resolver link, observed 2026-06-28T14:25:08.052988Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-06-28T14:25:08.052988Z digest=sha256:b67205fa1bca5f12a5d50853f9da4410116fbcc2882654d57084b58f47803237

Observation 462c1a5d-011d-4306-a9cc-a73b8c306257 · outbound

This paper cites Toolllm: Facilitating large language models to master 16000+ real-world apis, 2023.

Harness-1: Reinforcement Learning for Search Agents with State-Externalizing Harnesses Toolllm: Facilitating large language models to master 16000+ real-world apis, 2023

Reference 98

Resolution
unresolved
no resolver link, observed 2026-06-28T14:25:08.052988Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-06-28T14:25:08.052988Z digest=sha256:c0419603caee1654365f01ec2ff5f4597460da3045f13ca64f684e19b6236c14

Observation 06f2951b-f1c4-412e-a596-aeec62a96566 · outbound

This paper cites Proximal policy optimization algorithms, 2017.

Harness-1: Reinforcement Learning for Search Agents with State-Externalizing Harnesses Proximal policy optimization algorithms, 2017

Reference 99

Resolution
unresolved
no resolver link, observed 2026-06-28T14:25:08.052988Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-06-28T14:25:08.052988Z digest=sha256:fa9b2cc3e9e34cb77c8f7a85c85209f3286198de719118d448d871543640e02f

Observation 5d122814-3995-47d7-b56d-bc40d2235f33 · outbound

This paper cites HARBOR: Automated Harness Optimization.

Harness-1: Reinforcement Learning for Search Agents with State-Externalizing Harnesses HARBOR: Automated Harness Optimization

Reference 100

Resolution
verified exact
local_arxiv, observed 2026-07-01T23:26:22.095043Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.

source=arxiv_source observed=2026-06-28T14:25:08.052988Z digest=sha256:9a9b550d984aeb516e38e0814ad6312e245063674b5fe7436e5347491f07ffaf

Observation 9d062346-98d9-4a07-8446-fe46801c7d1d · outbound

This paper cites R1-Searcher: Incentivizing the Search Capability in LLMs via Reinforcement Learning.

Harness-1: Reinforcement Learning for Search Agents with State-Externalizing Harnesses R1-Searcher: Incentivizing the Search Capability in LLMs via Reinforcement Learning

Reference 101

Resolution
verified exact
local_arxiv, observed 2026-07-01T23:26:22.072581Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.

source=arxiv_source observed=2026-06-28T14:25:08.052988Z digest=sha256:ff53004ee6061b65cb9c8eb68c422edd22a06b7fdd201614cc56da5c009f2f58

Observation a140e10e-b646-4609-89d6-70343a74e450 · outbound

This paper cites Toolorchestra: Elevating intelligence via efficient model and tool orchestration, 2025.

Harness-1: Reinforcement Learning for Search Agents with State-Externalizing Harnesses Toolorchestra: Elevating intelligence via efficient model and tool orchestration, 2025

Reference 102

Resolution
unresolved
no resolver link, observed 2026-06-28T14:25:08.052988Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-06-28T14:25:08.052988Z digest=sha256:bcbb3f1203efb80425f7ea4f4a72b5491ba7b10b574ca260f8c8d160c2965e0a

Observation 1877b91a-498e-476b-9c4f-73a458cbcb14 · outbound

This paper cites Decouplesearch: Decouple planning and search via hierarchical reward modeling.

Harness-1: Reinforcement Learning for Search Agents with State-Externalizing Harnesses Decouplesearch: Decouple planning and search via hierarchical reward modeling

Reference 103

Resolution
unresolved
no resolver link, observed 2026-06-28T14:25:08.052988Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-06-28T14:25:08.052988Z digest=sha256:c15e16864eb3f700f9ca54e5053d5e4121f72545e09d98b8fc8a99f2d0c38664

Observation 51bf1f54-a9ce-474a-bb9f-1536d6341df6 · outbound

This paper cites Tongyi DeepResearch Technical Report.

Harness-1: Reinforcement Learning for Search Agents with State-Externalizing Harnesses Tongyi DeepResearch Technical Report

Reference 104

Resolution
verified exact
local_arxiv, observed 2026-07-01T23:26:22.076290Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.

source=arxiv_source observed=2026-06-28T14:25:08.052988Z digest=sha256:11dce1dd42c376446668672f23a26f2fe520b08831a00a1b7a3ebc3762eafe8c

Observation a4672d20-21c6-4a52-b30c-45c481ac8d7a · outbound

This paper cites Interleaving retrieval with chain-of-thought reasoning for knowledge-intensive multi-step questions.

Harness-1: Reinforcement Learning for Search Agents with State-Externalizing Harnesses Interleaving retrieval with chain-of-thought reasoning for knowledge-intensive multi-step questions

Reference 105

Resolution
unresolved
no resolver link, observed 2026-06-28T14:25:08.052988Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-06-28T14:25:08.052988Z digest=sha256:ee0a226aad42d0af47abab258db3d1e63c894312f5d0c6999106473c42672c82

Observation 3652ee58-b3fb-4925-bd75-fa1edcb1cf17 · outbound

This paper cites an unresolved cited work.

Harness-1: Reinforcement Learning for Search Agents with State-Externalizing Harnesses Unresolved cited work

Reference 106

Resolution
unresolved
no resolver link, observed 2026-06-28T14:25:08.052988Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-06-28T14:25:08.052988Z digest=sha256:1cbab94da02010790f95774dd148861ed7f3b66dca253215839255990060a08d

Observation 45a5daac-0171-4fc5-bf89-01c6816d5d5d · outbound

This paper cites USPTO Open Data Portal.

Harness-1: Reinforcement Learning for Search Agents with State-Externalizing Harnesses USPTO Open Data Portal

Reference 107

Resolution
unresolved
no resolver link, observed 2026-06-28T14:25:08.052988Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-06-28T14:25:08.052988Z digest=sha256:fe447e6c45887ebf93aab67c7549229c87a2f5c682658d387a08429b68d88c1f

Observation 73c2e6de-5fcd-4e89-99de-8efdfbd566e7 · outbound

This paper cites Securities and Exchange Commission.

Harness-1: Reinforcement Learning for Search Agents with State-Externalizing Harnesses Securities and Exchange Commission

Reference 108

Resolution
unresolved
no resolver link, observed 2026-06-28T14:25:08.052988Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-06-28T14:25:08.052988Z digest=sha256:e6434cdc2cb37483ad4aa7dae7719037c7ce29779b628cbe36aa621886fd73c1

Observation b9f02781-c1f8-4734-b987-c1863f1b9afa · outbound

This paper cites SPA-RL: Reinforcing LLM Agents via Stepwise Progress Attribution.

Harness-1: Reinforcement Learning for Search Agents with State-Externalizing Harnesses SPA-RL: Reinforcing LLM Agents via Stepwise Progress Attribution

Reference 109

Resolution
verified exact
arxiv_id, observed 2026-07-01T23:26:22.069256Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.

source=arxiv_source observed=2026-06-28T14:25:08.052988Z digest=sha256:904aae02388f5a7853da56b67b13b7c2c9e3ec8b6be4ce822b27c8765c24871b

Observation 80832a9b-e435-4a00-afdf-f06b668aa714 · outbound

This paper cites StepSearch: Igniting LLMs Search Ability via Step-Wise Proximal Policy Optimization.

Harness-1: Reinforcement Learning for Search Agents with State-Externalizing Harnesses StepSearch: Igniting LLMs Search Ability via Step-Wise Proximal Policy Optimization

Reference 110

Resolution
verified exact
arxiv_id, observed 2026-07-01T23:26:22.099072Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.

source=arxiv_source observed=2026-06-28T14:25:08.052988Z digest=sha256:5ad1e12ef2732962fce183f7db7a11242b984e941ed0b9c7a7c3db8804edfe28

Observation 25ad6795-52da-49e7-9bb6-490bee8d30b3 · outbound

This paper cites Webdancer: Towards autonomous information seeking agency, 2025.

Harness-1: Reinforcement Learning for Search Agents with State-Externalizing Harnesses Webdancer: Towards autonomous information seeking agency, 2025

Reference 111

Resolution
unresolved
no resolver link, observed 2026-06-28T14:25:08.052988Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-06-28T14:25:08.052988Z digest=sha256:0cb877874b0f8c1265c0234934e71228f82bc489aabb9aaefe5fafc06eb16e22

Observation 64a7d282-92b5-4bde-bcfa-50f2ff44876d · outbound

This paper cites Agentless: Demystifying LLM-based Software Engineering Agents.

Harness-1: Reinforcement Learning for Search Agents with State-Externalizing Harnesses Agentless: Demystifying LLM-based Software Engineering Agents

Reference 112

Resolution
verified exact
local_arxiv, observed 2026-07-01T23:26:22.080201Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.

source=arxiv_source observed=2026-06-28T14:25:08.052988Z digest=sha256:2bc4268ff3d19aeeaf9f9132201d7d205fe58b6d45c834e5b1b18262d41b4f3a

Observation 4d548640-d3db-4ad3-87f0-14703cf2f595 · outbound

This paper cites Demystifying llm-based software engineering agents.

Harness-1: Reinforcement Learning for Search Agents with State-Externalizing Harnesses Demystifying llm-based software engineering agents

Reference 113

Resolution
unresolved
no resolver link, observed 2026-06-28T14:25:08.052988Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-06-28T14:25:08.052988Z digest=sha256:cccc4acd44c70a6c0bae4a338226b83fff5176893c4adbf6d9fc66b0b55c4e64

Pith citing papers

Observation a6ef2b82-acfa-47ce-804d-a6049effec00 · inbound

Fetch-then-Explore: Decoupling Selection from Extraction over a Persistent Workspace for Search Agents cites this paper.

Fetch-then-Explore: Decoupling Selection from Extraction over a Persistent Workspace for Search Agents Harness-1: Reinforcement Learning for Search Agents with State-Externalizing Harnesses

Reference 25

Resolution
unresolved
no resolver link, observed 2026-08-04T15:12:55.554565Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-04T15:12:55.554565Z digest=sha256:0ca5b7cb4eedb732b3edd7873e4d7fe372458b500019f271ce5e582d3819bd43

Observation 431a4610-419f-4600-8b9e-a9e9f7df540a · inbound

EvoHarness-RL: Learning Self-Evolving Runtime Harness for Long-Horizon LLM Agents cites this paper.

EvoHarness-RL: Learning Self-Evolving Runtime Harness for Long-Horizon LLM Agents Harness-1: Reinforcement Learning for Search Agents with State-Externalizing Harnesses

Reference 3

Resolution
verified exact
local_arxiv, observed 2026-08-08T13:01:09.644786Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.

source=pdf_text observed=2026-08-08T13:01:09.120785Z digest=sha256:82f927ba883e792ce5dbfda035ea75891c7c7b95b0cc2a9429b3f777c91ab51d