{"as_of":"2026-08-18T11:49:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:58abf2e69645b024aef07286710eb3280221a144cea94f238d7b39735e4d3ab0","coverage":[{"denominator":24,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":24,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-28T22:13:39.317125Z","state":"measured"},{"denominator":26,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":26,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-18T06:34:40.430872+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-03T01:47:26.989643Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2605.31433","last_updated":"2026-05-29T15:28:26Z","snapshot_observed_at":"2026-08-08T06:49:37.449828Z","submitted_at":"2026-05-29T15:28:26Z","title":"SCOPE: Self-Play via Co-Evolving Policies for Open-Ended Tasks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.31433","snapshot_observed_at":"2026-07-30T18:33:28.507798Z","title":"P.; Leang, J","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.26873","last_updated":"2026-07-31T13:09:25Z","snapshot_observed_at":"2026-08-13T19:56:21.477865Z","submitted_at":"2026-07-29T13:03:07Z","title":"SERPO: Self-Evolving Rubric Policy Optimization for Open-Ended Test-Time Reinforcement Learning","version":1},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-07-30T18:33:28.507798Z"},"links":{"cited_paper":"/paper/2605.31433","citing_paper":"/paper/2607.26873"},"observation_digest":"sha256:6f9a2d318067da5faffc3ce5692f352b30083b582b132e0be0b2687638bd55c9","observation_id":"e65d33d3-0910-48fa-9bf3-5bb0b8cb6e94","resolution":{"observed_at":"2026-07-30T18:33:28.507798Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.31433","last_updated":"2026-05-29T15:28:26Z","snapshot_observed_at":"2026-08-08T06:49:37.449828Z","submitted_at":"2026-05-29T15:28:26Z","title":"SCOPE: Self-Play via Co-Evolving Policies for Open-Ended Tasks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.31433","snapshot_observed_at":"2026-08-03T01:47:26.989643Z","title":"2605.31433 , archivePrefix=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.26873","last_updated":"2026-07-31T13:09:25Z","snapshot_observed_at":"2026-08-13T19:56:21.477865Z","submitted_at":"2026-07-29T13:03:07Z","title":"SERPO: Self-Evolving Rubric Policy Optimization for Open-Ended Test-Time Reinforcement Learning","version":2},"reference_index":78,"source":"arxiv_source","source_observed_at":"2026-08-03T01:47:26.989643Z"},"links":{"cited_paper":"/paper/2605.31433","citing_paper":"/paper/2607.26873"},"observation_digest":"sha256:c23eb1b02fccb381a82638d4b4c7507a03f5338c47c93b682b439c6576e19f1f","observation_id":"6592df4b-8e50-48ac-9e43-f33b6ec39a2e","resolution":{"observed_at":"2026-08-03T01:47:26.989643Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2605.31433/citation-record","integrity":"/paper/2605.31433/integrity","json":"/paper/2605.31433/citation-record.json","paper":"/paper/2605.31433"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"1540.361156","doi":"10.14778/3611540.3611569","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"I am EdgeRunner AI","venue":"Proceedings of the VLDB Endowment","work_id":"2fecc4e1-0d3a-4003-bd43-23d1f5da5be2","year":2024},"citing_paper":{"arxiv_id":"2605.31433","last_updated":"2026-05-29T15:28:26Z","snapshot_observed_at":"2026-08-08T06:49:37.449828Z","submitted_at":"2026-05-29T15:28:26Z","title":"SCOPE: Self-Play via Co-Evolving Policies for Open-Ended Tasks","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-06-28T22:13:39.317125Z"},"links":{"citing_paper":"/paper/2605.31433"},"observation_digest":"sha256:e873a5a0d21b18ea3d1ce84874e89b5416361acf0ae34c48ea7431c5c6617554","observation_id":"5580f452-b47e-45ad-8eb3-423cc8f833dc","resolution":{"observed_at":"2026-06-28T22:22:42.704440Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-05-19T23:52:03.068603+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-19T23:52:03.068603+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T22:13:39.317125Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2605.31433","last_updated":"2026-05-29T15:28:26Z","snapshot_observed_at":"2026-08-08T06:49:37.449828Z","submitted_at":"2026-05-29T15:28:26Z","title":"SCOPE: Self-Play via Co-Evolving Policies for Open-Ended Tasks","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-06-28T22:13:39.317125Z"},"links":{"citing_paper":"/paper/2605.31433"},"observation_digest":"sha256:898db18238c26bb43fe6fdbb37963faf39d7b6b034881a6a6faf68b7c1d8bd9c","observation_id":"205b94ed-aa11-4e88-b11c-c635cdf6db94","resolution":{"observed_at":"2026-06-28T22:13:39.317125Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T22:13:39.317125Z","title":"</think> block","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2605.31433","last_updated":"2026-05-29T15:28:26Z","snapshot_observed_at":"2026-08-08T06:49:37.449828Z","submitted_at":"2026-05-29T15:28:26Z","title":"SCOPE: Self-Play via Co-Evolving Policies for Open-Ended Tasks","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-06-28T22:13:39.317125Z"},"links":{"citing_paper":"/paper/2605.31433"},"observation_digest":"sha256:0b05efa23fdc1bda0577c66248933d502c22ffd2da3d98a2ecfaa2cd852800b3","observation_id":"cdf093e3-8e79-4b61-88cf-1f3b44cba140","resolution":{"observed_at":"2026-06-28T22:13:39.317125Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T22:13:39.317125Z","title":"4:3:2” stratified distribution over 1/2/3 turns). A search tag is “valid","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2605.31433","last_updated":"2026-05-29T15:28:26Z","snapshot_observed_at":"2026-08-08T06:49:37.449828Z","submitted_at":"2026-05-29T15:28:26Z","title":"SCOPE: Self-Play via Co-Evolving Policies for Open-Ended Tasks","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-06-28T22:13:39.317125Z"},"links":{"citing_paper":"/paper/2605.31433"},"observation_digest":"sha256:109a135c119bd0da0be83863e67d5c817251be7cad90233d37336f29a035ed41","observation_id":"0b86e653-fa25-45f9-a057-257d7992cc86","resolution":{"observed_at":"2026-06-28T22:13:39.317125Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T22:13:39.317125Z","title":"The format score is rfmt = (think+tool+structure)/3","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2605.31433","last_updated":"2026-05-29T15:28:26Z","snapshot_observed_at":"2026-08-08T06:49:37.449828Z","submitted_at":"2026-05-29T15:28:26Z","title":"SCOPE: Self-Play via Co-Evolving Policies for Open-Ended Tasks","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-06-28T22:13:39.317125Z"},"links":{"citing_paper":"/paper/2605.31433"},"observation_digest":"sha256:77d44fd1360ef96c0e09910af58a0eec4a8488e97fa432c96c30774f21fff092","observation_id":"e0fffbdc-e6f8-4664-bcd4-7a837cc4af50","resolution":{"observed_at":"2026-06-28T22:13:39.317125Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T22:13:39.317125Z","title":"</think> tags","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2605.31433","last_updated":"2026-05-29T15:28:26Z","snapshot_observed_at":"2026-08-08T06:49:37.449828Z","submitted_at":"2026-05-29T15:28:26Z","title":"SCOPE: Self-Play via Co-Evolving Policies for Open-Ended Tasks","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-06-28T22:13:39.317125Z"},"links":{"citing_paper":"/paper/2605.31433"},"observation_digest":"sha256:fa28c5097c98ebe7bbea8151c31ccbab3d09ab4d144dff5bbb91dd08a4ca2aeb","observation_id":"dc4f242c-d3cc-45a8-9ff4-51ef4a8373e5","resolution":{"observed_at":"2026-06-28T22:13:39.317125Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T22:13:39.317125Z","title":"A search call is “valid” if it matches the regex<search>.*?</search>with non-empty content","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2605.31433","last_updated":"2026-05-29T15:28:26Z","snapshot_observed_at":"2026-08-08T06:49:37.449828Z","submitted_at":"2026-05-29T15:28:26Z","title":"SCOPE: Self-Play via Co-Evolving Policies for Open-Ended Tasks","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-06-28T22:13:39.317125Z"},"links":{"citing_paper":"/paper/2605.31433"},"observation_digest":"sha256:6ed8324a869afbef9f10d2cf19e5cad76be299e1901220e8f719381da3c22c6f","observation_id":"d6e56186-9216-4ff1-bdff-d2db13512a5e","resolution":{"observed_at":"2026-06-28T22:13:39.317125Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T22:13:39.317125Z","title":"valid_search_calls","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2605.31433","last_updated":"2026-05-29T15:28:26Z","snapshot_observed_at":"2026-08-08T06:49:37.449828Z","submitted_at":"2026-05-29T15:28:26Z","title":"SCOPE: Self-Play via Co-Evolving Policies for Open-Ended Tasks","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-06-28T22:13:39.317125Z"},"links":{"citing_paper":"/paper/2605.31433"},"observation_digest":"sha256:81dee43669d20fd007e3fff34d7996d0e4d84b7e66c6f5740b01a4a5c9e99466","observation_id":"3f998eff-4342-4b48-a93b-4db8b2c4e6bd","resolution":{"observed_at":"2026-06-28T22:13:39.317125Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T22:13:39.317125Z","title":"Qwen3-8B","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2605.31433","last_updated":"2026-05-29T15:28:26Z","snapshot_observed_at":"2026-08-08T06:49:37.449828Z","submitted_at":"2026-05-29T15:28:26Z","title":"SCOPE: Self-Play via Co-Evolving Policies for Open-Ended Tasks","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-06-28T22:13:39.317125Z"},"links":{"citing_paper":"/paper/2605.31433"},"observation_digest":"sha256:c0a8f96bfd0c71a81b3feea64ec6061315046ac0b215cfb1c4d9e19a5b40902e","observation_id":"e061ef60-7ca6-4f4c-8b5f-67518e25834f","resolution":{"observed_at":"2026-06-28T22:13:39.317125Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T22:13:39.317125Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2605.31433","last_updated":"2026-05-29T15:28:26Z","snapshot_observed_at":"2026-08-08T06:49:37.449828Z","submitted_at":"2026-05-29T15:28:26Z","title":"SCOPE: Self-Play via Co-Evolving Policies for Open-Ended Tasks","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-06-28T22:13:39.317125Z"},"links":{"citing_paper":"/paper/2605.31433"},"observation_digest":"sha256:5c570107d7fd93953fb9b8ae8c2cba47fb82c21956da8cf4b1290766c76bdf9d","observation_id":"8ce2c4c1-05ef-4d95-9544-3265e79f9bc8","resolution":{"observed_at":"2026-06-28T22:13:39.317125Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T22:13:39.317125Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2605.31433","last_updated":"2026-05-29T15:28:26Z","snapshot_observed_at":"2026-08-08T06:49:37.449828Z","submitted_at":"2026-05-29T15:28:26Z","title":"SCOPE: Self-Play via Co-Evolving Policies for Open-Ended Tasks","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-06-28T22:13:39.317125Z"},"links":{"citing_paper":"/paper/2605.31433"},"observation_digest":"sha256:30e5063c5816749d670a9f8c7430b7705faa90c1a48f8fab0c27d879a831a9cb","observation_id":"7656396e-4c4c-425a-8f98-76d591bcc939","resolution":{"observed_at":"2026-06-28T22:13:39.317125Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T22:13:39.317125Z","title":"Qwen3-32B","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2605.31433","last_updated":"2026-05-29T15:28:26Z","snapshot_observed_at":"2026-08-08T06:49:37.449828Z","submitted_at":"2026-05-29T15:28:26Z","title":"SCOPE: Self-Play via Co-Evolving Policies for Open-Ended Tasks","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-06-28T22:13:39.317125Z"},"links":{"citing_paper":"/paper/2605.31433"},"observation_digest":"sha256:3800759b46c3dc6396beb9bafa52604764504a6ec254eb73f52e5be8f0756ecd","observation_id":"f29c46e5-f2f4-4f12-9511-f4f850df30f4","resolution":{"observed_at":"2026-06-28T22:13:39.317125Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T22:13:39.317125Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2605.31433","last_updated":"2026-05-29T15:28:26Z","snapshot_observed_at":"2026-08-08T06:49:37.449828Z","submitted_at":"2026-05-29T15:28:26Z","title":"SCOPE: Self-Play via Co-Evolving Policies for Open-Ended Tasks","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-06-28T22:13:39.317125Z"},"links":{"citing_paper":"/paper/2605.31433"},"observation_digest":"sha256:390e2a2bd32d7cb6fac99d0ebf03833f1d515f2c4e6ed350550b9345c9280d27","observation_id":"1b95203b-4aba-4d5e-9de2-a6f48ecaa59c","resolution":{"observed_at":"2026-06-28T22:13:39.317125Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T22:13:39.317125Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2605.31433","last_updated":"2026-05-29T15:28:26Z","snapshot_observed_at":"2026-08-08T06:49:37.449828Z","submitted_at":"2026-05-29T15:28:26Z","title":"SCOPE: Self-Play via Co-Evolving Policies for Open-Ended Tasks","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-06-28T22:13:39.317125Z"},"links":{"citing_paper":"/paper/2605.31433"},"observation_digest":"sha256:dcc708005f3c91776c84be70bfd92ae9330cdc6e71342261a08d4be4c8fbbf6c","observation_id":"47d20bde-b8bd-41d7-ac92-d16b8298b739","resolution":{"observed_at":"2026-06-28T22:13:39.317125Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T22:13:39.317125Z","title":"Table 10: Rubrics from Qwen3-4B, 8B, and 32B on a summarisation task.Red: generic prompt restatements;blue: source-grounded facts;green: analytical requirements","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2605.31433","last_updated":"2026-05-29T15:28:26Z","snapshot_observed_at":"2026-08-08T06:49:37.449828Z","submitted_at":"2026-05-29T15:28:26Z","title":"SCOPE: Self-Play via Co-Evolving Policies for Open-Ended Tasks","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-06-28T22:13:39.317125Z"},"links":{"citing_paper":"/paper/2605.31433"},"observation_digest":"sha256:12956f774c408e188d038dc77065a4a3197031039eeeec20e9b20ca1543d658d","observation_id":"e0e0006b-adc8-4ff4-a02f-f2762478bdd5","resolution":{"observed_at":"2026-06-28T22:13:39.317125Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T22:13:39.317125Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2605.31433","last_updated":"2026-05-29T15:28:26Z","snapshot_observed_at":"2026-08-08T06:49:37.449828Z","submitted_at":"2026-05-29T15:28:26Z","title":"SCOPE: Self-Play via Co-Evolving Policies for Open-Ended Tasks","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-06-28T22:13:39.317125Z"},"links":{"citing_paper":"/paper/2605.31433"},"observation_digest":"sha256:439b5f4875d10559c6a9f4aab4aeee8f65e41e67b8d6b4bb29597c0beb193e4b","observation_id":"90833e24-96e1-47cd-beba-4d1f3cf5f79b","resolution":{"observed_at":"2026-06-28T22:13:39.317125Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T22:13:39.317125Z","title":"name\":\"search","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2605.31433","last_updated":"2026-05-29T15:28:26Z","snapshot_observed_at":"2026-08-08T06:49:37.449828Z","submitted_at":"2026-05-29T15:28:26Z","title":"SCOPE: Self-Play via Co-Evolving Policies for Open-Ended Tasks","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-06-28T22:13:39.317125Z"},"links":{"citing_paper":"/paper/2605.31433"},"observation_digest":"sha256:4f93dbdc60ede7ae4f122a945dd7a10fde50084ff9ccb8f4c43cf27c258ca979","observation_id":"2ebb8ecf-e621-485f-86c7-951bf8787483","resolution":{"observed_at":"2026-06-28T22:13:39.317125Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T22:13:39.317125Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2605.31433","last_updated":"2026-05-29T15:28:26Z","snapshot_observed_at":"2026-08-08T06:49:37.449828Z","submitted_at":"2026-05-29T15:28:26Z","title":"SCOPE: Self-Play via Co-Evolving Policies for Open-Ended Tasks","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-06-28T22:13:39.317125Z"},"links":{"citing_paper":"/paper/2605.31433"},"observation_digest":"sha256:6f09e26de33cc09ce49f00a8a8b450656e6b5b6331370bacc435ed36b0725321","observation_id":"657ee2fb-0d71-4737-a614-c15408f95de9","resolution":{"observed_at":"2026-06-28T22:13:39.317125Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T22:13:39.317125Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2605.31433","last_updated":"2026-05-29T15:28:26Z","snapshot_observed_at":"2026-08-08T06:49:37.449828Z","submitted_at":"2026-05-29T15:28:26Z","title":"SCOPE: Self-Play via Co-Evolving Policies for Open-Ended Tasks","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-06-28T22:13:39.317125Z"},"links":{"citing_paper":"/paper/2605.31433"},"observation_digest":"sha256:50a3ce726f07d22a9789a47fd75cc93ec6829387b4a5c678b0f63ca72a871a57","observation_id":"276eb01a-d12f-407e-986c-01948bada1c5","resolution":{"observed_at":"2026-06-28T22:13:39.317125Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T22:13:39.317125Z","title":"The Judge evaluates a Solver response against a single rubric criterion with strict binary scoring (0 or 1)","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2605.31433","last_updated":"2026-05-29T15:28:26Z","snapshot_observed_at":"2026-08-08T06:49:37.449828Z","submitted_at":"2026-05-29T15:28:26Z","title":"SCOPE: Self-Play via Co-Evolving Policies for Open-Ended Tasks","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-06-28T22:13:39.317125Z"},"links":{"citing_paper":"/paper/2605.31433"},"observation_digest":"sha256:2dde5d81689aa91d2d72660c35c23dae19b5afb8dd2c6b5d666d98e69b0a5a48","observation_id":"07e31123-5035-47a5-97ab-b1739a0c2731","resolution":{"observed_at":"2026-06-28T22:13:39.317125Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T22:13:39.317125Z","title":"Each rubric contains a single clear requirement — not compound","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2605.31433","last_updated":"2026-05-29T15:28:26Z","snapshot_observed_at":"2026-08-08T06:49:37.449828Z","submitted_at":"2026-05-29T15:28:26Z","title":"SCOPE: Self-Play via Co-Evolving Policies for Open-Ended Tasks","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-06-28T22:13:39.317125Z"},"links":{"citing_paper":"/paper/2605.31433"},"observation_digest":"sha256:f760f62a05632eb0f2712283af777b72bb6c703a6e82e67bf846252e58ae82f3","observation_id":"e44fb9d7-6d01-48ee-b02f-173099d8d0f4","resolution":{"observed_at":"2026-06-28T22:13:39.317125Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T22:13:39.317125Z","title":"Command verbs: Addresses, Demonstrates, Provides, Incorporates, Synthesises, Identifies, Explains, Compares, Evaluates, Integrates, Supports, Applies","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2605.31433","last_updated":"2026-05-29T15:28:26Z","snapshot_observed_at":"2026-08-08T06:49:37.449828Z","submitted_at":"2026-05-29T15:28:26Z","title":"SCOPE: Self-Play via Co-Evolving Policies for Open-Ended Tasks","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-06-28T22:13:39.317125Z"},"links":{"citing_paper":"/paper/2605.31433"},"observation_digest":"sha256:77b2ba9d9033f47221390c7581a35d6a3bc5bfe32da5b702b82614fc22d62a12","observation_id":"36ca05e7-5673-44af-9a38-8e3e9537d794","resolution":{"observed_at":"2026-06-28T22:13:39.317125Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T22:13:39.317125Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2605.31433","last_updated":"2026-05-29T15:28:26Z","snapshot_observed_at":"2026-08-08T06:49:37.449828Z","submitted_at":"2026-05-29T15:28:26Z","title":"SCOPE: Self-Play via Co-Evolving Policies for Open-Ended Tasks","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-06-28T22:13:39.317125Z"},"links":{"citing_paper":"/paper/2605.31433"},"observation_digest":"sha256:dcd5666318402540b91810ca019c2a4097636220310b16ef041a9423a73860d5","observation_id":"e612c730-d0c9-4523-b096-122d6ba18f4f","resolution":{"observed_at":"2026-06-28T22:13:39.317125Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T22:13:39.317125Z","title":"critical|important|bonus","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2605.31433","last_updated":"2026-05-29T15:28:26Z","snapshot_observed_at":"2026-08-08T06:49:37.449828Z","submitted_at":"2026-05-29T15:28:26Z","title":"SCOPE: Self-Play via Co-Evolving Policies for Open-Ended Tasks","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-06-28T22:13:39.317125Z"},"links":{"citing_paper":"/paper/2605.31433"},"observation_digest":"sha256:2ee956ff8cbf57bffd5722fafc2db45947a7e4897eb182f4e738fd557811080e","observation_id":"9d6ec144-b8b6-412c-9e86-70727133b3a9","resolution":{"observed_at":"2026-06-28T22:13:39.317125Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2605.31433","last_updated":"2026-05-29T15:28:26Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-08T06:49:37.449828Z","submitted_at":"2026-05-29T15:28:26Z","title":"SCOPE: Self-Play via Co-Evolving Policies for Open-Ended Tasks"},"reference_resolution":{"displayed":24,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":23,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":24},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"thesis":"As of 18 August 2026, this Paper Citation Record lists 24 of 24 outbound references and 2 inbound Pith citation observations for arXiv:2605.31433."}