{"as_of":"2026-08-04T10:45:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:d3ad64935107918bfc86ba676976d9f2be79a748c9fdb14a5d0872200994468b","coverage":[{"denominator":46,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":46,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-12T01:24:22.084179Z","state":"measured"},{"denominator":47,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":47,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-04T06:34:03.388597+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-01T21:32:07.891524Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2605.08527","last_updated":"2026-05-08T22:20:24Z","snapshot_observed_at":"2026-07-06T23:20:43.010758Z","submitted_at":"2026-05-08T22:20:24Z","title":"MARLaaS: Multi-Tenant Asynchronous Reinforcement Learning as a Service","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.08527","snapshot_observed_at":"2026-08-01T21:32:07.891524Z","title":"MARLaaS: Multi-tenant asynchronous reinforcement learning as a service.arXiv preprint arXiv:2605.08527, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.16074","last_updated":"2026-07-17T15:58:20Z","snapshot_observed_at":"2026-08-01T21:31:54.206217Z","submitted_at":"2026-07-17T15:58:20Z","title":"JoyNexus: Service-Oriented Multi-Tenant Post-Training for VLA Models","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-01T21:32:07.891524Z"},"links":{"cited_paper":"/paper/2605.08527","citing_paper":"/paper/2607.16074"},"observation_digest":"sha256:9c3c32ebad5a7aad713761eb933715aae8eb86ec40e3d55019a078619e8994c1","observation_id":"5a6cdea9-f05a-4a65-ab48-a6ff933c0c5c","resolution":{"observed_at":"2026-08-01T21:32:07.891524Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2605.08527/citation-record","integrity":"/paper/2605.08527/integrity","json":"/paper/2605.08527/citation-record.json","paper":"/paper/2605.08527"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"2024 , eprint=","venue":null,"work_id":"0fc1fd74-f600-4e35-b553-8c096296616e","year":2024},"citing_paper":{"arxiv_id":"2605.08527","last_updated":"2026-05-08T22:20:24Z","snapshot_observed_at":"2026-07-06T23:20:43.010758Z","submitted_at":"2026-05-08T22:20:24Z","title":"MARLaaS: Multi-Tenant Asynchronous Reinforcement Learning as a Service","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-05-12T01:24:22.084179Z"},"links":{"citing_paper":"/paper/2605.08527"},"observation_digest":"sha256:c586c0f560ea4170a3cbe9805286d39fc5a4e5f4d2460003a32ed6b5f5e2009d","observation_id":"9144ec9f-07e5-4f77-9884-0c4a71b16d72","resolution":{"observed_at":"2026-05-14T07:24:48.146715Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.00754","last_updated":"2023-09-01T22:57:20Z","snapshot_observed_at":"2026-07-06T16:13:27.304874Z","submitted_at":"2023-09-01T22:57:20Z","title":"Efficient RLHF: Reducing the Memory Usage of PPO","version":1},"cited_work":{"arxiv_id":"2309.00754","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2309.00754","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Efficient rlhf: Reducing the memory usage of ppo","venue":null,"work_id":"e2d0c99e-7a62-48d8-9ee6-f0845b1a507e","year":2023},"citing_paper":{"arxiv_id":"2605.08527","last_updated":"2026-05-08T22:20:24Z","snapshot_observed_at":"2026-07-06T23:20:43.010758Z","submitted_at":"2026-05-08T22:20:24Z","title":"MARLaaS: Multi-Tenant Asynchronous Reinforcement Learning as a Service","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-05-12T01:24:22.084179Z"},"links":{"cited_paper":"/paper/2309.00754","citing_paper":"/paper/2605.08527"},"observation_digest":"sha256:0ef5e7641c3d3db5db2da6729f0f7879b88873cf445e4b3c995fbc2b1af98811","observation_id":"d5f26f3d-2527-426f-bff9-191c97966a0b","resolution":{"observed_at":"2026-05-12T08:01:28.609302Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"2026 , eprint=","venue":null,"work_id":"87e727d7-8c0b-4663-bfbf-0260e564b3b2","year":2026},"citing_paper":{"arxiv_id":"2605.08527","last_updated":"2026-05-08T22:20:24Z","snapshot_observed_at":"2026-07-06T23:20:43.010758Z","submitted_at":"2026-05-08T22:20:24Z","title":"MARLaaS: Multi-Tenant Asynchronous Reinforcement Learning as a Service","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-05-12T01:24:22.084179Z"},"links":{"citing_paper":"/paper/2605.08527"},"observation_digest":"sha256:6beef3f85887d111b21b6da8ab3dc7e3c4b74061b5e55723c12291bfa89364ea","observation_id":"73a6e424-0110-4ab4-84b8-75f43252d7ad","resolution":{"observed_at":"2026-05-14T07:24:48.070309Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"2026 , eprint=","venue":null,"work_id":"347c22f7-be89-4ad7-a619-fbd6d43208c3","year":2026},"citing_paper":{"arxiv_id":"2605.08527","last_updated":"2026-05-08T22:20:24Z","snapshot_observed_at":"2026-07-06T23:20:43.010758Z","submitted_at":"2026-05-08T22:20:24Z","title":"MARLaaS: Multi-Tenant Asynchronous Reinforcement Learning as a Service","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-05-12T01:24:22.084179Z"},"links":{"citing_paper":"/paper/2605.08527"},"observation_digest":"sha256:ef14ff646a8a3b6d31b6e9b5b2a4eb8a579d61e45ae52ee4d53ca561779010a4","observation_id":"d0d17aba-b0e8-463a-a828-f057596c760c","resolution":{"observed_at":"2026-05-14T07:24:48.120153Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Proceedings of the Nineteenth European Conference on Computer Systems , pages=","venue":null,"work_id":"7e2ffe72-d6a5-4015-adb3-dce59570c787","year":null},"citing_paper":{"arxiv_id":"2605.08527","last_updated":"2026-05-08T22:20:24Z","snapshot_observed_at":"2026-07-06T23:20:43.010758Z","submitted_at":"2026-05-08T22:20:24Z","title":"MARLaaS: Multi-Tenant Asynchronous Reinforcement Learning as a Service","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-05-12T01:24:22.084179Z"},"links":{"citing_paper":"/paper/2605.08527"},"observation_digest":"sha256:f04eda11a969e087602164cbd692e4306356c3a4bb40e42f4a62fd0f32583663","observation_id":"2edb90ee-9d7a-4372-8bf3-090712279cc1","resolution":{"observed_at":"2026-05-14T07:24:48.033700Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"TechRxiv , year =","venue":null,"work_id":"3a1c0024-d967-49ec-8487-8424708dcb3d","year":null},"citing_paper":{"arxiv_id":"2605.08527","last_updated":"2026-05-08T22:20:24Z","snapshot_observed_at":"2026-07-06T23:20:43.010758Z","submitted_at":"2026-05-08T22:20:24Z","title":"MARLaaS: Multi-Tenant Asynchronous Reinforcement Learning as a Service","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-05-12T01:24:22.084179Z"},"links":{"citing_paper":"/paper/2605.08527"},"observation_digest":"sha256:0718ba7c37f7301826b05b0afde7d69228b1690d207f4ce935a9700bf3cf21dc","observation_id":"9729d5fe-820d-40a1-a4b9-34c42713f0a1","resolution":{"observed_at":"2026-05-14T07:24:48.040800Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"2018 , eprint=","venue":null,"work_id":"dab53dd6-3300-4585-8afc-bc9bd5c69540","year":2018},"citing_paper":{"arxiv_id":"2605.08527","last_updated":"2026-05-08T22:20:24Z","snapshot_observed_at":"2026-07-06T23:20:43.010758Z","submitted_at":"2026-05-08T22:20:24Z","title":"MARLaaS: Multi-Tenant Asynchronous Reinforcement Learning as a Service","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-05-12T01:24:22.084179Z"},"links":{"citing_paper":"/paper/2605.08527"},"observation_digest":"sha256:1fe97bcf40b60ebda096a3f959e687f9b270be44c1688ec6c50ff95a7d22f51e","observation_id":"d00dd70c-0fbf-4fa6-a035-9cd26ad60f90","resolution":{"observed_at":"2026-05-14T07:24:48.052264Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"9031.369607","doi":"10.1145/3689031.3696072","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Hybridflow: A flexible and efficient rlhf framework","venue":null,"work_id":"4909736c-3fe1-4820-b489-cca51669c6d2","year":2025},"citing_paper":{"arxiv_id":"2605.08527","last_updated":"2026-05-08T22:20:24Z","snapshot_observed_at":"2026-07-06T23:20:43.010758Z","submitted_at":"2026-05-08T22:20:24Z","title":"MARLaaS: Multi-Tenant Asynchronous Reinforcement Learning as a Service","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-05-12T01:24:22.084179Z"},"links":{"citing_paper":"/paper/2605.08527"},"observation_digest":"sha256:763d23875004a106bb78a179771cb57a3693b1e98889e66f2f55d2875a517411","observation_id":"89b6ca72-31f0-4c5c-8113-f056ea4e81b4","resolution":{"observed_at":"2026-05-12T01:26:15.875128Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"2023 , eprint=","venue":null,"work_id":"9bb11342-caa0-40e3-8925-d7e4c7e44817","year":2023},"citing_paper":{"arxiv_id":"2605.08527","last_updated":"2026-05-08T22:20:24Z","snapshot_observed_at":"2026-07-06T23:20:43.010758Z","submitted_at":"2026-05-08T22:20:24Z","title":"MARLaaS: Multi-Tenant Asynchronous Reinforcement Learning as a Service","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-05-12T01:24:22.084179Z"},"links":{"citing_paper":"/paper/2605.08527"},"observation_digest":"sha256:27a7077fa25778716f6785f3f7b682a00b97d9162a8a1fd688d8fda486929a86","observation_id":"5a9bacb5-5adc-40bd-991a-27bd9a8fc0b5","resolution":{"observed_at":"2026-05-14T07:24:48.134925Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"2026 , howpublished =","venue":null,"work_id":"233b2f50-2d28-4b4b-94ea-b2ae1b1f59c3","year":2026},"citing_paper":{"arxiv_id":"2605.08527","last_updated":"2026-05-08T22:20:24Z","snapshot_observed_at":"2026-07-06T23:20:43.010758Z","submitted_at":"2026-05-08T22:20:24Z","title":"MARLaaS: Multi-Tenant Asynchronous Reinforcement Learning as a Service","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-05-12T01:24:22.084179Z"},"links":{"citing_paper":"/paper/2605.08527"},"observation_digest":"sha256:f71e77c8d64f32a15b909c674e149b536cd39771573050b9e1b23f5eea9e9726","observation_id":"3a3563e4-8287-43d4-9165-e0d4e32d5edd","resolution":{"observed_at":"2026-05-14T07:24:48.230697Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T03:08:01.253485Z","title":"2021 , eprint=","venue":null,"work_id":"8e6d7443-6b29-4f76-94d1-3661d5f2a5ec","year":2021},"citing_paper":{"arxiv_id":"2605.08527","last_updated":"2026-05-08T22:20:24Z","snapshot_observed_at":"2026-07-06T23:20:43.010758Z","submitted_at":"2026-05-08T22:20:24Z","title":"MARLaaS: Multi-Tenant Asynchronous Reinforcement Learning as a Service","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-05-12T01:24:22.084179Z"},"links":{"citing_paper":"/paper/2605.08527"},"observation_digest":"sha256:6177744750e67938383e87b6f6934bfad5907b535d794c0d23009cc05b00a82f","observation_id":"2dba6575-3978-49db-8af9-f595c1705d87","resolution":{"observed_at":"2026-05-14T07:24:48.235516Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2110.14168","last_updated":"2021-11-18T00:23:45Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-10-27T04:49:45Z","title":"Training Verifiers to Solve Math Word Problems","version":2},"cited_work":{"arxiv_id":"2110.14168","doi":"10.1002/j.1545-","metadata_source":"pith","pith_arxiv_id":"2110.14168","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Training Verifiers to Solve Math Word Problems","venue":"cs.LG","work_id":"acab1aa8-b4d6-40e0-a3ee-25341701dca2","year":2021},"citing_paper":{"arxiv_id":"2605.08527","last_updated":"2026-05-08T22:20:24Z","snapshot_observed_at":"2026-07-06T23:20:43.010758Z","submitted_at":"2026-05-08T22:20:24Z","title":"MARLaaS: Multi-Tenant Asynchronous Reinforcement Learning as a Service","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-05-12T01:24:22.084179Z"},"links":{"cited_paper":"/paper/2110.14168","citing_paper":"/paper/2605.08527"},"observation_digest":"sha256:390dc1f2ed459f6dc4ef9cfc6cd36c8582e009b418cd19dfd3d138f64a0614d9","observation_id":"fa11e605-7312-48cb-b5ee-3e1dbff75337","resolution":{"observed_at":"2026-05-12T08:01:28.597480Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"2026 , eprint=","venue":null,"work_id":"0b1639fd-4304-4a08-bba0-24c35d5f9baa","year":2026},"citing_paper":{"arxiv_id":"2605.08527","last_updated":"2026-05-08T22:20:24Z","snapshot_observed_at":"2026-07-06T23:20:43.010758Z","submitted_at":"2026-05-08T22:20:24Z","title":"MARLaaS: Multi-Tenant Asynchronous Reinforcement Learning as a Service","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-05-12T01:24:22.084179Z"},"links":{"citing_paper":"/paper/2605.08527"},"observation_digest":"sha256:99c8317bdc728f3f0e440d4ca67d7963a7a1e00fcdb49d53925bfb43c8a3b8c9","observation_id":"3129026d-152a-4a4d-9981-2dff9fd71c39","resolution":{"observed_at":"2026-05-14T07:24:48.171409Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"2026 , month = feb, howpublished =","venue":null,"work_id":"eb73d8e7-b855-4525-83d7-80c34672eb10","year":2026},"citing_paper":{"arxiv_id":"2605.08527","last_updated":"2026-05-08T22:20:24Z","snapshot_observed_at":"2026-07-06T23:20:43.010758Z","submitted_at":"2026-05-08T22:20:24Z","title":"MARLaaS: Multi-Tenant Asynchronous Reinforcement Learning as a Service","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-05-12T01:24:22.084179Z"},"links":{"citing_paper":"/paper/2605.08527"},"observation_digest":"sha256:b23a29b8d6ebe3a43804ceeb9e6911f89c26479aff5e5434c4b49dceeef2d173","observation_id":"4e58b224-7fe4-4d89-bb89-6855b6845383","resolution":{"observed_at":"2026-05-14T07:24:48.107752Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"2025 , eprint=","venue":null,"work_id":"d484411c-13b9-4a06-a086-7a55c113c28e","year":2025},"citing_paper":{"arxiv_id":"2605.08527","last_updated":"2026-05-08T22:20:24Z","snapshot_observed_at":"2026-07-06T23:20:43.010758Z","submitted_at":"2026-05-08T22:20:24Z","title":"MARLaaS: Multi-Tenant Asynchronous Reinforcement Learning as a Service","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-05-12T01:24:22.084179Z"},"links":{"citing_paper":"/paper/2605.08527"},"observation_digest":"sha256:7c3cd945b90da37afa9d8f25c1f4286a502048bca7c34e69bf027b7884dae001","observation_id":"2cee85e7-8d4e-48eb-92d3-26809bdf6df0","resolution":{"observed_at":"2026-05-14T07:24:48.216563Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-06T01:01:40.153043Z","title":"2023 , eprint=","venue":null,"work_id":"61a7f775-1799-4759-b1d5-246c33ee6c69","year":2023},"citing_paper":{"arxiv_id":"2605.08527","last_updated":"2026-05-08T22:20:24Z","snapshot_observed_at":"2026-07-06T23:20:43.010758Z","submitted_at":"2026-05-08T22:20:24Z","title":"MARLaaS: Multi-Tenant Asynchronous Reinforcement Learning as a Service","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-05-12T01:24:22.084179Z"},"links":{"citing_paper":"/paper/2605.08527"},"observation_digest":"sha256:94265d699307e193eb95d576c9db4532da1f42806bb2eed894f772855f3fdca4","observation_id":"78db1c82-c69c-4f69-a0ba-e0e7f8ddb726","resolution":{"observed_at":"2026-05-14T07:24:48.080787Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"2022 , eprint=","venue":null,"work_id":"37b2ad29-a42f-4662-9e07-224c2d79bba0","year":2022},"citing_paper":{"arxiv_id":"2605.08527","last_updated":"2026-05-08T22:20:24Z","snapshot_observed_at":"2026-07-06T23:20:43.010758Z","submitted_at":"2026-05-08T22:20:24Z","title":"MARLaaS: Multi-Tenant Asynchronous Reinforcement Learning as a Service","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-05-12T01:24:22.084179Z"},"links":{"citing_paper":"/paper/2605.08527"},"observation_digest":"sha256:8bfee451055cc5e901ea405be63212adc002e364bc4e1851833bcc2b52c4ed2b","observation_id":"389d27cb-02f2-4138-a803-cba0c3b2dd4e","resolution":{"observed_at":"2026-05-14T07:24:48.125735Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"22nd USENIX Symposium on Networked Systems Design and Implementation (NSDI 25) , year =","venue":null,"work_id":"8738dc6b-00e8-4dfe-89b2-c500655e73d2","year":null},"citing_paper":{"arxiv_id":"2605.08527","last_updated":"2026-05-08T22:20:24Z","snapshot_observed_at":"2026-07-06T23:20:43.010758Z","submitted_at":"2026-05-08T22:20:24Z","title":"MARLaaS: Multi-Tenant Asynchronous Reinforcement Learning as a Service","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-05-12T01:24:22.084179Z"},"links":{"citing_paper":"/paper/2605.08527"},"observation_digest":"sha256:24810668856e169beced2b106a512660b2f839af323aaa015214a5d9fd30b196","observation_id":"6b6b2b24-03af-4984-a90b-52f009ce5663","resolution":{"observed_at":"2026-05-14T07:24:48.210373Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"2025 , eprint=","venue":null,"work_id":"66db4e7d-351b-45d8-93a3-986ca092588d","year":2025},"citing_paper":{"arxiv_id":"2605.08527","last_updated":"2026-05-08T22:20:24Z","snapshot_observed_at":"2026-07-06T23:20:43.010758Z","submitted_at":"2026-05-08T22:20:24Z","title":"MARLaaS: Multi-Tenant Asynchronous Reinforcement Learning as a Service","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-05-12T01:24:22.084179Z"},"links":{"citing_paper":"/paper/2605.08527"},"observation_digest":"sha256:419805af40b7d0fcc0b2877f30a644cbc20c13770eeef7fede8d4e5001c36571","observation_id":"be6d2254-649f-40af-8f7d-96ecf7b7b6d2","resolution":{"observed_at":"2026-05-14T07:24:48.223013Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"2025 , eprint=","venue":null,"work_id":"70617102-d51e-487b-85ec-4bea15cca19b","year":2025},"citing_paper":{"arxiv_id":"2605.08527","last_updated":"2026-05-08T22:20:24Z","snapshot_observed_at":"2026-07-06T23:20:43.010758Z","submitted_at":"2026-05-08T22:20:24Z","title":"MARLaaS: Multi-Tenant Asynchronous Reinforcement Learning as a Service","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-05-12T01:24:22.084179Z"},"links":{"citing_paper":"/paper/2605.08527"},"observation_digest":"sha256:d0ac6b7060a451042a9e2521b17d838b97c247725b0b32123eda01f8b34b2387","observation_id":"b4f13ed0-f77b-486e-8419-d5d57df1c7a8","resolution":{"observed_at":"2026-05-14T07:24:48.266342Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T14:46:18.175074Z","title":"2024 , eprint=","venue":null,"work_id":"d91f5ad8-9be3-4ce1-b79f-8f0030ecf52e","year":2024},"citing_paper":{"arxiv_id":"2605.08527","last_updated":"2026-05-08T22:20:24Z","snapshot_observed_at":"2026-07-06T23:20:43.010758Z","submitted_at":"2026-05-08T22:20:24Z","title":"MARLaaS: Multi-Tenant Asynchronous Reinforcement Learning as a Service","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-05-12T01:24:22.084179Z"},"links":{"citing_paper":"/paper/2605.08527"},"observation_digest":"sha256:9013b7604ce02b9b41fce04d93fb09db175d8a941ff843600d6ccce1460b5e6f","observation_id":"9b67a563-9606-4950-9551-b0bf57242ba4","resolution":{"observed_at":"2026-05-14T07:24:48.205535Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T14:46:18.243842Z","title":"2017 , eprint=","venue":null,"work_id":"5a794cfe-c0fb-4191-a347-b4e935d39d00","year":2017},"citing_paper":{"arxiv_id":"2605.08527","last_updated":"2026-05-08T22:20:24Z","snapshot_observed_at":"2026-07-06T23:20:43.010758Z","submitted_at":"2026-05-08T22:20:24Z","title":"MARLaaS: Multi-Tenant Asynchronous Reinforcement Learning as a Service","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-05-12T01:24:22.084179Z"},"links":{"citing_paper":"/paper/2605.08527"},"observation_digest":"sha256:af882fc85616302954b9c0bf4385e497482891d6b5ae5d98d62ebc5e26d7a995","observation_id":"64fb6bd5-669c-4ade-864c-e78946c53277","resolution":{"observed_at":"2026-05-14T07:24:48.159466Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-06T11:32:21.995696Z","title":"2022 , eprint=","venue":null,"work_id":"290b799d-7b6d-426f-b12b-1d750d415539","year":2022},"citing_paper":{"arxiv_id":"2605.08527","last_updated":"2026-05-08T22:20:24Z","snapshot_observed_at":"2026-07-06T23:20:43.010758Z","submitted_at":"2026-05-08T22:20:24Z","title":"MARLaaS: Multi-Tenant Asynchronous Reinforcement Learning as a Service","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-05-12T01:24:22.084179Z"},"links":{"citing_paper":"/paper/2605.08527"},"observation_digest":"sha256:6ba963dc7f0a97ee489ba01bfcdc4ff68ae306c50cf6afa76ad11ec410ad6f2e","observation_id":"6b32fdda-0845-4e7a-b652-8124320a4378","resolution":{"observed_at":"2026-05-14T07:24:48.166118Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T22:57:43.199137Z","title":"2024 , eprint=","venue":null,"work_id":"56de79bb-a384-4567-8274-19e8bfa69568","year":2024},"citing_paper":{"arxiv_id":"2605.08527","last_updated":"2026-05-08T22:20:24Z","snapshot_observed_at":"2026-07-06T23:20:43.010758Z","submitted_at":"2026-05-08T22:20:24Z","title":"MARLaaS: Multi-Tenant Asynchronous Reinforcement Learning as a Service","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-05-12T01:24:22.084179Z"},"links":{"citing_paper":"/paper/2605.08527"},"observation_digest":"sha256:343a94fe634f1db5f16afac943aa2b996006078bcd44b958bdd27ccc10b51faf","observation_id":"729e9769-42be-4338-8080-afef9350dae1","resolution":{"observed_at":"2026-05-14T07:24:48.200203Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-06T02:01:49.837957Z","title":"2023 , eprint=","venue":null,"work_id":"b03ed08b-9c21-439e-88e1-581742bdacde","year":2023},"citing_paper":{"arxiv_id":"2605.08527","last_updated":"2026-05-08T22:20:24Z","snapshot_observed_at":"2026-07-06T23:20:43.010758Z","submitted_at":"2026-05-08T22:20:24Z","title":"MARLaaS: Multi-Tenant Asynchronous Reinforcement Learning as a Service","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-05-12T01:24:22.084179Z"},"links":{"citing_paper":"/paper/2605.08527"},"observation_digest":"sha256:c5b82554847ef9b0a79fd38a45c9b087046cec784d5498eff24f47fe0166b0bf","observation_id":"b6a3b8d0-c047-4d8a-b403-93fdd5fad306","resolution":{"observed_at":"2026-05-14T07:24:48.076076Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Nature , volume=","venue":null,"work_id":"61b43415-ad67-4456-ad24-1fe2cb3b6a54","year":2025},"citing_paper":{"arxiv_id":"2605.08527","last_updated":"2026-05-08T22:20:24Z","snapshot_observed_at":"2026-07-06T23:20:43.010758Z","submitted_at":"2026-05-08T22:20:24Z","title":"MARLaaS: Multi-Tenant Asynchronous Reinforcement Learning as a Service","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-05-12T01:24:22.084179Z"},"links":{"citing_paper":"/paper/2605.08527"},"observation_digest":"sha256:acbc42ea809c5f128fb2c24a9d667e4737a79cb5229efefabb9f93868d566d48","observation_id":"f977a4cf-1773-46c9-a3b2-06b04b4c80b7","resolution":{"observed_at":"2026-05-14T07:24:48.064833Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T14:46:18.238303Z","title":"2022 , eprint=","venue":null,"work_id":"5903b651-f252-45b3-9845-98a1abf380ae","year":2022},"citing_paper":{"arxiv_id":"2605.08527","last_updated":"2026-05-08T22:20:24Z","snapshot_observed_at":"2026-07-06T23:20:43.010758Z","submitted_at":"2026-05-08T22:20:24Z","title":"MARLaaS: Multi-Tenant Asynchronous Reinforcement Learning as a Service","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-05-12T01:24:22.084179Z"},"links":{"citing_paper":"/paper/2605.08527"},"observation_digest":"sha256:a049072af281a12e2e40ccc53db27a1c82b60e21e72e5da79199a932b78c0000","observation_id":"b408eba3-cfae-4e0a-aaa2-3fcb60a929d6","resolution":{"observed_at":"2026-05-14T07:24:48.251679Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"2024 , eprint=","venue":null,"work_id":"8f85c215-128f-487c-9381-6b7a026aa471","year":2024},"citing_paper":{"arxiv_id":"2605.08527","last_updated":"2026-05-08T22:20:24Z","snapshot_observed_at":"2026-07-06T23:20:43.010758Z","submitted_at":"2026-05-08T22:20:24Z","title":"MARLaaS: Multi-Tenant Asynchronous Reinforcement Learning as a Service","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-05-12T01:24:22.084179Z"},"links":{"citing_paper":"/paper/2605.08527"},"observation_digest":"sha256:b8160492ced736cf5c4d17400aae6b1bd6b2c790d9219278375025fa4e721882","observation_id":"009d167d-db1f-48aa-8cc9-3c6eee449a77","resolution":{"observed_at":"2026-05-14T07:24:48.260794Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"2022 USENIX Annual Technical Conference (USENIX ATC 22) , pages=","venue":null,"work_id":"adbad1aa-cd19-40b3-8c09-a20fd16b4ac2","year":2022},"citing_paper":{"arxiv_id":"2605.08527","last_updated":"2026-05-08T22:20:24Z","snapshot_observed_at":"2026-07-06T23:20:43.010758Z","submitted_at":"2026-05-08T22:20:24Z","title":"MARLaaS: Multi-Tenant Asynchronous Reinforcement Learning as a Service","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-05-12T01:24:22.084179Z"},"links":{"citing_paper":"/paper/2605.08527"},"observation_digest":"sha256:ef7aa6397d8ef8e5f300635c77ed56240e6d5fa4bccc54aa6ddc141ff8c474d5","observation_id":"9f18295a-9efe-4f87-a9c4-793f3843d7b4","resolution":{"observed_at":"2026-05-14T07:24:48.190305Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"2025 , eprint=","venue":null,"work_id":"b2b5e75e-6816-4f66-b365-0b2a4d8bc053","year":2025},"citing_paper":{"arxiv_id":"2605.08527","last_updated":"2026-05-08T22:20:24Z","snapshot_observed_at":"2026-07-06T23:20:43.010758Z","submitted_at":"2026-05-08T22:20:24Z","title":"MARLaaS: Multi-Tenant Asynchronous Reinforcement Learning as a Service","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-05-12T01:24:22.084179Z"},"links":{"citing_paper":"/paper/2605.08527"},"observation_digest":"sha256:62dd0fa3dc32aae0218e1e96355d8aadb789ed47877f5c2489e1e0b63762578d","observation_id":"18275f55-721f-49b8-aaa9-f5513325fed5","resolution":{"observed_at":"2026-05-14T07:24:48.244805Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"2025 , eprint=","venue":null,"work_id":"549fa26d-fb7c-418f-8295-a6f0d07de292","year":2025},"citing_paper":{"arxiv_id":"2605.08527","last_updated":"2026-05-08T22:20:24Z","snapshot_observed_at":"2026-07-06T23:20:43.010758Z","submitted_at":"2026-05-08T22:20:24Z","title":"MARLaaS: Multi-Tenant Asynchronous Reinforcement Learning as a Service","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-05-12T01:24:22.084179Z"},"links":{"citing_paper":"/paper/2605.08527"},"observation_digest":"sha256:0d96e5249364a2527253d7c08233a8ee12c8f6c0a493ae14017fdca781a08ac8","observation_id":"b8e12e54-30ec-415a-8e39-85820ce062c9","resolution":{"observed_at":"2026-05-14T07:24:48.271153Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"2025 , eprint=","venue":null,"work_id":"4f73b414-0803-4369-96e3-fd3e54857d3a","year":2025},"citing_paper":{"arxiv_id":"2605.08527","last_updated":"2026-05-08T22:20:24Z","snapshot_observed_at":"2026-07-06T23:20:43.010758Z","submitted_at":"2026-05-08T22:20:24Z","title":"MARLaaS: Multi-Tenant Asynchronous Reinforcement Learning as a Service","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-05-12T01:24:22.084179Z"},"links":{"citing_paper":"/paper/2605.08527"},"observation_digest":"sha256:7ccd2e294f56e77716f697758b153b8b8dc46f8d0794bdd9d96a4b449cc8cc6e","observation_id":"13e32f5a-26e3-4545-96a4-41fc0cf2698d","resolution":{"observed_at":"2026-05-14T07:24:48.045263Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"2025 , eprint=","venue":null,"work_id":"e3969ffd-b72f-424b-a607-0d1dfd1772d6","year":2025},"citing_paper":{"arxiv_id":"2605.08527","last_updated":"2026-05-08T22:20:24Z","snapshot_observed_at":"2026-07-06T23:20:43.010758Z","submitted_at":"2026-05-08T22:20:24Z","title":"MARLaaS: Multi-Tenant Asynchronous Reinforcement Learning as a Service","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-05-12T01:24:22.084179Z"},"links":{"citing_paper":"/paper/2605.08527"},"observation_digest":"sha256:4fd1ae3132a40a1a4de72e0e0d6042d92e6239fa8772ca476d77495b59a0f4f8","observation_id":"546205c6-ca7f-46a2-91bb-a9366a8e4333","resolution":{"observed_at":"2026-05-14T07:24:48.178102Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"2023 , eprint=","venue":null,"work_id":"df1470b3-09e9-47f0-a195-7c73e51f3be4","year":2023},"citing_paper":{"arxiv_id":"2605.08527","last_updated":"2026-05-08T22:20:24Z","snapshot_observed_at":"2026-07-06T23:20:43.010758Z","submitted_at":"2026-05-08T22:20:24Z","title":"MARLaaS: Multi-Tenant Asynchronous Reinforcement Learning as a Service","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-05-12T01:24:22.084179Z"},"links":{"citing_paper":"/paper/2605.08527"},"observation_digest":"sha256:bb5108372c5ec17ea81d4ed3db3c56f888b2d972cbbe375309d74bb616d7bce1","observation_id":"a6d37b55-456d-4d5f-bafe-eb1b99498bb5","resolution":{"observed_at":"2026-05-14T07:24:48.183007Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"2024 , eprint=","venue":null,"work_id":"96d33d05-27a9-4743-a280-59c1712187f5","year":2024},"citing_paper":{"arxiv_id":"2605.08527","last_updated":"2026-05-08T22:20:24Z","snapshot_observed_at":"2026-07-06T23:20:43.010758Z","submitted_at":"2026-05-08T22:20:24Z","title":"MARLaaS: Multi-Tenant Asynchronous Reinforcement Learning as a Service","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-05-12T01:24:22.084179Z"},"links":{"citing_paper":"/paper/2605.08527"},"observation_digest":"sha256:ff90c9eeb10417d99978ea402b0e6d68b4a43fa25b22ec5efc35a9358812e8ee","observation_id":"dac389a0-75d9-4285-88e9-b2a76e6530d9","resolution":{"observed_at":"2026-05-14T07:24:48.114618Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"2025 , eprint=","venue":null,"work_id":"69abb8bf-890d-4d6e-90da-bf6a9c38468e","year":2025},"citing_paper":{"arxiv_id":"2605.08527","last_updated":"2026-05-08T22:20:24Z","snapshot_observed_at":"2026-07-06T23:20:43.010758Z","submitted_at":"2026-05-08T22:20:24Z","title":"MARLaaS: Multi-Tenant Asynchronous Reinforcement Learning as a Service","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-05-12T01:24:22.084179Z"},"links":{"citing_paper":"/paper/2605.08527"},"observation_digest":"sha256:8889a4326e8cd8abc5363597fe1200c4cecf04250066ce906df7b61cd485e4c2","observation_id":"225662e2-dd70-4e67-a2ac-8427ad8dcceb","resolution":{"observed_at":"2026-05-14T07:24:48.151507Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"2024 , eprint=","venue":null,"work_id":"4b5dcdd3-460c-447b-ab13-e6a1a79f7c96","year":2024},"citing_paper":{"arxiv_id":"2605.08527","last_updated":"2026-05-08T22:20:24Z","snapshot_observed_at":"2026-07-06T23:20:43.010758Z","submitted_at":"2026-05-08T22:20:24Z","title":"MARLaaS: Multi-Tenant Asynchronous Reinforcement Learning as a Service","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-05-12T01:24:22.084179Z"},"links":{"citing_paper":"/paper/2605.08527"},"observation_digest":"sha256:0ecc900537a75f11c28dd5d9274ddec7354a597483cef00cdae5b6a21bbab2cb","observation_id":"3789710a-0af5-4085-a045-a0b88073059b","resolution":{"observed_at":"2026-05-14T07:24:48.277043Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T20:07:34.119737Z","title":"Langley , title =","venue":null,"work_id":"6cd283dc-0548-45e9-af07-6bc1005593ad","year":2000},"citing_paper":{"arxiv_id":"2605.08527","last_updated":"2026-05-08T22:20:24Z","snapshot_observed_at":"2026-07-06T23:20:43.010758Z","submitted_at":"2026-05-08T22:20:24Z","title":"MARLaaS: Multi-Tenant Asynchronous Reinforcement Learning as a Service","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-05-12T01:24:22.084179Z"},"links":{"citing_paper":"/paper/2605.08527"},"observation_digest":"sha256:f0bc1ada03ed83f907617f881a83fcd3a553c44fd0721b84ea801f6b98de7be1","observation_id":"a8f5f6d3-304e-4065-85ff-5809eeed78d4","resolution":{"observed_at":"2026-05-14T07:24:48.021610Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T00:47:54.976173Z","title":null,"venue":null,"work_id":"6b09bca6-ef5d-4a83-8c8e-219f23cbd761","year":1980},"citing_paper":{"arxiv_id":"2605.08527","last_updated":"2026-05-08T22:20:24Z","snapshot_observed_at":"2026-07-06T23:20:43.010758Z","submitted_at":"2026-05-08T22:20:24Z","title":"MARLaaS: Multi-Tenant Asynchronous Reinforcement Learning as a Service","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-05-12T01:24:22.084179Z"},"links":{"citing_paper":"/paper/2605.08527"},"observation_digest":"sha256:4d2310d1ae416a915c720fae910aa7b74e0ea3422702960d703187b86b7f374f","observation_id":"0a253ed9-1c8b-4582-9385-2bef97a21e8d","resolution":{"observed_at":"2026-05-14T07:24:48.087684Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T00:47:54.841265Z","title":null,"venue":null,"work_id":"8efd8073-6f5d-45c5-94d5-62d366b52518","year":null},"citing_paper":{"arxiv_id":"2605.08527","last_updated":"2026-05-08T22:20:24Z","snapshot_observed_at":"2026-07-06T23:20:43.010758Z","submitted_at":"2026-05-08T22:20:24Z","title":"MARLaaS: Multi-Tenant Asynchronous Reinforcement Learning as a Service","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-05-12T01:24:22.084179Z"},"links":{"citing_paper":"/paper/2605.08527"},"observation_digest":"sha256:505d3bada18cafff3e68609d4a4e06ccadbcfed323d98d606654b8f862ff8380","observation_id":"1a82fa50-20b3-4036-bfe4-eac0cfdf66a5","resolution":{"observed_at":"2026-05-14T07:24:48.015117Z","resolver_source":"raw_fallback","status":"parse_uncertain"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T00:47:54.783905Z","title":null,"venue":null,"work_id":"51835800-f16e-4534-8339-d3ea09147556","year":1983},"citing_paper":{"arxiv_id":"2605.08527","last_updated":"2026-05-08T22:20:24Z","snapshot_observed_at":"2026-07-06T23:20:43.010758Z","submitted_at":"2026-05-08T22:20:24Z","title":"MARLaaS: Multi-Tenant Asynchronous Reinforcement Learning as a Service","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-05-12T01:24:22.084179Z"},"links":{"citing_paper":"/paper/2605.08527"},"observation_digest":"sha256:6f5a0c3e9e0681005585498d1f5903a6266c1aa1b2255b8bea376e1d5b4f1352","observation_id":"c7478caf-cd17-4deb-8795-bb57777eb2f9","resolution":{"observed_at":"2026-05-14T07:24:48.093449Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"2025 , eprint=","venue":null,"work_id":"56d2f15d-6086-48ff-8cd6-dcdf035f319d","year":2025},"citing_paper":{"arxiv_id":"2605.08527","last_updated":"2026-05-08T22:20:24Z","snapshot_observed_at":"2026-07-06T23:20:43.010758Z","submitted_at":"2026-05-08T22:20:24Z","title":"MARLaaS: Multi-Tenant Asynchronous Reinforcement Learning as a Service","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-05-12T01:24:22.084179Z"},"links":{"citing_paper":"/paper/2605.08527"},"observation_digest":"sha256:73175ef9e93e06511fb0e38a6563b794def8258d43dee6e6acf79b009e68f27f","observation_id":"2217c2e4-888d-4fc7-abc2-ef1f386e500c","resolution":{"observed_at":"2026-05-14T07:24:48.026355Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2728.374275","doi":"10.14778/3742728.3742752","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"LobRA: Multi-Tenant Fine-Tuning over Heterogeneous Data , volume=","venue":null,"work_id":"e75d5621-5aef-4d62-a6f4-389c33595c9b","year":2025},"citing_paper":{"arxiv_id":"2605.08527","last_updated":"2026-05-08T22:20:24Z","snapshot_observed_at":"2026-07-06T23:20:43.010758Z","submitted_at":"2026-05-08T22:20:24Z","title":"MARLaaS: Multi-Tenant Asynchronous Reinforcement Learning as a Service","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-05-12T01:24:22.084179Z"},"links":{"citing_paper":"/paper/2605.08527"},"observation_digest":"sha256:a3723bcd5f6c5091214f7c9b30900cd11dacedf7ac5f233161b7720b54288a83","observation_id":"a4a78ead-d5b8-4563-8fc0-15d019adad4d","resolution":{"observed_at":"2026-05-12T01:26:15.868044Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T04:46:46.775981Z","title":"2025 , eprint=","venue":null,"work_id":"26c7b6ed-f86e-4ed8-b9ed-b1783d90255b","year":2025},"citing_paper":{"arxiv_id":"2605.08527","last_updated":"2026-05-08T22:20:24Z","snapshot_observed_at":"2026-07-06T23:20:43.010758Z","submitted_at":"2026-05-08T22:20:24Z","title":"MARLaaS: Multi-Tenant Asynchronous Reinforcement Learning as a Service","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-05-12T01:24:22.084179Z"},"links":{"citing_paper":"/paper/2605.08527"},"observation_digest":"sha256:be734c24635e776d8cfa54c1493e7711a2ff8e733bb788d4b80ddd7386fd6eb4","observation_id":"095b6bfb-cd5c-4818-9ef5-2137c25e9995","resolution":{"observed_at":"2026-05-14T07:24:48.281808Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"2025 , eprint=","venue":null,"work_id":"f68de386-35d2-4ddb-8965-d7c0d3ac96b7","year":2025},"citing_paper":{"arxiv_id":"2605.08527","last_updated":"2026-05-08T22:20:24Z","snapshot_observed_at":"2026-07-06T23:20:43.010758Z","submitted_at":"2026-05-08T22:20:24Z","title":"MARLaaS: Multi-Tenant Asynchronous Reinforcement Learning as a Service","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-05-12T01:24:22.084179Z"},"links":{"citing_paper":"/paper/2605.08527"},"observation_digest":"sha256:b2767181b76b23c58bd9284a7a2f2c441c4dc1c61830f8bd36906fc103bfb709","observation_id":"26a871ec-1cad-4e91-9c90-d3e8421b587e","resolution":{"observed_at":"2026-05-14T07:24:48.056985Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T14:26:20.598827Z","title":"2023 , eprint=","venue":null,"work_id":"24d5ea36-553e-4692-8cc6-435e8690a705","year":2023},"citing_paper":{"arxiv_id":"2605.08527","last_updated":"2026-05-08T22:20:24Z","snapshot_observed_at":"2026-07-06T23:20:43.010758Z","submitted_at":"2026-05-08T22:20:24Z","title":"MARLaaS: Multi-Tenant Asynchronous Reinforcement Learning as a Service","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-05-12T01:24:22.084179Z"},"links":{"citing_paper":"/paper/2605.08527"},"observation_digest":"sha256:b77154ae24d22df47639e435d1b1acb72daeb242cbd527d96aec852112e490ed","observation_id":"1f16cc9e-be1d-4cad-bbcf-bc8349d45480","resolution":{"observed_at":"2026-05-14T07:24:48.141184Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2605.08527","last_updated":"2026-05-08T22:20:24Z","latest_version":1,"primary_category":"cs.DC","snapshot_observed_at":"2026-07-06T23:20:43.010758Z","submitted_at":"2026-05-08T22:20:24Z","title":"MARLaaS: Multi-Tenant Asynchronous Reinforcement Learning as a Service"},"reference_resolution":{"displayed":46,"state_counts":{"malformed_identifier":0,"metadata_mismatch":3,"parse_uncertain":1,"unresolved":2,"verified_exact":1,"verified_fuzzy":39},"total_outbound_references":46},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"thesis":"As of 4 August 2026, this Paper Citation Record lists 46 of 46 outbound references and 1 inbound Pith citation observation for arXiv:2605.08527."}