{"as_of":"2026-08-18T04:31:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:9e165f65232125fba36c200fffd5f2eae1733814acfbc0bf131837c646a1f3c8","coverage":[{"denominator":30,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":30,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-09T12:49:59.170317Z","state":"measured"},{"denominator":31,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":31,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-17T06:30:58.91139+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-27T15:27:51.585099Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"arxiv_reference","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":0,"observed_at":"2026-08-05T02:28:24.338817Z","source":"arxiv_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2502.02265","last_updated":"2025-02-04T12:26:47Z","snapshot_observed_at":"2026-08-16T13:30:43.146918Z","submitted_at":"2025-02-04T12:26:47Z","title":"Adviser-Actor-Critic: Eliminating Steady-State Error in Reinforcement Learning Control","version":1},"cited_work":{"arxiv_id":"2502.02265","doi":"10.48550/arxiv.2502.02265","metadata_source":"arxiv_reference","pith_arxiv_id":"2502.02265","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Adviser-","venue":"ArXiv.org","work_id":"a3e0eae1-1e64-4c22-a693-f2359ef0f02d","year":null},"citing_paper":{"arxiv_id":"2606.09439","last_updated":"2026-06-08T12:48:38Z","snapshot_observed_at":"2026-08-13T02:54:11.800853Z","submitted_at":"2026-06-08T12:48:38Z","title":"Tracking the Effective Surface Area of Non-Convex Satellites","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-06-27T15:27:51.585099Z"},"links":{"cited_paper":"/paper/2502.02265","citing_paper":"/paper/2606.09439"},"observation_digest":"sha256:4f2dec86bd2c08e58c50950baefed9c37d7c799331647983dca782c22f8e7360","observation_id":"ff0e69d0-98c0-4cf9-9d63-2b1a0dafcd24","resolution":{"observed_at":"2026-06-27T15:31:00.509587Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2502.02265/citation-record","integrity":"/paper/2502.02265/integrity","json":"/paper/2502.02265/citation-record.json","paper":"/paper/2502.02265"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T12:49:59.602738Z","title":"Hindsight experience replay","venue":null,"work_id":"1879fd3e-763b-4281-8040-50f7a4e1596b","year":2017},"citing_paper":{"arxiv_id":"2502.02265","last_updated":"2025-02-04T12:26:47Z","snapshot_observed_at":"2026-08-16T13:30:43.146918Z","submitted_at":"2025-02-04T12:26:47Z","title":"Adviser-Actor-Critic: Eliminating Steady-State Error in Reinforcement Learning Control","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-09T12:49:59.035484Z"},"links":{"citing_paper":"/paper/2502.02265"},"observation_digest":"sha256:430f8205196fcacbe088376f3802e539ac52977b22d1037de5c5d125dcbdef10","observation_id":"005660fd-f11d-40c9-bf38-a89d949fdacc","resolution":{"observed_at":"2026-08-09T12:49:59.607414Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T12:49:59.587103Z","title":"P., Maghade, D., Sondkar, S., and Pawar, S","venue":null,"work_id":"8c94319d-d633-46fb-bd55-b62c36e26554","year":2021},"citing_paper":{"arxiv_id":"2502.02265","last_updated":"2025-02-04T12:26:47Z","snapshot_observed_at":"2026-08-16T13:30:43.146918Z","submitted_at":"2025-02-04T12:26:47Z","title":"Adviser-Actor-Critic: Eliminating Steady-State Error in Reinforcement Learning Control","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-09T12:49:59.040935Z"},"links":{"citing_paper":"/paper/2502.02265"},"observation_digest":"sha256:e41d60dcd3d415ff9a03075e9c72168428c2fe8876144166f64bb2bbe26462cf","observation_id":"6e179587-d8f0-4ba9-86c4-665a4ad47c42","resolution":{"observed_at":"2026-08-09T12:49:59.592147Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T12:49:59.571713Z","title":"Exploration by random network distillation","venue":null,"work_id":"3b68caee-01d4-4575-9cee-4df70ec4cc1f","year":2019},"citing_paper":{"arxiv_id":"2502.02265","last_updated":"2025-02-04T12:26:47Z","snapshot_observed_at":"2026-08-16T13:30:43.146918Z","submitted_at":"2025-02-04T12:26:47Z","title":"Adviser-Actor-Critic: Eliminating Steady-State Error in Reinforcement Learning Control","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-09T12:49:59.045753Z"},"links":{"citing_paper":"/paper/2502.02265"},"observation_digest":"sha256:f0005a5f197853b863123a984752ab0d35c78bd8c9ca0f37d3afd89373fbfad9","observation_id":"abd3d449-c43e-4b46-a973-dc9bf510f0a0","resolution":{"observed_at":"2026-08-09T12:49:59.576396Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T12:49:59.556273Z","title":"Reinforcement learning for control: Performance, stability, and deep approximators","venue":null,"work_id":"cfd49f73-a680-4866-8173-71798edc9da8","year":2018},"citing_paper":{"arxiv_id":"2502.02265","last_updated":"2025-02-04T12:26:47Z","snapshot_observed_at":"2026-08-16T13:30:43.146918Z","submitted_at":"2025-02-04T12:26:47Z","title":"Adviser-Actor-Critic: Eliminating Steady-State Error in Reinforcement Learning Control","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-09T12:49:59.050519Z"},"links":{"citing_paper":"/paper/2502.02265"},"observation_digest":"sha256:aa7caf97da5ba90adc057d180202fd65d09b831d256df0fab09728b900b14086","observation_id":"03dd188a-2241-4d44-9027-1269f5a20e47","resolution":{"observed_at":"2026-08-09T12:49:59.561296Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T12:49:59.541194Z","title":"Learning sim-to-real dense object descriptors for robotic manipulation","venue":null,"work_id":"180bf907-54ff-49be-9034-1555f4601a24","year":2023},"citing_paper":{"arxiv_id":"2502.02265","last_updated":"2025-02-04T12:26:47Z","snapshot_observed_at":"2026-08-16T13:30:43.146918Z","submitted_at":"2025-02-04T12:26:47Z","title":"Adviser-Actor-Critic: Eliminating Steady-State Error in Reinforcement Learning Control","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-09T12:49:59.055719Z"},"links":{"citing_paper":"/paper/2502.02265"},"observation_digest":"sha256:b1d17526162c4ef4386a9afcdec4feb1a86e57959a2ae4fc8ddebf9265f9d012","observation_id":"008b4ff0-7dca-470a-9775-df1beccedce0","resolution":{"observed_at":"2026-08-09T12:49:59.546171Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T12:49:59.526224Z","title":"Neural-network-based nonlinear optimal terminal guidance with impact angle constraints","venue":null,"work_id":"467c5e6e-56bf-4adf-8208-af94a713380b","year":2023},"citing_paper":{"arxiv_id":"2502.02265","last_updated":"2025-02-04T12:26:47Z","snapshot_observed_at":"2026-08-16T13:30:43.146918Z","submitted_at":"2025-02-04T12:26:47Z","title":"Adviser-Actor-Critic: Eliminating Steady-State Error in Reinforcement Learning Control","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-09T12:49:59.060598Z"},"links":{"citing_paper":"/paper/2502.02265"},"observation_digest":"sha256:c610298b29d141d72ddcad1471d76138765000ebbf9bbe34c7d10d5d2e084b21","observation_id":"a60f5adf-8c81-4a66-85e9-48918bc402b3","resolution":{"observed_at":"2026-08-09T12:49:59.531047Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T12:49:59.510940Z","title":null,"venue":null,"work_id":"c383afe3-4a2a-462e-af92-2024f4aec9df","year":2012},"citing_paper":{"arxiv_id":"2502.02265","last_updated":"2025-02-04T12:26:47Z","snapshot_observed_at":"2026-08-16T13:30:43.146918Z","submitted_at":"2025-02-04T12:26:47Z","title":"Adviser-Actor-Critic: Eliminating Steady-State Error in Reinforcement Learning Control","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-09T12:49:59.065842Z"},"links":{"citing_paper":"/paper/2502.02265"},"observation_digest":"sha256:fdad431743a2df75cd019aefb2cfc3c8e4995d4a91a7e67f1a8a3009168a7ce2","observation_id":"bb575392-bd9b-47db-9728-84df08a3f9bf","resolution":{"observed_at":"2026-08-09T12:49:59.515527Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T12:49:59.070277Z","title":"Addressing function approximation error in actor-critic methods","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2502.02265","last_updated":"2025-02-04T12:26:47Z","snapshot_observed_at":"2026-08-16T13:30:43.146918Z","submitted_at":"2025-02-04T12:26:47Z","title":"Adviser-Actor-Critic: Eliminating Steady-State Error in Reinforcement Learning Control","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-09T12:49:59.070277Z"},"links":{"citing_paper":"/paper/2502.02265"},"observation_digest":"sha256:bf78db7a3647416c3871b9a6da338aabb0ab3e270a1e883e2aa995f546fd40fe","observation_id":"86175193-adb9-4711-9cb5-0aa029de2293","resolution":{"observed_at":"2026-08-09T12:49:59.070277Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T12:49:59.075006Z","title":"Soft actor-critic: Off-policy maximum entropy deep reinforcement learning with a stochastic actor","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2502.02265","last_updated":"2025-02-04T12:26:47Z","snapshot_observed_at":"2026-08-16T13:30:43.146918Z","submitted_at":"2025-02-04T12:26:47Z","title":"Adviser-Actor-Critic: Eliminating Steady-State Error in Reinforcement Learning Control","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-09T12:49:59.075006Z"},"links":{"citing_paper":"/paper/2502.02265"},"observation_digest":"sha256:f91faab970abe5b71ab3c732e6aa251a68a68e12e5923b585b429fe97ed712f2","observation_id":"e0797492-a89d-44a9-9f02-1cc9270fa322","resolution":{"observed_at":"2026-08-09T12:49:59.075006Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T12:49:59.476953Z","title":"Learning to utilize shaping rewards: A new approach of reward shaping","venue":null,"work_id":"4c4d4f29-cc23-4126-8015-980033a14cf7","year":2020},"citing_paper":{"arxiv_id":"2502.02265","last_updated":"2025-02-04T12:26:47Z","snapshot_observed_at":"2026-08-16T13:30:43.146918Z","submitted_at":"2025-02-04T12:26:47Z","title":"Adviser-Actor-Critic: Eliminating Steady-State Error in Reinforcement Learning Control","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-09T12:49:59.079365Z"},"links":{"citing_paper":"/paper/2502.02265"},"observation_digest":"sha256:40e2dede84b52cb19b7ad670e2b08a3abba8d30734956410131a34837b51b24a","observation_id":"faf70b9f-6882-46ae-84e0-f2c305af9901","resolution":{"observed_at":"2026-08-09T12:49:59.481764Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T12:49:59.461709Z","title":"D., Tsounis, V., Hwangbo, J., Bodie, K., Fankhauser, P., Bloesch, M., et al","venue":null,"work_id":"c9a772f3-3e52-4b0e-a0a4-3957b0ea2f9e","year":2016},"citing_paper":{"arxiv_id":"2502.02265","last_updated":"2025-02-04T12:26:47Z","snapshot_observed_at":"2026-08-16T13:30:43.146918Z","submitted_at":"2025-02-04T12:26:47Z","title":"Adviser-Actor-Critic: Eliminating Steady-State Error in Reinforcement Learning Control","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-09T12:49:59.083704Z"},"links":{"citing_paper":"/paper/2502.02265"},"observation_digest":"sha256:0276cb6d8d8042469dab56014dbf274b59e5421f6714bb566821ec28a4c41a45","observation_id":"48605718-3d47-4a0b-a625-fdb1949b5017","resolution":{"observed_at":"2026-08-09T12:49:59.466447Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T12:49:59.088067Z","title":"R., Sobh, I., Talpaert, V., Mannion, P., Al Sallab, A","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.02265","last_updated":"2025-02-04T12:26:47Z","snapshot_observed_at":"2026-08-16T13:30:43.146918Z","submitted_at":"2025-02-04T12:26:47Z","title":"Adviser-Actor-Critic: Eliminating Steady-State Error in Reinforcement Learning Control","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-09T12:49:59.088067Z"},"links":{"citing_paper":"/paper/2502.02265"},"observation_digest":"sha256:459d2273f12ada4869c009a4e279b30d41b9f5ad72d688423a4ee0ac0a632b9b","observation_id":"948f4ce5-1522-4428-b26e-620c297cfa90","resolution":{"observed_at":"2026-08-09T12:49:59.088067Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T12:49:59.437671Z","title":"H., and Chong, G","venue":null,"work_id":"191849e7-0aa0-46f9-97fb-20819971fe7a","year":2006},"citing_paper":{"arxiv_id":"2502.02265","last_updated":"2025-02-04T12:26:47Z","snapshot_observed_at":"2026-08-16T13:30:43.146918Z","submitted_at":"2025-02-04T12:26:47Z","title":"Adviser-Actor-Critic: Eliminating Steady-State Error in Reinforcement Learning Control","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-09T12:49:59.092820Z"},"links":{"citing_paper":"/paper/2502.02265"},"observation_digest":"sha256:46de8c07407caf8dd340c0bffc8c47a2e1d836733db77f7bbddda0208bafd9e4","observation_id":"8d6f2deb-e3db-46b5-b1b5-7b9f5a4a4dfd","resolution":{"observed_at":"2026-08-09T12:49:59.442341Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1509.02971","last_updated":"2019-07-05T10:47:27Z","snapshot_observed_at":"2026-08-16T22:06:26.835611Z","submitted_at":"2015-09-09T23:01:36Z","title":"Continuous control with deep reinforcement learning","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1509.02971","snapshot_observed_at":"2026-08-09T12:49:59.097406Z","title":"Continuous control with deep reinforcement learning","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2502.02265","last_updated":"2025-02-04T12:26:47Z","snapshot_observed_at":"2026-08-16T13:30:43.146918Z","submitted_at":"2025-02-04T12:26:47Z","title":"Adviser-Actor-Critic: Eliminating Steady-State Error in Reinforcement Learning Control","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-09T12:49:59.097406Z"},"links":{"cited_paper":"/paper/1509.02971","citing_paper":"/paper/2502.02265"},"observation_digest":"sha256:8f556526c5d265a7a3446fa495c7669b70780dec94bb5311a8463267fb138ee9","observation_id":"7b3ee027-c958-4823-8cad-d6c96086fd1f","resolution":{"observed_at":"2026-08-09T12:49:59.097406Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T12:49:59.422134Z","title":"A review of industrial mimo decoupling control","venue":null,"work_id":"2ab6b464-8ded-4974-b691-3fb4194944f2","year":2019},"citing_paper":{"arxiv_id":"2502.02265","last_updated":"2025-02-04T12:26:47Z","snapshot_observed_at":"2026-08-16T13:30:43.146918Z","submitted_at":"2025-02-04T12:26:47Z","title":"Adviser-Actor-Critic: Eliminating Steady-State Error in Reinforcement Learning Control","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-09T12:49:59.102440Z"},"links":{"citing_paper":"/paper/2502.02265"},"observation_digest":"sha256:59fd2f7b04192a13ed092d2fc68ca67cefdfa6a2d610aa62df9657b5be2d7988","observation_id":"19f774e0-a4fd-48fb-8f70-91d5a83473ba","resolution":{"observed_at":"2026-08-09T12:49:59.427187Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2201.08299","last_updated":"2022-09-02T10:46:40Z","snapshot_observed_at":"2026-08-16T17:27:02.445517Z","submitted_at":"2022-01-20T17:06:42Z","title":"Goal-Conditioned Reinforcement Learning: Problems and Solutions","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2201.08299","snapshot_observed_at":"2026-08-09T12:49:59.106851Z","title":"Goal-conditioned reinforcement learning: Problems and solutions","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.02265","last_updated":"2025-02-04T12:26:47Z","snapshot_observed_at":"2026-08-16T13:30:43.146918Z","submitted_at":"2025-02-04T12:26:47Z","title":"Adviser-Actor-Critic: Eliminating Steady-State Error in Reinforcement Learning Control","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-09T12:49:59.106851Z"},"links":{"cited_paper":"/paper/2201.08299","citing_paper":"/paper/2502.02265"},"observation_digest":"sha256:5e14ba251a9f6ab68af8e22d35daa5621be79ab5c1d073dfb189bdfee8863709","observation_id":"d5e18518-2e86-4153-bfd2-06607d1a89fd","resolution":{"observed_at":"2026-08-09T12:49:59.106851Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T12:49:59.111561Z","title":"A., Veness, J., Bellemare, M","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2502.02265","last_updated":"2025-02-04T12:26:47Z","snapshot_observed_at":"2026-08-16T13:30:43.146918Z","submitted_at":"2025-02-04T12:26:47Z","title":"Adviser-Actor-Critic: Eliminating Steady-State Error in Reinforcement Learning Control","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-09T12:49:59.111561Z"},"links":{"citing_paper":"/paper/2502.02265"},"observation_digest":"sha256:32d75468647e3d5ea4c3416aa5ccfef80e4531f51f0591209c3e192fd5d5cfba","observation_id":"88376a46-728d-4a23-aacb-6bdf8e95806a","resolution":{"observed_at":"2026-08-09T12:49:59.111561Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T12:49:59.397200Z","title":"Goal-directed planning via hindsight experience replay","venue":null,"work_id":"2c474d36-8310-47cb-a750-512371da3c93","year":2022},"citing_paper":{"arxiv_id":"2502.02265","last_updated":"2025-02-04T12:26:47Z","snapshot_observed_at":"2026-08-16T13:30:43.146918Z","submitted_at":"2025-02-04T12:26:47Z","title":"Adviser-Actor-Critic: Eliminating Steady-State Error in Reinforcement Learning Control","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-09T12:49:59.115909Z"},"links":{"citing_paper":"/paper/2502.02265"},"observation_digest":"sha256:3e7df03adc09adc54d586bb96414fddad101c56006a0bb6b8cd0a2ae4484e19e","observation_id":"e285dbe8-e8e8-46a8-a728-d4ce6efa5bc4","resolution":{"observed_at":"2026-08-09T12:49:59.402026Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T12:49:59.120185Z","title":"A., and Darrell, T","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2502.02265","last_updated":"2025-02-04T12:26:47Z","snapshot_observed_at":"2026-08-16T13:30:43.146918Z","submitted_at":"2025-02-04T12:26:47Z","title":"Adviser-Actor-Critic: Eliminating Steady-State Error in Reinforcement Learning Control","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-09T12:49:59.120185Z"},"links":{"citing_paper":"/paper/2502.02265"},"observation_digest":"sha256:79d9a12f004def96a6f0f4effb82a387fc9551767a933b5c69f0229d971006fd","observation_id":"cb9b5b77-5a19-4227-a0b5-cdb3e0cbddc8","resolution":{"observed_at":"2026-08-09T12:49:59.120185Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T12:49:59.372797Z","title":"Dynamic-matching adaptive sliding mode control for hypersonic vehicles","venue":null,"work_id":"a658b450-91a3-40e5-a3cf-99255ccda476","year":2024},"citing_paper":{"arxiv_id":"2502.02265","last_updated":"2025-02-04T12:26:47Z","snapshot_observed_at":"2026-08-16T13:30:43.146918Z","submitted_at":"2025-02-04T12:26:47Z","title":"Adviser-Actor-Critic: Eliminating Steady-State Error in Reinforcement Learning Control","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-09T12:49:59.124777Z"},"links":{"citing_paper":"/paper/2502.02265"},"observation_digest":"sha256:6afc998a0b2abfe197c017dc01d8fb7ab3f6c7dc760b20528a061dd3d164d8d5","observation_id":"448fbb73-893e-477b-9963-880893f87a36","resolution":{"observed_at":"2026-08-09T12:49:59.377494Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T12:49:59.357317Z","title":"Discovering blind spots in reinforcement learning","venue":null,"work_id":"4ed52498-9c56-411e-ad80-0ec747598a62","year":2018},"citing_paper":{"arxiv_id":"2502.02265","last_updated":"2025-02-04T12:26:47Z","snapshot_observed_at":"2026-08-16T13:30:43.146918Z","submitted_at":"2025-02-04T12:26:47Z","title":"Adviser-Actor-Critic: Eliminating Steady-State Error in Reinforcement Learning Control","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-09T12:49:59.129734Z"},"links":{"citing_paper":"/paper/2502.02265"},"observation_digest":"sha256:4e692e522ae2ad300649c766267f5db1c73fa4ba4d872c2d2c1c86359b48a4a8","observation_id":"06734728-c786-440a-97ac-89c7bdb52c5b","resolution":{"observed_at":"2026-08-09T12:49:59.362366Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-08-15T20:26:32.102285Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-09T12:49:59.134118Z","title":"Proximal policy optimization algorithms","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2502.02265","last_updated":"2025-02-04T12:26:47Z","snapshot_observed_at":"2026-08-16T13:30:43.146918Z","submitted_at":"2025-02-04T12:26:47Z","title":"Adviser-Actor-Critic: Eliminating Steady-State Error in Reinforcement Learning Control","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-09T12:49:59.134118Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2502.02265"},"observation_digest":"sha256:56e845e6f80b450b57092e2d80745c86a2e180d5aeb82f0fbeae2a8247a47582","observation_id":"c6bec956-1b08-41e5-97e5-6f9dba0e8240","resolution":{"observed_at":"2026-08-09T12:49:59.134118Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T12:49:59.138954Z","title":"Deterministic policy gradient algorithms","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2502.02265","last_updated":"2025-02-04T12:26:47Z","snapshot_observed_at":"2026-08-16T13:30:43.146918Z","submitted_at":"2025-02-04T12:26:47Z","title":"Adviser-Actor-Critic: Eliminating Steady-State Error in Reinforcement Learning Control","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-09T12:49:59.138954Z"},"links":{"citing_paper":"/paper/2502.02265"},"observation_digest":"sha256:b9e9ab458f93973322d316f9126fad22b357381ebeb14a6937806bea58d824e7","observation_id":"2cdffbd7-5206-4799-8fe2-ff334b6439bd","resolution":{"observed_at":"2026-08-09T12:49:59.138954Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T12:49:59.143546Z","title":"Action robust reinforcement learning and applications in continuous control","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2502.02265","last_updated":"2025-02-04T12:26:47Z","snapshot_observed_at":"2026-08-16T13:30:43.146918Z","submitted_at":"2025-02-04T12:26:47Z","title":"Adviser-Actor-Critic: Eliminating Steady-State Error in Reinforcement Learning Control","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-09T12:49:59.143546Z"},"links":{"citing_paper":"/paper/2502.02265"},"observation_digest":"sha256:570da10b9e882da15910702d64431e23c9925deaecac3d03618d78083f4ae951","observation_id":"f353c4f6-4994-4597-959e-d7c5f1028dee","resolution":{"observed_at":"2026-08-09T12:49:59.143546Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T12:49:59.320737Z","title":"D., Michi, A., Chervonyi, Y., Davies, I., Paduraru, C., Lazic, N., Felici, F., Ewalds, T., Donner, C., Galperti, C., et al","venue":null,"work_id":"440160d3-b223-4046-aa98-e7cf8c0f61c4","year":2024},"citing_paper":{"arxiv_id":"2502.02265","last_updated":"2025-02-04T12:26:47Z","snapshot_observed_at":"2026-08-16T13:30:43.146918Z","submitted_at":"2025-02-04T12:26:47Z","title":"Adviser-Actor-Critic: Eliminating Steady-State Error in Reinforcement Learning Control","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-09T12:49:59.148057Z"},"links":{"citing_paper":"/paper/2502.02265"},"observation_digest":"sha256:d1e6330d8e6f26e63f7bd6d7223e46fec701f017580bcd36aea23b096f611df1","observation_id":"407097ac-ed4c-47a2-925a-55e19f8e6c23","resolution":{"observed_at":"2026-08-09T12:49:59.325736Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T12:49:59.304996Z","title":"A brief survey on nonlinear control using adaptive dynamic programming under engineering-oriented complexities","venue":null,"work_id":"73b1f5cb-f7ba-4b16-a5ae-d29dff6b3fcb","year":2023},"citing_paper":{"arxiv_id":"2502.02265","last_updated":"2025-02-04T12:26:47Z","snapshot_observed_at":"2026-08-16T13:30:43.146918Z","submitted_at":"2025-02-04T12:26:47Z","title":"Adviser-Actor-Critic: Eliminating Steady-State Error in Reinforcement Learning Control","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-09T12:49:59.152626Z"},"links":{"citing_paper":"/paper/2502.02265"},"observation_digest":"sha256:9408094eb658b3b90ecb0c9f9375ddbdf007243c45cc728ae8ce3c738ab1e72e","observation_id":"69cefe13-0d49-40f6-9cef-8c89416365ee","resolution":{"observed_at":"2026-08-09T12:49:59.310143Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T12:49:59.289887Z","title":"P., Qingqing, L., and Westerlund, T","venue":null,"work_id":"9e85a299-10bd-4975-8bcd-116f99cddf4e","year":2020},"citing_paper":{"arxiv_id":"2502.02265","last_updated":"2025-02-04T12:26:47Z","snapshot_observed_at":"2026-08-16T13:30:43.146918Z","submitted_at":"2025-02-04T12:26:47Z","title":"Adviser-Actor-Critic: Eliminating Steady-State Error in Reinforcement Learning Control","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-09T12:49:59.156933Z"},"links":{"citing_paper":"/paper/2502.02265"},"observation_digest":"sha256:2bffe5f514cb30244d964445ec610554e75ea4534f5b3e9c55e591282cc85fc2","observation_id":"8a103e4a-59e7-478a-9bd3-c47d20057cfc","resolution":{"observed_at":"2026-08-09T12:49:59.294548Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T12:49:59.274936Z","title":"P., and Westerlund, T","venue":null,"work_id":"59632d1a-bd5c-47ec-b4be-0e15c1d7c291","year":2020},"citing_paper":{"arxiv_id":"2502.02265","last_updated":"2025-02-04T12:26:47Z","snapshot_observed_at":"2026-08-16T13:30:43.146918Z","submitted_at":"2025-02-04T12:26:47Z","title":"Adviser-Actor-Critic: Eliminating Steady-State Error in Reinforcement Learning Control","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-09T12:49:59.161470Z"},"links":{"citing_paper":"/paper/2502.02265"},"observation_digest":"sha256:ad4b2ebbb6457879507aa880ef7fe2c1bec3c90bfa45c21d96bdacae9ad4952e","observation_id":"e0d97cee-bc2e-4aa1-8468-00c75548ee32","resolution":{"observed_at":"2026-08-09T12:49:59.279619Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T12:49:59.256300Z","title":"A comprehensive survey on transfer learning","venue":null,"work_id":"5344c49f-bac8-4c2e-b4be-545e30117f07","year":2020},"citing_paper":{"arxiv_id":"2502.02265","last_updated":"2025-02-04T12:26:47Z","snapshot_observed_at":"2026-08-16T13:30:43.146918Z","submitted_at":"2025-02-04T12:26:47Z","title":"Adviser-Actor-Critic: Eliminating Steady-State Error in Reinforcement Learning Control","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-09T12:49:59.165901Z"},"links":{"citing_paper":"/paper/2502.02265"},"observation_digest":"sha256:b0dcd2b4e90a69f7895f1767bd6b5e1782d33fdff8ef7e134a245c3bccec92e1","observation_id":"b34a8f89-1956-4252-bf22-d8918cfa874a","resolution":{"observed_at":"2026-08-09T12:49:59.262839Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T12:49:59.170317Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.02265","last_updated":"2025-02-04T12:26:47Z","snapshot_observed_at":"2026-08-16T13:30:43.146918Z","submitted_at":"2025-02-04T12:26:47Z","title":"Adviser-Actor-Critic: Eliminating Steady-State Error in Reinforcement Learning Control","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-09T12:49:59.170317Z"},"links":{"citing_paper":"/paper/2502.02265"},"observation_digest":"sha256:93bcb23dfd6ee6834ccebc75f976718ef38c9a6b2e9f0c6dceac6bd0d24102f9","observation_id":"82e864a6-f2f0-4395-a749-cc4b93895863","resolution":{"observed_at":"2026-08-09T12:49:59.170317Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2502.02265","last_updated":"2025-02-04T12:26:47Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-16T13:30:43.146918Z","submitted_at":"2025-02-04T12:26:47Z","title":"Adviser-Actor-Critic: Eliminating Steady-State Error in Reinforcement Learning Control"},"reference_resolution":{"displayed":30,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":12,"verified_exact":0,"verified_fuzzy":18},"total_outbound_references":30},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"thesis":"As of 18 August 2026, this Paper Citation Record lists 30 of 30 outbound references and 1 inbound Pith citation observation for arXiv:2502.02265."}