{"as_of":"2026-08-13T14:03:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:a18994129eedd5246985060b987018673c9f4cbde6f80261bae89726d89d7e65","coverage":[{"denominator":37,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":37,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-09T21:16:56.501482Z","state":"measured"},{"denominator":37,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":37,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-13T06:32:02.005865+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2501.19133/citation-record","integrity":"/paper/2501.19133/integrity","json":"/paper/2501.19133/citation-record.json","paper":"/paper/2501.19133"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2407.10780","last_updated":"2025-08-25T10:34:51Z","snapshot_observed_at":"2026-08-12T23:21:56.944873Z","submitted_at":"2024-07-15T14:59:43Z","title":"Correlations Are Ruining Your Gradient Descent","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.10780","snapshot_observed_at":"2026-08-09T21:16:56.284738Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.19133","last_updated":"2025-01-31T13:38:57Z","snapshot_observed_at":"2026-08-13T04:13:37.324406Z","submitted_at":"2025-01-31T13:38:57Z","title":"Decorrelated Soft Actor-Critic for Efficient Deep Reinforcement Learning","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-09T21:16:56.284738Z"},"links":{"cited_paper":"/paper/2407.10780","citing_paper":"/paper/2501.19133"},"observation_digest":"sha256:f1fe8d6bce10642f97fc88d86aca89cc43b44f4583bedcea48cc6c6c73088435","observation_id":"ccaace65-5079-4eda-9853-3a931762a375","resolution":{"observed_at":"2026-08-09T21:16:56.284738Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T21:16:57.327847Z","title":null,"venue":null,"work_id":"75ed0ca6-099e-4275-99ba-90600ed8ba86","year":2023},"citing_paper":{"arxiv_id":"2501.19133","last_updated":"2025-01-31T13:38:57Z","snapshot_observed_at":"2026-08-13T04:13:37.324406Z","submitted_at":"2025-01-31T13:38:57Z","title":"Decorrelated Soft Actor-Critic for Efficient Deep Reinforcement Learning","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-09T21:16:56.291855Z"},"links":{"citing_paper":"/paper/2501.19133"},"observation_digest":"sha256:f4ef59baeb6b75fefa65c148bdd604e7861035762d9ff514f9da0ae565e047ba","observation_id":"796db72b-4d13-4ae7-9151-6f1d480cf5db","resolution":{"observed_at":"2026-08-09T21:16:57.333361Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T21:16:57.308307Z","title":"independent components","venue":null,"work_id":"b5e6c88d-a5cd-41fd-b3ab-977c7560c3b1","year":1997},"citing_paper":{"arxiv_id":"2501.19133","last_updated":"2025-01-31T13:38:57Z","snapshot_observed_at":"2026-08-13T04:13:37.324406Z","submitted_at":"2025-01-31T13:38:57Z","title":"Decorrelated Soft Actor-Critic for Efficient Deep Reinforcement Learning","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-09T21:16:56.299098Z"},"links":{"citing_paper":"/paper/2501.19133"},"observation_digest":"sha256:ca870711ac53048ff7831754b2b8cddf8879f84fff8333b9304dcf1e614991c4","observation_id":"615f50ed-31c8-422d-85e9-f2ffdaf707fa","resolution":{"observed_at":"2026-08-09T21:16:57.314093Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T21:16:57.290018Z","title":"and Bergstra, J","venue":null,"work_id":"338824ad-020a-4300-868b-a10ed4a88133","year":2009},"citing_paper":{"arxiv_id":"2501.19133","last_updated":"2025-01-31T13:38:57Z","snapshot_observed_at":"2026-08-13T04:13:37.324406Z","submitted_at":"2025-01-31T13:38:57Z","title":"Decorrelated Soft Actor-Critic for Efficient Deep Reinforcement Learning","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-09T21:16:56.306747Z"},"links":{"citing_paper":"/paper/2501.19133"},"observation_digest":"sha256:1dee692f0d467ff7cec5e2de1f7b613b78f9749dac80ac0cf69c2edc6643712a","observation_id":"efcc5600-00f5-40fa-bb0c-7ead6f5263df","resolution":{"observed_at":"2026-08-09T21:16:57.295675Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1910.07207","last_updated":"2019-10-18T09:17:44Z","snapshot_observed_at":"2026-08-06T11:56:09.577967Z","submitted_at":"2019-10-16T08:11:08Z","title":"Soft Actor-Critic for Discrete Action Settings","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1910.07207","snapshot_observed_at":"2026-08-09T21:16:56.312627Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2501.19133","last_updated":"2025-01-31T13:38:57Z","snapshot_observed_at":"2026-08-13T04:13:37.324406Z","submitted_at":"2025-01-31T13:38:57Z","title":"Decorrelated Soft Actor-Critic for Efficient Deep Reinforcement Learning","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-09T21:16:56.312627Z"},"links":{"cited_paper":"/paper/1910.07207","citing_paper":"/paper/2501.19133"},"observation_digest":"sha256:1b8395dea5d8f863d66e005315b28cf31f27a511a2caf6043cd394c298347741","observation_id":"ebce658c-c843-4fdb-a824-5f93eff0308e","resolution":{"observed_at":"2026-08-09T21:16:56.312627Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T21:16:57.270435Z","title":null,"venue":null,"work_id":"a3d17c49-c5db-4a15-9767-ac602aaeeec2","year":2013},"citing_paper":{"arxiv_id":"2501.19133","last_updated":"2025-01-31T13:38:57Z","snapshot_observed_at":"2026-08-13T04:13:37.324406Z","submitted_at":"2025-01-31T13:38:57Z","title":"Decorrelated Soft Actor-Critic for Efficient Deep Reinforcement Learning","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-09T21:16:56.320403Z"},"links":{"citing_paper":"/paper/2501.19133"},"observation_digest":"sha256:dc53df183f7dadd9b76532279b82adce12af58ec70f4c76c9c7d955dc0941c3f","observation_id":"8d697073-4e9a-435b-a564-ca43a0d19c5c","resolution":{"observed_at":"2026-08-09T21:16:57.276065Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2405.02385","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T21:16:56.751602Z","title":null,"venue":null,"work_id":"363d537f-ac47-424e-ac6e-c1c89b17cbf7","year":2024},"citing_paper":{"arxiv_id":"2501.19133","last_updated":"2025-01-31T13:38:57Z","snapshot_observed_at":"2026-08-13T04:13:37.324406Z","submitted_at":"2025-01-31T13:38:57Z","title":"Decorrelated Soft Actor-Critic for Efficient Deep Reinforcement Learning","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-09T21:16:56.326793Z"},"links":{"citing_paper":"/paper/2501.19133"},"observation_digest":"sha256:e512e4204d9445501de5faed8bf41aa5213fa13a2d566ac48a431b67f925b378","observation_id":"f8a63d46-c19b-4987-9113-8655eb5885bb","resolution":{"observed_at":"2026-08-09T21:16:56.760997Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T21:16:57.251574Z","title":null,"venue":null,"work_id":"111e991d-5f6d-4c0d-ab4c-d0a84bff2634","year":2024},"citing_paper":{"arxiv_id":"2501.19133","last_updated":"2025-01-31T13:38:57Z","snapshot_observed_at":"2026-08-13T04:13:37.324406Z","submitted_at":"2025-01-31T13:38:57Z","title":"Decorrelated Soft Actor-Critic for Efficient Deep Reinforcement Learning","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-09T21:16:56.332095Z"},"links":{"citing_paper":"/paper/2501.19133"},"observation_digest":"sha256:07e7a725acda526a56523ecf61cf37461218483883ce70b0895cb7a26326963c","observation_id":"87e1cc1d-e0bc-4b29-b541-7d0f1a79ebe0","resolution":{"observed_at":"2026-08-09T21:16:57.256440Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T21:16:57.233939Z","title":null,"venue":null,"work_id":"ef97425f-246a-47a8-82ab-358b5283b519","year":2015},"citing_paper":{"arxiv_id":"2501.19133","last_updated":"2025-01-31T13:38:57Z","snapshot_observed_at":"2026-08-13T04:13:37.324406Z","submitted_at":"2025-01-31T13:38:57Z","title":"Decorrelated Soft Actor-Critic for Efficient Deep Reinforcement Learning","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-09T21:16:56.337322Z"},"links":{"citing_paper":"/paper/2501.19133"},"observation_digest":"sha256:05feb685925eee17e6708bd60b6fe81a3a599ff38a8d39e73d4af8c91adec3d7","observation_id":"4cae1d90-6dcc-4504-9b20-0b39d81198d7","resolution":{"observed_at":"2026-08-09T21:16:57.240097Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T21:16:57.213871Z","title":null,"venue":null,"work_id":"7b7aebfc-caab-42a2-8f15-d4a4eb0235b0","year":2017},"citing_paper":{"arxiv_id":"2501.19133","last_updated":"2025-01-31T13:38:57Z","snapshot_observed_at":"2026-08-13T04:13:37.324406Z","submitted_at":"2025-01-31T13:38:57Z","title":"Decorrelated Soft Actor-Critic for Efficient Deep Reinforcement Learning","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-09T21:16:56.343074Z"},"links":{"citing_paper":"/paper/2501.19133"},"observation_digest":"sha256:80181c159f1ef7588a0f07129ae8bd43209faf64e5c3adf15818fcaf2653cd9f","observation_id":"a82cebd5-656e-4821-8473-969819540ec0","resolution":{"observed_at":"2026-08-09T21:16:57.219770Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T21:16:57.195838Z","title":null,"venue":null,"work_id":"d041686b-25c9-4b54-94ed-2cccee0566aa","year":2005},"citing_paper":{"arxiv_id":"2501.19133","last_updated":"2025-01-31T13:38:57Z","snapshot_observed_at":"2026-08-13T04:13:37.324406Z","submitted_at":"2025-01-31T13:38:57Z","title":"Decorrelated Soft Actor-Critic for Efficient Deep Reinforcement Learning","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-09T21:16:56.348361Z"},"links":{"citing_paper":"/paper/2501.19133"},"observation_digest":"sha256:43f0a0e5b761914fc58564907f53d1480a0069a8138d514a6c4e01a511f0059a","observation_id":"a9f6724d-905a-45b1-972d-5979fa5be4b4","resolution":{"observed_at":"2026-08-09T21:16:57.201021Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T21:16:57.176544Z","title":null,"venue":null,"work_id":"6310bb86-7705-45a2-b73c-5aa30fc96d49","year":2018},"citing_paper":{"arxiv_id":"2501.19133","last_updated":"2025-01-31T13:38:57Z","snapshot_observed_at":"2026-08-13T04:13:37.324406Z","submitted_at":"2025-01-31T13:38:57Z","title":"Decorrelated Soft Actor-Critic for Efficient Deep Reinforcement Learning","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-09T21:16:56.353937Z"},"links":{"citing_paper":"/paper/2501.19133"},"observation_digest":"sha256:9084d4b11808294e30a6f52ae7ccf723e116ea1b33f41b546d349c3ffd581866","observation_id":"fdad1c53-0d23-40d6-a978-1156250f093c","resolution":{"observed_at":"2026-08-09T21:16:57.181750Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1812.05905","last_updated":"2019-01-29T12:10:47Z","snapshot_observed_at":"2026-08-01T15:24:35.515954Z","submitted_at":"2018-12-13T04:44:29Z","title":"Soft Actor-Critic Algorithms and Applications","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1812.05905","snapshot_observed_at":"2026-08-09T21:16:56.359112Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2501.19133","last_updated":"2025-01-31T13:38:57Z","snapshot_observed_at":"2026-08-13T04:13:37.324406Z","submitted_at":"2025-01-31T13:38:57Z","title":"Decorrelated Soft Actor-Critic for Efficient Deep Reinforcement Learning","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-09T21:16:56.359112Z"},"links":{"cited_paper":"/paper/1812.05905","citing_paper":"/paper/2501.19133"},"observation_digest":"sha256:d3f1daf233a65c744e3a0a9967d06c29a29d6d2443b65612da644f1088adb43a","observation_id":"d03a1cce-0652-44c2-aa63-46d2a7e77178","resolution":{"observed_at":"2026-08-09T21:16:56.359112Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T21:16:57.158748Z","title":null,"venue":null,"work_id":"c79c792f-3d80-485f-85c3-d04f04198ba6","year":2023},"citing_paper":{"arxiv_id":"2501.19133","last_updated":"2025-01-31T13:38:57Z","snapshot_observed_at":"2026-08-13T04:13:37.324406Z","submitted_at":"2025-01-31T13:38:57Z","title":"Decorrelated Soft Actor-Critic for Efficient Deep Reinforcement Learning","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-09T21:16:56.364729Z"},"links":{"citing_paper":"/paper/2501.19133"},"observation_digest":"sha256:4557c51278c69fcb86380d3f687ac960383ff14366ce7e312481214664c3f644","observation_id":"1b19ecc4-b170-4bcb-a75e-f030c68dd402","resolution":{"observed_at":"2026-08-09T21:16:57.164494Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T21:16:57.141312Z","title":"and Rao, R","venue":null,"work_id":"5b594ac5-067d-4132-aafa-796e28dc7d07","year":2011},"citing_paper":{"arxiv_id":"2501.19133","last_updated":"2025-01-31T13:38:57Z","snapshot_observed_at":"2026-08-13T04:13:37.324406Z","submitted_at":"2025-01-31T13:38:57Z","title":"Decorrelated Soft Actor-Critic for Efficient Deep Reinforcement Learning","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-09T21:16:56.369689Z"},"links":{"citing_paper":"/paper/2501.19133"},"observation_digest":"sha256:23a4edf1d439e308975f2597887f31d6a02770f7212f6c41f8998338b7d9fcf6","observation_id":"c321452f-98c3-428e-898a-ee9472c7222e","resolution":{"observed_at":"2026-08-09T21:16:57.146650Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T21:16:57.121263Z","title":null,"venue":null,"work_id":"96f6b752-07c5-40ef-afc0-9d80c18439d9","year":2018},"citing_paper":{"arxiv_id":"2501.19133","last_updated":"2025-01-31T13:38:57Z","snapshot_observed_at":"2026-08-13T04:13:37.324406Z","submitted_at":"2025-01-31T13:38:57Z","title":"Decorrelated Soft Actor-Critic for Efficient Deep Reinforcement Learning","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-09T21:16:56.375001Z"},"links":{"citing_paper":"/paper/2501.19133"},"observation_digest":"sha256:431f6cdf8e41f24c4b90e0be626e673a345002c1f17d39166284ac5b16d305ca","observation_id":"58157826-07c8-47da-a67d-f98a063f7a7e","resolution":{"observed_at":"2026-08-09T21:16:57.128136Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T21:16:57.100758Z","title":"H., Czechowski, K., Erhan, D., Finn, C., Kozakowski, P., Levine, S., Mohiuddin, A., Sepassi, R., Tucker, G., and Michalewski, H","venue":null,"work_id":"f1d555ac-ebf7-4046-98aa-63b2dfa04611","year":2020},"citing_paper":{"arxiv_id":"2501.19133","last_updated":"2025-01-31T13:38:57Z","snapshot_observed_at":"2026-08-13T04:13:37.324406Z","submitted_at":"2025-01-31T13:38:57Z","title":"Decorrelated Soft Actor-Critic for Efficient Deep Reinforcement Learning","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-09T21:16:56.380544Z"},"links":{"citing_paper":"/paper/2501.19133"},"observation_digest":"sha256:7905e7326c61319eaf6e6734bcb52078360d4bfd632b68aa7611d38814c830f0","observation_id":"f081d93d-8b87-4a83-8084-723544700b84","resolution":{"observed_at":"2026-08-09T21:16:57.106662Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T21:16:57.078994Z","title":null,"venue":null,"work_id":"1f3017f5-c7bf-4fd3-9196-2b4000c229ef","year":2024},"citing_paper":{"arxiv_id":"2501.19133","last_updated":"2025-01-31T13:38:57Z","snapshot_observed_at":"2026-08-13T04:13:37.324406Z","submitted_at":"2025-01-31T13:38:57Z","title":"Decorrelated Soft Actor-Critic for Efficient Deep Reinforcement Learning","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-09T21:16:56.387308Z"},"links":{"citing_paper":"/paper/2501.19133"},"observation_digest":"sha256:56e8ef58f0cd68d53e56ffe67e2b4a087d92f2819c2c1669a93a02f1be4154ac","observation_id":"e2abb557-20c7-4af2-bcb1-4af1ed0bb986","resolution":{"observed_at":"2026-08-09T21:16:57.086240Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T21:16:57.051367Z","title":null,"venue":null,"work_id":"f154262a-ba94-4c25-a72c-f558cc4d117c","year":2022},"citing_paper":{"arxiv_id":"2501.19133","last_updated":"2025-01-31T13:38:57Z","snapshot_observed_at":"2026-08-13T04:13:37.324406Z","submitted_at":"2025-01-31T13:38:57Z","title":"Decorrelated Soft Actor-Critic for Efficient Deep Reinforcement Learning","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-09T21:16:56.393253Z"},"links":{"citing_paper":"/paper/2501.19133"},"observation_digest":"sha256:13f58031887dd66292bb74066832de05081727bf3560524cdcae20fd1b560dd3","observation_id":"988bbedc-2fa5-4e94-9c80-54e04145053b","resolution":{"observed_at":"2026-08-09T21:16:57.058232Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T21:16:57.031112Z","title":"u ller, K.-R. (2012). Efficient backprop. In Montavon, G., Orr, G. B., and M \\","venue":null,"work_id":"658326ec-e369-4a04-aecb-abcd5e047c90","year":2012},"citing_paper":{"arxiv_id":"2501.19133","last_updated":"2025-01-31T13:38:57Z","snapshot_observed_at":"2026-08-13T04:13:37.324406Z","submitted_at":"2025-01-31T13:38:57Z","title":"Decorrelated Soft Actor-Critic for Efficient Deep Reinforcement Learning","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-09T21:16:56.398996Z"},"links":{"citing_paper":"/paper/2501.19133"},"observation_digest":"sha256:676b50ec0f0e636a87952ccb629ff5f4cbfe060c350202d72d5fac2690804ae5","observation_id":"682ae32b-d542-449c-8149-7e69f0bb5349","resolution":{"observed_at":"2026-08-09T21:16:57.037157Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T21:16:57.011707Z","title":null,"venue":null,"work_id":"7c495731-b735-469f-b62c-b18fc6ce8efb","year":2023},"citing_paper":{"arxiv_id":"2501.19133","last_updated":"2025-01-31T13:38:57Z","snapshot_observed_at":"2026-08-13T04:13:37.324406Z","submitted_at":"2025-01-31T13:38:57Z","title":"Decorrelated Soft Actor-Critic for Efficient Deep Reinforcement Learning","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-09T21:16:56.405208Z"},"links":{"citing_paper":"/paper/2501.19133"},"observation_digest":"sha256:109f18134b54a3871f8fe5828cb0cca554b945278604d76fa38d1253e5b6e383","observation_id":"990e4dc6-1b78-4a5c-b55a-2ee755b314b7","resolution":{"observed_at":"2026-08-09T21:16:57.017304Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T21:16:56.990725Z","title":null,"venue":null,"work_id":"1bc36166-ee0f-45ec-a3bd-30696d6f535d","year":1976},"citing_paper":{"arxiv_id":"2501.19133","last_updated":"2025-01-31T13:38:57Z","snapshot_observed_at":"2026-08-13T04:13:37.324406Z","submitted_at":"2025-01-31T13:38:57Z","title":"Decorrelated Soft Actor-Critic for Efficient Deep Reinforcement Learning","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-09T21:16:56.411657Z"},"links":{"citing_paper":"/paper/2501.19133"},"observation_digest":"sha256:5a8e379fe8beb8df81249223f671b2e00f213faeda1c1a7fe3048724f06db655","observation_id":"2f57dfca-392b-4a9b-aa0a-b6f5c115dc8c","resolution":{"observed_at":"2026-08-09T21:16:56.997641Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T21:16:56.969893Z","title":null,"venue":null,"work_id":"290a2cc0-57a7-4750-94ec-ea23f3080f3b","year":2017},"citing_paper":{"arxiv_id":"2501.19133","last_updated":"2025-01-31T13:38:57Z","snapshot_observed_at":"2026-08-13T04:13:37.324406Z","submitted_at":"2025-01-31T13:38:57Z","title":"Decorrelated Soft Actor-Critic for Efficient Deep Reinforcement Learning","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-09T21:16:56.417723Z"},"links":{"citing_paper":"/paper/2501.19133"},"observation_digest":"sha256:06ecb4d495ae1072d27a18d076b59ebbc0e2851a0ab281dba6d14dba57fb9997","observation_id":"9ec5481b-0376-42cc-9c26-19a054abb3ac","resolution":{"observed_at":"2026-08-09T21:16:56.975605Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T21:16:56.949686Z","title":"C., Bellemare, M","venue":null,"work_id":"b3753438-9063-4c2d-a850-63ce93e198d8","year":2018},"citing_paper":{"arxiv_id":"2501.19133","last_updated":"2025-01-31T13:38:57Z","snapshot_observed_at":"2026-08-13T04:13:37.324406Z","submitted_at":"2025-01-31T13:38:57Z","title":"Decorrelated Soft Actor-Critic for Efficient Deep Reinforcement Learning","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-09T21:16:56.424282Z"},"links":{"citing_paper":"/paper/2501.19133"},"observation_digest":"sha256:5bad207ac1d14958a763758cf232b08717736a42c8b8bed1e79d82c89c2ab015","observation_id":"7800dcab-61ea-4e22-bd58-8623ff859a96","resolution":{"observed_at":"2026-08-09T21:16:56.955987Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1911.08610","last_updated":"2019-11-19T22:10:08Z","snapshot_observed_at":"2026-08-11T11:37:44.455087Z","submitted_at":"2019-11-19T22:10:08Z","title":"Efficient decorrelation of features using Gramian in Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"1911.08610","doi":null,"metadata_source":"pith","pith_arxiv_id":"1911.08610","snapshot_observed_at":"2026-08-09T21:16:56.648905Z","title":"Efficient decorrelation of features using Gramian in Reinforcement Learning","venue":"cs.LG","work_id":"0d3923e3-f1c0-4569-bd8e-968670dca0e4","year":2019},"citing_paper":{"arxiv_id":"2501.19133","last_updated":"2025-01-31T13:38:57Z","snapshot_observed_at":"2026-08-13T04:13:37.324406Z","submitted_at":"2025-01-31T13:38:57Z","title":"Decorrelated Soft Actor-Critic for Efficient Deep Reinforcement Learning","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-09T21:16:56.432228Z"},"links":{"cited_paper":"/paper/1911.08610","citing_paper":"/paper/2501.19133"},"observation_digest":"sha256:cd33ba8c31fd4466cdcceb569a57da5f0b3a2b5b11d5d9160ab5e1940aaf8abe","observation_id":"ae649b05-7da6-420d-8ea1-bf60e0835388","resolution":{"observed_at":"2026-08-09T21:16:56.654930Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1903.07765","last_updated":"2019-05-08T22:06:55Z","snapshot_observed_at":"2026-07-06T07:40:09.287257Z","submitted_at":"2019-03-18T23:35:23Z","title":"Deep Reinforcement Learning with Decorrelation","version":3},"cited_work":{"arxiv_id":"1903.07765","doi":null,"metadata_source":"pith","pith_arxiv_id":"1903.07765","snapshot_observed_at":"2026-08-09T21:16:56.619461Z","title":"Deep Reinforcement Learning with Decorrelation","venue":"cs.LG","work_id":"24ce63e9-6e4c-4cfb-8778-644c326ad2c0","year":2019},"citing_paper":{"arxiv_id":"2501.19133","last_updated":"2025-01-31T13:38:57Z","snapshot_observed_at":"2026-08-13T04:13:37.324406Z","submitted_at":"2025-01-31T13:38:57Z","title":"Decorrelated Soft Actor-Critic for Efficient Deep Reinforcement Learning","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-09T21:16:56.437687Z"},"links":{"cited_paper":"/paper/1903.07765","citing_paper":"/paper/2501.19133"},"observation_digest":"sha256:73e139371e78db8754c1eb45a7b36dbb1fd16ea3ed8569cb49eac6162379e61d","observation_id":"9aeffa04-b667-4bbf-a102-728825f1783b","resolution":{"observed_at":"2026-08-09T21:16:56.628596Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1312.5602","last_updated":"2013-12-19T16:00:08Z","snapshot_observed_at":"2026-08-12T14:28:10.961989Z","submitted_at":"2013-12-19T16:00:08Z","title":"Playing Atari with Deep Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1312.5602","snapshot_observed_at":"2026-08-09T21:16:56.443530Z","title":null,"venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2501.19133","last_updated":"2025-01-31T13:38:57Z","snapshot_observed_at":"2026-08-13T04:13:37.324406Z","submitted_at":"2025-01-31T13:38:57Z","title":"Decorrelated Soft Actor-Critic for Efficient Deep Reinforcement Learning","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-09T21:16:56.443530Z"},"links":{"cited_paper":"/paper/1312.5602","citing_paper":"/paper/2501.19133"},"observation_digest":"sha256:cc31069a1aa5f52bad1b5a6a4e318ab5983358185259f224b454ccd9275fbebf","observation_id":"adbbc1a3-1594-4d20-a3bb-1abf84f06b41","resolution":{"observed_at":"2026-08-09T21:16:56.443530Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T21:16:56.450160Z","title":"A., Veness, J., Bellemare, M","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2501.19133","last_updated":"2025-01-31T13:38:57Z","snapshot_observed_at":"2026-08-13T04:13:37.324406Z","submitted_at":"2025-01-31T13:38:57Z","title":"Decorrelated Soft Actor-Critic for Efficient Deep Reinforcement Learning","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-09T21:16:56.450160Z"},"links":{"citing_paper":"/paper/2501.19133"},"observation_digest":"sha256:7f210cccedb5c38216efa50acda4243151132f09852e8683811d71f2e44ad0ea","observation_id":"e8818c41-9ff9-4c78-aed4-22f2ef814903","resolution":{"observed_at":"2026-08-09T21:16:56.450160Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T21:16:56.916608Z","title":"and Meister, M","venue":null,"work_id":"61467b1e-906d-4077-8400-6d15a98ce9b7","year":2012},"citing_paper":{"arxiv_id":"2501.19133","last_updated":"2025-01-31T13:38:57Z","snapshot_observed_at":"2026-08-13T04:13:37.324406Z","submitted_at":"2025-01-31T13:38:57Z","title":"Decorrelated Soft Actor-Critic for Efficient Deep Reinforcement Learning","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-09T21:16:56.456437Z"},"links":{"citing_paper":"/paper/2501.19133"},"observation_digest":"sha256:384f81cdc85aee5db045beb14e8ff216f5996ee16454490fa73fd8b328d6a342","observation_id":"b3a6d5ce-7d7f-437d-bd24-924f3a0ed8ce","resolution":{"observed_at":"2026-08-09T21:16:56.922509Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T21:16:56.897531Z","title":null,"venue":null,"work_id":"d58ac311-792b-407a-9f50-f86a35cffb52","year":2022},"citing_paper":{"arxiv_id":"2501.19133","last_updated":"2025-01-31T13:38:57Z","snapshot_observed_at":"2026-08-13T04:13:37.324406Z","submitted_at":"2025-01-31T13:38:57Z","title":"Decorrelated Soft Actor-Critic for Efficient Deep Reinforcement Learning","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-09T21:16:56.462057Z"},"links":{"citing_paper":"/paper/2501.19133"},"observation_digest":"sha256:a7806640c97de0351b5d5c7a44e157749b3696dad2ec2904ddfee6194126a162","observation_id":"1a3ac593-5517-4f89-b109-1ca7a528f15e","resolution":{"observed_at":"2026-08-09T21:16:56.903308Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T21:16:56.879485Z","title":null,"venue":null,"work_id":"eadd6dba-59a6-4664-934f-91379193fd8c","year":2019},"citing_paper":{"arxiv_id":"2501.19133","last_updated":"2025-01-31T13:38:57Z","snapshot_observed_at":"2026-08-13T04:13:37.324406Z","submitted_at":"2025-01-31T13:38:57Z","title":"Decorrelated Soft Actor-Critic for Efficient Deep Reinforcement Learning","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-09T21:16:56.467492Z"},"links":{"citing_paper":"/paper/2501.19133"},"observation_digest":"sha256:e8623760467ec4449655d4adc283b92eb9188453d39df3808e3c566016926759","observation_id":"1dde4e14-b57a-4ab9-b89d-7378825b3777","resolution":{"observed_at":"2026-08-09T21:16:56.884742Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-09T21:16:56.472802Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2501.19133","last_updated":"2025-01-31T13:38:57Z","snapshot_observed_at":"2026-08-13T04:13:37.324406Z","submitted_at":"2025-01-31T13:38:57Z","title":"Decorrelated Soft Actor-Critic for Efficient Deep Reinforcement Learning","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-09T21:16:56.472802Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2501.19133"},"observation_digest":"sha256:4c06fed7a945c5bfbd0efbaa60bb97f161ceac04c982ee42bd8e807f0ae89d63","observation_id":"1c380162-00bd-451c-bb4d-5d40440120c7","resolution":{"observed_at":"2026-08-09T21:16:56.472802Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T21:16:56.861472Z","title":"Y., Giladi, C., Gedalin, M., Rucci, M., Ben-Tov, M., Kushinsky, Y., Mokeichev, A., and Segev, R","venue":null,"work_id":"d730ed97-6509-4511-b06e-3afa704ff0ae","year":2015},"citing_paper":{"arxiv_id":"2501.19133","last_updated":"2025-01-31T13:38:57Z","snapshot_observed_at":"2026-08-13T04:13:37.324406Z","submitted_at":"2025-01-31T13:38:57Z","title":"Decorrelated Soft Actor-Critic for Efficient Deep Reinforcement Learning","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-09T21:16:56.478487Z"},"links":{"citing_paper":"/paper/2501.19133"},"observation_digest":"sha256:eedded9ce36111ca8571f5a912116f27a1800ee1c51b280efe9fc0d461fb8a4a","observation_id":"986cdbff-cc27-4233-9e3e-ccd613ce7633","resolution":{"observed_at":"2026-08-09T21:16:56.866782Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T21:16:56.843298Z","title":"V., Laughlin, S","venue":null,"work_id":"fa76585b-03bd-47e5-b4b9-6cdbf0885aed","year":1982},"citing_paper":{"arxiv_id":"2501.19133","last_updated":"2025-01-31T13:38:57Z","snapshot_observed_at":"2026-08-13T04:13:37.324406Z","submitted_at":"2025-01-31T13:38:57Z","title":"Decorrelated Soft Actor-Critic for Efficient Deep Reinforcement Learning","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-09T21:16:56.483985Z"},"links":{"citing_paper":"/paper/2501.19133"},"observation_digest":"sha256:616b369e187b82dacf8b43c427ff8627e6ea51c2261a88e585da943e6b8d079d","observation_id":"377dd828-aa5c-43e0-ae61-281a34c8b533","resolution":{"observed_at":"2026-08-09T21:16:56.848830Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T21:16:56.489652Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2501.19133","last_updated":"2025-01-31T13:38:57Z","snapshot_observed_at":"2026-08-13T04:13:37.324406Z","submitted_at":"2025-01-31T13:38:57Z","title":"Decorrelated Soft Actor-Critic for Efficient Deep Reinforcement Learning","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-09T21:16:56.489652Z"},"links":{"citing_paper":"/paper/2501.19133"},"observation_digest":"sha256:9a502906ed38f7bcc25e642487bfb1d578f40444538effde8877a70818d4f37b","observation_id":"43f802e3-1c6d-41b2-a665-d79aa36301ac","resolution":{"observed_at":"2026-08-09T21:16:56.489652Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1908.04683","last_updated":"2019-11-08T10:37:59Z","snapshot_observed_at":"2026-08-13T01:52:30.836249Z","submitted_at":"2019-08-13T14:55:09Z","title":"Is Deep Reinforcement Learning Really Superhuman on Atari? Leveling the playing field","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1908.04683","snapshot_observed_at":"2026-08-09T21:16:56.496069Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2501.19133","last_updated":"2025-01-31T13:38:57Z","snapshot_observed_at":"2026-08-13T04:13:37.324406Z","submitted_at":"2025-01-31T13:38:57Z","title":"Decorrelated Soft Actor-Critic for Efficient Deep Reinforcement Learning","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-09T21:16:56.496069Z"},"links":{"cited_paper":"/paper/1908.04683","citing_paper":"/paper/2501.19133"},"observation_digest":"sha256:fa684bd94ffe7e81f04ca7ccc8e4177ce9c073b5cd6a83ae6a11cb358a8776c7","observation_id":"f2a56067-4a5d-4bab-9a84-17caabb8e52f","resolution":{"observed_at":"2026-08-09T21:16:56.496069Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T21:16:56.813895Z","title":null,"venue":null,"work_id":"a1397f39-8713-42d7-94f3-f6bc5c6486dd","year":1974},"citing_paper":{"arxiv_id":"2501.19133","last_updated":"2025-01-31T13:38:57Z","snapshot_observed_at":"2026-08-13T04:13:37.324406Z","submitted_at":"2025-01-31T13:38:57Z","title":"Decorrelated Soft Actor-Critic for Efficient Deep Reinforcement Learning","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-09T21:16:56.501482Z"},"links":{"citing_paper":"/paper/2501.19133"},"observation_digest":"sha256:783c307c119dc7abe151280f34455db757c63622ca3256e4d6db5b4578f3466d","observation_id":"b2d3a4f4-919a-409f-a6ef-93ea1dbc8812","resolution":{"observed_at":"2026-08-09T21:16:56.819298Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2501.19133","last_updated":"2025-01-31T13:38:57Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-13T04:13:37.324406Z","submitted_at":"2025-01-31T13:38:57Z","title":"Decorrelated Soft Actor-Critic for Efficient Deep Reinforcement Learning"},"reference_resolution":{"displayed":37,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":25,"verified_exact":3,"verified_fuzzy":9},"total_outbound_references":37},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"thesis":"As of 13 August 2026, this Paper Citation Record lists 37 of 37 outbound references and 0 inbound Pith citation observations for arXiv:2501.19133."}