{"as_of":"2026-08-19T23:13:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:5704d5e7d431bcb5df40237728a16c44ce0be592bcf944fd4b7586739bb87948","coverage":[{"denominator":13,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":13,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T15:03:44.551417Z","state":"measured"},{"denominator":13,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":13,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-19T06:32:44.657259+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2505.16734/citation-record","integrity":"/paper/2505.16734/integrity","json":"/paper/2505.16734/citation-record.json","paper":"/paper/2505.16734"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:45.601467Z","title":null,"venue":null,"work_id":"ff664206-e087-4a3c-b32a-8ad6129b7afc","year":2023},"citing_paper":{"arxiv_id":"2505.16734","last_updated":"2025-05-22T14:48:00Z","snapshot_observed_at":"2026-08-17T20:19:25.830500Z","submitted_at":"2025-05-22T14:48:00Z","title":"Maximum Total Correlation Reinforcement Learning","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:44.211447Z"},"links":{"citing_paper":"/paper/2505.16734"},"observation_digest":"sha256:cc563b00672c354c490039ad016e003bc862dffeaf2b62fe2b7a1cfb7de0c96e","observation_id":"31a7e459-ba72-46fb-9578-f876d8195b34","resolution":{"observed_at":"2026-08-07T15:03:45.691678Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:45.310595Z","title":null,"venue":null,"work_id":"cc4f2691-e2f8-469a-b24c-569f6d76b7bb","year":null},"citing_paper":{"arxiv_id":"2505.16734","last_updated":"2025-05-22T14:48:00Z","snapshot_observed_at":"2026-08-17T20:19:25.830500Z","submitted_at":"2025-05-22T14:48:00Z","title":"Maximum Total Correlation Reinforcement Learning","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:44.421431Z"},"links":{"citing_paper":"/paper/2505.16734"},"observation_digest":"sha256:dd1ed8638c226f0948dbbdf71ea98db2d7c8f72c0b524f49f442dc3bce172829","observation_id":"3d532233-6349-43b5-a98c-c2a97fbc2bbb","resolution":{"observed_at":"2026-08-07T15:03:45.360462Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1801.00690","last_updated":"2018-01-02T15:48:14Z","snapshot_observed_at":"2026-08-01T20:24:08.300098Z","submitted_at":"2018-01-02T15:48:14Z","title":"DeepMind Control Suite","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1801.00690","snapshot_observed_at":"2026-08-07T15:03:43.855369Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.16734","last_updated":"2025-05-22T14:48:00Z","snapshot_observed_at":"2026-08-17T20:19:25.830500Z","submitted_at":"2025-05-22T14:48:00Z","title":"Maximum Total Correlation Reinforcement Learning","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:43.855369Z"},"links":{"cited_paper":"/paper/1801.00690","citing_paper":"/paper/2505.16734"},"observation_digest":"sha256:3b19f91ccfdd65ebf32a09d82cc504e3bb38b7b2303db5a9c420f8487cd08d53","observation_id":"ea192361-4a4e-46a7-8aef-1e9982e8c62c","resolution":{"observed_at":"2026-08-07T15:03:43.855369Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:45.970221Z","title":"log p(z1:T |s1:T ) p(z1:T ) # − E","venue":null,"work_id":"67afb589-63b7-4a27-b016-d3cb291203a3","year":2021},"citing_paper":{"arxiv_id":"2505.16734","last_updated":"2025-05-22T14:48:00Z","snapshot_observed_at":"2026-08-17T20:19:25.830500Z","submitted_at":"2025-05-22T14:48:00Z","title":"Maximum Total Correlation Reinforcement Learning","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:44.031060Z"},"links":{"citing_paper":"/paper/2505.16734"},"observation_digest":"sha256:627fcdc794bc50a096b27abaf0e36af17286168ba9ccd1321b5cf1e5bf90ed1b","observation_id":"87b97f67-d3f3-4743-94b5-335fe32ffd4f","resolution":{"observed_at":"2026-08-07T15:03:46.037412Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:45.443459Z","title":null,"venue":null,"work_id":"b8e60396-fd29-4677-a5a2-76135ca55f97","year":2021},"citing_paper":{"arxiv_id":"2505.16734","last_updated":"2025-05-22T14:48:00Z","snapshot_observed_at":"2026-08-17T20:19:25.830500Z","submitted_at":"2025-05-22T14:48:00Z","title":"Maximum Total Correlation Reinforcement Learning","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:44.303922Z"},"links":{"citing_paper":"/paper/2505.16734"},"observation_digest":"sha256:6567155fc59a6be4f36c271c9f3852ad1fa873e726a36e01942c335c33485f40","observation_id":"c50d02b3-37bf-4571-a6b2-2d7cadd5d23d","resolution":{"observed_at":"2026-08-07T15:03:45.510278Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:45.111662Z","title":"State sequences of our method show more repeating and periodic patterns","venue":null,"work_id":"9701e82d-844b-42f9-a84c-558f436d4c16","year":2001},"citing_paper":{"arxiv_id":"2505.16734","last_updated":"2025-05-22T14:48:00Z","snapshot_observed_at":"2026-08-17T20:19:25.830500Z","submitted_at":"2025-05-22T14:48:00Z","title":"Maximum Total Correlation Reinforcement Learning","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:44.551417Z"},"links":{"citing_paper":"/paper/2505.16734"},"observation_digest":"sha256:c7efbe2c51826496d637e86c7736652696e1d1f623e7b6877827ce5ca0bcae52","observation_id":"94b62b42-4d4e-4696-9456-bac29e550954","resolution":{"observed_at":"2026-08-07T15:03:45.214371Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1807.03748","last_updated":"2019-01-22T18:47:12Z","snapshot_observed_at":"2026-08-14T18:53:38.574749Z","submitted_at":"2018-07-10T16:52:11Z","title":"Representation Learning with Contrastive Predictive Coding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1807.03748","snapshot_observed_at":"2026-08-07T15:03:43.695300Z","title":"URL http://www.jstor.org/ stable/jj.8441753.32","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.16734","last_updated":"2025-05-22T14:48:00Z","snapshot_observed_at":"2026-08-17T20:19:25.830500Z","submitted_at":"2025-05-22T14:48:00Z","title":"Maximum Total Correlation Reinforcement Learning","version":1},"reference_index":1934,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:43.695300Z"},"links":{"cited_paper":"/paper/1807.03748","citing_paper":"/paper/2505.16734"},"observation_digest":"sha256:5f7d239bccbf86cc709f4e9dffe9086a947c77373b2eff814470224e5f539eda","observation_id":"31c098a3-27e9-4e95-94f4-786a3d99976c","resolution":{"observed_at":"2026-08-07T15:03:43.695300Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2301.12038","last_updated":"2023-09-19T03:21:17Z","snapshot_observed_at":"2026-08-16T15:59:35.212830Z","submitted_at":"2023-01-28T00:49:28Z","title":"STEERING: Stein Information Directed Exploration for Model-Based Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"2301.12038","doi":null,"metadata_source":"pith","pith_arxiv_id":"2301.12038","snapshot_observed_at":"2026-08-07T15:03:44.970885Z","title":"STEERING: Stein Information Directed Exploration for Model-Based Reinforcement Learning","venue":"cs.LG","work_id":"498178ac-4df3-4992-86ae-126de2999195","year":2023},"citing_paper":{"arxiv_id":"2505.16734","last_updated":"2025-05-22T14:48:00Z","snapshot_observed_at":"2026-08-17T20:19:25.830500Z","submitted_at":"2025-05-22T14:48:00Z","title":"Maximum Total Correlation Reinforcement Learning","version":1},"reference_index":1995,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:43.304291Z"},"links":{"cited_paper":"/paper/2301.12038","citing_paper":"/paper/2505.16734"},"observation_digest":"sha256:22d5147ee1071436cf3cf01974d4ac0f6546d32a0a93b8103de1c5d74a9dd750","observation_id":"bae987d2-975d-49da-bb05-4374e5f63975","resolution":{"observed_at":"2026-08-07T15:03:45.033649Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:46.181021Z","title":"and Zaslavsky, N","venue":null,"work_id":"459fbd46-06da-4b48-87b9-f4c79fc8a46b","year":2015},"citing_paper":{"arxiv_id":"2505.16734","last_updated":"2025-05-22T14:48:00Z","snapshot_observed_at":"2026-08-17T20:19:25.830500Z","submitted_at":"2025-05-22T14:48:00Z","title":"Maximum Total Correlation Reinforcement Learning","version":1},"reference_index":2010,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:43.932389Z"},"links":{"citing_paper":"/paper/2505.16734"},"observation_digest":"sha256:e4718777711bc65439279d12c2d31685bbce64d5304e3a0aeba8ccb5be7aa6d5","observation_id":"ced26670-bd24-4dd1-a016-bbe27b08fbee","resolution":{"observed_at":"2026-08-07T15:03:46.266062Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:45.796187Z","title":null,"venue":null,"work_id":"c5396b20-ea14-44c0-bcd0-48feb49604c9","year":2021},"citing_paper":{"arxiv_id":"2505.16734","last_updated":"2025-05-22T14:48:00Z","snapshot_observed_at":"2026-08-17T20:19:25.830500Z","submitted_at":"2025-05-22T14:48:00Z","title":"Maximum Total Correlation Reinforcement Learning","version":1},"reference_index":2018,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:44.114776Z"},"links":{"citing_paper":"/paper/2505.16734"},"observation_digest":"sha256:99223808cf678fea499aef7752c8ae359d173b934195144efbeb6390251c0500","observation_id":"6a905fc8-68bd-4a1f-b2c2-29090c2dea39","resolution":{"observed_at":"2026-08-07T15:03:45.871561Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2008.00614","last_updated":"2020-08-03T02:24:20Z","snapshot_observed_at":"2026-08-19T22:16:30.261030Z","submitted_at":"2020-08-03T02:24:20Z","title":"Dynamics Generalization via Information Bottleneck in Deep Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2008.00614","doi":null,"metadata_source":"pith","pith_arxiv_id":"2008.00614","snapshot_observed_at":"2026-08-07T15:03:44.749882Z","title":"Dynamics Generalization via Information Bottleneck in Deep Reinforcement Learning","venue":"cs.LG","work_id":"ef173d0f-c22c-4b43-8b12-f3300361e85e","year":2020},"citing_paper":{"arxiv_id":"2505.16734","last_updated":"2025-05-22T14:48:00Z","snapshot_observed_at":"2026-08-17T20:19:25.830500Z","submitted_at":"2025-05-22T14:48:00Z","title":"Maximum Total Correlation Reinforcement Learning","version":1},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:43.592134Z"},"links":{"cited_paper":"/paper/2008.00614","citing_paper":"/paper/2505.16734"},"observation_digest":"sha256:1dbeeafb1b43e0bbce80b8f6db8a22a564cdb11cfb2f468d41ab9e97ff8e7fe2","observation_id":"6107c7b8-cf3a-47d1-bd0d-1a7008b88b16","resolution":{"observed_at":"2026-08-07T15:03:44.845068Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1812.05905","last_updated":"2019-01-29T12:10:47Z","snapshot_observed_at":"2026-08-17T07:51:41.384508Z","submitted_at":"2018-12-13T04:44:29Z","title":"Soft Actor-Critic Algorithms and Applications","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1812.05905","snapshot_observed_at":"2026-08-07T15:03:43.349174Z","title":"Soft actor-critic algorithms and applications","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.16734","last_updated":"2025-05-22T14:48:00Z","snapshot_observed_at":"2026-08-17T20:19:25.830500Z","submitted_at":"2025-05-22T14:48:00Z","title":"Maximum Total Correlation Reinforcement Learning","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:43.349174Z"},"links":{"cited_paper":"/paper/1812.05905","citing_paper":"/paper/2505.16734"},"observation_digest":"sha256:ec5f1192269671bf08eaa6ef66f8a8e5570aae33323197034b264849af61833a","observation_id":"8eab2a62-5a0e-4ea0-97ec-6e15aceef930","resolution":{"observed_at":"2026-08-07T15:03:43.349174Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:03:43.777664Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.16734","last_updated":"2025-05-22T14:48:00Z","snapshot_observed_at":"2026-08-17T20:19:25.830500Z","submitted_at":"2025-05-22T14:48:00Z","title":"Maximum Total Correlation Reinforcement Learning","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:43.777664Z"},"links":{"citing_paper":"/paper/2505.16734"},"observation_digest":"sha256:eb4c549bcb1bd214a0ccf4a4b26c7595cd45da74159e59d66287e3a9da1a2816","observation_id":"c2b0111f-6e25-44b3-8a2b-fd90038c2cc9","resolution":{"observed_at":"2026-08-07T15:03:43.777664Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2505.16734","last_updated":"2025-05-22T14:48:00Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-17T20:19:25.830500Z","submitted_at":"2025-05-22T14:48:00Z","title":"Maximum Total Correlation Reinforcement Learning"},"reference_resolution":{"displayed":13,"state_counts":{"malformed_identifier":2,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":6,"verified_exact":1,"verified_fuzzy":3},"total_outbound_references":13},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"thesis":"As of 19 August 2026, this Paper Citation Record lists 13 of 13 outbound references and 0 inbound Pith citation observations for arXiv:2505.16734."}