{"as_of":"2026-08-08T12:15:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:acdcba5c4ccd629ffdb8021767378e13820395293ebff522781329df6c5a9dd1","coverage":[{"denominator":24,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":24,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T05:55:08.160720Z","state":"measured"},{"denominator":24,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":24,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2506.06786/citation-record","integrity":"/paper/2506.06786/integrity","json":"/paper/2506.06786/citation-record.json","paper":"/paper/2506.06786"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:55:08.037952Z","title":"Exploration in deep reinforcement learning: A survey,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.06786","last_updated":"2025-06-07T12:55:10Z","snapshot_observed_at":"2026-08-07T05:47:05.245444Z","submitted_at":"2025-06-07T12:55:10Z","title":"Learning What Matters Now: A Dual-Critic Context-Aware RL Framework for Priority-Driven Information Gain","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T05:55:08.037952Z"},"links":{"citing_paper":"/paper/2506.06786"},"observation_digest":"sha256:9d7267546aef22df65b8ae37b69fa74bc1d078218cab60761d61a885ac9cab2d","observation_id":"7398286a-4956-4f95-a711-1972aa3f39ce","resolution":{"observed_at":"2026-08-07T05:55:08.037952Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:55:08.043659Z","title":"Deep reinforcement learning for time-critical wilderness search and rescue using drones,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.06786","last_updated":"2025-06-07T12:55:10Z","snapshot_observed_at":"2026-08-07T05:47:05.245444Z","submitted_at":"2025-06-07T12:55:10Z","title":"Learning What Matters Now: A Dual-Critic Context-Aware RL Framework for Priority-Driven Information Gain","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T05:55:08.043659Z"},"links":{"citing_paper":"/paper/2506.06786"},"observation_digest":"sha256:e5b20dc1f9b834427ef9a91bfba513bb749ea3ee68ef6d71baeb050a71b8ee84","observation_id":"2b7abad1-1726-4681-be06-c2e94e5c61fb","resolution":{"observed_at":"2026-08-07T05:55:08.043659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.12098","last_updated":"2025-07-31T14:50:20Z","snapshot_observed_at":"2026-08-03T10:08:45.650380Z","submitted_at":"2024-12-16T18:59:53Z","title":"MaxInfoRL: Boosting exploration in reinforcement learning through information gain maximization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.12098","snapshot_observed_at":"2026-08-07T05:55:08.048563Z","title":"Maxinforl: Boosting exploration in reinforcement learning through information gain maximization,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.06786","last_updated":"2025-06-07T12:55:10Z","snapshot_observed_at":"2026-08-07T05:47:05.245444Z","submitted_at":"2025-06-07T12:55:10Z","title":"Learning What Matters Now: A Dual-Critic Context-Aware RL Framework for Priority-Driven Information Gain","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T05:55:08.048563Z"},"links":{"cited_paper":"/paper/2412.12098","citing_paper":"/paper/2506.06786"},"observation_digest":"sha256:e1a2cecdf100a035734013cdde3606524c68d5095f4bf49d3c7d23ef61ecf5da","observation_id":"292fd82b-4056-49fd-bcbe-7899350d43ac","resolution":{"observed_at":"2026-08-07T05:55:08.048563Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:55:08.535735Z","title":"Regret bounds for information-directed reinforcement learning,","venue":null,"work_id":"ed2d101f-e8d3-450e-ad00-e169fa9db938","year":2022},"citing_paper":{"arxiv_id":"2506.06786","last_updated":"2025-06-07T12:55:10Z","snapshot_observed_at":"2026-08-07T05:47:05.245444Z","submitted_at":"2025-06-07T12:55:10Z","title":"Learning What Matters Now: A Dual-Critic Context-Aware RL Framework for Priority-Driven Information Gain","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T05:55:08.054122Z"},"links":{"citing_paper":"/paper/2506.06786"},"observation_digest":"sha256:722ce05f58354f384413158d1a1ec6d638d71a324e555466b1b94b6e47936a88","observation_id":"e5e0854f-babb-4008-85b6-8929849cc418","resolution":{"observed_at":"2026-08-07T05:55:08.540988Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:55:08.517508Z","title":"Selective exploration and information gathering in search and rescue using hierarchical learning guided by natural language input,","venue":null,"work_id":"acaccd83-ea4e-408d-b9ff-992a84561dd1","year":2024},"citing_paper":{"arxiv_id":"2506.06786","last_updated":"2025-06-07T12:55:10Z","snapshot_observed_at":"2026-08-07T05:47:05.245444Z","submitted_at":"2025-06-07T12:55:10Z","title":"Learning What Matters Now: A Dual-Critic Context-Aware RL Framework for Priority-Driven Information Gain","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T05:55:08.059018Z"},"links":{"citing_paper":"/paper/2506.06786"},"observation_digest":"sha256:301d2b909fa95c1ed8c1ecfe7840aff15a5e515086e316935b7dbafe1ffbdfca","observation_id":"adf17a1d-4b14-4273-a5f1-24b4f5ddc7b7","resolution":{"observed_at":"2026-08-07T05:55:08.523642Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:55:08.501420Z","title":"Adversar: Adversarial search and rescue via multi-agent reinforcement learning,","venue":null,"work_id":"f9d6dd8e-5cf1-4574-8882-2700425cb166","year":2022},"citing_paper":{"arxiv_id":"2506.06786","last_updated":"2025-06-07T12:55:10Z","snapshot_observed_at":"2026-08-07T05:47:05.245444Z","submitted_at":"2025-06-07T12:55:10Z","title":"Learning What Matters Now: A Dual-Critic Context-Aware RL Framework for Priority-Driven Information Gain","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T05:55:08.064858Z"},"links":{"citing_paper":"/paper/2506.06786"},"observation_digest":"sha256:2e2b8eb309305293ad4b61c643db63fe08a74ed4cf1412c9f931190df494353b","observation_id":"021747fd-36ab-4553-82ce-91559fef86b9","resolution":{"observed_at":"2026-08-07T05:55:08.506480Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:55:08.484620Z","title":"Target search and navigation in heterogeneous robot systems with deep reinforcement learning,","venue":null,"work_id":"6bfa483d-cce3-4703-9432-eecd45a66360","year":2025},"citing_paper":{"arxiv_id":"2506.06786","last_updated":"2025-06-07T12:55:10Z","snapshot_observed_at":"2026-08-07T05:47:05.245444Z","submitted_at":"2025-06-07T12:55:10Z","title":"Learning What Matters Now: A Dual-Critic Context-Aware RL Framework for Priority-Driven Information Gain","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T05:55:08.070670Z"},"links":{"citing_paper":"/paper/2506.06786"},"observation_digest":"sha256:a7c6f113e431614c1c03d5dd52d5d77ef371469a2d5d1454db3b4fc877f65c06","observation_id":"7867432d-7291-4cf8-8fbc-71340a251fdd","resolution":{"observed_at":"2026-08-07T05:55:08.490184Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:55:08.467682Z","title":"Multi-robot cooperative target search based on distributed reinforcement learning method in 3d dynamic environments,","venue":null,"work_id":"aa8d5599-ac27-411c-a4ac-fdfeb7ab3f43","year":2024},"citing_paper":{"arxiv_id":"2506.06786","last_updated":"2025-06-07T12:55:10Z","snapshot_observed_at":"2026-08-07T05:47:05.245444Z","submitted_at":"2025-06-07T12:55:10Z","title":"Learning What Matters Now: A Dual-Critic Context-Aware RL Framework for Priority-Driven Information Gain","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T05:55:08.075594Z"},"links":{"citing_paper":"/paper/2506.06786"},"observation_digest":"sha256:657b627c3e95d7997a9f4e3b428d2f9714fcc014d225fc82e9a74745c858c4eb","observation_id":"f7627ad9-0862-4d8c-8e21-2015ab9d841f","resolution":{"observed_at":"2026-08-07T05:55:08.473171Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:55:08.080420Z","title":null,"venue":null,"work_id":null,"year":1998},"citing_paper":{"arxiv_id":"2506.06786","last_updated":"2025-06-07T12:55:10Z","snapshot_observed_at":"2026-08-07T05:47:05.245444Z","submitted_at":"2025-06-07T12:55:10Z","title":"Learning What Matters Now: A Dual-Critic Context-Aware RL Framework for Priority-Driven Information Gain","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T05:55:08.080420Z"},"links":{"citing_paper":"/paper/2506.06786"},"observation_digest":"sha256:86c1a10fbb54b7a7508cab60c923e38f48c022bf2fb5979aa553ae68a1b8e9ba","observation_id":"399349a3-5f65-4f6e-8ac5-275f1bafbadf","resolution":{"observed_at":"2026-08-07T05:55:08.080420Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:55:08.438322Z","title":"Boltzmann exploration done right,","venue":null,"work_id":"1b94a294-caae-4692-a763-70d31ae5d421","year":2017},"citing_paper":{"arxiv_id":"2506.06786","last_updated":"2025-06-07T12:55:10Z","snapshot_observed_at":"2026-08-07T05:47:05.245444Z","submitted_at":"2025-06-07T12:55:10Z","title":"Learning What Matters Now: A Dual-Critic Context-Aware RL Framework for Priority-Driven Information Gain","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T05:55:08.085052Z"},"links":{"citing_paper":"/paper/2506.06786"},"observation_digest":"sha256:ff912bcc1dce38df4e05053e7788290aabd1e50e62499f8af3f8298634918ebc","observation_id":"9d35c641-da1d-4d39-933d-4eb8530a0265","resolution":{"observed_at":"2026-08-07T05:55:08.444604Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:55:08.421606Z","title":"Using confidence bounds for exploitation-exploration trade- offs,","venue":null,"work_id":"775f8429-b4d0-4cff-ac9f-f5565d557002","year":2002},"citing_paper":{"arxiv_id":"2506.06786","last_updated":"2025-06-07T12:55:10Z","snapshot_observed_at":"2026-08-07T05:47:05.245444Z","submitted_at":"2025-06-07T12:55:10Z","title":"Learning What Matters Now: A Dual-Critic Context-Aware RL Framework for Priority-Driven Information Gain","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T05:55:08.089768Z"},"links":{"citing_paper":"/paper/2506.06786"},"observation_digest":"sha256:284f6d7eb653c2419d406c0e872bc6a52b1f8118e14cd7b84900b9152afcf3bb","observation_id":"35cbcc6b-197f-486b-9597-9c78e7c6b97d","resolution":{"observed_at":"2026-08-07T05:55:08.426789Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:55:08.402989Z","title":"An empirical evaluation of thompson sam- pling,","venue":null,"work_id":"28bbf340-21d4-4c73-853b-c2706d339024","year":2011},"citing_paper":{"arxiv_id":"2506.06786","last_updated":"2025-06-07T12:55:10Z","snapshot_observed_at":"2026-08-07T05:47:05.245444Z","submitted_at":"2025-06-07T12:55:10Z","title":"Learning What Matters Now: A Dual-Critic Context-Aware RL Framework for Priority-Driven Information Gain","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T05:55:08.094471Z"},"links":{"citing_paper":"/paper/2506.06786"},"observation_digest":"sha256:0a82ceee7ef3dc67a34e5ab03218a93a6db24a33cdc13835e0304ca71c30299e","observation_id":"4a812954-355a-49bf-a755-6be8287c776d","resolution":{"observed_at":"2026-08-07T05:55:08.408573Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:55:08.099735Z","title":"Curiosity-driven exploration by self-supervised prediction,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.06786","last_updated":"2025-06-07T12:55:10Z","snapshot_observed_at":"2026-08-07T05:47:05.245444Z","submitted_at":"2025-06-07T12:55:10Z","title":"Learning What Matters Now: A Dual-Critic Context-Aware RL Framework for Priority-Driven Information Gain","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T05:55:08.099735Z"},"links":{"citing_paper":"/paper/2506.06786"},"observation_digest":"sha256:9b3648d5f8799e9caaaee7dd1b5e8e17544ba1025cd1eb4eb217325600589561","observation_id":"b9813539-f0d5-48f3-8c5c-cada4c50e4c9","resolution":{"observed_at":"2026-08-07T05:55:08.099735Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:55:08.104666Z","title":"Unifying count-based exploration and intrinsic motiva- tion,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2506.06786","last_updated":"2025-06-07T12:55:10Z","snapshot_observed_at":"2026-08-07T05:47:05.245444Z","submitted_at":"2025-06-07T12:55:10Z","title":"Learning What Matters Now: A Dual-Critic Context-Aware RL Framework for Priority-Driven Information Gain","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T05:55:08.104666Z"},"links":{"citing_paper":"/paper/2506.06786"},"observation_digest":"sha256:4c6cd254917f8f305d3196e0d7fb7baf1e875cdd36f0485782253ec5e9243c3b","observation_id":"95e244b5-9f07-4d80-b95f-e0a892e61399","resolution":{"observed_at":"2026-08-07T05:55:08.104666Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1703.01732","last_updated":"2017-03-06T05:51:42Z","snapshot_observed_at":"2026-07-06T05:32:27.193419Z","submitted_at":"2017-03-06T05:51:42Z","title":"Surprise-Based Intrinsic Motivation for Deep Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1703.01732","snapshot_observed_at":"2026-08-07T05:55:08.110056Z","title":"Surprise-based intrinsic motivation for deep reinforcement learning,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.06786","last_updated":"2025-06-07T12:55:10Z","snapshot_observed_at":"2026-08-07T05:47:05.245444Z","submitted_at":"2025-06-07T12:55:10Z","title":"Learning What Matters Now: A Dual-Critic Context-Aware RL Framework for Priority-Driven Information Gain","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T05:55:08.110056Z"},"links":{"cited_paper":"/paper/1703.01732","citing_paper":"/paper/2506.06786"},"observation_digest":"sha256:94ac4602f80e9aad0904673e7d88ba0b8e3d7fe90c6df3ce14f0a52542e8e4ea","observation_id":"1e91654f-7996-496d-9846-07d9ccb8f408","resolution":{"observed_at":"2026-08-07T05:55:08.110056Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1810.12894","last_updated":"2018-10-30T17:44:42Z","snapshot_observed_at":"2026-07-06T07:11:32.319931Z","submitted_at":"2018-10-30T17:44:42Z","title":"Exploration by Random Network Distillation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1810.12894","snapshot_observed_at":"2026-08-07T05:55:08.116114Z","title":"Exploration by random network distillation,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.06786","last_updated":"2025-06-07T12:55:10Z","snapshot_observed_at":"2026-08-07T05:47:05.245444Z","submitted_at":"2025-06-07T12:55:10Z","title":"Learning What Matters Now: A Dual-Critic Context-Aware RL Framework for Priority-Driven Information Gain","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T05:55:08.116114Z"},"links":{"cited_paper":"/paper/1810.12894","citing_paper":"/paper/2506.06786"},"observation_digest":"sha256:ed5b96eac0e4895ba33c8a830d72564b74695996e0fa5011d5d60c9d7f4b99ca","observation_id":"217eb0e2-bdb2-4011-aec0-5feafce2fd0a","resolution":{"observed_at":"2026-08-07T05:55:08.116114Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:55:08.121560Z","title":"Model-agnostic meta-learning for fast adaptation of deep networks,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.06786","last_updated":"2025-06-07T12:55:10Z","snapshot_observed_at":"2026-08-07T05:47:05.245444Z","submitted_at":"2025-06-07T12:55:10Z","title":"Learning What Matters Now: A Dual-Critic Context-Aware RL Framework for Priority-Driven Information Gain","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T05:55:08.121560Z"},"links":{"citing_paper":"/paper/2506.06786"},"observation_digest":"sha256:ea3ba4912f7fe190225bda5f86d97e877d7d685c2f85c20d2e5f940a568abec8","observation_id":"20bf38b9-0336-400e-80d1-e7f705d683df","resolution":{"observed_at":"2026-08-07T05:55:08.121560Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:55:08.353533Z","title":"Lattimore and C","venue":null,"work_id":"24620bdd-638b-4f9b-959a-19e764390322","year":2020},"citing_paper":{"arxiv_id":"2506.06786","last_updated":"2025-06-07T12:55:10Z","snapshot_observed_at":"2026-08-07T05:47:05.245444Z","submitted_at":"2025-06-07T12:55:10Z","title":"Learning What Matters Now: A Dual-Critic Context-Aware RL Framework for Priority-Driven Information Gain","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T05:55:08.126666Z"},"links":{"citing_paper":"/paper/2506.06786"},"observation_digest":"sha256:28a4886cb0a32ca54413cfb6e1dd57520c751f3506fae94a534ee7d7c7a05e01","observation_id":"beca5d45-bc1d-40dd-93c9-efe68b3f5075","resolution":{"observed_at":"2026-08-07T05:55:08.358828Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:55:08.335968Z","title":"Hidden parameter markov decision processes: A semiparametric regression approach for discovering latent task parametrizations,","venue":null,"work_id":"9a59bc17-ea8d-41ca-b39a-15a221bf4a54","year":2016},"citing_paper":{"arxiv_id":"2506.06786","last_updated":"2025-06-07T12:55:10Z","snapshot_observed_at":"2026-08-07T05:47:05.245444Z","submitted_at":"2025-06-07T12:55:10Z","title":"Learning What Matters Now: A Dual-Critic Context-Aware RL Framework for Priority-Driven Information Gain","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T05:55:08.131798Z"},"links":{"citing_paper":"/paper/2506.06786"},"observation_digest":"sha256:96a3a204a4686d6e445c5b079d48414541651e241ca4c16dacf35530fdb2aeff","observation_id":"d2b74e39-e08d-469b-bce2-248c23810283","resolution":{"observed_at":"2026-08-07T05:55:08.341394Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1502.02259","last_updated":"2015-02-08T14:58:50Z","snapshot_observed_at":"2026-08-03T17:17:59.241164Z","submitted_at":"2015-02-08T14:58:50Z","title":"Contextual Markov Decision Processes","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1502.02259","snapshot_observed_at":"2026-08-07T05:55:08.137170Z","title":"Contextual markov decision processes,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2506.06786","last_updated":"2025-06-07T12:55:10Z","snapshot_observed_at":"2026-08-07T05:47:05.245444Z","submitted_at":"2025-06-07T12:55:10Z","title":"Learning What Matters Now: A Dual-Critic Context-Aware RL Framework for Priority-Driven Information Gain","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T05:55:08.137170Z"},"links":{"cited_paper":"/paper/1502.02259","citing_paper":"/paper/2506.06786"},"observation_digest":"sha256:282044032ed532e3f9afdb3325c323f69d240393dc50ec926f562f0764e7c51f","observation_id":"9135ebbd-6a7a-4ac0-89ff-ded3ac6cd182","resolution":{"observed_at":"2026-08-07T05:55:08.137170Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2202.06557","last_updated":"2022-02-14T08:52:36Z","snapshot_observed_at":"2026-07-06T12:37:25.512398Z","submitted_at":"2022-02-14T08:52:36Z","title":"Reinforcement Learning in Presence of Discrete Markovian Context Evolution","version":1},"cited_work":{"arxiv_id":"2202.06557","doi":null,"metadata_source":"pith","pith_arxiv_id":"2202.06557","snapshot_observed_at":"2026-08-07T05:55:08.199869Z","title":"Reinforcement Learning in Presence of Discrete Markovian Context Evolution","venue":"cs.LG","work_id":"7ea7ddc3-ebc2-4123-936f-36314e665fed","year":2022},"citing_paper":{"arxiv_id":"2506.06786","last_updated":"2025-06-07T12:55:10Z","snapshot_observed_at":"2026-08-07T05:47:05.245444Z","submitted_at":"2025-06-07T12:55:10Z","title":"Learning What Matters Now: A Dual-Critic Context-Aware RL Framework for Priority-Driven Information Gain","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T05:55:08.142795Z"},"links":{"cited_paper":"/paper/2202.06557","citing_paper":"/paper/2506.06786"},"observation_digest":"sha256:01628317643a3cb510f3df1a3651c969fbb9a77ad92982fe04662c1397e2e12e","observation_id":"5d9ee41b-2377-4147-b8d2-58f513e91a1e","resolution":{"observed_at":"2026-08-07T05:55:08.207365Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:55:08.317500Z","title":"Context-aware dynamics model for generalization in model-based reinforcement learning,","venue":null,"work_id":"bb03ec40-64fe-493b-8e10-88b381fc0a94","year":2020},"citing_paper":{"arxiv_id":"2506.06786","last_updated":"2025-06-07T12:55:10Z","snapshot_observed_at":"2026-08-07T05:47:05.245444Z","submitted_at":"2025-06-07T12:55:10Z","title":"Learning What Matters Now: A Dual-Critic Context-Aware RL Framework for Priority-Driven Information Gain","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T05:55:08.149028Z"},"links":{"citing_paper":"/paper/2506.06786"},"observation_digest":"sha256:c127f8c10cd3b8bc4d242b29722756d77f6b8b3f9a88530d6d00d193d2d4e7ea","observation_id":"3e2e32e3-2288-4089-91a9-9d2c56dae461","resolution":{"observed_at":"2026-08-07T05:55:08.323520Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:55:08.300651Z","title":"Learning to optimize via information- directed sampling,","venue":null,"work_id":"cc02ca50-1f47-44ce-8d91-370e9ebb107e","year":2018},"citing_paper":{"arxiv_id":"2506.06786","last_updated":"2025-06-07T12:55:10Z","snapshot_observed_at":"2026-08-07T05:47:05.245444Z","submitted_at":"2025-06-07T12:55:10Z","title":"Learning What Matters Now: A Dual-Critic Context-Aware RL Framework for Priority-Driven Information Gain","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T05:55:08.155554Z"},"links":{"citing_paper":"/paper/2506.06786"},"observation_digest":"sha256:d1d06cc571095c1dbdb17972307477c4decc263a558f7d2cf793c48137f49054","observation_id":"26648876-6b35-45f1-8482-0234814bf0cc","resolution":{"observed_at":"2026-08-07T05:55:08.306067Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:55:08.160720Z","title":"Soft actor-critic: Off- policy maximum entropy deep reinforcement learning with a stochastic actor,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.06786","last_updated":"2025-06-07T12:55:10Z","snapshot_observed_at":"2026-08-07T05:47:05.245444Z","submitted_at":"2025-06-07T12:55:10Z","title":"Learning What Matters Now: A Dual-Critic Context-Aware RL Framework for Priority-Driven Information Gain","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T05:55:08.160720Z"},"links":{"citing_paper":"/paper/2506.06786"},"observation_digest":"sha256:51157ea4b2ad594de84078dc5078ee0cc336695e53a4843ce87eca8b651de415","observation_id":"7f08c08f-3949-43d9-b9a4-7393359e6b6f","resolution":{"observed_at":"2026-08-07T05:55:08.160720Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.06786","last_updated":"2025-06-07T12:55:10Z","latest_version":1,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-07T05:47:05.245444Z","submitted_at":"2025-06-07T12:55:10Z","title":"Learning What Matters Now: A Dual-Critic Context-Aware RL Framework for Priority-Driven Information Gain"},"reference_resolution":{"displayed":24,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":11,"verified_exact":1,"verified_fuzzy":12},"total_outbound_references":24},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 24 of 24 outbound references and 0 inbound Pith citation observations for arXiv:2506.06786."}