{"as_of":"2026-08-08T09:59:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:b13a22c3e27c9f2b9afea46506aef553d9f578d8753b9c5f7ab08dd6c82a30b2","coverage":[{"denominator":11,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":11,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T12:40:50.234790Z","state":"measured"},{"denominator":11,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":11,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2506.06323/citation-record","integrity":"/paper/2506.06323/integrity","json":"/paper/2506.06323/citation-record.json","paper":"/paper/2506.06323"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:40:53.126103Z","title":"Widrow and S","venue":null,"work_id":"796cc832-f2bb-4db7-b21c-893f352f219e","year":1985},"citing_paper":{"arxiv_id":"2506.06323","last_updated":"2026-07-02T13:22:02Z","snapshot_observed_at":"2026-08-07T18:02:16.076511Z","submitted_at":"2025-05-29T23:11:48Z","title":"Composite Reward Design in PPO-Driven Adaptive Filtering","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:49.366247Z"},"links":{"citing_paper":"/paper/2506.06323"},"observation_digest":"sha256:692930b99e98de8ea81530d74a9520a70c609f0ada5aac183a7d367fd65d1f00","observation_id":"3c8aee21-0035-4f9a-8356-6061eed19e58","resolution":{"observed_at":"2026-08-07T12:40:53.254426Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:40:52.421587Z","title":"Haykin, Adaptive Filter Theory , 5th ed","venue":null,"work_id":"68e94953-c3be-46c7-aa18-b6ccade57335","year":2013},"citing_paper":{"arxiv_id":"2506.06323","last_updated":"2026-07-02T13:22:02Z","snapshot_observed_at":"2026-08-07T18:02:16.076511Z","submitted_at":"2025-05-29T23:11:48Z","title":"Composite Reward Design in PPO-Driven Adaptive Filtering","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:49.452380Z"},"links":{"citing_paper":"/paper/2506.06323"},"observation_digest":"sha256:fd1f88e80a005fa38e6b8ef659b3a349d6e8d050c3e1e06b45d9912a502dceb8","observation_id":"0c8fe8a1-8059-47f9-a4e8-989c34c684cb","resolution":{"observed_at":"2026-08-07T12:40:53.009927Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:40:51.500037Z","title":"A new approach to linear filtering and prediction problems,","venue":null,"work_id":"898f625b-4b35-4e4d-bd5d-ea4f3e659848","year":1960},"citing_paper":{"arxiv_id":"2506.06323","last_updated":"2026-07-02T13:22:02Z","snapshot_observed_at":"2026-08-07T18:02:16.076511Z","submitted_at":"2025-05-29T23:11:48Z","title":"Composite Reward Design in PPO-Driven Adaptive Filtering","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:49.514475Z"},"links":{"citing_paper":"/paper/2506.06323"},"observation_digest":"sha256:6f4890d1377ce0422525b3908e15138ccd6b15eff615c3b0fe45197e318eb673","observation_id":"6e5e1a67-48b4-4a92-b379-4d6401d8d055","resolution":{"observed_at":"2026-08-07T12:40:51.701720Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-07T12:40:49.608574Z","title":"Proximal policy optimization algorithms,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.06323","last_updated":"2026-07-02T13:22:02Z","snapshot_observed_at":"2026-08-07T18:02:16.076511Z","submitted_at":"2025-05-29T23:11:48Z","title":"Composite Reward Design in PPO-Driven Adaptive Filtering","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:49.608574Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2506.06323"},"observation_digest":"sha256:bf732e82304c5c483c701e3b9fbe592469d1a25186056b56957a6c6d359609bc","observation_id":"8a71db63-14b9-4900-ab64-bf8015c37014","resolution":{"observed_at":"2026-08-07T12:40:49.608574Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:40:51.322406Z","title":"Channel estimation via successive denoising in MIMO- OFDM systems: a reinforcement learning approach,","venue":null,"work_id":"8719b412-1297-494f-ab49-30384752cb0d","year":2021},"citing_paper":{"arxiv_id":"2506.06323","last_updated":"2026-07-02T13:22:02Z","snapshot_observed_at":"2026-08-07T18:02:16.076511Z","submitted_at":"2025-05-29T23:11:48Z","title":"Composite Reward Design in PPO-Driven Adaptive Filtering","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:49.665086Z"},"links":{"citing_paper":"/paper/2506.06323"},"observation_digest":"sha256:ff092865e33d74142f4c87ae421ddbc7318ccd41a1b098cd350b34d074235fec","observation_id":"2b08d94c-328d-4b3b-be5b-da2341566ea1","resolution":{"observed_at":"2026-08-07T12:40:51.376705Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:40:51.122797Z","title":"Adaptive filtering algorithm based on reinforcement learning,","venue":null,"work_id":"2442d7d6-fa78-4edc-8efe-122df7ca61e7","year":2024},"citing_paper":{"arxiv_id":"2506.06323","last_updated":"2026-07-02T13:22:02Z","snapshot_observed_at":"2026-08-07T18:02:16.076511Z","submitted_at":"2025-05-29T23:11:48Z","title":"Composite Reward Design in PPO-Driven Adaptive Filtering","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:49.763547Z"},"links":{"citing_paper":"/paper/2506.06323"},"observation_digest":"sha256:9e73f3c830bbafda9c7354d87d63e9ede7310ccebf0826ae8aee3cf7562e4630","observation_id":"403fe8ea-26ea-4d55-9620-35e71d7ccf8b","resolution":{"observed_at":"2026-08-07T12:40:51.206030Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:40:50.964842Z","title":"A fractional filter based on reinforcement learning for effective tracking under impulsive noise,","venue":null,"work_id":"ccaabc63-fcac-4aa7-92ef-786c6d61fdc0","year":2023},"citing_paper":{"arxiv_id":"2506.06323","last_updated":"2026-07-02T13:22:02Z","snapshot_observed_at":"2026-08-07T18:02:16.076511Z","submitted_at":"2025-05-29T23:11:48Z","title":"Composite Reward Design in PPO-Driven Adaptive Filtering","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:49.870251Z"},"links":{"citing_paper":"/paper/2506.06323"},"observation_digest":"sha256:72a1a24db2ec6b4cb450bec4336c40f15a97e4dfac46ed13835441785494fb25","observation_id":"cdced8ad-8335-4e11-8999-9ad71a5a3bf6","resolution":{"observed_at":"2026-08-07T12:40:51.028859Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:40:50.820708Z","title":"Reinforcement learning adaptive Kalman filter for AE signal’s AR-mode denoise,","venue":null,"work_id":"3712f5cb-b2af-490c-9ff2-cdab52842167","year":2023},"citing_paper":{"arxiv_id":"2506.06323","last_updated":"2026-07-02T13:22:02Z","snapshot_observed_at":"2026-08-07T18:02:16.076511Z","submitted_at":"2025-05-29T23:11:48Z","title":"Composite Reward Design in PPO-Driven Adaptive Filtering","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:49.971626Z"},"links":{"citing_paper":"/paper/2506.06323"},"observation_digest":"sha256:c015317dc86eac08f20ce47582573ecbc9b0b704da24df151c4202c3102ca52f","observation_id":"2eeaa10a-75f4-4a6a-aae9-d82215b318d8","resolution":{"observed_at":"2026-08-07T12:40:50.879560Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:40:50.658268Z","title":"Beyond static obstacles: integrating Kalman filter with reinforcement learning for drone navigation,","venue":null,"work_id":"39409e5f-d9fb-4bf2-baa7-5112d7a84816","year":2024},"citing_paper":{"arxiv_id":"2506.06323","last_updated":"2026-07-02T13:22:02Z","snapshot_observed_at":"2026-08-07T18:02:16.076511Z","submitted_at":"2025-05-29T23:11:48Z","title":"Composite Reward Design in PPO-Driven Adaptive Filtering","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:50.077465Z"},"links":{"citing_paper":"/paper/2506.06323"},"observation_digest":"sha256:cf85a052119e0c2d22060fde2ba3c0dc5d376e9b72b541d77dc821195c42b0e2","observation_id":"b0715b7e-f8ed-446f-a8b9-1af84787da06","resolution":{"observed_at":"2026-08-07T12:40:50.737417Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:40:50.526066Z","title":"GFANC-RL: reinforcement learning-based generative fixed-filter active noise control,","venue":null,"work_id":"9bdeedb4-a428-4392-a98d-cb3e9739ab9c","year":2024},"citing_paper":{"arxiv_id":"2506.06323","last_updated":"2026-07-02T13:22:02Z","snapshot_observed_at":"2026-08-07T18:02:16.076511Z","submitted_at":"2025-05-29T23:11:48Z","title":"Composite Reward Design in PPO-Driven Adaptive Filtering","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:50.165670Z"},"links":{"citing_paper":"/paper/2506.06323"},"observation_digest":"sha256:29dbb5b5845ed96ad6b010e7ac46d42268aab5a55f0d4bb3d4ba12464fc7b4bf","observation_id":"279bae49-1e4c-4a45-ba93-e1eaefdec071","resolution":{"observed_at":"2026-08-07T12:40:50.573462Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:40:50.371991Z","title":"Exploration by random network distillation,","venue":null,"work_id":"da94a02b-00d2-4d1d-a01f-a195de4a660d","year":2019},"citing_paper":{"arxiv_id":"2506.06323","last_updated":"2026-07-02T13:22:02Z","snapshot_observed_at":"2026-08-07T18:02:16.076511Z","submitted_at":"2025-05-29T23:11:48Z","title":"Composite Reward Design in PPO-Driven Adaptive Filtering","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T12:40:50.234790Z"},"links":{"citing_paper":"/paper/2506.06323"},"observation_digest":"sha256:808c59e4e4903438cf19c7f24d0dd29fc5bc226a550d4c63ec576e98c75029f2","observation_id":"81efcc73-f3a0-4682-ad7b-d1498e7fd065","resolution":{"observed_at":"2026-08-07T12:40:50.451669Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2506.06323","last_updated":"2026-07-02T13:22:02Z","latest_version":2,"primary_category":"eess.SP","snapshot_observed_at":"2026-08-07T18:02:16.076511Z","submitted_at":"2025-05-29T23:11:48Z","title":"Composite Reward Design in PPO-Driven Adaptive Filtering"},"reference_resolution":{"displayed":11,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":1,"verified_exact":0,"verified_fuzzy":10},"total_outbound_references":11},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 11 of 11 outbound references and 0 inbound Pith citation observations for arXiv:2506.06323."}