{"as_of":"2026-08-13T10:12:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:fdaffec7fd22f3d1e32846111ef4f3a927f3c1913e283ea84fc1653a1fc033e9","coverage":[{"denominator":49,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":49,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-09T00:13:05.031194Z","state":"measured"},{"denominator":50,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":50,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-13T06:32:02.005865+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-17T20:18:09.847453Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-17T20:20:11.884602Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2502.03953","last_updated":"2025-09-02T10:01:32Z","snapshot_observed_at":"2026-08-09T08:11:07.175543Z","submitted_at":"2025-02-06T10:45:55Z","title":"Fairness Aware Reinforcement Learning via Proximal Policy Optimization","version":2},"cited_work":{"arxiv_id":"2502.03953","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.03953","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Zhang, Michael Luck, and Elizabeth Black","venue":null,"work_id":"673d300c-cabd-4083-ad82-ee9bc5a17f85","year":2025},"citing_paper":{"arxiv_id":"2511.14135","last_updated":"2026-04-22T21:56:51Z","snapshot_observed_at":"2026-07-06T22:36:08.495952Z","submitted_at":"2025-11-18T04:48:50Z","title":"AdaFair-MARL: Enforcing Adaptive Fairness Constraints in Multi-Agent Reinforcement Learning","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-17T20:18:09.847453Z"},"links":{"cited_paper":"/paper/2502.03953","citing_paper":"/paper/2511.14135"},"observation_digest":"sha256:0ba4d1a92f63e044844f8a4775d7b4f6b375c1a25463d008198505048b1ecaaf","observation_id":"209a152e-7232-46c1-a36a-bb8ea635365e","resolution":{"observed_at":"2026-05-17T20:20:11.886396Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2502.03953/citation-record","integrity":"/paper/2502.03953/integrity","json":"/paper/2502.03953/citation-record.json","paper":"/paper/2502.03953"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T00:13:04.509708Z","title":", \" * write output.state after.block = add.period write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.03953","last_updated":"2025-09-02T10:01:32Z","snapshot_observed_at":"2026-08-09T08:11:07.175543Z","submitted_at":"2025-02-06T10:45:55Z","title":"Fairness Aware Reinforcement Learning via Proximal Policy Optimization","version":2},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-09T00:13:04.509708Z"},"links":{"citing_paper":"/paper/2502.03953"},"observation_digest":"sha256:e33198bb63b849df77e9010ef18ac13aab801cd7968651cf955115c65ce0a5ed","observation_id":"7597e3d7-fef0-43f3-9430-07525c09888f","resolution":{"observed_at":"2026-08-09T00:13:04.509708Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T00:13:04.536407Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.03953","last_updated":"2025-09-02T10:01:32Z","snapshot_observed_at":"2026-08-09T08:11:07.175543Z","submitted_at":"2025-02-06T10:45:55Z","title":"Fairness Aware Reinforcement Learning via Proximal Policy Optimization","version":2},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-09T00:13:04.536407Z"},"links":{"citing_paper":"/paper/2502.03953"},"observation_digest":"sha256:3e09ae744b6edcdf4b85b8a7b785c79fa87216f5d5ff48f7391562f1a131bf7c","observation_id":"1b39a62c-c7b0-48fd-a713-1c07ca7aff02","resolution":{"observed_at":"2026-08-09T00:13:04.536407Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T00:13:05.596560Z","title":null,"venue":null,"work_id":"6a4bd327-38a0-472b-8e12-0e9711b01acc","year":2023},"citing_paper":{"arxiv_id":"2502.03953","last_updated":"2025-09-02T10:01:32Z","snapshot_observed_at":"2026-08-09T08:11:07.175543Z","submitted_at":"2025-02-06T10:45:55Z","title":"Fairness Aware Reinforcement Learning via Proximal Policy Optimization","version":2},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-09T00:13:04.581538Z"},"links":{"citing_paper":"/paper/2502.03953"},"observation_digest":"sha256:8901bde7ecafec4db3f9fdbdd2fa26ffa0582c4aa7d0dfd18399691e5a9e2052","observation_id":"508edbb0-ab7f-4e53-ae51-068116ce3f63","resolution":{"observed_at":"2026-08-09T00:13:05.599971Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T00:13:05.586930Z","title":null,"venue":null,"work_id":"4c16e704-35f4-4484-b40b-869af8c027dd","year":2021},"citing_paper":{"arxiv_id":"2502.03953","last_updated":"2025-09-02T10:01:32Z","snapshot_observed_at":"2026-08-09T08:11:07.175543Z","submitted_at":"2025-02-06T10:45:55Z","title":"Fairness Aware Reinforcement Learning via Proximal Policy Optimization","version":2},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-09T00:13:04.608274Z"},"links":{"citing_paper":"/paper/2502.03953"},"observation_digest":"sha256:fe2bc97f6f5ac66d615fd7b7671bfb52467c260869f896fbab8fe771ab51dbfd","observation_id":"8f65295e-7d16-41b9-bdf0-d7a0d1fbd831","resolution":{"observed_at":"2026-08-09T00:13:05.590380Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T00:13:05.576924Z","title":null,"venue":null,"work_id":"a2d23848-55f3-42e3-9f62-4f042ba27b0f","year":2023},"citing_paper":{"arxiv_id":"2502.03953","last_updated":"2025-09-02T10:01:32Z","snapshot_observed_at":"2026-08-09T08:11:07.175543Z","submitted_at":"2025-02-06T10:45:55Z","title":"Fairness Aware Reinforcement Learning via Proximal Policy Optimization","version":2},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-09T00:13:04.635898Z"},"links":{"citing_paper":"/paper/2502.03953"},"observation_digest":"sha256:cc91c9d35148e597d6af62cf367e018e5035aeb572223acf493e3fd7eeea07c0","observation_id":"f3420c49-b8c2-4d55-b441-59691b39884f","resolution":{"observed_at":"2026-08-09T00:13:05.580453Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T00:13:05.566598Z","title":null,"venue":null,"work_id":"9f1ed194-8774-45a3-9f25-dbfe3b47c943","year":2019},"citing_paper":{"arxiv_id":"2502.03953","last_updated":"2025-09-02T10:01:32Z","snapshot_observed_at":"2026-08-09T08:11:07.175543Z","submitted_at":"2025-02-06T10:45:55Z","title":"Fairness Aware Reinforcement Learning via Proximal Policy Optimization","version":2},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-09T00:13:04.639856Z"},"links":{"citing_paper":"/paper/2502.03953"},"observation_digest":"sha256:a0113ed41de486471e4fab3e1db8b774976ddc1c78b77772275b3d13a8130c6e","observation_id":"47cd44f1-fd6a-48ef-9964-5c73a1448f9f","resolution":{"observed_at":"2026-08-09T00:13:05.570238Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1607.01569","last_updated":"2017-05-12T19:31:43Z","snapshot_observed_at":"2026-08-12T03:32:08.149349Z","submitted_at":"2016-07-06T11:28:17Z","title":"Nash Social Welfare Approximation for Strategic Agents","version":3},"cited_work":{"arxiv_id":"1607.01569","doi":null,"metadata_source":"pith","pith_arxiv_id":"1607.01569","snapshot_observed_at":"2026-08-09T00:13:05.182346Z","title":"Nash Social Welfare Approximation for Strategic Agents","venue":"cs.GT","work_id":"e72ef02b-4cb2-4cdd-abc2-960b074d97d7","year":2016},"citing_paper":{"arxiv_id":"2502.03953","last_updated":"2025-09-02T10:01:32Z","snapshot_observed_at":"2026-08-09T08:11:07.175543Z","submitted_at":"2025-02-06T10:45:55Z","title":"Fairness Aware Reinforcement Learning via Proximal Policy Optimization","version":2},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-09T00:13:04.643745Z"},"links":{"cited_paper":"/paper/1607.01569","citing_paper":"/paper/2502.03953"},"observation_digest":"sha256:ee699424ef788f73dd6882c91b6fbcd9ee69645779194970e6063dd31824540d","observation_id":"183f86e7-f135-4a1b-9280-cc8a8ba06751","resolution":{"observed_at":"2026-08-09T00:13:05.185852Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T00:13:05.556301Z","title":null,"venue":null,"work_id":"f4d72479-ac5b-4eda-9d94-b961342947cc","year":2011},"citing_paper":{"arxiv_id":"2502.03953","last_updated":"2025-09-02T10:01:32Z","snapshot_observed_at":"2026-08-09T08:11:07.175543Z","submitted_at":"2025-02-06T10:45:55Z","title":"Fairness Aware Reinforcement Learning via Proximal Policy Optimization","version":2},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-09T00:13:04.647952Z"},"links":{"citing_paper":"/paper/2502.03953"},"observation_digest":"sha256:a447de3b9e549173b17d5a5d0cc3d875c2989b0de843f8f7dd58a4d3bedf3817","observation_id":"0a4dca87-eb4a-4c47-a646-21d6d88bf00b","resolution":{"observed_at":"2026-08-09T00:13:05.560018Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T00:13:05.545930Z","title":null,"venue":null,"work_id":"e2e32f0e-43d3-4df0-bb69-7fb5481363fc","year":2019},"citing_paper":{"arxiv_id":"2502.03953","last_updated":"2025-09-02T10:01:32Z","snapshot_observed_at":"2026-08-09T08:11:07.175543Z","submitted_at":"2025-02-06T10:45:55Z","title":"Fairness Aware Reinforcement Learning via Proximal Policy Optimization","version":2},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-09T00:13:04.651475Z"},"links":{"citing_paper":"/paper/2502.03953"},"observation_digest":"sha256:d939829ece2f65e9f19b9b0433f08173029a24126a85f13c7663c7a4ee350c1b","observation_id":"d4cb1313-22e5-4e6a-a3bc-723998701963","resolution":{"observed_at":"2026-08-09T00:13:05.549627Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T00:13:05.535525Z","title":null,"venue":null,"work_id":"d2ebcd56-c941-47ef-aa23-713b4b5b4ea4","year":2022},"citing_paper":{"arxiv_id":"2502.03953","last_updated":"2025-09-02T10:01:32Z","snapshot_observed_at":"2026-08-09T08:11:07.175543Z","submitted_at":"2025-02-06T10:45:55Z","title":"Fairness Aware Reinforcement Learning via Proximal Policy Optimization","version":2},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-09T00:13:04.655207Z"},"links":{"citing_paper":"/paper/2502.03953"},"observation_digest":"sha256:ad0c3802f720ee67f25881294b7b54864eadc30f4f52af3f0f0d6287b57d17e5","observation_id":"886acf7d-8c19-493f-b847-5e762a01c86d","resolution":{"observed_at":"2026-08-09T00:13:05.538864Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T00:13:05.525663Z","title":null,"venue":null,"work_id":"04a4411a-b154-414d-9130-e86e541635ff","year":2021},"citing_paper":{"arxiv_id":"2502.03953","last_updated":"2025-09-02T10:01:32Z","snapshot_observed_at":"2026-08-09T08:11:07.175543Z","submitted_at":"2025-02-06T10:45:55Z","title":"Fairness Aware Reinforcement Learning via Proximal Policy Optimization","version":2},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-09T00:13:04.658730Z"},"links":{"citing_paper":"/paper/2502.03953"},"observation_digest":"sha256:33b0b723cb2963e80fbb9b6e2e4c125868764c39a53bd64fbd6a42156e4ae76d","observation_id":"8e220efc-ca9d-4f2f-b160-5cd639fc6342","resolution":{"observed_at":"2026-08-09T00:13:05.529142Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T00:13:05.514553Z","title":null,"venue":null,"work_id":"9f251699-d015-42d6-b651-bb933ea2c544","year":2022},"citing_paper":{"arxiv_id":"2502.03953","last_updated":"2025-09-02T10:01:32Z","snapshot_observed_at":"2026-08-09T08:11:07.175543Z","submitted_at":"2025-02-06T10:45:55Z","title":"Fairness Aware Reinforcement Learning via Proximal Policy Optimization","version":2},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-09T00:13:04.662813Z"},"links":{"citing_paper":"/paper/2502.03953"},"observation_digest":"sha256:c8c32fa740dbbf4b2b217a155206e8df4621851e2e41ce9fdeddd4285554e8a3","observation_id":"3ee215b1-f047-491b-96d4-ef0dc7600734","resolution":{"observed_at":"2026-08-09T00:13:05.518759Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1610.07524","last_updated":"2016-10-24T18:23:38Z","snapshot_observed_at":"2026-08-09T08:10:28.834857Z","submitted_at":"2016-10-24T18:23:38Z","title":"Fair prediction with disparate impact: A study of bias in recidivism prediction instruments","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1610.07524","snapshot_observed_at":"2026-08-09T00:13:04.666275Z","title":null,"venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2502.03953","last_updated":"2025-09-02T10:01:32Z","snapshot_observed_at":"2026-08-09T08:11:07.175543Z","submitted_at":"2025-02-06T10:45:55Z","title":"Fairness Aware Reinforcement Learning via Proximal Policy Optimization","version":2},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-09T00:13:04.666275Z"},"links":{"cited_paper":"/paper/1610.07524","citing_paper":"/paper/2502.03953"},"observation_digest":"sha256:7c44f166ce3e3b99e4134901e842ef9c8bdbe7c81cf7b7f0104bade74c27374c","observation_id":"29b71bbe-443a-4523-a24f-dbd01b2acc40","resolution":{"observed_at":"2026-08-09T00:13:04.666275Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T00:13:05.505573Z","title":null,"venue":null,"work_id":"083a5001-0100-4791-b464-ac562dcdf651","year":2016},"citing_paper":{"arxiv_id":"2502.03953","last_updated":"2025-09-02T10:01:32Z","snapshot_observed_at":"2026-08-09T08:11:07.175543Z","submitted_at":"2025-02-06T10:45:55Z","title":"Fairness Aware Reinforcement Learning via Proximal Policy Optimization","version":2},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-09T00:13:04.669849Z"},"links":{"citing_paper":"/paper/2502.03953"},"observation_digest":"sha256:399b57bfb5c88a8034a3d927899d05d993c8fb7bccf25840008280e5e051733a","observation_id":"8c3b6044-3f91-4539-9314-0999155f23ed","resolution":{"observed_at":"2026-08-09T00:13:05.508381Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T00:13:05.495939Z","title":null,"venue":null,"work_id":"fb7eae57-787c-4120-9c80-6eb420a44d7d","year":2010},"citing_paper":{"arxiv_id":"2502.03953","last_updated":"2025-09-02T10:01:32Z","snapshot_observed_at":"2026-08-09T08:11:07.175543Z","submitted_at":"2025-02-06T10:45:55Z","title":"Fairness Aware Reinforcement Learning via Proximal Policy Optimization","version":2},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-09T00:13:04.673386Z"},"links":{"citing_paper":"/paper/2502.03953"},"observation_digest":"sha256:790c2b680460b01d41086556c828b553452d3aa6e80ca6b2ceb50f3a09c612c2","observation_id":"7910e40e-45fb-42b9-9e46-5f1d495fbf73","resolution":{"observed_at":"2026-08-09T00:13:05.499152Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T00:13:05.486870Z","title":null,"venue":null,"work_id":"f69d4315-5ffb-48b2-9a08-56a5550caa63","year":2022},"citing_paper":{"arxiv_id":"2502.03953","last_updated":"2025-09-02T10:01:32Z","snapshot_observed_at":"2026-08-09T08:11:07.175543Z","submitted_at":"2025-02-06T10:45:55Z","title":"Fairness Aware Reinforcement Learning via Proximal Policy Optimization","version":2},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-09T00:13:04.676463Z"},"links":{"citing_paper":"/paper/2502.03953"},"observation_digest":"sha256:c966ba2f9e21d20c7309dc376e52d76c8a34703ede0a2cc4148550026366e0df","observation_id":"ea2f92e5-86d8-4594-aac7-1f8fb91cde44","resolution":{"observed_at":"2026-08-09T00:13:05.489757Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T00:13:05.476804Z","title":"W.; and Livingston Jr., J","venue":null,"work_id":"5061039f-0d27-4fb3-ab73-f9576c035ceb","year":1973},"citing_paper":{"arxiv_id":"2502.03953","last_updated":"2025-09-02T10:01:32Z","snapshot_observed_at":"2026-08-09T08:11:07.175543Z","submitted_at":"2025-02-06T10:45:55Z","title":"Fairness Aware Reinforcement Learning via Proximal Policy Optimization","version":2},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-09T00:13:04.679667Z"},"links":{"citing_paper":"/paper/2502.03953"},"observation_digest":"sha256:7ff0f6e96ff7a128a6bb3946285da9fb361940c32cfa2ed35b99ea9f588c1624","observation_id":"3708b520-e229-46f9-8c9d-a537023f0080","resolution":{"observed_at":"2026-08-09T00:13:05.480620Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T00:13:05.446098Z","title":null,"venue":null,"work_id":"4b8232b0-67c1-4e63-bc58-13b07a570dd1","year":2014},"citing_paper":{"arxiv_id":"2502.03953","last_updated":"2025-09-02T10:01:32Z","snapshot_observed_at":"2026-08-09T08:11:07.175543Z","submitted_at":"2025-02-06T10:45:55Z","title":"Fairness Aware Reinforcement Learning via Proximal Policy Optimization","version":2},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-09T00:13:04.682829Z"},"links":{"citing_paper":"/paper/2502.03953"},"observation_digest":"sha256:0cc6525be1b327e7e5ae1f0e981180693f8db6e1c55cf2027c5bc58eb648019c","observation_id":"a0b31bf6-c804-4ff7-aaf2-ad8cb10df59b","resolution":{"observed_at":"2026-08-09T00:13:05.450228Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T00:13:05.432754Z","title":null,"venue":null,"work_id":"4f1c2f8a-97eb-4c19-b161-16ba875a5e87","year":2016},"citing_paper":{"arxiv_id":"2502.03953","last_updated":"2025-09-02T10:01:32Z","snapshot_observed_at":"2026-08-09T08:11:07.175543Z","submitted_at":"2025-02-06T10:45:55Z","title":"Fairness Aware Reinforcement Learning via Proximal Policy Optimization","version":2},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-09T00:13:04.686098Z"},"links":{"citing_paper":"/paper/2502.03953"},"observation_digest":"sha256:f0bc664ef7bb113e3653af3552f148be30512c652275ba556590c698b155c6d8","observation_id":"08f9265f-c87a-436e-9cb2-3fd59b8bc785","resolution":{"observed_at":"2026-08-09T00:13:05.436317Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.03071","last_updated":"2023-02-06T19:18:37Z","snapshot_observed_at":"2026-08-12T18:39:56.020516Z","submitted_at":"2023-02-06T19:18:37Z","title":"Optimally Interpolating between Ex-Ante Fairness and Welfare","version":1},"cited_work":{"arxiv_id":"2302.03071","doi":null,"metadata_source":"pith","pith_arxiv_id":"2302.03071","snapshot_observed_at":"2026-08-09T00:13:05.158620Z","title":"Optimally Interpolating between Ex-Ante Fairness and Welfare","venue":"cs.GT","work_id":"2108f92a-2a06-4d05-a6f3-bb136947484f","year":2023},"citing_paper":{"arxiv_id":"2502.03953","last_updated":"2025-09-02T10:01:32Z","snapshot_observed_at":"2026-08-09T08:11:07.175543Z","submitted_at":"2025-02-06T10:45:55Z","title":"Fairness Aware Reinforcement Learning via Proximal Policy Optimization","version":2},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-09T00:13:04.689565Z"},"links":{"cited_paper":"/paper/2302.03071","citing_paper":"/paper/2502.03953"},"observation_digest":"sha256:397ce7c360ccaa4fa7824ca8691be5c6f0b602014e11ede8f259e8f5ceb85e81","observation_id":"2a98032c-1840-4697-830d-9528dd773592","resolution":{"observed_at":"2026-08-09T00:13:05.162244Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T00:13:05.422444Z","title":null,"venue":null,"work_id":"f091fd7f-beaf-4f5d-974a-e6a809fe05d0","year":2017},"citing_paper":{"arxiv_id":"2502.03953","last_updated":"2025-09-02T10:01:32Z","snapshot_observed_at":"2026-08-09T08:11:07.175543Z","submitted_at":"2025-02-06T10:45:55Z","title":"Fairness Aware Reinforcement Learning via Proximal Policy Optimization","version":2},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-09T00:13:04.693308Z"},"links":{"citing_paper":"/paper/2502.03953"},"observation_digest":"sha256:2a86de5e8c8989ecd96cb915e196aba7e2e88cd12be8b0281a60670ee2a340c5","observation_id":"fbef346e-264f-47bd-80bc-3c1606a7652c","resolution":{"observed_at":"2026-08-09T00:13:05.426007Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T00:13:05.411777Z","title":null,"venue":null,"work_id":"c5bc80bf-7456-4044-95ca-ab6b0e9783dc","year":2019},"citing_paper":{"arxiv_id":"2502.03953","last_updated":"2025-09-02T10:01:32Z","snapshot_observed_at":"2026-08-09T08:11:07.175543Z","submitted_at":"2025-02-06T10:45:55Z","title":"Fairness Aware Reinforcement Learning via Proximal Policy Optimization","version":2},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-09T00:13:04.696442Z"},"links":{"citing_paper":"/paper/2502.03953"},"observation_digest":"sha256:151671c2363a78266b52c10254e21e1b30b6a7fde4c25406c775a88222d801c2","observation_id":"262d7826-d633-4f65-bf7a-a46161dea322","resolution":{"observed_at":"2026-08-09T00:13:05.415287Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T00:13:05.390153Z","title":null,"venue":null,"work_id":"c441591a-663e-4090-8f8f-d7446f21de3b","year":2023},"citing_paper":{"arxiv_id":"2502.03953","last_updated":"2025-09-02T10:01:32Z","snapshot_observed_at":"2026-08-09T08:11:07.175543Z","submitted_at":"2025-02-06T10:45:55Z","title":"Fairness Aware Reinforcement Learning via Proximal Policy Optimization","version":2},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-09T00:13:04.699796Z"},"links":{"citing_paper":"/paper/2502.03953"},"observation_digest":"sha256:edd0f4e155124f8ab3e73c5bf14599bab6cd39b237733685028c18d339908f22","observation_id":"591858d6-ec90-428a-8346-1dd1757de137","resolution":{"observed_at":"2026-08-09T00:13:05.405046Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T00:13:05.379809Z","title":"H.; and Roth, A","venue":null,"work_id":"0e0600ad-7cb3-48b6-9a77-2f025e1d8afc","year":2016},"citing_paper":{"arxiv_id":"2502.03953","last_updated":"2025-09-02T10:01:32Z","snapshot_observed_at":"2026-08-09T08:11:07.175543Z","submitted_at":"2025-02-06T10:45:55Z","title":"Fairness Aware Reinforcement Learning via Proximal Policy Optimization","version":2},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-09T00:13:04.703550Z"},"links":{"citing_paper":"/paper/2502.03953"},"observation_digest":"sha256:254e7b6d5f153d1f4ec0911ca1714670e3e30445150d1c3100a7264319798784","observation_id":"803d01c5-db61-41e9-a73d-d4b657411c0e","resolution":{"observed_at":"2026-08-09T00:13:05.383677Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T00:13:05.366819Z","title":null,"venue":null,"work_id":"598552f6-047e-4c7d-8fb4-fd81818a62b9","year":2024},"citing_paper":{"arxiv_id":"2502.03953","last_updated":"2025-09-02T10:01:32Z","snapshot_observed_at":"2026-08-09T08:11:07.175543Z","submitted_at":"2025-02-06T10:45:55Z","title":"Fairness Aware Reinforcement Learning via Proximal Policy Optimization","version":2},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-09T00:13:04.706524Z"},"links":{"citing_paper":"/paper/2502.03953"},"observation_digest":"sha256:a21d0877538c0eca62324210dace9fae4907d84040961a2e22cc44c0d6a4c796","observation_id":"bb018550-560e-409e-ad43-8b5d5e30235f","resolution":{"observed_at":"2026-08-09T00:13:05.370401Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T00:13:05.356626Z","title":null,"venue":null,"work_id":"18fe5e8d-f832-4cf9-b583-9e03fdd8c2b2","year":2012},"citing_paper":{"arxiv_id":"2502.03953","last_updated":"2025-09-02T10:01:32Z","snapshot_observed_at":"2026-08-09T08:11:07.175543Z","submitted_at":"2025-02-06T10:45:55Z","title":"Fairness Aware Reinforcement Learning via Proximal Policy Optimization","version":2},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-09T00:13:04.709845Z"},"links":{"citing_paper":"/paper/2502.03953"},"observation_digest":"sha256:7baafbcebaa3d9dcefc6e3edd6f253f5ea69337b8ebd41bf85ac3a4a535e8054","observation_id":"68144b3e-1dfc-45f7-b3fc-a35c78a6810e","resolution":{"observed_at":"2026-08-09T00:13:05.360303Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T00:13:05.341122Z","title":null,"venue":null,"work_id":"6c715207-62be-4c3c-987b-45b775d71ff7","year":2003},"citing_paper":{"arxiv_id":"2502.03953","last_updated":"2025-09-02T10:01:32Z","snapshot_observed_at":"2026-08-09T08:11:07.175543Z","submitted_at":"2025-02-06T10:45:55Z","title":"Fairness Aware Reinforcement Learning via Proximal Policy Optimization","version":2},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-09T00:13:04.713327Z"},"links":{"citing_paper":"/paper/2502.03953"},"observation_digest":"sha256:e318f6d1e39a6ada71a5e7540bb4105bd0b3dc60b9fd1c534295cb332b65d7da","observation_id":"d57b8993-ea49-4889-b597-7354d1567394","resolution":{"observed_at":"2026-08-09T00:13:05.344719Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T00:13:05.331148Z","title":null,"venue":null,"work_id":"82565330-781d-4d0e-97ca-ff8175c499cb","year":2022},"citing_paper":{"arxiv_id":"2502.03953","last_updated":"2025-09-02T10:01:32Z","snapshot_observed_at":"2026-08-09T08:11:07.175543Z","submitted_at":"2025-02-06T10:45:55Z","title":"Fairness Aware Reinforcement Learning via Proximal Policy Optimization","version":2},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-09T00:13:04.717740Z"},"links":{"citing_paper":"/paper/2502.03953"},"observation_digest":"sha256:720aec637f7d35e85f1fa79c68e7a6415385e2e3987b8d193c90b23bd0f6f9c4","observation_id":"438f5e04-d6ed-40cc-8f2a-4f078ce75852","resolution":{"observed_at":"2026-08-09T00:13:05.334722Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1703.06856","last_updated":"2018-03-08T11:23:13Z","snapshot_observed_at":"2026-08-02T06:05:50.560605Z","submitted_at":"2017-03-20T17:18:57Z","title":"Counterfactual Fairness","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1703.06856","snapshot_observed_at":"2026-08-09T00:13:04.721799Z","title":"J.; Loftus, J","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2502.03953","last_updated":"2025-09-02T10:01:32Z","snapshot_observed_at":"2026-08-09T08:11:07.175543Z","submitted_at":"2025-02-06T10:45:55Z","title":"Fairness Aware Reinforcement Learning via Proximal Policy Optimization","version":2},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-09T00:13:04.721799Z"},"links":{"cited_paper":"/paper/1703.06856","citing_paper":"/paper/2502.03953"},"observation_digest":"sha256:44aebf983911c619996212540d494b0892957c3f0836ff6ccaddb07728db43ca","observation_id":"1def4555-5cbd-474e-96c0-49466a99b47d","resolution":{"observed_at":"2026-08-09T00:13:04.721799Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T00:13:05.322313Z","title":"Z.; Perolat, J.; Hughes, E.; and et al","venue":null,"work_id":"417761d4-203d-4943-89d8-bf06d5dccaf4","year":2019},"citing_paper":{"arxiv_id":"2502.03953","last_updated":"2025-09-02T10:01:32Z","snapshot_observed_at":"2026-08-09T08:11:07.175543Z","submitted_at":"2025-02-06T10:45:55Z","title":"Fairness Aware Reinforcement Learning via Proximal Policy Optimization","version":2},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-09T00:13:04.754547Z"},"links":{"citing_paper":"/paper/2502.03953"},"observation_digest":"sha256:a39e06e87fbfd5620c3d5a91f0f8c970d9fad8842d37adb3326ab582333cb262","observation_id":"0aaf7d0c-f1ed-42cb-86af-901a3920b12d","resolution":{"observed_at":"2026-08-09T00:13:05.325295Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T00:13:05.313318Z","title":null,"venue":null,"work_id":"4e08a82c-c41e-40a0-b24a-929d50120c63","year":2020},"citing_paper":{"arxiv_id":"2502.03953","last_updated":"2025-09-02T10:01:32Z","snapshot_observed_at":"2026-08-09T08:11:07.175543Z","submitted_at":"2025-02-06T10:45:55Z","title":"Fairness Aware Reinforcement Learning via Proximal Policy Optimization","version":2},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-09T00:13:04.834950Z"},"links":{"citing_paper":"/paper/2502.03953"},"observation_digest":"sha256:c85f5221df7fcb8b383607c2a250140b8e658d07f2d1675d8cf1666207f667b7","observation_id":"f8336578-1446-40da-a104-aee51eee71a9","resolution":{"observed_at":"2026-08-09T00:13:05.316266Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T00:13:05.304139Z","title":null,"venue":null,"work_id":"ee18e9b5-591d-4e88-a745-70e96e5c2d86","year":1984},"citing_paper":{"arxiv_id":"2502.03953","last_updated":"2025-09-02T10:01:32Z","snapshot_observed_at":"2026-08-09T08:11:07.175543Z","submitted_at":"2025-02-06T10:45:55Z","title":"Fairness Aware Reinforcement Learning via Proximal Policy Optimization","version":2},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-09T00:13:04.902048Z"},"links":{"citing_paper":"/paper/2502.03953"},"observation_digest":"sha256:6afcdcf709db917366e059191b6ab3e8126216b4faa8bf4c451e628603d67966","observation_id":"2dd158f2-9a01-4611-9001-00ff0a89fddf","resolution":{"observed_at":"2026-08-09T00:13:05.307187Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T00:13:05.293350Z","title":null,"venue":null,"work_id":"f6f7af54-5544-471b-b05c-80c5b025a9ea","year":2016},"citing_paper":{"arxiv_id":"2502.03953","last_updated":"2025-09-02T10:01:32Z","snapshot_observed_at":"2026-08-09T08:11:07.175543Z","submitted_at":"2025-02-06T10:45:55Z","title":"Fairness Aware Reinforcement Learning via Proximal Policy Optimization","version":2},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-09T00:13:04.973164Z"},"links":{"citing_paper":"/paper/2502.03953"},"observation_digest":"sha256:a839478a03aaf0aeabdcb643ee71799c9fd3f27ed95e4ede80f23d189a01eec4","observation_id":"7a6d240c-09e2-4fe7-8a7e-077884603a48","resolution":{"observed_at":"2026-08-09T00:13:05.297526Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T00:13:05.282988Z","title":"J.; Markakis, E.; Mossel, E.; and Saberi, A","venue":null,"work_id":"a79579aa-6f61-47e6-8642-c7510e445f84","year":2004},"citing_paper":{"arxiv_id":"2502.03953","last_updated":"2025-09-02T10:01:32Z","snapshot_observed_at":"2026-08-09T08:11:07.175543Z","submitted_at":"2025-02-06T10:45:55Z","title":"Fairness Aware Reinforcement Learning via Proximal Policy Optimization","version":2},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-09T00:13:04.976308Z"},"links":{"citing_paper":"/paper/2502.03953"},"observation_digest":"sha256:3aa0822fd47f8badd6212289d3f1e74d6cd1e804968bb1a305306a09b3b2931e","observation_id":"bc8959ff-6d59-41f5-a1f8-aafb0082366d","resolution":{"observed_at":"2026-08-09T00:13:05.286556Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1707.01875","last_updated":"2017-07-06T17:24:01Z","snapshot_observed_at":"2026-07-06T05:50:03.544515Z","submitted_at":"2017-07-06T17:24:01Z","title":"Calibrated Fairness in Bandits","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.01875","snapshot_observed_at":"2026-08-09T00:13:04.979176Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2502.03953","last_updated":"2025-09-02T10:01:32Z","snapshot_observed_at":"2026-08-09T08:11:07.175543Z","submitted_at":"2025-02-06T10:45:55Z","title":"Fairness Aware Reinforcement Learning via Proximal Policy Optimization","version":2},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-09T00:13:04.979176Z"},"links":{"cited_paper":"/paper/1707.01875","citing_paper":"/paper/2502.03953"},"observation_digest":"sha256:967964a6f51cd0cdad5891a2e4db856669050f56ec6ef1b3043917dcd981b4e4","observation_id":"54abf6cd-5086-490d-bde9-e34d55c28fbf","resolution":{"observed_at":"2026-08-09T00:13:04.979176Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T00:13:05.273189Z","title":null,"venue":null,"work_id":"2362d8ed-a259-4f9d-b2ca-b9999fc72284","year":2021},"citing_paper":{"arxiv_id":"2502.03953","last_updated":"2025-09-02T10:01:32Z","snapshot_observed_at":"2026-08-09T08:11:07.175543Z","submitted_at":"2025-02-06T10:45:55Z","title":"Fairness Aware Reinforcement Learning via Proximal Policy Optimization","version":2},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-09T00:13:04.982595Z"},"links":{"citing_paper":"/paper/2502.03953"},"observation_digest":"sha256:262c2805f84a90be08f3a4380c5b39565345f3d9abdd89bccf64786313a22dbb","observation_id":"d33d5e36-f48f-46df-9401-7dd9e2063cba","resolution":{"observed_at":"2026-08-09T00:13:05.276562Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T00:13:05.262469Z","title":null,"venue":null,"work_id":"7048ba9e-d261-41d8-87d5-46b21176d011","year":2024},"citing_paper":{"arxiv_id":"2502.03953","last_updated":"2025-09-02T10:01:32Z","snapshot_observed_at":"2026-08-09T08:11:07.175543Z","submitted_at":"2025-02-06T10:45:55Z","title":"Fairness Aware Reinforcement Learning via Proximal Policy Optimization","version":2},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-09T00:13:04.985684Z"},"links":{"citing_paper":"/paper/2502.03953"},"observation_digest":"sha256:fb1f82c2c2508af7dcd2b7d7eac31a864f7bcd2d761a964d53ae9fdb13e28ab4","observation_id":"881ae253-2501-4fe6-8164-55382b2ef5b8","resolution":{"observed_at":"2026-08-09T00:13:05.266239Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T00:13:05.251784Z","title":null,"venue":null,"work_id":"ec8f92ed-951b-4882-a9cc-e23351a6d6a4","year":2021},"citing_paper":{"arxiv_id":"2502.03953","last_updated":"2025-09-02T10:01:32Z","snapshot_observed_at":"2026-08-09T08:11:07.175543Z","submitted_at":"2025-02-06T10:45:55Z","title":"Fairness Aware Reinforcement Learning via Proximal Policy Optimization","version":2},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-09T00:13:04.988874Z"},"links":{"citing_paper":"/paper/2502.03953"},"observation_digest":"sha256:74e739a955c72362a0cb8c26970a4c8b54a149a722d5bff68033bacbd2aee656","observation_id":"05a5baf9-692a-4457-bbaa-00d30fbd9296","resolution":{"observed_at":"2026-08-09T00:13:05.255522Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.06909","last_updated":"2024-05-11T04:36:46Z","snapshot_observed_at":"2026-08-13T00:09:51.452703Z","submitted_at":"2024-05-11T04:36:46Z","title":"Fairness in Reinforcement Learning: A Survey","version":1},"cited_work":{"arxiv_id":"2405.06909","doi":null,"metadata_source":"pith","pith_arxiv_id":"2405.06909","snapshot_observed_at":"2026-08-09T00:13:05.123856Z","title":"Fairness in Reinforcement Learning: A Survey","venue":"cs.LG","work_id":"7234a030-b94b-4033-a838-bd35cc85e007","year":2024},"citing_paper":{"arxiv_id":"2502.03953","last_updated":"2025-09-02T10:01:32Z","snapshot_observed_at":"2026-08-09T08:11:07.175543Z","submitted_at":"2025-02-06T10:45:55Z","title":"Fairness Aware Reinforcement Learning via Proximal Policy Optimization","version":2},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-09T00:13:04.991911Z"},"links":{"cited_paper":"/paper/2405.06909","citing_paper":"/paper/2502.03953"},"observation_digest":"sha256:3f18322f665b3126ab9a834dd82e6e2ff360d6059a6df3088bf5e48212dddd2c","observation_id":"a029b85f-4714-439d-8549-04b2987ada85","resolution":{"observed_at":"2026-08-09T00:13:05.127956Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1502.05477","last_updated":"2017-04-20T18:04:12Z","snapshot_observed_at":"2026-07-06T04:09:39.172428Z","submitted_at":"2015-02-19T06:44:25Z","title":"Trust Region Policy Optimization","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1502.05477","snapshot_observed_at":"2026-08-09T00:13:04.996057Z","title":"I.; and Abbeel, P","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2502.03953","last_updated":"2025-09-02T10:01:32Z","snapshot_observed_at":"2026-08-09T08:11:07.175543Z","submitted_at":"2025-02-06T10:45:55Z","title":"Fairness Aware Reinforcement Learning via Proximal Policy Optimization","version":2},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-09T00:13:04.996057Z"},"links":{"cited_paper":"/paper/1502.05477","citing_paper":"/paper/2502.03953"},"observation_digest":"sha256:dba4c99a1fff14294d4605e72893622067010c725eb7e36702a95756f34c73fb","observation_id":"28546539-8cbe-4447-9a99-38343387c414","resolution":{"observed_at":"2026-08-09T00:13:04.996057Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-09T00:13:04.999624Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2502.03953","last_updated":"2025-09-02T10:01:32Z","snapshot_observed_at":"2026-08-09T08:11:07.175543Z","submitted_at":"2025-02-06T10:45:55Z","title":"Fairness Aware Reinforcement Learning via Proximal Policy Optimization","version":2},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-09T00:13:04.999624Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2502.03953"},"observation_digest":"sha256:8668ac945a31e7fd864217ad4723ea21bc44ada15a28cfc184c6e0e5427cfc38","observation_id":"a302619e-4928-4495-89c4-724093671588","resolution":{"observed_at":"2026-08-09T00:13:04.999624Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T00:13:05.239217Z","title":null,"venue":null,"work_id":"d8387a2e-d31a-4b44-88d8-f79e0690fb9a","year":2020},"citing_paper":{"arxiv_id":"2502.03953","last_updated":"2025-09-02T10:01:32Z","snapshot_observed_at":"2026-08-09T08:11:07.175543Z","submitted_at":"2025-02-06T10:45:55Z","title":"Fairness Aware Reinforcement Learning via Proximal Policy Optimization","version":2},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-09T00:13:05.003100Z"},"links":{"citing_paper":"/paper/2502.03953"},"observation_digest":"sha256:c686b68b7b73c225dd6e27dff4d7e7faf3fff9b8486e9fde84b1c662eef8cb9e","observation_id":"b69f0019-07cf-488a-b7d0-5dc1cbf7a1f4","resolution":{"observed_at":"2026-08-09T00:13:05.244237Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T00:13:05.227919Z","title":"S.; and Barto, A","venue":null,"work_id":"a08a8480-9649-4910-898e-2ac34371e707","year":2018},"citing_paper":{"arxiv_id":"2502.03953","last_updated":"2025-09-02T10:01:32Z","snapshot_observed_at":"2026-08-09T08:11:07.175543Z","submitted_at":"2025-02-06T10:45:55Z","title":"Fairness Aware Reinforcement Learning via Proximal Policy Optimization","version":2},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-09T00:13:05.006349Z"},"links":{"citing_paper":"/paper/2502.03953"},"observation_digest":"sha256:ba45015e9da3515a2d0354900708b04469ac90b55db878f6f85bedc0d3fa77f0","observation_id":"94a05665-28dd-4d56-aa2d-0704a66731da","resolution":{"observed_at":"2026-08-09T00:13:05.231786Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T00:13:05.214846Z","title":"A.; Eisenstein, L","venue":null,"work_id":"e05f0f47-2a8f-4c33-86ac-2fd40b6ed40c","year":2020},"citing_paper":{"arxiv_id":"2502.03953","last_updated":"2025-09-02T10:01:32Z","snapshot_observed_at":"2026-08-09T08:11:07.175543Z","submitted_at":"2025-02-06T10:45:55Z","title":"Fairness Aware Reinforcement Learning via Proximal Policy Optimization","version":2},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-09T00:13:05.010270Z"},"links":{"citing_paper":"/paper/2502.03953"},"observation_digest":"sha256:a0ac31d214e193cd8300809d180488133d6fa3b9aec47ebc28f8253c63ec4055","observation_id":"ca76107d-9aa8-441a-bd6e-577d8dccf96a","resolution":{"observed_at":"2026-08-09T00:13:05.219510Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1901.08568","last_updated":"2021-10-11T14:31:53Z","snapshot_observed_at":"2026-07-06T07:28:51.782366Z","submitted_at":"2019-01-24T18:40:05Z","title":"Algorithms for Fairness in Sequential Decision Making","version":2},"cited_work":{"arxiv_id":"1901.08568","doi":null,"metadata_source":"pith","pith_arxiv_id":"1901.08568","snapshot_observed_at":"2026-08-09T00:13:05.090775Z","title":"Algorithms for Fairness in Sequential Decision Making","venue":"cs.LG","work_id":"6e6d72aa-ca2d-491e-98c8-146b6f059c31","year":2019},"citing_paper":{"arxiv_id":"2502.03953","last_updated":"2025-09-02T10:01:32Z","snapshot_observed_at":"2026-08-09T08:11:07.175543Z","submitted_at":"2025-02-06T10:45:55Z","title":"Fairness Aware Reinforcement Learning via Proximal Policy Optimization","version":2},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-09T00:13:05.013838Z"},"links":{"cited_paper":"/paper/1901.08568","citing_paper":"/paper/2502.03953"},"observation_digest":"sha256:3dfdc6d3f09533467a2e08aca4a4d99147a3f97d1daa141836a030e92f5d495c","observation_id":"177bfb8f-973a-48b4-9fac-d8625bb50d52","resolution":{"observed_at":"2026-08-09T00:13:05.094774Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T00:13:05.203940Z","title":null,"venue":null,"work_id":"29763896-17ca-458f-af4b-9a60a1b6ba2f","year":2023},"citing_paper":{"arxiv_id":"2502.03953","last_updated":"2025-09-02T10:01:32Z","snapshot_observed_at":"2026-08-09T08:11:07.175543Z","submitted_at":"2025-02-06T10:45:55Z","title":"Fairness Aware Reinforcement Learning via Proximal Policy Optimization","version":2},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-09T00:13:05.017739Z"},"links":{"citing_paper":"/paper/2502.03953"},"observation_digest":"sha256:30b9b9209287df7cd77b04133e211372726cfc3e8a1cfebafbac6caefe0b0faf","observation_id":"214cd1ec-bb67-418d-908e-c93526566bda","resolution":{"observed_at":"2026-08-09T00:13:05.207432Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T00:13:05.192821Z","title":null,"venue":null,"work_id":"6fec9ea0-8659-405f-b26e-1843abc39e5e","year":2014},"citing_paper":{"arxiv_id":"2502.03953","last_updated":"2025-09-02T10:01:32Z","snapshot_observed_at":"2026-08-09T08:11:07.175543Z","submitted_at":"2025-02-06T10:45:55Z","title":"Fairness Aware Reinforcement Learning via Proximal Policy Optimization","version":2},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-09T00:13:05.021664Z"},"links":{"citing_paper":"/paper/2502.03953"},"observation_digest":"sha256:f919154af49d868500ebe8591e489376ea26bda9f820ff11be32ab346bba4a31","observation_id":"a613fb61-476b-488e-a02c-87230457f205","resolution":{"observed_at":"2026-08-09T00:13:05.196659Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2205.11814","last_updated":"2022-06-17T02:39:04Z","snapshot_observed_at":"2026-08-12T20:44:52.583449Z","submitted_at":"2022-05-24T06:15:51Z","title":"Penalized Proximal Policy Optimization for Safe Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.11814","snapshot_observed_at":"2026-08-09T00:13:05.026156Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.03953","last_updated":"2025-09-02T10:01:32Z","snapshot_observed_at":"2026-08-09T08:11:07.175543Z","submitted_at":"2025-02-06T10:45:55Z","title":"Fairness Aware Reinforcement Learning via Proximal Policy Optimization","version":2},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-09T00:13:05.026156Z"},"links":{"cited_paper":"/paper/2205.11814","citing_paper":"/paper/2502.03953"},"observation_digest":"sha256:42ea71d5d995931ab3bf99ce0d89b2a8758c2b2705090e450be59194ae307619","observation_id":"e4350450-d4ba-44ce-8319-6cf82725fe99","resolution":{"observed_at":"2026-08-09T00:13:05.026156Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2012.09421","last_updated":"2021-06-22T07:20:24Z","snapshot_observed_at":"2026-07-06T10:25:22.792609Z","submitted_at":"2020-12-17T07:17:36Z","title":"Learning Fair Policies in Decentralized Cooperative Multi-Agent Reinforcement Learning","version":4},"cited_work":{"arxiv_id":"2012.09421","doi":null,"metadata_source":"pith","pith_arxiv_id":"2012.09421","snapshot_observed_at":"2026-08-09T00:13:05.063464Z","title":"Learning Fair Policies in Decentralized Cooperative Multi-Agent Reinforcement Learning","venue":"cs.LG","work_id":"7a70d0e8-f164-430c-b388-ca8c621b071e","year":2020},"citing_paper":{"arxiv_id":"2502.03953","last_updated":"2025-09-02T10:01:32Z","snapshot_observed_at":"2026-08-09T08:11:07.175543Z","submitted_at":"2025-02-06T10:45:55Z","title":"Fairness Aware Reinforcement Learning via Proximal Policy Optimization","version":2},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-09T00:13:05.031194Z"},"links":{"cited_paper":"/paper/2012.09421","citing_paper":"/paper/2502.03953"},"observation_digest":"sha256:85bd9ef156ad925f9cd90f29e697868597b03c691582464b5757b35f255cdb62","observation_id":"1deed8e9-4385-4b60-94ac-f008b69173df","resolution":{"observed_at":"2026-08-09T00:13:05.069862Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2502.03953","last_updated":"2025-09-02T10:01:32Z","latest_version":2,"primary_category":"cs.MA","snapshot_observed_at":"2026-08-09T08:11:07.175543Z","submitted_at":"2025-02-06T10:45:55Z","title":"Fairness Aware Reinforcement Learning via Proximal Policy Optimization"},"reference_resolution":{"displayed":49,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":38,"verified_exact":4,"verified_fuzzy":6},"total_outbound_references":49},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"thesis":"As of 13 August 2026, this Paper Citation Record lists 49 of 49 outbound references and 1 inbound Pith citation observation for arXiv:2502.03953."}