{"as_of":"2026-08-14T01:24:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:9f37343e8da19fff42f831eb4e3f28800ce7679767ef28e919c776f5a24e3595","coverage":[{"denominator":32,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":32,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T13:57:40.245927Z","state":"measured"},{"denominator":32,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":32,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-13T06:32:02.005865+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2505.20579/citation-record","integrity":"/paper/2505.20579/integrity","json":"/paper/2505.20579/citation-record.json","paper":"/paper/2505.20579"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:57:41.906326Z","title":"LOQA : Learning with opponent q-learning awareness","venue":null,"work_id":"5e8ed76e-8b46-4127-b5de-a82e88e2b5b2","year":2024},"citing_paper":{"arxiv_id":"2505.20579","last_updated":"2026-07-18T20:07:20Z","snapshot_observed_at":"2026-08-07T13:49:07.327912Z","submitted_at":"2025-05-26T23:28:52Z","title":"The challenge of hidden gifts in multi-agent reinforcement learning","version":7},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-07T13:57:38.263636Z"},"links":{"citing_paper":"/paper/2505.20579"},"observation_digest":"sha256:5a15a61089ae362baceb1a4e75bfce9138f00c5cd8dd17d9c9721aebb0f2ea6f","observation_id":"0785d4bb-e775-4cfb-8e2c-d5f46fb58dfd","resolution":{"observed_at":"2026-08-07T13:57:41.973000Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:57:41.804430Z","title":"Unifying temporal and structural credit assignment problems","venue":null,"work_id":"760cd5b2-8b27-45a2-9779-1c586cf9c52f","year":2004},"citing_paper":{"arxiv_id":"2505.20579","last_updated":"2026-07-18T20:07:20Z","snapshot_observed_at":"2026-08-07T13:49:07.327912Z","submitted_at":"2025-05-26T23:28:52Z","title":"The challenge of hidden gifts in multi-agent reinforcement learning","version":7},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-07T13:57:38.403146Z"},"links":{"citing_paper":"/paper/2505.20579"},"observation_digest":"sha256:ed030884b4d45a9de9e4dda68ca5233603215c65f3ff024237d2d26b57861034","observation_id":"65b50dc3-88b8-429a-8651-2d1ae047486d","resolution":{"observed_at":"2026-08-07T13:57:41.845941Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:57:38.517182Z","title":"Understanding the impact of entropy on policy optimization","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.20579","last_updated":"2026-07-18T20:07:20Z","snapshot_observed_at":"2026-08-07T13:49:07.327912Z","submitted_at":"2025-05-26T23:28:52Z","title":"The challenge of hidden gifts in multi-agent reinforcement learning","version":7},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-07T13:57:38.517182Z"},"links":{"citing_paper":"/paper/2505.20579"},"observation_digest":"sha256:3dd54cecab2f9eb368febb4bf68f3140780737f1e8d9c1af0e87c8c09f6eaed6","observation_id":"45148112-d0c6-4aa3-becf-9b96e2203caf","resolution":{"observed_at":"2026-08-07T13:57:38.517182Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:57:41.738990Z","title":"Effective choice in the prisoner's dilemma","venue":null,"work_id":"dcf0bb76-28be-42aa-b821-37462bfe4fac","year":1980},"citing_paper":{"arxiv_id":"2505.20579","last_updated":"2026-07-18T20:07:20Z","snapshot_observed_at":"2026-08-07T13:49:07.327912Z","submitted_at":"2025-05-26T23:28:52Z","title":"The challenge of hidden gifts in multi-agent reinforcement learning","version":7},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-07T13:57:38.596201Z"},"links":{"citing_paper":"/paper/2505.20579"},"observation_digest":"sha256:dc1a9db591b20f559ed9dc1a3a016df05bf835573c758f50e48250c9b9a76347","observation_id":"717fd1f9-4ef1-4ca7-92c3-7639a377b6b5","resolution":{"observed_at":"2026-08-07T13:57:41.762392Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:57:41.684653Z","title":"Manitokanac","venue":null,"work_id":"f8ea4976-4339-4470-98c7-0173cb9ffe60","year":2015},"citing_paper":{"arxiv_id":"2505.20579","last_updated":"2026-07-18T20:07:20Z","snapshot_observed_at":"2026-08-07T13:49:07.327912Z","submitted_at":"2025-05-26T23:28:52Z","title":"The challenge of hidden gifts in multi-agent reinforcement learning","version":7},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-07T13:57:38.723112Z"},"links":{"citing_paper":"/paper/2505.20579"},"observation_digest":"sha256:dae494bcccad5dbfe756e6fefd06f2d656bb30ecf6e5ac40fbeb1c0b185ff543","observation_id":"545c2036-bae3-4537-a921-a7b2ee20f4d5","resolution":{"observed_at":"2026-08-07T13:57:41.704296Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:57:38.847739Z","title":"The theory of dynamic programming","venue":null,"work_id":null,"year":1954},"citing_paper":{"arxiv_id":"2505.20579","last_updated":"2026-07-18T20:07:20Z","snapshot_observed_at":"2026-08-07T13:49:07.327912Z","submitted_at":"2025-05-26T23:28:52Z","title":"The challenge of hidden gifts in multi-agent reinforcement learning","version":7},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-07T13:57:38.847739Z"},"links":{"citing_paper":"/paper/2505.20579"},"observation_digest":"sha256:bbeba802764778ce19bd933a1fb9f26b3eb4d45d65fe0cd25f4136777a1b57b2","observation_id":"878a3ef2-3b7d-4462-b2c7-3f02961b23a5","resolution":{"observed_at":"2026-08-07T13:57:38.847739Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:57:41.640596Z","title":"Prisoner's dilemma; a study in conflict and cooperation","venue":null,"work_id":"beb56e1b-3493-4e0e-b0b9-e77a736b0b69","year":1965},"citing_paper":{"arxiv_id":"2505.20579","last_updated":"2026-07-18T20:07:20Z","snapshot_observed_at":"2026-08-07T13:49:07.327912Z","submitted_at":"2025-05-26T23:28:52Z","title":"The challenge of hidden gifts in multi-agent reinforcement learning","version":7},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-07T13:57:38.955323Z"},"links":{"citing_paper":"/paper/2505.20579"},"observation_digest":"sha256:320cda5ef47b41b8297add29946bdba5560c39bb7bf37a8f9a816bb5661820ab","observation_id":"fa69cbd5-ecc0-40ef-98f3-07dacafc609b","resolution":{"observed_at":"2026-08-07T13:57:41.652409Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:57:39.056790Z","title":"Decision transformer: Reinforcement learning via sequence modeling","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.20579","last_updated":"2026-07-18T20:07:20Z","snapshot_observed_at":"2026-08-07T13:49:07.327912Z","submitted_at":"2025-05-26T23:28:52Z","title":"The challenge of hidden gifts in multi-agent reinforcement learning","version":7},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-07T13:57:39.056790Z"},"links":{"citing_paper":"/paper/2505.20579"},"observation_digest":"sha256:6f5c27512f53b758437ec1631ca72188e001f8ddbc041b803fc29443e8d00e64","observation_id":"fecfc178-cc40-4f6c-ad19-b731c3caee36","resolution":{"observed_at":"2026-08-07T13:57:39.056790Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:57:39.091824Z","title":"Minigrid & miniworld: Modular & customizable reinforcement learning environments for goal-oriented tasks","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.20579","last_updated":"2026-07-18T20:07:20Z","snapshot_observed_at":"2026-08-07T13:49:07.327912Z","submitted_at":"2025-05-26T23:28:52Z","title":"The challenge of hidden gifts in multi-agent reinforcement learning","version":7},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-07T13:57:39.091824Z"},"links":{"citing_paper":"/paper/2505.20579"},"observation_digest":"sha256:a2c18f57bf841fd79aea8188f36c0dd6071550058da69c6a42e42ff5876de3be","observation_id":"c395c7bc-213f-4ad1-ab39-50dc2bea790a","resolution":{"observed_at":"2026-08-07T13:57:39.091824Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:57:39.129254Z","title":"Learning phrase representations using RNN encoder -- decoder for statistical machine translation","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2505.20579","last_updated":"2026-07-18T20:07:20Z","snapshot_observed_at":"2026-08-07T13:49:07.327912Z","submitted_at":"2025-05-26T23:28:52Z","title":"The challenge of hidden gifts in multi-agent reinforcement learning","version":7},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-07T13:57:39.129254Z"},"links":{"citing_paper":"/paper/2505.20579"},"observation_digest":"sha256:29ec884b97e20ce71e0d38ec8501e2c6cad601ddc09a330d99a85637a49bc389","observation_id":"440b0c45-833b-4302-9b72-75deec581e6f","resolution":{"observed_at":"2026-08-07T13:57:39.129254Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:57:41.569850Z","title":"Hypothetical minds: Scaffolding theory of mind for multi-agent tasks with large language models","venue":null,"work_id":"2736cf36-08ed-45a8-95c8-31d03c539c5d","year":2025},"citing_paper":{"arxiv_id":"2505.20579","last_updated":"2026-07-18T20:07:20Z","snapshot_observed_at":"2026-08-07T13:49:07.327912Z","submitted_at":"2025-05-26T23:28:52Z","title":"The challenge of hidden gifts in multi-agent reinforcement learning","version":7},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-07T13:57:39.183179Z"},"links":{"citing_paper":"/paper/2505.20579"},"observation_digest":"sha256:3ead71d94593cc7646777e613b750a05660635b3ebae3c3dd80b4fcb87860657","observation_id":"1429d519-a76c-4b38-8964-b27f8e51bc77","resolution":{"observed_at":"2026-08-07T13:57:41.604374Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:57:41.492287Z","title":"Maximum entropy RL (provably) solves some robust RL problems","venue":null,"work_id":"158a2957-403f-4a8d-bc72-db15573300fd","year":2022},"citing_paper":{"arxiv_id":"2505.20579","last_updated":"2026-07-18T20:07:20Z","snapshot_observed_at":"2026-08-07T13:49:07.327912Z","submitted_at":"2025-05-26T23:28:52Z","title":"The challenge of hidden gifts in multi-agent reinforcement learning","version":7},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-07T13:57:39.240202Z"},"links":{"citing_paper":"/paper/2505.20579"},"observation_digest":"sha256:d937312243655b42c46b8a477b8ea9c0137e7188a7d06df6ed00d0b6681e4cb0","observation_id":"ee237fee-8184-496b-b614-bec4548cb90b","resolution":{"observed_at":"2026-08-07T13:57:41.525145Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:57:39.298552Z","title":"Counterfactual multi-agent policy gradients","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2505.20579","last_updated":"2026-07-18T20:07:20Z","snapshot_observed_at":"2026-08-07T13:49:07.327912Z","submitted_at":"2025-05-26T23:28:52Z","title":"The challenge of hidden gifts in multi-agent reinforcement learning","version":7},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-07T13:57:39.298552Z"},"links":{"citing_paper":"/paper/2505.20579"},"observation_digest":"sha256:2b3ea85fe195a932afea5e3e3e7e82e36d1bca204242be3216f28cb292514137","observation_id":"edcda3d2-97cb-44e2-b238-7b58dad96676","resolution":{"observed_at":"2026-08-07T13:57:39.298552Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1709.04326","last_updated":"2018-09-19T19:22:48Z","snapshot_observed_at":"2026-07-06T05:59:28.465615Z","submitted_at":"2017-09-13T13:42:15Z","title":"Learning with Opponent-Learning Awareness","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1709.04326","snapshot_observed_at":"2026-08-07T13:57:39.358832Z","title":"Learning with opponent-learning awareness","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.20579","last_updated":"2026-07-18T20:07:20Z","snapshot_observed_at":"2026-08-07T13:49:07.327912Z","submitted_at":"2025-05-26T23:28:52Z","title":"The challenge of hidden gifts in multi-agent reinforcement learning","version":7},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-07T13:57:39.358832Z"},"links":{"cited_paper":"/paper/1709.04326","citing_paper":"/paper/2505.20579"},"observation_digest":"sha256:fca71e6db909024a2ce79c6ade92fd59350a475b05797fe01671b70186715caf","observation_id":"1d218df6-f17b-4151-b312-7a51599cfd3e","resolution":{"observed_at":"2026-08-07T13:57:39.358832Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:57:41.348572Z","title":"Structural credit assignment in neural networks using reinforcement learning","venue":null,"work_id":"8c2c3866-5f0f-4c7e-832f-7576dbb917bc","year":2021},"citing_paper":{"arxiv_id":"2505.20579","last_updated":"2026-07-18T20:07:20Z","snapshot_observed_at":"2026-08-07T13:49:07.327912Z","submitted_at":"2025-05-26T23:28:52Z","title":"The challenge of hidden gifts in multi-agent reinforcement learning","version":7},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-07T13:57:39.409064Z"},"links":{"citing_paper":"/paper/2505.20579"},"observation_digest":"sha256:5bf756ef4a9d22ca46e1ebf32ad501b99f720ed6fce239cb949ece28bd3a3458","observation_id":"fa5fa247-7d8a-4ce1-90c4-4e7525eabf33","resolution":{"observed_at":"2026-08-07T13:57:41.422159Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:57:39.454659Z","title":"Soft actor-critic: Off-policy maximum entropy deep reinforcement learning with a stochastic actor","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2505.20579","last_updated":"2026-07-18T20:07:20Z","snapshot_observed_at":"2026-08-07T13:49:07.327912Z","submitted_at":"2025-05-26T23:28:52Z","title":"The challenge of hidden gifts in multi-agent reinforcement learning","version":7},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-07T13:57:39.454659Z"},"links":{"citing_paper":"/paper/2505.20579"},"observation_digest":"sha256:7c5489603b0b2a1cadcd597e809ec9da455231e215384e08d533487496928802","observation_id":"23447fde-0e28-4662-8aaf-02fb51e13281","resolution":{"observed_at":"2026-08-07T13:57:39.454659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:57:41.244755Z","title":"Optimizing agent behavior over long time scales by transporting value","venue":null,"work_id":"6c3e85ac-801c-4c72-91f1-1779c9f39ab2","year":2019},"citing_paper":{"arxiv_id":"2505.20579","last_updated":"2026-07-18T20:07:20Z","snapshot_observed_at":"2026-08-07T13:49:07.327912Z","submitted_at":"2025-05-26T23:28:52Z","title":"The challenge of hidden gifts in multi-agent reinforcement learning","version":7},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-07T13:57:39.511697Z"},"links":{"citing_paper":"/paper/2505.20579"},"observation_digest":"sha256:e309fc3a19e589175cc0a2a9521f40eef65faa1a2d215bfc688afe54c7e9225d","observation_id":"c9e0a6a7-9510-41ae-9122-827df185a5cf","resolution":{"observed_at":"2026-08-07T13:57:41.293111Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:57:41.160427Z","title":"Stateful active facilitator: Coordination and environmental heterogeneity in cooperative multi-agent reinforcement learning","venue":null,"work_id":"f32eaadf-bb3b-45f1-bc8d-3c4cc767289a","year":2023},"citing_paper":{"arxiv_id":"2505.20579","last_updated":"2026-07-18T20:07:20Z","snapshot_observed_at":"2026-08-07T13:49:07.327912Z","submitted_at":"2025-05-26T23:28:52Z","title":"The challenge of hidden gifts in multi-agent reinforcement learning","version":7},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-07T13:57:39.568734Z"},"links":{"citing_paper":"/paper/2505.20579"},"observation_digest":"sha256:be9d9cff2ccd5af51b4e305711dba377786ed91308ca6ec8c6c789e037b541cc","observation_id":"0e6b197b-fa05-4ba0-96bc-c5aeff909f22","resolution":{"observed_at":"2026-08-07T13:57:41.188200Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:57:39.609339Z","title":"Maven: Multi-agent variational exploration","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.20579","last_updated":"2026-07-18T20:07:20Z","snapshot_observed_at":"2026-08-07T13:49:07.327912Z","submitted_at":"2025-05-26T23:28:52Z","title":"The challenge of hidden gifts in multi-agent reinforcement learning","version":7},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-07T13:57:39.609339Z"},"links":{"citing_paper":"/paper/2505.20579"},"observation_digest":"sha256:b68f5960897d6dddf4151d576a1db40c01e1164ce4b7a1114de29f0117c5d900","observation_id":"38f3c47b-f42f-45cf-add0-5cde06837423","resolution":{"observed_at":"2026-08-07T13:57:39.609339Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.18636","last_updated":"2025-03-19T13:28:43Z","snapshot_observed_at":"2026-08-12T22:16:00.956082Z","submitted_at":"2024-10-24T10:48:42Z","title":"Multi-agent cooperation through learning-aware policy gradients","version":2},"cited_work":{"arxiv_id":"2410.18636","doi":null,"metadata_source":"pith","pith_arxiv_id":"2410.18636","snapshot_observed_at":"2026-08-07T13:57:40.460711Z","title":"Multi-agent cooperation through learning-aware policy gradients","venue":"cs.AI","work_id":"c745e8bc-0835-4088-8aac-da6191357837","year":2024},"citing_paper":{"arxiv_id":"2505.20579","last_updated":"2026-07-18T20:07:20Z","snapshot_observed_at":"2026-08-07T13:49:07.327912Z","submitted_at":"2025-05-26T23:28:52Z","title":"The challenge of hidden gifts in multi-agent reinforcement learning","version":7},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-07T13:57:39.665521Z"},"links":{"cited_paper":"/paper/2410.18636","citing_paper":"/paper/2505.20579"},"observation_digest":"sha256:803de4e3b8f2e3d3464fee894357cdca83b64ec96ebeb4e9b794a4b5a3b6a3a2","observation_id":"5778cf27-9108-4fa6-9e27-766e4d1956f5","resolution":{"observed_at":"2026-08-07T13:57:40.513690Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:57:39.695724Z","title":"Equilibrium points in n-person games","venue":null,"work_id":null,"year":1950},"citing_paper":{"arxiv_id":"2505.20579","last_updated":"2026-07-18T20:07:20Z","snapshot_observed_at":"2026-08-07T13:49:07.327912Z","submitted_at":"2025-05-26T23:28:52Z","title":"The challenge of hidden gifts in multi-agent reinforcement learning","version":7},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-07T13:57:39.695724Z"},"links":{"citing_paper":"/paper/2505.20579"},"observation_digest":"sha256:e2f41a4d3b70b23771d82361239eef3af0b2e9c5356478bb55a2f36bd8997925","observation_id":"86740e3a-9d60-4325-aeb7-1832e2994eb9","resolution":{"observed_at":"2026-08-07T13:57:39.695724Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:57:41.074455Z","title":"When do transformers shine in rl? decoupling memory from credit assignment","venue":null,"work_id":"1d80b830-e030-4a8b-8995-3f54c7b96a42","year":2023},"citing_paper":{"arxiv_id":"2505.20579","last_updated":"2026-07-18T20:07:20Z","snapshot_observed_at":"2026-08-07T13:49:07.327912Z","submitted_at":"2025-05-26T23:28:52Z","title":"The challenge of hidden gifts in multi-agent reinforcement learning","version":7},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-07T13:57:39.752780Z"},"links":{"citing_paper":"/paper/2505.20579"},"observation_digest":"sha256:d8e710c601469f7756de5009eb062ceb7fa35fb814a764a8dfe37eb0a74a5bb1","observation_id":"5cf85eeb-2d4b-4a4e-b747-7bc456e0db6b","resolution":{"observed_at":"2026-08-07T13:57:41.109096Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:57:39.809487Z","title":"Monotonic value function factorisation for deep multi-agent reinforcement learning","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.20579","last_updated":"2026-07-18T20:07:20Z","snapshot_observed_at":"2026-08-07T13:49:07.327912Z","submitted_at":"2025-05-26T23:28:52Z","title":"The challenge of hidden gifts in multi-agent reinforcement learning","version":7},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-07T13:57:39.809487Z"},"links":{"citing_paper":"/paper/2505.20579"},"observation_digest":"sha256:97b663eb1ac11ebc4accab1f3fa086f3f7fa2a4a18d00285d9cfe0f47eb5a72e","observation_id":"55335269-7cf6-46a5-9871-7febce7d37f4","resolution":{"observed_at":"2026-08-07T13:57:39.809487Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-07T13:57:39.857334Z","title":"Proximal policy optimization algorithms","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.20579","last_updated":"2026-07-18T20:07:20Z","snapshot_observed_at":"2026-08-07T13:49:07.327912Z","submitted_at":"2025-05-26T23:28:52Z","title":"The challenge of hidden gifts in multi-agent reinforcement learning","version":7},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-07T13:57:39.857334Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2505.20579"},"observation_digest":"sha256:1b178b333987561c1e0a6e0769d058a0fe0b936db3043152bb49bc7ea3ac0805","observation_id":"451b9fd3-8fe7-4219-8eaa-1f1103f85942","resolution":{"observed_at":"2026-08-07T13:57:39.857334Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.17540","last_updated":"2022-10-31T17:54:51Z","snapshot_observed_at":"2026-08-13T16:28:52.745002Z","submitted_at":"2022-10-31T17:54:51Z","title":"Agent-Time Attention for Sparse Rewards Multi-Agent Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2210.17540","doi":null,"metadata_source":"pith","pith_arxiv_id":"2210.17540","snapshot_observed_at":"2026-08-07T13:57:40.340365Z","title":"Agent-Time Attention for Sparse Rewards Multi-Agent Reinforcement Learning","venue":"cs.LG","work_id":"8c3e0e17-c58e-4831-8bc7-9149c2e000ea","year":2022},"citing_paper":{"arxiv_id":"2505.20579","last_updated":"2026-07-18T20:07:20Z","snapshot_observed_at":"2026-08-07T13:49:07.327912Z","submitted_at":"2025-05-26T23:28:52Z","title":"The challenge of hidden gifts in multi-agent reinforcement learning","version":7},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-07T13:57:39.909858Z"},"links":{"cited_paper":"/paper/2210.17540","citing_paper":"/paper/2505.20579"},"observation_digest":"sha256:f21c7af2f4507d008922fec41f200c9933208384cf529bc8a02a2163c85b38c4","observation_id":"e3603498-d8ec-4585-ae22-691096eaa45e","resolution":{"observed_at":"2026-08-07T13:57:40.393765Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:57:40.984163Z","title":"Qtran: Learning to factorize with transformation for cooperative multi-agent reinforcement learning","venue":null,"work_id":"f740077e-7f86-4dce-b689-4b4051728461","year":2019},"citing_paper":{"arxiv_id":"2505.20579","last_updated":"2026-07-18T20:07:20Z","snapshot_observed_at":"2026-08-07T13:49:07.327912Z","submitted_at":"2025-05-26T23:28:52Z","title":"The challenge of hidden gifts in multi-agent reinforcement learning","version":7},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-07T13:57:39.956054Z"},"links":{"citing_paper":"/paper/2505.20579"},"observation_digest":"sha256:3626756819fbeca46e1b99d9ef99492b56f79ce86beb993edd63ccaff64bf5d8","observation_id":"a839fd47-f4ca-41e4-84a2-aa7124976a93","resolution":{"observed_at":"2026-08-07T13:57:41.008477Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.12905","last_updated":"2024-06-11T21:13:34Z","snapshot_observed_at":"2026-08-12T23:45:06.578096Z","submitted_at":"2024-06-11T21:13:34Z","title":"PufferLib: Making Reinforcement Learning Libraries and Environments Play Nice","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.12905","snapshot_observed_at":"2026-08-07T13:57:40.035699Z","title":"Pufferlib: Making reinforcement learning libraries and environments play nice","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.20579","last_updated":"2026-07-18T20:07:20Z","snapshot_observed_at":"2026-08-07T13:49:07.327912Z","submitted_at":"2025-05-26T23:28:52Z","title":"The challenge of hidden gifts in multi-agent reinforcement learning","version":7},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-07T13:57:40.035699Z"},"links":{"cited_paper":"/paper/2406.12905","citing_paper":"/paper/2505.20579"},"observation_digest":"sha256:c054298199e4775aac614171657ba1df811cac0a0de0d88d48544f879be47ecc","observation_id":"db7404eb-e5c0-4b34-a830-334337701ea0","resolution":{"observed_at":"2026-08-07T13:57:40.035699Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:57:40.889362Z","title":"Value-decomposition networks for cooperative multi-agent learning","venue":null,"work_id":"531afe2f-f18b-48b7-9313-e5c3b8974dbc","year":2017},"citing_paper":{"arxiv_id":"2505.20579","last_updated":"2026-07-18T20:07:20Z","snapshot_observed_at":"2026-08-07T13:49:07.327912Z","submitted_at":"2025-05-26T23:28:52Z","title":"The challenge of hidden gifts in multi-agent reinforcement learning","version":7},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-07T13:57:40.079910Z"},"links":{"citing_paper":"/paper/2505.20579"},"observation_digest":"sha256:028e0ef703161d371d4223e5b758532d65000cef052946af5941567410d9272b","observation_id":"91fd2b73-84ff-4050-9654-cc1a7d4f5e5a","resolution":{"observed_at":"2026-08-07T13:57:40.936484Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:57:40.131961Z","title":"Policy gradient methods for reinforcement learning with function approximation","venue":null,"work_id":null,"year":1999},"citing_paper":{"arxiv_id":"2505.20579","last_updated":"2026-07-18T20:07:20Z","snapshot_observed_at":"2026-08-07T13:49:07.327912Z","submitted_at":"2025-05-26T23:28:52Z","title":"The challenge of hidden gifts in multi-agent reinforcement learning","version":7},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-07T13:57:40.131961Z"},"links":{"citing_paper":"/paper/2505.20579"},"observation_digest":"sha256:d77e401e2f6efb3bffd6c78c45e1de5f71288683bd76e7264ce9642a5d9e1f8c","observation_id":"6588f00d-0d2f-4415-a0a9-d4590e78ca2a","resolution":{"observed_at":"2026-08-07T13:57:40.131961Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:57:40.770732Z","title":"Learning sequences of actions in collectives of autonomous agents","venue":null,"work_id":"12fbc3c9-769f-40a4-b820-ee1331aa7cfe","year":2002},"citing_paper":{"arxiv_id":"2505.20579","last_updated":"2026-07-18T20:07:20Z","snapshot_observed_at":"2026-08-07T13:49:07.327912Z","submitted_at":"2025-05-26T23:28:52Z","title":"The challenge of hidden gifts in multi-agent reinforcement learning","version":7},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-07T13:57:40.173465Z"},"links":{"citing_paper":"/paper/2505.20579"},"observation_digest":"sha256:b0a51284e6c5b2f1a5cc5fd15219e5ded09fd53d616b225fa1aff34ea1c88054","observation_id":"32731990-74ff-40fb-8c52-8d65ba72f489","resolution":{"observed_at":"2026-08-07T13:57:40.819723Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:57:40.667892Z","title":"Cola: consistent learning with opponent-learning awareness","venue":null,"work_id":"cc021345-80b1-4dcc-94b4-54ca4d7ec2c5","year":2022},"citing_paper":{"arxiv_id":"2505.20579","last_updated":"2026-07-18T20:07:20Z","snapshot_observed_at":"2026-08-07T13:49:07.327912Z","submitted_at":"2025-05-26T23:28:52Z","title":"The challenge of hidden gifts in multi-agent reinforcement learning","version":7},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-07T13:57:40.206889Z"},"links":{"citing_paper":"/paper/2505.20579"},"observation_digest":"sha256:f5b8731805498313bb1c0e45c19c7e6c733c1738ca6d8d9406dd91498966780d","observation_id":"4873364c-44db-423f-8ed7-6303da79cba4","resolution":{"observed_at":"2026-08-07T13:57:40.720516Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:57:40.579956Z","title":"The surprising effectiveness of ppo in cooperative multi-agent games","venue":null,"work_id":"79ea997b-46f6-4872-ad15-5866d0e439ee","year":2022},"citing_paper":{"arxiv_id":"2505.20579","last_updated":"2026-07-18T20:07:20Z","snapshot_observed_at":"2026-08-07T13:49:07.327912Z","submitted_at":"2025-05-26T23:28:52Z","title":"The challenge of hidden gifts in multi-agent reinforcement learning","version":7},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-07T13:57:40.245927Z"},"links":{"citing_paper":"/paper/2505.20579"},"observation_digest":"sha256:8702e034e1a0b64d91ed76d8e7cbeb3bb00083b922b7ac573c4603d2338bbdaa","observation_id":"4e88e8fe-79cc-47f6-9a09-8e48e4f66aa1","resolution":{"observed_at":"2026-08-07T13:57:40.611299Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2505.20579","last_updated":"2026-07-18T20:07:20Z","latest_version":7,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-07T13:49:07.327912Z","submitted_at":"2025-05-26T23:28:52Z","title":"The challenge of hidden gifts in multi-agent reinforcement learning"},"reference_resolution":{"displayed":32,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":14,"verified_exact":2,"verified_fuzzy":16},"total_outbound_references":32},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"thesis":"As of 14 August 2026, this Paper Citation Record lists 32 of 32 outbound references and 0 inbound Pith citation observations for arXiv:2505.20579."}