{"as_of":"2026-08-13T05:30:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:8a568edacc0131c6fb5b496a5cefa866e102af2e496e570f44485bee6a3ed26a","coverage":[{"denominator":146,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":100,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T23:56:00.724470Z","state":"measured"},{"denominator":100,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":100,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-12T06:34:41.77262+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2412.02091/citation-record","integrity":"/paper/2412.02091/integrity","json":"/paper/2412.02091/citation-record.json","paper":"/paper/2412.02091"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:56:00.337546Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2412.02091","last_updated":"2025-04-13T01:25:54Z","snapshot_observed_at":"2026-08-13T00:46:41.317824Z","submitted_at":"2024-12-03T02:22:55Z","title":"The Problem of Social Cost in Multi-Agent General Reinforcement Learning: Survey and Synthesis","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-11T23:56:00.337546Z"},"links":{"citing_paper":"/paper/2412.02091"},"observation_digest":"sha256:988c712f417645b31be3ade74671b4c28f47e12628cd87cbe276d9f9cac23864","observation_id":"6217f445-406e-44b4-a06d-54d2ceeb8f01","resolution":{"observed_at":"2026-08-11T23:56:00.337546Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:56:00.342427Z","title":"A model of online misinformation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.02091","last_updated":"2025-04-13T01:25:54Z","snapshot_observed_at":"2026-08-13T00:46:41.317824Z","submitted_at":"2024-12-03T02:22:55Z","title":"The Problem of Social Cost in Multi-Agent General Reinforcement Learning: Survey and Synthesis","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-11T23:56:00.342427Z"},"links":{"citing_paper":"/paper/2412.02091"},"observation_digest":"sha256:d644302f398378ed66566bdf2719e8723691d3473382fdd408a450b0f458d08d","observation_id":"6c85ce51-012a-467c-8064-bf73762d4e4b","resolution":{"observed_at":"2026-08-11T23:56:00.342427Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:56:00.346995Z","title":"The multiplicative weights updatemethod: ameta-algorithmandapplications","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2412.02091","last_updated":"2025-04-13T01:25:54Z","snapshot_observed_at":"2026-08-13T00:46:41.317824Z","submitted_at":"2024-12-03T02:22:55Z","title":"The Problem of Social Cost in Multi-Agent General Reinforcement Learning: Survey and Synthesis","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-11T23:56:00.346995Z"},"links":{"citing_paper":"/paper/2412.02091"},"observation_digest":"sha256:53e8cb969ad18f3e11bea72fe3383e78a0991d03f9f9b4b9f27e788c4b59eb85","observation_id":"a1fffa89-d828-454b-adac-9f87c050b9eb","resolution":{"observed_at":"2026-08-11T23:56:00.346995Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:56:00.351316Z","title":"Deep reinforcement learning: A brief survey.IEEE Signal Processing Magazine, 34(6):26–38, 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2412.02091","last_updated":"2025-04-13T01:25:54Z","snapshot_observed_at":"2026-08-13T00:46:41.317824Z","submitted_at":"2024-12-03T02:22:55Z","title":"The Problem of Social Cost in Multi-Agent General Reinforcement Learning: Survey and Synthesis","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-11T23:56:00.351316Z"},"links":{"citing_paper":"/paper/2412.02091"},"observation_digest":"sha256:bd71e5b64a7ad3091920c05be0d872d202cb529d6666b22672f6b9a909f0fe9f","observation_id":"6a198f9b-9f1a-43ef-92b3-df9b37d6d00d","resolution":{"observed_at":"2026-08-11T23:56:00.351316Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:56:00.355692Z","title":"An efficient dynamic mechanism.Economet- rica, 81(6):2463–2485, 2013","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2412.02091","last_updated":"2025-04-13T01:25:54Z","snapshot_observed_at":"2026-08-13T00:46:41.317824Z","submitted_at":"2024-12-03T02:22:55Z","title":"The Problem of Social Cost in Multi-Agent General Reinforcement Learning: Survey and Synthesis","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-11T23:56:00.355692Z"},"links":{"citing_paper":"/paper/2412.02091"},"observation_digest":"sha256:2418211f474ac9d2e7c57f4d65cb441976ec32dc47e33f42cc691222af03d5dd","observation_id":"adc18232-2d67-458d-8305-8aae9710d867","resolution":{"observed_at":"2026-08-11T23:56:00.355692Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:56:00.359629Z","title":"Using confidence bounds for exploitation-exploration trade- offs","venue":null,"work_id":null,"year":2003},"citing_paper":{"arxiv_id":"2412.02091","last_updated":"2025-04-13T01:25:54Z","snapshot_observed_at":"2026-08-13T00:46:41.317824Z","submitted_at":"2024-12-03T02:22:55Z","title":"The Problem of Social Cost in Multi-Agent General Reinforcement Learning: Survey and Synthesis","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-11T23:56:00.359629Z"},"links":{"citing_paper":"/paper/2412.02091"},"observation_digest":"sha256:b8c1132ccf50926559cab9d63d2cb1c1dfdf43c8ebe7dd5c205544c49ec429be","observation_id":"affb08b9-945c-4c10-b7c0-72377086f379","resolution":{"observed_at":"2026-08-11T23:56:00.359629Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:56:00.364212Z","title":"The nonstochastic multiarmed bandit problem.SIAM Journal on Com- puting, 32(1):48–77, 2002","venue":null,"work_id":null,"year":2002},"citing_paper":{"arxiv_id":"2412.02091","last_updated":"2025-04-13T01:25:54Z","snapshot_observed_at":"2026-08-13T00:46:41.317824Z","submitted_at":"2024-12-03T02:22:55Z","title":"The Problem of Social Cost in Multi-Agent General Reinforcement Learning: Survey and Synthesis","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-11T23:56:00.364212Z"},"links":{"citing_paper":"/paper/2412.02091"},"observation_digest":"sha256:83107e10b80f5e62fc75e7aafa762389213ccacbb603d7a5e55e23ef4f6594cf","observation_id":"23e1bc6d-beef-4611-ac9b-63c33b908f4f","resolution":{"observed_at":"2026-08-11T23:56:00.364212Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:56:00.368304Z","title":"Correlated equilibrium as an expression of Bayesian rationality","venue":null,"work_id":null,"year":1987},"citing_paper":{"arxiv_id":"2412.02091","last_updated":"2025-04-13T01:25:54Z","snapshot_observed_at":"2026-08-13T00:46:41.317824Z","submitted_at":"2024-12-03T02:22:55Z","title":"The Problem of Social Cost in Multi-Agent General Reinforcement Learning: Survey and Synthesis","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-11T23:56:00.368304Z"},"links":{"citing_paper":"/paper/2412.02091"},"observation_digest":"sha256:647c545dd184e8c864581c037a4a3cfe199596caf11cfc9b722c72f1d4c8c7ff","observation_id":"d691e754-5f9b-40ad-8f44-031399ce9f25","resolution":{"observed_at":"2026-08-11T23:56:00.368304Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:56:00.372307Z","title":"The emergence of cooperation among egoists.American Political Science Review, 75(2):306–318, 1981","venue":null,"work_id":null,"year":1981},"citing_paper":{"arxiv_id":"2412.02091","last_updated":"2025-04-13T01:25:54Z","snapshot_observed_at":"2026-08-13T00:46:41.317824Z","submitted_at":"2024-12-03T02:22:55Z","title":"The Problem of Social Cost in Multi-Agent General Reinforcement Learning: Survey and Synthesis","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-11T23:56:00.372307Z"},"links":{"citing_paper":"/paper/2412.02091"},"observation_digest":"sha256:08e399a534d21d7eed50a59d7f0272e806a26a40e1683bc8b16b56ce1f79c380","observation_id":"8aa510b6-94e2-4128-885c-0bdebbb46c8f","resolution":{"observed_at":"2026-08-11T23:56:00.372307Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:56:00.376120Z","title":"The Formula: The Universal Laws of Success","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2412.02091","last_updated":"2025-04-13T01:25:54Z","snapshot_observed_at":"2026-08-13T00:46:41.317824Z","submitted_at":"2024-12-03T02:22:55Z","title":"The Problem of Social Cost in Multi-Agent General Reinforcement Learning: Survey and Synthesis","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-11T23:56:00.376120Z"},"links":{"citing_paper":"/paper/2412.02091"},"observation_digest":"sha256:f744f302ee9d6548e53ab1d7a8f4c5aeaaa9dc20bf28f624ae0fa1e75f119f67","observation_id":"1ce94c58-1974-430b-8995-47379ed9790f","resolution":{"observed_at":"2026-08-11T23:56:00.376120Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:56:00.380923Z","title":"Dynamic incentives for congestion control","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2412.02091","last_updated":"2025-04-13T01:25:54Z","snapshot_observed_at":"2026-08-13T00:46:41.317824Z","submitted_at":"2024-12-03T02:22:55Z","title":"The Problem of Social Cost in Multi-Agent General Reinforcement Learning: Survey and Synthesis","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-11T23:56:00.380923Z"},"links":{"citing_paper":"/paper/2412.02091"},"observation_digest":"sha256:a6ba37d3fd1d71da98c6f89c7ec1674a5add623eb1bad3f776471e1b6edb64dd","observation_id":"1cb87b26-b958-4b6a-b781-43887567c6ee","resolution":{"observed_at":"2026-08-11T23:56:00.380923Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:56:00.385172Z","title":"A neural probabilistic language model.J","venue":null,"work_id":null,"year":2003},"citing_paper":{"arxiv_id":"2412.02091","last_updated":"2025-04-13T01:25:54Z","snapshot_observed_at":"2026-08-13T00:46:41.317824Z","submitted_at":"2024-12-03T02:22:55Z","title":"The Problem of Social Cost in Multi-Agent General Reinforcement Learning: Survey and Synthesis","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-11T23:56:00.385172Z"},"links":{"citing_paper":"/paper/2412.02091"},"observation_digest":"sha256:8a5a95d58223ab7411b13bcb3d5761c04eb6ff8fd085be4f241136b0aadc6d71","observation_id":"2bd0a905-a0f3-4799-a535-39ab03e0dae8","resolution":{"observed_at":"2026-08-11T23:56:00.385172Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:56:00.389340Z","title":"Taming the Matthew effect in online markets with social influence","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2412.02091","last_updated":"2025-04-13T01:25:54Z","snapshot_observed_at":"2026-08-13T00:46:41.317824Z","submitted_at":"2024-12-03T02:22:55Z","title":"The Problem of Social Cost in Multi-Agent General Reinforcement Learning: Survey and Synthesis","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-11T23:56:00.389340Z"},"links":{"citing_paper":"/paper/2412.02091"},"observation_digest":"sha256:bd2e41326ea33055ad1bb93610412ea85a768632f25e503b074e6b5e656cbaa0","observation_id":"280058df-b74d-447e-b414-a556cc22816c","resolution":{"observed_at":"2026-08-11T23:56:00.389340Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:56:00.393254Z","title":"The dynamic pivot mechanism","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2412.02091","last_updated":"2025-04-13T01:25:54Z","snapshot_observed_at":"2026-08-13T00:46:41.317824Z","submitted_at":"2024-12-03T02:22:55Z","title":"The Problem of Social Cost in Multi-Agent General Reinforcement Learning: Survey and Synthesis","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-11T23:56:00.393254Z"},"links":{"citing_paper":"/paper/2412.02091"},"observation_digest":"sha256:68e28b6d982ceb0c52746971291c5ca15007ebaea7594b3b382707072c870234","observation_id":"b0e9f2db-6e59-4e64-9874-2813c2813246","resolution":{"observed_at":"2026-08-11T23:56:00.393254Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:56:00.397020Z","title":"Dynamic mechanism design: An introduction","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2412.02091","last_updated":"2025-04-13T01:25:54Z","snapshot_observed_at":"2026-08-13T00:46:41.317824Z","submitted_at":"2024-12-03T02:22:55Z","title":"The Problem of Social Cost in Multi-Agent General Reinforcement Learning: Survey and Synthesis","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-11T23:56:00.397020Z"},"links":{"citing_paper":"/paper/2412.02091"},"observation_digest":"sha256:e11cf8c7210533df3b14f0233e7e9376d507bc3c0b6e27046ff005186950d018","observation_id":"2ee5a282-4ee7-44ed-82a3-e57a9438f01c","resolution":{"observed_at":"2026-08-11T23:56:00.397020Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:56:00.400660Z","title":"From external to internal regret.Jour- nal of Machine Learning Research, 8(6), 2007","venue":null,"work_id":null,"year":2007},"citing_paper":{"arxiv_id":"2412.02091","last_updated":"2025-04-13T01:25:54Z","snapshot_observed_at":"2026-08-13T00:46:41.317824Z","submitted_at":"2024-12-03T02:22:55Z","title":"The Problem of Social Cost in Multi-Agent General Reinforcement Learning: Survey and Synthesis","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-11T23:56:00.400660Z"},"links":{"citing_paper":"/paper/2412.02091"},"observation_digest":"sha256:3d61e0d155fb4d068fad9ecbd4355fbd8f046d177cad9443a98172710b991f3d","observation_id":"560cbd1e-87ca-40b5-8f2c-ddbabff06711","resolution":{"observed_at":"2026-08-11T23:56:00.400660Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:56:00.404299Z","title":"An Introduction to the Theory of Mechanism Design","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2412.02091","last_updated":"2025-04-13T01:25:54Z","snapshot_observed_at":"2026-08-13T00:46:41.317824Z","submitted_at":"2024-12-03T02:22:55Z","title":"The Problem of Social Cost in Multi-Agent General Reinforcement Learning: Survey and Synthesis","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-11T23:56:00.404299Z"},"links":{"citing_paper":"/paper/2412.02091"},"observation_digest":"sha256:3189696f958287e897a66a59cccfae98859cf14b23528c496800909ec5852614","observation_id":"46cf5c75-9b58-49ab-baf8-da926974aaee","resolution":{"observed_at":"2026-08-11T23:56:00.404299Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:56:00.408171Z","title":"Superintelligence: Paths, Dangers, Strategies","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2412.02091","last_updated":"2025-04-13T01:25:54Z","snapshot_observed_at":"2026-08-13T00:46:41.317824Z","submitted_at":"2024-12-03T02:22:55Z","title":"The Problem of Social Cost in Multi-Agent General Reinforcement Learning: Survey and Synthesis","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-11T23:56:00.408171Z"},"links":{"citing_paper":"/paper/2412.02091"},"observation_digest":"sha256:d11813d7b367ab93eefa7a31619b4ecd7e1565051f05e56906ff4d7e8aeb948d","observation_id":"a69de65e-3f50-4729-8bd6-430d598feae9","resolution":{"observed_at":"2026-08-11T23:56:00.408171Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:56:00.411991Z","title":"Ethical issues in advanced artificial intelligence.Machine Ethics and Robot Ethics, pages 69–75, 2020","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.02091","last_updated":"2025-04-13T01:25:54Z","snapshot_observed_at":"2026-08-13T00:46:41.317824Z","submitted_at":"2024-12-03T02:22:55Z","title":"The Problem of Social Cost in Multi-Agent General Reinforcement Learning: Survey and Synthesis","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-11T23:56:00.411991Z"},"links":{"citing_paper":"/paper/2412.02091"},"observation_digest":"sha256:91544f3d3929698964e56907986af7e4c6338cc6c61c943279dddf00689e287d","observation_id":"e395d10c-5de4-4fd6-b6c5-c7bf3e40bc55","resolution":{"observed_at":"2026-08-11T23:56:00.411991Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:56:00.415614Z","title":"Learn- ing to mitigate AI collusion on economic platforms.Advances in Neural Information Processing Systems, 35:37892–37904, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.02091","last_updated":"2025-04-13T01:25:54Z","snapshot_observed_at":"2026-08-13T00:46:41.317824Z","submitted_at":"2024-12-03T02:22:55Z","title":"The Problem of Social Cost in Multi-Agent General Reinforcement Learning: Survey and Synthesis","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-11T23:56:00.415614Z"},"links":{"citing_paper":"/paper/2412.02091"},"observation_digest":"sha256:4e16cbcf0b9412a2cf9255a0e9d7719f8f26644ad6d3ff9c49c3d8579596fec3","observation_id":"7dc6ae90-b268-44db-802a-5d3415663f28","resolution":{"observed_at":"2026-08-11T23:56:00.415614Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:56:00.419499Z","title":"A survey of monte carlo tree search methods","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2412.02091","last_updated":"2025-04-13T01:25:54Z","snapshot_observed_at":"2026-08-13T00:46:41.317824Z","submitted_at":"2024-12-03T02:22:55Z","title":"The Problem of Social Cost in Multi-Agent General Reinforcement Learning: Survey and Synthesis","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-11T23:56:00.419499Z"},"links":{"citing_paper":"/paper/2412.02091"},"observation_digest":"sha256:4545c8c0e9fab287f32a59c775a0fbe763d0e7b7089487e0a8e571a6c91e9902","observation_id":"6731de7f-a2ef-43a3-8e22-6874b91483ae","resolution":{"observed_at":"2026-08-11T23:56:00.419499Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:56:00.423612Z","title":"A comprehensive survey of graph embedding: Problems, techniques, and applications","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2412.02091","last_updated":"2025-04-13T01:25:54Z","snapshot_observed_at":"2026-08-13T00:46:41.317824Z","submitted_at":"2024-12-03T02:22:55Z","title":"The Problem of Social Cost in Multi-Agent General Reinforcement Learning: Survey and Synthesis","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-11T23:56:00.423612Z"},"links":{"citing_paper":"/paper/2412.02091"},"observation_digest":"sha256:71f73cc744e05d074b2bd72b78cbeebf61f96c2ab4d1a6eeba08a98ee9752d41","observation_id":"2285585f-da61-4f76-9bb1-1dd29e1d5abd","resolution":{"observed_at":"2026-08-11T23:56:00.423612Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:56:00.427413Z","title":"Artificial intelligence, algorithmic pricing, and collusion.American Economic Review, 110(10):3267–3297, 2020","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.02091","last_updated":"2025-04-13T01:25:54Z","snapshot_observed_at":"2026-08-13T00:46:41.317824Z","submitted_at":"2024-12-03T02:22:55Z","title":"The Problem of Social Cost in Multi-Agent General Reinforcement Learning: Survey and Synthesis","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-11T23:56:00.427413Z"},"links":{"citing_paper":"/paper/2412.02091"},"observation_digest":"sha256:8c2a54e86d1a95f5de52a43fb1cd185a6c5d472a1b2d0b3d23006fb43db51f14","observation_id":"72a1d687-08a5-48c9-a87b-e8e7b53c8a08","resolution":{"observed_at":"2026-08-11T23:56:00.427413Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:56:00.430984Z","title":"Self-predictive universal AI","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.02091","last_updated":"2025-04-13T01:25:54Z","snapshot_observed_at":"2026-08-13T00:46:41.317824Z","submitted_at":"2024-12-03T02:22:55Z","title":"The Problem of Social Cost in Multi-Agent General Reinforcement Learning: Survey and Synthesis","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-11T23:56:00.430984Z"},"links":{"citing_paper":"/paper/2412.02091"},"observation_digest":"sha256:3b8d2e2c674b48d33e71edb1b95da7c6b9ef6d37a4f009a0597a8708453b25ea","observation_id":"ef6e43d6-345d-4334-b033-1770f70f3aad","resolution":{"observed_at":"2026-08-11T23:56:00.430984Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:56:00.434733Z","title":"Optimal coordi- nated planning amongst self-interested agents with private state","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2412.02091","last_updated":"2025-04-13T01:25:54Z","snapshot_observed_at":"2026-08-13T00:46:41.317824Z","submitted_at":"2024-12-03T02:22:55Z","title":"The Problem of Social Cost in Multi-Agent General Reinforcement Learning: Survey and Synthesis","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-11T23:56:00.434733Z"},"links":{"citing_paper":"/paper/2412.02091"},"observation_digest":"sha256:284cd36be9b9f296f16c0cdc5f6a89c2552918da0b5856bc5996054ab1b1319a","observation_id":"10f84c2a-5ed3-458a-a767-21158954d741","resolution":{"observed_at":"2026-08-11T23:56:00.434733Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:56:00.438409Z","title":"Cambridge University Press, 2006","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2412.02091","last_updated":"2025-04-13T01:25:54Z","snapshot_observed_at":"2026-08-13T00:46:41.317824Z","submitted_at":"2024-12-03T02:22:55Z","title":"The Problem of Social Cost in Multi-Agent General Reinforcement Learning: Survey and Synthesis","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-11T23:56:00.438409Z"},"links":{"citing_paper":"/paper/2412.02091"},"observation_digest":"sha256:6466519100c0e715960bf25c8db69fa98e90b3ff9964ffec340ba51b5b001f09","observation_id":"c2f5f229-1533-49ce-9a68-c094b43ee44d","resolution":{"observed_at":"2026-08-11T23:56:00.438409Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:56:00.442224Z","title":"Evolu- tionary dynamics of biological auctions.Theoretical Population Biology, 81(1):69–80, 2012","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2412.02091","last_updated":"2025-04-13T01:25:54Z","snapshot_observed_at":"2026-08-13T00:46:41.317824Z","submitted_at":"2024-12-03T02:22:55Z","title":"The Problem of Social Cost in Multi-Agent General Reinforcement Learning: Survey and Synthesis","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-11T23:56:00.442224Z"},"links":{"citing_paper":"/paper/2412.02091"},"observation_digest":"sha256:f0c7488d9321e74a3e0ab4b572095af950abc84966a4afee237ab10516388a56","observation_id":"6ba7a7c9-79a5-4aaa-b312-3422c562c94f","resolution":{"observed_at":"2026-08-11T23:56:00.442224Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:56:00.445778Z","title":"Dynamic pricing in a labor market: Surge pricing and flexible work on the Uber platform.Ec, 16:455, 2016","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2412.02091","last_updated":"2025-04-13T01:25:54Z","snapshot_observed_at":"2026-08-13T00:46:41.317824Z","submitted_at":"2024-12-03T02:22:55Z","title":"The Problem of Social Cost in Multi-Agent General Reinforcement Learning: Survey and Synthesis","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-11T23:56:00.445778Z"},"links":{"citing_paper":"/paper/2412.02091"},"observation_digest":"sha256:33765a85652dcfd685cf587d0bb74834127650faac26a4342028e3618c51fae6","observation_id":"def6f621-f15b-4cde-a4ee-dfdf52802156","resolution":{"observed_at":"2026-08-11T23:56:00.445778Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:56:00.449612Z","title":"Hedging in games: Faster convergence of external and swap regrets","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.02091","last_updated":"2025-04-13T01:25:54Z","snapshot_observed_at":"2026-08-13T00:46:41.317824Z","submitted_at":"2024-12-03T02:22:55Z","title":"The Problem of Social Cost in Multi-Agent General Reinforcement Learning: Survey and Synthesis","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-11T23:56:00.449612Z"},"links":{"citing_paper":"/paper/2412.02091"},"observation_digest":"sha256:cb659f15c6f0c37da2d926e3dee24d000dad7c5cbd107ec33b733fd74c78342b","observation_id":"95490cd0-bbe9-4d93-b545-557981afda60","resolution":{"observed_at":"2026-08-11T23:56:00.449612Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:56:00.453322Z","title":"Prediction with expert evaluators’ advice","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2412.02091","last_updated":"2025-04-13T01:25:54Z","snapshot_observed_at":"2026-08-13T00:46:41.317824Z","submitted_at":"2024-12-03T02:22:55Z","title":"The Problem of Social Cost in Multi-Agent General Reinforcement Learning: Survey and Synthesis","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-11T23:56:00.453322Z"},"links":{"citing_paper":"/paper/2412.02091"},"observation_digest":"sha256:13c4b5b53ebf896487d7f02c3a27f09b184e936880d5c7e564f9ac4cd4e46755","observation_id":"203acd08-516f-4a6f-aabf-190a9e5352c5","resolution":{"observed_at":"2026-08-11T23:56:00.453322Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:56:00.457197Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.02091","last_updated":"2025-04-13T01:25:54Z","snapshot_observed_at":"2026-08-13T00:46:41.317824Z","submitted_at":"2024-12-03T02:22:55Z","title":"The Problem of Social Cost in Multi-Agent General Reinforcement Learning: Survey and Synthesis","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-11T23:56:00.457197Z"},"links":{"citing_paper":"/paper/2412.02091"},"observation_digest":"sha256:ae69abc4498051cd8601fde516bdd2b97757baa8008148b515c4f878ecf198f1","observation_id":"74c9e1e0-4da9-44ea-9868-575381d29cbc","resolution":{"observed_at":"2026-08-11T23:56:00.457197Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:56:00.460993Z","title":"A formulation of the simple theory of types.Journal of Symbolic Logic, 5:56–68, 1940","venue":null,"work_id":null,"year":1940},"citing_paper":{"arxiv_id":"2412.02091","last_updated":"2025-04-13T01:25:54Z","snapshot_observed_at":"2026-08-13T00:46:41.317824Z","submitted_at":"2024-12-03T02:22:55Z","title":"The Problem of Social Cost in Multi-Agent General Reinforcement Learning: Survey and Synthesis","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-11T23:56:00.460993Z"},"links":{"citing_paper":"/paper/2412.02091"},"observation_digest":"sha256:334846dc5b8b4d1eff12854c1f3d084589a68283d9f263989dff1a41a4e3a94a","observation_id":"af3fdfba-3f9a-435e-ad48-fffda0e7bbe1","resolution":{"observed_at":"2026-08-11T23:56:00.460993Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:56:00.465002Z","title":"The problem of social cost.Journal of Law and Economics, 3(1):1–44, 1960","venue":null,"work_id":null,"year":1960},"citing_paper":{"arxiv_id":"2412.02091","last_updated":"2025-04-13T01:25:54Z","snapshot_observed_at":"2026-08-13T00:46:41.317824Z","submitted_at":"2024-12-03T02:22:55Z","title":"The Problem of Social Cost in Multi-Agent General Reinforcement Learning: Survey and Synthesis","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-11T23:56:00.465002Z"},"links":{"citing_paper":"/paper/2412.02091"},"observation_digest":"sha256:9e1132271db95ef4e01b10205f13759e3f05865f169738397786a2150bca0c46","observation_id":"9e51077a-1b86-4b7d-88ba-9b1fe2b78c11","resolution":{"observed_at":"2026-08-11T23:56:00.465002Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:56:00.469204Z","title":"The Firm, The Market, and The Law","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2412.02091","last_updated":"2025-04-13T01:25:54Z","snapshot_observed_at":"2026-08-13T00:46:41.317824Z","submitted_at":"2024-12-03T02:22:55Z","title":"The Problem of Social Cost in Multi-Agent General Reinforcement Learning: Survey and Synthesis","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-11T23:56:00.469204Z"},"links":{"citing_paper":"/paper/2412.02091"},"observation_digest":"sha256:e6852ee895023ff49bef22f16052775c75aabb5d51bd65b9cf34e4fb8d4482c9","observation_id":"bad48d59-e536-4348-9187-905218dc4bb2","resolution":{"observed_at":"2026-08-11T23:56:00.469204Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:56:00.473652Z","title":"Law for the platform economy.UCDL Rev., 51:133, 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2412.02091","last_updated":"2025-04-13T01:25:54Z","snapshot_observed_at":"2026-08-13T00:46:41.317824Z","submitted_at":"2024-12-03T02:22:55Z","title":"The Problem of Social Cost in Multi-Agent General Reinforcement Learning: Survey and Synthesis","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-11T23:56:00.473652Z"},"links":{"citing_paper":"/paper/2412.02091"},"observation_digest":"sha256:8a25fe7a1735dbcd1aa8c92d433292af3fb1d71a9abb0842314586a7bc2adf77","observation_id":"14d07d0f-4d7c-4348-b4eb-20bdda64d7c2","resolution":{"observed_at":"2026-08-11T23:56:00.473652Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.10271","last_updated":"2024-06-04T14:34:38Z","snapshot_observed_at":"2026-08-13T00:29:25.167949Z","submitted_at":"2024-04-16T03:59:33Z","title":"Social Choice Should Guide AI Alignment in Dealing with Diverse Human Feedback","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.10271","snapshot_observed_at":"2026-08-11T23:56:00.477796Z","title":"Holliday, Bob M","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.02091","last_updated":"2025-04-13T01:25:54Z","snapshot_observed_at":"2026-08-13T00:46:41.317824Z","submitted_at":"2024-12-03T02:22:55Z","title":"The Problem of Social Cost in Multi-Agent General Reinforcement Learning: Survey and Synthesis","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-11T23:56:00.477796Z"},"links":{"cited_paper":"/paper/2404.10271","citing_paper":"/paper/2412.02091"},"observation_digest":"sha256:797d3599b8cd92e49f014732bc73ae1a3c240f0b5cbfbaa80f83d588bc6dbc18","observation_id":"9b1b5f03-b322-4923-9db5-96ade8787ba7","resolution":{"observed_at":"2026-08-11T23:56:00.477796Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:56:00.482424Z","title":"Cambridge University Press, 1996","venue":null,"work_id":null,"year":1996},"citing_paper":{"arxiv_id":"2412.02091","last_updated":"2025-04-13T01:25:54Z","snapshot_observed_at":"2026-08-13T00:46:41.317824Z","submitted_at":"2024-12-03T02:22:55Z","title":"The Problem of Social Cost in Multi-Agent General Reinforcement Learning: Survey and Synthesis","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-11T23:56:00.482424Z"},"links":{"citing_paper":"/paper/2412.02091"},"observation_digest":"sha256:9df6982fc470fee7a73f2d163dcd9db5312cf7218bb54855d71f19d4430889c7","observation_id":"1040dfd4-fb2e-47d2-b49c-f86e17fec938","resolution":{"observed_at":"2026-08-11T23:56:00.482424Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:56:00.487015Z","title":"A collusion-proof dynamic mechanism.SSRN, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.02091","last_updated":"2025-04-13T01:25:54Z","snapshot_observed_at":"2026-08-13T00:46:41.317824Z","submitted_at":"2024-12-03T02:22:55Z","title":"The Problem of Social Cost in Multi-Agent General Reinforcement Learning: Survey and Synthesis","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-11T23:56:00.487015Z"},"links":{"citing_paper":"/paper/2412.02091"},"observation_digest":"sha256:0e19527bd90c647d7f266946377ea55cd642bc0b8b1ff030cdf5f39703f58d3c","observation_id":"dfe1b177-94ed-4836-bf51-1bf57c9e3842","resolution":{"observed_at":"2026-08-11T23:56:00.487015Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:56:00.490732Z","title":"From external to swap regret 2.0: An efficient reduction for large action spaces","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.02091","last_updated":"2025-04-13T01:25:54Z","snapshot_observed_at":"2026-08-13T00:46:41.317824Z","submitted_at":"2024-12-03T02:22:55Z","title":"The Problem of Social Cost in Multi-Agent General Reinforcement Learning: Survey and Synthesis","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-11T23:56:00.490732Z"},"links":{"citing_paper":"/paper/2412.02091"},"observation_digest":"sha256:24a9c279edc8672d02597ea05fd357b49f103e0b2c0fbf3dbac474c75c165c68","observation_id":"aeb00fe9-64d9-4d83-ba29-e0b6742b049b","resolution":{"observed_at":"2026-08-11T23:56:00.490732Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:56:00.494693Z","title":"Logical and relational learning","venue":null,"work_id":null,"year":2008},"citing_paper":{"arxiv_id":"2412.02091","last_updated":"2025-04-13T01:25:54Z","snapshot_observed_at":"2026-08-13T00:46:41.317824Z","submitted_at":"2024-12-03T02:22:55Z","title":"The Problem of Social Cost in Multi-Agent General Reinforcement Learning: Survey and Synthesis","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-11T23:56:00.494693Z"},"links":{"citing_paper":"/paper/2412.02091"},"observation_digest":"sha256:9bbc15e8c214dc05a3bdbf8c0035b2b8a909ed458595c59bdb68ad527064ae63","observation_id":"21e31179-4665-401c-a72c-6e029b107196","resolution":{"observed_at":"2026-08-11T23:56:00.494693Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:56:00.498928Z","title":"The algorithmic foundations of differ- ential privacy.Found","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2412.02091","last_updated":"2025-04-13T01:25:54Z","snapshot_observed_at":"2026-08-13T00:46:41.317824Z","submitted_at":"2024-12-03T02:22:55Z","title":"The Problem of Social Cost in Multi-Agent General Reinforcement Learning: Survey and Synthesis","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-11T23:56:00.498928Z"},"links":{"citing_paper":"/paper/2412.02091"},"observation_digest":"sha256:1b645615edfd50f2e8f188189099e261e2374a8d92ecf5736185eb54781deaa9","observation_id":"dd52d47f-66f4-4baa-b6c7-654cc86ef84e","resolution":{"observed_at":"2026-08-11T23:56:00.498928Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:56:00.502610Z","title":"Relational reinforce- ment learning","venue":null,"work_id":null,"year":2001},"citing_paper":{"arxiv_id":"2412.02091","last_updated":"2025-04-13T01:25:54Z","snapshot_observed_at":"2026-08-13T00:46:41.317824Z","submitted_at":"2024-12-03T02:22:55Z","title":"The Problem of Social Cost in Multi-Agent General Reinforcement Learning: Survey and Synthesis","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-11T23:56:00.502610Z"},"links":{"citing_paper":"/paper/2412.02091"},"observation_digest":"sha256:0085a3fc360cc6104d678cadcf42c85130b8cb8b12dc70c39e388fdb96f02b84","observation_id":"38e0b50d-1752-47d5-9fc5-08256f631efa","resolution":{"observed_at":"2026-08-11T23:56:00.502610Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:56:00.506290Z","title":"Matchmakers: the new economics of multisided platforms","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2412.02091","last_updated":"2025-04-13T01:25:54Z","snapshot_observed_at":"2026-08-13T00:46:41.317824Z","submitted_at":"2024-12-03T02:22:55Z","title":"The Problem of Social Cost in Multi-Agent General Reinforcement Learning: Survey and Synthesis","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-11T23:56:00.506290Z"},"links":{"citing_paper":"/paper/2412.02091"},"observation_digest":"sha256:0e582ac0cf6c60328a905d45409bed23152870b324735811351893a710bee3f9","observation_id":"13ff3370-8792-4dde-bf84-71fa79b160a6","resolution":{"observed_at":"2026-08-11T23:56:00.506290Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:56:00.510011Z","title":"Reward tampering problems and solutions in reinforcement learning: A causal influence diagram perspective.Synthese, 198(Suppl 27):6435–6467, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.02091","last_updated":"2025-04-13T01:25:54Z","snapshot_observed_at":"2026-08-13T00:46:41.317824Z","submitted_at":"2024-12-03T02:22:55Z","title":"The Problem of Social Cost in Multi-Agent General Reinforcement Learning: Survey and Synthesis","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-11T23:56:00.510011Z"},"links":{"citing_paper":"/paper/2412.02091"},"observation_digest":"sha256:744f6f31b632f743986032d41bad9fda527b233f189a873c18afd5df67674da8","observation_id":"eb6ba134-f45b-491a-bc13-78baf0cc78a4","resolution":{"observed_at":"2026-08-11T23:56:00.510011Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:56:00.513785Z","title":"Re- inforcement learning with a corrupted reward channel","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2412.02091","last_updated":"2025-04-13T01:25:54Z","snapshot_observed_at":"2026-08-13T00:46:41.317824Z","submitted_at":"2024-12-03T02:22:55Z","title":"The Problem of Social Cost in Multi-Agent General Reinforcement Learning: Survey and Synthesis","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-11T23:56:00.513785Z"},"links":{"citing_paper":"/paper/2412.02091"},"observation_digest":"sha256:8b4d3186dad03d9690d72877ef42d60431c56b515b6a7c2c288b11e9aeaebdda","observation_id":"4d6a5807-2c83-40d2-88cc-b473e0a49b8d","resolution":{"observed_at":"2026-08-11T23:56:00.513785Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:56:00.517607Z","title":"AGI safety literature review","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2412.02091","last_updated":"2025-04-13T01:25:54Z","snapshot_observed_at":"2026-08-13T00:46:41.317824Z","submitted_at":"2024-12-03T02:22:55Z","title":"The Problem of Social Cost in Multi-Agent General Reinforcement Learning: Survey and Synthesis","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-11T23:56:00.517607Z"},"links":{"citing_paper":"/paper/2412.02091"},"observation_digest":"sha256:dd503f2859f3a2432940df046e3c7be7c9f39233ad7e2278636e8d77b94990fa","observation_id":"f2698ef8-3976-4ce2-919c-ab6b274e234f","resolution":{"observed_at":"2026-08-11T23:56:00.517607Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:56:00.521276Z","title":"Reflective or- acles: A foundation for game theory in artificial intelligence","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2412.02091","last_updated":"2025-04-13T01:25:54Z","snapshot_observed_at":"2026-08-13T00:46:41.317824Z","submitted_at":"2024-12-03T02:22:55Z","title":"The Problem of Social Cost in Multi-Agent General Reinforcement Learning: Survey and Synthesis","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-11T23:56:00.521276Z"},"links":{"citing_paper":"/paper/2412.02091"},"observation_digest":"sha256:c57e658d037f29ea1a67943633426823b1dfd2d382e13115f5a305226a0a1ae1","observation_id":"6d12efec-3c2a-482d-a66d-65f02b08094a","resolution":{"observed_at":"2026-08-11T23:56:00.521276Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:56:00.524751Z","title":null,"venue":null,"work_id":null,"year":2008},"citing_paper":{"arxiv_id":"2412.02091","last_updated":"2025-04-13T01:25:54Z","snapshot_observed_at":"2026-08-13T00:46:41.317824Z","submitted_at":"2024-12-03T02:22:55Z","title":"The Problem of Social Cost in Multi-Agent General Reinforcement Learning: Survey and Synthesis","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-11T23:56:00.524751Z"},"links":{"citing_paper":"/paper/2412.02091"},"observation_digest":"sha256:d1992504021c403811d6b9f4df6a702793fee127c735030ca729b195698d733b","observation_id":"af5359bf-0782-4a28-9534-4ea34a1a7360","resolution":{"observed_at":"2026-08-11T23:56:00.524751Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:56:00.528481Z","title":"Economicsofoilrefining","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.02091","last_updated":"2025-04-13T01:25:54Z","snapshot_observed_at":"2026-08-13T00:46:41.317824Z","submitted_at":"2024-12-03T02:22:55Z","title":"The Problem of Social Cost in Multi-Agent General Reinforcement Learning: Survey and Synthesis","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-11T23:56:00.528481Z"},"links":{"citing_paper":"/paper/2412.02091"},"observation_digest":"sha256:2c662a9665beff8de67029befd27bb60074de40e9fecba068d3ba12c50b6cc20","observation_id":"89de71b5-c4ab-48e9-bd2d-400ce6c7618b","resolution":{"observed_at":"2026-08-11T23:56:00.528481Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:56:00.532269Z","title":"Calibrated learning and correlated equilibrium","venue":null,"work_id":null,"year":1997},"citing_paper":{"arxiv_id":"2412.02091","last_updated":"2025-04-13T01:25:54Z","snapshot_observed_at":"2026-08-13T00:46:41.317824Z","submitted_at":"2024-12-03T02:22:55Z","title":"The Problem of Social Cost in Multi-Agent General Reinforcement Learning: Survey and Synthesis","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-11T23:56:00.532269Z"},"links":{"citing_paper":"/paper/2412.02091"},"observation_digest":"sha256:2f546b7455fea94ad31fff18d36e6adc33327c06e762b26ea672cc17a9d530d9","observation_id":"f806c2e4-c365-4690-8c6b-c00a10868aba","resolution":{"observed_at":"2026-08-11T23:56:00.532269Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:56:00.536357Z","title":"A decision-theoretic generalization of on-line learning and an application to boosting.Journal of Computer and System Sciences, 55(1):119–139, 1997","venue":null,"work_id":null,"year":1997},"citing_paper":{"arxiv_id":"2412.02091","last_updated":"2025-04-13T01:25:54Z","snapshot_observed_at":"2026-08-13T00:46:41.317824Z","submitted_at":"2024-12-03T02:22:55Z","title":"The Problem of Social Cost in Multi-Agent General Reinforcement Learning: Survey and Synthesis","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-11T23:56:00.536357Z"},"links":{"citing_paper":"/paper/2412.02091"},"observation_digest":"sha256:0f3c3d6365e73c51904f9758eaca69cba2ec616bec3cdf8db9f46dd0c50f7c3e","observation_id":"4f2752aa-76e0-415e-b201-1bd62ed557e8","resolution":{"observed_at":"2026-08-11T23:56:00.536357Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:56:00.540211Z","title":"Schapire, Yoram Singer, and Manfred K","venue":null,"work_id":null,"year":1997},"citing_paper":{"arxiv_id":"2412.02091","last_updated":"2025-04-13T01:25:54Z","snapshot_observed_at":"2026-08-13T00:46:41.317824Z","submitted_at":"2024-12-03T02:22:55Z","title":"The Problem of Social Cost in Multi-Agent General Reinforcement Learning: Survey and Synthesis","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-11T23:56:00.540211Z"},"links":{"citing_paper":"/paper/2412.02091"},"observation_digest":"sha256:7c799b604898ff6372427f6ec6b15a1507cc8ee03e9d522e90e217095a36b698","observation_id":"b0771398-efea-48b1-b9d7-531e99b07939","resolution":{"observed_at":"2026-08-11T23:56:00.540211Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:56:00.544224Z","title":"The rationality of quali- fied lotteries","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.02091","last_updated":"2025-04-13T01:25:54Z","snapshot_observed_at":"2026-08-13T00:46:41.317824Z","submitted_at":"2024-12-03T02:22:55Z","title":"The Problem of Social Cost in Multi-Agent General Reinforcement Learning: Survey and Synthesis","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-11T23:56:00.544224Z"},"links":{"citing_paper":"/paper/2412.02091"},"observation_digest":"sha256:d34929045e026f6affa64057b10b423717bc6f4530e506d2e6e801776c0699eb","observation_id":"734e2856-1e38-410c-a609-1098d2f6a77a","resolution":{"observed_at":"2026-08-11T23:56:00.544224Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:56:00.548657Z","title":"MIT press, 1998","venue":null,"work_id":null,"year":1998},"citing_paper":{"arxiv_id":"2412.02091","last_updated":"2025-04-13T01:25:54Z","snapshot_observed_at":"2026-08-13T00:46:41.317824Z","submitted_at":"2024-12-03T02:22:55Z","title":"The Problem of Social Cost in Multi-Agent General Reinforcement Learning: Survey and Synthesis","version":2},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-11T23:56:00.548657Z"},"links":{"citing_paper":"/paper/2412.02091"},"observation_digest":"sha256:9061202b375189eb1f7bbaddf8e986cd8d5a1ede8fce34baf1200d12fa9e8c67","observation_id":"b6f5f842-092b-46a6-9378-6393f88afd31","resolution":{"observed_at":"2026-08-11T23:56:00.548657Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:56:00.552194Z","title":"Artificial intelligence, values, and alignment.Minds and Machines, 30(3):411–437, 2020","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.02091","last_updated":"2025-04-13T01:25:54Z","snapshot_observed_at":"2026-08-13T00:46:41.317824Z","submitted_at":"2024-12-03T02:22:55Z","title":"The Problem of Social Cost in Multi-Agent General Reinforcement Learning: Survey and Synthesis","version":2},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-11T23:56:00.552194Z"},"links":{"citing_paper":"/paper/2412.02091"},"observation_digest":"sha256:6921faecc15b5c8683bf9db926d97bccbdd6d737770fa2eb0ceff8c4b16192d5","observation_id":"de4b3e6e-966d-4059-ad85-ee3b97f48593","resolution":{"observed_at":"2026-08-11T23:56:00.552194Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:56:00.556143Z","title":"Bayesian reinforcement learning: A survey","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2412.02091","last_updated":"2025-04-13T01:25:54Z","snapshot_observed_at":"2026-08-13T00:46:41.317824Z","submitted_at":"2024-12-03T02:22:55Z","title":"The Problem of Social Cost in Multi-Agent General Reinforcement Learning: Survey and Synthesis","version":2},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-11T23:56:00.556143Z"},"links":{"citing_paper":"/paper/2412.02091"},"observation_digest":"sha256:ae94fc88ce66de51437886523730946030882a58090c5969685ef1088aff04bd","observation_id":"1f28048b-f2f6-4fb3-b9a2-ec7be43d61dd","resolution":{"observed_at":"2026-08-11T23:56:00.556143Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:56:00.560057Z","title":"Graph embedding techniques, applica- tions, and performance: A survey.Knowledge-Based Systems, 151:78–94, 2018","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2412.02091","last_updated":"2025-04-13T01:25:54Z","snapshot_observed_at":"2026-08-13T00:46:41.317824Z","submitted_at":"2024-12-03T02:22:55Z","title":"The Problem of Social Cost in Multi-Agent General Reinforcement Learning: Survey and Synthesis","version":2},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-11T23:56:00.560057Z"},"links":{"citing_paper":"/paper/2412.02091"},"observation_digest":"sha256:95c7fbb5ef4f2b60d222f896360e81aa723f64e97b6c77bafbde3eaba81ffc57","observation_id":"7f2751a5-8bef-451a-84d0-5efda07364c3","resolution":{"observed_at":"2026-08-11T23:56:00.560057Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:56:00.563841Z","title":"Inconsistency of Bayesian in- ference for misspecified linear models, and a proposal for repairing it","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2412.02091","last_updated":"2025-04-13T01:25:54Z","snapshot_observed_at":"2026-08-13T00:46:41.317824Z","submitted_at":"2024-12-03T02:22:55Z","title":"The Problem of Social Cost in Multi-Agent General Reinforcement Learning: Survey and Synthesis","version":2},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-11T23:56:00.563841Z"},"links":{"citing_paper":"/paper/2412.02091"},"observation_digest":"sha256:fa8d39ab0906814f1aed0208f30bd1d9c374d452606f5ef36ea43d022eaa3631","observation_id":"3b7274ae-7134-4432-adfb-6fbd1d2749ff","resolution":{"observed_at":"2026-08-11T23:56:00.563841Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:56:00.568217Z","title":"The off-switch game","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2412.02091","last_updated":"2025-04-13T01:25:54Z","snapshot_observed_at":"2026-08-13T00:46:41.317824Z","submitted_at":"2024-12-03T02:22:55Z","title":"The Problem of Social Cost in Multi-Agent General Reinforcement Learning: Survey and Synthesis","version":2},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-11T23:56:00.568217Z"},"links":{"citing_paper":"/paper/2412.02091"},"observation_digest":"sha256:e153da7e35be436f1ccdeb72ce1903493621d50452a47bee6c09c01d326c131a","observation_id":"32d209c2-436b-48a8-bb73-4da9b1458af9","resolution":{"observed_at":"2026-08-11T23:56:00.568217Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:56:00.572056Z","title":"Cooperative inverse reinforcement learning.Advances in Neural Informa- tion Processing Systems, 29, 2016","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2412.02091","last_updated":"2025-04-13T01:25:54Z","snapshot_observed_at":"2026-08-13T00:46:41.317824Z","submitted_at":"2024-12-03T02:22:55Z","title":"The Problem of Social Cost in Multi-Agent General Reinforcement Learning: Survey and Synthesis","version":2},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-11T23:56:00.572056Z"},"links":{"citing_paper":"/paper/2412.02091"},"observation_digest":"sha256:d976fb263adebe349e5997574010ad3c1d8e9d0e4c79507a36b8eec616df8e4c","observation_id":"4ab5d993-fd02-4ff2-bef8-71e847ea15de","resolution":{"observed_at":"2026-08-11T23:56:00.572056Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:56:00.576001Z","title":"The tragedy of the commons","venue":null,"work_id":null,"year":1968},"citing_paper":{"arxiv_id":"2412.02091","last_updated":"2025-04-13T01:25:54Z","snapshot_observed_at":"2026-08-13T00:46:41.317824Z","submitted_at":"2024-12-03T02:22:55Z","title":"The Problem of Social Cost in Multi-Agent General Reinforcement Learning: Survey and Synthesis","version":2},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-11T23:56:00.576001Z"},"links":{"citing_paper":"/paper/2412.02091"},"observation_digest":"sha256:8aff589fb098503492d78006aeb6d994a0141cb17c61ce4a2be66c49f836e666","observation_id":"3de8e233-2243-4902-9b2b-afabaf3aae6b","resolution":{"observed_at":"2026-08-11T23:56:00.576001Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:56:00.579850Z","title":"Completeness in the theory of types.Journal of Symbolic Logic, 15(2):81–91, 1950","venue":null,"work_id":null,"year":1950},"citing_paper":{"arxiv_id":"2412.02091","last_updated":"2025-04-13T01:25:54Z","snapshot_observed_at":"2026-08-13T00:46:41.317824Z","submitted_at":"2024-12-03T02:22:55Z","title":"The Problem of Social Cost in Multi-Agent General Reinforcement Learning: Survey and Synthesis","version":2},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-11T23:56:00.579850Z"},"links":{"citing_paper":"/paper/2412.02091"},"observation_digest":"sha256:78d3d3b9554dfca1f6b071c4d81298cefafc80f6b74c2e11b7eaffcb0ef93765","observation_id":"d0089685-5f65-4ff5-ac89-3132df8e7545","resolution":{"observed_at":"2026-08-11T23:56:00.579850Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:56:00.583839Z","title":"Tracking the best expert.Ma- chine learning, 32(2):151–178, 1998","venue":null,"work_id":null,"year":1998},"citing_paper":{"arxiv_id":"2412.02091","last_updated":"2025-04-13T01:25:54Z","snapshot_observed_at":"2026-08-13T00:46:41.317824Z","submitted_at":"2024-12-03T02:22:55Z","title":"The Problem of Social Cost in Multi-Agent General Reinforcement Learning: Survey and Synthesis","version":2},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-11T23:56:00.583839Z"},"links":{"citing_paper":"/paper/2412.02091"},"observation_digest":"sha256:8ac3f57881b57beaf63c25cee043ec20b1fa74d1d1fcfba5f92d2992411b8df6","observation_id":"241c5f4b-ba30-4405-8efa-f41aa3b0a07f","resolution":{"observed_at":"2026-08-11T23:56:00.583839Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:56:00.587304Z","title":"The many faces of exponentialweightsinonlinelearning","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2412.02091","last_updated":"2025-04-13T01:25:54Z","snapshot_observed_at":"2026-08-13T00:46:41.317824Z","submitted_at":"2024-12-03T02:22:55Z","title":"The Problem of Social Cost in Multi-Agent General Reinforcement Learning: Survey and Synthesis","version":2},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-11T23:56:00.587304Z"},"links":{"citing_paper":"/paper/2412.02091"},"observation_digest":"sha256:b924abe4f254ca2c04f01ae4553ce95570a4333168df839e9d152419fc2a6a8b","observation_id":"1c3e2999-b6e2-4642-be3a-2296dc69c0cc","resolution":{"observed_at":"2026-08-11T23:56:00.587304Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:56:00.591019Z","title":"The exponential mechanism for social welfare: Private, truthful, and nearly optimal","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2412.02091","last_updated":"2025-04-13T01:25:54Z","snapshot_observed_at":"2026-08-13T00:46:41.317824Z","submitted_at":"2024-12-03T02:22:55Z","title":"The Problem of Social Cost in Multi-Agent General Reinforcement Learning: Survey and Synthesis","version":2},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-11T23:56:00.591019Z"},"links":{"citing_paper":"/paper/2412.02091"},"observation_digest":"sha256:b277377f82e1739ad57d692636ea2e6dd29124789611e6081e40ec8caa2d1830","observation_id":"ae6fca03-0fa4-45bf-8a8b-86ed41623d39","resolution":{"observed_at":"2026-08-11T23:56:00.591019Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.04898","last_updated":"2024-07-06T00:02:25Z","snapshot_observed_at":"2026-08-12T23:27:50.424597Z","submitted_at":"2024-07-06T00:02:25Z","title":"Nash Incentive-compatible Online Mechanism Learning via Weakly Differentially Private Online Learning","version":1},"cited_work":{"arxiv_id":"2407.04898","doi":null,"metadata_source":"pith","pith_arxiv_id":"2407.04898","snapshot_observed_at":"2026-08-11T23:56:01.205929Z","title":"Nash Incentive-compatible Online Mechanism Learning via Weakly Differentially Private Online Learning","venue":"cs.GT","work_id":"30fc0bd5-33d6-48ce-898a-6f9193c9ec54","year":2024},"citing_paper":{"arxiv_id":"2412.02091","last_updated":"2025-04-13T01:25:54Z","snapshot_observed_at":"2026-08-13T00:46:41.317824Z","submitted_at":"2024-12-03T02:22:55Z","title":"The Problem of Social Cost in Multi-Agent General Reinforcement Learning: Survey and Synthesis","version":2},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-11T23:56:00.594642Z"},"links":{"cited_paper":"/paper/2407.04898","citing_paper":"/paper/2412.02091"},"observation_digest":"sha256:709b934c277c0307f1a74ebe31fca0f539ca25658b67942d76506039ba31909a","observation_id":"e41b946f-d2a9-4f18-aec3-8b8ba6e923ca","resolution":{"observed_at":"2026-08-11T23:56:01.211238Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:56:00.598968Z","title":"Universal Artificial Intelligence: Sequential Decisions based on Algorithmic Probability","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2412.02091","last_updated":"2025-04-13T01:25:54Z","snapshot_observed_at":"2026-08-13T00:46:41.317824Z","submitted_at":"2024-12-03T02:22:55Z","title":"The Problem of Social Cost in Multi-Agent General Reinforcement Learning: Survey and Synthesis","version":2},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-11T23:56:00.598968Z"},"links":{"citing_paper":"/paper/2412.02091"},"observation_digest":"sha256:2e6ecc4fc47e6d3a0b0b6cc7dab4696423494a200dfbe0190747ef7d91c75b35","observation_id":"d1af85ec-7077-43b8-a0eb-af19d41d7921","resolution":{"observed_at":"2026-08-11T23:56:00.598968Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:56:00.602602Z","title":"Feature reinforcement learning: Part I","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2412.02091","last_updated":"2025-04-13T01:25:54Z","snapshot_observed_at":"2026-08-13T00:46:41.317824Z","submitted_at":"2024-12-03T02:22:55Z","title":"The Problem of Social Cost in Multi-Agent General Reinforcement Learning: Survey and Synthesis","version":2},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-11T23:56:00.602602Z"},"links":{"citing_paper":"/paper/2412.02091"},"observation_digest":"sha256:c0acfde55efa6bf11713984efa6ab84e77d38cd8dc81e3101dcff51df71723d5","observation_id":"b2f60829-63bc-40e4-b756-836d44a65cc0","resolution":{"observed_at":"2026-08-11T23:56:00.602602Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:56:02.175663Z","title":"CRC Press, 2024","venue":null,"work_id":"e7238ef8-9a83-4d63-bc45-a777ae008093","year":2024},"citing_paper":{"arxiv_id":"2412.02091","last_updated":"2025-04-13T01:25:54Z","snapshot_observed_at":"2026-08-13T00:46:41.317824Z","submitted_at":"2024-12-03T02:22:55Z","title":"The Problem of Social Cost in Multi-Agent General Reinforcement Learning: Survey and Synthesis","version":2},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-11T23:56:00.606144Z"},"links":{"citing_paper":"/paper/2412.02091"},"observation_digest":"sha256:2b5b2ca961671101364b02024e07b898af1336c203abd5b4746dc92642285c7b","observation_id":"f2a59516-a8d6-4b10-bfa8-a10c41b4b133","resolution":{"observed_at":"2026-08-11T23:56:02.179729Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.18074","last_updated":"2024-10-07T16:46:42Z","snapshot_observed_at":"2026-08-12T23:14:50.090966Z","submitted_at":"2024-07-25T14:28:58Z","title":"Principal-Agent Reinforcement Learning: Orchestrating AI Agents with Contracts","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.18074","snapshot_observed_at":"2026-08-11T23:56:00.609953Z","title":"Principal-agent reinforcement learning: Orchestrating AI agents with contracts.arXiv preprint arXiv:2407.18074, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.02091","last_updated":"2025-04-13T01:25:54Z","snapshot_observed_at":"2026-08-13T00:46:41.317824Z","submitted_at":"2024-12-03T02:22:55Z","title":"The Problem of Social Cost in Multi-Agent General Reinforcement Learning: Survey and Synthesis","version":2},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-11T23:56:00.609953Z"},"links":{"cited_paper":"/paper/2407.18074","citing_paper":"/paper/2412.02091"},"observation_digest":"sha256:d8ea5ab43613c12eccf3fd7710caf62a98443f6a76c1a2574bb2a194555add25","observation_id":"593c4a24-bc2d-4fd1-b98c-b2ebc05da740","resolution":{"observed_at":"2026-08-11T23:56:00.609953Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:56:02.162976Z","title":"Reward-free exploration for reinforcement learning","venue":null,"work_id":"a862280d-cec3-417a-9bf3-aa4c94a237fe","year":2020},"citing_paper":{"arxiv_id":"2412.02091","last_updated":"2025-04-13T01:25:54Z","snapshot_observed_at":"2026-08-13T00:46:41.317824Z","submitted_at":"2024-12-03T02:22:55Z","title":"The Problem of Social Cost in Multi-Agent General Reinforcement Learning: Survey and Synthesis","version":2},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-11T23:56:00.614314Z"},"links":{"citing_paper":"/paper/2412.02091"},"observation_digest":"sha256:c9be464cb05487dceb0ce450efb7c0739483e88baf9ff7ed77f1ddc4600c304e","observation_id":"dd15f004-c4c4-4f94-85d8-6503d780457d","resolution":{"observed_at":"2026-08-11T23:56:02.167275Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:56:00.618166Z","title":"Provably efficient reinforcement learning with linear function approximation","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.02091","last_updated":"2025-04-13T01:25:54Z","snapshot_observed_at":"2026-08-13T00:46:41.317824Z","submitted_at":"2024-12-03T02:22:55Z","title":"The Problem of Social Cost in Multi-Agent General Reinforcement Learning: Survey and Synthesis","version":2},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-11T23:56:00.618166Z"},"links":{"citing_paper":"/paper/2412.02091"},"observation_digest":"sha256:2a9a6c46a1da83b5fc515b251a670fb05982b8849470f3f5d36160d2ed7767ed","observation_id":"542e3856-66cc-4f4d-82e6-50489218de5c","resolution":{"observed_at":"2026-08-11T23:56:00.618166Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:56:02.143628Z","title":"Rational learning leads to Nash equilib- rium","venue":null,"work_id":"f2b3b9e2-6326-4b5a-b644-7d26317be74f","year":1993},"citing_paper":{"arxiv_id":"2412.02091","last_updated":"2025-04-13T01:25:54Z","snapshot_observed_at":"2026-08-13T00:46:41.317824Z","submitted_at":"2024-12-03T02:22:55Z","title":"The Problem of Social Cost in Multi-Agent General Reinforcement Learning: Survey and Synthesis","version":2},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-11T23:56:00.621863Z"},"links":{"citing_paper":"/paper/2412.02091"},"observation_digest":"sha256:db3028fb1392076c68ae0131cea9381c1db85a66731c823bffccfe9d8c0df331","observation_id":"1e1afb36-a4b4-488e-a518-f999dd481eaa","resolution":{"observed_at":"2026-08-11T23:56:02.147664Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:56:02.132944Z","title":"Gonzalez, Michael I","venue":null,"work_id":"91037181-dd7c-4e9d-9887-5dee237a87e2","year":2023},"citing_paper":{"arxiv_id":"2412.02091","last_updated":"2025-04-13T01:25:54Z","snapshot_observed_at":"2026-08-13T00:46:41.317824Z","submitted_at":"2024-12-03T02:22:55Z","title":"The Problem of Social Cost in Multi-Agent General Reinforcement Learning: Survey and Synthesis","version":2},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-11T23:56:00.625666Z"},"links":{"citing_paper":"/paper/2412.02091"},"observation_digest":"sha256:da716a0ff084332d7d4349ff62892aee9249246f301ee0fc64826ec0a0107102","observation_id":"3ced9075-2192-4b19-8c01-e9b52668bcca","resolution":{"observed_at":"2026-08-11T23:56:02.136678Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:56:00.629715Z","title":"A survey of reinforcement learning from human feedback.arXiv:2312.14925, 10, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.02091","last_updated":"2025-04-13T01:25:54Z","snapshot_observed_at":"2026-08-13T00:46:41.317824Z","submitted_at":"2024-12-03T02:22:55Z","title":"The Problem of Social Cost in Multi-Agent General Reinforcement Learning: Survey and Synthesis","version":2},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-11T23:56:00.629715Z"},"links":{"citing_paper":"/paper/2412.02091"},"observation_digest":"sha256:88b136d74db0fdc2972b415b6688aae17301b6ca46804399b256743076acfceb","observation_id":"a88ebf50-8c57-418b-8b0a-3a91b5bc9d8b","resolution":{"observed_at":"2026-08-11T23:56:00.629715Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:56:02.121112Z","title":"Mech- anism design in large games: Incentives and privacy","venue":null,"work_id":"0f3a37c6-4640-4cb7-80c1-b73be8540bed","year":2014},"citing_paper":{"arxiv_id":"2412.02091","last_updated":"2025-04-13T01:25:54Z","snapshot_observed_at":"2026-08-13T00:46:41.317824Z","submitted_at":"2024-12-03T02:22:55Z","title":"The Problem of Social Cost in Multi-Agent General Reinforcement Learning: Survey and Synthesis","version":2},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-11T23:56:00.633577Z"},"links":{"citing_paper":"/paper/2412.02091"},"observation_digest":"sha256:3a60c450f2d9b322431405722f12f094790059a6f26a72c8172c0cf657416c3b","observation_id":"f0429409-8cec-4ad5-9f34-5312f0368b9f","resolution":{"observed_at":"2026-08-11T23:56:02.125025Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:56:02.108084Z","title":"The rise of the platform economy","venue":null,"work_id":"20b33c76-4b74-4df9-98f4-f6eb39e59c2a","year":2016},"citing_paper":{"arxiv_id":"2412.02091","last_updated":"2025-04-13T01:25:54Z","snapshot_observed_at":"2026-08-13T00:46:41.317824Z","submitted_at":"2024-12-03T02:22:55Z","title":"The Problem of Social Cost in Multi-Agent General Reinforcement Learning: Survey and Synthesis","version":2},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-11T23:56:00.637394Z"},"links":{"citing_paper":"/paper/2412.02091"},"observation_digest":"sha256:cfe6b4b8e8df408314c28f83835387c7f02094d937a12a9cdd46dfbad5d8b5d1","observation_id":"6057d7ed-cf49-4855-9040-50dfabe934bf","resolution":{"observed_at":"2026-08-11T23:56:02.112429Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:56:02.095591Z","title":"Bellman goes relational","venue":null,"work_id":"52a1530c-df4b-4be6-8397-745df6425632","year":2004},"citing_paper":{"arxiv_id":"2412.02091","last_updated":"2025-04-13T01:25:54Z","snapshot_observed_at":"2026-08-13T00:46:41.317824Z","submitted_at":"2024-12-03T02:22:55Z","title":"The Problem of Social Cost in Multi-Agent General Reinforcement Learning: Survey and Synthesis","version":2},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-11T23:56:00.641048Z"},"links":{"citing_paper":"/paper/2412.02091"},"observation_digest":"sha256:860b1ac37bdea86f9ec1ff90baf9bc4d1b696fb0bc6b93f97f515e9a55705468","observation_id":"40ec5578-7771-41e2-bb94-0d228b314f3d","resolution":{"observed_at":"2026-08-11T23:56:02.099661Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:56:02.082544Z","title":"Bandit based monte-carlo planning","venue":null,"work_id":"17a2dc89-1cda-4a39-a3b1-788520030575","year":2006},"citing_paper":{"arxiv_id":"2412.02091","last_updated":"2025-04-13T01:25:54Z","snapshot_observed_at":"2026-08-13T00:46:41.317824Z","submitted_at":"2024-12-03T02:22:55Z","title":"The Problem of Social Cost in Multi-Agent General Reinforcement Learning: Survey and Synthesis","version":2},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-08-11T23:56:00.644619Z"},"links":{"citing_paper":"/paper/2412.02091"},"observation_digest":"sha256:7096b9a074c15b84ebc2edcc0a4dc9b9274b958239d5b955e15e0fb05d627ab6","observation_id":"f534922c-bb39-4664-9de3-d49fe285958d","resolution":{"observed_at":"2026-08-11T23:56:02.086990Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:56:00.648645Z","title":"Paying to do better: Games with payments between learning agents.arXiv:2405.20880, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.02091","last_updated":"2025-04-13T01:25:54Z","snapshot_observed_at":"2026-08-13T00:46:41.317824Z","submitted_at":"2024-12-03T02:22:55Z","title":"The Problem of Social Cost in Multi-Agent General Reinforcement Learning: Survey and Synthesis","version":2},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-08-11T23:56:00.648645Z"},"links":{"citing_paper":"/paper/2412.02091"},"observation_digest":"sha256:8dc6c545cd6e78139e1233c80c80f24b708f31baaa578f67392ff81181951154","observation_id":"26c6102a-c9ae-43d8-8244-5ddc4813b053","resolution":{"observed_at":"2026-08-11T23:56:00.648645Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:56:02.069514Z","title":"Universal codes from switching strategies","venue":null,"work_id":"f6d21948-3eb5-4f3d-bcd2-a648554a7ef6","year":2013},"citing_paper":{"arxiv_id":"2412.02091","last_updated":"2025-04-13T01:25:54Z","snapshot_observed_at":"2026-08-13T00:46:41.317824Z","submitted_at":"2024-12-03T02:22:55Z","title":"The Problem of Social Cost in Multi-Agent General Reinforcement Learning: Survey and Synthesis","version":2},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-08-11T23:56:00.652458Z"},"links":{"citing_paper":"/paper/2412.02091"},"observation_digest":"sha256:d124b39843fba9f81fcd11fbf9e563ed11bfcab44a4e7dd11065b17e269a8c8e","observation_id":"e276eed5-bc61-4161-b383-cbbf2093d810","resolution":{"observed_at":"2026-08-11T23:56:02.073826Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:56:02.056970Z","title":"Krichevsky and V","venue":null,"work_id":"ce1da1c0-d418-4560-8dba-ec699ad48371","year":2006},"citing_paper":{"arxiv_id":"2412.02091","last_updated":"2025-04-13T01:25:54Z","snapshot_observed_at":"2026-08-13T00:46:41.317824Z","submitted_at":"2024-12-03T02:22:55Z","title":"The Problem of Social Cost in Multi-Agent General Reinforcement Learning: Survey and Synthesis","version":2},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-08-11T23:56:00.656358Z"},"links":{"citing_paper":"/paper/2412.02091"},"observation_digest":"sha256:26b944848beaf33a9c952a94833485ed5226ecad6b5b8886c4ebc73087a71646","observation_id":"456e641f-cee3-4c73-99f1-159d7fbdbec3","resolution":{"observed_at":"2026-08-11T23:56:02.061464Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:56:02.044051Z","title":"A unified game-theoretic approach to multiagent reinforcement learning.Advances in Neural Information Processing Systems, 30, 2017","venue":null,"work_id":"db309515-ef01-4389-9a62-f5914d0b7c0f","year":2017},"citing_paper":{"arxiv_id":"2412.02091","last_updated":"2025-04-13T01:25:54Z","snapshot_observed_at":"2026-08-13T00:46:41.317824Z","submitted_at":"2024-12-03T02:22:55Z","title":"The Problem of Social Cost in Multi-Agent General Reinforcement Learning: Survey and Synthesis","version":2},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-08-11T23:56:00.660262Z"},"links":{"citing_paper":"/paper/2412.02091"},"observation_digest":"sha256:a809ff54f8fe9e46d545c87ca7f5ca2bec1507f3538028a6550b0706f66e524f","observation_id":"cb36b20f-8d48-4205-bf24-ad770218ee0a","resolution":{"observed_at":"2026-08-11T23:56:02.048431Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:56:00.663954Z","title":"Bandit Algorithms","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.02091","last_updated":"2025-04-13T01:25:54Z","snapshot_observed_at":"2026-08-13T00:46:41.317824Z","submitted_at":"2024-12-03T02:22:55Z","title":"The Problem of Social Cost in Multi-Agent General Reinforcement Learning: Survey and Synthesis","version":2},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-08-11T23:56:00.663954Z"},"links":{"citing_paper":"/paper/2412.02091"},"observation_digest":"sha256:8054e9b6f0a7403e1701a12e8dc4a9c133a6f796103270bdb5ad8044a2eecf5a","observation_id":"c8c05919-8918-4a19-a339-a7a62b1035c1","resolution":{"observed_at":"2026-08-11T23:56:00.663954Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:56:02.020152Z","title":"Thomp- son sampling is asymptotically optimal in general environments","venue":null,"work_id":"a8884936-52cf-456e-af82-852217ab2897","year":2016},"citing_paper":{"arxiv_id":"2412.02091","last_updated":"2025-04-13T01:25:54Z","snapshot_observed_at":"2026-08-13T00:46:41.317824Z","submitted_at":"2024-12-03T02:22:55Z","title":"The Problem of Social Cost in Multi-Agent General Reinforcement Learning: Survey and Synthesis","version":2},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-08-11T23:56:00.667799Z"},"links":{"citing_paper":"/paper/2412.02091"},"observation_digest":"sha256:ea112da25e8d19c704eb722de471c98069b14ea746f4fac6f3adf12c15682883","observation_id":"25a13960-66f4-4ec6-bcb6-736074a9099c","resolution":{"observed_at":"2026-08-11T23:56:02.024580Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:56:02.007490Z","title":"A formal solution to the grain of truth problem","venue":null,"work_id":"72a317e1-6685-4408-9e3a-2beb1c4d02f5","year":2016},"citing_paper":{"arxiv_id":"2412.02091","last_updated":"2025-04-13T01:25:54Z","snapshot_observed_at":"2026-08-13T00:46:41.317824Z","submitted_at":"2024-12-03T02:22:55Z","title":"The Problem of Social Cost in Multi-Agent General Reinforcement Learning: Survey and Synthesis","version":2},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-08-11T23:56:00.671607Z"},"links":{"citing_paper":"/paper/2412.02091"},"observation_digest":"sha256:bd165957f3da9d9140cf35e7341848d01aab2d45a168c2047f9103b594e18936","observation_id":"8345c7a4-cec9-4623-9c03-e25ed384c392","resolution":{"observed_at":"2026-08-11T23:56:02.011678Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:56:01.995231Z","title":"Walsh, and Michael L","venue":null,"work_id":"471b44f1-5eb1-4211-9fe2-62f57d038b62","year":2006},"citing_paper":{"arxiv_id":"2412.02091","last_updated":"2025-04-13T01:25:54Z","snapshot_observed_at":"2026-08-13T00:46:41.317824Z","submitted_at":"2024-12-03T02:22:55Z","title":"The Problem of Social Cost in Multi-Agent General Reinforcement Learning: Survey and Synthesis","version":2},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-08-11T23:56:00.675744Z"},"links":{"citing_paper":"/paper/2412.02091"},"observation_digest":"sha256:475f06e2ca8df9d246e0425e41100141488c2a523b72e775ca797e89c750116f","observation_id":"e428798b-4a9b-4b95-87b0-bfaf050d9f62","resolution":{"observed_at":"2026-08-11T23:56:01.999348Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:56:01.982159Z","title":"An Introduction to Kolmogorov Complexity and Its Applications","venue":null,"work_id":"34c94106-bd1f-4b58-b281-4986e4182fa1","year":2019},"citing_paper":{"arxiv_id":"2412.02091","last_updated":"2025-04-13T01:25:54Z","snapshot_observed_at":"2026-08-13T00:46:41.317824Z","submitted_at":"2024-12-03T02:22:55Z","title":"The Problem of Social Cost in Multi-Agent General Reinforcement Learning: Survey and Synthesis","version":2},"reference_index":88,"source":"pdf_text","source_observed_at":"2026-08-11T23:56:00.679584Z"},"links":{"citing_paper":"/paper/2412.02091"},"observation_digest":"sha256:f7619835ea63dfaba091fda0509cc4e7c42bf3ebe8daad825a281c41d6f7a639","observation_id":"1df2304d-fb51-411e-86a1-775d5095c3ed","resolution":{"observed_at":"2026-08-11T23:56:01.986452Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:56:01.971283Z","title":"Markov games as a framework for multi-agent rein- forcement learning","venue":null,"work_id":"75ba0348-a0e1-4aaa-bef4-581379fb5e4e","year":1994},"citing_paper":{"arxiv_id":"2412.02091","last_updated":"2025-04-13T01:25:54Z","snapshot_observed_at":"2026-08-13T00:46:41.317824Z","submitted_at":"2024-12-03T02:22:55Z","title":"The Problem of Social Cost in Multi-Agent General Reinforcement Learning: Survey and Synthesis","version":2},"reference_index":89,"source":"pdf_text","source_observed_at":"2026-08-11T23:56:00.683289Z"},"links":{"citing_paper":"/paper/2412.02091"},"observation_digest":"sha256:432bbec03c17e660177f85364cad2c8009661eb25ddfd7df43cf5accbb5fc331","observation_id":"e20590f9-ba97-4875-880b-7294ab2241d2","resolution":{"observed_at":"2026-08-11T23:56:01.975202Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:56:01.959832Z","title":null,"venue":null,"work_id":"aac05b90-7e19-4aa6-8ca7-b5330099f9f3","year":2003},"citing_paper":{"arxiv_id":"2412.02091","last_updated":"2025-04-13T01:25:54Z","snapshot_observed_at":"2026-08-13T00:46:41.317824Z","submitted_at":"2024-12-03T02:22:55Z","title":"The Problem of Social Cost in Multi-Agent General Reinforcement Learning: Survey and Synthesis","version":2},"reference_index":90,"source":"pdf_text","source_observed_at":"2026-08-11T23:56:00.687209Z"},"links":{"citing_paper":"/paper/2412.02091"},"observation_digest":"sha256:11442f9b2376403ac25d2621da5a3b86e84b13a5e62c707531abcb1a7db8002a","observation_id":"181ee530-d9e1-4ce0-990a-21317afb815d","resolution":{"observed_at":"2026-08-11T23:56:01.963992Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:56:01.948514Z","title":"Lloyd and Kee Siong Ng","venue":null,"work_id":"dbd6de13-e6c3-40e9-8925-753651c324e1","year":2011},"citing_paper":{"arxiv_id":"2412.02091","last_updated":"2025-04-13T01:25:54Z","snapshot_observed_at":"2026-08-13T00:46:41.317824Z","submitted_at":"2024-12-03T02:22:55Z","title":"The Problem of Social Cost in Multi-Agent General Reinforcement Learning: Survey and Synthesis","version":2},"reference_index":91,"source":"pdf_text","source_observed_at":"2026-08-11T23:56:00.691113Z"},"links":{"citing_paper":"/paper/2412.02091"},"observation_digest":"sha256:8e2623fb9228c9f5c3c4e0594530acb12834534dfda8b20488b679e9a2cfc060","observation_id":"a8a56564-3a59-4409-9d80-1c74351f735b","resolution":{"observed_at":"2026-08-11T23:56:01.952311Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:56:01.936641Z","title":"Pes- simism meets VCG: Learning dynamic mechanism design via offline rein- forcement learning","venue":null,"work_id":"73e2b02c-ef9b-44c0-a7cd-340db4375cdb","year":2022},"citing_paper":{"arxiv_id":"2412.02091","last_updated":"2025-04-13T01:25:54Z","snapshot_observed_at":"2026-08-13T00:46:41.317824Z","submitted_at":"2024-12-03T02:22:55Z","title":"The Problem of Social Cost in Multi-Agent General Reinforcement Learning: Survey and Synthesis","version":2},"reference_index":92,"source":"pdf_text","source_observed_at":"2026-08-11T23:56:00.694562Z"},"links":{"citing_paper":"/paper/2412.02091"},"observation_digest":"sha256:e355d5910aa4adfd4fcb8fcbf572dd6eabb0a5f59304f0ca06325d51f420f9fb","observation_id":"13d86ac0-2ee9-4b2b-9153-1e27c224aa40","resolution":{"observed_at":"2026-08-11T23:56:01.940697Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:56:01.924089Z","title":"Mechanism design via differential privacy","venue":null,"work_id":"9e00bbb5-f4d6-4018-a7ae-db3cd94433ff","year":2007},"citing_paper":{"arxiv_id":"2412.02091","last_updated":"2025-04-13T01:25:54Z","snapshot_observed_at":"2026-08-13T00:46:41.317824Z","submitted_at":"2024-12-03T02:22:55Z","title":"The Problem of Social Cost in Multi-Agent General Reinforcement Learning: Survey and Synthesis","version":2},"reference_index":93,"source":"pdf_text","source_observed_at":"2026-08-11T23:56:00.698198Z"},"links":{"citing_paper":"/paper/2412.02091"},"observation_digest":"sha256:4dba092ed965020123b39320ba2c94c8a02aca8afc009dabe3f489d3eca97759","observation_id":"2eb78945-7ed2-4e78-b17c-88f2a9763c59","resolution":{"observed_at":"2026-08-11T23:56:01.928234Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:56:01.912136Z","title":"Kenneth Arrow’s last theorem.The Journal of Mechanism and Institution Design, 9(1):7–11, 2024","venue":null,"work_id":"d0677d3d-280d-4131-87ca-52e8107e7564","year":2024},"citing_paper":{"arxiv_id":"2412.02091","last_updated":"2025-04-13T01:25:54Z","snapshot_observed_at":"2026-08-13T00:46:41.317824Z","submitted_at":"2024-12-03T02:22:55Z","title":"The Problem of Social Cost in Multi-Agent General Reinforcement Learning: Survey and Synthesis","version":2},"reference_index":94,"source":"pdf_text","source_observed_at":"2026-08-11T23:56:00.702062Z"},"links":{"citing_paper":"/paper/2412.02091"},"observation_digest":"sha256:44d8ebe763871386ab6018895df1ad2ee74e7b59c323097e68a3d6606bb361c7","observation_id":"b4fe5859-b4c2-4c27-a59f-862ef65d6c35","resolution":{"observed_at":"2026-08-11T23:56:01.916339Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:56:01.900239Z","title":"Human-level control through deep re- inforcement learning","venue":null,"work_id":"e1d06c47-66ab-4dee-b5d5-9484bc004ab3","year":2015},"citing_paper":{"arxiv_id":"2412.02091","last_updated":"2025-04-13T01:25:54Z","snapshot_observed_at":"2026-08-13T00:46:41.317824Z","submitted_at":"2024-12-03T02:22:55Z","title":"The Problem of Social Cost in Multi-Agent General Reinforcement Learning: Survey and Synthesis","version":2},"reference_index":95,"source":"pdf_text","source_observed_at":"2026-08-11T23:56:00.705819Z"},"links":{"citing_paper":"/paper/2412.02091"},"observation_digest":"sha256:65d488f1fdd82c56a29fdd52020400237dcf609fac4d555d424bfa33bbf014d5","observation_id":"8b8cd9ba-76a8-411e-92a0-51f5eb0b23bd","resolution":{"observed_at":"2026-08-11T23:56:01.904186Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:56:01.886520Z","title":"Efficient tracking of a growing number of experts","venue":null,"work_id":"c07f0b68-8635-40eb-8ba4-77b891d26b87","year":2017},"citing_paper":{"arxiv_id":"2412.02091","last_updated":"2025-04-13T01:25:54Z","snapshot_observed_at":"2026-08-13T00:46:41.317824Z","submitted_at":"2024-12-03T02:22:55Z","title":"The Problem of Social Cost in Multi-Agent General Reinforcement Learning: Survey and Synthesis","version":2},"reference_index":96,"source":"pdf_text","source_observed_at":"2026-08-11T23:56:00.709555Z"},"links":{"citing_paper":"/paper/2412.02091"},"observation_digest":"sha256:1c39f3e6ddbe63a5c0a7fbba8e4f1404b7956d153ca10a9a8c36b6cfbd1e0d01","observation_id":"60fd1852-a849-474e-9128-7c669a8c1986","resolution":{"observed_at":"2026-08-11T23:56:01.891161Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:56:01.872510Z","title":"Exploratory engineering in artificial intelligence","venue":null,"work_id":"d94e0e8a-9389-4228-83b9-a3cc061395ff","year":2014},"citing_paper":{"arxiv_id":"2412.02091","last_updated":"2025-04-13T01:25:54Z","snapshot_observed_at":"2026-08-13T00:46:41.317824Z","submitted_at":"2024-12-03T02:22:55Z","title":"The Problem of Social Cost in Multi-Agent General Reinforcement Learning: Survey and Synthesis","version":2},"reference_index":97,"source":"pdf_text","source_observed_at":"2026-08-11T23:56:00.713334Z"},"links":{"citing_paper":"/paper/2412.02091"},"observation_digest":"sha256:5f6c58bfd287e23084cee7ad416d57b4de40d54cc80e9004202a188e2ae8a949","observation_id":"534956a3-9058-4f25-8a44-63ab8767111a","resolution":{"observed_at":"2026-08-11T23:56:01.877411Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:56:01.858442Z","title":"Lloyd, and William Uther","venue":null,"work_id":"1460b7e5-d1c7-40df-a469-6fa4254cb8a1","year":2008},"citing_paper":{"arxiv_id":"2412.02091","last_updated":"2025-04-13T01:25:54Z","snapshot_observed_at":"2026-08-13T00:46:41.317824Z","submitted_at":"2024-12-03T02:22:55Z","title":"The Problem of Social Cost in Multi-Agent General Reinforcement Learning: Survey and Synthesis","version":2},"reference_index":98,"source":"pdf_text","source_observed_at":"2026-08-11T23:56:00.716871Z"},"links":{"citing_paper":"/paper/2412.02091"},"observation_digest":"sha256:d8507d3924b877ff2130176e1ff09017fb440ae305c6255e730a3500f92b7c7c","observation_id":"4c834a32-4dce-456e-8f78-af4041217695","resolution":{"observed_at":"2026-08-11T23:56:01.863052Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:56:01.844491Z","title":"Feature re- inforcement learning in practice","venue":null,"work_id":"dbe7610b-5516-4f9d-9d85-a3d405955d8a","year":2011},"citing_paper":{"arxiv_id":"2412.02091","last_updated":"2025-04-13T01:25:54Z","snapshot_observed_at":"2026-08-13T00:46:41.317824Z","submitted_at":"2024-12-03T02:22:55Z","title":"The Problem of Social Cost in Multi-Agent General Reinforcement Learning: Survey and Synthesis","version":2},"reference_index":99,"source":"pdf_text","source_observed_at":"2026-08-11T23:56:00.720776Z"},"links":{"citing_paper":"/paper/2412.02091"},"observation_digest":"sha256:5f5266806e3353b4e6530ed8101a9c1f291474e364eeb73ca2efa381b2ac7924","observation_id":"1dfc2b30-6ea0-42a7-8fcc-37bfe1605a43","resolution":{"observed_at":"2026-08-11T23:56:01.849385Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:56:01.832473Z","title":"Introduction to mechanism design (for computer scientist)","venue":null,"work_id":"d1efd71b-8fef-424c-aa25-0b9c8a3a98eb","year":2007},"citing_paper":{"arxiv_id":"2412.02091","last_updated":"2025-04-13T01:25:54Z","snapshot_observed_at":"2026-08-13T00:46:41.317824Z","submitted_at":"2024-12-03T02:22:55Z","title":"The Problem of Social Cost in Multi-Agent General Reinforcement Learning: Survey and Synthesis","version":2},"reference_index":100,"source":"pdf_text","source_observed_at":"2026-08-11T23:56:00.724470Z"},"links":{"citing_paper":"/paper/2412.02091"},"observation_digest":"sha256:5d1ac6641d7b224f007297e0d87ce1abc6a298f7b08e90a73d4dbc0f4d3a5505","observation_id":"477810e9-3361-4bc2-a97e-0daadef4a59d","resolution":{"observed_at":"2026-08-11T23:56:01.836606Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2412.02091","last_updated":"2025-04-13T01:25:54Z","latest_version":2,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-13T00:46:41.317824Z","submitted_at":"2024-12-03T02:22:55Z","title":"The Problem of Social Cost in Multi-Agent General Reinforcement Learning: Survey and Synthesis"},"reference_resolution":{"displayed":100,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":73,"verified_exact":1,"verified_fuzzy":26},"total_outbound_references":146},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"thesis":"As of 13 August 2026, this Paper Citation Record lists 100 of 146 outbound references and 0 inbound Pith citation observations for arXiv:2412.02091."}