{"as_of":"2026-08-21T23:45:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:0d4bd8c21dc082c5e2a3aeb967e3eba255d1075733ceabcab786a86911a89fa5","coverage":[{"denominator":27,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":27,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T17:54:40.015064Z","state":"measured"},{"denominator":27,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":27,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-21T06:32:19.484+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2507.20143/citation-record","integrity":"/paper/2507.20143/integrity","json":"/paper/2507.20143/citation-record.json","paper":"/paper/2507.20143"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:54:40.303538Z","title":"An overview of recent progress in the study of distributed multi-agent coordination,","venue":null,"work_id":"a89759df-242b-4098-9a27-e21c6363fb61","year":2012},"citing_paper":{"arxiv_id":"2507.20143","last_updated":"2025-07-27T06:22:24Z","snapshot_observed_at":"2026-08-18T16:25:50.260725Z","submitted_at":"2025-07-27T06:22:24Z","title":"Concept Learning for Cooperative Multi-Agent Reinforcement Learning","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-15T17:54:39.925740Z"},"links":{"citing_paper":"/paper/2507.20143"},"observation_digest":"sha256:135b92234445d2badc6199d26b3898a837aba384682706b129e42f86c91ee56d","observation_id":"b0b7e243-d987-42ee-84b5-7f737de4472f","resolution":{"observed_at":"2026-08-15T17:54:40.307534Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:54:40.293770Z","title":"Coordinated multi-agent reinforcement learn- ing in networked distributed pomdps,","venue":null,"work_id":"41d12940-0148-4d57-8eeb-8dc1ed4d57e2","year":2011},"citing_paper":{"arxiv_id":"2507.20143","last_updated":"2025-07-27T06:22:24Z","snapshot_observed_at":"2026-08-18T16:25:50.260725Z","submitted_at":"2025-07-27T06:22:24Z","title":"Concept Learning for Cooperative Multi-Agent Reinforcement Learning","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-15T17:54:39.930061Z"},"links":{"citing_paper":"/paper/2507.20143"},"observation_digest":"sha256:57cb476b038242100667586136a862572be6cc6e065c40ec1adbc9e99e45d474","observation_id":"6d206734-9d8c-4906-9dad-af13eb45dccf","resolution":{"observed_at":"2026-08-15T17:54:40.297615Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1709.06011","last_updated":"2017-09-18T15:37:45Z","snapshot_observed_at":"2026-08-14T20:32:08.595924Z","submitted_at":"2017-09-18T15:37:45Z","title":"Guided Deep Reinforcement Learning for Swarm Systems","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1709.06011","snapshot_observed_at":"2026-08-15T17:54:39.933543Z","title":"Guided deep reinforce- ment learning for swarm systems,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2507.20143","last_updated":"2025-07-27T06:22:24Z","snapshot_observed_at":"2026-08-18T16:25:50.260725Z","submitted_at":"2025-07-27T06:22:24Z","title":"Concept Learning for Cooperative Multi-Agent Reinforcement Learning","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-15T17:54:39.933543Z"},"links":{"cited_paper":"/paper/1709.06011","citing_paper":"/paper/2507.20143"},"observation_digest":"sha256:f7b7e488cd4399d8afd2d007cd86c659c9610b96a2050b8290f55f4c46cf4c0f","observation_id":"e426b1ce-340a-4955-9221-bd1e3c7c7d3b","resolution":{"observed_at":"2026-08-15T17:54:39.933543Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:54:40.283868Z","title":"Value-decomposition networks for cooperative multi-agent learning based on team reward,","venue":null,"work_id":"8296fa90-4b16-442c-b907-187907b2500f","year":2018},"citing_paper":{"arxiv_id":"2507.20143","last_updated":"2025-07-27T06:22:24Z","snapshot_observed_at":"2026-08-18T16:25:50.260725Z","submitted_at":"2025-07-27T06:22:24Z","title":"Concept Learning for Cooperative Multi-Agent Reinforcement Learning","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-15T17:54:39.937395Z"},"links":{"citing_paper":"/paper/2507.20143"},"observation_digest":"sha256:3c4451e3767ec13dbf58e3d0604a247871937633c017357087cd5ac029c44a11","observation_id":"f72e07a2-03fc-4349-9736-c9ddc1379ef9","resolution":{"observed_at":"2026-08-15T17:54:40.287321Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:54:40.274010Z","title":"QMIX: Monotonic value function factorisation for deep multi-agent reinforcement learning,","venue":null,"work_id":"44770c0f-a319-4562-a2e9-0a80399313c1","year":2018},"citing_paper":{"arxiv_id":"2507.20143","last_updated":"2025-07-27T06:22:24Z","snapshot_observed_at":"2026-08-18T16:25:50.260725Z","submitted_at":"2025-07-27T06:22:24Z","title":"Concept Learning for Cooperative Multi-Agent Reinforcement Learning","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-15T17:54:39.941301Z"},"links":{"citing_paper":"/paper/2507.20143"},"observation_digest":"sha256:942d5daabec20ecda985d731b618ded371f4f9a0ef4f49d60f51c3c8084b94af","observation_id":"7822d528-5e28-46ee-9d20-fa2960101324","resolution":{"observed_at":"2026-08-15T17:54:40.277410Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:54:40.263659Z","title":"QPLEX: Duplex dueling multi-agent Q-learning,","venue":null,"work_id":"18e70fca-b7e8-43de-8643-a0991db39267","year":2020},"citing_paper":{"arxiv_id":"2507.20143","last_updated":"2025-07-27T06:22:24Z","snapshot_observed_at":"2026-08-18T16:25:50.260725Z","submitted_at":"2025-07-27T06:22:24Z","title":"Concept Learning for Cooperative Multi-Agent Reinforcement Learning","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-15T17:54:39.944838Z"},"links":{"citing_paper":"/paper/2507.20143"},"observation_digest":"sha256:4c468b842c851781ac7358f13364b75147b2282a9dccf234b45eff7a2e0da58e","observation_id":"39336a54-30c1-440f-b3e1-b0dc116cc138","resolution":{"observed_at":"2026-08-15T17:54:40.267340Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:54:40.252680Z","title":"QTRAN: Learning to factorize with transformation for cooperative multi-agent reinforcement learning,","venue":null,"work_id":"29f38e4b-ce74-4b8a-87cb-481bf1b9dcd2","year":2019},"citing_paper":{"arxiv_id":"2507.20143","last_updated":"2025-07-27T06:22:24Z","snapshot_observed_at":"2026-08-18T16:25:50.260725Z","submitted_at":"2025-07-27T06:22:24Z","title":"Concept Learning for Cooperative Multi-Agent Reinforcement Learning","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-15T17:54:39.948449Z"},"links":{"citing_paper":"/paper/2507.20143"},"observation_digest":"sha256:a4cc9c76ffad1166f009371d37420a006a3a4e0fc3051d859f8fed108deffd69","observation_id":"b1d50fa8-ddb3-42e2-8b90-4bc84676875f","resolution":{"observed_at":"2026-08-15T17:54:40.256094Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:54:40.242189Z","title":"Q-value path decomposition for deep multiagent reinforcement learning,","venue":null,"work_id":"ad11c078-5858-476f-ab9f-233a968350cb","year":2020},"citing_paper":{"arxiv_id":"2507.20143","last_updated":"2025-07-27T06:22:24Z","snapshot_observed_at":"2026-08-18T16:25:50.260725Z","submitted_at":"2025-07-27T06:22:24Z","title":"Concept Learning for Cooperative Multi-Agent Reinforcement Learning","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-15T17:54:39.951665Z"},"links":{"citing_paper":"/paper/2507.20143"},"observation_digest":"sha256:87da48a5cc45b647b9ea1552fddcbb491e040adfea5baf880289ffe7840e8a9c","observation_id":"df7b297f-d76e-4e47-be4b-d7bef7cca0f2","resolution":{"observed_at":"2026-08-15T17:54:40.245997Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:54:40.231925Z","title":"Mixrts: Toward interpretable multi-agent reinforcement learning via mixing recurrent soft decision trees,","venue":null,"work_id":"867946f5-57b5-4926-83ec-b0d718ba6053","year":2025},"citing_paper":{"arxiv_id":"2507.20143","last_updated":"2025-07-27T06:22:24Z","snapshot_observed_at":"2026-08-18T16:25:50.260725Z","submitted_at":"2025-07-27T06:22:24Z","title":"Concept Learning for Cooperative Multi-Agent Reinforcement Learning","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-15T17:54:39.954922Z"},"links":{"citing_paper":"/paper/2507.20143"},"observation_digest":"sha256:3c85bf179cf38efe2452d9cec23c2693f07f54ee41d0ad7dd296d7bf919c94e3","observation_id":"3bed5604-c962-4c30-a5b4-5258073a274a","resolution":{"observed_at":"2026-08-15T17:54:40.235540Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:54:40.221792Z","title":"Na 2q: Neural attention additive model for interpretable multi-agent q-learning,","venue":null,"work_id":"afd31af6-6d3b-4c13-bbc4-3d7f72fd33e3","year":2023},"citing_paper":{"arxiv_id":"2507.20143","last_updated":"2025-07-27T06:22:24Z","snapshot_observed_at":"2026-08-18T16:25:50.260725Z","submitted_at":"2025-07-27T06:22:24Z","title":"Concept Learning for Cooperative Multi-Agent Reinforcement Learning","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-15T17:54:39.958209Z"},"links":{"citing_paper":"/paper/2507.20143"},"observation_digest":"sha256:d246c266aa5dd3968a4787bf62eda9e893167ad504dbe6705b54b9771e334965","observation_id":"1db8fb9d-b0ce-41fe-b20c-439c19718111","resolution":{"observed_at":"2026-08-15T17:54:40.225629Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:54:40.211095Z","title":"Shapley Q-value: A local reward approach to solve global reward games,","venue":null,"work_id":"aa78f746-5f69-4c6c-97e6-80986ab5e3d5","year":2020},"citing_paper":{"arxiv_id":"2507.20143","last_updated":"2025-07-27T06:22:24Z","snapshot_observed_at":"2026-08-18T16:25:50.260725Z","submitted_at":"2025-07-27T06:22:24Z","title":"Concept Learning for Cooperative Multi-Agent Reinforcement Learning","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-15T17:54:39.961259Z"},"links":{"citing_paper":"/paper/2507.20143"},"observation_digest":"sha256:1470f50d87bcaa7a42f36c074f4955e4dbe0c852e189fa0e98e062ee0733006b","observation_id":"8fac033d-5ffd-4307-939b-6bb55547c053","resolution":{"observed_at":"2026-08-15T17:54:40.214913Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:54:40.200647Z","title":"Graying the black box: Understanding DQNs,","venue":null,"work_id":"c2202d4d-19ae-4634-a2ec-25db0e222261","year":2016},"citing_paper":{"arxiv_id":"2507.20143","last_updated":"2025-07-27T06:22:24Z","snapshot_observed_at":"2026-08-18T16:25:50.260725Z","submitted_at":"2025-07-27T06:22:24Z","title":"Concept Learning for Cooperative Multi-Agent Reinforcement Learning","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-15T17:54:39.964608Z"},"links":{"citing_paper":"/paper/2507.20143"},"observation_digest":"sha256:c23dc4f1f5c2ca4470309d3581942f3b32fdfc388adddf494cf3f13bb8afb2b1","observation_id":"614302bb-e856-4435-a68e-2ae3c35df80e","resolution":{"observed_at":"2026-08-15T17:54:40.204150Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:54:40.190275Z","title":"Interpretation of neural networks is fragile,","venue":null,"work_id":"03de0d85-024a-4747-9976-92b44756f1cb","year":2019},"citing_paper":{"arxiv_id":"2507.20143","last_updated":"2025-07-27T06:22:24Z","snapshot_observed_at":"2026-08-18T16:25:50.260725Z","submitted_at":"2025-07-27T06:22:24Z","title":"Concept Learning for Cooperative Multi-Agent Reinforcement Learning","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-15T17:54:39.968223Z"},"links":{"citing_paper":"/paper/2507.20143"},"observation_digest":"sha256:becf7fd79e3b9d0ece7cb27567ae5f2076a75382ae6b67bc8b3e4784db634d7e","observation_id":"4c8fbfe9-0d29-49b3-8bde-6662685a173b","resolution":{"observed_at":"2026-08-15T17:54:40.193665Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:54:40.179890Z","title":"Reliable post hoc explanations: Modeling uncertainty in explainability,","venue":null,"work_id":"ccc0b4d8-da85-4dd8-9f12-3577e9ab65d4","year":2021},"citing_paper":{"arxiv_id":"2507.20143","last_updated":"2025-07-27T06:22:24Z","snapshot_observed_at":"2026-08-18T16:25:50.260725Z","submitted_at":"2025-07-27T06:22:24Z","title":"Concept Learning for Cooperative Multi-Agent Reinforcement Learning","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-15T17:54:39.971418Z"},"links":{"citing_paper":"/paper/2507.20143"},"observation_digest":"sha256:2efe0b9ea4b2b4fa0cf8053cb72cc079d755df01f067e53594449e595c994554","observation_id":"d30f3fd3-2ade-43aa-8857-79ad4786ae85","resolution":{"observed_at":"2026-08-15T17:54:40.183522Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:54:40.169800Z","title":"Verifiable reinforcement learning via policy extraction,","venue":null,"work_id":"3e4fa889-9bf4-43a8-9a6e-dfa22de43f2f","year":2018},"citing_paper":{"arxiv_id":"2507.20143","last_updated":"2025-07-27T06:22:24Z","snapshot_observed_at":"2026-08-18T16:25:50.260725Z","submitted_at":"2025-07-27T06:22:24Z","title":"Concept Learning for Cooperative Multi-Agent Reinforcement Learning","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-15T17:54:39.975000Z"},"links":{"citing_paper":"/paper/2507.20143"},"observation_digest":"sha256:7c40aa9a8dc2b6054b486bbdfa8ad8630fc14d0ca9235d870e688cb3b2fd3f88","observation_id":"ee9255a8-6f2d-4379-b524-87a3f37c499a","resolution":{"observed_at":"2026-08-15T17:54:40.173201Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:54:40.159392Z","title":"Opti- mization methods for interpretable differentiable decision trees applied to reinforcement learning,","venue":null,"work_id":"390c1a3f-38eb-45e5-862b-4cfbe8ed978b","year":2020},"citing_paper":{"arxiv_id":"2507.20143","last_updated":"2025-07-27T06:22:24Z","snapshot_observed_at":"2026-08-18T16:25:50.260725Z","submitted_at":"2025-07-27T06:22:24Z","title":"Concept Learning for Cooperative Multi-Agent Reinforcement Learning","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-15T17:54:39.978051Z"},"links":{"citing_paper":"/paper/2507.20143"},"observation_digest":"sha256:3e330a97a0caad273ac015c8f166e281b72ae03fd338ac6a46c57a1507a272ca","observation_id":"4dd55783-bd39-4bcf-9363-5c02edcb9bd1","resolution":{"observed_at":"2026-08-15T17:54:40.163035Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:54:39.981121Z","title":"Extracting decision tree from trained deep reinforcement learning in traffic signal control,","venue":null,"work_id":null,"year":1997},"citing_paper":{"arxiv_id":"2507.20143","last_updated":"2025-07-27T06:22:24Z","snapshot_observed_at":"2026-08-18T16:25:50.260725Z","submitted_at":"2025-07-27T06:22:24Z","title":"Concept Learning for Cooperative Multi-Agent Reinforcement Learning","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-15T17:54:39.981121Z"},"links":{"citing_paper":"/paper/2507.20143"},"observation_digest":"sha256:7ac646d499936c4cef8687ba7b5eb2594abb52a6b283aa60468619b951de541c","observation_id":"0c1a8ad8-da4e-442c-92f1-672c23cc08b2","resolution":{"observed_at":"2026-08-15T17:54:39.981121Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:54:40.142990Z","title":"Concept bottleneck models,","venue":null,"work_id":"d4286b5a-0727-4bfa-9583-5b89dc9b947d","year":2020},"citing_paper":{"arxiv_id":"2507.20143","last_updated":"2025-07-27T06:22:24Z","snapshot_observed_at":"2026-08-18T16:25:50.260725Z","submitted_at":"2025-07-27T06:22:24Z","title":"Concept Learning for Cooperative Multi-Agent Reinforcement Learning","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-15T17:54:39.984075Z"},"links":{"citing_paper":"/paper/2507.20143"},"observation_digest":"sha256:eb8ccab9c0b9b8ffd5498722cba040a5d19a08be41c124db43f4e4b372a73a61","observation_id":"e769ae27-4678-47d3-aaa5-7f2779e04d93","resolution":{"observed_at":"2026-08-15T17:54:40.146569Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:54:40.133007Z","title":"Interactive disentanglement: Learning concepts by interacting with their prototype representations,","venue":null,"work_id":"8d75c3fc-14db-4338-a4c1-4686e9ff16a9","year":2022},"citing_paper":{"arxiv_id":"2507.20143","last_updated":"2025-07-27T06:22:24Z","snapshot_observed_at":"2026-08-18T16:25:50.260725Z","submitted_at":"2025-07-27T06:22:24Z","title":"Concept Learning for Cooperative Multi-Agent Reinforcement Learning","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-15T17:54:39.987197Z"},"links":{"citing_paper":"/paper/2507.20143"},"observation_digest":"sha256:dbd463082578d7bb369fa2d8e0d76cf7fedcb909d67c6f06ef86d6d806ad701f","observation_id":"9a04c297-a971-4450-8056-f0501363b405","resolution":{"observed_at":"2026-08-15T17:54:40.136658Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:54:40.123107Z","title":"Addressing leakage in concept bottleneck models,","venue":null,"work_id":"689eb09d-1fbe-4d47-9fd8-0cb321bfcaf3","year":2022},"citing_paper":{"arxiv_id":"2507.20143","last_updated":"2025-07-27T06:22:24Z","snapshot_observed_at":"2026-08-18T16:25:50.260725Z","submitted_at":"2025-07-27T06:22:24Z","title":"Concept Learning for Cooperative Multi-Agent Reinforcement Learning","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-15T17:54:39.991110Z"},"links":{"citing_paper":"/paper/2507.20143"},"observation_digest":"sha256:b9c3ba31033cf96a1d818a74c6720b9a156c272d479ff5443918d086e500fcf9","observation_id":"8f3b08dd-2aa4-4abd-9ed0-13b9be179d8a","resolution":{"observed_at":"2026-08-15T17:54:40.126572Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:54:40.112511Z","title":"Concept gradient: Concept-based interpretation without linear assumption,","venue":null,"work_id":"3b14c526-3a8c-4f01-b159-f5210bca4774","year":2022},"citing_paper":{"arxiv_id":"2507.20143","last_updated":"2025-07-27T06:22:24Z","snapshot_observed_at":"2026-08-18T16:25:50.260725Z","submitted_at":"2025-07-27T06:22:24Z","title":"Concept Learning for Cooperative Multi-Agent Reinforcement Learning","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-15T17:54:39.994639Z"},"links":{"citing_paper":"/paper/2507.20143"},"observation_digest":"sha256:151e54507f7cb840f8b6df960395334b18da13623aef45bb6dbc460777ab0779","observation_id":"7e2d32cb-712b-4272-a3e9-6934b1a60fdb","resolution":{"observed_at":"2026-08-15T17:54:40.116122Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:54:40.101832Z","title":"Weighted QMIX: Expanding monotonic value function factorisation for deep multi-agent reinforcement learning,","venue":null,"work_id":"8bc34ed5-be13-4b54-839e-4007eff1cfce","year":2020},"citing_paper":{"arxiv_id":"2507.20143","last_updated":"2025-07-27T06:22:24Z","snapshot_observed_at":"2026-08-18T16:25:50.260725Z","submitted_at":"2025-07-27T06:22:24Z","title":"Concept Learning for Cooperative Multi-Agent Reinforcement Learning","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-15T17:54:39.998063Z"},"links":{"citing_paper":"/paper/2507.20143"},"observation_digest":"sha256:9c036502983b32888ec8bc90db0f0bf1654d31b64b50b19590749b48c5ca507a","observation_id":"d0f9709c-94e1-4d33-9c03-514984cfb427","resolution":{"observed_at":"2026-08-15T17:54:40.105405Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2002.03939","last_updated":"2020-06-09T05:20:11Z","snapshot_observed_at":"2026-08-18T16:24:37.512043Z","submitted_at":"2020-02-10T16:48:03Z","title":"Qatten: A General Framework for Cooperative Multiagent Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2002.03939","snapshot_observed_at":"2026-08-15T17:54:40.001534Z","title":"Qatten: A general framework for cooperative multiagent reinforcement learning,","venue":null,"work_id":null,"year":2002},"citing_paper":{"arxiv_id":"2507.20143","last_updated":"2025-07-27T06:22:24Z","snapshot_observed_at":"2026-08-18T16:25:50.260725Z","submitted_at":"2025-07-27T06:22:24Z","title":"Concept Learning for Cooperative Multi-Agent Reinforcement Learning","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-15T17:54:40.001534Z"},"links":{"cited_paper":"/paper/2002.03939","citing_paper":"/paper/2507.20143"},"observation_digest":"sha256:27b3733fcf27816c96c9295db709d0a9da8cd9519b00b042d3fce4247fec578d","observation_id":"e494a9e0-894a-419b-ae3e-606e644d626c","resolution":{"observed_at":"2026-08-15T17:54:40.001534Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:54:40.091732Z","title":"Celebrating diversity in shared multi-agent reinforcement learning,","venue":null,"work_id":"8a608847-5cf0-4992-a24f-e103b923c3fc","year":2021},"citing_paper":{"arxiv_id":"2507.20143","last_updated":"2025-07-27T06:22:24Z","snapshot_observed_at":"2026-08-18T16:25:50.260725Z","submitted_at":"2025-07-27T06:22:24Z","title":"Concept Learning for Cooperative Multi-Agent Reinforcement Learning","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-15T17:54:40.005337Z"},"links":{"citing_paper":"/paper/2507.20143"},"observation_digest":"sha256:6fd9c42f7a22f323e6299d8e7358b2bb806b4636dffd693eff803d4bae111cec","observation_id":"1dfd32b4-ed5a-46dc-b530-70f50821749f","resolution":{"observed_at":"2026-08-15T17:54:40.095200Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:54:40.081431Z","title":"SHAQ: Incorpo- rating shapley value theory into multi-agent Q-learning,","venue":null,"work_id":"a498cd4a-909f-4730-ab14-1e13fa37d46f","year":2022},"citing_paper":{"arxiv_id":"2507.20143","last_updated":"2025-07-27T06:22:24Z","snapshot_observed_at":"2026-08-18T16:25:50.260725Z","submitted_at":"2025-07-27T06:22:24Z","title":"Concept Learning for Cooperative Multi-Agent Reinforcement Learning","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-15T17:54:40.008718Z"},"links":{"citing_paper":"/paper/2507.20143"},"observation_digest":"sha256:af3096b9d67d03291094193c0a01dfe974d26ed241c7390cc321da72b3fab7ce","observation_id":"173386c7-3fc1-46e7-bf13-29e26066b9f2","resolution":{"observed_at":"2026-08-15T17:54:40.084972Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:54:40.071390Z","title":"Shared experience actor- critic for multi-agent reinforcement learning,","venue":null,"work_id":"bfdc9507-671c-4df5-a856-f4da70ea382a","year":2020},"citing_paper":{"arxiv_id":"2507.20143","last_updated":"2025-07-27T06:22:24Z","snapshot_observed_at":"2026-08-18T16:25:50.260725Z","submitted_at":"2025-07-27T06:22:24Z","title":"Concept Learning for Cooperative Multi-Agent Reinforcement Learning","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-15T17:54:40.011850Z"},"links":{"citing_paper":"/paper/2507.20143"},"observation_digest":"sha256:32f348216566d2079cc367e207776334e231082619ff305562587dbc06e059c7","observation_id":"203f36bc-1d2f-4038-a0cc-2b34951d3a92","resolution":{"observed_at":"2026-08-15T17:54:40.074809Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:54:40.059421Z","title":"The StarCraft Multi-Agent Challenge,","venue":null,"work_id":"63a0eb1c-9b3e-42ac-85a2-4b6335e53366","year":2019},"citing_paper":{"arxiv_id":"2507.20143","last_updated":"2025-07-27T06:22:24Z","snapshot_observed_at":"2026-08-18T16:25:50.260725Z","submitted_at":"2025-07-27T06:22:24Z","title":"Concept Learning for Cooperative Multi-Agent Reinforcement Learning","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-15T17:54:40.015064Z"},"links":{"citing_paper":"/paper/2507.20143"},"observation_digest":"sha256:5122eb300ea54a493ae99d949ad5927689639ddaf3da4cea77688b34b4e1f243","observation_id":"1d13a3b0-7274-4d7b-b151-c593e8d22db5","resolution":{"observed_at":"2026-08-15T17:54:40.064822Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2507.20143","last_updated":"2025-07-27T06:22:24Z","latest_version":1,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-18T16:25:50.260725Z","submitted_at":"2025-07-27T06:22:24Z","title":"Concept Learning for Cooperative Multi-Agent Reinforcement Learning"},"reference_resolution":{"displayed":27,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":3,"verified_exact":0,"verified_fuzzy":24},"total_outbound_references":27},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"thesis":"As of 21 August 2026, this Paper Citation Record lists 27 of 27 outbound references and 0 inbound Pith citation observations for arXiv:2507.20143."}