{"as_of":"2026-08-08T23:53:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:ded35d0f595d2735dae42ba38d96be7b1be5505abb3bf634d331636a0fedfbcc","coverage":[{"denominator":31,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":31,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T17:42:31.969789Z","state":"measured"},{"denominator":31,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":31,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2507.10251/citation-record","integrity":"/paper/2507.10251/integrity","json":"/paper/2507.10251/citation-record.json","paper":"/paper/2507.10251"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:42:32.261353Z","title":"Amato, G","venue":null,"work_id":"517ec0d0-0104-49b3-8c91-05dced4b2c0c","year":2019},"citing_paper":{"arxiv_id":"2507.10251","last_updated":"2025-07-14T13:18:13Z","snapshot_observed_at":"2026-08-06T17:33:20.360132Z","submitted_at":"2025-07-14T13:18:13Z","title":"ToMacVF : Temporal Macro-action Value Factorization for Asynchronous Multi-Agent Reinforcement Learning","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T17:42:31.900918Z"},"links":{"citing_paper":"/paper/2507.10251"},"observation_digest":"sha256:315ee832530be2dd6fb4e0ef97ffd81e69de325b1ea24e6ea72979ae48025042","observation_id":"c25dabca-4b28-44ef-aca6-fc5d86beb1ce","resolution":{"observed_at":"2026-08-06T17:42:32.263964Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:42:32.254513Z","title":null,"venue":null,"work_id":"d3f97104-1ab9-42a8-8d35-946d48c17df2","year":2017},"citing_paper":{"arxiv_id":"2507.10251","last_updated":"2025-07-14T13:18:13Z","snapshot_observed_at":"2026-08-06T17:33:20.360132Z","submitted_at":"2025-07-14T13:18:13Z","title":"ToMacVF : Temporal Macro-action Value Factorization for Asynchronous Multi-Agent Reinforcement Learning","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T17:42:31.903594Z"},"links":{"citing_paper":"/paper/2507.10251"},"observation_digest":"sha256:4ecddee7234a541f1111a6a902eb5c84cf6c2fd5c054dcf81f4b887b34613070","observation_id":"dd50fff5-d071-4772-8ada-085108eb3937","resolution":{"observed_at":"2026-08-06T17:42:32.256851Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:42:32.247597Z","title":"Christopher, D","venue":null,"work_id":"9a93e58d-bea2-4063-b010-cbc8d8c0ab0e","year":2014},"citing_paper":{"arxiv_id":"2507.10251","last_updated":"2025-07-14T13:18:13Z","snapshot_observed_at":"2026-08-06T17:33:20.360132Z","submitted_at":"2025-07-14T13:18:13Z","title":"ToMacVF : Temporal Macro-action Value Factorization for Asynchronous Multi-Agent Reinforcement Learning","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T17:42:31.905919Z"},"links":{"citing_paper":"/paper/2507.10251"},"observation_digest":"sha256:74292fd364be3e7c682b04fb54f963e70619b93709b9ddb0cba4a49c1ef849b9","observation_id":"254b6afe-a17d-4c24-92fe-8eb5fd9e4f05","resolution":{"observed_at":"2026-08-06T17:42:32.249983Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:42:32.241232Z","title":null,"venue":null,"work_id":"3502720e-1096-40aa-8d62-20e6d84ac918","year":2019},"citing_paper":{"arxiv_id":"2507.10251","last_updated":"2025-07-14T13:18:13Z","snapshot_observed_at":"2026-08-06T17:33:20.360132Z","submitted_at":"2025-07-14T13:18:13Z","title":"ToMacVF : Temporal Macro-action Value Factorization for Asynchronous Multi-Agent Reinforcement Learning","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T17:42:31.908315Z"},"links":{"citing_paper":"/paper/2507.10251"},"observation_digest":"sha256:76c0c8dfc35682594ad625c59d6d719cf107dc8eadf4820ccc89daf7c2838714","observation_id":"52688c32-0c2d-4039-9037-fdbf6c6ac072","resolution":{"observed_at":"2026-08-06T17:42:32.243323Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1904.06979","last_updated":"2022-08-29T10:30:43Z","snapshot_observed_at":"2026-07-06T07:46:06.039145Z","submitted_at":"2019-04-15T12:00:29Z","title":"A Hitchhiker's Guide to Statistical Comparisons of Reinforcement Learning Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1904.06979","snapshot_observed_at":"2026-08-06T17:42:31.910654Z","title":"Colas, O","venue":null,"work_id":null,"year":1904},"citing_paper":{"arxiv_id":"2507.10251","last_updated":"2025-07-14T13:18:13Z","snapshot_observed_at":"2026-08-06T17:33:20.360132Z","submitted_at":"2025-07-14T13:18:13Z","title":"ToMacVF : Temporal Macro-action Value Factorization for Asynchronous Multi-Agent Reinforcement Learning","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T17:42:31.910654Z"},"links":{"cited_paper":"/paper/1904.06979","citing_paper":"/paper/2507.10251"},"observation_digest":"sha256:74013c62024f0082470015b6868e8656350df5716008e5c0a6dd2977b160b413","observation_id":"87ac3d3e-fd49-4e89-ab9b-363cda374d13","resolution":{"observed_at":"2026-08-06T17:42:31.910654Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:42:32.234689Z","title":null,"venue":null,"work_id":"7bbaf04f-e18f-45ab-9e6b-f4b4ebba84cd","year":2021},"citing_paper":{"arxiv_id":"2507.10251","last_updated":"2025-07-14T13:18:13Z","snapshot_observed_at":"2026-08-06T17:33:20.360132Z","submitted_at":"2025-07-14T13:18:13Z","title":"ToMacVF : Temporal Macro-action Value Factorization for Asynchronous Multi-Agent Reinforcement Learning","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T17:42:31.913173Z"},"links":{"citing_paper":"/paper/2507.10251"},"observation_digest":"sha256:305265ea62fefb0e336ad8a79ff3d3369ec696ffe67a4260bfa7115ccc7948e2","observation_id":"2b01d831-0594-4a3e-9116-86fce109ecf0","resolution":{"observed_at":"2026-08-06T17:42:32.236904Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:42:32.228013Z","title":null,"venue":null,"work_id":"00b7c4b8-a03a-4416-b2ac-2658307b3488","year":2023},"citing_paper":{"arxiv_id":"2507.10251","last_updated":"2025-07-14T13:18:13Z","snapshot_observed_at":"2026-08-06T17:33:20.360132Z","submitted_at":"2025-07-14T13:18:13Z","title":"ToMacVF : Temporal Macro-action Value Factorization for Asynchronous Multi-Agent Reinforcement Learning","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T17:42:31.915660Z"},"links":{"citing_paper":"/paper/2507.10251"},"observation_digest":"sha256:61f0df5cd557006ef344429214aa0cb6d28c470396622da8872f8435cac7d09f","observation_id":"4e0fe3d0-cf6a-485d-8a92-5a6d53d0bd10","resolution":{"observed_at":"2026-08-06T17:42:32.230238Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:42:32.220642Z","title":"Gupta, A","venue":null,"work_id":"62c7ea74-2768-4d5c-9c0e-8b442538aaaa","year":null},"citing_paper":{"arxiv_id":"2507.10251","last_updated":"2025-07-14T13:18:13Z","snapshot_observed_at":"2026-08-06T17:33:20.360132Z","submitted_at":"2025-07-14T13:18:13Z","title":"ToMacVF : Temporal Macro-action Value Factorization for Asynchronous Multi-Agent Reinforcement Learning","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T17:42:31.917968Z"},"links":{"citing_paper":"/paper/2507.10251"},"observation_digest":"sha256:57fe0101c47a38a581006be319f115bc143ee294f795eb41d2b49cabaac8f0e0","observation_id":"13632030-4f3a-4502-8f6c-3f8f5480527f","resolution":{"observed_at":"2026-08-06T17:42:32.223213Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:42:32.213938Z","title":null,"venue":null,"work_id":"dae89498-fe28-4fff-8c58-5a496028f992","year":1990},"citing_paper":{"arxiv_id":"2507.10251","last_updated":"2025-07-14T13:18:13Z","snapshot_observed_at":"2026-08-06T17:33:20.360132Z","submitted_at":"2025-07-14T13:18:13Z","title":"ToMacVF : Temporal Macro-action Value Factorization for Asynchronous Multi-Agent Reinforcement Learning","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T17:42:31.920152Z"},"links":{"citing_paper":"/paper/2507.10251"},"observation_digest":"sha256:699e8bc355fc81ff730cda8d9e6b3344aa6b9a5d86f82fe144c233e50582c97e","observation_id":"8f48adb4-8852-4c19-8d82-0f2ad4709543","resolution":{"observed_at":"2026-08-06T17:42:32.216227Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:42:32.207336Z","title":"Liu and J","venue":null,"work_id":"05865756-66b8-42e1-a5a9-19f14cfb8ffd","year":2024},"citing_paper":{"arxiv_id":"2507.10251","last_updated":"2025-07-14T13:18:13Z","snapshot_observed_at":"2026-08-06T17:33:20.360132Z","submitted_at":"2025-07-14T13:18:13Z","title":"ToMacVF : Temporal Macro-action Value Factorization for Asynchronous Multi-Agent Reinforcement Learning","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T17:42:31.922269Z"},"links":{"citing_paper":"/paper/2507.10251"},"observation_digest":"sha256:742a2a314a3c6d97bdc52bb67cf5ee401e464a62f07f5142ed8056b92f213ef5","observation_id":"790eb0c5-57ee-453e-830b-a88b36812a67","resolution":{"observed_at":"2026-08-06T17:42:32.209501Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:42:32.200182Z","title":"Mahajan, T","venue":null,"work_id":"71c5c4c1-8564-4604-817f-81bdde8844d8","year":2019},"citing_paper":{"arxiv_id":"2507.10251","last_updated":"2025-07-14T13:18:13Z","snapshot_observed_at":"2026-08-06T17:33:20.360132Z","submitted_at":"2025-07-14T13:18:13Z","title":"ToMacVF : Temporal Macro-action Value Factorization for Asynchronous Multi-Agent Reinforcement Learning","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T17:42:31.924564Z"},"links":{"citing_paper":"/paper/2507.10251"},"observation_digest":"sha256:b8f1e5a46a9cd7cc6c6b5ec116d5609b09c841f9afd07cf2dc2d40506385608f","observation_id":"ed8414c3-967e-4153-93c1-d1cedc9678b3","resolution":{"observed_at":"2026-08-06T17:42:32.202893Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:42:32.193411Z","title":"Marchesini, Y","venue":null,"work_id":"272cd362-7318-4131-a4c0-d04fca40f7de","year":2024},"citing_paper":{"arxiv_id":"2507.10251","last_updated":"2025-07-14T13:18:13Z","snapshot_observed_at":"2026-08-06T17:33:20.360132Z","submitted_at":"2025-07-14T13:18:13Z","title":"ToMacVF : Temporal Macro-action Value Factorization for Asynchronous Multi-Agent Reinforcement Learning","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T17:42:31.926863Z"},"links":{"citing_paper":"/paper/2507.10251"},"observation_digest":"sha256:5be61b78e55c96459d696fe4397cd558d253998ad63a1d873420b46e50d49043","observation_id":"5a1119d7-cb7c-43da-96e7-f94fcee32f4e","resolution":{"observed_at":"2026-08-06T17:42:32.195768Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:42:32.186969Z","title":null,"venue":null,"work_id":"c0b07ec3-b805-483c-80cb-9beea3e1b2f4","year":2016},"citing_paper":{"arxiv_id":"2507.10251","last_updated":"2025-07-14T13:18:13Z","snapshot_observed_at":"2026-08-06T17:33:20.360132Z","submitted_at":"2025-07-14T13:18:13Z","title":"ToMacVF : Temporal Macro-action Value Factorization for Asynchronous Multi-Agent Reinforcement Learning","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T17:42:31.929012Z"},"links":{"citing_paper":"/paper/2507.10251"},"observation_digest":"sha256:e5c4f5f593cb4d87f510b706050681472052b8a2208b19eb944dac6970faa52f","observation_id":"67c0c2a2-3264-4785-9487-05e1d6858dab","resolution":{"observed_at":"2026-08-06T17:42:32.189160Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:42:32.180460Z","title":"Omidshafiei, A.-A","venue":null,"work_id":"96463c2f-0f68-4fa9-8591-b5da22c16e17","year":2017},"citing_paper":{"arxiv_id":"2507.10251","last_updated":"2025-07-14T13:18:13Z","snapshot_observed_at":"2026-08-06T17:33:20.360132Z","submitted_at":"2025-07-14T13:18:13Z","title":"ToMacVF : Temporal Macro-action Value Factorization for Asynchronous Multi-Agent Reinforcement Learning","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T17:42:31.931025Z"},"links":{"citing_paper":"/paper/2507.10251"},"observation_digest":"sha256:5aa9b8fc39b6667c77fda9677d5a1bf8f707408d018aa27d85d80fa742811468","observation_id":"82f40597-9b22-4d56-8372-52b0f7ac358f","resolution":{"observed_at":"2026-08-06T17:42:32.182632Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:42:32.172609Z","title":"Rashid, G","venue":null,"work_id":"ed0510b1-ea07-4e51-9404-696026316cae","year":2020},"citing_paper":{"arxiv_id":"2507.10251","last_updated":"2025-07-14T13:18:13Z","snapshot_observed_at":"2026-08-06T17:33:20.360132Z","submitted_at":"2025-07-14T13:18:13Z","title":"ToMacVF : Temporal Macro-action Value Factorization for Asynchronous Multi-Agent Reinforcement Learning","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T17:42:31.933128Z"},"links":{"citing_paper":"/paper/2507.10251"},"observation_digest":"sha256:e184ac959276d0079e47eb4dbf7e2dc317cbd4a515a88e7151e4f7ed451a9378","observation_id":"49742869-cd09-48bf-a46f-e9c9af372feb","resolution":{"observed_at":"2026-08-06T17:42:32.175255Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:42:32.165323Z","title":"Rashid, M","venue":null,"work_id":"95c959de-9656-4835-ad83-81fb3839ddea","year":2020},"citing_paper":{"arxiv_id":"2507.10251","last_updated":"2025-07-14T13:18:13Z","snapshot_observed_at":"2026-08-06T17:33:20.360132Z","submitted_at":"2025-07-14T13:18:13Z","title":"ToMacVF : Temporal Macro-action Value Factorization for Asynchronous Multi-Agent Reinforcement Learning","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T17:42:31.935270Z"},"links":{"citing_paper":"/paper/2507.10251"},"observation_digest":"sha256:4aeac3d4268e6e9bf05f93296888808279743a4e537f9b4e30095a532384c27a","observation_id":"4a7f6d14-3b7f-4e10-9d34-2c72b9679b40","resolution":{"observed_at":"2026-08-06T17:42:32.167625Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1206.5295","last_updated":"2012-06-20T15:19:47Z","snapshot_observed_at":"2026-07-06T02:50:30.556639Z","submitted_at":"2012-06-20T15:19:47Z","title":"Improved Memory-Bounded Dynamic Programming for Decentralized POMDPs","version":1},"cited_work":{"arxiv_id":"1206.5295","doi":null,"metadata_source":"pith","pith_arxiv_id":"1206.5295","snapshot_observed_at":"2026-08-06T17:42:32.075513Z","title":"Improved Memory-Bounded Dynamic Programming for Decentralized POMDPs","venue":"cs.AI","work_id":"8fe12442-453d-4ee5-a00d-012961a58dc7","year":2012},"citing_paper":{"arxiv_id":"2507.10251","last_updated":"2025-07-14T13:18:13Z","snapshot_observed_at":"2026-08-06T17:33:20.360132Z","submitted_at":"2025-07-14T13:18:13Z","title":"ToMacVF : Temporal Macro-action Value Factorization for Asynchronous Multi-Agent Reinforcement Learning","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T17:42:31.937356Z"},"links":{"cited_paper":"/paper/1206.5295","citing_paper":"/paper/2507.10251"},"observation_digest":"sha256:da9ce3f9379cd6b3ed18a91ebba07d8e6ff2c8930c84aea9e2f2873b9831c833","observation_id":"213fe555-0bf7-4a43-9fdf-ed13993412af","resolution":{"observed_at":"2026-08-06T17:42:32.078285Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:42:32.157443Z","title":null,"venue":null,"work_id":"2c858ee4-3b09-4162-939f-817598ea2845","year":2019},"citing_paper":{"arxiv_id":"2507.10251","last_updated":"2025-07-14T13:18:13Z","snapshot_observed_at":"2026-08-06T17:33:20.360132Z","submitted_at":"2025-07-14T13:18:13Z","title":"ToMacVF : Temporal Macro-action Value Factorization for Asynchronous Multi-Agent Reinforcement Learning","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T17:42:31.939852Z"},"links":{"citing_paper":"/paper/2507.10251"},"observation_digest":"sha256:eb501efe81c636f99620feada179bd3776a835ab2980f45cc4ec9e4a050c547d","observation_id":"f70f9ac5-1bf7-4c74-89bb-bcd46b022d46","resolution":{"observed_at":"2026-08-06T17:42:32.159833Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:42:32.150243Z","title":"Tuyls and G","venue":null,"work_id":"03751625-2033-41ab-8ee7-4f465728a1d1","year":2012},"citing_paper":{"arxiv_id":"2507.10251","last_updated":"2025-07-14T13:18:13Z","snapshot_observed_at":"2026-08-06T17:33:20.360132Z","submitted_at":"2025-07-14T13:18:13Z","title":"ToMacVF : Temporal Macro-action Value Factorization for Asynchronous Multi-Agent Reinforcement Learning","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T17:42:31.941942Z"},"links":{"citing_paper":"/paper/2507.10251"},"observation_digest":"sha256:59cd730b0edad5101cdf1ebe0b556e7486808ad320b084c22bd0ffc0b7c5b48e","observation_id":"663f352d-5a3c-455a-8d73-f8f2d404acd0","resolution":{"observed_at":"2026-08-06T17:42:32.152705Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2112.04454","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:42:32.063831Z","title":null,"venue":null,"work_id":"1545eca8-916d-438d-a855-f6909612c4a0","year":2021},"citing_paper":{"arxiv_id":"2507.10251","last_updated":"2025-07-14T13:18:13Z","snapshot_observed_at":"2026-08-06T17:33:20.360132Z","submitted_at":"2025-07-14T13:18:13Z","title":"ToMacVF : Temporal Macro-action Value Factorization for Asynchronous Multi-Agent Reinforcement Learning","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T17:42:31.943955Z"},"links":{"citing_paper":"/paper/2507.10251"},"observation_digest":"sha256:3c2c15e720c11c41f1a9b0c9c8f60c9236720d965d62f4981db5acdff4add06c","observation_id":"c27bcdf6-02d5-44d5-af66-852287f41051","resolution":{"observed_at":"2026-08-06T17:42:32.067921Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2008.01062","last_updated":"2021-10-04T01:36:59Z","snapshot_observed_at":"2026-07-06T09:44:11.377445Z","submitted_at":"2020-08-03T17:52:09Z","title":"QPLEX: Duplex Dueling Multi-Agent Q-Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2008.01062","snapshot_observed_at":"2026-08-06T17:42:31.946134Z","title":null,"venue":null,"work_id":null,"year":2008},"citing_paper":{"arxiv_id":"2507.10251","last_updated":"2025-07-14T13:18:13Z","snapshot_observed_at":"2026-08-06T17:33:20.360132Z","submitted_at":"2025-07-14T13:18:13Z","title":"ToMacVF : Temporal Macro-action Value Factorization for Asynchronous Multi-Agent Reinforcement Learning","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T17:42:31.946134Z"},"links":{"cited_paper":"/paper/2008.01062","citing_paper":"/paper/2507.10251"},"observation_digest":"sha256:ce263c285a5a4507a389586bae9f8c3ef523873595e63a929b4a62e084776e2f","observation_id":"37a69add-050c-4d38-a5dd-7115c7cca8c4","resolution":{"observed_at":"2026-08-06T17:42:31.946134Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:42:32.143554Z","title":null,"venue":null,"work_id":"96140612-e720-470f-ab16-bd61a5b303a1","year":2020},"citing_paper":{"arxiv_id":"2507.10251","last_updated":"2025-07-14T13:18:13Z","snapshot_observed_at":"2026-08-06T17:33:20.360132Z","submitted_at":"2025-07-14T13:18:13Z","title":"ToMacVF : Temporal Macro-action Value Factorization for Asynchronous Multi-Agent Reinforcement Learning","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T17:42:31.948359Z"},"links":{"citing_paper":"/paper/2507.10251"},"observation_digest":"sha256:99a232f98f22241ea6255c7f08a0165a2c71b5b39a344df6121ee8af72368b43","observation_id":"8eaf9bc8-6a94-4169-b974-c3bc0d905bc9","resolution":{"observed_at":"2026-08-06T17:42:32.145781Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:42:32.136423Z","title":null,"venue":null,"work_id":"3b96f87e-7b4e-4600-9668-a2567364df68","year":2020},"citing_paper":{"arxiv_id":"2507.10251","last_updated":"2025-07-14T13:18:13Z","snapshot_observed_at":"2026-08-06T17:33:20.360132Z","submitted_at":"2025-07-14T13:18:13Z","title":"ToMacVF : Temporal Macro-action Value Factorization for Asynchronous Multi-Agent Reinforcement Learning","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T17:42:31.950455Z"},"links":{"citing_paper":"/paper/2507.10251"},"observation_digest":"sha256:fc53e59b1c3023d380d78e197179bdfa1109a9af8bcdcad63ee70aacbac41d80","observation_id":"7adf4894-07da-4228-8204-e490ebb307f9","resolution":{"observed_at":"2026-08-06T17:42:32.139040Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:42:32.129154Z","title":null,"venue":null,"work_id":"bf0096fa-8b88-4549-a9ff-d1a2f10c23e5","year":2022},"citing_paper":{"arxiv_id":"2507.10251","last_updated":"2025-07-14T13:18:13Z","snapshot_observed_at":"2026-08-06T17:33:20.360132Z","submitted_at":"2025-07-14T13:18:13Z","title":"ToMacVF : Temporal Macro-action Value Factorization for Asynchronous Multi-Agent Reinforcement Learning","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T17:42:31.952475Z"},"links":{"citing_paper":"/paper/2507.10251"},"observation_digest":"sha256:3497211174bc0a29f3093f7e6eaa2044b88e92ad53deb4dc8fbfd2277788d55c","observation_id":"306e5843-c729-450b-854d-c68a2f77800e","resolution":{"observed_at":"2026-08-06T17:42:32.131597Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:42:32.121470Z","title":null,"venue":null,"work_id":"ec84e8ba-ed2e-4269-98e2-da596ca392b3","year":2020},"citing_paper":{"arxiv_id":"2507.10251","last_updated":"2025-07-14T13:18:13Z","snapshot_observed_at":"2026-08-06T17:33:20.360132Z","submitted_at":"2025-07-14T13:18:13Z","title":"ToMacVF : Temporal Macro-action Value Factorization for Asynchronous Multi-Agent Reinforcement Learning","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T17:42:31.954837Z"},"links":{"citing_paper":"/paper/2507.10251"},"observation_digest":"sha256:230a81fd2d7a910e04cc07b7e80a65895e16681e167e10d8dd9215bab5750170","observation_id":"f4077a1d-1ad6-48a4-a211-96b6b5ffbbe6","resolution":{"observed_at":"2026-08-06T17:42:32.123834Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:42:32.113871Z","title":null,"venue":null,"work_id":"51b2b70d-2436-49fc-bfe4-53940eefbdc6","year":2020},"citing_paper":{"arxiv_id":"2507.10251","last_updated":"2025-07-14T13:18:13Z","snapshot_observed_at":"2026-08-06T17:33:20.360132Z","submitted_at":"2025-07-14T13:18:13Z","title":"ToMacVF : Temporal Macro-action Value Factorization for Asynchronous Multi-Agent Reinforcement Learning","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T17:42:31.957866Z"},"links":{"citing_paper":"/paper/2507.10251"},"observation_digest":"sha256:0170ca6e3df83ac5dcf363127a5704387bc8d1c75a172ea15cb67865c83b75bb","observation_id":"2d14c30f-4a84-43d3-a9f9-fb1a9a123e85","resolution":{"observed_at":"2026-08-06T17:42:32.116283Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:42:32.106011Z","title":null,"venue":null,"work_id":"d41f3e29-4068-44ad-809e-48d34430f0ec","year":2022},"citing_paper":{"arxiv_id":"2507.10251","last_updated":"2025-07-14T13:18:13Z","snapshot_observed_at":"2026-08-06T17:33:20.360132Z","submitted_at":"2025-07-14T13:18:13Z","title":"ToMacVF : Temporal Macro-action Value Factorization for Asynchronous Multi-Agent Reinforcement Learning","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T17:42:31.960123Z"},"links":{"citing_paper":"/paper/2507.10251"},"observation_digest":"sha256:5c8a41221a5c1016fa6df38a65e94d908a73971ad75f35397cff483aa309a632","observation_id":"250ed19e-5f67-42e3-af7c-257086c5631a","resolution":{"observed_at":"2026-08-06T17:42:32.108364Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2002.03939","last_updated":"2020-06-09T05:20:11Z","snapshot_observed_at":"2026-07-06T08:56:13.036996Z","submitted_at":"2020-02-10T16:48:03Z","title":"Qatten: A General Framework for Cooperative Multiagent Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2002.03939","snapshot_observed_at":"2026-08-06T17:42:31.962434Z","title":null,"venue":null,"work_id":null,"year":2002},"citing_paper":{"arxiv_id":"2507.10251","last_updated":"2025-07-14T13:18:13Z","snapshot_observed_at":"2026-08-06T17:33:20.360132Z","submitted_at":"2025-07-14T13:18:13Z","title":"ToMacVF : Temporal Macro-action Value Factorization for Asynchronous Multi-Agent Reinforcement Learning","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T17:42:31.962434Z"},"links":{"cited_paper":"/paper/2002.03939","citing_paper":"/paper/2507.10251"},"observation_digest":"sha256:97c12b68890dab26a71ceb1d00e2a2b4a308a3b53a62b8adf70c63738328011a","observation_id":"ccc3942c-aaf4-42c8-af05-541c2d1dae88","resolution":{"observed_at":"2026-08-06T17:42:31.962434Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:42:32.098877Z","title":null,"venue":null,"work_id":"483bd9f5-7c88-4878-a7c3-8929be90732b","year":2021},"citing_paper":{"arxiv_id":"2507.10251","last_updated":"2025-07-14T13:18:13Z","snapshot_observed_at":"2026-08-06T17:33:20.360132Z","submitted_at":"2025-07-14T13:18:13Z","title":"ToMacVF : Temporal Macro-action Value Factorization for Asynchronous Multi-Agent Reinforcement Learning","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T17:42:31.964784Z"},"links":{"citing_paper":"/paper/2507.10251"},"observation_digest":"sha256:1486f5aa4aa59ddbee493633c54ab2d3695d557129407ce5f25ca40790422141","observation_id":"df4d22d7-557a-4d19-8be0-0ee404368ebc","resolution":{"observed_at":"2026-08-06T17:42:32.101132Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1901.08004","last_updated":"2019-06-21T06:37:40Z","snapshot_observed_at":"2026-07-06T07:28:34.096059Z","submitted_at":"2019-01-23T17:08:15Z","title":"Hierarchical Reinforcement Learning for Multi-agent MOBA Game","version":6},"cited_work":{"arxiv_id":"1901.08004","doi":null,"metadata_source":"pith","pith_arxiv_id":"1901.08004","snapshot_observed_at":"2026-08-06T17:42:31.990660Z","title":"Hierarchical Reinforcement Learning for Multi-agent MOBA Game","venue":"cs.LG","work_id":"734b9c03-e8b8-4e57-a6e4-6f9578d7d6ca","year":2019},"citing_paper":{"arxiv_id":"2507.10251","last_updated":"2025-07-14T13:18:13Z","snapshot_observed_at":"2026-08-06T17:33:20.360132Z","submitted_at":"2025-07-14T13:18:13Z","title":"ToMacVF : Temporal Macro-action Value Factorization for Asynchronous Multi-Agent Reinforcement Learning","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T17:42:31.967163Z"},"links":{"cited_paper":"/paper/1901.08004","citing_paper":"/paper/2507.10251"},"observation_digest":"sha256:631ac72706442cdf426727c8a533f2399c2155d6024da793737cac6356788a48","observation_id":"d79e2eba-811b-4f73-8619-f2cc41268c39","resolution":{"observed_at":"2026-08-06T17:42:31.995475Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:42:32.091281Z","title":"go to tomato","venue":null,"work_id":"256a2e6d-00a3-4c3c-ab57-bfff1a1afb09","year":2020},"citing_paper":{"arxiv_id":"2507.10251","last_updated":"2025-07-14T13:18:13Z","snapshot_observed_at":"2026-08-06T17:33:20.360132Z","submitted_at":"2025-07-14T13:18:13Z","title":"ToMacVF : Temporal Macro-action Value Factorization for Asynchronous Multi-Agent Reinforcement Learning","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T17:42:31.969789Z"},"links":{"citing_paper":"/paper/2507.10251"},"observation_digest":"sha256:2d46d0b4697a70aea434eab2cefee3397b2b3518eee4035f440b15daea680a14","observation_id":"5e005ef1-12af-435f-aa95-f5422e99adac","resolution":{"observed_at":"2026-08-06T17:42:32.093800Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2507.10251","last_updated":"2025-07-14T13:18:13Z","latest_version":1,"primary_category":"cs.MA","snapshot_observed_at":"2026-08-06T17:33:20.360132Z","submitted_at":"2025-07-14T13:18:13Z","title":"ToMacVF : Temporal Macro-action Value Factorization for Asynchronous Multi-Agent Reinforcement Learning"},"reference_resolution":{"displayed":31,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":17,"verified_exact":3,"verified_fuzzy":11},"total_outbound_references":31},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 31 of 31 outbound references and 0 inbound Pith citation observations for arXiv:2507.10251."}