{"as_of":"2026-08-08T17:50:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:90fa093e249f409af622919106f6bf69438adcf14c24db73cfc22b4c405bd591","coverage":[{"denominator":92,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":92,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-13T03:08:01.590659Z","state":"measured"},{"denominator":92,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":92,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.09422/citation-record","integrity":"/paper/2607.09422/integrity","json":"/paper/2607.09422/citation-record.json","paper":"/paper/2607.09422"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T03:08:01.590659Z","title":"Sutton and Andrew G","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.09422","last_updated":"2026-07-10T13:50:29Z","snapshot_observed_at":"2026-08-02T03:29:36.466642Z","submitted_at":"2026-07-10T13:50:29Z","title":"Action-Factored Multi-Agent Reinforcement Learning for Scalable Quantum Device Tuning","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-07-13T03:08:01.590659Z"},"links":{"citing_paper":"/paper/2607.09422"},"observation_digest":"sha256:76ad1cc84cb4e800fdd5a047ee2c32f3fe6f0241e4f0c453cca319d154775ac7","observation_id":"1bd1218c-deb1-49d0-9066-bffdb2a36cb1","resolution":{"observed_at":"2026-07-13T03:08:01.590659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T03:08:01.590659Z","title":"Human-level control through deep reinforcement learning","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2607.09422","last_updated":"2026-07-10T13:50:29Z","snapshot_observed_at":"2026-08-02T03:29:36.466642Z","submitted_at":"2026-07-10T13:50:29Z","title":"Action-Factored Multi-Agent Reinforcement Learning for Scalable Quantum Device Tuning","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-07-13T03:08:01.590659Z"},"links":{"citing_paper":"/paper/2607.09422"},"observation_digest":"sha256:adc29c6e504db82cca501c2214df95df61c34ebcb9bc8d96a5971cb2b677524a","observation_id":"a9be09bc-2079-4ae0-bad4-2b63ae1d1c03","resolution":{"observed_at":"2026-07-13T03:08:01.590659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T03:08:01.590659Z","title":"Continuous control with deep reinforcement learning, September 15 2020","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.09422","last_updated":"2026-07-10T13:50:29Z","snapshot_observed_at":"2026-08-02T03:29:36.466642Z","submitted_at":"2026-07-10T13:50:29Z","title":"Action-Factored Multi-Agent Reinforcement Learning for Scalable Quantum Device Tuning","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-07-13T03:08:01.590659Z"},"links":{"citing_paper":"/paper/2607.09422"},"observation_digest":"sha256:b1c523edcae8843202b48d6ae27b0224482aead7adb7477721766b17949cdce0","observation_id":"151bfbb4-04e4-42da-89f3-626e5daa8baf","resolution":{"observed_at":"2026-07-13T03:08:01.590659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T03:08:01.590659Z","title":"Experimental deep reinforcement learning for error-robust gate-set design on a superconducting quantum computer","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.09422","last_updated":"2026-07-10T13:50:29Z","snapshot_observed_at":"2026-08-02T03:29:36.466642Z","submitted_at":"2026-07-10T13:50:29Z","title":"Action-Factored Multi-Agent Reinforcement Learning for Scalable Quantum Device Tuning","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-07-13T03:08:01.590659Z"},"links":{"citing_paper":"/paper/2607.09422"},"observation_digest":"sha256:d86e3c192c59c45c3a906bfa7c7c381f7a92a7cdf2532e17af984ebce287ec22","observation_id":"e6e2c0d6-4482-47b6-ad92-6f55b24a66fd","resolution":{"observed_at":"2026-07-13T03:08:01.590659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T03:08:01.590659Z","title":"Deep reinforcement learning quantum control on ibmq platforms and qiskit pulse","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.09422","last_updated":"2026-07-10T13:50:29Z","snapshot_observed_at":"2026-08-02T03:29:36.466642Z","submitted_at":"2026-07-10T13:50:29Z","title":"Action-Factored Multi-Agent Reinforcement Learning for Scalable Quantum Device Tuning","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-07-13T03:08:01.590659Z"},"links":{"citing_paper":"/paper/2607.09422"},"observation_digest":"sha256:b5dacc516b9d4e7adf202b4c4f6cfee2e05b2b68c5fd348353e07c3e4772c3b7","observation_id":"22e79d08-315d-488e-aa4e-f4ab7b60c26d","resolution":{"observed_at":"2026-07-13T03:08:01.590659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T03:08:01.590659Z","title":"Realizing a deep reinforcement learning agent for real-time quantum feedback","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.09422","last_updated":"2026-07-10T13:50:29Z","snapshot_observed_at":"2026-08-02T03:29:36.466642Z","submitted_at":"2026-07-10T13:50:29Z","title":"Action-Factored Multi-Agent Reinforcement Learning for Scalable Quantum Device Tuning","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-07-13T03:08:01.590659Z"},"links":{"citing_paper":"/paper/2607.09422"},"observation_digest":"sha256:57b624efaef3d660c80cd5b6b1e633d5a4a1af80f05df4118a4bb6f588728e3f","observation_id":"6f8d80e3-9162-42ae-829f-5cbb522fdc92","resolution":{"observed_at":"2026-07-13T03:08:01.590659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T03:08:01.590659Z","title":"Quantum feedback control with a transformer neural network architecture","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.09422","last_updated":"2026-07-10T13:50:29Z","snapshot_observed_at":"2026-08-02T03:29:36.466642Z","submitted_at":"2026-07-10T13:50:29Z","title":"Action-Factored Multi-Agent Reinforcement Learning for Scalable Quantum Device Tuning","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-07-13T03:08:01.590659Z"},"links":{"citing_paper":"/paper/2607.09422"},"observation_digest":"sha256:77fa4aaabba4a9007ae017fb9a1ab1948c4a5bfe7882fd6e59a8cd3ff2baa1e6","observation_id":"74b5e6ce-f7fd-4cb8-9332-4f0a49d97f28","resolution":{"observed_at":"2026-07-13T03:08:01.590659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T03:08:01.590659Z","title":"Deep reinforcement learning for efficient measurement of quantum devices","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.09422","last_updated":"2026-07-10T13:50:29Z","snapshot_observed_at":"2026-08-02T03:29:36.466642Z","submitted_at":"2026-07-10T13:50:29Z","title":"Action-Factored Multi-Agent Reinforcement Learning for Scalable Quantum Device Tuning","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-07-13T03:08:01.590659Z"},"links":{"citing_paper":"/paper/2607.09422"},"observation_digest":"sha256:eb3bd575e9ee023e2d86568dda51641296f1aac3fdee9cb746d7caa75698e786","observation_id":"e65c602f-24f7-4b91-84c6-42cf853bbb79","resolution":{"observed_at":"2026-07-13T03:08:01.590659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T03:08:01.590659Z","title":"Artificial intelligence for quantum computing","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.09422","last_updated":"2026-07-10T13:50:29Z","snapshot_observed_at":"2026-08-02T03:29:36.466642Z","submitted_at":"2026-07-10T13:50:29Z","title":"Action-Factored Multi-Agent Reinforcement Learning for Scalable Quantum Device Tuning","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-07-13T03:08:01.590659Z"},"links":{"citing_paper":"/paper/2607.09422"},"observation_digest":"sha256:d95f313901f8f0e1cef635694ef77f9301ecccac1293fb0828951220260af73f","observation_id":"3a99b18e-266d-48c8-8361-f9784fbee60f","resolution":{"observed_at":"2026-07-13T03:08:01.590659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2604.25884","last_updated":"2026-04-28T17:28:33Z","snapshot_observed_at":"2026-08-03T15:40:02.849060Z","submitted_at":"2026-04-28T17:28:33Z","title":"QCalEval: Benchmarking Vision-Language Models for Quantum Calibration Plot Understanding","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.25884","snapshot_observed_at":"2026-07-13T03:08:01.590659Z","title":"Qcaleval: Benchmarking vision- language models for quantum calibration plot understanding","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.09422","last_updated":"2026-07-10T13:50:29Z","snapshot_observed_at":"2026-08-02T03:29:36.466642Z","submitted_at":"2026-07-10T13:50:29Z","title":"Action-Factored Multi-Agent Reinforcement Learning for Scalable Quantum Device Tuning","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-07-13T03:08:01.590659Z"},"links":{"cited_paper":"/paper/2604.25884","citing_paper":"/paper/2607.09422"},"observation_digest":"sha256:4931f3e187c619beddebf338525d8034fc0fe6259b04b35549ffe06005a0fd3f","observation_id":"7137f5a3-e9fd-4c7e-abfc-5d409fc47332","resolution":{"observed_at":"2026-07-13T03:08:01.590659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T03:08:01.590659Z","title":"Machine learning as an enabler of qubit scalability","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.09422","last_updated":"2026-07-10T13:50:29Z","snapshot_observed_at":"2026-08-02T03:29:36.466642Z","submitted_at":"2026-07-10T13:50:29Z","title":"Action-Factored Multi-Agent Reinforcement Learning for Scalable Quantum Device Tuning","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-07-13T03:08:01.590659Z"},"links":{"citing_paper":"/paper/2607.09422"},"observation_digest":"sha256:7f7fd32d5816de8d746b89634689839416649c02fdedc01d5c41c404fa2cdada","observation_id":"581dfc40-3769-41ef-a1a2-0e0498191d3f","resolution":{"observed_at":"2026-07-13T03:08:01.590659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T03:08:01.590659Z","title":"Data needs and challenges for quantum dot devices automation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.09422","last_updated":"2026-07-10T13:50:29Z","snapshot_observed_at":"2026-08-02T03:29:36.466642Z","submitted_at":"2026-07-10T13:50:29Z","title":"Action-Factored Multi-Agent Reinforcement Learning for Scalable Quantum Device Tuning","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-07-13T03:08:01.590659Z"},"links":{"citing_paper":"/paper/2607.09422"},"observation_digest":"sha256:210ef40b148841bcda086fb416969d6ddddda802a74d074ad1f15fa392902ac5","observation_id":"8b36378a-c8a6-4f81-aad6-8697e635c341","resolution":{"observed_at":"2026-07-13T03:08:01.590659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T03:08:01.590659Z","title":"Environment model construction toward auto-tuning of quantum dot devices based on model-based reinforcement learning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.09422","last_updated":"2026-07-10T13:50:29Z","snapshot_observed_at":"2026-08-02T03:29:36.466642Z","submitted_at":"2026-07-10T13:50:29Z","title":"Action-Factored Multi-Agent Reinforcement Learning for Scalable Quantum Device Tuning","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-07-13T03:08:01.590659Z"},"links":{"citing_paper":"/paper/2607.09422"},"observation_digest":"sha256:d4e95ca398d34ed84a12a6ff25ab81e7d6714febbcbf7f45736a8b5fe7d65158","observation_id":"2d133019-9ea1-4e41-9f6c-b9ce76e04b5c","resolution":{"observed_at":"2026-07-13T03:08:01.590659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T03:08:01.590659Z","title":"Metasym: A symplectic meta-learning framework for physical intelligence","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.09422","last_updated":"2026-07-10T13:50:29Z","snapshot_observed_at":"2026-08-02T03:29:36.466642Z","submitted_at":"2026-07-10T13:50:29Z","title":"Action-Factored Multi-Agent Reinforcement Learning for Scalable Quantum Device Tuning","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-07-13T03:08:01.590659Z"},"links":{"citing_paper":"/paper/2607.09422"},"observation_digest":"sha256:3cc9f94c090d020d9945fd1a4fea6776904f28ef527162ecfff63c5fa5582264","observation_id":"b3acc95b-df24-47e2-8988-1ac83eacbde4","resolution":{"observed_at":"2026-07-13T03:08:01.590659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.10492","last_updated":"2025-03-13T15:56:58Z","snapshot_observed_at":"2026-08-08T15:02:39.129655Z","submitted_at":"2025-03-13T15:56:58Z","title":"Meta-learning characteristics and dynamics of quantum systems","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.10492","snapshot_observed_at":"2026-07-13T03:08:01.590659Z","title":"Meta-learning characteristics and dynamics of quantum systems","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.09422","last_updated":"2026-07-10T13:50:29Z","snapshot_observed_at":"2026-08-02T03:29:36.466642Z","submitted_at":"2026-07-10T13:50:29Z","title":"Action-Factored Multi-Agent Reinforcement Learning for Scalable Quantum Device Tuning","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-07-13T03:08:01.590659Z"},"links":{"cited_paper":"/paper/2503.10492","citing_paper":"/paper/2607.09422"},"observation_digest":"sha256:765560093ffcd2016908b9d5f4bd71ed87b0e861985f0ee0e849f1488ef8788c","observation_id":"61ee42ce-705b-4be6-b367-fea8e1351215","resolution":{"observed_at":"2026-07-13T03:08:01.590659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T03:08:01.590659Z","title":"Reinforcement learning for quantum technology","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.09422","last_updated":"2026-07-10T13:50:29Z","snapshot_observed_at":"2026-08-02T03:29:36.466642Z","submitted_at":"2026-07-10T13:50:29Z","title":"Action-Factored Multi-Agent Reinforcement Learning for Scalable Quantum Device Tuning","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-07-13T03:08:01.590659Z"},"links":{"citing_paper":"/paper/2607.09422"},"observation_digest":"sha256:64ce59cfa9b422121bb7aca3c184352fe3aae6ac5eb9b2c4dfc02b2ee0463d1d","observation_id":"5bfc2509-ea0e-446f-8856-516be4aff3f4","resolution":{"observed_at":"2026-07-13T03:08:01.590659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T03:08:01.590659Z","title":"Semiconductor qubits in practice","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.09422","last_updated":"2026-07-10T13:50:29Z","snapshot_observed_at":"2026-08-02T03:29:36.466642Z","submitted_at":"2026-07-10T13:50:29Z","title":"Action-Factored Multi-Agent Reinforcement Learning for Scalable Quantum Device Tuning","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-07-13T03:08:01.590659Z"},"links":{"citing_paper":"/paper/2607.09422"},"observation_digest":"sha256:4474593b4b35b588e9b24027de44147a3a7f3c3e6f6a64a34e93c188d98d0903","observation_id":"c2767651-6694-48ca-b1ae-3a68cd2998a3","resolution":{"observed_at":"2026-07-13T03:08:01.590659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T03:08:01.590659Z","title":"Spin-qubit control with a milli-kelvin cmos chip","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.09422","last_updated":"2026-07-10T13:50:29Z","snapshot_observed_at":"2026-08-02T03:29:36.466642Z","submitted_at":"2026-07-10T13:50:29Z","title":"Action-Factored Multi-Agent Reinforcement Learning for Scalable Quantum Device Tuning","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-07-13T03:08:01.590659Z"},"links":{"citing_paper":"/paper/2607.09422"},"observation_digest":"sha256:5c86fbe7033baf848da7bbabf3ea528d9c4dc98b0f04e0c2aa0ee9a2124b3301","observation_id":"2468619b-9ac2-4945-ab6d-c0eb94358691","resolution":{"observed_at":"2026-07-13T03:08:01.590659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T03:08:01.590659Z","title":"Industry-compatible silicon spin-qubit unit cells exceeding 99% fidelity","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.09422","last_updated":"2026-07-10T13:50:29Z","snapshot_observed_at":"2026-08-02T03:29:36.466642Z","submitted_at":"2026-07-10T13:50:29Z","title":"Action-Factored Multi-Agent Reinforcement Learning for Scalable Quantum Device Tuning","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-07-13T03:08:01.590659Z"},"links":{"citing_paper":"/paper/2607.09422"},"observation_digest":"sha256:38f52c11e00a32335b81b37152df94d000de843a1d7530548163c741c541c845","observation_id":"41882c9b-7a3d-4270-9574-8f72be96f717","resolution":{"observed_at":"2026-07-13T03:08:01.590659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T03:08:01.590659Z","title":"Simultaneous operation of an 18-qubit modular array in germanium","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.09422","last_updated":"2026-07-10T13:50:29Z","snapshot_observed_at":"2026-08-02T03:29:36.466642Z","submitted_at":"2026-07-10T13:50:29Z","title":"Action-Factored Multi-Agent Reinforcement Learning for Scalable Quantum Device Tuning","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-07-13T03:08:01.590659Z"},"links":{"citing_paper":"/paper/2607.09422"},"observation_digest":"sha256:47c9cb35fed79f601f381abca5caffb219dfc28dedcdadc38e73b1a20e4c7cb6","observation_id":"755e4a31-72dd-48b2-908a-e07bd9906429","resolution":{"observed_at":"2026-07-13T03:08:01.590659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T03:08:01.590659Z","title":"Shared control of a 16 semiconductor quantum dot crossbar array","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.09422","last_updated":"2026-07-10T13:50:29Z","snapshot_observed_at":"2026-08-02T03:29:36.466642Z","submitted_at":"2026-07-10T13:50:29Z","title":"Action-Factored Multi-Agent Reinforcement Learning for Scalable Quantum Device Tuning","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-07-13T03:08:01.590659Z"},"links":{"citing_paper":"/paper/2607.09422"},"observation_digest":"sha256:724ea433cc909a7d0dfaaa25eddd13fcfb88488e003b2c03d14491ea8514c0b8","observation_id":"d1ec93f1-d623-4f79-b03d-366041ea9f29","resolution":{"observed_at":"2026-07-13T03:08:01.590659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T03:08:01.590659Z","title":"Fully autonomous tuning of a spin qubit","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.09422","last_updated":"2026-07-10T13:50:29Z","snapshot_observed_at":"2026-08-02T03:29:36.466642Z","submitted_at":"2026-07-10T13:50:29Z","title":"Action-Factored Multi-Agent Reinforcement Learning for Scalable Quantum Device Tuning","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-07-13T03:08:01.590659Z"},"links":{"citing_paper":"/paper/2607.09422"},"observation_digest":"sha256:b6276e32c69f236b05cdfbeb8c34777d4484115248499d55b9f83b2ca5655a42","observation_id":"b36fe8b4-f77d-42a0-bf41-4b2ac2c61d43","resolution":{"observed_at":"2026-07-13T03:08:01.590659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T03:08:01.590659Z","title":"Machine learning enables completely automatic tuning of a quantum device faster than human experts","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.09422","last_updated":"2026-07-10T13:50:29Z","snapshot_observed_at":"2026-08-02T03:29:36.466642Z","submitted_at":"2026-07-10T13:50:29Z","title":"Action-Factored Multi-Agent Reinforcement Learning for Scalable Quantum Device Tuning","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-07-13T03:08:01.590659Z"},"links":{"citing_paper":"/paper/2607.09422"},"observation_digest":"sha256:f344a77b5fdf8ba2c5e1851478c55334b774d1f1a0ec73535403f4223b60d790","observation_id":"fbea905d-a3a2-4ba6-910a-2e53893f3eb0","resolution":{"observed_at":"2026-07-13T03:08:01.590659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T03:08:01.590659Z","title":"Autotuning of double-dot devices in situ with machine learning","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.09422","last_updated":"2026-07-10T13:50:29Z","snapshot_observed_at":"2026-08-02T03:29:36.466642Z","submitted_at":"2026-07-10T13:50:29Z","title":"Action-Factored Multi-Agent Reinforcement Learning for Scalable Quantum Device Tuning","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-07-13T03:08:01.590659Z"},"links":{"citing_paper":"/paper/2607.09422"},"observation_digest":"sha256:7f05f54db9aa47a3a95dbc9f19e2baead6291e229a25ff2d57ba4f5df27b4da7","observation_id":"e4093dbf-9116-4174-87b1-0ef77973f45c","resolution":{"observed_at":"2026-07-13T03:08:01.590659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2509.19537","last_updated":"2025-09-23T20:03:47Z","snapshot_observed_at":"2026-07-06T22:30:36.671861Z","submitted_at":"2025-09-23T20:03:47Z","title":"Rapid Autotuning of a SiGe Quantum Dot into the Single-Electron Regime with Machine Learning and RF-Reflectometry FPGA-Based Measurements","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.19537","snapshot_observed_at":"2026-07-13T03:08:01.590659Z","title":"Rapid autotuning of a sige quantum dot into the single-electron regime with machine learning and rf-reflectometry fpga-based measurements","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.09422","last_updated":"2026-07-10T13:50:29Z","snapshot_observed_at":"2026-08-02T03:29:36.466642Z","submitted_at":"2026-07-10T13:50:29Z","title":"Action-Factored Multi-Agent Reinforcement Learning for Scalable Quantum Device Tuning","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-07-13T03:08:01.590659Z"},"links":{"cited_paper":"/paper/2509.19537","citing_paper":"/paper/2607.09422"},"observation_digest":"sha256:a863a27bbb4afee6ca44d56dc608cc027732aad2ed8cd55541a2e9c35b527269","observation_id":"3dbb4844-336c-4632-9ee5-609513e79b4f","resolution":{"observed_at":"2026-07-13T03:08:01.590659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.10834","last_updated":"2025-06-12T15:52:53Z","snapshot_observed_at":"2026-08-07T11:59:04.446858Z","submitted_at":"2025-06-12T15:52:53Z","title":"Automated All-RF Tuning for Spin Qubit Readout and Control","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.10834","snapshot_observed_at":"2026-07-13T03:08:01.590659Z","title":"Automated all-rf tuning for spin qubit readout and control","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.09422","last_updated":"2026-07-10T13:50:29Z","snapshot_observed_at":"2026-08-02T03:29:36.466642Z","submitted_at":"2026-07-10T13:50:29Z","title":"Action-Factored Multi-Agent Reinforcement Learning for Scalable Quantum Device Tuning","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-07-13T03:08:01.590659Z"},"links":{"cited_paper":"/paper/2506.10834","citing_paper":"/paper/2607.09422"},"observation_digest":"sha256:d366e0682073756e36aa0b3c6612ee53dfa0d6b51b27747efad57a86893a8c36","observation_id":"f78466a5-36f1-4c43-8728-bd18991858bc","resolution":{"observed_at":"2026-07-13T03:08:01.590659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T03:08:01.590659Z","title":"Cooperative multi-agent control using deep reinforcement learning","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.09422","last_updated":"2026-07-10T13:50:29Z","snapshot_observed_at":"2026-08-02T03:29:36.466642Z","submitted_at":"2026-07-10T13:50:29Z","title":"Action-Factored Multi-Agent Reinforcement Learning for Scalable Quantum Device Tuning","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-07-13T03:08:01.590659Z"},"links":{"citing_paper":"/paper/2607.09422"},"observation_digest":"sha256:73567d127f0dce1fd90b722b0f0edef7b9b207191df30600247a38f487a3f9c3","observation_id":"ebe9f24c-2eb5-4c11-9cfe-af939060ad45","resolution":{"observed_at":"2026-07-13T03:08:01.590659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T03:08:01.590659Z","title":"Computer-automated tuning of semiconductor double quantum dots into the single-electron regime","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2607.09422","last_updated":"2026-07-10T13:50:29Z","snapshot_observed_at":"2026-08-02T03:29:36.466642Z","submitted_at":"2026-07-10T13:50:29Z","title":"Action-Factored Multi-Agent Reinforcement Learning for Scalable Quantum Device Tuning","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-07-13T03:08:01.590659Z"},"links":{"citing_paper":"/paper/2607.09422"},"observation_digest":"sha256:9c3cdf42733f61b89bce678b9ac8f3d12e9c970aa61be245a106f8557b84c82d","observation_id":"9fb1c3ec-8c61-4346-b2de-89498fbbc436","resolution":{"observed_at":"2026-07-13T03:08:01.590659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T03:08:01.590659Z","title":"Experimental online quantum dots charge autotuning using neural networks","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.09422","last_updated":"2026-07-10T13:50:29Z","snapshot_observed_at":"2026-08-02T03:29:36.466642Z","submitted_at":"2026-07-10T13:50:29Z","title":"Action-Factored Multi-Agent Reinforcement Learning for Scalable Quantum Device Tuning","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-07-13T03:08:01.590659Z"},"links":{"citing_paper":"/paper/2607.09422"},"observation_digest":"sha256:e88d06b3b6ef940ff6eba90a69c006008c2153e6a489c788d0e0d07a311008be","observation_id":"c65c7ecb-f428-471b-b1a0-1105514b3d7f","resolution":{"observed_at":"2026-07-13T03:08:01.590659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T03:08:01.590659Z","title":"Machine learning techniques for state recognition and auto-tuning in quantum dots","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.09422","last_updated":"2026-07-10T13:50:29Z","snapshot_observed_at":"2026-08-02T03:29:36.466642Z","submitted_at":"2026-07-10T13:50:29Z","title":"Action-Factored Multi-Agent Reinforcement Learning for Scalable Quantum Device Tuning","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-07-13T03:08:01.590659Z"},"links":{"citing_paper":"/paper/2607.09422"},"observation_digest":"sha256:ebf1a28d6f1dff4b48706a73e282f7c7823adef3464688f1346c8b69c7a91049","observation_id":"b03d3c77-d162-4342-9b14-2cb5a9bba1a4","resolution":{"observed_at":"2026-07-13T03:08:01.590659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T03:08:01.590659Z","title":"Tuning arrays with rays: Physics-informed tuning of quantum dot charge states","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.09422","last_updated":"2026-07-10T13:50:29Z","snapshot_observed_at":"2026-08-02T03:29:36.466642Z","submitted_at":"2026-07-10T13:50:29Z","title":"Action-Factored Multi-Agent Reinforcement Learning for Scalable Quantum Device Tuning","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-07-13T03:08:01.590659Z"},"links":{"citing_paper":"/paper/2607.09422"},"observation_digest":"sha256:9592152f801aeea4492e0932145f5dbc4b2d1890f40a14d68e4454f62eb99368","observation_id":"d4d86b8b-362e-4653-bd3f-ee516bce0c87","resolution":{"observed_at":"2026-07-13T03:08:01.590659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T03:08:01.590659Z","title":"All-rf-based coarse-tuning algorithm for quantum devices using machine learning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.09422","last_updated":"2026-07-10T13:50:29Z","snapshot_observed_at":"2026-08-02T03:29:36.466642Z","submitted_at":"2026-07-10T13:50:29Z","title":"Action-Factored Multi-Agent Reinforcement Learning for Scalable Quantum Device Tuning","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-07-13T03:08:01.590659Z"},"links":{"citing_paper":"/paper/2607.09422"},"observation_digest":"sha256:2ccf63f512fee0a6f15f3f7caac683d2645fc10a1640988b10d1790e8f2601e5","observation_id":"5eff1e41-4a95-40d6-b7d6-292472c79c7e","resolution":{"observed_at":"2026-07-13T03:08:01.590659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T03:08:01.590659Z","title":"Automated tuning of double quantum dots into specific charge states using neural networks","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.09422","last_updated":"2026-07-10T13:50:29Z","snapshot_observed_at":"2026-08-02T03:29:36.466642Z","submitted_at":"2026-07-10T13:50:29Z","title":"Action-Factored Multi-Agent Reinforcement Learning for Scalable Quantum Device Tuning","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-07-13T03:08:01.590659Z"},"links":{"citing_paper":"/paper/2607.09422"},"observation_digest":"sha256:89ce19e94e1b9a2196d76ec52264e39fb243ef6fcf9ed7b97590a85c8afef5ed","observation_id":"99b5cc7c-e79e-47bb-9761-d9d719274dc6","resolution":{"observed_at":"2026-07-13T03:08:01.590659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T03:08:01.590659Z","title":"Minia- turizing neural networks for charge state autotuning in quantum dots","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.09422","last_updated":"2026-07-10T13:50:29Z","snapshot_observed_at":"2026-08-02T03:29:36.466642Z","submitted_at":"2026-07-10T13:50:29Z","title":"Action-Factored Multi-Agent Reinforcement Learning for Scalable Quantum Device Tuning","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-07-13T03:08:01.590659Z"},"links":{"citing_paper":"/paper/2607.09422"},"observation_digest":"sha256:a246cba71c9239d80c70a25d1fb64c0b4406151d2dcfe7310936f8b5910e7af8","observation_id":"ca9df888-eb4e-4e56-94c7-ff4e56cc91dc","resolution":{"observed_at":"2026-07-13T03:08:01.590659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T03:08:01.590659Z","title":"Quantum device fine-tuning using unsupervised embedding learning","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.09422","last_updated":"2026-07-10T13:50:29Z","snapshot_observed_at":"2026-08-02T03:29:36.466642Z","submitted_at":"2026-07-10T13:50:29Z","title":"Action-Factored Multi-Agent Reinforcement Learning for Scalable Quantum Device Tuning","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-07-13T03:08:01.590659Z"},"links":{"citing_paper":"/paper/2607.09422"},"observation_digest":"sha256:316b859ce135ae2fb436dfc0f06a5041d3b874593173bdf00be36974c0941ecd","observation_id":"9304ecd0-b3bc-4bf6-8c01-fd92ce40a0d2","resolution":{"observed_at":"2026-07-13T03:08:01.590659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T03:08:01.590659Z","title":"Cross-architecture tuning of silicon and sige-based quantum devices using machine learning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.09422","last_updated":"2026-07-10T13:50:29Z","snapshot_observed_at":"2026-08-02T03:29:36.466642Z","submitted_at":"2026-07-10T13:50:29Z","title":"Action-Factored Multi-Agent Reinforcement Learning for Scalable Quantum Device Tuning","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-07-13T03:08:01.590659Z"},"links":{"citing_paper":"/paper/2607.09422"},"observation_digest":"sha256:7f3ea7ffbc0fe1eb6c21dee6e63bb45037a45ca8ae5d043f0ee8fb68c8e8e36c","observation_id":"206fb4cc-7706-4adc-808d-4f8f8083420f","resolution":{"observed_at":"2026-07-13T03:08:01.590659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T03:08:01.590659Z","title":"Loading a quantum-dot based “qubyte” register","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.09422","last_updated":"2026-07-10T13:50:29Z","snapshot_observed_at":"2026-08-02T03:29:36.466642Z","submitted_at":"2026-07-10T13:50:29Z","title":"Action-Factored Multi-Agent Reinforcement Learning for Scalable Quantum Device Tuning","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-07-13T03:08:01.590659Z"},"links":{"citing_paper":"/paper/2607.09422"},"observation_digest":"sha256:0025397e750bfcfa1f0909ed99209d9ef3629a26d32d77f4a768452a01580971","observation_id":"cfb6999d-93f0-4903-bf92-1c2895fc4910","resolution":{"observed_at":"2026-07-13T03:08:01.590659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T03:08:01.590659Z","title":"Cnn-assisted automatic cross-capacitance matrix update for virtual-gate control of quantum dot arrays","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.09422","last_updated":"2026-07-10T13:50:29Z","snapshot_observed_at":"2026-08-02T03:29:36.466642Z","submitted_at":"2026-07-10T13:50:29Z","title":"Action-Factored Multi-Agent Reinforcement Learning for Scalable Quantum Device Tuning","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-07-13T03:08:01.590659Z"},"links":{"citing_paper":"/paper/2607.09422"},"observation_digest":"sha256:8b390d621041f1e853106980d41bd368322dd4c05c85d936d8d4a31458b51667","observation_id":"8157b114-40f6-4a10-9fb3-41587d04b8a1","resolution":{"observed_at":"2026-07-13T03:08:01.590659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T03:08:01.590659Z","title":"Modular autonomous virtualization system for two-dimensional semiconductor quantum dot arrays","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.09422","last_updated":"2026-07-10T13:50:29Z","snapshot_observed_at":"2026-08-02T03:29:36.466642Z","submitted_at":"2026-07-10T13:50:29Z","title":"Action-Factored Multi-Agent Reinforcement Learning for Scalable Quantum Device Tuning","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-07-13T03:08:01.590659Z"},"links":{"citing_paper":"/paper/2607.09422"},"observation_digest":"sha256:de93be91fdd55b5d44df62af8456ef5d46462c14c4eb9d1e13bdde24cd3abf38","observation_id":"41b42b82-76a4-40ce-9947-f2598eada88b","resolution":{"observed_at":"2026-07-13T03:08:01.590659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T03:08:01.590659Z","title":"Automatic detection of single-electron regime of quantum dots and definition of virtual gates using u-net and clustering","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.09422","last_updated":"2026-07-10T13:50:29Z","snapshot_observed_at":"2026-08-02T03:29:36.466642Z","submitted_at":"2026-07-10T13:50:29Z","title":"Action-Factored Multi-Agent Reinforcement Learning for Scalable Quantum Device Tuning","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-07-13T03:08:01.590659Z"},"links":{"citing_paper":"/paper/2607.09422"},"observation_digest":"sha256:e101e2c702d99afb60816b5657eb10de60030d10d3305c02142b31322f844f2b","observation_id":"f000d5c6-b12e-4b60-95d1-4414851a662e","resolution":{"observed_at":"2026-07-13T03:08:01.590659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T03:08:01.590659Z","title":"Automated charge transition detection in quantum dot charge stability diagrams","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.09422","last_updated":"2026-07-10T13:50:29Z","snapshot_observed_at":"2026-08-02T03:29:36.466642Z","submitted_at":"2026-07-10T13:50:29Z","title":"Action-Factored Multi-Agent Reinforcement Learning for Scalable Quantum Device Tuning","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-07-13T03:08:01.590659Z"},"links":{"citing_paper":"/paper/2607.09422"},"observation_digest":"sha256:6ba326ce727290d0f09c4b8e0db5e99c9bb3d90ae7b25ca68f3476a0e6537d4b","observation_id":"4b11772f-936e-4d52-a92f-c54cf1128f61","resolution":{"observed_at":"2026-07-13T03:08:01.590659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.15710","last_updated":"2025-08-21T16:54:22Z","snapshot_observed_at":"2026-08-08T03:54:01.326626Z","submitted_at":"2025-08-21T16:54:22Z","title":"End-to-End Analysis of Charge Stability Diagrams with Transformers","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.15710","snapshot_observed_at":"2026-07-13T03:08:01.590659Z","title":"End-to-end analysis of charge stability diagrams with transformers","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.09422","last_updated":"2026-07-10T13:50:29Z","snapshot_observed_at":"2026-08-02T03:29:36.466642Z","submitted_at":"2026-07-10T13:50:29Z","title":"Action-Factored Multi-Agent Reinforcement Learning for Scalable Quantum Device Tuning","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-07-13T03:08:01.590659Z"},"links":{"cited_paper":"/paper/2508.15710","citing_paper":"/paper/2607.09422"},"observation_digest":"sha256:e28ad167297e93cf4aab32854d661ead3ce2fb6e91862887f8d6402addba4f2f","observation_id":"3b3cc618-77fb-4e91-a78c-7e860382c94e","resolution":{"observed_at":"2026-07-13T03:08:01.590659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2012.03685","last_updated":"2024-11-22T14:04:59Z","snapshot_observed_at":"2026-07-06T10:21:23.501948Z","submitted_at":"2020-12-07T13:37:09Z","title":"Automatic virtual voltage extraction of a 2x2 array of quantum dots with machine learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2012.03685","snapshot_observed_at":"2026-07-13T03:08:01.590659Z","title":"Auto- matic virtual voltage extraction of a 2x2 array of quantum dots with machine learning","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2607.09422","last_updated":"2026-07-10T13:50:29Z","snapshot_observed_at":"2026-08-02T03:29:36.466642Z","submitted_at":"2026-07-10T13:50:29Z","title":"Action-Factored Multi-Agent Reinforcement Learning for Scalable Quantum Device Tuning","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-07-13T03:08:01.590659Z"},"links":{"cited_paper":"/paper/2012.03685","citing_paper":"/paper/2607.09422"},"observation_digest":"sha256:2f258364fc7570ed2ef7aeddd4e5979d4564e9ff8156b24c7f389b8fa495a09c","observation_id":"19bf288e-7abf-4a0a-9d83-594f895a03f0","resolution":{"observed_at":"2026-07-13T03:08:01.590659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T03:08:01.590659Z","title":"A review of cooperative multi-agent deep reinforcement learning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.09422","last_updated":"2026-07-10T13:50:29Z","snapshot_observed_at":"2026-08-02T03:29:36.466642Z","submitted_at":"2026-07-10T13:50:29Z","title":"Action-Factored Multi-Agent Reinforcement Learning for Scalable Quantum Device Tuning","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-07-13T03:08:01.590659Z"},"links":{"citing_paper":"/paper/2607.09422"},"observation_digest":"sha256:10c1f9e59d7febfa01bb9ec864d3687fa250b2982b648486d2bc4b690be901b0","observation_id":"ecf4914b-d5d6-4e52-b294-45593335a54d","resolution":{"observed_at":"2026-07-13T03:08:01.590659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T03:08:01.590659Z","title":"Multi-agent reinforcement learning: Independent vs","venue":null,"work_id":null,"year":1993},"citing_paper":{"arxiv_id":"2607.09422","last_updated":"2026-07-10T13:50:29Z","snapshot_observed_at":"2026-08-02T03:29:36.466642Z","submitted_at":"2026-07-10T13:50:29Z","title":"Action-Factored Multi-Agent Reinforcement Learning for Scalable Quantum Device Tuning","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-07-13T03:08:01.590659Z"},"links":{"citing_paper":"/paper/2607.09422"},"observation_digest":"sha256:7059197426f52c109af7e98d82335eeca8d7fc556b9fcf917337e0112e4035aa","observation_id":"396d1517-1c89-4b4b-b890-0d71558d9ae6","resolution":{"observed_at":"2026-07-13T03:08:01.590659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1706.05296","last_updated":"2017-06-16T14:47:21Z","snapshot_observed_at":"2026-07-06T05:47:10.770104Z","submitted_at":"2017-06-16T14:47:21Z","title":"Value-Decomposition Networks For Cooperative Multi-Agent Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1706.05296","snapshot_observed_at":"2026-07-13T03:08:01.590659Z","title":"Value-decomposition networks for cooperative multi-agent learning","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.09422","last_updated":"2026-07-10T13:50:29Z","snapshot_observed_at":"2026-08-02T03:29:36.466642Z","submitted_at":"2026-07-10T13:50:29Z","title":"Action-Factored Multi-Agent Reinforcement Learning for Scalable Quantum Device Tuning","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-07-13T03:08:01.590659Z"},"links":{"cited_paper":"/paper/1706.05296","citing_paper":"/paper/2607.09422"},"observation_digest":"sha256:9214bb5a7cb78f289b022d660cda952381260a9115d65820b98ea92156b67664","observation_id":"fc67145e-d63a-487f-a903-ef1664593bb2","resolution":{"observed_at":"2026-07-13T03:08:01.590659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T03:08:01.590659Z","title":"Monotonic value function factorisation for deep multi-agent reinforcement learning","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.09422","last_updated":"2026-07-10T13:50:29Z","snapshot_observed_at":"2026-08-02T03:29:36.466642Z","submitted_at":"2026-07-10T13:50:29Z","title":"Action-Factored Multi-Agent Reinforcement Learning for Scalable Quantum Device Tuning","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-07-13T03:08:01.590659Z"},"links":{"citing_paper":"/paper/2607.09422"},"observation_digest":"sha256:381ac2fb1e2a33301c6dd2c52fa4a7866a3027ff101eda8c609567e62f2fd7eb","observation_id":"ce7a2c94-16bd-4793-9013-2550a57dff2f","resolution":{"observed_at":"2026-07-13T03:08:01.590659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T03:08:01.590659Z","title":"Qtran: Learning to factorize with transformation for cooperative multi-agent reinforcement learning","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.09422","last_updated":"2026-07-10T13:50:29Z","snapshot_observed_at":"2026-08-02T03:29:36.466642Z","submitted_at":"2026-07-10T13:50:29Z","title":"Action-Factored Multi-Agent Reinforcement Learning for Scalable Quantum Device Tuning","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-07-13T03:08:01.590659Z"},"links":{"citing_paper":"/paper/2607.09422"},"observation_digest":"sha256:518c19b1b8cad306f3de8f397fc083af13ae537461eaaf6990a360e94bb12bc8","observation_id":"0524ac63-68c4-4c7e-9f62-2f6f7d1b3b68","resolution":{"observed_at":"2026-07-13T03:08:01.590659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2003.06709","last_updated":"2021-05-07T14:03:40Z","snapshot_observed_at":"2026-07-06T09:04:43.836543Z","submitted_at":"2020-03-14T21:29:09Z","title":"FACMAC: Factored Multi-Agent Centralised Policy Gradients","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2003.06709","snapshot_observed_at":"2026-07-13T03:08:01.590659Z","title":"Deep multi-agent reinforcement learning for decentralized continuous cooperative control","venue":null,"work_id":null,"year":2003},"citing_paper":{"arxiv_id":"2607.09422","last_updated":"2026-07-10T13:50:29Z","snapshot_observed_at":"2026-08-02T03:29:36.466642Z","submitted_at":"2026-07-10T13:50:29Z","title":"Action-Factored Multi-Agent Reinforcement Learning for Scalable Quantum Device Tuning","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-07-13T03:08:01.590659Z"},"links":{"cited_paper":"/paper/2003.06709","citing_paper":"/paper/2607.09422"},"observation_digest":"sha256:886ce132b2f9d61eab4c362a398fcc919d07618355f0bcd37296835298dae273","observation_id":"d64e32cc-5e5a-4705-90a0-2afb2f7ad6db","resolution":{"observed_at":"2026-07-13T03:08:01.590659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T03:08:01.590659Z","title":"Coun- terfactual multi-agent policy gradients","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.09422","last_updated":"2026-07-10T13:50:29Z","snapshot_observed_at":"2026-08-02T03:29:36.466642Z","submitted_at":"2026-07-10T13:50:29Z","title":"Action-Factored Multi-Agent Reinforcement Learning for Scalable Quantum Device Tuning","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-07-13T03:08:01.590659Z"},"links":{"citing_paper":"/paper/2607.09422"},"observation_digest":"sha256:dee6e222be6e3200172f223abdf6557c558959ed98b14dafd1413ccd35b6b3c0","observation_id":"5e5c60c3-a80e-49a3-a5bb-68dcc5832f13","resolution":{"observed_at":"2026-07-13T03:08:01.590659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T03:08:01.590659Z","title":"Multi-agent actor-critic for mixed cooperative-competitive environments","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.09422","last_updated":"2026-07-10T13:50:29Z","snapshot_observed_at":"2026-08-02T03:29:36.466642Z","submitted_at":"2026-07-10T13:50:29Z","title":"Action-Factored Multi-Agent Reinforcement Learning for Scalable Quantum Device Tuning","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-07-13T03:08:01.590659Z"},"links":{"citing_paper":"/paper/2607.09422"},"observation_digest":"sha256:73717356535b81a775be1c677b6a8ca4a9de9862b0078713e40ebb7dc624777a","observation_id":"192b7bfb-fb6c-4659-8964-81f693d91cf3","resolution":{"observed_at":"2026-07-13T03:08:01.590659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T03:08:01.590659Z","title":"Facmac: Factored multi-agent centralised policy gradients","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.09422","last_updated":"2026-07-10T13:50:29Z","snapshot_observed_at":"2026-08-02T03:29:36.466642Z","submitted_at":"2026-07-10T13:50:29Z","title":"Action-Factored Multi-Agent Reinforcement Learning for Scalable Quantum Device Tuning","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-07-13T03:08:01.590659Z"},"links":{"citing_paper":"/paper/2607.09422"},"observation_digest":"sha256:090b8b0fb44bc88097ec72a6233ddb1798a62e24630c36e668f42d9d1ec3a5a5","observation_id":"6199cbde-5daa-46a3-8d8a-90a4cb74320c","resolution":{"observed_at":"2026-07-13T03:08:01.590659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T03:08:01.590659Z","title":"Learning multiagent communication with backpropagation","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2607.09422","last_updated":"2026-07-10T13:50:29Z","snapshot_observed_at":"2026-08-02T03:29:36.466642Z","submitted_at":"2026-07-10T13:50:29Z","title":"Action-Factored Multi-Agent Reinforcement Learning for Scalable Quantum Device Tuning","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-07-13T03:08:01.590659Z"},"links":{"citing_paper":"/paper/2607.09422"},"observation_digest":"sha256:ee436b933838968850d9fba064ddba908d724af050c6d6072e946363d65ebc02","observation_id":"914a6233-dfea-44fe-8000-956034a36e6e","resolution":{"observed_at":"2026-07-13T03:08:01.590659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T03:08:01.590659Z","title":"Graph policy gradients for large scale robot control","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.09422","last_updated":"2026-07-10T13:50:29Z","snapshot_observed_at":"2026-08-02T03:29:36.466642Z","submitted_at":"2026-07-10T13:50:29Z","title":"Action-Factored Multi-Agent Reinforcement Learning for Scalable Quantum Device Tuning","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-07-13T03:08:01.590659Z"},"links":{"citing_paper":"/paper/2607.09422"},"observation_digest":"sha256:92d7d1f5276d8674f212365dda5b145bb854c823bd33eebf27f0bba83ece4a19","observation_id":"47dd2af0-caa8-4642-a209-a6d94ad2378b","resolution":{"observed_at":"2026-07-13T03:08:01.590659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T03:08:01.590659Z","title":"Scalable multi-agent reinforcement learning through intelligent information aggregation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.09422","last_updated":"2026-07-10T13:50:29Z","snapshot_observed_at":"2026-08-02T03:29:36.466642Z","submitted_at":"2026-07-10T13:50:29Z","title":"Action-Factored Multi-Agent Reinforcement Learning for Scalable Quantum Device Tuning","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-07-13T03:08:01.590659Z"},"links":{"citing_paper":"/paper/2607.09422"},"observation_digest":"sha256:1b61e7405f06efab0b0fece0f9b467f15946aa8383ea318abe8caf3c2fba241f","observation_id":"88f683a2-5656-42fb-b8ca-96803cba2469","resolution":{"observed_at":"2026-07-13T03:08:01.590659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1812.00922","last_updated":"2018-12-03T17:27:41Z","snapshot_observed_at":"2026-07-06T07:18:46.717192Z","submitted_at":"2018-12-03T17:27:41Z","title":"Multi-agent Deep Reinforcement Learning with Extremely Noisy Observations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1812.00922","snapshot_observed_at":"2026-07-13T03:08:01.590659Z","title":"Multi-agent deep reinforcement learning with extremely noisy observations","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.09422","last_updated":"2026-07-10T13:50:29Z","snapshot_observed_at":"2026-08-02T03:29:36.466642Z","submitted_at":"2026-07-10T13:50:29Z","title":"Action-Factored Multi-Agent Reinforcement Learning for Scalable Quantum Device Tuning","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-07-13T03:08:01.590659Z"},"links":{"cited_paper":"/paper/1812.00922","citing_paper":"/paper/2607.09422"},"observation_digest":"sha256:359f44f3a7550bbe405dff2d34ae46565f6e7554ed49df78a1b903bab8e326be","observation_id":"d9a7e3d6-236c-4c32-806b-e23b45ff8226","resolution":{"observed_at":"2026-07-13T03:08:01.590659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2604.13472","last_updated":"2026-07-27T13:24:09Z","snapshot_observed_at":"2026-08-02T16:21:01.098429Z","submitted_at":"2026-04-15T04:52:22Z","title":"Bridging MARL to SARL: An Order-Independent Multi-Agent Transformer via Latent Consensus","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.13472","snapshot_observed_at":"2026-07-13T03:08:01.590659Z","title":"Bridging marl to sarl: An order-independent multi-agent transformer via latent consensus","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.09422","last_updated":"2026-07-10T13:50:29Z","snapshot_observed_at":"2026-08-02T03:29:36.466642Z","submitted_at":"2026-07-10T13:50:29Z","title":"Action-Factored Multi-Agent Reinforcement Learning for Scalable Quantum Device Tuning","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-07-13T03:08:01.590659Z"},"links":{"cited_paper":"/paper/2604.13472","citing_paper":"/paper/2607.09422"},"observation_digest":"sha256:7c9f207075e2edfd26df7743307e9e28a4fd5ad482b8a1d16baa69cc37e13741","observation_id":"88069d6a-9a26-46e2-9735-4ffaba853dc0","resolution":{"observed_at":"2026-07-13T03:08:01.590659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T03:08:01.590659Z","title":"Multi- agent reinforcement learning is a sequence modeling problem.Advances in Neural Information Processing Systems, 35:16509–16521, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.09422","last_updated":"2026-07-10T13:50:29Z","snapshot_observed_at":"2026-08-02T03:29:36.466642Z","submitted_at":"2026-07-10T13:50:29Z","title":"Action-Factored Multi-Agent Reinforcement Learning for Scalable Quantum Device Tuning","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-07-13T03:08:01.590659Z"},"links":{"citing_paper":"/paper/2607.09422"},"observation_digest":"sha256:e69d75759c1592957da6c5bb8a4617fd93b01f0b89968bbf8f42213e4f0d1f45","observation_id":"a9e7d60e-dd80-4d79-b470-cb270a65bb31","resolution":{"observed_at":"2026-07-13T03:08:01.590659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T03:08:01.590659Z","title":"Hierarchical consensus-based multi-agent reinforcement learning for multi-robot cooperation tasks","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.09422","last_updated":"2026-07-10T13:50:29Z","snapshot_observed_at":"2026-08-02T03:29:36.466642Z","submitted_at":"2026-07-10T13:50:29Z","title":"Action-Factored Multi-Agent Reinforcement Learning for Scalable Quantum Device Tuning","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-07-13T03:08:01.590659Z"},"links":{"citing_paper":"/paper/2607.09422"},"observation_digest":"sha256:867daefda3d1906de6c03073869f1e1751cf6fe0d115dedfbebca7a04c55543b","observation_id":"32c25a18-5a2c-4f2f-82c8-8ecae50b2478","resolution":{"observed_at":"2026-07-13T03:08:01.590659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T03:08:01.590659Z","title":"Scaling multi-agent reinforcement learning with selective parameter sharing","venue":null,"work_id":null,"year":1989},"citing_paper":{"arxiv_id":"2607.09422","last_updated":"2026-07-10T13:50:29Z","snapshot_observed_at":"2026-08-02T03:29:36.466642Z","submitted_at":"2026-07-10T13:50:29Z","title":"Action-Factored Multi-Agent Reinforcement Learning for Scalable Quantum Device Tuning","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-07-13T03:08:01.590659Z"},"links":{"citing_paper":"/paper/2607.09422"},"observation_digest":"sha256:0ce2be29e549512c5341674da054891ca31aa50db126aa2f9a11e843b2924749","observation_id":"7597a568-6322-4be0-8abb-2d2bb0de3b8e","resolution":{"observed_at":"2026-07-13T03:08:01.590659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2011.09533","last_updated":"2020-11-18T20:29:59Z","snapshot_observed_at":"2026-08-06T15:48:23.562152Z","submitted_at":"2020-11-18T20:29:59Z","title":"Is Independent Learning All You Need in the StarCraft Multi-Agent Challenge?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2011.09533","snapshot_observed_at":"2026-07-13T03:08:01.590659Z","title":"Is independent learning all you need in the starcraft multi-agent challenge? arXiv preprint arXiv:2011.09533, 2020","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2607.09422","last_updated":"2026-07-10T13:50:29Z","snapshot_observed_at":"2026-08-02T03:29:36.466642Z","submitted_at":"2026-07-10T13:50:29Z","title":"Action-Factored Multi-Agent Reinforcement Learning for Scalable Quantum Device Tuning","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-07-13T03:08:01.590659Z"},"links":{"cited_paper":"/paper/2011.09533","citing_paper":"/paper/2607.09422"},"observation_digest":"sha256:b5458c4ce06b192264de5df11ab6cf37e3dc1779ce4371e7a92b3fb94c1edd74","observation_id":"779a09df-d05f-4cf1-a990-836252a614ad","resolution":{"observed_at":"2026-07-13T03:08:01.590659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T03:08:01.590659Z","title":"The sur- prising effectiveness of ppo in cooperative multi-agent games","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.09422","last_updated":"2026-07-10T13:50:29Z","snapshot_observed_at":"2026-08-02T03:29:36.466642Z","submitted_at":"2026-07-10T13:50:29Z","title":"Action-Factored Multi-Agent Reinforcement Learning for Scalable Quantum Device Tuning","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-07-13T03:08:01.590659Z"},"links":{"citing_paper":"/paper/2607.09422"},"observation_digest":"sha256:40b0881bf15d61aa5fbb3cecd8b23e81506838b922e4015d2fdd0aac9d263f91","observation_id":"2321d9e6-ebd1-451c-bda7-bcf887269725","resolution":{"observed_at":"2026-07-13T03:08:01.590659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2109.11251","last_updated":"2022-04-04T06:39:20Z","snapshot_observed_at":"2026-08-06T03:41:51.704789Z","submitted_at":"2021-09-23T09:44:35Z","title":"Trust Region Policy Optimisation in Multi-Agent Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2109.11251","snapshot_observed_at":"2026-07-13T03:08:01.590659Z","title":"Trust region policy optimisation in multi-agent reinforcement learning","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.09422","last_updated":"2026-07-10T13:50:29Z","snapshot_observed_at":"2026-08-02T03:29:36.466642Z","submitted_at":"2026-07-10T13:50:29Z","title":"Action-Factored Multi-Agent Reinforcement Learning for Scalable Quantum Device Tuning","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-07-13T03:08:01.590659Z"},"links":{"cited_paper":"/paper/2109.11251","citing_paper":"/paper/2607.09422"},"observation_digest":"sha256:4eca52da32d356ebe6508e28ffad7f9baf2ca6d3f22dec0959c3e15d7b05ce11","observation_id":"235d54c4-9e76-462f-9e21-80b4af10140d","resolution":{"observed_at":"2026-07-13T03:08:01.590659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T03:08:01.590659Z","title":"Heterogeneous- agent reinforcement learning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.09422","last_updated":"2026-07-10T13:50:29Z","snapshot_observed_at":"2026-08-02T03:29:36.466642Z","submitted_at":"2026-07-10T13:50:29Z","title":"Action-Factored Multi-Agent Reinforcement Learning for Scalable Quantum Device Tuning","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-07-13T03:08:01.590659Z"},"links":{"citing_paper":"/paper/2607.09422"},"observation_digest":"sha256:bdbf6532899d577781c72f4867f2b1448c5d23fc69d825a6a72355938cf9eeea","observation_id":"67a597cc-909b-4d69-be77-d1aa4bc8db46","resolution":{"observed_at":"2026-07-13T03:08:01.590659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T03:08:01.590659Z","title":"Hypermarl: Adaptive hypernetworks for multi-agent rl","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.09422","last_updated":"2026-07-10T13:50:29Z","snapshot_observed_at":"2026-08-02T03:29:36.466642Z","submitted_at":"2026-07-10T13:50:29Z","title":"Action-Factored Multi-Agent Reinforcement Learning for Scalable Quantum Device Tuning","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-07-13T03:08:01.590659Z"},"links":{"citing_paper":"/paper/2607.09422"},"observation_digest":"sha256:80ad8f93713136b68dc4d3717b515358f51890e5baad9362cdb9243b8603a8b3","observation_id":"9cea869a-c06c-49ee-98ee-7c7c5de5aaca","resolution":{"observed_at":"2026-07-13T03:08:01.590659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T03:08:01.590659Z","title":"Qarray: A gpu-accelerated constant capacitance model simulator for large quantum dot arrays","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.09422","last_updated":"2026-07-10T13:50:29Z","snapshot_observed_at":"2026-08-02T03:29:36.466642Z","submitted_at":"2026-07-10T13:50:29Z","title":"Action-Factored Multi-Agent Reinforcement Learning for Scalable Quantum Device Tuning","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-07-13T03:08:01.590659Z"},"links":{"citing_paper":"/paper/2607.09422"},"observation_digest":"sha256:48322c7ac6b49d5a6179eea343b5578435d626b791548f985b91b93b117f9bda","observation_id":"75baa93b-9309-4121-9ad4-e5d2671819b5","resolution":{"observed_at":"2026-07-13T03:08:01.590659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T03:08:01.590659Z","title":"Codebase release 1.3 for qarray","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.09422","last_updated":"2026-07-10T13:50:29Z","snapshot_observed_at":"2026-08-02T03:29:36.466642Z","submitted_at":"2026-07-10T13:50:29Z","title":"Action-Factored Multi-Agent Reinforcement Learning for Scalable Quantum Device Tuning","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-07-13T03:08:01.590659Z"},"links":{"citing_paper":"/paper/2607.09422"},"observation_digest":"sha256:26556c3943f8b479e488d806daa91509ebcb80b2337d08ec3442a079711aa334","observation_id":"913ec338-c91a-4c5e-8be0-2ac078e8e4a0","resolution":{"observed_at":"2026-07-13T03:08:01.590659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T03:08:01.590659Z","title":"The complexity of de- centralized control of markov decision processes","venue":null,"work_id":null,"year":2002},"citing_paper":{"arxiv_id":"2607.09422","last_updated":"2026-07-10T13:50:29Z","snapshot_observed_at":"2026-08-02T03:29:36.466642Z","submitted_at":"2026-07-10T13:50:29Z","title":"Action-Factored Multi-Agent Reinforcement Learning for Scalable Quantum Device Tuning","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-07-13T03:08:01.590659Z"},"links":{"citing_paper":"/paper/2607.09422"},"observation_digest":"sha256:a3218cde13cd56a432e219a64abbccb0fef088fedd20c66ba8516a4e33aaaf04","observation_id":"8e07136d-5340-4634-ad78-f347d1a3415c","resolution":{"observed_at":"2026-07-13T03:08:01.590659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T03:08:01.590659Z","title":"Learning to utilize shaping rewards: A new approach of reward shaping","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.09422","last_updated":"2026-07-10T13:50:29Z","snapshot_observed_at":"2026-08-02T03:29:36.466642Z","submitted_at":"2026-07-10T13:50:29Z","title":"Action-Factored Multi-Agent Reinforcement Learning for Scalable Quantum Device Tuning","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-07-13T03:08:01.590659Z"},"links":{"citing_paper":"/paper/2607.09422"},"observation_digest":"sha256:b0ceebb9d5c6afa0667487dcea8ad8003acc62a4591bb3d0606127c05d921ae4","observation_id":"df5b8ee3-e474-4c0a-a8bb-bc4a9b89f5e5","resolution":{"observed_at":"2026-07-13T03:08:01.590659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T03:08:01.590659Z","title":"Bayesian filtering: From kalman filters to particle filters, and beyond","venue":null,"work_id":null,"year":2003},"citing_paper":{"arxiv_id":"2607.09422","last_updated":"2026-07-10T13:50:29Z","snapshot_observed_at":"2026-08-02T03:29:36.466642Z","submitted_at":"2026-07-10T13:50:29Z","title":"Action-Factored Multi-Agent Reinforcement Learning for Scalable Quantum Device Tuning","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-07-13T03:08:01.590659Z"},"links":{"citing_paper":"/paper/2607.09422"},"observation_digest":"sha256:d946983a557a7a783512ec8b7bd2f301b62151a6b2fdddb64ee174a308f84d75","observation_id":"cee6a44f-3838-48d3-8453-48df01b20c14","resolution":{"observed_at":"2026-07-13T03:08:01.590659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T03:08:01.590659Z","title":"Nonlinear bayesian estimation: From kalman filtering to a broader horizon.IEEE/CAA Journal of Automatica Sinica, 5(2):401– 417, 2018","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.09422","last_updated":"2026-07-10T13:50:29Z","snapshot_observed_at":"2026-08-02T03:29:36.466642Z","submitted_at":"2026-07-10T13:50:29Z","title":"Action-Factored Multi-Agent Reinforcement Learning for Scalable Quantum Device Tuning","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-07-13T03:08:01.590659Z"},"links":{"citing_paper":"/paper/2607.09422"},"observation_digest":"sha256:734685f1318f6ff2c61a08c9f33c0d1149528f2bc8639e004777112d11164b67","observation_id":"7622e215-4417-4748-8fdb-51dabb9b79d4","resolution":{"observed_at":"2026-07-13T03:08:01.590659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T03:08:01.590659Z","title":"Actor-critic algorithms","venue":null,"work_id":null,"year":1999},"citing_paper":{"arxiv_id":"2607.09422","last_updated":"2026-07-10T13:50:29Z","snapshot_observed_at":"2026-08-02T03:29:36.466642Z","submitted_at":"2026-07-10T13:50:29Z","title":"Action-Factored Multi-Agent Reinforcement Learning for Scalable Quantum Device Tuning","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-07-13T03:08:01.590659Z"},"links":{"citing_paper":"/paper/2607.09422"},"observation_digest":"sha256:60e1b081bf3d934793f8d4791ece56836e73456e8e12ea4d73e594dc68ce7fda","observation_id":"c1512eeb-8b10-46db-acc8-f54d4edb11d4","resolution":{"observed_at":"2026-07-13T03:08:01.590659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.00849","last_updated":"2023-02-13T15:33:31Z","snapshot_observed_at":"2026-07-06T13:58:56.329236Z","submitted_at":"2022-09-29T19:08:51Z","title":"Scaling Laws for a Multi-Agent Reinforcement Learning Model","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.00849","snapshot_observed_at":"2026-07-13T03:08:01.590659Z","title":"Scaling laws for a multi-agent reinforcement learning model","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.09422","last_updated":"2026-07-10T13:50:29Z","snapshot_observed_at":"2026-08-02T03:29:36.466642Z","submitted_at":"2026-07-10T13:50:29Z","title":"Action-Factored Multi-Agent Reinforcement Learning for Scalable Quantum Device Tuning","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-07-13T03:08:01.590659Z"},"links":{"cited_paper":"/paper/2210.00849","citing_paper":"/paper/2607.09422"},"observation_digest":"sha256:ed79e6adbc5249087a93ecb1426b97ef889ef284d9f481ec817ec4bd8c2966cc","observation_id":"c7932402-ba4f-4643-b232-4a0163736cac","resolution":{"observed_at":"2026-07-13T03:08:01.590659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-07-13T03:08:01.590659Z","title":"Proximal policy optimization algorithms","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.09422","last_updated":"2026-07-10T13:50:29Z","snapshot_observed_at":"2026-08-02T03:29:36.466642Z","submitted_at":"2026-07-10T13:50:29Z","title":"Action-Factored Multi-Agent Reinforcement Learning for Scalable Quantum Device Tuning","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-07-13T03:08:01.590659Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2607.09422"},"observation_digest":"sha256:92ca1a5c9320c10cd4cbba7dd5352cc7c0b448d9a050ca64f990d235e72199f2","observation_id":"3696c613-ca52-42ee-b90e-61b06ad12ba0","resolution":{"observed_at":"2026-07-13T03:08:01.590659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T03:08:01.590659Z","title":"Survey on applications of multi-armed and contextual bandits","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.09422","last_updated":"2026-07-10T13:50:29Z","snapshot_observed_at":"2026-08-02T03:29:36.466642Z","submitted_at":"2026-07-10T13:50:29Z","title":"Action-Factored Multi-Agent Reinforcement Learning for Scalable Quantum Device Tuning","version":1},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-07-13T03:08:01.590659Z"},"links":{"citing_paper":"/paper/2607.09422"},"observation_digest":"sha256:029fb55071ed4588b0af757d16582950adb0485cc812a0c9a2ed5ad25f0aed39","observation_id":"2d038fcb-3b06-4415-a6cb-baefd5f50626","resolution":{"observed_at":"2026-07-13T03:08:01.590659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T03:08:01.590659Z","title":"Experience-driven networking: A deep reinforcement learning based approach","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.09422","last_updated":"2026-07-10T13:50:29Z","snapshot_observed_at":"2026-08-02T03:29:36.466642Z","submitted_at":"2026-07-10T13:50:29Z","title":"Action-Factored Multi-Agent Reinforcement Learning for Scalable Quantum Device Tuning","version":1},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-07-13T03:08:01.590659Z"},"links":{"citing_paper":"/paper/2607.09422"},"observation_digest":"sha256:40193ebe9216a1a85987900befe676fdc75984071e53933fd3d9a51ccacffd20","observation_id":"9a361d5a-ecf5-4025-b770-3f03803812d7","resolution":{"observed_at":"2026-07-13T03:08:01.590659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T03:08:01.590659Z","title":"A simplex method for function minimization","venue":null,"work_id":null,"year":1965},"citing_paper":{"arxiv_id":"2607.09422","last_updated":"2026-07-10T13:50:29Z","snapshot_observed_at":"2026-08-02T03:29:36.466642Z","submitted_at":"2026-07-10T13:50:29Z","title":"Action-Factored Multi-Agent Reinforcement Learning for Scalable Quantum Device Tuning","version":1},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-07-13T03:08:01.590659Z"},"links":{"citing_paper":"/paper/2607.09422"},"observation_digest":"sha256:38f08c461fb01da6fc1c731ab8545251c2efb4bb8a8f459eb343188881ffec9b","observation_id":"ed51303b-084f-4cc5-a997-6d4d993b8683","resolution":{"observed_at":"2026-07-13T03:08:01.590659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T03:08:01.590659Z","title":"Gaussian Processes for Machine Learning","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2607.09422","last_updated":"2026-07-10T13:50:29Z","snapshot_observed_at":"2026-08-02T03:29:36.466642Z","submitted_at":"2026-07-10T13:50:29Z","title":"Action-Factored Multi-Agent Reinforcement Learning for Scalable Quantum Device Tuning","version":1},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-07-13T03:08:01.590659Z"},"links":{"citing_paper":"/paper/2607.09422"},"observation_digest":"sha256:ba26ee6e52a9b3afbfa92a0a2fc308b9ad5d84048ea9884c3611361c7faa9733","observation_id":"d30808b2-6ea5-440d-9350-6ed824415b88","resolution":{"observed_at":"2026-07-13T03:08:01.590659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T03:08:01.590659Z","title":"Taking the human out of the loop: A review of bayesian optimization","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2607.09422","last_updated":"2026-07-10T13:50:29Z","snapshot_observed_at":"2026-08-02T03:29:36.466642Z","submitted_at":"2026-07-10T13:50:29Z","title":"Action-Factored Multi-Agent Reinforcement Learning for Scalable Quantum Device Tuning","version":1},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-07-13T03:08:01.590659Z"},"links":{"citing_paper":"/paper/2607.09422"},"observation_digest":"sha256:16e05da3fc2edc9d246b54f78771a016d4579c56bff5ddf65bc8cf8b47c693bf","observation_id":"81dcb0fa-7fc4-414d-87fa-d61b46d681a2","resolution":{"observed_at":"2026-07-13T03:08:01.590659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T03:08:01.590659Z","title":"Updating quasi-newton matrices with limited storage","venue":null,"work_id":null,"year":1980},"citing_paper":{"arxiv_id":"2607.09422","last_updated":"2026-07-10T13:50:29Z","snapshot_observed_at":"2026-08-02T03:29:36.466642Z","submitted_at":"2026-07-10T13:50:29Z","title":"Action-Factored Multi-Agent Reinforcement Learning for Scalable Quantum Device Tuning","version":1},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-07-13T03:08:01.590659Z"},"links":{"citing_paper":"/paper/2607.09422"},"observation_digest":"sha256:a4acbbc74680f8b9c26eb2cc4bcc43711829f3e4387eeeca1f29e20c3fb3893f","observation_id":"3edc6cfc-bed4-4789-8e1e-93c3b74e1793","resolution":{"observed_at":"2026-07-13T03:08:01.590659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T03:08:01.590659Z","title":"Mastering diverse domains through world models, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.09422","last_updated":"2026-07-10T13:50:29Z","snapshot_observed_at":"2026-08-02T03:29:36.466642Z","submitted_at":"2026-07-10T13:50:29Z","title":"Action-Factored Multi-Agent Reinforcement Learning for Scalable Quantum Device Tuning","version":1},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-07-13T03:08:01.590659Z"},"links":{"citing_paper":"/paper/2607.09422"},"observation_digest":"sha256:e96fe1de241565d56afa23c25afca950c24ed657f4a727e7dad7487f6c9bda93","observation_id":"24d49913-8bae-40d8-bce5-4bd341cb073a","resolution":{"observed_at":"2026-07-13T03:08:01.590659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T03:08:01.590659Z","title":"Deep residual learning for image recognition","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2607.09422","last_updated":"2026-07-10T13:50:29Z","snapshot_observed_at":"2026-08-02T03:29:36.466642Z","submitted_at":"2026-07-10T13:50:29Z","title":"Action-Factored Multi-Agent Reinforcement Learning for Scalable Quantum Device Tuning","version":1},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-07-13T03:08:01.590659Z"},"links":{"citing_paper":"/paper/2607.09422"},"observation_digest":"sha256:572187e82a66d377a83938bc9f9c30eb26ab9e64b9d835a63ec9856b49939807","observation_id":"5aea591a-7273-4049-88bc-51b870d916cb","resolution":{"observed_at":"2026-07-13T03:08:01.590659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T03:08:01.590659Z","title":"Long short-term memory","venue":null,"work_id":null,"year":1997},"citing_paper":{"arxiv_id":"2607.09422","last_updated":"2026-07-10T13:50:29Z","snapshot_observed_at":"2026-08-02T03:29:36.466642Z","submitted_at":"2026-07-10T13:50:29Z","title":"Action-Factored Multi-Agent Reinforcement Learning for Scalable Quantum Device Tuning","version":1},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-07-13T03:08:01.590659Z"},"links":{"citing_paper":"/paper/2607.09422"},"observation_digest":"sha256:5c9c7f75833ba85f80a3263cf06758130d806661d1dee2cfaa30a31098924543","observation_id":"e87c8a85-47a4-4b86-bbd8-1f838382c427","resolution":{"observed_at":"2026-07-13T03:08:01.590659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T03:08:01.590659Z","title":"Attention is all you need.Advances in neural information processing systems, 30, 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.09422","last_updated":"2026-07-10T13:50:29Z","snapshot_observed_at":"2026-08-02T03:29:36.466642Z","submitted_at":"2026-07-10T13:50:29Z","title":"Action-Factored Multi-Agent Reinforcement Learning for Scalable Quantum Device Tuning","version":1},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-07-13T03:08:01.590659Z"},"links":{"citing_paper":"/paper/2607.09422"},"observation_digest":"sha256:974ca826e36c9fde5f57aa9d08bf1247912d45ea2b94d2d33decb1b5198cef54","observation_id":"ebfec922-d3c4-4587-bcc2-28a1d8339957","resolution":{"observed_at":"2026-07-13T03:08:01.590659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T03:08:01.590659Z","title":"Kaleidoscope: Learnable masks for heterogeneous multi-agent reinforcement learning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.09422","last_updated":"2026-07-10T13:50:29Z","snapshot_observed_at":"2026-08-02T03:29:36.466642Z","submitted_at":"2026-07-10T13:50:29Z","title":"Action-Factored Multi-Agent Reinforcement Learning for Scalable Quantum Device Tuning","version":1},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-07-13T03:08:01.590659Z"},"links":{"citing_paper":"/paper/2607.09422"},"observation_digest":"sha256:f08ad62d4be5f263ba09c8c9587415d0ec8cd68e7eb4a31511d8f5961f06df17","observation_id":"c1351cc2-a7d5-4997-b5a3-a422fc108ded","resolution":{"observed_at":"2026-07-13T03:08:01.590659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T03:08:01.590659Z","title":"Quantum manipulation of two-electron spin states in isolated double quantum dots","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2607.09422","last_updated":"2026-07-10T13:50:29Z","snapshot_observed_at":"2026-08-02T03:29:36.466642Z","submitted_at":"2026-07-10T13:50:29Z","title":"Action-Factored Multi-Agent Reinforcement Learning for Scalable Quantum Device Tuning","version":1},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-07-13T03:08:01.590659Z"},"links":{"citing_paper":"/paper/2607.09422"},"observation_digest":"sha256:ad6af3db21a75be051ba768ba4896472016ea6f877af5e07d89fb982a5bc8f0e","observation_id":"6ee87ee6-413c-43aa-ab8e-afca4ff90ec7","resolution":{"observed_at":"2026-07-13T03:08:01.590659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T03:08:01.590659Z","title":"Concentration inequalities and model selection: Ecole d’Eté de Probabilités de Saint-Flour XXXIII-2003","venue":null,"work_id":null,"year":2003},"citing_paper":{"arxiv_id":"2607.09422","last_updated":"2026-07-10T13:50:29Z","snapshot_observed_at":"2026-08-02T03:29:36.466642Z","submitted_at":"2026-07-10T13:50:29Z","title":"Action-Factored Multi-Agent Reinforcement Learning for Scalable Quantum Device Tuning","version":1},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-07-13T03:08:01.590659Z"},"links":{"citing_paper":"/paper/2607.09422"},"observation_digest":"sha256:d6ede9b04c72a313b6acc7662a69581a501b53489c2a5ab5a6125d81cd99aa69","observation_id":"1dc590f7-704f-4977-af99-aac36cb19e7e","resolution":{"observed_at":"2026-07-13T03:08:01.590659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T03:08:01.590659Z","title":"Mitigating crosstalk errors for simultaneous single-qubit gates on a superconducting quantum processor.arXiv preprint arXiv:2603.11018, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.09422","last_updated":"2026-07-10T13:50:29Z","snapshot_observed_at":"2026-08-02T03:29:36.466642Z","submitted_at":"2026-07-10T13:50:29Z","title":"Action-Factored Multi-Agent Reinforcement Learning for Scalable Quantum Device Tuning","version":1},"reference_index":88,"source":"pdf_text","source_observed_at":"2026-07-13T03:08:01.590659Z"},"links":{"citing_paper":"/paper/2607.09422"},"observation_digest":"sha256:cfb275f20af33f90b9b77d772175c3a44b84d2f6960b299d6a01428c63d64f94","observation_id":"eac59fe5-c316-456f-ab25-5d0f11df4bee","resolution":{"observed_at":"2026-07-13T03:08:01.590659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T03:08:01.590659Z","title":"Practical guide for building supercon- ducting quantum devices","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.09422","last_updated":"2026-07-10T13:50:29Z","snapshot_observed_at":"2026-08-02T03:29:36.466642Z","submitted_at":"2026-07-10T13:50:29Z","title":"Action-Factored Multi-Agent Reinforcement Learning for Scalable Quantum Device Tuning","version":1},"reference_index":89,"source":"pdf_text","source_observed_at":"2026-07-13T03:08:01.590659Z"},"links":{"citing_paper":"/paper/2607.09422"},"observation_digest":"sha256:c8356d7537f32f30cd935bd349a8f128455e244c3dabac5203f73cef0c100598","observation_id":"015d9ffc-6f89-494f-9395-9bb305bc373e","resolution":{"observed_at":"2026-07-13T03:08:01.590659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T03:08:01.590659Z","title":"Entanglement and quantum error correction with superconducting qubits","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2607.09422","last_updated":"2026-07-10T13:50:29Z","snapshot_observed_at":"2026-08-02T03:29:36.466642Z","submitted_at":"2026-07-10T13:50:29Z","title":"Action-Factored Multi-Agent Reinforcement Learning for Scalable Quantum Device Tuning","version":1},"reference_index":90,"source":"pdf_text","source_observed_at":"2026-07-13T03:08:01.590659Z"},"links":{"citing_paper":"/paper/2607.09422"},"observation_digest":"sha256:0f6d60d4adc84638bfa35e991bf9be174b1822a9c511325004e5589389b2a580","observation_id":"37d658cd-e562-4ce9-839e-af35abeed48d","resolution":{"observed_at":"2026-07-13T03:08:01.590659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T03:08:01.590659Z","title":"Charge-insensitive qubit design derived from the cooper pair box","venue":null,"work_id":null,"year":2007},"citing_paper":{"arxiv_id":"2607.09422","last_updated":"2026-07-10T13:50:29Z","snapshot_observed_at":"2026-08-02T03:29:36.466642Z","submitted_at":"2026-07-10T13:50:29Z","title":"Action-Factored Multi-Agent Reinforcement Learning for Scalable Quantum Device Tuning","version":1},"reference_index":91,"source":"pdf_text","source_observed_at":"2026-07-13T03:08:01.590659Z"},"links":{"citing_paper":"/paper/2607.09422"},"observation_digest":"sha256:6e670a72c3d2088b667709542e90e4800667f3bb4e089fea628589da5c5055cd","observation_id":"a66de2ac-6ba5-41a0-89f3-e68f343858f5","resolution":{"observed_at":"2026-07-13T03:08:01.590659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T03:08:01.590659Z","title":"world model","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.09422","last_updated":"2026-07-10T13:50:29Z","snapshot_observed_at":"2026-08-02T03:29:36.466642Z","submitted_at":"2026-07-10T13:50:29Z","title":"Action-Factored Multi-Agent Reinforcement Learning for Scalable Quantum Device Tuning","version":1},"reference_index":92,"source":"pdf_text","source_observed_at":"2026-07-13T03:08:01.590659Z"},"links":{"citing_paper":"/paper/2607.09422"},"observation_digest":"sha256:0fa3b5e3435b7b783a280a44a999f8120f6afa00283cd508f099b9aa78474c97","observation_id":"b07aa845-f2d1-48fa-97f7-bd1df074a261","resolution":{"observed_at":"2026-07-13T03:08:01.590659Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.09422","last_updated":"2026-07-10T13:50:29Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-02T03:29:36.466642Z","submitted_at":"2026-07-10T13:50:29Z","title":"Action-Factored Multi-Agent Reinforcement Learning for Scalable Quantum Device Tuning"},"reference_resolution":{"displayed":92,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":91,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":92},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 92 of 92 outbound references and 0 inbound Pith citation observations for arXiv:2607.09422."}