{"as_of":"2026-08-08T08:47:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:ef11c14622f13e3e9b4505512d1c5ce0b07399d4d8ef1bf751c476a16f06af52","coverage":[{"denominator":46,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":46,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-04T10:26:10.871418Z","state":"measured"},{"denominator":46,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":46,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2510.10057/citation-record","integrity":"/paper/2510.10057/integrity","json":"/paper/2510.10057/citation-record.json","paper":"/paper/2510.10057"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:26:05.971389Z","title":", \" * write output.state after.block = add.period write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2510.10057","last_updated":"2026-07-22T06:28:33Z","snapshot_observed_at":"2026-08-07T08:14:30.365751Z","submitted_at":"2025-10-11T06:47:49Z","title":"One4Many-StablePacker: An Efficient Deep Reinforcement Learning Framework for the 3D Bin Packing Problem","version":2},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-04T10:26:05.971389Z"},"links":{"citing_paper":"/paper/2510.10057"},"observation_digest":"sha256:6277eb352fb2a4bec6dce5a0f100e75513cf1753c48fb2620ca1a18849e0d387","observation_id":"473f5ef6-9287-48a0-99a8-7758f559617c","resolution":{"observed_at":"2026-08-04T10:26:05.971389Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:26:06.045074Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2510.10057","last_updated":"2026-07-22T06:28:33Z","snapshot_observed_at":"2026-08-07T08:14:30.365751Z","submitted_at":"2025-10-11T06:47:49Z","title":"One4Many-StablePacker: An Efficient Deep Reinforcement Learning Framework for the 3D Bin Packing Problem","version":2},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-04T10:26:06.045074Z"},"links":{"citing_paper":"/paper/2510.10057"},"observation_digest":"sha256:1490da028f71a664786d6e360e895b158df59e81d2fb75db1c11993a9eab8acf","observation_id":"1eaa3570-b501-45b3-a72c-082d6862a80f","resolution":{"observed_at":"2026-08-04T10:26:06.045074Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1611.09940","last_updated":"2017-01-12T23:55:36Z","snapshot_observed_at":"2026-07-06T05:20:39.825511Z","submitted_at":"2016-11-29T23:22:39Z","title":"Neural Combinatorial Optimization with Reinforcement Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1611.09940","snapshot_observed_at":"2026-08-04T10:26:06.173285Z","title":"V.; Norouzi, M.; and Bengio, S","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2510.10057","last_updated":"2026-07-22T06:28:33Z","snapshot_observed_at":"2026-08-07T08:14:30.365751Z","submitted_at":"2025-10-11T06:47:49Z","title":"One4Many-StablePacker: An Efficient Deep Reinforcement Learning Framework for the 3D Bin Packing Problem","version":2},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-04T10:26:06.173285Z"},"links":{"cited_paper":"/paper/1611.09940","citing_paper":"/paper/2510.10057"},"observation_digest":"sha256:6fdc9cd46af21532de64899b77e3ebc395659023e786d18c1fe6c014841be090","observation_id":"bcec7bcd-f6bd-444b-a4e5-d1d03c68c2ac","resolution":{"observed_at":"2026-08-04T10:26:06.173285Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:26:06.342239Z","title":null,"venue":null,"work_id":null,"year":1995},"citing_paper":{"arxiv_id":"2510.10057","last_updated":"2026-07-22T06:28:33Z","snapshot_observed_at":"2026-08-07T08:14:30.365751Z","submitted_at":"2025-10-11T06:47:49Z","title":"One4Many-StablePacker: An Efficient Deep Reinforcement Learning Framework for the 3D Bin Packing Problem","version":2},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-04T10:26:06.342239Z"},"links":{"citing_paper":"/paper/2510.10057"},"observation_digest":"sha256:5218e7f1a27f13f3fae5be6411790e1f1567e438172e20b570dd5070acbbe9c3","observation_id":"075e5f93-473f-44f4-bdbd-a330b4a3cca2","resolution":{"observed_at":"2026-08-04T10:26:06.342239Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:26:06.487241Z","title":"G.; Perboli, G.; and Tadei, R","venue":null,"work_id":null,"year":2008},"citing_paper":{"arxiv_id":"2510.10057","last_updated":"2026-07-22T06:28:33Z","snapshot_observed_at":"2026-08-07T08:14:30.365751Z","submitted_at":"2025-10-11T06:47:49Z","title":"One4Many-StablePacker: An Efficient Deep Reinforcement Learning Framework for the 3D Bin Packing Problem","version":2},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-04T10:26:06.487241Z"},"links":{"citing_paper":"/paper/2510.10057"},"observation_digest":"sha256:4ec1d519f8c5f4656adb33761360e3b8eee1cca75cd8c7769343f49e8ba4c7b1","observation_id":"4e6e9e80-1f4c-4f05-a811-5623ad9d4d27","resolution":{"observed_at":"2026-08-04T10:26:06.487241Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:26:06.620663Z","title":"G.; Perboli, G.; and Tadei, R","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2510.10057","last_updated":"2026-07-22T06:28:33Z","snapshot_observed_at":"2026-08-07T08:14:30.365751Z","submitted_at":"2025-10-11T06:47:49Z","title":"One4Many-StablePacker: An Efficient Deep Reinforcement Learning Framework for the 3D Bin Packing Problem","version":2},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-04T10:26:06.620663Z"},"links":{"citing_paper":"/paper/2510.10057"},"observation_digest":"sha256:012e8d7f61ba2045634411a43c1fcce691068724b3e47359146b351c88a8dffe","observation_id":"00c10e80-e730-4556-96db-1f93ae8d6229","resolution":{"observed_at":"2026-08-04T10:26:06.620663Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.22617","last_updated":"2025-05-28T17:38:45Z","snapshot_observed_at":"2026-08-07T08:20:32.332400Z","submitted_at":"2025-05-28T17:38:45Z","title":"The Entropy Mechanism of Reinforcement Learning for Reasoning Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.22617","snapshot_observed_at":"2026-08-04T10:26:06.777745Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2510.10057","last_updated":"2026-07-22T06:28:33Z","snapshot_observed_at":"2026-08-07T08:14:30.365751Z","submitted_at":"2025-10-11T06:47:49Z","title":"One4Many-StablePacker: An Efficient Deep Reinforcement Learning Framework for the 3D Bin Packing Problem","version":2},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-04T10:26:06.777745Z"},"links":{"cited_paper":"/paper/2505.22617","citing_paper":"/paper/2510.10057"},"observation_digest":"sha256:3f1bb4e27bd1e0645f9e1c6c4cc69b56c355796ade476dcf0133fc5993555bc4","observation_id":"3a5197af-1ca4-48e6-ae12-1b744be77265","resolution":{"observed_at":"2026-08-04T10:26:06.777745Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:26:06.927245Z","title":"P.; and Sokolov, B","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2510.10057","last_updated":"2026-07-22T06:28:33Z","snapshot_observed_at":"2026-08-07T08:14:30.365751Z","submitted_at":"2025-10-11T06:47:49Z","title":"One4Many-StablePacker: An Efficient Deep Reinforcement Learning Framework for the 3D Bin Packing Problem","version":2},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-04T10:26:06.927245Z"},"links":{"citing_paper":"/paper/2510.10057"},"observation_digest":"sha256:28f1fb4f24a2532f80d16ad668a908d9fa8a17e68c6add63d8086a8c90b60ff7","observation_id":"534c4752-5052-4340-b980-1cb9dbe2620f","resolution":{"observed_at":"2026-08-04T10:26:06.927245Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1804.06896","last_updated":"2019-02-15T06:20:39Z","snapshot_observed_at":"2026-07-06T06:34:12.309939Z","submitted_at":"2018-04-17T07:00:42Z","title":"A Multi-task Selected Learning Approach for Solving 3D Flexible Bin Packing Problem","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1804.06896","snapshot_observed_at":"2026-08-04T10:26:07.045721Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2510.10057","last_updated":"2026-07-22T06:28:33Z","snapshot_observed_at":"2026-08-07T08:14:30.365751Z","submitted_at":"2025-10-11T06:47:49Z","title":"One4Many-StablePacker: An Efficient Deep Reinforcement Learning Framework for the 3D Bin Packing Problem","version":2},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-04T10:26:07.045721Z"},"links":{"cited_paper":"/paper/1804.06896","citing_paper":"/paper/2510.10057"},"observation_digest":"sha256:a3b77b893ad71693c1828e04e3247f82c62509d6724e8c05e3cb401f7119b73d","observation_id":"dfdd8104-d2a6-4c06-8a30-a94bf746a613","resolution":{"observed_at":"2026-08-04T10:26:07.045721Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:26:07.141206Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2510.10057","last_updated":"2026-07-22T06:28:33Z","snapshot_observed_at":"2026-08-07T08:14:30.365751Z","submitted_at":"2025-10-11T06:47:49Z","title":"One4Many-StablePacker: An Efficient Deep Reinforcement Learning Framework for the 3D Bin Packing Problem","version":2},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-04T10:26:07.141206Z"},"links":{"citing_paper":"/paper/2510.10057"},"observation_digest":"sha256:c9ad3f7f06ba689a722c3023dd4eb533d348eddb8a1642f45f55305ca4502b08","observation_id":"cac882cb-4ac8-4ffa-990d-b4ce3e0f936f","resolution":{"observed_at":"2026-08-04T10:26:07.141206Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:26:07.316622Z","title":"J.; Paterson, M","venue":null,"work_id":null,"year":1981},"citing_paper":{"arxiv_id":"2510.10057","last_updated":"2026-07-22T06:28:33Z","snapshot_observed_at":"2026-08-07T08:14:30.365751Z","submitted_at":"2025-10-11T06:47:49Z","title":"One4Many-StablePacker: An Efficient Deep Reinforcement Learning Framework for the 3D Bin Packing Problem","version":2},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-04T10:26:07.316622Z"},"links":{"citing_paper":"/paper/2510.10057"},"observation_digest":"sha256:1cde46cafd336336d867fdf4a40ccbc747d70905b3b81a6d16983fa579285a0f","observation_id":"5e6e2701-a787-4fae-b631-7d45b731f08b","resolution":{"observed_at":"2026-08-04T10:26:07.316622Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:26:07.461960Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2510.10057","last_updated":"2026-07-22T06:28:33Z","snapshot_observed_at":"2026-08-07T08:14:30.365751Z","submitted_at":"2025-10-11T06:47:49Z","title":"One4Many-StablePacker: An Efficient Deep Reinforcement Learning Framework for the 3D Bin Packing Problem","version":2},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-04T10:26:07.461960Z"},"links":{"citing_paper":"/paper/2510.10057"},"observation_digest":"sha256:0c6da5d5f5267b9b589e949ceb36af36515806a292540a4be3142c7f6a037601","observation_id":"c70e35e8-7632-4f7c-b9a6-51e6065a1bb7","resolution":{"observed_at":"2026-08-04T10:26:07.461960Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:26:07.644876Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2510.10057","last_updated":"2026-07-22T06:28:33Z","snapshot_observed_at":"2026-08-07T08:14:30.365751Z","submitted_at":"2025-10-11T06:47:49Z","title":"One4Many-StablePacker: An Efficient Deep Reinforcement Learning Framework for the 3D Bin Packing Problem","version":2},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-04T10:26:07.644876Z"},"links":{"citing_paper":"/paper/2510.10057"},"observation_digest":"sha256:2ffbbb0ece67b3c5d3e0cd41177c260a26ef01839c0276c1ba89e4d39a5e9d5d","observation_id":"584f3a6a-797d-47e4-b642-26054e42c0c0","resolution":{"observed_at":"2026-08-04T10:26:07.644876Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1708.05930","last_updated":"2017-08-20T03:53:04Z","snapshot_observed_at":"2026-07-06T05:55:55.700400Z","submitted_at":"2017-08-20T03:53:04Z","title":"Solving a New 3D Bin Packing Problem with Deep Reinforcement Learning Method","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1708.05930","snapshot_observed_at":"2026-08-04T10:26:07.714487Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2510.10057","last_updated":"2026-07-22T06:28:33Z","snapshot_observed_at":"2026-08-07T08:14:30.365751Z","submitted_at":"2025-10-11T06:47:49Z","title":"One4Many-StablePacker: An Efficient Deep Reinforcement Learning Framework for the 3D Bin Packing Problem","version":2},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-04T10:26:07.714487Z"},"links":{"cited_paper":"/paper/1708.05930","citing_paper":"/paper/2510.10057"},"observation_digest":"sha256:c061fb5988b5174b1dcbe857bc097edf9911bcca336d87b302cf09a1a97daa24","observation_id":"a197390a-86e1-4273-8415-44194a660534","resolution":{"observed_at":"2026-08-04T10:26:07.714487Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:26:07.821627Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2510.10057","last_updated":"2026-07-22T06:28:33Z","snapshot_observed_at":"2026-08-07T08:14:30.365751Z","submitted_at":"2025-10-11T06:47:49Z","title":"One4Many-StablePacker: An Efficient Deep Reinforcement Learning Framework for the 3D Bin Packing Problem","version":2},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-04T10:26:07.821627Z"},"links":{"citing_paper":"/paper/2510.10057"},"observation_digest":"sha256:3456d1d0c97e0eddff7a2c9793e14999b69160af2bda463a0a4c09f0c36aa276","observation_id":"bf1eea10-f0c9-4b87-912c-719a68c38cd4","resolution":{"observed_at":"2026-08-04T10:26:07.821627Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:26:07.923048Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2510.10057","last_updated":"2026-07-22T06:28:33Z","snapshot_observed_at":"2026-08-07T08:14:30.365751Z","submitted_at":"2025-10-11T06:47:49Z","title":"One4Many-StablePacker: An Efficient Deep Reinforcement Learning Framework for the 3D Bin Packing Problem","version":2},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-04T10:26:07.923048Z"},"links":{"citing_paper":"/paper/2510.10057"},"observation_digest":"sha256:609355094d1a86d0ce052a295fd2b6b0345d9a6020eeedb62ed820b585a31833","observation_id":"4dd9181b-0037-4877-a7a2-49c6c5d4782c","resolution":{"observed_at":"2026-08-04T10:26:07.923048Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:26:08.051235Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2510.10057","last_updated":"2026-07-22T06:28:33Z","snapshot_observed_at":"2026-08-07T08:14:30.365751Z","submitted_at":"2025-10-11T06:47:49Z","title":"One4Many-StablePacker: An Efficient Deep Reinforcement Learning Framework for the 3D Bin Packing Problem","version":2},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-04T10:26:08.051235Z"},"links":{"citing_paper":"/paper/2510.10057"},"observation_digest":"sha256:54c71068bf931ace5e80713a522ce518d71d6d5bdf4c69bf6f4bf51485ebd538","observation_id":"d337ba9b-4e71-4a6c-9bfe-314a03c427d2","resolution":{"observed_at":"2026-08-04T10:26:08.051235Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:26:08.169720Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2510.10057","last_updated":"2026-07-22T06:28:33Z","snapshot_observed_at":"2026-08-07T08:14:30.365751Z","submitted_at":"2025-10-11T06:47:49Z","title":"One4Many-StablePacker: An Efficient Deep Reinforcement Learning Framework for the 3D Bin Packing Problem","version":2},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-04T10:26:08.169720Z"},"links":{"citing_paper":"/paper/2510.10057"},"observation_digest":"sha256:000f785314f298b107a7e4f4f1c15ef138d93a959947ff71954463048cf0455c","observation_id":"cbd682a8-9a85-4b5e-b48a-6668e15d4659","resolution":{"observed_at":"2026-08-04T10:26:08.169720Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:26:08.258956Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2510.10057","last_updated":"2026-07-22T06:28:33Z","snapshot_observed_at":"2026-08-07T08:14:30.365751Z","submitted_at":"2025-10-11T06:47:49Z","title":"One4Many-StablePacker: An Efficient Deep Reinforcement Learning Framework for the 3D Bin Packing Problem","version":2},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-04T10:26:08.258956Z"},"links":{"citing_paper":"/paper/2510.10057"},"observation_digest":"sha256:e58e8a4857904a6a42b986930358ff2c9a23cf943bf3a06df08e57591d7b081f","observation_id":"3b41618a-ff8e-423b-9f75-8262ba8307f3","resolution":{"observed_at":"2026-08-04T10:26:08.258956Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:26:08.416560Z","title":null,"venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2510.10057","last_updated":"2026-07-22T06:28:33Z","snapshot_observed_at":"2026-08-07T08:14:30.365751Z","submitted_at":"2025-10-11T06:47:49Z","title":"One4Many-StablePacker: An Efficient Deep Reinforcement Learning Framework for the 3D Bin Packing Problem","version":2},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-04T10:26:08.416560Z"},"links":{"citing_paper":"/paper/2510.10057"},"observation_digest":"sha256:e979933e2d0fb273bce2471c8273b60fa55a8c8d9300d58ceda778fb739ea36e","observation_id":"d129e06f-5734-4e56-9a5d-750df6fe6a66","resolution":{"observed_at":"2026-08-04T10:26:08.416560Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1807.01672","last_updated":"2018-12-06T23:32:05Z","snapshot_observed_at":"2026-07-06T06:48:23.889615Z","submitted_at":"2018-07-04T16:40:53Z","title":"Ranked Reward: Enabling Self-Play Reinforcement Learning for Combinatorial Optimization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1807.01672","snapshot_observed_at":"2026-08-04T10:26:08.510755Z","title":"K.; Cohen, A.-S.; Kas, D.; Hajjar, K.; Dahl, T","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2510.10057","last_updated":"2026-07-22T06:28:33Z","snapshot_observed_at":"2026-08-07T08:14:30.365751Z","submitted_at":"2025-10-11T06:47:49Z","title":"One4Many-StablePacker: An Efficient Deep Reinforcement Learning Framework for the 3D Bin Packing Problem","version":2},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-04T10:26:08.510755Z"},"links":{"cited_paper":"/paper/1807.01672","citing_paper":"/paper/2510.10057"},"observation_digest":"sha256:f1a521ee3976540855438d68d3050709385ed757c3883aacbf1403ce5c83207f","observation_id":"2442e345-8c24-4d80-b58d-6f7c2b6438d1","resolution":{"observed_at":"2026-08-04T10:26:08.510755Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:26:08.637854Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2510.10057","last_updated":"2026-07-22T06:28:33Z","snapshot_observed_at":"2026-08-07T08:14:30.365751Z","submitted_at":"2025-10-11T06:47:49Z","title":"One4Many-StablePacker: An Efficient Deep Reinforcement Learning Framework for the 3D Bin Packing Problem","version":2},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-04T10:26:08.637854Z"},"links":{"citing_paper":"/paper/2510.10057"},"observation_digest":"sha256:afbfa223a8d600e0ec5fbe6c66e1d18355b4d1b56dad5c8835d6037aca364e31","observation_id":"6546dee6-3c25-4d40-8905-0a5fd6154381","resolution":{"observed_at":"2026-08-04T10:26:08.637854Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:26:08.722776Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2510.10057","last_updated":"2026-07-22T06:28:33Z","snapshot_observed_at":"2026-08-07T08:14:30.365751Z","submitted_at":"2025-10-11T06:47:49Z","title":"One4Many-StablePacker: An Efficient Deep Reinforcement Learning Framework for the 3D Bin Packing Problem","version":2},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-04T10:26:08.722776Z"},"links":{"citing_paper":"/paper/2510.10057"},"observation_digest":"sha256:1bd5f73b5e4b35387b05c53dfea73480fcbed167cfbbc0752defd95744ed2e46","observation_id":"f6e5cd0a-e557-47b8-8c19-800882a149d6","resolution":{"observed_at":"2026-08-04T10:26:08.722776Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:26:08.819289Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2510.10057","last_updated":"2026-07-22T06:28:33Z","snapshot_observed_at":"2026-08-07T08:14:30.365751Z","submitted_at":"2025-10-11T06:47:49Z","title":"One4Many-StablePacker: An Efficient Deep Reinforcement Learning Framework for the 3D Bin Packing Problem","version":2},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-04T10:26:08.819289Z"},"links":{"citing_paper":"/paper/2510.10057"},"observation_digest":"sha256:781e2b186d64540df14aa96f5ac0799f9a0a1c1bcd4e33fcf5fd98720b8cc690","observation_id":"9a70dfea-9dd2-4011-8888-38ca963e9c65","resolution":{"observed_at":"2026-08-04T10:26:08.819289Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:26:08.932886Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.10057","last_updated":"2026-07-22T06:28:33Z","snapshot_observed_at":"2026-08-07T08:14:30.365751Z","submitted_at":"2025-10-11T06:47:49Z","title":"One4Many-StablePacker: An Efficient Deep Reinforcement Learning Framework for the 3D Bin Packing Problem","version":2},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-04T10:26:08.932886Z"},"links":{"citing_paper":"/paper/2510.10057"},"observation_digest":"sha256:01d0431359cc9318571f3fa72b3af80fa27f8a6daa810f1a78edb19fd3074937","observation_id":"dae2c235-cca7-45ca-b72a-cdc1e6e5d3e1","resolution":{"observed_at":"2026-08-04T10:26:08.932886Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.12504","last_updated":"2025-05-18T17:44:53Z","snapshot_observed_at":"2026-08-08T07:46:06.468510Z","submitted_at":"2025-05-18T17:44:53Z","title":"CPGD: Toward Stable Rule-based Reinforcement Learning for Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.12504","snapshot_observed_at":"2026-08-04T10:26:09.003643Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2510.10057","last_updated":"2026-07-22T06:28:33Z","snapshot_observed_at":"2026-08-07T08:14:30.365751Z","submitted_at":"2025-10-11T06:47:49Z","title":"One4Many-StablePacker: An Efficient Deep Reinforcement Learning Framework for the 3D Bin Packing Problem","version":2},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-04T10:26:09.003643Z"},"links":{"cited_paper":"/paper/2505.12504","citing_paper":"/paper/2510.10057"},"observation_digest":"sha256:7e314a07d74df2c41df18fde8cb4de30ae03d4f98961e7693385ff3094f7f99c","observation_id":"4a0377a0-0911-4ff0-a708-91404fb5d5e8","resolution":{"observed_at":"2026-08-04T10:26:09.003643Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1711.05101","last_updated":"2019-01-04T21:01:49Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-11-14T14:24:06Z","title":"Decoupled Weight Decay Regularization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1711.05101","snapshot_observed_at":"2026-08-04T10:26:09.089627Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2510.10057","last_updated":"2026-07-22T06:28:33Z","snapshot_observed_at":"2026-08-07T08:14:30.365751Z","submitted_at":"2025-10-11T06:47:49Z","title":"One4Many-StablePacker: An Efficient Deep Reinforcement Learning Framework for the 3D Bin Packing Problem","version":2},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-04T10:26:09.089627Z"},"links":{"cited_paper":"/paper/1711.05101","citing_paper":"/paper/2510.10057"},"observation_digest":"sha256:5997c108577b45bca7d549e4d6555dd08845edc156958a872d5e980839c45388","observation_id":"615d055c-6c80-4aa4-ada6-7c726dca52aa","resolution":{"observed_at":"2026-08-04T10:26:09.089627Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:26:09.272344Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2510.10057","last_updated":"2026-07-22T06:28:33Z","snapshot_observed_at":"2026-08-07T08:14:30.365751Z","submitted_at":"2025-10-11T06:47:49Z","title":"One4Many-StablePacker: An Efficient Deep Reinforcement Learning Framework for the 3D Bin Packing Problem","version":2},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-04T10:26:09.272344Z"},"links":{"citing_paper":"/paper/2510.10057"},"observation_digest":"sha256:bcdf6c0fa0877b61eabcd727f7417872a92af4cd5850bd0a206f0e724b05d424","observation_id":"6fab7c61-0a11-4340-a3a5-5a9b90862d61","resolution":{"observed_at":"2026-08-04T10:26:09.272344Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:26:09.337550Z","title":null,"venue":null,"work_id":null,"year":2000},"citing_paper":{"arxiv_id":"2510.10057","last_updated":"2026-07-22T06:28:33Z","snapshot_observed_at":"2026-08-07T08:14:30.365751Z","submitted_at":"2025-10-11T06:47:49Z","title":"One4Many-StablePacker: An Efficient Deep Reinforcement Learning Framework for the 3D Bin Packing Problem","version":2},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-04T10:26:09.337550Z"},"links":{"citing_paper":"/paper/2510.10057"},"observation_digest":"sha256:cf4a51ec31b31e873cbdc370c53125219034bc06c83d726607228d8441cd0de3","observation_id":"06a2ea72-35d8-4acc-aa3d-c63dc5c78003","resolution":{"observed_at":"2026-08-04T10:26:09.337550Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:26:09.442198Z","title":null,"venue":null,"work_id":null,"year":2000},"citing_paper":{"arxiv_id":"2510.10057","last_updated":"2026-07-22T06:28:33Z","snapshot_observed_at":"2026-08-07T08:14:30.365751Z","submitted_at":"2025-10-11T06:47:49Z","title":"One4Many-StablePacker: An Efficient Deep Reinforcement Learning Framework for the 3D Bin Packing Problem","version":2},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-04T10:26:09.442198Z"},"links":{"citing_paper":"/paper/2510.10057"},"observation_digest":"sha256:4425ba556acbfe1f1fa82be3efbe2fdb5c40fc216a0489f91c4e1fe3916860eb","observation_id":"8e6a9bf3-ecf9-45e0-9512-2caba572af46","resolution":{"observed_at":"2026-08-04T10:26:09.442198Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:26:09.577204Z","title":null,"venue":null,"work_id":null,"year":2002},"citing_paper":{"arxiv_id":"2510.10057","last_updated":"2026-07-22T06:28:33Z","snapshot_observed_at":"2026-08-07T08:14:30.365751Z","submitted_at":"2025-10-11T06:47:49Z","title":"One4Many-StablePacker: An Efficient Deep Reinforcement Learning Framework for the 3D Bin Packing Problem","version":2},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-04T10:26:09.577204Z"},"links":{"citing_paper":"/paper/2510.10057"},"observation_digest":"sha256:7603b32883e6e7d1d9e6cfeb006cfdb3b4887a7b6db2455461bdad408815b3b6","observation_id":"afbd66c2-626a-4551-946b-d4b737410708","resolution":{"observed_at":"2026-08-04T10:26:09.577204Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:26:09.660501Z","title":null,"venue":null,"work_id":null,"year":1988},"citing_paper":{"arxiv_id":"2510.10057","last_updated":"2026-07-22T06:28:33Z","snapshot_observed_at":"2026-08-07T08:14:30.365751Z","submitted_at":"2025-10-11T06:47:49Z","title":"One4Many-StablePacker: An Efficient Deep Reinforcement Learning Framework for the 3D Bin Packing Problem","version":2},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-04T10:26:09.660501Z"},"links":{"citing_paper":"/paper/2510.10057"},"observation_digest":"sha256:77644dbfb981c03eba92c7a3463391f00d0551a010a877fa46b1cfe35fd972b8","observation_id":"57545c43-2c29-40bd-8ff7-865c4f68e422","resolution":{"observed_at":"2026-08-04T10:26:09.660501Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:26:09.733441Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2510.10057","last_updated":"2026-07-22T06:28:33Z","snapshot_observed_at":"2026-08-07T08:14:30.365751Z","submitted_at":"2025-10-11T06:47:49Z","title":"One4Many-StablePacker: An Efficient Deep Reinforcement Learning Framework for the 3D Bin Packing Problem","version":2},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-04T10:26:09.733441Z"},"links":{"citing_paper":"/paper/2510.10057"},"observation_digest":"sha256:2d8d43fdb0781d8798e5e19c3b1644f4bd2a3d252f184abcfe43aba324676b89","observation_id":"e2eec3ff-15a6-4175-93d5-57c96412ded2","resolution":{"observed_at":"2026-08-04T10:26:09.733441Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:26:09.789010Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2510.10057","last_updated":"2026-07-22T06:28:33Z","snapshot_observed_at":"2026-08-07T08:14:30.365751Z","submitted_at":"2025-10-11T06:47:49Z","title":"One4Many-StablePacker: An Efficient Deep Reinforcement Learning Framework for the 3D Bin Packing Problem","version":2},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-04T10:26:09.789010Z"},"links":{"citing_paper":"/paper/2510.10057"},"observation_digest":"sha256:346e9f2c2f8140acc9091c0a1a925e0815d744d06c93cf73c762e7030bbdf65f","observation_id":"f97954bd-7e30-4266-81a9-6dd2ce063c23","resolution":{"observed_at":"2026-08-04T10:26:09.789010Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.01939","last_updated":"2025-11-13T10:08:29Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-06-02T17:54:39Z","title":"Beyond the 80/20 Rule: High-Entropy Minority Tokens Drive Effective Reinforcement Learning for LLM Reasoning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.01939","snapshot_observed_at":"2026-08-04T10:26:09.892550Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2510.10057","last_updated":"2026-07-22T06:28:33Z","snapshot_observed_at":"2026-08-07T08:14:30.365751Z","submitted_at":"2025-10-11T06:47:49Z","title":"One4Many-StablePacker: An Efficient Deep Reinforcement Learning Framework for the 3D Bin Packing Problem","version":2},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-04T10:26:09.892550Z"},"links":{"cited_paper":"/paper/2506.01939","citing_paper":"/paper/2510.10057"},"observation_digest":"sha256:f303b8112714b18a0b72f6cc9a33ff6b64956bad51dc24f25fe5ad01c3a00c8d","observation_id":"29ff64a5-0d8d-4a71-afca-96646e69b284","resolution":{"observed_at":"2026-08-04T10:26:09.892550Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.08103","last_updated":"2023-12-13T12:39:25Z","snapshot_observed_at":"2026-07-06T17:01:00.985811Z","submitted_at":"2023-12-13T12:39:25Z","title":"Machine Learning for the Multi-Dimensional Bin Packing Problem: Literature Review and Empirical Evaluation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.08103","snapshot_observed_at":"2026-08-04T10:26:09.963492Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2510.10057","last_updated":"2026-07-22T06:28:33Z","snapshot_observed_at":"2026-08-07T08:14:30.365751Z","submitted_at":"2025-10-11T06:47:49Z","title":"One4Many-StablePacker: An Efficient Deep Reinforcement Learning Framework for the 3D Bin Packing Problem","version":2},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-04T10:26:09.963492Z"},"links":{"cited_paper":"/paper/2312.08103","citing_paper":"/paper/2510.10057"},"observation_digest":"sha256:6716a4247e7cf721de0b890c08a50c6b19630f6ee7095a699c08ea39b73b97c0","observation_id":"afa02894-e5b5-4ef6-9d47-2843b920ceee","resolution":{"observed_at":"2026-08-04T10:26:09.963492Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.00415","last_updated":"2025-04-25T06:52:44Z","snapshot_observed_at":"2026-08-07T23:28:05.451374Z","submitted_at":"2024-06-01T12:18:39Z","title":"Neural Combinatorial Optimization Algorithms for Solving Vehicle Routing Problems: A Comprehensive Survey with Perspectives","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.00415","snapshot_observed_at":"2026-08-04T10:26:10.007893Z","title":"L.; and Zhou, Y","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.10057","last_updated":"2026-07-22T06:28:33Z","snapshot_observed_at":"2026-08-07T08:14:30.365751Z","submitted_at":"2025-10-11T06:47:49Z","title":"One4Many-StablePacker: An Efficient Deep Reinforcement Learning Framework for the 3D Bin Packing Problem","version":2},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-04T10:26:10.007893Z"},"links":{"cited_paper":"/paper/2406.00415","citing_paper":"/paper/2510.10057"},"observation_digest":"sha256:fb885a3e51ebe9b6f4d05b6bc4d6e80f278364328ba2e9a6de9ddaad8e0d0277","observation_id":"6ba2c467-12d8-41be-af0f-90a44f672b9b","resolution":{"observed_at":"2026-08-04T10:26:10.007893Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:26:10.093693Z","title":null,"venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2510.10057","last_updated":"2026-07-22T06:28:33Z","snapshot_observed_at":"2026-08-07T08:14:30.365751Z","submitted_at":"2025-10-11T06:47:49Z","title":"One4Many-StablePacker: An Efficient Deep Reinforcement Learning Framework for the 3D Bin Packing Problem","version":2},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-04T10:26:10.093693Z"},"links":{"citing_paper":"/paper/2510.10057"},"observation_digest":"sha256:dd9b8cc074dc6ae115fba5d425b2b666ec262b1a61aaada063aad95be939ef46","observation_id":"d549efae-941f-410a-a885-89ab09450ae2","resolution":{"observed_at":"2026-08-04T10:26:10.093693Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:26:10.224836Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.10057","last_updated":"2026-07-22T06:28:33Z","snapshot_observed_at":"2026-08-07T08:14:30.365751Z","submitted_at":"2025-10-11T06:47:49Z","title":"One4Many-StablePacker: An Efficient Deep Reinforcement Learning Framework for the 3D Bin Packing Problem","version":2},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-04T10:26:10.224836Z"},"links":{"citing_paper":"/paper/2510.10057"},"observation_digest":"sha256:579e4d51b52d67b516e18840eb6f0acfd44e23727bc0798292b56b8a3e7e5d53","observation_id":"292d2468-9d05-4c7b-a7e7-47f9d6520f36","resolution":{"observed_at":"2026-08-04T10:26:10.224836Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:26:10.306355Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2510.10057","last_updated":"2026-07-22T06:28:33Z","snapshot_observed_at":"2026-08-07T08:14:30.365751Z","submitted_at":"2025-10-11T06:47:49Z","title":"One4Many-StablePacker: An Efficient Deep Reinforcement Learning Framework for the 3D Bin Packing Problem","version":2},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-04T10:26:10.306355Z"},"links":{"citing_paper":"/paper/2510.10057"},"observation_digest":"sha256:16916a60e39bb732710ddc827ca5a67c67f6b626bc67d30bce16305f8b001ee2","observation_id":"12f8d62b-ffbd-4a39-b948-f0c8db251adc","resolution":{"observed_at":"2026-08-04T10:26:10.306355Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:26:10.388195Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.10057","last_updated":"2026-07-22T06:28:33Z","snapshot_observed_at":"2026-08-07T08:14:30.365751Z","submitted_at":"2025-10-11T06:47:49Z","title":"One4Many-StablePacker: An Efficient Deep Reinforcement Learning Framework for the 3D Bin Packing Problem","version":2},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-04T10:26:10.388195Z"},"links":{"citing_paper":"/paper/2510.10057"},"observation_digest":"sha256:3cb4077895b9678c11336d7429ae1a04af8f47b5fd7ff1f54b26c8da3f1209a8","observation_id":"8a5bd26e-616a-4c6d-b0c9-06ea3820b098","resolution":{"observed_at":"2026-08-04T10:26:10.388195Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2107.04333","last_updated":"2021-08-02T09:50:24Z","snapshot_observed_at":"2026-08-06T23:01:54.111230Z","submitted_at":"2021-07-09T10:00:30Z","title":"Attend2Pack: Bin Packing through Deep Reinforcement Learning with Attention","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2107.04333","snapshot_observed_at":"2026-08-04T10:26:10.411669Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2510.10057","last_updated":"2026-07-22T06:28:33Z","snapshot_observed_at":"2026-08-07T08:14:30.365751Z","submitted_at":"2025-10-11T06:47:49Z","title":"One4Many-StablePacker: An Efficient Deep Reinforcement Learning Framework for the 3D Bin Packing Problem","version":2},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-04T10:26:10.411669Z"},"links":{"cited_paper":"/paper/2107.04333","citing_paper":"/paper/2510.10057"},"observation_digest":"sha256:b009b31fde5547f5701f9889c4b1e7b3e4a01c27d79ca5695c2b3c713e6ef964","observation_id":"e9148d4f-a9c0-4c4f-a72e-993ea5432acc","resolution":{"observed_at":"2026-08-04T10:26:10.411669Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:26:10.539743Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.10057","last_updated":"2026-07-22T06:28:33Z","snapshot_observed_at":"2026-08-07T08:14:30.365751Z","submitted_at":"2025-10-11T06:47:49Z","title":"One4Many-StablePacker: An Efficient Deep Reinforcement Learning Framework for the 3D Bin Packing Problem","version":2},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-04T10:26:10.539743Z"},"links":{"citing_paper":"/paper/2510.10057"},"observation_digest":"sha256:edc726ac827acfa3219342b0269477a1e61fcb4ee03da87f596ee61f12feaa36","observation_id":"848083c3-1c1f-4aa0-94ad-859a35bba738","resolution":{"observed_at":"2026-08-04T10:26:10.539743Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:26:10.616106Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2510.10057","last_updated":"2026-07-22T06:28:33Z","snapshot_observed_at":"2026-08-07T08:14:30.365751Z","submitted_at":"2025-10-11T06:47:49Z","title":"One4Many-StablePacker: An Efficient Deep Reinforcement Learning Framework for the 3D Bin Packing Problem","version":2},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-04T10:26:10.616106Z"},"links":{"citing_paper":"/paper/2510.10057"},"observation_digest":"sha256:a822f3428b3dfe26c489c4ce4c1bc09c39170c071384362c08f8368ec7bcaa02","observation_id":"5c3c569c-1d6e-4ed8-b733-2ddfe62e49a1","resolution":{"observed_at":"2026-08-04T10:26:10.616106Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:26:10.742271Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2510.10057","last_updated":"2026-07-22T06:28:33Z","snapshot_observed_at":"2026-08-07T08:14:30.365751Z","submitted_at":"2025-10-11T06:47:49Z","title":"One4Many-StablePacker: An Efficient Deep Reinforcement Learning Framework for the 3D Bin Packing Problem","version":2},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-04T10:26:10.742271Z"},"links":{"citing_paper":"/paper/2510.10057"},"observation_digest":"sha256:0018ef3b06a5c7746c8838bb7130f2fe9ec11c82aecaeb0b9d838bb9a72e9c40","observation_id":"60207276-e32b-46a0-975f-40136de8274c","resolution":{"observed_at":"2026-08-04T10:26:10.742271Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T10:26:10.871418Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.10057","last_updated":"2026-07-22T06:28:33Z","snapshot_observed_at":"2026-08-07T08:14:30.365751Z","submitted_at":"2025-10-11T06:47:49Z","title":"One4Many-StablePacker: An Efficient Deep Reinforcement Learning Framework for the 3D Bin Packing Problem","version":2},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-04T10:26:10.871418Z"},"links":{"citing_paper":"/paper/2510.10057"},"observation_digest":"sha256:6ceed77906de6ace93fdbacc1cadaed78ef33bb89c79b8ae81dcef2bbe19c6aa","observation_id":"49b1adeb-039d-4da6-9155-222f5bf237b0","resolution":{"observed_at":"2026-08-04T10:26:10.871418Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2510.10057","last_updated":"2026-07-22T06:28:33Z","latest_version":2,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-07T08:14:30.365751Z","submitted_at":"2025-10-11T06:47:49Z","title":"One4Many-StablePacker: An Efficient Deep Reinforcement Learning Framework for the 3D Bin Packing Problem"},"reference_resolution":{"displayed":46,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":46,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":46},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 46 of 46 outbound references and 0 inbound Pith citation observations for arXiv:2510.10057."}